Naar de inhoud
Terug naar overzicht
AI NieuwsQwenBeeldgeneratieOpen Modellen

Qwen-Image 2.1 maakt de achtergrond echt transparant

·Door
Qwen-Image 2.1 maakt de achtergrond echt transparant

Alibaba's nieuwe beeldmodel levert geen onderwerp op een witte achtergrond, maar kan een bestand met een echt transparant kanaal maken. Dat klinkt als een klein technisch verschil. Voor productfoto's, presentaties en vormgeving scheelt het een aparte stap.

De gewichten van Qwen-Image 2.1 staan sinds 20 september online. Toch mag een bedrijf dit model niet zonder meer in zijn eigen beeldstraat zetten. De licentie is het interessantste deel van dit verhaal.

Transparantie zit nu in het beeldmodel

Een gewone afbeelding bevat rood, groen en blauw. Een RGBA-bestand heeft een vierde kanaal: alpha. Dat bepaalt per pixel wat zichtbaar is en wat doorschijnt.

Qwen-Image 2.1 heeft daarvoor een eigen RGBA-encoder. Het model kan een onderwerp direct zonder vaste achtergrond genereren, een object uit een foto losmaken en daarna die transparante laag verder bewerken. Alibaba laat bijvoorbeeld tekst in zo'n laag vervangen zonder de transparantie kwijt te raken (officiële aankondiging).

“The model natively generates transparent images.”

— Qwen-team, ontwikkelteam van Alibaba Cloud (modeldocumentatie)

Genereren en bewerken zitten in dezelfde pijplijn. Volgens Alibaba accepteert die maximaal tien referentiebeelden. Met een aanwijzing kan het model ook maar één deel aanpassen: een cirkel om een horloge dat weg moet, een masker voor nieuwe kleding of een markering bij haar dat van kleur verandert. Dit zijn claims en voorbeelden van Alibaba. Ik heb het model niet zelf getest en er is nog geen onafhankelijke vergelijking die deze kwaliteit bevestigt.

Zeven miljard is niet de hele rekensom

Alibaba zet vooral het getal van 7 miljard parameters vooraan. Dat slaat op de visuele generator met 32 lagen. De architectuurbeschrijving noemt daarnaast een Qwen3-VL-encoder van 8 miljard parameters die tekst en referentiebeelden verwerkt, plus de encoder voor RGBA-beelden.

De visuele generator is daarmee compact vergeleken met veel grote beeldmodellen. Toch beschrijft “7B” niet de hele lokale pijplijn. De documentatie noemt geen universele minimale hoeveelheid videogeheugen of een vaste generatietijd. Bij te weinig videogeheugen kunnen modeldelen tijdelijk naar het werkgeheugen.

De standaarduitvoer is volgens Alibaba 2048 bij 2048 pixels. Ondersteuning was er op de releasedag al voor onder meer Diffusers, ComfyUI, vLLM-Omni en SGLang. Onderzoekers konden de gewichten daardoor meteen op eigen infrastructuur draaien. OpenAI beheert ChatGPT Images 2.5 juist zelf als dienst.

Downloadbaar betekent hier niet commercieel vrij

Alibaba noemt Qwen-Image 2.1 open-source. De daadwerkelijke licentie is strenger dan die term suggereert.

De Qwen Research License staat gebruik, kopiëren, aanpassen en verspreiden alleen toe voor niet-commercieel onderzoek of evaluatie. Wie de materialen commercieel wil gebruiken, moet bij Alibaba een aparte licentie aanvragen. Dat raakt precies de bedrijven waarvoor lokale beeldgeneratie aantrekkelijk is: bureaus, webwinkels en productteams die klantbeelden niet naar een externe dienst willen sturen.

De gewichten zijn dus open om te downloaden en te onderzoeken. Of ze in een betaalde dienst, marketingproces of product mogen draaien, staat niet in de downloadknop maar in artikel 2 van de licentie.

Volgende Stap

Wil je uitzoeken welke beeldmodellen bij je proces én gebruiksrechten passen? Neem contact op en we brengen het in kaart.

Headerbeeld: The Decoder.

Hoe AI-ready is jouw organisatie?

Doe de gratis AI-Readiness Scan: 9 vragen, 2 minuten, direct een persoonlijk advies.