Qwen-Image 2.1 maakt de achtergrond echt transparant

Alibaba's nieuwe beeldmodel levert geen onderwerp op een witte achtergrond, maar kan een bestand met een echt transparant kanaal maken. Dat klinkt als een klein technisch verschil. Voor productfoto's, presentaties en vormgeving scheelt het een aparte stap.
De gewichten van Qwen-Image 2.1 staan sinds 20 september online. Toch mag een bedrijf dit model niet zonder meer in zijn eigen beeldstraat zetten. De licentie is het interessantste deel van dit verhaal.
Transparantie zit nu in het beeldmodel
Een gewone afbeelding bevat rood, groen en blauw. Een RGBA-bestand heeft een vierde kanaal: alpha. Dat bepaalt per pixel wat zichtbaar is en wat doorschijnt.
Qwen-Image 2.1 heeft daarvoor een eigen RGBA-encoder. Het model kan een onderwerp direct zonder vaste achtergrond genereren, een object uit een foto losmaken en daarna die transparante laag verder bewerken. Alibaba laat bijvoorbeeld tekst in zo'n laag vervangen zonder de transparantie kwijt te raken (officiële aankondiging).
“The model natively generates transparent images.”
— Qwen-team, ontwikkelteam van Alibaba Cloud (modeldocumentatie)
Genereren en bewerken zitten in dezelfde pijplijn. Volgens Alibaba accepteert die maximaal tien referentiebeelden. Met een aanwijzing kan het model ook maar één deel aanpassen: een cirkel om een horloge dat weg moet, een masker voor nieuwe kleding of een markering bij haar dat van kleur verandert. Dit zijn claims en voorbeelden van Alibaba. Ik heb het model niet zelf getest en er is nog geen onafhankelijke vergelijking die deze kwaliteit bevestigt.
Zeven miljard is niet de hele rekensom
Alibaba zet vooral het getal van 7 miljard parameters vooraan. Dat slaat op de visuele generator met 32 lagen. De architectuurbeschrijving noemt daarnaast een Qwen3-VL-encoder van 8 miljard parameters die tekst en referentiebeelden verwerkt, plus de encoder voor RGBA-beelden.
De visuele generator is daarmee compact vergeleken met veel grote beeldmodellen. Toch beschrijft “7B” niet de hele lokale pijplijn. De documentatie noemt geen universele minimale hoeveelheid videogeheugen of een vaste generatietijd. Bij te weinig videogeheugen kunnen modeldelen tijdelijk naar het werkgeheugen.
De standaarduitvoer is volgens Alibaba 2048 bij 2048 pixels. Ondersteuning was er op de releasedag al voor onder meer Diffusers, ComfyUI, vLLM-Omni en SGLang. Onderzoekers konden de gewichten daardoor meteen op eigen infrastructuur draaien. OpenAI beheert ChatGPT Images 2.5 juist zelf als dienst.
Downloadbaar betekent hier niet commercieel vrij
Alibaba noemt Qwen-Image 2.1 open-source. De daadwerkelijke licentie is strenger dan die term suggereert.
De Qwen Research License staat gebruik, kopiëren, aanpassen en verspreiden alleen toe voor niet-commercieel onderzoek of evaluatie. Wie de materialen commercieel wil gebruiken, moet bij Alibaba een aparte licentie aanvragen. Dat raakt precies de bedrijven waarvoor lokale beeldgeneratie aantrekkelijk is: bureaus, webwinkels en productteams die klantbeelden niet naar een externe dienst willen sturen.
De gewichten zijn dus open om te downloaden en te onderzoeken. Of ze in een betaalde dienst, marketingproces of product mogen draaien, staat niet in de downloadknop maar in artikel 2 van de licentie.
Volgende Stap
Wil je uitzoeken welke beeldmodellen bij je proces én gebruiksrechten passen? Neem contact op en we brengen het in kaart.
Headerbeeld: The Decoder.
Lees ook

OpenAI maakt cachemissers in GPT-6 zichtbaar
GPT-6 krijgt een cache-dashboard en diagnose per misser. De korting kan 90% zijn, maar een cache write kost eerst 25% extra.

Anthropics Opus 5.5 haalt Fable in en kost minder dan Opus 5
Claude Opus 5.5 kost $4 en $20 per miljoen tokens, een vijfde minder dan Opus 5, en scoort op de meeste tests zo hoog als het veel duurdere Fable 5.1.

Gemini hackte drie bedrijven, Google zweeg zeven weken
Tijdens een beveiligingstest kreeg Gemini per ongeluk toegang tot het echte internet en brak in bij drie bedrijven. Google wist het sinds eind juli.
Hoe AI-ready is jouw organisatie?
Doe de gratis AI-Readiness Scan: 9 vragen, 2 minuten, direct een persoonlijk advies.