AI & computing › Generatieve AI & synthetische media
xAI's Imagine 2.0 net iets minder goed dan GPT-Image-2 in beeldtests
xAI heeft een nieuwe versie van zijn beeldgenerator Imagine gelanceerd, met uitgebreide bewerkingsfuncties en kant-en-klare sjablonen. In onafhankelijke ranglijsten eindigt het model wereldwijd op de tweede plek, net achter GPT-Image-2 van OpenAI.
Het bedrijf xAI, opgericht door Elon Musk, heeft Imagine Image 2.0 uitgebracht. Het nieuwe model is te gebruiken als "Quality Mode" op de website grok.com/imagine en in de Grok-apps voor iOS en Android. Toegang via een programmeerinterface (API), waarmee andere bedrijven het model in hun eigen software kunnen inbouwen, volgt volgens xAI binnenkort. Het model is gebaseerd op een diffusiemodel, een techniek waarbij een AI-systeem stap voor stap ruis omzet in een scherpe afbeelding.
xAI claimt dat Imagine 2.0 instructies nauwkeuriger opvolgt dan zijn voorganger, tekst en lay-out netjes weet te houden in complexe afbeeldingen, en consistent blijft als je meerdere versies van dezelfde afbeelding genereert. Dat laatste is voor gebruikers belangrijk: eerdere beeldgeneratoren produceerden vaak wisselende resultaten bij een vergelijkbare opdracht.
Tweede plek in onafhankelijke ranglijsten
De prestaties van het model zijn getoetst op LMArena, een populaire benchmark waarbij gebruikers blind twee AI-gegenereerde beelden met elkaar vergelijken en aangeven welke beter is. Uit die duizenden vergelijkingen rolt een Elo-score per model, een ranglijstsysteem dat oorspronkelijk uit het schaken komt: hoe hoger het getal, hoe vaker een model wint van concurrenten.
Volgens de meting van 7 augustus 2026 scoort de snellere "low"-variant van Imagine 2.0 wereldwijd de tweede plaats in twee categorieën. Bij het bewerken van bestaande afbeeldingen (Image Edit Arena) haalt het model een Elo-score van 1.439, tegenover 1.463 voor GPT-Image-2 van OpenAI. Bij het genereren van beelden op basis van tekst (Text-to-Image Arena) staat Imagine 2.0 op 1.320, tegenover 1.380 voor GPT-Image-2. Andere grote spelers zoals xAI's eigen Reve 2.1, Meta's Muse-Image, Alibaba's Qwen-Image-3.0-Pro, Google's Gemini en ByteDance's SeedDream eindigen lager. Vergeleken met de vorige "Quality"-versie van xAI's eigen model is de sprong groot.
Meer bewerkingsgereedschap en sjablonen
Imagine 2.0 krijgt een reeks nieuwe bewerkingstools voor wie een afbeelding stap voor stap wil verfijnen, een vorm van beeldfabricage die steeds toegankelijker wordt. "Magic Wand" past alleen het geselecteerde deel van een afbeelding aan, terwijl een segmentatiefunctie gebruikers toelaat om precies af te bakenen welk gebied bewerkt moet worden. Een aparte tool verwijdert de achtergrond en levert het onderwerp op met een doorzichtige ondergrond, handig voor bijvoorbeeld productfoto's. Met Multi-Ref Editing kunnen tot vijf bronafbeeldingen worden gecombineerd tot één nieuw beeld, en Smart Resize past een bestaande afbeelding aan naar elke gewenste beeldverhouding, waarbij het model zelf de extra ruimte invult.
Daarnaast introduceert xAI kant-en-klare sjablonen voor veelgebruikte taken, van fotobewerking en productfotografie tot marketingmateriaal, game-assets en emoji's voor livestreams. Opvallend is een functie die personages, locaties en objecten los van elkaar genereert maar wel in dezelfde visuele stijl houdt. xAI presenteert dit als een eerste stap richting volledige video-productie: de losse beeldelementen moeten straks dienen als bouwstenen voor AI-gegenereerde video's.
Achtergrond & begrippen
Wat betekent dit voor de toekomst? De race tussen xAI, OpenAI en andere techbedrijven om de beste beeldgenerator laat zien hoe snel deze technologie verbetert en hoe dicht concurrerende modellen nu bij elkaar liggen. Functies als consistente personages en scènes wijzen vooruit naar een tijd waarin AI niet alleen losse plaatjes maakt, maar complete video's produceert. Dat kan het maken van content sterk versnellen, maar vergroot ook de kans op misbruik voor misleidend beeldmateriaal.
- Quality Mode
- Een instelling in de Grok-app die de meest geavanceerde, kwalitatief beste versie van het beeldmodel gebruikt in plaats van een snellere, eenvoudigere variant.
- API
- Een programmeerinterface waarmee externe software en ontwikkelaars een AI-model kunnen aanroepen en inbouwen in eigen producten.
- Diffusiemodel
- Een type AI-model dat afbeeldingen genereert door willekeurige ruis stap voor stap om te vormen tot een herkenbare, scherpe afbeelding.
- LMArena / Benchmark
- Een onafhankelijke testomgeving waarin gebruikers AI-modellen blind met elkaar vergelijken, gebruikt om de kwaliteit van verschillende modellen objectief te meten.
- Elo-score
- Een ranglijstsysteem, oorspronkelijk uit het schaken, dat aangeeft hoe vaak een AI-model wint van andere modellen in directe vergelijkingen.
- Beeldsegmentatie
- Een techniek waarbij software een afbeelding opdeelt in precieze gebieden of objecten, zodat je slechts een deel van het beeld kunt bewerken.
- Achtergrondverwijdering
- Een functie die het hoofdonderwerp van een afbeelding automatisch scheidt van de achtergrond en die achtergrond transparant maakt.
- Beeldverhouding (aspect ratio)
- De verhouding tussen breedte en hoogte van een afbeelding of video, bijvoorbeeld vierkant of breedbeeld.
Bronnen
Dit artikel is met behulp van AI geschreven op basis van bovenstaande bronnen en is geen letterlijke vertaling. Zo werkt onze redactie.