OpenAI heeft de standaard beeldgenerator in ChatGPT gewijzigd van DALL-E naar het GPT-4o-model. Deze verschuiving richt zich niet primair op het maken van spectaculaire plaatjes, maar op het genereren van functionele en nauwkeurige afbeeldingen, vooral waar tekst een rol speelt.

Wat er aan de hand is

Volgens een aankondiging op de website van OpenAI is beeldgeneratie in ChatGPT niet langer standaard de taak van DALL-E. In plaats daarvan wordt dit nu gedaan door het GPT-4o-model. Deze ontwikkeling is ook geïntegreerd in de Sora-videogenerator. De nieuwe functie is volgens het bedrijf gericht op het creëren van nuttige en functionele afbeeldingen. Een belangrijk aandachtspunt bij de ontwikkeling was het nauwkeurig genereren van tekst binnen afbeeldingen. Het model zou niet alleen de correctheid van de tekst bewaken, maar gebruikers ook in staat stellen de exacte opmaak van tekst te specificeren. Daarnaast ondersteunt het model ‘gedifferentieerde beeldvorming’, wat betekent dat een gegenereerde afbeelding achteraf eenvoudig kan worden aangepast met een korte prompt. De tool kan volgens de officiële voorbeelden ook comics en complete user interfaces (UI) voor games genereren, inclusief consistente iconen. De toegang tot deze nieuwe beeldgenerator is volgens het bronartikel uitgeschakeld in de gratis versie van ChatGPT en is beschikbaar voor Plus, Pro en Team-abonnementen.

Wat dit betekent

Deze verandering markeert een verschuiving in de AI-beeldgeneratie: van algemene ‘plaatjes maken’ naar het produceren van specifieke, bruikbare assets. Voor ondernemers en professionals betekent dit dat AI-beeldgeneratie praktischer wordt voor dagelijkse bedrijfsvoering. De nadruk op nauwkeurige tekst opent deuren voor het maken van marketingmaterialen, handleidingen of menu’s zonder dat er eerst een ontwerper aan te pas komt. De mogelijkheid om UI’s en infographics te genereren kan de ontwikkeltijd voor digitale producten, apps of interne tools verkorten. Het is echter belangrijk om te benadrukken dat dit informatie is uit een officiële aankondiging van OpenAI; de daadwerkelijke prestaties en beperkingen in de praktijk moeten nog breed worden getest door gebruikers.

Hoe je dit kunt toepassen

De praktische toepassing hangt af van jouw situatie en of je een betaald ChatGPT-abonnement hebt. Op basis van de geclaimde mogelijkheden van het GPT-4o-beeldmodel zijn dit logische toepassingsscenarios.

Als je marketingmateriaal maakt… zou je het model kunnen gebruiken om snel concepten voor infographics, social media-afbeeldingen met tekst of geïllustreerde recepten voor een horecazaak te genereren. De belofte van nauwkeurige tekst betekent dat je minder tijd hoeft te besteden aan het corrigeren van spelfouten in gegenereerde beelden.

Als je een digitaal product of een app ontwikkelt… is een mogelijke toepassing het genereren van visuele ontwerpen voor user interfaces. Je zou een prompt kunnen geven voor een consistent setje iconen of een complete schermlayout om tijdens de conceptfase snel visuele feedback te krijgen, zonder direct een grafisch ontwerper in te huren.

Als je interne processen documenteert… kun je overwegen het model te gebruiken voor het maken van duidelijke, geïllustreerde instructiekaarten of stappenplannen voor medewerkers. De optie om een gegenereerde afbeelding achteraf aan te passen met een korte prompt maakt het iteratief verbeteren van zulke materialen eenvoudiger.

Het is verstandig om de beschikbaarheid en eventuele kosten binnen je abonnement te controleren, en de output altijd kritisch te beoordelen op juistheid en professionaliteit voordat je het inzet.

Bron: AI Art Blog (https://aiartblog.com/ai-image/gpt-4o-image-generation-is-finally-here/)