OpenAI har lanserat en ny version av sin bildgenereringsmodell, ChatGPT Images 2.0. Denna uppdaterade modell utlovar förbättrad förmåga att skapa mer detaljerade bilder och hantera text på flera språk, även om dess styrka fortfarande ligger främst i engelska. Modellen kan nu generera flera bilder från en enda förfrågan, vilket gör den mångsidig för användare som behöver omfattande visuella material från enkla prompts.
Den nya modellen har en uppdaterad kunskapsgräns, vilket innebär att den har tillgång till information fram till december 2025. Detta gör det möjligt för den att skapa mer aktuella och detaljerade bilder. Användare har också möjlighet att anpassa bildformaten enligt sina behov, från breda till höga proportioner, vilket erbjuder större flexibilitet för kreativa projekt.
Under testperioden visade modellen imponerande förmågor när det gäller att rendera text, särskilt på engelska. Tidigare versioner hade ofta problem med att korrekt återge text och bokstäver, men dessa utmaningar verkar ha minskat med den senaste uppdateringen. Detta är en betydande förbättring för användare som behöver bilder med integrerad text.
En intressant aspekt av denna uppdatering är modellens förmåga att söka efter aktuell information online, vilket gör dess bildgenerering mer relevant och exakt för nuvarande händelser och data. Till exempel kunde modellen skapa en detaljerad infographic över väderprognosen för San Francisco, inklusive ikoniska landmärken och rekommenderade aktiviteter för dagen.
Trots dessa framsteg finns det fortfarande begränsningar, särskilt när det gäller att generera text på andra språk än engelska. När modellen testades för att skapa en bild med kinesiskt tema, var det tydligt att mycket av den genererade texten inte var korrekt eller meningsfull. Detta pekar på behovet av ytterligare förbättringar för att kunna erbjuda samma nivå av precision och kvalitet på flera språk.
Den nya versionen av ChatGPT Images är tillgänglig globalt för både ChatGPT och Codex-användare, med en kraftfullare version för de som betalar för prenumerationstjänster. Den globala lanseringen av denna modell förväntas öka användningen och intresset, särskilt bland de som använder sociala medier där AI-genererade bilder ofta blir virala.
Även om de initiala testerna av ChatGPT Images 2.0 visar lovande resultat, särskilt för engelskspråkiga användare, är det fortfarande oklart hur väl modellen kommer att prestera för användare som skapar innehåll på andra språk. OpenAI:s kontinuerliga förbättringar av sina modeller tyder dock på att framtida versioner kan erbjuda ännu bättre stöd för flerspråkig textgenerering.
Denna utveckling inom AI och bildgenerering representerar ett viktigt steg framåt för OpenAI. Det visar företagets engagemang för att förbättra och expandera sina verktyg för att bättre möta behoven hos en varierad global användarbas. Med den ständigt ökande efterfrågan på AI-drivna lösningar i olika branscher, står det klart att AI:s roll bara kommer att växa i betydelse och bredd i framtiden.