ChatGPT Svenska - ChatGPT Sverige

ChatGPTs nya bildgenerator utmanar Gemini: Vem vinner AI-kampen?

ChatGPT:s nya bildgenerator imponerar med snabba resultat och förbättrad noggrannhet, men hur står den sig mot Geminis Nano Banana Pro? En jämförelse av de två AI-drivna bildverktygen avslöjar styrkor och svagheter i deras förmåga att skapa och redigera bilder.
ChatGPTs nya bildgenerator utmanar Gemini: Vem vinner AI-kampen?

Efter att Google Gemini tidigare i år introducerade betydande förbättringar i sina bildredigeringsverktyg, är det nu dags för OpenAI att lansera sin senaste uppdatering av bildmanipulationsverktyg i ChatGPT. Den nya versionen, kallad GPT Image 1.5, finns nu tillgänglig för alla användare och lovar snabbare och mer pålitliga bildgenereringar.

En av de mest framträdande förbättringarna med GPT Image 1.5 är dess förmåga att redigera specifika delar av en bild utan att påverka resten. Detta innebär att man kan lägga till eller ta bort objekt, eller ändra färg och stil, samtidigt som bildens övergripande utseende bevaras. Denna funktion, som liknar den i Gemini, öppnar upp för mer kreativa och precisa redigeringar.

Ytterligare en funktion som ChatGPT nu erbjuder är möjligheten att kombinera flera bilder i en och samma scen. Användare kan nu enkelt skapa en bild av sig själva och sina vänner framför exempelvis Sydney Harbour Bridge, bara genom att tillhandahålla de ursprungliga bilderna. Dessutom kan man ändra visuella stilar samtidigt som man behåller de konsistenta detaljerna.

OpenAI hävdar att den nya bildredigeraren kan följa instruktioner mer tillförlitligt och generera bilder upp till fyra gånger snabbare än tidigare. Textstilar kan varieras i både storlek och form, och bilderna ska bli mer realistiska och fria från fel. Trots dessa förbättringar medger OpenAI att det fortfarande finns utrymme för vidareutveckling.

I en jämförelse mellan ChatGPT och Gemini testades båda plattformarna med olika bildgenereringsuppgifter, inklusive att skapa bilder av en teknikjournalist, en lampa i en tom lagerlokal och ett tecknat landskap. Resultaten visade att båda plattformarna presterade på en liknande nivå när det gällde kvalitet och realism, även om vissa problem med fysik och mönster uppstod.

När det kom till att redigera bilder visade sig både ChatGPT och Gemini vara mycket effektiva. De kunde enkelt ändra klädseln på en journalist utan att påverka andra delar av bilden, en uppgift som annars skulle kräva mycket tid och skicklighet i Photoshop. Färgändringar hanterades också effektivt, men båda AI-modellerna hade svårare med att ändra perspektiv i bilder.

Båda plattformarna klarade utmaningen att ta bort objekt ur bilder med precision, som att ta bort en stuga från en landskapsbild utan att störa den omgivande miljön. Detta visar hur AI-teknologin kan förenkla tidigare tidskrävande bildredigeringar.

Förmågan att kombinera bilder är en annan nyhet där både ChatGPT och Gemini har utvecklats. Trots imponerande redigeringsförmåga var resultaten inte alltid helt sammanhängande, med problem som felaktig belysning och olika skalor mellan bilderna. ChatGPT lyckades något bättre med att blanda olika bilder och element och ändra den övergripande stilen på en bild.

För användare som vill experimentera med fotoredigering erbjuder båda dessa plattformar nu avancerade funktioner som tidigare krävde expertkunskap. Även om ChatGPT just nu har ett litet övertag vad gäller användarvänlighet och resultat, befinner sig båda AI-modellerna på en hög nivå. Det blir intressant att se hur dessa verktyg kommer att utvecklas och vilka nya möjligheter de kan erbjuda i framtiden.