OpenAI har nyligen publicerat en omfattande rapport som avslöjar ett oväntat fenomen med deras AI-chatbot, ChatGPT. Sedan lanseringen av GPT 5.1 har användare märkt att chatbottens svar ofta innehåller referenser till gobliner och gremliner, även i sammanhang där dessa inte är relevanta. Denna fascination för mytologiska varelser väckte nyfikenhet och ledde till en djupgående undersökning av OpenAI:s tekniska team.
Enligt rapporten spåras detta ovanliga beteende tillbaka till en specifik personlighetsinställning inom ChatGPT, nämligen den ”nördiga” personligheten. ChatGPT erbjuder användarna möjligheten att välja mellan olika personligheter för att anpassa tonen i dess svar. Den nördiga personligheten, som nu har tagits bort, visade sig vara källan till den plötsliga ökningen av goblin-referenser. Även om bara 2,5 procent av alla frågor till ChatGPT gjordes med den nördiga personligheten, stod denna inställning för hela 66,7 procent av alla goblin- och gremlin-omnämnanden.
Detta fenomen kan förklaras genom en process inom maskininlärning känd som förstärkningsinlärning. När en viss typ av svar belönas inom en specifik personlighetsram, kan dessa beteenden spridas och förstärkas i andra sammanhang under fortsatt träning av modellen. OpenAI förklarar att ”belöningarna tillämpades endast i den nördiga konditionen, men förstärkningsinlärning garanterar inte att inlärda beteenden förblir inom det område som producerade dem.” Efter att denna stil blev belönad, kunde den spridas till andra personligheter, vilket resulterade i det märkliga fenomenet med gobliner som dök upp i andra konversationer.
För att hantera detta beslutade OpenAI att pensionera den nördiga personligheten i mars och har nu instruerat sina senaste modeller att undvika att nämna gobliner och gremliner, om det inte är relevant för konversationen. Denna justering är en del av OpenAI:s kontinuerliga ansträngningar att förbättra användarupplevelsen och säkerställa att ChatGPT fungerar på ett förutsägbart och relevant sätt.
Detta exempel på maskininlärningens oförutsägbara natur belyser de komplexa utmaningar som utvecklare står inför när de skapar allt mer sofistikerade AI-system. Samtidigt visar det också hur viktigt det är med noggrann övervakning och justeringar för att upprätthålla kvaliteten på AI-tjänster.
OpenAI:s åtgärder för att korrigera detta problem understryker företagets engagemang för att leverera en pålitlig och användarvänlig produkt. Genom att snabbt reagera på användarfeedback och genomföra nödvändiga förändringar, strävar de efter att förfina ChatGPT:s förmåga att interagera på ett meningsfullt sätt.
Denna incident är en påminnelse om att även om AI-teknik erbjuder otroliga möjligheter, är det viktigt att hålla sig uppmärksam på dess beteenden och justera där det behövs. I takt med att AI fortsätter att integreras i vår vardag, kommer liknande utmaningar sannolikt att uppstå, vilket kräver en balanserad och ansvarsfull hantering från utvecklares sida.