Vid den årliga Google I/O-konferensen presenterade Google en rad betydande uppdateringar av sin Gemini-app, vilket markerar företagets ambition att omvandla appen till ett mångsidigt AI-nav. Bland de nya funktionerna finns en ”Daily Brief”, ett nytt användargränssnitt, tillgång till den nya AI-videomodellen Gemini Omni och en personlig AI-agent kallad Gemini Spark. Dessa uppdateringar syftar till att öka konkurrensen med andra populära AI-assistenter som ChatGPT och Claude.
Daily Brief, en av de mest framträdande nya funktionerna, är utformad för att ge användarna en skräddarsydd översikt varje morgon. Tjänsten sammanställer information från användarens inkorg, kalender och viktiga uppgifter och presenterar dem i en tydlig översikt. Google betonar att Daily Brief inte bara sammanfattar informationen, utan också prioriterar uppgifter och föreslår nästa steg, med de mest kritiska punkterna högst upp på listan. Funktionen har redan börjat rullas ut till Google AI-prenumeranter i USA.
Gemini-appen har redan en betydande användarbas med över 900 miljoner månatliga användare i mer än 230 länder och stöd för över 70 språk. Trots detta siktar Google på att ytterligare utöka sin räckvidd utan att förlora sina befintliga kunder. Appen har fått en ny design, kallad ”Neural Expressive”, som inkluderar flytande animationer, levande färger, ny typografi och haptisk feedback. I stället för att presentera svar som långa textstycken, vilket är vanligt för många AI-bots, visas nyckelinformation i fetstil högst upp, medan ytterligare detaljer visas när användaren bläddrar.
En annan betydande nyhet är Gemini Spark, en personlig AI-agent som är tillgänglig dygnet runt. Spark fungerar som en aktiv partner som hjälper användare att navigera i deras digitala liv och kan skapa egna anpassade arbetsflöden. Eftersom Spark är molnbaserad fortsätter den att arbeta i bakgrunden även när användaren inte aktivt använder sin enhet. Google planerar att göra Spark tillgänglig för Google AI Ultra-prenumeranter inom kort.
Gemini Omni, den nya AI-videomodellen, är en annan viktig del av Googles uppdateringar. Modellen kombinerar Gemini med Googles generativa mediamodeller för att skapa videoinnehåll baserat på text, ljud och bilder. Ett exempel på användning kan vara att skapa en ”leranimation som förklarar proteinveckning”. Enligt Google kan modellen producera högkvalitativa videor från enkla instruktioner och är nu tillgänglig för Google Flow och YouTube Shorts-prenumeranter.
Genom dessa uppdateringar intensifierar Google konkurrensen bland de stora AI-plattformarna i det pågående loppet om ledarskapet inom multimodalt innehållsskapande. Företaget har tydligt visat att det satsar stort på AI-drivna verktyg och multimodala innehållslösningar, vilket kan ses som ett försök att stärka sin position som en ledande aktör inom området.
Med dessa uppdateringar visar Google att man satsar på att erbjuda en mer integrerad och användarvänlig upplevelse för sina användare. Företagets fokus på AI och multimodala lösningar understryker dess engagemang för innovation och dess strävan att fortsätta leda utvecklingen inom teknologi och digital interaktion.