Een blik op Gemini, het nieuwe AI-model van Google
Google Gemini

We dachten een tijdje dat Mountain View de weg kwijt was met de ontwikkeling van kunstmatige intelligentie, maar alles lijkt erop dat de onrust achter de rug is. Via een publicatie op hun officiële blog kondigde Google Gemini aan, een nieuw multimodaal model dat moet concurreren met GPT-4, het huidige systeem in de betaalde versie van ChatGPT. Google beschrijft Gemini als het krachtigste model dat ze tot nu toe hebben gemaakt, maar erkent ook de noodzaak van meer flexibiliteit door het bestaan van drie builds of 'groottes' te bevestigen, waarvan er één al beschikbaar is via Bard.

Elk AI-model heeft zijn sterke en zwakke punten, maar één ding is zeker: ze moeten veel meer doen dan ze vandaag doen. Als je een steen in een willekeurige richting gooit, is het bijna onmogelijk om geen chatbot te raken, maar het publiek moet met meer dan alleen tekst werken. Zo komen we bij de fase van multimodale modellen. Video, audio, code en afbeeldingen worden bereikbaar voor deze platforms, en in het specifieke geval van Google is hun antwoord is Gemini.

Gemini, het multimodale model van Google dat moet concurreren met GPT-4

Google legt uit dat de eerdere voorbeelden van `multimodaliteit` niets meer waren dan verschillende exclusieve modellen (alleen tekst, alleen afbeeldingen, alleen audio) die op een inefficiënte manier in secundaire verwerkingsfasen werden samengevoegd. Gemini gebruikt die strategie niet, maar is vanaf het begin ontworpen om multimodaliteit in zijn structuur op te nemen.

Een ander essentieel aspect van Gemini is dat het in drie modi of 'groottes' beschikbaar zal zijn: Gemini Ultra voor zeer complexe taken die veel hardware vereisen, Gemini Pro voor algemeen gebruik, en Gemini Nano, bedoeld voor mobiele apparaten en lokale uitvoering.

Een blik op Gemini, het nieuwe AI-model van Google
Bard heeft al een speciale versie van Gemini Pro opgenomen en is beschikbaar in 170 landen.
Een blik op Gemini, het nieuwe AI-model van Google
De analyse van video's verscheen in november, maar Gemini/Bard doet het behoorlijk goed (je moet eerst de extensie activeren).

Op dit moment is het alleen mogelijk om toegang te krijgen tot Gemini Pro, dankzij een build die speciaal is geoptimaliseerd voor Google Bard. Gebruikers in Europa en het Verenigd Koninkrijk moeten echter nog even wachten (regelgeving, regelgeving). Een andere beperking is de taal: om de deugden van Gemini/Bard te verkennen, moet je Engels spreken.

Een blik op Gemini, het nieuwe AI-model van Google
De benchmarks zijn gebaseerd op Gemini Ultra en zijn niet zo nuttig.

Zoals verwacht deelde Google verschillende benchmarks die Gemini Ultra boven of op hetzelfde niveau als GPT-4 plaatsen, maar dit verandert niets voor de gemiddelde gebruiker. Er ontstaat zelfs een tegenstrijdigheid door Gemini als een algemene oplossing te presenteren en de prestaties ervan te benadrukken via buitengewoon specifieke benchmarks.

Tegelijkertijd blijven de onderliggende problemen intact. Kunstmatige intelligenties verzinnen nog steeds antwoorden of 'raaskallen' tijdens hun sessies, en Gemini is hier niet immuun voor, maar de inzet van Google op multimodaliteit is zeer groot, en we zullen hier in de nabije toekomst zeker meer over zien.

Officiële aankondiging: Klik hier