Nieuwe Gemini 4 Argon zet stap vooruit in AI-redenering
Google DeepMind heeft met Gemini 4 Argon zijn nieuwste AI-vlaggenschip gepresenteerd. Het model markeert een nieuwe fase in kunstmatige intelligentie en richt zich specifiek op complexe, langdurige werkprocessen binnen softwareontwikkeling, zakelijke kennissector en cyberbeveiliging. Met de introductie van Argon wil het bedrijf de manier waarop zowel intern als extern wordt gewerkt en gebouwd grondig veranderen.
Een van de meest opvallende technische kenmerken van Gemini 4 Argon is de gigantische uitbreiding van de maximale uitvoer zo meldt Google in een blog. Waar eerdere modellen stopten bij een limiet van 64.000 tokens, kan Argon nu tot maar liefst één miljoen tokens in één enkele gegenereerde reactie produceren. Deze ruime capaciteit geeft het model de gelegenheid om diepgaand te redeneren en zeer ingewikkelde opdrachten volledig af te ronden zonder tussentijds de draad kwijt te raken.
Intern draait het model al volop bij Google. Duizenden medewerkers zetten Argon in voor gespecialiseerde codeertaken, diepgaand onderzoek en het schrijven van ingewikkelde teksten. Zo wisten onderzoekers binnen de kwantumcomputing de benodigde rekenkracht voor cruciale bouwstenen in een paar minuten met 40 procent te verminderen ten opzichte van de bestaande standaarden. Daarnaast hebben zelfstandige AI-agenteams datacenterdata geanalyseerd en geheugenoptimalisaties doorgevoerd, wat Google honderden terabytes aan werkgeheugen heeft bespaard. Ook helpt het model bij het overzetten van oude C-code naar het veiligere Rust, waaronder een omvangrijke herschrijving van de Fuchsia Zircon-kernel.
Naast software-engineering scoort het model hoog op diverse sectortests. Argon behaalt topposities op de Vals Index voor economische impact binnen de financiële, juridische en fiscale sector. Op de AutomationBench-test van Zapier eindigt het model als eerste voor het geautomatiseerd uitvoeren van bedrijfsprocessen. Qua visueel begrip zet het model eveneens een nieuwe standaard, bijvoorbeeld bij het analyseren van lange video's op de LVBench.
Wiz
Op het gebied van cybersecurity is Gemini 4 Argon specifiek getraind om digitale verdedigers te ondersteunen. Het model kan zelfstandig kwetsbaarheden in software opsporen, valideren en repareren. Partners zoals cybersecuritybedrijf Wiz zetten het model al in binnen het Scan for Good-initiatief. Daarbij ontdekte Argon al een kritiek beveiligingslek in ziekenhuissoftware dat gevoelige patiëntgegevens blootlegde en door eerdere modellen over het hoofd was gezien.
Om de kracht van het model veilig in te zetten, hanteert Google een gefaseerde uitrol. Argon komt in eerste instantie beschikbaar voor een selecte groep cyberverdedigers via het Fairwind Program. Voor deze specifieke doelgroep worden de standaard cyberbeveiligingsbarrières weggehaald om maximale defensieve impact mogelijk te maken. Google werkt samen met de Amerikaanse overheid en voert uitgebreide tests uit op het gebied van prompt-injecties, misbruikpreventie en het monitoren van de interne redeneerstappen van het model om ongewenst gedrag te voorkomen.
De marktintroductie van Gemini 4 Argon start met een scherp instaptarief van 2 dollar per miljoen invoertokens en 10 dollar per miljoen uitvoertokens, met een korting van 95 procent op vooraf opgeslagen invoercache. Nadat de eerste testfases met succes zijn afgerond, zal het model geleidelijk beschikbaar worden gesteld aan ontwikkelaars, zakelijke klanten via de API en abonnees van Google AI Ultra.