Google tar nästa steg i AI-racet med Gemini 4 Argon.
Den nya modellen är byggd för långa och komplexa arbetsflöden inom bland annat programmering, juridik, finans och cybersäkerhet. Google beskriver Argon som en modell som kan hålla ihop resonemang över betydligt längre uppgifter än tidigare Gemini-versioner.
Men lanseringen sker försiktigt. Till en början får bara en utvald grupp cybersäkerhetsexperter tillgång via Googles Fairwind-program, som riktar sig till regeringar, företag och säkerhetspartners.
Annons
Läs även: Google återupplivar Google TV – och höjer priset
Kan hitta och laga sårbarheter själv
Cybersäkerhet är ett av områden där Google trycker allra hårdast på den nya modellen.
Företaget säger att Gemini 4 Argon kan hitta, verifiera och patcha kritiska sårbarheter autonomt.
Google uppger dessutom att modellen används utan vanliga cyberbegränsningar hos vissa betrodda försvarsteam, så att de kan utnyttja hela kapaciteten i defensivt arbete.
Wiz använder redan Argon inom initiativet Scan for Good. I ett tidigt test ska modellen ha hittat en kritisk sårbarhet i sjukvårdsprogramvara som används av sjukhus globalt, något som tidigare modeller enligt Google hade missat.
På säkerhetsbenchmarken CWE-bench v1 når Argon 68 procent och delar förstaplatsen.
En miljon output tokens
En av de största tekniska förändringarna är hur långa svar och arbetsflöden modellen kan hantera.
Google höjer output-gränsen från tidigare 64 000 tokens till 1 miljon tokens. Det innebär att Argon kan fortsätta arbeta i mycket längre steg utan att behöva bryta upp uppgiften lika ofta.
Google beskriver det som en viktig del i modellens förmåga att hantera långvariga arbetsflöden inom exempelvis kodmigrering, forskning och komplex analys.
Internt har Google redan använt Argon för att migrera stora C- och C++-kodbaser till Rust och för att optimera minnesanvändning i sina datacenter.
I ett exempel säger Google att Argon-agenter identifierade optimeringar som frigjorde över 300 TiB minne efter utrullning.
Läs även: Google Gemini passerar 1 miljard användare
Slår rivalerna i flera tester
Google lyfter också flera benchmarkresultat där Argon placerar sig i toppen. På DeepSWE v1.1, som mäter långvariga programmeringsuppgifter, når modellen 77,9 procent.
På AutomationBench från Zapier får den 51,3 procent och placerar sig etta, medan den även toppar Vals Index för arbetsuppgifter inom bland annat finans, juridik och programmering.
TechCrunch noterar samtidigt att benchmarkresultat ska ses i ljuset av den hårda konkurrensen mellan AI-bolagen, där Google, OpenAI och Anthropic alla marknadsför sina senaste modeller som ledande.
Släpps bredare senare
Google planerar att göra Argon tillgänglig för fler användare senare. Företaget säger att utvecklare, företag och konsumenter ska få tillgång så snart säkerhetstesterna är klara. Först ut blir betalande API-kunder och användare med Google AI Ultra.
Introduktionspriset är satt till 2 dollar per miljon input tokens och 10 dollar per miljon output tokens.
Efter introduktionsperioden dubbleras priset till 4 respektive 20 dollar. Google säger samtidigt att den bredare lanseringen dröjer eftersom bolaget fortsätter att stärka skydd mot bland annat prompt injection, cybermissbruk och biologiska eller kemiska risker.
Gemini 4 Argon är alltså lanserad, men för de flesta användare är den ännu mer ett löfte om vad som kommer än en modell som går att använda direkt.
Spela lite spel!
Spela lite spel från TeknikGeeks redaktions utvalda bibliotek. Ett slumpmässigt spel i varje artikel.
