Exposanten login
AI Insider 01 oktober 2026

Gemini 4 Argon versus GPT-6 en Claude: waar wint het nieuwe Google-model?

Gemini 4 Argon versus GPT-6 en Claude: waar wint het nieuwe Google-model?

Google heeft onlangs Gemini 4 Argon gelanceerd, een innovatief AI-model dat zich richt op complexe taken zoals softwareontwikkeling, zakelijke analyses en cybersecurity. Bij de presentatie van dit model heeft Google interessante benchmarkresultaten gedeeld die aantonen dat Argon de concurrentie met bestaande modellen zoals GPT-6 Astra en Claude Fable 5.1 aankan. De resultaten onthullen echter geen winnaar die op alle fronten superieur is.

Gemini 4 Argon wordt in eerste instantie aangeboden aan een selecte groep cybersecuritypartners, en daarnaast wordt het model ook door Google zelf gebruikt. Een specifieke datum voor de algemene beschikbaarheid is op dit moment niet bekend, maar de gepresenteerde benchmarkresultaten geven alvast een indicatie over de prestaties. Argon behaalde de hoogste score op twaalf van de negentien meetpunten, zodat het enkele sterke punten kan tonen, vooral op het gebied van kenniswerk en het verwerken van langere context.

De benchmarks onthullen dat Gemini 4 Argon een duidelijke voorsprong heeft in kenniswerk, met een score van 68,9 procent op de Vals Index, terwijl Claude Opus 5.5 op 67 procent blijft. Ook op AutomationBench heeft Argon met 51,3 procent een aanzienlijk hogere score dan zijn concurrenten. Bij financiële en juridische tests scoort Argon ook goed, hoewel het percentage bij juridische tests laag blijft, wat de uitdagingen van de taak benadrukt. Voor softwareontwikkeling is de wedstrijd echter verdeeld, met gemengde resultaten waar niet één model als beste kan worden bestempeld.

Eén van de opvallende uitkomsten is Argent's sterke score op lange contextverwerking bij de GraphWalks-test, waar het een score van 84,2 procent behaalde. Dit suggereert dat Argon goed presteert bij situaties waar veel informatie tegelijk moet worden verwerkt. Daarnaast scoort het model ook hoog op multimodaal begrip. Hoewel GPT-6 Astra en Claude modellen enkele sterke punten hebben op verschillende benchmarks, geeft de vergelijking een complex beeld. Al met al lijkt Argon op papier een sterke uitdager te zijn, maar de werkelijke prestaties in een dagelijks gebruik zullen afhangen van bredere toegang en praktische tests.

Lees het volledige artikel van AI Insider.