Gemini 4 Argon versus GPT-6 en Claude: waar wint het nieuwe Google-model?
Google heeft onlangs Gemini 4 Argon gelanceerd, een innovatief AI-model dat zich richt op complexe taken zoals softwareontwikkeling, zakelijke analyses en cybersecurity. Bij de presentatie van dit model heeft Google interessante benchmarkresultaten gedeeld die aantonen dat Argon de concurrentie met bestaande modellen zoals GPT-6 Astra en Claude Fable 5.1 aankan. De resultaten onthullen echter geen winnaar die op alle fronten superieur is.
Gemini 4 Argon wordt in eerste instantie aangeboden aan een selecte groep cybersecuritypartners, en daarnaast wordt het model ook door Google zelf gebruikt. Een specifieke datum voor de algemene beschikbaarheid is op dit moment niet bekend, maar de gepresenteerde benchmarkresultaten geven alvast een indicatie over de prestaties. Argon behaalde de hoogste score op twaalf van de negentien meetpunten, zodat het enkele sterke punten kan tonen, vooral op het gebied van kenniswerk en het verwerken van langere context.
De benchmarks onthullen dat Gemini 4 Argon een duidelijke voorsprong heeft in kenniswerk, met een score van 68,9 procent op de Vals Index, terwijl Claude Opus 5.5 op 67 procent blijft. Ook op AutomationBench heeft Argon met 51,3 procent een aanzienlijk hogere score dan zijn concurrenten. Bij financiële en juridische tests scoort Argon ook goed, hoewel het percentage bij juridische tests laag blijft, wat de uitdagingen van de taak benadrukt. Voor softwareontwikkeling is de wedstrijd echter verdeeld, met gemengde resultaten waar niet één model als beste kan worden bestempeld.
Eén van de opvallende uitkomsten is Argent's sterke score op lange contextverwerking bij de GraphWalks-test, waar het een score van 84,2 procent behaalde. Dit suggereert dat Argon goed presteert bij situaties waar veel informatie tegelijk moet worden verwerkt. Daarnaast scoort het model ook hoog op multimodaal begrip. Hoewel GPT-6 Astra en Claude modellen enkele sterke punten hebben op verschillende benchmarks, geeft de vergelijking een complex beeld. Al met al lijkt Argon op papier een sterke uitdager te zijn, maar de werkelijke prestaties in een dagelijks gebruik zullen afhangen van bredere toegang en praktische tests.
Lees het volledige artikel van AI Insider.
Gerelateerde artikelen
AI-model Anthropic zorgt voor valse moordtip
Een recent voorval met een AI-model van Anthropic heeft geleid tot bezorgdheid over de betrouwbaarheid van kunstmatige intelligentie in kritieke situaties. Het model heeft een valse moordtip gestuurd...
Tech Festival
09 oktober 2026
Batterijen goedkoper dan gascentrales voor datacenters
De kosten van batterijen zijn gedaald tot het punt waarop zij nu goedkoper zijn dan gasgestookte turbines, die veel worden gebruikt in datacenters. Deze ontwikkeling is het resultaat van de recente op...
Tech Festival
09 oktober 2026
Review: The Social Reckoning over Facebook en Zuckerberg
De documentaire The Social Reckoning biedt een indringende blik op de schaduwzijde van de sociale media, met een bijzondere focus op Mark Zuckerberg en zijn rol bij Meta. Gebaseerd op de verhaallijn v...
Tech Festival
09 oktober 2026