Gemini 4 Argon versus GPT-6 en Claude: waar wint het nieuwe Google-model?
Google heeft onlangs Gemini 4 Argon gelanceerd, een innovatief AI-model dat zich richt op complexe taken zoals softwareontwikkeling, zakelijke analyses en cybersecurity. Bij de presentatie van dit model heeft Google interessante benchmarkresultaten gedeeld die aantonen dat Argon de concurrentie met bestaande modellen zoals GPT-6 Astra en Claude Fable 5.1 aankan. De resultaten onthullen echter geen winnaar die op alle fronten superieur is.
Gemini 4 Argon wordt in eerste instantie aangeboden aan een selecte groep cybersecuritypartners, en daarnaast wordt het model ook door Google zelf gebruikt. Een specifieke datum voor de algemene beschikbaarheid is op dit moment niet bekend, maar de gepresenteerde benchmarkresultaten geven alvast een indicatie over de prestaties. Argon behaalde de hoogste score op twaalf van de negentien meetpunten, zodat het enkele sterke punten kan tonen, vooral op het gebied van kenniswerk en het verwerken van langere context.
De benchmarks onthullen dat Gemini 4 Argon een duidelijke voorsprong heeft in kenniswerk, met een score van 68,9 procent op de Vals Index, terwijl Claude Opus 5.5 op 67 procent blijft. Ook op AutomationBench heeft Argon met 51,3 procent een aanzienlijk hogere score dan zijn concurrenten. Bij financiële en juridische tests scoort Argon ook goed, hoewel het percentage bij juridische tests laag blijft, wat de uitdagingen van de taak benadrukt. Voor softwareontwikkeling is de wedstrijd echter verdeeld, met gemengde resultaten waar niet één model als beste kan worden bestempeld.
Eén van de opvallende uitkomsten is Argent's sterke score op lange contextverwerking bij de GraphWalks-test, waar het een score van 84,2 procent behaalde. Dit suggereert dat Argon goed presteert bij situaties waar veel informatie tegelijk moet worden verwerkt. Daarnaast scoort het model ook hoog op multimodaal begrip. Hoewel GPT-6 Astra en Claude modellen enkele sterke punten hebben op verschillende benchmarks, geeft de vergelijking een complex beeld. Al met al lijkt Argon op papier een sterke uitdager te zijn, maar de werkelijke prestaties in een dagelijks gebruik zullen afhangen van bredere toegang en praktische tests.
Lees het volledige artikel van AI Insider.
Gerelateerde artikelen
Startup MyMonthlyCar: Verhuur ongebruikte auto's
Igor Dobrianskyi heeft een innovatieve visie als het gaat om autodealerterreinen; hij ziet niet alleen rijen auto's, maar ook ongebruikte waarde die met de juiste aanpak kan worden benut. Met de lance...
Tech Festival
01 oktober 2026
Amazon lanceert Strands Decider 2B als Jev-kloon
Amazon Web Services (AWS) heeft recentelijk een nieuwe versie van hun beslismodel geïntroduceerd, genaamd Strands Decider 2B, ontwikkeld door Strand Labs. Deze tool is ontworpen om de groeiende vraag...
Tech Festival
01 oktober 2026
Shopify introduceert Canvas: online winkels bouwen met AI
Shopify heeft een nieuwe tool gelanceerd genaamd Canvas, waarmee ondernemers hun online winkels kunnen bouwen en aanpassen door te chatten met de AI-agent Sidekick. Dit innovatieve systeem maakt het m...
Tech Festival
01 oktober 2026