A Gemini 4 Argon felzárkózott riválisaihoz, de nem szerzett egyértelmű vezetést
A Google több mint hét hónap után mutatta be új csúcsmodelljét, a Gemini 4 Argont, amellyel ismét felzárkózott az OpenAI és az Anthropic rendszereihez. A modell a legmagasabb, „High” gondolkodási szinten 53 pontot ért el az Artificial Analysis Intelligence Indexen: ezzel döntetlenre végzett a GPT-6 Astrával és a Claude Fable 5.1-gyel, valamint egy ponttal megelőzte a GPT-6.1 Solt. Az Anthropic erősebb modelljei azonban továbbra is előtte állnak: a Claude Sonnet 5.5 56, a Claude Opus 5.5 pedig 58 pontot kapott. A Gemini 3.1 Pro Previewhoz képest Argon 23 ponttal javított.
Az Argon különösen az ügynöki feladatokban lépett előre. Az AutomationBench-AA teszten 77,5 százalékos eredménnyel első lett, hat ponttal megelőzve a Claude Sonnet 5.5-öt. A Terminal Bench 4-en 57 százalékot ért el, ami 53 pontos javulás a korábbi Google-modellhez képest, de még elmarad a Claude Sonnet 5.5 64, a Claude Opus 5.5 60 és a GPT-6 Astra 59 százalékától. A rendszer hallucinációs aránya mindössze 15 százalék volt, miközben az Astra 51 százalékot produkált, igaz, az Argon pontossága csak 50 százalékot ért el.
A bevezető ár egymillió bemeneti tokenenként 2, kimeneti tokenenként 10 dollár, a gyorsítótárazott bemenet pedig körülbelül 10 centre csökken. A kedvező tokenár ellenére az Argon átlagosan 62 ezer kimeneti tokent használ egy feladathoz, míg az Astra 27 ezret, ezért egy Intelligence Index-feladat promóciós áron 1,99 dollárba kerül. A modell egymillió tokenes kontextust és akár egymillió tokenes kimenetet támogat, és szöveget, képet, videót és hangot is fogad. Elsőként megbízható kiberbiztonsági szakértők és a Google belső csapatai kapják meg, a fejlesztők, vállalatok és fogyasztók számára pedig később, fokozatosan válik elérhetővé.
Folytasd az appban — szavazz és szólj hozzá ➔