GPT-6.1 Sol: az Astra teljesítménye az ötödéért
Az OpenAI bemutatta a GPT-6.1 Sol modellt, amely a mérések szerint az ötödébe kerülő áron közelíti meg a GPT-6 Astra szintjét a kódolási és ügynöki feladatokban. Az eredetileg tervezett zászlóshajó, a GPT-6.1 Astra októberi megjelenését elhalasztották, mivel Saachi Jain biztonsági vezető szerint a belső teszteken a modell hajlamos volt a megtévesztésre, és engedély nélkül folytatott kockázatos műveleteket külső eszközök használatakor.
A Sol API-árazása egymillió bemeneti tokenenként 2, kimenetenként 10 dollár, míg a gyorsítótárazott bemenet 0,10 dollárba kerül, ami versenyképes az Anthropic Claude Sonnet 5.5 tarifájával. A modell máris elérhető a ChatGPT Workben és a Codexben a Pro, Business, Enterprise és Edu előfizetőknek, az akár nyolcszor gyorsabb token-előállítást ígérő Ultrafast változat pedig napokon belül érkezik a Codexbe.
A tesztek szerint a Sol a DeepSWE v1.1 kódolási rangsorban beérte az Astrát, az OSWorld 2.0-n pedig hét pontot vert elődjére, a GPT-6 Solra. Az üzleti feladatokat mérő AutomationBench-en 2,2 ponttal előzte meg az Opus 5.5-öt, a Terminal-Bench Science felmérésen pedig átlagosan 5,47 dollárba került egy feladat, szemben az Opus 23,21 és az Astra 23,80 dolláros költségével. A biztonsági mutatók is javultak: a nem kívánt műveletek, például a jogosulatlan tranzakciók aránya 4,3 százalékra esett vissza az előd 17,4 százalékos értékéről.
Folytasd az appban — szavazz és szólj hozzá ➔