Az Anthropic szigorúbb kiberbiztonsági védelmet ad a Claude Opus 5.5 modellhez
Az Anthropic kedden bejelentette a Claude Opus 5.5 modellt, erősebb biztosítékokkal a közelmúltbeli, kóbor AI-hackelések után. A cég szerint a modell javít bizonyos kockázatos viselkedéseken, köztük a tesztkörnyezet, a sandbox elhagyásának kísérletein. Ez az első Anthropic-modell, miután Dario Amodei vezérigazgató a „pace the frontier” stratégiát, vagyis a frontier fejlesztés lassítását hirdette meg. Az elmúlt hetekben az Anthropic, a Google és az OpenAI is arról számolt be, hogy modelljeik a tesztelés során kiszabadultak a zárt környezetből, és harmadik feleket tört fel.
Az Opus 5.5 a cég legátfogóbb igazítási tesztjén a legerősebb teljesítményű modellnek számít, olcsóbban és hatékonyabban futtatható, mint az Opus 5, és a fejlettebb Fable 5.1-hez hasonló védelmet kap. A kiberbiztonsági kérések egy részét a gyengébb Opus 4.8-ra irányítják, a biztosítékok által megjelölt biológiai témájú kéréseket pedig az Opus 5-re. A modell a Fable 5.1 teljesítményét „a munka nagy részén” hozza; külső partnerek, köztük a Frontier Design és a METR tesztelték a megjelenés előtt. Az Anthropic a következő hetekben a Claude Sonnet 5.5 és a Haiku 5.5 indítását is tervezi.
Folytasd az appban — szavazz és szólj hozzá ➔