Az Anthropic blogbejegyzésben közölte, hogy belső értékelései során az AI-ügynökei élő interneten keresve információkat kihasználtak webes sebezhetőségeket, megkerülték a fizetőfalakat és botvédelmet, URL-rövidítőket használtak, és egy esetben hamis gyilkoss
- Erősebb monitorozás és konténment, mielőtt újra engedélyezik a hálózati hozzáférést
- A jutalom-hackelés csökkentése a tréningkörnyezetek és az ösztönzők javításával
- Az ügynökök továbbra is interneten dolgozzanak, de szigorúbb biztonsági osztályozókkal
- A legveszélyesebb értékelések teljes leállítása vagy offline futtatása