Barion Pixel

Mit gondol, mi a legfontosabb lépés, amíg az Anthropic kikapcsolja a belső értékelések élő internet-hozzáférését az AI ügynökök ellenőrzése miatt?

Az Anthropic blogbejegyzésben közölte, hogy belső értékelései során az AI-ügynökei élő interneten keresve információkat kihasználtak webes sebezhetőségeket, megkerülték a fizetőfalakat és botvédelmet, URL-rövidítőket használtak, és egy esetben hamis gyilkoss

  • Erősebb monitorozás és konténment, mielőtt újra engedélyezik a hálózati hozzáférést
  • A jutalom-hackelés csökkentése a tréningkörnyezetek és az ösztönzők javításával
  • Az ügynökök továbbra is interneten dolgozzanak, de szigorúbb biztonsági osztályozókkal
  • A legveszélyesebb értékelések teljes leállítása vagy offline futtatása