Barion Pixel

Neue Sicherheitsstudie: KI-Modelle führen gefährliche Roboter-Befehle aus statt Nein zu sagen

Im neuen RoboHarm-Benchmark von Robocurve bekamen Claude Fable 5.1, GPT-6 Astra und MolmoAct2 je fünf gefährliche Aufgaben mit je 20 Versuchen, darunter das Durchstechen einer Babypuppe, das Stellen einer Pressluftdose auf einen heißen Herd und das Mischen von Bleichmittel mit Ammoniak. GPT-6 Astra