Anthropic Frontier Red Team testet KI-Modelle bei Binärexploitation-Aufgaben
🤖 KI-generierter Inhalt — Titel und Zusammenfassung wurden automatisch von künstlicher Intelligenz erstellt, ohne menschliche redaktionelle Prüfung.
Das Anthropic Frontier Red Team hat verschiedene KI-Modelle an 100 Aufgaben eines internen Binärexploitation-Benchmarks getestet. Dabei erreichte GLM-5.3 bei 4 % der Versuche vollständige Kontrollfluss-Hijacks, während Claude Mythos Preview 6 % erzielte. Ältere Modelle wie Claude Opus 4.6 und GLM-5.2 waren bei keiner der Aufgaben erfolgreich.
Weiter in der App — abstimmen & mitreden ➔Quelle: Simon Willison (AI) · über ahirlevel.hu