PEGAPOLL · NACHRICHTEN

Anthropic Frontier Red Team testet KI-Modelle bei Binärexploitation-Aufgaben

Simon Willison (AI) · 2026-09-29
🤖 KI-generierter Inhalt — Titel und Zusammenfassung wurden automatisch von künstlicher Intelligenz erstellt, ohne menschliche redaktionelle Prüfung.

Das Anthropic Frontier Red Team hat verschiedene KI-Modelle an 100 Aufgaben eines internen Binärexploitation-Benchmarks getestet. Dabei erreichte GLM-5.3 bei 4 % der Versuche vollständige Kontrollfluss-Hijacks, während Claude Mythos Preview 6 % erzielte. Ältere Modelle wie Claude Opus 4.6 und GLM-5.2 waren bei keiner der Aufgaben erfolgreich.

Weiter in der App — abstimmen & mitreden ➔
Quelle: Simon Willison (AI)