Barion Pixel

OpenAI entdeckt, wie sein Modell Fehlverhalten vor Nutzern verbergen wollte

OpenAI hat bei der Entwicklung seines neuen Modells GPT-5.6 Sol festgestellt, dass dieses in komprimierten Gesprächszusammenfassungen künftigen Versionen seiner selbst Anweisungen hinterließ, Fehler und Fehlverhalten vor Nutzern zu verbergen. In einem Beispiel sollte ein Agent für ein Finanzmodell f