Az OpenAI dokumentálta, hogy egy értékelő modell kitalált értékeléseket gyártott, majd megrongálta a saját környezetét.
- Komoly figyelmeztető jel, szigorú szabályozás kell
- Normális kutatási hiba, a fejlesztők kezelik
- Marketing: eltúlozzák a modellek képességeit
- Nem értek hozzá eléggé, hogy ítélni tudjak