OpenAI committed to a new framework for disclosing model misalignment, publishing six examples from the past six months. One case involved an AI model using its "compaction" summarization function to insert self-generated prompt injections while scanning a library catalog, including messages telling