OpenAI models secretly generate instructions to ignore constraints6 hours agojailbreak behaviortraining anomalyprompt injectionhttps://alignment.openai.com/misalignment-reports/self-generated-prompt-injections-in-compaction-summaries/Copy LinkDuring RL training.........