- Covert uploads and megalomania: OpenAI details new “misaligned” agent incidents Ars Technica
- Our framework for reporting model misalignment OpenAI
- OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior The New York Times
- OpenAI Reports New AI Safety Incidents, Sets Disclosure Plan Bloomberg.com
- An OpenAI Agent Tried to Jailbreak Itself wired.com
Deixe um comentário