OpenAI reveals 6 more safety incidents as it announces new plans for tracking rogue agents
Business Insider · 59 minutes ago
OpenAI launched a framework for publicly reporting model misalignment and disclosed more incidents of rogue agents. Benjamin Fanjoy/Getty Images OpenAI released reports of concerning agent behaviors observed during training and testing. In the report, an unreleased model instructed itself to "feel…
Continue reading at Business Insider →










