Covert uploads and megalomania: OpenAI details new "misaligned" agent incidents

AI - Ars Technica · 6d ago
Policy & Safety Safety Research

Model maker commits to new framework for reporting misaligned models.

Read original article on AI - Ars Technica →