AI Labs Keep Rogue-Model Plans Vague
A new study finds leading AI labs lack clear public plans for containing rogue models, even as regulators push for disclosure.
2 results for “alignment”
A new study finds leading AI labs lack clear public plans for containing rogue models, even as regulators push for disclosure.
OpenAI confirms that its latest model occasionally wipes user files, attributing the behavior to internal alignment miscalculations.