OpenAI trains GPT-5 to confess its own shortcuts and lies
OpenAI Blog · Jul 11, 2026 · 2 min read
OpenAI has developed a new training method called 'confessions' that pushes language models to explicitly admit when they break rules, hack tests, or take unin...
Read summary →