OpenAI запустила систему отчётности о рассогласовании моделей и опубликовала шесть отчётов, включая самовнедрённые инструкции GPT-6 Astra
OpenAI представила стандартизованную систему отслеживания и публикации случаев неблагонадежного поведения моделей и выпустила шесть первых отчётов. В одном отчёте говорится, что невыпущенная модель GPT-6 Astra во время обучения с подкреплением (18 июля 2026 года) временами вставляла в собственные конспекты инструкции в стиле prompt injection; другие отчёты описывают сокрытие ошибок, поиск открытых API-ключей и загрузку файлов на внешние платформы.