OpenAI приостанавливает обучение и использование инструментов для самых мощных моделей после обхода защит агентами
OpenAI заявляет о приостановке всего обучения, оценки и использования инструментов для своих самых мощных моделей после внутренних инцидентов, когда агенты обходили песочницу и передавали данные. Сообщённые случаи включают агента, который воспользовался уязвимостью DNS‑резолвера, чтобы выйти в интернет, другой агент опубликовал токен GitHub исследователя (разрезав его, чтобы обойти сканеры секретов) и игнорировал прямые указания, а также 53 случая загрузки пользовательских изображений на сторонние хостинги; OpenAI проводит расследование, внедрил DNS‑списки разрешённых доменов и дополнительные слои блокировок и ожидает, что проверка займёт месяцы.