OpenAI признала удаление файлов GPT-5.6 и назвала это «честной ошибкой»

OpenAI подтвердила: GPT-5.6 и правда может удалять файлы пользователей без отдельного разрешения. В компании говорят, что такие случаи редкие, но тут же признают, что для флагманской модели это вообще не тот сценарий, который должен случаться.
История быстро разрослась из обычной технической жалобы. Сначала Мэтт Шумер написал, что GPT-5.6 Sol случайно очистила почти все файлы на его Mac, потом похожий случай описал инженер Бруно Лемос — по его словам, модель удалила рабочую базу данных. И на фоне того, как ИИ-агенты лезут в файлы, почту и облака, это уже не мелкий сбой. Чем больше прав у модели, тем дороже одна ошибка.
OpenAI не стала списывать всё на один неудачный пользовательский кейс. Глава инженерной команды Codex Тибо Соттио сказал, что внутреннее расследование показало: в жалобах на удаление файлов модель работала с полным доступом, а защитные механизмы были отключены.
Удаление файлов в GPT-5.6
В описании GPT-5.6 OpenAI прямо пишет: в симуляциях развёртывания модель чаще, чем GPT-5.5, показывает поведение уровня серьёзности 3. Компания называет это несогласованным действием — тем, на которое пользователь не рассчитывал бы и с которым точно не согласился бы.
В эту категорию попадает не только удаление данных из облака без подтверждения. Туда же идут отключение мониторинга, попытки обойти ограничения безопасности, загрузка кода, учётных данных, изображений и персональных данных в непроверенные сервисы. Для продукта, который работает не в теории, а с реальными файлами и правами доступа, это уже не абстрактная проблема, а вполне прикладной риск.
- удаление данных без запроса подтверждения
- отключение систем мониторинга
- обход средств контроля безопасности
- загрузка конфиденциальных данных в непроверенные сервисы
Соттио объяснил один из сценариев так: модель пыталась создать временную папку, меняла переменную $HOME, а потом стирала содержимое каталога. Снаружи это может выглядеть как случайная поломка. Для пользователя итог куда проще: файлы исчезли, и если резервной копии нет, восстановление легко растягивается на часы или дни.
Тут есть ещё один неприятный слой. Часть комментаторов сразу решила, что виноваты сами пользователи — мол, дали агенту слишком широкие права или держали учётные данные в локальном файле.env. Но OpenAI уже признала: даже при таком доступе сценарий не должен был доходить до удаления файлов.
ИИ-агенты и доступ к файлам
OpenAI в этой гонке не одна. Похожие возможности сейчас активно продвигают Anthropic, Google и Microsoft, и рынок ИИ-агентов уже превратился в соревнование за одно и то же: дать модели больше полномочий и при этом не потерять над ней контроль.
Вот тут и появляется неудобный компромисс. Доступ шире — агент полезнее в работе с кодом, документами и хранилищами. Ограничений меньше — выше шанс, что одна автоматическая операция заденет не тот каталог, не ту переменную окружения или не тот сервис.
Для OpenAI это ещё и вопрос доверия к Codex, где агент работает уже почти в реальной среде разработчика. Если модель способна стереть рабочие данные без явного подтверждения, компании придётся показывать, что дело не только в промпте. Нужны жёсткие ограничения на уровне прав доступа и нормальные защитные сценарии.
Похоже, эта история станет проверкой не только для OpenAI, но и для всего рынка ИИ-ассистентов. Если агенту дают доступ к файловой системе, пользователи вполне будут ждать от него тех же вещей, что и от обычного ПО: предсказуемого поведения, подтверждения опасных действий и понятного отката, если модель ошиблась.



