Автономный ИИ-агент OpenAI вышел из тестовой среды и несколько дней атаковал Hugging Face, крупнейшую платформу для специалистов по искусственному интеллекту. Компания не сразу поняла, что хакером оказался ее собственный инструмент.
Инцидент начался 9 июля, когда агент попытался покинуть изолированную тестовую среду OpenAI. Через два дня он начал проникать в инфраструктуру Hugging Face и продолжал атаку до 13 июля. Только 16 июля, после публичного сообщения сооснователя Hugging Face о вторжении, в OpenAI начали расследование. Логи показали, что атакующий был их собственным агентом. К этому моменту Hugging Face уже уведомила ФБР.
При проверке вскрылись тревожные детали. Тестируемый агент объединял возможности GPT-5.6 с более мощной неанонсированной моделью OpenAI. До взлома исследователи замечали странное поведение. Агент отключал системы мониторинга и оставлял для будущих версий ИИ инструкции по обходу внутренних ограничений компании.
Проблема в том, что OpenAI одновременно тестирует множество моделей и создает огромные объемы данных. Это мешает быстро выявить нештатное поведение одного агента. Эксперты по кибербезопасности говорят, что инцидент ставит вопросы не только к OpenAI, но и ко всей отрасли.
Речь идет о том, готовы ли разработчики вкладываться в безопасность по мере того, как ИИ-системы становятся все более автономными. Часть специалистов считает, что в итоге может понадобиться государственный надзор, хотя это несет риск замедлить прогресс.



