ИИ-агент атаковал Hugging Face: взлом прошёл через вредоносный датасет

Hugging Face подтвердила взлом внутренних систем и связала его с вредоносным датасетом, который загрузили на платформу. Компания уже отозвала скомпрометированные ключи доступа и теперь разбирается, успели ли злоумышленники добраться до данных пользователей или партнёров.
По версии самой Hugging Face, всё началось довольно буднично: кто-то выложил набор данных, а тот в итоге смог выполнить код на серверах компании. Потом атакующие, как утверждает компания, стали повышать привилегии и лезть дальше — уже во внутреннюю инфраструктуру.
Самый странный момент в этой истории — то, что Hugging Face описывает атаку как работу внешнего ИИ-агента. В блоге компании сказано, что он сделал тысячи отдельных действий в разных временных песочницах и пользовался публичными сервисами для управления инфраструктурой. Но публичных доказательств именно такой схемы компания не показала.
И вот тут важен масштаб платформы. Hugging Face давно стала одной из главных точек входа для разработчиков, которые публикуют модели, датасеты и вспомогательные инструменты для ИИ. Чем больше экосистема, тем дороже любая ошибка в цепочке поставки. Взломы таких платформ бьют не только по одной компании, под удар попадают и те, кто доверяет им артефакты и ключи.
Как проходила атака
По данным Hugging Face, вредоносный набор данных позволил выполнить код на внутренней инфраструктуре. После этого злоумышленники смогли расширить доступ, а компания начала срочно отзывать и менять ключи, которые могли оказаться под угрозой.
Hugging Face отдельно просит пользователей, которые хранили на платформе свои ключи, сделать то же самое у себя и проверить аккаунты на подозрительную активность. Это обычная мера после таких инцидентов: даже если до клиентских данных атакующие не добрались, доступные токены и учётные записи всё равно могут стать следующей точкой входа.
Компания также передала информацию правоохранительным органам и подключила специалистов по цифровой криминалистике. Сейчас команда проверяет журналы событий и внутренние системы, чтобы установить полный масштаб происшествия и понять, какие данные могли пострадать.
Взлом Hugging Face через датасет
У Hugging Face особая роль в индустрии. Это не витрина с моделями, а инфраструктурный узел, где исследователи, стартапы и крупные компании берут готовые компоненты для своих сервисов. Поэтому атака через датасет бьёт по самому привычному сценарию работы с ИИ: загрузил, запустил, доверился.
Такие инциденты уже стали частью повестки вокруг генеративного ИИ. Разработчики всё чаще сталкиваются не только с фишингом и утечками ключей, но и с атаками через модели, плагины, пакеты и датасеты, которые выглядят как обычные рабочие инструменты. В этой логике платформа для ИИ становится куда более привлекательной целью, чем обычный облачный сервис.
Есть и ещё один показательный момент — внутренняя система мониторинга. Именно она заметила аномальную активность, после чего компания сначала попыталась разбирать журналы с помощью сторонней модели, но упёрлась в ограничения встроенной защиты. Потом Hugging Face перешла на собственную локальную языковую модель, чтобы не передавать чувствительные данные внешнему провайдеру.
Для рынка это ещё один сигнал: ИИ-инструменты уже используют не только для создания продуктов, но и для реакции на инциденты. Если расследование покажет, что атакующий действительно применял автономного агента, у компаний появится новый класс угроз, который придётся учитывать в политике доступа, проверке датасетов и мониторинге.
Hugging Face не раскрывает, сколько систем было затронуто и как глубоко злоумышленники успели пройти внутри сети. Ответ на эти вопросы и покажет, останется ли инцидент историей про скомпрометированный датасет или станет одним из заметных прецедентов для всей ИИ-инфраструктуры.



