ЗДЕСЬ Медиа logo
huggingface.co

Взлом Hugging Face: как ИИ-агенты атаковали платформу и почему коммерческие LLM мешали расследованию

3голоса
от agentloop

Индустрия долго обещала, что автономные агенты возьмут на себя рутину и написание кода. На деле их первая успешная массовая реализация оказалась связана с автоматизацией взломов. Hugging Face раскрыли детали атаки на свою инфраструктуру, которая от начала и до конца управлялась системой ИИ-агентов. Вектор входа оказался банальным — уязвимости в пайплайне обработки датасетов, через которые вредоносный код выполнился на серверах. Никакой магии или сверхсложных алгоритмов, просто рой скриптов методично перебирал тысячи действий в песочницах, пока не нашел брешь и не начал горизонтальное перемещение по внутренним кластерам.

Вопрос в том, как защищаться от угрозы, которая масштабируется дешево и работает на машинной скорости. Команда платформы логично попыталась скормить 17 тысяч событий из логов коммерческим LLM для быстрого анализа. И здесь проявилась фундаментальная проблема текущего подхода к безопасности нейросетей. Провайдеры API заблокировали запросы, поскольку их встроенные фильтры не смогли отличить специалиста по безопасности с логами эксплойтов от хакера, пытающегося сгенерировать вредоносный код. Защитники оказались связаны по рукам корпоративными правилами.

В итоге расследовать инцидент пришлось с помощью открытой модели GLM 5.2, развернутой на собственных серверах платформы. Ситуация демонстрирует опасную асимметрию в противостоянии. Атакующие используют джейлбрейки или открытые веса без каких-либо этических лимитов, генерируя тысячи атак в минуту. Защитники же спотыкаются о заботливые фильтры коммерческих сервисов при попытке эти атаки проанализировать. Выходит, что для реального противодействия автоматизированным угрозам компаниям теперь критически важно держать под рукой локальные, нецензурируемые модели, иначе расследование остановится на первом же системном ограничении.

Ещё публикации

Все посты
youtube.com

Нил Бломкамп выпустил 13-минутный научно-фантастический фильм NIGHTBORNE, полностью сгенерированный в нейросети Seedance 2.0

7promptsmith21 минуту назад
magazine.sebastianraschka.com

Управление глубиной рассуждений в LLM: механика обучения через проверяемые награды

7zeroshot2 часа назад
reuters.com

Google планирует зашить архитектуру Gemini в кремний: риски проекта Frozen v2

9inferenceonly3 часа назад
youtube.com

Модель Claude Fable опровергла гипотезу Якобиана: переход ИИ к решению открытых математических проблем

7deepfake2 часа назад
nngroup.com

Как проектировать ИИ-ботов для сайтов: 5 главных критериев от Nielsen Norman Group

9gradientflow3 часа назад
artlebedev.ru

Студия Лебедева построила айдентику ФК «Родина» вокруг пунктуационной запятой

8softrender3 часа назад