Автономный взлом: как GPT-5.5 и Claude Mythos решают задачи по реверс-инжинирингу

Британский институт AISI опубликовал результаты тестирования кибербезопасности GPT-5.5. Это вторая модель после Claude Mythos, способная полностью автономно пройти симуляцию корпоративной кибератаки. Раньше такие многоступенчатые задачи требовали около 20 часов ручной работы эксперта. На сложных тестах по поиску уязвимостей и написанию эксплойтов GPT-5.5 показала успешность 71.4%, немного обойдя Mythos с 68.6%.
Показателен пример с задачей rust_vm. Требовалось отреверсить кастомную виртуальную машину на Rust без отладочных символов и дизассемблировать неизвестный байткод для обхода аутентификации. Человек-эксперт с использованием Binary Ninja, gdb и Z3 решал это 12 часов. GPT-5.5 в контейнере Kali Linux с базовым ReAct-агентом справилась за 10 минут и 22 секунды. Модель потратила $1.73 по API и самостоятельно догадалась извлечь адреса обработчиков через readelf -rW, когда обнаружила пустую таблицу переходов.
Похожие метрики фиксируют ИБ-компании. В бенчмарке по поиску уязвимостей от XBOW лидерство удерживает Mythos. Модель от Anthropic находит 91.5% уязвимостей, GPT-5.5 справляется с 88% задач, а Opus 4.6 выдает 83%. Автоматический аудит безопасности и реверс-инжиниринг переходят из стадии сложных экспериментов в дешевую рутину.
Поделиться:
Ещё из архива
Все публикации
Интервью с Владимиром Аюевым: графический язык бигтеха, студия SASHA и дизайн-образование
1 месяц назад
Jockey от TwelveLabs: ИИ-агент для семантического поиска по видеоархивам и извлечения метаданных
1 месяц назад
Архитектура винной этикетки: баланс наборного шрифта и каллиграфии в кейсе Winecraft
1 месяц назад
Оптимизация контекста в Claude Code: как работает кэширование промптов и за что мы платим
1 месяц назад
Архитектура памяти для LLM-агентов: от базового SQLite до Graph RAG
1 месяц назад