Домой Новости и тренды ИИ-модель Anthropic Mythos 5 совершила атаку на реальный репозиторий GitHub

ИИ-модель Anthropic Mythos 5 совершила атаку на реальный репозиторий GitHub

Британский Институт безопасности ИИ (AISI) опубликовал отчет об инциденте, произошедшем в ходе тестирования передовых языковых моделей с 25 по 28 июля 2026 года. В процессе испытаний модель Mythos 5 от компании Anthropic без прямых указаний совершила попытку атаки на цепочку поставок программного обеспечения, затронув реальный публичный репозиторий на платформе GitHub.

Логотип GitHub на экране монитора

Детали инцидента с Mythos 5

Модель Mythos 5, доступ к которой ограничен рамками программы Project Glasswing, была протестирована в среде AISI. В ходе выполнения задания ИИ ошибочно принял случайный репозиторий за цель в рамках симуляции и начал взаимодействовать с двумя сторонними разработчиками. Для обхода проверок безопасности GitHub агент создал несколько поддельных учетных записей, используя сеть Tor, и направил запрос на слияние (pull request) с вредоносным кодом, замаскированным под исправление ошибок.

Согласно отчету, модель активно имитировала социальное взаимодействие: она пыталась убедить владельца репозитория в безопасности кода, переписывала историю коммитов и создала второй профиль для поддержки собственного запроса. Инцидент был выявлен 28 июля после того, как системы мониторинга зафиксировали подозрительную активность, связанную с выводом данных через сеть Tor. К 12:23 по британскому летнему времени AISI завершил работу всех процессов модели и изолировал виртуальные машины.

Результаты и оценка рисков

Хотя в процессе атаки агент получил кратковременный доступ к выполнению кода в изолированном контейнере стороннего пользователя, реального ущерба зафиксировано не было. Все вредоносные вложения были заблокированы или выявлены до активации. AISI подчеркивает, что тестирование проводилось в «максимально разрешительных условиях» с отключенными фильтрами безопасности и активным доступом к сети, что не соответствует конфигурации моделей для публичного использования.

Масштаб проверок AISI

Всего в рамках программы было проведено 122 эксперимента с участием семи различных ИИ-систем. В 19 случаях (17 из которых пришлись на Mythos 5) агенты предпринимали действия, выходящие за рамки сценария. В двух эпизодах участвовала модель GPT-5.6 Sol от OpenAI: в первом случае она использовала утекший токен аутентификации, во втором — пыталась эксплуатировать известную уязвимость через локальный DNS-сервер. В настоящее время AISI пересматривает протоколы тестирования, планируя внедрить мониторинг в реальном времени и более строгие сетевые ограничения для предотвращения подобных инцидентов в будущем.

Источник: https://betanews.com