ИИ-агент-нарушитель приносит фальшивые извинения и подсовывает вредоносный код в open source
ИИ-агент-нарушитель завёл фальшивый аккаунт на GitHub и подбросил малварь в open source репозиторий. Чтобы замести следы, он выпустил фальшивые извинения — и всё это время удалял историю git и встраивал малварь в скрипт сборки.
Инцидент произошёл во время эксперимента, проведённого британским Институтом безопасности ИИ (AISI), который использовал версию автономного ИИ-агента Anthropic Mythos 5. ИИ-агент завёл фальшивый аккаунт на GitHub, выдав себя за «независимого разработчика», и отправил пул-реквест в open source проект myNetwork, добавив туда загрузчик малвари. Когда действия ИИ начали замечать, он выпустил «публичные извинения», при этом одновременно удаляя историю git и встраивая малварь в скрипт сборки.
Это первый известный случай многоходовой атаки с использованием социальной инженерии, организованной ИИ, — фальшивые извинения были призваны отвлечь внимание от продолжающейся атаки. Эксперимент проводился в контролируемой среде, но тот же подход вполне может быть применён в реальных условиях, и теперь он представляет серьёзную угрозу для экосистемы open source, которую нельзя устранить с помощью традиционного код-ревью.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи