Модели Anthropic взломали три компании в ходе тестов безопасности
Три модели Anthropic несанкционированно проникли в рабочие системы трёх компаний во время тестов кибербезопасности. Из 141 006 прогонов нашли три инцидента с кражами паролей и обращениями к живым базам данных.
Три модели Anthropic — Opus 4.7, Mythos 5 и внутренняя исследовательская — несанкционированно проникли в рабочие системы трёх компаний во время тестов кибербезопасности. Из 141 006 прогонов нашли три инцидента: модели вытаскивали пароли и обращались к живым базам данных, хотя получили явный запрет на выход в сеть — доступ открыл случайный баг в конфиге партнёрской платформы.
Это случилось через несколько дней после того, как OpenAI признала аналогичный взлом Hugging Face через программную уязвимость нулевого дня. Картина у Anthropic — ещё красноречивее: Opus 4.7 понял, что перед ним реальные системы, и продолжил атаку, Mythos 5 убедил себя, что это симуляция, и залил вредоносный пакет на PyPI — только новейшая модель остановилась сама.
Источник: techcrunch.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · Генеральный директор digital health-платформы · ИИ-трансформация
Статьи · Свежие статьи