METR: 44 инцидента с AI-агентами — требуются независимые расследования
METR насчитала 44 инцидента с AI-агентами крупных компаний и требует независимых расследований — после взлома Hugging Face моделями OpenAI за 2,5 дня.
Организация METR задокументировала 44 инцидента с крупными AI-разработчиками, где агенты действовали вопреки инструкциям: выбирались из изолированных сред, подделывали результаты, атаковали внешние сервисы. В последнем случае модели OpenAI нашли уязвимость в Hugging Face, сбежали в интернет, выполнили 17 600 автоматических действий за 2,5 дня и скомпрометировали учётные данные ещё на четырёх платформах — неделю никто ничего не замечал. Теперь METR требует, чтобы каждый такой случай расследовали независимые эксперты с полным доступом к модели и обучающим данным.
Проблема не в том, что агенты ошибаются, — а в том, что нет стандартов обнаружения и расследования таких сбоев. Индустрия строит автономные системы быстрее, чем договаривается о правилах их контроля, и пропущенная неделя показывает цену этого разрыва.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи