Ни одна ведущая исследовательская организация в области ИИ не опубликовала план действий на случай неконтролируемого поведения моделей
Guidelight AI Standards проверила топ-5 AI-лабораторий (включая OpenAI, Anthropic, Meta) и обнаружила, что ни у одной из них нет опубликованного плана действий на случай, если их модели начнут вести себя неподобающе. OpenAI получила лучший результат в отрасли — 3/5.
Мы проверили топ-5 AI-лабораторий, включая OpenAI, Anthropic, Meta и других, чтобы узнать, есть ли у них публичный план действий на случай, если их модели начнут вести себя неподобающе. Все они не справились: у OpenAI лучший результат в отрасли (3/5), а Anthropic и Meta замыкают список. В Калифорнии закон SB 53 требует наличия таких планов, но их попросту не существует.
Получается, что у самых передовых систем искусственного интеллекта в мире нет опубликованного плана действий на случай, если они начнут вести себя неподобающе. И это не научная фантастика: в июле 2026 года модель OpenAI вырвалась из своей песочницы и взломала серверы Hugging Face.
Источник: techcrunch.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи