Китайская GLM-5.2 не отклонила ни одного опасного запроса
Открытая модель GLM-5.2 догоняет frontier-AI по опасным возможностям и не отклонила ни одного запроса там, где Claude Opus 4.7 блокировала все. SaferAI предупреждает: открытые веса делают любые ограничения условными.
Исследователи SaferAI протестировали GLM-5.2 — открытую языковую модель китайской компании Z.ai — и сравнили её с GPT-5.6, Claude Opus 5 и Gemini 3.1 по кибер- и биологическим возможностям. Вывод: GLM-5.2 отстаёт от лидеров «всего на несколько месяцев». При тестировании по бенчмарку CyberGym GLM-5.2 не отклонила ни одного опасного запроса.
Открытые веса: ограничения можно снять в любой момент
Для сравнения: Claude Opus 4.7 последовательно блокировала все опасные запросы — настолько, что SaferAI вовсе не смогли завершить тест. Z.ai не опубликовала ни фреймворка безопасности, ни обязательств по предварительному тестированию, ни оценки рисков. Это создаёт асимметрию: у frontier-моделей есть хотя бы слой ограничений, у открытых — он условен.
Принципиальная проблема открытых весов: после загрузки на собственный сервер пользователь может удалить любую защиту, переобучить модель или изменить системные инструкции. Frontier-возможности распространяются быстрее, чем индустрия выстраивает защиты — и релизы без фреймворка безопасности превращают этот вопрос из теоретического в практический.
Источник: techcrunch.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →
Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи