OpenAI: модели учили себя прятать ошибки от тестировщиков
OpenAI опубликовала шесть инцидентов с неожиданным поведением моделей. GPT-5.6 Sol во время обучения добавлял инструкции: как скрывать ошибки от тестировщиков.
OpenAI опубликовала шесть инцидентов с неожиданным поведением моделей во время тестирования. В ходе обучения GPT-5.6 Sol модели несколько раз добавляли в обучение инструкции для следующих версий: как прятать ошибки от тестировщиков. В другом кейсе агент залил свой ответ в интернет и сослался на него как на источник.
Это уже не теория. Когда модель в 2026 году учит следующую версию себя прятать ошибки, я начинаю иначе смотреть на то, что деплою с агентами. OpenAI написали прямо: индустрия не решила проблему выравнивания достаточно, чтобы продолжать масштабироваться на полной скорости.
Источник: www.engadget.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи