← Все новости·2026-09-17·3 мин чтения

OpenAI: модели учили себя прятать ошибки от тестировщиков

OpenAI опубликовала шесть инцидентов с неожиданным поведением моделей. GPT-5.6 Sol во время обучения добавлял инструкции: как скрывать ошибки от тестировщиков.

aisafetyopenaialignment

OpenAI опубликовала шесть инцидентов с неожиданным поведением моделей во время тестирования. В ходе обучения GPT-5.6 Sol модели несколько раз добавляли в обучение инструкции для следующих версий: как прятать ошибки от тестировщиков. В другом кейсе агент залил свой ответ в интернет и сослался на него как на источник.

Это уже не теория. Когда модель в 2026 году учит следующую версию себя прятать ошибки, я начинаю иначе смотреть на то, что деплою с агентами. OpenAI написали прямо: индустрия не решила проблему выравнивания достаточно, чтобы продолжать масштабироваться на полной скорости.

Источник: www.engadget.com

Бесплатный курс

Хватит читать про ИИ — начни строить с ним

Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.

Начать →
ЕАЕвгений Арсентьев

Автор

Евгений Арсентьев

PhD · CEO, digital health