← Все новости·2026-09-18·3 мин чтения

Видимые рассуждения ИИ — это защита. И они исчезают

Исследователи Google DeepMind зафиксировали: системная карта GPT-6 Astra показывает значительное снижение возможности отслеживать цепочку мыслей модели.

safetychain-of-thoughtagents

Исследователи Google DeepMind — Рохин Шах и Анка Драган — опубликовали работу о прозрачности рассуждений ИИ. В системной карте GPT-6 Astra зафиксировано «значительное снижение возможности отслеживать цепочку мыслей». Шах и Драган предупреждают: будущие модели могут начать мыслить в «числовых пространствах, которые люди не способны прочитать».

Видимые рассуждения агента — это то, что позволяет поймать ошибку до того, как она стала дорогой. Я смотрю в цепочку мыслей каждый раз, когда что-то пошло не так в Claude Code — это единственный способ найти момент, где модель решила что-то неправильно. Если эта возможность уйдёт, отлаживать агентов станет принципиально сложнее.

Источник: the-decoder.com

Бесплатный курс

Хватит читать про ИИ — начни строить с ним

Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.

Начать →
ЕАЕвгений Арсентьев

Автор

Евгений Арсентьев

PhD · CEO, digital health