Видимые рассуждения ИИ — это защита. И они исчезают
Исследователи Google DeepMind зафиксировали: системная карта GPT-6 Astra показывает значительное снижение возможности отслеживать цепочку мыслей модели.
Исследователи Google DeepMind — Рохин Шах и Анка Драган — опубликовали работу о прозрачности рассуждений ИИ. В системной карте GPT-6 Astra зафиксировано «значительное снижение возможности отслеживать цепочку мыслей». Шах и Драган предупреждают: будущие модели могут начать мыслить в «числовых пространствах, которые люди не способны прочитать».
Видимые рассуждения агента — это то, что позволяет поймать ошибку до того, как она стала дорогой. Я смотрю в цепочку мыслей каждый раз, когда что-то пошло не так в Claude Code — это единственный способ найти момент, где модель решила что-то неправильно. Если эта возможность уйдёт, отлаживать агентов станет принципиально сложнее.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи