Мировые модели не умеют читать мысли — и поэтому ошибаются
Мировые модели вроде Sora и Genie игнорируют убеждения и цели людей. MENTIS добавляет «ментальные переменные» и поднимает точность с 63,3 до 87,9%.
Мировые модели — ИИ-системы, предсказывающие развитие событий (Sora, Genie), — не учитывают убеждения, цели и эмоции людей и из-за этого дают неверные ответы.
Новый фреймворк MENTIS добавляет шесть «ментальных переменных»: убеждения, внимание, цели, намерения, эмоции, нормы и социальные отношения. Это поднимает точность с прямого ответа в 63,3% F1 до 87,9% при использовании полного пайплайна.
Самый показательный результат: слабая модель с MENTIS (84,9%) обошла более мощную без него (83,6%). Особенно велик разрыв в межличностных сценах — плюс 26,4 пункта. Человеческий потолок — 98,5%.
Главное узкое место — симуляция переходов состояний: как меняются и физические, и ментальные состояния одновременно. На это приходится 80% оставшихся ошибок.
Для всей индустрии это сигнал: агент или робот, не понимающий, чего хочет человек, будет ошибаться — даже зная физику вокруг. Добавить «психологию» в мировые модели перестаёт быть теорией и становится инженерным требованием для любой системы, работающей рядом с людьми.
Источник: the-decoder.com
Бесплатный курс
Хватит читать про ИИ — начни строить с ним
Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.
Начать →▌ Гайды по теме

Автор
Евгений Арсентьев
PhD · CEO, digital health
Статьи · Свежие статьи