Галлюцинации нейросетей: почему AI уверенно врёт

Что такое галлюцинации нейросетей, почему AI уверенно выдумывает факты — и привычка на 3 секунды, которая защищает. Это не баг, а управляемое поведение.

safetyfundamentalsverification
Обновлено 2026-06-12ЕАЕвгений АрсентьевЕвгений Арсентьев · MD, PhD

Проверено на точность — Евгений Арсентьев, MD, PhD · 2026-06-12

Цель AI — чтобы «звучало правильно», и обычно «звучит правильно» совпадает с «является правдой» — но не всегда. Когда они расходятся, получаешь уверенную ложь. Лекарство: проверяй всё, у чего есть последствия, и относись к AI как к толковому стажёру, а не к оракулу.

Что такое галлюцинация нейросети?

Галлюцинация — это уверенный, правдоподобно звучащий ответ, который оказался ложью: выдуманная ссылка, несуществующая статистика, функция, которой нет. Модель не врёт нарочно: её движок предсказания выдаёт текст, который звучит правильно, а встроенного шага проверки «а правда ли это» у неё нет.

Как выглядят галлюцинации AI?

Они редко выглядят как явная чушь — в этом и ловушка. Ты увидишь ссылку на статью, которую никто не писал, цитату, которую никто не говорил, уверенную цифру без источника, несуществующее судебное дело или код, вызывающий функцию, которой в библиотеке никогда не было. Примета — гладкая конкретика, под которой ничего реального.

Почему ChatGPT галлюцинирует?

По той же причине, что и любая LLM: он заточен выдавать текст, который звучит правильно, а не текст, который он проверил. Когда он чего-то на самом деле не знает, он не замолкает — он предсказывает самое правдоподобное продолжение и подаёт его с той же уверенностью, что и факт, который действительно знает. Гладкость — это фича; редкая выдумка — её тень.

Помогают ли источники?

Очень. Когда ты вставляешь реальный документ, статью или данные и просишь работать только по ним, ты меняешь «вспомни из памяти» на «прочитай то, что перед глазами» — и доля ложных фактов резко падает. Как читатель и пересказчик модель куда надёжнее, чем как оракул.

Можно ли остановить галлюцинации AI?

Полностью убрать галлюцинации нельзя, но можно сделать их безвредными. Проси источники и проверяй хотя бы один. Давай модели реальные материалы вместо того, чтобы заставлять её вспоминать факты. И держи правило трёх секунд: всё, у чего есть последствия, проверяй так, как проверял бы работу толкового стажёра.

Когда галлюцинации вообще важны?

Ровно настолько, насколько велики последствия. Мозговой штурм или черновик спокойно переживут неверную деталь без вреда. Юридический документ, медицинское утверждение, опубликованная цифра или выкаченный код — нет, и именно там шаг проверки не обсуждается. Соизмеряй придирчивость со ставками — и инструмент остаётся безопасным.

Бесплатный курс

Хватит читать про ИИ — начни строить с ним

Бесплатный курс Claude Code: свой первый сайт, инструмент или игра — без программирования. Без апсейлов и кросс-сейлов — здесь нечего купить.

Начать →

Источники и исследования

Подборка рецензируемых работ и препринтов по научной основе этой темы.

  1. [1]Cao et al. (2023). AutoHall: Automated Factuality Hallucination Dataset Generation for Large Language Models. arXiv:2310.00259
  2. [2]Liang et al. (2024). THaMES: An End-to-End Tool for Hallucination Mitigation and Evaluation in Large Language Models. arXiv:2409.11353
  3. [3]Wei et al. (2024). Long-form factuality in large language models. arXiv:2403.18802
  4. [4]Zucchet et al. (2025). How do language models learn facts? Dynamics, curricula and hallucinations. arXiv:2503.21676
  5. [5]Cheung (2025). Hallucination Detection with Small Language Models. arXiv:2506.22486
  6. [6]Wang et al. (2024). Learning From Failure: Integrating Negative Examples when Fine-tuning Large Language Models as Agents. arXiv:2402.11651
  7. [7]Liu et al. (2026). PretrainRL: Alleviating Factuality Hallucination of Large Language Models at the Beginning. arXiv:2602.01875
ЕАЕвгений Арсентьев

Автор

Евгений Арсентьев

MD, PhD · Руководитель ИИ-трансформации

Чтение — это синяя пилюля

Хочешь реально это построить?

Гайды объясняют. Бесплатный курс превращает — персонально, с геймификацией и заточенный на быстрый запуск.

Начать бесплатный курс →