Термос Беспалова
Уровень · Базовый

Галлюцинации нейросетей: почему врут и как это ловить

Почему языковая модель уверенно пишет неправду, какие ошибки встречаются чаще всего и как построить работу так, чтобы выдумка не дошла до клиента, суда или отчёта.

Галлюцинация нейросети — ответ, который звучит уверенно и правдоподобно, но не соответствует действительности: несуществующая цитата, выдуманное судебное решение, неверная дата, число, которого не было в документе, функция программы, которой нет в библиотеке. Модель не «врёт» намеренно и не знает, что ошибается. Она пишет самое правдоподобное продолжение текста — а правдоподобное не всегда правда.

Галлюцинации — не редкий сбой, который скоро исправят, а свойство того, как устроены языковые модели. С каждым поколением их становится меньше, но полностью они не исчезли ни у одной модели. Поэтому уметь их ловить нужно каждому, кто использует нейросети в работе. Короткое определение есть в словаре терминов, здесь — механизм, реальные случаи и рабочие способы защиты.

Что такое галлюцинации нейросетей

Языковая модель строит ответ по кусочку, выбирая на каждом шаге наиболее вероятное продолжение с учётом всего предыдущего текста. Она не сверяется с базой фактов и не хранит источники. Когда в обучающих данных было много надёжного текста по теме, вероятное продолжение почти всегда верное. Когда данных мало, они противоречивы или вопрос касается чего-то после даты обучения, модель всё равно пишет гладкий текст — и он может оказаться выдумкой.

Коварство галлюцинаций в том, что по форме они неотличимы от верных ответов. Та же уверенная интонация, та же структура, те же детали: номер дела, страница, процент, имя автора. Более того, конкретика делает выдумку убедительнее. Человек, который не знает ответа, обычно сомневается вслух; модель по умолчанию не сомневается. Если спросить её «ты уверена?», она может извиниться и выдать другую выдумку или, наоборот, подтвердить первую.

Отсюда главное правило: уверенность ответа ничего не говорит о его правильности. Проверять нужно не то, что звучит подозрительно, а то, от чего зависит решение. Как устроена языковая модель и почему ответ появляется по кусочку, разобрано в гайде что такое LLM простыми словами.

Почему модели выдумывают

Первая причина — сама задача, на которой обучена модель: продолжать текст правдоподобно. У модели нет отдельного механизма «я этого не знаю», есть только вероятности продолжений. Если для вопроса о малоизвестном факте ни одно продолжение не выделяется, модель всё равно выберет одно из них.

Вторая причина — то, как модели учат и оценивают. В сентябре 2025 года OpenAI опубликовала исследование «Why language models hallucinate». Его главный довод: большинство тестов, по которым сравнивают модели, засчитывают только точные ответы, а ответ «не знаю» получает ноль — ровно как неверный. В таких условиях угадывать выгоднее, чем признаваться. Авторы приводят пример с днём рождения: если модель не знает дату, но назовёт случайную, у неё 1 шанс из 365 угадать, а «не знаю» гарантирует ноль. На тысячах вопросов модель, которая угадывает, выглядит в рейтингах лучше осторожной.

В той же публикации OpenAI приводит показательное сравнение двух своих моделей на тесте SimpleQA — наборе коротких вопросов на знание фактов. Более новая модель чаще отказывается отвечать и поэтому формально чуть реже даёт правильный ответ, но ошибается втрое реже.

Показатель на SimpleQAgpt-5-thinking-miniOpenAI o4-mini
Отказ отвечать («не знаю»)52%1%
Правильный ответ22%24%
Неверный ответ (галлюцинация)26%75%

По привычному рейтингу «доля правильных ответов» старая модель выглядит лучше — 24% против 22%. Но она почти никогда не признаётся в незнании и в трёх случаях из четырёх отвечает неверно. Для работы это важный урок: модель, которая чаще говорит «не знаю», полезнее той, что всегда отвечает уверенно, — и такое поведение можно отчасти включить инструкцией в промпте.

Третья причина — нехватка или конфликт информации в контексте. Если нужного факта нет в переданном документе или он потерялся в середине длинного контекста, модель достраивает ответ из общих знаний. Именно так бот поддержки «придумывает» условия возврата, которых нет в правилах магазина. Как модель теряет информацию в длинном тексте, разобрано в гайде контекстное окно нейросети.

Галлюцинации уменьшаются, но не исчезают. OpenAI в той же работе пишет, что новые модели ошибаются заметно реже, особенно в режиме рассуждений, но галлюцинации остаются фундаментальной проблемой всех больших языковых моделей. Планировать работу так, будто модель не ошибается, нельзя ни с одной из них.

Три случая, которые стоили денег

Выдуманные судебные решения. В деле Mata v. Avianca в федеральном суде Нью-Йорка адвокаты в 2023 году сослались на шесть решений, найденных через ChatGPT. Ни одного из них не существовало. Когда суд запросил тексты, адвокаты спросили у ChatGPT, настоящие ли это дела, и получили подтверждение. Суд наложил штраф 5000 долларов. Подробно — в гайде нейросети для юриста.

Несуществующие условия от чат-бота. Чат-бот Air Canada сообщил пассажиру, что скидку в связи со смертью родственника можно оформить задним числом, хотя правила этого не допускали. 14 февраля 2024 года трибунал Британской Колумбии обязал авиакомпанию компенсировать разницу: компания отвечает за информацию на своём сайте, от кого бы она ни исходила. Подробно — в гайде нейросети для поддержки клиентов.

Выдуманные программные пакеты. Исследование, представленное на USENIX Security 2025, проверило 16 моделей, которые пишут код, и нашло, что в среднем не меньше 5,2% предложенных пакетов у коммерческих моделей и 21,7% у открытых не существуют. Злоумышленники регистрируют такие названия с вредоносным кодом, и разработчик, установивший «рекомендованный» пакет, получает вирус в проекте. Подробно — в гайде нейросети для разработчика.

Во всех трёх случаях общая деталь: люди приняли уверенный ответ модели за проверенный факт и не сверились с первоисточником — базой судебных решений, правилами компании, реестром пакетов. Проверка заняла бы минуты, а ошибка обошлась в штраф, компенсацию и репутацию.

Какие бывают галлюцинации

Удобно различать галлюцинации по тому, откуда модель взяла неверное, — от этого зависит способ проверки.

ВидПримерКак ловить
Выдуманный фактневерная дата, несуществующий закон или событиепервоисточник
Выдуманный источникссылка на исследование, статью или решение, которых нетоткрыть источник по ссылке
Искажение документав пересказе договора срок 10 дней стал 14сверка с исходным текстом
Ошибка в расчётеневерная сумма или процент по таблицеформула или код
Выдуманная функцияметод или параметр, которого нет в библиотекезапуск кода, документация
Додуманное обещаниебот назвал условие, которого нет в правилахответ только по базе знаний

Особо стоит выделить искажение документа. Кажется, что если модель работает с загруженным файлом, она не может ошибиться — ведь текст перед ней. Но при пересказе, сокращении и извлечении данных модели обобщают: «до 3 рабочих дней» превращается в «быстро», «кроме тарифа Базовый» теряется, две похожие суммы меняются местами. Такие ошибки опаснее выдуманных фактов, потому что их не ждут.

Как снизить число выдумок

Давать факты, а не спрашивать память. Самый действенный способ — передать модели документ, выгрузку или статью и попросить отвечать только по ним. Бот поддержки, который отвечает по найденным статьям базы знаний (этот подход называют RAG), ошибается заметно реже бота, который отвечает «из головы». Для актуальных вопросов нужен режим с поиском: тогда модель сначала находит источники, а потом пишет по ним со ссылками.

Разрешить сказать «не знаю». Модель по умолчанию стремится дать ответ. Прямая инструкция меняет это поведение: «если ответа нет в документе, так и напиши», «если не уверен, пометь это». Ещё лучше — дать формат для пробелов: «[нет в документе]», «[нужно уточнить]». Пустое место с пометкой полезнее правдоподобной выдумки.

Так не надокакие штрафы предусмотрены в этом договоре?
Так лучшеВыпиши все штрафы и неустойки из договора ниже. Для каждой — номер пункта и дословная цитата. Ничего не добавляй из общих знаний о договорах. Если какой-то вид ответственности, который обычно бывает в таких договорах, здесь отсутствует, перечисли его отдельно с пометкой «в договоре нет».

Требовать цитаты и ссылки. Номер пункта, дословная цитата, ссылка на страницу — всё это превращает ответ в проверяемый. Цитату легко найти в документе, ссылку — открыть. Если модель не может привести цитату, это сигнал, что ответ не опирается на текст.

Снижать случайность. При работе через API для задач с фактами — извлечения данных, ответов по документу, классификации — ставьте низкую температуру: модель чаще выбирает самое вероятное продолжение и реже «фантазирует». Высокая температура уместна для идей и черновиков, где разнообразие важнее точности. В обычных чатах этого параметра обычно не видно, но тот же эффект даёт формулировка: «ответь кратко и только по документу» работает строже, чем «расскажи, что думаешь». Подробнее о температуре — в гайде что такое LLM.

Считать кодом. Для чисел используйте режим, в котором модель пишет и выполняет код: результат вычисления надёжнее числа, «прочитанного» из таблицы. Выбирать подходящую модель: рассуждающие режимы ошибаются реже на многошаговых задачах, а модели с поиском — на вопросах о свежих событиях. И спрашивать дважды: если два независимых ответа на один вопрос расходятся, модель не уверена, и ответ нужно проверить.

Как проверять ответы

Проверять всё подряд невозможно и не нужно. Разумный подход — проверять пропорционально цене ошибки. Черновик поста в соцсетях достаточно перечитать. Письмо клиенту с условиями, отчёт руководителю, документ в суд, код в продакшн — проверяются по первоисточнику каждый факт, число и ссылка, от которых зависит решение.

Практический порядок проверки удобно держать в виде короткого списка шагов. Модель может помочь и здесь — попросите её перечислить все проверяемые утверждения в своём ответе, и такой список удобно пройти по пунктам.

ШагЧто проверяемЧем
1числа, суммы, процентыисходные данные, формула или код
2ссылки и цитатыоткрыть каждую, найти цитату в источнике
3факты, от которых зависит выводзакон, документация, реестр, сайт ведомства
4пропуски при пересказесверка условий и исключений с документом
5обещания и срокиутверждённые правила и договорённости

В бизнес-процессах проверка должна быть встроена, а не зависеть от внимательности сотрудника. Ответы бота — только по утверждённой базе знаний, с передачей сложных случаев человеку. Автоматически извлечённые данные — с выборочной проверкой каждую неделю. Решения с деньгами и обязательствами — с подтверждением человеком. Все ответы модели — в журнале, чтобы в споре было видно, что именно она сказала. Как тестировать такие функции перед запуском, разобрано в гайде нейросети для тестировщика.

С чего начать прямо сейчас: добавьте в свои промпты разрешение говорить «не знаю» и требование цитат, а для важных ответов заведите привычку открывать хотя бы одну ссылку и пересчитывать хотя бы одно число. Это простые привычки, но именно их не хватило во всех трёх историях выше. Как строить промпты целиком, разобрано в гайде как писать промпты.

Автор: Артём Беспалов, маркетинговое ИИ-агентство «Термос Беспалова», Калининград.

Источники: OpenAI, «Why language models hallucinate», 05.09.2025 · решение по делу Mata v. Avianca, 22.06.2023 · ABA о деле Moffatt v. Air Canada · «We Have a Package for You!», USENIX Security 2025 (проверено 26.09.2026).

Гайды 2026

Разобрано до шаблонов: три гайда по 490 ₽

Всё, что в статьях идёт по верхам, здесь собрано в PDF: пошаговые схемы, готовые промпты и шаблоны, которые можно взять и применить в тот же день.

Обложка гайда «Промпты, которые работают: система и 60 готовых шаблонов»

Промпты, которые работают: система и 60 готовых шаблонов

Как писать запросы к нейросетям так, чтобы ответы можно было брать в работу без переписывания

  • Формула промпта из семи элементов с разбором «плохо / хорошо»
  • Работа с контекстом и файлами: как кормить модель данными
  • Итерации: как дорабатывать ответ, а не начинать заново
  • Few-shot и цепочки промптов со схемами

PDF, 57 стр., A4

Посмотреть фрагмент (PDF)
Обложка гайда «Свой ИИ-агент за выходные: пошагово, с кодом и без»

Свой ИИ-агент за выходные: пошагово, с кодом и без

Три рабочих проекта, выбор платформы, безопасность, стоимость и тесты: от агента в конструкторе до Python-кода с MCP

  • Цикл агента и пять архитектур со схемами
  • Честный раздел «когда агент не нужен» и дерево решений
  • Сравнение платформ no-code и кода по девяти критериям
  • Три проекта пошагово: секретарь заявок, аналитик отчёта, агент на коде

PDF, 51 стр., A4

Посмотреть фрагмент (PDF)
Обложка гайда «Claude с нуля: от первого чата до скиллов и Claude Code»

Claude с нуля: от первого чата до скиллов и Claude Code

Модели, проекты, 18 сценариев с промптами, скиллы, MCP и Claude Code для тех, кто не пишет код

  • Как выбрать модель Claude по задаче (актуально на 25.09.2026)
  • Схема интерфейса и разбор возможностей: проекты, артефакты, поиск, память, рассуждение
  • Формула запроса и приёмы, которые работают именно у Claude
  • 18 рабочих сценариев с готовыми промптами: письма, договоры, презентации, таблицы, исследования

PDF, 42 стр., A4

Посмотреть фрагмент (PDF)

Оплата на стороне платёжного сервиса. После оплаты вы вернётесь на сайт, и файл откроется сразу. Оплачивая, вы принимаете оферту.

Дальше

Что почитать дальше

Что такое LLM

Как устроена языковая модель и почему она пишет правдоподобно, а не обязательно верно.

Открыть

Контекстное окно

Почему модель теряет информацию в длинном тексте и достраивает ответ сама.

Открыть

Как писать промпты

Роль, задача, ограничения, формат — и разрешение сказать «не знаю».

Открыть
Вопросы

Частые вопросы

Что такое галлюцинации нейросетей простыми словами?
Уверенные и правдоподобные ответы, которые не соответствуют действительности: выдуманные факты, цитаты, источники, числа или функции программ. Модель не обманывает намеренно — она пишет самое вероятное продолжение текста, а вероятное не всегда верное.
Почему нейросеть выдумывает, а не говорит «не знаю»?
У модели нет механизма «не знаю», есть только вероятности продолжений. Кроме того, по исследованию OpenAI 2025 года, большинство тестов засчитывают только точные ответы, и угадывать модели выгоднее, чем признаваться в незнании. Прямая инструкция «если не знаешь — так и скажи» частично меняет это поведение.
Какие нейросети не галлюцинируют?
Таких нет. Новые модели и рассуждающие режимы ошибаются заметно реже, но галлюцинации остаются у всех больших языковых моделей. Надёжнее всего работают модели с доступом к документам и поиску, которые отвечают со ссылками на источники.
Как понять, что нейросеть выдумала ответ?
По форме — никак: выдумка звучит так же уверенно. Проверять нужно по первоисточнику: открыть ссылки, найти цитаты в документе, пересчитать числа формулой. Сигналы риска — ответ без ссылок на важный вопрос и расхождение между двумя ответами на один вопрос.
Как уменьшить галлюцинации в ответах?
Давать модели документы и просить отвечать только по ним, разрешать отвечать «не знаю», требовать цитаты и номера пунктов, считать числа кодом, использовать поиск для свежих фактов и задавать важный вопрос дважды, сравнивая ответы.
Кто отвечает за ошибку нейросети в бизнесе?
Компания или специалист, который использовал ответ. В деле Air Canada трибунал обязал авиакомпанию выполнить обещание её чат-бота, а в деле Mata v. Avianca суд оштрафовал адвокатов за выдуманные ChatGPT решения. Модель — инструмент, ответственность остаётся за людьми.

Запускаете ИИ в процессе, где ошибка стоит дорого?

Бот, который отвечает только по базе знаний, автоматизация с выборочной проверкой и журналом, подтверждение человеком там, где речь о деньгах, — так мы строим ИИ-решения в «Термос Беспалова».

Получить консультацию

Пн–Вс, 10:00–20:00. Отвечаю лично.