Галлюцинации — главная проблема LLM в продуктах, где важна фактическая точность. Модель не отличает «знаю» от «не знаю»: для неё всё это просто разные распределения вероятностей следующего токена.
Виды галлюцинаций
- Фактические — выдуманные даты, имена, цифры, ссылки.
- Логические — неверные выводы из правильных предпосылок.
- Контекстные — модель «забыла» или исказила то, что было сказано выше в диалоге или в переданном документе.
- Источники — модель ссылается на несуществующие книги, статьи, законы.
Как уменьшить
- Подключить RAG: дать модели возможность опираться на проверенные документы.
- Просить модель явно отмечать, чего она не знает.
- Использовать цепочку рассуждений и проверки: «приведи источник», «перепроверь ответ».
- На уровне продукта добавлять проверку ответов через внешние API или через человека.
- В любом продукте, где есть LLM и важна точность, нужно отдельно работать с галлюцинациями
- Особенно — в медицине, праве, финансах, поддержке клиентов
- В чисто творческих задачах (генерация идей, текстов) «галлюцинация» часто перестаёт быть проблемой и становится частью задачи
Юрист просит модель «дай ссылки на 3 решения суда по теме X». Модель уверенно приводит три решения с номерами и датами. Все три не существуют. Это не редкий случай, а типичное поведение LLM без RAG и без проверки. В продукте, где такие галлюцинации недопустимы, обязательно делается отдельный шаг: модель сначала получает реальные решения из юридической базы, и только потом строит ответ на них.
Не пытайтесь «победить» галлюцинации только промптом. Самые надёжные подходы — структурные: RAG, вызов функций к проверенным источникам, явная проверка ответов. Формулировки вида «отвечай, только если уверена» помогают, но дают лишь частичное улучшение.