Почему нейросеть выдумывает факты?

Языковая модель не ищет ответ в базе фактов, а продолжает текст самым вероятным образом. Если точного знания нет, она всё равно достраивает правдоподобный ответ — так появляются выдуманные цитаты, ссылки и цифры. Это называют галлюцинациями; меньше всего их, когда модель отвечает по источникам, которые ей дали.

Обновлено

Подробно

Как это устроено

Модель обучалась предсказывать следующее слово в огромном количестве текстов. Она хорошо усвоила, как обычно звучат ответы, но не хранит «таблицу правды». Когда вопрос редкий или сформулирован размыто, самые вероятные слова складываются в уверенный, но неверный ответ.

Исследования OpenAI показывают ещё одну причину: при обучении и оценке модели чаще поощряют за попытку ответить, чем за честное «не знаю». Поэтому модель склонна угадывать.

Риски

Когда галлюцинаций больше всего

Что делать

Как снизить выдумки

Вопросы

Частые вопросы по теме

Какая нейросеть меньше всего выдумывает?

Меньше галлюцинируют модели с подключённым поиском или работающие по вашим документам (RAG). Между моделями разница есть, но способ задать вопрос влияет сильнее.

Можно ли полностью избавиться от галлюцинаций?

Нет: это свойство вероятностной генерации текста. Их можно заметно сократить, если давать модели источники и проверять ключевые факты.

Почему нейросеть придумывает ссылки на статьи?

Она знает, как выглядит типичная ссылка, и собирает правдоподобную. Без реального поиска такие ссылки часто не существуют.

Выдумывает ли ИИ в заметках Fast Notes?

Ответы «Спросить» строятся по вашим заметкам и показывают источники — по ним видно, откуда взят каждый ответ. Если в заметках ответа нет, это лучше спросить прямо.

Fast Notes

Как это устроено в Fast Notes

В Fast Notes ИИ отвечает по вашим собственным заметкам и показывает, из каких записей взят ответ, — так любой факт можно проверить одним нажатием.

Источники

Источники