Почему нейросеть выдумывает факты?
Языковая модель не ищет ответ в базе фактов, а продолжает текст самым вероятным образом. Если точного знания нет, она всё равно достраивает правдоподобный ответ — так появляются выдуманные цитаты, ссылки и цифры. Это называют галлюцинациями; меньше всего их, когда модель отвечает по источникам, которые ей дали.
Обновлено
Как это устроено
Модель обучалась предсказывать следующее слово в огромном количестве текстов. Она хорошо усвоила, как обычно звучат ответы, но не хранит «таблицу правды». Когда вопрос редкий или сформулирован размыто, самые вероятные слова складываются в уверенный, но неверный ответ.
Исследования OpenAI показывают ещё одну причину: при обучении и оценке модели чаще поощряют за попытку ответить, чем за честное «не знаю». Поэтому модель склонна угадывать.
Когда галлюцинаций больше всего
- Точные цифры, даты, цитаты и названия статей.
- Редкие темы, о которых мало текстов в интернете.
- Свежие события после даты обучения модели.
- Просьбы «дай ссылку на источник» без подключённого поиска.
- Длинные цепочки рассуждений, где ошибка в начале тянет за собой следующие.
Как снизить выдумки
- Давайте модели источник: текст документа, заметки, ссылку — и просите отвечать только по нему.
- Прямо разрешайте ответ «не знаю» в запросе.
- Просите указывать, из какого фрагмента взят каждый факт.
- Включайте поиск в интернете для вопросов о свежих событиях.
- Проверяйте цифры и цитаты по первоисточнику.
Частые вопросы по теме
Какая нейросеть меньше всего выдумывает?
Меньше галлюцинируют модели с подключённым поиском или работающие по вашим документам (RAG). Между моделями разница есть, но способ задать вопрос влияет сильнее.
Можно ли полностью избавиться от галлюцинаций?
Нет: это свойство вероятностной генерации текста. Их можно заметно сократить, если давать модели источники и проверять ключевые факты.
Почему нейросеть придумывает ссылки на статьи?
Она знает, как выглядит типичная ссылка, и собирает правдоподобную. Без реального поиска такие ссылки часто не существуют.
Выдумывает ли ИИ в заметках Fast Notes?
Ответы «Спросить» строятся по вашим заметкам и показывают источники — по ним видно, откуда взят каждый ответ. Если в заметках ответа нет, это лучше спросить прямо.
Как это устроено в Fast Notes
В Fast Notes ИИ отвечает по вашим собственным заметкам и показывает, из каких записей взят ответ, — так любой факт можно проверить одним нажатием.
Источники
Похожие вопросы
Почему ИИ так уверенно ошибается?
Уверенный тон — это стиль текста, а не степень знания. Модель учится писать как хорошие ответы в интернете, а они…
02Как проверить ответ нейросети?
Проверяйте в первую очередь факты, которые влияют на решение: цифры, даты, имена, законы и ссылки. Попросите модель…
03Как нейросеть ищет ответы в моих документах (RAG)?
Документы заранее режутся на фрагменты, и для каждого считается числовой «отпечаток смысла» — эмбеддинг. Когда вы…
04Почему нейросеть забывает начало разговора?
У модели есть контекстное окно — максимальный объём текста, который она видит за раз. Всё, что в него не помещается…
05Что такое контекстное окно нейросети?
Контекстное окно — это максимальный объём текста в токенах, который модель обрабатывает за один запрос: ваш вопрос…
06Что такое токены в нейросетях?
Токен — кусочек текста, которым оперирует модель: целое короткое слово, часть длинного слова, знак препинания или…