Галлюцинация — это ответ, который выглядит как знание, но им не является. Модель не «лжёт»: она продолжает текст наиболее правдоподобным образом, и правдоподобие тут — не синоним правды. В рабочем контуре это главный источник недоверия: один уверенно выдуманный пункт договора обесценивает сотню правильных ответов.
В тарифной сетке режим перекрёстной проверки появляется на Tier 2 (AI Power). Название «Zero-Hallucination Mode» — маркетинговое, и мы это признаём. Технически там мультиагентная схема, и её стоит объяснить как есть.
Что уже сделано до всякой мультиагентности
Базовая защита от выдумок — не в хитрой схеме, а в дисциплине источников. Модель отвечает не «из головы», а по фрагментам, найденным в вашей базе знаний, и обязана сослаться на файл и раздел. Это отсекает целый класс ошибок: там, где нечего процитировать, отвечать не из чего.
Остаточный риск в двух местах. Первое: найден правильный фрагмент, но модель пересказала его неточно — переставила условие, потеряла отрицание, обобщила частный случай. Второе: фрагмент найден не тот, а ответ по нему построен безупречно — формально корректно, по сути мимо.
Как устроена перекрёстная проверка
Схема разносит одну задачу на несколько ролей, и роли не доверяют друг другу:
- Извлечение. Первый проход собирает кандидатов из гибридного поиска и формирует черновой ответ со ссылками.
- Проверка. Второй проход получает черновик и исходные фрагменты и отвечает на единственный вопрос: подтверждается ли каждое утверждение текстом источника. Не «звучит ли это правдоподобно», а «есть ли это в приложенном куске».
- Сборка. Утверждения без подтверждения либо снимаются, либо помечаются как неподтверждённые — в зависимости от настройки контура.
Ключевая деталь: проверяющий проход не видит внешних знаний и не должен «догадываться». Его задача — сверка с текстом, а не рассуждение о мире. Именно поэтому схема ловит вторую ошибку из двух названных выше, а первую превращает из молчаливой в заметную.
Вместо гладкого ответа на любой вопрос появляется ответ, у которого части имеют разный статус: подтверждено источником, не подтверждено, не найдено. Пользоваться этим поначалу непривычно, зато проверять — быстро.
Чем платим
Ничего бесплатного здесь нет, и цена вполне конкретная.
- Время ответа. Проходов больше одного, значит, и ждать дольше. На коротких вопросах разница незаметна, на разборе многостраничного документа — вполне.
- Видеопамять. Держать несколько ролей и длинные контексты на 16 ГБ — путь к выгрузке моделей по кругу. Отсюда и требование 24–32 ГБ на Tier 2, а не любовь к большим цифрам.
- Отказы вместо ответов. Система чаще говорит «в документах этого нет». Для руководителя, привыкшего к бодрым ответам чат-бота, это выглядит как ухудшение — ровно до первого случая, когда бодрый ответ оказался выдумкой.
Чего эта схема не даёт
Она не гарантирует отсутствие ошибок. Никакая архитектура этого не гарантирует, и любой, кто обещает ноль галлюцинаций как свойство продукта, продаёт вам уверенность, а не технологию.
Проверка сверяет ответ с источником — она не проверяет сам источник. Если в базе лежит устаревшая редакция регламента, ответ будет корректно подтверждён устаревшим документом. Актуальность содержимого базы остаётся зоной ответственности человека, и это не отговорка, а неустранимое свойство схемы.
Не спасает она и от неправильно заданного вопроса. Если спрашивать не то, ответ будет добросовестно подтверждён не тем.
Не «система не галлюцинирует», а «система реже выдумывает молча». Разница принципиальная: во втором случае у вас есть способ увидеть, где она не уверена, и решение остаётся за вами.
Коротко
Перекрёстная проверка — это разделение ролей: один проход отвечает, другой сверяет ответ с приложенным текстом. Она заметно снижает долю уверенных выдумок и делает неуверенность видимой. Платите за это временем ответа и видеопамятью, поэтому режим включается на контурах Tier 2 и выше. Ответственность за актуальность документов остаётся у вас — и это единственное честное распределение ролей.