Протокол сверки: настройка, после которой нейросеть перестаёт выдумывать
Это готовая настройка, после которой нейросеть перестаёт уверенно выдумывать. Внутри полный текст правил под копирование в постоянные инструкции, порядок проверки ответа и три приёма, которыми ложь ловится за полминуты. Ставится один раз и действует во всех разговорах.
Почему модель врёт, и почему уверенным тоном
Это не поломка и не злой умысел. Так устроен сам способ, которым она отвечает.
Модель подбирает следующее слово по тому, насколько оно уместно. У правдоподобного и у правдивого продолжения уместность одинаковая, а вот проверить факт в момент ответа ей нечем. Поэтому там, где данных не хватает, получается гладкий текст с выдуманной серединой.
Тон при этом всегда ровный, потому что уверенность в ответе никак не связана с наличием источника. Именно это опаснее самой ошибки: неуверенное «кажется, около двадцати процентов» человек проверит, а спокойное «двадцать три процента по данным исследования» примет на веру и вставит в презентацию.
Просьба «не выдумывай» почти не работает, потому что она не даёт правила поведения на случай нехватки данных. Нужно прямо сказать, что делать вместо выдумки: признаваться в незнании конкретной формулировкой. Ровно на этом и построен текст ниже.
Протокол сверки, полный текст
Копируй целиком в постоянные инструкции. Ниже разбор, зачем нужен каждый кусок.
Куда это класть
Разово в настройки, без повтора в каждом разговоре.
- В ChatGPT: настройки, персонализация, пользовательские инструкции. Текст кладётся в поле про то, как отвечать. Действует во всех новых разговорах.
- В Клоде: настройки профиля, поле с постоянными указаниями. Либо создай проект под задачи, где точность критична, и положи протокол в инструкции проекта.
- В Клод Коде и в проектах на диске: файл CLAUDE.md в корне рабочей папки, читается сам при каждом запуске.
- Если поля с постоянными инструкциями нет, вставляй протокол первым сообщением в разговоре. Действует до конца этого разговора.
Три приёма поймать выдумку за полминуты
Работают независимо от настроек, поэтому их стоит знать даже без протокола.
Спросить источник отдельным сообщением
Выдуманное число здесь обычно и рассыпается: приходит либо признание, либо ссылка на несуществующее исследование, а его легко проверить поиском по названию.
Спросить то же самое заново в новом окне
Задай тот же вопрос в чистом разговоре и сравни ответы. Проверяемый факт повторяется почти дословно, а выдумка каждый раз выходит разной. Расхождение в числах между двумя заходами это готовый признак.
Попросить назвать границу знания
Прямо поставленный вопрос про границу почти всегда получает честный ответ, потому что признание тут и есть требуемое поведение. Второй список и надо проверять руками.
Где протокол не спасает
Честная граница, чтобы не расслабляться после установки.
Протокол снижает долю выдумки заметно и не убирает её полностью. Он делает модель осторожнее в формулировках и заставляет чаще признаваться в незнании, но проверить внешний факт она по-прежнему не может, если у неё нет доступа к источникам.
- Свежие события. Всё, что произошло недавно, проверяй сам, независимо от того, как уверенно это звучит.
- Цитаты и авторство. Самый частый вид выдумки: настоящая мысль приписывается не тому человеку.
- Точные числа в деньгах, сроках и законах. Здесь цена ошибки такая, что проверять надо всегда.
- Ссылки. Адрес может выглядеть правильно и не открываться вовсе. Проверяется одним кликом.
Читать дальше в блоге
Эту тему я разбираю подробно в статье рабочий список нейросетей для контента. Там же лежат остальные разборы про нейросети.
Я собрал систему, по которой обычный человек запускает блог с нуля и набирает аудиторию без съёмок, монтажа и команды. Внутри разбор, с которого стартовал сам.
Открыть разбор: с чего начать→