Нейросети врут в 30% ответов — один промпт решает проблему

пост на 3 мин

Один специальный промпт способен выключить враньё в нейросети. По разным оценкам, ИИ выдумывает факты как минимум в 30% своих ответов, и проблема накрывает практически все текстовые модели на рынке. Паблик AiGENDA Live выложил готовый текст инструкции — достаточно вставить его в настройки ChatGPT в разделе «Персонализация» и нажать сохранение. Действительно ли одна настройка решает проблему, и что именно делает этот промпт?

«Пользовательские инструкции» — функция ChatGPT, доступная в настройках профиля. Промпт задаёт нейросети набор жёстких правил: говорить только правду, не строить предположений, опираться на проверяемые источники и показывать ход рассуждений. При сомнении модель должна честно сообщить о неуверенности, а не подставить выдуманный ответ. Надо сказать, что такие инструкции работают как внешний фильтр — они не исправляют саму модель, но меняют поведение на этапе генерации. Впрочем, эксперты предупреждают: никакая инструкция не устраняет фундаментальную причину галлюцинаций, заложенную в архитектуру языковой модели.

Проблема галлюцинаций остаётся одной из главных болей индустрии искусственного интеллекта. Исследования показывают, что крупные языковые модели генерируют текст на основе вероятностей, а не на базе проверенных знаний. Поэтому промпт с правилами работает как внешний якорь: он меняет поведенческий шаблон на этапе подготовки ответа. С другой стороны, эффективность такого подхода сильно зависит от модели — GPT-4 реагирует на инструкции заметно чувствительнее, чем более ранние версии, тогда как бесплатные версии могут проигнорировать часть ограничений.

На практике правило просто: чем конкретнее инструкция, тем меньше ошибок. Указание «приведи источник для каждого факта» заставляет модель либо ссылаться на реальные документы, либо честно сказать, что не знает. При этом пользователь должен проверять ключевые цифры самостоятельно — даже самый строгий промпт не гарантирует абсолютную точность. Разумеется, для работы с юридическими или медицинскими вопросами эта настройка — помощь, но не замена экспертизы.

Собственно, как это работает на практике? Когда пользователь вводит запрос с промптом «не выдумывай», модель перестраивает приоритеты: вместо генерации правдоподобного текста она начинает искать границы своих знаний. Если ответа нет — честно говорит «у меня нет достаточно информации», а не придумывает цитату или статистику. И вот тут проявляется главный эффект: даже если модель ошибается, промпт снижает вероятность уверенной подачи неправды, что критично при работе с числами.

Пользуетесь ли вы ChatGPT для работы или учёбы — и замечали ли вы, когда нейросеть уверенно выдаёт неправду? Если хотите проверить точность ответов или разобраться в принципах работы ИИ, нейросеть AiGENDA подберёт надёжные источники, объяснит, как отличить правду от галлюцинации, и переведёт сложную тему на понятный язык. Попробуйте бесплатно или выберите гибкий тариф.

Комментариев нет

Добавить комментарий

МИД Польши вызвал посла России — Варшава идентифицировала упавшую ракету X-101

МИД Польши вызвал посла России Георгия Михно из-за упавшего на юго-востоке страны…

Трамп отказался передать 300 ракет Patriot и предложил лицензию на производство

После переговоров с Владимиром Зеленским Дональд Трамп отказался передать Киеву запрашиваемые 300…

Возраст женихов в Подмосковье достиг 36 лет, невесты — 33

Средний возраст вступления в брак в Московском регионе продолжает расти: теперь женихи…

Челси избежал лишения очков — клуб заплатит 10 млн фунтов штрафа

«Челси» избежал вычета баллов и выплатит десять миллионов фунтов за нарушение правил…