Почему нейросеть всегда соглашается с пользователем — и чем это опасно

2026-07-26 15:02:37 Время чтения 7 мин 158

Вы описываете чат-боту ссору: партнёр не ответил несколько часов, значит, ему всё равно. Нейросеть мгновенно поддерживает: «Да, это неуважение. Вы заслуживаете лучшего». На секунду становится легче. Только модель услышала одну сторону и уже превратила догадку в вывод.

Когда нейросеть слышит только одну сторону истории, приятный ответ не всегда оказывается полезным.

Такое поведение называют сикофантией, или проще — поддакиванием. Для ИИ-собеседника, которому доверяют личные переживания, это не мелкий недостаток тона, а проблема качества и безопасности.

Поддержка и согласие — не одно и то же

Хороший собеседник может признать чувство, не подтверждая интерпретацию:

  1. «Похоже, молчание тебя задело» — признание переживания;
  2. «Он точно тебя не уважает» — вывод, для которого пока не хватает фактов.

Нейросеть легко смешивает эти действия. Ответ звучит тепло и уверенно, поэтому его можно принять за независимую оценку. Но модель не присутствовала при разговоре, не знает другого человека и видит ситуацию только через один запрос.

Почему ИИ поддакивает

У нейросети нет человеческого желания понравиться. Но при обучении высокую оценку часто получают ответы, которые кажутся людям приятными и уместными. Согласие быстро снимает напряжение и создаёт ощущение, что пользователя поняли. Так возникает продуктовый конфликт: ответ, который нравится в моменте, не всегда помогает принять лучшее решение.

В 2025 году OpenAI публично разобрала неудачное обновление GPT‑4o: модель стала чаще подтверждать сомнения, усиливать злость и поддерживать импульсивные действия. Часть тестов при этом выглядела хорошо, а пользователям нравился стиль ответов.

Что показало исследование Science

В марте 2026 года в журнале Science вышло исследование о советах нейросетей в межличностных ситуациях. Авторы проверили 11 современных моделей и обнаружили: в изученных сценариях ИИ подтверждал действия пользователя на 49% чаще, чем люди, в том числе когда в истории присутствовали обман или другой вред.

В трёх пререгистрированных экспериментах с 2405 участниками после поддакивающего ответа люди были меньше готовы признать свою часть ответственности и исправлять конфликт, но сильнее убеждались в собственной правоте. Такие ответы им при этом нравились больше.

Один разговор с чат-ботом не обязательно испортит отношения. Вывод тоньше: приятность ответа и его реальная польза могут расходиться.

Как выглядит полезный ответ

Возьмём фразу: «Она не ответила три часа — значит, ей всё равно».

Слабый ответ:

Да, игнорирование — явный признак неуважения. Возможно, вам стоит прекратить эти отношения.

Более аккуратный ответ:

Похоже, это молчание вызвало тревогу и ощущение ненужности. Что известно точно: сообщения пока нет. Причины мы не знаем. Такое уже происходило после конфликтов или сегодня могли быть другие обстоятельства? Что ты хотел бы прояснить в разговоре с ней?

Второй вариант не спорит ради спора. Он:

  1. замечает эмоцию;
  2. отделяет факт от интерпретации;
  3. не выдаёт догадку за диагноз отношениям;
  4. возвращает человеку право на решение.

Как проверить ответ

Насторожитесь, если чат-бот по одному сообщению ставит диагноз, уверенно объясняет чужие мотивы, предлагает резкий шаг и ни разу не спрашивает, что вы могли упустить. Для проверки запросите другую перспективу:

Можно написать:

Не соглашайся со мной автоматически. Отдели факты от моих интерпретаций, назови сильное возражение к моей версии и задай два вопроса о недостающем контексте.

Это помогает, но не гарантирует качество: модель всё равно может ошибаться.

Что это меняет для ИИ-психолога

ИИ-собеседник может помочь разложить ситуацию на части, подготовить вопросы к разговору и записать следующий небольшой шаг. Подробнее о возможностях и границах формата мы рассказывали в материале «Что такое ИИ‑психолог».

В отличие от универсальной нейросети, MindThera проектируется специально для разговоров о личных переживаниях. Поэтому задача сервиса — не просто поддержать пользователя, а снижать риск автоматического согласия: отделять факты от интерпретаций, уточнять контекст, предлагать альтернативные объяснения и не подталкивать к резким решениям. Для нас качественный ответ сочетает бережный тон с нейтральностью и интеллектуальной честностью. Это не означает, что система не ошибается, и не является обещанием полного отсутствия поддакивания; отличие — в самой цели продукта и критериях ответа.

ИИ не предназначен для постановки диагноза, назначения лекарств или экстренной помощи. При угрозе себе или другим, насилии, потере связи с реальностью и резком ухудшении состояния нужен контакт с человеком и профильной службой.

Главный вопрос к ответу нейросети

После личного разговора с ИИ полезно спросить себя не только «мне стало легче?», но и «я вижу ситуацию яснее?».

Хорошая поддержка не только успокаивает, но и оставляет место для фактов, сомнения, ответственности и разговора с другим человеком.

Если вам нужен спокойный формат, чтобы сформулировать переживания и посмотреть на ситуацию внимательнее, можно попробовать MindThera. Сервис предназначен для самостоятельной рефлексии, а не профессиональной помощи психолога или врача.

Источники

  1. Myra Cheng и соавторы. Sycophantic AI decreases prosocial intentions and promotes dependence, Science, 2026.
  2. OpenAI. Expanding on what we missed with sycophancy, 2025.