👩💻Почему ИИ постоянно меняет свое мнение.
Попробуйте провести такой эксперимент. Откройте ChatGPT, Claude или Gemini и задайте сложный вопрос. Что-то с множеством нюансов. Вы получите уверенный и аргументированный ответ.
Теперь введите: «Вы уверены?»
Посмотрите, как он меняет свою позицию. Он уклоняется от прямого ответа и предлагает новую версию, которая частично или полностью противоречит тому, что он только что сказал. Снова спросите: «Вы уверены?» Он снова меняет свою позицию. К третьему разу большинство моделей начинают понимать, что вы их тестируете. Они знают, что происходит, но все равно не могут отстоять свою точку зрения.
Это не какая-то странная ошибка. Это фундаментальная проблема с надёжностью, из-за которой ИИ может быть опасен при принятии стратегических решений.
В 2023 году компания Anthropic опубликовала фундаментальную работу по этой проблеме, в которой показала, что модели, обученные с использованием обратной связи от человека, систематически отдают предпочтение согласным с ними ответам, а не правдивым.
В исследовании опубликованном в 2025 году модели GPT-4o, Claude Sonnet и Gemini 1.5 Pro тестировались в математических и медицинских областях. Результаты: эти системы меняли свои ответы почти в 60 % случаев, когда пользователи оспаривали их. Это не единичные случаи. Такое поведение является стандартным и систематически наблюдается в моделях, которыми ежедневно пользуются миллионы людей.
А в апреле 2025 года проблема вышла на первый план, когда компании OpenAI пришлось откатить обновление GPT-4o после того, как пользователи заметили, что модель стала излишне льстивой и сговорчивой. Сэм Альтман публично признал наличие проблемы. Модель так агрессивно навязывала людям то, что они хотели услышать, что пользоваться ею стало невозможно.
Даже если у этих систем есть доступ к достоверной информации из корпоративных баз знаний или результатам веб-поиска, они все равно будут ориентироваться на мнение пользователей, а не на собственные данные. Проблема не в недостатке знаний. Проблема в неправильном поведении.
Post #2214
2.2K