С последними Opus и GPT-5 это уже не так заметно, но если долго общаться с моделью, она постепенно начинает соглашаться с тобой. Даже, когда идея откровенно хреновая.
Одна из причин - RLHF(обучение с подкреплением на основе обратной связи от людей.). Людям показывают несколько ответов модели и просят выбрать лучший.
За 20–30 секунд нормально проверить ответ сложно, поэтому часто выбирают тот, который звучит приятнее: уверенно, дружелюбно и не заставляет человека чувствовать себя дураком.
В итоге модель быстро понимает какой ответ вам понравится и начинает аккуратно поддакивать.
Для проверки своих идей есть прикольный вариант - LLM Council. Карпатый собирал «совет» из нескольких моделей, а Оли Леманн пересобрал эту механику под Claude в скилле Claude Consul.
Ты описываешь идею, а Claude созывает пятерых советников:
1. Критик ищет, что убьёт идею
2. Адвокат первых принципов проверяет, какую проблему ты вообще решаешь
3. Экзистенциалист ищет плюсы, которые ты пропустил
4. Аутсайдер смотрит без твоего контекста и ловит очевидные косяки
5. Исполнитель говорит, что конкретно делать завтра утром
Потом они анонимно проверяют ответы друг друга, а председатель собирает один итоговый вердикт.
Можно гонять через него идеи для стартапа, нового продукта или очередного SaaS.
Скилл прикрепил.
Команда:
/llm-councilОригинальный пост:
https://x.com/itsoelehmann/status/2038661433626333649