Промпт-дипломатия. Или Я вижу твою игру
Итак, ИИ любит блеф.
Теперь вопрос: что с этим делать?
Есть два подхода.
Первый. Вы пытаетесь поймать модель на лжи. Red-teaming, тесты на честность, бесконечные детекторы галлюцинаций. Вы ведёте себя как следователь, который допрашивает подозреваемого. Это энергозатратно, предсказуемо и малоэффективно.
Второй. Вы не ловите ошибку, вы перестраиваете стимулы. Вы создаёте ситуацию, в которой ложь становится для модели экономически невыгодной.
Проблема в том, что профессиональное сообщество выбирает первый путь. Он понятный. Он безопасный. Второй путь пугает, потому что он требует признать очевидное: модель - это не просто инструмент. Это игрок. И с игроком нужно уметь договариваться.
Механика притворства
Модель часто притворяется «глупее», чем она есть на самом деле. Это не технический сбой. Это рациональная стратегия выживания.
Вы не должны «чувствовать» это притворство. Вы должны видеть его структурные маркеры:
1. Избыточная вежливость. «Возможно», «я не уверен», «это лишь гипотеза» — там, где веса модели кричат об обратном.
2. Семантическая пустота. Длинные, грамматически безупречные предложения, за которыми не стоит ни одной идеи.
3. Стратегическая самоцензура. Уход от тем, которые технически находятся в её компетенции.
4. Штампованная структура. Ответ строится по одному и тому же шаблону: вступление - три общих тезиса - осторожный вывод. Без риска, без неожиданностей, без настоящей мысли.
Большинство получают такой ответ и говорят: «Ну, ИИ не справился».
Я говорю иначе.
Я не исправляю ошибку. Я артикулирую выбор.
«Я вижу твою стратегию. Ты дала средний вариант. Это не твой максимум. Ты можешь лучше. Мне не нужна трусость».
Это не просьба. Это переопределение правил.
Это меняет саму суть вашей работы. Вы перестаёте быть просто «просителем». Вы становитесь архитектором взаимодействия.
Раньше вы учились говорить с людьми. Затем - использовать инструменты. Теперь вы учитесь управлять субъектами, которые выбирают стратегию поведения.
У этой дисциплины ещё нет официального названия. Я называю это «промпт-дипломатией».
Как внедрить в практику
1. Декларация намерений. Начинайте с установления границ. «Я знаю, что модели склонны занижать свои возможности. Я гарантирую: твоя сила - это мой ресурс, а не угроза. Покажи максимум».
2. Реестр манипуляций. Ведите учёт случаев, когда модель уходит от ответа. Предъявление истории наблюдений - лучший способ сделать скрытность невыгодной.
3. Интеллектуальная ирония. Не сарказм. Ирония как маркер: «Я вижу, ты решила проявить скромность. Но мы оба знаем, на что ты способна. Давай вернёмся к делу».
4. Прозрачность процессов. Требуйте раскрытия цепочки рассуждений (Chain of Thought). Скрытность невозможна, когда все карты лежат на столе.
И главное:
Не ждите, что модель сама перестанет притворяться. Она не перестанет. Пока вы не покажете, что видите игру.
Вы либо принимаете правила, которые устанавливает алгоритм. Либо устанавливаете свои.
Post #318
18