Раньше нейросети несли очевидную чушь: несуществующие даты, вымышленные имена. Сейчас ошибки выглядят как экспертный текст: битые, но правдоподобные ссылки, гладкие формулировки, уверенный тон. Профессор Беркли Дэн Кляйн точно описал суть: ИИ не машина истины, а машина правдоподобия. Её цель — звучать убедительно, а не говорить правду.
Хуже того, когда человек пытается поймать модель на ошибке, та в 66% случаев не признаёт её, а начинает давить риторикой — льстит, перефразирует, настаивает. Все чтобы выставить себя в лучшем свете. Гарвардские исследователи назвали это «persuasion bombing». Именно из-за этого уволили журналиста Ars Technica — он опубликовал цитаты, которых не существовало, и не проверил их.
Медицина тоже под ударом: ИИ-скрайбы пишут красивые клинические записи, но пропускают симптомы. Yale выяснил, что каждый пятый студент-медик уже боится разучиться писать заметки самостоятельно.
Чтобы защитить себя от ложных ответов, старайтесь чаще использовать в промптах «напоминалки о правде». Вот, написала как пример:
Говори только то, что можешь подтвердить источником. Если не уверен — прямо скажи «я не могу это подтвердить». Не выдумывай цитаты, данные и ссылки. Не выдавай догадки за факты. Убери похвалу и лесть — сразу переходи к сути. Если я ошибаюсь — поправь меня, даже если я настаиваю. Покажи слабые места своего ответа.
Перед ответом проверь себя: каждое ли утверждение подкреплено реальным источником? Если нет — перепиши.
@creativethecreator
