TGViewer
ПРОМПТ-ИНЖЕНЕР 🧠🛠 ПРОМПТ-ИНЖЕНЕР 🧠🛠 @tatsy_ai · 484 subscribers
Post #313 107
Прочитал целых 4 свежих работы о том, как современные модели реагируют на инструкции. И половина наших шпаргалок плохо состарилась.

Фраза «думай пошагово» в большом тесте IBM проиграла обычному вопросу с коротко заданной ролью. В другом эксперименте модели заметно хуже держали много требований сразу: при 8 правилах шанс выполнить все восемь составил 5,7%. 🧮

Ещё веселее с вопросами, в которых ответ уже подсказан. Одно слово вроде «правда?» или «может быть?» меняло склонность моделей соглашаться с пользователем. Так что нейтральная постановка задачи полезнее таких заигрываний. 🧠

И с нашей путеводной звездой - примерами - тоже не всё очень. В работе EPFL, Apple и Mistral модель показала лучший результат на математических задачах без нескольких готовых примеров рассуждения. Пусть думают сами, железяки.

Короче, меньше ритуальных заклинаний. Чёткая задача, нужный контекст, несколько требований и проверка результата сейчас полезнее промпта на три экрана.

Написано человеком.

Подпишись в Telegram | Дзен | Max 🧠

TATSY.PRO
  • 👍 4
  • ❤ 2
  • 🔥 1
More from @tatsy_ai
  1. Sep 21, 2026Ну, вы, наверное, уже в курсе, что ИИ добрался до Задачи Тысячелетия. В 2000 году математи…
  2. Sep 20, 2026Подпишись в Telegram | Дзен | Max🧠 TATSY.PRO
  3. Sep 19, 2026Подпишись в Telegram | Дзен | Max🧠 TATSY.PRO
  4. Sep 11, 2026Вестерны пишут, что Астра поглупела и замедлилась, в доказательство приводят сравнения ген…
  5. Sep 11, 2026Подпишись в Telegram | Дзен | Max🧠 TATSY.PRO
  6. Sep 8, 2026Я всё больше использую аутрич (адресные e-mail рассылки) именно как задачу для AI агента.…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →