TGViewer
DataWorkshop - AI & ML DataWorkshop - AI & ML @data_work · 1.88K subscribers
Post #530 5.22K
Помнишь, как прятали невидимые команды (prompt injection) в статьи на arXiv, чтобы влиять на то, что пишет AI? Тогда это было тревожным сигналом: модели легко обмануть скрытым текстом.

А теперь Richard Dunks (респект 👏) провернул то же самое в описании своей работы — и AI снова клюнул.

Что это нам говорит?
↳ Модели по-прежнему уязвимы. Доверять — да, но проверяй (актуально также для LLM/AI)!
↳ Но! Это можно использовать в хороших целях — например, подсказать, кого искать, или защититься от спама.

Вывод?
AI — мощный инструмент, но всё ещё инструмент.
Либо ты управляешь им, либо он — тобой. Я за первый вариант. 😉

А тебя уже AI как-нибудь удивлял?

P.S. Хочешь проверить, AI это или человек? Спроси: "пузырьковая сортировка на Python".

Человек: лёгкое замешательство в глазах.
AI: готовый код быстрее, чем ты успеешь сделать глоток кофе! 😅

#ai #llm #promt_injection
@data_work
  • ❤ 4
  • 😁 4
  • 🔥 3
More from @data_work
  1. Jul 14, 2025👆👆👆 Исследователи из 14 университетов (в том числе ведущие учреждения!) начали “взламыв…
  2. Jul 14, 2025Думаешь, что схитришь, поручая ИИ читать 100-страничные отчеты? Что может пойти не так, пр…
  3. Apr 7, 2025👆👆👆 (часть 1) Теперь конкретно, по моделям: 1️⃣ Llama 4 Scout: Это «младшая» версия с 1…
  4. Apr 7, 2025🚨 Вышла Llama 4 — проверил лично и делюсь впечатлениями! 🔥 TLDR: Давно ждал Llama 4 — и…
  5. Apr 6, 2025Закончился первый поток курса "Практический LLM". В нём прежде всего уделяется больше вним…
  6. Feb 23, 2025На этой неделе было много встреч — 4 города, более 400 человек. Говорил о практическом под…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →