TGViewer
Механические крылья Икара Механические крылья Икара @uitcom · 1.93K subscribers
Post #1097 664

Forwarded from AppSec Journey

Risk AI_Model_Use.pdf2.1 MB
Это уже у нас AGI covernance пошел!... так, если у вас там агенты и LLM в бизнес-процессах во весь рост - это оно, нам надо такое. Все примеры, бенчмарки и угрозы завязаны на специфику больших языковых моделей: chain-of-thought и его faithfulness, steganographic reasoning, jailbreak resistance, agentic AI R&D (RE-Bench, SWE-Bench Pro, PaperBench), cyber/bio-uplift оценки (Cybench, WMDP, LAB-Bench), sandbagging и alignment faking. В целом, документ не то чтобы базовый, надо прям включиться.
Мне понравилось, что для MLSecOps оч хорошо подходит, можно ханипот-эксперименты control evaluations и прочие штуки типа мисаллайментов покрутить у себя🤖
  • 👾 3
More from @uitcom
  1. Sep 30, 20262 самых частых вопроса перед каждым нашим философским циклом: «Нужна ли подготовка?» и «Чт…
  2. Sep 29, 2026Вчера на закате блики играли на волнах, словно порождая какой-то шифр на воде. Вспомнил Су…
  3. Sep 26, 2026Пару недель назад размышлял в канале про недуг гиперэмпатичности. Наткнулся в итоге на цит…
  4. Sep 25, 2026Давние читатели этого канала знают, что я веду его в формате дневника для своих Здесь не б…
  5. Sep 22, 2026ставим глобальную цель на осень: разобраться с историями! вообще со всеми и сразу. Для это…
  6. Sep 22, 2026В Arete никогда не ставилась цель делать какие-то практически полезные семинары, но пожалу…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →