TGViewer
Oh my AI Oh my AI @oaiohmy · 311 subscribers
Post #440 246
Итоги подведем

Хорошо что увидели нормально проработанную идею классифицировать угрозы и ответы для агентов, хотелось бы конечно фреймворк/темплейты и поглубже(ну как кукбук например) чем Frontier Safety Famework но тут уж пейшыте сами. Выглядит интереснее чем OWASP TOP10 LLM, OWASP ASI и NIST AI ASI. Мне кажется это основа настоящего крепкого системного подхода. Конечно же часть угроз не оправдает себя и мы пытаемся придумать защиту от того что никогда не произойдет (но мы ведь не знаем какая), часть - просто уплыла из зоны видимости и укусит еще на за мягкое место в будущем. Однако ящитаю этот док - must read любому МЛщику имеющему отношение к агентам.

#ai_safety #owasp #agents #llm #threat_model
More from @oaiohmy
  1. Sep 22, 2026К слову муха в этом твите так-то должна была искать фишинг. Но она заспидранила эту жизнь…
  2. Sep 22, 2026МУХА! Муху научили проходить по цепочке атаки до финальной странички флоу фишинга - кликат…
  3. Sep 19, 2026У LLMок нашли вектор боли Что такое: Whitebox-интерпретируемость: линейное 'pain'-направле…
  4. Sep 11, 2026Вышел новый Threat Intelligence Report от Anthropic Анализ с декабрь 2025 по август 2026.…
  5. Aug 23, 2026Если задумывались насколько скиллы лучше чем запись в memory Demystifying Agent Skills - А…
  6. Aug 21, 2026Очень нравится наблюдать за тем, как по мере того, как модельки умнеют, агенты на их базе…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →