Итоги подведем
Хорошо что увидели нормально проработанную идею классифицировать угрозы и ответы для агентов, хотелось бы конечно фреймворк/темплейты и поглубже(ну как кукбук например) чем Frontier Safety Famework но тут уж пейшыте сами. Выглядит интереснее чем OWASP TOP10 LLM, OWASP ASI и NIST AI ASI. Мне кажется это основа настоящего крепкого системного подхода. Конечно же часть угроз не оправдает себя и мы пытаемся придумать защиту от того что никогда не произойдет (но мы ведь не знаем какая), часть - просто уплыла из зоны видимости и укусит еще на за мягкое место в будущем. Однако ящитаю этот док - must read любому МЛщику имеющему отношение к агентам.
#ai_safety #owasp #agents #llm #threat_model
Post #440
246