Сравнение LLM для моделирования угроз
Всем привет!
По ссылке можно найти результаты сравнения возможностей LLM по моделированию угроз.
В выборку попали: gemma, Phi, DeepSeek, llama и не только.
Сравнение проводилось по группам критериев:
🍭 STRIDE Coverage & Accuracy: насколько модель покрывает все группы угроз в соответствии с методологией STRIDE
🍭Threat Completeness: показывает количество угроз, качество описания
🍭Technical Validity: насколько описание является технически корректным и релевантным
🍭JSON Structure Compliance: проверка корректности заполнения и формата данных в итоговых результатах
Все результаты представлены в виде интерактивных графиков – общие результаты, результаты по приведенным выше группам и т.д.
Больше подробностей про саму методологию можно найти в соответствующем разделе сайта.
P.S. Кстати, это сравнением сделал Matt Adams – Автор STRIDE GPT, о которой мы писали тут.
Post #1178
4.39K