Исследователи из MIT собрали 831 меру снижения рисков, связанных с ИИ из 13 фреймворков и разложили их по таксономии в гайде Mapping AI Risk Mitigations. Но это не вся польза от гайда, в нем подробно расписана методология создания, которую можно адаптировать для своих целей.
🔹 MIT использовали Claude 4 Sonnet, Opus и ChatGPT o3 для извлечения мер из документов, классификации по заранее заданной структуре, стандартизации описаний, проверки “edge cases”. При анализе выяснили, что некоторые важные меры почти не встречаются в документах (например, Model Alignment — <1%).
Такой же подход подойдёт, если вы строите внутреннюю базу знаний, документацию по управлению рисками или разрабатываете compliance-процессы. НО автоматизация = быстро, поэтому важна обязательная ручная проверка, т.к. LLM путаются, объединяют несколько мер в одну или "придумывают" несуществующее.
🔹У них получилось 4 категории + 23 подкласса:
- Governance (например, защита информаторов, конфликт интересов);
- Security (модельная безопасность, RLHF, watermarking);
- Operations (тестирование, staged deployment, monitoring);
- Transparency (логирование, раскрытие рисков, права пользователя).
Главный вывод, смотря на таблицу, что ИИ развивается быстрее, чем успевают адаптироваться фреймворки и таксономия, например, тестирование входит сразу в несколько направлений. Жёсткая таксономия малоэффективна.
Поэтому не бойтесь, если внутренняя классификация будет неидеальна, лучше “живой список мер” под необходимый стек, чем академическая схема.
Описания мер и примеры подойдут для составления своей базы мер, чек-листов, планов аудита и т.п.
Интерактивная версия базы и карта
🔹Собран список из 13 ключевых фреймворков (NIST AI RM, EU AI Act, FLI Index, Unified Control Framework и т.д.).
Можно использовать как справочник, чтобы определиться с необходимым фреймворком, составить свою политику управления рисками ИИ.
🔹Приведен пример короткого промпта:
I am working with the following taxonomy of AI risk controls {draft taxonomy in XML format}. For each mitigation {mitigation name and description}, assign the best-fit category with a confidence score and
justification. If no category fits, say so. List secondary categories if applicable.
Варианты адаптации:
taxonomy = структура (даже простая табличка);
mitigation = описание инцидентов, мер, требований или задач из Jira, Notion или CSV.
MIT проделали большую работу, используйте в своих процессах.
#TalkPrompty #BehindTheMachine
————
@pattern_ai