Red Teaming AI: безопасный и этичный ИИ по методике UNESCO
UNESCO выпустила практический Red Teaming AI Playbook, чтобы проверять модели ИИ на скрытые ошибки, предвзятость и потенциально вредное поведение до их использования в продуктах. В нем фокус на социальных, этических и гендерных рисках, а не только на технических ошибках.
Проиллюстрированы практические шаги и примеры, как организовать Red Teaming, собирать выводы и улучшать модели, показаны промпты и варианты правильных/неправильных ответов.
Пособие делает red teaming доступным широкому кругу участников: политикам, образовательным организациям, гражданскому обществу, а не только узким техническим командам.
#AIShelf
————
@pattern_ai
Post #234
76