🛡 Разрыв переноса safety-бенчмарков на малые ЯМ
Safety-бенчмарки для больших языковых моделей стали стандартом оценки надёжности ИИ. Но при переносе на малые языковые модели (SLM) исследователи фиксируют рост неоднозначных ответов и разброс оценок: тесты, работающие для LLM, плохо различают реальные риски у компактных систем. Использовать эти бенчмарки как единственный критерий безопасности SLM — значит опираться на шаткую метрику. Либо индустрия разработает отдельные протоколы оценки для малых моделей, либо продолжит переносить LLM-бенчмарки и получать оценки безопасности, которым нельзя доверять.
Полный разбор → https://icaig.net/ru/trend/concept-slm-safety-benchmark-gap
#ИКИИГУ #безопасность
Post #162
9
