OpenAI и Anthropic вылетели из топа. Российские модели заняли все 6 первых мест
Речь о бенчмарке SLAVA, который оценивает не код, а «мировоззренческий суверенитет». Лидер — Alice AI LLM от Яндекса, следом идут версии YandexGPT 5.1 и Gigachat 2 Max.
Еще в конце 2024-го в лидерах были американские модели, но ситуация изменилась. Тест включает 14 000 вопросов по истории, обществознанию и нацбезопасности.
Почему это важно для инженеров:
Технически западные модели могут быть мощнее в логике, но этот кейс показывает разрыв в контексте. Если вы проектируете RAG-системы для EdTech, юриспруденции или госсектора в РФ, использование GPT-5 или Claude может стать архитектурной ошибкой из-за «культурных галлюцинаций». Локализация модели — это теперь не только язык, но и сеттинг данных.
Важен ли «культурный код» модели для ваших задач?
🔥 — Да, контекст решает всё
🤬 — Нет, мне нужен только чистый код и логика
👀 — Использую локальные модели только из-за регуляторики
#AI #LLM #GenAI #productmanagement
ИСТОЧНИКИ:
Ведомости — Российские ИИ-модели заняли весь топ-6 в бенчмарке SLAVA
Институт общественных наук (ИОН) Президентской академии — Отчет по бенчмарку SLAVA
Post #186
77

- 🙏 7
- 💊 5
- 🤩 1