На днях вышла Qwen3-Embedding-0.6B,
Весит 1.2 Гб
Решил сравнить её с топовой моделью для русского языка: FRIDA
Весит 3 Гб
Сравнивал на своем датасете из юридический, банковских, законодательных статьях.
Результат интересен, хоть и выборка не очень большая.
Единственное ограничение - Qwen показывает хорошие результаты только с flash_attention_2, а его не на каждую машину получится поставить
Post #47
190

- 🔥 4
- 🤔 2