Не все новые модели LLM одинаково полезны 🤖
Последнее время я работаю с двумя семействами — Qwen3.x-27b и Ornith1.x-35b. Они отлично справляются и с агентными задачами, и с разработкой. Но новые модели выходят постоянно, и у меня накопился беклог для тестирования.
Сегодня попробовал Kimi-linear-48b и Nex2.5-mini — и они показали себя плохо.
🧪 Задача №1 — простая: обновить конфига llama-swap
Добавить новые модели, почистить удалённые, где в названии есть MTP — прописать.
С Kimi-linear всё понятно: моделям уже год, а это вечность в мире LLM. При редактировании она привела настройки всех моделей к одному виду, удалила всё, что касается MTP, и не смогла восстановить. Лишь после этого Qwen3.x-27b перечитала данные из сессии и вернула нужные настройки.
📄 Задача №2 — взять PDF, переименовать и перенести в папку
Ornith с этим справляется без проблем. Nex2.5-mini же долго думал, как прочитать название книги и какое имя использовать — запустил для этого субагента, и я устал ждать.
💡 Вывод: берите проверенные модели. Не все новинки оправдывают ожидания — несмотря на высокие результаты в тестах.
Post #26
10
- 👍 2
- ❤ 1