OpenBMB показали новый результат для MiniCPM5-1B и снова продвигают свою идею Densing Law: маленькие on-device модели постепенно догоняют то, что ещё недавно требовало огромных LLM.
Хронология выглядит так:
- февраль 2024: MiniCPM-2B добирается до уровня GPT-3
- сентябрь 2024: MiniCPM3-4B уже сравнивают с уровнем ChatGPT
- май 2026: MiniCPM5-1B получает AA 17.9 и обходит GPT-4o с 14.1 в этом тесте
Главный акцент - размер.
MiniCPM5-1B примерно в 200 раз меньше по числу параметров, но уже показывает результаты, которые ещё пару лет назад казались невозможными для локальных моделей.
Cами авторы честно признают, что на многих задачах 1B-модель всё ещё не сильнее GPT-4o. Это не «убийца больших моделей», а скорее сигнал направления.
Если Densing Law продолжит работать, следующий большой сдвиг может быть не в ещё более гигантских моделях, а в сильных локальных AI, которые запускаются прямо на телефоне, ноутбуке или edge-устройстве.
https://huggingface.openbmb.com/model/openbmb/MiniCPM5-1B
Post #1856
1.43K

- 👍 3
- ❤ 2