Meta* выпустила лучшие практически во всех “тяжелых” весовых категориях не Reasoning модели
Речь идет о новом поколении моделей Llama 4.
Всего представили 3 модели:
- Llama 4 Behemoth - 2T параметров (говорят. что столько было у GPT4). Модель называют “самой лучшей” для выполнения функции учителя при дистиляции знаний в модели меньшей рамерности.
- Llama 4 Maverick - 400b параметров - конкурент нашумевшей DeepSeek V3
- Llama 4 Scout - 109b параметров - замена Gemini 2.0 Flash-Light, Llama 3.3 70b и более мелких моделей с контекстным окном аж до 10 млн токенов
Судя по цифрам в бенчмарках, модели получились очень мощными, а Maverik на LMarena с ELO 1417 занимает второе место после Gemini 2.5 PRO, обгоняя GPT-4o, Grok 3, Claude 3.7 и другие модели. Бегемот все еще учится и даже не представляю, какие цифры выбьет он.
Meta вновь решили знатно пошуметь в опенсорс пространстве. Учитывая то, насколько хороша были предыдущие модели Llama, я практически уверен, что цифры бенчмарков будут не так далеко от правды.
Для кого эти модели? Прежде всего, для крупных энтерпрайзов, которым нужна приватность и которые могут позволить себе купить и гонять модель на видеокарте H100 (либо арендовать ее) 🙂 То есть далеко не для всех. Но уверен, что этот релиз знатно качнет опенсорс. Особенно китайский.
Если Behemoth действительно будет так хороша, как о ней пишут, то очень скоро ее дистилируют в условный QWEN и будет счастье не только крупным компаниям, но и бизнесам поменьше.
Интересно, чем на этот релиз ответят Google, OpenAI и Anthropic 🙂
👉 Новость с релизом тут
*Meta запрещена на территории РФ
#развитиеии
Post #213
425