ИБМ-2 (начало тут)
Их z-мэйнфреймы у нас юзаются в ЦБ, РЖД, СФР, Газпроме, а также в немалом числе других серьёзных контор.
Стратегия IBM кардинально отличается от подхода OpenAI или Google: они не стремятся создавать гигантские "фронтенд-модели" для чатов, их фокус -- компактные специализированные корпоративные нейронки. IBM делает ставку на то, что 90% корпоративных задач могут и должны решаться подобными моделями.
Флагманская модель: Granite 4.1 (выпущена 29 апреля)
Открытые нейронки с от 3 до 30 миллиардов параметров специально обучены идеально выполнять бизнес-задачи: строго следовать инструкциям, tool calling и работа с объёмными документами (контекст до 512 тыс. токенов). Все под лицензией Apache 2.0, что означает абсолютную свободу для бизнеса.
И даже 8B модель на равных конкурирует с Gemma и Qwen в корпоративных бенчмарках.
Запуск этих моделей в бизнес-сценариях на 98% дешевле, чем GPT-4 Turbo и на 75% дешевле, чем Llama 70B.
Рекомендую.
Granite Vision 4.1 4B превосходит Claude Opus 4.6 в распознавании таблиц и графиков.
Granite Speech 4.1 достигает рекордно низкой ошибки (5.33% WER) и поддерживает перевод с качеством выше GPT-4o.
Granite Guardian 4.1 - автоматические проверки, не галлюцинирует ли модель и не нарушает ли политики.
ИБМ отказались от хайповой темки создания очередного ChatGPT-киллера, потому что для них это просто далеко не самый интересный рынок (так-то он пока сильно убыточный :). Вместо этого они создают то, что серьёзным компаниям нужно здесь и сейчас (и, главное, скучным образом приносит хорошее баблишко) - предсказуемые, дешёвые и надёжные модели, которые можно запустить на обычном сервере и интегрировать в свои процессы, не опасаясь эпических счетов за API :)
Post #2394
787
- ✍ 30
- 🔥 7
- 🤔 7
- ❤ 6
- 👍 2