TGViewer
immers.cloud | Облако с GPU immers.cloud | Облако с GPU @immers_cloud · 946 subscribers
Post #1112 634
Gemma-4-26B-A4B-it — первая open-weight MoE-модель Google в линейке Gemma

👋 В каталоге immers.cloud появилась Gemma-4-26B-A4B-it — модель, которая делает ставку не на максимальный размер, а на эффективную архитектуру. При 25,2 млрд общих параметров на каждом токене активируется только 3,8–4 млрд, поэтому она даёт сильное качество без избыточных требований к инфраструктуре.

Что здесь важно:
▪️ Первая MoE-модель Gemma: около 97% качества плотной версии 31B при заметно меньших вычислительных затратах.
▪️ Контекст до 256K токенов: подходит для больших документов и многошаговых сценариев.
▪️ Гибридное внимание: 30 слоёв и sliding window на 1024 токена для более эффективной работы с длинным контекстом.
▪️ Мультимодальность: модель работает не только с текстом, но и с изображениями.
▪️ Фокус на агентные задачи: подходит для систем, где модель должна анализировать, планировать и выполнять последовательность действий.
▪️ Высокая практическая скорость: пользователи отмечают до 162 токенов в секунду на RTX 4090.

📲 Подробнее — в слайдах.

➡️ Тестируйте Gemma-4-26B-A4B-it в каталоге immers.

#ИИ_модели
  • 🔥 5
  • ❤ 3
  • 👍 3
More from @immers_cloud
  1. Oct 1, 2026🎉 С Днем работника ЦОД! 👨‍🔧 Работать в дата-центре — это как быть за кулисами спектакля…
  2. Sep 28, 2026❓ FAQ по публичным эндпоинтам Immers Foundation Models — отвечаем на вопросы о тарифах и о…
  3. Sep 24, 2026🎉 С Днем системного аналитика! 👨‍💻 Работать системным аналитиком — это как вести детект…
  4. Sep 22, 2026📢 Глава Anthropic призвал замедлить развитие ИИ 📰 Дарио Амодеи опубликовал эссе «We Must…
  5. Sep 16, 2026Сравнительный анализ инференса модели openai/gpt-oss-20 на RTX 4090 и H100 NVL Что важно:…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →