TGViewer
Channel Public Channel
immers.cloud | Облако с GPU

immers.cloud | Облако с GPU

@immers_cloud

immers.cloud — облачный GPU-сервис с широким выбором видеокарт для ML, генеративных моделей, 3D и рендеринга.

Самый большой ассортимент GPU Tesla и RTX 💻

👉 Наш сайт https://immers.cloud/
🎧 @immerscloudsupport

Чат по ИИ - https://t.me/immersAI
Subscribers
944
Photos
1.3K
Videos
9
Links
318

Showing posts older than #1265 · Back to latest

Older Posts 4 shown
Post #1257 607
GLM-5.2: выходит на территорию топовых моделей

👋 GLM-5.2 — open-source MoE-модель от Z.ai для задач, где важны длинный контекст, рассуждение, кодинг и многошаговая работа с инструментами.

Что важно:
▪️ Стабильность на длинных сценариях
GLM-5.2 рассчитана на задачи, где модель должна обрабатывать большой объём входных данных и сохранять связность рассуждения на протяжении нескольких этапов. Это важно для анализа репозиториев, технической документации, исследовательских материалов и агентных пайплайнов.

▪️ Эффективнее работа с большим контекстом
За счёт IndexShare модель снижает избыточные вычисления в индексаторе внимания и делает обработку сверхдлинных последовательностей более практичной. Это особенно важно в задачах, где контекст нельзя сильно сокращать без потери качества результата.

▪️ Фокус на кодинг и работу с инструментами
GLM-5.2 ориентирована на сценарии, где модель не ограничивается генерацией ответа: она анализирует контекст, выполняет промежуточные шаги, работает с инструментами и продолжает задачу с учётом уже полученных данных.

📲 Подробнее — в слайдах.

➡️ GLM-5.2 в 4-битной квантизации можно запустить в immers.cloud на конфигурации 4 × H200 от 1 719,14 ₽/ч.
  • ⚡ 3
  • ❤ 2
  • 🔥 2
  • 👏 2
  • 👍 1
Post #1250 660
Immers Foundation Models: каталог open-source моделей для запуска на GPU-инфраструктуре immers.cloud

📁 В каталоге уже собрано 210 моделей, для которых подобрано более 600 весов. Для части моделей доступны готовые публичные эндпоинты: сейчас можно протестировать 6 моделей через чат или API без подготовки собственного окружения.

🚀 Каталог упрощает путь от выбора модели до запуска: изучить характеристики, оценить требования к ресурсам, подобрать GPU-конфигурацию.

Если хотите разобрать процесс на практике, посмотрите видеогайд «Как запустить AI-модель на собственном сервере?»:
📱 ВК

📱 YouTube

📺 Rutube

➡️ Полное руководство по запуску модели доступно в FAQ immers.cloud.

➡️ Перейти в Immers Foundation Models
  • 🔥 3
  • 👏 3
  • 😱 2
  • ❤ 1
  • 🤔 1
Post #1243 595
NVIDIA Nemotron 3 Ultra: что внутри флагманской MoE-модели

👋 NVIDIA Nemotron 3 Ultra — крупнейшая модель в линейке Nemotron 3, ориентированная на агентные системы, рассуждения, кодинг, диалог и работу с длинным контекстом.

📌 Главный интерес — в том, как NVIDIA пытается совместить ёмкость крупной модели с более эффективным инференсом.

Что важно:

▪️ Гибридная архитектура Nemotron-H + LatentMoE
В модели используются 108 слоёв трёх типов: Mamba-2, Latent MoE и Attention. Значительная часть классических attention-слоёв заменена на Mamba-2, а экспертные вычисления вынесены в LatentMoE. Это снижает стоимость внимания и размер KV-cache, что особенно важно для длинноконтекстных задач и агентных цепочек.

▪️ LatentMoE вместо классической MoE-маршрутизации
Nemotron 3 Ultra содержит 550B параметров, из которых 55B активируются на токен. При этом токены перед маршрутизацией и вычислениями в экспертах проецируются в латентное пространство меньшей размерности. Такой подход делает маршрутизацию экономичнее по сравнению с классическими MoE-моделями.

▪️ Multi-Token Prediction для ускорения генерации
В архитектуру встроена Multi-Token Prediction — механизм, при котором модель может предсказывать несколько будущих токенов одновременно. Это помогает повышать пропускную способность инференса, особенно при генерации длинных ответов.


📲 Подробнее — в слайдах.

➡️ Запустить Nemotron 3 Ultra в квантизации 4 бита можно на 4 x H200 от 1 717,59 ₽/ч.

➡️ Перейти в каталог с более чем 200 другими моделями.
  • ❤ 4
  • 🔥 2
  • ⚡ 1
  • 👍 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →