TGViewer
Channel Public Channel
immers.cloud | Облако с GPU

immers.cloud | Облако с GPU

@immers_cloud

immers.cloud — облачный GPU-сервис с широким выбором видеокарт для ML, генеративных моделей, 3D и рендеринга.

Самый большой ассортимент GPU Tesla и RTX 💻

👉 Наш сайт https://immers.cloud/
🎧 @immerscloudsupport

Чат по ИИ - https://t.me/immersAI
Subscribers
943
Photos
1.3K
Videos
9
Links
318

Showing posts older than #1243 · Back to latest

Older Posts 5 shown
Post #1235 640
Gemma 4 12B: мультимодальность на одной RTX 3090

👋 Gemma 4 12B — модель среднего класса в новой линейке Gemma 4: мощнее компактной E4B, но доступнее старшей 26B A4B MoE.

Что важно:
▪️ Полностью бесэнкодерная архитектура
Gemma 4 12B не использует отдельные визуальные и аудиоэнкодеры. Изображения и аудиоволны напрямую переводятся в токены через линейные проекции и обрабатываются единым decoder-only трансформером. Это упрощает работу с мультимодальностью и делает модель удобнее для инференса и дообучения.

▪️ Мультимодальность в одной модели
Модель работает с текстом, изображениями, видео и аудио, поддерживает длинный контекст до 256K токенов, function calling, режим мышления и Multi-Token Prediction для ускорения инференса.

▪️ Доступность для self-hosting
Gemma 4 12B можно запускать в 4-bit и 8-bit форматах на одной RTX 3090 или 4090. Это делает модель интересной для локальных ассистентов, анализа документов, голосового ввода, видеофрагментов и агентных сценариев.

📲 Подробнее — в слайдах.

➡️ В immers.cloud можно быстро проверить, подходит ли Gemma 4 12B под ваш сценарий: запустить модель, протестировать её на реальных данных и оценить требования к GPU без долгой подготовки окружения.
  • 🔥 3
  • 🎉 2
  • ❤ 1
  • 👍 1
Post #1233 579
👍 Проголосуйте за тему, которая комфортнее именно вам ⤵️
Post #1227 607
Число π рассчитали до 314 трлн знаков после запятой

🧮 Новый мировой рекорд поставили не на GPU-кластере, а на одном сервере с CPU и 40 NVMe SSD.

📌 На первый взгляд кажется, что для таких вычислений нужны видеокарты. Но в этой задаче узким местом стали не математические операции, а память, накопители и стабильная работа с огромными объёмами данных.

⚙️ Это хороший пример того, почему инфраструктуру нельзя выбирать по принципу «чем больше GPU, тем лучше». Для одних задач важнее CPU и быстрые NVMe, для других — GPU и массово-параллельные вычисления.

📲 В слайдах разбираем, почему рекорд по π стал именно инфраструктурной задачей — и как понять, какая конфигурация нужна под конкретную нагрузку.

☁️ В immers.cloud можно подбирать инфраструктуру под сценарий: CPU-серверы — для вычислительных и сервисных задач, GPU-инстансы — для ИИ, инференса, обучения моделей и рендеринга.
  • 👏 5
  • 😱 3
  • ❤ 1
  • 👍 1
  • 🔥 1
Post #1219 589
Qwen3.6-35B-A3B: зачем нужна MoE-версия

👋 Qwen3.6-35B-A3B — модель семейства Qwen3.6, которая близка к Qwen3.6-27B по назначению, но отличается архитектурным подходом.

Что важно:
▪️ MoE-архитектура
Модель использует 256 экспертов, из которых для каждого токена выбираются 8. Это позволяет сочетать качество крупной модели с более низкой вычислительной нагрузкой при инференсе.

▪️ Отличие от Qwen3.6-27B
По бенчмаркам Qwen3.6-35B-A3B уступает Qwen3.6-27B, но за счёт MoE и меньшей нагрузки на KV-cache может быть быстрее и экономичнее в ряде сценариев инференса, особенно при длинных многошаговых задачах.

📲 Подробнее — в слайдах.

➡️ Развернуть Qwen3.6-35B-A3B можно в immers.cloud и проверить модель на реальных задачах с оплатой за GPU-ресурсы, а не за отдельные токены.
  • ❤ 4
  • 🔥 4
  • 👍 2
  • ⚡ 1
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →