TGViewer
immers.cloud | Облако с GPU immers.cloud | Облако с GPU @immers_cloud · 944 subscribers
Post #412 1.19K
Развертывание Marco o1: языковая модель для логики и математики на вашем PC 💡🖥

Недавно я тестировал Marco o1 — опенсорсную LLM с продвинутыми алгоритмами рассуждений: Chain-of-Thoughts и поиском по дереву Монте-Карло (MCTS). Это позволяет модели решать задачи по логике, математике и программированию эффективнее.

Что интересного:
• Вес модели — всего 7B параметров, можно запустить даже на RTX 4060.
• Поддержка квантизации (bitsandbytes) ускоряет инференс на локальном PC.
• Готовые решения для LLM-сервера на TGI и ollama.


🚀 Запуск в Docker с Text Generation Inference
docker run --gpus all --shm-size 1g -p 8080:80 -v $path_to_volume:/data \
ghcr.io/huggingface/text-generation-inference:2.4.1 --model-id AIDC-AI/Marco-o1 --quantize bitsandbytes-nf4


🔥 Если нужен сервер попроще — попробуйте ollama
ollama pull marco-o1  
ollama serve


⚡️ Почему immers.cloud?
Если вашей машине не хватает мощности, запускайте Marco o1 в облаке immers.cloud на GPU-серверах. Это удобно и быстро!
  • ⚡ 2
  • ❤ 2
  • 👍 2
  • 🏆 2
More from @immers_cloud
  1. Oct 9, 2026Трамп советуется с Grok, а кто управляет вашим ИИ? 📰 По сообщению TIME, Трамп спрашивал G…
  2. Oct 8, 20265 ИИ-моделей для одной RTX 4090 Подобрали модели для создания ИИ-помощников, программирова…
  3. Oct 6, 2026Qwen3.8-Flash-Next: гибридное внимание для ИИ-агентов 👋 Qwen3.8-Flash-Next — эксперимента…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →