TGViewer
devmark_ru devmark_ru @devmark_ru · 224 subscribers
Post #186 228
Недавно прикупил себе RTX 5080 с 16 GB на борту, запустил на ней Qwen 3 Coder на 30 миллиардов параметров с помощью LM Studio и потестировал с помощью opencode на спринговом проекте, как он будет справляться с типовыми задачами. В целом хочу сказать, что с задачами писать "по образу и подобию" такая модель справляется и даже умеет делать некоторый рефакторинг. Вначале работает шустро, затем чем больше делает правок и исправлений, тем сильнее замедляется, но продолжает работать. Через некоторое время правки вместо 5 минут занимают минут по 20. Но сами по себе правки остаются корректными. Поэтому по достижении более-менее устойчивого состояния надо сразу начинать новую сессию в кодинговом агенте.

В случае с LLM объём памяти является наиболее критичным параметром. И лучше брать побольше, хотя бы 24 гига. Но таких моделей в продаже очень мало и стоимость их возрастает в разы. Конечно для промышленной разработки такая видеокарта не подходит, но у локального решения есть другое неоспоримое преимущество: бесплатные токены и 100% доступность без ограничений. Вы платите разве что за электричество. Уже сейчас при желании можно составить некий бэклог простых заданий для такой модели и оставить её работать скажем на ночь. Утром можно провести ревью результатов и отправить их на следующую итерацию. То есть сейчас сфера применения локальных решений - это фоновые рутинные задачи, не критичные по времени.

Экстраполируя скорость развития AI-решений и рост цен на токены, я лишь убеждаюсь, что мы будем постепенно уходить от больших облачных моделей в сторону развёрнутых локально. Пусть не на локальном ПК, но как минимум в контуре организации. Особенно это актуально для России. Ведь даже бесплатные модели постоянно улучшаются и соответствуют топовым моделям (Qwen 3 Coder - это примерно GPT-4 по словам того же ChatGPT).

#devmark #ai #прогнозы #qwen #opencode
  • 🔥 6
  • 👍 4
  • 🏆 3
  • 🤔 1
More from @devmark_ru
  1. Sep 7, 2026Новый этап автоматизации SDLC от Dockhost! Спустя 3 месяца после появления LLM инференса н…
  2. Jul 16, 2026OpenIDE представила свой клиент для базы данных! На днях вышла новая версия OpenIDE Pro, в…
  3. Jun 30, 2026Channel photo updated
  4. Jun 26, 2026"Товарищ Сталин, что вы курите?" В процессе "общения" с LLM вспомнился один старый номер и…
  5. Jun 15, 2026Вышел стабильный релиз Spring AI 2.0 Чуть больше года назад появился Spring AI версии 1.0,…
  6. May 29, 2026Ваш персональный ChatGPT от Dockhost Продолжаю серию постов про альтернативные LLM, которы…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →