TGViewer
ПЕНТХАУС • Since 2016 ПЕНТХАУС • Since 2016 @penthaus · 6.04K subscribers
Post #7071 1.47K

Forwarded from – Гордеев, что с AI?

10 вещей, который вам надо знать, если хотите запускать нейросети локально.

Это мой новый формат. Я просто пишу то, что знаю, часто дописывая пост в течение суток, так что заходите еще завтра, он расширится. Поехали!

– Нет ни одной реальной причины запускать что-то локально, если только вы не супер-агентов. Серьезно! Это дорого, медленно и через год уже вообще отстанет
– Весь инференс, а именно так называются вычисления ИИ, субчидироруемая инвесторами игра. Он в реальности стоит в разы дороже, просто все игроки хотят захватить ваше внимание
– Не получится, потому что модели вышли на определенное плато, в котором они уже практически не различимы в слепом тестировании
– Поэтому пользуйтесь этой уникальной возможностью, тем более если у вас подписка. Если обычный инференс по API примерно в 5 раз дешевле локального, то объем в подписке еще раз в 5 дешевле, чем в API
– По самым поверхностным оценкам максимальный потолок на цену запущенной локально модели – 1/1000 стоимость оборудование
– Другими словами если у вас печка за $10,000, то максимум цены за 1 миллион оутпута – это $10
– В реальности цифры еще хуже
– Другими словами вам придется 3-10 лет качегарить машинку, чтобы окупить её стоимость
– Ну вот вам новость: через год цена этого же инференса упадет в раз в 5
– Тем более обидно, если вы покупаете что-то настольное, типа Mac Studio или даже с картами Nvidia, не говоря уже о серверах
– Вы ведь даже не сможете совсем этим барахлом через год пойти в кафе, чтобы привлечь внимание зумерш?
– Поэтому наиболее оптимальная история, если уж очень хочется поиграться с локальными нейросетями, это покупать MacBooks с процессорами Max и объемом памяти 128 ГБ
– Любые процессоры ниже категории M1 Max — это очень медленные нейросети. Идеально иметь процессоры Ultra но они были в версии M3 на MacBookах, а сейчас только уже на настольных печах
– Удивительно но только Apple все эти годы занимался тем, что делал максимальный инференс в минимальном форм-факторе. Почти все игроки, в том числе AMD, NVIDIA и так далее, имеют куда более слабые характеристики для домашнего применения. Ваши нейросети будут просто в 2-5 раз хуже, чем на технике Apple
– И если ты читаешь эти строки в начале сентября 2026 года, то наиболее оптимальной локальной моделью для запуска будет Qwen 3.8 27B, потому что:
1. Он запускается почти на любой машинке с 32 ГБ оперативной памяти.
2. Его цена outputа $2 за 1 миллион токенов
– Другими словами это чуть ли не единственный игрок (Alibaba), кто реально что-то качественное делает
– Вы получаете экономию в $2 за миллион output на ноутбуке, который может стоить $1,000-$2,000
– Сама моделька всеядная и по бенчмаркам работает не хуже GPT-5.6 Луна в режиме thinking

Завтра допишу...

pass.io/index ответит на все ваши вопросы
pass.io Pass Index · The State of AI Every AI model, tool and agent that is sold, who sells it and what it costs — 1687 things from 1865 companies, read fresh every day.
  • 💩 15
  • 👍 5
More from @penthaus
  1. Oct 3, 2026Elon says we're living in a simulation. Fine — let's run one. Join TonCraft:
  2. Sep 24, 2026Сколько биткоина стоит? — Цена Bitcoin (Биткоин) в реальном времени сегодня составляет ₽70…
  3. Sep 23, 2026Интуиция Викторина: вопрос открывается по букве, 10 вариантов, 5 звёзд, до последнего игро…
  4. Sep 23, 2026Gem-Pong Pong with a random opponent. Swipe to move, miss 3 times and you are out.
  5. Sep 23, 2026ПЕНТХАУС • Since 2016 pinned «цена токена Minter BIP — 1 BIP стоит 0.01272 RUB. (https://c…
  6. Sep 23, 2026почему блокчейн Minter считается большим прорывом в мире технологий? — У меня нет информац…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →