TGViewer
STARTOBUS STARTOBUS @startobus · 2.42K subscribers
Post #6461 372

Forwarded from LLM под капотом

Как запустить рандомную модель на своем железе?

Можно повторить то, что сделал Dan Woods, когда ему захотелось самому запустить Qwen3.5-397B на своем M3 Max 48GB (tweet).

Он взял Claude Code, ткнул пальцем в autoresearch репу от Andrej Karpathy, скормил статью Apple "LLM in a Flash" и сказал, что хочет себе так же.

Спустя 5 часов, система запустилась и выдала 1 tok/sec. Еще спустя 3 часа оптимизаций - 4.74 tok/sec и использует 5.9GB RAM. Причем, там еще далеко не все оптимизации реализованы.

Как нынче говорят - стоит испытать огромную благодарность к людям, которые раньше реализовывали подобные оптимизации вручную.

Ваш, @llm_under_hood 🤗
More from @startobus
  1. Oct 7, 2026У consumer AI еще полно незанятых ниш A16Z сравнил крупнейшие категории эпохи Web 1.0/2.0…
  2. Sep 29, 2026Google представила говорящих ИИ-персонажей Они видят, слышат собеседника и отвечают в реал…
  3. Sep 28, 2026ElevenLabs выпустили Eleven v4 и v4 Turbo: модели озвучки с точным управлением эмоциями, т…
  4. Sep 28, 2026Раньше будущее было лучше. По крайней мере, прогнозы о нём мне нравились больше. Сейчас чи…
  5. Sep 22, 2026Xiaomi выпустила MiMo V2.6 Pro и Flash с открытыми весами Pro — топ-1 в Artificial Analysi…
  6. Sep 19, 2026Тут господа из Devin.ai (ex Windsurf) сделали знатный подгон халявы страждущим любителям в…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →