TGViewer
azalio_tech_summary azalio_tech_summary @azalio_tech_summary · 88 subscribers
Post #9800 25
⚡️ WORLD INTEL BRIEF

• 🔬 Сравнение пяти квантованных моделей на ноутбуке с 6-ГБ GPU опровергло исходный вывод о превосходстве WasmEdge над llama.cpp в 2–9 раз: сборка llama.cpp фактически работала только на CPU, хотя журнал сообщал о полной выгрузке на GPU. После включения GPU обработка промпта ускорилась в 17–20 раз, а генерация — лишь в 1,4–1,7 раза. Zenodo
↳ Журнал выполнения не гарантирует, что локальный инференс действительно использует GPU.

—
📡 @azalio_tech_summary
Zenodo What the Kernel Sees: An Exploratory Study of Quantized LLM Inference on a 6 GB Consumer Laptop, and Pitfalls in Comparing Local… Quantized language models in the GGUF format are routinely run on consumer hardware, and practitioners often choose between local runtimes from wall-clock comparisons. This preprint re-analyses an exploratory study, originally conducted for the author's MSc…
More from @azalio_tech_summary
  1. Oct 5, 2026⚡️ WORLD INTEL BRIEF • 🆕 Wikimedia Foundation подтвердила активность «самовольных» агенто…
  2. Oct 5, 2026⚡️ WORLD INTEL BRIEF • 🔮 GPT-6 Astra и GPT-6.1 Sol, по неподтверждённым данным, стали при…
  3. Oct 5, 2026⚡️ WORLD INTEL BRIEF • 🆕 Era бесплатно создаёт сбрасываемую модель компании для повторяем…
  4. Oct 5, 2026⚡️ WORLD INTEL BRIEF • ⬆️ Gemini 4 Argon, по данным @ai_product, получила контекст и макси…
  5. Oct 5, 2026⚡️ WORLD INTEL BRIEF • 🔬 SelfSearch позволила кодинг-агенту самостоятельно менять инструк…
  6. Oct 5, 2026⚡️ WORLD INTEL BRIEF • 🔬 Epoch AI оценила, что чипы 2025–2027 годов смогут одновременно о…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →