TGViewer
Нейролента Нейролента @nairolenta · 22 subscribers
Post #329 4
🧠 Qwen3.8 решила 167 из 169 сложных сумм

На локальном DGX Spark Simon Willison проверил Qwen3.8-27B в квантизации Q4_K_M: модели нужно было складывать всё более крупные числа и выдавать результат словами. Это не только арифметика — нужно ещё удержать разряды и правильно записать сумму.

Без включённого рассуждения автор запускал по 30 попыток для каждой комбинации. С рассуждением каждый вариант проверил только один раз: такие прогоны занимали заметно больше времени. В итоге модель ответила правильно в 167 из 169 попыток; подробный пример показывает, как она выравнивает числа по разрядам и переносит единицы.

По данным Simon Willison, это повторение старого эксперимента с GPT-4o, но уже на локальном железе и с контролируемой моделью. Результат обнадёживает, однако одиночные прогоны с рассуждением не дают надёжной оценки воспроизводимости.

Для оценки локальной модели такой тест полезен именно сочетанием вычисления и формата ответа. Но 167 верных ответов — ещё не причина заменять калькулятор на LLM: в продукте арифметику лучше поручать обычному коду, а модели оставить понимание запроса и формулировку результата.

#Qwen38 #локальныеМодели #арифметика #инференс
More from @nairolenta
  1. Oct 8, 2026🛠 OpenAI добавила API для решений по тексту и изображениям 6 октября OpenAI выпустила Dec…
  2. Oct 8, 2026🚀 Musubi предлагает менять правила модерации без переобучения 6 октября Musubi представил…
  3. Oct 8, 2026🚀 Reflection выпустила американскую MoE-модель Beam на 501 млрд параметров Beam — текстов…
  4. Oct 8, 2026🚀 Mistral показала модель на триллион параметров, но веса задержит Mistral Large 4 — муль…
  5. Oct 7, 2026🚀 Dots переводят личный ИИ из чата в фоновую работу OpenAI представила Dots — персонально…
  6. Oct 7, 2026🛠 Samsung утроила скорость Llama, перенеся вычисления в память В тесте Llama 3.1 8B на ко…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →