TGViewer
Лаборатория Лиса Лаборатория Лиса @foxfoxcsharp · 79 subscribers
Post #355 29
report-heavy.html4.7 MB
Я тут накатил еще моделей, самая большая которая мне понравилась по уму и качеству и по скорости, это gpt-oss-20b, это экспертная модель, MoE. Она на первый взгляд далеко не дура и на 3060 спокойно обрабатывается очень даже комфортно.

Я наверное уже задушил вас всех своими метриками. Похоже это очень мало кому интересно.

Но я тут сейчас тестирую нагрузку этой модели на одной карте 3060 и опубликую html файлик, представляющий собой отчет из k6

Кому будет интересно, там отчет нагрузка НА ОДНУ видеокарту 3060 с симуляцией в 600 одновременных пользователей. (Понарастающая нагрузка)

В отчете ошибка, модель GTP-OSS-20B, а не qwen 3.5 0.8b

Ну и да, она захлебнулась =)
  • ❤ 1
More from @foxfoxcsharp
  1. Oct 7, 2026Вот более щедящий режим, тут хотя бы уже видно на каком моменте уже моделька начинает... Я…
  2. Oct 7, 2026Последние результаты ГЕНЕРАЦИЯ, ток/с модель 2k 8k 16k 32k 64k 128k ----------------------…
  3. Oct 6, 2026Ну в общем === qwen3.8:27b === загрузка: 116.0 с, 52% на GPU запуск 1: генерация 3.4 ток/с…
  4. Oct 6, 2026Продолжаю эксперементировать с гнейронками, накатил относительно свежие модельки (До этого…
  5. Oct 6, 2026Может быть мне человек это сказал для успокоения, но тем не менее, он высказал свое мнение…
  6. Oct 5, 2026Ранее я недооценивал потенциал малых языковых моделей, полагая, что в умелых руках они спо…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →