TGViewer
НЕЙРОН Live НЕЙРОН Live @techpnew · 1.06K subscribers
Post #110 193
DeepSeek выпускает V4.1‑Flash, утверждает, что он превосходит флагман V4‑Pro

Китайский стартап DeepSeek выпустил модель DeepSeek‑V4.1‑Flash — меньшую по активным ресурсам модель новой архитектуры, которую компания заявляет более производительной, чем её более крупный V4‑Pro. Это MoE‑модель с 552 миллиардами параметров, но с каузальным энкодер‑декодером, который оставляет в работе лишь 8 млрд параметров при обработке подсказки и 16 млрд при генерации; ключ‑значение кеш уменьшен до ~890 байт на токен, примерно четверть от предыдущей версии. DeepSeek перенаправит запросы к V4‑Pro на V4.1‑Flash с 14 сентября и выставит оплату по тарифам меньшей модели, выложил веса на Hugging Face под MIT‑лицензией и публикует бенчмарки, где V4.1‑Flash чуть опережает Opus 5 и GPT‑5.6 Sol по ряду тестов.

Для разработчиков это означает заметное снижение затрат и ускорение отклика: офф‑пиковые тарифы указаны как $0.15 за миллион некешированных входных токенов и $0.60 за миллион выходных, а при перенаправлении пиковая стоимо
  • ❤ 1
More from @techpnew
  1. Oct 2, 2026🌍 Суд отклонил иски Chegg и Penske против Google по делу об ИИ‑поиске и потере трафика 📰…
  2. Oct 2, 2026🌍 Нью‑Мексико требует с Meta до $40 млрд за нарушения приватности данных 📍 Нью‑Мексико ·…
  3. Oct 1, 2026🏗 Стартап Кевина Мандии Armadin привлёк $255,5 млн на «рой» ИИ‑агентов для поиска дыр в з…
  4. Oct 1, 2026🌍 Microsoft: киберпреступники используют ИИ быстрее защитников 📰 Опубликовано: 1 окт 202…
  5. Oct 1, 2026🤖 Albertsons вводит ChatGPT, чтобы ускорить работу магазинов и упростить покупки 📰 Опубл…
  6. Oct 1, 2026🗣 Microsoft хочет, чтобы Copilot стал «операционной системой» для рабочего дня 📰 Опублик…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →