TGViewer
Нейронавт | Нейросети в творчестве Нейронавт | Нейросети в творчестве @greenneuralrobots · 13K subscribers
Post #14724 799
Confucius4

Пара моделей обработки речи для реального времени: потоковая ASR и синхронный перевод китайский-английский

R2T2 - стриминговая #ASR:
• вывод только в режиме append - уже выданный текст не переписывается никогда
• точность близка к оффлайн-распознаванию
• чанки от 80 мс до 2 секунд под нужный компромисс
• 2B на базе Qwen3-ASR, лицензия NetEase

T3PO - китайско-английский синхронный перевод:
• сам решает, когда ждать, а когда переводить
• не правит выданное - подходит для немедленной обработки
• 14B, Apache 2.0
• пара к R2T2 для речи

Для субтитров в реальном времени, живых капшенов и агентных пайплайнов, где текст обрабатывается по мере появления

huggingface.co/netease-youdao/Confucius4-R2T2
github.com/netease-youdao/Confucius4-R2T2
huggingface.co/spaces/netease-youdao/confucius4-r2t2-demo
huggingface.co/netease-youdao/Confucius4-T3PO

#realtime

MAX
  • 👍 1
More from @greenneuralrobots
  1. Sep 24, 2026Samsone от Samsung Labs Три небольших аудиоязыковых модели для смартфонов: Samsone-99M, 13…
  2. Sep 24, 2026Hy Translation Мобильное приложение от Tencent с оффлайн-переводом на Hy-MT2 • 33 языка •…
  3. Sep 24, 2026Держите всяких весов huggingface.co/prism-ml/Ternary-Bonsai-2-27B-gguf - Bonsai 2 27B с те…
  4. Sep 24, 2026Ovis-Embedding Универсальные эмбеддинг-модели для всего сразу: текст, изображения, докумен…
  5. Sep 24, 2026Comfy Router Один API для моделей - картинки, видео, 3D и аудио. Интегрируешься один раз,…
  6. Sep 24, 2026Gemini 3.8 TTS Две модели синтеза речи. Flash TTS - для творческой режиссуры и дизайна пер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →