TGViewer
[38/100] Витя Тарнавский [38/100] Витя Тарнавский @singularityfm · 9.78K subscribers
Post #296 7.58K
🥳 Выкладываем T-One: открытая потоковая ASR модель для телефонии

Распознать хорошее аудио в оффлайне сегодня – не проблема. Берём какой-нибудь whisper и полетели.

А вот на плохих телефонных каналах всё довольно сложно. 8 килогерц, пшш-пшш, эхо и прочие беды. Для нас это задача типичная, и у нас получается её хорошо решать. Мы решили поделиться наработками.

Модель называется T-One, и это потоковая модель для телефонии. Она супер компактная, быстрая, и адаптирована для телефонных каналов.

→ Потоковая модель
→ 70M параметров, это в 50 раз меньше whisper-large-v3
→ В 2-3 раза (!) лучше WER чем у whisper-large-v3 на телефонных каналах (бенчи)
→ 300 ms чанк данных, можно строить realtime системы
→ Apache 2.0

Читайте крутой развернутый тех репорт на хабре
Качать как обычно на нашем Hugging Face
  • 🔥 106
  • ❤ 23
  • 🤔 3
  • 🤡 3
  • 🥱 2
More from @singularityfm
  1. Sep 7, 2026Лондон очень интересно исследовать. А понять где в нём жить – не так просто. Я собрал для…
  2. Aug 27, 2026Сижу в Лондоне, думаю, что дальше делать, и испытываю тревогу. Я – человек из цифровых тех…
  3. Aug 20, 2026Всё, я в Лондоне 🇬🇧 С собой всего два чемодана. Плана нет, работы нет 🌟 Работы нет впол…
  4. Aug 5, 2026С туберкулёзом это отдельный прикол. Оказывается, для получения рабочей визы в UK нужно сд…
  5. Aug 4, 2026Давайте расскажу мои приключения по UK Global Talent Visa и почему я до сих пор её не полу…
  6. Aug 3, 2026У меня есть классный приятель Саша Журавлёв. Саша – топ. Мы давно держим связь, а волею су…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →