TGViewer
Анализ данных (Data analysis) Анализ данных (Data analysis) @data_analysis_ml · 51.3K subscribers
Post #4885 5.53K
🚀 Tencent выкатывает Covo-Audio (7B) - новый уровень голосовых AI.

Это уже не просто “распознал → ответил → озвучил”.

Модель умеет говорить и слушать одновременно.

Что внутри:

• Qwen2.5-7B + Whisper
• 8 млн часов аудио обучения
• full-duplex — диалог без пауз

Главное отличие:

Нет отдельных пайплайнов ASR и TTS.
→ всё работает как единая модель

Что это даёт:
• можно перебивать (barge-in)
• естественный разговор, как с человеком
• меньше задержек
• меньше костылей в архитектуре

Отдельно:

Разделение интеллекта и голоса
→ проще делать voice cloning
→ гибкость под разные сценарии

Тренд очевиден:

AI переходит от “голосовых интерфейсов”
→ к полноценному живому диалогу

Скоро кнопка “нажми и говори” исчезнет совсем.

Модель: https://huggingface.co/tencent/Covo-Audio-Chat
  • 👍 12
  • ❤ 8
  • 🔥 4
More from @data_analysis_ml
  1. Oct 9, 2026✔️ Qwen выложили Turbo-версию своей картиночной модели: 2K-изображение и редактирование те…
  2. Oct 9, 2026🔎 Perplexity открыла компактную модель для поиска по текстам и изображениям pplx-embed-v2…
  3. Oct 8, 2026🌌 Claude помог собрать первую полную UV-карту неба Астрофизик Брайс Менар из Johns Hopkin…
  4. Oct 8, 2026🧮 Математика для ИИ на русском: от школьной базы до трансформеров и диффузии Бесплатный к…
  5. Oct 8, 2026🤖 ИИ-агентам убрали «начальника», и сложные задачи стали решаться быстрее. Исследователи…
  6. Oct 7, 2026🏦 ИИ-агенты могут лишить банки США преимущества стоимостью $500 млрд Механизм простой: аг…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →