TGViewer
very vibe coding very vibe coding @veryvibecoding · 122 subscribers
Post #744 37

Forwarded from Machine learning Interview

⚡️ Большинство быстрых text-to-speech моделей звучат роботизировано.

Большинство качественных - слишком медленные.
И почти ни одна не решает вопрос аутентичности аудио на уровне архитектуры.

Resemble AI закрыли все три проблемы сразу.

Chatterbox Turbo 0 это:

🟢 <150 мс до первого звука
🟢 Качество уровня SOTA - превосходит более крупные проприетарные модели
🟢 Естественные, программируемые эмоции и интонации
🟢 Zero-shot клонирование голоса всего по 5 секундам аудио
🟢 PerTh watermarking - проверяемое и аутентифицированное аудио
🟢 Полностью open source, никакой «чёрной магии»

Редкий пример, когда скорость, качество и безопасность не идут на компромисс, а работают вместе.

HuggingFace: https://huggingface.co/spaces/ResembleAI/chatterbox-turbo-demo
More from @veryvibecoding
  1. Oct 6, 2026Есть все-таки польза от Grok Bot - поставил на нем агента, который контролирует расход под…
  2. Oct 6, 2026Мне кажется, я догадался, что может произойти. Надо просто уменьшить размер токена в полто…
  3. Oct 6, 2026Первое улучшение - скорость. Оно и правда требовалось, работают моделька очень долго. Но п…
  4. Oct 5, 2026Кажется, что нащупал оптимальный режим работы с кодексом - это модель Sol 6.1 medium. Если…
  5. Oct 5, 2026Очень интересные и показательные цифры. Мало, чтобы агентами пользовались, надо чтобы за н…
  6. Oct 5, 2026Тибо пообещал, что следующие 28 дней каждый день либо OpenAI выпускает какое-то значимое у…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →