ElevenLabs провели КОНТРНАСТУП і випустили очманіти яку круту модель v4 😮
Тут повністю нова архітектура, завдяки якій моделька діє як справжній актор: спочатку читає ваш текст, уявляє собі контекст і лише після цього генерує аудіо. Також модель краще тримає стиль на довгих текстах, якщо ви робите аудіокниги.
По бенчмаркам майже у всьому топ-1, до того ж удвічі швидше за v3. А тепер про мінуси: 80$ за лям символів. Це дешевше, ніж v3, але Gemini 3.8 Flash TTS коштує усього 16$ 😢
ооо збори живуть дуже дякую (залишилося 30 964.79)
Post #7693
7.52K
Ооо нейромережеве🐱 Сьогодні по ElevenLabs нанесли координовану атаку з трьох позицій, я зараз вам покажу, я мапу приніс: 🪙 Google випустили Gemini 3.8 Flash TTS — голос можна пропистати промтом, підтримує понад 100 мов. Можна генерувати повноцінні діалоги, охи, вздохи та й…
- ❤ 49
- 🤯 23
- 👍 11
- 🔥 6
- ⚡ 2
- 👏 2
- 😁 1
- 🥴 1