Voicelab'da yangiliklar ko'p, faqat biz ozgina buni yashirib keldik, release kunigacha
Sado v2 (STT) modelimiz Gemini va boshqa STT modellardan yaxshiroq natijalar beryabdi O'zbek tili uchun. Biz buni bir nechta dataset va turli xil resource lardan audiolar olib sinab ko'rdik.
Lison v2 (TTS) modelimiz Elevenlab v4 va shu kabi modellardan qolishmaydigan natijalar berayabdi. Buni o'zimiz va kichik beta guruh bilan qo'lda sinab solishtirib tekshirib ko'rdik.
Live translation uchun yangi modellarimiz kelayabdi.
Dubbing bo'yicha ham beta qilgan edik, endi butunlayin release uchun tayyorlayabmiz.
Natijalarni tez orada bo'lishib o'tamiz. Hozircha TTS va STT natijalarini voicelab.uz da sinab ko'rsangiz bo'ladi.
Ha aytgancha, biz inference optimization uchun custom CUDA va kernel yozishni ham boshladik. Shunga bo'lsa kerak, modellarimiz juda tez ishlayabdi : )
Yangiliklarni @voicelabio da kuzatib boring
Post #709
1.08K