مدلهای تبدیل متن به گفتار و گفتار به متن جدید توسط OpenAI معرفی شدن که به صورت API در دسترس قرار گرفتن.
مدلهای gpt-4o-transcribe و gpt-4o-mini-transcribe با دقت ساخته شدن تا بتونن تو شرایط سخت مثل محیطهای پر سر و صدا و لهجههای مختلف عملکرد بالایی داشته باشن.
مدل gpt-4o-mini-tts هم امکان سفارشیسازی صدا و لحن صحبت کردن رو میده. این لحن هم خیلی گسترده هست، مثلا میتونید بگید یه پشتیبان تلفنی مهربان هستی.
یه پلتفرم کامل هم برای این کار معرفی کردن که میتونید از این لینک بهش دسترسی داشته باشید و این مدلهارو تست کنید. تو ویدیو هم یک نمونه ازش رو میبینید که ما تست کردیم به زبان فارسی.
Post #4581
2.63K

- 👍 4