بالاخره صدای زبان فارسی هم شنیده شد!😳
مدل Whisper رو خیلیها میشناسن؛ یکی از قویترین مدلها برای تبدیل صدا به متنه.
اما یه مشکلی که داشت این بود که وقتی نوبت زبان فارسی میشد، دقتش پایین میومد و خیلی از کلمات رو درست نمتونست بنویسه.
اما حالا یه نسخه جدید به اسم Whisper-large-fa-v1 منتشر کرده که میتونه زبان فارسی رو به متن تبدیل کنه.
یه فرقی که این نسخه داره اینکه این نسخه روی یه دیتاست تازه به اسم Persian-Voice-v1 دوباره آموزش داده شده. دیتاستی که لهجههای مختلف فارسی و اصطلاحات خاص فارسی رو شامل میشه.
نتیجه چیشده؟
تشخیص و رونویسی گفتار فارسی خیلی دقیقتر شده.
این یعنی توی کاربردهایی مثل:
✅زیرنویسگذاری خودکار
✅ساخت دستیارهای صوتی
✅ابزارهای NLP فارسی
و مهم از همه اینکه این همهچی متنباز منتشر شده؛ یعنی هر پژوهشگر یا تیمی میتونه راحت استفاده کنه، تغییر بده و پروژههای جدید بسازه.
لینک مدل: https://huggingface.co/vhdm/whisper-large-fa-v1
لینک دیتاست: https://huggingface.co/datasets/vhdm/persian-voice-v1
منبع: https://www.linkedin.com/feed/update/urn:li:activity:7364194597717073925/
Post #4192
8.74K

- ❤ 59
- 👌 11
- 👍 6