پردازش صوت با speechbrain
اگه دنبال یه ابزاری میگردید که بتونید باهاش راحت کارهای پردازش صوتی بکنید، باید برید سراغ speechbrain. این ابزار کارهای بازشناسی گفتار، بازشناسی گوینده، بهبود صوت، پردازشهای میانی مانند استخراج فیچر و پردازش همزمان چندین میکروفون رو انجا میده. نکته اینه که مدلهایی که استفاده شده کاملا بهروز و در برخی کاربردها حتی state of the art هستند و در برخی دیگه هم عملکرد کاملا رقابتی دارند. از ویژگیهای مهم دیگه این ابزار اینه که مدلهای استفاده شده در این ابزار بر روی هاگینگفیس موجودند. شاید تنها ضعف این ابزار اینه که مدلها کاملا پایتورچی هستند و خبری از تنسورفلو نیست اما با توجه به سادگی کاربرد و همچنین وجود مدلها بر روی هاگینگفیس نباید اصلا نگران استفاده ازش باشید. از دیگر ویژگیهای مثبتش هم اینه که کاملا با GPU دوسته و اگه لازم دارید تا اون رو بر روی دیتاست خودتون آموزش بدید و از GPU استفاده کنید، قطعا مشکلی نخواهید داشت. پیشنهاد میکنیم بر و بچههای صوتی حتما یه نگاهی به این ابزار بهروز بندازند.
لینک گیتهاب:
https://github.com/speechbrain/speechbrain
لینک صفحه رسمی در هاگینگفیس :
https://huggingface.co/speechbrain
#tool
@nlp_stuff
Post #184
1.79K