TGViewer
هوش مصنوعی اسمارت نکست هوش مصنوعی اسمارت نکست @smartech_ir · 3.59K subscribers
Post #2411 547
‏Meta مدل SAM Audio رو منتشر کرد

یه مدل open-source که ایده‌ی معروف Segment Anything رو آورده تو دنیای صدا. یعنی همون کاری که SAM با تصویر می‌کرد، حالا برای صدا انجام می‌ده.

پیش از این audio separation وجود داشت، ولی بیشتر مدل‌ها خیلی محدود بودن؛ یا فقط speech رو جدا می‌کردن، یا فقط آهنگ هارو و معمولاً هم فقط یه راه کنترل داشتن.
اما SAM Audio اجازه می‌ده از یه فایل صدا یا حتی ویدیو هر صدایی رو که بخوای جدا کنی؛ با text prompt، با یه visual click روی تصویر، یا با مشخص کردن یه time span که خیلی چیز خفنیه
فنی

مدل SAM Audio از یه flow-matching Diffusion Transformer استفاده می‌کنه. یه مدل generative که کم‌کم از روی noise، صدای تمیز رو بازسازی می‌کنه. بعد هم صدا رو compress می‌کنه بدون اینکه کیفیت از بین بره.
نحوه استفاده

کد open-source رو با Python 3.10+ نصب کن
و model checkpointها رو از Hugging Face بگیر
برای performance واقعی، inference رو روی CUDA GPU اجرا کن
حتما سایتشو چک کنید

🔴Instagram
🔵Telegram
  • 👍 1
More from @smartech_ir
  1. Feb 23, 2026♥️‏ ابزارهای هوش‌مصنوعی گوگل رو بشناسید و ازشون استفاده کنید. 💰عموما Gemini رو میشناس…
  2. Feb 10, 2026🔥 هر چیزی به کمک هوش مصنوعی میتونه دست نویس بشه! ☘ یکی از قابلیت‌های باحال و عجیب نانو بن…
  3. Feb 10, 2026♨️ جعبه‌ابزار جادویی 2026 | هر چیزی که از هوش مصنوعی لازم داری، یک‌جا! ▪️سال 2026 بدون هوش…
  4. Feb 9, 2026⭐️گوگل یه راهنمای ۷۱ صفحه ای رایگان برای آموزش پرامپت نویسی ارائه داده https://services.go…
  5. Feb 8, 2026ساخت کامیک بوک با نوشتن پرامپت https://github.com/Nutlope/make-comics #comic #prompt #Midj…
  6. Feb 1, 2026📚🤖 هوش مصنوعی تصحیح تکالیف را در مدارس چین به‌دست گرفت! مدارس چین به‌سرعت در حال سپردن ت…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →