TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3620 223
‏🚀 معرفی مدل Nemotron-3 برای تشخیص گوینده

‏ان‌ویدیا مدل جدید Nemotron-3 Diarization را منتشر کرد؛ مدلی با ۱۰۰ میلیون پارامتر که در تشخیص «چه کسی، چه زمانی صحبت کرده» تخصص دارد. این مدل حتی زمانی که صداها با هم تداخل دارند، می‌تواند تا ۸ گوینده را به‌صورت هم‌زمان و بلادرنگ ردیابی کند. برای مطالعه جزئیات بیشتر، نسخه کامل مطلب در سایت را ببینید.

‏مهم‌ترین ویژگی‌های این مدل عبارتند از:
‏- دقت بالا: ثبت نرخ خطای ۱۴.۷۲٪ در بنچمارک Diarization-Bench.
‏- سرعت بی‌نظیر: پشتیبانی از پردازش جریان صوتی با زمان پاسخ بسیار پایین (تا ۰.۳۲ ثانیه).
‏- مجوز آزاد: عرضه تحت لایسنس OpenMDW-1.1 با امکان استفاده تجاری.
‏- بهینه‌سازی: اجرای بهینه روی پردازنده‌های گرافیکی NVIDIA در بستر NeMo.

‏شما می‌توانید برای بررسی عملکرد مدل، از دموی آنلاین آن استفاده کنید یا جزئیات فنی بیشتر را در وبلاگ رسمی NVIDIA مطالعه کنید.

🇮🇷 - هوش مصنوعی و علم داده به فارسی
🌐 سایت | تلگرام | بله | ایتا | ارتباط با ما


#Nemotron_3_Diarization #Diarization_Bench
  • ❤ 2
More from @dataplusscience
  1. Sep 30, 2026‏📊 جزئیات مالی و ریسک‌های امنیتی آنتروپیک در مسیر IPO ‏شرکت Anthropic در آستانه ع…
  2. Sep 30, 2026‏🤖 دستیار هوش مصنوعی متن‌باز OpenMuse با قابلیت میزبانی شخصی ‏پروژه متن‌باز OpenM…
  3. Sep 30, 2026‏📊 صدرنشینی مدل‌های Claude در شاخص هوش مصنوعی ‏در جدیدترین به‌روزرسانی شاخص Artif…
  4. Sep 30, 2026‏🤖 عرضه مدل GPT-6.1 Sol ‏مدل GPT-6.1 Sol تنها ۷ روز پس از عرضه نسخه قبلی، جایگزین…
  5. Sep 30, 2026‏📊 تغییر مرز کارایی مدل‌های هوش مصنوعی ‏داده‌های Artificial Analysis نشان می‌دهد…
  6. Sep 29, 2026‏🎙️ انتشار ابزار متن‌باز شبیه‌ساز صدا و دوبله ‏یک توسعه‌دهنده پروژه‌ای به نام Voi…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →