TGViewer
Channel Public Channel
Tensorflow(@CVision)

Tensorflow(@CVision)

@cvision

اخبار حوزه یادگیری عمیق و هوش مصنوعی
مقالات و یافته های جدید یادگیری عمیق
بینایی ماشین و پردازش تصویر

TensorFlow, Keras, Deep Learning, Computer Vision

سایت:
http://class.vision

👨‍💻👩‍💻پشتیبان دوره ها:
@classvision_support

لینک گروه:
@tf2keras
Subscribers
15.1K
Photos
1.3K
Videos
318
Links
2.6K

Showing posts older than #3980 · Back to latest

Older Posts 19 shown
Post #3979 4.69K
مایکروسافت روش جدیدی به نام KBLaM برای اضافه کردن دانش به مدل‌ های زبانی پیشنهاد داده که نسبت به روش های پیشین بهینه تره.

توی روش‌های سنتی مثل Fine-tuning، مدلها نیاز به آموزش مجدد با داده‌ های جدید دارن. این فرآیند بسیار زمان‌ بر، پرهزینه و نیازمند منابع محاسباتی زیادی هست. KBLaM دانش رو بدون نیاز به آموزش مجدد در مدل ادغام می‌کنه، که این امر باعث صرفه‌ جویی قابل توجهی در زمان و هزینه میشه.

در روش‌های دیگه مثل Retrieval-Augmented Generation (RAG)، مدل برای پاسخ دادن به سوالات، ابتدا باید اطلاعات مرتبط رو از یه منبع خارجی بازیابی و بعد از اون اطلاعات برای تولید پاسخ استفاده کنه. این فرآیند بازیابی جداگانه می‌تونه زمانبر باشه. KBLaM با ادغام دانش در لایه‌ های attention مدل، عمل بازیابی را به صورت ضمنی و یکپارچه انجام میده و نیازی به مراحل جداگانه بازیابی نداره.

از طرفی مدل‌های زبانی که فقط بر دانش داخلی خود تکیه میکنن، ممکنه اطلاعات نادرست یا بی‌ اساس تولید کنن (اصطلاحاً توهم بزنن)، اما KBLaM با فراهم کردن دسترسی مستقیم به دانش ساختار یافته و معتبر، احتمال تولید پاسخ‌های نادرست رو کاهش میده و قابلیت اطمینان مدل رو به صورت چشمگیری افزایش میده.

توی این روش اگه اطلاعات جدیدی به پایگاه دانش اضافه شه یا اطلاعات قبلی تغییر کنن، می‌شه به راحتی دانش مدل رو با بروزرسانی حافظه خارجی KBLaM آپدیت کرد. این کار بسیار ساده‌ تر و سریع‌ تر از آموزش مجدد کل مدله!

https://www.microsoft.com/en-us/research/blog/introducing-kblam-bringing-plug-and-play-external-knowledge-to-llms/
Microsoft Research A more efficient path to add knowledge to LLMs Introducing KBLaM, an approach that encodes and stores structured knowledge within an LLM itself. By integrating knowledge without retraining, it offers a scalable alternative to traditional methods.
  • 👍 26
  • ❤ 2
Post #3978 4.53K
Tensorflow(@CVision) برای استفاده از این تخفیف، کافیست در هنگام ثبت‌نام کد nowruz404 را وارد نمایید. https://class.vision nowruz404
کد تخفیف 40 درصدی تا 15 فروردین اعتبار دارد.


https://class.vision

nowruz404
  • 👍 2
Post #3976 8.37K
این وسط گوگل هم
Gemini 2.5 Pro

رو معرفی می‌کنه که در بین مدل های استدلالی بالاترین امتیاز رو توی بنچ مارک های مختلف میگیره

البته یه مدل مخصوص تولید تصاویر هم منتشر کرده که کیفیت تولید تصاویرش در حد اوپن ای آی هست با این تفاوت که دیگه محدودیت تولید تصاویر ندارید.

عکس بالا رو توسط همون پرامپی که اوپن ای آی قرار داده تولید کردم

https://blog.google/technology/google-deepmind/gemini-model-thinking-updates-march-2025/#gemini-2-5-thinking
  • 🔥 18
  • 👍 8
Post #3975 6.67K
تصور اینکه این عکس توسط هوش مصنوعی تولید شده باشه بسیار سخته.

مدل نه تنها عکس رو با جزییات کامل تولید کرده بلکه متن نوشته شده روی وایت بورد دقیقا متن وارد شده در پرامپ هست!

اوپن ای آی پیشرفته‌ ترین مدل تولید تصویر خودش رو در GPT-4o ادغام کرد. نتیجه این کار، تولید تصاویریه که نه‌ تنها زیبان، بلکه بسیار کاربردین.

https://openai.com/index/introducing-4o-image-generation/
  • 👍 33
  • 🤯 18
  • ❤ 2
  • 👏 2
Post #3974 3.92K
Tensorflow(@CVision) تیم Deepseek عنوان کرده که تغییرات جزیی ایجاد کرده اما بسیاری از قابلیت های این مدل به صورت گسترده از جمله کدنویسی بهبود پیدا کرده Claude sonnet 3.7 vs Deepseek v3-0324 لیست تغییرات: https://api-docs.deepseek.com/updates
پرامپت:

یک فایل HTML واحد ایجاد کن که شامل CSS و JavaScript برای تولید یک کارت آب و هوای متحرک باشه. این کارت باید شرایط آب و هوایی زیر را با انیمیشن‌های مجزا با توجه به دمای کنونی چهار شهر تهران، تبریز، اصفهان و شیراز رو نشون بده
همه کارت‌های آب و هوا را در کنار هم نمایش بده. با توجه به توصیفات هر کدام از شهرها که در پایین مینویسیم پس زمینه هر کدام از کارت ها رو به صورت انمیشن متحرک از شهرها طراحی کن بصورتی که با فرهنگ اون شهر هماهنگ باشه:

تهران: پایتخت و بزرگترین شهر ایران، واقع در شمال کشور. تهران یک مرکز فرهنگی، اقتصادی و سیاسی مهمه و دارای جاذبه‌های تاریخی و مدرن فراوانی مانند کاخ گلستان، برج میلاد و بازار بزرگ تهران هست. این شهر در دامنه‌های جنوبی رشته کوه البرز قرار گرفته و آب و هوای متنوعی داره.

اصفهان: شهری تاریخی در مرکز ایران که به دلیل معماری زیبای اسلامی، پل‌های تاریخی و میدان نقش جهان شهرت جهانی داره. اصفهان در دوران صفویه پایتخت ایران بوده و آثار باستانی متعددی از آن دوران به جا مانده، این شهر به عنوان "نصف جهان" نیز شناخته میشه.

شیراز: شهری باستانی در جنوب ایران که به دلیل باغ‌های زیبا، مساجد تاریخی و آرامگاه شاعران نامدار ایرانی مانند حافظ و سعدی شهرت داره. شیراز در گذشته پایتخت ایران بوده و دارای فرهنگ و هنر غنیه. این شهر به "شهر شعر و ادب" نیز معروفه.

تبریز: شهری تاریخی در شمال غربی ایران که به دلیل بازار بزرگ تبریز، یکی از قدیمی‌ترین و بزرگ‌ترین بازارهای سرپوشیده جهان، شهرت دارد. تبریز در طول تاریخ نقش مهمی در تجارت و فرهنگ ایران ایفا کرده و دارای جاذبه‌های تاریخی و طبیعی متنوعی هست.
  • ❤ 16
Post #3973 3.91K
تیم Deepseek عنوان کرده که تغییرات جزیی ایجاد کرده اما بسیاری از قابلیت های این مدل به صورت گسترده از جمله کدنویسی بهبود پیدا کرده

Claude sonnet 3.7 vs Deepseek v3-0324

لیست تغییرات:

https://api-docs.deepseek.com/updates
  • 👍 7
  • 🔥 5
Post #3971 4.9K
Tensorflow(@CVision) ضمن قبولی طاعات و عبادات، به مناسبت فرا رسیدن نوروز، کلاس‌ویژن برای همراهان گرامی تخفیف ویژه‌ای در نظر گرفته است. شما می‌توانید با استفاده از کد تخفیف nowruz404 از ۴۰٪ تخفیف بر روی تمامی دوره‌های آموزشی ما بهره‌مند شوید. این فرصت استثنایی را از دست ندهید…
علاوه بر تخفیفات ۴۰ درصدی روی سایت کلاس ویژن
با کلیک بر روی این لینک و کپی کردن کد تخفیف زیر از 50 درصد تخفیف دوره opencv در مکتب خونه استفاده کنید:

COUPON-95179
مکتب‌خونه آموزش پردازش تصویر و بینایی ماشین با OpenCV دوره آموزش پردازش تصویر و بینایی ماشین با opencv برای ایجاد یک پایه قوی در بینایی کامپیوتر طراحی شده است. در این دوره شما درک کاملی از تقریبا تمام ابزارهای OpenCV برای پردازش تصویر، بینایی کامپیوتری، پردازش ویدئو و اصول اولیه هوش مصنوعی خواهید داشت.
  • 🎉 7
  • 👍 1
Post #3969 4.75K
Tensorflow(@CVision) خروجی
Audio
تبلیغ آلودگی تهران
  • 🔥 11
  • 👀 4
  • 🤯 3
  • ❤ 1
  • ❤‍🔥 1
  • 👍 1
  • 😱 1
  • 👌 1
Post #3968 4.55K
Tensorflow(@CVision) اوپن ای آی مدل جدیدی برای تبدیل متن به گفتار ایجاد کرده که قابلیت های تولید گفتار فارسیش قابل توجه. https://www.openai.fm/
Audio
خروجی
  • 🔥 19
  • 🤯 5
  • 👀 2
Post #3966 6.85K
اوپن ای آی مدل جدیدی برای تبدیل متن به گفتار ایجاد کرده که قابلیت های تولید گفتار فارسیش قابل توجه.


https://www.openai.fm/
  • 🔥 17
  • ❤ 1
Post #3965 4.35K
SpatialLM 

مدل جدیدی هست که داده‌های تصویری رو تجزیه و تحلیل می‌کنه و برداشت‌های واضحی از صحنه‌های سه‌ بعدی ارائه می‌ده.

 این برداشت‌ ها شامل اجزای معماری مثل دیوار، در و پنجره و .... هست که توسط boundery box دسته بندی میشن.

 برخلاف روش‌های قدیمی که نیاز به تجهیزات ویژه داشتند، این مدل می‌تونه داده‌ها رو از منابع مختلفی مثل ویدیوهایی معمولی دریافت کنه.

این مدل داده‌های بدون ساختار رو به نمایش‌های قابل فهم تبدیل می‌کنه و درک بهتری از صحنه بوجود میاره، این موضوع در رباتیک، خودروی خودران و تحلیل صحنه‌های پیچیده بسیار کاربرد داره.

کل مدل کمتر از یک و نیم میلیارد پارامتر داره!

https://github.com/manycore-research/SpatialLM
  • 👍 16
  • 👌 4
Post #3963 3.96K
Audio
نوروز، نه فقط نو شدن طبیعت، که فرصتی برای بازآفرینی "خود" هست. همونطور که محمد نوری میخونه، "جان جهان در گذر است"، پس بیاییم در این گذر، نو شیم. نوروزتان پیروز
🌺🌺

آهنگ رو توسط مدل های زبانی تولید کردم امیدوارم خوب در اومده باشه
  • ❤ 16
  • 👍 2
  • 👏 2
Post #3962 6.45K
ضمن قبولی طاعات و عبادات، به مناسبت فرا رسیدن نوروز، کلاس‌ویژن برای همراهان گرامی تخفیف ویژه‌ای در نظر گرفته است. شما می‌توانید با استفاده از کد تخفیف nowruz404 از ۴۰٪ تخفیف بر روی تمامی دوره‌های آموزشی ما بهره‌مند شوید.

این فرصت استثنایی را از دست ندهید و مهارت‌های خود را در سال جدید ارتقا دهید.

برای استفاده از این تخفیف، کافیست در هنگام ثبت‌نام کد nowruz404 را وارد نمایید.

https://class.vision

nowruz404

سال نو مبارک!
  • ❤ 24
Post #3961 3.95K
شرکت LG هم وارد گود ساخت مدل های زبانی شده!

مرکز تحقیقات LG سری مدل‌های استدلال EXAONE با اندازه‌های 2.4 میلیارد، 7.8 میلیارد و 32 میلیارد پارامتر، برای وظایف استدلالی از جمله ریاضی و کدنویسی ارایه کرد.

نتایج مقاله نشون میده که این مدل ها توانایی‌ های برتر در وظایف استدلالی مختلف، از جمله بنچ مارک های ریاضی و کدنویسی، از 2.4 میلیارد تا 32 میلیارد پارامتر دارن!

 مدل2.4 میلیارد پارامتری، از سایر مدل‌های با اندازه مشابه عملکرد بهتری داره

مدل 7.8 میلیارد پارامتری، نه تنها از مدل‌های متن‌ باز با مقیاس مشابه، بلکه از مدل استدلالی اختصاصی OpenAI با نام o1-mini نیز عملکرد بهتری داره!

مدل 32 میلیارد پارامتری، عملکرد رقابتی در برابر مدل‌های متن‌ باز پیشرو داره

https://arxiv.org/abs/2503.12524

https://huggingface.co/collections/LGAI-EXAONE/exaone-deep-67d119918816ec6efa79a4aa

https://github.com/LG-AI-EXAONE/EXAONE-Deep
  • 👍 14
  • ❤‍🔥 2
  • 👀 2
  • 🤔 1
Post #3959 5.01K
به طور کلی، در حوزه مدل‌ های زبانی، دو رویکرد اصلی وجود داره: مدل‌های Autoregressive و مدل‌های Diffusion

مدل‌های Autoregressive متون رو بصورت کلمه به کلمه تولید میکنن، مثل مدل های رایج زبانی کنونی، این روش باعث میشه متن‌های روان و مرتبطی تولید شه، اما سرعت تولید اونها پایینه. در مقابل، مدل‌های Diffusion، ابتدا یک متن پر از نویز تولید میکنن و سپس با حذف تدریجی نویز، به یک متن قابل فهم میرسن. این روش امکان تولید موازی کلمات رو فراهم میکنه، اما در تولید متن‌های طولانی و دقیق و همچنین تخمین احتمال متن، ضعف دارن.

برای رفع این مشکلات، این مقاله مدل Block Diffusion معرفی کرده که مزایای هر دو رویکرد قبلی رو با هم ترکیب میکنه. این مدل مانند مدل‌ های Diffusion، ابتدا متن پر از نویز رو تولید میکنه، اما اون رو به بخش‌ های کوچک ‌تر (بلوک‌ها) تقسیم میکنه و سپس نویز هر بخش رو به صورت جداگانه حذف میکنه. این کار باعث میشه هم سرعت تولید متن بالا بره و هم دقت اون افزایش پیدا کنه. در واقع، مدل‌ Block Diffusion ، هم در کنار افزایش سرعت تولید متن کیفیت متن تولیدی رو افزایش داده


https://arxiv.org/abs/2503.09573
  • 👍 24
  • ❤ 6
Older posts →
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →