مدلهای زبانی-تصویری (VLM) پشت ابزارهایی مثل تشخیص تصویر پیشرفته، جستجوی بصری و دستیارهای چندوجهی هستن. توی این دوره یاد میگیری این مدلها از کجا شروع شدن و چطور میتونی خودت فاینتیونشون کنی.
توی دوره آموزش مدلهای زبانی-تصویری (VLM) یاد میگیری:
🔹 آشنایی با مدلهای مولتیمودال از CLIP تا SigLIP
🔹 معماری VLMها برای درک تصویر و ویدیو
🔹 روشهای Fine-tuning و کاربردهای تخصصی مدلهای مولتیمودال
🔹 روشهای پیشرفته آموزش با ترجیحات: DPO، GRPO و MPO
🔹 پیادهسازی یک پروژه نهایی واقعی با VLM
اگه میخوای وارد دنیای هوش مصنوعی چندوجهی (Multimodal AI) بشی و فراتر از مدلهای صرفاً متنی کار کنی، این دوره برات ساخته شده.
🎁 تخفیف ۷۰٪ فقط تا اول مهر (تعداد محدود)
🎟 کد تخفیف:
COUPON-57005👇 ثبتنام:
🔗 https://mktb.me/e3gx/
@llm_huggingface
