TGViewer
هوش مصنوعی و علم داده به فارسی هوش مصنوعی و علم داده به فارسی @dataplusscience · 6.06K subscribers
Post #3436 215
‏📊 فرمولاسیون و تبیین ریاضی معماری ترنسفورمرها

‏مقاله جدید A Mathematical Explanation of Transformers چارچوب ریاضی دقیقی برای تحلیل معماری ترنسفورمر و مدل‌های زبانی بزرگ ارائه می‌دهد. در این پژوهش، ترنسفورمر به عنوان گسسته‌سازی یک معادله دیفرانسیل-انتگرال پیوسته مدل‌سازی شده است.

‏مهم‌ترین محورهای ریاضی این مقاله عبارتند از:
‏• تحلیل مکانیزم Self-attention به عنوان یک اپراتور انتگرالی غیرمحلی
‏• تعریف Layer normalization به عنوان تصویرسازی بر یک مجموعه محدود
‏• یکپارچه‌سازی لایه‌های تمام‌متصل و توابع فعال‌ساز در ساختار ریاضی واحد

‏نویسندگان در نهایت با استفاده از روش‌های گسسته‌سازی عددی، این مدل ریاضی را به Vision Transformers و ترنسفورمرهای کانولوشنی تعمیم داده‌اند.

تبیین ریاضی ترنسفورمرها؛ فرمولاسیون معماری یادگیری عمیق با معادلات دیفرانسیل

📊 Data➕Science 🇮🇷 - هوش مصنوعی و علم داده به فارسی
📩 ارتباط با ما
More from @dataplusscience
  1. Oct 2, 2026‏🛠 عرضه ابزار متن‌باز MCP برای سرویس ترب ‏ابزار جدیدی برای تعامل با سرویس «ترب» ب…
  2. Oct 2, 2026‏🤖 معرفی مدل‌های Intern-Decision برای تصمیم‌گیری ساختاریافته ‏خانواده مدل‌های Int…
  3. Oct 2, 2026‏🤖 شکستن کد ۲۱۷ ساله ناپلئون با GPT-6 Astra ‏کارتر چرچ با استفاده از مدل GPT-6 As…
  4. Oct 2, 2026‏🧠 مدل‌های زبانی با قابلیت مدیریت مستقیم حافظه ‏محققان متا در مدل‌های جدیدی با عن…
  5. Oct 2, 2026‏📉 کاهش محدودیت‌های GPT-6 Pro و هدیه ۲۵۰۰ دلاری OpenAI به کاربران ‏شرکت OpenAI تغ…
  6. Oct 2, 2026‏🌐 شناسایی کمپین استخراج غیرمجاز از مدل‌های OpenAI ‏شرکت OpenAI در بررسی‌های اخیر…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →