TGViewer
NoteCasts NoteCasts @navidcasts · 159 subscribers
Post #24 141
Audio
👉 @navidcasts 🎓


این مقاله روش جدیدی به نام پیش‌بینی ترتیب توکن (TOP) را معرفی می‌کند که هدف آن بهبود آموزش مدل‌های زبانی بزرگ (LLM) است. برخلاف روش‌های سنتی که فقط توکن بعدی را پیش‌بینی می‌کنند (NTP) یا روش‌های کمکی مانند پیش‌بینی چند-توکن (MTP) که توکن‌های آینده را به طور دقیق پیش‌بینی می‌کنند، TOP مدل را برای رتبه‌بندی توکن‌های آینده بر اساس نزدیکی‌شان آموزش می‌دهد.

👉 @navidcasts 🎓

نویسندگان استدلال می‌کنند که پیش‌بینی دقیق توکن‌های آینده در MTP بسیار دشوار است و منجر به بهبودهای نامنظم می‌شود، اما TOP با یک لایه اضافی ساده و با استفاده از «زیان یادگیری برای رتبه‌بندی» (learning-to-rank loss)، عملکرد کلی مدل‌های زبانی را در معیارهای استاندارد NLP بهبود می‌بخشد و با افزایش مقیاس مدل نیز عملکرد بهتری دارد.

لینک مقاله : https://www.alphaxiv.org/pdf/2508.19228
More from @navidcasts
  1. Sep 23, 2026https://youtu.be/mPr2iboMI5A?si=Ac5iAx4lstOBPfoz
  2. Sep 21, 2026هشدار امنیتی مشترک نهادهای اطلاعاتی بریتانیا، آمریکا و هلند نشان می‌دهد که عاملان سایبری و…
  3. Sep 18, 2026این منبع یک مقاله پژوهشی تخصصی است که روشی نوآورانه برای شناسایی دقیق پارامترهای مودال ساز…
  4. Sep 7, 2026این مقاله، با شروعی بر مبنای ماجرای پرحاشیه کیتی جنوویس، به تحلیل چرایی عدم مداخله افراد د…
  5. Sep 6, 2026این مقاله استدلال می‌کند که دموکراسی لیبرال در معرض خطر جدی است زیرا حامیان آن در بازگو کر…
  6. Jul 6, 2026این وویس به معرفی و تبیین مهندسی عامل (Agent Engineering) می‌پردازد و آن را به عنوان یک نظ…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →