TGViewer
NLP stuff NLP stuff @nlp_stuff · 3.86K subscribers
Post #48 1.01K
مقاله‌ی برنده‌ی ACL2020

این مقاله امسال جایزه‌ی بهترین مقاله‌ی کنفرانس ACL2020 را برنده شد. حتما بخونیدش. لینک پایین هم ویدیوی توضیحات یکی از نویسندهاشه!

حرف حساب این مقاله اینه که به جای این که برای ارزیابی مدل‌ها بیایم از روش «آموزش روی دیتای آموزشی و گرفتن یک عدد آماری روی دیتای تست» استفاده کنیم، واسه هر تسکی جنبه‌های مختلفی را بررسی کنیم.
مثلا تسک sentiment را در نظر بگیرید. یک جنبه برای این تسک اینه که با اضافه کردن یک جمله مثبت در پایان جمله ورودی نباید میزان مثبت بودن جمله کاهش پیدا کنه.
یا مثلا اگر کلمه خنثایی در متن ورودی با کلمه خنثای دیگه‌ای جایگزین شد نباید لیبل متن (مثبت، منفی یا خنثی) تغییر کنه.
یا مثلا برای تسک NER یک جنبه می‌تونه این باشه که عوض کردن اسم کشور نباید نتیجه را تغییر بده.

در پایان: برای مقاله شاخ دادن لازم نیست حتما منابع سخت‌افزاری شاخ و مدل گنده‌ای داشت و هنوز هم ایده‌ها می‌تونند‌ موفق باشند.

https://www.aclweb.org/anthology/2020.acl-main.442.pdf

https://slideslive.com/38929272/beyond-accuracy-behavioral-testing-of-nlp-models-with-checklist

#read
#paper

@nlp_stuff
More from @nlp_stuff
  1. Jan 6, 2026اندر حکایات بازی با کلمات: AI Engineering vs ML Engineering/Data Scientist این روزها عناوی…
  2. Mar 3, 2025مفهوم Agent چیست و چگونه کار می‌کنند؟ خانم چیپ هوین بلاگ پست مفصلی راجع به Agent (به قول ر…
  3. Feb 28, 2025خلاصه‌تر فکر کن از اونجایی که در مسائل استدلالی (reasoning) ، مدل برای رسیدن به جواب نهایی…
  4. Feb 23, 2025چه قدر تا بی‌کارشدن بک‌اندی‌ها فاصله داریم؟ عمده استفاده برنامه‌نویس‌ها از LLM‌ها در سطح پ…
  5. Feb 20, 2025به سوی سیستم‌۲ پیشرفت‌های هوش مصنوعی در دهه ۲۰۱۰، مدیون آموزش مدل‌های بزرگ دیپ لرنینگی روی…
  6. Feb 8, 2025مدل‌های استدلالی (reasoning) چیست و چگونه ساخته می‌شوند؟ حتما این روزها بارها مدل‌های استد…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →