TGViewer
مقاله | کنفرانس | همایش | سمینار مقاله | کنفرانس | همایش | سمینار @confpaper · 1.59K subscribers
Post #1339 111
🔹 امتیاز بریر؛ چگونه دقت احتمال‌های پیش‌بینی‌شده را با یک شاخص واحد بسنجیم؟

وقتی یک مدل برای هر فرد «احتمال» تولید می‌کند، فقط درست یا غلط بودن طبقه‌بندی کافی نیست.

باید بررسی کنیم احتمال‌های تولیدشده تا چه اندازه به واقعیت نزدیک‌اند.

یکی از شاخص‌های مهم برای این هدف «امتیاز بریر» است.

══════════════

🧠 امتیاز بریر چه چیزی را اندازه می‌گیرد؟

امتیاز بریر فاصله بین احتمال پیش‌بینی‌شده و نتیجه واقعی را محاسبه می‌کند.

اگر پیامد رخ دهد، مقدار واقعی برابر ۱ در نظر گرفته می‌شود.

اگر رخ ندهد، مقدار واقعی برابر ۰ است.

سپس فاصله بین احتمال پیش‌بینی‌شده و این مقدار واقعی محاسبه و به توان دو رسانده می‌شود.

در پایان، میانگین این خطاها به دست می‌آید.

══════════════

📌 مثال ساده

فرض کنید مدل برای سه دانشجو احتمال ترک تحصیل را چنین پیش‌بینی کرده است:

دانشجوی اول: ۰٫۹۰ و واقعاً ترک تحصیل کرده است.

دانشجوی دوم: ۰٫۷۰ اما ترک تحصیل نکرده است.

دانشجوی سوم: ۰٫۲۰ و ترک تحصیل نکرده است.

پیش‌بینی اول بسیار خوب است.

پیش‌بینی سوم نیز نسبتاً مناسب است.

اما پیش‌بینی دوم خطای زیادی دارد، چون مدل احتمال نسبتاً بالایی داده اما پیامد رخ نداده است.

امتیاز بریر تمام این فاصله‌ها را در یک شاخص خلاصه می‌کند.

══════════════

📌 مقدار کمتر بهتر است یا بیشتر؟

در امتیاز بریر، مقدار کمتر نشان‌دهنده عملکرد بهتر است.

اگر همه پیش‌بینی‌ها دقیق باشند، امتیاز به صفر نزدیک می‌شود.

در یک پیامد دودویی، مقدار این شاخص معمولاً بین صفر و یک قرار می‌گیرد.

اما تفسیر عدد به تنهایی کافی نیست.

باید آن را با شیوع پیامد، مدل مرجع یا مدل‌های رقیب مقایسه کرد.

══════════════

✍️ چرا این شاخص از دقت طبقه‌بندی اطلاعات بیشتری می‌دهد؟

فرض کنید دو مدل هر دو یک دانشجو را «در معرض خطر» طبقه‌بندی کرده‌اند.

مدل اول احتمال ۰٫۵۱ داده است.

مدل دوم احتمال ۰٫۹۵ داده است.

اگر دانشجو واقعاً در معرض خطر باشد، هر دو از نظر طبقه‌بندی درست‌اند.

اما مدل دوم اعتماد بسیار بیشتری به پیش‌بینی خود داشته است.

امتیاز بریر این تفاوت در کیفیت احتمال‌ها را در نظر می‌گیرد، در حالی که دقت ساده معمولاً آن را نادیده می‌گیرد.

══════════════

📌 ارتباط امتیاز بریر با کالیبراسیون

امتیاز بریر تا حدی تحت تأثیر دو ویژگی مهم است:

توان مدل در جدا کردن افراد پرخطر از کم‌خطر

و میزان تطابق احتمال‌های پیش‌بینی‌شده با وقوع واقعی پیامد.

بنابراین یک مدل ممکن است AUC مناسبی داشته باشد، اما اگر احتمال‌های آن بیش از حد مطمئن یا بدکالیبره باشند، امتیاز بریر ضعیف‌تری داشته باشد.

══════════════

⚠️ خطای رایج: مقایسه امتیاز بریر در دو مسئله کاملاً متفاوت

اگر شیوع پیامد در دو جامعه متفاوت باشد، مقایسه مستقیم امتیاز بریر ممکن است گمراه‌کننده باشد.

مثلاً پیش‌بینی یک پیامد بسیار نادر با پیش‌بینی یک پیامد شایع شرایط یکسانی ندارد.

بهتر است مدل با یک پیش‌بینی مرجع مناسب در همان داده مقایسه شود.

══════════════

🎯 چه زمانی امتیاز بریر مفید است؟

زمانی که خروجی مدل یک احتمال است و خود مقدار احتمال برای تصمیم‌گیری اهمیت دارد.

مثلاً در:

پیش‌بینی افت تحصیلی،

احتمال ترک تحصیل،

احتمال موفقیت یک مداخله،

یا هر مسئله دودویی که تصمیم بر اساس میزان خطر انجام می‌شود.

در این شرایط، امتیاز بریر مکمل خوبی برای AUC و نمودار کالیبراسیون است.

══════════════

✅ جمع‌بندی

امتیاز بریر فقط نمی‌پرسد:

«مدل درست طبقه‌بندی کرد یا نه؟»

بلکه می‌پرسد:

«احتمالی که مدل اعلام کرد، چقدر به نتیجه واقعی نزدیک بود؟»

مقدار کمتر معمولاً بهتر است، اما تفسیر باید در مقایسه با مدل مرجع و شیوع پیامد انجام شود.

برای ارزیابی مدل‌های احتمالی، بهتر است همزمان به:

قدرت تفکیک،

کالیبراسیون،

و خطای احتمال‌های پیش‌بینی‌شده

توجه کنیم.

📚 @confpaper
More from @confpaper
  1. Sep 27, 2026🔹 نقض فرض مخاطرات متناسب؛ وقتی اثر یک متغیر در طول زمان ثابت نمی‌ماند در مدل استاندارد کا…
  2. Sep 27, 2026🔹 مدل کاکس؛ چگونه اثر چند متغیر را بر زمان وقوع یک رویداد هم‌زمان بررسی کنیم؟ منحنی کاپلا…
  3. Sep 27, 2026🔹 آزمون لگ‌رنک؛ وقتی دو منحنی بقا متفاوت به نظر می‌رسند، چگونه تفاوت را آزمون کنیم؟ در نم…
  4. Sep 27, 2026🔹 منحنی کاپلان مایر؛ چگونه احتمال بقا را در طول زمان مقایسه کنیم؟ در مطالعات زمان تا روید…
  5. Sep 26, 2026🔹 سانسور در تحلیل بقا؛ چرا «ندیدن رویداد» به معنای «رخ ندادن رویداد» نیست؟ در مطالعات زما…
  6. Sep 26, 2026🔹 نسبت مخاطره با نسبت خطر چه تفاوتی دارد؟ چرا Hazard Ratio را نباید «احتمال وقوع پیامد» ت…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →