مدلهای هوش مصنوعی در یک بنچمارک سلامت روان، از پزشکان متخصص امتیاز بالاتری گرفتن‼️
- اپن OpenAI نتایج یک بنچمارک جدید در حوزه سلامت روان منتشر کرده که توی اون، چند مدل پیشرفته هوش مصنوعی تونستن امتیاز بالاتری از پاسخهای نوشته شده توسط متخصصان سلامت روان کسب کنن.
🤖 مدل GPT-6 Astra: ۵۷.۳
💠 مدلClaude Opus 5.5: ۵۲.۴
👨⚕️ پاسخ متخصصان: ۳۸.۵
- البته جالبه که متخصصان بالینی در واقع جریمههای کمتری دریافت کردن. طبق توضیح OpenAI، دلیل پایینتر بودن امتیازشون تا حد زیادی این بوده که مثل زمانی که واقعا با یک مراجعهکننده روبهرو هستن، خیلی کوتاه جواب میدادن؛ گاهی حتی فقط با یک سؤال یا یک جمله.😁
- در مقابل، مدلهای AI پاسخهای مفصلتر و کاملتری تولید کردهاند و همین باعث شده در این بنچمارک امتیاز بالاتری بگیرند.
➕@Sharifgpt
➕@Sharifgpt
Post #2890
6.22K

- 👍 26
- ❤ 7
- 🤯 7
- 🌚 1