⚡️ همیشه مدل جدید، بهترین انتخاب نیست!
🧠 یک آزمایش جدید روی چند مدل هوش مصنوعی نشان میدهد پاسخ مدل های جدید همیشه بهتر نیست.
📈 در این تست، از مدلها خواسته شد شبیهسازیهایی مثل تصادف، پرش، واژگونی و خروج قطار از ریل را با HTML5 تولید کنند؛ آزمونی که توانایی مدل در درک قوانین فیزیک را به چالش میکشد.
📉 در این آزمایش، اجرای GPT-5.6 Sol Ultra حدود ۳۳ سنت هزینه داشت؛ در حالی که همین تست با GPT-5.5 تنها ۱۱ سنت، با Opus 4.8 حدود ۲۴ سنت و با Grok 4.5 فقط ۸ سنت هزینه داشت.
⁉️ با اینکه GPT-5.6 حدود سه برابر گرانتر از GPT-5.5 بود، اما برتری محسوسی در کیفیت شبیهسازیهای فیزیکی نشان نداد.
✍️ مدلهای هوش مصنوعی گاهی با تولید متن و کد بیشتر، خروجی پیچیدهتری ارائه میکنند؛ اما این به معنی درک بهتر مسئله نیست.
Post #1634
1.75K
- ❤ 8
- 🔥 3
- 🙏 2
- 👍 1