یک مدل جدید و قدرتمند از Shanghai AI Lab که تمرکز ویژهای روی Agentic AI، اجرای وظایف چندمرحلهای، استفاده از ابزار و برنامهنویسی دارد.
در بنچمارکهای Agentic عملکرد بسیار خوبی نشان داده:
AutomationBench: 53.8 — بالاتر از مدلهایی مثل GPT-5.6، Claude Opus 5 و Qwen 3.8
CyberGym: 86.5
MLE-Bench: 86.2
پ . ن : عملکردش در حد glm 5.3 هستش که بنظرم مدل فوق العاده ای هستش
پ . ن : زیاد به عدد 100 میلیون اکتفا نکنید چون مصرف توکن بالایی داره .
api.atria-asi.ai
🇮🇷 | @Sezar_Sec - @sezarsec_cm
