xAI kompaniyasi dasturlash va murakkab aqliy mehnat uchun mo‘ljallangan Grok 4.7 modelini taqdim etdi.
Model yangi kattaroq arxitekturaga ega bo‘lib, bir necha soat davom etadigan og‘ir vazifalarni yechishga qaratilgan mustahkamlash o‘rganishidan (RL) o‘tgan. U 500 ming tokenlik kontekst oynasini qo‘llab-quvvatlaydi.
Dasturlash sinovlarida model yuqori natijalar qayd etdi. U uzoq davom etuvchi kodlash vazifalarini baholovchi CursorBench 4.0 benchmarkida 46.3 foiz, Terminal-Bench 4.0 da esa 38.0 foiz ko‘rsatkichga erishdi. Shuningdek, model o‘z ishini o‘zi tekshirish va Grok Bot muhitida ishlash qobiliyatiga ega.
Muhandislik va kasbiy bilimlarni tekshiruvchi testlarda ham sezilarli o‘sish kuzatildi. Grok 4.7 EEBench elektrotexnika benchmarkida 64.0 foiz, Harvey Legal agentlik testida 19.6 foiz, HealthBench tibbiy tahlilida esa 56.7 foiz natija ko‘rsatib, Fable 5.1 va GPT-5.6 Sol bilan raqobatlasha oldi.
Model narxi Grok 4.6 darajasida saqlangan bo‘lib, bir million kiruvchi token uchun 2 dollar, chiquvchi token uchun 6 dollarni tashkil qiladi. Yangi model kuchaytirilgan kiberxavfsizlik himoyasiga ega hamda xAI API, Grok Build va Cursor orqali foydalanishga chiqarildi.
@aimastava
Post #956
1.39K


- 👍 1