نسخه ۴.۶ گراک معرفی شده و تمرکز اصلیش رو گذاشته روی ایجنتهای طولانیمدت، کدهای سنگین و پیادهسازی سریع پروژههای بصری. با اصلاح فرایند آموزش و تقویت RL، توانسته توی بنچمارکهای ایجنتی مثل CursorBench و DeepSWE ارتقای چشمگیری داشته باشه و توی شاخص کلی AA Intelligence دقیقاً پابهپای GPT-5.6 Sol جلو بیاد. ویژگی واقعاً کاربردیش اینه که موقع کار روی تسکهای طولانی توانایی خودآزمایی و تایید کار خودش رو داره، یعنی ایده یک پروژه رو خیلی سریعتر به یک پروتوتایپ قابل استفاده تبدیل میکنه. در حال حاضر این مدل توی Cursor و Grok Build در دسترسه و قیمت پایهاش هم از ۲ دلار برای ورودی و ۶ دلار برای خروجی به ازای هر میلیون توکن شروع میشه.
و نتیجه ای که به من داد :
نگارش ۴.۶ گراک رونمایی شده و تمرکز اصلیش رو گذاشته روی ایجنتهای درازمدت، کدهای سنگین و ساخت تندِ پروژههای دیداری. با پیرایش فرایند آموزش و تقویت یادگیری تقویتی (RL)، توانسته توی محکهای ایجنتی مانند CursorBench و DeepSWE پیشرفت چشمگیری داشته باشه و توی شاخص کلی AA Intelligence دقیقاً پابهپای GPT-5.6 Sol پیش بره. ویژگی واقعاً کاربردیش اینه که هنگام کار روی کارهای درازمدت، توان خودآزمایی و بازبینی کار خودش رو داره، یعنی ایدهٔ یک پروژه رو خیلی تندتر به یک پیشنمونهٔ کارآمد تبدیل میکنه. هماکنون این مدل توی Cursor و Grok Build در دسترسه و بهای پایهاش هم از ۲ دلار برای ورودی و ۶ دلار برای خروجی بهازای هر میلیون توکن آغاز میشه.
از جذابیت هاش اینه که کور کورانه هر چیزیو قبول نمیکنه ایجنت من اولا یه قضاوت میکنه کلمات رو برمیگردونه به کلمات فارسی و ایجنت بعدی میاد و دقیقا میبینه که چیا تعییر کردن و چرا تغییر کردن و ایا درست بوده تغییرش یا نه یه سریارو رد میکنه یه سریا رو اکسپت میکنه در نهایت متنی غنی تر از زبان فارسی براتون مینویسه این اسکیل !
@codehalics | کدهالیک