در همان روزی که گوگل جمنای ۳.۷ فلش را معرفی کرد، xAI (شرکت هوش مصنوعی ایلان ماسک) نیز از جدیدترین مدل فرانتیر خود با نام Grok 4.6 رونمایی کرد. این دو انتشار هم‌زمان، تصویری کامل از شدت رقابت در بازار مدل‌های زبانی ارائه می‌دهد.

Grok 4.6 به‌عنوان مدل فرانتیر xAI برای سه حوزه‌ی اصلی طراحی شده: کدنویسی، کارهای ایجنت‌گونه و کارهای دانش‌محور (knowledge work). به گفته‌ی xAI، این مدل یک دوره‌ی آموزشی تکمیلی طولانی‌تر با داده‌های منتخب برای استدلال و مفاهیم فنی پشت سر گذاشته و داده‌های آموزشی نظارت‌شده‌ی آن نیز از نو تولید شده است.

ستاره‌ی این نسخه: ایجنت‌های طولانی‌مدت

بزرگ‌ترین ویژگی Grok 4.6 تمرکز آن روی «ایجنت‌های طولانی‌مدت» (long-running agents) است؛ ایجنت‌هایی که می‌توانند کارهای چندمرحله‌ای و سخت را بدون نیاز به دخالت مداوم انسان انجام دهند: تحقیق و جمع‌آوری اطلاعات، کار روی کدبیس‌های بزرگ، و تبدیل یک ایده‌ی خام به اپلیکیشنی کارا.

در جدول ارزیابی ده‌ردیفه‌ای که xAI منتشر کرده، Grok 4.6 در ردیف‌های «کار دانش‌محور» و «حقوقی» رتبه‌ی اول را گرفته و رقابت نزدیکی با Claude Fable 5 Max دارد؛ اگرچه در برخی بنچمارک‌های ترمینالی مثل Terminal-Bench از رقبا عقب می‌ماند.

قیمت‌گذاری

Grok 4.6 از طریق API xAI با قیمت ۲ دلار به ازای هر میلیون توکن ورودی و ۶ دلار به ازای هر میلیون توکن خروجی در دسترس قرار گرفته است. نسخه‌ی سریع‌تر (fast) این مدل نیز با قیمتی دو برابر عرضه می‌شود. دانش مدل تا اول فوریه ۲۰۲۶ به‌روز است.

«تفاوت Grok 4.6 با نسخه‌های قبل، در توانایی انجام کارهای چندمرحله‌ای طولانی است؛ جایی که اکثر مدل‌ها خسته می‌شوند و اشتباه می‌کنند.»

برای تیم‌هایی که به دنبال خودکارسازی پروژه‌های پیچیده‌اند — از تحلیل کد تا مستندسازی و اجرای فرایندهای چندلایه — Grok 4.6 گزینه‌ی جدی‌ای است که باید به لیست مقایسه اضافه شود.