در همان روزی که گوگل جمنای ۳.۷ فلش را معرفی کرد، xAI (شرکت هوش مصنوعی ایلان ماسک) نیز از جدیدترین مدل فرانتیر خود با نام Grok 4.6 رونمایی کرد. این دو انتشار همزمان، تصویری کامل از شدت رقابت در بازار مدلهای زبانی ارائه میدهد.
Grok 4.6 بهعنوان مدل فرانتیر xAI برای سه حوزهی اصلی طراحی شده: کدنویسی، کارهای ایجنتگونه و کارهای دانشمحور (knowledge work). به گفتهی xAI، این مدل یک دورهی آموزشی تکمیلی طولانیتر با دادههای منتخب برای استدلال و مفاهیم فنی پشت سر گذاشته و دادههای آموزشی نظارتشدهی آن نیز از نو تولید شده است.
ستارهی این نسخه: ایجنتهای طولانیمدت
بزرگترین ویژگی Grok 4.6 تمرکز آن روی «ایجنتهای طولانیمدت» (long-running agents) است؛ ایجنتهایی که میتوانند کارهای چندمرحلهای و سخت را بدون نیاز به دخالت مداوم انسان انجام دهند: تحقیق و جمعآوری اطلاعات، کار روی کدبیسهای بزرگ، و تبدیل یک ایدهی خام به اپلیکیشنی کارا.
در جدول ارزیابی دهردیفهای که xAI منتشر کرده، Grok 4.6 در ردیفهای «کار دانشمحور» و «حقوقی» رتبهی اول را گرفته و رقابت نزدیکی با Claude Fable 5 Max دارد؛ اگرچه در برخی بنچمارکهای ترمینالی مثل Terminal-Bench از رقبا عقب میماند.
قیمتگذاری
Grok 4.6 از طریق API xAI با قیمت ۲ دلار به ازای هر میلیون توکن ورودی و ۶ دلار به ازای هر میلیون توکن خروجی در دسترس قرار گرفته است. نسخهی سریعتر (fast) این مدل نیز با قیمتی دو برابر عرضه میشود. دانش مدل تا اول فوریه ۲۰۲۶ بهروز است.
«تفاوت Grok 4.6 با نسخههای قبل، در توانایی انجام کارهای چندمرحلهای طولانی است؛ جایی که اکثر مدلها خسته میشوند و اشتباه میکنند.»
برای تیمهایی که به دنبال خودکارسازی پروژههای پیچیدهاند — از تحلیل کد تا مستندسازی و اجرای فرایندهای چندلایه — Grok 4.6 گزینهی جدیای است که باید به لیست مقایسه اضافه شود.