إصدار Grok 4.6: أداء وكيل يعادل GPT-5.6 Sol بتكلفة أقل
أصدرت SpaceXAI نموذج Grok 4.6 في 12 أغسطس 2026، واضعةً إياه كنموذج رائد في مجال البرمجة والمهام الوكيلة طويلة الأمد والعمل المعرفي. يعتمد هذا النموذج مباشرة على Grok 4.5، ب

إصدار Grok 4.6: أداء وكيل يضاهي GPT-5.6 Sol بتكلفة أقل
مقدمة
أصدرت SpaceXAI في 12 أغسطس 2026 Grok 4.6، مركزةً إياه كنموذج رائد للبرمجة والمهام الوكيلة طويلة الأمد والأعمال المعرفية.
يُبنى هذا النموذج مباشرةً على Grok 4.5، لكن مع تركيز أكثر وضوحًا وعملية: الحفاظ على الكفاءة في الأعمال المستمرة الأطول، واستخدام الأدوات عبر خطوات متعددة، وتوليد مسودات أولى أقوى للتطبيقات التفاعلية والمرئية.
وفقًا لـ SpaceXAI وCursor، أصبح Grok 4.6 الآن معادلًا لـ GPT-5.6 Sol على مؤشر Artificial Analysis للذكاء، مع تألق ملحوظ في التقييمات الوكيلة الواقعية مثل GDPval-AA v2 وAA-Briefcase.
كما سلط المقال الأصلي في AIBase الضوء على سعر وسرعة خدمة Grok 4.6. الميزة السعرية مدعومة بالكامل في الوثائق الرسمية. أما بيانات السرعة فتتطلب تفسيرًا أكثر دقة: أبلغت AIBase عن 80 رمزًا في الثانية، بينما يقيس Artificial Analysis حاليًا واجهة برمجة التطبيقات الرسمية لـ Grok 4.6 بحوالي 68 رمز إخراج في الثانية. تختلف السرعة التشغيلية باختلاف البنية التحتية وطول المطالبات وقوة الاستدلال وحمل المزود.
Grok 4.6 مبني على Grok 4.5
Grok 4.6 هو جيل نموذجي تزايدي، وليس إصدارًا ببنية جديدة تمامًا.
صرحت SpaceXAI أن النموذج الجديد تلقى تدريبًا تكميليًا أطول مقارنةً بـ Grok 4.5. تتضمن تركيبة محتوى التدريب:
- بيانات استدلال مولّدة من النموذج بشكل منتقى
- مفاهيم تقنية متقدمة
- بيانات هندسية عالية الجودة
- مُحسِّن ووصفة تدريب محسّنان
- ضبط دقيق خاضع للإشراف يغطي قوى استدلال متعددة وأطر عمل وكيلة
- تعلم معزز وكيل موجه للبرمجة والأعمال المعرفية والبيئات التقنية المتخصصة
وذكرت الشركة أنه تم أيضًا استخدام Grok 4.5 لإعادة توليد مسارات الضبط الدقيق الخاضع للإشراف لمهام العلوم والتكنولوجيا والهندسة والرياضيات وهندسة البرمجيات والأعمال المعرفية، مع استخدام مرشحات قائمة على النموذج لإزالة الآثار الإشكالية.
أساس Grok 4.5
كان Grok 4.5 قد أكمل تدريبه بالفعل على نطاق واسع جدًا.
صرحت SpaceXAI رسميًا أن تدريب Grok 4.5 استخدم عشرات الآلاف من وحدات معالجة الرسوم NVIDIA GB300. تغطي بيانات تدريبه البرمجة والعلوم والهندسة والرياضيات، بينما ركز التعلم المعزز بشكل أساسي على مهام هندسة البرمجيات متعددة الخطوات والأعمال التقنية طويلة الأمد الأخرى.
Grok 4.6 هو امتداد لهذا الأساس، وليس بديلًا عنه.
التغيير الأهم يكمن في التركيز على السلوك الوكيل المستمر: لا ينبغي للنموذج حل مشكلات برمجية معزولة فحسب، بل الحفاظ على الترابط أثناء البحث وتحرير الملفات واستخدام الأدوات واختبار عمله الخاص والتكرار عبر جولات متعددة من التغذية الراجعة.
تركيز التدريب: المهام الوكيلة طويلة الأمد
صرحت SpaceXAI أن Grok 4.6 تم تدريبه على مجموعة واسعة من مهام التعلم المعزز الوكيل.
تشمل هذه البيئات:
- الأعمال المعرفية
- البرمجة العامة
- تحسين النواة
- تطوير الويب
- التصميم بمساعدة الحاسوب
- مهام تقنية أخرى خاصة بالمجالات
وهذا يساعد في تفسير سبب تألق النموذج في التقييمات التي تنطوي على أعمال ممتدة بدلاً من الاستدلال القصير بالإجابات.
مسودات أولى أفضل للمشاريع المرئية والتفاعلية
تؤكد SpaceXAI وCursor أيضًا على
قدرة النموذج على تحويل الأفكار المنتجية الواسعة إلى مسودات أولى قابلة للاستخدام.
في الاختبارات الداخلية، تمكن Grok 4.6 من:
- البحث في مجالات غير مألوفة.
- بناء هيكل التطبيق.
- تنفيذ التفاعلات الأساسية.
- تحديد الاتجاه البصري.
- اختبار أجزاء من مخرجاته الخاصة.
- تحسين النتائج باستمرار عبر جولات متعددة من التكرار.
هذا لا يعني أن كل تطبيق مولّد دفعة واحدة قد وصل إلى مستوى الجاهزية للإنتاج. بل يعني فقط أن الشركة وجدت أن جودة مخرجاته الأولية أفضل من Grok 4.5، خاصةً عندما تتطلب المهمة الجمع بين الكود والتصميم والتفاعل والاستخدام التكراري للأدوات.
Grok 4.6 يعادل GPT-5.6 Sol على مؤشر Artificial Analysis للذكاء
يمنح Artificial Analysis حاليًا Grok 4.6 (النسخة العالية) درجة 61 على مؤشر الذكاء.
وهذا يطابق النتيجة الإجمالية لـ GPT-5.6 Sol (النسخة القصوى) في المقارنات التي نشرتها SpaceXAI.
هذا المؤشر هو نتيجة مركبة لتسعة تقييمات، وليس اختبارًا واحدًا، لذا فهو أكثر ملاءمة كإشارة مقارنة عامة، وليس كدليل على أن النموذجين متطابقان تمامًا في جميع أعباء العمل.

يتضمن جدول المعايير المرفق مع الإصدار النتائج التالية:
| المعيار | Grok 4.6 العالية | Grok 4.5 العالية | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| مؤشر AA للذكاء | 61 | 56 | 61 | 62 |
| GDPval-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54.0% | 73.0% | 70.0% |
| FrontierCode v1.1 الموسع | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26.0% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
تتغير ترتيبات المعايير مع تحديث النماذج وأطر الاختبار وإصدارات التقييم. يعكس الجدول أعلاه نتائج المقارنة في فترة الإصدار، وليس ترتيبًا دائمًا.
GDPval-AA v2: قدرة قوية على الأعمال المعرفية الواقعية
على GDPval-AA v2، حصل Grok 4.6 على درجة 1753 Elo.
يصف Artificial Analysis GDPval-AA v2 بأنه تقييم وكيل للأعمال المعرفية الواقعية يغطي مهنًا متخصصة متعددة.
في وقت تحليل إصدار Grok 4.6، قال Artificial Analysis إن هذه الدرجة تتخلف فقط عن سلسلة Claude Opus 5، بينما تتداخل فترات الثقة مع النماذج الرائدة الأخرى (مثل Claude Fable 5 وQwen3.8 Max).
هذا أكثر دقة من الادعاء المباشر بأن Grok 4.6 يحتل المرتبة الثانية بوضوح.
التقييمات القائمة على Elo تنطوي على عدم يقين، والنتائج المتقاربة قد تتداخل إحصائيًا مع بعضها البعض.
AA-Briefcase: العمل الوكيل طويل الدورة
حصل Grok 4.6 أيضًا على 1577 Elo على AA-Briefcase.
هذا هو التقييم. هذا معيار خاص وضعته Artificial Analysis للعمل المعرفي الوكيل طويل المدى.
وهذا ما يجعل نتيجته——
في اللقطة المنشورة، أداء Grok 4.6 يعادل تقريبًا مستوى Fable 5، متخلفًا عن سلسلة Claude Opus 5.
أداء كفاءته يستحق الاهتمام أيضًا.
ذكرت Artificial Analysis أن Grok 4.6 استخدم تقريبًا عند إكمال مهام AA-Briefcase الخاصة به:
- متوسط 53 جولة محادثة
- متوسط 500 مليون توكن إدخال
بالمقارنة، يُذكر أن Claude Opus 5 (الإصدار الأقصى) استخدم تقريبًا:
- 103 جولة محادثة
- 2 مليار توكن إدخال
هذا لا يعني أن Grok 4.6 أكثر كفاءة من Claude Opus 5 في جميع الحالات. هذه مجرد ملاحظة لمعيار محدد. ومع ذلك، بالنسبة للوكلاء الأذكياء طويلي التشغيل، فإن عدد جولات أقل وذاكرة سياق متراكمة أقل يمكن أن يخفض تكلفة المهام بشكل كبير.
تسعير Grok 4.6 يبدأ من 2 دولار للإدخال و6 دولارات للإخراج
لا يزال تسعير API العام القياسي أحد أقوى المزايا التنافسية لـ Grok 4.6.
بالنسبة للطلبات التي تقل عن عتبة تسعير السياق الطويل، توضح وثائق SpaceXAI ما يلي:
| نوع التوكن | السعر لكل مليون توكن |
|---|---|
| الإدخال | 2.00 دولار |
| الإدخال المخزن مؤقتًا | 0.50 دولار |
| الإخراج | 6.00 دولار |
أشارت Artificial Analysis إلى أن هذا التسعير العام ظل دون تغيير مقارنة بـ Grok 4.5، على الرغم من ارتفاع مؤشر الذكاء من 56 إلى 61.
بالمقارنة، وقت كتابة هذا التقرير:
- التسعير القياسي لـ GPT-5.6 Sol API هو 5 دولارات لكل مليون توكن إدخال / 30 دولارًا للإخراج.
- أسعار التوكن العامة لـ Claude Opus 5 أعلى من Grok 4.6.
هذا يجعل Grok 4.6 جذابًا بشكل خاص لحلقات الوكلاء عالية الإنتاجية، حيث تميل توكنات الإخراج والسياق المتكرر إلى تشكيل الجزء الأكبر من التكلفة الإجمالية في هذه السيناريوهات.
تكلفة أعلى للطلبات الطويلة
أضاف بيان الإصدار الرسمي من SpaceXAI تفصيلًا مهمًا لم يذكره مقال AIBase القصير.
بالنسبة للطلبات التي تتجاوز 200 ألف توكن، يطبق Grok 4.6 مستوى تسعير أعلى:
| نوع التوكن | السعر لكل مليون توكن للطلبات التي تتجاوز 200 ألف |
|---|---|
| الإدخال | 4.00 دولار |
| الإدخال المخزن مؤقتًا | 1.00 دولار |
| الإخراج | 12.00 دولار |
لذلك، "2 دولار للإدخال / 6 دولارات للإخراج" هو سعر البداية، وليس سعرًا عامًا ينطبق على جميع الطلبات.
النماذج السريعة
ذكرت Cursor أن تسعير النموذج السريع هو ضعف السعر القياسي.
هذا منفصل عن قواعد تسعير الطلبات الطويلة المذكورة أعلاه. اعتمادًا على المنصة وحمل العمل، يجب على المستخدمين التحقق من مستوى السرعة ومستوى السياق المطبقين قبل تقدير تكاليف الإنتاج.
ماذا عن سرعة 80 TPS المذكورة في التقرير؟
ذكر مقال AIBase أن Grok 4.6 يمكن أن يعمل بسرعة 80 توكنًا في الثانية.
يجب التعامل مع هذا الرقم بحذر.
لم ينشر الإعلان الرسمي لـ Grok 4.6 من SpaceXAI ضمانًا ثابتًا لسرعة 80 TPS كخدمة. تقيس Artificial Analysis حاليًا سرعة إخراج Grok 4.6 (العالي) على واجهة برمجة التطبيقات الخاصة بالطرف الأول بحوالي 67.6 توكن إخراج في الثانية تحت حمل عمل المعيار الخاص بها.
بالمقارنة، ذكرت صفحة إصدار Grok 4.5 الرسمية من SpaceXAI بوضوح أن Grok 4.5 يُقدم بسرعة 80 TPS.
لذلك، ربما استخدمت المقالات المصدرية القصيرة رقم 80 TPS السابق، أو أشارت إلى مستوى خدمة مختلف.
النقطة العملية أبسط:
Grok 4.6 سريع جدًا بالنسبة لنموذج استدلال متقدم، لكن لا يوجد رقم TPS ثابت واحد ينطبق على جميع الطلبات أو جميع المزودين أو جميع مستويات الاستدلال أو جميع مستويات السرعة.
سياق 500 ألف على SpaceXAI API
تدرج وثائق SpaceXAI API نافذة سياق grok-4.6 على أنها 500 ألف توكن.
يدعم النموذج:
- إدخال نصي
- إدخال صور
- إخراج نصي
- مستويات استدلال منخفضة ومتوسطة وعالية وعالية جدًا
- استدعاء الدوال
- البحث على الويب
- البحث على X
- تنفيذ الكود
كما تدرج صفحة النموذج الرسمية تاريخ قطع المعرفة على أنه 1 فبراير 2026.
Cursor يستخدم حد سياق مختلف
توثق وثائق نموذج Grok 4.6 الخاصة بـ Cursor حاليًا نافذة سياق 256 ألف داخل Cursor.
هذا لا يتعارض مع مواصفات النموذج الأساسي. هذا يعني أن تكامل المنصة يمكن أن يعرض حد سياق أصغر من واجهة SpaceXAI API الرسمية.
عند مقارنة حدود النماذج، تحقق دائمًا من المزود والتكامل المحددين المستخدمين.
كيفية استخدام Grok 4.6 عبر API
معرف النموذج الرسمي من SpaceXAI هو:
grok-4.6
يبدو طلب Responses API الأدنى كالتالي:
curl https://api.x.ai/v1/responses \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $XAI_API_KEY" \
-d '{
"model": "grok-4.6",
"input": "ابحث عن الخطأ وأصلحه ثم اشرحه: function median(a){a.sort();return a[a.length/2]}"
}'
يمكن أيضًا استخدام نفس النموذج عبر SDK الرسمي من xAI وعملاء API المتوافقين مع OpenAI.
مثال بايثون
import os
from xai_sdk import Client
from xai_sdk.chat import user
client = Client(api_key=os.getenv("XAI_API_KEY"))
chat = client.chat.create(model="grok-4.6")
chat.append(
user(
"ابحث عن الخطأ وأصلحه ثم اشرحه: "
"function median(a){a.sort();return a[a.length/2]}"
)
)
response = chat.sample()
print(response.content)
بالنسبة لحلقات الوكلاء طويلة التشغيل، توصي SpaceXAI باستخدام التخزين المؤقت للطلبات وضغط السياق عند الاقتضاء لتقليل تكاليف السياق المتكرر.
Grok 4.6 متاح في Cursor وGrok Build
وقت الإصدار، يتوفر Grok 4.6 على المنصات التالية:
- Cursor
- Grok Build
- SpaceXAI API
- OpenRouter
- Vercel
- Cloudflare
توفر SpaceXAI وCursor أيضًا ضعف الحصة المضمنة للأسبوع الأول في Cursor وGrok Build.
هذا العرض الترويجي للإصدار محدود زمنيًا ولا ينبغي اعتباره تسعيرًا دائمًا.
Grok 4.6 في Cursor
يعرض Cursor Grok 4.6 بأربعة مستويات شدة استدلال:
- xhigh
- high
- medium
- low
high هو مستوى الاستدلال الافتراضي.
في خطط Cursor المؤهلة، يتوفر أيضًا مستوى السرعة السريع.
داخل Cursor، يمكن للنموذج استخدام أدوات الوكيل الخاصة بالمنصة لتنفيذ المهام التالية:
- البحث في الملفات والمجلدات
- قراءة الملفات
- تحرير الملفات
- تشغيل أوامر shell
- تصفح الويب
- اختبار التطبيقات المستندة إلى المتصفح
- توليد الصور
- الحصول على قواعد المشروع
هذا أحد أسباب إيلاء إصدار Grok 4.6 أهمية كبيرة للمعايير الوكيلة: استخدامه المقصود لا يقتصر على إكمال المحادثات المعزولة.
Grok 4.6 في أقوى حالاته عندما تتطلب المهام عملًا مستمرًا
تشير نتائج الاختبارات المعيارية إلى أن أكبر تحقق في Grok 4.6 لا يقتصر على الاستدلال الثابت.
بل إن تحسّنه يكون أكثر وضوحًا عندما تتضمن المهام ما يلي:
- خطوات متعددة
- استخدام الأدوات
- البحث
- التعامل مع الأكواد أو المستندات
- الفحص الذاتي
- السياق الطويل
- التحسين التكراري
وهذا يجعله مناسبًا بشكل خاص لـ:
- وكلاء البرمجة
- الأعمال البرمجية على مستوى المستودعات
- وكلاء البحث
- سير عمل الجداول الإلكترونية والمستندات
- التحليل التقني
- النماذج الأولية لتطبيقات الويب
المهام المعرفية طويلة الأمد
بالنسبة للطلبات القصيرة والبسيطة، قد لا تكون هذه الميزة واضحة.
ما يمكن أن تثبته الاختبارات المعيارية وما لا يمكنها إثباته
تدعم البيانات المنشورة الاستنتاجات الواضحة التالية:
- في العديد من اختبارات الوكلاء المعيارية، يتفوق Grok 4.6 بوضوح على Grok 4.5.
- في المقارنة الحالية لمؤشر الذكاء الاصطناعي من Artificial Analysis، فهو متعادل مع GPT-5.6 Sol.
- أداؤه بارز بشكل خاص في GDPval-AA v2 وAA-Briefcase.
- أسعار واجهة برمجة التطبيقات القياسية أقل بكثير من أسعار GPT-5.6 Sol.
لكن البيانات لا تثبت أن Grok 4.6 أفضل بشكل عام من GPT-5.6 Sol أو Claude في كل مهمة.
فعلى سبيل المثال، يُظهر جدول الإصدار نفسه أن GPT-5.6 Sol يتصدر في DeepSWE v1.1 وTerminal-Bench v3.0، بينما يتصدر Claude Fable 5 في العديد من تقييمات البرمجة والوكلاء الأخرى.
لذا، يجب أن يعتمد اختيار النموذج على عبء العمل الفعلي، وليس على درجة تركيبية واحدة.
الأسئلة الشائعة
ما هو Grok 4.6؟
Grok 4.6 هو نموذج رائد من SpaceXAI مخصص للبرمجة والمهام الوكيلة والعمل المعرفي. وهو يضيف تدريبًا إضافيًا على أساس Grok 4.5، مع تركيز معزز على الوكلاء طويلي التشغيل، وقدرة أقوى على بناء التطبيقات من المحاولة الأولى، وعمل متعدد الخطوات أكثر استمرارية.
هل Grok 4.6 أفضل من GPT-5.6 Sol؟
يعتمد ذلك على المهمة المحددة. في المقارنة المنشورة، يتعادل Grok 4.6 مع GPT-5.6 Sol في مؤشر الذكاء الاصطناعي من Artificial Analysis، ويتفوق في بعض تقييمات الوكلاء، بينما يظل GPT-5.6 Sol أقوى في بعض اختبارات البرمجة المعيارية. كما توجد فروق كبيرة في التسعير وطول السياق بين النموذجين.
كم تبلغ تكلفة واجهة برمجة تطبيقات Grok 4.6؟
التسعير القياسي هو 2 دولار لكل مليون رمز إدخال، و0.50 دولار لكل مليون رمز إدخال مخزّن مؤقتًا، و6 دولارات لكل مليون رمز إخراج. بالنسبة للطلبات التي تتجاوز 200 ألف رمز، تحدد وثائق SpaceXAI مستويات أسعار أعلى: 4 دولارات / 1 دولار / 12 دولارًا لكل مليون للإدخال والإدخال المخزّن مؤقتًا والإخراج على التوالي.
ما هو حجم نافذة السياق في Grok 4.6؟
تدعم واجهة برمجة التطبيقات الرسمية من SpaceXAI نافذة سياق تبلغ 500 ألف رمز. توفر Cursor حاليًا نافذة سياق تبلغ 256 ألف رمز لتكاملها الخاص مع Grok 4.6، لذا فإن الحد الفعلي يعتمد على المنصة.
هل يدعم Grok 4.6 الصور؟
نعم. تُدرج SpaceXAI أن Grok 4.6 يدعم إدخال النصوص والصور وإخراج النصوص. كما يدعم النموذج أدوات مثل استدعاء الدوال والبحث على الويب والبحث على X وتنفيذ الأكواد، عبر واجهة برمجة التطبيقات الخاصة بـ xAI.
هل يمكنني استخدام Grok 4.6 في Cursor؟
نعم. يتوفر Grok 4.6 في Cursor ويدعم مستويات شدة استدلال xhigh وhigh وmedium وlow. كما تمنحه Cursor الوصول إلى مجموعة أدوات الوكلاء الخاصة بها للتعامل مع الملفات وأوامر Shell والتصفح وسير عمل البرمجة الأخرى.
هل Grok 4.6 مفتوح المصدر؟
لا. Grok 4.6 هو نموذج مملوك، ولم تكشف SpaceXAI عن أوزانه أو عدد معاملاته.
ما مدى سرعة Grok 4.6؟
أفادت AIBase عن 80 رمزًا في الثانية، لكن قياسات Artificial Analysis الحالية تُظهر أن واجهة برمجة التطبيقات الرسمية Grok 4.6 تبلغ حوالي 68 رمز إخراج في الثانية في عبء العمل المرجعي الخاص بها. تختلف السرعة تبعًا لشدة الاستدلال وحجم الطلب وحمل البنية التحتية ومستوى المنصة.
الأدوات ذات الصلة
- Grok 4.6: صفحة الإعلان الرسمية من SpaceXAI، وتغطي التدريب والاختبارات المعيارية والأمان والتوفر.
- وحدة تحكم SpaceXAI API: وحدة التحكم الرسمية لإنشاء مفاتيح API والوصول إلى نماذج Grok.
- Grok Build: بيئة البرمجة والعمل الوكيلة من SpaceXAI، مدعومة بنماذج Grok.
- Cursor: بيئة برمجة بالذكاء الاصطناعي، أطلقت Grok 4.6 بالتزامن مع SpaceXAI وتتيح النموذج عبر سير عمل الوكلاء الخاص بها.
- Artificial Analysis: اختبارات معيارية مستقلة للنماذج من حيث الذكاء والتكلفة والسرعة والسياق وأداء الوكلاء.
الروابط ذات الصلة
- الإعلان الرسمي عن Grok 4.6: الإعلان الرئيسي من SpaceXAI وجداول الاختبارات المعيارية.
- وثائق واجهة برمجة تطبيقات Grok 4.6: معرّفات النماذج الرسمية ونوافذ السياق والتسعير والأنماط المدعومة والأدوات وأمثلة API.
- ملاحظات إصدار SpaceXAI: السجل الرسمي للإصدارات، بما في ذلك مستويات أسعار Grok 4.6 وتوفّره.
- إعلان Cursor عن Grok 4.6: مقال إصدار Cursor الذي يغطي التدريب وسلوك الوكلاء والتسعير والتكاملات المدعومة.
- وثائق نموذج Grok 4.6 في Cursor: حدود السياق الخاصة بـ Cursor ومستويات الجهد والأدوات الوكيلة المتاحة.
- تقييم Artificial Analysis لـ Grok 4.6: تحليل مستقل لمؤشر الذكاء وGDPval-AA v2 وAA-Briefcase وكفاءة التكلفة واستخدام الرموز.
- الإعلان الرسمي عن Grok 4.5: خلفية النموذج السابق حول حجم تدريب GB300 والتعلم المعزز وادعاء 80 رمزًا في الثانية وتسعير الإصدار.
ملخص
Grok 4.6 هو ترقية موجّهة مقارنة بـ Grok 4.5، مع تركيز رئيسي على الوكلاء طويلي التشغيل والبرمجة والعمل المعرفي وجودة التنفيذ من المحاولة الأولى في المشاريع التفاعلية. نتائج إصداره تضعه في طليعة تقييمات النماذج الحالية، حيث حقق 61 نقطة في مؤشر الذكاء الاصطناعي من Artificial Analysis — متعادلاً مع GPT-5.6 Sol في مقارنة الإصدار.
أقوى ميزة في هذا الإصدار هي الجمع بين أداء الوكلاء والسعر. يبدأ سعر Grok 4.6 من 2 دولار لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، مع تسجيل درجات عالية في GDPval-AA v2 وAA-Briefcase. قد تؤدي الطلبات الطويلة والمستويات السريعة إلى تكاليف أعلى، لذا يجب أن تستند تقديرات الإنتاج إلى تكوين المزود الفعلي.
يجب التعامل مع بيانات 80 رمزًا في الثانية المعلنة بحذر: القياسات المستقلة الحالية قريبة من 68 رمز إخراج في الثانية، وقد تختلف سرعة الخدمة بمرور الوقت.
Grok 4.6
الميزة الرئيسية لا تكمن في فوزها بجميع الاختبارات المعيارية، بل في أنها تقدم الآن أداءً بمستوى متقدم للوكلاء بسعر تنافسي للغاية.