صدر Grok 4.7 في 21 سبتمبر 2026، وتبعه Claude Opus 5.5 بعد يوم واحد. يفرض الأول 2 دولار لكل مليون توكن إدخال و6 دولارات لكل مليون توكن إخراج، ويفرض الثاني 4 دولارات و20 دولارًا. تُظهر صفحة الأسعار هذا الفرق في ثانيتين، لكنها لا تستطيع أن تخبرك ما إذا كان الإنفاق الإضافي يحقق نتائج أفضل في مهامك. يضع هذا التحليل أرقام الموردين، والتشغيلات المستقلة من Vals AI، ومؤشر ذكاء عام، وقائمتي الأسعار جنبًا إلى جنب، ثم يحوّلها إلى حسابات تكلفة بسيطة يمكنك التحقق منها بنفسك.

الإجابة المختصرة
Claude Opus 5.5 هو النموذج الأقوى في معظم الاختبارات، وGrok 4.7 أرخص بكثير. في المواجهة المباشرة لـ Vals AI، تفوّق Opus 5.5 في 20 من أصل 22 اختبارًا مشتركًا، بينما تصدّر Grok 4.7 في اثنين. في مؤشر الذكاء المستقل (الإصدار 4.3.2)، يسجّل Opus 5.5 النتيجة 58 ويحتل المركز الأول من بين 225 نموذجًا. ويسجّل Grok 4.7 النتيجة 46 ويحتل المركز 29، وهو ما يزال أعلى بكثير من الوسيط البالغ 26 للنماذج المماثلة.
| المواصفة | Grok 4.7 | Claude Opus 5.5 |
|---|
| تاريخ الإصدار | 21 سبتمبر 2026 | 22 سبتمبر 2026 |
| سعر الإدخال (لكل مليون توكن) | 2.00$ | 4.00$ |
| سعر الإخراج (لكل مليون توكن) | 6.00$ | 20.00$ |
| نافذة السياق | 500 ألف توكن | مليون توكن |
| أقصى إخراج | غير منشور | 128 ألف توكن |
| مؤشر الذكاء | 46 | 58 |
| سرعة الإخراج | 72.6 توكن في الثانية | 95.3 توكن في الثانية |
| أنواع الإدخال | نص (لم يُبلَّغ عن دعم إدخال الصور) | نص وصور |
يختلف الوصول أيضًا. يتوفر Grok 4.7 عبر Grok API وCursor، ومستوى مجاني في Grok Build، لكن لا توجد واجهة برمجية مجانية. يعمل Opus 5.5 على Claude API وAmazon Bedrock وGoogle Cloud وMicrosoft Foundry، وتاريخ آخر تحديث لمعرفته هو يونيو 2026. تفكيره تكيفي ومفعّل دائمًا، مع خمسة مستويات جهد: low وmedium وhigh وxhigh وmax.
💡 قاعدة عملية: يبلغ Grok 4.7 نحو 82% من نتيجة مؤشر Vals لـ Opus 5.5 (54.95 مقابل 66.97)، مقابل ما بين الثلث وأقل من النصف من الفاتورة. إذا كان الخطأ في الإجابة يكلّفك ساعة من التصحيح، فغالبًا ما تبرّر علاوة Opus نفسها. أما إذا كنت تلخّص أو تكتب مسودات أو تُصنّف بكميات كبيرة، فإن Grok هو الإنفاق الأذكى.
السعر لكل مليون توكن
أسعار الإدخال والإخراج
يُحتسب سعر النموذجين بحسب التوكن، وتبدو القائمتان متشابهتين حتى تقرأ سطر الإخراج.
| نوع السعر (لكل مليون توكن) | Grok 4.7 | Claude Opus 5.5 |
|---|
| الإدخال | 2.00$ | 4.00$ |
| قراءة الإدخال المخزّن مؤقتًا | 0.50$ | 0.20$ |
| الإخراج | 6.00$ | 20.00$ |
| إدخال / إخراج الدفعات | غير مدرج | 2$ / 10$ |
| الأوامر التي تتجاوز 200 ألف توكن | 4$ إدخال، و1$ مخزّن مؤقتًا، و12$ إخراج | لا توجد فئة أوامر طويلة مدرجة |
الفجوة الحقيقية تكمن في الإخراج. يكلّف الإدخال على Opus 5.5 2x أكثر، لكن الإخراج يكلّف 3.3x أكثر. أما قراءات التخزين المؤقت فتسير في الاتجاه المعاكس: يتقاضى Opus 5.5 مبلغ 0.20$ مقابل 0.50$ لدى Grok، ما يجعله الخيار الأرخص للوكلاء الذين يعيدون قراءة السياق الطويل نفسه باستمرار.

التخزين المؤقت والأوامر الطويلة
لا تنطبق أسعار Grok 4.7 الأساسية البالغة 2$ و6$ إلا طالما ظل الأمر النصي لديك عند 200000 توكن أو أقل. وما إن يتجاوز الأمر هذا الحد حتى يتضاعف كل سعر ليصبح 4$ للإدخال، و1$ للتخزين المؤقت، و12$ للإخراج. وبما أن نافذة السياق لديه 500K، فإن النطاق الرخيص لا يشمل سوى أول 40% منها.
يُسعَّر Opus 5.5 بأقل بنسبة 20% من Opus 5، مع كتابة في الذاكرة المؤقتة بقيمة 5$ لخمس دقائق أو 8$ لساعة. يتوفر وضع سريع تجريبي على Claude API بسعر 8$ للإدخال و40$ للإخراج. وهناك فخ واحد: تغيير مستوى الجهد في منتصف الجلسة يُبطل ذاكرة الأوامر المؤقتة، فتتحوّل قراءات التخزين المؤقت الرخيصة بصمت إلى إدخال بالسعر الكامل. اختر مستوى جهد واحدًا والتزم به.
تكلفة حِمل عمل حقيقي
الأسعار المعلنة عند ثلاثة أحمال عمل يومية، دون تطبيق خصومات التخزين المؤقت أو الدفعات:
| حمل العمل اليومي | Grok 4.7 | Claude Opus 5.5 | علاوة Opus |
|---|
| ملخصات الدعم: 10 ملايين إدخال، ومليون إخراج | 26$ | 60$ | 2.3x |
| وكيل برمجة: 5 ملايين إدخال، و5 ملايين إخراج | 40$ | 120$ | 3.0x |
| كتابة التقارير: مليون إدخال، و3 ملايين إخراج | 20$ | 64$ | 3.2x |
كلما اعتمد حِمل عملك على الإخراج أكثر، اتسعت الفجوة. وقاست Vals AI تشغيلات حقيقية بدل الاعتماد على الصيغ. كلّف تشغيل مؤشر Vals 32.14$ على Opus 5.5 و12.12$ على Grok 4.7، أي بنسبة 2.7 مرة تقريبًا. كلّف اختبار Finance Agent مبلغ 9.22$ مقابل 2.72$. وكان الفارق ضئيلًا في ProofBench، بمبلغ 0.96$ مقابل 0.79$.

ولن تنقذ الإسهابية فاتورة Grok أيضًا. سجّل تشغيل مؤشر الذكاء المستقل 240M توكن إخراج من Grok 4.7، مقابل وسيط قدره 81M للنماذج المماثلة. أما Opus 5.5 فأنتج 260M. وكلاهما يُكثر من الكلام، لذا ينعكس فرق السعر لكل توكن تقريبًا مباشرةً على فاتورتك.
المعايير جنبًا إلى جنب
تعامل مع كل رقم أدناه مع مصدره. بعض النتائج يعلنها المورّد، وبعضها يأتي من تشغيلات مستقلة، ويمكن أن يحتل النموذج نفسه مواقع مختلفة جدًا تبعًا لمن أجرى الاختبار.
البرمجة وأعمال الطرفية
البرمجة هي المجال الذي يفصل بين النموذجين بوضوح أكبر.
| المعيار | Grok 4.7 | Claude Opus 5.5 |
|---|
| Terminal-Bench 4.0 (أعلنه المورّد) | 38.0% | 66.4% |
| Terminal-Bench 4.0 (Vals AI) | 28.79% | 65.15% |
| CursorBench 4.0 | 46.3% | 57.8% |
| ترحيل الشيفرة (Vals AI) | 44.82% | 66.65% |
| IOI (Vals AI) | 57.72% | 95.06% |
| Vibe Code Bench v1.1 (Vals AI) | 86.17% | 90.29% |
| SRE Bench (Vals AI) | 3.82% | 33.59% |
بمتوسط اختبارات البرمجة لدى Vals AI، يسجّل Opus 5.5 نسبة 67.13%، ويسجّل Grok 4.7 نسبة 43.60%. والنتيجة المتقاربة الوحيدة هي Vibe Code Bench، بنسبة 86.17% مقابل 90.29%. ويحقق Grok 4.7 أيضًا نسبة 71.0% على DeepSWE v1.1 بمستوى جهد عالٍ، وهو اختبار لم أجد له رقمًا لـ Opus 5.5. ويضيف Opus 5.5 نسبة 54.4% على FrontierCode v1.1، متقدمًا بمقدار 1.1 نقطة على GPT-6 Astra.

الاستدلال وأعمال المعرفة
فجوة الاستدلال واضحة بالقدر نفسه. في مؤشر Vals، يسجّل Opus 5.5 نسبة 66.97% مقابل 54.95% لـ Grok. وProofBench v1.1، الذي تصنّفه Vals AI ضمن الرياضيات، هو أكثر النتائج انحيازًا في الترتيب: 100% مقابل 26%. تتبع اختبارات العلوم النمط نفسه، إذ يبلغ متوسط Opus 5.5 نسبة 58.65% ويبلغ متوسط Grok 4.7 نسبة 34.83%.
تضيف جداول إطلاق Opus 5.5 بعض النتائج الأخرى: نسبة 67.7% في Humanity's Last Exam مع الأدوات، وتقييم Elo بقيمة 1846 في GDPval-AA v2.1 لأعمال المعرفة، ونسبة 81.8% في OSWorld 2.0 لاستخدام الحاسوب، ونسبة 89.0% في Chartography لقراءة الرسوم البيانية. أما ملاحظات إطلاق Grok 4.7 فتعتمد على اختبارات مختلفة: نسبة 64.0% في EEBench للهندسة الكهربائية، ونسبة 56.7% في HealthBench Professional.

حيث يتفوّق Grok 4.7
انتصارا Grok في مقارنة Vals AI محددان:
- Legal Agent من Harvey: 12.50% عند Grok 4.7 مقابل 3.75% عند Opus 5.5. كلتا النتيجتين منخفضتان، لذا اعتبرها تقدّمًا في اختبار صعب جدًا.
- CyberBench v1.1: 69.46% مقابل 55.36%، بفارق 14 نقطة.
يتقدم Grok أيضًا بهامش ضئيل في متوسط فئة القانون (29.81% مقابل 27.12%)، رغم أن Opus 5.5 يفوز في Legal Research Bench بنسبة 50.48% مقابل 47.12%. والرعاية الصحية متعادلة تقريبًا، بنسبة 70.61% لـ Opus و69.47% لـ Grok.
السياق والسرعة وحدود الإخراج

500 ألف مقابل مليون توكن
تضع قائمة مؤشر الذكاء المستقل نافذة Grok 4.7 عند 500,000 توكن، أي نحو 750 صفحة نصية. ولا تذكر وثائق إطلاق Grok الرقم، لذا تحقق منه مع مزوّدك قبل أن تبني عليه. يوفر Opus 5.5 مليون توكن، أي نحو 1500 صفحة، مع ما يصل إلى 128 ألف توكن إخراج لكل استجابة. ويمكن أن تمتد مهام الدفعات إلى 300 ألف توكن إخراج باستخدام ترويسة تجريبية.
تذكّر مضاعفة سعر Grok عند 200 ألف توكن. فالمهمة التي تغذي Grok بمقدار 400 ألف توكن من العقود تقع في الفئة الأعلى، بينما لا توجد فئة أوامر طويلة مدرجة لـ Opus 5.5.

السرعة والإسهاب
من حيث سرعة الإخراج الخام، يبث Opus 5.5 بسرعة 95.3 توكن في الثانية، ويبث Grok 4.7 بسرعة 72.6، وهي أدنى من الوسيط البالغ 78.5 للنماذج المماثلة. أما زمن ظهور أول توكن فقصته أكثر تعقيدًا. يدرج المؤشر نفسه Grok 4.7 عند 73.9 ثانية على إعداد التفكير xhigh لديه. ورقم Opus 5.5 عند الجهد max هو 731 ثانية، وهذا يبدو قيمة شاذة، لذا لا أنصح بالاعتماد عليه.
جاءت نتائج زمن التنفيذ الفعلي للمهام متباينة ضمن تشغيلات Vals AI. أنهى Grok 4.7 مؤشر Vals في 35 دقيقة، مقابل 1 ساعة و19 دقيقة لدى Opus، كما أنهى اختبار Finance Agent في 15 دقيقة، مقابل 33 دقيقة. وفاز Opus في ProofBench بزمن 5 دقائق و51 ثانية، مقابل 12 دقيقة و47 ثانية لدى Grok. أيّ النموذجين ينهي المهمة أولًا يعتمد على المهمة نفسها.
أيهما يناسب عملك

اختر Grok 4.7 عندما
- تعالج حجمًا كبيرًا من النصوص وتكون الفاتورة القيد الأساسي.
- تبقى أوامرك دون 200 ألف توكن، حيث تسري أسعار 2$ و6$.
- يكون العمل مهام وكلاء قانونية أو اختبارات أمنية، وهي المجالات التي حقق فيها انتصاريه.
- يمكنك قبول سقف أدنى في عمليات البرمجة الوكيلية الطويلة.
اختر Opus 5.5 عندما
- تشغّل وكلاء أو مهام طرفية أو عمليات ترحيل للشيفرة يكون فيها الفشل في خطوة واحدة مكلفًا.
- تغذّي مستندات طويلة تتجاوز 500 ألف توكن، أو تحتاج إلى إدخال صور.
- تعتمد على التخزين المؤقت للأوامر، إذ تكلّف قراءات التخزين المؤقت 0.20$ لكل مليون توكن.
- تريد أعلى نتيجة في مؤشر الذكاء العام ويمكنك تخصيص ميزانية لها.
سيستخدم كثير من الفرق النموذجين معًا. وجّه الأعمال الكبيرة مثل التصنيف والمسودات الأولى للملخصات والاستخراج الروتيني إلى Grok 4.7، ثم صعّد الحالات الصعبة إلى Opus 5.5: تشغيلات الوكلاء الطويلة والبراهين وعمليات الترحيل. يمكن أن يُطلق الانتقال فشل اختبار أو درجة ثقة منخفضة. وبحساب تقريبي سريع، فإن إرسال 75% من أعمال مؤشر Vals إلى Grok و25% إلى Opus سيكلّف نحو 17$ بدلًا من 32.14$.
💡 تحقق قبل أن تبدّل: يرفض Opus 5.5 عدة إعدادات كانت تعتمد عليها تكاملات Claude القديمة. يؤدي تعطيل التفكير إلى خطأ 400، وفرض استخدام الأدوات (tool_choice مضبوطًا على any أو أداة مسمّاة) يعيد أخطاءً، وتُرفض الأداة القديمة computer_20251124. كما تعيد Anthropic توجيه معظم طلبات الأمن السيبراني إلى Opus 4.8، لذا اختبر أعمال الأمن مباشرة بدلًا من الافتراض.
لماذا تضلّل المعايير
انظر إلى نتيجة Grok 4.7 في Terminal-Bench 4.0. يعلن المورّد نسبة 38.0%. وقاست Vals AI نسبة 28.79%. وقاس تشغيل مؤشر الذكاء المستقل نسبة 26%. النموذج نفسه، واسم المعيار نفسه، وفارق يبلغ 12 نقطة، تبعًا للبيئة الاختبارية ومستوى الجهد ومن أجرى الاختبار.
ولدى Opus 5.5 تحفظاته الخاصة. فجهده الافتراضي متوسط، لكن نتائجه المعلنة تأتي من مستويات xhigh أو max، وهي أغلى وأطول زمنًا. ويقارن المؤشر المستقل أيضًا Opus عند max بـ Grok عند xhigh، لذا يقف النموذجان على إعدادين مختلفين. وتحذّر Anthropic نفسها من أن هوامش المعايير أصبحت مؤشرًا أقل موثوقية على الفروق في الاستخدام الفعلي عند هذا المستوى من القدرة.
لذا أجرِ اختبارك الخاص. يستغرق الأمر بعد ظهر واحدًا:
- اختر 20 أمرًا نصيًا حقيقيًا من عملك الفعلي، لا أمثلة بسيطة.
- شغّل كل أمر على النموذجين بمستوى الجهد الذي تستخدمه في الإنتاج.
- سجّل التكلفة لكل مهمة، وإعادات المحاولة، والزمن الفعلي.
- قيّم المخرجات بشكل أعمى، دون أن تعرف أي نموذج كتب أي إجابة.
- احسب التكلفة لكل إجابة مقبولة، لا التكلفة لكل توكن.
جرّب نماذج مشابهة على Picasso IA
لا يظهر Grok 4.7 ولا Claude Opus 5.5 في كتالوج Picasso IA حتى وقت كتابة هذا المقال. أقرب الخيارات متاحة اليوم، ويمكنك استخدامها دون بيانات اعتماد API أو إعداد.
نماذج متاحة الآن
من الخيارات الأخرى لاختبار ثلاثي، GPT 5.6 Sol وGemini 3.1 Pro وKimi K2.6.
استخدم Claude Opus 4.7 على Picasso IA
- افتح صفحة Claude Opus 4.7.
- اكتب سؤالك أو الصق شيفرتك في حقل Prompt. وهو الحقل الإلزامي الوحيد.
- أضف System Prompt إذا أردت دورًا ثابتًا، مثل "أنت مراجع للشيفرة".
- اترك Max Tokens على 8,192 للإجابات الطويلة، أو خفّضه للردود القصيرة.
- ارفع لقطة شاشة أو مخططًا إذا كان سؤالك يعتمد عليه. تُقلَّص الصور إلى 0.5 ميغابكسل افتراضيًا لتوفير الوقت.
- شغّله، ثم واصل التحسين من خلال أوامر متابعة.
استخدم Grok 4 على Picasso IA
- افتح صفحة Grok 4.
- اكتب سؤالك في حقل Prompt. المسائل متعددة الخطوات هي ما يتفوق فيه Grok 4.
- أبقِ Temperature على القيمة الافتراضية 0.1 للحصول على إجابات مركزة، أو ارفعها للعصف الذهني.
- ارفع Max Tokens فوق القيمة الافتراضية 2,048 إذا بدأت الإجابات تنقطع.
- عدّل Presence Penalty وFrequency Penalty فقط عندما يبدأ المخرج في تكرار نفسه.
💡 نصيحة: أرسل الأمر نفسه إلى النموذجين والصق الردود جنبًا إلى جنب. عشر دقائق من ذلك تخبرك أكثر من جدول معايير آخر.
أنشئ صورك الخاصة على Picasso IA

دع النموذج يكتب أوامرك
النموذج اللغوي القوي كاتب أوامر قوي أيضًا. اطلب من Claude Opus 4.7 أو Grok 4 كتابة أوامر الصور والفيديو، ثم الصق النتائج في أداة التوليد:
اكتب خمسة أوامر نصية واقعية كالصور الفوتوغرافية لمقال مدونة يقارن بين نموذجين للذكاء الاصطناعي. يجب أن يتضمن كل أمر موضوعًا، وموقعًا، واتجاه الإضاءة، وزاوية الكاميرا، وعدسة. اجعل كل أمر دون 70 كلمة.
الترتيب مهم: الموضوع، ثم المكان، ثم الضوء، ثم الكاميرا، ثم العدسة. هذا الترتيب يمنح نماذج الصور التفاصيل التي تحتاجها لإنتاج نتائج حادة وطبيعية.
نماذج الصور والفيديو للتجربة
للصور، جرّب Seedream 4.5 أو GPT Image 2 أو Flux 2 Pro أو Nano Banana Pro. وللمقاطع القصيرة، تحوّل Seedance 2.0 وVeo 3.1 وKling v3 Video الأمر النصي أو الصورة الثابتة إلى حركة.
والآن جاء دورك. افتح Picasso IA، واطلب من نموذج لغوي ثلاثة أوامر، ثم شغّلها عبر نموذج صور. اختر نتيجتك المفضلة، وحرّكها بنموذج فيديو، وقارن كيف يفهم كل نموذج تعليماتك. أسرع طريقة لتعرف أي نموذج يناسبك هي أن تضع أمرك الخاص أمامه.