Claude Opus 4.7: ما الجديد في أقوى نموذج لدى Anthropic

Claude Opus 4.7 هو أكثر إصدارات Anthropic قدرةً حتى الآن، إذ يقدّم تفكيرًا موسّعًا محسّنًا، ومعالجة بصرية أدق، وسير عمل أقوى للبرمجة الوكيلية، وواجهة API أكثر موثوقية لاستخدام الحاسوب. يستعرض هذا المقال كل تغيير مهم، ويقارنه بالنماذج الرائدة المنافسة، ويوضح بالتفصيل كيف تستفيد منه.

Claude Opus 4.7: ما الجديد في أقوى نموذج لدى Anthropic
Cristian Da Conceicao
مؤسس Picasso IA

أطلقت Anthropic للتو Claude Opus 4.7، والتغييرات أعمق من إصدار تحديث اعتيادي. أصبح التفكير الموسّع قدرة قابلة للضبط بالكامل، وتتعامل المعالجة البصرية مع التعقيد المكاني الذي كان يربك النموذج سابقًا، وبلغ أداء البرمجة الوكيلية مستوى تصبح معه سير العمل الحقيقية متعددة الملفات موثوقة فعلًا. هذا شرح كامل لما تغيّر، ومعنى ذلك عمليًا، وكيفية توظيفه.

من 4.6 إلى 4.7: ما الذي تغيّر فعلًا

مقارنة Claude Opus 4.7 مع Claude Opus 4.6 لا تتعلق باختيار الفائز. الأمر يتعلق بمعرفة المجالات التي استثمرت فيها Anthropic جهدها الهندسي في هذه الدورة. والجواب: عمق الاستدلال، والدقة البصرية، والموثوقية في السياقات الطويلة. نال كل من هذه المجالات عملًا مستهدفًا، والنتيجة التراكمية نموذج يتعامل مع المهام المعقدة والممتدة بشكل أفضل ملحوظ من سابقه.

أيدٍ تكتب على لوحة مفاتيح MacBook في مساحة عمل حديثة، لقطة مقرّبة واقعية كالصور الفوتوغرافية

استدلال أذكى، وخطوات مهدورة أقل

أكثر التحولات وضوحًا في 4.7 هو طريقة تعامل النموذج مع سلاسل الاستدلال متعددة الخطوات. في الإصدارات السابقة، كانت المهام المنطقية المعقدة تنتج أحيانًا خطوات وسيطة مطوّلة تدور في حلقات أو تتكرر. في 4.7، أصبح مسار الاستدلال أكثر مباشرة. يُظهر النموذج ضغطًا أفضل لسلسلة التفكير: ما زال يعالج المسائل بعناية، لكنه يتخلص من المنطق الدائري بسرعة أكبر، ويصل إلى الإجابات بضجيج أقل في المخرجات.

يظهر ذلك بوضوح أكبر في:

  • الإجابة عن الأسئلة متعددة القفزات عبر مستندات طويلة
  • المسائل الكلامية الرياضية ذات القيود المضمّنة
  • مراجعة العقود والوثائق القانونية التي تتطلب ربط البنود ببعضها
  • مهام الاستدلال العلمي ذات سلاسل المنطق الشرطي

💡 فكّر في الأمر كالفرق بين مفكّر جيد يشرح كل شيء بالكلام، ومحترف بارع لا يقول إلا ما يهم. العمل الأساسي واحد، لكن المخرجات أكثر إحكامًا.

رؤية تواكب المطلوب

يعالج Claude Opus 4.7 الصور بفهم مكاني أفضل بشكل ملحوظ. كانت إصدارات Opus السابقة تخطئ أحيانًا في تحديد مواقع الأجسام داخل الصور، أو تخلط بين العناصر الأمامية والخلفية. يقلّل الإصدار 4.7 هذه الأخطاء بشكل كبير في:

  • قراءة المخططات والرسوم البيانية، خاصة الأعمدة المكدسة ومخططات الانتشار التي تتداخل فيها نقاط البيانات
  • تحليل لقطات واجهات المستخدم لأغراض الاختبار الآلي وسير عمل إمكانية الوصول
  • معالجة صور المستندات عندما يتداخل النص مع العناصر البصرية بكثافة
  • قراءة المخططات التقنية في السياقات الهندسية والعلمية

التحسن ليس طفيفًا. سير العمل التي كانت تتطلب عدة أوامر نصية لتوجيه النموذج على صورة ما أصبح يعمل بموثوقية من المحاولة الأولى.

وضع التفكير الموسّع، بالشرح

من أهم الإضافات في 4.7 ميزة التفكير الموسّع المُقنّنة. ظهرت هذه الميزة في إصدارات Claude السابقة بشكل محدود، لكن 4.7 يجعلها قدرة من الدرجة الأولى قابلة للضبط، ويمكنك التحكم بها صراحةً عبر API أو واجهة الدردشة.

لقطة علوية من الجو لمكتب باحث يضم أوراقًا مطبوعة وملاحظات مكتوبة بخط اليد وفنجان إسبريسو

كيف تعمل توكنات التفكير

عند تفعيل التفكير الموسّع، يخصص النموذج ميزانية توكنات تفكير منفصلة قبل إنتاج ردّه النهائي. تغذّي هذه التوكنات الاستدلال الداخلي الذي لا يعرضه النموذج على المستخدمين إلا إذا طلبت ذلك. يسير التدفق كالتالي:

  1. ترسل أمرًا نصيًا مع تفعيل التفكير الموسّع
  2. يستخدم النموذج ميزانية توكنات التفكير لاستدلال المشكلة داخليًا
  3. يعكس الرد النهائي الاستنتاجات التي تم التوصل إليها خلال تلك العملية الداخلية
  4. يمكنك اختياريًا فحص محتوى التفكير مباشرة في استجابة API

ميزانية التوكنات للتفكير قابلة للضبط بالكامل. يمكنك خفضها إلى 1,000 توكن للمهام البسيطة، أو رفعها إلى 32,000 توكن للاستدلال المعقد متعدد الأجزاء. كلما زادت ميزانية التفكير، كانت المعالجة أشمل، لكنها تعني أيضًا زمن استجابة أعلى وتكلفة أكبر لكل طلب.

ميزانية التفكيرالأنسب للاستخدامالموازنة
1,000 إلى 4,000التلخيص المنظم، الأسئلة والأجوبة البسيطةسريع، فعّال من حيث التكلفة
8,000 إلى 16,000مراجعة الكود، مهام التقييم المعمّقمتوازن
16,000 إلى 32,000تجميع الأبحاث، سلاسل الاستدلال المعقدةأبطأ، وأشمل

متى تفعّله

التفكير الموسّع ليس الخيار الصحيح دائمًا. إليك الحالات التي يحدث فيها فرق ملموس:

فعّله من أجل:

  • مسائل التحسين متعددة القيود
  • المهام التي تتطلب من النموذج الاحتفاظ بشروط كثيرة في وقت واحد
  • الأعمال القانونية أو المالية أو العلمية التي لا تقبل التنازل عن الدقة
  • خطوط العمل الوكيلية التي تؤدي فيها خطوة أولى خاطئة إلى إخفاقات أكبر

أوقفه من أجل:

  • عمليات البحث البسيطة عن الحقائق
  • مهام الكتابة الإبداعية القصيرة
  • الردود الحوارية التي تكون فيها السرعة مهمة
  • تطبيقات الإنتاج عالية الإنتاجية والحساسة لزمن الاستجابة

💡 فعّل التفكير الموسّع عندما تكون الأخطاء مكلفة، لا فقط عندما تبدو المهمة معقدة.

أداء برمجي يلفت الانتباه

كانت البرمجة مجالًا قويًا بالفعل في Claude Opus 4.6. في 4.7، دفعت Anthropic الأمور أبعد مع تركيز محدد على مهام البرمجة الوكيلية، أي المواقف التي يجب فيها على النموذج أن يخطط وينفّذ ويصحح نفسه عبر خطوات متتابعة دون تدخل بشري في كل مرحلة.

مهندس برمجيات مركّز يدرس شاشتين عريضتين جدًا تعرضان شيفرة IDE داكنة

أرقام SWE-bench تستحق الاهتمام

SWE-bench هو الاختبار المعياري المعتمد لتقييم قدرة الذكاء الاصطناعي على حل مشكلات GitHub الحقيقية في المستودعات مفتوحة المصدر. يحقق Claude Opus 4.7 نتائج من الدرجة الأولى في هذا الاختبار، ويتنافس مباشرة مع أفضل نماذج البرمجة المتاحة. تعكس مكاسب الأداء تحسينات حقيقية في:

  • تحديد موقع الخلل: إيجاد الملف والدالة الدقيقين المسؤولين عن الخطأ
  • توليد التصحيحات: كتابة إصلاح ينجح في الاختبارات الحالية دون كسر الوظائف المجاورة
  • كتابة الاختبارات: توليد حالات اختبار جديدة تغطي السلوك المُصلح تغطية فعّالة
  • إعادة الهيكلة تحت القيود: إعادة تنظيم الكود مع الحفاظ على سلوكه والالتزام بقواعد أدوات الفحص

هذه ليست تحسينات أكاديمية. فهي تترجم مباشرة إلى تقليل الأخذ والرد عند استخدام Claude في سير عمل التطوير الفعلي.

مهام وكيلية يتولاها وحده

بعيدًا عن إصلاحات الملف الواحد، يتعامل 4.7 مع سير عمل البرمجة الوكيلية متعددة الملفات بموثوقية أكبر من سابقه. هذا يعني أن النموذج يستطيع:

  • قراءة بنية المستودع وتحديد الاعتماديات قبل لمس أي كود
  • إجراء تغييرات منسقة عبر عدة ملفات بالترتيب الصحيح
  • تشغيل الاختبارات وتفسير الإخفاقات وتصحيح نفسه دون مدخلات بشرية في كل خطوة
  • كتابة رسائل الإيداع التي تعكس بدقة ما تغيّر ولماذا

بالنسبة إلى الفرق التي تشغّل Claude في خطوط CI، أو أتمتة مراجعة الكود، أو توليد التوثيق، فهذه أكثر الترقيات تأثيرًا في إصدار 4.7. أصبح النموذج موثوقًا بما يكفي لتولي المهمة من البداية إلى النهاية، بدلًا من إعادتها عند كل نقطة احتكاك.

استخدام الحاسوب صار جادًا

قدّمت Anthropic ميزة استخدام الحاسوب مع Claude 3.5. كانت نموذجًا أوليًا لافتًا. في Claude Opus 4.7، انتقل استخدام الحاسوب من عرض مثير للإعجاب إلى شيء يمكنك فعلًا بناء سير عمل إنتاجي عليه.

لقطة مقرّبة لشاشة محرر شيفرة IDE داكن تعرض تمييزًا ملونًا للصيغة

ما الذي يتحكم به على الشاشة

تتيح واجهة API لاستخدام الحاسوب لنموذج Claude Opus 4.7 التفاعل مع سطح المكتب عبر لقطات الشاشة والمدخلات المحاكاة. في 4.7، يمكنه:

  • ينقر على عناصر الواجهة بناءً على موقعها البصري
  • يكتب في حقول النص والنماذج مع إدارة صحيحة للتركيز
  • يمرر عبر الصفحات والمستندات الطويلة
  • يلتقط ويقرأ لقطات الشاشة لتقييم أفعاله وتصحيح نفسه
  • ينتقل بين التطبيقات وألسنة المتصفح كجزء من سير العمل

هذا يجعله مفيدًا فعلًا في:

  • سير عمل جمع البيانات من الويب التي تتطلب تفاعلًا بدلًا من التحليل الثابت
  • ملء النماذج تلقائيًا عبر البوابات التي لا تملك واجهات API عامة
  • خطوط اختبار واجهة المستخدم لتطبيقات الويب
  • أتمتة إدخال البيانات عبر الأنظمة القديمة التي لا تملك واجهة برمجية

حدود حقيقية يجب تذكرها

استخدام الحاسوب في 4.7 أفضل، لكنه ليس معصومًا. القيود الجديرة بالملاحظة:

  • المحتوى الديناميكي مثل الرسوم المتحركة وحالات التمرير فوق العناصر والعناصر التي تُحمَّل تلقائيًا قد يسبب ارتباكًا مكانيًا
  • واجهات المستخدم عالية الكثافة قد تحتاج إلى أوصاف صريحة للعناصر لتقليل النقرات الخاطئة
  • الإجراءات الحساسة أمنيًا ومنها نماذج الدفع وتدفقات المصادقة ما زالت تستلزم تأكيدًا بشريًا
  • زمن الاستجابة يتراكم: كل دورة من لقطة الشاشة ثم الفعل ثم لقطة شاشة أخرى تستغرق وقتًا وتوكنات، لذا ينبغي تصميم التسلسلات الآلية الطويلة مع نقاط تحقق

💡 يعمل استخدام الحاسوب بأفضل صورة عندما تصف بنية الواجهة مسبقًا وتزوّد النموذج بمعايير نجاح واضحة قبل أن يبدأ التنفيذ.

العمق متعدد الوسائط: الصور والمستندات

Claude Opus 4.7 نموذج متعدد الوسائط حقًا، وليس نموذجًا نصيًا يتحمل الصور فقط. في 4.7، أدخلت Anthropic تحسينات مستهدفة على قراءة الصور ومعالجة المستندات معًا، وجعلت نافذة السياق البالغة 200K كلًا منهما أكثر عملية بكثير.

امرأة محترفة تقرأ جهازًا لوحيًا في قاعة اجتماعات حديثة بجدران زجاجية

قراءة الصور بدقة

يعالج النموذج الصور الآن بفهم دلالي أدق: يستوعب العلاقة بين العناصر البصرية، لا وجودها الفردي فحسب. وتظهر النتائج العملية عبر أنواع الصور المختلفة:

  • المخططات الموضحة: يربط التسميات بالمكونات بشكل صحيح حتى عندما تكون أسهم الوصل غير مباشرة أو متقاطعة
  • الصور الطبية والعلمية: يحدد مناطق الاهتمام دون أن يقع في الهلوسة بشأن نتائج غير موجودة
  • تصوير المنتجات: يصف بدقة الخصائص مثل اللون، وتشطيب المادة، والتوجه المكاني
  • الصور التوثيقية: يميّز بموثوقية بين الأشخاص في المقدمة والسياق المحيط

تتيح نافذة السياق البالغة 200K توكن تضمين عدة صور عالية الدقة في طلب واحد إلى جانب نص واسع. وهذا مهم لحالات مثل:

  • مقارنة إصدارين لمنتج جنبًا إلى جنب من خلال الصور الفوتوغرافية
  • مراجعة سلسلة من حالات الواجهة عبر تدفق مستخدم كامل
  • معالجة دفعة من المستندات تحمل فيها المخططات والجداول قدرًا من المعلومات يعادل النص

معالجة المستندات الطويلة

تحافظ نافذة السياق البالغة 200K على موثوقيتها عبر مهام المستندات الطويلة. فبينما تفقد نماذج كثيرة دقتها بعد نحو 50,000 توكن، يحافظ 4.7 على أداء ثابت عند 100,000 توكن فأكثر في مهام مثل:

  • العقود القانونية ذات الإحالات المتقاطعة المعقدة بين البنود
  • الأدلة التقنية التي تتطلب مقارنة قسم بقسم
  • التقارير المالية ذات جداول البيانات متعددة السنوات
  • الأوراق الأكاديمية ذات سلاسل الاستشهاد الواسعة

يتعامل النموذج مع تدهور "الضياع في المنتصف" بشكل أفضل من الأجيال السابقة، أي أن المعلومات المدفونة في وسط مستند طويل تُسترجع بالدقة نفسها التي يُسترجع بها المحتوى في البداية أو النهاية. وبالنسبة إلى سير عمل المستندات في العالم الحقيقي، غالبًا ما تكون هذه الموثوقية على نطاق واسع أثمن من القدرة الخام في المهام القصيرة.

Opus 4.7 مقابل المنافسين

لا يوجد Claude Opus 4.7 بمعزل عن غيره. فمساحة النماذج الرائدة مزدحمة بمنافسين أقوياء. إليك مقارنة جانبية صريحة.

شاب يقرأ محادثة ذكاء اصطناعي على هاتف ذكي على طاولة خشبية في مقهى، ضوء الصباح

GPT-5 وGemini 3 Pro وDeepSeek R1

النموذجالاستدلالالبرمجةالرؤيةالسياقاستخدام الحاسوب
Claude Opus 4.7من الدرجة الأولى مع التفكير الموسّعبرمجة وكيلية من الطراز الأفضلفهم مكاني قوي200Kنعم، جاهز للإنتاج
GPT-5استدلال عام قويممتازةدقة عالية128Kمحدود
Gemini 3 Proاستدلال متعدد الوسائط قويجيدةفيديو وصور أصلية1Mلا
DeepSeek R1الأفضل في الرياضيات والمنطق بتكلفة أقلقويةمحدودة128Kلا

الصورة الصادقة: يتقدم Claude Opus 4.7 في البرمجة الوكيلية واستخدام الحاسوب. ينافس GPT-5 بقوة في الاستدلال العام، ويتعامل مع استخدام الأدوات بموثوقية مشابهة. يتفوق Gemini 3 Pro في معالجة الفيديو الأصلية وطول السياق الخام. ويبقى DeepSeek R1 الخيار الأقوى للاستدلال الرياضي البحت بتكلفة أقل.

بالنسبة إلى الفرق التي تحتاج نموذجًا يكتب الكود ويقرأ الشاشات ويعالج المستندات ويستدل على المسائل المعقدة داخل سير عمل واحد، يمثل 4.7 أقوى خيار متاح الآن.

كيفية استخدام Claude Opus 4.7 على PicassoIA

Claude Opus 4.7 متاح مباشرة على PicassoIA، ما يعني أنه يمكنك الوصول إليه دون إعداد بيانات اعتماد API، أو إدارة حسابات الفوترة، أو تشغيل أي بنية تحتية محلية.

لقطة واسعة الزاوية لمختبر أبحاث ذكاء اصطناعي حديث تصطف فيه محطات العمل صفوفًا

الوصول خطوة بخطوة

البدء يستغرق نحو دقيقتين:

  1. انتقل إلى صفحة Claude Opus 4.7 على PicassoIA
  2. سجّل الدخول أو أنشئ حسابًا مجانيًا
  3. اختر Claude Opus 4.7 من قائمة النماذج
  4. اختر وضع المهمة: Chat أو Code أو Document
  5. بالنسبة إلى المهام المعقدة، فعّل التفكير الموسّع قبل الإرسال
  6. أرسل أمرك النصي وكرّر التجربة انطلاقًا من الرد

لا حاجة إلى مفتاح API. لا إعدادات فوترة. لا تثبيت محلي. يعمل النموذج داخل المتصفح.

نصائح للأوامر النصية تنجح

الحصول على نتائج قوية من Claude Opus 4.7 يعتمد على التحديد الدقيق، لا على عبارات سحرية:

لمهام البرمجة:

  • قدّم رسالة الخطأ كاملة، لا صياغة عنها
  • حدّد إصدار اللغة والإطار الدقيقين اللذين تستخدمهما
  • اذكر السلوك المتوقع مقابل السلوك الذي تلاحظه فعليًا

للتقييم المعمّق والاستدلال:

  • اذكر قيودك في البداية، لا مدفونة في آخر أمر طويل
  • اطلب تفصيلًا خطوة بخطوة بشكل صريح عندما تكون الدقة مهمة
  • حدّد شكل المخرجات التي تحتاجها: جدول، أو قائمة مرقمة، أو نص سردي

لمهام الصور والمستندات:

  • صف ما تبحث عنه بتحديد، لا بعبارات عامة
  • عند مقارنة عنصرين، اسأل بشكل مباشر: "ما الفرق بين A وB؟"
  • بالنسبة إلى المستندات الطويلة، اربط سؤالك بقسم أو موضوع محدد لتقليل نطاق البحث

💡 النموذج يكافئ التحديد. الأوامر الغامضة تنتج إجابات غامضة مهما كان النموذج قادرًا. القيود الواضحة تنتج ردودًا أكثر إحكامًا وقابلية للتطبيق.

يد امرأة تمسك هاتفًا ذكيًا حديثًا تظهر على شاشته واجهة دردشة بسيطة

ما لا تلتقطه المعايير

تلتقط الأرقام الأداء في المهام المعيارية. لكنها لا تلتقط طابع الاستخدام الفعلي: كيف يصمد النموذج خلال جلسة تستغرق ساعة، وهل يحافظ على السياق بموثوقية عبر أدوار المحادثة الكثيرة، وهل رفضه للطلبات معايَر جيدًا أم مزعج بإفراط.

يصمد Claude Opus 4.7 جيدًا في الجوانب الثلاثة:

  • تماسك الجلسة: يحتفظ النموذج بالسياق السابق ويشير إليه بشكل صحيح في المحادثات الطويلة دون انحراف أو تناقض مع نفسه
  • ثقة معايَرة: يعبّر عن عدم اليقين عندما يكون غير متأكد فعلًا، بدلًا من تقديم إجابات خاطئة بثقة تستلزم التحقق من الحقائق
  • جودة الرفض: يعتذر عن الطلبات الحدّية بتفسيرات واضحة بدلًا من الحجب الصارم، ما يجعل إعادة صياغة الطلب سهلة عند الحاجة

بالنسبة إلى تطبيقات الإنتاج، تهم هذه العوامل النوعية بقدر أهمية درجات المعايير. فالنموذج الذي يحل 10% أكثر من المشكلات على الورق، لكنه يحجب طلبات مشروعة بشكل غير متوقع، يخلق احتكاكًا تشغيليًا أكبر لا أقل.

لماذا يهم هذا الإصدار للذكاء الاصطناعي الوكيلي

الاتجاه واضح لا لبس فيه. لا تحسّن Anthropic Claude Opus 4.7 لتفاعلات الدردشة ذات الدور الواحد. إنها تبني نموذجًا مصممًا للعمل داخل خطوط الأتمتة: ينفّذ الإجراءات، ويتحقق من النتائج، ويتعافى من الأخطاء، ويدير سير العمل من البداية إلى النهاية دون توجيه بشري مستمر.

امرأة محترفة في استوديو إبداعي أمام شاشة كبيرة تعرض تصورات بيانات ملونة

يجعل هذا 4.7 ذا صلة خاصة بالفئات التالية:

  • فرق البرمجيات التي تبني وكلاء ذكاء اصطناعي داخليين لمراجعة الكود والتوثيق والاختبار الآلي
  • فرق العمليات التي تستبدل سير العمل اليدوي المتكرر عبر الأنظمة القديمة
  • فرق البحث التي تعالج وتجمع مجموعات كبيرة من المستندات على نطاق واسع
  • فرق المنتجات التي تستخدم استخدام الحاسوب لأتمتة دورات اختبار ضمان الجودة دون كتابة نصوص اختبار هشة

التحول من "ذكاء اصطناعي يجيب عن الأسئلة" إلى "ذكاء اصطناعي يتولى المهام من البداية إلى النهاية" بدأ بالفعل. وClaude Opus 4.7 من أكثر الأدوات قدرة المتاحة لإجراء هذا التحول في سير عملك اليوم.

ضعه موضع العمل

إذا كنت لم تستخدم الذكاء الاصطناعي إلا للكتابة أو البحث السريع، فإن Claude Opus 4.7 يستحق أن تختبره على مهمة صعبة. تظهر الفجوات المهمة في المهام المتواصلة والمعقدة: جلسة برمجة من 20 رسالة، ومراجعة عقد من 80 صفحة، أو سير عمل بحثي متعدد الخطوات حيث يتضاعف استنتاج خاطئ واحد إلى عدة أخطاء لاحقة.

يمنحك PicassoIA الوصول إلى Claude Opus 4.7 إلى جانب كامل كتالوج النماذج الرائدة: GPT-5، وGemini 3 Pro، وDeepSeek R1، وClaude 4 Sonnet، وClaude 4.5 Sonnet. يمكنك تشغيل المهمة الصعبة نفسها عبر عدة نماذج ورؤية بنفسك أين يثبت 4.7 جدارته.

ابدأ من هنا. شغّل شيئًا صعبًا. وشاهد ما يستطيع النموذج فعلًا القيام به.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة