شرح Gemini 3: ما الجديد في أقوى نموذج ذكاء اصطناعي من Google

يقدّم Gemini 3 من Google نواة استدلال أعيد تصميمها، ونموذجين متخصصين، ونافذة سياق بحجم 2 مليون توكن، ومعالجة متعددة الوسائط أصيلة للنصوص والصور والشيفرة البرمجية والصوت، ونتائج في الاختبارات المعيارية تنافس كل نموذج أُطلق في 2026. إليك ما تغيّر، ولماذا يهم، وكيف تستفيد منه.

شرح Gemini 3: ما الجديد في أقوى نموذج ذكاء اصطناعي من Google
Cristian Da Conceicao
مؤسس Picasso IA

لم تأتِ عائلة Gemini 3 من Google بسجل تغييرات هادئ. فعند إطلاق Gemini 3 Pro وGemini 3 Flash، صارت الاختبارات المعيارية محور كل نقاش حول الذكاء الاصطناعي: 93.4% في MMLU، ودرجات شبه مثالية في HumanEval، ونافذة سياق بحجم 2 مليون توكن تعيد تعريف معنى "معالجة المستندات الطويلة". الأرقام الخام تروي جزءًا فقط من القصة. ما الذي تغيّر فعلًا في Gemini 3، ولماذا تهم هذه التغييرات عمليًا، وكيف يمكنك استخدامه الآن؟ هذه هي الأسئلة التي تستحق الإجابة.

ما هو Gemini 3 فعلًا

Gemini هي سلسلة النماذج الرائدة لدى Google DeepMind. أُطلق الجيل الأول في أواخر 2023 كردّ متعدد الوسائط على GPT-4. وتلاه Gemini 2 في أوائل 2025 مع تحسينات كبيرة في الاستدلال والسرعة. أما Gemini 3 فليس تحديثًا تدريجيًا: فقد أُعيد تصميم البنية بشكل جوهري، وأُعيد بناء خط معالجة بيانات التدريب، وأُعيدت هندسة القدرات متعددة الوسائط من الصفر بدلًا من إلحاقها لاحقًا.

مختص يراجع مخرجات الذكاء الاصطناعي على شاشة عريضة جدًا في مكتب منزلي مشرق

إصداران، ومهمتان

تأتي عائلة Gemini 3 في شكلين:

  • Gemini 3 Pro: النموذج كامل الإمكانات. أفضل استدلال، وأعلى دقة، ويدعم نافذة السياق بحجم 2M توكن. أبطأ وأكثر استهلاكًا للموارد من Flash، لكنه الخيار الصحيح عندما لا يمكن التنازل عن الجودة.
  • Gemini 3 Flash: نسخة مقطّرة مُحسّنة للسرعة والتكلفة. أسرع من Pro بنحو 4x، وتتعامل مع أنواع المدخلات نفسها، ودقيقة بما يكفي لغالبية المهام الواقعية. الخيار العملي للتطبيقات ذات الحجم الكبير.

يعكس هذا التقسيم بين Pro وFlash ما نجح في Gemini 2.5، حيث أصبح Gemini 2.5 Flash التوصية الافتراضية لمعظم المطورين. الفرق مع Gemini 3 أن الفجوة في القدرات بين Flash وPro تقلّصت بشكل ملحوظ. فإصدار Flash من الجيل الثالث يتفوق على إصدار Pro من الجيل الثاني في معظم الاختبارات المعيارية القياسية.

💡 متى تختار Flash: إذا كان استخدامك يشمل المحادثة، أو التلخيص، أو الأسئلة والأجوبة على المستندات، أو مراجعة الشيفرة حيث تهم الاستجابات التي تقل عن ثانية، فإن Flash هو نقطة البداية الصحيحة. انتقل إلى Pro حين تكون الدقة في الاستدلال المعقد متعدد الخطوات هي الأولوية.

ما الذي تغيّر على مستوى البنية

لم تنشر Google DeepMind تفاصيل البنية الكاملة، لكن هناك تغييرات ملموسة موثّقة:

  1. مزيج الخبراء (MoE) على نطاق واسع: يستخدم Gemini 3 تصميم MoE متفرّقًا أكثر جرأة من Gemini 2، ما يقلل تكلفة التشغيل دون تقليص سعة النموذج.
  2. طبقات الانتباه المتداخلة: تعالج بنية الانتباه الآن أنواع المدخلات المختلفة (النص، وتوكنات الصور، وتوكنات الصوت) بطريقة متداخلة بإحكام بدلًا من تكديسها تتابعيًا، ما يحسّن الترابط بين الوسائط.
  3. تدريب ما بعد التدريب الموسّع: محاذاة بأسلوب RLHF وConstitutional AI مع مجموعة بيانات تفضيلات بشرية أكبر بكثير.

القفزات الحقيقية في الاستدلال

كان أداء الاستدلال أوضح مجالات التحسن من Gemini 2.5 إلى Gemini 3. ويهم ذلك لأن مهام الاستدلال، بما فيها المسائل الرياضية والمنطق متعدد الخطوات وتوليد الشيفرة والأسئلة العلمية، تمثل الجزء الأصعب مما تحتاج النماذج اللغوية الكبيرة (LLM) إلى إنجازه.

فريق من علماء البيانات يراجعون مخططات مقارنة الاختبارات المعيارية على شاشة في مكتب تقني حديث

وضع التفكير المدمج

يتضمن Gemini 3 Pro وضع تفكير مدمجًا يمرّر الاستفسارات المعقدة بما يكفي عبر سلسلة تفكير موسّعة قبل توليد الإجابة النهائية. ولا يحدث ذلك عبر أمر نصي منفصل، بل تلقائيًا بناءً على تصنيف الاستفسار. والنتيجة أن المستخدمين الذين يسألون عن البراهين الرياضية أو الاستدلال العلمي أو معمارية الشيفرة المعقدة يحصلون على إجابات أفضل بوضوح دون أن يطلبوا صراحةً استدلالًا خطوة بخطوة.

مقارنةً بنماذج منافسة مثل GPT 5 وClaude Opus 4.7، يُظهر Gemini 3 Pro أداءً قويًا بشكل خاص في المهام التي تتطلب الجمع بين خطوات استدلال متعددة واسترجاع الحقائق، وهي فئة كانت إصدارات Gemini السابقة تقصّر فيها.

ما الذي تُظهره الاختبارات المعيارية فعلًا

الاختبار المعياريGemini 3 ProGPT 5Claude Opus 4.7
MMLU93.4%91.8%90.6%
HumanEval (الشيفرة)94.1%92.4%91.9%
MATH91.7%90.3%89.8%
GPQA (العلوم)87.3%85.1%84.9%

ملاحظة: تختلف نتائج الاختبارات المعيارية باختلاف إعدادات التقييم. وتعكس هذه الأرقام القيم المعلنة علنًا وقت الإطلاق.

الفوارق ليست كبيرة، لكنها ثابتة: يتصدر Gemini 3 Pro الاختبارات المعيارية التي تعتمد على الاستدلال بشكل عام. أما Deepseek R1 فيتفوق على Gemini 3 في مسائل المسابقات الرياضية البحتة (AIME وAMC)، حيث يمنحه التدريب المخصص على سلسلة التفكير أفضلية هناك.

متعدد الوسائط دون تحفظات

قُدّمت إصدارات Gemini السابقة على أنها "متعددة الوسائط أصيلًا"، لكن عمليًا كان أداء الرؤية غير ثابت، واقتصرت معالجة الصوت على التفريغ النصي لا على الفهم الدلالي الحقيقي. يغيّر Gemini 3 هذا بطرق يلاحظها المستخدم فورًا في الاستخدام الفعلي.

امرأة تبتسم وهي تستخدم جهازًا لوحيًا مع واجهة محادثة بالذكاء الاصطناعي متعددة اللغات في شقة حديثة

رؤية تعمل فعلًا

يتعامل إدخال الصور في Gemini 3 مع:

  • تحليل المستندات الكثيفة: قراءة الجداول والمخططات وتخطيطات النص المختلط بالصور بدقة عالية
  • الاستدلال البصري: الإجابة عن أسئلة تتطلب فهم العلاقات المكانية داخل الصورة
  • قراءة لقطات الشاشة: تفسير لقطات واجهات المستخدم، ولقطات الشيفرة البرمجية، والإنفوجرافيك
  • إدخال عدة صور: معالجة الصور المتعددة والاستدلال عبرها ضمن أمر نصي واحد

يعني ذلك عمليًا أن سير العمل الذي كان يحتاج سابقًا إلى نماذج OCR أو رؤية متخصصة يمكن غالبًا دمجه ضمن استدعاء API واحد لنموذج Gemini 3.

الصوت كمدخل من الدرجة الأولى

يقبل Gemini 3 Pro ملفات الصوت الخام ويجري فهمًا دلاليًا حقيقيًا، لا مجرد تحويل من الكلام إلى نص. يمكنك أن تطلب منه تلخيص بودكاست، أو تحديد النبرة العاطفية في محادثة، أو استخراج بنود العمل من تسجيل اجتماع.

يضعه هذا متقدمًا على Grok 4 وKimi K2 من حيث اتساع القدرات متعددة الوسائط، فكلاهما يملك قدرات قوية في النص والرؤية لكن معالجتهما للصوت أقل نضجًا.

نافذة السياق تغيّر كل شيء

تُعد نافذة السياق بحجم 2 مليون توكن في Gemini 3 Pro المواصفة التي تثير أكبر قدر من النقاش. للمقارنة: يتسع 1 مليون توكن لنحو 750,000 كلمة، أي ما يقارب 10 روايات كاملة الطول. أما 2 مليون توكن فيتسع لقاعدة شيفرة برمجية كاملة، أو مستودع مستندات قانونية، أو عدة أشهر من سجلات الدردشة.

لقطة مقرّبة ليدَي امرأة تكتبان بسرعة على لوحة مفاتيح حاسوب محمول، وضوء الصباح الجانبي يلقي ظلالًا بين المفاتيح

ما الذي يتسع فعلًا الآن

نوع المحتوىعدد التوكنات التقريبي
ملف PDF من 1,000 صفحةنحو 750,000 توكن
قاعدة شيفرة كاملة (تطبيق متوسط)نحو 500,000 توكن
10 ساعات من نصوص الاجتماعاتنحو 900,000 توكن
أرشيف بريد إلكتروني لخمس سنواتنحو 1,500,000 توكن

السؤال الأكثر إثارة ليس ما الذي يتسع، بل ما إذا كان النموذج يستخدم فعلًا المعلومات من السياق الكامل. يُظهر Gemini 3 Pro تحسنًا ملحوظًا في أداء اختبار "الإبرة في كومة القش" عند أطوال السياق القصوى مقارنةً بنموذج Gemini 2.5، ما يعني أنه يسترجع المعلومات المحددة من أعماق بعيدة داخل مستند طويل بموثوقية.

أين يصبح السياق الطويل عمليًا

بالنسبة للمطورين، تتيح نافذة السياق الكبيرة أنماطًا لم تكن ممكنة من قبل:

  • الأسئلة والأجوبة على قاعدة الشيفرة الكاملة: حمّل مستودعًا كاملًا واطرح أسئلة معمارية
  • مقارنة المستندات الطويلة: قارن عدة عقود أو تقارير مطولة في وقت واحد
  • ذاكرة محادثة مستمرة: احتفظ بسجل محادثات يمتد لأشهر داخل السياق دون استرجاع خارجي
  • معالجة البيانات دفعةً واحدة: شغّل مجموعات بيانات كبيرة عبر أمر نصي واحد بدلًا من تقسيمها

💡 اعتبار التكلفة: تكلّف السياقات الأطول مزيدًا من المال لكل توكن بشكل يتناسب مع طولها. وغالبًا ما يكون Gemini 3 Flash الخيار الأفضل لحالات الاستخدام ذات الحجم الكبير والسياق الطويل حين لا تكون دقة مستوى Pro مطلوبة.

Gemini 3 مقابل المنافسة

المشهد التنافسي لنماذج اللغة الكبيرة في 2027 تنافسي فعلًا. والحكم بشكل قاطع على أي نموذج واحد بأنه "الأفضل" دون تحديد المهمة غير دقيق ببساطة.

مهندس برمجيات يراجع مخططات معمارية للذكاء الاصطناعي على جهاز لوحي في ممر غرفة خوادم حديثة

في مواجهة GPT-5 وClaude Opus

يظل GPT 5 منافسًا قويًا في الكتابة الإبداعية وتوليد الشيفرة، مع أسلوب استجابة يفضله كثير من المستخدمين للتطبيقات الحوارية. واتباعه للتعليمات دقيق، ويتعامل مع أوامر النظام المعقدة بموثوقية.

يتصدر Claude Opus 4.7 المهام التي تتطلب الالتزام الدقيق بالتعليمات الدقيقة، وجودة الكتابة الطويلة. ومحاذاته للسلامة أكثر تحفظًا، وهذا قد يكون ميزة أو عيبًا حسب حالة الاستخدام.

تتلخص مزايا Gemini 3 Pro على المنافسين في ثلاثة مجالات:

  1. اتساع الوسائط: أنواع مدخلات أكثر تُعالج بشكل أصيل
  2. حجم نافذة السياق: 2 مليون توكن مقابل 128 ألف توكن لنموذج GPT 5 و200 ألف توكن لنموذج Claude Opus 4.7
  3. نتائج الاستدلال في الاختبارات المعيارية: مراكز متقدمة باستمرار (الأول أو الثاني) في التقييمات القياسية

أين يقصّر Gemini 3

الصراحة بشأن القيود مهمة:

  • أسلوب الكتابة الإبداعية: يُنتج GPT 5 و Claude Opus 4.7 نصوصًا تبدو أكثر طبيعية في كثير من مهام الكتابة
  • زمن استجابة API: زمن استجابة نموذج Pro مرتفع بما يكفي لإحداث توقفات ملحوظة في تطبيقات الدردشة الفورية؛ أما Flash فهو الخيار العملي لتلك الحالات
  • موثوقية البرمجة الوكيلية: يمكن أن يتفوق Llama 4 Maverick وKimi K2 على Gemini 3 في مهام البرمجة الوكيلية متعددة الخطوات
  • السعر عند الحجم الكبير: تسعير Gemini 3 Pro تنافسي، لكنه ليس الخيار الأرخص للنشر ذي الحجم الكبير

مقارنة السرعة والتكلفة

النموذجالمدخلات (لكل 1 مليون توكن)المخرجات (لكل 1 مليون توكن)زمن الاستجابة
Gemini 3 Proنحو 7$نحو 21$1.5-4 ثوانٍ TTFT
Gemini 3 Flashنحو 0.30$نحو 1.25$0.4-0.9 ثانية TTFT
GPT 5نحو 10$نحو 30$1.2-3 ثوانٍ TTFT
Claude Opus 4.7نحو 15$نحو 75$1.8-5 ثوانٍ TTFT

TTFT: الزمن حتى أول توكن. أرقام تقريبية قابلة للتغيير.

يبرز Gemini 3 Flash كأفضل قيمة في هذه المقارنة، إذ يقدم جودة قريبة من Pro بجزء بسيط من التكلفة. وللتطبيقات التي تكون فيها الميزانية قيدًا، يصعب الاعتراض على Flash.

ما الذي يختلف عن Gemini 2.5

منظر جوي من طائرة مسيّرة لحرم تقني حديث بمبانٍ زجاجية وأفنية خضراء مشذّبة

سيلاحظ المستخدمون القادمون من Gemini 2.5 Flash عدة فروق عملية في Gemini 3:

ما هو أفضل:

  • دقة الاستدلال في المسائل متعددة الخطوات (تحسّن بنحو 10-15% في الاختبارات المعيارية الداخلية)
  • جودة إدخال الرؤية، خاصة في الجداول والمخططات المعقدة
  • ثبات اتباع التعليمات: حالات أقل يتجاهل فيها النموذج القيود
  • توليد الشيفرة: أفضل في التعامل مع المتطلبات الغامضة وطرح أسئلة توضيحية

ما هو مختلف (وليس بالضرورة أفضل):

  • الإسهاب في الردود: يميل Gemini 3 Pro إلى أن يكون أكثر شمولًا افتراضيًا، وتساعد إضافة تعليمات "كن موجزًا" في التطبيقات الحساسة للاختصار
  • وضع التفكير يضيف زمن استجابة: الاستفسارات المعقدة التي تُفعّل الاستدلال الموسّع قد تستغرق 3-5 أضعاف زمن استجابة Gemini 2.5 العادي

تتوافق بنية API مع الإصدارات السابقة، ومنها Gemini 2.5، لذا يكون نقل التكاملات الحالية أمرًا مباشرًا.

استخدام Gemini 3 على PicassoIA

يتوفر كلا النموذجين Gemini 3 Pro وGemini 3 Flash على PicassoIA، مما يعني أنه يمكنك تجربة أيٍّ منهما دون إعداد بيانات اعتماد API أو إدارة الفوترة بشكل منفصل.

أستاذ يعرض شرائح اختبارات معيارية للذكاء الاصطناعي على طلاب دراسات عليا في قاعة محاضرات جامعية مشمسة

استخدام Gemini 3 Pro: خطوة بخطوة

  1. انتقل إلى صفحة النموذج Gemini 3 Pro على PicassoIA
  2. انقر على Try Model لفتح واجهة التشغيل
  3. أدخل أمرك النصي في حقل النص. يمكنك أيضًا إرفاق صورة أو مستند عبر أيقونة المرفقات
  4. بالنسبة لمهام الاستدلال المعقدة، أضف تعليمات صريحة مثل: "فكّر خطوة بخطوة قبل تقديم إجابتك النهائية" لتفعيل التفكير الموسّع
  5. اضبط شريط temperature: قيم أقل (0.1-0.3) للمخرجات الدقيقة والحتمية، وقيم أعلى (0.7-1.0) للمهام الإبداعية
  6. لتوليد الشيفرة، اضبط temperature على 0.2 وحدّد اللغة المستهدفة والإطار وقيود العمل في أمر النظام

💡 نصيحة متقدمة: عند معالجة مستندات طويلة مع Gemini 3 Pro، الصق نص المستند كاملًا أولًا، ثم اطرح سؤالك في النهاية. هذا يضع سؤالك في المنطقة الأكثر انتباهًا من نافذة السياق.

متى يكون Flash الخيار الصحيح

  • تطبيقات المحادثة: زمن الاستجابة أهم من تعظيم الدقة
  • التلخيص على نطاق واسع: معالجة عدد كبير من المستندات دفعات
  • مهام التصنيف: التوجيه، والوسم، واكتشاف المشاعر
  • المسودات الأولى: توليد أولي سريع ستراجعه وتصقله لاحقًا

يتعامل Gemini 3 Flash مع كل هذه المهام بجودة عالية مع تقليص زمن التشغيل بشكل كبير. ولمعظم المستخدمين الذين يبدؤون مع Gemini 3، يبقى Flash الخيار الأول الصحيح.

حالات استخدام حقيقية تستحق التجربة

باحثة في مكتبة مضاءة بمصباح مكتب دافئ وضوء نافذة بارد، تنظر إلى الأعلى بتأمل

هذه مجالات يُظهر فيها Gemini 3 تحسنات قابلة للقياس في الواقع مقارنةً بأسلافه ومنافسيه:

أعمال المستندات الكثيفة: ارفع عقدًا أو طلب عروض (RFP) أو ورقة بحثية من 200 صفحة، واطرح أسئلة محددة. تُلغي نافذة السياق بحجم 2M توكن الحاجة إلى تقسيم المستند، كما تتعامل إمكانات الرؤية مع ملفات PDF الممسوحة ضوئيًا التي تحتوي على جداول وأشكال.

الأسئلة والأجوبة على الشيفرة: الصق قاعدة شيفرة كبيرة أو حمّل مستودعًا واطرح أسئلة معمارية: "أين تتم معالجة المصادقة؟"، "ماذا سيتعطل إذا أزلت هذه الوحدة؟"، "اكتب اختبارات لتدفق الدفع."

المحتوى متعدد اللغات: يُظهر Gemini 3 Pro استدلالًا متعدد اللغات أقوى بكثير من Gemini 2.5، خاصة في اللغات قليلة الموارد. الترجمة، والتلخيص عبر اللغات، ودعم العملاء متعدد اللغات من أقوى حالات الاستخدام.

مراجعة الأدبيات العلمية: يشير أداء اختبار GPQA (87.3%) إلى تعامل قوي مع النصوص العلمية. يمكن للباحثين استخدام Gemini 3 Pro لتلخيص الأوراق البحثية، ومقارنة المنهجيات، وتحديد النتائج المتناقضة عبر مجموعة من الأدبيات.

معالجة الصوت والكلام: ارفع تسجيلات الاجتماعات أو المقابلات أو ملفات البودكاست. اطلب من Gemini 3 Pro استخراج القرارات أو بنود العمل أو ملخصات المتحدثين دون خطوة تفريغ نصي منفصلة.

ابدأ الإبداع على PicassoIA

هاتف ذكي يُمسك بيد واحدة ويعرض واجهة محادثة نظيفة بالذكاء الاصطناعي، وخلفيته ضبابية دافئة لمقهى

يُعد Gemini 3 واحدًا من أكثر نماذج الذكاء الاصطناعي قدرةً المتاحة في 2027، وكل من Gemini 3 Pro وGemini 3 Flash يعملان على PicassoIA الآن.

إذا كنت تعمل مع الصور وتريد دمج الذكاء الاصطناعي اللغوي مع الإنتاج الإبداعي، فإن PicassoIA يجمع كل شيء في مكان واحد. أنشئ المرئيات، واكتب نصوصًا تسويقية، وعالج المستندات، وشغّل النماذج اللغوية من Google و OpenAI و Anthropic و Meta، دون الحاجة إلى بيانات اعتماد API منفصلة أو سير عمل مجزأ.

أفضل طريقة لتكوين رأي حقيقي عن Gemini 3 هي تجربته على مهامك الفعلية. جرّب مستندًا كنت تواجه صعوبة في تلخيصه، أو مسألة برمجية علقت فيها، أو سؤالًا استدلاليًا أخفقت فيه نماذج أخرى. سيصبح فرق الأداء واضحًا بسرعة. افتح Gemini 3 Pro على PicassoIA وشاهد ما يفعله في مشروعك القادم.

شارك هذا المقال

اختر لغتك

مقالات ذات صلة