مقارنة بين Gemini 3.6 Flash وGemini 3.1 Pro: السعر، ونتائج الاختبارات القياسية، و6 اختبارات باستخدام نفس المطالبة

Gemini 3.6 Flash مقابل Gemini 3.1 Pro

Gemini 3.6 فلاش لم يمر الأمر مرور الكرام. فقد أطلقت «جوجل» هذا الإصدار باعتباره نسخة أسرع وأكثر كفاءة من «فلاش»، لكن رد فعل الكثيرين كان واحدًا: لحظة، أين الترقية إلى الإصدار «برو»؟

وهذا يجعل المقارنة أكثر إثارة للاهتمام من مجرد ورقة المواصفات العادية. Gemini 3.6 فلاش من المفترض أن تكون أرخص وأسرع وأكثر قوة في مجالات البرمجة والوكلاء والأعمال اليومية متعددة الوسائط. Gemini 3.1 Pro, وفي الوقت نفسه، لا تزال تحمل علامة “Pro”، وتركز على عمليات التفكير الأعمق والمهام الأكثر صعوبة.

لذا قمنا باختبارها بالطريقة الوحيدة التي تهم حقًّا: نفس المهمة، نفس المطالبة، نفس المدخلات، نفس قواعد التقييم.

في هذا الاستعراض، نقارن بين طرازي Gemini 3.6 Flash وGemini 3.1 Pro من خلال مهام حقيقية: rتوليف الأبحاث، وإصلاح الترميز، وتلخيص النصوص ذات السياق الطويل، والاستدلال على البيانات، وتحليل لقطات الشاشة، والكتابة المخصصة لتحسين محركات البحث (SEO). في كل جولة، يكون السؤال الرئيسي بسيطًا: أي ناتج سيكون من الأسهل الوثوق به وتعديله وإعادة استخدامه؟

إذا كنت ترغب في مقارنة الطرز دون فتح عدد كبير من علامات التبويب المنفصلة، فابدأ من مركز نماذج GLBGPT وتشغيل نفس الأمر عبر نماذج ذكاء اصطناعي متعددة قبل الوثوق بأي ادعاء يتعلق بالأداء. وهذا أمر مهم في هذا النوع من المراجعات، لأن الطريقة الوحيدة النزيهة لمقارنة النماذج هي تشغيل نفس المهمة عبرها ومقارنة النتائج.

حالة واجهة برمجة التطبيقات (API) الإصدار المستقر مقابل الإصدار التجريبي

يُصنف الإصدار Gemini 3.6 Flash على أنه «مستقر»؛ بينما يُصنف الإصدار Gemini 3.1 Pro على أنه «نسخة تجريبية».

سعر البيع الرسمي $7.50 مقابل $12+

لكل مليون توكن ناتج وفقًا لأسعار واجهة برمجة التطبيقات (API) المدفوعة القياسية، قبل طرح مستويات Pro ذات المطالبات الطويلة.

تشغيلنا باستخدام نفس المطالبة 4 انتصارات مقابل 2

فازت «فلاش» بأربع مهام تحريرية؛ بينما فازت «برو» بمهمتي توليف الأبحاث وتحليل لقطات الشاشة.

Gemini 3.6 Flash مقابل Gemini 3.1 Pro — إجابة سريعة

في اختبار واجهة برمجة التطبيقات (API) الذي أجريناه باستخدام نفس الموجهات، كان طراز Gemini 3.6 Flash هو الأفضل أداءً عمليًّا بشكل عام: وقد فازت بأربعة من أصل ستة تقييمات تحريرية على مستوى المهام، وقدمت مسودات أولية أكثر دقة في العديد من المهام العملية.

قدمت نسخة «Gemini 3.1 Pro Preview» توصيات بحثية أكثر ملاءمة للنشر وفقًا لمعايير تحسين محركات البحث (SEO)، بالإضافة إلى تدقيق أكثر شمولاً للقطات الشاشة. أما «Flash» فقد تعاملت بشكل أكثر فعالية مع مهام البرمجة، والسياقات الطويلة، والاستدلال على البيانات، وتحرير المحتوى وفقًا لمعايير تحسين محركات البحث (SEO).

إلى أين يقودنا «3.6 Flash» الآن فائدة المسودة الأولى

حقق «فلاش» نتائج أفضل في مجالات البرمجة، وتلخيص السياقات الطويلة، والاستدلال على البيانات، وتحرير محتوى تحسين محركات البحث (SEO)، مع الحفاظ على سهولة إعادة استخدام المسودة الأولى.

المجالات التي لا يزال بإمكان الإصدار 3.1 Pro التفوق فيها التفكير المنطقي ونقد أكثر تعمقاً لواجهة المستخدم

قدم «Pro» إجابة أكثر منطقية من حيث البيانات، بالإضافة إلى مراجعة أكثر تفصيلاً للقطات الشاشة، لا سيما عندما كانت الإجابة تتطلب نقدًا أكثر عمقًا.

ما لم يُحسم بعد أعباء عمل أطول وأكثر أهمية

استخدمت هذه الجلسة ست مهام API خاضعة للتحكم. ولا يُثبت ذلك أن كل حمل عمل في بيئة الإنتاج، أو مسار مزود الخدمة، أو طبقة ذات سياق طويل تتصرف بنفس الطريقة.

المواصفات الرسمية لـ Gemini 3.6 Flash مقابل Gemini 3.1 Pro

أعلنت شركة جوجل Gemini 3.6 فلاش في 21 يوليو 2026, ، إلى جانب طرازي Gemini 3.5 Flash-Lite وGemini 3.5 Flash Cyber. وفي منشور الإعلان عن الإطلاق هذا، تصف «جوجل» طراز 3.6 Flash بأنه نموذج Flash أكثر كفاءة في مجالات البرمجة، والأعمال المعرفية، والأداء متعدد الوسائط، وسير العمل التفاعلي.

تُدرج صفحة طراز Gemini الرسمية الخاصة بواجهة برمجة التطبيقات (API) رمز الطراز على النحو التالي: gemini-3.6-flash. وهي مصنفة على أنها «مستقرة»، وتدعم إدخال النصوص والصور ومقاطع الفيديو والمقاطع الصوتية وملفات PDF، وتُرجع مخرجات نصية. وتبلغ الحدود القصوى المحددة لعدد الرموز 1,048,576 رمزًا في الإدخال و65,536 رمزًا في الإخراج.

يُعد طراز Gemini 3.1 Pro نموذجًا من نوع مختلف. وقد أعلنت شركة جوجل Gemini 3.1 Pro في 19 فبراير 2026, ، حيث ركزت على المهام المعقدة والاستدلال المتقدم. وأعلنت «جوجل» أن النموذج يجري طرحه في مرحلة المعاينة للتحقق من صحة التحديثات قبل إتاحته للجمهور بشكل عام.

صفحة الإصدار الرسمية من Google لـ Gemini 3.6 Flash التي تُظهر تاريخ الإطلاق في 21 يوليو 2026.
Gemini 3.6 إعلان عاجل، تم تسجيله في 22 يوليو 2026.
صفحة الإصدار الرسمية لـ Google Gemini 3.1 Pro التي تعرض الإعلان الصادر في 19 فبراير 2026.
إعلان عن جهاز Gemini 3.1 Pro، تم تسجيله في 22 يوليو 2026.

عند مقارنة واجهات برمجة التطبيقات (API)، فإن التسمية الدقيقة لها أهمية كبيرة. تستخدم صفحة النموذج الرسمية جيميني-3.1-برو-برو-برو, ، وليس إصدار «Pro» الثابت. وتتمتع بنفس حدود الرموز المحددة للإدخال والإخراج مثل إصدار Gemini 3.6 Flash: 1,048,576 رمزًا للإدخال و65,536 رمزًا للإخراج. لتجربة إصدار «Pro» بعد قراءة المواصفات، افتح صفحة طراز Gemini 3.1 Pro وقم بتشغيل إحدى الأوامر الواردة في هذه المقالة.

إذا كنت بحاجة إلى دليل تفصيلي للإعداد بدلاً من الملاحظات النصية حول كود النموذج، فإن دليل استخدام Gemini 3.1 Pro تعد هذه الخطوة التالية الأكثر دقة قبل البدء في اختبار المطالبات.

صفحة نموذج Gemini API تُظهر نموذج «gemini-3.6-flash» باعتباره نموذجًا مستقرًا مع نافذة سياق إدخال تبلغ 1M.
gemini-3.6-flash يُصنف على أنه «مستقر» مع نافذة إدخال تبلغ 1 مليون توكن.
صفحة نموذج API Gemini التي تعرض نموذج «gemini-3.1-pro-preview» كنموذج تجريبي.
جيميني-3.1-برو-برو-برو يتم إدراجها تحت عنوان «معاينة» مع نفس حدود الإدخال/الإخراج.

مقارنة أسعار Gemini 3.6 Flash و Gemini 3.1 Pro

بالنسبة للاستخدام القياسي المدفوع لواجهة برمجة التطبيقات (API) لـ Gemini، فإن إصدار Gemini 3.6 Flash أرخص من إصدار Gemini 3.1 Pro Preview. إن صفحة أسعار واجهة برمجة التطبيقات (API) لـ Gemini تُدرّ قائمة Gemini 3.6 Flash عائدًا قدره $1.50 لكل مليون توكن مدخل و$7.50 لكل مليون توكن مخرج.

تتضمن النسخة التجريبية من Gemini 3.1 Pro مستويين قياسيين للتسعير. بالنسبة للمطالبات التي تصل إلى 200 ألف توكن، يبلغ السعر $2.00 لكل مليون توكن مدخل و$12.00 لكل مليون توكن مخرج. أما بالنسبة للمطالبات التي تتجاوز 200 ألف توكن، فيرتفع السعر إلى $4.00 للإدخال و$18.00 للإخراج لكل مليون توكن. للحصول على تفاصيل التكاليف الخاصة بإصدار Pro، يرجى الاطلاع على دليل أسعار Gemini 3.1 Pro مفتوح بجانب الطاولة.

نموذجسعر المدخلات القياسيسعر الإخراج القياسيملاحظة مهمة
Gemini 3.6 فلاش$1.50 / 1 مليون توكن$7.50 / 1 مليون توكننموذج مستقر؛ سعر المخرجات يشمل «توكينات التفكير»
معاينة الجوزاء 3.1 برو$2.00 / 1 مليون رمز ضمن 200 ألف رمز موجه$12.00 / 1 مليون توكن ضمن 200 ألف توكن فورينموذج المعاينة؛ يُطبق المستوى الأعلى عند تجاوز 200 ألف رمز موجه
معاينة Gemini 3.1 Pro، موجه طويل$4.00 / 1 مليون رمز فوق 200 ألف رمز فوري$18.00 / 1 مليون توكن فوق 200 ألف توكن فوريأمر مهم للاختبار في سياقات طويلة

السعر وحده لا يحدد جودة النموذج. فقد يصبح النموذج الأرخص الذي يتطلب المزيد من المحاولات المتكررة مكلفًا في الواقع العملي. ويمكن أن يكون النموذج الأبطأ جديرًا بالاهتمام إذا كان يتجنب تقديم إجابة خاطئة في مهمة ذات قيمة عالية. إذا كانت المطالبات التي تقدمها غالبًا ما تستنفد السياق الطويل أو الحصص المحددة، فتحقق من دليل حدود Gemini 3.1 Pro قبل اعتبار السعر هو العامل الوحيد في اتخاذ القرار. ولهذا السبب، تسجل اختباراتنا كلاً من التكلفة وجودة النتائج لكل استفسار.

اختبارات الأداء لـ Gemini 3.6 Flash مقابل Gemini 3.1 Pro

جوجل منشور إطلاق Gemini 3.6 Flash يمنح هذا النموذج ميزات كفاءة قوية. وتقول «جوجل» إن الإصدار 3.6 Flash يستخدم عددًا أقل من الرموز الناتجة بمقدار 17% مقارنةً بالإصدار 3.5 Flash في مؤشر «Artificial Analysis Index»، ويحقق أداءً أفضل في اختبار «DeepSWE» واختبار «MLE Bench»، كما يرفع مستوى الأداء المعتمد من «OSWorld» مقارنةً بالإصدار 3.5 Flash.

هذه علامة جيدة، لكنها لا تجيب على السؤال الذي يهمنا هنا. فالسؤال الحقيقي لا يقتصر على مقارنة الإصدار 3.6 من Flash بالإصدارات السابقة مراجعة سريعة لـ Gemini 3.5 Flash; ؛ والسؤال هو ما إذا كان بإمكان الإصدار 3.6 Flash الآن منافسة الإصدار Gemini 3.1 Pro في المهام العملية التي تعتمد على نفس المطالبة.

يتميز جهاز Gemini 3.1 Pro بنتائج اختبارات الأداء الرسمية المختلفة. في منشور إطلاق Gemini 3.1 Pro, ، سلطت «جوجل» الضوء على قدراتها المتقدمة في مجال الاستدلال، وأعلنت أن إصدار «3.1 Pro» حقق درجة مُثبتة في اختبار ARC-AGI-2 بلغت 77.1%. وهذا يجعل من السهل افتراض أن إصدار «Pro» سيتفوق في اختبارات الاستدلال الأكثر صعوبة. لكن الافتراضات هي بالضبط ما يحاول هذا المقال تجنبه.

الطرف الثالث مقارنة التحليل الاصطناعي تُظهر النتائج التي سجلناها تباينًا أكثر وضوحًا: يبدو نموذج «Gemini 3.6 Flash» أسرع وأرخص، كما أنه يحقق درجة أعلى في «مؤشر الذكاء» مقارنةً بنموذج «Gemini 3.1 Pro Preview». ويُعد هذا سياقًا مفيدًا، لكنه ليس نتيجة رسمية من Google، ولا يزال لا يحل محل الاختبار باستخدام نفس المطالبة.

أبرز ميزات التحليل الاصطناعي في الإصدارين التجريبيين «Gemini 3.6 Flash» و«Gemini 3.1 Pro».
جدول مقارنة نماذج التحليل الاصطناعي. تُظهر لقطة الشاشة هذه قيم «مؤشر الذكاء» الخاص بجهات خارجية، والسعر المركب، وسرعة الإخراج، والوقت المستغرق حتى الحصول على الرمز الأول، وقيم نافذة السياق الواردة أدناه.
المصدرمتريGemini 3.6 فلاشمعاينة الجوزاء 3.1 بروكيفية استخدامه
مسؤول في جوجلDeepSWE49%لم تتضمن منشور إطلاق الإصدار 3.6 Flash مقارنة مباشرة مع الإصدار 3.1 Proتقارن المقارنة الرسمية بشكل أساسي بين الإصدار 3.6 من برنامج Flash والإصدار 3.5 منه
مسؤول في جوجلمقعد MLE63.9%لم تتضمن منشور إطلاق الإصدار 3.6 Flash مقارنة مباشرة مع الإصدار 3.1 Proمفيد في تحديد التوقعات المتعلقة بالترميز/الوكالة، وليس دليلاً قاطعاً
مسؤول في جوجلتم التحقق من عالم الأو إس دبليو إس وورلد83.0%لم تتضمن منشور إطلاق الإصدار 3.6 Flash مقارنة مباشرة مع الإصدار 3.1 Proمفيد في سياق استخدام الكمبيوتر
التحليل الاصطناعيمؤشر الذكاء5046سياق اختبار الأداء من جهة خارجية
التحليل الاصطناعيسرعة الإخراج280 توكن في الثانية119 توكن في الثانيةسياق السرعة الخاص بطرف ثالث
التحليل الاصطناعيالوقت المستغرق حتى ظهور الرمز الأول11.71 ثانية33.44 ثانيةسياق زمن الوصول الخاص بالطرف الثالث
التحليل الاصطناعيالسعر المركب$1.16 / 1 مليون توكن$1.74 / 1 مليون توكنيُستخدم بشكل منفصل عن الأسعار الرسمية لواجهة برمجة التطبيقات (API)

الشكل البياني: لمحة عن التحليل الاصطناعي

مقارنة أجرتها جهة خارجية في 22 يوليو 2026. استخدم هذه المقارنة كمرجع للمقارنة، وليس كادعاء رسمي من Google.

مؤشر الذكاء: 3.6 فلاش
50
مؤشر الذكاء: 3.1 Pro
46
سرعة الإخراج: 3.6 فلاش
280 طن/ثانية
سرعة الإخراج: 3.1 Pro
119 طن/ثانية

كيف قمنا باختبار Gemini 3.6 Flash مقابل Gemini 3.1 Pro

يستخدم كل اختبار نفس السؤال، ونفس المدخلات، ونفس فئات التقييم بالنسبة لكلا النموذجين. ونحن لا نعتبر الإجابة الصحيحة في إحدى المهام دليلاً على أن أحد النموذجين أفضل بشكل عام. فالهدف أضيق نطاقاً وأكثر فائدة: وهو إظهار كيفية أداء كل نموذج في مهام محددة.

قمنا بتقييم كل ناتج وفقًا لهذه الفئات:

الفئةما كنا نبحث عنه
جودة النتائجهل الإجابة قابلة للتطبيق فعليًّا؟
التعليمات التاليةهل التزم النموذج بالتنسيق والحدود والقيود؟
الدقةهل تجنب المقال ذكر حقائق أو أسعار أو روابط أو ادعاءات مختلقة؟
العمق المنطقيهل أخذت في الاعتبار المفاضلات والقيود الخفية؟
الهيكلهل يمكن الاطلاع على النتائج بسهولة وإعادة استخدامها؟
السرعةزمن الاستجابة من البداية إلى النهاية بالثواني
التكلفةتم تقديرها استنادًا إلى الأسعار الرسمية لرموز المدخلات والمخرجات الخاصة بـ API

تم إجراء الاختبار عبر نفس مسار واجهة برمجة التطبيقات (API) باستخدام معرّفات النماذج المطلوبة بالضبط: gemini-3.6-flash و جيميني-3.1-برو-برو-برو. تم تسجيل النتائج الأولية، واستخدام الرموز، وزمن الاستجابة، وتقديرات تكلفة واجهة برمجة التطبيقات (API) الرسمية لكل مهمة.

إذا كان البرمجة هي السبب الرئيسي الذي يدفعك إلى مقارنة هذين الطرازين، فقم بمقارنة هذه النتيجة مع أفضل نموذج ذكاء اصطناعي للبرمجة استرشد بذلك بدلاً من إصدار حكم بناءً على موجه إصلاح خطأ واحد فقط.

ملاحظة بشأن الطريقة: هذا اختبار لسير عمل واجهة برمجة التطبيقات (API) باستخدام نفس المطالبة، وليس معيارًا قياسيًا في القطاع. ويُقصد بزمن الاستجابة الوقت المنقضي محليًّا من طرف إلى طرف انطلاقًا من مساحة العمل هذه. أما التكلفة، فقد تم تقديرها استنادًا إلى البيانات الرسمية أسعار الفئة المدفوعة وفقًا لمعيار API لـ Gemini تم التحقق من ذلك في 22 يوليو 2026. استخدمت مهمة لقطة الشاشة صورة اصطناعية لصفحة الدفع/لوحة التحكم تم إنشاؤها خصيصًا لهذا الاختبار.

إذا كنت لا تزال في طور اختيار نموذج افتراضي لاستخدامه في نطاق أوسع من العمل، فإن دليل أفضل نماذج الذكاء الاصطناعي تعد هذه الخطوة التالية أفضل من قراءة زوج Gemini هذا بمعزل عن غيره.

وإذا كان خيارك الحقيقي هو «جوجل» مقابل «OpenAI» بدلاً من «فلاش» مقابل «برو»، فإن مقارنة بين GPT-5 و Gemini 2.5 Pro تعد هذه الخطوة التالية أفضل من إعداد جدول قياسي آخر يقتصر على Gemini.

T01 تلخيص الأبحاث

بدت توصية «Pro» أشبه بنص مُحسَّن من قبل فريق تحسين محركات البحث (SEO)، على الرغم من أن إحدى الملاحظات في المصفوفة أوردت معلومات خاطئة بشأن حزمة المصادر.

محترف
تصحيح خطأ في الترميز T02

كلاهما نجح في حل المشكلة، لكن «فلاش» كان يحتوي على تأكيدات عشرية أكثر موثوقية في الاختبارات.

فلاش
T03 ملخص السياق الطويل

كان «Pro» أكثر ثراءً، لكن «Flash» كان أكثر بساطة وأمانًا فيما يتعلق بصياغة العبارات المتعلقة بحالة المعاينة.

وميض خفيف
T04 الاستدلال على البيانات

كلاهما قام بحسابات رياضية صحيحة؛ فقد استخدم «فلاش» صيغة القسمة الأكثر شيوعًا وبنية أكثر وضوحًا وسهولة في القراءة.

فلاش
T05 تحليل لقطة الشاشة

كان «فلاش» دقيقاً؛ أما «برو» فقد قدم معلومات أكثر تفصيلاً بشأن الثقة، والخطوط الطباعية، ومخاطر استخدام الأجهزة المحمولة.

إيجابي، طفيف
T06 كتابة/تحرير محتوى مُحسَّن لمحركات البحث (SEO)

بدا صوت «فلاش» أكثر طبيعية ونقاءً؛ أما صوت «برو» فكان آمنًا، لكن نبرته كانت درامية أكثر من اللازم.

فلاش

Gemini 3.6 Flash مقابل Gemini 3.1 Pro: نتائج نفس المطالبة

بدلاً من إخفاء بيانات الاختبار في بطاقة نتائج واحدة مجمعة، يعرض هذا القسم كل موجه في شكل بطاقة مقارنة منفصلة بين Gemini 3.6 Flash وGemini 3.1 Pro. تتضمن كل بطاقة بيانات تشغيل واجهة برمجة التطبيقات (API) لنفس المطالبة بالإضافة إلى مقتطفات قصيرة من المخرجات الأولية الفعلية، لذا فإن المقارنة ليست مجرد جدول نتائج.

نتيجة المهمة / T01

توليف البحوث

الفائز: Gemini 3.1 Pro Preview
Gemini 3.6 فلاش
النتيجة
4.23
الوقت المنقضي
22.8 ثانية
التكلفة
$0.0471
الناتج
6,206 توكن
معاينة الجوزاء 3.1 برو
النتيجة
3.76
الوقت المنقضي
48.0 ثانية
التكلفة
$0.0874
الناتج
7,217 توكن

إعداد المهمة: كان على كل نموذج كتابة توصية شراء داخلية تتراوح بين 120 و160 كلمة، مستندةً حصريًّا إلى حزمة مصادر محددة. وتضمنت الحزمة معرّفات النماذج، وأسعار واجهة برمجة التطبيقات (API) الرسمية، وقيود المشتري، والأدلة غير المعروفة، وقائمة صارمة من أربعة بنود تتعلق بالأدلة الناقصة.

لقطة شاشة تُظهر جنبًا إلى جنب نتائج التوليف البحثي لنسختي Gemini 3.6 Flash وGemini 3.1 Pro Preview.

الإخراج الفعلي لـ Flash
بالنسبة لفريق محتوى تحسين محركات البحث (SEO) المكون من خمسة أفراد، نوصي بتعيين «gemini-3.6-flash» كنموذج افتراضي رئيسي واستخدام «gemini-3.1-pro-preview» بشكل انتقائي.
الإخراج الفعلي لـ Pro
(أسعار المطالبات التي تتجاوز 200 ألف توكن غير مدرجة في حزمة المصدر).

ما يوضحه هذا: قام «Pro» بتنظيم التوصية بأسلوب أكثر ملاءمة للنشر من حيث تحسين محركات البحث (SEO)، واستخدم نبرة أكثر اعتدالاً في عرض العروض. أما «Flash» فقد كان أكثر دقةً فيما يتعلق بمستويات الأسعار المقدمة؛ حيث أشارت مصفوفة «Pro» خطأً إلى أن أحد تفاصيل أسعار «Flash» كان مفقودًا من حزمة المصدر.

رأي هيئة التحرير: يفوز «Pro» في هذه المهمة التي تركز على الكتابة لأن توصياته تبدو أقرب إلى موجز داخلي جاهز لتحسين محركات البحث (SEO)، لكن يجب تصحيح الملاحظة المتعلقة بالسعر قبل النشر.

نتيجة المهمة / T02

إصلاح خطأ في البرمجة

الفائز: Gemini 3.6 Flash
Gemini 3.6 فلاش
النتيجة
4.73
الوقت المنقضي
9.1 ثانية
التكلفة
$0.0166
الناتج
2,131 توكن
معاينة الجوزاء 3.1 برو
النتيجة
4.51
الوقت المنقضي
13.2 ثانية
التكلفة
$0.0231
الناتج
1,853 توكن

إعداد المهمة: كان المدخل عبارة عن آلة حاسبة صغيرة للتكلفة مكتوبة بلغة جافا سكريبت تحتوي على خطأين متعمدين: فهي تعاملت مع الأسعار المحددة لكل مليون توكن على أنها أسعار لكل توكن، واستخدمت الفئة «Pro» الأعلى في >=200,000 العملات الرمزية بدلاً من تلك التي تزيد قيمتها عن 200,000 فقط.

الإخراج الفعلي لـ Flash
console.assert(Math.abs(actual – expected) < 1e-9, `فشل الاختبار 1: المتوقع ${expected}، والنتيجة ${actual}`);
الإخراج الفعلي لـ Pro
console.assert(test1 === 0.00525, `فشل الاختبار 1: كان من المتوقع 0.00525، ولكن النتيجة كانت ${test1}`);

ما يوضحه هذا: قام كلا النموذجين بتصحيح الوحدة النمطية باستخدام تصحيح بسيط، لكن «فلاش» كتب اختبارات أكثر أمانًا للعدد العائم تعتمد على التفاوت المسموح به، بينما استخدم «برو» المساواة العشرية الصارمة.

رأي هيئة التحرير: كلا الإجابتين كانتا صحيحتين. كان «فلاش» أكثر جاهزية للاستخدام في بيئة الإنتاج لأن اختباراته استخدمت تأكيدات عشرية أكثر أمانًا.

نتيجة المهمة / T03

ملخص السياق المطول

الفائز: Gemini 3.6 فلاش، طفيف
Gemini 3.6 فلاش
النتيجة
4.53
الوقت المنقضي
15.0 ثانية
التكلفة
$0.0455
الناتج
3,489 توكن
معاينة الجوزاء 3.1 برو
النتيجة
4.2
الوقت المنقضي
28.2 ثانية
التكلفة
$0.0732
الناتج
3,949 توكن

إعداد المهمة: استخدمت المطالبة نصًا متكررًا للتخطيط يتضمن ملاحظات متأخرة حول النزاعات المتعلقة باللقطات المفقودة، والإبلاغ عن تكلفة الرموز، وضغوط النشر يوم الجمعة، وأمان معرّف النموذج، ومعالجة أعطال واجهة برمجة التطبيقات.

الإخراج الفعلي لـ Flash
تأكد من أن Gemini 3.1 Pro لا يُوصف بأنه "مستقر" إذا كان معرّف الطراز الخاص به هو "preview".
الإخراج الفعلي لـ Pro
تم التأكيد على أن إصدار Gemini 3.1 Pro مستقر، أو يتم تعديل النص لتجنب وصفه بالمستقر إذا كان المعرّف يشير إلى "نسخة تجريبية".

ما يوضحه هذا: حافظ «فلاش» على القاعدة التحريرية الأكثر أمانًا: لا تصف إصدار Gemini 3.1 Pro بأنه مستقر عندما يشير معرّف نموذج واجهة برمجة التطبيقات (API) إلى أنه إصدار تجريبي. كان إصدار «Pro» أكثر ثراءً، لكن صياغة قائمة التحقق الخاصة به يمكن تفسيرها على أنها تؤكد الاستقرار أولاً.

رأي هيئة التحرير: قدمت نسخة «Pro» مزيدًا من التنوع في التصميم، في حين كانت نسخة «Flash» أكثر دقة وأمانًا فيما يتعلق بصياغة حالة المعاينة.

نتيجة المهمة / T04

التفكير المنطقي في البيانات

الفائز: Gemini 3.6 Flash
Gemini 3.6 فلاش
النتيجة
4.18
الوقت المنقضي
10.5 ثانية
التكلفة
$0.0181
الناتج
2,368 توكن
معاينة الجوزاء 3.1 برو
النتيجة
4.21
الوقت المنقضي
17.1 ثانية
التكلفة
$0.0276
الناتج
2,258 توكن

إعداد المهمة: كانت البيانات المدخلة عبارة عن جدول قنوات مدته 14 يومًا يتضمن الإنفاق، والنقرات، وعمليات التسجيل، والتحويلات المدفوعة، والإيرادات، ومدة البقاء على الصفحة. وكان على النموذج ترتيب عائد الإنفاق على الإعلانات (ROAS)، ومعالجة القناة ذات الإنفاق الصف بشكل منفصل، وترتيب معدل التحويل المدفوع، وتقديم توصية بشأن توزيع الميزانية التالية لـ $300.

لقطة شاشة تُظهر جنبًا إلى جنب مخرجات استدلال البيانات في إصداري Gemini 3.6 Flash وGemini 3.1 Pro Preview.

الإخراج الفعلي لـ Flash
النمو العضوي على LinkedIn (إيرادات تبلغ $45 مقابل إنفاق يبلغ $0؛ مما يؤدي حسابياً إلى عائد على الإنفاق الإعلاني (ROAS) غير محدد/لانهائي).
الإخراج الفعلي لـ Pro
تُعدّ عمليات التسجيل هنا مؤشراً زائفاً لأنها لا تضمن تحقيق إيرادات فعلية.

ما يوضحه هذا: توصل كلا النموذجين إلى الترتيب الصحيح وتوزيع الميزانية الصحيح. وقد سهّل «فلاش» عملية مراجعة الحسابات باستخدام علامة القسمة المألوفة بدلاً من الترميز بالشرطة المائلة، كما حافظ تخطيطه المرقّم على الاتساق في كلا الحسابين.

الخطوة التالية: لإجراء الترتيب على غرار جداول البيانات، وتوزيع الميزانية، وتحليل القنوات، قارن هذه المهمة مع أفضل أدوات الذكاء الاصطناعي لتحليل البيانات الدليل.

رأي هيئة التحرير: يفوز «فلاش» في هذه المهمة من حيث العرض التقديمي. قدم «برو» شرحًا مفيدًا لجودة عملية التسجيل، لكن تنسيق الحسابات في «فلاش» أسرع في القراءة والتحقق.

نتيجة المهمة / T05

تحليل لقطة الشاشة

الفائز: Gemini 3.1 Pro Preview، بفارق طفيف
Gemini 3.6 فلاش
النتيجة
4.68
الوقت المنقضي
11.2 ثانية
التكلفة
$0.0165
الناتج
1,950 توكن
معاينة الجوزاء 3.1 برو
النتيجة
4.57
الوقت المنقضي
20.7 ثانية
التكلفة
$0.0296
الناتج
2,261 توكن

إعداد المهمة: كانت الصورة المدخلة عبارة عن لقطة شاشة مركبة لواجهة الدفع/لوحة التحكم في GLBGPT تم إنشاؤها خصيصًا لهذا الاختبار. وأظهرت الصورة عملية دفع شهرية لخطة «Pro»، وتحذيرًا بشأن الخصم، وزر «ادفع الآن»، وملخصًا للطلب، ونصًا بشأن الضريبة المؤجلة، وملاحظة تتعلق بشارة الثقة على الأجهزة المحمولة.

لقطة شاشة لوحات التحكم في عملية الدفع في GLBGPT الاصطناعية، المستخدمة في اختبار تحليل لقطات الشاشة T05.
الإخراج الفعلي لـ Flash
تأثير تباعد عناصر التصميم على الثقة البصرية: المساحات البيضاء الفارغة الزائدة داخل اللوحتين الرئيسيتين تضفي مظهرًا غير متقن.
الإخراج الفعلي لـ Pro
تصميم زر غير ملائم: النص "ادفع الآن" الموجود داخل الزر الأخضر صغير بشكل غير متناسب ويستخدم خطًا أسود رفيعًا.

ما يوضحه هذا: حددت «Pro» المزيد من المشكلات المتعلقة بالتصميم على وجه التحديد، بما في ذلك تصميم حروف الأزرار، ومصداقية الأسعار، وموضع إشارات الثقة على الأجهزة المحمولة. أما تقييم «Flash» فقد كان دقيقًا ولكنه أقل تحديدًا.

رأي هيئة التحرير: يفوز «Pro» بفارق ضئيل لأن ملاحظاته توفر للمصمم حلولاً أكثر واقعية يمكنه تنفيذها.

نتيجة المهمة / T06

كتابة/تحرير المحتوى المُحسَّن لمحركات البحث (SEO)

الفائز: Gemini 3.6 Flash
Gemini 3.6 فلاش
النتيجة
4.39
الوقت المنقضي
19.9 ثانية
التكلفة
$0.0366
الناتج
4,818 توكن
معاينة الجوزاء 3.1 برو
النتيجة
4.11
الوقت المنقضي
34.9 ثانية
التكلفة
$0.0641
الناتج
5,291 توكن

إعداد المهمة: كان على كل نموذج إعادة كتابة قسم المقارنة الخاص بـ GLBGPT بلغة HTML فقط، مع الحفاظ على العبارات التسويقية المحظورة بالضبط، وتضمين عنوان URL الدقيق لـ CTA، وتجنب اختلاق نتائج الاختبار، والالتزام بعدد كلمات يتراوح بين 180 و260 كلمة.

Gemini 3.6 Flash مقابل Gemini 3.1 Pro: الحكم النهائي

تتصدر Gemini 3.6 Flash هذه المقارنة، حيث فازت بأربع مهام من أصل ست مهام ذات المطالبات نفسها. وقد حققت أفضل نتائجها في مجالات البرمجة، وتلخيص النصوص ذات السياق الطويل، والاستدلال على البيانات، وتحرير محتوى تحسين محركات البحث (SEO). ولا يزال إصدار Gemini 3.1 Pro Preview يقدم أفضل توليف للبحوث وأكثر تدقيقًا في مراجعة لقطات الشاشة، مما يدل على أن طراز Pro قادر على تقديم إجابة أكثر دقة أو عمقًا عندما تتطلب المهمة عمقًا في التفكير.

كما أظهر «فلاش» أداءً أسرع وتكلفة أقل خلال هذه التجربة المُراقبة التي استخدمت واجهة برمجة التطبيقات (API). وقد أدى هذا المزيج إلى حصوله على النتيجة الأفضل بشكل عام في هذه التجربة، لكنه لا يُعد بديلاً شاملاً عن «برو»: فالمخرجات الفعلية تُظهر أن جودة النموذج لا تزال تتغير باختلاف المهمة، حتى عندما تظل المطالبة كما هي تمامًا.

من أجلك Gemini 3.6 Flash مقابل Gemini 3.1 Pro لإجراء مقارنة، قم بتشغيل نفس المطالبة الحقيقية عبر كلا النموذجين في GLBGPT ومقارنة العمل النهائي جنبًا إلى جنب.

الأسئلة الشائعة حول Gemini 3.6 Flash مقابل Gemini 3.1 Pro

متى تم إصدار Gemini 3.6 Flash؟

جوجل أعلنت عن إصدار Gemini 3.6 Flash في 21 يوليو 2026. تضم صفحة النموذج الرسمية لواجهة برمجة التطبيقات Gemini ما يلي: gemini-3.6-flash كنموذج مستقر.

هل الإصدار Gemini 3.1 Pro هو نفسه الإصدار Gemini 3.1 Pro Preview؟

للاطلاع على أسعار واجهة برمجة التطبيقات (API) والمقارنة الفنية، استخدم الملصق الرسمي جيميني-3.1-برو-برو-برو. تشير منشورة «جوجل» الخاصة بالإطلاق في فبراير 2026 إلى أن إصدار Gemini 3.1 Pro قد تم طرحه في مرحلة المعاينة للتحقق من صحة التحديثات قبل طرحه للجمهور.

متى سيتم إطلاق جهاز Gemini 3.5 Pro أو Gemini 3.6 Pro؟

حتى تاريخ 22 يوليو 2026، أصدرت «جوجل» بيانًا رسميًا بشأن جهاز Gemini 3.5 Pro، لكنها لم تتعهد بموعد محدد لإطلاقه. في إعلان سريع عن Gemini 3.6, ، وتقول “جوجل” إن طراز Gemini 3.5 Pro يخضع حاليًا للاختبار مع الشركاء، وإنها تخطط لإتاحة هذا الطراز على نطاق واسع «بمجرد أن يصبح جاهزًا». ولم أجد تاريخًا رسميًا لإصدار «جوجل» أو إعلانًا رسميًا بشأن طراز Gemini 3.6 Pro.

هل يحل الإصدار Gemini 3.6 Flash محل الإصدار Gemini 3.1 Pro؟

ليس رسميًا. يُعد «Gemini 3.6 Flash» نموذجًا مستقرًا من «Flash» يركز على السرعة والتكلفة والترميز والعمل متعدد الوسائط والتنفيذ التفاعلي. أما «Gemini 3.1 Pro Preview» فيُركز على الاستدلال الأكثر تقدمًا والمهام المعقدة. وقد صُممت اختبارات «الموجهة نفسها» الواردة في هذه المقالة لإظهار أين تكمن الفجوة العملية حاليًا.

هل يمكن للمعايير العامة أن تحدد الفائز؟

لا. تساعد اختبارات الأداء القياسية في تحديد التوقعات، لكنها لا تحل محل الاختبارات الخاضعة للرقابة التي تُجرى باستخدام نفس المطالبات. ويفصل هذا المقال بين الادعاءات الرسمية المتعلقة باختبارات الأداء القياسية، وبيانات اختبارات الأداء القياسية الصادرة عن أطراف ثالثة، ونتائج اختباراتنا الخاصة على مستوى المهام.

لماذا يستخدم هذا المقال اسم «Gemini 3.1 Pro Preview» بدلاً من «Gemini 3.1 Pro» فقط؟

يمكن أن يستخدم المقال مصطلح “Gemini 3.1 Pro” في النص الموجه للقراء، لكن يجب أن تستخدم الجداول الفنية جيميني-3.1-برو-برو-برو. هذه هي التسمية الرسمية لواجهة برمجة التطبيقات (API) المستخدمة في صفحات طراز Gemini وصفحات الأسعار.

هل جهاز Gemini 3.6 Flash أرخص من جهاز Gemini 3.1 Pro Preview؟

نعم، وفقًا للتسعير القياسي المدفوع لواجهة برمجة التطبيقات (API) الخاصة بـ Gemini. يُقدَّر سعر Gemini 3.6 Flash بـ $1.50 لكل مليون توكن مدخل و$7.50 لكل مليون توكن مخرج. تبدأ أسعار Gemini 3.1 Pro Preview من $2.00 للمدخلات و$12.00 للمخرجات لكل مليون توكن، مع فئة أسعار أعلى للمطالبات التي تتجاوز 200 ألف توكن.

هل يدعم كلا النموذجين نافذة سياق تضم مليون رمز؟

تسرد صفحات نماذج واجهة برمجة التطبيقات (API) الرسمية لـ Gemini 1,048,576 رمزًا من رموز الإدخال لكل من gemini-3.6-flash و جيميني-3.1-برو-برو-برو. من الناحية العملية، لا يزال اختبار السياق الطويل مهمًا لأن النافذة الكبيرة لا تضمن استرجاعًا تامًا.

هل ينبغي أن تتضمن المقالة لقطات شاشة رسمية؟

نعم، لكن لقطات الشاشة يجب أن تدعم الادعاءات بدلاً من أن تحل محل المقال بأكمله. وينبغي عرض المقارنة الرئيسية من خلال جداول سهلة القراءة، وبطاقات بيانات، وأشرطة أسعار، وملخصات اختبارات الأداء، وجداول النتائج المستمدة من نفس المطالبات.

ما هي المهام التي تضمنها اختبار «الموجهة الواحدة»؟

تضمنت جولة اختبار واجهة برمجة التطبيقات (API) ست مهام: توليف الأبحاث، وإصلاح أخطاء البرمجة، وتلخيص النصوص الطويلة، والاستدلال على البيانات، وتحليل لقطات الشاشة، والكتابة/التحرير بهدف تحسين محركات البحث (SEO). وسُجلت في كل جولة زمن الاستجابة، ووحدات الإدخال، ووحدات الإخراج، والتكلفة التقديرية، وملاحظة المحكم.

هل يمكن أن يذكر هذا المقال أن طراز Gemini 3.6 Flash أفضل من طراز Gemini 3.1 Pro؟

يمكن القول إن Gemini 3.6 Flash كان الأفضل بشكل عام في هذا الاختبار المحدد الذي استخدم نفس المطالبة لواجهة برمجة التطبيقات (API). ولا ينبغي الادعاء بأن Flash أفضل بشكل عام لكل أحمال العمل، لأن Pro حقق نتائج أقوى في توليف الأبحاث وتحليل لقطات الشاشة.

أين أُجريت الاختبارات التي استخدمت نفس الموجهات؟

تم إجراء الاختبارات عبر نفس مسار واجهة برمجة التطبيقات (API) باستخدام معرّفات النماذج نفسها بالضبط gemini-3.6-flash و جيميني-3.1-برو-برو-برو. هذا ليس اختبارًا لواجهة المستخدم GLBGPT، وينبغي فهم التوقيت المحلي على أنه وقت الطلب من البداية إلى النهاية، وليس زمن الاستجابة من جانب المزود.

لماذا فازت لعبة «Gemini 3.6 Flash» بالجائزة الكبرى رغم فوز «Pro» في بعض الفئات المتميزة؟

فاز «فلاش» لأنه قدم الحل الأكثر فعالية والقابل لإعادة الاستخدام في عدد أكبر من المهام. ورغم أن «برو» تفوق في مجال توليف الأبحاث وتحليل لقطات الشاشة، إلا أن «فلاش» تفوق في مجالات البرمجة، وتلخيص النصوص ذات السياق الطويل، والاستدلال على البيانات، وتحرير محتوى تحسين محركات البحث (SEO).

لماذا تم ذكر GLBGPT في المقارنة؟

تصبح مقارنات النماذج أسهل عندما يتمكن القراء من اختبار نماذج متعددة في مكان واحد. ويُعد GLBGPT مناسبًا في هذا السياق لأن الخطوة التالية التي يتخذها القارئ لا تقتصر على قراءة المواصفات فحسب، بل تشمل تشغيل نفس المطالبة عبر النماذج المختلفة ومقارنة النتائج.

شارك المنشور:

منشورات ذات صلة