Gemini 3.6 Flash مقابل GPT-5.6 Sol هو سؤال توجيه AI الأهم هذا الأسبوع. غيّرت Google القائمة المختصرة في 21 يوليو 2026 عندما طرحت Gemini 3.6 Flash، والقصة الأهم ليست الضجة المعتادة حول الإطلاق. القصة الحقيقية هي أن Google تدفع بنموذج وكلاء أرخص، مع ادعاءات أقوى في البرمجة، وإسهاب أقل، ومسار اختبار مجاني أسهل بكثير من معظم الأنظمة الرائدة.
في الوقت نفسه، حوّلت OpenAI بالفعل GPT-5.6 إلى عائلة من ثلاث طبقات، وتستخدم Moonshot AI نموذج Kimi K3 للضغط فعليًا على سوق النماذج المغلقة. اعتبارًا من 26 يوليو 2026، قراءتي بسيطة: إذا كنت تبني وكلاء AI، فالسؤال الحقيقي ليس أي نموذج يفوز في لقطة شاشة لمعيار واحد. السؤال الحقيقي هو أي نموذج ستوجّه إليه الطلب أولًا، ومتى ستصعّد، وما تكلفة ذلك القرار لكل مهمة.
أنا لا أتعامل مع مخططات معايير الشركات المقدمة من المورّدين باعتبارها حقيقة مطلقة هنا. هذا قرار توجيه يستند إلى ملاحظات الإصدار الرسمية، والأسعار، وواجهات الأدوات، وما يشير إليه النظام البيئي هذا الأسبوع.
الحكم السريع
إذا كنت تريد النسخة المختصرة:
هذه هي الخلاصة التي سأعتمدها اليوم إذا كنت أبني حزمة وكلاء حقيقية أو أحدّثها.
Gemini 3.6 Flash مقابل GPT-5.6 Sol في يوليو 2026
تغيّرت ثلاثة أمور خلال فترة قصيرة.
أولًا، قالت Google إن Gemini 3.6 Flash يتفوق على 3.5 Flash مع خفض استخدام رموز الإخراج بنسبة 17% وخفض السعر إلى 1.50 دولار لكل مليون رمز إدخال و7.50 دولارات لكل مليون رمز إخراج. هذا مهم لأن معظم تكاليف الوكلاء لا تأتي من إجابة واحدة كبيرة. بل تأتي من الحلقات المتكررة، واستدعاءات الأدوات، وإعادة المحاولات، والخطوات الوسيطة المطوّلة.
ثانيًا، جعل إصدار OpenAI لـ GPT-5.6 في 9 يوليو 2026 هيكل العائلة أكثر وضوحًا. Sol هي الفئة الرائدة، وTerra هي الفئة المتوازنة، وLuna هي الفئة الأرخص. هذا شكل منتج أفضل للتوجيه الفعلي من قصة «نموذج رائد واحد لكل شيء» القديمة.
ثالثًا، تقول Moonshot إن Kimi K3 هو نموذجها الرائد للبرمجة طويلة الأفق والاستدلال العميق، مع 2.8 تريليون معلمة، وتعدد وسائط أصلي، ونافذة سياق من مليون رمز. كما يذكر دليل البدء السريع الرسمي لـ Kimi أن أوزان النموذج الكاملة ستُطرح بحلول 27 يوليو 2026. وهذا أمر مهم حتى إن لم تكن تخطط لاستضافته ذاتيًا، لأن الضغط الناتج عن الأوزان المفتوحة يغيّر الأسعار وسلوك المشترين في السوق بأكمله.
المقارنة العملية
إليك النسخة الأهم من النصوص التسويقية.
| النموذج | الموقع الرسمي | سعر API | أفضل استخدام أولي |
|---|---|---|---|
| --- | --- | --- | --- |
| Gemini 3.6 Flash | أداة عمل فعّالة للبرمجة، والعمل المعرفي، والوكلاء متعددي الوسائط | 1.50 دولار للإدخال / 7.50 دولارات للإخراج لكل مليون رمز | التوجيه الافتراضي الأول للوكلاء الحساسين للتكلفة |
| GPT-5.6 Sol | النموذج الرائد من OpenAI للبرمجة، واستخدام الأدوات، والعمل المعرفي، وسير العمل المعقد | 5 دولارات للإدخال / 30 دولارًا للإخراج لكل مليون رمز | التصعيد عالي الثقة للمهام الصعبة أو المكلفة |
| Kimi K3 | النموذج الرائد من Moonshot للبرمجة طويلة الأفق والاستدلال العميق | تدرج Moonshot سعر K3 عند نحو 3 دولارات للإدخال / 15 دولارًا للإخراج لكل مليون رمز | تجارب السياق الطويل، واستراتيجية الأوزان المفتوحة، والضغط السعري |
لهذا السبب يبدو Gemini 3.6 Flash أكثر إثارة للاهتمام مما قد يبدو للوهلة الأولى. فهو لا يحاول التفوق على النموذج الأغلى في كل مهمة. بل يحاول الفوز بقرار التوجيه الأول.
وبالنسبة إلى بُناة الوكلاء، غالبًا ما تكون هذه الخانة الأكثر قيمة في الحزمة.
لماذا يُعد Gemini 3.6 Flash الاختيار المفاجئ
لا تقتصر رسالة Google الرسمية على أن 3.6 Flash أفضل من 3.5 Flash. النقطة الأقوى هي أنه أكثر كفاءة وأرخص في الوقت نفسه.
هذا المزيج مهم لأن أنظمة الوكلاء تفشل بطرق مملة:
تقدّم Google صراحةً 3.6 Flash باعتباره أقوى في البرمجة، والعمل المعرفي، والمهام متعددة الوسائط، واستخدام الحاسوب. كما تقول الشركة إنه يحقق تحسنًا في DeepSWE وMLE Bench وOSWorld-Verified وGDPval-AA v2 مقارنةً بـ 3.5 Flash.
حتى إذا قلّلت قليلًا من وزن أرقام المورّدين، فإن اتجاه المنتج واضح: تحاول Google جعل Flash الخيار الافتراضي الجاد للوكلاء، لا البديل الرخيص.
وأعتقد أن هذا أهم من استعراض المعايير.
السبب الثاني لأهمية Gemini 3.6 Flash هو مسار الاختبار. يذكر المستودع الرسمي `google-gemini/gemini-cli` أن Gemini CLI مفتوح المصدر، ويدعم MCP، وعمليات الملفات، وأوامر shell، وجلب الويب، ويوفر طبقة مجانية تبلغ 60 طلبًا في الدقيقة و1,000 طلب يوميًا باستخدام حساب Google شخصي. هذه واجهة سير عمل حقيقية، وليست مجرد حصة تجريبية.
إذا كنت تقرر ما الذي ستجربه أولًا من دون إنفاق المال بسرعة، فلدى Gemini الآن أوضح مسار منخفض الاحتكاك في هذه المقارنة.
أين لا يزال GPT-5.6 Sol متفوقًا
لا تزال OpenAI تملك أقوى موقع في فئة «أحتاج إلى أن ينجح هذا في المهمة الصعبة».
يصف إصدار GPT-5.6 الرسمي Sol بأنه النموذج الرائد للبرمجة، والعمل المعرفي، والأمن السيبراني، والعلوم، وتقول OpenAI إنه يحسن الأداء مقابل الدولار مع استخدام رموز أقل من النماذج السابقة. الجزء الأهم بالنسبة إليّ ليس النتيجة الرئيسية. بل التركيز المتكرر على استخدام الأدوات، وسير العمل طويل الأمد، واستخدام الحاسوب، والتنفيذ متعدد الوكلاء.
وهذا تحديدًا هو المجال الذي تحافظ فيه النماذج المتميزة على تفوقها.
إذا كانت تكلفة الخطأ في المهمة مرتفعة، فسأفضل دفع المال مقابل Sol بدلًا من توفير مبلغ صغير ثم إنفاقه مجددًا على التنظيف والإصلاح. ويشمل ذلك أعمالًا مثل:
كما أصبحت OpenAI أوضح الآن بشأن التوجيه المتدرج داخل عائلتها نفسها. يضع إصدار 9 يوليو Terra وLuna كخيارين أقل تكلفة، وتقول OpenAI إن مستخدمي Free وGo يمكنهم الوصول إلى GPT-5.6 Terra في ChatGPT Work وCodex. وهذا يجعل حزمة OpenAI أكثر مرونة مما قد يوحي به التركيز على Sol وحدها.
ومع ذلك، لا تتغير الخلاصة الأساسية. GPT-5.6 Sol هو نموذج التصعيد، وليس الخيار الافتراضي الرخيص.
لماذا يهم Kimi K3 حتى إن لم تنتقل إليه اليوم
يهم Kimi K3 لسببين.
الأول واضح: تضعه Moonshot باعتباره نموذجًا رائدًا للـ برمجة طويلة الأفق، والاستدلال العميق، وسياق من مليون رمز. وإذا وصلت الأوزان الكاملة فعلًا في 27 يوليو 2026، فسيواصل ذلك زيادة الضغط على المورّدين المغلقين لتبرير الأسعار المتميزة.
السبب الثاني أكثر عملية. لا تدفع Kimi بطبقة النموذج فقط، بل تدفع أيضًا بطبقة سير العمل.
يُظهر المستودع الرسمي لـ Kimi Code ووثائقه وكيلًا طرفيًا يمكنه قراءة الكود وتعديله، وتشغيل أوامر shell، وجلب الويب، وتعديل خطوته التالية استنادًا إلى الملاحظات. وهذا مهم لأن السوق يبتعد عن سؤال «أي نموذج هو الأذكى؟» ويتجه نحو سؤال «أي مزيج من النموذج وواجهة الأدوات هو الأسهل في التشغيل العملي؟»
ما زلت لا أوصي بجعل Kimi K3 خياري الافتراضي للجميع. والسبب بسيط: الخيار الإنتاجي الأكثر أمانًا لا يتعلق بالطموح في المعايير فقط، بل أيضًا بالاستقرار، وعمق التوثيق، ومدى قابلية التنبؤ بالنظام البيئي المحيط للمطور العالمي الناطق بالإنجليزية.
لكن تجاهل Kimi K3 الآن سيكون خطأ. فهو يغيّر التفاوض بالفعل.
سؤال الاختبار الرخيص أو المجاني
هنا تصبح الكثير من منشورات المقارنة عديمة الفائدة.
لا يريد الناس معرفة أي نموذج هو «الأفضل» فحسب. بل يريدون معرفة ما يمكنهم اختباره اليوم من دون الالتزام بإنفاق كبير في وقت مبكر.
هكذا سأفكر في الأمر يوم الأحد، 26 يوليو 2026:
ولهذا أيضًا لا أعتقد أن هذا الأسبوع يتمحور أساسًا حول المعايير. بل يتمحور حول مسارات الوصول.
فالنموذج صاحب أفضل نتيجة على الورق لا يفوز دائمًا بسير العمل.
توصية التوجيه للمطورين
في منطق التشغيل الخاص بي، النموذج الذي أوجّه إليه الطلب أولًا ليس النموذج الذي أثق به أكثر في أصعب مهمة.
لو كنت أحدّث حزمة وكلاء اليوم، فسأوجّه الطلبات هكذا:
هذا لا يعني أن Gemini «أفضل من OpenAI» بمعنى مطلق.
بل يعني أن المسار الافتراضي ومسار التصعيد لم يعودا المسار نفسه.
وهذا هو التحول الأهم هنا.
إذا كانت ميزانيتك حقيقية، فمن الصعب الآن تجاهل Gemini 3.6 Flash.
وإذا كانت المخاطر حقيقية، فلا يزال من الأسهل تبرير GPT-5.6 Sol.
وإذا كانت استراتيجيتك تعتمد على الخيارات وبقاء السوق المفتوح تنافسيًا، فإن Kimi K3 يستحق اهتمامًا جادًا.
هذه هي حزمة التوجيه التي سأتعامل معها بجدية الآن.
قراءات ذات صلة
إذا كنت تريد الجانب الآخر من هذه الدورة، فاقرأ Kimi K3 مقابل GPT-5.6 Sol وClaude Fable 5: حكم المعايير→، وQwen Code مقابل Kimi Code: موجة وكلاء البرمجة المجانية بالـ AI وصلت→، ووكلاء البرمجة بعد 21.54 مليار رمز: ما الذي ينقص؟→.
الحكم النهائي
حكمي ليس معقدًا.
Gemini 3.6 Flash هو نموذج التوجيه الجديد الأكثر إثارة للاهتمام هذا الأسبوع.
ليس لأنه أطاح فجأة بكل النماذج الرائدة. وليس لأن Google فازت في كل مخطط. بل لأنه يجمع بين سعر أقل، وموقع أقوى في مجال الوكلاء، وأسهل واجهة اختبار حقيقية في المجموعة.
وهذا كافٍ لتغيير ما سأجربه أولًا.
GPT-5.6 Sol لا يزال النموذج الذي سأدفع مقابله عندما تكون الجودة، والاستمرارية، والتنفيذ عالي المخاطر هي الأهم.
Kimi K3 هو النموذج الذي سأراقبه إذا كنت أهتم بالسياق الطويل، والاستفادة من الأوزان المفتوحة، واتجاه الضغط السعري التالي.
هذه هي حزمة التوجيه التي سأتعامل معها بجدية الآن.
الأسئلة الشائعة
هل Gemini 3.6 Flash أفضل من GPT-5.6 Sol؟
ليس بالمعنى المطلق الذي سأستخدمه في الأعمال عالية المخاطر. لا يزال GPT-5.6 Sol يبدو كخيار تصعيد متميز أقوى. بينما يبدو Gemini 3.6 Flash أفضل كنموذج منخفض التكلفة للمرحلة الأولى في العديد من سير عمل الوكلاء.
لماذا نقارن Gemini 3.6 Flash بـ Kimi K3 أصلًا؟
لأن Kimi K3 مهم استراتيجيًا حتى إن كانت واجهات المنتج مختلفة. فسياقه البالغ مليون رمز، وموقعه كنموذج رائد، وإصداره الموعود بأوزان مفتوحة، كلها تغيّر طريقة تفكير المشترين في السعر والخيارات المتاحة.
ما أسهل نموذج يمكن اختباره مجانًا هنا؟
لدى Gemini أوضح سير عمل عام اليوم، لأن Gemini CLI مفتوح المصدر، وتقول Google إن الحسابات الشخصية تحصل على 60 طلبًا في الدقيقة و1,000 طلب يوميًا.
