عودة Claude Fable 5: المعايير ورأيي
تقنية
Claude Fable 5
Anthropic
AI Models
Claude Code

عودة Claude Fable 5: المعايير ورأيي

تعود Claude Fable 5 عالميًا بعد رفع قيود التصدير. إليك أرقام المعايير، والضمانات الجديدة، ولماذا افتقدت هذا النموذج.

Uygar DuzgunUUygar Duzgun
Jul 1, 2026
تم التحديث 26 يوليو 2026
6 min read

لقد افتقدت Claude Fable 5 أكثر مما كنت أتوقع.

يبدو أن هذا غريب للقول عن نموذج كان لديه نافذة إطلاق فوضوية، وتم سحبه، وأصبح محاطًا بقيود التصدير وجدل السلامة السيبرانية في غضون أيام. لكن Fable 5 كان هو النموذج الذي أردته للعمل كوكيل: فحص المستودعات، حلقات البرمجة الطويلة، استخدام الأدوات، تصحيح الأخطاء، ونوع المهام التي يجب أن يستمر فيها النموذج دون تحويل سير العمل إلى ضوضاء.

تقول Anthropic الآن إن Fable 5 سيعود عالميًا. النسخة القصيرة: فرضت الحكومة الأمريكية قيود تصدير على Claude Fable 5 وClaude Mythos 5 في 12 يونيو 2026. علقت Anthropic الوصول لأنها لم تتمكن من التحقق من الجنسية في الوقت الحقيقي. في 30 يونيو، قالت Anthropic إن تلك القيود قد تم رفعها، وأن Fable 5 سيبدأ في العودة عالميًا يوم الأربعاء، 1 يوليو 2026.

أنا سعيد لأن هذا الفصل قد أوشك على الانتهاء. أريد اختبار النموذج في العمل العادي مرة أخرى، وليس قراءة أسبوع آخر من التكهنات حول ما إذا كان سيعود مرة أخرى.

لماذا تعتبر Claude Fable 5 مهمة

Fable 5 ليس مجرد تحديث صغير للنموذج. تصفها Anthropic كنموذج من فئة Mythos تم جعله أكثر أمانًا للاستخدام العام. هذا يعني أن القدرة الأساسية قريبة من Mythos 5 الأكثر تقييدًا، لكن Fable 5 يأتي مع ضمانات ومصنفات أقوى.

تشرح معايير الإطلاق لماذا كان الناس مهتمين كثيرًا عندما اختفى الوصول.

جدول معايير Claude Fable 5 وMythos 5 من Anthropic
جدول معايير Claude Fable 5 وMythos 5 من Anthropic
المعيارClaude Mythos 5 / Fable 5Claude Opus 4.8GPT-5.5Gemini 3.1 Pro
------:---:---:---:
SWE-bench Pro80.3%69.2%58.6%54.2%
FrontierCode Diamond29.3%13.4%5.7%-
OSWorld-Verified85.0%83.4%78.7%76.2%
Terminal-Bench 2.188.0%*82.7%83.4%70.7%
ExploitBench78.0%*40.0%34.0%-
HealthBench Professional66.0%*56.9%51.8%-

النجمات مهمة. تقول Anthropic إن بعض المعايير المميزة تظهر فجوة أكبر بين Mythos 5 وFable 5 لأن الضمانات وسلوكيات التراجع تؤثر على Fable. لذلك، لا أقرأ الجدول كقدرة نموذجية خام لكل طلب مستخدم. أقرأه كسبب جعل Fable 5 مثيرًا للاهتمام: إنه قريب من مستوى Mythos بينما لا يزال النموذج الذي تريده Anthropic أن يصل إليه المستخدمون والمطورون العاديون.

بالنسبة لعملي الخاص، فإن أقوى الإشارات هي SWE-bench Pro وTerminal-Bench 2.1 وOSWorld-Verified. تلك تتوافق بشكل أقرب مع البرمجة الوكيلة وسير العمل في استخدام الكمبيوتر مقارنة بمعايير الدردشة العامة. يبدو أن Fable 5 مصمم للمهام الطويلة والفوضوية حيث يجب على النموذج فحص الحالة، واستخدام الأدوات، والتعافي من الأخطاء، والحفاظ على سياق كافٍ لإنهاء المهمة.

صفقة الضمان الجديدة

العودة ليست مجرد مفتاح بسيط للعودة.

تقول Anthropic إنها قامت بتدريب مصنف أمان محسّن بعد أن أظهر تقرير من أمازون طريقة لتجاوز ضمانات Fable 5 حول الطلبات المتعلقة بالثغرات. تجادل Anthropic بأن التقرير لم يكشف عن قدرة سيبرانية فريدة من نوع Mythos، لكن الشركة لا تزال تحركت لمنع السلوك الموصوف.

المصنف الجديد يمنع التقنية المحددة من ذلك التقرير في أكثر من 99% من الحالات، وفقًا لـ Anthropic. عندما يتم حظر طلب، يجب إبلاغ المستخدم ويمكن أن يتراجع الطلب إلى Claude Opus 4.8.

رسم توضيحي من Anthropic يوضح الضمانات العادية مقابل ضمانات Fable 5
رسم توضيحي من Anthropic يوضح الضمانات العادية مقابل ضمانات Fable 5

هذا التراجع مهم. يعني أن بعض الأعمال الروتينية في البرمجة وتصحيح الأخطاء قد لا تصل إلى Fable 5 في البداية. إذا رأى المصنف أن الطلب قريب جدًا من الأمن السيبراني، حتى عندما تكون نية المستخدم غير ضارة، فقد تذهب المهمة إلى Opus 4.8 بدلاً من ذلك.

أتوقع أن يكون ذلك مزعجًا للمطورين على المدى القصير. غالبًا ما تتعلق تصحيح أنظمة حقيقية بالمصادقة، والشبكات، والحقن، والاعتماديات، والسجلات، ولغة الثغرات. يمكن لمصنف حذر أن يخطئ بسهولة في الهندسة الدفاعية على أنها إساءة استخدام. تقول Anthropic إنها ستقوم بتحسين المصنفات على مدار الأسابيع القادمة لتقليل الإيجابيات الكاذبة.

هذا هو التوازن الصحيح إذا كانت البديل هو فقدان الوصول إلى Fable 5 مرة أخرى. ومع ذلك، فإن السؤال العملي ليس ما إذا كان المصنف صحيحًا فلسفيًا. السؤال هو ما إذا كان يسمح باستمرار العمل البرمجي العادي دون إجبار كل مهمة مرتبطة بالأمان على نموذج مختلف.

شدة كسر الحماية تحتاج إلى لغة مشتركة

الخطوة السياسية الأكثر إثارة للاهتمام هي الإطار الذي تقوم Anthropic بصياغته مع أمازون ومايكروسوفت وجوجل وشركاء Glasswing الآخرين. الهدف هو طريقة مشتركة لتقييم مدى شدة كسر الحماية في الذكاء الاصطناعي وكيف يجب أن تستجيب مزودات النماذج.

رسم توضيحي من Anthropic يوضح فئات كسر الحماية الطفيفة والضيقة والضارة والعالمية
رسم توضيحي من Anthropic يوضح فئات كسر الحماية الطفيفة والضيقة والضارة والعالمية

المعايير المقترحة من Anthropic معقولة:

اكتساب القدرة
نطاق اكتساب القدرة
سهولة التسليح
القابلية للاكتشاف

هذا مهم لأن ليس كل كسر حماية يحمل نفس المخاطر. إن الطلب الذي يستعيد فقط سلوك منخفض المخاطر داخل هامش أمان المصنف ليس هو نفسه كسر الحماية العالمي الذي يفتح فئة واسعة من القدرات الضارة. إن التعامل مع كلاهما كنوع من الطوارئ يخلق حوافز سيئة. إما أن تتفاعل المختبرات بشكل مفرط مع الاكتشافات الصغيرة أو تفسر الكبيرة بشكل غير كاف.

لن يحل مقياس الشدة المشترك أمان النماذج الحدودية بمفرده. على الأقل، سيجعل المحادثة أقل فوضى.

رأيي

أريد Fable 5 مرة أخرى لأنني أريد نموذجًا يبدو أنه يستحق الاحتفاظ به للمرور الصعب.

قراءة مقترحة

Sonnet 5 هو الآن السائق اليومي المعقول. كتبت عن ذلك في مقالتي حول معايير Claude Sonnet 5. إنه أرخص، وعملي، وقوي بما يكفي للعديد من حلقات الوكيل. لا يزال Opus 4.8 يبدو مفيدًا كنموذج موثوق للتراجع والمراجعة.

يجلس Fable 5 في مكان مختلف. سأستخدمه عندما تكون المهمة مكلفة بأي شكل: ترحيل محفوف بالمخاطر، خطأ عالق، مراجعة مستودع عميقة، سير عمل وكيل طويل، أو قطعة من التحليل حيث يجب على النموذج الاحتفاظ بالعديد من الأجزاء المتحركة في وقت واحد.

أحب أيضًا أن Anthropic لا تتظاهر بأن إعادة النشر خالية من الاحتكاك. تقول الشركة إن المصنفات الجديدة ستخلق بعض الإيجابيات الكاذبة. هذا أفضل من بيع العودة كما لو لم يحدث شيء.

الاختبار الآن بسيط: هل يمكن أن يعود Fable 5 دون أن يصبح متقلبًا جدًا للاستخدام في العمل الهندسي الحقيقي؟

إذا كانت الإجابة نعم، فأنا سعيد أن هذا قد انتهى. افتقدت النموذج، وأريد أن أضعه مرة أخرى في سير العمل حيث يكون Sonnet جيدًا ولكن ليس كافيًا.

المصادر التي تم التحقق منها في 1 يوليو 2026