أعلنت شركة Anthropic رسميًا عن إطلاق Claude Fable 5.1 بالتزامن مع Claude Mythos 5.1، في خطوة تعكس انتقال سباق نماذج الذكاء الاصطناعي من مجرد تحسين جودة الإجابات إلى بناء أنظمة قادرة على تنفيذ أعمال معقدة وطويلة الأمد بدرجة أكبر من الاستقلالية.
وتصف Anthropic نموذج Claude Fable 5.1 بأنه أكثر نماذجها قدرة حتى الآن في مجالات البرمجة والأعمال المعرفية، مع تركيز واضح على المهام التي قد تستمر لساعات أو تمتد عبر مراحل متعددة وتتطلب استخدام الأدوات، والتحقق من النتائج، والتعامل مع حالات الفشل بدل الاكتفاء بإنتاج إجابة واحدة.
Claude Fable 5.1 ما الجديد في الجيل الأحدث من Claude؟
الفكرة الأساسية وراء Fable 5.1 تتجاوز مفهوم روبوت المحادثة التقليدي، تم تصميم النموذج للتعامل مع المشروعات طويلة الأمد، والمهام البرمجية الكبيرة، والبحث والتحليل، وسير العمل المؤتمت، مع قدرة أفضل على الحفاظ على مسار العمل وإعادة ترتيب الأولويات ومتابعة التنفيذ دون الحاجة إلى تدخل بشري مستمر.
وهذا يعني أن النموذج يمكن استخدامه كوكيل AI Agent يعمل لفترة طويلة لإنجاز مشروع كامل، بدلًا من التعامل معه كأداة ترد على الطلبات واحدة تلو الأخرى.
قدرات أقوى في المهام طويلة الأمد
من أبرز نقاط التركيز في Claude Fable 5.1 قدرته على تنفيذ الأعمال الممتدة دون فقدان السياق العملي للمهمة، وتقول Anthropic إن النموذج قادر على التخطيط للعمل، واستخدام الأدوات المناسبة، والتعافي عندما تفشل إحدى الخطوات، وإبلاغ المستخدم بالتقدم الذي أحرزه أثناء التنفيذ.
وتشير شهادات مبكرة من شركات اختبرت النموذج إلى تحسن ملحوظ في التعامل مع المشاريع طويلة المدى.
فقد ذكرت MongoDB أن Fable 5.1 تمكن من إجراء بحث أولي عبر الأكواد والوثائق، ثم العمل لساعات بشكل غير مراقب لتنفيذ نموذج أولي مع حلقات تحقق مستمرة.

تطور كبير في البرمجة وتطوير البرمجيات
البرمجة تمثل واحدة من أهم نقاط قوة Claude Fable 5.1، وتصف Anthropic النموذج بأنه مصمم للمشروعات البرمجية الطموحة التي تشمل قواعد أكواد كاملة، ومراجعات برمجية، وتحسين الأداء، وجلسات تنفيذ ذاتية يمكن أن تمتد لعدة أيام.
ومن المزايا اللافتة أن النموذج يستطيع كتابة الاختبارات الخاصة به للتحقق من جودة العمل، بالإضافة إلى تنفيذ التصميمات بدقة والاستفادة من الرؤية الحاسوبية لمقارنة المخرجات النهائية بالهدف المطلوب.
وتظهر اختبارات Anthropic تحسن واضح مقارنة بـ Fable 5، حيث سجل Fable 5.1 نسبة 73.4% على CursorBench 3.2.0 عند أعلى مستوى من الجهد، مقابل 70.5% لـFable 5.
كما سجل 55.8% على Terminal-Bench 4.0 في المقارنة الأساسية، بينما وصل Mythos 5.1 إلى 60.9% في الاختبار ذاته.
وفي اختبار AutomationBench الخاص بسير العمل التجاري، سجل Fable 5.1 نسبة 31.4% مقابل 17.1% لـ Fable 5 و26.9% لـ Opus 5.

الذكاء الاصطناعي كوكيل وليس مجرد مساعد
من أكبر التحولات التي ترافق إطلاق Fable 5.1 توسع Anthropic في مفهوم AI Agent.
فالنموذج مصمم لتنفيذ مهام تمتد عبر تطبيقات متعددة، والعمل على المتصفح، واستخدام الأدوات، ومتابعة الخطوات بشكل شبه مستقل، وتذكر Anthropic أن Fable 5.1 يمكن أن يعمل ضمن بيئات مثل Claude Cowork، ويعالج الطلبات في Slack من خلال Claude Tag، ويعمل كوكيل مدار على Claude Platform.
هذه القدرات تفتح الباب أمام استخدام النموذج في أعمال مثل تحليل المشروعات، مراجعة قواعد الأكواد، تحليل الحوادث التقنية، تنفيذ الأبحاث، إعداد التقارير، وإتمام مهام الأعمال التي كانت تتطلب تدخل بشري في كل مرحلة.
Fable 5.1 وMythos 5.1 ما الفرق؟
رغم اختلاف الأسماء والاستخدامات، تؤكد Anthropic أن Fable 5.1 وMythos 5.1 هما النموذج نفسه من الناحية الأساسية، لكنهما يختلفان في مستوى الحماية المطبق عليهما.
يتوفر Fable 5.1 بشكل عام للمستخدمين، بينما يتم توفير Mythos 5.1 حاليًا لعدد محدود من المؤسسات التي تمر عبر برامج وصول موثوقة، مع سياسات حماية مصممة لدعم الأبحاث المتقدمة، خصوصًا في الأمن السيبراني وعلوم الحياة.
وفي مجال الأمن السيبراني، أصبحت حماية Fable 5.1 أكثر دقة، بما يسمح له بالمساعدة في اكتشاف الثغرات البرمجية دون السماح بإنشاء الاستغلالات الخاصة بها، أما الطلبات الحساسة المتعلقة بالأحياء والبيولوجيا، فتستخدم Anthropic آلية تحويل تلقائي لبعض الاستفسارات إلى نماذج Opus.

الخلاصة
يبدو إطلاق Claude Fable 5.1 بمثابة تطور مهم في مسار Anthropic، خصوصًا مع التركيز على البرمجة، والعمل المعرفي، والمهام طويلة الأمد، والأنظمة الوكيلة القادرة على العمل باستقلالية أكبر، وفي المقابل يقدم Claude Mythos 5.1 النسخة نفسها من القدرات الأساسية ضمن بيئة حماية مخصصة للأبحاث المتقدمة.
وبذلك لا تقدم Anthropic مجرد تحديث تقليدي لنموذج Claude، بل تدفع باتجاه نموذج جديد لاستخدام الذكاء الاصطناعي، ذكاء اصطناعي يمكنه التخطيط والتنفيذ والتحقق والمتابعة، وليس فقط الإجابة.

