إطلاق Claude 5.1: أقوى نموذج في العالم
chaincatcherالأصل: تابعوا Machine Heart للذكاء الاصطناعي
أطلقت Anthropic للتو الجيل التالي من النماذج Claude Fable 5.1 و Claude Mythos 5.1.
تدّعي Anthropic أن Claude Fable 5.1 هو أحد أقوى النماذج المتاحة للعموم، وهو مصمم للاستدلال المعقد والمهام طويلة الأمد وسير عمل الوكلاء. ويمثل Claude Mythos 5.1 استكشافهم لحدود قدرات أعلى.
من المهم ملاحظة أنه على الرغم من أن كليهما يشتركان في نفس قدرات النموذج الأساسي، فقد تم اعتماد تدابير أمان مختلفة لسيناريوهات استخدام مختلفة.
Claude Fable 5.1 متاح للمستخدمين العاديين والمطورين والشركات، بينما Claude Mythos 5.1 موجه للشركاء الموثوقين في المجالات عالية الخطورة، مع ضوابط وصول أكثر صرامة.
بمعنى آخر، أحدهما مسؤول عن دخول مهام العالم الحقيقي، بينما يُحفظ الآخر في بيئة أكثر تحكمًا. قد يكون هذا أيضًا استكشاف Anthropic للأشكال المستقبلية لمنتجات الذكاء الاصطناعي: قد لا تُقدَّم أقوى النماذج بالضرورة للجميع بنفس الشكل.
يشير البيان الرسمي إلى أن هذين النموذجين يمثلان تقدمًا كبيرًا في قدرات سلسلة Claude ويوضحان كيف يواصلون تعزيز النشر الآمن مع تحسين قدرات النموذج. 
بصفته النموذج "الأقوى ظاهريًا"، لا يزال أداء Claude Fable 5.1 مثيرًا للإعجاب. تُظهر البيانات الرسمية أن Claude Fable 5.1 يتفوق على الرائد السابق Claude Fable 5 في اختبارات معيارية متعددة. 
ومع ذلك، مع زيادة القدرات، انخفض السعر. تذكر Anthropic أن Claude Fable 5.1 يحافظ على نفس السعر الأساسي، بينما انخفضت تكلفة قراءات ذاكرة التخزين المؤقت بنسبة 75% مقارنة بـ Claude Fable 5. في الاستخدام العملي، يقلل هذا من التكلفة الإجمالية للنموذج لأعباء العمل النموذجية بنحو 25%؛ وبالنسبة لأعباء العمل عالية التوكيل، يمكن خفض التكاليف بنسبة تصل إلى 45%. 
يبدو أنه حتى أقوى النماذج تركز على الفعالية من حيث التكلفة.
دعونا نلقي نظرة عن قرب.
الفئات الأدنى تلحق بالجيل السابق، Claude Fable 5.1 يركز على "الفعالية من حيث التكلفة"
بدلاً من مجرد تحديث لوحة الصدارة، تريد Anthropic التأكيد هذه المرة على أن Claude Fable 5.1 يمكنه إكمال المهام التي كانت تتطلب سابقًا الفئات العليا من Claude Fable 5 بتكاليف استدلال أقل.
وفقًا للاختبارات الرسمية، حقق Claude Fable 5.1 بالفعل أداءً قريبًا من Claude Fable 5 أو حتى متجاوزًا له عند شدة استدلال منخفضة إلى متوسطة. يستخدم Claude Code افتراضيًا شدة استدلال عالية، بينما يستخدم Claude Cowork و Claude .ai افتراضيًا شدة متوسطة، مما يسمح للمستخدمين بالتعديل بين السرعة والتكلفة والفعالية بناءً على تعقيد المهمة.
على وجه التحديد، حقق Claude Fable 5.1 درجة 52.6% في المعيار البحثي العلمي Terminal-Bench-Science 0.1، أي أكثر من ضعف 24.7% لـ Claude Fable 5؛ وفي Terminal-Bench 4.0، وصل Claude Fable 5.1 إلى 55.8%، بينما حقق Claude Mythos 5.1 الأكثر قدرة 60.9%.
في اختبارات العمل المعرفي وعمليات الكمبيوتر والعمليات التجارية، أظهر النموذج الجديد أيضًا تحسينات. ارتفعت درجات AutomationBench من 17.1% لـ Claude Fable 5 إلى 31.4%، وتحسن CursorBench 3.2.0 من 70.5% إلى 73.4%. 
في اختبارات معيارية متعددة، تجاوزت درجات Claude Fable 5.1 درجات Claude Fable 5، مع ملاحظة أكبر التحسينات في وكلاء البحث العلمي وقدرات سير العمل التجاري. 
في اختبار Terminal-Bench 4.0، تجاوز كل من Claude Fable 5.1 و Claude Mythos 5.1 الجيل السابق Claude Mythos 5 عند شدة استدلال مختلفة. 
في اختبار Terminal-Bench-Science 0.1، حقق Claude Fable 5.1 درجة قصوى تبلغ 52.6%، أي أكثر من ضعف Claude Fable 5.
تعتقد Anthropic أن التغيير المهم في Claude Fable 5.1 هو رغبته الأكبر في تتبع الأسباب الجذرية للمشكلات، مما يجعله أكثر ملاءمة لتنفيذ المهام المعقدة التي تستمر لساعات أو حتى عشرات الساعات.
وجدت شركة الاستثمار Millennium في الاختبار أن قطعة من الكود الداخلي تتعطل مرة واحدة تقريبًا كل مليون تشغيل. وقد ظلت هذه المشكلة تؤرق الفريق الهندسي لمدة أربع إلى خمس سنوات، ولم تتمكن النماذج الأخرى من تحديد السبب. حدد Claude Fable 5.1 المشكلة في خطأ في مكتبة برامج تابعة لجهة خارجية عن طريق تفكيك مكتبة البائع الخارجي ومقارنة ملفات تفريغ الذاكرة.
كما جعلت Ramp نموذج Claude Fable 5.1 يعمل بشكل مستمر لمدة 38 ساعة. بعد اكتشاف أن نتائج التعلم الآلي الأصلية تأثرت بأخطاء في التسمية، قام النموذج بتصحيح المشكلة بشكل مستقل وبدأ في نفس الوقت ست مجموعات من التجارب، وفي النهاية جمع نتائج جديدة وتوصيات لاحقة.
من كتابة الكود إلى إجراء البحث العلمي
في هذا الإصدار، خصصت Anthropic جزءًا كبيرًا لمناقشة أداء Claude Fable 5.1 و Claude Mythos 5.1 في البحث العلمي.
في تجارب تصميم البروتين، جعل الباحثون Claude Mythos 5.1 يستدعي أدوات تصميم وطي البروتين مفتوحة المصدر، ثم أرسلوا التصميمات المولدة إلى مؤسستين خارجيتين للتحقق التجريبي.
بالنسبة لثلاثة بروتينات مستهدفة، بلغت ألفة الارتباط للروابط التي صممها Claude Mythos 5.1 عشرة أضعاف أفضل الحلول في مسابقة Adaptyv Bio ذات الصلة بتصميم البروتين. وعند مواجهة اثني عشر بروتينًا مستهدفًا، اقترب معدل نجاح الروابط الفعالة للنموذج من 50%، بينما المستوى الشائع في الصناعة الذي توفره Anthropic هو 10% إلى 15%.
كما استخدم Claude Fable 5.1 صور الرادار التي جمعتها مركبة الفضاء ماجلان التابعة لناسا منذ أكثر من 30 عامًا لتوليد خريطة ارتفاع جديدة عالية الدقة لنحو ثلث سطح كوكب الزهرة. 
صور رادار لكوكب الزهرة التقطتها مركبة الفضاء ماجلان التابعة لناسا، مع بركان درعي صغير يبلغ قطره حوالي 15 كيلومترًا في المركز.
كانت الخريطة الأصلية تقدم تفاصيل بمقياس 10 إلى 20 كيلومترًا فقط، بينما تحسن الخريطة الجديدة الدقة إلى 2 إلى 3 كيلومترات، مع تحسين دقة قياس الارتفاع بنسبة تصل إلى 25%. تخطط Anthropic لإصدار هذه الخريطة علنًا بموجب ترخيص مشاركة المعرفة للمهام المستقبلية مثل VERITAS التابعة لناسا و EnVision التابعة لوكالة الفضاء الأوروبية.
في مجال علم الأحياء الحاسوبي، حسّن Claude Mythos 5.1 سرعة تشغيل سبعة نماذج تعلم عميق مفتوحة المصدر للبروتين والجينوم بنسبة تصل إلى 2.5 مرة عن طريق كتابة نوى GPU مخصصة وتخزين النتائج الوسيطة مؤقتًا، مع الحفاظ على نتائج إخراج متسقة. في بعض مهام تحليل الجينوم الكامل، من المتوقع خفض تكاليف GPU بنسبة 30% إلى 60%. 
بعد تحسين سبعة نماذج بروتين وجينوم مفتوحة المصدر، زادت سرعة الاستدلال لـ Claude Mythos 5.1 بمقدار 1.4 إلى 2.5 مرة.
تهدف Anthropic إلى استخدام هذه الحالات لإثبات أن النموذج يتطور من تنظيم المعلومات وكتابة الكود إلى اقتراح الحلول وتشغيل الأدوات وتقديم نتائج بحثية يمكن التحقق منها تجريبيًا.
انخفضت أسعار ذاكرة التخزين المؤقت بنسبة 75%، وأصبحت مهام الوكلاء أرخص بنسبة تصل إلى 45%.
بخلاف الأداء، السعر هو التغيير الأكثر مباشرة في Claude Fable 5.1.
لم يتم تعديل أسعار الإدخال والإخراج لـ Claude Fable 5.1، حيث بقيت عند 10 دولارات لكل مليون رمز و50 دولارًا على التوالي، ولكن تم تخفيض سعر قراءة ذاكرة التخزين المؤقت بنسبة 75%، ليصل إلى 0.25 دولار لكل مليون رمز.
تشير قراءة ذاكرة التخزين المؤقت إلى إعادة استخدام النموذج للسياق الذي تمت معالجته بالفعل. قد تكون نسبتها محدودة في الأسئلة والأجوبة العادية، ولكن في مهام الوكلاء التي تتطلب قراءة متكررة لقواعد الكود والحوارات التاريخية ونتائج الأدوات، غالبًا ما تشكل ذاكرة التخزين المؤقت تكلفة كبيرة.
وفقًا لحسابات Anthropic بناءً على بيانات الاستخدام الفعلية من أغسطس 2026، فإن التكلفة الإجمالية لتشغيل المهام النموذجية باستخدام Claude Fable 5.1 أقل بنحو 25% من Claude Fable 5؛ وبالنسبة لمهام الوكلاء المعقدة ذات السياقات الأطول واستدعاءات الأدوات المتكررة، يمكن أن يصل خفض التكلفة إلى حوالي 45%. 
بعد تخفيض أسعار قراءة ذاكرة التخزين المؤقت، تنخفض تكلفة المهام النموذجية مع Claude Fable 5.1 بنحو 25%، بينما تنخفض تكلفة المهام عالية التوكيل بنسبة تصل إلى حوالي 45%.
يتوفر Claude Fable 5.1 الآن على Claude .ai و Claude Code و Claude API، كما يتم توفيره من خلال AWS و Google Cloud و Microsoft Azure. يمكن للمطورين استدعاء النموذج الجديد عبر claude - fable -5-1.
آلية مكافحة التقطير المعززة
يستخدم Claude Fable 5.1 و Claude Mythos 5.1 في الواقع نفس النموذج الأساسي، والفرق الرئيسي هو قيود الأمان.
Claude Fable 5.1 مفتوح بالكامل للمستخدمين العاديين والشركات؛ بينما Claude Mythos 5.1 لديه قيود أقل صرامة في مجال الأمن السيبراني وعلوم الحياة وهو متاح حاليًا فقط للأفراد والمؤسسات الموثوقين.
في مجال الأمن السيبراني، يمكن لـ Claude Fable 5.1 بالفعل مساعدة المستخدمين في اكتشاف ثغرات البرامج ولكنه لا يزال غير قادر على توليد برامج استغلال مباشرة. قد تظل المهام ذات الاستخدام المزدوج مثل اختبار الاختراق وتوليد الاستغلال وفحص الثغرات القائم على الملفات الثنائية تُحال إلى نماذج ذات قيود أكثر صرامة.
بعد التعديلات، قللت النسخة الجديدة من آلية حماية الأمن السيبراني من الإيجابيات الكاذبة بنحو 60% مقارنة بـ Claude Fable 5. كما انخفض معدل الإيجابيات الكاذبة لآليات السلامة الحيوية في الأسئلة الأساسية في علم الأحياء والطب بنسبة 85%، بينما تُفتح القدرات المتقدمة المتعلقة بأبحاث علوم الحياة بشكل أساسي من خلال برنامج مراجعة Claude Mythos 5.1.
أطلقت Anthropic أيضًا إجراءات الحماية الحدودية للمؤسسات (Enterprise Frontier Safeguards). يمكن للشركات تخزين البيانات في بنيتها التحتية السحابية الخاضعة لسيطرتها، مع تحمل الشركة مسؤولية المراجعات اليدوية الافتراضية، مما يحقق تأثيرات خصوصية شبه "صفر احتفاظ بالبيانات" مع الحفاظ على قدرات المراقبة الأمنية. من المخطط تطبيق هذه الآلية تدريجيًا بدءًا من هذا الخريف.
بالنسبة لتقطير النماذج واسعة النطاق، أضاف Claude Fable 5.1 أيضًا قيودًا جديدة. لن تتمكن حسابات API التي تم إنشاؤها بعد ذلك اليوم من تعديل السياق السابق يدويًا في الحوارات متعددة الأدوار مع الاحتفاظ بسجلات أفكار Claude التاريخية. تذكر Anthropic أن هذا التغيير يهدف بشكل أساسي إلى منع طريقة معروفة لاستخراج القدرات.
بالإضافة إلى ذلك، لتلبية متطلبات قانون الذكاء الاصطناعي للاتحاد الأوروبي، ستتضمن مخرجات النص لـ Claude Fable 5.1 علامات مائية غير مرئية. كما بدأت Anthropic اختبارًا صغير النطاق لواجهات برمجة تطبيقات الكشف، وهي مفتوحة مبدئيًا للهيئات التنظيمية ووسائل الإعلام ومنظمات التحقق من الحقائق والمؤسسات البحثية.
أخيرًا، محق مستخدمو الإنترنت؛ الطائر المبكر يتمكن من استخدام 5.1 أولاً. 
هذا المحتوى لأغراض معلوماتية وتعليمية فقط، ولا يمثل نصيحة استثمارية تتعلق بـ BTCC. تبذل BTCC قصارى جهدها ولكنها لا تضمن صحة أو دقة أو أصالة المحتوى المذكور أعلاه.