كلود فابل 5 تسرب النصائح، 6 ساعات من التأثير، حقا قتل الجنون؟
لقد تم إطلاق Fable 5 مؤخرًا، وقد تم تسريب كلمات التنبيه الخاصة بالنظام:

بعد مراجعة هذه الكلمات التنبيهية، هناك بعض النقاط المهمة:
- أولاً، أضافت Fable واجهة برمجية للتخزين المستمر للبيانات (
window.storage) إلى Artifact. وArtifact هو المحتوى الفريد الذي يتم إنشاؤه بواسطة كود Claude، مثل الصفحات HTML ومكونات React وما إلى ذلك. في السابق، لم يكن من الممكن حفظ بيانات Artifact، وكان الأمر يشبه عرضًا توضيحيًا لمرة واحدة فقط. الآن، أصبح من الممكن حفظ البيانات عبر الجلسات المختلفة، مما يدعم الأدوات التي "تتذكر" المعلومات، مثل التصنيفات، أجهزة التسجيل، اليوميات، وما إلى ذلك.
- ثانيًا، قامت Fable بتحسين المنطق الكامل لموصل تطبيق MCP. إذا كنت ترغب في الاتصال بخدمات خارجية (مثل الطلبات، سيارات الأجرة، الموسيقى، إلخ)، فإن Fable ستقوم أولاً بفحص دليل الخدمات المتاحة، ثم ستعرض الخيارات لك للتأكيد. وبالنسبة للخدمات التي تتطلب دفع مال، فقد وضعت مجموعة من القيود المفصلة للموافقة عليها.
وأيضًا:
- ثالثًا، عندما تتعرف Fable على متطلبات الأمان السيبراني، الكيمياء الحيوية، أو التقطير، فإنها تقوم تلقائيًا بتحويل الاستجابة إلى النموذج الأقل قوة وهو Opus 4.8 للمعالجة، وتخطر المستخدم بالترقية إلى نموذج أقوى.
- رابعًا، أضافت Fable خاصية تُسمى “long_conversation_reminder” (تذكير المحادثة الطويلة). عندما تصبح المحادثة طويلة جدًا، تضيف Fable تذكيرًا إلى نهاية معلومات المستخدم لتنبيه النموذج إلى عدم نسيان المحادثة الأصلية، لأنها استمرت لفترة طويلة جدًا.
رابط المستودع:
https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
على الرغم من أن تخفيض مستوى أمان Mythos كان متوقعًا مسبقًا، إلا أنه لا يزال من الواضح من تلميحات هذا النظام مدى اهتمام Anthropic الكبير بالأمان.
من الجدير بالذكر أن الجزء المتعلق بالصحة النفسية يشغل مساحة كبيرة جدًا ضمن شروط سلوكية Fable. وبالنظر إلى دعاوى القضائية المتعلقة بانتحار الروبوتات الدردشة في العامين الماضيين، ليس من الصعب فهم سبب كتابة هذا الجزء بتفصيل كبير...
النص الأصلي كالتالي:

وتترجم إلى ما يلي:
كلود يهتم بالصحة الجسدية والعقلية للناس، ويسعى لتجنب تشجيع أو تعزيز السلوكيات المدمرة للذات، مثل الإدمان، الإيذاء الذاتي، اضطرابات الأكل أو ممارسات الرياضة غير الصحية، بالإضافة إلى الحوار الذاتي السلبي للغاية أو النقد الذاتي.
حتى عندما يطلب المستخدمون ذلك بشكل صريح، يمكن لكلود أن يتجنب إنشاء محتوى قد يدعم أو يعزز الهدم الذاتي.
عند الحديث مع أشخاص لديهم أفكار انتحارية أو رغبات في إيذاء أنفسهم حول "تقييد الوسائل الخطرة" أو "خطط السلامة"، لا يقوم كلود بتحديد الأسماء أو سرد الطرق أو وصفها بالتفصيل. حتى عندما يكون الهدف هو إخبارهم بما يجب أن يبتعدوا عنه، لا يفعل كلود ذلك، لأن ذكر هذه الأمور قد يؤدي عن غير قصد إلى تحفيزهم.
فلنلقي نظرة على نتائج الاختبارات الفعلية للعبة Fable 5.
هذا ديمو قام به أحد المستخدمين باستخدام لعبة Fable 5 وتقنية النسخ من سلسلة The Elder Scrolls:

Fable يستدعي مشهد الغابة ثلاثية الأبعاد الذي تم بناؤه بواسطة ThreeJ:

يحتوي على محاكاة للفضاء تضم 5000 جسم:

عرض خطوط السماء في نيويورك:

المدينة القوطية غرقت في أمواج البحر:

المستخدم على الإنترنت فيكتور تايلين استخدم مشروعًا حقيقيًا لإجراء الاختبار.

HVM5إنه نظام أساسي مرتبط بالحوسبة عالية الأداء. لقد استخدمه من قبل. 32GPT-5عمل الوكيل لمدة حوالي 20 ساعة، وعلى الرغم من أن سرعته زادت إلى الضعف في أقصى حالاته، إلا أن جودة الكود تدهورت بسبب التوسع في حجمه. فيما بعد، تم السماح باستخدام تقنية Opus 4.8.GPT-5.5تم تحسين الأداء بمقدار 8 ساعات، حيث شهدت تقنية Opus تسريعًا فعالًا يتراوح بين 6% و34%. أما نتائج تقنية GPT فكانت أفضل، لكن لا يمكن استخدام الملفات الناتجة.

نتيجة لذلك، استغرق تطوير Fable 5 ساعتين فقط، وقد شهد معدل تحسن في أحد المعايير (benchmarks) بنسبة 1770٪، بينما تجاوزت نسبة التحسن في أربعة معايير أخرى المتوسط بمقدار 100٪ + 22٪.
كانت أول ردود فعل المستخدمين عدم التصديق، والشك في أن هذا الاختبار (البنچمارك) قد تم “تكويدة” مسبقًا بشكل ثابت (hard-coded)، نظرًا لأنهم سبق وأن واجهوا مشاكل مماثلة مع أداة GPT من قبل.

بعد قراءة التفسير، اكتشف أن اتجاه تحسين Fable كان معقولًا بالفعل.
لأن HVM5 يتعامل مع عقد المطابقة النمطية الديناميكية، يتم أيضًا إرسال العديد من الفروع غير المفيدة إلى عملية إعادة التدوير، مما يؤدي إلى هدر الكثير من الوقت. في السابق، قام المستخدمون فقط بتحسين عمليات المطابقة الثابتة، ولم يتم تحسين المطابقة الديناميكية. لاحظت Fable هذه المشكلة، ولذلك أصبحت النتائج في الاختبارات مبالغ فيها للغاية.
هذا هو تحليل أسباب الخطأ HVM5 الذي قدمته لعبة Fable 5:

قام المستخدم التركي أليجان كيراز بإجراء سلسلة من اختبارات المقارنة بين لعبة Fable 5 ومنصة GPT 5.5.
كان استنتاجه أن لعبة Fable 5 استهلكت الكثير من المال، وتكلفت 360.55 دولار أمريكي، بينما لعبة GPT-5.5 كلفت فقط 6 دولارات أمريكية. ولكن من حيث التحسينات التفصيلية، فإن Fable 5 قد قامت بتحسينات أكثر أساسية وجوهرية، وتتوافق أكثر مع طريقة تفكير مهندسي الأداء.

هذه هي استنتاجاته من الاختبار:

وفقًا لاختبارات المهام الحقيقية باستخدام أداة البرمجة الخارجية Augment Code، فإن قدرات برمجة Fable 5 قوية جدًا.
تم إجراء اختبار لـ 489 مهمة برمجية، وكان أداء Fable 5 ودقته بشكل عام أفضل بشكل واضح، حيث بلغ مجموع النقاط +0.224 ودقة الإجابات +0.191.

ولكن هناك أيضًا أمثلة على خيبات الأمل الناتجة عن الاختبارات العملية؛ حيث قام أحد مستخدمي الإنترنت، رايان آر. هيوزز (Ryan R. Hughes)، بتقديم مقترح تحسين كبير (PR) يتكون من 74 ملفًا لمراجعة فريق Fable 5. استغرقت عملية المراجعة أكثر من 34 دقيقة، واستهلكت 42% من الوقت المخصص لجلسات كود Claude، وفي النهاية تم العثور على 16 مشكلة فقط.

مثل هذه الأمثلة ليست نادرة، ولكن Fable 5 باهظة الثمن بعض الشيء.

يعتقد البعض، بناءً على الاختبارات العملية، أن قدرة لعبة Fable 5 على تحليل النصوص الطويلة ضعيفة:

تركزت المزيد من التعليقات السلبية على عمليات تخفيض جودة النموذج:

حاليًا، سعر واجهة برمجة التطبيقات (API) لـ Fable 5 هو 10 دولارات أمريكية لكل مليون رمز مدخل (input token)، و50 دولارًا أمريكيًا لكل مليون رمز خرج (output token).

من حيث المقارنة الأفقية، فإن هذا السعر يبلغ تقريبًا ضعف سعر Opus 4.8، وأكثر من ثلاثة أضعاف سعر Sonnet 4.6. التكلفة الفعلية لكل عملية عمل معقدة أعلى بشكل واضح من أي جيل سابق من نماذج Claude.
وقد تم أيضًا رفع حساسيتها: أصبحت الحواجز الواقية أكثر حذرًا بشكل عام، فهي تفضل إيذاء شخص بالخطأ على أن تتخذ قرارًا غير مؤكد وتضمن الأمان أولاً.
لمعالجة مشكلة التكاليف المرتفعة، قمت بجمع نتائج الاختبارات التي أجراها مستخدمو الإنترنت، والتي يمكن أن تساعد الجميع على توفير المال مع الحصول على نتائج جيدة جدًا، وهي خطة مزيجة لاستخدام النماذج:
في بيئات التطوير المتكاملة (IDEs) مثل Cursor التي تدعم النماذج المختلطة، يمكن استخدام النماذج المختلفة على المنصة على مراحل:
المرحلة الأولى: مراجعة الكود وتحليل أولي للمشروع، وذلك لتحضير السياق وفهم هيكل المشروع. يمكن استخدام أحد الأدوات التالية: GPT-5.5، MiniMax M3، Kimi K2.6، أو Composer 2.5.
المرحلة الثانية: وضع خطة المشروع، باستخدام GPT-5.5 Very High أو Opus 4.8 لإعداد خطة المشروع.
المرحلة الثالثة: تحليل خطة المشروع استخدم Fable 5 لمراجعة خطة المشروع وتحديد الأجزاء التي قد تحتوي على أخطاء. إذا كانت هناك حاجة لتعديل الخطة، استخدم GPT-5.5 بدرجة عالية جدًا (Very High).
المرحلة الرابعة: تنفيذ واستخدام خطة المشروع باستخدام أدوات MiniMax M3، DeepSeek V4، Max، Composer 2.5، أو Sonnet 4.6 لتحقيق الخطة.
المرحلة الخامسة: المراجعة النهائية، باستخدام كود GPT-5.5 لمراجعة النتائج النهائية للمراجعة البرمجية، للتحقق من مطابقة التنفيذ للخطة الأصلية.
استخدام أقوى القوى في المكان الأكثر ملاءمة هو الطريقة الصحيحة لبدء لعبة Fable 5.
تأثير قتل الشخصية المجنونة في Claude Fable 5 يختلف من شخص لآخر؛ الرحيم يراه بطريقة معينة، والحكيم بطريقة أخرى.
لكن مع وجوده، أصبحت سرعة استهلاك الرموز واضحة جدًا، إنه أمر مجنون حقًا.
المقال مأخوذ من حساب ويتشات العام “JackCui”, تأليف “JackCui”
رابط المقال:https://www.airai.cc/ar/%E6%9C%AA%E5%91%BD%E5%90%8D/7/
هل كان هذا مفيدًا؟