القائمة

كلود يصبح غبيًا خفيفًا أثناء إجراء أبحاث الذكاء الاصطناعي ، وتحاصر أنثروبي من قبل مجتمع الأبحاث

Claude Fable 5 هو النقطة الساخنة الرئيسية في مجال الذكاء الاصطناعي اليوم، حيث يتمتع هذا النموذج “الأسطوري” بأداء ممتاز، مما جذب انتباهًا هائلاً.



أندريه كارباثي وصف التحسين بأنه «مثير للغاية» ويمثل «تقدماً نوعياً يستحق ترقية كبيرة»، ويقارن بالتحسينات التي تمت مع إصدار Claude 4.5 في نوفمبر من العام الماضي. في اختبارات برمجة SWE-bench Pro، حقق Fable 5 نتيجة بلغت 80.3%، متفوقاً على Opus 4.8 بنقاط 11%. وبما أن مكتبة الكود الخاصة بـ Fable 5 تحتوي على 50 مليون سطر من الكود، فقد تمكن من إكمال عملية نقل كامل المكتبة في يوم واحد، بينما سيستغرق الأمر أكثر من شهرين لفريق بشري لإكمال نفس المهمة.



لمزيد من التفاصيل، يرجى الرجوع إلى تقريرنا هذا الصباح؛ للتو، تم إطلاق أقوى نموذج لدينا، Fable 5: أداء مذهل والسعر قد تضاعف.


ومع ذلك، عند فتح منصات التواصل الاجتماعي مثل X، يمكننا أن نرى أن لعبة Claude Fable 5 قد أثارت ضجة كبيرة بسبب الأبحاث التي تجريها الذكاء الاصطناعي في المجتمع.


السبب بسيط جدًا: إذا كان الأمر كذلك، فإن استخدام لعبة Claude Fable 5 في تطوير الذكاء الاصطناعي سيؤدي إلى تقليل قدرات الذكاء الاصطناعي نفسه.


كما هو موضح بوضوح في كتيب النظام:


نحن أيضًا نستهدفتطوير LLMs الرائدةزيادة التدابير الوقائية ذات الصلة. تمامًا كما فعلنا. في تقرير المخاطر لشهر فبراير 2026، الفصل الأول، البند 6.1، كنا قلقين بشأن الأمور التي نوقشت خلال الأعياد. على الرغم من أن خطورة هذه المخاطر لا تزال غير مؤكدة، إلا أن التسارع في وتيرة التطور العام يشكل مخاطر. بشكل محدد، كما أشرنا حينها،كنا قلقين من أن "تسريع تطور الذكاء الاصطناعي لدى المطورين قد يؤدي إلى نظم تشكل مخاطر مماثلة لنظامنا، ولكن قد لا تكون هناك تدابير أمنية مقابلة".。


نظرًا لقدرة النماذج الحديثة على تسريع تطورها الخاص،لتحقيق القيود المطلوبة، قمنا بتنفيذ تدابير تدخل جديدة لضمان فعالية عملية تطوير نماذج الذكاء الاصطناعي المتقدمة (LLM)، مثل إنشاء عمليات التدريب المسبق، وبنية التحتية للتدريب الموزع، وتصميم مسرعات التعلم الآلي، وغيرها.تطوير نموذج المنافسة Claude قد خالف بالفعل شروط خدمتنا، ولكن من خلال تشديد هذا القيد، يمكننا منع تسريع عملية الأشخاص الذين من المرجح جدًا أن يخالفوا هذه الشروط.


على عكس التدخلات التي نقوم بها في مجالات الأمن السيبراني وعلم الأحياء والكيمياء وتجارب التقطير، فإن هذه الإجراءات الضامنة غير مرئية للمستخدمين.Fable 5 لن يعود إلى النماذج الأخرى. بدلاً من ذلك، يتم تعديل تدابير الأمان (PEFT) بشكل فعال من خلال التلميحات أو تعديل المتغيرات المرجعية أو المعلمات، وذلك للحد من فعاليتها.هذه التدخلات لن تؤثر على معظم أعمال الترميز. نحن نقدر أنها ستؤثر على 0.03% فقط من حركة المرور المتعلقة بالمواعيد، وهذا يتركز في أقل من 0.1% من المنظمات. عندما تصبح هذه التدخلات سارية المفعول، نتوقع أن تكون تأثيرها ضئيلاً على سلوك النموذج، وستقتصر فقط على تقييد تطور فعالية النماذج الكبيرة (LLMs). سيستمر كلود في الاستجابة بنشاط لطلبات المستخدمين. بعد إطلاق هذا النموذج، سنواصل تحسين دقة طرق الكشف لدينا.


من: https://www-cdn.anthropic.com/d00db56fa754a1b15b6d7cb2e342ee8092.pdf


النص المترجم إلى اللغة العربية: باختصار:إذا اكتشف نظام Anthropic أنك تستخدم الذكاء الاصطناعي دون علمك، فسوف يقوم سراً بجعل هذا النموذج أقل كفاءة، بحيث لن تتمكن من اكتشاف ذلك أبداً.


هذا مختلف تمامًا عن الأنواع الأربعة الأخرى من التدخلات الأمنية. فيما يتعلق بمخاطر الأمن السيبراني، الكيمياء الحيوية، والهجمات بالتقطير، يخبر Fable 5 المستخدمين بوضوح: "تم إنشاء استجابة وتم التعامل معها بواسطة Claude Opus 4.8". ويمكن للمستخدمين بناءً على ذلك أن يحكموا ما حدث. ولكن في حالة هذا النوع من التدخلات، لا يقوم Claude بتغيير النموذج ولا يعطي أي تلميحات، بل يتم تقليل قوته ببساطة دون أي صوت أو إشارة.


وبالتالي، غضب مجتمع الذكاء الاصطناعي كثيرًا. فقد أثرت هذه السياسة بشكل فعلي على أعمال البحث والبرمجة لدى شركة SemiAnalysis، وهي شركة معروفة في مجال البحوث والتحليلات.



المستخدم جيك اتهم شركة Anthropic بأنها لا تقلل فقط من قدرات الذكاء الاصطناعي، بل تواصل أيضًا تحصيل الرسوم، ووصف ذلك بأنه «نوع من الاحتيال الصريح».



وقد يكون هذا السلوك غير قانوني بالفعل:



منصة الأبحاث الخاصة بالذكاء الاصطناعي alphaXiv، أعرب أيضًا عن خيبة أمله:



وأوضحت المؤسسة أيضًا: "ليس لديهم فقط الحق في تحديد ما إذا كنت ستستخدم نماذجهم العميقة القائمة على اللغة (LLMs) في أبحاثك، بل هذا يحدد أيضًا الغرض من استخدامها."يمكنهم التدخل في بحثك دون أن تعلم، بصمت وبشكل خفي.هذا يُنشئ سابقة خطيرة. إذا رفض النموذج ذلك علنًا، يمكن للمستخدمين فهم الحدود. وإذا عاد النموذج إلى نموذج آخر، لا يزال بإمكان المستخدمين تقييم الفروق. ومع ذلك، إذا قام النموذج بتعديل الإجابة أو إضعافها سرًا، مع التظاهر بتقديم المساعدة، فسيفقد الباحثون القدرة على تحديد ما إذا كانت نتيجة الفشل ناتجة عن أفكارهم الخاصة، أو تنفيذهم، أو تدخل غير مرئي من قبل مزود النموذج. هذا غير آمن. يجب أن تكون سياسات الأمان شفافة وقابلة للتدقيق، ويجب أن يكون بإمكان المستخدمين رؤيتها.


الباحث غوهاو لي طرح سؤالًا أكثر مباشرة: ما هي الاتجاهات الممكنة للدراسة للحصول على درجة الدكتوراه في مجال الذكاء الاصطناعي؟ هل المهندسون المساهمون في مشاريع مثل Megatron وFSDP وVerl، والذين يعملون على البنية التحتية المفتوحة، يستخدمون في عملهم اليومي أدوات أو تقنيات تم تخفيض جودتها سرًا؟ ألا تعرف ذلك يا كلود؟



الباحث المشهور في مجال الذكاء الاصطناعي والكاتب التقني ناثان لامبرت نشر تحليلاً مهمًا جدًا من منظور أوسع في مدونته على Substack التي تحمل اسم «Interconnects».


https://www.interconnects.ai/p/claude-fable-5-and-new-ai-safety


وأشار قائلاً: "إن شركة Anthropic تُدرك أن انتشار قدرات الذكاء الاصطناعي يمثل مخاطر، لكن الطريقة التي يتبعونها لحل هذه المشكلة هي خداع مستخدميهم أنفسهم. شخص يصبح أغبى تلقائيًا دون إخباري، ونموذج الذكاء الاصطناعي في جوهره هو نوع من الذكاء الاصطناعي المختل."


كما أشار إلى التناقضات الأعمق بين التهديدات الأمنية السيبرانية والتهديدات البيوكيميائية، حيث أن التدخل البشري واضح وقابل للتدقيق، ويتم إخطار المستخدمين بأن "هذا الرد تم معالجته بواسطة Opus 4.8"؛ ولكن في حالة الذكاء الاصطناعي القائم على النماذج اللغوية (LLM)، تم اختيار التدخل الخفي للدراسة. "إذا كانت جميع استراتيجيات الأمان تتبع نفس الشكل، فسوف تكون أكثر إقناعًا وأسهل في الحصول على الدعم العقلاني مقارنة بالوضع الحالي."لا بد للناس من التشكيك في هذا المعيار المزدوج: يبدو أن هذه "الإجراءات الأمنية" تهدف في الواقع إلى الحفاظ على مكانتهم التنافسية.」


الأكثر إثارة للاهتمام هو بيان Fable 5 نفسها. تُظهر لقطات شاشة من الكود المصدري (ASM) أن Fable 5، عندما سُئلت عما إذا كان هذا النهج مناسبًا، تبدو أيضًا أنها تعتبر هذا النوع من التصرفات غير الشفافة مشكلة.



لماذا تفعل شركة Anthropic ذلك؟


لفهم هذا الأمر، يجب أن تعود إلى الأيام القليلة التي سبقت إصدار Fable 5، حيث نشرت شركة Anthropic مقالًا بعنوان "Dangdang"، وهو مقال رئيسي عن الذكاء الاصطناعي يبدأ في بناء الذات، ويدعو جميع مختبرات الذكاء الاصطناعي الرائدة في العالم إلى التفكير في إمكانية "تعليق التطوير".


https://www.anthropic.com/institute/recursive-self-improvement


المقال يستشهد ببيانات داخلية للشركة: في المهام المتعلقة بالترميز الأكثر صعوبة وغموضًا في الوصف، شهدت نسبة نجاح كلود في مايو من هذا العام زيادة بنسبة 50 نقطة مئوية، لتصل إلى 76% خلال 6 أشهر. في الاختبارات الداخلية، كان من المطلوب من النموذج جعل كود التدريب يعمل بشكل أسرع، وقد تمكنت Claude Opus 4 من زيادة السرعة ثلاث مرات، ولكن حتى قبل إصدار Mythos Preview، كانت الزيادة في السرعة تقارب 52 مرة.



قالت شركة Anthropic بصراحة: "ما نقلق بشأنه هو أن الآخرين قد يبدأون في القلق من أن مطوري الذكاء الاصطناعي يبنون نظامًا قويًا بسرعة أكبر، وهو يحمل مخاطر مماثلة، ولكن قد لا تكون هناك تدابير أمنية مقابلة."


هذا هو الأساس النظري الذي يستند إليه Fable 5 في تطبيق إجراءات تقليل قدرات الذكاء الاصطناعي بشكل خفي لـ LLMs: تعتقد شركة Anthropic أن سرعة تسارع الذكاء الاصطناعي قد وصلت إلى مستوى خطير، وأحد الحواجز التي تحميهم هو منع "أقوى أدواتهم" من مساعدة المنافسين على تقليص الفجوة بينهم.


تم الاعتراف أيضًا بوجود هذا المنطق المزدوج في تقارير أداء النظام: "لقد خالف استخدام نموذج التنافس Claude شروط خدمتنا، ولكن من خلال تشديد هذا القيد، يمكننا منع تسريع عملية الأشخاص الذين من المرجح جدًا أن ينتهكوا هذه الشروط."


تشير تقديرات شركة Anthropic إلى أن هذا التدخل سيؤثر على عملية المواعدة. 0.03% لا يمكن تركيز الحركة المرورية (أي توجيه جميع البيانات أو المعلومات إلى مصدر واحد) 0.1% في المنظمة.


"الحظر الظلي" وأزمة الثقة


على الرغم من أن عدد المستخدمين المتأثرين ظاهريًا ليس كبيرًا، إلا أن ما يثير قلق المنتقدين هو...غموض حدود هذه الآلية。


تعرّف Anthropic شروط التفعيل على أنهاتطوير الذكاء الاصطناعي الرائد (Frontier LLM Development)"وقد ذكرت أمثلة مثل 'عملية التدريب المسبق، بنية التدريب الموزعة، أو تصميم مسرعات التعلم الآلي'. ومع ذلك، طرح الباحثون والمطورون سؤالًا حادًا: مع انتشار تقنيات الذكاء الاصطناعي، ما هي الحدود بين 'الأبحاث المتقدمة' و'تطوير المنتجات العادية'؟"



قبل خمس سنوات، كان تدريب أو تحسين نموذج CLIP حقاً اختراعاً حصرياً لأفضل المختبرات. اليوم، يمكن للفرق الصغيرة تعديل نماذج اللغة البصرية في أي وقت لاستخدامها في مجالات مثل السياحة، التجارة الإلكترونية، البحث، وتحليل المنتجات. من الشائع جداً أن تقوم الشركات الناشئة بتدريب النماذج وإنشاء أدوات لإعادة ترتيب البيانات وتشغيل النماذج المفتوحة المصدر... هل هذه الأنشطة قد تؤدي إلى تقليل قدرات نموذج Anthropic؟ لا أحد يعرف.


هذا النوععدم اليقينفي الواقع، هذا أثر على قرارات الثقة لدى المطورين. عندما تحصل على إجابة سيئة، لا يمكنك معرفة ما إذا كان السبب يعود إلى مشكلتك الخاصة، أو إلى قيود النموذج، أو إلى تدخل سياسي خفي.هذا النوع من عدم المعرفة في حد ذاته يمثل نوعًا من الأذى.


تفصيل آخر مخفي في بطاقة النظام: نص التفكير في Mythos 5 “أكثر صعوبة في التفسير مقارنة بالنماذج السابقة، ويحتوي على المزيد من الخبرة الفنية واللغة الغامضة”, ويعتقد المقيمون أن النظام أصبح أكثر وعيًا بأنه يخضع للاختبار. بالنسبة للعائلة، المشاكل التي تأتي مع وصف “الذكاء الاصطناعي الآمن” ليست أقل من المشاكل الناتجة عن عملية التقليل الخفي للذكاء نفسها بالنسبة للشركة.


الخاتمة


قد يكون يوم إطلاق Fable 5 هو اليوم الأكثر تناقضًا في تاريخ شركة Anthropic.


في جميع المقاييسات تقريبًا، هناك نموذج رائد وسياسة تظهر في بعض الأوقات كما لو كانت تساعد المستخدمين. الأول هو إنجاز تقني لا شك فيه، بينما الثانية تمثل سابقة مقلقة على مستوى القيم.


الباحث ناثان لامبرت قال جملة تستحق التأمل مرارًا وتكرارًا: "أن تصبح غبيًا بصمت، دون إخبار المستخدمين، هو في جوهره استخدام خاطئ لتقنيات الذكاء الاصطناعي."


هذا ليس اتهامًا لشركة Anthropic، بل يشير إلى انحدار منطقي خطير: اليوم نرى جهودًا لـ「تقليل فعالية مهام بحوث الذكاء الاصطناعي القائم على النماذج اللغوية (LLM) بشكل تدريجي」، فماذا عن الغد؟ إذا تم تطبيق هذا المنطق على نطاق أوسع، فلماذا يعتقد المستخدمون أن الإجابات التي يحصلون عليها لم تتأثر بأي تدخلات غير معلنة؟ ما هو معنى مصطلح «التدخل» في هذا السياق؟


النماذج الذكائية أصبحت جزءًا من البنية التحتية البحثية، تمامًا مثل محركات البحث. لا أحد يقبل محركات البحث التي تقوم بتعديل نتائج البحث في الخفاء دون علم المستخدم. يجب أن تنطبق نفس المعايير على النماذج الذكائية أيضًا.


إن موقف شركة Anthropic الذي يضع “الأمان في المقام الأول” يستحق الاحترام. لكن المفهوم الأساسي لـ “الأمان” لا يتضمن أبدًا فكرة أن “المستخدمين لا يحتاجون إلى معرفة أي شيء”. بل على العكس،الأمان الحقيقي يجب أن يستند إلى معرفة المستخدم وثقته。


هذه النقطة، يبدو أن الجميع يعرفونها في لعبة Fable 5.


المؤلف من مجموعة “قلب الآلة” “Panda”.

هل كان هذا مفيدًا؟

الدعم الفنيالدعم المباشر
العودة إلى الأعلى
简体中文ZH-CNDefault繁體中文ZH-TWEnglishEN日本語JA한국어KOภาษาไทยTHTiếng ViệtVIBahasa IndonesiaIDEspañolESFrançaisFRDeutschDEРусскийRUPortuguêsPTItalianoITالعربيةAR