تقرير أنثروبيك للمخاطر لشهر أغسطس 2026 يتكون من 186 صفحة لمختبر يقيم نفسه. تاريخ التغطية هو 15 يوليو. بموجب النسخة 3.4 من سياسة التوسع المسؤول للشركة، انتقل التقييم العام لمخاطر الاختلال الكارثي من تصنيفه الأرضي السابق إلى منخفض. السبب المذكور هو عدم اليقين بعد الكشف عن حوادث الأمن السيبراني الأخيرة، بالإضافة إلى مؤشرات مبكرة على تسريع النماذج للبحث والتطوير الآلي، وليس دليلا جديدا على التوافق الداخلي.
يمكنك تفويتها إذا كنت تريد فقط العنوان الرئيسي الذي أنثروبيك لا يزال هو العنوان الدقيق. اقرأها مرة أخرى. وقد رفع المختبر الذي يحمل علامة السلامة علامة المخاطر الكارثية الخاصة به، وقال في نفس الوثيقة إنه لا يؤدي إلى إبطاء التطوير بشكل عام.
النموذج 2 جاهز للعمل
يسمي التقرير نظاما غير معلن من فئة ميثوس، وهو نموذج 2. تصفه أنثروبيك بأنه تحسن ملحوظ على ميثوس 5 في كثير من المهام الداخلية، أعلى بنحو 1.5 نقطة على مؤشر القدرات الخاص بالشركة، وليس قفزة بحجم أوبوس 4.6 إلى ميثوس. لا توجد خطة حالية لإصداره. لم يُجرَ الاختبار الكامل قبل النشر، لذا فإن ثقة الشركة في قدراته أقل مما هي عليه لميثوس 5.
على كوبنش، الذي يضم 449 مشكلة هندسية حقيقية مستمدة إلى حد كبير من قضايا حلها موظفو أنثروبيك لاحقا، يسجل نموذج 2 نسبة 62.8 بالمئة. ميثوس 5 يسجل 50.3 بالمئة. ميثوس بريفيو يسجل 54.8 بالمئة. تقدير أنثروبيك الخاص هو أن النظام القادر على الاستغناء عن موظفي البحث يحتاج إلى 85 بالمئة على الأقل. نموذج 2 ليس ذلك النظام. أغلق فجوة من رقمين على البطل الداخلي السابق في خطوة واحدة، على واجبات المختبر المنزلية.
يُستخدم ميثوس 5 ونموذج 2 على نطاق واسع في البحث والهندسة داخل أنثروبيك، تفاعليا وعبر نشر وكلاء مستمرين؛ كلود يؤلف الآن غالبية كبيرة من الشفرة المدمجة في قواعد الشفرة الإنتاجية لدينا.
أنثروبيك · Risk Report August 2026
المقياس استخدم نفسه
وفيما يتعلق بالآلية الآلية لمؤسسة AI RD، لا يزال التقرير يُعرّض المخاطر عموماً إلى مستوى منخفض. ثم تقول إن الشركة أقل ثقة في هذا التقييم من التقارير السابقة، لأن أكثر التقييمات الملموسة القائمة على المهام قد شبعت. They no longer capture increases in capacity. المختبر أيضاً يشاهد علامات مبكرة على التسارع
الاختبار الذي لا يرى القفزة التالية هو نقطة عمياء تحمل رقما. استبدلت أنثروبيك جزءا من المجموعة القديمة بكوبنش، وهو على الأقل مجموعة من المشكلات الداخلية الحقيقية. حتى هناك، يقف شريط الاستغناء عن الموظفين عند 85 بالمئة، ونموذج 2 وصل بالفعل إلى 62.8 دون اسم عام.
إبقاء نموذج 2 خارج واجهة البرمجة ليس مثل إبقاء نموذج أقوى خارج السباق. يقول التقرير إن أقوى نظامين يُستخدمان بالفعل بشكل مكثف داخليا، بما في ذلك وكلاء يعملون باستمرار. الشفرة التي تُشحن، بكلمات الشركة، تُكتب الآن في معظمها بواسطة كلود.
القراءة الشعبية هي أن المختبر الحذر حافظ على الخط
أنثروبيك did did not ship Model 2. ونشرت تقريراً طويلاً وأثارت المخاطرة. في نفس أغسطس مَرَّدَ المعهدُ بعض التدريب على الحدود بعد أسترا, و قال (يو جي) أن ضماناته الخاصة تعني أنها لا تحتاج إلى توقف من الخارج هذا يبدو كإشراف الكبار ومن داخل الوثيقة، يبدو أنها شركة لم تعد قادرة على قياس الشيء الذي تتوسع فيه، باستخدام النظام الأقوى في عملها الخاص، وتراجع إلى إبطاء العمل.
تفسر الحوافز ذلك دون أشرار. المختبر الذي يتوقف بينما لا يتوقف المنافس يخسر النموذج التالي والعقد التالي والتقييم التالي. السياسات المقيمة ذاتيا مصممة لتحمل هذا الضغط. تنتج تقارير وأسماء محجوبة وتحركا بدرجة واحدة من التصنيف الأرضي السابق إلى منخفض. لا تنتج وقفا.
رفع القانون، وليس الحقن
لا ترى مؤسسة ناكادا تصنيفا أعلى للمخاطر داخليا علاجا. يجب ألا يُبنى الذكاء الفائق الاصطناعي أبدا. الذكاء الفائق لا يمكن السيطرة عليه من قبل البشر. إذا كان الموظفون الذين يكتبون الشفرة يشاهدون بالفعل كلود يكتب معظمها، فإن الدور البشري المتبقي هو خطوة مراجعة تتقلص على نظام لم تعد الاختبارات تراه بوضوح.
انشر التقييمات إن أردت. احجب الأوزان إن أردت. ليس أي منهما بديلا عن حظر ملزم. تقرير أغسطس مفيد لأنه صريح. تعامل مع الصراحة كدليل، لا كطمأنينة.