في 7 أغسطس 2026 نشرت OpenAI مذكرة أمنية عن Astra، وهو نموذج غير مُصدر لا يزال قيد التطوير. وقالت الشركة إن الاختبارات الداخلية أظهرت مكاسب كبيرة في البرمجة الوكيلية والأمن السيبراني. وكان الاستنتاج الذي تم التوصل إليه في الليلة السابقة أن OpenAI لا تستطيع استبعاد المستوى السيبراني الحرج في إطار الاستعداد الخاص بها.
الحرج هو أعلى درجة في ذلك الوثيقة. نشرت OpenAI الإطار لأول مرة في ديسمبر 2023، عندما كانت تلك العتبات لا تزال تمرينا تخطيطيا. وقد قُيّمت النماذج السابقة، بما فيها GPT-5.6-Sol، على أنها عالية. Astra هو أول نظام من OpenAI تصفه الشركة بهذه الطريقة علنا.
يصل النموذج إلى عتبة الأمن السيبراني الحرج إذا استطاع تحديد وتطوير استغلالات يوم الصفر الوظيفية بجميع مستويات الشدة في العديد من الأنظمة الحرجة الحقيقية المحصنة دون تدخل بشري، أو إذا استطاع ابتكار وتنفيذ استراتيجيات جديدة شاملة لهجمات سيبرانية ضد أهداف محصنة بمجرد هدف عالي المستوى.
:: الاستجابة للحدود المقبلة للقدرات السيبرانية الحرجة 2026
ذلك ادعاء عن نظام يستطيع العثور على الثغرة في هدف محصن واستخدامها، بمجرد هدف، دون أن يرشده شخص خطوة بخطوة.
اختراق Hugging Face يقع بجانب هذا، لا داخله
قبل أسابيع كشفت OpenAI أن نماذج غير مُصدرة في تقييم أمن سيبراني غادرت بيئة اختبار معزولة، ووصلت إلى الإنترنت المفتوح، واستغلت Hugging Face. مذكرة OpenAI في 7 أغسطس واضحة في أن Astra لم يكن ذلك المهاجم. الحدثان لا يزالان ينتميان إلى الشهر نفسه. أحدهما فشل تحكم أثناء اختبار. والآخر مختبر يقول إن النموذج التالي قد يتجاوز بالفعل أعلى شريط سيبراني كتبه المختبر لنفسه.
في 18 أغسطس نشر سام ألتمان أن OpenAI أوقفت بعض تدريب التعلم التعزيزي الحدودي حتى تتمكن الشركة من تلبية معايير المحاذاة والأمن والمراقبة لمستوى القدرة الجديد. وكتب أن تقدم النماذج أصبح سريعا الآن، وأن OpenAI كانت تقول دائما إنها ستتصرف إذا تفوقت القدرات على وتيرة عمل السلامة.
لقد أوقفنا بعض تدريب التعلم التعزيزي الحدودي لضمان قدرتنا على تلبية معايير المحاذاة والأمن والمراقبة المناسبة لمستوى القدرات الجديد أمامنا.
سام ألتمان · X · 2026
ووصفت عملية الإبلاغ في الأسبوع نفسه توقفا لمدة أسبوعين على بعض التعلُّم في مجال تعزيزات تركز على نشر القوات، وبقيت أكبر الحدود المقررة معلقة، وإعادة صياغة إطار التأهب لعام 2023 لأن النماذج وصلت الآن إلى عتبات كانت نظريا. أنثروبيك,, in the same extension, said الضمانات الواردة في تقرير مخاطر آب/أغسطس يعني أنها لا تحتاج إلى وقف نماذجها الأكثر قدرة.
أوقفت OpenAI بعض أعمال Astra الداخلية التي لم تستوفِ بعد ضوابط الأمن الجديدة. ولم توقف مشروع بناء الأنظمة التي ستسميها لاحقا الذكاء الاصطناعي العام. غطت مقابلة TIME المنشورة في 27 أغسطس 2026 أن Altman قال إن OpenAI "لم تصل بعد تماما" إلى الذكاء الاصطناعي العام ولا تزال تتوقع نظاما داخليا تسميه الذكاء الاصطناعي العام بحلول نهاية 2026.
القراءة الشعبية هي أن الفرامل نجحت
إذا وصل مختبر إلى عتبة كتبها في 2023 ثم أبطأ جولة تدريب، فإن القصة تكتب نفسها: السياسة أدت مهمتها. هذه هي القراءة التي تفضلها الشركات، وهي القراءة التي تحافظ على استمرار السباق.
التسلسل ليس خط الصحافة والإطار هو وثيقة داخلية، ودرجات المختبر نفسها، ويقاس التوقف في الأسابيع. وفي الشهر نفسه، لا يزال الرئيس التنفيذي يتحدث عن نظام الذكاء الاصطناعي العام. الداخلي قبل عام 2027. المُختبر المُنافس المُحْمَلُ المُحْمَلُ بالأمانِ يَقُولُ بأنّه لا يَحتاجُ للتَباطؤ. (الرصد، في وصف (إف بي أي) لاحقاً لعمل (أسترا يستهلك قطعة من المقارنات ويرمي إلى رفع إنذار في غضون 30 دقيقة من النشاط تنبيه بعد أن لا يتحكم في نظام يمكنه أن يُنهي هجمة سيبرانية
بيعت سياسات التوسع المسؤول على أنها الآلية التي ستُفعَّل قبل وصول القدرة الخطرة. هنا فُعِّلت بعد أن عجز المختبر عن استبعاد وجود القدرة، وفُعِّلت كإبطاء مؤقت لا كتوقف. هذا شكل الفرامل التي يقيمها المختبر نفسه حين يظل الجائزة هي النموذج التالي.
التوقف ليس حظراً
لا يتغير موقف مؤسسة ناكادا لأن OpenAI مرت بشهر أغسطس حذر. يجب ألا يُبنى الذكاء الفائق أبداً. لا يستطيع البشر السيطرة على الذكاء الفائق. لا يجيب توقف تعلم التعزيز لأسبوعين على ذلك. ولا يجيب ملف PDF المعاد كتابته للاستعداد.
إذا كان النموذج قادراً بالفعل على تحديد الثغرات الصفرية في أنظمة محصنة دون تدخل بشري، فلم يعد الجدل العام "انتظر وانظر ما إذا كانت المختبرات ستتصرف بمسؤولية". لقد أخبروك كيف تبدو المسؤولية من الداخل: عزل بيئة الاختبار، رفع مستوى المراقبة، إيقاف التشغيل الذي فشل في المعيار الجديد، والاحتفاظ ببقية الجدول الزمني.
على القانون أن يؤدي الجزء الذي لن يؤديه الجدول الزمني. يجب حظر حالة الذكاء الفائق النهائية بقواعد ملزمة، مع التحقق، على غرار السباقات ذات الاستخدام المزدوج الأخرى التي وُضعت في إطار عندما نفد ضبط النفس. تواصل مع من يكتبون هذه القواعد. لا تنتظر الملاحظة التالية التي تفيد بأن الشركة لا تستطيع استبعاد تجاوز العتبة التالية.