أكدت شركة OpenAI يوم الثلاثاء أن نموذج Astra الذي لم يتم إصداره قد وصل إلى مرحلة جديدة خطيرة، بينما أكدت أيضًا أنها تمضي قدمًا في الإطلاق العام.
في أ مشاركة المدونةوقالت OpenAI إن Astra وصلت إلى عتبة القدرة السيبرانية “الحرجة”، مما يعني أن النموذج يشكل مخاطر وجودية على الأمن السيبراني. OpenAI إطار الاستعداد يتتبع مستويات المخاطر في ثلاث فئات: البيولوجية/الكيميائية، والأمن السيبراني، والتنمية الذاتية للذكاء الاصطناعي.
وفقًا لـ OpenAI، هذه هي المرة الأولى وقد تم تقييم نماذجها بشكل نقدي في المجال السيبراني.
ويشير منشور المدونة نفسه أيضًا إلى أن Astra ستتوفر “قريبًا”، لكن قدراتها الأكثر تقدمًا في مجال الأمن السيبراني سيتم حجزها لشركاء الاختبار المختارين لصالح السلامة العامة. وقالت شركة الذكاء الاصطناعي إنها لا تزال تستعد لإصدار آمن لـ Astra وستكون شفافة بشأن مستوى التهديد المحتمل.
في X، يحل Sam Altman التوتر بين إعلان Astra خطيرًا بشكل خاص، والمضي قدمًا في الإطلاق العام. قال ألتمان إن “Astra تم تدريبها منذ فترة” لكن OpenAI “تبطئ العمل المطلوب لضمان قدرتنا على القيام بما يكفي من العمل فيما يتعلق بالأمن والمواءمة”.
هذه التغريدة غير متاحة حاليًا. قد يتم تحميلها أو تفريغها.
وكتب ألتمان: “هناك توتر واضح هنا: فمن ناحية، فإن أسترا رائعة، ونحن متحمسون لرؤية ما يبنيه الناس بها”. “من ناحية أخرى، من الواضح أننا في مرحلة من التطوير حيث نعتقد أن هناك ما يبرر الحذر، ونحن نعمل على تسريع تقدمنا لضمان قدرتنا على تلبية معايير السلامة التي تتطلبها مستويات القدرة الجديدة.”
بالطبع، هذه ليست المرة الأولى التي تقوم فيها شركة ذكاء اصطناعي بالترويج لأحد نماذجها باعتبارها قوية بشكل خطير قبل إطلاق كبير.
قال تال كولندر، المؤسس والرئيس التنفيذي: “إن تقييد الوصول إلى ميزات الأمن السيبراني الأكثر تقدمًا لاختيار الشركاء يعد أمرًا مريحًا، ولا أعتقد أن OpenAI مهملة هنا”. شركة الأمن السيبراني AI Remedio. “تم تصميم إطار عملهم للسماح بالإفراج عنهم مع الضمانات الصحيحة، ولكن القصة الأمنية هي أن الضمانات لا تحتوي على أي نسخة من هذا، سواء كانت مسورة أو عامة.”
سرعة الضوء قابلة للمزج
ما الذي يجعل أسترا خطيرا؟
قامت OpenAI سابقًا بتصنيف GPT-5.6-Sol على أنه خطر “عالي” في المجال السيبراني، لكن Astra أكثر قدرة. وقالت OpenAI إن الاستغلال سجل نسبة 100 بالمائة في اختبار قياس الأداء.
“بموجب إطار الاستعداد الخاص بنا، يلبي النموذج عتبة الأمن السيبراني الحرجة إذا كان بإمكانه تحديد وتطوير عمليات استغلال يوم الصفر الوظيفية بجميع مستويات الخطورة عبر العديد من الأنظمة الحرجة في العالم الحقيقي الصعب دون تدخل بشري، أو إنشاء وتنفيذ استراتيجيات جديدة شاملة ضد أهداف سيبرانية يصعب استهدافها وحدها.” 7 أغسطس جاء ذلك في منشور مدونة OpenAI.
وفي الأشهر الأخيرة، شهدت النماذج المتقدمة من Anthropic وOpenAI تقدمًا سريعًا في تشفير العملاء واختراق الأمن السيبراني. ونتيجة لذلك، وخاصة بعد اختراق Hugging Face، فإن احتمال قيام أحد عملاء الذكاء الاصطناعي باختراق مجموعة من البنية التحتية الحيوية يبدو غير مرجح. وفي تلك الحالة، تمكنت مجموعات من عملاء الذكاء الاصطناعي الذين طورتهم شركة OpenAI من الهروب من بيئة الاختبار الآمنة، واخترقت Hugging Face وتصرفت بشكل مستقل لاجتياز الاختبار. وفي الوقت نفسه، أدى طوفان من الأخطاء المكتشفة بواسطة الذكاء الاصطناعي إلى إجبار بعض برامج مكافأة الأخطاء في يوم الصفر على الإغلاق تمامًا.
إن اختراق الوجه الذي يعانق OpenAI هو أسوأ مما كنا نعتقد
“أسترا ليست متورطة حادثة الوجه المعانقةلقد أضفنا لدينا تعلُّم “من تلك الحادثة إلى سياستنا الأمنية،” جاء في منشور مدونة OpenAI. “استنادًا إلى الاختبارات بأثر رجعي، نعتقد أن ضمانات منتجاتنا في ذلك الوقت كان من الممكن أن تمنع حادثة معانقة الوجه. لقد قمنا بتنفيذ إجراءات حماية أقوى لشركة Astra، بما في ذلك الرفض الأكثر موثوقية للطلبات السيبرانية الضارة واحترام القيود الأمنية، والضمانات الإضافية ضد سوء الاستخدام، والمراقبة التي يمكن أن توقف النشاط غير المصرح به المحتمل.”
في منشور مدونتها، أوضحت OpenAI أيضًا بعض الاحتياطات الأمنية الأخرى التي طورتها حول Astra مع وضع هدفين في الاعتبار: منع الجهات الفاعلة السيئة من الوصول إلى النموذج ومنع Astra من اتخاذ إجراءات غير مرغوب فيها من تلقاء نفسها. قامت الشركة بتشديد صناديق الحماية الأمنية الخاصة بها وكثفت جهود “الكشف عن التهديدات وتعطيلها دون الاتصال بالإنترنت”.
وقال كولندر لـ Mashable: “الدول القومية والمهاجمون الممولون جيدًا لا ينتظرون تقويم إصدار سام ألتمان”. “إذا كان النموذج الداخلي للمختبر الحدودي قادرًا على العثور على الأيام الصفرية وتسلسلها دون وجود إنسان في الحلقة، فتخيل أن الخصوم لديهم نفس القدرة، سواء كانوا محميين بالبوابة أم لا.”
في نفس اليوم الذي أصدرت فيه OpenAI هذه الإعلانات، أعلنت Anthropic عن إطلاق Fable 5.1، وهو تحديث لأحدث نموذج لها على نطاق واسع. استنادًا إلى الأساطير المكسوة بالخرافة، يعد النموذج الأنثروبي خطيرًا جدًا بحيث لا يمكن إصداره نظرًا لقدراته على تشفير الأمن السيبراني.
إذا بدأت وتيرة تطوير الذكاء الاصطناعي في تذكيرك العاب حربضع في اعتبارك حقيقة أخرى: في حين أن نماذج الحدود المتقدمة تزيد من مخاطر الأمن السيبراني، فإن هذه النماذج نفسها تفيد أيضًا المدافعين عن الأمن السيبراني على المدى الطويل.
التحديث: 2 سبتمبر 2026، الساعة 1:26 مساءً بتوقيت شرق الولايات المتحدة تم تحديث هذه المقالة بتعليقات Sam Altman التي تمت مشاركتها مع X واقتباسات من أحد خبراء الأمن السيبراني.
التحديث: 2 سبتمبر 2026، الساعة 9:29 صباحًا بتوقيت شرق الولايات المتحدة زعمت نسخة سابقة من هذه المقالة أن نموذج OpenAI كان أول نموذج تم تقييمه باعتباره تهديدًا “خطيرًا” في أي من الفئات الثلاث لإطار استعداد المنظمة (الكيميائي/البيولوجي، السيبراني، التطوير الذاتي). وقالت الشركة فقط إن أسترا كان النموذج الأول الذي وصل إلى العتبة “الحرجة” في المجال السيبراني.
الإفصاح: رفعت شركة Ziff Davis، الشركة الأم لـ Mashable، دعوى قضائية ضد OpenAI في أبريل 2025، زاعمة أن Ziff Davis انتهكت حقوق الطبع والنشر في تدريب وتشغيل أنظمة الذكاء الاصطناعي الخاصة بها.