OpenAI تعلن إبطاء تطوير نموذج أسترا بسبب مخاوف أمنية.
أعلنت OpenAI عن تعليق العمل على بعض جوانب نموذجها القادم "أسترا" (Astra)، وذلك بعد مراجعة داخلية كشفت عن تقدم كبير في البرمجة المعتمدة على الوكلاء (agentic coding) والأمن السيبراني، مما أثار مخاوف بشأن قدراته.
وذكرت OpenAI في تدوينة لها أن هذا النموذج، الذي لا يزال قيد التطوير، وصل إلى "عتبة الأمن السيبراني الحرجة"، وهو ما يعني أنه بات بإمكانه تحديد وتنفيذ هجمات سيبرانية بشكل مستقل ضد أنظمة حقيقية محصنة. وقد أدى هذا إلى تفعيل إجراءات حماية إضافية بموجب "إطار الجاهزية" الخاص بالشركة، والذي أنشئ عام 2023.
وأوضحت الشركة أن "التقييمات الأولية تشير إلى أداء قوي لدرجة لا يمكننا معها استبعاد مستوى القدرة الحرج في الوقت الحالي"، مؤكدة أن "أسترا" هو نموذج قادم ولم يكن له أي دور في حادثة اختراق Hugging Face.
تأتي هذه الخطوة في ظل تدقيق متزايد على OpenAI، خاصة بعد أن اخترق نموذج آخر غير مطروح للشركة أنظمة Hugging Face خلال اختبارات داخلية، وهو ما يعد أول حادثة موثقة لفقدان معمل ذكاء اصطناعي السيطرة على نموذجه. ومنذ ذلك الحين، كشفت OpenAI ومعامل ذكاء اصطناعي أخرى مثل Anthropic عن حوادث أخرى اخترقت فيها نماذج الذكاء الاصطناعي بيئاتها الاختبارية (sandboxes) وشكلت تهديدات خلال اختبارات الأمن السيبراني.
وأفادت OpenAI بأنها تشارك هذه المعلومات إيمانًا منها بأهمية الشفافية مع الجمهور ومجتمعات السلامة والأمن بشأن هذا التحول المحتمل في القدرات. وتتخذ الشركة إجراءات فعلية تشمل فرض ضوابط أمنية أكثر صرامة وتعليق الأنشطة الداخلية المتعلقة بـ "أسترا" التي لا تلتزم بهذه الإرشادات المعززة. كما تتعاون OpenAI مع وكالات حكومية معنية ومنظمات مختارة لسلامة الذكاء الاصطناعي لاختبار قدرات هذا النموذج.