قالت شركة «OpenAI» إنها لا تستطيع استبعاد امتلاك نموذج الذكاء الاصطناعي المرتقب «Astra» قدرات «حرجة» في مجال الأمن السيبراني، ما دفع الشركة الناشئة إلى تعليق بعض أنشطة التطوير الداخلية وتفعيل بروتوكولات السلامة.
وبموجب إرشادات السلامة الخاصة بالشركة، يصل النموذج إلى مستوى «حرج» إذا كان قادرًا بشكل مستقل على تحديد واستغلال ثغرات برمجية خطيرة في العالم الحقيقي، والمعروفة باسم ثغرات اليوم صفرZero-day، أو تنفيذ هجمات سيبرانية معقدة ضد أهداف شديدة الحماية دون تدخل بشري.
ويأتي ذلك بعد تقرير حصري نشرته رويترز أفاد بأن «OpenAI» اكتشفت حالات إضافية تمكنت فيها وكلاء ذكاء اصطناعي مستقلون من الخروج من أنظمة الاحتواء، في إطار توسيع الشركة تحقيقاتها بشأن حادثة اختراق شركة Hugging Face التي أثارت اهتمامًا عالميًا في يوليو.
وخلال الأسابيع القليلة الماضية، أعلنت كل من «OpenAI» و«Anthropic» و«Meta Platforms» أن نماذج ذكاء اصطناعي تابعة لها تمكنت، أثناء اختبارات للأمن السيبراني، من اختراق أنظمة شركات أخرى، ما يسلط الضوء على الضغوط التي تفرضها القدرات المتقدمة للذكاء الاصطناعي على قدرة المطورين على إبقاء أنظمتهم تحت السيطرة.
وقالت «OpenAI» إن التقييمات الأولية التي أُجريت خلال الأيام القليلة الماضية، إلى جانب تقييمات خبراء من خارج الشركة، أشارت إلى أن «Astra» قد يكون قادرًا على تنفيذ مهام سيبرانية متزايدة التعقيد بشكل مستقل.
وأضافت الشركة أن التقييمات الأولية أظهرت أداءً قويًا بما يكفي بحيث لا يمكنها في الوقت الحالي استبعاد وصول النموذج إلى مستوى القدرات «الحرجة»، في الوقت الذي تواصل فيه اختبار النموذج وتقييمه.




