أبطأت OpenAI تطوير بعض جوانب نموذجها المرتقب للذكاء الاصطناعي Astra، وعلّقت أنشطة داخلية مرتبطة به، بعدما أظهرت تقييمات أولية أن قدراته في الأمن السيبراني والبرمجة القائمة على الوكلاء وصلت إلى مستوى دفع الشركة إلى تطبيق إجراءات حماية أكثر صرامة خلال مرحلة التطوير نفسها.
وبحسب إفصاح نشرته OpenAI، فإن الاختبارات الأولية للنموذج أظهرت أداءً قوياً إلى درجة جعلت الشركة غير قادرة في الوقت الحالي على استبعاد وصوله إلى مستوى القدرات السيبرانية "الحرجة Critical"، وهو أعلى مستوى للمخاطر ضمن إطار الاستعداد Preparedness Framework الذي تستخدمه الشركة لتقييم المخاطر المحتملة لنماذجها الأكثر تقدماً.
وفقاً للشركة، فإن قدرات النموذج قد تخلق مساراً جديداً نوعياً لمخاطر جسيمة، بما يستوجب تطبيق ضمانات وإجراءات أمنية خلال عملية التطوير نفسها، وليس فقط قبل إتاحة النموذج للمستخدمين.
وتشير النتائج الأولية المتعلقة بالنموذج إلى تقدم كبير في قدرته على التعامل مع مهام الأمن السيبراني، بما قد يسمح لنظام ذكاء اصطناعي بالعثور بصورة مستقلة على نقاط ضعف وتنفيذ هجمات ضد أنظمة حقيقية تتمتع عادة بمستويات قوية من الحماية، بحسب تقرير لموقع TechCrunch.
وأكدت OpenAI أن التقييمات لا تزال مستمرة، وأنها لم تتوصل بعد إلى تصنيف نهائي لقدرات Astra، لكنها رأت أن مستوى الأداء الحالي مرتفع بما يكفي للتعامل معه مؤقتاً باعتباره نموذجاً قد يصل إلى مستوى فائق من القدرات الحرجة، إلى حين استكمال الاختبارات وقياس قدراته بصورة أكثر دقة.
وشددت الشركة على أن Astra لا يزال قيد التطوير، ولم يكن النموذج الذي شارك في حادثة اختراق أنظمة منصة Hugging Face خلال اختبارات أمنية سابقة، في محاولة للفصل بين النموذج الجديد والحادثة التي أثارت نقاشاً واسعاً بشأن قدرة مختبرات الذكاء الاصطناعي على السيطرة على النماذج والوكلاء المتقدمين أثناء الاختبارات.
إجراءات أمنية مشددة
بالتوازي مع إبطاء بعض جوانب التطوير، بدأت OpenAI تطبيق حزمة من الإجراءات الأمنية الإضافية على Astra. وتشمل هذه الإجراءات استخدام بيئات اختبار أكثر عزلاً، وفرض قيود على وصول النموذج إلى الشبكات والأدوات الخارجية، وتعزيز حماية أوزان النموذج وتشفيرها، وتوسيع أنظمة المراقبة والكشف، إلى جانب تشغيل المهام في بيئات معزولة Sandboxed Execution.
كما علّقت الشركة الأنشطة الداخلية المرتبطة بـAstra التي لا تستوفي حتى الآن متطلبات الحماية الجديدة، ما يعني أن العمل على النموذج لم يتوقف بالكامل، وإنما أصبح استمرار بعض مسارات التطوير مشروطاً بالالتزام بمستوى أعلى من الضوابط الأمنية.
ووسعت OpenAI كذلك نطاق المراقبة ليشمل جميع التطبيقات القائمة على الوكلاء باستخدام Astra، سواء خلال التدريب أو التقييم، بحيث تراقب.....
لقراءة المقال بالكامل، يرجى الضغط على زر "إقرأ على الموقع الرسمي" أدناه
هذا المحتوى مقدم من الشرق للأخبار
