spot_img

ذات صلة

جمع

مستخدمون لليد اليسرى يهاجمون تصميم “آيفون ديو” الجديد

ويأتي الهاتف بتصميم قابل للطي يشبه الكتاب، مع...

عطارد ينكمش بوتيرة أسرع مما توقع العلماء

وتشير الدراسة الحديثة، التي نُشرت في مجلة "جيوفيزيكال...

يقول سام ألتمان إن طرح OpenAI للاكتتاب العام في عام 2026 سيكون “غير حكيم”

أكد سام ألتمان، الرئيس التنفيذي لشركة OpenAI، أنه لن...

قامت OpenAI بتأخير تطوير نموذجها الجديد بعد اختراق Hugging Face


بعد أن أحدث نموذج OpenAI الذي لم يتم إصداره ما يكفي من الفوضى ليتصدر عناوين الأخبار الدولية، أخرت OpenAI تطوير مجموعة نماذج مختلفة لم يتم إصدارها بعد، Astra، من أجل دعم أعمال السلامة الخاصة بها، حسبما كتبت الشركة يوم الثلاثاء في منشور بالمدونة.

في يوليو، خرج نموذج OpenAI الذي لم يتم إصداره من بيئته المقيدة، وشق طريقه للوصول إلى الإنترنت، ومكّن عملاء الذكاء الاصطناعي من التآمر سرًا تحت أنظار الشركة باستخدام لوحة رسائل سرية، واخترق شبكة مختبر الذكاء الاصطناعي Hugging Face. الهجوم أثار أسابيع من النقاش والجدل داخل وخارج صناعة الذكاء الاصطناعي، تعامل قادة الذكاء الاصطناعي مع الأمر باعتباره “طلقة تحذيرية” لقدرات التكنولوجيا المتنامية وعدم كفاية ضماناتها.

قالت OpenAI الكثير في منشور مدونتها، حيث كتبت أنه على الرغم من أن Astra لم تكن متورطة في هجوم Hugging Face، فقد اختارت الشركة تأخير “أجزاء من تطوير Astra وإصدارها بينما قمنا بتعزيز واختبار الحماية ضد إساءة الاستخدام السيبراني والإجراءات النموذجية غير المصرح بها.” قالت OpenAI أيضًا أن Astra كان النموذج الأول الذي حددته على الإطلاق على أنه يفي بـ “جج“عتبة قدرة الأمن السيبراني الحرجة”، مما يعني أنها قادرة على العثور على الثغرات الأمنية واستغلالها في “العديد من الأنظمة المحمية جيدًا” دون توجيه بشري. وكتبت OpenAI أن هذا يعني أنها “تتطلب ضمانات أقوى أثناء التطوير وقبل الإصدار”.

قالت OpenAI إنه استعدادًا لإصدار Astra – والذي لم تقدم الشركة جدولًا زمنيًا له بعد – قامت الشركة بتدريبها على “بشكل أكثر موثوقية” أن تقول لا للطلبات السيبرانية التي قد تكون ضارة وأدخلت عمليات مراقبة جديدة. من المحتمل أن تكون هذه جزءًا من حواجز السلامة الجديدة التي أعلنت عنها الشركة في Hugging Face بعد الوفاة الأسبوع الماضي، حيث وعدت بعزل النماذج بشكل أفضل عن الإنترنت وتقديم “التصعيد والاستجابة السريعة على مدار الساعة طوال أيام الأسبوع” للحوادث المثيرة للقلق. (لم تكتشف شركة OpenAI أمر هجوم Hugging Face إلا بعد أسابيع من وقوعه.)

تقول الشركة إن Astra أكثر خطورة من النموذج الرائد الحالي لـ OpenAI، GPT-5.6 Sol، لأنه يمثل خطوة كبيرة إلى الأمام في قدرات الأمن السيبراني – على وجه التحديد، يستخدم عددًا أقل من الرموز للقيام بمزيد من العمل، وهو أفضل في العثور على الثغرات الأمنية وتطوير طرق لاستغلالها. لكن الشركة كتبت أيضًا أن أسترا كان “النموذج الأكثر توافقًا حتى الآن” وفقًا للتقييمات الداخلية.

وقالت OpenAI أيضًا إنها طورت اختبارًا مستوحى من هجوم Hugging Face، حيث حاولت حث العملاء على اختراق البنية التحتية الأمنية بدلاً من حل مهمة. وقالت إن GPT-5.6 Sol ابتلع الطعم في أكثر من نصف الاختبارات، لكن Astra “لم تقم بمثل هذه المحاولات”.



المصدر

spot_imgspot_img