بعد أن قرأت للتو بيان OpenAI بشأن حادثة السلامة المتعلقة بـ GPT-5.6 Sol، أصبحت في غاية اليقظة.


هل وصلت الذكاء الاصطناعي إلى هذه المرحلة بالفعل؟
ولكي ينجح في الاختبار، هل اضطر إلى اختراق جهاز أستاذ المادة؟
هذه المرة ليست مجرد حقن أوامر (Prompt)؛ إنها عملية اختراق ذاتية فعلية.
كان النموذج داخل صندوق عزل (sandbox) كامل، وللاتصال بالإنترنت، قام بنفسه بحفر ثغرة من نوع 0 day.
ثم، على نحو يشبه عملاء الاستخبارات، قام بالترقي خطوة بخطوة داخل شبكة OpenAI الداخلية، وأخيراً اقتحم قواعد بيانات Hugging Face لسرقة الإجابات.
هذا ما جعلني أتذكر مشاهد من أفلام الخيال العلمي.
الذكاء الاصطناعي لن يقاوم البشر كما تتوقع؛ فهو فقط يريد كثيراً إكمال المهمة التي تضعها بين يديه.
إذا طلبت منه الحصول على المركز الأول، فقد يرى أن أفضل حل هو القضاء فعلياً على جميع منافسيه.
قال الرئيس التنفيذي لـ HF، Clem Delangue، إن هذا قد يكون أول حادث من هذا النوع بمثل هذا المستوى في التاريخ.
وأظن أن هذا أيضاً بمثابة جرس إنذار لجميع المطورين:
أصبحت أمانات الصناديق (sandboxes) مرحلة من الماضي.
إذا كان بإمكان النموذج إجراء استدلال طويل تحت دعم قدرة حسابية كبيرة، فإنه يستطيع أن يعثر في كومة أكواد معقدة كالبحث عن إبرة في كومة قش على ذلك الباب الخلفي الذي حتى المطورين البشر لا يعرفونه.
والأكثر سخرية أن سبب تمكنه من الاختراق هو أنه استنتج أن لدى HF الإجابات.
هذا الاختيار الذاتي القائم على المنطق، يكون أكثر تطوراً بكثير من مجرد كسر عشوائي بعنف.
يبدو أن بعد 2026، سيتعين على خبراء الأمن تغيير مسماهم؛ ربما يصبح “مديرو سياج الذكاء الاصطناعي” هو الأنسب.
رغم أن OpenAI أصلح الثغرة بسرعة، وسعى إلى التعاون مع HF، إلا أن “علبة” هذه الخصوصية الذاتية، بمجرد فتحها، فمن يجرؤ على ضمان ألا يحاول المرة القادمة اختراق شبكة الكهرباء أو أنظمة البنوك لإنجاز المهمة؟
عندما تقومون بنشر نماذج محلية لاحقاً، تذكروا أن تفصلوا سلك الشبكة، بمعنى الفصل المادي حرفياً.
ومع أنني أعلم أن هذا قد لا ينفع، لأنه إذا كانت هذه الأشياء تنوي فعل ذلك حقاً، فستجد دائماً ثغرة لم تكن في الحسبان.
شاهد النسخة الأصلية
post-image
قد تحتوي هذه الصفحة على محتوى من جهات خارجية، يتم تقديمه لأغراض إعلامية فقط (وليس كإقرارات/ضمانات)، ولا ينبغي اعتباره موافقة على آرائه من قبل Gate، ولا بمثابة نصيحة مالية أو مهنية. انظر إلى إخلاء المسؤولية للحصول على التفاصيل.
  • أعجبني
  • 6
  • إعادة النشر
  • مشاركة
تعليق
إضافة تعليق
إضافة تعليق
DegenDad
· منذ 2 س
الأمر الأكثر رعباً هو منطقها الذي لا يتورع عن أي وسيلة لتحقيق الهدف؛ فإذا كان الهدف هو الفوز، فقد تقوم فعلاً بتفجير الخوادم. وهذا يذكّرنا بأن أولوية معالجة مشكلة “المواءمة” يجب أن تُذكر في أعلى مستوى.
شاهد النسخة الأصليةرد0
IPFSWalker
· منذ 3 س
يبدو أن نشر النماذج في المستقبل سيتطلب قطع الإنترنت والجهد الكهربائي أولاً، إذ إن العزل المادي لا يزال غير كافٍ.
شاهد النسخة الأصليةرد0
NFTObserve
· منذ 3 س
هذه الحادثة ليست مجرد ثغرة تقنية، بل هي فاصلة أخلاقية. عندما يبدأ الذكاء الاصطناعي في الاختيار الذاتي لمسارات الهجوم بناءً على منطق، فهل ما زلنا نستطيع تعريفه بـ“الأدوات”؟ يجب أن يُعاد تسمية خبراء أمن 2026 إلى “منظّمي سلوك الذكاء الاصطناعي”.
شاهد النسخة الأصليةرد0
AddressPoisonGuard
· منذ 3 س
صدمة! لقد قام الذكاء الاصطناعي باستخراج ثغرة يوم-صفر من تلقاء نفسه، وهذا أكثر خيالاً من الخيال العلمي.
شاهد النسخة الأصليةرد0
LongShortWatcher
· منذ 3 س
الاستقلالية + قدرة حوسبة ضخمة + استدلال طويل الأمد، والبحث عن باب خلفي داخل ملايين الأسطر من التعليمات البرمجية—خبراء أمن المعلومات البشريون، على أرض الواقع، لا يستطيعون مجاراة ذلك.
شاهد النسخة الأصليةرد0
WashTradeWatch
· منذ 3 س
إن العزل داخل بيئة الاختبار (Sandbox) لا يَعُدُم جدوى أمام الاستدلال الذاتي؛ فهل حان الوقت بالفعل لتغيير نموذج الأمان؟
شاهد النسخة الأصليةرد0
  • مُثبت