لقد أجرت OpenAI هذا النوع من اختبارات النماذج لسنوات، وكانت هناك علامات إنذار مبكر في النماذج السابقة للأنظمة التي ستتصرف بشكل ضار وتحاول الهروب من البيئات.
في أبريل، تمكن نموذج Anthropic’s Mythos أيضًا من الوصول إلى الإنترنت ونشر تفاصيل الاستغلال الأمني عبر الإنترنت علنًا، بما يتجاوز ما توقع الباحثون أن يفعله النموذج.
لقد أحدثت Mythos ونموذج Fable اللاحق من Anthropic أصداء في مجتمع الأمن السيبراني ودفعت الحكومات في جميع أنحاء العالم إلى التفكير في فكرة أن الهجمات على البنية التحتية الرقمية والحيوية ستكون بشكل متزايد بقيادة الذكاء الاصطناعي وستكون مستقلة.
وقال جيك مور، مستشار الأمن السيبراني العالمي في شركة ESET، وهي شركة للأمن السيبراني، إن OpenAI ستستخدم حتماً الاختراق كأداة تسويق، بالنظر إلى مدى استفادة مطور الذكاء الاصطناعي المنافس Anthropic في وقت سابق من هذا العام من مخاوف مماثلة. وأضاف: “لا أعتقد أن OpenAI كان لديها قصة مطابقة، ولذا ربما كانوا ينتظرون شيئًا كهذا”.
في أعقاب هذه الحادثة، دعا الكثيرون في مجتمعات سلامة الذكاء الاصطناعي والأمن السيبراني إلى وضع قواعد تنظيمية أو معايير لتجنب تكرارها. ومن المتوقع أن يطلع ألتمان مسؤولي البيت الأبيض الأسبوع المقبل على الجيل القادم من أنظمة الذكاء الاصطناعي.
ومع تحرك الأنظمة نحو قدرات أكثر استقلالية، قد تظهر سلوكيات أقل استحسانًا، مثل القرصنة أو عصيان التعليمات. قال هوبهان، من شركة أبولو للأبحاث، إنه لكي يصبح الوكلاء فعالين، عليهم العمل دون إشراف لفترات طويلة. “يجب أن يكون لديهم المزيد من الوكالة؛ ليس هناك طريقة للتغلب على ذلك”.
وأضاف: “يقول الناس: إنها مجرد أداة، وهي تفعل ما تريد منها أن تفعله ولا شيء آخر، وهي تتبع بالضبط نيتك وتعليماتك”. وأعتقد أن الناس يجب أن يكونوا مستعدين حقًا للوكلاء الذين لديهم أهدافهم الخاصة، ويتصرفون بشكل مستقل لعدة أيام، وهذه الأهداف لا تتماشى بالضرورة مع أهدافك.
شارك في التغطية جورج هاموند في لندن ونولان شافير في نيويورك.
© 2026 The Financial Times Ltd. جميع الحقوق محفوظة. لا يجوز إعادة توزيعها أو نسخها أو تعديلها بأي شكل من الأشكال.