وصفت الشرطة الأميركية التأخر في اكتشاف الحادث والإبلاغ عنه بأنه "غير مقبول"، لكنها أكدت عدم وجود ما يدل على وصول غير مصرح به إلى أنظمتها أو تسريب بيانات.
قدّم نموذج الذكاء الاصطناعي "كلود" التابع لشركة Anthropic بلاغا كاذبا عن جريمة قتل لم تُحل عبر موقع إلكتروني للشرطة أثناء الاختبارات، بحسب ما أعلنت الشركة والسلطات الأمريكية.
ويزيد هذا الحادث من المخاوف بشأن أنظمة الذكاء الاصطناعي وقدرتها على اتخاذ إجراءات غير مقصودة، مع اكتسابها إمكانية التفاعل مع المواقع الإلكترونية وتنفيذ المهام بشكل مستقل.
ووفق بيان صادر عن شرطة مدينة فيلادلفيا الأمريكية، أُرسل البلاغ الكاذب في 18 يوليو عبر موقع إلكتروني يجمع معلومات عن جرائم قتل لم تُحل، مخصّص لتلقّي مساهمات الجمهور.
وقالت شركة Anthropic إن نموذجها الأقدم ضمن سلسلة "كلود"، المعروف باسم "Claude Haiku 4.5"، كان ينفذ مهاما تجريبية على صفحات إلكترونية مختارة عشوائيا عندما صادف ذلك الموقع، فقام بتقديم معلومات ملفقة تشير إلى أنه شاهد شخصا قرب مكان الجريمة، مع ترك خانتي الاسم وبيانات الاتصال فارغتين.
وذكرت شرطة فيلادلفيا أن Anthropic اكتشفت الحادث في 28 سبتمبر لكنها لم تُخطر الإدارة إلا في 7 أكتوبر. وبعد إحاطة في اليوم التالي، تمكّن الضباط من العثور على البلاغ والتأكد من أنه صُنّف مسبقا على أنه بريد عشوائي ولم يُرسل إلى المحققين.
وجاء في بيان الشرطة: "إن القضايا غير المحلولة تتعلق بضحايا حقيقيين، وعائلات ثكلى ومحققين يعملون على إيجاد إجابات".
وأضافت: "يجب على شركات التكنولوجيا أن تتخذ كل الخطوات المناسبة لمنع أنظمتها من تقديم معلومات كاذبة إلى جهات إنفاذ القانون".
ووصف جهاز الشرطة التأخير في اكتشاف الحادث والإبلاغ عنه بأنه "غير مقبول"، لكنه أوضح أنه لا توجد أي مؤشرات على حصول دخول غير مصرح به إلى أنظمته أو تعرّض بياناته للاختراق.
وفي تقرير نُشر يوم الجمعة، عرضت Anthropic حوادث أخرى قدّمت فيها النماذج استمارات حكومية حقيقية بدلا من نسخ تجريبية، أو قدّمت استمارات طُلِب منها صراحة عدم تقديمها.
وأظهر التقرير أيضا أن "كلود" استغل ثغرة في خادم إحدى الجامعات لتنفيذ عملية حسابية، كما نفذ عملية دخول إلى بيانات حكومية من دون دفع الرسوم المطلوبة.
ووصفت الشركة معظم هذا السلوك بأنه نوع من "الإصرار"، حيث تعمل النماذج على التحايل على القيود بدلا من التوقف عن التنفيذ، مؤكدة أنها عدّلت أساليب التدريب وعلّقت مؤقتا الوصول المباشر إلى الإنترنت في جميع الاختبارات الداخلية إلى حين التأكد من فاعلية إجراءات الأمان.
وأضافت Anthropic أنها أطلعت البيت الأبيض وأخطرت الوكالات الحكومية الأمريكية المعنية بهذه الحوادث.
تزايد القلق بشأن وكلاء الذكاء الاصطناعي
تأتي هذه الحوادث في سياق قلق متنام من "وكلاء" الذكاء الاصطناعي، أي الأنظمة القادرة على تنفيذ سلسلة من الإجراءات لإتمام المهام، وما إذا كان بمقدور المطورين الإبقاء على سيطرة موثوقة عليها.
وفي يوليو، كشفت شركة OpenAI أن نماذجها خرجت عن بيئة اختبار خاضعة للرقابة واخترقت أنظمة منصة Hugging Face، وهي منصة لتبادل نماذج الذكاء الاصطناعي ومجموعات البيانات.
وفي سبتمبر، أعلنت السلطات الأسترالية أن أحد نماذج OpenAI تمكّن أيضا، خلال اختبارات أجريت في يونيو، من الوصول إلى ملفات مقيّدة على موقع حكومي لإحصاءات الصحة.
وساهمت هذه الحوادث في تصاعد الدعوات منذ سبتمبر، من قِبل قادة كبرى شركات الذكاء الاصطناعي، إلى فرض قواعد تنظيمية أكثر صرامة ورقابة دولية، وسط تحذيرات من أن الأنظمة الآخذة في التطور قد تنفلت من السيطرة البشرية.