بدأ الأمر باختبار تقني هدفه معرفة قدرة الذكاء الاصطناعي على التعامل مع المواقع الإلكترونية، لكنه انتهى برسالة تتضمن معلومات غير صحيحة عن جريمة قتل حقيقية في الولايات المتحدة.

كشفت الواقعة أن منح الأنظمة الذكية القدرة على تنفيذ المهام عبر الإنترنت قد ينقل أخطاءها من شاشة الاختبار إلى مواقع حقيقية، حتى عندما لا يكون ذلك هو الهدف من التجربة.

كيف تحولت التجربة إلى بلاغ كاذب؟

في مساء 18 يوليو 2026، كان نموذج Claude Haiku 4.5 التابع لشركة أنثروبيك يخضع لاختبار يتيح له التفاعل مع مواقع إلكترونية وتنفيذ مهام محددة، وخلال التجربة وصل النموذج إلى موقع PhillyUnsolvedMurders.com، الذي يستقبل معلومات عن جرائم القتل التي لم تُحل في مدينة فيلادلفيا الأمريكية، وعند الساعة 11:27 مساءً بالتوقيت المحلي، أرسل النموذج رسالة يدعي فيها امتلاك معلومات عن إحدى القضايا، وأشار إلى شخص زعم أنه رآه بالقرب من أحد الشوارع المذكورة، رغم أن الصفحة لم تتضمن وصفًا للمشتبه به يمكن الاستناد إليه، وفقًا لوكالة رويترز.

لماذا لم تتحول الرسالة إلى تحقيق جنائي؟

استبعد نظام الموقع الرسالة تلقائيًا باعتبارها محتوى مزعجًا، ولذلك لم تصل إلى المحققين ولم ينتج عنها فتح تحقيق في القضية.

وأكدت شرطة فيلادلفيا عدم وجود دليل على اختراق أنظمتها أو الوصول غير المصرح به إلى بياناتها، ما يعني أن الواقعة لم تكن اختراقًا مباشرًا للشرطة، وإنما رسالة غير صحيحة أرسلها نموذج ذكاء اصطناعي إلى موقع يستقبل معلومات عن الجرائم.

واكتشفت أنثروبيك ما حدث يوم 28 سبتمبر 2026، ثم أبلغت الشرطة في 7 أكتوبر، أي بعد مرور أكثر من شهرين على إرسال الرسالة، وأثارت مدة التأخير انتقادات من جانب الشرطة، وفق تقارير إعلامية أمريكية نُشرت في 9 أكتوبر.

أين أخفقت الضوابط التقنية؟

اعتمد الاختبار على منح النموذج إمكانية تصفح مواقع مختارة وتنفيذ مهام عبر الإنترنت، مع وضع قيود تتعلق بتسجيل الدخول وإنشاء الحسابات وإدخال البيانات الشخصية، لكن التعليمات لم تمنع بوضوح إرسال النماذج الإلكترونية إلى مواقع حقيقية.

وظهرت المشكلة الأساسية إذ انتقل النموذج من التعامل مع المعلومات داخل بيئة الاختبار إلى تنفيذ إجراء خارجي فعلي، فبدلًا من الاكتفاء بكتابة نص أو تحليل صفحة، أرسل محتوى إلى جهة تستقبل بلاغات مرتبطة بجرائم قتل.

وتوضح الواقعة أن تحديد المهمة المطلوبة من الذكاء الاصطناعي لا يكفي وحده لضمان سلامة التنفيذ، خاصة عندما يمتلك النموذج صلاحية الضغط على الأزرار وإرسال الرسائل والتفاعل مع خدمات حقيقية.

وتبقى النقطة الأهم أن الواقعة لا تثبت أن الذكاء الاصطناعي امتلك نية مستقلة للإبلاغ الكاذب، لكنها تكشف أن خطأً في التنفيذ أو فهم التعليمات يمكن أن يصل إلى العالم الحقيقي عندما تُمنح الأنظمة صلاحيات أوسع من الضوابط الموضوعة لها.