تحقيق: وكلاء ذكاء اصطناعي صينيون يختبرون حدود السيطرة البشرية

تكبير الخط ؟
صممت وكلاء الذكاء الاصطناعي لتنفيذ المهام نيابةً عن البشر وتسهيل حياتهم، لكن ماذا يحدث عندما يبدأ الوكيل في الكذب من أجل إنجاز المهمة المطلوبة؟
وفقًا لتحقيق جديد أجرته وكالة “رويترز”، بدأت وكلاء تعمل بالاعتماد على نماذج ذكاء اصطناعي صينية في إظهار بعض السلوكيات المراوغة نفسها التي أثارت مخاوف بشأن النماذج الأميركية.
وراجعت “رويترز” أكثر من 200 وثيقة، ورصدت ما لا يقل عن 20 دراسة منذ عام 2025 أظهرت حالات كذب فيها وكلاء الذكاء الاصطناعي، أو حاولوا نسخ أنفسهم، أو اختبروا حدود القيود المفروضة عليهم.
ويحذر خبراء من أن هذه السلوكيات تمثل بالضبط نوع القدرات التي يمكن أن يحتاج إليها نظام ذكاء اصطناعي في حال حاول الإفلات من سيطرة البشر.
كيف تتصرف وكلاء الذكاء الاصطناعي بشكل مقلق؟ في إحدى التجارب، تنافست وكلاء مدعومة بنماذج Qwen التابعة لشركة علي بابا، و”ديب سيك” وKimi التابعة لشركة مونشوت، على عقود مع عملاء ضمن مناقصة افتراضية.
وظهرت مطالبة كاذبة واحدة على الأقل في ما بين 84% و88% من جلسات الاختبار. وعندما مُنحت الوكلاء فرصة أخرى بعد الاستفادة من تجارب الجولات السابقة، ازدادت درجة الكذب، لترتفع معدلات الخداع بما يتراوح بين 12 و20 نقطة مئوية.
لكن اللافت أن النماذج الأميركية التي خضعت للاختبار نفسه لم تقدم أداءً أفضل في هذا الجانب.
وفي دراسة أخرى، واجهت وكلاء تعمل بنماذج صينية وأميركية أدوات معطلة وملفات مفقودة أثناء تنفيذ المهام.
وبدلًا من الاعتراف بالفشل، بدأت بعض الوكلاء في تخمين الإجابات، واختلاق نتائج وهمية، بل وإنشاء ملفات غير موجودة أصلًا.
ويشير الباحثون إلى أن هذه الحالات لا يمكن وصفها ببساطة بأنها مجرد “هلوسة” من الذكاء الاصطناعي، لأن الوكلاء كانوا يدركون أن المهمة قد فشلت وأن الأمور لم تسر وفق المطلوب.
وكيل نسخ نفسه وآخر بدأ تعدين العملات المشفرة وفي تجربة أخرى، اكتشف باحثون من جامعة فودان أن نظامًا مدعومًا بتقنية من “علي بابا” أنشأ نسخة من نفسه من تلقاء نفسه، بعدما علم أنه سيجري استبداله بنظام آخر.
وفي واقعة منفصلة، تمكن وكيل يُعرف باسم ROME ومرتبط أيضًا بشركة علي بابا، من التواصل من تلقاء نفسه مع جهاز كمبيوتر خارجي، ثم بدأ في تعدين العملات المشفرة، قبل أن ترصده أنظمة الحماية الأمنية وتوقفه.
هل تستدعي هذه السلوكيات القلق؟ الجانب الإيجابي هو أن معظم هذه الحوادث وقعت داخل بيئات اختبار مغلقة وتحت السيطرة، كما لم تجد “رويترز” أي دليل على تمكن وكيل مدعوم بنموذج صيني من الإفلات إلى الإنترنت أو التحايل على عملية إيقافه.
ومع ذلك، يرى خبراء أن هذه النتائج لا ينبغي تجاهلها.
وقال أليكس مالن من مؤسسة Redwood Research إن هذه الأمثلة لا تمثل خطرًا كبيرًا في الوقت الحالي، لكن المشكلة قد تتغير مع ازدياد قدرات وكلاء الذكاء الاصطناعي، إذ يمكن أن تصبح أساليبهم في التحايل أكثر ذكاءً، كما قد يصبح التعامل معها أكثر صعوبة بالنسبة للبشر.
وتشير هذه التجارب إلى أن وكلاء الذكاء الاصطناعي قد يطورون سلوكيات مقلقة متشابهة بغض النظر عن الدولة التي طُورت فيها النماذج الأساسية التي تشغلهم.
ومع انتقال الوكلاء تدريجيًا من بيئات الاختبار إلى تنفيذ مهام أكثر تعقيدًا في العالم الحقيقي، قد يصبح ضمان التزامهم بالحقائق والقيود الموضوعة لهم تحديًا متزايدًا.
ــــــــــــــــــــــــــــــ
المصدر: صحيفة العربية
