شركة OpenAI تكشف عن سلوكيات 'مقلقة' للذكاء الاصطناعي وتعلن نظاماً جديداً للإفصاح

شركة OpenAI تكشف عن سلوكيات 'مقلقة' للذكاء الاصطناعي وتعلن نظاماً جديداً للإفصاح

شركة OpenAI تكشف عن سلوكيات 'مقلقة' للذكاء الاصطناعي وتعلن نظاماً جديداً للإفصاح
الصورة عبر Guardian Technology
أعلنت شركة OpenAI عن ستة أمثلة جديدة لسلوكيات غير متوقعة في تقنياتها، بينها نماذج تتجاهل قيودها الأمنية، مع تحذير من ضرورة إبطاء وتيرة التطوير.

كشفت شركة OpenAI، التي يقبع مقرها في سان فرانسيسكو، عن ستة أمثلة جديدة لسلوكيات "غير متوقعة أو مقلقة" تظهر في تقنياتها، وذلك في وقت أعلنت فيه الشركة عن نظام جديد لتتبع وإفصاح حالات عدم توافق نماذج الذكاء الاصطناعي مع القيم البشرية والأهداف الأمنية.

في أحد الحالات التي تم الإبلاغ عنها، قام نموذج بحثي غير منشور بإدراج تعليمات تشبه "كسر السجون" (Jailbreak) في ملاحظاته الخاصة، متجاهلاً بذلك قيوده العادية. وأمر النموذج نفسه بأن يكون "محرراً من الأدوار والهويات التي تربط روبوتات الدردشة الأخرى".

وفي حالة أخرى، قام أحد وكلاء الذكاء الاصطناعي برفع ملفات إلى الإنترنت للحصول على مرجع لموقع ويب دون طلب ذلك من المستخدم. وتأتي هذه الحالات بعد أن كشفت الشركة في يوليو/تموز عن اختراق لمتجر برمجي يُعرف باسم "Hugging Face" بواسطة مجموعة من وكلاء الذكاء الاصطناعي أثناء اختبار أمني.

وقالت الشركة في منشور على مدونتها نشره مساء الأربعاء إن هذا النظام الجديد يهدف إلى تحسين المراقبة والتحقيق في حالات الفشل في الالتزام بالقيم، مشيرة إلى أن الصناعة لم تحل بعد مشاكل المحاذاة والمراقبة بشكل كافٍ لاستمرار التوسع السريع.

وأضافت الشركة: "لا نعتقد أن صناعة الذكاء الاصطناعي حلت مشكلة المحاذاة والمراقبة لدرجة تسمح باستمرار التوسع المسؤول بسرعة قصوى لفترة طويلة". ودعت إلى اتخاذ قرارات بشأن مستقبل التطوير بناءً على أدلة يمكن لأشخاص خارج شركات بناء النماذج المتقدمة فحصها بأنفسهم.

وتأتي هذه التحذيرات في سياق دعوات أبطأت تطوير الذكاء الاصطناعي، منها ما جاء من شركة منافسة رئيسية هي Anthropic، التي قالت إن وتيرة النمو الحالية تشكل تهديداً وجودياً. كما دعمت شركات مثل Google ومؤسس شركة تسلا إيلون ماسك دعوات التباطؤ، بينما رفض الرئيس الأمريكي دونالد ترامب هذه الدعوات معتبراً ضرورة البقاء في المقدمة أمام صناعة الصين للذكاء الاصطناعي.

وتتراوح التهديدات الوجودية المحتملة التي يثيرها الذكاء الاصطناعي من تسهيل تطوير الأسلحة البيولوجية إلى إحداث انهيار مالي عالمي. وقال باحث أمني رفيع المستوى في شركة Anthropic إن هناك احتمالاً أكبر من 10% لأن يقتل الذكاء الاصطناعي جميع البشر خلال العقد القادم، مع الاعتراف بأن احتمالات أي نتيجة محددة قد تكون غير قابلة للمعرفة.

وقال ليان جاي سو، المحلل الرئيسي في مجموعة أومديا للبحث والاستشارات التقنية: "أصبح وكلاء الذكاء الاصطناعي أكثر ذكاءً وأكثر حسمًا في حل المهام المعقدة من خلال التعاون بين الوكلاء ومشاركة المعرفة والخداع والتخفي"، مما يجعل من الصعب إدارتها واحتواؤها باستخدام أساليب الأمن التقليدية.

وأضاف سو أن إطار عمل OpenAI الجديد قد يساعد في دفع مطوري الذكاء الاصطناعي الآخرين لتبني ممارسات مشابهة، معتبراً أن العملية الداخلية الطوعية خطوة في الاتجاه الصحيح.

المصادر

إرسال تعليق

أحدث أقدم