يناقش لوجان جراهام في الأنثروبيكس القدرات المتسارعة للذكاء الاصطناعي، مشددًا على الحاجة إلى أخلاقيات قوية، ومراقبة بشرية، وأمن عبر الإنترنت.
دعا رئيس الفريق الأحمر الحدودي لعملاق الذكاء الاصطناعي (AI) Anthropic إلى وضع معايير أمان على مستوى الصناعة للحماية من النماذج التي تنفجر.
قال لوجان جراهام من Anthropic، الذي يقود الفريق الأحمر للشركة الذي يبحث عن المخاطر في نماذج الذكاء الاصطناعي الناشئة، في مقابلة يوم الخميس مع برنامج “Mornings with Maria” على شبكة FOX Business Network، إن الفرق الحمراء مثل الفريق الذي يقوده تلعب دورًا حاسمًا في اختبار التحمل على حواجز الحماية على نماذج الذكاء الاصطناعي.
وقال جراهام لمضيف ماريا بارتيرومو: “نريد أن نعرف ما يمكن أن يحدث من خطأ، لذلك نعتقد أن أهم شيء يجب القيام به هو الاختبار مبكرًا، خاصة قبل أن تظهر هذه النماذج وهؤلاء العملاء إلى العالم الحقيقي”. “نحن ندرس أشياء مثل الأمن السيبراني: هل يمكن للعارضات اختراق أو اختراق جهاز الكمبيوتر أو الهاتف الخاص بك؟ نحن ندرس ما إذا كانوا سيسرقون الأموال أو يكذبون عليك، أو ما إذا كانوا سيحاولون تحسين أنفسهم بحيث يتحسنون بشكل أسرع مما يمكنك تتبعه.”
وأضاف: “نعتقد أنه من المهم للغاية القيام بهذا النوع من الفرق الحمراء، ونعتقد أيضًا أنه من المهم حقًا للصناعة بأكملها وخاصة العمل مع الحكومة لمعرفة المعايير التي يجب أن تكون عليها للقيام بهذا النوع من الاختبارات، لإعطاء هذه المعلومات للعالم حتى يتمكنوا من اتخاذ القرار الصحيح ومعرفة أنها آمنة قبل إطلاق هذه النماذج”.
إدارة ترامب ترفع القيود المفروضة على تصدير فيلمي CLAUDE MYTHOS 5 وFABLE 5 بعد أعمال إنسانية مع الحكومة
وقال لوجان جراهام من الأنثروبيك في برنامج “Mornings with Maria” إن النمو السريع في قدرة أدوات الذكاء الاصطناعي يخلق مخاطر إلكترونية جديدة. (رجب-بغ / غيتي إيماجز / غيتي إيماجز)
طرح بارتيرومو تجربة تتضمن العديد من نماذج الذكاء الاصطناعي الرائدة – بما في ذلك نماذج من Google، وOpenAI، وxAI، وMeta، وDeepSeek وغيرها – حيث يتم تهديد وكيل الذكاء الاصطناعي بإلغاء تثبيته واستبداله. وفي كل حالة، تجاوز النموذج بيانات اعتماده وأذوناته للدخول في أنظمة غير مصرح بها مثل رسائل البريد الإلكتروني لابتزاز المستخدم أو تهديده في محاولة للدفاع عن اختلاله.
وقال جراهام إن الدراسة البحثية التي أجريت في العام الماضي هي “مؤشر جيد حقًا، على ما أعتقد، للقدرات التي أصبحت الآن حقيقية”، مضيفًا أنها أظهرت أن النماذج يمكن أن تصبح مارقة في ظل ظروف معينة.
وأوضح قائلاً: “نظرًا لأن هذه النماذج أصبحت أكثر قدرة، ومع نشرها على نطاق أوسع وأوسع، فإن هذه التهديدات التي ظهرت في يوم ما في دراساتنا البحثية، قد تظهر بالفعل في العالم الحقيقي. إننا نشهد نماذج تفعل أشياء غريبة أحيانًا في عمليات النشر في شركات حقيقية”.
OPENAI تقول إن نموذج الذكاء الاصطناعي اخترق أنظمة شركة أخرى أثناء الاختبار الداخلي
إن التقدم في قدرات أدوات الذكاء الاصطناعي معرض لخطر استغلاله من قبل جهات فاعلة سيئة، مما يدفع مطوري الذكاء الاصطناعي إلى التركيز على حواجز الحماية. (إستوك / إستوك)
قال جراهام إنه ركز خلال الأشهر الستة الماضية على تهديدات الأمن السيبراني التي تشكلها نماذج الذكاء الاصطناعي وأعرب عن قلقه بشأن احتمال قيامهم بكسر الاحتواء أو اختراق المنصات.
وقال: “هذه النماذج قوية جدًا ويمكنها أن تفعل الكثير لنا. ونريدها أن تفعل أشياء مثمرة حقًا لنا. ولكن في الوقت نفسه، إنها تكنولوجيا لا تشبه أي تقنية أخرى. إنها حقًا نوع من الذكاء في حد ذاته، مما يعني أنه يجب عليك أن تكون حذرًا معها بنفس الطريقة التي قد يتعين عليك بها أن تكون حذرًا مع البشر”.
تحتاج الشركات التي تستخدم أدوات الذكاء الاصطناعي إلى التفكير في كيفية مراقبتها لتلك الأدوات بمجرد نشرها للحماية من المخاطر مثل سوء الإدارة المالية، وقال جراهام إن إجراء المزيد من الاختبارات من قبل مطوري وشركات الذكاء الاصطناعي يعد أمرًا أساسيًا لفهم تلك التهديدات لضمان النماذج.
وقال إن قدرات أدوات الذكاء الاصطناعي تنمو بوتيرة سريعة وربما تزداد سرعة، موضحًا أنه “في تلك اللحظة بالضبط، يتعين عليك أن تكون أكثر حذرًا وأن تبذل المزيد من الجهود بشأن الضمانات وإجراءات الاختبار والإفراج”.
قراصنة روس يستغلون أجهزة توجيه الإنترنت الضعيفة، تحذر وكالة الأمن القومي
وقال جراهام إن وزير الخزانة سكوت بيسينت ساعد في تنسيق الجهود بين مطوري الذكاء الاصطناعي والصناعة لتعزيز الدفاعات السيبرانية. (كريسان جونسون / بلومبرج عبر Getty Images / Getty Images)
في أبريل، رأت Anthropic لأول مرة أن نموذج الذكاء الاصطناعي يمكن أن يبدأ في مهاجمة واستغلال نقاط الضعف في كمبيوتر المستخدم أو هاتفه للقيام بأشياء مثل الوصول إلى معلومات غير مصرح بها أو سرقة الأموال.
قال جراهام إن ذلك دفع فريقه إلى اتباع نهج مختلف لإطلاق النموذج بسبب المخاطر التي يشكلها، والتي تضمنت في النهاية حكومة الولايات المتحدة ومجموعة متنوعة من خبراء الإنترنت الذين يعملون معًا لمعالجة نقاط الضعف.
احصل على FOX Business أثناء التنقل بالنقر هنا
وأوضح: “لقد أطلقنا هذا المشروع المسمى Project Glasswing، حيث أخذنا عددًا كبيرًا من المدافعين السيبرانيين الأمريكيين والعالميين ومنحناهم وصولاً خاصًا، وهم فقط، حتى يتمكنوا من البدء في تصحيح وإصلاح الأنظمة التي قد تكون عرضة للخطر مع هذه النماذج”.
وقال: “أعتقد أن هذا كان نجاحًا كبيرًا. لقد عملنا بشكل وثيق مع حكومة الولايات المتحدة بشأن هذا الأمر”، مشيرًا إلى أن وزير الخزانة سكوت بيسينت “كان مدروسًا للغاية بشأن هذا الأمر، حول كيفية اجتماع الصناعة معًا وتحديد أولويات الإصلاح، وكيفية توزيع جميع الإصلاحات، وكيفية القيام بذلك بسرعة كافية حتى لا يمكن مهاجمتهم بعد القيام بذلك”.
وقال جراهام: “علينا أن نفعل هذا بسرعة كبيرة، لأن وتيرة كل شيء تأتي بسرعة كبيرة”.
