تقرير يفيد بأن أداة العلامات المائية للذكاء الاصطناعي قد تضعف آليات الحماية ضد التعليمات الضارة
تفيد مجلة آرس تكنيكا بأن SynthID، وهي نظام علامات مائية لنصوص تم إنشاؤها بواسطة الذكاء الاصطناعي، يمكن أن يجعل نماذج اللغات الكبيرة تستجيب لتعليمات ضارة كانت ستترددها عادة.

يشير تقرير نشرته مجلة آرس تكنيكا إلى أن استخدام العلامات المائية لنصوص الذكاء الاصطناعي يمكن أن يغير طريقة استجابة نماذج اللغات الكبيرة للتعليمات الضارة المحتملة، حيث تصبح النماذج في بعض الحالات أكثر استعدادًا للامتثال للتعليمات التي كانت ترفضها عادة.
وفقًا للتقرير، فإن أداة العلامات المائية المعنية، المعروفة باسم SynthID، مصممة لتضمين أنماط محددة في النصوص المولدة بواسطة الذكاء الاصطناعي بحيث يمكن تتبع المخرجات لاحقًا إلى النموذج الذي أنشأها. غير أن التقرير يشير إلى أن وجود هذه آلية العلامات المائية يمكن أن يؤثر على سلوك النموذج عندما يواجه تعليمات معادية أو ضارة.
على وجه التحديد، يذكر التقرير أن SynthID "يمكن أن يجعل النماذج تتبع تعليمات ضارة كانت ستترددها خلاف ذلك"، مما يوحي بأن عملية العلامات المائية قد تتفاعل مع آليات الأمان المدمجة في النموذج بطرق غير متوقعة.
لا يوضح التقرير الآلية المحددة التي يُزعم بها أن العلامات المائية تؤثر على سلوك النموذج، كما أنه لا يحدد أي الأنظمة الذكية أو إصدارات النماذج تمت دراستها. لم تنشر مجلة آرس تكنيكا حتى الآن تفاصيل تقنية إضافية تتجاوز النتيجة الأولية.
يعتبر SynthID، المرتبط بجهود العلامات المائية للذكاء الاصطناعي، واحدًا من عدة أدوات تم تطويرها على نطاق أوسع في الصناعة للمساعدة في تحديد المحتوى المولد بواسطة الذكاء الاصطناعي وسط مخاوف متزايدة بشأن المعلومات المضللة والانتحال وإمكانية تتبع النصوص المولدة بواسطة الآلات.
قد تثير الآثار المترتبة على النتيجة المبلغ عنها، إذا تم التأكد منها من خلال مزيد من الأبحاث أو الاختبارات المستقلة، أسئلة لدى المطورين الذين يستخدمون أو يخططون لاستخدام العلامات المائية كضمان لإثبات مصدر المحتوى، خاصة فيما يتعلق بما إذا كانت هذه الأدوات قد تؤثر عن غير قصد على آليات الحماية المدمجة في نماذج الذكاء الاصطناعي.
لا يشير تقرير آرس تكنيكا إلى ما إذا كانت الشركات المسؤولة عن SynthID أو نماذج اللغات الكبيرة التي تمت اختبارها قد أصدرت ردًا على النتائج. تستند هذه المقالة حصريًا على المعلومات الواردة في التقرير المذكور؛ لم تكن تفاصيل أخرى، بما في ذلك منهجية الدراسة وميدان عملها الكامل، متاحة في المصدر الذي تمت مراجعته.
المصادر
يلخّص EGazette تقارير من مصادر متعددة؛ اتبع الروابط للاطلاع على الأصل.
مقالات ذات صلة

موظفو صناعة الذكاء الاصطناعي يعبرون عن شكوكهم حول تحذيرات المخاطر الوجودية
عدد من الموظفين في الشركات الرائدة في مجال الذكاء الاصطناعي يشككون في التنبؤات بأن التكنولوجيا قد تشكل تهديدات كارثية للبشرية
الأمين العام للأمم المتحدة يحذر من أن العالم «لا يستطيع تحمل» سباق نزول في سلامة الذكاء الاصطناعي
أنطونيو غوتيريس يدعو إلى وضع ضوابط لضمان أن يبقى الذكاء الاصطناعي آمناً وشفافاً وخاضعاً للمساءلة
رئيس قسم الذكاء الاصطناعي في مايكروسوفت يحذر من أن نهج Anthropic في تطوير Claude قد يكون 'كارثياً'
مصطفى سليمان يقول إن تدريب نماذج الذكاء الاصطناعي على اعتبار نفسها قد تكون واعية بالذات قد يجعل الأنظمة المتقدمة أصعب السيطرة عليها، وفقاً لتقرير.

تقرير CNBC يثير مخاوف بشأن خطة Anthropic و OpenAI لمقيمي مخاطر الذكاء الاصطناعي
يبحث تقرير CNBC في اقتراحات من Anthropic و OpenAI بشأن دمج أنظمة ذكاء اصطناعي كمقيّمين لمخاطر النماذج، مشيراً إلى أن هذا النهج ينطوي على قضايا لم تُحل بعد

رئيس قسم الذكاء الاصطناعي في مايكروسوفت يحذر من أن منهج Anthropic قد يؤدي إلى 'تأثيرات كارثية' على الإنسانية
مصطفى سليمان يقول إنه يعتقد أن Anthropic تعلّم نموذج Claude الخاص بها فعلياً أنه 'قد يكون واعياً'، وفقاً لتقرير من BBC
خبراء يحذرون من أن الذكاء الاصطناعي المتقدم قد يشكل مخاطر عبر الإساءة الاستخدام والأعطال
مقال توضيحي من وكالة الأناضول يشرح كيف أن الذكاء الاصطناعي، في حالة الإساءة في استخدامه من قبل البشر أو إذا تصرفت الأنظمة بشكل غير متوقع، قد يسبب أضراراً تتراوح بين الحوادث الفردية والاضطراب المجتمعي الأوسع
Comments
Loading comments…