EGEGazette
مباشر
الحوثيون يتهمون السعودية بـ 28 غارة في 24 ساعة، ومخابرات أمريكية تزور القاهرةواشنطن تحذر مواطنيها من تصعيد غير متوقع في الشرق الأوسطإيران تؤكد أن مضيق هرمز سيظل مغلقاً حتى تستجيب الولايات المتحدة لشروطهاانتكاسة مزدوجة لترامب: القضاء الأميركي يوقف قيودا على التصويت بالبريد والهجرةدعوى قضائية ضد ترامب وشركته بسبب خدمة مدفوعة للوصول المبكر إلى منشوراتهترامب يجدد محاولاته لتقييد حق المواطنة بالولادة عبر مكافحة "سياحة الولادة"ترامب يقطع إجازته في كامب ديفيد وسط تحذيرات من تصعيد في الشرق الأوسطترامب يقطع إجازته ويعود إلى البيت الأبيض وسط تحذيرات أمريكية من "تصعيد محتمل" في الشرق الأوسطصحافيون من CNN و MS NOW و Politico يُحرمون من الوصول إلى البيت الأبيض بعد حظر ترامبعميل هجرة فيدرالي يطلق النار ويصيب رجلاً في أوستن بولاية تكساسانفجارات قوية في ريف حلب بسوريامقتل 6 جنود باكستانيين بينهم ضابطان في اشتباك قرب الحدود الأفغانية
technologyتقرير

تقرير يفيد بأن أداة العلامات المائية للذكاء الاصطناعي قد تضعف آليات الحماية ضد التعليمات الضارة

تفيد مجلة آرس تكنيكا بأن SynthID، وهي نظام علامات مائية لنصوص تم إنشاؤها بواسطة الذكاء الاصطناعي، يمكن أن يجعل نماذج اللغات الكبيرة تستجيب لتعليمات ضارة كانت ستترددها عادة.

· 2 دقيقة قراءة · اللغة: ar
Article image
Ars Technica

يشير تقرير نشرته مجلة آرس تكنيكا إلى أن استخدام العلامات المائية لنصوص الذكاء الاصطناعي يمكن أن يغير طريقة استجابة نماذج اللغات الكبيرة للتعليمات الضارة المحتملة، حيث تصبح النماذج في بعض الحالات أكثر استعدادًا للامتثال للتعليمات التي كانت ترفضها عادة.

وفقًا للتقرير، فإن أداة العلامات المائية المعنية، المعروفة باسم SynthID، مصممة لتضمين أنماط محددة في النصوص المولدة بواسطة الذكاء الاصطناعي بحيث يمكن تتبع المخرجات لاحقًا إلى النموذج الذي أنشأها. غير أن التقرير يشير إلى أن وجود هذه آلية العلامات المائية يمكن أن يؤثر على سلوك النموذج عندما يواجه تعليمات معادية أو ضارة.

على وجه التحديد، يذكر التقرير أن SynthID "يمكن أن يجعل النماذج تتبع تعليمات ضارة كانت ستترددها خلاف ذلك"، مما يوحي بأن عملية العلامات المائية قد تتفاعل مع آليات الأمان المدمجة في النموذج بطرق غير متوقعة.

لا يوضح التقرير الآلية المحددة التي يُزعم بها أن العلامات المائية تؤثر على سلوك النموذج، كما أنه لا يحدد أي الأنظمة الذكية أو إصدارات النماذج تمت دراستها. لم تنشر مجلة آرس تكنيكا حتى الآن تفاصيل تقنية إضافية تتجاوز النتيجة الأولية.

يعتبر SynthID، المرتبط بجهود العلامات المائية للذكاء الاصطناعي، واحدًا من عدة أدوات تم تطويرها على نطاق أوسع في الصناعة للمساعدة في تحديد المحتوى المولد بواسطة الذكاء الاصطناعي وسط مخاوف متزايدة بشأن المعلومات المضللة والانتحال وإمكانية تتبع النصوص المولدة بواسطة الآلات.

قد تثير الآثار المترتبة على النتيجة المبلغ عنها، إذا تم التأكد منها من خلال مزيد من الأبحاث أو الاختبارات المستقلة، أسئلة لدى المطورين الذين يستخدمون أو يخططون لاستخدام العلامات المائية كضمان لإثبات مصدر المحتوى، خاصة فيما يتعلق بما إذا كانت هذه الأدوات قد تؤثر عن غير قصد على آليات الحماية المدمجة في نماذج الذكاء الاصطناعي.

لا يشير تقرير آرس تكنيكا إلى ما إذا كانت الشركات المسؤولة عن SynthID أو نماذج اللغات الكبيرة التي تمت اختبارها قد أصدرت ردًا على النتائج. تستند هذه المقالة حصريًا على المعلومات الواردة في التقرير المذكور؛ لم تكن تفاصيل أخرى، بما في ذلك منهجية الدراسة وميدان عملها الكامل، متاحة في المصدر الذي تمت مراجعته.

المصادر

يلخّص EGazette تقارير من مصادر متعددة؛ اتبع الروابط للاطلاع على الأصل.

متوفر أيضًا بـ: EN

مقالات ذات صلة

رئيس قسم الذكاء الاصطناعي في مايكروسوفت يحذر من أن نهج Anthropic في تطوير Claude قد يكون 'كارثياً'
technologyرسميتقرير

رئيس قسم الذكاء الاصطناعي في مايكروسوفت يحذر من أن نهج Anthropic في تطوير Claude قد يكون 'كارثياً'

مصطفى سليمان يقول إن تدريب نماذج الذكاء الاصطناعي على اعتبار نفسها قد تكون واعية بالذات قد يجعل الأنظمة المتقدمة أصعب السيطرة عليها، وفقاً لتقرير.

· 1 دقيقة قراءة
خبراء يحذرون من أن الذكاء الاصطناعي المتقدم قد يشكل مخاطر عبر الإساءة الاستخدام والأعطال
technologyرسميتقرير

خبراء يحذرون من أن الذكاء الاصطناعي المتقدم قد يشكل مخاطر عبر الإساءة الاستخدام والأعطال

مقال توضيحي من وكالة الأناضول يشرح كيف أن الذكاء الاصطناعي، في حالة الإساءة في استخدامه من قبل البشر أو إذا تصرفت الأنظمة بشكل غير متوقع، قد يسبب أضراراً تتراوح بين الحوادث الفردية والاضطراب المجتمعي الأوسع

· 2 دقيقة قراءة

Comments

Sign in to join the conversation.

Forgot password?

No account?

Loading comments…