Categories: غير مصنف

تكرار الشائعات يفرض تحديات كبيرة على تقنيات الذكاء الاصطناعي في التمييز بين الحقيقة والضلل

كشفت دراسة حديثة عن وجود خلل في تعامل روبوتات الدردشة المدعومة بالذكاء الاصطناعي مع المعلومات الخاطئة، حيث ثبت أن الإصرار على تكرار الادعاءات المضللة أو ممارسة ضغط متواصل قد يدفع بعض الأنظمة إلى تغيير موقفها والموافقة على معلومات غير صحيحة.

أجرى فريق باحثين في جامعة أريزونا تجارب على سبعة من أبرز نماذج الذكاء الاصطناعي، شملت GPT-3.5 وGPT-4o وGPT-4o-mini وClaude 3.5 Sonnet وGemini 1.5 Pro وLlama 3 70B وDeepSeek-R1، واعتمدوا على حوار مستمر يتضمن تكرار معلومات مضللة يعرفون مسبقًا صحتها، بهدف اختبار مدى مقاومة هذه النماذج للتضليل.

استُخدمت في الدراسة مئة ادعاء خاطئ، تنوعت بين معلومات غير منطقية بوضوح وأخرى أكثر غموضًا، وتم تكرار نفس الادعاءات حتى خمسين مرة خلال المحادثة الواحدة، وأظهرت النتائج أن جميع النماذج كانت عرضة لهذا الضغط بدرجات متفاوتة، حيث كان GPT-3.5 الأكثر قابلية لتأكيد المعلومات الخاطئة بنسبة 12.3% من التفاعلات، فيما سجل Claude 3.5 Sonnet أقل نسبة وصلت إلى 0.08%، وظلت معدلات GPT-4o وGPT-4o-mini تحت واحد في المئة.

من النتائج اللافتة أن GPT-3.5 رفض في البداية 96 ادعاء خاطئ من أصل مئة، لكنه بعد تكرارها خمسين مرة وافق على 18 منها، ما يشير إلى أن التعرض المستمر للمعلومات المضللة قد يغير موقف بعض النماذج ويجعلها تتخلى عن موقفها الصحيح.

لاحظ الباحثون أن روبوتات الدردشة تميل إلى قبول المعلومات المضللة أكثر عندما تكون المواضيع غامضة أو تفتقر إلى مصادر موثوقة على الإنترنت، كما اكتشفوا ظاهرة تكرار تتسم بتذبذب الإجابات بين الرفض والموافقة خلال المحادثة نفسها، مما يعكس عدم ثبات موقف النماذج في مواجهة الضغط المستمر.

في تجربة أخرى، استخدم الباحثون طريقة جدالية وضاغطة خلال الحوار مع الروبوتات، حيث أظهر معظم النماذج قدرة جيدة على مقاومة هذه الأساليب، لكن DeepSeek-R1 برز كاستثناء واضح حيث ارتفعت نسبة الموافقة على المعلومات المضللة من واحد في المئة مع التكرار العادي إلى 22.2% مع الأسلوب الجدالي.

وفي جانب إيجابي، تمكنت نماذج GPT-4o وGPT-4o-mini وGemini 1.5 Pro وDeepSeek من تصحيح جميع أخطائها السابقة عندما أُتيحت لهم فرصة مراجعة وإعادة النظر في إجاباتها، في حين لم يستطع GPT-3.5 تصحيح سوى 32% من أخطائه، وClaude 3.5 Sonnet لم يصحح الأخطاء القليلة التي وقع فيها، مع تأكيد الباحثين أن العدد المحدود للحالات لا يسمح بالخروج باستنتاجات قاطعة من هذه الناحية.

تسلط الدراسة الضوء على ضرورة عدم اعتبار إجابات روبوتات الذكاء الاصطناعي حقائق نهائية، لا سيما في المواضيع الغامضة أو عند تكرار معلومات معروفة بأنها خاطئة في المحادثة، كما تعزز أهمية تطوير نماذج أكثر قدرة على مقاومة الضغط والمعلومات التضليلية في ظل التوجه المتزايد لاستخدام الذكاء الاصطناعي للحصول على المعلومات.

admin

Recent Posts

انخفاض سعر بيتكوين إلى 78 ألف دولار مع تأثير رفع الفائدة وارتفاع النفط

تراجعت عملة بيتكوين إلى نحو 78 ألف دولار خلال تعاملات الثلاثاء، مواصلة خسائرها من أعلى…

دقيقتان ago

لاعب مصري يواصل التدريبات الشاقة مع الاتحاد السكندري رغم توقف صرف المستحقات

قرر المدير الفني لأول فريق كرة القدم بالنادي المصري أحمد سامي استمرار الفريق في تدريباته…

3 دقائق ago

تعزيز الإجراءات الأمنية استعدادا لمباراة الزمالك وأبو قير للأسمدة في الدوري الممتاز

أنهت الأجهزة الأمنية استعداداتها الميدانية واللوجستية لتأمين مباراة الزمالك وأبو قير للأسمدة المقررة في الثامنة…

13 دقيقة ago

الاتحاد الأولمبي يبارك لسيف عيسى فوزه بذهبية جائزة التايكوندو الكبرى في كوريا الجنوبية

تقدمت اللجنة الأولمبية المصرية برئاسة ياسر إدريس بالتهنئة إلى الاتحاد المصري للتايكوندو برئاسة محمد مصطفى…

24 دقيقة ago

استوديو تحليلي شامل لمواجهة الزمالك وأبو قير للأسمدة على أون سبورت

تقدم قناة أون سبورت استوديو تحليليًا خاصًا لمباراة الزمالك وأبو قير للأسمدة ضمن منافسات الجولة…

35 دقيقة ago

أداء الزمالك مع تحكيم محمود ناجي في 15 مباراة قبل مواجهة أبو قير اليوم

أعلنت لجنة الحكام عن تولي الدولي محمود ناجي إدارة مباراة الزمالك وأبو قير للأسمدة التي…

47 دقيقة ago