Categories: غير مصنف

دراسة تحذر من مخاطر تأثير الضغط على روبوتات الذكاء الاصطناعي وقبولها معلومات خاطئة

كشفت دراسة حديثة عن ظاهرة مثيرة تخص روبوتات الذكاء الاصطناعي، إذ أظهرت أن استمرار المستخدم في مجادلة الروبوت وتكرار معلومات خاطئة أمامه قد يؤدي ببعض النماذج إلى التخلي عن إجاباتها الصحيحة والموافقة على المعلومات المضللة في نهاية المطاف، ما يسلط الضوء على تحد جديد في الاعتماد على روبوتات الدردشة كمصدر للمعلومات.

قام فريق من جامعة أريزونا باختبار سبعة نماذج للذكاء الاصطناعي تشمل GPT-3.5 وGPT-4o وGPT-4o-mini وClaude 3.5 Sonnet وGemini 1.5 Pro وLlama-3-70B وDeepSeek-R1، بهدف قياس مدى مقاومتها للمعلومات المضللة خلال محادثات طويلة، ونُشرت هذه الدراسة في مجلة Scientific Reports التابعة لمجموعة Nature.

خطت التجربة خطوة أبعد من طرح سؤال واحد، حيث قدم الباحثون للنماذج 100 عبارة خاطئة عمدًا تراوحت بين معلومات واضحة الخطأ وأخرى غامضة يصعب التحقق منها، ثم كرروا هذه العبارات داخل محادثات متتابعة وصل بعضها إلى خمسين تكرارًا، ليتبين إذا استمر النموذج في تمسكه بالإجابة الصحيحة أم تأثر بتكرار وإصرار المستخدم، وأسفرت النتائج عن تأثر جميع النماذج بدرجات متفاوتة تباينت مؤشرات تأكيد المعلومات المضللة ما بين 0.08% و12.3%، بفارق يزيد عن 150 مرة بين بعض النماذج.

ظهرت في الدراسة أن GPT-3.5 كان أكثر النماذج قابلية لتأكيد المعلومات الكاذبة في ظل تكرار مستمر للمعلومات المضللة، في حين سجل Claude 3.5 Sonnet أدنى معدل تأكيد لهذه المعلومات، وقد تبين أن أداء النموذج في سؤال منفرد لا يعكس بالضرورة سلوكه حين تطول المحادثة ويتزايد الضغط من المستخدم، وهو ما يبرز أهمية عدم الاعتماد فقط على اختبارات الذكاء الاصطناعي التقليدية التي تقيس الأداء عبر سؤال واحد فقط.

كما لاحظ الباحثون ظاهرة أسموها “التردد الحواري” أو Conversational Reverberation، حيث يتنقل النموذج بين قبول المعلومة الخاطئة ورفضها عبر الرسائل المتتالية، فقد يرفض الادعاء في إجابة ثم يوافق عليه في التالية قبل أن يعيده إلى الرفض، ما يشير إلى أن المشكلة لا تقتصر على خطأ في الإجابة فقط، وإنما تشمل تذبذب الموقف ذاته خلال المحادثة.

وأظهرت الدراسة أن النماذج كانت أكثر عرضة لقبول المعلومات المضللة حين تتعلق بمواضيع غامضة أو غير شائعة، ووجد الباحثون ارتباطًا بين درجة غموض المعلومة واحتمال قبولها، حيث يصبح النموذج أكثر ثباتًا أمام معلومة خاطئة تتعلق بموضوع معروف وشائع، لكنه يزداد تأثرًا حين تكون المعلومة نادرة أو يصعب التحقق منها.

لم تقتصر التجارب على التكرار فقط، بل شملت أيضًا اختبارًا لما يحدث عندما يتحول النقاش إلى جدال إصراري من المستخدم على صحة المعلومة الخاطئة، وكان DeepSeek-R1 الأكثر تأثرًا في هذا السياق، إذ ارتفعت نسبة قبوله للمعلومات المضللة من حوالي 1% في حالة التكرار وحده إلى 22.2% تحت ضغط الجدال، إلا أن الباحثين أشاروا إلى تحفظ على هذا المؤشر بسبب ميل النموذج أحيانًا لاستخدام السخرية، ما يربك تفسير ردوده.

في الجانب الإيجابي، بينت الدراسة أن بعض النماذج مثل GPT-4o وGPT-4o-mini وGemini 1.5 Pro وDeepSeek-R1 أظهرت القدرة على تصحيح أخطائها حين أُعطيت فرصة لمراجعة المعلومات التي سبق وأن قدمتها بشكل خاطئ، حيث حققت نسبة 100% في تصحيح هذه الأخطاء ضمن الاختبار، لكن اللافت أن النموذج الذي حقق أقل معدل أخطاء لم يكن بالضرورة الأفضل في التصحيح، مما يؤكد أن معدل الخطأ المنخفض لا يكفي لتقييم موثوقية النموذج.

تكمن أهمية النتائج في أنها توسع نطاق الحوار من سؤال “هل يهلوس الذكاء الاصطناعي؟” إلى سؤال أكثر تعقيدًا يتعلق بكيفية تأثير استمرار ضغط المستخدم على المخرجات، فالروبوت قد يبدأ بإجابة صحيحة ويعتذر عن معلومة خاطئة، لكن تكرار الادعاء أو تغيير طريقة طرحه أو تصعيد النقاش قد يدفع في بعض الحالات إلى تحويل موقفه، ولهذا ينصح الباحثون بعدم الاعتماد على تقييم نماذج الذكاء الاصطناعي بناءً على تفاعل واحد فقط، خصوصًا في المواضيع التي تتطلب دقة عالية.

توضح الدراسة أن الثقة في إجابة الروبوت لا تعني بالضرورة صحتها، فاللغة الواثقة والأسلوب السلس قد تغطي على الشك أو الخطأ، كما أن استمرار المحادثة لا يضمن تحسن الدقة، إذ قد تزيد الأخطاء أحيانًا مع استمرار الحوار، لذلك تبقى الرجوع إلى مصادر خارجية أمرًا ضروريًا عند التعامل مع معلومات حساسة أو غير مؤكدة، لا سيما إذا كانت نادرة أو متخصصة.

يفتح البحث نافذة جديدة تبرز حدود اختبارات الذكاء الاصطناعي التقليدية القائمة على أسئلة وإجابات منفردة، إذ إن النماذج في الواقع تتعامل مع محادثات طويلة قد تتعرض فيها للإصرار والتكرار والجدل، ومن هنا يرى الباحثون ضرورة تقييمها ضمن سياق ديناميكية الحوار الممتد وليس فقط من خلال أول إجابة، مع الإشارة إلى أن مقاومة المعلومات المضللة تختلف بشكل كبير من نموذج إلى آخر.

admin

Recent Posts

انخفاض سعر بيتكوين إلى 78 ألف دولار مع تأثير رفع الفائدة وارتفاع النفط

تراجعت عملة بيتكوين إلى نحو 78 ألف دولار خلال تعاملات الثلاثاء، مواصلة خسائرها من أعلى…

دقيقتان ago

لاعب مصري يواصل التدريبات الشاقة مع الاتحاد السكندري رغم توقف صرف المستحقات

قرر المدير الفني لأول فريق كرة القدم بالنادي المصري أحمد سامي استمرار الفريق في تدريباته…

3 دقائق ago

تعزيز الإجراءات الأمنية استعدادا لمباراة الزمالك وأبو قير للأسمدة في الدوري الممتاز

أنهت الأجهزة الأمنية استعداداتها الميدانية واللوجستية لتأمين مباراة الزمالك وأبو قير للأسمدة المقررة في الثامنة…

14 دقيقة ago

الاتحاد الأولمبي يبارك لسيف عيسى فوزه بذهبية جائزة التايكوندو الكبرى في كوريا الجنوبية

تقدمت اللجنة الأولمبية المصرية برئاسة ياسر إدريس بالتهنئة إلى الاتحاد المصري للتايكوندو برئاسة محمد مصطفى…

24 دقيقة ago

استوديو تحليلي شامل لمواجهة الزمالك وأبو قير للأسمدة على أون سبورت

تقدم قناة أون سبورت استوديو تحليليًا خاصًا لمباراة الزمالك وأبو قير للأسمدة ضمن منافسات الجولة…

35 دقيقة ago

أداء الزمالك مع تحكيم محمود ناجي في 15 مباراة قبل مواجهة أبو قير اليوم

أعلنت لجنة الحكام عن تولي الدولي محمود ناجي إدارة مباراة الزمالك وأبو قير للأسمدة التي…

47 دقيقة ago