دراسة تكشف ضعف قدرات "تشات جي بي تي" في الرياضيات

منذ أن أصبحت متاحة على نطاق واسع للجمهور العام الماضي، أبهرت روبوتات الدردشة القائمة على الذكاء الاصطناعي كل من جرّبها، بينما ولّدت أيضًا مخاوف من أنها ستهدد البشرية.

لكن بحثا جديدا صدر هذا الأسبوع يكشف عن تحدٍ أساسي لتطوير الذكاء الاصطناعي، حيث كشف أن "تشات جي بي تي" أصبح أسوأ في أداء بعض العمليات الحسابية.

وقال باحثون في جامعة ستانفورد وجامعة كاليفورنيا، إن هذا الأداء السيء هو مثال على ظاهرة يعرفها مطورو الذكاء الاصطناعي باسم "الانجراف" (drift)، حيث تؤدي محاولات تحسين جزء واحد من نماذج الذكاء الاصطناعي المعقدة إلى جعل أداء الأجزاء الأخرى من النماذج أسوأ.

قال جيمس زو، الأستاذ في جامعة ستانفورد الذي يعمل في مختبر الذكاء الاصطناعي بالجامعة، وأحد مؤلفي البحث الجديد: "تغييره في اتجاه واحد يمكن أن يؤدي إلى تراجعه في اتجاهات أخرى" وتابع "هذا يجعل التحسين المستمر أمرًا صعبًا للغاية".

ويمكن أن يكون "شات جي بي تي" مدهشا أحيانا، ومضحكا أحيانا أخرى، لكنه كثيرا ما يبدو "ملمًا بأي موضوع وقواعده النحوية لا تشوبها شائبة" وفق تعبير تقرير لصحيفة "وول ستريت جورنال".

لكن الخبراء الذين أجروا اختبارات لبرنامج "تشات جي بي تي" تبينوا أنه لم يكن كذلك في كل الأوقات وقالوا إن برنامج الدردشة الآلي فشل في بعض مسائل الرياضيات الأساسية.

"أداء متواضع جدا"

قام فريق من الباحثين باختبار نسختين من تشات جي بي تي": الإصدار 3.5، المتاح مجانًا عبر الإنترنت لأي شخص، والإصدار 4.0، المتاح من خلال اشتراك متميز.

أعطوا "شات بوت" مهمة أساسية وهي تحديد ما إذا كان رقم معين هو رقم أولي أملا.

وهذا هو نوع من المسائل الحسابية معقد للناس العاديين، ولكنه بسيط لأجهزة الكمبيوتر، لكن الخبراء قالوا إن النتائج "لم تكن واعدة تماما".

"هل 17077 عدد أولي؟ هل 17947 أولي هو الآخر؟"

ما لم تكن خبيرا، لا يمكنك حل هذا الأمر من خلال جهدك الذهني فقط، لكن من السهل على أجهزة الكمبيوتر إعطاؤك الحل، إذ يمكن للحاسوب أن يقسم العدد على اثنين، ثلاثة، خمسة، إلخ، وينظر في الحل قبل أن يقرر.

ولتتبع أدائه على مدد زمنية مختلفة، قام الباحثون بإعطاء البرنامج 1000 رقم مختلف.

دراسة تكشف ضعف قدرات "تشات جي بي تي" في الرياضيات

آراء وتحليلات

مقابلات