قطر
تكنولوجيا

كيف تؤثر لغة السؤال على إجابات الذكاء الاصطناعي وما الأسباب الكامنة وراء ذلك؟

الجزيرة٢٨ سبتمبر ٢٠٢٦ في ٠٩:٣٥ ص0 مشاهدة
كيف تؤثر لغة السؤال على إجابات الذكاء الاصطناعي وما الأسباب الكامنة وراء ذلك؟

تنويه

هذا الخبر بعنوان "لغة السؤال تغير الإجابة.. ماذا يحدث داخل الذكاء الاصطناعي؟" نشر أولاً على موقع الجزيرة وتم جلبه من مصدره الأصلي بتاريخ ٢٨ سبتمبر ٢٠٢٦.

لا يتحمل موقعنا مضمونه بأي شكل من الأشكال. بإمكانكم الإطلاع على تفاصيل هذا الخبر من خلال مصدره الأصلي.

تختلف إجابات نماذج الذكاء الاصطناعي عندما يُطرح نفس السؤال بلغات مختلفة، مما يظهر بوضوح في دقة المعلومات، أو اختيار المصطلحات، أو التفاصيل التي يستحضرها النموذج، وصولاً إلى فهم السياق الثقافي للسؤال. لا يعني هذا بالضرورة أن نموذجاً ما يفكر بلغة أفضل من أخرى، بل يرتبط الأمر بطريقة التدريب وتمثيل اللغات داخل بنيته، وتفاوت حجم وجودة البيانات المتاحة لكل لغة.

تعتمد النماذج اللغوية الكبيرة على كميات ضخمة من النصوص، لكن هذه البيانات غير موزعة بالتساوي؛ فالإنجليزية واللغات ذات الحضور الرقمي الكبير تمتلك موارد نصية أكثر، بينما تعاني لغات أخرى من نقص البيانات. وأشارت دراسة منشورة في دورية ساينتفيك ريبورتس (Scientific Reports)، التي اختبرت 3 نماذج عبر 12 لغة، إلى أن أداء النماذج يختلف باختلاف اللغة وحجم بيانات التدريب ومصدرها والمسافة اللغوية. كما أظهرت أبحاث أخرى أن طريقة تقسيم النصوص إلى رموز أو توكنات (Tokens) تؤثر بشكل كبير في الأداء وتكلفة التدريب.

ولا تقتصر المشكلة على البيانات والبنية اللغوية، بل تمتد إلى السياق الثقافي المرتبط باللغة. فقد بينت دراسة قدمت في مؤتمر إيه سي إل 2025 (ACL 2025) وجود ما يُعرف بالتآزر اللغوي الثقافي، حيث يكون أداء النماذج أفضل عندما يتوافق السؤال ثقافياً مع اللغة المستخدمة. وتظهر هذه التحديات بشكل جلي في اللغة العربية واللهجات المختلفة، حيث أشارت ورقة مؤشر نضج تقنيات الذكاء الاصطناعي للغة العربية بلسم (BALSAM) في مؤتمر معالجة اللغة العربية 2025 إلى تأثر الأداء بندرة البيانات والتنوع اللغوي. وفي السياق ذاته، طورت دراسة أخرى معيار أراديس (AraDiCE) لاختبار قدرات النماذج في اللهجات العربية والوعي الثقافي في مناطق الخليج ومصر وبلاد الشام، بينما أكدت منظمة اليونسكو أن نقص البيانات المحلية يحد من قدرة الأنظمة على التعامل مع المفاهيم الثقافية المحلية.

وعلى صعيد آخر، لا يُعد اختلاف الإجابة بين لغتين دليلاً قاطعاً على وجود تحيز متعمد، إذ قد ينتج عن تفاوت البيانات أو طريقة تقسيم النص أو السياق الثقافي. ومع ذلك، قد تؤدي هذه الفوارق إلى تحيز لغوي فعلي، مما يدفع الأبحاث الحديثة لاختبار النماذج في لغات وثقافات متعددة للتأكد من فهم السؤال ضمن سياقه الصحيح، وليس مجرد فهم اللغة بمعزل عن بيئتها.

شارك الخبر: