هوش مصنوعی صدای کدام زبانها را نمیشنود؟
📌 نابرابری در توزیع دادههای وب و تسلط چند زبان خاص، عملکرد مدلهای هوش مصنوعی را در زبانهای مناطق کمدرآمد تضعیف کرده است. هوش مصنوعی اغلب بهعنوان یک فناوری همهمنظوره توصیف میشود؛ نوآوری که توانایی دارد اقتصادها و جوامع را بهطور بنیادین متحول کن...
نابرابری در توزیع دادههای وب و تسلط چند زبان خاص، عملکرد مدلهای هوش مصنوعی را در زبانهای مناطق کمدرآمد تضعیف کرده است. هوش مصنوعی اغلب بهعنوان یک فناوری همهمنظوره توصیف میشود؛ نوآوری که توانایی دارد اقتصادها و جوامع را بهطور بنیادین متحول کند. چنین ابزاری میتواند شکافهای فهم انسانی را پر کند و دسترسی به دانش را دموکراتیکتر سازد. با این حال، کارآمدی آن بهشدت به دادههایی وابسته است که از سراسر اینترنت گردآوری میشوند. بهگزارش وبلاگ رسمی بانک جهانی، تواناییهای هوش مصنوعی عمدتا بر همین پایه بنا شدهاند؛ بر اساس انبوهی از دادهها که برای پیشبینی و تولید متن شبیه به زبان انسان تحلیل میشوند. وقتی دادهها نامتوازن باشند، سؤال اصلی این میشود که برای زبانهایی که صدای کمتری دارند و اطلاعاتشان سختتر پیدا میشود چه اتفاقی میافتد؟ اگر دادهای در کار نباشد، مدلهای هوش مصنوعی نیز از همان ابتدا توان کمتری خواهند داشت. زبان انگلیسی بهتنهایی نزدیک به نیمی از نشانیهای اینترنتی جهان را به خود اختصاص داده و زبانهای رایج در کشورهای ثروتمند نیز در سراسر وب بهوفور دیده میشوند. در مقابل، زبانهایی که بیشتر در کشورهای کمدرآمد و با درآمد متوسط صحبت میشوند، حتی با وجود صدها میلیون گوینده، سهمی بسیار کمتر دارند. همین شکاف باعث میشود هوش مصنوعی نتواند به یک فناوری واقعا جهانی تبدیل شود. برای درک بهتر این نابرابری، میتوان فراوانی نسبی زبانها را با مقایسه تعداد گویش ور و تعداد نشانیهای اینترنتی در همان زبان تصویر کرد. از هر ۱۰٬۰۰۰ نفر در جهان، حدود ۷ نفر دانمارکی صحبت میکنند؛ زبان اصلی دانمارک همین زبان است. با وجود چنین سهم کوچکی از جمعیت، ۵۱ نشانی اینترنتی از هر ۱۰٬۰۰۰ نشانی در جهان به زبان دانمارکی هستند. این وضعیت نشان میدهد که دانمارکی در فضای آنلاین بیشازحد نمایان است. در سوی دیگر، حدود ۲۵۰ نفر از هر ۱۰٬۰۰۰ نفر در جهان پنجابی صحبت میکنند؛ زبانی که رایجترین زبان پاکستان و در عین حال در هند نیز بسیار گسترده است. با این حال، تنها ۱ نشانی اینترنتی از هر ۱۰٬۰۰۰ نشانی جهان به زبان پنجابی ثبت شده و همین مسئله نشان میدهد پنجابی در وب کمنماینده مانده است. پیامد چنین نابرابری برای مدلهای هوش مصنوعی روشن است؛ در جاهایی که دسترسی به دانش و اطلاعات سختتر است، این مدلها اغلب دقت و ظرافت کافی را ندارند و کمتر به کار میآیند. جبران این فاصله نیازمند سرمایهگذاری هدفمند است، از جمله گسترش دادههای متنی در زبانهای کمنماینده و پشتیبانی از توانمندی توسعه محلی هوش مصنوعی. هوش مصنوعی میتواند به فناوری واقعا جهانی بدل شود، اما فقط زمانی که زبانهایی را که در مناطق فقیرتر جهان صحبت میشوند، پشت سر نگذارد. شما فکر میکنید کدام زبانها بیشتر از همه در وب نادیده گرفته شدهاند؟
📡 منبع: رسانه زومان
🕒 تاریخ انتشار در سایت: 2026/09/04 - 16:31
🕒 تاریخ انتشار در سایت: 2026/09/04 - 16:31

نظرات (0)