International

AI-তে কার কণ্ঠ?

এক নজরে

যা জানা জরুরি

  • প্রতিবেদন: কৃষক স্থানীয় ভাষায় গাছের রোগের লক্ষণ বললেন, কিন্তু যন্ত্র বুঝল অন্য ফসলের নাম।
  • স্বাস্থ্যকর্মীর উচ্চারণ ঠিকমতো ধরতে না পেরে কৃত্রিম বুদ্ধিমত্তা ভুল পরামর্শ দিল।
  • কোথাও ভুল অনুবাদ নিয়ে হাসাহাসি, আবার কোথাও ভাষাগত ভুলের ফল স্বাস্থ্য, শিক্ষা বা সরকারি পরিষেবায় সরাসরি ক্ষতি।

বিস্তারিত প্রতিবেদন

প্রতিবেদন: কৃষক স্থানীয় ভাষায় গাছের রোগের লক্ষণ বললেন, কিন্তু যন্ত্র বুঝল অন্য ফসলের নাম। স্বাস্থ্যকর্মীর উচ্চারণ ঠিকমতো ধরতে না পেরে কৃত্রিম বুদ্ধিমত্তা ভুল পরামর্শ দিল। কোথাও ভুল অনুবাদ নিয়ে হাসাহাসি, আবার কোথাও ভাষাগত ভুলের ফল স্বাস্থ্য, শিক্ষা বা সরকারি পরিষেবায় সরাসরি ক্ষতি।

এই ফাঁক কমাতেই এবার একজোট হয়েছে প্রযুক্তি সংস্থা, গবেষণা প্রতিষ্ঠান ও আন্তর্জাতিক সংগঠন। ২১ সেপ্টেম্বর ৬০টি প্রতিষ্ঠান পাঁচ বছরের একটি যৌথ অঙ্গীকার ঘোষণা করেছে। লক্ষ্য—কৃত্রিম বুদ্ধিমত্তায় এখনও কম প্রতিনিধিত্ব পাওয়া ভাষাগুলির আনুমানিক ৩৪০ কোটি মানুষকে নিজের ভাষা ও কণ্ঠে কার্যকর AI পরিষেবার আওতায় আনা।

গেটস ফাউন্ডেশনের উদ্যোগে তৈরি প্রাথমিক জোটে রয়েছে অ্যানথ্রপিক, গুগল, মাইক্রোসফট, এনভিডিয়া, মিস্ত্রাল ও ওপেনএআই ফাউন্ডেশন। সঙ্গে রয়েছে ইউনিসেফ, বিশ্বব্যাঙ্ক, বিভিন্ন বিশ্ববিদ্যালয়, আফ্রিকান গবেষণাগোষ্ঠী, সরকারি দপ্তর এবং স্থানীয় প্রযুক্তি প্রতিষ্ঠান।

চ্যালেঞ্জটা অবশ্য শুধু ভাষার সংখ্যা নয়। পৃথিবীতে প্রায় সাত হাজার ভাষা থাকলেও শক্তিশালী ভাষা-প্রযুক্তি তৈরির মতো বিপুল তথ্যভান্ডার রয়েছে হাতে গোনা কয়েকটির। ইংরেজির মতো ভাষায় বই, সংবাদ, ওয়েবপৃষ্ঠা, অভিধান, শব্দরেকর্ড থেকে শুরু করে যাচাই করা পরীক্ষার উপকরণ পর্যন্ত প্রচুর। বহু আফ্রিকান, এশীয় ও আদিবাসী ভাষায় সেই পরিমাণ লিখিত তথ্য নেই। সেখানে আবার উপভাষা, মিশ্র ভাষা, স্থানীয় উচ্চারণ এবং মৌখিক ঐতিহ্যের গুরুত্ব অনেক বেশি।

ফলে শুধু শব্দের সঙ্গে শব্দ মিলিয়ে অনুবাদ করলেই ভাষার আসল অর্থ ধরা পড়ে না। একই শব্দের অর্থ বদলে যেতে পারে অঞ্চল, সংস্কৃতি কিংবা ব্যবহারের পরিস্থিতি অনুযায়ী।

জোটের পরিকল্পনায় চারটি বিষয় বিশেষ গুরুত্ব পাচ্ছে। প্রথমত, মানুষের সম্মতি ও উন্মুক্ত অনুমতির ভিত্তিতে ভাগ করে ব্যবহারযোগ্য ভাষাতথ্যের পরিকাঠামো তৈরি করা। দ্বিতীয়ত, কোনও ভাষাকে ‘সমর্থিত’ বলা হলেই হবে না—বাস্তবে কতটা কাজ করছে, তা মাপার নির্দিষ্ট পরীক্ষা ও মানদণ্ড তৈরি করা। তৃতীয়ত, সংগৃহীত তথ্যকে কার্যকর AI মডেল ও পরিষেবায় পরিণত করা, যাতে শুধু বড় প্রযুক্তি সংস্থাই নয়, ছোট নির্মাতারাও তা কাজে লাগাতে পারেন। চতুর্থত, গোপনীয়তা, সম্মতি এবং সম্প্রদায়ের তথ্যের উপর তাদের নিয়ন্ত্রণ বজায় রাখা।

এখানে কণ্ঠস্বরের প্রশ্নটি আরও গুরুত্বপূর্ণ। অনেকের পক্ষে দীর্ঘ লেখা টাইপ করা কঠিন, অনেক ভাষার জন্য মানসম্মত কিবোর্ড নেই, আবার বহু জায়গায় মৌখিক যোগাযোগই দৈনন্দিন জীবনের স্বাভাবিক মাধ্যম। কিন্তু কণ্ঠের তথ্যও ব্যক্তিকে শনাক্ত করতে পারে।

ধরা যাক, কোনও দরিদ্র সম্প্রদায়ের মানুষের কণ্ঠ সামান্য পারিশ্রমিকের বিনিময়ে রেকর্ড করা হল। পরে সেই তথ্য ব্যবহার করে তৈরি হল লাভজনক বাণিজ্যিক পণ্য। সে ক্ষেত্রে ‘ভাষাগত অন্তর্ভুক্তি’ কি শেষ পর্যন্ত নতুন ধরনের তথ্য-শোষণে পরিণত হবে না? প্রশ্নটা তাই প্রযুক্তির মতোই গুরুত্বপূর্ণ।

তার উপর ঘোষণার সময় জোটটির পূর্ণ শাসনকাঠামো এখনও তৈরি হয়নি। আগামী এক বছরে নেতৃত্ব, কাজের ধারা এবং জবাবদিহির ব্যবস্থা তৈরির কথা রয়েছে। কিন্তু অর্থ দেবে কে, তথ্যের মালিকানা থাকবে কার হাতে, বাণিজ্যিক পণ্যে সেই তথ্য ব্যবহারের নিয়ম কী হবে, কিংবা কোনও সম্প্রদায় পরে দেওয়া সম্মতি প্রত্যাহার করতে পারবে কি না—এসব প্রশ্নের সব উত্তর এখনও স্পষ্ট নয়।

আর এখানেই আসল পরীক্ষা।

‘একটি ভাষা সমর্থিত’ বলা আর সেই ভাষায় নির্ভরযোগ্য AI তৈরি করা এক কথা নয়। পাঁচটি সাধারণ বাক্য অনুবাদ করতে পারা আর চিকিৎসার উপসর্গ, কৃষির স্থানীয় নাম বা আদালতের জটিল ভাষা ঠিকমতো বোঝা সম্পূর্ণ আলাদা বিষয়। একই ভাষার মধ্যেও নারী, প্রবীণ, আঞ্চলিক উচ্চারণ কিংবা এক কথোপকথনে একাধিক ভাষা ব্যবহারের অভ্যাস—অর্থাৎ কোড-সুইচিং—AI-এর কাছে নতুন চ্যালেঞ্জ হয়ে উঠতে পারে।

তাই সাফল্যের মাপকাঠি শুধু কত গিগাবাইট তথ্য সংগ্রহ হল, তা হতে পারে না। দেখতে হবে সেই তথ্যের উপর স্থানীয় মানুষের নিয়ন্ত্রণ কতটা, AI কতটা নির্ভুল এবং ভুল হলে সংশোধনের সুযোগ কতটা সহজ।

প্রতিটি ভাষার ক্ষেত্রে স্বাধীন পরীক্ষা, ভুল জানানোর ব্যবস্থা, ক্ষতিকর প্রয়োগ থামিয়ে দেওয়ার ক্ষমতা এবং তথ্যদাতাদের যথাযথ স্বীকৃতি জরুরি। নইলে প্রযুক্তি সংস্থাগুলি যদি ভাষাকে শুধু ভবিষ্যতের নতুন বাজার হিসেবে দেখে, তবে এই উদ্যোগ পুরনো ডিজিটাল বৈষম্যেরই নতুন সংস্করণ হয়ে উঠতে পারে।

কিন্তু ভাষাভাষী মানুষ যদি শুধু তথ্যের উৎস না হয়ে তথ্যের সহ-নির্মাতা ও সিদ্ধান্তগ্রহণকারী হন, ছবিটা বদলাতে পারে।

তখন AI শুধু আরও বেশি ভাষা বলবে না—সম্ভবত প্রথমবার সত্যিই আরও বেশি মানুষের কথা শুনবে

সূত্র ও সম্পাদকীয় নোট

প্রতিবেদনের তথ্য প্রকাশের আগে সংশ্লিষ্ট উৎস ও প্রাসঙ্গিক নথি যাচাই করা হয়েছে। নতুন তথ্য পাওয়া গেলে প্রতিবেদনটি আপডেট করা হতে পারে।

লেখক / সম্পাদকীয় ডেস্ক

বাংলাস্ফিয়ার ডেস্ক

বিশ্বস্ত উৎস যাচাই করে পাঠকের জন্য সংবাদ ও ব্যাখ্যা প্রস্তুত করে বাংলাSphere সম্পাদকীয় দল।

আরও লেখা →
সকালের খবর, একসঙ্গে

দিন শুরু হোক বাংলাSphere-এর সঙ্গে

বাছাই করা গুরুত্বপূর্ণ খবর সরাসরি আপনার ইনবক্সে পেতে আমাদের নিউজলেটারে যুক্ত হন।

ইমেলে সাবস্ক্রাইব করুন →
বাংলাস্ফিয়ার

বাংলাস্ফিয়ার একটি স্বাধীন বাংলা সংবাদ ও মতামতভিত্তিক ডিজিটাল প্ল্যাটফর্ম। দেশ, বিশ্ব, রাজনীতি, প্রযুক্তি, সংস্কৃতি ও সমাজের গুরুত্বপূর্ণ খবর ও বিশ্লেষণ পাঠকের কাছে পৌঁছে দেওয়াই আমাদের লক্ষ্য।

Edtior's Picks

Latest Articles