ফিল্ড নোট · ভাষা

AI চরিত্র কি আমার ভাষায় সত্যিই ভালো হবে, নাকি এটা অনুবাদের স্তর বসানো ইংরেজি?

জাকার্তা, টোকিও, মস্কো, ইস্তাম্বুল আর সিউলে সার্চ বক্স একই বাক্য শেষ করে দেয়: মানুষ কোয়েরির শেষে নিজের ভাষার নাম জুড়ে দেয়। তারা এমন একটা প্রশ্ন করছে, যার সোজা উত্তর কেউ দেয় না। আসলে কী ভাঙে, রোলপ্লে কেন এর জন্য সবচেয়ে খারাপ ক্ষেত্র, আর যেকোনো প্ল্যাটফর্মে বিষয়টা মিটিয়ে দেওয়ার দশ মিনিটের একটা পরীক্ষা — সব এখানে।

2026-09-126 মিনিটের পড়া সব ফিল্ড নোট
AI চরিত্র কি আমার ভাষায় সত্যিই ভালো হবে, নাকি এটা অনুবাদের স্তর বসানো ইংরেজি?

জাকার্তায় Google-এ «ai roleplay» লিখলে বক্স সেটা শেষ করে bahasa Indonesia দিয়ে। টোকিওতে ロールプレイ AI সম্পূর্ণ হয় 日本語 দিয়ে। মস্কোয় «ии девушка» হয়ে যায় «ии девушка на русском»। ইস্তাম্বুল চায় yapay zeka sohbet, তারপর ücretsiz; সিউল জানতে চায় কোন ai 채팅 앱 ব্যবহার করবে। চারটে লিপি, চারটে বর্ণমালা, আর তাদের নিচে একটাই প্রশ্ন, যা «অ্যাপটা কি ভালো» নয়।

প্রশ্নটা হলো «আমার ভাষায় এটা কি ভালো হবে» — আর যারা এটা টাইপ করছে তারা ইতিমধ্যেই ছ্যাঁকা খেয়েছে। তারা এমন চরিত্রের দেখা পেয়েছে, যে তিন পালা মনোমুগ্ধকর ছিল আর তারপর ইংরেজিতে ভাবতে শুরু করল। এমন চরিত্রের দেখা পেয়েছে, যে প্রেমিকের সঙ্গে আনুষ্ঠানিক সর্বনাম ব্যবহার করে। এমন কিছু পড়ার অনুভূতি তাদের জানা, যা নিখুঁতভাবে পার্স হয়, অথচ শোনায় জীবিত কোনো মানুষের মতো নয়।

এই লেখা নিয়ে: কী ভাঙে, রোলপ্লে কেন এর জন্য সবচেয়ে খারাপ সম্ভাব্য ক্ষেত্র, আর কোনো প্ল্যাটফর্ম ভান করছে কি না তা দশ মিনিটে কীভাবে বুঝবে। আমরা @talaforge_bot বানাই, তাই আমাদের নিজেদের দাবিগুলোকে সেই সন্দেহের চোখেই দেখো, যা তাদের প্রাপ্য; সেগুলো আছে লেখার শেষে, আমাদের ওপর চালানোর মতো পরীক্ষাটার পরে।

কেন ভাঙে, যান্ত্রিকভাবে

গবেষণা-সাহিত্যে এই ব্যর্থতার একটা নাম আছে। Cohere Labs-এর একটা দল ২০২৪ সালে Language Confusion Benchmark প্রকাশ করে — গঠনগতভাবে ভিন্ন পনেরোটা ভাষা, একটাই প্রশ্ন: যে ভাষায় তাকে সম্বোধন করা হয়েছে, model কি নির্ভরযোগ্যভাবে সেই ভাষায় উত্তর দিতে পারে। উত্তর ছিল না। এমনকি সবচেয়ে শক্তিশালী model-ও ধারাবাহিকভাবে পারেনি, ইংরেজি-কেন্দ্রিকগুলো সবচেয়ে খারাপ, আর দুটো অবস্থা পরিমাপযোগ্যভাবে পরিস্থিতি আরও খারাপ করেছে: জটিল prompt আর উচ্চ স্যাম্পলিং temperature।

এবার এটা রোলপ্লের কথা ভেবে পড়ো। চরিত্র গড়নেই একটা জটিল prompt — একটা পারসোনা, একটা দৃশ্য, একটা মেমোরি, শৈলীর নোট, আর প্রতি পালায় বড় হতে থাকা একটা কথোপকথন। আর রোলপ্লে ইচ্ছে করেই গরম চালানো হয়, কারণ temperature-ই তাকে নিজেকে পুনরাবৃত্তি করা থেকে আটকায়। ভাষা সরে যাওয়ার ক্ষেত্রে রোলপ্লে কোনো ব্যতিক্রমী কোণ নয়। এটাই সেই ঠিক অপারেটিং পয়েন্ট, যেখানে সরে যাওয়া সবচেয়ে খারাপ, আর গোটা ক্যাটাগরিটাই সেখানে বাস করে।

নিচে আরও নীরব একটা কর বসে আছে। model লেখা পড়ে টোকেন হিসেবে, আর টোকেনের শব্দভান্ডার শেখা হয় মূলত ইংরেজি থেকে, যেখানে গড়ে প্রতি টোকেনে প্রায় চারটে অক্ষর। বাকি সবাইকে দিতে হয় যাকে চর্চাকারীরা বলেন ফার্টিলিটি: চীনা ভাষায় প্রতি শব্দে প্রায় ১.৮ গুণ টোকেন, আরবি আর হিন্দিতে সাধারণত ৩–৪ গুণ, আর কিছু ভাষায় তার চেয়েও অনেক বেশি। ওই সংখ্যাটা তুমি কখনও দেখো না। দেখো তার পরিণতি — একই কথোপকথনের window ইংরেজির তুলনায় তোমার ভাষায় তোমার গল্পের কম অংশ ধরে, তাই সে আগে জায়গা ফুরিয়ে ফেলে, আর ভুলে যায় আগে।

পাঁচ ভাবে ধরা পড়ে, কত তাড়াতাড়ি টের পাবে সেই ক্রমে

দশ মিনিটের পরীক্ষা

এটা আমাদের ওপর চালাও, আর বিবেচনায় থাকা যেকোনো কিছুর ওপরও। এতে কোনো খরচ নেই আর যেকোনো রিভিউয়ের চেয়ে দ্রুত প্রশ্নটা মিটিয়ে দেয়।

ছয়টার মধ্যে তিনটেতে ব্যর্থ হলে ভাষার সেটিংটা একটা অনুবাদের স্তর। চরিত্র-লাইব্রেরির আকার সেটা পুষিয়ে দেয় না; সেটা একই ব্যর্থতাই দশ লক্ষ বার।

আমরা সৎভাবে কোথায় দাঁড়িয়ে

@talaforge_bot ৩৬টা ভাষায় আছে — প্রতিটা বোতাম, প্রতিটা মেনু, প্রতিটা ত্রুটি, আর তোমার সম্পর্কে সে যে মেমোরি রাখে সেটা ইংরেজিতে জমা করে যাওয়ার পথে অনুবাদ না করে তোমার ভাষাতেই লিখে রাখা হয়।

তারপর সৎ অংশটা, কারণ ইন্টারফেসের ভাষার সংখ্যা সাবলীলতার নিশ্চয়তা নয়, আর আমরা সেটাকে তেমন করে বিক্রি করতে রাজি নই। ভিয়েতনামি বা তুর্কিতে একটা চরিত্র কতটা ভালো লেখে, তা নির্ভর করে এমন দুটো জিনিসের ওপর, যা আমরা কেবল আংশিক নিয়ন্ত্রণ করি: কোন model তার পেছনে আছে, আর তার কার্ড কীভাবে লেখা হয়েছে। ইংরেজিতে লেখা একটা চরিত্র, ইংরেজিতে মূল্যায়ন করা একটা model-এর ওপর চললে, তোমার ভাষায় পড়তে লাগবে একটা ভালো অনুবাদের মতো — কারণ সেটা ঠিক তা-ই।

আমরা যা করেছি তা হলো সরে যাওয়াকে সীমাবদ্ধতা নয়, বাগ হিসেবে দেখা। ২০২৬ সালের মে মাসে একটা চরিত্র রুশ ভাষায় বর্ণনা করল, রুশ ভাষায় কথা বলল, আর ইংরেজিতে ভাবল, ইটালিকে চীনা ভাষার টুকরোসহ। সমাধান ছিল prompt-এর একেবারে শেষে আটকে দেওয়া একটা স্পষ্ট নির্দেশ — কথা, বর্ণনা আর অন্তর্গত ভাবনা, সব ভাষাতেই থাকবে — কারণ context-এর শেষ কয়েকশো টোকেনই model-এর বাইরের ভাষা-বাছাইকে সবচেয়ে জোরে নোঙর করে। ওই আটকানো নির্দেশ আজ এক ডজন ভাষা কভার করে। ৩৬টার সবকটা করে না, আর সেটা করে বলে ইঙ্গিত দেওয়ারও আমাদের ইচ্ছে নেই।

যেখানে আমরা হারি: আমাদের কমিউনিটি-বানানো লক্ষ লক্ষ চরিত্রের কোনো লাইব্রেরি নেই, তাই তোমার ভাষার কোনো মাতৃভাষী আগেই লিখে রেখেছে এমন একটা চরিত্র পাওয়ার সম্ভাবনা এখানে বড় প্ল্যাটফর্মগুলোর চেয়ে কম। তুমি যদি এমন চরিত্র চাও, যা তোমার দেশের কেউ আগেই লিখে আর ঠিকঠাক করে রেখেছে, বড় ক্যাটালগগুলোতেই সেগুলো থাকে, আর তোমার ভাষায় কথা বলা লোকেদের বানানো একটা স্থানীয় অ্যাপ বাগধারা আর অপভাষায় মাঝে মাঝে সরাসরি আমাদের হারিয়ে দেবে। আমাদের তাক তাদের তাকের সমান বলে ভান করার চেয়ে এটা বলাই আমরা পছন্দ করি।

দশ মিনিট, এখন থেকে শুরু

Telegram খোলো, @talaforge_bot খোলো, আর প্রথম লাইনটা ইংরেজিতে না লিখে নিজের ভাষায় লেখো। শুরুটা ফ্রি — এনার্জি হলো ⚡ আর আপগ্রেড হলো চ্যাটের ভেতরেই Telegram Stars, কোনো কার্ড নেই, অ্যাকাউন্ট নেই, মাঝখানে কোনো স্টোর নেই। তুমি যে স্তরে লিখেছ সে যদি সেই স্তরে উত্তর দেয়, দৃশ্য জটিল হলেও সেটা ধরে রাখে, আর কালও মনে রাখে, তাহলে তোমার উত্তর পেয়ে গেলে। না দিলে সেটাও তুমি ঠিক ততটাই দ্রুত পেলে, আর খরচ করলে দশ মিনিট, একটা মাস নয়।

আর মেমোরি খুলে সম্পাদনা করার অধিকার তোমারই, যেটা ইংরেজির চেয়ে তোমার ভাষায় বেশি জরুরি: সে যখন কোনো নাম বা সম্বোধনের রূপ ভুল করবে, তখন পাঁচ পালা ধরে তার সঙ্গে তর্ক না করে তুমি ভেতরে গিয়ে তথ্যটাই ঠিক করে দিতে পারবে।

Talaforge কি আমার ভাষায় কাজ করে?
bot আর Mini App ৩৬টা ভাষায় আছে, তাই তোমার ভাষা তার মধ্যে থাকলে পুরো ইন্টারফেস সেই ভাষাতেই, আর সে যে মেমোরি রাখে সেটাও সেই ভাষাতেই লেখা হয়। একটা নির্দিষ্ট চরিত্র তাতে কতটা ভালো লেখে, তা নির্ভর করে তার পেছনের model আর তার কার্ড কীভাবে লেখা হয়েছে তার ওপর — ওপরের দশ মিনিটের পরীক্ষা ঠিক সেই জন্যই।
AI চরিত্র দৃশ্যের মাঝখানে কেন ইংরেজিতে চলে যায়?
একে বলে language confusion, আর এটা পরিমাপ করা হয়েছে: ২০২৪ সালের Language Confusion Benchmark দেখিয়েছে, এমনকি সবচেয়ে শক্তিশালী model-ও যে ভাষায় তাদের বলা হয়েছে সেই ভাষায় ধারাবাহিকভাবে উত্তর দিতে পারে না, আর জটিল prompt ও উচ্চ স্যাম্পলিং temperature পরিস্থিতি আরও খারাপ করে। রোলপ্লে একসঙ্গে ওই দুটোই, আর সে কারণেই অ্যাসিস্ট্যান্ট চ্যাটের চেয়ে এখানে এটা বেশি দেখা যায়।
অনুবাদ করা ইন্টারফেস আর বহুভাষী চরিত্র কি একই জিনিস?
না, আর দুটোকে গুলিয়ে ফেলা এই শিল্পের সবচেয়ে প্রচলিত হাতসাফাই। বোতাম অনুবাদ করতে এক সপ্তাহ লাগে। দীর্ঘ দৃশ্য জুড়ে ভাষার স্তর, লিঙ্গরূপ আর বাগধারা ধরে রাখা হলো model আর চরিত্রের লেখার একটা বৈশিষ্ট্য, আর কোনো সেটিংসের পাতা তা যোগ করতে পারে না।
আমার ভাষার একটা স্থানীয় অ্যাপ কি বিশ্বজোড়া অ্যাপের চেয়ে ভালো হবে?
কখনও কখনও, সত্যিই। একটা বাজারের জন্য আর সেই বাজারের লোকেদের হাতে বানানো পণ্য প্রায়ই অপভাষা, বাগধারা আর সম্বোধনে জেতে, কারণ যারা লিখছে তারা প্রতিদিন ভাষাটা শোনে। বিশ্বজোড়া পণ্য জেতে model-এর মান, মেমোরি আর দৃশ্য কতক্ষণ চলতে পারে তাতে। একই সন্ধ্যায়, একই চরিত্র দিয়ে দুটোই পরীক্ষা করো — তফাত দশ মিনিটের মধ্যেই ধরা পড়ে।
চেষ্টা করতে কি অ্যাকাউন্ট, অ্যাপ বা কার্ড লাগে?
না। এটা Telegram-এর ভেতরের একটা bot: একটা চ্যাট খুলে লিখতে শুরু করো। শুরুটা ফ্রি, এনার্জি হলো ⚡, আর আপগ্রেড হলো চ্যাটের ভেতরেই Telegram Stars।

আরও পড়ো

Telegram-এ একটা চরিত্র বানাও →