در جاکارتا «ai roleplay» را در گوگل بنویسید و کادر با bahasa Indonesia تمامش میکند. در توکیو، ロールプレイ AI به 日本語 کامل میشود. در مسکو «ии девушка» میشود «ии девушка на русском». استانبول yapay zeka sohbet و بعد ücretsiz میخواهد؛ سئول میپرسد کدام ai 채팅 앱 را استفاده کند. چهار خط، چهار الفبا، و زیرشان یک پرسش که «آیا این اپ خوب است» نیست.
پرسش این است: «آیا به زبان خودِ من خوب خواهد بود» — و کسانی که آن را تایپ میکنند قبلاً سوختهاند. شخصیتی را دیدهاند که سه نوبت جذاب بود و بعد شروع کرد به فکر کردن به انگلیسی. شخصیتی را دیدهاند که با معشوقش ضمیر رسمی به کار برد. حس خواندن متنی را میشناسند که کاملاً درست تجزیه میشود و شبیه هیچ آدم زندهای نیست.
این نوشته دربارهٔ این است که چه چیزی خراب میشود، چرا نقشآفرینی بدترین حالت ممکن برای آن است، و چطور در ده دقیقه بفهمیم یک پلتفرم دارد تظاهر میکند یا نه. ما @talaforge_bot را میسازیم، پس ادعاهای خودمان را با همان بدگمانی که سزاوارشان است بخوانید؛ آنها ته مقالهاند، بعد از آزمونی که میتوانید روی خود ما اجرا کنید.
چرا خراب میشود، از نظر مکانیکی
این خطا در ادبیات پژوهشی اسم دارد. تیمی از Cohere Labs در ۲۰۲۴ «معیار سردرگمی زبانی» (Language Confusion Benchmark) را منتشر کرد — پانزده زبان با ساختارهای متنوع، یک پرسش: آیا مدل میتواند مطمئناً به همان زبانی جواب بدهد که با آن مخاطب شده است. جواب نه بود. حتی قویترین مدلها پیوسته از عهدهاش برنمیآمدند، مدلهای انگلیسیمحور از همه بدتر، و دو شرط آن را بهطور قابلاندازهگیری بدتر میکرد: پرومپتهای پیچیده و دمای نمونهبرداری بالا.
حالا این را با نقشآفرینی در ذهن بخوانید. یک شخصیت از بنیاد یک پرومپت پیچیده است — پرسونا، صحنه، حافظه، نکات سبک، و گفتوگویی که هر نوبت بزرگتر میشود. و نقشآفرینی عمداً داغ اجرا میشود، چون دما همان چیزی است که جلوی تکرار او را میگیرد. نقشآفرینی حالت حاشیهای برای لغزش زبانی نیست. نقطهٔ کاریِ دقیقی است که لغزش در آن بدتر است، و کل این دسته همانجا زندگی میکند.
زیرش مالیاتی آرامتر هست. مدلها متن را بهصورت توکن میخوانند و واژگان توکن بیشتر از انگلیسی آموخته میشود، که تقریباً چهار نویسه به ازای هر توکن است. همهٔ زبانهای دیگر چیزی میپردازند که اهل فن «باروری» (fertility) مینامند: چینی حدود ۱٫۸ برابر توکن به ازای هر واژه، عربی و هندی معمولاً ۳ تا ۴ برابر، و بعضی زبانها بسیار بدتر. آن عدد را هرگز نمیبینید. پیامدش را میبینید — همان پنجرهٔ گفتوگو به زبان شما از داستان شما کمتر از انگلیسی جا میدهد، پس او زودتر جایش تمام میشود و زودتر فراموش میکند.
پنج شکل بروز، به ترتیب سرعتی که متوجهشان میشوید
- فروپاشی لحن. کیگو در ژاپنی، سطوح گفتار در کرهای، ты/вы در روسی، du/Sie در آلمانی، saya/anda در برابر aku/kamu در برابر gue/lo در اندونزیایی — و در فارسی تو/شما و تفاوت لحن گفتاری با نوشتاری. هر کدام رابطهای را کدگذاری میکند. شخصیتی که نتواند یکی را نگه دارد، یا هرگز عوضشان نکند، فراموش کرده شما برایش کی هستید — و لحن سریعترین چیزی است که میشود آزمود.
- لغزش مطابقت. در روسی، عربی، عبری، لهستانی یا پرتغالی فعل یا صفت جنسیت دارد، پس زنی که دربارهٔ خودش مینویسد شکلی متفاوت از مرد برمیگزیند. شخصیتی که دربارهٔ خودش به مذکر سُر بخورد صحنه را با یک کلمه شکسته است، و مدلهای آموزشدیده با انگلیسی زیاد سُر میخورند.
- نشت انگلیسی. دیالوگ به زبان شما، روایت به زبان شما، و فکر درونیِ ایتالیک به انگلیسی. اول در فکرها پیدا میشود، چون آن سبکدارترین متن جواب است و کمتر از همه به آنچه همین حالا نوشتهاید لنگر دارد.
- اصطلاح کپیشده. جملههایی که تجزیه میشوند و هیچکس نمیگوید: تعبیرهای انگلیسی کلمهبهکلمه منتقلشده، ریتم جملهٔ انگلیسی، شکل پاراگراف انگلیسی. منظور مردم وقتی میگویند یک محصول «مثل دوبله میخواند» همین است.
- نامها و عبارات خطاب خرابشده. 先輩 با حروف لاتین برای خوانندهای ژاپنی، 오빠 تبدیلشده به یک اسم کوچک، یک جفت anh/em ویتنامی جایگزینشده با «you» لخت. واژههایی که رابطه را حمل میکنند دقیقاً همانهاییاند که لایهٔ ترجمه حذف میکند، چون انگلیسی برایشان جایی ندارد.
آزمون دهدقیقهای
این را روی ما و روی هر چیز دیگری که در نظر دارید اجرا کنید. هزینهای ندارد و سریعتر از هر نقدی تکلیف را روشن میکند.
- دقیقهٔ یک — اولین جمله را به زبان خودتان بنویسید، با لحنی که واقعاً به کار میبرید. عامیانه، ادات، ضمیر صمیمی. نه «سلام».
- دقیقههای دو تا چهار — وادارش کنید لحن عوض کند. از او بخواهید با شما رسمی باشد، بعد بگویید کنارش بگذارد. پلتفرمی که فقط یک سطح ادب دارد اینجا رد میشود، و بیسروصدا رد میشود.
- دقیقهٔ پنج — صحنه را پیچیده کنید. سه نفر در اتاق، یک دعوا، چیزی که قبلاً اتفاق افتاده. پیچیدگی محرک مستندشده است؛ بروید و تحریکش کنید.
- دقیقهٔ شش — ایتالیکها را بخوانید. فکر درونی او جایی است که انگلیسی اول از همه میرسد، معمولاً چند نوبت پیش از اینکه دیالوگ ترک بخورد.
- دقیقههای هفت و هشت — مطابقت و خطاب را بررسی کنید. آیا دربارهٔ خودش شکل جنسیتی درست را به کار میبرد؟ آیا شما را همانطور صدا میزند که آدمی در زبان شما صدا میزند؟
- دقیقههای نه و ده — فردا برگردید و بپرسید دربارهٔ چه حرف زدید. کیفیت زبانی که از یک شب عبور کند کیفیت زبانی است.
اگر از این شش تا سهتایش را رد شد، تنظیم زبان یک لایهٔ ترجمه است. بزرگی کتابخانهٔ شخصیتها جبران نمیکند؛ یک شکست است که یک میلیون بار تکرار شده.
جایگاه صادقانهٔ ما
@talaforge_bot به ۳۶ زبان است — هر دکمه، هر منو، هر خطا، و حافظهای که دربارهٔ شما نگه میدارد به زبان خود شما نوشته میشود، نه اینکه به انگلیسی بایگانی شود و در راه خروج ترجمه گردد.
بعد بخش صادقانه، چون تعداد زبانهای رابط ضمانتِ روانی نیست و ما نمیخواهیم آن را چنین بفروشیم. اینکه یک شخصیت به ویتنامی یا ترکی چقدر خوب مینویسد به دو چیز بستگی دارد که فقط تا حدی در کنترل ماست: کدام مدل پشت اوست، و کارتش چطور نوشته شده. شخصیتی که به انگلیسی نوشته شده و روی مدلی اجرا میشود که به انگلیسی ارزیابی شده، در زبان شما مثل یک ترجمهٔ خوب خوانده میشود — چون دقیقاً همین است.
کاری که کردیم این بود که لغزش را یک باگ بدانیم نه یک محدودیت. در مه ۲۰۲۶ شخصیتی به روسی روایت میکرد، به روسی حرف میزد و به انگلیسی فکر میکرد، با تکههایی چینی در ایتالیکها. راهحل یک دستور صریح بود که به آخرین بخش پرومپت سنجاق شد — گفتار، روایت و فکر درونی، همه به همان زبان بمانند — چون چند صد توکن آخر زمینه محکمترین لنگر برای انتخاب زبان سطحی مدلاند. آن سنجاق امروز دوازده زبان را پوشش میدهد. هر ۳۶ زبان را نه، و قصد نداریم وانمود کنیم دارد.
جایی که میبازیم: ما کتابخانهای از میلیونها شخصیت ساختهٔ جامعه نداریم، پس شانس شما برای پیدا کردن شخصیتی که قبلاً یک گویشور بومی زبان شما نوشته باشد اینجا کمتر از پلتفرمهای بزرگ است. اگر چیزی که میخواهید شخصیتی است که کسی در کشور شما قبلاً نوشته و تنظیم کرده، کاتالوگهای بزرگ جاییاند که آنها زندگی میکنند، و یک اپ محلی که به دست کسانی ساخته شده که زبان شما را حرف میزنند گاهی در اصطلاح و عامیانه صریحاً از ما بهتر است. ترجیح میدهیم این را بگوییم تا وانمود کنیم قفسهٔ ما همان قفسهٔ آنهاست.
ده دقیقه، از همین حالا
تلگرام را باز کنید، @talaforge_bot را باز کنید و اولین جمله را بهجای انگلیسی به زبان خودتان بنویسید. شروع رایگان است — انرژی ⚡ است و ارتقاها Telegram Stars در خود چتاند، بدون کارت، بدون حساب، بدون فروشگاهی در میان. اگر با همان لحنی که به کار بردید جواب داد، وقتی صحنه پیچیده شد نگهش داشت و فردا هنوز یادش بود، جوابتان را گرفتهاید. اگر نه، همانقدر سریع آن را هم گرفتهاید، و ده دقیقه خرج کردهاید نه یک ماه.
و حافظه مال خود شماست که بازش کنید و ویرایشش کنید، که در زبان شما از انگلیسی مهمتر است: وقتی اسم یا شکل خطابی را اشتباه گرفت، میتوانید بروید و واقعیت را درست کنید، بهجای اینکه پنج نوبت با او سر آن بحث کنید.