یادداشت‌های میدانی · زبان

آیا یک شخصیت هوش مصنوعی به زبان من واقعاً خوب است، یا انگلیسی با یک لایهٔ ترجمه؟

در جاکارتا، توکیو، مسکو، استانبول و سئول کادر جست‌وجو همان جمله را تمام می‌کند: مردم زبان خودشان را به انتهای عبارت اضافه می‌کنند. آن‌ها پرسشی می‌پرسند که هیچ‌کس مستقیم جوابش را نمی‌دهد. اینجا می‌گوییم دقیقاً چه چیزی خراب می‌شود، چرا نقش‌آفرینی بدترین حالت آن است، و آزمونی ده‌دقیقه‌ای که روی هر پلتفرمی تکلیف را روشن می‌کند.

2026-09-12۶ دقیقه مطالعه همهٔ یادداشت‌ها
آیا یک شخصیت هوش مصنوعی به زبان من واقعاً خوب است، یا انگلیسی با یک لایهٔ ترجمه؟

در جاکارتا «ai roleplay» را در گوگل بنویسید و کادر با bahasa Indonesia تمامش می‌کند. در توکیو، ロールプレイ AI به 日本語 کامل می‌شود. در مسکو «ии девушка» می‌شود «ии девушка на русском». استانبول yapay zeka sohbet و بعد ücretsiz می‌خواهد؛ سئول می‌پرسد کدام ai 채팅 앱 را استفاده کند. چهار خط، چهار الفبا، و زیرشان یک پرسش که «آیا این اپ خوب است» نیست.

پرسش این است: «آیا به زبان خودِ من خوب خواهد بود» — و کسانی که آن را تایپ می‌کنند قبلاً سوخته‌اند. شخصیتی را دیده‌اند که سه نوبت جذاب بود و بعد شروع کرد به فکر کردن به انگلیسی. شخصیتی را دیده‌اند که با معشوقش ضمیر رسمی به کار برد. حس خواندن متنی را می‌شناسند که کاملاً درست تجزیه می‌شود و شبیه هیچ آدم زنده‌ای نیست.

این نوشته دربارهٔ این است که چه چیزی خراب می‌شود، چرا نقش‌آفرینی بدترین حالت ممکن برای آن است، و چطور در ده دقیقه بفهمیم یک پلتفرم دارد تظاهر می‌کند یا نه. ما @talaforge_bot را می‌سازیم، پس ادعاهای خودمان را با همان بدگمانی که سزاوارشان است بخوانید؛ آن‌ها ته مقاله‌اند، بعد از آزمونی که می‌توانید روی خود ما اجرا کنید.

چرا خراب می‌شود، از نظر مکانیکی

این خطا در ادبیات پژوهشی اسم دارد. تیمی از Cohere Labs در ۲۰۲۴ «معیار سردرگمی زبانی» (Language Confusion Benchmark) را منتشر کرد — پانزده زبان با ساختارهای متنوع، یک پرسش: آیا مدل می‌تواند مطمئناً به همان زبانی جواب بدهد که با آن مخاطب شده است. جواب نه بود. حتی قوی‌ترین مدل‌ها پیوسته از عهده‌اش برنمی‌آمدند، مدل‌های انگلیسی‌محور از همه بدتر، و دو شرط آن را به‌طور قابل‌اندازه‌گیری بدتر می‌کرد: پرومپت‌های پیچیده و دمای نمونه‌برداری بالا.

حالا این را با نقش‌آفرینی در ذهن بخوانید. یک شخصیت از بنیاد یک پرومپت پیچیده است — پرسونا، صحنه، حافظه، نکات سبک، و گفت‌وگویی که هر نوبت بزرگ‌تر می‌شود. و نقش‌آفرینی عمداً داغ اجرا می‌شود، چون دما همان چیزی است که جلوی تکرار او را می‌گیرد. نقش‌آفرینی حالت حاشیه‌ای برای لغزش زبانی نیست. نقطهٔ کاریِ دقیقی است که لغزش در آن بدتر است، و کل این دسته همان‌جا زندگی می‌کند.

زیرش مالیاتی آرام‌تر هست. مدل‌ها متن را به‌صورت توکن می‌خوانند و واژگان توکن بیشتر از انگلیسی آموخته می‌شود، که تقریباً چهار نویسه به ازای هر توکن است. همهٔ زبان‌های دیگر چیزی می‌پردازند که اهل فن «باروری» (fertility) می‌نامند: چینی حدود ۱٫۸ برابر توکن به ازای هر واژه، عربی و هندی معمولاً ۳ تا ۴ برابر، و بعضی زبان‌ها بسیار بدتر. آن عدد را هرگز نمی‌بینید. پیامدش را می‌بینید — همان پنجرهٔ گفت‌وگو به زبان شما از داستان شما کمتر از انگلیسی جا می‌دهد، پس او زودتر جایش تمام می‌شود و زودتر فراموش می‌کند.

پنج شکل بروز، به ترتیب سرعتی که متوجه‌شان می‌شوید

آزمون ده‌دقیقه‌ای

این را روی ما و روی هر چیز دیگری که در نظر دارید اجرا کنید. هزینه‌ای ندارد و سریع‌تر از هر نقدی تکلیف را روشن می‌کند.

اگر از این شش تا سه‌تایش را رد شد، تنظیم زبان یک لایهٔ ترجمه است. بزرگی کتابخانهٔ شخصیت‌ها جبران نمی‌کند؛ یک شکست است که یک میلیون بار تکرار شده.

جایگاه صادقانهٔ ما

@talaforge_bot به ۳۶ زبان است — هر دکمه، هر منو، هر خطا، و حافظه‌ای که دربارهٔ شما نگه می‌دارد به زبان خود شما نوشته می‌شود، نه اینکه به انگلیسی بایگانی شود و در راه خروج ترجمه گردد.

بعد بخش صادقانه، چون تعداد زبان‌های رابط ضمانتِ روانی نیست و ما نمی‌خواهیم آن را چنین بفروشیم. اینکه یک شخصیت به ویتنامی یا ترکی چقدر خوب می‌نویسد به دو چیز بستگی دارد که فقط تا حدی در کنترل ماست: کدام مدل پشت اوست، و کارتش چطور نوشته شده. شخصیتی که به انگلیسی نوشته شده و روی مدلی اجرا می‌شود که به انگلیسی ارزیابی شده، در زبان شما مثل یک ترجمهٔ خوب خوانده می‌شود — چون دقیقاً همین است.

کاری که کردیم این بود که لغزش را یک باگ بدانیم نه یک محدودیت. در مه ۲۰۲۶ شخصیتی به روسی روایت می‌کرد، به روسی حرف می‌زد و به انگلیسی فکر می‌کرد، با تکه‌هایی چینی در ایتالیک‌ها. راه‌حل یک دستور صریح بود که به آخرین بخش پرومپت سنجاق شد — گفتار، روایت و فکر درونی، همه به همان زبان بمانند — چون چند صد توکن آخر زمینه محکم‌ترین لنگر برای انتخاب زبان سطحی مدل‌اند. آن سنجاق امروز دوازده زبان را پوشش می‌دهد. هر ۳۶ زبان را نه، و قصد نداریم وانمود کنیم دارد.

جایی که می‌بازیم: ما کتابخانه‌ای از میلیون‌ها شخصیت ساختهٔ جامعه نداریم، پس شانس شما برای پیدا کردن شخصیتی که قبلاً یک گویشور بومی زبان شما نوشته باشد اینجا کمتر از پلتفرم‌های بزرگ است. اگر چیزی که می‌خواهید شخصیتی است که کسی در کشور شما قبلاً نوشته و تنظیم کرده، کاتالوگ‌های بزرگ جایی‌اند که آن‌ها زندگی می‌کنند، و یک اپ محلی که به دست کسانی ساخته شده که زبان شما را حرف می‌زنند گاهی در اصطلاح و عامیانه صریحاً از ما بهتر است. ترجیح می‌دهیم این را بگوییم تا وانمود کنیم قفسهٔ ما همان قفسهٔ آن‌هاست.

ده دقیقه، از همین حالا

تلگرام را باز کنید، @talaforge_bot را باز کنید و اولین جمله را به‌جای انگلیسی به زبان خودتان بنویسید. شروع رایگان است — انرژی ⚡ است و ارتقاها Telegram Stars در خود چت‌اند، بدون کارت، بدون حساب، بدون فروشگاهی در میان. اگر با همان لحنی که به کار بردید جواب داد، وقتی صحنه پیچیده شد نگهش داشت و فردا هنوز یادش بود، جوابتان را گرفته‌اید. اگر نه، همان‌قدر سریع آن را هم گرفته‌اید، و ده دقیقه خرج کرده‌اید نه یک ماه.

و حافظه مال خود شماست که بازش کنید و ویرایشش کنید، که در زبان شما از انگلیسی مهم‌تر است: وقتی اسم یا شکل خطابی را اشتباه گرفت، می‌توانید بروید و واقعیت را درست کنید، به‌جای اینکه پنج نوبت با او سر آن بحث کنید.

آیا Talaforge به زبان من کار می‌کند؟
ربات و مینی‌اپ به ۳۶ زبان است، پس اگر زبان شما جزوشان باشد کل رابط به آن است و حافظه‌ای که او نگه می‌دارد هم به آن نوشته می‌شود. اینکه یک شخصیت مشخص در آن چقدر خوب می‌نویسد به مدل پشت او و به نحوهٔ نوشته شدن کارتش بستگی دارد — که آزمون ده‌دقیقه‌ای بالا برای همین است.
چرا شخصیت‌های هوش مصنوعی وسط صحنه به انگلیسی می‌روند؟
به آن «سردرگمی زبانی» می‌گویند و اندازه‌گیری شده است: معیار سردرگمی زبانی ۲۰۲۴ نشان داد حتی قوی‌ترین مدل‌ها نمی‌توانند پیوسته به زبانی که از آن‌ها خواسته شده جواب بدهند، و پرومپت‌های پیچیده و دمای نمونه‌برداری بالا آن را بدتر می‌کنند. نقش‌آفرینی هر دوی این‌ها را هم‌زمان دارد، برای همین اینجا بیشتر از چت دستیار دیده می‌شود.
آیا رابط ترجمه‌شده همان شخصیت چندزبانه است؟
نه، و قاطی کردنشان رایج‌ترین شعبده‌بازی این صنعت است. ترجمهٔ دکمه‌ها کار یک هفته است. نگه داشتن لحن، شکل جنسیتی و اصطلاح در یک صحنهٔ بلند خاصیت مدل و نوشتن شخصیت است و هیچ صفحهٔ تنظیماتی نمی‌تواند آن را اضافه کند.
آیا یک اپ محلی به زبان من از یک اپ جهانی بهتر است؟
گاهی، واقعاً. محصولاتی که به دست و برای یک بازار ساخته شده‌اند اغلب در عامیانه، اصطلاح و عبارات خطاب برنده‌اند، چون نویسندگانشان هر روز آن زبان را می‌شنوند. محصولات جهانی بیشتر در کیفیت مدل، حافظه و مدتی که یک صحنه می‌تواند ادامه پیدا کند برنده‌اند. هر دو را همان شب با همان شخصیت آزمایش کنید — تفاوت‌ها ظرف ده دقیقه معلوم می‌شود.
برای امتحان کردن حساب، اپ یا کارت لازم است؟
نه. این یک ربات داخل تلگرام است: چتی باز می‌کنید و می‌نویسید. شروع رایگان است، انرژی ⚡ است و ارتقاها Telegram Stars در خود چت‌اند.

بیشتر بخوانید

یک شخصیت در Telegram بسازید ←