บันทึกภาคสนาม · ภาษา

ตัวละคร AI จะเก่งในภาษาของฉันจริงไหม หรือเป็นแค่ภาษาอังกฤษที่มีชั้นแปลครอบอยู่

ในจาการ์ตา โตเกียว มอสโก อิสตันบูล และโซล ช่องค้นหาเติมประโยคเดียวกันให้จบ คือคนต่อท้ายคำค้นด้วยภาษาของตัวเอง พวกเขากำลังถามคำถามที่ไม่มีใครตอบตรง ๆ นี่คือสิ่งที่พังจริง ทำไมโรลเพลย์จึงเป็นกรณีที่แย่ที่สุด และการทดสอบสิบนาทีที่ตัดสินเรื่องนี้ได้ในทุกแพลตฟอร์ม

ตัวละคร AI จะเก่งในภาษาของฉันจริงไหม หรือเป็นแค่ภาษาอังกฤษที่มีชั้นแปลครอบอยู่

พิมพ์ «ai roleplay» ใน Google ที่จาการ์ตา ช่องค้นหาจะเติมเป็นภาษาอินโดนีเซีย ที่โตเกียว ロールプレイ AI จะต่อท้ายด้วย 日本語 ที่มอสโก «ии девушка» กลายเป็น «ии девушка на русском» อิสตันบูลถามหา yapay zeka sohbet แล้วตามด้วย ücretsiz โซลถามว่าควรใช้แอป ai 채팅 ตัวไหน สี่ภาษา สี่ชุดอักษร และใต้ทั้งหมดนั้นคือคำถามเดียวที่ไม่ใช่ «แอปนี้ดีไหม»

แต่คือ «มันจะดีในภาษาของฉันไหม» และคนที่พิมพ์คำนี้เคยเจ็บมาแล้ว พวกเขาเคยเจอตัวละครที่น่าหลงใหลอยู่สามเทิร์น แล้วเริ่มคิดเป็นภาษาอังกฤษ เคยเจอตัวที่ใช้สรรพนามสุภาพกับคนรัก และรู้จักความรู้สึกของการอ่านอะไรที่แยกวิเคราะห์ได้สมบูรณ์แต่ฟังไม่เหมือนคนที่มีชีวิตอยู่

บทความนี้เล่าว่าอะไรพัง ทำไมโรลเพลย์จึงเป็นกรณีที่แย่ที่สุดของเรื่องนี้ และจะรู้ใน 10 นาทีได้อย่างไรว่าแพลตฟอร์มไหนแกล้งทำ เราทำ @talaforge_bot ดังนั้นคำกล่าวอ้างของเราเองก็ควรถูกสงสัยตามสมควร มันอยู่ท้ายบทความ หลังการทดสอบที่คุณรันกับเราได้

ทำไมมันพัง ในเชิงกลไก

ความล้มเหลวนี้มีชื่อในงานวิจัย ทีมของ Cohere Labs เผยแพร่ Language Confusion Benchmark ในปี 2024 — สิบห้าภาษาที่ต่างกันเชิงรูปแบบ กับคำถามเดียว: โมเดลตอบด้วยภาษาเดียวกับที่ถูกพูดด้วยได้อย่างน่าเชื่อถือหรือไม่ คำตอบคือไม่ แม้แต่โมเดลที่แข็งแกร่งที่สุดก็ทำไม่ได้อย่างสม่ำเสมอ โมเดลที่เน้นอังกฤษแย่ที่สุด และมีสองเงื่อนไขที่ทำให้แย่ลงอย่างวัดได้: พรอมต์ที่ซับซ้อน และอุณหภูมิการสุ่มตัวอย่างสูง

ทีนี้อ่านมันโดยนึกถึงโรลเพลย์ ตัวละครคือพรอมต์ที่ซับซ้อนโดยโครงสร้าง — มีบุคลิก ฉาก ความทรงจำ โน้ตสไตล์ และบทสนทนาที่ยาวขึ้นทุกเทิร์น และโรลเพลย์ถูกรันแบบร้อนโดยตั้งใจ เพราะ temperature คือสิ่งที่ทำให้เธอไม่พูดซ้ำตัวเอง โรลเพลย์ไม่ใช่กรณีขอบของการเลื่อนภาษา มันคือจุดทำงานที่การเลื่อนแย่ที่สุดพอดี และทั้งหมวดนี้อยู่ตรงนั้น

ข้างใต้มีภาษีที่เงียบกว่า โมเดลอ่านข้อความเป็นโทเคน และคลังโทเคนถูกเรียนจากภาษาอังกฤษเป็นหลัก ซึ่งลงตัวที่ราวสี่ตัวอักษรต่อโทเคน ภาษาอื่นจ่ายสิ่งที่ผู้ปฏิบัติเรียกว่า fertility: จีนใช้ราว 1.8 เท่าของโทเคนต่อคำ อาหรับและฮินดีมักสามถึงสี่เท่า และบางภาษาแย่กว่านั้นมาก คุณไม่เห็นตัวเลขนั้น คุณเห็นผลของมัน — หน้าต่างบทสนทนาเดียวกันใส่เรื่องราวของคุณในภาษาของคุณได้น้อยกว่าในภาษาอังกฤษ เธอจึงหมดที่และลืมเร็วกว่า

ห้าอาการ เรียงตามความเร็วที่คุณจะสังเกตเห็น

การทดสอบสิบนาที

รันอันนี้กับเราและกับทุกอย่างที่คุณกำลังพิจารณา มันไม่มีค่าใช้จ่ายและตัดสินเรื่องนี้ได้เร็วกว่ารีวิวใด ๆ

ถ้าตกสามในหกข้อ การตั้งค่าภาษาก็คือชั้นแปล ขนาดของคลังตัวละครไม่ช่วยชดเชย มันคือความล้มเหลวเดียวที่ซ้ำหนึ่งล้านครั้ง

เราอยู่ตรงไหนอย่างซื่อตรง

@talaforge_bot มี 36 ภาษา — ทุกปุ่ม ทุกเมนู ทุกข้อความผิดพลาด และความทรงจำที่เธอเก็บเกี่ยวกับคุณถูกเขียนกลับเป็นภาษาของคุณ ไม่ใช่เก็บเป็นอังกฤษแล้วแปลตอนส่งออก

แล้วถึงส่วนที่ตรงไปตรงมา เพราะจำนวนภาษาของอินเทอร์เฟซไม่ใช่การรับประกันความคล่อง และเราไม่ยอมขายมันแบบนั้น ตัวละครเขียนภาษาเวียดนามหรือตุรกีได้ดีแค่ไหนขึ้นอยู่กับสองสิ่งที่เราควบคุมได้แค่บางส่วน: โมเดลตัวไหนอยู่เบื้องหลังเธอ และการ์ดของเธอถูกเขียนอย่างไร ตัวละครที่เขียนเป็นอังกฤษ รันบนโมเดลที่ประเมินเป็นอังกฤษ จะอ่านในภาษาของคุณเหมือนคำแปลที่ดี เพราะนั่นคือสิ่งที่มันเป็นพอดี

สิ่งที่เราทำคือถือว่าการเลื่อนภาษาเป็นบั๊ก ไม่ใช่ข้อจำกัด ในเดือนพฤษภาคม 2026 ตัวละครตัวหนึ่งบรรยายเป็นรัสเซีย พูดเป็นรัสเซีย และคิดเป็นอังกฤษ พร้อมเศษภาษาจีนในตัวเอียง วิธีแก้คือคำสั่งชัดเจนที่ตรึงไว้ท้ายสุดของพรอมต์ — คำพูด คำบรรยาย และความคิดในใจ ล้วนอยู่ในภาษาเดียวกัน — เพราะโทเคนสองสามร้อยตัวสุดท้ายของบริบทยึดการเลือกภาษาผิวของโมเดลได้แน่นที่สุด การตรึงนั้นครอบคลุมหนึ่งโหลภาษาในวันนี้ ไม่ครอบคลุมทั้ง 36 และเราจะไม่บอกเป็นนัยว่าครอบคลุม

ที่เราแพ้: เราไม่มีคลังตัวละครจากชุมชนหลายล้านตัว โอกาสที่คุณจะเจอตัวที่เจ้าของภาษาของคุณเขียนไว้แล้วจึงต่ำกว่าที่นี่เมื่อเทียบกับแพลตฟอร์มใหญ่ ถ้าสิ่งที่คุณอยากได้คือตัวละครที่มีคนในประเทศของคุณเขียนและปรับแต่งไว้แล้ว แค็ตตาล็อกขนาดใหญ่คือที่ที่ตัวละครเหล่านั้นอยู่ และแอปท้องถิ่นที่ทำโดยคนที่พูดภาษาของคุณบางครั้งก็ชนะเราเรื่องสำนวนและสแลงอย่างเด็ดขาด เราขอพูดแบบนี้ดีกว่าแกล้งทำเหมือนชั้นวางของเราคือชั้นวางของพวกเขา

สิบนาที เริ่มเดี๋ยวนี้

เปิด Telegram เปิด @talaforge_bot แล้วเขียนบรรทัดแรกเป็นภาษาของคุณเองแทนที่จะเป็นอังกฤษ เริ่มต้นฟรี พลังงานคือ ⚡ และการอัปเกรดใช้ Telegram Stars ในแชท ไม่ต้องใช้บัตร ไม่ต้องมีบัญชี ไม่มีสโตร์คั่นกลาง ถ้าเธอตอบด้วยระดับภาษาที่คุณใช้ รักษามันไว้เมื่อฉากซับซ้อนขึ้น และยังจำได้พรุ่งนี้ คุณก็ได้คำตอบแล้ว ถ้าไม่ คุณก็ได้มันเร็วพอกัน และคุณเสียสิบนาที ไม่ใช่หนึ่งเดือน

และ ความทรงจำเป็นของคุณที่จะเปิดและแก้ไข ซึ่งสำคัญกว่าในภาษาของคุณเมื่อเทียบกับอังกฤษ: เมื่อเธอได้ชื่อหรือคำเรียกขานผิดจริง ๆ คุณเข้าไปแก้ข้อเท็จจริงได้ แทนที่จะเถียงกับเธอห้าเทิร์น

Talaforge ใช้ได้ในภาษาของฉันไหม
บอทและมินิแอปมี 36 ภาษา ถ้าภาษาของคุณอยู่ในนั้น อินเทอร์เฟซทั้งหมดก็เป็นภาษานั้น และความทรงจำที่เธอเก็บก็เขียนเป็นภาษานั้นด้วย ตัวละครหนึ่งเขียนในภาษานั้นได้ดีแค่ไหนขึ้นอยู่กับโมเดลเบื้องหลังและวิธีที่การ์ดของเธอถูกเขียน ซึ่งคือสิ่งที่การทดสอบสิบนาทีข้างบนมีไว้สำหรับ
ทำไมตัวละคร AI สลับเป็นภาษาอังกฤษกลางฉาก
เรียกว่า language confusion และมีการวัดไว้: Language Confusion Benchmark ปี 2024 พบว่าแม้แต่โมเดลที่แข็งแกร่งที่สุดก็ตอบด้วยภาษาที่ถูกขอได้ไม่สม่ำเสมอ และพรอมต์ที่ซับซ้อนกับอุณหภูมิการสุ่มตัวอย่างสูงทำให้แย่ลง โรลเพลย์คือทั้งสองอย่างพร้อมกัน จึงเห็นที่นี่มากกว่าในแชทผู้ช่วย
อินเทอร์เฟซที่แปลแล้วเหมือนกับตัวละครหลายภาษาไหม
ไม่ และการเอามาปนกันคือกลเม็ดที่พบบ่อยที่สุดของอุตสาหกรรม การแปลปุ่มใช้เวลาทำงานหนึ่งสัปดาห์ การรักษาระดับภาษา รูปที่มีเพศ และสำนวนตลอดฉากยาวเป็นคุณสมบัติของโมเดลและของงานเขียนตัวละคร และไม่มีหน้าจอตั้งค่าใดเพิ่มให้ได้
แอปท้องถิ่นในภาษาของฉันจะดีกว่าแอประดับโลกไหม
บางครั้งจริง ๆ ผลิตภัณฑ์ที่สร้างโดยและเพื่อตลาดเดียวมักชนะเรื่องสแลง สำนวน และคำเรียกขาน เพราะคนเขียนได้ยินภาษานั้นทุกวัน ผลิตภัณฑ์ระดับโลกมักชนะเรื่องคุณภาพโมเดล ความทรงจำ และความยาวของฉากที่ไปต่อได้ ทดสอบทั้งสองในเย็นวันเดียวกันด้วยตัวละครเดียวกัน ความต่างโผล่ภายในสิบนาที
ต้องมีบัญชี แอป หรือบัตรเพื่อลองไหม
ไม่ต้อง มันคือบอทใน Telegram: คุณเปิดแชทแล้วเขียน เริ่มต้นฟรี พลังงานคือ ⚡ และการอัปเกรดใช้ Telegram Stars ในแชทเลย

อ่านต่อ

สร้างตัวละครใน Telegram →