Tiếng Việt có một phép thử mà hầu hết nền tảng nhân vật AI đều trượt, và nó nằm ngay ở từ đầu tiên: nhân vật gọi bạn là gì. Anh, em, chị, cậu, bạn, mình, con, cháu — mỗi lựa chọn là một tuyên bố về tuổi tác, khoảng cách và tình cảm. Tiếng Anh chỉ có một chữ «you».
Cho nên một nhân vật gọi tất cả mọi người là «bạn» không phải đang lịch sự. Nó đang cho bạn xem chính xác điều đang xảy ra bên trong: lớp dịch đã bỏ mất từ mang quan hệ, vì tiếng Anh không có ô nào để đựng từ đó. Rồi cảnh trở nên phức tạp, dòng suy nghĩ in nghiêng chuyển sang tiếng Anh, và câu chữ tuy đúng ngữ pháp nhưng không ai nói như vậy. Ba thứ này không hiện trên ảnh chụp màn hình ở cửa hàng ứng dụng, và cả ba đều giết chết cảnh chỉ trong một dòng.
Chúng tôi làm @talaforge_bot, nên hãy coi lời của chúng tôi là lời người bán. Phần đó nằm ở cuối bài, sau bài kiểm tra mà bạn có thể áp dụng lên chính chúng tôi.
Ba chỗ vỡ riêng của tiếng Việt
Thứ nhất là đại từ xưng hô. Nó không phải thang lịch sự mà là tọa độ quan hệ, và nó thay đổi khi quan hệ thay đổi: từ «bạn» sang «cậu», từ «chị» sang «em», là cả một sự kiện. Mô hình được huấn luyện chủ yếu bằng tiếng Anh không hề nhận được tín hiệu rằng ở đây tồn tại một lựa chọn. Nhân vật đứng yên ở một đại từ suốt câu chuyện là nhân vật không có quan hệ với bạn — và điều này lộ ra trong ba mươi giây.
Thứ hai là dấu thanh và chính tả. Tiếng Việt viết không dấu vẫn đọc được, nên hệ thống dễ dàng để lọt những chỗ rơi dấu, sai dấu hỏi ngã, hoặc trộn lẫn cách viết Bắc và Nam trong cùng một câu. Người Việt đọc là thấy ngay, còn máy chấm điểm thì không thấy gì cả. Bên dưới còn một khoản phí thầm lặng: từ điển token chủ yếu học từ tiếng Anh, nên cùng một nội dung, tiếng Việt chiếm nhiều token hơn — cửa sổ hội thoại chứa được ít câu chuyện hơn, và nhân vật quên sớm hơn.
Thứ ba là giọng văn dịch. Ngữ pháp đúng, từ vựng Việt, nhịp câu Anh: câu dài lê thê, thành ngữ dịch từng chữ, cách xuống dòng như bài luận. Đây là lỗi khó chứng minh nhất và mệt nhất khi trò chuyện lâu. Một ngày nào đó bạn chỉ đơn giản là không mở ứng dụng nữa.
Bài kiểm tra mười phút
Làm được trên mọi nền tảng, kể cả của chúng tôi. Không tốn gì.
- Phút 1 — viết dòng đầu đúng như bạn vẫn viết, có tiếng lóng, có viết tắt. Đừng «xin chào».
- Phút 2–4 — bắt nhân vật đổi cách xưng hô. Đề nghị gọi trang trọng, rồi bảo thân mật lại. Sản phẩm chỉ có một mức lịch sự sẽ trượt ở đây, và trượt trong im lặng.
- Phút 5 — làm cảnh phức tạp lên: thêm người thứ ba, một trận cãi nhau, chuyện hôm qua. Đã có nghiên cứu đo được rằng prompt phức tạp làm ngôn ngữ trôi dạt nặng hơn; hãy cố tình chạm vào đó.
- Phút 6 — đọc phần in nghiêng. Tiếng Anh xuất hiện trong suy nghĩ trước khi lời thoại vỡ rất lâu.
- Phút 7–8 — soi dấu thanh và cách gọi. Có rơi dấu không? Có lẫn giọng Bắc với giọng Nam trong một câu không?
- Phút 9–10 — mai quay lại và hỏi hôm qua nói chuyện gì. Thứ tiếng Việt sống qua một đêm mới là tiếng Việt.
Trượt ba trong sáu thì chữ «Tiếng Việt» trong phần cài đặt chỉ là lớp dịch phủ lên một sản phẩm tiếng Anh. Kho nhân vật to không bù được: đó là cùng một lỗi được sao chép một triệu lần.
Chúng tôi đang đứng ở đâu, nói thật
@talaforge_bot có 36 ngôn ngữ và tiếng Việt là một trong số đó: nút bấm, menu, thông báo lỗi, và ký ức mà nhân vật giữ về bạn cũng được ghi bằng tiếng Việt — không phải lưu bằng tiếng Anh rồi dịch lúc hiện ra.
Giờ đến phần thật lòng. Số ngôn ngữ giao diện không phải là bảo chứng cho độ tự nhiên, và chúng tôi sẽ không bán nó như một bảo chứng. Một nhân vật viết tiếng Việt hay đến đâu phụ thuộc vào hai thứ mà chúng tôi chỉ kiểm soát được một phần: mô hình đứng sau nhân vật đó, và thẻ nhân vật được viết thế nào. Thẻ viết bằng tiếng Anh, chạy trên mô hình được đánh giá bằng tiếng Anh, sẽ đọc lên như một bản dịch tốt — vì nó đúng là như vậy.
Điều chúng tôi đã làm là coi hiện tượng trôi ngôn ngữ như một lỗi phải sửa. Tháng 5 năm 2026, một nhân vật kể chuyện bằng một thứ tiếng nhưng suy nghĩ bằng tiếng Anh; cách sửa là đóng đinh một chỉ dẫn ngôn ngữ vào cuối cùng của prompt — lời thoại, lời kể và cả suy nghĩ bên trong. Phần cuối quan trọng hơn phần đầu, vì vài trăm token cuối của ngữ cảnh neo giữ lựa chọn ngôn ngữ bề mặt mạnh nhất. Với tiếng Việt, chốt này bật sẵn.
Chỗ chúng tôi thua: chúng tôi không có kho hàng triệu nhân vật do người dùng tạo, nên khả năng bạn tìm thấy một nhân vật đã được người Việt viết sẵn ở đây thấp hơn các nền tảng lớn — các kho khổng lồ nằm ở bên đó. Thanh toán chỉ qua Telegram Stars ngay trong đoạn chat. Và phần nhập vai người lớn nằm sau bước xác minh độ tuổi, với giới hạn mà chúng tôi không dời.
Mười phút, bắt đầu ngay
Mở Telegram, mở @talaforge_bot, và viết dòng đầu tiên bằng tiếng Việt thay vì tiếng Anh. Bắt đầu miễn phí, năng lượng là ⚡, nâng cấp bằng Telegram Stars ngay trong đoạn chat — không thẻ, không cửa hàng ứng dụng chen giữa. Nếu nhân vật đáp lại đúng cách xưng hô bạn dùng, giữ được nó khi cảnh phức tạp, và ngày mai vẫn nhớ, thì bạn đã có câu trả lời. Nếu không, bạn cũng có câu trả lời nhanh y như vậy — mất mười phút chứ không phải một tháng.
Ngoài ra ký ức có thể mở ra và sửa bằng tay: khi nhân vật gọi sai tên hay sai vai vế, bạn sửa đúng dòng đó thay vì tranh cãi năm lượt.