Trong dữ liệu từ khóa của chúng tôi, câu hỏi đơn lẻ được nhiều đường dẫn hội tụ nhất trong khối tiếng Anh là «how to train ai chatbot». Số hạt giống đổ về nó nhiều hơn bất kỳ cụm nào về bạn gái ảo, nhập vai hay ứng dụng. Người ta cho rằng đằng sau một nhân vật hay ắt phải có một quy trình huấn luyện, và rằng cánh cửa ấy đóng với họ.
Với một nhân vật, khung nhìn đó đơn giản là sai — và nhận ra vì sao nó sai là bước nâng cấp nhanh nhất đang có sẵn.
Mô hình không phải của bạn để huấn luyện, và thế là ổn
Các mô hình ngôn ngữ đứng sau một nhân vật — ở đây là năm mô hình, trong đó có Claude Opus và DeepSeek — đến nơi đã hoàn chỉnh, được huấn luyện trên lượng văn bản nhiều hơn bất kỳ người nào đọc nổi trong một đời. Thứ gì bạn thêm vào cũng không làm chúng nhúc nhích. Cái chúng thiếu không phải kiến thức; là chỉ dẫn về con người chúng phải trở thành ngay lúc này.
Một nhân vật chính xác là thế: chỉ dẫn cộng trí nhớ. Cả hai đều là văn bản thường. Cả hai đều của bạn. Sửa bất kỳ bên nào cũng có hiệu lực ngay ở câu trả lời kế tiếp — một vòng phản hồi chặt hơn mọi phiên huấn luyện từng trao cho bất kỳ người nào.
Câu văn gánh phần nặng nhất
Một câu viết ra sinh cả bản nháp — nhân dạng, giọng, cảnh mở đầu, một diện mạo được khóa. Chất lượng của câu ấy quyết định nhiều hơn mọi cài đặt trên trang.
Mẹo dùng được là mâu thuẫn. «Một cô thủ thư tốt bụng» sẽ phẳng lì sau chừng mười câu trả lời, vì không còn chỗ để đi. «Một cô thủ thư tốt với tất cả mọi người và bực chính mình vì cần được như thế» cho mô hình một sức căng để diễn, và sức căng chính là thứ đọc lên thấy giống một con người.
Những ô mà người ta bỏ qua
Bản nháp được sinh ra là điểm khởi đầu, và mọi trường đều sửa được mãi mãi. Ba chỗ đáng công chăm chút:
Tin nhắn mở đầu định giọng điệu còn hơn cả phần nhân dạng — câu đầu tiên của nhân vật dạy cả hai bên cuộc trò chuyện này nghe ra sao. Các ràng buộc phải nằm trên giấy: nếu cô ấy không bao giờ nói về cuộc chiến, hãy viết điều đó ra, vì mô hình không suy ra nổi một khoảng lặng bạn chưa từng nêu. Còn diện mạo được khóa từ lúc tạo — vì thế tấm ảnh tối nay của cô khớp với tấm của tháng trước.
Không thứ nào trong số này là prompt engineering theo nghĩa đáng sợ. Nó gần với việc viết một bản mô tả nhân vật cho một diễn viên tuân theo nó từng chữ.
Trí nhớ mới là vòng huấn luyện bạn thực sự có
Người đi tìm một «nhân vật AI nhớ được mọi thứ» thực ra đang đòi sự nhất quán qua nhiều tuần — và cơ chế cho việc đó không phải một mô hình to hơn, mà là một trí nhớ chỉnh lại được.
Ở đây trí nhớ là các dữ kiện ngắn đọc được, theo từng nhân vật và từng chủ đề. Khi một dữ kiện sai bị ghi lại — và sẽ có lúc như thế — bạn mở danh sách và sửa dòng ấy. Một lần sửa đó làm đúng điều người ta tưởng một đợt fine-tune sẽ làm, trong năm giây, và đảo ngược được. Chỉnh trí nhớ sớm trong đời một nhân vật định hình nó hơn mọi thói quen khác.
Khi nghe vẫn cứ sai
Nếu mạch truyện trôi lệch, công cụ mang tính phẫu thuật chứ không toàn cục: tạo lại đúng câu trả lời vừa chệch hướng, hoặc rẽ nhánh phân cảnh và giữ cả hai nhánh. Nếu giọng văn phẳng, có thể nhạc cụ đang sai với phân cảnh — đổi qua lại giữa năm mô hình ngay giữa cuộc trò chuyện thay đổi chất văn mà không chạm vào con người của nhân vật.
!Điều duy nhất không bao giờ giúp ích là xóa đi làm lại từ đầu. Một nhân vật tiến bộ theo cách một bản nháp tiến bộ — bằng những lần sửa còn ở lại — và xóa bản nháp là xóa đúng phần không thể tạo lại: những gì nó đã học được về bạn.
Vậy câu trả lời trung thực cho «làm sao huấn luyện chatbot của tôi» là: bạn viết một câu thật tốt, bạn sửa trí nhớ của nó khi nó nhầm, và bạn cưỡng lại ý muốn đi tìm một trang cài đặt nơi cất giấu tay nghề. Tay nghề nằm trong việc viết — đúng chỗ nó vẫn luôn nằm.