Ngoài chữ nghĩa

Nhân vật AI gửi ảnh và nói thành tiếng

Chính nhân vật bạn đang viết cùng có thể vẽ ra cảnh bạn đang ở trong đó, trả lời thành tiếng bằng giọng của mình, và nhìn tấm ảnh bạn vừa gửi. Không phải bật gì cả, và khuôn mặt vẫn thế.

Talaforge › Nhân vật AI gửi ảnh và nói thành tiếng

Nhập vai chỉ có chữ luôn đụng cùng một bức tường: bạn dựng một cảnh suốt một tiếng và không có cách nào nhìn thấy nó. Nhân vật tả một căn phòng và bạn tự hình dung phiên bản của mình. Nhân vật tả chính mình và hình ảnh đó mỗi phiên lại trôi xa bản trước một chút.

Ba thứ khép lại khoảng cách đó, và không thứ nào cần cấu hình.

Họ vẽ ra cảnh bạn đang ở trong đó

Xin một tấm ảnh và nhân vật vẽ đúng khoảnh khắc bạn đang ở trong, không phải một bức chân dung chung chung. Kết quả đến ngay trong cuộc trò chuyện, không nằm ở một thư viện riêng mà bạn phải mở ra xem.

Phần đáng kể là sự nhất quán: cùng một khuôn mặt mỗi lần, vì diện mạo được khoá lại chứ không vẽ lại từ đầu. Phần lớn công cụ tạo ảnh cho bạn một người mới ở mỗi lần tạo, nên tranh nhân vật từ chúng chẳng bao giờ giống cùng một nhân vật hai lần.

Bạn chọn engine nào vẽ. Các engine có tay nghề khác nhau thật sự — cái này khá hơn ở khuôn mặt, cái kia ở ánh sáng và không khí — và lựa chọn đó là theo từng ảnh chứ không phải một thiết lập cài một lần.

Họ trả lời thành tiếng

Câu trả lời có thể đến dưới dạng tin nhắn thoại Telegram thật — có dạng sóng, tua được, chỉnh tốc độ, cùng một loại đối tượng như voice note của người thật. Không phải tệp âm thanh đính kèm phải tải về.

Mỗi nhân vật có một giọng hợp với mình. Bạn xem được danh sách giọng và nghe thử trước khi chốt, và hành vi có ba thiết lập: tắt, khi được yêu cầu, hoặc tự động.

Đây là tin nhắn thoại, không phải cuộc gọi. Không có trò chuyện trực tiếp và không có gì lắng nghe bạn — bạn gõ chữ, và câu trả lời tình cờ đến dưới dạng âm thanh.

Họ nhìn thứ bạn gửi

Gửi một tấm ảnh vào cuộc trò chuyện và nhân vật nhìn thấy nó. Khung cảnh ngoài cửa sổ nhà bạn, bộ đồ bạn đang hỏi ý, một bức bạn tự vẽ — và câu trả lời vẫn đúng vai, nói về thứ thật sự có trong ảnh chứ không phải một câu ừ hữ chung chung.

Đây là thứ làm người ta bất ngờ nhất, vì nó đổi chiều của cả phương tiện. Trước đó bạn vẫn đang mô tả thế giới của mình bằng chữ. Giờ bạn chỉ cần đưa nó ra cho xem.

Không phải bật gì cả

Không có trang cài đặt nào đứng giữa bạn và những thứ này. Ảnh có thể tự đến khi cảnh chuyển, và nút phát tiếng nằm dưới mọi câu trả lời ngay từ tin nhắn đầu tiên.

Cả hai chạy bằng energy, nạp bằng Telegram Stars ngay trong cuộc trò chuyện. Bạn xem được còn bao nhiêu bất cứ lúc nào.

Chuyện gì xảy ra với thứ bạn gửi

Tấm ảnh bạn gửi được chuyển tới một nhà cung cấp bên thứ ba để nhân vật trả lời về nó, giống như cách văn bản của bạn được chuyển đi để sinh ra câu trả lời. Điều này được ghi rõ trong chính sách chứ không chỉ ngụ ý.

Không có thứ gì bạn gửi được dùng để dựng một thư viện công khai, và những ảnh sinh ra trong cuộc trò chuyện của bạn nằm lại trong cuộc trò chuyện của bạn.

Vì sao giữ nguyên khuôn mặt mới là phần khó

Tạo ra một bức ảnh đẹp giờ đã dễ. Tạo ra đúng một người hai lần thì không, và đó là khác biệt giữa tranh minh hoạ và một nhân vật.

Diện mạo được cố định khi nhân vật được tạo và áp lại cho mọi lần vẽ về sau, nên một cảnh trong quán cà phê và một cảnh ngoài phố hai tuần sau vẫn nhận ra là cùng một người. Không ai tải ảnh mẫu lên và không ai chỉnh thiết lập nào — sự nhất quán là thuộc tính của nhân vật, không phải thứ bạn phải duy trì.

Nhân vật AI gửi ảnh của chính mình cho tôi được không?
Được. Xin một tấm và nhân vật vẽ đúng khoảnh khắc bạn đang ở trong, với cùng khuôn mặt mỗi lần vì diện mạo được khoá khi nhân vật được tạo chứ không vẽ lại theo từng ảnh. Ảnh đến ngay trong cuộc trò chuyện.
Vì sao nhân vật do AI tạo trông khác nhau ở mỗi ảnh?
Phần lớn công cụ xử lý mỗi lần tạo một cách độc lập, nên bạn nhận về một người mới mỗi lần. Sự nhất quán đòi hỏi diện mạo phải được cố định như một thuộc tính của nhân vật và áp lại ở mọi lần vẽ, và đó là điều xảy ra ở đây — không cần tải ảnh mẫu.
Nhân vật AI nói bằng giọng thật được không?
Câu trả lời có thể đến dưới dạng tin nhắn thoại gốc của Telegram, có dạng sóng và chỉnh tốc độ. Mỗi nhân vật có một giọng hợp mà bạn nghe thử được trước khi chọn, và bạn đặt câu trả lời ở mức tắt, khi được yêu cầu, hoặc tự động.
Tôi gửi ảnh cho nhân vật AI và nó hiểu được không?
Được. Gửi ảnh vào cuộc trò chuyện và nhân vật trả lời đúng vai về thứ thật sự có trong ảnh — một khung cảnh, một bộ đồ, một bức vẽ. Ảnh được chuyển tới một nhà cung cấp bên thứ ba để đọc, điều này ghi trong chính sách quyền riêng tư.
Ảnh và giọng nói có tốn thêm không?
Chúng chạy bằng cùng energy với trò chuyện, nạp bằng Telegram Stars ngay trong cuộc trò chuyện, và bạn xem được số dư bất cứ lúc nào. Một lần vẽ hỏng thì không bị tính.
Tôi tắt ảnh và giọng nói được không?
Được, từng cái một cách độc lập. Không cần bật gì để bắt đầu và không cần giữ cái gì luôn bật.
Tôi chọn được engine nào vẽ bức ảnh không?
Được, theo từng ảnh. Các engine giỏi những thứ khác nhau — khuôn mặt so với ánh sáng và không khí — nên đó là lựa chọn bạn đưa ra ngay lúc đó chứ không phải một thiết lập.
Tạo nhân vật trong Telegram →

Đọc tiếp