ĐANG HOẠT ĐỘNG · ĐÃ ĐỐI CHIẾU HỆ THỐNG

Tạo hội thoại từ văn bản

Tạo audio hội thoại từ kịch bản. Gán giọng riêng cho từng nhân vật và điều chỉnh khoảng nghỉ giữa các câu.

Thông số vận hành đã kiểm chứng

Đầu vào, giới hạn và điều khiển thực tế

Người nói
2–26 người nói, gắn nhãn từ A> đến Z>
Nhịp thoại
Tốc độ 0,5–1,5 cho từng người; nghỉ giữa đoạn 0–5 giây
Phối giọng
Mỗi nhân vật có thể dùng một nguồn giọng được kết nối khác nhau
Tùy chọn thêm
Từ điển phát âm, thẻ biểu cảm AI và bản chép lời tùy chọn

Khả năng chính

Công cụ này làm được gì?

Nhiều người nói
Giọng riêng cho từng nhân vật
Điều chỉnh khoảng nghỉ
Dùng chung thư viện giọng

Dịch vụ được kết nối

Nguồn giọng, dịch vụ hoặc mô hình liên quan

ElevenLabsDịch vụ được kết nối
MiniMaxNguồn giọng
VbeeNguồn giọng
Fish AudioNguồn giọng
Microsoft Edge TTSDịch vụ được kết nối

Quy trình sản phẩm

Từ đầu vào đến thành phẩm trong ba bước

01

Định dạng kịch bản

Viết từng câu với nhãn A>, B>, C> để hệ thống nhận đúng nhân vật.

02

Chọn giọng từng người

Gán giọng, tốc độ cho mỗi nhân vật và đặt độ trễ giữa các đoạn.

03

Tạo hội thoại

Tạo bản hội thoại hoàn chỉnh và xuất bản chép lời có mốc thời gian nếu cần.

Tình huống sử dụng

Phù hợp cho

  • Hội thoại podcast
  • Tình huống đào tạo
  • Cảnh có nhiều nhân vật
  • Bản địa hóa nhiều người nói

API cho lập trình viên

Tích hợp quy trình này

Tác vụ tạo nội dung chạy bất đồng bộ: nhận task_id, sau đó polling hoặc dùng webhook.

POST/v3/text-to-speech/dialogue
Xem hướng dẫn API công khai
Thông tin đã đối chiếu

Trang này chỉ mô tả khả năng đang hiển thị trong ứng dụng và có luồng xử lý tương ứng trong hệ thống tại lần xác minh gần nhất.