ĐANG HOẠT ĐỘNG · ĐÃ ĐỐI CHIẾU HỆ THỐNG

Nhân bản giọng nói

Nhân bản giọng nói từ bản thu của bạn hoặc bản thu đã được chủ thể cho phép, sau đó dùng trực tiếp trong không gian tạo giọng.

Thông số vận hành đã kiểm chứng

Đầu vào, giới hạn và điều khiển thực tế

Độ dài mẫu
3–30 giây
Giới hạn tải lên
10 MB cho mỗi bản thu tham chiếu
Định dạng audio
MP3, WAV, M4A, AAC, OGG, WebM, FLAC hoặc Opus
Làm sạch
Tùy chọn loại bỏ tiếng ồn nền trước khi nhân bản

Khả năng chính

Công cụ này làm được gì?

Nhân bản từ audio tham chiếu
Lưu giọng để dùng lại
Dùng chung trong thư viện TTS
Ưu tiên quyền đồng ý

Dịch vụ được kết nối

Nguồn giọng, dịch vụ hoặc mô hình liên quan

Đây là công cụ nội bộ trong quy trình OpenSpeaker, không được gắn nhãn sai thành sản phẩm của một nhà cung cấp bên ngoài.

Quy trình sản phẩm

Từ đầu vào đến thành phẩm trong ba bước

01

Dùng audio đã được đồng ý

Tải một bản thu rõ mà bạn sở hữu hoặc đã được chủ thể cho phép nhân bản.

02

Chuẩn bị mẫu

Xem waveform và loại bỏ tiếng ồn nền nếu cần.

03

Lưu và dùng giọng

Đặt tên giọng nhân bản rồi chọn ngay trong thư viện TTS chung.

Tình huống sử dụng

Phù hợp cho

  • Giọng đọc cá nhân
  • Giọng thương hiệu đã được đồng ý
  • Giọng nhân vật dùng lặp lại
  • Giữ nhất quán khi bản địa hóa

API cho lập trình viên

Tích hợp quy trình này

Tác vụ tạo nội dung chạy bất đồng bộ: nhận task_id, sau đó polling hoặc dùng webhook.

POST/v3/text-to-speech/voice-clone
Xem hướng dẫn API công khai
Thông tin đã đối chiếu

Trang này chỉ mô tả khả năng đang hiển thị trong ứng dụng và có luồng xử lý tương ứng trong hệ thống tại lần xác minh gần nhất.