Được tạo bằng ứng dụng này
ElevenLabs Voice Clone cho phép bạn nắm bắt những đặc điểm cốt lõi của bất kỳ giọng nào từ một mẫu âm thanh duy nhất và nghe xem trước độ trung thực cao ngay lập tức. Chỉ cần tối thiểu mười giây âm thanh nguồn, ứng dụng được xây dựng cho những người sáng tạo, nhà phát triển và thương hiệu những người cần một giọng nhất quán, được cá nhân hóa mà không cần phòng thu hoặc thiết lập dài dòng. Cho dù bạn đang xây dựng một sản phẩm được kể lại, bảo tồn một giọng cá nhân hay tạo mẫu một nhân vật, công cụ này biến một bản ghi âm sạch sẽ thành một danh tính giọng nói có thể tái sử dụng.
Cách sử dụng ứng dụng này
- 1
Mô tả những gì bạn muốn tạo hoặc tải lên tệp nguồn của bạn.
- 2
Chọn các tùy chọn của bạn, sau đó nhấn Tạo.
- 3
Xem kết quả của bạn xuất hiện trong thư viện trong vài khoảnh khắc.
- 4
Tải xuống, chia sẻ hoặc tạo lại với một ý tưởng mới.
Những gì bạn có thể tạo
Tạo Mẫu Kể Chuyện Sách Nói
Tác giả và nhà xuất bản có thể tải lên mẫu mười giây của giọng diễn viên và xem trước ngay lập tức cách toàn bộ chương có thể nghe. Điều này loại bỏ nhu cầu đặt phòng thu trước khi cam kết với một diễn viên, cho phép các nhóm đánh giá tông, cảm giác nhịp độ và sự phù hợp của nhân vật sớm trong sản xuất.
Tính Nhất Quán Giọng Thương Hiệu
Các nhóm tiếp thị dựa vào một phát ngôn viên có thể sao chép giọng đó một lần và tạo âm thanh phù hợp với thương hiệu cho quảng cáo, hướng dẫn hoặc thông báo mà không cần lên lịch các phiên ghi âm lặp lại. Đầu ra độ trung thực cao giữ nguyên đặc điểm giọng nói trên mọi tài sản.
Bảo Tồn Giọng Nói Cá Nhân
Các cá nhân muốn bảo tồn giọng của họ cho công nghệ hỗ trợ, nội dung tương lai hoặc các dự án cá nhân có thể tạo bản sao trung thực từ bản ghi âm tại nhà ngắn. Yêu cầu mẫu duy nhất có nghĩa là không cần thiết lập microphone chuyên nghiệp để có được kết quả có thể sử dụng.
Giọng Nhân Vật Trò Chơi và Hoạt Hình
Nhà phát triển và họa sĩ hoạt hình có thể tạo mẫu giọng nhân vật bằng cách sao chép mẫu của diễn viên lồng tiếng sớm trong tiền sản xuất. Xem trước tức thì có nghĩa là nhóm có thể xem xét nhiều ứng cử viên và chọn tính cách giọng nói phù hợp trước khi đưa ra quyết định diễn xuất cuối cùng.
Địa Phương Hóa Phù Hợp Với Giọng Nói
Các nhóm địa phương hóa làm việc trên nội dung lồng tiếng có thể sao chép các đặc điểm giọng nói của diễn viên gốc để hướng dẫn các giám đốc giọng nói hoặc tạo bản nhạc tham khảo. Sao chép độ trung thực cao giúp người dịch và giám đốc duy trì thanh ghi cảm xúc trên các phiên bản ngôn ngữ.
Tại sao các nhà sáng tạo sử dụng ứng dụng này
- Một mẫu duy nhất
- Độ trung thực cao
- Xem trước tức thời
Mẹo để có kết quả tốt hơn
Sử Dụng Âm Thanh Nguồn Sạch Sẽ và Yên Tĩnh
Tiếng ồn nền, âm nhạc hoặc tiếng vang trong mẫu mười giây của bạn sẽ được sao chép trong bản sao. Ghi âm hoặc chọn âm thanh được ghi âm trong một phòng yên tĩnh với khoảng cách microphone nhất quán để cung cấp cho mô hình tín hiệu giọng nói rõ nhất có thể.
Đáp Ứng Độ Dài Mẫu Tối Thiểu
Mười giây là giới hạn, không phải mục tiêu. Khi bạn có tùy chọn cung cấp mười lăm đến ba mươi giây về tần suất ngôn luận, bản sao nắm bắt một loạt rộng hơn của các mẫu phát âm tự nhiên và các mẫu hơi thở của người nói, dẫn đến đầu ra tự nhiên hơn trên các tập lệnh dài hơn.
Xem Trước Trước Khi Cam Kết Tín Dụng
Tính năng xem trước tức thì tồn tại chính xác để cho phép bạn đánh giá chất lượng bản sao trước khi sử dụng nó để tạo ra toàn bộ. Nghe một cách phê phán các phụ âm, hình dạng nguyên âm và nhịp độ trong bản xem trước trước khi tiếp tục sang các đầu ra dài hơn.
Tông Tập Lệnh Phù Hợp Với Tông Mẫu
Một bản sao được xây dựng từ mẫu yên tĩnh, đo lường sẽ thực hiện tốt nhất trên các tập lệnh yên tĩnh, đo lường. Nếu âm thanh nguồn của bạn là hội thoại, hãy chỉ định cho nó bản sao hội thoại. Năng lượng không phù hợp giữa mẫu và tập lệnh có thể tạo ra nhấn mạnh hoặc nhịp độ không tự nhiên.
Khi nào nên chọn ứng dụng này
ElevenLabs Voice Clone là lựa chọn đúng khi bạn cần một giọng cụ thể, có thể nhận ra chứ không phải một giọng tổng hợp chung chung. Vì nó hoạt động từ mẫu của một người nói thực, đầu ra mang lại một đặc điểm giọng nói xác thực mà không có thư viện giọng nói được đặt sẵn nào có thể sao chép. Nếu dự án của bạn đòi hỏi tính nhất quán của thương hiệu, tính xác thực của nhân vật hoặc bảo tồn giọng nói cá nhân gắn liền với một cá nhân thực, ứng dụng này là công cụ thích hợp.
Các câu hỏi thường gặp
Tôi nên tải lên loại tệp âm thanh nào làm mẫu giọng nói của mình?
Mẫu phải là bản ghi âm rõ ràng, liên tục của người nói đích với tiếng ồn nền tối thiểu. Bài phát biểu hữu ích hơn so với hát hoặc thì thầm. Các định dạng âm thanh phổ biến được chấp nhận và bản ghi âm phải dài ít nhất mười giây để đáp ứng yêu cầu tối thiểu của mô hình.
Tôi có thể sao chép giọng nói từ bản ghi âm bao gồm nhiều loa không?
Bạn nên sử dụng mẫu của một người nói duy nhất. Âm thanh chứa các giọng nói chồng chéo hoặc phỏng vấn khiến mô hình khó cách ly một danh tính giọng nói, giảm độ chính xác và độ trung thực của bản sao trong đầu ra.
Bản sao sẽ nghe gần như thế nào so với giọng gốc?
ElevenLabs Voice Clone được xếp hạng độ trung thực cao, có nghĩa là nó tái tạo những phẩm chất tông cốt lõi, nhịp độ và cộng hưởng của người nói nguồn. Sự gần gũi của kết quả phụ thuộc rất nhiều vào sự rõ ràng và độ dài của mẫu bạn cung cấp.
Tôi có thể tái sử dụng giọng được sao chép trên nhiều bản tạo ra không?
Vâng. Khi một giọng được sao chép, bạn có thể sử dụng nó để tạo nhiều tập lệnh hoặc đầu ra âm thanh. Mỗi bản tạo ra tốn tín dụng riêng biệt, nhưng bạn không cần phải tải lên mẫu lại cho mỗi phần nội dung mới.
Bản sao có nắm bắt phạm vi cảm xúc hay chỉ tône trung lập không?
Mô hình nắm bắt các đặc điểm giọng nói có trong mẫu. Nếu âm thanh nguồn bao gồm cách gửi biểu cảm, một phần của phạm vi đó sẽ được chuyển sang. Tuy nhiên, mẫu đơn điệu sẽ tạo ra phạm vi cảm xúc hẹp hơn trong bản sao, do đó sự biểu cảm nguồn có vấn đề.
Có độ dài tối đa cho các tập lệnh tôi chạy qua giọng được sao chép không?
Quá trình sao chép chính nó hoạt động từ mẫu ngắn của bạn, nhưng độ dài tập lệnh để tạo ra có thể phải tuân theo các giới hạn text-to-speech tiêu chuẩn của nền tảng. Đối với các tập lệnh rất dài, chia nội dung thành các phần hợp lý và tạo chúng theo trình tự thường tạo ra kết quả nhất quán nhất.
Chi phí là bao nhiêu?
Mỗi lần tạo tốn 23 credit. Tài khoản mới được nhận credit miễn phí để thử.
Mô hình AI nào hỗ trợ ứng dụng này?
Ứng dụng này chạy trên ElevenLabs Voice Clone, có sẵn thông qua Arteza mà không cần tài khoản riêng hoặc thiết lập.
Tôi có thể sử dụng kết quả này cho mục đích thương mại không?
Có. Nội dung bạn tạo là của bạn để sử dụng, tuân theo giấy phép nội dung của chúng tôi.
Quá trình tạo mất bao lâu?
Hầu hết các quá trình tạo hoàn thành trong vòng một phút, và bạn có thể xem tiến độ trực tiếp trong thư viện.