Nhận quyền truy cập không giới hạn 1 ngày vào Seedance 2.5 + thêm nữagiảm đến 25%

Giảm giá hết hạn trong --

Được tạo bằng ứng dụng này

0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00
0:00 / 0:00

Seed Audio 1.0 là một ứng dụng tạo âm thanh dựa trên lời nhắc, chuyển đổi các mô tả bằng chữ viết thành lời nói biểu cảm, đối thoại đa nhân vật và cảnh âm thanh có nhiều lớp, tất cả trong một lần chạy. Xây dựng trên công nghệ Seed Audio 1.0 của ByteDance, nó hỗ trợ tiếng Anh và tiếng Trung Quốc, chấp nhận hình ảnh hoặc tối đa ba clip âm thanh tham chiếu để điều hướng nhân vật giọng nói, và cho phép bạn tái sử dụng các giọng nói bạn đã sao chép. Nó phù hợp với các nhà sản xuất podcast, nhà biên kịch trò chơi, họa sĩ, người tạo ngôn ngữ và bất kỳ ai cần âm thanh sẵn sàng cho sản xuất mà không cần một phòng quay âm.

Cách sử dụng ứng dụng này

  1. 1

    Mô tả những gì bạn muốn tạo hoặc tải lên tệp nguồn của bạn.

  2. 2

    Chọn các tùy chọn của bạn, sau đó nhấn Tạo.

  3. 3

    Xem kết quả của bạn xuất hiện trong thư viện trong vài khoảnh khắc.

  4. 4

    Tải xuống, chia sẻ hoặc tạo lại với một ý tưởng mới.

Những gì bạn có thể tạo

Sản xuất đối thoại đa nhân vật

Viết một cảnh với hai hoặc nhiều diễn viên và để Seed Audio 1.0 tạo ra từng giọng nói với tính cách và cảm xúc riêng biệt. Ghép từng vai trò với một clip tham chiếu để khóa tông giọng nhất quán trong các tập, làm cho nó thực tế cho các podcast nối tiếp, sách nói hoặc tiểu thuyết tương tác.

Lời tựa đề hai ngôn ngữ và lồng tiếng

Tạo lời tựa đề chuyển đổi một cách tự nhiên giữa tiếng Anh và tiếng Trung Quốc trong một lời nhắc duy nhất. Điều này hữu ích cho các mô-đun học tập hai ngôn ngữ, bản trình diễn sản phẩm nhắm vào khán giả xuyên biên giới, hoặc nội dung kiểu tài liệu phục vụ những người nói cả hai ngôn ngữ mà không cần phiên quay lại.

Thiết kế cảnh âm thanh môi trường

Mô tả một môi trường âm thanh, chẳng hạn như một chợ mưa vào lúc chạng vạng hoặc một phòng máy chủ căng thẳng đang phát ra tiếng rầm rầm của phần cứng hỏng, và nhận được một cảnh có nhiều lớp dài tới hai phút. Các nhà phát triển trò chơi và nhà thiết kế âm thanh phim có thể sử dụng chúng như những tệp giường tham chiếu hoặc theo dõi giữ chỗ sớm trong sản xuất.

Đúc giọng nói được điều hướng bởi hình ảnh

Cung cấp một bản minh họa nhân vật hoặc chân dung và để mô hình suy ra chất lượng giọng nói từ hình ảnh. Phím tắt này giúp các họa sĩ khái niệm và người xây dựng thế giới nhanh chóng kết hợp giọng nói với một nhân vật chưa được đúc trước khi đưa ra bất kỳ quyết định ghi âm nào.

Tái sử dụng tài sản giọng nói được sao chép

Nếu bạn đã sao chép một giọng nói ở nơi khác trong Arteza, hãy tham chiếu nó trực tiếp ở đây để giữ cho các nhà tường thuật thương hiệu, nhân vật chính hư cấu hoặc chữ ký giọng nói cá nhân nhất quán trên nhiều dự án mà không cần tải lên âm thanh nguồn mỗi lần.

Ý tưởng prompt để thử

Tại sao các nhà sáng tạo sử dụng ứng dụng này

  • Cảnh theo lời nhắc
  • Điều hướng hình ảnh hoặc âm thanh
  • Tiếng Anh và Tiếng Trung
  • Tái sử dụng giọng nói sao chép
  • Kiểm soát tốc độ, âm lượng và cao độ
  • Lên đến 2 phút

Mẹo để có kết quả tốt hơn

Vá giọng nói bằng clip tham chiếu

Tải lên tối đa ba clip âm thanh tham chiếu ngắn cho một nhân vật để hướng mô hình về phía một kết cấu giọng nói, accent hoặc tuổi tác cụ thể. Clip của bạn càng nhất quán về chất lượng ghi âm và tông giọng, thì Seed Audio 1.0 càng đáng tin cậy để khớp giọng nói mục tiêu trên nhiều lần chạy.

Sử dụng điều hướng hình ảnh cho các nhân vật chưa được đúc

Khi bạn có tác phẩm nghệ thuật nhân vật nhưng không có giọng nói tham chiếu, hãy đính kèm hình ảnh làm đầu vào điều hướng. Mô hình đọc các manh mối trực quan như tuổi tác biểu kiến, tư thế và biểu hiện để thông báo chất lượng giọng nói, giúp bạn bỏ qua bước tìm kiếm hoặc ghi lại một clip tham chiếu từ đầu.

Hãy rõ ràng về môi trường âm thanh

Đối với các cảnh âm thanh, hãy mô tả cả lớp tiền cảnh và nền trong lời nhắc của bạn. Đặt tên không gian, khoảng cách của các nguồn âm thanh và bất kỳ kết cấu môi trường nào mà bạn muốn, chẳng hạn như dung dịch trong một nhà thờ hoặc sự phẳng của một phòng vô âm, sẽ giúp mô hình rõ ràng hơn trong giới hạn hai phút.

Lên kế hoạch chiều dài trong giới hạn hai phút

Seed Audio 1.0 hỗ trợ tối đa hai phút âm thanh cho mỗi lần chạy. Đối với đối thoại, hãy soạn thảo số từ kịch bản của bạn trước khi nhắc; tiếng Anh nói trung bình khoảng 130 từ mỗi phút, vì vậy một trao đổi 200 từ phù hợp thoải mái trong khi vẫn để lại chỗ cho tạm dừng và chi tiết môi trường.

Khi nào nên chọn ứng dụng này

Chọn ứng dụng này khi dự án của bạn kết hợp giọng nói và môi trường trong một lần chạy, yêu cầu đối thoại đa nhân vật với danh tính giọng nói có thể điều khiển, hoặc cần đầu ra tiếng Anh và tiếng Trung Quốc hai ngôn ngữ. Vì không có ứng dụng anh em được liệt kê cho danh mục này trên Arteza vào lúc này, trường hợp rõ ràng nhất cho Seed Audio 1.0 là sự kết hợp của việc xây dựng cảnh do lời nhắc điều khiển, điều hướng hình ảnh hoặc âm thanh, và tái sử dụng giọng nói được sao chép, một bộ công cụ được thiết kế đặc biệt cho những người tạo âm thanh làm việc trên bài phát biểu, nhân vật và môi trường trong một quy trình làm việc duy nhất.

Các câu hỏi thường gặp

Tôi có thể sử dụng cả tiếng Anh và tiếng Trung Quốc trong cùng một lần tạo âm thanh không?

Có. Seed Audio 1.0 hỗ trợ tiếng Anh và tiếng Trung Quốc, và bạn có thể viết một lời nhắc hai ngôn ngữ để tạo ra đầu ra di chuyển giữa cả hai ngôn ngữ một cách tự nhiên. Điều này đặc biệt hữu ích cho các cảnh lời tựa đề hoặc đối thoại được thiết kế để phục vụ những người nói cả hai ngôn ngữ trong một tệp âm thanh duy nhất.

Tôi có thể tải lên bao nhiêu clip âm thanh tham chiếu để điều hướng giọng nói?

Bạn có thể cung cấp tối đa ba clip âm thanh tham chiếu cho mỗi giọng nói. Sử dụng nhiều clip chia sẻ chất lượng ghi âm nhất quán và tông giọng giọng nói cung cấp một tín hiệu mạnh hơn, nói chung sẽ tạo ra kết quả chính xác và có thể lặp lại hơn so với dựa vào một mẫu ngắn duy nhất.

Chiều dài âm thanh tối đa mà tôi có thể tạo trong một lần chạy là bao nhiêu?

Mỗi lần chạy có thể tạo ra tối đa hai phút âm thanh. Nếu kịch bản hoặc khái niệm cảnh của bạn chạy dài hơn, hãy lên kế hoạch để chia nó thành các đoạn phù hợp trong giới hạn đó và may chúng lại với nhau trong quy trình chỉnh sửa của bạn bằng cách sử dụng các giọng nói được sao chép hoặc tham chiếu để duy trì tính nhất quán trên các đoạn.

Tôi có thể điều hướng giọng nói bằng một bản minh họa nhân vật thay vì một bản ghi âm không?

Có. Tính năng điều hướng hình ảnh chấp nhận một chân dung hoặc bản minh họa nhân vật và sử dụng thông tin trực quan để thông báo về nhân vật giọng nói. Điều này hữu ích sớm trong quá trình sản xuất khi tác phẩm nghệ thuật nhân vật tồn tại nhưng không có diễn viên thoại hoặc bản ghi âm tham chiếu nào được chọn hoặc ghi lại.

Làm cách nào tôi có thể giữ giọng nói giống nhau trên nhiều dự án?

Sau khi bạn sao chép một giọng nói trong Arteza, Seed Audio 1.0 cho phép bạn tham chiếu giọng nói được sao chép đó trực tiếp trong các lần tạo mới. Điều này có nghĩa là một nhà tường thuật thương hiệu, một nhân vật định kỳ hoặc chữ ký giọng nói của riêng bạn có thể được tái sử dụng mà không cần tải lên tài liệu tham chiếu mới mỗi lần bạn bắt đầu một dự án mới.

Ứng dụng này có phù hợp để tạo âm thanh không nói như môi trường xung quanh không?

Có. Seed Audio 1.0 được thiết kế cho việc tạo cảnh âm thanh, không chỉ lời nói. Bạn có thể nhắc nó bằng một mô tả hoàn toàn môi trường, chỉ định các vị trí, kết cấu và các nguồn âm thanh có lớp, để tạo ra các giường môi trường, nền khí quyển hoặc bản phác thảo âm thanh không gian mà không có bất kỳ đối thoại hoặc lời tường thuật nào.

Chi phí là bao nhiêu?

Mỗi lần tạo tốn 1 credit. Tài khoản mới được nhận credit miễn phí để thử.

Mô hình AI nào hỗ trợ ứng dụng này?

Ứng dụng này chạy trên Seed Audio 1.0, có sẵn thông qua Arteza mà không cần tài khoản riêng hoặc thiết lập.

Tôi có thể sử dụng kết quả này cho mục đích thương mại không?

Có. Nội dung bạn tạo là của bạn để sử dụng, tuân theo giấy phép nội dung của chúng tôi.

Quá trình tạo mất bao lâu?

Hầu hết các quá trình tạo hoàn thành trong vòng một phút, và bạn có thể xem tiến độ trực tiếp trong thư viện.

Khám phá thêm ứng dụng