ByteDance Ra mắt Seed Audio 1.0, Tạo hội thoại và hiệu ứng âm thanh từ một lời nhắc duy nhất

Theo Beating, Seed Audio 1.0 của ByteDance được ra mắt vào ngày 22 tháng 7, cho phép tạo ra hội thoại, hiệu ứng âm thanh và âm thanh xung quanh chỉ với một lời nhắc, với độ chính xác canh thời gian 100ms. Mô hình hỗ trợ đầu vào dạng văn bản và âm thanh tham chiếu, có thể tạo khoảng 2 phút âm thanh mỗi lần tạo với khả năng mở rộng, đồng thời duy trì giọng nhân vật nhất quán giữa các đầu ra.

Âm thanh cho thấy mức độ khả dụng trên 90% trong hầu hết các tình huống, với Mean Opinion Score (MOS) vượt 4 ở đa số ngôn ngữ được hỗ trợ. Seed Audio 1.0 hỗ trợ hơn 20 ngôn ngữ với chuyển giọng xuyên ngôn ngữ và tùy chỉnh tông giọng. Mô hình hiện đã sẵn có thông qua trung tâm trải nghiệm Volcano Ark, với tích hợp API đang mở.

Tuyên bố miễn trừ trách nhiệm: Thông tin trên trang này có thể đến từ các nguồn bên thứ ba và chỉ mang tính chất tham khảo. Thông tin này không phản ánh quan điểm hoặc ý kiến của Gate và không cấu thành bất kỳ lời khuyên tài chính, đầu tư hoặc pháp lý nào. Giao dịch tài sản ảo tiềm ẩn rủi ro cao. Vui lòng không chỉ dựa vào thông tin trên trang này khi đưa ra quyết định. Để biết thêm chi tiết, vui lòng xem Tuyên bố miễn trừ trách nhiệm.
Bình luận
0/400
Không có bình luận