Theo Beating, Seed Audio 1.0 của ByteDance được ra mắt vào ngày 22 tháng 7, cho phép tạo ra hội thoại, hiệu ứng âm thanh và âm thanh xung quanh chỉ với một lời nhắc, với độ chính xác canh thời gian 100ms. Mô hình hỗ trợ đầu vào dạng văn bản và âm thanh tham chiếu, có thể tạo khoảng 2 phút âm thanh mỗi lần tạo với khả năng mở rộng, đồng thời duy trì giọng nhân vật nhất quán giữa các đầu ra.
Âm thanh cho thấy mức độ khả dụng trên 90% trong hầu hết các tình huống, với Mean Opinion Score (MOS) vượt 4 ở đa số ngôn ngữ được hỗ trợ. Seed Audio 1.0 hỗ trợ hơn 20 ngôn ngữ với chuyển giọng xuyên ngôn ngữ và tùy chỉnh tông giọng. Mô hình hiện đã sẵn có thông qua trung tâm trải nghiệm Volcano Ark, với tích hợp API đang mở.