Theo thông báo chính thức, công ty AI voice Fish Audio đã huy động 52 triệu USD vốn seed và ra mắt mô hình giọng nói thế hệ tiếp theo S2.1 Pro vào ngày 29 tháng 7. Mô hình có thể sao chép giọng nói từ các mẫu âm thanh chỉ 5 giây, với tốc độ tạo nhanh hơn khoảng 2 lần so với Cartesia và chi phí sản xuất thấp hơn khoảng 1/6 so với ElevenLabs.
S2.1 Pro hỗ trợ kiểm soát cảm xúc, ngữ điệu và tốc độ ở cấp độ từ, đồng thời được mô tả là một trong những mô hình giọng nói giàu biểu cảm nhất hiện có. Các công ty như HeyGen, LiveKit, Retell, Sanas và OpenArt đã triển khai các mô hình của Fish Audio trong môi trường sản xuất. Nhân dịp kỷ niệm 1 năm, Fish Audio đang cung cấp quyền truy cập miễn phí trong 1 tháng vào S2.1 Pro.