公式発表によると、AI音声企業のFish Audioはシード資金調達で5,200万ドルを調達し、次世代の音声モデル「S2.1 Pro」を7月29日にローンチしました。このモデルはわずか5秒の音声サンプルから音声をクローンでき、生成速度はCartesiaより約2倍速く、生産コストはElevenLabsの約6分の1です。
S2.1 Proは単語レベルでの感情、トーン、速度の制御をサポートしており、利用可能な音声モデルの中でも最も表現力が高いものの1つだと説明されています。HeyGen、LiveKit、Retell、Sanas、OpenArtなどの企業はすでに、生産環境でFish Audioのモデルを採用しています。1周年を記念してFish Audioは、S2.1 Proを無料で1か月間利用できるアクセス提供を行っています。