Le lancement par Alibaba de Qwen-Audio-3.0-TTS avec une version Flash de 300 ms pour des interactions en temps réel

BABA-1,84%
Alibaba a publié Qwen-Audio-3.0-TTS, un modèle de synthèse vocale qui prend en charge des instructions en langage naturel en mode libre. Le modèle comprend une version Flash pour des interactions en temps réel avec une latence de 300 ms pour le premier paquet, ainsi qu’une version Plus pour une génération de haute qualité.
Avertissement : Les informations figurant sur cette page peuvent provenir de sources tierces et sont fournies à titre indicatif uniquement. Elles ne reflètent pas les points de vue ou opinions de Gate et ne constituent pas un conseil financier, d’investissement ou juridique. Le trading des actifs virtuels comporte des risques élevés. Veuillez ne pas vous fonder uniquement sur les informations de cette page pour prendre vos décisions. Pour en savoir plus, consultez l’avertissement.
Commentaire
0/400
Aucun commentaire