D’après l’annonce officielle, la société d’IA vocale Fish Audio a levé 52 millions de dollars en financement de démarrage (seed) et a lancé son modèle vocal de prochaine génération S2.1 Pro le 29 juillet. Le modèle peut cloner des voix à partir d’échantillons audio de seulement cinq secondes, avec une vitesse de génération environ deux fois plus rapide que Cartesia et des coûts de production d’environ un sixième d’ElevenLabs.
S2.1 Pro prend en charge le contrôle des émotions, du ton et de la vitesse au niveau des mots, et est décrit comme l’un des modèles vocaux les plus expressifs disponibles. Des entreprises, dont HeyGen, LiveKit, Retell, Sanas et OpenArt, ont déjà adopté des modèles de Fish Audio dans des environnements de production. Pour célébrer son premier anniversaire, Fish Audio propose un accès gratuit pendant un mois à S2.1 Pro.