بحسب الإعلان الرسمي، رفعت شركة Fish Audio المدعومة بالذكاء الاصطناعي 52 مليون دولار في جولة تمويل أولي (seed) وأطلقت نموذجها الصوتي من الجيل التالي S2.1 Pro في 29 يوليو. يمكن للنموذج نسخ الأصوات اعتمادًا على عينات صوتية لا تتجاوز خمس ثوانٍ، مع سرعة توليد أسرع بنحو 2x من Cartesia، وتكلفة إنتاج أقل بنحو سدس تكلفة ElevenLabs.
يدعم S2.1 Pro التحكم في المشاعر والنبرة والسرعة على مستوى الكلمة، ويُوصف بأنه أحد أكثر نماذج الأصوات تعبيرًا المتاحة. وقد اعتمدت شركات من بينها HeyGen وLiveKit وRetell وSanas وOpenArt نماذج Fish Audio بالفعل في بيئات الإنتاج. واحتفالًا بالذكرى السنوية الأولى، تُتيح Fish Audio وصولًا مجانيًا لمدة شهر إلى S2.1 Pro.