OpenAI випустила дві мовні моделі для перетворення мовлення на текст із рівнем помилок 3,31% та зниженням ціни на 25%

За даними Beating, сьогодні OpenAI випустила GPT Transcribe та GPT Live Transcribe — дві моделі розпізнавання мовлення з перетворенням на текст для пакетної розшифровки та сценаріїв у реальному часі, зокрема для прямих субтитрів і телефонних дзвінків відповідно. За даними Artificial Analysis, GPT Transcribe досягла частоти помилок на рівні слів (word error rate) 3,31%, що на 0,7 відсоткового пункту менше, ніж у попередній версії GPT-4o Transcribe. Ціни знизили на 25% до $4,5 за 1 000 хвилин аудіо.
Застереження: інформація на цій сторінці може походити зі сторонніх джерел і надається виключно для ознайомлення. Вона не відображає позицію чи думку Gate і не є фінансовою, інвестиційною чи юридичною консультацією. Торгівля віртуальними активами пов’язана з високим ризиком. Будь ласка, не покладайтеся лише на інформацію з цієї сторінки під час прийняття рішень. Детальніше дивіться у Застереженні.
Прокоментувати
0/400
Немає коментарів