【CNMO科技动静】7月29日,OpenAI Developers官方公布于API中推出两款语音转录模子。此中,GPT-Live-Transcribe面向低延迟及时转录场景,GPT-Transcribe则针对于已经完成音频文件的异步转录和批量处置惩罚使命举行优化。
OpenAI
OpenAI暗示,两款模子进一步晋升了上下文理解能力,于差别语言、口音和繁杂真实情况中可以或许提供更正确的转录成果,特别改善了短语、数字、专业术语以和强配景噪声下的辨认体现。开发者还有可以向模子提供灌音内容简介、姓名和范畴术语要害词、预期语言及前序转录内容,以提高辨认正确率。

测试数据显示,于OpenAI新成立的上下文感知主动语音辨认评测中,GPT-Live-Transcribe的语义正确率于未提供自由情势上下文时为38.5%,插手上下文后提高至44.6%。于笼罩22种语言的Co妹妹on Voice测试中,其转录过错率为19.70%,略低在GPT-Realtime-Whisper-1的20.33%;于九种语言的真实灌音测试中,二者别离为9.60%及11.65%。
GPT-Transcribe一样可以使用上下文提高体现,其语义正确率由41.6%升至45.2%。于Co妹妹on Voice测试中,该模子的转录过错率为19.27%,比拟Whisper-1的40.37%较着降低;真实灌音测试中的过错率为8.98%,Whisper-1则为15.21%。
版权所有,未经许可不患上转载
-米兰体育