标签:语音识别
共 2 篇相关访谈。
P
语音识别远未解决:Mistral音频研究负责人谈技术前沿
Mistral音频研究负责人Pavan Muddireddy分享了公司全栈AI战略下的音频模型开发。他探讨了从音频理解到语音生成的端到端方法,解释了流式与批处理模型的权衡,介绍了基于连续潜变量和流匹配的TTS架构创新,并深入分析了说话人分离、抗噪性及消除模型幻觉等关键挑战。
PPavan Muddireddy音频研究负责人

Rev.ai副总裁:打造世界最佳语音识别引擎
Lex Fridman采访Rev.ai工程副总裁Dan Kokotov,探讨了Rev如何通过简化自由职业市场创立转录服务,其ASR引擎如何挑战Google等巨头,以及语音转文本技术对播客、会议记录和信息检索的深远影响。
DDan KokotovRev.ai工程副总裁