Meta 推出 Muse Voice Transcribe,支持多语言及长音频转写
22 小时前
Meta 推出由其超级智能实验室开发的实时音频感知模型 Muse Voice Transcribe,该模型支持实时流式自动语音识别、超 20 位说话人语音分割及端点控制,可处理超 1 小时长音频,支持多语言及无缝语码切换,能通过语言、关键词和上下文偏好提升识别准确率,在相关基准测试中排名第一。它已用 70 多种语言训练,25 种经全面验证,具备自适应延迟功能,可动态平衡速度与准确率,还基于 ASR 构建了说话人分割和语音端点检测功能,可通过 Meta Model API、Mac 版 Meta AI 和 Muse Code 使用,API 有相应定价。语音转写正从独立工具向 AI 系统实时感知层演进,未来竞争核心将聚焦多维度能力并与大模型相关能力融合。
Meta 甩出语音转写「神器」:准确识别中英文夹杂
ITBear 科技资讯
Meta 推出语音转写新模型:多语言无缝切换,超 20 人畅聊 1 小时精准识别
ITBear 科技资讯
Meta 甩出语音转写「神器」:准确识别中英文夹杂,支持超 20 人长聊 1 小时
maomu.com/36Kr/智东西
体验专业版特色功能,拓展更丰富、更全面的相关内容。