The DecoderJonathan Kemper
Meta 发布实时语音转写模型 Muse Voice Transcribe
原标题:Meta's new real-time audio model is the foundation for AI assistants that never stop listening
模型82
Meta 的超级智能实验室(Superintelligence Labs)发布了 Muse Voice Transcribe,这是一款实时转录模型,能以 80 毫秒的分块处理语音、区分不同说话人并检测句子边界。根据 Artificial Analysis 的评测,它以市场上最低的价格提供了最精准的流式转录。Meta 将该模型视为个人 AI 智能体的核心基石,这些智能体可通过其智能拍摄眼镜等设备旁听现实生活中的真实对话。文章《Meta 的全新实时音频模型是永不停歇倾听的 AI 助手的基石》首发于 The Decoder。
为什么值得读
80 毫秒延迟与极低成本补齐了可穿戴设备常驻监听的关键拼图,展现了 Meta 推进全时陪伴型 AI 的底层技术路径。
标签
Meta语音转写实时音频Muse Voice智能眼镜端侧AI