Models · Products and Tools · Applications
Meta发布Muse Voice Transcribe:实时音频模型,定价每小时0.18美元,支持70多种语言
Meta发布实时音频模型Muse Voice Transcribe,支持70多种语言,可区分超过20个说话者,英语词错误率3.1%,定价每小时0.18美元。
阅读 THE DECODER 原文为什么重要
该模型以低成本提供高精度实时转录,可能加速语音助手和会议记录等应用的普及。
关键事实
事实 1
Muse Voice Transcribe可实时区分超过20个说话者。
来源与依据
The model can tell more than 20 speakers apart at once
事实 2
Muse Voice Transcribe的定价为每小时0.18美元。
来源与依据
At $0.18 per hour, Meta undercuts competitors
事实 3
Muse Voice Transcribe在英语上的词错误率为3.1%。
来源与依据
Muse Voice Transcribe hits a 3.1 percent word error rate on English