跳到正文
原文
AssemblyAI Blog·· 2 天前

AssemblyAI 解析 WER 基准为何可能误判转录模型表现

Why your word error rate (WER) benchmark might be lying to you

摘要

AssemblyAI 发现部分客户用传统 WER 基准测试其新模型 Universal-3 Pro 时,结果反而差于旧模型,原因是插入错误偏多。回听音频后确认,这些插入大多是人工标注漏掉的真实语音,在噪声、口音、重叠说话等困难音频上模型常优于人工标注。

应来源方要求,这里只提供摘要与原文入口。完整内容请阅读原文。

来源:AssemblyAI Blog · assemblyai.com