发布于 2026-10-01 12:00
FFASR:基于高保真模拟 RIR 的远场自动语音识别基准
FFASR 是一个包含 15,637 条话语的留出语料库与公开排行榜,覆盖九种条件,分别改变单一声学因素:近场消声语音、实测与模拟办公室-实验室配对、高/中/低信噪比静态远场混合,以及匹配信噪比下的移动说话人变体。
FFASR 是一个包含 15,637 条话语的留出语料库与公开排行榜,覆盖九种条件,分别改变单一声学因素:近场消声语音、实测与模拟办公室-实验室配对、高/中/低信噪比静态远场混合,以及匹配信噪比下的移动说话人变体。
研究人员开发了一种模拟听觉脑干回路、由数千个神经元活动合成 ABR 波的计算机模型,并用脆性 X 综合征小鼠和衰老沙鼠的 recordings 验证。在脆性 X 模型中,模拟的神经兴奋性增高和髓鞘缺陷产生的 ABR 波幅与时间变化与实验记录高度吻合;衰老模型也复现了老年沙鼠的听觉脑干改变。