arXiv cs.SD RSS·· 3 小时前
AudioJev:以顺序校准概率实现直接音频决策
AudioJev: Direct Audio Decisions with Order-Calibrated Probabilities
摘要
AudioJev 将波形、问题与候选选项直接映射为候选分布,用单一共享全参数模型完成推理,无需校准头或顺序集成。其随机错位 SKL 训练为每个问题配对重排视图并监督两个答案,在三个训练种子上于完整 MMAU/MMAR 达到 68.88%/55.33% 平均准确率,随机顺序 SKL 较单视图消融分别降低 43.8%/60.5%。
应来源方要求,这里只提供摘要与原文入口。完整内容请阅读原文。
来源:arXiv cs.SD RSS · arxiv.org