arXiv eess.AS RSS·· 3 小时前
语码转换口语语言识别被建模为多标签集合预测
Code-Switching Spoken Language Identification as Multi-Label Set Prediction
摘要
研究将话语级语码转换语言识别(CS-LID)建模为多标签语言集合预测,提出直接输出话语所含语言的集合生成器,并与原子对和基于分数的分类基线对比。Oracle Top-k 是最强基线,但阈值法因无法用单一阈值区分语码转换与单语语音而失效。
应来源方要求,这里只提供摘要与原文入口。完整内容请阅读原文。
来源:arXiv eess.AS RSS · arxiv.org