标签
本文探讨了汉语方言中语调与词汇声调的相互作用,利用边界现象考察疑问句与陈述句等句子层面功能的基频线索,并讨论了理论模型。
本文提出PiDA,一种基于语音信息的越南语语音翻译数据增强方法,通过使用语音词嵌入生成类似ASR的破坏来提高鲁棒性,在噪声输出上获得高达+2.04 BLEU的提升。
本文研究了预训练的自监督语音模型(如Wav2Vec2和HuBERT)是否能够准确识别咔嗒辅音(click consonants),这些辅音在训练数据中较为罕见,通过在科伊桑语言(Khoisan languages)上进行微调来测试。结果表明,这些模型识别咔嗒辅音的准确率高于非咔嗒辅音,表明它们能够泛化到不常见的音素。
本文比较了现有的荷兰语音节划分算法,并介绍了一种结合语音和正字法信息的深度学习模型,在单词准确率上取得了小幅提升。
本研究使用来自36名发音人的超声舌成像数据,表明个体在发硬腭元音/i/时的发音策略系统地影响双元音中的声学共振峰动态,将舌运动模式与共振峰过渡的时间和陡度联系起来。