spoken-language-model

标签

Cards List
#spoken-language-model

层次化声学-语义建模:全双工SLM的模态分离与语义一致性

arXiv cs.CL · 2026-07-08 缓存

本文介绍了Lychee-FD,一种原生端到端全双工口语语言模型,通过层次化参数分离策略缓解模态干扰,在语音智能和交互流畅性方面取得了显著提升。

0 人收藏 0 人点赞
#spoken-language-model

FlexiSLM:动态可控制帧率的语音语言模型

Hugging Face Daily Papers · 2026-06-30 缓存

FlexiSLM 为语音语言模型引入动态帧率能力,适用于语音输入与输出,性能优于固定帧率模型,并实现可控推理速度。

0 人收藏 0 人点赞
#spoken-language-model

VITA-QinYu:用于角色扮演和唱歌的表现力口语语言模型

arXiv cs.CL · 2026-05-11 缓存

VITA-QinYu 是一个具有表现力的端到端口语语言模型,支持角色扮演和唱歌功能。该模型在 15.8 万小时的数据集上进行训练,在表现力和对话准确性方面均优于同类模型。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈