clinical-speech

标签

Cards List
#clinical-speech

双人交互中抑郁检测的说话人感知时序聚合策略:一项基准研究

Hugging Face Daily Papers · 2026-07-03 缓存

本文介绍了DEPOOL,一个受控基准,评估了六种时序聚合架构在六种冻结语音主干网络上的表现,用于双人交互中的抑郁检测,发现许多配置会坍缩为单类别预测,并且鲁棒性应作为一个关键标准。

0 人收藏 0 人点赞
#clinical-speech

我对Parakeet 0.6B进行了医学ASR微调——开放权重,本地运行于Mac/CUDA/CPU

Reddit r/LocalLLaMA · 2026-06-09

Omi Health创始人微调了NVIDIA的Parakeet TDT 0.6B用于医学ASR,发布了开放权重的模型Omi Med STT v1,在本地Mac、CUDA或CPU上运行时实现了有竞争力的医学WER。

0 人收藏 0 人点赞
#clinical-speech

大型语言模型能否模仿人类语音进行临床评估?基于LLM的数据增强方法用于认知评分预测

arXiv cs.CL · 2026-05-18 缓存

本文提出了一种基于大型语言模型的数据增强框架,利用GPT-5从书面锚点生成合成口语独白,用于从语音中预测认知评分。一种相似性引导的选择策略持续降低了预测误差,特别是对于少数低分参与者。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈