标签
这条推文分享了一份精选的英语学习资源列表,按听力、口语和阅读等技能分类,面向中国在线社区,提供双语支持和导航中心。
介绍Spark-X2.5-1.7B,一个紧凑的文本生成模型,专为中英双语流畅对话设计,已获得早期积极反馈。
Breeze TTS 2 是一个开放权重的实时文本转语音模型,支持语音设计和双语语音,并在 Artificial Analysis TTS 排行榜的开放权重模型中排名第一。
Skills-4-SE 是一个全面的代码库,提供超过180项编码技能,涵盖软件工程任务,包括需求分析、设计、实现、测试和维护,并配有一个基于Web的技能管理器。
BEAR-Bench引入了一个双语(英语和俄语)基准,用于评估多模态模型在文本丰富的专业文档上的推理能力,评估了16个模型并突出了性能差距。
本文研究了双语混合专家 (MoE) 语言模型是否会发展出语言结构化的专家路由。研究发现,在 MoE 路由模式中会出现可解释的语言组织,并且课程训练会影响语言平衡中的专业化。
本文研究了上下文注入微调是否能提升小型语言模型在孟加拉国法律问答中利用检索到法律的能力。使用0.8B、2B和4B规模的Qwen3.5模型,发现微调在较小规模上有帮助,但在4B规模上无显著增益,并减少了语言漂移。
Telco-GAIA是一个用于评估电信领域工具使用智能体的双语多模态基准测试,包含100个经过人工验证的任务,要求对异构来源进行多跳推理,并通过精确字符串匹配进行客观评分。
Argelius Labs发布了针对中国开源情报调查的双语搜索技巧清单,涵盖公司注册、采购、法院、监管等信息的查询方法,旨在帮助研究人员高效地在中国互联网上进行合法调查。
作者分享了将语音代理中的TTS替换为专为双语(阿拉伯语和英语)对话设计的自定义模型(Banter 1)的经验,这显著降低了感知延迟。
Horizon 是一款开源的 AI 新闻雷达工具,能从多个信息源自动抓取一手内容,利用 AI 进行去重、评分、总结并生成中英双语简报,支持多种部署方式。
PolyAlign是一个分布感知的对齐框架,它将语言模型对齐到特定上下文的人类回复分布,而不是单一的全局风格,从而提升了双语环境下的自然性和忠实度。
Linear设计工程师Emil Kowalski整理了90+个动画术语,涵盖12个分类,作者用Claude制作了一个双语预览站以便理解效果。
BloomBench是一个基于认知理论的双语(英语-阿拉伯语)多模态视觉语言模型基准,系统评估基于布鲁姆分类学的六个认知层次。实验揭示了当前模型中显著的认知不对称和跨语言性能差距。