multilingual

标签

Cards List
#multilingual

@rohanpaul_ai: Fish Audio 刚刚将 S2.1 Pro 免费开放一个月。以下是您需要了解的一切 - 从10秒音频克隆任何声音…

X AI KOLs Following · 2026-07-30 缓存

Fish Audio 已将其 S2.1 Pro 语音克隆服务免费开放一个月,支持10-15秒语音克隆、约90毫秒响应时间、83种语言、单词级控制,以及开放权重模型,成本仅为 ElevenLabs 的六分之一。

0 人收藏 0 人点赞
#multilingual

DenseOn与LateOn:面向多语言、长上下文和代码搜索的完全开放密集与延迟交互模型

arXiv cs.CL · 2026-07-30 缓存

本文介绍了完全开放的DenseOn和LateOn检索模型,这些模型在精心整理的英语数据上训练,并通过translate-train扩展到多语言设置,在其参数规模下实现了最先进的BEIR结果。

0 人收藏 0 人点赞
#multilingual

语言模型对不同语言中的非规范分词并非同样鲁棒

arXiv cs.CL · 2026-07-30 缓存

本文研究了语言模型在27种语言中是否对替代(非规范)分词保持鲁棒性,发现英语中观察到的不变性并不具有普适性,且分词碎片化程度更高的语言表现出更高的敏感性。作者证明,使用多分词数据的LoRA微调可以有效缓解这种敏感性。

0 人收藏 0 人点赞
#multilingual

avatarin 如何利用 GPT-Realtime 构建 24/7 零售智能代理

OpenAI Blog · 2026-07-30 缓存

avatarin 使用 OpenAI 的 GPT-Realtime 为山田电机打造了一个 24/7 多语言购物智能代理,通过自然语音对话引导顾客完成购买。在为期两周的试用中,约有 3 万人使用,92% 的调查反馈为正面评价。

0 人收藏 0 人点赞
#multilingual

SpeechLLM与联邦学习结合实现端到端ASR:英语和意大利语案例研究

arXiv cs.CL · 2026-07-29 缓存

本文首次系统研究了基于SpeechLLM的端到端ASR系统的联邦训练,在英语和意大利语任务上进行了评估,在降低通信成本的同时取得了具有竞争力的词错误率。

0 人收藏 0 人点赞
#multilingual

Inspect India Evals:面向印度语言文化语境的大语言模型开放评估框架

arXiv cs.CL · 2026-07-29 缓存

介绍Inspect India Evals,一个用于在印度语言文化语境中评估大语言模型的开源框架,包含六项基准测试,涵盖多语言能力、偏见、安全性和文化知识。对五个模型的测试显示,Sarvam-M 24B和Gemma 2 27B表现领先。

0 人收藏 0 人点赞
#multilingual

LGAI-EXAONE/K-EXAONE-2.0-750B-A37B

Hugging Face Models Trending · 2026-07-29 缓存

LG AI Research introduces K-EXAONE 2.0, a frontier-scale multilingual MoE model with 750B total parameters (37B active), upcycled and trained for advanced reasoning, agentic workflows, and long-context understanding, released under Apache 2.0.

0 人收藏 0 人点赞
#multilingual

@maximelabonne: 我们刚刚发布了两个新的编码器模型(MLM)在2026年。它们非常快,易于训练,并且多语言能力强。试试…

X AI KOLs Following · 2026-07-28 缓存

Liquid AI发布了两个新的编码器模型,LFM2.5-Encoder-230M和LFM2.5-Encoder-350M。这些模型快速、易于训练且多语言能力强。速度基准测试显示,与ModernBERT-base相比,CPU性能提升了3.7倍以上。

0 人收藏 0 人点赞
#multilingual

Audio8/Audio8-TTS-Preview-0.6b

Hugging Face Models Trending · 2026-07-28 缓存

Audio8 发布了一款拥有 6 亿参数的多语言文本转语音模型,支持零样本声音克隆功能,在 Hugging Face 上以 Apache 2.0 许可证提供。

0 人收藏 0 人点赞
#multilingual

microsoft/VibeVoice-ASR-BitNet

Reddit r/LocalLLaMA · 2026-07-28 缓存

Microsoft发布了VibeVoice-ASR-BitNet,这是一个压缩的多语言ASR模型,用于实时CPU推理。与Whisper.cpp相比,它的推理速度提高了1.6-2.3倍,并且仅需3个CPU线程即可实现实时能力。

0 人收藏 0 人点赞
#multilingual

MoLGE:混合语言组专家实现大规模多语言语音识别的高效扩展

arXiv cs.CL · 2026-07-28 缓存

MoLGE在混合专家框架中为相似语言簇分配专用专家模块,用于大规模多语言ASR,在参数增加极小的情况下提升495种语言的性能。

0 人收藏 0 人点赞
#multilingual

语言塑造多语言大语言模型中指令层级遵循度

arXiv cs.CL · 2026-07-28 缓存

本文介绍了XIH-Bench,一个用于评估多语言大语言模型中指令层级遵循度的基准,揭示了语言依赖的不对称性以及语言边界效应,即跨语言冲突比同语言冲突产生更高的遵循度。

0 人收藏 0 人点赞
#multilingual

IndicTalk:面向印度语言的基于角色的大规模多语言对话语料库

arXiv cs.CL · 2026-07-28 缓存

IndicTalk 是一个大规模多语言对话语料库,涵盖9种印度语言,包含代码混合对话,通过自动化流水线生成,结合新闻基础(news grounding)和角色条件(persona conditioning),旨在推动面向代表性不足语言的对话AI发展。

0 人收藏 0 人点赞
#multilingual

ADAGE:一种语言无关的类比推理评估流水线

arXiv cs.CL · 2026-07-28 缓存

ADAGE 是一种语言无关的流水线,用于构建具有挑战性且无需翻译的抽象类比推理基准。它揭示了模型在阿拉伯语、阿姆哈拉语和日语中普遍存在的文化推理差距。

0 人收藏 0 人点赞
#multilingual

LiquidAI/LFM2.5-Encoder-350M

Hugging Face Models Trending · 2026-07-27 缓存

Liquid AI releases LFM2.5-Encoder-350M, a multilingual bidirectional encoder built on the LFM2 architecture, offering strong quality for its size, 8k context, and efficient on-device performance across 15 languages.

0 人收藏 0 人点赞
#multilingual

grapheme-kit: 字素级度量与多语言NLP文本处理

arXiv cs.CL · 2026-07-27 缓存

介绍grapheme-kit,一个开源Python库,该库扩展了词汇距离和评估度量,使其操作于字素簇而非Unicode码点,并改进了对泰米尔语和僧伽罗语的处理。

0 人收藏 0 人点赞
#multilingual

MEUSLI:一个面向基于LLM的ASR及其他任务的多语言投影器

arXiv cs.CL · 2026-07-27 缓存

MEUSLI是一个开源的多语言投影器家族,它将Whisper编码器与多语言LLM连接起来,支持28种欧洲语言的端到端ASR,并扩展到语音翻译和主题识别。

0 人收藏 0 人点赞
#multilingual

swiss-ai/Apertus-v1.5 70B/8B

Reddit r/LocalLLaMA · 2026-07-24

瑞士AI发布Apertus 1.5,一个全开放的8B和70B多语言多模态语言模型系列,支持高达262k上下文长度、音频/图像理解、推理模式,并改进了指令遵循和工具使用。

0 人收藏 0 人点赞
#multilingual

从单词级词典到句子级语义:基于上下文模型的多语言怨言标注

arXiv cs.CL · 2026-07-24 缓存

本文提出了一种使用上下文模型进行多语言怨言标注的方法,改进了单词级词典,解决了循环评估问题,并通过读取上下文实现了更好的性能。

0 人收藏 0 人点赞
#multilingual

LAMAR:一种开放的语言感知多语言对齐重排序器

Hugging Face Daily Papers · 2026-07-24 缓存

LAMAR 是一种语言感知的多语言交叉编码器重排序器,它利用基于英语锚定的相关性蒸馏和偏好对齐,在保持语义相关性的同时,优先考虑与查询同语言的文档,在多语言基准测试中表现优异。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈