标签
本文介绍了VectraYX-Vision-1B,一个面向西班牙语/拉美网络安全影像的亚20亿参数视觉语言模型,但报告了一项负面的视觉定位结果,引发了关于NoPE层的架构问题,并发布了代码、基准测试和检查点。
介绍了VectraYX-Vision-1B,这是一个面向西班牙语/拉丁美洲网络安全的亚20亿参数视觉语言模型,通过MLP将冻结的SigLIP编码器与西班牙语解码器耦合;然而,尽管流水线功能完全正常,它却报告了近乎为零的视觉基础能力,并提供了开源权重和修复计划。
This paper probes character-level transformers to investigate whether they encode the Spanish L-shaped morphome, an irregular morphological pattern, as an abstract class or just surface alternations. The authors find that the encoding is item-specific and localized, but does not generalize like human learners.
介绍MIRA-Ev,这是一个基于西班牙MIR执业资格考试案例构建的临床论据挖掘基准,由专家标注了跨度级别的论据、主张以及支持/反对关系,并提供西班牙语、英语和巴斯克语版本。该基准通过三级任务层次结构评估证据句子检索、论据成分提取和关系分类,弥补了临床自然语言处理中多选题问答基准的局限性。
介绍了ESCUCHA,这是首个用于评估大型音频语言模型在异质声学条件和推理能力方面的西班牙语语音理解基准,包含来自多种真实世界来源的1000个精选问题。
介绍了一种经济高效的人机协作标注框架,用于构建涵盖多个西班牙语国家的西班牙语刻板印象数据集EspanStereo,从而在大型语言模型中实现更具文化基础的偏见评估。
S-DiverSe 是一个3.2小时的西班牙语音语料库,来自22位患有神经系统疾病(肌萎缩侧索硬化症、帕金森病、中风)的说话者,旨在支持病理语音的ASR评估。基线实验表明,在该领域,启发式后处理优于微调。
本文描述了 HULAT2-UC3M 在 MER-TRANS 2026 共享任务(西班牙语易读文本生成)中的参与情况,采用基于 LangGraph 和 Gemini/RigoChat 模型的受控多智能体工作流,取得了最佳 SARI 得分 44.05。
介绍了VectraYX-Nano,一个从零开始训练的42M参数仅解码器西班牙语网络安全语言模型,具备课程学习、通过MCP的原生工具调用以及一个1.7亿词元的语料库。实证发现揭示了损失-寄存器反转以及工具使用能力的语料密度伪影。