spanish

标签

Cards List
#spanish

VectraYX-Vision-1B:一个面向西班牙语/拉美网络安全、具备结构化视觉推理和原生工具调用的亚20亿参数视觉语言模型

arXiv cs.CL · 2026-08-11 缓存

本文介绍了VectraYX-Vision-1B,一个面向西班牙语/拉美网络安全影像的亚20亿参数视觉语言模型,但报告了一项负面的视觉定位结果,引发了关于NoPE层的架构问题,并发布了代码、基准测试和检查点。

0 人收藏 0 人点赞
#spanish

VectraYX-Vision-1B:面向西班牙语/拉丁美洲网络安全的亚20亿参数视觉语言模型,具有结构化视觉推理和原生工具使用能力

Hugging Face Daily Papers · 2026-08-09 缓存

介绍了VectraYX-Vision-1B,这是一个面向西班牙语/拉丁美洲网络安全的亚20亿参数视觉语言模型,通过MLP将冻结的SigLIP编码器与西班牙语解码器耦合;然而,尽管流水线功能完全正常,它却报告了近乎为零的视觉基础能力,并提供了开源权重和修复计划。

0 人收藏 0 人点赞
#spanish

Probing Character-level Transformers for the Spanish L-shaped Morphome

arXiv cs.CL · 2026-08-05 缓存

This paper probes character-level transformers to investigate whether they encode the Spanish L-shaped morphome, an irregular morphological pattern, as an abstract class or just surface alternations. The authors find that the encoding is item-specific and localized, but does not generalize like human learners.

0 人收藏 0 人点赞
#spanish

MIRA-Ev:临床考试中细粒度证据检测与关系推理的基准

arXiv cs.CL · 2026-07-22 缓存

介绍MIRA-Ev,这是一个基于西班牙MIR执业资格考试案例构建的临床论据挖掘基准,由专家标注了跨度级别的论据、主张以及支持/反对关系,并提供西班牙语、英语和巴斯克语版本。该基准通过三级任务层次结构评估证据句子检索、论据成分提取和关系分类,弥补了临床自然语言处理中多选题问答基准的局限性。

0 人收藏 0 人点赞
#spanish

ESCUCHA:面向异质声学条件的西班牙语语音基准

arXiv cs.CL · 2026-07-21 缓存

介绍了ESCUCHA,这是首个用于评估大型音频语言模型在异质声学条件和推理能力方面的西班牙语语音理解基准,包含来自多种真实世界来源的1000个精选问题。

0 人收藏 0 人点赞
#spanish

人工智能正在奖励数量并埋葬创新

Reddit r/artificial · 2026-07-13

文章批评人工智能如何奖励数据和生产的数量而非真正的创新,暗示该领域存在失衡。

0 人收藏 0 人点赞
#spanish

通过人机协作构建可扩展且文化特异性的刻板印象数据集

arXiv cs.CL · 2026-07-10 缓存

介绍了一种经济高效的人机协作标注框架,用于构建涵盖多个西班牙语国家的西班牙语刻板印象数据集EspanStereo,从而在大型语言模型中实现更具文化基础的偏见评估。

0 人收藏 0 人点赞
#spanish

S-DiverSe: 西班牙语多样语音

arXiv cs.CL · 2026-07-07 缓存

S-DiverSe 是一个3.2小时的西班牙语音语料库,来自22位患有神经系统疾病(肌萎缩侧索硬化症、帕金森病、中风)的说话者,旨在支持病理语音的ASR评估。基线实验表明,在该领域,启发式后处理优于微调。

0 人收藏 0 人点赞
#spanish

HULAT2 在 MER-TRANS 2026 中的参与:面向西班牙语易读文本生成的受控多智能体简化

arXiv cs.CL · 2026-07-03 缓存

本文描述了 HULAT2-UC3M 在 MER-TRANS 2026 共享任务(西班牙语易读文本生成)中的参与情况,采用基于 LangGraph 和 Gemini/RigoChat 模型的受控多智能体工作流,取得了最佳 SARI 得分 44.05。

0 人收藏 0 人点赞
#spanish

VectraYX-Nano:一个42M参数的西班牙语网络安全语言模型,具备课程学习与原生工具调用能力

arXiv cs.CL · 2026-05-15 缓存

介绍了VectraYX-Nano,一个从零开始训练的42M参数仅解码器西班牙语网络安全语言模型,具备课程学习、通过MCP的原生工具调用以及一个1.7亿词元的语料库。实证发现揭示了损失-寄存器反转以及工具使用能力的语料密度伪影。

0 人收藏 0 人点赞
← 返回首页

提交意见反馈