zero-shot

标签

Cards List
#zero-shot

Audio8/Audio8-TTS-预览版-0.1b

Hugging Face Models Trending ↗ · 2026-08-19 缓存

Audio8 TTS Preview 0.1b 是一个紧凑的零样本文本转语音模型,主模型拥有约1.7亿参数,支持语音克隆和多语言。

0 人收藏 0 人点赞
#zero-shot

Roboflow Playground:尝试并比较30种计算机视觉模型

Hacker News Top ↗ · 2026-08-17 缓存

Roboflow Playground 是一款新的开发者工具,能够对超过30种计算机视觉模型进行并排比较,涵盖目标检测和分类等任务,从而简化评估流程。

0 人收藏 0 人点赞
#zero-shot

TinyCast:基于计算周期的概率零样本预测

Hugging Face Daily Papers ↗ · 2026-08-16 缓存

TinyCast 是一款紧凑的零样本时间序列基础模型,具有计算周期功能,可在 Cortex-M7 等边缘设备上实现高效的概率预测。

0 人收藏 0 人点赞
#zero-shot

Can Frontier LLMs Match Natively Multimodal Embeddings? A Comparison on Hard-Negative Text-to-Image Retrieval

arXiv cs.AI ↗ · 2026-08-13 缓存

This paper compares natively multimodal embedding models (Gemini Embedding 2, Amazon Nova 2) against frontier LLMs (GPT-4.1, Claude Sonnet 4.6) for hard-negative text-to-image retrieval, finding comparable accuracy but much lower latency for embedding-based ranking.

0 人收藏 0 人点赞
#zero-shot

The Field Knows: Cross-Dimensional Geometry from Navigation to Black Holes

arXiv cs.AI ↗ · 2026-08-11 缓存

This paper introduces a continuous metric field framework trained by a single causal contrastive loss that unifies geometric structure discovery from robot navigation to black hole emergence, demonstrating zero-shot generalization across dimensions.

0 人收藏 0 人点赞
#zero-shot

一次响应,始终响应:通过潜在提示恢复检测LLM生成的文本

arXiv cs.CL ↗ · 2026-08-07 缓存

本文提出了EchoPrompt,一种无需训练的LLM生成文本检测器,通过添加通用前缀恢复潜在提示依赖性,并衡量指令微调模型与基础模型之间的似然增益差异,实现了最先进的零样本检测性能。

0 人收藏 0 人点赞
#zero-shot

不同扰动,不同机制:理解面向零样本方言鲁棒性的持续预训练

arXiv cs.CL ↗ · 2026-08-07 缓存

本文系统研究了基于扰动的持续预训练(CPT)在提升多语言大语言模型零样本方言鲁棒性方面的作用,比较了德语、意大利语和阿拉伯语中的六种训练条件。研究发现,字符级噪声CPT是最有效的通用策略,并揭示了不同扰动方法会引发不同的鲁棒性机制。

0 人收藏 0 人点赞
#zero-shot

HyperODE:动力系统仿真与推断的零样本替代模型

arXiv cs.LG ↗ · 2026-08-04 缓存

介绍HyperODE,一种零样本替代模型,将ODE结构映射到超图,无需重新训练即可对整类动力系统进行仿真和参数推断。

0 人收藏 0 人点赞
#zero-shot

DE-NER:通过大型语言模型的对话引导实现零样本命名实体识别

arXiv cs.CL ↗ · 2026-08-04 缓存

介绍DE-NER,一种用于零样本命名实体识别的对话引导框架,通过提问者和角色扮演LLM之间的自我对弈来明确实体边界,相比基线平均提高了3.75%的F1值。

0 人收藏 0 人点赞
#zero-shot

零样本大语言模型能否预测儿童营养不良?公平性与时间稳健性研究

arXiv cs.CL ↗ · 2026-08-03 缓存

一项研究评估了零样本 GPT-4o-mini 在孟加拉国人口与健康调查数据中预测儿童发育迟缓的表现,并与随机森林基线进行对比,同时评估了不同人口群体间的公平性及时间稳健性。结果显示两者平衡准确率相当,但在居住地和财富类别上存在显著的公平性差异。

0 人收藏 0 人点赞
#zero-shot

SwanTale:面向指令和零样本任务的统一多说话人语音与音频生成

Hugging Face Daily Papers ↗ · 2026-08-03 缓存

本文介绍了SwanTale,一个支持零样本和指令任务的统一多说话人语音与音频生成模型,以及用于数据标注的SwanData-Caption和用于高质量多音频模态生成的SwanVAE。

0 人收藏 0 人点赞
#zero-shot

选择开放权重语言模型进行零样本意图分类:41个模型的系统评估

arXiv cs.CL ↗ · 2026-07-31 缓存

本文系统评估了41个开放权重语言模型(135M–9B)在8个数据集上的零样本意图分类性能,分析了准确性、校准、鲁棒性和部署效率。研究发现,经过指令调优的3B模型可以胜过7B基础模型,并且像SNIPS这样的一些基准已经饱和。

0 人收藏 0 人点赞
#zero-shot

知识先于推理:EC-Reason-Bench,一个无需训练的LLM酶分类诊断基准

arXiv cs.CL ↗ · 2026-07-30 缓存

本文介绍了EC-Reason-Bench,一个无需训练的诊断基准,用于分析通用LLM为何在酶EC编号预测上失败。研究发现外部知识是关键并且必须优先于推理,而基于证据的推理充当了冲突近邻的仲裁者,而非新知识的来源。

0 人收藏 0 人点赞
#zero-shot

基于记忆的推理:一种时间粒度自适应的免训练长视频理解框架

arXiv cs.AI ↗ · 2026-07-29 缓存

ReMem提出了一种双层记忆增强的关键帧选择框架,用于免训练的长视频理解,在多个基准上实现了最先进的零样本性能。

0 人收藏 0 人点赞
#zero-shot

OVEarth-Bench:评估开放词汇地球观测的类别广度与查询多样性

Hugging Face Daily Papers ↗ · 2026-07-29 缓存

介绍了OVEarth-Bench,一个用于开放词汇地球观测的基准,扩展了类别覆盖和查询多样性,揭示了现有方法仍有限,而基于MLLM的方法表现最佳。

0 人收藏 0 人点赞
#zero-shot

空中MLLM智能体的零样本任务级评估

arXiv cs.CL ↗ · 2026-07-27 缓存

MissionBench是一个新的基准测试,用于评估多模态大语言模型(MLLMs)在三维空中环境中执行长期具身任务的表现。结果显示,即使是表现最好的模型,其任务成功率也不到35%,而人类的表现达到84.4%。

0 人收藏 0 人点赞
#zero-shot

DWT-Fusion: 一种基于信号的免训练LLM生成文本检测框架

arXiv cs.CL ↗ · 2026-07-27 缓存

介绍DWT-Fusion,一种免训练框架,通过对token级对数概率进行离散小波分析来检测LLM生成的文本,在多个数据集上取得了优异的AUROC结果。

0 人收藏 0 人点赞
#zero-shot

一种用于LLM零样本适应谵妄预测的知识注入框架

arXiv cs.CL ↗ · 2026-07-24 缓存

提出一种用于零样本ICU谵妄预测的轻量化知识注入框架,该框架在推理时用外部临床知识增强结构化电子健康记录数据摘要,在无需微调的LLaMA模型上,AUROC提升高达8.57个百分点。

0 人收藏 0 人点赞
#zero-shot

面向零样本数字孪生的图神经网络方法

arXiv cs.LG ↗ · 2026-07-24 缓存

本文提出了一种新颖的零样本数字孪生框架,该框架将实时视觉感知与几何无关、物理驱动的图神经网络相结合。该方法采用热力学驱动的图神经网络,强制执行能量守恒和熵产生,从而无需重新训练即可在未见过的几何体上实现物理准确的模拟。

0 人收藏 0 人点赞
#zero-shot

用于引文功能分类的大型语言模型

arXiv cs.CL ↗ · 2026-07-21 缓存

本文对五种大型语言模型在引文功能分类任务上进行了全面评估,基于微调后的 Falcon 7B 模型在 ACL-ARC 数据集上取得了新的最优结果。同时引入了 AC3 数据集,该数据集采用七类别标注方案,能够区分中性致谢与评价性立场。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈