VultronRetriever系列模型在HuggingFace上发布![R]

Reddit r/MachineLearning 模型

摘要

Vultr发布了VultronRetriever系列模型,包括Prime-8B、Core-4.5B和Flash-0.8B,这些模型在MTEB排行榜上名列前茅,具有高效和离线能力。

激动地宣布VultronRetriever系列模型,在Raise Summit Paris期间发布,并在iPhone上演示了运行问答和嵌入文档,完全离线!📱 VultronRetriever模型家族的一些亮点:🥇 每款模型在MTEB排行榜上各自类别中排名第一,其中VultronRetrieverPrime-8B为全球第一 📦 VultronRetrieverPrime-8B相比之前的9B级领先模型,索引存储占用缩小高达16倍,吞吐量提高12倍 🎯 VultronRetrieverCore-4.5B在排行榜上仅次于Prime,性能超越两倍于其大小的模型 ⚡ VultronRetrieverFlash-0.8B性能超越高达5倍于其大小的模型,在边缘设备上低温运行,完全离线每分钟可索引60张图像!🐍 使用Hydra架构部署VultronRetriever模型,带来无与伦比精度的延迟交互检索,同时生成过程的显存仅为同类模型的一半 🧪 所有模型均在0%跨数据集重复和0%评估污染的数据集上训练,在私有MTEB评估中未显示过拟合 赶快获取,尽情改造,让它们为你所用 🔧 🏆 Prime: https://huggingface.co/vultr/VultronRetrieverPrime-Qwen3.5-8B ⚙️ Core: https://huggingface.co/vultr/VultronRetrieverCore-Qwen3.5-4.5B ⚡ Flash: https://huggingface.co/vultr/VultronRetrieverFlash-Qwen3.5-0.8B 📊 MTEB排行榜: https://mteb-leaderboard.hf.space/benchmark/ViDoRe(v3)) 🐍 Hydra架构: https://arxiv.org/abs/2603.28554
查看原文

相似文章

@swyx: 链接汇总:

X AI KOLs Following

NVIDIA 发布 Cosmos 3(混合 Transformer 模型,参数最高达 64B)、Nemotron 3 Ultra(550B-A55B 大语言模型),并在 Computex 2026 上预览了 RTX Spark 个人超级芯片,在多个开源模型排行榜上达到 SOTA。