VultronRetriever系列模型在HuggingFace上发布![R]
摘要
Vultr发布了VultronRetriever系列模型,包括Prime-8B、Core-4.5B和Flash-0.8B,这些模型在MTEB排行榜上名列前茅,具有高效和离线能力。
激动地宣布VultronRetriever系列模型,在Raise Summit Paris期间发布,并在iPhone上演示了运行问答和嵌入文档,完全离线!📱 VultronRetriever模型家族的一些亮点:🥇 每款模型在MTEB排行榜上各自类别中排名第一,其中VultronRetrieverPrime-8B为全球第一 📦 VultronRetrieverPrime-8B相比之前的9B级领先模型,索引存储占用缩小高达16倍,吞吐量提高12倍 🎯 VultronRetrieverCore-4.5B在排行榜上仅次于Prime,性能超越两倍于其大小的模型 ⚡ VultronRetrieverFlash-0.8B性能超越高达5倍于其大小的模型,在边缘设备上低温运行,完全离线每分钟可索引60张图像!🐍 使用Hydra架构部署VultronRetriever模型,带来无与伦比精度的延迟交互检索,同时生成过程的显存仅为同类模型的一半 🧪 所有模型均在0%跨数据集重复和0%评估污染的数据集上训练,在私有MTEB评估中未显示过拟合 赶快获取,尽情改造,让它们为你所用 🔧 🏆 Prime: https://huggingface.co/vultr/VultronRetrieverPrime-Qwen3.5-8B ⚙️ Core: https://huggingface.co/vultr/VultronRetrieverCore-Qwen3.5-4.5B ⚡ Flash: https://huggingface.co/vultr/VultronRetrieverFlash-Qwen3.5-0.8B 📊 MTEB排行榜: https://mteb-leaderboard.hf.space/benchmark/ViDoRe(v3)) 🐍 Hydra架构: https://arxiv.org/abs/2603.28554
相似文章
@svpino:小巧、专业且开源的模型才是未来!TwiL-LM 模型系列现已在 HuggingFace 上发布,供 Tra…
TwiL-LM 是一系列小巧的专用开源模型,现已发布在 HuggingFace 上。其中 3B 版本在形式推理基准测试上优于 OpenAI 的 120B gpt-oss 模型,并且能在消费级硬件上高效运行。
NVIDIA Nemotron 3 Embed 在RTEB整体排名第一,推动智能检索发展
NVIDIA发布Nemotron 3 Embed,这是一组开源嵌入模型,在RTEB排行榜上名列前茅,包括一个80亿参数的旗舰模型以及适用于生产规模检索的高效10亿参数变体。
Qwen3.6-35B-A3B 和 9B 已正式登上公开的 Terminal-Bench 2.0 排行榜!
Qwen3.6-35B-A3B 和 Qwen3.5-9B 模型已正式登上 Terminal-Bench 2.0 排行榜,其中 little-coder 在 35B 变体上取得 24.6% 的成绩,超越了 Gemini 2.5 Pro 和 Qwen3-Coder-480B;而 9B 模型则表明,10B 以下的本地模型能够与高难度代理基准竞争。
@swyx: 链接汇总:
NVIDIA 发布 Cosmos 3(混合 Transformer 模型,参数最高达 64B)、Nemotron 3 Ultra(550B-A55B 大语言模型),并在 Computex 2026 上预览了 RTX Spark 个人超级芯片,在多个开源模型排行榜上达到 SOTA。
@TraffAlex: 32GB VRAM的AI模型 — 前17名速查表 调用HuggingFace API,获取了真实的.gguf Q4大小。每个链接均为直接下载…
一份速查表,列出了使用GGUF Q4量化针对32GB VRAM优化的顶级AI模型,并提供来自HuggingFace的直接下载链接。包含Qwen、DeepSeek、Llama和Mistral系列的模型,以及关于量化和上下文设置的提示。