NVIDIA的Nemotron Personas嵌入向量

Reddit r/LocalLLaMA 工具

摘要

使用Qwen 0.6B为Nemotron-Personas数据集预计算的嵌入向量,通过网页演示实现对合成角色进行语义搜索和聚类。

我为nvidia/Nemotron-Personas数据集提取了嵌入向量。这是一个非常宝贵的资源,包含数百万个具有详细背景(姓名、年龄、职业、爱好等)的合成角色,但要找到特定角色或对其聚类却很难。为了解决这个问题,我使用了Qwen 0.6B来计算嵌入向量。虽然0.6B模型轻量,但用于运行语义搜索或查找K近邻以构建角色组群完全足够。你可以找到预计算的嵌入向量(韩国、日本、法国、美国)。请查看网页演示。 * 数据集:[https://huggingface.co/collections/tantara/nemotron-personas-embedding](https://huggingface.co/collections/tantara/nemotron-personas-embedding) * 网页演示:[https://www.microworld.dev/](https://www.microworld.dev/) 如果你有任何想法,或者最终将其用于你的本地智能体项目,请告诉我!
查看原文

相似文章

Nemotron-3-Embed 1B/8B

Reddit r/LocalLLaMA

NVIDIA 发布了 Nemotron-3-Embed 1B 和 8B 模型,这是最先进的多语言文本嵌入模型,用于检索和语义相似度,针对 RAG 系统进行了优化。

nvidia/Nemotron-3-Embed-1B-BF16

Hugging Face Models Trending

NVIDIA发布了Nemotron-3-Embed-1B-BF16,一款针对检索和语义相似度优化的多语言文本嵌入模型,在34种语言上实现了RAG系统的最优性能。

nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 · Hugging Face

Reddit r/LocalLLaMA

NVIDIA发布Nemotron-3-Ultra-550B-A55B,这是一个5500亿参数(550亿活跃参数)的前沿大语言模型,采用混合LatentMoE架构,结合Mamba-2、MoE和注意力层,支持高达100万令牌的上下文长度和可配置的推理模式。它支持11种语言,并针对复杂的智能体工作流、长上下文分析和高精度推理进行了优化。