NVIDIA的Nemotron Personas嵌入向量
摘要
使用Qwen 0.6B为Nemotron-Personas数据集预计算的嵌入向量,通过网页演示实现对合成角色进行语义搜索和聚类。
我为nvidia/Nemotron-Personas数据集提取了嵌入向量。这是一个非常宝贵的资源,包含数百万个具有详细背景(姓名、年龄、职业、爱好等)的合成角色,但要找到特定角色或对其聚类却很难。为了解决这个问题,我使用了Qwen 0.6B来计算嵌入向量。虽然0.6B模型轻量,但用于运行语义搜索或查找K近邻以构建角色组群完全足够。你可以找到预计算的嵌入向量(韩国、日本、法国、美国)。请查看网页演示。
* 数据集:[https://huggingface.co/collections/tantara/nemotron-personas-embedding](https://huggingface.co/collections/tantara/nemotron-personas-embedding)
* 网页演示:[https://www.microworld.dev/](https://www.microworld.dev/)
如果你有任何想法,或者最终将其用于你的本地智能体项目,请告诉我!
相似文章
Nemotron-3-Embed 1B/8B
NVIDIA 发布了 Nemotron-3-Embed 1B 和 8B 模型,这是最先进的多语言文本嵌入模型,用于检索和语义相似度,针对 RAG 系统进行了优化。
NVIDIA Nemotron 3 Embed 在RTEB整体排名第一,推动智能检索发展
NVIDIA发布Nemotron 3 Embed,这是一组开源嵌入模型,在RTEB排行榜上名列前茅,包括一个80亿参数的旗舰模型以及适用于生产规模检索的高效10亿参数变体。
nvidia/Nemotron-3-Embed-1B-BF16
NVIDIA发布了Nemotron-3-Embed-1B-BF16,一款针对检索和语义相似度优化的多语言文本嵌入模型,在34种语言上实现了RAG系统的最优性能。
nvidia/NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16 · Hugging Face
NVIDIA发布Nemotron-3-Ultra-550B-A55B,这是一个5500亿参数(550亿活跃参数)的前沿大语言模型,采用混合LatentMoE架构,结合Mamba-2、MoE和注意力层,支持高达100万令牌的上下文长度和可配置的推理模式。它支持11种语言,并针对复杂的智能体工作流、长上下文分析和高精度推理进行了优化。
nvidia/NVIDIA-Nemotron-Labs-3-Puzzle-75B-A9B-NVFP4
NVIDIA 发布了 Nemotron-Labs-3-Puzzle-75B-A9B,它是 Nemotron-3-Super 的压缩版本,推理效率更高,基准测试性能强劲。