embeddings

标签

Cards List
#embeddings

OlmoEarth 嵌入介绍:从 OlmoEarth Studio 导出自定义嵌入向量用于下游分析

Hugging Face Blog · 21小时前 缓存

OlmoEarth Studio 现支持从 OlmoEarth 基础模型计算并导出自定义嵌入向量,支持相似性搜索、分割和变化检测等下游任务。这些嵌入向量可通过 Studio 界面或 API 以云优化 GeoTIFF 格式获取。

0 人收藏 0 人点赞
#embeddings

基于LLM的嵌入用于程序分析与优化

arXiv cs.LG · 2天前 缓存

本文介绍了LLMCompiler(一个在IR代码上大规模预训练的LLM)产生的程序嵌入在程序分析和优化任务中的首次应用,在算法分类中实现了1.54%的错误率,并在异构设备映射上取得了有竞争力的准确率。

0 人收藏 0 人点赞
#embeddings

@0xMorlex: https://x.com/0xMorlex/status/2086754640968732729

X AI KOLs Timeline · 3天前 缓存

A technical post explaining why RAG fails for multi-hop queries and presenting a 9-step roadmap for building context graphs, where entities are nodes and relationships are edges, with a minimal 150-line engine.

0 人收藏 0 人点赞
#embeddings

通过微分几何与积分几何理解可微嵌入

arXiv cs.LG · 3天前 缓存

本文提出了一个统一的几何框架,用以理解 t-SNE 和 UMAP 等可微嵌入,表明现有的诊断方法源自同一个几何对象,并提出了新的基于曲率和积分路径的信任度量。

0 人收藏 0 人点赞
#embeddings

@thesupermanmx: Google DeepMind 认为 RAG 已经失效。他们发表了一篇论文,证明向量数据库是死胡同。对于过去…

X AI KOLs Timeline · 3天前 缓存

Google DeepMind 的一篇论文认为,RAG 系统中的单向量嵌入存在严格的数学极限,证明向量数据库无法完全捕捉复杂的文档关系。他们引入了 LIMIT 压力测试数据集,以展示最先进的模型在结构化查询上也会失败。

0 人收藏 0 人点赞
#embeddings

@TeachTheMachine:决定你的RAG是否有效的7种分块策略

X AI KOLs Timeline · 5天前 缓存

来自MachineLearningMastery的一篇教育性文章,涵盖了RAG流水线的七种分块策略,从固定大小令牌分块到高级语义和层次化方法,并提供了每种策略的适用场景指导。

0 人收藏 0 人点赞
#embeddings

InsightEmb:学习面向智能体洞察检索的动作意图嵌入

arXiv cs.CL · 2026-08-06 缓存

InsightEmb 是一种用于智能体洞察检索的对比嵌入框架,仅通过数学推理数据即可学习面向进展的检索几何结构,从而在无需环境特定训练的情况下改进 LLM 智能体的检索效果。

0 人收藏 0 人点赞
#embeddings

来自6.6万集播客的叙事语义地图

Reddit r/ArtificialInteligence · 2026-08-03

作者构建了一个流水线,将6.6万集播客转录,提取并聚类超过70万个观点到二维语义地图中,用于追踪投资叙事,并过滤掉AI生成的内容。

0 人收藏 0 人点赞
#embeddings

亲爱的,我把嵌入缩小了:Matryoshka 与 PCA

Hacker News Top · 2026-08-03 缓存

Dylan Castillo 比较了 Matryoshka 表示学习(MRL)与主成分分析(PCA)在降低嵌入维度方面的效果,并在八个 BEIR 数据集上进行了实验,以评估检索质量与向量大小缩减之间的权衡。

0 人收藏 0 人点赞
#embeddings

UEmbed:统一稀疏与稠密多模态嵌入

Hugging Face Daily Papers · 2026-08-03 缓存

UEmbed 是一个仅解码器的多模态嵌入模型,能够在一次前向传播中同时生成稀疏和稠密表示,已发布 2B、4B 和 9B 三种规模。它在 MMEB-v2 上优于现有基于公开数据训练的多模态嵌入模型,并在 BEIR 上保持竞争力。

0 人收藏 0 人点赞
#embeddings

Notion向量搜索两年回顾:规模扩大10倍,成本降至1/10

Lobsters Hottest · 2026-07-22 缓存

Notion分享了其向量搜索基础设施在过去两年中实现规模扩大10倍、成本降低90%的经验,详细介绍了从上线到处理数百万工作区的架构演变。

0 人收藏 0 人点赞
#embeddings

EU AI Act OpenRAG:933个法律结构化文本块和BGE-M3嵌入向量集成于一个SQLite文件 [P]

Reddit r/MachineLearning · 2026-07-17

一个包含欧盟AI法案的933个法律结构化文本块以及BGE-M3嵌入向量的资源,打包在一个SQLite文件中,便于在检索增强生成系统中使用。

0 人收藏 0 人点赞
#embeddings

@HowToPrompt__: 整个RAG行业即将被……mp4文件颠覆!它叫做Memvid,可以将你的整个智能体记忆打包…

X AI KOLs Timeline · 2026-07-14 缓存

Memvid是一个开源工具,将智能体记忆打包到mp4文件中,相比传统的RAG管道和向量数据库,性能显著提升。

0 人收藏 0 人点赞
#embeddings

缓解CTR模型中的早期训练崩溃

arXiv cs.LG · 2026-07-14 缓存

本文分析了用于点击率预测的深度神经网络模型中的早期训练崩溃现象,并提出了缓解策略,如稀疏特征移除和值过滤,在大规模工业数据集上展示了改进效果。

0 人收藏 0 人点赞
#embeddings

@N01ennn: 我不明白为什么Obsidian用户还在看2D图,而3D可视化展示了实际的拓扑……

X AI KOLs Timeline · 2026-07-11 缓存

一个将Obsidian仓库笔记转换为嵌入并实时渲染3D网络可视化的工具,揭示思维拓扑和隐藏的缺口。

0 人收藏 0 人点赞
#embeddings

如果你已经付费使用LLM服务,运行本地嵌入模型和重排序模型比运行本地LLM更有用

Reddit r/LocalLLaMA · 2026-07-09

作者认为,对于已经订阅ChatGPT Pro等LLM服务的用户来说,为记忆系统运行本地嵌入模型和重排序模型比运行本地LLM更实用,并详细介绍了他们基于GBrain的配置。

0 人收藏 0 人点赞
#embeddings

预训练语言模型嵌入的黎曼几何

arXiv cs.CL · 2026-07-09 缓存

本文介绍了黎曼均值池化(RMP),该方法通过拉回度量利用黎曼几何聚合预训练语言模型的词元嵌入,在句子分类任务上表现出优于欧氏池化的性能。

0 人收藏 0 人点赞
#embeddings

DINOv2在k-NN中远差于SigLIP。这是预期的吗?[R]

Reddit r/MachineLearning · 2026-07-08

一位研究人员报告,在细粒度汽车分类任务中使用k-NN时,冻结的SigLIP2(92%)和DINOv2(41%)嵌入之间存在惊人的50个百分点的准确率差距,寻求了解线性探针是否能缩小差距,或者DINOv2是否不适合检索。

0 人收藏 0 人点赞
#embeddings

使用嵌入预测普通话单音节词的口语时长和音高

arXiv cs.CL · 2026-07-03 缓存

本研究探讨了来自大型语言模型的上下文嵌入是否能预测普通话单音节词的口语时长和音高轮廓,结果表明其预测能力高于随机水平,并能将归一化基频轮廓反变换回毫秒时间尺度。

0 人收藏 0 人点赞
#embeddings

14× 更快的嵌入:我们如何重建Manticore中的ONNX路径

Hacker News Top · 2026-07-03 缓存

Manticore Search 27.1.5 引入了一个新的 ONNX Runtime 后端用于嵌入,其性能比之前的 SentenceTransformers/Candle 路径提升约14倍,吞吐量从每秒5-11个文档提高到每秒70-230个文档,并且无需更改API。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈