embeddings

标签

Cards List
#embeddings

前瞻记忆:面向个人记忆检索的零推断前瞻性检索项

arXiv cs.CL ↗ · 3天前 缓存

本文提出一种用于个人记忆检索的零推断前瞻性检索项,该技术能在无需查询时计算的情况下,提升与未来承诺相关记忆项的检索优先级。在合成任务集上的实验表明,该方法能改善记忆召回效果,并可作为主动型AI助手分层架构的组成部分。

0 人收藏 0 人点赞
#embeddings

Ovis-Embedding:推动通用全模态嵌入的前沿

Hugging Face Daily Papers ↗ · 4天前 缓存

本文介绍了Ovis-Embedding,一种最先进的全模态嵌入模型,它使用共享骨干网络将文本、图像、视频和音频编码到公共表示空间中,在MMEB-v3和MVEB等基准测试上取得了顶级性能。

0 人收藏 0 人点赞
#embeddings

@tomaarsen: 不如生成式解码器那样性感,但用于搜索的Sentence Transformers模型已经慢慢占据了下载量最多的页面…

X AI KOLs Timeline ↗ · 5天前 缓存

这条推文指出,用于搜索的Sentence Transformers模型在Hugging Face上获得了人气,并表达了对具有零样本能力的编码器复兴的希望。

0 人收藏 0 人点赞
#embeddings

@DailyDoseOfDS_: 终于,数据库现在可以自己生成嵌入了。当您为应用添加语义搜索时,标准步骤是…

X AI KOLs Timeline ↗ · 6天前 缓存

MongoDB Atlas 推出了自动嵌入功能,使数据库能够在内部生成和管理嵌入向量,用于语义搜索,无需外部服务并改善数据同步。

0 人收藏 0 人点赞
#embeddings

@garrytan: Memorable找到了一种用嵌入代替更多令牌来优化记忆的方法,这是一种强大的记忆新方式。

X AI KOLs Timeline ↗ · 2026-09-17 缓存

Memorable引入了一种使用嵌入代替令牌来优化AI代理记忆的方法,使得程序性记忆能够跨多个运行持续存在。

0 人收藏 0 人点赞
#embeddings

面向长文档的更优向量搜索:Manticore Search 中的文档分块技术

Hacker News Top ↗ · 2026-09-17 缓存

Manticore Search 引入了针对向量搜索的自动文档分块功能,通过将长文档分割为多个分块并为每个分块生成嵌入向量,从而提升长文档的召回率。

0 人收藏 0 人点赞
#embeddings

从压缩向量表示中精确读出语义

arXiv cs.CL ↗ · 2026-09-17 缓存

本文开发了一种用于形式语义的向量逻辑,描述了压缩向量表示何时允许对真值条件进行精确线性或仿射读出,并在GloVe和word2vec嵌入上进行了实验。

0 人收藏 0 人点赞
#embeddings

从零开始用纯Zig构建的搜索与推理数据库

Hacker News Top ↗ · 2026-09-15 缓存

Antfly将他们的搜索与推理数据库从Go重写为纯Zig,以提升性能并实现零依赖。本文详细介绍了他们的技术决策、基本原则以及向量搜索算法的实现。

0 人收藏 0 人点赞
#embeddings

基于监督嵌入的症状网络可扩展部分信息分解

arXiv cs.LG ↗ · 2026-09-15 缓存

本文介绍了ePID,一种使用监督嵌入计算症状网络部分信息分解的可扩展流水线,能够分离心理健康数据中的冗余和协同信息。

0 人收藏 0 人点赞
#embeddings

@incrementaliser: 进入嵌入空间!我正在复习一些自然语言处理知识(必须是 @chrmanning 的讲座)并且实…

X AI KOLs Timeline ↗ · 2026-09-12 缓存

作者提议创建一个3D可视化房间来探索NLP嵌入模型,灵感来源于 @chrmanning 的讲座。

0 人收藏 0 人点赞
#embeddings

@rohanpaul_ai: 新LinkedIn论文显示智能体记忆并非自动可移植:固定结构记忆在模型更换中存活,自由格式笔记则...

X AI KOLs Following ↗ · 2026-09-11 缓存

LinkedIn的一篇论文揭示,智能体记忆在模型更换时并非自动可移植,固定结构记忆比自由格式笔记更稳定,并强调了在升级过程中进行记忆兼容性测试的必要性。

0 人收藏 0 人点赞
#embeddings

用于替代度假租赁房产推荐的多源集成候选生成方法

arXiv cs.LG ↗ · 2026-09-10 缓存

本文介绍了一种用于度假租赁推荐的混合候选生成方法,结合了协同过滤和图神经网络,将召回率提高了14.8%。

0 人收藏 0 人点赞
#embeddings

视觉文档检索中的生成式后期交互嵌入

Hugging Face Daily Papers ↗ · 2026-09-10 缓存

介绍了生成式后期交互嵌入(GLIE),用于压缩视觉文档检索向量,通过按需重新生成完整嵌入来提高存储约束下的准确性。

0 人收藏 0 人点赞
#embeddings

Autoencoder参数的频谱特征作为数据的向量表示

arXiv cs.LG ↗ · 2026-09-04 缓存

本文探讨了自编码器参数与数据统计特性之间的联系,提出参数可以作为数据的向量表示,通过理论分析以及在CIFAR-10和FashionMNIST数据集上的实验进行了验证。

0 人收藏 0 人点赞
#embeddings

通过二次嵌入实现位置感知的语言模型

arXiv cs.CL ↗ · 2026-09-02 缓存

本文提出了一种轻量级、模型无关的方法,通过利用位置数据增强嵌入来提升语言模型的地理空间感知能力,从而在保持标准NLP性能的同时改善空间对齐。

0 人收藏 0 人点赞
#embeddings

基于Wasserstein重心的交互场在空间因子模型中的应用:来自语言模型表示的证据

Hugging Face Daily Papers ↗ · 2026-08-30 缓存

本文提出了一种使用Wasserstein重心重建语言模型嵌入场的方法,用于预测空间因子模型中的同伴错配惩罚,其性能优于常规加权方案。

0 人收藏 0 人点赞
#embeddings

无跨资产收益协方差的投资组合风险界限:语言模型表示的分布场

Hugging Face Daily Papers ↗ · 2026-08-30 缓存

一个使用分布值公司特征和语言模型嵌入的框架,无需跨资产协方差估计即可提供投资组合风险界限,展示了使用Qwen3-Embedding-8B表示的低方差配置。

0 人收藏 0 人点赞
#embeddings

基于嵌入的神经回归用于知识图谱中的数值属性预测

arXiv cs.LG ↗ · 2026-08-28 缓存

本文提出了LitEm,一个神经回归模型,它使归纳式知识图谱嵌入模型能够预测数值属性,在基准测试中取得了优异结果,并引入了一个协同训练框架以提升性能。

0 人收藏 0 人点赞
#embeddings

不,Engrams 不会让你在本地运行 1T 模型。但它能做更好的事情。

Reddit r/LocalLLaMA ↗ · 2026-08-27

Engrams 是一种架构创新,它使用 N-gram 表来从 transformer 模型中卸载记忆,通过释放参数用于计算,让较小模型能更好地推理。

0 人收藏 0 人点赞
#embeddings

RAG 并没有你想象的那么复杂

Hacker News Top ↗ · 2026-08-26 缓存

文章探讨了六种 RAG 架构,并建议根据数据新鲜度、查询模式和规模等因素选择合适的方法,以避免过度工程化。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈