全新改进的嵌入模型
摘要
OpenAI 发布了 text-embedding-ada-002,这是一个统一的嵌入模型,将之前的五个模型整合为一个,具有更出色的性能、4 倍更长的上下文窗口(8192 个令牌)、更小的维度(1536)以及比之前的 Davinci 嵌入模型低 99.8% 的定价。
查看缓存全文
缓存时间: 2026/04/20 14:46
相似文章
新的嵌入模型和 API 更新
OpenAI 发布了两个新的嵌入模型:text-embedding-3-small(比 ada-002 便宜 5 倍,MIRACL 性能提升 40% 以上)和 text-embedding-3-large(性能最佳,支持最多 3072 维度)。两个模型在标准基准上都展现出显著的性能提升,同时降低了成本。
介绍文本和代码嵌入
OpenAI 推出了新的嵌入 API 端点,可以将文本和代码转换为数值向量表示,用于语义搜索、聚类和分类任务。这些模型在标准基准测试上取得了最先进的效果,包括代码搜索性能相比之下提升了 20%。
@JinaAI_: jina-embeddings-v5-omni 正式发布!我们首个支持文本、图像、音频和视频的通用嵌入模型。现已在 t…
Jina AI 发布了 jina-embeddings-v5-omni,这是一款支持文本、图像、音频和视频的通用嵌入模型,具备向后兼容的索引功能。
Granite Embedding Multilingual R2:基于Apache 2.0的开源多语言嵌入模型,支持32K上下文——参数量低于1亿的检索质量最佳
IBM发布Granite Embedding Multilingual R2,这是一系列基于Apache 2.0的开源多语言嵌入模型,包含一个紧凑的97M参数模型,实现了参数量低于1亿的同类最佳检索质量,以及一个采用Matryoshka嵌入的311M参数模型,两者均支持32K上下文和200多种语言。
nvidia/Nemotron-3-Embed-1B-BF16
NVIDIA发布了Nemotron-3-Embed-1B-BF16,一款针对检索和语义相似度优化的多语言文本嵌入模型,在34种语言上实现了RAG系统的最优性能。