code-search

标签

Cards List
#code-search

意外创建了一个本地检索工具,似乎有效!急需测试建议

Reddit r/AI_Agents ↗ · 2026-09-04

作者意外开发了一个用于代理AI软件调试的本地检索工具,该工具能高效缩小代码函数范围以定位错误,并寻求更多测试想法来验证其有效性。

0 人收藏 0 人点赞
#code-search

合成语义监督用于小型Transformer中的对比代码表示学习:一项实证研究

arXiv cs.AI ↗ · 2026-09-04 缓存

本文通过实证研究了使用合成语义监督对小型Transformer中的代码嵌入进行对比预训练,结果显示相比基线有显著提升,并且与大型模型具有竞争力。

0 人收藏 0 人点赞
#code-search

🚀 zg(zvec-grep)现已开源!我们为人类和AI代理打造了一款本地搜索工具——索引和搜索默认在设备上运行…

X AI KOLs Timeline ↗ · 2026-09-02 缓存

ZvecAI 开源了 zg(zvec-grep),这是一款本地优先的搜索工具,集成了语义搜索、BM25 和 ripgrep,可在设备上进行高效索引和检索,专为人类和 AI 代理设计。

0 人收藏 0 人点赞
#code-search

@Robro612: 来看看这个低摩擦方式,亲身体验一下 @mixedbreadai agentic search 的速度和精度!

X AI KOLs Following ↗ · 2026-08-21 缓存

介绍 Repofetch,一款开发者工具,利用 mixedbreadai 的 toast-1 模型提供 agentic search,实现与 GitHub 仓库的高效交互,助力快速代码查询。

0 人收藏 0 人点赞
#code-search

Inventory

Product Hunt ↗ · 2026-08-02

Inventory 是一款产品,可让你搜索所有 AI Agent 和 IDE 对话,从而更轻松地找到过去的交互和代码讨论。

0 人收藏 0 人点赞
#code-search

Don't stop early: Case-folding source code at memory speed

Hacker News Top ↗ · 2026-07-31 缓存

GitHub engineering describes how they optimized case-folding for their code search engine by removing early-exit branches, achieving memory-speed ASCII folding, and open-sourcing the result as a Rust crate called casefold.

0 人收藏 0 人点赞
#code-search

DenseOn与LateOn:面向多语言、长上下文和代码搜索的完全开放密集与延迟交互模型

arXiv cs.CL ↗ · 2026-07-30 缓存

本文介绍了完全开放的DenseOn和LateOn检索模型,这些模型在精心整理的英语数据上训练,并通过translate-train扩展到多语言设置,在其参数规模下实现了最先进的BEIR结果。

0 人收藏 0 人点赞
#code-search

AST-grep 如何使用 Rust 重写 Tree-sitter 并使其速度提升 30%

Hacker News Top ↗ · 2026-07-26 缓存

ast-grep 用 Rust 重写了 Tree-sitter 的 C 核心,实现了高达 30% 的解析速度提升和 22% 的端到端性能提升,但内存使用略有增加。

0 人收藏 0 人点赞
#code-search

Harness Handbook:使不断演化的智能体Harness可读、可导航、可编辑

arXiv cs.AI ↗ · 2026-07-16 缓存

Harness Handbook是一种以行为为中心的表示,通过静态程序分析和LLM辅助从智能体harness代码库中合成,帮助开发者和编码智能体定位实现特定行为的代码。它引入了行为引导的渐进式披露(BGPD),引导智能体从高层描述到相关实现细节,提高了定位准确性和编辑计划质量。

0 人收藏 0 人点赞
#code-search

Show HN: Capn-hook —— 编码代理的持久记忆工具 —— 不再重复grep同一谜题

Hacker News Top ↗ · 2026-07-12 缓存

Capn-hook 是一个 CLI 工具,它为编码代理提供持久记忆,保存回答代码库问题的文件,使得代理不再跨会话重复探索同一谜题,将重复问题的 Token 使用量减少 77%。

0 人收藏 0 人点赞
#code-search

@geekbb: Go 编写的 CLI 工具,集成了 Web 搜索(Brave/DDG/SearXNG/Exa)、代码搜索(Grep/Sourcegraph/GitHub)和库文档查询(Context7)三种搜索能力,同时支持网页抓取和站点爬取。 为 AI…

X AI KOLs Timeline ↗ · 2026-06-30 缓存

一个用 Go 编写的极速、无状态的 CLI 工具,集成 Web 搜索、代码搜索和库文档查询功能,支持网页抓取和站点爬取,专为 AI Agent 和终端使用设计。

0 人收藏 0 人点赞
#code-search

@Ryrenz: coding agent 的省 token 神器来了——cocoindex-code,一条命令给你的代码库做语义搜索 刚开源不久,靠“省 70% token”的卖点 star 涨得很快。 让 Claude Code、Codex 这类 ag…

X AI KOLs Timeline ↗ · 2026-06-29 缓存

cocoindex-code 是一个基于 AST 的语义代码搜索工具,可以快速集成到编码代理中,节省高达 70% 的 token 并提高搜索效率。

0 人收藏 0 人点赞
#code-search

召回前重排序:大规模代码到代码检索的深度学习模型基准测试

arXiv cs.CL ↗ · 2026-06-29 缓存

本文对17种深度学习模型在大规模代码到代码检索的第一阶段召回中进行了基准测试,评估了它们在多种编程语言和数据集上的精确度、效率和可扩展性。文中介绍了基于LLM的代码标准化和查询重写方案,这些方案提高了性能较低模型的精确度。

0 人收藏 0 人点赞
#code-search

@Chenzeze777: 兄弟们今天刷 GitHub 直接愣住了。 Headroom,一周涨了 1.4 万星,海外开发者圈彻底炸了。我本来以为是又一个 PPT 开源项目,结果仔细看了眼实测数据——代码搜索 1.7 万 token 压到 1400,答案一字没变。 给…

X AI KOLs Timeline ↗ · 2026-06-08 缓存

Headroom 是一个开源工具,可将代码搜索结果和AI对话中的token数量压缩高达92%(如从1.7万压缩到1400),且保持答案质量不变,支持多平台本地免费运行。

0 人收藏 0 人点赞
#code-search

我构建了一个开源编码代理,让上下文可见且可编辑 — 你可以精确策划大语言模型所看到的内容

Reddit r/AI_Agents ↗ · 2026-05-31

作者构建了 Nice Coding Agent,这是一个开源编码工作台,具有可见且可编辑的上下文堆栈,允许用户精确策划大语言模型所看到的内容。它具备本地优先检索、沙盒执行和混合代码搜索功能,旨在让开发者对上下文组装拥有控制和可见性。

0 人收藏 0 人点赞
#code-search

@Trtd6Trtd: https://github.com/MinishLab/semble… 专为AI优化的高速代码搜索库,相比grep+读取,它可节省约98%的token。

X AI KOLs Timeline ↗ · 2026-05-20 缓存

Semble 是一个面向 AI 代理的高效代码搜索库,使用模型如 Model2Vec 或 BM25 实现快速索引和检索,比 grep+read 节省约 98% 的 token,支持 MCP 服务器和 CLI 集成。

0 人收藏 0 人点赞
#code-search

@aigclink: 面向Agent的一个代码搜索工具:Semble,用自然语言查代码库返回精准代码片段,比grep+read节省98% token消耗 方法是让Agent用自然语言直接定位到最相关的几行代码,不用瞎猜关键词,不用读整文件 速度上,索引一个普通…

X AI KOLs Timeline ↗ · 2026-05-19 缓存

Semble是一个面向Agent的代码搜索工具,支持自然语言查询,能精准返回语义完整的代码片段,比传统grep+read方式节省98% token消耗,具有智能分块、双路检索和代码感知重排序等特性。

0 人收藏 0 人点赞
#code-search

为AI编码代理构建本地优先的上下文引擎——符号图+语义搜索,无需云端

Reddit r/artificial ↗ · 2026-05-18

Argyph 是一个开源 MCP 服务器,通过符号图和语义搜索为 AI 编码代理提供结构化的代码库理解,完全本地运行,无云端依赖。

0 人收藏 0 人点赞
#code-search

Show HN: Semble – 面向代理的代码搜索,令牌使用量比 grep 减少 98%

Hacker News Top ↗ · 2026-05-17 缓存

Semble 是一款面向 AI 代理的快速代码搜索库,令牌使用量比 grep+read 减少约 98%,在 CPU 上运行,无外部依赖,并通过 MCP 或 CLI 集成。

0 人收藏 0 人点赞
#code-search

超越检索:代码搜索的多任务基准与模型

Hugging Face Daily Papers ↗ · 2026-05-06 缓存

本文介绍了 CoREB,这是一个针对代码搜索的、受数据污染限制的多任务基准测试,具备微调重排序能力,可评估文本到代码、代码到文本以及代码到代码的检索效果。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈