标签
Hyperresearch 是一个开源的Python工具,充当Claude Code和OpenAI Codex的深度研究框架,使用代理来收集、搜索和综合网络研究到一个持久的、可搜索的维基中,并带有对抗性审计。
ASIRF是一个智能体框架,它在推理时检索特定领域的敏感信息脱敏定义,与训练好的分类器相比,在多个领域以极少的专家输入达到更高的召回率。
learn-from-materials Agent技能将PDF、EPUB、Word文档和PPT转换为具有源追踪和知识库构建功能的交互式学习网站。
ClaudeBrain 项目为 Claude Code 引入了一个安全研究工具,配备全面的知识库和自动化工作流,以协助渗透测试和漏洞猎捕。
Opyt 是一款免费、基于 MIT 许可的工具,它利用 AI 从您在 X、Substack 和其他来源关注的内容中创建个性化知识库,增强探索并跟踪新发展。
MACE 是一个多智能体候选事件获取方法,它使用证据专用的 LLM 代理来细化事件结构,提高事件链接任务的准确性,而无需修改现有模型。
作者构建了Global Fail Map,这是一个开源交互式工具,记录了科学、技术和商业领域的历史失败案例,旨在为AI代理和开发者提供研究层。
一家AI机构分享了在客户支持系统中实施AI的经验,详述了提升自助服务和客服效率等益处,但指出AI无法解决根本的政策问题,且需要持续维护。
Grok,一个 AI 模型,创建了一个可配置和可下载的智能体工程百科全书,包括领域指南和集成课程,展示了 AI 生成全面教育资源的能力。
一位网页开发者分享了围绕AI编程代理构建系统的经验,以实现可靠开发,并寻求关于工作流和编排工具的建议。
这个AI编剧知识库名为'screenwriting-skills',它从19本经典编剧书籍中提炼出技能,提供13个编剧技能,有392个GitHub星标,旨在降维打击AI写剧本。
论文介绍了一个两阶段的大语言模型管道,使用经过微调的Qwen3-4B和超并行解码来提取电子商务中具有购买区分度的属性,实现了85%的准确率,成本降低了92%。
这篇文章介绍了一个基于19本经典著作的全面编剧知识库,用于协助AI辅助的剧本创作和学习,覆盖了不同阶段和文化方法。
本文介绍了PACE,一个用于评估AI模型是否能通过检索隐式知识库事实来识别用户请求中隐藏冲突的数据集,并提出了PaceMaker,一个增强冲突感知决策的多智能体框架。
本文介绍了LexIssue,这是一个用于识别中文民事诉讼中争议法律问题的基准测试,基于真实案例和专家标注构建,并展示了检索增强生成能够提升性能。
本文提供了企业AI知识库从概念到实际交付的全面指南,强调了数据治理、权限管理、测试与验收的重要性,并附有实施检查清单。
构建了一个用于AI代理的开源事实检查器,通过获取实时来源验证主张,并提供真实性和置信度评分,适用于公开和内部文档。
Google Research的WikiSkill预印本展示了将执行历史编译成技能文件可以让一个9B AI模型在基准测试中超越27B模型,突出了程序记忆和技能转移在代理性能中的作用。
Virgil是一个交互式系统,旨在通过精选知识库和统一界面,帮助用户发现和比较用于基于Transformer的语言模型的可解释性工具。
WikiSkill 介绍了一个框架,该框架与持久知识库共同演化代理技能,以系统性地积累经验并提升跨模型性能,展示了优于最先进的技能演化方法的优势。