scaffolding

标签

Cards List
#scaffolding

@rohanpaul_ai: Boris Cherny, Claude Code creator at Anthrpic: "更通用的模型总是比更具体的模型表现更好。……"

X AI KOLs Timeline ↗ · 2026-09-28 缓存

Boris Cherny,Claude Code在Anthropic的创作者,建议优先选择通用AI模型而非具体模型,指出脚手架改进往往是临时的,并会被新模型取代。

0 人收藏 0 人点赞
#scaffolding

@simplifyinAI: 重大新闻:Anthropic 工程师透露了他们内部使用的一个简单技巧。Claude 代理现在可以记住改进方法……

X AI KOLs Timeline ↗ · 2026-09-26 缓存

Anthropic 工程师公开了一项他们内部使用的简易技巧:利用外部记忆脚手架,让 Claude 代理将错误和改进记录在一个文件中,从而在无需重新训练模型的前提下持续提升性能。

0 人收藏 0 人点赞
#scaffolding

GPT-6 Astra 主打你可以移除脚手架,但你得先看安全部分

Reddit r/AI_Agents ↗ · 2026-09-15

OpenAI 的 GPT-6 Astra 功能增强,可移除脚手架以提升效率,但安全指标和企业控制凸显了保留控制脚手架的重要性,以防意外后果。

0 人收藏 0 人点赞
#scaffolding

架构基础模型至物理世界智能体,推动长时程导航的前沿

Hugging Face Daily Papers ↗ · 2026-08-31 缓存

NavMCP是一个代理脚手架框架,集成视觉语言模型与导航基础模型,以实现持久的长时程物理世界探索,并在基准测试和真实机器人任务中取得最先进的成果。

0 人收藏 0 人点赞
#scaffolding

当前的AI智能体被过度炒作且存在根本性限制

Reddit r/AI_Agents ↗ · 2026-08-23

本文批评当前的AI智能体被过度炒作且根本上有限,认为它们本质上是带有脚手架的大语言模型,并且其依赖的下一个词元预测使其在长期规划和问责方面不可靠。

0 人收藏 0 人点赞
#scaffolding

测试时AI4AI:通过框架实现强到弱能力迁移

Hugging Face Daily Papers ↗ · 2026-08-12 缓存

本文研究了测试时的强弱能力迁移,表明更强的模型能够构建推理时框架,在不进行参数更新的情况下,使较弱模型的性能近乎翻倍。

0 人收藏 0 人点赞
#scaffolding

秒级搭建生产级 AI Agent 项目脚手架

Reddit r/AI_Agents ↗ · 2026-08-08

一款开源 CLI 工具,可在数秒内搭建生产级 AI Agent 项目,简化 Python 开发者的环境配置流程。

0 人收藏 0 人点赞
#scaffolding

DCAS:解耦CLI代理脚手架以跨脚手架内化规划

Hugging Face Daily Papers ↗ · 2026-08-06 缓存

本文介绍了DCAS——一种后端替换拦截层,它将CLI代理脚手架与后端模型解耦,从而实现跨脚手架评估。研究表明,在小规模数据集上进行规划感知微调,能够提高模型在非训练脚手架上的泛化能力。

0 人收藏 0 人点赞
#scaffolding

以GenAI促进批判性参与:转变少数民族预科生在提示工程任务中的协作话语

arXiv cs.AI ↗ · 2026-08-03 缓存

这项基于设计的研究探讨了教学支架如何帮助少数民族预科生在提示工程任务中从被动消费转向与生成式AI进行批判性共创,从而提升提示自我效能感,并主动把关AI生成的内容。

0 人收藏 0 人点赞
#scaffolding

@DanKornas: GenAI项目在提示词、模型设置、实验和应用逻辑没有明确归宿时,会变得难以驾驭。

X AI KOLs Timeline ↗ · 2026-07-29 缓存

一个用于组织生成式AI应用的项目结构脚手架,将配置、数据、示例、笔记本、测试和核心源代码模块分离。它采用Apache 2.0开源许可。

0 人收藏 0 人点赞
#scaffolding

现代智能体系统中的自我改进:一项综述

arXiv cs.AI ↗ · 2026-07-16 缓存

本综述为自我改进的自主智能体提供了一个系统框架,将方法分为基础模型改进和脚手架改进,并回顾了应用和评估方法。

0 人收藏 0 人点赞
#scaffolding

框架比模型更重要。一个配备优秀评审的27B模型改变了我的看法。

Reddit r/LocalLLaMA ↗ · 2026-06-30

一位开发者认为,AI模型周围的框架(评审、脚手架)比模型本身更重要,并分享了一个例子:一个27B模型在优秀评审的帮助下变得可用于编码工作。

0 人收藏 0 人点赞
#scaffolding

自压缩语言模型代理

Hugging Face Daily Papers ↗ · 2026-06-22 缓存

SelfCompact是一种脚手架方法,让语言模型自主决定何时以及如何压缩长智能体轨迹,相比固定间隔方法,在减少token成本的同时实现了更好的性能。

0 人收藏 0 人点赞
#scaffolding

大多数公司的人工智能问题不在于模型

Reddit r/artificial ↗ · 2026-06-18

一项分析指出,公司在人工智能方面失败的原因在于它们专注于模型,而非基础层——流程设计、治理、知识架构、人工判断和反馈循环——而这些才是真正的价值来源。文章引用了纳德拉的“令牌资本”概念、苹果可切换模型的Siri,以及显示战略与执行之间存在巨大差距的调查数据。

0 人收藏 0 人点赞
#scaffolding

探索共享工作空间中的人机协同

arXiv cs.AI ↗ · 2026-06-18 缓存

本文研究了共享工作空间中的人机团队协调,使用Collaborative Gym和DiscoveryBench任务,发现如果没有适当的结构,增加协作者可能会降低性能。通过共享组记忆和人在回路门控进行支撑,可以提升性能,尤其是在三人团队中。

0 人收藏 0 人点赞
#scaffolding

@rohanpaul_ai: 这篇论文展示了一种人工智能通过重写其设置并更新其模型来更好地自我改进。问题是,大部分…

X AI KOLs Following ↗ · 2026-06-11 缓存

本文介绍了SIA,一种自我改进的AI循环,它结合了脚手架重写和权重更新(通过LoRA)以提升任务性能。在三个不同的任务上测试,它优于仅使用脚手架改进的设置。

0 人收藏 0 人点赞
#scaffolding

我构建了一个推理时认知框架,可将连贯的LLM线程扩展到32.5万至100万token。以下是其工作原理。

Reddit r/artificial ↗ · 2026-06-05

一位独立研究者引入了Epistemic Lattice Tethering(ELT),这是一种推理时脚手架框架,通过应用认知和本体治理,将连贯的LLM线程扩展到32.5万至100万token。

0 人收藏 0 人点赞
#scaffolding

Harness、Scaffold 以及值得厘清的 AI Agent 术语

Hugging Face Blog ↗ · 2026-05-25 缓存

这是一篇 Hugging Face 博客文章,旨在定义并厘清 AI Agent 领域的关键术语,如 scaffolding、harness、context engineering 和 tool use,力求在快速演进中实现词汇标准化。

0 人收藏 0 人点赞
#scaffolding

@aiDotEngineer: Most agents die after a few seconds. @AnthropicAI's workshop shows how to build agents that run for hours. full 75-min …

X AI KOLs Following ↗ · 2026-05-23 缓存

Anthropic 应用AI团队在研讨会上分享了如何构建能持续运行数小时的智能体,核心在于上下文管理、规划与自我验证,以及模型与配套工具的共同演进。

0 人收藏 0 人点赞
#scaffolding

@wsl8297: 经常从 0 起项目的人,Better-Fullstack 可以少掉一大段重复搭架子的时间。 GitHub:https://github.com/Marve10s/Better-Fullstack… 官网:https://better-fu…

X AI KOLs Timeline ↗ · 2026-05-23 缓存

Better-Fullstack 是一款全栈项目脚手架工具,支持 TypeScript、Rust、Python、Go、Java 五种生态,450+ 工具组合,通过 CLI 或网页构建器快速生成即用项目骨架。

1 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈