agentic-coding

标签

Cards List
#agentic-coding

DeepReinforce 发布 Ornith-1.0 开源编程模型(2分钟阅读)

TLDR AI · 2026-06-26 缓存

DeepReinforce 开源了 Ornith-1.0,这是一系列自我改进的编程模型,参数从 9B 到 397B 不等,基于 Gemma 4 和 Qwen 3.5 基础模型训练,采用了一种新颖的强化学习方法,能够学习生成自己的脚手架。

0 人收藏 0 人点赞
#agentic-coding

@morganlinton: https://x.com/morganlinton/status/2069794086220116452

X AI KOLs Timeline · 2026-06-24 缓存

一位首席技术官分享了关于自主编码工作流中执行层不足的见解,将这一概念追溯至1975年,并讨论了现代模型的选择。

0 人收藏 0 人点赞
#agentic-coding

Off Autopilot

Product Hunt · 2026-06-23

Off Autopilot 是一个由人类编写的关于代理编码的文章精选集,可在 ProductHunt 上获取。

0 人收藏 0 人点赞
#agentic-coding

@hooeem: https://x.com/hooeem/status/2068752941553476002

X AI KOLs Timeline · 2026-06-21 缓存

一份全面指南,介绍如何部署 GLM 5.2(一款自称在编程基准测试中超越 GPT-5.5 且成本更低的开源 AI 模型),涵盖云端和本地部署方案。

0 人收藏 0 人点赞
#agentic-coding

deepreinforce-ai/Ornith-1.0-9B

Hugging Face Models Trending · 2026-06-21 缓存

deepreinforce-ai 发布了 Ornith-1.0,一个开源编码代理模型系列,在编码基准测试上实现了最先进的性能,提供从 9B 到 397B 的参数规模,采用自我改进训练框架和 MIT 许可证。

0 人收藏 0 人点赞
#agentic-coding

Laguna by Poolside

Product Hunt · 2026-06-20

Poolside 推出了 Laguna,这是一个用于智能体编程和长期任务的基座模型。

0 人收藏 0 人点赞
#agentic-coding

North Mini Code 更新:4位量化 + Ollama + OpenRouter

Reddit r/LocalLLaMA · 2026-06-18 缓存

Cohere 发布 North Mini Code,一个30B-A3B开源权重模型,采用4位量化,用于代码生成和智能体编码任务,支持256K上下文。

0 人收藏 0 人点赞
#agentic-coding

校准用于智能体编码任务的2位GGUF量化(<10Gb)

Reddit r/LocalLLaMA · 2026-06-18

本文介绍Qwopus3.6-27B-Coder模型的校准2位GGUF量化版本,用于智能体编码任务。实验表明,IQ2_M量化(9.74 GiB)在SWE-rebench基准测试中达到63%的通过率,与Q5_K_M量化相当,但模型大小仅为其一半。

0 人收藏 0 人点赞
#agentic-coding

@Yonah_x: 我也推荐一下,最近经常用,grill me经常拷问我十几轮,应该是我用过的brainstorm类技能问的最多最细的了。我原本以为技能描述应该会很复杂,但看完发现字数短的不可思议,我愿称之为编程界的李继刚。把技能写长很简单,把技能写短可不容…

X AI KOLs Timeline · 2026-06-18 缓存

推荐了 @mattpocockuk 发布的 agentic coding skills 套件 v1.0.0,其中包含“grill me”技能,能进行多轮细致提问,被认为在编程技能描述上极为精炼。

0 人收藏 0 人点赞
#agentic-coding

@yibie: 本地模型做主力编码工具:2026 年中的实战报告 Hacker News 上有一个帖子,标题很直接:"有人用本地模型做主力编码工具吗?" 197 条评论,信息密度极高。十几个真实用户在讨论他们每天用的配置、踩过的坑、以及为什么明明知道本地…

X AI KOLs Timeline · 2026-06-18 缓存

本文总结了Hacker News讨论中关于使用本地模型(主要是Qwen 3.6 35B-A3B)作为主力编码工具的实战经验,包括配置、效果(约为前沿模型的50-75%)、关键技巧(如preserve_thinking)和不同用户的立场。

0 人收藏 0 人点赞
#agentic-coding

@dexhorthy: 在HumanLayer,我们致力于解决AI劣质代码问题。2025年,我们开源了Research, Plan, Implement…

X AI KOLs Following · 2026-06-17 缓存

HumanLayer推出了一个Agentic IDE和协作平台,使工程师能够在整个SDLC中提速2-3倍,同时保持严格的代码质量,已被Block、Uber等财富500强公司使用。

0 人收藏 0 人点赞
#agentic-coding

@_philschmid:"但借助 Google 最新发布的 Gemma 4 系列,我终于能够在本地进行自主编码,并且循环的准确率/速度达到前沿模型的约 75%,这太不可思议了。"

X AI KOLs Following · 2026-06-17 缓存

Phil Schmid 指出,Google 的 Gemma 4 模型支持本地自主编码,准确率/速度约为前沿模型的 75%,并引用了 Vicki Boykis 的文章。

0 人收藏 0 人点赞
#agentic-coding

@AnthropicAI:我们的最新经济研究引入了一个框架,用于跟踪Claude Code的扩展情况。谁在使用Claude Code,以及…

X AI KOLs · 2026-06-16 缓存

Anthropic的最新经济研究分析了约40万次Claude Code会话,发现对于成功的代理编码,领域专业知识比编码技能更重要,并且任务价值在七个月内增加了约25%。

0 人收藏 0 人点赞
#agentic-coding

@KyleHessling1: Qwopus Coder 在这里领跑!就连我旧的18B frankenmerge 在这个评测中也稳居第四,超越了许多更新更大的模型……

X AI KOLs Timeline · 2026-06-16 缓存

一条推文讨论了基准测试结果,其中 Qwopus Coder 位居榜首,而 Cohere 的 North-Mini-Code-1.0 在代理工具调用排行榜上垫底,显示出小模型的惊人结果。

0 人收藏 0 人点赞
#agentic-coding

小米新开源、智能体式AI编码工具MiMo Code在超长200+步骤任务中击败Claude Code(14分钟阅读)

TLDR AI · 2026-06-12 缓存

小米开源了MiMo Code,一款采用新颖记忆架构的AI编码助手,在长期任务上表现优于Claude Code,并免费提供MiMo-V2.5模型。

0 人收藏 0 人点赞
#agentic-coding

形式化方法与编程的未来

Lobsters Hottest · 2026-06-11 缓存

Jane Street,此前对形式化方法持怀疑态度,现宣布转变观点,计划组建专注于形式化方法的团队。这一转变源于代理编程(agentic coding)的出现,它通过降低验证成本并增加对可靠代码的需求,改变了成本/效益计算。

0 人收藏 0 人点赞
#agentic-coding

@paulg: 有趣。人工智能实际上将增加对形式化方法的需求和供给。你更需要它们,但你也拥有…

X AI KOLs Following · 2026-06-11 缓存

Jane Street,此前对形式化方法持怀疑态度,现在正在组建团队使用它们,这得益于人工智能和智能体式编码,它们降低了成本并增加了软件验证的收益。

0 人收藏 0 人点赞
#agentic-coding

Claude Desktop 启动虚拟机且无法停止

Hacker News Top · 2026-06-10 缓存

Claude Code 是 Anthropic 推出的一款终端中的智能编码工具,它能理解你的代码库,通过自然语言命令执行日常任务、解释复杂代码以及处理 git 工作流程,从而帮助你更快地编写代码。

0 人收藏 0 人点赞
#agentic-coding

@_avichawla: 我仅凭一项改动就将Fable 5的token用量降低了2.5倍! - 之前:5.5 M tokens · 7 errors · $8.94 - 之后:2.3 M tokens · …

X AI KOLs Timeline · 2026-06-10 缓存

作者通过从Firebase切换到InsForge(一个用于智能体编程的开源后端平台),将AI智能体的token用量降低了2.5倍,token数从550万降至230万,并消除了人工干预。

0 人收藏 0 人点赞
#agentic-coding

qwopus 与 qwen3.6 27b 相比有多实用

Reddit r/LocalLLaMA · 2026-06-10

用户询问社区关于 qwopus 与 qwen3.6 27b 实用性的看法,特别是在代理编码任务中的表现,报告了意见不一且个人测试中差异极小。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈