software-engineering

标签

Cards List
#software-engineering

@Pragmatic_Eng: 任何认为软件工程会‘消失’的人都不了解这份工作。@KentBeck,XP和TDD的创造者,关于…

X AI KOLs Following · 2026-07-02 缓存

Kent Beck认为,即使AI不断进步,软件工程也不会消失,因为编码涉及建立信任、理解和联系,而这些是无法自动化的。

0 人收藏 0 人点赞
#software-engineering

许多人误解了代码评审的目的

Hacker News Top · 2026-07-02

该文章讨论了软件开发中关于代码评审真实目的的常见误解,强调其更多是关于知识共享和团队协作,而不仅仅是发现错误。

0 人收藏 0 人点赞
#software-engineering

@lidangzzz: 我这些年反复讲过,让AI Agent好好写代码,所有的秘诀都写在了1990年代的教材里: - 踏踏实实写test,多写test,让test coverage尽可能高 - 认真做好CI/CD,千方百计避免messed up - 对于一个新项…

X AI KOLs Timeline · 2026-07-02 缓存

作者强调让AI Agent写好代码的关键在于遵循1990年代教材中的经典软件工程实践:写测试、做好CI/CD、进行自顶向下设计和模块化解耦等。

0 人收藏 0 人点赞
#software-engineering

AI编码代理的护栏到底该放在哪里?

Reddit r/AI_Agents · 2026-07-02

关于在何处设置护栏以防止AI编码代理进行未经授权的更改的讨论,探讨部署工作流各个阶段的摩擦点。

0 人收藏 0 人点赞
#software-engineering

Senior SWE-Bench:评估作为高级工程师的AI代理的开源基准

Hacker News Top · 2026-07-02 缓存

Senior SWE-Bench 是一个开源基准,用于评估AI代理在需要高级技能的软件工程任务上的表现。

0 人收藏 0 人点赞
#software-engineering

@sujingshen: https://x.com/sujingshen/status/2072497223850668513

X AI KOLs Timeline · 2026-07-02 缓存

批评Vibe Coding风格,指出自然语言需求的不精确性导致AI Agent产出需要大量返工,提倡spec-driven development以确保安全性和生产质量。

0 人收藏 0 人点赞
#software-engineering

Senior SWE Bench:一个专注于现实未充分指定功能任务的新基准测试

Reddit r/LocalLLaMA · 2026-07-01 缓存

Senior SWE-Bench 是一个新的开源基准测试,旨在评估 AI 智能体在现实、未充分指定的软件工程任务上的表现,强调意图对齐和代码质量等技能,而非过于详细的规范。

0 人收藏 0 人点赞
#software-engineering

@GergelyOrosz:像@KentBeck这样对软件工程行业产生影响的人寥寥无几。他此前从未完整讲述过自己的经历……

X AI KOLs Timeline · 2026-07-01 缓存

一档播客访谈中,Kent Beck讲述了他的职业生涯,从早期编程到敏捷开发和测试驱动开发,强调了软件工程中人类技能的重要性。

0 人收藏 0 人点赞
#software-engineering

SWE-rebench 排行榜更新:GLM-5.2、Qwen3.6-27B、Qwen3.6-35B-A3B、Gemma 4 31B 等新模型 + 改进的 UI

Reddit r/LocalLLaMA · 2026-07-01 缓存

SWE-rebench 排行榜已更新,新增了 GLM-5.2、Qwen3.6、Gemma 4 31B 等模型,并改进了 UI,展示了软件工程任务上的性能排名。

0 人收藏 0 人点赞
#software-engineering

AI会取代开发者吗?

Reddit r/AI_Agents · 2026-07-01

探讨AI是否会最终取代人类软件开发者这一争论,分析当前能力和未来趋势。

0 人收藏 0 人点赞
#software-engineering

LLM编码时代的软件工程最佳实践

Reddit r/LocalLLaMA · 2026-07-01

一篇讨论软件工程最佳实践如何随着LLM编码工具的整合而发展的文章,为开发者提供指导。

0 人收藏 0 人点赞
#software-engineering

信任你的编译器:现代C++

Hacker News Top · 2026-07-01 缓存

本文对比了旧的C++性能技巧与现代编译器的能力,表明编译器现在能够将朴素代码优化得比手工调整的技巧更好。包含在AMD Zen 5上使用Clang 21的基准测试。

0 人收藏 0 人点赞
#software-engineering

ORM教会我的:直接学SQL (2014)

Hacker News Top · 2026-07-01 缓存

作者认为ORM弊大于利,开发者应直接学习SQL,以避免属性蔓延和低效查询等问题。

0 人收藏 0 人点赞
#software-engineering

大型语言模型在浮点错误分类上的基准测试

arXiv cs.AI · 2026-07-01 缓存

本文介绍了InterFLOPBench,这是一个用于评估LLM在C代码中检测浮点错误的基准测试,发现最近的模型取得了较高的F1分数,但性能因错误类型而异。

0 人收藏 0 人点赞
#software-engineering

@GergelyOrosz:明天 - 与传奇人物 @KentBeck

X AI KOLs Following · 2026-07-01 缓存

Gergely Orosz 宣布明天将与 Kent Beck 举办一场活动。

0 人收藏 0 人点赞
#software-engineering

性能优化基准是否可靠地衡量编码代理?

Hugging Face Daily Papers · 2026-07-01 缓存

本文审计了针对编码代理的三个性能优化基准(GSO、SWE-Perf、SWE-efficiency),发现运行时不稳定、评分规则和任务覆盖率显著影响可靠性,并且许多任务已经至少有一个公开提交解决了。

0 人收藏 0 人点赞
#software-engineering

@omarsar0: 如果你使用MCP构建,这篇值得一读。(收藏它)论文涵盖了五个反复出现的MCP服务器模式……

X AI KOLs Following · 2026-06-30 缓存

本文对在十五个独立开发的服务器中观察到的五个反复出现的MCP服务器架构模式进行了分类,提供了一个包含上下文、问题、解决方案和后果的分类法。还记录了反模式、横切关注点以及定量评估,包括评分者间信度和传输开销。

0 人收藏 0 人点赞
#software-engineering

ScarfBench: 面向企业级Java框架迁移的AI智能体基准测试

Hugging Face Blog · 2026-06-30 缓存

IBM Research 推出 ScarfBench,这是一个用于评估AI智能体在跨框架Java迁移任务中表现的开放基准测试,重点关注 Spring、Jakarta EE 和 Quarkus。与传统的代码生成基准不同,该基准主要评估迁移后的应用程序是否能够构建、部署并保持原有行为。

0 人收藏 0 人点赞
#software-engineering

@MaximeRivest: 这是一场非常精彩的演讲。真的说到点子上了。如果你从事科技行业,你应该都去看一看。…

X AI KOLs Following · 2026-06-30 缓存

一条推文推荐观看Angie Jones关于构建AI代理的主题演讲,强调了核心工程原则,并提到了Python框架如DSPy、Functai和Mirascope。

0 人收藏 0 人点赞
#software-engineering

局部推理保证全局属性

Lobsters Hottest · 2026-06-30 缓存

本文探讨了AI代码生成在局部代码块方面表现出色,但在全局程序理解方面存在困难,导致过多的防御性检查。它考察了编程语言设计是否能有所帮助,并通过一个局部推理保证全局属性的例子进行说明。

0 人收藏 0 人点赞
← Previous
Next →
← 返回首页

提交意见反馈