software-testing

标签

Cards List
#software-testing

面向分布式并行AI程序验证的定向神经符号随机执行

arXiv cs.AI · 19小时前 缓存

本文提出了DNSSE,一种混合框架,结合了基于LLM的调度预测、符号约束求解和覆盖引导的随机变异,用于验证分布式并行AI程序。它在现实基准上检测到的并发缺陷数量是基线的2.9倍,并将分支覆盖率从68.6%提高到91.6%。

0 人收藏 0 人点赞
#software-testing

MetaSpace:具身智能体中空间认知的蜕变测试

arXiv cs.AI · 19小时前 缓存

MetaSpace 是一个框架,应用蜕变测试来评估具身智能体的空间认知能力,从执行轨迹中生成测试用例,并将逻辑/物理约束编码为 Prolog 规则。基准测试表明,最先进的 MLLM 驱动的智能体在空间认知上的得分远低于人类水平,其中方向性任务尤为薄弱。

0 人收藏 0 人点赞
#software-testing

@no_stp_on_snek: 实地笔记:AI与QA 将一个代理指向我的测试套件,只问一个问题。不是“测试通过了吗。” 这个测试能不能检测出它存在所要捕获的那个bug…

X AI KOLs Following · 3天前 缓存

一篇实地笔记认为,全绿的测试套件并不能证明测试是有意义的;应该让AI代理尝试让测试失败,以验证它们确实能捕获bug。

0 人收藏 0 人点赞
#software-testing

@freeCodeCamp:测试是帮助你在发布新功能后保持软件可靠性的关键。在本课程中,Beau 将教你软件…

X AI KOLs Timeline · 2026-07-31 缓存

freeCodeCamp 宣布推出一个关于使用 Playwright 进行软件测试的综合课程,涵盖测试金字塔、TDD、API 测试等基础知识,以及像 KaneAI 这样的 AI 驱动工具。

0 人收藏 0 人点赞
#software-testing

在Raft实现中发现Bug

Lobsters Hottest · 2026-07-27 缓存

Antithesis发布了一篇博客文章,详细介绍了在多个开源Raft共识实现(包括HashiCorp Raft和OpenRaft)中发现的Bug,强调了测试分布式系统的困难以及对更好工具的需求。

0 人收藏 0 人点赞
#software-testing

高效的云端确定性仿真

Lobsters Hottest · 2026-07-13 缓存

Antithesis 描述了其定制的确定性虚拟机监控器和子树去重技术,用于在云规模上进行高效、可重复的全系统模糊测试。

0 人收藏 0 人点赞
#software-testing

我探索所有Tetris的旅程

Lobsters Hottest · 2026-07-02 缓存

来自Antithesis的一篇详细博客文章,描述了他们的软件测试工具如何用于探索并实现Tetris中的‘重生’(达到255级),在此过程中克服挑战并发现故障。

0 人收藏 0 人点赞
#software-testing

软件质量新时代今日开启(5分钟阅读)

TLDR AI · 2026-06-24 缓存

Momentic 宣布重大平台更新,推出基于AI的知识库和自主测试代理,以应对代码速度与软件质量之间日益扩大的差距。

0 人收藏 0 人点赞
#software-testing

@gabriel1: 每个 PR 显然都会附带 100% 覆盖率的 AI 应用测试,测试界面中的每个按钮以确保其正常工作……

X AI KOLs Following · 2026-06-23 缓存

一条推文认为,AI 应用测试应成为编码应用的一流功能,并指出如果让 AI 自行尝试应用,许多明显问题都可以被发现。

0 人收藏 0 人点赞
#software-testing

@gdb: 使用codex测试你应用中的每一个功能:

X AI KOLs Following · 2026-06-21 缓存

使用Codex通过生成用户故事并在迭代循环中在电子表格中跟踪功能状态,来自动化应用测试。

0 人收藏 0 人点赞
#software-testing

@GergelyOrosz: 我越来越多地使用Antithesis(@AntithesisHQ - 本期播客的呈现赞助商),以更深入地了解他们如何进行确定性测试来发现缺陷。

X AI KOLs Following · 2026-06-12 缓存

Gergely Orosz 分享了他使用 Antithesis 的经验,这是一个确定性测试基础设施,可以在几分钟内完成数小时的测试。

0 人收藏 0 人点赞
#software-testing

你的AI代理绿色测试套件实际证明了什么

Reddit r/AI_Agents · 2026-06-10

本文认为,由于输入空间无限且行为非确定性,AI代理使用固定输入和预期输出的标准测试套件并不充分,主张应采用基于属性的测试方法。

0 人收藏 0 人点赞
#software-testing

软件测试的新时代

Hacker News Top · 2026-06-07 缓存

这篇文章讨论了使用LLM作为自动化QA工程师来执行手动测试任务,如集成测试和回归测试,有可能提高软件质量门槛。

0 人收藏 0 人点赞
#software-testing

我的智能体技能:测试驱动开发

Hacker News Top · 2026-06-04 缓存

作者分享了一项适用于AI智能体的测试驱动开发技能,旨在改进测试编写,基于Kent Beck的Canon TDD,并提供了GitHub链接。

0 人收藏 0 人点赞
#software-testing

我测试了Sage的长期记忆,结果让我惊喜!

Reddit r/AI_Agents · 2026-06-01

作者测试了Persistent Sage的长期记忆功能,发现它能够准确地回忆起一周前告知的个人事实,如色盲和配偶的名字,而无需明确提示,展示了AI智能体的有效持久记忆。

0 人收藏 0 人点赞
#software-testing

@yihui_indie: 我离开职场太久了,我现在很好奇大厂里面 QA 的工作,还是和以前的工作流模式一样吗?就是测出一个 bug 之后给 RD 提 ticket。 因为我发现我现在在给研发提 bug 的时候,其实提的这个 bug 本身就是给 AI 的提示词,我觉…

X AI KOLs Following · 2026-05-30 缓存

作者离开职场后,好奇大厂QA的工作流是否仍是测出bug后提ticket,并认为提bug本身可视为给AI的提示词,不如直接让AI修改代码。

0 人收藏 0 人点赞
#software-testing

假设弱化性质

Hillel Wayne — Computer Things · 2026-05-20 缓存

本文探讨了为什么在规范或测试中添加假设会从逻辑上弱化所得性质,使用了逻辑蕴含以及来自形式化方法和 Rust 的示例。此外,还讨论了尽管存在这种弱化,仍使用假设的实际原因。

0 人收藏 0 人点赞
#software-testing

@RayFernando1337: 你可以用这个提示教 Composer 2.5 成为你团队中非常出色的QA工程师:"继续创建一个QA部…

X AI KOLs Following · 2026-05-20 缓存

一条推文分享了一个提示,将 Composer 2.5 配置为QA工程师,为开发阶段创建测试文档和错误报告。

0 人收藏 0 人点赞
#software-testing

@Suryanshti777: 每个移动团队都即将意识到应用测试一直以来有多么糟糕。有人将Claude Code连接到了…

X AI KOLs Timeline · 2026-05-16 缓存

一位开发者将Claude Code连接到iPhone模拟器,并提示它“测试一切”,结果实现了自主导航、漏洞检测和结构化报告,展示了从传统测试脚本到AI驱动的意图测试的转变。

0 人收藏 0 人点赞
#software-testing

一个简单的运行时不变量挖掘器

Lobsters Hottest · 2026-05-14 缓存

本文用Python实现了一个Daikon风格的运行时不变量挖掘器,包括插桩、轨迹收集、候选不变量检查以及基于蕴含的抑制,为回归测试提供了一个近似预言。

0 人收藏 0 人点赞
Next →
← 返回首页

提交意见反馈