AI 时代,为什么回归测试反而更重要了?
我有一个暴论,在AI时代,回归测试将变得越来越重要。 最近发现AI经常出现改一个问题,送几个bug情况。仔细分析一下,几个项目里都出现了类似的情形。 A项目中AI增加了一个字段,却误判了老字段的影响的范围,将之前的字段默认值重置了,导致了线上的旧版本出现了严重的问题;B项目里AI修改了一个小问题,却没有考虑到对其他功能的影响,也产生了一些线上缺陷。 因为这些 …
关于 AI、软件测试与研发效能的观察与实践。
164 篇内容我有一个暴论,在AI时代,回归测试将变得越来越重要。 最近发现AI经常出现改一个问题,送几个bug情况。仔细分析一下,几个项目里都出现了类似的情形。 A项目中AI增加了一个字段,却误判了老字段的影响的范围,将之前的字段默认值重置了,导致了线上的旧版本出现了严重的问题;B项目里AI修改了一个小问题,却没有考虑到对其他功能的影响,也产生了一些线上缺陷。 因为这些 …
测试不会消失,反而越来越重要,可能以后的AI开发团队,人人都是测试
最近两个月高强度的使用AI进行了一些跟测试相关工作的探索,从之前大火的openclaw到hermes,从claude code到opencode再到codex,从各种国内模型到sunnet再到gpt5.5,感觉上是一日不见如隔三秋,两个月的时间变化相当迅速。 昨天同国内的某团队进行了一次关于ai在研发过程中使用的交流,发现大家所处的阶段以及遇到的问题都差不 …
最近一直在思考如何在测试过程中使用openclaw等AI agent工具来提升测试效率。 直接用AI写用例一直是各个大厂关注的重点,各家也有了一定的突破,可以预见在不久的将来,一些通用用例的编写和执行是可以交给AI去完成的。 不过复杂业务场景下的用例编写和执行还是需要人工参与比较好。 这是因为 AI对复杂业务场景的理解可能不如测试领域的业务专家; 测试策略的 …
爬虫之路,道阻且长,Scrapling在目前可能是一个比较合适的选择。
我最近用 opencode 搭建了一个完整的应用。 整个过程中,我大部分的精力其实都在做3件事情。 像产品经理一样设计功能和交互 像测试人员一样验证产品的功能及交互 不停的发现bug,提出缺陷,然后跟AI一起配合修复问题 这么反复循环了几次之后,我最终意识到:AI极大地降低了实现的门槛,却成倍放大了验证的难度和重要性。 用AI进行编码,实现代码确实是唾手可得 …
openclaw升级之后会出现一些问题
openclaw的各种配置
这几天clawdbot的改名风波闹的沸沸扬扬。 从clawdbot到moltbot再到openclaw,一周装了我3个版本,搞得我都有点精神分裂了。 两个月前,clawdbot的作者peter花了一个周末搞了个叫“WhatsApp Relay”的小项目,结果现在GitHub星标破10万,一周内吸引了200万访问者。完全超出预期。 今天peter正式宣布:这个 …
本期内容再次印证了软件测试行业正在经历的深刻变革。从传统的手工测试向智能化测试转变,从技术层面的优化到文化层面的重塑,我们看到测试工程师们不仅要掌握新兴的 AI 工具,更需要具备战略思维和质量意识的深度转变。 特别值得注意的是,本期多篇文章都在强调"文化"而非"技术"才是测试面临的真正挑战。这提醒我们,在关注技术进步的同时,不应忽视团队协作、质量理念和战略思 …
2025 年已经过去一半了,这半年里,ai 与测试工具的结合有了不少进展。 今天我们就一起来盘点一下。 一个零配置的工具,只需指向你的网站或应用,AI 便可自动生成并执行测试。非常适合需要快速反馈循环而不依赖繁琐脚本的场景。 项目地址: https://github.com/antiwork/shortest 基于自然语言的端到端(E2E) …
在一个已有开发节奏的团队中,作为第一位测试人员去推行新流程,绝非易事。 你会被开发质疑:是不是要拖慢上线进度?是不是要卡死流程,让整个开发团队都不爽? 这些成见不是你的错,但你必须面对它们。 之前介绍过一款新的 ui 自动化测试工具—-pydoll。 今天抽空在 github 的 copilot 的帮助下试用了一下。 我用 pydoll 实现了一个测试任务列 …
在 Google 早期,测试并不是首要任务。公司文化高度依赖工程师的才华——聪明的人写聪明的代码。大多数情况下,这种方式都很有效。少数系统部署了集成测试,但广泛的、结构化的测试极其罕见。这就像软件开发的"狂野西部"时代。 在 Google 早期,测试并不是首要任务。公司文化高度依赖工程师的才华——聪明的人写聪明的代码。大多数情况下,这种方式都很有效。少数系统 …
马上就到端午假期了。 今天在电梯听到两位女士的对话,大概的意思是一位认为只有一天的假期有点不太过瘾,而另一位觉得假期归来以后上 4 休 2 已经是非常划算了。 反正我是同意后者的。 前些天 deepseek 发布了新模型,该模型在代码能力上有了较大的提升。 有人尝试之后表示模型不仅可以正确实现编码需求,还可以在生成代码的同时给出完整的单元测试用例。 今后将有 …
五一假期结束了。 这次五一完美的错峰出行。 核心的原因是起的早。 天刚亮就出发,第一波到达景区,人流汹涌的时候就回酒店休息。 世间的喧闹与我无关。 这大概是一种错位竞争吧。 比如,当测试都在千军万马涌入新领域的时候,业务在原有的业务上进行深耕反而会取得一些错位竞争的优势。 …
离五一只有两周了。 最近有朋友买了 cursor 的会员,我驻足观看了一番。 他先描述需求,然后让大模型生成原型,接着又让 LLM 根据原型来生成前后端项目的代码。 整体流程一气呵成,看着非常有科幻感。 不难想象,接下来根据可以工作的前后端代码就可以让大模型来生成 ui 和接口的自动化测试用例。 不久的将来,通过 AI 生成的各种测试代码可能会是开发标准输出 …
清明过后似乎会更加期待劳动节一些。 今年五一放五天假,时间是充裕的,但想到各大景点的人山人海,可能最终还是会选择躲在家里吧。 看看书,在附近活动活动,陪陪家人,安静的时光就足够了吧。 最近在读一本关于二战时期太平洋战争的书,里面一些细节很有意思。 比如美军在珍珠港被空袭之后大概一年的时间里,一直在边打仗边学习。 因为美军中大部分将军和士兵都没有经历过真正的战 …
看到一篇讨论质量指标的文章。 文中描述了 3 个过时的不推荐继续使用的指标。 平心而论,作者认为这 3 个指标没什么用,这点我是完全赞同的。 本质就是这 3 个指标里有 2 个是过程指标,而不是结果指标。 过程指标只能说明你做了什么,而不能说明你做的好不好。 质量的结果指标是非常难去度量的,很多对结果指标的罗列只不是过隔靴搔痒而已。 所以作者的思路从度量结果 …
我个人认为,AI 一定会对软件测试甚至整个行业内的质量保障工作带来天翻地覆的影响。 但是现在,AI 对测试人员来说可能更接近工具一些。 正好看到一篇讨论类似内容的文章,随手用 AI 翻译了一下,供大家参考。 直到最近,关于 AI 在软件测试中的讨论仍存在两种极端观点。一方面,狂热者坚信 AI 将在一夜之间彻底改变质量保障(QA),实现所有测试自动化、预测所有 …
前几天马斯克发布了 Grok3。 简单试用了一下,有几点感想。 速度是真快。除了搜索之外,基本上大部分的问题都是秒回; 对中文的理解不错; 代码生成能力令人印象深刻; 因为只是简单的体验了一下,感触比较浅薄。 昨天看到 DHH 在社交媒体上谈论 Grok3。 他表示 Grok3 对他来说最重要的功能是处理测试代码。 这里可以简单的理解为使用 Grok3 进行 …