但是,大语言模型(Large Language Model,LLM)的出现改变了这一切。
我们的Agent在执行接口回归时,每跑完一批用例,都要等我确认"可以继续"才能跑下一批。理由是"怕它做错决定"。结果一套两千条用例的回归,本来可以一小时跑完,因...
这些记录,是真实探索过程的产物:混杂着疑问、感受、未确认的发现、需要跟进的线索。它们很有价值——这是人工探索最难被自动化替代的部分,是经验和直觉的结晶。
从生成测试代码,到操作浏览器执行流程,Codex 这类 AI Agent 已经能够参与越来越多测试环节。很多人开始思考:既然 AI 已经可以自己写测试、跑流程,...
在DevOps和CI/CD成为标配的今天,软件迭代的速度早已从“月”级压缩到“天”级甚至“小时”级。然而,测试团队依然被困在一个尴尬的处境里——需求变更频繁、用...
最近半年,我所在的技术群里,关于“AI写测试用例”的讨论翻了十倍不止。不是因为这东西新鲜,而是因为越来越多人发现——自己花一整天写的用例,工具30秒就吐出来了,...
去年双十一大促封网前夜,一位在拼多多做测试的朋友发了条朋友圈:“终于不用再通宵等回归结果了。”
随着工业产品智能化水平的不断提高,日常生活生活中智能设备普及率也越来越高,嵌入式软件市场也越来越大。
行业统计,数据污染占 Flaky Test 成因的 60% 以上——这是接口自动化"随机失败"的头号元凶。
本文我们依据 GB/T 25000.51-2016《系统与软件工程 系统与软件质量要求和评价(SQuaRE) 第 51 部分:就绪可用软件产品(RUSP)的质量...
2.请详细描述静态测试和动态测试的概念、基本方法与技术实现,并对二者在缺陷发现方面的能力进行比较说明。
Allure 最强大的地方在于它深度集成了 BDD(行为驱动开发)的概念。通过这三个装饰器,可以将数千条用例构建成一个清晰的“金字塔结构”:
做性能测试这些年,我发现一个很普遍的现象:大部分团队拿到性能测试报告,第一眼看TPS,第二眼看响应时间,第三眼看错误率,然后就没了。指标一达标,皆大欢喜,上线走...