首页
学习
活动
专区
圈层
工具
发布
首页标签测试开发

#测试开发

Playwright ARIA Snapshot:AI 写的页面,怎么测语义没变?

霍格沃兹-测试开发学社

关键词:Playwright ARIA Snapshot、AI Coding、UI 自动化测试、可访问性树、语义回归

800

AI 接口全是 200,为什么订单还是被多退了一次?

霍格沃兹-测试开发学社

很多 AI 项目上线前,接口回归是绿的,演示也顺利。可一到真实用户手里,还是出了事:同一笔售后申请因为网络重试被处理两次,客服看到两条退款单,订单系统的库存也被...

900

公司从零开始推自动化测试,如何落地?

测试开发技术

「我们团队之前一直是手工测试,现在老板要求转型自动化,但大家都没经验,不知道从哪下手。」

2300

测试Skill开发三步走:SKILL.md + scripts + references实战指南

霍格沃兹-测试开发学社

上个月,团队来了个新项目。测试新人小陈接了个“订单取消功能”的用例设计任务,按以往的经验,这活儿至少3天。

3000

4个Agent Skill覆盖所有测试用例设计场景:一套组合拳打天下

霍格沃兹-测试开发学社

上个月,团队接了个电商购物车模块的改版项目。需求文档不复杂,大概十来页。测试组长看了一眼排期,皱了下眉:“按以前的节奏,光写用例就得3天。”

5800

DeepSeek Harness + 知识图谱:企业测试团队,正在长出一支“质量 FDE”

霍格沃兹-测试开发学社

很多企业做完 AI Agent Demo 后,才遇到真正难的问题:为什么它给出了一条错误报价?它看过哪些资料?调用了哪个工具?这次变更究竟该回归哪些场景?

4700

AI 一次改几十个文件,测试怎么决定回归范围?

霍格沃兹-测试开发学社

周五傍晚,研发把一个 PR 丢进群里:“AI 辅助改完了优惠计算逻辑,47 个文件,单测全绿,麻烦测一下。”

3700

DeepSeek Harness 不是测试工具:它会把 AI 测试推进到“验轨迹”的阶段

霍格沃兹-测试开发学社

回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用...

5100

别再只会 assertEquals 了:AI 测试开发要补的 4 个 Skill——LLM 评测、RAG、Agent、MCP

霍格沃兹-测试开发学社

他们团队三月份接了个大模型,做了个"智能客服 + 内部知识库问答"。上线前老板把验收的活儿丢给他:"你给这套 AI 功能出个测试方案。"他愣是卡了两天写不出来—...

11410

为什么团队用了 AI 之后,测试质量反而下降了!

测试开发技术

这位老哥是认真做过团队实践的,观察写得很扎实。提测质量肉眼可见地下滑,需求做漏了,单位时间里测试捞出来的 bug 反而变多,最后测试团队加了 23% 的人,还是...

10810

AI开始自己改Harness了,企业测试平台为什么必须跟着升级?

霍格沃兹-测试开发学社

JIT-Agent 这类思路正在尝试让 AI 针对具体任务动态生成 Harness,执行失败后自动 Repair,再根据历史 Evaluation 结果继续 E...

12110

DeepSeek V4-Flash-Vision-Exp上线:UI自动化终于“长眼睛”了?

霍格沃兹-测试开发学社

它很擅长判断“元素在不在、能不能点”,却不一定知道“用户最终看到的页面到底对不对”。

15200

Agent 上线前,谁来回答“它安全吗”?拆解 Agent Assurance 的三层设计

霍格沃兹-测试开发学社

最近TestMu AI推出的Agent Assurance,恰好把这个问题摆到了台面上。

15710

AI 写了 30 页,人只看 3 行:我们可能正在进入「文档通胀」时代

蔡金伟

🤖 AI 让内容生成越来越便宜,但人的注意力没有同步变多 当“写”几乎没有成本以后,真正稀缺的,开始变成判断、验证和压缩

9900
领券