一、核心理念

AI探路,人工决策,代码回归。 分五阶段推进,每阶段评审通过才进入下一阶段,不跳步、不编造、不越权。

二、完整测试流程(五阶段)

阶段核心问题产出
系统探索产品实际上是什么样?页面事实、行为记录、未知缺口
业务梳理这些事实表达了什么业务?业务目标、流程、分支、风险
用例设计应该怎样验证这些风险?测试点 + 可执行场景
用例评审这份设计是否有资格执行?问题清单、返修方向、执行范围
真实执行系统实际上做了什么?执行记录、截图/video、PASS/FAIL

⚠️ 不能压缩成"帮我把网站测完"——跳过任一环节,结论都不可信。

三、浏览器控制工具

工具接入方式适用场景
Playwright-MCPMCP Server⭐课程主力。持续观察+推理+操作,保留登录态
Playwright-CLIShell+Skills独立干净浏览器,衔接Playwright生态
Agent-BrowserShell+SkillsVercel出品,自成体系

Playwright-MCP验证:

claude mcp list   # 看状态是否为Connected

四、系统探索

目的: 认识真实产品,减少幻觉。只回答:①真实有什么 ②不同角色能做什么 ③还不知道什么

探索顺序: 划定边界 → 建立地图 → 主动触发行为 → 边操作边记录 → 复核关键观察

四类主动行为:

行为类别找什么
主流程当前角色完成用户目标的正常路径
拦截与权限未登录或低权限角色怎样被阻止
空态与无数据没有业务数据时页面怎样表达
边界与异常特殊数据、状态限制、失败依赖

两条标记维度(分开记录,不混用):

主张类型含义证据状态含义
fact直接观察到的页面事实verified可复现,证据充分
inference根据观察形成的解释candidate有线索,需补充验证
question当前不能回答的问题blocked因权限/数据等无法继续
——contradicted与已有事实冲突

此阶段不生成用例,不把推断当规则。

五、业务梳理

目的: 把页面事实还原成"用户完成一件事的完整旅程"

四步走: 主线 → 分支 → 五类要素 → 风险

五类不能静默消失的测试要素: 字段、状态、权限、数据、环境

每条解释必须有来源,否则进"待确认清单"。

六、用例设计(八维覆盖)

测试点 ≠ 页面元素检查,测试点验证的是业务风险。

概念作用
测试点回答"哪些风险必须被验证"(细粒度)
场景回答"什么前置下,用一段完整操作验证"(聚合检查点)

八维覆盖(每个维度都核对,不机械生成8条):

正向、异常、边界、权限、状态、配置、数据一致性、网络与加载异常

确定性 vs 探索性场景:

类型预期写法
确定性客观、可观察的确定结果
探索性候选预期 + 验证路径,不包装成确定结论

每条场景必须闭合: 来源、角色、前置、操作、预期、清理、追溯全部明确。

七、用例评审(九面检查)

原则: 只评审不修改,问题指明返修方向,送回对应阶段。

评审面核心问题
需求追溯核心分支是否有场景,来源是否有效
预期正确性确定预期有证据,候选预期诚实标记
覆盖充分性八维/角色/高风险有无静默缺口
可执行性前置/账号/数据/步骤/清理是否具体
可观察性结果能否从页面/URL/状态判断
场景粒度与闭包会话/数据前置/清理责任是否闭合
去重目标/步骤/预期相同的是否合并
风险覆盖高/中风险和待确认项有无去向
证据诚实性推断/阻塞/未知是否冒充确定规则

返修路径: 事实不足→系统探索;业务有误→业务梳理;场景问题→用例设计。

八、用例执行

输入:测试用例 → 筛选P0 → Playwright执行 → 输出:截图/video/trace.zip + PASS/FAIL

📊 一图记全课

系统探索(页面事实)→ 业务梳理(用户旅程)→ 用例设计(测试点+场景)→ 评审(返修闭环)→ 执行(证据)
     ↓                    ↓                    ↓                   ↓                ↓
  fact/inference      主线+分支           八维覆盖            九面检查       截图/video
  +证据状态           +五类要素           +确定性/探索性       +返修路径       +PASS/FAIL

🎯 一句话总结

AI主导Web测试 = MCP控制浏览器 → 五阶段分步推进(探索/梳理/设计/评审/执行),每阶段有明确产出和评审标准,AI探路、人工决策、不跳步不编造,最终用页面证据裁决PASS/FAIL。

Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐