ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

Midscene.js AI自动化测试落地指南:设备接入到稳定夜跑的完整路径

Midscene.js AI自动化测试落地指南:设备接入到稳定夜跑的完整路径 Midscene.js AI自动化测试落地指南设备接入到稳定夜跑的完整路径【免费下载链接】midsceneGUI Agent for E2E Testing项目地址: https://gitcode.com/GitHub_Trending/mid/midscene一次人工回归要跑掉一两个小时基于选择器的脚本还经常在前端一改版就整片变红。Midscene.js 的 AI自动化测试 换了一种思路把测试步骤写成自然语言由 AI 直接读屏、规划、执行。本文按一条真实落地路径讲清从接设备到跑稳夜跑的四步配置。一、先想清楚它替谁干活传统 UI 脚本和页面结构强绑定class 名一变几十条用例集体失效修脚本的时间比跑测试还长。换成 Midscene.js 之后模型像一个能看屏幕的视觉验收员——它验收的是用户真实看到的界面DOM 怎么重构它都不在意测试脚本只描述要做什么不描述元素在第几层。代价是需要一个多模态模型但换来的是跨 Web、Android、iOS、桌面的同一套写法。二、先选连接方式三条路各适合谁接什么对象决定后面所有配置走向先在这里做选择。真机路线Android 与 iOSAndroid 打开 USB 调试并用数据线连上电脑adb 会自动识别出设备型号与系统版本iOS 需要额外搭建 WebDriverAgent 建立远程连接。适合要验证移动 App 的业务一台主机并行挂 5 台设备以内比较稳。PC 浏览器路线桥接模式与 Chrome 扩展桥接模式让本地脚本接管你日常在用的 Chrome登录态、Cookie、插件全部复用脚本跑到一半还能切回手动操作业内叫 man-in-the-loop详见桥接模式文档。Chrome 扩展则是零搭建路线装好插件打开侧边栏直接输入指令适合先体验、再决定要不要写代码。三、第一次跑通三步发出第一条指令第一步配好环境与密钥。最小可用配置就是四组环境变量Base URL、API Key、模型名、模型系列。export MIDSCENE_MODEL_BASE_URLhttps://ark.cn-beijing.volces.com/api/v3 export MIDSCENE_MODEL_API_KEYyour-api-key export MIDSCENE_MODEL_NAMEdoubao-seed-2-1-turbo-260628 export MIDSCENE_MODEL_FAMILYdoubao-seed用 Playground 的话把这组配置直接粘进设置页即可选型的完整清单见支持的模型与配置。第二步连上设备或浏览器。手机走 USB浏览器装好扩展或启动桥接脚本确认界面里能看到目标页面。第三步发指令。第一条指令不必复杂点击登录按钮规划并交互、页面顶部显示导航栏检查界面、页面中的商品{name: string, price: number}[]提取结构化数据三类能力各试一遍跑通了这套环境就算验收合格。四、从一句话到一套测试任务怎么拆验证通过后把散句组织成流程遵循三条规则拆步执行一条指令只干一件事。以电商为例搜商品 → 加购物车 → 提交订单 → 支付拆成四步而不是一句帮我下单。关键节点验证每一步之后接一条aiAssert状态断言比如支付完成后断言订单状态为待发货把问题拦在最早的节点。失败可恢复为易抖动的步骤配置重试社交场景里发帖后评论未立即出现这类时序问题用等待断言代替固定 sleep。流程稳定后再考虑把自然语言沉淀为 YAML 脚本纳入版本管理编排方式见YAML 脚本说明。五、跑得又快又稳缓存与并发的三个参数缓存该不该开默认关闭。Midscene.js 会缓存两类内容AI 规划出的步骤以及 Web 端的元素 XPath 定位结果缓存命中时同一任务实测从 51 秒降到 28 秒。开发期建议开读写模式全流程缓存调试最快生产期建议只读模式加手动flushCache()并把缓存文件提交进仓库CI 上直接命中。注意查询类断言永不缓存页面大改后缓存会自动失效回落到 AI 重算所以缓存不能替代模型服务。并发上限Web 任务数不超过 CPU 核心数真机每台主机建议 5 台并行封顶再多主要卡在 adb 和屏幕流传输上。超时与模型选型从默认单模型起步多数场景够用只有复杂多步规划或大量数据提取成为瓶颈时再单独加 Planning / Insight 模型每加一个模型都会增加耗时和 token 开销。六、出错了先看这里三个高频症状症状检查处理设备识别不到USB 调试是否开启、adb 授权弹窗是否点过换数据线非纯充电线、重插设备iOS 核对 WebDriverAgent 端口AI 调用超时网络代理与 Base URL 是否可达调大响应超时、加失败重试排查代理拦截结果时好时坏是否命中过期缓存、步骤指令是否含糊清空./midscene_run/cache重来把模糊指令改写成单一动作更细的平台级问题按对号入座常见问题 FAQ 已按 Web、Android、iOS、桌面分好了条目。七、读懂执行报告盯住三个数字每次运行都会产出一份 HTML 报告核心看三处任务状态统计哪些步骤红、AI 调用次数与单步耗时哪里最贵、关键步骤截图失败时 AI 当时看到了什么。从 v1.7.0 起report-tool子命令还能把报告拆成 JSON 加截图或转成 Markdown 供其他工具消费报告解析说明见文档。日常监控建议盯三个指标任务成功率跌破阈值要查报告定位、平均执行时间趋势上升通常是缓存失效或模型变慢、AI 响应时间判断要不要换更快的模型系列。八、按阶段选型三档配置建议个人调试选轻量快速的模型系列开读写缓存打开详细日志目标是把反馈循环压到最短。团队使用模型配置统一沉淀到环境变量或配置文件共享缓存文件进仓库报告产物接进 CI 留档。生产夜跑换准确率更高的模型缓存改只读模式配好超时与自动重试用报告里的成功率做每日巡检。配置没有一劳永逸的版本跑一周看一次报告数据缓存命中率、耗时和失败点会告诉你下一轮该调哪一项。【免费下载链接】midsceneGUI Agent for E2E Testing项目地址: https://gitcode.com/GitHub_Trending/mid/midscene创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表