- 博客(596)
- 资源 (19)
- 收藏
- 关注
原创 夯爆了,谷歌又一强大AI自动化开源神器,Appium慌了!
翻了下日历,ARTEMIS 开源到现在,才一个半月。一个半月,一万多 star,谷歌官方出品,MCP 原生,AndroidWorld 榜首。这几件事凑在一起,基本可以确定,自然语言驱动真机这件事,接下来一年会有一大波跟进者。被改写的先是入门路径。以前学 UI 自动化,先啃定位器,再啃等待,再啃框架 API,一套下来仨月。以后的第一行用例,可能就是一句中文的测试描述。工具一直在换,怎么证明它是对的,这个活一直都在。
2026-10-09 08:59:28
284
原创 Agent 天天挂在嘴边的沙箱,到底是个啥?
不知道你们有没有这种感觉。不管是翻 Claude Code 的文档,还是用 Codex、WorkBuddy,总有一个词在你眼前晃,沙箱。Claude Code 专门拿出一整节文档,来讲沙箱。Codex 默认就在沙箱里跑,想联网得单独申请。WorkBuddy 装完第一件事,就是让你勾选它能碰哪些文件夹,没勾到的地方,一步都进不去。要是你刚接触这个词,八成会拿它往熟悉的概念上套。沙箱?说的是虚拟机吗?还是 Docker 那种容器?再不然,Python 的 venv 算不算?
2026-10-08 09:35:11
126
原创 Web自动化测试全景图:20个主流AI自动化工具如何选?(强烈安利)
这两年想给 Web 自动化挑个工具,比以前要难了。以前好办,无非在几个老框架里挑,挑来挑去最后无非也就 Playwright 和 Selenium 两派。现在打开任何一份工具清单,一半以上是带 AI 特性的新面孔,腾讯、微软、亚马逊都在往里挤,开源的工具,star 涨得一个比一个快,比如,腾讯 6 月放出来的 BrowserSkill,三个月就冲到七千多star了。变化最大的点是 Coding Agent 出来之后,工具的用法跟着变了。
2026-09-30 08:55:44
216
原创 AI 测试 Skill 大全,我日常在用的 25 个,夯爆了!
之前有人问我,你天天说的 Agent Skill 到底是啥,你平常有用哪些呢?关于Agent Skill介绍,如果还不清楚的,可以看看之前公众号发表的这篇我平常在用的 Skill 种类有很多,办公提效、创作类、工作流相关的,零零散散加起来不少,后面有机会再给大家分享。今天单独说一说与软件测试强相关的。文末有Skill获取方式。先给一张Skill全景清单。25 个 Skill 按流程分三组,需求与用例设计 6 个,接口自动化 10 个,UI 自动化 9 个。
2026-09-29 08:54:09
193
原创 突发!字节内部大调整,QA直接转研发了?
代码能力仍要,这条绕不过去。Java、Go、Python 挑一门,至少能读别人的代码,能重构,能独立交付一个模块,算法和系统设计是转研发面试的硬门槛,虽然AI都能帮你做这些,但人学习,重点是要学习代码算法和架构的逻辑思维。在现在的岗位上就可以开始,质量平台、测试工具、CI/CD 流水线,会点页面的人到处都是,能把工具建起来的人不多,这些项目经验是转岗面试时最硬的筹码,也是当下证明价值最直接的方式。窗口期大概率就这一两年,主动补能力的人,留在原序列还是转过去,都有的选,等公司替你做决定的时候,选项就不多了。
2026-09-28 09:55:19
250
原创 别只盯着 Codex,分享一款免费且支持随时随地远程控制工具UU, 我也在用...
这篇文章不是广告,网易也没给我钱。写它是因为我真的用了一个月,觉得这款工具在 AI 时代的远程办公场景里,填补了一个很多人没意识到的空缺——AI 工具管的是「让任务自动跑起来」,UU 远程管的是「让你人在任何地方都能接管电脑」。两者搭配,才是 AI 时代完整的移动办公方案。想下载体验的,可以去我的导航站找,搜「UU远程」就行。网站里还收了不少同类工具的对比和我的使用评价,帮你少走弯路。在「最新上架」分类菜单中能快速找到它。
2026-09-24 08:58:58
204
原创 最近全网爆火的 Jev 到底是什么?适合干什么、怎么用,一篇讲透!
最后聊聊我自己的看法。网上吹它的和骂它的都不少。骂得最狠的那位工程师做过两个实验,拿 Qwen 两个小时复刻了一个同款,又找来一个 400M 参数的开源模型 laya,效果都和 Jev 差不多。他的结论说得很难听,Jev 就是一片止痛药,只治贵和慢,治不了笨。这话说得难听,但我大体同意。你真把它当聪明模型用,会失望,它本来也没打算聪明。它更像一颗螺丝钉,拧在大模型旁边,专干那些不值得惊动大模型的小判断。
2026-09-23 08:49:59
150
原创 cloudflared,不需要服务器和公网 IP 的免费内网穿透,一条命令上手
本文介绍 Cloudflare 官方工具 cloudflared,一款无需公网 IP、零配置的内网穿透解决方案。通过一条命令,可将本地服务(如 localhost:3000)暴露为全球可访问的 HTTPS 地址,适用于 Webhook 联调、AI Agent 外部访问、临时展示等场景。相比 frp、ngrok,它免服务器、免费额度高、自动配 HTTPS 证书,适合快速搭建公网入口。支持 macOS、Linux、Windows 多平台安装,开源且活跃维护,是现代开发与 AI 实践中的高效利器。
2026-09-22 09:08:44
122
原创 2026互联网大厂秋招AI Coding笔试全攻略!
本文详解大厂秋招新兴的AI Coding笔试:不考手写代码,而考需求理解、任务拆解、Prompt设计、AI协作与工程交付能力。通过六步实战法(分析→分轮实现→精准调试→自造测试→逐条验收→AI自审)及高频避坑指南,助你从“AI使用者”升级为“AI项目经理”。
2026-09-21 08:51:14
268
原创 AI越来越强了,为什么测试人反而越来越累!(为打工人发声)
本文揭示AI时代测试工程师“越忙越累”的真相:研发、产品等岗位因AI大幅提效,而测试却成瓶颈——AI擅长“迎合”,测试重在“挑刺”;产能翻倍导致被测物激增,验证环节却难以规模化。文章呼吁理性设定AI提效目标,尊重测试在质量兜底中的不可替代价值。
2026-09-18 09:27:04
129
原创 AI 都会写代码了,还要不要学传统编程了? (强烈建议阅读)
大家好,我是狂师。今天咱们来聊一个大家都非常关心的话题。这两年 AI 编程火得不像话,会写代码的人天天用,不会写代码的人也开始拿它做东西。八岁小孩都能用 AI 做出游戏了,不会编程的设计师上线了自己的产品,一个人加一堆 AI 就是一家软件公司。然后一个问题被顶到了很多人面前,尤其是正在学技术的人面前。我本身也是做技术知识分享的,这两年这个问题被问过很多次,问的人里有想转行做测开的,有在校的学生,也有干了几年开始慌的在职测试工程师。
2026-09-17 09:02:28
219
原创 BrowserAct,给AI Agent配一个真实浏览器,从安装到实战
大家好,我是狂师。事情是这样的,最近群里在聊一个老话题,Agent 什么都行,一到「去网站上帮我看看」就歇菜。页面是动态渲染的,curl 拿到一坨壳。数据要登录才能看,无头浏览器里 session 又不延续。好不容易进去了,Cloudflare 一个挑战页甩脸上。Static page还好,现在稍微像样点的网站,反爬、验证码、登录态,三道墙至少撞上一道。Agent 缺的其实就一样东西,一个能感知真实在跑的浏览器。
2026-09-16 08:59:16
379
原创 2026 性能测试工具大盘点:13 款主流压测工具,测试工程师必备!
经常有人让我帮忙推荐压测工具,我的答案一直是,先看你会不会写代码。会写的,直接上 k6 或者 Locust,脚本进 Git、场景可评审、结果可复现,这是性能测试工程化的正路。不会写的,JMeter 依然是最稳的起点,别硬着头皮上代码系工具,工具的别扭会盖过测试本身。有两个容易被忽略的点。轻量 CLI 是宝藏,wrk 和 Vegeta 五分钟就能给服务摸个底,真正的大规模压测再上平台,别什么事都兴师动众。
2026-09-15 09:02:16
140
原创 最近火爆出圈的,FDE 到底是个什么岗位?
前几天和一位刚面完国外大厂 FDE 的同学聊了很久,越聊越觉得,很多人对这个 AI 新岗位的理解,从第一步就偏了。会做 Agent,不等于能做 FDE。手里攒了几个 Demo,也不等于能拿到这个岗位的 Offer。今天就把真实面试拆开,看看企业到底在挑什么样的人。
2026-09-14 08:38:22
146
原创 2026年AI编程工具大全,33个主流工具一次看懂
四拨看下来,说点我自己的看法。第一,别被33个吓到,其实就三类,编辑器、终端、云端,而且功能在飞速趋同,计划模式、子代理、MCP、skills,几乎人手一套,今天你发的新功能,下周别家全都有。第二,真正拉开差距的从来不是壳,是模型和上下文管理。同一个模型套不同的壳,体验能差出两档,同一个壳换不同的模型,体验能差出五档。选工具之前,先选模型。第三,开源成了大厂的军火库。
2026-09-11 08:46:42
217
原创 为什么都说要做自动化测试,落地却这么难!(附自动化测试的四种死法)
最后说句实在的。自动化测试从来不难在技术,它难在一笔长期主义的账,要在一个按月看结果的生意里算平。AI 没有让自动化变简单,它让自动化的账单,终于算得过来了。剩下的,就看你想不想算了。
2026-09-10 08:36:47
71
原创 别只会用 Postman 了,这 15 款接口测试工具你可能还不知道
15 款看下来,我最想说的其实是一句老话,先想清楚自己要干什么,再挑工具。纯个人调试,Postman、Insomnia、Bruno 里挑个顺手的就行,这类工具的核心体验早就趋同了,不值得纠结太久。团队要协作和流程规范,Apifox、Eolink 这类一体化平台更省事。在意数据主权或者只想零成本,Bruno 把用例存本地配 Git,一分钱不花,数据还在自己手里。更值得想透的一个点,调试工具和测试框架是两回事。用手点的管探索和沟通,用代码跑的管回归和流水线,成熟团队两套都要,别指望一个工具通吃。
2026-09-08 08:42:38
353
原创 2026年9月大模型最新排行榜,30款主流AI大模型,第一名有点意外...
翻完这 30 款,最直观的感受是节奏。Meta 一年三代连发把榜首抢了,OpenAI 用一个 GPT-6 带着一串 5.x 变体铺满中间段位,Google 靠 Flash 系两三个月一更走量,头部四家各走各的路。国产这边值得多说一句,Kimi K3 和 GLM-5.3 双双进了前十,Qwen 和 DeepSeek 稳在第二梯队,和海外的差距从名单上看已经不明显了,加上价格普遍只有海外同档的几分之一,实际用起来的性价比很突出。
2026-09-07 09:32:51
1462
原创 公司从零开始推自动化测试,如何落地?
本文深度剖析团队自动化转型的底层逻辑:指出失败主因常是目标错位与管理缺位,而非技术本身。强调“三分技术、七分管理”,主张先对齐业务目标、小步试点、建立闭环与规范,并结合AI提效——但须严控生成质量与维护闭环。核心是将自动化打造成可持续演进的测试资产。
2026-09-04 10:35:33
327
原创 AI 测试提效 | 别搞万能 Skill,推荐5 个 Agent Skill 串起 UI 自动化执行到报告生成全流程
本文系统提出UI自动化测试执行阶段的AI赋能方案,针对“跑测试难、失败诊断难、修复效率低、报告手工拼”等五大痛点,设计5个专业Agent Skill(标签管理、智能执行、失败诊断、报告生成、流程编排),以职责分离、闭环衔接、灵活复用为原则,实现从脚本标签化到可视化报告的全自动链路,大幅提升测试执行效率与质量可控性。
2026-09-03 09:13:22
433
原创 为什么团队用了 AI 之后,测试质量反而下降了!
但业务一复杂,特别是诸如管理后台这类,光开关就有几百个,金融计费、库存扣减、订单状态流转,还有十年老系统里那些没写在任何文档里的隐藏规则,这些知识根本不在 AI 的脑子里,在老员工的脑子里。他甚至没意识到,AI 是在拿通用知识猜他的业务,猜中是运气,猜错是日常,而且猜错的部分,长得特别像对的。会用的同学,把需求拆成小块一点点喂,把团队的历史坑、业务规则、边界条件全部交代清楚,出来的东西自己先过一遍,改完再验。很多团队用 AI 用得风生水起,基本都赢在这类场景,他们的「AI 真香」,是真的。
2026-09-02 09:37:17
189
原创 阿里开源:skill-up,一款Agent Skill 评测工具!
阿里开源的 skill-up 是首个专为 Agent Skill 设计的评测与演进工具,将软件测试方法论完整迁移:支持多引擎运行、声明式 YAML 用例、规则/脚本/LLM 三类断言,并内置自动修复与回归闭环。本地可跑,CI 可集成,让 Skill 质量可度量、可保障。
2026-09-01 17:15:48
493
原创 整理了一份 DeepSeek Harness 必备插件清单!
最后,不要一口气装十个。三步走。第一步,先装 01 市场和 02 视觉。第二步,装 03 或 04 其中一个界面插件。到这一步,基础体验已经和毛坯版完全两个东西了。第三步,再看自己用得多的是搜索还是记忆,按需补齐后面的。DeepSeek Harness 的生态现在是一周一变,今天的前 10,下个月可能就换血一半。但最核心的那几个,市场、视觉、界面,大概率会一直稳着。
2026-08-31 08:41:53
283
原创 我的免费 AI 测试开发学习路线,开源了!
这条路线用 CC BY-NC-SA 协议开源,个人学习、博客署名转载都随意,注明出处就行。拿去开付费专栏、做收费培训,协议不允许,看到了会维权。一个人的精力有限,内容难免有不足,路线会持续更新,也欢迎提 Issue 和 PR 一起共建。项目开源地址: https://github.com/zhoujinjian/ai-testing-guide如果这条路线对你有帮助,去 GitHub 给个Star⭐️,你的认可是持续更新的动力。
2026-08-28 08:52:43
237
原创 UI自动化测试提效必备Skill!一套CI流水线编排 Skill 可以直接抄了...
这个系列一直在做一件事,用 Agent Skill 把 UI 自动化测试的各个环节逐个自动化。到上一篇为止,环节级的 Skill 都齐了。执行有证据,失败有结论,报告有判断,单点能力全部到位。缺的是一个把它们串起来的东西。什么时候执行、失败了要不要诊断、修完要不要重跑、重跑几轮、结果怎么算,这些环节之间的决策,之前都靠人临场判断。所以这个系列收官的一篇,我做了,一个全链路统一编排的 Skill。它不当球员,只当指挥,把前面几个 Skill 编排串联成一条自动化流水线。
2026-08-27 08:06:58
227
原创 AI 测试丨一句指令生成测试报告,带失败截图、操作录屏、Trace、日志,这套 Skill 思路可以直接抄...
狂师推出`ui-report-generator`智能技能,一键将UI测试执行结果、失败证据、诊断结论与历史数据融合生成单文件HTML可视化报告。支持多维统计、风险分级、证据内联、Trace回放及趋势分析,3分钟读懂质量状况,让测试价值真正被看见。
2026-08-26 08:57:20
355
原创 AI 测试提效丨从失败排查到自动修复,分享我的Playwright+Skill UI自动化测试失败诊断提效方案!
狂师推出「ui-failure-diagnoser」AI技能,自动诊断UI测试失败根因(环境/定位/超时/数据/脚本/缺陷),智能修复并验证,全程留痕、分类统计、报告可溯。告别手动排查红条,让失败变成可分析、可治理的质量数据。
2026-08-25 08:43:08
341
原创 AI 测试 | 把 UI 自动化测试执行固化成五步流程,这套AI Skill 思路可以直接抄
本文介绍`ui-test-executor`——一款专为UI自动化测试打造的智能执行调度引擎。它以自然语言指令驱动,自动完成环境检测、用例筛选、并发执行、六类失败证据采集(截图/录屏/Trace/日志/源码/网络)及多格式报告生成,彻底解决环境不稳定、时序难控、脏数据干扰、现场不可追溯等执行痛点,让UI测试真正“跑得稳、查得清、信得过”。
2026-08-24 08:46:22
401
原创 智谱GLM-5.3+ZCode Agent,真实项目第一手实测!
智谱推出ZCode智能体开发环境,与旗舰模型GLM-5.3深度协同,实现“原生模型+原生Agent”高效配合。实测显示,ZCode提升任务通过率2.39%,缓存命中率超98%,显著降本增效。零配置、多平台、支持SSH/Docker,真实项目重构验证其开箱即用与工程落地能力。
2026-08-20 08:44:55
389
原创 从 0 到 1,DeepSeek Harness 保姆级安装与使用教程!
DeepSeek Harness 只是个起点。接下来真正值得关注的,是“一切皆插件”能否形成一套行业足够稳定的开发标准,以及它是会长成 DeepSeek 自己的 Coding 产品,还是会成为更多 Agent 产品共同采用的底层 Harness。总之,这个Hanress的其他有趣的地方,就交给大家去探索了。需要注意,目前放出来的,DeepSeek Harness还只是开发者预览版,通俗来说,就是专门面向开发者放出的早期测试版本,普通用户也可以刷,但不并建议作为日常主力用。
2026-08-19 08:28:50
802
原创 一个测试负责人的崩溃:该做的都做了,线上还是炸了
《测试不是越多越好,关键在于精准命中高风险点》 文章通过一个案例揭示测试误区:某团队写了3000条测试用例,代码覆盖率达95%,但上线后仍出现重大Bug。作者指出,覆盖率仅反映代码是否被执行,而非逻辑是否正确。过度追求覆盖率会导致资源浪费,而忽视真正的高风险场景。 核心观点包括: 覆盖率的局限性:高覆盖率不等于低Bug率,需区分代码重要性,优先保障核心逻辑。 风险驱动测试:根据Bug概率和影响排序,集中资源测试关键路径(如支付链路),而非低风险代码(如日志脚本)。 高效测试策略: 从线上故障中提取用例;
2026-08-18 08:51:50
178
原创 Agent质量怎么评?
本文深度剖析AI Agent上线翻车困局:90%+评测分≠真实可用。指出传统测试失效根源——Agent具多步性、工具调用、自主性与随机性四大特性。提出“评产出不评路径”核心原则,并对比AgentBench、SWE-Bench等基准与DeepEval、LangSmith等框架适用场景,强调需构建离线评测、红队测试、在线监控三层质量保障体系,助力团队从Demo走向可靠落地。
2026-08-14 08:31:32
195
原创 想做测试工具却不会写代码?怎么办?
这篇文章探讨了AI时代测试人员如何利用AI工具快速开发测试工具,无需掌握传统编程技能。核心观点包括: 关键转变:测试工具开发的核心从"写代码能力"转变为"清晰描述需求的能力"。 开发流程:通过AI工具(如Claude Code/Codex)实现需求描述→代码生成→验证的闭环,开发者只需专注需求定义和验收。 实操建议: 从小工具入手,逐步迭代 使用模型原生的Agent工具而非网页版 遇到报错直接反馈给AI自行修复 当前门槛:测试人员需要具备场景痛点识别、需求结构化表达和工具验收能力,而非编程技能。
2026-08-13 08:30:21
270
原创 用AI做自动化测试,哪些是真不行,哪些是你不会用?
测试工程师在使用AI工具时存在三类常见误区:一是AI确实无法胜任的业务断言、异步链路验证和性能根因分析等复杂场景;二是因自身技能不足导致AI工具使用不当,如元素定位和测试数据生成问题;三是半吊子水平导致AI时灵时不灵。作者指出,AI在业务规则清晰时能生成精准测试数据,在应用可测性完善时能稳定定位元素,但需要工程师提升Prompt编写能力和基建水平。关键在于区分AI的能力边界,避免盲目甩锅或过度依赖。
2026-08-12 08:38:24
208
原创 推荐一款开源 Skill:让 AI Agent 给你做一份“能改“的 PPT,支持 上千套模板!
dashi-ppt-skill是一款开源AI PPT技能(4.3k stars),突破行业痛点:生成后可实时编辑。支持12套主题、1020种版式、8576个控件,网页端可视化修改(拖拽/换色/调图表),一键导出真正可编辑的PPTX(文字/图表保留可修改性),全程本地运行,商业文档零上传。
2026-08-10 10:35:21
302
原创 AI 测试提效 | 别搞万能 Skill,推荐用 5 个 Agent Skill 串起 UI 自动化全流程
本文提出“4+1 Agent Skill”架构,以AI赋能UI自动化全流程:ui-page-parser解析页面、ui-testscript-generator生成脚本、ui-testscript-enhancer增强健壮性、ui-visual-assert实现视觉断言与多端适配,可选ui-auto-maintainer支持智能自愈。告别“写3天修2周”,用专业分工替代万能技能,大幅提升效率与可持续性。
2026-08-07 08:30:39
406
原创 AI 测试提效 | UI 自动化测不出样式 bug?分享 ui-visual-assert + Skill 视觉断言与多浏览器适配方案
UI自动化测试中DOM断言存在局限性,无法检测样式和布局问题。本文介绍了ui-visual-assert技能,通过视觉断言解决这一问题。它能在功能断言基础上增加三大维度的视觉校验:整页/局部截图比对、响应式布局适配(支持多分辨率)和跨浏览器兼容处理(Chromium/Firefox/WebKit)。该技能自动扫描脚本,生成视觉断言代码、响应式fixtures和浏览器配置,最终输出包含视觉测试模块的增强脚本。相比传统DOM断言,它能发现样式错乱、布局偏移等视觉问题,使UI测试从功能验证升级为全维度校验,显著提
2026-08-06 08:43:24
402
原创 公司不给你配 AI,你会自己掏钱吗?
AI付费办公时代来临:当员工自掏腰包购买生产力工具 一篇技术社区热帖引发广泛共鸣:越来越多的职场人正自费订阅各类AI工具用于工作。从ChatGPT到Claude Pro,开发者每月动辄花费上千元购置AI服务,形成"付费上班"的奇特现象。 这些AI工具已成为新型生产力工具,但多数企业囿于财务体系滞后、成本意识偏差和安全顾虑,不愿为员工报销。由此产生效率悖论:员工自费提升工作效率,企业坐享其成。 文章指出,AI能力正成为新的职场分水岭。会用AI的人正在替代不会用的人,这种差距随着时间推移将愈发明显。
2026-08-05 09:26:36
279
原创 AI 测试提效 | 脚本能跑但总挂?分享我的 ui-testscript-enhancer + Skill UI 自动化健壮性增强方案
UI测试脚本健壮性增强方案 针对UI自动化测试脚本在CI环境中不稳定问题,本文提出通过ui-testscript-enhancer技能实现脚本健壮性增强。该方案从六大维度进行加固:1)智能等待替换硬编码sleep;2)自动处理弹窗干扰;3)支持iframe/Shadow DOM穿透;4)异常重试与容错机制;5)失败时自动截图录屏;6)验证码自动识别方案。通过AI扫描分析基础脚本,自动补全生产级测试所需的稳定性逻辑,将"能跑"的demo脚本升级为可在CI环境中稳定运行的可靠脚本,解决偶发失败、环境差异等
2026-08-04 09:29:39
433
原创 AI 测试提效 | 告别手工写脚本,分享我的 Playwright + Skill 批量生成 UI 自动化脚本方案
本文介绍了UI自动化测试脚本生成工具ui-testscript-generator,旨在解决传统UI自动化测试中脚本编写的高耗时问题。该工具基于标准化页面定义文件pages.yaml和业务测试用例,自动生成页面对象模型(POM)、测试脚本及测试数据,覆盖正向、边界值、异常和安全测试场景。通过智能构造测试数据、封装原子操作和组合操作,并固化团队框架规范,显著提升脚本编写效率,减少人工重复劳动,生成可直接运行的完整测试工程。实操演示展示了从输入到生成项目结构的全流程,最终输出符合分层设计的标准化代码
2026-07-31 08:36:27
366
PanTools多网盘批量管理工具,支持主流网盘平台(如百度网盘、阿里云盘、夸克云盘等)
2025-06-23
ADO实现连接数据库方法
2012-05-27
TD常见问题解决方法
2012-05-27
电子元器件综合知识大全
2012-05-27
串口的收发程序
2012-05-27
TD服务器搭建及配置指南(TestDirector
2012-05-27
空空如也
TA创建的收藏夹 TA关注的收藏夹
TA关注的人
RSS订阅