Argus: 像真人一样自动测试UI的AI代理
Show HN: Argus, agentic QA for teams whose coding agents move faster than QA

Argus 是一款本地开源的视觉 UI 测试工具,专为解决编码速度远超测试进度的团队痛点而生。它利用多智能体协作,无需编写脚本或维护选择器,只需描述测试意图,Argus 就能像真实用户一样在隔离的 Playwright 浏览器中自主探索、点击和验证页面。从自动规划测试路径到生成包含截图和时间线的结构化报告,Argus 让测试变得零配置且高度可靠,完美适配本地开发及私有网络应用。
Argus 能发现那些你从未编写测试用例的漏洞:只需指向页面并描述‘正常工作’的样子,自主智能体就会像真实用户一样探索你的界面,最终交给你一份包含截图和时间线的结构化报告。
- debarshri
我觉得这算不上最高优先级。我们在 Chrome 里用 Codex 或 Claude 就能搞定,顺便验证一下 UX。
我觉得 BDD 会在 Agent 生成代码的场景下重新流行起来。
当你大规模生成代码时,发现、维护和扩展测试才是个大问题,所以我们做了 katana [1],这是一个行为驱动测试工具,能自动发现行为、维护测试并生成测试用例。
- ramoz
“它读取的是屏幕,而不是 DOM”,但整个架构完全是基于 Playwright 构建的?起初我以为你们用了某种视觉模型,但看起来似乎并非如此。
- rgbrgb
CI 配合常规的 e2e 测试通常既贵又慢。和普通的 Playwright 测试相比,成本怎么样?