据SiliconANGLE 9月28日报道,AI软件测试与质量保障平台Momentic Inc.宣布推出AI代理Mo,允许开发者在不维护测试脚本集合的情况下测试软件。该公司称,Mo面向由人类或AI代理生成的代码,试图把质量保障从编写和维护脚本转向直接依据需求与意图执行验证。

Momentic联合创始人兼首席执行官Wei-Wei Wu在采访中表示,智能体质量的下一个前沿是未来不再需要测试,而是智能体根据开发者的指令自行验证。这一判断针对的是现代代码创建速度加快后,错误和问题更容易在未被察觉的情况下进入生产环境。

报道称,目前测试主要有两类:检查代码质量的测试,以及验证应用运行时是否正常工作的测试。后一类通常依赖测试脚本点击按钮、触发下拉菜单和填写字段。但人类在应用实际使用环境中操作应用效果更好,而AI代理可以模仿这种方式。应用越复杂,所需测试越多,最终难以跟上变化。更麻烦的是,测试会不断膨胀,开发者每次修改应用都要检查、修改和修复脚本,否则脚本本身会变成负担。Wu说,只要代码库某处有脚本,就必须有人维护它。

Momentic最初通过帮助开发者用普通语言描述工作流来应对脚本化浏览器测试的维护负担,大语言模型可以减少其中的人力。但Wu说,公司后来遇到同一问题的更深版本:即使测试产物更容易维护,它仍然需要有人维护。Mo去掉了中间层,让QA代理直接根据需求和意图工作。Wu解释说,有了智能体,规模经济才能真正发挥作用;开发者现在可以把Mo指向应用,并要求它进行测试,而不必坐下来构建和维护另一套脚本库。

Mo的外观与其他日常AI编程工具类似,例如Claude Code。它有一个代理运行框架,提供网页界面和聊天框,开发者可输入需求和URL开始使用,也提供命令行界面用于自动化任务。Wu如此描述与Mo的交流:对我刚构建的这个应用做缺陷大扫除,这是URL,这是测试凭证,放手去测。

Mo接手后会打开应用,启动一组智能体集群并执行操作。除了告诉代理要测试什么或测试意图,当功能需要更多背景时,它还可以读取产品需求文档、Jira问题、Linear工单或Confluence文档。随后,Mo利用智能体集群尝试数千种排列和边缘情况,并记录每一次交互。完成后,它会向开发者逐步说明测试了什么、什么失败了、如何复现缺陷,并为每个缺陷提供视频证据。没有脚本要写,也没有测试套件要维护。Wu补充说,如果开发者想把这些转成测试,由于结果可复现且被完整描述,开发者可以将其转成自己选择的脚本。

Momentic表示,过去几周客户一直在试用Mo,其中包括Notion、Superpower、Iris、Committee for Children和Boundless等使用网页和移动应用的科技及服务行业领先公司。Wu说,脚本不是最终目标,没有人上班时会说,嘿,我想写1万条Momentic脚本、Playwright脚本或Selenium脚本;他们想要的是没有缺陷。