Melaya Mobile · 应用测试

在真实手机上自动化 App 测试。不是模拟器在猜测。

智能体在真实设备上还原真实用户旅程:安装、引导、点击操作、截图、生成报告。开发者可在每次构建时验证推送通知、深度链接和跨设备行为。产品经理在发布前在实体硬件上运行 A/B 变体,并获得对比录屏。这是您的真实应用运行在真实手机上,不是模拟器在猜测。

01
// 现状的痛点

人工工作流的成本,比智能体还贵。

每个销售与BD团队每周都会遇到的三个痛点。每一个都是你的代表实际抱怨的内容,而不是功能页面会用的措辞。

  1. 01

    在真实设备上进行手动 QA 费时耗力、成本高昂。

  2. 02

    推送通知、深度链接和引导流程中的缺陷频繁上线,原因很简单:没有人有时间在每台手机上测试每条用户旅程。

02
// 你可以构建的流水线

智能体工作流:组合、审批、回放。

下方每条流水线都是你在画布上使用智能体团队与工具连接出的形态。不是我们替你交付的功能,而是你配置的模式。

P01

真实用户旅程,完整还原

安装、引导、点击操作、截图、生成报告。智能体在实体硬件上还原真实用户旅程,并提交可回放的测试证据。

P02

推送通知、深度链接与跨设备检查

在用户发现问题之前,于每次构建时验证推送通知、深度链接和跨设备行为。

P03

在硬件设备上运行 A/B 变体

在发布前于实体设备上运行 A/B 变体,并获得用于决策的对比录屏。

03
// 多智能体团队

设备 QA 团队

来自 tech_team 智能体团队的真实角色。每个角色都带有调优过的系统提示词和默认工具白名单。你可以在画布上按角色更换模型。

技术负责人

TechLead

规划用户旅程覆盖范围,并逐次构建审阅测试证据。

前端工程师

FrontendEngineer

逐屏遍历应用界面并记录每个步骤。

DevOps 工程师

DevOpsEngineer

将运行任务纳入您的发布节奏并提交报告。

UI/UX 设计师

UIUXDesigner

并排对比变体,标记发生回退的部分。

04
// 受限工具

工具授权范围:只允许你授权的操作。

下方每个工具都是 Melaya 工具包中的真实共享工具。按智能体设置白名单;对写入操作设置 HITL 门控;任意工具一键撤销。

shared/工具/phone/

在真实设备上驱动您的应用:点击、滑动、截图、步骤日志。

phone_open_appphone_get_screen_treephone_screenshotphone_tapphone_swipephone_batch
shared/工具/project_mgmt/

将发现的问题提交至团队已在使用的工具中。

jira_create_issuelinear_create_issue
shared/工具/knowledge/

将每次运行的测试证据转化为按构建版本可检索的记录。

build_knowledge_from_textbuild_knowledge_from_file
shared/工具/core/

在设备运行期间读取配置和日志。

file_readgrep_search
05
// 三层知识

智能体团队只读取你给它的内容。

每条流水线都附带三层知识访问。在画布上按智能体混搭。不与其他租户共享向量空间,无意外读取,无不透明检索。

L1

静态上下文

includeContext

按流水线配置的文档,在每次运行时附加到指定智能体的输入。ICP 简报、行动手册、报价单或赢单邮件语料。任何需要在智能体开始思考前就到位的内容。你决定哪个角色拿到哪份文档。

L2

RAG 检索工具

rag_retrieve

按智能体授予的受限工具。当智能体判断需要更深入信息时,它会按需查询当前工作流的向量库。与静态上下文同源知识库,只在模型主动请求时访问。

L3

跨运行记忆

pipeline_memory

流水线级别的状态,从一次运行延续到下一次。昨天的研究在今天的跟进中依然在范围内。智能体团队会记得它已经处理过哪些潜在客户、获得了哪些审批、发送过什么内容。审计日志就是二阶知识库。

07
// FAQ

每周都有人问的 AI 智能体问题。

这是模拟器吗?

不是。这是您的真实应用运行在真实手机上。智能体遍历真实界面并提交可回放的测试证据:截图、步骤日志、复现脚本。

需要对我的应用进行插桩处理吗?

无需插桩,也无需集成测试框架。智能体通过屏幕驱动应用,方式与真实用户完全一致。

为什么选 Melaya 而不是 Appium 或 Maestro 脚本?

Appium 和 Maestro 等脚本框架依赖选择器,UI 变动后就会失效。Melaya 的 Device QA 智能体团队读取实际屏幕:Frontend Engineer 智能体以视觉方式遍历应用,所以按钮移位或文案变化不会中断运行。对于成熟 CI 套件中需要像素级断言的场景,脚本依然有其价值,很多团队两者并用。

n8n 或 Zapier 能在真机上测试移动应用吗?

不能。n8n、Zapier 和 Make 通过 API 执行预定义的触发-动作步骤,而待测移动应用通常没有可调用的 API。Melaya 的 Device Control 操控一台真实的 Android 手机:安装构建版本,打开已授权的应用,读取屏幕,点击并输入,记录每一步。这些工具在简单线性 Web 自动化的连接器数量上仍然占优。

如何证明每次发布都测试了哪些用户旅程?

每次 Melaya 运行都会产生完整的运行追踪:带时间戳的步骤、每屏截图和类型化的失败原因。knowledge 工具包将这些证据转化为每个构建版本的可搜索记录,DevOps Engineer 智能体通过你们团队已在使用的 project_mgmt 工具包提交报告。优先确定性的评估在任何模型评分之前运行基于规则的检查。

可以在每次构建中复用同一套测试旅程吗?

可以。在 Melaya 的智能体、工具、触发器和批准门控画布上一次构建好旅程,然后将任意运行保存为可复用流水线。Tech Lead 智能体规划旅程覆盖范围,DevOps Engineer 智能体将运行接入你的发布节奏,每次构建都以同样的旅程回放,产出可比对的证据。

Melaya 如何在真机上测试推送通知和深度链接?

Melaya 的 Device Control 在真实的 Android 手机上等待通知到达,点击通知,验证应用是否跳转到正确的页面,并在每步截图。深度链接的测试方式相同:智能体打开链接并确认目标页面。core 工具包在设备运行的同时读取配置并记录日志。

如何防止 AI 智能体在我的应用中做出破坏性操作?

每次写入操作都有 HITL 批准。Device QA 智能体团队可以自由遍历只读旅程,但任何发布、购买或发送步骤都会暂停,等待人工批准,手机在发布任何内容前也会在设备上暂停等待批准。工具许可列表限定手机工具包可以打开哪些应用,完整运行追踪在事后记录每次点击。

发布前可以在真实硬件上比较 A/B 变体吗?

可以。将每个变体作为并行旅程在真实硬件上运行,Melaya 的 UI/UX Designer 智能体并排比较录屏并标记出现回归的地方。产品经理可以从手机工具包获取两个变体的逐步截图和步骤日志,发布决策基于可回放的证据,而不是走廊演示。

测试运行可以保留在自己的硬件上吗?

可以。Melaya 在云端或本地 runner 上运行,测试手机连接到该 runner,所以未发布的构建版本和测试账户永远不会离开你的设备。跨 23 个服务商的逐步模型路由让敏感步骤在本地模型上运行,而更便宜的云端模型负责撰写报告。

在 Melaya 上构建 应用创始人、移动端开发者与产品经理 流水线。

Sandbox 套餐免费,无需信用卡。加入等候名单,一旦有名额开放,我们就会立刻发邮件通知你。

← 返回所有用例
加入社区
// Cookie
Melaya 使用一小组第一方 cookie,仅用于身份验证、维持会话和保护平台。默认不使用广告 cookie、跨站追踪器或第三方分析。完整 cookie 清单见我们的 隐私政策.