给AI Agent(智能体)用的安卓云手机
给AI Agent用的安卓手机,按真机型号打造,而不是模拟器:在上面训练、测试和运行移动端Agent。保存一个干净状态,每次运行前恢复,任务需要多少副本就克隆多少。
# 1. 重置到已保存的状态 POST /v1/devices/c3f9a41d2/snapshots/ready-v3/restore # 2. 观察:最新截图 + 每个元素及其边界 GET /v1/devices/c3f9a41d2/observe → { "seq": 41, "image": {…}, "activity": "…Cart", "ui": [ { "text": "Checkout", "b": [60,1560,1020,1680] } ] } # 3. 操作,并等待画面稳定 POST /v1/devices/c3f9a41d2/act { "op": "tap_text", "text": "Checkout", "seq": 41, "settle": true } # 4. 从系统内部核对 adb shell dumpsys activity top # 订单下成功了吗?
为什么不用模拟器。
只在模拟器上练过的Agent,到了真手机上面对的是另一个世界。在这里,它在用户真实使用的环境里工作。
应用看到的是手机
机型、传感器、摄像头、GPU、SIM和运营商,都和设备所仿照的那款手机一致。应用的表现和面对真实用户时一样。Agent可用的机型
内置Google Play
每台设备都有Play商店和Play服务,应用的安装方式和真手机一样。
真实用户的网络
在你选择的国家使用移动或住宅出口。时区、区域设置和SIM跟随出口。
为批量运行而生,而不只是一台手机。
评测和训练每次都需要相同的起点,而且要同时跑很多个。每次运行前重置,克隆出副本并行运行。
保存一个“世界”
把设备配置一次:装好应用、登好账号、备好数据,然后拍个快照。
每轮之间重置
每个回合开始前恢复快照,每次运行都从同一状态出发。
克隆扩容
从同一个快照创建新设备:十个或一百个完全相同的起点,每个都有独立的设备身份。
按分钟付费
关机的设备不收费。集中跑一批任务,用多少付多少。
Agent可以直接驱动的接口。
一次调用“看”:最新截图、屏幕上每个元素及其位置,以及当前前台应用。一次调用“做”,并等画面稳定后再返回。 需要更深入检查时,还有ADB。observe和act调用都属于常规API。
团队用它来做什么。
Agent只是云手机的用途之一;另见其他使用场景。
Agent评测
在真实应用和真机型号上给Agent跑基准测试,每次都从相同的初始状态开始。
训练环境
可大规模重置的回合,覆盖不同机型、Android版本和国家。
需要手机的Agent
替用户预订、下单、发消息的产品,每位用户都有一台自己的设备。
用Agent做测试
让Agent在你的用户真正在用的手机上把你的应用走一遍。用Agent做测试
申请抢先体验。
我们会先向少数团队开放。告诉我们你的Agent做什么、同时需要多少台设备;我们会帮你开通,并在一天内回复。
- 和所有用户一样的设备150多款真机型号,机型库中任意Android版本,任意网络。
- 一样的价格运行时按分钟计费,关机时不收费。
AI Agent云手机常见问题
还有其他问题?请联系客服,通常一个工作日内由真人回复。
为什么用云手机而不是模拟器来训练Agent?
因为Agent应该在它将来工作的地方练习。每次运行都从同一个快照开始,应用看到的是一台手机:机型的芯片、传感器和屏幕,Google Play和真实的网络出口,而不是一台通用的模拟器设备。为什么它不是模拟器
一次观察和一次操作有多快?
不带UI树的observe远不到一秒;带完整UI树时需要几秒。act会在画面稳定后立即返回,最多等5秒。
支持哪些Agent框架?
任何能发HTTP请求的框架都行:接口就是普通的REST和JSON。MCP服务器和Python SDK会在抢先体验阶段推出。
每次运行都能从完全相同的状态开始吗?
能。给准备好的设备拍个快照,每个回合开始前恢复它;需要并行就克隆,每台克隆都有独立的设备身份。