Teléfonos Android en la nube para agentes de IA.
Teléfonos Android para agentes de IA, basados en dispositivos reales y no en un emulador: entrena, prueba y ejecuta en ellos tus agentes móviles. Guarda un estado limpio, restáuralo antes de cada ejecución y clona todas las copias que necesite la tarea.
# 1. volver al estado guardado POST /v1/devices/c3f9a41d2/snapshots/ready-v3/restore # 2. mirar: captura reciente + cada elemento con sus límites GET /v1/devices/c3f9a41d2/observe → { "seq": 41, "image": {…}, "activity": "…Cart", "ui": [ { "text": "Checkout", "b": [60,1560,1020,1680] } ] } # 3. actuar y esperar a que la pantalla se estabilice POST /v1/devices/c3f9a41d2/act { "op": "tap_text", "text": "Checkout", "seq": 41, "settle": true } # 4. comprobar desde dentro adb shell dumpsys activity top # ¿se completó el pedido?
Por qué no un emulador.
Un agente que solo practicó en un emulador se encuentra con otro mundo en un teléfono real. Aquí trabaja en el mismo que tienen tus usuarios.
Las apps ven un teléfono
Modelo, sensores, cámara, GPU, SIM y operador del teléfono en el que se basa el dispositivo. Las apps se comportan como lo hacen con usuarios reales. Los modelos en los que trabajan los agentes
Con Google Play
Play Store y los servicios de Play en todos los dispositivos, con las apps instaladas como las instala un teléfono.
La red de un usuario real
Salida móvil o residencial en el país que elijas. La zona horaria, la configuración regional y la SIM la siguen.
Pensado para ejecuciones en serie, no para un solo teléfono.
La evaluación y el entrenamiento necesitan el mismo punto de partida cada vez, y muchos a la vez. Reinicia antes de cada ejecución y clona para correr en paralelo.
Guarda un mundo
Configura un dispositivo una vez: apps instaladas, cuentas con sesión iniciada, datos en su lugar. Guarda un snapshot.
Restaurar entre ejecuciones
Restaura el snapshot antes de cada episodio, así cada ejecución parte del mismo estado.
Clona para escalar
Dispositivos nuevos a partir del mismo snapshot: diez o cien puntos de partida idénticos, cada uno con su propia identidad.
Paga por minuto
Los dispositivos detenidos no cuestan nada. Una ráfaga de ejecuciones cuesta lo que usa.
Una interfaz que un agente puede manejar.
Una llamada para mirar: una captura reciente, cada elemento de la pantalla con su posición y la app en primer plano. Una llamada para actuar, que espera a que la pantalla se estabilice. ADB cuando la verificación necesita ir más a fondo. Las llamadas observe y act son parte de la API normal.
Para qué lo usan los equipos.
Los agentes son uno de los trabajos que hacen los teléfonos en la nube; mira los otros usos.
Evaluación de agentes
Mide un agente en apps reales y modelos de dispositivos reales, partiendo siempre del mismo estado.
Entornos de entrenamiento
Episodios reiniciables a escala, con distintos modelos, versiones de Android y países.
Agentes que necesitan un teléfono
Productos que reservan, piden y envían mensajes por sus usuarios, cada usuario en su propio dispositivo.
Pruebas con agentes
Deja que un agente recorra tu app en los teléfonos que de verdad tienen tus usuarios. Pruebas con agentes
Solicita acceso anticipado.
Primero lo abrimos a unos pocos equipos. Cuéntanos qué hace tu agente y cuántos dispositivos necesita a la vez; te lo configuramos y te respondemos en un día.
- Los mismos dispositivos que todosMás de 150 modelos de teléfono reales, cualquier Android del catálogo, cualquier red.
- Los mismos preciosPor minuto mientras está encendido, nada mientras está detenido.
Preguntas sobre teléfonos para agentes de IA
¿Algo más? Escribe a soporte y te responde una persona, normalmente en un día hábil.
¿Por qué entrenar agentes en teléfonos en la nube y no en emuladores?
Porque el agente debe practicar donde va a trabajar. Cada ejecución parte del mismo snapshot, y las apps ven un teléfono: el chip, los sensores y la pantalla del modelo, Google Play y una salida a internet real, en lugar de un dispositivo de emulador genérico. Por qué no es un emulador
¿Qué tan rápido es mirar y actuar?
Un observe sin el árbol de UI tarda bastante menos de un segundo; con el árbol completo, unos segundos. Un act responde en cuanto la pantalla se estabiliza, o como máximo a los 5 segundos.
¿Con qué frameworks de agentes funciona?
Con cualquiera que pueda hacer llamadas HTTP: la interfaz es REST y JSON simples. Un servidor MCP y un SDK para Python llegan con el acceso anticipado.
¿Cada ejecución puede partir exactamente del mismo estado?
Sí. Guarda un snapshot de un dispositivo preparado y restáuralo antes de cada episodio; clónalo para correr en paralelo, cada clon con su propia identidad.