Conecta un dispositivo Android
Instala Talos, define una contraseña para el panel y conecta por ADB un emulador o teléfono autorizado. Añade una clave de API de Claude, OpenAI, Gemini u OpenRouter, o un endpoint de modelo propio.
Talos · Agente de IA para automatizar Android
Talos es un agente de automatización de escritorio que controla dispositivos Android conectados a tu ordenador por ADB. Dale objetivos en lenguaje natural para automatizar teléfonos y emuladores que sean tuyos o que tengas permiso para controlar.
Autoalojado · Windows y Linux · Tu proveedor de IA
La licencia de prueba no requiere tarjeta. El uso de IA se factura aparte.
Tu objetivo
«En Contactos, añade a Lucía García con el número 5550100. Confirma que el contacto guardado aparece en la lista.»
Éxito: se ven los campos de nombre y teléfono.
Éxito: los campos muestran Lucía García y 5550100.
Éxito: Lucía García aparece en Contactos.
Definición de tarea ilustrativa, no una ejecución grabada. La última llamada al modelo puede superar el umbral de presupuesto.
¿Qué es Talos?
Repetir a mano el mismo recorrido por una app exige atención. Escribir un script para cada variante exige mantenimiento. Con Talos defines el resultado y un agente elige las acciones a partir de la pantalla actual.
Tu panel se ejecuta en tu propio equipo, protegido con contraseña, y controla Android por ADB. El contexto de la tarea y las observaciones de la pantalla van al proveedor de IA que configures.
Descubre la automatización de emuladores Android →
Cómo funciona
Empieza con una app y un resultado observable.
Instala Talos, define una contraseña para el panel y conecta por ADB un emulador o teléfono autorizado. Añade una clave de API de Claude, OpenAI, Gemini u OpenRouter, o un endpoint de modelo propio.
Elige un dispositivo y describe el objetivo. Añade contexto, etapas opcionales, límites y, si quieres, un modelo para esta tarea. Elige una tarea única o continua.
Sigue la vista previa del dispositivo y abre la línea de tiempo de la ejecución para ver qué observó el agente, qué acciones realizó, cuánto costó y cómo terminó.
Funciones clave
Describe el objetivo y añade etapas opcionales, cada una con un criterio de éxito visible, o deja que la IA proponga las etapas.
El agente lee elementos de la interfaz y capturas, toca, desplaza, escribe, abre apps y comprueba qué ha cambiado. Antes de una ejecución enciende la pantalla y quita un bloqueo sin seguridad.
Repite ciclos correctos con una pausa, horario de trabajo opcional y un resumen que pasa al siguiente ciclo. Los errores temporales se reintentan en lugar de detener la tarea.
Cada ejecución guarda observaciones, acciones, resultados, explicaciones del modelo, tokens, coste y capturas, con sus registros a un clic. Se conservan las 10 últimas ejecuciones de cada tarea.
Limita iteraciones, tiempo y coste por ejecución, y fija un presupuesto diario por tarea y para todas las tareas. Cuando se agota, las tareas continuas esperan al día siguiente.
Usa Claude, OpenAI, Google Gemini, OpenRouter o un endpoint HTTP propio con tu clave. Define modelo y esfuerzo de forma global o por tarea; cada ejecución registra con qué funcionó.
Recibe un mensaje por webhook, Discord, Telegram, ntfy o correo cuando una tarea falla, alcanza un límite o su presupuesto diario, pierde su teléfono o termina.
Toca la vista previa en directo, escribe texto y usa Atrás, Inicio o Aplicaciones recientes para desbloquear un teléfono o corregir su estado. Varias tareas pueden compartir un dispositivo y ejecutarse una tras otra.
Protegido con contraseña, con claves de API que nunca vuelven al navegador, una página de diagnóstico con un informe para copiar y una interfaz en seis idiomas.
¿Para quién es?
Úsalo donde el trabajo ocurre dentro de una interfaz Android.
Desarrolladores
Crea un contacto de prueba o ajusta una opción visible con una tarea guiada por objetivos y comprueba la pantalla final antes de empezar.
Equipos de QA y apps
Describe un flujo de la app con puntos de control visibles. Revisa en la línea de tiempo dónde tuvo éxito el agente o dónde se atascó.
Operadores técnicos
Ejecuta ciclos dentro del horario de trabajo, con un presupuesto diario y una notificación si la tarea se detiene. Mantén la tarea bajo control y detenla cuando haga falta.
¿Por qué Talos?
Talos puede reducir los scripts de acciones en tareas guiadas por objetivos. Aun así, sus decisiones basadas en la pantalla deben evaluarse en tu app. Úsalo junto a las comprobaciones que ya funcionan en tu equipo.
| Tu flujo | Automatización de UI con scripts | Agente de IA Talos |
|---|---|---|
| Definir la tarea | Escribir una secuencia de acciones y aserciones. | Describir un objetivo y criterios de éxito visibles. |
| Reaccionar a la pantalla | Selectores y ramas que tienes que mantener. | Elegir la siguiente acción a partir de la interfaz actual y las capturas. |
| Investigar una ejecución | Revisar los registros y capturas que ofrece tu framework. | Revisar observaciones, acciones, resultados, capturas, tokens y coste en una sola línea de tiempo. |
| Mejor encaje | Aserciones exactas y controles de regresión repetibles. | Interacción con apps guiada por objetivos, tareas de preparación y comprobaciones exploratorias. |
| Contrapartida | Escribir scripts al principio y mantenerlos. | Latencia del modelo, costes del proveedor y decisiones que pueden variar. |
Antes de empezar
Talos es un agente de IA autoalojado para automatizar emuladores y teléfonos Android. Describes un objetivo, añades si quieres etapas con criterios de éxito visibles, y el agente observa la interfaz y elige acciones por ADB.
Talos se conecta a dispositivos Android accesibles por ADB, incluidos emuladores Android y teléfonos con la depuración USB activada. El dispositivo debe estar en línea y autorizado. Antes de una ejecución, Talos enciende la pantalla y quita un bloqueo sin PIN, patrón ni contraseña; un bloqueo con seguridad tienes que quitarlo tú. iOS no es compatible.
Puedes definir tareas en lenguaje natural sin escribir un script de acciones. Talos usa ADB, observaciones de la interfaz y capturas; Appium no es necesario. Los objetivos claros y los criterios de éxito observables siguen siendo importantes, y cada flujo debe probarse en tu app.
Claude (Anthropic), OpenAI, Google Gemini, OpenRouter o tu propio endpoint HTTP que implemente el protocolo de Talos. Eliges el modelo y el esfuerzo predeterminados en Ajustes; cada tarea puede usar su propio modelo, por ejemplo uno más barato para una comprobación frecuente. Los modelos de OpenRouter sin llamadas a herramientas se rechazan antes de la primera llamada de pago, y los modelos sin entrada de imagen no reciben capturas.
No. Usas tu propia clave de API y el proveedor te factura directamente. Talos estima los costes con los precios del proveedor, usa el coste real que informa OpenRouter y muestra el total del día en el panel. No calcula los cargos de endpoints propios.
Define límites de iteraciones, tiempo y presupuesto en USD por ejecución, además de un presupuesto diario por tarea y para todas las tareas juntas. El presupuesto de la ejecución se comprueba tras cada respuesta del modelo, así que la última llamada puede superarlo. Cuando se agota un presupuesto diario, las tareas continuas esperan al día siguiente (hora del servidor). Puedes detener cualquier tarea desde el panel.
El panel, las definiciones de tareas, el historial de ejecuciones y los registros de costes se guardan en tu equipo, protegidos con la contraseña del panel. El proveedor de IA que elijas recibe el contexto de la tarea, las observaciones de la interfaz y las capturas usadas para decidir. Las instalaciones con licencia también contactan con el servidor de licencias, y las notificaciones van a los canales que configures. Autoalojado no significa que todo se procese sin conexión.
Talos puede ayudar a recorrer flujos visibles de la app y reunir un historial de ejecuciones que puedes revisar. Las decisiones del agente pueden variar y el éxito se evalúa a partir de la pantalla. Mantén las pruebas deterministas para aserciones exactas, comprobaciones de regresión repetibles y controles de publicación.
Sí. Las tareas continuas repiten los ciclos correctos tras una pausa configurable, si quieres solo dentro del horario de trabajo, y pasan un resumen al siguiente ciclo. Los problemas temporales se reintentan hasta cuatro veces con una pausa creciente. El resumen es contexto generado por el modelo, no un registro exacto de eventos; revisa las acciones que no deben duplicarse.
Una instalación en marcha sigue funcionando hasta 72 horas después de la última comprobación de licencia correcta. Detener tareas siempre es posible, incluso sin una licencia activa.
Empieza con un solo flujo
Pruébalo en tu propio emulador o teléfono. Necesitas una conexión ADB, un objetivo claro y tu proveedor de modelos.
La licencia de prueba no requiere tarjeta. El uso de IA se factura aparte.