Neu in 0.4.0 OpenAI, Gemini und OpenRouter · Tagesbudgets · Benachrichtigungen

Talos · KI-Agent für Android-Automatisierung

Beschreibe die Aufgabe.
Talos erledigt sie auf Android.

Talos ist ein Desktop-Automatisierungsagent, der Android-Geräte steuert, die per ADB mit deinem Computer verbunden sind. Gib ihm Ziele in natürlicher Sprache, um Telefone und Emulatoren zu automatisieren, die dir gehören oder die du steuern darfst.

Selbst gehostet · Windows & Linux · Dein KI-Anbieter

Keine Karte für die Testlizenz nötig. KI-Nutzung wird separat abgerechnet.

Beispielaufgabe Einmaliger Durchlauf

Dein Ziel

„Füge in Kontakte Max Mustermann mit der Nummer 5550100 hinzu. Prüfe, ob der gespeicherte Kontakt in der Liste erscheint.“

  1. 01
    Kontaktformular öffnen

    Erfolg: Felder für Name und Telefonnummer sind sichtbar.

  2. 02
    Kontaktdaten eingeben

    Erfolg: Die Felder zeigen Max Mustermann und 5550100.

  3. 03
    Speichern und Ergebnis prüfen

    Erfolg: Max Mustermann erscheint in Kontakte.

40 Iterationen15 MinutenBudgetgrenze 0,50 USD

Beispielhafte Aufgabendefinition, kein aufgezeichneter Durchlauf. Der letzte Modellaufruf kann die Budgetgrenze überschreiten.

Android-Emulatoren & echte TelefoneZiele + sichtbare ErfolgskriterienClaude, OpenAI, Gemini oder OpenRouterNachvollziehbarer Durchlaufverlauf

Was ist Talos?

Ein KI-Operator für deine Android-Abläufe.

Denselben App-Ablauf immer wieder von Hand durchzugehen kostet Aufmerksamkeit. Für jede Variante ein Skript zu schreiben kostet Wartung. Mit Talos legst du das Ergebnis fest, und ein Agent wählt die Aktionen anhand des aktuellen Bildschirms.

Dein Dashboard läuft auf deinem eigenen Rechner, geschützt durch ein Passwort, und steuert Android über ADB. Aufgabenkontext und Bildschirmbeobachtungen gehen an den KI-Anbieter, den du einrichtest.

Android-Emulator-Automatisierung ansehen →
Talos-Dashboard mit einem verbundenen Android-Telefon, dem Aufgabenstatus sowie CPU-, Arbeitsspeicher- und Festplattenmetriken.
Das Talos-Dashboard. Die Screenshots zeigen die polnische Oberfläche; das Dashboard gibt es auch auf Deutsch, Englisch, Spanisch, Französisch und Chinesisch.

So funktioniert es

Verbinden. Beschreiben. Ausführen und prüfen.

Beginne mit einer App und einem beobachtbaren Ergebnis.

01 / Verbinden

Android-Gerät anschließen

Installiere Talos, lege ein Dashboard-Passwort fest und verbinde einen autorisierten Emulator oder ein Telefon per ADB. Hinterlege einen API-Schlüssel für Claude, OpenAI, Gemini oder OpenRouter oder einen eigenen Modell-Endpunkt.

02 / Festlegen

Sag dem Agenten, wie Erfolg aussieht

Wähle ein Gerät und beschreibe das Ziel. Ergänze Kontext, optionale Etappen, Limits und bei Bedarf ein eigenes Modell für diese Aufgabe. Wähle eine einmalige oder kontinuierliche Aufgabe.

03 / Prüfen

Aufgabe starten und Ergebnis ansehen

Verfolge die Gerätevorschau und öffne die Zeitleiste des Durchlaufs: was der Agent gesehen hat, welche Aktionen er ausgeführt hat, was es gekostet hat und wie der Durchlauf endete.

Wichtige Funktionen

Vom Ziel zum nachvollziehbaren Durchlauf.

Das Ergebnis in eigenen Worten festlegen

Beschreibe das Ziel und ergänze optionale Etappen mit je einem sichtbaren Erfolgskriterium – oder lass die KI die Etappen vorschlagen.

Mit der Oberfläche arbeiten, die du siehst

Der Agent liest UI-Elemente und Screenshots, tippt, scrollt, schreibt, öffnet Apps und prüft, was sich geändert hat. Vor einem Durchlauf weckt er den Bildschirm und schließt einen ungesicherten Sperrbildschirm.

Einmal ausführen oder dauerhaft laufen lassen

Wiederhole erfolgreiche Zyklen mit Pause, optionalen Arbeitszeiten und einer Zusammenfassung für den nächsten Zyklus. Vorübergehende Fehler werden wiederholt, statt die Aufgabe zu stoppen.

Verstehen, was passiert ist

Jeder Durchlauf speichert Beobachtungen, Aktionen, Ergebnisse, Erklärungen des Modells, Tokens, Kosten und Screenshots; seine Protokolleinträge sind einen Klick entfernt. Die letzten 10 Durchläufe pro Aufgabe bleiben erhalten.

Limits und Tagesbudget festlegen

Begrenze Iterationen, Laufzeit und Kosten pro Durchlauf und lege ein Tagesbudget pro Aufgabe und für alle Aufgaben fest. Ist das Tagesbudget aufgebraucht, warten kontinuierliche Aufgaben bis zum nächsten Tag.

Das Modell pro Aufgabe wählen

Nutze Claude, OpenAI, Google Gemini, OpenRouter oder einen eigenen HTTP-Endpunkt mit deinem eigenen Schlüssel. Lege Modell und Effort global oder pro Aufgabe fest; jeder Durchlauf speichert, womit er lief.

Von Problemen erfahren, ohne zuzuschauen

Erhalte eine Nachricht per Webhook, Discord, Telegram, ntfy oder E-Mail, wenn eine Aufgabe fehlschlägt, ein Limit oder ihr Tagesbudget erreicht, ihr Telefon verliert oder fertig ist.

Über die Vorschau eingreifen

Tippe in die Live-Vorschau, gib Text ein und nutze Zurück, Startbildschirm oder Letzte Apps, um ein Telefon zu entsperren oder seinen Zustand zu korrigieren. Mehrere Aufgaben können sich ein Gerät teilen und laufen nacheinander.

Ein Dashboard, das einfach weiterlaufen kann

Passwortgeschützt, API-Schlüssel gelangen nie zurück in den Browser, dazu eine Diagnoseseite mit kopierbarem Bericht und eine Oberfläche in sechs Sprachen.

Für wen?

Weniger Wiederholung für Entwickler, QA und technische Operatoren.

Setze Talos dort ein, wo die Arbeit in einer Android-Oberfläche stattfindet.

Entwickler

App-Zustand für eine Demo vorbereiten

Lege über eine zielorientierte Aufgabe einen Testkontakt an oder ändere eine sichtbare Einstellung und prüfe den Endbildschirm, bevor du loslegst.

QA- & App-Teams

Einen Ablauf über mehrere Bildschirme durchspielen

Beschreibe einen App-Ablauf mit sichtbaren Kontrollpunkten. Sieh in der Zeitleiste nach, wo der Agent erfolgreich war oder hängen blieb.

Technische Operatoren

Einen UI-basierten Ablauf wiederholen

Lass Zyklen innerhalb von Arbeitszeiten laufen, mit Tagesbudget und einer Benachrichtigung, falls die Aufgabe stoppt. Behalte die Aufgabe im Blick und stoppe sie bei Bedarf.

Warum Talos?

Absicht festlegen. Der Agent wählt den nächsten Schritt.

Talos kann den Skriptaufwand für zielorientierte Aufgaben verringern. Seine bildschirmbasierten Entscheidungen musst du aber in deiner App prüfen. Nutze Talos zusätzlich zu den Prüfungen, die in deinem Team bereits funktionieren.

Das richtige Werkzeug für die Aufgabe
Dein AblaufSkriptbasierte UI-AutomatisierungTalos-KI-Agent
Aufgabe festlegenEine Aktionsfolge und Assertions schreiben.Ein Ziel und sichtbare Erfolgskriterien beschreiben.
Auf den Bildschirm reagierenSelektoren und Verzweigungen nutzen, die du pflegst.Die nächste Aktion aus der aktuellen Oberfläche und Screenshots wählen.
Einen Durchlauf untersuchenLogs und Aufnahmen deines Frameworks auswerten.Beobachtungen, Aktionen, Ergebnisse, Screenshots, Tokens und Kosten in einer Zeitleiste prüfen.
Passt am besten zuExakten Assertions und wiederholbaren Regressions-Gates.Zielorientierter App-Bedienung, Einrichtungsaufgaben und explorativen Ablaufprüfungen.
KompromissSkriptaufwand vorab und laufende Wartung.Modelllatenz, Anbieterkosten und Entscheidungen, die variieren können.

Bevor du anfängst

Fragen und Antworten.

Was ist Talos?

Talos ist ein selbst gehosteter KI-Agent zur Automatisierung von Android-Emulatoren und -Telefonen. Du beschreibst ein Ziel, ergänzt optional Etappen mit sichtbaren Erfolgskriterien, und der Agent beobachtet die Oberfläche und wählt Aktionen über ADB.

Welche Emulatoren und Geräte kann ich verwenden?

Talos verbindet sich mit Android-Geräten, die über ADB erreichbar sind, darunter Android-Emulatoren und Telefone mit aktiviertem USB-Debugging. Das Gerät muss online und autorisiert sein. Vor einem Durchlauf weckt Talos den Bildschirm und schließt einen Sperrbildschirm ohne PIN, Muster oder Passwort; einen gesicherten Sperrbildschirm musst du selbst entsperren. iOS wird nicht unterstützt.

Muss ich Skripte schreiben oder Appium installieren?

Du kannst Aufgaben in natürlicher Sprache festlegen, ohne ein Aktionsskript zu schreiben. Talos nutzt ADB, UI-Beobachtungen und Screenshots; Appium ist nicht erforderlich. Klare Ziele und beobachtbare Erfolgskriterien bleiben wichtig, und jeder Ablauf muss in deiner App ausprobiert werden.

Welche KI-Modelle kann ich nutzen?

Claude (Anthropic), OpenAI, Google Gemini, OpenRouter oder einen eigenen HTTP-Endpunkt, der das Talos-Protokoll umsetzt. Standardmodell und Effort wählst du in den Einstellungen; jede Aufgabe kann ein eigenes Modell nutzen, etwa ein günstigeres für eine häufige Prüfung. OpenRouter-Modelle ohne Tool-Aufrufe werden vor dem ersten kostenpflichtigen Aufruf abgelehnt, und Modelle ohne Bildeingabe erhalten keine Screenshots.

Ist die KI-Nutzung in der Lizenz enthalten?

Nein. Du verwendest deinen eigenen API-Schlüssel, und der Anbieter rechnet direkt mit dir ab. Talos schätzt die Kosten anhand der Anbieterpreise, übernimmt die tatsächlichen Kosten, die OpenRouter meldet, und zeigt die Tagessumme im Dashboard. Kosten eigener Endpunkte berechnet Talos nicht.

Kann ich steuern, wie lange und wie teuer ein Agent arbeitet?

Lege Limits für Iterationen, Zeit und USD-Budget pro Durchlauf fest, dazu ein Tagesbudget pro Aufgabe und für alle Aufgaben zusammen. Das Durchlaufbudget wird nach jeder Modellantwort geprüft, daher kann der letzte Aufruf es überschreiten. Ist ein Tagesbudget aufgebraucht, warten kontinuierliche Aufgaben bis zum nächsten Tag (Serverzeit). Jede Aufgabe lässt sich im Dashboard stoppen.

Welche Daten verlassen meinen Rechner?

Dashboard, Aufgabendefinitionen, Durchlaufverlauf und Kostendaten liegen auf deinem Host, geschützt durch ein Dashboard-Passwort. Der gewählte KI-Anbieter erhält Aufgabenkontext, UI-Beobachtungen und Screenshots, die für Entscheidungen genutzt werden. Lizenzierte Installationen kontaktieren außerdem den Lizenzserver, und Benachrichtigungen gehen an die Kanäle, die du einrichtest. Selbst gehostet heißt nicht, dass alles offline verarbeitet wird.

Kann Talos meine Android-Testsuite ersetzen?

Talos kann helfen, sichtbare App-Abläufe durchzuspielen und einen nachvollziehbaren Durchlaufverlauf zu sammeln. Entscheidungen des Agenten können variieren, und Erfolg wird am Bildschirm bewertet. Behalte deterministische Tests für exakte Assertions, wiederholbare Regressionsprüfungen und Release-Gates.

Kann Talos eine Aufgabe automatisch wiederholen?

Ja. Kontinuierliche Aufgaben wiederholen erfolgreiche Zyklen nach einer einstellbaren Pause, auf Wunsch nur innerhalb von Arbeitszeiten, und geben eine Zusammenfassung an den nächsten Zyklus weiter. Vorübergehende Probleme werden bis zu viermal mit wachsender Pause wiederholt. Die Zusammenfassung ist vom Modell erzeugter Kontext, kein exaktes Ereignisprotokoll; prüfe Aktionen, die nicht doppelt ausgeführt werden dürfen.

Was passiert, wenn der Lizenzserver nicht erreichbar ist?

Eine laufende Installation arbeitet bis zu 72 Stunden nach der letzten erfolgreichen Lizenzprüfung weiter. Aufgaben lassen sich immer stoppen, auch ohne aktive Lizenz.

Mit einem Ablauf anfangen

Gib deine nächste wiederkehrende Android-Aufgabe an Talos ab.

Probiere es auf deinem eigenen Emulator oder Telefon aus. Du brauchst eine ADB-Verbindung, ein klares Ziel und deinen Modellanbieter.

Für die Testlizenz ist keine Karte nötig. KI-Nutzung wird separat abgerechnet.