ego (lite) ist nur ein Browser, ego ist Ihr persönlicher Agent für alle Geräte.
Zur Warteliste anmelden
ego lite vs. agent-browser

Die beste agent-browser-Alternative

agent-browser ist eine CLI, die ein frisches, headless Chromium steuert: öffnen, Snapshot, klicken, erneut Snapshot, ein Befehl pro Schritt, jeder ein Round-Trip durchs Modell, bevor der nächste Schritt beginnt.

ego lite drives the browser you already log into, batching actions in JavaScript instead of one command per step. Across 31 live-site jobs it finishes 96.8% of tasks with a perfect score; agent-browser finishes 74.2%.

Vertraut von Entwicklern von
GoogleAmazonShopifyTikTokHarvardStanfordUSCUCLA

Browser automation benchmark: ego lite vs agent-browser

This is browser automation on the live web, not a sandbox CLI demo. We gave ego lite and agent-browser the same 31 multi-step tasks on real sites: several pages, several decisions, often a login you already have. A fresh headless profile stalls on those sessions. A real browser does not. Both ran the identical set, so the bars below compare the same jobs.

agent: pimodel: ChatGPT 5.6 Solthinking: max31 tasks

Task completion rate

How often the agent finished the job. Stuck at login, skipped a step, or returned the wrong result: that task is a fail. Higher is better.

ego lite96.8%30 of 31 tasks perfect
agent-browser74.2%23 of 31 tasks perfect

Cost per completed task

What one finished job costs in model spend. Failures still get billed, so they push this number up. Lower is better.

ego lite$1.98
agent-browser$3.72

Model turns per task

How many times the model had to look at the page and choose the next action. Extra looks mean extra tokens, extra waiting, and extra places to stall. Lower is better.

ego lite30.3
agent-browser45.6

Average task time

How long a job took from start to finish, on average, including time spent waiting on the model. Lower is better.

ego lite8m 38s
agent-browser11m 02s

We ran every tool twice and kept the better score. A failed task still counts against it.

Check the numbers, or rerun the tasks yourselfThe 31 tasks, the grading checklists, and the raw results are open source. If a number looks off, open the repo.ego-browser-benchmark-framework

Warum ego lite besser ist als agent-browser

Beide Tools existieren, weil Coding-Agenten mehr verdienen als MCP-Konfiguration und rohes HTML. Der Unterschied liegt in der Ausführung. agent-browser startet eine frische Automatisierungssitzung hinter einem Rust-Daemon, der Chrome direkt steuert; ego lite macht den Browser, in dem du ohnehin lebst, agentennativ, sodass Aufgaben mit deinen echten Sitzungen laufen, günstiger pro Aufgabe, und sichtbar genug, dass du jederzeit das Steuer übernehmen kannst.

96.8% of tasks done perfectly. No other tool tops 84%.

agent-browser's core loop is open, snapshot, click @e2, snapshot again: each step a command the model reads before deciding the next one, and every extra round trip is another chance to lose the thread. On those 31 jobs, one agent-browser task in four ends short of a perfect score.

ego lite reaches the page as a compressed Snapshot with stable @N refs, and the agent acts on several of them in one JavaScript turn. Fewer round trips leave fewer places to stall: 96.8% of the same 31 tasks end perfect, at the fastest average task time of the five tools measured.

Time to finish a task, shorter is better
518 sego (lite)
662 sKI-Agenten-Browser
Data source - Task: finish an average live-site job

Paralleles Multitasking, schnellere Ausführung

Die Parallelität von agent-browser besteht aus --session-Flags, die du selbst verwaltest, standardmäßig headless, sodass dir ein hängender Dialog nur die CLI-Ausgabe zum Rätseln lässt. Das --headed-Flag, das das beheben soll, hat offene Bug-Reports darüber, dass es ignoriert wird oder Chrome stattdessen in eine Absturzschleife gerät, statt ein Fenster anzuzeigen.

In ego lite gibt es kein Limit für Spaces: Jeder erledigt gleichzeitig seine eigene Aufgabe, standardmäßig headful, mit seinem eigenen importierten Chrome-Profil. Keiner davon kapert deinen Tab, und du kannst jederzeit zusehen oder übernehmen.

Kein Hin und Her mehr Geringere Token-Kosten

Ein typischer agent-browser-Ablauf ist: öffnen, Snapshot, @e2 klicken, @e3 ausfüllen, erneut Snapshot: separate Befehle, jeder ein Round-Trip, den das Modell liest, bevor es den nächsten Schritt entscheidet. Der Batch-Modus kann Schritte in eine Warteschlange stellen, aber das Modell kann erst auf einen Snapshot reagieren, wenn der gesamte Batch zurückkommt.

Der Agent von ego lite schreibt ein paar Zeilen JavaScript, die mehrere Schritte in einem Zug ausführen, und liest das Ergebnis als komprimierten Snapshot. Zusammen sorgt das dafür, dass eine ganze Aufgabe deutlich unter einer Befehl-pro-Aktion-Schleife bleibt.

Claude Code · ego lite
>/ego-browser Add the first product to the cart, then check checkout loads
Bash(
ego-browser nodejs <<'EOF' await openOrReuseTab('localhost:3000') await click('.product-card') await click('.add-to-cart') await click('a[href="/checkout"]') cliLog('checkout loaded') EOF
)
Output:
[t=4480ms] checkout loaded
Done. Both steps work.
─── 1 tool call · 1.1k tokens ───
Claude Code · agent-browser
>Add the first product to the cart, then check checkout loads
$agent-browser open localhost:3000
stdout
Navigated to http://localhost:3000
1.6k tokens sent so far
Storefront loaded. Need a snapshot to find the first product.
$agent-browser snapshot -i
Snapshot
… +224 lines (ctrl+o to expand)
3.1k tokens sent so far
Found the first product card at @e18. Clicking it.
$agent-browser click @e18
stdout
Clicked @e18
4.9k tokens sent so far
Product page loaded, but refs are stale now. Snapshotting again.
$agent-browser snapshot -i
Snapshot
… +205 lines (ctrl+o to expand)
6.8k tokens sent so far
Add to cart button is @e7.
$agent-browser click @e7
stdout
Clicked @e7
9.2k tokens sent so far
Added. Heading to checkout.
$agent-browser click @e24
stdout
Clicked @e24
11.2k tokens sent so far
Confirming the checkout page actually loaded.
$agent-browser wait --url "**/checkout"
stdout
Matched http://localhost:3000/checkout
13.6k tokens sent so far
─── 7 tool calls · 13.6k tokens ───
Dieselbe Aufgabe, dasselbe Modell. Links: ein gebündelter JavaScript-Aufruf in ego lite, insgesamt 1.1k Tokens. Rechts: die CLI von agent-browser, ein Befehl pro Aktion, 7 Round-Trips, die Tokens steigen auf 13.6k.

Dasselbe Chrome, nativ für Agenten

agent-browser auf dein echtes Chrome zu bringen, braucht Einrichtung: Ein Profilname kopiert dein Profil in einen schreibgeschützten Snapshot, oder ein persistenter Pfad soll Logins über Neustarts hinweg erhalten, wobei es einen offenen Bericht gibt, dass er unter Linux leer bleibt. Die Alternative, ein Remote-Debugging-Port, macht die volle Browserkontrolle für jeden lokalen Prozess zugänglich. Überspringst du die Einrichtung, bekommst du ein frisches, headless Profil, das bei jedem Captcha und jeder 2FA-Abfrage steckenbleibt.

ego lite importiert dein Chrome-Profil mit einem Klick, live.

ego lite Chrome-Profilimport: Einrichtung mit einem Klick, inklusive aller Logins

ego lite vs. agent-browser

Funktionsvergleich zwischen ego lite und agent-browser.
Funktionego liteagent-browser
Standard-BrowserzustandDein importiertes Chrome-Profil: Logins, Cookies, ErweiterungenFrisches, headless Profil; um echtes Chrome weiterzuverwenden, braucht es eine --profile-Snapshot-Kopie oder eine manuelle CDP-Verbindung
So agiert der Agent auf einer SeiteBündelt mehrere Aktionen in wenigen Zeilen JavaScript pro ZugEin Befehl pro Aktion; der Batch-Modus kann Schritte in eine Warteschlange stellen, aber während des Laufs nicht anhand eines Snapshots verzweigen
Wie der Agent eine Seite liestKomprimierter Snapshot: Accessibility-Tree mit stabilen @N-ReferenzenÄhnlich: kompakter Accessibility-Snapshot mit @e-Referenzen
Browser automation on live sites (31 tasks, same model)96.8% perfect, $1.98 per completed task, 8m 38s average74.2% perfect, $3.72 per completed task, 11m 02s average
Eine Aufgabe beobachten oder übernehmenJa. Standardmäßig headful Fenster; einklicken und selbst zu Ende bringenStandardmäßig headless; zum Zusehen ist das separate --headed-Flag nötig
Parallele AufgabenSpaces führen Aufgaben nebeneinander aus, ohne je deine Tabs anzufassenMehrere isolierte Sitzungen über --session-Flags, verwaltet und überwacht über die CLI
Wiederverwendbare Skills (bald verfügbar)Verdichtet erfolgreiche Durchläufe zu wiederverwendbaren Skills; bis zu 5-mal schneller bei komplexen Aufgaben, wenn der Agent sie wiederholt (limitierte Beta)Keine integrierte Entsprechung
EinrichtungApp installieren, /ego-browser in deinem Agenten ausführenInstallation über npm, Homebrew oder Cargo, danach agent-browser install, um einen Chrome-for-Testing-Build herunterzuladen
PreisKostenlos, kein Abo; die ego-browser-Shell ist MIT-lizenziertKostenlos und Open Source
Zuletzt aktualisiert 20. Aug. 2026

Der nahtlose Wechsel

Wenn dich agent-browser davon überzeugt hat, dass Coding-Agenten einen Browser direkt steuern sollten, ist ego lite dieselbe Überzeugung mit deinem echten Browser dabei. Der Wechsel dauert Minuten, und nichts muss deinstalliert werden.

  1. ego (lite) herunterladen

    Lade ego lite herunter und importiere dein Chrome-Profil mit einem Klick. Logins, Cookies und Erweiterungen sind direkt mit dabei, ganz ohne --profile-Flag oder Kopie des Profilverzeichnisses.

  2. Starte deine erste Aufgabe mit /ego-browser

    In deinen Agenten einfügen

    /ego-browser ego.app öffnen und prüfen, dass die Preisseite lädt

    Füge einen Satz in Claude Code, Codex, Cursor oder Gemini CLI ein und drücke Enter. Kein Daemon zu starten, kein CDP-Port zu öffnen, kein Session-Flag zu verwalten.

  3. Sieh es dir bei der Arbeit an
    Übersicht über ego lite Spaces mit vier Browser-Aufgaben, die nebeneinander laufen und gleichzeitig sichtbar sind, anders als die headless --session-Instanzen von agent-browser: Claude Code verfolgt Apple-Aktien auf Yahoo Finance, Codex filtert Autos nach Baujahr auf cars.com, Hermes schließt eine SaaS-Back-Office-Aufgabe ab, ein Nutzer scrapt X, und eine Hand tippt auf +, um einen weiteren Space zu öffnen

    Die Aufgabe läuft in ihrem eigenen Space, deine Tabs bleiben also unangetastet. Das Browserfenster ist echt: live zuschauen oder jederzeit übernehmen. Die Ergebnisse landen zurück in der CLI deines Agents.

Behalte agent-browser für headless CI-Checks, wenn es dort schon in eine Pipeline eingebunden ist. ego lite übernimmt die interaktive Arbeit auf deiner eigenen Maschine und mit deinen Accounts.

Wann sich welches Tool eignet

Wähle ego (lite), wenn

  • Deine Aufgaben betreffen echte Accounts: Gmail, Dashboards, alles hinter SSO, und dein importiertes Profil ist bereits angemeldet, live, ohne Profilkopie-Schritt oder manuell geöffneten CDP-Port.
  • Du willst Token-Ersparnis pro Aufgabe durch Snapshot-Input plus gebündelte Multi-Aktions-JavaScript-Aufrufe, kombiniert, statt einem CLI-Befehl-Round-Trip pro Aktion.
  • Du willst Aufgaben standardmäßig headful in parallelen Spaces zusehen und in dem Moment übernehmen, in dem eine einen Menschen braucht, ganz ohne separates Flag oder plattformspezifische Display-Einrichtung.
  • Du willst, dass der Browser, in dem du ohnehin lebst, der KI-Agenten-Browser ist: kein Daemon zu verwalten, keine Session-Flags, keine CDP-Verbindung einzurichten.

Wähle agent-browser, wenn

  • Du läufst in headless CI-Umgebungen oder Serverless-Funktionen, wo kein Desktop-Browser verfügbar ist und wegwerfbare Sitzungen genau der Sinn der Sache sind.
  • Du baust auf Vercel Sandbox oder steckst schon tief im Vercel-Ökosystem und willst ein Tool, das dafür mitentwickelt wurde.
  • Du willst einen minimalen Footprint auf Servern: eine Rust-CLI und ein Daemon ohne Abhängigkeit von Playwright oder einer Node.js-Laufzeitumgebung, installierbar über npm, Homebrew oder Cargo.
  • Du brauchst iOS-Safari-Abdeckung über WebDriver, was ego lite, nur Chromium, nicht abdeckt.

Gib deinem Agenten einen echten Browser

Kostenlos, läuft auf deinem Mac und importiert dein Chrome-Profil mit einem Klick. Funktioniert mit Claude Code, Codex, Cursor und jedem CLI-Agenten, der Code schreibt.

Noch am Abwägen? Sieh, wie agent-browser im Vergleich zu den anderen Tools in diesem Bereich abschneidet.

FAQ

agent-browser, auch bekannt als Vercel agent-browser, da Vercel Labs es entwickelt hat, ist eine Open-Source-CLI für Browser-Automatisierung, gebaut für KI-Coding-Agenten: eine Rust-CLI vor einem reinen Rust-Daemon, der Chrome direkt über das DevTools-Protokoll steuert, ganz ohne Playwright oder Node.js-Laufzeitumgebung. Der snapshot-Befehl liefert einen kompakten Accessibility-Tree mit @e-Referenzen, sodass Agenten gegen stabile Referenzen klicken und ausfüllen statt gegen brüchige Selektoren, und es wird als Skill für Claude Code, Codex, Cursor, Gemini CLI, GitHub Copilot und die meisten anderen Coding-Agenten ausgeliefert, mit einem MCP-Server als optionalem Subcommand statt als Standardweg. Es ist kostenlos, gut durchdacht und weit verbreitet.

Ja, wenn es bei deinen Aufgaben um echte Accounts geht oder sie davon profitieren, sichtbar zu sein. Beide geben einem Coding-Agenten einen Browser über eine CLI oder einen Skill statt über ein MCP-first-Setup; ego lite ergänzt das standardmäßig live importierte Chrome-Profil, headful Fenster, die du übernehmen kannst, parallele Spaces und die Ausführung mehrerer Aktionen in JavaScript. agent-browser bleibt eine saubere Wahl für wegwerfbare, headless Automatisierung in Skripten und CI.

We ran both tools on the same 31 browser automation tasks on live websites, driven by the same pi agent with the same model (gpt-5.6-sol, thinking effort max) and graded by the same written checklist. Each tool keeps its better of two full runs, so a failed task still counts. ego lite finished 30 of 31 tasks perfectly (96.8%) at $1.98 per completed task, averaging 8 minutes 38 seconds per task; agent-browser finished 23 of 31 (74.2%) at $3.72, averaging 11 minutes 2 seconds. The tasks, the checklists, and the raw results are open source in the ego-browser-benchmark-framework repository on GitHub, so every number can be audited or reproduced.

Ja, mit zusätzlicher Einrichtung, und noch nicht ganz zuverlässig. Übergibst du einen Profilnamen, kopiert agent-browser dieses Chrome-Profil als schreibgeschützten Snapshot in ein temporäres Verzeichnis, sodass es mit deinen bestehenden Logins startet, aber nichts, was während der Sitzung geschrieben wird, zurück in dein echtes Profil kopiert wird; unter Windows musst du Chrome außerdem vorher schließen, da Profildateien gesperrt sein können. Es gibt auch einen persistenten Profilmodus, der Cookies und Login-Status eigenständig über Neustarts hinweg erhalten soll, aber dazu gibt es einen offenen Bug-Report, dass das Profilverzeichnis zwischen den Läufen leer bleibt. Eine Verbindung zu einem laufenden Chrome über CDP funktioniert ebenfalls, aber die eigene Dokumentation des Projekts weist darauf hin, dass dieser Port die volle Browserkontrolle für jeden lokalen Prozess offenlegt. In ego lite ist der eingeloggte Browser der Standard: Importiere dein Profil einmal, und jede Agent-Aufgabe startet live davon, ganz ohne zusätzliche Flags.

The snapshot is only half of it. agent-browser's batch mode can fire a fixed list of commands in one process launch, but the model still can't act on what a snapshot returns until the whole batch finishes, so a task where each step depends on the last ends up as a long chain of command-then-model-reads-the-result cycles. ego lite lets the agent batch several actions in one JavaScript execution and reason about the result immediately, reading it as a compressed Snapshot. The savings come from the two stacked together, and they show up per task: across those 31 jobs, ego lite averages 30.3 model round trips to agent-browser's 45.6, which works out to $1.98 per completed task against $3.72.

Nein. Das ist eine Philosophie, die beide Tools teilen. Die primäre Schnittstelle von agent-browser ist seine CLI, mit einem MCP-Server als optionalem Subcommand für Clients, die einen wollen. ego lite verbindet sich über die ego-browser-Shell, indem du /ego-browser in deinem Agenten ausführst. Bei keinem der beiden musst du standardmäßig MCP-Konfigurationsdateien bearbeiten.

Ja. Sie stehen sich nicht im Weg. Manche Entwickler behalten agent-browser für headless Checks in CI oder auf Vercel Sandbox und nutzen ego lite für alles Interaktive: eingeloggte Aufgaben, parallele Recherche, alles, was sich zu beobachten lohnt. In der Praxis sind die eingeloggten Aufgaben die meisten davon.

Ja. ego lite ist kostenlos, ganz ohne Abo, und die ego-browser-Shell, über die sich dein Agent verbindet, ist MIT-lizenzierte Open Source.