ego (lite) es solo un navegador, ego es su agente personal en todos sus dispositivos.
Únanse a la lista de espera
ego lite vs agent-browser

La mejor alternativa a agent-browser

agent-browser es una CLI que maneja un Chromium headless recién abierto: abrir, sacar snapshot, hacer clic, sacar snapshot de nuevo, un comando por paso, cada uno una ida y vuelta por el modelo antes de que empiece el siguiente paso.

ego lite drives the browser you already log into, batching actions in JavaScript instead of one command per step. Across 31 live-site jobs it finishes 96.8% of tasks with a perfect score; agent-browser finishes 74.2%.

Con la confianza de desarrolladores de
GoogleAmazonShopifyTikTokHarvardStanfordUSCUCLA

Browser automation benchmark: ego lite vs agent-browser

This is browser automation on the live web, not a sandbox CLI demo. We gave ego lite and agent-browser the same 31 multi-step tasks on real sites: several pages, several decisions, often a login you already have. A fresh headless profile stalls on those sessions. A real browser does not. Both ran the identical set, so the bars below compare the same jobs.

agent: pimodel: ChatGPT 5.6 Solthinking: max31 tasks

Task completion rate

How often the agent finished the job. Stuck at login, skipped a step, or returned the wrong result: that task is a fail. Higher is better.

ego lite96.8%30 of 31 tasks perfect
agent-browser74.2%23 of 31 tasks perfect

Cost per completed task

What one finished job costs in model spend. Failures still get billed, so they push this number up. Lower is better.

ego lite$1.98
agent-browser$3.72

Model turns per task

How many times the model had to look at the page and choose the next action. Extra looks mean extra tokens, extra waiting, and extra places to stall. Lower is better.

ego lite30.3
agent-browser45.6

Average task time

How long a job took from start to finish, on average, including time spent waiting on the model. Lower is better.

ego lite8m 38s
agent-browser11m 02s

We ran every tool twice and kept the better score. A failed task still counts against it.

Check the numbers, or rerun the tasks yourselfThe 31 tasks, the grading checklists, and the raw results are open source. If a number looks off, open the repo.ego-browser-benchmark-framework

Por qué ego lite es mejor que agent-browser

Ambas herramientas existen porque los agentes de código merecen algo mejor que configurar MCP y lidiar con HTML sin procesar. La diferencia está en la ejecución. agent-browser inicia una sesión de automatización nueva detrás de un daemon en Rust que maneja Chrome directamente; ego lite convierte el navegador en el que ya vivís en uno nativo para agentes, así que las tareas corren con tus sesiones reales, cuestan menos por tarea, y son lo bastante visibles como para que puedas tomar el control.

96.8% of tasks done perfectly. No other tool tops 84%.

agent-browser's core loop is open, snapshot, click @e2, snapshot again: each step a command the model reads before deciding the next one, and every extra round trip is another chance to lose the thread. On those 31 jobs, one agent-browser task in four ends short of a perfect score.

ego lite reaches the page as a compressed Snapshot with stable @N refs, and the agent acts on several of them in one JavaScript turn. Fewer round trips leave fewer places to stall: 96.8% of the same 31 tasks end perfect, at the fastest average task time of the five tools measured.

Time to finish a task, shorter is better
518 sego (lite)
662 snavegador para agentes de IA
Data source - Task: finish an average live-site job

Multitarea en paralelo, ejecución más rápida

El paralelismo de agent-browser es un conjunto de flags --session que tenés que gestionar vos mismo, headless por defecto, así que un diálogo colgado te deja adivinando solo a partir de la salida de la CLI. El flag --headed pensado para arreglar eso tiene reportes de bugs abiertos de que se ignora, o de que Chrome entra en un ciclo de fallos en vez de mostrar una ventana.

En ego lite no hay límite de Spaces: cada uno corre su propia tarea a la vez, con ventana visible por defecto, sobre su propio perfil de Chrome importado. Ninguno te roba la pestaña, y podés mirar o tomar el control en cualquier momento.

Se acabó el ida y vuelta Menos costo en tokens

Un flujo típico de agent-browser es abrir, sacar snapshot, hacer clic en @e2, llenar @e3, sacar snapshot de nuevo: comandos separados, cada uno una ida y vuelta que el modelo lee antes de decidir el siguiente paso. Su modo batch puede encolar pasos, pero el modelo no puede actuar sobre un snapshot hasta que todo el lote termina.

El agente de ego lite escribe unas pocas líneas de JavaScript que ejecutan varios pasos en un solo turno, leyendo el resultado como un Snapshot comprimido. Sumado todo, eso mantiene una tarea completa muy por debajo de un ciclo de un comando por acción.

Claude Code · ego lite
>/ego-browser Add the first product to the cart, then check checkout loads
Bash(
ego-browser nodejs <<'EOF' await openOrReuseTab('localhost:3000') await click('.product-card') await click('.add-to-cart') await click('a[href="/checkout"]') cliLog('checkout loaded') EOF
)
Output:
[t=4480ms] checkout loaded
Done. Both steps work.
─── 1 tool call · 1.1k tokens ───
Claude Code · agent-browser
>Add the first product to the cart, then check checkout loads
$agent-browser open localhost:3000
stdout
Navigated to http://localhost:3000
1.6k tokens sent so far
Storefront loaded. Need a snapshot to find the first product.
$agent-browser snapshot -i
Snapshot
… +224 lines (ctrl+o to expand)
3.1k tokens sent so far
Found the first product card at @e18. Clicking it.
$agent-browser click @e18
stdout
Clicked @e18
4.9k tokens sent so far
Product page loaded, but refs are stale now. Snapshotting again.
$agent-browser snapshot -i
Snapshot
… +205 lines (ctrl+o to expand)
6.8k tokens sent so far
Add to cart button is @e7.
$agent-browser click @e7
stdout
Clicked @e7
9.2k tokens sent so far
Added. Heading to checkout.
$agent-browser click @e24
stdout
Clicked @e24
11.2k tokens sent so far
Confirming the checkout page actually loaded.
$agent-browser wait --url "**/checkout"
stdout
Matched http://localhost:3000/checkout
13.6k tokens sent so far
─── 7 tool calls · 13.6k tokens ───
La misma tarea, el mismo modelo. Izquierda: una sola llamada agrupada de JavaScript en ego lite, 1.1k tokens en total. Derecha: la CLI de agent-browser, un comando por acción, 7 idas y vueltas, los tokens suben a 13.6k.

El mismo Chrome, nativo para agentes

Llevar agent-browser a tu Chrome real requiere configuración: un nombre de perfil copia tu perfil en un snapshot de solo lectura, o una ruta persistente que en teoría mantiene las sesiones iniciadas entre reinicios, aunque hay un reporte abierto de que queda vacía en Linux. La alternativa, un puerto de depuración remota, expone el control total del navegador a cualquier proceso local que se conecte a él. Si te saltás la configuración, obtenés un perfil headless nuevo que se traba en cada captcha y aviso de 2FA.

ego lite importa tu perfil de Chrome con un clic, en vivo.

Importación del perfil de Chrome en ego lite: configuración con un clic y todas tus sesiones

ego lite vs agent-browser

Comparación de funciones entre ego lite y agent-browser.
Funciónego liteagent-browser
Estado del navegador por defectoTu perfil de Chrome importado: sesiones iniciadas, cookies, extensionesPerfil headless nuevo; reutilizar tu Chrome real requiere una copia snapshot con --profile o una conexión manual por CDP
Cómo actúa el agente sobre una páginaAgrupa varias acciones en pocas líneas de JavaScript por turnoUn comando por acción; el modo batch puede encolar pasos pero no puede ramificarse según un snapshot a mitad de la ejecución
Cómo lee la página el agenteSnapshot comprimido: árbol de accesibilidad con referencias @N establesSimilar: snapshot de accesibilidad compacto con referencias @e
Browser automation on live sites (31 tasks, same model)96.8% perfect, $1.98 per completed task, 8m 38s average74.2% perfect, $3.72 per completed task, 11m 02s average
Mirar o tomar el control de una tareaSí. Ventanas visibles por defecto; entrá y terminala vos mismoHeadless por defecto; para mirar hace falta el flag aparte --headed
Tareas en paraleloLos Spaces corren tareas lado a lado, sin tocar nunca tus pestañasVarias sesiones aisladas mediante flags --session, gestionadas y monitoreadas desde la CLI
Habilidades reutilizables (próximamente)Convierte las ejecuciones exitosas en habilidades reutilizables; hasta 5 veces más rápido en tareas complejas a medida que el agente las repite (beta limitada)Sin equivalente incorporado
ConfiguraciónInstalá la app y ejecutá /ego-browser en tu agenteInstalación con npm, Homebrew o Cargo, y después agent-browser install para descargar un build de Chrome for Testing
PrecioGratis, sin suscripción; el shell ego-browser tiene licencia MITGratis y de código abierto
Última actualización 20 ago 2026

Hacé de esto una transición sin fricciones

Si agent-browser te convenció de que los agentes de código deberían manejar un navegador directamente, ego lite es la misma convicción pero con tu navegador real conectado. Cambiar toma minutos, y no hay que desinstalar nada.

  1. Descargar ego (lite)

    Descargá ego lite e importá tu perfil de Chrome con un clic. Las sesiones iniciadas, cookies y extensiones vienen incluidas, sin necesitar el flag --profile ni copiar el directorio de perfil.

  2. Ejecuta tu primera tarea con /ego-browser

    Pega esto en tu agente

    /ego-browser Abrí ego.app y verificá que la página de precios cargue

    Pegá una oración en Claude Code, Codex, Cursor o Gemini CLI y presioná enter. Sin daemon que iniciar, sin puerto CDP que abrir, sin flag de sesión que gestionar.

  3. Míralo en acción
    Vista general de Spaces de ego lite con cuatro tareas de navegador corriendo lado a lado y visibles a la vez, a diferencia de las instancias headless --session de agent-browser: Claude Code siguiendo la acción de Apple en Yahoo Finance, Codex filtrando autos por año en cars.com, Hermes terminando una tarea de back office de un SaaS, un usuario extrayendo datos de X, y una mano tocando + para abrir otro Space

    La tarea se ejecuta en su propio Space, así que tus pestañas quedan intactas. La ventana del navegador es real: obsérvala en vivo o toma el control cuando quieras. Los resultados vuelven a la CLI de tu agente.

Mantené agent-browser para las verificaciones headless en CI si ya está conectado a un pipeline ahí. ego lite cubre el trabajo interactivo en tu propia máquina y tus propias cuentas.

Cuándo usar cada herramienta

Elegí ego (lite) cuando

  • Tus tareas tocan cuentas reales: Gmail, dashboards, cualquier cosa detrás de SSO, y tu perfil importado ya tiene sesión iniciada, en vivo, sin un paso de copia de perfil ni un puerto CDP abierto manualmente.
  • Querés ahorro de tokens por tarea gracias a la entrada por Snapshot más lotes de JavaScript multiacción, combinados, en lugar de una ida y vuelta de comando de CLI por acción.
  • Querés ver las tareas correr con ventana visible en Spaces paralelos por defecto, y tomar el control apenas una necesite a un humano, sin un flag aparte ni configuración de pantalla específica de la plataforma.
  • Querés que el navegador en el que ya vivís sea el navegador para agentes de IA: sin daemon que gestionar, sin flags de sesión, sin conexión CDP que configurar.

Elegí agent-browser cuando

  • Corrés en entornos de CI headless o funciones serverless donde no hay un navegador de escritorio disponible y el objetivo son las sesiones descartables.
  • Estás construyendo sobre Vercel Sandbox o ya estás metido de lleno en el ecosistema de Vercel y querés una herramienta diseñada junto a él.
  • Querés una huella mínima en los servidores: una CLI y un daemon en Rust sin dependencia de Playwright ni de un runtime de Node.js, instalable vía npm, Homebrew o Cargo.
  • Necesitás cobertura de iOS Safari a través de WebDriver, algo que ego lite, que es solo Chromium, no cubre.

Dale a tu agente un navegador real

Gratis, funciona en tu Mac e importa tu perfil de Chrome con un clic. Funciona con Claude Code, Codex, Cursor y cualquier agente de CLI que escriba código.

¿Todavía estás evaluando tus opciones? Mirá cómo se compara agent-browser con las demás herramientas de esta categoría.

Preguntas frecuentes

agent-browser, también conocido como agent-browser de Vercel porque lo construyó Vercel Labs, es una CLI de automatización de navegador de código abierto pensada para agentes de código de IA: una CLI en Rust delante de un daemon puro en Rust que maneja Chrome directamente sobre el DevTools protocol, sin necesitar Playwright ni un runtime de Node.js para correr. Su comando snapshot devuelve un árbol de accesibilidad compacto con referencias @e, así que los agentes hacen clic y llenan campos contra referencias estables en lugar de selectores frágiles, y viene como skill para Claude Code, Codex, Cursor, Gemini CLI, GitHub Copilot y la mayoría de los demás agentes de código, con un servidor MCP disponible como subcomando opcional en vez de ser el camino por defecto. Es gratis, está bien diseñado y tiene una adopción amplia.

Sí, si las tareas que te importan involucran tus cuentas reales o se benefician de ser visibles. Ambas le dan a un agente de código un navegador a través de una CLI o skill en lugar de una configuración basada en MCP; ego lite suma tu perfil de Chrome importado en vivo por defecto, ventanas visibles de las que podés tomar el control, Spaces en paralelo y ejecución de JavaScript multiacción. agent-browser sigue siendo una opción limpia para automatización headless descartable en scripts y CI.

We ran both tools on the same 31 browser automation tasks on live websites, driven by the same pi agent with the same model (gpt-5.6-sol, thinking effort max) and graded by the same written checklist. Each tool keeps its better of two full runs, so a failed task still counts. ego lite finished 30 of 31 tasks perfectly (96.8%) at $1.98 per completed task, averaging 8 minutes 38 seconds per task; agent-browser finished 23 of 31 (74.2%) at $3.72, averaging 11 minutes 2 seconds. The tasks, the checklists, and the raw results are open source in the ego-browser-benchmark-framework repository on GitHub, so every number can be audited or reproduced.

Sí, con configuración adicional, y todavía no es del todo confiable. Le pasás un nombre de perfil y agent-browser copia ese perfil de Chrome a un directorio temporal como un snapshot de solo lectura, así que arranca con tus sesiones iniciadas existentes, pero nada de lo que se escribe durante la sesión se copia de vuelta a tu perfil real; en Windows también tenés que cerrar Chrome primero, porque los archivos del perfil pueden estar bloqueados. También hay un modo de perfil persistente pensado para mantener cookies y sesiones iniciadas entre reinicios por su cuenta, pero tiene un reporte de bug abierto de que el directorio del perfil queda vacío entre ejecuciones. Conectarse a un Chrome en ejecución vía CDP también funciona, pero la propia documentación del proyecto advierte que ese puerto expone el control total del navegador a cualquier proceso local. En ego lite el navegador con sesión iniciada es lo predeterminado: importás tu perfil una vez y cada tarea del agente arranca desde ahí, en vivo, sin flags adicionales.

The snapshot is only half of it. agent-browser's batch mode can fire a fixed list of commands in one process launch, but the model still can't act on what a snapshot returns until the whole batch finishes, so a task where each step depends on the last ends up as a long chain of command-then-model-reads-the-result cycles. ego lite lets the agent batch several actions in one JavaScript execution and reason about the result immediately, reading it as a compressed Snapshot. The savings come from the two stacked together, and they show up per task: across those 31 jobs, ego lite averages 30.3 model round trips to agent-browser's 45.6, which works out to $1.98 per completed task against $3.72.

No. Esa es una filosofía que ambas herramientas comparten. La interfaz principal de agent-browser es su CLI, con un servidor MCP disponible como subcomando opcional para los clientes que lo quieran. ego lite se conecta a través del shell ego-browser corriendo /ego-browser dentro de tu agente. Ninguna requiere editar archivos de configuración de MCP como camino por defecto.

Sí. No entran en conflicto. Algunos desarrolladores mantienen agent-browser para verificaciones headless en CI o en Vercel Sandbox, y usan ego lite para todo lo interactivo: tareas con sesión iniciada, investigación en paralelo, cualquier cosa que valga la pena mirar. En la práctica, las tareas con sesión iniciada son la mayoría.

Sí. ego lite es gratis y sin suscripción, y el shell ego-browser a través del cual se conecta tu agente es de código abierto con licencia MIT.