
ego (lite) es un navegador en el que tú y tus agentes de IA trabajan en paralelo. Tus pestañas siguen siendo tuyas mientras los agentes ejecutan varias tareas de navegador en sus propios Spaces, con más rapidez y menos tokens.
Durante el último año, muchos de nosotros hemos intentado que agentes de IA ( Claude Code, Codex, Continue) realicen automatización en un navegador real. Obtén una lista de un panel de administración con sesión iniciada. Completa un formulario de proveedor. Ejecuta el control de calidad en un entorno de prueba. Las herramientas para hacerlo existen, pero la experiencia sigue siendo difícil.
ego (lite) es nuestro intento de resolver ese problema.
¿Qué es ego (lite)?
ego (lite) está profundamente integrado en el ecosistema de Chrome. Usa el mismo motor que Chrome y conserva todos tus marcadores, extensiones y sesiones iniciadas. No necesitas cambiar tu forma de navegar: funciona desde el primer momento.
Lo que realmente lo distingue es su soporte nativo para agentes:
- Base de código, no base de CLI, para ejecuciones más rápidas con menos tokens en tareas complejas. Las funciones que ego (lite) expone al agente están encapsuladas como funciones de JavaScript que el agente llama directamente. Así puede hacer lo que mejor sabe: escribir código y componer una tarea de varios pasos en una sola ejecución, en lugar de quedar atrapado en el ciclo «ejecutar dos comandos, mirar el resultado y ejecutar otros dos». Frente al enfoque convencional basado en CLI, los flujos de trabajo complejos terminan entre un 20 % y un 50 % más rápido, con una mayor tasa de éxito y muchas menos llamadas a herramientas por tarea. El mismo patrón aparece en nuestras pruebas internas frente al agent-browser de Vercel: cuanto más complejo es el flujo, mayor es la diferencia.
- Un Space dedicado para cada agente. ego (lite) asigna a cada agente un Space completamente aislado. Tú navegas en primer plano mientras el agente trabaja en segundo plano, sin interponerse. Puedes ver en todo momento qué Space tiene un agente activo, tomar el control o detenerlo cuando quieras. Si has usado herramientas como agent-browser que se conectan a Chrome, ya conoces el caos de ventanas y pestañas que aparecen por todas partes. ego (lite) resuelve el problema de raíz.
- Tus agentes realizan varias tareas en Spaces, espacios de trabajo paralelos dentro del mismo navegador. Cada Space tiene su propio agente de IA o su propia tarea, y todos se ejecutan al mismo tiempo. Claude Code enriquece 10 prospectos en 10 Spaces paralelos. Codex recopila datos de 5 sitios de la competencia en otros 5. No chocan ni ocupan tus pestañas. Tu mouse permanece donde lo dejaste.
- La página Snapshot más potente del mercado. Gracias a la personalización a nivel de kernel, ego (lite) genera Snapshots de página de gran calidad: la vista que los modelos de texto utilizan para «ver» una web y actuar sobre ella. Gestiona de forma fiable casos difíciles, como iframes muy anidados, justo donde otros enfoques suelen fallar.
- Cualquier agente puede controlarlo mediante
ego-browser. ego-browser es la capa de conexión entre cualquier CLI de agente —Claude Code, Codex, Cursor o una propia— y ego (lite). Expone el navegador como un conjunto de herramientas JavaScript dentro de la página: snapshot, fill, click, wait, navigate y capture. El agente escribe un fragmento de JavaScript que llama a esas herramientas y ego-browser lo ejecuta en la página de una sola vez. - Acumulación de experiencia que hace que tu agente sea más rápido cuanto más lo uses (próximamente). En las tareas de navegador, el agente dedica la mayor parte del tiempo a probar y corregir. La Skill oficial de ego (lite) convierte cada acción que funciona en herramientas y flujos de trabajo reutilizables, de modo que las tareas similares posteriores pueden ejecutarse hasta 5 veces más rápido. Más adelante lo explicamos con detalle.
Por qué construimos ego (lite)
Tenemos una opinión sobre la pregunta «¿está muriendo la GUI?». La GUI llegó para quedarse. Lo que cambiará de raíz es quién la proporciona. Hoy, cada plataforma incluye su propia interfaz prediseñada. Mañana, tu agente personal te generará una sobre la marcha.
Ese es el futuro. La realidad de hoy es que los agentes ya tienen que hacer mucho trabajo real y el mundo aún no está hecho para ellos. Muchos servicios todavía no incluyen API ni MCP. La información y la funcionalidad permanecen encerradas dentro de la GUI, empaquetadas para un usuario humano. Si has intentado utilizar Codex o Claude Code para investigar o realizar un trabajo que depende de una herramienta SaaS, sabes lo que esto significa. El agente todavía tiene que abrir un navegador y hablar con este viejo mundo.
Por eso, cada vez más productos de agentes incorporan un navegador. Algunos incluyen un navegador simplificado integrado en el cliente. Otros incluyen una extensión que se conecta con tu Chrome existente. Ninguno funciona lo suficientemente bien. El enfoque de puente con Chrome es inestable: las sesiones iniciadas se transfieren a veces y otras no, las pestañas aparecen en ventanas nuevas sin motivo y los modos con y sin interfaz se descontrolan. El enfoque integrado no es un navegador real y se desmorona ante cualquier tarea compleja.
Hay una razón más profunda por la que todo esto se queda corto. El navegador nunca fue diseñado para un agente. Cada detalle de la interacción en Chrome, pestañas, ventanas, navegación y permisos, se creó en torno a un usuario humano. Nadie preguntó cómo trabajaría con él un agente autónomo. Las herramientas puente y las herramientas integradas son parches en un sistema que nunca dejó espacio para un agente. Los problemas son la consecuencia natural.
La otra mitad del problema: ninguna de estas herramientas ha pensado seriamente en cómo debería ser realmente un navegador para un agente. Envuelven demasiado el navegador y le entregan al agente algunos comandos CLI, subestimando lo que un agente puede orquestar por sí solo. O giran hacia el otro lado, exponen el protocolo sin procesar y arrojan todo el ruido sin procesar al modelo.
Por eso creamos ego (lite). Queríamos replantear el navegador desde cero y convertirlo en la conexión más fluida entre tú, tu agente y la web.
Cómo construimos ego (lite)
Antes de escribir código, teníamos que resolver una pregunta: ¿cómo debería interactuar un agente con un navegador?
Nuestra respuesta fue tres capas.
La primera capa es visión y acción. El agente «ve» la página como lo hace un humano; luego hace clic, escribe y se desplaza. Esta es la base que cualquier navegador debería ofrecerle a un agente.
La segunda capa son las llamadas a métodos envueltos. Tomamos las operaciones que surgen con frecuencia, siendo Snapshot la canónica, y les dimos abstracciones limpias. Nos contuvimos a propósito. No se deben acumular cientos de métodos. El objetivo era mantener la abstracción clara, no exhaustiva.
La tercera capa es el acceso directo a las capacidades subyacentes del navegador. Cuando el agente realmente necesita control absoluto, está ahí.
El objetivo de las tres capas es que el agente elija la que se ajuste a la tarea. Un simple clic no necesita una llamada de protocolo sin formato. Un flujo complejo no se reduce a un solo comando CLI.
Por qué JavaScript y no Python o Shell
El código sobre CLI es la opción arquitectónica. Dentro de eso, ¿por qué JavaScript y no Python o Shell? Dos razones lo impulsaron.
La primera razón es la carga cognitiva. Lo que ego (lite) inyecta en la página ya es JavaScript. Si el código de orquestación en segundo plano usara otro lenguaje, el agente tendría que cambiar de sintaxis entre dos contextos en cada tarea. Es una fricción innecesaria. Usar un solo lenguaje durante toda la tarea permite que el agente piense de una única manera.
La segunda razón es la estabilidad del entorno. No podemos dar por hecho que todo el mundo tenga Python instalado ni que su shell se comporte igual que el nuestro. En vez de depender del entorno del usuario, incluimos el runtime. Reutilizamos el motor V8 que ya está en el navegador, reducimos el resto de Node.js e incorporamos un runtime completo de Node dentro de ego (lite). El tamaño de la instalación solo aumenta 6 MB.
¿Qué tan rápido es ego (lite)?
Comparamos ego (lite) con agent-browser de Vercel en cuatro tareas complejas de automatización de navegadores. ego (lite) terminó cada tarea hasta 3,45 veces más rápido y consumió muchos menos tokens.

Cuanto más difícil es la tarea, mayor es la brecha.
Dos decisiones de diseño marcaron la diferencia. Primero, la interacción de JavaScript de tres capas anterior. El agente escribe un fragmento que ejecuta muchas acciones en una sola pasada, en lugar de encadenar una llamada CLI a la vez. Segundo, el Snapshot a nivel de kernel integrado en nuestro motor Chromium personalizado, que llega a iframes de origen cruzado, Shadow DOM y widgets de SDK de terceros que los sistemas de Snapshot basados en un shim de JavaScript omiten silenciosamente.
Cuanto más lo usas, más rápido se vuelve (Próximamente)
Estamos probando un mecanismo de acumulación de experiencia en la Skill oficial de ego (lite). Cada tarea completada se convierte en herramientas y flujos de trabajo reutilizables, organizados por dominio. La próxima vez que tu agente ejecute una tarea similar, cargará esas herramientas y evitará el proceso de prueba y error.
La versión ideal permitiría que el agente capturara la experiencia mientras ejecuta la tarea. Lo intentamos primero, pero los resultados de la evaluación nos hicieron retroceder. Cuando se le pide al modelo que optimice tanto la tarea como la captura de experiencia en una misma ejecución, la tasa de éxito disminuye y la ejecución se ralentiza. Intentar hacer bien ambas cosas a la vez significa no hacer bien ninguna.
Entonces lo dividimos en dos fases. Durante la ejecución, el agente se centra en la tarea y no hace nada más. Una vez terminada, comienza una fase de acumulación separada, en la que el agente lee los documentos relevantes y desarrolla herramientas y aprendizajes. Este enfoque de divulgación progresiva alcanzó la velocidad que buscábamos. Las pruebas internas en tareas complejas muestran que las ejecuciones repetidas son hasta 2,6 veces más rápidas que la primera ejecución, con una cantidad de tokens significativamente menor.
La experiencia de usuario (UX) todavía es un área que no nos satisface del todo. Una vez finalizada la tarea, el usuario tiene que esperar el proceso de acumulación antes de recibir el resultado final, y esa espera aún no es sencilla. Una opción que estamos considerando es poner la acumulación en manos del usuario: permitirle decidir si quiere realizar una captura de experiencia después de finalizar la tarea. Así no hay esperas obligatorias y el usuario obtiene más control sobre cómo evoluciona su agente.
Todavía estamos puliendo esto y lo lanzaremos ampliamente cuando alcance nuestro estándar.
La función de ego (lite) en nuestra arquitectura es sencilla: ser un navegador que funcione tanto para ti como para tus agentes, ni más ni menos.
¿En qué se diferencia ego (lite) de las herramientas existentes?
| Función | ego (lite) | Browser Use | agent-browser (Vercel) | ChatGPT Atlas | Perplexity Comet |
|---|---|---|---|---|---|
| Multitarea | ✓ | — | — | — | — |
| Habilidades reutilizables | ✓ | — | — | — | — |
| Hereda los datos de Chrome | ✓ | — | — | ✓ | ✓ |
| El mismo navegador, un espacio de trabajo aparte | ✓ | — | — | — | — |
| Entrada semántica comprimida | ✓ | — | ✓ | — | — |
| Controlable por agentes externos | ✓ | ✓ | ✓ | — | — |
| Datos almacenados localmente | ✓ | ✓ | ✓ | — | — |
| Sin fricción de inicio de sesión | ✓ | — | — | ✓ | ✓ |
| Navegador de uso diario | ✓ | — | — | ✓ | ✓ |
| Gratis | ✓ | ✓ | ✓ | — | — |
¿Por qué nos llaman “ego”?
La cultura moderna se inclina con fuerza hacia el «ego bajo». Entendemos la intención: un exceso de ego puede dañar a otras personas. Pero la tendencia ha ido demasiado lejos. Se ha convertido en una retórica que presenta la autosupresión como una virtud y convierte a la gente en engranajes de una máquina mucho más grande.
A medida que la IA asume cada vez más trabajo, pensamos lo contrario. Este es el momento de volver a considerar el valor del «yo». Cuanto más potente es la herramienta, más valiosos se vuelven el juicio humano, la personalidad y el pensamiento independiente que hay detrás. No deben diluirse, sino amplificarse.
El verdadero peligro no es que las computadoras empiecen a pensar como los humanos, sino que los humanos empiecen a pensar como computadoras.
Por eso lo llamamos ego. No es un llamado a ser egoísta, sino una apuesta por proteger tu intuición, tu identidad y tu propio juicio.
El término «lite» de ego (lite) indica que esto no es todo lo que ofrece ego. Existe una versión completa con un agente personal, un entorno sandbox en la nube, funciones de sistema que van más allá del navegador y un sistema de memoria. Distribuimos ambas versiones como productos independientes.
Pruébalo
Actualmente, ego (lite) es gratis en macOS; las versiones para Windows y Linux están en la hoja de ruta. Todas las acciones del navegador las controla tu propio agente, no nuestros servidores. Por eso podemos mantener ego (lite) gratis para particulares.
El proceso de incorporación te hace una sola pregunta —si quieres migrar tus datos de Chrome— y se encarga del resto.
Si conectar un agente de IA a un navegador real te ha resultado frustrante, prueba ego (lite): no te decepcionará.
Una última consideración: ego (lite) ofrece a tu agente capacidades reales para manejar el navegador, tanto para leer el contenido de las páginas como para ejecutar acciones. Asegúrate de que el agente al que permitas controlarlo provenga de una fuente confiable.