ego (lite) はブラウザそのもの、ego は端末を横断して動くあなた専属のエージェントです。
順番待ちリストに参加する
ego lite vs agent-browser

最良のagent-browser代替

agent-browserは、まっさらなヘッドレスChromiumを操作するCLIです。開く、スナップショットを取る、クリックする、再びスナップショットを取る——各ステップにつき1コマンドで、次のステップが始まる前に毎回モデルとの往復が発生します。

ego lite drives the browser you already log into, batching actions in JavaScript instead of one command per step. Across 31 live-site jobs it finishes 96.8% of tasks with a perfect score; agent-browser finishes 74.2%.

導入している開発者の所属先
GoogleAmazonShopifyTikTokHarvardStanfordUSCUCLA

Browser automation benchmark: ego lite vs agent-browser

This is browser automation on the live web, not a sandbox CLI demo. We gave ego lite and agent-browser the same 31 multi-step tasks on real sites: several pages, several decisions, often a login you already have. A fresh headless profile stalls on those sessions. A real browser does not. Both ran the identical set, so the bars below compare the same jobs.

agent: pimodel: ChatGPT 5.6 Solthinking: max31 tasks

Task completion rate

How often the agent finished the job. Stuck at login, skipped a step, or returned the wrong result: that task is a fail. Higher is better.

ego lite96.8%30 of 31 tasks perfect
agent-browser74.2%23 of 31 tasks perfect

Cost per completed task

What one finished job costs in model spend. Failures still get billed, so they push this number up. Lower is better.

ego lite$1.98
agent-browser$3.72

Model turns per task

How many times the model had to look at the page and choose the next action. Extra looks mean extra tokens, extra waiting, and extra places to stall. Lower is better.

ego lite30.3
agent-browser45.6

Average task time

How long a job took from start to finish, on average, including time spent waiting on the model. Lower is better.

ego lite8m 38s
agent-browser11m 02s

We ran every tool twice and kept the better score. A failed task still counts against it.

Check the numbers, or rerun the tasks yourselfThe 31 tasks, the grading checklists, and the raw results are open source. If a number looks off, open the repo.ego-browser-benchmark-framework

ego liteがagent-browserより優れている理由

どちらのツールも、コーディングエージェントにはMCP設定や生のHTMLよりも良い方法があるべきだという発想から生まれています。違いは実行方式にあります。agent-browserは、Chromeを直接操作するRust製デーモンの背後で、まっさらな自動化セッションを起動します。一方 ego liteは、あなたが普段使っているブラウザそのものをエージェントネイティブにするため、実際のセッションでタスクが実行され、タスクあたりのコストも抑えられ、いつでもハンドルを握れるほど可視化されています。

96.8% of tasks done perfectly. No other tool tops 84%.

agent-browser's core loop is open, snapshot, click @e2, snapshot again: each step a command the model reads before deciding the next one, and every extra round trip is another chance to lose the thread. On those 31 jobs, one agent-browser task in four ends short of a perfect score.

ego lite reaches the page as a compressed Snapshot with stable @N refs, and the agent acts on several of them in one JavaScript turn. Fewer round trips leave fewer places to stall: 96.8% of the same 31 tasks end perfect, at the fastest average task time of the five tools measured.

Time to finish a task, shorter is better
518 sego (lite)
662 sエージェントブラウザ
Data source - Task: finish an average live-site job

並列マルチタスクで、より速く実行

agent-browserの並列処理は、自分自身で管理する一連の--sessionフラグによって実現されており、デフォルトではヘッドレスです。そのため、ダイアログがフリーズしても、CLIの出力だけを頼りに推測するしかありません。それを解決するはずの--headedフラグには、無視される、あるいはウィンドウを表示する代わりにChromeがクラッシュを繰り返すといった未解決のバグ報告があります。

ego liteではSpacesの数に上限がなく、それぞれがインポートされた独自のChromeプロファイル上で、デフォルトでheadful(表示あり)のまま、同時に自分のタスクを実行します。どのSpaceもあなたのタブを奪うことはなく、いつでも見守ったり操作を引き継いだりできます。

何度も往復する必要はもうなし トークン消費も削減

典型的なagent-browserのフローは、開く、スナップショットを取る、@e2をクリックする、@e3に入力する、再びスナップショットを取る、というように個別のコマンドの連続で、それぞれがモデルとの往復を伴い、モデルは結果を読んでから次のステップを決めます。batchモードでステップをキューに入れることはできますが、モデルはバッチ全体の結果が返るまでスナップショットに対して行動できません。

ego liteのエージェントは数行のJavaScriptを書いて1ターンで複数のステップを実行し、その結果を圧縮されたSnapshotとして読み取ります。これらを組み合わせることで、タスク全体のコストを1アクション1コマンドのループよりも大幅に抑えられます。

Claude Code · ego lite
>/ego-browser Add the first product to the cart, then check checkout loads
Bash(
ego-browser nodejs <<'EOF' await openOrReuseTab('localhost:3000') await click('.product-card') await click('.add-to-cart') await click('a[href="/checkout"]') cliLog('checkout loaded') EOF
)
Output:
[t=4480ms] checkout loaded
Done. Both steps work.
─── 1 tool call · 1.1k tokens ───
Claude Code · agent-browser
>Add the first product to the cart, then check checkout loads
$agent-browser open localhost:3000
stdout
Navigated to http://localhost:3000
1.6k tokens sent so far
Storefront loaded. Need a snapshot to find the first product.
$agent-browser snapshot -i
Snapshot
… +224 lines (ctrl+o to expand)
3.1k tokens sent so far
Found the first product card at @e18. Clicking it.
$agent-browser click @e18
stdout
Clicked @e18
4.9k tokens sent so far
Product page loaded, but refs are stale now. Snapshotting again.
$agent-browser snapshot -i
Snapshot
… +205 lines (ctrl+o to expand)
6.8k tokens sent so far
Add to cart button is @e7.
$agent-browser click @e7
stdout
Clicked @e7
9.2k tokens sent so far
Added. Heading to checkout.
$agent-browser click @e24
stdout
Clicked @e24
11.2k tokens sent so far
Confirming the checkout page actually loaded.
$agent-browser wait --url "**/checkout"
stdout
Matched http://localhost:3000/checkout
13.6k tokens sent so far
─── 7 tool calls · 13.6k tokens ───
同じタスク、同じモデル。 左:ego liteでの1回のバッチJavaScript呼び出し、合計1.1kトークン。 右:agent-browserのCLI、1アクション1コマンドで7回の往復、トークンは13.6kまで増加。

同じ Chrome を、エージェントに最適化

agent-browserを実際のChromeで使うにはセットアップが必要です。プロファイル名を指定すると、あなたのプロファイルが読み取り専用のスナップショットにコピーされます。あるいは永続パスを使えば再起動をまたいでログイン状態を維持できるはずですが、Linuxではプロファイルディレクトリが空のままになるという未解決の報告があります。もう一つの手段であるリモートデバッグポートは、そのポートにアクセスできるローカルの任意のプロセスにブラウザの完全な制御を晒します。セットアップを省略すると、まっさらなヘッドレスプロファイルが起動し、CAPTCHAや2FAのプロンプトのたびに止まってしまいます。

ego liteは、あなたのChromeプロファイルをワンクリックで、稼働中のままインポートします。

ego lite の Chrome プロファイルインポート:ワンクリックで全ログイン情報をセットアップ

ego lite vs agent-browser

ego liteとagent-browserの機能比較。
機能ego liteagent-browser
デフォルトのブラウザ状態インポート済みのChromeプロファイル:ログイン情報、Cookie、拡張機能まっさらなヘッドレスプロファイル。実際のChromeを再利用するには、--profileによるスナップショットコピーか手動のCDP接続が必要です。
エージェントがページをどう操作するか1ターンあたり数行のJavaScriptで複数のアクションをまとめて実行1アクションにつき1コマンド。batchモードでステップをキューに入れることはできますが、実行途中でスナップショットに応じて分岐することはできません。
エージェントがページをどう読み取るか圧縮されたSnapshot:安定した@N参照を持つアクセシビリティツリー同様:@e参照を持つコンパクトなアクセシビリティスナップショット
Browser automation on live sites (31 tasks, same model)96.8% perfect, $1.98 per completed task, 8m 38s average74.2% perfect, $3.72 per completed task, 11m 02s average
タスクを見守る、または引き継ぐはい。デフォルトでheadfulウィンドウが表示され、クリックして自分で操作を引き継げます。デフォルトではヘッドレス。監視するには別途--headedフラグが必要です。
並列タスクSpaceがタスクを並べて実行し、あなたのタブには一切触れません--sessionフラグを介した複数の分離セッションで、CLIから管理・監視します。
再利用可能なスキル (近日公開)成功した実行を再利用可能なスキルへと蒸留し、エージェントが繰り返すほど複雑なタスクで最大5倍高速化 (限定ベータ)標準機能としては非搭載
セットアップアプリをインストールし、エージェントで /ego-browser を実行npm、Homebrew、Cargoでインストールした後、agent-browser installでChrome for Testingビルドをダウンロードします。
価格無料、サブスクリプションなし。ego-browserシェルはMITライセンスです。無料、オープンソース
最終更新 2026年8月20日

移行をシームレスに

agent-browserによって、コーディングエージェントはブラウザを直接操作すべきだと確信したなら、ego liteはその確信をそのままに、あなたの実際のブラウザを結びつけたものです。切り替えは数分で済み、何かをアンインストールする必要もありません。

  1. ego (lite) をダウンロード

    ego liteをダウンロードして、ワンクリックでChromeプロファイルを取り込みます。ログイン情報もCookieも拡張機能もそのまま引き継がれ、--profileフラグやプロファイルディレクトリのコピーは一切不要です。

  2. /ego-browserで最初のタスクを実行

    エージェントに貼り付ける

    /ego-browser ego.appを開き、料金ページが読み込まれることを確認する

    Claude Code、Codex、Cursor、Gemini CLIのいずれかに一文を貼り付けてEnterを押すだけです。デーモンを起動する必要も、CDPポートを開く必要も、sessionフラグを管理する必要もありません。

  3. 動作を見る
    4つのブラウザタスクを並べて表示し、一目で確認できる ego lite Spaceの概要(agent-browserのヘッドレスな--sessionインスタンスとは異なります):Claude Codeが Yahoo Finance で Apple 株を追跡し、Codex が cars.com で年式ごとに車をフィルタリングし、Hermes が SaaS のバックオフィス業務を仕上げ、ユーザーが X をスクレイピングし、手が + をタップして新しい Space を開いている

    タスクは専用のSpaceで実行されるため、あなたのタブには触れません。ブラウザウィンドウは本物なので、ライブで見ることもいつでも引き継ぐこともできます。結果はエージェントのCLIに戻ってきます。

すでにパイプラインに組み込まれているなら、ヘッドレスのCIチェックにはそのままagent-browserを使い続けて構いません。ego liteは、あなた自身のマシンとアカウントで行う対話的な作業をカバーします。

それぞれのツールを使うべき場面

ego (lite) を選ぶべきケース

  • タスクが実際のアカウントに触れる場合。Gmail、ダッシュボード、SSOの背後にあるものすべてです。インポート済みのプロファイルはすでに稼働中のままログイン済みで、プロファイルのコピー作業も手動でのCDPポート開放も必要ありません。
  • 1アクションにつき1回のCLIコマンド往復ではなく、Snapshot入力と複数アクションのJavaScriptバッチを組み合わせた、タスクあたりのトークン削減を求めている場合。
  • デフォルトで並列のSpace内でheadful(表示あり)にタスクが実行される様子を見守り、人手が必要になった瞬間に引き継ぎたい場合。別途フラグやプラットフォーム固有のディスプレイ設定は不要です。
  • 普段使っているブラウザそのものをエージェントブラウザにしたい場合。デーモンの管理も、sessionフラグも、CDP接続の構築も不要です。

agent-browserを選ぶべき場合

  • デスクトップブラウザが使えず、使い捨てのセッションであることが重要なヘッドレスのCI環境やサーバーレス関数で実行している場合。
  • Vercel Sandbox上で構築している、またはすでにVercelのエコシステムに深く関わっていて、それと並行して設計されたツールを求めている場合。
  • サーバー上での占有量を最小限にしたい場合。PlaywrightやNode.jsランタイムに依存しないRust製のCLIとデーモンで、npm、Homebrew、Cargo経由でインストールできます。
  • WebDriver経由でのiOS Safari対応が必要な場合。Chromium専用の ego liteはこれをカバーしていません。

AI エージェントに本物のブラウザを

無料で Mac 上で動作し、ワンクリックで Chrome のプロファイルをインポートできます。Claude Code、Codex、Cursor、コードを書くあらゆる CLI エージェントに対応しています。

まだ検討中ですか?agent-browserが同分野の他のツールとどう比較されるかをご覧ください。

よくある質問

agent-browserは、Vercel Labsが開発したことからVercel agent-browserとも呼ばれ、AIコーディングエージェント向けに作られたオープンソースのブラウザ自動化CLIです。Chrome DevTools Protocolを介してChromeを直接操作する純粋なRust製デーモンの前段にRust CLIを配置した構成で、動作にPlaywrightやNode.jsランタイムは不要です。snapshotコマンドは@e参照付きのコンパクトなアクセシビリティツリーを返すため、エージェントは壊れやすいセレクタではなく安定した参照を使ってクリックや入力を行えます。また、Claude Code、Codex、Cursor、Gemini CLI、GitHub Copilotをはじめほとんどのコーディングエージェント向けのskillとして提供され、MCPサーバーはデフォルトの経路ではなくオプションのサブコマンドとして利用できます。無料でよく設計されており、広く採用されています。

はい、重視しているタスクが実際のアカウントに関わる場合や、可視化されることに利点がある場合はそうです。どちらのツールも、MCPを前提としたセットアップではなくCLIやskillを通じてコーディングエージェントにブラウザを与えます。ego liteはさらに、デフォルトで稼働中のままインポートされたChromeプロファイル、引き継ぎ可能なheadfulウィンドウ、並列のSpace、複数アクションのJavaScript実行を加えます。agent-browserは、スクリプトやCIにおける使い捨てのヘッドレス自動化のためのクリーンな選択肢であり続けます。

We ran both tools on the same 31 browser automation tasks on live websites, driven by the same pi agent with the same model (gpt-5.6-sol, thinking effort max) and graded by the same written checklist. Each tool keeps its better of two full runs, so a failed task still counts. ego lite finished 30 of 31 tasks perfectly (96.8%) at $1.98 per completed task, averaging 8 minutes 38 seconds per task; agent-browser finished 23 of 31 (74.2%) at $3.72, averaging 11 minutes 2 seconds. The tasks, the checklists, and the raw results are open source in the ego-browser-benchmark-framework repository on GitHub, so every number can be audited or reproduced.

はい、追加のセットアップをすれば可能ですが、まだ完全に信頼できるわけではありません。プロファイル名を渡すと、agent-browserはそのChromeプロファイルを読み取り専用のスナップショットとして一時ディレクトリにコピーします。そのため既存のログイン状態を引き継いで起動しますが、セッション中に書き込まれた内容は実際のプロファイルには反映されません。Windowsでは、プロファイルファイルがロックされる可能性があるため、事前にChromeを閉じておく必要もあります。Cookieとログイン状態を再起動をまたいで自動的に維持するための永続プロファイルモードもありますが、実行のたびにプロファイルディレクトリが空になるという未解決のバグ報告があります。稼働中のChromeにCDP経由で接続することも可能ですが、プロジェクト自身のドキュメントでも、そのポートはローカルの任意のプロセスにブラウザの完全な制御を晒すと明記されています。ego liteでは、ログイン済みのブラウザがデフォルトです。プロファイルを一度インポートすれば、以降のすべてのエージェントタスクは稼働中のまま、追加のフラグなしでそこから始まります。

The snapshot is only half of it. agent-browser's batch mode can fire a fixed list of commands in one process launch, but the model still can't act on what a snapshot returns until the whole batch finishes, so a task where each step depends on the last ends up as a long chain of command-then-model-reads-the-result cycles. ego lite lets the agent batch several actions in one JavaScript execution and reason about the result immediately, reading it as a compressed Snapshot. The savings come from the two stacked together, and they show up per task: across those 31 jobs, ego lite averages 30.3 model round trips to agent-browser's 45.6, which works out to $1.98 per completed task against $3.72.

いいえ。これは両方のツールが共有している考え方です。agent-browserの主なインターフェースはCLIであり、MCPサーバーは必要なクライアント向けにオプションのサブコマンドとして用意されています。ego liteは、エージェント内で/ego-browserを実行することで、ego-browserシェルを通じて接続します。どちらのツールも、デフォルトの経路としてMCPの設定ファイルを編集する必要はありません。

はい。両者は競合しません。一部の開発者は、CIやVercel Sandbox上でのヘッドレスチェックにはagent-browserを使い続け、ログイン済みのタスクや並行リサーチ、見守る価値のあるあらゆる対話的な作業には ego liteを使っています。実際のところ、その大半はログイン済みのタスクです。

はい。ego liteは無料でサブスクリプションも不要です。そして、エージェントが接続する ego-browserシェルはMITライセンスのオープンソースです。