モデル / データセット
LvcidPsyche/auto-browser avatar
LvcidPsyche/auto-browser

Auto Browser: MCPネイティブのブラウザ制御プレーン、人間による介入をサポート

AI エージェントに実際のブラウザを提供し、人間がループに参加します。オープンソースの MCP ネイティブ ブラウザ エージェント。

スター 792フォーク 133PythonMIT

ひと目でわかる

これは何?
LLMエージェントとオペレーターに共有Playwrightブラウザを提供するPython製MCPサーバー。承認、監査証跡、ローカルファースト展開を備えています。
誰に向いている?
Auto BrowserはMITライセンスのプロジェクトで、PlaywrightブラウザセッションをMCPサーバーとしてパッケージ化し、人間による介入、認証プロファイル、コンプライアンスプリセットを備えています。READMEは独立したセキュリティ保証や本番ベンチマークを提供しておらず、それらは検証事項です。
商用利用できる?
できます。MIT は寛容なライセンスで、著作権表示とライセンス表示を残せば、使用・改変・販売が可能です。
今もメンテナンスされている?
されています。最後のコミットは 18 日前です。
何の言語で書かれている?
主に Python です(GitHub の言語統計による)。

回答はプロジェクトの GitHub データ(最終同期:2026年9月14日)と当サイトの分析に基づくもので、法的助言ではありません。

オープンソース詳細解説

MCPクライアントとオペレーターのための共有Playwrightブラウザ

Auto Browserは、PlaywrightベースのセッションをMCPサーバーとしてパッケージ化するブラウザ制御プレーンです。MCPクライアント、LLMエージェント、人間のオペレーターに、スクリーンショット、DOMサマリー、OCR抜粋、タブ制御、ダウンロード、ネットワーク検査を備えた共有ライブブラウザを提供します。READMEは、これをAIエージェントのための実際のブラウザとして位置づけており、単なるHTML取得ではなく、内部ダッシュボード、オペレーター支援QA、ログイン再利用ワークフロー、壊れやすいサイトを良い適合例として挙げています。また、CAPTCHA解決、不正なスクレイピング、欺瞞的なアイデンティティ形成は目的ではないと明記しています。

人間による介入と安全レール

システムはnoVNCを介して人間が介入できるようにし、ウェブが壊れやすい場合に同じライブセッションに人が入れるようにします。安全機能には、承認ゲート、オペレーターIDヘッダー、監査イベント、PIIスクラビング、Ed25519署名付きWitnessレシートが含まれます。READMEは、docs/audits/2026-08-execution-audit.mdの敵対的監査を文書化しており、成功を報告しながら何もしない安全制御が見つかり、再現と修正が含まれています。また、エクスポートされたWitnessバンドルは、このプロジェクトから何もインポートしないスクリプトで検証できるため、受信者はコントローラーを実行または信頼する必要がないと述べています。

v1.5.0のリリースハイライト

バージョン1.5.0では、スクリーンショットやOCRなしでアクセシビリティアウトライン、抽出テキスト、インタラクタブルを返すテキスト観察プリセットが追加され、PERCEPTION_PRESET_DEFAULT=textで設定されます。browser.find_elementsツールは、クエリ文字列(プレーンテキストまたは正規表現)を受け取り、周囲のコンテキストとともに一致を返すようになりました。無効なツール引数はフィールドレベルの詳細を報告し、MCPブリッジのコールドスタートエラーはコントローラーの起動方法を説明します。汎用OpenAI互換アダプターは、OpenAI /chat/completionsエンドポイントで到達可能な任意のモデルをサポートし、openrouter、xai、deepseek、minimax、openai_compatibleプロバイダーが含まれます。また、browser://audit/events MCPリソースとCIで強制されるPlaywrightピン整合性があります。

クイックスタートと最初の実用的デモ

クイックスタートではリポジトリをクローンしてdocker compose up --buildを実行します。READMEはこれがデフォルト設定でのローカル開発に十分だと述べています。オプションの手順として、.env.exampleをコピーし、ローカルDockerアクセス権を持つターミナルでmake doctorを実行します。公開ポートはデフォルトで127.0.0.1にバインドされ、APIドキュメントは/docs、オペレーターダッシュボードは/dashboard、noVNCはポート6080にあります。Codespacesはスタックを自動的にプロビジョニングします。最も価値の高いフローは、セッションを作成し、必要に応じて手動でログインし、名前付き認証プロファイルとして保存し、そのプロファイルから新しいセッションを開き、再認証なしで続行することです。例とcurlコマンドはREADMEにあります。

MCP統合とクライアント設定

Auto Browserは/mcpでHTTP MCPエンドポイントを公開し、/mcp/toolsと/mcp/tools/callに便利なエンドポイントを提供し、PyPIのuvx auto-browser-mcpを介してstdioブリッジを提供します。デフォルトのMCPツールプロファイルはcuratedで、ブラウザサーフェスをコンパクトに保ちます。MCP_TOOL_PROFILE=fullを設定すると完全な内部サーフェスが公開されます。Claude DesktopとCursor向けのクライアント設定ガイドがあり、READMEには生のツール呼び出し例が含まれています。リポジトリはまた、docs/mcp-clients.mdでリソース一覧、読み取り、サブスクリプション形式の更新を文書化しています。

セキュリティ、コンプライアンス、展開姿勢

プライベート展開では、READMEはAPP_ENV=production、API_BEARER_TOKEN、REQUIRE_OPERATOR_ID、AUTH_STATE_ENCRYPTION_KEY、REQUIRE_AUTH_STATE_ENCRYPTION、REQUEST_RATE_LIMIT_ENABLED、METRICS_ENABLED、STEALTH_ENABLED=falseを設定することを推奨しています。COMPLIANCE_TEMPLATEは事前設定された姿勢を適用します。strictは認証暗号化、オペレーターID、全層でのPIIスクラビング、docker_ephemeral分離、4時間の最大セッション年齢を要求します。balancedはオペレーターID、ネットワークとテキストでのPIIスクラビング、共有分離、24時間の最大セッション年齢を要求します。両方のプリセットはアップロード承認を要求し、Witnessレシートを有効にします。HIPAA、SOC2、GDPR、PCI-DSSなどのレガシー名は、非推奨のエイリアスとして引き続き機能し、警告を発します。

アーキテクチャ: コントローラー、ブラウザノード、モデルアダプター

リポジトリは、Chromium、Xvfb、x11vnc、noVNCを実行するbrowser-node、FastAPIコントローラー、MCPトランスポート、ポリシーレール、オーケストレーションを公開するcontroller、ランタイムアーティファクト用のdata、ローカルヘルパー用のscriptsに分かれています。モデルプロバイダーにはOpenAI、Claude、Geminiのファーストクラスアダプターに加え、任意のエンドポイント向けの汎用OpenAI互換アダプターがあります。アーキテクチャ図は、人間のオペレーターがnoVNCを介して監視または介入し、LLMがコントローラーを介して共有ツールを使用し、コントローラーがPlaywrightを介してブラウザノードを駆動することを示しています。スクリーンショット、トレース、認証状態などのアーティファクトが保存され、ポリシーレールがアクションをゲートします。

スキル帰納のための収束ハーネス

Auto BrowserはStage 0収束ハーネスを同梱しており、構造化タスク契約を実行し、改ざんチェックされたトレースを記録し、完了を検証し、署名付き来歴を持つステージング済みスキル候補を書き込みます。生成されたスキルはステージングのみであり、昇格は明示的かつレビュー付きです。harness.list_runs、harness.get_status、harness.get_traceなどの読み取り専用検査ツールはデフォルトのcuratedプロファイルに含まれていますが、収束実行、ドリフトチェック、候補管理、卒業にはMCP_TOOL_PROFILE=fullまたは直接RESTが必要です。例の契約を使用した決定論的ローカルスモークコマンドが提供されています。

編集部の結論

Auto BrowserはMITライセンスのプロジェクトで、PlaywrightブラウザセッションをMCPサーバーとしてパッケージ化し、人間による介入、認証プロファイル、コンプライアンスプリセットを備えています。READMEは独立したセキュリティ保証や本番ベンチマークを提供しておらず、それらは検証事項です。

公式情報源

  1. Official documentation
  2. Official README
  3. Project repository
  4. Release notes
コミュニティノート

コミュニティノート