WebMCP

Alexandra Klepper
Alexandra Klepper

公開日: 2026 年 5 月 18 日、最終更新日: 2026 年 6 月 9 日

WebMCP は、AI エージェント用の構造化ツールを構築して公開するのに役立つ、提案中のウェブ標準です。WebMCP は JavaScript を提供し、HTML フォーム要素にアノテーションを付けます。これにより、エージェントはページ機能とやり取りする方法を正確に把握し、ユーザー エクスペリエンスをサポートできます。これにより、エージェントの動作のパフォーマンスと信頼性が大幅に向上します。

AI エージェントは比較的新しいテクノロジーです。複雑で技術的なタスクを人間がより適切に完了できるよう支援します。WebMCP は、エージェント タスクの完了の精度を高め、プログレッシブ エンハンスメントとして追加できます。

商品の解説 ウェブ 拡張機能 Chrome ステータス インテント
GitHub オリジン トライアル オリジン トライアル 表示 テストの目的

WebMCP を選ぶ理由

WebMCP は、インタラクションのルールを提供することで、ウェブ アプリケーションとエージェント間のギャップを埋め、効率、信頼性、タスク完了率を向上させます。ボタンやフィールドなどの要素の目的をエージェントが確認する代わりに、ウェブサイトが要素の目的を宣言することで、要素が正しく使用されるようにします。

これは、多数の手順があり、各手順がエージェントによる解釈に委ねられる可能性があるアクチュエーションよりも信頼性が高くなります。

ウェブサイトは、tool を定義することで、検索や購入などの明確な目的を共有できます。ツールはウェブページ上で目に見える形で実行されるため、ユーザーはタスクが期待どおりに完了したことを確認できます。また、ブランドと人間中心のデザインの選択もそのまま維持されます。

WebMCP は以下をサポートしています。

  • ディスカバリ: ページが checkoutfilter_results などのエージェントにツールを登録する標準的な方法。
  • JSON スキーマ: 幻覚や誤解を減らすために、入力と想定される出力を明示的に定義します。
  • 状態: 現在のページのコンテキストを共有して理解することで、エージェントはリアルタイムで操作できるリソースを把握できます。

Google の目標は、エージェント機能を備えたあらゆるブラウザが実装して活用できる API を構築し、ユーザーがタスクをより簡単に完了できるようにすることです。このプロセスは GitHub で確認できます。

ユースケース

ウェブ上で WebMCP を使用する方法はたくさんあります。次に例を示します。

  • お客様がサポートを受けられるようサポートします。お客様にソフトウェアを提供している場合、さまざまな質問に対応するための複雑なサポートフローが必要になることがあります。WebMCP を使用すると、エージェントが適切なフォームにすばやく移動し、ユーザーから提供された情報をフィールドに入力できます。
  • 旅行の予約を改善する。エージェントが複雑な複数都市や複数人数の旅行を少ない手順で予約できるようにします。

購入などの操作は機密情報に該当する場合があります。確認ダイアログでユーザー インタラクションをリクエストするコマンドを含めることができます。

実際には、ツールで次のタスクを実行できます。

  • 構造化されたフォームに記入する: エージェントがユーザーとの会話から収集したデータをフォーム フィールドに正しくマッピングできるようにする submit_application ツールを構築します。たとえば、フィールドに氏名が必要か、姓と名が別々に必要かを区別できます。
  • 人間優先のインターフェースでのサポート エージェントの操作: 特定のフィールドは人間のユーザー向けに設計されていますが、エージェントには理解できない場合があります。予約やイベントの予約で複雑な日時選択を可能にする date_pick ツールを構築できます。
  • アプリケーションのデバッグを迅速化: デベロッパー設定ページで run_diagnostics ツールを構築できるため、エージェントは、ネストされたメニューの奥に隠れている修正をトリガーできます。

ユースケースが見つかりませんか?WebMCP について共有したいアイデアはありますか?GitHub で質問を投稿したり、ディスカッションに参加したりする

始める

Chrome 149 から WebMCP オリジン トライアルに参加してください。詳しくは、オリジン トライアルを開始するをご覧ください。

ローカル WebMCP

WebMCP は、ローカル開発用の Chrome フラグとして利用できます。

  1. Chrome を開いて chrome://flags/#enable-webmcp-testing に移動します。
  2. フラグを [有効] に設定します。
  3. Chrome を再起動して変更を適用します。

WebMCP API を使用する

ウェブサイト ツールを設定するために使用できる API は次の 2 つです。

  • 命令型 API: フォーム入力、ナビゲーション ツール、状態管理などのさまざまな種類のツールを標準の JavaScript で定義します。
  • 宣言型 API: 標準の HTML フォームにアノテーションを追加して、WebMCP ツールを作成します。

制限事項

WebMCP はエージェントと人間にとって複雑なタスクを簡素化することを目的としていますが、いくつかの制限があります。

  • ブラウジング コンテキストが必要: ツール呼び出しは JavaScript で処理されるため、表示可能なインターフェースとブラウザ コンテキストを提供するために、ブラウザタブまたはウェブビューを開く必要があります。つまり、ヘッドレス状態のツールを呼び出すエージェントや補助ツールはサポートされていません。
  • 複雑なインターフェースではオーバーヘッドが増加する: サイトが非常に複雑な場合は、アプリケーションとインターフェースの状態を処理するために、リファクタリングまたは JavaScript の追加が必要になる可能性があります。
  • ツールの検出可能性: 呼び出し可能なツールがあるかどうかを確認するには、クライアントとブラウザがサイトに直接アクセスする必要があります。

セキュリティと権限

WebMCP API は、オリジン分離要件と権限ポリシーの両方によってゲートされます。

オリジンの分離

WebMCP は、オリジン分離されたドキュメントでのみ使用できます。これにより、ツールのライフサイクル全体を通じてドキュメントのオリジンが安定します。

ドキュメントで document.domain が有効になっている場合(たとえば、Origin-Agent-Cluster: ?0 HTTP ヘッダーを使用している場合)、WebMCP API は無効になります。

権限に関するポリシー

どちらの API も tools Permissions Policy によって制限されています。このポリシーのデフォルトは self で、トップレベルと同一オリジンのコンテキストでのツールの登録を許可し、クロスオリジンの iframe では無効にします。

クロスオリジンの iframe で WebMCP ツールを許可するには、iframe に allow="tools" 属性を追加します。

デモ

命令型と宣言型の両方の実装をカバーするデモの例は、次のとおりです。

GitHub でデモのソースコードを確認することもできます。

インスペクタ拡張機能を使用してエージェントのチャットを模倣する

Model Context Tool Inspector 拡張機能をインストールして、エージェントを試したり、ライブデモや独自のアプリケーションで WebMCP ツールがどのように動作するかを確認したりできます。自然言語プロンプトを使用して、エージェントが WebMCP ツールと想定どおりにやり取りしているかどうかを判断します。

この拡張機能を使用すると、次のことができます。

  • WebMCP API をモニタリングして、ページに登録されているツールを確認します。
  • ツールを手動で呼び出して関数を実行します。
  • JSON スキーマが正しく定義されており、ブラウザがツールが想定する形式でデータを解析できることを確認します。
  • ツールから返された構造化された出力またはエラー メッセージを表示して、エージェントが理解できるように、明確に記述され、正しくフォーマットされていることを確認します。

自然言語を使用してエージェントに話しかけ、適切な WebMCP ツールを正しく識別して呼び出すことができるかどうかを確認します。プロンプトはデフォルトで gemini-3-flash-preview モデルに送信されます。

意見交換とフィードバックの提供

WebMCP は現在、活発な議論が行われており、今後変更される可能性があります。これらの API をお試しになり、フィードバックがございましたら、ぜひお聞かせください。