このドキュメントでは、Gemini Enterprise app によって生成された指標にアクセスする方法について説明します。これらの指標は、アプリケーションのパフォーマンスと健全性に関する分析情報を提供します。
指標テレメトリーは、Metrics Explorer を使用して表示することも、エージェントの [オブザーバビリティ] タブを使用して個々のエージェント内で直接表示することもできます。
主なコンセプト
このセクションでは、Gemini Enterprise のオブザーバビリティに関連する主なコンセプトについて説明します。
| コンセプト | 説明 |
|---|---|
| 指標 | 指標は、システムが経時的に収集する数値測定です。これらの 測定値は、システムのパフォーマンス、リソース使用率、または 動作を表します。エンジニアは指標を使用して、システムの状態をモニタリングし、 傾向を特定し、アラートをトリガーします。 |
| エージェント スコープの指標 | セッション、会話ターン、ツール呼び出しなど、個々のエージェントのアクティビティを測定する指標。 これらは Gemini Enterprise エージェント リソースタイプの下に表示され、 そのエージェントに対して [OpenTelemetry の トレースとログの計測を有効にする] オブザーバビリティ設定がオンになっている場合にのみ収集されます。 |
| アプリ スコープの指標 | 単一の エージェントではなく、アプリへのすべてのトラフィックを測定する指標(リクエスト数やエンドツーエンドのレイテンシなど)。これらは Gemini Enterprise エンジン リソース タイプの下に表示されます。ここで、Engine は Gemini Enterprise app の API 名です。 オブザーバビリティ設定に関係なく収集されます。 |
始める前に
以下のものが揃っていることを確認してください。
Gemini Enterprise 管理者 ロールまたは Google Cloud コンソールの Gemini Enterprise ユーザーロール。
既存の Gemini Enterprise ウェブアプリ。新しい アプリの作成については、アプリを作成するをご覧ください。
Metrics Explorer にアクセスするには、 モニタリング閲覧者ロール (
roles/monitoring.viewer)が必要です。[OpenTelemetry のトレースとログの計測を有効にする] オブザーバビリティ設定を有効にします。エージェントのタイプに応じて、アプリレベルの構成(コア アシスタント エージェントの場合)またはエージェントの [構成] タブ(Workflow Builder の従業員作成エージェントと Deep Research エージェントの場合)で有効にします。詳細については、 オブザーバビリティ設定を管理するをご覧ください。 この設定は、エージェント スコープの指標に必要です。Gemini Enterprise エンジン リソースタイプの下に表示されるアプリ スコープの指標は、この設定なしで収集されます。
データの保持
Gemini Enterprise app によって生成された指標は、
プロジェクト Google Cloud の Cloud Monitoring に保存され、保持は
Cloud Monitoring によって管理されます。Gemini Enterprise の指標は
discoveryengine.googleapis.com/ 接頭辞で公開されます。これは "その他すべての
Google Cloud 指標" 階層に該当し、デフォルトで 6 週間 保持されます。保持期間より古いデータは自動的に削除されます。信頼できる
最新の保持値については、
Cloud Monitoring の割り当てと上限ドキュメントの
データの保持をご覧ください。
Metrics Explorer で指標にアクセスする
指標にアクセスする手順は次のとおりです。
Google Cloud コンソールで、[Metrics Explorer] ページに移動します。
Gemini Enterprise app が作成された Google Cloud プロジェクトを選択します。
[指標を選択] をクリックして検索バーを開きます。
検索バーで、次の指標を探します。
指標名 説明 Gemini Enterprise エージェント - Gemini Enterprise エージェント セッション数 Gemini Enterprise エージェントによって処理されたセッションの数。 Gemini Enterprise エージェント - Gemini Enterprise エージェント ツール数 Gemini Enterprise エージェントによってツールが呼び出された回数。 Gemini Enterprise エージェント - Gemini Enterprise エージェント ターン数 Gemini Enterprise エージェント セッション内の会話ターンの数。 Gemini Enterprise エージェント - Gemini Enterprise エージェントの合計 レイテンシ Gemini Enterprise エージェントからのレスポンスの合計レイテンシ。 Gemini Enterprise エージェント - Gemini Enterprise エージェント ツールの合計 レイテンシ Gemini Enterprise エージェント内のツール実行によって発生した合計レイテンシ。 Gemini Enterprise DataConnector - Gemini Enterprise DataConnector リクエスト数 Gemini Enterprise データ コネクタ(コンソール Google Cloud ではデータストアとも呼ばれます)に対して行われたリクエストの合計数。 Gemini Enterprise DataConnector - Gemini Enterprise DataConnector リクエスト レイテンシ (ベータ版)Gemini Enterprise データ コネクタ(コンソール Google Cloud ではデータストアとも呼ばれます)に対して行われたリクエストのレイテンシ(ミリ秒単位)。 Gemini Enterprise エンジン - Gemini Enterprise エンジン リクエスト数 単一のエージェントではなく、アプリへのすべてのトラフィックで、 Gemini Enterprise app が受信したリクエストの合計数。API メソッド、正規の gRPC レスポンス コード、レスポンス コード クラス、クエリタイプ、モデル別に分類されます。 Gemini Enterprise エンジン - Gemini Enterprise エンジン リクエストの合計 レイテンシ Gemini Enterprise app のエンドツーエンドのリクエスト レイテンシの分布。エラーを返すリクエストを含め、すべてのリクエストに対して記録されます。 Gemini Enterprise エンジン - Gemini Enterprise エンタープライズ エンジン 最初の回答までの時間 回答のレイテンシ リクエストの受信から 最初の回答トークンのストリーミングまでのレイテンシの分布。少なくとも 1 つの回答トークンを生成するリクエストに対してのみ記録されます。 Gemini Enterprise エンジン - Gemini Enterprise エンジン 最初の トークンまでのレイテンシ リクエストの受信から 最初のトークンのストリーミングまでのレイテンシの分布。トークンが モデルの思考プロセスの一部であるか、最終的な回答であるかに関係なく記録されます。少なくとも 1 つのストリーミング トークンを生成するリクエストに対してのみ記録されます。 調べる指標を選択して [適用] をクリックします。
必要に応じて、追加のラベルフィルタと集計要素を設定し、時間範囲を調整します。

エージェントの指標にアクセスする
コンソールの Google Cloud エージェントの [Observability] タブで、個々のエージェントのオペレーション、ツール固有、セッションの指標ダッシュボードを直接表示することもできます。
エージェントの指標にアクセスする手順は次のとおりです。
- コンソール Google Cloud でアプリに移動し、[エージェント] をクリックします。
- 検査するエージェントを選択し、[オブザーバビリティ] タブをクリックします。
[オブザーバビリティ] タブには、[概要]、[ツール]、[レイテンシ]、[エラー率] の 4 つのビューに分割された主要なオペレーション テレメトリーが表示されます。
全体的な指標
このビューには、標準のセッション データとエージェントの健康に関するデータをまとめたダッシュボードが表示されます。これには次のものが含まれます。
- セッション: ユーザー セッションの合計数。
- セッションあたりの平均時間: セッション中に経過した平均時間。
- エージェントの呼び出し: エージェントが呼び出された合計回数。
- エージェントのレイテンシ: 時間と特定の指標にわたるレイテンシ。
- エージェントのトラフィック: 受信リクエスト数。
- エージェントのエラー率: エージェントの呼び出しに失敗した割合。
![Google Cloud コンソールの [モニタリング] タブの [概要] ビューのスクリーンショット。セッション、セッションあたりの平均ターン数、エージェントの呼び出し、レイテンシ、トラフィック、エラー率が表示されています。](/docs.cloud.google.com/static/gemini/enterprise/docs/images/observability/core-assistant-metrics-overview.png?hl=ja)
ツールの指標
このビューでは、エージェントに接続されているツールの使用状況とレイテンシに特に重点を置いています。これには次のものが含まれます。
- 合計呼び出し数: ツールの実行リクエストの数。
- ツール別の P95 期間: ツール別に分類された実行の 95 パーセンタイルのレイテンシ。
- ツール別の呼び出し数: さまざまなツールに分割された合計呼び出し数。
- ツール別のエラー率: ツール別の実行の失敗率。
- 「ツール呼び出しなし」の割合: インタラクションでツールの実行がトリガーされなかった割合。
レイテンシの指標
このビューには、エージェントのレスポンス レイテンシが表示されます。各指標は、選択した期間の p50 と p95 の概要カードとして、また経時的な傾向を示す時系列グラフとして表示されます。レイテンシの指標を機能でフィルタすることもできます。 このビューには次の指標が表示されます。
- 最初のトークンまでの時間(TTFT): リクエストの受信から 最初のトークンのストリーミングまでのレイテンシ。トークンがモデルの 思考プロセスの一部であるか、回答の一部であるかに関係なく記録されます。
- 最初の回答までの時間(TTFA): リクエストの受信から 最初の回答トークンのストリーミングまでのレイテンシ。これは、モデルの思考の一部ではない最初のトークンです。エージェントが回答を開始した後にツールを呼び出すと、測定が再開されるため、TTFA にはユーザーが読んだ回答のストリーミングが開始された時点が反映されます。中間ナレーションは反映されません。
- 最後のトークンまでの時間(TTLT): リクエストの受信から 最後のトークンのストリーミングまでのレイテンシ。これは、レスポンスが完了した時点です。
機能でレイテンシの指標をフィルタする
機能とは、ウェブ検索や画像生成など、ターンが表すインタラクションの種類です。レイテンシの指標を機能でフィルタして、どの種類のインタラクションが最も遅いかを確認し、1 つの遅い機能が全体的なレイテンシを歪めるのを防ぎます。
機能でレイテンシの指標をフィルタする手順は次のとおりです。
- エージェントの [オブザーバビリティ] タブで、[レイテンシ] ビューをクリックします。
- [機能でフィルタ] をクリックします。
- 検査する機能を選択します。
概要カードと時系列グラフには、その機能のターンのみが表示されます。
すべての機能を一度に比較するには、機能テレメトリー テーブルを使用します。このテーブルには、各機能について次の情報が表示されます。
- トラフィックの割合: 機能に起因するターンの割合。
- TTFT、TTFA、TTLT: 機能の p50 と p95 のレイテンシ。
次の機能を使用してフィルタできます。
- パラメータ: ツールを使用せず、テキスト出力 のみを目的としてモデルにリクエストを送信するインタラクション(翻訳タスクなど)。
- メディア生成: 画像と動画の生成タスク。
- ウェブ検索のみ: ウェブ検索ツールを使用してモデルにリクエストを送信するインタラクション。
- アップロードされたファイルの分析: ユーザーがアップロードしたファイルを使用してモデルにリクエストを送信するインタラクション。
- コネクタ: 内部コネクタまたはサードパーティ コネクタにリクエストを送信するクエリ。
- Canvas: Canvas を使用する生成タスク。
- スキル: スキルを呼び出すインタラクション。
- その他: 複数の機能にまたがるターンや、まだ分類されていないターンをまとめるキャッチオール。
![Google Cloud コンソールの [オブザーバビリティ] タブの [レイテンシ] ビューのスクリーンショット。機能フィルタ、p50 と p95 の概要カード、最初のトークンまでの時間、最初の回答までの時間、最後のトークンまでの時間の時系列グラフ、各機能のトラフィックの割合と p50 と p95 のレイテンシが一覧表示された [機能] テレメトリー テーブルが表示されている](/docs.cloud.google.com/static/gemini/enterprise/docs/images/observability/core-assistant-metrics-latency.png?hl=ja)
エラー率の指標
このビューには、エージェントのリクエストがどのように解決されるかが、レスポンス クラス別にグループ化されて表示されます: OK(2xx)、クライアント エラー(4xx)、サーバーエラー(5xx)、および キャンセル。これには次のものが含まれます。
- レスポンス クラス別のリクエスト数: 経時的な受信リクエスト数( レスポンス クラス別に積み重ね)。
- レスポンス クラス別のエラー率: 経時的に失敗したリクエストの割合(レスポンス クラス別に分割)。
- クライアント エラーコード(4xx) とサーバー エラーコード(5xx): 経時的な
個々の正規の gRPC レスポンス コード(
INVALID_ARGUMENTやINTERNALなど)。これにより、スパイクの原因となった特定のエラーを 把握できます。 - 合計: 選択した期間における 各結果のリクエスト数とリクエストの合計の割合。個々のクライアント エラーコードとサーバー エラーコードをランク付けする個別のテーブルがあります。
![Google Cloud コンソールの [オブザーバビリティ] タブの [エラー率] ビューのスクリーンショット。レスポンス クラス別のリクエスト数とエラー率、クライアントとサーバーのエラーコードの時系列グラフ、合計テーブルが表示されています。](/docs.cloud.google.com/static/gemini/enterprise/docs/images/observability/core-assistant-metrics-error-rate.png?hl=ja)
次のステップ
- Gemini Enterprise の指標を使用してダッシュボードを作成する。詳細については、 カスタム ダッシュボードの作成と管理をご覧ください。
- 指標がしきい値を超えたときにアラートを作成する。詳細については、 指標しきい値のアラート ポリシーを作成するをご覧ください。
- Metrics Explorer のトラッキングをオフにするには、 オブザーバビリティ設定をオフにするをご覧ください。