AI AGENT HARNESSクラウド別

Google CloudのAgent Harness設計|Agent Platform・ADK・Runtimeの選び方

検索意図:Google Cloud AIエージェント Agent Runtime ADK Memory Bank セキュリティ 料金

結論

2026年8月時点の正式な上位名称はGemini Enterprise Agent Platformで、旧Vertex AI Agent EngineはAgent Runtimeへ移行しました。Agent HarnessはGoogle Cloudの製品名ではなく、ADK、Runtime、Sessions、Memory Bank、評価、IAM、ネットワーク、暗号鍵、監視を一つの運用設計として扱うBlueAIの判断フレームです。

対象:Google CloudでAIエージェントを本番化するDX責任者・クラウド・セキュリティアーキテクト・AIエージェントの開発・運用責任者更新:2026-08-18次回確認:2026-09-18
Agent Harness内を探す

FIT / NO-FIT

先に、導入対象かを判定する

向いている条件

  • Google CloudのIAM、監査、ネットワーク、鍵管理とエージェント実行を同じ統制下に置きたい
  • ADKまたは対応OSSフレームワークで開発し、マネージドRuntimeへデプロイしたい
  • 会話中の状態と長期記憶を分け、ユーザーID単位のアクセス制御と削除を設計できる
  • Preview依存、リージョン、クォータ、従量課金を継続レビューできる

まだ導入しない条件

  • Code Executionを日本リージョンのGA機能として必須利用したい
  • 評価データにもCMEK、VPC-SC、Access Transparencyが必須だが代替評価基盤を用意できない
  • 外部送信、更新、削除を人の承認や停止手段なしで全面自動化したい
  • 従量課金とクォータを監視できず、固定費だけで運用したい

DECISION CRITERIA

発注前に確認する判断基準

01製品境界

開発フレームワークとマネージド実行基盤を分けて選べるか

進められる状態
ADKは開発・オーケストレーション、Agent Runtimeはデプロイ・実行・スケール、Sessions/Memory Bankは状態管理として責任を分ける
止めるサイン
ADK、Agent Runtime、旧Agent Engine、API上のReasoningEngineを同じ製品名として要件や見積を作る
02提供段階

GA機能とPreview機能を業務重要度に合わせて分けられるか

進められる状態
Runtime、Sessions、Memory Bank、Agent Identity基盤をGA前提とし、Code Execution、Agent RuntimeのエージェントIDアクセス方式、統合評価などPreview依存を台帳化して代替手段を持つ
止めるサイン
v1beta1やPreview機能を、変更・サポート制約の承認なしに基幹処理へ組み込む
03ID・権限

人、エージェント、サービスアカウントの権限を分離できるか

進められる状態
利用者には必要なIAMロールだけを付与し、エージェントごとの権限または専用サービスアカウントでデータとツールを最小権限化する
止めるサイン
複数エージェントで広い権限の既定サービスアカウントやAPIキーを共有する
04ネットワーク・鍵

PSC、VPC-SC、CMEK、リージョンを同時に設計できるか

進められる状態
非公開接続、外向き通信、鍵の所在、データ所在地、再作成が必要な変更を本番前に決める
止めるサイン
グローバルSessions/Memory BankでCMEKを使える前提にする、またはPSCを後から無停止で変更できる前提にする
05費用・クォータ

モデル以外の実行・記憶・評価・運用費を計測できるか

進められる状態
Agent Compute、Memory、Storage、Sessions/Memory Bank操作、モデル、評価、ログ、人の確認工数を利用量で試算し、ピーク負荷のクォータも確認する
止めるサイン
LLMトークン単価だけで総費用を見積もり、サンドボックス、保存、評価、監視、再試行を除外する

OPERATING FLOW

業務を完了するまでの役割分担

0101 / DEFINE

業務・権限・証跡を定義

対象業務、正本データ、許可ツール、人の承認、停止条件、保存・削除要件を先に確定する。

責任:業務責任者+クラウドアーキテクト

0202 / BUILD & EVAL

ADKで構築し評価ケースを実行

ローカルまたは検証環境で、正常系、権限拒否、ツール失敗、プロンプトインジェクションを含む評価ケースとトレースを確認する。

責任:AI開発チーム

0303 / DEPLOY

Runtimeとコンテキストを分離して配備

Agent Runtime、Sessions、Memory Bank、必要時のみSandboxを構成し、ID、PSC、CMEK、リージョン、上限を適用する。

責任:クラウド基盤・セキュリティ

0404 / OPERATE

品質・費用・変更を継続管理

トレース、エラー、拒否、記憶、費用、クォータを監視し、モデル・権限・Preview機能の変更時に再評価する。

責任:AgentOps+業務責任者

REFERENCE ARCHITECTURE

Agent Platformを使う責任分離型Agent Harness

01 / EXPERIENCE

業務UI・API・承認画面

利用者の依頼と、人が確認・差戻し・停止する境界を提供する。

02 / DEVELOPMENT

Agent Development Kit

エージェント、ツール、ワークフロー、マルチエージェント連携をコードと評価可能な形で定義する。

03 / RUNTIME

Agent Runtime

エージェントをデプロイ、実行、スケールし、オブザーバビリティへ接続する。

04 / CONTEXT

Sessions / Memory Bank

会話イベントと一時状態、複数セッションをまたぐ長期記憶を分離して管理する。

05 / TOOLS

Approved APIs / Code Execution

許可APIを最小権限で呼び、信頼できないコードはPreviewの隔離Sandboxへ限定する。

06 / CONTROL

IAM / PSC / CMEK / Evaluation

ID、非公開通信、保存時暗号化、品質評価、監査、費用、停止を横断管理する。

横断制御

  • Agent Platform Userなど必要最小限のIAMロール
  • エージェント単位のIDまたは専用サービスアカウント
  • PSCインターフェースと明示的な外向き通信経路
  • 同一リージョンのCMEKと鍵変更時の再配備計画
  • Sessions/Memory BankのIDスコープ・TTL・削除
  • 評価ケース、トレース、費用・クォータアラート
  • Preview機能台帳とKill Switch

Google Cloudの公式名称に「Agent Harness」という単一製品はありません。現在の正式プロダクト群を、業務責任・人の承認・停止・費用まで含むBlueAIの運用レイヤとして組み合わせます。APIリソース名のReasoningEngineは後方互換のため残っています。

USE CASES

最初に検証する3業務

01

社内ナレッジ回答支援

入力
利用者の質問、閲覧権限、承認済み社内文書
Agentの処理
権限内検索、根拠抽出、回答案作成、セッションへのイベント記録
成果物
出典と未確認点を含む回答案
人が決める範囲
人事・法務・規制判断は所管部署へ移管し、権限外文書は取得しない

最初のKPI:確認込み回答時間、出典不備率、権限越境件数

02

顧客対応の継続支援

入力
問い合わせ、製品文書、セッション履歴、許可された長期記憶
Agentの処理
意図分類、関連履歴取得、回答案と次アクションの作成
成果物
根拠、確信度、エスカレーション条件つき回答案
人が決める範囲
対外送信、返金、契約変更、機微情報の記憶化は担当者が承認する

最初のKPI:処理時間、修正率、誤記憶・不要記憶の削除件数

03

限定データ分析エージェント

入力
承認済みデータファイルと分析依頼
Agentの処理
隔離Sandboxでコード生成・実行・結果検査
成果物
実行コード、標準出力、生成ファイル、前提とエラー
人が決める範囲
Code ExecutionのPreview・リージョン・ネットワーク非接続を受容できる検証用途に限定し、意思決定は人が行う

最初のKPI:再実行率、失敗率、人の検算時間、費用

ROI / TCO

効果と費用を同じ前提で比べる

業務便益からAgent Platform総運用費を差し引く

対象件数 ×(現在時間 − 導入後の確認・修正・例外対応を含む人手時間)× 時間単価 −(Agent Compute費+Memory費+Storage費+モデル費+評価・監視費+(基盤運用工数 × 時間単価))

  • 対象件数、現在時間、確認・修正後時間を自社で実測する
  • RuntimeとSandboxの稼働、Sessions/Memory Bankの保存・操作、モデル利用を別々に計測する
  • 評価、ログ確認、権限レビュー、メモリ削除、障害対応を運用工数へ含める
  • 無料枠、Preview中の課金挙動、将来単価を恒久前提にしない

検討例:先行1業務で2〜4週間の利用量と確認時間を測り、保守・標準・積極の3条件に分けて月次純便益を比較する。単価は見積時点の公式料金とCloud SKUへ差し替える。

BlueAI試算モデルです。Google Cloudの性能、削減率、費用、回収期間を保証せず、公式料金と自社実績で更新します。

Runtime・Sandbox計算資源

CPU・メモリ、最小インスタンス、実行時間、同時実行、再試行が増えるほど上がる

Agent RuntimeとCode Execution/Computer UseなどのSandboxは、Agent ComputeとAgent Memoryの利用量が主要因になる。

Sessions・Memory Bank

保存期間、イベント数、記憶数、検索・更新頻度、モデル利用量で変動する

会話履歴、状態、長期記憶の保存量、読み書き操作、記憶生成・検索で使うモデルを分けて見る。

評価・オブザーバビリティ

評価ケース数、トレース量、保持期間、評価頻度が増えるほど上がる

評価データ、判定モデル、トレース・ログの保存、オンライン監視、再評価の頻度を含める。

セキュリティ・ネットワーク運用

環境・リージョン・鍵・ネットワーク境界・監査単位が増えるほど上がる

PSC、DNS、プロキシ、Cloud NAT、CMEK、IAMレビュー、VPC-SC、監査対応の構築・運用工数。

STOP CONDITIONS

失敗を小さく止める条件

01

旧称と現行名の混在

兆候:設計書はAgent Runtime、SDKやAPIはagent_engines/ReasoningEngine、古い資料はVertex AI Agent Engineと表記される

対応:正式名称、SDK名、APIリソース名の対応表を設計書に置き、旧URLや古い料金表を根拠にしない

02

Preview機能への無自覚な依存

兆候:Code Execution、Agent RuntimeのPreview扱いのエージェントIDアクセス方式、統合評価などをGAとしてSLAや監査要件へ記載する

対応:機能単位でリリース段階、APIバージョン、リージョン、代替手段、撤退条件を台帳化する

03

長期記憶の汚染・過剰保存

兆候:誤情報、命令文、不要な機微情報がMemory Bankへ保存され、後続セッションで再利用される

対応:生成対象、IDスコープ、TTL、削除、リビジョン、人のレビュー、Model Armor・敵対的テストを組み合わせる

04

鍵・ネットワーク変更での再作成

兆候:本番後にCMEK鍵、PSCインターフェース、グローバルエンドポイント要件の変更が発生する

対応:再配備とデータ移行を前提に環境をコード化し、鍵・リージョン・PSCを本番前の設計ゲートにする

05

クォータ・費用の急増

兆候:429、長いセッション、過剰なイベント、記憶検索、再試行、Sandbox維持が増える

対応:ピーク負荷を事前計算し、回数・TTL・入力長・再試行を制限し、クォータと予算のアラートを設定する

90-DAY ROADMAP

90日で本番判断まで進める

0〜30日

名称・機能・責任境界を確定

  • 対象業務と現在工数を実測
  • 現行名称とGA/Preview台帳を作成
  • データ、ツール、承認、停止、保存・削除要件を定義
  • リージョンと料金構造切替を確認

判定:Preview依存と代替手段を含む構成・責任・費用項目が承認される

31〜60日

ADKとAgent Platformで安全性を検証

  • 正常・異常・権限拒否を含む評価ケースを実行
  • SessionsとMemory Bankの分離・削除を試験
  • IAM、PSC、CMEK、Sandbox制約を検証
  • 利用量と確認時間を計測

判定:重大越境0件で、停止・削除・再評価を再現でき、総費用の入力値が得られる

61〜90日

限定本番と継続判断

  • 対象者・実行上限・ツールを限定して配備
  • 品質、費用、クォータ、記憶を週次確認
  • Preview・SDK・料金・リージョン変更をレビュー
  • 拡張・維持・停止を判断

判定:人の確認と運用を含む便益が成立し、所有者が継続監視と停止判断を実行できる

SOURCES / METHOD

根拠・確認範囲・更新日

公式仕様

Google Cloud

Gemini Enterprise Agent Platform

適用範囲:現在の上位製品名と、Build・Scale・Govern・Optimizeで構成される公式プロダクト体系。

提供状態:最終確認時点の現行ドキュメント。旧Vertex AI Agent EngineのドキュメントURLは新体系へ転送される。

確認日
2026-08-18
公式発表

Google Cloud

Gemini Enterprise Agent Platform release notes

適用範囲:2026年4月22日の正式名称変更、各機能の提供段階、Agent Identity基盤と個別API、Managed Agents API、Antigravity harnessの位置づけ。

提供状態:Agent Identity基盤はGA。Agent Identity APIなど個別APIのPreview表記は分け、実装・公開前に最新リリースノートを再確認する。

確認日
2026-08-18
公式仕様

Google Cloud

Agent Runtime

適用範囲:マネージド実行、Sessions、Memory Bank、Code Execution、評価、オブザーバビリティ、セキュリティ機能の対応関係。

提供状態:旧Vertex AI Agent Engineは2025年3月4日にGA、2026年4月22日にAgent Runtimeへ名称変更。機能単位のPreview表記は別途確認する。

確認日
2026-08-18
公式仕様

Google Cloud

Agent Development Kit

適用範囲:ADKがモデル非依存のオープンソース開発フレームワークであり、Python、TypeScript、Go、Javaに対応すること。

提供状態:ADKは開発フレームワークであり、Agent Runtimeというマネージド実行サービスとは分けて扱う。

確認日
2026-08-18
公式仕様

Google Cloud

Agent Platform セッションの概要

適用範囲:セッション、イベント、会話中の状態、複数セッションをまたぐ記憶の区別。

提供状態:Sessionsは2025年12月16日にGA。グローバル/マルチリージョン対応は2026年6月17日にGA。

確認日
2026-08-18
公式仕様

Google Cloud

Agent Platform メモリバンク

適用範囲:長期記憶の生成・統合・取得、IDスコープ、TTL、リビジョン、メモリポイズニングのリスク。

提供状態:Memory Bankは2025年12月16日にGA。個別機能とエンドポイントの提供段階はリリースノートで確認する。

確認日
2026-08-18
公式仕様

Google Cloud

Code Execution

適用範囲:分離サンドボックス、ネットワーク非接続、100MBの入出力上限、最大14日の構成可能なTTL。

提供状態:Preview。最終確認時点ではus-central1のv1beta1のみ。

確認日
2026-08-18
公式仕様

Google Cloud

エージェントの評価

適用範囲:評価ケース、推論、トレース、指標、分析、最適化からなるエージェント評価プロセス。

提供状態:生成AI評価サービス自体と、Agent Runtime統合の品質・評価機能では提供段階が異なる。Runtime統合は公式概要でPreview表記。

確認日
2026-08-18
公式仕様

Google Cloud

デプロイされたエージェントのアクセスを管理する

適用範囲:Agent Runtimeでデプロイしたエージェントのアクセス方式、デフォルト/カスタムサービスアカウント、APIキー、OAuth、CMEK、VPC Service Controls。

提供状態:Agent Runtimeからデータソースへ直接アクセスする「エージェントID」方式はPreview。GAのAgent Identity基盤とは機能面を分け、既定サービスエージェントの旧称も確認する。

確認日
2026-08-18
公式仕様

Google Cloud

Quotas and system limits for agents in Agent Platform

適用範囲:Runtime、Sessions、Memory Bank、Code Executionのプロジェクト/リージョン別クォータと調整可否。

提供状態:既定クォータは変更され得るため、負荷試験と本番前に対象プロジェクトで確認する。

確認日
2026-08-18
公式仕様

Google Cloud

Agent Platform の料金

適用範囲:Agent Compute、Agent Memory、Agent Storage、Runtime/Sandbox、Sessions、Memory Bank、評価とモデル利用の課金導線。

提供状態:SessionsとMemory Bankは2026年9月1日に新しい課金構造へ切替予定。固定単価を転載せず、見積時に公式ページとSKUを再確認する。

確認日
2026-08-18
BlueAI実務フレーム

株式会社BlueAI

BlueAI Agent Harness 設計フレーム v1.0

適用範囲:Google Cloud公式機能を、計画・実行・記憶・評価・権限・監査・停止の導入判断へ対応づける編集フレーム。

提供状態:Google Cloudの正式製品名ではない。公式仕様と案件レビューに応じて月次確認する。

確認日
2026-08-18
BlueAI試算

株式会社BlueAI

BlueAI Agent Harness ROI試算モデル

適用範囲:業務便益からRuntime、モデル、コンテキスト、評価、監視、運用工数を差し引く計算枠。市場平均や成果保証ではない。

提供状態:入力前提、Google Cloud SKU、為替、実績利用量を案件ごとに更新する。

確認日
2026-08-18
執筆:株式会社BlueAI技術レビュー:BlueAI 技術レビュー次回確認:2026-09-18

RELATED GUIDES

01 基礎・比較

AGENT HARNESS / FOUNDATION

Agent Harness完全ガイド

Agent Harnessは、モデルにツールを渡すだけの部品ではなく、依頼受付から計画、権限確認、実行、人の承認、記録、停止までを管理する実行基盤です。最初は1業務・読み取り中心・承認必須で検証します。

BlueAI実務フレームBlueAI試算
更新 2026-08-18
技術レビュー:BlueAI 技術レビュー
設計条件を見る →
02 基礎・比較

AGENT HARNESS / FOUNDATION

Agent Harnessのセキュリティ

Agent Harnessのsecurityは、モデルを信用して権限を渡す設計ではなく、入力を未信頼として扱い、専用ID・最小権限・tool policy・人の承認・完全な証跡・即時停止を実行基盤側で強制します。

BlueAI実務フレームBlueAI試算
更新 2026-08-18
技術レビュー:BlueAI 技術レビュー
設計条件を見る →
03 基礎・比較

AGENT HARNESS / FOUNDATION

Agent Harness基盤比較

製品名ではなく、必要なsurfaceと自社が所有する範囲で選びます。DeepSeek Harnessは公式OSSですがDeveloper Previewかつprereleaseで、安定した本番標準基盤とは断定できません。LangGraphは低レベルorchestration、OpenAI Agents SDKはagent primitiveを組むSDKとして評価します。

BlueAI実務フレームBlueAI試算
更新 2026-08-18
技術レビュー:BlueAI 技術レビュー
設計条件を見る →

FROM GUIDE TO DECISION

自社の業務・費用・承認条件に置き換える。

一般情報は登録なしで確認できます。次に、AI利益MAPで投資回収を試算し、RFPで権限・評価・停止条件を発注文書へ落とします。