向いている条件
- ✓評価する業務と必要機能を先に定義できる
- ✓候補ごとに公式docsと実装を確認できる
- ✓version固定・再評価・rollbackを運用できる
- ✓OSSと自社実装の責任分界を持てる
検索意図:Agent Harness 比較 DeepSeek Harness LangGraph Agents SDK OSS
結論
製品名ではなく、必要なsurfaceと自社が所有する範囲で選びます。DeepSeek Harnessは公式OSSですがDeveloper Previewかつprereleaseで、安定した本番標準基盤とは断定できません。LangGraphは低レベルorchestration、OpenAI Agents SDKはagent primitiveを組むSDKとして評価します。
FIT / NO-FIT
DECISION CRITERIA
OPERATING FLOW
model、tool、session、loop、approval、sandbox、headless、UI、deployment、supportをmust/should化する。
責任:architecture owner
repository、version、release状態、license、docs、security policy、対応runtimeを確認する。
責任:OSS審査担当
代表業務、失敗、resume、権限拒否、停止、upgrade、recoveryを候補ごとに実行する。
責任:platform team
採用、補完実装、version固定、監視、fork、乗換の責任と費用をADRへ残す。
責任:技術責任者
REFERENCE ARCHITECTURE
利用者とautomationが操作する完成surfaceの有無を比較する。
turn、step、分岐、retry、multi-agent、human interruptionの所有者を確認する。
durability、resume、fork、schema migration、concurrent writerの条件を比較する。
adapter、tool policy、extension、version境界、交換単位を確認する。
実行隔離、権限、trace、評価、停止、deploymentを誰が実装・運用するか確認する。
安定性、互換性、更新、脆弱性対応、fork、乗換を運用条件にする。
横断制御
比較表の空欄を推測で埋めません。公式一次情報が確認できないcapabilityは「未確認」として採点から外します。
USE CASES
最初のKPI:完了率、差戻し率、無許可操作0件
最初のKPI:再開成功率、重複実行率、例外復旧時間
最初のKPI:実装工数、trace完全性、guardrail違反率
ROI / TCO
licenseではなく補完実装を含むTCO
金額換算した対象業務便益 −(導入費+不足capability実装費+運用費+upgrade費+migration費+exit費)
検討例:各候補について「提供済み・設定・追加実装・外部service・未確認」を分類し、12〜24か月の人員・infra・support費へ変換する。
BlueAI試算モデルです。repositoryの人気、license、benchmarkだけで生産性・安定性・本番適合を保証しません。
UI、CLI、headless、approval、session browser、admin、deployment。
API、config、session schema、plugin、model adapterの変更。
security patch、sandbox、observability、backup、recovery、support。
STOP CONDITIONS
兆候:DeepSeek Harnessを「安定した本番標準」と記載する
対応:公式READMEのpreview・breaking-change警告とprereleaseを明示し、隔離検証に限定する
兆候:完成Web UIとlow-level graph/SDKを同じ機能欄で単純比較する
対応:提供surface、自作範囲、host runtime、deploymentを分離して比較する
兆候:AWS、Google Cloud、Microsoft等の機能を公式sourceなしで記載する
対応:一次情報のURL・確認日・scopeを必須化し、確認できない候補は掲載しない
90-DAY ROADMAP
0〜30日
判定:推測なしで候補の提供範囲と自作範囲を説明できる
31〜60日
判定:重大越境0件で、version固定と復旧を再現できる
61〜90日
判定:技術責任者がmaturityと所有範囲を含むADRを承認する
SOURCES / METHOD
株式会社BlueAI
適用範囲:Agent Harness候補をmaturity、surface、loop、state、extension、runtime、lifecycle、TCOで比較する評価枠。
提供状態:案件レビューと運用知見に応じて月次確認
株式会社BlueAI
適用範囲:工数削減余地、確認・例外対応、運用費を同じ式で比較する計算枠。市場平均や成果保証ではない。
提供状態:入力前提と実績差分を案件ごとに確認
DeepSeek AI
適用範囲:正式名称、公式repository、Developer Preview、Cordisを使ったplugin architecture、起動方法。
提供状態:Developer Preview。公式READMEが互換性を壊す変更を明示しているため月次確認
DeepSeek AI
適用範囲:2026年8月18日時点で確認したprerelease。plugin設定、subagent、MCP/ACP、DeepSeek reasoning effort等の変更内容。
提供状態:Prerelease。固定版として扱わず、採用時に最新releaseとmigration情報を再確認
DeepSeek AI
適用範囲:model adapter、tool registry、session log、agent loopをpluginとして構成する設計とturn/step flow。
提供状態:master branchのDeveloper Preview仕様。version固定時は対応tagの文書を確認
LangChain
適用範囲:長時間・stateful agent向けの低レベルorchestration framework、durable execution、human-in-the-loop、memoryの公式説明。
提供状態:導入時に対象言語、version、deployment条件を公式docsで再確認
OpenAI
適用範囲:Agent、handoff、guardrail、session、human-in-the-loop、tracing等のSDK primitiveに関する公式説明。
提供状態:導入時に利用model、SDK version、host環境の対応状況を公式docsで再確認
RELATED GUIDES
AGENT HARNESS / FOUNDATION
Agent Harnessは、モデルにツールを渡すだけの部品ではなく、依頼受付から計画、権限確認、実行、人の承認、記録、停止までを管理する実行基盤です。最初は1業務・読み取り中心・承認必須で検証します。
AGENT HARNESS / FOUNDATION
Agent Harnessのsecurityは、モデルを信用して権限を渡す設計ではなく、入力を未信頼として扱い、専用ID・最小権限・tool policy・人の承認・完全な証跡・即時停止を実行基盤側で強制します。
AGENT HARNESS / FOUNDATION
Agent HarnessのROIは、無人化率ではなく、導入前の作業量から確認・例外対応を含む導入後総工数と総費用を引いた純便益で測ります。成功と撤退を同じ時点に設定します。
FROM GUIDE TO DECISION
一般情報は登録なしで確認できます。次に、AI利益MAPで投資回収を試算し、RFPで権限・評価・停止条件を発注文書へ落とします。