Agentspan は、プロセスのクラッシュ、展開、長時間の待機、人間の承認に耐えなければならない AI エージェントのためのオープンソースの実行レイヤーです。エージェント ループ全体をアプリケーション メモリに保持する代わりに、実行状態を Agentspan サーバーに保存し、接続されているワーカーにツールの作業を委任します。このプロジェクトは、Conductor ワークフロー エンジン上の Orkes によって構築されており、現在 MIT ライセンスを取得しており、自己ホスト可能です。
区別は重要です。Agentspan は、弱いエージェントをインテリジェントにし、安全な権限を選択したり、ビジネス結果を検証したりするものではありません。それは失敗モデルを変えます。実行には永続的な ID が取得され、完了したステップには履歴があり、保留中の承認はサーバー側で待機でき、代替作業者が再接続できます。チームは、これをプロンプト ライブラリとしてではなく、分散システム インフラストラクチャとして評価する必要があります。
状態がエージェント プロセスの外に移動すると何が変わるか
| 懸念 | インプロセスエージェントループ | Agentspan モデル | オペレーターはまだ所有しています |
|---|---|---|---|
| プロセスクラッシュ | 記憶や現在位置が消える場合があります | サーバーはワークフローの状態を保持し、作業を再開します | ワーカーの可用性とべき等ツール |
| 人間の承認 | アプリケーションは保留状態を維持または再構築する必要があります | ワークフローはサーバー側で一時停止し、後で応答を受け取ることができます | 承認者のアイデンティティ、タイムアウト、およびエスカレーションのポリシー |
| 再試行 | カスタム ループ、多くの場合粒度が粗い | ステップごとの再試行はワークフローのプリミティブです | どのエラーが再試行可能か、副作用は安全かどうか |
| 歴史 | アプリケーション固有のログ | 入力、出力、タイミング、ステップはクエリ可能です | 編集、保存、アクセス制御 |
| スケール | 1 つのプロセスに結合された状態とスケジューリング | サーバーがワーカーと実行を調整します | 容量、テナンシー、キュー、災害復旧 |
| スケジュール/イベント | cron またはメッセージの配管を分離する | Conductor スケジュールとイベントの統合 | 重複、重複排除、および見逃したイベントの動作 |
障害境界として描画されるランタイム パス
ユーザー/イベント
|
v
.----------------------。 耐久状態----------------------。
|アプリケーションコード | ------------------------> | Agentspan / Conductor|
|エージェント + ツール | <--- task delegation ---- | run, step, history |
'--------------------' '----------+-----------'
| worker may die |
| and reconnect | calls
v v
custom tool process LLM / HTTP / MCP tools
| |
'---------------- results + side effects ---------------'
Durable checkpoint ≠ transaction over every external side effect
最後の行は、操作上の最も重要な注意事項です。ワークフロー エンジンは、支払い、電子メール、またはリポジトリの変更を要求したことを記憶できますが、任意の外部アクションを自動的にトランザクションにすることはできません。ワーカーがリモートで成功し、完了を確認する前にクラッシュした場合、再試行によってアクションが繰り返される可能性があります。すべての変更ツールには、冪等性キー、調整クエリ、または人間の意思決定パスが必要です。
Happy-Path デモの前にクラッシュ テストを行う
有用な概念実証では、異なる境界でワーカーを意図的に殺します。読み取り専用のリサーチ ジョブを 1 つ、副作用を制御したジョブを 1 つ、承認ゲート型ジョブを 1 つ実行します。実行 ID を保存し、別のマシンで再起動して再接続し、最終状態を中断されていない制御実行と比較します。
| 注入ポイント | 期待される証拠 | ロールアウトをブロックする障害が発生しました |
|---|---|---|
| LLM リクエスト中 | 制限付き再試行と 1 つの一貫した継続 | 無制限のトークン消費または重複したコンテキスト |
| 読み取り専用ツールの完了後 | 以前の結果を失わずに再開 | 最初から実行を再開します |
| リモート書き込み後、確認応答前 | 冪等性キーにより重複を防止 | チケット 2 枚、支払い、メッセージまたはコミット |
| 承認を待っている間 | 再起動により保留中のリクエストと監査 ID が保持されます。 | 暗黙の承認、リクエストの紛失、または間違った承認者 |
| 導入中 | 古いワーカーと新しいワーカーは同じ排他的なステップを実行しません | スプリットブレインの副作用 |
| サーバーの再起動後 | 文書化された回復目標が達成されている | 履歴またはワークフローの状態を回復できません |
再試行には副作用契約が必要です
自動再試行を有効にする前にツールを分類します。純粋な関数と反復可能な読み取りは通常、再試行できます。書き込みには、ワークフローとステップを対象とした安定した操作キーが必要です。反復不可能なアクションには、「再試行前のクエリ」アダプターまたは手動調整キューが必要です。 LLM に、会話のコンテキストから支払いまたはメッセージがすでに発生したかどうかを推測するよう依頼しないでください。
- 安全な再試行: チェックサムを計算し、公開ページを読み取り、または不変 ID でクエリを実行します。
- 条件付きで安全: サーバー強制冪等キーを使用してチケットを作成するか、バージョンチェックを使用して既知のレコードを更新します。
- デフォルトでは安全ではありません: 重複排除を行わずに、電子メールの送信、コンテンツの公開、送金、または運用変更の実行を行うことができます。
- 補償可能: テスト済みのキャンセル操作と説明責任のあるエスカレーション パスが存在する場合にリソースを予約します。
人間の承認はポリシー システムであり、一時停止ボタンではありません
Agentspan は、承認および CLI、API、または UI 応答用にマークされたツールを文書化します。運用ポリシーでは、誰が承認できるか、どの正確な引数が凍結されるか、ID が認証される方法、リクエストの有効期限がいつ切れるか、変更されたアクションによって新しい承認が作成されるかどうかをさらに定義する必要があります。承認者に、提案された副作用、目的地、データ開示、推定コスト、および人間が判読できる差分を示します。
影響の大きいアクションについては、要求者と承認者を分離します。拒否する場合は、アクションを終了するか範囲を狭める必要があります。モデルに別のツールを使用してゲートの周りをルーティングするように指示するべきではありません。ポリシーのバージョンと承認アーティファクトを実行とともに記録して、リプレイによって古い決定が新しい引数に適用されないようにします。
フレームワークの互換性はセマンティクスが同一であることを意味するわけではありません
公式ドキュメントでは、独自のエージェント API と、LangGraph、OpenAI エージェント、SDK、および Google ADK との統合について説明しています。導入する予定のアダプターとバージョンを正確にテストします。ストリーミング、キャンセル、ネストされたエージェント、ツール呼び出し ID、構造化出力、コンテキストの伝播、およびエラー マッピングを確認します。ラッパーは、チェックポイントまたは再試行の動作を変更しながら、呼び出し可能なインターフェイスを保持できます。
| 統合の選択 | それを使用する最大の理由 | 検証の質問 |
|---|---|---|
| ネイティブ Agentspan エージェント | 最小の概念的な表面と文書化されたプリミティブ | そのモデル/ツールの抽象化は必要な動作をカバーしていますか? |
| LangGraph | 既存のグラフ、ノード、状態の設計 | どの層がチェックポイント、再試行、割り込みを所有していますか? |
| OpenAI エージェント SDK | 既存のエージェント、ハンドオフ、およびトレース規則 | ツールと承認イベントは損失なくマッピングされていますか? |
| Google ADK | 既存の Google エージェントの実装 | セッション状態とアーティファクトは永続的に表現されますか? |
| HTTP/OpenAPI ツール | カスタムワーカーコードを使用しないサーバー側の呼び出し | 認証情報、レート制限、応答スキーマはどこで適用されますか? |
| MCP ツール | MCP サーバーの機能サーフェスを再利用する | 公開された各メソッドの範囲を指定して個別に監査できますか? |
認証情報と保存された実行データ
Agentspan は、環境構成とサーバー実行の HTTP、OpenAPI、MCP ツールを通じてプロバイダー キーをサポートします。中央で実行すると、すべてのワーカーにコピーされるシークレットを減らすことができますが、権限も集中します。シークレット マネージャー、有効期間の短い認証情報、環境ごとの ID、送信許可リストを使用します。プロンプト、ツール スキーマ、または永続化された結果内に資格情報を決して配置しないでください。
実行履歴には、顧客テキスト、取得したドキュメント、ソース コード、モデル応答、ツール引数、エラーが含まれる場合があります。保存前にどのフィールドを編集するか、誰が実行を検索または再生できるか、テナントをどのように分離するか、削除リクエストがバックアップや可観測性エクスポートにどのように伝播されるかを決定します。永続性と回復可能性を想定するのではなく、トランスポートとストレージを暗号化し、読み取りアクセスを監査し、復元をテストします。
行動につながる観察力
生のトレースは、運用上の質問に答える場合にのみ役立ちます。トリガー、ワークフロー、モデル呼び出し、外部ミューテーション全体に相関 ID を付加します。モデル/バージョン、プロンプトポリシーのバージョン、トークン数、ツールの遅延、再試行の理由、承認の遅延、端末の分類を記録します。ラベルではカーディナリティの高いシークレットを避けてください。
| メトリック | なぜそれが重要なのか | 推奨されるアラート |
|---|---|---|
| 成功したビジネス成果 | 完了したワークフローと正しい結果を分離する | タスク固有のベースラインに対するドロップ |
| 重複した副作用 | 壊れたべき等性を検出します | 重要なツールの確認された重複 |
| ステップごとの再試行数 | 不安定なツールと隠れたコストを見つける | ツール/バージョンごとの継続的な増加 |
| 承認年齢 | 行き詰まった作業と運用負荷を示します | 過去のポリシーの SLA または有効期限 |
| 回復成功 | コア耐久性の約束を測定します | 回復不可能な対象となる実行 |
| 承認された結果ごとのコスト | モデル、コンピューティング、およびレビュー担当者のコストを組み合わせたもの | 回帰と制御のワークフロー |
導入とアップグレードのチェックリスト
- SDK、サーバーおよび Conductor バージョンを固定します。互換性マトリックスを記録します。
- 開発、ステージング、運用の認証情報、キュー、データ ストアを分離します。
- ワークフロー メタデータをバックアップし、隔離された環境への復元をテストします。
- エージェントおよびテナントごとに同時実行性、トークン、時間、再試行、および再帰のバジェットを設定します。
- サーバー、ワーカー、キュー、データベース、モデルプロバイダーのヘルスチェックを構成します。
- アップグレードにはカナリア ワーカーを使用し、古いワークフロー定義を実行中の実行に利用できるようにしておきます。
- キャンセルのセマンティクスを定義します。今後の作業を停止し、認証情報を取り消し、部分的な副作用を調整します。
- 脅威モデルのプロンプト挿入、SSRF、悪意のあるツールの出力、および広範囲にわたる MCP/OpenAPI の露出。
代替案と正直な選択境界
| オプション | こんなときに選んでください | トレードオフ |
|---|---|---|
| Agentspan | Conductor ではなくエージェント固有の API、セルフホスティング、統合が必要な場合 | 新しいコントロール プレーンと進化するプロジェクト サーフェス |
| LangGraph 永続性 | アプリケーションはすでに深くグラフ化されています | より多くの本番オーケストレーションの選択肢を所有できるようになりました |
| 時間的 | 組織はすでに耐久性のあるワークフローを大規模に運用しています | エージェントアダプターとリプレイセーフコードにはエンジニアリングが必要 |
| Conductor を直接 | エージェントを超えた一般的なワークフローのプリミティブが必要 | エージェント固有の利便性が低い |
| 再ステートまたは DBOS パターン | 永続的な関数/トランザクションをアプリケーション コードの近くに配置したい | 異なるエコシステムと統合モデル |
| キュー + データベース ステート マシン | ワークフローは小さく、決定的で安定しています | 依存関係の数は最も少ないが、カスタム リカバリと UI は機能する |
| マネージドエージェントプラットフォーム | インフラストラクチャ制御よりも迅速な運用が重要 | ベンダー、データ、カスタマイズの制約 |
ワークフローで LLM が使用されているという理由だけで永続的なランタイムを追加しないでください。副作用のない短い同期アシスタントでは、要求のロギングと再試行のみが必要な場合があります。 Agentspan は、実行時間が長い場合、承認がプロセスの存続期間を超えて待機する場合、イベントが作業をトリガーする場合、またはリカバリ履歴が製品要件である場合に、魅力的になります。
2週間の評価プラン
第 1 週では、制御ワークフローと統合を確立する必要があります。 3 ~ 10 のステップ、1 つの承認、および可逆外部書き込みを含む制限付きジョブを 1 つ選択します。中断のない成功とコストを測定し、クラッシュを発生させます。第 2 週では、重複イベント、承認の遅れ、不正なツール出力、プロバイダーのレート制限、従業員の交代、サーバーの再起動、実行中のアップグレードなど、敵対的なケースや運用上のケースに焦点を当てます。
別のエンジニアが書面による指示に従ってデプロイメントとリカバリを再現でき、すべての変更ツールにはテスト済みの副作用ポリシーがあり、機密履歴が管理され、サーバーとオンコールの負担を正当化できるほど受け入れ結果率が向上する場合にのみ昇格します。
よくある質問
Agentspan はエージェント フレームワークですか?
これにはエージェント API が含まれていますが、差別化要因はエージェントの下での耐久性のあるランタイムです。サポートされている外部フレームワークで構築されたエージェントを実行することもできます。
実行エンジンとは何ですか?
プロジェクトでは、エージェント定義が Conductor 上のワークフローにコンパイルされ、永続的な状態、履歴、再試行、およびワークフロー プリミティブが提供されると述べています。
自己ホストできますか?
はい。公式サイトでは、MIT ライセンスを取得しており、自己ホスト可能であると説明されています。オペレーターは依然として、依存関係、データ ストア、アップグレードを検証し、期待をサポートする必要があります。
クラッシュリカバリーは重複書き込みを防止しますか?
いいえ。永続的なオーケストレーションにより状態の損失は軽減されますが、外部書き込みでは依然として冪等性、調整、または補償が必要です。
承認は自動的に安全になりますか?
いいえ。チームは、認証、承認、引数のバインディング、有効期限、職務の分離、および監査の保持を定義する必要があります。
エージェント フレームワークは不要になりますか?
いいえ。既存のエージェント定義を補完できます。セマンティクスの競合を避けるために、状態、再試行、および割り込みに対して明確な所有者を 1 人選択します。
最初の運用ワークロードはどのようなものにすべきでしょうか?
支払い、生産変更、広範なデータ アクセスではなく、測定可能な成功と明確なエスカレーションを伴う、制限付き、可逆的、低感度のワークフロー。
一次情報源
- 公式 Agentspan サイトとクイックスタート
- 公式ドキュメント
- 公式のアーキテクチャと耐久性の説明
- エージェント実行の概念
- ツールの種類とサーバー側の実行
- サポートされているモデルプロバイダーと構成
- CLI、承認および実行履歴
- 公式ソースリポジトリ
- LLM アプリケーションのリスクに関する OWASP ガイダンス
最終レビュー日は 2026 年 7 月 25 日です。Agentspan は急速に進化しています。導入する前に、正確な SDK/server リリース、ライセンス、フレームワーク アダプター、および展開手順を確認してください。



