元の項目は Mock-Agent-Tester として github.com/mock/agent-tester を案内していました。2026-08-21 の確認では GitHub API が 404 を返し、完全一致のリポジトリ検索にも結果がありません。管理者、パッケージ、リリース、ライセンス、文書、セキュリティ窓口をこの名称に結び付ける根拠も見つかりませんでした。
以前掲載されていた高速ルーティング、拡張可能なスキル、Redditの評価、Windows対応に関する記述は、出典を確認できないため削除しました。外部ボタンは公式サイトではなく、GitHub上の確認用検索を開きます。

確認できた事実
| 確認項目 | 結果 | 編集上の結論 |
|---|---|---|
| 登録リポジトリ | GitHub API は404 | ソース、管理者、Issue、履歴を確認できない |
| 完全一致検索 | 結果なし | 移転先の公式リポジトリを特定できない |
| パッケージ/リリース | 帰属可能な成果物なし | 安全な導入方法やチェックサムを提示できない |
| ライセンス | 未確認 | 利用、改変、再配布の権利を推定できない |
| 旧機能説明 | 根拠なし | ルーティング、スキル、Reddit、Windowsの記述を撤回 |
「未確認」が意味する範囲
404だけでは、改名、移管、非公開化、削除のどれが起きたかは分かりません。確実に言えるのは、現在の項目だけではコード、保守状況、互換性、ライセンスを検証できないということです。
「未確認」は証拠の状態を示すもので、作者やプロジェクトへの非難ではありません。そのため本ページは、導入可能性、機能、互換性、オープンソース性、開発終了、安全性について断定しません。公式情報が示された場合は再確認します。
製品レビューを再開するために必要な証拠
- 管理者が運営するドメインまたは組織ページを示す。
- 公式リポジトリと管理者の帰属関係を示す。
- ライセンスと現行文書を示す。
- 最新リリースまたはコミット、導入成果物、チェックサムを示す。
- セキュリティ窓口と、必要に応じてデータ取扱条件を示す。
- 再現可能な例で機能を検証してから製品評価を戻す。
今すぐ使えるAgentテストの基準
以下はAIDreamHub独自の編集ガイドで、Mock-Agent-Testerの機能説明ではありません。Agentのテストでは最終回答だけでなく、ツール選択、引数、権限、状態変化、失敗時の挙動を確認します。
| 対象 | 残す証拠 | 推奨方法 |
|---|---|---|
| 身元 | 管理者、リポジトリ、リリース、ライセンス、チェックサム | コード実行前に確認 |
| ツール動作 | 選択、引数、権限、副作用 | 決定的なアサーション |
| 失敗処理 | タイムアウト、不正応答、拒否、再試行、部分成功 | モックとサンドボックス契約テスト |
| 回答品質 | 正確性、根拠、確認質問、拒否 | 人手ラベルと校正済み評価器 |
| 安全性 | プロンプト注入、秘密漏えい、過剰な自律性 | 最小権限と承認ゲート |
| 運用 | 遅延、費用、手順数、再現性 | 反復実行と版管理された履歴 |
モックは失敗を再現できますが、モデル提供者、ブラウザ、ネットワーク、本番環境を完全には再現しません。決定的テストにサンドボックス契約テストと少数の保護されたE2Eを組み合わせます。LLM評価器は、人手で校正した主観評価に限定します。
確認済みの代替手段
| 選択肢 | 適した用途 | 主な注意点 |
|---|---|---|
| Promptfoo | ローカル/CIでのプロンプト・モデル比較、アサーション、レッドチーム | 提供者、テストデータ、評価器の管理が必要 |
| LangSmith評価 | トレース付きデータセット、オフライン/オンライン評価 | ホスト型サービスのデータ管理と価格を確認 |
| OpenAI Hosted Evals | OpenAI中心のデータセット、基準、非同期実行、レポート | プラットフォーム依存とAPI費用 |
| OpenAI Evalsリポジトリ | 公開された評価パターンと独自評価コード | 現在のホスト型Evalsとは利用経路が異なる |
| 自作テストダブル | 状態、権限、時刻、障害、副作用の厳密な制御 | 実装負担は最大だが業務規則に強い |
独立見解:名称だけでツールを採用・却下すべきではありません。本番Agentには、不可逆操作を守る決定的な状態検証と、回答品質を測る継続運用可能な評価基盤を組み合わせる方法が適しています。
制約と安全上の注意
実行可能な製品を確認できないため、ベンチマークや使用感は掲載しません。比較表は各代替製品の情報であり、Mock-Agent-Testerの能力を示すものではありません。
評価データには非公開プロンプト、検索文書、顧客記録、ツール出力が含まれ得ます。ホスト型評価サービスに送る前に、保存期間、学習利用、地域、再委託先、アクセス制御、削除方法を確認してください。
プロンプト注入はユーザー入力だけでなく検索内容からも入ります。説得力のある危険な文章が生成されても実動作を止められるよう、権限と状態遷移をテストします。
よくある質問
確認済みのソフトウェアですか?
現在の証拠では確認できません。2026年8月21日に登録リポジトリは404で、完全一致の移転先も特定できませんでした。
404は存在しなかった証拠ですか?
いいえ。現在のURLで状況を確認できないという意味です。改名、移管、非公開化、削除の可能性があります。
インストールできますか?
公式パッケージやリリースを確認できないため、導入コマンドは掲載しません。
オープンソースですか?
不明です。帰属可能なライセンスや公式ソースを確認できません。
なぜページを残すのですか?
旧情報を見た利用者に訂正を示し、再確認に必要な証拠を明確にするためです。
代わりに何を使えますか?
CI比較にはPromptfoo、トレース管理にはLangSmith、OpenAI中心の運用にはHosted Evals、権限と副作用には自作の決定的テストが候補です。
確認した情報源
- 旧項目に登録されていたリポジトリ
- GitHub API確認先
- GitHub完全一致検索
- Promptfoo公式評価文書
- Promptfooリポジトリとライセンス
- LangSmith評価概念
- OpenAI Hosted Evalsガイド
- OpenAI Evalsリポジトリ
- OWASPプロンプト注入ガイド
独立確認日:2026-08-21。公式管理者またはリポジトリが示された場合は再確認が必要です。



