La fiche initiale associait Mock-Agent-Tester à github.com/mock/agent-tester. Le 2026-08-21, l’API GitHub a renvoyé 404 et la recherche du nom exact n’a trouvé aucun dépôt. Aucun propriétaire, package, release, licence, documentation ou contact sécurité n’a pu être attribué.
Les anciennes affirmations sur le routage rapide, les fonctions extensibles, Reddit et Windows ont été retirées faute de sources. Le bouton externe ouvre une recherche de vérification GitHub, pas un site officiel.

Ce qui a pu être vérifié
| Contrôle | Résultat | Conséquence éditoriale |
|---|---|---|
| Dépôt enregistré | API GitHub : 404 | Impossible d’examiner code, propriétaire, issues ou historique |
| Recherche exacte | Aucun résultat | Aucun remplacement canonique attribuable |
| Package ou release | Aucun artefact attribuable | Aucune installation ni somme de contrôle vérifiable |
| Licence | Introuvable | Droits d’usage, modification et redistribution inconnus |
| Anciennes affirmations | Aucune source traçable | Les mentions routing, skills, Reddit et Windows ont été retirées |
Ce que signifie « non vérifié »
Un 404 n’explique pas pourquoi le dépôt est absent. Il peut avoir été renommé, transféré, rendu privé ou supprimé. La conclusion défendable est plus étroite : la fiche actuelle n’apporte pas assez de preuves pour vérifier le code, la maintenance, la compatibilité ou la licence.
« Non vérifié » décrit l’état des preuves et n’accuse ni le projet ni son auteur. La page ne fait donc aucune affirmation sur l’installation, les fonctions, la compatibilité, le statut open source, la maintenance ou la sécurité. Une source officielle attribuable imposerait une nouvelle vérification.
Preuves nécessaires pour rétablir une revue
- Fournir un domaine ou une organisation contrôlés par le propriétaire.
- Fournir le dépôt canonique et l’identité attribuable du mainteneur.
- Fournir la licence et la documentation actuelle.
- Fournir une release ou un commit récent, un artefact installable et sa somme de contrôle.
- Fournir un contact sécurité et, si nécessaire, les conditions de traitement des données.
- Reproduire les fonctions annoncées avant de rétablir une note produit.
Base pratique pour tester un agent
Les éléments suivants sont des conseils éditoriaux indépendants d’AIDreamHub, pas des fonctions de Mock-Agent-Tester. Un test d’agent doit observer outils, arguments, permissions, changements d’état et chemins d’échec, pas seulement la réponse finale.
| Couche | Preuves à conserver | Méthode recommandée |
|---|---|---|
| Identité | Propriétaire, dépôt, release, licence, somme de contrôle | Avant toute exécution |
| Comportement des outils | Choix, arguments, permissions, effets | Assertions déterministes |
| Gestion des échecs | Timeout, réponse invalide, refus, retry, succès partiel | Mocks et contrats sandbox |
| Qualité de réponse | Exactitude, preuves, clarification, refus | Labels humains et évaluateurs calibrés |
| Sécurité | Injection, fuite de secrets, autonomie excessive | Moindre privilège et approbations |
| Exploitation | Latence, coût, étapes, répétabilité | Répétitions et traces versionnées |
Les mocks rendent les échecs reproductibles sans reproduire totalement fournisseur, navigateur, réseau ou production. Associez tests déterministes, contrats sandbox et quelques scénarios de bout en bout protégés. Réservez les évaluateurs LLM aux critères subjectifs et calibrez-les avec des exemples annotés par des humains.
Alternatives prises en charge
| Option | Usage adapté | Principal compromis |
|---|---|---|
| Promptfoo | Matrices locales/CI, assertions et red teaming | Gouvernance des fournisseurs, fixtures et évaluateurs |
| LangSmith Evaluations | Datasets tracés, évaluation offline/online et plusieurs évaluateurs | Gouvernance des données hébergées et prix à vérifier |
| OpenAI Hosted Evals | Datasets, critères, exécutions asynchrones et rapports centrés OpenAI | Dépendance accrue et coût API |
| Dépôt OpenAI Evals | Modèles ouverts et code d’évaluation personnalisé | Parcours différent du produit Hosted Evals actuel |
| Doubles de test internes | Contrôle exact de l’état, des droits, du temps, des pannes et effets | Effort d’ingénierie maximal |
Jugement indépendant : il ne faut ni adopter ni écarter un outil à partir de son seul nom. Pour un agent en production, une approche hybride est généralement préférable : assertions d’état déterministes pour les actions irréversibles et plateforme sémantique maintenue pour la qualité des réponses et les régressions.
Limites et sécurité
Aucun benchmark ni essai pratique n’est publié, faute de projet exécutable confirmé. Le tableau décrit les alternatives citées, pas les capacités de Mock-Agent-Tester.
Les données d’évaluation peuvent inclure prompts privés, documents, dossiers clients et sorties d’outils. Avant un évaluateur hébergé, vérifiez rétention, entraînement, région, sous-traitants, accès et suppression.
L’injection peut venir de l’utilisateur ou du contenu récupéré. Les tests doivent vérifier permissions et transitions d’état afin de bloquer les actions dangereuses même si le texte du modèle paraît convaincant.
Questions fréquentes
Mock-Agent-Tester est-il un projet confirmé ?
Pas selon les preuves disponibles. Le dépôt enregistré a renvoyé 404 le 21 août 2026 et aucun remplacement attribuable n’a été trouvé.
Le 404 prouve-t-il que le projet n’a jamais existé ?
Non. Il indique seulement que l’URL actuelle ne prouve pas son état présent. Renommage, transfert, passage en privé ou suppression restent possibles.
Puis-je l’installer ?
Aucun package ou release officiel n’a été confirmé ; cette page ne fournit donc aucune commande d’installation.
Est-il open source ?
On l’ignore. Aucune licence attribuable ni dépôt canonique n’a été trouvé.
Pourquoi conserver cette page ?
Pour corriger l’ancienne fiche de façon transparente et préciser les preuves manquantes.
Quelle alternative choisir ?
Promptfoo convient aux matrices CI, LangSmith aux évaluations tracées, Hosted Evals aux workflows OpenAI et des tests déterministes internes aux permissions et effets.
Sources consultées
- Dépôt enregistré dans la fiche initiale
- Endpoint de vérification GitHub
- Recherche exacte sur GitHub
- Documentation officielle Promptfoo
- Dépôt et licence Promptfoo
- Concepts d’évaluation LangSmith
- Guide OpenAI Hosted Evals
- Dépôt OpenAI Evals
- Guide OWASP sur la prompt injection
Vérification indépendante : 2026-08-21. Réexaminer le statut si un propriétaire ou dépôt canonique apparaît.



