La ficha original enlazaba Mock-Agent-Tester con github.com/mock/agent-tester. El 2026-08-21, la API de GitHub devolvió 404 y la búsqueda por nombre exacto no encontró ningún repositorio. Tampoco pudimos atribuir propietario, paquete, versión, licencia, documentación o contacto de seguridad.
Se retiraron las afirmaciones anteriores sobre enrutamiento rápido, funciones ampliables, opiniones de Reddit y compatibilidad con Windows porque no tenían fuentes verificables. El botón externo abre una búsqueda de comprobación en GitHub, no un sitio oficial.

Qué pudo comprobarse
| Comprobación | Resultado | Consecuencia editorial |
|---|---|---|
| Repositorio guardado | API de GitHub: 404 | No se pueden revisar código, propietario, incidencias ni historial |
| Búsqueda exacta | Sin resultados | No se atribuyó un reemplazo canónico |
| Paquete o versión | Ningún artefacto atribuible | No hay instalación ni checksum verificables |
| Licencia | No encontrada | Se desconocen derechos de uso, modificación y distribución |
| Afirmaciones anteriores | Sin fuentes trazables | Se retiraron routing, skills, Reddit y Windows |
Qué significa «sin verificar»
Un 404 no explica por qué falta un repositorio. Puede haberse renombrado, transferido, hecho privado o eliminado. La conclusión defendible es más limitada: la ficha actual no aporta evidencia suficiente para verificar código, mantenimiento, compatibilidad o licencia.
«Sin verificar» describe el estado de la evidencia, no acusa al proyecto ni a su autor. Por eso la página no hace afirmaciones sobre instalación, funciones, compatibilidad, estado open source, mantenimiento o seguridad. Si aparece una fuente oficial atribuible, deberá revisarse el estado.
Pruebas necesarias para restaurar la reseña
- Aportar un dominio u organización controlados por el propietario.
- Aportar repositorio canónico e identidad atribuible del responsable.
- Aportar licencia y documentación actual.
- Aportar versión o commit reciente, artefacto instalable y checksum.
- Aportar contacto de seguridad y, si procede, condiciones de tratamiento de datos.
- Reproducir las funciones declaradas antes de restaurar la valoración del producto.
Base práctica para probar agentes
Lo siguiente es orientación editorial independiente de AIDreamHub, no una lista de funciones de Mock-Agent-Tester. Las pruebas de agentes deben observar selección de herramientas, argumentos, permisos, cambios de estado y fallos, además de la respuesta final.
| Capa | Evidencia que conservar | Método recomendado |
|---|---|---|
| Identidad | Propietario, repositorio, versión, licencia, checksum | Antes de ejecutar código |
| Uso de herramientas | Selección, argumentos, permisos y efectos | Aserciones deterministas |
| Gestión de fallos | Timeout, respuesta inválida, rechazo, reintento, éxito parcial | Mocks y contratos en sandbox |
| Calidad de respuesta | Exactitud, evidencias, aclaración y rechazo | Etiquetas humanas y evaluadores calibrados |
| Seguridad | Inyección, fuga de secretos y autonomía excesiva | Mínimo privilegio y aprobaciones |
| Operación | Latencia, coste, pasos y repetibilidad | Ejecuciones repetidas y trazas versionadas |
Los mocks reproducen fallos, pero no imitan por completo proveedor, navegador, red o producción. Combine pruebas deterministas rápidas con contratos en sandbox y pocos casos de extremo a extremo protegidos. Use evaluadores LLM solo para criterios subjetivos y calíbrelos con ejemplos etiquetados por personas.
Alternativas con soporte
| Opción | Mejor uso | Principal contrapartida |
|---|---|---|
| Promptfoo | Matrices locales/CI, aserciones y red teaming | Hay que gobernar proveedores, fixtures y evaluadores |
| LangSmith Evaluations | Datasets con trazas, evaluación offline/online y varios evaluadores | Revisar gobierno de datos alojados y precio |
| OpenAI Hosted Evals | Datasets, criterios, ejecuciones asíncronas e informes centrados en OpenAI | Mayor acoplamiento y coste de API |
| Repositorio OpenAI Evals | Patrones abiertos y evaluaciones personalizadas | Ruta distinta del producto Hosted Evals actual |
| Dobles de prueba propios | Control exacto de estado, permisos, tiempo, fallos y efectos | Mayor esfuerzo de ingeniería |
Juicio independiente: no conviene adoptar ni descartar una herramienta por el nombre. Para agentes en producción suele funcionar mejor una combinación: comprobaciones deterministas del estado para acciones irreversibles y una plataforma semántica mantenida para calidad de respuesta y regresiones.
Límites y seguridad
No se publican benchmarks ni resultados prácticos porque no se confirmó un proyecto ejecutable. La comparación describe alternativas citadas, no capacidades de Mock-Agent-Tester.
Los datos de evaluación pueden contener prompts privados, documentos, clientes y salidas de herramientas. Antes de usar un evaluador alojado, revise retención, entrenamiento, región, subprocesadores, acceso y borrado.
La inyección puede llegar desde el usuario o desde contenido recuperado. Las pruebas deben comprobar permisos y transiciones de estado para bloquear acciones peligrosas aunque el texto del modelo resulte convincente.
Preguntas frecuentes
¿Es Mock-Agent-Tester un proyecto confirmado?
No con la evidencia disponible. El repositorio guardado devolvió 404 el 21 de agosto de 2026 y no apareció un reemplazo atribuible.
¿El 404 prueba que nunca existió?
No. Solo indica que la URL actual no demuestra su estado presente. Podría haberse renombrado, transferido, privatizado o eliminado.
¿Puedo instalarlo?
No se confirmó ningún paquete o versión oficial, por lo que esta página no ofrece un comando de instalación.
¿Es open source?
No se sabe. No se encontró una licencia atribuible ni un repositorio canónico.
¿Por qué se conserva la página?
Para corregir de forma transparente la ficha anterior y explicar qué evidencia falta.
¿Qué alternativa puedo usar?
Promptfoo sirve para matrices CI, LangSmith para evaluación con trazas, Hosted Evals para flujos OpenAI y las pruebas deterministas propias para permisos y efectos.
Fuentes revisadas
- Repositorio guardado en la ficha original
- Endpoint de verificación de GitHub
- Búsqueda exacta en GitHub
- Documentación oficial de Promptfoo
- Repositorio y licencia de Promptfoo
- Conceptos de evaluación de LangSmith
- Guía de OpenAI Hosted Evals
- Repositorio OpenAI Evals
- Guía OWASP sobre prompt injection
Verificación independiente: 2026-08-21. Revisar de nuevo si aparece un propietario o repositorio canónico.



