Evaluaciones / Capa de evidencia

Evaluaciones

Un espacio para métodos versionados de gateways, actualizaciones e informes que facilitan revisar las evaluaciones.

Métodos6 conjuntos de evaluaciónInformesActualizaciones publicadasRitmoActualizaciones continuasRevisiónRevisión de evidencia

01 / CONJUNTOS DE EVALUACIÓN DE GATEWAYS

Evalúa la ruta, no solo el modelo.

Ninguna evaluación demuestra por sí sola la seguridad o la identidad del modelo. Combina pruebas controladas, muestras repetidas y procedencia.

01 / CONJUNTOS DE EVALUACIÓN DE GATEWAYS

Evalúa la ruta, no solo el modelo.

Ninguna evaluación demuestra por sí sola la seguridad o la identidad del modelo. Combina pruebas controladas, muestras repetidas y procedencia.

Seguridad

Límite de credenciales y endpoint

Revisa TLS, manejo del endpoint, redacción de errores, exposición de credenciales y señales de retención.

Objetivo: señal de seguridad

Identidad

Consistencia del modelo declarado

Ejecuta sondeos de capacidad repetidos y comprobaciones de pares de respuestas en las rutas declaradas.

Objetivo: señal de identidad

Fiabilidad

Ventana de disponibilidad de la ruta

Mide conexiones, tiempos de espera, latencia, reintentos y variación entre ventanas.

Objetivo: estabilidad + alcance

Integridad

Conjunto de retos de integridad de respuesta

Usa tareas invariantes, salidas estructuradas y comportamiento de herramientas para detectar degradación de la ruta.

Objetivo: señal de integridad

Economía

Coste efectivo por éxito

Compara el precio mostrado con el coste de las tareas completadas después de fallos y reintentos.

Objetivo: señal de precio

Seguridad

Gestión de abuso y políticas

Mide cómo conserva la ruta los controles declarados del proveedor ante indicaciones adversarias.

Objetivo: señal de seguridad

“Sospechoso” no significa “demostrado”.

Las evaluaciones deben mostrar incertidumbre, muestras repetidas, controles de falsos positivos y una vía de apelación.

Aún no hay informes de evaluación publicados. Las notas de método no son resultados publicados.

Resumen editorial de un benchmark externo. Folkbench no ejecutó esta evaluación.

Qué cambió en la evidencia.

27 ago · v0.2

Identidad del gateway y consistencia del modelo

Los pares de tareas repetidos muestran señales de consistencia; la consistencia no demuestra identidad.

26 ago · 3.600 llamadas

Ventana de fiabilidad de la ruta de 30 días

Patrones de conexión, tiempos de espera y disponibilidad con contexto de muestra.

25 ago · v0.3

Coste efectivo por tarea completada

Precio mostrado comparado con el coste de finalización ajustado por reintentos.

Cada método e informe incluye su alcance, fecha de actualización y limitaciones de evidencia.