Método Construct

Una respuesta convincente aún no demuestra un comportamiento fiable.

Evaluamos el sistema completo: el modelo dentro de una tarea, un entorno, una secuencia de interacciones y unos límites de decisión definidos.

Método

Seis aspectos que comprobamos en cada evaluación.

01

Validez de constructo

¿Las tareas y rúbricas representan la capacidad declarada o un indicador sencillo pero inadecuado?

02

Fiabilidad y coherencia

Las repeticiones muestran distribución, dispersión y fallos que aparecen de forma irregular, no un caso conveniente.

03

Coherencia entre grupos y contextos (invariancia y DIF)

Comparar lenguas, grupos o contextos exige casos equivalentes. Una señal DIF no prueba discriminación por sí sola.

04

Sensibilidad al contexto

El contexto relevante debe producir cambios explicables; cambios irrelevantes no deberían desplazar la decisión.

05

Memoria y adaptación

Probamos la continuidad, la corrección de errores y la influencia de las interacciones anteriores.

06

Referencia independiente

La teoría, los datos y los criterios de expertos o de una consulta Delphi orientan la interpretación sin ocultar desacuerdos.

Proceso

10 pasos controlados.

01

Evaluación inicial

Delimitamos un sistema ejecutable, una decisión concreta y el menor alcance útil para la prueba.

02

Conversación breve

Confirmamos la finalidad, el calendario, las personas responsables, los casos y el procedimiento de prueba.

03

NDA, DPA y acuerdo de trabajo

Alcance, precio, IVA, acceso, roles de datos y calendario quedan por escrito.

04

Protocolo

Registramos versión, entorno, constructo, poblaciones, criterios y conclusiones que no podrán extraerse.

05

Casos y referencias

Relacionamos casos habituales, casos límite y casos especialmente difíciles con criterios de evaluación.

06

Línea base

Versionamos el ejecutor de pruebas, la configuración y los registros; después repetimos las pruebas en las mismas condiciones.

07

Prueba de resistencia

Variamos herramientas, idioma, públicos, recursos, secuencia, memoria y respuestas del sistema.

08

Hallazgos

Cada hallazgo incluye condición, reproducción, gravedad, incertidumbre y acción.

09

Corrección y nueva ejecución

Cuando se incluye, aplicamos cambios acotados y repetimos todo el protocolo.

10

Entrega

Revisamos pruebas, informe, límites y recomendación de decisión.

Simulación basada en agentes (ABM)

Agente · interacción · entorno · tiempo

Evaluamos el sistema completo: el modelo dentro de una tarea, un entorno, una secuencia de interacciones y unos límites de decisión definidos.

ContextoPoblación · entorno · tareaAgenteModelo · reglas · memoriaInteracciónRespuesta del entorno · conflictoAdaptaciónAprendizaje · trayectoriaEvaluaciónTeoría · especialistas · métricas

Lo que la evidencia puede respaldar

  • Lo observado en una versión y entorno definidos
  • Fallos reproducibles
  • Diferencias entre condiciones acordadas
  • Qué criterios de prueba se alcanzaron
  • Incertidumbre que afecta la decisión

Qué no demuestran estas pruebas por sí solas

  • Equivalencia entre perfiles sintéticos y reales
  • Diagnóstico psicológico o educativo
  • Predicción exhaustiva del comportamiento humano
  • Certificación o conformidad legal
  • Ausencia de todo fallo futuro

Convierta una capacidad declarada en un protocolo reproducible.

Solicitar prueba