
Knowing What Students Know y la evaluación de capacidades
Knowing What Students Know fue escrito para la evaluación educativa, pero su pregunta central atraviesa cualquier sistema que intente valorar capacidades: ¿cómo pasar de lo que una persona hace en una situación concreta a una inferencia defendible sobre lo que sabe y puede hacer?
Publicado en 2001 por el National Research Council, el libro reúne aportes de ciencias cognitivas y medición educativa para replantear el diseño de evaluaciones. No es una guía ligera ni un manual de recursos humanos. Su valor está en obligar al lector a mirar la cadena de razonamiento que suele quedar escondida detrás de una pregunta, una rúbrica o un score.
La idea más conocida es el triángulo de evaluación: cognición, observación e interpretación. Las tres partes deben diseñarse como un conjunto coordinado. Si una falla, el resultado puede ser consistente y seguir diciendo muy poco sobre la capacidad que interesa.
Cognición: qué significa progresar en un dominio
El primer vértice exige un modelo de cómo se organiza y desarrolla la competencia. En educación, esto implica comprender qué conocimientos, estrategias y formas de razonamiento importan en un dominio. Trasladado al trabajo, obliga a superar descripciones como tiene pensamiento estratégico o demuestra liderazgo.
Una arquitectura de capacidades necesita explicar qué cambia entre niveles. Puede cambiar la complejidad de los problemas, la autonomía, el alcance de las decisiones, la calidad del criterio o la habilidad para transferir lo aprendido a situaciones nuevas. Sin ese modelo, la evaluación solo recopila impresiones alrededor de una etiqueta.
Este punto es especialmente valioso porque sitúa el diseño antes del instrumento. No se comienza preguntando qué ítems incluir, sino qué interpretación de la capacidad se quiere sostener.
Observación: qué tareas pueden revelar esa capacidad
El segundo vértice se ocupa de las situaciones que permiten observar manifestaciones relevantes. Una capacidad no se ve directamente. Se observan decisiones, procedimientos, explicaciones, resultados, interacciones y productos de trabajo.
El libro insiste en que las tareas deben provocar evidencia conectada con el modelo de cognición. Una pregunta de autopercepción puede informar cómo se ve la persona; una entrevista puede revelar razonamiento; una simulación puede mostrar aplicación bajo condiciones preparadas; el trabajo real aporta autenticidad contextual. Ninguna fuente responde automáticamente todas las preguntas.
Esta mirada evita dos atajos frecuentes. El primero es evaluar aquello que resulta fácil preguntar, aunque represente mal la capacidad. El segundo es asumir que una tarea compleja es válida por parecer realista. Una situación puede contener tantos factores irrelevantes que resulte imposible saber qué produjo el desempeño.
Interpretación: cómo la evidencia se convierte en conclusión
El tercer vértice conecta observaciones con inferencias. Incluye reglas, modelos, rúbricas y criterios para decidir qué significa la evidencia.
En una evaluación de skills, interpretar no es sumar señales y asignar una etiqueta. Hay que justificar por qué ciertas manifestaciones sostienen una expectativa, cómo se trata la variación entre contextos, qué hacer con evidencia contradictoria y cuándo la muestra todavía es insuficiente.

La interpretación también debe guardar relación con el uso previsto. Evidencia suficiente para orientar una práctica quizá no lo sea para decidir una promoción. El score no posee validez por sí mismo; la solidez pertenece a la conclusión y a la decisión que se toma con ella.
La fuerza del libro está en las conexiones
La principal aportación de Knowing What Students Know no es ofrecer tres casillas para completar. Es mostrar que cada vértice restringe a los otros.
Si el modelo de capacidad cambia, también deben cambiar las tareas y las reglas. Si una fuente solo observa parte del desempeño, la interpretación debe limitarse. Si la decisión exige mayor certeza, quizá se necesiten observaciones adicionales o condiciones más representativas.
Esta coordinación mejora la trazabilidad. Permite reconstruir el recorrido desde una conclusión hasta la evidencia, y desde la evidencia hasta la definición de la capacidad. También vuelve visibles los puntos donde entra el juicio profesional.
Para una organización, esa transparencia es más útil que la promesa de objetividad total. El juicio no desaparece; se ubica dentro de reglas que pueden examinarse, contrastarse y mejorar.
Lo que no conviene trasladar sin adaptación
Capacidad Qué se espera poder hacer.
Situación Qué tarea permitiría observarlo.
Juicio Qué criterio conecta evidencia y conclusión.
El libro trabaja principalmente con aprendizaje y evaluación educativa. Las organizaciones tienen condiciones diferentes: experiencia previa heterogénea, tareas menos estandarizadas, consecuencias laborales, acceso desigual a oportunidades y capacidades que dependen fuertemente del contexto.
Una evaluación empresarial no debería copiar tareas escolares ni asumir una progresión única. Tampoco puede ignorar el poder involucrado cuando un resultado afecta compensación, movilidad o permanencia. La gobernanza, la privacidad, la posibilidad de contradicción y la proporcionalidad de las consecuencias requieren un tratamiento adicional.
Además, el triángulo no resuelve por sí solo la calidad de cada componente. Una definición pobre puede quedar perfectamente conectada con una tarea y una rúbrica igualmente pobres. La coherencia es necesaria, pero necesita evidencia de validez, confiabilidad cuando corresponda, equidad y revisión continua.
Por qué sigue siendo una lectura útil
Más de dos décadas después, el libro conserva una virtud incómoda: impide tratar la evaluación como un formulario. Lleva la conversación hacia el modelo de capacidad, la situación que permite observarla y el razonamiento que justifica una conclusión.
Para equipos que diseñan arquitecturas de skills, resulta especialmente útil como disciplina de preguntas:
- ¿qué creemos que significa desarrollar esta capacidad?;
- ¿qué desempeño permitiría verla sin confundirla con otro factor?;
- ¿qué conclusión puede sostener esa evidencia y para qué uso?;
Una evaluación defendible comienza cuando esas respuestas permanecen conectadas. El instrumento viene después.





