Dos medidores analógicos están conectados a un mecanismo azul central y a una caja de control común.

Cómo diseñar una sesión de calibración que no termine negociando scores

¿Cómo evitar que una calibración termine negociando scores? Haga que la evidencia, el contexto y los criterios entren en la conversación antes que la cifra.

PRYSMAP5 min de lectura

Pensemos en una líder que defiende un cuatro mientras otra considera que el caso merece un tres. La conversación avanza durante veinte minutos y termina en 3,5. Nadie podría explicar qué evidencia cambió ni qué significa la cifra intermedia.

La sesión produjo acuerdo numérico, pero no calibración.

Calibrar debería aumentar la consistencia con que se interpretan criterios frente a situaciones comparables. No exige que todas las personas emitan el mismo juicio ni elimina la incertidumbre. Exige que las diferencias puedan examinarse y que la conclusión conserve una base reconstruible.

Prepare casos, no posiciones

Antes de la reunión, seleccione decisiones que realmente necesiten revisión: casos con consecuencias relevantes, discrepancias amplias o evidencia difícil de interpretar. No lleve cada evaluación al foro común.

Para cada caso prepare una ficha breve con el contexto, la expectativa aplicable, las observaciones disponibles y las fuentes. Separe hechos, interpretación y conclusión provisional.

No incluya información personal que no sea necesaria para el propósito. La calibración no mejora por acumular detalles, y el exceso aumenta riesgos de sesgo y confidencialidad.

La OPM describe la gestión del desempeño como un ciclo que incluye planificación, seguimiento, desarrollo, evaluación y reconocimiento; también insiste en que el proceso es más amplio que asignar ratings. El marco pertenece al empleo federal estadounidense, pero refuerza una precaución general: una cifra final depende de expectativas y observaciones anteriores. U.S. Office of Personnel Management, Performance Management Cycle (se abre en una nueva pestaña).

Abra con la evidencia y la regla

Quien presenta el caso debería responder en este orden:

  1. ¿Qué se esperaba en esa situación?
  2. ¿Qué ocurrió y cómo lo sabemos?
  3. ¿Qué parte de la expectativa está respaldada?
  4. ¿Qué información falta?
  5. ¿Qué decisión utilizará la conclusión?

El score aparece después. Este orden impide que la discusión se convierta desde el inicio en una defensa de la evaluación previa.

La persona facilitadora debe pedir lenguaje observable. “Tiene gran liderazgo” es una valoración. “En una interrupción coordinó tres funciones, explicitó el criterio de prioridad y revisó la decisión con nueva evidencia” ofrece elementos que pueden contrastarse.

Dos balanzas de latón comparan piedras y pesas sobre una mesa cubierta con tela azul.

Clasifique el desacuerdo antes de resolverlo

No todas las discrepancias significan que alguien aplicó mal la escala. Pueden tener al menos cuatro orígenes.

Hay desacuerdo sobre los hechos cuando las personas conocen episodios distintos. La respuesta es reunir o delimitar evidencia, no promediar recuerdos.

Hay desacuerdo sobre el criterio cuando una definición admite lecturas incompatibles. El caso puede revelar una regla que la arquitectura debe aclarar.

Hay desacuerdo sobre el contexto cuando una misma acción tuvo diferente complejidad, autonomía o riesgo. La conversación debe reconstruir esas condiciones.

Hay desacuerdo sobre suficiencia cuando todos aceptan lo observado, pero difieren sobre cuánto permite concluir. Aquí conviene preservar límites y decidir qué evidencia adicional sería razonable obtener.

Etiquetar el tipo de discrepancia reduce discusiones circulares. También produce insumos para mejorar definiciones y guías.

Proteja los estados que no son scores

Si una persona no tuvo ocasión razonable de actuar en una situación, la sesión no puede inventar desempeño. Si la skill no corresponde al propósito del rol, el problema puede estar en la arquitectura. Si existen señales contradictorias, la conclusión puede permanecer abierta.

La incertidumbre bien registrada es más útil que una precisión ficticia. Permite decidir si hace falta observar, ajustar el instrumento o limitar el uso del resultado.

Cierre con una conclusión reconstruible

El acta no necesita transcribir toda la conversación. Debe conservar la expectativa aplicada, la evidencia decisiva, las objeciones relevantes, el estado final y el uso autorizado.

Si cambió un score, registre qué interpretación o evidencia justificó el cambio. Si no hubo conclusión, indique qué falta y quién decidirá si vale la pena obtenerlo.

La hoja de ruta de la OPM para supervisores sitúa la evaluación dentro de un proceso continuo de gestión del desempeño. Aunque no prescribe esta sesión, ayuda a recordar que calibrar no debería ser un evento aislado que repare al final expectativas nunca acordadas. U.S. Office of Personnel Management, Performance Management Roadmap for Supervisors (se abre en una nueva pestaña).

Revise el sistema después de revisar personas

Si muchos casos generan la misma duda, no concluya que todos los líderes necesitan más entrenamiento. Quizás la escala mezcla autonomía con complejidad, los ejemplos representan un solo contexto o la arquitectura ubica una expectativa en el rol equivocado.

Registre patrones sin utilizar la calibración como mecanismo disciplinario. El objetivo sistémico es aprender dónde la evaluación pierde claridad.

Esta guía continúa Qué significa que una evaluación sea válida para una decisión concreta y No observado, no aplica y evidencia insuficiente no significan lo mismo. La calidad de la sesión depende de conservar esas distinciones cuando existe presión por cerrar una cifra.

Una buena calibración puede terminar con scores distintos, un caso abierto o una regla por corregir. Su éxito no está en reducir toda diferencia, sino en dejar decisiones más explicables que las que entraron a la sala.

Para ampliar esta lectura, puede consultarse Autoevaluación, líder o pares — qué aporta cada fuente, que desarrolla una dimensión complementaria del problema.