Pequeños recipientes, instrumentos y muestras conectados por cables azules sobre fondo blanco.

Qué medir en un piloto de skills para saber si funciona

Un piloto de skills no necesita demostrar de inmediato el impacto final de toda la iniciativa. Necesita producir evidencia suficiente para decidir si el recorrido se comprende, puede ejecutarse, genera información consistente y mejora decisiones reales antes de escalar.

PRYSMAP5 min de lectura

Medir solo cuántas personas completaron la evaluación confunde alcance con éxito. Medir únicamente satisfacción puede ocultar resultados incomprensibles. Y exigir retorno financiero en una prueba breve puede empujar al equipo a inventar atribuciones. La medición debe corresponder con las incertidumbres de la etapa.

Seis dimensiones para aprender antes de escalar

Dimensión Qué observar Evidencia útil Cómo evitar una lectura engañosa
Participación Quién inició, completó o abandonó y en qué tramo Tasas por rol o grupo elegible, motivos de abandono y cobertura de fuentes No usar el total bruto sin denominador ni tratar participación obligatoria como aceptación.
Consistencia Si reglas y anclas producen interpretaciones razonablemente estables Distribución de respuestas, desacuerdos por elemento, calibraciones y revisión de casos No exigir acuerdo total ni promediar diferencias que provienen de acceso legítimamente distinto.
Utilidad Si la salida ayuda a comprender una situación o actuar Decisiones apoyadas, preguntas resueltas, ajustes solicitados y usos rechazados No equiparar agrado con utilidad ni aceptar declaraciones generales sin una decisión identificable.
Tiempo y esfuerzo Cuánto cuesta completar, revisar, explicar y mantener el proceso Mediana y dispersión de tiempos, retrabajo, soporte requerido y carga por rol No mirar solo el tiempo del participante; incluir líderes, expertos y administración.
Comprensión Si las personas interpretan conceptos, niveles y límites como fueron diseñados Preguntas de comprobación, errores recurrentes, capacidad de explicar el resultado y solicitudes de aclaración No asumir comprensión porque el formulario fue completado.
Decisiones generadas Qué cambió después de disponer de la evidencia Priorizaciones, experiencias acordadas, observación adicional, movilidad explorada o decisión de no actuar No contar cualquier acción; registrar su relación con el resultado y su propósito.

Las seis dimensiones no forman un score único. Un piloto puede tener alta participación y baja comprensión, o resultados útiles con un costo operativo todavía inviable. La decisión de escalar necesita conservar esas diferencias.

Define la pregunta y la referencia antes de medir

Cada indicador debería vincularse con una incertidumbre. Si preocupa la carga, hay que distinguir tiempo de respuesta, preparación del líder y trabajo de soporte. Si preocupa la consistencia, se necesita saber qué desacuerdo sería material y cuál podría reflejar perspectivas válidas. Si preocupa la utilidad, hay que nombrar de antemano las decisiones que el piloto pretende apoyar.

También hace falta una referencia. Puede ser el proceso anterior, un objetivo operativo acordado o un criterio mínimo definido antes de ver los resultados. No existe un porcentaje universal que declare exitoso un piloto de skills. El umbral depende del uso, la criticidad y el costo de equivocarse.

Métricas y evidencia cualitativa cumplen funciones distintas

Los conteos ayudan a localizar patrones: dónde se abandona, qué elementos concentran desacuerdo o cuánto varía el tiempo. Las entrevistas breves, observaciones y revisiones de casos explican por qué ocurre. Una tasa de finalización baja podría deberse a carga, instrucciones, acceso, temor a consecuencias o falta de relevancia. El dato indica dónde mirar; rara vez decide la causa.

La taxonomía de resultados de implementación de Proctor y colegas distingue aceptabilidad, adopción, pertinencia, viabilidad, fidelidad, costo, penetración y sostenibilidad (Proctor et al., 2011 (se abre en una nueva pestaña)). Fue desarrollada en servicios de salud, por lo que no valida estas seis dimensiones para talento. Su aporte transferible es conceptual: los resultados de implementación son distintos de los resultados finales de la intervención y algunos aparecen antes que otros.

Esta diferencia protege el alcance del piloto. Participación, comprensión y esfuerzo pueden evaluarse pronto. La sostenibilidad de un cambio de desarrollo o el efecto sobre movilidad requieren más tiempo, otras fuentes y un diseño de evaluación distinto.

Maqueta de puente de madera bajo una prensa que aplica pesos sobre la estructura.

Registra decisiones, incluidas las negativas

La evidencia más valiosa puede ser una decisión de no escalar todavía. Si los líderes interpretan de manera incompatible una skill crítica, ampliar la población multiplicaría el problema. Si la salida no cambia ninguna conversación, quizá el uso previsto no está claro. Si el proceso es útil pero demasiado costoso, el siguiente experimento debería simplificarlo.

Conviene mantener un registro mínimo por decisión:

  1. qué pregunta o necesidad existía;
  2. qué evidencia aportó el piloto;
  3. qué decisión se tomó;
  4. qué otra información influyó;
  5. qué resultado se observará después.

Este registro evita atribuir al piloto cambios que dependieron de otros factores. También muestra si los resultados se utilizan dentro de los límites definidos o empiezan a apoyar promociones, compensaciones o clasificaciones para las que no fueron diseñados.

El criterio de salida

Proceso Participación, comprensión y esfuerzo.

Calidad Consistencia, evidencia y límites de interpretación.

Antes de comenzar, el equipo debería acordar qué decisiones podrán tomarse al final: escalar el mismo recorrido, ajustar y repetir, reducir alcance, cambiar el instrumento o detener la iniciativa. Cada opción necesita evidencia diferente.

Los marcos skills-first ofrecen una dirección amplia, pero la OECD advierte que su implementación exige recursos, capacidades de RR. HH., evaluaciones sólidas y seguimiento, y que puede introducir riesgos si se ejecuta mal (OECD, 2025 (se abre en una nueva pestaña)). El piloto es el lugar para hacer visibles esas dependencias a una escala que todavía permita corregir.

Saber si funciona no equivale a obtener todos los indicadores en verde. Equivale a poder explicar qué aprendió la organización, qué límites permanecen y por qué la siguiente decisión está mejor fundamentada que antes de la prueba.