
Sesgos y equidad: la misma escala no garantiza la misma oportunidad de demostrar
Un hallazgo incómodo de la evaluación es que una escala común no produce equidad cuando las personas carecen de oportunidades semejantes para generar y mostrar evidencia.
Según los estándares de evaluación, la uniformidad cumple una función necesaria: permite usar criterios comunes y reduce el espacio para negociar expectativas según la persona. Pero la equidad no empieza al puntuar. Mucho antes, el trabajo ya distribuyó proyectos, exposición, apoyos, riesgos y oportunidades de aprendizaje. Dos personas pueden llegar con capacidades semejantes y expedientes muy distintos. Leer esa diferencia como diferencia automática de competencia confunde la evidencia disponible con aquello que se intenta conocer.
La escala ordena lo observado
Una escala describe cómo interpretar una muestra: qué caracteriza un desempeño inicial, consistente o avanzado. No crea las situaciones que permiten producir esa muestra. Tampoco garantiza que el observador haya estado presente cuando la contribución ocurrió.
Por eso conviene separar tres preguntas. ¿El criterio representa la capacidad que importa? ¿La evidencia permite juzgar ese criterio? ¿La persona tuvo una oportunidad razonable de generar o presentar esa evidencia? Una respuesta positiva a la primera no resuelve las otras dos.
Los Standards for Educational and Psychological Testing tratan la validez como la calidad de la interpretación y del uso de resultados. También incluyen la equidad dentro de las responsabilidades de diseño y aplicación. No constituyen una receta para evaluar skills corporativas; sí ayudan a recordar que un puntaje no puede separarse de las condiciones bajo las que se obtuvo. La validez depende de la interpretación y del uso que sostendrá la decisión, no solo de que la escala se haya aplicado de forma uniforme. AERA, APA y NCME (se abre en una nueva pestaña).
Oportunidad no equivale a facilidad
Equidad no exige eliminar la dificultad relevante. Si una skill requiere tomar decisiones con información incompleta, la evaluación necesita alguna evidencia de ese razonamiento. Lo que debe revisarse es si la barrera pertenece al constructo o llegó desde otro lugar.
Acceso a datos, patrocinio, idioma, tecnología asistiva, horario, familiaridad con un formato o visibilidad ante el evaluador pueden afectar la demostración sin formar parte de la capacidad. La pregunta no es si todos vivieron exactamente la misma experiencia, sino si las diferencias alteran aquello que creemos estar comparando.
Una adaptación responsable conserva el núcleo de la exigencia y cambia el canal que introduce ruido. Si lo evaluado es el juicio, puede ser válido presentar una solución de más de una forma. No lo sería si la comunicación específica es parte esencial del trabajo.
La trayectoria de asignaciones también produce sesgo
Algunas personas reciben proyectos que generan pruebas fácilmente reconocibles: lideran lanzamientos, exponen ante comités o resuelven incidentes visibles. Otras sostienen trabajo preventivo, relacional o distribuido cuyo valor aparece precisamente porque un problema no ocurrió.
Si la organización usa solo la evidencia más visible, recompensa además el acceso previo a escenarios de exposición. Antes de concluir que falta capacidad, conviene revisar qué encargos fueron ofrecidos, quién pudo asumirlos y qué contribuciones quedaron fuera de los canales habituales.
Compare patrones, no solo casos individuales
Una decisión aislada puede parecer razonable y aun formar parte de un patrón desigual. Revise distribución de oportunidades, resultados, apelaciones y cambios posteriores por grupos relevantes y contextos de trabajo. Las diferencias no prueban por sí mismas discriminación ni explican su causa, pero señalan dónde investigar.
La EEOC advierte que los procedimientos de selección pueden producir efectos adversos y que deben relacionarse con el puesto y con la necesidad del negocio. Esa guía pertenece al marco estadounidense y no sustituye asesoría jurídica local; ofrece, sin embargo, una disciplina útil para no tratar una prueba uniforme como garantía automática de justicia. EEOC (se abre en una nueva pestaña).

El análisis necesita llegar hasta la fuente. ¿La diferencia aparece al asignar proyectos, registrar evidencia, interpretar el criterio o convertir el resultado en una decisión? Agregar todos esos momentos en un único promedio impide corregir el mecanismo adecuado.
Diseñe una segunda mirada antes de decidir
Para decisiones de alta consecuencia, incorpore una revisión que no repita mecánicamente la primera lectura. Puede contrastar evidencia alternativa, comprobar la pertinencia del criterio y revisar si existió una barrera ajena a la capacidad. La persona revisora necesita autoridad para pedir más información, corregir una interpretación o suspender la decisión.
Registre además qué habría contado como evidencia suficiente. Sin ese umbral, la revisión puede convertirse en una negociación retrospectiva. La trazabilidad protege tanto a la persona como a la arquitectura: permite aprender si una definición, un canal o una oportunidad produce distorsiones repetidas.
La misma escala sigue siendo valiosa. Hace visible el estándar común y obliga a justificar diferencias. Su límite aparece cuando la organización supone que aplicar una regla idéntica corrige una historia de oportunidades distintas. Una evaluación equitativa no rebaja lo que importa; mejora las condiciones para observarlo y evita afirmar más de lo que la evidencia permite.





