top of page

Managers demasiado duros o demasiado blandos al evaluar: cómo corregir el sesgo de severidad e indulgencia

Foto del escritor: TRAKER
TRAKER
21 ago
7 min de lectura

Actualizado: hace 4 días

Dos managers pueden evaluar el mismo desempeño y llegar a notas opuestas: uno endurece la vara y otro evita cualquier calificación baja. Una gestión efectiva del desempeño ayuda a detectar estos patrones, contrastar evidencia y corregir diferencias sin borrar el contexto ni imponer una distribución.



En este artículo:



Qué es el sesgo de severidad e indulgencia

Qué es el sesgo de severidad e indulgencia

El sesgo de severidad aparece cuando una persona evaluadora califica de forma sistemáticamente más baja que otras ante evidencia similar. El sesgo de indulgencia —también llamado *leniency bias*— es el patrón inverso: notas sistemáticamente más altas. No se trata de una diferencia aislada ni de exigir alto desempeño; se trata de un patrón que persiste al comparar varios casos y períodos.


Conviene diferenciarlo de una escala de evaluación de desempeño mal diseñada. Una escala poco clara puede aumentar la variación, pero el sesgo está en la tendencia estable del evaluador a usar un extremo. La pregunta útil no es “¿este manager puso una nota baja?”, sino “¿usa el mismo estándar que el resto cuando la evidencia es equivalente?”.

Patrón

Qué suele verse

Riesgo para el equipo

Respuesta útil

Severidad

Muchas notas bajo el promedio, aun con resultados sólidos

Desmotivación, menor movilidad y mensajes injustos

Revisar evidencia, definiciones y comparables

Indulgencia

Concentración de notas altas y pocas brechas

Se ocultan necesidades de apoyo y se inflan decisiones

Pedir ejemplos concretos y distinguir impacto de esfuerzo

Diferencia legítima

Resultados y contexto realmente distintos

Ninguno si se explica y documenta

Conservar el contexto y hacerlo visible

Para ubicar este tema dentro del proceso completo, revisa la guía de calibración de evaluaciones, que define el marco general, las decisiones y los límites de esta práctica.


Cómo reconocer managers demasiado duros o blandos

Cómo reconocer managers demasiado duros o blandos

La señal más clara no es una conversación anecdótica. Es una distribución que se repite: un manager concentra casi todas sus evaluaciones en 2 y 3, mientras otro concentra casos comparables en 4 y 5. Antes de concluir que existe un sesgo, compara funciones, antigüedad, tamaño de equipo, ciclos y resultados. Un equipo nuevo o que atraviesa una transformación puede tener una distribución distinta por razones válidas.


Revisa también el lenguaje. El manager severo puede describir logros como “lo mínimo esperable” sin explicar qué habría elevado la nota. El indulgente puede usar elogios generales —“muy comprometido”, “excelente actitud”— sin conectar esas frases con resultados, conductas o alcance. Los criterios de evaluación de desempeño ayudan a mover la conversación desde una impresión global hacia evidencia observable.


Estas preguntas permiten separar un patrón de una diferencia real:


Analizador de calibración del desempeño

  • ¿La desviación aparece en más de un ciclo y con varias personas?

  • ¿Los resultados, responsabilidades y condiciones de los equipos son comparables?

  • ¿Cada nota puede sostenerse con ejemplos fechados y expectativas conocidas?

  • ¿El evaluador usa todos los niveles de la escala cuando la evidencia lo justifica?


Por qué aparece este sesgo

Por qué aparece este sesgo

La severidad suele nacer de estándares implícitos. Un manager puede compararlo todo con su propia forma de trabajar, premiar sólo resultados excepcionales o creer que una nota alta reduce el incentivo por mejorar. La indulgencia, en cambio, suele aparecer cuando una nota baja se vive como un conflicto, cuando faltan conversaciones de feedback durante el ciclo o cuando el manager confunde cuidar a una persona con protegerla de una evaluación honesta.


También hay causas de sistema. Si la organización nunca define qué distingue “cumple” de “supera”, cada manager completa los vacíos con su historia, presión y estilo. Si las evaluaciones se usan sólo para decidir bonos, aumenta la tentación de defender a todo el equipo o de endurecer la vara para repartir un presupuesto limitado.


El objetivo no es que todas las áreas tengan la misma curva. Es que cualquier diferencia responda a desempeño y contexto, no al estilo personal de quien califica. Por eso una conversación sobre sesgo debe revisar tanto la conducta del evaluador como el diseño del proceso.


Qué datos revisar antes de intervenir

Qué datos revisar antes de intervenir

Empieza con una vista simple por manager y ciclo: número de evaluaciones, promedio, dispersión, porcentaje en cada nivel y cambios respecto del período anterior. Los KPI de desempeño laboral muestran cómo definir una medida de forma consistente; aquí la medida no decide por sí sola, sino que indica dónde vale la pena abrir una conversación.


No compares promedios sin contexto. Añade información que explique las diferencias legítimas: objetivos del período, nivel de los roles, resultados del equipo, cambios de alcance, licencias y situaciones extraordinarias. Después selecciona una muestra de evaluaciones de distintos niveles y revisa si la evidencia escrita sustenta la calificación.

Dato

Pregunta que responde

Precaución

Promedio por manager

¿Alguien se aleja de sus pares de manera persistente?

No usarlo para exigir el mismo promedio

Distribución de niveles

¿Se evita un extremo o se usa siempre?

Comparar equipos equivalentes

Comentarios y ejemplos

¿La nota se conecta con hechos?

Evaluar calidad, no longitud

Cambio entre ciclos

¿El patrón es estable o coincide con un contexto puntual?

Investigar antes de etiquetar


Cómo preparar una evaluación con evidencia

Cómo preparar una evaluación con evidencia

Una evaluación más justa se construye antes de la reunión de calibración. Pide a cada manager que reúna evidencia del período completo: objetivos acordados, entregables, resultados, feedback recibido, cambios de prioridad y ejemplos de conductas relevantes. Un registro de desempeño para evaluaciones más justas disminuye la dependencia de la memoria reciente y hace que las diferencias se puedan discutir sin convertirlas en opiniones personales.


La evidencia debe responder tres cosas: qué se esperaba, qué ocurrió y cuál fue el impacto. “Tuvo buena actitud” no permite calibrar. “Acordó el plan de recuperación con tres clientes críticos, redujo sus escalaciones y dejó el seguimiento documentado” sí permite analizar alcance, resultados y conducta.


Antes de asignar una nota, el manager puede hacer este control breve:

  1. Releer los objetivos y cambios de alcance del ciclo.

  2. Identificar dos o tres ejemplos que sostengan cada conclusión relevante.

  3. Distinguir resultado, forma de trabajo y circunstancias que facilitaron o limitaron el resultado.

  4. Anotar qué expectativa concreta habría marcado un nivel superior o inferior.


Cómo calibrar sin imponer una nota

Cómo calibrar sin imponer una nota

Una buena calibración no busca que todos “cedan” hasta que las notas parezcan cómodas. Busca comprobar que notas comparables significan lo mismo. La persona que facilita puede pedir primero que el manager explique la evidencia, luego que otros managers aporten casos comparables y finalmente que el grupo contraste la definición de la escala.


Volver a los objetivos de una evaluación de desempeño ayuda a evitar una discusión política. Si el propósito incluye dar feedback útil, reconocer el impacto y tomar decisiones consistentes, una nota no puede defenderse sólo porque “así evalúo yo” ni cambiarse sólo para suavizar una conversación.


Una agenda de calibración práctica puede seguir esta secuencia:

  • Alinear el significado de cada nivel antes de revisar personas.

  • Presentar evidencia y contexto, no adjetivos ni reputaciones.

  • Comparar casos similares sin convertirlos en un ranking público.

  • Registrar la razón de cualquier ajuste y el mensaje que recibirá la persona.

  • Detectar si el caso revela un patrón de manager, de escala o de proceso.


Qué ajustes reducen la variación entre evaluadores

Qué ajustes reducen la variación entre evaluadores

El ajuste más potente suele ser describir conductas y resultados observables para cada nivel. Una escala BARS con ejemplos de conductas hace explícito qué significa “supera lo esperado” en un rol y reduce la necesidad de interpretar frases vagas.


También ayudan los ejemplos ancla: dos o tres casos ficticios o históricos anonimizados que el grupo evalúa antes del ciclo. Si los managers califican esos casos de forma muy distinta, la conversación ocurre antes de impactar a personas reales. Complementa los anclajes con formación breve sobre feedback, campos obligatorios para evidencia y revisiones de distribución que inviten a investigar, no a forzar una curva.


No todos los equipos deben terminar con la misma distribución. Forzarla puede esconder alto desempeño genuino o convertir la calibración en un reparto de cupos. La consistencia proviene de definiciones, evidencia y conversación entre pares, no de que un gráfico se vea simétrico.


Errores que empeoran el problema

Errores que empeoran el problema

Corregir sólo el promedio. Pedir a un manager “sube tus notas” o “baja tus notas” sin revisar casos transforma la calibración en maquillaje. La pregunta debe ser qué evidencia explica cada diferencia.


Calibrar al final y en una sola reunión. Cuando nunca hubo seguimiento, toda la tensión cae sobre el cierre. Es preferible revisar expectativas, evidencia y riesgos durante el período.


Confundir exigencia con severidad. Un manager puede tener estándares altos y ser justo si las expectativas son conocidas, la evidencia es consistente y reconoce cuando se exceden. El problema aparece cuando el estándar cambia según la persona o nadie puede alcanzarlo.


Evitar el feedback difícil. La indulgencia puede parecer amable, pero posterga información necesaria para crecer. Las metas que motivan, alinean y permiten seguimiento permiten sostener una conversación de apoyo antes de que una brecha termine escondida en una nota alta.


Analizador de calibración del desempeño

Preguntas frecuentes sobre severidad e indulgencia

Preguntas frecuentes sobre severidad e indulgencia

¿Un manager con notas bajas siempre tiene sesgo de severidad?

No. Puede dirigir un equipo en un momento exigente o tener evidencia de brechas reales. El sesgo se confirma al observar un patrón persistente, comparar casos equivalentes y revisar si las notas están bien sustentadas.


¿Debemos obligar a todos los managers a usar la misma distribución?

No. Una distribución forzada puede ocultar diferencias reales. Es mejor acordar criterios, usar ejemplos ancla y revisar las excepciones con evidencia.


¿Quién debe participar en una calibración?

Habitualmente participan managers de áreas comparables, una persona facilitadora de RR. HH. y, cuando aporta contexto, el líder del área. Deben conocer los criterios y respetar la confidencialidad de los casos.


¿Cada cuánto conviene revisar estos sesgos?

En cada ciclo formal y en los check-ins relevantes. Revisar temprano permite mejorar criterios y feedback antes de que una decisión de promoción o compensación dependa de una nota difícil de defender.


Una evaluación comparable y humana

Una evaluación comparable y humana

El sesgo de severidad e indulgencia no se corrige pidiendo a todos que evalúen igual. Se corrige haciendo que cada nota pueda explicarse con expectativas conocidas, evidencia del período y comparables relevantes. Así se mantiene la exigencia sin castigar a quien reporta a un manager duro, y se mantiene el cuidado sin ocultar una brecha que necesita apoyo.


Empieza con una revisión de distribución, selecciona algunos casos comparables y pregúntate qué significa cada nivel en la práctica. Cuando el proceso enseña a los managers a argumentar mejor sus evaluaciones, la calibración deja de ser un ajuste de números y se convierte en una conversación de calidad.


Cuando la organización necesita ejecutar este proceso de forma consistente, la calibración automática del desempeño permite centralizar configuración, seguimiento y evidencia sin depender de planillas.

Comentarios


logo spotify
logo linkedin

651 North Broad Street, Middletown, Delaware, USA.

Código Postal  19709

+1 385-715-9671

Eliodoro Yañez 2972 of 806, Providencia, Santiago. Chile

Codigo Postal 7510277

Copyright © Traker 2026. Todos los derechos reservados.

bottom of page