top of page

Criterios de evaluación de desempeño: qué medir y definir

Foto del escritor: TRAKER
TRAKER
20 ago
11 min de lectura

Actualizado: hace 4 días

Dos personas pueden recibir la misma nota y haber aportado cosas muy distintas. El problema no es la escala: son los criterios. Esta guía te ayuda a definir qué medir, con evidencia y sin convertir la evaluación en una discusión de opiniones.



En este artículo:



Qué son los criterios de evaluación de desempeño


Criterios claros: qué medir, evidencia y nivel esperado

Los criterios de evaluación de desempeño son las reglas que indican qué se observará, cómo se reconocerá un buen resultado y con qué evidencia se asignará una calificación.


No son una lista de cualidades deseables. Son acuerdos visibles antes de empezar el ciclo. Le dicen a cada persona qué se espera de su trabajo y le dan a la jefatura una base para conversar sin recurrir a frases vagas como “le falta compromiso” o “tiene buena actitud”.


Un criterio útil responde cuatro preguntas:


→ ¿Qué resultado, conducta o aporte importa en este cargo?

→ ¿Qué evidencia permite observarlo?

→ ¿Qué diferencia un desempeño esperado de uno sobresaliente o insuficiente?

→ ¿Quién tiene información suficiente para evaluarlo?


Por ejemplo, “mejorar la experiencia del cliente” todavía es una intención. En cambio, “resuelve el 85% de los casos en el plazo comprometido, documenta los aprendizajes y comunica riesgos antes de incumplir” ya permite observar, conversar y mejorar.


Gallup advierte que las expectativas claras requieren acordar responsabilidades, definir qué significa un desempeño sobresaliente, aceptable e insuficiente, y explicar cómo se medirá. Cuando ese acuerdo no existe, la persona no tiene un mapa confiable para priorizar.


Por qué los criterios claros cambian la evaluación


La evidencia convierte opiniones en una evaluación justa

Una evaluación de desempeño bien diseñada no gana credibilidad por tener más preguntas. La gana cuando quienes participan entienden qué significa cada nota y pueden sostenerla con hechos.


Los criterios bien definidos ayudan a:


→ Alinear el trabajo individual con las prioridades reales del equipo y del negocio.

→ Dar feedback específico sobre acciones que una persona puede repetir, ajustar o aprender.

→ Separar un resultado puntual de la forma en que se obtuvo.

→ Detectar si una brecha es de habilidad, recursos, claridad, proceso o acompañamiento.

→ Reducir diferencias arbitrarias entre jefaturas.

→ Construir planes de desarrollo que partan de evidencia y no de etiquetas.


El CIPD recuerda que las medidas de desempeño deben ser necesarias, relevantes y coherentes con la estrategia. También señala algo importante: los indicadores objetivos y las apreciaciones de jefatura no son equivalentes. Combinarlos con intención suele dar una imagen más completa que depender solo de uno.


Qué medir en una evaluación de desempeño


Las cuatro dimensiones de un desempeño completo

No hay una lista universal que sirva para todos los cargos. Un ejecutivo comercial, una analista de datos y una jefatura de operaciones pueden compartir algunos criterios, pero no deberían ser evaluados como si hicieran el mismo trabajo.


La solución práctica es usar una matriz que combine cuatro dimensiones. Así evitas premiar solo el número final o, en el extremo contrario, evaluar solo impresiones.


Dimensión: Resultados · Qué mide: Qué logró la persona o el equipo. · Ejemplo de evidencia: Cumplimiento de metas, calidad, plazo, ahorro o satisfacción de clientes.


Dimensión: Competencias · Qué mide: Cómo realizó el trabajo. · Ejemplo de evidencia: Conductas observables de colaboración, análisis, liderazgo o comunicación.


Dimensión: Impacto colectivo · Qué mide: Cómo contribuyó a que otros lograran resultados. · Ejemplo de evidencia: Transferencia de conocimiento, coordinación entre áreas, apoyo a pares o mejora del proceso.


Dimensión: Desarrollo y adaptación · Qué mide: Cómo aprende y responde a cambios relevantes. · Ejemplo de evidencia: Uso de feedback, nuevas habilidades aplicadas, ajustes ante un problema o aprendizaje documentado.


La proporción cambia según el cargo. En una función de producción, calidad, seguridad y cumplimiento pueden tener un peso alto. En una jefatura, sumar liderazgo, desarrollo del equipo y colaboración transversal es esencial. Para un rol que resuelve problemas nuevos, conviene mirar más el aprendizaje y el criterio que un único KPI rígido.


Los siete criterios más usados, con ejemplos


Siete criterios de evaluación de desempeño

Estos siete criterios son un punto de partida. Adáptalos al contexto: no todos deben entrar en todos los formularios.


1. Cumplimiento de objetivos

Mide el avance en compromisos acordados, no solo actividad.


Banco de competencias por nivel jerárquico

→ Entrega los resultados prioritarios en la fecha comprometida o renegocia con anticipación.

→ Usa indicadores definidos para revisar el avance y tomar decisiones.

→ Identifica desvíos y propone una acción concreta antes de que el objetivo se pierda.


Evita: evaluar por cantidad de tareas cerradas cuando esas tareas no prueban impacto.


2. Calidad del trabajo

Mide si el resultado cumple el estándar técnico, operativo o de servicio esperado.


→ Entrega trabajo preciso, completo y revisado antes de enviarlo.

→ Reduce errores repetitivos y documenta controles para prevenirlos.

→ Cumple los estándares definidos para clientes, procesos o seguridad.


Evita: dejar “calidad” sin un estándar o ejemplo observable.


3. Orientación al cliente

Mide cómo entiende y resuelve necesidades de clientes internos o externos.


→ Hace preguntas antes de asumir cuál es el problema.

→ Comunica alternativas, plazos y riesgos con claridad.

→ Usa comentarios de clientes para mejorar el servicio o el proceso.


Evita: confundir amabilidad con resolver una necesidad de forma sostenible.


4. Colaboración

Mide la contribución a resultados que nadie puede lograr en solitario.


→ Comparte información relevante sin esperar a que se la pidan.

→ Coordina dependencias y cierra acuerdos con otras áreas.

→ Da crédito al aporte de otros y pide apoyo a tiempo.


Evita: medir colaboración solo por popularidad o afinidad personal.


5. Comunicación y feedback

Mide si la persona hace visibles avances, decisiones y riesgos para que el equipo pueda actuar.


→ Adapta el mensaje al público y deja acuerdos claros después de una reunión.

→ Comunica errores o riesgos cuando todavía hay margen para corregirlos.

→ Da y recibe feedback usando situaciones concretas, no juicios sobre la personalidad.


Evita: valorar solamente a quien habla más; importa la claridad y el efecto de su comunicación.


6. Resolución de problemas y mejora continua

Mide cómo analiza una situación y transforma un obstáculo en una decisión útil.


→ Distingue síntomas de causas antes de elegir una solución.

→ Compara alternativas considerando impacto, datos y riesgos.

→ Prueba mejoras, revisa el resultado y comparte el aprendizaje.


Evita: premiar la urgencia constante si se originó por falta de planificación.


7. Desarrollo y adaptabilidad

Mide la capacidad de aprender, incorporar feedback y responder a un contexto cambiante.


→ Pide retroalimentación después de hitos relevantes y la convierte en una acción.

→ Aprende una herramienta o práctica nueva cuando el rol lo necesita.

→ Ajusta prioridades sin perder de vista el propósito del trabajo.


Evita: usar “adaptabilidad” como excusa para cambios desordenados o expectativas contradictorias.


Cómo convertir un criterio ambiguo en uno evaluable


Cómo pasar de un criterio ambiguo a uno evaluable

El salto de una frase bonita a un criterio útil se logra al agregar conducta, evidencia y nivel esperado.


Criterio ambiguo: Tiene liderazgo. · Criterio evaluable: Aclara prioridades, delega con contexto, da feedback específico y desarrolla a cada integrante del equipo.


Criterio ambiguo: Es proactivo. · Criterio evaluable: Identifica un riesgo relevante, propone alternativas y activa a las personas necesarias antes de que afecte el resultado.


Criterio ambiguo: Se comunica bien. · Criterio evaluable: Ajusta el mensaje al público, confirma acuerdos y comunica cambios que afectan plazos, calidad o decisiones.


Criterio ambiguo: Tiene compromiso. · Criterio evaluable: Cumple acuerdos críticos, hace visible el avance y renegocia alcance o fecha antes de incumplir.


Criterio ambiguo: Es colaborativo. · Criterio evaluable: Comparte información, coordina dependencias y contribuye a destrabar el trabajo de otras áreas.


Una buena prueba es esta: si dos evaluadores leen el criterio, ¿podrían reconocer las mismas conductas en la práctica? Si la respuesta es no, todavía falta precisión.


Define niveles de desempeño antes de evaluar


Niveles de desempeño antes de evaluar

Una escala sin descriptores hace que la nota dependa del estilo personal de quien evalúa. En cambio, los niveles anclados a conductas permiten que una conversación parta desde hechos comparables.


Puedes usar una escala simple de cuatro niveles:


Nivel: Requiere apoyo · Qué significa: Aún no alcanza el estándar y necesita acompañamiento. · Ejemplo en “gestión de prioridades”: Reacciona tarde a cambios y no hace visibles conflictos de plazo.


Nivel: Cumple parcialmente · Qué significa: Logra algunos aspectos, pero de manera inconsistente. · Ejemplo en “gestión de prioridades”: Ordena lo urgente, aunque a veces pierde de vista las prioridades de mayor impacto.


Nivel: Cumple lo esperado · Qué significa: Sostiene el estándar definido para el rol. · Ejemplo en “gestión de prioridades”: Prioriza, comunica dependencias y ajusta su plan con anticipación.


Nivel: Supera lo esperado · Qué significa: Aporta un nivel de impacto que eleva el estándar. · Ejemplo en “gestión de prioridades”: Anticipa cuellos de botella, mejora el sistema de priorización y ayuda al equipo a enfocarse.


No necesitas escribir un manual de diez páginas por competencia. Sí necesitas un ejemplo por nivel para los criterios que más influyen en decisiones de desempeño, desarrollo o promoción.


Cómo ponderar criterios sin volver el proceso imposible


Ejemplo de ponderación de criterios

Ponderar es decidir cuánto influye cada dimensión en el resultado final. El error común es repartir el mismo peso entre todo por parecer “equilibrado”. Eso puede ocultar lo que realmente importa.


Una pauta simple:


→ Da mayor peso a los resultados y conductas que explican el éxito del cargo.

→ Mantén entre cuatro y siete criterios centrales por rol; más que eso suele aumentar la fatiga y bajar la calidad de las respuestas.

→ No uses una fórmula compleja para dar apariencia de precisión. Si nadie puede explicarla, nadie confiará en ella.

→ Revisa si los pesos siguen siendo coherentes cuando cambia la estrategia o el alcance del cargo.


Un ejemplo para una jefatura de servicio podría ser 35% resultados y calidad, 25% experiencia del cliente, 20% liderazgo de personas, 10% colaboración transversal y 10% mejora continua. No es una receta universal: es una conversación de diseño que debe reflejar el trabajo real.


Quién debe evaluar cada criterio


Fuentes adecuadas para evaluar cada criterio

La jefatura no observa todo. Elegir bien las fuentes de evidencia evita pedir opiniones a personas que no han visto el comportamiento y, al mismo tiempo, reduce puntos ciegos.


Criterio: Objetivos y resultados · Fuente principal: Jefatura y datos operativos. · Fuentes complementarias: Autoevaluación.


Criterio: Calidad técnica · Fuente principal: Jefatura experta o revisión de calidad. · Fuentes complementarias: Pares especialistas.


Criterio: Colaboración · Fuente principal: Pares y áreas dependientes. · Fuentes complementarias: Jefatura.


Criterio: Liderazgo · Fuente principal: Colaboradores directos y jefatura. · Fuentes complementarias: Pares.


Criterio: Servicio interno o externo · Fuente principal: Cliente, usuario o indicador de servicio. · Fuentes complementarias: Jefatura.


No se trata de hacer una evaluación 360° por defecto. Se trata de pedir evidencia a quienes están en posición de verla. Para diseñar preguntas y conductas por cargo, consulta también la guía de evaluación por competencias: allí encontrarás una forma práctica de pasar de etiquetas a comportamientos observables.


Cómo evitar que los criterios se conviertan en sesgos


Evidencia, registro y calibración para reducir sesgos

Un criterio claro reduce la ambigüedad, pero no elimina por sí solo los sesgos. La memoria reciente, la afinidad o la tendencia a evaluar siempre alto o bajo pueden distorsionar incluso un buen formulario.


Protege el proceso con cinco prácticas:


→ Pide un ejemplo o dato antes de aceptar una calificación importante.

→ Entrena a las jefaturas con casos y escalas reales antes de lanzar el ciclo.

→ Registra evidencias durante el periodo, no solo al final.

→ Revisa diferencias llamativas entre equipos o evaluadores antes de comunicar resultados.

→ Separa el análisis de desempeño de conversaciones de compensación cuando el propósito de la reunión sea aprender y mejorar.


La guía de calibración del desempeño profundiza en este punto: calibrar no significa forzar a todos a una distribución, sino revisar si una misma nota mantiene el mismo significado entre áreas.


Plantilla: matriz de criterios de evaluación de desempeño


Matriz de criterios de evaluación de desempeño

Usa esta matriz como punto de partida para un cargo. Completa una fila por criterio y pruébala con líderes y personas que conozcan el trabajo real.


Criterio: Cumplimiento de objetivos · Por qué importa: Conecta el rol con la estrategia. · Conducta o resultado esperado: Logra los hitos prioritarios y anticipa desvíos. · Evidencia: KPI, hitos, entregables. · Peso: 30% · Evaluador: Jefatura.


Criterio: Calidad del trabajo · Por qué importa: Protege el estándar de servicio. · Conducta o resultado esperado: Entrega con precisión y aplica controles. · Evidencia: Errores, auditorías, retrabajo. · Peso: 20% · Evaluador: Jefatura / calidad.


Criterio: Colaboración · Por qué importa: Reduce fricción entre áreas. · Conducta o resultado esperado: Coordina dependencias y comparte información. · Evidencia: Casos, feedback de pares. · Peso: 15% · Evaluador: Pares y jefatura.


Criterio: Orientación al cliente · Por qué importa: Conecta el trabajo con la experiencia. · Conducta o resultado esperado: Resuelve necesidades y comunica a tiempo. · Evidencia: CSAT, casos, comentarios. · Peso: 15% · Evaluador: Cliente / jefatura.


Criterio: Mejora continua · Por qué importa: Aumenta la capacidad futura. · Conducta o resultado esperado: Propone, prueba y documenta mejoras. · Evidencia: Antes/después, aprendizaje. · Peso: 10% · Evaluador: Jefatura.


Criterio: Desarrollo · Por qué importa: Sostiene la evolución del rol. · Conducta o resultado esperado: Aplica feedback y adquiere habilidades críticas. · Evidencia: Plan de desarrollo, práctica. · Peso: 10% · Evaluador: Persona y jefatura.


Antes de implementarla, valida tres cosas: que cada criterio sea relevante para el cargo, que exista evidencia disponible y que los pesos sumen 100%.


Banco de competencias por nivel jerárquico

Errores frecuentes al definir criterios


Errores frecuentes y el criterio útil

Copiar el mismo formulario para todos los cargos

Las competencias transversales ayudan, pero no reemplazan los criterios técnicos y de impacto propios de cada familia de roles.


Medir lo que es fácil, no lo que importa

Contar correos enviados, horas conectadas o tareas marcadas como terminadas puede ser cómodo. No siempre explica el valor creado.


Confundir comportamiento con personalidad

“Es difícil” no es un criterio. “Interrumpe acuerdos sin comunicar el impacto” describe una conducta que se puede conversar y corregir.


Cambiar las reglas al final del ciclo

Si una prioridad cambia, actualiza el objetivo y deja registro. Usar una expectativa nueva para juzgar trabajo pasado destruye la percepción de justicia.


Cerrar con una nota y ninguna acción

La evaluación debe terminar con una conversación, una decisión y un próximo paso. De lo contrario, el criterio solo ordenó un formulario.


Preguntas frecuentes sobre criterios de evaluación de desempeño


Preguntas frecuentes sobre criterios de evaluación

¿Cuántos criterios debe tener una evaluación de desempeño?

Como regla práctica, entre cuatro y siete criterios centrales por rol suele ser suficiente. Prioriza los que explican el éxito del puesto y permiten tomar mejores decisiones. Agregar más ítems no garantiza una evaluación más justa.


¿Los criterios deben ser iguales para toda la empresa?

No por completo. Puedes mantener algunos criterios transversales, como colaboración o integridad, y sumar otros específicos por cargo, nivel y contexto. La clave es que todos sean relevantes y comprensibles para quien será evaluado.


¿Cómo evaluar criterios que no tienen un KPI?

Define conductas observables y ejemplos de evidencia. Para colaboración, por ejemplo, puedes revisar acuerdos entre áreas, comentarios de pares o casos en que la persona ayudó a destrabar un resultado. Lo cualitativo puede ser riguroso si el estándar está claro.


¿Conviene usar una escala de 1 a 5?

Puede funcionar, siempre que cada punto tenga un significado claro. Una escala sin descriptores invita a que cada evaluador use su propia vara. A menudo, una escala de cuatro niveles reduce el refugio automático en el punto medio.


¿Qué hago si dos jefaturas califican distinto la misma conducta?

Primero revisa la evidencia y el descriptor del nivel. Si la diferencia persiste, una instancia de calibración ayuda a verificar si el criterio se está interpretando de la misma manera, sin obligar a que todos lleguen a la misma nota.


Un buen criterio no termina en una nota


Una evaluación va de la nota a la acción

Definir criterios de evaluación de desempeño es diseñar una conversación más honesta sobre el trabajo. Cuando las personas saben qué se espera, con qué evidencia se revisará y cómo pueden mejorar, la evaluación deja de sentirse como un veredicto inesperado.


Empieza pequeño: toma un cargo crítico, elige cinco criterios que expliquen su éxito y redacta una conducta observable para cada nivel. Después pruébalos con quienes hacen ese trabajo todos los días. Esa prueba vale más que cualquier formulario elegante.


Si quieres conectar objetivos, competencias, evidencias, feedback y calibración en un mismo ciclo, TRAKER permite configurar modelos por cargo, detectar diferencias entre evaluadores y llevar los resultados a conversaciones y planes de desarrollo accionables.

Comentarios


logo spotify
logo linkedin

651 North Broad Street, Middletown, Delaware, USA.

Código Postal  19709

+1 385-715-9671

Eliodoro Yañez 2972 of 806, Providencia, Santiago. Chile

Codigo Postal 7510277

Copyright © Traker 2026. Todos los derechos reservados.

bottom of page