¿Te ayudamos a aplicar esta guía?Pregunta al equipo de DripTell
Dos revisores escuchan la misma conversación con un cliente. Uno considera aceptable el trabajo. El otro ve un fallo grave. Si el equipo promedia las puntuaciones y continúa, la sesión de calibración habrá ocultado su hallazgo más útil.
La calibración de QA debe hacer que la evaluación sea reproducible. Entregue a todos la misma interacción, pruebas, versión de rúbrica y política. Cada persona puntúa de forma independiente. Después compare criterios, clasifique la diferencia, asigne propietario y pruebe la aclaración con trabajo nuevo.
La calibración protege la medición
Una buena rúbrica de QA para atención al cliente puede producir resultados poco fiables. «Mostró empatía» puede significar una disculpa para un revisor y el reconocimiento del perjuicio concreto para otro. Un fallo de privacidad puede ser evidente en la grabación completa y desaparecer de una transcripción abreviada.
- 1Fije las pruebasEntregue a todos la misma interacción, política y versión de rúbrica.
- 2Puntúe por separadoRegistre decisiones antes de que alguien vea otra puntuación.
- 3Compare criteriosSepare errores críticos de estilo y notas totales.
- 4Asigne la causaEnvíe problemas de pruebas, rúbrica, política o revisor al propietario correcto.
- 5Pruebe la reglaUse una interacción nueva para comprobar la reproducibilidad.
La documentación de Microsoft sobre criterios de evaluación hace explícitos preguntas, respuestas, instrucciones, elementos críticos, versiones y simulación. La lección operativa es sencilla: el significado de una nota debe estar escrito y asociado a una versión. Alguien fuera de la reunión debe poder aplicar la regla con la norma y las pruebas.
No use la calibración para reparar una muestra sesgada. Decida qué conversaciones entran en QA con un plan de muestreo independiente.
Fije las pruebas antes de puntuar
Cada revisor necesita el mismo paquete de pruebas. En una llamada puede incluir la grabación completa, horas, historial de transferencias, política vigente ese día y resultado para el cliente. En mensajería, conserve el hilo completo en lugar de una captura seleccionada. Limite el acceso mediante un modelo claro de acceso a conversaciones, porque calibrar no justifica abrir datos ajenos al caso.

Registre la versión de la rúbrica y la fecha de la política. Si una persona aplica la regla de reembolsos actual a una conversación del mes pasado, no hay deriva del revisor. Hay un fallo de control de versiones.
Todos puntúan de forma independiente antes de hablar. Nadie ve primero la nota o explicación de un colega. La documentación de Microsoft sobre resultados muestra los criterios y puede exponer la versión asociada. Así cada nota queda vinculada a un instrumento, mientras la independencia conserva la decisión original.
Compare criterios antes que totales
La nota total puede esconder la decisión importante. Dos revisores pueden conceder 82 por ciento y discrepar por completo sobre privacidad, exactitud y propiedad del siguiente paso. Compare criterio por criterio y separe los fallos críticos de las preferencias de estilo.
Pida a cada persona que cite el momento observado, la regla aplicada y las pruebas disponibles. «Sonó distante» no basta. «El agente prometió un reembolso antes de comprobar la elegibilidad» sí puede verificarse.
Clasifique el origen de la diferencia
No todas las diferencias requieren más formación. Algunas revelan pruebas ausentes, lenguaje ambiguo, políticas en conflicto o una decisión que solo puede tomar el propietario de la política.
| Origen de la diferencia | Qué debe comprobar | Propietario correcto | Acción práctica |
|---|---|---|---|
| Hecho observable | Si ambos vieron la interacción completa | Responsable de QA | Restaurar el registro y volver a puntuar |
| Contexto ausente | Si estaban disponibles pedido, identidad y transferencia | Propietario del sistema | Reparar la captura o el acceso |
| Criterio ambiguo | Si lectores razonables aplican el texto de forma distinta | Propietario de la rúbrica | Reescribir el criterio y añadir ejemplos |
| Conflicto de política | Si las instrucciones chocan o carecen de autoridad | Propietario de política | Decidir la regla y fecha de vigencia |
| Deriva del revisor | Si la regla es clara pero se aplica de manera desigual | Coach de QA | Practicar con casos nuevos y volver a probar |
La ambigüedad repetida pertenece al análisis de causa raíz. Si falta una respuesta actual, conéctela con la detección de vacíos en la base de conocimiento.
Documente la decisión y vuelva a probar
El registro de calibración conserva el identificador de la interacción, la versión de la rúbrica, las puntuaciones originales por criterio, las pruebas, la clase de diferencia, la decisión, el propietario y la fecha de vigencia. No sobrescriba las notas iniciales. Si lo hace, no podrá medir si la evaluación mejoró.
Cuando cambie un criterio, inicie un periodo de comparación nuevo. No mezcle definiciones antiguas y nuevas en una tendencia. Entregue a los revisores una interacción de control que no se discutió. Si ahora aplican la regla aclarada de forma coherente, el cambio probablemente ayudó. Si siguen discrepando, reabra el criterio o el paquete de pruebas.
Mida el acuerdo por criterio y tipo de contacto, no solo como un porcentaje general. Una cifra alta puede ocultar decisiones inestables sobre privacidad, pagos, seguridad o promesas sin respaldo.
Adapte la frecuencia al cambio
Calibre al lanzar una rúbrica, cambiar una política, incorporar un revisor o detectar más diferencias. Una operación estable puede usar una sesión mensual. Un cambio urgente puede requerirla esta semana. La frecuencia sigue el riesgo, no el calendario.
Separe calibración y disciplina. Primero confirme que regla, pruebas y aplicación son fiables. Después se puede formar con una norma aprobada. Juzgar desempeño con una disputa abierta destruye la confianza en QA.
Un espacio de soporte compartido puede conservar asignaciones, notas e historial entre canales. No aclara la regla de puntuación. La calibración aún necesita propietario y nueva prueba.
Preguntas frecuentes
Cuántas conversaciones necesita una sesión de calibración
Use suficientes para revelar decisiones importantes sin convertir la sesión en revisión rutinaria. Incluya trabajo normal y algunos casos límite pertinentes. La cantidad depende de la complejidad de la rúbrica, los canales, los cambios de política y la experiencia. Una sesión pequeña no demuestra la fiabilidad de todo el equipo.
Deben los revisores hablar antes de puntuar
No. Todos reciben las mismas pruebas y puntúan primero de forma independiente. La conversación es útil después de registrar las diferencias originales por criterio. De lo contrario, el primer juicio o la jerarquía pueden crear un acuerdo artificial.
Qué ocurre cuando la política no está clara
Suspenda ese criterio como juicio de desempeño y envíe la pregunta al propietario de la política. Registre la decisión y su fecha, actualice la norma y pruebe la aclaración en una interacción nueva. Los revisores de QA no deben inventar políticas durante la reunión.
DripTell Editorial
Guías prácticas revisadas por el equipo de producto y flujos de cliente de DripTell.
Consulta cómo DripTell verifica el producto, utiliza fuentes primarias y corrige errores.
Política editorial y de fuentes



