Mide la cola, no el bot
Cuando pusimos en marcha un agente de soporte con IA sobre nuestra cola de 5.000 tickets al mes, nunca montamos un panel de deflexión. No fue por principios - es que no conseguimos averiguar qué nos iba a contar.
La deflexión cuenta las conversaciones que no llegaron a una persona. No cuenta si algo se resolvió. Un cliente que se rinde no es un éxito: es un reembolso esperando su momento, o el mismo ticket la semana que viene con otro asunto.
Este agosto, tres rincones muy distintos del sector llegaron a la misma conclusión. El responsable de CX de Automattic defendió que la deflexión no es una estrategia de soporte. Una columna del lado de los proveedores en Smart Customer Service pidió sustituirla por la tasa de resolución. Y la prensa de consumo en China citó a un experto legal diciendo que el servicio con IA debe juzgarse por la eficiencia de resolución y de escalado - con un regulador detrás de la frase.
¿Debate zanjado, entonces? Casi. Esta es la parte a la que sigo dando vueltas: la tasa de resolución también se puede maquillar.
Cerrar por silencio, donde no responder en 72 horas cuenta como resuelto. Resoluciones confirmadas por el bot, donde el agente pregunta "¿te ha servido?" y trata una sesión abandonada como un sí. Reaperturas registradas como tickets nuevos, de modo que cada fallo se convierte en dos éxitos.
Cualquier métrica limitada al trozo de cola del bot se puede favorecer eligiendo el trozo.
Lo que nos funcionó fue negarnos a darle a la IA su propio marcador. Una cola, un reloj: los tickets atendidos por IA y los atendidos por personas en las mismas dos cifras - tiempo medio de resolución y satisfacción del cliente, medidos sobre todo el conjunto. Si el agente "resolvía" algo que no había resuelto, el cliente volvía, y la cifra se movía en nuestra contra. El fallo no tenía dónde esconderse.
Ese diseño es también lo que nos permitió crecer con confianza. Empezamos con el agente en el 10% de la cola y lo ampliamos solo mientras las cifras del conjunto aguantaban. Seis meses después lo cubría todo, y la resolución media había bajado de unas 24 horas a unas 10. La satisfacción se mantuvo por encima del 95% - medida sobre todo, no sobre los mejores días del bot.
Entiendo por qué existen los paneles de deflexión. Están disponibles desde el primer día, y siempre suben.
Pero la métrica a la que sometes a un equipo debería ser una que tu cliente reconocería como real. Nadie nos escribió nunca para darnos las gracias por haber sido deflectado.