Los KPI de chatbots son métricas vinculadas a un objetivo, como resolver una consulta o generar un lead cualificado. El volumen de mensajes es una métrica; la resolución confirmada frente a una meta definida es un KPI. Especifica qué conversaciones cuentan y qué evidencia demuestra el resultado.
Para soporte, empieza por resolución confirmada, resultados desconocidos y transferencias completadas. Para la experiencia de usuario, añade satisfacción, participación en encuestas y latencia. Una conversación que termina sin intervención humana no necesariamente resolvió el problema.
Definiciones y fórmulas
Esta es una convención de medición propuesta, no un estándar universal de los proveedores. Incluye conversaciones reales del caso de uso y periodo elegidos. Excluye pruebas y spam mediante una regla documentada. Separa las conversaciones abiertas hasta que termine su ventana de observación. Multiplica cada fracción por 100 para obtener porcentajes. Un denominador cero significa no disponible, no 0 %.
| KPI | Fórmula | Información adicional |
|---|---|---|
| Resolución confirmada | Conversaciones resueltas por el bot con confirmación / conversaciones elegibles | Método de confirmación y resultados desconocidos |
| Contención | Conversaciones sin escalamiento humano registrado / conversaciones elegibles | Cobertura del registro y casos no resueltos |
| Solicitud de transferencia | Conversaciones que piden ayuda humana / conversaciones elegibles | Solicitudes, fallos y aceptaciones separados |
| Transferencias completadas | Transferencias aceptadas por una persona o cola de destino / transferencias solicitadas | Evidencia de aceptación, no de resolución |
| CSAT | Valoraciones positivas / valoraciones válidas | Escala, umbral positivo y número de respuestas |
| Participación en encuestas | Respuestas válidas / conversaciones a las que se ofreció la encuesta | Representatividad de los participantes |
| Fallback | Turnos del visitante que activan un fallback definido / turnos elegibles del visitante | Rechazos, falta de información y errores separados |
| Interacción | Sesiones del widget con mensaje del visitante / sesiones observadas de apertura del widget | Misma definición de sesión |
| Conversión de leads | Conversaciones de ventas con un lead cualificado y deduplicado / conversaciones de ventas elegibles | Regla de cualificación y resultado comercial posterior |
| Resultado desconocido sin escalamiento | Conversaciones no escaladas sin evidencia suficiente del resultado / conversaciones elegibles | Falta de seguimiento y posibles abandonos |
Resolución, contención y contactos evitados
Confirma la resolución con una respuesta explícita sobre el problema, un resultado de tarea verificado o una revisión documentada de la conversación. Una valoración positiva del tono no basta. Publica por separado cualquier éxito inferido. Microsoft también distingue éxito confirmado e implícito.
El silencio, cerrar el widget o no volver en un día puede indicar éxito, interrupción o abandono. Sin pruebas, el resultado es desconocido. Busca contactos posteriores sobre el mismo problema durante una ventana declarada, cuando sea posible y esté permitido. Identifica los canales que no puedes observar.
La contención puede incluir problemas sin resolver. La deflexión estima contactos humanos evitados frente a lo que habría ocurrido sin el bot. Necesita tasas comparables, idealmente un grupo de control adecuado. Los cambios de tráfico o de consultas pueden alterar una comparación antes/después. Ninguna de estas tasas mide directamente horas de trabajo ahorradas.
Ejemplo con 100 conversaciones
Es un ejemplo hipotético, no datos de clientes de Agentkit ni un benchmark. Al cerrar la ventana de observación hay 45 resoluciones confirmadas sin escalamiento, 20 solicitudes de transferencia y 35 conversaciones sin escalamiento ni confirmación fiable. De las transferencias, 15 se aceptaron y 5 fallaron.
Según esta convención, las 20 solicitudes de transferencia registradas cuentan como escalamientos, incluidas las 5 transferencias fallidas. La tasa de resultados desconocidos sin escalamiento excluye esas solicitudes; su resolución final requiere seguimiento separado.
Resolución confirmada: 45/100 = 45 %. Contención: 80/100 = 80 %. Resultados desconocidos sin escalamiento: 35/100 = 35 %. Los resultados de los casos escalados requieren seguimiento adicional. Transferencias completadas: 15/20 = 75 %, sin que eso pruebe la resolución de esas consultas.
Si los 100 reciben una encuesta y responden 10, con 8 valoraciones positivas, el CSAT es 8/10 = 80 % y la participación 10/100 = 10 %. No demuestra que el 80 % de todos los visitantes esté satisfecho. Los contactos evitados y el tiempo ahorrado siguen sin conocerse.
Qué KPI de experiencia de usuario elegir
Combina CSAT y participación con resultados desconocidos o abandonados, latencia y transferencias completadas. Una muestra voluntaria pequeña puede excluir a quienes se fueron descontentos. Comprueba que también haya oportunidades de opinar tras un escalamiento.
Define la latencia desde el envío hasta la primera respuesta visible o hasta la respuesta completa. Presenta mediana y percentil 95, junto con errores y tiempos de espera agotados. Una respuesta rápida pero incorrecta no ayuda.
La profundidad es mensajes contados por conversación; indica si incluye ambos lados. Una conversación larga puede ser útil o repetitiva, y una corta puede tener éxito o acabar en abandono. Separa usuarios que vuelven con una necesidad nueva de contactos repetidos por un problema pendiente.
Establecer objetivos y actuar
No hay un porcentaje universal defendible para todas estas tareas. Compara el mismo caso de uso, idioma, canal y reglas. Muestra numeradores y denominadores; las muestras pequeñas y los cambios en las consultas limitan las conclusiones.
Establece un periodo completo de referencia, aplica una corrección y compara otro periodo completo. Separa los escalamientos necesarios de los fallos evitables. Un 60 % de contención no significa un 60 % menos de trabajo: mide contactos humanos y tiempo de gestión por separado.
Revisa conversaciones resueltas, desconocidas, escaladas y con fallback. Este último puede deberse a información ausente, un rechazo apropiado o un error técnico. Consulta optimización del chatbot y soporte al cliente. Para ventas, investiga intención, requisitos del formulario y momento de la oferta con la guía de generación de leads. Conserva la visibilidad al combinar chatbot y chat en vivo.
Usa los registros y comentarios disponibles en tu instalación. Este plan no afirma que Agentkit calcule automáticamente todas las fórmulas ni identifique visitantes entre canales. Si falta un evento, marca el KPI como no disponible y define la instrumentación o revisión manual necesaria.
Crea tu chatbot gratis → Sin tarjeta de crédito.



