Cuánto tarda ClaudIA en contestar: 1.122 respuestas medidas
Casi todo lo que se lee sobre asistentes con inteligencia artificial son promesas. Esto es una medición: mediana de 3 segundos, percentil 90 de 5 segundos y el 99% de las respuestas por debajo del minuto, sobre 1.122 respuestas a mensajes de clientes reales en dos salones durante aproximadamente un mes.
Debajo está la metodología completa, incluido lo que dejamos fuera, lo que el número no significa y las cifras que decidimos no publicar porque no aguantaron la revisión.
Qué se midió exactamente
Por cada mensaje entrante de un cliente, el tiempo hasta la siguiente respuesta de ClaudIA en esa misma conversación. Es lo que en atención al cliente se llama tiempo de primera respuesta, y es la métrica estándar precisamente porque es la que nota quien escribe.
| Salón A | Salón B | Juntos | |
|---|---|---|---|
| Respuestas medidas | 840 | 282 | 1.122 |
| Mediana | 3 s | 3 s | 3 s |
| Percentil 90 | 5 s | 4 s | 5 s |
| Por debajo de 60 s | 99% | 100% | 99% |
Los dos salones dan el mismo número, que es la primera señal de que no estamos ante una casualidad de un caso raro.
Lo que dejamos fuera, y por qué
Una medición sin exclusiones declaradas no es una medición, es un anuncio. Estas son las nuestras:
Los mensajes que escribió una persona del salón. Cuando la dueña responde desde el panel o desde su móvil, ese mensaje no es de ClaudIA y no cuenta. Es una distinción que hay que hacer en el dato, no a ojo: en la base quedan marcados con su autor.
Todo lo que tardó más de una hora. Por encima de ese umbral ya no es una respuesta: es un recordatorio, una invitación a volver o un hilo que alguien retomó al día siguiente. Meterlo en la mediana la ensuciaría en nuestro favor o en nuestra contra según el mes, y en ninguno de los dos casos estaría midiendo lo que dice medir.
Nada más. No se filtraron conversaciones «buenas», ni se quitaron los casos lentos, ni se eligió una ventana favorable.
Por qué el número es conservador
Hay un detalle técnico que juega en nuestra contra y lo dejamos así a propósito. Cuando ClaudIA manda dos o tres mensajes seguidos como respuesta a uno solo del cliente, el cálculo cuenta los tres, y el segundo y el tercero llegan por definición más tarde que el primero.
Es decir: el tiempo de primera respuesta real es todavía mejor que 3 segundos. Preferimos publicar el número que sale de la medición cruda antes que uno afinado a nuestro favor, porque un dato que mejora cuando lo auditan es la única clase de dato que compensa publicar.
Qué significa esto y qué no
No significa que ClaudIA sea buena. Significa que es rápida. Contestar en 3 segundos con una tontería es peor que no contestar, y hay productos que hacen exactamente eso: responden al instante con un menú de opciones que no sabe si el jueves a las cinco hay hueco.
El dato tiene valor unido a lo otro: contestar en 3 segundos habiendo consultado la agenda real, con los servicios, los horarios de cada profesional y los huecos que existen de verdad. La velocidad sola es fácil; la velocidad con una hora concreta que se puede reservar es lo que cambia el resultado.
Tampoco significa que su cliente reciba respuesta en 3 segundos siempre. Significa que la mitad de las veces tarda menos de eso y que prácticamente nunca pasa del minuto. Un día con una caída de WhatsApp seguirá siendo un día con una caída de WhatsApp.
Con qué se compara
Con lo que hay hoy en un salón sin asistente, que no es un competidor tecnológico: es el teléfono sonando siete veces mientras alguien tiene las manos en un tinte, y el WhatsApp que se contesta a las nueve de la noche, cuando la clienta ya ha pedido cita en otro sitio.
Esa es la comparación honesta. No la hacemos contra otro producto porque no tenemos sus datos, y publicar una tabla comparativa con cifras que no hemos medido sería exactamente el tipo de contenido del que este artículo intenta ser lo contrario.
Lo que NO publicamos
Medimos siete cosas y publicamos una. Las otras seis se quedaron fuera, y contarlo es parte de que esta se pueda creer:
- El porcentaje de citas que ClaudIA reserva sola parecía bueno hasta que auditamos el dato: uno de los salones está cargando su histórico de citas a mano, y esas filas —decenas, todas con el mismo instante de creación al segundo— inflaban el resultado. El número real es bastante más modesto y lo publicaremos cuando la base esté limpia.
- El porcentaje de llamadas resueltas sin intervención humana salió muy alto, pero sobre 50 llamadas. Con esa muestra, una sola llamada mal resuelta mueve el resultado dos puntos. Volveremos a mirarlo con unos cientos.
- Los euros que ClaudIA pone en la agenda son un buen argumento en una demo y un mal artículo público: son dos salones identificables y ese dinero no es nuestro para publicarlo.
Lo decimos porque la pregunta correcta ante cualquier cifra de marketing es «¿qué midieron y no enseñaron?». Aquí está la respuesta.
Cómo comprobarlo usted
Si está evaluando cualquier asistente —el nuestro o el de otro—, esta es la prueba que puede hacer en una demo sin depender de lo que le cuenten:
- Escriba como escribiría un cliente, en lenguaje normal y con una falta de ortografía.
- Mire el reloj hasta la respuesta.
- Y sobre todo: pida una hora que usted sepa ocupada y compruebe si se la ofrece.
El paso 3 es el que separa un asistente de un contestador con buenos modales. Los 3 segundos solo valen si lo que llega en esos 3 segundos es cierto.
ClaudIA hace esto por ti
Reserva por WhatsApp
Tus clientes escriben como siempre y ClaudIA gestiona la cita en lenguaje natural. Ver cómo funciona →
