Ir al contenido
quick.bot
Iniciar sesiónComenzar
Volver al blog

Por Francisco Mastromarino, Founder, Quick.bot · 15 de septiembre de 2026

Pasar el chat de bot a humano en WhatsApp: cómo hacerlo

Lo esencial

  • El escalamiento se dispara por señales concretas, no por intuición: palabra clave explícita, intento fallido repetido, tipo de pedido (queja, cancelación) u horario fuera de atención. Un bot sin estos disparadores definidos escala tarde o no escala nunca.
  • El error más común no es la falta de agentes disponibles: es que el bot sigue respondiendo mientras la persona ya está escribiendo, y el cliente recibe dos respuestas mezcladas o contradictorias en el mismo chat.
  • Pasar el chat sin pasar el contexto obliga al cliente a repetir todo desde cero. La solución no es mandarle al agente el historial completo sin filtrar, sino un resumen corto de qué pidió, qué se probó y por qué se escaló.
  • Si el cliente le escribió por última vez a tu número hace más de 24 horas, WhatsApp no deja que el agente humano responda con un mensaje libre: necesita una plantilla aprobada por Meta. Es el detalle técnico que más artículos sobre este tema se saltean.
  • Cuando no hay nadie disponible, conviene decirlo con un horario concreto en lugar de dejar el chat en silencio o repetir el mismo mensaje automático en loop.
  • Devolver la conversación al bot al cerrar la atención necesita un cierre explícito (una acción del agente o un límite de inactividad), no simplemente que la persona deje de escribir.

¿Cómo se detecta que un chat necesita un humano?

No existe un único disparador correcto. La mayoría de los bots que funcionan bien combinan varios, porque cada uno cubre un caso que los otros no ven.

DisparadorSeñalRiesgo si no está bien resuelto
Palabra clave explícitaEl cliente escribe algo como “quiero hablar con una persona”, “agente” o “humano”Si solo reconoce la frase exacta y no sus variantes (mayúsculas, errores de tipeo, “un asesor”, “alguien real”), el cliente insiste dos o tres veces antes de lograrlo
Intento fallido repetidoEl bot no entiende la misma consulta dos o tres veces seguidasEscalar recién al quinto intento llega tarde: el cliente ya escribió “esto no sirve” o abandonó la conversación
Tipo de pedido sensibleEl mensaje incluye reclamo, cancelación, devolución o urgenciaDejar estos casos enteramente en manos del flujo automático puede agravar un problema que ya venía delicado
Fuera del horario de atenciónLa hora del mensaje cae fuera de la ventana configurada para agentes humanosSin este disparador el bot promete una respuesta humana que nadie va a dar hasta el día siguiente, y el cliente se entera recién cuando ya esperó horas

¿Qué pasa con el bot mientras contesta la persona?

Acá está el error de diseño más frecuente, y es el que menos se explica en las guías genéricas sobre handoff. Cuando un agente humano toma un chat, el bot tiene que dejar de responder en esa conversación puntual, no en general. Si el flujo sigue escuchando cada mensaje entrante y contestando con su lógica normal, el agente y el bot terminan hablándole al mismo cliente al mismo tiempo.

No es un caso de borde: quien arma estos flujos se lo encuentra apenas suma una persona del otro lado. En la comunidad de n8n, alguien armando un asistente de WhatsApp para una empresa de alquiler de autos lo resumió como un requisito de su cliente: el dueño del negocio quería poder tomar una conversación manualmente y responder como persona, mientras el bot dejaba de responder en ese chat. No era un capricho: sin eso, el bot le pisaba las respuestas al dueño del negocio delante del cliente.

La Cloud API no trae nada de esto resuelto: no hay routing, no hay cola de espera y no hay un estado de conversación que diga quién está atendiendo. La documentación de Meta describe cómo recibir y responder mensajes, no cómo repartirlos entre un bot y una persona. Ese estado (“bot”, “en cola”, “con agente”) hay que guardarlo y consultarlo tú mismo antes de dejar pasar cada mensaje entrante a tu lógica automática o a tu LLM.

La forma más simple de resolverlo es una bandera por conversación (no una bandera global de la cuenta) que el webhook revisa antes de correr el flujo: si está en “con agente”, el mensaje entra al inbox humano y el bot no procesa nada. Quick.Bot trae esa bandera resuelta: cuando el agente toma el chat desde la bandeja, el bot deja de responder en esa conversación, sin que haya que programarlo a mano.

¿Cómo se le pasa el contexto al agente para que no pregunte lo mismo?

Mandar el historial crudo entero no alcanza: un agente que recibe cuarenta mensajes sin estructura tarda más en entender el caso que en resolverlo. Lo que funciona es un resumen corto y visible antes de la primera respuesta del agente, con tres datos: qué quiere el cliente, qué se intentó ya (incluidos los pasos que el bot completó, como datos de contacto o número de pedido) y por qué se escaló. Ese resumen es para el equipo, nunca para el cliente.

Si varias personas atienden el mismo número, conviene revisar además cómo se reparten esos chats entre agentes; eso ya es un tema aparte que cubrimos en cómo usar WhatsApp Business con varios usuarios en un mismo número.

¿Qué se le dice al cliente cuando no hay nadie disponible?

Lo que el cliente no puede hacer es adivinar cuánto falta. Un mensaje automático que reconozca el pedido y dé un horario concreto (“un agente te responde a partir de las 9:00”) le deja algo que esperar; un genérico “en breve te contactamos” que no dice cuándo, no. Si el bot todavía puede resolver parte del pedido mientras espera al agente (por ejemplo, tomar los datos del reclamo), conviene que lo siga haciendo: lo único que tiene que detenerse es la respuesta automática una vez que el agente ya tomó el chat.

¿Por qué el escalamiento se rompe después de 24 horas en WhatsApp?

Este es el detalle técnico que casi ningún artículo sobre handoff menciona, y es el que más rompe implementaciones en producción. Según la documentación oficial de Meta, cuando un usuario de WhatsApp te escribe (o te llama) se abre una ventana de servicio de 24 horas; cada mensaje nuevo del usuario reinicia el conteo. Mientras esa ventana está abierta, tu negocio puede mandar mensajes libres (texto, imágenes, lo que sea) sin usar una plantilla. En cuanto se cierra, solo se pueden enviar mensajes de plantilla aprobados por Meta: el resto de los tipos de mensaje queda bloqueado.

Esto le pega directo al handoff: si un chat quedó parado (el cliente escribió y nadie contestó a tiempo, o el caso se reabre al día siguiente) y ya pasaron más de 24 horas desde su último mensaje, el agente humano no puede simplemente escribirle de vuelta. Necesita disparar una plantilla de utilidad o de marketing ya aprobada, con las categorías y reglas que explicamos en plantillas de WhatsApp y la ventana de 24 horas. Un equipo de soporte que no lo sabe se entera cuando su mensaje “normal” falla en silencio y el cliente nunca lo recibe.

¿Cómo se devuelve el chat al bot cuando el agente termina?

La vuelta al bot necesita un cierre explícito, no la ausencia de nuevos mensajes del agente. Dos patrones cubren la mayoría de los casos: que el agente marque la conversación como resuelta y eso limpie la bandera de “con agente”, o que se restablezca sola después de un tiempo de inactividad razonable si nadie la cerró a mano. Lo que hay que evitar es que el chat quede en un limbo donde ni el bot ni ningún agente lo estén mirando: ese es el estado en el que un cliente manda un mensaje y no le contesta nadie.

Preguntas frecuentes

¿El cliente ve si le está hablando un bot o una persona?

WhatsApp no distingue eso visualmente para el cliente: todo llega como mensajes del mismo número. Por eso conviene que el propio flujo lo aclare al escalar (“te paso con [nombre] de nuestro equipo”), en vez de dejar que el cambio de tono sea lo único que lo delate.

¿Qué pasa si dos agentes contestan el mismo chat a la vez?

Es el mismo problema de diseño que el del bot pisando al agente, pero entre personas: sin un estado de “conversación asignada” que se muestre en el inbox, dos agentes pueden escribirle al mismo cliente cosas distintas. La bandera por conversación tiene que cubrir también ese caso, no solo bot contra humano.

¿La ventana de 24 horas se reinicia si el agente humano responde?

No. Según la documentación de Meta, el conteo se reinicia únicamente cuando el usuario envía un mensaje o llama, no cuando el negocio responde. Que el agente conteste rápido no extiende la ventana ni un minuto.

Arma tu bot de WhatsApp gratis en Quick.Bot; la bandeja compartida, donde tomar un chat pausa el bot en el acto, viene con los planes de pago: empieza gratis

Fuentes