El servicio asíncrono, basado en canales de mensajería persistentes, está reemplazando a la cola en vivo como modelo predeterminado para la atención al cliente.
El servicio asíncrono permite que un cliente inicie una conversación con una empresa, cierre la aplicación y la retome horas o días después, con todo el contexto intacto. Sin música de espera, sin posición en la cola, sin repetir el problema. El canal lo recuerda.
WhatsApp Business y Apple Messages for Business han convertido esto en la expectativa predeterminada en lugar de una novedad. Un cliente envía un mensaje sobre un pedido retrasado a las 9 a.m., continúa con su día y recibe una resolución a las 3 p.m. en el mismo hilo, sin necesidad de devolución de llamada ni de citar un número de caso.
Esto rompe la suposición implícita en la mayoría del diseño de servicios: que la resolución ocurre en una sesión única, continua y sincrónica. El servicio asíncrono trata una conversación como un objeto persistente al que ambas partes pueden volver, no como una llamada en vivo que debe completarse o se pierde.
Why we think it'll come up
The queue is disappearing as a UI concept
Apple Messages for Business and WhatsApp Business API both default to threaded, persistent conversations rather than live queues — customers see a chat history, not a wait time.
Businesses are re-platforming support around messaging, not calls
Contact centre vendors (Zendesk, Salesforce, Twilio) have rebuilt core workflows around message threads that route to different agents over time, rather than single-session calls.
Context persistence is now the differentiator, not response speed
Because the thread retains history, customers tolerate longer resolution windows — provided they never have to re-explain the issue from scratch.
What it changes for customer experience
For customers
Support fits around their day instead of demanding they wait live — but they expect the business, not them, to carry the context forward.
For business
Async threads reduce concurrent agent load and abandonment, but require new staffing and SLA models built around resolution windows, not talk time.
For CX & operations
Legacy metrics like average handle time and time-to-first-response lose meaning; operations must shift to thread-level resolution tracking.
Industries on the front line
El fin de la cola en vivo
El servicio al cliente ha asumido durante mucho tiempo un único patrón de diseño: la sesión en vivo y sincrónica. Un cliente llama, espera, se conecta, resuelve, todo en un bloque de tiempo continuo, o se considera que la interacción ha fallado. Esa suposición ahora se está desmoronando. El servicio asincrónico, basado en canales de mensajería persistentes, está reemplazando la cola en vivo como modelo predeterminado para la atención al cliente.
La mecánica es simple, pero las implicaciones no lo son. Un cliente envía un mensaje a una empresa sobre un pedido retrasado a las 9 a.m., cierra la aplicación, continúa con su día y recibe una resolución a las 3 p.m. en el mismo hilo. Sin música de espera, sin posición en la cola, sin número de caso que citar, sin repetir el problema desde cero. El canal recuerda, incluso si el cliente y el agente se ausentan. WhatsApp Business y Apple Messages for Business han hecho que esto sea algo común en lugar de novedoso: la conversación se trata como un objeto persistente al que ambas partes pueden volver, no como una llamada en vivo que debe completarse o perderse.
Por qué el hilo supera a la llamada
La escala de adopción ya no es marginal. Meta informó en 2022 que más de 175 millones de personas envían mensajes a una cuenta comercial en WhatsApp todos los días, una cifra que indica que el servicio de mensajería persistente ha superado con creces el estado piloto y se ha convertido en infraestructura predeterminada para una gran parte de las industrias orientadas al consumidor.
Lo notable no es simplemente que los clientes envían mensajes a las empresas en volumen, sino que la cola en sí está desapareciendo como concepto de diseño. Apple Messages for Business y la API de WhatsApp Business se configuran por defecto en conversaciones persistentes y con hilos en lugar de colas en vivo: los clientes ven un historial de chat, no un tiempo de espera. Ese único cambio de interfaz elimina silenciosamente el costo psicológico de la espera, porque la espera ya no es visible ni sincrónica. No hay nada que mirar, ninguna posición que actualizar.
El cambio no es de un servicio lento a un servicio rápido. Es de un servicio que exige presencia a un servicio que persiste sin ella.
Reconstruyendo el back-end en torno a los hilos
Los proveedores de centros de contacto —Zendesk, Salesforce, Twilio, entre ellos— han reconstruido los flujos de trabajo centrales en torno a hilos de mensajes que se dirigen a diferentes agentes a lo largo del tiempo, en lugar de llamadas de una sola sesión. Este es un cambio arquitectónico más profundo de lo que parece. Una llamada en vivo requiere un agente, presente, durante toda la duración. Un hilo persistente puede pasar entre agentes, turnos e incluso días, siempre que el contexto viaje con él. Eso requiere una nueva infraestructura: historial compartido, intercambios previos visibles y lógica de enrutamiento que trate una conversación como un registro continuo en lugar de un evento cerrado.
Esta es también la razón por la que la persistencia del contexto, no la velocidad de respuesta, se ha convertido en el verdadero diferenciador. Debido a que el hilo conserva el historial, los clientes toleran ventanas de resolución más largas, siempre que nunca tengan que volver a explicar el problema desde cero. La velocidad sigue siendo importante, pero ha sido degradada. Lo que los clientes no tolerarán es que se les pida que repitan un problema que ya describieron, a un sistema que aparentemente ha olvidado que existía.
Qué cambia para los clientes y las operaciones
Para los clientes, el beneficio es sencillo: el soporte ahora se adapta a su día en lugar de exigirles que esperen en vivo. Pero esto viene con una expectativa correspondiente: que la empresa, no el cliente, lleve el contexto hacia adelante. El servicio asincrónico solo funciona como un intercambio de confianza si el hilo realmente recuerda; si no lo hace, el modelo colapsa de nuevo en el problema de repetición exacto que se suponía que debía resolver.
Para las empresas, los hilos asincrónicos reducen la carga concurrente de los agentes y disminuyen el abandono, ya que los clientes ya no están en una cola en vivo con un incentivo para colgar. Pero esto requiere nuevos modelos de personal y SLA construidos en torno a ventanas de resolución en lugar de tiempo de conversación. Un modelo diseñado para llamadas sincrónicas de una sola sesión no se adapta limpiamente a conversaciones que pueden abarcar horas o días y múltiples agentes.
Para los equipos de CX y operaciones específicamente, esto fuerza una revisión de las métricas. Las medidas heredadas como el tiempo promedio de manejo y el tiempo hasta la primera respuesta pierden gran parte de su significado cuando la "llamada" ya no existe como una unidad discreta. Las operaciones deben cambiar hacia el seguimiento de la resolución a nivel de hilo, midiendo si un problema se cerró realmente y cuánto tiempo tomó el arco completo, en lugar de la rapidez con la que alguien respondió.
El camino práctico a seguir
Este patrón ya es relevante en el comercio minorista y electrónico, las telecomunicaciones, la banca y los servicios financieros, los viajes y la hostelería, y la logística y la entrega, en cualquier lugar donde las consultas de servicio de alto volumen y baja urgencia actualmente obstruyen innecesariamente los canales en vivo. La medida sensata es adoptar ahora: probar canales de mensajería persistentes para esos casos de menor urgencia y alto volumen, y rediseñar los SLA en torno a las ventanas de resolución en lugar del tiempo de respuesta. Las organizaciones que traten esto como un cambio de canal perderán el punto. Las que lo traten como un rediseño de lo que significa "resolución" serán aquellas a las que los clientes dejarán de temer contactar.
Adopte ahora: canales de mensajería persistente piloto para consultas de servicio de alto volumen y baja urgencia, y rediseñe los SLA en torno a ventanas de resolución en lugar de tiempo de respuesta.
Trends Radar
Other trends
Build for what's next
Turn this trend into a measurable experience advantage.
