ooligo
STACK

Stack de agente de soporte con IA — un medidor de resoluciones auditable y una ruta de escalamiento propia

Un equipo de soporte que despliega un agente de IA y necesita que el número de la factura, el número del board deck y el número de clientes realmente atendidos sean el mismo número.

Dificultad
intermedio
Herramientas
7
Customer Success

El stack

El 18 de mayo de 2026, Zendesk cambió el significado de la palabra “resuelto”. Dividió los resultados automatizados en tres categorías — resoluciones contenidas, escalamientos asistidos y resoluciones verificadas — y dejó facturable solo la tercera. Una resolución verificada es una conversación que un modelo LLM confirmó como realmente satisfecha, evaluada al cierre de la ventana de sesión, que por defecto son 72 horas después del primer mensaje. Antes de ese cambio, un cliente que hacía una pregunta y luego se quedaba callado tres días contaba como resolución y consumía tu bolsa.

Esa semana ningún agente mejoró. Lo que cambió fue el medidor. Ese es el problema alrededor del cual está construido este stack: en todo despliegue de soporte con IA, el número que llega a tu board deck lo produce el proveedor al que le pagas por él, y cada proveedor define la unidad facturable de forma distinta. Este stack es una composición donde la afirmación de resolución se puede verificar, la ruta de escalamiento no es propiedad del proveedor del agente, y puedes ver qué hizo el cliente después de que terminó la conversación.

La forma

  • Zendesk o Pylon es el sistema de registro. Cada conversación que toca el agente queda como ticket con el hilo completo adjunto, porque la auditoría que tarde o temprano vas a correr es una consulta de tickets, no una exportación del dashboard del proveedor. Zendesk es el default para volumen de consumo y multicanal. Pylon es la elección cuando tu soporte ocurre de verdad en canales compartidos de Slack y Teams con cuentas nombradas — una motion B2B donde el “ticket” es un hilo dentro del workspace del propio cliente. Pylon retiró su precio por asiento publicado y lo puso detrás de una demo, así que trátalo como una línea solo por cotización.
  • Fin (Intercom) o Decagon es la capa de resolución. Un agente, que resuelve de punta a punta y ejecuta la acción en el backend en lugar de responder desde un artículo. Fin se mide a $0.99 por resultado con un mínimo mensual de 50 resultados; Decagon no publica precio y se reporta que arranca alrededor de una cuota de plataforma anual de $50,000 antes del consumo. El head-to-head completo está en Decagon vs Fin.
  • Notion es la base de conocimiento, y es un componente más que un documento. Fin conecta Notion como fuente de contenido nativa, resincroniza cada 24 horas y no te deja editar ese contenido dentro de Fin — los cambios se hacen en Notion. Esa restricción es la ventaja. Obliga a tener un solo dueño y un solo lugar donde cambia una política de reembolsos, que es la única razón por la que las respuestas del agente siguen siendo consistentes con lo que dicen tus humanos.
  • Pendo mide lo que el medidor del proveedor estructuralmente no puede. Agent Analytics instrumenta la superficie conversacional dentro de tu propio producto y la conecta con analítica de comportamiento y session replay, reportando volumen de prompts, retención, tasa de prompts sugeridos y dónde se rompen las conversaciones. Pendo reporta que mide más de 350 agentes y 2.5 millones de prompts por semana. El medidor del proveedor te dice que una conversación terminó; Pendo te dice si esa misma persona volvió y abrió un ticket 20 minutos después.
  • n8n es dueño de la ruta de escalamiento y del segundo log. Cada escalamiento dispara un workflow que escribe su propio registro — timestamp, intención, la confianza del agente, el motivo del traspaso — en un almacén que el proveedor del agente no controla. Es la capa más barata del stack y la que hace que una disputa de facturación sea ganable.

Traspasos nombrados

  1. La política cambia en Notion → las respuestas del agente cambian en menos de 24 horas. Una página, un dueño, una resincronización. Sin una copia paralela en el editor del propio agente que se desvíe.
  2. El cliente abre una conversación → el agente intenta resolver → el sistema de registro recibe un ticket en cualquier caso. Contenida, escalada o resuelta, el hilo existe en Zendesk o Pylon. Un agente que resuelve conversaciones de forma invisible es un agente que no puedes auditar.
  3. El agente traspasa → n8n rutea y registra. El workflow asigna la cola, adjunta el payload de traspaso y escribe el registro independiente de escalamiento antes de que un humano lo vea.
  4. Se cierra la ventana de sesión → el proveedor marca el resultado → n8n reconcilia. Una vez al mes, compara resoluciones facturadas contra escalamientos registrados y tickets reabiertos dentro de siete días. Una resolución que produjo una reapertura es una pregunta de facturación, no un éxito.
  5. Termina la conversación con el agente in-product → Pendo lleva el journey hacia adelante hasta los datos de retención y adopción, que es donde finalmente aparece el número honesto de deflection.

La bifurcación que decide el costo

Ambos agentes corren sobre Zendesk, así que esta no es una decisión de migración. Es una decisión sobre qué medidor compras, y hay una condición que vale la pena conocer antes de cotizar nada.

Fin para Zendesk messaging requiere la Sunshine API, que solo está incluida en Zendesk Suite Professional, Enterprise y Enterprise Plus. Suite Professional cuesta $115 por agente al mes con pago anual, frente a Suite Team a $55. Si tu despliegue de Fin es solo email y tickets de formulario de contacto, Fin puede asignarse como agente en tickets de Zendesk sin esa condición. En el momento en que lo quieras en messaging web, móvil o WhatsApp, tu factura de helpdesk prácticamente se duplica. Cotiza eso antes de cotizar el agente.

La segunda regla es más simple: corre un solo medidor. Zendesk cobra $1.50 por resolución automatizada comprometida y $2.00 pay-as-you-go, con bolsas de 5, 10 o 15 resoluciones automatizadas por agente al mes según el plan. Fin cobra $0.99 por resultado. Si Fin resuelve, tu bolsa de resoluciones de Zendesk queda sin usar y pagaste por un medidor que no estás leyendo. Elige el agente y después compra el plan que ese agente necesita — no los dos.

La realidad del costo

Un equipo de soporte de SaaS B2B con 12 asientos, 6,000 conversaciones al mes y una tasa de resolución realista de 40% — 2,400 resoluciones al mes:

  • Agente nativo de Zendesk: Suite Professional a $115 × 12 asientos = $16,560/año. La bolsa es de 10 resoluciones por agente al mes, así que 120 cubiertas y 2,280 facturadas a $1.50 = $41,040/año. Total ≈ $57,600/año.
  • Fin sobre Zendesk: el mismo piso de helpdesk de $16,560 si necesitas messaging, más 2,400 × $0.99 = $28,512/año. Total ≈ $45,000/año, y la bolsa de Zendesk queda sin usar.
  • Decagon: la cuota reportada de ~$50,000 de plataforma aterriza antes de una sola resolución, así que compite en precio unitario solo cuando el volumen supera con holgura este ejemplo.
  • n8n Pro: €60 al mes por 10,000 ejecuciones, unos €720/año, un error de redondeo frente a la línea del agente.
  • Pendo: precio por MAU y solo por cotización arriba del tier gratuito. Consigue el número antes de asumir que la capa de medición es gratis.

La línea sin precio es la base de conocimiento. Alguien tiene que ser su dueño. Presupuesta un dueño nombrado a tiempo parcial; una base de conocimiento desactualizada es la forma más confiable de convertir un resultado de $0.99 en un ticket reabierto que además le pagas a un humano por atender.

Variaciones y cuándo cambiar

  • Pylon en lugar de Zendesk cuando más de la mitad de tu volumen llega en canales compartidos de Slack o Teams. No lo cambies para una motion web y móvil orientada a consumo — estarías comprando un modelo centrado en cuentas para tráfico anónimo.
  • Saca a Pendo si tu agente vive solo en un widget web y email, sin superficie in-product. No hay journey que instrumentar, y el medidor del proveedor más el log de n8n alcanzan. Consérvalo en el momento en que el agente esté embebido en tu aplicación.
  • Cambia n8n por triggers nativos del helpdesk con volumen bajo de escalamientos. La regla: quédate con n8n cuando necesites que el log viva en un lugar que el proveedor del agente no pueda reescribir, o cuando el ruteo dependa de datos de un tercer sistema.

Lo que este stack no reemplaza

  • No es una estrategia de soporte. Mide y rutea; no decide qué intenciones puede resolver un agente. Ese trabajo de alcance es el template de agente de deflection de tickets.
  • No es un stack de customer success. Resolución no es retención — mira el stack de retención de clientes.
  • No escribe tu base de conocimiento. Cada capa aquí asume contenido que ya es correcto.
  • No reemplaza capacidad humana de escalamiento. Si el agente resuelve 40%, tus humanos siguen atendiendo 60%, y ahora les toca el 60% más difícil.

Puntos de cuidado, cada uno con su guardia

  • La unidad facturable de cada proveedor es distinta, y la definición se mueve. La de Zendesk cambió en mayo de 2026; la de Decagon se negocia por contrato. Guardia: consigue la definición de resolución por escrito antes de firmar, y vuelve a leerla en la renovación.
  • Contención no es resolución. Un cliente que se rinde queda contenido. Guardia: mide reaperturas dentro de siete días y CSAT en conversaciones atendidas por el agente como métrica pareja — mira CSAT.
  • La ventana de 72 horas retrasa tu ciclo de feedback. Un mal cambio de prompt tarda tres días en aparecer en el medidor. Guardia: observa la tasa de escalamiento de n8n, que se mueve en menos de una hora, como indicador adelantado.
  • Un hueco de resincronización deja al agente seguro y equivocado. Notion resincroniza cada 24 horas. Guardia: fuerza una resincronización manual ante cualquier cambio de política que afecte dinero o entitlements, y retén el cambio hasta que aterrice.
  • Escalamientos que llegan sin contexto son peores que no tener agente. Guardia: haz del payload de traspaso un esquema que n8n valide, y trata una validación fallida como falla de ruteo. Cuando uno salga mal, corre el RCA de escalamiento.

Reglas de encaje

Es la elección correcta cuando: manejas 2,000 conversaciones al mes o más, una parte real son intenciones tier-1 repetibles, y a alguien le van a pedir que defienda el número de deflection — un board, un CFO o una conversación de renovación. Encaja mejor entre 10 y 50 asientos de soporte, donde el volumen justifica el medidor y no hay un equipo de analítica que te construya uno.

Es la elección equivocada cuando: estás por debajo de unos cientos de tickets al mes, donde un centro de ayuda y un humano vacían la cola y el agente agrega un mantenimiento de políticas que nunca se paga solo. También es equivocada cuando tu volumen es abrumadoramente investigación técnica a medida en lugar de preguntas repetibles, y cuando nadie puede ser nombrado dueño de la base de conocimiento — ese hueco rompe el stack sin importar qué agente compres.

Si solo puedes hacer una cosa: levanta el log de escalamiento de n8n antes de encender el agente. Cuesta €60 al mes, toma una tarde, y es el único registro de este stack que no produjo tu proveedor del agente.