ooligo
STACK

Stack de agente de suporte com IA — um medidor de resoluções auditável e uma rota de escalonamento que é sua

Um time de suporte colocando um agente de IA em produção e precisando que o número da fatura, o número do board deck e o número de clientes de fato atendidos sejam o mesmo número.

Dificuldade
intermediário
Ferramentas
7
Customer Success

A stack

Em 18 de maio de 2026, a Zendesk mudou o que a palavra “resolvido” significa. Ela dividiu os resultados automatizados em três categorias — resoluções contidas, escalonamentos assistidos e resoluções verificadas — e deixou só a terceira como faturável. Uma resolução verificada é uma conversa que um LLM confirmou ter sido realmente atendida, avaliada no fim da janela de sessão, que por padrão são 72 horas após a primeira mensagem. Antes dessa mudança, um cliente que fazia uma pergunta e depois ficava em silêncio por três dias contava como resolução e consumia a sua franquia.

Nenhum agente ficou melhor naquela semana. O medidor mudou. É esse o problema em torno do qual este stack foi montado: em todo deploy de suporte com IA, o número que chega ao seu board deck é produzido pelo fornecedor que está sendo pago por ele, e cada fornecedor define a unidade faturável de um jeito diferente. Este stack é uma composição em que a afirmação de resolução dá para conferir, a rota de escalonamento não pertence ao fornecedor do agente, e você consegue ver o que o cliente fez depois que a conversa terminou.

O formato

  • Zendesk ou Pylon é o sistema de registro. Toda conversa que o agente toca vira um ticket com a thread inteira anexada, porque a auditoria que você vai acabar rodando é uma consulta de tickets, não um export do dashboard do fornecedor. Zendesk é o default para volume de consumo e multicanal. Pylon é a escolha quando o seu suporte acontece de verdade em canais compartilhados de Slack e Teams com contas nomeadas — uma motion B2B em que o “ticket” é uma thread dentro do workspace do próprio cliente. A Pylon tirou o preço por assento publicado e colocou atrás de uma demo, então trate como linha só sob cotação.
  • Fin (Intercom) ou Decagon é a camada de resolução. Um agente, resolvendo ponta a ponta e executando a ação no backend em vez de responder a partir de um artigo. O Fin é medido a US$ 0,99 por resultado com um mínimo mensal de 50 resultados; a Decagon não publica preço e é reportada começando por volta de uma taxa de plataforma anual de US$ 50.000 antes do consumo. O head-to-head completo está em Decagon vs Fin.
  • Notion é a base de conhecimento, e é um componente e não um documento. O Fin conecta o Notion como fonte de conteúdo nativa, ressincroniza a cada 24 horas e não deixa você editar esse conteúdo dentro do Fin — as mudanças são feitas no Notion. Essa restrição é a vantagem. Ela força um dono só e um lugar só onde uma política de reembolso muda, que é a única razão pela qual as respostas do agente continuam batendo com o que os seus humanos dizem.
  • Pendo mede o que o medidor do fornecedor estruturalmente não consegue. O Agent Analytics instrumenta a superfície conversacional dentro do seu próprio produto e conecta com analytics comportamental e session replay, reportando volume de prompts, retenção, taxa de prompts sugeridos e onde as conversas quebram. A Pendo reporta medir mais de 350 agentes e 2,5 milhões de prompts por semana. O medidor do fornecedor diz que uma conversa terminou; o Pendo diz se a mesma pessoa voltou e abriu um ticket 20 minutos depois.
  • n8n é dono da rota de escalonamento e do segundo log. Todo escalonamento dispara um workflow que grava o próprio registro — timestamp, intenção, a confiança do agente, o motivo do repasse — em um store que o fornecedor do agente não controla. É a camada mais barata do stack e a que torna uma disputa de faturamento vencível.

Repasses nomeados

  1. A política muda no Notion → as respostas do agente mudam em até 24 horas. Uma página, um dono, uma ressincronização. Sem cópia paralela no editor do próprio agente para divergir.
  2. O cliente abre uma conversa → o agente tenta resolver → o sistema de registro recebe um ticket de qualquer jeito. Contida, escalada ou resolvida, a thread existe no Zendesk ou no Pylon. Um agente que resolve conversas de forma invisível é um agente que você não consegue auditar.
  3. O agente repassa → o n8n roteia e registra. O workflow atribui a fila, anexa o payload de repasse e grava o registro independente de escalonamento antes de um humano ver.
  4. A janela de sessão fecha → o fornecedor marca o resultado → o n8n reconcilia. Uma vez por mês, compare resoluções faturadas com escalonamentos registrados e tickets reabertos em até sete dias. Uma resolução que gerou reabertura é uma questão de faturamento, não um sucesso.
  5. A conversa com o agente in-product termina → o Pendo leva o journey adiante até os dados de retenção e adoção, que é onde o número honesto de deflection finalmente aparece.

A bifurcação que decide o custo

Os dois agentes rodam sobre Zendesk, então esta não é uma decisão de migração. É uma decisão sobre qual medidor você compra, e existe uma trava que vale conhecer antes de precificar qualquer coisa.

O Fin para Zendesk messaging exige a Sunshine API, que só está incluída no Zendesk Suite Professional, Enterprise e Enterprise Plus. O Suite Professional é US$ 115 por agente por mês no pagamento anual, contra o Suite Team a US$ 55. Se o seu deploy do Fin for só email e tickets de formulário de contato, o Fin pode ser atribuído como agente em tickets do Zendesk sem essa trava. No momento em que você quiser o Fin em messaging web, mobile ou WhatsApp, a sua conta de helpdesk praticamente dobra. Precifique isso antes de precificar o agente.

A segunda regra é mais simples: rode um medidor só. A Zendesk cobra US$ 1,50 por resolução automatizada comprometida e US$ 2,00 pay-as-you-go, com franquias de 5, 10 ou 15 resoluções automatizadas por agente por mês conforme o plano. O Fin cobra US$ 0,99 por resultado. Se o Fin resolve, a sua franquia de resoluções da Zendesk fica sem uso e você pagou por um medidor que não está lendo. Escolha o agente e depois compre o plano que aquele agente precisa — não os dois.

A realidade do custo

Um time de suporte de SaaS B2B com 12 assentos, 6.000 conversas por mês e uma taxa de resolução realista de 40% — 2.400 resoluções por mês:

  • Agente nativo da Zendesk: Suite Professional a US$ 115 × 12 assentos = US$ 16.560/ano. A franquia é de 10 resoluções por agente por mês, então 120 cobertas e 2.280 faturadas a US$ 1,50 = US$ 41.040/ano. Total ≈ US$ 57.600/ano.
  • Fin sobre Zendesk: o mesmo piso de helpdesk de US$ 16.560 se você precisar de messaging, mais 2.400 × US$ 0,99 = US$ 28.512/ano. Total ≈ US$ 45.000/ano, e a franquia da Zendesk fica sem uso.
  • Decagon: a taxa reportada de ~US$ 50.000 de plataforma cai antes de uma única resolução, então ela compete em preço unitário só quando o volume passa bem longe deste exemplo.
  • n8n Pro: € 60 por mês para 10.000 execuções, cerca de € 720/ano, um erro de arredondamento perto da linha do agente.
  • Pendo: preço por MAU e só sob cotação acima do tier gratuito. Consiga o número antes de assumir que a camada de medição é de graça.

A linha sem preço é a base de conhecimento. Alguém tem que ser dono dela. Reserve orçamento para um dono nomeado em tempo parcial; uma base de conhecimento desatualizada é o jeito mais confiável de transformar um resultado de US$ 0,99 em um ticket reaberto que você ainda paga um humano para atender.

Variações e quando trocar

  • Pylon no lugar do Zendesk quando mais da metade do seu volume chega em canais compartilhados de Slack ou Teams. Não troque para uma motion web e mobile voltada ao consumidor — você estaria comprando um modelo centrado em contas para tráfego anônimo.
  • Tire o Pendo se o seu agente vive só em um widget web e email, sem superfície in-product. Não há journey para instrumentar, e o medidor do fornecedor mais o log do n8n bastam. Mantenha no momento em que o agente estiver embutido na sua aplicação.
  • Troque o n8n por triggers nativos do helpdesk com volume baixo de escalonamento. A regra: fique com o n8n quando precisar que o log viva em um lugar que o fornecedor do agente não possa reescrever, ou quando o roteamento depender de dados de um terceiro sistema.

O que este stack não substitui

  • Não é uma estratégia de suporte. Ele mede e roteia; não decide quais intenções um agente pode resolver. Esse trabalho de escopo é o template de agente de deflection de tickets.
  • Não é um stack de customer success. Resolução não é retenção — veja o stack de retenção de clientes.
  • Não escreve a sua base de conhecimento. Toda camada aqui assume conteúdo que já está correto.
  • Não substitui capacidade humana de escalonamento. Se o agente resolve 40%, os seus humanos continuam atendendo 60%, e agora pegam os 60% mais difíceis.

Pontos de atenção, cada um com a sua guarda

  • A unidade faturável de cada fornecedor é diferente, e a definição se move. A da Zendesk mudou em maio de 2026; a da Decagon é negociada por contrato. Guarda: consiga a definição de resolução por escrito antes de assinar, e releia na renovação.
  • Contenção não é resolução. Um cliente que desiste fica contido. Guarda: acompanhe reaberturas em até sete dias e CSAT nas conversas atendidas pelo agente como métrica par — veja CSAT.
  • A janela de 72 horas atrasa o seu ciclo de feedback. Uma mudança ruim de prompt leva três dias para aparecer no medidor. Guarda: olhe a taxa de escalonamento do n8n, que se move em menos de uma hora, como indicador antecedente.
  • Um buraco de ressincronização deixa o agente confiante e errado. O Notion ressincroniza a cada 24 horas. Guarda: force uma ressincronização manual em qualquer mudança de política que afete dinheiro ou entitlements, e segure a mudança até ela entrar.
  • Escalonamentos que chegam sem contexto são piores do que não ter agente. Guarda: faça do payload de repasse um schema que o n8n valida, e trate uma validação falha como falha de roteamento. Quando um der errado, rode o RCA de escalonamento.

Regras de encaixe

É a escolha certa quando: você roda 2.000 conversas por mês ou mais, uma parcela real delas são intenções tier-1 repetíveis, e alguém vai ser chamado para defender o número de deflection — um board, um CFO ou uma conversa de renovação. Encaixa melhor entre 10 e 50 assentos de suporte, onde o volume justifica o medidor e não existe um time de analytics para construir um para você.

É a escolha errada quando: você está abaixo de algumas centenas de tickets por mês, onde um help center e um humano zeram a fila e o agente adiciona uma manutenção de política que nunca se paga. Também é errada quando o seu volume é majoritariamente investigação técnica sob medida em vez de perguntas repetíveis, e quando ninguém pode ser nomeado dono da base de conhecimento — esse buraco quebra o stack independentemente de qual agente você comprar.

Se você só puder fazer uma coisa: suba o log de escalonamento do n8n antes de ligar o agente. Custa € 60 por mês, leva uma tarde, e é o único registro deste stack que o fornecedor do seu agente não produziu.