ooligo
STACK

Stack de ops com agentes de IA — agentes always-on sem engenharia

Um time de ops de 3 a 10 pessoas rodando agentes de IA always-on sobre o SaaS que já usa, com enriquecimento, um portão de aprovação e nenhum engenheiro no organograma.

Dificuldade
intermediário
Ferramentas
4
RevOpsLegal OpsRecrutamento e TA

A stack

O stack que um time de ops enxuto roda quando quer agentes que disparam em eventos em vez de uma janela de chat que alguém precisa lembrar de abrir. O Gumloop constrói e hospeda os agentes, o n8n move o trabalho entre sistemas e aplica o portão de aprovação, o Clay fornece os dados externos de que um agente precisa antes de decidir qualquer coisa, e o Slack é onde um humano diz sim ou não. Quatro ferramentas, cerca de $1,1K-$11K por ano, nenhum engenheiro no organograma.

A distinção que define se você precisa disso: não é um stack para automatizar passos fixos e conhecidos. Se os passos nunca mudam — copiar o campo A para o campo B quando um formulário dispara — o n8n sozinho faz isso mais barato e com mais confiabilidade. Este stack se paga quando o input não é estruturado e a decisão exige julgamento caso a caso: um email inbound que pode ou não ser uma demanda real, um CV contra um scorecard, um NDA com uma cláusula de indenização fora do padrão, uma thread de suporte que talvez seja sinal de churn.

Como as peças se encaixam

  • O Gumloop é a camada de agentes. Desde o reposicionamento de 2026 ele lidera com agentes e mantém o canvas visual embaixo: os agentes rodam em chat, no Slack, a partir de uma caixa de email do agente, ou em triggers de agenda e de evento, e chamam um workflow do canvas quando um passo deve ser repetível em vez de raciocinado. A escolha de modelo é por nó entre 35+ modelos, então um mesmo agente pode chamar o Claude para extrair cláusulas e um modelo mais barato para classificar na mesma execução. Sua superfície de recuperação, o Brain, indexa Notion, Google Drive, Slack, GitHub, Confluence, Zendesk e Salesforce, e para Drive e Salesforce herda as permissões de origem — um agente devolve só o que quem pergunta já conseguia abrir. O Gumloop não é o seu sistema de registro: ele lê, raciocina e emite.

  • O n8n é a camada de orquestração e de guarda-corpos. Todo handoff entre o Gumloop e o resto do seu SaaS é um workflow do n8n: ele recebe o output do agente, confere contra os limiares que você definiu, decide se a ação pode rodar sem supervisão ou precisa de um humano, escreve no sistema de registro e captura as falhas. É também onde vive a trilha de auditoria — o log de execuções do n8n é o registro do que um agente fez e por quê, o que importa na primeira vez que alguém perguntar.

  • O Clay é a camada de dados externos. Um agente raciocinando sobre um lead inbound, um candidato ou uma contraparte precisa de fatos que o evento disparador não contém: headcount, funding, stack de tecnologia, se aquele domínio já é cliente. O Clay faz cada busca em cascata pelo seu marketplace de provedores e, desde a mudança de medição de março de 2026, cobra só quando encontra. Sem ele, os agentes tomam decisões confiantes com base apenas em uma assinatura de email.

  • O Slack é a superfície de aprovação e auditoria. Toda ação do agente acima do limiar de autoridade é publicada em um canal como uma mensagem de aprovar/rejeitar antes de executar. Esse é o componente que os times pulam, e pular ele é a razão pela qual projetos de agentes sem supervisão são desligados no segundo mês — ninguém conseguia ver o que a coisa estava fazendo.

Handoffs nomeados

  1. Evento → triagem. Um email chega em uma caixa compartilhada, um formulário é enviado ou um arquivo cai em uma pasta → o agente do Gumloop extrai as entidades, classifica a solicitação e emite JSON estruturado com um valor de confiança.
  2. Entidade desconhecida → enriquecimento. O output do Gumloop cita uma empresa ou pessoa que ainda não está no seu CRM → o n8n dispara a execução da tabela do Clay → a linha enriquecida volta ao contexto do agente antes de ele recomendar uma ação.
  3. Recomendação → portão. O Gumloop devolve uma ação recomendada → o n8n avalia contra o limiar (se a confiança passa da régua e o valor fica abaixo do teto, executa sem supervisão; qualquer outro caso vai para o Slack como um card de aprovação com o raciocínio declarado do agente anexado).
  4. Aprovação → escrita. Um humano clica em aprovar no Slack → o n8n escreve no sistema de registro (CRM, ATS ou CLM) e publica o comprovante de volta na mesma thread, para que a decisão e sua consequência fiquem em um só lugar.
  5. Falha → responsável. Uma execução do agente dá erro, uma busca no Clay não retorna nada ou o consumo mensal de créditos cruza um teto → o workflow de erro do n8n alerta no Slack o responsável de ops nomeado em vez de falhar em silêncio.

Por que essa combinação

Cada ferramenta ocupa uma camada e as camadas não se sobrepõem: o Gumloop raciocina, o Clay fornece fatos, o n8n roteia e controla, o Slack sustenta o humano. Essa separação é o que torna o stack depurável por quem não é engenheiro — quando algo dá errado existe exatamente um lugar onde deu errado.

Vale nomear dois colapsos, porque os dois às vezes estão certos. O n8n sozinho consegue fazer tudo o que o Gumloop faz; o nó AI Agent conecta qualquer modelo a ferramentas e memória, e self-hosted é gratuito. O que você paga em troca são horas de construção e a exigência de que alguém consiga depurar um webhook quebrado às 18h. O Gumloop sozinho consegue chamar APIs diretamente e pular o n8n. O que você perde é o portão — lógica de aprovação, limiares, retries e roteamento de erro se espalham dentro de agentes individuais em vez de ficarem em uma camada que os impõe, o que é aceitável com dois agentes e ingerenciável com dez.

O Gumloop é a camada de agentes padrão aqui, e não um produto de assistente por seat, porque o plano dele inclui seats ilimitados e cobra por créditos compartilhados: deixar o time de ops inteiro construir sobre os mesmos agentes não custa nada a mais, e uma fila compartilhada é exatamente para isso que este stack existe.

Custo real

Faixas anuais para um time de ops de 3 a 10 pessoas, com base nas páginas de preço dos fornecedores consultadas em 2026-09-06:

  • Gumloop: ~$450-$3.000/ano. O Pro sai $37/mês com 20.000 créditos, seats ilimitados, 5 execuções simultâneas de workflow, 25 chats de agente simultâneos e um servidor MCP hospedado; o slider de créditos escala até 1,5M/mês. Não existe plano gratuito — ele foi retirado em 2026-07-30 em favor de um teste Pro de 14 dias. O Enterprise (enfileiramento de requisições, RBAC, SCIM/SAML, audit logs, VPC, hosting MCP sob medida) é só sob cotação.
  • n8n: ~$0-$800/ano. A Community Edition self-hosted é gratuita; reserve $20-40/mês de VPS. Na nuvem, o Starter sai €20/mês faturado anualmente por 2.500 execuções e o Pro €50/mês por 10.000. A cobrança é por execução de workflow independentemente da quantidade de passos, e os usuários são ilimitados em todos os planos. O Business, a €667/mês faturado anualmente, adiciona 40.000 execuções e deploy self-hosted; com menos de 20 funcionários ele sai com 50% de desconto pelo plano startup do n8n, que é o único desconto deste stack ao qual um time desse tamanho realmente se qualifica.
  • Clay: ~$0-$5.400/ano. Voltou um plano gratuito com 100 data credits e 500 actions por mês — dá para pilotar, não para operar. O Launch sai $185/mês ($167 faturado anualmente) por 3.000 data credits e 15.000 actions; o Growth sai $495/mês ($446 faturado anualmente) por 6.000 e 40.000. A cobrança roda em dois medidores — data credits para buscas em provedores e actions para execuções de IA e integrações — então um stack de agentes que chama o Clay em todo trigger queima os dois.
  • Slack: ~$450-$1.800/ano. O Pro sai $7,25/usuário/mês faturado anualmente ($8,75 no mensal); o Business+ sai $15/usuário/mês faturado anualmente. Só quem aprova coisas precisa de um seat pago.

Total: ~$1,1K-$11K/ano. O piso caiu desde a última vez que esta página precificou o stack, porque o Clay reintroduziu um plano gratuito e o self-hosting do n8n continua gratuito: um piloto de verdade hoje custa uma assinatura do Gumloop e cinco seats de Slack. O teto é onde um stack em produção aterrissa quando o Clay já mede volume real.

Orce o Gumloop contra a linha de crédito dele, não contra os $37. Os créditos são medidos a 1 crédito = $0,005, e um chat de agente cobra sobre cinco componentes: tokens de chat e de raciocínio, um mínimo de 1 crédito por chamada de ferramenta bem-sucedida, computação a 5 créditos por minuto de sessão, uma taxa de orquestração de 8% sobre esses três, e o custo cheio de qualquer workflow que o agente dispare. Só a computação já deixa uma sessão de agente de 60 minutos em 300 créditos antes de contar um token. Os workflows do canvas custam bem menos — 1 crédito para iniciar mais o custo por nó, a maioria dos nós nativos de graça, sem cobrança de computação nem de orquestração — o que é a razão concreta para tirar os trechos determinísticos do agente e colocá-los em um workflow que ele chame.

Os outros custos ocultos são os de sempre: 2-4 semanas do tempo de uma pessoa de ops para deixar os três primeiros agentes em um estado que você deixaria sem supervisão, a deriva contínua de créditos conforme os agentes ficam mais falantes, e o imposto de manutenção de um canvas do Gumloop que passa de uns 30 nós e deixa de ser legível.

O que este stack não substitui

  • Seu sistema de registro. Nada aqui armazena o estado de clientes, candidatos ou contratos. Os agentes agem sobre o seu CRM, ATS ou CLM; eles não viram um.
  • Engenharia, para qualquer coisa transacional. Movimentação de dinheiro, provisionamento e qualquer coisa que precise de um limite transacional real ou de um compromisso de uptime pertence a código com testes, não a um canvas hospedado.
  • Um data warehouse. O Clay enriquece registros em trânsito. Análise histórica, atribuição e reporting ainda precisam de um lugar para aterrissar.
  • A responsabilidade pela decisão. O portão de aprovação não transfere a responsabilidade para o agente. Quem clicou em aprovar é dono do resultado, e é exatamente por isso que o raciocínio precisa estar na mensagem do Slack e não enterrado em um log de execução.

Regras de match

Use este stack quando:

  • Seu trabalho de ops de maior volume começa como texto sem estrutura — caixas de entrada, candidaturas, tickets, contratos — e hoje alguém lê tudo isso.
  • Você tem uma pessoa de ops confortável em um canvas visual e capaz de ler JSON, mas não tem e não vai ter tempo de engenharia.
  • O volume é alto o suficiente para que a triagem humana item a item seja um custo real (aproximadamente 100+ itens por mês) e baixo o suficiente para que um erro seja recuperável e não um evento de compliance.
  • Você consegue nomear o limiar. Se você não consegue dizer o que um agente tem permissão de fazer sem supervisão, você não está pronto para rodar um sem supervisão.

Não use este stack quando:

  • Os passos são fixos e conhecidos. Use o n8n sozinho e coloque a economia em outro lugar.
  • A decisão é regulada — ação adversa sobre um candidato, uma posição jurídica, qualquer coisa com uma notificação legal atrelada. Agentes podem redigir e rotear; um humano decide, e a trilha de auditoria tem que mostrar isso.
  • Ninguém é dono disso. Um stack de agentes sem responsável nomeado se degrada em silêncio: os créditos sobem, a autenticação de uma integração expira, e a falha aparece como reclamação de cliente meses depois.
  • Você ainda está descobrindo qual é o processo. Agentes operacionalizam uma regra de decisão; eles não descobrem uma. Escreva ela na mão por um mês primeiro.

Pontos de atenção

  • O Slack agora é legível por agentes, não só por pessoas. O servidor MCP remoto do próprio Slack chegou a GA em 2026-02-17 em mcp.slack.com, com OAuth de token de usuário atrás de um fluxo de aprovação do admin do workspace, então um cliente aprovado lê e publica dentro das permissões do próprio usuário que autentica. O canal de aprovação não é mais uma superfície que só humanos veem. Proteção: mantenha as aprovações em um canal dedicado cuja composição você consiga nomear, e aprove os clientes MCP no nível de admin do workspace em vez de deixar cada um conectar o seu.
  • Trazer sua própria chave de modelo aumenta a taxa de plataforma do Gumloop em vez de reduzir. O BYOK tira os tokens de raciocínio do seu saldo de créditos mas move a orquestração de 8% para 16% dos créditos de chat, computação e chamadas de ferramenta. Proteção: rode o mesmo fluxo dos dois jeitos sobre um conjunto de teste de 10 linhas e leia o painel de créditos antes — o BYOK só ganha quando a sua tarifa negociada de modelo bate o pass-through por mais do que esses 8% extras.
  • O Gumloop Pro rejeita a concorrência excedente em vez de enfileirar. Passadas 5 execuções simultâneas de workflow a API devolve HTTP 429 e os chats de agente falham; o enfileiramento é recurso de Enterprise, então um lote de 500 linhas disparado como execuções paralelas perde trabalho em silêncio se nada tentar de novo. Proteção: escalone os triggers a partir do n8n, quebre os trabalhos grandes em subfluxos e construa retry em 429 em tudo que chamar a API.
  • O plano gratuito do Clay é orçamento de piloto, não de produção. 100 data credits por mês cobrem mais ou menos um dia de triagem real. Proteção: meça a taxa de acerto do passo de enriquecimento durante o piloto e dimensione Launch ou Growth a partir disso, em vez de descobrir o teto quando os agentes já estiverem decidindo sobre dados faltantes.

Variações comuns

  • Troque o Gumloop pelo Lindy quando o trabalho é a caixa de uma pessoa, não a fila de um time. O Lindy cobra por usuário — Plus a $29,99/mês por 3.000 créditos, Pro a $99,99 por 15.000, Max a $199,99 por 35.000 — com até 5 caixas conectadas e computer use em todos os planos, e créditos compartilhados no workspace. A regra: o email, a agenda e os follow-ups de um executivo → Lindy; uma fila compartilhada sobre a qual várias pessoas constroem → Gumloop, cujos seats são ilimitados.
  • Tire o Clay quando os agentes só tocam dados que já são seus. Triagem de tickets de suporte, revisão de contratos e trabalho com documentos internos não precisam de enriquecimento externo, e o Clay é a maior linha removível do stack. Coloque de volta no dia em que um agente começar a tomar decisões sobre empresas ou pessoas que ainda não estão no seu CRM.
  • Colapse para o n8n sozinho quando ganhar alguém que construa. Se uma contratação técnica entrar, o nó AI Agent absorve a camada do Gumloop e o custo recorrente cai para um VPS. Isso é um retrocesso real em quem consegue manter — faça quando a pessoa estiver no time, não quando estiver no plano de contratação.
  • Troque o Slack pelo Microsoft Teams. A superfície de aprovação tem o mesmo formato e o n8n tem um nó de Teams de primeira classe. O que você abre mão é do caminho MCP do Slack acima, então a leitura da thread de aprovação pelo agente volta a ser uma integração sob medida.

Para os padrões concretos de agentes que este stack roda, veja triagem de leads inbound, triagem de intake de NDA e enriquecimento de leads com Clay e Claude. Para o conceito por trás, agentes de IA para ops cobre o que separa um agente de um script agendado.