Conversation intelligence é o software que grava calls e reuniões de vendas, transcreve tudo e roda análise sobre o corpus inteiro de gravações, não apenas sobre a call em que você esteve. Essa análise produz três coisas que uma gravação sozinha não entrega: detecção de temas pesquisável em toda call que seu time já fez, sinais de risco de negócio consolidados no pipeline e scorecards de coaching amarrados a comportamentos específicos do rep. A gravação é o insumo. A análise entre calls é o produto, e é a única parte que justifica preço enterprise.
Não é um anotador com IA. Fathom, Granola e Otter capturam e resumem uma reunião para quem estava nela, e o artefato termina no limite daquela reunião. Conversation intelligence responde perguntas que só existem ao longo de centenas de calls: quantas vezes os reps tocaram no novo pricing do concorrente no trimestre passado e o que aconteceu com esses negócios. Também não é revenue intelligence — dados de conversa são um insumo do forecast, não o forecast — nem é speech analytics de contact center, que pontua interações de suporte contra uma rubrica de QA e compliance em vez de contra o avanço do negócio.
As quatro camadas
Captura e transcrição. Um bot entra pelo convite do calendário, ou o fornecedor captura pela API da plataforma de conferência sem bot nenhum. A diarização separa a transcrição por participante. Essa camada é quase commodity: todo fornecedor da categoria resolve, e não é aí que mora a diferença de preço.
Detecção de temas e trackers. É aqui que um gravador vira conversation intelligence. A Gong separa em dois mecanismos: keyword trackers dão match no termo literal, enquanto smart trackers são modelos que detectam o conceito independentemente das palavras, de modo que “é o melhor que você consegue fazer?” registra como pedido de desconto sem a palavra desconto aparecer (Gong Help Center). A distinção pesa na hora de comprar, porque uma implementação só de keywords parece idêntica numa demo e perde a maior parte do que deveria pegar.
Risco de negócio. A plataforma lê sinais de comportamento na conversa e no registro de atividade — sem próximo passo combinado, engajamento com um único contato, comprador que sumiu, concorrente citado tarde no ciclo, etapa travada — e expõe isso contra o pipeline aberto, não contra calls individuais.
Scorecards de coaching. Um gestor pontua uma call contra uma rubrica e as notas agregam por rep, time e pergunta. A IA já preenche isso: os scorecards de revisão automática da Gong revisam toda call que casa com um filtro, com teto de 90 dias para trás, disponíveis para times nos planos Enable Essentials ou Enable (Gong Help Center).
Quanto custa
Dois formatos de pricing, e confundir os dois é como o orçamento estoura.
Fornecedores mid-market publicam um preço por assento que exclui a análise. A Avoma lista Startup a US$ 19 por usuário/mês no anual, Organization a US$ 24 e Enterprise a US$ 39 com mínimo de 10 assentos, e então vende Conversation Intelligence como add-on de US$ 29 por assento (US$ 35 na cobrança mensal), com Revenue Intelligence por mais US$ 29 (pricing da Avoma, verificado em 19 de agosto de 2026). Um rep que precisa das camadas de coaching e de negócio custa de US$ 48 a US$ 77 por assento, não US$ 19. Confira essa mesma divisão em toda proposta da categoria.
Conversation intelligence enterprise é cotada sob demanda. Os dados de benchmark da Vendr colocam o contrato mediano da Gong em US$ 54.900 por ano sobre 593 compras registradas, com faixa observada de US$ 11.184 a US$ 204.033 (marketplace da Vendr, última atualização em março de 2026). Peça a proposta separada em platform fee e licenças por assento antes de comparar com qualquer coisa, e peça por escrito qual é o reajuste na renovação.
Quão precisa ela é, de verdade
São duas perguntas de precisão e o comprador costuma fazer só a primeira.
Precisão de transcrição é mensurável e está em grande parte resolvida. Uma comparação revisada por pares de 11 serviços de ASR sobre áudio de aulas em inglês mediu taxas de erro de palavra de 2,9 por cento (Whisper large-v2) a 20,1 por cento (Google), com média de 7,0 por cento, e de 10,2 por cento para falantes não nativos de inglês contra 7,0 por cento para nativos (Measuring the Accuracy of Automatic Speech Recognition Solutions). Áudio de aula é um único falante com microfone decente. Uma call de quatro pessoas com gente falando por cima e microfone de notebook é mais difícil, então trate qualquer número de precisão do fornecedor como afirmação sobre o caso fácil e teste nas suas próprias gravações, pesando os sotaques e o vocabulário de produto que seu time realmente usa.
Precisão de análise é a que custa dinheiro, e a documentação do fornecedor fala isso em voz alta. A própria página da Gong sobre revisão automática de scorecards afirma que “às vezes, a IA produz saídas diferentes para entradas idênticas”, e chama isso de comportamento esperado. Uma nota de rubrica que muda entre execuções na mesma call não pode ser insumo de uma conversa de performance sem um humano confirmando. Peça a todo fornecedor que pontue as mesmas 20 calls duas vezes e mostre a dispersão.
O bloqueio do rollout é consentimento, não orçamento
Gravar uma call num estado dos EUA com consentimento de todas as partes, sem o consentimento de cada participante, é uma questão de wiretap, não uma preferência de política interna. Cerca de uma dúzia de estados exigem consentimento de todas as partes, e as regras não são uniformes dentro deles: Connecticut trata chamadas telefônicas de forma diferente de conversas presenciais, e Oregon trata comunicações orais de forma diferente das eletrônicas. Para um time de vendas distribuído, a premissa segura é que toda semana alguma call tem participante em um desses estados.
O caso de teste vivo é In re Otter.AI Privacy Litigation, No. 5:25-cv-06911 (N.D. Cal.), consolidado a partir de ações ajuizadas desde agosto de 2025, alegando que o anotador OtterPilot gravou reuniões apenas com o consentimento do anfitrião, sob a Wiretap Act federal e a California Invasion of Privacy Act. A juíza Eumi K. Lee ouviu a moção de arquivamento em 20 de maio de 2026 e não havia decidido até 19 de agosto de 2026, então nenhum tribunal declarou essas práticas lícitas ou ilícitas ainda. Três guardas independem do resultado: ligue o aviso de gravação pré-reunião do fornecedor, dê aos participantes um caminho de recusa que de fato interrompa a captura e não apenas silencie o resumo, e leia a cláusula que define se seus dados de call treinam os modelos do fornecedor.
O que mudou em 2026
A Gong anunciou o Gong Enable em 25 de fevereiro de 2026 e o Gong Revenue Harness em 24 de junho de 2026: uma camada de execução agêntica construída sobre o Agent Studio e o suporte a MCP, com Custom Agents que RevOps configura sem engenharia (release da Gong). A ZoomInfo expõe os dados de call do Chorus por uma ferramenta conversation_intelligence no seu MCP server, de modo que um agente consegue raciocinar sobre calls, emails e transcrições indexadas.
A direção é a mesma em todos os fornecedores: o corpus de calls está virando fonte de dados consultável por agentes em vez de biblioteca que gestor visita para assistir clipes. Isso move a pergunta de compra de quem tem a transcrição mais limpa para quem vai deixar seus agentes lerem o corpus, e sob quais scopes: o gêmeo de leitura da decisão em Acesso de escrita MCP ao CRM.
Erros comuns
- Comprar como gravador e nunca configurar trackers. A plataforma grava, ninguém pesquisa e a renovação chega com dados de uso que justificam rebaixar o plano. Guarda: suba cinco trackers na primeira semana amarrados a negócios vivos — concorrente principal, objeção de preço, revisão de segurança, saída do champion, procurement — e revise na reunião semanal de pipeline.
- Trackers configurados uma vez e nunca ajustados. Guarda: revise as taxas de disparo a cada trimestre. Um tracker que dispara em menos de 1 por cento das calls não está medindo nada; um que dispara em mais de 60 por cento mede a linguagem que todo mundo usa mesmo.
- Scorecards ligados à gestão de performance antes de calibrar. Guarda: pontue a mesma amostra de 20 calls com dois gestores e com a IA, e publique a taxa de concordância antes de qualquer nota chegar a uma avaliação. Onde eles discordam, o problema é a rubrica, não o rep.
- Medir adoção por taxa de gravação. Toda call é gravada desde o primeiro dia; esse número prova que o bot funciona, não que alguém aprendeu algo. Guarda: acompanhe buscas feitas e clipes compartilhados por gestor por semana.
- Sem política de retenção nem de exclusão. Gravações de negociação de preço, desligamentos e discussões jurídicas ficam no corpus indefinidamente e viram material passível de produção em litígio. Guarda: defina uma janela de retenção e exclua tipos de reunião por palavra-chave do calendário já na captura.
Relacionado
- Venda baseada em sinais — as plays que os dados de conversa deveriam disparar
- Categorias de forecast explicadas — onde os sinais de risco aterrissam no forecast
- Interview intelligence — a mesma tecnologia aplicada a contratação, com outra rubrica e outro regulador
- GTM context layer — no que os fornecedores estão transformando o corpus de calls
- AE rep coaching skill — um Claude Skill para virar análise de call em plano de coaching