Qué es
Coveo es una capa de búsqueda y recuperación consciente de permisos que apuntas a tu propio contenido: un crawler y un índice, una capa de relevancia y ML encima, y respuestas generativas sobre esa base. La empresa (TSX: CVO, Quebec) la vende como AI-Relevance Platform en cuatro formas de despliegue: Commerce, Service, Website y Workplace. El modelo mental más cercano es la economía de búsqueda de cara al cliente de Algolia soldada al modelo de permisos de Glean, que es exactamente por lo que aparece cuando la licencia por asiento de Glean deja de tener sentido.
El mecanismo de permisos es lo primero que hay que entender. Coveo usa early binding: el crawler extrae la lista de control de acceso de cada elemento en el mismo momento en que extrae el contenido, y las identidades de seguridad permitidas o denegadas se guardan en el índice junto al documento. Las consultas se filtran contra esas identidades antes de rankear los resultados, en lugar de recuperarlos y comprobarlos después. Un proveedor de identidades de seguridad y una caché mantienen resoluble la pertenencia a grupos en tiempo de consulta.
El 10 de febrero de 2026 Coveo lanzó un servidor MCP alojado, en disponibilidad general, que expone Search, Fetch, Answer y Passage Retrieval como herramientas para ChatGPT Enterprise, Claude y otros modelos, con una app de Coveo publicada en el directorio de Apps and Connectors de ChatGPT Enterprise. Las consultas que pasan por ahí se facturan contra el entitlement de la suscripción existente y no como una línea nueva. Coveo fue nombrada Leader en el Gartner Magic Quadrant 2026 for Search and Product Discovery el 23 de junio de 2026.
En lo financiero es una empresa pública real y aburrida: en el Q1 del año fiscal 2027 (trimestre cerrado el 30 de junio de 2026, reportado el 30 de julio de 2026) tuvo ingresos de $38.5M, un 8% más interanual, EBITDA ajustado positivo de $0.1M, flujo de caja operativo de $9.2M y $107.1M en efectivo sin deuda. La guía para el año fiscal 2027 es de $160M-$164M de ingresos totales.
Por qué aparece en los stacks de ops
Porque es la respuesta a la pregunta sobre Glean desde la forma del precio, no desde las funcionalidades. Glean factura alrededor de $40-50 por usuario al mes con un piso de 100 asientos, y eso pone precio a los empleados. No le pone precio a los 200,000 visitantes anónimos que entran a tu portal de soporte, porque no son asientos. Los planes Service y Websites de Coveo se basan en entitlements —la unidad son 100,000 consultas al mes—, así que un visitante sin sesión cuesta una consulta, no una licencia.
La segunda razón es que un solo índice puede servir a tres audiencias. La documentación pública responde de forma anónima, los artículos de la base de conocimiento con derecho de acceso responden solo para el cliente cuyo contrato los cubre, y los runbooks internos responden solo para el agente en la consola, todo desde el mismo crawl, porque la ACL viajó con el elemento en el momento de indexar. Construir eso con un asistente interno por asiento más una herramienta de búsqueda pública aparte significa dos índices, dos modelos de relevancia y dos juegos de bugs de actualización de contenido.
Los propios números de Coveo dicen que los compradores se mueven en esa dirección: en el Q3 del año fiscal 2026 (trimestre cerrado el 31 de diciembre de 2025, reportado el 29 de enero de 2026), los ingresos por suscripción SaaS fueron de $36.6M, un 13% más, con la Platform principal en $35.8M, un 15% más; la empresa reportó el mayor volumen de nuevas ventas de su historia, con las soluciones de IA generativa impulsando más del 25% de las nuevas reservas y Commerce cerca de la mitad.
Un caso de uso que justifica comprarlo
Un área de soporte con un portal de autoservicio que mezcla contenido anónimo y con derecho de acceso, donde el objetivo de deflexión es real y el contenido ya vive en Salesforce, ServiceNow, Zendesk y SharePoint con los permisos ya modelados ahí. Indexas una vez, sirves la documentación pública al tráfico anónimo, condicionas los artículos restringidos a la identidad contractual del cliente, mantienes los runbooks solo para agentes, y luego apuntas el servidor MCP a ese mismo índice para que un despliegue interno de Claude o ChatGPT Enterprise responda desde el mismo contenido sin un segundo pipeline de recuperación.
Sobre deflexión: los primeros clientes de respuestas generativas de Coveo reportaron mejoras de deflexión de casos superiores al 20% en pruebas A/B. Es un dato reportado por el proveedor en comentarios de resultados, así que trátalo como el número que te van a citar en el ciclo de venta, no como el que vas a obtener.
Precios
Coveo no publica precios de lista. La página de precios describe planes basados en entitlements para Service y Websites, planes por asiento para Workplace y precios modulares para Commerce. La unidad base son 100,000 consultas al mes. Relevance Generative Answering mide Generative Queries per Month en un contador aparte, y la Passage Retrieval API mide Passage Queries per Month en un tercero. Existe una prueba gratuita; la cotización sigue pasando por ventas.
Datos de terceros sobre compradores (Vendr) sitúan el contrato anual promedio alrededor de $34,700, con despliegues que van desde unos $30K al año para un módulo único hasta bastante más de $500K en implantaciones enterprise multimódulo con alto volumen de consultas. Presupuesta $35K-$60K al año para un módulo, y seis cifras una vez que Commerce y las respuestas generativas están ambos en producción.
El medidor que hay que modelar antes de firmar es el reparto entre contadores. Un portal con 1M de búsquedas al mes donde el 10% escala a una respuesta generativa son diez unidades de búsqueda más una unidad generativa, no once de lo mismo. Como contraste, Algolia publica alrededor de $0.50 por cada 1,000 solicitudes de búsqueda en Grow, que suben a unos $0.75 por cada 1,000 con funciones de IA, y cerca de $50K al año en su nivel superior con compromiso anual. Ese es el piso que Coveo tiene que superar en búsqueda de sitio simple.
Ideal para
Líderes de soporte, autoservicio y comercio digital en empresas donde el contenido ya está protegido por ACL en un sistema de registro y la audiencia mezcla visitantes anónimos, clientes con derecho de acceso y agentes internos. La economía funciona por encima de unos $100M de ingresos, o allí donde una mejora de deflexión del 20% sobre el volumen de tickets supere un piso anual de más de $35K.
No lo compres solo como asistente interno para empleados. Si el único trabajo es que 300 empleados conversen con el conocimiento de la empresa, Glean o Microsoft 365 Copilot es un camino más corto y el precio por asiento de Workplace renuncia a la ventaja que te hizo mirar a Coveo. Tampoco lo compres para un sitio de documentación de 40 páginas: el costo de implementación supera con creces el problema.
Alternativas y cuándo elegirlas
- Glean — el líder por base instalada en búsqueda empresarial interna y el punto de comparación en casi toda evaluación de Coveo. Elígelo cuando la audiencia sea exclusivamente de empleados, el número de asientos supere 100 y la experiencia de asistente lista para usar pese más que la economía unitaria. Pierde en cuanto una parte relevante de tu tráfico es anónima.
- Algolia — el incumbente por cuota de mercado en búsqueda de sitio y de producto de cara al cliente. Elígelo cuando el trabajo sea búsqueda y descubrimiento sin complejidad de ACL: precios públicos, más rápido de lanzar y bastante más barato con volúmenes bajos de consultas. Elige Coveo en el momento en que los resultados tengan que diferir según quién pregunta.
- Onyx — el entrante de crecimiento más rápido del segmento, open source y autoalojable. Elígelo cuando la residencia de datos o el control de costos exijan operar el stack por tu cuenta y tengas a alguien de ingeniería que lo mantenga. Cambias la flota de conectores gestionados y el ajuste de relevancia por control.
- Inkeep o eesel AI — elige cualquiera de los dos cuando el alcance sea solo documentación y respuestas de soporte, el contenido sea público y quieras estar en producción en días. Ninguno intenta resolver el problema de permisos con audiencias mixtas.
Puntos de atención
- El early binding convierte la frescura de los permisos en un problema de indexación, no de consulta. Una cuenta revocada sigue siendo efectiva hasta que la caché de identidades de seguridad y la actualización de la fuente se ponen al día. Guarda: ajusta la cadencia de refresco del proveedor de identidades al SLA de offboarding y prueba con una cuenta realmente revocada antes del go-live, no con un usuario de prueba que desactivaste en el portal.
- Dos medidores facturan sobre la misma vista de página. Los equipos dimensionan el entitlement de búsqueda, lanzan respuestas generativas en todas las consultas y descubren que el contador generativo es el caro. Guarda: modela ambos contadores contra el tráfico real del portal durante el piloto y limita las respuestas generativas a consultas con intención cualificada en vez de dispararlas en cada búsqueda.
- La implementación es un proyecto con un partner, no un interruptor. La configuración de conectores, el mapeo de permisos y el ajuste de relevancia llevan semanas, y buena parte de la entrega pasa por partners de implementación. Guarda: incluye el SOW, el partner nombrado y la fecha de go-live en el mismo contrato que la licencia, con la primera renovación contada desde el go-live y no desde la firma.
- El crecimiento se está desacelerando y los márgenes están en el punto de equilibrio. El crecimiento de suscripción SaaS del 13% en el Q3 del año fiscal 2026 dio paso a un 8% de crecimiento de ingresos totales en el Q1 del año fiscal 2027, con EBITDA ajustado en $0.1M. Guarda: el balance responde la pregunta de solvencia —$107.1M en efectivo, sin deuda—, así que trátalo como riesgo de ritmo de roadmap y no de proveedor, y negocia un plazo multianual con protección de precio en lugar de apostar a una cotización de un solo año.