Was es ist
Coveo ist eine berechtigungsbewusste Such- und Retrieval-Schicht, die Sie auf Ihre eigenen Inhalte richten: ein Crawler und ein Index, darüber eine Relevanz- und ML-Schicht und darüber generative Antworten. Das Unternehmen (TSX: CVO, Quebec) verkauft das als AI-Relevance Platform in vier Deployment-Formen: Commerce, Service, Website und Workplace. Das nächstliegende mentale Modell ist die kundenseitige Such-Ökonomie von Algolia, verschweißt mit dem Berechtigungsmodell von Glean — genau deshalb taucht Coveo auf, sobald Gleans Lizenz pro Sitzplatz keinen Sinn mehr ergibt.
Der Berechtigungsmechanismus ist das Erste, was Sie verstehen sollten. Coveo arbeitet mit Early Binding: Der Crawler holt die Zugriffskontrollliste eines Elements im selben Moment wie den Inhalt, und die erlaubten oder verweigerten Security Identities werden zusammen mit dem Dokument im Index abgelegt. Anfragen werden gegen diese Identities gefiltert, bevor Ergebnisse gerankt werden, statt sie erst zu holen und dann zu prüfen. Ein Security Identity Provider und ein Cache halten Gruppenzugehörigkeiten zur Abfragezeit auflösbar.
Am 10. Februar 2026 hat Coveo einen gehosteten MCP-Server allgemein verfügbar gemacht, der Search, Fetch, Answer und Passage Retrieval als Tools für ChatGPT Enterprise, Claude und weitere Modelle bereitstellt, mit einer Coveo-App im Apps-and-Connectors-Verzeichnis von ChatGPT Enterprise. Abfragen darüber werden gegen das bestehende Subscription-Entitlement abgerechnet und nicht als neue Position. Coveo wurde am 23. Juni 2026 als Leader im Gartner Magic Quadrant 2026 for Search and Product Discovery benannt.
Finanziell ist das ein echtes, unaufgeregtes börsennotiertes Unternehmen: Im ersten Quartal des Geschäftsjahres 2027 (Quartal zum 30. Juni 2026, berichtet am 30. Juli 2026) lag der Umsatz bei $38.5M, ein Plus von 8% gegenüber dem Vorjahr, das bereinigte EBITDA bei positiven $0.1M, der operative Cashflow bei $9.2M, dazu $107.1M Cash ohne Schulden. Die Prognose für das Geschäftsjahr 2027 liegt bei $160M-$164M Gesamtumsatz.
Warum es in Ops-Stacks auftaucht
Weil es die Antwort auf die Glean-Frage über die Form des Preises ist, nicht über Funktionen. Glean berechnet rund $40-50 pro Nutzer und Monat bei einer Untergrenze von 100 Sitzplätzen, und das bepreist Mitarbeitende. Es bepreist nicht die 200.000 anonymen Besucher auf Ihrem Support-Portal, denn die sind keine Sitzplätze. Die Pläne Service und Websites von Coveo sind Entitlement-basiert — die Einheit sind 100.000 Abfragen pro Monat —, ein nicht angemeldeter Besucher kostet also eine Abfrage und keine Lizenz.
Der zweite Grund: Ein einziger Index kann drei Zielgruppen bedienen. Öffentliche Doku antwortet anonym, berechtigungspflichtige Knowledge-Base-Artikel antworten nur für den Kunden, dessen Vertrag sie abdeckt, interne Runbooks nur für den Agent in der Konsole — alles aus demselben Crawl, weil die ACL beim Indexieren mit dem Element mitgereist ist. Dasselbe mit einem internen Assistenten pro Sitzplatz plus separatem öffentlichem Suchwerkzeug zu bauen bedeutet zwei Indizes, zwei Relevanzmodelle und zwei Sätze von Bugs bei der Inhaltsaktualität.
Coveos eigene Zahlen sagen, dass Käufer sich in diese Richtung bewegen: Im dritten Quartal des Geschäftsjahres 2026 (Quartal zum 31. Dezember 2025, berichtet am 29. Januar 2026) lag der SaaS-Subscription-Umsatz bei $36.6M, ein Plus von 13%, die Kern-Platform bei $35.8M, ein Plus von 15%; das Unternehmen meldete das höchste Neugeschäftsvolumen seiner Geschichte, wobei generative KI-Lösungen über 25% der neuen Buchungen trieben und Commerce knapp die Hälfte.
Ein Use Case, für den sich der Kauf lohnt
Eine Support-Organisation mit einem Self-Service-Portal, das anonyme und berechtigungspflichtige Inhalte mischt, in der das Deflection-Ziel real ist und die Inhalte bereits in Salesforce, ServiceNow, Zendesk und SharePoint liegen, mit dort schon modellierten Berechtigungen. Einmal crawlen, öffentliche Doku an anonymen Traffic ausliefern, die geschützten Artikel an die Vertragsidentität des Kunden binden, Agent-Runbooks agentenintern halten — und dann den MCP-Server auf denselben Index richten, damit ein interner Claude- oder ChatGPT-Enterprise-Rollout aus denselben Inhalten antwortet, ohne eine zweite Retrieval-Pipeline.
Zur Deflection: Coveos frühe Kunden für generative Antworten meldeten Verbesserungen der Case Deflection von über 20% in A/B-Tests. Das ist eine Herstellerangabe aus Earnings-Kommentaren — behandeln Sie sie als die Zahl, die Ihnen im Vertriebszyklus genannt wird, nicht als die, die Sie erreichen werden.
Preise
Coveo veröffentlicht keine Listenpreise. Die Preisseite beschreibt Entitlement-basierte Pläne für Service und Websites, Pläne pro Sitzplatz für Workplace und modulare Preise für Commerce. Die Basiseinheit sind 100.000 Abfragen pro Monat. Relevance Generative Answering zählt Generative Queries per Month auf einem eigenen Zähler, die Passage Retrieval API zählt Passage Queries per Month auf einem dritten. Es gibt eine kostenlose Testphase; ein Angebot läuft weiterhin über den Vertrieb.
Käuferdaten von Dritten (Vendr) verorten den durchschnittlichen Jahresvertrag bei rund $34,700, mit Deployments von etwa $30K pro Jahr für ein einzelnes Modul bis deutlich über $500K für Multi-Modul-Enterprise-Landschaften mit hohem Abfragevolumen. Planen Sie $35K-$60K pro Jahr für ein Modul ein und einen sechsstelligen Betrag, sobald Commerce und generative Antworten beide produktiv sind.
Der Zähler, den Sie vor der Unterschrift modellieren müssen, ist die Aufteilung zwischen den Metern. Ein Portal mit 1M Suchen pro Monat, bei dem 10% zu einer generativen Antwort eskalieren, sind zehn Such-Einheiten plus eine generative Einheit — nicht elf von derselben Sorte. Zum Vergleich: Algolia veröffentlicht rund $0.50 pro 1.000 Suchanfragen im Grow-Plan, mit KI-Funktionen etwa $0.75 pro 1.000, und rund $50K pro Jahr für die oberste Stufe mit Jahresbindung. Das ist die Untergrenze, die Coveo bei reiner Site-Suche schlagen muss.
Am besten geeignet für
Verantwortliche für Support, Self-Service und Digital Commerce in Unternehmen, in denen Inhalte bereits per ACL in einem führenden System geschützt sind und die Zielgruppe aus anonymen Besuchern, berechtigten Kunden und internen Agents gemischt ist. Die Rechnung geht oberhalb von etwa $100M Umsatz auf, oder überall dort, wo ein Deflection-Gewinn von 20% auf das Ticketvolumen eine jährliche Untergrenze von über $35K übersteigt.
Kaufen Sie es nicht als reinen internen Mitarbeiter-Assistenten. Wenn die einzige Aufgabe darin besteht, 300 Mitarbeitende mit dem Unternehmenswissen chatten zu lassen, sind Glean oder Microsoft 365 Copilot der kürzere Weg, und der Sitzplatzpreis von Workplace gibt genau den Vorteil auf, wegen dem Sie hingeschaut haben. Kaufen Sie es auch nicht für eine Doku-Website mit 40 Seiten: Der Implementierungsaufwand übersteigt das Problem bei Weitem.
Alternativen und wann Sie sie stattdessen wählen
- Glean — der Marktführer nach installierter Basis bei interner Unternehmenssuche und der Vergleichspunkt in den meisten Coveo-Evaluierungen. Wählen Sie es, wenn die Zielgruppe ausschließlich aus Mitarbeitenden besteht, die Sitzplatzzahl über 100 liegt und die fertige Assistenten-UX schwerer wiegt als die Stückkosten. Es verliert in dem Moment, in dem ein relevanter Teil Ihres Traffics anonym ist.
- Algolia — der Marktanteilsführer bei kundenseitiger Site- und Produktsuche. Wählen Sie es, wenn die Aufgabe Suche und Discovery ohne ACL-Komplexität ist: veröffentlichte Preise, schneller live, bei niedrigem Abfragevolumen deutlich günstiger. Wählen Sie Coveo in dem Moment, in dem Ergebnisse davon abhängen müssen, wer fragt.
- Onyx — der am schnellsten wachsende Neueinsteiger im Segment, Open Source und selbst hostbar. Wählen Sie es, wenn Datenresidenz oder Kostenkontrolle den Eigenbetrieb erzwingen und Sie jemanden aus dem Engineering haben, der das übernimmt. Sie tauschen die verwaltete Connector-Flotte und das Relevanz-Tuning gegen Kontrolle.
- Inkeep oder eesel AI — wählen Sie eines von beiden, wenn der Scope nur Dokumentation und Support-Antworten umfasst, die Inhalte öffentlich sind und Sie in Tagen live sein wollen. Keines der beiden versucht, das Berechtigungsproblem bei gemischten Zielgruppen zu lösen.
Worauf Sie achten müssen
- Early Binding macht die Aktualität von Berechtigungen zu einem Indexierungs- und nicht zu einem Abfrageproblem. Ein entzogener Account bleibt so lange wirksam, bis der Security-Identity-Cache und die Quellenaktualisierung nachgezogen haben. Guard: Stellen Sie die Refresh-Kadenz des Identity Providers auf Ihr Offboarding-SLA ein und testen Sie vor dem Go-live mit einem tatsächlich entzogenen Account statt mit einem Testnutzer, den Sie im Portal deaktiviert haben.
- Zwei Zähler rechnen auf denselben Seitenaufruf. Teams dimensionieren das Such-Entitlement, schalten generative Antworten für jede Abfrage frei und stellen fest, dass der generative Zähler der teure ist. Guard: Modellieren Sie beide Zähler im Pilotbetrieb gegen echten Portal-Traffic und beschränken Sie generative Antworten auf Abfragen mit qualifizierter Intention, statt sie bei jeder Suche auszulösen.
- Die Implementierung ist ein Projekt mit Partner, kein Schalter. Connector-Setup, Berechtigungs-Mapping und Relevanz-Tuning laufen über Wochen, und ein großer Teil der Umsetzung geht über Implementierungspartner. Guard: Nehmen Sie SOW, benannten Partner und Go-live-Datum in denselben Vertrag wie die Lizenz auf, mit der ersten Verlängerung gerechnet ab Go-live und nicht ab Unterschrift.
- Das Wachstum verlangsamt sich und die Marge liegt am Break-even. Aus 13% SaaS-Subscription-Wachstum im dritten Quartal des Geschäftsjahres 2026 wurden 8% Gesamtumsatzwachstum im ersten Quartal des Geschäftsjahres 2027, bei einem bereinigten EBITDA von $0.1M. Guard: Die Bilanz beantwortet die Solvenzfrage — $107.1M Cash, keine Schulden —, behandeln Sie das also als Risiko beim Roadmap-Tempo und nicht als Anbieterrisiko, und verhandeln Sie eine mehrjährige Laufzeit mit Preisschutz, statt auf ein Einjahresangebot zu setzen.