ooligo

Onyx

enterprise-ai-search enterprise-search · open-source · self-hosted · ai-assistant · rag
AI-NATIVE MCP API FREEMIUM
RevOpsLegal OpsRecrutamento e TACustomer Success
8.0 /10

O que é

Onyx — antes Danswer — é busca corporativa e chat com IA que você roda na sua própria infraestrutura. Ele indexa seu SaaS por meio de mais de 50 conectores, responde perguntas sobre esse índice com o modelo que você escolher e expõe a mesma camada de recuperação para agentes e para ações MCP. O repositório no GitHub soma 31.9k estrelas e 4.4k forks, o que faz dele a resposta padrão sempre que alguém pede um Glean de código aberto.

É a primeira bifurcação em quase toda avaliação de busca corporativa, e ela costuma ser mal colocada. O comprador lê “licença MIT” e entende “o mesmo produto do Glean, de graça”. O Onyx é distribuído em duas edições, e a linha entre elas passa exatamente pela função que torna a busca corporativa segura de ligar.

A linha do open core, que é a avaliação inteira

A Community Edition é MIT: chat, recuperação, agentes, ações, conectores e a API. Existe ainda um build totalmente FOSS no repositório separado onyx-foss. Essa edição é gratuita de verdade e útil de verdade.

A Enterprise Edition é uma licença comercial e carrega a lista que qualquer revisão de segurança vai pedir: SSO com OIDC e SAML, conectores de sincronização de permissões, grupos de usuários e RBAC, permissões por grupo sobre conectores e conjuntos de documentos, analytics de uso, segredos criptografados, extensões de hooks e suporte prioritário.

A sincronização de permissões é a que decide a compra. Ela espelha a lista de controle de acesso de cada sistema de origem e a aplica no momento da recuperação, então um documento de remuneração aparece para quem já conseguia abri-lo no Drive e continua invisível para o resto. Sem ela, seu índice é plano: qualquer pessoa que consiga fazer login recupera tudo o que você indexou. É uma postura viável para documentação de engenharia e um manual público. Não é uma postura viável para um índice que inclui arquivos de RH, material de conselho ou um data room sem tratamento.

Ou seja, o enquadramento honesto tem três opções, não duas. Onyx self-hosted gratuito sobre conteúdo que você não se incomoda de expor a qualquer funcionário logado. Onyx pago — nuvem ou on-premise — com aplicação real de ACL. Ou Glean. A opção do meio continua mais barata que o Glean e continua sendo sua para hospedar; de graça ela não é.

A realidade do preço

Página de preços do fornecedor, verificada em 5 de setembro de 2026:

  • Community Edition — US$ 0. Self-hosted, MIT, sem contagem de assentos e sem relação comercial.
  • Business — US$ 20 por usuário por mês na cobrança anual. Onyx Cloud. Interface de chat e busca, os principais LLMs, agentes próprios, ações MCP e OpenAPI, mais de 40 conectores, busca na web, deep research, interpretador de código, integração com Slack, APIs para desenvolvedores, RBAC e herança de permissões, suporte da comunidade.
  • Enterprise — somente sob cotação. Acrescenta SSO OIDC/SAML, deploy on-premise e por região, white-label, integrações sob medida, extensões de hooks, exportação de dados, suporte dedicado e SLA.

Repare onde o on-premise fica: self-hosting pago é uma conversa de nível Enterprise, então o plano de “a gente hospeda e pula a call de vendas” só se sustenta na edição gratuita.

Contra a categoria, o Glean roda por volta de US$ 40-50 por usuário por mês com mínimo de 100 assentos, mais cerca de US$ 15 por usuário para a camada de IA quando ela é destacada. O Onyx Business a US$ 20 fica um pouco abaixo da metade da base do Glean antes do adicional. Para 300 assentos isso dá algo em torno de US$ 72 mil por ano contra um contrato de Glean que aterrissa na casa das centenas de milhares baixas depois de contar onboarding e trabalho de integração.

Depois some a infraestrutura que você passa a operar. O modo Standard pede no mínimo 4 vCPU e 10 GB de RAM, 8 ou mais vCPU e 16 GB ou mais recomendados, e 32 GB de disco mais cerca de 2,5 vezes os dados indexados — a documentação sugere 500 GB para organizações com menos de 5.000 usuários. A memória acompanha o tamanho do corpus: cerca de 2 GB por GB de documentos de origem em corpus pequenos, caindo para perto de 1 GB por GB acima de 50 GB. Um modo Lite roda com 2 vCPU e 2 GB para avaliação. Nada disso é caro em gasto de nuvem; tudo isso entra no plantão de alguém.

Melhor para

Um time de ops ou de plataforma próximo da engenharia, de 100 a 2.000 assentos, que já opera a própria infraestrutura e tem um motivo específico para manter o índice em casa: residência de dados, uma base de clientes de defesa ou regulada, ou uma cotação do Glean que voltou acima do que o problema vale. O Onyx está implantado para os mais de 14.000 funcionários da Netflix e dentro da Thales, segundo o material de clientes publicado pelo próprio fornecedor, então o teto não é a restrição.

O sinal claro: se a pessoa que vai operar isso já administra Postgres e um cluster de busca e não veria nisso um fardo novo, o Onyx tem o formato certo. Se essa pessoa não existe, compre o tier em nuvem ou compre o Glean.

Não é para

  • Times sem dono de plataforma. Hospedar um índice é um serviço, não uma instalação.
  • Quem precisa de aplicação de ACL desde o primeiro dia com orçamento zero. Aqui as duas condições se excluem. Escolha uma.
  • Deploys em que a cobertura de conectores é a restrição determinante. O catálogo de mais de 100 do Glean é mais profundo, e a falta de um conector para o seu sistema de registro não é algo que uma licença resolva.
  • Times pequenos, abaixo de uns 50 assentos. Nesse tamanho o custo operacional supera a economia por assento, e um assistente hospedado com camada de conectores é a troca melhor.

Frente às alternativas

  • Glean — o líder de participação e a referência contra a qual o Onyx é medido. Escolha o Glean quando a qualidade de recuperação sobre mais de 100 sistemas for o fator decisivo, o modelo de permissões já estiver em ordem e ninguém quiser assumir a infraestrutura. Escolha o Onyx quando o local de hospedagem for requisito e não preferência, ou quando a objeção for a cotação.
  • Dust — o entrante AI-native que mais cresce, orientado a agentes antes do índice. Escolha o Dust quando o objetivo for construir e entregar assistentes para os times rapidamente e a busca for um meio para isso; escolha o Onyx quando o índice em si for o ativo. A comparação Dust vs Glean cobre esse eixo em profundidade.
  • Hebbia — trabalho analítico pesado em documentos sobre um corpus definido, não recuperação para a empresa inteira. Outro trabalho.
  • Open WebUI ou LibreChat — se o que você quer de fato é um front-end de chat self-hosted e não há requisito de conectores, eles são mais leves e o piso de recursos é bem menor. O Onyx justifica sua pegada pelas camadas de conectores e permissões; pule se você não for usá-las.

Se nada disso encaixa, o problema pode não ser busca: melhores bases de conhecimento para times cobre o caso em que o conteúdo falta em vez de estar difícil de achar, e RAG explica o que a camada de recuperação pode e não pode fazer.

Pontos de atenção

  • A edição gratuita não tem sincronização de permissões, e os pilotos escondem isso. Um piloto de 20 pessoas indexa documentação de engenharia, todo mundo vê tudo, ninguém percebe. O rollout adiciona o Drive e a pasta de RH, e o índice plano vira um incidente de vazamento. Proteção: decida a edição antes do piloto, não depois. Se o índice de produção um dia contiver algo que nem todos deveriam ler, rode o piloto no trial Enterprise — o fornecedor oferece um gratuito, self-hosted, mediante pedido — para testar aquilo que você vai realmente implantar.
  • Disco é o modo de falha que ninguém planeja. Reserve cerca de 2,5 vezes o corpus indexado e observe que o cluster OpenSearch por baixo aplica bloqueio de somente leitura quando o disco cruza a marca de flood stage. Isso aparece como indexação parando em silêncio, e respostas desatualizadas são piores que resposta nenhuma porque ninguém consegue distinguir. Proteção: alerte sobre a idade da atualização do índice, não só sobre percentual de disco, e refaça a projeção depois do primeiro crawl completo — é nele que você descobre o tamanho real do corpus.
  • Open core se move. A empresa é financiada por venture capital, com seed de US$ 10 milhões coliderada por Khosla Ventures e First Round Capital, e a linha CE/EE é definida pelo fornecedor e pode ser redesenhada. Não é previsão, é o risco estrutural do modelo. Proteção: fixe a versão que você implanta, acompanhe o build onyx-foss como alternativa e escreva o caminho de migração no documento de decisão em vez de descobri-lo durante uma renovação.
  • Existem duas empresas sem relação chamadas Onyx. Uma startup israelense de segurança com IA divide o nome e levantou uma Série B de US$ 113 milhões em 2026; o runtime de ML ONNX é um quase homógrafo. Proteção: busque em cadastros de fornecedores, questionários de segurança e alertas de notícias por onyx.app ou “Onyx (Danswer)”, ou sua revisão de segurança vai ler o histórico de captação e o modelo de ameaças de outra empresa.
  • A camada de administração fica atrás da superfície de chat. A queixa recorrente de quem opera é a visibilidade em nível de documento: rastrear qual fonte produziu uma resposta e o que de fato foi indexado. Proteção: durante a avaliação, pegue dez perguntas com resposta conhecida e verifique se consegue rastrear cada uma até o documento de origem na interface de administração. Se não conseguir, você não tem ciclo de depuração quando a qualidade de recuperação escorregar.

Relacionado: o stack de rollout de IA corporativa precifica as camadas que cercam uma ferramenta de recuperação como esta.