Qué es
Onyx — antes Danswer — es búsqueda empresarial y chat con IA que puedes ejecutar en tu propia infraestructura. Indexa tu SaaS a través de más de 50 conectores, responde preguntas sobre ese índice con el modelo que elijas y expone la misma capa de recuperación a agentes y a acciones MCP. El repositorio de GitHub acumula 31.9k estrellas y 4.4k forks, lo que lo convierte en la respuesta por defecto cuando alguien pide un Glean de código abierto.
Es la primera bifurcación en casi toda evaluación de búsqueda empresarial, y suele plantearse mal. El comprador lee “licencia MIT” y entiende “el mismo producto que Glean, gratis”. Onyx se distribuye en dos ediciones, y la línea que las separa atraviesa justo la función que hace que la búsqueda empresarial sea segura de activar.
La línea del open core, que es toda la evaluación
La Community Edition es MIT: chat, recuperación, agentes, acciones, conectores y la API. Existe además una compilación totalmente FOSS en el repositorio aparte onyx-foss. Esa edición es gratuita de verdad y útil de verdad.
La Enterprise Edition es una licencia comercial y contiene la lista que va a pedir cualquier revisión de seguridad: SSO con OIDC y SAML, conectores de sincronización de permisos, grupos de usuarios y RBAC, permisos por grupo sobre conectores y conjuntos de documentos, analítica de uso, secretos cifrados, extensiones de hooks y soporte prioritario.
La sincronización de permisos es la que decide la compra. Replica la lista de control de acceso de cada sistema de origen y la aplica en el momento de la recuperación, de modo que un documento de compensación aparece para quien ya podía abrirlo en Drive y permanece invisible para el resto. Sin ella, tu índice es plano: cualquiera que pueda iniciar sesión puede recuperar todo lo que hayas indexado. Es una postura viable para documentación de ingeniería y un manual público. No lo es para un índice que incluye archivos de RR. HH., material del consejo o un data room sin depurar.
Así que el planteamiento honesto son tres opciones, no dos. Onyx autohospedado gratis sobre contenido que no te incomoda exponer a cualquier empleado con sesión iniciada. Onyx de pago — nube o on-premise — con aplicación real de ACL. O Glean. La opción intermedia sigue siendo más barata que Glean y sigue siendo tuya para hospedar; gratis no es.
La realidad del precio
Página de precios del proveedor, verificada el 5 de septiembre de 2026:
- Community Edition — 0 USD. Autohospedada, MIT, sin recuento de asientos ni relación comercial.
- Business — 20 USD por usuario al mes con facturación anual. Onyx Cloud. Interfaz de chat y búsqueda, los principales LLM, agentes propios, acciones MCP y OpenAPI, más de 40 conectores, búsqueda web, investigación profunda, intérprete de código, integración con Slack, APIs para desarrolladores, RBAC y herencia de permisos, soporte comunitario.
- Enterprise — solo bajo cotización. Añade SSO OIDC/SAML, despliegue on-premise y por región, marca blanca, integraciones a medida, extensiones de hooks, exportación de datos, soporte dedicado y SLA.
Fíjate dónde queda el on-premise: el autohospedaje de pago es una conversación de nivel Enterprise, así que el plan de “lo hospedamos nosotros y nos saltamos la llamada de ventas” solo se sostiene con la edición gratuita.
Frente a la categoría, Glean ronda los 40-50 USD por usuario al mes con un mínimo de 100 asientos, más unos 15 USD por usuario para la capa de IA cuando se desglosa. Onyx Business a 20 USD queda algo por debajo de la mitad de la base de Glean antes del complemento. Para 300 asientos son unos 72.000 USD al año frente a un contrato de Glean que aterriza en cientos de miles bajos una vez contados la puesta en marcha y el trabajo de integración.
Después suma la infraestructura que ahora operas. El modo Standard pide como mínimo 4 vCPU y 10 GB de RAM, 8 o más vCPU y 16 GB o más de RAM recomendados, y 32 GB de disco más aproximadamente 2,5 veces tus datos indexados — la documentación sugiere 500 GB para organizaciones de menos de 5.000 usuarios. La memoria sigue el tamaño del corpus: unos 2 GB por cada GB de documentos de origen en corpus pequeños, bajando a cerca de 1 GB por GB por encima de los 50 GB. Un modo Lite corre con 2 vCPU y 2 GB para evaluar. Nada de esto es caro en gasto de nube; todo esto entra en la guardia de alguien.
Ideal para
Un equipo de ops o de plataforma cercano a ingeniería, de 100 a 2.000 asientos, que ya opera su propia infraestructura y tiene una razón concreta para mantener el índice en casa: residencia de datos, una base de clientes de defensa o regulada, o una cotización de Glean que volvió por encima de lo que vale el problema. Onyx está desplegado para los más de 14.000 empleados de Netflix y dentro de Thales, según el material de clientes publicado por el propio proveedor, así que el techo no es la restricción.
La señal clara: si quien va a operar esto ya administra Postgres y un clúster de búsqueda y no lo consideraría una carga nueva, Onyx tiene la forma correcta. Si esa persona no existe, compra el nivel en la nube o compra Glean.
No es para
- Equipos sin responsable de plataforma. Autohospedar un índice es un servicio, no una instalación.
- Quien necesite aplicación de ACL desde el primer día con presupuesto cero. Aquí las dos condiciones se excluyen. Elige una.
- Despliegues donde la cobertura de conectores es la restricción determinante. El catálogo de más de 100 de Glean es más profundo, y que falte un conector para tu sistema de registro no se arregla con una licencia.
- Equipos pequeños de menos de unos 50 asientos. A ese tamaño el coste operativo supera el ahorro por asiento, y un asistente hospedado con capa de conectores es el mejor intercambio.
Frente a las alternativas
- Glean — el líder de cuota y la referencia contra la que se mide Onyx. Elige Glean cuando la calidad de recuperación sobre más de 100 sistemas sea el factor decisivo, el modelo de permisos ya esté ordenado y nadie quiera hacerse cargo de la infraestructura. Elige Onyx cuando la ubicación del hospedaje sea un requisito y no una preferencia, o cuando la objeción sea la cotización.
- Dust — el entrante nativo de IA que más rápido crece, orientado a agentes antes que al índice. Elige Dust cuando el objetivo sea construir y desplegar asistentes a los equipos con rapidez y la búsqueda sea un medio para eso; elige Onyx cuando el índice en sí sea el activo. La comparativa Dust vs Glean desarrolla ese eje a fondo.
- Hebbia — trabajo analítico intensivo en documentos sobre un corpus acotado, no recuperación para toda la empresa. Otro trabajo.
- Open WebUI o LibreChat — si lo que quieres en realidad es un frontend de chat autohospedado y no tienes requisito de conectores, son más ligeros y su piso de recursos es mucho más bajo. Onyx justifica su huella con las capas de conectores y permisos; sáltalo si no vas a usarlas.
Si nada de esto encaja, quizá el problema no sea la búsqueda: mejores bases de conocimiento para equipos cubre el caso en que el contenido falta en lugar de no encontrarse, y RAG explica qué puede y qué no puede hacer la capa de recuperación.
Puntos de atención
- La edición gratuita no tiene sincronización de permisos, y los pilotos lo ocultan. Un piloto de 20 personas indexa documentación de ingeniería, todos ven todo, nadie lo nota. El despliegue añade Drive y la carpeta de RR. HH., y el índice plano se convierte en un incidente de divulgación. Guarda: decide la edición antes del piloto, no después. Si el índice de producción va a contener alguna vez algo que no todos deberían leer, corre el piloto sobre la prueba Enterprise — el proveedor ofrece una gratuita autohospedada bajo petición — para que pruebes lo que realmente vas a desplegar.
- El disco es el modo de fallo que nadie planifica. Presupuesta unas 2,5 veces tu corpus indexado, y ten en cuenta que el clúster de OpenSearch subyacente aplica un bloqueo de solo lectura cuando el disco cruza la marca de inundación. Eso se manifiesta como una indexación que se detiene en silencio, y las respuestas obsoletas son peores que la ausencia de respuestas porque nadie puede distinguirlas. Guarda: alerta sobre la antigüedad de la frescura del índice, no solo sobre el porcentaje de disco, y vuelve a proyectar tras el primer rastreo completo — ese rastreo es cuando descubres el tamaño real de tu corpus.
- El open core se mueve. La empresa tiene respaldo de capital riesgo con una ronda semilla de 10 millones de USD coliderada por Khosla Ventures y First Round Capital, y la línea CE/EE la fija el proveedor y puede redibujarse. No es una predicción, es el riesgo estructural del modelo. Guarda: fija la versión que despliegas, sigue la compilación
onyx-fosscomo plan B y escribe la ruta de migración en el documento de decisión en vez de descubrirla durante una renovación. - Hay dos empresas sin relación llamadas Onyx. Una startup israelí de seguridad con IA comparte el nombre y levantó una Serie B de 113 millones de USD en 2026; el runtime de ML ONNX es un casi homógrafo. Guarda: busca en registros de proveedores, cuestionarios de seguridad y alertas de noticias por
onyx.appo “Onyx (Danswer)”, o tu revisión de seguridad estará leyendo el historial de financiación y el modelo de amenazas de otra empresa. - Las herramientas de administración van por detrás de la superficie de chat. La queja recurrente de quienes lo operan es la visibilidad a nivel de documento: rastrear qué fuente produjo una respuesta y qué se indexó realmente. Guarda: durante la evaluación, toma diez preguntas con respuesta conocida y verifica que puedes rastrear cada una hasta su documento de origen en la interfaz de administración. Si no puedes, no tienes bucle de depuración cuando la calidad de recuperación se degrade.
Relacionado: el stack de despliegue de IA empresarial pone precio a las capas que rodean una herramienta de recuperación como esta.