chDB — base de datos in-process rápida, fiable y escalable
Experimenta el poder de ClickHouse, in-process. Con un rendimiento, fiabilidad y escalabilidad inigualables para cualquier aplicación intensiva en datos.
- Motor SQL ultrarrápido
- Compatible con más de 80 formatos de datos
- Intercambio de datos zero-copy con DataFrames
- Interfaz pythónica nativa al estilo Pandas
Presentamos chDB 4.0
Escribe Pandas, ejecuta ClickHouse, ahora en Hex
Con la nueva DataStore API, escribe el código Pandas que ya conoces y se ejecuta automáticamente sobre el motor de ClickHouse.
DataStore registra tus operaciones como un lazy pipeline, compila la cadena completa en SQL optimizado de ClickHouse en tiempo de ejecución y aplica filter pushdown, column pruning y propagación de límites.
Lazy execution, velocidad de ClickHouse
Las operaciones se registran, no se ejecutan. El pipeline completo se compila en SQL optimizado y se ejecuta sobre el motor vectorizado y multi-threaded de ClickHouse.
Frictionless engine fallback
Las operaciones se registran, no se ejecutan. El pipeline completo se compila en SQL optimizado y se ejecuta sobre el motor vectorizado y multi-threaded de ClickHouse.
Migración con un solo import
Las operaciones se registran, no se ejecutan. El pipeline completo se compila en SQL optimizado y se ejecuta sobre el motor vectorizado y multi-threaded de ClickHouse.
Prueba chDB 4.0 en Hex
Ejecuta queries de ClickHouse al estilo Pandas en notebooks de Hex sin necesidad de configuración.
Obtén una prueba gratuita extendida a través de ClickHouse.
chDB y el ecosistema de ClickHouse
Ya sea que estés desarrollando en local, ejecutando analítica in-process integrada en tu app o escalando workloads de producción, ClickHouse te respalda.
ClickHouse
chDB: ClickHouse In-Process
ClickHouse Local
Biblioteca open source
chDB es una biblioteca open source que te permite personalizar y extender tu base de datos según tus necesidades. Aprovecha una comunidad activa que te mantiene al día con las últimas innovaciones y prácticas de seguridad.
Consulta objetos directamente
Con chDB, puedes consultar directamente objetos nativos del lenguaje de programación de tu elección. Este acceso directo reduce la latencia y simplifica el procesamiento de datos, habilitando operaciones más rápidas.
Compatible con Python DB API 2.0
chDB es compatible con Python DB API 2.chDB es compatible con Python DB API 2.0, asegurando una integración fluida con tus aplicaciones Python. Disfruta de consistencia, fiabilidad y facilidad de uso con bibliotecas y herramientas conocidas.
Nativo para Pandas
Escribe código Pandas que se ejecuta sobre ClickHouse. La DataStore API trae lazy execution, optimización automática de queries y frictionless engine fallback.
chDB es compatible con bindings para múltiples lenguajes de programación, incluyendo:
Integrado. Sin necesidad de instalar ni ejecutar servicios de ClickHouse
- Simplifica el despliegue sin configuración adicional
- Reduce la complejidad del sistema y el consumo de recursos
- Ideal para aplicaciones ligeras y embebidas
Intercambio de DataFrames zero-copy
- Los DataFrames se leen y escriben directamente sin costo de serialización
- Las columnas numéricas y de ancho fijo comparten buffers de memoria directamente con Pandas mediante el buffer protocol.
Soporte de entrada y salida para Parquet, CSV, JSON, Arrow, ORC y más de 80 formatos adicionales
- Integra fácilmente diversas fuentes de datos
- Simplifica el intercambio y la interoperabilidad de los datos
- Asegura compatibilidad con una amplia variedad de formatos de datos
chDB supera de forma habitual a DuckDB, Pandas y Polars, ahora con intercambio de DataFrames zero-copy
Con chDB, tienes el beneficio de la velocidad vertiginosa de ClickHouse, in-process.
247x
Más rápido que Pandas
Agregación COUNT(*) sobre un DataFrame de 1M de filas
~24%
Más rápido que DuckDB
Exportando 1M de filas a un DataFrame de Pandas (2.64 s vs 3.47 s)
87x
Más rápido que chDB v1
Query end-to-end sobre DataFrame, entrada zero-copy en v2+
En benchmarks comparativos sobre 14 operaciones comunes de Pandas con 1M y 10M de filas, chDB lidera en la mayoría de los desafíos. Consulta los resultados completos del benchmark.
¿Para qué se usa chDB?
Estamos donde nos necesites. Nos encanta mantener conversaciones con la comunidad de ClickHouse y siempre estamos disponibles para responder tus preguntas.
- 01Probar tus queries en CI sin tener que levantar un servidor de CHProbar tus queries en CI sin tener que levantar un servidor de CH
- 02Construir prototipos/PoCs autocontenidos
- 03Notebooks de Jupyter sin un servidor de CH en ejecución
Empieza a usar chDB en minutos
Instala chDB para macOS y Linux
pip install chdbquery = "select count() FROM s3('s3://datasets-documentation/hackernews/hacknernews.json.gz')"
chdb.query(query, 'DataFrame')¿Buscas una solución gestionada?
Empieza con ClickHouse Cloud
Prueba gratuita de 30 días y 300 USD en créditos para que los uses a tu ritmo.