DuckDB adelanta el plan de v2.0 para estabilizar el modo servidor Quack

Los cocreadores Mark Raasveldt y Hannes Muehleisen planean estabilizar Quack y agregar CONNECT en un lanzamiento para el otoño de 2026 dirigido a cargas de trabajo de producción compartidas.

By · Published

Primary source: DuckDB

Why it matters

DuckDB's founders are expanding the database into shared production workloads, creating a larger support market while putting its defining simplicity under pressure.

An isometric paper-cut render shows a duck icon connecting to a data cylinder and a server tower, representing DuckDB's new server mode.

Mark Raasveldt (@mraasveldt) and Hannes Muehleisen (@hfmuehleisen), the researchers who created DuckDB, previewed the planned DuckDB v2.0 on August 17, outlining a client-server mode intended to expand the analytical database beyond the embedded architecture that defined it. The release, code-named Cyanoptera, is planned for fall 2026 and has no exact launch date. (duckdb.org)

La pareja que creó DuckDB, Mark Raasveldt (@mraasveldt) y Hannes Muehleisen (@hfmuehleisen), presentaron un adelanto de la planeada DuckDB v2.0 el 17 de agosto, describiendo un modo cliente-servidor destinado a ampliar la base de datos analítica más allá de la arquitectura embebida que la definió. La versión, con nombre en código Cyanoptera, está prevista para el otoño de 2026 y no tiene una fecha de lanzamiento exacta. (duckdb.org)

The pair began DuckDB as a research project at Amsterdam's Centrum Wiskunde & Informatica, aiming to put a fast analytical SQL engine directly inside applications and data-science tools. Muehleisen remains a senior researcher at CWI and is CEO of DuckLabs; Raasveldt, DuckLabs' CTO, wrote his doctoral work around the intersection of relational databases, machine learning and analytics. Their original thesis removed the network protocol and operational machinery that came with conventional database servers. (ducklabs.com)

La pareja inició DuckDB como un proyecto de investigación en el Centrum Wiskunde & Informatica de Ámsterdam, con el objetivo de colocar un motor SQL analítico rápido directamente dentro de aplicaciones y herramientas de ciencia de datos. Muehleisen sigue siendo investigador senior en CWI y es CEO de DuckLabs; Raasveldt, CTO de DuckLabs, escribió su tesis doctoral en la intersección entre bases de datos relacionales, machine learning y analítica. Su tesis original eliminó el protocolo de red y la maquinaria operativa que acompañan a los servidores de bases de datos convencionales. (ducklabs.com)

The v2.0 plan bends that thesis in response to how people are actually deploying DuckDB. Users have repeatedly asked for multiple processes and remote clients to share a database, a pattern the in-process design could not handle cleanly. Raasveldt and Muehleisen are addressing that constraint with the Quack extension, which implements DuckDB's native remote protocol, and a planned CONNECT statement that routes queries to another DuckDB process. (duckdb.org)

El plan de la v2.0 flexibiliza esa tesis en respuesta a cómo los usuarios están desplegando realmente DuckDB. Los usuarios han solicitado repetidamente que múltiples procesos y clientes remotos compartan una base de datos, un patrón que el diseño en proceso no podía manejar de forma limpia. Raasveldt y Muehleisen están abordando esa limitación con la extensión Quack, que implementa el protocolo remoto nativo de DuckDB, y una instrucción CONNECT planificada que enruta consultas a otro proceso de DuckDB. (duckdb.org)

A concession built into the product

DuckDB's appeal came from avoiding a server. Developers could install a library, open a file or in-memory database, and run analytical SQL within Python, R, JavaScript or another host application. That made DuckDB useful for notebooks, local data processing and software that needed an embedded query engine without a separate service to deploy.

The same design created a hard boundary around multi-process writes. DuckDB can run concurrent transactions and multiple writer threads within one process, using multiversion concurrency control and optimistic concurrency control. Its current documentation says writes from multiple processes rely on Quack, which remains beta in the available 1.5 series and is expected to mature with v2.0. Conflicting updates to the same rows can still produce transaction errors. (duckdb.org)

Una concesión incorporada en el producto

El atractivo de DuckDB provenía de evitar un servidor. Los desarrolladores podían instalar una librería, abrir un archivo o una base de datos en memoria y ejecutar SQL analítico dentro de Python, R, JavaScript u otra aplicación anfitriona. Eso hizo a DuckDB útil para notebooks, procesamiento de datos local y software que necesitaba un motor de consultas embebido sin un servicio separado que desplegar.

El mismo diseño creó un límite estricto alrededor de las escrituras multi-proceso. DuckDB puede ejecutar transacciones concurrentes y múltiples hilos escritores dentro de un mismo proceso, usando control de concurrencia multiversión y control de concurrencia optimista. Su documentación actual indica que las escrituras desde múltiples procesos dependen de Quack, que sigue en beta en la serie 1.5 disponible y se espera que madure con la v2.0. Actualizaciones en conflicto sobre las mismas filas aún pueden producir errores de transacción. (duckdb.org)

Quack places one DuckDB process in charge of the database and lets remote clients attach over the network. A client can issue CONNECT, run SQL on the server and stream results back. The same statement can target PostgreSQL and MySQL, with DuckDB's optimizer pushing SQL to those systems instead of first copying their tables across the network. (duckdb.org)

Quack coloca un proceso de DuckDB a cargo de la base de datos y permite que clientes remotos se conecten a través de la red. Un cliente puede emitir CONNECT, ejecutar SQL en el servidor y transmitir los resultados de vuelta. La misma instrucción puede dirigirse a PostgreSQL y MySQL, con el optimizador de DuckDB enviando SQL a esos sistemas en lugar de copiar primero sus tablas a través de la red. (duckdb.org)

That changes DuckDB's practical role. A tool that was commonly embedded in a notebook or application process can also sit behind long-running services. The founders are pairing the protocol with expanded metrics, logs and observability, acknowledging that a persistent shared database needs a different operating surface from a local analytical library. (duckdb.org)

Eso cambia el papel práctico de DuckDB. Una herramienta que comúnmente estaba embebida en un notebook o en el proceso de una aplicación también puede situarse detrás de servicios de larga duración. Los fundadores están combinando el protocolo con métricas ampliadas, registros y mayor observabilidad, reconociendo que una base de datos compartida y persistente necesita una superficie de operación diferente a la de una librería analítica local. (duckdb.org)

The production bet

The server push also fits the economics of DuckLabs, the founder-owned operation that maintains DuckDB and sells commercial support, advisory work and feature prioritization. DuckLabs says it has more than 30 engineers and researchers in Amsterdam and remains independent of venture capital. Its roadmap says revenue comes from support and paid feature work, while the nonprofit DuckDB Foundation governs the open-source project. (ducklabs.com)

La apuesta por uso en producción

El empuje hacia un servidor también encaja con la economía de DuckLabs, la operación propiedad de sus fundadores que mantiene DuckDB y vende soporte comercial, trabajo de asesoría y priorización de características. DuckLabs dice tener más de 30 ingenieros e investigadores en Ámsterdam y sigue siendo independiente del capital de riesgo. Su hoja de ruta indica que los ingresos provienen del soporte y del trabajo remunerado en características, mientras que la organización sin fines de lucro DuckDB Foundation gobierna el proyecto de código abierto. (ducklabs.com)

More production deployments give DuckLabs a wider market for those services. Networking and multi-user operation move DuckDB closer to workloads where teams pay for reliability guidance, architecture reviews and support agreements. DuckLabs said in May that DuckDB was seeing more than one million downloads a day, though it has not published revenue or customer figures alongside that adoption claim. (ducklabs.com)

Más despliegues en producción le brindan a DuckLabs un mercado más amplio para esos servicios. El trabajo en red y la operación multiusuario acercan a DuckDB a cargas de trabajo donde los equipos pagan por orientación sobre fiabilidad, revisiones de arquitectura y acuerdos de soporte. DuckLabs dijo en mayo que DuckDB estaba registrando más de un millón de descargas al día, aunque no ha publicado cifras de ingresos o de clientes junto con esa afirmación de adopción. (ducklabs.com)

The approach differs from handing the project roadmap to outside investors. DuckLabs says the original creators retain ownership, while commercial collaborations fund work on the MIT-licensed core. That structure leaves Raasveldt and Muehleisen responsible for managing a delicate expansion: they can pursue the production use cases users want while keeping the local, low-operations experience that drove DuckDB's adoption. (ducklabs.com)

El enfoque difiere de entregar la hoja de ruta del proyecto a inversores externos. DuckLabs afirma que los creadores originales retienen la propiedad, mientras que las colaboraciones comerciales financian el trabajo sobre el núcleo con licencia MIT. Esa estructura deja a Raasveldt y Muehleisen responsables de gestionar una expansión delicada: pueden perseguir los casos de uso en producción que los usuarios desean, mientras conservan la experiencia local de baja operación que impulsó la adopción de DuckDB. (ducklabs.com)

Quack also changes DuckDB's boundary with managed products built around the engine. MotherDuck, a separate commercial service built around DuckDB, already provides managed multi-user operation. DuckDB v2.0 is expected to give users an open-source native route to shared remote operation, while users running Quack themselves will remain responsible for the surrounding deployment and operational work. (duckdb.org)

Quack también modifica el límite de DuckDB con productos gestionados construidos alrededor del motor. MotherDuck, un servicio comercial separado construido alrededor de DuckDB, ya proporciona operación multiusuario gestionada. Se espera que DuckDB v2.0 ofrezca a los usuarios una ruta nativa de código abierto hacia la operación remota compartida, mientras que los usuarios que ejecuten Quack por su cuenta seguirán siendo responsables del despliegue y del trabajo operativo circundante. (duckdb.org)

V2.0 reaches deeper than networking

The planned server mode leads a preview that Raasveldt and Muehleisen say covers more than 10,000 commits since DuckDB v1.5 shipped in March. The v2.0 plan includes a new default storage format, a PEG-based SQL parser, a broadened stable C API, triggers, asynchronous I/O and selected breaking changes. (duckdb.org)

V2.0 va más allá de la red

El modo servidor planificado encabeza una vista previa que Raasveldt y Muehleisen dicen que cubre más de 10,000 commits desde que DuckDB v1.5 se lanzó en marzo. El plan de la v2.0 incluye un nuevo formato de almacenamiento por defecto, un parser SQL basado en PEG, una API estable de C ampliada, triggers, E/S asincrónica y cambios incompatibles seleccionados. (duckdb.org)

The stable C API addresses a recurring cost for extension developers. Many DuckDB extensions have depended on an unstable C++ interface and needed rebuilding for each release. V2.0 is designed to let developers compile an extension once against a versioned API and keep the binary working across subsequent DuckDB versions. DuckDB already operates a Community Extensions repository for third-party extensions, but the project says it does not vet submitted code or guarantee that those extensions are safe. (duckdb.org)

La API estable de C aborda un costo recurrente para desarrolladores de extensiones. Muchas extensiones de DuckDB han dependido de una interfaz C++ inestable y han necesitado recompilarse para cada lanzamiento. La v2.0 está diseñada para permitir a los desarrolladores compilar una extensión una vez contra una API versionada y mantener el binario funcionando a través de versiones posteriores de DuckDB. DuckDB ya mantiene un repositorio Community Extensions para extensiones de terceros, pero el proyecto dice que no revisa el código enviado ni garantiza que esas extensiones sean seguras. (duckdb.org)

For semi-structured data, the VARIANT type introduced in v1.5 is set to gain direct storage execution, Parquet reading and writing, scan pushdown and new functions for inspecting and filtering nested values. DuckDB stores the detected structure in a columnar representation instead of treating every value as a JSON text blob, an approach aimed at logs and other records whose schemas change over time. (duckdb.org)

Para datos semiestructurados, el tipo VARIANT introducido en la v1.5 ganará ejecución de almacenamiento directa, lectura y escritura Parquet, pushdown de escaneo y nuevas funciones para inspeccionar y filtrar valores anidados. DuckDB almacena la estructura detectada en una representación columnar en lugar de tratar cada valor como un blob de texto JSON, un enfoque orientado a logs y otros registros cuyos esquemas cambian con el tiempo. (duckdb.org)

Asynchronous I/O targets another growing DuckDB workload: querying Parquet and other files in object storage. DuckDB says the planned I/O layer separates network request concurrency from query-processing threads, allowing more remote reads to proceed simultaneously. The work covers Parquet first, with CSV, DuckDB files and asynchronous Parquet writes also included in the preview. (duckdb.org)

La E/S asincrónica apunta a otra carga de trabajo en crecimiento para DuckDB: consultar Parquet y otros archivos en almacenamiento de objetos. DuckDB indica que la capa de E/S planificada separa la concurrencia de solicitudes de red de los hilos de procesamiento de consultas, permitiendo que más lecturas remotas procedan simultáneamente. El trabajo cubre Parquet primero, con CSV, archivos DuckDB y escrituras Parquet asincrónicas también incluidas en la vista previa. (duckdb.org)

The preview also describes partial aggregate pushdown below joins, reuse of redundant aggregations, a rewritten recursive CTE engine and the ability for aggregations to spill to disk when they outgrow memory. (duckdb.org)

La vista previa también describe pushdown parcial de agregados por debajo de los joins, reutilización de agregaciones redundantes, un motor de CTE recursivo reescrito y la capacidad de que las agregaciones desborden a disco cuando superan la memoria. (duckdb.org)

The test begins after the preview

DuckDB v2.0 has not shipped. The release calendar lists v1.5.5, released July 22, 2026, as the latest published version and gives v2.0 only a fall window. Preview builds contain much of the announced work, and the maintainers warn that details can change before release.

La prueba comienza después de la vista previa

DuckDB v2.0 no ha sido lanzado. El calendario de lanzamientos lista la v1.5.5, publicada el 22 de julio de 2026, como la versión más reciente publicada y da a la v2.0 sólo una ventana para el otoño. Las compilaciones de vista previa contienen gran parte del trabajo anunciado, y los mantenedores advierten que los detalles pueden cambiar antes del lanzamiento.

El plan de Quack para salir de beta llevará la mayor carga estratégica. Raasveldt y Muehleisen pasaron años demostrando que una base de datos analítica podía desaparecer dentro de otro proceso. V2.0 le pide a DuckDB que siga siendo ese motor pequeño y portátil, mientras también atiende a clientes remotos, escritores concurrentes y cargas de trabajo de producción de larga duración. La característica de servidor surgió por la presión de los usuarios, y su éxito dependerá de si DuckDB puede absorber las exigencias operativas sin hacer más difícil la experiencia embebida.

Reader comments

Conversation for this story loads after sign-in.