Saltar al contenido principal

Anuncio

🛠️ Presentamos el Data Product Builder

Escribe lo que necesitas en un Data Contract y pídele a tu agente de código que lo construya. El Data Product Builder lleva el desarrollo guiado por contratos a los productos de datos: Claude Code, OpenAI Codex o GitHub Copilot CLI implementan el producto de datos en minutos, respetando tus convenciones y totalmente integrado con Entropy Data.

El Data Product Builder en acción.

Cómo funciona

Hoy los Data Engineers construyen productos de datos con agentes de código. El agente escribe los modelos dbt, los tests y el workflow de CI. Lo que necesita son tres insumos, y todos se pueden gestionar desde Entropy Data:

  • El Data Contract define el qué: el dataset que debe entregar el producto de datos, especificado como un contrato ODCS desde el punto de vista del Data Consumer.
  • El repositorio de skills define el cómo: las convenciones, plantillas y políticas de tu organización para construir productos de datos sobre tu stack.
  • El marketplace de datos aporta los datos sobre los que construir: los productos de datos upstream, las aplicaciones de origen y los datos externos que consume el nuevo producto de datos. El agente los descubre a través de la CLI de Entropy Data e incluso solicita acceso en nombre del nuevo producto de datos.

El agente de código combina los tres e implementa el producto de datos en minutos: un dataset, un proyecto dbt, un Databricks Asset Bundle o lo que exija tu stack, con tests, workflow de despliegue, data lineage y metadatos incluidos. El resultado aparece ya conectado en Entropy Data: publicado en el marketplace, con data lineage, resultados de los tests del contrato, detección de drift y gestión de accesos.

La pestaña Data Product Builder en la página de un producto de datos: elige el agente de código (Claude Code, OpenAI Codex, GitHub Copilot CLI), copia los comandos de instalación y conexión, y consulta las skills del builder.
La pestaña Builder en la página del producto de datos: elige el builder, consulta el comando de instalación y copia el prompt prerrellenado.

Repositorios de skills open source

Un repositorio de skills es un repositorio Git con skills (instrucciones en Markdown que el agente carga para una tarea concreta), plantillas de archivos y hooks de validación. Haz un fork y codifica en él tus propias convenciones. Entropy Data ofrece repositorios de skills open source para cada stack:

  • dataproduct-builder-dbt. dbt con cualquier adaptador: Snowflake, BigQuery, Databricks, Redshift, Postgres, DuckDB. GitHub Actions para CI.
  • dataproduct-builder-databricks. Databricks Asset Bundles con Lakeflow Spark Declarative Pipelines. Compartición mediante Unity Catalog.
  • Snowflake Native Apps Framework y AWS Glue. Próximamente.

Los repositorios de la comunidad y los personalizados son bienvenidos. Abre un pull request en el registro dataproduct-builders para publicar el tuyo.

Pruébalo

Lee la guía del Data Product Builder para ver el recorrido completo con el ejemplo de Shelf Warmers: edición del contrato, descubrimiento en el marketplace, solicitudes de acceso y el producto de datos terminado dentro de Entropy Data. O ve directamente a la documentación.