Ingeniero de Datos Databricks

Ingeniero de Datos Databricks

location_on Empresa confidencial · MX

Buscamos un Ingeniero de Datos con amplia experiencia en producción para construir y mantener lakehouses en Databricks. Serás responsable de diseñar pipelines de ingesta batch, modelar datos para entornos multi-tenant (incluyendo estrategias de particionamiento y aislamiento) y gestionar la gobernanza con Unity Catalog. Manejarás transformaciones con PySpark y dbt, así como la optimización de tablas en Delta Lake con control transaccional ACID y evolución de esquemas. También trabajarás con orquestadores modernos como Dagster, Prefect o Databricks Workflows, y colaborarás en proyectos de IA que involucren bases de datos vectoriales, pipelines de embeddings y patrones RAG. Se valora experiencia con Databricks en AWS (configuración de workspace, integración S3, IAM y cost governance), así como infraestructura como código con Databricks Asset Bundles o Terraform. El puesto requiere habilidades sólidas en Python y SQL, y conocimiento de herramientas de catalogación y gobierno de datos como Unity Catalog u OpenMetadata.

WhatsApp