Construiré un data warehouse y optimizaré pipelines ETL de BigQuery en Google Cloud
Acerca de este Servicio
Construiré tus pipelines de datos en Google Cloud y reduciré tu factura de BigQuery.
Soy un ingeniero de datos que ha gestionado toda la pila de BigQuery en producción, actualmente soy Lead/Senior Data Engineer, donde reduje el gasto mensual en BigQuery en un 96% (de 13K a 500 dólares) mientras el volumen de consultas se triplicaba, rediseñando esquemas y optimizando consultas.
Lo que hago:
- Construir pipelines ETL hacia BigQuery desde APIs, exportaciones de GA4/Firebase, GCS o bases de datos
- Unificar GA4, Firebase, Adjust, RevenueCat, Google Ads en un solo modelo de BigQuery
- Reducir costos de BigQuery mediante rediseño de esquemas, particionado/clusterización, optimización de consultas
- Configurar orquestación programada (Airflow, Cloud Composer, Pub/Sub)
- Construir capas de transformación con Dataform
- Automatizar flujos de trabajo de reportes con Python y APIs
- Configurar interruptores de facturación por proyecto
- Crear y optimizar data warehouse y data lakes
- Construir dashboards directamente desde el warehouse
Cómo trabajo: compartes acceso de lectura a GCP, audito costos de pipelines/consultas, construyo o refactorizo y valido, obtienes documentación y una llamada de entrega.
Herramientas: GCP, BigQuery, Cloud Storage, Pub/Sub, Airflow, Dataform, GA4, Firebase, SQL, Python.
- Envíame un mensaje primero si tu configuración no es estándar.
Idioma:
Inglés
Experiencia técnica:
Google BigQuery
industria:
Análisis de Datos
FAQ
Traducción automática
¿Necesitarás acceso de facturación/administrador a mi proyecto GCP?
No, solo necesito los roles IAM específicos para el trabajo en alcance (por ejemplo, Editor de datos de BigQuery, Usuario de trabajos). Te diré exactamente qué otorgar.
¿Puedes garantizar una reducción de costos específica en %?
Cada entorno es diferente, así que no prometo un número antes de auditar tus patrones de consulta y esquema — pero la reducción de costos suele ser lo primero que busco.
¿Trabajas con herramientas fuera del stack de Google (AWS, Snowflake, dbt)?
Mi mayor experiencia es con GCP/BigQuery, pero me siento cómodo con patrones generales de ETL/orquestación, envíame un mensaje si tu stack es mixto.
¿Puedes configurar esto para que funcione sin que tenga que tocarlo otra vez?
Sí, los paquetes Estándar y Premium incluyen orquestación programada para que los pipelines funcionen automáticamente.

