Construiré pipelines de datos ETL automatizados con dbt y BigQuery
Acerca de este Servicio
La mayoría de los problemas de datos no son problemas de análisis. Son problemas de infraestructura. Los números viven en cinco herramientas, tres de ellas en desacuerdo, y alguien en tu equipo vuelve a construir el mismo informe a mano cada lunes.
Construyo el pipeline que hace que eso se detenga.
Lo que hago:
Traslado tus datos desde sus fuentes a BigQuery en un horario automatizado. Los modela en dbt para que estén limpios, probados y documentados. Los entrego estructurados para que tus informes extraigan de una sola fuente en lugar de cinco.
Fuentes típicas: Shopify, Stripe, HubSpot, Salesforce, Google Ads, Facebook Ads, GA4, Postgres, MySQL, Google Sheets.
Para quién es esto:
Equipos que ya tienen datos y no pueden confiar en ellos. Si exportas CSVs para armar informes, esta es la solución.
Por qué elegirme:
Diez años en análisis, la mayor parte en agencia, gestionando pipelines para clientes de CPG, servicios financieros y medios minoristas. He construido esto para empresas donde los informes iban a un CMO, así que tenían que ser correctos.
Obtienes código funcional, documentación y una explicación paso a paso. Sin caja negra que tengas que pagarme para mantener.
Envíame un mensaje con las herramientas que usas y te diré si esto es adecuado antes de que hagas tu pedido.
Mi porfolio
FAQ
Traducción automática
¿Ya necesito tener una cuenta en BigQuery?
No. Si no tienes una, te guiaré en la creación del proyecto durante la incorporación. Tú eres dueño de la cuenta y la facturación, no yo. La capa gratuita de Google cubre la mayoría de cargas de trabajo pequeñas y medianas.
¿Cuánto cuesta esto después de que termines?
El pipeline en sí es tuyo sin tarifa continua para mí. Pagas a Google por almacenamiento y consultas en BigQuery, que para la mayoría de las pequeñas empresas cuesta unos pocos dólares al mes. Si usas una herramienta de conexión de pago como Fivetran, tiene su propia tarifa basada en el volumen de filas. Te diré el costo esperado antes de que hagamos el pedido.
¿Qué acceso necesitas de mí?
Acceso de lectura a tus fuentes de datos y administración en el proyecto de BigQuery. Nunca necesito tus contraseñas. Todo funciona mediante credenciales API adecuadas o cuentas de servicio que puedes revocar en cualquier momento.
¿Mi data está desordenada? ¿Eso es un problema?
Ese es el trabajo. Los registros duplicados, nombres inconsistentes, formatos de fecha diferentes y columnas que significan cosas distintas en diferentes sistemas son normales. Limpiarlo es para eso la capa de modelado en dbt.
¿Puedes conectar una fuente que no esté en tu lista?
Generalmente sí. Si la herramienta tiene una API o exporta a una base de datos, puede conectarse. Envíame un mensaje antes de ordenar y te confirmaré.
¿Qué pasa si el pipeline se rompe más tarde?
Recibirás documentación que explica cómo funciona y cómo solucionar problemas comunes. También estoy disponible para soporte continuo como un acuerdo separado si lo deseas. Nada está bloqueado detrás de mí.
¿También construyes los dashboards?
No en este trabajo. Esto limpia y estructura tus datos para que tus herramientas existentes funcionen correctamente. Si necesitas dashboards sobre ello, envíame un mensaje y podemos definirlo por separado.
¿Por qué no usar simplemente una herramienta sin código?
Para una fuente simple, una herramienta sin código puede ser suficiente. Esto es para cuando tienes varias fuentes que necesitan unirse, deduplicar y reconciliarse entre sí, que es donde esas herramientas fallan.

