Construiré una pipeline de scraping web en Python o automatización con IA
Ingeniero de automatización con IA y backend, Python FastAPI RAG
Acerca de este Servicio
Construyo pipelines de datos que siguen funcionando después de la entrega, no scripts que se rompen en una semana.
Lo que hago:
- Extraer datos de negocios, productos y contactos de sitios y APIs (Google Places, directorios públicos, sitios personalizados)
- Limpiarlos correctamente: números de teléfono a E.164, eliminar duplicados con coincidencia difusa, verificar correos electrónicos (MX/SMTP), descartar registros inválidos
- Guardarlos en una base de datos real (PostgreSQL/Supabase) con ejecuciones programadas o bajo demanda
- Capa opcional de IA: puntuar y calificar cada registro con un LLM más una razón en una línea, o extraer datos estructurados de textos y PDFs desordenados
Utilizo APIs oficiales cuando existen y solo recurro al scraping en bruto cuando no hay API, y te digo cuál es cuál en lugar de entregar algo que se rompe con el próximo cambio de diseño.
Trabajo reciente: un motor de leads en cuadrícula que obtiene casi toda la cobertura de la ciudad en lugar de los 60 resultados truncados que la mayoría de los scrapers pierden silenciosamente.
Pila tecnológica: Python, httpx, BeautifulSoup, Playwright, Pandas, PostgreSQL, APIs de LLM.
Envíame tus sitios y campos objetivo antes de ordenar para confirmar que es posible y ofrecerte una cotización precisa.
Tecnología:
scrapy
•
Selenium
•
Beautiful Soup
•
Playwright
•
Pandas
Técnica:
Automatizado

