Crearé un scraper web personalizado o un rastreador de datos automatizado en python

Parte de la información se ha traducido automáticamente.

Pakistán

Hablo Pashto, Urdu, Inglés

Experto en Web Scraping y Automatización en Python, Selenium, Playwright, OCR

Construyo pipelines de datos automatizados que extraen datos estructurados de sitios web, incluyendo sitios protegidos por login, captchas o contenido escaneado o basado en imágenes, entregándolos lim...
Acerca de este Servicio

Construyo scrapers web personalizados en Python y pipelines de automatización de datos que convierten contenido web disperso en conjuntos de datos limpios y estructurados. Trabajo con requests + BeautifulSoup para sitios estándar y Playwright para sitios con mucho JavaScript o protegidos contra bots (Cloudflare, contenido dinámico, páginas con login).

Recientemente completé un proyecto del mundo real raspando 13 glosarios y sitios de referencia de la industria del petróleo y gas, manejando HTML estático, datos JSON-LD incrustados, interacciones con clics en JS y protección de Cloudflare, fusionando todo en un conjunto de datos CSV limpio y sin duplicados. Puedes ver el proyecto completo en mi GitHub.

Lo que puedo hacer por ti:

  • Raspar listados de productos, directorios, glosarios, precios, información de contacto o cualquier dato estructurado en la web
  • Manejar páginas dinámicas/renderizadas con JS y protección básica contra bots
  • Fusionar y eliminar duplicados de datos de múltiples fuentes en un solo archivo limpio
  • Entregar en formato CSV, Excel o JSON, según prefieras

Envíame tus sitios objetivo antes de ordenar para que pueda confirmar la viabilidad (algunos sitios tienen bloqueos técnicos o legales difíciles, los señalaré desde el principio, con honestidad, en lugar de prometer de más).

Tecnología:

Python

•

Excel

•

Selenium

•

Beautiful Soup

•

Playwright

Tipo de información:

Información de contacto

Técnica:

Automatizado

Mi porfolio