Scraping Web con Cloudflare y reCAPTCHA

Job ID: 40380023

Budget: $10 – $30 USD

Necesito un scraper robusto que automatice la extracción periódica de datos de una web app sofisticada construida con Ionic. El sitio está protegido por Cloudflare y reCAPTCHA invisible, así que el script debe sortear ambas capas sin intervención humana.

Qué busco:
• Automatizar la tarea de extracción en intervalos regulares (cron o equivalente).
• Guardar los datos en JSON o insertarlos directamente en mi base de datos; podemos definir el formato final juntos.
• Preferencia por Python (requests, Playwright, Selenium, cloudscraper) u otra tecnología que garantice estabilidad y bajo riesgo de bloqueo.

Entregables:
1. Código fuente bien documentado.
2. Instrucciones de despliegue en Linux.
3. Tarea programada que ejecute la extracción con la frecuencia acordada. (rapido)
4. Sistema de logs que confirme cada ronda de scraping y muestre cualquier error.

Criterios de aceptación:
• Funciona al menos una semana seguida sin bloqueo.
• Regenera cookies/tokens de manera automática cuando Cloudflare actualice el desafío.
• Mantiene la extracción dentro del tiempo de ejecución que definamos conjuntamente.

Si ya has resuelto retos similares con Cloudflare y reCAPTCHA invisible, comparte ejemplos y dime qué librerías planeas usar y tu plazo estimado de entrega.