Scraper Web Continuo Anti-Captcha

Job ID: 40131657

Budget: $10 – $30 USD

Necesito un scraper que funcione las 24 h extrayendo únicamente información de contacto de un sitio concreto. El portal dispara un captcha de forma aleatoria, por lo que el código deberá incluir la integración directa de un script que lo resuelva automáticamente; no quiero depender de avisos manuales ni de servicios externos que requieran interacción humana.

La extracción tiene que ser constante: el robot debe detectar nuevas páginas, procesarlas y, si el sitio se queda sin cambios, mantenerse a la espera sin cerrar la sesión. También necesito que se reinicie de manera autónoma cuando ocurra cualquier excepción para garantizar que nunca se detenga.

Entrego acceso a una cuenta de prueba y las rutas de las secciones donde aparece la información de contacto; tú decides la tecnología siempre que sea estable (Python + Selenium/Playwright, Node + Puppeteer, etc.) y permita logging detallado.

Acepto el trabajo cuando:
• El scraper corra ininterrumpidamente por lo menos 24 h en mi servidor Linux.
• El módulo de resolución de captcha esté integrado y parametrizable.
• Pueda ver los datos capturados guardados en CSV o en una tabla MySQL/PostgreSQL.

Incluye en la entrega:
• Código fuente documentado.
• Script/servicio de arranque automático (systemd, Docker o equivalente).
• Archivo de configuración externo para credenciales y claves del servicio anticaptcha.

Cualquier duda técnica, pregúntame antes de avanzar.
Related categories: PHP JavaScript Python Web Scraping MySQL Node.js PostgreSQL Selenium