Web Scraping Project

Job ID: 38153741

Budget: $10 – $100 USD

Descripción del Proyecto
Estoy buscando un programador con experiencia en web scraping, análisis de datos y desarrollo de soluciones automatizadas. La tarea consiste en extraer información específica de varias páginas web y almacenar los datos en un archivo CSV. Los detalles de los requerimientos se encuentran a continuación.

Requerimientos del Proyecto
Páginas Web a Extraer:

Primera Página:
Extraer todos los precios de los sublinks existentes (5 sublinks).
Información requerida: referencia, descripción y precio del producto.

Otras Tres Páginas Web:
Extraer referencia, descripción y precio del producto basado en palabras clave especificadas.
Las palabras clave se tomarán de un archivo plano.
El script debe guardar las palabras clave en memoria y permitir recargar el archivo plano para actualizarlas o utilizar las que ya tiene en memoria.
Tecnología:

Lenguaje de programación: Python.

Formato de Salida:

Los datos extraídos deben ser almacenados en un archivo CSV con la siguiente estructura: referencia, descripción, precio, página y fecha de captura.
Debe ser posible descargar el archivo CSV y permitir al usuario elegir la ruta de descarga por defecto.
Automatización:

El script debe poder ejecutarse automáticamente de manera semanal.
Opción para ejecución manual cuando el usuario lo desee.
Entregables
Código fuente en Python bien documentado.
Archivo CSV con los datos extraídos.
Funcionalidad para descargar el archivo CSV y escoger la ruta por defecto para dicho fin.
Instrucciones para la configuración y ejecución del script tanto manual como automáticamente.
Plazo y Propuesta
El tiempo estimado para completar el proyecto es de 10 a 30 días como máximo.

*********************************************************************************************************

Application for Programmer - Web Scraping Project
Project Description
I am looking for a programmer with experience in web scraping, data analysis, and automated solutions development. The task involves extracting specific information from several websites and storing the data in a CSV file. Detailed requirements are provided below.

Project Requirements
Web Pages to Scrape:

First Page:
Extract all prices from existing sublinks (5 sublinks).
Required information: product reference, description, and price.
Other Three Web Pages:
Extract product reference, description, and price based on specified keywords.
Keywords will be taken from a flat file.
The script should store keywords in memory and allow reloading the flat file to update keywords or use the ones already in memory.
Technology:

Programming language: Python.
Output Format:

Extracted data should be stored in a CSV file with the following structure: reference, description, price, page, and capture date.
It should be possible to download the CSV file and allow the user to choose the default download path.
Automation:

The script should be able to run automatically on a weekly basis.
Option for manual execution when desired by the user.
Deliverables
Well-documented Python source code.
CSV file with the extracted data.
Functionality to download the CSV file and select the default path for this purpose.
Instructions for setting up and running the script both manually and automatically.
Timeline and Proposal
The estimated time to complete the project is 10 to 30 days maximum.