Scraper + Procesador de Texto para Remates de Propiedades (español obligatorio)

Job ID: 39489990

Budget: $10 – $30 USD

Se requiere un desarrollador con experiencia en web scraping y procesamiento de lenguaje natural (NLP) para implementar un script capaz de extraer, procesar y estructurar información legal publicada en el sitio web de remates de propiedades del diario El Mercurio en Chile.

Sitio objetivo:
https://www.economicos.cl/todo_chile/remates_de_propiedades_el_mercurio

Alcance del trabajo:

El script debe recopilar todos los avisos de remates desde la página 1 hasta el último aviso cuya fecha de publicación sea “hace un mes”.

Para cada aviso, deberá ingresar al enlace correspondiente y extraer el texto completo publicado.
A partir de ese contenido, el sistema deberá procesar el texto en español y extraer de forma estructurada los siguientes campos:

Fecha del remate
Hora del remate
Tribunal que lo ordena (juzgado)
Dirección del inmueble
Rol de la causa judicial
Postura mínima
Inscripción en el Conservador de Bienes Raíces
Rol de avalúo fiscal del inmueble

El resultado deberá consolidarse en un archivo Excel (.xlsx), incluyendo además el enlace (URL) original de cada aviso.

Requisitos del desarrollo:

El script debe poder ejecutarse on demand (por ejemplo, desde línea de comandos o archivo ejecutable), sin necesidad de configurar una ejecución periódica ni desplegarlo en un servidor.

El código debe estar desarrollado en Python, utilizando librerías como requests, BeautifulSoup, Selenium (si es necesario), y alguna herramienta o modelo de NLP (por ejemplo, spaCy, transformers o similar) que permita extraer los datos contextualmente desde el texto libre en español.

El resultado debe almacenarse en un archivo Excel con una estructura clara y ordenada.

Formato de entrega esperado (Excel):

| Fecha Remate | Hora | Juzgado | Dirección | Rol Causa | Postura Mínima | Inscripción CBR | Rol Avalúo | URL |

Se valorará positivamente:
Experiencia previa trabajando con textos legales en español.
Uso de modelos de lenguaje avanzados para interpretar contenido no estructurado.
Código limpio, comentado y entregado con instrucciones claras de uso.

Al momento de postular, por favor indicar:
Experiencia previa en proyectos similares.
Herramientas o librerías que propone utilizar.
Estrategia para el análisis y extracción de los campos requeridos.
Tiempo estimado de ejecución.
Presupuesto total.
Related categories: Python Data Processing Web Scraping