El proyecto consiste en un desarrollo automático de extracción de información de Wikipedia. La información que se necesita extraer incluye imágenes, referencias y texto.
Budget: $250 – $750 USD
Estoy buscando un desarrollador que pueda automatizar la extracción de información de Wikipedia para nuestro negocio existente. El proyecto consiste en extraer imágenes, referencias y texto de páginas de Wikipedia.
Habilidades y experiencia preferidas:
- Alto dominio del lenguaje de programación JavaScript.
- Experiencia en extracción de datos de fuentes web.
- Familiaridad con el trabajo con formato de datos JSON.
El candidato ideal debe tener experiencia en la automatización de tareas de web scraping y poder extraer de manera eficiente la información requerida de las páginas de Wikipedia. También deben tener habilidades para trabajar con JavaScript y tener un buen conocimiento del formato de datos JSON.
Competencia en la extracción de imágenes, referencias y texto de Wikipedia.
- Familiaridad con herramientas y técnicas para la extracción de datos de Wikipedia.
El objetivo de las imágenes extraídas es incorporarlas a una herramienta en Oracol, utilizando SQL y Java 1.8.
El número de páginas de las que es necesario extraer la información depende del número de personas que tienen información sobre Wikipedia en mi base de datos, que actualmente contiene 20.000 entradas.
Si tiene las habilidades y experiencia necesarias en la extracción de información de Wikipedia y está interesado en este proyecto, envíe su propuesta.
XML Oracol SQL Json Wikipedia API
Habilidades y experiencia preferidas:
- Alto dominio del lenguaje de programación JavaScript.
- Experiencia en extracción de datos de fuentes web.
- Familiaridad con el trabajo con formato de datos JSON.
El candidato ideal debe tener experiencia en la automatización de tareas de web scraping y poder extraer de manera eficiente la información requerida de las páginas de Wikipedia. También deben tener habilidades para trabajar con JavaScript y tener un buen conocimiento del formato de datos JSON.
Competencia en la extracción de imágenes, referencias y texto de Wikipedia.
- Familiaridad con herramientas y técnicas para la extracción de datos de Wikipedia.
El objetivo de las imágenes extraídas es incorporarlas a una herramienta en Oracol, utilizando SQL y Java 1.8.
El número de páginas de las que es necesario extraer la información depende del número de personas que tienen información sobre Wikipedia en mi base de datos, que actualmente contiene 20.000 entradas.
Si tiene las habilidades y experiencia necesarias en la extracción de información de Wikipedia y está interesado en este proyecto, envíe su propuesta.
XML Oracol SQL Json Wikipedia API