Extracción masiva de datos PDF

Job ID: 40416958

Budget: $45 – $50 USD

Dispongo de 700 archivos PDF y necesito consolidar su información en una sola hoja de Excel. De cada PDF requiero:

• ID o código del producto
• Descripción del producto
• Recorte de la imagen donde se muestre la vista isométrica del producto (la posición varía en cada PDF) y la banda de colores asociada

Puntos clave:
– Los PDFs no comparten una plantilla fija, por lo que el script o procedimiento debe localizar la imagen aunque cambie de lugar.
– La vista isométrica es el único ángulo que me interesa; si el PDF muestra varias imágenes, solo debe extraerse esa.
– El resultado final debe ser un archivo .xlsx con columnas ID, Descripción, Imagen y Colores. La imagen puede incrustarse o indicarse mediante enlace a una carpeta ordenada por ID, según la solución que propongas.
– Prefiero un proceso automatizado (Python, R, VBA, etc.) que pueda reutilizar cuando lleguen nuevos lotes de PDFs.

Entrego ejemplos representativos para pruebas iniciales y espero una entrega verificable con al menos 10 registros antes de procesar el lote completo.