Extracción masiva de datos PDF
Budget: $45 – $50 USD
Dispongo de 700 archivos PDF y necesito consolidar su información en una sola hoja de Excel. De cada PDF requiero:
• ID o código del producto
• Descripción del producto
• Recorte de la imagen donde se muestre la vista isométrica del producto (la posición varía en cada PDF) y la banda de colores asociada
Puntos clave:
– Los PDFs no comparten una plantilla fija, por lo que el script o procedimiento debe localizar la imagen aunque cambie de lugar.
– La vista isométrica es el único ángulo que me interesa; si el PDF muestra varias imágenes, solo debe extraerse esa.
– El resultado final debe ser un archivo .xlsx con columnas ID, Descripción, Imagen y Colores. La imagen puede incrustarse o indicarse mediante enlace a una carpeta ordenada por ID, según la solución que propongas.
– Prefiero un proceso automatizado (Python, R, VBA, etc.) que pueda reutilizar cuando lleguen nuevos lotes de PDFs.
Entrego ejemplos representativos para pruebas iniciales y espero una entrega verificable con al menos 10 registros antes de procesar el lote completo.
• ID o código del producto
• Descripción del producto
• Recorte de la imagen donde se muestre la vista isométrica del producto (la posición varía en cada PDF) y la banda de colores asociada
Puntos clave:
– Los PDFs no comparten una plantilla fija, por lo que el script o procedimiento debe localizar la imagen aunque cambie de lugar.
– La vista isométrica es el único ángulo que me interesa; si el PDF muestra varias imágenes, solo debe extraerse esa.
– El resultado final debe ser un archivo .xlsx con columnas ID, Descripción, Imagen y Colores. La imagen puede incrustarse o indicarse mediante enlace a una carpeta ordenada por ID, según la solución que propongas.
– Prefiero un proceso automatizado (Python, R, VBA, etc.) que pueda reutilizar cuando lleguen nuevos lotes de PDFs.
Entrego ejemplos representativos para pruebas iniciales y espero una entrega verificable con al menos 10 registros antes de procesar el lote completo.