Développement d'un Système OCR pour l'extraction automatique de données sur des documents administratifs (Factures, BC, Permis, etc.)

Job ID: 38591025

Budget: $750 – $1,500 USD

Nous recherchons un développeur freelance expérimenté pour créer un système d'OCR (Reconnaissance Optique de Caractères) capable d'extraire automatiquement les informations à partir de différents types de documents administratifs. L'objectif principal du projet est de permettre l'automatisation de la reconnaissance, du tri et de l'extraction des données à partir de ces documents, avec une précision et une fiabilité élevées.

Factures
Bons de Commande (BC)
Contrat
Bons d'achat

Fonctionnalités attendues :
Reconnaissance de texte précise : Extraction des informations clés telles que le nom, l'adresse, les montants, les dates, les numéros de commande, etc., avec une haute précision.
Traitement multi-langues : Le système doit être capable de reconnaître et d'extraire les informations des documents en plusieurs langues, principalement en français et en anglais.
Classification automatique des documents : Identifier automatiquement le type de document (facture, BC, passeport, etc.).
Interface utilisateur simple : Une interface pour charger des documents et visualiser les informations extraites.
Export des données : Capacité d'exporter les informations extraites vers différents formats (CSV, JSON, XML, etc.).
Modèle d'auto-apprentissage : Possibilité d'améliorer la précision du système avec l'ajout de nouveaux exemples et documents (optionnel mais apprécié).

Compétences requises :

Expérience avérée en développement de systèmes OCR.
Compétence dans l’utilisation d’outils et frameworks OCR tels que Tesseract, Paddle OCR, Paddle, Yolo, ou équivalents.
Expérience en traitement d'images (optimisation de la qualité d'image pour la reconnaissance).
Connaissance en intelligence artificielle et machine learning pour l'amélioration de la précision de l'OCR (souhaitable).


Candidature :
Veuillez fournir des exemples de projets similaires que vous avez réalisés, votre approche pour ce projet, ainsi qu'une estimation du coût et du temps nécessaire pour le développement.

Nous cherchons une collaboration de qualité et à long terme, car d'autres types de documents pourraient être ajoutés au système à l'avenir.
Related categories: Python OCR Celery RabbitMQ YOLO