J'extraurai les données de PDF et de documents scannés vers Excel CSV ou json
Extraction de données, automatisation Python et QA logiciel
À propos de ce service
J'extrais des données utiles de PDFs et de documents scannés dans des fichiers Excel, CSV ou JSON propres. Mon travail actuel inclut l'OCR et l'extraction de dossiers UCC provenant de sources gouvernementales américaines.
Le forfait pilote comprend :
- Jusqu'à 50 pages de texte tapé, avec une mise en page cohérente
- Jusqu'à 10 champs convenus
- Un seul format de sortie : Excel, CSV ou JSON
- Mise en forme, validation de base et vérification des doublons
- Un script d'extraction Python réutilisable avec instructions d'installation
- Une révision dans le cadre initial
Veuillez m'envoyer un message avec 2-3 pages représentatives et votre format de sortie souhaité avant de commander, afin que je puisse confirmer le périmètre.
L'écriture manuscrite, les scans de mauvaise qualité, les tableaux complexes, les mises en page multiples, le web scraping, les intégrations API et l'hébergement cloud nécessitent un devis séparé. L'utilisation payante de l'OCR/API est exclue et doit être convenue à l'avance. Les valeurs illisibles ou incertaines sont signalées pour révision.
Mon historique sur Upwork : plus de 200 000 $ gagnés, 100 % de réussite, Top Rated Plus, 193 missions et plus de 5600 heures. Je vérifie personnellement le résultat avant livraison.
Technologie:
Excel
•
Google Sheets
•
Python
