J'extraurai des tableaux de PDF ou de rapports scannés en Excel propre
Analyse des données
Niveau 1
Répond à certains critères de performance et présente un fort potentiel sur la place de marché.
À propos de ce service
Envoyez-moi un PDF textuel ou scanné et je vous retournerai un fichier Excel structuré et propre avec chaque tableau extrait, correctement typé et fusionné dans un seul classeur.
Ce que vous obtenez :
- Un fichier .xlsx propre avec une feuille par tableau source (ou fusionné en un seul tableau organisé sur demande)
- En-têtes de colonnes normalisés, types corrigés (nombres, dates, devises)
- Une colonne de référence de la page source pour que vous puissiez vérifier l'extraction
- Optionnel : une feuille « validation » signalant les lignes à faible confiance
Je peux extraire de :
- États financiers, rapports annuels, 10-K
- Déclarations gouvernementales / réglementaires
- Articles académiques (tableaux et listes de références)
- Factures et reçus
- Rapports scientifiques et livres blancs
- Annonces immobilières et catalogues
- PDFs de résultats d’enquêtes
Les PDFs textuels et les PDFs scannés sont traités, OCR inclus si nécessaire, sans coût supplémentaire.
Pourquoi je suis rapide : détection de tableaux assistée par IA et OCR + contrôle qualité humain. La plupart des commandes sont expédiées le jour même pour moins de 50 pages.
Indiquez le PDF dans les exigences de la commande avec une ligne précisant quels tableaux vous souhaitez (ou « tous »). Je m’occupe du reste.
Outil:
Excel
•
Google Sheets
•
Documents Google
FAQ
Traduction automatique
Qu'est-ce qui est inclus dans le forfait de base ?
(1) Jusqu'à 10 pages ; (2) PDFs textuels uniquement (pas d'OCR) ; (3) Un seul tableau par page ; (4) sortie .xlsx propre ; (5) référence de la page source
Qu'est-ce qui est inclus dans le forfait standard ?
(1) Jusqu'à 50 pages ; (2) PDFs textuels ou scannés (OCR inclus) ; (3) Plusieurs tableaux par page gérés ; (4) en-têtes normalisés, correction des types ; (5) fusion optionnelle en un seul tableau organisé ; (6) feuille de validation signalant les lignes à faible confiance
Qu'est-ce qui est inclus dans le forfait premium ?
(1) Jusqu'à 200 pages ; (2) PDFs textuels ou scannés (OCR inclus) ; (3) tableaux complexes multi-pages, gestion des notes de bas de page, tableaux tournés ; (4) nettoyage complet + validation ; (5) script Python réutilisable pour répéter l'extraction sur des PDFs similaires à l'avenir ; (6) README explicatif
Mon document restera-t-il privé ?
Oui — je ne partage ni ne réutilise jamais les fichiers clients. NDA disponible sur demande.
Mon PDF contient des notes manuscrites — pouvez-vous les extraire ?
Le texte imprimé et la majorité des écritures propres oui. Les écritures approximatives seront traitées au mieux et signalées. Contactez-moi d’abord avec une page d’exemple.
Pouvez-vous extraire uniquement certains tableaux, pas tous ?
Oui — indiquez les numéros de tableau / pages dont vous avez besoin.
Pouvez-vous traiter des PDFs non anglophones ?
Oui — la plupart des langues latines majeures et CJK. Indiquez-moi la langue source dès le départ.
Mes PDFs arrivent chaque mois — pouvez-vous automatiser cela ?
Le niveau premium inclut un script Python que vous pouvez exécuter sur de nouveaux PDFs du même modèle. Pour une automatisation complète (surveillance de fichiers, fonction cloud), contactez-moi pour un devis personnalisé.
Mon PDF dépasse 200 pages. C’est possible ?
Oui, contactez-moi pour une offre personnalisée — généralement 1,50 $ par page pour les PDFs textuels, 2,50 $ par page pour les scans.

