Je vais extraire les tableaux PDF vers Excel ou CSV avec références de page source

Certaines informations ont été traduites automatiquement.

Chine

Je parle Chinois, Anglais

Développeur Full Stack pour l’automatisation Python et le web scraping

Développeur full-stack spécialisé en automatisation Python, workflows PDF et tableurs, nettoyage de données, extraction de données web, correction de bugs et intégrations API. Je fournis des sorties s...
À propos de ce service

Je vais extraire les tableaux des PDFs basés sur du texte en fichiers Excel ou CSV propres. Chaque ligne de sortie inclut le nom du fichier source et le numéro de page, sauf si vous me demandez de les omettre. Je peux gérer des tableaux sur plusieurs pages, des en-têtes répétés, des pages tournées, et je marque clairement les lignes nécessitant une révision.


Tous les forfaits incluent une sortie structurée et une validation de base. La version standard ajoute un tableau maître fusionné, une liste d’exception et un résumé QA. La version premium comprend également un workflow CLI local réutilisable et un README pour les fichiers futurs.


Veuillez envoyer des échantillons représentatifs avant de commander afin que je puisse confirmer la mise en page et les vérifications d’acceptation. Les PDFs scannés ou uniquement en image, l’écriture manuscrite, les fichiers cryptés et les mises en page très irrégulières ne sont pas inclus sauf accord dans une offre personnalisée. N’uploadez que les fichiers que vous êtes autorisé à partager.


J’utilise éventuellement Python et des outils assistés par IA lorsque cela est autorisé. Chaque livraison est personnalisée et vérifiée. Informez-moi avant de commander si votre workflow doit être non-IA ou uniquement local.

Technologie:

Excel

Python

Expertise:

Extraction des données

Manipulation des données

Mon portfolio