Je ferai du web scraping en Python et une extraction de données vers Excel ou csv
APIs backend Python, automatisation et web scraping
À propos de ce service
La plupart des scrapers échouent dès qu’un site change sa mise en page. Pas les miens. Je les construis avec des tentatives répétées, une limitation du débit et une étape de validation qui repère les mauvaises lignes avant même que vous ne voyiez le fichier.
Je crée des outils de traitement de données en Python à plein temps, et mon travail est public sur GitHub, notamment une plateforme de suivi des prix qui surveille les boutiques en ligne dans le temps et un crawler qui respecte robots.txt et les limites de débit.
CE QUE VOUS OBTENEZ
Un Excel ou CSV propre avec de vrais en-têtes, des types corrects et sans doublons
Produits, prix, contacts, annonces, avis, tableaux, résultats de recherche
Pagination, filtres, pages de connexion et sites rendus en JavaScript
Le code source Python, pour que vous ne soyez jamais bloqué
Un court README pour que vous puissiez le faire tourner vous-même
COMMENT ÇA FONCTIONNE
1. Envoyez-moi l’URL et les champs que vous souhaitez
2. Je scrape 20 lignes et vous les envoie gratuitement, pour que vous vérifiiez le format
3. Vous validez, je lance le travail complet et je vous livre le fichier
CE QUE JE NE FERAI PAS
Pas de LinkedIn, Facebook ou Instagram. Rien derrière un paywall que vous ne possédez pas. Rien dont les termes d’utilisation interdisent clairement la copie. Parfois, la réponse est non et je vous le dirai avant que vous ne payiez.
Envoyez-moi le site que vous avez en tête et je vous dirai honnêtement si cela peut être fait.
Technologie:
Python
•
Excel
•
scrapy
•
sélénium
•
Beautiful Soup
Technique:
Automatisé(e)
Mon portfolio
FAQ
Traduction automatique
Pouvez-vous scraper un site nécessitant une connexion ?
Oui, si le compte vous appartient et que vous avez l’autorisation de partager l’accès. Vous me donnez les identifiants, je ne les utilise que pour votre projet et je les supprime à la livraison.
Que faire si le site charge des données avec JavaScript ?
C’est normal et cela est couvert à partir du package Standard. J’utilise un navigateur sans interface graphique lorsque une requête simple ne suffit pas.
Est-ce que je reçois le code ou seulement le fichier de données ?
Les packages Standard et Premium incluent le code source Python complet et un README. Le package Starter fournit uniquement le fichier de données.
Comment savoir si les données seront correctes avant de payer ?
Contactez-moi d’abord. Je scrape environ 20 lignes de votre page cible et vous les envoie gratuitement, pour que vous vérifiiez les colonnes et le format.
Pouvez-vous exécuter le scraper automatiquement tous les jours ?
Oui, c’est le package Premium. Je configure une tâche programmée qui écrit des données fraîches dans votre fichier selon le calendrier que vous choisissez.
Le web scraping est-il légal ?
Les données publiques sont généralement acceptables, les données privées ou protégées par copyright ne le sont pas. Je vérifie d’abord les termes du site et robots.txt, et je refuse les projets qui dépassent ces limites.
Que faire si le site change et que le scraper ne fonctionne plus ?
Contactez-moi dans les 30 jours et je le réparerai gratuitement. Pour une assistance prolongée, un coût mensuel de maintenance s’applique.

