Je vais extraire des sites web dynamiques avec playwright, selenium et python
Ingénieur en automatisation QA pour Playwright
À propos de ce service
Vous avez besoin de données structurées provenant d’un site web dynamique ou riche en JavaScript ?
Je vais créer une solution fiable de web scraping en utilisant Python, Playwright, Selenium, Scrapy ou Requests, en fonction du site et des exigences du projet.
Je peux extraire :
- Sites JavaScript dynamiques
- Données produits et e-commerce
- Annuaire d’entreprises
- Tableaux et répertoires
- Sites paginés
- Résultats de recherche
- Données structurées accessibles publiquement
- Sites nécessitant une interaction avec le navigateur
Je peux gérer :
- Pagination
- Défilement infini
- Contenu dynamique
- Automatisation du navigateur
- Nettoyage et transformation des données
- Suppression des doublons
- Sortie en CSV, Excel ou JSON
- Spiders Scrapy
- Automatisation du navigateur avec Playwright/Selenium
- Scripts de scraping réutilisables
Les technologies avec lesquelles je travaille incluent Python, Playwright, Selenium, Scrapy, Scrapy-Playwright, Requests, BeautifulSoup et Pandas.
Vous recevrez des données propres et structurées ou du code source réutilisable, selon vos besoins.
Veuillez me contacter avant de commander pour que je puisse examiner le site cible, les champs requis, le nombre de pages et le format de sortie attendu.
Je ne travaille qu’avec des données accessibles publiquement et des projets.
Technologie:
Python
•
scrapy
•
sélénium
•
Beautiful Soup
•
Playwright
Technique:
Automatisé(e)
