Je vais extraire des sites web dynamiques avec playwright, selenium et python

Certaines informations ont été traduites automatiquement.

Pakistan

Je parle Anglais

Ingénieur en automatisation QA pour Playwright

Je suis un ingénieur en automatisation QA spécialisé dans Playwright, TypeScript/JavaScript, Python et les tests E2E. Je conçois des frameworks d'automatisation fiables et faciles à maintenir, qui réd...
À propos de ce service

Vous avez besoin de données structurées provenant d’un site web dynamique ou riche en JavaScript ?

Je vais créer une solution fiable de web scraping en utilisant Python, Playwright, Selenium, Scrapy ou Requests, en fonction du site et des exigences du projet.

Je peux extraire :

  • Sites JavaScript dynamiques
  • Données produits et e-commerce
  • Annuaire d’entreprises
  • Tableaux et répertoires
  • Sites paginés
  • Résultats de recherche
  • Données structurées accessibles publiquement
  • Sites nécessitant une interaction avec le navigateur


Je peux gérer :

  • Pagination
  • Défilement infini
  • Contenu dynamique
  • Automatisation du navigateur
  • Nettoyage et transformation des données
  • Suppression des doublons
  • Sortie en CSV, Excel ou JSON
  • Spiders Scrapy
  • Automatisation du navigateur avec Playwright/Selenium
  • Scripts de scraping réutilisables


Les technologies avec lesquelles je travaille incluent Python, Playwright, Selenium, Scrapy, Scrapy-Playwright, Requests, BeautifulSoup et Pandas.


Vous recevrez des données propres et structurées ou du code source réutilisable, selon vos besoins.


Veuillez me contacter avant de commander pour que je puisse examiner le site cible, les champs requis, le nombre de pages et le format de sortie attendu.

Je ne travaille qu’avec des données accessibles publiquement et des projets.

Technologie:

Python

•

scrapy

•

sélénium

•

Beautiful Soup

•

Playwright

Type d'information:

Veille concurrentielle

•

Devise et actions

Technique:

Automatisé(e)

Mon portfolio