J'extrairai les données des dépôts SEC EDGAR dans des ensembles de données Excel ou csv propres
Data Engineer : GCP, AWS, pipelines ETL, BigQuery, dbt, intégration API
Niveau 2
Répond à des critères de performance élevés et a fait ses preuves en matière de satisfaction clients.
À propos de ce service
Vous avez besoin de données de dépôt SEC sans passer des semaines à vous battre avec EDGAR vous-même ?
Je transforme les dépôts SEC EDGAR en ensembles de données propres, prêtes à l’analyse.
CE QUE JE PEUX EXTRAIRE
- états financiers 10-K / 10-Q (XBRL vers tableaux structurés)
- Form D - sociétés privées récemment financées (idéal pour les listes de prospects)
- Form 3/4/5 - achats et ventes d’insiders
- 13F - participations des fonds institutionnels et hedge funds
- 8-K - événements importants et changements de direction
- recherche par mots-clés dans le texte intégral de tous les types de dépôt
CE QUE VOUS RECEVEZ
CSV ou Excel propre. Colonnes correctement typées, doublons supprimés, chaque champ documenté pour que vous sachiez ce que vous regardez. Prêt pour Excel, Power BI ou votre base de données. Pas un simple dump brut que vous devez encore nettoyer.
POURQUOI MOI
Je suis un ingénieur en données (Python, SQL, BigQuery, Airflow, dbt) qui construit des pipelines de production, pas des scripts jetables. J’utilise les API officielles SEC et des ensembles de données en masse, donc les résultats sont précis, reproductibles et conformes aux règles d’accès équitable de la SEC.
Besoin en continu ? La version Premium fournit un pipeline réutilisable que vous possédez et exécutez vous-même.
Toutes les données EDGAR sont des documents publics. Contactez-moi avec les sociétés, types de formulaires et plage de dates, et je vous confirmerai ce qui est possible avant votre commande.
Mon portfolio
FAQ
Traduction automatique
Est-il légal d’extraire les données SEC EDGAR ?
Oui. Chaque dépôt EDGAR est un document public publié par la Securities and Exchange Commission des États-Unis. J’utilise les API officielles SEC et les fichiers de données en masse, en respectant leurs limites de taux publiées, donc rien n’est extrait derrière un login ou un paywall.
Quels formats de fichiers livrez-vous ?
Par défaut, en CSV et Excel. Je peux aussi fournir en JSON, Parquet, Google Sheets, ou charger directement dans votre base ou entrepôt comme PostgreSQL, BigQuery ou Snowflake. Dites-moi simplement où cela doit arriver.
Jusqu’à quelle date puis-je extraire des dépôts historiques ?
EDGAR conserve les dépôts électroniques depuis 1993, et les données financières structurées XBRL depuis environ 2009. Toute période dans cette fenêtre fonctionne. Les dépôts antérieurs à 2009 sont basés sur du texte et nécessitent un temps supplémentaire de parsing, donc prévoyez un délai de livraison plus long.
Pouvez-vous suivre automatiquement les nouveaux dépôts ?
Oui. La version Premium inclut un pipeline avec suivi d’état, pour que chaque exécution ne récupère que les dépôts réellement nouveaux et ne duplique pas ce que vous avez déjà. Des exécutions programmées avec alertes email ou Slack peuvent être ajoutées en option.
Je ne suis pas sûr du type de formulaire dont j’ai besoin. Pouvez-vous m’aider ?
Absolument. Dites-moi la question que vous cherchez à répondre, comme activité de financement, achats d’insiders, participations ou changements de direction, et je l’associerai au bon formulaire SEC et vous montrerai un exemple avant votre commande.
Est-ce que j'obtiens le code source ?
Oui avec la version Premium, où le pipeline vous appartient pour le conserver, le modifier et le relancer aussi souvent que vous le souhaitez. La version Basic et Standard livrent uniquement l’ensemble de données final, mais le code source peut être ajouté en option en tant que gig supplémentaire.

