Web Scraping avec Python : Extraction de données du web moderne Ryan Mitchell est un manuel d’étude anglophone consacré au web scraping. Cet ouvrage de référence propose une explication approfondie de la collecte automatique de données provenant de sites web avec Python.
Le livre aborde les techniques modernes de web scraping, de l’envoi de requêtes aux serveurs web au traitement et à l’extraction de différents types de données. Le contenu est réparti en deux parties : la première traite des principes de base et des mécanismes du web scraping, comme la gestion du HTML et l’interaction automatique avec des sites web. La deuxième partie se concentre sur des applications avancées, telles que le développement de crawlers avec Scrapy, le scraping de JavaScript, l’exploration d’API et la contournement des blocages.
Cette édition s’inscrit dans des thématiques comme le web scraping, la capture de données et l’analyse, ainsi que la programmation web, et convient aux professionnels comme aux étudiants qui souhaitent approfondir l’extraction de données du web moderne.

