Extraction de vastes ensembles de données van Jure Leskovec, Anand Rajaraman et Jeffrey David Ullman est un manuel anglophone destiné à l’enseignement supérieur et aux professionnels. Ce livre se concentre sur des algorithmes pratiques pour l’exploration de données et traite d’applications sur de très grands ensembles de données.
Cette édition aborde des concepts importants tels que le framework MapReduce pour le traitement parallèle, le hachage sensible à la localité et le traitement en flux. D’autres sujets sont également couverts, notamment PageRank, l’extraction d’ensembles d’items fréquents, le clustering, les arbres de décision, l’apprentissage profond et l’analyse des graphes de réseaux sociaux.
Ce livre met l’accent sur les applications pratiques et propose des explications approfondies d’algorithmes essentiels pour les étudiants et les professionnels de la data mining. Le contenu s’inscrit dans des thèmes tels que l’exploration de données, la reconnaissance de motifs et l’intelligence artificielle en informatique.

