Modélisation prédictive et apprentissage statistique avec R

Issu de formations devant des publics variés, cet ouvrage présente les principales méthodes de modélisation de statistique et de machine learning, à travers le fil conducteur d'une étude de cas. Chaque méthode fait l'objet d'un rappel de cours et est accompagnée de références bibliogr...

Descripción completa

Guardado en:
Detalles Bibliográficos
Autor principal: Tufféry, Stéphane, 1965-
Formato: Livre papier
Lenguaje:Français
Publicado: Paris : Éditions Technip 2017.
Edición:[2e éd. actualisée et augmentée].
Materias:
Nota: La couv. porte en plus : "AdaBoost, CART, données massives, forêts aléatoires, lasso, logistique PLS, machine learning, méthodes d'ensemble, parallélisation, régression ridge, réseaux de neurones, Support Vector Machines"
Autres localisations: Voir dans le Sudoc
LEADER 04650nam a22003137a 4500
001 641009
008 171002t20172017xxe ||| |||| 00| 0 fre d
009 PPN204407974
020 |a 9782710811787 (br.) :  |c 45 EUR 
024 |a 9782710811787 
041 0 |a fre 
082 |a 006.312  |z fre 
082 |a 519.202 85 
084 |a 62Pxx. 2020 
084 |a 68Uxx. 2020 
100 1 |a Tufféry, Stéphane,  |d 1965- 
245 1 0 |a Modélisation prédictive et apprentissage statistique avec R   |c Stéphane Tufféry,... 
250 |a [2e éd. actualisée et augmentée]. 
260 |a Paris :  |b Éditions Technip,  |c 2017. 
300 |a 1 volume (xi-405 pages) :  |b illustrations, tableaux, graphiques, couverture illustrée en couleur ;  |c 24 cm. 
500 |a La couv. porte en plus : "AdaBoost, CART, données massives, forêts aléatoires, lasso, logistique PLS, machine learning, méthodes d'ensemble, parallélisation, régression ridge, réseaux de neurones, Support Vector Machines" 
504 |a Bibliographie et liste de sites Internet p. [403]-405. Notes bibliographiques. Index 
520 |a Issu de formations devant des publics variés, cet ouvrage présente les principales méthodes de modélisation de statistique et de machine learning, à travers le fil conducteur d'une étude de cas. Chaque méthode fait l'objet d'un rappel de cours et est accompagnée de références bibliographiques, puis est mise en oeuvre avec des explications détaillées sur les calculs effectués, les interprétations des résultats et jusqu'aux astuces de programmation permettant d'optimiser les temps de calcul. À ce sujet, une annexe est consacrée au traitement des données massives. L'ouvrage commence par les méthodes de classement classiques les plus éprouvées, mais aborde rapidement les méthodes plus récentes et avancées : régression ridge, lasso, elastic net, boosting, forêts aléatoires, Extra-Trees, réseaux de neurones, séparateurs à vaste marge. Chaque fois, le lien est fait entre la théorie et les résultats obtenus pour montrer qu'ils illustrent bien les principes sous-jacents à ces méthodes. Mais l'aspect pratique est aussi privilégié, avec l'objectif de permettre au lecteur une mise en oeuvre rapide et efficace dans son travail concret. L'exploration et la préparation préliminaire des données sont d'ailleurs décrites, ainsi que le processus de sélection des variables. Une synthèse finale est faite de toutes les méthodes présentées. La mise en oeuvre s'appuie sur le logiciel libre R et sur un jeu public de données. Ce dernier peut être téléchargé sur internet et présente l'intérêt d'être riche, complet et de permettre des comparaisons grâce aux nombreuses publications dans lesquelles il a servi. Le logiciel statistique utilisé est R, actuellement celui qui se développe le plus : devenu la lingua franca de la statistique et l'outil le plus répandu dans le monde académique, il prend également de plus en plus de place dans le monde de l'entreprise, à tel point que tous les logiciels commerciaux proposent désormais une interface avec R. Outre qu'il est disponible pour tous, dans de multiples environnements, il est aussi le plus riche statistiquement et c'est le seul logiciel permettant de mettre en oeuvre toutes les méthodes présentées dans cet ouvrage. Enfin, son langage de programmation particulièrement élégant et adapté au calcul mathématique permet de se concentrer dans le codage sur les aspects statistiques. R permet d'arriver directement à l'essentiel et de mieux comprendre les méthodes exposées dans l'ouvrage. [Source : 4e de couv.] 
630 |a R  |n logiciel 
650 |a Statistique  |x Modèles mathématiques 
650 |a Apprentissage automatique  |x Modèles mathématiques 
650 |a Exploration de données 
787 0 8 |i Reproduced as:  |0 233131930  |t Modélisation prédictive et apprentissage statistique avec R  |f Stéphane Tufféry,...  |d 2018  |c [Rennes]  |n [Université de Rennes 1] 
997 |0 641009  |1 Livre papier  |a Ressource papier  |c 0/Orléans/  |c 1/Orléans/BU Droit, Economie, Gestion/  |c 1/Orléans/BU Sciences, Technologies, STAPS/  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Sciences, Technologies, STAPS, 519.5 TUF  |z Orléans, BU Droit, Economie, Gestion, 519.5 TUF  |z Orléans, BU Droit, Economie, Gestion, 519.5 TUF  |z Orléans, BU Droit, Economie, Gestion, 519.5 TUF  |z Orléans, BU Droit, Economie, Gestion, 519.5 TUF