Régression logistique pas à pas en R : sélection stepAIC
Un guide pratique de la régression logistique pas à pas en R : ajustez un glm binomial complet, puis utilisez MASS::stepAIC pour une sélection de variables ascendante…
Le guide pratique de la classification en R — régression logistique pénalisée et pas à pas, logistique multinomiale (multiclasse), analyse discriminante (LDA/QDA), machines à vecteurs de support, Bayes naïf, et comment évaluer (matrice de confusion, ROC/AUC), fixer le seuil et calibrer un classifieur. Recettes tidymodels reproductibles.
Apprendre › Machine Learning › Classification
La classification prédit une catégorie — diabétique ou non, quelle espèce, quel segment de clientèle. Cette série couvre toute la boîte à outils en R : la régression logistique et ses extensions prédictives (pénalisée, pas à pas, multiclasse), les classifieurs linéaires classiques (analyse discriminante, Bayes naïf), les machines à vecteurs de support, et — tout aussi important — comment évaluer honnêtement un classifieur (matrice de confusion, ROC/AUC) et fixer son seuil de décision et calibrer ses probabilités. Chaque recette est reproductible et repose sur le workflow tidymodels.
Vous voulez interpréter les coefficients et les odds ratio d’un modèle logistique (inférence) plutôt que construire un classifieur prédictif ? Voir la régression logistique en biostatistique. Cette série est le versant prédictif — intention distincte, complémentaire.
| Méthode | Comment elle classe | À privilégier quand… | Commencer ici |
|---|---|---|---|
| Logistique (pénalisée / pas à pas) | frontière linéaire en log-odds ; le lasso sélectionne les prédicteurs | une référence solide et interprétable ; nombreux prédicteurs | pénalisée · pas à pas |
| Logistique multinomiale | logistique étendue à >2 classes | un résultat multiclasse dont vous voulez les probabilités | multinomiale |
| Discriminante (LDA/QDA) | frontières de classe à partir des distributions par classe | les classes sont à peu près gaussiennes ; vous voulez une règle linéaire/quadratique rapide | analyse discriminante |
| Bayes naïf | a priori × vraisemblances par variable | une référence rapide, données à haute dimension / texte | Bayes naïf |
| SVM | le séparateur à marge maximale (linéaire ou à noyau) | une frontière non linéaire flexible | machine à vecteurs de support |
Quoi que vous ajustiez, évaluez-le correctement (matrice de confusion, ROC/AUC) et fixez le seuil / calibrez les probabilités (seuils et calibration) — 0.5 est rarement le bon point de coupure.
Ce guide se complète vague après vague. Associez-le à la validation de modèle et aux méthodes d’apprentissage statistique (arbres, forêts aléatoires, boosting).
Demandez à Prova « quel classifieur convient à mes données, et à quel point est-il vraiment bon ? » — elle répond avec du code R que vous pouvez exécuter sur vos propres données, ajuste le modèle et vous aide à lire la matrice de confusion et la courbe ROC. The runtime is the judge. Demander à Prova →
Prouvez que vous savez le faire. Maîtrisez toute la série Classification en R — suivez votre parcours, construisez des projets et obtenez un certificat.
Passez à Pro — Prova illimité sur vos propres données et un certificat vérifiable qui atteste la compétence.
dès 15 $/mois facturé annuellement
✓ Vous êtes Pro — continuez. The runtime is the judge.
Prêt à passer à la vitesse supérieure ?
Recevez les nouvelles leçons R & Python par e-mail
Pratique, reproductible, sans spam. Désinscription à tout moment.
Double opt-in. Nous ne partageons jamais votre e-mail.
@online{untitled,
author = {},
title = {Classification en R},
url = {https://www.datanovia.com/learn/machine-learning/classification/},
langid = {fr}
}