CHAID
CHAID (CHi-squared Automatic Interaction Detector) est une technique de type « arbre de décision ». Elle a été publiée en 1980 par Gordon V. Kas…
CHAID (CHi-squared Automatic Interaction Detector) est une technique de type « arbre de décision ». Elle a été publiée en 1980 par Gordon V. Kass[1].
En pratique, elle est souvent utilisée en marketing direct pour sélectionner un groupe de consommateurs et prédire comment leurs réponses à certaines variables affectent d'autres variables.
Comme avec les autres arbres de décision, ses avantages sont un résultat essentiellement visuel et facilement interprétable. À cause de la segmentation de la population lors de l'analyse, l'échantillonnage doit être suffisamment large de manière que la taille de chaque groupe ne devienne pas trop petite, ce qui rendrait l'analyse peu fiable.
CHAID détecte l'interaction entre variables dans un jeu de données. En utilisant cette technique on peut établir des relations de dépendance entre variables. En prenant l’abonnement à un journal, par exemple, il sera possible d'étudier l'influence de variables explicatives comme le prix, la taille, les suppléments, etc. CHAID identifie des groupes discrets puis, en examinant les réactions aux variables explicatives, cherche à prédire l'impact sur la variable initiale.
CHAID est souvent utilisé comme technique d'exploration et est une alternative aux multiples régressions, en particulier quand le jeu de données n'est pas parfaitement adapté aux analyses par régression.
CHAID
L'algorithme CHAID[2] se déroule en trois étapes :
- préparation des prédicteurs ;
- fusion des classes ;
- sélection de la variable de séparation.
Dans cette dernière étape, l'algorithme utilise les probabilités avec correction de Bonferroni pour estimer si une catégorie peut être divisée. L'algorithme « Exhaustive » CHAID (ECHAID)[3] utilise une technique plus complexe à cette même fin. Pour une description détaillée de CHAID et de son extension ECHAID, voir Ritschard (2013)[4].
Voir aussi
Références
- ↑ Kass, G. V.; An Exploratory Technique for Investigating Large Quantities of Categorical Data, Journal of Applied Statistics, Vol. 29, No. 2 (1980), pp. 119-127.
- ↑ Nisbet, Robert; Elder, John; Miner, Gary; Handbook for Statistical Analysis And Data Mining, Accademic Press, 2009, page 247.
- ↑ David Biggs, Barry De Ville et Ed Suen, « A method of choosing multiway partitions for classification and decision trees », Journal of Applied Statistics, vol. 18, no 1, , p. 49–62 (ISSN 0266-4763 et 1360-0532, DOI 10.1080/02664769100000005, lire en ligne).
- ↑ Gilbert Ritschard, « CHAID and Earlier Supervised Tree Methods », Contemporary Issues in Exploratory Data Mining in the Behavioral Sciences, McArdle, J.J. And G. Ritschard (Eds), New York, Routledge, , p. 48-74 (lire en ligne).
Liens externes
- (en) Analyse CHAID
- (en) Arbre de décision
- (en) Techniques d'analyse
Content Disclaimer
Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.
- The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
- There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
- It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
- Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
- Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.