Interpretable Machine Learning Approach to Predicting Electric Vehicle Buying Decisions
Notice bibliographique
Résumé
To address the problem of climate change emissions from the transport sector, many countries are promoting electric vehicles (EVs). To support such efforts, it is essential to know what influences the choice of an EV over a traditional internal combustion engine vehicle (ICEV). To study this, a discrete choice experiment was developed, and 2,015 valid responses were gathered from Canadian adults with a driver’s license. In place of a more traditional analysis, a machine learning approach, XGBoost, was applied. However, two key issues were addressed with respect to its application. First, a practical question related to how best to split the training and testing data was examined. A new technique based on the Coyote optimization algorithm (COA) is developed that automatically determines the split that leads to the greatest prediction accuracy. The policy-relevant results of the analysis found that an individual’s Climate Change-Stage of Change (CC-SoC) and the price ratio of EVs to ICEVs are the most important direct influences. The interaction effect of the first two (CC-SoC and price ratio) is also influential. However, this leads to the second key issue: interpretability. Although high prediction accuracy (87.1%) was achieved, the black-box nature of the approach limits its policy relevance. As such, this research applied a technique, Accumulated Local Effects (ALE), that can determine the strength and direction of influence of the variable. This research demonstrates how machine learning can be applied to a policy-relevant question and provide information that is useful to policy decision makers.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,006 | 0,001 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,002 | 0,007 |
| Études des sciences et des technologies | 0,001 | 0,000 |
| Communication savante | 0,000 | 0,001 |
| Science ouverte | 0,001 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,000 | 0,000 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule tête enseignante, pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».