Innover dans la collecte de données transport pour des données actuelles et de meilleure qualité
Notice bibliographique
Résumé
Depuis 1970, de grandes enquetes telephoniques Origine-Destination sont realisees tous les 5 ans dans la region metropolitaine de Montreal et permettent de recenser les habitudes de deplacements de la population pour une journee moyenne de semaine l’automne. Face aux defis actuels de planification des transports et du territoire et au-dela du portrait de mobilite a tous les 5 ans, des besoins d’information emergent notamment afin de : - capter l’evolution de la mobilite a travers les annees et les saisons ; - mesurer l’impact des plans, des politiques et des modifications a l’offre de service. Pour repondre a ce besoin, un projet pilote d’enquete telephonique Origine-Destination en continu s’est deroule a Montreal entre 2009 et 2012 au cours duquel environ 15 000 menages ont ete sondes chaque an, de janvier a decembre. Cette etude a permis de caracteriser la mobilite par saison et mesurer son evolution entre les deux grandes enquetes quinquennales de 2008 et 2013. En plus de repondre aux objectifs, la tenue de l’enquete en mode continu a ete un terrain fertile pour l’experimentation de nouvelles methodes et processus afin d’innover et de faire evoluer les enquetes quinquennales sans mettre en peril leurs realisation. Ce projet a d’abord permis de maintenir une expertise quant a la realisation et le traitement des enquetes de mobilite, mais surtout d’ameliorer son efficacite et son efficience. De nouveaux outils et processus plus performants ont d’ailleurs ete developpes durant cette periode. Plusieurs experimentations methodologiques ont aussi ete tenues dans le cadre de l’enquete, tel l’ajout d’un echantillon d’abonnees exclusif a un service de telephonie cellulaire, l’introduction de nouvelles questions et le developpement d’un questionnaire web. Plusieurs d’entre elles ont d’ailleurs ete integrees dans la grande enquete Origine-Destination de 2013. Les grands apprentissages tires de cette experience ont permis de concevoir une nouvelle methode de collecte de donnees en continu en plus de contribuer directement au succes de l’enquete Origine- Destination de 2013.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,052 | 0,091 |
| Méta-épidémiologie (sens strict) | 0,002 | 0,002 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,007 | 0,008 |
| Études des sciences et des technologies | 0,006 | 0,004 |
| Communication savante | 0,016 | 0,013 |
| Science ouverte | 0,004 | 0,010 |
| Intégrité de la recherche | 0,002 | 0,004 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,014 | 0,007 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».