Synthèse spatialisée de la population pour fins de modélisation des comportements de mobilité
Notice bibliographique
Résumé
RÉSUMÉ: «RÉSUMÉ: De l’identification du besoin à la mise en service d’un projet d’infrastructure de transport, plusieurs années sont souvent requises. De plus, un projet d’infrastructure de transport requiert souvent le déblocage d’investissements considérables. Or, la demande en transport évolue rapidement en nombre comme en nature et les fonds disponibles à investir dans une offre de mobilité sont limités. Une planification préalable menant à une action par anticipation s’impose alors afin de s’assurer de maintenir une offre adaptée et de garantir la pertinence et la rentabilité des investissements. En effet, dans le présent comme dans le futur, la planification de l’offre en transport est basée sur les enjeux de mobilité généralement identifiés par le biais de modèles reflétant le comportement de mobilité de la population. Les comportements de mobilité des individus sont généralement fortement influencés par leurs caractéristiques sociodémographiques, celles de leurs ménages, et leurs localisations résidentielles. Ainsi, pour alimenter les plateformes de microsimulation à grande échelle basées agents de plus en plus populaires en modélisation des comportements de mobilité, une liste totalement énumérée, caractérisée et spatialisée des ménages et individus composant la population de la zone d’étude est requise. Une telle base de données peut être constituée par compilation des formulaires du recensement complétés par les citoyens de la zone. Or, cette compilation demeure inaccessible aux planificateurs pour des raisons relevant essentiellement de la protection de la vie privée. Les instituts nationaux de la statistique publient généralement deux types de données dérivées des formulaires détaillés qu’ils reçoivent : des tabulations agrégées d’une variété de variables à différents découpages zonaux, aussi appelées résumés du recensement, et un échantillon de microdonnées non géoréférencé dont la taille ne dépasse généralement pas 5% de la population. Les données disséminées par les instituts nationaux de la statistique sont alors, entre autres, utilisées par les planificateurs pour produire une base de données statistiquement équivalente à la compilation confidentielle des formulaires détaillés. Ce processus inversé est ce que l’on appelle la synthèse de population. Une population synthétique est une liste totalement énumérée, caractérisée et spatialisée de ménages et individus non identifiables. Lorsqu’elle est destinée à alimenter une simulation des comportements de mobilité, une population synthétique de qualité montre des caractéristiques sociodémographiques, une distribution spatiale, et par conséquent des comportements de mobilité statistiquement cohérents avec ceux de la population réelle.» ABSTRACT: «ABSTRACT: Transportation infrastructure projects generally require several years and considerable investments to see the light of day. However, transportation demand is continuously evolving and the funds available to provide for the population’s mobility needs are limited. Prior planning leading to anticipatory action is thus necessary to ensure that a suitable transportation supply is maintained, and relevant and effective investments are made. Indeed, in the present as in the future, the planning of transportation supply is based on mobility issues generally identified through models reflecting the mobility behavior of the population. Individuals’ mobility behaviors are generally strongly influenced by their sociodemographic characteristics, their households’ characteristics, and their residential locations. Thus, to feed large-scale agent-based microsimulation platforms, increasingly popular in travel demand modeling, a fully enumerated, characterized and spatialized list of households and individuals making up the population of the study area is required. Such a database can be obtained by compiling census forms completed by the citizens of the study area. However, this compilation remains inaccessible to planners and researchers for privacy reasons mainly. Instead, national statistical agencies generally disseminate two types of data derived from the confidential compilation of detailed forms they receive: aggregate tabulations of a variety of variables at different zonal breakdowns, commonly called census summary files, and a non-georeferenced microdata sample whose size does generally not exceed 5% of the population. The data disseminated by national statistical agencies are then, among others, used by planners to produce a statistical equivalent to the confidential compilation of completed detailed forms. This reversed process is called population synthesis. A synthetic population is a fully enumerated, characterized, and spatialized list of unidentifiable households and individuals. When intended to feed a simulation of mobility behaviors, a reliable synthetic population should show sociodemographic characteristics, spatial distribution, and thus mobility behaviors that are statistically consistent with those of the real population.»
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,008 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,002 | 0,002 |
| Études des sciences et des technologies | 0,000 | 0,000 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,002 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,020 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».