Présentation de la recherche « Migration des groupes linguistiques » et de ses préoccupations actuelles
Notice bibliographique
Résumé
Le premier volet de notre recherche pour le compte du Conseil de la langue française porte sur la situation des groupes linguistiques au Québec et sur les mécanismes de leur renouvellement. Notre étude a surtout porté sur l’ensemble du Québec pour la période 1966-1976. Nous avons cependant fait le même genre d’étude, quoique moins élaborée, pour les six régions que nous avons définies pour le Québec. On retire des résultats, pour l’ensemble du Québec, que la mécanique du renouvellement de la population diffère selon la langue maternelle. Pour les Anglophones et les Allophones, les composantes migratoires interprovinciales et internationales dominent, respectivement, alors que la mortalité est la principale composante de l’accroissement négatif des Francophones et, pour ces derniers, la migration interrégionale est la principale composante de l’accroissement migratoire. Ces résultats sont obtenus après plusieurs corrections afin de pallier les imperfections des données. Le second volet de notre recherche porte sur l’évolution future de la composition linguistique de la population. Nous avons été amenés dans ce cadre à évaluer, à la lumière des données du recensement de 1976, les perspectives de Henripin et Lachapelle (1977) qui étaient fondées sur les données du recensement de 1971. Il nous a semblé que ces perspectives négligeaient d’attribuer une mobilité linguistique vers l’anglais aux personnes qui avaient, en 1971, déclaré avoir une langue d’usage autre que l’anglais ou le français. Ceci nous amène à remettre en question les résultats de Henripin et Lachapelle montrant que des hypothèses très favorables aux anglophones entraîneraient, au mieux, le maintien de leur importance relative dans la population québécoise. A notre avis, de telles hypothèses auraient entraîné une augmentation du groupe anglophone.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,005 | 0,011 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,003 | 0,005 |
| Études des sciences et des technologies | 0,005 | 0,002 |
| Communication savante | 0,004 | 0,001 |
| Science ouverte | 0,001 | 0,002 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,017 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».