Notice bibliographique
Résumé
La traduction d'ouvrages littéraires rédigés dans des langues régionales soulève le problème d'accès à des ouvrages de référence fiables décrivant leurs propriétés.Des dictionnaires, des glossaires, des brochures répertorient les aspects lexicaux des parlers régionaux.Non seulement sont-ils peu nombreux et fragmentaires, mais aussi, et surtout, ils ne représentent pas toujours la langue dans sa modernité 1 .Par ailleurs, il n'existe à peu près pas de grammaire qui décrive les parlers régionaux.Les descriptions qui ont été faites de la morphologie et de la syntaxe des français d'Amérique sont éparpillées dans des revues linguistiques.Ces travaux sont difficiles à colliger, ils ne sont pas toujours faciles à aborder et il faut mettre un certain temps pour en extraire les informations qui nous sont pertinentes.Nous n'avons certainement pas la prétention de combler cette lacune en quelques pages.Nous nous proposons toutefois de présenter un inventaire des particularités morphosyntaxiques qui caractérisent les variétés de français au Canada en les situant les unes par rapport aux autres à l'intérieur d'un cadre conceptuel qui fait appel à la trajectoire des parlers de France qui se sont implantés en Amérique du nord et à la théorie du contact linguistique, que nous présenterons dans la première partie de l'article. Le contexte : Les souches de français au CanadaLes variétés de français canadiennes se divisent en deux grands groupes : d'une part, les variétés acadiennes implantées dans les provinces maritimes à partir de 1604 et, d'autre part, les variétés laurentiennes qui se sont développées dans la vallée du Saint-Laurent après la fondation de Québec en 1608.Les Français qui ont colonisé l'Amérique au XVII e siècle venaient de l'ouest de la France.Ils parlaient le dialecte de leurs régions respectives.Plusieurs avaient été exposés au français de l'Île-de-France, même s'ils ne le parlaient pas couramment.Environ la moitié était alphabétisée.1 Le dictionnaire du français acadien d'Yves Cormier (1999) est à ce jour ce qu'il y a de plus complet pour le vocabulaire.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,006 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,007 | 0,024 |
| Études des sciences et des technologies | 0,013 | 0,005 |
| Communication savante | 0,011 | 0,004 |
| Science ouverte | 0,001 | 0,002 |
| Intégrité de la recherche | 0,002 | 0,003 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,010 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».