Du référentiel au pragmatique : note sur la variation intracommunautaire en cri de l’Est de la Baie James
Bibliographic record
Abstract
I NTllODUCllON li existe, dans plusieurs langues autochtones viables (i.e.encore utilisées à la mai son par la jeune génération), des différences linguistiques majeures entre les diverses générations de locuteurs (Clarke 1986;Dorais 2002 ;Artuso 1998).Dans les communautés cri de l' Est de la baie James (Figure 1 ), le cri stylistique ou tepî111î.ayî11111wi11(litt.« la vra ie langue cri »), le plain Cree, liigli Cree, bush Cree, eiders' lrmguage ou encore tlieir la11guage tel que désigné par les informateurs plus jeunes, caractérise la parole des personnes âgées unilingues ou des locuteurs non scolarisés qui ont vécu une bonne partie de leur existence en forêt.Cette variété se rt de codification culturelle (Francey 1998, p. 83) et se définit par un nivea u de complexité sémantique redevable à la richesse de certains registres, ainsi qu'à une pleine articulation phonologique et morphologique.En revanche, elle est en même temps relativement abstraite et pose des problèmes de polysémie pour les jeunes locuteurs (Junker 2003).Tandis que le changement social et linguistique des quarante dernières années a accéléré le développement de l'alphabétisation et de la standardisation orthographique, l'absence de littérature en langue vernacul aire et la dépend ance croissa nte vi s-ù -vis des langues de la société dominante ont contribué à l'accentuation des diflërcnces linguistiques entre les générations (hybridation lingui stique, bilinguisme soustract if, etc.).Le cri pidginisé, utilisé tant par les enfants, les adolescents que par les jeunes parents, représente une variété, dite érodée 1 , du cri de l'Est de la baie James.Variété que les unilingues cri , les linguistes et les éd ucateurs (a utochtones ou non) étiquetten t sous les notions pratiques de youtli-Cree, Cree11glisli, ou sloppy-Cree (voi r les propos de Gerti Murdoch rapportés dans Feurcr 1994, pp.134 et 136).
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.009 |
| Meta-epidemiology (narrow) | 0.000 | 0.000 |
| Meta-epidemiology (broad) | 0.000 | 0.000 |
| Bibliometrics | 0.002 | 0.002 |
| Science and technology studies | 0.002 | 0.004 |
| Scholarly communication | 0.004 | 0.003 |
| Open science | 0.001 | 0.003 |
| Research integrity | 0.001 | 0.001 |
| Insufficient payload (model declined to judge) | 0.004 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".