Méthodologie de trois essais d'analyse grammaticale en approche raisonnée
Bibliographic record
Abstract
La recherche a pour premier objectif de faire voir l'intérêt et la qualité des résultats de trois analyses grammaticales menées selon une approche qualifiée de raisonnée. Le second objectif est celui d'identifier les choix méthodologiques qui permettent l'analyse en approche raisonnée. Il est donc procédé, dans la recherche, à l'examen critique de trois essais d'analyse grammaticale menée en approche raisonnée, ceux de la règle d'accord des mots de couleur, de la règle d'accord en nombre des noms propres et de la notion de phrase. \n \nL'examen du premier essai d'analyse raisonnée sur la règle d'accord des mots de couleur révèle une règle composée de quatre cas d'accord entretenant des liens étroits. L'examen montre aussi que les mots utilisés pour exprimer la couleur, qu'ils soient adjectifs ou noms, s'accordent selon la règle générale d'accord des adjectifs et des noms. L'examen du deuxième essai, portant sur l'analyse raisonnée de la règle d'accord en nombre des noms propres, fait voir une règle fondée conceptuellement. La règle est composée de trois cas d'accord: les cas d'accord général sans s de pluriel (accord autorisé par une règle de seule écriture et qui traduit à la fois la nature du nom propre véritable et le caractère particulier des êtres identifiés), les cas d'accord de dérogation avec s, et les cas de contre-dérogation sans s. Ces accords sans s et avec s de pluriel des noms propres sont gouvernés par le caractère de totalement différent ou d'exactement pareil des êtres ou des objets identifiés. L'examen du troisième essai sur la notion de phrase montre une analyse de nature proprement grammaticale. Aussi l'analyse se fait-elle autour de la phrase simple et de la phrase complexe, la notion de proposition n'y apparaît pas. Il appert de cette analyse que la phrase simple est faite de la complémentarité d'un nom et d'un verbe, avec ou sans complexification interne. La phrase complexe, pour sa part, est faite de la complémentarité d'un nom et d'un verbe à laquelle s'ajoute une ou plusieurs complexifications externes. \n \nL'examen de ces trois essais d'analyse raisonnée a permis d'identifier sept principes méthodologiques sur lesquels doivent s'appuyer des analyses grammaticales d'approche raisonnée: 1) les données d'analyses doivent être simples, claires et nettes; 2) les analyses doivent pratiquer une logique proprement grammaticale en puisant aux données usuelles de la grammaire; 3) les analyses doivent rendre compte de tous les cas d'emploi; 4) les analyses doivent prendre en compte, par l'identification du mécanisme organisateur, la vie de la langue; 5) les analyses ne peuvent faire abstraction des acquis de la grammaire traditionnelle, mais doivent les utiliser avec discernement; 6) les analyses doivent se donner les outils nécessaires à la compréhension, même si ce sont des règles et des concepts nouveaux pour la grammaire traditionnelle; 7) les analyses doivent, lorsque utile, savoir puiser aux données de la linguistique pour élaborer ou approfondir les données grammaticales. \n
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.008 | 0.013 |
| Meta-epidemiology (narrow) | 0.001 | 0.001 |
| Meta-epidemiology (broad) | 0.001 | 0.002 |
| Bibliometrics | 0.003 | 0.003 |
| Science and technology studies | 0.002 | 0.008 |
| Scholarly communication | 0.012 | 0.010 |
| Open science | 0.002 | 0.004 |
| Research integrity | 0.002 | 0.005 |
| Insufficient payload (model declined to judge) | 0.018 | 0.005 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".