Méthodologie de trois essais d'analyse grammaticale en approche raisonnée
Notice bibliographique
Résumé
La recherche a pour premier objectif de faire voir l'intérêt et la qualité des résultats de trois analyses grammaticales menées selon une approche qualifiée de raisonnée. Le second objectif est celui d'identifier les choix méthodologiques qui permettent l'analyse en approche raisonnée. Il est donc procédé, dans la recherche, à l'examen critique de trois essais d'analyse grammaticale menée en approche raisonnée, ceux de la règle d'accord des mots de couleur, de la règle d'accord en nombre des noms propres et de la notion de phrase. \n \nL'examen du premier essai d'analyse raisonnée sur la règle d'accord des mots de couleur révèle une règle composée de quatre cas d'accord entretenant des liens étroits. L'examen montre aussi que les mots utilisés pour exprimer la couleur, qu'ils soient adjectifs ou noms, s'accordent selon la règle générale d'accord des adjectifs et des noms. L'examen du deuxième essai, portant sur l'analyse raisonnée de la règle d'accord en nombre des noms propres, fait voir une règle fondée conceptuellement. La règle est composée de trois cas d'accord: les cas d'accord général sans s de pluriel (accord autorisé par une règle de seule écriture et qui traduit à la fois la nature du nom propre véritable et le caractère particulier des êtres identifiés), les cas d'accord de dérogation avec s, et les cas de contre-dérogation sans s. Ces accords sans s et avec s de pluriel des noms propres sont gouvernés par le caractère de totalement différent ou d'exactement pareil des êtres ou des objets identifiés. L'examen du troisième essai sur la notion de phrase montre une analyse de nature proprement grammaticale. Aussi l'analyse se fait-elle autour de la phrase simple et de la phrase complexe, la notion de proposition n'y apparaît pas. Il appert de cette analyse que la phrase simple est faite de la complémentarité d'un nom et d'un verbe, avec ou sans complexification interne. La phrase complexe, pour sa part, est faite de la complémentarité d'un nom et d'un verbe à laquelle s'ajoute une ou plusieurs complexifications externes. \n \nL'examen de ces trois essais d'analyse raisonnée a permis d'identifier sept principes méthodologiques sur lesquels doivent s'appuyer des analyses grammaticales d'approche raisonnée: 1) les données d'analyses doivent être simples, claires et nettes; 2) les analyses doivent pratiquer une logique proprement grammaticale en puisant aux données usuelles de la grammaire; 3) les analyses doivent rendre compte de tous les cas d'emploi; 4) les analyses doivent prendre en compte, par l'identification du mécanisme organisateur, la vie de la langue; 5) les analyses ne peuvent faire abstraction des acquis de la grammaire traditionnelle, mais doivent les utiliser avec discernement; 6) les analyses doivent se donner les outils nécessaires à la compréhension, même si ce sont des règles et des concepts nouveaux pour la grammaire traditionnelle; 7) les analyses doivent, lorsque utile, savoir puiser aux données de la linguistique pour élaborer ou approfondir les données grammaticales. \n
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,008 | 0,013 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,001 |
| Méta-épidémiologie (sens large) | 0,001 | 0,002 |
| Bibliométrie | 0,003 | 0,003 |
| Études des sciences et des technologies | 0,002 | 0,008 |
| Communication savante | 0,012 | 0,010 |
| Science ouverte | 0,002 | 0,004 |
| Intégrité de la recherche | 0,002 | 0,005 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,018 | 0,005 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».