Bibliographic record
Abstract
T out comme le recto d'une feuille ne peut s'imaginer sans son verso, ou le côté pile d'une pièce de monnaie sans son côté face, le texte ne peut s'imaginer sans cette qualité qui fait de lui un texte : la cohérence.Or, un texte n'est pas un jeu de dominos, dans lequel les pièces (les énoncés) se juxtaposent simplement les unes aux autres ; un texte, c'est un casse-tête, dans lequel les pièces s'emboîtent les unes dans les autres.Dans un texte comme dans un casse-tête, chaque pièce (chaque énoncé) a sa raison d'être, et la présence de chacune ainsi que la façon qu'elle a de s'arrimer aux autres contribuent à façonner l'image globale.Ainsi la cohérence d'un texte repose sur la raison d'être (la pertinence') de chaque énoncé et de chaque séquence d'énoncés, et sur la façon dont les énoncés et les séquences d'énoncés s'arriment les un(e)s aux autres.Un premier constat s'impose d'emblée : nous disons « chaque énoncé et chaque séquence d'énoncés » parce que la cohérence se joue tant au niveau local (ou micro-structurel) entre les énoncés d'une même séquence ou paragraphe, qu'au niveau global (ou macro-structurel) 2 entre les diverses séquences (ou paragraphes) du texte.Un deuxième constat s'avère opportun, concernant le caractère multidimensionnel du texte.La construction d'un texte représente en effet un acte de langage qui comporte au moins trois actes fondamentaux' : l'acte de référence (on parle de quelque chose) ; l'acte de prédication (on dit quelque chose de ce dont on parle) ; l'acte d'énonciation (on le fait d'une certaine manière).Ces trois actes déterminent trois niveaux (simultanés) de structuration du texte (la structuration référentielle, la structuration predicative et la structuration énonciative), lesquels doivent être considérés comme autant de terrains sur lesquels se joue la cohérence.Un dernier constat doit être fait : il est rare que les textes, même ceux produits par des scripteurs moins habiles, génèrent un effet de totale incohérence.Ils se caractérisent plutôt soit par une impression générale de cohérence, soit par une impression de cohérence perturbée par des ruptures, lesquelles s'avèrent plus ou moins nombreuses et d'importance variable.C'est que la cohérence est une affaire de degré : un texte sera perçu comme plus
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.007 | 0.041 |
| Meta-epidemiology (narrow) | 0.001 | 0.001 |
| Meta-epidemiology (broad) | 0.000 | 0.000 |
| Bibliometrics | 0.002 | 0.002 |
| Science and technology studies | 0.004 | 0.011 |
| Scholarly communication | 0.010 | 0.015 |
| Open science | 0.001 | 0.004 |
| Research integrity | 0.002 | 0.004 |
| Insufficient payload (model declined to judge) | 0.006 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".