Norme psycholinguistique, norme esthétique : le cas de la tmèse dans la prose littéraire
Bibliographic record
Abstract
A partir des annees 1950, on voit apparaitre dans la stylisation du parle de nouveaux types de phrases, comportant des structures de mises en attente et des inserts qui devient de la norme a differents egards : deviance morpho-syntaxique, avec par exemple des disjonctions entre pronom clitique et verbe ; deviance syntaxique, avec des structures recursives d’insert dans l’insert ; deviance discursive, avec des inserts assez long pour mettre en peril la memorisation du premier segment. Ces retardements d’elements previsibles appellent une lecture figurale, et nous nommons tmese, au sens large, ces disjonctions de divers types senties comme a-normales. On propose une typologie des tmeses, selon qu’elles sont toujours percues comme deviantes (tmeses contraintes : cas des tmeses lexicales) ou qu’elles peuvent etre l’objet d’un jugement graduel de deviance (tmeses conditionnees : cas des insertions tres longues ou tres complexes). Depassant le cadre figural, nous proposons ensuite d’aborder l’infraction ressentie en termes psycholinguistiques. En effet, depuis une quinzaine d’annees, certaines etudes cognitives du traitement des phrases montrent que les structures qui compromettent la comprehension et obligent a des retraitements sont celles qui, comme les tmeses, induisent des couts de stockage et des couts d’integration eleves. Nous souhaitons ainsi evaluer l’impact des limites cognitives de la performance, qui participe au ressentiment collectif de la norme. On passe en revue trois hypotheses sur les difficultes processuelles des insertions, qui offrent des pistes pour l’apprehension du sentiment de transgression dans la majorite des tmeses relevees : l’hypothese du nombre de dependances incompletes en un point, l’hypothese de la longueur des previsions syntaxiques, et l’hypothese du nombre et de la nature des referents discursifs intercalaires. On conclut que les tmeses dites conditionnees passent la limite d’une norme qui n’est pas interne au systeme linguistique (ou a la competence), mais aux limitations cognitives qui sont les notres, notamment celles qui concernent la memoire de travail. Ces limitations constituent une entree dans l’apprehension de la norme esthetique, celle qui nous fait dire : ce n’est pas agrammatical, mais c’est lourd, inelegant, difficile, voire illisible… Cette lourdeur peut etre mise en perspective au sein de l’histoire de la langue litteraire, ou elles sont susceptibles de differents rendements esthetiques, entre reference a un etat classique de la langue, affichage d’une guerre contre la norme syntaxique, ou recherche d’un mal-dire plus moderne.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.002 | 0.004 |
| Meta-epidemiology (narrow) | 0.001 | 0.000 |
| Meta-epidemiology (broad) | 0.000 | 0.000 |
| Bibliometrics | 0.001 | 0.001 |
| Science and technology studies | 0.002 | 0.012 |
| Scholarly communication | 0.004 | 0.005 |
| Open science | 0.000 | 0.002 |
| Research integrity | 0.001 | 0.004 |
| Insufficient payload (model declined to judge) | 0.006 | 0.001 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".