Les modifications lexicales apportées par les réviseurs professionnels dans leur tâche de révision : du problème à la solution
Bibliographic record
Abstract
Depuis quelques années seulement, chercheurs et praticiens en révision professionnelle ont commencé à décrire ce métier et à expliquer les multiples tâches qu'il comporte (Bisaillon, 2005, 2007a et b; Cloutier, 2005; Leclerc, 2006; Lachance, 2006; Association canadienne des réviseurs, 2006; Bisaillon, 2007 c). Dans la foulée de ces travaux, j'ai entrepris une étude sur les modifications lexicales apportées par six réviseurs au cours d'un de leurs mandats de révision afin de préciser la nature et les raisons d'être de ce type de modifications. Je cherchais entre autres, à répondre aux questions suivantes: Qu'est-ce qui caractérise les modifications lexicales? Quels problèmes les réviseurs ont-ils détectés pour justifier ces changements et comment les ont-ils résolus? Quelles préoccupations révisionnelles traduisent ces modifications? Pour obtenir des données, une partie du travail des réviseurs a d'abord été filmé et ceux -ci devaient, par la suite, expliquer les changelnents qu'ils avaient faits dans le texte. Seulement les modifications portant sur des unités lexicales ont été retenues pour ma recherche et une classification a été élaborée pour les décrire et les analyser. Les principaux résultats montrent que les unités lexicales visées par les Inodifications sont le plus souvent remplacées et qu'elles appartiennent deux fois sur trois à une classe ouverte (nom, verbe, adjectif et adverbe). Les problèmes détectés par les réviseurs ont été classés dans une vingtaine de catégories différentes, ce qui témoigne bien de la diversité des difficultés que pose l' elnploi des mots dans un texte. Même si les erreurs de syntaxe et les erreurs d'orthographe grammaticale sont les plus nombreuses, elles ne comptent que pour environ 20 % de tous les problèmes détectés et résolus. On remarque également que quelques modifications lexicales ont été apportées sur la base de pressentiments. Par ailleurs, il s'avère qu 'une modification sur deux visant une unité lexicale est faite dans une optique nonnative. Enfin, on observe que certains éléments du contexte de travail, dont le mandat reçu, la conception de la révision et la fonnation, semblent avoir une incidence sur les types de problèmes que détectent et corrigent les réviseurs.
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.011 | 0.051 |
| Meta-epidemiology (narrow) | 0.001 | 0.001 |
| Meta-epidemiology (broad) | 0.001 | 0.001 |
| Bibliometrics | 0.003 | 0.003 |
| Science and technology studies | 0.004 | 0.010 |
| Scholarly communication | 0.009 | 0.013 |
| Open science | 0.002 | 0.004 |
| Research integrity | 0.003 | 0.003 |
| Insufficient payload (model declined to judge) | 0.006 | 0.002 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".