La remédiation numérique des savoirs critiques : enjeux formels et heuristiques
Bibliographic record
Abstract
UQÀM), Ingrid MAYEUR (ULiège), François PROVENZANO (ULiège) L'hypothèse soutenue veut que les Humanités critiques tiennent leur valeur sociale d'un régime singulier d'élaboration, de circulation et d'usage dans lequel elles se sont historiquement constituées, en particulier entre la France et l'Allemagne dans la séquence 1945-1980.Cette séquence est en effet envisagée par le prisme de l'activité des revues, lieux collectifs de production et de circulation des savoirs aux frontières -des traditions nationales et des disciplines, mais aussi des formes d'écriture et de diffusion.Le projet se propose de recenser et de décrire ces lieux, ainsi que les fonctions de transfert qu'ils ont assumées.Voici déjà un premier lien évident avec les problématiques de ce colloque : nous considérons en effet les revues d'idées comme des médias par lesquels s'élaborent et se diffusent des savoirs.Ces médias sont, comme on le sait, aujourd'hui affectés de mutations profondes, avec la généralisation du support électronique au détriment du support papier, mais aussi avec l'emprise des politiques d'évaluation de la recherche sur le formatage des contenus et l'exigence de leur (hyper-)disciplinarisation.Le média revue tel qu'il a pu être pratiqué par Les Temps modernes, Arguments ou même Communications à ses débuts, semble donc connaitre une évidente dévaluation, en même temps que beaucoup des textes et des auteurs qui ont fait vivre ces revues trouvent de nouvelles formes de visibilité et de mise en circulation (par la réédition en volumes, ou encore par la patrimonialisation numérique).Ainsi, de la « surenchère fonctionnelle » (texte d'argumentaire du colloque) dont elle a pu faire l'objet dans l'après-guerre -au point d'apparaitre comme le média par excellence du débat d'idées -jusqu'à sa démédiation actuelle au profit d'autres formats, en passant encore par la fonction qu'elle occupe très souvent dans une chaîne de remédiation des textes (les textes publiés dans les revues considérées ont des provenances très variées -séminaire universitaire, conférence radiophonique, extrait fictionnel, etc. -et des destins eux-mêmes très variés -de la reprise en monographie, à l'oubli pur et simple), la revue rencontre très directement la question de la transformation des médias, et des effets que ces transformations ont sur les textualités médiées.Mais en réalité ce ne sont pas vraiment les questions que nous allons traiter ici ; elles nous servent plutôt d'arrière-plan pour envisager un autre pan du projet GENACH, évidemment solidaire du premier, qui consiste à faire l'expérience d'un format de production et de diffusion des savoirs sur nos objets.Le projet se veut en effet en prise directe avec les enjeux actuels de l'élaboration et de la diffusion des savoirs en Humanités.Parmi ces enjeux, le plus crucial est sans doute celui de la mise en commun des ressources documentaires.Par mise en commun, il ne faut pas entendre uniquement le fait que ces ressources sont rendues disponibles au plus grand nombre, mais surtout que les conditions mêmes de cette disponibilité sont élaborées et négociées collectivement.Ainsi, notre ambition n'est pas de constituer une base de données en ligne, issue du corpus dépouillé, mais plutôt de proposer une plateforme pérenne, dont la viabilité ne soit pas uniquement liée aux inputs scientifiques du projet.Formulée de la sorte, cette ambition vise à répondre au défaut récurrent des usages (quasiment systématiques depuis les quinze dernières années) du numérique pour la diffusion des résultats d'un projet scientifique, en particulier dans le champ des Humanités : les Annexe : Proposition d'étapes du graphe (cf.graphe sauvegardé d'Olivier, libellé de chacune des étapes) :
Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.
How this classification was reachedexpand
Full frame machine prediction
Teacher imitationNot calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.
Distilled classifier scores by category (both heads)
| Category | Codex | Gemma |
|---|---|---|
| Metaresearch | 0.012 | 0.056 |
| Meta-epidemiology (narrow) | 0.001 | 0.000 |
| Meta-epidemiology (broad) | 0.001 | 0.001 |
| Bibliometrics | 0.005 | 0.004 |
| Science and technology studies | 0.010 | 0.030 |
| Scholarly communication | 0.021 | 0.013 |
| Open science | 0.002 | 0.007 |
| Research integrity | 0.006 | 0.006 |
| Insufficient payload (model declined to judge) | 0.018 | 0.002 |
Machine scores (provisional)
The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.
Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.
score_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from itClassification
machine, unvalidatedMachine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.
How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".