MétaCan
Menu
Back to cohort
Record W2021182544 · doi:10.7202/003400ar

Vers un produit unifié en terminologie et en documentation : le thésaurus terminologique

2002· article· fr· W2021182544 on OpenAlexvenueaboutno aff
Louise Larivière

Bibliographic record

VenueMeta Journal des traducteurs · 2002
Typearticle
Languagefr
FieldArts and Humanities
Topiclinguistics and terminology studies
Canadian institutionsnot available
Fundersnot available
KeywordsHumanitiesPhilosophyArt

Abstract

fetched live from OpenAlex

Les terminologies et les thésaurus documentaires présentent suffisamment d'affinités au plan de leur contenu et de leur structure pour qu'on puisse envisager la création d'un seul répertoire unifié. Un tel produit pourrait prendre la forme d'un thésaurus terminologique qui servirait tant à l'indexation et au repérage des documents qu'à la consultation des données terminologiques et dont la confection s'effectuerait à partir des méthodes utilisées en terminologie et en documentation. Pour ce faire, les descripteurs des thésaurus devront acquérir la spécificité du terme et s'accompagner d'une définition tandis que les terminologies devront adopter la structure des thésaurus : système de relations et plan de classement. En s'appuyant sur ces principes, on présente un modèle de thésaurus terminologique appliqué aux documents professionnels. D'entrée de jeu, Sparck Jones et Kay (1973: 1) affirment, dans l'introduction à leur étude sur les rapports entre la linguistique et les sciences de l'information, que ces deux disciplines ont suffisamment d'affinités pour faire bon ménage ("are bedfellows"). La linguistique, en effet, a pour objet de décrire les langues naturelles qui ont pour fonction, entre autres, de transmettre de l'information, alors que les sciences de l'information ont pour objet de repérer de l'information traduite dans des documents écrits en langue naturelle. Tout en reconnaissant l'existence de recoupements entre les deux disciplines, ces auteurs s'étonnent, néanmoins, de leur manque d'interpénétration et s'interrogent sur les causes d'un tel fait et sur les mesures à prendre pour y remédier. Les recoupements sont si évidents, selon eux, qu'ils se demandent, même, si les sciences de l'information ne devraient pas constituer une sous-discipline de la linguistique ou la linguistique faire partie des sciences de l'information. Mais tel n'est pas leur but de répondre à cette question. Ils cherchent plutôt à savoir ce que ces deux disciplines peuvent s'apporter mutuellement et quel degré d'interpénétration elles ont atteint ou peuvent atteindre. S'est-on, par ailleurs, posé les mêmes questions au sujet de la terminologie et de la documentation ? Depuis une quinzaine d'années, un certain rapprochement s'est amorcé entre terminologues et spécialistes en information documentaire. Dans les publications canadiennes des années 70 (articles de revues et actes de colloque), on s'est surtout arrêté sur la façon dont la fonction recherche de la documentation pouvait optimiser le rendement des activités terminologiques et traductionnelles de plus en plus intenses et complexes1, mais on a démontré peu d'intérêt pour la documentation dans sa fonction analyse. On croit même, dans certains milieux, que la terminologie et la documentation constituent "deux univers séparés dont les concepts de base sont bien distincts, la documentation s'occupant de classes et la terminologie de notions à structurer et à dénommer"2. Quelques auteurs se sont attardés, cependant, sur un aspect de la fonction analyse de la documentation, soit la classification, et ont préconisé le répertoire de type thésaurus comme système de classement des données terminologiques à l'intérieur d'une banque de données3. C'est donc vers l'Europe surtout et les États-Unis qu'il faut se tourner pour trouver des écrits dans lesquels on compare les démarches utilisées en terminologie et en documentation pour produire les répertoires terminologiques, d'une part, et les répertoires documentaires que sont les thésaurus, d'autre part, pour en conclure qu'elles possèdent suffisamment d'affinités pour tendre progressivement vers un produit unifié4. Un tel produit unifié pourrait prendre la forme d'un thésaurus terminologique qui servirait tant à l'indexation et au repérage des documents qu'à la consultation de données terminologiques et dont la confection s'effectuerait à partir des méthodes utilisées en terminologie et en documentation. C'est ce à quoi vise cette communication : 1) justifier la création d'un tel répertoire en comparant les produits fabriqués traditionnellement, l'un par les terminologues (les terminologies) et l'autre par les documentalistes (les thésaurus), du point de vue de leur finalité, de leur contenu, de leur structure pour en faire ressortir les lacunes et les insuffisances; 2) décrire son fonctionnement à partir d'un modèle appliqué aux documents professionnels.

Fetched live from OpenAlex and de-inverted. Abstracts are not stored in this database: the inverted indexes are 8.6 GB of the frame’s 9.3 GB of text, and the host has 13 GB free.

How this classification was reachedexpand

Full frame machine prediction

Teacher imitation

Not calibrated prevalence, not ground truth. Human validation pending. The Gemma side is a direct model label for every work in the frame, read from the title-only record. The Codex side is a classifier learned from the 10,348 direct Codex labels and calibrated to design-weighted sample rates; fields without enough sample support carry no Codex call. Candidate is the union of the two sides; consensus is their intersection. These outputs are machine_predicted_unvalidated and are not human labels.

metaresearch head score (Codex)0.011
metaresearch head score (Gemma)0.016
Version: metacan-v3-hybrid-931329e0061cValidation status: machine_predicted_unvalidated
Candidate categoriesnone
Consensus categoriesnone
DomainCandidate signal: none · Consensus signal: none
Study designCandidate signal: Theoretical or conceptual · Consensus signal: Theoretical or conceptual
GenreCandidate signal: Empirical · Consensus signal: none
Teacher disagreement score0.015
Threshold uncertainty score0.057

Distilled classifier scores by category (both heads)

CategoryCodexGemma
Metaresearch0.0110.016
Meta-epidemiology (narrow)0.0010.001
Meta-epidemiology (broad)0.0010.001
Bibliometrics0.0080.008
Science and technology studies0.0050.013
Scholarly communication0.0150.024
Open science0.0020.007
Research integrity0.0040.005
Insufficient payload (model declined to judge)0.0090.004

Machine scores (provisional)

The two teacher heads of the student model, read on this work. A score orders the frame for review; it never asserts a category, and the validation status ships verbatim with every row.

Baseline scores from an immature model (maturity gate not passed, 7 training rounds). Scores rank; they never assert a category.

Opus teacher head0.071
GPT teacher head0.279
Teacher spread0.208 · how far apart the two teachers sit on this one work
Validation statusscore_only:v0-immature-baseline · verbatim from the scoring run: score_only means the number may rank works, and no category label ships from it

Classification

machine, unvalidated

Machine predicted; a candidate call from one source (direct Gemma or distilled Codex), not a consensus.

The models applied no category: nothing in the taxonomy fit this work.
Study designTheoretical or conceptual
Domainnot available
GenreEmpirical

How this classification was reached, model by model and score by score, is at the end of the page under "How this classification was reached".

Quick stats

Citations1
Published2002
Admission routes2
Has abstractyes

Explore more

Same venueMeta Journal des traducteursSame topiclinguistics and terminology studiesFrench-language works237,207