Notice bibliographique
Résumé
Cet article a pour but d'etiduer les marques d'usage dans les dictionnaires coreens, Great Korean Dictionary 『국어대사전』(desormais GKD) et Standard Great Korean Dictionary 『표준국어대사전』(desormais SGKD) par rapport a celles du dictionaire francais, le Nouveau Petit Robert. Nous y avons releve des marques d'usage utilisees et nous les avons classees d'apres les cinq criteres suivants: le temps, l'espace, les niveaux de langue, le domaine et la frequence. Ce travail nous a permis de montrer les caracteristiques et/ou les problemes du systeme des marques d'usage des dictionnaires. En ce qui concerne le temps, le dictionnaire francais utilise deux marques VX et VIEILLI. alors que les dictionnaires coreens n'utilisent qu'une pour indiquer les vieux mots. Ce qui est propre au dictionnaire francais, c'est qu'il emploie une marque ANCIENNT pour presenter un mot ou un sens courant qui se rapporte a une chose du passe disparue. Pour l'espace, les regionalismes sont mentionnes comme REGION. et precises par la mention de la zone d'emploi. Le domaine geographique d'usage peut etre une region de la France ou un des pays francophones. Les termes institutionnels sont distingues par le mention ‘Au Quebec’, ‘En Suisse’, etc. dans la definition. Les dictionnaires coreens utilisent en commun la marque et ils precisent la zone d'emploi apres la definition. Le SGKD seul accepte les mots et les usages propres a la Coree du Nord et utilise la marque pour les indiquer. Quant aux niveaux de langue, le NPR utilise differents types de marques selon qu'elles concernent l'utilisation d'unite par un groupe, une strategie de discours ou la semantique connotative des unites lexicales. Le SGKD n'utilise que deux marques , et le GKD emploie diverses marques comme le dictionnaire francais. Cependant, ce dernier n'utilise pas de marques pour indiquer les mots argotiques qui sont hyperonymes des ‘jargons des etudiants 학생어’, ‘jargons de shimmani 심마니어’. En ce qui concerne le domaine, le NPR emploie les marques generiques DIDAC., SC., TECHN. pour presenter un mot ou un emploi qui n'existe que dans la langue savante ou technique. Quand il s'agit d'une science ou technique particuliere et tres importante, elles sont remplacees par le nom de cette science ou technique. Ces noms sont au nombre de 198. Les domaines sont detailles. Les dictionnaires coreens ne se servent pas de marques generiques pour indiquer une langue speciale ou technique. Ils n'emploient que le nom de la science ou de la technique. Les domaines ne sont pas detailles. Il y en a une cinquantaine. La difference esssentielle dans la presentation des marques d'usage dans le dictionnaire francais et dans les dictionnaires coreens reside dans le fait que le premier presente toutes les marques utilisees dans le dictionnaire et explique leur emploi dans la preface tandis que les seconds ne mentionnent que les marques. C'est pourquoi les lecteurs sont obliges de consulter les definitions pour comprendre leur emploi. Ce qui est etonnant, c'est que des mots comme ‘mots des jeunes enfants 소아어’, ‘jargons des etudiants 학생어’ etc. ne sont pas enregistres comme entree. Il vaudrait mieux presenter les marques et leurs emplois dans la preface dans l'interet du lecteur. Deuxiemement, tandis que les informations sur les restrictions d'emploi sont donnees par les marques d'usage dans le dictionnaire francais, elles sont donnees, tantot par la marque, tantot par la definition dans les dictionnaires coreens. Etant donne que l'indication de restrictions d'emploi donnee dans la definition peut etre remplacee par les marques d'usage, ne vaudrait-il pas mieux de les remplacer par les marques. Cela permettrait de decrire avec coherence les informations sur les usages de la langue coreenne.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,006 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,002 | 0,005 |
| Études des sciences et des technologies | 0,001 | 0,002 |
| Communication savante | 0,006 | 0,005 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,009 | 0,007 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».