Notice bibliographique
Résumé
Cet article a pour but d'etiduer les marques d'usage dans les dictionnaires coreens, Great Korean Dictionary 『국어대사전』(desormais GKD) et Standard Great Korean Dictionary 『표준국어대사전』(desormais SGKD) par rapport a celles du dictionaire francais, le Nouveau Petit Robert. Nous y avons releve des marques d'usage utilisees et nous les avons classees d'apres les cinq criteres suivants: le temps, l'espace, les niveaux de langue, le domaine et la frequence. Ce travail nous a permis de montrer les caracteristiques et/ou les problemes du systeme des marques d'usage des dictionnaires. En ce qui concerne le temps, le dictionnaire francais utilise deux marques VX et VIEILLI. alors que les dictionnaires coreens n'utilisent qu'une pour indiquer les vieux mots. Ce qui est propre au dictionnaire francais, c'est qu'il emploie une marque ANCIENNT pour presenter un mot ou un sens courant qui se rapporte a une chose du passe disparue. Pour l'espace, les regionalismes sont mentionnes comme REGION. et precises par la mention de la zone d'emploi. Le domaine geographique d'usage peut etre une region de la France ou un des pays francophones. Les termes institutionnels sont distingues par le mention ‘Au Quebec’, ‘En Suisse’, etc. dans la definition. Les dictionnaires coreens utilisent en commun la marque et ils precisent la zone d'emploi apres la definition. Le SGKD seul accepte les mots et les usages propres a la Coree du Nord et utilise la marque pour les indiquer. Quant aux niveaux de langue, le NPR utilise differents types de marques selon qu'elles concernent l'utilisation d'unite par un groupe, une strategie de discours ou la semantique connotative des unites lexicales. Le SGKD n'utilise que deux marques , et le GKD emploie diverses marques comme le dictionnaire francais. Cependant, ce dernier n'utilise pas de marques pour indiquer les mots argotiques qui sont hyperonymes des ‘jargons des etudiants 학생어’, ‘jargons de shimmani 심마니어’. En ce qui concerne le domaine, le NPR emploie les marques generiques DIDAC., SC., TECHN. pour presenter un mot ou un emploi qui n'existe que dans la langue savante ou technique. Quand il s'agit d'une science ou technique particuliere et tres importante, elles sont remplacees par le nom de cette science ou technique. Ces noms sont au nombre de 198. Les domaines sont detailles. Les dictionnaires coreens ne se servent pas de marques generiques pour indiquer une langue speciale ou technique. Ils n'emploient que le nom de la science ou de la technique. Les domaines ne sont pas detailles. Il y en a une cinquantaine. La difference esssentielle dans la presentation des marques d'usage dans le dictionnaire francais et dans les dictionnaires coreens reside dans le fait que le premier presente toutes les marques utilisees dans le dictionnaire et explique leur emploi dans la preface tandis que les seconds ne mentionnent que les marques. C'est pourquoi les lecteurs sont obliges de consulter les definitions pour comprendre leur emploi. Ce qui est etonnant, c'est que des mots comme ‘mots des jeunes enfants 소아어’, ‘jargons des etudiants 학생어’ etc. ne sont pas enregistres comme entree. Il vaudrait mieux presenter les marques et leurs emplois dans la preface dans l'interet du lecteur. Deuxiemement, tandis que les informations sur les restrictions d'emploi sont donnees par les marques d'usage dans le dictionnaire francais, elles sont donnees, tantot par la marque, tantot par la definition dans les dictionnaires coreens. Etant donne que l'indication de restrictions d'emploi donnee dans la definition peut etre remplacee par les marques d'usage, ne vaudrait-il pas mieux de les remplacer par les marques. Cela permettrait de decrire avec coherence les informations sur les usages de la langue coreenne.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction distillée sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Apprise à partir de 10 348 étiquettes directes de Codex et de 10 348 étiquettes directes de Gemma. Le mode candidate est l'union des têtes enseignantes seuillées; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont ni des étiquettes humaines ni des étiquettes directes de modèles de pointe.
Scores Codex et Gemma par catégorie
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,000 | 0,000 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,000 |
| Bibliométrie | 0,000 | 0,000 |
| Études des sciences et des technologies | 0,001 | 0,001 |
| Communication savante | 0,000 | 0,000 |
| Science ouverte | 0,000 | 0,000 |
| Intégrité de la recherche | 0,000 | 0,000 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,020 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; les deux têtes enseignantes s’accordent sur ce qui est montré ici.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».