MétaCan
Menu
Retour à la cohorte
Enregistrement W7143863137 · doi:10.24619/00000788

How could archival metadata be successfully shared?: an international survey of online union catalogs

2008· article· ja· W7143863137 sur OpenAlexaboutno aff
タカヒロ サカグチ, Takahiro SAKAGUCHI

Notice bibliographique

RevueInstitutional Repositories DataBase (IRDB) · 2008
Typearticle
Langueja
DomaineComputer Science
ThématiqueLibrary Science and Information Systems
Établissements canadiensnon disponible
Organismes subventionnairesnon disponible
Mots-clésMetadataUnion catalogDatabase catalogMetadata repositoryMeta Data ServicesGeospatial metadataData sharingNational archives

Résumé

récupéré en direct d'OpenAlex

アーカイブズ情報の共有化は、アーカイブズの保存と利用をめぐる一般の理解を広げるのに大きな効果があるという点で重要であり、全国のアーカイブズ機関による協同の成功を期すにあたっては、その方法論を綿密に検討する必要がある。そこで、イギリス、アメリカ、カナダ、オーストラリア、日本において構築されている全国的アーカイブズ情報共有化データベースを対象に、共有化の仕組みとメタデータ標準類の活用方法について調査を行った。調査項目は「記述作成機関」「記述レベル」「記述項目」「検索項目」「記述規則」「シソーラス」「EADの活用」である。その結果、次のような点が明らかになった。1)データの記述は基本的にアーカイブズ資料を所蔵している各所蔵機関の役割とされていた。2)記述のレベルはフォンドに相当する単位を基本としていた。3)ISAD(G)で記述が必須とされている項目に加え、いくつかの項目が記述項目とされていることが多かった。4)作成者名称は、すべての国で検索項目となっていた。5)記述規則、シソーラス、EADの活用といった発展的な課題については、データベースによる相違が大きかった。 Sharing of archival metadata is crucial in order to expand people's understanding of Management of and access to archival resources. Because the collaboration project between various archival institutions would be difficult, it is necessary to consider carefully about its strategy and methodology to develop archival union database successfully. This article is on an international survey of 5 national online union catalogs: A2A(UK), NUCMC(USA), Archives Canada, RAAM (Australia), and National Archival Information Database and Network (Japan). This survey focused on the system for collaboration and the use of metadata standards, especially on who create archival descriptions, levels of description contained, metadata elements, elements used for search, content standards, thesaurus,and use of EAD. The main findings are: 1)Basically, data creation is the role of each institution with archival holdings: 2) All databases contain fonds level description: 3) In addition to the elements identified as mandatory in ISAD(G), some elements are used. 4) Name of creator (s) is used as search elements in all databases. 5) There are wide variations on the use of content standards, thesaurus and EAD.

Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.

Comment cette classification a été obtenuedéplier

Prédiction machine sur la base complète

Imitation des enseignants

Ni prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.

score de la tête « metaresearch » (Codex)0,013
score de la tête « metaresearch » (Gemma)0,047
Version: metacan-v3-hybrid-931329e0061cStatut de validation: machine_predicted_unvalidated
Catégories candidatesCommunication savante
Catégories consensuellesaucune
DomaineSignal candidat: aucune · Signal consensuel: aucune
Devis d'étudeSignal candidat: Observationnel · Signal consensuel: Observationnel
GenreSignal candidat: Empirique · Signal consensuel: Empirique
Score de désaccord entre enseignants0,988
Score d'incertitude au seuil0,068

Scores du classifieur distillé par catégorie (deux têtes)

CatégorieCodexGemma
Métarecherche0,0130,047
Méta-épidémiologie (sens strict)0,0000,000
Méta-épidémiologie (sens large)0,0000,000
Bibliométrie0,0130,032
Études des sciences et des technologies0,0040,003
Communication savante0,0120,016
Science ouverte0,0010,004
Intégrité de la recherche0,0010,001
Charge utile insuffisante (le modèle a refusé de juger)0,0080,001

Scores machine (provisoires)

Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.

Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.

Tête enseignante Opus0,083
Tête enseignante GPT0,292
Écart entre enseignants0,210 · la distance entre les deux têtes enseignantes sur ce seul travail
Statut de validationscore_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découle

Classification

machine, non validée

Prédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.

Devis d'étudeObservationnel
Domainenon disponible
GenreEmpirique

Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».

En bref

Citations0
Publié2008
Routes d'admission1
Résumé présentoui

Explorer davantage

Même revueInstitutional Repositories DataBase (IRDB)Même sujetLibrary Science and Information SystemsTravaux en français237 207