Radiocarbon dating of Mesolithic human remains
Notice bibliographique
Résumé
This is to introduce what I hope will be an ongoing set of papers in Mesolithic Miscellany. The first of these follows, written in collaboration with Canadian colleagues. I feel that some explanation is required for what is a project in data management. Its starting place is my experience in putting together a recent paper on burial chronology for the proceedings of the MESO2005 conference (Meiklejohn et al. 2009). In that paper we encountered the problem of the highly erratic publication of radiocarbon dates. While clearly reflecting the proprietary nature of these dates, it can make it extremely difficult to obtain a full picture of the state of dating for any given type of archaeological information. To provide context, in the aftermath of presenting a preliminary paper at Belfast, it took over six months of intensive work to gather the information appearing in the paper’s appendix, without which the paper could not have been written. And this length of time was still required even though the database used in the paper had been started over a decade earlier, rooted in a paper that appeared thirty years ago (Newell et al. 1979). The core issue of data availability has been exacerbated over time. The sheer number of dates has accelerated over the years, making any database for a given period or phenomenon of enormous size. One result of this acceleration is that, in a counterproductive way, regular publication of date lists in Radiocarbon is, for practical purposes, finished. Laboratories that ceased publication earliest were generally those producing the
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,002 | 0,004 |
| Méta-épidémiologie (sens strict) | 0,000 | 0,000 |
| Méta-épidémiologie (sens large) | 0,000 | 0,000 |
| Bibliométrie | 0,006 | 0,007 |
| Études des sciences et des technologies | 0,002 | 0,002 |
| Communication savante | 0,002 | 0,001 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,000 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,008 | 0,002 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».