Application de la protéomique pour estimer le sexe d’individus archéologiques : exploration méthodologique sur trois cimetières historiques euro-québécois
Notice bibliographique
Résumé
Afin de pallier le manque de précision dans l’estimation du sexe via les méthodes morphologiques, surtout dans le cas des juvéniles, diverses méthodes basées sur la génétique ont été appliquées en bioarchéologie. Outre l’analyse de l’ADN ancien, la présence dans l’émail de certaines protéines associées au sexe, telle que l’amélogénine, permet d’apporter des informations hautement précises. Le présent mémoire a donc pour objectif d’appliquer cette méthode sur un échantillon archéologique issu de trois cimetières euro-québécois en vue de comparer les résultats avec les données ostéologiques antérieures. Afin d’extraire l’amélogénine, l’émail de molaires de 47 individus a subi une abrasion minimale à l’acide et les échantillons extraits ont ensuite été analysés au spectromètre de masse. Les résultats indiquant la présence ou l’absence de différentes chaînes de peptides (N = 40) associées au chromosome X (AMELX) ou au chromosome Y (AMELY), nous ont permis d’estimer le sexe de chaque individu (masculin = présence d’au moins une des 18 chaînes de peptides d’AMELY; féminin = absence de chaînes de peptides d’AMELY). Les résultats issus de la protéomique sont presque tous en accord (85 %) avec les données ostéologiques. Pour les individus adultes (N = 24), l’accord inter-méthodologique est presque parfait et hautement significatif. Pour les individus juvéniles, les résultats ont été soit confirmés (N = 10), modifiés (N = 6) ou attribués (N = 7) par la protéomique. Dans notre échantillon, on remarque qu’il y a plus de femmes et de filles que d’hommes et de garçons. L’apport de données protéomiques pour l’estimation du sexe des juvéniles est non négligeable et propose des avenues de recherches intéressantes pour les futures analyses qui concernent la mortalité reliée au sexe dont celle des enfants.
Récupéré en direct depuis OpenAlex et désinversé. Les résumés ne sont pas conservés dans cette base de données : les index inversés représentent 8,6 Go des 9,3 Go de texte de la base, et le serveur dispose de 13 Go libres.
Comment cette classification a été obtenuedéplier
Prédiction machine sur la base complète
Imitation des enseignantsNi prévalence calibrée, ni vérité terrain. Validation humaine à venir. Le volet Gemma est une étiquette directe du modèle pour chaque travail de la base, lue sur la notice réduite au titre. Le volet Codex est un classifieur appris des 10 348 étiquettes directes de Codex et calibré sur les taux pondérés de l'échantillon; les champs sans appui suffisant ne portent aucun appel Codex. Le mode candidate est l'union des deux volets; le consensus est leur intersection. Ces sorties portent le statut machine_predicted_unvalidated et ne sont pas des étiquettes humaines.
Scores du classifieur distillé par catégorie (deux têtes)
| Catégorie | Codex | Gemma |
|---|---|---|
| Métarecherche | 0,004 | 0,003 |
| Méta-épidémiologie (sens strict) | 0,001 | 0,000 |
| Méta-épidémiologie (sens large) | 0,001 | 0,001 |
| Bibliométrie | 0,006 | 0,005 |
| Études des sciences et des technologies | 0,002 | 0,001 |
| Communication savante | 0,002 | 0,000 |
| Science ouverte | 0,001 | 0,001 |
| Intégrité de la recherche | 0,001 | 0,001 |
| Charge utile insuffisante (le modèle a refusé de juger) | 0,004 | 0,001 |
Scores machine (provisoires)
Les deux têtes enseignantes du modèle étudiant, lues sur ce travail. Un score ordonne la base pour la relecture; il n'affirme jamais une catégorie, et le statut de validation accompagne chaque rangée tel quel.
Scores de référence d'un modèle non mature (critères de maturité non atteints, 7 itérations). Un score ordonne; il n'affirme jamais une catégorie.
score_only:v0-immature-baseline · tel quel depuis la passe de notation : score_only signifie que le nombre peut ordonner les travaux, et qu'aucune étiquette de catégorie n'en découleClassification
machine, non validéePrédiction automatique; un appel candidat d’une seule source (Gemma direct ou Codex distillé), pas un consensus.
Le détail, modèle par modèle et score par score, se trouve en fin de page sous « Comment cette classification a été obtenue ».