{"id":"W4317602988","doi":"10.1007/s10502-023-09408-8","title":"Archivist in the machine: paradata for AI-based automation in the archives","year":2023,"lang":"en","type":"article","venue":"Archival Science","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":21,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Computer science; Documentation; Archivist; Data science; Artificial intelligence; Multimedia; Library science","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01216455,0.0005121156,0.0004711513,0.003669297,0.00968564,0.02494401,0.002403478,0.002807692,0.03661162],"category_scores_gemma":[0.01875765,0.0006425465,0.0008141447,0.002690703,0.02500504,0.02877391,0.01127272,0.007256561,0.005278727],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004981154,"about_ca_system_score_gemma":0.006688237,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006796302,"about_ca_topic_score_gemma":0.01399183,"domain_scores_codex":[0.9936283,0.004024752,0.0003360939,0.0005891118,0.001106699,0.0003151816],"domain_scores_gemma":[0.9859191,0.005139017,0.0004689112,0.00575668,0.001408518,0.001307756],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005127063,0.00002497747,0.0004368144,0.0001156244,0.000008817029,0.00007176632,0.01197575,0.0002514879,0.0003098264,0.9020859,0.03533061,0.04933717],"study_design_scores_gemma":[0.00001491958,0.00001721976,0.0003000697,0.0002911789,0.00001143643,0.0001571313,0.007925535,0.00124867,0.001175451,0.3962975,0.5925263,0.0000346644],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"other","genre_gemma":"empirical","genre_scores_codex":[0.01693159,0.007846675,0.3004569,0.1296444,0.003866822,0.0002034047,0.0008627581,0.007178063,0.5330094],"genre_scores_gemma":[0.5050649,0.005356621,0.2779892,0.005874893,0.002316552,0.0002991261,0.0009129478,0.005066955,0.1971188],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.03661162,"threshold_uncertainty_score":0.1224781,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1932326004149269,"score_gpt":0.4808470610267683,"score_spread":0.2876144606118414,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}