{"id":"W4298622982","doi":"10.1007/s12520-022-01676-2","title":"Testing inter-observer error under a collaborative research framework for studying lithic shape variability","year":2022,"lang":"en","type":"article","venue":"Archaeological and Anthropological Sciences","topic":"Pleistocene-Era Hominins and Archaeology","field":"Social Sciences","cited_by":19,"is_retracted":false,"has_abstract":true,"ca_institutions":"Simon Fraser University","funders":"Lithic Studies Society; Leakey Foundation; Wenner-Gren Foundation","keywords":"Geography; Archaeology; Geology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1668083,0.002377504,0.001926035,0.002604189,0.003420229,0.003893794,0.003082932,0.002658101,0.006506818],"category_scores_gemma":[0.2708196,0.001055156,0.002386007,0.003555351,0.0063469,0.002906594,0.0087395,0.002522876,0.001804943],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001769819,"about_ca_system_score_gemma":0.003756909,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002181961,"about_ca_topic_score_gemma":0.005340775,"domain_scores_codex":[0.7553953,0.1495673,0.01648594,0.03124578,0.0444888,0.002816917],"domain_scores_gemma":[0.5340099,0.2828656,0.05068476,0.06723297,0.06292748,0.002279394],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.01078632,0.004570107,0.228764,0.009343432,0.005483595,0.001526572,0.04752756,0.03656681,0.1489888,0.06148475,0.01491588,0.4300423],"study_design_scores_gemma":[0.001760904,0.01999317,0.3925331,0.00277751,0.003329793,0.001879749,0.01370896,0.2058154,0.1407885,0.1197315,0.09606722,0.00161414],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1143898,0.000665192,0.8691404,0.0002888268,0.0009397285,0.005204741,0.00112933,0.0007601909,0.007481754],"genre_scores_gemma":[0.3552829,0.000202124,0.615886,0.0003358179,0.0001711155,0.0234737,0.001327206,0.000742875,0.002578264],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8331916,"threshold_uncertainty_score":0.8821774,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.292262351920366,"score_gpt":0.4627453154006594,"score_spread":0.1704829634802933,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}