{"id":"W2949348360","doi":"10.4300/jgme-d-19-00107.1","title":"Picking the Right Tool for the Job: A Reliability Study of 4 Assessment Tools for Central Venous Catheter Insertion","year":2019,"lang":"en","type":"article","venue":"Journal of Graduate Medical Education","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Generalizability theory; Checklist; Competence (human resources); Medicine; Trainer; Inter-rater reliability; Educational measurement; Psychology; Computer science; Curriculum; Rating scale","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002439675,0.00008095635,0.0002698415,0.00004558871,0.0001040977,0.0000284827,0.0001310276,0.00005303463,0.0001190609],"category_scores_gemma":[0.002669912,0.00003784908,0.0001925054,0.000110242,0.00004488446,0.0001154733,0.00001175446,0.0002752399,8.591985e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001219674,"about_ca_system_score_gemma":0.0008399077,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002165828,"about_ca_topic_score_gemma":0.000006416959,"domain_scores_codex":[0.9983098,0.0001212982,0.0006268005,0.0001046234,0.0006874866,0.0001500214],"domain_scores_gemma":[0.9970945,0.001730356,0.0003811265,0.0001882216,0.0005020466,0.0001037114],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.002990111,0.01856958,0.2576164,0.0004705753,0.0008334321,0.000004891239,0.0170797,0.001014236,0.0002789932,0.00207101,0.002085272,0.6969858],"study_design_scores_gemma":[0.007203473,0.003591023,0.9614689,0.0002609228,0.0004493045,0.00004558378,0.004659354,0.007152937,0.00008696723,0.0008196867,0.01417534,0.00008651122],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9826201,0.00004653438,0.002707826,0.01182018,0.001270405,0.001452016,0.00000114984,0.000004772134,0.00007705884],"genre_scores_gemma":[0.9983839,0.0000165577,0.0003566179,0.0007210889,0.000403517,0.00004696688,0.000005616931,0.000009176634,0.00005650803],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7038525,"threshold_uncertainty_score":0.3196327,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05753086002312422,"score_gpt":0.3848520792083348,"score_spread":0.3273212191852105,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}