{"id":"W1970986976","doi":"10.1016/s0002-9610(01)00700-0","title":"Exporting a technical skills evaluation technology to other sites","year":2001,"lang":"en","type":"article","venue":"The American Journal of Surgery","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":54,"is_retracted":false,"has_abstract":false,"ca_institutions":"University Health Network; University of Toronto","funders":"","keywords":"Checklist; Reliability (semiconductor); Medicine; Construct validity; Administration (probate law); Medical education; Psychology; Patient satisfaction; Nursing; Political science","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008888566,0.001013982,0.0007992652,0.004210283,0.0007045735,0.002945138,0.001102621,0.000833654,0.04351776],"category_scores_gemma":[0.02237575,0.0005801428,0.001130959,0.002148345,0.0004014324,0.002440308,0.001871545,0.001098139,0.01795474],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006178963,"about_ca_system_score_gemma":0.001627334,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003299125,"about_ca_topic_score_gemma":0.00287483,"domain_scores_codex":[0.9956878,0.001716054,0.000430507,0.0004195665,0.001487684,0.0002583523],"domain_scores_gemma":[0.9456325,0.01824388,0.001735252,0.01511201,0.01754113,0.001735219],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0008435231,0.00158541,0.06099685,0.0003222188,0.0001027476,0.0002926874,0.001202013,0.001538516,0.0307229,0.001810794,0.01805116,0.8825311],"study_design_scores_gemma":[0.001164522,0.01004994,0.3708622,0.0008958293,0.0009454934,0.003703912,0.004677714,0.05164073,0.2896778,0.008074115,0.2578288,0.0004788526],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3381272,0.0004636708,0.4027989,0.002039473,0.00116053,0.0046365,0.007429323,0.04174147,0.2016028],"genre_scores_gemma":[0.487824,0.0004863011,0.3928793,0.001005476,0.0003019051,0.00157017,0.008778495,0.004319763,0.1028346],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.04351776,"threshold_uncertainty_score":0.1455814,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06470768260662817,"score_gpt":0.381547012965974,"score_spread":0.3168393303593459,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}