{"id":"W4390546377","doi":"10.1001/jamasurg.2023.6696","title":"Practical Guide to Assessment Tool Development for Surgical Education Research","year":2024,"lang":"en","type":"article","venue":"JAMA Surgery","topic":"Innovations in Medical Education","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"McGill University","funders":"","keywords":"Medicine; Medical education; Medical physics; MEDLINE","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006743473,0.0001078395,0.0002140238,0.0007060786,0.0001543296,0.0001549053,0.00005966282,0.0001496549,0.0004553158],"category_scores_gemma":[0.008279376,0.00009368931,0.00007718227,0.001207296,0.00005176621,0.0001797538,0.00004991832,0.000513183,0.0003091512],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009340058,"about_ca_system_score_gemma":0.01040051,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001195437,"about_ca_topic_score_gemma":9.116715e-7,"domain_scores_codex":[0.9976392,0.0001042975,0.0005909072,0.0003808385,0.000895124,0.0003896037],"domain_scores_gemma":[0.9962655,0.002201358,0.00003170688,0.0003008895,0.001056593,0.000143936],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005056035,0.0002994966,0.001019942,0.0002324764,0.00002724743,0.0000261753,0.0001331968,2.132541e-7,0.0001031597,0.009686016,0.6859906,0.3024309],"study_design_scores_gemma":[0.0001594242,0.00004478431,0.009697755,0.0004983123,0.00001690443,0.0001288406,0.0004041906,0.000331153,0.0008376572,0.0002105012,0.9875618,0.0001086826],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.664275,0.0002321543,0.02491966,0.2813496,0.006786137,0.002201061,0.000005301099,0.0002542319,0.01997691],"genre_scores_gemma":[0.458009,0.00005916678,0.4851342,0.006961415,0.006823978,0.004208886,0.0007921496,0.0001063321,0.03790493],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.4602145,"threshold_uncertainty_score":0.9952096,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1108430091016513,"score_gpt":0.5325032360688411,"score_spread":0.4216602269671898,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}