{"id":"W4413258124","doi":"10.2196/72264","title":"Game-Based Assessment of Cognitive Abilities and Personality Characteristics for Surgical Resident Selection: A Preliminary Validation Study","year":2025,"lang":"en","type":"article","venue":"JMIR Medical Education","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Psychology; Test (biology); Human multitasking; Applied psychology; Personnel selection; Aptitude; Cognition; Personality; Clinical psychology; Medical education; Social psychology; Cognitive psychology; Developmental psychology; Medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006261684,0.00008767823,0.0002401574,0.0001046361,0.00006275386,0.00001432205,0.00002684641,0.00009376754,0.0004200448],"category_scores_gemma":[0.001271952,0.00007626272,0.00005526282,0.0001866169,0.0001017469,0.00004042783,0.00001280058,0.0001415404,3.973464e-7],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00008724509,"about_ca_system_score_gemma":0.00155213,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002699101,"about_ca_topic_score_gemma":0.00000275803,"domain_scores_codex":[0.9987956,0.000135844,0.0003595706,0.0002175261,0.0003930111,0.00009842392],"domain_scores_gemma":[0.9981678,0.001142077,0.00009877633,0.00007287672,0.0003893964,0.0001291299],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002104462,0.004767963,0.9242246,0.000821612,0.0001077401,0.000003289311,0.002642513,0.000002257102,0.000006499227,0.00165945,0.0001268271,0.06353284],"study_design_scores_gemma":[0.005848046,0.0009363926,0.9796742,0.0006638214,0.0001496947,0.000005262307,0.004100839,0.007534177,0.00005409984,0.000139546,0.000827654,0.00006623548],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9944908,0.00003478872,0.0009774485,0.001905057,0.0001646446,0.001375201,0.000006234607,0.00002918426,0.00101664],"genre_scores_gemma":[0.998374,0.000004216495,0.0001260377,0.0003369412,0.0001397046,0.0004885356,0.0001933137,0.000005834097,0.0003313953],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0634666,"threshold_uncertainty_score":0.4599195,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02872945086791322,"score_gpt":0.4280367414831215,"score_spread":0.3993072906152083,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}