{"id":"W2162177040","doi":"10.1080/01421590802512888","title":"A predictive validity study of medical judgment vignettes to assess students’ noncognitive attributes: A 3-year prospective longitudinal study","year":2009,"lang":"en","type":"article","venue":"Medical Teacher","topic":"Medical Education and Admissions","field":"Medicine","cited_by":24,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Calgary","funders":"","keywords":"Predictive validity; Psychology; Medical school; Clinical psychology; Cognition; Reliability (semiconductor); Medical education; Medicine; Psychiatry","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.003613555,0.0003976116,0.001071411,0.0002477904,0.0001582428,0.00003600413,0.0007037288,0.0003373486,0.02164275],"category_scores_gemma":[0.02635599,0.0002872205,0.0001642684,0.0008348121,0.0002643887,0.00008279148,0.0003277865,0.001458756,0.0001022804],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002881421,"about_ca_system_score_gemma":0.001728312,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002079913,"about_ca_topic_score_gemma":0.00004401511,"domain_scores_codex":[0.988696,0.0007226823,0.001019216,0.0009086465,0.008075699,0.0005777488],"domain_scores_gemma":[0.993848,0.0003447845,0.000189602,0.0005830611,0.0005277151,0.004506885],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0006507236,0.06885754,0.8977013,0.0000313421,0.0004920541,0.0006012825,0.01195874,3.450641e-7,0.000006082178,0.00003797758,0.01570042,0.003962263],"study_design_scores_gemma":[0.01117913,0.01904007,0.9273725,0.0006889116,0.0005324398,0.00004100655,0.03995029,0.0001272972,0.00005328907,0.00009095143,0.000629352,0.0002947474],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.967741,0.00003999271,0.001077814,0.02447507,0.0003561544,0.004242003,0.000009237279,0.0001443764,0.00191431],"genre_scores_gemma":[0.9949121,0.00001581931,0.0001161261,0.00271678,0.0007753578,0.0003601378,0.00002188894,0.00002987681,0.001051897],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.04981747,"threshold_uncertainty_score":0.999958,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1696745600748359,"score_gpt":0.4578434014003572,"score_spread":0.2881688413255213,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}