{"id":"W2007329364","doi":"10.1097/00001888-200308000-00020","title":"A Comparison of Performance Assessment Programs for Medical Practitioners in Canada, Australia, New Zealand, and the United Kingdom","year":2003,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Primary Care and Health Outcomes","field":"Health Professions","cited_by":39,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Referral; Family medicine; Medicine; Task (project management); Medical education; Management","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002765459,0.0001188382,0.0005321825,0.00009924358,0.0001653485,7.738333e-7,0.0001635123,0.000219821,0.0003684989],"category_scores_gemma":[0.001005088,0.00006975477,0.00001532961,0.0002951008,0.0001672653,0.00005325302,0.00002911165,0.001453831,0.000001685472],"about_ca_system_candidate":true,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005434214,"about_ca_system_score_gemma":0.006019843,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.7158191,"about_ca_topic_score_gemma":0.4650226,"domain_scores_codex":[0.9974999,0.0004189624,0.0009684498,0.0001597474,0.000527026,0.0004259204],"domain_scores_gemma":[0.9969137,0.002197652,0.0003939915,0.0001483899,0.00008297758,0.0002633313],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001320518,0.000005700905,0.7688338,0.0002837629,0.00001544162,9.796494e-7,0.002849648,0.000002271388,0.000003612035,0.009313417,0.2172092,0.001350122],"study_design_scores_gemma":[0.0116736,0.0001838467,0.1088666,0.0008829954,0.00006694494,0.000006866205,0.00759293,0.0006542195,0.000007902971,0.0006289235,0.869317,0.0001181867],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8752624,0.0003609401,0.0003026626,0.1202537,0.00072334,0.001841354,0.00000470636,0.00001378834,0.001237097],"genre_scores_gemma":[0.9839644,0.0005337733,0.0001723064,0.01249183,0.0001981956,0.0001671356,0.00007224091,0.000009432702,0.002390695],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.6599672,"threshold_uncertainty_score":0.9996151,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1868255014824252,"score_gpt":0.5205398514660337,"score_spread":0.3337143499836085,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}