{"id":"W2116812741","doi":"","title":"Validation of a large-scale clinical examination for international medical graduates.","year":2012,"lang":"en","type":"article","venue":"PubMed","topic":"Global Health Workforce Issues","field":"Health Professions","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; Objective structured clinical examination; Family medicine; Scale (ratio); Test (biology); Rating scale; Physical examination; Educational measurement; Psychology; Medical education; Curriculum; Surgery","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007962183,0.00008985793,0.0002390691,0.00007874068,0.0001599883,0.000002984234,0.0002151899,0.0002979594,0.0003711058],"category_scores_gemma":[0.00482216,0.00008049059,0.00008268121,0.0001357605,0.00005014689,0.0002124237,0.00009546922,0.0002759244,0.00005577025],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001392782,"about_ca_system_score_gemma":0.00008521907,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00002684224,"about_ca_topic_score_gemma":0.00003750642,"domain_scores_codex":[0.9971171,0.0005210501,0.0009790411,0.0001704368,0.0005269058,0.0006854419],"domain_scores_gemma":[0.9974137,0.001189801,0.0003956144,0.0001758985,0.0004538606,0.0003711293],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00009784404,0.0004154697,0.8091,0.000188703,0.00003083139,1.864483e-7,0.001297799,6.69841e-7,0.000001302538,0.00466276,0.03132541,0.152879],"study_design_scores_gemma":[0.001477581,0.00002101613,0.8429524,0.00007096658,0.0000209015,4.480652e-7,0.0007120597,0.000290098,0.0001023181,0.0004156849,0.1538551,0.00008143282],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9688737,0.0001727808,0.00413402,0.004475676,0.008600126,0.002903768,0.00007617789,0.0001026922,0.01066108],"genre_scores_gemma":[0.9910134,0.0000819343,0.0009950169,0.0009100598,0.001942207,0.002945585,0.0001849967,0.00001740322,0.001909361],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1527976,"threshold_uncertainty_score":0.5772924,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1309715409582473,"score_gpt":0.4818000563529121,"score_spread":0.3508285153946648,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}