{"id":"W4391285444","doi":"10.1097/acm.0000000000005651","title":"A Comparison of Remote vs In-Person Proctored In-Training Examination Administration for Internal Medicine","year":2024,"lang":"en","type":"article","venue":"Academic Medicine","topic":"Diversity and Career in Medicine","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Training (meteorology); Administration (probate law); Medical education; Psychology; Medicine; Geography","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.005758139,0.0003425853,0.0003353693,0.0006534097,0.0002152844,0.000722885,0.0007720657,0.0004209256,0.003470395],"category_scores_gemma":[0.05204383,0.0002073261,0.0004702554,0.0005749637,0.0004923693,0.0009258289,0.0009778967,0.0005538112,0.0005069847],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005640513,"about_ca_system_score_gemma":0.0008404776,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00178567,"about_ca_topic_score_gemma":0.003520522,"domain_scores_codex":[0.9944822,0.003233538,0.0003095529,0.0004962881,0.001220827,0.0002576063],"domain_scores_gemma":[0.9646577,0.0200579,0.009918059,0.001192077,0.001792742,0.002381472],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.006187081,0.001375565,0.9387487,0.0002665106,0.0003653295,0.00006589431,0.0009120668,0.0002873592,0.001092439,0.00006915352,0.0004405597,0.05018935],"study_design_scores_gemma":[0.00009452912,0.004388893,0.9937767,0.00004281719,0.00007908394,0.00009105656,0.0003565866,0.0005192239,0.0003826281,0.00001839189,0.0002429046,0.000007302077],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9986456,0.0001757558,0.0002744553,0.00006452765,0.00001100315,0.00003917896,0.0000645399,0.00001347774,0.0007114171],"genre_scores_gemma":[0.9990833,0.00008327446,0.000430557,0.00003647842,0.00002037153,0.00003574415,0.00009465337,0.000007291412,0.0002082534],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9942418,"threshold_uncertainty_score":0.03045231,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1811705204431043,"score_gpt":0.4523259360083913,"score_spread":0.271155415565287,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}