{"id":"W4407571608","doi":"10.1002/aet2.70000","title":"The standardized letter of evaluation (SLOE) in emergency medicine: The internal validity of the SLOE 2.0","year":2025,"lang":"en","type":"article","venue":"AEM Education and Training","topic":"Diversity and Career in Medicine","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"McMaster University","funders":"","keywords":"Spearman's rank correlation coefficient; Rank correlation; Descriptive statistics; Ranking (information retrieval); Correlation; Medicine; Statistics; Psychology; Family medicine; Mathematics; Computer science; Artificial intelligence","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03563355,0.0005207724,0.000704589,0.003625277,0.0007982769,0.002058564,0.0009076984,0.0007916564,0.001983441],"category_scores_gemma":[0.1087253,0.000315118,0.001084037,0.002703451,0.001627664,0.001646315,0.002973547,0.0009298198,0.0006513526],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001224739,"about_ca_system_score_gemma":0.002283616,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001457119,"about_ca_topic_score_gemma":0.001821527,"domain_scores_codex":[0.965533,0.01630283,0.004938594,0.001792754,0.01048127,0.0009515201],"domain_scores_gemma":[0.8573551,0.072473,0.03558249,0.006893102,0.02471551,0.002980837],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002171982,0.0001628944,0.9704632,0.00009513404,0.00008850393,0.00003563137,0.0007660663,0.0003090172,0.0002573324,0.0003828151,0.001299262,0.02592288],"study_design_scores_gemma":[0.0000405799,0.0005051245,0.9899102,0.000226209,0.00003807376,0.0002206124,0.001419471,0.002227403,0.0008813813,0.0005598155,0.003937408,0.00003374597],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9825167,0.0004708669,0.004175849,0.0007073613,0.0001933352,0.0005633265,0.0009568019,0.00009196851,0.01032375],"genre_scores_gemma":[0.9919897,0.0001785734,0.005384285,0.0002993924,0.00006964955,0.0005792844,0.0008730303,0.00004420706,0.0005819347],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9643664,"threshold_uncertainty_score":0.1884505,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.07781072017688558,"score_gpt":0.4044468225739495,"score_spread":0.3266361023970639,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}