{"id":"W2918726316","doi":"10.1097/jpa.0000000000000234","title":"Effect of Applicant Gender on Multiple Mini-Interview Admissions Score","year":2019,"lang":"en","type":"article","venue":"The Journal of Physician Assistant Education","topic":"Medical Education and Admissions","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"Reliability (semiconductor); Cronbach's alpha; Medicine; Replication (statistics); Family medicine; Psychology; Clinical psychology; Medical education; Psychometrics","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0007832971,0.0001308983,0.0003704398,0.000110079,0.00005475452,0.000006967025,0.0001767304,0.00004546306,0.001356168],"category_scores_gemma":[0.0008571613,0.00006792717,0.0002032989,0.000234038,0.00004274108,0.00004765096,0.00001586406,0.0003146078,0.00006331476],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00008443998,"about_ca_system_score_gemma":0.001672777,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000004377564,"about_ca_topic_score_gemma":2.479886e-7,"domain_scores_codex":[0.9986131,0.0002448156,0.0004574522,0.00009994617,0.0004518483,0.0001328506],"domain_scores_gemma":[0.9977711,0.000552856,0.0005662924,0.0003595435,0.0002088304,0.0005413864],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"not_applicable","study_design_scores_codex":[0.002740276,0.006399691,0.009914356,0.002214818,0.000509912,0.000003498481,0.007619252,0.0000140166,0.3741422,0.001359612,0.2492609,0.3458215],"study_design_scores_gemma":[0.007902613,0.01076541,0.2002319,0.01511353,0.002449301,0.0002515613,0.01210569,0.0005473703,0.3650998,0.0008044931,0.384064,0.0006642946],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9830881,0.0004876412,0.00005647664,0.009591153,0.000855699,0.0004993341,0.000005270842,0.000006846969,0.005409522],"genre_scores_gemma":[0.9927319,0.0000712479,0.00008657056,0.005146408,0.0004320516,0.000005813409,0.000006503198,0.00001605969,0.001503501],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3451572,"threshold_uncertainty_score":0.9995567,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02742041331110815,"score_gpt":0.3443068840006898,"score_spread":0.3168864706895816,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}