{"id":"W4400902594","doi":"10.1177/22925503241264832","title":"Can ChatGPT Fool the Match? Artificial Intelligence Personal Statements for Plastic Surgery Residency Applications: A Comparative Study","year":2024,"lang":"en","type":"article","venue":"Plastic Surgery","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; University of Waterloo; McMaster University","funders":"","keywords":"Medical education; Psychology; Computer science; Medicine","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001287768,0.0002757419,0.0005300284,0.0004015716,0.0004122947,0.0001554552,0.0001168108,0.00008858267,0.0002897609],"category_scores_gemma":[0.00456982,0.0002078158,0.000219663,0.0008310674,0.0001649026,0.0001592133,0.00003171365,0.0003147028,0.0003088215],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002366432,"about_ca_system_score_gemma":0.00154863,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004935423,"about_ca_topic_score_gemma":0.0006584516,"domain_scores_codex":[0.9971025,0.0001508128,0.001108063,0.0005827154,0.0005155886,0.0005403203],"domain_scores_gemma":[0.9308041,0.06820612,0.0001607332,0.0002989215,0.0003274972,0.000202596],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"qualitative","study_design_scores_codex":[0.005295893,0.00694476,0.2290625,0.006264447,0.002492092,0.0003504313,0.1351728,0.0006172984,0.0007630946,0.01107593,0.08795533,0.5140054],"study_design_scores_gemma":[0.0002716557,0.003905975,0.1332528,0.009609273,0.004525766,0.0004761999,0.5041718,0.1935569,0.02082072,0.08811792,0.03656952,0.004721498],"study_design_candidate":"qualitative","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9270011,0.001142127,0.05448245,0.004146364,0.01024486,0.002607907,0.0001275268,0.0002140324,0.00003369552],"genre_scores_gemma":[0.995487,0.00009610463,0.00006520997,0.0001154297,0.001434147,0.002553774,0.0001341957,0.00003954383,0.0000746448],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.5092839,"threshold_uncertainty_score":0.8474482,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3315282582548428,"score_gpt":0.469120368664547,"score_spread":0.1375921104097042,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}