{"id":"W4389382524","doi":"10.1016/j.hansur.2023.09.230","title":"ChatGPT est-il en mesure de passer la première partie de l’examen du diplôme de l’European Board of Hand Surgery ?","year":2023,"lang":"fr","type":"article","venue":"Hand surgery & rehabilitation","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":false,"ca_institutions":"Western University","funders":"","keywords":"Humanities; Philosophy; Political science; Art","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.01065467,0.0003336227,0.0007522636,0.0004905314,0.0003767727,0.0001395476,0.0001235619,0.0004143943,0.0002600906],"category_scores_gemma":[0.01546062,0.0003539461,0.0004420093,0.0009414346,0.0006847782,0.0003457909,0.00004718438,0.0004268969,0.0002403025],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005946065,"about_ca_system_score_gemma":0.002338764,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002635422,"about_ca_topic_score_gemma":0.0003377132,"domain_scores_codex":[0.9931606,0.003313016,0.001387044,0.0005347689,0.000474812,0.00112976],"domain_scores_gemma":[0.9728435,0.02526471,0.000380751,0.0005140767,0.0005057625,0.0004911606],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002811708,0.0003636296,0.7457842,0.002304314,0.00009082361,0.00007973862,0.04774787,0.0003455809,0.004702476,0.0004873014,0.0330716,0.1647413],"study_design_scores_gemma":[0.0001403649,0.0004761056,0.8695108,0.004152812,0.0003134008,0.00007598132,0.01925428,0.003953259,0.02212279,0.005980089,0.07347655,0.0005435163],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9757399,0.002638469,0.0005389733,0.01755743,0.002098997,0.0005356604,0.00003798032,0.0001142917,0.0007382972],"genre_scores_gemma":[0.9936205,0.002189195,0.0003170699,0.0002495797,0.001748524,0.0001457806,0.0001738389,0.00009339475,0.001462184],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1641978,"threshold_uncertainty_score":0.9998913,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05150628800329156,"score_gpt":0.3448291808800701,"score_spread":0.2933228928767786,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}