{"id":"W4393128858","doi":"10.1016/j.soard.2024.03.011","title":"Harnessing artificial intelligence in bariatric surgery: comparative analysis of ChatGPT-4, Bing, and Bard in generating clinician-level bariatric surgery recommendations","year":2024,"lang":"en","type":"review","venue":"Surgery for Obesity and Related Diseases","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":67,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto; McMaster University","funders":"","keywords":"Readability; Medicine; Likert scale; Surgery; Psychology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02265737,0.0006669677,0.001119491,0.002630126,0.0006057985,0.002698109,0.001224895,0.001107603,0.002185379],"category_scores_gemma":[0.1933346,0.0004412315,0.001223068,0.001576389,0.0009851214,0.002549639,0.002587015,0.00150123,0.0005967029],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001720511,"about_ca_system_score_gemma":0.00174995,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003638423,"about_ca_topic_score_gemma":0.006519891,"domain_scores_codex":[0.9777343,0.01514915,0.002393716,0.0009779835,0.003260708,0.0004841409],"domain_scores_gemma":[0.7005346,0.2715942,0.0102512,0.003830975,0.008652819,0.005136149],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.01848397,0.005497777,0.2311287,0.009810199,0.001507449,0.0008734829,0.04948884,0.007062117,0.00435448,0.0008024487,0.006172867,0.6648177],"study_design_scores_gemma":[0.003098001,0.03444099,0.827165,0.004712675,0.002676334,0.001583033,0.04051232,0.05558097,0.006412521,0.003724737,0.01934611,0.0007472273],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"review","genre_scores_codex":[0.9886811,0.001195553,0.002625806,0.0006380656,0.00008189748,0.001013212,0.0003267727,0.00037538,0.005062157],"genre_scores_gemma":[0.9711047,0.001953868,0.02116876,0.0006142622,0.000100869,0.001910224,0.0009815036,0.0001634229,0.002002347],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.02265737,"threshold_uncertainty_score":0.119825,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3174517299173116,"score_gpt":0.4613307091438424,"score_spread":0.1438789792265309,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}