{"id":"W4409331731","doi":"10.1080/00140139.2025.2487558","title":"Examining the development, effectiveness, and limitations of computer-aided diagnosis systems for retained surgical items detection: a systematic review","year":2025,"lang":"en","type":"review","venue":"Ergonomics","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; Surgical procedures; Medical physics; Computer-aided; Computer science; Surgery","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01359125,0.001616655,0.007515193,0.008984019,0.0006961544,0.00295205,0.001867434,0.001920112,0.003283706],"category_scores_gemma":[0.0618704,0.001138809,0.01073293,0.007814014,0.000923518,0.002282071,0.001622082,0.00118448,0.0003201563],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003599504,"about_ca_system_score_gemma":0.01173067,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008390763,"about_ca_topic_score_gemma":0.02745543,"domain_scores_codex":[0.9875045,0.0047254,0.004460394,0.0006977696,0.002350786,0.0002611258],"domain_scores_gemma":[0.9489311,0.0400104,0.00612831,0.0005796169,0.004076812,0.0002737659],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.0002723947,0.00002438343,0.001086574,0.9316922,0.01390554,0.00006221767,0.0001407903,0.0001149133,0.000130756,0.0001706688,0.0007999562,0.0515996],"study_design_scores_gemma":[0.0003272297,0.0003832118,0.005289115,0.8307884,0.147535,0.0003323647,0.0002570224,0.0001979595,0.0003766326,0.0003247798,0.01413652,0.00005182752],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.001051204,0.9978654,0.0001676743,0.000148897,0.00006362336,0.0003188424,0.0001931426,0.000005529937,0.0001857537],"genre_scores_gemma":[0.01392701,0.9842343,0.0007681927,0.0002968656,0.00005640802,0.0004396422,0.0001903742,0.000004719046,0.00008254313],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.01359125,"threshold_uncertainty_score":0.07187825,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.3098257493300611,"score_gpt":0.4193937345305216,"score_spread":0.1095679852004606,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}