{"id":"W3203942361","doi":"10.1016/j.ejrad.2021.109992","title":"Diagnostic performance of US for suspected appendicitis: Does multi-categorical reporting provide better estimates of disease in adults, and what factors are associated with false or indeterminate results?","year":2021,"lang":"en","type":"article","venue":"European Journal of Radiology","topic":"Appendicitis Diagnosis and Management","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":false,"ca_institutions":"Queen Elizabeth II Health Sciences Centre; Dalhousie University","funders":"","keywords":"Medicine; Indeterminate; Appendicitis; False positive paradox; False Negative Reactions; Logistic regression; Appendix; Radiology; Surgery; Internal medicine; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01705794,0.0005126636,0.0009721401,0.002221759,0.0003944887,0.002929993,0.001116348,0.001424651,0.001212161],"category_scores_gemma":[0.1235405,0.0003677385,0.001278801,0.002237638,0.0009785454,0.00372507,0.001210328,0.001093289,0.0003893558],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006357457,"about_ca_system_score_gemma":0.0007220948,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002938294,"about_ca_topic_score_gemma":0.002789991,"domain_scores_codex":[0.9873876,0.006220391,0.002666071,0.001119082,0.001967567,0.0006393315],"domain_scores_gemma":[0.8920338,0.05555239,0.03458866,0.006648372,0.009188514,0.001988254],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0001526004,0.00001725793,0.9938548,0.00005666735,0.0001280156,0.00002532996,0.0001294656,0.0000976974,0.0000673879,0.00006360487,0.0001711699,0.005235965],"study_design_scores_gemma":[0.00001915427,0.0002936175,0.9928545,0.0002284298,0.0002780161,0.0006495114,0.0008515354,0.003194508,0.0003060307,0.0005371729,0.0007502935,0.00003728036],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9819371,0.008340606,0.002362503,0.003635916,0.0001872078,0.00002188642,0.0009450952,0.00004413944,0.002525639],"genre_scores_gemma":[0.9980757,0.0005261618,0.0007574754,0.0001740613,0.0001138193,0.000005351132,0.0002919444,0.000006419436,0.00004906947],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01705794,"threshold_uncertainty_score":0.09021211,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02369486844994675,"score_gpt":0.2694970753285191,"score_spread":0.2458022068785724,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}