{"id":"W2966427411","doi":"10.1016/j.urology.2019.03.045","title":"Over-reliance on P Values in Urology: Fragility of Findings in the Hydronephrosis Literature Calls for Systematic Reporting of Robustness Indicators","year":2019,"lang":"en","type":"review","venue":"Urology","topic":"Pediatric Urology and Nephrology Studies","field":"Medicine","cited_by":16,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto; Hospital for Sick Children; SickKids Foundation","funders":"","keywords":"Medicine; Hydronephrosis; Fragility; Contingency table; Exact test; Observational study; Sample size determination; Statistics; Surgery; Internal medicine; Urinary system; Mathematics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow","research_integrity"],"consensus_categories":[],"category_scores_codex":[0.004197455,0.0004966268,0.005314809,0.001135061,0.00005016169,0.000003042757,0.0004618774,0.001767324,0.000008445535],"category_scores_gemma":[0.005856776,0.0003093011,0.0005857343,0.001070776,0.000503906,0.00003420229,0.0001138629,0.001483081,0.000003439173],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00006572541,"about_ca_system_score_gemma":0.0002801885,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00001351804,"about_ca_topic_score_gemma":0.00001943918,"domain_scores_codex":[0.9939624,0.001117123,0.003417269,0.000733611,0.0002341381,0.0005354648],"domain_scores_gemma":[0.9901008,0.004986546,0.003910798,0.000875641,0.00008843087,0.00003780498],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","study_design_scores_codex":[0.003099596,0.002680445,0.06145835,0.902094,0.005115676,0.0008975408,0.006251225,0.0004066432,0.00001598041,0.001246474,0.003764447,0.01296964],"study_design_scores_gemma":[0.03400992,0.04881148,0.243503,0.2144441,0.1180699,0.006795061,0.0008858069,0.003472781,0.00005007272,0.004370593,0.3190726,0.006514689],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.09308998,0.9024299,0.00002016503,0.0004469098,0.0002887006,0.003558749,0.00006236772,0.0000153232,0.00008793703],"genre_scores_gemma":[0.1080187,0.8893357,0.00005299506,0.001330994,0.0001409353,0.0009158613,0.0001025989,0.00004711596,0.00005508198],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.6876498,"threshold_uncertainty_score":0.9999359,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.05065207996650459,"score_gpt":0.3635643142862581,"score_spread":0.3129122343197536,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}