{"id":"W2956873218","doi":"10.1016/s1470-2045(19)30338-9","title":"The fragility of phase 3 trials supporting FDA-approved anticancer medicines: a retrospective analysis","year":2019,"lang":"en","type":"article","venue":"The Lancet Oncology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":73,"is_retracted":false,"has_abstract":false,"ca_institutions":"University of Toronto; Princess Margaret Cancer Centre; Thunder Bay Regional Health Sciences Centre; NOSM University","funders":"","keywords":"Medicine; Fragility; Statistical significance; Confidence interval; Clinical trial; Randomized controlled trial; Sample size determination; Internal medicine; Statistics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.107296,0.0006321059,0.001805659,0.004767422,0.0009803254,0.003078504,0.001644081,0.001472936,0.00570929],"category_scores_gemma":[0.3097383,0.001112603,0.005465191,0.006642088,0.002395323,0.003309895,0.002764787,0.002763848,0.0007843385],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001469845,"about_ca_system_score_gemma":0.001630871,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001246634,"about_ca_topic_score_gemma":0.001588119,"domain_scores_codex":[0.8911353,0.06370024,0.02031686,0.01023969,0.01207605,0.002531755],"domain_scores_gemma":[0.4082428,0.4059206,0.133041,0.04170053,0.007937046,0.003158071],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.01051554,0.00007640935,0.9113696,0.001324951,0.01744201,0.0004994799,0.0006849715,0.004420295,0.0004551692,0.006283551,0.005115406,0.04181271],"study_design_scores_gemma":[0.001107246,0.003414081,0.8776,0.002212197,0.03037707,0.006239103,0.001307364,0.01693561,0.001760499,0.02581453,0.03292809,0.0003042097],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8475879,0.07468209,0.04635255,0.005077421,0.0003391196,0.0009818579,0.01658481,0.0002336999,0.008160618],"genre_scores_gemma":[0.9916165,0.001685646,0.002656804,0.0006405361,0.0001393646,0.000200274,0.002650988,0.00007670338,0.0003330586],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.892704,"threshold_uncertainty_score":0.5674425,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5921369313792776,"score_gpt":0.6538412243340906,"score_spread":0.06170429295481306,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}