{"id":"W3132836732","doi":"10.1002/cam4.3732","title":"Does biomarker use in oncology improve clinical trial failure risk? A large‐scale analysis","year":2021,"lang":"en","type":"article","venue":"Cancer Medicine","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University; Cancer Care Ontario; St. Michael's Hospital; Public Health Ontario; University of Toronto","funders":"","keywords":"Medicine; Oncology; Clinical trial; Biomarker; Internal medicine; Hazard ratio; Breast cancer; Lung cancer; Cancer; Confidence interval","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2840393,0.001216865,0.003260561,0.00183101,0.0006746002,0.003831981,0.001966721,0.002157078,0.004729754],"category_scores_gemma":[0.4217473,0.0007189476,0.009788186,0.003412739,0.00310545,0.005326612,0.002949137,0.002437385,0.0006343056],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001350148,"about_ca_system_score_gemma":0.001798912,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008314379,"about_ca_topic_score_gemma":0.0009442793,"domain_scores_codex":[0.735597,0.2278651,0.01252355,0.01232904,0.009983101,0.001702308],"domain_scores_gemma":[0.3194056,0.5061654,0.09942115,0.06443887,0.008261617,0.002307343],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.02098445,0.000548174,0.7196304,0.004067307,0.1140867,0.0002295401,0.0005383136,0.01710845,0.000618904,0.0044,0.005183194,0.1126046],"study_design_scores_gemma":[0.004202967,0.01585598,0.7356184,0.002891393,0.09787952,0.0008181927,0.0005019819,0.08405584,0.002456002,0.0328692,0.02251871,0.0003318606],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.718047,0.101176,0.154098,0.008373254,0.0009502406,0.002878534,0.004881608,0.0007517394,0.008843834],"genre_scores_gemma":[0.9918112,0.001190677,0.004827127,0.0006390682,0.0002017431,0.0004726623,0.0005531809,0.0000576729,0.0002467486],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.7159607,"threshold_uncertainty_score":0.882907,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5516949384392401,"score_gpt":0.6380658190628812,"score_spread":0.08637088062364107,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}