{"id":"W2947771303","doi":"10.1016/j.drudis.2019.05.018","title":"Unbiased data analytic strategies to improve biomarker discovery in precision medicine","year":2019,"lang":"en","type":"review","venue":"Drug Discovery Today","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":32,"is_retracted":false,"has_abstract":false,"ca_institutions":"Canada Research Chairs; University of Toronto; University of New Brunswick; Toronto General Hospital","funders":"Diabetes Canada","keywords":"Overfitting; Biomarker discovery; Precision medicine; Computer science; Data science; Analytics; Preprocessor; Data pre-processing; Biomarker; Data mining; Machine learning; Artificial intelligence; Medicine; Proteomics; Biology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01007933,0.00160838,0.003617959,0.004533299,0.000306829,0.002412999,0.001801271,0.001904734,0.003128305],"category_scores_gemma":[0.02439113,0.0005824458,0.00164806,0.004763311,0.002003801,0.002690625,0.001544134,0.004661774,0.001230615],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001743355,"about_ca_system_score_gemma":0.003420842,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001668255,"about_ca_topic_score_gemma":0.001895287,"domain_scores_codex":[0.9964787,0.001899683,0.0003616114,0.0003011318,0.0008731426,0.0000857733],"domain_scores_gemma":[0.9802822,0.0170294,0.0007892295,0.00056333,0.001208077,0.0001277636],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000101654,0.00005369932,0.0002816787,0.03025482,0.000770696,0.00006690398,0.00005963522,0.002921367,0.0004419909,0.06189561,0.0144337,0.8887182],"study_design_scores_gemma":[0.000214285,0.0003376509,0.002252175,0.03438441,0.002351891,0.0009440941,0.0001327789,0.00861461,0.002384528,0.3073153,0.6408836,0.0001847853],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.00008887651,0.9874526,0.01045534,0.001101684,0.000246428,0.00001487552,0.00004673478,0.0000336496,0.0005599009],"genre_scores_gemma":[0.002995264,0.9846673,0.01029347,0.0009181534,0.0007129692,0.00005262276,0.00008032052,0.00001507296,0.0002649858],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9899207,"threshold_uncertainty_score":0.05330527,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6483316119005409,"score_gpt":0.6010919350572403,"score_spread":0.04723967684330055,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}