{"id":"W3121451510","doi":"10.1200/op.20.00810","title":"Readiness of Healthcare Systems to Generate Real-World Evidence: Reliability of CT Radiographic End Points for Evaluation of First-Line Systemic Treatment","year":2021,"lang":"en","type":"article","venue":"JCO Oncology Practice","topic":"Radiomics and Machine Learning in Medical Imaging","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Reliability (semiconductor); Health care; Healthcare system; Baseline (sea); Radiography; Resource (disambiguation); Clinical Practice","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3644539,0.0006008664,0.001803126,0.008609083,0.0008504575,0.009545774,0.002855556,0.002457454,0.002040647],"category_scores_gemma":[0.7118715,0.0008012238,0.002232139,0.006298795,0.002857742,0.005135689,0.004729289,0.002370333,0.000730123],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004517682,"about_ca_system_score_gemma":0.008034727,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003566127,"about_ca_topic_score_gemma":0.002597757,"domain_scores_codex":[0.5445787,0.3125052,0.07655996,0.01518669,0.04832695,0.002842541],"domain_scores_gemma":[0.1069724,0.598068,0.1779169,0.0505143,0.06333414,0.003194341],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001153441,0.0001304047,0.8916614,0.001581582,0.002420667,0.00007756498,0.0009014077,0.004282173,0.0003660957,0.001796201,0.003754346,0.09187474],"study_design_scores_gemma":[0.0005417115,0.002734629,0.9084443,0.004922728,0.002025083,0.001066033,0.001759874,0.04690048,0.003413075,0.007867175,0.02008698,0.000237946],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7966503,0.04862405,0.06868993,0.04190003,0.0008875526,0.002657047,0.009634017,0.0009035493,0.03005348],"genre_scores_gemma":[0.9832326,0.001101963,0.01245965,0.001465733,0.000197034,0.0003318495,0.001059353,0.00003492205,0.0001168022],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3644539,"threshold_uncertainty_score":0.7837415,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.08495731440286869,"score_gpt":0.4554308684702615,"score_spread":0.3704735540673929,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}