{"id":"W3037389001","doi":"10.1007/s00330-020-07030-1","title":"Using decision curve analysis to benchmark performance of a magnetic resonance imaging–based deep learning model for prostate cancer risk assessment","year":2020,"lang":"en","type":"article","venue":"European Radiology","topic":"Prostate Cancer Diagnosis and Treatment","field":"Medicine","cited_by":34,"is_retracted":false,"has_abstract":false,"ca_institutions":"Sunnybrook Health Science Centre; Sinai Health System; Lunenfeld-Tanenbaum Research Institute; University of Toronto; University Health Network","funders":"Ontario Institute for Cancer Research; Deutsche Forschungsgemeinschaft","keywords":"Medicine; Prostate cancer; Biopsy; Calibration; Cohort; Prostate; Magnetic resonance imaging; Cancer; Prostate biopsy; Receiver operating characteristic; Radiology; Internal medicine; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01356307,0.001632368,0.001546282,0.002658561,0.0004661441,0.00244074,0.001320257,0.002772257,0.001978237],"category_scores_gemma":[0.0431745,0.0003541798,0.001585299,0.001213232,0.0007121837,0.001697513,0.001600791,0.00271653,0.0008253279],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001761341,"about_ca_system_score_gemma":0.00205756,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01059337,"about_ca_topic_score_gemma":0.005430159,"domain_scores_codex":[0.9954075,0.002375666,0.0003468625,0.0007718678,0.0008162063,0.0002818967],"domain_scores_gemma":[0.9640492,0.02914481,0.00138709,0.001391386,0.003127191,0.0009004115],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003708308,0.0009195835,0.03927375,0.0003172093,0.0009943951,0.0001838529,0.000113136,0.7849929,0.001738441,0.002351371,0.006627461,0.1587796],"study_design_scores_gemma":[0.00008086523,0.000499676,0.003029404,0.00003671759,0.00007320468,0.00009734182,0.00003195503,0.9914461,0.001468389,0.002460077,0.0007436869,0.00003253932],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7422614,0.005606036,0.2358616,0.002952985,0.0004603852,0.0003915609,0.003802375,0.00271841,0.005945298],"genre_scores_gemma":[0.96261,0.0004643232,0.03247101,0.0004020406,0.00008643446,0.0001091608,0.00211173,0.0001983615,0.001547023],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01356307,"threshold_uncertainty_score":0.0717293,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0271658459594484,"score_gpt":0.3142697538508242,"score_spread":0.2871039078913759,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}