{"id":"W3037389001","doi":"10.1007/s00330-020-07030-1","title":"Using decision curve analysis to benchmark performance of a magnetic resonance imaging–based deep learning model for prostate cancer risk assessment","year":2020,"lang":"en","type":"article","venue":"European Radiology","topic":"Prostate Cancer Diagnosis and Treatment","field":"Medicine","cited_by":34,"is_retracted":false,"has_abstract":false,"ca_institutions":"Sunnybrook Health Science Centre; Sinai Health System; Lunenfeld-Tanenbaum Research Institute; University of Toronto; University Health Network","funders":"Ontario Institute for Cancer Research; Deutsche Forschungsgemeinschaft","keywords":"Medicine; Prostate cancer; Biopsy; Calibration; Cohort; Prostate; Magnetic resonance imaging; Cancer; Prostate biopsy; Receiver operating characteristic; Radiology; Internal medicine; Statistics; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003695274,0.0001943914,0.0005211314,0.0001566368,0.000106795,0.00001212548,0.0001111578,0.00002312115,0.00005414714],"category_scores_gemma":[0.0001420058,0.0001653543,0.0001721487,0.0004714049,0.0000618757,0.0000478465,0.00005842001,0.0001695538,0.000003845268],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001781153,"about_ca_system_score_gemma":0.0001308335,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00004198091,"about_ca_topic_score_gemma":0.00001252297,"domain_scores_codex":[0.9984242,0.0001867393,0.0004118798,0.0005050856,0.0001537394,0.0003183498],"domain_scores_gemma":[0.9990308,0.0001398321,0.0002094358,0.0002346545,0.0001889125,0.0001963484],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006724803,0.00005221776,0.5748123,0.00004559227,0.0001069157,0.00002090773,0.0005135103,0.3354196,0.0007741676,0.000003857494,0.000132404,0.08744604],"study_design_scores_gemma":[0.001578575,0.001079323,0.2930953,0.0000728382,0.000719915,0.000002643614,0.00001962957,0.701831,0.000189017,0.000004113531,0.001296123,0.0001115858],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9133726,0.007198762,0.07756018,0.0006534363,0.00005927685,0.0008020941,0.000132655,0.00003440273,0.0001865432],"genre_scores_gemma":[0.950104,0.001081754,0.04760284,0.0009088998,0.00007284154,0.00008868116,0.00006808409,0.00003997923,0.00003292066],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3664114,"threshold_uncertainty_score":0.6742951,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.0271658459594484,"score_gpt":0.3142697538508242,"score_spread":0.2871039078913759,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}