{"id":"W3111503343","doi":"10.1038/s41746-021-00507-3","title":"Overcoming barriers to data sharing with medical image generation: a comprehensive evaluation","year":2021,"lang":"en","type":"preprint","venue":"npj Digital Medicine","topic":"AI in cancer detection","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"ca_institutions":"Canadian Institute for Advanced Research","funders":"GlaxoSmithKline","keywords":"Overfitting; Synthetic data; Computer science; Benchmark (surveying); Medical imaging; Artificial intelligence; Image synthesis; Generative model; Machine learning; Aggregate (composite); Data mining; Image (mathematics); Pattern recognition (psychology); Data science; Generative grammar; Artificial neural network","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0009745936,0.000374587,0.000523007,0.0002180778,0.0001540207,0.0008195219,0.002985206,0.0002287246,0.0004069384],"category_scores_gemma":[0.002849027,0.0003194575,0.00004301897,0.0005415936,0.0001559867,0.001575859,0.006413485,0.0007251471,0.00001736368],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004797474,"about_ca_system_score_gemma":0.001605334,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001427641,"about_ca_topic_score_gemma":0.000152372,"domain_scores_codex":[0.9943208,0.00008881567,0.0005504138,0.001891773,0.002804857,0.000343332],"domain_scores_gemma":[0.9949042,0.0001785745,0.0002395287,0.003179067,0.0007867898,0.0007118529],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001208139,0.0001178819,0.001104948,0.000568333,0.0007366937,0.0009175874,0.01046317,0.007474625,0.003336382,0.0008721277,0.05136495,0.9229225],"study_design_scores_gemma":[0.001237606,0.0002997212,0.000587619,0.002475723,0.0001012931,0.000226549,0.0005049418,0.988213,0.0005454804,0.0004954643,0.00473346,0.0005791559],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04862032,0.0006114906,0.9304413,0.01089961,0.003200271,0.0009455317,0.00003523755,0.0002553319,0.004990942],"genre_scores_gemma":[0.9670559,0.00004774244,0.02633349,0.002761668,0.002545006,0.0001558624,0.0009887598,0.00004969018,0.0000618442],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9807383,"threshold_uncertainty_score":0.9999257,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1138878189995588,"score_gpt":0.3576403586010562,"score_spread":0.2437525396014974,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}