{"id":"W3022268149","doi":"10.2196/14064","title":"Privacy-Preserving Deep Learning for the Detection of Protected Health Information in Real-World Data: Comparative Evaluation","year":2020,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"Universitätsklinikum Jena; RWTH Aachen University","keywords":"Confidentiality; Computer science; Private information retrieval; Protocol (science); Information privacy; Artificial neural network; Machine learning; Computer security; Artificial intelligence; Data mining; Medicine","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01240122,0.001000807,0.0008973398,0.00105175,0.0004894639,0.0009967971,0.001502558,0.001823896,0.0009596243],"category_scores_gemma":[0.01721924,0.0002335949,0.0008194076,0.0006109559,0.001232408,0.002300585,0.001655469,0.001599549,0.0002684782],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001529655,"about_ca_system_score_gemma":0.001219627,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003367867,"about_ca_topic_score_gemma":0.002590595,"domain_scores_codex":[0.994276,0.002807566,0.0003564596,0.0009928781,0.001237673,0.0003294519],"domain_scores_gemma":[0.9882952,0.007680275,0.0007953648,0.001691967,0.00116749,0.0003697182],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.006226192,0.002417129,0.03646994,0.00117666,0.001638177,0.0003606173,0.0003310562,0.3666301,0.00522232,0.002472948,0.0052609,0.571794],"study_design_scores_gemma":[0.0001660359,0.001915414,0.00970077,0.0001184982,0.0003387655,0.0003114735,0.0001540593,0.9718459,0.01146939,0.002779203,0.001159873,0.0000406215],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.845481,0.008546089,0.137123,0.001588768,0.0002797188,0.0003620607,0.0006740378,0.001351192,0.004594177],"genre_scores_gemma":[0.9751748,0.0009414366,0.02202032,0.0001707611,0.00005611665,0.00006043124,0.0007843707,0.00002597272,0.000765573],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01240122,"threshold_uncertainty_score":0.06558466,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2760449451955062,"score_gpt":0.4681315358562635,"score_spread":0.1920865906607573,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}