{"id":"W2803982643","doi":"10.2196/medinform.9455","title":"Privacy-Preserving Predictive Modeling: Harmonization of Contextual Embeddings From Different Sources","year":2018,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"U.S. National Library of Medicine; National Institute of General Medical Sciences; National Center for Advancing Translational Sciences; National Institute of Biomedical Imaging and Bioengineering; National Human Genome Research Institute","keywords":"Computer science; Pooling; Embedding; Context (archaeology); Word2vec; Data sharing; Data mining; Machine learning; Harmonization; Artificial intelligence; Data science","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000359433,0.0001697266,0.0002947099,0.0001164201,0.0001368061,0.00008774626,0.001702982,0.0002006982,0.0001732651],"category_scores_gemma":[0.0009413445,0.0001349104,0.00005651046,0.0002344768,0.0001554016,0.0006296973,0.001203502,0.0004396325,0.00003094774],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00005181617,"about_ca_system_score_gemma":0.0001464334,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001420971,"about_ca_topic_score_gemma":0.00001089149,"domain_scores_codex":[0.9973682,0.00009671588,0.0008581397,0.0001672446,0.001207299,0.0003024074],"domain_scores_gemma":[0.998113,0.0002660153,0.0003675982,0.0006176365,0.0003354055,0.0003003798],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"qualitative","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001947355,0.0005993583,0.0998196,0.001471751,0.000307965,0.00001282606,0.7198845,0.005363777,0.0001571959,0.01860021,0.009597332,0.1439908],"study_design_scores_gemma":[0.000397043,0.000212797,0.001449284,0.0002619232,0.000005594575,0.000003134941,0.0009879827,0.9945928,0.0003876649,0.001201323,0.0003737079,0.0001267254],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4731866,0.00002163902,0.5251645,0.000550977,0.0001856094,0.0001686553,0.000005049239,0.0001353933,0.0005816414],"genre_scores_gemma":[0.9762796,0.00001010395,0.02271328,0.0006650506,0.0002497458,0.00002090779,0.00002480178,0.00001059357,0.00002591676],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.989229,"threshold_uncertainty_score":0.5501487,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02518940963220853,"score_gpt":0.3102796689629046,"score_spread":0.285090259330696,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}