{"id":"W4225853051","doi":"10.5281/zenodo.6368376","title":"DP-VAE: Human-Readable Text Anonymization for Online Reviews with Differentially Private Variational Autoencoders","year":2022,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Artificial intelligence; Private information retrieval; Data science; Information retrieval; Computer security","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002539261,0.0008451065,0.000990935,0.0004873027,0.000507342,0.001187016,0.001390124,0.001616683,0.001513773],"category_scores_gemma":[0.009899558,0.0005358809,0.0008833054,0.0004548405,0.001309405,0.001959221,0.002097062,0.002244392,0.001135212],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008971355,"about_ca_system_score_gemma":0.001126246,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002985793,"about_ca_topic_score_gemma":0.003736318,"domain_scores_codex":[0.997999,0.000976536,0.00008878061,0.0004155375,0.0003924457,0.0001276954],"domain_scores_gemma":[0.9968419,0.001668725,0.0002717315,0.0007484824,0.0003796704,0.00008950368],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000686283,0.0001865479,0.001572996,0.0002305271,0.0002303397,0.0003261091,0.0005669795,0.5875479,0.02899375,0.03811742,0.007431115,0.3341101],"study_design_scores_gemma":[0.00001061682,0.00003360109,0.0001363754,0.000007702718,0.000007902832,0.00004014339,0.00001667566,0.9833225,0.005252519,0.00980731,0.001354961,0.00000981507],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.008721227,0.0002019565,0.9891111,0.0002557375,0.0000512626,0.00004666952,0.00012013,0.001007131,0.0004846919],"genre_scores_gemma":[0.4862112,0.000488697,0.4995037,0.0006335154,0.0002412012,0.0003429447,0.001259119,0.0005276315,0.01079199],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002985793,"threshold_uncertainty_score":0.01342905,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06481148837151597,"score_gpt":0.2794793357719953,"score_spread":0.2146678474004793,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}