{"id":"W4399971973","doi":"10.29012/jpc.880","title":"Differentially Private Fine-tuning of Language Models","year":2024,"lang":"en","type":"article","venue":"Journal of Privacy and Confidentiality","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":36,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Private speech; Base (topology); Artificial intelligence; Private information retrieval; Language model; Machine learning; Scale (ratio); Natural language processing; Data mining; Computer security; Mathematics","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003819344,0.001411228,0.001862926,0.0006194188,0.0009271296,0.002346819,0.003184013,0.002633324,0.006902302],"category_scores_gemma":[0.02177026,0.0008717834,0.001872804,0.0007985111,0.001965715,0.005237199,0.004981459,0.005073881,0.00275073],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002314057,"about_ca_system_score_gemma":0.00284613,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002962336,"about_ca_topic_score_gemma":0.005069341,"domain_scores_codex":[0.9961134,0.001491537,0.0001947706,0.0009683001,0.0008403195,0.0003915728],"domain_scores_gemma":[0.9916127,0.003892905,0.000396939,0.003461248,0.0004002056,0.0002359986],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008016003,0.0004362022,0.002721702,0.0002463103,0.0001847045,0.0003449867,0.0003750859,0.5854947,0.01752885,0.06571866,0.02132568,0.3048215],"study_design_scores_gemma":[0.00008635741,0.00004976813,0.0001593162,0.00001338877,0.00001795749,0.0001101199,0.00002758564,0.9412459,0.003774157,0.05235399,0.00214153,0.00002002331],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02473382,0.0005438801,0.9601018,0.001324852,0.0001686622,0.000167642,0.0003742892,0.007924383,0.004660733],"genre_scores_gemma":[0.6763328,0.0003345659,0.3112431,0.001503397,0.0002206702,0.0004251068,0.001162023,0.001263157,0.007515195],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006902302,"threshold_uncertainty_score":0.02309054,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.03058623113808286,"score_gpt":0.2914109549588623,"score_spread":0.2608247238207794,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}