{"id":"W1987500677","doi":"10.2196/ijmr.2140","title":"An Approach to Reducing Information Loss and Achieving Diversity of Sensitive Attributes in k-anonymity Methods","year":2012,"lang":"en","type":"article","venue":"Interactive Journal of Medical Research","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"ca_institutions":"","funders":"","keywords":"k-anonymity; Computer science; Information loss; Information sensitivity; Mutual information; Entropy (arrow of time); Generalization; Private information retrieval; Data mining; Diversity (politics); Identifier; Conditional entropy; Anonymity; Row; Machine learning; Information retrieval; Artificial intelligence; Computer security; Mathematics; Database; Principle of maximum entropy","routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false,"invisible_to_affiliation_only":true},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":["metaresearch","open_science"],"consensus_categories":["open_science"],"category_scores_codex":[0.02398971,0.00008934325,0.0002918122,0.0008996818,0.0001194639,0.00008569453,0.008047884,0.0001471062,0.000007238341],"category_scores_gemma":[0.1641032,0.00007254905,0.00003919196,0.0008481867,0.0002487061,0.00468193,0.0460896,0.001658857,0.000002259312],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002737145,"about_ca_system_score_gemma":0.0001779733,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0002543938,"about_ca_topic_score_gemma":0.000002989982,"domain_scores_codex":[0.9954507,0.001626132,0.0004841783,0.0001599694,0.001864699,0.0004142653],"domain_scores_gemma":[0.9932037,0.003946025,0.0002999214,0.001196255,0.0009049148,0.0004492017],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0006046107,0.001181631,0.07639989,0.0001780283,0.0001711952,0.00009854439,0.02636061,0.00004645212,0.006382674,0.00299542,0.0102174,0.8753635],"study_design_scores_gemma":[0.002528461,0.001796753,0.6038457,0.002407249,0.00002585011,0.0012907,0.01750994,0.2300428,0.1100504,0.02854082,0.00135891,0.0006024054],"study_design_candidate":"design_other","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.463487,0.00005688562,0.5290053,0.007011594,0.0001214505,0.0000916936,0.000003606365,0.000009983881,0.0002124233],"genre_scores_gemma":[0.7263383,0.00005467665,0.2735123,0.00004714416,0.00004297219,0.000001169087,7.855236e-7,0.000002084905,5.299059e-7],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8747612,"threshold_uncertainty_score":0.997319,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.1305208629525585,"score_gpt":0.4657120208107823,"score_spread":0.3351911578582237,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}