{"id":"W4379522373","doi":"10.21428/594757db.2728303d","title":"An Empirical Study on Vagueness Detection in Privacy Policy Texts","year":2023,"lang":"en","type":"article","venue":"","topic":"Privacy, Security, and Data Protection","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Vagueness; Computer science; CLARITY; Transparency (behavior); Transformer; Privacy policy; Information privacy; Entropy (arrow of time); Data mining; Fuzzy logic; Artificial intelligence; Internet privacy; Computer security","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"codex-gemma-dda1882f352a","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001198975,0.0000935691,0.0001136852,0.0004443591,0.0004385471,0.000113987,0.0004264358,0.0001068923,0.00004925484],"category_scores_gemma":[0.000995124,0.00008744054,0.00002738734,0.00185111,0.00005603651,0.0004658447,0.0001379453,0.0001725388,0.0003271894],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002133076,"about_ca_system_score_gemma":0.0001442562,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.02659797,"about_ca_topic_score_gemma":0.03511241,"domain_scores_codex":[0.9982562,0.0005135338,0.0001714335,0.0003322558,0.000393811,0.0003327708],"domain_scores_gemma":[0.999348,0.00008197979,0.00003480198,0.0003801933,0.00003568339,0.0001193045],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002948357,0.004136413,0.5312118,0.0000240772,0.00003023913,0.00006927043,0.1688333,0.00007494279,0.002700926,0.005914521,0.002631344,0.2840783],"study_design_scores_gemma":[0.0006088449,0.000528725,0.9561909,0.000006537772,0.000004097605,5.127609e-7,0.0170515,0.0003225215,0.0008780662,0.01562904,0.008572746,0.0002064452],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9907312,0.000002723595,0.0002650458,0.002333947,0.0002737706,0.0005999542,0.000002798736,0.0004432311,0.005347374],"genre_scores_gemma":[0.9989679,0.00001536212,0.00001513383,0.0001820958,0.0005124675,0.0000642281,0.000005821712,0.000009617977,0.000227412],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.4249792,"threshold_uncertainty_score":0.9824943,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06997199548349217,"score_gpt":0.4179091949909002,"score_spread":0.347937199507408,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}