{"id":"W2783291455","doi":"10.1109/bigdata.2017.8258218","title":"Identifying and mitigating risks to the quality of open data in the post-truth era","year":2017,"lang":"en","type":"article","venue":"","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Open data; Big data; Data science; Transparency (behavior); Data quality; Computer science; Analytics; Quality (philosophy); Ground truth; Open government; Data analysis; Computer security; Data mining; World Wide Web; Business","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.1467902,0.0009062859,0.001559971,0.005441254,0.006759963,0.01817388,0.004250077,0.008763831,0.003791551],"category_scores_gemma":[0.5344652,0.001286261,0.001339016,0.008744119,0.02109199,0.03449035,0.01588495,0.01383466,0.0007214356],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006574345,"about_ca_system_score_gemma":0.01391231,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005518219,"about_ca_topic_score_gemma":0.004673965,"domain_scores_codex":[0.8409704,0.08817682,0.01000037,0.009739111,0.04706139,0.00405194],"domain_scores_gemma":[0.2560848,0.5051143,0.09705818,0.08241899,0.05385942,0.005464363],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000462433,0.0002848092,0.0745687,0.001313033,0.0002664811,0.001127464,0.01365971,0.01171142,0.001441693,0.7166216,0.01932835,0.1592144],"study_design_scores_gemma":[0.00006938997,0.0002299306,0.01275953,0.002946459,0.0001741973,0.0009805079,0.009468155,0.01922762,0.004195378,0.8661589,0.08360276,0.0001871156],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1002379,0.008441051,0.5460907,0.3001537,0.001592163,0.001116825,0.001134375,0.0005965985,0.04063662],"genre_scores_gemma":[0.8214017,0.005031728,0.1505731,0.01582249,0.001745347,0.0008638483,0.0007350416,0.0002913983,0.003535352],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.99575,"threshold_uncertainty_score":0.7763098,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7811195203369069,"score_gpt":0.6219168215022497,"score_spread":0.1592026988346572,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}