{"id":"W2137775416","doi":"","title":"Improving data quality: consistency and accuracy","year":2007,"lang":"en","type":"article","venue":"Edinburgh Research Explorer (University of Edinburgh)","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":312,"is_retracted":false,"has_abstract":true,"ca_institutions":"Bell (Canada)","funders":"Biotechnology and Biological Sciences Research Council; Engineering and Physical Sciences Research Council; Vlaamse regering; Fonds Wetenschappelijk Onderzoek","keywords":"Consistency (knowledge bases); Computer science; Data consistency; Data integrity; Consistency model; Sequential consistency; Set (abstract data type); Weak consistency; Heuristic; Data mining; Data quality; Quality (philosophy); Strong consistency; Database; Artificial intelligence; Mathematics; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04891176,0.001532357,0.002691221,0.005492634,0.001606552,0.007751905,0.005287916,0.003562145,0.001972381],"category_scores_gemma":[0.2322024,0.001448355,0.002211625,0.006271655,0.004316272,0.0158673,0.008229802,0.00482338,0.0009836822],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003399534,"about_ca_system_score_gemma":0.005891264,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003624345,"about_ca_topic_score_gemma":0.002180394,"domain_scores_codex":[0.9162613,0.02680226,0.01061055,0.009167768,0.03502026,0.002137908],"domain_scores_gemma":[0.6989079,0.1566437,0.0247631,0.0810882,0.03687283,0.001724293],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0007255845,0.0004051362,0.03727433,0.001973718,0.0006025268,0.0002225886,0.001699684,0.1513306,0.01331611,0.1520782,0.009778841,0.6305927],"study_design_scores_gemma":[0.0003517264,0.0008725201,0.01576488,0.00117606,0.0005437243,0.001434186,0.001025337,0.5851222,0.05880725,0.2882375,0.04629621,0.0003685038],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01453555,0.001730567,0.9776284,0.002433601,0.0001110783,0.0001906823,0.0003622282,0.001208145,0.001799665],"genre_scores_gemma":[0.2591739,0.001104502,0.736182,0.0007396912,0.0003041215,0.0003606941,0.0007764734,0.0004795018,0.0008790679],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04891176,"threshold_uncertainty_score":0.2586733,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5859534533824458,"score_gpt":0.5006272625830552,"score_spread":0.08532619079939052,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}