{"id":"W2142472956","doi":"10.1109/icde.2011.5767833","title":"A unified model for data and constraint repair","year":2011,"lang":"en","type":"article","venue":"","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":92,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Data integrity; Scalability; Constraint (computer-aided design); Data quality; Data modeling; Set (abstract data type); Data mining; Semantics (computer science); Data model (GIS); Quality (philosophy); Database; Artificial intelligence; Programming language; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01308172,0.002390673,0.00244276,0.004994878,0.001725661,0.009336548,0.01171502,0.005117954,0.007535364],"category_scores_gemma":[0.04369455,0.002236137,0.004387802,0.006565975,0.003914019,0.01823133,0.007267796,0.006072501,0.002071046],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005452423,"about_ca_system_score_gemma":0.00564893,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0134382,"about_ca_topic_score_gemma":0.01033866,"domain_scores_codex":[0.9826741,0.00493931,0.001848039,0.003078356,0.006314751,0.001145442],"domain_scores_gemma":[0.9714351,0.01316885,0.002815148,0.006775633,0.004795854,0.001009297],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001254688,0.0001033239,0.001417064,0.000304826,0.0001363308,0.0003429592,0.0003955859,0.4265677,0.000999367,0.5071208,0.004821696,0.05766482],"study_design_scores_gemma":[0.00003481761,0.00007396519,0.0002142042,0.00007374649,0.00006176058,0.0002541374,0.00009794003,0.7615389,0.0008056622,0.2212603,0.01554053,0.00004410257],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.00239478,0.000315953,0.9931103,0.0007314035,0.00006460467,0.0001705782,0.0004049662,0.0005285983,0.002278788],"genre_scores_gemma":[0.1071028,0.0008861164,0.881694,0.0004163772,0.0002050735,0.0009505178,0.001643669,0.0005491223,0.006552404],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.0134382,"threshold_uncertainty_score":0.06918353,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.7150539177874393,"score_gpt":0.4688035771737507,"score_spread":0.2462503406136887,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}