{"id":"W2949999477","doi":"10.48550/arxiv.1312.7373","title":"Extending Contexts with Ontologies for Multidimensional Data Quality Assessment","year":2013,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Datalog; Context (archaeology); Quality (philosophy); Data quality; Quality assessment; Database; Information retrieval; Data mining; Data science; Evaluation methods; Engineering","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01348126,0.001192382,0.001114618,0.005888807,0.001926918,0.006938352,0.002181792,0.002015235,0.001422783],"category_scores_gemma":[0.035261,0.000995634,0.00299691,0.006136466,0.00438554,0.01627576,0.01078654,0.003379362,0.0003400346],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0017987,"about_ca_system_score_gemma":0.002238215,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004901418,"about_ca_topic_score_gemma":0.004273044,"domain_scores_codex":[0.9793158,0.008998891,0.002904719,0.002913388,0.00501597,0.0008513117],"domain_scores_gemma":[0.9727025,0.01256294,0.002662595,0.007448656,0.003669153,0.0009542048],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0000942144,0.0001111238,0.006578539,0.0006309837,0.0002144732,0.0007751856,0.004174026,0.02157168,0.004220378,0.8494015,0.002457721,0.1097702],"study_design_scores_gemma":[0.00003479578,0.00007291092,0.001830141,0.0005330049,0.0002318284,0.0007016474,0.001576386,0.09023719,0.005689369,0.8333983,0.06554849,0.0001459907],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.009931116,0.001106874,0.9841982,0.00113559,0.00007985745,0.0001450671,0.0002239399,0.0004488199,0.00273055],"genre_scores_gemma":[0.2057762,0.001444121,0.790548,0.0004330727,0.000147246,0.000268194,0.0003928262,0.0001615137,0.0008288873],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01348126,"threshold_uncertainty_score":0.07129657,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.6427823544612737,"score_gpt":0.3972805547871189,"score_spread":0.2455017996741548,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}