{"id":"W2025146961","doi":"10.1177/1460458207086333","title":"A method to map heterogeneity between near but non-equivalent semantic attributes in multiple health data registries","year":2008,"lang":"en","type":"article","venue":"Health Informatics Journal","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":14,"is_retracted":false,"has_abstract":true,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Ontology; Metadata; Web Ontology Language; Information retrieval; Semantics (computer science); Semantic integration; Context (archaeology); Semantic heterogeneity; XML; Semantic Web; RDF; OWL-S; Data mapping; Ontology-based data integration; World Wide Web; Database; Semantic Web Stack; Geography; Programming language","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01784582,0.0007828537,0.001071072,0.007306581,0.001945643,0.007124541,0.002280782,0.001663284,0.003033689],"category_scores_gemma":[0.04183552,0.001269655,0.002070483,0.009374886,0.001538747,0.008164739,0.007229906,0.001980736,0.0007273337],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001650204,"about_ca_system_score_gemma":0.00361931,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00565389,"about_ca_topic_score_gemma":0.006091719,"domain_scores_codex":[0.989513,0.003655096,0.0012866,0.001929432,0.003322409,0.000293529],"domain_scores_gemma":[0.9713928,0.01531412,0.003057356,0.007263068,0.002373025,0.0005997034],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004614721,0.0002357989,0.01572886,0.0005768791,0.0005206659,0.001639061,0.00705427,0.02175124,0.01356522,0.2585725,0.00866822,0.6712258],"study_design_scores_gemma":[0.0003637458,0.0002763327,0.01008084,0.0005330319,0.0007435301,0.004331013,0.004519455,0.4390587,0.03155688,0.35081,0.1572345,0.0004920462],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004079585,0.00004652221,0.9924069,0.0002644137,0.0000153077,0.0001775557,0.0002628645,0.002003172,0.0007436494],"genre_scores_gemma":[0.0505856,0.00005694405,0.9477385,0.00005542277,0.0000188383,0.0002203915,0.000518658,0.0001865625,0.0006189981],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01784582,"threshold_uncertainty_score":0.09437889,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.5805209750176058,"score_gpt":0.517028038760856,"score_spread":0.06349293625674979,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}