{"id":"W2031989156","doi":"10.2481/dsj.2.25","title":"Data integration and knowledge discovery in biomedical databases. Reliable information from unreliable sources","year":2003,"lang":"en","type":"article","venue":"Data Science Journal","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":2,"is_retracted":false,"has_abstract":true,"ca_institutions":"Dalhousie University","funders":"","keywords":"Scope (computer science); Computer science; Data science; Usability; Metadata; Transparency (behavior); Open data; Reuse; Implementation; World Wide Web; Data discovery; Data publishing; Publishing; Software engineering; Political science; Engineering","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04343435,0.0009461007,0.003337821,0.0158275,0.002686394,0.01741557,0.003775336,0.003931697,0.004110878],"category_scores_gemma":[0.1114113,0.001948764,0.002696335,0.0268997,0.006749413,0.02651634,0.01253912,0.003672997,0.003175957],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002636592,"about_ca_system_score_gemma":0.006708412,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003334626,"about_ca_topic_score_gemma":0.002785309,"domain_scores_codex":[0.9604355,0.01842936,0.004587048,0.003094553,0.01279717,0.0006563522],"domain_scores_gemma":[0.9305956,0.0471747,0.004474113,0.01159568,0.00530367,0.0008560392],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002291806,0.0001108598,0.004448676,0.004272627,0.0005929797,0.0009035059,0.003104127,0.008177101,0.001313908,0.5193773,0.03352737,0.4239423],"study_design_scores_gemma":[0.00004389499,0.00004620248,0.001313227,0.001656992,0.0002440066,0.0008978816,0.0009914953,0.0338826,0.002417628,0.8319884,0.1264325,0.00008509575],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.006767988,0.0765029,0.8550107,0.0347089,0.001304398,0.000595469,0.002768955,0.001863523,0.02047709],"genre_scores_gemma":[0.1494963,0.04474839,0.7807166,0.005439686,0.002483658,0.0008797764,0.007352399,0.0005720817,0.008311111],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.04343435,"threshold_uncertainty_score":0.2297056,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.2754938637313639,"score_gpt":0.5016500590355036,"score_spread":0.2261561953041397,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}