{"id":"W3215892644","doi":"10.37796/2211-8039.1302","title":"Comparison of Multiple Imputation Algorithms and Verification Using Whole-Genome Sequencing in the CMUH Genetic Biobank","year":2021,"lang":"en","type":"article","venue":"Biomedicine","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":53,"is_retracted":false,"has_abstract":true,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"China Medical University Hospital; National Applied Research Laboratories; Division of Materials Research; China Medical University; Taiwan Biobank","keywords":"Imputation (statistics); Biobank; Genome-wide association study; Data mining; Computer science; Single-nucleotide polymorphism; Genetic association; Missing data; Machine learning; Bioinformatics; Genetics; Biology","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03640832,0.0007798561,0.001765527,0.002221942,0.0008414804,0.00174937,0.001763306,0.001156098,0.002186969],"category_scores_gemma":[0.06236742,0.0005493812,0.001893854,0.00361006,0.0003775769,0.002299029,0.001155573,0.001016127,0.0008240714],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007198866,"about_ca_system_score_gemma":0.00201947,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00626399,"about_ca_topic_score_gemma":0.004113063,"domain_scores_codex":[0.9851238,0.009394581,0.001570912,0.001977938,0.00153049,0.0004021889],"domain_scores_gemma":[0.9662302,0.02171984,0.001718612,0.0052396,0.004750681,0.0003410577],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01070515,0.0009723051,0.2717652,0.001099654,0.005111384,0.0007461355,0.0007759784,0.1752312,0.006163654,0.007503649,0.02812281,0.4918028],"study_design_scores_gemma":[0.001125463,0.0006531724,0.07326131,0.000198977,0.001170084,0.0009036493,0.0003746953,0.8970941,0.008899124,0.006418154,0.00972461,0.0001767596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.6729715,0.003736417,0.3056651,0.00146454,0.0004461905,0.0004231434,0.005850667,0.006460642,0.00298179],"genre_scores_gemma":[0.6844703,0.0009839953,0.2958194,0.0004046881,0.00008853961,0.0005696745,0.01616063,0.0005701033,0.0009326055],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.03640832,"threshold_uncertainty_score":0.1925479,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04955184285685363,"score_gpt":0.3377828751287228,"score_spread":0.2882310322718692,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}