{"id":"W4411265496","doi":"10.1101/2025.06.10.658783","title":"Concordance and dissonance: A genome-wide analysis of self-declared versus inferred ancestry in 10,250 participants from the HostSeq cohort","year":2025,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of British Columbia; Canada's Michael Smith Genome Sciences Centre","funders":"Canadian Institutes of Health Research; Government of Canada; Genome Canada","keywords":"Concordance; Cognitive dissonance; Cohort; Psychology; Medicine; Genetics; Demography; Social psychology; Biology; Internal medicine; Sociology","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004536756,0.000304953,0.0004360063,0.00120005,0.001843395,0.001230696,0.001201107,0.0006223411,0.001550027],"category_scores_gemma":[0.009335234,0.0003056081,0.00050618,0.001438478,0.001006734,0.0002632223,0.001113289,0.0005753836,0.0002023666],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001292649,"about_ca_system_score_gemma":0.001587864,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.3621825,"about_ca_topic_score_gemma":0.4941269,"domain_scores_codex":[0.9972465,0.0005229106,0.0001382594,0.001112722,0.0007107494,0.0002687893],"domain_scores_gemma":[0.996181,0.001042288,0.000634365,0.0007431905,0.001062693,0.0003363607],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0002680588,0.0000147502,0.9932614,0.0000314355,0.0003692539,0.00006447489,0.001146131,0.0002160317,0.001619516,0.0001709488,0.0004626584,0.002375315],"study_design_scores_gemma":[0.000009213364,0.00002346866,0.9972856,0.00001167111,0.00007120857,0.0001175641,0.0005476911,0.0007899533,0.0004247648,0.00008854987,0.0006135285,0.00001681758],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9969767,0.0001376098,0.0006207945,0.00003456642,0.000006664234,0.00001436048,0.001818468,0.000009535593,0.0003812572],"genre_scores_gemma":[0.9971671,0.00004524028,0.0008336033,0.00003114266,0.000004542733,0.00001869817,0.001583454,0.00001564664,0.0003007306],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.3621825,"threshold_uncertainty_score":0.7201487,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.02276938832175571,"score_gpt":0.2709234022895502,"score_spread":0.2481540139677945,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}