{"id":"W4388020749","doi":"10.1101/2023.10.26.564274","title":"A multitask neural network trained on embeddings from ESMFold can accurately rank order clinical outcomes for different cystic fibrosis mutations","year":2023,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Cystic Fibrosis Research Advances","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"ca_institutions":"Hospital for Sick Children","funders":"","keywords":"Cystic fibrosis; Phenotype; Computational biology; Protein structure prediction; Mutation; Artificial neural network; Biology; Computer science; Artificial intelligence; Gene; Machine learning; Bioinformatics; Protein structure; Genetics","routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001403064,0.001101695,0.0005075173,0.0006105455,0.000291317,0.0005453273,0.0006015813,0.0009553782,0.001749301],"category_scores_gemma":[0.004202665,0.000221082,0.000646596,0.0003616721,0.0002921553,0.0007056503,0.0007083848,0.001227875,0.0009214156],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000647964,"about_ca_system_score_gemma":0.0008054298,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005510821,"about_ca_topic_score_gemma":0.008178981,"domain_scores_codex":[0.9997556,0.00006597005,0.00001489025,0.00008526524,0.00003293267,0.00004545987],"domain_scores_gemma":[0.9989064,0.0006052369,0.00008466974,0.0001096813,0.0002015661,0.00009246269],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001195489,0.0007733709,0.05030538,0.0001479291,0.0003059491,0.0002967632,0.0001235572,0.531522,0.00859813,0.001711318,0.01407879,0.3909413],"study_design_scores_gemma":[0.00001566903,0.00007745794,0.002079395,0.000009789122,0.00001367326,0.00002242914,0.00001502654,0.9945381,0.0009219624,0.002068775,0.0002282995,0.000009390801],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7341456,0.001163974,0.2490927,0.002432673,0.0005748325,0.0001514245,0.002912693,0.004485405,0.005040647],"genre_scores_gemma":[0.9669361,0.0001414204,0.02635547,0.0002686868,0.00007354468,0.00007483283,0.002857516,0.00008299496,0.003209421],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005510821,"threshold_uncertainty_score":0.01095748,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.06481301918721036,"score_gpt":0.3523675253959631,"score_spread":0.2875545062087528,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}