{"id":"W3120180752","doi":"10.1016/j.jmb.2021.166810","title":"ELASPIC2 (EL2): Combining Contextualized Language Models and Graph Neural Networks to Predict Effects of Mutations","year":2021,"lang":"en","type":"article","venue":"Journal of Molecular Biology","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":44,"is_retracted":false,"has_abstract":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Computer science; Machine learning; Artificial intelligence; Leverage (statistics); Artificial neural network; Language model; Web server; The Internet","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007846521,0.001657283,0.0006806423,0.0007626786,0.0003107323,0.0006746793,0.001425997,0.001027675,0.003141323],"category_scores_gemma":[0.001990506,0.000417252,0.0009709718,0.0004168285,0.0003121578,0.001019377,0.001072021,0.001479299,0.001148462],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008202787,"about_ca_system_score_gemma":0.001214726,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01342186,"about_ca_topic_score_gemma":0.02858048,"domain_scores_codex":[0.9997078,0.00008064538,0.00001281773,0.0000923048,0.0000666147,0.00003982748],"domain_scores_gemma":[0.9994395,0.0002879509,0.00004250984,0.00007207491,0.0001056994,0.00005219036],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005712087,0.0004015561,0.006761738,0.0002813239,0.0004030333,0.0004845641,0.00007372801,0.7285357,0.0109343,0.008339803,0.04319164,0.2000214],"study_design_scores_gemma":[0.0000172354,0.00002385527,0.000161166,0.000003671252,0.00001037904,0.00001973376,0.000003678209,0.99461,0.001522116,0.002660606,0.0009594212,0.000008203262],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1461284,0.001348942,0.7739823,0.001325476,0.000404624,0.0002816143,0.01040911,0.05994256,0.006177036],"genre_scores_gemma":[0.5277147,0.0006461148,0.435944,0.001039221,0.0001606418,0.0004768507,0.02141938,0.003317167,0.009281999],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01342186,"threshold_uncertainty_score":0.0266875,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.004099539784084971,"score_gpt":0.2559829125733331,"score_spread":0.2518833727892482,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}