{"id":"W3203875161","doi":"10.1186/s12859-021-04398-9","title":"On the robustness of generalization of drug–drug interaction models","year":2021,"lang":"en","type":"article","venue":"BMC Bioinformatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":15,"is_retracted":false,"has_abstract":true,"ca_institutions":"Mila - Quebec Artificial Intelligence Institute; Université Laval","funders":"Mitacs; Compute Canada; Nvidia","keywords":"Computer science; Machine learning; Robustness (evolution); Generalizability theory; Artificial intelligence; Benchmarking; Multi-task learning; Generalization; Task (project management); Data mining","routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false,"invisible_to_affiliation_only":false},"retraction":null,"screen":null,"direct_labels":[],"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02920324,0.002683793,0.001827707,0.00213216,0.0008955004,0.001908632,0.002621157,0.002824333,0.001635728],"category_scores_gemma":[0.09312745,0.001014545,0.002415997,0.0009505176,0.002957318,0.00299153,0.004201789,0.004534874,0.0004956937],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002549081,"about_ca_system_score_gemma":0.00172474,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01365427,"about_ca_topic_score_gemma":0.005920685,"domain_scores_codex":[0.9937333,0.003763527,0.0004230083,0.001096458,0.0006303238,0.0003533285],"domain_scores_gemma":[0.9041899,0.07801457,0.005234302,0.008601779,0.002857118,0.001102343],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002635912,0.00007789542,0.006380033,0.0001067567,0.0002518042,0.000075189,0.00007333226,0.9748293,0.0005318431,0.003709737,0.0009983982,0.01270211],"study_design_scores_gemma":[0.00002192906,0.0001123766,0.001243159,0.00004835437,0.00003726109,0.00003436567,0.00001548628,0.9869779,0.0003872155,0.01086047,0.0002466862,0.00001499717],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4708148,0.007697962,0.4988818,0.008907474,0.0004369149,0.0003681657,0.001727232,0.00246928,0.008696409],"genre_scores_gemma":[0.9735517,0.0009836085,0.02179171,0.0007945535,0.0001860738,0.0001367724,0.001289763,0.0001903474,0.001075539],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.02920324,"threshold_uncertainty_score":0.1544433,"prediction_status":"machine_predicted_unvalidated"},"machine_scores":{"provisional":true,"baseline":true,"maturity_gate_passed":false,"score_opus":0.04704167203536014,"score_gpt":0.2900567858064442,"score_spread":0.243015113771084,"validation_status":"score_only:v0-immature-baseline","note":"Baseline scores from an immature model (maturity gate not passed). Scores rank; they never assert a category."}}