{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":26,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":26,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"92f54b72ab7b","filters":{"venue":"Molecular Informatics"}},"results":[{"id":"W3009970748","doi":"10.1002/minf.202000028","title":"Rapid Identification of Potential Inhibitors of SARS‐CoV‐2 Main Protease by Deep Docking of 1.3 Billion Compounds","year":2020,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":518,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"National Institute on Deafness and Other Communication Disorders; Canadian Institutes of Health Research","keywords":"Docking (animal); Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Virtual screening; Coronavirus disease 2019 (COVID-19); Drug discovery; Protease; Coronavirus; Computational biology; Drug development; 2019-20 coronavirus outbreak; Drug; Computer science; Virology; Infectious disease (medical specialty); Medicine; Chemistry; Outbreak; Biology; Bioinformatics; Pharmacology; Disease; Biochemistry; Enzyme","authors":[{"name":"Anh‐Tien Ton","is_ca":true},{"name":"Francesco Gentile","is_ca":true},{"name":"Michael Hsing","is_ca":true},{"name":"Fuqiang Ban","is_ca":true},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01770774515941695,"gpt":0.2675397446277249,"spread":0.2498319994683079,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003356046,0.001195719,0.001147589,0.0008281029,0.000251183,0.0007078697,0.0006093061,0.000575681,0.002625751],"category_scores_gemma":[0.000641512,0.0002848151,0.001004876,0.0007184907,0.0001875959,0.0004808974,0.0006004951,0.0006331801,0.000634262],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000504485,"about_ca_system_score_gemma":0.0007118243,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003352805,"about_ca_topic_score_gemma":0.005770765,"domain_scores_codex":[0.9998055,0.00003521636,0.00001164402,0.00003499209,0.00006424765,0.00004836333],"domain_scores_gemma":[0.9999027,0.00002987967,0.00001714787,0.00001316815,0.00002031592,0.00001676026],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001254312,0.001374622,0.009200648,0.001006629,0.0006762725,0.0003565851,0.00004686452,0.6707702,0.06953453,0.002964668,0.01433073,0.2284839],"study_design_scores_gemma":[0.0002339716,0.0009384551,0.001606236,0.0000244455,0.0001297707,0.0001025617,0.00003015175,0.9652132,0.02622492,0.001322616,0.004147463,0.00002629792],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9091271,0.009852291,0.05168629,0.001050274,0.0001735601,0.0003665857,0.004223952,0.006084344,0.01743565],"genre_scores_gemma":[0.9474475,0.00279155,0.03826631,0.0005011501,0.00003001479,0.0001791059,0.005822221,0.0001181775,0.004843968],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003352805,"threshold_uncertainty_score":0.008784056,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2061937956","doi":"10.1002/minf.201200141","title":"Chemically Advanced Template Search (CATS) for Scaffold‐Hopping and Prospective Target Prediction for ‘Orphan’ Molecules","year":2013,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":164,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"Ministry of Earth Sciences; Ministry of Education, India; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung","keywords":"Drug discovery; Scaffold; Computational biology; Nanotechnology; Chemistry; Computer science; Combinatorial chemistry; Materials science; Medicine; Biology; Biomedical engineering; Biochemistry","authors":[{"name":"Michael Reutlinger","is_ca":false},{"name":"Christian P. Koch","is_ca":false},{"name":"Daniel Reker","is_ca":false},{"name":"Nickolay Todoroff","is_ca":false},{"name":"Petra Schneider","is_ca":false},{"name":"Tiago Rodrigues","is_ca":false},{"name":"Gisbert Schneider","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01078410717972747,"gpt":0.2691825093482484,"spread":0.2583984021685209,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001406677,0.0006770313,0.0008566497,0.00106242,0.000265661,0.0007530377,0.0009829033,0.0005401526,0.002016246],"category_scores_gemma":[0.002542991,0.000191464,0.0005873591,0.001040117,0.0003943289,0.0007936799,0.0008409598,0.0005057274,0.0003005814],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005067523,"about_ca_system_score_gemma":0.0008714446,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001289583,"about_ca_topic_score_gemma":0.001454482,"domain_scores_codex":[0.9991948,0.0002787754,0.00005323024,0.0001116844,0.000312401,0.00004902158],"domain_scores_gemma":[0.9991865,0.000477863,0.0001040828,0.0001005236,0.00009151305,0.00003956049],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001114426,0.0003217144,0.006161671,0.0003326871,0.0001963947,0.000149755,0.00009509543,0.6321018,0.04213591,0.01500136,0.001701013,0.3006882],"study_design_scores_gemma":[0.0000531854,0.0006410234,0.0007240046,0.000009749596,0.00003220272,0.00007100207,0.00001699079,0.9806224,0.01420142,0.00219394,0.001416219,0.0000178463],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.4515797,0.002887525,0.5334153,0.000172785,0.00006626675,0.0004879399,0.001316501,0.004130579,0.005943406],"genre_scores_gemma":[0.6798569,0.0008332473,0.3157246,0.00008238704,0.00004705244,0.0003798444,0.001832104,0.0001920445,0.001051845],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002016246,"threshold_uncertainty_score":0.007439375,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4206247747","doi":"10.1002/minf.202100264","title":"An AI‐based Prediction Model for Drug‐drug Interactions in Osteoporosis and Paget's Diseases from SMILES","year":2022,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Bone health and treatments","field":"Medicine","cited_by":89,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Ministry of Science and Technology, Taiwan","keywords":"Drug; Cheminformatics; Osteoporosis; Computer science; Medicine; Pharmacology; Chemistry; Internal medicine; Computational chemistry","authors":[{"name":"Truong Nguyen Khanh Hung","is_ca":false},{"name":"Nguyen Quoc Khanh Le","is_ca":true},{"name":"Ngoc Hoang Le","is_ca":true},{"name":"Lê Văn Tuấn","is_ca":false},{"name":"P.T.A. Nguyen","is_ca":false},{"name":"Thi Cao","is_ca":false},{"name":"Jiunn‐Horng Kang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01321261440398536,"gpt":0.2909295781902771,"spread":0.2777169637862917,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000994593,0.0009827446,0.0008998313,0.001540796,0.0003148555,0.0006318496,0.0007229997,0.0008094705,0.001304636],"category_scores_gemma":[0.002379705,0.0002448598,0.0009574363,0.0008872578,0.0002110709,0.0005080991,0.000321511,0.0008477321,0.0003622499],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007018981,"about_ca_system_score_gemma":0.001061594,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01753703,"about_ca_topic_score_gemma":0.01448168,"domain_scores_codex":[0.9996809,0.00007571099,0.00003563724,0.00008372471,0.0000723408,0.00005174586],"domain_scores_gemma":[0.9986641,0.0008814191,0.0001370642,0.00003019806,0.0002385773,0.0000486278],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004032273,0.0004712798,0.02967034,0.0001556303,0.0002312937,0.000312872,0.00005093952,0.8539329,0.001342658,0.00114307,0.004306119,0.1079797],"study_design_scores_gemma":[0.000009053476,0.00004381837,0.001305425,0.000005927683,0.00002433249,0.00002364951,0.000004656172,0.9977254,0.0001765965,0.0004283721,0.0002486273,0.000004052986],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.6325086,0.0052868,0.343979,0.002905766,0.0002974878,0.0004275155,0.006198555,0.002749202,0.005647084],"genre_scores_gemma":[0.9598682,0.0007614751,0.03320107,0.0003629434,0.0001044584,0.0002450076,0.003548343,0.00002549298,0.00188298],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.01753703,"threshold_uncertainty_score":0.03486991,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4220753843","doi":"10.1002/minf.202100240","title":"A Descriptor Set for Quantitative Structure‐property Relationship Prediction in Biologics","year":2022,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Monoclonal and Polyclonal Antibodies Research","field":"Medicine","cited_by":78,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto; University of Waterloo","funders":"","keywords":"Quantitative structure–activity relationship; In silico; Computer science; Stability (learning theory); Drug development; Artificial intelligence; Machine learning; Drug discovery; Set (abstract data type); Process (computing); Biochemical engineering; Data mining; Biological system; Computational biology; Drug; Chemistry; Bioinformatics; Biology","authors":[{"name":"Kannan Sankar","is_ca":false},{"name":"Kyle Trainor","is_ca":true},{"name":"Levi L. Blazer","is_ca":true},{"name":"Jarrett Adams","is_ca":true},{"name":"Sachdev S. Sidhu","is_ca":true},{"name":"Tyler Day","is_ca":false},{"name":"Elizabeth M. Meiering","is_ca":true},{"name":"Johannes Maier","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08329791264474877,"gpt":0.3406507462846687,"spread":0.2573528336399199,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001993167,0.001064169,0.001264677,0.002178389,0.0004800583,0.001040378,0.001015662,0.001051321,0.001949178],"category_scores_gemma":[0.005651783,0.0003143145,0.001862273,0.001782944,0.0006123949,0.0008221493,0.0008400781,0.001311797,0.0002812784],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001107282,"about_ca_system_score_gemma":0.001240102,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006789865,"about_ca_topic_score_gemma":0.004950419,"domain_scores_codex":[0.999225,0.0002789487,0.00007059105,0.0001257884,0.000243029,0.00005655093],"domain_scores_gemma":[0.9968021,0.002589924,0.0001546125,0.0001220979,0.0002786406,0.00005257674],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00007162475,0.000151652,0.002107424,0.0001783299,0.00006711244,0.00007272722,0.00002329297,0.9608302,0.001446916,0.003268093,0.00105705,0.03072554],"study_design_scores_gemma":[0.00001531219,0.00005855523,0.0003306199,0.000009275896,0.0000118342,0.00001315185,0.00001005232,0.9964259,0.0004929056,0.002205284,0.0004203848,0.00000677196],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1890776,0.001538065,0.7950374,0.000670878,0.00008787169,0.000437143,0.008209409,0.002062137,0.002879403],"genre_scores_gemma":[0.7408983,0.0005555332,0.2473907,0.0001914397,0.00005543105,0.0007411288,0.009232412,0.00009402684,0.0008410016],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006789865,"threshold_uncertainty_score":0.01350069,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4313816625","doi":"10.1002/minf.202200186","title":"A comparison between 2D and 3D descriptors in QSAR modeling based on bio‐active conformations","year":2023,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":52,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia Hospital","funders":"","keywords":"Quantitative structure–activity relationship; Cheminformatics; Random forest; Protein Data Bank (RCSB PDB); Molecular descriptor; Lasso (programming language); Computer science; Set (abstract data type); Artificial intelligence; Test set; Data mining; Pattern recognition (psychology); Machine learning; Chemistry; Computational chemistry; Stereochemistry","authors":[{"name":"Malkeet Singh Bahia","is_ca":true},{"name":"Omer Kaspi","is_ca":false},{"name":"Meir Touitou","is_ca":false},{"name":"Idan Binayev","is_ca":false},{"name":"Seema Dhail","is_ca":false},{"name":"J. Dominik Spiegel","is_ca":false},{"name":"Netaly Khazanov","is_ca":false},{"name":"Abraham Yosipof","is_ca":false},{"name":"Hanoch Senderowitz","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05288652475164202,"gpt":0.337118736541096,"spread":0.284232211789454,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003480259,0.0009034429,0.001285922,0.002451316,0.0003520932,0.001384185,0.0008375471,0.0007327533,0.001179655],"category_scores_gemma":[0.006194551,0.0003256503,0.001597325,0.002773718,0.0005212374,0.001352194,0.0008763398,0.0008517206,0.0004388849],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006818989,"about_ca_system_score_gemma":0.0008140834,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004274156,"about_ca_topic_score_gemma":0.002890326,"domain_scores_codex":[0.9981712,0.0009486988,0.0001533425,0.0001995583,0.0004366922,0.00009044595],"domain_scores_gemma":[0.9964843,0.002597417,0.0002477904,0.0003757687,0.0002440917,0.00005062053],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004393353,0.0001350822,0.006574923,0.0002758519,0.0001952296,0.00007244364,0.00005331755,0.9249422,0.002910662,0.005101214,0.0007731951,0.05852651],"study_design_scores_gemma":[0.00003931988,0.0002207239,0.002339981,0.00003518717,0.00004084112,0.00005010209,0.00002702347,0.9903165,0.00159711,0.003759568,0.0015397,0.00003401973],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.434488,0.009096988,0.5406067,0.0009829961,0.0001652394,0.0003068022,0.00510168,0.00150382,0.007747726],"genre_scores_gemma":[0.897436,0.002666413,0.09473334,0.0001666508,0.0000562229,0.0002719541,0.003928561,0.0001784557,0.0005622532],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004274156,"threshold_uncertainty_score":0.01840556,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1899644141","doi":"10.1002/minf.201400118","title":"Towards Better BBB Passage Prediction Using an Extensive and Curated Data Set","year":2015,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":50,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Linear discriminant analysis; Set (abstract data type); Test set; Computer science; Data set; Artificial intelligence; Machine learning; Regression; Linear regression; Data mining; Variance (accounting); Drug discovery; Linear model; Regression analysis; Statistics; Mathematics; Bioinformatics; Biology","authors":[{"name":"Yoan Brito‐Sánchez","is_ca":true},{"name":"Yovani Marrero‐Ponce","is_ca":false},{"name":"Stephen J. Barigye","is_ca":false},{"name":"Iván Yaber‐Goenaga","is_ca":false},{"name":"Carlos Morell","is_ca":false},{"name":"Huong Le‐Thi‐Thu","is_ca":false},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1242311728463903,"gpt":0.3528909864422495,"spread":0.2286598135958592,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001932814,0.001588716,0.001562584,0.002191075,0.0004559981,0.001673984,0.001251606,0.001393962,0.001265916],"category_scores_gemma":[0.006421445,0.0003589928,0.001657236,0.001885738,0.0005068915,0.001274628,0.001018279,0.001664039,0.0007756833],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007916277,"about_ca_system_score_gemma":0.00179875,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005324489,"about_ca_topic_score_gemma":0.005974148,"domain_scores_codex":[0.9991544,0.0002598593,0.00008372868,0.000244606,0.000202406,0.000054939],"domain_scores_gemma":[0.9965064,0.001954121,0.0003294087,0.00055156,0.0005653698,0.00009317879],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008530105,0.001480678,0.02325714,0.0025652,0.0006024166,0.001225905,0.0002426858,0.7050898,0.0803821,0.003314148,0.01091916,0.1700677],"study_design_scores_gemma":[0.00005414704,0.0006672733,0.01023284,0.0001145375,0.0002046267,0.0004492345,0.0001364091,0.9257069,0.04501997,0.003478725,0.01381164,0.0001236775],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.50233,0.0041374,0.4572844,0.001070269,0.0002092698,0.000593992,0.026302,0.004894157,0.003178488],"genre_scores_gemma":[0.6890848,0.002329833,0.2540661,0.0003126124,0.00008475394,0.0008452006,0.05112789,0.000326255,0.001822436],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005324489,"threshold_uncertainty_score":0.01058698,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2008947010","doi":"10.1002/minf.201200031","title":"Chemical Descriptors Are More Important Than Learning Algorithms for Modelling","year":2012,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":40,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"University of Waterloo; Mitacs","keywords":"Computer science; Cheminformatics; Machine learning; Artificial intelligence; Algorithm; Chemistry; Computational chemistry","authors":[{"name":"S. Stanley Young","is_ca":false},{"name":"Fei Yuan","is_ca":false},{"name":"Mu Zhu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03754151563592349,"gpt":0.2965459023265248,"spread":0.2590043866906013,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001596664,0.001020878,0.00182383,0.001253747,0.0005087296,0.002854059,0.001037885,0.001683114,0.006318276],"category_scores_gemma":[0.01258669,0.0002932478,0.0004860552,0.003586464,0.001633356,0.006329141,0.000833307,0.0022669,0.001649094],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005370222,"about_ca_system_score_gemma":0.0005747029,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001115495,"about_ca_topic_score_gemma":0.0008499589,"domain_scores_codex":[0.9986563,0.0005920174,0.00007189772,0.0002154011,0.0004134856,0.00005093461],"domain_scores_gemma":[0.9903315,0.007879294,0.0006641124,0.000648398,0.0003658057,0.0001108843],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005234667,0.0002548909,0.006482527,0.003403886,0.0003355437,0.0001692186,0.00009435776,0.1752928,0.008552531,0.2660298,0.007391356,0.5314696],"study_design_scores_gemma":[0.0001500386,0.0005177661,0.002676028,0.00035953,0.0002909586,0.0003949857,0.0001525456,0.3269888,0.01242252,0.6108592,0.04506209,0.0001255492],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06490032,0.04766675,0.8462719,0.008059924,0.001535463,0.000264597,0.001154987,0.001054587,0.0290915],"genre_scores_gemma":[0.7212615,0.0427232,0.2202421,0.00183829,0.00201801,0.0002683568,0.001529654,0.0005371429,0.009581843],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006318276,"threshold_uncertainty_score":0.0211367,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2032729355","doi":"10.1002/minf.201000018","title":"Finding Inspiration in the Protein Data Bank to Chemically Antagonize Readers of the Histone Code","year":2010,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Click Chemistry and Applications","field":"Chemistry","cited_by":22,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Canada Research Chairs; University of New Brunswick; Structural Genomics Consortium; University of Toronto","funders":"Knut och Alice Wallenbergs Stiftelse; Natural Sciences and Engineering Research Council of Canada; Karolinska Institutet; Stiftelsen för Strategisk Forskning; Canadian Institutes of Health Research; Genome Canada; Ontario Genomics; Wellcome Trust; Ontario Genomics Institute; Ontario Innovation Trust","keywords":"Protein Data Bank (RCSB PDB); Protein Data Bank; Pharmacophore; Histone; Epigenetics; Chemistry; Cheminformatics; Computational biology; Affinities; Stereochemistry; Acetylation; Drug discovery; Biology; Biochemistry; Protein structure; Bioinformatics; DNA; Gene","authors":[{"name":"Valérie Campágna‐Slater","is_ca":true},{"name":"Matthieu Schapira","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02806135310030598,"gpt":0.2972882026075814,"spread":0.2692268495072754,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005727286,0.0009497667,0.001095739,0.001102976,0.0004084068,0.000791363,0.0007057021,0.0006764902,0.01281598],"category_scores_gemma":[0.001249974,0.0003369377,0.000513799,0.002804019,0.0001879355,0.0005639733,0.0003590462,0.0006903777,0.008666652],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007557051,"about_ca_system_score_gemma":0.001753515,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002106606,"about_ca_topic_score_gemma":0.005199471,"domain_scores_codex":[0.9997646,0.00003361398,0.00002749743,0.00005320277,0.00008974232,0.00003124949],"domain_scores_gemma":[0.9997541,0.00007031881,0.00004870451,0.00004264835,0.000047749,0.00003632725],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.006163231,0.001223846,0.03830825,0.006782017,0.0006281367,0.002362407,0.0003384684,0.01172291,0.3348769,0.01300125,0.3376536,0.2469389],"study_design_scores_gemma":[0.001855735,0.001248749,0.03967021,0.0003940795,0.0007725164,0.001919489,0.0002624218,0.06488527,0.2177845,0.006281041,0.6647317,0.0001943204],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"dataset","genre_gemma":"empirical","genre_scores_codex":[0.2644494,0.0102604,0.06125705,0.003278062,0.0004272068,0.001167321,0.5830409,0.03963303,0.03648664],"genre_scores_gemma":[0.2062472,0.006679134,0.1344179,0.0007424629,0.00004027956,0.0006644081,0.6393319,0.00102289,0.0108538],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01281598,"threshold_uncertainty_score":0.04287374,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2003032055","doi":"10.1002/minf.201100053","title":"Target‐Driven Subspace Mapping Methods and Their Applicability Domain Estimation","year":2011,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Domain Adaptation and Few-Shot Learning","field":"Computer Science","cited_by":22,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada; Consejo Nacional de Investigaciones Científicas y Técnicas; Deutsche Forschungsgemeinschaft","keywords":"Subspace topology; Estimation; Computer science; Domain (mathematical analysis); Data mining; Artificial intelligence; Computational biology; Pattern recognition (psychology); Mathematics; Biology; Engineering","authors":[{"name":"Axel J. Soto","is_ca":true},{"name":"Gustavo E. Vázquez","is_ca":false},{"name":"Marc Strickert","is_ca":false},{"name":"Ignacio Ponzoni","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0257763614147911,"gpt":0.2729227023296965,"spread":0.2471463409149053,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002927895,0.0005111256,0.0006932212,0.001133831,0.0004238035,0.0007052291,0.001005098,0.0006415411,0.001004844],"category_scores_gemma":[0.009585235,0.0002960124,0.0007703673,0.0008054187,0.0009879251,0.001148343,0.001563374,0.001291011,0.0003614417],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003923564,"about_ca_system_score_gemma":0.0006895206,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001026549,"about_ca_topic_score_gemma":0.0006790681,"domain_scores_codex":[0.9987813,0.0006230157,0.00004527209,0.0001335174,0.0003728609,0.00004403738],"domain_scores_gemma":[0.9953582,0.003350549,0.0003185999,0.0004507691,0.0004311701,0.00009071951],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000126176,0.00009362215,0.002025113,0.0001566912,0.00009699402,0.00007950255,0.0002246363,0.5868394,0.007000674,0.03890313,0.001125283,0.3633287],"study_design_scores_gemma":[0.000007278068,0.00003540418,0.0004403026,0.000009909327,0.000005848628,0.0000522199,0.0000203843,0.9729002,0.00261181,0.02319011,0.0007118754,0.00001464523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.009484752,0.0001787755,0.9896917,0.00007071529,0.000006348124,0.00001965482,0.00002331609,0.0001541763,0.0003705198],"genre_scores_gemma":[0.4748245,0.0005910646,0.5222108,0.0001181147,0.0000662797,0.0003197635,0.0003083902,0.0001385261,0.001422588],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002927895,"threshold_uncertainty_score":0.01548439,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2059197104","doi":"10.1002/minf.201200020","title":"Prospective Prediction of Antitarget Activity by Matched Molecular Pairs Analysis","year":2012,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":21,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"AstraZeneca (Canada)","funders":"","keywords":"Quantitative structure–activity relationship; Computer science; Aggregate (composite); Data mining; Machine learning; Nanotechnology; Materials science","authors":[{"name":"Daniel J. Warner","is_ca":true},{"name":"M H Bridgland‐Taylor","is_ca":false},{"name":"Clare E. Sefton","is_ca":false},{"name":"David Wood","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.00911041723449239,"gpt":0.2583840696909916,"spread":0.2492736524564993,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002676756,0.001191096,0.001831647,0.003544872,0.0003390614,0.001150513,0.001138579,0.00088107,0.002850022],"category_scores_gemma":[0.00680015,0.0004537721,0.0009257213,0.002046292,0.0005292479,0.001345148,0.001042283,0.001128598,0.001220462],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000557466,"about_ca_system_score_gemma":0.00063959,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004986342,"about_ca_topic_score_gemma":0.0006006804,"domain_scores_codex":[0.9984567,0.0005310619,0.0001127186,0.0003223647,0.0005022362,0.00007486314],"domain_scores_gemma":[0.996704,0.00210732,0.0005164979,0.0002710493,0.0002655796,0.0001355789],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004065321,0.001208631,0.08874217,0.0006960774,0.0005476365,0.0005010071,0.00006294347,0.4629349,0.06395177,0.007228596,0.005308895,0.364752],"study_design_scores_gemma":[0.0001308559,0.001040493,0.006373829,0.00001190269,0.0001109454,0.0002085485,0.0000125633,0.963218,0.02337719,0.003979724,0.001507285,0.00002865469],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6049681,0.003475844,0.376753,0.000460422,0.00005505613,0.0005481563,0.006159664,0.003007439,0.004572258],"genre_scores_gemma":[0.9173644,0.0005000766,0.0762223,0.0001039113,0.00005150857,0.0001934762,0.004871112,0.00006930799,0.0006239195],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003544872,"threshold_uncertainty_score":0.01415622,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2919214297","doi":"10.1002/minf.201800160","title":"Application of an Iterative Fragment Selection (IFS) Method to Estimate Entropies of Fusion and Melting Points of Organic Chemicals","year":2019,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":17,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto; ASL Environmental Sciences (Canada); ARC Resources (Canada); The Scarborough Hospital; Greenfield Research (Canada)","funders":"European Chemical Industry Council","keywords":"Selection (genetic algorithm); Mean squared error; Computer science; Biological system; Mathematics; Artificial intelligence; Biology; Statistics","authors":[{"name":"Trevor N. Brown","is_ca":true},{"name":"James M. Armitage","is_ca":true},{"name":"Jon A. Arnot","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005338842299840955,"gpt":0.3057756650376185,"spread":0.3004368227377776,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001679019,0.0005700078,0.0006459013,0.001028458,0.0002401018,0.0002910375,0.0006137333,0.0003536846,0.0007722821],"category_scores_gemma":[0.003411792,0.0002538883,0.0007422532,0.0005082365,0.0003188252,0.0003658794,0.0003560822,0.0004221709,0.00017807],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005036797,"about_ca_system_score_gemma":0.0005404918,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003732809,"about_ca_topic_score_gemma":0.002413061,"domain_scores_codex":[0.9994734,0.0001783971,0.00002094446,0.00007512757,0.0002259704,0.00002613346],"domain_scores_gemma":[0.9981116,0.001245153,0.0002239143,0.00008690949,0.0003006339,0.00003169323],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004977827,0.0001738709,0.01696231,0.0002499139,0.0002374429,0.000124565,0.0001016064,0.7384084,0.07696311,0.001533562,0.0008860654,0.1638613],"study_design_scores_gemma":[0.00001278002,0.0001391831,0.00265624,0.000004218313,0.00001745552,0.00003438994,0.000005882493,0.9799129,0.01683459,0.000185255,0.0001831995,0.00001384178],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3846502,0.0005720682,0.6104683,0.0001067843,0.00002429637,0.000146489,0.0005496645,0.001621513,0.001860617],"genre_scores_gemma":[0.8810824,0.0001252275,0.117694,0.00002699197,0.00001157887,0.0001023841,0.0004470461,0.00006685415,0.0004435676],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003732809,"threshold_uncertainty_score":0.008879602,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2015042232","doi":"10.1002/minf.200900019","title":"How to Deal with Batch Effect in Sequential Microarray Experiments?","year":2010,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":13,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; Public Health Ontario; University of Toronto; Mount Sinai Hospital","funders":"National Cancer Institute; Canadian Prostate Cancer Research Initiative; Institute for Prostate Cancer Research","keywords":"Computer science; Computational biology; Microarray analysis techniques; Data mining; Chemistry; Biology; Gene; Gene expression; Biochemistry","authors":[{"name":"Nino Demetrashvili","is_ca":true},{"name":"Ken J. Kron","is_ca":true},{"name":"Vaijayanti Pethe","is_ca":true},{"name":"Bharati Bapat","is_ca":true},{"name":"Laurent Briollais","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005950242800431988,"gpt":0.2494548033599986,"spread":0.2435045605595666,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0264518,0.002920044,0.004716701,0.001168017,0.001394487,0.002254691,0.004223462,0.003168861,0.003774151],"category_scores_gemma":[0.0504002,0.002669143,0.00261316,0.002506999,0.002135372,0.005276299,0.002272238,0.005612495,0.002534732],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001793666,"about_ca_system_score_gemma":0.003798991,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003632138,"about_ca_topic_score_gemma":0.00818015,"domain_scores_codex":[0.98814,0.004826264,0.0008021305,0.002644351,0.003026511,0.0005606985],"domain_scores_gemma":[0.9555019,0.02701237,0.002071249,0.01100455,0.003602793,0.0008071343],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002392957,0.0007233977,0.01247525,0.00156159,0.001694501,0.0006020758,0.0006853009,0.07587544,0.16375,0.02046683,0.02580178,0.6939709],"study_design_scores_gemma":[0.0003998034,0.0006685478,0.01270531,0.0001180916,0.0009851569,0.001167609,0.0002212835,0.7078483,0.1521578,0.09560769,0.02771123,0.0004091313],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005559368,0.000509897,0.988295,0.0007277981,0.0004564088,0.0001065699,0.0001380617,0.003892752,0.0003140833],"genre_scores_gemma":[0.05937986,0.0006177028,0.9323297,0.001220006,0.0006648583,0.000706787,0.0005356469,0.001364845,0.003180688],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9735482,"threshold_uncertainty_score":0.1398922,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2981596486","doi":"10.1002/minf.201900096","title":"An <i>in silico</i> Approach for Integrating Phenotypic and Target‐based Approaches in Drug Discovery","year":2019,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Innovation Cluster (Canada)","funders":"Core Research for Evolutional Science and Technology; Japan Society for the Promotion of Science; New Energy and Industrial Technology Development Organization","keywords":"In silico; Drug discovery; Computational biology; Phenotypic screening; Computer science; Deconvolution; Phenotype; Cheminformatics; Drug target; Systems biology; Bioinformatics; Biology; Genetics; Algorithm; Pharmacology; Gene","authors":[{"name":"Hiroaki Iwata","is_ca":true},{"name":"Ryosuke Kojima","is_ca":false},{"name":"Yasushi Okuno","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01839675626069718,"gpt":0.2593566582448479,"spread":0.2409599019841507,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001769484,0.0009268271,0.0009417327,0.001090014,0.0006164124,0.001222569,0.001764739,0.0009785406,0.002489208],"category_scores_gemma":[0.002937079,0.0008647919,0.001566833,0.0007187966,0.001091846,0.001428725,0.001533293,0.001550189,0.000758653],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008033116,"about_ca_system_score_gemma":0.001119551,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001337262,"about_ca_topic_score_gemma":0.001637258,"domain_scores_codex":[0.9990901,0.0004955383,0.0000411976,0.000110649,0.0002250584,0.00003738899],"domain_scores_gemma":[0.9986254,0.0007866666,0.0001617368,0.0002528666,0.0001129053,0.00006039353],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001644502,0.0004882033,0.003932805,0.0005142841,0.0004855187,0.0003997178,0.0001501232,0.6178663,0.09677148,0.1761457,0.003240613,0.0998408],"study_design_scores_gemma":[0.00002049076,0.0001140701,0.0003359301,0.00001625848,0.00005496853,0.0002022111,0.00001313262,0.9600536,0.0123447,0.02196109,0.004856613,0.0000269888],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.002136046,0.00005931156,0.9954991,0.0001384699,0.00002915409,0.0000482012,0.00004905906,0.000382871,0.00165785],"genre_scores_gemma":[0.1208247,0.0004972503,0.875558,0.0003514304,0.00007546369,0.0003207815,0.0002335297,0.0002353232,0.001903581],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002489208,"threshold_uncertainty_score":0.009358048,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4376636211","doi":"10.1002/minf.202300026","title":"Novel Inhibitors of androgen receptor's DNA binding domain identified using an ultra‐large virtual screening","year":2023,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Prostate Cancer Treatment and Research","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"DOD Prostate Cancer Research Program; Canadian Cancer Society Research Institute; U.S. Department of Defense","keywords":"Androgen receptor; Virtual screening; Computational biology; Chemistry; Domain (mathematical analysis); DNA; Computer science; Biology; Genetics; Drug discovery; Biochemistry; Prostate cancer; Mathematics","authors":[{"name":"Mariia Radaeva","is_ca":true},{"name":"Hélène Morin","is_ca":true},{"name":"Mohit Pandey","is_ca":true},{"name":"Fuqiang Ban","is_ca":true},{"name":"Maria Guo","is_ca":true},{"name":"Eric Leblanc","is_ca":true},{"name":"Nada Lallous","is_ca":true},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04133740417371557,"gpt":0.3232444522595325,"spread":0.281907048085817,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003036735,0.0009350562,0.0009399358,0.0007310824,0.0002681252,0.0005904369,0.0005974523,0.000275186,0.002165982],"category_scores_gemma":[0.0003319444,0.0001927348,0.0007728239,0.0006033335,0.0002304342,0.0002867808,0.0004970197,0.0004943275,0.0003125652],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004303917,"about_ca_system_score_gemma":0.0006842649,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009762532,"about_ca_topic_score_gemma":0.002616199,"domain_scores_codex":[0.9998635,0.00003443763,0.000006293703,0.00003033284,0.00003863583,0.00002677155],"domain_scores_gemma":[0.9999298,0.00002672429,0.00001407391,0.000005799422,0.00001049652,0.00001314402],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00303452,0.002563093,0.007452467,0.002634009,0.001169259,0.002186431,0.0001301048,0.4479742,0.2878382,0.01069807,0.01157381,0.2227458],"study_design_scores_gemma":[0.002876233,0.01190687,0.008742691,0.0002365583,0.002384958,0.001927492,0.0002432235,0.7383724,0.1679313,0.006625677,0.05850232,0.0002502039],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9258202,0.01161816,0.03710226,0.0008320815,0.0001899582,0.0008191222,0.003764701,0.001565224,0.01828831],"genre_scores_gemma":[0.9610837,0.005670655,0.02537368,0.0004541987,0.00002991437,0.0003933953,0.003190125,0.00005880187,0.003745673],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002165982,"threshold_uncertainty_score":0.007245898,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1983545523","doi":"10.1002/minf.201100085","title":"Identification of Novel Inhibitors of UDP‐Galactopyranose Mutase by Structure‐Based Virtual Screening","year":2011,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Carbohydrate Chemistry and Synthesis","field":"Chemistry","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Alberta; University of Saskatchewan","funders":"University of Saskatchewan","keywords":"Mutase; In silico; Escherichia coli; Virtual screening; Enzyme; Docking (animal); Biochemistry; Klebsiella pneumoniae; Dehydratase; Chemistry; Mycobacterium tuberculosis; Biology; Klebsiella pneumonia; Stereochemistry; Drug discovery; Tuberculosis","authors":[{"name":"Sarathy Karunan Partha","is_ca":true},{"name":"Ali Sadeghi‐Khomami","is_ca":false},{"name":"Sylvaine Cren","is_ca":false},{"name":"Richard I. Robinson","is_ca":false},{"name":"Simon Woodward","is_ca":false},{"name":"Kate Slowski","is_ca":true},{"name":"Lindsey Berast","is_ca":true},{"name":"Blake Zheng","is_ca":true},{"name":"Neil R. Thomas","is_ca":true},{"name":"D.A.R. Sanders","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.013410427002871,"gpt":0.2119475518740633,"spread":0.1985371248711922,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004337791,0.001357541,0.001848022,0.001148516,0.0003544348,0.001067812,0.0008847058,0.0005621575,0.002593102],"category_scores_gemma":[0.0004942684,0.0004748022,0.0008189518,0.0008378976,0.0002809321,0.0003181912,0.0004380255,0.0008207443,0.0005290709],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007978083,"about_ca_system_score_gemma":0.0006669034,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001046978,"about_ca_topic_score_gemma":0.00274963,"domain_scores_codex":[0.9997709,0.0000500426,0.00001416375,0.00004262586,0.00006616827,0.00005606944],"domain_scores_gemma":[0.9998373,0.00005108792,0.00003581085,0.000009734654,0.00002783414,0.00003818456],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.005563589,0.005021658,0.008451571,0.001975129,0.001212559,0.002304821,0.0002274846,0.1386532,0.6179698,0.002444645,0.006301589,0.209874],"study_design_scores_gemma":[0.01141545,0.03203524,0.0188822,0.0003929778,0.003419077,0.005738964,0.0003246797,0.2570609,0.6152945,0.002247451,0.052828,0.0003606742],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9482867,0.01785818,0.01656603,0.0007752192,0.0001463757,0.001319559,0.003635474,0.001342035,0.01007051],"genre_scores_gemma":[0.9643947,0.0109907,0.01424273,0.0003445563,0.00005070935,0.0004867858,0.005527681,0.00006815176,0.003894006],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002593102,"threshold_uncertainty_score":0.0086748,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1990193701","doi":"10.1002/minf.201400017","title":"Systematic Identification of Matching Molecular Series and Mapping of Screening Hits","year":2014,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Emergent BioSolutions (Canada)","funders":"","keywords":"Computer science; Series (stratigraphy); Matching (statistics); Identification (biology); Computational biology; Data mining; Information retrieval; Biology; Mathematics","authors":[{"name":"Antonio de la Vega de León","is_ca":true},{"name":"Ye Hu","is_ca":true},{"name":"Jürgen Bajorath","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.009911711928669237,"gpt":0.2481507745470005,"spread":0.2382390626183312,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001538743,0.001070751,0.001859557,0.007480542,0.0004672819,0.001108785,0.001414946,0.0005003473,0.004595159],"category_scores_gemma":[0.007642369,0.0005034555,0.001388492,0.007024539,0.0003296863,0.001303757,0.001333677,0.0005783743,0.001632067],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006062248,"about_ca_system_score_gemma":0.001295602,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007461925,"about_ca_topic_score_gemma":0.001377315,"domain_scores_codex":[0.9981668,0.0003661833,0.0002911194,0.0005128765,0.0005505641,0.0001123938],"domain_scores_gemma":[0.9971954,0.001224156,0.0004912436,0.0005229366,0.0004627084,0.0001036429],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002326168,0.0009409596,0.05027186,0.005737795,0.0007763014,0.001828318,0.0003047562,0.05588477,0.2490386,0.01235625,0.01789976,0.6026345],"study_design_scores_gemma":[0.0008899065,0.004724605,0.06503473,0.0004186621,0.002501691,0.004423584,0.0006374147,0.4222645,0.3760169,0.02351694,0.09931763,0.0002533508],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.6845781,0.008532493,0.1965849,0.0004751412,0.0001964356,0.002770487,0.07668968,0.01238278,0.01778998],"genre_scores_gemma":[0.5657536,0.002808473,0.3136434,0.0002485695,0.00008606274,0.001618438,0.1125519,0.00063667,0.002652916],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.007480542,"threshold_uncertainty_score":0.01537234,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2799656935","doi":"10.1002/minf.201800043","title":"Cheminformatics Driven Development of Novel Therapies for Drug Resistant Prostate Cancer","year":2018,"lang":"en","type":"review","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia; Prevention of Organ Failure","funders":"Canadian Institutes of Health Research; Genome British Columbia; Prostate Cancer Canada","keywords":"Cheminformatics; Androgen receptor; Prostate cancer; Antiandrogens; Drug resistance; Computational biology; Drug development; Regulator; Drug; Chemistry; Pharmacology; Cancer; Cancer research; Bioinformatics; Medicine; Biology; Internal medicine; Biochemistry; Genetics","authors":[{"name":"Fuqiang Ban","is_ca":true},{"name":"Kush Dalal","is_ca":true},{"name":"Eric Leblanc","is_ca":true},{"name":"Hélène Morin","is_ca":true},{"name":"Paul S. Rennie","is_ca":true},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05123095418060562,"gpt":0.3599071691822451,"spread":0.3086762150016395,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006490555,0.0008074878,0.001029314,0.001885978,0.0002545005,0.001178629,0.001082486,0.001065671,0.004263359],"category_scores_gemma":[0.0009097747,0.0003187988,0.0005751482,0.002038513,0.0004631814,0.001381863,0.0008854821,0.002190546,0.002539042],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006926038,"about_ca_system_score_gemma":0.001097691,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007948087,"about_ca_topic_score_gemma":0.001163507,"domain_scores_codex":[0.9997626,0.00005566076,0.00001708638,0.00004352656,0.00009689909,0.00002425917],"domain_scores_gemma":[0.9996418,0.0001911037,0.00003479278,0.00001797044,0.00008696018,0.00002733759],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00004528043,0.00009882876,0.0001479707,0.0117241,0.0001494503,0.0001537019,0.000072863,0.002615863,0.002511121,0.03223446,0.02845275,0.9217936],"study_design_scores_gemma":[0.00001664723,0.00006897508,0.0002804499,0.00209737,0.00007559424,0.0005784685,0.00003356042,0.0009954037,0.001459259,0.008940152,0.9854301,0.00002405058],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0004656515,0.9913368,0.002379354,0.0006802959,0.000257557,0.00001630057,0.00006031627,0.000044447,0.004759231],"genre_scores_gemma":[0.003168208,0.9923779,0.001933441,0.0004375115,0.0001683986,0.00002007297,0.000111222,0.00001304336,0.001770132],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.004263359,"threshold_uncertainty_score":0.01426238,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2155678816","doi":"10.1002/minf.201200171","title":"Rendering Molecular Sketches for Publication Quality Output","year":2013,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec","funders":"","keywords":"Rendering (computer graphics); Computer science; Cheminformatics; Computer graphics (images); File format; Graphics; Software; Computer graphics; Computational science; Engineering drawing; Database; Programming language; Bioinformatics; Engineering","authors":[{"name":"Alex M. Clark","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03700972570440528,"gpt":0.3195687943401153,"spread":0.28255906863571,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003977637,0.001495291,0.001228513,0.003351014,0.0008977973,0.008430454,0.001882276,0.00154826,0.08668551],"category_scores_gemma":[0.04130521,0.001002643,0.001531115,0.002841523,0.0007992309,0.004385833,0.003005253,0.001883697,0.01969739],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001198248,"about_ca_system_score_gemma":0.001427832,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001353538,"about_ca_topic_score_gemma":0.001474476,"domain_scores_codex":[0.9978696,0.0004132141,0.0002268831,0.0001987358,0.001158381,0.0001331634],"domain_scores_gemma":[0.9880311,0.005763981,0.0004468905,0.002611346,0.002801122,0.000345476],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0007166658,0.00007873668,0.001033172,0.001742459,0.0001098896,0.001085021,0.001093376,0.08488584,0.03433359,0.2292233,0.08483292,0.560865],"study_design_scores_gemma":[0.000323523,0.0001708265,0.0007109764,0.0006318256,0.0001154289,0.0008307155,0.0004069971,0.3823352,0.04075777,0.1079067,0.4655489,0.0002611545],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004147851,0.0006600003,0.9489728,0.0008433413,0.001002732,0.0002522161,0.001219196,0.02709071,0.01581112],"genre_scores_gemma":[0.06774283,0.002088322,0.9066217,0.0001751145,0.0002596589,0.0003302328,0.001885304,0.006420733,0.0144761],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.08668551,"threshold_uncertainty_score":0.2899919,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3037787710","doi":"10.1002/minf.202000033","title":"Using Language Representation Learning Approach to Efficiently Identify Protein Complex Categories in Electron Transport Chain","year":2020,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Computer science; Artificial intelligence; Feature learning; Representation (politics); Word embedding; Natural language processing; Machine learning; Feature (linguistics); Pattern recognition (psychology); Support vector machine; Categorization; Multi-task learning; Embedding; Task (project management)","authors":[{"name":"Trinh‐Trung‐Duong Nguyen","is_ca":false},{"name":"Nguyen Quoc Khanh Le","is_ca":true},{"name":"Quang‐Thai Ho","is_ca":false},{"name":"Dinh‐Van Phan","is_ca":false},{"name":"Yu‐Yen Ou","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02120448430788708,"gpt":0.3007711008899546,"spread":0.2795666165820676,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006481002,0.0006324084,0.0004978722,0.001864165,0.0003961405,0.0008903043,0.0006841915,0.0005752682,0.001338536],"category_scores_gemma":[0.001554721,0.0001613004,0.0008328981,0.001100975,0.0003842707,0.001984435,0.0007983255,0.0007498265,0.0006443844],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005839841,"about_ca_system_score_gemma":0.0007496632,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002144504,"about_ca_topic_score_gemma":0.001679796,"domain_scores_codex":[0.999539,0.0001260451,0.000043412,0.0001192414,0.00009139261,0.00008098171],"domain_scores_gemma":[0.99945,0.0002023983,0.0001001958,0.00006418097,0.0001511433,0.00003203794],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003744769,0.0004351904,0.0127177,0.0003572357,0.0001480709,0.0005274544,0.0006309066,0.07081539,0.08318397,0.01999964,0.006354911,0.804455],"study_design_scores_gemma":[0.00002607225,0.0001638521,0.002664255,0.00002370021,0.00005200586,0.0002549245,0.000191063,0.9577211,0.01640219,0.0195491,0.00290473,0.00004707434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1791072,0.0006597064,0.8133099,0.0005319896,0.00006894759,0.0001414079,0.0004920769,0.002493899,0.003194954],"genre_scores_gemma":[0.714904,0.0002933015,0.2800876,0.0001963601,0.00005546996,0.000191762,0.001301073,0.00009503154,0.002875464],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002144504,"threshold_uncertainty_score":0.004477859,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2944666543","doi":"10.1002/minf.201800110","title":"QSPRs for Molecular Diffusion Coefficients in Polymeric Passive Samplers: A Comparison of Simple Molecular and Quantum‐mechanical Sigma‐moment Descriptors","year":2019,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Trent University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Quantitative structure–activity relationship; Molecular descriptor; Low-density polyethylene; Mean squared error; Correlation coefficient; Chemistry; Moment (physics); Diffusion; Computational chemistry; Mathematics; Polyethylene; Thermodynamics; Organic chemistry; Stereochemistry; Statistics; Physics","authors":[{"name":"Alina M. Lampic","is_ca":true},{"name":"Donald Mackay","is_ca":true},{"name":"J. Mark Parnis","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01619342216238135,"gpt":0.3002332653078655,"spread":0.2840398431454841,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003106473,0.0006868669,0.0006536806,0.001048019,0.00009666351,0.000548651,0.0005665519,0.0004789638,0.0007978905],"category_scores_gemma":[0.004943199,0.0002561974,0.001126635,0.0007748592,0.0003798503,0.0008105109,0.000381897,0.0006041088,0.0003022769],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005485216,"about_ca_system_score_gemma":0.0004691994,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001862776,"about_ca_topic_score_gemma":0.001776266,"domain_scores_codex":[0.9990901,0.0003601081,0.00004727551,0.0001055622,0.0003591904,0.00003773999],"domain_scores_gemma":[0.9954907,0.003550203,0.0004925163,0.0001665887,0.0002723609,0.0000276022],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001225052,0.0005390621,0.02706794,0.001250038,0.0006709943,0.0001687584,0.0001205057,0.5891162,0.2363831,0.004196065,0.001034661,0.1382277],"study_design_scores_gemma":[0.00005700838,0.00133432,0.01545378,0.00004285387,0.0001329268,0.0001080872,0.00004484602,0.8932794,0.08675705,0.001303595,0.001408094,0.0000780816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6542438,0.003859364,0.3352222,0.0003075632,0.00004031682,0.0002855968,0.002342474,0.001100129,0.002598527],"genre_scores_gemma":[0.9578077,0.0009038952,0.0390127,0.00007633511,0.00002158149,0.0001443438,0.001264493,0.00003696038,0.0007319921],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003106473,"threshold_uncertainty_score":0.01642883,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2066256098","doi":"10.1002/minf.200900040","title":"Forecasting CYP2D6 and CYP3A4 Risk with a Global/Local Fusion Model of CYP450 Inhibition","year":2010,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University Health Network; Ontario Institute for Cancer Research","funders":"Neurocrine Biosciences","keywords":"Quantitative structure–activity relationship; Computer science; Data mining; Pharmacophore; Similarity (geometry); Set (abstract data type); Machine learning; Artificial intelligence; Chemistry","authors":[{"name":"Todd Ewing","is_ca":false},{"name":"Miklós Fehér","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01137314563226853,"gpt":0.2389662891251577,"spread":0.2275931434928892,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002236003,0.000908352,0.001084189,0.001044424,0.0003040982,0.0008001751,0.0008540408,0.0007170168,0.001259542],"category_scores_gemma":[0.003451499,0.0003310769,0.001185949,0.0008373018,0.0004236337,0.001051785,0.000885488,0.001164685,0.0003285457],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007788248,"about_ca_system_score_gemma":0.0007525743,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006002321,"about_ca_topic_score_gemma":0.006981533,"domain_scores_codex":[0.9992599,0.0001891692,0.00004488785,0.0002273922,0.0002229849,0.00005564233],"domain_scores_gemma":[0.9984206,0.0008440727,0.000269814,0.0002192411,0.0001845268,0.00006175588],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000103195,0.00008177014,0.008277342,0.00002133765,0.00008761802,0.00003941804,0.0000225158,0.948422,0.002066854,0.0008391537,0.0005484647,0.03949029],"study_design_scores_gemma":[0.000004158664,0.0000387763,0.0009452383,0.000001405929,0.00001495507,0.00001509191,0.000005409905,0.9973564,0.0006310173,0.0008163464,0.0001661475,0.000005107401],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3003016,0.0004162509,0.6927487,0.0004128478,0.00004575496,0.0001242414,0.001191607,0.001417409,0.003341593],"genre_scores_gemma":[0.8868462,0.0001549943,0.1102138,0.0001094521,0.00004812097,0.00009305809,0.001260903,0.00005995735,0.001213555],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006002321,"threshold_uncertainty_score":0.01193476,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1980840780","doi":"10.1002/minf.201100111","title":"An Advanced Group Contribution Method for High‐Dimensional, Sparse Data Sets","year":2011,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Alberta","funders":"","keywords":"Group (periodic table); Computer science; Data mining; Chemistry; Organic chemistry","authors":[{"name":"Chang Jun Lee","is_ca":true},{"name":"Jong Min Lee","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04836593607333022,"gpt":0.3458207124614303,"spread":0.2974547763881001,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003859253,0.001199534,0.001681035,0.002230957,0.0007426165,0.001077743,0.00226411,0.001732865,0.003129535],"category_scores_gemma":[0.009170289,0.0005684369,0.001809251,0.002415483,0.0009036572,0.001475528,0.001999244,0.002323466,0.001521012],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004955071,"about_ca_system_score_gemma":0.001550864,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003034087,"about_ca_topic_score_gemma":0.00262175,"domain_scores_codex":[0.9982252,0.0008080755,0.00008386744,0.0002575273,0.0005614022,0.00006386909],"domain_scores_gemma":[0.9968944,0.002028664,0.0001839457,0.0003134847,0.0004921202,0.00008735859],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002451023,0.0001423403,0.001331992,0.0003376058,0.0002891918,0.0002420683,0.0002003778,0.4163024,0.008020769,0.02887546,0.006691666,0.537321],"study_design_scores_gemma":[0.00001115548,0.00002511304,0.0001091433,0.000008882663,0.000009897304,0.0000405765,0.00000718037,0.9899387,0.0005573293,0.007317387,0.001965168,0.000009478088],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.001493873,0.0001596582,0.9977635,0.00007900609,0.00003425356,0.00002796689,0.00004000804,0.0002190624,0.0001827649],"genre_scores_gemma":[0.06209595,0.0004809751,0.9337327,0.0001514316,0.000179686,0.0003696156,0.0005261255,0.0001859082,0.002277609],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003859253,"threshold_uncertainty_score":0.02040994,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2621981149","doi":"10.1002/minf.201700022","title":"Non a Priori Automatic Discovery of 3D Chemical Patterns: Application to Mutagenicity","year":2017,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"European Regional Development Fund; Région Normandie","keywords":"Cheminformatics; A priori and a posteriori; Computer science; Relation (database); Set (abstract data type); Feature (linguistics); Property (philosophy); Function (biology); Fragment (logic); Data mining; Biological system; Theoretical computer science; Algorithm; Chemistry; Computational chemistry; Biology","authors":[{"name":"Julien Rabatel","is_ca":false},{"name":"Thomas Fannes","is_ca":true},{"name":"Alban Lepailleur","is_ca":false},{"name":"Jérémie Le Goff","is_ca":false},{"name":"Bruno Crémilleux","is_ca":false},{"name":"Jan Ramon","is_ca":true},{"name":"Ronan Bureau","is_ca":false},{"name":"Bertrand Cuissart","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01040611623854909,"gpt":0.291363309884864,"spread":0.2809571936463149,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008802959,0.0006373962,0.0008548113,0.002417812,0.0004510466,0.0008898205,0.001078663,0.000840953,0.001510206],"category_scores_gemma":[0.005346052,0.0003905264,0.001024373,0.001805264,0.0006792785,0.0008925577,0.001122459,0.0008268291,0.0005863525],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000451825,"about_ca_system_score_gemma":0.0008439067,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001898943,"about_ca_topic_score_gemma":0.003284959,"domain_scores_codex":[0.9991524,0.0002417507,0.00006633888,0.0002476173,0.0002498852,0.00004197822],"domain_scores_gemma":[0.9961468,0.002295674,0.0004738302,0.0005967784,0.0003816603,0.0001052448],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009316873,0.0004389281,0.03443434,0.001166568,0.0002962991,0.0006594257,0.0003043441,0.2302922,0.0749038,0.01943693,0.004815809,0.6323197],"study_design_scores_gemma":[0.00005125319,0.0001472145,0.004649934,0.00003320434,0.00004421378,0.0002959645,0.00005465195,0.9545416,0.01335379,0.02324208,0.003559979,0.00002624175],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1793657,0.001000695,0.8088031,0.0004498253,0.00004272633,0.0002089378,0.003163076,0.004773381,0.002192488],"genre_scores_gemma":[0.4605474,0.0003647218,0.5333543,0.000101664,0.00003251709,0.0001645883,0.004623385,0.0002414297,0.0005700376],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002417812,"threshold_uncertainty_score":0.005052149,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2947303722","doi":"10.1002/minf.201900024","title":"Molecular Modelling of Potential Candidates for the Treatment of Depression","year":2019,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Pharmacophore; Quantitative structure–activity relationship; Computational biology; Serotonin transporter; Docking (animal); Mode of action; Isoquinoline; Chemistry; Pharmacology; Serotonin; Stereochemistry; Biology; Medicine; Receptor; Biochemistry","authors":[{"name":"Daniela Rodrigues Silva","is_ca":false},{"name":"Stephen J. Barigye","is_ca":true},{"name":"Letícia Santos‐Garcia","is_ca":false},{"name":"Elaine F. F. da Cunha","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01543643617665239,"gpt":0.2676626665438475,"spread":0.2522262303671951,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002291888,0.0005782471,0.0008291403,0.0005745796,0.0003253648,0.0009115952,0.0006976916,0.001055528,0.009381132],"category_scores_gemma":[0.0005429781,0.0003055609,0.000621092,0.000602495,0.0002926652,0.0003259736,0.000332479,0.0004640743,0.001033876],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007133142,"about_ca_system_score_gemma":0.0008968948,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005089136,"about_ca_topic_score_gemma":0.003546982,"domain_scores_codex":[0.9999013,0.00003619952,0.000003989478,0.00001132731,0.00002800762,0.00001920597],"domain_scores_gemma":[0.9998612,0.00007740694,0.00001730826,0.00000764506,0.00002510807,0.00001125799],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008110749,0.00003890381,0.0003540675,0.00007596474,0.00001714742,0.0000784607,0.00001105371,0.9919708,0.00176614,0.002520132,0.0004035535,0.002682652],"study_design_scores_gemma":[0.00004571305,0.00007654912,0.0001819984,0.00001019784,0.00001343896,0.0000147483,0.00001449881,0.9966424,0.0007262307,0.0008570029,0.001411665,0.000005662588],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.707559,0.004827208,0.1820878,0.002140655,0.0003255171,0.0005186312,0.005629124,0.001121462,0.09579059],"genre_scores_gemma":[0.9700344,0.001053899,0.02131404,0.0001152896,0.00002097192,0.0002820166,0.001067722,0.00005177236,0.006059988],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.009381132,"threshold_uncertainty_score":0.03138304,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4409979195","doi":"10.1002/minf.202500018","title":"Deep Modeling of Gain‐of‐Function Mutations on Androgen Receptor","year":2025,"lang":"en","type":"article","venue":"Molecular Informatics","topic":"Prostate Cancer Treatment and Research","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Androgen receptor; Prostate cancer; Mutant; Computational biology; Mutation; Antiandrogens; Function (biology); Computer science; Biology; Bioinformatics; Genetics; Gene; Cancer","authors":[{"name":"Jiaying You","is_ca":true},{"name":"Jane Foo","is_ca":true},{"name":"Nada Lallous","is_ca":true},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01792586232352345,"gpt":0.3033978119549671,"spread":0.2854719496314437,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00023882,0.0006666823,0.0005751131,0.000246717,0.0001269574,0.0004765043,0.0005804675,0.0006740685,0.001079586],"category_scores_gemma":[0.0006106895,0.0002936317,0.000735481,0.0002394404,0.0003089772,0.0003338296,0.0003416251,0.0007366514,0.0001620171],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004302024,"about_ca_system_score_gemma":0.0006734077,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005476729,"about_ca_topic_score_gemma":0.005392646,"domain_scores_codex":[0.9999259,0.00002107403,0.000003435486,0.00001658283,0.00001401169,0.00001892353],"domain_scores_gemma":[0.9998542,0.00009222848,0.00001782622,0.000008453153,0.00001492479,0.00001227938],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00004260582,0.00002548202,0.0005862356,0.00002312812,0.00002482958,0.00003711945,0.000005583452,0.9912711,0.001978329,0.0009114319,0.0003427904,0.004751308],"study_design_scores_gemma":[0.000001681838,0.000009116501,0.0000469034,7.28343e-7,0.00000258866,0.000003270994,0.000001023128,0.999171,0.0003308056,0.0003548134,0.00007709213,8.824019e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5356314,0.001839509,0.4527833,0.0009050259,0.000129588,0.00005388206,0.001065252,0.001229192,0.006362908],"genre_scores_gemma":[0.9745213,0.0005134476,0.02146544,0.0001802171,0.00002316265,0.00006750362,0.0005550015,0.00005528543,0.002618764],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005476729,"threshold_uncertainty_score":0.01088971,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4408701827","doi":"10.1002/minf.70029","title":"The Use of DeepQSAR Models for the Discovery of Peptides With Enhanced Antimicrobial and Antibiofilm Potential","year":2025,"lang":"en","type":"preprint","venue":"Molecular Informatics","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"British Columbia Knowledge Development Fund; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canada Foundation for Innovation","keywords":"Antimicrobial; Antimicrobial peptides; Chemistry; Biochemical engineering; Nanotechnology; Computational biology; Microbiology; Biology; Materials science; Engineering","authors":[{"name":"Jiaying You","is_ca":true},{"name":"Evan F. Haney","is_ca":true},{"name":"Noushin Akhoundsadegh","is_ca":true},{"name":"Robert E. W. Hancock","is_ca":true},{"name":"Artem Cherkasov","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01057461734984583,"gpt":0.2379863335103369,"spread":0.2274117161604911,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001077196,0.001094124,0.0009833786,0.0004600502,0.0001622092,0.0006062606,0.0008237538,0.0009202496,0.0008659901],"category_scores_gemma":[0.001225005,0.0004619912,0.0009550274,0.0004066929,0.0004669329,0.0008915136,0.0005770969,0.001557756,0.0002662658],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007543899,"about_ca_system_score_gemma":0.0006820529,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002852037,"about_ca_topic_score_gemma":0.00274368,"domain_scores_codex":[0.999768,0.00006615293,0.00001897019,0.00004482748,0.00007052676,0.00003158252],"domain_scores_gemma":[0.9994887,0.0002784909,0.00008436306,0.00003172319,0.00009266724,0.00002395017],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00005510712,0.0000675812,0.0006380123,0.000111889,0.00004859092,0.00005156598,0.00001626276,0.958976,0.01946698,0.002242579,0.0002355794,0.01808983],"study_design_scores_gemma":[0.000003820528,0.00004066263,0.00003953116,0.00000250972,0.000006478944,0.000005234059,0.000001519391,0.9966286,0.002512139,0.000589035,0.0001677464,0.000002739041],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2063974,0.003014178,0.7849306,0.000636221,0.00008146526,0.00007981875,0.000408174,0.001299321,0.003152742],"genre_scores_gemma":[0.8616292,0.001889891,0.1329206,0.0004561725,0.00004194034,0.0001894857,0.0007130031,0.00007687043,0.00208288],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002852037,"threshold_uncertainty_score":0.005696774,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}