{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":48,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":48,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"c7cf3172b93e","filters":{"venue":"BioData Mining"}},"results":[{"id":"W2771169143","doi":"10.1186/s13040-017-0155-3","title":"Ten quick tips for machine learning in computational biology","year":2017,"lang":"en","type":"review","venue":"BioData Mining","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":915,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre","funders":"Natural Sciences and Engineering Research Council of Canada; University of California, Irvine; University of Toronto","keywords":"Computer science; Informatics; Context (archaeology); Data science; Artificial intelligence; Machine learning; Biology; Engineering","authors":[{"name":"Davide Chicco","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1424812159179113,"gpt":0.4167059229229167,"spread":0.2742247070050055,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005610542,0.001592567,0.001315313,0.005336689,0.001058515,0.003454902,0.002108166,0.003296102,0.006799325],"category_scores_gemma":[0.0174653,0.0006402545,0.001010816,0.005152103,0.003218371,0.008845662,0.003043514,0.01114573,0.005549935],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001719455,"about_ca_system_score_gemma":0.004082568,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001071219,"about_ca_topic_score_gemma":0.002103823,"domain_scores_codex":[0.997595,0.0007633591,0.0003634931,0.0002467411,0.0008874293,0.0001439177],"domain_scores_gemma":[0.9837859,0.01166546,0.000649359,0.0004319506,0.002751858,0.0007154038],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005440966,0.00006481427,0.0002132078,0.01106232,0.00008170467,0.0002716496,0.0003894564,0.0004538748,0.000504549,0.03489134,0.251554,0.7004586],"study_design_scores_gemma":[0.000009507223,0.00003113395,0.000153362,0.005725003,0.00002768862,0.0004726915,0.0001158455,0.0000912203,0.0001556299,0.01868657,0.9745021,0.00002928677],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0001051347,0.9722615,0.003630145,0.01417156,0.006823811,0.00002227442,0.00005988729,0.0001094646,0.002816182],"genre_scores_gemma":[0.001354085,0.9744043,0.007155232,0.009307989,0.00441902,0.00007070455,0.000140409,0.00006970636,0.003078449],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.006799325,"threshold_uncertainty_score":0.02967173,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3126232929","doi":"10.1186/s13040-021-00244-z","title":"The Matthews correlation coefficient (MCC) is more reliable than balanced accuracy, bookmaker informedness, and markedness in two-class confusion matrix evaluation","year":2021,"lang":"en","type":"article","venue":"BioData Mining","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":893,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Krembil Foundation","funders":"Deutsche Forschungsgemeinschaft","keywords":"Confusion matrix; Correlation; False positive paradox; Computer science; Confusion; False positives and false negatives; Classifier (UML); Statistics; Artificial intelligence; Metric (unit); Correlation coefficient; Machine learning; Data mining; Mathematics; Psychology; Operations management","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Niklas Tötsch","is_ca":false},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02927417731283126,"gpt":0.3307727570661502,"spread":0.3014985797533189,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01584418,0.001545204,0.001511071,0.007663949,0.001366348,0.003296727,0.001054969,0.00191533,0.001817628],"category_scores_gemma":[0.1107636,0.0003350041,0.0008541324,0.004399135,0.002304319,0.002821813,0.001821487,0.001428677,0.0009953736],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001400318,"about_ca_system_score_gemma":0.001319449,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003817915,"about_ca_topic_score_gemma":0.005058927,"domain_scores_codex":[0.9814667,0.005495087,0.002551811,0.003180954,0.0066273,0.0006782635],"domain_scores_gemma":[0.8398484,0.1025892,0.02223467,0.008470453,0.02368741,0.003169879],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0024924,0.0003610173,0.4226277,0.001822262,0.00262621,0.0009373054,0.002193426,0.1344294,0.0186979,0.02001596,0.04351469,0.3502817],"study_design_scores_gemma":[0.00009906881,0.001587682,0.1799962,0.0005762462,0.000605116,0.001548274,0.001153974,0.7163308,0.04192943,0.04094587,0.01463181,0.0005954534],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.6303577,0.007464869,0.3337457,0.00225208,0.0009788257,0.0005293683,0.003544639,0.004319874,0.01680693],"genre_scores_gemma":[0.9578433,0.0002957901,0.03816509,0.0002443196,0.0002563609,0.0001537767,0.001516277,0.0002316614,0.001293396],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.01584418,"threshold_uncertainty_score":0.08379304,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4321214126","doi":"10.1186/s13040-023-00322-4","title":"The Matthews correlation coefficient (MCC) should replace the ROC AUC as the standard metric for assessing binary classification","year":2023,"lang":"en","type":"article","venue":"BioData Mining","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":513,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Receiver operating characteristic; Matthews correlation coefficient; Binary classification; Statistics; Confusion matrix; False positive rate; Artificial intelligence; Correlation; Mathematics; Binary number; Sensitivity (control systems); Metric (unit); Classifier (UML); Computer science; Pattern recognition (psychology); Machine learning; Support vector machine; Arithmetic","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1099873591318314,"gpt":0.3627967148767833,"spread":0.2528093557449519,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01530556,0.002756914,0.004081455,0.003941244,0.0009771422,0.004764434,0.003884683,0.005842996,0.006873861],"category_scores_gemma":[0.09827743,0.0008002041,0.001730083,0.006211227,0.003612601,0.004704223,0.001725498,0.005976944,0.01251109],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002863693,"about_ca_system_score_gemma":0.003009216,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003513164,"about_ca_topic_score_gemma":0.003343298,"domain_scores_codex":[0.981873,0.005489669,0.002355809,0.002591823,0.007197795,0.0004919061],"domain_scores_gemma":[0.9382277,0.0345214,0.007168982,0.005280702,0.01335584,0.001445459],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0005443954,0.0001262674,0.01733394,0.003481501,0.0008541755,0.0007132969,0.0002993405,0.004302681,0.004502175,0.05068823,0.5676448,0.3495092],"study_design_scores_gemma":[0.0002152485,0.001137028,0.04118559,0.003305807,0.0009035009,0.00621452,0.0005875552,0.04324102,0.02648873,0.1804464,0.6952102,0.001064406],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02861718,0.1832888,0.5222214,0.1014407,0.07616145,0.00126635,0.01073733,0.01671157,0.05955528],"genre_scores_gemma":[0.3390985,0.06127909,0.4569612,0.05931128,0.02679771,0.003372934,0.01172351,0.005896053,0.03555974],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9846944,"threshold_uncertainty_score":0.08094454,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2171815584","doi":"10.1186/1756-0381-7-22","title":"Applications of the MapReduce programming framework to clinical big data analysis: current landscape and future trends","year":2014,"lang":"en","type":"review","venue":"BioData Mining","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":147,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Calgary Laboratory Services; University of Calgary","funders":"","keywords":"Computer science; Big data; Scalability; Programming paradigm; Data-intensive computing; Distributed computing; Data processing; Node (physics); Distributed File System; Grid computing; Grid; Database; Data mining; Operating system; Programming language","authors":[{"name":"Emad A. Mohammed","is_ca":true},{"name":"Behrouz H. Far","is_ca":true},{"name":"Christopher Naugler","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5193724130788084,"gpt":0.6095661319612116,"spread":0.09019371888240313,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007256266,0.0007438996,0.0009266686,0.002775295,0.0005790929,0.003571196,0.003091041,0.001743791,0.002332157],"category_scores_gemma":[0.007740624,0.0007642454,0.001118306,0.004328601,0.002261623,0.005159085,0.002272269,0.004667703,0.001257156],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001795947,"about_ca_system_score_gemma":0.003872294,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003504113,"about_ca_topic_score_gemma":0.002507091,"domain_scores_codex":[0.997127,0.0008006063,0.0002362786,0.0004828221,0.001160105,0.0001931875],"domain_scores_gemma":[0.9915741,0.004479284,0.0003651902,0.0003494457,0.002591527,0.0006405295],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001419868,0.00024176,0.00369258,0.006422069,0.0001129961,0.000261717,0.0006658817,0.004262401,0.002130263,0.04976753,0.0471561,0.8851447],"study_design_scores_gemma":[0.00005056987,0.0003156698,0.003609128,0.003163105,0.0000980761,0.00173878,0.0009926399,0.0162455,0.002855405,0.07175822,0.8989711,0.000201696],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.004711853,0.8185324,0.1189542,0.03323785,0.002879537,0.000241456,0.0002460678,0.001315565,0.01988102],"genre_scores_gemma":[0.02676015,0.844301,0.1114523,0.006766128,0.006480271,0.0002045863,0.0005551095,0.0003550422,0.003125329],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.007256266,"threshold_uncertainty_score":0.03837526,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4413362561","doi":"10.1186/s13040-025-00465-6","title":"A simple guide to the use of Student’s t-test, Mann-Whitney U test, Chi-squared test, and Kruskal-Wallis test in biostatistics","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":68,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"Ministero dell'Università e della Ricerca; Dipartimenti di Eccellenza","keywords":"Test (biology); Biostatistics; Null hypothesis; Univariate; Kruskal–Wallis one-way analysis of variance; Mann–Whitney U test; Statistical hypothesis testing; Computer science; Chi-square test; Statistics; Simple (philosophy); Machine learning; Artificial intelligence; Data mining; Mathematics; Multivariate statistics; Medicine","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Andrea Sichenze","is_ca":false},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04371332968964679,"gpt":0.3430738913752828,"spread":0.299360561685636,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01838422,0.00255582,0.002002,0.009598304,0.001815123,0.004457757,0.004592329,0.005096974,0.08368386],"category_scores_gemma":[0.1358669,0.001761146,0.001737506,0.01084566,0.004148006,0.005851397,0.003290198,0.009000804,0.09816351],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002136558,"about_ca_system_score_gemma":0.007232973,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003961706,"about_ca_topic_score_gemma":0.005516058,"domain_scores_codex":[0.9735796,0.01368301,0.003457159,0.0016913,0.007093439,0.0004954746],"domain_scores_gemma":[0.8954985,0.06984838,0.004804933,0.006376815,0.02151429,0.00195706],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001220496,0.0001887466,0.0008863877,0.001552341,0.00004552629,0.0003923339,0.0006732313,0.0009575,0.001612802,0.0287318,0.8135018,0.1513355],"study_design_scores_gemma":[0.00005276039,0.0001426671,0.0009392144,0.001315594,0.00001804405,0.0006402922,0.0003749425,0.001250966,0.0008696135,0.03958215,0.9547045,0.0001092945],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.002245557,0.02461494,0.7550923,0.04620063,0.0162632,0.004980742,0.02560314,0.02306977,0.1019298],"genre_scores_gemma":[0.00891192,0.01746577,0.887909,0.01940783,0.00455757,0.007259248,0.0102071,0.007286464,0.03699506],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.08368386,"threshold_uncertainty_score":0.2799504,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3136786679","doi":"10.1186/s13040-021-00251-0","title":"Indels in SARS-CoV-2 occur at template-switching hotspots","year":2021,"lang":"en","type":"article","venue":"BioData Mining","topic":"SARS-CoV-2 and COVID-19 Research","field":"Medicine","cited_by":39,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"National Science Foundation of Sri Lanka; Stanford Bio-X; National Science Foundation","keywords":"Indel; Genetics; Biology; RNA; Computational biology; Homologous recombination; RNA polymerase; Recombination; Evolutionary biology; Gene; Single-nucleotide polymorphism; Genotype","authors":[{"name":"Brianna Chrisman","is_ca":false},{"name":"Kelley Paskov","is_ca":false},{"name":"Nate Stockham","is_ca":false},{"name":"Kevin Tabatabaei","is_ca":true},{"name":"Jae-Yoon Jung","is_ca":false},{"name":"Peter Washington","is_ca":false},{"name":"Maya Varma","is_ca":false},{"name":"Min Sun","is_ca":false},{"name":"Sepideh Maleki","is_ca":false},{"name":"Dennis P. Wall","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.121934235703093,"gpt":0.3875826429091648,"spread":0.2656484072060718,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003819455,0.000339669,0.0005482038,0.001775617,0.0004666371,0.0005669673,0.0003044794,0.0006284916,0.002246626],"category_scores_gemma":[0.001362268,0.0002859429,0.0007087725,0.001963735,0.0003038757,0.0003504082,0.0003740852,0.0005563497,0.0009365473],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002076537,"about_ca_system_score_gemma":0.0001899399,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007382452,"about_ca_topic_score_gemma":0.002096076,"domain_scores_codex":[0.9993487,0.00005563496,0.00006551887,0.0002735752,0.0001881523,0.00006845828],"domain_scores_gemma":[0.9984784,0.0004571083,0.0006120832,0.0001578052,0.0001692818,0.0001254189],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001716378,0.0001504228,0.1955535,0.00101585,0.0004817949,0.004501267,0.001043019,0.002514959,0.7582355,0.000883136,0.001156093,0.03274821],"study_design_scores_gemma":[0.0000518729,0.0002742167,0.9092354,0.0001036284,0.0002816729,0.006073048,0.000417916,0.003317778,0.06901236,0.00108401,0.01005808,0.00009008853],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9894856,0.001848691,0.00308277,0.00005148704,0.0000333798,0.00003359114,0.003511937,0.0002355248,0.001716939],"genre_scores_gemma":[0.9845282,0.0004100147,0.006682403,0.0001417954,0.00003928744,0.00003387974,0.007322639,0.00009614565,0.0007455442],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002246626,"threshold_uncertainty_score":0.007515669,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2273538503","doi":"10.1186/s13040-016-0082-8","title":"Network-based analysis of genetic variants associated with hippocampal volume in Alzheimer’s disease: a study of ADNI cohorts","year":2016,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":35,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute of General Medical Sciences; National Institute on Aging; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; University of California, San Diego; National Institutes of Health; Genentech; U.S. National Library of Medicine; IXICO; Servier; Eisai; Pfizer; Biogen; BioClinica; Medpace; F. Hoffmann-La Roche; Synarc; University of Southern California; Novartis Pharmaceuticals Corporation; Dartmouth College; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Alzheimer's Disease Neuroimaging Initiative; National Center for Advancing Translational Sciences; Meso Scale Diagnostics; Gordon and Betty Moore Foundation; Foundation for the National Institutes of Health; Alzheimer's Association; National Science Foundation","keywords":"Hippocampal formation; Disease; Volume (thermodynamics); Genetic variants; Alzheimer's disease; Neuroscience; Computer science; Medicine; Data science; Computational biology; Biology; Internal medicine; Genetics; Genotype; Gene","authors":[{"name":"Ailin Song","is_ca":false},{"name":"Jingwen Yan","is_ca":false},{"name":"Sungeun Kim","is_ca":false},{"name":"Shannon L. Risacher","is_ca":false},{"name":"Aaron K. Wong","is_ca":false},{"name":"Andrew J. Saykin","is_ca":false},{"name":"Li Shen","is_ca":false},{"name":"Casey S. Greene","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02897990539535016,"gpt":0.2713402144407311,"spread":0.2423603090453809,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002057068,0.0005117396,0.0005412117,0.001982731,0.0009106346,0.0009555484,0.001048581,0.0005446528,0.001834185],"category_scores_gemma":[0.007538056,0.0003658649,0.0008257732,0.001960749,0.0004188184,0.0005836795,0.001140386,0.0006573378,0.0003420529],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000827426,"about_ca_system_score_gemma":0.0006509924,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01475811,"about_ca_topic_score_gemma":0.02661918,"domain_scores_codex":[0.998975,0.0002886241,0.0000686734,0.0004787334,0.0001151852,0.00007377515],"domain_scores_gemma":[0.9971973,0.0007639489,0.0007786213,0.0006270112,0.0003500518,0.0002830765],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001410882,0.0001155919,0.9729864,0.0001693043,0.003095096,0.000448463,0.0004758307,0.003030571,0.002071207,0.0008855816,0.005421817,0.009889365],"study_design_scores_gemma":[0.0001763409,0.000127464,0.9840792,0.00005219172,0.001192725,0.0008125309,0.0002468229,0.008330313,0.0005667424,0.002073373,0.002301518,0.00004076112],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9840531,0.0006178373,0.003432306,0.0002882632,0.00003286515,0.00006989409,0.01028879,0.0001192447,0.001097811],"genre_scores_gemma":[0.9749919,0.0003381426,0.006659483,0.0001267579,0.00004275695,0.0002230676,0.0168902,0.00008475594,0.0006430284],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01475811,"threshold_uncertainty_score":0.02934444,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2111827030","doi":"10.1186/1756-0381-7-7","title":"Semi-supervised consensus clustering for gene expression data analysis","year":2014,"lang":"en","type":"article","venue":"BioData Mining","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":35,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"National Research Council Canada","funders":"National Research Council Canada","keywords":"Cluster analysis; Computer science; Data mining; Consensus clustering; Computational biology; Expression (computer science); Artificial intelligence; Biology; Correlation clustering; CURE data clustering algorithm","authors":[{"name":"Yunli Wang","is_ca":true},{"name":"Youlian Pan","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1087011612012788,"gpt":0.350048260191916,"spread":0.2413470989906372,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005724066,0.001321783,0.002311201,0.00288702,0.001014012,0.001149205,0.002714407,0.001711551,0.00169155],"category_scores_gemma":[0.01441562,0.0007080265,0.001930991,0.003134252,0.001499858,0.001362381,0.001269404,0.002125851,0.001520931],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001808852,"about_ca_system_score_gemma":0.002668686,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004231688,"about_ca_topic_score_gemma":0.003734261,"domain_scores_codex":[0.9934989,0.002499175,0.0004144806,0.001443121,0.001997965,0.0001463026],"domain_scores_gemma":[0.9902229,0.004703601,0.00103652,0.00121989,0.002637163,0.0001798606],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000320224,0.0002092676,0.002709042,0.001015025,0.0005323139,0.0001399164,0.0004175793,0.657284,0.01690073,0.01174309,0.00560233,0.3031265],"study_design_scores_gemma":[0.00001255023,0.00003164614,0.0006001565,0.00002078798,0.00001940386,0.00005141592,0.00002692908,0.9829636,0.004043058,0.01080097,0.001401154,0.00002843131],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.004817686,0.0003067981,0.9933073,0.00007628962,0.0000282937,0.00008718965,0.0001320129,0.0009445902,0.0002998736],"genre_scores_gemma":[0.1297049,0.0003353324,0.8670255,0.00009254944,0.00006963529,0.0007530796,0.001086307,0.0002596908,0.0006729325],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005724066,"threshold_uncertainty_score":0.03027213,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2161488150","doi":"10.1186/1756-0381-5-8","title":"A comparison and evaluation of five biclustering algorithms by quantifying goodness of biclusters for gene expression data","year":2012,"lang":"en","type":"article","venue":"BioData Mining","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":28,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"York University","keywords":"Biclustering; Ranking (information retrieval); Computer science; Data mining; Gene ontology; Correlation; Algorithm; Expression (computer science); Cluster analysis; Artificial intelligence; Pattern recognition (psychology); Mathematics; Gene; Gene expression; Biology; Correlation clustering","authors":[{"name":"Li Li","is_ca":false},{"name":"Yang Guo","is_ca":false},{"name":"Wenwu Wu","is_ca":false},{"name":"Youyi Shi","is_ca":false},{"name":"Jian Cheng","is_ca":false},{"name":"Shiheng Tao","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.264235945200037,"gpt":0.4307928668063278,"spread":0.1665569216062908,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01065459,0.001729349,0.001466313,0.006933718,0.001124485,0.001687653,0.00136531,0.001122725,0.0007564782],"category_scores_gemma":[0.02158464,0.0004049869,0.00186498,0.003662262,0.0008283704,0.001448231,0.001215015,0.001013877,0.0003678252],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001165329,"about_ca_system_score_gemma":0.001795109,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003068668,"about_ca_topic_score_gemma":0.00293643,"domain_scores_codex":[0.9947861,0.001946152,0.000673015,0.0008864629,0.001434776,0.0002734074],"domain_scores_gemma":[0.983689,0.01025454,0.001143498,0.001131026,0.003401899,0.0003802611],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002363703,0.0006190658,0.1131052,0.001569151,0.002079737,0.0001753367,0.000744616,0.2768527,0.02278711,0.00419135,0.004626405,0.5708857],"study_design_scores_gemma":[0.0001028358,0.0007088049,0.02275869,0.0001102093,0.0003307876,0.0002973435,0.0004265303,0.9523413,0.01759882,0.003240008,0.001989919,0.00009475253],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.3890611,0.003506394,0.5978411,0.0003509411,0.000147273,0.0005146197,0.001299096,0.005266645,0.002012965],"genre_scores_gemma":[0.4788785,0.0007222173,0.515438,0.0001511925,0.0000328243,0.0005233664,0.003526235,0.0003482427,0.0003795064],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01065459,"threshold_uncertainty_score":0.05634755,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2202714662","doi":"10.1186/s13040-015-0077-x","title":"Characterizing gene-gene interactions in a statistical epistasis network of twelve candidate genes for obesity","year":2015,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":27,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Memorial University of Newfoundland","funders":"U.S. National Library of Medicine; National Institute of General Medical Sciences; National Institutes of Health","keywords":"Epistasis; SNP; Missing heritability problem; Single-nucleotide polymorphism; Genetics; Gene; Genome-wide association study; Biology; Candidate gene; Pairwise comparison; Computational biology; Statistics; Genotype; Mathematics","authors":[{"name":"Rishika De","is_ca":false},{"name":"Ting Hu","is_ca":true},{"name":"Jason H. Moore","is_ca":false},{"name":"Diane Gilbert‐Diamond","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05905887234879215,"gpt":0.3274183350026971,"spread":0.2683594626539049,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009455682,0.0003818714,0.0004107569,0.002118715,0.000404875,0.0005184203,0.0003399827,0.0002657928,0.001207948],"category_scores_gemma":[0.004444669,0.0002029848,0.0007105871,0.00167396,0.0004974178,0.0004119627,0.0006111442,0.0004795095,0.000100011],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004528728,"about_ca_system_score_gemma":0.0003846074,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002363019,"about_ca_topic_score_gemma":0.003605994,"domain_scores_codex":[0.9994185,0.000240268,0.00003302899,0.0001794842,0.00007197949,0.00005677747],"domain_scores_gemma":[0.9963864,0.002506705,0.0006742103,0.0001411001,0.0001415289,0.0001500302],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008212848,0.0002108403,0.8003345,0.0003826872,0.002429575,0.000998456,0.0005427947,0.096029,0.04223124,0.005567024,0.0009673889,0.04948519],"study_design_scores_gemma":[0.00005664084,0.000285555,0.6152518,0.00002565127,0.0006360493,0.0009552566,0.0003141176,0.3602248,0.003565488,0.01752474,0.001114494,0.00004549523],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9790087,0.0002410131,0.01973588,0.00008640123,0.000002931369,0.00002607289,0.0003916768,0.00007539673,0.0004319378],"genre_scores_gemma":[0.9942993,0.00005925081,0.005117089,0.00001454071,0.000004521028,0.00002799184,0.0003990884,0.000007123974,0.00007108158],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002363019,"threshold_uncertainty_score":0.00500071,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2528021625","doi":"10.1186/s13040-017-0129-5","title":"Variant Set Enrichment: an R package to identify disease-associated functional genomic regions","year":2017,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genomics and Rare Diseases","field":"Biochemistry, Genetics and Molecular Biology","cited_by":25,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University Health Network; Ontario Institute for Cancer Research; University of Toronto; Princess Margaret Cancer Centre","funders":"U.S. National Library of Medicine; National Institute of Environmental Health Sciences; Canadian Cancer Society Research Institute; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; National Cancer Institute; National Institutes of Health; Prostate Cancer Canada; Natural Sciences and Engineering Research Council of Canada; Princess Margaret Cancer Foundation","keywords":"Computational biology; Disease; Set (abstract data type); Genome; R package; Human genome; Computer science; Biology; Genetics; Gene; Medicine","authors":[{"name":"Musaddeque Ahmed","is_ca":true},{"name":"Richard Sallari","is_ca":false},{"name":"Haiyang Guo","is_ca":true},{"name":"Jason H. Moore","is_ca":false},{"name":"Housheng Hansen He","is_ca":true},{"name":"Mathieu Lupien","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05028613776478923,"gpt":0.3121266194218884,"spread":0.2618404816570991,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006543024,0.003237608,0.002513854,0.003845889,0.000803619,0.002492798,0.003867539,0.001200354,0.03151374],"category_scores_gemma":[0.04748147,0.001568228,0.004023466,0.003586127,0.001067455,0.001436103,0.00360624,0.002661761,0.01593168],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005844833,"about_ca_system_score_gemma":0.002743301,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002683169,"about_ca_topic_score_gemma":0.002939774,"domain_scores_codex":[0.9961591,0.001901524,0.000328837,0.0008900464,0.0005276066,0.0001928487],"domain_scores_gemma":[0.9748155,0.02094321,0.001176424,0.00189492,0.0007577406,0.0004121317],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003460255,0.0002381701,0.05891781,0.009620402,0.01603378,0.00334591,0.001319927,0.03517262,0.01328803,0.0328877,0.6030368,0.2226786],"study_design_scores_gemma":[0.002174597,0.0005969789,0.04357469,0.001077579,0.005909939,0.005533295,0.0004035096,0.2047929,0.02274013,0.1444798,0.5679768,0.0007397372],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01530056,0.00211278,0.6404769,0.001351771,0.0006808299,0.0005069182,0.1211207,0.2141322,0.004317294],"genre_scores_gemma":[0.1131148,0.001450436,0.7060869,0.001384689,0.0003191065,0.003450973,0.08710953,0.08253936,0.004544046],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03151374,"threshold_uncertainty_score":0.105424,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3128825412","doi":"10.1186/s13040-021-00235-0","title":"Data analytics and clinical feature ranking of medical records of patients with sepsis","year":2021,"lang":"en","type":"article","venue":"BioData Mining","topic":"Sepsis Diagnosis and Treatment","field":"Medicine","cited_by":21,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Krembil Foundation","funders":"University of Toronto","keywords":"Sepsis; Medical record; Septic shock; Medicine; Context (archaeology); Ranking (information retrieval); Electronic medical record; Machine learning; Binary classification; Computer science; Logistic regression; SOFA score; Artificial intelligence; Intensive care medicine; Data mining; Emergency medicine; Internal medicine; Support vector machine","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Luca Oneto","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2182863075406786,"gpt":0.4170764311393291,"spread":0.1987901235986505,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003860968,0.0007202197,0.0007397787,0.006894547,0.0004715568,0.001538791,0.0007600565,0.00083233,0.0007429594],"category_scores_gemma":[0.02415364,0.0001682403,0.0009807163,0.006003263,0.000361078,0.001221218,0.000757811,0.0008950296,0.0004694907],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001200505,"about_ca_system_score_gemma":0.001344352,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006069992,"about_ca_topic_score_gemma":0.006051533,"domain_scores_codex":[0.9952058,0.001634012,0.0008329981,0.0008171857,0.001181214,0.0003288465],"domain_scores_gemma":[0.9786972,0.01258335,0.00362063,0.00154002,0.003019702,0.0005391329],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008040715,0.000716246,0.835912,0.0005417802,0.0004204907,0.0004236248,0.0002679864,0.02173102,0.002042151,0.0008012626,0.007942503,0.1283969],"study_design_scores_gemma":[0.00008355798,0.0007374308,0.6946102,0.0002520751,0.0002260823,0.001045475,0.001267796,0.2847658,0.005602969,0.003548408,0.007770318,0.00008991408],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9415246,0.002500246,0.01636924,0.002237899,0.0001983041,0.0002862198,0.03477471,0.0007163283,0.001392496],"genre_scores_gemma":[0.9510968,0.0003392745,0.0166043,0.0001329847,0.0001162597,0.0001342883,0.03138074,0.00001306634,0.0001823042],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006894547,"threshold_uncertainty_score":0.020419,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2368906419","doi":"10.1186/s13040-016-0098-0","title":"Machine learning algorithms for mode-of-action classification in toxicity assessment","year":2016,"lang":"en","type":"article","venue":"BioData Mining","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":21,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"MacEwan University; University of Calgary; Alberta Health; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Computer science; Action (physics); Mode (computer interface); Machine learning; Artificial intelligence; Mode of action; Algorithm; Chemistry; Human–computer interaction","authors":[{"name":"Yile Zhang","is_ca":true},{"name":"Yau Shu Wong","is_ca":true},{"name":"Jian Deng","is_ca":true},{"name":"Cristina Antón","is_ca":true},{"name":"Stephan Gabos","is_ca":true},{"name":"Weiping Zhang","is_ca":true},{"name":"Dorothy Yu Huang","is_ca":true},{"name":"Can Jin","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08482953243657332,"gpt":0.3714903720574589,"spread":0.2866608396208856,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00284255,0.001168422,0.00143208,0.00190485,0.000412464,0.001029029,0.001369367,0.001443709,0.001507851],"category_scores_gemma":[0.00646116,0.000363161,0.001023615,0.001860035,0.0005806075,0.001039093,0.0007119712,0.00216879,0.0008474155],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007787796,"about_ca_system_score_gemma":0.0007911481,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001451706,"about_ca_topic_score_gemma":0.0008251813,"domain_scores_codex":[0.998547,0.0005572566,0.0001705674,0.0002576798,0.0003937015,0.00007379047],"domain_scores_gemma":[0.9957841,0.002788297,0.0004296815,0.0002337194,0.0007063021,0.0000578857],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001321779,0.0002308411,0.003361484,0.0004158379,0.0001998174,0.00008859761,0.000083126,0.461932,0.00562706,0.009469985,0.002850713,0.5156084],"study_design_scores_gemma":[0.000004790406,0.00004046019,0.0003569252,0.00001701131,0.00001074266,0.00002265271,0.000007472735,0.9926025,0.001230659,0.004947075,0.0007504988,0.000009178561],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007147854,0.001182267,0.9899238,0.0001882855,0.00005086805,0.00006919301,0.0001007985,0.0006904341,0.0006465438],"genre_scores_gemma":[0.2604237,0.00172499,0.734462,0.0001791093,0.0002085995,0.0006252966,0.0005907583,0.0001173774,0.001668255],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00284255,"threshold_uncertainty_score":0.01503301,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2587099845","doi":"10.1186/s13040-017-0123-y","title":"Semantics-based plausible reasoning to extend the knowledge coverage of medical knowledge bases for improved clinical decision support","year":2017,"lang":"en","type":"article","venue":"BioData Mining","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":20,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Model-based reasoning; Semantics (computer science); Semantic Web; Data science; Artificial intelligence; Information retrieval; Knowledge representation and reasoning","authors":[{"name":"Hossein Mohammadhassanzadeh","is_ca":true},{"name":"William Van Woensel","is_ca":true},{"name":"Samina Abidi","is_ca":true},{"name":"Syed Sibte Raza Abidi","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.076125745526062,"gpt":0.4277109479327042,"spread":0.3515852024066422,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01697662,0.001452508,0.001633123,0.008250455,0.001147198,0.004963693,0.003173294,0.001853533,0.003101443],"category_scores_gemma":[0.07499515,0.0008898011,0.004281442,0.005223512,0.001873847,0.009463459,0.005553761,0.002684013,0.000719651],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001723959,"about_ca_system_score_gemma":0.003641868,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004943408,"about_ca_topic_score_gemma":0.006416947,"domain_scores_codex":[0.984385,0.006653038,0.002535575,0.002038763,0.004039368,0.0003483242],"domain_scores_gemma":[0.9511688,0.03752223,0.002332457,0.004969019,0.00346496,0.0005425132],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001087628,0.001053127,0.01484704,0.002705067,0.001337317,0.003109308,0.003738897,0.3135976,0.01271594,0.1275875,0.009137814,0.5090828],"study_design_scores_gemma":[0.0001967267,0.0001543818,0.001468409,0.0003949479,0.0004105407,0.0007503456,0.0004285858,0.7074946,0.008411471,0.2658333,0.01434364,0.0001129907],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02532363,0.001327621,0.9638309,0.002332294,0.00007594311,0.0005019438,0.001729849,0.002164114,0.002713698],"genre_scores_gemma":[0.2960566,0.0008023266,0.6975414,0.0007907345,0.000111966,0.0003284332,0.003824754,0.0001389423,0.0004047717],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01697662,"threshold_uncertainty_score":0.08978194,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2232773008","doi":"10.1186/s13040-015-0078-9","title":"Iteratively refining breast cancer intrinsic subtypes in the METABRIC dataset","year":2016,"lang":"en","type":"article","venue":"BioData Mining","topic":"AI in cancer detection","field":"Computer Science","cited_by":19,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"BC Cancer Agency; Australian Research Council; Cancer Research UK","keywords":"Discriminative model; Computer science; Machine learning; Artificial intelligence; Set (abstract data type); Breast cancer; Class (philosophy); Data mining; Pattern recognition (psychology); Cancer; Medicine","authors":[{"name":"Heloisa Milioli","is_ca":false},{"name":"Renato Vimieiro","is_ca":false},{"name":"Inna Tishchenko","is_ca":false},{"name":"Carlos Riveros","is_ca":false},{"name":"Regina Berretta","is_ca":false},{"name":"Pablo Moscato","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04386414633269161,"gpt":0.2884951767383135,"spread":0.2446310304056219,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005326506,0.001024191,0.001185809,0.002721397,0.000836023,0.001352145,0.001412049,0.001045254,0.0007860505],"category_scores_gemma":[0.008282722,0.0002645479,0.00129698,0.001547761,0.0004660386,0.0004949331,0.001174288,0.001473288,0.0007205757],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009698545,"about_ca_system_score_gemma":0.001344547,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01021741,"about_ca_topic_score_gemma":0.02069567,"domain_scores_codex":[0.9981624,0.0006053101,0.0001194836,0.0006069587,0.0003241957,0.0001815556],"domain_scores_gemma":[0.9960304,0.002251121,0.0002838067,0.0006213362,0.0006894232,0.0001239575],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002450783,0.0006065761,0.3939686,0.0007914436,0.001086972,0.0005816709,0.001018774,0.1517484,0.04121358,0.002454781,0.01553118,0.3885473],"study_design_scores_gemma":[0.0002178055,0.0004860929,0.1315217,0.0001335005,0.0006065757,0.0009318055,0.0006940782,0.7963581,0.04071515,0.008584756,0.01962989,0.0001205267],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.8779627,0.001496665,0.1051237,0.0005006111,0.00004620488,0.0003090247,0.01030042,0.002293804,0.001967036],"genre_scores_gemma":[0.7035257,0.0003524054,0.2502988,0.0003176803,0.00004490453,0.0003147557,0.04347732,0.0002555877,0.001412926],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.01021741,"threshold_uncertainty_score":0.02816963,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4390605262","doi":"10.1186/s13040-023-00352-y","title":"Machine learning approaches to identify systemic lupus erythematosus in anti-nuclear antibody-positive patients using genomic data and electronic health records","year":2024,"lang":"en","type":"article","venue":"BioData Mining","topic":"Systemic Lupus Erythematosus Research","field":"Medicine","cited_by":14,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"Academia Sinica; Taichung Veterans General Hospital; National Science and Technology Council","keywords":"Logistic regression; Single-nucleotide polymorphism; Medicine; Random forest; Titer; Gradient boosting; Artificial intelligence; Medical record; Machine learning; Systemic lupus erythematosus; Internal medicine; Cohort; Support vector machine; Oncology; Immunology; Antibody; Computer science; Disease; Biology; Genetics; Genotype","authors":[{"name":"Chih-Wei Chung","is_ca":false},{"name":"Seng‐Cho T. Chou","is_ca":false},{"name":"Tzu‐Hung Hsiao","is_ca":false},{"name":"Grace Joyce Zhang","is_ca":true},{"name":"Yu‐Fang Chung","is_ca":false},{"name":"Yi‐Ming Chen","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1125995094971304,"gpt":0.3603028582297049,"spread":0.2477033487325745,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005758174,0.0006998508,0.0009383225,0.006507608,0.0003263449,0.001253757,0.0009745558,0.0008330497,0.0009517414],"category_scores_gemma":[0.01391197,0.0002592934,0.0008764535,0.002915457,0.0002405995,0.0007765198,0.0007386017,0.001006477,0.0004312788],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006092443,"about_ca_system_score_gemma":0.0007938407,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00280392,"about_ca_topic_score_gemma":0.003362061,"domain_scores_codex":[0.9969759,0.001953048,0.000242681,0.0004248713,0.000284428,0.0001190694],"domain_scores_gemma":[0.9917648,0.005722207,0.001171728,0.000424444,0.0007422444,0.0001745603],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003714406,0.0008261614,0.689024,0.0003429843,0.001043514,0.0002842181,0.0001974131,0.03840692,0.001170661,0.001292364,0.003509135,0.2635312],"study_design_scores_gemma":[0.00009345471,0.0003192978,0.1350251,0.0002569746,0.000303343,0.0003559827,0.0003855766,0.8503098,0.001290289,0.009468509,0.002145876,0.00004584575],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.66764,0.007725693,0.3035684,0.006368905,0.0002392484,0.0007203387,0.007714645,0.001228066,0.004794771],"genre_scores_gemma":[0.916407,0.0009356759,0.07857992,0.0003921633,0.0001758251,0.0002447852,0.002907893,0.00001301088,0.0003436593],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.006507608,"threshold_uncertainty_score":0.03045255,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4323050290","doi":"10.1186/s13040-023-00325-1","title":"Signature literature review reveals AHCY, DPYSL3, and NME1 as the most recurrent prognostic genes for neuroblastoma","year":2023,"lang":"en","type":"article","venue":"BioData Mining","topic":"Neuroblastoma Research and Treatments","field":"Medicine","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Neuroblastoma; Gene; Bioinformatics; Oncology; Biology; Computational biology; Medicine; Internal medicine; Genetics","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Tiziana Sanavia","is_ca":false},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04151356111928294,"gpt":0.3423840202260795,"spread":0.3008704591067966,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001444085,0.0003784365,0.001129156,0.007414225,0.0004296844,0.001048123,0.000642575,0.0006515063,0.003217909],"category_scores_gemma":[0.005771402,0.0001513926,0.00149274,0.008475335,0.0004724003,0.000810843,0.0004600995,0.0005363362,0.0006962648],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008394192,"about_ca_system_score_gemma":0.003346692,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002977475,"about_ca_topic_score_gemma":0.00649694,"domain_scores_codex":[0.9991096,0.0001424353,0.0003113509,0.000159896,0.0002246579,0.00005211296],"domain_scores_gemma":[0.9957755,0.002509169,0.0005934481,0.0001356608,0.0008736047,0.000112718],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"systematic_review","study_design_scores_codex":[0.001111546,0.00008469835,0.03727001,0.1447016,0.003056256,0.001745465,0.0005744621,0.0006862998,0.005826406,0.002184697,0.05263094,0.7501276],"study_design_scores_gemma":[0.000123452,0.000441635,0.1287396,0.1080076,0.02713317,0.008565511,0.001221266,0.0008372271,0.007433284,0.003693613,0.7136644,0.0001392374],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.01232905,0.9779295,0.0008149726,0.002756697,0.0005655652,0.00003887575,0.003187873,0.00004681085,0.00233069],"genre_scores_gemma":[0.0613768,0.9289039,0.001729503,0.001900004,0.0005076348,0.00005867295,0.004610382,0.00002303438,0.0008900577],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.007414225,"threshold_uncertainty_score":0.01076496,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2069849680","doi":"10.1186/1756-0381-6-8","title":"Prediction of Drosophila melanogaster gene function using Support Vector Machines","year":2013,"lang":"en","type":"article","venue":"BioData Mining","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; University of Toronto; University of Washington","keywords":"Drosophila melanogaster; Gene; Genome; Biology; Computational biology; Support vector machine; Gene prediction; Genome project; Microarray analysis techniques; Melanogaster; Gene Annotation; Genetics; Annotation; Function (biology); Computer science; Artificial intelligence; Gene expression","authors":[{"name":"Nicholas Mitsakakis","is_ca":true},{"name":"Zak Razak","is_ca":true},{"name":"Michael Escobar","is_ca":true},{"name":"J. Timothy Westwood","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02614048323694971,"gpt":0.224926785095025,"spread":0.1987863018580753,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009452448,0.0008992425,0.0005671892,0.001140172,0.0002009442,0.0004975952,0.0005206845,0.0005972394,0.001034269],"category_scores_gemma":[0.001890728,0.0001429937,0.0007066204,0.0006286465,0.0001473709,0.0003019975,0.000213646,0.0005242079,0.0006350786],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004045385,"about_ca_system_score_gemma":0.0004184828,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002235426,"about_ca_topic_score_gemma":0.001052873,"domain_scores_codex":[0.9995376,0.0001105233,0.00004412385,0.0001627011,0.00009895142,0.0000462541],"domain_scores_gemma":[0.9990143,0.0005876968,0.00008360802,0.00003968486,0.0002428487,0.00003187431],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009248426,0.0004270479,0.04427415,0.0005039807,0.0003158716,0.0003590936,0.00009683138,0.3917468,0.03585013,0.001119928,0.006326701,0.5180546],"study_design_scores_gemma":[0.00001490096,0.00007198588,0.004235094,0.00001254835,0.00001546971,0.00005330037,0.00001734499,0.9893956,0.004981786,0.0007233175,0.0004722327,0.000006455576],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6397695,0.001984334,0.3477588,0.0003214238,0.0001158813,0.0001368816,0.003480259,0.005048724,0.001384261],"genre_scores_gemma":[0.9018568,0.0002553656,0.09251738,0.00006248993,0.00003578119,0.0001199871,0.004411664,0.0000425245,0.0006979241],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002235426,"threshold_uncertainty_score":0.004998982,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2222833576","doi":"10.1186/s13040-015-0062-4","title":"Functional dyadicity and heterophilicity of gene-gene interactions in statistical epistasis networks","year":2015,"lang":"en","type":"article","venue":"BioData Mining","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Memorial University of Newfoundland","funders":"National Institute of Allergy and Infectious Diseases; U.S. National Library of Medicine; National Institute of General Medical Sciences; National Cancer Institute; National Institutes of Health","keywords":"Epistasis; Context (archaeology); Computational biology; Biology; Genetic association; Gene; Gene interaction; Gene ontology; Genetics; Computer science; Genotype; Single-nucleotide polymorphism; Gene expression","authors":[{"name":"Ting Hu","is_ca":true},{"name":"Angeline S. Andrew","is_ca":false},{"name":"Margaret R. Karagas","is_ca":false},{"name":"Jason H. Moore","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04534004385984268,"gpt":0.2740099323237019,"spread":0.2286698884638592,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001397959,0.0003070596,0.0004356131,0.002772582,0.0004942809,0.0008968103,0.0004760945,0.0004212188,0.0009503202],"category_scores_gemma":[0.007205646,0.000185863,0.0006888086,0.001871794,0.001060138,0.001011963,0.0007782954,0.0004955595,0.0001052873],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007713767,"about_ca_system_score_gemma":0.0004042275,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002648305,"about_ca_topic_score_gemma":0.003106476,"domain_scores_codex":[0.9990045,0.0004362652,0.00005698505,0.000309423,0.0001274074,0.000065376],"domain_scores_gemma":[0.9929141,0.004725415,0.001449243,0.0004045986,0.0002842898,0.0002223314],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000555155,0.0002654022,0.3569558,0.0007399381,0.001108794,0.001028739,0.001620265,0.3640315,0.04044947,0.1387342,0.002473111,0.09203753],"study_design_scores_gemma":[0.00002323705,0.00009496093,0.1014714,0.00003212899,0.0001935744,0.0005746216,0.000357671,0.7661652,0.002989843,0.1263435,0.001716557,0.00003734574],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7110706,0.0006661539,0.285111,0.0003381478,0.00001038472,0.00005233418,0.0007608152,0.0002140273,0.001776515],"genre_scores_gemma":[0.9880144,0.0001272519,0.01130672,0.00002490232,0.00001172207,0.00004078366,0.0003003288,0.0000119055,0.0001619099],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002772582,"threshold_uncertainty_score":0.007393181,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3101574558","doi":"10.1186/s13040-016-0108-2","title":"ProtNN: fast and accurate protein 3D-structure classification in structural and topological space","year":2016,"lang":"en","type":"article","venue":"BioData Mining","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":11,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Space (punctuation); Topology (electrical circuits); Topological space; Data mining; Pattern recognition (psychology); Artificial intelligence; Mathematics; Pure mathematics; Combinatorics","authors":[{"name":"Wajdi Dhifli","is_ca":true},{"name":"Abdoulaye Baniré Diallo","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01616966876460837,"gpt":0.2731470377325991,"spread":0.2569773689679907,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008003939,0.001739354,0.001458419,0.003105836,0.0009552904,0.001831558,0.002406409,0.001392877,0.005327557],"category_scores_gemma":[0.002512963,0.0005810703,0.001283871,0.00243748,0.0004342344,0.002169662,0.002042857,0.0009704428,0.005379353],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001137383,"about_ca_system_score_gemma":0.001137044,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006282649,"about_ca_topic_score_gemma":0.01044758,"domain_scores_codex":[0.9988723,0.0001013993,0.00007664303,0.0003424808,0.0005195414,0.00008751272],"domain_scores_gemma":[0.9988887,0.0002186263,0.0001773113,0.0003008966,0.0003352877,0.00007920448],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000797521,0.0002945705,0.01209955,0.001139891,0.0002501155,0.0003067714,0.0001846139,0.03555936,0.03447607,0.004462589,0.1338115,0.7766175],"study_design_scores_gemma":[0.00008267788,0.0001476598,0.004551818,0.00005792448,0.00004897255,0.0005932541,0.0001286824,0.942075,0.01951972,0.006628362,0.02610506,0.00006087575],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.09680919,0.003267456,0.7183175,0.0007931475,0.0004997831,0.0005699092,0.02745098,0.1460099,0.006282169],"genre_scores_gemma":[0.1930404,0.0009587271,0.732365,0.0002788589,0.0001005591,0.000549248,0.0640672,0.002080639,0.006559363],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006282649,"threshold_uncertainty_score":0.01782244,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4406160197","doi":"10.1186/s13040-024-00412-x","title":"The Venus score for the assessment of the quality and trustworthiness of biomedical datasets","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Artificial Intelligence in Healthcare and Education","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"HORIZON EUROPE European Research Council; Ministero dell'Università e della Ricerca; HORIZON EUROPE Framework Programme; Dipartimenti di Eccellenza; European Commission; Alexander von Humboldt-Stiftung","keywords":"Computer science; Quality (philosophy); Informatics; Usability; Data science; Data quality; Data mining; Artificial intelligence","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Alessandro Fabris","is_ca":false},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3350027862965513,"gpt":0.5494247029763654,"spread":0.214421916679814,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02848014,0.001287313,0.001599048,0.02318514,0.002062644,0.004844851,0.001644428,0.002081063,0.005876746],"category_scores_gemma":[0.2102576,0.000353339,0.002226879,0.01611891,0.002680213,0.005166089,0.005121651,0.00178713,0.001872723],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001917384,"about_ca_system_score_gemma":0.002599001,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002504474,"about_ca_topic_score_gemma":0.004197825,"domain_scores_codex":[0.9474834,0.01993802,0.009596187,0.004265033,0.01730839,0.001409026],"domain_scores_gemma":[0.7859559,0.151469,0.01669301,0.01222613,0.02853164,0.005124252],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.002194742,0.0003810025,0.4865975,0.006190182,0.002899563,0.0006445413,0.004277576,0.01419181,0.005135243,0.0374819,0.07453058,0.3654754],"study_design_scores_gemma":[0.0008650593,0.002713442,0.4484774,0.003635588,0.001867705,0.003393948,0.007798791,0.1352389,0.0177666,0.184291,0.1922736,0.001677967],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.5358184,0.0106261,0.3203368,0.004180203,0.001846484,0.00387387,0.05481544,0.006384134,0.06211862],"genre_scores_gemma":[0.8075184,0.001124446,0.1591123,0.0006344563,0.0002591086,0.003054981,0.02509042,0.0009070197,0.002298862],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9715198,"threshold_uncertainty_score":0.1506192,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2736939530","doi":"10.1186/s13040-017-0145-5","title":"Discovery and replication of SNP-SNP interactions for quantitative lipid traits in over 60,000 individuals","year":2017,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"U.S. National Library of Medicine; National Center for Advancing Translational Sciences; National Human Genome Research Institute; National Heart, Lung, and Blood Institute; National Eye Institute; National Institute on Aging; Medical Research Council; British Heart Foundation; European Hematology Association; National Institute of General Medical Sciences; National Institute for Health and Care Research; Broad Institute; Harvard University; National Institutes of Health; U.S. Department of Health and Human Services","keywords":"Replication (statistics); SNP; Single-nucleotide polymorphism; Computational biology; Biology; Pairwise comparison; Genetics; Bioinformatics; Gene; Computer science; Artificial intelligence; Genotype","authors":[{"name":"Emily Holzinger","is_ca":false},{"name":"Shefali S. Verma","is_ca":false},{"name":"Carrie Moore","is_ca":false},{"name":"Molly A. Hall","is_ca":false},{"name":"Rishika De","is_ca":false},{"name":"Diane Gilbert‐Diamond","is_ca":false},{"name":"Matthew B. Lanktree","is_ca":true},{"name":"Nathan Pankratz","is_ca":false},{"name":"Antoinette Amuzu","is_ca":false},{"name":"Amber Burt","is_ca":false},{"name":"Caroline Dale","is_ca":false},{"name":"Scott Dudek","is_ca":false},{"name":"Clement E. Furlong","is_ca":false},{"name":"Tom R. Gaunt","is_ca":false},{"name":"Daniel Seung Kim","is_ca":false},{"name":"Helene Riess","is_ca":false},{"name":"Suthesh Sivapalaratnam","is_ca":false},{"name":"Vinicius Tragante","is_ca":false},{"name":"Erik P.A. van Iperen","is_ca":false},{"name":"Ariel Brautbar","is_ca":false},{"name":"David Carrell","is_ca":false},{"name":"David R. Crosslin","is_ca":false},{"name":"Gail P. Jarvik","is_ca":false},{"name":"Helena Kuivaniemi","is_ca":false},{"name":"Iftikhar J. Kullo","is_ca":false},{"name":"Eric B. Larson","is_ca":false},{"name":"Laura J. Rasmussen‐Torvik","is_ca":false},{"name":"Gerard Tromp","is_ca":false},{"name":"Jens Baumert","is_ca":false},{"name":"Karen J. Cruickshanks","is_ca":false},{"name":"Martin Farrall","is_ca":false},{"name":"Aroon D. Hingorani","is_ca":false},{"name":"G. Kees Hovingh","is_ca":false},{"name":"Marcus E. Kleber","is_ca":false},{"name":"Barbara E.K. Klein","is_ca":false},{"name":"Ronald Klein","is_ca":false},{"name":"Wolfgang Köenig","is_ca":false},{"name":"Leslie A. Lange","is_ca":false},{"name":"Winfried März","is_ca":false},{"name":"Kari E. North","is_ca":false},{"name":"N. Charlotte Onland‐Moret","is_ca":false},{"name":"Alex P. Reiner","is_ca":false},{"name":"Philippa J. Talmud","is_ca":false},{"name":"Yvonne T. van der Schouw","is_ca":false},{"name":"James G. Wilson","is_ca":false},{"name":"Mika Kivimäki","is_ca":false},{"name":"Meena Kumari","is_ca":false},{"name":"Jason H. Moore","is_ca":false},{"name":"Fotios Drenos","is_ca":false},{"name":"Folkert W. Asselbergs","is_ca":false},{"name":"Brendan J. Keating","is_ca":false},{"name":"Marylyn D. Ritchie","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.09098401409320957,"gpt":0.3887127870929476,"spread":0.297728772999738,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02935558,0.001286543,0.002107687,0.001838289,0.001737067,0.001667108,0.001814184,0.001183825,0.002996011],"category_scores_gemma":[0.05024788,0.0008713101,0.003603137,0.003015279,0.0008289879,0.0006421278,0.002097325,0.001557965,0.0009508346],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005196262,"about_ca_system_score_gemma":0.002380816,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009470483,"about_ca_topic_score_gemma":0.01328111,"domain_scores_codex":[0.9847853,0.004588369,0.001751736,0.005903948,0.002052219,0.000918422],"domain_scores_gemma":[0.9700508,0.01434007,0.002219582,0.01080996,0.001892746,0.0006868132],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.002171106,0.0006412789,0.8570519,0.0006341978,0.007182675,0.002634949,0.001409756,0.00715772,0.04399827,0.001621433,0.005043622,0.07045312],"study_design_scores_gemma":[0.001520303,0.001604005,0.9076685,0.0001322665,0.007191048,0.002632628,0.000405197,0.03126699,0.02288746,0.0062357,0.01823408,0.0002217951],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8617204,0.001562641,0.1162179,0.0003806874,0.0002133034,0.0009374394,0.01593659,0.001523643,0.001507402],"genre_scores_gemma":[0.9154226,0.0002572527,0.06206744,0.0001832175,0.00005371205,0.001200914,0.01946892,0.0002926618,0.001053294],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02935558,"threshold_uncertainty_score":0.1552491,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3141242658","doi":"10.1186/s13040-021-00249-8","title":"Prescreening and treatment of aortic dissection through an analysis of infinite-dimension data","year":2021,"lang":"en","type":"article","venue":"BioData Mining","topic":"Aortic Disease and Treatment Approaches","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Prince Edward Island; University of Waterloo","funders":"Shanghai Jiao Tong University; Shanghai Municipal Health Bureau; National Natural Science Foundation of China; School of Medicine, Shanghai Jiao Tong University; Comanche Nation","keywords":"Aortic dissection; Medicine; Cardiology; Blood pressure; Internal medicine; Mortality rate; Disease; Incidence (geometry); Medical diagnosis; Psychological intervention; Dissection (medical); Intensive care medicine; Emergency medicine; Surgery; Radiology; Aorta","authors":[{"name":"Peng Qiu","is_ca":true},{"name":"Yixuan Li","is_ca":true},{"name":"Kai Liu","is_ca":true},{"name":"Jinbao Qin","is_ca":false},{"name":"Kaichuang Ye","is_ca":false},{"name":"Tao Chen","is_ca":true},{"name":"Xinwu Lu","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1588053887997506,"gpt":0.3612328588707938,"spread":0.2024274700710433,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001944164,0.0006215444,0.0005936485,0.002772936,0.0003367876,0.0009257033,0.0005973356,0.000564115,0.0007886972],"category_scores_gemma":[0.006086314,0.0001757613,0.0007290117,0.0008982123,0.000358063,0.0006720597,0.0005234827,0.0005540425,0.0002301597],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005216574,"about_ca_system_score_gemma":0.0007221454,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003148998,"about_ca_topic_score_gemma":0.003490936,"domain_scores_codex":[0.9994222,0.0001698023,0.00007773736,0.0001481689,0.0001188735,0.00006324338],"domain_scores_gemma":[0.9963254,0.002378467,0.0005540192,0.000252941,0.000363079,0.0001260213],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0007798107,0.0007633328,0.4657134,0.0002334368,0.0002882444,0.000831411,0.0002896063,0.2694809,0.006551595,0.001785424,0.002347653,0.2509351],"study_design_scores_gemma":[0.00000982963,0.000173871,0.05756973,0.00003274714,0.00004019167,0.0002082032,0.00008705495,0.9378871,0.001578833,0.001774103,0.0006136315,0.00002472001],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7928641,0.0008074119,0.2020059,0.0007877876,0.00006107258,0.0001198712,0.001570935,0.0006181182,0.001164907],"genre_scores_gemma":[0.9583493,0.0002116561,0.0395504,0.00004518355,0.00003242757,0.00005138016,0.001432987,0.00001529738,0.0003113158],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003148998,"threshold_uncertainty_score":0.01028186,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4321598956","doi":"10.1186/s13040-023-00326-0","title":"Ten simple rules for providing bioinformatics support within a hospital","year":2023,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Simple (philosophy); Computer science; Data science; Data mining; Bioinformatics; Biology","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0376802126752831,"gpt":0.3102693955737785,"spread":0.2725891828984954,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02098631,0.001352165,0.0009724489,0.003554346,0.003860559,0.008221486,0.004431389,0.006814508,0.009414572],"category_scores_gemma":[0.06739782,0.001278537,0.001530556,0.002591742,0.004897421,0.009127513,0.005298252,0.005162581,0.006127647],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002220355,"about_ca_system_score_gemma":0.008702688,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01092873,"about_ca_topic_score_gemma":0.01621437,"domain_scores_codex":[0.97478,0.009957201,0.004974379,0.001985525,0.006619441,0.001683378],"domain_scores_gemma":[0.9330032,0.03461613,0.006068912,0.006644912,0.01496507,0.004701682],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0005951379,0.001193906,0.02633951,0.001593041,0.0002096067,0.002637265,0.004991028,0.02750521,0.004521442,0.4652186,0.1638903,0.3013049],"study_design_scores_gemma":[0.0005900568,0.0006044069,0.006674214,0.00222286,0.0003847413,0.001901637,0.005022371,0.09509418,0.009023091,0.479217,0.3986027,0.0006627478],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02875288,0.0007073494,0.8432429,0.04621257,0.001936582,0.003046646,0.001448578,0.008860725,0.06579158],"genre_scores_gemma":[0.07127856,0.0003986585,0.915807,0.003627015,0.0001943295,0.000825625,0.0008023154,0.0003168201,0.006749678],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02098631,"threshold_uncertainty_score":0.1109875,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2101279094","doi":"10.1186/1756-0381-7-17","title":"Computational genetics analysis of grey matter density in Alzheimer’s disease","year":2014,"lang":"en","type":"article","venue":"BioData Mining","topic":"Olfactory and Sensory Function Studies","field":"Neuroscience","cited_by":9,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute on Aging; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; National Institutes of Health; Genentech; U.S. National Library of Medicine; IXICO; National Cancer Institute; Servier; Eisai; Northern California Institute for Research and Education; University of California, San Diego; Pfizer; Biogen; BioClinica; F. Hoffmann-La Roche; Synarc; University of Southern California; Medpace; Novartis Pharmaceuticals Corporation; Dartmouth College; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Alzheimer's Disease Neuroimaging Initiative; National Center for Advancing Translational Sciences; Meso Scale Diagnostics; Alzheimer's Association; Foundation for the National Institutes of Health","keywords":"Grey matter; Disease; Computer science; Data science; Computational biology; Biology; Medicine; Pathology","authors":[{"name":"Amanda Zieselman","is_ca":false},{"name":"Jonathan Fisher","is_ca":false},{"name":"Ting Hu","is_ca":false},{"name":"Peter C. Andrews","is_ca":false},{"name":"Casey S. Greene","is_ca":false},{"name":"Li Shen","is_ca":false},{"name":"Andrew J. Saykin","is_ca":false},{"name":"Jason H. Moore","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1900964567775927,"gpt":0.3033707888264548,"spread":0.1132743320488621,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001504762,0.0005188652,0.0006442057,0.002027098,0.000425242,0.0006425465,0.0009371039,0.0006408201,0.001343573],"category_scores_gemma":[0.005407583,0.0002795961,0.001491257,0.001059577,0.000367749,0.0002558978,0.0005557972,0.0006379736,0.0001627448],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009060054,"about_ca_system_score_gemma":0.001379966,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01972437,"about_ca_topic_score_gemma":0.02175005,"domain_scores_codex":[0.9996448,0.000177192,0.00002299325,0.00008677536,0.00003910388,0.00002919253],"domain_scores_gemma":[0.9960822,0.003409738,0.0001641148,0.0001111021,0.0001375207,0.00009534222],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","study_design_scores_codex":[0.0008590904,0.0004058181,0.1341062,0.000220304,0.001704006,0.0005946978,0.0001359137,0.7861074,0.002814981,0.004500146,0.004396481,0.06415489],"study_design_scores_gemma":[0.00004228361,0.00003379487,0.008567778,0.000006238189,0.00007468204,0.00005892794,0.00002315261,0.9846427,0.0002917424,0.005974486,0.0002773473,0.000006937415],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8562858,0.0009432271,0.1335282,0.002040318,0.00008192895,0.00008402146,0.003648235,0.00203135,0.001356813],"genre_scores_gemma":[0.9249869,0.0001481845,0.07085721,0.0002348969,0.00004387165,0.00007530688,0.00312525,0.00007748864,0.0004508905],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01972437,"threshold_uncertainty_score":0.03921914,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3215710945","doi":"10.1186/s13040-021-00281-8","title":"Development of glaucoma predictive model and risk factors assessment based on supervised models","year":2021,"lang":"en","type":"article","venue":"BioData Mining","topic":"Retinal Imaging and Analysis","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Glaucoma; Machine learning; Artificial intelligence; Data science; Risk analysis (engineering); Medicine; Ophthalmology","authors":[{"name":"Mahyar Sharifi","is_ca":false},{"name":"Toktam Khatibi","is_ca":false},{"name":"Mohammad Hassan Emamian","is_ca":false},{"name":"Somayeh Sadat","is_ca":true},{"name":"Hassan Hashemi","is_ca":false},{"name":"Akbar Fotouhi","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05509305354175464,"gpt":0.3059507429795755,"spread":0.2508576894378208,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00142654,0.0007183402,0.0008330918,0.001304622,0.0003537263,0.000787708,0.001142554,0.0006513964,0.00117783],"category_scores_gemma":[0.003290062,0.0003071167,0.001129514,0.000569972,0.0002151338,0.0008191183,0.0005796239,0.0009260851,0.000383031],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005192049,"about_ca_system_score_gemma":0.001183498,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007316375,"about_ca_topic_score_gemma":0.005520941,"domain_scores_codex":[0.9994029,0.0001621062,0.00004853719,0.0001647108,0.0001579642,0.00006388593],"domain_scores_gemma":[0.9988939,0.0004646003,0.0001188328,0.00006447873,0.0004151081,0.0000430876],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002117416,0.0004035885,0.05035126,0.0001832972,0.0003518265,0.0003522364,0.0001754497,0.6625355,0.002981833,0.005085335,0.005277843,0.27209],"study_design_scores_gemma":[0.000004885473,0.00003222561,0.001796001,0.0000150627,0.00002578553,0.00003697596,0.00001333179,0.9961011,0.0003055394,0.001313227,0.0003492044,0.000006667652],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1171857,0.0009363557,0.8764417,0.0006300721,0.0001171386,0.0002199846,0.0006652683,0.001072099,0.00273173],"genre_scores_gemma":[0.8676763,0.0007224717,0.1268944,0.00017827,0.0001744233,0.0004017408,0.001258466,0.00004378655,0.002650176],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.007316375,"threshold_uncertainty_score":0.01454759,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2155858762","doi":"10.1186/1756-0381-4-22","title":"Detection of putative new mutacins by bioinformatic analysis using available web tools","year":2011,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université Laval","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Bacteriocin; Computational biology; Context (archaeology); Identification (biology); Genome; Biology; Drug discovery; Whole genome sequencing; Computer science; Genetics; Gene; Bioinformatics; Bacteria","authors":[{"name":"Guillaume Nicolas","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06311613741850325,"gpt":0.2527864325412549,"spread":0.1896702951227516,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004817873,0.0007384148,0.0006830404,0.002135197,0.0004163849,0.0009353863,0.0004641836,0.0003781143,0.002424529],"category_scores_gemma":[0.001067236,0.0002116156,0.0007400464,0.001309248,0.0002176644,0.0006991329,0.0004438385,0.0004955912,0.0007763199],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002900192,"about_ca_system_score_gemma":0.0003516751,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.000278276,"about_ca_topic_score_gemma":0.0004530542,"domain_scores_codex":[0.9998073,0.00003402587,0.0000288388,0.00003824902,0.0000730695,0.00001857034],"domain_scores_gemma":[0.999481,0.0002034565,0.000125556,0.00003668366,0.00007629369,0.00007707995],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","study_design_scores_codex":[0.002277008,0.0006453522,0.02717984,0.002078881,0.0003016127,0.002063896,0.0003427201,0.003974286,0.8302581,0.001992469,0.001409841,0.1274761],"study_design_scores_gemma":[0.0002960618,0.001287009,0.1273912,0.0002824102,0.0009485668,0.007381034,0.000910189,0.1498511,0.6677952,0.008531883,0.03515875,0.0001664927],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8880488,0.003336117,0.09230833,0.0005597875,0.00005235201,0.0003314066,0.007075575,0.004933505,0.003354105],"genre_scores_gemma":[0.7312779,0.00154365,0.2416354,0.0002228949,0.00004344411,0.0003565066,0.02269402,0.0004166081,0.001809706],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002424529,"threshold_uncertainty_score":0.008110881,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2136227372","doi":"10.1186/s13040-015-0056-2","title":"The role of visualization and 3-D printing in biological data mining","year":2015,"lang":"en","type":"article","venue":"BioData Mining","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute of General Medical Sciences; National Institute on Aging; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; National Institutes of Health; Genentech; U.S. National Library of Medicine; IXICO; Servier; Eisai; Northern California Institute for Research and Education; University of California, San Diego; Pfizer; Biogen; BioClinica; F. Hoffmann-La Roche; Synarc; University of Southern California; Medpace; Novartis Pharmaceuticals Corporation; Dartmouth College; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Alzheimer's Disease Neuroimaging Initiative; National Center for Advancing Translational Sciences; Meso Scale Diagnostics; Alzheimer's Association; Foundation for the National Institutes of Health","keywords":"Visualization; Data science; Computer science; Biological network; Biological data; Data mining; Endophenotype; Data visualization; Artificial intelligence; Machine learning; Bioinformatics; Biology; Neuroscience","authors":[{"name":"Talia Weiss","is_ca":false},{"name":"Amanda Zieselman","is_ca":false},{"name":"Douglas Hill","is_ca":false},{"name":"Solomon Diamond","is_ca":false},{"name":"Li Shen","is_ca":false},{"name":"Andrew J. Saykin","is_ca":false},{"name":"Jason H. Moore","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1481506632125918,"gpt":0.3576323327334887,"spread":0.2094816695208969,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00830434,0.001289129,0.001015529,0.003331418,0.000833193,0.007140202,0.001885153,0.001682023,0.004777777],"category_scores_gemma":[0.02736192,0.001241936,0.002165853,0.002841523,0.002527691,0.003897758,0.003773151,0.002389429,0.001123498],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001180981,"about_ca_system_score_gemma":0.001003872,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001670494,"about_ca_topic_score_gemma":0.0009673177,"domain_scores_codex":[0.9960742,0.00225906,0.0003423764,0.000340272,0.0008902404,0.00009394714],"domain_scores_gemma":[0.9638945,0.02832261,0.001304566,0.003827231,0.002072302,0.0005788169],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000885993,0.0002238148,0.01438052,0.002831204,0.0006092509,0.001632867,0.004832557,0.1291347,0.03749739,0.1668704,0.02001946,0.6210817],"study_design_scores_gemma":[0.0002069044,0.0003429048,0.007409404,0.001059962,0.0003004881,0.00296186,0.001156751,0.5470243,0.06341235,0.2577203,0.1179113,0.0004936011],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01310343,0.002550047,0.9709991,0.003524429,0.0002323094,0.0001014747,0.0005037611,0.004883947,0.004101506],"genre_scores_gemma":[0.1612792,0.003901889,0.831645,0.0005107058,0.0001898013,0.0002494962,0.0004324673,0.0007851042,0.001006371],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00830434,"threshold_uncertainty_score":0.04391807,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4414531239","doi":"10.1186/s13040-025-00480-7","title":"Temporal phenotyping and prognostic stratification of patients with sepsis through longitudinal clustering","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Time Series Analysis and Forecasting","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Cluster analysis; Multivariate statistics; Sepsis; Covariate; Silhouette; Disease; Biobank; Multivariate analysis; Metric (unit)","authors":[{"name":"Patrizia Ribino","is_ca":false},{"name":"Maria Mannone","is_ca":false},{"name":"Claudia Di Napoli","is_ca":false},{"name":"Giovanni Paragliola","is_ca":false},{"name":"Davide Chicco","is_ca":true},{"name":"Francesca Gasparini","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0254430725212012,"gpt":0.2456228539031261,"spread":0.2201797813819249,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00256132,0.0005546821,0.0006200995,0.001632908,0.0004619719,0.0007556882,0.0006678177,0.0005402258,0.0006441487],"category_scores_gemma":[0.006138397,0.0002224755,0.0008220017,0.001122355,0.0002282824,0.0004983079,0.0008932034,0.0007391527,0.0003210494],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005530801,"about_ca_system_score_gemma":0.0009460476,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007898129,"about_ca_topic_score_gemma":0.006272862,"domain_scores_codex":[0.9992473,0.0003297778,0.00005904696,0.0001867906,0.00009123098,0.00008584542],"domain_scores_gemma":[0.997811,0.0007549901,0.000465429,0.0003220681,0.0004594142,0.0001871484],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001956486,0.0004347763,0.6724594,0.0001592169,0.0006392748,0.0004512558,0.0007594678,0.1592292,0.007390224,0.002462703,0.005472742,0.1485851],"study_design_scores_gemma":[0.0000379194,0.0002105377,0.083908,0.00004953392,0.0001644686,0.0002663279,0.0003071054,0.907019,0.002124066,0.004121993,0.001720292,0.00007073064],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8180128,0.001537145,0.1761593,0.0008930718,0.0001017874,0.0001370962,0.001612761,0.0005501703,0.0009957852],"genre_scores_gemma":[0.96808,0.0003297436,0.02916596,0.00006747918,0.0000550499,0.0000694931,0.001736856,0.00003443933,0.0004609162],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.007898129,"threshold_uncertainty_score":0.01570427,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4307995431","doi":"10.1186/s13040-022-00312-y","title":"Towards a potential pan-cancer prognostic signature for gene expression based on probesets and ensemble machine learning","year":2022,"lang":"en","type":"article","venue":"BioData Mining","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Krembil Foundation; University of Toronto","funders":"","keywords":"Signature (topology); Gene signature; Cancer; Gene; Computational biology; Random forest; Relevance (law); Microarray analysis techniques; Biology; Microarray; Bioinformatics; Computer science; Gene expression; Machine learning; Genetics; Mathematics","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Abbas Alameer","is_ca":false},{"name":"Sara Rahmati","is_ca":true},{"name":"Giuseppe Jurman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01260455096746129,"gpt":0.24221652434108,"spread":0.2296119733736187,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001508969,0.0009072078,0.001170957,0.002574936,0.0003105898,0.0007368958,0.0007202465,0.000660732,0.0007734122],"category_scores_gemma":[0.002984186,0.0002054372,0.000917957,0.0023968,0.0003349185,0.0009391695,0.0007079436,0.0007055216,0.0003649435],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003976185,"about_ca_system_score_gemma":0.0006056686,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001363872,"about_ca_topic_score_gemma":0.001575742,"domain_scores_codex":[0.9990906,0.0002551339,0.00007146675,0.0002525987,0.0002089038,0.0001213115],"domain_scores_gemma":[0.9990565,0.0003701093,0.00015193,0.0001199446,0.0002443864,0.00005712709],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001243475,0.0003391876,0.08429143,0.0004684147,0.0005891087,0.0006127917,0.0002051615,0.1844952,0.0880933,0.004769172,0.005282061,0.6296106],"study_design_scores_gemma":[0.00004264307,0.0003438403,0.01599397,0.00003825621,0.0002220457,0.0003549658,0.00006464587,0.946022,0.0233554,0.009881041,0.003629995,0.00005112081],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2493807,0.001907426,0.7415149,0.0005200373,0.0001298557,0.0001550078,0.002289327,0.002626309,0.00147641],"genre_scores_gemma":[0.8065537,0.0005555346,0.1863281,0.0002379022,0.0001074541,0.0002303161,0.00497671,0.00008935136,0.0009209712],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002574936,"threshold_uncertainty_score":0.007980287,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4391353343","doi":"10.1186/s13040-024-00355-3","title":"Revealing third-order interactions through the integration of machine learning and entropy methods in genomic studies","year":2024,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research; Genentech; IXICO; H. Lundbeck A/S; Servier; National Institutes of Health; Türkiye Bilimsel ve Teknolojik Araştırma Kurumu; Eisai; Pfizer; Novartis Pharmaceuticals Corporation; U.S. Department of Defense; Meso Scale Diagnostics; Northern California Institute for Research and Education; F. Hoffmann-La Roche; University of Southern California; BioClinica; Bristol-Myers Squibb; Eli Lilly and Company; Biogen","keywords":"Genome-wide association study; Computer science; Epistasis; Single-nucleotide polymorphism; Genetic association; SNP; Computational biology; Artificial intelligence; Data mining; Machine learning; Biology; Genetics; Genotype; Gene","authors":[{"name":"Burcu Yaldız","is_ca":false},{"name":"Onur Erdoğan","is_ca":false},{"name":"Sevda Rafatov","is_ca":false},{"name":"Cem İyigün","is_ca":false},{"name":"Yeşim Aydın Son","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07409299352930675,"gpt":0.4222588802548448,"spread":0.348165886725538,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004751988,0.0009995464,0.0009977149,0.003199466,0.0005365888,0.001416312,0.0009349341,0.0005932856,0.001225916],"category_scores_gemma":[0.009189226,0.0003515731,0.002625103,0.001846935,0.0007328783,0.001085745,0.001565625,0.001172884,0.000315994],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005602583,"about_ca_system_score_gemma":0.001145656,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002529044,"about_ca_topic_score_gemma":0.002865958,"domain_scores_codex":[0.9979101,0.001122938,0.0001136124,0.0003581948,0.0003935227,0.0001016018],"domain_scores_gemma":[0.9922345,0.006231718,0.000507935,0.000528869,0.0003473309,0.0001497438],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005059151,0.0003707432,0.07380475,0.0006606018,0.001365098,0.001042186,0.0006348251,0.5083421,0.02719044,0.04282587,0.002417788,0.3408397],"study_design_scores_gemma":[0.00001597629,0.00006202018,0.009322106,0.00002640014,0.0001037,0.0001261832,0.00003865602,0.9427505,0.003532515,0.04255722,0.001415856,0.00004884711],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03914229,0.0004638336,0.9583568,0.0001868154,0.00002398898,0.00005651937,0.0003275497,0.000790838,0.0006514255],"genre_scores_gemma":[0.500574,0.0005707212,0.4959712,0.0001617997,0.00008948391,0.0003221109,0.001405871,0.0002166762,0.0006880604],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004751988,"threshold_uncertainty_score":0.02513123,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4402164248","doi":"10.1186/s13040-024-00380-2","title":"Seven quick tips for gene-focused computational pangenomic analysis","year":2024,"lang":"en","type":"article","venue":"BioData Mining","topic":"Cell Image Analysis Techniques","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"Università degli Studi di Parma; Università degli Studi di Trento","keywords":"Computer science; Data science; Computational biology; Data mining; Biology","authors":[{"name":"Vincenzo Bonnici","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02125871234764549,"gpt":0.2961630698224296,"spread":0.2749043574747841,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009843729,0.004308954,0.002011352,0.005284065,0.001980755,0.00697786,0.00599969,0.005123996,0.0438988],"category_scores_gemma":[0.09296288,0.002868674,0.002420441,0.004230991,0.002585495,0.01173246,0.005622878,0.01492774,0.04970097],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00133926,"about_ca_system_score_gemma":0.002344545,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001144494,"about_ca_topic_score_gemma":0.002274526,"domain_scores_codex":[0.9915909,0.002874961,0.0009465971,0.0007461819,0.003393585,0.0004477288],"domain_scores_gemma":[0.9395707,0.03168001,0.001839306,0.007046137,0.0172603,0.002603615],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0004723371,0.0002377065,0.001592265,0.001933622,0.0001947543,0.001237389,0.0007083174,0.004087774,0.009503412,0.02364308,0.5675443,0.3888451],"study_design_scores_gemma":[0.0002971259,0.0002160578,0.001532909,0.001757861,0.0001507607,0.002030245,0.0008026191,0.0246277,0.01955624,0.1883968,0.7601055,0.0005261191],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001872955,0.006532396,0.9089752,0.02072169,0.008036988,0.000427482,0.001661861,0.04521663,0.006554796],"genre_scores_gemma":[0.005907183,0.003541868,0.963959,0.005357312,0.002085845,0.0005094797,0.001738397,0.01097675,0.005924173],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0438988,"threshold_uncertainty_score":0.1468561,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3040486170","doi":"10.1186/s13040-020-00218-7","title":"An epistatic interaction between pre-natal smoke exposure and socioeconomic status has a significant impact on bronchodilator drug response in African American youth with asthma","year":2020,"lang":"en","type":"article","venue":"BioData Mining","topic":"Health, Environment, Cognitive Aging","field":"Environmental Science","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"National Institute of General Medical Sciences; University of California, San Francisco; National Institutes of Health; National Institute of Environmental Health Sciences; San Francisco State University; National Institute on Minority Health and Health Disparities; Tobacco-Related Disease Research Program; National Heart, Lung, and Blood Institute; Gordon and Betty Moore Foundation; American Asthma Foundation; Alfred P. Sloan Foundation; Robert Wood Johnson Foundation","keywords":"Bronchodilator; Socioeconomic status; Asthma; Smoke; Drug; Drug response; Environmental health; African american; Medicine; Demography; Pharmacology; Internal medicine; Geography; Sociology","authors":[{"name":"Joaquín Magaña","is_ca":false},{"name":"María G. Contreras","is_ca":false},{"name":"Kevin L. Keys","is_ca":false},{"name":"Oona Risse‐Adams","is_ca":false},{"name":"Pagé C. Goddard","is_ca":false},{"name":"Andrew M. Zeiger","is_ca":false},{"name":"Angel C. Y. Mak","is_ca":false},{"name":"Jennifer R. Elhawary","is_ca":false},{"name":"Lesly‐Anne Samedy","is_ca":false},{"name":"Eunice Lee","is_ca":false},{"name":"Neeta Thakur","is_ca":false},{"name":"Donglei Hu","is_ca":false},{"name":"Celeste Eng","is_ca":false},{"name":"Sandra Salazar","is_ca":false},{"name":"Scott Huntsman","is_ca":false},{"name":"Ting Hu","is_ca":true},{"name":"Esteban G. Burchard","is_ca":false},{"name":"Marquitta J. White","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03639083565729737,"gpt":0.2904963259645341,"spread":0.2541054903072367,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001126565,0.0004192059,0.000516975,0.0007546019,0.0007077254,0.0005316465,0.0004265918,0.0003249702,0.003489082],"category_scores_gemma":[0.004819419,0.0001535252,0.001613626,0.001033356,0.0002751723,0.0003155587,0.0008652185,0.0006205536,0.000167435],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003861928,"about_ca_system_score_gemma":0.0006335105,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02246568,"about_ca_topic_score_gemma":0.03666135,"domain_scores_codex":[0.9990778,0.0003796345,0.00006572036,0.0002450191,0.00008636786,0.0001454598],"domain_scores_gemma":[0.9980729,0.001135424,0.0003866532,0.0001462435,0.0001127245,0.0001461257],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0003482241,0.00003015403,0.9891278,0.00004008927,0.0004773792,0.0001629083,0.0001289357,0.0009964616,0.0009993371,0.0001363098,0.0007996526,0.006752809],"study_design_scores_gemma":[0.00001789142,0.0001016773,0.9881268,0.00002858071,0.0003590652,0.0003007892,0.0003723504,0.008849788,0.0003962241,0.0004981575,0.000934199,0.00001456517],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9942405,0.0003774319,0.0008578554,0.0001873835,0.00001215722,0.000008824131,0.003885128,0.00004380663,0.0003866827],"genre_scores_gemma":[0.9970976,0.00008295257,0.000778972,0.00003531417,0.000007295223,0.00001580037,0.00185739,0.00000768571,0.0001169622],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02246568,"threshold_uncertainty_score":0.04466981,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2165336562","doi":"10.1186/1756-0381-5-14","title":"Peer2ref: a peer-reviewer finding web tool that uses author disambiguation","year":2012,"lang":"en","type":"article","venue":"BioData Mining","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ottawa Hospital","funders":"","keywords":"Computer science; MEDLINE; Information retrieval; Web of science; World Wide Web; Selection (genetic algorithm); Data science; Artificial intelligence","authors":[{"name":"Miguel A. Andrade‐Navarro","is_ca":true},{"name":"Gareth Palidwor","is_ca":true},{"name":"Carol Perez‐Iratxeta","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.119280966501619,"gpt":0.3543855559307648,"spread":0.2351045894291458,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02958581,0.002697774,0.002657041,0.03318492,0.003908306,0.007577324,0.003920247,0.00326501,0.05623384],"category_scores_gemma":[0.0927793,0.001852067,0.001414569,0.01518847,0.0012672,0.01100889,0.006539721,0.001666554,0.04564901],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001073467,"about_ca_system_score_gemma":0.008008891,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001582306,"about_ca_topic_score_gemma":0.002807434,"domain_scores_codex":[0.9847112,0.004296436,0.003195182,0.002462412,0.004904316,0.0004304615],"domain_scores_gemma":[0.8845465,0.05935724,0.01272775,0.01222788,0.02667759,0.004463025],"domain_codex":null,"domain_gemma":"evaluation","domain_candidate":"evaluation","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009004824,0.0002698904,0.006987636,0.006407685,0.0003921609,0.0009537725,0.002008907,0.001044661,0.01212684,0.01001119,0.3883322,0.5705645],"study_design_scores_gemma":[0.0005281137,0.0002643676,0.007066929,0.001337966,0.0002972626,0.001822416,0.00109985,0.02435916,0.02972182,0.02256229,0.9103584,0.0005814866],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008359505,0.002576848,0.6225388,0.002753876,0.002436992,0.003578244,0.0436114,0.2968512,0.01729316],"genre_scores_gemma":[0.02903231,0.001336534,0.8972797,0.0007546177,0.001304763,0.002326341,0.03585817,0.01718083,0.01492666],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9704142,"threshold_uncertainty_score":0.1881209,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4411237205","doi":"10.1186/s13040-025-00455-8","title":"DBSCAN and DBCV application to open medical records heterogeneous data for identifying clinically significant clusters of patients with neuroblastoma","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Neuroblastoma Research and Treatments","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Data mining; Neuroblastoma; Medical record; DBSCAN; Data science; Information retrieval; Cluster analysis; Medicine; Internal medicine; Artificial intelligence; Fuzzy clustering","authors":[{"name":"Davide Chicco","is_ca":true},{"name":"Luca Oneto","is_ca":false},{"name":"Davide Cangelosi","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07202205426547378,"gpt":0.3988111328466636,"spread":0.3267890785811898,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004015917,0.0009508963,0.0008787392,0.007316656,0.0009655093,0.002117049,0.001624304,0.0009781744,0.0009563587],"category_scores_gemma":[0.02029533,0.0003381997,0.001136906,0.006311735,0.000473189,0.0007578041,0.001874634,0.0008984644,0.0004454311],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001145119,"about_ca_system_score_gemma":0.002746373,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.03327484,"about_ca_topic_score_gemma":0.0281203,"domain_scores_codex":[0.9957445,0.001179939,0.0007573732,0.0008852077,0.001210504,0.0002224415],"domain_scores_gemma":[0.9924676,0.003714126,0.0006587144,0.001057892,0.001768558,0.0003331645],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003111755,0.001033566,0.1956688,0.001933906,0.001441512,0.001977312,0.002510467,0.192935,0.008032072,0.009757654,0.07291915,0.5086788],"study_design_scores_gemma":[0.0002557321,0.0002098786,0.05482524,0.0001840278,0.000233769,0.0007640803,0.002113245,0.8970829,0.0107875,0.009257781,0.02414001,0.0001457666],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7202561,0.002540773,0.1694672,0.001847073,0.0004206016,0.001310446,0.07551049,0.02322877,0.005418513],"genre_scores_gemma":[0.6419448,0.0005970042,0.2625602,0.0002533665,0.00008254516,0.0008266542,0.09233971,0.0004540317,0.0009416436],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.03327484,"threshold_uncertainty_score":0.06616229,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4404300486","doi":"10.1186/s13040-024-00400-1","title":"Deciphering the tissue-specific functional effect of Alzheimer risk SNPs with deep genome annotation","year":2024,"lang":"en","type":"article","venue":"BioData Mining","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institutes of Health; Genentech; IXICO; H. Lundbeck A/S; Servier; Eisai; Northern California Institute for Research and Education; University of Southern California; Biogen; BioClinica; Meso Scale Diagnostics; U.S. Department of Defense; Alzheimer's Disease Neuroimaging Initiative; Novartis Pharmaceuticals Corporation; Pfizer; Eli Lilly and Company; Bristol-Myers Squibb; National Institute on Aging; Alzheimer's Association; Canadian Institutes of Health Research; National Science Foundation","keywords":"Annotation; Genome-wide association study; Single-nucleotide polymorphism; Genome; Computer science; Computational biology; Biology; Data science; Artificial intelligence; Genetics; Gene; Genotype","authors":[{"name":"Pradeep Varathan Pugalenthi","is_ca":false},{"name":"Bing He","is_ca":false},{"name":"Linhui Xie","is_ca":false},{"name":"Kwangsik Nho","is_ca":false},{"name":"Andrew J. Saykin","is_ca":false},{"name":"Jingwen Yan","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01376340837305052,"gpt":0.2323274820777082,"spread":0.2185640737046577,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007212675,0.0004054711,0.0005608842,0.0008316546,0.0003101625,0.0006139761,0.0004539782,0.0003563792,0.001089786],"category_scores_gemma":[0.001575219,0.0002076806,0.0005360449,0.0008273342,0.0002492354,0.0004764232,0.0006983984,0.000619831,0.0002463592],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003101702,"about_ca_system_score_gemma":0.0004172843,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003979394,"about_ca_topic_score_gemma":0.006485587,"domain_scores_codex":[0.9997346,0.00006830976,0.00001333789,0.00008999124,0.00004454987,0.00004918362],"domain_scores_gemma":[0.9995427,0.0002577226,0.00005950014,0.00005971308,0.00004155554,0.0000388257],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001032393,0.0002872801,0.266263,0.0009701523,0.001032797,0.001064486,0.0006616678,0.1028968,0.4258083,0.01797988,0.005714329,0.1762889],"study_design_scores_gemma":[0.00008074777,0.0002527259,0.2182932,0.0001291523,0.0007553136,0.0006693574,0.0005185734,0.6497115,0.06050579,0.05156322,0.01742398,0.00009637047],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8595511,0.002213005,0.1290246,0.0006037775,0.00005354697,0.00002656147,0.005546826,0.000861534,0.002119055],"genre_scores_gemma":[0.9606225,0.0006100857,0.03338497,0.0001737473,0.00001428623,0.00003210289,0.004419969,0.00009438497,0.0006479027],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003979394,"threshold_uncertainty_score":0.007912457,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2610597045","doi":"10.1186/s13040-017-0136-6","title":"Study of Meta-analysis strategies for network inference using information-theoretic approaches","year":2017,"lang":"en","type":"article","venue":"BioData Mining","topic":"Gene Regulatory Network Analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto; Ontario Institute for Cancer Research","funders":"Université de Liège; Fonds De La Recherche Scientifique - FNRS","keywords":"Pairwise comparison; Computer science; Data mining; Inference; Set (abstract data type); Reverse engineering; Machine learning; Artificial intelligence","authors":[{"name":"Ngoc C. Pham","is_ca":false},{"name":"Benjamin Haibe‐Kains","is_ca":true},{"name":"Pau Bellot","is_ca":false},{"name":"Gianluca Bontempi","is_ca":false},{"name":"Patrick Meyer","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2128476376645253,"gpt":0.3422631988385581,"spread":0.1294155611740328,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04412268,0.003540511,0.002814658,0.008384036,0.00102638,0.003635593,0.003876842,0.002239642,0.002462121],"category_scores_gemma":[0.09131341,0.001308591,0.007484455,0.003390065,0.001419373,0.004907547,0.002941821,0.004308531,0.0004077808],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002652612,"about_ca_system_score_gemma":0.002866556,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002797415,"about_ca_topic_score_gemma":0.00295538,"domain_scores_codex":[0.9780586,0.01775604,0.0006210831,0.001790506,0.001509229,0.0002646213],"domain_scores_gemma":[0.7937545,0.1909816,0.004429647,0.00583422,0.003941426,0.001058544],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000412545,0.0002740757,0.01236399,0.001531322,0.01095192,0.0003646077,0.0003621189,0.774848,0.001973176,0.08214153,0.001804673,0.112972],"study_design_scores_gemma":[0.00004321643,0.0001299463,0.0005469791,0.0001412589,0.0008383874,0.00007313789,0.00005146326,0.9275525,0.0008531011,0.0686865,0.001054661,0.00002875248],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008237532,0.001999553,0.9878896,0.0006148358,0.0000653699,0.0001345172,0.0002523056,0.0002739744,0.0005322999],"genre_scores_gemma":[0.2230891,0.00172896,0.772069,0.0003744422,0.0002722681,0.0008085739,0.0008653819,0.0002869855,0.000505364],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04412268,"threshold_uncertainty_score":0.2333458,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2120184682","doi":"10.1186/s13040-014-0032-2","title":"Integrative genomics and transcriptomics analysis of human embryonic and induced pluripotent stem cells","year":2014,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genomic variations and chromosomal abnormalities","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Lunenfeld-Tanenbaum Research Institute","funders":"Emil Aaltosen Säätiö; European Commission","keywords":"Embryonic stem cell; Induced pluripotent stem cell; Genomics; Transcriptome; Computational biology; Biology; Human Induced Pluripotent Stem Cells; Stem cell; Data science; Computer science; Genetics; Genome; Gene; Gene expression","authors":[{"name":"Kirsti Laurila","is_ca":false},{"name":"Reija Autio","is_ca":false},{"name":"Lingjia Kong","is_ca":false},{"name":"Elisa Närvä","is_ca":false},{"name":"Samer M. I. Hussein","is_ca":true},{"name":"Timo Otonkoski","is_ca":false},{"name":"Riitta Lahesmaa","is_ca":false},{"name":"Harri Lähdesmäki","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01718761907827809,"gpt":0.2301086904694139,"spread":0.2129210713911358,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003892137,0.0003013533,0.0004171519,0.0007488058,0.0001681479,0.0003452757,0.0002428579,0.0001629394,0.0007356934],"category_scores_gemma":[0.000342895,0.0001066182,0.0006411335,0.00080983,0.0001486397,0.0001440603,0.0002480304,0.0002018406,0.0002424177],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002595858,"about_ca_system_score_gemma":0.0003750482,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005600021,"about_ca_topic_score_gemma":0.0006925572,"domain_scores_codex":[0.9997434,0.00003882376,0.00002129254,0.00008443639,0.00008871318,0.00002330611],"domain_scores_gemma":[0.9998883,0.00004329039,0.00002359865,0.00001255325,0.00002396191,0.000008337976],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","study_design_scores_codex":[0.0002175158,0.00003227163,0.007409539,0.0003315995,0.00009788201,0.0002433474,0.0000807886,0.003495535,0.9564487,0.001463582,0.0003228131,0.02985644],"study_design_scores_gemma":[0.00005775795,0.0005490585,0.2093904,0.00007632845,0.0005554856,0.001557114,0.0002539974,0.05804659,0.6965811,0.006113128,0.02677043,0.00004864509],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8422657,0.004438402,0.1310731,0.0001980384,0.0000462551,0.0001590171,0.01726818,0.0009497291,0.003601549],"genre_scores_gemma":[0.83152,0.002217734,0.1170661,0.0001742688,0.00003614488,0.0002764418,0.04685334,0.0001403128,0.001715667],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0007488058,"threshold_uncertainty_score":0.002461135,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2102718331","doi":"10.1186/1756-0381-7-25","title":"Updating microbial genomic sequences: improving accuracy &amp; innovation","year":2014,"lang":"en","type":"article","venue":"BioData Mining","topic":"Vibrio bacteria research studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"McMaster University","keywords":"Sanger sequencing; Biology; Genome; Whole genome sequencing; Computational biology; Salmonella enterica; Biovar; Genetics; DNA sequencing; Caulobacter crescentus; Salmonella; Gene; Bacterial protein; Bacteria","authors":[{"name":"Hongseok Tae","is_ca":false},{"name":"Enusha Karunasena","is_ca":false},{"name":"Jasmin Bavarva","is_ca":false},{"name":"Harold R. Garner","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03551480171943568,"gpt":0.3013115225258921,"spread":0.2657967208064564,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02190073,0.001067205,0.001277305,0.003529945,0.0007652704,0.004448069,0.003421153,0.002112426,0.002457598],"category_scores_gemma":[0.07841668,0.0009130259,0.000990984,0.005029032,0.001094919,0.006034846,0.002622802,0.00203291,0.003566555],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001218134,"about_ca_system_score_gemma":0.002209012,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001553344,"about_ca_topic_score_gemma":0.001940279,"domain_scores_codex":[0.9809625,0.005619484,0.001787115,0.002913796,0.008271631,0.0004456358],"domain_scores_gemma":[0.9483619,0.01995257,0.004233462,0.01230311,0.01458784,0.000561013],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0004085229,0.0001737083,0.02149896,0.001134096,0.0001670644,0.0003221512,0.001145597,0.01609991,0.07974458,0.009016027,0.005812893,0.8644766],"study_design_scores_gemma":[0.0001824676,0.0007591658,0.02724026,0.001021279,0.0005213632,0.00279953,0.001414994,0.271931,0.3957653,0.05961592,0.2383621,0.0003867048],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.08496558,0.004928005,0.8877417,0.004835231,0.0008460422,0.0003186144,0.002115476,0.007130165,0.007119163],"genre_scores_gemma":[0.1242836,0.001961703,0.8676059,0.0008640637,0.000246646,0.0001290344,0.002386027,0.0007188593,0.001804159],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02190073,"threshold_uncertainty_score":0.1158235,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4405855303","doi":"10.1186/s13040-024-00413-w","title":"Distinct network patterns emerge from Cartesian and XOR epistasis models: a comparative network science analysis","year":2024,"lang":"en","type":"article","venue":"BioData Mining","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"U.S. National Library of Medicine; National Institutes of Health; Alliance de recherche numérique du Canada","keywords":"Epistasis; Biology; Computational biology; Genetics; Gene","authors":[{"name":"Zhendong Sha","is_ca":true},{"name":"Philip J. Freda","is_ca":false},{"name":"Priyanka Bhandary","is_ca":false},{"name":"Attri Ghosh","is_ca":false},{"name":"Nicholas Matsumoto","is_ca":false},{"name":"Jason H. Moore","is_ca":false},{"name":"Ting Hu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03330849453372306,"gpt":0.2784116938249487,"spread":0.2451031992912257,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009248908,0.0003773279,0.0003255116,0.002282378,0.0004266947,0.0006821745,0.0003775129,0.0003480512,0.00217569],"category_scores_gemma":[0.002863137,0.0001517837,0.0008424156,0.0009386529,0.0005460553,0.0008215741,0.0005246906,0.0004127834,0.0001136818],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006771516,"about_ca_system_score_gemma":0.0004050562,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003103029,"about_ca_topic_score_gemma":0.003610372,"domain_scores_codex":[0.9996604,0.0001396079,0.00001314131,0.00009568225,0.00005273836,0.00003849309],"domain_scores_gemma":[0.998621,0.000814434,0.0002461397,0.0000897334,0.0001497516,0.00007891247],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001602427,0.000414323,0.2258725,0.001163704,0.002321658,0.001642703,0.002238334,0.3893025,0.1001174,0.1516017,0.005594515,0.1181283],"study_design_scores_gemma":[0.00003753115,0.0001542611,0.07784018,0.00003980886,0.0002251105,0.000427686,0.0005414815,0.8720633,0.003005221,0.0430907,0.002534257,0.00004046909],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8974808,0.0003571282,0.09720111,0.0002956334,0.00001642521,0.00006853729,0.0008480087,0.0002037286,0.003528546],"genre_scores_gemma":[0.9747277,0.0001917176,0.02369102,0.00003219237,0.000008253772,0.00007679965,0.0007549049,0.00002089522,0.0004965512],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003103029,"threshold_uncertainty_score":0.007278383,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4414606898","doi":"10.1186/s13040-025-00482-5","title":"Proteome mining of Yersinia Enterocolitica for drug targets and computational inhibitor identification with ADMET, anti-inflammation potential and formulation characteristics","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Pharmacological Effects of Natural Compounds","field":"Pharmacology, Toxicology and Pharmaceutics","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Alpha Technologies (Canada)","funders":"King Khalid University; National Research Foundation of Korea","keywords":"Yersinia enterocolitica; Proteome; Drug; Yersinia; Proteomics; Drug repositioning; Identification (biology); Drug discovery","authors":[{"name":"Zarrin Basharat","is_ca":true},{"name":"Youssef Saeed Alghamdi","is_ca":false},{"name":"Mutaib M. Mashraqi","is_ca":false},{"name":"Hanan A. Ogaly","is_ca":false},{"name":"Fatimah A. M. Al‐Zahrani","is_ca":false},{"name":"Calvin R. Wei","is_ca":false},{"name":"Ibrar Ahmed","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04233579431491202,"gpt":0.381111791511651,"spread":0.338775997196739,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004617121,0.001183103,0.001233775,0.001175809,0.0004677394,0.0009491267,0.0006324538,0.000660949,0.001960328],"category_scores_gemma":[0.0007349495,0.0003165299,0.001772258,0.00148202,0.0001448377,0.000458112,0.0003305823,0.0004721171,0.0007184811],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006286438,"about_ca_system_score_gemma":0.001409584,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003887995,"about_ca_topic_score_gemma":0.004263299,"domain_scores_codex":[0.9998153,0.00002803006,0.00001683957,0.00006128697,0.00004889691,0.00002971424],"domain_scores_gemma":[0.9998418,0.00005149517,0.00003564409,0.00001221615,0.00004398902,0.00001482587],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003826466,0.001638836,0.07522388,0.0108001,0.001874171,0.003839357,0.0004194461,0.3324056,0.3236711,0.005500008,0.04335218,0.1974488],"study_design_scores_gemma":[0.0003166806,0.00134763,0.02655388,0.000207819,0.001028086,0.00139052,0.0003729727,0.8402478,0.07831915,0.003538462,0.04657304,0.0001039012],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.850458,0.01244438,0.04562775,0.001688677,0.0001406472,0.0004115441,0.07254811,0.00787473,0.008806202],"genre_scores_gemma":[0.8035859,0.00698246,0.08076717,0.0004610184,0.00005222503,0.0004814935,0.1039583,0.0003796415,0.003331787],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003887995,"threshold_uncertainty_score":0.007730722,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4408930421","doi":"10.1186/s13040-025-00441-0","title":"Multivariate longitudinal clustering reveals neuropsychological factors as dementia predictors in an Alzheimer’s disease progression study","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Multivariate statistics; Dementia; Neuropsychology; Multivariate analysis; Cluster analysis; Disease; Longitudinal study; Psychology; Alzheimer's disease; Longitudinal data; Medicine; Computer science; Cognition; Psychiatry; Artificial intelligence; Internal medicine; Data mining; Machine learning; Pathology","authors":[{"name":"Patrizia Ribino","is_ca":false},{"name":"Claudia Di Napoli","is_ca":false},{"name":"Giovanni Paragliola","is_ca":false},{"name":"Davide Chicco","is_ca":true},{"name":"Francesca Gasparini","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1037533014192664,"gpt":0.4365110347565466,"spread":0.3327577333372801,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004174923,0.0003240773,0.0004457108,0.002163386,0.0004396564,0.001020907,0.0004721046,0.0004131258,0.0006312886],"category_scores_gemma":[0.00792922,0.000128364,0.0008689754,0.001586819,0.0001917563,0.0003624905,0.0007843158,0.0005363052,0.0001933698],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004358707,"about_ca_system_score_gemma":0.0008883571,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01069925,"about_ca_topic_score_gemma":0.0133029,"domain_scores_codex":[0.9991378,0.0004399787,0.00009282422,0.0001550005,0.0001066479,0.00006779128],"domain_scores_gemma":[0.9975531,0.001002427,0.0004474232,0.000388393,0.0003814042,0.0002274059],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0008227638,0.0001977339,0.949548,0.00006415777,0.000639334,0.0002358681,0.0004740771,0.01063793,0.001457411,0.0004693943,0.001677534,0.03377581],"study_design_scores_gemma":[0.00005314937,0.0002747349,0.8235165,0.00006691693,0.00031401,0.0003059174,0.001031607,0.1689482,0.001018796,0.002697816,0.001718315,0.00005418158],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9906781,0.0002887848,0.007431321,0.0002009588,0.0000134444,0.00004633199,0.001062133,0.0000529648,0.0002258647],"genre_scores_gemma":[0.9912315,0.0001027147,0.006449226,0.00001589434,0.000009309887,0.00002984254,0.002023934,0.00001118728,0.0001263266],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01069925,"threshold_uncertainty_score":0.02207935,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4410024327","doi":"10.1186/s13040-025-00444-x","title":"Learning the therapeutic targets of acute myeloid leukemia through multiscale human interactome network and community analysis","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Interactome; Myeloid leukemia; Computer science; Computational biology; Data science; Medicine; Biology; Cancer research; Gene; Genetics","authors":[{"name":"Suruthy Sivanathan","is_ca":true},{"name":"Ting Hu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04076467338792138,"gpt":0.3493131891731776,"spread":0.3085485157852562,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000395517,0.0004323064,0.0004750625,0.00245707,0.0003484644,0.0004730535,0.0003556337,0.0004304239,0.0008436393],"category_scores_gemma":[0.001548685,0.0001599066,0.0007600026,0.001232792,0.000234047,0.0004865795,0.0006590908,0.0003197756,0.0001182654],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005063793,"about_ca_system_score_gemma":0.0006849255,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005400119,"about_ca_topic_score_gemma":0.008050121,"domain_scores_codex":[0.999777,0.00006940313,0.00001152552,0.00007150488,0.00004190327,0.00002851797],"domain_scores_gemma":[0.999624,0.0002002867,0.00008044553,0.00002501952,0.00003963341,0.00003052655],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007801447,0.0005897707,0.08840501,0.000950473,0.0008275843,0.0007795944,0.0003009202,0.5537912,0.03372548,0.01745339,0.01008231,0.2923141],"study_design_scores_gemma":[0.00001716167,0.0000485413,0.007494966,0.00001615862,0.00008161849,0.0001087796,0.0000576169,0.9781489,0.001196662,0.01128668,0.001530315,0.00001249301],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5324755,0.003009668,0.4544201,0.001120152,0.00005053467,0.0002373568,0.0041397,0.001014584,0.003532467],"genre_scores_gemma":[0.9147922,0.0007782046,0.08078106,0.0001085211,0.00004032618,0.0001456423,0.00264623,0.00003186354,0.0006758837],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.005400119,"threshold_uncertainty_score":0.01073736,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4387813874","doi":"10.1186/s13040-023-00344-y","title":"Prescription pattern analysis of Type 2 Diabetes Mellitus: a cross-sectional study in Isfahan, Iran","year":2023,"lang":"en","type":"article","venue":"BioData Mining","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Artificial Intelligence in Medicine (Canada); University of Toronto","funders":"","keywords":"Medical prescription; Medicine; Diabetes mellitus; Polypharmacy; Type 2 Diabetes Mellitus; Cross-sectional study; Type 2 diabetes; Internal medicine; Pharmacology; Endocrinology","authors":[{"name":"Elnaz Ziad","is_ca":false},{"name":"Somayeh Sadat","is_ca":true},{"name":"Farshad Farzadfar","is_ca":false},{"name":"Mohammad‐Reza Malekpour","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08700440662326508,"gpt":0.3629943011081319,"spread":0.2759898944848668,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001167816,0.0002376804,0.0004368896,0.00124809,0.000500582,0.000453973,0.0003794958,0.0003731142,0.0009083797],"category_scores_gemma":[0.001633266,0.0003217431,0.0005929665,0.001930865,0.000224306,0.000430513,0.0003038035,0.0004735116,0.000127539],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004794812,"about_ca_system_score_gemma":0.0006835802,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00891997,"about_ca_topic_score_gemma":0.01145181,"domain_scores_codex":[0.9993048,0.0001633525,0.0001036148,0.0001400873,0.0002068263,0.00008137067],"domain_scores_gemma":[0.998859,0.0002695103,0.0004915571,0.00007172232,0.0001897655,0.0001184332],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.00001724578,0.00005381698,0.9989452,0.00001104513,0.00003321534,0.00004385223,0.00009952024,0.00001156216,0.00004394073,0.000004665636,0.00004222537,0.0006936913],"study_design_scores_gemma":[0.000004871882,0.00008764526,0.9989617,0.000005800657,0.00002558974,0.0002340291,0.0004240113,0.0001252111,0.00002855355,0.000006097645,0.00009395658,0.000002409223],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9994803,0.0001067761,0.00004511747,0.00003153837,0.000003424213,0.00001553144,0.0002073461,0.000001077769,0.0001088592],"genre_scores_gemma":[0.999079,0.0001867679,0.0002391255,0.00005435778,0.00001069889,0.00002787615,0.0003287959,0.000001287754,0.00007213815],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.00891997,"threshold_uncertainty_score":0.01773614,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4416785648","doi":"10.1186/s13040-025-00499-w","title":"Bioinformatics analysis of Rickettsia typhi autoimmune associations and screening of Streptomyces-derived inhibitors","year":2025,"lang":"en","type":"article","venue":"BioData Mining","topic":"vaccines and immunoinformatics approaches","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Alpha Technologies (Canada)","funders":"National Research Foundation of Korea; King Khalid University; National Research Foundation","keywords":"Rickettsia typhi; Salmonella typhi; Rickettsia","authors":[{"name":"Zarrin Basharat","is_ca":true},{"name":"Hanan A. Ogaly","is_ca":false},{"name":"Fatimah A. M. Al‐Zahrani","is_ca":false},{"name":"Calvin R. Wei","is_ca":false},{"name":"Syed Shah Hassan","is_ca":false},{"name":"Muhammad Salman","is_ca":false},{"name":"Madiha Islam","is_ca":false},{"name":"İbrar Ahmed","is_ca":false},{"name":"Yasir Waheed","is_ca":false},{"name":"Seil Kim","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01826554024398858,"gpt":0.2611037845670206,"spread":0.242838244323032,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005269859,0.000935293,0.001450409,0.002026127,0.0004615757,0.001048513,0.0004589919,0.0004089195,0.001862756],"category_scores_gemma":[0.0007752514,0.0001888407,0.001593284,0.002042684,0.0001406554,0.0003510477,0.000362415,0.0004386205,0.0009760379],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004895575,"about_ca_system_score_gemma":0.0008168058,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001354969,"about_ca_topic_score_gemma":0.002012404,"domain_scores_codex":[0.9996324,0.00005808774,0.00004699797,0.0001057031,0.0001001739,0.00005671828],"domain_scores_gemma":[0.9997192,0.00007691282,0.00007381089,0.00001471461,0.00007504736,0.00004032878],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"not_applicable","study_design_scores_codex":[0.006838474,0.001999833,0.1751754,0.01258505,0.002352379,0.005610335,0.0005296204,0.05072153,0.4385988,0.00274798,0.05124851,0.2515922],"study_design_scores_gemma":[0.000633825,0.003997988,0.2507731,0.0007230168,0.003098752,0.004989701,0.00115025,0.431672,0.1797236,0.004034993,0.1188947,0.0003080132],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8920094,0.01508721,0.02157091,0.0009935553,0.000194725,0.0004610868,0.05600569,0.0054219,0.008255474],"genre_scores_gemma":[0.8008993,0.008152815,0.06991526,0.0005024977,0.00006618389,0.0005116473,0.1168826,0.0003417882,0.002727955],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.002026127,"threshold_uncertainty_score":0.006231546,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4234031396","doi":"10.1186/preaccept-8590947901180703","title":"Integrative genomics and transcriptomics analysis of human embryonic and induced pluripotent stem cells","year":2014,"lang":"en","type":"article","venue":"BioData Mining","topic":"Genomic variations and chromosomal abnormalities","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Lunenfeld-Tanenbaum Research Institute","funders":"Emil Aaltosen Säätiö; European Commission","keywords":"Biology; Induced pluripotent stem cell; Genetics; Single-nucleotide polymorphism; Gene; SNP array; Copy-number variation; Genomics; DNA microarray; Transcriptome; Embryonic stem cell; Human genome; Functional genomics; Phenotype; Exon; Genome; Computational biology; Gene expression; Genotype","authors":[{"name":"Kirsti Laurila","is_ca":false},{"name":"Reija Autio","is_ca":false},{"name":"Lingjia Kong","is_ca":false},{"name":"Elisa Närvä","is_ca":false},{"name":"Samer M. I. Hussein","is_ca":true},{"name":"Timo Otonkoski","is_ca":false},{"name":"Riitta Lahesmaa","is_ca":false},{"name":"Harri Lähdesmäki","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01718761907827809,"gpt":0.2301086904694139,"spread":0.2129210713911358,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000276508,0.0002524757,0.0004060853,0.0006737842,0.0001578817,0.0003084395,0.0001851754,0.0001292403,0.0005753302],"category_scores_gemma":[0.0002694049,0.0001047511,0.0005556346,0.0008042315,0.0001241445,0.000122098,0.0002095368,0.0001660185,0.0002040805],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002130746,"about_ca_system_score_gemma":0.000343234,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006936031,"about_ca_topic_score_gemma":0.0008670308,"domain_scores_codex":[0.9997837,0.00003058881,0.00001758264,0.00007586544,0.0000719517,0.00002023789],"domain_scores_gemma":[0.9999272,0.00002636883,0.00001528583,0.000009205098,0.00001573947,0.000006223392],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0001680615,0.00002375771,0.005089585,0.000193545,0.00006830358,0.0002087494,0.0000691992,0.002504492,0.9690971,0.001036485,0.00020394,0.02133688],"study_design_scores_gemma":[0.0000563993,0.0004851894,0.2355541,0.00005719373,0.0004670272,0.001477934,0.0002532516,0.0482942,0.6843296,0.004709858,0.02426863,0.00004664203],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8855463,0.003242861,0.09178872,0.0001392298,0.00003339045,0.0001138996,0.01543581,0.0006173403,0.003082542],"genre_scores_gemma":[0.8597494,0.002031617,0.09310398,0.0001518424,0.00002618543,0.0002221044,0.04295569,0.0001126465,0.001646676],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.0006936031,"threshold_uncertainty_score":0.001924694,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4387402455","doi":"10.1186/s13040-023-00343-z","title":"Quantum analysis of squiggle data","year":2023,"lang":"en","type":"article","venue":"BioData Mining","topic":"Quantum Computing Algorithms and Architecture","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Lethbridge","funders":"Alberta Innovates; Ministero dello Sviluppo Economico; Government of Alberta; Genome Canada","keywords":"Nanopore sequencing; Computer science; Curse of dimensionality; Algorithm; Quantum; IBM; Quantum computer; Current (fluid); Computer engineering; DNA sequencing; Theoretical computer science; Artificial intelligence; DNA; Electrical engineering; Physics","authors":[{"name":"Naya Nagy","is_ca":false},{"name":"Matthew Stuart-Edwards","is_ca":true},{"name":"Marius Nagy","is_ca":false},{"name":"Liam Mitchell","is_ca":true},{"name":"Athanasios Zovoilis","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07099168818858985,"gpt":0.3082925873008592,"spread":0.2373008991122694,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007173202,0.0002781635,0.0004570899,0.001130568,0.0005121778,0.0008885052,0.0006435525,0.0003809219,0.003626758],"category_scores_gemma":[0.003946786,0.000164028,0.0004168862,0.001045298,0.0007447557,0.001733956,0.000774061,0.0007419756,0.0005091871],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006139826,"about_ca_system_score_gemma":0.0006188573,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001701134,"about_ca_topic_score_gemma":0.001573886,"domain_scores_codex":[0.9994839,0.00009198899,0.00002645236,0.00009017363,0.0002426957,0.00006473295],"domain_scores_gemma":[0.9984553,0.0006505779,0.000108354,0.0003022037,0.0004243639,0.00005923012],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005317286,0.0002174762,0.007288076,0.0002745416,0.0001350665,0.0007081227,0.0005548308,0.2701764,0.1584958,0.2278606,0.006847782,0.3269096],"study_design_scores_gemma":[0.000006967726,0.00002814745,0.001453557,0.000006425162,0.000006136267,0.00007438864,0.00007055237,0.9384184,0.01622613,0.04187065,0.001823374,0.00001523003],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1432585,0.0001960197,0.8509939,0.0004743038,0.00005381327,0.00004879441,0.0002413321,0.001256755,0.003476631],"genre_scores_gemma":[0.8000981,0.0002013031,0.1960042,0.000140955,0.00004136884,0.00004780712,0.0004435123,0.0001805656,0.002842104],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003626758,"threshold_uncertainty_score":0.0121327,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4410588018","doi":"10.1186/s13040-025-00451-y","title":"Correction: Learning the therapeutic targets of acute myeloid leukemia through multiscale human interactome network and community analysis","year":2025,"lang":"en","type":"erratum","venue":"BioData Mining","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"","keywords":"Interactome; Myeloid leukemia; Computer science; Computational biology; Artificial intelligence; Data science; Medicine; Biology; Cancer research; Gene","authors":[{"name":"Suruthy Sivanathan","is_ca":true},{"name":"Ting Hu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03957594418586434,"gpt":0.3386744091704122,"spread":0.2990984649845479,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005555912,0.003059515,0.003403085,0.005065198,0.004893707,0.004438074,0.005149866,0.01143332,0.09568404],"category_scores_gemma":[0.1308555,0.00191504,0.002644032,0.00377689,0.004257701,0.00290706,0.00344953,0.01404153,0.04872388],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004357301,"about_ca_system_score_gemma":0.007060485,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02693036,"about_ca_topic_score_gemma":0.02517072,"domain_scores_codex":[0.9933849,0.0009751213,0.001344006,0.00104406,0.002607184,0.0006447805],"domain_scores_gemma":[0.9338937,0.01885403,0.002740388,0.004385877,0.03693232,0.003193654],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005031353,0.000007607633,0.0001060581,0.000155675,0.000023573,0.0003259286,0.00003468942,0.00005609557,0.00005648649,0.0006165877,0.9949786,0.003588482],"study_design_scores_gemma":[0.0003167476,0.00005652468,0.002027157,0.0007013693,0.0002129739,0.002126279,0.0002476698,0.001560983,0.001228206,0.007569738,0.9838255,0.0001267352],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"editorial","genre_gemma":"other","genre_scores_codex":[0.0001664055,0.0004421705,0.001192651,0.05627795,0.9376985,0.00003203413,0.002139806,0.0008165793,0.001233947],"genre_scores_gemma":[0.03024851,0.005371784,0.01663476,0.2266866,0.4894493,0.0006380401,0.006076962,0.004622866,0.2202712],"genre_candidate":"other","genre_consensus":null,"teacher_disagreement_score":0.09568404,"threshold_uncertainty_score":0.320095,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}