{"meta":{"query_hash":"8b096c79865a","filters":{"venue":"Bioinformatics Advances"},"cohort_total":65,"direct_labels_cover":0,"predictions_cover":65,"exported":65,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/8b096c79865a","api":"https://metacan.xera.ac/api/v1/cohort?venue=Bioinformatics+Advances"},"results":[{"id":"W3179038740","doi":"10.1093/bioadv/vbac033","title":"Sufficient principal component regression for pattern discovery in transcriptomic data","year":2022,"lang":"en","type":"preprint","venue":"Bioinformatics Advances","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; National Science Foundation","keywords":"Subspace topology; Principal component analysis; Context (archaeology); Computer science; Data mining; Regression; Principal component regression; Machine learning; Artificial intelligence; Pattern recognition (psychology); Mathematics; Biology; Statistics","score_opus":0.0465884028724005,"score_gpt":0.3316644022699577,"score_spread":0.2850759993975572,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3179038740","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022783978,0.0003332165,0.994165,0.00045641523,0.000033261214,0.000055621844,0.00072792877,0.0015414389,0.0004086592],"genre_scores_gemma":[0.14392851,0.0014143775,0.8376148,0.0005840682,0.0003856523,0.00094127544,0.011040134,0.0013305214,0.0027606785],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99388933,0.003004523,0.00028440892,0.0011284257,0.0014729627,0.0002203652],"domain_scores_gemma":[0.9763633,0.017392438,0.0009977279,0.002834034,0.0019619945,0.00045052424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008718671,0.0018800433,0.0022520132,0.0024376055,0.0009148821,0.0017615998,0.0022249299,0.001746604,0.0053700944],"category_scores_gemma":[0.045455534,0.0012162176,0.0018524226,0.0037237937,0.0021014842,0.00265639,0.002283106,0.003901729,0.0057402393],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00071807037,0.00034564035,0.0060974695,0.0013420414,0.00036927036,0.00045186834,0.0002425151,0.5557345,0.009929781,0.09546218,0.044549156,0.2847575],"study_design_scores_gemma":[0.000030618667,0.000029905048,0.00047023228,0.00003801074,0.0000142599565,0.000058546724,0.000015343587,0.9254922,0.0014175072,0.06980308,0.0026143957,0.000015848213],"about_ca_topic_score_codex":0.0028522806,"about_ca_topic_score_gemma":0.0029216448,"teacher_disagreement_score":0.008718671,"about_ca_system_score_codex":0.00091023993,"about_ca_system_score_gemma":0.0036369094,"threshold_uncertainty_score":0.04610926},"labels":[],"label_agreement":null},{"id":"W3201257126","doi":"10.1093/bioadv/vbab021","title":"CRIS: complete reconstruction of immunoglobulin <i>V-D-J</i> sequences from RNA-seq data","year":2021,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Chronic Lymphocytic Leukemia Research","field":"Medicine","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Terry Fox Research Institute; Canada's Michael Smith Genome Sciences Centre; University of British Columbia","funders":"National Cancer Institute; National Human Genome Research Institute; Canadian Institutes of Health Research","keywords":"RNA-Seq; Computational biology; Antibody; Biology; Genetics; Gene; Transcriptome; Gene expression","score_opus":0.061407976704869756,"score_gpt":0.3298371960912405,"score_spread":0.26842921938637077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3201257126","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.104806796,0.0017434671,0.2635551,0.0009765985,0.0005467453,0.0008241833,0.4966648,0.12199378,0.008888498],"genre_scores_gemma":[0.13773601,0.0005257324,0.31175783,0.00068365695,0.00011834689,0.0010048905,0.53572655,0.00955023,0.0028967536],"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989322,0.0001632189,0.00007124204,0.0004787444,0.0002528367,0.000101824175],"domain_scores_gemma":[0.99835205,0.00074769143,0.00020975873,0.00027005494,0.00029310666,0.00012741367],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026541864,0.0015669238,0.0009262268,0.0017111795,0.0010191129,0.0018025341,0.0013189517,0.00083608757,0.008799198],"category_scores_gemma":[0.004982423,0.00084897986,0.0016225429,0.001367025,0.000637539,0.00067863043,0.0013828638,0.0018169009,0.006654984],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032911764,0.00039032224,0.03727564,0.0066202423,0.002056088,0.0015262672,0.0015822677,0.06833608,0.3813102,0.0123467725,0.3258109,0.15945403],"study_design_scores_gemma":[0.0008173066,0.00067970896,0.06122572,0.00068618223,0.000839385,0.0013883469,0.00095724873,0.32398364,0.21428338,0.02644174,0.36813894,0.00055842113],"about_ca_topic_score_codex":0.0038512745,"about_ca_topic_score_gemma":0.00837692,"teacher_disagreement_score":0.008799198,"about_ca_system_score_codex":0.0007570364,"about_ca_system_score_gemma":0.0023305702,"threshold_uncertainty_score":0.02943623},"labels":[],"label_agreement":null},{"id":"W3201645418","doi":"10.1093/bioadv/vbab018","title":"Balanced Functional Module Detection in genomic data","year":2021,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Interpretability; Outcome (game theory); Property (philosophy); Computer science; Set (abstract data type); Consistency (knowledge bases); Variable (mathematics); Feature selection; Data mining; Artificial intelligence; Theoretical computer science; Machine learning; Mathematics","score_opus":0.014696382845612456,"score_gpt":0.2381064015665066,"score_spread":0.22341001872089414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3201645418","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09933917,0.00038275868,0.896844,0.00027773136,0.000025112518,0.000099776116,0.0016109333,0.0008755811,0.00054491946],"genre_scores_gemma":[0.6890998,0.0002908884,0.30475214,0.00021413468,0.000060611048,0.00025839376,0.004540132,0.000112238726,0.0006716647],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998696,0.0005385125,0.000074128,0.00036529417,0.000245992,0.000080036516],"domain_scores_gemma":[0.99275726,0.005439354,0.00066947954,0.00040020896,0.0005641711,0.00016962453],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028714696,0.00069251953,0.0006533646,0.00250713,0.000413815,0.0009664973,0.0011681385,0.0006772401,0.001077227],"category_scores_gemma":[0.013485761,0.0002822829,0.0007536644,0.0018349653,0.0007326192,0.0011571248,0.0012006235,0.00066280476,0.00028315678],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063351396,0.00022001375,0.06881217,0.0008546255,0.00040635472,0.0009957245,0.00046723665,0.5496022,0.033676226,0.03894751,0.004567619,0.30081677],"study_design_scores_gemma":[0.000022116466,0.00007829147,0.0058383774,0.000035854842,0.000047145404,0.00023755342,0.000058728045,0.91298556,0.00789231,0.07059115,0.0021912192,0.000021701482],"about_ca_topic_score_codex":0.0015398844,"about_ca_topic_score_gemma":0.0013825472,"teacher_disagreement_score":0.0028714696,"about_ca_system_score_codex":0.0007161457,"about_ca_system_score_gemma":0.00072426477,"threshold_uncertainty_score":0.015185952},"labels":[],"label_agreement":null},{"id":"W3217126935","doi":"10.1093/bioadv/vbab032","title":"An expectation–maximization approach to quantifying protein stoichiometry with single-molecule imaging","year":2021,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Advanced Fluorescence Microscopy Techniques","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Python (programming language); Photobleaching; Maximization; Rendering (computer graphics); Benchmark (surveying); Single-molecule experiment; Software; Algorithm; Resampling; Biological system; Artificial intelligence; Fluorescence; Physics; Mathematics; Optics; Mathematical optimization","score_opus":0.01365889790151077,"score_gpt":0.28657783493185246,"score_spread":0.2729189370303417,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3217126935","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017119615,0.00014268106,0.9965934,0.00018808649,0.000019961386,0.000043120916,0.00017436477,0.00080591324,0.00032043963],"genre_scores_gemma":[0.04024818,0.0002084396,0.95672566,0.00027557253,0.000073859956,0.00031047728,0.00087247486,0.0003383496,0.0009469911],"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99832994,0.0006961291,0.00009236176,0.00045862462,0.00035280967,0.00007005702],"domain_scores_gemma":[0.99661785,0.0022857983,0.00023847475,0.00021949178,0.0005113543,0.00012706056],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047594192,0.0017232824,0.0015764905,0.0011538793,0.0006377432,0.0015604664,0.0033357749,0.0020296266,0.0029062417],"category_scores_gemma":[0.010267604,0.0012161881,0.0014859042,0.0016365921,0.0012893411,0.001461112,0.0015454494,0.0026849587,0.0017351626],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017765252,0.00014174233,0.0013883578,0.00047674857,0.00028829073,0.0001772729,0.00010807445,0.8330363,0.010649118,0.020048229,0.009424169,0.12408413],"study_design_scores_gemma":[0.000010995826,0.00001386177,0.00011233566,0.0000110257215,0.000009576618,0.000039076345,0.0000055052556,0.9854798,0.0017747524,0.011366744,0.0011648121,0.0000115381745],"about_ca_topic_score_codex":0.0040318575,"about_ca_topic_score_gemma":0.0046181325,"teacher_disagreement_score":0.0047594192,"about_ca_system_score_codex":0.001299451,"about_ca_system_score_gemma":0.002231064,"threshold_uncertainty_score":0.025170505},"labels":[],"label_agreement":null},{"id":"W4210673729","doi":"10.1093/bioadv/vbab044","title":"From pairwise to multiple spliced alignment","year":2022,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"RNA Research and Splicing","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Université de Sherbrooke","keywords":"Pairwise comparison; RNA splicing; Gene; Computer science; Computational biology; Alignment-free sequence analysis; Gene family; Gene Annotation; Heuristic; Context (archaeology); Annotation; Gene prediction; Genome; Genetics; Biology; Sequence alignment; Artificial intelligence; RNA; Peptide sequence","score_opus":0.010446553364173973,"score_gpt":0.2654293748247018,"score_spread":0.2549828214605278,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210673729","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002797267,0.0006070846,0.9872652,0.00036418613,0.00021478838,0.00010599953,0.0011383813,0.0050780154,0.0024290425],"genre_scores_gemma":[0.028785225,0.00047575546,0.9637349,0.00020001754,0.00017373168,0.00022391012,0.003299015,0.0019185988,0.0011888267],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99495137,0.0016990242,0.000509337,0.0014247132,0.0012306317,0.00018497204],"domain_scores_gemma":[0.9943996,0.0023026762,0.0005485609,0.001405038,0.0011062014,0.00023779855],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031860527,0.0023322206,0.001573808,0.0030412886,0.0013152707,0.002488064,0.0035000807,0.0019455595,0.01479196],"category_scores_gemma":[0.015266511,0.0011354068,0.0018527992,0.005501601,0.0015756958,0.0056673572,0.0052446797,0.0036097977,0.011941783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000374727,0.00017878068,0.003001233,0.0022216116,0.00025957174,0.0006265247,0.00057197,0.07331861,0.014390402,0.19023882,0.062641606,0.65217614],"study_design_scores_gemma":[0.0000715041,0.00012654446,0.00061948784,0.00025033604,0.000060689952,0.00090617297,0.00021880181,0.27815357,0.01442354,0.6314972,0.073590524,0.000081654485],"about_ca_topic_score_codex":0.0009432979,"about_ca_topic_score_gemma":0.0016029929,"teacher_disagreement_score":0.01479196,"about_ca_system_score_codex":0.0010278535,"about_ca_system_score_gemma":0.00169858,"threshold_uncertainty_score":0.049484074},"labels":[],"label_agreement":null},{"id":"W4226251181","doi":"10.1093/bioadv/vbac030","title":"Expanding the Galaxy’s reference data","year":2022,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université de Sherbrooke; BC Centre for Disease Control","funders":"National Human Genome Research Institute; Biotechnology and Biological Sciences Research Council; Directorate for Biological Sciences; National Cancer Institute; National Institutes of Health; European Commission; Vlaamse regering; National Research Foundation; UK Research and Innovation; Cleveland Clinic","keywords":"Computer science; Galaxy; Task (project management); Interface (matter); Reference data; Information retrieval; Database; Astrophysics; Operating system; Physics; Engineering","score_opus":0.037415753046130866,"score_gpt":0.28645728237098694,"score_spread":0.24904152932485607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226251181","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075514624,0.0025087087,0.081715785,0.0035394968,0.0019417512,0.00029845996,0.57126796,0.27563047,0.055545907],"genre_scores_gemma":[0.013970775,0.0006315576,0.0761793,0.002004811,0.00023461529,0.00054380746,0.84682596,0.050824404,0.008784768],"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99150157,0.0013304176,0.0007529081,0.0021081674,0.0035345403,0.0007723345],"domain_scores_gemma":[0.97826505,0.0021789863,0.0007865389,0.011406347,0.005809323,0.0015537305],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0088200625,0.0022644892,0.002328244,0.008677315,0.0027534582,0.0073857843,0.008899019,0.003634826,0.05813423],"category_scores_gemma":[0.035179336,0.002299678,0.003103843,0.011917812,0.0012282167,0.007303915,0.011361008,0.0057096444,0.10716233],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028148454,0.000033933688,0.0034545995,0.000814414,0.00017315435,0.00019319066,0.00049991277,0.0010150723,0.0039612106,0.0112515995,0.9294353,0.048886165],"study_design_scores_gemma":[0.00007540942,0.000023028775,0.0019146773,0.00015465339,0.000057425066,0.00009175904,0.00006971551,0.0010232385,0.0037011495,0.006491419,0.9863274,0.000070097194],"about_ca_topic_score_codex":0.02502164,"about_ca_topic_score_gemma":0.02540175,"teacher_disagreement_score":0.05813423,"about_ca_system_score_codex":0.0030945307,"about_ca_system_score_gemma":0.0059157135,"threshold_uncertainty_score":0.1944784},"labels":[],"label_agreement":null},{"id":"W4281294657","doi":"10.1093/bioadv/vbac038","title":"HPiP: an R/Bioconductor package for predicting host–pathogen protein–protein interactions from protein sequences using ensemble machine learning approach","year":2022,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan; University of Regina","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Bioconductor; Computational biology; Host (biology); Computer science; Machine learning; Biology; Artificial intelligence; Bioinformatics; Genetics; Gene","score_opus":0.021306430047910288,"score_gpt":0.2605602040231485,"score_spread":0.23925377397523823,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281294657","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004633309,0.002383856,0.3169932,0.0011445429,0.0010824742,0.0007283534,0.09295665,0.57446676,0.0056109307],"genre_scores_gemma":[0.04741552,0.003003228,0.5731032,0.0021705106,0.00044437792,0.0071967496,0.1615308,0.19295715,0.012178446],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965578,0.00095787516,0.00031809774,0.0009349127,0.0009253668,0.0003059752],"domain_scores_gemma":[0.990838,0.0046566515,0.0010144805,0.0012080031,0.0017629204,0.0005199584],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0067512956,0.0063196174,0.004742845,0.0041032773,0.0010132659,0.003201097,0.007877031,0.0020643098,0.06751598],"category_scores_gemma":[0.018894263,0.0025533317,0.003208584,0.004191857,0.0014676215,0.0030896037,0.0045846454,0.0057521416,0.07267103],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013800521,0.00020681374,0.0033561245,0.0077783,0.002166166,0.000673559,0.00039901858,0.012926692,0.0070791836,0.012478194,0.8788764,0.07267949],"study_design_scores_gemma":[0.0016349123,0.0005747308,0.010364511,0.0022681598,0.0016111817,0.0013883857,0.00030136696,0.31380364,0.031098988,0.07040036,0.56594306,0.00061069336],"about_ca_topic_score_codex":0.0045052245,"about_ca_topic_score_gemma":0.004328412,"teacher_disagreement_score":0.06751598,"about_ca_system_score_codex":0.0013582918,"about_ca_system_score_gemma":0.004958086,"threshold_uncertainty_score":0.2258634},"labels":[],"label_agreement":null},{"id":"W4288051411","doi":"10.1093/bioadv/vbac049","title":"More accurate estimation of cell composition in bulk expression through robust integration of single-cell information","year":2022,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; Health Canada","funders":"","keywords":"Covariance; Collinearity; Univariate; Computer science; Expression (computer science); RNA-Seq; Data mining; Analysis of covariance; Computational biology; Algorithm; Biological system; Gene expression; Mathematics; Gene; Multivariate statistics; Transcriptome; Biology; Statistics; Machine learning; Genetics","score_opus":0.01643830154938968,"score_gpt":0.24041963199313485,"score_spread":0.22398133044374516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4288051411","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07429156,0.0011309138,0.9193898,0.0001847717,0.00006309466,0.000056624773,0.0018429717,0.0021076621,0.00093265076],"genre_scores_gemma":[0.35347787,0.0012606084,0.6319083,0.0003672006,0.00010799386,0.00023888778,0.009830318,0.000636172,0.002172543],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99931645,0.000107823435,0.000034028955,0.0002996744,0.00019718874,0.000044840926],"domain_scores_gemma":[0.99842477,0.00061008555,0.00021971636,0.00028467108,0.00039458866,0.00006625392],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001943915,0.00088873383,0.0011104251,0.001285655,0.0003382315,0.0011428376,0.00096592563,0.00071922416,0.0009817675],"category_scores_gemma":[0.0038184552,0.0003352456,0.0009792593,0.0013971585,0.00056191854,0.0012247085,0.0009678344,0.0014125368,0.0009785052],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057646405,0.0002916857,0.04251423,0.0007677971,0.0002953281,0.00017902632,0.00041981228,0.18177597,0.3351158,0.00677544,0.007913248,0.42337525],"study_design_scores_gemma":[0.000025617177,0.00007400794,0.013520016,0.000047268873,0.00006410451,0.00012186879,0.00011180226,0.91043323,0.057970602,0.010565395,0.0069977124,0.00006832205],"about_ca_topic_score_codex":0.0036332654,"about_ca_topic_score_gemma":0.004489945,"teacher_disagreement_score":0.0036332654,"about_ca_system_score_codex":0.00060042675,"about_ca_system_score_gemma":0.0010527817,"threshold_uncertainty_score":0.0102805495},"labels":[],"label_agreement":null},{"id":"W4297231023","doi":"10.1093/bioadv/vbac069","title":"High-throughput design of bacterial anti-sense RNAs using CAREng","year":2022,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bacterial Genetics and Biotechnology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Biology; Computational biology; Gene; Antisense RNA; Functional genomics; RNA; Transfer RNA; Genetics; Genome; Genomics","score_opus":0.01569035333574757,"score_gpt":0.2419148205237434,"score_spread":0.22622446718799585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4297231023","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25639012,0.0017693016,0.69714034,0.0008099622,0.0006307469,0.0031014918,0.005287173,0.018851243,0.01601965],"genre_scores_gemma":[0.40749326,0.0016139614,0.55913496,0.0006924542,0.000051719508,0.0028088347,0.010361698,0.0032857493,0.014557289],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9991203,0.0001444762,0.00008854651,0.00019074207,0.0003393571,0.000116707866],"domain_scores_gemma":[0.99931896,0.00021979971,0.000094121235,0.000101423226,0.00016303998,0.00010263081],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012320159,0.0008539545,0.0007658464,0.00047003137,0.00049613003,0.0011180899,0.00076000835,0.0006703496,0.0040178867],"category_scores_gemma":[0.0015851907,0.00074529706,0.0008489859,0.00037252472,0.0005125485,0.00041814047,0.00069921627,0.001516737,0.0045036958],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012460956,0.00006506843,0.00022673998,0.00030710528,0.000022360704,0.00012896728,0.00013600683,0.0036570465,0.97909945,0.0015015017,0.002105805,0.012625218],"study_design_scores_gemma":[0.00004252953,0.00019622067,0.00026696958,0.000029412018,0.00002106889,0.00010567781,0.000034587345,0.010590432,0.9593123,0.00038838695,0.028968789,0.000043497086],"about_ca_topic_score_codex":0.00089269766,"about_ca_topic_score_gemma":0.0022600826,"teacher_disagreement_score":0.0040178867,"about_ca_system_score_codex":0.0010391249,"about_ca_system_score_gemma":0.0009036186,"threshold_uncertainty_score":0.013441205},"labels":[],"label_agreement":null},{"id":"W4313800421","doi":"10.1093/bioadv/vbac099","title":"GlobeCorr: interactive globe-based visualization for correlation datasets","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Health, Environment, Cognitive Aging","field":"Environmental Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; McGill University Health Centre; Simon Fraser University","funders":"Canadian Institutes of Health Research; Genome Canada","keywords":"Metadata; Visualization; Computer science; MIT License; Pairwise comparison; Data mining; Correlation; Interactive visualization; Data visualization; Information retrieval; Globe; License; Data science; World Wide Web; Artificial intelligence; Biology","score_opus":0.016107814823444484,"score_gpt":0.3134939633144855,"score_spread":0.297386148491041,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313800421","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046122083,0.0004799424,0.22480415,0.0016587497,0.0005169341,0.0003819735,0.07721884,0.6786938,0.01163347],"genre_scores_gemma":[0.07582825,0.0013073358,0.60473263,0.0018801179,0.0004910808,0.002381287,0.15108792,0.15022044,0.012070916],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99782157,0.0005539375,0.00020435963,0.00047655634,0.0007549675,0.00018865817],"domain_scores_gemma":[0.9890627,0.006060927,0.00060645345,0.0018993133,0.0017131347,0.0006573909],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005472468,0.0027994039,0.001812356,0.0046783644,0.0013652354,0.0045160283,0.0037541473,0.001692707,0.11454189],"category_scores_gemma":[0.01919118,0.0011224075,0.0024644753,0.0055720094,0.0009900447,0.005013171,0.006493488,0.003122001,0.02835698],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006816417,0.00010576554,0.0027219448,0.0011326319,0.00023304741,0.00044150878,0.000754515,0.0031069343,0.004912824,0.0073808935,0.8986785,0.07984977],"study_design_scores_gemma":[0.0011032883,0.00022405214,0.013175963,0.0011430675,0.00029855434,0.0012284892,0.0006833755,0.13612,0.030674882,0.08082433,0.7338703,0.00065375614],"about_ca_topic_score_codex":0.006317288,"about_ca_topic_score_gemma":0.008010342,"teacher_disagreement_score":0.11454189,"about_ca_system_score_codex":0.00095630396,"about_ca_system_score_gemma":0.0023342285,"threshold_uncertainty_score":0.3831808},"labels":[],"label_agreement":null},{"id":"W4319341254","doi":"10.1093/bioadv/vbad010","title":"NSPA: characterizing the disease association of multiple genetic interactions at single-subject resolution","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Alliance de recherche numérique du Canada; Natural Sciences and Engineering Research Council of Canada; Queen's University","keywords":"Association (psychology); Subject (documents); Resolution (logic); Genetic association; Computational biology; Computer science; Biology; Genetics; Artificial intelligence; Psychology; Genotype; Single-nucleotide polymorphism; Gene; Library science","score_opus":0.01775615102493194,"score_gpt":0.26334134266902914,"score_spread":0.2455851916440972,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319341254","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22196144,0.002000104,0.70871115,0.0036579736,0.0002942407,0.0003317168,0.049907595,0.004681157,0.008454577],"genre_scores_gemma":[0.76205784,0.00088311126,0.19181629,0.00055415794,0.0003473631,0.00062259147,0.038945846,0.0003689661,0.004403759],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99889094,0.00048150713,0.00004822504,0.00038946807,0.00014860778,0.00004124521],"domain_scores_gemma":[0.9929357,0.0050204005,0.0006384421,0.0008061988,0.0003312763,0.00026794436],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034409661,0.0006975882,0.00077299366,0.00188296,0.00061811844,0.0010041944,0.0010486641,0.0008771226,0.0083513865],"category_scores_gemma":[0.011240453,0.00028912476,0.0012955706,0.0018129142,0.0006633113,0.00081641285,0.0011456257,0.0011361992,0.0015270798],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014612854,0.00047435536,0.32274878,0.0014437203,0.0018851942,0.0020605433,0.0009565908,0.21617949,0.017771546,0.04768876,0.0928199,0.29450983],"study_design_scores_gemma":[0.0001945309,0.00029369284,0.09025777,0.00015778943,0.00050433207,0.0015128951,0.0002234012,0.6815426,0.0041383277,0.18637303,0.03470636,0.00009529583],"about_ca_topic_score_codex":0.005003939,"about_ca_topic_score_gemma":0.006663472,"teacher_disagreement_score":0.0083513865,"about_ca_system_score_codex":0.0005549005,"about_ca_system_score_gemma":0.0009367485,"threshold_uncertainty_score":0.027938187},"labels":[],"label_agreement":null},{"id":"W4323066661","doi":"10.1093/bioadv/vbad023","title":"GPTree Cluster: phylogenetic tree cluster generator in the context of supertree inference","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada; Université de Sherbrooke","keywords":"Supertree; Phylogenetic tree; Computational phylogenetics; Tree (set theory); Context (archaeology); Phylogenetic network; Tree rearrangement; Cluster analysis; Inference; Biology; Computer science; Sister group; Python (programming language); Phylogenetics; Theoretical computer science; Artificial intelligence; Mathematics; Combinatorics; Genetics; Clade","score_opus":0.015122267526134965,"score_gpt":0.25754650968047427,"score_spread":0.2424242421543393,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323066661","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008603968,0.0002219624,0.65185124,0.0005684937,0.00037868254,0.00041175005,0.014469554,0.31957826,0.0039160987],"genre_scores_gemma":[0.07403416,0.00030166295,0.790679,0.0005325533,0.00010167728,0.0014981055,0.049232822,0.07910884,0.0045112143],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9991435,0.00019844694,0.000062256026,0.00025588385,0.00021999597,0.000119847355],"domain_scores_gemma":[0.9979631,0.00085650425,0.000115969706,0.00046563573,0.00041643856,0.00018237914],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023655847,0.0017990934,0.0010728815,0.00162657,0.001387436,0.0020607235,0.0058887126,0.0017950544,0.029701125],"category_scores_gemma":[0.011091925,0.0014292274,0.0019731638,0.002028246,0.0010887905,0.0032989744,0.003269627,0.003428506,0.014926565],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018348413,0.00039918453,0.0076850816,0.0027401103,0.0005639683,0.0012117769,0.0019594743,0.09498314,0.01435804,0.057264,0.5924896,0.2245108],"study_design_scores_gemma":[0.0005884899,0.0001229287,0.0015366183,0.00020764419,0.00011729905,0.00051711104,0.00018320899,0.7371923,0.015386072,0.09700627,0.14698161,0.00016045192],"about_ca_topic_score_codex":0.0038583092,"about_ca_topic_score_gemma":0.0054818084,"teacher_disagreement_score":0.029701125,"about_ca_system_score_codex":0.001031371,"about_ca_system_score_gemma":0.0025245864,"threshold_uncertainty_score":0.09936011},"labels":[],"label_agreement":null},{"id":"W4323816133","doi":"10.1093/bioadv/vbad028","title":"Predicting phenotypes from novel genomic markers using deep learning","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Single-nucleotide polymorphism; Convolutional neural network; Biology; Computational biology; SNP; Pearson product-moment correlation coefficient; Genetics; Phenotype; DNA sequencing; Artificial intelligence; Genotype; Computer science; DNA; Statistics; Gene; Mathematics","score_opus":0.01358583109972697,"score_gpt":0.24077463066215105,"score_spread":0.22718879956242408,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323816133","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5847438,0.0011195933,0.40723503,0.0005244191,0.00008305607,0.000054054784,0.0019359232,0.0021568565,0.0021472606],"genre_scores_gemma":[0.96003586,0.00018308462,0.036321525,0.00012437358,0.000017200922,0.000043010696,0.0017835345,0.000034826935,0.0014565742],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99983823,0.000034041987,0.0000092616,0.00006313523,0.00003125364,0.00002402359],"domain_scores_gemma":[0.99949694,0.0002778687,0.00005740344,0.000038277278,0.000102369304,0.00002716586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00053259596,0.00083681446,0.00041003764,0.0006123199,0.00013198005,0.00045918504,0.00051019667,0.00048887916,0.0010181706],"category_scores_gemma":[0.0009403693,0.00017210947,0.000491426,0.0005193902,0.00019809049,0.00038717556,0.0004542373,0.0007748614,0.00030827164],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022969693,0.00035137145,0.034739807,0.00011670386,0.00021586572,0.00017414629,0.00003656496,0.7547123,0.019184778,0.0011814327,0.002264089,0.18679324],"study_design_scores_gemma":[0.000004305356,0.000019534391,0.0022900754,0.0000055948444,0.000013378613,0.000011374527,0.000003958431,0.9944102,0.0022353327,0.0008227651,0.00017894788,0.000004600447],"about_ca_topic_score_codex":0.0047865207,"about_ca_topic_score_gemma":0.006207034,"teacher_disagreement_score":0.0047865207,"about_ca_system_score_codex":0.0005013613,"about_ca_system_score_gemma":0.00047703466,"threshold_uncertainty_score":0.009517312},"labels":[],"label_agreement":null},{"id":"W4324045291","doi":"10.1093/bioadv/vbad030","title":"scAnnotate: an automated cell-type annotation tool for single-cell RNA-sequencing data","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan; University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada; Universities Space Research Association; Genome British Columbia; Western Canada Research Grid; Compute Canada","keywords":"Annotation; Dropout (neural networks); Computer science; Artificial intelligence; Data mining; Computational biology; Machine learning; Biology","score_opus":0.04813062175676968,"score_gpt":0.3011984307456495,"score_spread":0.2530678089888798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4324045291","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016633112,0.00041225087,0.69666743,0.0002511601,0.00020894888,0.0002583163,0.0116966,0.27280423,0.0010680051],"genre_scores_gemma":[0.14540647,0.0006321632,0.7678858,0.0006852947,0.000109855115,0.0016350368,0.05560656,0.023514401,0.004524392],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981053,0.00028437274,0.0001785291,0.0005754976,0.00075133884,0.00010498027],"domain_scores_gemma":[0.9949486,0.0027470267,0.0004714935,0.00083748274,0.0007658826,0.00022949323],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034006373,0.0020406544,0.0013370152,0.0022452616,0.0009397334,0.0016701381,0.0037311937,0.0015113177,0.008733037],"category_scores_gemma":[0.011004449,0.0010226284,0.0020623412,0.0014993787,0.0008482298,0.002181752,0.0021225773,0.0015501974,0.004140528],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003693575,0.00047943724,0.037141852,0.0040328163,0.0014210981,0.0020268653,0.0018255947,0.09563646,0.13408525,0.009972158,0.21302766,0.49665722],"study_design_scores_gemma":[0.0002972528,0.00021936542,0.007063444,0.00018508147,0.00015693871,0.0006173449,0.00019696164,0.8203353,0.08733579,0.010757029,0.07256046,0.0002750108],"about_ca_topic_score_codex":0.0036025213,"about_ca_topic_score_gemma":0.0059412583,"teacher_disagreement_score":0.008733037,"about_ca_system_score_codex":0.0009838481,"about_ca_system_score_gemma":0.0018551569,"threshold_uncertainty_score":0.029214919},"labels":[],"label_agreement":null},{"id":"W4327575955","doi":"10.1093/bioadv/vbad031","title":"Motif elucidation in ChIP-seq datasets with a knockout control","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Chromatin Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vector Institute; University of New Brunswick; Princess Margaret Cancer Centre; University of Toronto; University Health Network","funders":"Canadian Institutes of Health Research; University of Toronto; Natural Sciences and Engineering Research Council of Canada; Ontario Ministry of Research, Innovation and Science; Princess Margaret Cancer Foundation","keywords":"Chromatin immunoprecipitation; Motif (music); Computational biology; Computer science; Transcription factor; Chromatin; Biology; Artificial intelligence; Genetics; Gene; Promoter; Gene expression","score_opus":0.0042766906147950635,"score_gpt":0.22518562408588258,"score_spread":0.2209089334710875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4327575955","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20624119,0.0012455864,0.59338075,0.0007046344,0.000560318,0.0006671517,0.06358726,0.13077216,0.0028409772],"genre_scores_gemma":[0.23414956,0.00025903355,0.65067375,0.0009586651,0.00008540228,0.0017131601,0.090095565,0.020478768,0.0015861376],"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9972487,0.0006227747,0.00025929586,0.0012680788,0.00044321181,0.00015796733],"domain_scores_gemma":[0.9930606,0.0043064235,0.00042883705,0.0013131778,0.0006943752,0.00019657664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069419546,0.0017683712,0.0012645628,0.0017699737,0.0009700504,0.0015229617,0.0018128157,0.0012473862,0.0057486496],"category_scores_gemma":[0.021206597,0.0008269622,0.0017169039,0.0015114011,0.00095205475,0.00095846487,0.0014399614,0.001854892,0.003191127],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006260065,0.0008432693,0.07743088,0.005499273,0.0032324565,0.0010988024,0.00072689255,0.13500087,0.3639845,0.009275546,0.16093548,0.23571195],"study_design_scores_gemma":[0.00089230423,0.00044229737,0.027619094,0.0002553093,0.0005264459,0.0006902483,0.00024364596,0.72240514,0.18640682,0.016115949,0.044109542,0.0002932959],"about_ca_topic_score_codex":0.003011815,"about_ca_topic_score_gemma":0.007037056,"teacher_disagreement_score":0.0069419546,"about_ca_system_score_codex":0.0007566322,"about_ca_system_score_gemma":0.0016763294,"threshold_uncertainty_score":0.036713004},"labels":[],"label_agreement":null},{"id":"W4377047057","doi":"10.1093/bioadv/vbad059","title":"A self-knowledge distillation-driven CNN-LSTM model for predicting disease outcomes using longitudinal microbiome data","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Gut microbiota and health","field":"Biochemistry, Genetics and Molecular Biology","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Western University; University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Manitoba Medical Service Foundation","keywords":"Microbiome; Computer science; Artificial intelligence; Convolutional neural network; Deep learning; Inference; Machine learning; Data mining; Bioinformatics; Biology","score_opus":0.06966997547000747,"score_gpt":0.36256148296631757,"score_spread":0.2928915074963101,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4377047057","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3119004,0.0055239387,0.66113025,0.003517664,0.0006801338,0.0001360051,0.0054418775,0.0063364706,0.005333259],"genre_scores_gemma":[0.9307638,0.0008957603,0.056282613,0.0006908376,0.0001742732,0.00019319392,0.0049625672,0.00009173774,0.005945221],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99982613,0.000035772973,0.000011772781,0.000060524297,0.000025955667,0.00003976217],"domain_scores_gemma":[0.99961734,0.0001863206,0.000040660332,0.000028605691,0.00010096367,0.000026174836],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000920728,0.0010677787,0.00061553257,0.0004870672,0.00022668863,0.00049268646,0.0012225384,0.0008505936,0.0017008351],"category_scores_gemma":[0.001852243,0.00035904266,0.0006828412,0.0005271791,0.00025355592,0.00073378824,0.000668769,0.00147738,0.000616479],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045303686,0.00031228003,0.013207398,0.00015665899,0.00026660055,0.00020932066,0.00007807723,0.7749876,0.0046209097,0.0024874362,0.00813315,0.19508763],"study_design_scores_gemma":[0.000006325848,0.000018636836,0.00031483208,0.000005909912,0.000014291224,0.00000813888,0.000002678737,0.9983999,0.00038892092,0.0006569748,0.0001795588,0.0000037912237],"about_ca_topic_score_codex":0.016329294,"about_ca_topic_score_gemma":0.019256223,"teacher_disagreement_score":0.016329294,"about_ca_system_score_codex":0.0007783441,"about_ca_system_score_gemma":0.0013256682,"threshold_uncertainty_score":0.032468498},"labels":[],"label_agreement":null},{"id":"W4379276041","doi":"10.1093/bioadv/vbad068","title":"DataCurator.jl: efficient, portable and reproducible validation, curation and transformation of large heterogeneous datasets using human-readable recipes compiled into machine-verifiable templates","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Scientific Computing and Data Management","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"","keywords":"Computer science; Executable; Scalability; Python (programming language); Preprocessor; Workflow; Data mining; Verifiable secret sharing; Data curation; Database; Programming language","score_opus":0.09799458101637326,"score_gpt":0.40687124975629274,"score_spread":0.3088766687399195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379276041","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002458513,0.0002965585,0.25343508,0.0005888614,0.00036796997,0.00049745827,0.04499031,0.6928097,0.00455554],"genre_scores_gemma":[0.020483606,0.0005580814,0.32507995,0.0017702148,0.0001482403,0.0032594742,0.14558847,0.4930097,0.010102389],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99138546,0.0013588585,0.0010007711,0.0022979951,0.0033238742,0.0006330079],"domain_scores_gemma":[0.9788825,0.0070560533,0.0017265418,0.007499284,0.0039024164,0.0009332133],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.012456361,0.0035077927,0.0026606494,0.003507976,0.0017502103,0.00596305,0.005597734,0.0016913136,0.05162053],"category_scores_gemma":[0.034509517,0.0040778047,0.0037693635,0.0026298787,0.0028940206,0.004989835,0.010139783,0.0061308676,0.08045998],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010488826,0.00016789821,0.0051182825,0.0032224683,0.0004845072,0.0006346257,0.0014556969,0.005220192,0.032252125,0.011701668,0.82479465,0.11389898],"study_design_scores_gemma":[0.00056102517,0.00017608052,0.005261947,0.0010735973,0.00016568974,0.0005964122,0.00025864074,0.033549927,0.09839428,0.030001994,0.829333,0.0006273643],"about_ca_topic_score_codex":0.0034364169,"about_ca_topic_score_gemma":0.0038793008,"teacher_disagreement_score":0.9944023,"about_ca_system_score_codex":0.0015796397,"about_ca_system_score_gemma":0.005893007,"threshold_uncertainty_score":0.17268789},"labels":[],"label_agreement":null},{"id":"W4380867105","doi":"10.1093/bioadv/vbad072","title":"GDockScore: a graph-based protein–protein docking scoring function","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of New Brunswick","funders":"Canadian Institutes of Health Research; Alliance de recherche numérique du Canada","keywords":"Docking (animal); Computer science; Macromolecular docking; Graph; Protein–ligand docking; Artificial intelligence; Machine learning; Computational biology; Virtual screening; Theoretical computer science; Protein structure; Bioinformatics; Drug discovery; Biology; Biochemistry","score_opus":0.00998602961376684,"score_gpt":0.23053972378863127,"score_spread":0.22055369417486442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380867105","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0747885,0.002281837,0.73408467,0.001757537,0.0006987393,0.0006555878,0.058153726,0.1090957,0.018483749],"genre_scores_gemma":[0.3858513,0.0015068632,0.451376,0.0011840353,0.00012606056,0.001536606,0.12935017,0.0130341025,0.01603487],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994167,0.00015954691,0.000028049664,0.00012294909,0.00021487019,0.000057941],"domain_scores_gemma":[0.9993969,0.00022890867,0.000044598277,0.000115717645,0.00014877568,0.00006507032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011416145,0.0019457362,0.0013724661,0.0010358385,0.0006750459,0.0012051063,0.0037124925,0.001730812,0.018021896],"category_scores_gemma":[0.0039418368,0.00054661947,0.0013937359,0.001207625,0.00045239908,0.0012315378,0.0018727141,0.0020514042,0.00797872],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007000072,0.0004512964,0.0066385954,0.0014677797,0.0005959661,0.00028982922,0.0000876853,0.41708577,0.012359583,0.02779166,0.37018904,0.1623428],"study_design_scores_gemma":[0.00015020945,0.00012862228,0.00085034507,0.00005251489,0.00004385997,0.000096560376,0.0000164257,0.958926,0.005246223,0.01639875,0.018027725,0.00006267588],"about_ca_topic_score_codex":0.006671816,"about_ca_topic_score_gemma":0.010484965,"teacher_disagreement_score":0.018021896,"about_ca_system_score_codex":0.0010597424,"about_ca_system_score_gemma":0.00179621,"threshold_uncertainty_score":0.060289323},"labels":[],"label_agreement":null},{"id":"W4384397972","doi":"10.1093/bioadv/vbad091","title":"Measuring the relative contribution to predictive power of modern nucleotide substitution modeling approaches","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Substitution (logic); Predictive power; Model selection; Inference; Statistical model; Set (abstract data type); Computer science; Mixture model; Bayesian probability; Nucleotide; Probabilistic logic; Phylogenetic tree; Bayesian inference; Range (aeronautics); Selection (genetic algorithm); Computational biology; Econometrics; Mathematics; Artificial intelligence; Biology; Genetics; Engineering; Physics","score_opus":0.03347243952663514,"score_gpt":0.23591228002251383,"score_spread":0.20243984049587868,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384397972","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43260974,0.0028575736,0.5574609,0.0013258507,0.00008844532,0.00010956894,0.0004109982,0.0010076137,0.0041291956],"genre_scores_gemma":[0.91094965,0.00070210925,0.08672384,0.00017883794,0.00009367681,0.0000885047,0.0007308124,0.00020648728,0.00032612213],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.968388,0.020308467,0.0014340433,0.0025903755,0.0066347984,0.00064430234],"domain_scores_gemma":[0.8244265,0.15201841,0.004559124,0.014214134,0.0036296786,0.0011522335],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07561967,0.001863949,0.0017031173,0.0062832823,0.0010729961,0.0039772685,0.0020014828,0.002870263,0.0010734899],"category_scores_gemma":[0.16383943,0.0010145182,0.0016349334,0.0035972735,0.0026515233,0.007061936,0.0045114476,0.0035463702,0.0003986782],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008940798,0.00032519354,0.0782557,0.00038112947,0.0018122824,0.0001935369,0.0006657401,0.7716626,0.0073466487,0.020997493,0.0007071843,0.116758436],"study_design_scores_gemma":[0.000024282328,0.00023339341,0.012169944,0.00008563233,0.00018895692,0.00018676335,0.00008811573,0.96082926,0.0030243748,0.022504175,0.0005723292,0.000092854316],"about_ca_topic_score_codex":0.0028998374,"about_ca_topic_score_gemma":0.0027921612,"teacher_disagreement_score":0.07561967,"about_ca_system_score_codex":0.0010232662,"about_ca_system_score_gemma":0.0011757581,"threshold_uncertainty_score":0.3999198},"labels":[],"label_agreement":null},{"id":"W4385520436","doi":"10.1093/bioadv/vbad097","title":"Toward computing attributions for dimensionality reduction techniques","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal; Mila - Quebec Artificial Intelligence Institute; Université de Montréal; Montreal Heart Institute","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Fonds de Recherche du Québec - Santé; Institut de Valorisation des Données","keywords":"Dimensionality reduction; MNIST database; Python (programming language); Computer science; Artificial intelligence; Curse of dimensionality; Benchmark (surveying); Computation; Machine learning; Context (archaeology); Data mining; Reduction (mathematics); Pattern recognition (psychology); Deep learning; Algorithm; Mathematics","score_opus":0.03755720374093063,"score_gpt":0.2994449990200561,"score_spread":0.2618877952791255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385520436","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037288405,0.00016526703,0.9932734,0.0004161088,0.000046481287,0.00004960513,0.00025219782,0.0014555043,0.0006125629],"genre_scores_gemma":[0.10525796,0.00027014874,0.89092076,0.00022957398,0.0001339562,0.0002866081,0.0012749988,0.0006165088,0.0010094745],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9918464,0.00293723,0.0007322673,0.0016569834,0.00251388,0.00031331452],"domain_scores_gemma":[0.98050433,0.008663109,0.0017374979,0.004893146,0.0037650515,0.00043682544],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008217963,0.001417765,0.0012337726,0.0038176263,0.0011636029,0.0041997763,0.0025428883,0.0015153484,0.004436875],"category_scores_gemma":[0.04927369,0.00076572597,0.0022460287,0.003296691,0.002766467,0.005317812,0.005871052,0.0050424687,0.002233729],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021942816,0.0001801707,0.010059892,0.0005801404,0.00028484548,0.00018786603,0.00070168206,0.09076927,0.0056612967,0.2595497,0.023533093,0.60827255],"study_design_scores_gemma":[0.000030193421,0.000057082543,0.0014200651,0.000120565855,0.000032857366,0.00011143152,0.00015959408,0.51886696,0.0044126883,0.46608883,0.0086537,0.000046092413],"about_ca_topic_score_codex":0.0013944886,"about_ca_topic_score_gemma":0.0016606838,"teacher_disagreement_score":0.008217963,"about_ca_system_score_codex":0.0017106347,"about_ca_system_score_gemma":0.0022971062,"threshold_uncertainty_score":0.043461263},"labels":[],"label_agreement":null},{"id":"W4387731260","doi":"10.1093/bioadv/vbad150","title":"Single-cell gene set scoring with nearest neighbor graph smoothed data (gssnng)","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of California, San Francisco; Cancer Research UK; McGill University","keywords":"Smoothing; Computer science; Visualization; Data mining; Graph; Significance analysis of microarrays; Python (programming language); Data visualization; Software; Sample size determination; Gene expression profiling; Computational biology; Gene expression; Gene; Theoretical computer science; Mathematics; Genetics; Biology; Statistics","score_opus":0.04017187588871809,"score_gpt":0.2551354453461746,"score_spread":0.2149635694574565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387731260","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.061309,0.00047456703,0.7238144,0.00035473632,0.0005019521,0.00033114132,0.06464841,0.1422673,0.006298517],"genre_scores_gemma":[0.16186708,0.00033732754,0.7223117,0.00021654028,0.00007954859,0.001062075,0.08948225,0.018150322,0.006493183],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99875927,0.00016874446,0.000077145225,0.00038361823,0.00053443585,0.00007675445],"domain_scores_gemma":[0.9982216,0.00053463306,0.00017114116,0.00062899693,0.0003613252,0.00008234601],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017046479,0.00090553536,0.0011037497,0.0018983751,0.0006990896,0.0014154798,0.0015212934,0.00074587116,0.020614855],"category_scores_gemma":[0.0066688145,0.00047894786,0.0011320189,0.0025148976,0.00049042405,0.00091232674,0.0013748358,0.0014366214,0.009150783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011250188,0.0002699261,0.02594977,0.0025107122,0.0007457929,0.00048709384,0.0010887581,0.059424903,0.08039721,0.027174471,0.31207463,0.48875165],"study_design_scores_gemma":[0.00018340121,0.0002477799,0.028256845,0.00015721103,0.00018660746,0.0005636909,0.00033922028,0.6083136,0.11328475,0.061560582,0.18653503,0.00037130676],"about_ca_topic_score_codex":0.0039366037,"about_ca_topic_score_gemma":0.0071769394,"teacher_disagreement_score":0.020614855,"about_ca_system_score_codex":0.0006270853,"about_ca_system_score_gemma":0.0011154535,"threshold_uncertainty_score":0.06896359},"labels":[],"label_agreement":null},{"id":"W4388643693","doi":"10.1093/bioadv/vbad162","title":"aaHash: recursive amino acid sequence hashing","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre","funders":"National Human Genome Research Institute; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Dynamic perfect hashing; Hash function; Computer science; String (physics); Universal hashing; Context (archaeology); K-independent hashing; Theoretical computer science; Hash table; Algorithm; Locality-sensitive hashing; Double hashing; Biology; Mathematics; Programming language","score_opus":0.02459884249832153,"score_gpt":0.27694233884263164,"score_spread":0.25234349634431014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388643693","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020958412,0.0011396848,0.9103141,0.00035019298,0.00046732803,0.00035139718,0.0023827013,0.056234557,0.007801621],"genre_scores_gemma":[0.23455817,0.0004005318,0.74463725,0.0003831976,0.00025905756,0.00049823767,0.006221225,0.003406243,0.00963621],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9982383,0.00036766948,0.00014600788,0.00038148632,0.0007051698,0.00016125049],"domain_scores_gemma":[0.997191,0.00093098154,0.00021876971,0.0008469391,0.000631637,0.00018080883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015595885,0.0007574683,0.0008501002,0.0012685637,0.00084567926,0.0016433782,0.0024157243,0.001133407,0.016938368],"category_scores_gemma":[0.006886318,0.00061790517,0.00083669403,0.0015708497,0.00087881665,0.0024673901,0.0022031928,0.0013023429,0.013433898],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014032003,0.0002555515,0.0038858517,0.00092433824,0.00016647684,0.00023395126,0.00043272035,0.04434197,0.062259756,0.06431277,0.10670141,0.71508205],"study_design_scores_gemma":[0.0003159679,0.0005778402,0.0017532749,0.00011072599,0.000051841263,0.00078288285,0.00016760663,0.6519503,0.117833436,0.11188694,0.11434616,0.00022299352],"about_ca_topic_score_codex":0.0012266174,"about_ca_topic_score_gemma":0.0012787939,"teacher_disagreement_score":0.016938368,"about_ca_system_score_codex":0.00069234637,"about_ca_system_score_gemma":0.0014020656,"threshold_uncertainty_score":0.056664467},"labels":[],"label_agreement":null},{"id":"W4388928478","doi":"10.1093/bioadv/vbad166","title":"Adversarial training improves model interpretability in single-cell RNA-seq analysis","year":2023,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Lunenfeld-Tanenbaum Research Institute; University Health Network; University of Toronto; Sinai Health System; University of Waterloo","funders":"","keywords":"Interpretability; Robustness (evolution); Machine learning; Computer science; Artificial intelligence; Classifier (UML); Data mining; Biology; Gene","score_opus":0.023290461848573484,"score_gpt":0.24994314314055938,"score_spread":0.2266526812919859,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388928478","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21090129,0.0019669805,0.7518146,0.0047411826,0.0006101856,0.00015773179,0.0039160945,0.019694503,0.0061974614],"genre_scores_gemma":[0.79152477,0.0005879335,0.191877,0.002058506,0.00016465229,0.00019193561,0.007098487,0.003042121,0.0034546454],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981647,0.0008567994,0.00009107392,0.0004904,0.00026206725,0.00013510008],"domain_scores_gemma":[0.9859439,0.011218516,0.00047922533,0.0014666029,0.00055441965,0.00033736386],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075945184,0.0017650644,0.0010775632,0.0008227328,0.00072725327,0.0018577697,0.0017080471,0.0016389325,0.003742182],"category_scores_gemma":[0.025622044,0.0006094853,0.0016380223,0.0005067999,0.002152226,0.0021338065,0.0021218138,0.0038516824,0.0014325754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057237444,0.000115268136,0.0077588223,0.00031956405,0.00020549452,0.00022215187,0.00020431248,0.92005897,0.012131146,0.0066428995,0.009621131,0.042147838],"study_design_scores_gemma":[0.000014412744,0.000031064294,0.0005758715,0.000027660635,0.000014870736,0.00002366639,0.00001838639,0.98420954,0.003980874,0.010320335,0.00076809863,0.000015194898],"about_ca_topic_score_codex":0.005785941,"about_ca_topic_score_gemma":0.0059571397,"teacher_disagreement_score":0.0075945184,"about_ca_system_score_codex":0.0016428729,"about_ca_system_score_gemma":0.001753934,"threshold_uncertainty_score":0.040164113},"labels":[],"label_agreement":null},{"id":"W4391244160","doi":"10.1093/bioadv/vbae010","title":"MMDRP: drug response prediction and biomarker discovery using multi-modal deep learning","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Ontario Institute for Cancer Research","funders":"Ministry of Colleges and Universities","keywords":"Biomarker discovery; Modal; Drug discovery; Deep learning; Biomarker; Artificial intelligence; Computer science; Drug response; Machine learning; Drug; Computational biology; Medicine; Biology; Bioinformatics; Pharmacology; Proteomics; Chemistry","score_opus":0.02440852627287932,"score_gpt":0.31780439474983746,"score_spread":0.29339586847695814,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391244160","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03611347,0.002817919,0.88069856,0.0057169273,0.00033532458,0.00053687376,0.009346946,0.05870959,0.005724442],"genre_scores_gemma":[0.33010846,0.0013107217,0.6442678,0.0030478274,0.0002597139,0.001164168,0.011604276,0.0009995985,0.0072374474],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9993685,0.00017040959,0.000040039457,0.0001942154,0.00016137409,0.00006545023],"domain_scores_gemma":[0.99904424,0.0005128217,0.00009509763,0.00012327386,0.00013867377,0.000085979205],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021608297,0.0011713187,0.00096825854,0.0009631243,0.00043134997,0.0012191178,0.003094207,0.0017458551,0.0056868102],"category_scores_gemma":[0.0050765434,0.00073587365,0.0012040886,0.00090524426,0.00061899034,0.0013888003,0.0023763063,0.00270228,0.0018952966],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009799522,0.00058884075,0.006421093,0.0008524355,0.00050692284,0.00041768185,0.00007496051,0.43259525,0.007239099,0.008673718,0.08435358,0.45729637],"study_design_scores_gemma":[0.000078010955,0.00006954655,0.00029341434,0.000020295252,0.000024484905,0.00006874942,0.0000060577922,0.9853689,0.00341027,0.0066002468,0.0040461826,0.000013937965],"about_ca_topic_score_codex":0.0062723598,"about_ca_topic_score_gemma":0.007117576,"teacher_disagreement_score":0.0062723598,"about_ca_system_score_codex":0.0014327297,"about_ca_system_score_gemma":0.0025927618,"threshold_uncertainty_score":0.019024312},"labels":[],"label_agreement":null},{"id":"W4391463569","doi":"10.1093/bioadv/vbae016","title":"HiTaxon: a hierarchical ensemble framework for taxonomic classification of short reads","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Ministry of Agriculture, Food and Rural Affairs; University of Toronto; Compute Canada; Canada Foundation for Innovation; Ontario Ministry of Agriculture, Food and Rural Affairs; Government of Ontario","keywords":"Metagenomics; Biological classification; Computer science; Taxonomy (biology); Taxonomic rank; Microbiome; Key (lock); Artificial intelligence; Taxon; Data mining; Machine learning; Biology; Bioinformatics; Evolutionary biology; Ecology; Genetics","score_opus":0.026361272046267495,"score_gpt":0.29361646681389775,"score_spread":0.26725519476763027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391463569","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0098562585,0.0005440034,0.97297,0.00017118725,0.000099500445,0.00014839697,0.0027364646,0.012434165,0.001039973],"genre_scores_gemma":[0.13618785,0.0005438092,0.8359277,0.0003918887,0.00020087791,0.00061117625,0.021624325,0.0014689908,0.0030434146],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984371,0.00042122466,0.00009281177,0.00040625714,0.0005151764,0.0001274317],"domain_scores_gemma":[0.99805826,0.00073312165,0.00013254845,0.00032047482,0.00059357326,0.00016205365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036122147,0.001224294,0.0012277412,0.0021752848,0.0010770146,0.0018221169,0.002465397,0.0010475552,0.003507971],"category_scores_gemma":[0.007924109,0.0005922991,0.0014333819,0.0019007192,0.00039806147,0.0023533292,0.0023066236,0.0018931301,0.001940784],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007987773,0.00029250165,0.012677192,0.0005466886,0.0009962793,0.0003022982,0.0006801671,0.2315353,0.013695959,0.013548027,0.037474994,0.6874518],"study_design_scores_gemma":[0.00002643437,0.00011223893,0.001807992,0.000053994558,0.000089460955,0.000080382866,0.00007174172,0.96242326,0.0031884846,0.023032906,0.009069691,0.000043366406],"about_ca_topic_score_codex":0.010902425,"about_ca_topic_score_gemma":0.019910099,"teacher_disagreement_score":0.010902425,"about_ca_system_score_codex":0.00089098373,"about_ca_system_score_gemma":0.0016507817,"threshold_uncertainty_score":0.02167797},"labels":[],"label_agreement":null},{"id":"W4394762701","doi":"10.1093/bioadv/vbae047","title":"Text-mining-based feature selection for anticancer drug response prediction","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Stem Cell Network","keywords":"Feature selection; Pharmacogenomics; Machine learning; Computer science; Artificial intelligence; Feature (linguistics); Drug response; Selection (genetic algorithm); Support vector machine; Data mining; Bioinformatics; Drug; Biology","score_opus":0.012497927457812086,"score_gpt":0.3089335441867941,"score_spread":0.296435616728982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394762701","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.37865725,0.004489935,0.49910426,0.002392975,0.0004638073,0.0012777486,0.07495586,0.033518113,0.0051400815],"genre_scores_gemma":[0.67064327,0.0007160953,0.27877262,0.0003482848,0.00022240305,0.0009622552,0.04586491,0.00040844083,0.0020616946],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994124,0.00016216275,0.0000881921,0.00013176662,0.000159017,0.000046436708],"domain_scores_gemma":[0.9975803,0.0014653614,0.00025345664,0.00016044846,0.00047549236,0.000065058244],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012238234,0.0008609306,0.00094116176,0.0028402766,0.0002536623,0.00064421,0.00076507934,0.00050943834,0.00415109],"category_scores_gemma":[0.0054049077,0.00016132275,0.0009310082,0.0026988124,0.00015011412,0.0007031786,0.00038850124,0.00048327196,0.0016476584],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018520547,0.00094365707,0.029828195,0.0011890184,0.00036860936,0.00063659926,0.000082128296,0.048585057,0.04540935,0.0011209802,0.049468406,0.82051593],"study_design_scores_gemma":[0.00029184067,0.00062621123,0.023663523,0.0001274165,0.0003085999,0.00057381974,0.0000701914,0.8898602,0.062255565,0.006647196,0.015489041,0.0000864178],"about_ca_topic_score_codex":0.0015656912,"about_ca_topic_score_gemma":0.0016123096,"teacher_disagreement_score":0.00415109,"about_ca_system_score_codex":0.0003428434,"about_ca_system_score_gemma":0.00062482955,"threshold_uncertainty_score":0.01388675},"labels":[],"label_agreement":null},{"id":"W4396722621","doi":"10.1093/bioadv/vbae066","title":"Network depth affects inference of gene sets from bacterial transcriptomes using denoising autoencoders","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Inference; Artificial intelligence; Transcriptome; Noise reduction; Pattern recognition (psychology); Computer science; Gene; Computational biology; Biology; Gene expression; Genetics","score_opus":0.015222515311411207,"score_gpt":0.2686701019971908,"score_spread":0.2534475866857796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396722621","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7279734,0.00051821076,0.2623709,0.0010233073,0.0000784872,0.000055138335,0.0019957686,0.003898863,0.0020860007],"genre_scores_gemma":[0.8472287,0.00017375995,0.14625436,0.00027549654,0.000020376288,0.00006988779,0.0048112837,0.0002868902,0.00087914575],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995869,0.00014171077,0.000019725723,0.00012678679,0.000082333216,0.000042516356],"domain_scores_gemma":[0.9964824,0.0026631032,0.00012293711,0.0002911294,0.00035181333,0.00008862929],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00216643,0.0006157444,0.00043430686,0.00050094025,0.00034915505,0.00068166887,0.0007453095,0.0006804668,0.001074874],"category_scores_gemma":[0.007825028,0.0004224835,0.000659317,0.0003718256,0.0005669957,0.0009112491,0.0008112426,0.0017510243,0.00034154014],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053606095,0.00013587657,0.01934957,0.0001884672,0.00018798505,0.000089552515,0.00015572029,0.87550837,0.045267224,0.0029372608,0.0027484035,0.052895512],"study_design_scores_gemma":[0.000008797399,0.00001615622,0.0014794787,0.000008005777,0.000008968901,0.000007407205,0.000017001392,0.9902816,0.006139428,0.0017554438,0.00027161528,0.0000060732996],"about_ca_topic_score_codex":0.008806705,"about_ca_topic_score_gemma":0.011352933,"teacher_disagreement_score":0.008806705,"about_ca_system_score_codex":0.00086033234,"about_ca_system_score_gemma":0.0008609913,"threshold_uncertainty_score":0.017510891},"labels":[],"label_agreement":null},{"id":"W4398222897","doi":"10.1093/bioadv/vbae069","title":"Biology’s transformation: from observation through experiment to computation","year":2024,"lang":"en","type":"editorial","venue":"Bioinformatics Advances","topic":"Philosophy and History of Science","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Toronto","keywords":"Transformation (genetics); Computation; Biology; Computer science; Computational biology; Algorithm; Genetics","score_opus":0.05479374890839916,"score_gpt":0.30229577410893804,"score_spread":0.24750202520053888,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398222897","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007734778,0.06276701,0.018929297,0.3211885,0.5463061,0.000045343768,0.00051759894,0.00080101343,0.048671793],"genre_scores_gemma":[0.04014152,0.071704,0.011269381,0.062081028,0.76039684,0.0001350399,0.00042844022,0.0013469757,0.05249683],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967188,0.0012274069,0.0001993594,0.00057269004,0.0011755057,0.00010622012],"domain_scores_gemma":[0.9813704,0.014370533,0.00034018824,0.0011883235,0.0021074195,0.0006231568],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.0064570317,0.0006043608,0.0007329537,0.002118671,0.0014505831,0.007600631,0.0012747154,0.0032397676,0.010403993],"category_scores_gemma":[0.029624281,0.00038137025,0.0006050193,0.0008890002,0.009743477,0.007523957,0.002372458,0.008824186,0.0038564717],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004005865,0.000007856364,0.00010842666,0.0005407619,0.000022241205,0.0001377608,0.0008721434,0.00031692628,0.00027731006,0.13757683,0.80368054,0.0564191],"study_design_scores_gemma":[0.0000065994327,0.000005871784,0.00013043887,0.00035790753,0.000009655561,0.000063857755,0.00020248599,0.00029476965,0.00021840089,0.09357631,0.9051211,0.000012511466],"about_ca_topic_score_codex":0.0018050496,"about_ca_topic_score_gemma":0.0028702207,"teacher_disagreement_score":0.9985494,"about_ca_system_score_codex":0.002217093,"about_ca_system_score_gemma":0.0021935876,"threshold_uncertainty_score":0.03480482},"labels":[],"label_agreement":null},{"id":"W4399880261","doi":"10.1093/bioadv/vbae095","title":"SlowMoMan: a web app for discovery of important features along user-drawn trajectories in 2D embeddings","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"The Scarborough Hospital; University of Toronto; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Embedding; Computer science; Discriminative model; Manifold (fluid mechanics); Nonlinear dimensionality reduction; Inference; sort; Code (set theory); Path (computing); Space (punctuation); Theoretical computer science; Information retrieval; Data mining; Artificial intelligence; Programming language; Dimensionality reduction","score_opus":0.007143956142107216,"score_gpt":0.25038757708409864,"score_spread":0.24324362094199142,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399880261","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013713569,0.0006857741,0.32111105,0.0005195694,0.00034372555,0.00043730836,0.05605258,0.6002143,0.0069221277],"genre_scores_gemma":[0.14263336,0.0013510943,0.63770455,0.0012194649,0.00026921724,0.0033892398,0.1227453,0.07038345,0.020304363],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99961334,0.00005063156,0.000023950388,0.00010379592,0.00017026564,0.000038020862],"domain_scores_gemma":[0.9983803,0.0010039513,0.000095947005,0.00021650507,0.00017919808,0.00012406663],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007893867,0.0024913456,0.001287482,0.0024527397,0.00062222785,0.0014769174,0.0020963317,0.0013642476,0.079994805],"category_scores_gemma":[0.004942854,0.0008539736,0.0015422851,0.0017344995,0.00044268556,0.0021696556,0.0040087793,0.0012141665,0.02607491],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020932325,0.00030465302,0.008908872,0.0027448914,0.0004113834,0.000993764,0.0006683955,0.010466891,0.01650035,0.008852391,0.61754763,0.3305075],"study_design_scores_gemma":[0.0010512111,0.0004766897,0.013627842,0.00061687164,0.00013483879,0.0015235649,0.00052717363,0.550506,0.03597443,0.08408825,0.3109948,0.0004782739],"about_ca_topic_score_codex":0.0018788709,"about_ca_topic_score_gemma":0.0068871756,"teacher_disagreement_score":0.079994805,"about_ca_system_score_codex":0.000416056,"about_ca_system_score_gemma":0.0008479721,"threshold_uncertainty_score":0.26760924},"labels":[],"label_agreement":null},{"id":"W4400638857","doi":"10.1093/bioadv/vbae098","title":"loco-pipe: an automated pipeline for population genomics with low-coverage whole-genome sequencing","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"National Institute of General Medical Sciences; North Pacific Research Board","keywords":"Pipeline (software); Genomics; Computer science; Streamlines, streaklines, and pathlines; Population; Set (abstract data type); Pipeline transport; Genome; Computational biology; Biology; Engineering; Genetics; Medicine; Operating system; Gene; Programming language","score_opus":0.0092613412800591,"score_gpt":0.2608134375166964,"score_spread":0.25155209623663727,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400638857","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00613911,0.0004807055,0.69893545,0.00046991964,0.00035302172,0.0005375248,0.05450689,0.23418689,0.0043904795],"genre_scores_gemma":[0.03208385,0.0004741276,0.75219095,0.001000548,0.00017295447,0.0022747754,0.13742158,0.06726786,0.007113366],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99798906,0.00037242752,0.00014522203,0.0008043027,0.00049158256,0.0001973167],"domain_scores_gemma":[0.9963845,0.0015868226,0.00036231635,0.00069606653,0.0006254662,0.00034484154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005268511,0.002173491,0.0018629186,0.0024582304,0.0016210782,0.0026749135,0.0035809744,0.0014124366,0.03570952],"category_scores_gemma":[0.011677315,0.0023263243,0.002921171,0.0018400686,0.001094177,0.002612645,0.0045492006,0.0042269104,0.031318963],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017383072,0.00019605702,0.009172753,0.0045499844,0.0010838135,0.000614134,0.0017606228,0.011298801,0.13248561,0.016068785,0.57960135,0.24142972],"study_design_scores_gemma":[0.0010495795,0.00038121265,0.015203369,0.0005969519,0.0004926911,0.0011575934,0.00031135223,0.120566346,0.12518305,0.05601612,0.67830735,0.0007343814],"about_ca_topic_score_codex":0.003004903,"about_ca_topic_score_gemma":0.0051619783,"teacher_disagreement_score":0.03570952,"about_ca_system_score_codex":0.0008843173,"about_ca_system_score_gemma":0.0032843796,"threshold_uncertainty_score":0.119460285},"labels":[],"label_agreement":null},{"id":"W4400726464","doi":"10.1093/bioadv/vbae097","title":"Knowledge graph embeddings in the biomedical domain: are they useful? A look at link prediction, rule learning, and downstream polypharmacy tasks","year":2024,"lang":"en","type":"review","venue":"Bioinformatics Advances","topic":"Advanced Graph Neural Networks","field":"Computer Science","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Instituto de Ciencias del Mar y Limnología, Universidad Nacional Autónoma de México; Engineering and Physical Sciences Research Council; UK Research and Innovation; Institute for Catastrophic Loss Reduction; Science and Technology Facilities Council; European Commission; Dell EMC; Accenture; Cisco Systems","keywords":"Computer science; Interpretability; Embedding; Machine learning; Artificial intelligence; Knowledge graph; Field (mathematics); Downstream (manufacturing); Graph; Data science; Theoretical computer science","score_opus":0.021973077866220783,"score_gpt":0.3223211017238577,"score_spread":0.3003480238576369,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400726464","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3388295,0.009167101,0.58529186,0.018479872,0.0009908555,0.000658032,0.010474207,0.019622026,0.016486643],"genre_scores_gemma":[0.50502366,0.003715019,0.46772912,0.0015065123,0.00018682043,0.0003505219,0.01653469,0.0009758081,0.0039778226],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990282,0.00044293798,0.00006511956,0.0001962682,0.00021044961,0.000056970093],"domain_scores_gemma":[0.9906669,0.006618336,0.00045197972,0.001232341,0.0007428924,0.0002874495],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0028954728,0.00086309656,0.0004769985,0.0011708188,0.00042528316,0.0015227079,0.0013180182,0.001545793,0.0051102615],"category_scores_gemma":[0.022895386,0.00037629838,0.0006591138,0.0013215824,0.0008543758,0.004387149,0.0015196558,0.0022568817,0.0015715387],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008448013,0.00088041485,0.022041868,0.0013708909,0.000202047,0.00071999495,0.0005147214,0.37406698,0.0048298268,0.023804402,0.055711687,0.5150124],"study_design_scores_gemma":[0.00010826931,0.00018559785,0.0020391936,0.00021789724,0.000048570462,0.0002533343,0.00020030742,0.9251048,0.0059155533,0.050488062,0.015401085,0.00003734511],"about_ca_topic_score_codex":0.0057619675,"about_ca_topic_score_gemma":0.0096308915,"teacher_disagreement_score":0.0057619675,"about_ca_system_score_codex":0.00097082707,"about_ca_system_score_gemma":0.0013027603,"threshold_uncertainty_score":0.017095506},"labels":[],"label_agreement":null},{"id":"W4401200522","doi":"10.1093/bioadv/vbae108","title":"Investigating alignment-free machine learning methods for HIV-1 subtype classification","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"HIV Research and Treatment","field":"Immunology and Microbiology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Canada Research Chairs","keywords":"Human immunodeficiency virus (HIV); Computer science; Artificial intelligence; Machine learning; Virology; Computational biology; Medicine; Biology","score_opus":0.03916500014261359,"score_gpt":0.35511429207348705,"score_spread":0.31594929193087345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401200522","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24046463,0.0125939185,0.72308457,0.0037695973,0.0011124009,0.0004649046,0.002408758,0.0075804843,0.008520785],"genre_scores_gemma":[0.58996284,0.0019389633,0.39250275,0.0012249233,0.0004750338,0.00038183603,0.007585577,0.00049405236,0.005434072],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99835986,0.0007051565,0.00012575636,0.00033566207,0.00034022672,0.00013329419],"domain_scores_gemma":[0.99579597,0.0024824198,0.0002305107,0.00043104266,0.00093194144,0.00012808555],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033602205,0.0011045065,0.00084357464,0.001280412,0.0005940628,0.00095997594,0.0014012121,0.0011649221,0.0030243262],"category_scores_gemma":[0.008936033,0.00027060608,0.00077750895,0.0015458842,0.00031155482,0.0019567925,0.00078742875,0.0018094572,0.0018516673],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006407876,0.0005192994,0.013891602,0.00040804595,0.0002870484,0.000105128354,0.00015234794,0.18812256,0.003921225,0.005463066,0.018966885,0.7675221],"study_design_scores_gemma":[0.00003391672,0.000103415354,0.0009669155,0.000037000693,0.000024360108,0.000037659825,0.000050838124,0.98900664,0.0017042295,0.0063663158,0.0016582332,0.000010451983],"about_ca_topic_score_codex":0.005052104,"about_ca_topic_score_gemma":0.004642503,"teacher_disagreement_score":0.005052104,"about_ca_system_score_codex":0.0006939724,"about_ca_system_score_gemma":0.0013167477,"threshold_uncertainty_score":0.017770767},"labels":[],"label_agreement":null},{"id":"W4402914764","doi":"10.1093/bioadv/vbae146","title":"Chronogram: an R package for data curation and analysis of infection and vaccination cohort studies","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"vaccines and immunoinformatics approaches","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Infection and Immunity","funders":"Medical Research Council; Francis Crick Institute; Cancer Research UK; Wellcome Trust; London School of Hygiene and Tropical Medicine","keywords":"Cohort; Vaccination; R package; Cohort study; Data curation; Biology; Data science; Environmental health; Computational biology; Medicine; Virology; Computer science; Internal medicine","score_opus":0.03960482596782377,"score_gpt":0.3467256947207792,"score_spread":0.3071208687529554,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402914764","genre_codex":"dataset","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022353437,0.001515847,0.27290532,0.00147814,0.0008089153,0.0011285938,0.5224113,0.19240475,0.0051118364],"genre_scores_gemma":[0.033413924,0.0022934629,0.4366195,0.0021674316,0.00062893494,0.010108081,0.3572281,0.14982812,0.0077124266],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9926565,0.003239366,0.0009684504,0.0018582431,0.0009916855,0.00028573142],"domain_scores_gemma":[0.94647735,0.03701696,0.0037189673,0.0077593955,0.0038701394,0.001157163],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0148730995,0.0027847968,0.0029084077,0.0058897566,0.00088426546,0.0042844713,0.0035329978,0.001109299,0.10557263],"category_scores_gemma":[0.08603369,0.0022946836,0.003942277,0.006696691,0.0010809695,0.0028390451,0.003913156,0.0031779471,0.051818334],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001000866,0.00004624992,0.0072936136,0.007365088,0.002352263,0.00038855986,0.000440199,0.0040313844,0.0017266454,0.009263721,0.90780723,0.058284096],"study_design_scores_gemma":[0.0012082908,0.00014310006,0.01093796,0.0018277057,0.0014265183,0.0008141098,0.00019278376,0.017776676,0.0045119436,0.054674808,0.906176,0.00031005032],"about_ca_topic_score_codex":0.0053119357,"about_ca_topic_score_gemma":0.008494134,"teacher_disagreement_score":0.10557263,"about_ca_system_score_codex":0.0009935858,"about_ca_system_score_gemma":0.007320491,"threshold_uncertainty_score":0.35317564},"labels":[],"label_agreement":null},{"id":"W4403924852","doi":"10.1093/bioadv/vbae168","title":"Population-aware permutation-based significance thresholds for genome-wide association studies","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre; University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Bundesministerium für Bildung und Forschung","keywords":"Genome-wide association study; Genetic association; Association (psychology); Population; Genetics; Permutation (music); Biology; Computational biology; Evolutionary biology; Single-nucleotide polymorphism; Medicine; Psychology; Genotype; Gene; Environmental health; Physics","score_opus":0.018915421484220853,"score_gpt":0.3156294565846542,"score_spread":0.2967140351004333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403924852","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007952648,0.00032656096,0.97995317,0.00043043034,0.00019280773,0.00022063078,0.0017683771,0.008393181,0.0007621389],"genre_scores_gemma":[0.11036502,0.00020643987,0.88138497,0.00035601572,0.00019664694,0.001221524,0.0031700954,0.0021898276,0.0009095255],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9908345,0.006020814,0.00054636213,0.0013380832,0.0010057829,0.0002544718],"domain_scores_gemma":[0.96664155,0.024608415,0.0013159071,0.0047814036,0.0021256336,0.0005271194],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01442979,0.0009412487,0.0013464995,0.002163425,0.00081831246,0.0018687102,0.002359571,0.001225303,0.009591878],"category_scores_gemma":[0.08006688,0.0008890066,0.0016587157,0.0033467587,0.001352682,0.0014178575,0.0018221092,0.0031408689,0.0034276114],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028319112,0.00038603845,0.025236815,0.0023859243,0.002132587,0.0014119407,0.0006555972,0.11033237,0.045227744,0.06416636,0.07274893,0.67248374],"study_design_scores_gemma":[0.0010304955,0.0004917483,0.012027143,0.00025306852,0.00042873484,0.0013554312,0.0001574803,0.62316376,0.03535448,0.27444026,0.051045496,0.00025194397],"about_ca_topic_score_codex":0.0015984351,"about_ca_topic_score_gemma":0.0022743228,"teacher_disagreement_score":0.01442979,"about_ca_system_score_codex":0.0006013829,"about_ca_system_score_gemma":0.00278984,"threshold_uncertainty_score":0.07631296},"labels":[],"label_agreement":null},{"id":"W4404509197","doi":"10.1093/bioadv/vbae166","title":"The ISCB competency framework v. 3: a revised and extended standard for bioinformatics education and training","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Institute for Cancer Research","funders":"Common Fund; National Human Genome Research Institute; UK Research and Innovation; European Commission; Government of Ontario; European Molecular Biology Laboratory; National Institutes of Health; Ontario Institute for Cancer Research","keywords":"Computer science; Bioinformatics; Computational biology; Biology","score_opus":0.015503383659866005,"score_gpt":0.32277806113022606,"score_spread":0.3072746774703601,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404509197","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018873837,0.004409798,0.5751832,0.053357694,0.0042216596,0.016807362,0.015048377,0.011886746,0.30021134],"genre_scores_gemma":[0.05376933,0.0037174704,0.83574295,0.011155688,0.00039969545,0.017587315,0.029284354,0.0029422229,0.0454009],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9460854,0.022905245,0.006991913,0.002041048,0.017968861,0.004007513],"domain_scores_gemma":[0.89311254,0.035302453,0.0051669613,0.0063518933,0.051657695,0.008408382],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05426238,0.0012979271,0.0013978966,0.007762475,0.0034953938,0.008857183,0.0052305064,0.004944379,0.012681984],"category_scores_gemma":[0.1341381,0.0012537505,0.0027103066,0.0060221427,0.004164551,0.006671175,0.008783949,0.0075514247,0.014100484],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017362517,0.0006954541,0.007408202,0.0034627034,0.00006219243,0.000311888,0.009261735,0.004113421,0.002849838,0.19608288,0.39270914,0.3828689],"study_design_scores_gemma":[0.00007480198,0.00016147539,0.009412096,0.0068058735,0.0000370773,0.0005600265,0.0025160154,0.0026922114,0.0020760542,0.051558062,0.9238946,0.0002117255],"about_ca_topic_score_codex":0.04055117,"about_ca_topic_score_gemma":0.043757204,"teacher_disagreement_score":0.05426238,"about_ca_system_score_codex":0.013387609,"about_ca_system_score_gemma":0.07683695,"threshold_uncertainty_score":0.28697038},"labels":[],"label_agreement":null},{"id":"W4404647992","doi":"10.1093/bioadv/vbag121","title":"New algorithms for unsupervised cell clustering from scRNA-seq data","year":2024,"lang":"en","type":"preprint","venue":"Bioinformatics Advances","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Misericordia Community Hospital","funders":"","keywords":"Cluster analysis; Computer science; Biclustering; Artificial intelligence; Data mining; Algorithm; Correlation clustering; CURE data clustering algorithm","score_opus":0.050223387224697366,"score_gpt":0.2958406344081931,"score_spread":0.2456172471834957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404647992","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043374524,0.000059570277,0.9941499,0.00004451038,0.00001973899,0.000032336407,0.000072991694,0.0011137836,0.00016970024],"genre_scores_gemma":[0.04113274,0.000082855404,0.9560149,0.00008173593,0.00003310629,0.00015638446,0.00075345405,0.00027751984,0.0014672444],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989189,0.00015905705,0.0000788704,0.00041054442,0.00034422407,0.00008838997],"domain_scores_gemma":[0.99777216,0.00081590505,0.00024168672,0.00032759298,0.0007545428,0.00008806465],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00155478,0.0010241648,0.0011248318,0.002041784,0.00070895866,0.0010513875,0.002044554,0.0012552441,0.0016982834],"category_scores_gemma":[0.004183533,0.00073063356,0.0014740265,0.0014833241,0.0008145436,0.0010849796,0.0015337558,0.0017573418,0.001697745],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022793944,0.00011917636,0.001965288,0.00017261157,0.00020631043,0.00011101712,0.00020404339,0.40466297,0.03480377,0.010957071,0.004202189,0.5423676],"study_design_scores_gemma":[0.000006276651,0.0000125937895,0.00041684866,0.00000562593,0.0000073481215,0.000033147895,0.000013711586,0.98803306,0.0054850164,0.0048549664,0.0011190264,0.000012404243],"about_ca_topic_score_codex":0.005903542,"about_ca_topic_score_gemma":0.008792155,"teacher_disagreement_score":0.005903542,"about_ca_system_score_codex":0.0013013236,"about_ca_system_score_gemma":0.0013142895,"threshold_uncertainty_score":0.01173836},"labels":[],"label_agreement":null},{"id":"W4405910570","doi":"10.1093/bioadv/vbae184","title":"Predicting CRISPR-Cas9 off-target effects in human primary cells using bidirectional LSTM with BERT embedding","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"CRISPR and Genetic Engineering","field":"Biochemistry, Genetics and Molecular Biology","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; National Research Council Canada; McGill University","funders":"National Research Council Canada","keywords":"CRISPR; Embedding; Primary (astronomy); Computer science; Computational biology; Biology; Artificial intelligence; Genetics; Gene; Physics","score_opus":0.004768933118316525,"score_gpt":0.2879238221660577,"score_spread":0.2831548890477412,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405910570","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52254415,0.0030583672,0.4490979,0.0009815026,0.00025515043,0.0001086344,0.006874354,0.0110684475,0.0060115266],"genre_scores_gemma":[0.94727576,0.00057917915,0.04430568,0.00022388987,0.000016588136,0.0001011386,0.0031343785,0.00012883573,0.004234552],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99989784,0.000017387318,0.000005742496,0.00003530752,0.000023994955,0.000019781526],"domain_scores_gemma":[0.99987113,0.00006291822,0.000011724905,0.000012468308,0.000031347594,0.000010381788],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002743312,0.00054344407,0.0003798454,0.00018421335,0.000111564004,0.00036425758,0.00039080405,0.0005954269,0.0016085644],"category_scores_gemma":[0.0006896622,0.00018227169,0.00040005028,0.00020955257,0.00014290118,0.00022499291,0.00030419452,0.0005976264,0.0007470228],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005698156,0.00019195206,0.0064034876,0.00030493396,0.000115240284,0.0003798241,0.00006856099,0.64395493,0.15085077,0.0016245969,0.008939242,0.18659672],"study_design_scores_gemma":[0.000006996403,0.00005500983,0.0007002869,0.0000066357456,0.000010672495,0.00003441022,0.000010465291,0.96032965,0.037441123,0.0007364281,0.0006582135,0.000010041382],"about_ca_topic_score_codex":0.0058446717,"about_ca_topic_score_gemma":0.008363593,"teacher_disagreement_score":0.0058446717,"about_ca_system_score_codex":0.00055142096,"about_ca_system_score_gemma":0.0005031612,"threshold_uncertainty_score":0.011621296},"labels":[],"label_agreement":null},{"id":"W4406713780","doi":"10.1093/bioadv/vbae209","title":"<u>Imp</u>utation for <u>Li</u>pidomics and <u>Met</u>abolomics (ImpLiMet): a web-based application for optimization and method selection for missing data imputation","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Occupational Cancer Research Centre; University of Toronto; McGill Genome Centre; National Research Council Canada; McGill University; University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Missing data; Computer science; Mathematics; Statistics","score_opus":0.05619849722513385,"score_gpt":0.42300350110061274,"score_spread":0.3668050038754789,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406713780","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041795373,0.001112062,0.21593738,0.0021750992,0.001523721,0.00039473665,0.20397492,0.55490434,0.01579824],"genre_scores_gemma":[0.04078936,0.0016694855,0.35266653,0.0040873117,0.0007821752,0.0026887082,0.31540343,0.26038772,0.021525245],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99632996,0.00085126056,0.00029163528,0.0009123504,0.0012834071,0.00033144417],"domain_scores_gemma":[0.9897612,0.005305578,0.0009947664,0.0021491207,0.001240365,0.0005489194],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008406925,0.003169103,0.00304155,0.0032121378,0.0019926974,0.0047057946,0.004611419,0.0028769225,0.2249493],"category_scores_gemma":[0.031309277,0.0022536253,0.0035635824,0.0043432005,0.0012875801,0.0035673196,0.0063043525,0.0038364758,0.13203765],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00091093,0.00011918346,0.0039112517,0.0020164412,0.00039426968,0.0006342753,0.00029283515,0.0035479534,0.004601014,0.008136324,0.89799494,0.07744048],"study_design_scores_gemma":[0.00092440576,0.00023504811,0.0061697676,0.0009632919,0.00025307445,0.0012961619,0.00016606353,0.065936275,0.038545046,0.06098047,0.824046,0.00048435142],"about_ca_topic_score_codex":0.0031164286,"about_ca_topic_score_gemma":0.0050461516,"teacher_disagreement_score":0.2249493,"about_ca_system_score_codex":0.0014780851,"about_ca_system_score_gemma":0.0034033484,"threshold_uncertainty_score":0.7525304},"labels":[],"label_agreement":null},{"id":"W4407174948","doi":"10.1093/bioadv/vbaf014","title":"Leveraging LASSO-based methodologies for enhanced SNP analysis in plant genomes","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Guelph; Algoma University; Thompson Rivers University","funders":"Natural Sciences and Engineering Research Council of Canada; Thompson Rivers University","keywords":"Lasso (programming language); SNP; Computational biology; Genome; Biology; Genomic selection; Computer science; Genetics; Single-nucleotide polymorphism; Genotype; World Wide Web; Gene","score_opus":0.04697469140103604,"score_gpt":0.3454984677685396,"score_spread":0.29852377636750355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407174948","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005888176,0.00016683163,0.99154925,0.00027463477,0.000040095416,0.000019624724,0.00030664908,0.0013059963,0.00044869422],"genre_scores_gemma":[0.12220275,0.0002429168,0.87273693,0.00039060117,0.00013573871,0.000231826,0.0020259349,0.00094636524,0.0010869005],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978835,0.0012851949,0.0000876286,0.0002861931,0.00037628956,0.00008114831],"domain_scores_gemma":[0.99466234,0.0037670974,0.0003501294,0.00052322046,0.00054549915,0.00015171792],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004985654,0.0009268589,0.0011851676,0.0007881611,0.00048462566,0.0014767211,0.0014684469,0.0009879044,0.0034083494],"category_scores_gemma":[0.009851917,0.0005058634,0.0014239182,0.0009791384,0.0007046638,0.0009989908,0.0018549698,0.002319611,0.0015005434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025678336,0.0001511548,0.005046796,0.00049130566,0.00040318887,0.00032116123,0.00027825614,0.7232251,0.021189775,0.03407813,0.011944269,0.20261405],"study_design_scores_gemma":[0.000013915797,0.000014458442,0.00030318857,0.000014520236,0.00000886995,0.000019123294,0.000013567575,0.98326516,0.0009627156,0.013401792,0.0019697621,0.000012949208],"about_ca_topic_score_codex":0.0014414357,"about_ca_topic_score_gemma":0.0019135597,"teacher_disagreement_score":0.004985654,"about_ca_system_score_codex":0.000365416,"about_ca_system_score_gemma":0.00077607,"threshold_uncertainty_score":0.026367009},"labels":[],"label_agreement":null},{"id":"W4407603264","doi":"10.1093/bioadv/vbag179","title":"CycleMix: Gaussian Mixture Modeling of the Cell Cycle","year":2025,"lang":"en","type":"preprint","venue":"Bioinformatics Advances","topic":"Gene Regulatory Network Analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Gaussian; Mixture model; Computer science; Statistical physics; Artificial intelligence; Physics; Chemistry; Computational chemistry","score_opus":0.005661072395691977,"score_gpt":0.23241871094834993,"score_spread":0.22675763855265796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407603264","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010966821,0.0007584018,0.9768439,0.00028862874,0.00012727497,0.00012535627,0.0032237459,0.0066444026,0.0010214692],"genre_scores_gemma":[0.28557006,0.0014629754,0.6624204,0.0007709383,0.00039431592,0.0017703626,0.023143295,0.0040729134,0.02039471],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995597,0.000107637905,0.000014563552,0.00018688125,0.00008740766,0.000043753054],"domain_scores_gemma":[0.99929476,0.00039363958,0.000049381182,0.000101583784,0.00012359733,0.000036928475],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001566891,0.0012765427,0.0009421993,0.00082642416,0.0005545021,0.0012708894,0.0019768407,0.0013006217,0.0059246575],"category_scores_gemma":[0.0029923012,0.00070517807,0.0016269145,0.0010220434,0.0006298069,0.00091203355,0.0011179816,0.0019625067,0.0036257398],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005631332,0.00015603114,0.005800952,0.00039023597,0.00036897397,0.00011932671,0.0002287355,0.63220143,0.017922727,0.032518037,0.035788305,0.2739421],"study_design_scores_gemma":[0.000014254259,0.000013540513,0.00064974406,0.000009762078,0.00001225842,0.000021850912,0.0000076137135,0.98052096,0.0021576476,0.010662563,0.0059099253,0.00001983484],"about_ca_topic_score_codex":0.010107267,"about_ca_topic_score_gemma":0.012344516,"teacher_disagreement_score":0.010107267,"about_ca_system_score_codex":0.0011030445,"about_ca_system_score_gemma":0.0014866231,"threshold_uncertainty_score":0.020096898},"labels":[],"label_agreement":null},{"id":"W4408389020","doi":"10.1093/bioadv/vbaf052","title":"RegionScan: a comprehensive R package for region-level genome-wide association testing with integration and visualization of multiple-variant and single-variant hypothesis testing","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Hospital for Sick Children; Lunenfeld-Tanenbaum Research Institute","funders":"Canadian Institutes of Health Research","keywords":"Computer science; Visualization; Linkage disequilibrium; Scalability; Genetic association; Data mining; Biology; Genetics; Allele; Haplotype; Single-nucleotide polymorphism; Database","score_opus":0.05280040378514868,"score_gpt":0.26921073306269605,"score_spread":0.2164103292775474,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408389020","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033118222,0.0018457692,0.48418948,0.0011970912,0.0004981379,0.0005553565,0.13704182,0.36584982,0.005510673],"genre_scores_gemma":[0.051372804,0.001692907,0.61247116,0.0019725654,0.0004269122,0.00516051,0.099627785,0.21981516,0.007460272],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99407345,0.002463096,0.0005123357,0.0012333915,0.0013673573,0.0003504157],"domain_scores_gemma":[0.97009426,0.022664146,0.0019629893,0.0024681774,0.0021119858,0.0006984871],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0091810925,0.0040391227,0.0042039184,0.0048044077,0.0009784553,0.004747396,0.007779616,0.0016407024,0.11288759],"category_scores_gemma":[0.051384613,0.0032402526,0.004627345,0.00473801,0.0013419765,0.0024973478,0.004633154,0.0041262642,0.052760735],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012970642,0.000077529105,0.006648113,0.0047858907,0.0027659042,0.0010020063,0.00045740927,0.018644234,0.0040233424,0.01815292,0.8450449,0.09710066],"study_design_scores_gemma":[0.0025390931,0.00026000213,0.011671188,0.0017648002,0.0022087023,0.0020630332,0.00026420664,0.16463646,0.018988531,0.13912669,0.6556448,0.0008325394],"about_ca_topic_score_codex":0.0083070025,"about_ca_topic_score_gemma":0.008629513,"teacher_disagreement_score":0.11288759,"about_ca_system_score_codex":0.0010062371,"about_ca_system_score_gemma":0.004814169,"threshold_uncertainty_score":0.37764663},"labels":[],"label_agreement":null},{"id":"W4408714891","doi":"10.1093/bioadv/vbaf044","title":"Biological databases in the age of generative artificial intelligence","year":2024,"lang":"en","type":"editorial","venue":"Bioinformatics Advances","topic":"Scientific Computing and Data Management","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Montreal Clinical Research Institute","funders":"H2020 European Research Council","keywords":"Stewardship (theology); Computer science; Data science; Generative grammar; Biological data; Database; Artificial intelligence; Political science","score_opus":0.23202343592757224,"score_gpt":0.440254693494518,"score_spread":0.20823125756694577,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408714891","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000048705686,0.014148564,0.0012571871,0.13446635,0.84700346,0.00002022154,0.00009399097,0.00014306731,0.002818412],"genre_scores_gemma":[0.0010249558,0.01323812,0.0008393666,0.03152535,0.9447349,0.000032291813,0.000067007946,0.0001261598,0.008411869],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99253935,0.0014731773,0.00089458446,0.000745534,0.0041287723,0.00021852787],"domain_scores_gemma":[0.9227352,0.047979463,0.0019253754,0.0022960054,0.02132694,0.003736929],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012206975,0.00168908,0.0017497061,0.0039180047,0.002718979,0.011990408,0.003839566,0.01041589,0.010467446],"category_scores_gemma":[0.05581266,0.00090995774,0.0015320386,0.00223593,0.004993423,0.00758166,0.0022863387,0.023224693,0.008561528],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013271186,0.000004718774,0.000017288252,0.00019525441,0.000009473604,0.00006237857,0.000036559562,0.00004518729,0.000032506858,0.0029744294,0.9885479,0.008061],"study_design_scores_gemma":[0.000012348661,0.0000053764256,0.00004812546,0.00035213356,0.000012019507,0.000100851496,0.00003114666,0.00014084812,0.000049683447,0.0054600486,0.99377763,0.000009892061],"about_ca_topic_score_codex":0.0023131159,"about_ca_topic_score_gemma":0.004182947,"teacher_disagreement_score":0.012206975,"about_ca_system_score_codex":0.0040729954,"about_ca_system_score_gemma":0.0035464363,"threshold_uncertainty_score":0.06455743},"labels":[],"label_agreement":null},{"id":"W4409105075","doi":"10.1093/bioadv/vbaf021","title":"Transfer learning improves performance in volumetric electron microscopy organelle segmentation across tissues","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Advanced Electron Microscopy Techniques and Applications","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Lunenfeld-Tanenbaum Research Institute; Vector Institute; University of Toronto; University Health Network","funders":"","keywords":"Computer science; Transfer of learning; Segmentation; Benchmark (surveying); Artificial intelligence; Annotation; Pattern recognition (psychology); Deep learning; Identification (biology); Organelle; Endoplasmic reticulum; Image segmentation; Volume (thermodynamics); Microscopy; Biology; Pathology; Physics","score_opus":0.004681615284073407,"score_gpt":0.3218662588925711,"score_spread":0.3171846436084977,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409105075","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.557834,0.0070939194,0.3431749,0.0026219685,0.00079262303,0.00033446803,0.0045720222,0.070896804,0.012679357],"genre_scores_gemma":[0.8357439,0.00076339237,0.13711265,0.0011633646,0.00014041395,0.00015836263,0.013888282,0.0024026304,0.008627009],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998985,0.00017409814,0.00005325983,0.00045000706,0.00018667978,0.00015088076],"domain_scores_gemma":[0.99840516,0.00062247645,0.000101324,0.00035650682,0.0003819334,0.00013265625],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025270514,0.0023564042,0.0010762751,0.0012875488,0.00078620104,0.0014987048,0.0022304007,0.002391391,0.003113858],"category_scores_gemma":[0.006014111,0.0004391251,0.0012732508,0.0008998296,0.0008903764,0.0019409687,0.0021344756,0.002031195,0.0024489544],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011006568,0.00060877623,0.009339671,0.0005550233,0.00043935864,0.0003958599,0.00019323117,0.43174177,0.034030266,0.0017757316,0.032919094,0.48690054],"study_design_scores_gemma":[0.000041746098,0.00015990726,0.0016362857,0.00003546292,0.00003881683,0.00009415356,0.000064556516,0.97720563,0.015894802,0.0030613428,0.0017407526,0.000026464166],"about_ca_topic_score_codex":0.010557734,"about_ca_topic_score_gemma":0.0104698315,"teacher_disagreement_score":0.010557734,"about_ca_system_score_codex":0.0014727329,"about_ca_system_score_gemma":0.0012658975,"threshold_uncertainty_score":0.020992577},"labels":[],"label_agreement":null},{"id":"W4409285046","doi":"10.1093/bioadv/vbaf083","title":"“Neuropathological function estimations”: a user-friendly module for analyzing neural activity in neurological disorders","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Montreal Neurological Institute and Hospital; Douglas Mental Health University Institute; McGill University; Dawson College","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Réseau en Bio-Imagerie du Quebec","keywords":"Neuroscience; User Friendly; Function (biology); Computer science; Artificial neural network; Medicine; Physical medicine and rehabilitation; Artificial intelligence; Psychology; Biology; Operating system","score_opus":0.028425696911020124,"score_gpt":0.29264562433775343,"score_spread":0.2642199274267333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409285046","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007586774,0.00032092835,0.30045396,0.00029750154,0.00015176283,0.00037666372,0.022373978,0.6620096,0.0064289393],"genre_scores_gemma":[0.15137635,0.0009089918,0.5368167,0.0017042344,0.00033956842,0.0039443066,0.06872331,0.20934752,0.026839085],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99940586,0.00008908153,0.000078291785,0.0001805463,0.00019231116,0.000053901247],"domain_scores_gemma":[0.9974203,0.0014777883,0.00020842948,0.0002892471,0.00045171162,0.00015255064],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018805553,0.002154163,0.00085648603,0.002502211,0.0003455805,0.0014691512,0.001620501,0.00092868035,0.08330929],"category_scores_gemma":[0.0076167756,0.00096773665,0.0015417124,0.0007908609,0.00041414573,0.0015061235,0.0021121255,0.0010864524,0.02692189],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020482799,0.00032108327,0.017392246,0.0019512377,0.0004958007,0.0009617174,0.00065583835,0.0076286374,0.020066597,0.0050302935,0.579004,0.3644443],"study_design_scores_gemma":[0.0017289466,0.0005140599,0.06517997,0.0012349751,0.00042803978,0.0040395707,0.0002797762,0.30982876,0.11293599,0.03495523,0.46812636,0.0007483547],"about_ca_topic_score_codex":0.0015449146,"about_ca_topic_score_gemma":0.002109005,"teacher_disagreement_score":0.08330929,"about_ca_system_score_codex":0.00040760826,"about_ca_system_score_gemma":0.00084157713,"threshold_uncertainty_score":0.27869737},"labels":[],"label_agreement":null},{"id":"W4409908023","doi":"10.1093/bioadv/vbaf103","title":"Assessing accuracy and specificity of faecal source library for microbial source-tracking, using SourceTracker as case study","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Fecal contamination and water quality","field":"Environmental Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Melbourne Water","keywords":"Source tracking; Open source; Tracking (education); Computer science; Psychology; World Wide Web; Software","score_opus":0.04425365662850683,"score_gpt":0.3352390906556071,"score_spread":0.29098543402710025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409908023","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7156327,0.0032064917,0.26026005,0.0011123712,0.00028826794,0.0013991141,0.006506653,0.0038539213,0.007740545],"genre_scores_gemma":[0.65570885,0.0016080992,0.32776257,0.00060459593,0.00006333148,0.0008675598,0.0070870523,0.0011091647,0.005188743],"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9834673,0.0031889947,0.0015415575,0.0035724347,0.0074172476,0.00081250566],"domain_scores_gemma":[0.9740276,0.0096253045,0.0035794433,0.0028281359,0.009351073,0.00058851857],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015640551,0.0013264297,0.0012740993,0.0026833096,0.0011008107,0.0031944897,0.0014737282,0.0020787595,0.0017868639],"category_scores_gemma":[0.037100058,0.00056757254,0.0010045441,0.002135406,0.0015275584,0.0015321509,0.0029556872,0.0009881599,0.0024275745],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012698561,0.00054062274,0.21958442,0.0037404979,0.0003982457,0.0014933408,0.005319367,0.0064714565,0.5699604,0.0014920832,0.0043862523,0.18534343],"study_design_scores_gemma":[0.00002655784,0.0012883825,0.100677736,0.00085036113,0.0003525088,0.0024888634,0.0022018293,0.023550972,0.8395519,0.0016345147,0.027131392,0.0002450879],"about_ca_topic_score_codex":0.0051767137,"about_ca_topic_score_gemma":0.0097753005,"teacher_disagreement_score":0.015640551,"about_ca_system_score_codex":0.0008665117,"about_ca_system_score_gemma":0.0015330943,"threshold_uncertainty_score":0.08271617},"labels":[],"label_agreement":null},{"id":"W4409962274","doi":"10.1093/bioadv/vbaf098","title":"<i>bamSliceR</i> : a Bioconductor package for rapid, cross-cohort variant and allelic bias analysis","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; Hope Foundation; National Institutes of Health; National Cancer Institute; Genome Canada; Van Andel Research Institute","keywords":"Bioconductor; R package; Allele; Cohort; Genetics; Biology; Computational biology; Statistics; Computer science; Medicine; Mathematics; Gene","score_opus":0.021049864766813527,"score_gpt":0.3088681925524286,"score_spread":0.28781832778561506,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409962274","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024958993,0.0010014053,0.21142906,0.0012702431,0.0010754676,0.0007858558,0.30742848,0.46771038,0.006803308],"genre_scores_gemma":[0.02699541,0.0009705718,0.3710445,0.0028001734,0.00038571717,0.0085630715,0.25553015,0.31946102,0.01424936],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99480236,0.0012700347,0.00054496655,0.0017601586,0.0011412085,0.0004813835],"domain_scores_gemma":[0.9864466,0.0062104287,0.0013286183,0.003061224,0.0021886346,0.0007645342],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01144824,0.005316347,0.0040934198,0.005104979,0.0019409411,0.005021662,0.009448823,0.0025406142,0.18347761],"category_scores_gemma":[0.034698337,0.0032207707,0.0043599866,0.0057064723,0.0017410591,0.0034531758,0.00580111,0.0060711713,0.14498284],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006606361,0.0000633882,0.0030002436,0.0031755944,0.0011051652,0.00031630872,0.00040509374,0.0026032086,0.0035000315,0.00766982,0.9484396,0.02906096],"study_design_scores_gemma":[0.001661785,0.00025196752,0.011474519,0.002034102,0.001316934,0.0010878216,0.0002827047,0.0761434,0.02412562,0.09497623,0.7859688,0.00067615625],"about_ca_topic_score_codex":0.008547866,"about_ca_topic_score_gemma":0.013533543,"teacher_disagreement_score":0.18347761,"about_ca_system_score_codex":0.0017727173,"about_ca_system_score_gemma":0.006816026,"threshold_uncertainty_score":0.61379373},"labels":[],"label_agreement":null},{"id":"W4411332264","doi":"10.1093/bioadv/vbaf129","title":"NRGSuite-Qt: a PyMOL plugin for high-throughput virtual screening, molecular docking, normal-mode analysis, the study of molecular interactions, and the detection of binding-site similarities","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Plug-in; Docking (animal); Virtual screening; Computational biology; Computer science; Binding site; Chemistry; Bioinformatics; Drug discovery; Biology; Operating system; Medicine; Biochemistry","score_opus":0.0045888944274993905,"score_gpt":0.2638198506195027,"score_spread":0.2592309561920033,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411332264","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006955213,0.00095748215,0.3544979,0.0004844908,0.00042545347,0.00024302902,0.019684622,0.6121517,0.004600222],"genre_scores_gemma":[0.090378985,0.0026500556,0.55744517,0.0012385395,0.0002162148,0.0023769469,0.10128278,0.22303091,0.021380337],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99879825,0.000166852,0.00007302709,0.00020879328,0.00058683223,0.00016624322],"domain_scores_gemma":[0.99901354,0.00036940468,0.00008706754,0.00021094603,0.00019179493,0.00012734145],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001996538,0.002454257,0.0017349123,0.0017485297,0.00081134157,0.0017337038,0.0051874584,0.0012041923,0.04208812],"category_scores_gemma":[0.0038662935,0.0018175918,0.0018633974,0.0010592378,0.0006194515,0.0025430117,0.0036673045,0.00371816,0.024360713],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008702909,0.00023093249,0.0022200737,0.0019199178,0.00043776125,0.0005294174,0.00024833845,0.014157555,0.031155605,0.011221329,0.75124764,0.18576106],"study_design_scores_gemma":[0.00079659687,0.00028739538,0.004203495,0.00036071343,0.00015530485,0.0013660789,0.00007308227,0.25597736,0.115363695,0.02098237,0.59974235,0.0006916149],"about_ca_topic_score_codex":0.003875336,"about_ca_topic_score_gemma":0.0043169935,"teacher_disagreement_score":0.04208812,"about_ca_system_score_codex":0.00087334856,"about_ca_system_score_gemma":0.002072697,"threshold_uncertainty_score":0.1407988},"labels":[],"label_agreement":null},{"id":"W4411436820","doi":"10.1093/bioadv/vbaf140","title":"Prediction of the infecting organism in peritoneal dialysis patients with acute peritonitis using interpretable Tsetlin Machines","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Dialysis and Renal Disease Management","field":"Medicine","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Infection and Immunity","funders":"Engineering and Physical Sciences Research Council; Medical Research Council; National Institute for Health and Care Research","keywords":"Peritoneal dialysis; Peritonitis; Organism; Medicine; Dialysis; Intensive care medicine; Computational biology; Internal medicine; Biology; Genetics","score_opus":0.007110007031997439,"score_gpt":0.23912152794933883,"score_spread":0.2320115209173414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411436820","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7140981,0.0019730807,0.26479268,0.0029727546,0.0003369181,0.00022772294,0.007913418,0.0035810238,0.004104294],"genre_scores_gemma":[0.9473579,0.00030158373,0.047484286,0.00022964012,0.00008511681,0.00009159759,0.0038104877,0.000055239598,0.0005840956],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994824,0.00020777051,0.00006193392,0.00012332498,0.000080753176,0.000043763986],"domain_scores_gemma":[0.9968837,0.0021709534,0.00040482718,0.00016105072,0.00026578386,0.00011352782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013252217,0.00067782996,0.00037207082,0.0015451566,0.00019913983,0.0012009552,0.00046536233,0.0007311385,0.0020286264],"category_scores_gemma":[0.008083405,0.00015360765,0.00047028344,0.00076989795,0.00039319682,0.0006231195,0.000703795,0.0006979496,0.0005802543],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019524893,0.00038523207,0.32619333,0.00059768907,0.0002593544,0.0013102163,0.00045014705,0.3831198,0.009290096,0.005578571,0.021817522,0.2490456],"study_design_scores_gemma":[0.000034169494,0.00013684321,0.013564844,0.00007502524,0.00003780905,0.00036587735,0.00011485076,0.9653446,0.0055072242,0.011560439,0.0032280132,0.000030273244],"about_ca_topic_score_codex":0.0012468464,"about_ca_topic_score_gemma":0.0013039575,"teacher_disagreement_score":0.0020286264,"about_ca_system_score_codex":0.000497226,"about_ca_system_score_gemma":0.00054497295,"threshold_uncertainty_score":0.007008493},"labels":[],"label_agreement":null},{"id":"W4412033199","doi":"10.1093/bioadv/vbaf163","title":"Optimal solution to the set cover problem with a vicinity constraint for estimating genotype tissue expression profiles","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Rehabilitation Institute; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Cover (algebra); Set (abstract data type); Set cover problem; Expression (computer science); Constraint (computer-aided design); Computer science; Dynamic programming; Algorithm; Data mining; Computational biology; Biology; Mathematics; Engineering","score_opus":0.015646280706486673,"score_gpt":0.2950535653670106,"score_spread":0.27940728466052395,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412033199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0406681,0.0005528301,0.9526317,0.0007549585,0.000049926577,0.00021514694,0.00083435175,0.0006953419,0.0035976307],"genre_scores_gemma":[0.23305553,0.00035876673,0.7587148,0.00039008027,0.00009927321,0.0006959088,0.0028665778,0.00046921126,0.003349872],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99866986,0.00040921563,0.00005341814,0.00045236683,0.0002769945,0.00013809362],"domain_scores_gemma":[0.99575377,0.0034269057,0.0002200987,0.00020055012,0.00027820878,0.00012043012],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019017734,0.0013195059,0.0018382112,0.0014075782,0.0008972833,0.0014968963,0.0017285773,0.0020323028,0.006732667],"category_scores_gemma":[0.00825003,0.0008212191,0.0017058168,0.0017940975,0.0011231472,0.0014824161,0.0015814104,0.002117992,0.0011645677],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028459082,0.00023136826,0.0040392173,0.0003611022,0.000105159816,0.00023064895,0.00021877655,0.83132446,0.0061483723,0.01416739,0.00821596,0.13467304],"study_design_scores_gemma":[0.00003135234,0.000060549522,0.00068788993,0.000034554243,0.000022535904,0.00010508357,0.000059844835,0.9760031,0.0017894387,0.019566296,0.0016254255,0.000013970765],"about_ca_topic_score_codex":0.004491302,"about_ca_topic_score_gemma":0.004853199,"teacher_disagreement_score":0.006732667,"about_ca_system_score_codex":0.0013896333,"about_ca_system_score_gemma":0.0016900686,"threshold_uncertainty_score":0.022523046},"labels":[],"label_agreement":null},{"id":"W4412033208","doi":"10.1093/bioadv/vbaf162","title":"Volcano: a pipeline to characterize long terminal repeat-retrotransposons families in plants","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Chromosomal and Genetic Variations","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Innovation, Science and Economic Development Canada","funders":"Beijing Academy of Agricultural and Forestry Sciences; Chinese Academy of Sciences","keywords":"Retrotransposon; Long terminal repeat; Genome; Biology; Pipeline (software); Computational biology; Genetics; Computer science; Gene; Transposable element","score_opus":0.01568206321207271,"score_gpt":0.23696252220651856,"score_spread":0.22128045899444584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412033208","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06630554,0.0008558254,0.3672434,0.0005301284,0.00015054477,0.00071422406,0.0821604,0.47823128,0.0038086597],"genre_scores_gemma":[0.19956422,0.00053444825,0.59100103,0.0005183282,0.00009820774,0.0011275772,0.17731774,0.025881693,0.003956691],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99954385,0.000050220442,0.000035069752,0.00021811854,0.000095144,0.000057720026],"domain_scores_gemma":[0.99933064,0.00029579125,0.00009514676,0.000083882514,0.00010994638,0.0000845959],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011569137,0.002123051,0.0007707818,0.0024377855,0.0010757949,0.0011665256,0.0013533771,0.00083793385,0.008970122],"category_scores_gemma":[0.0026554149,0.0008623814,0.0022813939,0.0012893314,0.00046452577,0.0015492374,0.001241969,0.0011201035,0.0038884657],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0034287055,0.00045641867,0.05324189,0.0034939426,0.0011533849,0.0012881211,0.0030286892,0.024327891,0.30922586,0.007513368,0.21531934,0.3775224],"study_design_scores_gemma":[0.0008470833,0.0007456836,0.063264646,0.00026484448,0.00051070267,0.0013375013,0.000978556,0.54925674,0.15637414,0.018975424,0.20697233,0.00047235296],"about_ca_topic_score_codex":0.0052515054,"about_ca_topic_score_gemma":0.00596562,"teacher_disagreement_score":0.008970122,"about_ca_system_score_codex":0.0008950198,"about_ca_system_score_gemma":0.0013326013,"threshold_uncertainty_score":0.030008018},"labels":[],"label_agreement":null},{"id":"W4412397007","doi":"10.1093/bioadv/vbaf170","title":"Hybrid representation learning for human m6A modifications with chromosome-level generalizability","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"RNA modifications and cancer","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Winnipeg","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Generalizability theory; Chromosome; Representation (politics); Computational biology; Psychology; Computer science; Biology; Artificial intelligence; Genetics; Developmental psychology; Gene","score_opus":0.03558883257704904,"score_gpt":0.3212112618748866,"score_spread":0.28562242929783754,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412397007","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.69043773,0.003304265,0.28779295,0.0014306506,0.00010964833,0.00008738634,0.00582509,0.006896578,0.004115685],"genre_scores_gemma":[0.94072634,0.0004248744,0.044443063,0.00035377243,0.000038199007,0.000105186264,0.010431178,0.0001967165,0.0032807884],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99966836,0.000077436816,0.000009259532,0.00016776436,0.000037627604,0.000039445124],"domain_scores_gemma":[0.9993405,0.00032051493,0.000056832403,0.00014138066,0.00010703896,0.00003364307],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010876915,0.0007855461,0.00057546754,0.0005803063,0.00026630872,0.00072686566,0.0008703791,0.00085968414,0.0018777658],"category_scores_gemma":[0.0023257234,0.00023030375,0.0009767347,0.0005878079,0.0004014965,0.0008052334,0.00081366696,0.0011148715,0.0008282212],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006703602,0.00024259316,0.029111186,0.00021100721,0.00045132887,0.0002084642,0.00010383836,0.68912643,0.021007834,0.0034730353,0.012829507,0.24256445],"study_design_scores_gemma":[0.000024590689,0.000063820575,0.003231194,0.000014815854,0.000036241097,0.00004128645,0.00001875976,0.98665386,0.0045885975,0.0043610428,0.0009507229,0.000015027242],"about_ca_topic_score_codex":0.008147165,"about_ca_topic_score_gemma":0.010333462,"teacher_disagreement_score":0.008147165,"about_ca_system_score_codex":0.00080819754,"about_ca_system_score_gemma":0.00060483505,"threshold_uncertainty_score":0.01619953},"labels":[],"label_agreement":null},{"id":"W4412626392","doi":"10.1093/bioadv/vbaf178","title":"Gene-set enrichment analysis and visualization on the web using EnrichmentMap:RNASeq","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; Princess Margaret Cancer Centre; University Health Network; University of Toronto","funders":"National Institutes of Health","keywords":"Visualization; Computational biology; Set (abstract data type); Biology; Computer science; Genetics; World Wide Web; Data mining; Programming language","score_opus":0.012826118544825463,"score_gpt":0.278922961500048,"score_spread":0.2660968429552225,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412626392","genre_codex":"software","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012127685,0.0011643937,0.25553578,0.0010992641,0.00082569104,0.000517648,0.1829243,0.5273463,0.018458946],"genre_scores_gemma":[0.0643707,0.0014572467,0.52112633,0.0021565882,0.00046417938,0.0038294874,0.28008637,0.092588075,0.033921007],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986915,0.00014038802,0.00008015317,0.0003538616,0.0006009499,0.00013311116],"domain_scores_gemma":[0.9983707,0.0007364229,0.00009920646,0.00020900725,0.0004335289,0.00015106866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017272712,0.0021905913,0.0013483281,0.0048205857,0.0010915482,0.002027588,0.0019079371,0.0009859293,0.10956315],"category_scores_gemma":[0.003402991,0.00097375567,0.0014653885,0.0027171425,0.00039713286,0.0015998724,0.0022669986,0.0022337926,0.04142509],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00091099134,0.00025228047,0.003438945,0.0031982507,0.00055879244,0.0008226699,0.00050743285,0.00214392,0.07282641,0.0046615736,0.75674415,0.15393458],"study_design_scores_gemma":[0.00058030273,0.00019020491,0.015966658,0.0006441346,0.00026745105,0.001427207,0.00027591427,0.040142424,0.19228537,0.030158687,0.7175361,0.0005254837],"about_ca_topic_score_codex":0.0021563773,"about_ca_topic_score_gemma":0.0039015238,"teacher_disagreement_score":0.10956315,"about_ca_system_score_codex":0.0004682281,"about_ca_system_score_gemma":0.0012110589,"threshold_uncertainty_score":0.36652523},"labels":[],"label_agreement":null},{"id":"W4412701268","doi":"10.1093/bioadv/vbaf173","title":"SW-actors: accelerating the Smith–Waterman algorithm via actors","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Parallel computing","score_opus":0.01153603087821653,"score_gpt":0.2502597154997679,"score_spread":0.23872368462155136,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412701268","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024108697,0.00046830025,0.9385203,0.00036653498,0.0002355352,0.00010216806,0.0005831893,0.028303055,0.007312218],"genre_scores_gemma":[0.14009112,0.00038234962,0.8472086,0.0002270047,0.00007543453,0.00028940145,0.0024271563,0.0046131425,0.0046858406],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99912125,0.00022721365,0.00005863545,0.00025359265,0.00022431226,0.000115063725],"domain_scores_gemma":[0.9985392,0.00064095,0.000108848246,0.00032279224,0.0002665624,0.00012168483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015149335,0.001364414,0.00073472055,0.0007260487,0.0007056275,0.001471079,0.0024203463,0.0009778468,0.010447979],"category_scores_gemma":[0.0045995843,0.000732391,0.0010764003,0.0012960902,0.0008473715,0.0020317961,0.0015535494,0.0016134359,0.0045719524],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010976299,0.0002486879,0.0037588538,0.0006434051,0.00028862405,0.0002810542,0.00035079682,0.58486056,0.036282722,0.057543643,0.039753683,0.2748904],"study_design_scores_gemma":[0.000111942354,0.000046637335,0.00017548568,0.000021457949,0.000023149525,0.000038524875,0.00003548773,0.95531124,0.011076683,0.018466342,0.014669583,0.000023575174],"about_ca_topic_score_codex":0.0054565906,"about_ca_topic_score_gemma":0.0057226666,"teacher_disagreement_score":0.010447979,"about_ca_system_score_codex":0.000841337,"about_ca_system_score_gemma":0.0020236955,"threshold_uncertainty_score":0.034951985},"labels":[],"label_agreement":null},{"id":"W4413056432","doi":"10.1093/bioadv/vbaf179","title":"<i>Struc2mapGAN</i>: improving synthetic cryogenic electron microscopy density maps with generative adversarial networks","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Advanced Electron Microscopy Techniques and Applications","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Generator (circuit theory); Computer science; Generative grammar; Adversarial system; Artificial intelligence; Generative adversarial network; Raw data; Deep learning; Pattern recognition (psychology); Machine learning; Theoretical computer science; Physics","score_opus":0.00301896666668887,"score_gpt":0.26785414162269267,"score_spread":0.2648351749560038,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413056432","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0773902,0.0010399433,0.8836788,0.002809628,0.00037542157,0.00019840227,0.0030816526,0.019614767,0.011811166],"genre_scores_gemma":[0.6423112,0.0004111612,0.33683524,0.0015174546,0.00011734644,0.00033592866,0.007142019,0.002750393,0.008579329],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997274,0.00010059207,0.000007542937,0.000068284004,0.0000690963,0.000027014177],"domain_scores_gemma":[0.99875975,0.000746753,0.00006527053,0.00021886494,0.00014584012,0.00006349302],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013460213,0.0012717649,0.00048206287,0.0005555337,0.00036453482,0.0007207724,0.0016778191,0.0012321591,0.005940213],"category_scores_gemma":[0.0042625535,0.00047004927,0.0007029146,0.00033881562,0.000788006,0.0010276071,0.0014684113,0.0016288947,0.0016272918],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008838962,0.000039810926,0.00088487373,0.00010057493,0.000056672547,0.00008381549,0.00003103019,0.9386819,0.0030900198,0.005378134,0.01333681,0.03822799],"study_design_scores_gemma":[0.0000062436307,0.0000108701715,0.00007526701,0.000008606381,0.0000028049326,0.00002174483,0.0000041042827,0.9936963,0.0020943345,0.0032551384,0.0008191737,0.000005365552],"about_ca_topic_score_codex":0.003821498,"about_ca_topic_score_gemma":0.0048270524,"teacher_disagreement_score":0.005940213,"about_ca_system_score_codex":0.00084717904,"about_ca_system_score_gemma":0.0006823234,"threshold_uncertainty_score":0.01987195},"labels":[],"label_agreement":null},{"id":"W4413109704","doi":"10.1093/bioadv/vbaf131","title":"Next generation biobanking ontology: introducing–omics contextual data to biobanking ontology","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Genome British Columbia; Simon Fraser University","funders":"King Fahad Medical City","keywords":"Biobank; Ontology; Computer science; Data science; Ontology-based data integration; Data discovery; Open Biomedical Ontologies; Data integration; Information retrieval; Metadata; Data management; World Wide Web; Data mining; Semantic Web; Suggested Upper Merged Ontology; Bioinformatics","score_opus":0.08394483396799426,"score_gpt":0.3364466195746183,"score_spread":0.25250178560662406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413109704","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0063441736,0.0010180352,0.9446732,0.007913041,0.0006529162,0.00080386084,0.010743006,0.0063170027,0.02153479],"genre_scores_gemma":[0.036835685,0.0017663043,0.92607075,0.002574081,0.00026892897,0.0006850613,0.025184268,0.0011998715,0.005415011],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9952266,0.0012789733,0.00078651635,0.0007370993,0.0016061268,0.00036467318],"domain_scores_gemma":[0.9943731,0.0015923628,0.00051289477,0.0013555306,0.0017095325,0.00045655452],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008143956,0.0006534371,0.00062756235,0.0044865655,0.0017049244,0.004431857,0.0021378633,0.0013172934,0.0026283793],"category_scores_gemma":[0.010325292,0.0005515447,0.0017422048,0.0050582895,0.001868109,0.007986521,0.0054444703,0.0032721628,0.0016882978],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018186777,0.00027543402,0.006235251,0.0018113361,0.00019459345,0.0013394656,0.0040719206,0.0065516564,0.012912291,0.6554057,0.09909571,0.21192479],"study_design_scores_gemma":[0.00002572212,0.000019569308,0.0020504333,0.0008171987,0.000085253305,0.0006755379,0.000740134,0.017247118,0.0047686147,0.12345349,0.85004085,0.00007597222],"about_ca_topic_score_codex":0.02005384,"about_ca_topic_score_gemma":0.019025503,"teacher_disagreement_score":0.02005384,"about_ca_system_score_codex":0.0031887083,"about_ca_system_score_gemma":0.009362637,"threshold_uncertainty_score":0.0430699},"labels":[],"label_agreement":null},{"id":"W4413890799","doi":"10.1093/bioadv/vbaf169","title":"Opportunities and considerations for using artificial intelligence in bioinformatics education","year":2024,"lang":"en","type":"editorial","venue":"Bioinformatics Advances","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Agency of Canada; Ontario Institute for Cancer Research","funders":"National Center for Advancing Translational Sciences; Government of Ontario; Bill and Melinda Gates Foundation; National Institutes of Health; National Science Foundation","keywords":"Scope (computer science); Computer science; Artificial intelligence; Bioinformatics; Data science; Biology","score_opus":0.06368501628049607,"score_gpt":0.36218987482045306,"score_spread":0.298504858539957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413890799","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000059982303,0.006128466,0.0004070562,0.14908496,0.8422574,0.000016122045,0.000016384367,0.000050375125,0.0019793715],"genre_scores_gemma":[0.0009834225,0.008144169,0.00075009494,0.089179955,0.8905055,0.000037703776,0.000017009244,0.000056216413,0.010325925],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98914415,0.0030372522,0.0012340052,0.00085990335,0.005279577,0.00044524448],"domain_scores_gemma":[0.9290324,0.044093527,0.0016628458,0.0011183916,0.018209467,0.0058832895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0163864,0.0019974094,0.0012627617,0.0027334716,0.004397947,0.011945634,0.0032507589,0.017595699,0.005838953],"category_scores_gemma":[0.04942352,0.00082662574,0.001512118,0.0013701055,0.0051294123,0.008527575,0.0024699806,0.03176511,0.0049668974],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024793868,0.000018378978,0.000048177015,0.00028554405,0.000008937147,0.00014735713,0.00013056875,0.00006317958,0.00007795241,0.0021102251,0.9845055,0.0125793405],"study_design_scores_gemma":[0.000020782902,0.000020680998,0.0001752119,0.00053215644,0.000015823665,0.00024010282,0.00020421519,0.0002048587,0.0000895776,0.0037547958,0.99472094,0.00002081841],"about_ca_topic_score_codex":0.002098083,"about_ca_topic_score_gemma":0.00782932,"teacher_disagreement_score":0.017595699,"about_ca_system_score_codex":0.0043677497,"about_ca_system_score_gemma":0.005805801,"threshold_uncertainty_score":0.08666062},"labels":[],"label_agreement":null},{"id":"W4413913923","doi":"10.1093/bioadv/vbaf193","title":"Exploration of chaos game representation and integrative deep learning approaches for whole-genome sequencing-based grapevine genetic testing","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Horticultural and Viticultural Research","field":"Agricultural and Biological Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada","keywords":"Whole genome sequencing; CHAOS (operating system); Representation (politics); Artificial intelligence; Computational biology; Genome; DNA sequencing; Biology; Computer science; Evolutionary biology; Machine learning; Genetics; Gene","score_opus":0.13288676251102186,"score_gpt":0.30668923682132865,"score_spread":0.1738024743103068,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413913923","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.086743586,0.0004962554,0.9035313,0.0009734875,0.00006573535,0.00015399748,0.00053350296,0.004456352,0.0030458153],"genre_scores_gemma":[0.7010208,0.00023704753,0.2937902,0.00054264267,0.000041077466,0.00032527492,0.0013956724,0.00028978515,0.0023574547],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.999491,0.00017476188,0.000027263777,0.00013746132,0.0000957061,0.00007377595],"domain_scores_gemma":[0.99851674,0.0009562097,0.000092319155,0.00013330102,0.00021422165,0.00008706841],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015939538,0.0010905208,0.0007712579,0.00074033916,0.00037406638,0.0014272423,0.00216909,0.0010698473,0.0026597967],"category_scores_gemma":[0.004768596,0.0004689544,0.0010206413,0.0005000012,0.00057881896,0.0016688935,0.0015202666,0.001837659,0.00046335428],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018271118,0.00023848197,0.0048081484,0.00013117139,0.000106571846,0.00019716377,0.00013779801,0.8764424,0.0037601995,0.012267019,0.002530589,0.09919775],"study_design_scores_gemma":[0.0000035416354,0.000013106833,0.000078109864,0.0000042357838,0.0000033860913,0.000005323814,0.000006746903,0.9958587,0.00039999268,0.0034441792,0.00017985798,0.000002724041],"about_ca_topic_score_codex":0.010250004,"about_ca_topic_score_gemma":0.0103813065,"teacher_disagreement_score":0.010250004,"about_ca_system_score_codex":0.001569747,"about_ca_system_score_gemma":0.0014475369,"threshold_uncertainty_score":0.020380676},"labels":[],"label_agreement":null},{"id":"W4414457949","doi":"10.1093/bioadv/vbaf228","title":"Deep Active Learning based Experimental Design to Uncover Synergistic Genetic Interactions for Host Targeted Therapeutics","year":2025,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Vector Institute","funders":"","keywords":"Gene knockdown; Scalability; Gene; Identification (biology); Host (biology); Pairwise comparison; Deep learning; Representation (politics)","score_opus":0.026535857626650637,"score_gpt":0.34220779857183364,"score_spread":0.315671940945183,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414457949","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03676259,0.00050755334,0.9589937,0.00039309132,0.000051955027,0.0002137023,0.00035235405,0.0011266536,0.0015984254],"genre_scores_gemma":[0.6135145,0.0003773156,0.38113162,0.00051847025,0.000043543445,0.0014142895,0.0007729148,0.00017832888,0.0020489835],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9986451,0.0006461029,0.000054352473,0.00027715333,0.00027516545,0.00010206106],"domain_scores_gemma":[0.99653375,0.0021909985,0.00037118857,0.00038807536,0.00032669283,0.00018918497],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050596,0.0010315197,0.0012807638,0.000824899,0.00029963662,0.0010417288,0.0023257467,0.0011322217,0.0040999954],"category_scores_gemma":[0.006634328,0.0006328871,0.0011709443,0.0006173892,0.0013965751,0.0014444779,0.0015352578,0.0020935594,0.00040784208],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079956464,0.0004021046,0.0018189444,0.0004044063,0.0002147792,0.000089780304,0.00003482191,0.8676864,0.02520183,0.019155387,0.0014732144,0.08271873],"study_design_scores_gemma":[0.000043939574,0.00012826944,0.000086187334,0.000008050658,0.00001749548,0.0000063740085,0.0000033707809,0.98437876,0.0070841103,0.007770155,0.00046759026,0.0000056589024],"about_ca_topic_score_codex":0.0009567404,"about_ca_topic_score_gemma":0.0014337151,"teacher_disagreement_score":0.0050596,"about_ca_system_score_codex":0.0013660021,"about_ca_system_score_gemma":0.001647882,"threshold_uncertainty_score":0.026758015},"labels":[],"label_agreement":null},{"id":"W4414683622","doi":"10.1093/bioadv/vbaf222","title":"An overview of computational methods for gene prediction in eukaryotes: strengths, limitations, and future directions","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Benchmark (surveying); Gene prediction; Scripting language; Gene; Sequence (biology); DNA sequencing","score_opus":0.02498786159813313,"score_gpt":0.3762993471727817,"score_spread":0.35131148557464853,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414683622","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003326114,0.672979,0.30056375,0.009207128,0.001959906,0.00009380286,0.0020146745,0.0031905947,0.006665024],"genre_scores_gemma":[0.021853518,0.6559494,0.30691472,0.0032790068,0.0026105603,0.0003837024,0.0057088425,0.00116346,0.0021368102],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980211,0.0006596273,0.0001853348,0.00037967967,0.00065570953,0.00009850568],"domain_scores_gemma":[0.988962,0.008176224,0.00028013543,0.0005802922,0.001702386,0.0002989817],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063406667,0.0017360458,0.0017473008,0.0029265843,0.0005530197,0.0032356586,0.0028208834,0.0014699013,0.0044529326],"category_scores_gemma":[0.014428249,0.0009896066,0.0016519639,0.0041729584,0.0010202685,0.004109369,0.0021307433,0.0044797296,0.0037516316],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002122031,0.00008492371,0.0024179989,0.010837139,0.00040843012,0.00008336219,0.000103438666,0.023725403,0.0029016663,0.039508868,0.06293833,0.85677826],"study_design_scores_gemma":[0.00006878768,0.0002674154,0.0020611496,0.006944532,0.00036896695,0.0004694894,0.00012249267,0.12897371,0.0068363454,0.14153485,0.71216017,0.00019219045],"about_ca_topic_score_codex":0.0027497357,"about_ca_topic_score_gemma":0.0023250012,"teacher_disagreement_score":0.0063406667,"about_ca_system_score_codex":0.001203086,"about_ca_system_score_gemma":0.0022799303,"threshold_uncertainty_score":0.033533037},"labels":[],"label_agreement":null},{"id":"W4415491818","doi":"10.1093/bioadv/vbaf265","title":"MutSeqR: an open source R package for standardized analysis of error-corrected next-generation sequencing data in genetic toxicology","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Carcinogens and Genotoxicity Assessment","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; University of Ottawa; Health Canada","funders":"Health Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Open source; R package; Sequence (biology); License; DNA sequencing; MIT License","score_opus":0.0931933158410629,"score_gpt":0.3659723816727946,"score_spread":0.2727790658317317,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415491818","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008383909,0.0025674745,0.5701948,0.0013982246,0.00069899694,0.0006821913,0.1699008,0.24048336,0.005690208],"genre_scores_gemma":[0.05943394,0.0026566796,0.58931583,0.0025103092,0.00035694515,0.004176972,0.1858749,0.14815369,0.007520722],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99088156,0.0041378313,0.0007727932,0.0020877619,0.0017485811,0.00037157114],"domain_scores_gemma":[0.98011637,0.011968197,0.002638931,0.0024735106,0.0022007404,0.0006021937],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013074833,0.00410602,0.003300408,0.003212394,0.0010541244,0.004303691,0.0039464263,0.001877403,0.03351233],"category_scores_gemma":[0.049456943,0.0019893348,0.0037439421,0.002709776,0.0014152499,0.0023768253,0.0041894647,0.0038430328,0.03651848],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020856506,0.00018331569,0.022064602,0.0121205645,0.0047340724,0.0014119259,0.0013538304,0.04036987,0.02772085,0.025489505,0.691388,0.17107777],"study_design_scores_gemma":[0.000997752,0.00058466545,0.015027872,0.0019459199,0.0016822987,0.0018293917,0.00030781145,0.14645025,0.030507876,0.07907954,0.72087723,0.0007094496],"about_ca_topic_score_codex":0.003007138,"about_ca_topic_score_gemma":0.0031384781,"teacher_disagreement_score":0.03351233,"about_ca_system_score_codex":0.00097508845,"about_ca_system_score_gemma":0.0049406146,"threshold_uncertainty_score":0.1121099},"labels":[],"label_agreement":null},{"id":"W4416098230","doi":"10.1093/bioadv/vbaf287","title":"ntRoot: computational inference of human ancestry at scale from genomic data","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Canada's Michael Smith Genome Sciences Centre","funders":"Canadian Institutes of Health Research","keywords":"Inference; Scale (ratio); Genomics; Big data; Genetic data; Computational model","score_opus":0.03687343643295704,"score_gpt":0.3371535968671262,"score_spread":0.30028016043416916,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416098230","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028252646,0.0008645536,0.8795162,0.0010953831,0.0003300411,0.00020040927,0.030988157,0.05424539,0.0045072874],"genre_scores_gemma":[0.14730889,0.00065443944,0.78521144,0.0007804244,0.0002492692,0.0006374892,0.050820697,0.009894628,0.004442687],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99832755,0.0005693478,0.00009580488,0.0005353505,0.00040173816,0.00007016458],"domain_scores_gemma":[0.99384874,0.0042468673,0.00031864995,0.0010056812,0.00036425336,0.00021588341],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00389218,0.0012704108,0.0015327645,0.0019734127,0.001054351,0.0024898446,0.002796586,0.0012517697,0.016119126],"category_scores_gemma":[0.026492018,0.0010700745,0.0018218671,0.0022674934,0.001006447,0.0021122934,0.0032084573,0.001981931,0.0068235477],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022016955,0.00024247618,0.038129814,0.0025563922,0.002157713,0.0014777664,0.0015208158,0.37838528,0.01739988,0.05403427,0.19093679,0.3109571],"study_design_scores_gemma":[0.00029350616,0.000058843772,0.0027266934,0.00015040205,0.00015298412,0.00036072385,0.00013822176,0.899912,0.0039110826,0.06640628,0.025812006,0.00007719776],"about_ca_topic_score_codex":0.007481275,"about_ca_topic_score_gemma":0.015584627,"teacher_disagreement_score":0.016119126,"about_ca_system_score_codex":0.0009336567,"about_ca_system_score_gemma":0.0019478468,"threshold_uncertainty_score":0.053923845},"labels":[],"label_agreement":null},{"id":"W4416548752","doi":"10.1093/bioadv/vbaf286","title":"Are the tools fit for purpose? Network inference algorithms evaluated on a simulated lipidomics network","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Metabolomics and Mass Spectrometry Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"National Research Council Canada; University of Ottawa; University of Victoria; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Key (lock); Identification (biology); Feature (linguistics); Pattern recognition (psychology)","score_opus":0.041787844238959294,"score_gpt":0.3276315467898132,"score_spread":0.2858437025508539,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416548752","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5455516,0.00080038025,0.43437263,0.0023774563,0.00015324363,0.00035071545,0.003561569,0.00484639,0.007986049],"genre_scores_gemma":[0.77704114,0.00032447616,0.21759164,0.00020401398,0.000030079724,0.00029955473,0.0030836302,0.00038198777,0.0010435146],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99864703,0.00076718786,0.00005991581,0.0002452082,0.00018300224,0.000097741846],"domain_scores_gemma":[0.97083473,0.024533225,0.0007812627,0.0014387103,0.0020457443,0.0003663886],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.005946693,0.0007594896,0.0005665862,0.0012029072,0.0006451332,0.0010823961,0.0014322625,0.0010323889,0.0033850858],"category_scores_gemma":[0.037254535,0.0002728379,0.0005880965,0.0011462403,0.0006259045,0.0016439846,0.00095375476,0.0011639146,0.0005534962],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039224158,0.00018146398,0.011042284,0.00020336536,0.00010465127,0.00010078737,0.000107920045,0.9412282,0.0009418481,0.0068086423,0.0031770873,0.03571146],"study_design_scores_gemma":[0.000022759943,0.00002366583,0.0005067743,0.0000130506305,0.000010048323,0.000016025842,0.00002083139,0.99520457,0.0005370279,0.003330057,0.00031080286,0.0000043923246],"about_ca_topic_score_codex":0.014521228,"about_ca_topic_score_gemma":0.013607267,"teacher_disagreement_score":0.9940533,"about_ca_system_score_codex":0.0014992008,"about_ca_system_score_gemma":0.00169721,"threshold_uncertainty_score":0.031449497},"labels":[],"label_agreement":null},{"id":"W4416751600","doi":"10.1093/bioadv/vbaf307","title":"Omics BioAnalytics: an RShiny application for multimodal biomarker panel discovery and assessment","year":2025,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Paul's Hospital; University of British Columbia; Prevention of Organ Failure; Stornoway Diamond (Canada); Providence Health Care","funders":"National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Biomarker discovery; Biomarker; Omics; Genomics; Precision medicine","score_opus":0.013368177004067927,"score_gpt":0.3011272475436773,"score_spread":0.28775907053960936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416751600","genre_codex":"software","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":"software","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007565007,0.0009768103,0.4210743,0.0013341238,0.00029035096,0.00087265106,0.031922776,0.52307516,0.012888805],"genre_scores_gemma":[0.13768871,0.0022587627,0.63621813,0.0039350865,0.0004247967,0.0031166468,0.0790021,0.11189897,0.025456773],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99863833,0.0002055247,0.00009040582,0.00036077367,0.0005924349,0.00011262179],"domain_scores_gemma":[0.9980065,0.0007755252,0.00020602185,0.00044809002,0.00035791995,0.0002059044],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032502816,0.0026019597,0.0010940838,0.0023858026,0.0007524542,0.0025130634,0.0025863268,0.0013428151,0.046091847],"category_scores_gemma":[0.007924795,0.0012271554,0.0015956721,0.0012972801,0.0008689215,0.002044307,0.005542272,0.0018711888,0.024718337],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037784032,0.00040680027,0.013628581,0.0025137446,0.00082071545,0.002017425,0.0011430553,0.019077532,0.06370237,0.023163645,0.5371521,0.3325956],"study_design_scores_gemma":[0.00080456346,0.00036389806,0.014272216,0.00096650934,0.00026730463,0.0015886776,0.00032434546,0.29974493,0.09796246,0.060235612,0.52290034,0.0005691871],"about_ca_topic_score_codex":0.0048351106,"about_ca_topic_score_gemma":0.0046846364,"teacher_disagreement_score":0.046091847,"about_ca_system_score_codex":0.0010850597,"about_ca_system_score_gemma":0.0020887821,"threshold_uncertainty_score":0.15419263},"labels":[],"label_agreement":null},{"id":"W4417046158","doi":"10.1093/bioadv/vbaf311","title":"Mapping educational needs in bioinformatics in Brazil: adapting ISCB 3.0 competencies to a regional context","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children","funders":"","keywords":"Context (archaeology); Curriculum; Socioeconomic status; Scalability; Curriculum framework","score_opus":0.02452441183690168,"score_gpt":0.30692260802188703,"score_spread":0.28239819618498535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417046158","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9712724,0.00042797526,0.004733377,0.008614775,0.00004003213,0.00030132532,0.00067103765,0.00003539372,0.013903628],"genre_scores_gemma":[0.99511164,0.00021406545,0.003423834,0.00031341985,0.000005106579,0.0001819701,0.00025577802,0.0000092774,0.00048491245],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99669564,0.0013861554,0.00021047969,0.00029201427,0.0005372748,0.000878534],"domain_scores_gemma":[0.9917474,0.0027530845,0.001414539,0.00041803322,0.0020041335,0.0016627951],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0076422463,0.00025314864,0.00028881867,0.0023723994,0.0012911876,0.0017140278,0.0008377084,0.00044630902,0.0017003947],"category_scores_gemma":[0.017783705,0.00023936486,0.00039517772,0.0022090226,0.0012848201,0.0013217692,0.0035145497,0.0006730943,0.0001789614],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000062380655,0.00021268823,0.7599431,0.00062426843,0.00004128658,0.00044850472,0.08824203,0.0013463036,0.0019613006,0.0172911,0.004261106,0.12556589],"study_design_scores_gemma":[0.000025887648,0.00021595797,0.8030271,0.0014967284,0.00005356245,0.0004245554,0.14680977,0.0054195873,0.0014176728,0.0070035444,0.03405247,0.000053234493],"about_ca_topic_score_codex":0.08117811,"about_ca_topic_score_gemma":0.10959575,"teacher_disagreement_score":0.08117811,"about_ca_system_score_codex":0.00708377,"about_ca_system_score_gemma":0.024994835,"threshold_uncertainty_score":0.16141117},"labels":[],"label_agreement":null},{"id":"W4417501327","doi":"10.1093/bioadv/vbaf301","title":"Perspectives in computational mass spectrometry: recent developments and key challenges","year":2024,"lang":"en","type":"article","venue":"Bioinformatics Advances","topic":"Mass Spectrometry Techniques and Applications","field":"Chemistry","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Biotechnology and Biological Sciences Research Council; Engineering and Physical Sciences Research Council; Chan Zuckerberg Initiative; Wellcome Trust; Wellcome","keywords":"Grand Challenges; Key (lock); Field (mathematics); Cornerstone; Computational model","score_opus":0.021592840743025917,"score_gpt":0.28652386438425465,"score_spread":0.2649310236412287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417501327","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016485385,0.6597819,0.061256167,0.26472124,0.0061324714,0.00004181671,0.00019358896,0.00030267134,0.0059215683],"genre_scores_gemma":[0.026927877,0.83136165,0.085684024,0.025757173,0.027487436,0.00019883638,0.00044617392,0.00025466093,0.0018821815],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9933161,0.0036405681,0.00040507058,0.00073762715,0.0015920816,0.00030852287],"domain_scores_gemma":[0.93079513,0.056479067,0.0009676792,0.0025230222,0.0068899104,0.0023451599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02842241,0.0013580369,0.0017678358,0.0023191231,0.0013647823,0.0076830876,0.003949089,0.0064640013,0.0051895506],"category_scores_gemma":[0.03284678,0.00075551757,0.0016880382,0.003387685,0.0076662847,0.01617402,0.005293545,0.013674061,0.0018292058],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022696736,0.00020259585,0.0017687508,0.005385989,0.00027153335,0.0002850374,0.0005981519,0.01130636,0.00075883983,0.46142018,0.11923635,0.3985393],"study_design_scores_gemma":[0.00007666787,0.00015262925,0.00087138836,0.0038533828,0.00006074728,0.0006487043,0.00088771567,0.018525537,0.00063977,0.5438932,0.43026006,0.000130234],"about_ca_topic_score_codex":0.0018596179,"about_ca_topic_score_gemma":0.0017079179,"teacher_disagreement_score":0.02842241,"about_ca_system_score_codex":0.0024799695,"about_ca_system_score_gemma":0.004505331,"threshold_uncertainty_score":0.15031391},"labels":[],"label_agreement":null}]}