{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":19,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":19,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"d9fbe9c57fec","filters":{"venue":"Computer applications in the biosciences"}},"results":[{"id":"W2144014661","doi":"10.1093/bioinformatics/bti273","title":"Online Predicted Human Interaction Database","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":620,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Institute for Cancer Research","funders":"","keywords":"Drosophila melanogaster; Gene ontology; Computer science; Ontology; Visualization; Computational biology; Artificial intelligence; Biology; Gene; Gene expression; Genetics","authors":[{"name":"Kevin R. Brown","is_ca":true},{"name":"Igor Jurišica","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0176614791024342,"gpt":0.2957764760332367,"spread":0.2781149969308025,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001120319,0.001841586,0.001733399,0.005356308,0.001170303,0.001735996,0.002217209,0.001778911,0.0909721],"category_scores_gemma":[0.005121819,0.0006134132,0.0008651608,0.006364635,0.000269378,0.001479788,0.00201953,0.001016914,0.0518748],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008108322,"about_ca_system_score_gemma":0.002778825,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004263578,"about_ca_topic_score_gemma":0.006105028,"domain_scores_codex":[0.999245,0.0001529213,0.0001404376,0.0002316429,0.0001586976,0.00007134378],"domain_scores_gemma":[0.9981639,0.0007539121,0.0002218154,0.0003063199,0.0003064204,0.0002477191],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001680178,0.0001695388,0.00913348,0.006037294,0.0003286838,0.001171271,0.0002233963,0.002316689,0.004631742,0.008627586,0.9025046,0.06317554],"study_design_scores_gemma":[0.0004206976,0.0001304606,0.01461833,0.0007157409,0.0003083585,0.001909434,0.0001776657,0.004713538,0.003827114,0.01172619,0.9613587,0.00009387797],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"software","genre_scores_codex":[0.003122154,0.001886941,0.005088547,0.0003150138,0.00005971271,0.0001086104,0.9754524,0.004020611,0.009945975],"genre_scores_gemma":[0.007028454,0.000765364,0.007972166,0.0001613128,0.00002190151,0.0001730989,0.982249,0.0002215099,0.001407209],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.0909721,"threshold_uncertainty_score":0.304332,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2127325419","doi":"10.1093/bioinformatics/bti439","title":"pFind: a novel database-searching software system for automated peptide and protein identification via tandem mass spectrometry","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Advanced Proteomics Techniques and Applications","field":"Chemistry","cited_by":181,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Computer science; Usability; Software; XML; Database; Tandem mass spectrometry; Proteomics; Identification (biology); Database search engine; Tandem mass tag; Data mining; Mass spectrometry; Information retrieval; Quantitative proteomics; Programming language; Operating system; Chemistry; Search engine; Chromatography; Biology","authors":[{"name":"Dongxiang Li","is_ca":false},{"name":"Yan Fu","is_ca":false},{"name":"Ren Sun","is_ca":false},{"name":"Charles X. Ling","is_ca":true},{"name":"Yanjie Wei","is_ca":false},{"name":"Hui Zhou","is_ca":false},{"name":"Rong Zeng","is_ca":false},{"name":"Qiang Yang","is_ca":false},{"name":"Si‐Min He","is_ca":false},{"name":"Wen Gao","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01994045347924747,"gpt":0.2977135505692231,"spread":0.2777730970899757,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001918647,0.002123389,0.001588708,0.002905697,0.0007903682,0.001262869,0.003590851,0.0009226965,0.01238871],"category_scores_gemma":[0.002336318,0.0008154958,0.0007715204,0.001745131,0.0004686791,0.002616434,0.001792143,0.001584353,0.008506986],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000649458,"about_ca_system_score_gemma":0.001092025,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009166377,"about_ca_topic_score_gemma":0.0006111868,"domain_scores_codex":[0.9992527,0.00007325456,0.00009726611,0.000215528,0.0002895006,0.00007164748],"domain_scores_gemma":[0.9993037,0.0002208669,0.0001098748,0.0001061236,0.0001656874,0.00009372496],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00266897,0.0003904198,0.004810981,0.001637,0.0004136543,0.00108281,0.0002895066,0.005426857,0.1415903,0.006303779,0.1917128,0.643673],"study_design_scores_gemma":[0.001584043,0.0009403478,0.01139752,0.0002765263,0.0004490405,0.00833821,0.0001240569,0.2214764,0.3662174,0.02153158,0.3670295,0.0006353674],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.01640772,0.001570487,0.6411051,0.0002750842,0.0002043163,0.0004047455,0.00975425,0.3255174,0.00476091],"genre_scores_gemma":[0.07653266,0.001261675,0.8487932,0.0005388641,0.0001401084,0.001092713,0.0519185,0.01134937,0.008372771],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.01238871,"threshold_uncertainty_score":0.04144436,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2725970836","doi":"10.1093/bioinformatics/btx460","title":"Analysis and prediction of protein folding energy changes upon mutation by element specific persistent homology","year":2017,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":108,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Mutation; Homology modeling; Pearson product-moment correlation coefficient; Stability (learning theory); Mutation rate; Computational biology; Correlation coefficient; Computer science; Correlation; Persistent homology; Mutagenesis; Protein folding; Folding (DSP implementation); Mathematics; Protein design; Protein structure; Algorithm; Biology; Genetics; Machine learning; Statistics; Gene; Biochemistry; Engineering; Geometry","authors":[{"name":"Zixuan Cang","is_ca":true},{"name":"Guo‐Wei Wei","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01058242335798177,"gpt":0.2405717421445445,"spread":0.2299893187865628,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007108919,0.0004367876,0.0004085811,0.001384471,0.0002191813,0.0003161821,0.0004607699,0.0003917916,0.0008854615],"category_scores_gemma":[0.002230539,0.0001168928,0.0004677855,0.0007912529,0.00023764,0.000404298,0.0004893314,0.0003567645,0.0004498734],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003145471,"about_ca_system_score_gemma":0.0003893664,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001182125,"about_ca_topic_score_gemma":0.001001384,"domain_scores_codex":[0.9997485,0.00005748216,0.00001724947,0.00006683594,0.00008797961,0.00002192878],"domain_scores_gemma":[0.9989812,0.0004219734,0.0002357368,0.0001177202,0.000183236,0.00006006472],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006898881,0.0003015176,0.09292853,0.0003453835,0.000215667,0.0004670517,0.0001507026,0.7142912,0.07938842,0.002964892,0.001767505,0.1064893],"study_design_scores_gemma":[0.000007628159,0.00009188342,0.01306864,0.000005444595,0.00001549371,0.00009846048,0.00001770001,0.9748497,0.01082864,0.0007719247,0.0002322019,0.00001236832],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9058331,0.0002211285,0.09145682,0.00006791159,0.000008999788,0.00003641086,0.0007278631,0.0009791937,0.0006684865],"genre_scores_gemma":[0.974974,0.00008717865,0.02316239,0.00001083893,0.000004905626,0.00003237775,0.001412991,0.00005314163,0.0002621927],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001384471,"threshold_uncertainty_score":0.003759563,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2156336405","doi":"10.1093/bioinformatics/bti1041","title":"Multi-way clustering of microarray data using probabilistic sparse matrix factorization","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":97,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; University of Toronto; Microsoft","keywords":"Cluster analysis; Probabilistic logic; Computer science; Data mining; Sparse matrix; Non-negative matrix factorization; Noise (video); Hierarchical clustering; Matrix decomposition; Generative model; Matrix (chemical analysis); Algorithm; Artificial intelligence; Generative grammar; Eigenvalues and eigenvectors","authors":[{"name":"Delbert Dueck","is_ca":true},{"name":"Quaid Morris","is_ca":true},{"name":"Brendan J. Frey","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07690284190076663,"gpt":0.3453961809586526,"spread":0.268493339057886,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003810367,0.001109644,0.001674096,0.001542395,0.0009520829,0.001049779,0.002457091,0.001941995,0.0009141258],"category_scores_gemma":[0.01003887,0.0007129911,0.001839331,0.002356003,0.001951746,0.001805746,0.001445038,0.001947436,0.0007236839],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001103341,"about_ca_system_score_gemma":0.001211826,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002978528,"about_ca_topic_score_gemma":0.002888897,"domain_scores_codex":[0.996686,0.00115825,0.0001418631,0.0009299441,0.0009442099,0.0001397066],"domain_scores_gemma":[0.9941728,0.003508756,0.0006846308,0.0008046814,0.0006703891,0.0001587296],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000151916,0.0001166602,0.00230211,0.0003539464,0.0001807155,0.0001763127,0.0003916431,0.7634373,0.01616464,0.02891185,0.003148834,0.1846641],"study_design_scores_gemma":[0.00001489025,0.00002938566,0.0004404435,0.00001129893,0.00001560361,0.0001270885,0.00002107833,0.9663081,0.002931476,0.02916831,0.0009042711,0.00002813527],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.00326336,0.00007917463,0.9961971,0.0001317537,0.000007897762,0.00002125436,0.00003586483,0.0001637118,0.00009989159],"genre_scores_gemma":[0.2000675,0.0003639761,0.797419,0.0002507542,0.0001501439,0.0002468949,0.0006729265,0.00009950744,0.0007293802],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003810367,"threshold_uncertainty_score":0.02015138,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2121105117","doi":"10.1093/bioinformatics/bti406","title":"Modularized learning of genetic interaction networks from biological annotations and mRNA expression data","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":59,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"","keywords":"Expression (computer science); Computer science; Messenger RNA; Computational biology; Annotation; Artificial intelligence; Biology; Genetics; Gene; Programming language","authors":[{"name":"P. H. Lee","is_ca":true},{"name":"Doheon Lee","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02539486015560128,"gpt":0.2782883853891387,"spread":0.2528935252335375,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001662868,0.000825772,0.0008127824,0.00141798,0.0003546461,0.0006432299,0.001251733,0.0008150825,0.0009151759],"category_scores_gemma":[0.006562518,0.0004188172,0.0008341014,0.001092329,0.0007172481,0.001189517,0.0009953794,0.0009444295,0.0002197456],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008293533,"about_ca_system_score_gemma":0.0009196151,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002544547,"about_ca_topic_score_gemma":0.003912961,"domain_scores_codex":[0.9993161,0.0002164884,0.00003121183,0.0002716886,0.0001109722,0.00005355271],"domain_scores_gemma":[0.9968741,0.002026881,0.0004130265,0.0002736716,0.0003221096,0.00009011883],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002867618,0.0001340325,0.007601779,0.0001738003,0.0001729577,0.0001276317,0.000135201,0.7337431,0.01425283,0.00573721,0.0007295606,0.2369052],"study_design_scores_gemma":[0.000009891095,0.00002859573,0.001160157,0.000005483405,0.00002058444,0.00002948183,0.000008574261,0.9867755,0.002493604,0.009260777,0.0001990812,0.000008266116],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05236293,0.0001219978,0.9466298,0.00008536001,0.000006349697,0.0000262653,0.0001341046,0.0004029857,0.0002303222],"genre_scores_gemma":[0.5608545,0.0001961318,0.4365777,0.00008297432,0.000045963,0.0001222668,0.001220393,0.00006935799,0.0008307234],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002544547,"threshold_uncertainty_score":0.008794188,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2120815702","doi":"10.1093/bioinformatics/bti1040","title":"ExonHunter: a comprehensive approach to gene finding","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":52,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"","keywords":"Computer science; Annotation; Hidden Markov model; Gene prediction; Probabilistic logic; Set (abstract data type); Sequence (biology); Markov chain; Extension (predicate logic); Data mining; Artificial intelligence; Machine learning; Gene; Genome; Genetics; Biology","authors":[{"name":"Broňa Brejová","is_ca":true},{"name":"Dan Brown","is_ca":true},{"name":"Ming Li","is_ca":true},{"name":"Tomáš Vinař","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02161260978141782,"gpt":0.2653430076089932,"spread":0.2437303978275753,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002998199,0.00128926,0.001603552,0.002826052,0.001181311,0.001593594,0.003525818,0.001171199,0.006725518],"category_scores_gemma":[0.00621643,0.001044931,0.001059846,0.002620276,0.001106519,0.003246386,0.002622889,0.00187236,0.003877558],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006077321,"about_ca_system_score_gemma":0.002019184,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001781565,"about_ca_topic_score_gemma":0.003559254,"domain_scores_codex":[0.9979991,0.0002593925,0.0001426372,0.0008147415,0.0007076032,0.00007643725],"domain_scores_gemma":[0.9963298,0.001985209,0.0002790779,0.0007711307,0.0003886959,0.0002460281],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007345575,0.0002254607,0.006559113,0.001140964,0.0003279051,0.0008158138,0.0005198571,0.03307757,0.07208929,0.02205287,0.09101016,0.7714464],"study_design_scores_gemma":[0.0002482864,0.0002332388,0.004276796,0.0002109155,0.0002172707,0.003260626,0.0001815172,0.5741929,0.1618099,0.08773313,0.1673361,0.0002992034],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005874727,0.0006467616,0.930936,0.0004274202,0.00005867263,0.0001283982,0.003201524,0.05733917,0.001387335],"genre_scores_gemma":[0.0227942,0.0003913733,0.9659255,0.0002584176,0.00005528296,0.0001508408,0.005797189,0.002610259,0.002016877],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006725518,"threshold_uncertainty_score":0.02249908,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2103184043","doi":"10.1093/bioinformatics/bti321","title":"MtbRegList, a database dedicated to the analysis of transcriptional regulation in Mycobacterium tuberculosis","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Tuberculosis Research and Epidemiology","field":"Medicine","cited_by":49,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Sherbrooke","funders":"Fonds Québécois de la Recherche sur la Nature et les Technologies; U.S. National Library of Medicine; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Mycobacterium tuberculosis; Tuberculosis; Database; Computational biology; Biology; Computer science; Medicine","authors":[{"name":"Pierre‐Étienne Jacques","is_ca":true},{"name":"Alain Gervais","is_ca":true},{"name":"Michel Cantin","is_ca":true},{"name":"Jean‐François Lucier","is_ca":true},{"name":"Genevieve Dallaire","is_ca":true},{"name":"Geneviève Drouin","is_ca":true},{"name":"Louis Gaudreau","is_ca":true},{"name":"Joseph L. Goulet","is_ca":true},{"name":"Ryszard Brzeziński","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03446879600612759,"gpt":0.3397371658698042,"spread":0.3052683698636766,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007618313,0.001572927,0.002028554,0.004630342,0.0009530249,0.002071919,0.001986639,0.001581793,0.0277407],"category_scores_gemma":[0.003934321,0.0006935192,0.0007682014,0.005564366,0.0004247234,0.001354162,0.001277182,0.001053568,0.02191645],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006768923,"about_ca_system_score_gemma":0.001941754,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002480211,"about_ca_topic_score_gemma":0.003450504,"domain_scores_codex":[0.9991804,0.0001170122,0.000142664,0.0002266106,0.0002349378,0.00009836687],"domain_scores_gemma":[0.9983523,0.0006016979,0.0003436686,0.000241541,0.0001981654,0.0002626482],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.007110401,0.000409975,0.01814873,0.01675937,0.0003194978,0.002266587,0.0008246565,0.00431577,0.1868972,0.00500456,0.4714833,0.28646],"study_design_scores_gemma":[0.0005062668,0.0003783633,0.02779083,0.0008919585,0.0003983189,0.002123337,0.0002097368,0.00567876,0.04227784,0.003456613,0.9161503,0.0001378383],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"dataset","genre_scores_codex":[0.03591984,0.01764063,0.02942493,0.0010595,0.0003309455,0.000377345,0.8199856,0.07776483,0.01749636],"genre_scores_gemma":[0.03931412,0.003770106,0.03442223,0.0004157358,0.0001209951,0.0003753988,0.914216,0.002887242,0.004478338],"genre_candidate":"dataset","genre_consensus":"dataset","teacher_disagreement_score":0.0277407,"threshold_uncertainty_score":0.09280187,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2159605359","doi":"10.1093/bioinformatics/bti483","title":"Ensemble dependence model for classification and prediction of cancer and normal gene expression data","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":39,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Ensemble forecasting; Ensemble learning; Computational biology; Cancer; Expression (computer science); Gene; Gene expression; Artificial intelligence; Genetics; Biology; Programming language","authors":[{"name":"Peng Qiu","is_ca":false},{"name":"Z.J. Wang","is_ca":true},{"name":"K. J. R. Liu","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06174760510571803,"gpt":0.3243864251374056,"spread":0.2626388200316875,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003008715,0.0008189053,0.001129329,0.001581343,0.0004071951,0.0006051885,0.001134641,0.0009401158,0.001078633],"category_scores_gemma":[0.006674237,0.0002592794,0.0008047218,0.001002754,0.00045833,0.001099089,0.0005953657,0.001193455,0.000401629],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008680464,"about_ca_system_score_gemma":0.0006348203,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005996645,"about_ca_topic_score_gemma":0.004367492,"domain_scores_codex":[0.9988341,0.0005276481,0.0000640526,0.0002492059,0.0002321136,0.00009289738],"domain_scores_gemma":[0.9965705,0.002279792,0.0002480039,0.0003133491,0.0004681076,0.0001202288],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004997808,0.0002687185,0.02395286,0.00006672247,0.0002119158,0.000146643,0.0001241047,0.8314516,0.003591868,0.005890108,0.00193843,0.1318573],"study_design_scores_gemma":[0.000002387038,0.00001586689,0.0007648977,0.000001752092,0.000006016325,0.00001340245,0.000002518248,0.9972976,0.000243492,0.001561222,0.00008751035,0.000003363459],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1882049,0.0004599043,0.8084621,0.0004589297,0.00003945182,0.00006384546,0.0006125837,0.0007954108,0.0009029428],"genre_scores_gemma":[0.9258962,0.0002569933,0.07031258,0.000101243,0.00006405132,0.0001465755,0.001612316,0.00004662847,0.001563355],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.005996645,"threshold_uncertainty_score":0.01591176,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3108440423","doi":"10.1093/bioinformatics/btaa976","title":"Deep feature extraction of single-cell transcriptomes by generative adversarial network","year":2020,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":39,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true},"ca_institutions":"Douglas Mental Health University Institute; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Computer science; Generative model; Generative grammar; Feature (linguistics); Source code; Embedding; Generative adversarial network; Raw data; Code (set theory); Artificial intelligence; Data mining; Machine learning; Deep learning","authors":[{"name":"Mojtaba Bahrami","is_ca":true},{"name":"Malosree Maitra","is_ca":true},{"name":"Corina Nagy","is_ca":true},{"name":"Gustavo Turecki","is_ca":true},{"name":"Hamid R. Rabiee","is_ca":false},{"name":"Yue Li","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01653542818112854,"gpt":0.2360269951309656,"spread":0.219491566949837,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008297785,0.0009821946,0.0006552038,0.0003738027,0.0002289308,0.0006030512,0.001090612,0.0008501149,0.002024249],"category_scores_gemma":[0.001829754,0.0004047384,0.0008230912,0.000422046,0.0008088108,0.0005510873,0.0010996,0.001730912,0.001044207],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006332793,"about_ca_system_score_gemma":0.0005921165,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002416032,"about_ca_topic_score_gemma":0.003349097,"domain_scores_codex":[0.9997351,0.00006768281,0.000009194689,0.00009835851,0.00004951888,0.00004015014],"domain_scores_gemma":[0.9993722,0.0004081867,0.00004580811,0.00008163795,0.00006433413,0.00002780576],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001510495,0.00005714781,0.002988211,0.0001445909,0.00009015048,0.0002294655,0.0001104767,0.877934,0.02807929,0.008462374,0.006479615,0.07527351],"study_design_scores_gemma":[0.000003378718,0.0000126347,0.0004196665,0.000007355285,0.000006426508,0.00003457977,0.000007180078,0.989151,0.003982742,0.00558939,0.000776933,0.000008668379],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0283361,0.0004204973,0.9662694,0.0003618026,0.00006390104,0.00005195777,0.001242855,0.002028916,0.001224573],"genre_scores_gemma":[0.7056085,0.000785764,0.2760129,0.0007667689,0.0001173141,0.0004663785,0.007505556,0.0004803265,0.008256451],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002416032,"threshold_uncertainty_score":0.006771863,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2107500667","doi":"10.1093/bioinformatics/bti397","title":"A robust neural networks approach for spatial and intensity-dependent normalization of cDNA microarray data","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":39,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université Laval","funders":"","keywords":"Normalization (sociology); Sampling bias; Computer science; Microarray; Computational biology; Pattern recognition (psychology); Biology; Biological system; Statistics; Sample size determination; Artificial intelligence; Mathematics; Gene expression; Gene; Genetics","authors":[{"name":"Adi L. Tarca","is_ca":true},{"name":"Janice E. K. Cooke","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04246975923685588,"gpt":0.2754001957445745,"spread":0.2329304365077187,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00196831,0.001392523,0.0009170889,0.001054588,0.000443333,0.0009599965,0.001685769,0.00117254,0.001467406],"category_scores_gemma":[0.005123462,0.0005310861,0.001225804,0.001387532,0.0006948982,0.001060403,0.001076378,0.002081657,0.0006411563],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001374671,"about_ca_system_score_gemma":0.00112032,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0074983,"about_ca_topic_score_gemma":0.0053709,"domain_scores_codex":[0.9986722,0.0003158302,0.00008026484,0.0004445318,0.0003983868,0.00008876978],"domain_scores_gemma":[0.9983007,0.0008242769,0.0002204753,0.00012944,0.0004904065,0.0000346589],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001206526,0.00006474015,0.0005921836,0.0001355807,0.0001493155,0.00007809986,0.00005424284,0.7243297,0.01725423,0.004470725,0.001596413,0.2511541],"study_design_scores_gemma":[0.000002449471,0.0000137476,0.0001391047,0.000005552577,0.000009372659,0.00001236108,0.000003457545,0.9948021,0.003228182,0.00143454,0.0003402659,0.000008812022],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.00382012,0.0002092759,0.9945496,0.00008775126,0.00002767387,0.00002876632,0.00005987987,0.0008534464,0.0003635767],"genre_scores_gemma":[0.1797404,0.0005190899,0.8142499,0.000267134,0.0001441395,0.0004706042,0.0007650503,0.0003629382,0.003480838],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0074983,"threshold_uncertainty_score":0.01490933,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2108149347","doi":"10.1093/bioinformatics/bti330","title":"Recoverable one-dimensional encoding of three-dimensional protein structures","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":34,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Institute of Genetics; Ministry of Education, Culture, Sports, Science and Technology","keywords":"Protein structure; Protein secondary structure; Sequence (biology); Protein structure prediction; Computer science; Protein tertiary structure; Set (abstract data type); Structural bioinformatics; Structural motif; Biological system; Algorithm; Crystallography; Biology; Chemistry; Genetics","authors":[{"name":"Akira R. Kinjo","is_ca":false},{"name":"K. Nishikawa","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01384964738495638,"gpt":0.251645521404076,"spread":0.2377958740191197,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0002453477,0.0003934617,0.0004705745,0.0004507893,0.0002556269,0.0005874968,0.0005366957,0.0004255514,0.0007973721],"category_scores_gemma":[0.001634264,0.0003061815,0.0005082791,0.0004922126,0.0003822378,0.0005814393,0.0005435738,0.0007620539,0.0003791799],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0003860798,"about_ca_system_score_gemma":0.000414097,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006917891,"about_ca_topic_score_gemma":0.0007430791,"domain_scores_codex":[0.9998587,0.00003628237,0.00001102018,0.00002936718,0.00004934257,0.00001530164],"domain_scores_gemma":[0.9994122,0.0001749946,0.00009663528,0.000201753,0.00008637913,0.00002809325],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007195585,0.0001766642,0.006546287,0.0004524605,0.0001066453,0.0007812157,0.0003474489,0.4593641,0.3262179,0.0576054,0.003061034,0.1446214],"study_design_scores_gemma":[0.00001762429,0.00007269927,0.001434284,0.00001804389,0.00001722956,0.0002227801,0.00004610948,0.9257908,0.05640352,0.01329441,0.002647201,0.0000354242],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.4222305,0.0004672254,0.5718785,0.0002517936,0.00006574688,0.00003472583,0.001339594,0.001441547,0.002290311],"genre_scores_gemma":[0.6692373,0.0005080033,0.3270039,0.0000486202,0.00001582778,0.00004820436,0.002317419,0.0001423246,0.0006784367],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0007973721,"threshold_uncertainty_score":0.00280118,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2096149709","doi":"10.1093/bioinformatics/bti1037","title":"Reversal distance for partially ordered genomes","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":27,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"","keywords":"Genome; Position (finance); Chromosome; Computer science; Representation (politics); Order (exchange); Gene; Mutation; Genetics; Computational biology; Biology; Algorithm","authors":[{"name":"Chunfang Zheng","is_ca":true},{"name":"Aleksander Lenert","is_ca":true},{"name":"David Sankoff","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01449698518350952,"gpt":0.2713342964950228,"spread":0.2568373113115133,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001547885,0.0005180567,0.0007455262,0.001880828,0.0006324493,0.001316871,0.001627394,0.0009722646,0.004749771],"category_scores_gemma":[0.01415265,0.0003501354,0.0008449237,0.001253823,0.001135347,0.002365075,0.001396833,0.001405801,0.00070232],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001478248,"about_ca_system_score_gemma":0.00113154,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002153473,"about_ca_topic_score_gemma":0.001718858,"domain_scores_codex":[0.9988658,0.0002862395,0.00007995704,0.0003483198,0.000334651,0.000085161],"domain_scores_gemma":[0.9923359,0.005423074,0.0006555734,0.0007424908,0.000601534,0.000241443],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004084943,0.0001207874,0.007507913,0.0004157496,0.00006763978,0.0003570165,0.0004200092,0.5057901,0.004643327,0.3123192,0.004123912,0.1638259],"study_design_scores_gemma":[0.00003979311,0.0001212488,0.001212757,0.00003378293,0.000017322,0.0002925952,0.0001087804,0.6292209,0.003075875,0.3615016,0.00434765,0.00002770466],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1899576,0.0006311771,0.7974959,0.0009434182,0.00005635312,0.0001678469,0.001566359,0.001552397,0.007628985],"genre_scores_gemma":[0.6949087,0.00042822,0.2947004,0.0002818038,0.00007179704,0.0001987682,0.004676421,0.0003219015,0.004411967],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004749771,"threshold_uncertainty_score":0.01588959,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2121194346","doi":"10.1093/bioinformatics/bti427","title":"NodMutDB: a database for genes and mutants involved in symbiosis","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Legume Nitrogen Fixing Symbiosis","field":"Agricultural and Biological Sciences","cited_by":22,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"","keywords":"Functional genomics; Mutant; Gene; Computational biology; Function (biology); Biology; Schema (genetic algorithms); Symbiosis; Genomics; Database; Computer science; Genetics; Genome; Information retrieval","authors":[{"name":"Chuanzao Mao","is_ca":false},{"name":"Jian Qiu","is_ca":false},{"name":"Chen Wang","is_ca":false},{"name":"Trevor C. Charles","is_ca":true},{"name":"Bruno Sobral","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02845852507165696,"gpt":0.2535519766941076,"spread":0.2250934516224506,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009787346,0.001322898,0.001194893,0.00351909,0.0005636213,0.001279832,0.002729499,0.0009768128,0.01562918],"category_scores_gemma":[0.002237907,0.0004092207,0.0006824912,0.00467804,0.0002757217,0.001409931,0.001729683,0.0006966791,0.01114269],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004945339,"about_ca_system_score_gemma":0.001433445,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00235704,"about_ca_topic_score_gemma":0.002556749,"domain_scores_codex":[0.9993523,0.00007775765,0.0001900989,0.0001493615,0.0001830372,0.00004748124],"domain_scores_gemma":[0.9989436,0.0002424153,0.0002690765,0.0001764085,0.0001871455,0.0001811878],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.003625826,0.0004303569,0.02176936,0.01309101,0.0005617455,0.00244372,0.0008215094,0.004966174,0.1392102,0.01964817,0.5052317,0.2882002],"study_design_scores_gemma":[0.0003960071,0.0002361709,0.0190786,0.0007150371,0.0003783114,0.002403692,0.0002634685,0.00604995,0.03880825,0.007753486,0.923786,0.0001310205],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"dataset","genre_gemma":"software","genre_scores_codex":[0.03212758,0.007265924,0.05298954,0.0008311688,0.0002206322,0.0003208337,0.8492156,0.04135675,0.01567193],"genre_scores_gemma":[0.02872334,0.002194116,0.04164556,0.0002577194,0.0000403593,0.0002473906,0.9229531,0.001773969,0.002164541],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.01562918,"threshold_uncertainty_score":0.05228478,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2114368649","doi":"10.1093/bioinformatics/bti1045","title":"GenXHC: a probabilistic generative model for cross-hybridization compensation in high-density genome-wide microarray data","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":18,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Generative model; Computer science; Probabilistic logic; Generative grammar; Genome; Compensation (psychology); Computational biology; Statistical model; Microarray; Data mining; Artificial intelligence; Biology; Genetics; Gene; Gene expression","authors":[{"name":"Jiacong Huang","is_ca":true},{"name":"Quaid Morris","is_ca":true},{"name":"Timothy Hughes","is_ca":true},{"name":"Brendan J. Frey","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04346260838480358,"gpt":0.3150488217447869,"spread":0.2715862133599833,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005630623,0.0008629601,0.001402249,0.001015631,0.0007801946,0.0009205641,0.003267631,0.001750481,0.001801241],"category_scores_gemma":[0.007864643,0.001140931,0.001654987,0.001059531,0.001661939,0.001030471,0.001741124,0.00245606,0.0004672995],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001574671,"about_ca_system_score_gemma":0.001552133,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01029765,"about_ca_topic_score_gemma":0.01271637,"domain_scores_codex":[0.9983277,0.0008136251,0.0000576724,0.0003989633,0.0003035781,0.00009843066],"domain_scores_gemma":[0.9957454,0.003305495,0.0002372124,0.0003081783,0.0003069268,0.00009688201],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001044779,0.00004470145,0.001629001,0.00005452171,0.0001163702,0.0000735011,0.00009971716,0.9072905,0.003148962,0.01202096,0.00189452,0.07352285],"study_design_scores_gemma":[0.000007455482,0.000006260102,0.0001496205,0.000002257941,0.000004985308,0.00001760162,0.000003301876,0.9952996,0.0004679047,0.003801014,0.0002345757,0.000005476993],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.00544987,0.00008629898,0.9935172,0.0001324119,0.00001399627,0.00003527667,0.00007393866,0.0005529206,0.0001381675],"genre_scores_gemma":[0.25464,0.0002152901,0.7388949,0.0006244127,0.0001232134,0.0005179847,0.001557913,0.0005052006,0.002921069],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01029765,"threshold_uncertainty_score":0.02977794,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2108926360","doi":"10.1093/bioinformatics/bti1050","title":"Search for folding nuclei in native protein structures","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":15,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Executable; Computer science; Protein folding; Folding (DSP implementation); Simple (philosophy); Algorithm; Graph; Theoretical computer science; Topology (electrical circuits); Physics; Mathematics; Combinatorics; Engineering","authors":[{"name":"Alena Shmygelska","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01417628164947042,"gpt":0.296746002949353,"spread":0.2825697212998826,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001115654,0.0009267635,0.001234212,0.00166259,0.0008500808,0.00110282,0.001574081,0.00163451,0.0026626],"category_scores_gemma":[0.004373744,0.0003731293,0.0007721698,0.001200076,0.001099497,0.001303866,0.0007648413,0.0008234924,0.001391476],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005491294,"about_ca_system_score_gemma":0.0008684245,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001645324,"about_ca_topic_score_gemma":0.002240288,"domain_scores_codex":[0.9994265,0.0001256717,0.00003770653,0.0002675075,0.0001013778,0.00004138122],"domain_scores_gemma":[0.9971052,0.001602532,0.0004484062,0.0003457063,0.0003049884,0.0001932203],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001002583,0.0004119769,0.06019296,0.002024365,0.0003028788,0.001045236,0.0004704693,0.6054974,0.03060324,0.02904272,0.02182115,0.247585],"study_design_scores_gemma":[0.00005069935,0.0001063964,0.003434665,0.00007109779,0.0000471218,0.0003333614,0.0001771276,0.9389361,0.01428723,0.03699313,0.005538143,0.00002509034],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4739946,0.003801473,0.5057297,0.001031063,0.0001202723,0.0002258684,0.004924797,0.0062707,0.003901546],"genre_scores_gemma":[0.7613398,0.0008751145,0.2242012,0.0002166254,0.00007199377,0.0001378106,0.01118193,0.0004506894,0.00152482],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.0026626,"threshold_uncertainty_score":0.008907259,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2099398646","doi":"10.1093/bioinformatics/bti170","title":"BIAS: Bioinformatics Integrated Application Software","year":2004,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Software; Object (grammar); Data mining; Relational database; Bioinformatics; Data science; Software engineering; Artificial intelligence; Programming language; Biology","authors":[{"name":"Greg Finak","is_ca":true},{"name":"Noa Godin","is_ca":true},{"name":"Michael Hallett","is_ca":true},{"name":"François Pépin","is_ca":true},{"name":"Z. Rajabi","is_ca":true},{"name":"Varun Srivastava","is_ca":true},{"name":"Zuojian Tang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01302460520350489,"gpt":0.2429522021158472,"spread":0.2299275969123423,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004996551,0.001346116,0.001316826,0.002315968,0.0007913494,0.002986923,0.003957835,0.00161065,0.03868812],"category_scores_gemma":[0.01753323,0.001500297,0.001268401,0.003255307,0.0008086844,0.00413722,0.00485039,0.003881905,0.03777235],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001000049,"about_ca_system_score_gemma":0.002624887,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002176952,"about_ca_topic_score_gemma":0.001619,"domain_scores_codex":[0.9963431,0.0006993397,0.0003144275,0.0005711744,0.001785149,0.0002868249],"domain_scores_gemma":[0.9922943,0.003340911,0.0004924015,0.001069568,0.002068969,0.0007337678],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0008560835,0.0001504443,0.003193071,0.002037673,0.0001971392,0.000337828,0.0004045243,0.00591692,0.01439381,0.03597879,0.5334812,0.4030525],"study_design_scores_gemma":[0.0005937875,0.0001807826,0.003159872,0.0004650318,0.0001360139,0.000870515,0.00007145916,0.0486313,0.01348505,0.06502773,0.8671632,0.0002153166],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.002891028,0.001363982,0.5907609,0.001507353,0.000542207,0.0008653155,0.01112523,0.370988,0.01995588],"genre_scores_gemma":[0.03440148,0.002237308,0.8087072,0.003354295,0.0005767862,0.003309166,0.03902527,0.08139926,0.02698921],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.03868812,"threshold_uncertainty_score":0.1294247,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2117003089","doi":"10.1093/bioinformatics/bti280","title":"Computational identification of human mitochondrial proteins based on homology to yeast mitochondrially targeted proteins","year":2005,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Machine Learning in Bioinformatics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Hospital for Sick Children","funders":"Canadian Institutes of Health Research; Hospital for Sick Children","keywords":"Biology; Human genome; Computational biology; Saccharomyces cerevisiae; Homology (biology); Genetics; Human proteins; Gene; Genome; Human mitochondrial genetics; Mitochondrion; UniGene; Expressed sequence tag","authors":[{"name":"Jessie M. Cameron","is_ca":true},{"name":"Thomas R. Hurd","is_ca":true},{"name":"B. H. Robinson","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.008637087028099883,"gpt":0.2773267700318632,"spread":0.2686896830037633,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005642726,0.0008173052,0.000823627,0.002973951,0.0005032109,0.0007834284,0.0008059799,0.000857193,0.00266846],"category_scores_gemma":[0.0018828,0.0002451663,0.001041084,0.00204686,0.0002737953,0.000483447,0.0005475325,0.0004390683,0.0008304568],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006180203,"about_ca_system_score_gemma":0.0007831383,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003145022,"about_ca_topic_score_gemma":0.004820281,"domain_scores_codex":[0.9997601,0.00003944863,0.00002482528,0.0001132227,0.00004042,0.00002201354],"domain_scores_gemma":[0.999294,0.0004170679,0.00008822043,0.00004820173,0.0000637409,0.00008864185],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01029571,0.002148218,0.272319,0.005503327,0.002271698,0.005163497,0.0004236535,0.3987613,0.06568046,0.004894819,0.06550051,0.1670378],"study_design_scores_gemma":[0.0006867567,0.0005844517,0.080885,0.0001286102,0.0004424964,0.002216083,0.0003134157,0.8875871,0.0121465,0.004029828,0.01093092,0.0000488465],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9559582,0.001305362,0.007139912,0.0003789772,0.00004568781,0.0001008327,0.03183647,0.001636532,0.001597927],"genre_scores_gemma":[0.7853436,0.000856073,0.05289411,0.0002003892,0.00004144093,0.0001941583,0.1595249,0.0001527487,0.0007925858],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003145022,"threshold_uncertainty_score":0.008926928,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2509574344","doi":"10.1093/bioinformatics/btw481","title":"ECCB 2016: The 15th European Conference on Computational Biology","year":2016,"lang":"en","type":"editorial","venue":"Computer applications in the biosciences","topic":"Cancer Genomics and Diagnostics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Cancer Research UK Cambridge Institute, University of Cambridge; RIKEN; Swiss Institute of Bioinformatics; Università di Bologna; Rigshospitalet; University of Oxford; Vrije Universiteit Amsterdam; Wageningen University and Research; Aalto-Yliopisto; Universiteit Utrecht; Univerzita Karlova v Praze; Centre National de la Recherche Scientifique; Cancer Research UK; University College London; Institut National de la Recherche Agronomique; University of Toronto; Technische Universität Dresden; Eidgenössische Technische Hochschule Zürich; Universiteit Leiden; Okinawa Institute of Science and Technology Graduate University; Universität des Saarlandes; University of Notre Dame; European Bioinformatics Institute; University of California, Santa Cruz; Vrije Universiteit Brussel; Massachusetts General Hospital","keywords":"Computational biology; Computer science; Biology; Data science","authors":[{"name":"Jaap Heringa","is_ca":false},{"name":"Marcel Reinders","is_ca":false},{"name":"Sanne Abeln","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01384154714427038,"gpt":0.2938038882816018,"spread":0.2799623411373314,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01341801,0.003077095,0.00493642,0.005247262,0.002718512,0.01418149,0.003889288,0.01119317,0.02926069],"category_scores_gemma":[0.0319596,0.00112618,0.002181401,0.002848761,0.003809303,0.007912755,0.00383664,0.02185935,0.02756539],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003835131,"about_ca_system_score_gemma":0.004676925,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001932952,"about_ca_topic_score_gemma":0.005124918,"domain_scores_codex":[0.9927272,0.001262569,0.0006481367,0.0009341905,0.003979527,0.000448433],"domain_scores_gemma":[0.9550617,0.01609253,0.002237011,0.001805802,0.01812053,0.006682523],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00002871239,0.000007429299,0.0000108981,0.00013756,0.00001313352,0.00002012558,0.000007070047,0.00003329028,0.00004300837,0.000714996,0.9911413,0.007842441],"study_design_scores_gemma":[0.0000324899,0.00001121789,0.0001030388,0.0003322508,0.00001778006,0.00006620764,0.00001495852,0.0001972887,0.00008253854,0.002889249,0.9962376,0.00001534416],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"editorial","genre_gemma":"editorial","genre_scores_codex":[0.00004233783,0.01593948,0.001005837,0.04147717,0.9380383,0.00002232247,0.0001115732,0.00016583,0.003197206],"genre_scores_gemma":[0.0009505791,0.0164926,0.001058077,0.01860055,0.9260215,0.00006973663,0.0002904914,0.0004253355,0.0360912],"genre_candidate":"editorial","genre_consensus":"editorial","teacher_disagreement_score":0.02926069,"threshold_uncertainty_score":0.0978868,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2403880286","doi":"10.1093/bioinformatics/bts490","title":"ECCB 2012: The 11th European Conference on Computational Biology","year":2012,"lang":"en","type":"article","venue":"Computer applications in the biosciences","topic":"Genetics, Bioinformatics, and Biomedical Research","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"University at Buffalo; Swiss Institute of Bioinformatics; Schweizerische Akademie der Medizinischen Wissenschaften; Université de Genève; Eidgenössische Technische Hochschule Zürich; Universität Zürich; Branco Weiss Fellowship – Society in Science; Universität Basel; European Bioinformatics Institute; Universitätsspital Zürich; Microsoft Research","keywords":"Computer science; Computational biology; Biology","authors":[{"name":"Torsten Schwede","is_ca":false},{"name":"Dagmar Iber","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04298584498611423,"gpt":0.3267162124132776,"spread":0.2837303674271634,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011946,0.003083994,0.004078824,0.004288096,0.002282249,0.01437627,0.0057923,0.00635271,0.2421713],"category_scores_gemma":[0.02270314,0.001361337,0.002651358,0.004700114,0.002512729,0.01100832,0.008643459,0.00935601,0.1881449],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002718158,"about_ca_system_score_gemma":0.00678061,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002371058,"about_ca_topic_score_gemma":0.002062863,"domain_scores_codex":[0.9880978,0.003302011,0.0009255963,0.001832153,0.00486884,0.0009734594],"domain_scores_gemma":[0.9826499,0.004788135,0.0005694231,0.003373603,0.005495663,0.003123298],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005937865,0.00004187479,0.0000840685,0.0003164426,0.00002931528,0.00004578604,0.00004790303,0.0004861233,0.0003625989,0.009545935,0.9280571,0.06092343],"study_design_scores_gemma":[0.00001606831,0.00001597509,0.000183935,0.0002412365,0.000007992043,0.00007036463,0.00002464969,0.0007256647,0.0001381097,0.004648162,0.9939077,0.00002015577],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"other","genre_gemma":"editorial","genre_scores_codex":[0.00308555,0.116039,0.203392,0.07695486,0.255451,0.00167633,0.01532948,0.01706238,0.3110094],"genre_scores_gemma":[0.01429089,0.09912918,0.1175074,0.01803612,0.0541546,0.002784657,0.06114571,0.01685122,0.6161002],"genre_candidate":"editorial","genre_consensus":null,"teacher_disagreement_score":0.2421713,"threshold_uncertainty_score":0.8101438,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}