{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":160,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":160,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"6221cfeba50a","filters":{"venue":"Journal of Computational Biology"}},"results":[{"id":"W2033292629","doi":"10.1089/cmb.2009.0238","title":"Ray: Simultaneous Assembly of Reads from a Mix of High-Throughput Sequencing Technologies","year":2010,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":559,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université Laval; Centre hospitalier universitaire de Québec","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Compute Canada","keywords":"Contig; Sequence assembly; Hybrid genome assembly; Computer science; Software; DNA sequencing; Reference genome; Genome; Throughput; Computational biology; Sequence (biology); Data mining; Biology; Genetics; Gene; Transcriptome; Operating system","authors":[{"name":"Sébastien Boisvert","is_ca":true},{"name":"François Laviolette","is_ca":true},{"name":"Jacques Corbeil","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.00983358367180499,"gpt":0.2552465525768091,"spread":0.2454129689050041,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003592884,0.002261656,0.002069498,0.001730917,0.0007295145,0.002002626,0.001770437,0.001030456,0.005271464],"category_scores_gemma":[0.004242675,0.001831054,0.001913301,0.001262459,0.00040481,0.00134975,0.002321325,0.002168122,0.006704054],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004318075,"about_ca_system_score_gemma":0.0007424116,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005047796,"about_ca_topic_score_gemma":0.0009179854,"domain_scores_codex":[0.9967069,0.0008331017,0.0003543832,0.0008210478,0.001098242,0.0001862647],"domain_scores_gemma":[0.9981893,0.0005702222,0.0002620119,0.0005130747,0.0003141279,0.0001512408],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00253154,0.0002976916,0.004411809,0.001889517,0.001063989,0.0004968919,0.0006469808,0.01221676,0.7763137,0.005351054,0.01530151,0.1794785],"study_design_scores_gemma":[0.000445887,0.001549218,0.005732249,0.0001509862,0.0005637601,0.001009599,0.0001592388,0.09497274,0.7909293,0.004915841,0.09926026,0.0003109646],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04882193,0.001368111,0.9058723,0.0001626749,0.0002853436,0.001233674,0.005037334,0.03340289,0.003815638],"genre_scores_gemma":[0.04306881,0.0006952962,0.9357265,0.0002286127,0.00007730413,0.001235934,0.01187424,0.002399848,0.004693482],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.005271464,"threshold_uncertainty_score":0.01900119,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2056251063","doi":"10.1089/cmb.2014.0156","title":"PASTA: Ultra-Large Multiple Sequence Alignment for Nucleotide and Amino-Acid Sequences","year":2014,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":463,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute of General Medical Sciences; National Human Genome Research Institute; Howard Hughes Medical Institute; National Science Foundation; National Institutes of Health; National Institute on Aging; University of Alberta; Pennsylvania Department of Health","keywords":"Scalability; Multiple sequence alignment; Parallelizable manifold; Computer science; Sequence (biology); Alignment-free sequence analysis; Sequence alignment; Tree (set theory); Algorithm; Computational biology; Data mining; Biology; Mathematics; Peptide sequence; Genetics","authors":[{"name":"Siavash Mirarab","is_ca":false},{"name":"Nam Nguyen","is_ca":false},{"name":"Sheng Guo","is_ca":false},{"name":"Li‐San Wang","is_ca":false},{"name":"Junhyong Kim","is_ca":false},{"name":"Tandy Warnow","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01704934772177304,"gpt":0.2699171632434254,"spread":0.2528678155216524,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001779282,0.002186312,0.001940837,0.002041468,0.001742635,0.002357734,0.003189798,0.001598443,0.009685293],"category_scores_gemma":[0.0074421,0.001542999,0.001917331,0.002626024,0.000711169,0.00364309,0.002145918,0.004389331,0.01154871],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006137494,"about_ca_system_score_gemma":0.001543613,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001060265,"about_ca_topic_score_gemma":0.001756555,"domain_scores_codex":[0.9987226,0.0004651448,0.0001311184,0.000312034,0.0003021515,0.00006697385],"domain_scores_gemma":[0.9982575,0.0006545579,0.0002442256,0.0004729968,0.0002530506,0.0001178383],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001656685,0.0003503605,0.004579003,0.003997467,0.001718264,0.00155126,0.0009213295,0.0680927,0.124498,0.06317033,0.1961024,0.5333623],"study_design_scores_gemma":[0.0003440355,0.0003557925,0.001695595,0.0004267751,0.0002582981,0.002021485,0.0001624051,0.5128191,0.04901577,0.08398648,0.3486494,0.000264888],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.006321382,0.002684684,0.9233872,0.0004391462,0.0005921589,0.0001399017,0.004703834,0.05929677,0.002434973],"genre_scores_gemma":[0.02435937,0.001376391,0.9526307,0.0002892072,0.000180537,0.0005243854,0.01356981,0.005180215,0.001889326],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.009685293,"threshold_uncertainty_score":0.03240061,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2061327015","doi":"10.1089/106652703322756104","title":"Mining the Biomedical Literature in the Genomic Era: An Overview","year":2003,"lang":"en","type":"review","venue":"Journal of Computational Biology","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":264,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"","keywords":"Data science; Computer science; Biomedical text mining; sort; Genomics; Genome; Data mining; Text mining; Information retrieval; Biology","authors":[{"name":"Hagit Shatkay","is_ca":true},{"name":"Ronen Feldman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06706577458925418,"gpt":0.389611694130938,"spread":0.3225459195416839,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002824231,0.0005836831,0.001233272,0.01515552,0.0008539439,0.003244037,0.00148766,0.001416389,0.002311981],"category_scores_gemma":[0.005903593,0.0004126323,0.0008330981,0.01681826,0.001170995,0.006688852,0.001092049,0.0009199887,0.002407409],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000890231,"about_ca_system_score_gemma":0.002592921,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002579529,"about_ca_topic_score_gemma":0.004364704,"domain_scores_codex":[0.9986569,0.0003765138,0.0001911789,0.0001760965,0.0005567112,0.0000426176],"domain_scores_gemma":[0.9945779,0.003748448,0.0003416917,0.0001808282,0.0009720536,0.0001790595],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00003024232,0.00006137912,0.001016108,0.007914093,0.00009193821,0.0004587969,0.0003075393,0.0008408768,0.001520842,0.008288426,0.01664144,0.9628283],"study_design_scores_gemma":[0.00002115398,0.00007689466,0.004192621,0.008263817,0.0001803161,0.004865238,0.0009504853,0.002417942,0.002161783,0.03595051,0.9408574,0.00006192469],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.002638045,0.9376332,0.04391615,0.007508941,0.0005460501,0.0001062656,0.000459794,0.0004016832,0.006789815],"genre_scores_gemma":[0.008210965,0.9190524,0.06789776,0.001436503,0.0007262246,0.00008274867,0.00063938,0.00004091093,0.001913139],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.01515552,"threshold_uncertainty_score":0.01493615,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2074993099","doi":"10.1089/10665270152530818","title":"On Combinatorial DNA Word Design","year":2001,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Advanced biosensing and bioanalysis techniques","field":"Biochemistry, Genetics and Molecular Biology","cited_by":236,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Alphabet; Word (group theory); DNA computing; Combinatorics; Heuristic; Code (set theory); Discrete mathematics; Computer science; Coding (social sciences); Dynamic programming; Constraint (computer-aided design); Complement (music); Algorithm; Mathematics; Computation; Biology; Genetics; Set (abstract data type)","authors":[{"name":"Amit Marathe","is_ca":false},{"name":"Anne Condon","is_ca":true},{"name":"Robert M. Corn","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01447372318489215,"gpt":0.2974973618649308,"spread":0.2830236386800386,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001943879,0.00172783,0.001671436,0.001820845,0.001104936,0.002961368,0.00211395,0.002166978,0.007811937],"category_scores_gemma":[0.01010469,0.0009378939,0.001534384,0.003527007,0.003270759,0.004016774,0.002425747,0.00255497,0.002027108],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001537289,"about_ca_system_score_gemma":0.001063856,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008908513,"about_ca_topic_score_gemma":0.0009747364,"domain_scores_codex":[0.9976926,0.0008186825,0.0001514227,0.0005289507,0.0005836462,0.0002247443],"domain_scores_gemma":[0.9943036,0.004399006,0.0002885411,0.0004632099,0.0003863898,0.000159301],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001193659,0.0001299569,0.000474143,0.0006627687,0.00006828384,0.0002241313,0.0001588569,0.3189791,0.002329975,0.5601402,0.007147759,0.1095654],"study_design_scores_gemma":[0.00005753396,0.00009815973,0.00007548091,0.00007125021,0.00002320732,0.0001588614,0.00004404455,0.2472183,0.001226904,0.7336746,0.01732363,0.00002805961],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.009804489,0.002784309,0.9689839,0.0007425323,0.0002578312,0.0001353896,0.0002074308,0.0002569439,0.01682709],"genre_scores_gemma":[0.1490334,0.006920289,0.8239378,0.001055257,0.0007720924,0.001044307,0.001268734,0.0004413283,0.01552679],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007811937,"threshold_uncertainty_score":0.02613354,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2054547415","doi":"10.1089/106652701300099119","title":"Perfect Phylogenetic Networks with Recombination","year":2001,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":216,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Phylogenetic tree; Phylogenetic network; Recombination; Phylogenetics; Tree (set theory); Time complexity; Mathematics; Evolutionary biology; Biology; Combinatorics; Computer science; Genetics; Gene","authors":[{"name":"Lusheng Wang","is_ca":false},{"name":"Kaizhong Zhang","is_ca":true},{"name":"Louxin Zhang","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.007125730998609258,"gpt":0.2408557460107803,"spread":0.2337300150121711,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001449899,0.0004504704,0.0008006437,0.0006994652,0.0008810641,0.001787379,0.001342942,0.00133686,0.004443177],"category_scores_gemma":[0.006290611,0.0004440577,0.0007353244,0.001492908,0.001161176,0.006117053,0.001919929,0.001313399,0.0004853471],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008755982,"about_ca_system_score_gemma":0.0007657019,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007886321,"about_ca_topic_score_gemma":0.0009575853,"domain_scores_codex":[0.9986696,0.0004848796,0.00006008064,0.0004529186,0.0001954494,0.0001369844],"domain_scores_gemma":[0.997012,0.001658968,0.0004840545,0.0005158909,0.0001395076,0.0001894565],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002883954,0.0000715794,0.001832315,0.0003536357,0.00006574775,0.0002665974,0.0002412249,0.3879794,0.005080166,0.5067789,0.005034228,0.09200776],"study_design_scores_gemma":[0.00004123795,0.00007643755,0.0004298716,0.00002981633,0.00003308248,0.0003214819,0.00009024101,0.4741282,0.002302564,0.5106915,0.0118333,0.00002206109],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06675501,0.0006502388,0.9248459,0.0008383156,0.00003917776,0.00006946025,0.0005688018,0.0003968861,0.005836207],"genre_scores_gemma":[0.6304662,0.0009481537,0.361448,0.0002227378,0.00007224498,0.0001699259,0.00167928,0.0001225095,0.004870878],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004443177,"threshold_uncertainty_score":0.01486391,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2008288996","doi":"10.1089/10665270252935511","title":"A General Edit Distance between RNA Structures","year":2002,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"RNA and protein synthesis mechanisms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":207,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; National Science Foundation","keywords":"Edit distance; RNA; Similarity (geometry); Set (abstract data type); Computer science; Computation; Nucleic acid secondary structure; Arc (geometry); Algorithm; Mathematics; Theoretical computer science; Artificial intelligence; Geometry; Biology; Genetics; Programming language","authors":[{"name":"Tao Jiang","is_ca":false},{"name":"Guohui Lin","is_ca":true},{"name":"Bin Ma","is_ca":true},{"name":"Kaizhong Zhang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01613724710562217,"gpt":0.2617552788092111,"spread":0.245618031703589,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00102101,0.000701651,0.0008245961,0.002197562,0.0005790603,0.001535863,0.001801566,0.001203756,0.002629273],"category_scores_gemma":[0.005461258,0.0002452462,0.0008040318,0.002435426,0.0008458921,0.003245809,0.001347369,0.0007971685,0.0008559687],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0006440808,"about_ca_system_score_gemma":0.0006750733,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008098477,"about_ca_topic_score_gemma":0.0009402627,"domain_scores_codex":[0.997815,0.0003853423,0.0001860072,0.0008958355,0.000637529,0.00008022371],"domain_scores_gemma":[0.9978049,0.0009271016,0.0002366363,0.0004972245,0.0004198086,0.0001143934],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003269419,0.0001741383,0.004661139,0.0007142025,0.0002882837,0.0007963983,0.0003746529,0.2417997,0.03886736,0.237626,0.006289026,0.468082],"study_design_scores_gemma":[0.00004380014,0.0004834671,0.002731139,0.00006363275,0.00009077461,0.002326995,0.000134942,0.6471317,0.02081396,0.2981864,0.02788102,0.0001122412],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03383512,0.0006785732,0.9608782,0.0001757015,0.0000877555,0.00008226228,0.0008993304,0.0005438966,0.002819224],"genre_scores_gemma":[0.404007,0.0009327774,0.5866218,0.0001808553,0.0001722763,0.0001882975,0.00217728,0.000171929,0.005547796],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002629273,"threshold_uncertainty_score":0.008795798,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2253609413","doi":"10.1089/cmb.2015.0189","title":"Deep Feature Selection: Theory and Application to Identify Enhancers and Promoters","year":2016,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Chromatin Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":207,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"National Research Council Canada","funders":"Natural Sciences and Engineering Research Council of Canada; Genome Canada","keywords":"Artificial intelligence; Deep learning; Computer science; Feature selection; Feature (linguistics); Artificial neural network; Machine learning; Nonlinear system; Selection (genetic algorithm); Linear model; Pattern recognition (psychology)","authors":[{"name":"Yifeng Li","is_ca":true},{"name":"Chih‐Yu Chen","is_ca":false},{"name":"Wyeth W. Wasserman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.002544613022489751,"gpt":0.2572304031433438,"spread":0.254685790120854,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001133822,0.000756607,0.001004579,0.001380201,0.000313071,0.0006871111,0.0009073275,0.0009007053,0.001407251],"category_scores_gemma":[0.002708661,0.0003854151,0.0008698377,0.00152683,0.0006753358,0.0009634385,0.0009037098,0.001122941,0.0003064391],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007032811,"about_ca_system_score_gemma":0.0007003306,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002848326,"about_ca_topic_score_gemma":0.002042359,"domain_scores_codex":[0.999638,0.00008906578,0.00002710833,0.00008640029,0.0001121994,0.00004723306],"domain_scores_gemma":[0.9989302,0.0006678352,0.00009458644,0.00006175559,0.000207643,0.00003800282],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001343389,0.00009369535,0.00413013,0.0002133222,0.0001332232,0.0002009411,0.0001076957,0.4229197,0.0102504,0.0452656,0.006340086,0.5102108],"study_design_scores_gemma":[0.00001191326,0.0000284688,0.000543634,0.00001500472,0.00001970329,0.0000580501,0.000008532864,0.9737207,0.002068691,0.02184406,0.001670948,0.00001030731],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007017225,0.0007504381,0.9909096,0.0002539177,0.000036651,0.00002298503,0.0001044882,0.0003261615,0.0005784294],"genre_scores_gemma":[0.5439833,0.002686671,0.4459836,0.0005360133,0.0002986634,0.0003593475,0.0009427592,0.0001603348,0.005049093],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002848326,"threshold_uncertainty_score":0.005996227,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2034206030","doi":"10.1089/10665270252935421","title":"Algorithms for Phylogenetic Footprinting","year":2002,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":177,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Defense Advanced Research Projects Agency; National Science Foundation","keywords":"Substring; Phylogenetic tree; Footprinting; Computational biology; Biology; Dynamic programming; Set (abstract data type); Computer science; Phylogenetic network; Conserved sequence; Theoretical computer science; Genetics; Algorithm; DNA; Gene; Base sequence","authors":[{"name":"Mathieu Blanchette","is_ca":false},{"name":"Benno Schwikowski","is_ca":false},{"name":"Martin Tompa","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02977687371953442,"gpt":0.2799829105839355,"spread":0.2502060368644011,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00357426,0.002378793,0.001989884,0.004020083,0.002331852,0.003454779,0.004741549,0.002678131,0.02751186],"category_scores_gemma":[0.01840775,0.001787626,0.003057589,0.005329884,0.00154134,0.006166305,0.005036493,0.004265813,0.01418131],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001781026,"about_ca_system_score_gemma":0.002388146,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002795615,"about_ca_topic_score_gemma":0.00361111,"domain_scores_codex":[0.9970998,0.0007886176,0.0002810916,0.000707907,0.0008588043,0.000263816],"domain_scores_gemma":[0.9933542,0.003685886,0.0003041006,0.001425253,0.001044854,0.0001856752],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001801297,0.0002039917,0.001753049,0.000662756,0.0002092724,0.000168347,0.0003812132,0.1643098,0.002813467,0.2137553,0.0393786,0.5761841],"study_design_scores_gemma":[0.00009298966,0.00003179081,0.0002168816,0.00008893161,0.00003683518,0.0001972133,0.00009013579,0.4609738,0.001625028,0.4931697,0.04343902,0.00003759821],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0007680181,0.0002268734,0.9925775,0.0001436759,0.0000454175,0.00008147466,0.0004437821,0.003765414,0.001947757],"genre_scores_gemma":[0.01374488,0.0003220666,0.9809522,0.0001198845,0.00006214857,0.0003827297,0.001678146,0.001077194,0.001660646],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02751186,"threshold_uncertainty_score":0.09203637,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2081112743","doi":"10.1089/106652703322756195","title":"A Transition Probability Model for Amino Acid Substitutions from Blocks","year":2003,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":140,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University Health Network; Ontario Institute for Cancer Research","funders":"","keywords":"Substitution (logic); Sequence (biology); Distance matrices in phylogeny; Sequence alignment; Function (biology); Stochastic matrix; Matrix (chemical analysis); Protein sequencing; Computer science; Protein evolution; Algorithm; Evolutionary algorithm; Mathematics; Peptide sequence; Combinatorics; Biology; Genetics; Artificial intelligence; Machine learning; Chemistry","authors":[{"name":"Shalini Veerassamy","is_ca":true},{"name":"Andrew D. Smith","is_ca":true},{"name":"Elisabeth R.M. Tillier","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02387444716844759,"gpt":0.2631178745095681,"spread":0.2392434273411206,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00198656,0.0007196104,0.001650901,0.001635786,0.0009961966,0.002139557,0.003391224,0.002479219,0.01327432],"category_scores_gemma":[0.007580881,0.0008248806,0.001533668,0.001746336,0.001829613,0.004434119,0.001416353,0.002951708,0.004466276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001119636,"about_ca_system_score_gemma":0.001052711,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005342313,"about_ca_topic_score_gemma":0.003502453,"domain_scores_codex":[0.9988821,0.0002789804,0.00005255702,0.0003469677,0.0002370713,0.0002023215],"domain_scores_gemma":[0.9958792,0.002697455,0.000356773,0.000411104,0.0004173948,0.0002380647],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002127001,0.0001370371,0.002974316,0.0001970848,0.00009746139,0.0005716429,0.0005075969,0.2487376,0.005437119,0.7030964,0.008254901,0.02977609],"study_design_scores_gemma":[0.0000564241,0.00005642551,0.0005474046,0.00002511994,0.00003932506,0.0002828557,0.00002670237,0.8095279,0.0004817348,0.1839977,0.004915052,0.00004320842],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04508565,0.0006720875,0.9391358,0.001092354,0.0002283363,0.0001559273,0.001254678,0.0007855513,0.0115896],"genre_scores_gemma":[0.7536561,0.002066079,0.1635603,0.0006916936,0.0004958037,0.001230494,0.002358297,0.0005728132,0.07536843],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01327432,"threshold_uncertainty_score":0.04440701,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3093225483","doi":"10.1089/cmb.2020.0252","title":"Diagnosis of Autism Spectrum Disorder Based on Functional Brain Networks with Deep Learning","year":2020,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":134,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Autoencoder; Autism spectrum disorder; Artificial intelligence; Computer science; Deep learning; Machine learning; Benchmark (surveying); Artificial neural network; Functional magnetic resonance imaging; Autism; Pattern recognition (psychology); Set (abstract data type); Neuroscience; Psychology","authors":[{"name":"Wutao Yin","is_ca":true},{"name":"Sakib Mostafa","is_ca":true},{"name":"Fang‐Xiang Wu","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02267701052063384,"gpt":0.2459420574932694,"spread":0.2232650469726356,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004873693,0.0007289776,0.000305713,0.001326544,0.0002102905,0.0003170662,0.0004119783,0.0006703045,0.0006827254],"category_scores_gemma":[0.001822053,0.0001712837,0.0003907566,0.0003261872,0.0002885597,0.0005749626,0.0006595301,0.0005662833,0.0002440135],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004283863,"about_ca_system_score_gemma":0.0003719252,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003595433,"about_ca_topic_score_gemma":0.006087583,"domain_scores_codex":[0.999689,0.00006612954,0.00002742056,0.00009916699,0.00008416217,0.0000342512],"domain_scores_gemma":[0.9996061,0.0001459085,0.00008656727,0.0000308223,0.0001040147,0.00002666438],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006497643,0.0004031205,0.1062647,0.000383146,0.0003127513,0.00179197,0.0002280334,0.1386281,0.05934121,0.004949464,0.00913339,0.6779144],"study_design_scores_gemma":[0.00002264721,0.00009869393,0.02446912,0.00006573932,0.00005756915,0.0008793459,0.00006469822,0.9534807,0.0137119,0.005803464,0.001317393,0.00002868366],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.4229748,0.00296366,0.5635123,0.001413732,0.0001422315,0.0002427197,0.001511296,0.001457175,0.00578199],"genre_scores_gemma":[0.9138885,0.0007571232,0.08296313,0.0001554837,0.00005421936,0.000108472,0.001086306,0.00003593023,0.0009508815],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003595433,"threshold_uncertainty_score":0.007149041,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2035596374","doi":"10.1089/cmb.2009.0047","title":"Maximum Likelihood Genome Assembly","year":2009,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":129,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Genome; De Bruijn graph; De Bruijn sequence; Contig; Hybrid genome assembly; Sequence assembly; Computational biology; Biology; Genetics; Computer science; Algorithm; Mathematics; Combinatorics; Gene","authors":[{"name":"Paul Medvedev","is_ca":true},{"name":"Michael Brudno","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.009191157194856088,"gpt":0.2570611932085001,"spread":0.247870036013644,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001466822,0.001681123,0.001695535,0.001675711,0.001294167,0.001947961,0.003029036,0.002186728,0.01166609],"category_scores_gemma":[0.006892235,0.00127681,0.002014368,0.001750994,0.0006506745,0.001677322,0.002181247,0.00200291,0.008093952],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009806864,"about_ca_system_score_gemma":0.001487,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001690473,"about_ca_topic_score_gemma":0.002036442,"domain_scores_codex":[0.9984946,0.0004547762,0.00007927237,0.000531494,0.0003185975,0.0001211278],"domain_scores_gemma":[0.998094,0.0008986538,0.0001464566,0.0004195721,0.0003681942,0.00007307679],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009728312,0.0003606631,0.004877008,0.001589781,0.0004513798,0.0009904291,0.0006324538,0.3989322,0.0734472,0.09078088,0.03504722,0.391918],"study_design_scores_gemma":[0.00008865822,0.00007293849,0.0006822787,0.00005597462,0.00005522935,0.0003576179,0.00007307461,0.8931926,0.02035451,0.05400991,0.03098061,0.00007656072],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004990659,0.0002345778,0.9862141,0.000122121,0.00006025357,0.0001199691,0.001582669,0.003896135,0.002779506],"genre_scores_gemma":[0.05191153,0.0002538793,0.9343426,0.0001151305,0.00003090952,0.000321692,0.007346047,0.00138651,0.004291811],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01166609,"threshold_uncertainty_score":0.03902698,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1983815263","doi":"10.1089/cmb.2006.13.267","title":"RNA–RNA Interaction Prediction and Antisense RNA Target Search","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"RNA and protein synthesis mechanisms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":128,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University; Simon Fraser University","funders":"","keywords":"RNA; Non-coding RNA; Computational biology; Antisense RNA; Biology; Nucleic acid secondary structure; Gene; Nucleic acid structure; Algorithm; Sense (electronics); Genetics; Computer science; Chemistry","authors":[{"name":"Can Alkan","is_ca":false},{"name":"Emre Karakoç","is_ca":true},{"name":"Joseph H. Nadeau","is_ca":false},{"name":"S. Cenk Şahinalp","is_ca":true},{"name":"Kaizhong Zhang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01063543045560723,"gpt":0.267135800277262,"spread":0.2565003698216548,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001025978,0.0007703633,0.001133496,0.001207343,0.0004139527,0.0005528637,0.001576526,0.001494551,0.002587979],"category_scores_gemma":[0.002145981,0.0005843588,0.0007611832,0.001095724,0.0006132442,0.001145255,0.0006616388,0.0006860213,0.0007507434],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004526473,"about_ca_system_score_gemma":0.0007208586,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001599337,"about_ca_topic_score_gemma":0.001933736,"domain_scores_codex":[0.9994674,0.0002124863,0.00002307532,0.0001200386,0.0001214873,0.00005540393],"domain_scores_gemma":[0.9989121,0.0007957123,0.00009391358,0.00005432606,0.0001072961,0.00003661505],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002053995,0.0001635498,0.002249448,0.0001108981,0.00007321838,0.0001924364,0.00004566225,0.8603212,0.009141792,0.01178779,0.002116896,0.1135917],"study_design_scores_gemma":[0.00001351076,0.00002138812,0.0001473537,0.000002005309,0.00000662606,0.00003099874,0.000007570735,0.9928458,0.001793705,0.004810871,0.0003161043,0.00000399491],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.06532829,0.0002587981,0.9305492,0.000197198,0.00001384432,0.00005373189,0.000126337,0.001640619,0.001831942],"genre_scores_gemma":[0.4202184,0.0002024455,0.5750962,0.0001637279,0.00003420801,0.0002089773,0.0007369054,0.0002135329,0.003125594],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002587979,"threshold_uncertainty_score":0.008657634,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2026888821","doi":"10.1089/cmb.2006.13.1630","title":"A General Modeling Strategy for Gene Regulatory Networks with Stochastic Dynamics","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Gene Regulatory Network Analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":127,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"Fundação para a Ciência e a Tecnologia; Natural Sciences and Engineering Research Council of Canada; Government of Alberta","keywords":"Gene; Gene regulatory network; Genetic network; Stochastic modelling; Computer science; Computational biology; Translation (biology); Genetics; Transcription (linguistics); Regulation of gene expression; Stochastic process; Activator (genetics); Biology; Gene expression; Mathematics; Messenger RNA","authors":[{"name":"André S. Ribeiro","is_ca":true},{"name":"Rui Zhu","is_ca":true},{"name":"Stuart Kauffman","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.008581990317334634,"gpt":0.2416487419311768,"spread":0.2330667516138422,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006249528,0.0009129451,0.0009159885,0.0005402219,0.0005147426,0.0009222135,0.001708703,0.001360477,0.00190751],"category_scores_gemma":[0.00133133,0.0004694434,0.001481012,0.0005578508,0.000679849,0.001030041,0.0006911834,0.001056817,0.0005159582],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001079259,"about_ca_system_score_gemma":0.001238486,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006945193,"about_ca_topic_score_gemma":0.004533336,"domain_scores_codex":[0.9997111,0.0000870947,0.00001469476,0.00007447459,0.00008365724,0.00002900072],"domain_scores_gemma":[0.9997672,0.0001188117,0.0000306271,0.00002047975,0.00003959666,0.00002323153],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000006078586,0.000009699954,0.0001205285,0.00001502914,0.00001806072,0.00005717221,0.00002694666,0.9424362,0.001873869,0.05282258,0.0001648811,0.002448977],"study_design_scores_gemma":[0.00000352709,0.000006188371,0.00002062328,0.000001661217,0.000004183633,0.00001157371,0.000002355047,0.9888948,0.0001465752,0.01036412,0.0005402341,0.000004112295],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.009717864,0.00009936473,0.9878593,0.0001472347,0.00002019229,0.0000408983,0.00007764479,0.0001206369,0.001916826],"genre_scores_gemma":[0.5693458,0.001053888,0.4137286,0.0002864993,0.00008186195,0.001046128,0.0004361249,0.0001957788,0.01382527],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006945193,"threshold_uncertainty_score":0.01380956,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2161936690","doi":"10.1089/cmb.2008.0221","title":"Parallel GPU Implementation of Iterative PCA Algorithms","year":2009,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Spectroscopy and Chemometric Analyses","field":"Chemistry","cited_by":119,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"","keywords":"Principal component analysis; Orthogonalization; Graphics processing unit; Computer science; Algorithm; Orthogonality; CUDA; Graphics; Parallel computing; Artificial intelligence; Mathematics; Computer graphics (images)","authors":[{"name":"M. Andrecut","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01947093356858705,"gpt":0.3585168678255983,"spread":0.3390459342570113,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003905696,0.0009240597,0.0008103974,0.0006494562,0.000640741,0.001245602,0.001481534,0.0007583748,0.0109233],"category_scores_gemma":[0.002177971,0.0003507404,0.0006145088,0.001296682,0.0003193135,0.0007584633,0.0008573855,0.0008075875,0.003069307],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007785599,"about_ca_system_score_gemma":0.001453553,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01081996,"about_ca_topic_score_gemma":0.01022161,"domain_scores_codex":[0.9994881,0.0001027902,0.00002965665,0.00007184556,0.0002248188,0.00008270572],"domain_scores_gemma":[0.9992597,0.0001524123,0.00003198226,0.0001363176,0.0003800839,0.00003959276],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.000683618,0.0002746003,0.003339904,0.0003002959,0.0001878111,0.0004764792,0.0004298055,0.4277598,0.03116797,0.04542587,0.03927669,0.4506771],"study_design_scores_gemma":[0.00005577177,0.00002972229,0.0003278198,0.000008365091,0.00001002969,0.00006618704,0.00003219279,0.9774306,0.007056663,0.005985863,0.008982384,0.00001437527],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03715222,0.000314377,0.9297351,0.000273084,0.0001664596,0.0001007608,0.0005076502,0.01101492,0.02073547],"genre_scores_gemma":[0.224637,0.000238803,0.7632648,0.0001158129,0.00004179438,0.0003074338,0.001066082,0.0009885379,0.009339651],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0109233,"threshold_uncertainty_score":0.03654206,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1966241066","doi":"10.1089/cmb.2007.r002","title":"Bayesian Inference of MicroRNA Targets from Sequence and Expression Data","year":2007,"lang":"en","type":"review","venue":"Journal of Computational Biology","topic":"MicroRNA in disease regulation","field":"Biochemistry, Genetics and Molecular Biology","cited_by":118,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"microRNA; Biology; Computational biology; Robustness (evolution); Inference; Gene; DNA microarray; Gene expression profiling; Gene expression; Bayesian probability; Regulation of gene expression; Bioinformatics; Artificial intelligence; Computer science; Genetics","authors":[{"name":"Jim Huang","is_ca":true},{"name":"Quaid Morris","is_ca":true},{"name":"Brendan J. Frey","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07661162696924576,"gpt":0.3947066090749922,"spread":0.3180949821057464,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001691079,0.0008424452,0.001307257,0.00113903,0.0001134643,0.0009629366,0.001829133,0.001451678,0.0006493401],"category_scores_gemma":[0.003319577,0.0006976673,0.000658346,0.001284875,0.0008175229,0.001179293,0.0005688019,0.001276091,0.0008245203],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009374803,"about_ca_system_score_gemma":0.0006937443,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001705932,"about_ca_topic_score_gemma":0.001206444,"domain_scores_codex":[0.999529,0.0001763863,0.00002594355,0.0001009316,0.0001491208,0.00001856489],"domain_scores_gemma":[0.9990634,0.0006834794,0.00006222937,0.0000390239,0.0001316539,0.00002017012],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001188847,0.00004906957,0.001282106,0.00318491,0.0003394154,0.0002254221,0.00006280687,0.1434935,0.005322111,0.03353601,0.008943429,0.8034424],"study_design_scores_gemma":[0.0001094438,0.0001716058,0.004715331,0.00175818,0.0004077496,0.001457904,0.00006599935,0.5662927,0.01144558,0.1781192,0.2351918,0.0002645879],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.005031026,0.5130578,0.4746597,0.001837478,0.0003352193,0.00003229168,0.0002726864,0.0004730105,0.004300901],"genre_scores_gemma":[0.0901852,0.7815323,0.1225238,0.0005900445,0.0007361533,0.0001389178,0.0009026587,0.0001711994,0.003219778],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.001829133,"threshold_uncertainty_score":0.008943379,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4205330988","doi":"10.1089/cmb.2021.0290","title":"MONI: A Pangenomic Index for Finding Maximal Exact Matches","year":2022,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":90,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"National Institute of Allergy and Infectious Diseases; National Human Genome Research Institute","keywords":"Parsing; Computer science; Index (typography); Trie; Prefix; Matching (statistics); Pattern matching; Algorithm; Sequence (biology); Tree (set theory); Theoretical computer science; Mathematics; Data structure; Artificial intelligence; Combinatorics; Statistics; Biology","authors":[{"name":"Massimiliano Rossi","is_ca":false},{"name":"Marco Antônio Oliva","is_ca":false},{"name":"Ben Langmead","is_ca":false},{"name":"Travis Gagie","is_ca":true},{"name":"Christina Boucher","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02062048482590375,"gpt":0.2744811594893764,"spread":0.2538606746634727,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00228757,0.001511996,0.001750136,0.007108702,0.00182512,0.003255718,0.003143581,0.001540591,0.01388434],"category_scores_gemma":[0.009245951,0.001180166,0.001486507,0.007644536,0.000942898,0.006970549,0.004433132,0.001708645,0.007864751],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001680435,"about_ca_system_score_gemma":0.002758733,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003466302,"about_ca_topic_score_gemma":0.004945604,"domain_scores_codex":[0.9980336,0.000261658,0.0002629661,0.0006536056,0.0006091807,0.0001790689],"domain_scores_gemma":[0.9969311,0.0008616473,0.0003281097,0.001140329,0.0005407315,0.0001980498],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002060927,0.0002419047,0.008193855,0.001682697,0.0003639311,0.0005611856,0.0008286829,0.0101127,0.04807037,0.0659872,0.143319,0.7185774],"study_design_scores_gemma":[0.0004845278,0.0004528808,0.0053921,0.0003917159,0.0003596171,0.00214509,0.0005444182,0.2828824,0.08756409,0.1809408,0.4384617,0.0003808372],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02734531,0.004326907,0.8181106,0.001041555,0.000574892,0.0005875892,0.03108958,0.09839302,0.0185306],"genre_scores_gemma":[0.06022719,0.001071302,0.8838493,0.0004816308,0.000152034,0.0006004547,0.04260216,0.005031294,0.005984667],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01388434,"threshold_uncertainty_score":0.04644775,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1978802080","doi":"10.1089/cmb.2007.0229","title":"Computing Knock-Out Strategies in Metabolic Networks","year":2008,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Microbial Metabolic Engineering and Bioproduction","field":"Biochemistry, Genetics and Molecular Biology","cited_by":81,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"Simon Fraser University","keywords":"Computation; Computer science; Block (permutation group theory); Computational complexity theory; Metabolic network; Algorithm; Theoretical computer science; Mathematics; Computational biology; Biology; Combinatorics","authors":[{"name":"Utz‐Uwe Haus","is_ca":false},{"name":"Steffen Klamt","is_ca":false},{"name":"Tamon Stephen","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01034546835111357,"gpt":0.2563395280575266,"spread":0.245994059706413,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008691421,0.001112555,0.0009888762,0.000778212,0.0004659276,0.001206792,0.001218272,0.0009076907,0.002128013],"category_scores_gemma":[0.005130931,0.0006836323,0.0007528834,0.0003926103,0.001140394,0.001960139,0.001188386,0.00101034,0.0002998515],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00138515,"about_ca_system_score_gemma":0.001041448,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002750223,"about_ca_topic_score_gemma":0.00399873,"domain_scores_codex":[0.9995676,0.0001319205,0.00003161274,0.0001028049,0.00008304711,0.00008306184],"domain_scores_gemma":[0.9978618,0.00161148,0.0001221212,0.0001723996,0.0001214324,0.000110659],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001668707,0.00004458171,0.0007393528,0.00006540244,0.00002534222,0.00007775907,0.00004687346,0.9570078,0.005983224,0.02342859,0.0002647501,0.01214939],"study_design_scores_gemma":[0.00002443897,0.00002661616,0.0000915109,0.000004906503,0.00001098376,0.00001014195,0.00001311198,0.9595568,0.003642429,0.03640953,0.0002022393,0.000007267798],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.410721,0.000176777,0.5819499,0.0002141463,0.00002292476,0.00008957193,0.0004647358,0.001786982,0.004573971],"genre_scores_gemma":[0.8487899,0.0001525441,0.148683,0.00007149824,0.000008091531,0.0001520616,0.000625978,0.0001946889,0.001322189],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.002750223,"threshold_uncertainty_score":0.01005006,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2007492229","doi":"10.1089/106652704773416966","title":"From a Phylogenetic Tree to a Reticulated Network","year":2004,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":79,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Reticulate; Reticulate evolution; Phylogenetic tree; Phylogenetic network; Biology; Phylogenetics; Evolutionary biology; Tree (set theory); Most recent common ancestor; Ancestor; Paleontology; Genetics; Gene; Combinatorics; Mathematics; Geography","authors":[{"name":"Vladimir Makarenkov","is_ca":true},{"name":"Pierre Legendre","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.009135419365097668,"gpt":0.2517320367021659,"spread":0.2425966173370682,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001952057,0.0006021661,0.0006457862,0.002158619,0.001120741,0.002194717,0.001684259,0.00115476,0.004364779],"category_scores_gemma":[0.01338471,0.0009022119,0.0008054191,0.001568682,0.001727848,0.005710768,0.002138241,0.001626624,0.001445637],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001305249,"about_ca_system_score_gemma":0.0007002552,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001677698,"about_ca_topic_score_gemma":0.001905444,"domain_scores_codex":[0.998811,0.0005940492,0.00005473078,0.0003246122,0.0001638039,0.00005178679],"domain_scores_gemma":[0.9960731,0.002528335,0.0003031139,0.0006198661,0.0003197328,0.0001557764],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002188049,0.00005584778,0.003962649,0.0007109846,0.0001777822,0.0006774119,0.002269109,0.3501041,0.01226565,0.4256738,0.007041648,0.1968422],"study_design_scores_gemma":[0.00001736265,0.0000386488,0.0006628598,0.000072433,0.00003470326,0.0002891631,0.0001547984,0.521614,0.001763626,0.4608458,0.01447851,0.00002811047],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01947035,0.0003969102,0.9770015,0.0003590136,0.00002921763,0.0000454343,0.0003061931,0.0007189086,0.001672508],"genre_scores_gemma":[0.1554237,0.0008477507,0.8404355,0.0001778754,0.00004390535,0.000136511,0.001116136,0.0004373599,0.001381297],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004364779,"threshold_uncertainty_score":0.01460165,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2058730888","doi":"10.1089/cmb.2010.0184","title":"Gene Prediction Based on DNA Spectral Analysis: A Literature Review","year":2011,"lang":"en","type":"review","venue":"Journal of Computational Biology","topic":"Fractal and DNA sequence analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":77,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Guelph","funders":"","keywords":"ENCODE; Digital signal processing; Genetic code; Computational biology; Computer science; DNA; Coding (social sciences); Biology; Gene; Genetics; Mathematics","authors":[{"name":"Sajid A. Marhon","is_ca":true},{"name":"Stefan C. Kremer","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01866156464907689,"gpt":0.3082749050703346,"spread":0.2896133404212577,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007351671,0.0009100726,0.001403962,0.004237599,0.0003030604,0.001028929,0.001265305,0.000933848,0.002991112],"category_scores_gemma":[0.001583691,0.0004397069,0.0006580016,0.005211017,0.0004497457,0.001453055,0.0005331152,0.0008703322,0.002324422],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005580891,"about_ca_system_score_gemma":0.001155608,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002128549,"about_ca_topic_score_gemma":0.001640135,"domain_scores_codex":[0.999763,0.00003251275,0.00003426579,0.00007131156,0.00008480992,0.00001408007],"domain_scores_gemma":[0.9989552,0.0006176518,0.00006828901,0.000029083,0.000296862,0.00003292917],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00004402116,0.00005296028,0.0004657077,0.009504401,0.00008720689,0.0001910672,0.00005463954,0.001464992,0.001345183,0.002820427,0.01345238,0.970517],"study_design_scores_gemma":[0.00002455652,0.000159726,0.002869515,0.01072299,0.0005066483,0.003415198,0.0002080694,0.003531883,0.005145879,0.009530232,0.9637576,0.0001276722],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0005691129,0.991426,0.005220941,0.0003266874,0.0002137104,0.00001302584,0.00008800449,0.00005227981,0.002090337],"genre_scores_gemma":[0.002860385,0.9906737,0.005047123,0.0001422188,0.0002444618,0.00001761974,0.0001757481,0.00001252351,0.0008263025],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.004237599,"threshold_uncertainty_score":0.01000625,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2122316710","doi":"10.1089/cmb.2014.0160","title":"On the Representation of De Bruijn Graphs","year":2015,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":77,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ontario Institute for Cancer Research; Canada's Michael Smith Genome Sciences Centre","funders":"Division of Biological Infrastructure","keywords":"De Bruijn sequence; De Bruijn graph; Bottleneck; Computer science; Theoretical computer science; Data structure; Graph; Representation (politics); Mathematics; Discrete mathematics; Programming language","authors":[{"name":"Rayan Chikhi","is_ca":false},{"name":"Antoine Limasset","is_ca":false},{"name":"Shaun D. Jackman","is_ca":true},{"name":"Jared T. Simpson","is_ca":true},{"name":"Paul Medvedev","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03073178202377309,"gpt":0.3002495380754645,"spread":0.2695177560516914,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009432341,0.0008791119,0.0006736317,0.002487217,0.0008401093,0.002297185,0.001168745,0.0009859415,0.003734269],"category_scores_gemma":[0.006982544,0.0005377582,0.0008793225,0.002937935,0.001298108,0.003304195,0.001264103,0.001457536,0.001583172],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008041192,"about_ca_system_score_gemma":0.0007402118,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001865819,"about_ca_topic_score_gemma":0.002327188,"domain_scores_codex":[0.998949,0.0003208309,0.0001278104,0.0002159172,0.0002847225,0.0001017226],"domain_scores_gemma":[0.9970161,0.001538978,0.0003184481,0.0006087209,0.0004445967,0.00007325011],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000157531,0.00009355326,0.0009506757,0.0003687014,0.00002932349,0.0002071229,0.000535337,0.1489503,0.01495077,0.6635433,0.00689806,0.1633153],"study_design_scores_gemma":[0.0000244214,0.00006144917,0.0002962565,0.0001041942,0.00001738291,0.0002499359,0.0001187207,0.3556449,0.007587302,0.6124699,0.023386,0.00003963116],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.0184931,0.0002728078,0.9738689,0.000254584,0.00005004906,0.00005509725,0.0007044846,0.001021255,0.005279769],"genre_scores_gemma":[0.1486632,0.0006146152,0.8426611,0.0001982594,0.00009215048,0.0002579693,0.002506579,0.0008129886,0.004193176],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003734269,"threshold_uncertainty_score":0.01249236,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2022846158","doi":"10.1089/10665270360688129","title":"Tests for Gene Clustering","year":2003,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":77,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"National Human Genome Research Institute","keywords":"Genome; Biology; Gene; Gene duplication; Comparative genomics; Horizontal gene transfer; Gene cluster; Genetics; Genomics; Evolutionary biology; Gene family; Computational biology; Genome evolution","authors":[{"name":"Dannie Durand","is_ca":false},{"name":"David Sankoff","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0198886956447467,"gpt":0.2979448129065418,"spread":0.2780561172617951,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03383406,0.001744465,0.002442666,0.00726632,0.003316417,0.004318326,0.005739363,0.004578411,0.007416221],"category_scores_gemma":[0.2457811,0.0006812772,0.003622768,0.007370237,0.008626021,0.004908002,0.004011575,0.004191911,0.0008197547],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001693381,"about_ca_system_score_gemma":0.002301031,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001240752,"about_ca_topic_score_gemma":0.0008429813,"domain_scores_codex":[0.940412,0.03446022,0.003095836,0.01094852,0.00841237,0.002671038],"domain_scores_gemma":[0.5703571,0.3910472,0.0097966,0.01788664,0.007436914,0.003475584],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.008357933,0.0009364958,0.5465459,0.001546138,0.008163648,0.001477544,0.001847849,0.1534431,0.009955445,0.08027362,0.009327758,0.1781245],"study_design_scores_gemma":[0.0009061079,0.002297132,0.1505283,0.0002180458,0.001314615,0.002279366,0.00247662,0.6406392,0.01399323,0.1776644,0.007464046,0.000218955],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"methods","genre_scores_codex":[0.7126497,0.00121349,0.2680813,0.002042044,0.0003203617,0.00051832,0.003201205,0.002036274,0.009937338],"genre_scores_gemma":[0.9455726,0.0000733995,0.0500828,0.0002586567,0.0001044323,0.00032158,0.002897199,0.0002332524,0.0004560574],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.03383406,"threshold_uncertainty_score":0.1789337,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2068396445","doi":"10.1089/cmb.2006.13.567","title":"On Sorting by Translocations","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":61,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Sorting; Chromosomal translocation; Sorting algorithm; Genome; Chromosome; Computer science; Algorithm; Computational biology; Biology; Mathematics; Genetics; Gene","authors":[{"name":"Anne Bergeron","is_ca":true},{"name":"Julia Mixtacki","is_ca":false},{"name":"Jens Stoye","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005620043957935987,"gpt":0.250474535487991,"spread":0.244854491530055,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002881999,0.001087807,0.001486192,0.001911395,0.002383359,0.003039651,0.002076319,0.002303632,0.01198689],"category_scores_gemma":[0.01604993,0.0006181882,0.001720735,0.00501953,0.005589408,0.01277925,0.005074668,0.003919002,0.002884117],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002255094,"about_ca_system_score_gemma":0.00170433,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003100907,"about_ca_topic_score_gemma":0.00233034,"domain_scores_codex":[0.9969837,0.0008428889,0.0002137017,0.0006913715,0.0008589983,0.0004092496],"domain_scores_gemma":[0.9943252,0.003892574,0.0002837018,0.0007715434,0.0005513089,0.0001756519],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001970349,0.00004933649,0.0004631003,0.0002572841,0.0000205126,0.00012384,0.0003180363,0.03761264,0.003122383,0.8282742,0.007769436,0.1217921],"study_design_scores_gemma":[0.00005906422,0.0000421401,0.0001229468,0.00004771394,0.0000143181,0.0001319008,0.00007467029,0.04678765,0.002300035,0.9297373,0.02065671,0.00002556053],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03402188,0.003275185,0.9318326,0.003668862,0.00068409,0.0001371637,0.0002873009,0.001449092,0.02464392],"genre_scores_gemma":[0.32214,0.00942413,0.629141,0.003230433,0.001181247,0.0003582547,0.001571633,0.0016005,0.03135286],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01198689,"threshold_uncertainty_score":0.0401001,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2034206612","doi":"10.1089/cmb.2008.0054","title":"Gene Family Evolution by Duplication, Speciation, and Loss","year":2008,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":60,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Computer Research Institute of Montréal; Université de Montréal; Simon Fraser University; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Simon Fraser University","keywords":"Gene duplication; Genetic algorithm; Gene family; Biology; Tree rearrangement; Gene; Heuristic; Tree (set theory); Evolutionary biology; Phylogenetics; Computational biology; Genetics; Computer science; Mathematics; Genome; Combinatorics; Artificial intelligence","authors":[{"name":"Cédric Chauve","is_ca":true},{"name":"Jean‐Philippe Doyon","is_ca":true},{"name":"Nadia El-Mabrouk","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.008717990535582093,"gpt":0.2306207468131898,"spread":0.2219027562776077,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003906649,0.0004310251,0.001201861,0.001499162,0.001173994,0.001403537,0.00177311,0.001402631,0.001779845],"category_scores_gemma":[0.01895287,0.000599481,0.001276833,0.002285021,0.00228761,0.004839807,0.001433538,0.001534703,0.000215499],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001410009,"about_ca_system_score_gemma":0.0006010953,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001589859,"about_ca_topic_score_gemma":0.002562963,"domain_scores_codex":[0.9987057,0.0004267357,0.00009030248,0.000497676,0.0001774862,0.0001020311],"domain_scores_gemma":[0.9883136,0.008722304,0.001395493,0.0009661168,0.0002839874,0.0003184903],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001254307,0.0002505176,0.2076209,0.0007666069,0.0003869343,0.0009952011,0.00182197,0.5245085,0.0147862,0.1149006,0.004726722,0.1279816],"study_design_scores_gemma":[0.0001440421,0.0001331621,0.01865213,0.0000416492,0.0001053698,0.001535994,0.0003939506,0.7591922,0.00368999,0.2125451,0.003521272,0.00004510392],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8444986,0.0009201063,0.1512087,0.001073905,0.00001826582,0.00006871927,0.000510585,0.0001937676,0.00150744],"genre_scores_gemma":[0.906404,0.0003857311,0.09111402,0.0001688559,0.00003403757,0.00008685666,0.000896989,0.00008660124,0.0008229534],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.003906649,"threshold_uncertainty_score":0.02066058,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2045430208","doi":"10.1089/106652701752236232","title":"Unfolding of Microarray Data","year":2001,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":56,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto; Ontario Institute for Cancer Research","funders":"","keywords":"Microarray databases; DNA microarray; Microarray analysis techniques; Microarray; Robustness (evolution); Outlier; Computer science; Data mining; Gene chip analysis; Inference; Computational biology; Biology; Artificial intelligence; Genetics; Gene expression; Gene","authors":[{"name":"Andrew B. Goryachev","is_ca":true},{"name":"Pascale F Macgregor","is_ca":true},{"name":"A.M. Edwards","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03968641451553621,"gpt":0.3339513396237907,"spread":0.2942649251082545,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007103371,0.001325799,0.00153703,0.001938775,0.0008139372,0.001960106,0.001362362,0.0009184736,0.001786207],"category_scores_gemma":[0.0329094,0.000828655,0.002070666,0.002474214,0.001002124,0.00180622,0.002066136,0.002463769,0.00160029],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001066838,"about_ca_system_score_gemma":0.00114191,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009539294,"about_ca_topic_score_gemma":0.0007677488,"domain_scores_codex":[0.9929284,0.003063073,0.0004082144,0.001388347,0.001934737,0.0002772245],"domain_scores_gemma":[0.9850462,0.008044217,0.0008339071,0.004369806,0.001478043,0.0002277376],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006998148,0.0002271492,0.009791202,0.000961265,0.0004823586,0.0004622742,0.0007741927,0.4567795,0.1460541,0.04641671,0.007941857,0.3294096],"study_design_scores_gemma":[0.00002393609,0.0001842666,0.004791132,0.00003630197,0.00004717776,0.0002673203,0.0001532293,0.8599372,0.03008909,0.09226058,0.01213259,0.00007722892],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.011284,0.0001778217,0.9853926,0.0002117115,0.00005219025,0.0001119764,0.001087466,0.001346493,0.0003356402],"genre_scores_gemma":[0.1602102,0.0008370972,0.82863,0.0003433542,0.0001720556,0.0006940061,0.007585119,0.0006468642,0.0008811421],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007103371,"threshold_uncertainty_score":0.03756666,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2003921372","doi":"10.1089/cmb.2005.12.812","title":"Chromosomal Breakpoint Reuse in Genome Sequence Rearrangement","year":2005,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":53,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Carleton University; University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canadian Institute for Advanced Research","keywords":"Breakpoint; Genome; Biology; Computational biology; Sequence (biology); Genetics; Identification (biology); Gene; Reuse; Computer science; Chromosome","authors":[{"name":"David Sankoff","is_ca":true},{"name":"Phil Trinh","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01606047862208839,"gpt":0.2841884439062238,"spread":0.2681279652841354,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01204872,0.0003324616,0.0009575534,0.001895251,0.000664956,0.001515392,0.001406722,0.001265611,0.0009499282],"category_scores_gemma":[0.08644886,0.0005198504,0.0007985168,0.001808678,0.002364228,0.003118256,0.003026743,0.001073283,0.0002126979],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00129684,"about_ca_system_score_gemma":0.001054656,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001783251,"about_ca_topic_score_gemma":0.00203846,"domain_scores_codex":[0.9938155,0.003305222,0.0003505233,0.0009186983,0.001281581,0.0003283197],"domain_scores_gemma":[0.9309328,0.05494777,0.00476557,0.006950233,0.001865397,0.0005383703],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009618098,0.0001198765,0.0691807,0.0002552484,0.0003098497,0.0003188395,0.001283073,0.6403276,0.01415548,0.1380577,0.0004778342,0.1345519],"study_design_scores_gemma":[0.0000681734,0.0001732384,0.006828503,0.00004468048,0.00007447339,0.00038689,0.0001240794,0.86805,0.01259139,0.1099534,0.001648785,0.00005626465],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5002304,0.0006078393,0.4970161,0.0002615924,0.00001541256,0.00006720014,0.00005286721,0.0004540985,0.001294521],"genre_scores_gemma":[0.9128792,0.0002766566,0.0858002,0.00008455046,0.00001904541,0.00008932216,0.0001455901,0.0001345937,0.0005709043],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01204872,"threshold_uncertainty_score":0.06372046,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2127421473","doi":"10.1089/cmb.2013.0042","title":"IDBA-MT: <i>De Novo</i> Assembler for Metatranscriptomic Data Generated from Next-Generation Sequencing Technology","year":2013,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":50,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Amgen (Canada); University of Toronto","funders":"","keywords":"Contig; Sequence assembly; Computational biology; DNA sequencing; Genome; Biology; Computer science; Transcriptome; Genetics; Gene","authors":[{"name":"Henry C. M. Leung","is_ca":false},{"name":"Siu‐Ming Yiu","is_ca":false},{"name":"John Parkinson","is_ca":true},{"name":"Francis Y. L. Chin","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08796824590738316,"gpt":0.2947364766319145,"spread":0.2067682307245314,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001547534,0.002049431,0.001667897,0.001451576,0.00116414,0.001856523,0.001843476,0.001104266,0.004750251],"category_scores_gemma":[0.002796549,0.001408573,0.001677065,0.001233672,0.0004870479,0.001024778,0.001281648,0.003415703,0.006707865],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000789495,"about_ca_system_score_gemma":0.001101203,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001048799,"about_ca_topic_score_gemma":0.001534667,"domain_scores_codex":[0.9985967,0.0003253175,0.000195113,0.0003239133,0.0004462256,0.0001127185],"domain_scores_gemma":[0.9988886,0.0002794786,0.0002283177,0.0002640827,0.0002355219,0.0001040954],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.0007211228,0.0001789475,0.001736555,0.00165475,0.0003125454,0.0005361338,0.000473605,0.004565328,0.8331181,0.006232676,0.02893019,0.12154],"study_design_scores_gemma":[0.0001080656,0.0002917644,0.001586423,0.0001244288,0.0001531671,0.001142405,0.00009232249,0.05515642,0.7156461,0.002975062,0.2225261,0.0001977149],"study_design_candidate":"bench_or_experimental","study_design_consensus":"bench_or_experimental","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0175131,0.001671269,0.910246,0.0002935627,0.0004606136,0.0004137363,0.00437802,0.06102423,0.003999357],"genre_scores_gemma":[0.03820569,0.00108409,0.9322991,0.0003145333,0.00007142976,0.0007082705,0.01557274,0.006922105,0.004822016],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004750251,"threshold_uncertainty_score":0.01589119,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2021281986","doi":"10.1089/cmb.2006.13.1419","title":"Approximating Subtree Distances Between Phylogenies","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Algorithms and Data Compression","field":"Computer Science","cited_by":50,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"University of British Columbia; Graduate Center; National Science Foundation","keywords":"Tree (set theory); Approximation algorithm; Algorithm; Type (biology); Scheme (mathematics); Computer science; Mathematics; Combinatorics; Biology","authors":[{"name":"Marı́a Luisa Bonet","is_ca":false},{"name":"Katherine St. John","is_ca":false},{"name":"Ruchi Mahindru","is_ca":false},{"name":"Nina Amenta","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0120957413160893,"gpt":0.2592623049771438,"spread":0.2471665636610545,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001259265,0.0007750383,0.0009736518,0.001914881,0.0006198546,0.001330744,0.002149913,0.001351477,0.002432283],"category_scores_gemma":[0.01311992,0.0005250701,0.0009789319,0.00256033,0.0008624804,0.002278751,0.002373965,0.002249061,0.001069031],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001079656,"about_ca_system_score_gemma":0.001001371,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001963323,"about_ca_topic_score_gemma":0.002551133,"domain_scores_codex":[0.9984659,0.0003037751,0.0001207059,0.0003263683,0.000621169,0.0001620651],"domain_scores_gemma":[0.9962139,0.002031348,0.0003031254,0.0008933652,0.000425265,0.0001331127],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004923627,0.0001367903,0.003696261,0.0003023167,0.0001264816,0.0002487242,0.0004779927,0.4205751,0.009772863,0.08399488,0.006223893,0.4739522],"study_design_scores_gemma":[0.0000465816,0.00008995929,0.000620036,0.00002871348,0.00003027145,0.0002817558,0.00007476959,0.9056756,0.005066555,0.08370345,0.004360647,0.00002156922],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04884058,0.0006321667,0.947094,0.0002511978,0.00007990082,0.0000497536,0.0002455043,0.0009832381,0.001823782],"genre_scores_gemma":[0.228845,0.0004687787,0.7669641,0.0001180798,0.000060471,0.0001178673,0.001296466,0.0002561044,0.001873188],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002432283,"threshold_uncertainty_score":0.008136809,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2977115588","doi":"10.1089/cmb.2019.0237","title":"Analysis of Gene Expression in Bladder Cancer: Possible Involvement of Mitosis and Complement and Coagulation Cascades Signaling Pathway","year":2019,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Ferroptosis and cancer prognosis","field":"Medicine","cited_by":48,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ministry of Agriculture","funders":"","keywords":"microRNA; Biology; Microarray analysis techniques; Gene; Cell cycle; Transcription factor; Gene regulatory network; Downregulation and upregulation; Cancer research; Cell biology; Gene expression; Computational biology; Genetics","authors":[{"name":"Ying Liu","is_ca":true},{"name":"Shenghua Xiong","is_ca":false},{"name":"Shiying Liu","is_ca":false},{"name":"Jie Chen","is_ca":false},{"name":"Hao Yang","is_ca":false},{"name":"Gang Liu","is_ca":false},{"name":"Gengmi Li","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02944806252690458,"gpt":0.3143439019859041,"spread":0.2848958394589995,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0001582627,0.0002647011,0.000367517,0.00107731,0.0002849504,0.0003166654,0.00009886186,0.0001759563,0.0008663508],"category_scores_gemma":[0.000191852,0.0001005723,0.0003949947,0.001697099,0.0001201982,0.000171984,0.0002415492,0.0002060251,0.0001351011],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002901141,"about_ca_system_score_gemma":0.0003280271,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001275205,"about_ca_topic_score_gemma":0.00170589,"domain_scores_codex":[0.9998403,0.00001585408,0.00001152919,0.00005392385,0.00003744655,0.00004093876],"domain_scores_gemma":[0.9999093,0.0000169646,0.0000325653,0.000004629537,0.00001974426,0.0000167642],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","study_design_scores_codex":[0.001198257,0.0001037914,0.232828,0.001428328,0.0003762167,0.0007104854,0.0003251803,0.001277346,0.7096083,0.0005261035,0.001372972,0.05024505],"study_design_scores_gemma":[0.00002624036,0.000293723,0.9187287,0.00006091089,0.0004575433,0.001165106,0.0003373338,0.006103443,0.06556763,0.0005946563,0.006636734,0.00002786604],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9840979,0.007751535,0.002571612,0.0001272393,0.00002502901,0.0000360446,0.00388596,0.00007743817,0.001427356],"genre_scores_gemma":[0.9883566,0.002573055,0.003932779,0.0001093418,0.00001541787,0.00006961812,0.003818737,0.000012614,0.001111736],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001275205,"threshold_uncertainty_score":0.002898216,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1992306462","doi":"10.1089/cmb.2008.21tt","title":"How to Synchronize Biological Clocks","year":2009,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Gene Regulatory Network Analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":47,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Institute of Genetics; European Commission","keywords":"Biological clock; Construct (python library); Computer science; Biological network; Synchronization (alternating current); Set (abstract data type); Distributed computing; Theoretical computer science; Computer network; Biology; Computational biology; Programming language; Neuroscience","authors":[{"name":"Giovanni Russo","is_ca":false},{"name":"Mario di Bernardo","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01107651730193498,"gpt":0.2620000061672376,"spread":0.2509234888653026,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001547868,0.0004013073,0.0005687792,0.0004553114,0.0005773875,0.001080207,0.001153676,0.0009200909,0.003193887],"category_scores_gemma":[0.00769256,0.0003635916,0.0004158157,0.0003350823,0.001136395,0.002834354,0.001433073,0.0008190548,0.000628036],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004766451,"about_ca_system_score_gemma":0.0007631705,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009882993,"about_ca_topic_score_gemma":0.0005553346,"domain_scores_codex":[0.9993382,0.0002615981,0.0000328421,0.0002001492,0.0001158379,0.00005134643],"domain_scores_gemma":[0.9984546,0.0009506647,0.0001400031,0.0001885907,0.0001872145,0.00007893424],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002902633,0.00004015626,0.002054352,0.0001804812,0.00006383083,0.0001251183,0.0004462275,0.4016765,0.01286178,0.4656467,0.001939019,0.1146757],"study_design_scores_gemma":[0.00008748542,0.00006923564,0.000170593,0.00003242565,0.00002035025,0.00007179607,0.00008646741,0.8196212,0.00546828,0.1656649,0.008687566,0.00001972303],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03801688,0.000153074,0.9580234,0.0003108409,0.00007344774,0.00004631964,0.00003165903,0.0002100749,0.00313438],"genre_scores_gemma":[0.4661127,0.0003432984,0.5292081,0.0001512216,0.00006473118,0.000233854,0.0001573581,0.0002296055,0.003499118],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.003193887,"threshold_uncertainty_score":0.01068461,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2051551591","doi":"10.1089/cmb.2006.13.1340","title":"On the Similarity of Sets of Permutations and Its Applications to Genome Comparison","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":47,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Genome; Chaining; Similarity (geometry); Generalization; Key (lock); Feature (linguistics); Computer science; Combinatorics; Mathematics; Computational biology; Theoretical computer science; Biology; Gene; Genetics; Artificial intelligence","authors":[{"name":"Anne Bergeron","is_ca":true},{"name":"Jens Stoye","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01775467834541102,"gpt":0.3016380343992673,"spread":0.2838833560538563,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003152899,0.0005350556,0.001279316,0.006269249,0.001620211,0.002904947,0.001861751,0.001616184,0.003810564],"category_scores_gemma":[0.03495293,0.0004852444,0.001077591,0.009557774,0.004203988,0.00798796,0.004378229,0.002193735,0.0005436593],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001244163,"about_ca_system_score_gemma":0.0006501448,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001345099,"about_ca_topic_score_gemma":0.0007527321,"domain_scores_codex":[0.9956757,0.001870584,0.0003483229,0.0009259707,0.001025692,0.0001536656],"domain_scores_gemma":[0.9809017,0.01472831,0.001215195,0.001793508,0.0009824448,0.0003789449],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001548637,0.00006991206,0.002922855,0.0001971792,0.00006380997,0.0001714947,0.0007156728,0.04193996,0.002862389,0.776279,0.00149049,0.1731324],"study_design_scores_gemma":[0.00001774438,0.00007028441,0.0009507164,0.00005493743,0.00002150093,0.0003289049,0.0001619641,0.09038201,0.001373487,0.9012882,0.005318718,0.00003166505],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.05538298,0.001660963,0.9316987,0.0007789861,0.0001079724,0.00009956848,0.0002462671,0.0003939028,0.00963071],"genre_scores_gemma":[0.4659614,0.001726692,0.528211,0.000358215,0.0003707143,0.000264888,0.0007232629,0.0002422033,0.002141637],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006269249,"threshold_uncertainty_score":0.01667428,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2050243856","doi":"10.1089/cmb.2009.0095","title":"Space of Gene/Species Trees Reconciliations and Parsimonious Models","year":2009,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":43,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Simon Fraser University","keywords":"Tree (set theory); Space (punctuation); Computer science; Mutation; Gene duplication; Family tree; Mathematics; Gene; Combinatorics; Biology; Genetics","authors":[{"name":"Jean‐Philippe Doyon","is_ca":false},{"name":"Cédric Chauve","is_ca":true},{"name":"Sylvie Hamel","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01963970999811997,"gpt":0.2529601758186593,"spread":0.2333204658205393,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00502828,0.001012376,0.001902408,0.003778622,0.00180899,0.003880495,0.003836044,0.002975031,0.006504023],"category_scores_gemma":[0.02783493,0.001012013,0.002050721,0.00391042,0.002691938,0.006046636,0.003238784,0.002514898,0.0008555643],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002232726,"about_ca_system_score_gemma":0.001441108,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001224612,"about_ca_topic_score_gemma":0.001377853,"domain_scores_codex":[0.9962249,0.002259686,0.0001769791,0.0005343048,0.0005642694,0.0002399357],"domain_scores_gemma":[0.9827422,0.01341989,0.001108192,0.00169624,0.0005262159,0.0005072363],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003575816,0.00008251456,0.001402627,0.0002000328,0.000104531,0.0001881439,0.0003343877,0.7852629,0.0006233747,0.1730948,0.003029082,0.03531998],"study_design_scores_gemma":[0.00004517491,0.00003407618,0.0001917368,0.00002155019,0.00002103681,0.00008535493,0.00005139842,0.71399,0.0003592408,0.2839296,0.001250344,0.00002048587],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1951281,0.002217755,0.7874382,0.002176081,0.00006722903,0.0001777764,0.001826371,0.001863814,0.009104666],"genre_scores_gemma":[0.6919405,0.0008182665,0.2996306,0.0003493127,0.0001322255,0.0003744863,0.003049728,0.0005834512,0.003121536],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006504023,"threshold_uncertainty_score":0.02659237,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2083479074","doi":"10.1089/cmb.2008.0219","title":"An <i>O</i> ( <i>n</i> <sup>5</sup> ) Algorithm for MFE Prediction of Kissing Hairpins and 4-Chains in Nucleic Acids","year":2009,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"RNA and protein synthesis mechanisms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":43,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Nucleic acid; Algorithm; Function (biology); Computer science; Nucleic acid secondary structure; Nucleic acid structure; Class (philosophy); Protein secondary structure; RNA; Computational biology; Mathematics; Biology; Artificial intelligence; Genetics; Biochemistry","authors":[{"name":"Ho-Lin Chen","is_ca":false},{"name":"Anne Condon","is_ca":true},{"name":"Hosna Jabbari","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01055262268037657,"gpt":0.261910987315347,"spread":0.2513583646349705,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001610922,0.001652303,0.0010832,0.001366874,0.00113714,0.001289129,0.002495664,0.00218702,0.01334236],"category_scores_gemma":[0.004687728,0.0008681415,0.001422115,0.001549684,0.0008740995,0.002703509,0.002250093,0.002024351,0.004102372],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000868227,"about_ca_system_score_gemma":0.001640576,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002540478,"about_ca_topic_score_gemma":0.005124597,"domain_scores_codex":[0.999285,0.0001700997,0.00008997737,0.0001651582,0.0002088791,0.00008094632],"domain_scores_gemma":[0.9982755,0.001070006,0.0001372976,0.0002251661,0.0002223276,0.00006968434],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007464906,0.0003344298,0.001699265,0.0004114328,0.0001608441,0.000223451,0.0002188267,0.0991732,0.01190248,0.01515188,0.01999258,0.8499851],"study_design_scores_gemma":[0.000416512,0.0002074114,0.0006497332,0.00005957637,0.00005695996,0.0003010752,0.00007209456,0.9425009,0.01300359,0.02801172,0.01466113,0.00005932452],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005901868,0.0001942992,0.9878757,0.0001681148,0.00006834517,0.0001574683,0.0002335383,0.004183738,0.001216942],"genre_scores_gemma":[0.01700706,0.00007149685,0.9804453,0.00007758637,0.00002810083,0.0002453366,0.0004698925,0.0003798926,0.001275292],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01334236,"threshold_uncertainty_score":0.04463458,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2024827079","doi":"10.1089/cmb.2009.0067","title":"Two Lower Bounds for Self-Assemblies at Temperature 1","year":2010,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Advanced biosensing and bioanalysis techniques","field":"Biochemistry, Genetics and Molecular Biology","cited_by":42,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University; University of British Columbia","funders":"","keywords":"Tile; Square (algebra); Combinatorics; Upper and lower bounds; Domain (mathematical analysis); Mathematics; Discrete mathematics; Computer science; Geometry; Materials science; Mathematical analysis","authors":[{"name":"Ján Maňuch","is_ca":true},{"name":"Ladislav Stacho","is_ca":true},{"name":"Christine Stoll","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005450051418784046,"gpt":0.2983602811779114,"spread":0.2929102297591273,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003290287,0.002687559,0.00200522,0.001804027,0.002009385,0.002900994,0.004554224,0.003658929,0.01106997],"category_scores_gemma":[0.01949054,0.001579446,0.002963309,0.0008430358,0.002944986,0.00789796,0.004294942,0.007647919,0.003767591],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002382326,"about_ca_system_score_gemma":0.0008842874,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0007578846,"about_ca_topic_score_gemma":0.0007390734,"domain_scores_codex":[0.995605,0.000743645,0.0001959366,0.001021755,0.001258306,0.001175345],"domain_scores_gemma":[0.9800335,0.01131548,0.002024071,0.00317544,0.001785153,0.001666405],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001406994,0.0008280859,0.00471415,0.001368501,0.0001887312,0.0007797768,0.0009802064,0.2337445,0.08265153,0.5890588,0.01852252,0.06575621],"study_design_scores_gemma":[0.00009419551,0.0004512095,0.001914625,0.0002196297,0.0001235259,0.0006720848,0.0001525361,0.5254183,0.05510567,0.3997737,0.01590911,0.0001652911],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1188143,0.005627478,0.8099157,0.004860203,0.0009558736,0.000185461,0.0007279397,0.002097252,0.05681581],"genre_scores_gemma":[0.6655108,0.002480323,0.3001432,0.002370653,0.000898365,0.001237339,0.001610823,0.001490536,0.02425793],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01106997,"threshold_uncertainty_score":0.03703266,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2035522779","doi":"10.1089/cmb.2006.13.1289","title":"Wavelet Analysis of DNA Walks","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Fractal and DNA sequence analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":41,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of New Brunswick","funders":"U.S. National Library of Medicine; National Institutes of Health","keywords":"Computational biology; Wavelet; Intron; Biology; Genome; DNA sequencing; Genetics; genomic DNA; Sequence analysis; DNA; Computer science; Gene; Artificial intelligence","authors":[{"name":"Adrian D. Haimovich","is_ca":false},{"name":"Bruce C. Byrne","is_ca":false},{"name":"Ramakrishna Ramaswamy","is_ca":false},{"name":"William J. Welsh","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005689296584836071,"gpt":0.2539969995628238,"spread":0.2483077029779877,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0003312887,0.0002879232,0.0003467314,0.001434328,0.0002825244,0.0007538433,0.0002834571,0.0004475027,0.001953],"category_scores_gemma":[0.002371357,0.0001763697,0.0003857511,0.0007748714,0.0005862156,0.0007424672,0.0005623756,0.0005743125,0.0004155072],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000282654,"about_ca_system_score_gemma":0.0002257151,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004769121,"about_ca_topic_score_gemma":0.0003034431,"domain_scores_codex":[0.9998099,0.00004671966,0.000008637343,0.00003689055,0.00006211032,0.00003578038],"domain_scores_gemma":[0.9993622,0.0002551661,0.0001010178,0.00005573321,0.000146598,0.00007926659],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002601752,0.0000525789,0.002764643,0.0002138157,0.00006269772,0.0005521234,0.0004061786,0.1750345,0.07089527,0.6266892,0.004317749,0.1187511],"study_design_scores_gemma":[0.00001521524,0.00005289704,0.002368093,0.00002470422,0.00001079267,0.0002583739,0.00007893371,0.8163842,0.005172479,0.1703472,0.005258485,0.00002863717],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2011531,0.0007682553,0.7914864,0.0002774774,0.00009601603,0.00003626447,0.0002655616,0.0002665914,0.005650206],"genre_scores_gemma":[0.9017156,0.001164935,0.08774983,0.0001152039,0.0001133594,0.00006471441,0.000644106,0.0001665262,0.00826567],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.001953,"threshold_uncertainty_score":0.006533444,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2081163014","doi":"10.1089/cmb.2008.0003","title":"Linear Time Probabilistic Algorithms for the Singular Haplotype Reconstruction Problem from SNP Fragments","year":2008,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":40,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Regina","funders":"","keywords":"Probabilistic logic; Haplotype; Algorithm; SNP; Probabilistic analysis of algorithms; Computer science; Computational biology; Mathematics; Biology; Genetics; Artificial intelligence; Single-nucleotide polymorphism; Gene; Genotype","authors":[{"name":"Zhixiang Chen","is_ca":false},{"name":"Bin Fu","is_ca":false},{"name":"Robert Schweller","is_ca":false},{"name":"Boting Yang","is_ca":true},{"name":"Zhiyu Zhao","is_ca":false},{"name":"Binhai Zhu","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03132108430340452,"gpt":0.2924202296880671,"spread":0.2610991453846626,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006616051,0.001634022,0.001585607,0.001339631,0.001495804,0.002237112,0.004921025,0.002721041,0.005389036],"category_scores_gemma":[0.02565457,0.001225272,0.001776204,0.001977101,0.002278363,0.004960291,0.00419258,0.003788883,0.001636288],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002401589,"about_ca_system_score_gemma":0.003521355,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003663813,"about_ca_topic_score_gemma":0.004555283,"domain_scores_codex":[0.9955946,0.001653593,0.0002981028,0.001099878,0.0009902023,0.0003636485],"domain_scores_gemma":[0.9747816,0.0205709,0.001191937,0.002099105,0.001013888,0.0003425819],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003539003,0.0001953273,0.001073349,0.0002875014,0.0001001807,0.00009298044,0.0002512051,0.7279651,0.001742905,0.1082101,0.004021367,0.155706],"study_design_scores_gemma":[0.00006489484,0.00003175349,0.000104659,0.00001363032,0.00001347044,0.00006085491,0.00003046571,0.9033703,0.0008409097,0.09450933,0.0009425014,0.00001729896],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.001466935,0.00006386408,0.997669,0.0001178997,0.000008393922,0.00003893507,0.00003008348,0.0003382248,0.0002665966],"genre_scores_gemma":[0.06344099,0.0001740283,0.9342154,0.0001384496,0.00006041027,0.0003967737,0.0004398943,0.0001919983,0.0009420031],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.006616051,"threshold_uncertainty_score":0.03498948,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2369729543","doi":"10.1089/cmb.2010.0092","title":"Yeast Ancestral Genome Reconstructions: The Possibilities of Computational Methods II","year":2010,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":39,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Centre National de la Recherche Scientifique; Agence Nationale de la Recherche","keywords":"Genome; Yeast; Biology; Computational biology; Evolutionary biology; Genetics; Gene","authors":[{"name":"Cédric Chauve","is_ca":true},{"name":"Haris Gavranović","is_ca":false},{"name":"Aïda Ouangraoua","is_ca":false},{"name":"Éric Tannier","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0171202863078199,"gpt":0.3258122984228377,"spread":0.3086920121150178,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01148624,0.000880524,0.001281311,0.001985273,0.0008973462,0.002410959,0.002077675,0.001941521,0.002173722],"category_scores_gemma":[0.05730147,0.0009800727,0.001824224,0.001623441,0.002355055,0.003036284,0.002416399,0.003941342,0.0005698981],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009076928,"about_ca_system_score_gemma":0.001159286,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002246488,"about_ca_topic_score_gemma":0.001195613,"domain_scores_codex":[0.9957195,0.003086336,0.0001896271,0.0003211366,0.0005789489,0.0001044473],"domain_scores_gemma":[0.9714968,0.02339842,0.0005707184,0.003345628,0.0009231867,0.0002653027],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0004082898,0.0001170568,0.006513263,0.0005562517,0.0005968102,0.0001479839,0.0003291075,0.6072575,0.001744262,0.2644447,0.00378478,0.1140999],"study_design_scores_gemma":[0.00003174908,0.00002044429,0.0004710185,0.00007552233,0.00001767497,0.00003037914,0.00003218364,0.8346744,0.000547781,0.162057,0.002015645,0.00002614593],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02687388,0.002997909,0.9632943,0.002924137,0.0002378457,0.00007089919,0.0003466731,0.00107064,0.002183759],"genre_scores_gemma":[0.3664156,0.002415841,0.6271534,0.0005890799,0.0003819492,0.0004462186,0.0008891727,0.0008481072,0.0008607053],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01148624,"threshold_uncertainty_score":0.06074572,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1978273076","doi":"10.1089/cmb.2007.r003","title":"A Parameterized Algorithm for Protein Structure Alignment","year":2007,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Protein Structure and Dynamics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":38,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"University of Waterloo","keywords":"Parameterized complexity; Algorithm; Computer science","authors":[{"name":"Jinbo Xu","is_ca":false},{"name":"Bonnie Berger","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.006747070707571181,"gpt":0.2753649814743295,"spread":0.2686179107667583,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008840741,0.001400172,0.00143889,0.001050166,0.001128365,0.001664838,0.003409894,0.001495192,0.00768911],"category_scores_gemma":[0.004119903,0.0008066549,0.001262264,0.002670021,0.0007942194,0.003906372,0.002011084,0.002046363,0.002852865],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002225499,"about_ca_system_score_gemma":0.002104894,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00470667,"about_ca_topic_score_gemma":0.004820021,"domain_scores_codex":[0.998578,0.0003156962,0.00009990845,0.0004477453,0.0004140581,0.0001447596],"domain_scores_gemma":[0.9986088,0.0004929665,0.0001138024,0.000581424,0.0001416391,0.00006144046],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0005038675,0.0001968563,0.0008088062,0.0003203755,0.000109104,0.0001513837,0.0002212306,0.3129512,0.01325987,0.06958408,0.01478742,0.5871058],"study_design_scores_gemma":[0.00007138059,0.00004928472,0.000154358,0.00001305227,0.00001646817,0.0001174178,0.00004065325,0.9475768,0.002804561,0.04077398,0.008364352,0.00001780199],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.003543445,0.0001338197,0.991896,0.0001106497,0.00002018138,0.00005162226,0.00012637,0.003137179,0.0009806899],"genre_scores_gemma":[0.07399774,0.0002884253,0.9216678,0.00008139942,0.00002690752,0.0002152933,0.001341822,0.0004890295,0.001891619],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00768911,"threshold_uncertainty_score":0.02572268,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2607286649","doi":"10.1089/cmb.2017.0021","title":"Zseq: An Approach for Preprocessing Next-Generation Sequencing Data","year":2017,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":37,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Preprocessor; Sequence (biology); DNA sequencing; Sequence assembly; Computer science; Computational biology; Genome; Biology; Discriminative model; Genomics; Algorithm; Genetics; Artificial intelligence; DNA; Gene","authors":[{"name":"Abedalrhman Alkhateeb","is_ca":true},{"name":"Luis Rueda","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2161899380631361,"gpt":0.3635272799106088,"spread":0.1473373418474727,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002412484,0.001911104,0.001504194,0.003384996,0.001709762,0.002468293,0.001971535,0.001017689,0.009948754],"category_scores_gemma":[0.003976141,0.001407991,0.001825456,0.002956498,0.0004870516,0.001288993,0.001643727,0.002663008,0.005381931],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001224075,"about_ca_system_score_gemma":0.002026428,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003136826,"about_ca_topic_score_gemma":0.0047012,"domain_scores_codex":[0.9981481,0.0002652822,0.0001884503,0.0005985878,0.0006649089,0.0001347065],"domain_scores_gemma":[0.9988387,0.0004468923,0.0001486505,0.0001552028,0.0003575805,0.00005304078],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00138882,0.0002330426,0.008020926,0.003504061,0.001181617,0.0007947023,0.001118347,0.01502611,0.4876655,0.01395295,0.06725066,0.3998632],"study_design_scores_gemma":[0.0002146986,0.0004034127,0.01488308,0.0002569715,0.000489124,0.001192921,0.0003831995,0.1124124,0.464564,0.0234369,0.3812263,0.0005369549],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01424674,0.001598553,0.9238418,0.0002238286,0.0003375288,0.0005239295,0.02367694,0.03251685,0.00303388],"genre_scores_gemma":[0.02420202,0.001059267,0.9276916,0.0004116258,0.00009325363,0.001424694,0.03707463,0.00450124,0.003541672],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.009948754,"threshold_uncertainty_score":0.03328192,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2065400176","doi":"10.1089/cmb.2007.a006","title":"Exact and Heuristic Algorithms for the Indel Maximum Likelihood Problem","year":2007,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":37,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University; Université du Québec à Montréal","funders":"","keywords":"Indel; Algorithm; Heuristic; Tree (set theory); Markov chain; Viterbi algorithm; Hidden Markov model; Phylogenetic tree; Computer science; Mathematics; Biology; Artificial intelligence; Genetics; Combinatorics; Machine learning; Gene; Decoding methods","authors":[{"name":"Abdoulaye Baniré Diallo","is_ca":true},{"name":"Vladimir Makarenkov","is_ca":true},{"name":"Mathieu Blanchette","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01390614159782581,"gpt":0.2793256302335371,"spread":0.2654194886357112,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003662029,0.001705771,0.001788193,0.002519765,0.001110946,0.002227023,0.004111969,0.002833214,0.01049536],"category_scores_gemma":[0.01800748,0.001099778,0.001348647,0.003535001,0.001399099,0.003418015,0.002823948,0.003414776,0.003937101],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00167369,"about_ca_system_score_gemma":0.002418674,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003777877,"about_ca_topic_score_gemma":0.005060512,"domain_scores_codex":[0.9981117,0.0008372837,0.0001151265,0.0002925703,0.0004688714,0.0001742762],"domain_scores_gemma":[0.9926293,0.005816267,0.0003068288,0.0005688188,0.0005474366,0.0001313619],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001874201,0.0002105332,0.0008007824,0.0003630904,0.00009385637,0.0001764704,0.0002476668,0.5284646,0.00130393,0.1011171,0.01197332,0.3550613],"study_design_scores_gemma":[0.00009817275,0.00002843348,0.0001245494,0.00003063037,0.00001594289,0.00008465248,0.0000536672,0.8513949,0.0005017089,0.1439594,0.00368172,0.00002624213],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.001318991,0.0002910056,0.9959931,0.0001609467,0.00003840982,0.00006305765,0.00008602371,0.0006703384,0.001378001],"genre_scores_gemma":[0.02399397,0.0003263925,0.9730338,0.0001282437,0.0001085307,0.0003561893,0.0003775389,0.0002633605,0.001411969],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.01049536,"threshold_uncertainty_score":0.03511047,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1969595164","doi":"10.1089/cmb.2007.a005","title":"Common Intervals and Symmetric Difference in a Model-Free Phylogenomics, with an Application to Streptophyte Evolution","year":2007,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":35,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université Laval; University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Canadian Institute for Advanced Research","keywords":"Phylogenomics; Biology; Evolutionary biology; Botany; Phylogenetics; Genetics","authors":[{"name":"Zaky Adam","is_ca":true},{"name":"Monique Turmel","is_ca":true},{"name":"Claude Lemieux","is_ca":true},{"name":"David Sankoff","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.009398791714588465,"gpt":0.264439563613116,"spread":0.2550407718985275,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003042668,0.000380691,0.000887484,0.001612177,0.0005863628,0.001138269,0.001887311,0.001043051,0.00112483],"category_scores_gemma":[0.01363411,0.0005097949,0.001151701,0.001614055,0.001849271,0.002306634,0.002539211,0.001589391,0.0001869718],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001078838,"about_ca_system_score_gemma":0.0007780342,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002437719,"about_ca_topic_score_gemma":0.001951674,"domain_scores_codex":[0.9987997,0.0006754508,0.00005217147,0.0002212154,0.0002018666,0.00004971888],"domain_scores_gemma":[0.9936103,0.005172843,0.0003253861,0.0005038087,0.0002030796,0.0001844932],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002365297,0.00005223851,0.003067979,0.00005660819,0.00006543098,0.0001174081,0.0001367906,0.7901974,0.00242768,0.1623208,0.0005369499,0.04078413],"study_design_scores_gemma":[0.0000186843,0.00001987923,0.0001885695,0.000005504891,0.000006390873,0.00003337356,0.00001017236,0.9327261,0.0003737709,0.06614365,0.0004647783,0.000009018706],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.05406463,0.000204174,0.9444574,0.0002597928,0.00002229105,0.00001981811,0.00009399429,0.0002057854,0.0006720631],"genre_scores_gemma":[0.4456897,0.0002380642,0.5522702,0.000116205,0.00006889209,0.0001375682,0.0003866987,0.0001596735,0.0009329522],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003042668,"threshold_uncertainty_score":0.01609135,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3177371828","doi":"10.1089/cmb.2020.0543","title":"Essential Protein Prediction Based on node2vec and XGBoost","year":2021,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":35,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Computer science; Biological network; Identification (biology); Computational biology; Construct (python library); Boosting (machine learning); Artificial intelligence; Machine learning; Data mining; Biology","authors":[{"name":"Nian Wang","is_ca":false},{"name":"Min Zeng","is_ca":false},{"name":"Yiming Li","is_ca":false},{"name":"Fang‐Xiang Wu","is_ca":true},{"name":"Min Li","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01235493312477577,"gpt":0.2912001665630558,"spread":0.27884523343828,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006629169,0.001020398,0.001110478,0.001917943,0.0005297104,0.0005512165,0.001004267,0.0009789491,0.001621978],"category_scores_gemma":[0.001065566,0.0004449817,0.0009021487,0.001165926,0.0003647137,0.0007076666,0.0005117754,0.0008069297,0.0004339874],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007385,"about_ca_system_score_gemma":0.001591883,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.008539319,"about_ca_topic_score_gemma":0.01034793,"domain_scores_codex":[0.9996605,0.00006237117,0.00002331013,0.00009783656,0.00008727078,0.00006866811],"domain_scores_gemma":[0.9997103,0.0001087185,0.00002902405,0.00002368255,0.00009415558,0.00003403536],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009118413,0.0005628741,0.01456077,0.0003659387,0.0003191142,0.0004101365,0.00007870318,0.6147149,0.008198058,0.00486908,0.02171776,0.3332909],"study_design_scores_gemma":[0.00001066304,0.00002249612,0.0002565702,0.000002998622,0.000009595297,0.00002429742,0.000005214695,0.9978281,0.0007518795,0.0007552176,0.0003293965,0.000003618281],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.260354,0.001817049,0.7214202,0.0006695058,0.0003183941,0.0003353259,0.002407341,0.009293723,0.003384444],"genre_scores_gemma":[0.7073848,0.0006417839,0.279507,0.0003808801,0.00009910417,0.0002892057,0.00670536,0.0003255698,0.0046662],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.008539319,"threshold_uncertainty_score":0.01697922,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4233853535","doi":"10.1089/106652700750050925","title":"Early Eukaryote Evolution Based on Mitochondrial Gene Order Breakpoints","year":2000,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genome Rearrangement Algorithms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":34,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal; Université de Montréal","funders":"","keywords":"Genome; Breakpoint; Phylogenetic tree; Eukaryote; Biology; Phylogenetics; Evolutionary biology; Gene; Genetics; Computational biology; Synteny; Phylogenetic network","authors":[{"name":"David Sankoff","is_ca":true},{"name":"David Bryant","is_ca":true},{"name":"Mélanie Deneault","is_ca":true},{"name":"B. Franz Lang","is_ca":true},{"name":"Gertraud Burger","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.005654480235721184,"gpt":0.236491253388888,"spread":0.2308367731531668,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001158381,0.0002932327,0.0005918152,0.001158468,0.0006532618,0.001341994,0.0007712818,0.0007874116,0.001546874],"category_scores_gemma":[0.006808037,0.0004242086,0.0007487194,0.001123069,0.0008977639,0.001300244,0.001071103,0.001094958,0.0002029382],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008682871,"about_ca_system_score_gemma":0.0005015566,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001354066,"about_ca_topic_score_gemma":0.002361506,"domain_scores_codex":[0.9996029,0.0001342658,0.00002073607,0.000114749,0.0000760488,0.00005135096],"domain_scores_gemma":[0.9984344,0.000963092,0.0002567709,0.0001552025,0.00009595018,0.00009468178],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008807961,0.000137115,0.0484066,0.000211432,0.0001708146,0.0003639804,0.0006835693,0.7487531,0.04166744,0.06057125,0.0004603759,0.09769344],"study_design_scores_gemma":[0.00007751927,0.000269253,0.02892307,0.00005414593,0.00007316406,0.0002623844,0.000342606,0.8518319,0.0150369,0.1010254,0.002047158,0.0000564926],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.7650961,0.0002379162,0.232777,0.0001387003,0.00001034586,0.00002893173,0.0001339036,0.0002032951,0.001373973],"genre_scores_gemma":[0.8488719,0.0001897418,0.1498288,0.00002689954,0.000008410773,0.00003958772,0.0003784166,0.0001199192,0.0005363618],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001546874,"threshold_uncertainty_score":0.006299913,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2054028885","doi":"10.1089/cmb.2006.0108","title":"Parsing Nucleic Acid Pseudoknotted Secondary Structure: Algorithm and Applications","year":2007,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"RNA and protein synthesis mechanisms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":33,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Algorithm; Parsing; Nucleic acid secondary structure; Pseudoknot; Protein secondary structure; Computer science; Generality; Dynamic programming; Nucleic acid structure; Energy (signal processing); Artificial intelligence; Mathematics; RNA; Biology; Statistics","authors":[{"name":"Baharak Rastegari","is_ca":true},{"name":"Anne Condon","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.006073057763412786,"gpt":0.2527020174113226,"spread":0.2466289596479098,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000702154,0.00081223,0.0007945963,0.0008944806,0.0006269965,0.001020374,0.001600708,0.001730036,0.003013478],"category_scores_gemma":[0.002866579,0.0004241251,0.0006671489,0.001950834,0.000827,0.001815683,0.0007534993,0.0009878771,0.001192046],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009827698,"about_ca_system_score_gemma":0.001452122,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002931844,"about_ca_topic_score_gemma":0.002870176,"domain_scores_codex":[0.9994881,0.0001134357,0.00004667943,0.0001554876,0.0001448342,0.00005136236],"domain_scores_gemma":[0.9987063,0.000830033,0.00007944903,0.0001451459,0.0002005663,0.00003850127],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002948806,0.0002558417,0.001884364,0.0003944964,0.00005261472,0.000328017,0.0002680451,0.3171293,0.0213424,0.05914112,0.009361813,0.589547],"study_design_scores_gemma":[0.00004539172,0.00003991802,0.0002403397,0.00001916402,0.0000125116,0.0001500404,0.00003564523,0.9489238,0.009994507,0.03742862,0.003085619,0.00002443423],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.008688298,0.0002263884,0.9871842,0.0002273178,0.00002780792,0.00005062897,0.00008238365,0.002586527,0.0009263717],"genre_scores_gemma":[0.0642271,0.0002539015,0.9334869,0.00009889757,0.00002393148,0.0001075831,0.0003483998,0.0002748903,0.001178458],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.003013478,"threshold_uncertainty_score":0.01008111,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1973255639","doi":"10.1089/cmb.2012.0089","title":"Determining Protein Structures from NOESY Distance Constraints by Semidefinite Programming","year":2012,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Peroxisome Proliferator-Activated Receptors","field":"Biochemistry, Genetics and Molecular Biology","cited_by":33,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University; University of Waterloo","funders":"","keywords":"Semidefinite programming; Mathematical optimization; Euclidean distance; Computer science; Algorithm; Euclidean geometry; Simulated annealing; Mathematics; Artificial intelligence","authors":[{"name":"Babak Alipanahi","is_ca":true},{"name":"Nathan Krislock","is_ca":false},{"name":"Ali Ghodsi","is_ca":true},{"name":"Henry Wolkowicz","is_ca":true},{"name":"Logan W. Donaldson","is_ca":true},{"name":"Ming Li","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.00952262510956205,"gpt":0.2651261782244295,"spread":0.2556035531148675,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002542579,0.001769112,0.001651329,0.0006343941,0.0005467367,0.001449896,0.001700789,0.001464581,0.004133719],"category_scores_gemma":[0.006142571,0.001142164,0.001150823,0.000795509,0.001951726,0.001845912,0.00181342,0.00327888,0.000810551],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001060034,"about_ca_system_score_gemma":0.001869644,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002961699,"about_ca_topic_score_gemma":0.003795673,"domain_scores_codex":[0.9984674,0.0007362688,0.00005957198,0.0002452522,0.0004027889,0.00008877079],"domain_scores_gemma":[0.9944929,0.004284854,0.0003657578,0.0002760146,0.000458305,0.0001221544],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00003874556,0.00006065281,0.0001575432,0.000122822,0.00002220682,0.00007459975,0.00003748825,0.953386,0.0009628433,0.02963807,0.001590201,0.01390885],"study_design_scores_gemma":[0.00001785327,0.00002139995,0.00003203121,0.000007943032,0.000002793326,0.00001255538,0.00001385205,0.9749747,0.0004048463,0.02358682,0.0009185083,0.000006764883],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.006171725,0.0001128242,0.9898163,0.0002982793,0.00003568143,0.00006874706,0.0001506284,0.000138347,0.003207445],"genre_scores_gemma":[0.1690652,0.0004939943,0.8213192,0.0004032774,0.0001132924,0.0008922951,0.001056715,0.0003763471,0.006279598],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004133719,"threshold_uncertainty_score":0.01382869,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1606551583","doi":"10.1089/cmb.2006.13.1355","title":"Optimizing Multiple Spaced Seeds for Homology Search","year":2006,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Advanced Image and Video Retrieval Techniques","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University; University of Waterloo","funders":"","keywords":"Sensitivity (control systems); Greedy algorithm; Homology (biology); Algorithm; Set (abstract data type); Local search (optimization); Linear programming; Mathematical optimization; Computer science; Mathematics; Search algorithm; Biology; Engineering; Genetics","authors":[{"name":"Jinbo Xu","is_ca":true},{"name":"Daniel G. Brown","is_ca":true},{"name":"Ming Li","is_ca":true},{"name":"Bin Ma","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0242074479757779,"gpt":0.325914702964207,"spread":0.3017072549884292,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001596095,0.0009787369,0.001362023,0.00124798,0.0005427586,0.0007848525,0.001319075,0.001875786,0.002090732],"category_scores_gemma":[0.007140057,0.0007530169,0.0006418698,0.001266455,0.001007249,0.002118709,0.001448455,0.001030925,0.0009868273],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009805752,"about_ca_system_score_gemma":0.001122483,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001409728,"about_ca_topic_score_gemma":0.00182678,"domain_scores_codex":[0.9989424,0.0003819464,0.00005785438,0.0002696426,0.0002610838,0.0000871425],"domain_scores_gemma":[0.9973108,0.001706394,0.00025384,0.0002966406,0.0003024405,0.0001299165],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003635543,0.0002140075,0.001616394,0.000118861,0.00007631821,0.0002112471,0.0001381043,0.756367,0.0332495,0.01680128,0.002943293,0.1879005],"study_design_scores_gemma":[0.00003372435,0.00006251156,0.0001158376,0.000004912341,0.00001063445,0.00006422001,0.00001207803,0.9859214,0.005954585,0.007238948,0.000569713,0.00001136909],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.03743022,0.000210113,0.9598954,0.00009514502,0.00002151815,0.00005604553,0.00002983889,0.001186786,0.00107491],"genre_scores_gemma":[0.3289891,0.0001301154,0.6684777,0.0001499989,0.00002928009,0.0001579956,0.0001666876,0.0003404961,0.00155847],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.002090732,"threshold_uncertainty_score":0.008441031,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1999060916","doi":"10.1089/cmb.2007.0198","title":"Novel and Efficient RNA Secondary Structure Prediction Using Hierarchical Folding","year":2008,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"RNA and protein synthesis mechanisms","field":"Biochemistry, Genetics and Molecular Biology","cited_by":33,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Pseudoknot; Nucleic acid secondary structure; Protein secondary structure; RNA; Nucleic acid structure; Computer science; Computational biology; Energy minimization; Algorithm; Base pair; Folding (DSP implementation); Bioinformatics; Theoretical computer science; Biology; Genetics; DNA; Physics; Engineering","authors":[{"name":"Hosna Jabbari","is_ca":true},{"name":"Anne Condon","is_ca":true},{"name":"Shelly Zhao","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01579393709075526,"gpt":0.2522987994211601,"spread":0.2365048623304049,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006339348,0.0009655714,0.000953246,0.0009095282,0.0006502966,0.000817625,0.001362904,0.0009237587,0.001309498],"category_scores_gemma":[0.001509377,0.0005092383,0.0007383533,0.0009221599,0.0004662699,0.001461409,0.001030038,0.0009393977,0.0009015203],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008050021,"about_ca_system_score_gemma":0.001220178,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004551467,"about_ca_topic_score_gemma":0.006536239,"domain_scores_codex":[0.9995878,0.00007215638,0.00002884683,0.0001127998,0.0001567873,0.00004155516],"domain_scores_gemma":[0.9993594,0.0002409008,0.00006924868,0.0001086551,0.0001685572,0.00005321769],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002364218,0.0002354776,0.004711047,0.0002676356,0.0001305619,0.0002067641,0.0001690605,0.4467299,0.05970715,0.01234475,0.007774815,0.4674864],"study_design_scores_gemma":[0.00001211568,0.00002670211,0.0002403724,0.00000436466,0.000006076641,0.00002888792,0.000008877741,0.9905014,0.004667566,0.003703839,0.0007923235,0.000007415692],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.02486695,0.0002835972,0.9691952,0.00009322026,0.00003354857,0.00006857891,0.0002036475,0.004544617,0.0007105462],"genre_scores_gemma":[0.1576723,0.0002052421,0.8391308,0.00009101009,0.00002373918,0.0001105629,0.001041539,0.0003105731,0.001414245],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.004551467,"threshold_uncertainty_score":0.009049952,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1976245710","doi":"10.1089/cmb.2005.12.1083","title":"The Statistical Analysis of Spatially Clustered Genes under the Maximum Gap Criterion","year":2005,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":32,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa","funders":"National Human Genome Research Institute; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; Alfred P. Sloan Foundation","keywords":"Pairwise comparison; Genome; Comparative genomics; Computational biology; Identification (biology); Genomics; Biology; Set (abstract data type); Statistical model; Cluster (spacecraft); Statistical analysis; Gene; Genetics; Computer science; Mathematics; Statistics","authors":[{"name":"Rose Hoberman","is_ca":false},{"name":"David Sankoff","is_ca":true},{"name":"Dannie Durand","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02096222089491316,"gpt":0.319773445089963,"spread":0.2988112241950499,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0264919,0.0006269346,0.002186995,0.002454346,0.001382778,0.001823331,0.002543672,0.001723212,0.001852128],"category_scores_gemma":[0.08861123,0.000426856,0.001470043,0.002750125,0.005413805,0.002760769,0.00326725,0.002197338,0.0002988438],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001099528,"about_ca_system_score_gemma":0.001767369,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001113498,"about_ca_topic_score_gemma":0.0005370792,"domain_scores_codex":[0.9869704,0.007417272,0.0005319836,0.002282332,0.00224001,0.0005579015],"domain_scores_gemma":[0.898393,0.08471585,0.004850475,0.008309029,0.002758088,0.0009735231],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001682498,0.0002591003,0.08794459,0.0009453633,0.001324546,0.001265234,0.001894764,0.3220113,0.01937822,0.3642757,0.004986565,0.1940322],"study_design_scores_gemma":[0.00006371977,0.000388906,0.0236191,0.00005521107,0.00009001727,0.0004166165,0.0003146216,0.665814,0.005161061,0.3022061,0.00181489,0.00005578724],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1416815,0.0003119012,0.8557969,0.0003702119,0.00002723977,0.0001038959,0.0004187091,0.0004389599,0.0008506457],"genre_scores_gemma":[0.8890708,0.0001715144,0.1079942,0.0002203661,0.0000979176,0.0004709651,0.00115854,0.0001601588,0.0006556793],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0264919,"threshold_uncertainty_score":0.1401042,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2943381976","doi":"10.1089/cmb.2018.0239","title":"Toward an Alignment-Free Method for Feature Extraction and Accurate Classification of Viral Sequences","year":2019,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":32,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université du Québec à Montréal","funders":"Fonds de recherche du Québec – Nature et technologies; Natural Sciences and Engineering Research Council of Canada","keywords":"Biology; Virus; Subsequence; Computational biology; Genetics; Mathematics","authors":[{"name":"Dylan Lebatteux","is_ca":true},{"name":"Mohamed Amine Remita","is_ca":true},{"name":"Abdoulaye Baniré Diallo","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.03237791519115444,"gpt":0.3414660170478026,"spread":0.3090881018566481,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001615387,0.001233056,0.001374803,0.002827508,0.0006544458,0.0009139372,0.001258942,0.001336955,0.001135112],"category_scores_gemma":[0.003833966,0.0004066702,0.001300451,0.001649047,0.0004787294,0.001274373,0.0006860279,0.001586644,0.001031392],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005387392,"about_ca_system_score_gemma":0.001436258,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004719334,"about_ca_topic_score_gemma":0.004352543,"domain_scores_codex":[0.9985971,0.0003139051,0.0001454012,0.0003911656,0.0003995892,0.000152829],"domain_scores_gemma":[0.9980356,0.0008536393,0.0002101673,0.0001885279,0.0006464529,0.00006556822],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0003649092,0.0002908203,0.004991408,0.0001466974,0.0001087942,0.0001454375,0.0001184405,0.05920198,0.07152548,0.002111773,0.002919841,0.8580744],"study_design_scores_gemma":[0.00002787351,0.0001313929,0.002269295,0.00001472449,0.0000263596,0.0001888784,0.00004375728,0.9731616,0.02006422,0.002022169,0.002021382,0.00002836077],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02619147,0.000242526,0.9714769,0.00009871668,0.00002147161,0.00008008895,0.0002012371,0.001421365,0.0002660883],"genre_scores_gemma":[0.1477827,0.000166586,0.8490908,0.0001007247,0.00003329662,0.0002033749,0.001392557,0.0001237806,0.00110631],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004719334,"threshold_uncertainty_score":0.009383738,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2570688054","doi":"10.1089/cmb.2016.0148","title":"Clonality Inference from Single Tumor Samples Using Low-Coverage Sequence Data","year":2017,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Cancer Genomics and Diagnostics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":31,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"","keywords":"Deep sequencing; Tumor heterogeneity; Inference; DNA sequencing; Biology; Computational biology; Solid tumor; Sample (material); Sequence (biology); Single cell sequencing; Genetics; Cancer; Computer science; Artificial intelligence; Mutation; Exome sequencing; Genome; Gene","authors":[{"name":"Nilgun Donmez","is_ca":true},{"name":"Salem Malikić","is_ca":true},{"name":"Alexander W. Wyatt","is_ca":true},{"name":"Martin Gleave","is_ca":false},{"name":"Colin C. Collins","is_ca":true},{"name":"S. Cenk Şahinalp","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1186770205578936,"gpt":0.3722387631576175,"spread":0.2535617425997239,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001899346,0.0007363801,0.000950384,0.001753721,0.0004779112,0.001326097,0.0008510197,0.001007605,0.0008646502],"category_scores_gemma":[0.009069596,0.0005537866,0.000992634,0.001026419,0.0005918245,0.001087934,0.001212938,0.001234323,0.000387524],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005740427,"about_ca_system_score_gemma":0.0008386509,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00337913,"about_ca_topic_score_gemma":0.005503953,"domain_scores_codex":[0.9992606,0.0001928967,0.00005361065,0.0002649501,0.0001610901,0.00006686253],"domain_scores_gemma":[0.9960061,0.002719996,0.0003565775,0.0004673738,0.0003029504,0.0001470194],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008629391,0.0001752411,0.1263983,0.0006590767,0.0006522076,0.001005166,0.0005354396,0.5221542,0.1832993,0.007698708,0.002976109,0.1535833],"study_design_scores_gemma":[0.00002651069,0.00005696976,0.008904634,0.00002752606,0.00005347131,0.0003193504,0.00005819841,0.9550655,0.02330394,0.01025669,0.001897574,0.00002967714],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.413429,0.0009513943,0.5777515,0.0002671785,0.0000355737,0.0000946232,0.00336665,0.00298164,0.001122478],"genre_scores_gemma":[0.787474,0.0004255337,0.2026637,0.0002397702,0.00003484225,0.0001292529,0.008043184,0.000314441,0.0006750965],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.00337913,"threshold_uncertainty_score":0.01004481,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2092120709","doi":"10.1089/cmb.2007.a007","title":"Duplication and Inversion History of a Tandemly Repeated Genes Family","year":2007,"lang":"en","type":"article","venue":"Journal of Computational Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":31,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal","funders":"","keywords":"Phylogenetic tree; Biology; Gene duplication; Phylogenetics; Gene; Chromosomal inversion; Gene family; Genetics; Breakpoint; Chromosome; Segmental duplication; Inference; Maximum parsimony; Evolutionary biology; Genome; Karyotype; Computer science; Artificial intelligence","authors":[{"name":"Mathieu Lajoie","is_ca":true},{"name":"Denis Bertrand","is_ca":true},{"name":"Nadia El-Mabrouk","is_ca":true},{"name":"Olivier Gascuel","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.01476863121669693,"gpt":0.2472926858771418,"spread":0.2325240546604449,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0004665209,0.0001072677,0.0003008801,0.000707554,0.0004699769,0.000449961,0.0004853052,0.0004278535,0.001151127],"category_scores_gemma":[0.004036254,0.0001961551,0.0002284119,0.0007205997,0.0004623825,0.0008611776,0.0002791303,0.0004275324,0.00018171],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005214093,"about_ca_system_score_gemma":0.0004074775,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001027967,"about_ca_topic_score_gemma":0.001311628,"domain_scores_codex":[0.9998166,0.00004190453,0.00001029242,0.00006002976,0.0000462693,0.00002504504],"domain_scores_gemma":[0.9985666,0.0008349746,0.0002747102,0.00008510196,0.0001274801,0.0001112094],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001002808,0.0001568789,0.2238062,0.0003045881,0.0001570649,0.002347152,0.0007819752,0.3849421,0.2471107,0.06054909,0.0008516628,0.07798976],"study_design_scores_gemma":[0.00007621827,0.0003584576,0.08279686,0.00004572169,0.0001206091,0.002877543,0.0003720559,0.8190663,0.02727844,0.06379347,0.003147436,0.00006694593],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9820083,0.000112978,0.0169507,0.00006293572,0.000001902714,0.000004803216,0.0001044853,0.00003448853,0.0007194775],"genre_scores_gemma":[0.9867487,0.0000587558,0.01265734,0.000009420249,0.000002984466,0.000006479236,0.0002312112,0.000009476457,0.0002757591],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001151127,"threshold_uncertainty_score":0.003850877,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}