{"meta":{"query_hash":"eea82c7c0fa1","filters":{"venue":"Statistical Applications in Genetics and Molecular Biology"},"cohort_total":49,"direct_labels_cover":0,"predictions_cover":49,"exported":49,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/eea82c7c0fa1","api":"https://metacan.xera.ac/api/v1/cohort?venue=Statistical+Applications+in+Genetics+and+Molecular+Biology"},"results":[{"id":"W106150465","doi":"10.2202/1544-6115.1410","title":"Testing for Gene-Gene Interaction with AMMI Models","year":2010,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Mapping and Diversity in Plants and Animals","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Montreal Heart Institute","funders":"","keywords":"Ammi; Gene interaction; Biplot; Main effect; Interaction; Gene–environment interaction; Computational biology; Additive genetic effects; Biology; Multiplicative function; Genetics; Gene; Trait; Mixed model; Computer science; Mathematics; Genotype; Statistics; Heritability","score_opus":0.016352267092203384,"score_gpt":0.285890504062962,"score_spread":0.2695382369707586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W106150465","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0773928,0.00030869013,0.9188538,0.00034898458,0.00009333929,0.00029940813,0.0006981746,0.00088373554,0.0011209548],"genre_scores_gemma":[0.593092,0.0003286076,0.40062335,0.00033535156,0.00014527766,0.0013326255,0.0023562035,0.0003438281,0.0014427647],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95122856,0.03966036,0.0011683455,0.0042917035,0.0027585211,0.0008924671],"domain_scores_gemma":[0.83454853,0.15418887,0.0038013055,0.0048077297,0.0018430025,0.0008106416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04657119,0.003159824,0.0030583546,0.003455546,0.0015574115,0.0027567507,0.0032809242,0.0021595429,0.0038737215],"category_scores_gemma":[0.10423865,0.0009023744,0.0041028545,0.002764029,0.0020456938,0.0024230117,0.0026773964,0.0037224088,0.00086501247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017165944,0.0009720306,0.10107268,0.0006748011,0.006915106,0.0013402668,0.00093861343,0.690754,0.007461508,0.051345702,0.0042047845,0.13260387],"study_design_scores_gemma":[0.00008045503,0.00063074735,0.007829711,0.000033519944,0.00026978776,0.00025234334,0.00012417369,0.9503829,0.0013897321,0.037521236,0.0013992715,0.00008608236],"about_ca_topic_score_codex":0.0023880065,"about_ca_topic_score_gemma":0.0016257571,"teacher_disagreement_score":0.04657119,"about_ca_system_score_codex":0.00093128136,"about_ca_system_score_gemma":0.0015334543,"threshold_uncertainty_score":0.24629498},"labels":[],"label_agreement":null},{"id":"W129429178","doi":"10.1515/sagmb-2014-0033","title":"Testing genotypes-phenotype relationships using permutation tests on association rules","year":2015,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Data Mining Algorithms and Applications","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Canadian Institutes of Health Research","keywords":"Permutation (music); Association (psychology); Genotype; Phenotype; Genetics; Statistics; Biology; Computational biology; Mathematics; Psychology; Gene","score_opus":0.05919948829962234,"score_gpt":0.33482303618062387,"score_spread":0.2756235478810015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W129429178","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.26330632,0.00017223155,0.7299737,0.0010863745,0.00020227444,0.0004261898,0.0009735951,0.00085091835,0.0030084471],"genre_scores_gemma":[0.8362489,0.00009266233,0.16085015,0.0002500371,0.00010129501,0.00071009423,0.00095676945,0.00009452409,0.00069560175],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9501219,0.03587386,0.0024560157,0.0063900035,0.004171525,0.0009868196],"domain_scores_gemma":[0.6323393,0.34077448,0.006138482,0.01715982,0.0026090783,0.0009788595],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036913652,0.00097146456,0.0016371296,0.0029004663,0.0012306841,0.0022887634,0.0028771015,0.0015221266,0.0052268924],"category_scores_gemma":[0.206745,0.00050864014,0.003063523,0.0033486835,0.0034575304,0.003104959,0.0023345961,0.0035393657,0.00063290645],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004115601,0.0018622094,0.2951326,0.0006448064,0.0076401937,0.004073946,0.0016239753,0.07872059,0.009540447,0.09787232,0.005078576,0.49369466],"study_design_scores_gemma":[0.00081645604,0.002720255,0.05053212,0.000090990005,0.00091239694,0.0019153873,0.00060979475,0.6182658,0.0055922945,0.31518465,0.0032245577,0.00013534566],"about_ca_topic_score_codex":0.0018815016,"about_ca_topic_score_gemma":0.0014281962,"teacher_disagreement_score":0.036913652,"about_ca_system_score_codex":0.00058263645,"about_ca_system_score_gemma":0.0022493245,"threshold_uncertainty_score":0.19522035},"labels":[],"label_agreement":null},{"id":"W146638925","doi":"10.1515/1544-6115.1779","title":"Hessian Calculation for Phylogenetic Likelihood based on the Pruning Algorithm and its Applications","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Hessian matrix; Computation; Pruning; Algorithm; Tree (set theory); Mathematics; Likelihood function; Restricted maximum likelihood; Inference; Computer science; Maximum likelihood; Model selection; Mathematical optimization; Matrix (chemical analysis); Newton's method; Applied mathematics; Estimation theory; Statistics; Artificial intelligence; Combinatorics; Nonlinear system","score_opus":0.011170475214458023,"score_gpt":0.28856232222371786,"score_spread":0.27739184700925984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W146638925","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002347726,0.00020968542,0.99597687,0.00009876022,0.00003203316,0.00002071351,0.000021476331,0.0001919193,0.0011008525],"genre_scores_gemma":[0.053817786,0.000564821,0.942344,0.00010076453,0.00009360614,0.00012417238,0.00011908106,0.0003778436,0.002457938],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9988254,0.00039211157,0.000067488436,0.000106511325,0.0005501149,0.00005842615],"domain_scores_gemma":[0.9973787,0.0015607093,0.0002112816,0.00024799726,0.000525983,0.00007531997],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020530694,0.00077456015,0.0006795005,0.0015115495,0.000590758,0.00079577614,0.0010587869,0.0009853974,0.0037681372],"category_scores_gemma":[0.0105167385,0.00042044756,0.000788645,0.0015594518,0.00077467354,0.0013788674,0.00096648996,0.0013163659,0.0016700203],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007289199,0.00009750362,0.0019532698,0.0005188685,0.00010929669,0.00090546743,0.00038052537,0.2106017,0.023373576,0.3461234,0.008594653,0.4072689],"study_design_scores_gemma":[0.000017133552,0.00003845451,0.0011235152,0.000052644562,0.000022761198,0.0003946065,0.000024016625,0.89358294,0.005052449,0.09141657,0.008224064,0.000050884228],"about_ca_topic_score_codex":0.0026973959,"about_ca_topic_score_gemma":0.003019284,"teacher_disagreement_score":0.0037681372,"about_ca_system_score_codex":0.0006167561,"about_ca_system_score_gemma":0.0011606856,"threshold_uncertainty_score":0.012605727},"labels":[],"label_agreement":null},{"id":"W1485154922","doi":"10.2202/1544-6115.1289","title":"Pattern Classification of Phylogeny Signals","year":2008,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Cluster analysis; Concatenation (mathematics); Phylogenetics; Phylogenetic tree; Entropy (arrow of time); Pattern recognition (psychology); Artificial intelligence; Computer science; Computational biology; Mathematics; Data mining; Gene; Biology; Genetics; Combinatorics; Physics","score_opus":0.017931865034605084,"score_gpt":0.3085976421761609,"score_spread":0.29066577714155584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1485154922","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1355328,0.001134361,0.8568444,0.0005972933,0.00012653293,0.00011381715,0.00062855234,0.000801275,0.0042208773],"genre_scores_gemma":[0.709108,0.0008049737,0.28480944,0.0001777231,0.00016342527,0.00014250509,0.0018818945,0.00020315844,0.0027088877],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99903214,0.00020402244,0.0000671608,0.00029572463,0.00027713916,0.00012382814],"domain_scores_gemma":[0.99811953,0.00073799223,0.00026379654,0.00023093799,0.00053663464,0.000111057256],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00086719525,0.000530686,0.00071505836,0.0035817593,0.0005964931,0.0012395314,0.00082092657,0.000933445,0.0020286012],"category_scores_gemma":[0.0043875454,0.0002910705,0.00060522545,0.002482149,0.00086163066,0.0015256025,0.00076892285,0.0009016125,0.000916915],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00055206445,0.00012969259,0.028747354,0.0006054291,0.00014166645,0.0005152222,0.0006673164,0.057758912,0.08739828,0.038694214,0.0051071662,0.77968264],"study_design_scores_gemma":[0.000042653646,0.00019024432,0.035547588,0.00012191414,0.00010487169,0.0007307026,0.00044787215,0.84116,0.024303457,0.083959505,0.013295686,0.00009552848],"about_ca_topic_score_codex":0.0012946874,"about_ca_topic_score_gemma":0.0009501776,"teacher_disagreement_score":0.0035817593,"about_ca_system_score_codex":0.0006375934,"about_ca_system_score_gemma":0.00047410914,"threshold_uncertainty_score":0.006786406},"labels":[],"label_agreement":null},{"id":"W1489518784","doi":"10.2202/1544-6115.1298","title":"A Composite-Conditional-Likelihood Approach for Gene Mapping Based on Linkage Disequilibrium in Windows of Marker Loci","year":2008,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Mapping and Diversity in Plants and Animals","field":"Biochemistry, Genetics and Molecular Biology","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Linkage disequilibrium; Genetics; Locus (genetics); Biology; Single-nucleotide polymorphism; Association mapping; Genetic marker; Haplotype; Statistics; Mathematics; Algorithm; Allele; Gene; Genotype","score_opus":0.012891548595144143,"score_gpt":0.25739314203235947,"score_spread":0.24450159343721534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1489518784","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024121604,0.0000962013,0.99715424,0.000027878466,0.000008383559,0.000019032053,0.000025260088,0.00015741581,0.000099359815],"genre_scores_gemma":[0.11232061,0.00032953214,0.88472325,0.000088609944,0.00009258546,0.00032122462,0.0004564093,0.00028560543,0.0013822685],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976235,0.0014068724,0.00008104697,0.00040891964,0.00036204577,0.000117673924],"domain_scores_gemma":[0.98868084,0.009159695,0.0005425369,0.00071516726,0.0005786455,0.00032309536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006193627,0.0009858368,0.0015786453,0.0022755503,0.0007455305,0.0012287333,0.0042711436,0.0010944861,0.0023633004],"category_scores_gemma":[0.016860202,0.0007537248,0.0019156702,0.0020594823,0.0013490815,0.0015186679,0.0022067598,0.0024041485,0.00064983754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048716355,0.00018221063,0.009036095,0.0004268396,0.00055082724,0.00056878006,0.00045611692,0.59947616,0.0071700285,0.1214173,0.0021883298,0.2580401],"study_design_scores_gemma":[0.000019329118,0.000036674974,0.000508404,0.000008751738,0.000027616637,0.000108244436,0.000010082031,0.9778111,0.0006165012,0.019914236,0.00091065414,0.000028482038],"about_ca_topic_score_codex":0.0042512105,"about_ca_topic_score_gemma":0.0033790218,"teacher_disagreement_score":0.006193627,"about_ca_system_score_codex":0.00086041354,"about_ca_system_score_gemma":0.0018087615,"threshold_uncertainty_score":0.032755375},"labels":[],"label_agreement":null},{"id":"W1497520349","doi":"10.2202/1544-6115.1151","title":"Hierarchical Inverse Gaussian Models and Multiple Testing: Application to Gene Expression Data","year":2005,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Inverse Gaussian distribution; Computational biology; Expression (computer science); Computer science; Gaussian; Mathematics; Statistics; Biology; Physics; Mathematical analysis","score_opus":0.03209668385080837,"score_gpt":0.32657705499584017,"score_spread":0.2944803711450318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1497520349","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001684003,0.00043542753,0.9970156,0.00025580052,0.000035190074,0.000029060937,0.00003670355,0.00018683416,0.0003214589],"genre_scores_gemma":[0.117291614,0.0018823894,0.8767038,0.00051247154,0.00045307388,0.0006637316,0.00028115878,0.00024006714,0.0019716711],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9779589,0.016872669,0.000515209,0.0016272428,0.0025175724,0.0005083773],"domain_scores_gemma":[0.92761385,0.065645166,0.0021960489,0.002432031,0.0016824102,0.0004305114],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025495749,0.0018329769,0.0025492883,0.003083572,0.0011096748,0.001648782,0.003932793,0.0035790203,0.0026632864],"category_scores_gemma":[0.077626124,0.00085423206,0.0031178913,0.0061315447,0.004928727,0.0026063516,0.003379661,0.0045771417,0.0010209111],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015769484,0.00011978591,0.004255762,0.00050292007,0.00047003708,0.0009807238,0.0007439198,0.28145427,0.0017905614,0.55253154,0.0044776713,0.15251516],"study_design_scores_gemma":[0.000024682739,0.00004555785,0.0007401543,0.000030033949,0.000030692514,0.00024238804,0.00005316301,0.60822505,0.00037542655,0.38785863,0.002338827,0.000035340312],"about_ca_topic_score_codex":0.0067545995,"about_ca_topic_score_gemma":0.00523094,"teacher_disagreement_score":0.025495749,"about_ca_system_score_codex":0.0021401371,"about_ca_system_score_gemma":0.0027778603,"threshold_uncertainty_score":0.13483602},"labels":[],"label_agreement":null},{"id":"W1647270943","doi":"10.1515/1544-6115.1807","title":"Estimators of the local false discovery rate designed for small numbers of tests","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Estimator; False discovery rate; Bayes' theorem; Parametric statistics; Feature (linguistics); Negative binomial distribution; Binomial distribution; Prior probability","score_opus":0.1852363415391905,"score_gpt":0.5019122555711589,"score_spread":0.31667591403196843,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1647270943","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00069953734,0.00021393759,0.9982469,0.000052843847,0.00006212351,0.0001616707,0.00003084419,0.0003710509,0.00016122189],"genre_scores_gemma":[0.034768872,0.00025041934,0.9608509,0.0003103463,0.00019903612,0.0024848275,0.00020459185,0.0003842765,0.0005467872],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88281554,0.0902404,0.0048239403,0.00977086,0.011201886,0.0011472942],"domain_scores_gemma":[0.55410826,0.3810628,0.018593349,0.030603962,0.014519338,0.0011123882],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1252182,0.0036898295,0.004153367,0.0062706303,0.0013390783,0.0032469865,0.008296595,0.005864002,0.00337276],"category_scores_gemma":[0.41597155,0.002591259,0.003043821,0.0040127835,0.005786136,0.0054861335,0.003984124,0.008820826,0.0017677955],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014066796,0.00047669956,0.014396324,0.0021331515,0.0027995754,0.0007495876,0.0009920303,0.26480174,0.011521714,0.22842771,0.0076614455,0.46463332],"study_design_scores_gemma":[0.000403752,0.0006321827,0.0039764806,0.0005950247,0.00052345346,0.0009459626,0.00013437578,0.83802426,0.014032569,0.12652566,0.01389094,0.00031528194],"about_ca_topic_score_codex":0.001377703,"about_ca_topic_score_gemma":0.00097041007,"teacher_disagreement_score":0.1252182,"about_ca_system_score_codex":0.0027177525,"about_ca_system_score_gemma":0.0040564025,"threshold_uncertainty_score":0.662225},"labels":[],"label_agreement":null},{"id":"W168874597","doi":"10.1515/sagmb-2013-0035","title":"Estimation of weighted log partial area under the ROC curve and its application to MicroRNA expression data","year":2013,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"MicroRNA in disease regulation","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Statistic; Receiver operating characteristic; microRNA; Ranking (information retrieval); Computer science; Data mining; Rank (graph theory); Expression (computer science); Variance (accounting); Coding (social sciences); Mathematics; Statistics; Computational biology; Algorithm; Artificial intelligence; Biology; Genetics","score_opus":0.012875139461111284,"score_gpt":0.30076401849011586,"score_spread":0.28788887902900456,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W168874597","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0318834,0.00061093085,0.9656842,0.0001550576,0.000028078519,0.00010179015,0.00019045472,0.0009833697,0.00036285835],"genre_scores_gemma":[0.53030455,0.0004950229,0.46699333,0.00012578866,0.00010548023,0.0005418672,0.00077249587,0.0002589596,0.00040252946],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9807092,0.014794241,0.00086373324,0.001345181,0.0019907418,0.0002969304],"domain_scores_gemma":[0.9216683,0.0654156,0.0049263574,0.0034714907,0.0040778476,0.00044044317],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021203512,0.0011962559,0.001953906,0.004883121,0.0004339317,0.0016206029,0.0013087454,0.0015141014,0.0008080339],"category_scores_gemma":[0.08469466,0.0003882017,0.0017277991,0.0034000622,0.0011066324,0.0015246455,0.0012575712,0.0011585982,0.0004805342],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010851338,0.0002446964,0.04013426,0.000800052,0.0012113557,0.00073649787,0.00044357454,0.44696406,0.011590178,0.013665774,0.003330709,0.47979373],"study_design_scores_gemma":[0.000034786677,0.0003640184,0.008605796,0.00003117285,0.00008179451,0.0006076983,0.000079182755,0.977469,0.0026999232,0.008669269,0.0012574844,0.000099775476],"about_ca_topic_score_codex":0.001209463,"about_ca_topic_score_gemma":0.00060172036,"teacher_disagreement_score":0.021203512,"about_ca_system_score_codex":0.0005619943,"about_ca_system_score_gemma":0.0010601928,"threshold_uncertainty_score":0.112136245},"labels":[],"label_agreement":null},{"id":"W1967827763","doi":"10.2202/1544-6115.1406","title":"Sparse Canonical Correlation Analysis with Application to Genomic Data Integration","year":2009,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":351,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Ontario Institute for Cancer Research; SickKids Foundation; Hospital for Sick Children","funders":"","keywords":"Canonical correlation; Interpretability; Multivariate statistics; Correlation; Feature selection; Mathematics; Variable (mathematics); Multivariate analysis; Statistics; Data mining; Computer science; Artificial intelligence","score_opus":0.011641527765839902,"score_gpt":0.31727430992254274,"score_spread":0.30563278215670286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967827763","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043318244,0.00012783459,0.9946413,0.0001258227,0.00001497676,0.000031804528,0.00007714395,0.00034636006,0.00030281613],"genre_scores_gemma":[0.12310007,0.00049287576,0.8739049,0.00014955118,0.0001171051,0.00037543348,0.00080053677,0.00022403152,0.0008354917],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9951421,0.0030321965,0.00018892616,0.00053776085,0.0009024663,0.00019657657],"domain_scores_gemma":[0.986686,0.008915103,0.0006846015,0.0013161545,0.0021355872,0.00026259027],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061297663,0.0011231867,0.0017360094,0.0028253626,0.00089448015,0.001730793,0.0011544351,0.0009241579,0.0018228032],"category_scores_gemma":[0.026989203,0.0007544024,0.001721168,0.0057861055,0.0013942881,0.0013672437,0.0025540045,0.0016897942,0.00080172333],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017794127,0.00012431618,0.005293696,0.00018794306,0.00026440716,0.0002916987,0.00032649213,0.5758081,0.0038315514,0.06773324,0.0051265517,0.34083402],"study_design_scores_gemma":[0.000012283376,0.000017991537,0.00043413002,0.000008736448,0.000013447683,0.00004670759,0.000019354286,0.97436917,0.00058782566,0.023173241,0.0012997431,0.000017365888],"about_ca_topic_score_codex":0.0074582533,"about_ca_topic_score_gemma":0.007655779,"teacher_disagreement_score":0.0074582533,"about_ca_system_score_codex":0.000698657,"about_ca_system_score_gemma":0.002797199,"threshold_uncertainty_score":0.032417715},"labels":[],"label_agreement":null},{"id":"W1980353549","doi":"10.2202/1544-6115.1711","title":"Principal Components of Heritability for High Dimension Quantitative Traits and General Pedigrees","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; McGill University","funders":"","keywords":"Principal component analysis; Heritability; Pedigree chart; Variance (accounting); Estimator; Statistics; Context (archaeology); Dimension (graph theory); Linear discriminant analysis; Mathematics; Econometrics; Computer science; Biology; Genetics","score_opus":0.021060826109587708,"score_gpt":0.33405240768445055,"score_spread":0.31299158157486284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980353549","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010595866,0.003620326,0.98311996,0.0002172929,0.00007191889,0.00006504262,0.00027441845,0.0001950314,0.0018400397],"genre_scores_gemma":[0.33462954,0.0094231665,0.65048975,0.00027709777,0.00033933378,0.0005781248,0.0009802753,0.00029697365,0.0029857731],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99727637,0.001470622,0.00013163869,0.00054728735,0.0004695726,0.000104539955],"domain_scores_gemma":[0.98991793,0.008103252,0.00062581437,0.0008740447,0.00042187053,0.00005711442],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006334562,0.00090942584,0.0008256996,0.0023801746,0.00038708866,0.0012328258,0.00095329375,0.00080040615,0.0027975223],"category_scores_gemma":[0.03122126,0.00047081587,0.0011645006,0.0024531004,0.0014193754,0.0020381352,0.000996134,0.0016568209,0.0006234495],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009751763,0.000041926818,0.016707687,0.0008009214,0.0004900858,0.00030016585,0.00092109427,0.04783323,0.0025508015,0.57444847,0.0068849544,0.3489233],"study_design_scores_gemma":[0.00003834199,0.00007925356,0.046063412,0.0004488361,0.0002567693,0.0006506707,0.00025321599,0.1560784,0.0014277033,0.7676218,0.026935844,0.00014573596],"about_ca_topic_score_codex":0.002783064,"about_ca_topic_score_gemma":0.0026137822,"teacher_disagreement_score":0.006334562,"about_ca_system_score_codex":0.0007331553,"about_ca_system_score_gemma":0.00076440966,"threshold_uncertainty_score":0.03350073},"labels":[],"label_agreement":null},{"id":"W1982030926","doi":"10.2202/1544-6115.1261","title":"Estimating Number of Clusters Based on a General Similarity Matrix with Application to Microarray Data","year":2008,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Cluster analysis; Similarity (geometry); Data mining; Computer science; Selection (genetic algorithm); Set (abstract data type); A priori and a posteriori; Data set; Model selection; Matrix (chemical analysis); Determining the number of clusters in a data set; Artificial intelligence; Correlation clustering; CURE data clustering algorithm","score_opus":0.013888677644903851,"score_gpt":0.3370596504591929,"score_spread":0.323170972814289,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982030926","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013749411,0.00015002696,0.98553604,0.00008867662,0.000010978703,0.000051989042,0.000045015386,0.00017584195,0.0001920302],"genre_scores_gemma":[0.205387,0.00044460787,0.7925681,0.000059261834,0.00007822428,0.00020136296,0.00036327261,0.0001020596,0.000796117],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9967937,0.0013947835,0.00016733124,0.0007583108,0.0007464759,0.00013937915],"domain_scores_gemma":[0.98700225,0.008862638,0.0009891302,0.0012237102,0.0016316175,0.000290641],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0062261145,0.0007892174,0.0014063985,0.003008774,0.0011790257,0.0013797929,0.0020536566,0.0016048385,0.0008057265],"category_scores_gemma":[0.024766514,0.0006132261,0.0012116462,0.0039076842,0.0015220781,0.002139454,0.0018145838,0.0014270453,0.00040917704],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022206693,0.00009842853,0.0076251915,0.0002301796,0.0001977909,0.00016975228,0.000348329,0.78881353,0.0087156575,0.037574384,0.0017554774,0.15424931],"study_design_scores_gemma":[0.000009236901,0.00002552327,0.001074493,0.000007225554,0.000010956923,0.00006426636,0.00002362949,0.98054814,0.0008333155,0.016969824,0.00041390883,0.000019584792],"about_ca_topic_score_codex":0.0050725015,"about_ca_topic_score_gemma":0.0053346287,"teacher_disagreement_score":0.0062261145,"about_ca_system_score_codex":0.0014614571,"about_ca_system_score_gemma":0.0014239616,"threshold_uncertainty_score":0.032927215},"labels":[],"label_agreement":null},{"id":"W1988729528","doi":"10.2202/1544-6115.1231","title":"Examining Protein Structure and Similarities by Spectral Analysis Technique","year":2006,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Fractal and DNA sequence analysis","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Envelope (radar); Phylogenetic tree; Similarity (geometry); Categorical variable; Pattern recognition (psychology); Covariance; Spectral envelope; Tree (set theory); Spectral analysis; Mathematics; Computer science; Artificial intelligence; Biological system; Algorithm; Computational biology; Biology; Physics; Statistics; Speech recognition; Genetics; Combinatorics; Gene","score_opus":0.0042200096214464414,"score_gpt":0.25289519485412526,"score_spread":0.2486751852326788,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1988729528","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54976916,0.0004774561,0.44255108,0.00012623548,0.0000319725,0.000094430936,0.00042651535,0.0007945109,0.0057287337],"genre_scores_gemma":[0.82227015,0.00017942445,0.17631641,0.000020246405,0.000023308248,0.00007130053,0.00038560195,0.00006485501,0.00066859194],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995055,0.00010988824,0.00003083681,0.000089626184,0.0002101233,0.000053941487],"domain_scores_gemma":[0.99824333,0.0008793358,0.0003163555,0.0001706208,0.0003300515,0.000060292627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0007473664,0.00020668107,0.00031592234,0.004740464,0.00039135883,0.0005822984,0.0002443495,0.00037023038,0.0020860715],"category_scores_gemma":[0.0036800313,0.00014446882,0.00036878945,0.003000345,0.0005550383,0.0010331352,0.00056700973,0.00043346517,0.00050970644],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006759603,0.00031524687,0.057303,0.00039005332,0.0002619982,0.0006655942,0.0018067214,0.03490857,0.41102552,0.04226445,0.0024525558,0.44793022],"study_design_scores_gemma":[0.00004868461,0.000487415,0.23242068,0.00007454612,0.00015684262,0.0028834343,0.0016030235,0.5964487,0.09042312,0.06399044,0.011313089,0.000150045],"about_ca_topic_score_codex":0.000516528,"about_ca_topic_score_gemma":0.0003754624,"teacher_disagreement_score":0.004740464,"about_ca_system_score_codex":0.000267849,"about_ca_system_score_gemma":0.00023147269,"threshold_uncertainty_score":0.006978631},"labels":[],"label_agreement":null},{"id":"W1992991918","doi":"10.2202/1544-6115.1322","title":"Calculating Confidence Intervals for Prediction Error in Microarray Classification Using Resampling","year":2008,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University","funders":"","keywords":"Confidence interval; Resampling; Statistics; Robust confidence intervals; Percentile; Confidence distribution; Coverage probability; Point estimation; Nominal level; CDF-based nonparametric confidence interval; Sample size determination; Mathematics; Credible interval; Inference; Computer science; Artificial intelligence","score_opus":0.05684221735365688,"score_gpt":0.3714190284896959,"score_spread":0.31457681113603897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1992991918","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026298044,0.001161393,0.97064644,0.00011791092,0.000070406684,0.00011678008,0.0001700385,0.0008514203,0.00056747114],"genre_scores_gemma":[0.4712835,0.00076012796,0.52444935,0.00022903964,0.00019325352,0.0007839227,0.0013555373,0.00046613533,0.00047912583],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95291066,0.031227792,0.0027453743,0.0040314076,0.008381799,0.00070300646],"domain_scores_gemma":[0.5319703,0.41391486,0.012410367,0.024160827,0.016702382,0.0008412565],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08362836,0.0014170854,0.0020389878,0.0055040047,0.0008492982,0.0022363556,0.003151893,0.002682122,0.0013788352],"category_scores_gemma":[0.38231915,0.0007054869,0.0018125855,0.0027528468,0.002313685,0.0026267774,0.002694801,0.0031888178,0.00047639594],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014944047,0.00025475892,0.035853103,0.0010588088,0.0018595728,0.00050147314,0.0009183807,0.47330132,0.007038925,0.072691426,0.004442998,0.40058482],"study_design_scores_gemma":[0.00009379521,0.00033402615,0.010995031,0.00033978964,0.0001770776,0.00040665732,0.00013959968,0.9263709,0.010035776,0.048478886,0.0024796794,0.00014880871],"about_ca_topic_score_codex":0.0021537605,"about_ca_topic_score_gemma":0.0010532361,"teacher_disagreement_score":0.08362836,"about_ca_system_score_codex":0.0010171153,"about_ca_system_score_gemma":0.0010158152,"threshold_uncertainty_score":0.44227433},"labels":[],"label_agreement":null},{"id":"W1994687716","doi":"10.2202/1544-6115.1140","title":"Continuous Covariates in Genetic Association Studies of Case-Parent Triads: Gene and Gene-Environment Interaction Effects, Population Stratification, and Power Analysis","year":2005,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation","funders":"","keywords":"Multinomial logistic regression; Covariate; Statistics; Population stratification; Categorical variable; Multinomial distribution; Logistic regression; Econometrics; Mathematics; Population; Inference; Multinomial probit; Missing data; Logistic model tree; Computer science; Biology; Genetics; Genotype; Demography; Artificial intelligence","score_opus":0.007811834463553979,"score_gpt":0.29568025228899264,"score_spread":0.28786841782543865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994687716","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021942507,0.0007263001,0.97602355,0.00041142662,0.00005067567,0.00016954848,0.0001430264,0.00016087393,0.00037213974],"genre_scores_gemma":[0.27708957,0.0008527832,0.71857697,0.00029764604,0.00022135708,0.0018549358,0.00033285012,0.00014657219,0.00062730664],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9380118,0.05547108,0.0013155531,0.0023424644,0.0025740545,0.00028496032],"domain_scores_gemma":[0.8863267,0.0978122,0.0065118666,0.0073112426,0.0014292578,0.00060884067],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.056429766,0.0010018675,0.0022860952,0.0023723622,0.0008433114,0.0015691409,0.0026009725,0.0020792107,0.0029395183],"category_scores_gemma":[0.16745129,0.0009450805,0.0015043977,0.0049212566,0.0024828024,0.002355157,0.0023503588,0.0018798941,0.00045979634],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024828566,0.00055123365,0.18463314,0.0022705484,0.0027190952,0.0032203086,0.0024740116,0.114766754,0.00954621,0.20758002,0.004469796,0.46528602],"study_design_scores_gemma":[0.000982468,0.002276697,0.076417245,0.00035499292,0.0007816114,0.0035308644,0.00031563727,0.45313215,0.0038436635,0.44470745,0.0133350305,0.0003222197],"about_ca_topic_score_codex":0.0008109234,"about_ca_topic_score_gemma":0.0010765448,"teacher_disagreement_score":0.056429766,"about_ca_system_score_codex":0.00048652594,"about_ca_system_score_gemma":0.001002832,"threshold_uncertainty_score":0.29843265},"labels":[],"label_agreement":null},{"id":"W2004846882","doi":"10.2202/1544-6115.1330","title":"Correcting the Estimated Level of Differential Expression for Gene Selection Bias: Application to a Microarray Study","year":2008,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Ranking (information retrieval); Statistics; Expression (computer science); Smoothing; Microarray analysis techniques; Mathematics; Gene; Biology; Gene expression; Computational biology; Computer science; Genetics; Artificial intelligence","score_opus":0.05901533924471216,"score_gpt":0.3565840099581038,"score_spread":0.29756867071339166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2004846882","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.052875787,0.0004699704,0.94415003,0.00040307376,0.00014228,0.00014130503,0.00009577649,0.0013780311,0.00034368623],"genre_scores_gemma":[0.24457623,0.0002885339,0.7535326,0.00031694738,0.00005423393,0.0002159163,0.0001491047,0.0002584986,0.00060799567],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98762506,0.008275056,0.00047844462,0.0014925625,0.0019217232,0.00020709986],"domain_scores_gemma":[0.894402,0.08650428,0.003279214,0.009906652,0.0055130417,0.0003947528],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0316827,0.0008798309,0.0015695594,0.0013328634,0.0011834387,0.0012020693,0.0014651283,0.0023995244,0.0010304099],"category_scores_gemma":[0.12315173,0.0005456156,0.0013470575,0.0026208786,0.0013402292,0.00079298404,0.000905252,0.0019649186,0.00039696478],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001307972,0.0004546865,0.061126366,0.0011434831,0.0013423772,0.0011462972,0.0015541612,0.18678445,0.18260723,0.014782632,0.0038719533,0.5438783],"study_design_scores_gemma":[0.00025070837,0.0007450518,0.047468357,0.00014212384,0.00041741953,0.0017826009,0.00021720956,0.8118899,0.09861002,0.029969487,0.008216598,0.0002904615],"about_ca_topic_score_codex":0.0033096313,"about_ca_topic_score_gemma":0.0032641212,"teacher_disagreement_score":0.0316827,"about_ca_system_score_codex":0.0010034895,"about_ca_system_score_gemma":0.0017597652,"threshold_uncertainty_score":0.1675561},"labels":[],"label_agreement":null},{"id":"W2005834841","doi":"10.1515/sagmb-2013-0023","title":"A data-smoothing approach to explore and test gene-environment interaction in case-parent trios","year":2014,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Mapping and Diversity in Plants and Animals","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Simon Fraser University","funders":"","keywords":"Trait; Smoothing; Statistical hypothesis testing; Gene–environment interaction; Gene; Computational biology; Econometrics; Computer science; Statistics; Genetics; Psychology; Biology; Mathematics","score_opus":0.04238394522881148,"score_gpt":0.3090808315913631,"score_spread":0.2666968863625516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005834841","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024751836,0.000068386726,0.973169,0.0001976678,0.00004120837,0.00026461142,0.00027750086,0.00088505796,0.00034469418],"genre_scores_gemma":[0.18915145,0.000063454514,0.80778664,0.00015306233,0.000036872927,0.0013242322,0.0007548562,0.00019025983,0.0005391834],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9717863,0.021362849,0.0013272251,0.0028614087,0.0023261947,0.00033605366],"domain_scores_gemma":[0.8623851,0.112808205,0.005494242,0.015567026,0.0027531453,0.0009922483],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041519314,0.0010797988,0.0014160238,0.003965207,0.0016228186,0.0014397523,0.0031180498,0.0025774683,0.005171729],"category_scores_gemma":[0.12829213,0.000703252,0.0030972813,0.0042068157,0.0024222247,0.0016226395,0.0023170786,0.0038173364,0.00056434784],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021086165,0.001191829,0.11464385,0.001017659,0.0046336134,0.0032302039,0.0048937835,0.13786606,0.027176034,0.12011499,0.00739602,0.5757273],"study_design_scores_gemma":[0.000366694,0.0012701717,0.03197633,0.000107085274,0.00053177215,0.0015084906,0.0007012521,0.7932445,0.008350224,0.15093915,0.010741387,0.00026289007],"about_ca_topic_score_codex":0.0024359005,"about_ca_topic_score_gemma":0.0028043853,"teacher_disagreement_score":0.041519314,"about_ca_system_score_codex":0.00081582495,"about_ca_system_score_gemma":0.0014857838,"threshold_uncertainty_score":0.21957773},"labels":[],"label_agreement":null},{"id":"W2010805470","doi":"10.1515/sagmb-2013-0066","title":"Robustness of the linear mixed effects model to error distribution assumptions and the consequences for genome-wide association studies","year":2014,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital","funders":"Medical Research Council; University of Bristol; Australian Government; Wellcome Trust","keywords":"Heteroscedasticity; Statistics; Random effects model; Type I and type II errors; Mixed model; Mathematics; Robustness (evolution); Linear model; Econometrics; Standard error; Genome-wide association study; Inference; Computer science; Genetics; Biology; Medicine; Single-nucleotide polymorphism; Artificial intelligence","score_opus":0.016383479548913643,"score_gpt":0.324614360187526,"score_spread":0.30823088063861237,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010805470","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014736906,0.0013954194,0.97652847,0.0035549812,0.00045276218,0.00047103554,0.00048305275,0.00049532973,0.0018821037],"genre_scores_gemma":[0.4565527,0.0020846287,0.524921,0.004903278,0.0009797036,0.0040679676,0.0016064012,0.00074669614,0.0041377055],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8075825,0.16311067,0.005784221,0.0144405775,0.0072486787,0.0018334656],"domain_scores_gemma":[0.35437292,0.596179,0.013746752,0.025649015,0.009106713,0.0009456816],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26179436,0.00214476,0.004740781,0.002646639,0.0024848483,0.005002116,0.0063845324,0.0054142745,0.004387724],"category_scores_gemma":[0.556852,0.0018856738,0.00553627,0.0035036153,0.007199321,0.0047644475,0.004531246,0.009669111,0.0010274544],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002873241,0.00025767466,0.050973315,0.001976613,0.006442223,0.0032470394,0.0037003134,0.38714162,0.0024725033,0.3871272,0.008923861,0.14486435],"study_design_scores_gemma":[0.00044348068,0.00060745963,0.012408532,0.00065103633,0.000992031,0.0009446464,0.0005812756,0.5288093,0.0016739677,0.44067398,0.0118969465,0.0003173527],"about_ca_topic_score_codex":0.01646433,"about_ca_topic_score_gemma":0.0061663524,"teacher_disagreement_score":0.7382057,"about_ca_system_score_codex":0.0032537854,"about_ca_system_score_gemma":0.0044929315,"threshold_uncertainty_score":0.910339},"labels":[],"label_agreement":null},{"id":"W2014699424","doi":"10.1515/sagmb-2012-0044","title":"Imputing genotypes using regularized generalized linear regression models","year":2014,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Guelph; University of Toronto","funders":"","keywords":"Imputation (statistics); Missing data; International HapMap Project; Computer science; Statistics; Data mining; Context (archaeology); Mathematics; Single-nucleotide polymorphism; Genotype; Biology; Genetics","score_opus":0.013541119235238236,"score_gpt":0.30505275334210674,"score_spread":0.29151163410686853,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2014699424","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011996769,0.00016298583,0.98634434,0.0001876027,0.000023386385,0.00004541146,0.00026368967,0.00077531685,0.00020038348],"genre_scores_gemma":[0.3091634,0.00056053285,0.68217444,0.0003601513,0.00015574464,0.00041557022,0.0030169652,0.00043965486,0.003713572],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9920087,0.006170315,0.00020749205,0.0008834974,0.0004840811,0.0002459219],"domain_scores_gemma":[0.9854983,0.011110802,0.0009704614,0.0013833322,0.00087753095,0.00015940932],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011208372,0.0012974803,0.002056113,0.00139629,0.00047371545,0.0012889857,0.0032633257,0.0016900742,0.0018898597],"category_scores_gemma":[0.022155605,0.00089590455,0.0027479553,0.0022370706,0.00085868785,0.0014399696,0.0013340767,0.0023123876,0.001044692],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003089388,0.00009310651,0.003088703,0.00009924757,0.00036433784,0.00028173198,0.0001246559,0.9114248,0.0007677516,0.011468264,0.002506963,0.06947155],"study_design_scores_gemma":[0.000021606858,0.000023194709,0.0002466815,0.000005884709,0.000017738435,0.00003304978,0.0000066642315,0.9923246,0.00016650556,0.0067257304,0.0004148988,0.0000134590755],"about_ca_topic_score_codex":0.009587359,"about_ca_topic_score_gemma":0.007892892,"teacher_disagreement_score":0.011208372,"about_ca_system_score_codex":0.00071412843,"about_ca_system_score_gemma":0.0017931618,"threshold_uncertainty_score":0.059276223},"labels":[],"label_agreement":null},{"id":"W2038019245","doi":"10.2202/1544-6115.1713","title":"A Family-Based Probabilistic Method for Capturing De Novo Mutations from High-Throughput Short-Read Sequencing Data","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genomics and Rare Diseases","field":"Biochemistry, Genetics and Molecular Biology","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Polytechnique Montréal","funders":"National Institute of General Medical Sciences; National Institutes of Health","keywords":"Genetics; DNA sequencing; Biology; Selection (genetic algorithm); Mendelian inheritance; Mutation rate; Mutation; Computational biology; Genome; Population; Human genome; Throughput; Genomics; Computer science; Gene; Artificial intelligence","score_opus":0.03463663899362284,"score_gpt":0.35826484661819835,"score_spread":0.3236282076245755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2038019245","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028351457,0.000068841655,0.9963643,0.000031823514,0.000009276836,0.000018849936,0.00013017116,0.000437233,0.00010437923],"genre_scores_gemma":[0.09466188,0.0002291163,0.9022762,0.000088428955,0.000055963683,0.00021527856,0.0010849261,0.00021810638,0.0011699923],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984913,0.0005598045,0.00010241895,0.0003838801,0.00040215327,0.000060457907],"domain_scores_gemma":[0.9936054,0.0043001203,0.0006439332,0.0006862627,0.0006148809,0.00014951611],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041861283,0.0008061896,0.0007723612,0.00227295,0.00085558434,0.0008501958,0.0017826342,0.001052172,0.0017858241],"category_scores_gemma":[0.012214534,0.0006808618,0.0012944882,0.0021151155,0.0006348735,0.0012360351,0.00096319313,0.0013284391,0.00073496636],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031967164,0.00012792232,0.018043349,0.00027103737,0.0005409951,0.0006610082,0.00037174358,0.5490958,0.01723947,0.034677137,0.0053642145,0.37328762],"study_design_scores_gemma":[0.0000121850035,0.000024907331,0.001672523,0.000011628928,0.000030978055,0.00028591728,0.000012756445,0.9818216,0.0015972474,0.011857674,0.0026343714,0.000038281472],"about_ca_topic_score_codex":0.008674677,"about_ca_topic_score_gemma":0.01272299,"teacher_disagreement_score":0.008674677,"about_ca_system_score_codex":0.00076598104,"about_ca_system_score_gemma":0.002058106,"threshold_uncertainty_score":0.022138596},"labels":[],"label_agreement":null},{"id":"W2047329948","doi":"10.2202/1544-6115.1641","title":"Linear Combination Test for Hierarchical Gene Set Analysis","year":2011,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Estimator; Covariance matrix; Set (abstract data type); Covariance; Computer science; Computational biology; Test statistic; Algorithm; Mathematics; Statistical hypothesis testing; Biology; Statistics","score_opus":0.020301324429671502,"score_gpt":0.32386893084780605,"score_spread":0.3035676064181345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047329948","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050316967,0.00045987993,0.93952006,0.00061862095,0.0003416635,0.0011171715,0.0017159303,0.002556309,0.0033533785],"genre_scores_gemma":[0.58200586,0.00013687725,0.40779176,0.00060817366,0.00035826478,0.00328622,0.0030157599,0.00043202328,0.00236494],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9500344,0.033234246,0.0014543724,0.007905782,0.0060816566,0.0012894731],"domain_scores_gemma":[0.897972,0.08635242,0.003418812,0.0065216175,0.004376745,0.0013584915],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021536408,0.0015386876,0.003486135,0.0045019304,0.0022623602,0.0016033723,0.0041106828,0.0018836978,0.014944516],"category_scores_gemma":[0.10914958,0.00063143903,0.0040116897,0.004827909,0.0026827636,0.0024319608,0.0024469935,0.0045795515,0.0020411888],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0053297016,0.0012103489,0.07451677,0.0016089679,0.005903601,0.0023404327,0.001036732,0.14230959,0.011506113,0.08276653,0.02698297,0.6444883],"study_design_scores_gemma":[0.0004641889,0.0024179525,0.022189744,0.00008848957,0.00057717145,0.00063122576,0.00029722808,0.8822837,0.004593133,0.080735475,0.005519223,0.00020241446],"about_ca_topic_score_codex":0.0030738001,"about_ca_topic_score_gemma":0.002033308,"teacher_disagreement_score":0.021536408,"about_ca_system_score_codex":0.0017835983,"about_ca_system_score_gemma":0.0032614633,"threshold_uncertainty_score":0.11389679},"labels":[],"label_agreement":null},{"id":"W2056036270","doi":"10.2202/1544-6115.1759","title":"Special Issue on Computational Statistical Methods for Genomics and Systems Biology","year":2012,"lang":"en","type":"editorial","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Genomics; Computational genomics; Systems biology; Computational biology; Genome Biology; Biology; Statistical analysis; Data science; Computer science; Genome; Genetics; Mathematics; Statistics","score_opus":0.014237265647260806,"score_gpt":0.38634272780498746,"score_spread":0.37210546215772666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056036270","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024153462,0.009614413,0.001096001,0.02096541,0.96509624,0.000025306334,0.00018015345,0.00014101973,0.0028573822],"genre_scores_gemma":[0.00032426065,0.0051549193,0.000576155,0.0078460835,0.9719068,0.000047297883,0.00012716687,0.00019109534,0.013826317],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9926535,0.0015863454,0.00083213416,0.00092676515,0.0036687288,0.00033256397],"domain_scores_gemma":[0.9608137,0.018812992,0.001927185,0.0012020109,0.013457109,0.0037870633],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00993602,0.003294144,0.0042169313,0.005013782,0.0021124512,0.0068320134,0.002671119,0.005934925,0.03702068],"category_scores_gemma":[0.028677335,0.0009780043,0.0023600357,0.0024121534,0.002260798,0.0039809784,0.0015741093,0.014312839,0.023852175],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018044711,0.0000074584646,0.000014985479,0.00016031973,0.000014211392,0.000023819155,0.000005934249,0.000031074953,0.000048238737,0.00053566863,0.99393696,0.005203445],"study_design_scores_gemma":[0.00003242139,0.000016000617,0.00019607946,0.00028639552,0.00003074247,0.000136745,0.000011551595,0.0002651766,0.00008845642,0.0025876136,0.9963348,0.0000139478425],"about_ca_topic_score_codex":0.0010496835,"about_ca_topic_score_gemma":0.0033253853,"teacher_disagreement_score":0.03702068,"about_ca_system_score_codex":0.0025856344,"about_ca_system_score_gemma":0.0033560824,"threshold_uncertainty_score":0.12384653},"labels":[],"label_agreement":null},{"id":"W2056379515","doi":"10.2202/1544-6115.1714","title":"Adjusting for Spurious Gene-by-Environment Interaction Using Case-Parent Triads","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Simon Fraser University","funders":"Canadian Institutes of Health Research","keywords":"Spurious relationship; Locus (genetics); Sibling; Gene–environment interaction; Population stratification; Population; Econometrics; Genetics; Genotype; Statistics; Computer science; Psychology; Biology; Gene; Developmental psychology; Mathematics; Medicine; Environmental health; Single-nucleotide polymorphism","score_opus":0.026975429280990868,"score_gpt":0.3507347520915877,"score_spread":0.32375932281059683,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056379515","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07368924,0.0007466068,0.9159627,0.0010048044,0.0007628135,0.0027516244,0.0024817071,0.001372502,0.0012279403],"genre_scores_gemma":[0.2901057,0.00049929915,0.6860237,0.001105657,0.00029456755,0.013638551,0.0047331993,0.00053332833,0.003065958],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8652086,0.11550169,0.004540042,0.009673828,0.0039625205,0.0011132007],"domain_scores_gemma":[0.8803722,0.065587915,0.010417722,0.038747944,0.0036842062,0.0011900266],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09836345,0.0022937101,0.0035699336,0.002349394,0.002363043,0.0021415998,0.004750159,0.0030836714,0.009428288],"category_scores_gemma":[0.18119422,0.0018182894,0.004838829,0.0051294123,0.0015759359,0.0021673061,0.0036233792,0.0034250112,0.0016824004],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011071425,0.0026081423,0.4395679,0.0026553015,0.018194707,0.006641018,0.007303093,0.039367393,0.012091688,0.07062665,0.03321377,0.35665888],"study_design_scores_gemma":[0.008652232,0.012027105,0.21457443,0.0009950621,0.018120902,0.00885225,0.001981152,0.2877638,0.019994993,0.331182,0.09498555,0.0008705393],"about_ca_topic_score_codex":0.0053540496,"about_ca_topic_score_gemma":0.007627715,"teacher_disagreement_score":0.09836345,"about_ca_system_score_codex":0.001002659,"about_ca_system_score_gemma":0.0025538318,"threshold_uncertainty_score":0.52020186},"labels":[],"label_agreement":null},{"id":"W2068181458","doi":"10.1515/sagmb-2012-0070","title":"A novel method for analyzing genetic association with longitudinal phenotypes","year":2013,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Biological Sciences","funders":"National Institute of General Medical Sciences; National Institute on Drug Abuse; National Institutes of Health; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Innovative Research Group Project of the National Natural Science Foundation of China","keywords":"Framingham Heart Study; SNP; Genetic association; Statistical power; Trait; Bayesian probability; False discovery rate; Genome-wide association study; Replicate; Statistics; Statistical hypothesis testing; Quantitative trait locus; Biology; Disease; Computational biology; Genetics; Computer science; Single-nucleotide polymorphism; Genotype; Framingham Risk Score; Mathematics; Gene; Medicine; Internal medicine","score_opus":0.010934520757845833,"score_gpt":0.3158189965437446,"score_spread":0.3048844757858988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068181458","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003283494,0.00006103222,0.9957573,0.000069358175,0.000031668325,0.00008887286,0.00016210803,0.000327059,0.00021915986],"genre_scores_gemma":[0.08853062,0.00014994248,0.90812564,0.00014703463,0.00010214809,0.0010377822,0.0006393395,0.00021496978,0.0010525176],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9913703,0.0051570674,0.00048649134,0.0015132644,0.0013287796,0.00014395107],"domain_scores_gemma":[0.9514897,0.03855174,0.002245945,0.005232242,0.0021086668,0.00037162527],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015051809,0.0009951679,0.0012388971,0.0036650945,0.00092854886,0.0012049881,0.0017725781,0.0011362529,0.003716712],"category_scores_gemma":[0.06999475,0.00066837866,0.0019140954,0.0029275322,0.0012528909,0.0015002713,0.0016542186,0.0023372287,0.00084747566],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006176301,0.00035683598,0.07468498,0.0006387252,0.002348819,0.0006570849,0.0009804146,0.08149578,0.014309325,0.09317081,0.009203624,0.721536],"study_design_scores_gemma":[0.00030157782,0.00043149243,0.02118988,0.00012570123,0.00045575947,0.0018707524,0.00012145585,0.7900873,0.0057931608,0.16097766,0.018442502,0.00020270856],"about_ca_topic_score_codex":0.00329346,"about_ca_topic_score_gemma":0.0025283596,"teacher_disagreement_score":0.015051809,"about_ca_system_score_codex":0.00050658133,"about_ca_system_score_gemma":0.00177326,"threshold_uncertainty_score":0.07960254},"labels":[],"label_agreement":null},{"id":"W2070009349","doi":"10.1515/sagmb-2013-0003","title":"Simple estimators of false discovery rates given as few as one or two p-values without strong parametric assumptions","year":2013,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Estimator; False discovery rate; Prior probability; Nonparametric statistics; Parametric statistics; Bayes' theorem; Generality; Simple (philosophy)","score_opus":0.1952700356856978,"score_gpt":0.5447426637159445,"score_spread":0.3494726280302467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070009349","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026831387,0.0015905775,0.99314606,0.00022740057,0.00017400323,0.00024166137,0.00025076885,0.00075756107,0.00092891604],"genre_scores_gemma":[0.14018658,0.0022033579,0.84985113,0.0007521314,0.00060229993,0.0037905227,0.0007537586,0.00055638835,0.0013037599],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9374128,0.041687835,0.00408425,0.007558602,0.008557466,0.0006990357],"domain_scores_gemma":[0.692917,0.2578443,0.019346058,0.023597702,0.0056026606,0.0006923026],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.090360366,0.0035326048,0.0041784467,0.005930094,0.00097264635,0.0032410442,0.005931182,0.0041714506,0.00480348],"category_scores_gemma":[0.34546018,0.0011009874,0.003128832,0.0047043273,0.005710622,0.0053558433,0.0039031326,0.005751048,0.0019399436],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015998514,0.0004382416,0.014907755,0.007193076,0.004173699,0.0010676825,0.0011824747,0.038225938,0.015421208,0.27692667,0.011793781,0.62706953],"study_design_scores_gemma":[0.0007017669,0.0014101268,0.018159023,0.0022514127,0.0017432696,0.0038308853,0.00047260275,0.13550645,0.039799623,0.7621148,0.03338459,0.00062535965],"about_ca_topic_score_codex":0.00036790737,"about_ca_topic_score_gemma":0.0003711911,"teacher_disagreement_score":0.90963966,"about_ca_system_score_codex":0.0015908821,"about_ca_system_score_gemma":0.0023533616,"threshold_uncertainty_score":0.47787702},"labels":[],"label_agreement":null},{"id":"W2090537645","doi":"10.2202/1544-6115.1436","title":"A Bayesian Analysis Strategy for Cross-Study Translation of Gene Expression Biomarkers","year":2009,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Booth University College","funders":"National Cancer Institute","keywords":"Computational biology; Multivariate statistics; Gene expression profiling; Bayesian probability; Computer science; Biology; Bioinformatics; Gene expression; Data mining; Gene; Artificial intelligence; Machine learning; Genetics","score_opus":0.016680353521724214,"score_gpt":0.35851177622644487,"score_spread":0.34183142270472067,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2090537645","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006535786,0.000096771844,0.9985783,0.000112056754,0.000022186487,0.00006071655,0.000071338894,0.00017471539,0.00023033067],"genre_scores_gemma":[0.080791205,0.0004657247,0.9127375,0.0005552341,0.00025772562,0.0017569478,0.0009993032,0.00053043716,0.0019058752],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9833989,0.011854827,0.0007350205,0.0020301265,0.0016810817,0.00030000508],"domain_scores_gemma":[0.95158195,0.03621903,0.0024711252,0.0056590573,0.0034124008,0.00065644365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034892686,0.0019379412,0.0024713343,0.0037768,0.0014078625,0.002719781,0.002994867,0.0019696315,0.0074706646],"category_scores_gemma":[0.09201027,0.0017060034,0.003217423,0.0033381046,0.0016162721,0.001730723,0.0033963253,0.003825314,0.001919125],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006930917,0.00034035422,0.009461475,0.0007113648,0.002504847,0.0010442906,0.00062617863,0.12738451,0.012495034,0.26399255,0.009133821,0.5716125],"study_design_scores_gemma":[0.00017641901,0.00032898187,0.0031542513,0.000116017174,0.00052803016,0.00035886894,0.00007842287,0.58585936,0.004091041,0.39085168,0.014330893,0.00012605716],"about_ca_topic_score_codex":0.004939351,"about_ca_topic_score_gemma":0.0048935865,"teacher_disagreement_score":0.034892686,"about_ca_system_score_codex":0.001672583,"about_ca_system_score_gemma":0.0036629704,"threshold_uncertainty_score":0.1845324},"labels":[],"label_agreement":null},{"id":"W2140183618","doi":"10.2202/1544-6115.1569","title":"Information Metrics in Genetic Epidemiology","year":2011,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Multiple Sclerosis Society; National Multiple Sclerosis Society; Mitacs; U.S. Department of Defense; National Institutes of Health; National Science Foundation","keywords":"Computer science; Probabilistic logic; Context (archaeology); Relation (database); Interpretation (philosophy); Contrast (vision); Multinomial distribution; Genetic epidemiology; Data mining; Data science; Machine learning; Artificial intelligence; Econometrics; Mathematics; Biology; Genetics; Gene","score_opus":0.02503040580955535,"score_gpt":0.3209507100143086,"score_spread":0.29592030420475324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140183618","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015328873,0.023538856,0.94360095,0.0052822637,0.00042230653,0.00008692344,0.000559564,0.00014937118,0.011030791],"genre_scores_gemma":[0.5657218,0.027314343,0.3935802,0.0017969059,0.0033886975,0.0006605951,0.0011198705,0.00019570855,0.0062219477],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9895878,0.0070234137,0.00056746026,0.0009606223,0.0015515579,0.0003092575],"domain_scores_gemma":[0.961819,0.029468615,0.002430957,0.0025208788,0.0029265569,0.00083403324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012124047,0.0015176198,0.001861566,0.007228054,0.0012590165,0.0045086453,0.0013537148,0.0024493705,0.0016817134],"category_scores_gemma":[0.038938224,0.0005776561,0.0014092099,0.005643471,0.005836205,0.0076506515,0.0030912021,0.0031335796,0.00041800019],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000081514745,0.0000069395087,0.00061334646,0.000095207506,0.000041078565,0.000038605864,0.00011924956,0.011869893,0.00014888054,0.97115886,0.0014442359,0.014455622],"study_design_scores_gemma":[0.0000028364836,0.000015711343,0.00029532958,0.00003792984,0.000011353316,0.000059711692,0.000025508738,0.02066317,0.000066550725,0.97528154,0.0035239984,0.00001632402],"about_ca_topic_score_codex":0.0014588992,"about_ca_topic_score_gemma":0.0007994186,"teacher_disagreement_score":0.012124047,"about_ca_system_score_codex":0.003299818,"about_ca_system_score_gemma":0.0014344908,"threshold_uncertainty_score":0.06411886},"labels":[],"label_agreement":null},{"id":"W2197585008","doi":"10.1515/1544-6115.1760","title":"An Integrated Hierarchical Bayesian Model for Multivariate eQTL Mapping","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Mapping and Diversity in Plants and Animals","field":"Biochemistry, Genetics and Molecular Biology","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Clinical Research Institute","funders":"National Human Genome Research Institute; Canadian Institutes of Health Research","keywords":"Multivariate statistics; Bayesian probability; Computer science; Bayesian hierarchical modeling; Artificial intelligence; Multivariate analysis; Data mining; Mathematics; Statistics; Machine learning; Bayesian inference","score_opus":0.018681557394560094,"score_gpt":0.3105318896602877,"score_spread":0.29185033226572765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2197585008","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009061119,0.00040812872,0.98714393,0.0006136091,0.000042301486,0.000065390734,0.0006952717,0.00033094623,0.0016392882],"genre_scores_gemma":[0.47737864,0.0017818625,0.49391553,0.0010847637,0.00029907216,0.0012560454,0.0036400848,0.00043389123,0.02021004],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99736685,0.001265108,0.00009979498,0.00062404416,0.00039448685,0.00024976232],"domain_scores_gemma":[0.99468565,0.0040222285,0.00035776984,0.00022855337,0.00054284296,0.00016292992],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006214371,0.0014332435,0.0021906705,0.0015825229,0.0008225223,0.001712538,0.0044319173,0.0024629356,0.0066284724],"category_scores_gemma":[0.012150752,0.001104977,0.0021783889,0.002275286,0.0019420848,0.002273067,0.0020103517,0.0029592928,0.0013690667],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015390874,0.00006890488,0.0028959496,0.00013453148,0.0002014469,0.00024533778,0.00024864366,0.7539743,0.0011254058,0.20315269,0.003660778,0.034138203],"study_design_scores_gemma":[0.000036440513,0.000015566911,0.0003955471,0.0000111853105,0.0000309746,0.000033449294,0.000012164962,0.9460907,0.00008765156,0.052006558,0.0012564624,0.000023303895],"about_ca_topic_score_codex":0.025436336,"about_ca_topic_score_gemma":0.024315858,"teacher_disagreement_score":0.025436336,"about_ca_system_score_codex":0.0020844373,"about_ca_system_score_gemma":0.0020879207,"threshold_uncertainty_score":0.050576568},"labels":[],"label_agreement":null},{"id":"W2200221635","doi":"10.2202/1544-6115.1620","title":"A Robust Statistical Method to Detect Null Alleles in Microsatellite and SNP Datasets in Both Panmictic and Inbred Populations","year":2011,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Inbreeding; Biology; Panmixia; Null allele; Genetics; Allele; Null (SQL); Population; Microsatellite; Statistics; Mathematics; Computer science; Data mining; Gene","score_opus":0.04170293006541853,"score_gpt":0.33296973950270214,"score_spread":0.2912668094372836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2200221635","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00464007,0.000049986927,0.9929142,0.000040146093,0.000026683578,0.00005906938,0.0002013365,0.0019660785,0.0001023784],"genre_scores_gemma":[0.06986977,0.00006039985,0.92733186,0.00009632466,0.00005441108,0.0006492163,0.0008819675,0.00048139054,0.0005746904],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99181646,0.0036994163,0.0006984801,0.0021233286,0.0014824932,0.00017975167],"domain_scores_gemma":[0.9607277,0.027361559,0.0036876213,0.0053307367,0.0024487702,0.00044362072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01451573,0.0012442512,0.0015911199,0.0033598356,0.00068995275,0.0013783613,0.002242931,0.0015799775,0.0026021753],"category_scores_gemma":[0.050648108,0.00083226344,0.0021818879,0.0021510883,0.0013783133,0.0010539126,0.0015218657,0.0025101749,0.001170874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080545375,0.00029923822,0.030791538,0.000819418,0.003348179,0.0010989442,0.00044281097,0.07155575,0.060138367,0.021616377,0.010382427,0.7987016],"study_design_scores_gemma":[0.0003516357,0.000743393,0.029317448,0.00010351784,0.00064674654,0.002496109,0.0001341501,0.8744863,0.041618265,0.032444954,0.01732317,0.0003343372],"about_ca_topic_score_codex":0.0012475799,"about_ca_topic_score_gemma":0.0016649434,"teacher_disagreement_score":0.01451573,"about_ca_system_score_codex":0.00046657267,"about_ca_system_score_gemma":0.0013785365,"threshold_uncertainty_score":0.076767445},"labels":[],"label_agreement":null},{"id":"W2204121744","doi":"10.2202/1544-6115.1626","title":"Large Sample Approximations of Probabilities of Correct Evolutionary Tree Estimation and Biases of Maximum Likelihood Estimation","year":2011,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Mathematics; Tree (set theory); Sequence (biology); Statistics; Algorithm; Maximum likelihood; Combinatorics","score_opus":0.01604528567905189,"score_gpt":0.27348485234130654,"score_spread":0.25743956666225465,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2204121744","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08521578,0.0012770584,0.9087256,0.0008343018,0.00007715622,0.000082713246,0.0001653332,0.00045451484,0.0031674954],"genre_scores_gemma":[0.7699858,0.0010734239,0.22453664,0.0005511639,0.00019542775,0.00044743888,0.00075718656,0.00043144295,0.0020214722],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9855033,0.00914065,0.00074187585,0.0020123704,0.0020902285,0.0005116132],"domain_scores_gemma":[0.66598684,0.301533,0.011002677,0.015185704,0.005401813,0.00088987406],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03906464,0.00091598765,0.0016330882,0.002741144,0.0008167104,0.0029508895,0.002931733,0.0022571513,0.002511939],"category_scores_gemma":[0.33710942,0.0011150175,0.0013672229,0.0018713786,0.004129526,0.0057573854,0.0031684225,0.003582014,0.0006064409],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003356513,0.00006821655,0.027243521,0.00046752449,0.00030273045,0.0003821206,0.0008281768,0.6543165,0.0019015234,0.26521844,0.0016850082,0.047250565],"study_design_scores_gemma":[0.00002802626,0.00005023368,0.0031853162,0.00013575154,0.000033540935,0.00024413128,0.0000869604,0.82335925,0.0012283907,0.17030564,0.0012888841,0.00005390799],"about_ca_topic_score_codex":0.002726376,"about_ca_topic_score_gemma":0.001922372,"teacher_disagreement_score":0.03906464,"about_ca_system_score_codex":0.0022445996,"about_ca_system_score_gemma":0.0012053967,"threshold_uncertainty_score":0.20659596},"labels":[],"label_agreement":null},{"id":"W2206438750","doi":"10.2202/1544-6115.1270","title":"Case-Control Inference of Interaction between Genetic and Nongenetic Risk Factors under Assumptions on Their Distribution","year":2007,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Inference; Estimator; Statistical inference; Econometrics; Logistic regression; Conditional independence; Covariate; Independence (probability theory); Statistics; Genetic model; Mathematics; Computer science; Artificial intelligence; Biology","score_opus":0.01723949161786159,"score_gpt":0.32697539084434335,"score_spread":0.30973589922648176,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2206438750","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01952181,0.00033631356,0.9778721,0.0003373579,0.00008396822,0.0001846673,0.0002586652,0.00022718016,0.0011779732],"genre_scores_gemma":[0.5521528,0.0010284648,0.43854958,0.0010528637,0.0003037102,0.0016870296,0.0017321571,0.00017984172,0.0033135405],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9552237,0.029241117,0.002456626,0.00819251,0.0039512436,0.0009347818],"domain_scores_gemma":[0.787126,0.18508361,0.006459721,0.017678587,0.0028815945,0.00077041035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.098722406,0.0013278289,0.0036858052,0.0028034826,0.0013462886,0.0027669207,0.0054772273,0.003270936,0.008101815],"category_scores_gemma":[0.30515724,0.0014528206,0.0030652215,0.0026109584,0.004333742,0.004368745,0.003071758,0.0033519175,0.0008684182],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016093104,0.00064697064,0.060267463,0.0004972078,0.0021012619,0.002376109,0.0010590291,0.12068244,0.002343405,0.6727201,0.0040383297,0.13165843],"study_design_scores_gemma":[0.0005451398,0.00026198957,0.009226365,0.00014237865,0.00053256185,0.0010015616,0.00011890079,0.4606681,0.0019146036,0.52228296,0.003216943,0.00008840769],"about_ca_topic_score_codex":0.0038841018,"about_ca_topic_score_gemma":0.0020333505,"teacher_disagreement_score":0.098722406,"about_ca_system_score_codex":0.0013235252,"about_ca_system_score_gemma":0.0020986414,"threshold_uncertainty_score":0.5221002},"labels":[],"label_agreement":null},{"id":"W2237023490","doi":"10.2202/1544-6115.1417","title":"A Multivariate Growth Curve Model for Ranking Genes in Replicated Time Course Microarray Data","year":2009,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Multivariate statistics; Ranking (information retrieval); Time point; Inference; Computer science; Statistics; Expression (computer science); Mathematics; Data mining; Artificial intelligence","score_opus":0.023125501762366774,"score_gpt":0.34872595219207553,"score_spread":0.32560045042970875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2237023490","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029632863,0.00020714935,0.968055,0.00031893558,0.000029061452,0.00012577994,0.00054286356,0.0007003383,0.00038810106],"genre_scores_gemma":[0.5006599,0.0007591663,0.48293662,0.00035430747,0.00015272385,0.0016883151,0.0042481855,0.0004933198,0.00870748],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9939366,0.0029808255,0.0002503987,0.0012187775,0.0011810635,0.00043242535],"domain_scores_gemma":[0.97778803,0.014934452,0.0024886874,0.002051974,0.0022380496,0.00049877045],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014874097,0.0015460248,0.0026110774,0.0025807545,0.0006351807,0.0015096881,0.0034311395,0.0020393392,0.0024180582],"category_scores_gemma":[0.03192893,0.00073011324,0.0025739279,0.003548737,0.0017960363,0.0024338842,0.0012520022,0.0033159682,0.0014536371],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008920149,0.000213336,0.009985759,0.00019767269,0.00026663998,0.00030537936,0.00028011348,0.8263787,0.012300324,0.050301574,0.0027004343,0.096178114],"study_design_scores_gemma":[0.000026702266,0.000082212304,0.0017449585,0.0000072557186,0.00002359876,0.000050150808,0.000016035752,0.9838935,0.0010379817,0.012406539,0.000672437,0.00003857894],"about_ca_topic_score_codex":0.0076963096,"about_ca_topic_score_gemma":0.0055808965,"teacher_disagreement_score":0.014874097,"about_ca_system_score_codex":0.0023709892,"about_ca_system_score_gemma":0.0018067257,"threshold_uncertainty_score":0.07866269},"labels":[],"label_agreement":null},{"id":"W2265464824","doi":"10.1515/1544-6115.1818","title":"An Order Estimation Based Approach to Identify Response Genes for Microarray Time Course Data","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Gene; Context (archaeology); Microarray analysis techniques; Biology; Microarray; Computational biology; DNA microarray; Gene regulatory network; Genetics; Genome; Gene expression","score_opus":0.024981340043627853,"score_gpt":0.3885976204653775,"score_spread":0.36361628042174965,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2265464824","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004541771,0.00020594445,0.9939203,0.00006245566,0.000022656925,0.00007417656,0.00022386335,0.0007584178,0.0001904742],"genre_scores_gemma":[0.11993738,0.00053929,0.87278724,0.00017254637,0.00014048767,0.00073397416,0.0023081386,0.00041188265,0.0029690557],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99787915,0.00070427504,0.00016894519,0.0006100811,0.00044812277,0.00018946837],"domain_scores_gemma":[0.9934447,0.0051234183,0.0004441872,0.00039046782,0.00048362507,0.000113521804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029206658,0.0016602458,0.0018976668,0.0025950996,0.0006139468,0.0011654622,0.0015875719,0.001739886,0.002696184],"category_scores_gemma":[0.0075272694,0.001087762,0.0025790415,0.0019373944,0.00068776886,0.000902166,0.0008601074,0.0028401683,0.0019761682],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009613837,0.0005592947,0.009776699,0.0008568947,0.00050565205,0.00041848907,0.0004853697,0.38208124,0.0696906,0.018560266,0.0035308453,0.51257324],"study_design_scores_gemma":[0.000026660508,0.00010153045,0.002364625,0.000022507724,0.000066903165,0.00007609865,0.000032596487,0.9755917,0.005554432,0.014091463,0.0020236175,0.000047684305],"about_ca_topic_score_codex":0.00599344,"about_ca_topic_score_gemma":0.0058077583,"teacher_disagreement_score":0.00599344,"about_ca_system_score_codex":0.0013382947,"about_ca_system_score_gemma":0.0016838273,"threshold_uncertainty_score":0.015446186},"labels":[],"label_agreement":null},{"id":"W2292733224","doi":"10.1515/sagmb-2014-0098","title":"Using informative Multinomial-Dirichlet prior in a t-mixture with reversible jump estimation of nucleosome positions for genome-wide profiling","year":2015,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Canadian Institutes of Health Research","keywords":"Multinomial distribution; Dirichlet distribution; Profiling (computer programming); Jump; Mathematics; Genome; Mixture model; Statistics; Computational biology; Biology; Econometrics; Computer science; Statistical physics; Genetics; Physics","score_opus":0.023026727306635755,"score_gpt":0.33038312067648096,"score_spread":0.3073563933698452,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2292733224","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009979288,0.00016085237,0.9889796,0.00012012983,0.00002214858,0.000038371567,0.00007400575,0.0003622518,0.000263391],"genre_scores_gemma":[0.24072862,0.00062756665,0.7524839,0.00027325793,0.00012071006,0.0005287875,0.0010839022,0.00042398073,0.003729277],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984829,0.0008236195,0.00005882604,0.00030640696,0.00021994824,0.000108378066],"domain_scores_gemma":[0.99495184,0.004162298,0.00022384193,0.00029916587,0.00022613302,0.0001367173],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046066,0.0007982019,0.0016187532,0.0018080325,0.0010753528,0.0013182736,0.0027570245,0.0020574694,0.003126911],"category_scores_gemma":[0.011485031,0.0010435788,0.0023527616,0.0017147625,0.0015040403,0.0022006838,0.0016511328,0.002981784,0.0011130638],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062960153,0.00021559173,0.004502321,0.0002337817,0.00023255558,0.00025180433,0.0003888214,0.76424414,0.007848205,0.101661585,0.002417649,0.11737392],"study_design_scores_gemma":[0.000019300473,0.000010456014,0.00022963209,0.000008460709,0.000014236801,0.000027335946,0.000010243378,0.98179907,0.0007382621,0.01663076,0.0004905702,0.000021752816],"about_ca_topic_score_codex":0.012398022,"about_ca_topic_score_gemma":0.01493303,"teacher_disagreement_score":0.012398022,"about_ca_system_score_codex":0.0014433545,"about_ca_system_score_gemma":0.0016020904,"threshold_uncertainty_score":0.024651766},"labels":[],"label_agreement":null},{"id":"W2322448335","doi":"10.1515/sagmb-2015-0056","title":"On the validity of within-nuclear-family genetic association analysis in samples of extended families","year":2015,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Canadian Institutes of Health Research","keywords":"Nuclear family; Estimator; Inference; Statistics; Logistic regression; Variance (accounting); Econometrics; Linkage (software); Mathematics; Genetics; Biology; Computer science; Artificial intelligence; Gene","score_opus":0.024373241857033618,"score_gpt":0.3070305004537845,"score_spread":0.2826572585967509,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2322448335","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40788203,0.0029933492,0.57684815,0.0038292839,0.0005795652,0.00045379298,0.0007596826,0.00044348807,0.0062106946],"genre_scores_gemma":[0.9178026,0.000555476,0.07806695,0.0010059819,0.0002892446,0.00039210482,0.0009731918,0.00021264867,0.00070177705],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7484643,0.21783487,0.0057686227,0.017370114,0.008866998,0.0016950979],"domain_scores_gemma":[0.20423932,0.7209378,0.010059377,0.056431547,0.0066744867,0.0016574695],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.28885475,0.0010153024,0.0029503256,0.002422076,0.0029567697,0.0038718435,0.0051711397,0.0026199315,0.002399778],"category_scores_gemma":[0.6198964,0.0008991358,0.0035995133,0.0031701655,0.012779374,0.0053961715,0.0048635867,0.0036582244,0.0006315699],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0042814543,0.00031777145,0.69506145,0.0010851509,0.0078026983,0.0028179088,0.0049609877,0.08520418,0.00275204,0.08760668,0.0033809328,0.10472876],"study_design_scores_gemma":[0.0009976458,0.0019635211,0.19627039,0.0011671617,0.0030280943,0.0035625966,0.0029595008,0.513397,0.0042174933,0.26305056,0.009094924,0.00029112888],"about_ca_topic_score_codex":0.0052780835,"about_ca_topic_score_gemma":0.0032927855,"teacher_disagreement_score":0.28885475,"about_ca_system_score_codex":0.00091170985,"about_ca_system_score_gemma":0.0024809854,"threshold_uncertainty_score":0.87696874},"labels":[],"label_agreement":null},{"id":"W2326733347","doi":"10.1515/sagmb-2014-0100","title":"Corrigendum to: Simple estimators of false discovery rates given as few as one or two p-values without strong parametric assumptions","year":2015,"lang":"en","type":"erratum","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Public Health; University of Ottawa","funders":"","keywords":"Estimator; Simple (philosophy); Parametric statistics; Econometrics; Mathematics; Statistics; Parametric model; Applied mathematics; Philosophy; Epistemology","score_opus":0.2888264089124639,"score_gpt":0.5600055300892997,"score_spread":0.27117912117683574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2326733347","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000086422086,0.0024590252,0.005839121,0.036483448,0.9463474,0.00005301262,0.001317172,0.0008462603,0.006568147],"genre_scores_gemma":[0.0076808566,0.012545696,0.031497955,0.11536045,0.38804945,0.00057705457,0.004256735,0.0035854897,0.4364463],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99263835,0.0017145893,0.0014300173,0.0009076083,0.0030053176,0.00030409827],"domain_scores_gemma":[0.94102055,0.019066738,0.002173168,0.0047647906,0.03167594,0.0012989264],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0068839206,0.002896011,0.0031176244,0.005821174,0.0026276095,0.0040504215,0.0048641292,0.006734446,0.06340228],"category_scores_gemma":[0.11720729,0.0018343971,0.0018391345,0.0042054155,0.002990478,0.0033553168,0.0020505786,0.0109684765,0.06254078],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010469244,0.000006685827,0.00002638434,0.0000912641,0.0000076151655,0.000062380925,0.000008849699,0.000088358145,0.00002487725,0.0014759891,0.99057007,0.0076271254],"study_design_scores_gemma":[0.00003729219,0.000036411646,0.0008102303,0.00035353514,0.000053998563,0.00044706246,0.00003548364,0.001379877,0.00038619878,0.011940292,0.98444694,0.00007276564],"about_ca_topic_score_codex":0.015247047,"about_ca_topic_score_gemma":0.027971424,"teacher_disagreement_score":0.9931161,"about_ca_system_score_codex":0.004700074,"about_ca_system_score_gemma":0.0054176394,"threshold_uncertainty_score":0.21210176},"labels":[],"label_agreement":null},{"id":"W2400442575","doi":"10.1515/sagmb-2015-0026","title":"Identification of consistent functional genetic modules","year":2016,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Identification (biology); Computational biology; Computer science; Biological system; Biology","score_opus":0.009952392029068407,"score_gpt":0.2809339686172485,"score_spread":0.2709815765881801,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2400442575","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18897456,0.00021044914,0.80860317,0.00024017754,0.000014301002,0.000074114876,0.00042830917,0.00039322814,0.0010616902],"genre_scores_gemma":[0.8362865,0.00012800068,0.16102165,0.0000938039,0.000040410017,0.00012264801,0.001424329,0.0000957188,0.0007870998],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9986351,0.00048165335,0.0000662824,0.0004036268,0.00031864533,0.00009459449],"domain_scores_gemma":[0.9916636,0.005093777,0.0012135204,0.00094457436,0.0008522352,0.00023234732],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002850327,0.0005238551,0.00078412367,0.0023950008,0.00045904354,0.00092577335,0.0011280591,0.0007937382,0.00092080294],"category_scores_gemma":[0.014156958,0.0003681096,0.00070846593,0.0011328204,0.00085573556,0.0011227477,0.001124399,0.0008710979,0.0002742347],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078730297,0.00027122928,0.13170268,0.00055125495,0.00060886575,0.00080720714,0.0005591891,0.27089018,0.08234366,0.13357474,0.003433676,0.37447],"study_design_scores_gemma":[0.00004058975,0.0001194797,0.016556023,0.000032635315,0.000081208265,0.0003146202,0.00010368475,0.80854434,0.013376275,0.15836054,0.002429813,0.000040756076],"about_ca_topic_score_codex":0.0007027485,"about_ca_topic_score_gemma":0.00068201066,"teacher_disagreement_score":0.002850327,"about_ca_system_score_codex":0.000472195,"about_ca_system_score_gemma":0.0009686033,"threshold_uncertainty_score":0.015074134},"labels":[],"label_agreement":null},{"id":"W2408772186","doi":"10.1515/sagmb-2015-0057","title":"Using persistent homology and dynamical distances to analyze protein binding","year":2016,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Topological and Geometric Data Analysis","field":"Computer Science","cited_by":89,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Air Force Office of Scientific Research; Natural Sciences and Engineering Research Council of Canada; University of Alberta; Compute Canada","keywords":"Persistent homology; Persistence (discontinuity); Topological data analysis; Persistence length; Homology (biology); Barcode; Protein structure; Allosteric regulation","score_opus":0.01578656115812315,"score_gpt":0.3068789397904513,"score_spread":0.2910923786323281,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2408772186","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8092643,0.00043859525,0.1878188,0.00012709288,0.000013761917,0.00003080988,0.00027315711,0.00034228465,0.0016911499],"genre_scores_gemma":[0.98968935,0.00008428341,0.009666608,0.000014322448,0.000013364397,0.000021234575,0.0001985713,0.000021743903,0.0002905595],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99948585,0.00016282337,0.000033511413,0.00012124622,0.00013302254,0.00006363511],"domain_scores_gemma":[0.99695563,0.0014962157,0.00084171526,0.0002750305,0.0001366685,0.00029472713],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00090907066,0.00030475532,0.0005056833,0.0035691333,0.00041865258,0.00080826075,0.0004844885,0.00061498344,0.0010885441],"category_scores_gemma":[0.0054115485,0.00018725582,0.00037568723,0.0016505466,0.0011264322,0.00165743,0.0012758571,0.0005277417,0.00021025202],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00081733963,0.00028022157,0.06901796,0.00029623785,0.0004605738,0.00045687016,0.00065259065,0.6441825,0.05130532,0.12558784,0.0011578035,0.10578465],"study_design_scores_gemma":[0.000014722268,0.00014671174,0.012916994,0.0000069753764,0.000015865735,0.000159372,0.000086779706,0.925951,0.0036163388,0.05636876,0.00067372195,0.000042723896],"about_ca_topic_score_codex":0.0017813738,"about_ca_topic_score_gemma":0.00097619963,"teacher_disagreement_score":0.0035691333,"about_ca_system_score_codex":0.00076012465,"about_ca_system_score_gemma":0.00033138634,"threshold_uncertainty_score":0.0055150986},"labels":[],"label_agreement":null},{"id":"W2505409898","doi":"10.2202/1544-6115.1295","title":"Multiple Testing Issues in Discriminating Compound-Related Peaks and Chromatograms from High Frequency Noise, Spikes and Solvent-Based Noise in LC - MS Data Sets","year":2007,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Spectroscopy and Chemometric Analyses","field":"Chemistry","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Infection and Immunity","funders":"","keywords":"False positive paradox; Noise (video); Chromatography; Sample (material); Chemistry; Pattern recognition (psychology); Computer science; Artificial intelligence","score_opus":0.022958027026440155,"score_gpt":0.3317837427468998,"score_spread":0.30882571572045964,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2505409898","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05858895,0.0033450976,0.9271002,0.0054296944,0.0010060136,0.00093227293,0.00038037202,0.0010708729,0.0021465735],"genre_scores_gemma":[0.4228492,0.0008421154,0.56776625,0.0033680312,0.0011402082,0.0022718727,0.00054281764,0.00034685258,0.0008726528],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.71736693,0.19387835,0.022000307,0.030329237,0.0337718,0.0026534135],"domain_scores_gemma":[0.39742777,0.5536463,0.015485195,0.021039238,0.0109687885,0.0014326539],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16339478,0.0017966221,0.0033744227,0.0034510628,0.0021983478,0.0054067615,0.006021343,0.006062792,0.0012884082],"category_scores_gemma":[0.38699824,0.0011835311,0.0029140303,0.004639051,0.011034122,0.004724009,0.0040694727,0.006767292,0.0003711697],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00794422,0.001133961,0.16140135,0.0055927564,0.0074821515,0.017398125,0.005769212,0.033714972,0.040395103,0.09532016,0.0100540295,0.61379397],"study_design_scores_gemma":[0.0010044441,0.0056012417,0.11924336,0.0016294892,0.0018692905,0.0128271235,0.0029972922,0.24979958,0.05377639,0.5259645,0.024697062,0.0005902739],"about_ca_topic_score_codex":0.0017161287,"about_ca_topic_score_gemma":0.0017576613,"teacher_disagreement_score":0.16339478,"about_ca_system_score_codex":0.0015794631,"about_ca_system_score_gemma":0.0022410003,"threshold_uncertainty_score":0.86412454},"labels":[],"label_agreement":null},{"id":"W2563004743","doi":"10.1515/sagmb-2015-0096","title":"Statistical models and computational algorithms for discovering relationships in microbiome data","year":2016,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Microbiome; Human microbiome; Multinomial distribution; Computer science; Human Microbiome Project; Human health; Dirichlet distribution; Computational biology; Data science; Biology; Bioinformatics; Statistics; Mathematics","score_opus":0.05676287330995345,"score_gpt":0.3576809279288802,"score_spread":0.30091805461892673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2563004743","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028260336,0.00083324284,0.9946754,0.0005656721,0.000033790584,0.00005573203,0.00025527267,0.00052301824,0.00023179487],"genre_scores_gemma":[0.0671504,0.0019738462,0.9258616,0.00036556524,0.00035071545,0.0008929105,0.002128525,0.00026265395,0.0010137551],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9891101,0.0068017594,0.0007371817,0.001385706,0.0017036935,0.00026157728],"domain_scores_gemma":[0.91682905,0.07560642,0.0024031573,0.0027886191,0.0018104941,0.0005622405],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017299844,0.002486688,0.0029716978,0.0066821193,0.0016254522,0.0044503123,0.005860172,0.0037818502,0.0020518573],"category_scores_gemma":[0.076141834,0.002532619,0.0038722004,0.00842931,0.003420764,0.006439539,0.0044520576,0.0068058944,0.001341634],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015017546,0.00022374434,0.005168065,0.0004955646,0.00043170544,0.00019162541,0.0003496869,0.7212786,0.00064493483,0.10694989,0.0054898458,0.15862614],"study_design_scores_gemma":[0.0000143201805,0.00001340835,0.00017071403,0.00002522712,0.000013086409,0.000030149147,0.000020610953,0.88078195,0.00012450223,0.11804792,0.0007416502,0.000016466229],"about_ca_topic_score_codex":0.008243064,"about_ca_topic_score_gemma":0.007627701,"teacher_disagreement_score":0.017299844,"about_ca_system_score_codex":0.0023945223,"about_ca_system_score_gemma":0.0032805654,"threshold_uncertainty_score":0.0914914},"labels":[],"label_agreement":null},{"id":"W2586945381","doi":"10.1515/sagmb-2016-0035","title":"Polyunphased: an extension to polytomous outcomes of the Unphased package for family-based genetic association analysis","year":2017,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Centre intégré universitaire de santé et de services sociaux de la Capitale-Nationale; Institut Universitaire en Santé Mentale de Québec","funders":"Canadian Institutes of Health Research","keywords":"Polytomous Rasch model; Genetic association; Population; Logistic regression; Conditional dependence; Statistics; Computer science; Econometrics; Data mining; Mathematics; Biology; Genetics; Medicine; Genotype; Single-nucleotide polymorphism","score_opus":0.014199936806380912,"score_gpt":0.3469983778209622,"score_spread":0.3327984410145813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2586945381","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033082685,0.0003713789,0.92005974,0.00021799242,0.00027729472,0.0004373835,0.013091114,0.06017348,0.0020632574],"genre_scores_gemma":[0.023143832,0.0003964385,0.89178646,0.0005209281,0.00017005282,0.004834522,0.024541894,0.049850922,0.0047549643],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9961576,0.0020312543,0.00040266535,0.0006280293,0.0005429566,0.00023753746],"domain_scores_gemma":[0.9888227,0.0074057337,0.00082286715,0.0017970311,0.00087254215,0.00027917218],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009484293,0.0023438158,0.002729701,0.002884845,0.0010144714,0.0025668729,0.004532451,0.0013619569,0.066372275],"category_scores_gemma":[0.026250023,0.0023516293,0.004016692,0.003064847,0.0009073836,0.0023302443,0.004588945,0.003645216,0.021323495],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023914427,0.0005805234,0.025462456,0.0036128615,0.002761531,0.0014311634,0.0017297015,0.019986158,0.01077354,0.04302652,0.4125528,0.47569138],"study_design_scores_gemma":[0.0021984158,0.00045805748,0.019412285,0.0007598464,0.0010439204,0.0024972279,0.00020649775,0.21376838,0.017623672,0.16343124,0.5779188,0.00068170484],"about_ca_topic_score_codex":0.0018571987,"about_ca_topic_score_gemma":0.0028074007,"teacher_disagreement_score":0.066372275,"about_ca_system_score_codex":0.00052849954,"about_ca_system_score_gemma":0.0026686774,"threshold_uncertainty_score":0.22203737},"labels":[],"label_agreement":null},{"id":"W2738214912","doi":"10.1515/sagmb-2016-0066","title":"Comparing the performance of linear and nonlinear principal components in the context of high-dimensional genomic data integration","year":2017,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; Impact; McMaster University; Population Health Research Institute","funders":"Canadian Institutes of Health Research","keywords":"Context (archaeology); Principal component analysis; Nonlinear system; Computer science; Mathematics; Data mining; Statistics; Econometrics; Biology; Physics","score_opus":0.04208724528262083,"score_gpt":0.3307104930972203,"score_spread":0.28862324781459947,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2738214912","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6525199,0.0034270992,0.3387174,0.000851325,0.0001342566,0.00025521987,0.00034837116,0.0015282258,0.0022181228],"genre_scores_gemma":[0.8494344,0.00082211394,0.14770424,0.00007049441,0.00003593614,0.00012896367,0.001009379,0.00014725867,0.00064717454],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9943862,0.0036841284,0.00039258934,0.00054498203,0.00075784576,0.00023426545],"domain_scores_gemma":[0.96023566,0.032442946,0.0011313179,0.0023644478,0.0033776234,0.00044806022],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013914373,0.0010288552,0.001262363,0.0020778754,0.0005836725,0.0021186532,0.0008285689,0.0012797895,0.0005863505],"category_scores_gemma":[0.051420804,0.00030538853,0.0011989853,0.0025738154,0.00089446397,0.0019256127,0.0014635392,0.0009777369,0.00045149136],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030339172,0.00046313822,0.04224616,0.00066628907,0.00080360676,0.00020229189,0.00043956962,0.68006223,0.007820465,0.004745044,0.001501716,0.25801548],"study_design_scores_gemma":[0.000034201497,0.00021041222,0.01012983,0.000024324923,0.000054534867,0.00005450268,0.00009652197,0.98362666,0.0034555814,0.0019407388,0.00033880415,0.000033980647],"about_ca_topic_score_codex":0.005721538,"about_ca_topic_score_gemma":0.0036410864,"teacher_disagreement_score":0.013914373,"about_ca_system_score_codex":0.00093337736,"about_ca_system_score_gemma":0.0015976789,"threshold_uncertainty_score":0.07358712},"labels":[],"label_agreement":null},{"id":"W2765927438","doi":"10.1515/sagmb-2016-0062","title":"A smoothed EM-algorithm for DNA methylation profiles from sequencing-based methods in cell lines or for a single cell type","year":2017,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Epigenetics and DNA Methylation","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University; Jewish General Hospital; Université Laval","funders":"","keywords":"DNA methylation; CpG site; Biology; Computational biology; Methylation; Illumina Methylation Assay; DNA sequencing; Differentially methylated regions; DNA; Algorithm; Genetics; Computer science; Gene; Gene expression","score_opus":0.035912019318060456,"score_gpt":0.38405813375488007,"score_spread":0.34814611443681964,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2765927438","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013171878,0.000040050178,0.99814236,0.000027523643,0.000009761213,0.000019088304,0.00003333189,0.00032396018,0.00008676724],"genre_scores_gemma":[0.024192963,0.00011623368,0.97345835,0.00009431328,0.00002280804,0.00025336177,0.00055011426,0.00027989445,0.0010318082],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9987109,0.0005358519,0.00007733653,0.00031779907,0.0003073278,0.00005080573],"domain_scores_gemma":[0.9959638,0.002762744,0.00020723602,0.00048786076,0.000510425,0.00006798188],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050826957,0.0010820898,0.001134951,0.0010704992,0.00048502474,0.0010439403,0.0022862942,0.0015730783,0.0021787258],"category_scores_gemma":[0.016541522,0.0008681576,0.0014686106,0.0013045892,0.00088667683,0.000980912,0.0017759833,0.0024804212,0.0017590055],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029411545,0.00009269341,0.0037152667,0.00035830494,0.0004610921,0.00020916371,0.00024838626,0.5823209,0.027843941,0.039517216,0.0038975726,0.34104124],"study_design_scores_gemma":[0.000025068395,0.000044863682,0.0007018105,0.000019064446,0.000032806634,0.00010905697,0.000016559829,0.96206945,0.007176598,0.02593198,0.0038415575,0.000031184172],"about_ca_topic_score_codex":0.0037379318,"about_ca_topic_score_gemma":0.0043588877,"teacher_disagreement_score":0.0050826957,"about_ca_system_score_codex":0.0009218051,"about_ca_system_score_gemma":0.0019000317,"threshold_uncertainty_score":0.026880205},"labels":[],"label_agreement":null},{"id":"W2790219140","doi":"10.1515/sagmb-2017-0038","title":"Ensemble survival tree models to reveal pairwise interactions of variables with time-to-events outcomes in low-dimensional setting","year":2018,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Center for Advancing Translational Sciences; National Institute of Dental and Craniofacial Research; National Institute of Allergy and Infectious Diseases; National Cancer Institute; Russian Science Foundation; National Institute of General Medical Sciences; McGill University","keywords":"Pairwise comparison; Estimator; Statistics; Econometrics; Event (particle physics); Survival analysis; Computer science; Mathematics","score_opus":0.0340043625606339,"score_gpt":0.36531668971846626,"score_spread":0.3313123271578324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2790219140","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03497349,0.0004192632,0.96320355,0.00026625604,0.00006318336,0.000042095693,0.0003997335,0.00024755267,0.00038494528],"genre_scores_gemma":[0.78157413,0.0010429542,0.21080942,0.0003429176,0.00029011455,0.0006235421,0.002348504,0.00016239626,0.002805941],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99706995,0.0021339343,0.000094033705,0.00033760798,0.0001908041,0.00017366135],"domain_scores_gemma":[0.9798575,0.01675739,0.001277861,0.0010390154,0.0006485352,0.0004196713],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010487033,0.0011813747,0.0016517588,0.0016364611,0.0005817766,0.0010450731,0.0018828453,0.0011742411,0.0025508034],"category_scores_gemma":[0.024419233,0.00045415421,0.0018511298,0.0014536275,0.0008492347,0.001293078,0.0014690218,0.0021146648,0.0003837128],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029225126,0.00012835396,0.02652097,0.000161176,0.00056900346,0.00030697617,0.00020508247,0.82842016,0.0010646459,0.073895164,0.0027051233,0.065731056],"study_design_scores_gemma":[0.000009963547,0.000038483573,0.00083529926,0.000011353711,0.000042168547,0.000032190957,0.000009685446,0.97334176,0.00010491892,0.025189197,0.00037566156,0.000009343762],"about_ca_topic_score_codex":0.0036226972,"about_ca_topic_score_gemma":0.0038799292,"teacher_disagreement_score":0.010487033,"about_ca_system_score_codex":0.00057158206,"about_ca_system_score_gemma":0.0011920143,"threshold_uncertainty_score":0.055461407},"labels":[],"label_agreement":null},{"id":"W2950331006","doi":"10.1515/sagmb-2016-0077","title":"Multivariate association between single-nucleotide polymorphisms in Alzgene linkage regions and structural changes in the brain: discovery, refinement and validation","year":2017,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria; Simon Fraser University","funders":"National Institute on Aging","keywords":"Multivariate statistics; Single-nucleotide polymorphism; Linkage (software); Multivariate analysis; Computational biology; Association (psychology); Biology; Genetic association; Genetics; Computer science; Psychology; Genotype; Machine learning; Gene","score_opus":0.021259273517171755,"score_gpt":0.3167864999722645,"score_spread":0.2955272264550927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2950331006","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91974634,0.00026067413,0.07687408,0.0001675873,0.00002587836,0.0001836925,0.0017668038,0.0006836762,0.00029128263],"genre_scores_gemma":[0.93503547,0.00010434216,0.0567474,0.0000779703,0.000027578451,0.00026952047,0.0072972244,0.00017615964,0.0002644053],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.986089,0.009694238,0.00080853456,0.0017442283,0.0011218627,0.00054204115],"domain_scores_gemma":[0.91646725,0.06638504,0.0040873745,0.009432249,0.002690739,0.0009372767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04232881,0.0012175767,0.001382777,0.002649247,0.0010541365,0.0012067162,0.0019305217,0.0007202173,0.0015140796],"category_scores_gemma":[0.07119695,0.00052691234,0.0030290976,0.0029670505,0.0016798115,0.00071944075,0.0019536642,0.0017641061,0.00045221628],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024023547,0.00054318673,0.8547962,0.00030083884,0.0037633863,0.0010308325,0.00073613325,0.047712367,0.014256326,0.0022530758,0.0031582424,0.06904703],"study_design_scores_gemma":[0.00068337674,0.0016219406,0.6186311,0.00006957744,0.0016476498,0.0012739514,0.00032600696,0.35774055,0.008493709,0.0061987774,0.0031719175,0.00014144664],"about_ca_topic_score_codex":0.008263986,"about_ca_topic_score_gemma":0.010938034,"teacher_disagreement_score":0.04232881,"about_ca_system_score_codex":0.00043924668,"about_ca_system_score_gemma":0.0027173725,"threshold_uncertainty_score":0.22385877},"labels":[],"label_agreement":null},{"id":"W3009238540","doi":"10.1515/sagmb-2018-0026","title":"Identification of supervised and sparse functional genomic pathways","year":2020,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Identification (biology); Computational biology; Computer science; Artificial intelligence; Machine learning; Biology","score_opus":0.012856851338160271,"score_gpt":0.2431907907528628,"score_spread":0.2303339394147025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3009238540","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21686769,0.00019300992,0.78026825,0.00025715606,0.000013017931,0.00006268745,0.0007861137,0.00060012116,0.00095193996],"genre_scores_gemma":[0.7756874,0.00013681284,0.21996132,0.000067034176,0.000032711407,0.000100171565,0.0025755377,0.000056059915,0.0013828812],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99968636,0.000120816534,0.0000141962755,0.00007638983,0.00007034778,0.0000319355],"domain_scores_gemma":[0.998719,0.00065456866,0.00021654712,0.00011936091,0.00022544454,0.00006509816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00062561047,0.0004246546,0.0003759667,0.0013366345,0.00025253513,0.00052870234,0.000560796,0.00047268142,0.0008319134],"category_scores_gemma":[0.0032181218,0.0001906664,0.000449108,0.00073747075,0.00030640254,0.00050955877,0.000583301,0.00044548162,0.00019922739],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041690987,0.00019966046,0.023146195,0.0002133045,0.00016757216,0.00044405056,0.00029832296,0.6115105,0.036300622,0.02506044,0.0044347057,0.2978076],"study_design_scores_gemma":[0.000007813604,0.000017017368,0.0017774339,0.0000029028363,0.000005698348,0.00004100894,0.000019900726,0.988499,0.0013083305,0.0079649,0.0003512645,0.0000047272515],"about_ca_topic_score_codex":0.0018703288,"about_ca_topic_score_gemma":0.003211031,"teacher_disagreement_score":0.0018703288,"about_ca_system_score_codex":0.00038785863,"about_ca_system_score_gemma":0.00067407294,"threshold_uncertainty_score":0.0037189126},"labels":[],"label_agreement":null},{"id":"W3082808948","doi":"10.1515/sagmb-2019-0058","title":"Spectral dynamic causal modelling of resting-state fMRI: an exploratory study relating effective brain connectivity in the default mode network to genetics","year":2020,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria; Simon Fraser University","funders":"Canadian Statistical Sciences Institute; National Institute on Aging; National Institutes of Health; Natural Sciences and Engineering Research Council of Canada; U.S. Department of Defense","keywords":"Default mode network; Imaging genetics; Neuroimaging; Functional magnetic resonance imaging; Context (archaeology); Resting state fMRI; Single-nucleotide polymorphism; Alzheimer's Disease Neuroimaging Initiative; Psychology; Neuroscience; Genetics; Biology; Cognition; Genotype","score_opus":0.03760839718825871,"score_gpt":0.3276621817974205,"score_spread":0.2900537846091618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3082808948","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8926638,0.000113369744,0.10643841,0.00019890029,0.0000033347987,0.000029637482,0.00010856025,0.00006965716,0.0003743502],"genre_scores_gemma":[0.97240317,0.00004910578,0.027128728,0.000022948961,0.000008698714,0.000043236705,0.00015231648,0.00001960979,0.00017214348],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981693,0.0014531484,0.000028505281,0.00022173645,0.00006849914,0.00005873095],"domain_scores_gemma":[0.9774909,0.020304037,0.00072538934,0.0010196072,0.00028502854,0.00017509813],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005233457,0.0005873389,0.00046800319,0.0009916929,0.00038958102,0.00048495817,0.00078398915,0.000614025,0.0009332884],"category_scores_gemma":[0.024982812,0.00025784312,0.0010409585,0.00071208796,0.00087874715,0.00081826025,0.0006163459,0.00061558094,0.00008816956],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012069681,0.000980629,0.4194445,0.0002472835,0.0019950105,0.0023198996,0.0022687572,0.41265264,0.024221256,0.047118686,0.00084404915,0.08670035],"study_design_scores_gemma":[0.000065143184,0.00043778273,0.12387268,0.000022448306,0.00024956983,0.0006328217,0.00029147687,0.8359257,0.002671069,0.0350846,0.0006902091,0.00005648845],"about_ca_topic_score_codex":0.0046503907,"about_ca_topic_score_gemma":0.004877167,"teacher_disagreement_score":0.005233457,"about_ca_system_score_codex":0.00051994674,"about_ca_system_score_gemma":0.0006450388,"threshold_uncertainty_score":0.027677476},"labels":[],"label_agreement":null},{"id":"W3098349241","doi":"10.1515/1544-6115.1765","title":"Empirical Bayes Interval Estimates that are Conditionally Equal to Unadjusted Confidence Intervals or to Default Prior Credibility Intervals","year":2012,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Credible interval; Confidence interval; Statistics; Mathematics; CDF-based nonparametric confidence interval; Confidence distribution; Posterior probability; Point estimation; Coverage probability; Bayes' theorem; Prior probability; Frequentist inference; Binomial proportion confidence interval; Bayesian probability; Econometrics; Bayesian inference; Poisson distribution; Negative binomial distribution","score_opus":0.14014334099700204,"score_gpt":0.47542304051199746,"score_spread":0.3352796995149954,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3098349241","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038867374,0.001929559,0.98484266,0.00042963057,0.0003049359,0.00009689675,0.00045684417,0.0009237399,0.00712904],"genre_scores_gemma":[0.31116062,0.002756021,0.6758744,0.0013038452,0.0012509687,0.0009866137,0.0018868207,0.0013121015,0.0034685778],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96795547,0.012636997,0.0025041054,0.008068825,0.007997433,0.0008372718],"domain_scores_gemma":[0.78441817,0.167043,0.012010338,0.022237986,0.013264395,0.0010261559],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035306137,0.0017708881,0.0026231508,0.005815227,0.0011645134,0.007596604,0.0048511294,0.0035540743,0.013097908],"category_scores_gemma":[0.32523882,0.0013375679,0.0024468773,0.004347915,0.004277039,0.009397956,0.0038155068,0.006975898,0.002901121],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036802137,0.00006727237,0.0052420967,0.0014361298,0.00066825637,0.00036530546,0.00078098924,0.062006444,0.0015425382,0.641203,0.01399428,0.27232566],"study_design_scores_gemma":[0.00009941387,0.00009742802,0.0024751734,0.0009778948,0.00021774163,0.00071166153,0.00020106185,0.12182629,0.0031112793,0.84118396,0.028923107,0.00017493746],"about_ca_topic_score_codex":0.0021526632,"about_ca_topic_score_gemma":0.001020917,"teacher_disagreement_score":0.035306137,"about_ca_system_score_codex":0.0020585242,"about_ca_system_score_gemma":0.0018771216,"threshold_uncertainty_score":0.18671894},"labels":[],"label_agreement":null},{"id":"W4385969104","doi":"10.1515/sagmb-2023-0017","title":"CAT PETR: a graphical user interface for differential analysis of phosphorylation and expression data","year":2023,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Advanced Biosensing Techniques and Applications","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kinexus Bioinformatics Corporation (Canada); University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Visualization; Computer science; Graphical user interface; Data mining; Data visualization; User interface; Operating system","score_opus":0.01634073589515513,"score_gpt":0.36196739715944914,"score_spread":0.34562666126429403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385969104","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0055350726,0.0003203237,0.51235384,0.00032664154,0.00020847203,0.0002965433,0.012321491,0.4652759,0.0033616638],"genre_scores_gemma":[0.1051207,0.0011432038,0.75843054,0.0024819796,0.00030429254,0.0043785423,0.033554062,0.07783674,0.016749976],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988918,0.0002480532,0.00011706727,0.00017465427,0.0004688567,0.00009973476],"domain_scores_gemma":[0.99614173,0.0024873987,0.00018716774,0.00031408196,0.00067150255,0.0001981115],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002375677,0.0015923429,0.0009998054,0.00213935,0.00029752756,0.001198855,0.0017932139,0.0011510947,0.044914767],"category_scores_gemma":[0.006893799,0.0006023647,0.0012446448,0.0013687349,0.00041365786,0.0012825436,0.0020091638,0.001706053,0.014079339],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037292365,0.00043283546,0.00667445,0.0031900117,0.00067474897,0.0022505827,0.00081757415,0.0076327096,0.12607543,0.01139207,0.45850828,0.37862203],"study_design_scores_gemma":[0.0012204448,0.00065336545,0.017913373,0.0005751968,0.00031776188,0.003909578,0.00020421477,0.30957323,0.14928445,0.024457233,0.4912693,0.00062174036],"about_ca_topic_score_codex":0.00088883546,"about_ca_topic_score_gemma":0.0010374972,"teacher_disagreement_score":0.044914767,"about_ca_system_score_codex":0.00035438786,"about_ca_system_score_gemma":0.00094870175,"threshold_uncertainty_score":0.15025479},"labels":[],"label_agreement":null},{"id":"W7129040716","doi":"10.1515/sagmb-2025-0043","title":"Perfect collinearity not created equal: measuring and visualizing the severity of multi-collinearity of modern omics data","year":2025,"lang":"en","type":"article","venue":"Statistical Applications in Genetics and Molecular Biology","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; St. Joseph’s Healthcare Hamilton","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Collinearity; Redundancy (engineering); Statistical model; Linkage disequilibrium; Linkage (software); Selection (genetic algorithm); Contrast (vision); Multicollinearity; Disequilibrium","score_opus":0.03285082144057044,"score_gpt":0.3393574296199837,"score_spread":0.3065066081794133,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7129040716","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5185531,0.0011855457,0.4732805,0.00085317774,0.00010170722,0.00009961673,0.0012670234,0.0019495493,0.002709761],"genre_scores_gemma":[0.85070854,0.00026257394,0.14781743,0.00007051813,0.000045581975,0.000072909985,0.0004613371,0.00015512887,0.00040601363],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9982742,0.0007684228,0.00018483769,0.0002340459,0.00041754523,0.000120883815],"domain_scores_gemma":[0.9899136,0.00541904,0.0024240487,0.0009291163,0.0008957022,0.00041850403],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003728927,0.0006213259,0.0005032938,0.005471744,0.0005570626,0.0027027412,0.00040457386,0.00043479586,0.001351283],"category_scores_gemma":[0.012725673,0.00023363676,0.00050583057,0.0042183674,0.0011838514,0.0018195594,0.0024354162,0.0009418228,0.0001986837],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013891732,0.00023498379,0.25783113,0.001826174,0.0013023729,0.0021749304,0.009585088,0.07189842,0.15973401,0.082567364,0.010460867,0.40099543],"study_design_scores_gemma":[0.000083467865,0.00063480204,0.27276188,0.0004083705,0.00035849283,0.0025963713,0.007237347,0.45253682,0.07603325,0.16702923,0.019864503,0.00045551333],"about_ca_topic_score_codex":0.00078906026,"about_ca_topic_score_gemma":0.0009255851,"teacher_disagreement_score":0.005471744,"about_ca_system_score_codex":0.00043389533,"about_ca_system_score_gemma":0.00060574885,"threshold_uncertainty_score":0.019720674},"labels":[],"label_agreement":null}]}