{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":1222,"total_is_capped":false,"direct_labels_cover":16,"predictions_cover":1222,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"6a52b7c41d45","filters":{"topic":"Statistical Methods and Bayesian Inference"}},"results":[{"id":"W2112669742","doi":"10.1093/aje/kwh090","title":"A Modified Poisson Regression Approach to Prospective Studies with Binary Data","year":2004,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":9468,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Robarts Clinical Trials","funders":"","keywords":"Poisson regression; Statistics; Poisson distribution; Mathematics; Regression analysis; Binary data; Regression; Variance (accounting); Linear regression; Binary number; Econometrics; Medicine; Population","authors":[{"name":"Guangyong Zou","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2762250419605384,"gpt":0.4846306984267521,"spread":0.2084056564662137,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05157736,0.001351411,0.002598321,0.004613468,0.0007827951,0.002535432,0.007217813,0.002397193,0.005157342],"category_scores_gemma":[0.1324003,0.001338598,0.00393431,0.005078729,0.001256005,0.002873341,0.002951894,0.004768555,0.001758213],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001153203,"about_ca_system_score_gemma":0.001884983,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002182689,"about_ca_topic_score_gemma":0.002160738,"domain_scores_codex":[0.9421471,0.04657868,0.00238375,0.003949013,0.004611035,0.0003305547],"domain_scores_gemma":[0.9477255,0.04088442,0.003514562,0.005411173,0.002149479,0.0003148924],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003777503,0.0002005201,0.009394142,0.001691896,0.00252292,0.001156296,0.0009801928,0.0555409,0.001462519,0.5737464,0.01321562,0.3397108],"study_design_scores_gemma":[0.0004352567,0.0005696715,0.004316389,0.0006372277,0.0008777379,0.001847386,0.0001615626,0.2187725,0.001192442,0.7181151,0.05286689,0.0002077994],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0011799,0.001007197,0.9954668,0.0008195982,0.0001785831,0.0002816993,0.0001951389,0.00009801062,0.0007730454],"genre_scores_gemma":[0.05031024,0.003298863,0.9361517,0.001610281,0.0008340128,0.003390508,0.0004917369,0.0001466819,0.003766046],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9484227,"threshold_uncertainty_score":0.2727704,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2577537660","doi":"10.18637/jss.v076.i01","title":"<i>Stan</i> : A Probabilistic Programming Language","year":2017,"lang":"en","type":"article","venue":"Journal of Statistical Software","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":7378,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"National Center for Research Resources; Institute of Education Sciences; U.S. Department of Energy; National Science Foundation; National Institutes of Health; Harvard University","keywords":"Python (programming language); Computer science; Markov chain Monte Carlo; Algorithm; Hybrid Monte Carlo; Monte Carlo method; Probabilistic logic; Bayesian inference; Importance sampling; Statistical inference; Inference; Monte Carlo integration; Applied mathematics; Bayesian probability; Mathematical optimization; Mathematics; Programming language; Artificial intelligence; Statistics","authors":[{"name":"Bob Carpenter","is_ca":false},{"name":"Andrew Gelman","is_ca":false},{"name":"Matthew D. Hoffman","is_ca":false},{"name":"Daniel C. Lee","is_ca":false},{"name":"Ben Goodrich","is_ca":false},{"name":"Michael Betancourt","is_ca":false},{"name":"Marcus A. Brubaker","is_ca":true},{"name":"Jiqiang Guo","is_ca":false},{"name":"Peter Li","is_ca":false},{"name":"Allen Riddell","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05011962462799613,"gpt":0.3917699605443133,"spread":0.3416503359163172,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005296637,0.002943118,0.001773436,0.002050902,0.0008684856,0.005120043,0.004912789,0.001800833,0.1156944],"category_scores_gemma":[0.02137761,0.002622225,0.003036069,0.002766237,0.001544034,0.005046561,0.003434008,0.005278199,0.07530208],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001078074,"about_ca_system_score_gemma":0.003688184,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003691928,"about_ca_topic_score_gemma":0.00568725,"domain_scores_codex":[0.9970936,0.0009587079,0.0004168563,0.0005613478,0.0007694348,0.0002001804],"domain_scores_gemma":[0.9906446,0.00620515,0.0007649272,0.000964483,0.001199967,0.0002208864],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0001914574,0.00008589782,0.001326737,0.00134438,0.0002051353,0.0004328176,0.0004179943,0.01653264,0.002666738,0.2137008,0.6404368,0.1226586],"study_design_scores_gemma":[0.0001548248,0.00003715806,0.0004955769,0.0004044862,0.00005710252,0.0005946974,0.00004839199,0.09834083,0.006815337,0.2092083,0.6837081,0.0001351035],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.0003253167,0.0001885362,0.8889701,0.0005256013,0.000141653,0.0001573221,0.0122226,0.09022959,0.007239359],"genre_scores_gemma":[0.01007935,0.0005941426,0.8950227,0.001906905,0.0002101993,0.001669296,0.01765394,0.06180873,0.0110548],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.1156944,"threshold_uncertainty_score":0.3870364,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2065974896","doi":"10.1136/bmj.b2393","title":"Multiple imputation for missing data in epidemiological and clinical research: potential and pitfalls","year":2009,"lang":"en","type":"article","venue":"BMJ","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":7164,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Institute of Infection and Immunity","funders":"Economic and Social Research Council; British Heart Foundation","keywords":"Imputation (statistics); Missing data; Computer science; Data science; Data mining; Statistics; Econometrics; Mathematics; Machine learning","authors":[{"name":"Jonathan A C Sterne","is_ca":true},{"name":"Ian R. White","is_ca":false},{"name":"John B. Carlin","is_ca":false},{"name":"Michael Spratt","is_ca":false},{"name":"Patrick Royston","is_ca":false},{"name":"Michael G. Kenward","is_ca":false},{"name":"Angela Wood","is_ca":false},{"name":"James R. Carpenter","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6024689602522153,"gpt":0.6126207473716742,"spread":0.01015178711945885,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5608573,0.002098741,0.007949745,0.008115331,0.003558868,0.008471162,0.01123162,0.0108662,0.002328502],"category_scores_gemma":[0.7528582,0.003219603,0.006426312,0.01978526,0.01198604,0.01520395,0.009367724,0.01836194,0.001316201],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00325701,"about_ca_system_score_gemma":0.008750628,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005141333,"about_ca_topic_score_gemma":0.007906439,"domain_scores_codex":[0.3045496,0.625974,0.0320696,0.008136102,0.02788152,0.001389166],"domain_scores_gemma":[0.1352471,0.7857723,0.0258267,0.03179311,0.01957188,0.001788914],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001296147,0.000265233,0.03718862,0.01513894,0.007749138,0.001930634,0.0136993,0.009739676,0.000548099,0.1541359,0.08691344,0.6713949],"study_design_scores_gemma":[0.0005829923,0.00056959,0.01172656,0.02149597,0.001764982,0.006057749,0.003141255,0.03766188,0.001303435,0.8382686,0.07670487,0.0007220728],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005910376,0.09038762,0.6684355,0.2257139,0.004901252,0.0007488788,0.0006502328,0.0006231326,0.002629207],"genre_scores_gemma":[0.1345544,0.0406627,0.7555287,0.05395398,0.01049849,0.002665421,0.0003839757,0.0004863276,0.001266002],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.4391427,"threshold_uncertainty_score":0.5415412,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2133959349","doi":"10.1093/aje/kwf215","title":"Statistical Analysis of Correlated Data Using Generalized Estimating Equations: An Orientation","year":2003,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":2200,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University","funders":"National Institute of Diabetes and Digestive and Kidney Diseases; National Cancer Institute; National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Gee; Generalized estimating equation; Binary data; Binary number; Multivariate statistics; Simple (philosophy); Orientation (vector space); Set (abstract data type); Longitudinal data; Data set; Statistics; Estimating equations; Computer science; Mathematics; Multivariate analysis; Applied mathematics; Algorithm; Data mining; Maximum likelihood; Arithmetic","authors":[{"name":"James A. Hanley","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.307497116676916,"gpt":0.5219258977512772,"spread":0.2144287810743611,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04706145,0.001987385,0.002826239,0.005985145,0.001003242,0.004261078,0.002537044,0.002690725,0.002392418],"category_scores_gemma":[0.07611102,0.001423655,0.003368501,0.006418401,0.006851132,0.005322339,0.004675454,0.006998913,0.001206262],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001898921,"about_ca_system_score_gemma":0.002706077,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002860217,"about_ca_topic_score_gemma":0.001793372,"domain_scores_codex":[0.9467785,0.04296141,0.001681083,0.003254037,0.005036261,0.0002886353],"domain_scores_gemma":[0.9428446,0.04748054,0.002230061,0.004034436,0.0030868,0.0003235828],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00004969291,0.00007550833,0.002107991,0.0008243026,0.0004528669,0.0001989416,0.0006354515,0.01078226,0.0005404725,0.8223648,0.009429604,0.1525381],"study_design_scores_gemma":[0.00007908304,0.0001335154,0.001258967,0.0004349601,0.0001508134,0.0003455681,0.0001277963,0.05844649,0.0006169514,0.8904335,0.04785554,0.0001166652],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0006231639,0.003857633,0.9911665,0.00262476,0.0002995399,0.00006930155,0.0000647643,0.0001033086,0.001190993],"genre_scores_gemma":[0.02430642,0.0130722,0.9569784,0.001657422,0.001783986,0.0005880321,0.0001499998,0.0002155671,0.001247934],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04706145,"threshold_uncertainty_score":0.2488878,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2133470535","doi":"","title":"A multivariate technique for multiply imputing missing values using a sequence of regression models","year":2001,"lang":"en","type":"article","venue":"Survey methodology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1995,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"","keywords":"Missing data; Imputation (statistics); Statistics; Mathematics; Logistic regression; Multivariate statistics; Regression analysis; Regression; Computer science","authors":[{"name":"Trivellore E. Raghunathan","is_ca":false},{"name":"James M. Lepkowski","is_ca":false},{"name":"John Van Hoewyk","is_ca":false},{"name":"Peter W. Solenberger","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6952655713588801,"gpt":0.5554953450934195,"spread":0.1397702262654607,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03417493,0.002251467,0.00306186,0.00548978,0.001539582,0.001867275,0.003651662,0.00172784,0.008163091],"category_scores_gemma":[0.1048439,0.001261815,0.004720956,0.007489437,0.001901057,0.003973859,0.004206848,0.004753977,0.002324647],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001145862,"about_ca_system_score_gemma":0.003655971,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003102104,"about_ca_topic_score_gemma":0.003550424,"domain_scores_codex":[0.9695327,0.0230925,0.0009083709,0.001695352,0.004357929,0.0004131525],"domain_scores_gemma":[0.9509155,0.03578398,0.003559864,0.006887491,0.002420831,0.00043236],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000287608,0.0003329614,0.006725271,0.0007024316,0.00122808,0.0003730502,0.001182911,0.1086984,0.00229973,0.3284116,0.007120108,0.5426378],"study_design_scores_gemma":[0.000162656,0.0007446599,0.003519264,0.0004587997,0.0004798573,0.001215081,0.0002689072,0.5545548,0.004808016,0.3993054,0.03420237,0.0002801122],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0006620921,0.00005976053,0.9986212,0.00008027253,0.00002395703,0.00005247639,0.00003467766,0.0001888189,0.0002767592],"genre_scores_gemma":[0.02410957,0.0003857886,0.9733729,0.0001250298,0.0001151668,0.0006550699,0.000180771,0.0001335125,0.0009221462],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03417493,"threshold_uncertainty_score":0.1807365,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1484712862","doi":"10.1002/0471667196.ess0731","title":"Small Area Estimation","year":2003,"lang":"en","type":"book","venue":"Encyclopedia of Statistical Sciences","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1169,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Carleton University","funders":"","keywords":"Small area estimation; Mathematics; Statistics; Exponential family; Estimator; Linear model; Generalized linear mixed model; Generalized linear model; Bayes' theorem; Multivariate statistics; Bayesian probability","authors":[{"name":"J. N. K. Rao","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08328228167444557,"gpt":0.3568004655121695,"spread":0.273518183837724,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003399595,0.0008633145,0.001425855,0.002215592,0.0006318487,0.001580777,0.00202789,0.0008466952,0.02318112],"category_scores_gemma":[0.02732593,0.000523001,0.001342378,0.002463366,0.0008377467,0.002350436,0.001786882,0.001358684,0.004318276],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005584674,"about_ca_system_score_gemma":0.0008834772,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003510436,"about_ca_topic_score_gemma":0.003477101,"domain_scores_codex":[0.9978685,0.00105015,0.00007566439,0.0004956542,0.0004272383,0.00008268777],"domain_scores_gemma":[0.989616,0.007432074,0.0004494514,0.001310006,0.001072306,0.0001201005],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001455566,0.00006998568,0.009715043,0.0005417642,0.0004388186,0.000189323,0.0003163339,0.09401207,0.001376384,0.2538614,0.0288059,0.6105273],"study_design_scores_gemma":[0.00007077987,0.0001050859,0.01044271,0.0003628236,0.0002204745,0.0003575573,0.0002807719,0.4081918,0.002135121,0.4936541,0.08411846,0.00006025708],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005951624,0.001372034,0.9777256,0.0002830152,0.0001715726,0.0001134847,0.0005140712,0.0003888387,0.01347969],"genre_scores_gemma":[0.2838063,0.003291471,0.66713,0.0004331959,0.0006130648,0.00105892,0.003599404,0.0005512395,0.03951647],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02318112,"threshold_uncertainty_score":0.07754856,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2135760566","doi":"10.1016/j.jclinepi.2014.12.014","title":"The number of subjects per variable required in linear regression analyses","year":2015,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1043,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"","keywords":"Statistics; Linear regression; Confidence interval; Mathematics; Regression analysis; Regression dilution; Standard error; Regression; Population; Segmented regression; Statistic; Linear model; Proper linear model; Standard deviation; Polynomial regression; Medicine","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Ewout W. Steyerberg","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6415066932237838,"gpt":0.6428740076196767,"spread":0.001367314395892882,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1739216,0.001148703,0.00412481,0.001050525,0.001738395,0.003199313,0.004668633,0.006394171,0.005247907],"category_scores_gemma":[0.4999297,0.002311177,0.004186134,0.001775834,0.002660561,0.004628698,0.003126089,0.004934966,0.001075458],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001596319,"about_ca_system_score_gemma":0.004139085,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002429174,"about_ca_topic_score_gemma":0.002330305,"domain_scores_codex":[0.7493854,0.2232286,0.009245711,0.008540376,0.008455928,0.001143953],"domain_scores_gemma":[0.3827098,0.5779629,0.008066538,0.02407178,0.005740764,0.001448277],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.02463955,0.003780324,0.2131188,0.003763521,0.00496623,0.002998291,0.003114931,0.3827275,0.008784002,0.05058639,0.01048193,0.2910385],"study_design_scores_gemma":[0.00662131,0.009107693,0.07614838,0.001878603,0.002509171,0.002286013,0.001011777,0.7003396,0.01298947,0.171427,0.01525354,0.0004273932],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1579227,0.001744425,0.8230364,0.003248413,0.0004604523,0.006586099,0.001943541,0.000775405,0.004282537],"genre_scores_gemma":[0.5268878,0.0006414669,0.454365,0.001066335,0.0001778536,0.01452754,0.001009313,0.0001881435,0.001136493],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8260784,"threshold_uncertainty_score":0.9197961,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2885675882","doi":"10.1002/jrsm.1316","title":"A comparison of heterogeneity variance estimators in simulated random‐effects meta‐analyses","year":2018,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1026,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"St. Michael's Hospital","funders":"Medical Research Council; National Institute for Health and Care Research","keywords":"Estimator; Meta-analysis; Random effects model; Variance (accounting); Econometrics; Statistics; Variance components; Computer science; Estimation; Mathematics; Economics; Medicine","authors":[{"name":"Dean Langan","is_ca":false},{"name":"Julian P. T. Higgins","is_ca":false},{"name":"Dan Jackson","is_ca":false},{"name":"Jack Bowden","is_ca":false},{"name":"Areti Angeliki Veroniki","is_ca":true},{"name":"Evangelos Kontopantelis","is_ca":false},{"name":"Wolfgang Viechtbauer","is_ca":false},{"name":"Mark Simmonds","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6474146937413818,"gpt":0.6854525192511277,"spread":0.03803782550974588,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2462692,0.001460995,0.004577976,0.004342619,0.0006395708,0.003098062,0.003121926,0.003547168,0.002147157],"category_scores_gemma":[0.5461177,0.00140665,0.009982529,0.003708028,0.001642773,0.005290114,0.002403836,0.002934358,0.0003186788],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002586264,"about_ca_system_score_gemma":0.00280358,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001312793,"about_ca_topic_score_gemma":0.001096012,"domain_scores_codex":[0.6920744,0.2855686,0.009278676,0.004012404,0.008510727,0.0005552674],"domain_scores_gemma":[0.35817,0.6088927,0.008296924,0.01503209,0.009127112,0.0004812483],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01078566,0.0004123973,0.01978379,0.01608843,0.08721919,0.0004597833,0.00165265,0.4739935,0.001568175,0.1111936,0.00458223,0.2722606],"study_design_scores_gemma":[0.00944315,0.004139344,0.01554033,0.009241984,0.0312692,0.0008023608,0.0007589807,0.6790972,0.003920202,0.2317119,0.01336705,0.0007083464],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.06107045,0.02347018,0.9069378,0.001737742,0.0004787393,0.001763648,0.0009823936,0.0006663234,0.002892748],"genre_scores_gemma":[0.4825108,0.007577873,0.5020256,0.0008017416,0.0001423199,0.004968366,0.001282719,0.0003022215,0.0003883349],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7537308,"threshold_uncertainty_score":0.9294843,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3109682927","doi":"10.1016/j.cjca.2020.11.010","title":"Missing Data in Clinical Research: A Tutorial on Multiple Imputation","year":2020,"lang":"en","type":"review","venue":"Canadian Journal of Cardiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":956,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":true,"about_ca":false},"ca_institutions":"University Health Network; Institute for Clinical Evaluative Sciences; University of Toronto; Sunnybrook Hospital","funders":"Medical Research Council; Canadian Institutes of Health Research; Chest Heart and Stroke Scotland; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Missing data; Imputation (statistics); Statistics; Medicine; Regression analysis; Sample size determination; Data mining; Confidence interval; Computer science; Mathematics","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Ian R. White","is_ca":false},{"name":"Douglas S. Lee","is_ca":true},{"name":"Stef van Buuren","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6879125250333257,"gpt":0.5908263245184462,"spread":0.09708620051487948,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02424613,0.002135329,0.004339639,0.007295519,0.000562694,0.00302518,0.00392184,0.004750747,0.01380121],"category_scores_gemma":[0.04449711,0.001630913,0.003634902,0.01140682,0.003306146,0.005089846,0.002815198,0.009583461,0.0107305],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002087329,"about_ca_system_score_gemma":0.00413198,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002209509,"about_ca_topic_score_gemma":0.002192539,"domain_scores_codex":[0.9847777,0.00951088,0.001666117,0.0008510088,0.0029932,0.0002011223],"domain_scores_gemma":[0.9377195,0.05601663,0.001915026,0.001268149,0.0025654,0.0005154074],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00005910785,0.00009127012,0.0004254116,0.01669648,0.0004509213,0.0001930787,0.0004024124,0.002141913,0.0002716169,0.06514695,0.1778124,0.7363083],"study_design_scores_gemma":[0.00004198255,0.0000930856,0.0009318078,0.01352464,0.0001386864,0.001304176,0.0001094759,0.001688623,0.000174587,0.1261019,0.8557926,0.00009856076],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"methods","genre_scores_codex":[0.0000914157,0.9188446,0.06280868,0.01008653,0.002319357,0.0001568077,0.0003377949,0.0002593182,0.005095317],"genre_scores_gemma":[0.001510404,0.9260646,0.0565961,0.005757747,0.006436139,0.0005718121,0.0004168425,0.0002161773,0.00243009],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.9757538,"threshold_uncertainty_score":0.1282273,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2130845266","doi":"10.1177/0962280211427759","title":"Extension of the modified Poisson regression model to prospective studies with correlated binary data","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":745,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Statistics; Binary data; Estimator; Poisson distribution; Mathematics; Poisson regression; Logistic regression; Econometrics; Variance (accounting); Regression analysis; Cluster (spacecraft); Binary number; Computer science; Population; Medicine","authors":[{"name":"Guangyong Zou","is_ca":true},{"name":"Allan Donner","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6529093814670139,"gpt":0.6393137010129344,"spread":0.01359568045407955,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04815462,0.0008783173,0.001802225,0.002066024,0.0004912283,0.001464971,0.00451718,0.001494678,0.003036943],"category_scores_gemma":[0.09785425,0.0008428098,0.003067003,0.003176508,0.001244001,0.00189979,0.002109155,0.003247315,0.0008022388],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001112441,"about_ca_system_score_gemma":0.003493292,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003543298,"about_ca_topic_score_gemma":0.003103883,"domain_scores_codex":[0.9760624,0.01882754,0.001112327,0.001753028,0.001964681,0.0002799997],"domain_scores_gemma":[0.9494762,0.03822362,0.004666205,0.004316526,0.002966281,0.0003511785],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004315352,0.0002124894,0.02398317,0.001782929,0.001892016,0.001757908,0.001446691,0.1245579,0.001492481,0.5624952,0.008449356,0.2714983],"study_design_scores_gemma":[0.000335048,0.0005410733,0.006931272,0.0004537994,0.0007020995,0.001314736,0.0002145846,0.3826031,0.0008654845,0.5879287,0.01795951,0.0001505656],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005735541,0.0009492314,0.990401,0.001127218,0.0001434993,0.0003411432,0.0002206759,0.0000909618,0.0009908227],"genre_scores_gemma":[0.1954444,0.004573259,0.7895963,0.001557808,0.0006776008,0.003125666,0.0006426621,0.0001200667,0.004262272],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04815462,"threshold_uncertainty_score":0.254669,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2618058430","doi":"10.1002/sim.7336","title":"Intermediate and advanced topics in multilevel logistic regression analysis","year":2017,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":657,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Sunnybrook Hospital; University of Toronto; Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Vetenskapsrådet; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Marginal model; Logistic regression; Covariate; Multilevel model; Statistics; Hierarchical clustering; Econometrics; Regression analysis; Population; Odds ratio; Regression; Cluster analysis; Computer science; Mathematics; Demography","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Juan Merlo","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1141231773850907,"gpt":0.4782803494377693,"spread":0.3641571720526786,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02834336,0.001470548,0.002011997,0.005637617,0.00108866,0.00432164,0.002497461,0.002526956,0.01719668],"category_scores_gemma":[0.1332437,0.0009230289,0.003603144,0.009889791,0.00301197,0.004496648,0.005159437,0.008467041,0.005828047],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00169445,"about_ca_system_score_gemma":0.003567186,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00193021,"about_ca_topic_score_gemma":0.001764611,"domain_scores_codex":[0.964048,0.02592913,0.002121622,0.002672496,0.004683586,0.0005451192],"domain_scores_gemma":[0.8925722,0.09010526,0.005454675,0.006095084,0.004720509,0.001052383],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001689502,0.0001549022,0.01434522,0.004088396,0.001157697,0.0006751585,0.001448972,0.01138842,0.0008708251,0.4339261,0.1257166,0.4060588],"study_design_scores_gemma":[0.00004978274,0.0001830379,0.006036942,0.002181758,0.0002528743,0.0006592761,0.0003318209,0.04634482,0.0006501324,0.7539292,0.1892503,0.00013016],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004759708,0.04278202,0.9099298,0.02242147,0.002956426,0.0003262149,0.001668298,0.001454522,0.01370161],"genre_scores_gemma":[0.1237067,0.04893828,0.7853301,0.007233446,0.01444516,0.002380565,0.00446634,0.002266329,0.01123322],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02834336,"threshold_uncertainty_score":0.1498958,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1603573412","doi":"10.1186/1471-2288-6-57","title":"Dealing with missing data in a multi-question depression scale: a comparison of imputation methods","year":2006,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":655,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University; University of Calgary","funders":"Canadian Institutes of Health Research; Fondation pour la Recherche Médicale; Government of Canada; Heart and Stroke Foundation of Canada","keywords":"Missing data; Statistics; Imputation (statistics); Statistic; Cohen's kappa; Standard deviation; Population; Mathematics; Kappa; Regression; Psychology; Medicine","authors":[{"name":"Fiona M. Shrive","is_ca":true},{"name":"Heather Stuart","is_ca":true},{"name":"Hude Quan","is_ca":true},{"name":"William A. Ghali","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7482629066797014,"gpt":0.6934678501720167,"spread":0.05479505650768468,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1515152,0.0009509329,0.002519311,0.00309904,0.0008150332,0.001967294,0.002893649,0.002002324,0.001915469],"category_scores_gemma":[0.2307657,0.0009625087,0.004894583,0.003638211,0.0009325636,0.003054744,0.002289782,0.002365651,0.0004868098],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001273715,"about_ca_system_score_gemma":0.001710429,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001279688,"about_ca_topic_score_gemma":0.001805761,"domain_scores_codex":[0.8324543,0.1474718,0.006387175,0.003322291,0.009771772,0.0005927345],"domain_scores_gemma":[0.6125677,0.356052,0.01208729,0.00840681,0.009949323,0.0009369419],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01622683,0.001509374,0.1733069,0.006692924,0.01645385,0.0002334989,0.005209533,0.02659766,0.001079465,0.007078446,0.004498832,0.7411128],"study_design_scores_gemma":[0.008248038,0.02632822,0.3352398,0.01619468,0.01460413,0.003256275,0.00627282,0.5130343,0.008188265,0.04595362,0.02104964,0.001630264],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.3450294,0.03007991,0.6126254,0.003002593,0.0006385022,0.002835896,0.001045642,0.000740301,0.004002402],"genre_scores_gemma":[0.5303615,0.01036981,0.4540009,0.0005907669,0.000234408,0.002884928,0.000835051,0.0002075222,0.0005150019],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1515152,"threshold_uncertainty_score":0.8012988,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2122717603","doi":"10.1503/cmaj.110977","title":"Missing covariate data in clinical research: when and when not to use the missing-indicator method for analysis","year":2012,"lang":"en","type":"article","venue":"Canadian Medical Association Journal","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":542,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"Economic and Social Research Council; Nederlandse Organisatie voor Wetenschappelijk Onderzoek; Cancer Research UK","keywords":"Missing data; Covariate; Computer science; Data mining; Data science; Statistics; Machine learning; Mathematics","authors":[{"name":"Rolf H. H. Groenwold","is_ca":false},{"name":"Ian R. White","is_ca":false},{"name":"A. Rogier T. Donders","is_ca":false},{"name":"James R. Carpenter","is_ca":false},{"name":"Douglas G. Altman","is_ca":false},{"name":"Karel Moons","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4423327546156466,"gpt":0.5402522117396086,"spread":0.09791945712396194,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2776153,0.001222664,0.005366456,0.003611585,0.0018481,0.005416113,0.007034021,0.009180841,0.003915259],"category_scores_gemma":[0.5780327,0.001392359,0.002562865,0.007936428,0.007829897,0.01122819,0.004372687,0.01586245,0.001251624],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0019163,"about_ca_system_score_gemma":0.006977715,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002078935,"about_ca_topic_score_gemma":0.002943542,"domain_scores_codex":[0.6588071,0.3056164,0.01293097,0.006547657,0.01529624,0.0008017818],"domain_scores_gemma":[0.4174664,0.5314236,0.02048511,0.01817284,0.009264999,0.003186994],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.004489378,0.0005280842,0.03570944,0.01033796,0.002600931,0.0007198118,0.004826204,0.006443886,0.0009162016,0.1522067,0.09777578,0.6834457],"study_design_scores_gemma":[0.001194995,0.001124412,0.01171959,0.01187966,0.0008360408,0.001483362,0.001607668,0.0338389,0.001475399,0.8872056,0.04708749,0.0005470042],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008813719,0.07668388,0.7858771,0.119603,0.004717936,0.0008001372,0.001013866,0.0005035384,0.001986806],"genre_scores_gemma":[0.116799,0.03114621,0.8205231,0.0195563,0.008198577,0.001874432,0.0006429588,0.0005034902,0.0007559678],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7223847,"threshold_uncertainty_score":0.890829,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2068225985","doi":"10.1111/j.0006-341x.2001.00158.x","title":"Bayesian Approaches to Modeling the Conditional Dependence Between Multiple Diagnostic Tests","year":2001,"lang":"en","type":"article","venue":"Biometrics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":531,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":true},"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Bayesian probability; Statistics; Econometrics; Inference; Conditional dependence; Bayesian inference; A priori and a posteriori; Statistical hypothesis testing; Mathematics; Computer science; Artificial intelligence","authors":[{"name":"Nandini Dendukuri","is_ca":true},{"name":"Lawrence Joseph","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3859403790451644,"gpt":0.3821515830412841,"spread":0.003788796003880324,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05839879,0.002360766,0.004175688,0.005932287,0.002080322,0.004380092,0.008801395,0.004399854,0.004833551],"category_scores_gemma":[0.1625454,0.003096205,0.003196375,0.005377399,0.005042858,0.005930139,0.004248503,0.006733388,0.0008545638],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004084016,"about_ca_system_score_gemma":0.003553385,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01939134,"about_ca_topic_score_gemma":0.02009287,"domain_scores_codex":[0.9641676,0.02627797,0.001443137,0.004012867,0.003258018,0.0008404201],"domain_scores_gemma":[0.8488623,0.135957,0.006491291,0.00431951,0.003613015,0.0007568446],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002070523,0.0001423817,0.006875453,0.0004683079,0.0009068243,0.0005193895,0.001077335,0.338246,0.0004654969,0.5559733,0.002866089,0.09225226],"study_design_scores_gemma":[0.00007480977,0.00004912976,0.001247035,0.0001153506,0.0001607194,0.0001886617,0.00005911645,0.4789246,0.0001976918,0.5164448,0.002463679,0.00007443161],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.003564537,0.0005814643,0.994194,0.0005719973,0.00003604713,0.0001115761,0.0001551164,0.0001080188,0.0006772413],"genre_scores_gemma":[0.1767044,0.002286134,0.8148187,0.0005447227,0.0004258178,0.001577478,0.0007527748,0.0001170053,0.002772939],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.05839879,"threshold_uncertainty_score":0.308846,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2157235443","doi":"10.1177/0962280214521348","title":"Multiple imputation of covariates by fully conditional specification: Accommodating the substantive model","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":491,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"National Institute on Aging; Economic and Social Research Council; University of California, San Diego; National Institutes of Health; Genentech; IXICO; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; University of California, Los Angeles; Servier; Eisai; Northern California Institute for Research and Education; Pfizer; Biogen; BioClinica; Alzheimer's Association; Amorfix Life Sciences; F. Hoffmann-La Roche; Medpace; AstraZeneca; Eli Lilly and Company; Bristol-Myers Squibb; Novartis Pharmaceuticals Corporation; Synarc; Bayer HealthCare; Alzheimer's Disease Neuroimaging Initiative; Medical Research Council; Meso Scale Diagnostics; Foundation for the National Institutes of Health","keywords":"Covariate; Imputation (statistics); Missing data; Econometrics; Computer science; Statistics; Specification; Mathematics","authors":[{"name":"Jonathan W. Bartlett","is_ca":false},{"name":"Shaun R. Seaman","is_ca":false},{"name":"Ian R. White","is_ca":false},{"name":"James R. Carpenter","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2276033325385271,"gpt":0.5725945814759557,"spread":0.3449912489374286,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04854816,0.001040402,0.002307272,0.001669415,0.0008046348,0.002667854,0.005122334,0.002341991,0.003995533],"category_scores_gemma":[0.1598645,0.001208231,0.002768651,0.004932789,0.001530822,0.003046276,0.004445557,0.004147394,0.001210099],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00088957,"about_ca_system_score_gemma":0.004958197,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003062418,"about_ca_topic_score_gemma":0.003861716,"domain_scores_codex":[0.9532902,0.03901273,0.001627661,0.002246864,0.003031146,0.0007913705],"domain_scores_gemma":[0.8854293,0.08484989,0.005221821,0.01898801,0.004720888,0.0007900204],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003412069,0.0001782241,0.01564111,0.0007962774,0.001005512,0.0005977505,0.001228455,0.2391085,0.001441187,0.4689617,0.01266288,0.2580371],"study_design_scores_gemma":[0.0001421241,0.0001278947,0.001697921,0.0002050906,0.0001958123,0.0003290573,0.00009379063,0.6288177,0.001026791,0.3609422,0.006345931,0.00007566348],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001703267,0.00007241176,0.9974125,0.0002355449,0.00001952022,0.00004524309,0.0001033026,0.0001424598,0.000265662],"genre_scores_gemma":[0.1005037,0.0003285405,0.8964221,0.0003933157,0.0001224917,0.0004234367,0.0008739007,0.0001927809,0.0007396364],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9514518,"threshold_uncertainty_score":0.2567503,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2100697007","doi":"10.1177/0962280214558972","title":"Events per variable (EPV) and the relative performance of different strategies for estimating the out-of-sample validity of logistic regression models","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":484,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; National Institute of Neurological Disorders and Stroke; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Sample size determination; Logistic regression; Sample (material); Mathematics; Regression analysis; Econometrics; Mean squared error; Regression; Linear regression; Variance (accounting); Variables; Economics","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Ewout W. Steyerberg","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3934446952715054,"gpt":0.579674810655022,"spread":0.1862301153835166,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.315842,0.002793229,0.002381639,0.004318582,0.0008581803,0.003318185,0.002918366,0.002885578,0.0006402535],"category_scores_gemma":[0.5071852,0.0009556768,0.004145395,0.002087188,0.004441849,0.004880811,0.004387947,0.003861125,0.0003162101],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001346676,"about_ca_system_score_gemma":0.001551827,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001752906,"about_ca_topic_score_gemma":0.001441409,"domain_scores_codex":[0.803992,0.1630965,0.0092961,0.01095054,0.0110894,0.00157542],"domain_scores_gemma":[0.2198231,0.727664,0.01905683,0.0252997,0.006870094,0.001286308],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.007734605,0.0005596726,0.5463855,0.001233188,0.01097742,0.0005562652,0.002639825,0.269494,0.003111103,0.007467972,0.001422545,0.1484179],"study_design_scores_gemma":[0.0005480819,0.004238619,0.2089285,0.0008154054,0.001388288,0.00100163,0.0009436856,0.7478976,0.01093504,0.02128703,0.00153448,0.0004816649],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.6910125,0.004195445,0.2992523,0.001228768,0.0001731707,0.0005129738,0.0006399172,0.0005106431,0.002474185],"genre_scores_gemma":[0.9456758,0.0003682784,0.05251421,0.0001982871,0.00005043752,0.0002710956,0.0005884896,0.0001147415,0.0002187386],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.684158,"threshold_uncertainty_score":0.8436887,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1845661996","doi":"10.6000/1929-6029.2015.04.03.7","title":"Multiple Imputation by Fully Conditional Specification for Dealing with Missing Data in a Large Epidemiologic Study","year":2015,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":465,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"National Institutes of Health; U.S. President’s Emergency Plan for AIDS Relief; Centers for Disease Control and Prevention; Georgia State University","keywords":"Categorical variable; Missing data; Imputation (statistics); Computer science; Data mining; Multivariate statistics; Statistics; Econometrics; Mathematics; Machine learning","authors":[{"name":"Yang Liu","is_ca":false},{"name":"Anindya K. De","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4574323852140853,"gpt":0.598124388630447,"spread":0.1406920034163617,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08471342,0.001258078,0.00184635,0.003864145,0.001255518,0.002295843,0.004236933,0.002939669,0.006154645],"category_scores_gemma":[0.2467721,0.001623207,0.00330751,0.00815137,0.002762179,0.003526123,0.003799649,0.007681678,0.001948381],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001316286,"about_ca_system_score_gemma":0.007125742,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002818274,"about_ca_topic_score_gemma":0.004388935,"domain_scores_codex":[0.8830714,0.1031908,0.004312978,0.002839916,0.006006746,0.0005781569],"domain_scores_gemma":[0.8534623,0.1146283,0.009551147,0.01582734,0.005574565,0.0009564669],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002704508,0.0001253618,0.01107184,0.003020944,0.001137503,0.000794199,0.002029824,0.07060639,0.001732735,0.533648,0.04554985,0.330013],"study_design_scores_gemma":[0.0001716966,0.0003487766,0.003682172,0.001663818,0.000311107,0.0008867013,0.000316212,0.3419081,0.002348492,0.59224,0.05580161,0.000321402],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.000455444,0.0004247823,0.9976448,0.0005820728,0.00009465556,0.0001185287,0.0001531255,0.0002305342,0.0002960141],"genre_scores_gemma":[0.01588058,0.0008454687,0.9807349,0.0004601938,0.0001861285,0.0009774745,0.0004875783,0.000155635,0.000272068],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.08471342,"threshold_uncertainty_score":0.4480128,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3102763196","doi":"10.7916/d8v99mjx","title":"The Prior Can Often Only Be Understood in the Context of the Likelihood","year":2017,"lang":"en","type":"article","venue":"Columbia Academic Commons (Columbia University)","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":464,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Context (archaeology); Computer science; Econometrics; Statistical physics; Mathematics; Biology; Physics; Paleontology","authors":[{"name":"Andrew Gelman","is_ca":false},{"name":"Daniel Simpson","is_ca":true},{"name":"Michael Betancourt","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0614308441815082,"gpt":0.3068775392655041,"spread":0.2454466950839959,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01481469,0.001547638,0.002076668,0.00344521,0.001811025,0.006388651,0.003753709,0.005222696,0.01209143],"category_scores_gemma":[0.06463864,0.001191969,0.001304223,0.003992705,0.01443348,0.01833827,0.004393271,0.01356002,0.005215233],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002528447,"about_ca_system_score_gemma":0.002199006,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002742766,"about_ca_topic_score_gemma":0.002479509,"domain_scores_codex":[0.9908552,0.004938421,0.000537922,0.001779265,0.001677865,0.0002113195],"domain_scores_gemma":[0.9698966,0.02418455,0.001313524,0.003251272,0.0009903185,0.0003637635],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00000786895,0.000007726927,0.0001410265,0.00009576803,0.00001557893,0.00004371145,0.0001608411,0.001150019,0.0001302297,0.984957,0.002811483,0.01047874],"study_design_scores_gemma":[0.000003345181,0.0000069568,0.0001156837,0.0000993561,0.00001030479,0.00009531784,0.00003780805,0.002387636,0.0001165874,0.9836543,0.01345816,0.00001454583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001696825,0.005017168,0.9556523,0.01607543,0.0008386613,0.00003386952,0.0003904638,0.0002097457,0.02008556],"genre_scores_gemma":[0.2789884,0.02343107,0.6551577,0.01285416,0.006505447,0.0006071975,0.0009748757,0.001195622,0.02028563],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01481469,"threshold_uncertainty_score":0.07834852,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2747622113","doi":"10.3390/e19100555","title":"The Prior Can Often Only Be Understood in the Context of the Likelihood","year":2017,"lang":"en","type":"article","venue":"Entropy","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":451,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"Advanced Research Projects Agency; Office of Naval Research; Alfred P. Sloan Foundation; National Science Foundation","keywords":"Inference; Bayesian probability; Context (archaeology); Entropy (arrow of time); Prior probability; Key (lock); Bayesian inference; Principle of maximum entropy","authors":[],"retraction":null,"screen_n_in":null,"score":{"opus":0.05894595154175716,"gpt":0.3561339327717054,"spread":0.2971879812299483,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01279468,0.001530739,0.002049091,0.003210047,0.001635564,0.005472458,0.00335477,0.004700571,0.009515355],"category_scores_gemma":[0.05093513,0.001065154,0.001273122,0.003427081,0.0133571,0.01727772,0.004209901,0.01169866,0.003869932],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002100001,"about_ca_system_score_gemma":0.001620156,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001763978,"about_ca_topic_score_gemma":0.001645196,"domain_scores_codex":[0.9923409,0.004022911,0.0004649085,0.001506743,0.00147296,0.0001916221],"domain_scores_gemma":[0.9742949,0.02074343,0.001168371,0.002671462,0.0008070692,0.00031464],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000008081304,0.000006991492,0.0001196924,0.0000997252,0.00001534592,0.00004131908,0.000126536,0.001465428,0.0001660582,0.986563,0.001922842,0.009465115],"study_design_scores_gemma":[0.00000257773,0.000007209002,0.0000943764,0.00007327616,0.000008648202,0.00008201752,0.00002616891,0.002747762,0.0001214977,0.9875106,0.00931342,0.00001250973],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.001858076,0.004801868,0.9645399,0.01158981,0.0006482432,0.00002712891,0.0003159487,0.0001545739,0.01606428],"genre_scores_gemma":[0.296144,0.02287021,0.6452211,0.009823866,0.006318199,0.0005097712,0.0008412496,0.0009776038,0.01729402],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9872053,"threshold_uncertainty_score":0.06766552,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1666386643","doi":"10.1214/lnms/1215540964","title":"The Practical Implementation of Bayesian Model Selection","year":2001,"lang":"en","type":"book-chapter","venue":"Lecture notes-monograph series","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":433,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"","keywords":"Selection (genetic algorithm); Computer science; Bayesian probability; Bayesian inference; Model selection; Artificial intelligence","authors":[{"name":"Hugh Chipman","is_ca":true},{"name":"Edward I. George","is_ca":false},{"name":"Robert E. McCulloch","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05280911275820354,"gpt":0.3770241510213588,"spread":0.3242150382631553,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007438814,0.0009420296,0.0008635951,0.001096693,0.0007131029,0.002440417,0.002376778,0.001949661,0.01492764],"category_scores_gemma":[0.022786,0.0007092232,0.0008118892,0.001693792,0.001063058,0.002672937,0.002507488,0.002935016,0.007513294],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009792406,"about_ca_system_score_gemma":0.001657338,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002178834,"about_ca_topic_score_gemma":0.002473636,"domain_scores_codex":[0.9945735,0.003544949,0.0001285236,0.0003351254,0.001317271,0.0001006026],"domain_scores_gemma":[0.9952031,0.003426852,0.000108714,0.0006846087,0.0005196452,0.00005708199],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0000307514,0.00005579373,0.0003614367,0.0001987526,0.00005572162,0.0001824681,0.0002543898,0.04337056,0.0009911014,0.5744089,0.02140414,0.358686],"study_design_scores_gemma":[0.00002942507,0.00002016703,0.0001876558,0.00009427246,0.00001600463,0.000214269,0.00005982038,0.1787152,0.001074912,0.763029,0.05652885,0.00003025464],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0004423661,0.0002619112,0.9893081,0.0008747184,0.0000592233,0.00003315846,0.00004776636,0.0004215638,0.008551289],"genre_scores_gemma":[0.02616001,0.0008603861,0.9654472,0.0003924949,0.0001224515,0.0002272087,0.0001992333,0.0002337214,0.006357268],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01492764,"threshold_uncertainty_score":0.0499379,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2611208896","doi":"10.1101/132753","title":"Modeling zero-inflated count data with glmmTMB","year":2017,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":428,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"Count data; Laplace's method; Generalized linear mixed model; Negative binomial distribution; Overdispersion; Markov chain Monte Carlo; Computer science; Poisson distribution; Statistics; Quasi-likelihood; Range (aeronautics); Generalized linear model; Bayesian probability; Algorithm; Mathematics; Applied mathematics; Engineering","authors":[{"name":"M. Brooks","is_ca":false},{"name":"Kasper Kristensen","is_ca":false},{"name":"Koen J. van Benthem","is_ca":false},{"name":"Árni Magnússon","is_ca":false},{"name":"Casper Willestofte Berg","is_ca":false},{"name":"Anders Nielsen","is_ca":false},{"name":"Hans J. Skaug","is_ca":false},{"name":"Martin Mächler","is_ca":false},{"name":"Benjamin M. Bolker","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08572515254872412,"gpt":0.3282695346689558,"spread":0.2425443821202317,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02312228,0.002955207,0.002893838,0.003855342,0.001348175,0.0044606,0.005955279,0.002759135,0.0195689],"category_scores_gemma":[0.07920998,0.002330868,0.005333316,0.005235607,0.001600607,0.00394946,0.004135767,0.005595555,0.01162328],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001834432,"about_ca_system_score_gemma":0.003112196,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01441486,"about_ca_topic_score_gemma":0.01644834,"domain_scores_codex":[0.9914333,0.005048185,0.0005513958,0.001618206,0.000995888,0.0003531985],"domain_scores_gemma":[0.9614024,0.02824888,0.00263063,0.003627213,0.003596872,0.0004940488],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0008464843,0.0004663811,0.06659151,0.004399048,0.004187834,0.001129168,0.002467674,0.3399932,0.01158401,0.07109128,0.2310932,0.2661501],"study_design_scores_gemma":[0.0001891331,0.000197824,0.01073884,0.0005766136,0.000460246,0.0004140636,0.0002620146,0.7792813,0.005178975,0.1145343,0.08776294,0.0004037804],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01050668,0.0004385847,0.945194,0.0007098252,0.0002903295,0.0001731764,0.00994848,0.03153687,0.001202033],"genre_scores_gemma":[0.07406588,0.00040537,0.8879511,0.0008534541,0.0001192006,0.001885256,0.0136324,0.01906113,0.002026277],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02312228,"threshold_uncertainty_score":0.1222838,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2155013980","doi":"10.1002/nur.20100","title":"Handling missing data in self-report measures","year":2005,"lang":"en","type":"review","venue":"Research in Nursing & Health","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":408,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Windsor","funders":"Wayne State University","keywords":"Missing data; Imputation (statistics); Computer science; Data mining; Statistics; Mathematics; Machine learning","authors":[{"name":"Susan M. Fox-Wasylyshyn","is_ca":true},{"name":"Maher M. El‐Masri","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6966503124980666,"gpt":0.6780807088257569,"spread":0.01856960367230975,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0732979,0.001090769,0.003410324,0.005803511,0.0009321341,0.002780663,0.005230169,0.003095527,0.003014327],"category_scores_gemma":[0.2120925,0.001205872,0.001940914,0.009671646,0.003447521,0.005929439,0.003390442,0.0037417,0.002230088],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001223605,"about_ca_system_score_gemma":0.004482804,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001266754,"about_ca_topic_score_gemma":0.001411855,"domain_scores_codex":[0.916511,0.06081069,0.004668026,0.002704782,0.01478967,0.0005158617],"domain_scores_gemma":[0.7856796,0.183443,0.01289781,0.008477728,0.008954952,0.0005468894],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00011509,0.0001302266,0.005203536,0.01124695,0.0004459673,0.0002477941,0.001365645,0.002993763,0.0003317873,0.04417952,0.01024784,0.9234919],"study_design_scores_gemma":[0.0002500313,0.001158673,0.02664242,0.03499038,0.0009828185,0.006371766,0.002271921,0.02567777,0.005810419,0.6213602,0.2740475,0.0004360216],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.006718459,0.3361848,0.6360849,0.009816859,0.001312348,0.0007090083,0.000546193,0.0005387396,0.00808867],"genre_scores_gemma":[0.08326112,0.3950981,0.5094702,0.003429121,0.002295746,0.002477788,0.001135455,0.0002319584,0.002600536],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.9267021,"threshold_uncertainty_score":0.387641,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2808363984","doi":"10.1002/ecm.1309","title":"Model averaging in ecology: a review of Bayesian, information‐theoretic, and tactical approaches for predictive inference","year":2018,"lang":"en","type":"review","venue":"Ecological Monographs","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":404,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"Seventh Framework Programme; Engineering and Physical Sciences Research Council; University of Melbourne; Bundesministerium für Bildung und Forschung; Deutsches Zentrum für integrative Biodiversitätsforschung Halle-Jena-Leipzig; Deutsche Forschungsgemeinschaft; Australian Research Council; Alexander von Humboldt-Stiftung","keywords":"Variance (accounting); Model selection; Bayesian inference; Covariance; Context (archaeology); Bayesian probability; Computer science; Ecology; Range (aeronautics); Inference; Econometrics; Mathematics; Statistics; Artificial intelligence","authors":[{"name":"Carsten F. Dormann","is_ca":false},{"name":"Justin M. Calabrese","is_ca":false},{"name":"Gurutzeta Guillera‐Arroita","is_ca":false},{"name":"Eleni Matechou","is_ca":false},{"name":"Volker Bahn","is_ca":false},{"name":"Kamil A. Bartoń","is_ca":false},{"name":"Colin M. Beale","is_ca":false},{"name":"Simone Ciuti","is_ca":false},{"name":"Jane Elith","is_ca":false},{"name":"Katharina Gerstner","is_ca":false},{"name":"Jérôme Guélat","is_ca":false},{"name":"Petr Keil","is_ca":false},{"name":"José J. Lahoz‐Monfort","is_ca":false},{"name":"Laura J. Pollock","is_ca":false},{"name":"Björn Reineking","is_ca":false},{"name":"David R. Roberts","is_ca":true},{"name":"Boris Schröder","is_ca":false},{"name":"Wilfried Thuiller","is_ca":false},{"name":"David I. Warton","is_ca":false},{"name":"Brendan A. Wintle","is_ca":false},{"name":"Simon N. Wood","is_ca":false},{"name":"Rafael O. Wüest","is_ca":false},{"name":"Florian Härtig","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1790280268289677,"gpt":0.4110813618337321,"spread":0.2320533350047644,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01647891,0.002344996,0.004004312,0.007383083,0.0009139177,0.004048291,0.00454746,0.003259175,0.0017245],"category_scores_gemma":[0.02336333,0.001311666,0.002846792,0.007866387,0.005356077,0.007533467,0.002449404,0.005967175,0.0008589722],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003190945,"about_ca_system_score_gemma":0.003145532,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005761927,"about_ca_topic_score_gemma":0.003077348,"domain_scores_codex":[0.9943169,0.002887293,0.0004844644,0.0007317752,0.001457699,0.000121898],"domain_scores_gemma":[0.9724788,0.02343912,0.0008998037,0.0008807739,0.002049012,0.0002523734],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00006077521,0.0001164593,0.001510747,0.01049958,0.0009334788,0.0001994049,0.0004147177,0.04450478,0.0005747816,0.4071645,0.0206094,0.5134115],"study_design_scores_gemma":[0.00002513501,0.0001448905,0.001961315,0.007265785,0.0004049366,0.0004883202,0.0001548249,0.06813534,0.0007151128,0.7582037,0.1622332,0.0002673582],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0006486547,0.7824931,0.2065155,0.006024667,0.0008506473,0.00004855617,0.0001647981,0.0001711616,0.003082915],"genre_scores_gemma":[0.02712942,0.8784035,0.08591413,0.001970736,0.005286032,0.0001794556,0.0002245063,0.0001381358,0.0007540499],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9835211,"threshold_uncertainty_score":0.08714986,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2006031679","doi":"10.1186/1471-2288-7-34","title":"A simulation study of sample size for multilevel logistic regression models","year":2007,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":400,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Institute for Clinical Evaluative Sciences; St. Michael's Hospital; University of Toronto","funders":"Ontario Ministry of Health and Long-Term Care","keywords":"Statistics; Sample size determination; Multilevel model; Logistic regression; Random effects model; Variance (accounting); Covariance; Mathematics; Hierarchical database model; Sample (material); Econometrics; Regression; Medicine; Computer science; Meta-analysis; Data mining","authors":[{"name":"Rahim Moineddin","is_ca":true},{"name":"Flora I. Matheson","is_ca":true},{"name":"Richard H. Glazier","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8745461031859402,"gpt":0.6879301196957895,"spread":0.1866159834901506,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05461846,0.000915547,0.001807696,0.001683592,0.001123859,0.001774447,0.002634742,0.002461245,0.003390787],"category_scores_gemma":[0.2355839,0.0007196746,0.002125658,0.002125953,0.001642594,0.002458331,0.002056265,0.003197763,0.0002298751],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002700877,"about_ca_system_score_gemma":0.002232731,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0130631,"about_ca_topic_score_gemma":0.006774671,"domain_scores_codex":[0.9714386,0.02530128,0.0005071524,0.001106211,0.001083866,0.0005629908],"domain_scores_gemma":[0.4851392,0.4912776,0.00743014,0.00661793,0.008253897,0.001281176],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009392232,0.0003417666,0.03924755,0.0003933221,0.0004723324,0.0005544825,0.0007802476,0.9027356,0.0003450244,0.03671673,0.00199189,0.01548188],"study_design_scores_gemma":[0.0001115586,0.0001666572,0.001670712,0.00006925201,0.00007640014,0.0000813584,0.0001384847,0.9893507,0.0001444935,0.007817791,0.0003536364,0.00001901196],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5004105,0.001349083,0.4851601,0.002603449,0.000187235,0.001368552,0.001015506,0.0004592039,0.007446415],"genre_scores_gemma":[0.8857378,0.0003355983,0.1106632,0.0002445157,0.00004077831,0.001374129,0.0006182811,0.00007007657,0.0009157039],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.05461846,"threshold_uncertainty_score":0.2888535,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W94208768","doi":"10.1002/jae.2508","title":"Wild Bootstrap Inference for Wildly Different Cluster Sizes","year":2016,"lang":"en","type":"article","venue":"Journal of Applied Econometrics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":373,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Carleton University; Queen's University","funders":"","keywords":"Estimator; Cluster (spacecraft); Econometrics; Statistics; Variance (accounting); Monte Carlo method; Inference; Mathematics; Computer science; Economics; Artificial intelligence","authors":[{"name":"James G. MacKinnon","is_ca":true},{"name":"Matthew D. Webb","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1001847994653385,"gpt":0.3560613191813742,"spread":0.2558765197160357,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04326613,0.0007553246,0.00201968,0.002397933,0.001787773,0.00287949,0.003035813,0.002326933,0.009939196],"category_scores_gemma":[0.2550901,0.0007349303,0.001980342,0.002150884,0.005900602,0.00451751,0.00257943,0.004981554,0.001176017],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001416171,"about_ca_system_score_gemma":0.001509875,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004060629,"about_ca_topic_score_gemma":0.003176328,"domain_scores_codex":[0.9733988,0.01917394,0.0008741518,0.003924903,0.002073365,0.0005549017],"domain_scores_gemma":[0.7734295,0.1801103,0.005878449,0.03226079,0.007148108,0.001172774],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007568585,0.0002241083,0.01963454,0.0004263284,0.000862859,0.0004646053,0.0009273879,0.11329,0.001279378,0.6966835,0.01668973,0.1487608],"study_design_scores_gemma":[0.0001152918,0.0001148199,0.003964229,0.0002240802,0.0001052229,0.0001818251,0.0002295009,0.298684,0.001403592,0.6892708,0.005646713,0.0000599618],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03361167,0.00049404,0.9617535,0.0006751745,0.000170656,0.0001476228,0.0003690003,0.0004710085,0.002307247],"genre_scores_gemma":[0.6654067,0.000325717,0.3282446,0.0007693031,0.0002288425,0.0005620049,0.001559009,0.0004763358,0.002427438],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04326613,"threshold_uncertainty_score":0.2288159,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2002858652","doi":"10.1002/cjs.5550360302","title":"Bayesian analysis of elapsed times in continuous‐time Markov chains","year":2008,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":344,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico","keywords":"Prior probability; Frequentist inference; Bayesian probability; Posterior probability; Markov chain; Computer science; Mathematics; Bayesian inference; Econometrics; Statistics; Markov chain Monte Carlo","authors":[{"name":"Marco A. R. Ferreira","is_ca":false},{"name":"Marc A. Suchard","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.02815515843739064,"gpt":0.2897788057720888,"spread":0.2616236473346982,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01927722,0.0009270533,0.001994537,0.003269486,0.0009095802,0.003532699,0.003383803,0.002615512,0.00654254],"category_scores_gemma":[0.1008261,0.001502452,0.00186065,0.002675396,0.003696295,0.006055817,0.002185973,0.003978098,0.0006344767],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003433364,"about_ca_system_score_gemma":0.001853698,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009706189,"about_ca_topic_score_gemma":0.00475174,"domain_scores_codex":[0.9925432,0.003759699,0.000315133,0.001401815,0.00146179,0.0005183332],"domain_scores_gemma":[0.9087135,0.07739622,0.004870944,0.003274492,0.004424882,0.001320039],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001787818,0.000049737,0.002399437,0.0001192215,0.0001272274,0.0001439421,0.0002952044,0.4015244,0.000674455,0.5774356,0.001015719,0.01603623],"study_design_scores_gemma":[0.00001929049,0.00002488386,0.000844033,0.00005035368,0.00003051854,0.00003291308,0.00002678991,0.7984609,0.000277728,0.1992762,0.0009179694,0.00003842527],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.03413958,0.0005173124,0.9622414,0.0006211434,0.00005287179,0.00003609554,0.0001575153,0.0001702908,0.002063838],"genre_scores_gemma":[0.8409972,0.001579701,0.1486236,0.0003001493,0.0003194728,0.0002935457,0.0008461874,0.0002717971,0.006768307],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01927722,"threshold_uncertainty_score":0.101949,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2000767414","doi":"10.1007/s10985-007-9065-x","title":"Generalized linear mixed models: a review and some extensions","year":2007,"lang":"en","type":"review","venue":"Lifetime Data Analysis","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":335,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Carleton University; Simon Fraser University","funders":"","keywords":"Computational statistics; Computer science; Generalized linear mixed model; Variety (cybernetics); Software; Generalized linear model; Statistical model; Data science; Programming language; Machine learning; Artificial intelligence","authors":[{"name":"C. B. Dean","is_ca":true},{"name":"Jason D. Nielsen","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3583324276125319,"gpt":0.4960117588798883,"spread":0.1376793312673564,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004479526,0.002109107,0.003556693,0.003551066,0.0004161887,0.002224205,0.003151125,0.002686935,0.003556029],"category_scores_gemma":[0.00781688,0.001047181,0.001479897,0.007780279,0.001655425,0.003041773,0.001329292,0.002990751,0.002371768],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001262244,"about_ca_system_score_gemma":0.002286165,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00357731,"about_ca_topic_score_gemma":0.004252957,"domain_scores_codex":[0.9985599,0.0006006262,0.0001625685,0.0002444164,0.0003937676,0.00003868619],"domain_scores_gemma":[0.9942216,0.004680425,0.0002930085,0.0001992841,0.000545231,0.00006045604],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0000637904,0.000125199,0.0005188882,0.01044124,0.0003074413,0.0002155531,0.0001731655,0.006085129,0.0004641401,0.07661703,0.03218918,0.8727993],"study_design_scores_gemma":[0.00006676144,0.0001646226,0.001864976,0.005218567,0.0006133352,0.002461533,0.0001868912,0.01188617,0.0008813567,0.1982567,0.7782038,0.0001951339],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0003183593,0.9527865,0.04306757,0.001124812,0.0003626639,0.00002910382,0.0001597154,0.00007788149,0.002073355],"genre_scores_gemma":[0.003424264,0.9558631,0.03741317,0.000599812,0.001229677,0.0001040923,0.000179499,0.00003950722,0.001146721],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.004479526,"threshold_uncertainty_score":0.02369028,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3175648361","doi":"10.1186/s40488-021-00121-4","title":"A comparison of zero-inflated and hurdle models for modeling zero-inflated count data","year":2021,"lang":"en","type":"review","venue":"Journal of Statistical Distributions and Applications","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":296,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Zero (linguistics); Count data; Mathematics; Statistics; Computer science; Applied mathematics; Poisson distribution; Philosophy","authors":[{"name":"Cindy Feng","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2947301090636834,"gpt":0.5048017762537285,"spread":0.2100716671900451,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01345588,0.001502812,0.002455037,0.003577447,0.0004616597,0.002784253,0.004259207,0.002281126,0.003206518],"category_scores_gemma":[0.03430404,0.0008240521,0.002711968,0.004399398,0.001386794,0.003688816,0.001458096,0.003203646,0.001413631],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001823633,"about_ca_system_score_gemma":0.002435171,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005711352,"about_ca_topic_score_gemma":0.004104948,"domain_scores_codex":[0.9924299,0.00472512,0.0004507931,0.0007842149,0.001399899,0.0002100597],"domain_scores_gemma":[0.9704481,0.02553153,0.001100718,0.0009201363,0.001776546,0.0002228702],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002070103,0.0001419777,0.006630419,0.00429004,0.0009070282,0.0003690373,0.0006697139,0.1126084,0.0004886871,0.4790416,0.01382837,0.3808179],"study_design_scores_gemma":[0.00008984728,0.0002857615,0.003822619,0.003261508,0.0006207781,0.0009740216,0.0003468834,0.4189813,0.0008518727,0.470995,0.09949327,0.0002771123],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.005835147,0.1540883,0.8305911,0.002629679,0.0005436865,0.0001354655,0.0004425068,0.0003682013,0.005365937],"genre_scores_gemma":[0.2020067,0.3352874,0.4456376,0.002119809,0.001904557,0.00141715,0.00241218,0.0005293796,0.008685164],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.01345588,"threshold_uncertainty_score":0.07116234,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2030605340","doi":"10.1111/cdep.12043","title":"Planned Missing Data Designs for Developmental Researchers","year":2013,"lang":"en","type":"article","venue":"Child Development Perspectives","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":292,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; University of Kansas; National Science Foundation","keywords":"Missing data; Data collection; Research design; Longitudinal data; Psychology; Computer science; Statistics; Data mining; Econometrics; Machine learning; Mathematics","authors":[{"name":"Todd D. Little","is_ca":false},{"name":"Mijke Rhemtulla","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3455343248455911,"gpt":0.4424078329821734,"spread":0.0968735081365823,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.259116,0.002606045,0.003610501,0.003572489,0.001830187,0.003776691,0.006722041,0.004356856,0.01601243],"category_scores_gemma":[0.4922754,0.002117972,0.003507543,0.005106842,0.005927014,0.005766788,0.004204461,0.00780758,0.002184301],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00282741,"about_ca_system_score_gemma":0.008036098,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00114969,"about_ca_topic_score_gemma":0.001052022,"domain_scores_codex":[0.7089699,0.2667975,0.006910047,0.006889964,0.00948058,0.0009521262],"domain_scores_gemma":[0.4291959,0.4844476,0.02314269,0.04113608,0.02049273,0.0015849],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001315251,0.0003023048,0.004211789,0.004030403,0.0009675545,0.0003398538,0.003208468,0.0141685,0.0005878137,0.8105416,0.01710193,0.1432245],"study_design_scores_gemma":[0.001263629,0.00133785,0.00163505,0.002035638,0.0005026576,0.0003085867,0.0004387207,0.05435751,0.001321543,0.9043358,0.03228286,0.000180242],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001195655,0.0005290674,0.9939339,0.0006615487,0.0003437153,0.001810336,0.0003644274,0.000275652,0.0008856591],"genre_scores_gemma":[0.02841107,0.0006971601,0.9499457,0.0005701483,0.0002721911,0.01896784,0.0003739745,0.00009565956,0.0006662598],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7408841,"threshold_uncertainty_score":0.9136419,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2007834077","doi":"10.1080/00949650008812035","title":"Comparison of permutation methods for the partial correlation and partial mantel tests","year":2000,"lang":"en","type":"article","venue":"Journal of Statistical Computation and Simulation","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":286,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal","funders":"","keywords":"Mathematics; Partial correlation; Permutation (music); Statistics; Type I and type II errors; Resampling; Outlier; Population; Covariance matrix; Partial permutation; Applied mathematics; Correlation; Permutation matrix; Algorithm; Medicine","authors":[{"name":"Pierre Legendre","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1232763641789153,"gpt":0.5152636500600378,"spread":0.3919872858811226,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08986937,0.00154823,0.002400516,0.00452895,0.001487745,0.002572562,0.002782703,0.001994599,0.00884984],"category_scores_gemma":[0.4103569,0.0008571988,0.003260123,0.005120543,0.002995887,0.003935719,0.002368483,0.003340334,0.001701143],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001345086,"about_ca_system_score_gemma":0.003397377,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001710666,"about_ca_topic_score_gemma":0.001609353,"domain_scores_codex":[0.8577738,0.1160082,0.004802549,0.006399933,0.01391801,0.001097524],"domain_scores_gemma":[0.5276433,0.4211433,0.01115699,0.02406134,0.01510316,0.0008918742],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.005559159,0.0006438956,0.02451077,0.002562397,0.004341807,0.0005903227,0.002753934,0.04357269,0.003163112,0.09902029,0.01684652,0.7964351],"study_design_scores_gemma":[0.003194522,0.01211394,0.06651308,0.002522158,0.00348745,0.003949912,0.002960184,0.5324973,0.01678822,0.2714472,0.08320955,0.00131647],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04913661,0.002938397,0.9312595,0.000839547,0.001230354,0.002356012,0.0009723037,0.00172088,0.009546364],"genre_scores_gemma":[0.2670517,0.001916553,0.7157969,0.0004689851,0.0004212166,0.008419606,0.001441008,0.001361658,0.003122226],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.08986937,"threshold_uncertainty_score":0.4752803,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2112200626","doi":"10.1186/1471-2288-12-82","title":"Interpreting the concordance statistic of a logistic regression model: relation to the variance and odds ratio of a continuous explanatory variable","year":2012,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":271,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Mathematics; Statistic; Logistic regression; Sample size determination; Normal distribution; Standard deviation; Sampling distribution; PRESS statistic; Monte Carlo method; Variable (mathematics); Cumulative distribution function; Regression analysis; Econometrics; Ancillary statistic; F-test; Probability density function","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Ewout W. Steyerberg","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5031041758697814,"gpt":0.5613378965208847,"spread":0.05823372065110333,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06341407,0.0010493,0.002015884,0.004334131,0.001021123,0.003823999,0.002970544,0.002274881,0.001864331],"category_scores_gemma":[0.416401,0.0007895849,0.001836536,0.003709549,0.004558524,0.002545153,0.00278497,0.002844081,0.0004232976],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002947453,"about_ca_system_score_gemma":0.003299522,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007884999,"about_ca_topic_score_gemma":0.003387836,"domain_scores_codex":[0.9437658,0.03932346,0.002346213,0.006124461,0.007392852,0.001047259],"domain_scores_gemma":[0.4265366,0.5231591,0.02458818,0.01561427,0.008780859,0.001320873],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001187354,0.0001796636,0.6331563,0.0006691999,0.001631588,0.002602411,0.001695839,0.2530561,0.001441343,0.04699138,0.003319823,0.05406896],"study_design_scores_gemma":[0.0001119999,0.0003661445,0.08314411,0.0002630237,0.0004264759,0.003368698,0.0005981144,0.8002089,0.002668892,0.1061129,0.002493547,0.0002371141],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.4865938,0.001796046,0.4994492,0.001689048,0.0002695908,0.0003308414,0.0006931371,0.000685051,0.008493198],"genre_scores_gemma":[0.9730249,0.0001344186,0.02581284,0.0001399493,0.00007857238,0.0001300775,0.0002373149,0.00009507892,0.0003469782],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.06341407,"threshold_uncertainty_score":0.3353697,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2111418884","doi":"10.1111/j.1461-0248.2007.01047.x","title":"Data cloning: easy maximum likelihood estimation for complex ecological models using Bayesian Markov chain Monte Carlo methods","year":2007,"lang":"en","type":"article","venue":"Ecology Letters","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":269,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Ottawa; University of Alberta","funders":"","keywords":"Markov chain Monte Carlo; Frequentist inference; Computer science; Bayesian probability; Algorithm; Likelihood function; Data mining; Bayesian inference; Machine learning; Statistics; Mathematics; Estimation theory; Artificial intelligence","authors":[{"name":"Subhash R. Lele","is_ca":true},{"name":"Brian Dennis","is_ca":false},{"name":"Frithjof Lutscher","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1971455189971549,"gpt":0.4442246778074805,"spread":0.2470791588103257,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01202212,0.001627202,0.001962082,0.00325906,0.001073106,0.002294169,0.004162353,0.002031232,0.0047279],"category_scores_gemma":[0.06542285,0.001664481,0.002175178,0.003400324,0.002148897,0.003827284,0.004610206,0.004929513,0.002034051],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001105344,"about_ca_system_score_gemma":0.002384596,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00263356,"about_ca_topic_score_gemma":0.002467593,"domain_scores_codex":[0.9930444,0.004070893,0.0004062956,0.0007402872,0.001579434,0.0001586342],"domain_scores_gemma":[0.9641103,0.02747239,0.001748147,0.004271788,0.002009702,0.000387799],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008555675,0.0001423592,0.003318239,0.0005164103,0.0003062117,0.0002818876,0.0004995012,0.2343269,0.003818395,0.4472432,0.008548285,0.300913],"study_design_scores_gemma":[0.00003907825,0.00002366236,0.0003439153,0.00005593576,0.00002597164,0.0001007271,0.00001815373,0.7383747,0.001978677,0.2501758,0.00879467,0.0000687272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0002403184,0.00002677237,0.9994003,0.00003189276,0.00001156495,0.00001165227,0.00002710821,0.0001711988,0.00007919918],"genre_scores_gemma":[0.01114679,0.00009709757,0.9876568,0.00007231965,0.00004511506,0.0002578906,0.000157992,0.0003034854,0.0002624897],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01202212,"threshold_uncertainty_score":0.0635798,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2102720558","doi":"10.1109/tsmca.2007.902631","title":"A Novel Framework for Imputation of Missing Values in Databases","year":2007,"lang":"en","type":"article","venue":"IEEE Transactions on Systems Man and Cybernetics - Part A Systems and Humans","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":250,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Alberta","funders":"","keywords":"Imputation (statistics); Computer science; Missing data; Data mining; Machine learning","authors":[{"name":"Alireza Farhangfar","is_ca":true},{"name":"Lukasz Kurgan","is_ca":true},{"name":"Witold Pedrycz","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.112459478147945,"gpt":0.3843434643980513,"spread":0.2718839862501063,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03481632,0.001743562,0.003578117,0.003817525,0.001663,0.005038191,0.008950355,0.003804059,0.00270811],"category_scores_gemma":[0.05284298,0.001767661,0.004798837,0.00748033,0.002900829,0.005708248,0.005920948,0.006057364,0.001581333],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001879305,"about_ca_system_score_gemma":0.005159907,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003431551,"about_ca_topic_score_gemma":0.003747884,"domain_scores_codex":[0.9714612,0.01896527,0.001444766,0.002908681,0.004522231,0.0006977536],"domain_scores_gemma":[0.9693247,0.02117826,0.001934026,0.003972304,0.00295972,0.0006309581],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0001280688,0.00009813849,0.001748538,0.000592289,0.0005328715,0.0004334393,0.0004452646,0.165477,0.0008132108,0.6942994,0.008686902,0.1267448],"study_design_scores_gemma":[0.00007274931,0.0001153428,0.000456273,0.0001598163,0.000125201,0.0004725505,0.00006207156,0.5084096,0.0005305226,0.4723631,0.01715851,0.00007418685],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0001388791,0.0001590929,0.9992507,0.0001638646,0.00002907014,0.00002075229,0.00004924794,0.00004785193,0.0001405793],"genre_scores_gemma":[0.02228689,0.0009805412,0.9737959,0.000386543,0.0004056333,0.0005107899,0.0004805159,0.00006557256,0.001087553],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03481632,"threshold_uncertainty_score":0.1841285,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2084292194","doi":"10.1002/sim.2731","title":"Developments in cluster randomized trials and <i>Statistics in Medicine</i>","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":248,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Royal Society","keywords":"Sample size determination; Medical statistics; Statistics; Cluster (spacecraft); Cluster analysis; Randomized controlled trial; Computer science; Population; Psychological intervention; Research design; Medicine; Econometrics; Data science; Mathematics; Surgery","authors":[{"name":"Michael J. Campbell","is_ca":false},{"name":"Allan Donner","is_ca":true},{"name":"Neil Klar","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08618382227126765,"gpt":0.4329159356107219,"spread":0.3467321133394543,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1457657,0.002188136,0.0059994,0.007049645,0.001398345,0.007007676,0.005191343,0.007548613,0.005148796],"category_scores_gemma":[0.229035,0.001901876,0.003888129,0.01297564,0.01439513,0.00731228,0.004300409,0.02217563,0.002344914],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005929059,"about_ca_system_score_gemma":0.01084121,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002570689,"about_ca_topic_score_gemma":0.001339911,"domain_scores_codex":[0.7996178,0.168229,0.008494695,0.005969251,0.01669221,0.0009970459],"domain_scores_gemma":[0.5907113,0.3693125,0.009268369,0.01601173,0.01283852,0.001857678],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000189679,0.00007970778,0.0004748394,0.00422494,0.0005055555,0.0001243827,0.0004970733,0.004075204,0.0002146068,0.7620524,0.02749569,0.200066],"study_design_scores_gemma":[0.0001777778,0.0003117391,0.000605182,0.002757224,0.0001829798,0.0004756189,0.000136426,0.009123604,0.000529565,0.8313168,0.1542733,0.0001096691],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0005791133,0.1698077,0.7673584,0.03882653,0.01022588,0.0006341304,0.0002573007,0.0004433196,0.01186766],"genre_scores_gemma":[0.01904556,0.1363267,0.798959,0.01945859,0.02003163,0.003277551,0.0002347149,0.0005358639,0.002130437],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8542343,"threshold_uncertainty_score":0.7708917,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1753146223","doi":"10.1016/j.jclinepi.2015.08.015","title":"Sample size calculations for stepped wedge and cluster randomised trials: a unified approach","year":2015,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":241,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"Medical Research Council; National Institute for Health and Care Research","keywords":"Sample size determination; Cluster (spacecraft); Cluster randomised controlled trial; Wedge (geometry); Computer science; Cluster size; Statistics; Randomized controlled trial; Data mining; Mathematics; Medicine; Physics; Surgery","authors":[{"name":"Karla Hemming","is_ca":false},{"name":"Monica Taljaard","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.733403766534936,"gpt":0.6107111935731112,"spread":0.1226925729618248,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1893726,0.002935863,0.005392577,0.007912553,0.001059932,0.004856673,0.008418962,0.006706226,0.00721893],"category_scores_gemma":[0.4407439,0.002419272,0.00467559,0.006400933,0.006030998,0.006915896,0.00635098,0.009883041,0.001880022],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004178756,"about_ca_system_score_gemma":0.006922233,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00160979,"about_ca_topic_score_gemma":0.001262592,"domain_scores_codex":[0.7426711,0.2211216,0.01182163,0.004926744,0.01859233,0.000866546],"domain_scores_gemma":[0.7602214,0.2041249,0.008694436,0.01544318,0.01077422,0.0007419056],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004208237,0.0001183127,0.0007287885,0.002413851,0.0007067319,0.0003338126,0.001014763,0.0648134,0.0009275713,0.7435537,0.009164453,0.1758038],"study_design_scores_gemma":[0.0006493867,0.0004800985,0.0003653438,0.001435001,0.0003451647,0.0003749684,0.0001338698,0.2045201,0.001517554,0.7685409,0.0215003,0.0001373693],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0002320455,0.0003007154,0.9982868,0.0003019822,0.00008175136,0.0003630375,0.000029974,0.00006972507,0.0003339818],"genre_scores_gemma":[0.007577151,0.0004349418,0.9882328,0.0003507323,0.0001098691,0.002939337,0.00004054593,0.00009030128,0.000224394],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8106275,"threshold_uncertainty_score":0.999648,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2134699177","doi":"10.1093/swr/30.1.19","title":"Imputing Missing Data: A Comparison of Methods for Social Work Researchers","year":2006,"lang":"en","type":"article","venue":"Social Work Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":233,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Missing data; Imputation (statistics); Computer science; Multivariate statistics; Data science; Data mining; Statistics; Mathematics; Machine learning","authors":[{"name":"Jessica Saunders","is_ca":false},{"name":"Nancy Morrow‐Howell","is_ca":false},{"name":"Edward L. Spitznagel","is_ca":true},{"name":"P. Doré","is_ca":false},{"name":"Enola K. Proctor","is_ca":false},{"name":"R. Pescarino","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.709767389951839,"gpt":0.6728735764746552,"spread":0.03689381347718379,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3164416,0.002596403,0.004588148,0.0113796,0.002746233,0.008799257,0.005496863,0.005248734,0.003787297],"category_scores_gemma":[0.5273373,0.00236315,0.005075891,0.01257323,0.005515456,0.01023611,0.007699716,0.005898484,0.001200679],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00459443,"about_ca_system_score_gemma":0.007968366,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002874338,"about_ca_topic_score_gemma":0.003577112,"domain_scores_codex":[0.6135948,0.3327614,0.01406699,0.005351578,0.03306101,0.001164172],"domain_scores_gemma":[0.2817849,0.675548,0.007648977,0.01514384,0.01829434,0.001580013],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003059954,0.0005430297,0.008992409,0.008778079,0.003459417,0.0001950177,0.01077123,0.01099674,0.0005069512,0.1224545,0.009605006,0.8206378],"study_design_scores_gemma":[0.003608756,0.005127315,0.03517591,0.02652052,0.003313876,0.002720368,0.01643174,0.180244,0.00445765,0.6060012,0.1143217,0.002077044],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02007809,0.05311783,0.9044411,0.007259806,0.001387855,0.00382006,0.0005429319,0.001319035,0.008033213],"genre_scores_gemma":[0.06699725,0.03221988,0.8885595,0.001124203,0.0004535299,0.008377556,0.0004063199,0.0007207909,0.001141015],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.6835585,"threshold_uncertainty_score":0.8429493,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2576106406","doi":"10.1016/j.prevetmed.2017.01.006","title":"STARD-BLCM: Standards for the Reporting of Diagnostic accuracy studies that use Bayesian Latent Class Models","year":2017,"lang":"en","type":"article","venue":"Preventive Veterinary Medicine","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":219,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Prince Edward Island; McGill University Health Centre","funders":"Canada Excellence Research Chairs, Government of Canada; Canada Research Chairs; McGill University","keywords":"Latent class model; Bayesian probability; Computer science; Test (biology); Checklist; Diagnostic accuracy; Class (philosophy); Artificial intelligence; Machine learning; Medical physics; Data mining; Medicine; Psychology","authors":[{"name":"Polychronis Kostoulas","is_ca":false},{"name":"Søren Saxmose Nielsen","is_ca":false},{"name":"Adam J. Branscum","is_ca":false},{"name":"Wesley O. Johnson","is_ca":false},{"name":"Nandini Dendukuri","is_ca":true},{"name":"Navneet K. Dhand","is_ca":false},{"name":"Nils Toft","is_ca":false},{"name":"Ian A. Gardner","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5081186604439791,"gpt":0.523944825892012,"spread":0.01582616544803284,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4717311,0.00563151,0.01082973,0.03762177,0.003550628,0.01942465,0.02247823,0.02056772,0.02487748],"category_scores_gemma":[0.8774673,0.007693481,0.01342464,0.03268406,0.0106817,0.009724957,0.01993868,0.02586563,0.01776537],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009224367,"about_ca_system_score_gemma":0.03848838,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007127723,"about_ca_topic_score_gemma":0.005525917,"domain_scores_codex":[0.3131557,0.3840084,0.2251606,0.008550707,0.0666953,0.00242936],"domain_scores_gemma":[0.05925088,0.7201771,0.04905549,0.09356641,0.07482255,0.003127517],"domain_codex":"methods","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001984884,0.0006019105,0.005165822,0.0405639,0.004304934,0.0003954193,0.002370568,0.0123105,0.0022861,0.1524525,0.4836836,0.2938799],"study_design_scores_gemma":[0.002492695,0.0008615973,0.01049066,0.0533271,0.002955873,0.001484967,0.0009479478,0.03348014,0.01051284,0.362376,0.5199855,0.001084738],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001409373,0.009702308,0.8943738,0.01632407,0.00484914,0.009516114,0.03996821,0.01480477,0.009052243],"genre_scores_gemma":[0.01501776,0.005049769,0.9089711,0.008424545,0.001350249,0.02980403,0.02628366,0.003213288,0.001885455],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.5282689,"threshold_uncertainty_score":0.6514496,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2064422634","doi":"10.1111/1467-9868.00279","title":"Local Influence for Incomplete Data Models","year":2001,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series B (Statistical Methodology)","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":215,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Victoria","funders":"","keywords":"Likelihood function; Variety (cybernetics); Computer science; Maximum likelihood; Algorithm; Mathematics; Applied mathematics; Mathematical optimization; Data mining; Estimation theory; Artificial intelligence; Statistics","authors":[{"name":"Hong-Tu Zhu","is_ca":true},{"name":"Sik‐Yum Lee","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2733802088295864,"gpt":0.4303219885770805,"spread":0.1569417797474941,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01436913,0.001009259,0.002008858,0.002648529,0.0008628511,0.002195439,0.002266105,0.001435614,0.002607634],"category_scores_gemma":[0.06310428,0.0007181567,0.002074062,0.001287978,0.00397313,0.003264691,0.003610822,0.002995108,0.0004496248],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002108237,"about_ca_system_score_gemma":0.001200296,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002588489,"about_ca_topic_score_gemma":0.00191728,"domain_scores_codex":[0.9885288,0.00717184,0.0002706267,0.001167066,0.002540337,0.0003213088],"domain_scores_gemma":[0.9526178,0.03769259,0.003098318,0.003271585,0.002459998,0.0008596992],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001110532,0.00004073887,0.002729028,0.0003254304,0.0003851336,0.0005897696,0.0005407718,0.3317621,0.002181301,0.6186038,0.001697398,0.04103348],"study_design_scores_gemma":[0.000007942721,0.00003297735,0.0005749736,0.00004291956,0.00003609034,0.0001280339,0.00004721076,0.6806459,0.0008488164,0.3154279,0.002180156,0.00002705816],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005619186,0.0003330868,0.9921392,0.0002320968,0.00002179768,0.00001860128,0.00002549903,0.00008462922,0.001525917],"genre_scores_gemma":[0.6252279,0.001205623,0.3670143,0.0004270537,0.0004138841,0.0003478632,0.000233704,0.0002930656,0.004836521],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01436913,"threshold_uncertainty_score":0.07599211,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2976405568","doi":"10.1002/bimj.201900036","title":"Meta‐analysis of the difference of medians","year":2019,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":212,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University; McGill University Health Centre","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research","keywords":"Median; Statistics; Meta-analysis; Weighting; Sample size determination; Mathematics; Standard deviation; Variance (accounting); Pooled variance; Outcome (game theory); Mean difference; Confidence interval; Medicine; Internal medicine","authors":[{"name":"Sean McGrath","is_ca":true},{"name":"Hojoon Sohn","is_ca":false},{"name":"Russell Steele","is_ca":true},{"name":"Andrea Benedetti","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1875207696650769,"gpt":0.3957336478869019,"spread":0.208212878221825,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.111216,0.002282468,0.009826872,0.008761487,0.0006682634,0.004404958,0.004023317,0.00278602,0.003877542],"category_scores_gemma":[0.28098,0.001149416,0.02140716,0.007645672,0.001522679,0.003481268,0.002182749,0.0042939,0.0004082077],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002004317,"about_ca_system_score_gemma":0.002252429,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001504679,"about_ca_topic_score_gemma":0.001328192,"domain_scores_codex":[0.8703185,0.1093993,0.007059885,0.007146953,0.005625321,0.0004500308],"domain_scores_gemma":[0.7234815,0.2516995,0.009635523,0.0118148,0.002911777,0.0004569241],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"meta_analysis","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.004458616,0.0001951801,0.01909516,0.05003858,0.5922861,0.0008494642,0.0003654019,0.06548155,0.001379141,0.04124196,0.008030414,0.2165784],"study_design_scores_gemma":[0.004226378,0.002465737,0.01495662,0.01186487,0.4590128,0.001468367,0.0003155114,0.1079853,0.004024604,0.3566264,0.03664395,0.0004095402],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02717106,0.3248095,0.6281469,0.006697763,0.003204361,0.001670844,0.004497592,0.0008705914,0.002931386],"genre_scores_gemma":[0.535731,0.06590536,0.3826263,0.004207314,0.001965774,0.004999479,0.002374565,0.0003596351,0.00183068],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.888784,"threshold_uncertainty_score":0.5881736,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2345476363","doi":"10.1080/10705511.2016.1169188","title":"Impact of Misspecifications of the Latent Variance–Covariance and Residual Matrices on the Class Enumeration Accuracy of Growth Mixture Models","year":2016,"lang":"en","type":"article","venue":"Structural Equation Modeling A Multidisciplinary Journal","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":208,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Latent class model; Covariance; Mathematics; Statistics; Covariance matrix; Mixture model; Residual; Population; Variance (accounting); Econometrics; Algorithm","authors":[{"name":"Thierno Diallo","is_ca":false},{"name":"Alexandre J. S. Morin","is_ca":false},{"name":"Huizhong Lu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1216457498936597,"gpt":0.3807370481958413,"spread":0.2590912983021816,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07840035,0.001319375,0.001545609,0.001597138,0.001279086,0.002615804,0.001967106,0.002251996,0.001844578],"category_scores_gemma":[0.3727343,0.0009438346,0.001650782,0.001366811,0.002269635,0.004740867,0.003125533,0.003713824,0.0003103074],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002580669,"about_ca_system_score_gemma":0.002664973,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01164414,"about_ca_topic_score_gemma":0.01101759,"domain_scores_codex":[0.9671943,0.02498617,0.00179246,0.002736145,0.002430398,0.000860511],"domain_scores_gemma":[0.4183204,0.5341681,0.01619959,0.02285019,0.007529321,0.0009323179],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001587219,0.0003361187,0.05889632,0.0002773035,0.0005318961,0.0002464305,0.001436005,0.8447995,0.001901733,0.04299619,0.0009851075,0.04600614],"study_design_scores_gemma":[0.0001216445,0.0004862833,0.009659769,0.000199848,0.0001584855,0.0001759385,0.0004076354,0.955644,0.002991865,0.02921473,0.0008314271,0.0001083357],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.5566549,0.0008647219,0.4362832,0.001316622,0.00008679453,0.0003903458,0.0003824379,0.0004160116,0.003604836],"genre_scores_gemma":[0.91203,0.0002838669,0.08591184,0.0002491493,0.00002461155,0.000306725,0.0005141041,0.0001099612,0.0005696889],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.07840035,"threshold_uncertainty_score":0.4146256,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2756610413","doi":"10.1002/sim.7532","title":"Measures of clustering and heterogeneity in multilevel <scp>P</scp>oisson regression analyses of rates/count data","year":2017,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":206,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Prince Edward Island; University of Toronto; Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Vetenskapsrådet; Heart and Stroke Foundation of Canada","keywords":"Statistics; Poisson regression; Multilevel model; Poisson distribution; Hazard ratio; Proportional hazards model; Count data; Random effects model; Regression analysis; Cluster analysis; Confidence interval; Mathematics; Odds ratio; Rate ratio; Linear regression; Hierarchical clustering; Cluster (spacecraft); Econometrics; Medicine; Meta-analysis; Computer science; Internal medicine; Population","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Henrik Stryhn","is_ca":true},{"name":"George Leckie","is_ca":false},{"name":"Juan Merlo","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4042531616015181,"gpt":0.5285301629397802,"spread":0.1242770013382621,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02922282,0.0004972554,0.001091739,0.004721245,0.0007556032,0.001975258,0.001761597,0.001045068,0.004373983],"category_scores_gemma":[0.1708047,0.0003801024,0.002338981,0.006826541,0.002038914,0.002046781,0.002158795,0.001754103,0.0005357368],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001563419,"about_ca_system_score_gemma":0.001049616,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005787776,"about_ca_topic_score_gemma":0.003882023,"domain_scores_codex":[0.9649846,0.02073218,0.003008292,0.004096145,0.006469579,0.000709293],"domain_scores_gemma":[0.8146182,0.1374074,0.02403751,0.01803542,0.005137029,0.0007643289],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003745402,0.0001806115,0.5183472,0.001366325,0.006040739,0.001478373,0.003140153,0.08366922,0.001370063,0.1863996,0.02021203,0.1774211],"study_design_scores_gemma":[0.00008901799,0.0003402685,0.3625159,0.0008440107,0.0008011307,0.001699906,0.002007382,0.2473398,0.002280916,0.3585367,0.02327658,0.0002684401],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.2321128,0.003102074,0.7388986,0.004013534,0.0003837951,0.0007307314,0.008288891,0.0009012612,0.01156824],"genre_scores_gemma":[0.897347,0.0005351271,0.09524191,0.0004604709,0.0002230253,0.001180188,0.003053151,0.0002119242,0.00174717],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02922282,"threshold_uncertainty_score":0.1545469,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1973761476","doi":"10.1111/j.1541-0420.2008.01058.x","title":"Joint Regression Analysis of Correlated Data Using Gaussian Copulas","year":2008,"lang":"en","type":"article","venue":"Biometrics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":204,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Univariate; Copula (linguistics); Mathematics; Joint probability distribution; Regression analysis; Statistics; Generalized linear model; Logistic regression; Inference; Marginal model; Gaussian; Estimating equations; Multivariate statistics; Econometrics; Computer science; Estimator; Artificial intelligence","authors":[{"name":"Peter X.‐K. Song","is_ca":true},{"name":"Mingyao Li","is_ca":false},{"name":"Ying Yuan","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4876392554906313,"gpt":0.460364406222413,"spread":0.02727484926821827,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01208797,0.001635975,0.002664272,0.002334856,0.0005881761,0.002779105,0.002364276,0.001344764,0.001863215],"category_scores_gemma":[0.03744023,0.0008984734,0.00279588,0.003786038,0.002124258,0.003918705,0.002882376,0.003050182,0.0006728153],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001117309,"about_ca_system_score_gemma":0.001832476,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002806337,"about_ca_topic_score_gemma":0.001919078,"domain_scores_codex":[0.9890631,0.00676279,0.0004784609,0.001649559,0.001692929,0.0003532493],"domain_scores_gemma":[0.9806581,0.01331914,0.002065431,0.002597622,0.001166626,0.0001931145],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00004671584,0.00006647301,0.003153909,0.000260229,0.0005623966,0.0004010193,0.0004386993,0.3039729,0.002146562,0.6042287,0.001734444,0.08298792],"study_design_scores_gemma":[0.000008112502,0.00003515619,0.0008627757,0.0000375599,0.00007704293,0.00009642424,0.00003897768,0.8285445,0.00058105,0.1674915,0.002185055,0.00004183502],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001499058,0.0001260087,0.9979972,0.00005963326,0.00001180368,0.00001079186,0.00002971114,0.00005089751,0.0002147773],"genre_scores_gemma":[0.2222418,0.00264205,0.7704436,0.0003113088,0.0003091788,0.0004659054,0.0005764224,0.0002529142,0.002756853],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01208797,"threshold_uncertainty_score":0.06392807,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2051129785","doi":"10.2202/1557-4679.1171","title":"Inference in Epidemic Models without Likelihoods","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":194,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Guelph","funders":"Natural Sciences and Engineering Research Council of Canada; Biotechnology and Biological Sciences Research Council; Directorate for Biological Sciences","keywords":"Inference; Markov chain Monte Carlo; Computer science; Monte Carlo method; Econometrics; Data mining; Statistics; Machine learning; Artificial intelligence; Mathematics; Bayesian probability","authors":[{"name":"Trevelyan J. McKinley","is_ca":false},{"name":"Alex R. Cook","is_ca":false},{"name":"R. Deardon","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.0851133174261388,"gpt":0.4263022439375115,"spread":0.3411889265113727,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0457713,0.001511973,0.003502368,0.00341825,0.001617515,0.004659055,0.003781184,0.003960652,0.004756791],"category_scores_gemma":[0.2290045,0.002461607,0.002411136,0.003084009,0.005035358,0.01035774,0.003815548,0.005053356,0.0008920489],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002801534,"about_ca_system_score_gemma":0.003869297,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01516664,"about_ca_topic_score_gemma":0.009574087,"domain_scores_codex":[0.9820424,0.01366917,0.0008179413,0.001700049,0.001313909,0.0004566067],"domain_scores_gemma":[0.7836256,0.1996806,0.005036222,0.008092329,0.002695032,0.0008702226],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001318635,0.00005142834,0.003858729,0.0002063624,0.0002211742,0.0002240579,0.0002633035,0.7121635,0.0003087714,0.2543505,0.0009377245,0.02728261],"study_design_scores_gemma":[0.00003204515,0.00001472947,0.0002309893,0.00003749089,0.00001785528,0.00005260181,0.00002229505,0.7747467,0.0001494413,0.224156,0.0005202933,0.00001956788],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008483788,0.0004307901,0.9892057,0.0006734136,0.00003165039,0.00004523353,0.0001222769,0.0002921049,0.0007150568],"genre_scores_gemma":[0.3678966,0.001640829,0.6255092,0.0006336475,0.0002554035,0.0004457457,0.0007718569,0.000331575,0.002515215],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0457713,"threshold_uncertainty_score":0.2420647,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2093789600","doi":"10.2202/1557-4679.1195","title":"Estimating Multilevel Logistic Regression Models When the Number of Clusters is Low: A Comparison of Different Statistical Software Procedures","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Multilevel model; Logistic regression; Computer science; Variance (accounting); Statistical model; Hierarchical database model; Software; Bayesian probability; Mathematics; Data mining; Econometrics","authors":[{"name":"Peter C. Austin","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08904626714055525,"gpt":0.4328148997691603,"spread":0.343768632628605,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1030645,0.00101342,0.002631733,0.003771267,0.00115267,0.002634489,0.003874955,0.001745467,0.003987554],"category_scores_gemma":[0.4144878,0.001079323,0.003691606,0.005520726,0.001786607,0.004102206,0.005071732,0.00326789,0.0007135675],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001933232,"about_ca_system_score_gemma":0.003858201,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005369713,"about_ca_topic_score_gemma":0.009124969,"domain_scores_codex":[0.8635456,0.1191008,0.004669376,0.003960647,0.007822404,0.0009011734],"domain_scores_gemma":[0.5658888,0.3932725,0.01020294,0.01912528,0.01048255,0.001027937],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004697191,0.0008211776,0.08773332,0.005103732,0.007028612,0.0007100552,0.0107267,0.09211794,0.004831906,0.09898749,0.0118589,0.6753829],"study_design_scores_gemma":[0.001609992,0.001955288,0.06676786,0.001959564,0.002971149,0.0008129569,0.00280271,0.6859221,0.008030606,0.2077345,0.01879312,0.0006402346],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.06604794,0.0007301414,0.9288916,0.0007465938,0.00007119952,0.0007886959,0.0004344067,0.0009717831,0.001317644],"genre_scores_gemma":[0.1404551,0.000476541,0.8554844,0.0001903137,0.00003247275,0.002012886,0.0004875823,0.000534041,0.0003267649],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1030645,"threshold_uncertainty_score":0.5450636,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2016919144","doi":"10.1002/sim.2711","title":"Bayesian sensitivity analysis for unmeasured confounding in observational studies","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":184,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia; University of British Columbia Hospital","funders":"","keywords":"Confounding; Statistics; Markov chain Monte Carlo; Bayesian probability; Observational study; Econometrics; Logistic regression; Prior probability; Sample size determination; Sensitivity (control systems); Mathematics; Computer science","authors":[{"name":"Lawrence C. McCandless","is_ca":true},{"name":"Paul Gustafson","is_ca":true},{"name":"Adrian R. Levy","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2203225194206481,"gpt":0.4762013753441512,"spread":0.2558788559235031,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16287,0.001385169,0.00326694,0.004006319,0.001006635,0.003157167,0.003028102,0.003522776,0.002896078],"category_scores_gemma":[0.4815637,0.0009636616,0.003680089,0.003021321,0.003157869,0.003372162,0.003611556,0.003613611,0.0001784923],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003012592,"about_ca_system_score_gemma":0.002308714,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003945926,"about_ca_topic_score_gemma":0.001653432,"domain_scores_codex":[0.8365991,0.1500759,0.002555783,0.003495183,0.006378083,0.0008960147],"domain_scores_gemma":[0.3980834,0.5747087,0.01162935,0.01094235,0.004079066,0.0005570442],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0006708601,0.00009664701,0.01056792,0.001535167,0.003435847,0.0009178739,0.0007600688,0.5666932,0.0006471625,0.3567455,0.002211173,0.0557185],"study_design_scores_gemma":[0.0001885189,0.0001749072,0.002877858,0.0004877764,0.0008702548,0.0003696584,0.0001155269,0.5058632,0.0005926207,0.4853497,0.003016271,0.00009380565],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01751737,0.002340055,0.9750808,0.002014596,0.0001175295,0.0004227799,0.0002281639,0.0001073074,0.002171356],"genre_scores_gemma":[0.739243,0.002951466,0.2530017,0.001303766,0.0002962563,0.001983278,0.0002667602,0.00009065766,0.0008630661],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.16287,"threshold_uncertainty_score":0.8613495,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2013385108","doi":"10.1198/jasa.2010.tm09757","title":"Estimability and Likelihood Inference for Generalized Linear Mixed Models Using Data Cloning","year":2010,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":177,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Natural Sciences and Engineering Research Council of Canada","funders":"","keywords":"Generalized linear mixed model; Estimator; Likelihood function; Binary data; Random effects model; Restricted maximum likelihood; Mathematics; Quasi-likelihood; Frequentist inference; Computer science; Markov chain Monte Carlo; Generalized linear model; Statistics; Poisson distribution; Bayesian probability; Bayesian inference; Binary number; Count data; Estimation theory","authors":[{"name":"Subhash R. Lele","is_ca":true},{"name":"Khurram Nadeem","is_ca":true},{"name":"Byron Schmuland","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1142586750573369,"gpt":0.4378968439773239,"spread":0.323638168919987,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09822444,0.002087708,0.003711362,0.004426465,0.002241716,0.004647575,0.006336994,0.004002686,0.003524576],"category_scores_gemma":[0.4006205,0.00202444,0.005211597,0.005495599,0.008031869,0.008153896,0.009625861,0.008515417,0.0008333133],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002578997,"about_ca_system_score_gemma":0.004121658,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003224206,"about_ca_topic_score_gemma":0.002515288,"domain_scores_codex":[0.882992,0.1033942,0.003273567,0.004887518,0.004818246,0.0006344749],"domain_scores_gemma":[0.5605003,0.3934149,0.01121588,0.02868749,0.005508062,0.0006735229],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001358093,0.00008019283,0.004650519,0.0004650015,0.0004510561,0.0003138721,0.0009292871,0.0504821,0.0004756748,0.8571988,0.001581644,0.08323602],"study_design_scores_gemma":[0.00008967384,0.00006739783,0.0005769971,0.0001664594,0.0001090624,0.0002183563,0.0000985644,0.2293388,0.0009099435,0.764832,0.003536813,0.00005598058],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001316047,0.0001057849,0.9979447,0.000219692,0.00001840074,0.00005586005,0.00005110318,0.00007001671,0.0002184037],"genre_scores_gemma":[0.05179561,0.0003036678,0.9455339,0.0003024034,0.00008926677,0.001147203,0.000314044,0.0001044427,0.0004096071],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.09822444,"threshold_uncertainty_score":0.5194667,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2791458756","doi":"10.2196/medinform.8960","title":"Characterizing and Managing Missing Structured Data in Electronic Health Records: Data Analysis","year":2018,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":174,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"U.S. National Library of Medicine; National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases; National Human Genome Research Institute; University of Pennsylvania; National Institutes of Health; Pennsylvania Department of Health","keywords":"Missing data; Imputation (statistics); Health records; Computer science; Data science; Electronic health record; Data mining; Health care; Machine learning","authors":[{"name":"Brett K. Beaulieu‐Jones","is_ca":false},{"name":"Daniel R. Lavage","is_ca":false},{"name":"John W Snyder","is_ca":false},{"name":"Jason H. Moore","is_ca":false},{"name":"Sarah A. Pendergrass","is_ca":false},{"name":"Christopher R. Bauer","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08677746776859628,"gpt":0.4334871571936644,"spread":0.3467096894250681,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1618055,0.001556426,0.002786629,0.006906434,0.002669608,0.005935527,0.006235376,0.002975062,0.001615854],"category_scores_gemma":[0.3850677,0.001786325,0.003955049,0.01226353,0.003473086,0.008335262,0.005702194,0.005043277,0.0007409051],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002817116,"about_ca_system_score_gemma":0.009961076,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003691247,"about_ca_topic_score_gemma":0.003521664,"domain_scores_codex":[0.7957572,0.1683882,0.01341859,0.006478245,0.01477504,0.001182708],"domain_scores_gemma":[0.4848964,0.4240991,0.03891189,0.03155181,0.01918129,0.001359564],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.0004572458,0.0006800584,0.1853109,0.009158053,0.003380133,0.0006694454,0.007679041,0.1260181,0.002272693,0.07612578,0.02304954,0.565199],"study_design_scores_gemma":[0.0003459515,0.00088503,0.04770602,0.009884449,0.001261775,0.001473706,0.006127028,0.439486,0.01023312,0.441892,0.0400249,0.0006798966],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01498847,0.002085174,0.9748694,0.004452876,0.0001264079,0.0009405634,0.0012791,0.0006104618,0.0006476479],"genre_scores_gemma":[0.1216429,0.002163111,0.8708085,0.0009797481,0.0002506851,0.001648132,0.002115493,0.0001677112,0.0002236778],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.1618055,"threshold_uncertainty_score":0.8557194,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2594511273","doi":"10.1186/s13063-017-1833-7","title":"Analysis of cluster randomised stepped wedge trials with repeated cross-sectional samples","year":2017,"lang":"en","type":"article","venue":"Trials","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":173,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Institute for Health and Care Research","keywords":"Econometrics; Random effects model; Treatment effect; Confounding; Medicine; Statistics; Psychological intervention; Computer science; Mathematics; Meta-analysis","authors":[{"name":"Karla Hemming","is_ca":false},{"name":"Monica Taljaard","is_ca":true},{"name":"Andrew Forbes","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4153827757707162,"gpt":0.5217674289473853,"spread":0.1063846531766691,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2656677,0.003292056,0.00956916,0.002929715,0.001037454,0.003219395,0.00569736,0.005441489,0.01334053],"category_scores_gemma":[0.4101131,0.001688237,0.01217806,0.002740649,0.005145366,0.004010716,0.002661963,0.005498239,0.00108866],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003981315,"about_ca_system_score_gemma":0.00589005,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001699769,"about_ca_topic_score_gemma":0.001098101,"domain_scores_codex":[0.6182008,0.3407097,0.01506586,0.01482981,0.009316543,0.001877328],"domain_scores_gemma":[0.5614479,0.3619709,0.02802952,0.03881248,0.008030083,0.001709163],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.1604851,0.003885376,0.03310363,0.08998206,0.1247445,0.001991949,0.002807438,0.1489518,0.002479895,0.1922144,0.01963248,0.2197213],"study_design_scores_gemma":[0.08966848,0.03280764,0.01278162,0.01481395,0.0393429,0.0008603199,0.0008137007,0.4357331,0.005761495,0.3426391,0.02405452,0.0007231608],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.09080952,0.01760028,0.759142,0.004507886,0.006108091,0.1124287,0.002518725,0.001888711,0.004996177],"genre_scores_gemma":[0.4918115,0.002146693,0.3490272,0.002655657,0.0005232937,0.1505434,0.0009815623,0.0001565229,0.002154123],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.2656677,"threshold_uncertainty_score":0.9055625,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4321788752","doi":"10.1002/icd.2407","title":"Best practices for addressing missing data through multiple imputation","year":2023,"lang":"en","type":"article","venue":"Infant and Child Development","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":172,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Concordia University; Centre Intégré Universitaire de Santé et de Services Sociaux du Centre-Sud-de-l'Île-de-Montréal","funders":"","keywords":"Missing data; Imputation (statistics); Attrition; Computer science; Data collection; Psychology; Statistics; Data science; Data mining; Machine learning; Mathematics","authors":[{"name":"Adrienne D. Woods","is_ca":false},{"name":"Daria Gerasimova","is_ca":false},{"name":"Ben Van Dusen","is_ca":false},{"name":"Jayson Nissen","is_ca":false},{"name":"Sierra A. Bainter","is_ca":false},{"name":"Alex Uzdavines","is_ca":false},{"name":"Pamela Davis‐Kean","is_ca":false},{"name":"Max A. Halvorson","is_ca":false},{"name":"Kevin M. King","is_ca":false},{"name":"Jessica A. R. Logan","is_ca":false},{"name":"Menglin Xu","is_ca":false},{"name":"Martin R. Vasilev","is_ca":false},{"name":"James M. Clay","is_ca":false},{"name":"David Moreau","is_ca":false},{"name":"Keven Joyal‐Desmarais","is_ca":true},{"name":"Rick A. Cruz","is_ca":false},{"name":"Denver M. Y. Brown","is_ca":false},{"name":"Kathleen Schmidt","is_ca":false},{"name":"Mahmoud Medhat Elsherif","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3445098573815719,"gpt":0.4706630859148572,"spread":0.1261532285332853,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3459713,0.003489085,0.004526353,0.01243487,0.003531741,0.01146108,0.01405162,0.006631431,0.01677707],"category_scores_gemma":[0.6837725,0.004468624,0.008445327,0.01554965,0.006807961,0.01029097,0.01026765,0.01288294,0.009203772],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00313668,"about_ca_system_score_gemma":0.01596253,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005915856,"about_ca_topic_score_gemma":0.007841033,"domain_scores_codex":[0.5035696,0.4351899,0.02514338,0.008659974,0.02611092,0.00132635],"domain_scores_gemma":[0.3064308,0.5410778,0.02879407,0.06855226,0.05277695,0.002368191],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0003216701,0.0002237595,0.00473502,0.008893839,0.00294027,0.0005530392,0.007493836,0.02100988,0.0008935007,0.2257536,0.07232526,0.6548563],"study_design_scores_gemma":[0.000331424,0.000165253,0.001781894,0.01626327,0.0008403748,0.0007359641,0.001375661,0.0640268,0.003867466,0.759365,0.1507841,0.0004627599],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0002441868,0.001310196,0.9918094,0.003591614,0.0002739003,0.00040621,0.0003069411,0.0009609498,0.001096592],"genre_scores_gemma":[0.006167971,0.001589156,0.9883221,0.0008673092,0.0002233034,0.001618947,0.000356543,0.0004526527,0.000402071],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.3459713,"threshold_uncertainty_score":0.8065338,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2018795457","doi":"10.3758/bf03206555","title":"Fitting distributions using maximum likelihood: Methods and packages","year":2004,"lang":"en","type":"article","venue":"Behavior Research Methods, Instruments, & Computers","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":167,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Quantile; Weibull distribution; Log-normal distribution; Gumbel distribution; Mathematics; Statistics; Estimator; Gaussian; Applied mathematics; Algorithm; Computer science; Extreme value theory","authors":[{"name":"Denis Cousineau","is_ca":true},{"name":"Scott Brown","is_ca":false},{"name":"Andrew Heathcote","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2979135059293795,"gpt":0.5754612622245866,"spread":0.2775477562952071,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01272376,0.002281049,0.002956723,0.003538614,0.001264232,0.003337757,0.00557928,0.00304648,0.02715645],"category_scores_gemma":[0.06467499,0.002925964,0.002798471,0.004526506,0.001383133,0.004267152,0.003519436,0.005032392,0.01091287],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00100285,"about_ca_system_score_gemma":0.002816503,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002972988,"about_ca_topic_score_gemma":0.003212335,"domain_scores_codex":[0.9934383,0.004599303,0.0003309067,0.0005809375,0.0009057567,0.0001448919],"domain_scores_gemma":[0.9702533,0.02473683,0.0008370364,0.002472007,0.001443535,0.0002572792],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000347127,0.0004477701,0.001578742,0.001442115,0.0007317618,0.0001874794,0.0008255671,0.1509037,0.00163327,0.2366015,0.06090335,0.5443976],"study_design_scores_gemma":[0.0001433125,0.00003653579,0.0005092445,0.0002084862,0.0001228836,0.0002225253,0.00007924847,0.5874226,0.002666636,0.3762646,0.03220186,0.0001220689],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0002071902,0.0000636,0.9976026,0.00006387992,0.00001056306,0.00004401525,0.0001858477,0.001584569,0.0002377244],"genre_scores_gemma":[0.006212773,0.0001717023,0.9905434,0.00004785137,0.00002751993,0.0005331689,0.0004161729,0.001427835,0.0006196909],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02715645,"threshold_uncertainty_score":0.09084737,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}