{"meta":{"query_hash":"9890b73406e3","filters":{"venue":"Statistical Methods in Medical Research"},"cohort_total":233,"direct_labels_cover":2,"predictions_cover":233,"exported":233,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/9890b73406e3","api":"https://metacan.xera.ac/api/v1/cohort?venue=Statistical+Methods+in+Medical+Research"},"results":[{"id":"W1829168467","doi":"10.1191/0962280204sm365ra","title":"Sample size requirements for the design of reliability study: review and new results","year":2004,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":468,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Intraclass correlation; Sample size determination; Reliability (semiconductor); Variance (accounting); Statistics; Sample (material); Computer science; Mathematics; Reliability engineering; Psychometrics","score_opus":0.7388653050513273,"score_gpt":0.6767105014196586,"score_spread":0.0621548036316687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1829168467","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016903144,0.9316053,0.055108465,0.00448324,0.0024661182,0.0020551947,0.00046792906,0.00014607115,0.001977405],"genre_scores_gemma":[0.019856714,0.7844866,0.1728505,0.0040110988,0.0028628611,0.014081824,0.00093136483,0.00020768025,0.00071127136],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8679073,0.0625247,0.033891555,0.0060917065,0.02890284,0.0006819613],"domain_scores_gemma":[0.48804334,0.4582752,0.0154827675,0.0071071056,0.030353334,0.0007382764],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1698967,0.0017832079,0.010847425,0.0077190525,0.00073181366,0.0030030424,0.0053953677,0.0050020544,0.0035893708],"category_scores_gemma":[0.3808528,0.0017506593,0.0046136347,0.0058780173,0.0028664595,0.005736259,0.0020736163,0.0035390412,0.0014460407],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012654215,0.00012734534,0.0011966771,0.11435394,0.0012815387,0.00036211516,0.0003874899,0.0014858264,0.0018695905,0.0074499203,0.013518125,0.85670215],"study_design_scores_gemma":[0.0059087654,0.007839526,0.033078175,0.32168245,0.03182968,0.008435185,0.0012641529,0.010141595,0.012962937,0.067926586,0.497986,0.0009449044],"about_ca_topic_score_codex":0.0019230228,"about_ca_topic_score_gemma":0.0025164005,"teacher_disagreement_score":0.8301033,"about_ca_system_score_codex":0.0034605167,"about_ca_system_score_gemma":0.008207438,"threshold_uncertainty_score":0.8985104},"labels":[],"label_agreement":null},{"id":"W1943072312","doi":"10.1177/0962280215601134","title":"Estimating the effect of treatment on binary outcomes using full matching on the propensity score","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":125,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Mental Health","keywords":"Propensity score matching; Covariate; Confounding; Matching (statistics); Average treatment effect; Inverse probability weighting; Calipers; Statistics; Weighting; Binary number; Mathematics; Computer science; Medicine","score_opus":0.6971779961484548,"score_gpt":0.6699345220452536,"score_spread":0.02724347410320116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1943072312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026127398,0.00094398606,0.9679213,0.00088008476,0.00010902034,0.0012560352,0.00048043806,0.00029799002,0.0019837227],"genre_scores_gemma":[0.35036018,0.0013477575,0.6417786,0.00076114334,0.00015594494,0.0034335714,0.00077741564,0.000105850435,0.001279367],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94147825,0.04940484,0.0020333107,0.0030027376,0.0036091988,0.0004716393],"domain_scores_gemma":[0.86460394,0.11133538,0.007247235,0.014529067,0.0018503134,0.0004340702],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.077549085,0.0012351837,0.0029377188,0.002966739,0.0011341836,0.0019258498,0.0026633877,0.001744889,0.0072856555],"category_scores_gemma":[0.2152091,0.00086679583,0.0042689317,0.003563293,0.0023926117,0.0033411537,0.0037545946,0.0027992812,0.0007214517],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021090398,0.0008776338,0.04631654,0.0023549297,0.0058735707,0.00024134573,0.0015109283,0.12698752,0.0015830557,0.26783466,0.0045737172,0.5397371],"study_design_scores_gemma":[0.0015107553,0.001838526,0.030440765,0.00088476227,0.0021507812,0.00037313043,0.00035914418,0.30603123,0.0034143315,0.63804734,0.014723018,0.0002261595],"about_ca_topic_score_codex":0.004218916,"about_ca_topic_score_gemma":0.0025637532,"teacher_disagreement_score":0.077549085,"about_ca_system_score_codex":0.0018996149,"about_ca_system_score_gemma":0.0031839905,"threshold_uncertainty_score":0.41012365},"labels":[],"label_agreement":null},{"id":"W1967858306","doi":"10.1191/0962280203sm335ra","title":"Fitting competing risks with an assumed copula","year":2003,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":119,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Consejo Nacional de Ciencia y Tecnología","keywords":"Copula (linguistics); Identifiability; Econometrics; Marginal distribution; Parametric statistics; Bivariate analysis; Multivariate statistics; Computer science; Parametric model; Mathematics; Statistics; Random variable","score_opus":0.5286679617407478,"score_gpt":0.6699203937793321,"score_spread":0.14125243203858429,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967858306","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008195045,0.00017941956,0.99053264,0.0002789387,0.000029052002,0.00004335904,0.00011018261,0.00012372107,0.00050762796],"genre_scores_gemma":[0.45896342,0.0012501896,0.5326165,0.000637773,0.00027114182,0.0009399974,0.0010402362,0.0003551228,0.0039256345],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99062914,0.0064849234,0.0003470383,0.00096586754,0.0011471607,0.000425801],"domain_scores_gemma":[0.9693425,0.02399134,0.0020638176,0.0028761586,0.0013088993,0.0004172962],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015940942,0.001559097,0.0026837983,0.001756769,0.0007134122,0.0028707215,0.0035858983,0.002608347,0.0029851482],"category_scores_gemma":[0.06748116,0.00134973,0.0028971857,0.0020345256,0.0014506418,0.0030318594,0.002524394,0.003636842,0.0010105579],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013843268,0.00012766036,0.005141434,0.00022995623,0.0005160575,0.0007293359,0.00041722256,0.6841788,0.0008679124,0.2563248,0.0030824447,0.04824589],"study_design_scores_gemma":[0.000020860036,0.000050637776,0.00062038447,0.000027540525,0.00004046315,0.0001892866,0.000027102999,0.8846349,0.00015360682,0.11318525,0.0010183147,0.000031615597],"about_ca_topic_score_codex":0.0046222,"about_ca_topic_score_gemma":0.0020965901,"teacher_disagreement_score":0.015940942,"about_ca_system_score_codex":0.0010726756,"about_ca_system_score_gemma":0.0020758081,"threshold_uncertainty_score":0.08430481},"labels":[],"label_agreement":null},{"id":"W1974493848","doi":"10.1191/0962280202sm278ra","title":"Analysis of repeated events","year":2002,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Biomedical Text Mining and Ontologies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":143,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Computer science; Event (particle physics); Marginal model; Medicine; Machine learning; Regression analysis","score_opus":0.3234065665027732,"score_gpt":0.6439255386965067,"score_spread":0.3205189721937335,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1974493848","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013612753,0.07316925,0.8951995,0.0027457583,0.0010488627,0.00080751366,0.0041727563,0.000919044,0.00832465],"genre_scores_gemma":[0.2360952,0.08651036,0.6534034,0.0023164141,0.0029021984,0.0029208546,0.009251489,0.00046076206,0.006139251],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98127466,0.0093132965,0.0019668182,0.003163727,0.004041609,0.00023986663],"domain_scores_gemma":[0.8902195,0.08951974,0.009412881,0.005992922,0.004437337,0.0004177062],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020647401,0.0015755022,0.0028347864,0.0060039517,0.0006297487,0.003316192,0.002371321,0.0013053027,0.0048396327],"category_scores_gemma":[0.07056534,0.00061288424,0.0031470798,0.006543427,0.0018374659,0.0041745356,0.0017900962,0.0019713102,0.001349505],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034436796,0.00012711211,0.03061307,0.010481212,0.0033622808,0.0017112027,0.001217795,0.0068995017,0.0024549607,0.045921642,0.011083175,0.8857836],"study_design_scores_gemma":[0.00018703929,0.0007916744,0.08193152,0.0069206264,0.0048646415,0.010046283,0.0020969082,0.039198034,0.008977655,0.5870699,0.257496,0.00041973556],"about_ca_topic_score_codex":0.001250864,"about_ca_topic_score_gemma":0.0012456616,"teacher_disagreement_score":0.020647401,"about_ca_system_score_codex":0.0010074098,"about_ca_system_score_gemma":0.002128423,"threshold_uncertainty_score":0.10919523},"labels":[],"label_agreement":null},{"id":"W1977586926","doi":"10.1191/0962280202sm289ra","title":"Analysis of data with excess zeros","year":2002,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":156,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Biometrics; Wilcoxon signed-rank test; Econometrics; Statistics; Statistical hypothesis testing; Statistical power; Test (biology); Statistical model; Computer science; Data set; Statistical analysis; Mathematics; Artificial intelligence; Mann–Whitney U test","score_opus":0.640358640075248,"score_gpt":0.6721812143614034,"score_spread":0.031822574286155425,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977586926","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10201207,0.0017513877,0.89062923,0.0011000974,0.00032090713,0.00017679804,0.0009830346,0.0006948093,0.002331664],"genre_scores_gemma":[0.82275045,0.0012559049,0.16903204,0.0005948882,0.0005550168,0.0005490214,0.0025163256,0.00026806627,0.002478254],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98197836,0.01056938,0.0010902162,0.002553773,0.0032932484,0.00051498367],"domain_scores_gemma":[0.85733545,0.11443371,0.007848822,0.016161703,0.0035309982,0.0006893036],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.020227032,0.0010435992,0.0022438809,0.0037624456,0.0007768435,0.0034274387,0.0015319962,0.001323282,0.0041580796],"category_scores_gemma":[0.12981613,0.0005142059,0.0014803734,0.0037974652,0.0026620748,0.003935929,0.0024432205,0.0019467504,0.0008477636],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002995774,0.00043842202,0.07479698,0.0024538636,0.0020866296,0.0030327453,0.002788047,0.08094699,0.014507914,0.2667977,0.0107162045,0.53843874],"study_design_scores_gemma":[0.00010672325,0.00068062847,0.028519051,0.00029400893,0.0003068952,0.001650974,0.0008370731,0.4188205,0.0067038694,0.5301441,0.011768576,0.00016756254],"about_ca_topic_score_codex":0.00044272907,"about_ca_topic_score_gemma":0.00027554802,"teacher_disagreement_score":0.979773,"about_ca_system_score_codex":0.0007221698,"about_ca_system_score_gemma":0.001045995,"threshold_uncertainty_score":0.10697204},"labels":[],"label_agreement":null},{"id":"W1982070055","doi":"10.1177/0962280211436004","title":"Impact of weighted composite compared to traditional composite endpoints for the design of randomized controlled trials","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian VIGOUR Centre; University of Alberta","funders":"","keywords":"Discriminative model; Composite number; Weighting; Statistics; Event (particle physics); Clinical endpoint; Sample size determination; Component (thermodynamics); Mathematics; Clinical trial; Medicine; Computer science; Econometrics; Algorithm; Artificial intelligence; Internal medicine","score_opus":0.827207652661658,"score_gpt":0.7242513774061305,"score_spread":0.10295627525552742,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982070055","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05082338,0.010660302,0.9142909,0.004848982,0.0030096332,0.008054603,0.0008789802,0.0006078855,0.006825281],"genre_scores_gemma":[0.37425432,0.0023680339,0.6013405,0.003577449,0.00087040477,0.015658248,0.00046246382,0.00033962692,0.0011289712],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.3493685,0.59494984,0.017670363,0.012123621,0.02478038,0.0011073528],"domain_scores_gemma":[0.141497,0.813853,0.017702928,0.019968541,0.0057093757,0.0012690581],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4357853,0.0028110659,0.004677436,0.0027313433,0.001065051,0.0037655334,0.0025768713,0.004193682,0.009392022],"category_scores_gemma":[0.6997781,0.0013676228,0.007570206,0.0036023909,0.004307097,0.007409713,0.0041160528,0.0072737257,0.00073253026],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1136019,0.0020826515,0.02357217,0.014238312,0.024191458,0.0006529155,0.0022105486,0.12404955,0.003825683,0.23743638,0.009542319,0.44459614],"study_design_scores_gemma":[0.034696076,0.04442099,0.016505465,0.0043995962,0.012760297,0.0007955129,0.00034422183,0.3392675,0.0060255877,0.5011373,0.038957793,0.00068970205],"about_ca_topic_score_codex":0.00054248783,"about_ca_topic_score_gemma":0.0006482485,"teacher_disagreement_score":0.5642147,"about_ca_system_score_codex":0.002774784,"about_ca_system_score_gemma":0.004076353,"threshold_uncertainty_score":0.6957772},"labels":[],"label_agreement":null},{"id":"W1993762614","doi":"10.1177/0962280212448974","title":"A Skew-t space-varying regression model for the spectral analysis of resting state brain activity","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Blind Source Separation Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Down Syndrome Research Foundation; Simon Fraser University; University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Skew; Resting state fMRI; Regression analysis; State space; Regression; Mathematics; Computer science; Statistics; Econometrics; Statistical physics; Neuroscience; Psychology; Physics","score_opus":0.2554435893414817,"score_gpt":0.595130034201998,"score_spread":0.33968644486051625,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1993762614","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017496359,0.00013103097,0.98131883,0.0001330906,0.000034260385,0.00008183038,0.0002512039,0.00030166926,0.00025176557],"genre_scores_gemma":[0.43629473,0.00090862514,0.548094,0.0003197023,0.0001997765,0.0012466091,0.0023067407,0.0003963414,0.010233569],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9960556,0.0025246001,0.00016132489,0.0007193539,0.00034258925,0.00019646152],"domain_scores_gemma":[0.9915633,0.0060414285,0.0007196223,0.00074212824,0.0008077123,0.00012583722],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011025746,0.0012317419,0.0012850992,0.0011704162,0.00057129824,0.00100267,0.0023212226,0.0014525253,0.0043886327],"category_scores_gemma":[0.019521452,0.0007286053,0.0023358103,0.0013774126,0.0011880996,0.001731186,0.0011037177,0.0018645215,0.0013435065],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011449535,0.00025475217,0.011648875,0.00023663531,0.00066616485,0.0006895467,0.0006859871,0.663329,0.010801782,0.19497052,0.0034446444,0.11212709],"study_design_scores_gemma":[0.000033829576,0.0001263618,0.0013947345,0.000012620301,0.00004301032,0.00010383638,0.000023074586,0.97256947,0.0006516933,0.023756934,0.00124794,0.000036577094],"about_ca_topic_score_codex":0.0060543735,"about_ca_topic_score_gemma":0.0061304346,"teacher_disagreement_score":0.011025746,"about_ca_system_score_codex":0.00081295276,"about_ca_system_score_gemma":0.0016905144,"threshold_uncertainty_score":0.05831039},"labels":[],"label_agreement":null},{"id":"W1993980658","doi":"10.1177/0962280213505804","title":"Studying noncollapsibility of the odds ratio with marginal structural and logistic regression models","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Economic and Environmental Valuation","field":"Economics, Econometrics and Finance","cited_by":144,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé; Health Canada; Canada Research Chairs; Thrasher Research Fund; McGill University; McGill University Health Centre; World Health Organization","keywords":"Covariate; Confounding; Observational study; Statistics; Logistic regression; Econometrics; Marginal structural model; Odds ratio; Odds; Point estimation; Regression; Mathematics","score_opus":0.4115418379409699,"score_gpt":0.47321997805756816,"score_spread":0.06167814011659828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1993980658","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04054851,0.0010567833,0.95505804,0.001162517,0.00006742343,0.00019219352,0.00019761252,0.0001867569,0.0015302122],"genre_scores_gemma":[0.67377543,0.0014062015,0.32000527,0.0005695651,0.00029414258,0.00087633374,0.0004968214,0.00017460041,0.0024015666],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9008196,0.08103393,0.0028792443,0.008660024,0.005400704,0.0012065073],"domain_scores_gemma":[0.45407054,0.48751736,0.027240964,0.02612292,0.004165443,0.00088273303],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11302755,0.0018817236,0.0023902636,0.003110976,0.0007769013,0.0034752884,0.0042717014,0.0024045773,0.004165807],"category_scores_gemma":[0.3678103,0.0014647341,0.0041150306,0.003283247,0.007428542,0.0056555383,0.006442273,0.0046943845,0.00046215754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006076337,0.00016079114,0.05406721,0.00085657573,0.002967358,0.0012086659,0.002103622,0.21462005,0.0014016598,0.658067,0.0014577167,0.062481783],"study_design_scores_gemma":[0.00012226167,0.0003803175,0.010273206,0.0002409417,0.00041907604,0.0004596864,0.00021101677,0.49648032,0.0010310876,0.4869072,0.0033753235,0.000099616394],"about_ca_topic_score_codex":0.005334143,"about_ca_topic_score_gemma":0.00239197,"teacher_disagreement_score":0.11302755,"about_ca_system_score_codex":0.0024242315,"about_ca_system_score_gemma":0.0019899483,"threshold_uncertainty_score":0.597754},"labels":[],"label_agreement":null},{"id":"W1994201608","doi":"10.1191/0962280203sm340ra","title":"Detecting activation in fMRI data","year":2003,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":96,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Neurological Institute and Hospital","funders":"","keywords":"Excursion; Computer science; Artificial intelligence; Pattern recognition (psychology); Key (lock); Statistics; Mathematics","score_opus":0.4958300143860889,"score_gpt":0.6114019961467672,"score_spread":0.11557198176067823,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1994201608","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18240638,0.00030041588,0.8126659,0.00027600452,0.00006898057,0.0003393711,0.0009123571,0.0011911121,0.0018394729],"genre_scores_gemma":[0.45713183,0.00025788383,0.53923124,0.00021619287,0.00013482521,0.000616809,0.0013003219,0.0002534129,0.00085743447],"study_design_codex":"bench_or_experimental","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99882823,0.00040666517,0.000077325414,0.00032973886,0.0002582509,0.00009979368],"domain_scores_gemma":[0.9969746,0.001970587,0.00024591698,0.0004686522,0.00022333158,0.00011692038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021946118,0.000670764,0.0010187154,0.0021101737,0.00039669184,0.0009168809,0.00074749964,0.0013311565,0.0019934324],"category_scores_gemma":[0.010148464,0.0003126984,0.00049720303,0.0011100337,0.0010254899,0.0009856777,0.0009268987,0.0010052726,0.0005550425],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007444795,0.00021348782,0.008824537,0.00054787204,0.00027398343,0.0008471337,0.0005645468,0.009446166,0.6829354,0.008975869,0.0017658459,0.28486064],"study_design_scores_gemma":[0.00018798903,0.0016849686,0.19601725,0.00014695051,0.0004119252,0.0066815405,0.0005845627,0.2125663,0.4614748,0.10069286,0.019157786,0.0003930378],"about_ca_topic_score_codex":0.00037018926,"about_ca_topic_score_gemma":0.00062701054,"teacher_disagreement_score":0.0021946118,"about_ca_system_score_codex":0.00022450367,"about_ca_system_score_gemma":0.00039992481,"threshold_uncertainty_score":0.011606336},"labels":[],"label_agreement":null},{"id":"W1999384961","doi":"10.1177/0962280214550516","title":"Beyond the treatment effect: Evaluating the effects of patient preferences in randomised trials","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Medicine; Econometrics; Mathematics","score_opus":0.5884113956304523,"score_gpt":0.6665425784460107,"score_spread":0.07813118281555842,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1999384961","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013461184,0.038598437,0.9084239,0.017361958,0.0026660694,0.009731137,0.00073212007,0.00041529533,0.008609953],"genre_scores_gemma":[0.39442703,0.012025324,0.5507796,0.009202562,0.0020783553,0.029206771,0.00034382674,0.0002830457,0.0016534529],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.098547734,0.8721722,0.009875161,0.0053934366,0.013349858,0.000661699],"domain_scores_gemma":[0.086132556,0.877631,0.0153738875,0.017010013,0.0030577558,0.00079466257],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.61976683,0.0048467643,0.0122874575,0.005984175,0.0014984873,0.00979744,0.0054692333,0.013566724,0.009372305],"category_scores_gemma":[0.8310105,0.0027455166,0.01517655,0.006523822,0.018686047,0.021738647,0.007324179,0.014859125,0.0010115944],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014526412,0.0007200687,0.007296045,0.026725875,0.020023942,0.00035012246,0.0019060445,0.06109376,0.00056289986,0.6075891,0.0051580663,0.2540476],"study_design_scores_gemma":[0.0071064634,0.008632715,0.0031870273,0.009288189,0.0053330767,0.0004492462,0.0003273921,0.09272088,0.0014196069,0.85670924,0.014465882,0.0003602658],"about_ca_topic_score_codex":0.0013395152,"about_ca_topic_score_gemma":0.00094773737,"teacher_disagreement_score":0.38023317,"about_ca_system_score_codex":0.00926691,"about_ca_system_score_gemma":0.010361862,"threshold_uncertainty_score":0.46889526},"labels":[],"label_agreement":null},{"id":"W2002026546","doi":"10.1177/0962280212453891","title":"Meta-analysis using Dirichlet process","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Dirichlet process; Latent Dirichlet allocation; Hierarchical Dirichlet process; Dirichlet distribution; Generalized Dirichlet distribution; Computer science; Bayesian probability; Process (computing); Marginal likelihood; Statistics; Econometrics; Data mining; Mathematics; Topic model; Dirichlet's energy; Information retrieval","score_opus":0.4948803650150258,"score_gpt":0.630971933392843,"score_spread":0.13609156837781716,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2002026546","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013017359,0.007556745,0.98823535,0.0010835195,0.0002448636,0.00040206642,0.00029495347,0.00026900598,0.00061173533],"genre_scores_gemma":[0.080488965,0.009376002,0.9014101,0.0010637733,0.0007192045,0.0048152073,0.00070928637,0.0002617721,0.0011557391],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8107085,0.166604,0.0055806814,0.009184121,0.00725969,0.0006629024],"domain_scores_gemma":[0.79270214,0.19254805,0.004222594,0.0076522366,0.0023922797,0.00048261587],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11023166,0.0032147479,0.012104553,0.013910756,0.0021707667,0.008089115,0.0070140236,0.005074244,0.0066974494],"category_scores_gemma":[0.22202444,0.003020078,0.015111903,0.011090203,0.0029885122,0.0069422727,0.00525231,0.008004652,0.0010243064],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006740297,0.00015013576,0.004229509,0.008116035,0.026569106,0.0006326368,0.001529262,0.25330186,0.0007775282,0.45703846,0.0077687628,0.23921268],"study_design_scores_gemma":[0.00036150496,0.00012355407,0.00063833006,0.0012809145,0.0036780224,0.00026738067,0.00010644151,0.22379857,0.0005394438,0.75810486,0.010939845,0.00016112521],"about_ca_topic_score_codex":0.0042384085,"about_ca_topic_score_gemma":0.004339575,"teacher_disagreement_score":0.88976836,"about_ca_system_score_codex":0.0043986025,"about_ca_system_score_gemma":0.005105337,"threshold_uncertainty_score":0.5829677},"labels":[],"label_agreement":null},{"id":"W2009966581","doi":"10.1177/0962280208092559","title":"Meta-analyses of safety data: a comparison of exact versus asymptotic methods","year":2008,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Health Canada","keywords":"Computer science; Statistics; Mathematics; Medicine; Econometrics","score_opus":0.9908641569893527,"score_gpt":0.8447660122197003,"score_spread":0.14609814476965244,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2009966581","genre_codex":"review","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012138453,0.58670014,0.38804275,0.0021425432,0.0011570748,0.0046505616,0.0020650334,0.00050355314,0.0025998978],"genre_scores_gemma":[0.20501779,0.18164146,0.5882314,0.0023729596,0.0015464101,0.018066475,0.0021943692,0.00037645255,0.0005527769],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.39686853,0.50806,0.057643082,0.007905866,0.028757256,0.0007652605],"domain_scores_gemma":[0.30106795,0.63966364,0.028325558,0.021776598,0.008615913,0.0005504212],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.29388088,0.0029145428,0.014657601,0.015647586,0.0009184605,0.0077132727,0.004313242,0.0034453785,0.0032941895],"category_scores_gemma":[0.640708,0.002290589,0.021700127,0.01612566,0.0018224552,0.010920973,0.0045458786,0.0037236041,0.000548215],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012086155,0.00032655313,0.014081879,0.19070444,0.20454687,0.00052641344,0.00094590004,0.016452054,0.0007446344,0.044456586,0.0060040005,0.5091246],"study_design_scores_gemma":[0.023110349,0.009208121,0.021912286,0.10495416,0.41895717,0.0040053474,0.0009761014,0.064764805,0.0033763738,0.28628653,0.061017804,0.0014309392],"about_ca_topic_score_codex":0.00097315013,"about_ca_topic_score_gemma":0.0016667006,"teacher_disagreement_score":0.7061191,"about_ca_system_score_codex":0.0030698865,"about_ca_system_score_gemma":0.004080337,"threshold_uncertainty_score":0.8707706},"labels":[],"label_agreement":null},{"id":"W2017373633","doi":"10.1177/0962280207081866","title":"Surrogate endpoints: wishful thinking or reality?","year":2008,"lang":"en","type":"editorial","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Wishful thinking; Surrogate endpoint; Psychology; Computer science; Medicine; Cognitive psychology; Internal medicine","score_opus":0.6801096472464887,"score_gpt":0.682748615074429,"score_spread":0.002638967827940264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2017373633","genre_codex":"commentary","genre_gemma":"editorial","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031386497,0.16241306,0.29841757,0.4964011,0.014386515,0.00031762465,0.00046766098,0.0002609743,0.024196757],"genre_scores_gemma":[0.3325474,0.15763631,0.22411768,0.20419057,0.06852899,0.0025561345,0.0009809011,0.000749368,0.008692635],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.79636186,0.17099029,0.008387578,0.005737305,0.016982839,0.0015400774],"domain_scores_gemma":[0.5379076,0.40735415,0.017877601,0.016555399,0.0161747,0.0041304817],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19201489,0.0028028092,0.0049643717,0.0046489984,0.003413637,0.019439025,0.0056994944,0.01286646,0.0073979385],"category_scores_gemma":[0.2958697,0.0011721865,0.0023372564,0.0048284684,0.053326853,0.027728902,0.008662638,0.030013785,0.0024389962],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023355306,0.00007191008,0.0010476499,0.0014864441,0.00019649498,0.0002576995,0.0014149345,0.0018120845,0.00012782832,0.89418995,0.025097435,0.0740639],"study_design_scores_gemma":[0.00003228486,0.000051185867,0.0001259252,0.0015328662,0.000032081276,0.00015939097,0.00032734123,0.0013495303,0.000111901434,0.9662308,0.029995719,0.000050975952],"about_ca_topic_score_codex":0.0015925119,"about_ca_topic_score_gemma":0.0010118604,"teacher_disagreement_score":0.8079851,"about_ca_system_score_codex":0.008046616,"about_ca_system_score_gemma":0.009363614,"threshold_uncertainty_score":0.9963895},"labels":[],"label_agreement":null},{"id":"W2019366647","doi":"10.1177/0962280213503924","title":"Robust inference for mixed censored and binary response models with missing covariates","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Covariate; Estimator; Outlier; Inference; Computer science; Monte Carlo method; Missing data; Econometrics; Statistics; M-estimator; Robust statistics; Mathematics; Artificial intelligence","score_opus":0.41380458300558887,"score_gpt":0.5995737200556673,"score_spread":0.18576913705007847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2019366647","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036789335,0.00033873523,0.9954626,0.00013553194,0.000018524359,0.00002359385,0.000066738685,0.00014939072,0.00012602404],"genre_scores_gemma":[0.31449753,0.0010248703,0.68053555,0.0004283984,0.00024004758,0.00063723157,0.000726596,0.00022969747,0.001680041],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.979905,0.015799826,0.0005477691,0.0021408184,0.001246891,0.00035979733],"domain_scores_gemma":[0.9405707,0.049917314,0.004300453,0.0040592016,0.00079408527,0.00035826414],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029488439,0.0013658304,0.0031120956,0.002243137,0.000557787,0.0017735823,0.0045843297,0.0024070733,0.0021023164],"category_scores_gemma":[0.094709314,0.0011723596,0.002611604,0.002708553,0.002627056,0.0026135808,0.002487547,0.0029756154,0.00041579906],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000489991,0.00018074347,0.003323565,0.00060508086,0.0014148111,0.00048335455,0.0002778699,0.54355234,0.0019607146,0.38149953,0.0014397743,0.06477221],"study_design_scores_gemma":[0.00007976955,0.00010090568,0.0006329182,0.000040923802,0.00009541776,0.000082040504,0.000023073178,0.779327,0.0006349047,0.21788958,0.0010566332,0.000036872418],"about_ca_topic_score_codex":0.002294841,"about_ca_topic_score_gemma":0.0017858725,"teacher_disagreement_score":0.029488439,"about_ca_system_score_codex":0.0012801558,"about_ca_system_score_gemma":0.0014152566,"threshold_uncertainty_score":0.15595168},"labels":[],"label_agreement":null},{"id":"W2020953180","doi":"10.1177/0962280210391443","title":"A Bayesian destructive weighted Poisson cure rate model and an application to a cutaneous melanoma data","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico","keywords":"Markov chain Monte Carlo; Poisson distribution; Bayesian inference; Bayesian probability; Mathematics; Statistics; Cure rate; Applied mathematics; Medicine; Surgery","score_opus":0.5453015859287329,"score_gpt":0.6948447323734955,"score_spread":0.14954314644476263,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2020953180","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.070439495,0.00088532135,0.9234469,0.0013917651,0.00007247483,0.0002612813,0.0010381298,0.0002659033,0.002198852],"genre_scores_gemma":[0.6071166,0.0018982209,0.37619284,0.00061209325,0.0002915432,0.00088333536,0.0037648324,0.00018588998,0.009054644],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9975364,0.0014132498,0.000104195315,0.00042326792,0.00040520416,0.00011769587],"domain_scores_gemma":[0.9936539,0.0047550113,0.0004879744,0.00044692698,0.0004904134,0.00016577494],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0098043345,0.0006553581,0.0011617363,0.0017733554,0.0005491585,0.0015991483,0.0025061104,0.0023311356,0.0025823433],"category_scores_gemma":[0.016949963,0.0005500449,0.0016662918,0.0018447023,0.00085841876,0.0013320855,0.0014409471,0.002481736,0.0005932104],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002970666,0.00021044636,0.012143047,0.00034751996,0.00017584709,0.00123384,0.0008025436,0.69676054,0.003405579,0.19396967,0.004524119,0.0861298],"study_design_scores_gemma":[0.00003071059,0.00007615659,0.0018387858,0.000028489898,0.000028377688,0.00034583468,0.0000758544,0.9569192,0.000505267,0.036477674,0.0036228443,0.000050938135],"about_ca_topic_score_codex":0.008883253,"about_ca_topic_score_gemma":0.0062507004,"teacher_disagreement_score":0.0098043345,"about_ca_system_score_codex":0.001169547,"about_ca_system_score_gemma":0.0009598863,"threshold_uncertainty_score":0.051850915},"labels":[],"label_agreement":null},{"id":"W2024260148","doi":"10.1191/0962280203sm350oa","title":"Comparison of methods to identify outliers observed in health services small area variation studies","year":2003,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Healthcare Policy and Management","field":"Economics, Econometrics and Finance","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Population Health Research Institute; Hospital for Sick Children; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Confidence interval; Statistics; Outlier; Skewness; Medicine; Demography; Statistical hypothesis testing; Mathematics; Econometrics","score_opus":0.6626424859726238,"score_gpt":0.6637911482392466,"score_spread":0.001148662266622802,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2024260148","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14837088,0.00389155,0.833564,0.00083192985,0.0006571235,0.005993992,0.0011721712,0.0012460533,0.004272326],"genre_scores_gemma":[0.49313417,0.0009839808,0.49556744,0.00031498808,0.00021140829,0.0077483156,0.0010917959,0.00035046393,0.00059735967],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.5678406,0.37351128,0.02130901,0.009408631,0.026644178,0.0012863288],"domain_scores_gemma":[0.18977788,0.7550471,0.016662218,0.014447222,0.022806577,0.0012589962],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27355516,0.0015563782,0.00256095,0.012713985,0.0010570926,0.0031905065,0.0037898875,0.00174696,0.0022355758],"category_scores_gemma":[0.58667976,0.0008239653,0.0044852346,0.009267282,0.0024788375,0.0032772245,0.004403465,0.0023016385,0.00028552554],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005453732,0.0007143418,0.31837043,0.0052455026,0.01436,0.0007930279,0.011591605,0.032973215,0.0015651197,0.03250871,0.0075757653,0.56884855],"study_design_scores_gemma":[0.0030566964,0.008622803,0.3386551,0.004008791,0.0053626564,0.0018005157,0.013572808,0.49977955,0.0075896885,0.08311178,0.03344359,0.0009959792],"about_ca_topic_score_codex":0.0041645374,"about_ca_topic_score_gemma":0.0041694446,"teacher_disagreement_score":0.72644484,"about_ca_system_score_codex":0.0023604801,"about_ca_system_score_gemma":0.00401948,"threshold_uncertainty_score":0.8958358},"labels":[],"label_agreement":null},{"id":"W2035404753","doi":"10.1177/0962280215584401","title":"The performance of inverse probability of treatment weighting and full matching on the propensity score in the presence of model misspecification when estimating the effect of treatment on survival outcomes","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":325,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Mental Health","keywords":"Propensity score matching; Observational study; Matching (statistics); Statistics; Inverse probability weighting; Hazard ratio; Inverse probability; Covariate; Average treatment effect; Selection bias; Confounding; Weighting; Marginal structural model; Econometrics; Selection (genetic algorithm); Mathematics; Computer science; Medicine; Confidence interval; Posterior probability; Bayesian probability; Artificial intelligence","score_opus":0.5863130353224311,"score_gpt":0.5806095152849405,"score_spread":0.005703520037490528,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035404753","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09423201,0.0023148803,0.8993744,0.0005758584,0.00016761711,0.0006758491,0.00019946888,0.00039660855,0.002063386],"genre_scores_gemma":[0.5164662,0.0011806686,0.4796246,0.00040021463,0.00012342053,0.0008669392,0.0004346655,0.00018545902,0.00071776536],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.90809554,0.077786826,0.0035322122,0.004155118,0.0057218834,0.0007084448],"domain_scores_gemma":[0.75116295,0.20471425,0.011598333,0.02604081,0.005690562,0.0007931436],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12336686,0.0014464215,0.0025211615,0.0031427373,0.000909724,0.0025380298,0.0021013743,0.0019634492,0.002198558],"category_scores_gemma":[0.3221789,0.0011204729,0.003246184,0.0029108287,0.0021188345,0.0037910144,0.004931708,0.0024346446,0.0004148356],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027574566,0.00030098803,0.050361026,0.0013928354,0.004375666,0.00025958163,0.0012226802,0.27737272,0.0025224022,0.051737223,0.001979167,0.6057182],"study_design_scores_gemma":[0.0005681652,0.0011255981,0.021924304,0.0005419058,0.001210023,0.0005680492,0.00019849787,0.84129256,0.003994491,0.12326427,0.0050497022,0.00026241003],"about_ca_topic_score_codex":0.003744821,"about_ca_topic_score_gemma":0.0021041988,"teacher_disagreement_score":0.87663317,"about_ca_system_score_codex":0.001351644,"about_ca_system_score_gemma":0.0028754154,"threshold_uncertainty_score":0.6524341},"labels":[],"label_agreement":null},{"id":"W2035409154","doi":"10.1177/0962280210372454","title":"A comparison of classification algorithms for the identification of smoke plumes from satellite images","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Energy and Environment Impacts","field":"Environmental Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Simon Fraser University; Western University","funders":"","keywords":"Smoke; Satellite; Satellite imagery; Remote sensing; Computer science; Identification (biology); Environmental science; Air quality index; Data mining; Meteorology; Geography","score_opus":0.2288055250202884,"score_gpt":0.5778930655071207,"score_spread":0.3490875404868323,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035409154","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24129006,0.0066544646,0.7317568,0.0009932638,0.000842894,0.00081090437,0.0013698937,0.0061876164,0.010094063],"genre_scores_gemma":[0.39966777,0.0030935728,0.58868796,0.00028843118,0.00016187118,0.00048005738,0.0035105157,0.0005640067,0.003545762],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99623775,0.0008708153,0.0005007857,0.0005337881,0.0015556662,0.00030114653],"domain_scores_gemma":[0.98315746,0.009427645,0.00067465514,0.0009978415,0.0054748976,0.00026752474],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008304815,0.0013697408,0.0013434778,0.005961981,0.0008880414,0.0021411066,0.0018117091,0.002153952,0.0015391521],"category_scores_gemma":[0.020345246,0.00042599684,0.001421309,0.0032003182,0.00048346087,0.0026676178,0.0009259807,0.0011106424,0.0012875655],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018038693,0.00046785612,0.014971697,0.00045989035,0.0005904805,0.0000620007,0.00019214938,0.05119258,0.005860432,0.0026368888,0.004922971,0.9168392],"study_design_scores_gemma":[0.00016278565,0.0005733808,0.028597007,0.0001449502,0.0002278624,0.00030503457,0.00040895966,0.951083,0.0096799005,0.0039976034,0.004699167,0.00012030452],"about_ca_topic_score_codex":0.009468095,"about_ca_topic_score_gemma":0.00680331,"teacher_disagreement_score":0.009468095,"about_ca_system_score_codex":0.0011659897,"about_ca_system_score_gemma":0.0013252982,"threshold_uncertainty_score":0.043920636},"labels":[],"label_agreement":null},{"id":"W2036536239","doi":"10.1177/0962280213480576","title":"An adaptive clinical trials procedure for a sensitive subgroup examined in the multiple sclerosis context","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; McGill University","funders":"University of British Columbia","keywords":"Context (archaeology); Multiple sclerosis; Biomarker; Medicine; Clinical trial; Subgroup analysis; Oncology; Statistical power; Internal medicine; Outcome (game theory); Statistics; Meta-analysis; Immunology; Mathematics","score_opus":0.9252194452879065,"score_gpt":0.7518419097395197,"score_spread":0.17337753554838675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036536239","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010282998,0.00017653487,0.9834722,0.0005894949,0.0001965368,0.003930736,0.0002044373,0.00031970176,0.0008273696],"genre_scores_gemma":[0.15372159,0.00013039903,0.8277798,0.0008315923,0.00014149769,0.01616221,0.00027075433,0.0000892624,0.00087285374],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7656708,0.21305045,0.0056189145,0.008616852,0.0061019445,0.00094108307],"domain_scores_gemma":[0.72765446,0.22474453,0.010864727,0.02983421,0.0055643767,0.0013376562],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22465648,0.0017378879,0.0028873866,0.002317491,0.0011698072,0.0020352993,0.0030287243,0.0043175137,0.007933062],"category_scores_gemma":[0.3403716,0.0010155196,0.003799587,0.0026056638,0.0055385255,0.0032615687,0.0036513244,0.006129116,0.0009299089],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016798927,0.0010729613,0.021873478,0.0020432118,0.0053356234,0.001585288,0.0027452814,0.103769496,0.010007815,0.4099118,0.010734751,0.41412136],"study_design_scores_gemma":[0.0059639635,0.007896192,0.007306183,0.00051630905,0.0013459905,0.000759942,0.00028806017,0.56516373,0.010092124,0.3741665,0.02623671,0.00026443595],"about_ca_topic_score_codex":0.0007111426,"about_ca_topic_score_gemma":0.00064104423,"teacher_disagreement_score":0.77534354,"about_ca_system_score_codex":0.0015008765,"about_ca_system_score_gemma":0.004120897,"threshold_uncertainty_score":0.9561366},"labels":[],"label_agreement":null},{"id":"W2043640852","doi":"10.1177/0962280213476771","title":"Adjusted inference procedures for the interobserver agreement in twin studies","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Statistics; Confidence interval; Statistic; Statistical inference; Computer science; Interval estimation; Statistical hypothesis testing; Multiple comparisons problem; Sample size determination; Cohen's kappa; Kappa; Test statistic; Mathematics; Econometrics; Artificial intelligence","score_opus":0.7237431735697322,"score_gpt":0.680536609079811,"score_spread":0.04320656448992122,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2043640852","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002697601,0.00020090704,0.99619305,0.00013641558,0.000057238354,0.00023023652,0.0000721874,0.00011921969,0.00029313038],"genre_scores_gemma":[0.07640016,0.00023638892,0.9200612,0.00024106551,0.00011196901,0.0022378163,0.00020222153,0.00012033332,0.00038889513],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6816028,0.27025083,0.012921299,0.014525209,0.019100292,0.0015995362],"domain_scores_gemma":[0.44314638,0.4775779,0.025562156,0.03273526,0.019927904,0.0010503861],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22018185,0.0021112796,0.0026359414,0.007130882,0.0017806405,0.0035204599,0.00815326,0.0035016444,0.003808378],"category_scores_gemma":[0.59241533,0.0017728937,0.00402411,0.0053324937,0.0040300256,0.004574472,0.0048681614,0.0055999854,0.00082688534],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012375987,0.00027850296,0.025765657,0.0015074945,0.0039416,0.0007785505,0.00521817,0.07991679,0.0031586825,0.44608572,0.0056153093,0.4264959],"study_design_scores_gemma":[0.00037980042,0.0006783034,0.015387489,0.0006237803,0.0011495007,0.0008342451,0.0003608482,0.2733393,0.0047491356,0.6937298,0.008364179,0.00040357813],"about_ca_topic_score_codex":0.003511355,"about_ca_topic_score_gemma":0.0025556874,"teacher_disagreement_score":0.7798182,"about_ca_system_score_codex":0.0024465478,"about_ca_system_score_gemma":0.0034915444,"threshold_uncertainty_score":0.9616546},"labels":[],"label_agreement":null},{"id":"W2047330460","doi":"10.1177/0962280212446326","title":"Log Gaussian Cox processes and spatially aggregated disease incidence data","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":49,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cancer Care Ontario; Public Health Ontario; University of Toronto","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Cox process; Markov chain Monte Carlo; Inference; Computer science; Gaussian; Statistics; Mixture model; Econometrics; Gaussian network model; Gaussian process; Data mining; Mathematics; Monte Carlo method; Poisson distribution; Artificial intelligence","score_opus":0.3339326463437911,"score_gpt":0.6084049746751412,"score_spread":0.2744723283313501,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047330460","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016562944,0.00033793284,0.98055637,0.000544949,0.000059983602,0.00008126996,0.00046907843,0.00022698731,0.0011604987],"genre_scores_gemma":[0.69344866,0.001820427,0.2922913,0.00043881036,0.00038104842,0.0010501987,0.0015679569,0.00010139071,0.008900103],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99553275,0.0026369984,0.00017272931,0.0006817311,0.000724428,0.00025141268],"domain_scores_gemma":[0.97746915,0.017478002,0.002192218,0.0015787529,0.0009841179,0.00029770847],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010199003,0.0007116124,0.0010405513,0.0020073853,0.0005855502,0.0020809646,0.002326436,0.0016657796,0.0032354863],"category_scores_gemma":[0.029937113,0.0007069427,0.0013520367,0.0026762101,0.0020089573,0.0030489406,0.0017779049,0.0027909493,0.0005542181],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009446469,0.00006603546,0.009287133,0.00012673979,0.00013432557,0.00031848392,0.00043758957,0.44109532,0.00041036095,0.51798093,0.0022072932,0.02784136],"study_design_scores_gemma":[0.00003249352,0.000045814733,0.0013968449,0.00002479062,0.000030323103,0.000085276326,0.00006770017,0.7915693,0.0001683031,0.2033999,0.0031519136,0.000027394692],"about_ca_topic_score_codex":0.012593952,"about_ca_topic_score_gemma":0.008713711,"teacher_disagreement_score":0.012593952,"about_ca_system_score_codex":0.0019152544,"about_ca_system_score_gemma":0.001954849,"threshold_uncertainty_score":0.05393809},"labels":[],"label_agreement":null},{"id":"W2047721006","doi":"10.1177/09622802070160030704","title":"Book review: Kraemer HC, Kraemer-Lowe K, Kupfer DJ 2005: To your health: How to understand what research tells us about risk. New York: Oxford University Press. xviii + 270 pp. Tables and figures. US$49.95 Hardcover. ISBN 0 19 517870 X (#149)","year":2007,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Historical and modern epidemiology studies","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Sociology; Gerontology; Medicine","score_opus":0.3301029359075657,"score_gpt":0.5567726553447272,"score_spread":0.22666971943716152,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047721006","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00011275224,0.9306468,0.00079012895,0.015656838,0.03156321,0.00014171434,0.0015811572,0.00016476946,0.019342689],"genre_scores_gemma":[0.0011267761,0.91046464,0.0015557773,0.009354858,0.012012437,0.00018299335,0.0018430726,0.00013284324,0.063326664],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986929,0.0001814196,0.00016635,0.0001728823,0.0007007739,0.00008571371],"domain_scores_gemma":[0.99442416,0.0021802534,0.0005906487,0.00015578812,0.0023025814,0.00034647543],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014823186,0.0019611705,0.0036039301,0.0066716704,0.0006415362,0.002932483,0.0023178593,0.0022488525,0.06045822],"category_scores_gemma":[0.009076872,0.000816793,0.0011443725,0.009843483,0.0009004875,0.00268253,0.0013416748,0.0035765995,0.067549184],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017110808,0.0000068285417,0.000033574866,0.0026353935,0.000022755232,0.00003112716,0.000025022497,0.00004338774,0.000050123635,0.00031439628,0.9254597,0.07136062],"study_design_scores_gemma":[0.000016617809,0.00001254214,0.0002699842,0.0038348162,0.00004498432,0.00041828473,0.000021396007,0.000022669941,0.00004467888,0.00043638365,0.99486226,0.000015530368],"about_ca_topic_score_codex":0.005761039,"about_ca_topic_score_gemma":0.011582794,"teacher_disagreement_score":0.06045822,"about_ca_system_score_codex":0.0018175755,"about_ca_system_score_gemma":0.004042218,"threshold_uncertainty_score":0.20225286},"labels":[],"label_agreement":null},{"id":"W2048205624","doi":"10.1191/0962280203sm323ra","title":"Latent mixed Markov modelling of smoking transitions using Monte Carlo bootstrapping","year":2003,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Smoking Behavior and Cessation","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Health Information; Western University","funders":"","keywords":"Bootstrapping (finance); Markov chain; Markov chain Monte Carlo; Statistics; Goodness of fit; Econometrics; Markov model; Mathematics; Computer science; Bayesian probability; Psychology","score_opus":0.3686365064289348,"score_gpt":0.5523188855137922,"score_spread":0.18368237908485735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2048205624","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033926226,0.0002632347,0.963654,0.00022902682,0.000047016092,0.0001685115,0.00018630584,0.0003519226,0.001173683],"genre_scores_gemma":[0.6158357,0.00055285025,0.37526253,0.00016493099,0.00009371807,0.0015654217,0.001072386,0.00020434157,0.005248066],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99627846,0.002776543,0.00014571635,0.0003463948,0.00026599894,0.00018684566],"domain_scores_gemma":[0.97103846,0.025725747,0.001142085,0.0008171626,0.0010185749,0.00025798788],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0097158365,0.00080146093,0.0017020223,0.0015706851,0.00090086804,0.0015474189,0.002756571,0.0017173846,0.0055020577],"category_scores_gemma":[0.030682126,0.0009766282,0.0021584292,0.0015652359,0.0013309004,0.0016638285,0.0014216149,0.0023235958,0.00070641877],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011046242,0.000072051254,0.0032165963,0.00009609963,0.00011209413,0.00016237465,0.00029060122,0.90502256,0.00031555083,0.07350164,0.000577437,0.016522514],"study_design_scores_gemma":[0.0000069986168,0.0000104805995,0.00016554324,0.000010621206,0.000006289544,0.000007765536,0.000012199787,0.99034685,0.00004094303,0.009152172,0.00023307808,0.000007034523],"about_ca_topic_score_codex":0.027123928,"about_ca_topic_score_gemma":0.022344325,"teacher_disagreement_score":0.027123928,"about_ca_system_score_codex":0.0016221884,"about_ca_system_score_gemma":0.001557364,"threshold_uncertainty_score":0.05393207},"labels":[],"label_agreement":null},{"id":"W2049288534","doi":"10.1177/0962280214530608","title":"Penalized count data regression with application to hospital stay after pediatric cardiac surgery","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Epidemiology","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Montreal Children's Hospital","funders":"National Center for Advancing Translational Sciences; National Institute of Environmental Health Sciences; National Institute of Diabetes and Digestive and Kidney Diseases; National Cancer Institute; National Heart, Lung, and Blood Institute","keywords":"Poisson regression; Medicine; Lasso (programming language); Feature selection; Count data; Elastic net regularization; Regression; Statistics; Poisson distribution; Regression analysis; Renal function; Computer science; Internal medicine; Mathematics; Machine learning; Population","score_opus":0.2466960887406669,"score_gpt":0.6088668988222045,"score_spread":0.36217081008153756,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2049288534","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03607839,0.0005413596,0.96161574,0.00075210596,0.00008970588,0.00007232094,0.00016414342,0.00024292414,0.00044316947],"genre_scores_gemma":[0.6458481,0.0010653295,0.3456693,0.00054421445,0.000360063,0.000492879,0.000980928,0.00026194387,0.0047771884],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9948612,0.0036403416,0.00024337597,0.0005635876,0.00046130008,0.0002301843],"domain_scores_gemma":[0.9793361,0.016677562,0.0014421048,0.00076601666,0.0014844028,0.00029370957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010030086,0.0008401437,0.0011509428,0.00096988224,0.00051552703,0.0010065626,0.0023448027,0.0012426191,0.0015352718],"category_scores_gemma":[0.027690208,0.00052013836,0.0012645947,0.0012019932,0.0009519727,0.0011483129,0.0013850256,0.0022927292,0.00027817412],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031461837,0.00013475007,0.022473346,0.00020936306,0.00025883576,0.00043600088,0.0001386381,0.8599967,0.0009109633,0.028021084,0.0024387955,0.08466704],"study_design_scores_gemma":[0.00001018162,0.00002090207,0.00081883825,0.000009493463,0.000009737965,0.000025366218,0.000009804201,0.9951368,0.00017381909,0.0033825545,0.00039471596,0.000007678442],"about_ca_topic_score_codex":0.0057880697,"about_ca_topic_score_gemma":0.0043803253,"teacher_disagreement_score":0.010030086,"about_ca_system_score_codex":0.00083330966,"about_ca_system_score_gemma":0.0014672204,"threshold_uncertainty_score":0.053044796},"labels":[],"label_agreement":null},{"id":"W2052404934","doi":"10.1177/0962280214553330","title":"On the analysis of composite measures of quality in medical research","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Health Canada; Partenariat Canadien Contre Le Cancer; Heart and Stroke Foundation of Canada","keywords":"Binomial regression; Statistics; Logistic regression; Generalized linear model; Mathematics; Generalized estimating equation; Poisson regression; Marginal model; Regression analysis; Negative binomial distribution; Overdispersion; Quasi-likelihood; Linear regression; Gee; Econometrics; Poisson distribution; Medicine; Population","score_opus":0.89062208648722,"score_gpt":0.7857866714285195,"score_spread":0.10483541505870042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052404934","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02600478,0.010868509,0.95221514,0.0027811218,0.00043679622,0.0014965044,0.00051554316,0.00019134459,0.005490172],"genre_scores_gemma":[0.3343492,0.011512996,0.6402734,0.0030076636,0.000564817,0.0077101924,0.00063294364,0.0002896262,0.0016591665],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5557905,0.4044487,0.00795802,0.0077673667,0.023387687,0.0006477693],"domain_scores_gemma":[0.22632216,0.72292954,0.02029809,0.02236136,0.007464708,0.00062414893],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.35173935,0.0013531194,0.003109416,0.0051065683,0.00092534866,0.003596453,0.0022207554,0.002305601,0.003906235],"category_scores_gemma":[0.5814657,0.0005645749,0.003438565,0.008199477,0.008784168,0.004090227,0.0051510367,0.004232976,0.00076787465],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020543695,0.00029454986,0.0394925,0.0060437247,0.0046158163,0.00042781656,0.0031865858,0.0737466,0.0015552737,0.44713125,0.005385619,0.41606584],"study_design_scores_gemma":[0.0004365234,0.0028594874,0.033750683,0.00570698,0.001322037,0.000773781,0.00052494876,0.15989663,0.0033416892,0.7706074,0.020453032,0.0003268003],"about_ca_topic_score_codex":0.0014628195,"about_ca_topic_score_gemma":0.0011384988,"teacher_disagreement_score":0.64826065,"about_ca_system_score_codex":0.0026035567,"about_ca_system_score_gemma":0.003767301,"threshold_uncertainty_score":0.79942083},"labels":[],"label_agreement":null},{"id":"W2052567778","doi":"10.1177/0962280212448973","title":"Comparing variational Bayes with Markov chain Monte Carlo for Bayesian computation in neuroimaging","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Blind Source Separation Techniques","field":"Computer Science","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Western University; University of Victoria","funders":"","keywords":"Markov chain Monte Carlo; Computer science; Monte Carlo method; Bayesian probability; Context (archaeology); Computation; Artificial intelligence; Approximate Bayesian computation; Bayesian inference; Inverse problem; Algorithm; Machine learning; Mathematics; Statistics; Inference","score_opus":0.13727059447463075,"score_gpt":0.5244023664070628,"score_spread":0.3871317719324321,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052567778","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023193234,0.00075209636,0.9950299,0.0005417175,0.00004936043,0.00003361335,0.000030113115,0.00011845255,0.001125238],"genre_scores_gemma":[0.1496264,0.0021264483,0.84475017,0.00041146707,0.000309035,0.00048346256,0.00021338438,0.00040257804,0.0016771149],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9926186,0.005490047,0.00021287445,0.00045896764,0.0010326931,0.00018687149],"domain_scores_gemma":[0.9376683,0.057559367,0.001005142,0.0017090975,0.0015931408,0.00046492787],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015561046,0.0016168308,0.002303276,0.0022088648,0.0012171053,0.002742817,0.0029949427,0.00313055,0.0041214745],"category_scores_gemma":[0.07787268,0.0013433595,0.0015301913,0.0019935102,0.00369173,0.0053641,0.0031698563,0.0036658586,0.0006082637],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009719589,0.0000460237,0.00062474003,0.00016950487,0.00009941432,0.000048469985,0.00023048827,0.5366112,0.0002135804,0.42111322,0.0011112518,0.039634988],"study_design_scores_gemma":[0.000018894263,0.000012702041,0.000088457855,0.000033195716,0.000008147304,0.000013363801,0.000015730287,0.777843,0.00008572533,0.22089128,0.0009719767,0.00001748744],"about_ca_topic_score_codex":0.017249703,"about_ca_topic_score_gemma":0.012672828,"teacher_disagreement_score":0.017249703,"about_ca_system_score_codex":0.003712999,"about_ca_system_score_gemma":0.0041762725,"threshold_uncertainty_score":0.082295656},"labels":[],"label_agreement":null},{"id":"W2057830194","doi":"10.1191/0962280202sm308ra","title":"Using inverse-weighting in cost-effectiveness analysis with censored data","year":2002,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":54,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; SickKids Foundation; Hospital for Sick Children","funders":"","keywords":"Censoring (clinical trials); Weighting; Statistics; Covariance; Survival analysis; Mathematics; Econometrics; Inverse probability weighting; Duration (music); Medicine; Propensity score matching","score_opus":0.8657958110574773,"score_gpt":0.6909467344486384,"score_spread":0.17484907660883886,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2057830194","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009948943,0.0013969389,0.98707724,0.00035195585,0.00009463124,0.00022070218,0.000097948985,0.00008721165,0.0007244508],"genre_scores_gemma":[0.30751926,0.0027109245,0.6850591,0.0006612195,0.00033212456,0.0017674668,0.0004786993,0.00015646408,0.0013147475],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.89669126,0.09000612,0.0026986247,0.0035264704,0.006428384,0.00064908713],"domain_scores_gemma":[0.7978046,0.1800312,0.007579803,0.010755903,0.003470391,0.0003580756],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09669534,0.0019215378,0.0031857619,0.004253698,0.0005855198,0.0025377786,0.0026493112,0.0025116894,0.0017648721],"category_scores_gemma":[0.2550459,0.0010358331,0.003204475,0.004348334,0.0031087955,0.004103141,0.0021817351,0.0036601191,0.0004120266],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00075893867,0.0003227246,0.013090107,0.0016320618,0.003310714,0.0005740216,0.0008380529,0.29507068,0.00123098,0.31038228,0.0023211346,0.37046838],"study_design_scores_gemma":[0.00017902328,0.00029735916,0.0031952132,0.00035751346,0.00044837786,0.00025526344,0.00011335394,0.39464352,0.0019044469,0.5939139,0.004530862,0.00016123893],"about_ca_topic_score_codex":0.0024032623,"about_ca_topic_score_gemma":0.0014987676,"teacher_disagreement_score":0.90330464,"about_ca_system_score_codex":0.0017626742,"about_ca_system_score_gemma":0.001719441,"threshold_uncertainty_score":0.51137996},"labels":[],"label_agreement":null},{"id":"W2059439741","doi":"10.1177/0962280209344926","title":"Outlier detection for a hierarchical Bayes model in a study of hospital variation in surgical procedures","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Carleton University","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; University of Southern California","keywords":"Outlier; Bayes' theorem; Variation (astronomy); Computer science; Multilevel model; Statistics; Anomaly detection; Random effects model; Bayesian hierarchical modeling; Data mining; Bayesian probability; Artificial intelligence; Medicine; Machine learning; Mathematics","score_opus":0.056961056414367765,"score_gpt":0.4984115217864363,"score_spread":0.4414504653720685,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059439741","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02747582,0.0002149072,0.9707056,0.00077662506,0.00003441136,0.00013837196,0.00012783847,0.00016548767,0.00036088962],"genre_scores_gemma":[0.4583621,0.00038126798,0.53750056,0.00049563375,0.00026320852,0.0010129536,0.00046474818,0.00013065977,0.0013889043],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9499495,0.040077623,0.0012610451,0.0048245513,0.002843094,0.0010441976],"domain_scores_gemma":[0.72061163,0.26279843,0.007906621,0.005313152,0.0021618428,0.0012082626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06823416,0.0013429188,0.0035626208,0.00430402,0.0021440387,0.0035003603,0.005777107,0.0046144645,0.002794026],"category_scores_gemma":[0.19208717,0.0017119381,0.0034424344,0.00462147,0.006392765,0.004500052,0.0038203276,0.004349604,0.0004212875],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006074888,0.00026547423,0.03730062,0.00036465618,0.00095001917,0.00058007916,0.003355709,0.3680737,0.0012401397,0.52407867,0.0024779127,0.06070544],"study_design_scores_gemma":[0.00010175183,0.00009389019,0.0035154081,0.000057764457,0.00009695404,0.00013627019,0.0001519043,0.8017845,0.0002068246,0.19294176,0.0008424107,0.000070578084],"about_ca_topic_score_codex":0.019519454,"about_ca_topic_score_gemma":0.014356511,"teacher_disagreement_score":0.06823416,"about_ca_system_score_codex":0.0039492445,"about_ca_system_score_gemma":0.0037891276,"threshold_uncertainty_score":0.36086106},"labels":[],"label_agreement":null},{"id":"W2063974614","doi":"10.1191/0962280205sm0391oa","title":"On group sequential procedures under variance heterogeneity","year":2005,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; University of Windsor","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Variance (accounting); Group (periodic table); Statistics; Econometrics; Computer science; Mathematics; Economics","score_opus":0.7225271869331464,"score_gpt":0.7272749290543858,"score_spread":0.004747742121239407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063974614","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009827726,0.00030422947,0.9960686,0.00058764167,0.00017900254,0.00034437142,0.000042023137,0.000081747654,0.0014095636],"genre_scores_gemma":[0.055206798,0.0011469946,0.9355444,0.0012647511,0.0007571396,0.0038035493,0.0001426876,0.00020628457,0.0019275765],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.86789906,0.11298582,0.0028498224,0.004445516,0.010693318,0.0011264695],"domain_scores_gemma":[0.86915684,0.1095404,0.0063441186,0.008822412,0.005361198,0.0007749949],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10561249,0.0021878986,0.0029819994,0.002825195,0.0015036752,0.0021554448,0.0029374184,0.0037366983,0.01116789],"category_scores_gemma":[0.18564968,0.0008464161,0.0026849576,0.004043103,0.0065110982,0.005731687,0.004770214,0.0064087776,0.0021447295],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022569652,0.00006485768,0.00040185518,0.00037390494,0.00022297306,0.00016015473,0.00049660885,0.020437378,0.00037266998,0.88089526,0.0034462397,0.09290233],"study_design_scores_gemma":[0.00021491924,0.00021550151,0.00017121772,0.00013248307,0.000063814005,0.00009753032,0.00005110971,0.05151401,0.00055934646,0.9398867,0.0070535573,0.00003995405],"about_ca_topic_score_codex":0.0013538774,"about_ca_topic_score_gemma":0.0010340741,"teacher_disagreement_score":0.10561249,"about_ca_system_score_codex":0.0020652234,"about_ca_system_score_gemma":0.0066006905,"threshold_uncertainty_score":0.5585389},"labels":[],"label_agreement":null},{"id":"W2064839688","doi":"10.1177/0962280211406470","title":"A multi-state model for the analysis of changes in cognitive scores over a fixed time interval","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Simon Fraser University; Capital District Health Authority; Dalhousie University","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Statistics; Poisson distribution; Multivariate statistics; Cognition; Mathematics; Econometrics; Survival function; Poisson regression; Survival analysis; Psychology; Medicine; Population; Psychiatry","score_opus":0.3759594243516181,"score_gpt":0.6005438283901415,"score_spread":0.22458440403852342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064839688","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013837005,0.0004936409,0.98128945,0.0007256889,0.0001712411,0.00014586502,0.0011387873,0.0002737375,0.0019244474],"genre_scores_gemma":[0.6425258,0.0022725863,0.31462866,0.0006959073,0.0005728014,0.004397007,0.0043623983,0.00021073634,0.03033409],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99739885,0.0012853158,0.00011053365,0.0007553597,0.00023989363,0.00020998697],"domain_scores_gemma":[0.99342805,0.005071379,0.0005611372,0.00039341717,0.00039310133,0.00015296254],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0066235675,0.0014203077,0.0019997729,0.0015732186,0.0008708448,0.002369777,0.0033235585,0.0024724314,0.008576163],"category_scores_gemma":[0.011430042,0.00093407306,0.0026803035,0.0019397046,0.0016877997,0.0030733983,0.0016227182,0.0038569642,0.0016462597],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021621857,0.00016964265,0.0070997104,0.00020388087,0.00048390197,0.00034929218,0.00040758174,0.7120817,0.00089079275,0.2570105,0.0024606308,0.018626245],"study_design_scores_gemma":[0.0000511694,0.00012118354,0.0014137309,0.000028096201,0.000102691294,0.00009449113,0.000044851724,0.9201855,0.000115711584,0.07481076,0.002983467,0.000048331123],"about_ca_topic_score_codex":0.013399089,"about_ca_topic_score_gemma":0.012095616,"teacher_disagreement_score":0.013399089,"about_ca_system_score_codex":0.0021956216,"about_ca_system_score_gemma":0.0023878466,"threshold_uncertainty_score":0.035029173},"labels":[],"label_agreement":null},{"id":"W2069283580","doi":"10.1177/0962280212469682","title":"A cure rate survival model under a hybrid latent activation scheme","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Unobservable; Poisson distribution; Carcinogenesis; Survival analysis; Statistics; Mathematics; Biology; Econometrics; Cancer; Genetics","score_opus":0.853355063546163,"score_gpt":0.7394206970475853,"score_spread":0.11393436649857769,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2069283580","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22362745,0.00095059833,0.76632744,0.0011792185,0.00008762923,0.00021737476,0.0009356849,0.00047223695,0.0062024076],"genre_scores_gemma":[0.9549318,0.00064029905,0.021869253,0.00012056235,0.00006390561,0.00035805223,0.000591203,0.000061857856,0.021363182],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99862933,0.00048726072,0.0000646276,0.00033613454,0.00018444096,0.00029820073],"domain_scores_gemma":[0.99624157,0.0022432443,0.00063812337,0.00021523144,0.00042515277,0.00023672705],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003936542,0.0011031649,0.0014445749,0.001238017,0.00048105916,0.0016194631,0.0029692068,0.0023153718,0.0047216844],"category_scores_gemma":[0.0064378246,0.0005469207,0.0015964471,0.0009891108,0.0015837868,0.0019533136,0.0013515025,0.0020598255,0.0011762432],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030151982,0.00008923451,0.0041364254,0.000119434364,0.00007837897,0.00031742032,0.0005077263,0.8854795,0.0035310087,0.093083866,0.00087374257,0.01148178],"study_design_scores_gemma":[0.000023795363,0.000060669605,0.00041216554,0.000008625534,0.000022159398,0.0000699432,0.000018943347,0.9897363,0.00017714598,0.009012364,0.00044107425,0.0000169117],"about_ca_topic_score_codex":0.00603557,"about_ca_topic_score_gemma":0.002208067,"teacher_disagreement_score":0.00603557,"about_ca_system_score_codex":0.0017059474,"about_ca_system_score_gemma":0.0010630742,"threshold_uncertainty_score":0.02081871},"labels":[],"label_agreement":null},{"id":"W2071158082","doi":"10.1177/0962280207081606","title":"Stratified and randomized play-the-winner rule","year":2008,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Randomized controlled trial; Confounding; Computer science; Selection (genetic algorithm); Selection bias; Medicine; Statistics; Artificial intelligence; Mathematics; Internal medicine","score_opus":0.7300653694511776,"score_gpt":0.7097057590069843,"score_spread":0.02035961044419332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2071158082","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061134766,0.00082998845,0.98682564,0.0010139149,0.0004111061,0.0011825886,0.00022813943,0.00018416205,0.0032110654],"genre_scores_gemma":[0.2021375,0.0012287102,0.78089106,0.0027581486,0.00066687766,0.006535315,0.00053510006,0.00016267359,0.005084752],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8736617,0.10004753,0.0051274146,0.0062898085,0.013490007,0.0013834517],"domain_scores_gemma":[0.88818544,0.09094414,0.0060259295,0.00826977,0.004987773,0.0015869222],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08761978,0.0016743252,0.00490498,0.0015848691,0.00093236455,0.0023357703,0.003727459,0.0026294221,0.006871785],"category_scores_gemma":[0.1671914,0.0009038036,0.0022596603,0.0012879543,0.0032433262,0.0039151805,0.002346435,0.004781551,0.0023590736],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037174956,0.000321284,0.0031793437,0.0010539219,0.0009024254,0.0003679082,0.0004157232,0.05943311,0.0015523349,0.6453685,0.009722911,0.27396506],"study_design_scores_gemma":[0.0020996996,0.001349461,0.00064709265,0.00033924248,0.00032831173,0.00055681303,0.000050456383,0.2358946,0.0024454861,0.7396606,0.01648808,0.00014015983],"about_ca_topic_score_codex":0.00061028136,"about_ca_topic_score_gemma":0.0006091781,"teacher_disagreement_score":0.9123802,"about_ca_system_score_codex":0.0011853622,"about_ca_system_score_gemma":0.0039092996,"threshold_uncertainty_score":0.46338326},"labels":[],"label_agreement":null},{"id":"W2071412894","doi":"10.1177/0962280211416038","title":"Measuring continuous baseline covariate imbalances in clinical trial data","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Brain Institute","funders":"National Institute of Neurological Disorders and Stroke","keywords":"Covariate; Statistics; Baseline (sea); Analysis of covariance; Test statistic; Statistic; Type I and type II errors; Econometrics; Mathematics; Medicine; Statistical hypothesis testing","score_opus":0.9591079010063465,"score_gpt":0.7651604513098256,"score_spread":0.1939474496965209,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2071412894","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030291304,0.009639495,0.9484065,0.0038991808,0.0006281297,0.0022720697,0.0019885364,0.000511408,0.0023632932],"genre_scores_gemma":[0.49809334,0.0044696718,0.4772371,0.0033154811,0.0012727635,0.011748098,0.0026245017,0.0003542175,0.000884852],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.472866,0.4480652,0.028492313,0.010944985,0.038341556,0.0012899154],"domain_scores_gemma":[0.22206226,0.6832494,0.052825686,0.029021956,0.011758398,0.0010822949],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.31030956,0.0013157248,0.0035695813,0.0051664566,0.0010463125,0.0043257703,0.002693407,0.002942249,0.0026669013],"category_scores_gemma":[0.683863,0.0007374286,0.003261817,0.0067757685,0.0035968684,0.004499866,0.003845204,0.0047234236,0.0006084133],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008741953,0.0005276209,0.13000894,0.008833127,0.0112025235,0.0007343953,0.0028933266,0.05322548,0.0030658913,0.10229366,0.013554993,0.66491807],"study_design_scores_gemma":[0.005340507,0.009943597,0.098249435,0.005274944,0.005276881,0.0041727247,0.00096581824,0.15011856,0.011683817,0.65136254,0.05658872,0.0010224766],"about_ca_topic_score_codex":0.00033243085,"about_ca_topic_score_gemma":0.0003095867,"teacher_disagreement_score":0.6896905,"about_ca_system_score_codex":0.002192752,"about_ca_system_score_gemma":0.0037316442,"threshold_uncertainty_score":0.8505111},"labels":[],"label_agreement":null},{"id":"W2075432660","doi":"10.1177/0962280214544251","title":"Statistical methods for incomplete data: Some results on model misspecification","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Estimator; Inverse probability weighting; Inverse probability; Imputation (statistics); Weighting; Mathematics; Covariate; Estimating equations; Applied mathematics; Statistics; Inverse; Asymptotic distribution; Empirical likelihood; Delta method; Econometrics; Computer science; Missing data; Posterior probability; Bayesian probability","score_opus":0.7813321794790806,"score_gpt":0.7350020607206029,"score_spread":0.0463301187584777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075432660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002023441,0.0019849373,0.9939214,0.0010373784,0.000053419175,0.00004205426,0.00004266412,0.00008029966,0.0008144175],"genre_scores_gemma":[0.15285665,0.01051916,0.8278579,0.0019578843,0.001333686,0.0014573896,0.00048805217,0.0004980832,0.0030312624],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9337068,0.05015266,0.0025143751,0.003555147,0.009268709,0.00080222747],"domain_scores_gemma":[0.53445244,0.4157063,0.013765912,0.026118992,0.009215391,0.00074094476],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.109440655,0.0023188274,0.0042634183,0.004408495,0.0012333432,0.0038805357,0.005807505,0.003936009,0.0034719824],"category_scores_gemma":[0.4008269,0.0017930407,0.0047495007,0.0071693733,0.009288777,0.009809636,0.005389565,0.0096238945,0.0007717307],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006628806,0.000060441685,0.0038904322,0.0007641988,0.0005361027,0.0004903842,0.00082252716,0.08053775,0.00037657248,0.83058923,0.0023173764,0.0795487],"study_design_scores_gemma":[0.000035759986,0.000060254784,0.0007102877,0.00029173776,0.000118749165,0.000324156,0.00006680737,0.207193,0.00053715875,0.7859089,0.0047091856,0.00004406589],"about_ca_topic_score_codex":0.0023285765,"about_ca_topic_score_gemma":0.0011851145,"teacher_disagreement_score":0.109440655,"about_ca_system_score_codex":0.0032026735,"about_ca_system_score_gemma":0.003023652,"threshold_uncertainty_score":0.5787844},"labels":[],"label_agreement":null},{"id":"W2082197682","doi":"10.1177/0962280213491641","title":"Expectation maximization-based likelihood inference for flexible cure rate models with Weibull lifetimes","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advancements in Photolithography Techniques","field":"Engineering","cited_by":75,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Weibull distribution; Maximization; Expectation–maximization algorithm; Computer science; Maximum likelihood; Econometrics; Statistics; Artificial intelligence; Mathematics; Mathematical optimization","score_opus":0.06775448943020891,"score_gpt":0.4855262341241343,"score_spread":0.4177717446939254,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082197682","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043617436,0.00015093495,0.9951127,0.00008765371,0.000006290018,0.00001816266,0.00003760904,0.00007495081,0.00015000667],"genre_scores_gemma":[0.37052876,0.0010214769,0.624353,0.00021065431,0.0000922871,0.00043489924,0.0005796757,0.00023034234,0.0025490036],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996064,0.0028996526,0.0001697127,0.00040264754,0.00031624545,0.0001478126],"domain_scores_gemma":[0.96885747,0.028031735,0.001288484,0.0011259125,0.0005246666,0.00017178507],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015522685,0.0010044967,0.0017540875,0.0014312338,0.00061941997,0.0012846023,0.002480433,0.001177215,0.0016005619],"category_scores_gemma":[0.038020153,0.0010406565,0.001556562,0.001624144,0.0018841227,0.002156215,0.0018713662,0.002699381,0.00043164552],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009367044,0.000053638676,0.0019852805,0.000115022725,0.00011295945,0.00016844527,0.00016606436,0.8550961,0.0007769801,0.10264969,0.00059332786,0.038188793],"study_design_scores_gemma":[0.000012387096,0.000014113734,0.00027695973,0.000014046703,0.0000106886655,0.00004141783,0.000012813744,0.95215195,0.00027408128,0.046797026,0.00037465413,0.000019850822],"about_ca_topic_score_codex":0.0033753098,"about_ca_topic_score_gemma":0.0031134984,"teacher_disagreement_score":0.015522685,"about_ca_system_score_codex":0.0012984761,"about_ca_system_score_gemma":0.0013608367,"threshold_uncertainty_score":0.08209282},"labels":[],"label_agreement":null},{"id":"W2084416125","doi":"10.1177/0962280208096046","title":"Efficient sampling approaches to address confounding in database studies","year":2008,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Primary Care and Health Outcomes","field":"Health Professions","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"","keywords":"Confounding; Pharmacoepidemiology; Medical prescription; Computer science; Sampling (signal processing); Medicine; Data mining; Statistics; Mathematics; Pharmacology","score_opus":0.9154363551370552,"score_gpt":0.7780213316583924,"score_spread":0.13741502347866286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2084416125","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020432153,0.05130215,0.937793,0.0014212411,0.000414895,0.004740589,0.00068836566,0.00017962119,0.0014169712],"genre_scores_gemma":[0.035040967,0.04717983,0.8950283,0.0010361118,0.0006008611,0.019194229,0.0011329262,0.00008416386,0.00070269586],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.62559414,0.3321937,0.016283862,0.0062271785,0.018988395,0.000712744],"domain_scores_gemma":[0.6011153,0.3579413,0.011791591,0.019094845,0.009504372,0.00055264187],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22826204,0.002479835,0.0062138466,0.007923554,0.0013147308,0.0034693948,0.0061933887,0.0029115842,0.0035160964],"category_scores_gemma":[0.33168498,0.0022042487,0.0051578125,0.01341889,0.0028948477,0.003778803,0.0057707154,0.0038413303,0.0007823115],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005926862,0.0002050438,0.008915926,0.025622522,0.009188883,0.00027497092,0.0022714036,0.013726968,0.0006869057,0.13561836,0.0073464587,0.7955498],"study_design_scores_gemma":[0.002461503,0.0012981971,0.014403511,0.017486336,0.0073770485,0.001192167,0.0012473166,0.07170826,0.0028905442,0.7618898,0.11772631,0.00031903893],"about_ca_topic_score_codex":0.0030151398,"about_ca_topic_score_gemma":0.002874788,"teacher_disagreement_score":0.77173793,"about_ca_system_score_codex":0.0025864104,"about_ca_system_score_gemma":0.0066616167,"threshold_uncertainty_score":0.9516903},"labels":[],"label_agreement":null},{"id":"W2086701312","doi":"10.1177/0962280211399562","title":"Bayesian sample size calculation for estimation of the difference between two binomial proportions","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"University of Waterloo; University of Tehran","keywords":"Dirichlet distribution; Sample size determination; Statistics; Mathematics; Bayesian probability; Binomial (polynomial); Beta-binomial distribution; Binomial distribution; Negative binomial distribution; Econometrics; Prior probability; Computer science; Poisson distribution","score_opus":0.7821547142411684,"score_gpt":0.7131122956078051,"score_spread":0.06904241863336336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2086701312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019677314,0.00043263572,0.9958702,0.0003173252,0.000094711904,0.00036168375,0.00004780146,0.00012418246,0.00078371813],"genre_scores_gemma":[0.06640549,0.0005587463,0.9281134,0.00051098,0.00021893198,0.0031806529,0.00021786246,0.00014511483,0.0006489166],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92941356,0.057584923,0.0023718716,0.0030576517,0.0071006813,0.0004712498],"domain_scores_gemma":[0.82605624,0.16370115,0.0032339415,0.003883114,0.0026791173,0.00044641923],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07094172,0.0011893417,0.0031508387,0.004112329,0.00073280255,0.002377539,0.0031595265,0.0037742874,0.008061255],"category_scores_gemma":[0.29883423,0.0011320254,0.0017692181,0.002242967,0.0033073085,0.0047569876,0.0032100666,0.0049637617,0.0015023341],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016098039,0.0003510121,0.004006833,0.0021169155,0.00087515346,0.00033050787,0.0007328468,0.1043708,0.003795328,0.4530728,0.0059636924,0.42277426],"study_design_scores_gemma":[0.00079509045,0.0006630292,0.001635866,0.0008026293,0.00024965146,0.0005765373,0.00009397855,0.45428228,0.00390751,0.5255837,0.0112810545,0.00012873109],"about_ca_topic_score_codex":0.0007042915,"about_ca_topic_score_gemma":0.00056439947,"teacher_disagreement_score":0.07094172,"about_ca_system_score_codex":0.0018128142,"about_ca_system_score_gemma":0.0024999352,"threshold_uncertainty_score":0.37518013},"labels":[],"label_agreement":null},{"id":"W2093541024","doi":"10.1177/0962280214536537","title":"Longitudinal data subject to irregular observation: A review of methods with a focus on visit processes, assumptions, and study design","year":2014,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":79,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Outcome (game theory); Computer science; Focus (optics); Set (abstract data type); Process (computing); Subject (documents); Chart; Data science; Management science; Statistics; Mathematics","score_opus":0.738749131992883,"score_gpt":0.6926737143409845,"score_spread":0.04607541765189849,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2093541024","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000055654982,0.99399865,0.004084621,0.0010701728,0.00029596235,0.000034061497,0.000054512453,0.000015660109,0.00039072096],"genre_scores_gemma":[0.00087265234,0.9922035,0.00565835,0.00059214316,0.0003272989,0.0001347484,0.000057084693,0.000018307064,0.00013593912],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9765776,0.013668014,0.0036266418,0.0017191041,0.0041834894,0.00022526589],"domain_scores_gemma":[0.79746854,0.18698013,0.0048071374,0.0029333644,0.007318519,0.00049240625],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043482903,0.0017060214,0.0045577902,0.0111000445,0.0008054344,0.002881762,0.0040065143,0.0029649313,0.0036477454],"category_scores_gemma":[0.09703496,0.0013952192,0.003039489,0.013560626,0.004699309,0.0046850434,0.001874808,0.0048118574,0.0016931802],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007370961,0.00005378525,0.0008949158,0.06392865,0.0005162677,0.00010030465,0.0004120717,0.0008056904,0.00014975153,0.020365413,0.021756385,0.890943],"study_design_scores_gemma":[0.00005966911,0.00021031307,0.005633839,0.12107901,0.0012131775,0.0020011722,0.00056794175,0.0009812573,0.0005327697,0.051326513,0.81618714,0.00020726466],"about_ca_topic_score_codex":0.005011468,"about_ca_topic_score_gemma":0.005079052,"teacher_disagreement_score":0.043482903,"about_ca_system_score_codex":0.003518333,"about_ca_system_score_gemma":0.007654696,"threshold_uncertainty_score":0.22996229},"labels":[],"label_agreement":null},{"id":"W2096206421","doi":"10.1177/0962280208092346","title":"The case-crossover study design in pharmacoepidemiology","year":2008,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":102,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Pharmacoepidemiology; Crossover study; Crossover; Medicine; Computer science; Pharmacology; Alternative medicine; Artificial intelligence","score_opus":0.9107676203454614,"score_gpt":0.7895228873335225,"score_spread":0.12124473301193894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096206421","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17546576,0.059823778,0.68014854,0.00438165,0.013861729,0.057365466,0.0025011934,0.0007663383,0.005685512],"genre_scores_gemma":[0.55966026,0.009907569,0.35301042,0.005454898,0.0052524665,0.062030543,0.0014436303,0.00014295554,0.0030972697],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7034078,0.26403898,0.008403672,0.014065177,0.009294461,0.0007899019],"domain_scores_gemma":[0.74995446,0.19522183,0.022862017,0.024543433,0.006138229,0.0012800763],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23183002,0.0016979664,0.0047451523,0.0027192428,0.0018323193,0.0020446875,0.0038246617,0.0072140596,0.004369556],"category_scores_gemma":[0.22654848,0.0014326655,0.00351277,0.0037569464,0.004214029,0.0022640894,0.0015646575,0.0037431386,0.0006750881],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.10736111,0.012827646,0.21039523,0.03589414,0.035842985,0.0057560946,0.006364122,0.01841513,0.007731856,0.115219995,0.023090504,0.42110124],"study_design_scores_gemma":[0.120783284,0.20201905,0.19683279,0.009179593,0.031083466,0.013448578,0.0021310346,0.10416998,0.0092767645,0.21102236,0.09815907,0.0018941236],"about_ca_topic_score_codex":0.0022276656,"about_ca_topic_score_gemma":0.0018212654,"teacher_disagreement_score":0.76817,"about_ca_system_score_codex":0.0016921889,"about_ca_system_score_gemma":0.0023149345,"threshold_uncertainty_score":0.94729036},"labels":[],"label_agreement":null},{"id":"W2096814695","doi":"10.1177/0962280211432211","title":"Reflections on meta-analyses involving trials stopped early for benefit: Is there a problem and if so, what is it?","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa; McMaster University","funders":"","keywords":"Meta-analysis; Randomized controlled trial; Sample size determination; Econometrics; Publication bias; Statistics; Medicine; Mathematics; Internal medicine","score_opus":0.9834534062452185,"score_gpt":0.7951079030339979,"score_spread":0.18834550321122057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096814695","genre_codex":"commentary","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00041593742,0.24445458,0.023034532,0.6901279,0.040189732,0.00017997713,0.00023278687,0.00029579518,0.0010687669],"genre_scores_gemma":[0.017588176,0.13720904,0.05572831,0.70613366,0.0801197,0.0011939555,0.00017786154,0.0007185818,0.0011308392],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.32899967,0.49955276,0.08144605,0.023722557,0.06283028,0.0034486544],"domain_scores_gemma":[0.05462328,0.8766647,0.022956945,0.01711517,0.026591072,0.0020488505],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.68660957,0.0053873262,0.01565748,0.013181728,0.005705139,0.024845159,0.018005146,0.03995961,0.006195746],"category_scores_gemma":[0.8591752,0.0053877966,0.025130525,0.01405265,0.04573166,0.050456136,0.012335682,0.080878384,0.004172756],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00241298,0.000158504,0.0036928526,0.0634133,0.024329046,0.0015306112,0.009254043,0.004114025,0.0003699414,0.18027343,0.39187348,0.31857774],"study_design_scores_gemma":[0.0014995586,0.0005359001,0.0016130748,0.08241936,0.007789363,0.0016230749,0.0018816628,0.0028468918,0.0007110276,0.58598286,0.3121919,0.00090541877],"about_ca_topic_score_codex":0.0113905715,"about_ca_topic_score_gemma":0.011764203,"teacher_disagreement_score":0.31339043,"about_ca_system_score_codex":0.018422473,"about_ca_system_score_gemma":0.028437555,"threshold_uncertainty_score":0.38646626},"labels":[],"label_agreement":null},{"id":"W2098775098","doi":"10.1177/0962280210371561","title":"On Gaussian Markov random fields and Bayesian disease mapping","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":92,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Child and Family Research Institute; University of British Columbia","funders":"Indian Council of Agricultural Research; Canadian Institutes of Health Research; Gallipoli Medical Research Foundation","keywords":"Bayesian probability; Univariate; Prior probability; Multivariate statistics; Computer science; Bayesian linear regression; Artificial intelligence; Autoregressive model; Bayesian inference; Bayes' theorem; Mathematics; Statistics; Machine learning","score_opus":0.12325957161327475,"score_gpt":0.5478868605346664,"score_spread":0.4246272889213917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2098775098","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026142858,0.0072226953,0.9776642,0.0038977042,0.00020685168,0.00002441311,0.00021122234,0.00007919705,0.008079447],"genre_scores_gemma":[0.33025157,0.056227457,0.57627773,0.0059809205,0.005534416,0.00076036266,0.0010411952,0.0002632634,0.023663105],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9974631,0.0015650812,0.00008746213,0.00037302033,0.0003872219,0.00012396],"domain_scores_gemma":[0.9880591,0.010150602,0.0006580633,0.00048170245,0.0005051553,0.00014528361],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0073012533,0.0012194361,0.001264284,0.0020698002,0.0006341258,0.0017709808,0.0016516399,0.0029566712,0.0040137134],"category_scores_gemma":[0.016683506,0.0006629785,0.001339778,0.0030409081,0.0041102828,0.003525396,0.0018257448,0.0033032778,0.0009862192],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006254236,0.000008974084,0.00022795865,0.00007453062,0.000020408752,0.00007043561,0.000081586135,0.03081463,0.0001512707,0.95406705,0.0019775908,0.012499302],"study_design_scores_gemma":[0.000004101277,0.000011256748,0.00019448869,0.000057411187,0.000009799152,0.000059183865,0.000012809031,0.053279858,0.000058614864,0.9399167,0.006380862,0.000015041088],"about_ca_topic_score_codex":0.0054089515,"about_ca_topic_score_gemma":0.0030954857,"teacher_disagreement_score":0.0073012533,"about_ca_system_score_codex":0.001953585,"about_ca_system_score_gemma":0.0014343719,"threshold_uncertainty_score":0.0386132},"labels":[],"label_agreement":null},{"id":"W2099077995","doi":"10.1177/0962280215601133","title":"Assessing agreement between two measurement systems: An alternative to the limits of agreement approach","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":55,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Interchangeability; Agreement; Metric (unit); Limits of agreement; Computer science; Units of measurement; Physics; Engineering","score_opus":0.8455312682296875,"score_gpt":0.6788734831139276,"score_spread":0.1666577851157599,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2099077995","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006730264,0.0037189005,0.98210734,0.0011021707,0.00037840338,0.00057099917,0.00020521056,0.0002533529,0.0049333815],"genre_scores_gemma":[0.3283771,0.0024342712,0.66291064,0.0011616453,0.00063716044,0.0028842944,0.00032646934,0.00033405333,0.0009343741],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5175982,0.37628898,0.020864164,0.024659116,0.05854621,0.0020433299],"domain_scores_gemma":[0.342473,0.56304914,0.03204897,0.037961166,0.022797614,0.0016700428],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2813988,0.0032443423,0.0072313286,0.01592052,0.0031340506,0.012527926,0.008230767,0.0062035755,0.0034543986],"category_scores_gemma":[0.53023046,0.002015884,0.0059985127,0.015823232,0.01398283,0.017658718,0.012772853,0.010153457,0.00097140117],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014759168,0.0005524866,0.031155836,0.0062207086,0.008652559,0.00048213836,0.013185237,0.030765267,0.002958579,0.5688689,0.00609168,0.32959068],"study_design_scores_gemma":[0.00025337233,0.001710406,0.014703774,0.0018956886,0.001520682,0.00101864,0.00259763,0.10198804,0.0032401315,0.8492968,0.021186816,0.0005881195],"about_ca_topic_score_codex":0.0034063337,"about_ca_topic_score_gemma":0.002579288,"teacher_disagreement_score":0.2813988,"about_ca_system_score_codex":0.0051076077,"about_ca_system_score_gemma":0.0072756573,"threshold_uncertainty_score":0.88616323},"labels":[],"label_agreement":null},{"id":"W2100697007","doi":"10.1177/0962280214558972","title":"Events per variable (EPV) and the relative performance of different strategies for estimating the out-of-sample validity of logistic regression models","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":484,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; National Institute of Neurological Disorders and Stroke; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Sample size determination; Logistic regression; Sample (material); Mathematics; Regression analysis; Econometrics; Mean squared error; Regression; Linear regression; Variance (accounting); Variables; Economics","score_opus":0.39344469527150544,"score_gpt":0.579674810655022,"score_spread":0.18623011538351658,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2100697007","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6910125,0.004195445,0.29925233,0.0012287676,0.00017317066,0.00051297375,0.0006399172,0.00051064306,0.0024741846],"genre_scores_gemma":[0.94567585,0.00036827844,0.052514207,0.00019828707,0.000050437524,0.00027109557,0.0005884896,0.00011474148,0.00021873863],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.803992,0.16309655,0.0092961,0.0109505365,0.011089396,0.0015754199],"domain_scores_gemma":[0.21982309,0.727664,0.019056832,0.025299702,0.0068700938,0.0012863079],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.31584197,0.0027932287,0.0023816389,0.004318582,0.0008581803,0.0033181848,0.0029183656,0.0028855777,0.0006402535],"category_scores_gemma":[0.50718516,0.0009556768,0.004145395,0.0020871884,0.004441849,0.004880811,0.0043879473,0.0038611253,0.00031621012],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007734605,0.0005596726,0.5463855,0.0012331876,0.010977417,0.00055626524,0.0026398252,0.26949397,0.003111103,0.007467972,0.001422545,0.14841793],"study_design_scores_gemma":[0.00054808194,0.0042386185,0.20892851,0.0008154054,0.0013882881,0.0010016295,0.0009436856,0.74789757,0.010935039,0.021287028,0.0015344798,0.0004816649],"about_ca_topic_score_codex":0.0017529065,"about_ca_topic_score_gemma":0.0014414089,"teacher_disagreement_score":0.684158,"about_ca_system_score_codex":0.0013466759,"about_ca_system_score_gemma":0.001551827,"threshold_uncertainty_score":0.84368867},"labels":[],"label_agreement":null},{"id":"W2103521794","doi":"10.1177/0962280215591236","title":"Global tests for novelty","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"Jenny ja Antti Wihurin Rahasto; Natural Sciences and Engineering Research Council of Canada; Turun Yliopistosäätiö; Magnus Ehrnroothin Säätiö","keywords":"Novelty; Novelty detection; Computer science; Outlier; Permutation (music); Set (abstract data type); Relation (database); Range (aeronautics); Data mining; Null hypothesis; Resampling; Machine learning; Artificial intelligence; Statistical hypothesis testing; Data set; Statistics; Mathematics","score_opus":0.35127345044304936,"score_gpt":0.6502540705804974,"score_spread":0.2989806201374481,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2103521794","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.084180176,0.0012627549,0.9056063,0.0006018679,0.00021034197,0.0004417465,0.0014323934,0.0010312892,0.0052330354],"genre_scores_gemma":[0.81390136,0.00039625523,0.17952551,0.0003857387,0.0003972318,0.0012496074,0.0019875574,0.00033344323,0.0018232452],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9753661,0.011534256,0.0016109117,0.0054033888,0.0052118506,0.0008734977],"domain_scores_gemma":[0.7801465,0.18598087,0.010518119,0.016259175,0.005443921,0.0016514926],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.021249143,0.0016557951,0.0030574212,0.004750508,0.001133652,0.0029146636,0.0031098374,0.002970873,0.0056316857],"category_scores_gemma":[0.1356511,0.00050916016,0.0034025689,0.003720008,0.006435269,0.005948469,0.004082587,0.0040071616,0.001107703],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026414322,0.0005410953,0.13779101,0.0023551162,0.003684933,0.0019054312,0.0013357276,0.13549206,0.0171893,0.26270458,0.008765377,0.42559394],"study_design_scores_gemma":[0.00030684186,0.003719746,0.0582518,0.00038553376,0.00066448125,0.002584459,0.0011502182,0.44354013,0.017043341,0.4606972,0.0113279885,0.0003282736],"about_ca_topic_score_codex":0.0004413093,"about_ca_topic_score_gemma":0.0002975366,"teacher_disagreement_score":0.9787509,"about_ca_system_score_codex":0.0010563557,"about_ca_system_score_gemma":0.0012580252,"threshold_uncertainty_score":0.112377584},"labels":[],"label_agreement":null},{"id":"W2113489980","doi":"10.1177/0962280209340213","title":"Estimation of dose–response functions for longitudinal data using the generalised propensity score","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Longitudinal data; Statistics; Estimation; Covariate; Econometrics; Mathematics; Computer science; Medicine; Data mining; Economics","score_opus":0.8340373806115695,"score_gpt":0.7034432853645637,"score_spread":0.13059409524700583,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2113489980","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017328456,0.0007771431,0.97942585,0.0006933663,0.00006986981,0.00054621045,0.0003836984,0.00031719927,0.0004581667],"genre_scores_gemma":[0.39834324,0.0026945532,0.5865023,0.0008345331,0.00022271465,0.0054217507,0.0017059002,0.00022877746,0.0040461496],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9268305,0.0654925,0.0013673434,0.0034004706,0.0022465505,0.00066263543],"domain_scores_gemma":[0.8366641,0.1392688,0.009462344,0.011758212,0.0022408615,0.0006057341],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10663662,0.0019603157,0.0041422625,0.0059022214,0.0007929115,0.0021599394,0.0031765697,0.0040635346,0.007206389],"category_scores_gemma":[0.1857062,0.001227069,0.005809551,0.005037363,0.003746851,0.0036327234,0.004559404,0.0042132908,0.0013040222],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00151635,0.00041853116,0.06311394,0.002022414,0.008152704,0.0011796908,0.0019542647,0.30965707,0.0018479665,0.36062688,0.0056213546,0.24388885],"study_design_scores_gemma":[0.0007911005,0.0012390523,0.019321417,0.00042431915,0.0011711181,0.00065741024,0.0003290644,0.52936894,0.00091736275,0.43711573,0.008463628,0.0002009222],"about_ca_topic_score_codex":0.002897821,"about_ca_topic_score_gemma":0.001796663,"teacher_disagreement_score":0.10663662,"about_ca_system_score_codex":0.0018577485,"about_ca_system_score_gemma":0.002283028,"threshold_uncertainty_score":0.56395507},"labels":[],"label_agreement":null},{"id":"W2115308689","doi":"10.1191/0962280202sm304ra","title":"Analysis of uncertainty in health care cost-effectiveness studies: an introduction to statistical issues and methods","year":2002,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":251,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; McMaster University; St. Joseph's Hospital","funders":"","keywords":"Bootstrapping (finance); Computer science; Cost effectiveness; Health care; Statistic; Confidence interval; Econometrics; Statistics; Actuarial science; Risk analysis (engineering); Medicine; Mathematics; Economics","score_opus":0.6888032750728122,"score_gpt":0.7167444363492629,"score_spread":0.027941161276450632,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2115308689","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007407758,0.030828655,0.9576946,0.0058664163,0.00082673883,0.0010207304,0.000730198,0.00017371798,0.002118115],"genre_scores_gemma":[0.03699479,0.046428423,0.8943555,0.003738646,0.0037708443,0.01235804,0.00087741617,0.0003379207,0.0011384438],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.76561797,0.20370665,0.011271238,0.0043470883,0.01437019,0.00068690075],"domain_scores_gemma":[0.41521993,0.56286615,0.0078054564,0.009004788,0.004659489,0.00044410786],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1684506,0.0031639948,0.0061556376,0.008798758,0.0010722235,0.006755278,0.004859467,0.0047797277,0.005387541],"category_scores_gemma":[0.35770234,0.0016699298,0.005644295,0.0116147725,0.0065578935,0.006932248,0.004783099,0.011828047,0.0009149493],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020046698,0.0001864709,0.0030335428,0.0059383153,0.0024521928,0.00036995116,0.0006205098,0.042377267,0.00034641553,0.6733054,0.018188782,0.25298077],"study_design_scores_gemma":[0.000099994446,0.00019411198,0.00079912145,0.0020749855,0.00034232705,0.00027883513,0.00013741424,0.034558456,0.0003330416,0.9297809,0.03129459,0.000106170315],"about_ca_topic_score_codex":0.002225137,"about_ca_topic_score_gemma":0.0015110177,"teacher_disagreement_score":0.8315494,"about_ca_system_score_codex":0.0036343168,"about_ca_system_score_gemma":0.0059118173,"threshold_uncertainty_score":0.8908625},"labels":[],"label_agreement":null},{"id":"W2115420947","doi":"10.1191/0962280205sm411oa","title":"The role of proxy information in missing data analysis","year":2005,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; Statistics Canada","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Proxy (statistics); Missing data; Computer science; Data mining; Econometrics; Mathematics; Machine learning","score_opus":0.7108746652615446,"score_gpt":0.7422157901858673,"score_spread":0.031341124924322616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2115420947","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031998425,0.0027708814,0.9908635,0.0019798188,0.00020409406,0.00012605963,0.00006510882,0.00009009445,0.0007005815],"genre_scores_gemma":[0.29069406,0.0065979194,0.6952937,0.0025665706,0.0013720874,0.0018721508,0.0002822467,0.0002276749,0.001093636],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.54017144,0.43070894,0.010114247,0.0064079924,0.011327378,0.0012699998],"domain_scores_gemma":[0.1987473,0.74558276,0.0207869,0.027712436,0.006031576,0.0011389982],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.29690972,0.002059846,0.0065875277,0.0045959726,0.0021436757,0.006316911,0.0043185595,0.005090375,0.0028321876],"category_scores_gemma":[0.6600352,0.001731814,0.003385609,0.007825627,0.0083133485,0.013483832,0.0061082607,0.008578856,0.00050466607],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009556558,0.00017464672,0.013680742,0.0026021842,0.0018243379,0.0010352363,0.0027077834,0.07286919,0.0004602685,0.7012761,0.003698497,0.19871539],"study_design_scores_gemma":[0.00030347775,0.00062312,0.0018712908,0.0012457244,0.00052328646,0.00074381306,0.00038744847,0.1510064,0.0014280482,0.83262265,0.009063081,0.00018169972],"about_ca_topic_score_codex":0.0012167866,"about_ca_topic_score_gemma":0.0007591803,"teacher_disagreement_score":0.29690972,"about_ca_system_score_codex":0.0024056013,"about_ca_system_score_gemma":0.0054569296,"threshold_uncertainty_score":0.8670355},"labels":[],"label_agreement":null},{"id":"W2123033778","doi":"10.1177/0962280210383082","title":"Closed-form confidence intervals for functions of the normal mean and standard deviation","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":172,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Ontario Ministry of Research and Innovation; Natural Sciences and Engineering Research Council of Canada","keywords":"Standard deviation; Confidence interval; Percentile; Mathematics; Statistics; Coefficient of variation; Robust confidence intervals; Normal distribution; Geometric standard deviation; Standard error; CDF-based nonparametric confidence interval; Variance (accounting); Mean difference; Range (aeronautics); Limits of agreement; Relative standard deviation; Medicine; Detection limit; Nuclear medicine","score_opus":0.35473691480919106,"score_gpt":0.6128973161725231,"score_spread":0.258160401363332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2123033778","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019833522,0.0011383679,0.99438196,0.00019923998,0.00007018195,0.00009502167,0.00015740706,0.00049353344,0.0014810177],"genre_scores_gemma":[0.16152579,0.0029087674,0.8287747,0.00044093208,0.00041249153,0.002185085,0.0012133726,0.000886674,0.0016522871],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94887924,0.027877541,0.003729221,0.005805722,0.012593025,0.0011152558],"domain_scores_gemma":[0.52996665,0.40478343,0.018469922,0.01858508,0.027311541,0.0008834078],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06944848,0.0023016243,0.0036537936,0.008764308,0.0011370146,0.0063459473,0.0055090548,0.004454349,0.008516584],"category_scores_gemma":[0.4761174,0.0012189848,0.002813069,0.006026366,0.0043042284,0.008771112,0.0043184482,0.0071628224,0.0033343819],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046360103,0.00020243562,0.005101642,0.0022813322,0.00077269005,0.00046725065,0.0017091238,0.14095221,0.0023287372,0.4686802,0.010985341,0.36605543],"study_design_scores_gemma":[0.00020171505,0.00030244535,0.004592849,0.0021242474,0.00030004734,0.0011680966,0.00048521295,0.41886684,0.0059215394,0.54655176,0.01911555,0.00036965826],"about_ca_topic_score_codex":0.001689323,"about_ca_topic_score_gemma":0.0008197676,"teacher_disagreement_score":0.06944848,"about_ca_system_score_codex":0.0020999429,"about_ca_system_score_gemma":0.002185207,"threshold_uncertainty_score":0.36728305},"labels":[],"label_agreement":null},{"id":"W2123602065","doi":"10.1177/0962280214527386","title":"Bayesian hierarchical modelling of noisy spatial rates on a modestly large and discontinuous irregular lattice","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Child and Family Research Institute; University of British Columbia","funders":"Health Technology Assessment Programme; Natural Sciences and Engineering Research Council of Canada; National Institute for Health and Care Research","keywords":"Markov chain Monte Carlo; Overdispersion; Bayesian probability; Bayesian inference; Computer science; Statistics; Autoregressive model; Random effects model; Negative binomial distribution; Spatial analysis; Spatial dependence; Bayesian hierarchical modeling; Hierarchical database model; Econometrics; Mathematics; Poisson distribution; Data mining","score_opus":0.1687164579898777,"score_gpt":0.5362347401415055,"score_spread":0.36751828215162785,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2123602065","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06079733,0.0002511891,0.9362634,0.0006263994,0.000026887932,0.00006179299,0.0004133566,0.00020549457,0.0013541278],"genre_scores_gemma":[0.76074195,0.000559349,0.2315857,0.00019209734,0.00008536267,0.0003927998,0.00094606756,0.000122058285,0.0053746686],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9955642,0.0028588912,0.00018182662,0.00064916146,0.0004482399,0.00029767354],"domain_scores_gemma":[0.9664904,0.027408905,0.002679826,0.0016581266,0.0012284656,0.0005343325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010194576,0.00061734597,0.002094219,0.001386213,0.0006774412,0.0021693697,0.004304204,0.0018352877,0.0028008523],"category_scores_gemma":[0.038335875,0.0012206406,0.0015918033,0.0018494619,0.0031606727,0.0022844598,0.0026471221,0.0028321028,0.00042345322],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000063441206,0.000021550002,0.0028745946,0.000055019103,0.000042439475,0.00010274757,0.0002004453,0.8434305,0.00024242808,0.14571406,0.00043160122,0.0068211555],"study_design_scores_gemma":[0.000008466569,0.000009293379,0.00037030107,0.000008240398,0.000006311537,0.000013588335,0.000019059229,0.9639807,0.000048442034,0.035241965,0.00028373953,0.000010075733],"about_ca_topic_score_codex":0.025999323,"about_ca_topic_score_gemma":0.016541414,"teacher_disagreement_score":0.025999323,"about_ca_system_score_codex":0.002306505,"about_ca_system_score_gemma":0.0016059038,"threshold_uncertainty_score":0.053914666},"labels":[],"label_agreement":null},{"id":"W2124200703","doi":"10.1177/0962280213502437","title":"A comparison of machine learning methods for classification using simulation with multiple real data examples from mental health studies","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":85,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Menzies Centre for Australian Studies, King's College London, University of London; University of California, San Diego; Canadian Institutes of Health Research; University of California, Los Angeles; National Institutes of Health; Genentech; IXICO; Servier; King's College London; National Institute on Aging; National Institute for Health and Care Research; Northern California Institute for Research and Education; Eisai; Synarc; South London and Maudsley NHS Foundation Trust; Pfizer; Biogen; BioClinica; Medpace; Bristol-Myers Squibb; Eli Lilly and Company; AstraZeneca; Alzheimer's Association; Amorfix Life Sciences; Bayer HealthCare; Meso Scale Diagnostics; Alzheimer's Disease Neuroimaging Initiative; Novartis Pharmaceuticals Corporation","keywords":"Computer science; Sample size determination; Support vector machine; Artificial intelligence; Linear discriminant analysis; Machine learning; Random forest; Kernel (algebra); Sample (material); Stability (learning theory); Feature (linguistics); Kernel method; Pattern recognition (psychology); Statistics; Mathematics","score_opus":0.8484463315588613,"score_gpt":0.7874845120641984,"score_spread":0.06096181949466284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2124200703","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.50578696,0.007822463,0.4740576,0.0026593315,0.00056008785,0.0017175674,0.001824549,0.00091043586,0.004661096],"genre_scores_gemma":[0.78444225,0.0013875446,0.20950295,0.0003093187,0.00012363588,0.0021715118,0.001452888,0.00011403359,0.00049593253],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9684807,0.027263155,0.0012786522,0.0011193296,0.0016236323,0.00023455531],"domain_scores_gemma":[0.60345906,0.3740183,0.0066043455,0.008806596,0.00647404,0.0006376724],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.049763974,0.001087361,0.0015234563,0.0035590865,0.0006981372,0.0018853508,0.0022317914,0.0021447204,0.0023371608],"category_scores_gemma":[0.16305876,0.00045622938,0.003294927,0.0025101702,0.0011986843,0.0014336188,0.0015140293,0.0018977228,0.00032868359],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002832098,0.000769699,0.05406561,0.0027162079,0.0030560223,0.00034878327,0.00096932304,0.8142803,0.0005299524,0.013879418,0.003868655,0.10268398],"study_design_scores_gemma":[0.00026420175,0.00060191884,0.010859066,0.00042960074,0.00024891947,0.00016969605,0.0002835266,0.9721611,0.0005740696,0.012452557,0.0018893223,0.00006610583],"about_ca_topic_score_codex":0.0052012787,"about_ca_topic_score_gemma":0.003525361,"teacher_disagreement_score":0.950236,"about_ca_system_score_codex":0.0024152717,"about_ca_system_score_gemma":0.0015154869,"threshold_uncertainty_score":0.2631802},"labels":[],"label_agreement":null},{"id":"W2124612672","doi":"10.1177/0962280212436447","title":"Minimal sufficient balance—a new strategy to balance baseline covariates and preserve randomness of treatment allocation","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":90,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hotchkiss Brain Institute; University of Calgary","funders":"National Institute of Neurological Disorders and Stroke","keywords":"Covariate; Categorical variable; Randomization; Baseline (sea); Restricted randomization; Randomness; Statistics; Randomized controlled trial; Medicine; Mathematics; Surgery","score_opus":0.6337766155694683,"score_gpt":0.6851863314577871,"score_spread":0.051409715888318774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2124612672","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004817721,0.00020221372,0.99241877,0.0004477554,0.000055219243,0.00049783225,0.00007310479,0.00020956034,0.0012778332],"genre_scores_gemma":[0.19143137,0.00030385537,0.8006391,0.00094206486,0.00021171254,0.0039946157,0.00023967808,0.00022682767,0.0020108165],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96674347,0.027083449,0.0010930556,0.0018454104,0.0027582915,0.00047626585],"domain_scores_gemma":[0.97418094,0.019037543,0.0022172525,0.0026905946,0.0014103395,0.00046324273],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026158445,0.0013789153,0.0020795472,0.0019206408,0.00092310755,0.0013024372,0.0016391191,0.0016216479,0.0051117768],"category_scores_gemma":[0.06995567,0.0007574152,0.001365275,0.0013156729,0.002066524,0.002738624,0.002458185,0.0021877799,0.001057364],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003604086,0.00048540687,0.0046847584,0.0008632237,0.00075296056,0.00027649445,0.0010034468,0.081124395,0.009806823,0.40195954,0.011030618,0.4844083],"study_design_scores_gemma":[0.0039309757,0.0034295982,0.0025043986,0.00037945015,0.00038079178,0.0005412641,0.00012843631,0.3433768,0.008260332,0.59868276,0.038223755,0.00016144743],"about_ca_topic_score_codex":0.000619263,"about_ca_topic_score_gemma":0.0005236484,"teacher_disagreement_score":0.97384155,"about_ca_system_score_codex":0.0011160573,"about_ca_system_score_gemma":0.0034416968,"threshold_uncertainty_score":0.13834071},"labels":[],"label_agreement":null},{"id":"W2130845266","doi":"10.1177/0962280211427759","title":"Extension of the modified Poisson regression model to prospective studies with correlated binary data","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":745,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Statistics; Binary data; Estimator; Poisson distribution; Mathematics; Poisson regression; Logistic regression; Econometrics; Variance (accounting); Regression analysis; Cluster (spacecraft); Binary number; Computer science; Population; Medicine","score_opus":0.6529093814670139,"score_gpt":0.6393137010129344,"score_spread":0.01359568045407955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130845266","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0057355408,0.0009492314,0.99040097,0.0011272181,0.00014349933,0.00034114323,0.00022067585,0.0000909618,0.0009908227],"genre_scores_gemma":[0.1954444,0.0045732586,0.78959626,0.001557808,0.0006776008,0.0031256664,0.00064266205,0.00012006673,0.0042622723],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97606236,0.018827543,0.0011123266,0.0017530281,0.0019646806,0.0002799997],"domain_scores_gemma":[0.9494762,0.038223617,0.0046662055,0.0043165265,0.0029662808,0.00035117852],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04815462,0.00087831734,0.0018022251,0.0020660236,0.0004912283,0.0014649705,0.0045171804,0.0014946779,0.0030369428],"category_scores_gemma":[0.09785425,0.0008428098,0.0030670026,0.0031765078,0.0012440011,0.0018997896,0.0021091548,0.0032473153,0.00080223876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004315352,0.00021248941,0.023983173,0.0017829294,0.0018920164,0.0017579078,0.0014466913,0.124557935,0.0014924812,0.5624952,0.008449356,0.27149832],"study_design_scores_gemma":[0.00033504804,0.0005410733,0.006931272,0.0004537994,0.0007020995,0.0013147355,0.00021458455,0.3826031,0.00086548453,0.5879287,0.017959505,0.00015056555],"about_ca_topic_score_codex":0.0035432982,"about_ca_topic_score_gemma":0.0031038828,"teacher_disagreement_score":0.04815462,"about_ca_system_score_codex":0.001112441,"about_ca_system_score_gemma":0.0034932918,"threshold_uncertainty_score":0.254669},"labels":[],"label_agreement":null},{"id":"W2130892140","doi":"10.1177/0962280214543508","title":"Double propensity-score adjustment: A solution to design bias or bias due to incomplete matching","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":90,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Matching (statistics); Covariate; Statistics; Confounding; Average treatment effect; Mathematics; Selection bias; Observational study; Econometrics","score_opus":0.8048558980284114,"score_gpt":0.6387257078840167,"score_spread":0.16613019014439467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130892140","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013764779,0.0005064569,0.99606055,0.00075977267,0.00016256337,0.00027101173,0.000079096615,0.00016426206,0.0006197208],"genre_scores_gemma":[0.07423034,0.0012626362,0.91813254,0.0012525008,0.0005215333,0.001972207,0.00024699618,0.00022537821,0.0021558425],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8918604,0.082103804,0.0060116006,0.008381745,0.010489888,0.0011524981],"domain_scores_gemma":[0.8741279,0.0739572,0.014350555,0.02755882,0.009177556,0.0008278901],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09249119,0.0016634349,0.003753038,0.0037789803,0.0016490103,0.0031189718,0.003650724,0.0034162286,0.005562055],"category_scores_gemma":[0.23697141,0.0014385799,0.0038014608,0.0061780997,0.0032020782,0.0037109246,0.0057304013,0.0047014975,0.0010996525],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054940785,0.00014250982,0.009139227,0.002139546,0.002599002,0.00053513196,0.0013403618,0.023413032,0.0016174549,0.42772326,0.016084654,0.5147164],"study_design_scores_gemma":[0.00082422467,0.0005231058,0.0047862004,0.0009528445,0.0013138806,0.0014297842,0.00021459312,0.11654836,0.004353899,0.7955638,0.07317979,0.0003095068],"about_ca_topic_score_codex":0.0019104923,"about_ca_topic_score_gemma":0.0016704927,"teacher_disagreement_score":0.9075088,"about_ca_system_score_codex":0.0019359428,"about_ca_system_score_gemma":0.0074247033,"threshold_uncertainty_score":0.489146},"labels":[],"label_agreement":null},{"id":"W2135596283","doi":"10.1177/096228020101000502","title":"Statistical methods for the meta-analysis of cluster randomization trials","year":2001,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":159,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Meta-analysis; Estimator; Randomization; Computer science; Context (archaeology); Cluster randomised controlled trial; Cluster (spacecraft); Statistics; Restricted randomization; Statistical power; Variance (accounting); Sample size determination; Econometrics; Statistical hypothesis testing; Clinical trial; Randomized controlled trial; Medicine; Mathematics","score_opus":0.6678900408750544,"score_gpt":0.7118649138188959,"score_spread":0.0439748729438415,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2135596283","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002722455,0.005594969,0.9868623,0.0010871517,0.0010678337,0.002853023,0.0007718751,0.000935476,0.00055515044],"genre_scores_gemma":[0.0076113464,0.0031927936,0.95392513,0.0007645492,0.00066492683,0.032352637,0.00060359115,0.00038547657,0.0004994855],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.672075,0.2973038,0.012439779,0.0065793027,0.0109371655,0.00066496397],"domain_scores_gemma":[0.5323329,0.409231,0.01720605,0.03176193,0.008625786,0.0008423403],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23621407,0.0046102284,0.011450534,0.01438809,0.001507178,0.0042340537,0.007713521,0.0056074406,0.016946293],"category_scores_gemma":[0.51843303,0.0025134531,0.0116425045,0.015321518,0.0033916284,0.003915724,0.0045723645,0.013666396,0.004084189],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027640471,0.0003191891,0.0022708317,0.03643893,0.03204782,0.000623534,0.0009871364,0.04896517,0.0010216701,0.34519973,0.08472772,0.44463423],"study_design_scores_gemma":[0.0038661303,0.0010814008,0.0018293158,0.005858192,0.008740105,0.0005106332,0.00013966461,0.10844385,0.0013368165,0.7884951,0.07932209,0.00037660496],"about_ca_topic_score_codex":0.0019714874,"about_ca_topic_score_gemma":0.001743577,"teacher_disagreement_score":0.76378596,"about_ca_system_score_codex":0.0035614073,"about_ca_system_score_gemma":0.0085278135,"threshold_uncertainty_score":0.94188404},"labels":[],"label_agreement":null},{"id":"W2138930389","doi":"10.1177/0962280212448975","title":"Comparison of four shape features for detecting hippocampal shape changes in early Alzheimer's","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Alzheimer's disease research and treatments","field":"Medicine","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Alzheimer Society","keywords":"Spherical harmonics; Pattern recognition (psychology); Mathematics; Shape analysis (program analysis); Orthonormal basis; Artificial intelligence; Binary classification; Diffeomorphism; Mathematical analysis; Support vector machine; Computer science; Physics","score_opus":0.3136085106434523,"score_gpt":0.5916406204490242,"score_spread":0.2780321098055719,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138930389","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86062676,0.0014865856,0.13342544,0.0002837121,0.00009530066,0.00033410892,0.0009917723,0.0012285438,0.0015277858],"genre_scores_gemma":[0.8870796,0.0004624799,0.110232756,0.000049185324,0.00005470869,0.0002347658,0.0012634662,0.00013144124,0.0004915311],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.998601,0.00029029074,0.00014265538,0.00019524973,0.00066072296,0.00011019065],"domain_scores_gemma":[0.9953473,0.0024350742,0.00048720156,0.00033322547,0.0011616584,0.00023556393],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034070571,0.0009088597,0.0010491982,0.0063683153,0.0003672785,0.0011660402,0.00082516635,0.000867092,0.00077618123],"category_scores_gemma":[0.008382344,0.00034955805,0.0009434174,0.002073875,0.00044118182,0.0010401193,0.0007054227,0.0004978931,0.0003095067],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0057787206,0.00078040996,0.117699236,0.0004834208,0.00092394603,0.00015086269,0.00024542608,0.03749122,0.044616733,0.0011961517,0.002008993,0.788625],"study_design_scores_gemma":[0.0005365301,0.0032937196,0.28541517,0.000084748055,0.0005368526,0.00081750477,0.0004133579,0.6547156,0.049847633,0.0024946698,0.0015852232,0.000258864],"about_ca_topic_score_codex":0.0024170326,"about_ca_topic_score_gemma":0.0032644658,"teacher_disagreement_score":0.0063683153,"about_ca_system_score_codex":0.00057920447,"about_ca_system_score_gemma":0.0006575716,"threshold_uncertainty_score":0.018018484},"labels":[],"label_agreement":null},{"id":"W2140873752","doi":"10.1177/0962280213519716","title":"The performance of different propensity score methods for estimating absolute effects of treatments on survival outcomes: A simulation study","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":195,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital; University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Observational study; Inverse probability weighting; Statistics; Hazard ratio; Weighting; Average treatment effect; Medicine; Absolute risk reduction; Matching (statistics); Marginal structural model; Inverse probability; Mathematics; Confidence interval; Bayesian probability; Posterior probability","score_opus":0.5155792263631098,"score_gpt":0.6760756832121154,"score_spread":0.1604964568490056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140873752","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.45749053,0.0037024864,0.5289248,0.0019979903,0.00015894951,0.0014000831,0.0011494526,0.0003753363,0.004800288],"genre_scores_gemma":[0.81738955,0.0014254104,0.17748827,0.00032360366,0.00007147383,0.001492866,0.00088508945,0.0000893964,0.00083426124],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96598214,0.029937202,0.0012031589,0.0011382207,0.0013335071,0.00040583347],"domain_scores_gemma":[0.6150419,0.36300597,0.0068366304,0.008953953,0.0050874176,0.0010741471],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06970628,0.0011800594,0.0017018327,0.0028020486,0.0008174933,0.0016019165,0.0017975551,0.0020897684,0.0022492209],"category_scores_gemma":[0.17810358,0.00078942656,0.0032832278,0.0025158045,0.0014058481,0.002541828,0.0018784798,0.0026561401,0.00026644103],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002621951,0.0008229974,0.03794523,0.00042342706,0.0016896782,0.00015559759,0.00042402674,0.870237,0.00044012448,0.0363859,0.0015748872,0.04727917],"study_design_scores_gemma":[0.0004731285,0.00057186425,0.0043032933,0.0001432035,0.00025134938,0.000091788446,0.00009336158,0.9753049,0.00054140907,0.017234001,0.00092847785,0.000063300235],"about_ca_topic_score_codex":0.008581277,"about_ca_topic_score_gemma":0.005417457,"teacher_disagreement_score":0.93029374,"about_ca_system_score_codex":0.00229714,"about_ca_system_score_gemma":0.0021475193,"threshold_uncertainty_score":0.36864644},"labels":[],"label_agreement":null},{"id":"W2143838957","doi":"10.1177/0962280212447152","title":"On identification in Bayesian disease mapping and ecological–spatial regression models","year":2012,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Child and Family Research Institute; University of British Columbia","funders":"Canadian Institutes of Health Research; University of British Columbia; Ministry of Health, British Columbia; Indian Council of Agricultural Research","keywords":"Bayesian probability; Prior probability; Bayesian linear regression; Bayesian inference; Poisson distribution; Statistics; Econometrics; Computer science; Random effects model; Univariate; Gaussian; Bayesian multivariate linear regression; Identification (biology); Mathematics; Regression analysis; Multivariate statistics; Ecology; Biology","score_opus":0.28231828112242724,"score_gpt":0.5858811142094335,"score_spread":0.3035628330870062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2143838957","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023927558,0.00021762158,0.9961696,0.00038727207,0.000014672957,0.000015276286,0.00003840121,0.000034844335,0.0007294835],"genre_scores_gemma":[0.23721273,0.0029488544,0.7503612,0.0006495165,0.00051418564,0.00072976976,0.0006145867,0.00025999238,0.0067092027],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98860323,0.008200464,0.00036676344,0.0012192824,0.0012623069,0.00034795242],"domain_scores_gemma":[0.9338138,0.058452453,0.0033200171,0.002052966,0.0018151173,0.0005456118],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028048653,0.0016488039,0.002106031,0.0027439687,0.0010191594,0.002362618,0.0030593171,0.0026648436,0.00354987],"category_scores_gemma":[0.09174851,0.0012233194,0.0025726662,0.0028382365,0.0040809126,0.0051815608,0.0042880573,0.004454349,0.00067371584],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022139142,0.00002533617,0.0010853397,0.000104298095,0.000058231104,0.0000859428,0.0002390916,0.15052141,0.00031593168,0.8262959,0.0007161535,0.020530296],"study_design_scores_gemma":[0.0000069131092,0.000015870724,0.00027159843,0.000045484892,0.000018314327,0.000054529897,0.000024494613,0.4000559,0.00018852965,0.59807026,0.0012245153,0.000023526985],"about_ca_topic_score_codex":0.004669256,"about_ca_topic_score_gemma":0.004044943,"teacher_disagreement_score":0.028048653,"about_ca_system_score_codex":0.0022560444,"about_ca_system_score_gemma":0.0020785301,"threshold_uncertainty_score":0.14833719},"labels":[],"label_agreement":null},{"id":"W2146502722","doi":"10.1177/0962280214567141","title":"Predictive accuracy of novel risk factors and markers: A simulation study of the sensitivity of different performance measures for the Cox proportional hazards regression model","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"","keywords":"Proportional hazards model; Statistics; Concordance; Hazard ratio; Censoring (clinical trials); Medicine; Risk factor; Cohort; Regression; Population; Statistic; Econometrics; Internal medicine; Mathematics; Confidence interval; Environmental health","score_opus":0.6796715167424592,"score_gpt":0.626117586072389,"score_spread":0.05355393067007019,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2146502722","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9487964,0.0008177906,0.04748795,0.00046965166,0.000056585228,0.00020150213,0.00036417515,0.0001287824,0.0016770967],"genre_scores_gemma":[0.9848542,0.00018033158,0.014223528,0.00007473214,0.000010740178,0.0001446048,0.0002845446,0.000019400582,0.00020801972],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9932847,0.0048233247,0.00028504184,0.00073043536,0.00055818044,0.00031841444],"domain_scores_gemma":[0.8616593,0.12552184,0.004517732,0.0045358795,0.00296263,0.00080275984],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.029975148,0.0009354678,0.0012075123,0.0014063094,0.0007253374,0.0014194559,0.001764642,0.0018893911,0.0007420711],"category_scores_gemma":[0.07666557,0.000555772,0.0018497909,0.0011566603,0.0013600807,0.0014566102,0.0013792109,0.0023555725,0.00010387987],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010580607,0.00024475192,0.03500461,0.000116444404,0.00039270503,0.00019086165,0.00020447468,0.9505504,0.0007414936,0.0042620352,0.0003999341,0.006834312],"study_design_scores_gemma":[0.0000807198,0.0003461203,0.004035923,0.000046563542,0.000088303605,0.000068851776,0.000051077117,0.9921571,0.00083372643,0.00206003,0.00019637645,0.000035182173],"about_ca_topic_score_codex":0.013645484,"about_ca_topic_score_gemma":0.0062603783,"teacher_disagreement_score":0.9700248,"about_ca_system_score_codex":0.0021494657,"about_ca_system_score_gemma":0.0015947669,"threshold_uncertainty_score":0.15852565},"labels":[],"label_agreement":null},{"id":"W2147254563","doi":"10.1177/0962280213503925","title":"Linear spline multilevel models for summarising childhood growth trajectories: A guide to their application using examples from five birth cohorts","year":2013,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Birth, Development, and Health","field":"Medicine","cited_by":204,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Canadian Institutes of Health Research; Wellcome Trust","keywords":"Spline (mechanical); Multilevel model; Smoothing spline; Computer science; Econometrics; Linear model; Generalized linear mixed model; Mathematics; Statistics; Spline interpolation","score_opus":0.18016007865582498,"score_gpt":0.53160055665824,"score_spread":0.35144047800241507,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147254563","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006185262,0.0021682712,0.988176,0.00074187684,0.00019085863,0.000338145,0.003000305,0.0018640539,0.0029018642],"genre_scores_gemma":[0.0050817067,0.0032237638,0.9856119,0.00021206882,0.00009398873,0.0012002961,0.0016295436,0.0007809009,0.002165841],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9952453,0.0034324366,0.00049055467,0.00017963014,0.0005783273,0.00007370516],"domain_scores_gemma":[0.9871802,0.010445998,0.0005687952,0.00062206417,0.0010696905,0.00011333692],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010199542,0.001346851,0.0011145889,0.0035345305,0.00071112125,0.0017005823,0.0025272847,0.0018330642,0.027514605],"category_scores_gemma":[0.03131039,0.0011907308,0.0028619326,0.0061078724,0.00061939727,0.001636099,0.0019684583,0.0038188195,0.008768414],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011865383,0.00015650643,0.0045178733,0.0038000506,0.0003835229,0.001446647,0.0028442799,0.08261496,0.0018049912,0.30678144,0.23179975,0.36373144],"study_design_scores_gemma":[0.000110771594,0.00016680246,0.0029397495,0.0018171713,0.00014716954,0.0013389247,0.000831529,0.20487976,0.001205584,0.2968616,0.48943925,0.00026166177],"about_ca_topic_score_codex":0.010714224,"about_ca_topic_score_gemma":0.02081065,"teacher_disagreement_score":0.027514605,"about_ca_system_score_codex":0.0009267609,"about_ca_system_score_gemma":0.002270878,"threshold_uncertainty_score":0.092045546},"labels":[],"label_agreement":null},{"id":"W2155839122","doi":"10.1177/0962280214568110","title":"Bayesian regression models for the estimation of net cost of disease using aggregate data","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Toronto General Hospital; Public Health Ontario; University of Toronto","funders":"","keywords":"Heteroscedasticity; Aggregate (composite); Econometrics; Computer science; Bayesian probability; Skewness; Linear regression; Bayesian linear regression; Linear model; Estimation; Regression; Statistics; Bayesian inference; Data mining; Mathematics; Machine learning; Artificial intelligence; Economics","score_opus":0.8612777946749054,"score_gpt":0.7029062873227251,"score_spread":0.1583715073521803,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2155839122","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011186874,0.0006143206,0.986048,0.00046511262,0.000031496325,0.000098754404,0.00039270386,0.00016646851,0.0009963227],"genre_scores_gemma":[0.42451236,0.0040875934,0.55465454,0.0005451063,0.0002978874,0.0019884745,0.0029051492,0.00032213042,0.010686726],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99044573,0.0071643884,0.0003472031,0.0008265304,0.0009289232,0.00028708868],"domain_scores_gemma":[0.9694875,0.025494397,0.0024672993,0.0011072125,0.0012448173,0.00019867087],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019724503,0.0014333028,0.0023517658,0.0032000775,0.00045907215,0.0023542326,0.0034923807,0.0017912254,0.005182662],"category_scores_gemma":[0.06428032,0.0013138014,0.002369776,0.0031493604,0.0011238197,0.0037545809,0.0014155424,0.0027925663,0.0011465374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018948893,0.000102149796,0.0057674916,0.00020714599,0.0005140195,0.00010940089,0.0002195146,0.7063346,0.0003611416,0.21518296,0.0023501613,0.068662],"study_design_scores_gemma":[0.000035938443,0.000054883993,0.0016603771,0.00008240839,0.000088011206,0.000048533162,0.00003745977,0.88744485,0.00015185842,0.10856283,0.0017892425,0.000043545486],"about_ca_topic_score_codex":0.011616212,"about_ca_topic_score_gemma":0.011018563,"teacher_disagreement_score":0.019724503,"about_ca_system_score_codex":0.0019703486,"about_ca_system_score_gemma":0.0013948646,"threshold_uncertainty_score":0.10431439},"labels":[],"label_agreement":null},{"id":"W2157235443","doi":"10.1177/0962280214521348","title":"Multiple imputation of covariates by fully conditional specification: Accommodating the substantive model","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":491,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Economic and Social Research Council; University of California, San Diego; National Institutes of Health; Genentech; IXICO; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; University of California, Los Angeles; Servier; Eisai; Northern California Institute for Research and Education; Pfizer; Biogen; BioClinica; Alzheimer's Association; Amorfix Life Sciences; F. Hoffmann-La Roche; Medpace; AstraZeneca; Eli Lilly and Company; Bristol-Myers Squibb; Novartis Pharmaceuticals Corporation; Synarc; Bayer HealthCare; Alzheimer's Disease Neuroimaging Initiative; Medical Research Council; Meso Scale Diagnostics; Foundation for the National Institutes of Health","keywords":"Covariate; Imputation (statistics); Missing data; Econometrics; Computer science; Statistics; Specification; Mathematics","score_opus":0.2276033325385271,"score_gpt":0.5725945814759557,"score_spread":0.34499124893742855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2157235443","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017032668,0.000072411756,0.9974125,0.00023554493,0.00001952022,0.000045243087,0.000103302635,0.00014245977,0.000265662],"genre_scores_gemma":[0.100503735,0.00032854045,0.89642215,0.0003933157,0.00012249166,0.00042343672,0.0008739007,0.00019278088,0.00073963637],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9532902,0.03901273,0.0016276606,0.0022468637,0.0030311462,0.0007913705],"domain_scores_gemma":[0.8854293,0.08484989,0.005221821,0.01898801,0.004720888,0.0007900204],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04854816,0.0010404018,0.0023072723,0.0016694147,0.00080463476,0.0026678538,0.0051223338,0.0023419913,0.003995533],"category_scores_gemma":[0.15986452,0.0012082309,0.0027686513,0.0049327887,0.0015308217,0.0030462763,0.004445557,0.0041473936,0.0012100985],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034120693,0.0001782241,0.015641112,0.00079627737,0.001005512,0.0005977505,0.0012284546,0.23910853,0.0014411875,0.46896172,0.012662876,0.25803712],"study_design_scores_gemma":[0.00014212415,0.00012789473,0.0016979208,0.00020509058,0.0001958123,0.0003290573,0.00009379063,0.6288177,0.0010267907,0.36094224,0.006345931,0.000075663476],"about_ca_topic_score_codex":0.003062418,"about_ca_topic_score_gemma":0.003861716,"teacher_disagreement_score":0.95145184,"about_ca_system_score_codex":0.00088957004,"about_ca_system_score_gemma":0.004958197,"threshold_uncertainty_score":0.2567503},"labels":[],"label_agreement":null},{"id":"W2164186633","doi":"10.1177/0962280211414620","title":"A likelihood-based two-part marginal model for longitudinal semicontinuous data","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Medical Research Council","keywords":"Marginal model; Marginal structural model; Marginal distribution; Marginal likelihood; Covariate; Random effects model; Mixed model; Robustness (evolution); Statistics; Computer science; Statistical model; Population; Econometrics; Mathematics; Maximum likelihood; Regression analysis; Random variable; Medicine; Observational study","score_opus":0.6006715937666185,"score_gpt":0.6232256022617889,"score_spread":0.02255400849517042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164186633","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046050055,0.00008599828,0.9943152,0.00021673062,0.000023350765,0.00006884162,0.00021531305,0.00012989492,0.00033959615],"genre_scores_gemma":[0.28093728,0.0005249022,0.706816,0.0006638588,0.00014448143,0.0020027976,0.0016182996,0.0002654259,0.0070269126],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99009377,0.0069257645,0.0003620883,0.0012935362,0.0010021186,0.0003227167],"domain_scores_gemma":[0.9735839,0.020467104,0.0015761079,0.002806026,0.0011908109,0.0003760911],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022840636,0.0012064741,0.0024096083,0.0016492679,0.0007128766,0.0022304624,0.004618871,0.0024842434,0.0071110516],"category_scores_gemma":[0.05048248,0.0011643986,0.0030962008,0.0022771247,0.0030488654,0.0034413224,0.0029791244,0.003971402,0.0014826505],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053085905,0.00019265921,0.010977355,0.00040719032,0.00043903204,0.0005888483,0.0016304305,0.19867137,0.0023319228,0.6805704,0.0039034449,0.09975646],"study_design_scores_gemma":[0.00007204228,0.0002184397,0.002474806,0.00009072367,0.00009483571,0.00027229163,0.00011836333,0.64301634,0.0006156767,0.34810466,0.004829026,0.00009278942],"about_ca_topic_score_codex":0.00388133,"about_ca_topic_score_gemma":0.0041478327,"teacher_disagreement_score":0.022840636,"about_ca_system_score_codex":0.0014905574,"about_ca_system_score_gemma":0.0021521018,"threshold_uncertainty_score":0.12079424},"labels":[],"label_agreement":null},{"id":"W2164288176","doi":"10.1177/0962280215601458","title":"An improved procedure for estimation of malignant breast cancer prevalence using partially rank ordered set samples with multiple concomitants","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Fields Institute for Research in Mathematical Sciences; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; University of Manitoba","keywords":"Ranking (information retrieval); Rank (graph theory); Estimator; Sampling (signal processing); Statistics; Mathematics; Logistic regression; Set (abstract data type); Population; Breast cancer; Computer science; Data mining; Artificial intelligence; Cancer; Medicine; Combinatorics","score_opus":0.38167056655703446,"score_gpt":0.6098130584075224,"score_spread":0.22814249185048796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164288176","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006960235,0.000051842,0.9924334,0.000028578204,0.000015066394,0.000119278164,0.000064688946,0.00017301494,0.00015386302],"genre_scores_gemma":[0.087406285,0.00008451403,0.91104686,0.000050112227,0.00003750978,0.0004084695,0.00035849662,0.00004175951,0.0005660044],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99307996,0.0039043655,0.00040024225,0.0010032874,0.0013794656,0.00023265964],"domain_scores_gemma":[0.9868945,0.009098098,0.00095166144,0.0014118656,0.0014241282,0.00021982957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008836502,0.00095059315,0.0019817338,0.0024270352,0.00064218004,0.001098381,0.0018064678,0.0012034206,0.003317546],"category_scores_gemma":[0.028670423,0.0007178625,0.0019413122,0.0017142759,0.0011476497,0.0012714821,0.0016084351,0.0017848603,0.0007191861],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010056531,0.00037298904,0.019871019,0.00080900564,0.0006425458,0.00051038456,0.0006215421,0.26341295,0.023781814,0.056652375,0.002153369,0.6301664],"study_design_scores_gemma":[0.00012581702,0.00038779582,0.0054588434,0.00006199794,0.00009880936,0.00027258266,0.00006501376,0.9689038,0.007408448,0.014728099,0.002394362,0.00009439691],"about_ca_topic_score_codex":0.003968647,"about_ca_topic_score_gemma":0.0039268183,"teacher_disagreement_score":0.008836502,"about_ca_system_score_codex":0.00061269297,"about_ca_system_score_gemma":0.002078806,"threshold_uncertainty_score":0.046732485},"labels":[],"label_agreement":null},{"id":"W2170857766","doi":"10.1177/0962280210395739","title":"A generalized <i>p</i> -value approach for assessing noninferiority in a three-arm trial","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Confidence interval; Type I and type II errors; Statistics; Monte Carlo method; Sample size determination; Fraction (chemistry); Placebo; Mathematics; Value (mathematics); Medicine","score_opus":0.85810859778597,"score_gpt":0.7266962355247384,"score_spread":0.13141236226123165,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2170857766","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009461511,0.0008251265,0.9851462,0.00060457503,0.00020224894,0.0011282632,0.00039078624,0.000482175,0.0017590245],"genre_scores_gemma":[0.2524838,0.0008635811,0.73520774,0.0010918854,0.0003636431,0.0073105874,0.0006631898,0.00034553904,0.0016699595],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88865423,0.09598508,0.0025389637,0.0049119103,0.0069818282,0.00092799374],"domain_scores_gemma":[0.6343086,0.33759016,0.0065416186,0.016897714,0.0038430989,0.00081882253],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11350016,0.002352268,0.004476964,0.004668939,0.0010365888,0.0026092017,0.004305414,0.0042411177,0.009993859],"category_scores_gemma":[0.30196032,0.00061998994,0.0058707655,0.004806246,0.005305686,0.0028017182,0.0030289134,0.006346558,0.00094610616],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005740874,0.00045886385,0.015105941,0.0048508574,0.005176498,0.002534509,0.0012638924,0.15485512,0.0044467784,0.31489447,0.018530317,0.4721419],"study_design_scores_gemma":[0.0013387237,0.0034824833,0.0064395997,0.00061255414,0.0013402629,0.0016318989,0.00022297725,0.5475979,0.0046641147,0.42098796,0.0114429165,0.00023863975],"about_ca_topic_score_codex":0.00088683906,"about_ca_topic_score_gemma":0.00057875,"teacher_disagreement_score":0.8864998,"about_ca_system_score_codex":0.0017218523,"about_ca_system_score_gemma":0.0037699544,"threshold_uncertainty_score":0.6002534},"labels":[],"label_agreement":null},{"id":"W2171446894","doi":"10.1177/0962280211402548","title":"Confidence interval estimation for the Bland–Altman limits of agreement with multiple observations per individual","year":2011,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Hemodynamic Monitoring and Therapy","field":"Medicine","cited_by":262,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Ontario Ministry of Research and Innovation","keywords":"Confidence interval; Statistics; Quantile; Point estimation; Limits of agreement; Bland–Altman plot; Mathematics; Robust confidence intervals; Standard error; Interval estimation; Interval (graph theory); Econometrics; Level of measurement; Medicine; Nuclear medicine","score_opus":0.4464294343882807,"score_gpt":0.573171685688689,"score_spread":0.12674225130040834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2171446894","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002253055,0.0012975493,0.99231404,0.00016933389,0.0002562932,0.00051024853,0.00038710597,0.0012345619,0.0015778688],"genre_scores_gemma":[0.042629965,0.0007042022,0.9498258,0.00019135144,0.00015154594,0.0037096324,0.00072124053,0.001147801,0.00091836083],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82416254,0.118225984,0.010565458,0.014653299,0.031041188,0.0013515385],"domain_scores_gemma":[0.4690579,0.4284732,0.030771099,0.036640372,0.033713147,0.0013442737],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15304744,0.0026160097,0.0037635004,0.007783552,0.0020024946,0.005653254,0.0075131906,0.0037912289,0.013619445],"category_scores_gemma":[0.50799173,0.001789723,0.0048061935,0.0067471466,0.0036493717,0.0051116603,0.0062967637,0.009581356,0.0032445367],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030651973,0.00058765133,0.02018874,0.006177624,0.005031981,0.0004969485,0.0037553683,0.038512435,0.0062675932,0.14316985,0.04346652,0.72928],"study_design_scores_gemma":[0.0010091515,0.0027575556,0.04959836,0.0057973033,0.0033331409,0.0037603318,0.001355846,0.48361596,0.026867397,0.27519137,0.14523213,0.0014815343],"about_ca_topic_score_codex":0.0027188591,"about_ca_topic_score_gemma":0.001993608,"teacher_disagreement_score":0.84695256,"about_ca_system_score_codex":0.002448095,"about_ca_system_score_gemma":0.00508713,"threshold_uncertainty_score":0.8094019},"labels":[],"label_agreement":null},{"id":"W2332566401","doi":"10.1177/0962280214552291","title":"Confidence intervals for a difference between lognormal means in cluster randomization trials","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"","keywords":"Confidence interval; Statistics; Randomization; Coverage probability; Sample size determination; Variance (accounting); Inference; Cluster randomised controlled trial; Mathematics; Cluster (spacecraft); Causal inference; Randomized controlled trial; Econometrics; Computer science; Medicine; Artificial intelligence","score_opus":0.41840400507326886,"score_gpt":0.6391732705030557,"score_spread":0.22076926542978687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2332566401","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016126974,0.008507141,0.96731097,0.0017157984,0.00047050347,0.0009419695,0.00053730136,0.00070284423,0.0036864178],"genre_scores_gemma":[0.43054217,0.004032085,0.5542818,0.0017806068,0.00057250157,0.006226072,0.0010538806,0.00035861952,0.001152257],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.72683024,0.23472585,0.009757478,0.01121737,0.016153377,0.0013156305],"domain_scores_gemma":[0.15457764,0.79112136,0.020061098,0.024279851,0.008800419,0.0011596142],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27889597,0.0017218876,0.004897626,0.0049435836,0.0012390906,0.0055982727,0.006282327,0.0059902905,0.005190907],"category_scores_gemma":[0.73637027,0.0012293198,0.0040403353,0.0050782613,0.006600256,0.0064511127,0.005116168,0.009255924,0.000748592],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00777097,0.00032744816,0.0135154985,0.0065472405,0.0051821116,0.00070919545,0.002716631,0.10306522,0.0012774604,0.59831333,0.01069629,0.24987863],"study_design_scores_gemma":[0.0021073085,0.0015797942,0.007713255,0.004377333,0.0027926264,0.0010846144,0.0004283607,0.3316375,0.0034771238,0.6308863,0.013548544,0.0003671825],"about_ca_topic_score_codex":0.0017395373,"about_ca_topic_score_gemma":0.00083424844,"teacher_disagreement_score":0.721104,"about_ca_system_score_codex":0.0027369473,"about_ca_system_score_gemma":0.0030838007,"threshold_uncertainty_score":0.8892496},"labels":[],"label_agreement":null},{"id":"W2339513403","doi":"10.1177/0962280215613378","title":"Bayesian analysis of multi-type recurrent events and dependent termination with nonparametric covariate functions","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"National Center for Advancing Translational Sciences; National Institute of Neurological Disorders and Stroke; University of Texas at Austin","keywords":"Covariate; Nonparametric statistics; Event (particle physics); Statistics; Multivariate statistics; Bayesian probability; Econometrics; Computer science; Mathematics","score_opus":0.4006036106045842,"score_gpt":0.6092943891545313,"score_spread":0.20869077854994705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2339513403","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032744523,0.000632238,0.9650566,0.000591109,0.00003375058,0.0000922748,0.00023476033,0.00012501686,0.00048964267],"genre_scores_gemma":[0.7130838,0.0017157445,0.27699798,0.0005335255,0.00030239724,0.0011242183,0.0012721301,0.0001955347,0.004774708],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.979154,0.01632348,0.0006986768,0.0018802603,0.0013556705,0.0005878947],"domain_scores_gemma":[0.825286,0.1496571,0.010285767,0.01062448,0.0030035286,0.0011431131],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.067688316,0.0010444019,0.0024638097,0.0016228828,0.00069404877,0.0019443684,0.003567613,0.0022270107,0.0028262509],"category_scores_gemma":[0.15643013,0.0010961487,0.0026793187,0.0019144362,0.0022679286,0.003620846,0.0029801556,0.0042671887,0.00038495628],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011207493,0.0002906265,0.043371484,0.00056648185,0.0016949218,0.00096749066,0.0010365,0.34736603,0.0017243652,0.47087678,0.0036480762,0.12733646],"study_design_scores_gemma":[0.00015329645,0.00017046582,0.0058257733,0.00009307518,0.00023159373,0.0001638874,0.00006120095,0.7812538,0.00047639516,0.2097283,0.0017882963,0.000053941338],"about_ca_topic_score_codex":0.0039363736,"about_ca_topic_score_gemma":0.0035293417,"teacher_disagreement_score":0.067688316,"about_ca_system_score_codex":0.0012858332,"about_ca_system_score_gemma":0.002466991,"threshold_uncertainty_score":0.3579743},"labels":[],"label_agreement":null},{"id":"W2373287088","doi":"10.1177/0962280215590432","title":"Accounting for dropout reason in longitudinal studies with nonignorable dropout","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vancouver Infectious Diseases Centre; McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Institute on Drug Abuse","keywords":"Dropout (neural networks); Longitudinal data; Econometrics; Psychology; Medicine; Statistics; Computer science; Economics; Mathematics; Data mining; Machine learning","score_opus":0.7294024134950148,"score_gpt":0.7194349984114543,"score_spread":0.009967415083560471,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2373287088","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029303242,0.0033707484,0.9589019,0.002971497,0.00059043866,0.0020958583,0.0010255809,0.0006783934,0.0010624116],"genre_scores_gemma":[0.5252749,0.002276001,0.45285246,0.0034813187,0.0008027818,0.009741918,0.0020858431,0.00031529172,0.0031695212],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.71927947,0.23262478,0.022487821,0.014268037,0.009302052,0.0020378581],"domain_scores_gemma":[0.37370425,0.5074503,0.048111465,0.06269979,0.0065242522,0.0015099699],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.34978458,0.0014925458,0.004164211,0.005324131,0.002345202,0.0031236708,0.0055993265,0.005495476,0.0043798867],"category_scores_gemma":[0.5652913,0.0016186228,0.0078020534,0.0067914403,0.0037852167,0.004560718,0.0045209597,0.0056580654,0.00058060256],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032824683,0.0006534311,0.3634597,0.0064886045,0.012669854,0.0030513213,0.006846675,0.03305586,0.0011830596,0.12779881,0.015158926,0.42635122],"study_design_scores_gemma":[0.0014622938,0.0029677919,0.13755953,0.0053059915,0.00889441,0.0027961822,0.002040864,0.2632439,0.0033442262,0.53152096,0.04030594,0.00055795547],"about_ca_topic_score_codex":0.004162649,"about_ca_topic_score_gemma":0.0050742296,"teacher_disagreement_score":0.6502154,"about_ca_system_score_codex":0.0016874743,"about_ca_system_score_gemma":0.0050929203,"threshold_uncertainty_score":0.80183136},"labels":[],"label_agreement":null},{"id":"W2401418077","doi":"10.1177/0962280212451883","title":"Letter to the editor","year":2012,"lang":"en","type":"letter","venue":"Statistical Methods in Medical Research","topic":"Smoking Behavior and Cessation","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"","keywords":"Computer science; Data science","score_opus":0.21606490369746106,"score_gpt":0.5879729825449449,"score_spread":0.37190807884748384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2401418077","genre_codex":"commentary","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001848294,0.0013021054,0.00015144509,0.922436,0.07178336,0.000025207122,0.00008787166,0.000051702278,0.0039774696],"genre_scores_gemma":[0.0014424844,0.00069067517,0.0002071817,0.9358669,0.04958834,0.000059935697,0.000025715553,0.00003523135,0.012083535],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9918474,0.0029471254,0.00087001617,0.0009367048,0.0025970319,0.0008017159],"domain_scores_gemma":[0.9752896,0.012937797,0.001458804,0.0008371572,0.006806089,0.002670599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00930464,0.00088099064,0.0025180576,0.0012852168,0.0036176012,0.0048672534,0.0022702473,0.03521961,0.010682827],"category_scores_gemma":[0.07164599,0.0009540047,0.0015942757,0.0010144357,0.0020215232,0.0024422596,0.0011502173,0.027237164,0.009841907],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026856944,0.000011553572,0.00016142853,0.00002738785,0.000009364947,0.00021444705,0.000024199055,0.000018200884,0.000021135755,0.0004449601,0.9953732,0.0036674202],"study_design_scores_gemma":[0.00010881062,0.000046508732,0.0012110542,0.0003978765,0.00004590538,0.00087992824,0.00019685122,0.00033988617,0.00015249611,0.0037813766,0.99278367,0.00005558812],"about_ca_topic_score_codex":0.0067285644,"about_ca_topic_score_gemma":0.011643722,"teacher_disagreement_score":0.03521961,"about_ca_system_score_codex":0.0038183336,"about_ca_system_score_gemma":0.006930695,"threshold_uncertainty_score":0.049208224},"labels":[],"label_agreement":null},{"id":"W2484604119","doi":"10.1177/0962280216658920","title":"Propensity score matching and complex surveys","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Covariate; Statistics; Confounding; Matching (statistics); Sample size determination; Medicine; Population; Demography; Econometrics; Mathematics; Environmental health","score_opus":0.7553058634596144,"score_gpt":0.6754228526511649,"score_spread":0.0798830108084495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2484604119","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00897838,0.0014236021,0.9850831,0.0017869514,0.00013220604,0.00050312915,0.00022045092,0.00017187098,0.0017004061],"genre_scores_gemma":[0.23704852,0.004521309,0.75244033,0.0011065725,0.00047169946,0.002355793,0.0006960278,0.000118856675,0.0012408961],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.903447,0.08604067,0.0025873682,0.0033031257,0.004150601,0.0004712125],"domain_scores_gemma":[0.86045116,0.109223194,0.01368039,0.012702521,0.0032374272,0.0007053124],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.077933855,0.00092445157,0.001968686,0.0036565633,0.00095408515,0.002544535,0.002075485,0.0019018811,0.0050491304],"category_scores_gemma":[0.22930801,0.00087257376,0.0014798125,0.008054586,0.0033814558,0.0039868024,0.0034367286,0.0033309276,0.00050423574],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021743076,0.00015795058,0.021490838,0.0009660525,0.0009873833,0.0001672903,0.0008921417,0.054544613,0.00032091,0.7105243,0.006167427,0.20356362],"study_design_scores_gemma":[0.00019562728,0.00020106905,0.007529591,0.00043402184,0.00013879765,0.00018239666,0.0001732423,0.11117597,0.0003700685,0.862163,0.017367521,0.000068689515],"about_ca_topic_score_codex":0.0036569175,"about_ca_topic_score_gemma":0.0023443755,"teacher_disagreement_score":0.077933855,"about_ca_system_score_codex":0.0023875819,"about_ca_system_score_gemma":0.0040439577,"threshold_uncertainty_score":0.41215855},"labels":[],"label_agreement":null},{"id":"W2510561985","doi":"10.1177/0962280216660127","title":"A two-stage model in a Bayesian framework to estimate a survival endpoint in the presence of confounding by indication","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Institut National Du Cancer","keywords":"Prostate-specific antigen; Prostate cancer; Medicine; Oncology; Biomarker; Prostate; Hormonal therapy; Clinical endpoint; Hormone therapy; Internal medicine; Randomized controlled trial; Cancer; Biology","score_opus":0.6285155508790987,"score_gpt":0.7340032660082315,"score_spread":0.1054877151291328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2510561985","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058087427,0.0007560637,0.93651456,0.0012352756,0.000110424364,0.00034308026,0.0010436584,0.00035480488,0.0015548054],"genre_scores_gemma":[0.70269114,0.0014060428,0.27399552,0.00068567944,0.00033009128,0.0025636402,0.0024747807,0.00019701236,0.015656015],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9934076,0.0042111627,0.00026508528,0.001158057,0.0004191769,0.00053888914],"domain_scores_gemma":[0.9792682,0.017428901,0.001269492,0.000574325,0.00108186,0.00037728032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017532015,0.0018928745,0.0033313946,0.0019324779,0.0009317931,0.0024982246,0.0038632553,0.0038186656,0.005583866],"category_scores_gemma":[0.02528005,0.0019783077,0.0033894402,0.0017460703,0.002379296,0.0021740256,0.0021366137,0.003783013,0.00090261217],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056845625,0.0001226685,0.009271359,0.00019846928,0.00044257712,0.00032207524,0.00040453224,0.9008604,0.00082267233,0.06981845,0.0009953263,0.016173007],"study_design_scores_gemma":[0.0001086864,0.00012778475,0.0014142169,0.00004304199,0.0001332304,0.00006352712,0.000031106883,0.9727418,0.00014248936,0.024176484,0.00096846843,0.00004911426],"about_ca_topic_score_codex":0.03855167,"about_ca_topic_score_gemma":0.02252727,"teacher_disagreement_score":0.03855167,"about_ca_system_score_codex":0.0028137458,"about_ca_system_score_gemma":0.003614785,"threshold_uncertainty_score":0.09271932},"labels":[],"label_agreement":null},{"id":"W2514759531","doi":"10.1177/0962280216662494","title":"Mortality and morbidity peaks modeling: An extreme value theory approach","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Hydrology and Drought Analysis","field":"Environmental Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre hospitalier universitaire de Québec; Institut National de Santé Publique du Québec; Université Laval; Institut National de la Recherche Scientifique","funders":"","keywords":"Extreme value theory; Public health; Metropolitan area; Health care; Value (mathematics); Actuarial science; Medicine; Computer science; Operations research; Statistics; Econometrics; Business; Mathematics; Economics; Nursing","score_opus":0.30642057569356257,"score_gpt":0.5375606796132323,"score_spread":0.23114010391966971,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2514759531","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021927489,0.0002604485,0.9750693,0.00046422725,0.00004814474,0.00013322911,0.00043965128,0.00022725455,0.00143025],"genre_scores_gemma":[0.6560556,0.00080342323,0.33475885,0.00038080546,0.00038999386,0.0009373971,0.0020695804,0.0001878816,0.004416389],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99688476,0.0018891772,0.00013090584,0.00047129343,0.00035075514,0.00027293482],"domain_scores_gemma":[0.99087864,0.0074190586,0.0006416341,0.0003375137,0.0005144305,0.00020876592],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0065549617,0.0010330918,0.0011647957,0.0024764542,0.00060565735,0.0024156715,0.0028781237,0.0016477024,0.0022434827],"category_scores_gemma":[0.013255476,0.0006171845,0.0023429205,0.002203484,0.0011117555,0.0013566789,0.002060806,0.0026495857,0.00043595483],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000759474,0.00015252849,0.014772239,0.00012481348,0.00021654474,0.00023993675,0.0002675621,0.8819545,0.0003864121,0.0657654,0.002613356,0.033430796],"study_design_scores_gemma":[0.0000055685246,0.000027155273,0.001119413,0.00001612865,0.000015481613,0.000028256629,0.000058712754,0.96481365,0.00009381753,0.033099182,0.0007093033,0.000013266697],"about_ca_topic_score_codex":0.005611803,"about_ca_topic_score_gemma":0.0035965885,"teacher_disagreement_score":0.0065549617,"about_ca_system_score_codex":0.0012116589,"about_ca_system_score_gemma":0.0015160288,"threshold_uncertainty_score":0.03466636},"labels":[],"label_agreement":null},{"id":"W2515545921","doi":"10.1177/0962280216660419","title":"Linear models of coregionalization for multivariate lattice data: Order-dependent and order-free cMCARs","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Multivariate statistics; Univariate; Autoregressive model; Computer science; Multivariate analysis; Context (archaeology); Covariance; Linear model; Generalized linear mixed model; Econometrics; Statistics; Mathematics; Machine learning","score_opus":0.44791645230417537,"score_gpt":0.6086216280736643,"score_spread":0.1607051757694889,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2515545921","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007903079,0.00030844193,0.9901411,0.00031562126,0.000032024764,0.000033104894,0.00020111723,0.00015515367,0.0009103829],"genre_scores_gemma":[0.5462888,0.002346853,0.43187475,0.00091152976,0.0005607718,0.00085708324,0.001931887,0.0006482985,0.014580075],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99453413,0.0028849994,0.00022225204,0.0011458838,0.0007763712,0.00043636432],"domain_scores_gemma":[0.97865146,0.013674728,0.0031126325,0.002595142,0.0015264414,0.000439596],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010306928,0.0014327528,0.0020439073,0.0020227607,0.00077166926,0.0028850245,0.004073394,0.0019131502,0.0037369428],"category_scores_gemma":[0.027122002,0.0010693653,0.0028258425,0.0024556243,0.0032023157,0.0041347495,0.0034496807,0.004777035,0.0009937902],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000060528946,0.00003999655,0.0024640164,0.00011755562,0.00013414267,0.00014395195,0.00027625414,0.23320419,0.00075313373,0.73390937,0.0022783612,0.026618501],"study_design_scores_gemma":[0.000010219586,0.000021715896,0.00056715845,0.000025724916,0.000028062017,0.00005142278,0.000034502358,0.7678937,0.00021421375,0.2289305,0.002188172,0.00003461603],"about_ca_topic_score_codex":0.009707115,"about_ca_topic_score_gemma":0.008820283,"teacher_disagreement_score":0.010306928,"about_ca_system_score_codex":0.0021585596,"about_ca_system_score_gemma":0.0022155493,"threshold_uncertainty_score":0.054508865},"labels":[],"label_agreement":null},{"id":"W2516304337","doi":"10.1177/0962280216660407","title":"A Gaussian random field model for similarity-based smoothing in Bayesian disease mapping","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Spatial and Panel Data Analysis","field":"Economics, Econometrics and Finance","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Fogarty International Center; National Institute on Drug Abuse; National Institute of Mental Health","keywords":"Smoothing; Similarity (geometry); Mathematics; Spatial analysis; Bayesian probability; Gaussian random field; Gaussian; Random field; Computer science; Statistics; Artificial intelligence; Pattern recognition (psychology); Gaussian process","score_opus":0.2324085936925764,"score_gpt":0.48457481351439907,"score_spread":0.25216621982182263,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2516304337","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008022244,0.00040454004,0.9894282,0.00058645185,0.00006499709,0.000053056316,0.00025416832,0.00017579987,0.001010468],"genre_scores_gemma":[0.5760458,0.0020824738,0.4032515,0.00084711844,0.00040234288,0.0009073614,0.0016876638,0.0002210415,0.014554726],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99565166,0.0024436307,0.00017481395,0.000999945,0.00047398513,0.00025597785],"domain_scores_gemma":[0.98996615,0.007223483,0.0008414574,0.0008601761,0.0008528097,0.0002559222],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0099246,0.00090614555,0.001964007,0.0019794917,0.0008621254,0.0018672381,0.0044899043,0.0034779483,0.004852757],"category_scores_gemma":[0.025387669,0.0008872244,0.0024745727,0.0028636937,0.0026315202,0.0034276603,0.0016844093,0.0027725182,0.001179543],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009876846,0.000058237118,0.0029181486,0.00012915664,0.0001502278,0.00021327824,0.00030567733,0.4260761,0.00059573585,0.53340375,0.0029117547,0.033139203],"study_design_scores_gemma":[0.000035378274,0.0000533175,0.00082596135,0.0000376272,0.000049499235,0.00011889217,0.000030716106,0.80199677,0.00013913697,0.19387871,0.0027849337,0.00004908762],"about_ca_topic_score_codex":0.017704137,"about_ca_topic_score_gemma":0.010242761,"teacher_disagreement_score":0.017704137,"about_ca_system_score_codex":0.002092004,"about_ca_system_score_gemma":0.0020683343,"threshold_uncertainty_score":0.052486956},"labels":[],"label_agreement":null},{"id":"W2521300970","doi":"10.1177/0962280216668554","title":"Comparison of statistical approaches dealing with time-dependent confounding in drug effectiveness studies","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; University of British Columbia; McGill University; Jewish General Hospital","funders":"IC Design Education Center; Canadian Institutes of Health Research; Biogen; EMD Serono; Pfizer","keywords":"Covariate; Confounding; Marginal structural model; Proportional hazards model; Econometrics; Statistics; Event (particle physics); Marginal model; Estimation; Computer science; Medicine; Regression analysis; Mathematics","score_opus":0.6270859484776903,"score_gpt":0.6922224989551746,"score_spread":0.06513655047748435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2521300970","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033492904,0.00783755,0.9523555,0.0023035058,0.0005546054,0.0014160656,0.00025513806,0.0003106607,0.0014741247],"genre_scores_gemma":[0.3017767,0.004813529,0.68644756,0.00093998824,0.0004465042,0.0043930165,0.00036693,0.0001869864,0.0006287813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5427789,0.43029562,0.008078948,0.0054355636,0.012425522,0.0009854476],"domain_scores_gemma":[0.17579934,0.7935578,0.0090899095,0.014280328,0.0064828577,0.0007895986],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.34798846,0.0019191972,0.0035188426,0.005725866,0.0011788876,0.003123469,0.00509438,0.0037857362,0.0037357695],"category_scores_gemma":[0.5692863,0.0011420257,0.008435263,0.006801792,0.004840859,0.004981142,0.0049372846,0.0042754286,0.00033308213],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0069506783,0.00052146823,0.036109123,0.0064593363,0.034367304,0.00049211556,0.0039227335,0.14193593,0.0015254722,0.25496352,0.0032091064,0.50954324],"study_design_scores_gemma":[0.0030213222,0.006294737,0.03186902,0.0020996018,0.008511062,0.0008985689,0.0013822217,0.5026683,0.0024883691,0.42881048,0.011455292,0.00050103647],"about_ca_topic_score_codex":0.0026216628,"about_ca_topic_score_gemma":0.0021810045,"teacher_disagreement_score":0.6520115,"about_ca_system_score_codex":0.0032300595,"about_ca_system_score_gemma":0.00570972,"threshold_uncertainty_score":0.80404633},"labels":[],"label_agreement":null},{"id":"W2559863382","doi":"10.1177/0962280216680834","title":"A graphical perspective of marginal structural models: An application for the estimation of the effect of physical activity on blood pressure","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University; Hôpital du Sacré-Cœur de Montréal; McGill University Health Centre; Université Laval; The Quebec Population Health Research Network; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Marginal structural model; Counterfactual thinking; Causal inference; Causal model; Computer science; Marginal model; Graphical model; Econometrics; Causal structure; Graph; Inference; Context (archaeology); Data mining; Mathematics; Machine learning; Statistics; Artificial intelligence; Regression analysis; Theoretical computer science; Psychology","score_opus":0.20943349816461482,"score_gpt":0.6226692917242447,"score_spread":0.41323579355962986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2559863382","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00074098125,0.00031635544,0.99748945,0.0004724492,0.000030080559,0.000016354375,0.00008195581,0.000083548504,0.00076882547],"genre_scores_gemma":[0.12618043,0.0030894615,0.8662198,0.00062392594,0.00052446686,0.00045204954,0.00039331344,0.00025416331,0.0022623893],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9903861,0.007975346,0.00020247311,0.00065422134,0.0006426088,0.00013927348],"domain_scores_gemma":[0.92725796,0.066106886,0.0022957874,0.0026201978,0.001360874,0.00035838832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016001014,0.0017957926,0.001454022,0.0044866763,0.0008787827,0.0018393602,0.0028143239,0.0019436687,0.008975855],"category_scores_gemma":[0.072924644,0.001081758,0.0037469831,0.004885269,0.0039317957,0.003688701,0.0024747846,0.004428956,0.00092124793],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021996684,0.00003656287,0.0017556816,0.0001301006,0.00016791723,0.00013765259,0.00029130356,0.05850883,0.00019015506,0.90475786,0.0013634524,0.032638542],"study_design_scores_gemma":[0.000015499736,0.000030563653,0.00043915963,0.0000619727,0.000059630915,0.00009043033,0.00005244064,0.14364831,0.00010636657,0.85027486,0.005198131,0.000022560353],"about_ca_topic_score_codex":0.008698362,"about_ca_topic_score_gemma":0.006874278,"teacher_disagreement_score":0.016001014,"about_ca_system_score_codex":0.0019064577,"about_ca_system_score_gemma":0.0024466699,"threshold_uncertainty_score":0.08462244},"labels":[],"label_agreement":null},{"id":"W2560836925","doi":"10.1177/0962280216681599","title":"Interval estimation for a proportion using a double-sampling scheme with two fallible classifiers","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"","keywords":"Confidence interval; Statistics; Credible interval; Robust confidence intervals; Percentile; Coverage probability; Mathematics; Tolerance interval; Binomial proportion confidence interval; Sample size determination; Classifier (UML); Confidence distribution; Computer science; Artificial intelligence; Negative binomial distribution; Poisson distribution","score_opus":0.7224746746721421,"score_gpt":0.731382168623437,"score_spread":0.008907493951294865,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2560836925","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010089752,0.000118640884,0.9887205,0.000052956413,0.00004239908,0.0003439283,0.00007104973,0.00020723607,0.00035356433],"genre_scores_gemma":[0.15984337,0.00013535241,0.8376786,0.00010116827,0.000055781355,0.0011940178,0.0003462653,0.000053439748,0.0005919299],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94339764,0.035523266,0.003815533,0.007860023,0.008499436,0.00090420304],"domain_scores_gemma":[0.8360443,0.12511872,0.009703834,0.01834165,0.0098627955,0.00092872005],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07513449,0.0013523367,0.0027449045,0.0036824362,0.0010607489,0.0023180014,0.0031511665,0.0026239294,0.0027309437],"category_scores_gemma":[0.25674793,0.0006948754,0.0022053595,0.0027037545,0.0029437363,0.0035380542,0.002742004,0.0032876986,0.0007094557],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003041398,0.00039952734,0.04150394,0.001053889,0.0010148963,0.0005213259,0.0025118687,0.085937046,0.010362244,0.14047717,0.0032027743,0.709974],"study_design_scores_gemma":[0.00037287828,0.0018084007,0.014443935,0.0004458542,0.00048033692,0.0008293971,0.0003351973,0.8524439,0.014906536,0.10585759,0.007836789,0.00023915357],"about_ca_topic_score_codex":0.0022295213,"about_ca_topic_score_gemma":0.0014210301,"teacher_disagreement_score":0.07513449,"about_ca_system_score_codex":0.0012031433,"about_ca_system_score_gemma":0.0016301484,"threshold_uncertainty_score":0.39735395},"labels":[],"label_agreement":null},{"id":"W2569952854","doi":"10.1177/0962280216684671","title":"Detecting and correcting for publication bias in meta-analysis – A truncated normal distribution approach","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Publication bias; Funnel plot; Estimator; Statistics; Selection bias; Meta-analysis; Random effects model; Parametric statistics; Truncation (statistics); Econometrics; Computer science; Mathematics; Confidence interval; Medicine","score_opus":0.5688831534431038,"score_gpt":0.6084837730401228,"score_spread":0.03960061959701899,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2569952854","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016217466,0.0044558644,0.9915946,0.0009023272,0.00022440554,0.0003431717,0.00014312632,0.00030227087,0.0004124337],"genre_scores_gemma":[0.13024493,0.008228942,0.85432357,0.0015978278,0.00061142707,0.0031942187,0.00046377737,0.00027692196,0.0010583935],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7450805,0.20314088,0.018476704,0.011388195,0.020854961,0.0010586975],"domain_scores_gemma":[0.50517917,0.43616295,0.019899782,0.02624972,0.011823763,0.00068461726],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25294513,0.0023618944,0.006708583,0.009349948,0.0011714168,0.005849988,0.007639614,0.00540468,0.0037012557],"category_scores_gemma":[0.51543343,0.0016512437,0.009916366,0.008869125,0.005272824,0.007589507,0.004641498,0.006344784,0.0006387231],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013896726,0.00019459904,0.010736189,0.0136286495,0.020201165,0.0015529675,0.0016822604,0.103356965,0.0024391585,0.18316807,0.0075220885,0.65412813],"study_design_scores_gemma":[0.0014127302,0.0007851806,0.0037814626,0.00410119,0.00949728,0.0014659296,0.00024328318,0.30498463,0.004839178,0.6545139,0.014014662,0.00036068517],"about_ca_topic_score_codex":0.0023220223,"about_ca_topic_score_gemma":0.0015698023,"teacher_disagreement_score":0.7470549,"about_ca_system_score_codex":0.0033461,"about_ca_system_score_gemma":0.009301124,"threshold_uncertainty_score":0.92125165},"labels":[],"label_agreement":null},{"id":"W2573716001","doi":"10.1177/0962280216688031","title":"An efficient test based on the inferential model for the non-inferiority of odds ratio in matched-pairs design","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Odds ratio; Test (biology); Sample size determination; Odds; Statistics; Score test; Computer science; Type I and type II errors; Inference; Function (biology); Mathematics; Medicine; Statistical hypothesis testing; Logistic regression; Artificial intelligence","score_opus":0.7979925770576195,"score_gpt":0.7224137239264271,"score_spread":0.07557885313119239,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2573716001","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042180587,0.00025235477,0.99393326,0.00033508215,0.00005425407,0.0003015554,0.000064076456,0.00013000696,0.00071137527],"genre_scores_gemma":[0.2677589,0.00053781725,0.7258679,0.0008932351,0.0003342984,0.0025708799,0.00028879347,0.00008528362,0.0016629134],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.945122,0.04338998,0.0018367423,0.003681384,0.0052335425,0.0007363962],"domain_scores_gemma":[0.81728226,0.16388458,0.005561232,0.007943907,0.004596868,0.0007311147],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06649989,0.0013539194,0.00431003,0.0029899946,0.00084229105,0.0016497541,0.0036688102,0.0031202754,0.0072829244],"category_scores_gemma":[0.20952411,0.00073606014,0.0027452074,0.0023508575,0.0037398485,0.0042141993,0.0025904998,0.0037657714,0.00067685585],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014924546,0.00052374747,0.010574532,0.0020433762,0.001473682,0.0008580088,0.0007005532,0.09447951,0.0025854013,0.54632354,0.0051110457,0.33383426],"study_design_scores_gemma":[0.000846349,0.0014248312,0.0027131045,0.0002789228,0.00055625633,0.0008008709,0.00011607931,0.67159915,0.0028219195,0.31449872,0.004229502,0.00011429165],"about_ca_topic_score_codex":0.0007823201,"about_ca_topic_score_gemma":0.0005651555,"teacher_disagreement_score":0.06649989,"about_ca_system_score_codex":0.0015048776,"about_ca_system_score_gemma":0.003786504,"threshold_uncertainty_score":0.35168922},"labels":[],"label_agreement":null},{"id":"W2609604109","doi":"10.1177/0962280217708662","title":"Prediction and tolerance intervals for dynamic treatment regimes","year":2017,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Tolerance interval; Interval (graph theory); Computer science; Confidence interval; Estimation; Econometrics; Prediction interval; Data mining; Statistics; Machine learning; Mathematics; Engineering","score_opus":0.5751032498731449,"score_gpt":0.6926307709134367,"score_spread":0.11752752104029185,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2609604109","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009206009,0.0013940943,0.98568,0.0008562457,0.000110538596,0.00014801238,0.00028909717,0.00030545756,0.0020105247],"genre_scores_gemma":[0.4847628,0.0022029139,0.5065758,0.0009198433,0.0005347596,0.0013284354,0.0012122436,0.00026960965,0.00219352],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97691935,0.015603816,0.0009783078,0.0028437835,0.0030698464,0.000584843],"domain_scores_gemma":[0.70291173,0.25934348,0.01800378,0.013041153,0.0050418433,0.0016578648],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043403972,0.0012715166,0.0022960508,0.0035230033,0.00061155594,0.0031536676,0.0039940365,0.0026509974,0.0071146484],"category_scores_gemma":[0.25561717,0.0006450671,0.0019480212,0.0031850408,0.0030687936,0.0049267537,0.0031980749,0.0061475565,0.0008477172],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005409402,0.00018416547,0.013268818,0.0007219741,0.00040158667,0.00020226641,0.0007271518,0.3274464,0.000677474,0.40316832,0.004416514,0.2482444],"study_design_scores_gemma":[0.00010804403,0.00025385397,0.0022646915,0.0003071887,0.00010843793,0.00017131893,0.00008980412,0.6454596,0.0007635957,0.34608185,0.0043178024,0.0000737685],"about_ca_topic_score_codex":0.002147089,"about_ca_topic_score_gemma":0.001035689,"teacher_disagreement_score":0.043403972,"about_ca_system_score_codex":0.0017342295,"about_ca_system_score_gemma":0.0022469063,"threshold_uncertainty_score":0.22954488},"labels":[],"label_agreement":null},{"id":"W2612495025","doi":"10.1177/0962280217708665","title":"Model validation and selection for personalized medicine using dynamic-weighted ordinary least squares","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; University of Texas Southwestern Medical Center","keywords":"Ordinary least squares; Robustness (evolution); Computer science; Personalized medicine; Selection (genetic algorithm); Generalized least squares; Econometrics; Data mining; Statistics; Mathematics; Machine learning; Bioinformatics; Estimator","score_opus":0.6475070671778674,"score_gpt":0.7094544250062448,"score_spread":0.06194735782837735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2612495025","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005558367,0.00026409366,0.99290484,0.00053416606,0.000031043543,0.0000783079,0.000056023033,0.0001401711,0.0004330382],"genre_scores_gemma":[0.39361927,0.0007309737,0.6021989,0.00063377956,0.000174248,0.0007999604,0.00065563223,0.00016618521,0.0010211101],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97890615,0.017629756,0.0005451982,0.001299944,0.0013937688,0.00022516843],"domain_scores_gemma":[0.9599147,0.03359153,0.0016019262,0.0030975502,0.0014961442,0.00029813164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02757543,0.0011061877,0.0022635777,0.0020453425,0.0009199187,0.0017641742,0.0021504804,0.0011885359,0.0027765646],"category_scores_gemma":[0.090891905,0.00076672813,0.0022715912,0.0016283791,0.0015096649,0.0019118821,0.0025661439,0.0032494739,0.00059626315],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004219372,0.00027438582,0.00949275,0.00057042274,0.0014342848,0.0002587256,0.00042268066,0.5049478,0.0020779173,0.20058912,0.004206553,0.27530345],"study_design_scores_gemma":[0.00007546735,0.00015023354,0.0010632448,0.00008480621,0.00009186238,0.000051431485,0.000046272253,0.83405167,0.00067395275,0.16173548,0.0019382727,0.000037278474],"about_ca_topic_score_codex":0.0031064542,"about_ca_topic_score_gemma":0.0036754273,"teacher_disagreement_score":0.02757543,"about_ca_system_score_codex":0.0011833344,"about_ca_system_score_gemma":0.0039108186,"threshold_uncertainty_score":0.14583457},"labels":[],"label_agreement":null},{"id":"W2613103431","doi":"10.1177/0962280217702540","title":"Comparing heteroscedastic measurement systems with the probability of agreement","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; University of Waterloo","funders":"","keywords":"Homoscedasticity; Heteroscedasticity; Metric (unit); Observational error; Computer science; Statistics; Mathematics; Engineering","score_opus":0.7493861067260326,"score_gpt":0.6289003428450651,"score_spread":0.12048576388096743,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2613103431","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04436892,0.002590047,0.9457011,0.00085488916,0.0003645409,0.0004630456,0.00050327665,0.00033774736,0.00481646],"genre_scores_gemma":[0.70002747,0.0011409866,0.29465657,0.00035698857,0.00047432556,0.0017703447,0.0006891425,0.00019869728,0.00068554253],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7349167,0.18729144,0.017261695,0.023984129,0.034971386,0.0015747128],"domain_scores_gemma":[0.23740816,0.6774237,0.037464082,0.02909127,0.01749667,0.001116174],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.20664951,0.0018939124,0.0030322096,0.010623503,0.0019121907,0.008773235,0.0032972877,0.0034623689,0.0028259647],"category_scores_gemma":[0.53952867,0.0010620645,0.003942202,0.011522853,0.012232958,0.011203205,0.008238774,0.0044821994,0.0007274204],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019245186,0.00029159803,0.17420562,0.0033978552,0.009898282,0.0005258374,0.009593252,0.08821746,0.0026816274,0.32022578,0.0042730165,0.38476506],"study_design_scores_gemma":[0.00018394644,0.0014068192,0.083419256,0.00091695157,0.0013874987,0.0008235366,0.002519551,0.25046724,0.0041305185,0.6438896,0.010267451,0.0005876338],"about_ca_topic_score_codex":0.001507272,"about_ca_topic_score_gemma":0.0007778525,"teacher_disagreement_score":0.20664951,"about_ca_system_score_codex":0.002316521,"about_ca_system_score_gemma":0.0025809593,"threshold_uncertainty_score":0.9783424},"labels":[],"label_agreement":null},{"id":"W2613408792","doi":"10.1177/0962280217710835","title":"Compositional data analysis for physical activity, sedentary time and sleep research","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":547,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Children's Hospital of Eastern Ontario","funders":"Ministerio de Economía y Competitividad; Australian Government; Coca-Cola Foundation","keywords":"Compositional data; Multicollinearity; Physical activity; Statistical inference; Causal inference; Statistics; Econometrics; Inference; Psychology; Regression analysis; Computer science; Mathematics; Medicine; Physical therapy; Artificial intelligence","score_opus":0.3791836015499943,"score_gpt":0.623165077965462,"score_spread":0.24398147641546775,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2613408792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042780186,0.00087396847,0.9899457,0.00036805007,0.00016763477,0.0006407727,0.0019389476,0.0010480807,0.00073879375],"genre_scores_gemma":[0.0413743,0.0007711075,0.95067877,0.00015114428,0.00012070723,0.003717552,0.0023952445,0.00036785254,0.00042325762],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9451557,0.040169377,0.0040193996,0.0038058304,0.006385342,0.00046440886],"domain_scores_gemma":[0.82475144,0.13863206,0.009436546,0.020217588,0.0062107006,0.0007516471],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04592645,0.0016132479,0.002643465,0.007613298,0.0014198803,0.0032752545,0.0025281948,0.0015056295,0.0070912023],"category_scores_gemma":[0.23159623,0.00094509975,0.0038452845,0.012784179,0.0025859873,0.003006403,0.0045624934,0.0041752513,0.0017472294],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008516531,0.00042809025,0.04030457,0.0064911945,0.004444628,0.0005955184,0.0026154174,0.035861768,0.006200954,0.26522228,0.022334602,0.61464936],"study_design_scores_gemma":[0.00023133839,0.0009939057,0.039996147,0.0019328372,0.0010230907,0.000816909,0.0019065897,0.30391335,0.006866057,0.5416359,0.10038489,0.0002990759],"about_ca_topic_score_codex":0.0050357315,"about_ca_topic_score_gemma":0.004735962,"teacher_disagreement_score":0.04592645,"about_ca_system_score_codex":0.001910354,"about_ca_system_score_gemma":0.006177212,"threshold_uncertainty_score":0.24288517},"labels":[],"label_agreement":null},{"id":"W2615126006","doi":"10.1177/0962280217708683","title":"Proportional hazards under Conway–Maxwell-Poisson cure rate model and associated inference","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Manufacturing Process and Optimization","field":"Engineering","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Inference; Poisson distribution; Poisson regression; Overdispersion; Applied mathematics; Mathematics; Statistics; Proportional hazards model; Econometrics; Medicine; Computer science; Count data; Artificial intelligence; Environmental health","score_opus":0.1357556402941482,"score_gpt":0.5222345565827372,"score_spread":0.386478916288589,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2615126006","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010079156,0.0003610574,0.9882366,0.00021475197,0.00003091799,0.000097156604,0.00018563888,0.00011945397,0.0006753003],"genre_scores_gemma":[0.5735635,0.0025807018,0.4124734,0.0004138705,0.00033406192,0.0012458132,0.0013510233,0.000141509,0.0078960145],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9937186,0.0036349923,0.00029053658,0.0010990134,0.00090409274,0.00035269876],"domain_scores_gemma":[0.98024195,0.015738191,0.0015941691,0.0013137021,0.00094736175,0.00016468977],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016720055,0.0010896827,0.0018502119,0.0017940848,0.00072218466,0.001424956,0.0029190679,0.0018585314,0.0034205725],"category_scores_gemma":[0.03870195,0.0006403234,0.0023633894,0.002031079,0.0017284055,0.002500776,0.0018554025,0.0031020846,0.00042930426],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024908737,0.0001471452,0.01419175,0.0004692392,0.0002701623,0.00092103076,0.00068717176,0.51607144,0.0012447477,0.35873803,0.0026950573,0.104315124],"study_design_scores_gemma":[0.000030480902,0.00007628643,0.0014616322,0.000034179862,0.000067767636,0.00032187882,0.0000815565,0.8852775,0.0006243337,0.11042446,0.0015607963,0.000039211554],"about_ca_topic_score_codex":0.004186502,"about_ca_topic_score_gemma":0.002358229,"teacher_disagreement_score":0.016720055,"about_ca_system_score_codex":0.0012096599,"about_ca_system_score_gemma":0.0024269165,"threshold_uncertainty_score":0.08842516},"labels":[],"label_agreement":null},{"id":"W2616441786","doi":"10.1177/0962280217708673","title":"Prediction accuracy for the cure probabilities in mixture cure models","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Cancer Genomics and Diagnostics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Censoring (clinical trials); Estimator; Cure rate; Statistics; Identifiability; Inverse probability; Computer science; Mathematics; Bayesian probability; Medicine; Posterior probability; Surgery","score_opus":0.18013863621807136,"score_gpt":0.545927531221922,"score_spread":0.3657888950038506,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2616441786","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1664264,0.0014973347,0.82763714,0.0009232641,0.00010471374,0.00014061175,0.00073919154,0.000845578,0.0016857929],"genre_scores_gemma":[0.89328116,0.0006757174,0.10242343,0.00021755192,0.00012593748,0.00020543611,0.0016225866,0.00013992288,0.0013082059],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9901788,0.0054831817,0.00061342405,0.0019230421,0.0013601823,0.00044138552],"domain_scores_gemma":[0.89606225,0.0899533,0.0050437106,0.0052867816,0.0029058023,0.0007481743],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028778404,0.0013597277,0.002217972,0.0033789338,0.00070903834,0.002522902,0.002059594,0.0024280755,0.001888921],"category_scores_gemma":[0.101402156,0.0007008804,0.0021631522,0.0016991768,0.0014984324,0.0030717785,0.002581998,0.0034793876,0.00068038964],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000915687,0.00019406078,0.098609105,0.00030608426,0.0008694411,0.00024186738,0.0006079215,0.6948866,0.001796741,0.025807906,0.0027129797,0.17305163],"study_design_scores_gemma":[0.000021742882,0.000099080426,0.00833666,0.00006727283,0.00010190427,0.0001620812,0.00006200087,0.9670692,0.0007746157,0.022550844,0.00069133774,0.00006318124],"about_ca_topic_score_codex":0.0030434001,"about_ca_topic_score_gemma":0.002110986,"teacher_disagreement_score":0.028778404,"about_ca_system_score_codex":0.0009356755,"about_ca_system_score_gemma":0.0009137906,"threshold_uncertainty_score":0.15219659},"labels":[],"label_agreement":null},{"id":"W2646223782","doi":"10.1177/0962280217712088","title":"Functional principal component analysis of glomerular filtration rate curves after kidney transplant","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"","keywords":"Functional principal component analysis; Renal function; Principal component analysis; Functional data analysis; Filtration (mathematics); Kidney transplant; Kidney transplantation; Function (biology); Kidney; Urology; Medicine; Internal medicine; Mathematics; Biology; Statistics","score_opus":0.11661366098704007,"score_gpt":0.494865302077494,"score_spread":0.37825164109045395,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2646223782","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20299418,0.0006984071,0.7938282,0.00047972926,0.00005378126,0.00006541257,0.0006087225,0.0005081655,0.00076331757],"genre_scores_gemma":[0.9180124,0.0005436809,0.07860428,0.000057655645,0.000055855337,0.00009610085,0.0014019096,0.00013905436,0.0010890852],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981517,0.000961913,0.00009636,0.0003177699,0.00029065143,0.00018154639],"domain_scores_gemma":[0.9908785,0.006199324,0.00084430777,0.0009131486,0.00091212976,0.0002525675],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046784175,0.00075907103,0.0006537311,0.0025014135,0.0004887848,0.0012772644,0.00093725615,0.0006740061,0.0009299735],"category_scores_gemma":[0.022915237,0.0002739321,0.0008548944,0.0022722613,0.0007409542,0.0011654666,0.00075915566,0.0012018902,0.00027720383],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007605754,0.00019809324,0.18821226,0.0002569032,0.00065861683,0.0004402926,0.0008924956,0.37182397,0.010181657,0.057430528,0.003215421,0.36592922],"study_design_scores_gemma":[0.0000124873795,0.00009608741,0.09528892,0.00003193,0.00006790459,0.0002692806,0.00012555679,0.84889746,0.0020943622,0.051248502,0.0017759872,0.00009151402],"about_ca_topic_score_codex":0.0060306885,"about_ca_topic_score_gemma":0.00445594,"teacher_disagreement_score":0.0060306885,"about_ca_system_score_codex":0.00077273004,"about_ca_system_score_gemma":0.0010074937,"threshold_uncertainty_score":0.024742126},"labels":[],"label_agreement":null},{"id":"W2724536226","doi":"10.1177/0962280217708686","title":"Likelihood inference for COM-Poisson cure rate model with interval-censored data and Weibull lifetimes","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; University of Minnesota","keywords":"Poisson distribution; Statistics; Weibull distribution; Overdispersion; Mathematics; Interval (graph theory); Applied mathematics; Inference; Count data; Expectation–maximization algorithm; Computer science; Maximum likelihood; Artificial intelligence","score_opus":0.41110056473687834,"score_gpt":0.6454746309299403,"score_spread":0.23437406619306195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2724536226","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014876913,0.00039695628,0.98365813,0.00022612559,0.000018538945,0.00004672288,0.00014276014,0.00014974238,0.00048422973],"genre_scores_gemma":[0.60740453,0.001532229,0.38377985,0.0003715222,0.00017496358,0.0006391009,0.0014826856,0.0002074487,0.004407816],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99456316,0.0035214163,0.00025462048,0.0008718262,0.0005269558,0.0002619345],"domain_scores_gemma":[0.9573641,0.037553273,0.0022027039,0.0016626625,0.00095172756,0.0002655221],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018841969,0.00082059775,0.0020171881,0.002448188,0.0006278235,0.0017791281,0.0035814904,0.0018291641,0.0031223805],"category_scores_gemma":[0.05759717,0.0009392546,0.002067063,0.002413688,0.0017595951,0.0032071918,0.0021270378,0.0030190574,0.00064744544],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002668208,0.00013936395,0.016264109,0.0005039968,0.0003519062,0.00063044555,0.0006499152,0.6671686,0.0010329499,0.21400526,0.001940366,0.09704618],"study_design_scores_gemma":[0.000029443187,0.000054518652,0.0017943596,0.000052726013,0.00004530669,0.00022713181,0.0000987921,0.9108042,0.00042941456,0.085262336,0.0011644957,0.00003717101],"about_ca_topic_score_codex":0.0032418545,"about_ca_topic_score_gemma":0.0023576084,"teacher_disagreement_score":0.018841969,"about_ca_system_score_codex":0.0012800425,"about_ca_system_score_gemma":0.0015780065,"threshold_uncertainty_score":0.099647045},"labels":[],"label_agreement":null},{"id":"W2728427291","doi":"10.1177/0962280217708671","title":"Bayesian cure rate models induced by frailty in survival analysis","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Fundação de Amparo à Pesquisa do Estado de São Paulo","keywords":"Markov chain Monte Carlo; Bayesian probability; Computer science; Bayesian inference; Poisson distribution; Inference; Markov chain; Econometrics; Statistics; Survival analysis; Mathematics; Artificial intelligence; Machine learning","score_opus":0.28525290172911694,"score_gpt":0.6164067651596781,"score_spread":0.33115386343056114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2728427291","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038223594,0.00036165366,0.95914,0.000522665,0.00003387594,0.00006597738,0.00021326398,0.00015987805,0.0012790061],"genre_scores_gemma":[0.805688,0.0013623512,0.18436524,0.00039718833,0.00018613029,0.0006001478,0.0009887771,0.00015747412,0.0062546115],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9957408,0.0023403745,0.00016481681,0.00074003334,0.0006624123,0.00035167995],"domain_scores_gemma":[0.98388517,0.012252719,0.0014320719,0.0011597039,0.00089876883,0.0003715456],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014804743,0.0008861767,0.0016448778,0.0020710651,0.0007313661,0.0021335778,0.0028740226,0.002558106,0.0026824777],"category_scores_gemma":[0.044526074,0.0010120749,0.0018680042,0.0015320071,0.0029755628,0.003505367,0.0026193198,0.004185673,0.00055610004],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009514613,0.000053353517,0.004972872,0.000097190336,0.00009221105,0.00021601489,0.00065765285,0.44042116,0.00080964033,0.5269484,0.0012786862,0.02435764],"study_design_scores_gemma":[0.000027951888,0.00003245167,0.0011023325,0.000043346976,0.000033037515,0.00011473341,0.00004434319,0.7594903,0.00022034244,0.23783545,0.001015458,0.000040245613],"about_ca_topic_score_codex":0.0061130105,"about_ca_topic_score_gemma":0.0033055034,"teacher_disagreement_score":0.014804743,"about_ca_system_score_codex":0.0017440983,"about_ca_system_score_gemma":0.0014239075,"threshold_uncertainty_score":0.07829589},"labels":[],"label_agreement":null},{"id":"W2730038733","doi":"10.1177/0962280217713347","title":"Causality on longitudinal data: Stable specification search in constrained structural equation modeling","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research; National Institutes of Health; IXICO; H. Lundbeck A/S; Eisai; Servier; University of California, San Diego; University of Glasgow; Radboud Universiteit; University of Aberdeen; Newcastle University; Northern California Institute for Research and Education; Genentech; University of Dundee; BioClinica; Biogen; Pfizer; Novartis Pharmaceuticals Corporation; University of Southern California; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Meso Scale Diagnostics; Leids Universitair Medisch Centrum; Universiteit Leiden; Alzheimer's Disease Neuroimaging Initiative; Alzheimer's Association","keywords":"Computer science; Causal model; Causality (physics); Stability (learning theory); Structural equation modeling; Set (abstract data type); Machine learning; Artificial intelligence; Data mining; Mathematics; Statistics","score_opus":0.8721763018702403,"score_gpt":0.725111040097272,"score_spread":0.1470652617729683,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2730038733","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069092433,0.00022966591,0.9922524,0.00021598974,0.000006951804,0.000036675574,0.000035322526,0.00012652343,0.00018726183],"genre_scores_gemma":[0.28221396,0.000555362,0.7150893,0.00026431278,0.00006737833,0.0004599307,0.000521391,0.00018537321,0.00064303086],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9929069,0.0056146737,0.00021565681,0.0005655246,0.00055947574,0.00013768642],"domain_scores_gemma":[0.94529027,0.049835112,0.0017037231,0.0015433666,0.0012310736,0.0003964079],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015682481,0.0010865368,0.0019544212,0.003222524,0.0010799,0.0014783632,0.0022316575,0.001615612,0.0020410235],"category_scores_gemma":[0.06258542,0.0010594547,0.0016509066,0.0026116464,0.0014854373,0.0024813465,0.002874989,0.0025303434,0.00035277344],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014930095,0.0001295038,0.007972664,0.00025632803,0.00042751193,0.00026665287,0.00045332004,0.749392,0.0008192224,0.10858853,0.0015190765,0.13002595],"study_design_scores_gemma":[0.000018993538,0.000020767107,0.0002640511,0.000021008416,0.00001525909,0.0000177662,0.000026519392,0.945356,0.00016643746,0.053737484,0.00034686114,0.000008810681],"about_ca_topic_score_codex":0.0050175684,"about_ca_topic_score_gemma":0.00615103,"teacher_disagreement_score":0.015682481,"about_ca_system_score_codex":0.0010206306,"about_ca_system_score_gemma":0.0025704023,"threshold_uncertainty_score":0.08293784},"labels":[],"label_agreement":null},{"id":"W2732108610","doi":"10.1177/096228020401300507","title":"Book Review: Analyzing medical data using S-PLUS","year":2004,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Artificial Intelligence in Healthcare","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Computer science; Data science","score_opus":0.7380944379549161,"score_gpt":0.7792716709767741,"score_spread":0.04117723302185794,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2732108610","genre_codex":"review","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035272145,0.53310835,0.2400955,0.066222906,0.09888222,0.0006400182,0.005945801,0.0152184805,0.036359522],"genre_scores_gemma":[0.014809521,0.34511068,0.22202303,0.050381403,0.09213092,0.000802454,0.0069516418,0.009960379,0.25783],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9979882,0.0005878333,0.00014827918,0.00023952776,0.0009855548,0.00005058816],"domain_scores_gemma":[0.97944605,0.011912117,0.00076873665,0.000695539,0.0065267286,0.0006508523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022771498,0.0013102132,0.0026363013,0.0045523066,0.00046325795,0.0017053003,0.0011662362,0.0013061943,0.025217773],"category_scores_gemma":[0.014549082,0.0007007833,0.0013209959,0.00694867,0.0008042641,0.0017113474,0.00068868906,0.002213024,0.022171127],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000033205553,0.000025325086,0.00022045318,0.00068699813,0.000063319996,0.000043771597,0.0000133002395,0.00033836442,0.00032759755,0.000572848,0.8411946,0.15648022],"study_design_scores_gemma":[0.000044618668,0.00014787508,0.0022239562,0.000661807,0.00015888238,0.0008560373,0.000025510528,0.003536435,0.0013571287,0.0042036055,0.98672473,0.000059351783],"about_ca_topic_score_codex":0.0027801925,"about_ca_topic_score_gemma":0.0076244744,"teacher_disagreement_score":0.025217773,"about_ca_system_score_codex":0.00079075573,"about_ca_system_score_gemma":0.0020813954,"threshold_uncertainty_score":0.08436185},"labels":[],"label_agreement":null},{"id":"W2736383080","doi":"10.1177/0962280217715487","title":"A model averaging approach for estimating propensity scores by optimizing balance","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Propensity score matching; Covariate; Estimator; Statistics; Statistic; Nonparametric statistics; Inverse probability weighting; Causal inference; Weighting; Mathematics; Parametric statistics; Econometrics; Parametric model; Computer science; Medicine","score_opus":0.6341758442076512,"score_gpt":0.6615234680562492,"score_spread":0.027347623848598013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2736383080","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001329835,0.00011492777,0.9980987,0.0000758944,0.000014283711,0.000022677024,0.00002546927,0.00008269005,0.00023556338],"genre_scores_gemma":[0.14400944,0.0007843263,0.8516718,0.00024990828,0.00018768439,0.00061208504,0.00038255972,0.00016376963,0.0019383752],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9928318,0.0048425756,0.00032156793,0.00085397187,0.0009509057,0.00019911957],"domain_scores_gemma":[0.99503714,0.0031648849,0.0005245389,0.000630468,0.00054687803,0.00009613337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011603825,0.0012951493,0.0020671752,0.001953918,0.0006867733,0.0013268631,0.0018430207,0.0012503541,0.0030144076],"category_scores_gemma":[0.0228576,0.0008166646,0.0023565188,0.0028340805,0.00095200766,0.00215489,0.0020371121,0.001935811,0.0005143297],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012323471,0.00011005637,0.0035476068,0.0002643085,0.00076371315,0.00015657952,0.0002555373,0.54207593,0.0020917829,0.16946231,0.003448882,0.2777],"study_design_scores_gemma":[0.00004225546,0.00015341329,0.00095552317,0.000036294434,0.00013314547,0.00010749626,0.00002168755,0.9065355,0.0008915012,0.08679685,0.004287022,0.000039379356],"about_ca_topic_score_codex":0.003321951,"about_ca_topic_score_gemma":0.0024985704,"teacher_disagreement_score":0.011603825,"about_ca_system_score_codex":0.0010014385,"about_ca_system_score_gemma":0.0022789282,"threshold_uncertainty_score":0.06136757},"labels":[],"label_agreement":null},{"id":"W2745473302","doi":"10.1177/0962280217726800","title":"Adjustment for time-dependent unmeasured confounders in marginal structural Cox models using validation sample data","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Marginal structural model; Confounding; Proportional hazards model; Econometrics; Statistics; Computer science; Sample (material); Sample size determination; Marginal model; Mathematics; Regression analysis; Chemistry","score_opus":0.7887223164067655,"score_gpt":0.7025856314109221,"score_spread":0.08613668499584337,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2745473302","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012495008,0.00035005505,0.9861172,0.0004034136,0.000041225012,0.000090819194,0.0001256626,0.00019237795,0.00018422565],"genre_scores_gemma":[0.48040888,0.00091463205,0.51449805,0.0005531754,0.00019844697,0.001029636,0.0010044348,0.00018223524,0.0012105709],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9757446,0.021054987,0.0005509732,0.0012824262,0.0009955688,0.00037145958],"domain_scores_gemma":[0.86268127,0.11427339,0.006353203,0.013216202,0.0027767743,0.000699219],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06590363,0.0010501122,0.0017605351,0.0012919762,0.00074322283,0.0013670393,0.0037182432,0.001395947,0.002470191],"category_scores_gemma":[0.15148821,0.0008851869,0.0033466902,0.0014064749,0.0016229245,0.0022508705,0.0025133397,0.0030380548,0.0003277386],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017394102,0.00030464618,0.070226155,0.0009435983,0.0032561605,0.00062861777,0.0011941926,0.40494373,0.0016491067,0.2683575,0.005267719,0.24148914],"study_design_scores_gemma":[0.00028344535,0.00031858622,0.004854546,0.00017847563,0.00045785174,0.0001894345,0.00009281119,0.7981195,0.0012772905,0.19086225,0.003296773,0.00006899405],"about_ca_topic_score_codex":0.004580125,"about_ca_topic_score_gemma":0.0052315504,"teacher_disagreement_score":0.06590363,"about_ca_system_score_codex":0.00095896266,"about_ca_system_score_gemma":0.003270087,"threshold_uncertainty_score":0.34853584},"labels":[],"label_agreement":null},{"id":"W2749556736","doi":"10.1177/0962280217727314","title":"Survival forests for data with dependent censoring","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"Russian Science Foundation","keywords":"Censoring (clinical trials); Estimator; Covariate; Survival analysis; Computer science; Accelerated failure time model; Survival function; Statistics; Kaplan–Meier estimator; Econometrics; Data mining; Mathematics; Machine learning","score_opus":0.6773318042169131,"score_gpt":0.6953959658900677,"score_spread":0.01806416167315461,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2749556736","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002978841,0.0006087517,0.9954745,0.00014660643,0.00005026358,0.000042238193,0.00016024327,0.0002587603,0.00027972148],"genre_scores_gemma":[0.12900677,0.002218714,0.86324686,0.00035740135,0.00049955596,0.00089875446,0.0018538705,0.0003145504,0.0016035606],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99153626,0.005954317,0.0004376878,0.0008579643,0.00093298085,0.0002808215],"domain_scores_gemma":[0.94318825,0.04874451,0.0021594802,0.0031841162,0.0022505596,0.0004730851],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019296361,0.0011549884,0.001839898,0.0040223026,0.0012223696,0.0018438945,0.0019568717,0.0016739729,0.0030768423],"category_scores_gemma":[0.051148262,0.0007679569,0.0026318429,0.0031850275,0.001739954,0.0025292726,0.0019371214,0.0036889499,0.0010410621],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034301076,0.00011231867,0.012011697,0.0011045829,0.00054249936,0.0008441167,0.0007558939,0.3543262,0.0025380002,0.31855306,0.009903361,0.29896528],"study_design_scores_gemma":[0.000052954263,0.000044963523,0.00175854,0.0001780998,0.00007592904,0.00028223335,0.000067854184,0.66388136,0.00064493663,0.3261619,0.006807944,0.000043373533],"about_ca_topic_score_codex":0.0032261654,"about_ca_topic_score_gemma":0.00370673,"teacher_disagreement_score":0.019296361,"about_ca_system_score_codex":0.0008252551,"about_ca_system_score_gemma":0.0017288958,"threshold_uncertainty_score":0.102050126},"labels":[],"label_agreement":null},{"id":"W2751885691","doi":"10.1177/0962280217729844","title":"Bayesian sensitivity analysis for unmeasured confounding in causal mediation analysis","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Bayesian probability; Causal inference; Sensitivity (control systems); Mediation; Econometrics; Causal analysis; Statistics; Causal model; Computer science; Psychology; Mathematics; Sociology","score_opus":0.4857710251652698,"score_gpt":0.6844394513291232,"score_spread":0.19866842616385338,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2751885691","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024697483,0.0009400544,0.9932161,0.00075937004,0.00008957747,0.00033347134,0.00019650153,0.00011184036,0.0018832806],"genre_scores_gemma":[0.2753888,0.0034253371,0.7108998,0.0014230622,0.00052128936,0.0047510876,0.0005600341,0.00027796914,0.0027526428],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89367896,0.09476661,0.0021498702,0.003461805,0.0049955524,0.0009472008],"domain_scores_gemma":[0.6193834,0.3574319,0.006703099,0.010876468,0.004879376,0.00072572875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13144606,0.002209342,0.0040146494,0.0055249664,0.0017189132,0.003407768,0.004231073,0.0037366764,0.009534465],"category_scores_gemma":[0.35254908,0.0016706932,0.005238129,0.0040042526,0.004222714,0.0057717552,0.006162248,0.007411821,0.00064168696],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029984076,0.0001068872,0.004264975,0.0012105401,0.0016752133,0.00044578512,0.0007106072,0.16503508,0.00049145933,0.765398,0.004130489,0.0562311],"study_design_scores_gemma":[0.00012127119,0.0000969607,0.0010078015,0.00036000286,0.00039509987,0.00017061316,0.000089589106,0.2596416,0.0004291399,0.732055,0.005548708,0.00008430425],"about_ca_topic_score_codex":0.006008179,"about_ca_topic_score_gemma":0.003746597,"teacher_disagreement_score":0.13144606,"about_ca_system_score_codex":0.004391738,"about_ca_system_score_gemma":0.0047467784,"threshold_uncertainty_score":0.6951615},"labels":[],"label_agreement":null},{"id":"W2752464292","doi":"10.1177/0962280217720947","title":"Competing risks modeling of cumulative effects of time-varying drug exposures","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Hazard; Computer science; Statistics; Econometrics; Risk analysis (engineering); Medicine; Mathematics","score_opus":0.7693399576326204,"score_gpt":0.7370097003486988,"score_spread":0.03233025728392158,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2752464292","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015020209,0.00045461234,0.98242927,0.0004945406,0.00009593719,0.00013359328,0.00028116815,0.00018674758,0.0009038765],"genre_scores_gemma":[0.74997675,0.0017570104,0.23543355,0.00058980216,0.00035624634,0.0015091319,0.0011166058,0.00016785746,0.009092902],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9899732,0.0070750383,0.0003473257,0.0010625774,0.0010127891,0.0005291523],"domain_scores_gemma":[0.95227945,0.040947914,0.0029195475,0.0018080971,0.001481766,0.0005631875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0214751,0.0020077303,0.0020849213,0.001982884,0.00056803314,0.0020875263,0.004811376,0.0023596124,0.0045396644],"category_scores_gemma":[0.042775076,0.00082188577,0.0036207014,0.0017770454,0.0017875878,0.002054899,0.0019818395,0.0033339013,0.00049230695],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024586852,0.000087102526,0.007618988,0.00020971627,0.00051796413,0.0005787593,0.00021704426,0.7634886,0.00066189613,0.20309544,0.0012708581,0.022007743],"study_design_scores_gemma":[0.000055946974,0.000105567466,0.00074599165,0.000029968454,0.00014334367,0.00011532551,0.000022502047,0.9428327,0.00026903892,0.054636702,0.0010122006,0.000030686802],"about_ca_topic_score_codex":0.0068637975,"about_ca_topic_score_gemma":0.0035939834,"teacher_disagreement_score":0.0214751,"about_ca_system_score_codex":0.0013966338,"about_ca_system_score_gemma":0.0021061262,"threshold_uncertainty_score":0.1135726},"labels":[],"label_agreement":null},{"id":"W2756553568","doi":"10.1177/0962280217729573","title":"Joint modeling of longitudinal and survival data with a covariate subject to a limit of detection","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Statistics; Estimator; Confidence interval; Mathematics; Weibull distribution; Missing data; Econometrics; Computer science","score_opus":0.5664562877201138,"score_gpt":0.6143606527333666,"score_spread":0.04790436501325279,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2756553568","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005533879,0.00022103939,0.99356914,0.000299741,0.00002175605,0.000047060654,0.00007326719,0.00008777778,0.0001463145],"genre_scores_gemma":[0.35392046,0.0013130651,0.6352452,0.0008514048,0.00042157804,0.0020169448,0.0011551051,0.00022868159,0.0048474655],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9810704,0.012855557,0.000704281,0.0028267486,0.0018678253,0.000675197],"domain_scores_gemma":[0.8794816,0.10014461,0.00942362,0.0066514444,0.0031863858,0.0011123266],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04836108,0.0016005886,0.0037125526,0.002153201,0.00082639226,0.0024243526,0.0062952866,0.003734086,0.0022097456],"category_scores_gemma":[0.11461899,0.0018634949,0.0035204296,0.0025165442,0.0036008218,0.004384401,0.0047230334,0.0046748994,0.0006237675],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005612159,0.00040338392,0.03392945,0.00092453393,0.001447963,0.0012046938,0.0017378877,0.51195365,0.0031681452,0.32321993,0.002662706,0.11878642],"study_design_scores_gemma":[0.00006895047,0.0001685562,0.001601887,0.00008131706,0.00011247264,0.00023948327,0.00005139139,0.89374095,0.0007823807,0.10099539,0.0021027243,0.00005450006],"about_ca_topic_score_codex":0.0043059005,"about_ca_topic_score_gemma":0.0026410862,"teacher_disagreement_score":0.04836108,"about_ca_system_score_codex":0.0017333851,"about_ca_system_score_gemma":0.003448343,"threshold_uncertainty_score":0.2557609},"labels":[],"label_agreement":null},{"id":"W2762807097","doi":"10.1177/0962280217732597","title":"A hierarchical modeling approach for assessing the safety of exposure to complex antiretroviral drug regimens during pregnancy","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"HIV/AIDS Research and Interventions","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Public Health Agency of Canada; National Institutes of Health; Tulane University","keywords":"Antiretroviral drug; Pregnancy; Confounding; Medicine; Drug; Human immunodeficiency virus (HIV); Drug class; Intensive care medicine; ANTIRETROVIRAL AGENTS; Antiretroviral therapy; Obstetrics; Pharmacology; Viral load; Immunology; Internal medicine; Biology","score_opus":0.22655852030302848,"score_gpt":0.5795414981409522,"score_spread":0.35298297783792376,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2762807097","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07563072,0.00078047527,0.91865176,0.0007850423,0.00008892454,0.00070231623,0.0010320062,0.00041351723,0.0019151805],"genre_scores_gemma":[0.5957208,0.00082250114,0.39875814,0.00028944862,0.00015862056,0.0015140725,0.0009191183,0.000077812525,0.001739396],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9809825,0.016399788,0.00041775126,0.0009626798,0.00079590507,0.00044134862],"domain_scores_gemma":[0.9616261,0.032852445,0.002385073,0.0015798159,0.0010351837,0.00052134244],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01799135,0.0014490554,0.0015548363,0.0032149483,0.0011814013,0.0013676306,0.0026481182,0.0012354509,0.0023600152],"category_scores_gemma":[0.035827372,0.00078242115,0.0032660675,0.0025682065,0.0010430024,0.0009687509,0.0019098896,0.0018035871,0.00022443796],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006850257,0.0003377131,0.057734124,0.0003623682,0.0031065277,0.00043538894,0.000991915,0.7439208,0.0014194835,0.08774929,0.0022054184,0.10105194],"study_design_scores_gemma":[0.00008176221,0.00045715927,0.0076004853,0.000054408734,0.00042617152,0.00009457495,0.00013308413,0.9523423,0.00021279973,0.037108403,0.0014378626,0.00005109717],"about_ca_topic_score_codex":0.036097985,"about_ca_topic_score_gemma":0.03807928,"teacher_disagreement_score":0.036097985,"about_ca_system_score_codex":0.0024298632,"about_ca_system_score_gemma":0.0037319297,"threshold_uncertainty_score":0.095148504},"labels":[],"label_agreement":null},{"id":"W2762940523","doi":"10.1177/0962280217734969","title":"Cure rate modelling","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Manufacturing Process and Optimization","field":"Engineering","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Computer science; Statistics; Mathematics","score_opus":0.183779304838902,"score_gpt":0.5401490284692693,"score_spread":0.35636972363036723,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2762940523","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011802343,0.0011843417,0.9749674,0.00047070006,0.00027348506,0.00017608471,0.0014791938,0.0013670591,0.008279346],"genre_scores_gemma":[0.6497822,0.00360941,0.2392645,0.0009531455,0.00069918734,0.001210828,0.0069457944,0.0015855782,0.09594941],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99722856,0.0009095255,0.00013972749,0.0007315115,0.00072992156,0.00026078083],"domain_scores_gemma":[0.9952852,0.0026217103,0.00052234624,0.0008897508,0.0005674082,0.00011358959],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046920837,0.0016072684,0.002343468,0.0028048186,0.00055527745,0.0024178077,0.003275191,0.0036182012,0.009801923],"category_scores_gemma":[0.015481268,0.0009462315,0.004440603,0.002043323,0.0009868104,0.001955249,0.0013018696,0.0035964001,0.008325249],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002429626,0.00017194748,0.002276538,0.0003965535,0.00027186764,0.00020530942,0.00023204403,0.6688416,0.005077156,0.16053401,0.011959626,0.14979039],"study_design_scores_gemma":[0.000016186246,0.00006971241,0.0007831003,0.00005126246,0.00007656966,0.00022395156,0.00002056035,0.94264084,0.0024114128,0.04046147,0.013190028,0.000054887656],"about_ca_topic_score_codex":0.0031100311,"about_ca_topic_score_gemma":0.0018922276,"teacher_disagreement_score":0.009801923,"about_ca_system_score_codex":0.0010260023,"about_ca_system_score_gemma":0.0009970507,"threshold_uncertainty_score":0.03279072},"labels":[],"label_agreement":null},{"id":"W2770711354","doi":"10.1177/0962280217737566","title":"Bayesian latent time joint mixed effect models for multicohort longitudinal data","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":81,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research","keywords":"Bayesian probability; Mixed model; Longitudinal data; Latent variable; Econometrics; Computer science; Statistics; Event data; Mathematics; Data mining; Covariate","score_opus":0.5151171744634669,"score_gpt":0.6288287204909679,"score_spread":0.113711546027501,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2770711354","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007729513,0.0010654827,0.988734,0.0009821755,0.00008755194,0.00013475443,0.00064056664,0.00020814527,0.00041773953],"genre_scores_gemma":[0.32933334,0.0039642774,0.6527897,0.0009195889,0.0006172221,0.0033266642,0.0036855647,0.0002261481,0.0051374706],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98424596,0.012328337,0.0005291271,0.0018170716,0.0006851339,0.0003943952],"domain_scores_gemma":[0.89912933,0.08821893,0.0055419207,0.0045806896,0.0017299918,0.00079922244],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038453847,0.0018738235,0.0031514287,0.0032805966,0.0011976765,0.0030119952,0.005134026,0.003147846,0.0041680923],"category_scores_gemma":[0.087378845,0.0015948399,0.003029001,0.0039539854,0.0031946963,0.004686402,0.0029411232,0.0049432293,0.0007518589],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003502561,0.00018950898,0.011307926,0.00048402828,0.0011599226,0.00041674104,0.00082344026,0.20790747,0.0005464658,0.7258013,0.0043922137,0.04662076],"study_design_scores_gemma":[0.00010002537,0.00008846169,0.0015321523,0.00011493586,0.00023050977,0.00012308177,0.00009575066,0.46678102,0.00018530407,0.5277758,0.0029048007,0.00006818724],"about_ca_topic_score_codex":0.008731807,"about_ca_topic_score_gemma":0.009760588,"teacher_disagreement_score":0.038453847,"about_ca_system_score_codex":0.0026721545,"about_ca_system_score_gemma":0.002645066,"threshold_uncertainty_score":0.2033658},"labels":[],"label_agreement":null},{"id":"W2772202324","doi":"10.1177/0962280217743777","title":"Causal inference with measurement error in outcomes: Bias analysis and estimation methods","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; University of Waterloo","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Observational error; Statistics; Outcome (game theory); Weighting; Inverse probability weighting; Inference; Causal inference; Errors-in-variables models; Computer science; Econometrics; Estimation; Statistical inference; Mathematics; Artificial intelligence","score_opus":0.738761936625469,"score_gpt":0.7244365658423263,"score_spread":0.014325370783142666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2772202324","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00089909707,0.0007132318,0.9974547,0.00042041848,0.00005602068,0.00007488221,0.00004325567,0.000047165773,0.00029131063],"genre_scores_gemma":[0.1617975,0.00431031,0.8277572,0.0010064478,0.0009514972,0.0018252819,0.00034820172,0.00015643933,0.0018470761],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9052433,0.079697154,0.0026284326,0.0052502668,0.0063864063,0.0007944225],"domain_scores_gemma":[0.6984421,0.2669937,0.01073981,0.017652793,0.0057025566,0.00046911123],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.111860394,0.0021472424,0.0038259882,0.0052699456,0.001429094,0.0033383807,0.004874305,0.0045965356,0.0032972018],"category_scores_gemma":[0.33588153,0.0013939032,0.0036599839,0.0063410304,0.0052141836,0.0049402798,0.004667078,0.0052570705,0.00066947355],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000966554,0.000087604894,0.005844951,0.0010204929,0.0013032493,0.00023353375,0.00045411108,0.07790352,0.0004842071,0.7632996,0.0021649536,0.14710712],"study_design_scores_gemma":[0.00008569346,0.00007761297,0.0009496335,0.00035898705,0.00029335413,0.00018209164,0.000059493,0.20147963,0.00078589097,0.7910973,0.004570651,0.000059717077],"about_ca_topic_score_codex":0.0028426677,"about_ca_topic_score_gemma":0.0013437126,"teacher_disagreement_score":0.8881396,"about_ca_system_score_codex":0.0022918994,"about_ca_system_score_gemma":0.00377221,"threshold_uncertainty_score":0.59158134},"labels":[],"label_agreement":null},{"id":"W2790635366","doi":"10.1177/0962280218759693","title":"MethodCompare: An R package to assess bias and precision in method comparison studies","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Data Analysis with R","field":"Computer Science","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Alberta Children's Hospital; University of Calgary","funders":"","keywords":"R package; Statistics; Computer science; Econometrics; Mathematics","score_opus":0.6339406249091168,"score_gpt":0.7103905885533488,"score_spread":0.07644996364423196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2790635366","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046138624,0.004458363,0.8523039,0.0016215522,0.0017311592,0.0034837024,0.055721793,0.07139593,0.0046697585],"genre_scores_gemma":[0.03808002,0.002360523,0.85306233,0.0016835736,0.00064966775,0.023741204,0.019744063,0.056895982,0.0037826058],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.93006265,0.046039734,0.008148369,0.005783973,0.009282628,0.0006826764],"domain_scores_gemma":[0.58219355,0.35690212,0.022005754,0.020072,0.017852118,0.0009744965],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07168199,0.004099906,0.0045258207,0.0089019425,0.0011044819,0.00497057,0.0050045894,0.0022767414,0.060885362],"category_scores_gemma":[0.3469515,0.0030154884,0.006059503,0.007755423,0.0018848411,0.0034522207,0.0051679835,0.0048320782,0.015226219],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002257395,0.00032280266,0.019264545,0.025846276,0.017430136,0.00063608825,0.0016714304,0.011699211,0.0027590313,0.029430723,0.5771627,0.31151968],"study_design_scores_gemma":[0.002804174,0.00072462397,0.027874874,0.007984879,0.008854012,0.0018394353,0.00047170513,0.06756065,0.008312063,0.13594823,0.73661536,0.0010099711],"about_ca_topic_score_codex":0.0026402185,"about_ca_topic_score_gemma":0.003404071,"teacher_disagreement_score":0.928318,"about_ca_system_score_codex":0.0016483715,"about_ca_system_score_gemma":0.008014223,"threshold_uncertainty_score":0.37909514},"labels":[],"label_agreement":null},{"id":"W2792390571","doi":"10.1177/0962280218756159","title":"Assessing covariate balance when using the generalized propensity score with quantitative or continuous exposures","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":118,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Covariate; Statistics; Observational study; Logistic regression; Mathematics; Medicine","score_opus":0.7850233477568593,"score_gpt":0.6838532647255835,"score_spread":0.10117008303127584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2792390571","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012176019,0.00040611508,0.98510057,0.00034979073,0.000041710344,0.00028142065,0.00028153183,0.00020392433,0.0011589477],"genre_scores_gemma":[0.24116354,0.0010668703,0.753661,0.00043658225,0.00015662883,0.0013949869,0.0009909732,0.00018147305,0.0009479245],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96406275,0.028130168,0.0018066979,0.00230595,0.003352868,0.0003415748],"domain_scores_gemma":[0.8966837,0.08162999,0.00946182,0.009067093,0.0027650197,0.00039236332],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04939106,0.0010202724,0.00134821,0.0029195591,0.00074104354,0.002218956,0.0012837285,0.0012198554,0.005084946],"category_scores_gemma":[0.19008744,0.00051923876,0.0017490899,0.003340574,0.0020079175,0.0034221606,0.003240511,0.002001496,0.00044940028],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000606958,0.00023958393,0.08360512,0.0015763289,0.0025944002,0.00045130594,0.0016657856,0.15899904,0.0029174606,0.31884354,0.006946823,0.42155358],"study_design_scores_gemma":[0.00025483398,0.0005792576,0.028823946,0.000565997,0.00047968156,0.0004815218,0.00046979883,0.2833111,0.002869125,0.6558675,0.026152749,0.00014443712],"about_ca_topic_score_codex":0.0029426392,"about_ca_topic_score_gemma":0.002722439,"teacher_disagreement_score":0.04939106,"about_ca_system_score_codex":0.0010556153,"about_ca_system_score_gemma":0.0028090829,"threshold_uncertainty_score":0.261208},"labels":[],"label_agreement":null},{"id":"W2793641334","doi":"10.1177/0962280218757560","title":"Efficient robust doubly adaptive regularized regression with applications","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Outlier; Robustness (evolution); Estimator; Computer science; Oracle; Mathematical optimization; Robust regression; Linear regression; Algorithm; Regression; Monte Carlo method; Mathematics; Statistics; Artificial intelligence; Machine learning","score_opus":0.34605395600941213,"score_gpt":0.6137930848336274,"score_spread":0.26773912882421524,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2793641334","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038114053,0.00036153605,0.99473745,0.00018800674,0.0000233593,0.000019641486,0.00003235046,0.00013334688,0.0006929196],"genre_scores_gemma":[0.38178772,0.0013657635,0.6109565,0.00027813323,0.00023285743,0.00036150482,0.0004043738,0.0002465866,0.004366623],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99745756,0.0015857972,0.000095301024,0.0002595608,0.00049413,0.00010766875],"domain_scores_gemma":[0.99183196,0.006122284,0.0006520451,0.00051267387,0.0007591005,0.00012201624],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004226991,0.0011581255,0.0016790736,0.0010971726,0.00033432926,0.00092861045,0.0014487788,0.0013886746,0.0021241303],"category_scores_gemma":[0.018123388,0.00057312014,0.0010818328,0.001385125,0.0010365685,0.0010826029,0.0019957598,0.0015134441,0.0005103404],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011489703,0.00006230273,0.00082949514,0.0002004421,0.00009192709,0.00016175302,0.00005530397,0.8821544,0.0017643775,0.06011944,0.0018597279,0.052585967],"study_design_scores_gemma":[0.0000051555894,0.000011123453,0.000054127613,0.0000049893592,0.0000031030436,0.000012463321,0.0000024025087,0.9930977,0.00023054058,0.0062218155,0.00035293703,0.0000036788879],"about_ca_topic_score_codex":0.0021609499,"about_ca_topic_score_gemma":0.0014510232,"teacher_disagreement_score":0.004226991,"about_ca_system_score_codex":0.00064382056,"about_ca_system_score_gemma":0.00093298306,"threshold_uncertainty_score":0.022354782},"labels":[],"label_agreement":null},{"id":"W2795636674","doi":"10.1177/0962280218766964","title":"Decoding and modelling of time series count data using Poisson hidden Markov model and Markov ordinal logistic regression models","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Vibrio bacteria research studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"","keywords":"Markov chain; Statistics; Mathematics; Markov model; Poisson distribution; Hidden Markov model; Variable-order Markov model; Markov property; Overdispersion; Markov chain Monte Carlo; Stochastic matrix; Ordinal regression; Poisson regression; Count data; Computer science; Bayesian probability; Artificial intelligence; Population; Medicine","score_opus":0.28185465909972757,"score_gpt":0.5365581696180117,"score_spread":0.25470351051828416,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2795636674","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03572502,0.00024465242,0.96173185,0.000381059,0.000054465,0.00006356567,0.00050483056,0.0004726461,0.00082189206],"genre_scores_gemma":[0.6730324,0.0010806901,0.31578073,0.0001414857,0.0001369613,0.000591799,0.00260219,0.00020478881,0.006428942],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998257,0.0008264549,0.00015027284,0.00036879908,0.0002432771,0.0001541666],"domain_scores_gemma":[0.9937961,0.0047845286,0.0006457334,0.00022432173,0.00046526446,0.0000840666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037771931,0.0006194787,0.0011629266,0.0013530047,0.00048871094,0.0016311138,0.002031307,0.001071443,0.0023050022],"category_scores_gemma":[0.013302398,0.00079499173,0.0016532384,0.0016965413,0.0006111763,0.0017061554,0.0014269509,0.0019826575,0.00083704933],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001575697,0.000085941494,0.009639933,0.00020904596,0.00014594622,0.00038393468,0.00043279116,0.8864363,0.0015974615,0.039734513,0.0010478027,0.060128793],"study_design_scores_gemma":[0.0000044239932,0.0000136888575,0.0004760802,0.000010175334,0.000009911008,0.000027538354,0.000015545214,0.99178714,0.00024436295,0.0071230833,0.00027643726,0.000011677143],"about_ca_topic_score_codex":0.011492895,"about_ca_topic_score_gemma":0.007813038,"teacher_disagreement_score":0.011492895,"about_ca_system_score_codex":0.0010310684,"about_ca_system_score_gemma":0.0015796633,"threshold_uncertainty_score":0.022852004},"labels":[],"label_agreement":null},{"id":"W2800160739","doi":"10.1177/0962280218772065","title":"Understanding and diagnosing the potential for bias when using machine learning methods with doubly robust causal estimators","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hôpital du Sacré-Cœur de Montréal; Université de Montréal","funders":"Canadian Institutes of Health Research; Université de Montréal; Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Propensity score matching; Resampling; Estimator; Causal inference; Average treatment effect; Computer science; Parametric statistics; Statistics; Econometrics; Mathematics","score_opus":0.7613136427473822,"score_gpt":0.6566960719608058,"score_spread":0.10461757078657641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2800160739","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019881934,0.00051453226,0.9780963,0.0006460855,0.00003789253,0.000077339835,0.000051495957,0.0001130576,0.00058124046],"genre_scores_gemma":[0.44428092,0.000602021,0.552982,0.0005770903,0.00014379196,0.0005363322,0.00020807114,0.000120208,0.00054961833],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9531012,0.03809416,0.0020504287,0.0021886763,0.0040049995,0.0005603943],"domain_scores_gemma":[0.62056446,0.34365508,0.013750978,0.015411667,0.006102091,0.0005156869],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07292441,0.0009516353,0.0013177521,0.0024308446,0.00085559854,0.002698865,0.002377919,0.0031401243,0.0019231507],"category_scores_gemma":[0.3782891,0.0006969211,0.0012161349,0.0020225286,0.0031314045,0.0035084262,0.003695856,0.0030122846,0.00026425876],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005049084,0.00019570405,0.048413053,0.0010937144,0.0007741065,0.00081841904,0.0017843442,0.238063,0.003523044,0.4822849,0.0022872933,0.2202575],"study_design_scores_gemma":[0.000104847546,0.00017937565,0.005784141,0.000289007,0.00013585332,0.00043638758,0.0002137649,0.63336515,0.003942187,0.35146067,0.0040085237,0.00008009294],"about_ca_topic_score_codex":0.0020147918,"about_ca_topic_score_gemma":0.0012617385,"teacher_disagreement_score":0.92707556,"about_ca_system_score_codex":0.0011170789,"about_ca_system_score_gemma":0.0020222052,"threshold_uncertainty_score":0.38566577},"labels":[],"label_agreement":null},{"id":"W2805193208","doi":"10.1177/0962280218776690","title":"Assessing the performance of the generalized propensity score for estimating the effect of quantitative or continuous exposures on survival or time-to-event outcomes","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Heart, Lung, and Blood Institute; Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Global Positioning System; Medicine; Inverse probability weighting; Observational study; Weighting; Mathematics; Computer science","score_opus":0.5441098280577505,"score_gpt":0.667460193097909,"score_spread":0.1233503650401585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2805193208","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12096183,0.0014705127,0.874051,0.0006537766,0.0000829162,0.0004981143,0.0005475931,0.0002803425,0.0014539817],"genre_scores_gemma":[0.53999066,0.0014649999,0.4557453,0.00022237784,0.00010211885,0.0009329956,0.00088407734,0.00016973393,0.00048767173],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9503818,0.043376256,0.0014184345,0.0020293184,0.0024862483,0.0003079181],"domain_scores_gemma":[0.7420651,0.23066488,0.009656298,0.013211668,0.0038260245,0.0005760166],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.076196425,0.0012513978,0.0014348078,0.00283208,0.00051604427,0.0014362513,0.001318199,0.0017630158,0.0022906763],"category_scores_gemma":[0.27733946,0.0005020205,0.002584958,0.003253105,0.0017262199,0.0020722758,0.0022511233,0.0014550609,0.00027139258],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017236281,0.00038717777,0.14146763,0.0021500022,0.0074109985,0.00038214258,0.0012916662,0.5018997,0.0025759768,0.08612075,0.003524865,0.25106543],"study_design_scores_gemma":[0.00050186215,0.0019445098,0.06038803,0.0005322385,0.0011480012,0.00049456756,0.00036358743,0.8030776,0.0028239386,0.123034105,0.005491541,0.0002000163],"about_ca_topic_score_codex":0.0044178586,"about_ca_topic_score_gemma":0.0028703737,"teacher_disagreement_score":0.92380357,"about_ca_system_score_codex":0.0009958684,"about_ca_system_score_gemma":0.0025916004,"threshold_uncertainty_score":0.40297002},"labels":[],"label_agreement":null},{"id":"W2808600279","doi":"10.1177/0962280218779408","title":"Flexible and structured survival model for a simultaneous estimation of non-linear and non-proportional effects and complex interactions between continuous variables: Performance of this multidimensional penalized spline approach in net survival trend analysis","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Agence Nationale de la Recherche; Cancer Research UK","keywords":"Spline (mechanical); Survival analysis; Computer science; Elastic net regularization; Estimator; Econometrics; Statistics; Parametric statistics; Smoothing; Proportional hazards model; Poisson distribution; Mathematics; Mathematical optimization; Regression","score_opus":0.10006292289328535,"score_gpt":0.5157611724700032,"score_spread":0.41569824957671786,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2808600279","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018591566,0.00007254854,0.9806912,0.00014650653,0.000021223701,0.00004062357,0.000070162794,0.00010849598,0.0002576589],"genre_scores_gemma":[0.5389898,0.00036111506,0.45340636,0.00018215356,0.00009507388,0.0008552628,0.0007268424,0.00016111268,0.005222324],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9967031,0.0024990693,0.00009238201,0.00027425922,0.00028047967,0.00015066653],"domain_scores_gemma":[0.992272,0.0060894666,0.0005104148,0.0004408247,0.000533975,0.00015336747],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010215846,0.0006422192,0.001033364,0.0008609647,0.00031804654,0.0008683227,0.0017169089,0.0010654309,0.0018777479],"category_scores_gemma":[0.015483115,0.0004411055,0.0016651644,0.0008409246,0.0007598831,0.00086765277,0.001224294,0.0018269741,0.0003704454],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018634222,0.00009192266,0.005104424,0.000072952906,0.00013606228,0.00018325042,0.00021476822,0.89271337,0.0014476124,0.05670248,0.0008816967,0.04226503],"study_design_scores_gemma":[0.000008620781,0.00003761146,0.00039532775,0.0000053854014,0.0000124491235,0.000017482946,0.0000075956837,0.9945344,0.00009086202,0.0045861737,0.0002955057,0.000008650899],"about_ca_topic_score_codex":0.0041090082,"about_ca_topic_score_gemma":0.0030391712,"teacher_disagreement_score":0.010215846,"about_ca_system_score_codex":0.000498659,"about_ca_system_score_gemma":0.0014960143,"threshold_uncertainty_score":0.0540272},"labels":[],"label_agreement":null},{"id":"W2884046250","doi":"10.1177/0962280218786525","title":"Analysis of conversion of Alzheimer’s disease using a multi-state Markov model","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Dementia and Cognitive Impairment Research","field":"Medicine","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research; Michigan State University","keywords":"Disease; Apolipoprotein E; Neuroimaging; Medicine; Alzheimer's disease; Alzheimer's Disease Neuroimaging Initiative; Population; Risk factor; Apolipoprotein B; Internal medicine; Psychology; Neuroscience; Cholesterol; Environmental health","score_opus":0.252798915671842,"score_gpt":0.6051278958011224,"score_spread":0.3523289801292804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2884046250","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5696282,0.0010690436,0.42167184,0.0020793707,0.00014867836,0.00017855856,0.001505693,0.00060961494,0.0031089545],"genre_scores_gemma":[0.9782909,0.00043125037,0.016321175,0.000116973235,0.000062259714,0.00017257032,0.0010282794,0.00004396518,0.003532626],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99913603,0.00039481706,0.000042232827,0.00017277585,0.00006834769,0.0001857201],"domain_scores_gemma":[0.98751384,0.010944137,0.0005970101,0.0002089263,0.00044413944,0.00029196095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044318317,0.00089665345,0.0014296317,0.0013403983,0.00082115503,0.0014328443,0.0013480553,0.0013467111,0.006062568],"category_scores_gemma":[0.009724416,0.00070199574,0.0020588052,0.00059042365,0.0007585518,0.00125419,0.0010841349,0.0017426419,0.00040120023],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019578962,0.00006927797,0.010506802,0.000035425153,0.00013158126,0.00012504726,0.00007330063,0.9742473,0.0001844221,0.009339375,0.00056289515,0.0045288317],"study_design_scores_gemma":[0.000007745858,0.000012116023,0.00047150312,0.000004155984,0.000012920695,0.000009116012,0.000008034165,0.9973193,0.000023181188,0.0020635794,0.00006296813,0.000005308436],"about_ca_topic_score_codex":0.047086067,"about_ca_topic_score_gemma":0.0242226,"teacher_disagreement_score":0.047086067,"about_ca_system_score_codex":0.0018831257,"about_ca_system_score_gemma":0.0022018033,"threshold_uncertainty_score":0.093623996},"labels":[],"label_agreement":null},{"id":"W2884668939","doi":"10.1177/0962280218786980","title":"Joint modelling for organ transplantation outcomes for patients with diabetes and the end-stage renal disease","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Renal Transplantation Outcomes and Treatments","field":"Medicine","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Medicine; Renal function; Proportional hazards model; Kidney transplantation; End stage renal disease; Transplantation; Internal medicine; Disease; Intensive care medicine","score_opus":0.14855449154126799,"score_gpt":0.4956272917796851,"score_spread":0.34707280023841713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2884668939","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.31754926,0.0009237903,0.6773711,0.0013720492,0.000099579906,0.00017730414,0.0010304863,0.0002723112,0.0012041443],"genre_scores_gemma":[0.9441321,0.0005903121,0.049603567,0.000116721334,0.00008845182,0.00040326375,0.0013733717,0.00005913943,0.003633138],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99657816,0.0023169455,0.00013107479,0.00048412773,0.00020223447,0.00028749675],"domain_scores_gemma":[0.9878697,0.009618383,0.0011481557,0.0006678566,0.00034711644,0.00034877055],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0077869003,0.00087360444,0.0018576452,0.0009888136,0.0005582423,0.0014583707,0.001961584,0.0012302746,0.0028218923],"category_scores_gemma":[0.022324089,0.000558464,0.0026366347,0.0016168162,0.0008403743,0.0011900114,0.002023603,0.0025210439,0.0003888473],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003638237,0.00020528847,0.05085831,0.000106050225,0.00042220307,0.0002944528,0.00041019026,0.89074963,0.00045741643,0.023969581,0.00076038495,0.031402774],"study_design_scores_gemma":[0.000029420606,0.00010935231,0.0055839233,0.000018727073,0.000060373895,0.000061762665,0.0000738333,0.9804018,0.00011277963,0.01304223,0.00048657233,0.000019297559],"about_ca_topic_score_codex":0.01398686,"about_ca_topic_score_gemma":0.014468446,"teacher_disagreement_score":0.01398686,"about_ca_system_score_codex":0.001060259,"about_ca_system_score_gemma":0.0019355585,"threshold_uncertainty_score":0.041181564},"labels":[],"label_agreement":null},{"id":"W2888226965","doi":"10.1177/0962280218795187","title":"Methods for shortening patient-reported outcome measures","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital","funders":"Canadian Arthritis Network; Canadian Institutes of Health Research; Dr. Fooke Laboratorien","keywords":"Outcome (game theory); Observational study; Medicine; Patient-reported outcome; Clinical trial; Scale (ratio); Test (biology); Physical therapy; Computer science; Quality of life (healthcare); Nursing; Mathematics","score_opus":0.8985570285078743,"score_gpt":0.7640029906638991,"score_spread":0.13455403784397524,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2888226965","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043515,0.00036126465,0.98868424,0.00048669073,0.0002857667,0.0037706445,0.0007239099,0.00041760303,0.0009184599],"genre_scores_gemma":[0.019012354,0.00033882377,0.9544086,0.00027827377,0.00016898225,0.024011755,0.00085635675,0.00020673084,0.00071813347],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.87614554,0.08889653,0.014965093,0.004669875,0.014509589,0.00081341754],"domain_scores_gemma":[0.7192743,0.19897503,0.023725875,0.034487013,0.022341857,0.0011960473],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.092395775,0.001999202,0.0018314508,0.0035707245,0.00095464673,0.0018670176,0.0024073895,0.0013483166,0.010236763],"category_scores_gemma":[0.30417228,0.0010429546,0.002729096,0.0046016476,0.0014587654,0.001994259,0.0030556093,0.004653771,0.0029252751],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016712415,0.00074461167,0.007068257,0.002384611,0.00053384365,0.00012325811,0.0013945327,0.008167869,0.0035236771,0.03673803,0.007427928,0.9302221],"study_design_scores_gemma":[0.00464355,0.018807868,0.056477718,0.006842937,0.0024561556,0.0019451694,0.0027838855,0.2146926,0.046462834,0.38808033,0.2558361,0.00097081804],"about_ca_topic_score_codex":0.0006277251,"about_ca_topic_score_gemma":0.00090623106,"teacher_disagreement_score":0.9076042,"about_ca_system_score_codex":0.001083356,"about_ca_system_score_gemma":0.003982363,"threshold_uncertainty_score":0.48864138},"labels":[],"label_agreement":null},{"id":"W2890155095","doi":"10.1177/0962280218797145","title":"Eliminating systematic bias from case-crossover designs","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Alberta; Government of Alberta; Alberta Health Services","funders":"Health Research Board","keywords":"Crossover; Statistics; Confounding; Calibration; Crossover study; Computer science; Econometrics; Confidence interval; Meta-analysis; Publication bias; Medicine; Mathematics","score_opus":0.7550744409644745,"score_gpt":0.7229459907852953,"score_spread":0.0321284501791792,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2890155095","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016135463,0.0014718192,0.9754945,0.00033086105,0.00032987457,0.0051219426,0.00016853327,0.00020880102,0.0007382131],"genre_scores_gemma":[0.30390394,0.0014391645,0.6767004,0.0008318227,0.0002174729,0.016010497,0.0002791329,0.00005021621,0.00056733063],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.767156,0.2033284,0.010553456,0.00812509,0.009968892,0.00086806336],"domain_scores_gemma":[0.7412345,0.20399076,0.019505952,0.027801618,0.0068203253,0.00064690836],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23244956,0.001551059,0.0030746637,0.0023172507,0.001303163,0.0016217591,0.0028883654,0.0031481332,0.0033689525],"category_scores_gemma":[0.3167954,0.0010829335,0.00405741,0.0021364975,0.0030485783,0.0020036097,0.002232334,0.0024860967,0.0003110144],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01330524,0.0021547568,0.051358182,0.011656995,0.012741637,0.0011138803,0.0041346853,0.10317053,0.0072347946,0.2783121,0.0041196696,0.51069754],"study_design_scores_gemma":[0.024632215,0.022409717,0.03589262,0.003146061,0.012544457,0.0014728981,0.00072732376,0.29670998,0.018391274,0.54758614,0.035822704,0.0006645684],"about_ca_topic_score_codex":0.00087700103,"about_ca_topic_score_gemma":0.0007259771,"teacher_disagreement_score":0.76755047,"about_ca_system_score_codex":0.0011475245,"about_ca_system_score_gemma":0.0032388053,"threshold_uncertainty_score":0.94652635},"labels":[],"label_agreement":null},{"id":"W2891506233","doi":"10.1177/0962280218799540","title":"A review and empirical comparison of causal inference methods for clustered observational data with application to the evaluation of the effectiveness of medical devices","year":2018,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Observational study; Causal inference; Propensity score matching; Confounding; Matching (statistics); Cluster analysis; Metric (unit); Variance (accounting); Computer science; Statistics; Econometrics; Inference; Cluster (spacecraft); Data mining; Medicine; Mathematics; Artificial intelligence; Engineering; Operations management","score_opus":0.885421416171426,"score_gpt":0.8016456215590271,"score_spread":0.08377579461239892,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891506233","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012508809,0.9932308,0.004609069,0.00085457746,0.00019334006,0.00002645458,0.00007405374,0.00001617679,0.0008705536],"genre_scores_gemma":[0.001950993,0.9917434,0.005390107,0.0003139822,0.00026769788,0.00008761498,0.00007095271,0.00001126775,0.00016400775],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9930059,0.0036853405,0.0010099191,0.00067580334,0.0015209694,0.00010208443],"domain_scores_gemma":[0.90117514,0.091339156,0.0025280889,0.0013115313,0.0033490425,0.0002969302],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.015062487,0.0012870486,0.0029198257,0.0071683484,0.00050553266,0.0019694674,0.0023988853,0.0023120048,0.0053291917],"category_scores_gemma":[0.062373612,0.00075367413,0.0025370074,0.009361902,0.0017844264,0.0025204758,0.0011297496,0.0024262262,0.0012455353],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008249877,0.00007083044,0.0007639191,0.08613579,0.0009480164,0.000102766695,0.000199326,0.0019022776,0.00020807904,0.03399103,0.015458285,0.8601372],"study_design_scores_gemma":[0.0000920864,0.00030786026,0.007441673,0.14037938,0.003248113,0.0014844072,0.00036988282,0.0026605977,0.00074699573,0.087976396,0.75512224,0.00017040421],"about_ca_topic_score_codex":0.0027306343,"about_ca_topic_score_gemma":0.002777308,"teacher_disagreement_score":0.9849375,"about_ca_system_score_codex":0.0021534602,"about_ca_system_score_gemma":0.005427803,"threshold_uncertainty_score":0.079658985},"labels":[],"label_agreement":null},{"id":"W2896073293","doi":"10.1177/0962280218804275","title":"Benefits of combining prevalent and incident cohorts: An application to myotonic dystrophy","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic Neurodegenerative Diseases","field":"Neuroscience","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Cohort; Myotonic dystrophy; Medicine; Cohort study; Disease; Demography; Sample size determination; Pediatrics; Internal medicine; Statistics","score_opus":0.14378130381616575,"score_gpt":0.5384049972434336,"score_spread":0.3946236934272679,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896073293","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14384374,0.0040588984,0.84181297,0.0046787607,0.0003099224,0.00081769173,0.0009821045,0.00044548375,0.0030503855],"genre_scores_gemma":[0.5736666,0.0015018621,0.42010707,0.0011283662,0.00040131318,0.0008514854,0.00072263525,0.0001332946,0.001487391],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.892776,0.098346174,0.0017796874,0.00291118,0.0037468679,0.00044007838],"domain_scores_gemma":[0.5319943,0.42558408,0.008881867,0.024047043,0.007627947,0.001864747],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16802783,0.0012256948,0.0016527371,0.0017964946,0.0013672105,0.0026110178,0.0022457903,0.0020504342,0.0019579607],"category_scores_gemma":[0.33096245,0.0010518122,0.0026629611,0.0031267682,0.0022369502,0.0036998352,0.0066554477,0.0033812209,0.00025488416],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004583018,0.0006695199,0.4286293,0.00086685247,0.0067274766,0.0014756378,0.0027241746,0.07394735,0.0014000401,0.053819302,0.0033434057,0.421814],"study_design_scores_gemma":[0.0018407017,0.0051035485,0.11928889,0.00080142554,0.0061290343,0.0025038258,0.0018312868,0.5826755,0.0028313177,0.25591257,0.02079885,0.00028306388],"about_ca_topic_score_codex":0.0042889817,"about_ca_topic_score_gemma":0.0050162566,"teacher_disagreement_score":0.8319722,"about_ca_system_score_codex":0.0007739275,"about_ca_system_score_gemma":0.0025021357,"threshold_uncertainty_score":0.88862675},"labels":[],"label_agreement":null},{"id":"W2896304424","doi":"10.1177/0962280218804569","title":"Identifying treatment responders using counterfactual modeling and potential outcomes","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Mount Sinai Hospital","funders":"","keywords":"Covariate; Observational study; Counterfactual thinking; Multinomial distribution; Computer science; Statistics; Outcome (game theory); Econometrics; Medicine; Selection bias; Machine learning; Mathematics; Psychology","score_opus":0.5780682473959962,"score_gpt":0.6666451500665824,"score_spread":0.08857690267058627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896304424","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05750034,0.0008076086,0.93606067,0.0025525696,0.00016105518,0.0007954097,0.00040451117,0.0001710664,0.001546694],"genre_scores_gemma":[0.74374706,0.0008626336,0.24846639,0.001074166,0.00024711495,0.0031692917,0.000625051,0.000056608485,0.0017516717],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9235772,0.06875372,0.0014640361,0.0036285433,0.0018239911,0.0007525435],"domain_scores_gemma":[0.76369196,0.20299385,0.016830083,0.013806897,0.001971063,0.0007061011],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1095877,0.001496208,0.0028463616,0.002653509,0.0009066128,0.003225057,0.0032458,0.0031245884,0.0033560488],"category_scores_gemma":[0.17951004,0.000981637,0.0038104719,0.002047556,0.0038500403,0.0037129654,0.0029395279,0.0033888344,0.00043795267],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015487344,0.00045520617,0.041522738,0.00064029614,0.0016352047,0.000713311,0.0014826887,0.30335295,0.00072300655,0.57634026,0.0021385218,0.06944702],"study_design_scores_gemma":[0.0002525494,0.0002784454,0.0028941832,0.00011517036,0.00030392612,0.00021893086,0.00012061293,0.6619749,0.00047902306,0.33148766,0.0018123628,0.000062307816],"about_ca_topic_score_codex":0.0024529172,"about_ca_topic_score_gemma":0.0016011342,"teacher_disagreement_score":0.1095877,"about_ca_system_score_codex":0.0018592151,"about_ca_system_score_gemma":0.002038887,"threshold_uncertainty_score":0.57956207},"labels":[],"label_agreement":null},{"id":"W2898839296","doi":"10.1177/0962280218808817","title":"Causal inference with multiple concurrent medications: A comparison of methods and an application in multidrug-resistant tuberculosis","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Université de Montréal; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Causal inference; Propensity score matching; Marginal structural model; Inverse probability weighting; Estimation; Statistics; Econometrics; Outcome (game theory); Inference; Tuberculosis; Weighting; Medicine; Counterfactual thinking; Parametric statistics; Computer science; Intensive care medicine; Mathematics; Artificial intelligence; Psychology","score_opus":0.3771174340888153,"score_gpt":0.6903954447855432,"score_spread":0.31327801069672784,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2898839296","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023263773,0.006060019,0.9662883,0.0017014085,0.00016425298,0.0005669499,0.00011945604,0.00016310663,0.0016726856],"genre_scores_gemma":[0.26465458,0.0052398276,0.72671425,0.00053445925,0.00029965094,0.0012802402,0.0001590596,0.00012884013,0.0009891044],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8581013,0.13161156,0.0021467386,0.0029309802,0.0048169997,0.0003923538],"domain_scores_gemma":[0.28239265,0.6981025,0.0072699552,0.008900512,0.0027936334,0.0005408371],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15416194,0.0013183089,0.0023427769,0.0030188807,0.00089661585,0.002264319,0.0033324554,0.0023117715,0.0042633996],"category_scores_gemma":[0.36180443,0.0009071299,0.004257111,0.0030813226,0.0021955518,0.004499862,0.0034388637,0.0033753852,0.00030437933],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037127286,0.0008868621,0.027964208,0.0033864635,0.009210776,0.0004653351,0.0022988366,0.13927063,0.0007565415,0.20847042,0.0021546981,0.60142255],"study_design_scores_gemma":[0.0023081466,0.0015812712,0.014617536,0.0014122988,0.0025854998,0.0007384727,0.00060594274,0.6025082,0.0013355528,0.362908,0.009106655,0.00029243645],"about_ca_topic_score_codex":0.0049362937,"about_ca_topic_score_gemma":0.005184017,"teacher_disagreement_score":0.84583807,"about_ca_system_score_codex":0.0019378213,"about_ca_system_score_gemma":0.0040667006,"threshold_uncertainty_score":0.81529605},"labels":[],"label_agreement":null},{"id":"W2904833574","doi":"10.1177/0962280218815301","title":"Shape invariant mixture model for clustering non-linear longitudinal growth trajectories","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Cluster analysis; Markov chain Monte Carlo; Mixture model; Computer science; Invariant (physics); Bayesian probability; Bayesian inference; Linear model; Longitudinal data; Inference; Mathematics; Econometrics; Applied mathematics; Data mining; Artificial intelligence; Machine learning","score_opus":0.16600573259292056,"score_gpt":0.5160146234251991,"score_spread":0.35000889083227854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2904833574","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046990076,0.00027788695,0.9941571,0.0001651069,0.00003122087,0.000044939705,0.00013636495,0.00018016454,0.0003082703],"genre_scores_gemma":[0.35766914,0.0020113129,0.627021,0.0003931674,0.00026345183,0.0010516854,0.0024096358,0.0003946454,0.008785975],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9972198,0.0011396391,0.00014325192,0.0007501871,0.0005216834,0.00022547634],"domain_scores_gemma":[0.99426985,0.0036283305,0.00061049167,0.0005121116,0.00081683067,0.00016229901],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071063032,0.0013726112,0.00218311,0.0029551,0.0010913205,0.0017593757,0.003961988,0.0025167237,0.0023910098],"category_scores_gemma":[0.015618506,0.0010017047,0.0026824472,0.0031877884,0.0022151424,0.002776689,0.0018249092,0.003196633,0.0012988533],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019836474,0.00008787327,0.004373115,0.0002009305,0.00026822498,0.00018235097,0.00049562653,0.74859834,0.0023835844,0.1737828,0.0026540263,0.0667748],"study_design_scores_gemma":[0.000008668244,0.000021926548,0.00064454065,0.00001902419,0.000030470314,0.00004023678,0.000022895636,0.9652331,0.0002704678,0.032548238,0.0011290895,0.000031420972],"about_ca_topic_score_codex":0.017219393,"about_ca_topic_score_gemma":0.011278929,"teacher_disagreement_score":0.017219393,"about_ca_system_score_codex":0.0022560959,"about_ca_system_score_gemma":0.0018010117,"threshold_uncertainty_score":0.03758216},"labels":[],"label_agreement":null},{"id":"W2906515425","doi":"10.1177/0962280218817926","title":"Covariate-adjusted survival analyses in propensity-score matched samples: Imputing potential time-to-event outcomes","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada; National Institutes of Health; National Science Foundation","keywords":"Propensity score matching; Covariate; Statistics; Proportional hazards model; Matching (statistics); Hazard ratio; Survival analysis; Observational study; Accelerated failure time model; Sample size determination; Outcome (game theory); Econometrics; Mathematics; Confidence interval","score_opus":0.7075499601632524,"score_gpt":0.6697690744611742,"score_spread":0.03778088570207827,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906515425","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011159478,0.0002972811,0.9876139,0.00017557158,0.000042140393,0.00015843475,0.00014533951,0.00022159409,0.00018634326],"genre_scores_gemma":[0.3428342,0.00091037195,0.6530678,0.0003563363,0.00016678958,0.0010451904,0.00069231784,0.00010371767,0.00082324585],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98242444,0.014343731,0.00063606264,0.001262804,0.0010942955,0.00023869483],"domain_scores_gemma":[0.963519,0.027673528,0.0032847936,0.0040417355,0.0012509851,0.00023005987],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.028546914,0.0008199118,0.0013568068,0.0020715038,0.0005833763,0.0009881529,0.0019807469,0.0014777825,0.0024097369],"category_scores_gemma":[0.09016752,0.00050481135,0.0023209034,0.0029693225,0.0009995817,0.0014505348,0.0017431695,0.0018174786,0.00030239107],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001538847,0.0004572926,0.056813635,0.0010071695,0.0029677772,0.0007447068,0.0010561474,0.23389038,0.0032956956,0.19753876,0.0045242966,0.49616528],"study_design_scores_gemma":[0.0004485475,0.0007014332,0.013824009,0.00014384152,0.0005861035,0.00036946408,0.00013444904,0.73609656,0.003072294,0.23623426,0.008288607,0.00010034817],"about_ca_topic_score_codex":0.0023855178,"about_ca_topic_score_gemma":0.0016228613,"teacher_disagreement_score":0.9714531,"about_ca_system_score_codex":0.0007206848,"about_ca_system_score_gemma":0.0022438606,"threshold_uncertainty_score":0.1509723},"labels":[],"label_agreement":null},{"id":"W2916199673","doi":"10.1177/0962280219829885","title":"Prediction intervals with random forests","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Machine Learning and Data Classification","field":"Computer Science","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Random forest; Computer science; Covariate; Prediction interval; Calibration; Tree (set theory); Data mining; Regression; Interval (graph theory); Parametric statistics; Cart; Statistics; Machine learning; Mathematics","score_opus":0.11733146660538908,"score_gpt":0.5295953286551724,"score_spread":0.4122638620497834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2916199673","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009877689,0.0010456132,0.9867678,0.000120232326,0.00010515552,0.00010992913,0.0001746313,0.000914113,0.00088477193],"genre_scores_gemma":[0.3905929,0.0009556232,0.60487443,0.00019455896,0.0002921378,0.00053885597,0.0011176786,0.00032429185,0.0011095181],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98727417,0.008862781,0.0005746597,0.001329213,0.0016048911,0.00035428477],"domain_scores_gemma":[0.94589466,0.0450579,0.002356201,0.0033516055,0.0029600759,0.0003795714],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020370409,0.0014252777,0.0018943128,0.002784066,0.0006220746,0.0018683181,0.0025578008,0.0014610327,0.0033104965],"category_scores_gemma":[0.06609956,0.00066624716,0.001861418,0.0019169024,0.00082243414,0.0027795343,0.0018500922,0.0027043507,0.0011950071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007835348,0.00013477945,0.0057218373,0.00045655304,0.00039896453,0.00018360639,0.00020860056,0.6003473,0.000840914,0.033306405,0.005011314,0.35260618],"study_design_scores_gemma":[0.000050314327,0.00009215408,0.00066094345,0.000080488986,0.000057826994,0.00007456327,0.000022496188,0.96634346,0.00091046677,0.030062927,0.0016119236,0.000032417225],"about_ca_topic_score_codex":0.002121835,"about_ca_topic_score_gemma":0.0015557826,"teacher_disagreement_score":0.020370409,"about_ca_system_score_codex":0.0006598293,"about_ca_system_score_gemma":0.0009896547,"threshold_uncertainty_score":0.10773033},"labels":[],"label_agreement":null},{"id":"W2923957350","doi":"10.1177/0962280219889080","title":"Estimating the sample mean and standard deviation from commonly reported quantiles in meta-analysis","year":2020,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":83,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"National Institute on Minority Health and Health Disparities; National Institute of Diabetes and Digestive and Kidney Diseases; National Heart, Lung, and Blood Institute; Fonds de Recherche du Québec - Santé; National Center for Research Resources; National Institute of General Medical Sciences; National Institute of Mental Health; Agency for Healthcare Research and Quality; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Centers for Disease Control and Prevention","keywords":"Standard deviation; Quartile; Statistics; Quantile; Sample mean and sample covariance; Sample size determination; Meta-analysis; Standard error; Normal distribution; Sample (material); Econometrics; Outcome (game theory); Mathematics; Pooled variance; Absolute deviation; Confidence interval; Medicine","score_opus":0.5909202286661872,"score_gpt":0.6355710282862124,"score_spread":0.04465079962002516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2923957350","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0052594645,0.013704461,0.9770857,0.0015943154,0.0003576584,0.00043727653,0.0004910312,0.00051869615,0.00055139535],"genre_scores_gemma":[0.16799901,0.0109116305,0.8136118,0.0015393889,0.0006960683,0.0031291158,0.0011915413,0.00047094605,0.00045048798],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79776275,0.17459701,0.008130092,0.009536839,0.009155491,0.00081770774],"domain_scores_gemma":[0.51198786,0.44607717,0.013753612,0.020231482,0.0073203095,0.0006294741],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1939273,0.0025133886,0.0069235833,0.009009775,0.0012063265,0.0065120575,0.005901113,0.00487688,0.002266109],"category_scores_gemma":[0.5278686,0.0020608068,0.010018218,0.00985101,0.003881638,0.0058613666,0.0047537694,0.0073429476,0.00065113825],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020679266,0.0002239863,0.030449014,0.0146965375,0.037944995,0.0008134469,0.0016039297,0.25656435,0.0016756916,0.16497035,0.016720425,0.47226942],"study_design_scores_gemma":[0.0012195098,0.0005420992,0.008267705,0.0040885075,0.00903687,0.0005359458,0.00030005717,0.3104346,0.003139248,0.64711845,0.014909332,0.0004077591],"about_ca_topic_score_codex":0.003293413,"about_ca_topic_score_gemma":0.002574065,"teacher_disagreement_score":0.8060727,"about_ca_system_score_codex":0.002798821,"about_ca_system_score_gemma":0.005268236,"threshold_uncertainty_score":0.99403113},"labels":[],"label_agreement":null},{"id":"W2933605766","doi":"10.1177/0962280219837656","title":"Handling ties in continuous outcomes for confounder adjustment with rank-ordered logit and its application to ordinal outcomes","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Institut universitaire en santé mentale de Montréal","funders":"National Medical Research Council; Cancerfonden","keywords":"Econometrics; Odds; Statistics; Ordered logit; Ordinal data; Logit; Confounding; Ordinal regression; Mathematics; Scaling; Equivalence (formal languages); Computer science; Logistic regression; Discrete mathematics","score_opus":0.2995074587587282,"score_gpt":0.6181559167719965,"score_spread":0.31864845801326835,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2933605766","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009055408,0.00036540828,0.9888487,0.0005985941,0.000059466947,0.00014170574,0.00014121196,0.00022597394,0.0005635936],"genre_scores_gemma":[0.32354268,0.00083092635,0.6709551,0.0007625059,0.0002231759,0.0011898078,0.00043978955,0.00021453631,0.001841412],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94492656,0.046956725,0.0013956713,0.002837319,0.0033532402,0.00053055026],"domain_scores_gemma":[0.834626,0.13929456,0.0111728,0.010850904,0.00337634,0.0006793654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.062340267,0.00095367525,0.0013761177,0.002706009,0.0011067141,0.0026638235,0.002108958,0.0018683065,0.005370084],"category_scores_gemma":[0.24111249,0.00065811706,0.0024258245,0.0036227715,0.00324799,0.0034494149,0.0037589849,0.0036857685,0.0006815422],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010375461,0.00021679173,0.049593277,0.0012071745,0.0015480816,0.0014141438,0.003324197,0.15355788,0.0023387687,0.4475108,0.006322395,0.33192894],"study_design_scores_gemma":[0.0001729872,0.00023795043,0.006881914,0.0002756751,0.00029421074,0.00056069397,0.00035154642,0.3803805,0.0017190009,0.59648675,0.012499603,0.0001392423],"about_ca_topic_score_codex":0.0033096059,"about_ca_topic_score_gemma":0.002706919,"teacher_disagreement_score":0.062340267,"about_ca_system_score_codex":0.0012120797,"about_ca_system_score_gemma":0.0029907126,"threshold_uncertainty_score":0.3296908},"labels":[],"label_agreement":null},{"id":"W2937710358","doi":"10.1177/0962280219842362","title":"Comparing the high-dimensional propensity score for use with administrative data with propensity scores derived from high-quality clinical data","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Confounding; Medicine; Hazard ratio; Proxy (statistics); Statistics; Internal medicine; Mathematics; Confidence interval","score_opus":0.899460556396185,"score_gpt":0.6935688475760646,"score_spread":0.20589170882012042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2937710358","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28422734,0.003170917,0.6890529,0.0031459092,0.000910259,0.003617599,0.008342335,0.00083892065,0.006693829],"genre_scores_gemma":[0.8178158,0.0010816618,0.16901596,0.00078306795,0.0003107222,0.0031208994,0.006680466,0.00037151924,0.0008199891],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7637499,0.20660488,0.009401776,0.0075723627,0.011530155,0.0011409275],"domain_scores_gemma":[0.59224933,0.32324582,0.029958647,0.038512453,0.014149445,0.0018842213],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15550713,0.0015015253,0.0022850793,0.004823865,0.0008100982,0.0045949123,0.0026449012,0.0014764371,0.008601874],"category_scores_gemma":[0.43937397,0.0008103344,0.005597482,0.009547222,0.0017260655,0.004506249,0.0051618996,0.0030493885,0.0010538272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008913641,0.0011520415,0.5591396,0.002229408,0.040611207,0.00030201595,0.00155548,0.0675488,0.00063714973,0.04533185,0.014402476,0.2581764],"study_design_scores_gemma":[0.005482201,0.0065946053,0.4648247,0.0014511578,0.008822635,0.0009377317,0.0017314121,0.37787914,0.0017540818,0.09263455,0.03715437,0.00073343585],"about_ca_topic_score_codex":0.0049719126,"about_ca_topic_score_gemma":0.002977387,"teacher_disagreement_score":0.15550713,"about_ca_system_score_codex":0.0018003988,"about_ca_system_score_gemma":0.0026411754,"threshold_uncertainty_score":0.82241017},"labels":[],"label_agreement":null},{"id":"W29415624","doi":"10.1177/0962280218756159","title":"Variasi Bentuk Penguatan pada Pembelajaran Bahasa Jawa Kelas VII di SMP Se-Kecamatan Winong Kabupaten Pati","year":2012,"lang":"en","type":"dissertation","venue":"Statistical Methods in Medical Research","topic":"Educational Research and Methods","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research","keywords":"Humanities; Psychology; Physics; Art","score_opus":0.2623628753972758,"score_gpt":0.6661840673525657,"score_spread":0.4038211919552899,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W29415624","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58634573,0.036750767,0.0358849,0.01570733,0.0034442244,0.00060574134,0.0043242127,0.001327571,0.31560954],"genre_scores_gemma":[0.8204559,0.02278217,0.038240716,0.0016815059,0.0004664504,0.00037507378,0.002829455,0.00034955985,0.112819195],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.99968696,0.00006467772,0.000028642597,0.00007206491,0.00008995092,0.00005775346],"domain_scores_gemma":[0.999514,0.00014942276,0.00007353482,0.000043309643,0.00015278049,0.00006707603],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00080883893,0.00057984126,0.0006366094,0.00079944567,0.0016472121,0.0020323512,0.0005145692,0.0004525412,0.028279904],"category_scores_gemma":[0.0018006962,0.00029694717,0.00043658758,0.001632953,0.0004635186,0.0015573351,0.001293851,0.0014820894,0.004919893],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00082446,0.00052522775,0.036367342,0.0015080911,0.0001767757,0.004676366,0.004460471,0.0027878676,0.014728606,0.043330424,0.04008531,0.85052913],"study_design_scores_gemma":[0.00016007984,0.0005879988,0.07690922,0.00077361916,0.00034997612,0.004963218,0.010454792,0.0068113394,0.013646071,0.026821291,0.85834336,0.00017892139],"about_ca_topic_score_codex":0.0065488815,"about_ca_topic_score_gemma":0.014267676,"teacher_disagreement_score":0.028279904,"about_ca_system_score_codex":0.0010661377,"about_ca_system_score_gemma":0.0023875646,"threshold_uncertainty_score":0.094605684},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["insufficient_payload"],"domain":null,"study_design":"design_other","genre":"other","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2948592660","doi":"10.1177/0962280219852721","title":"Investigating protein patterns in human leukemia cell line experiments: A Bayesian approach for extremely small sample sizes","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Proteomics Techniques and Applications","field":"Chemistry","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"National Cancer Institute; University of Texas MD Anderson Cancer Center; National Institutes of Health; Cancer Prevention and Research Institute of Texas","keywords":"Myeloid leukemia; Bayesian probability; Computational biology; Sample size determination; Leukemia; Computer science; Cancer cell lines; Mass cytometry; Sample (material); Bioinformatics; Biology; Cancer; Statistics; Chemistry; Mathematics; Cancer research; Cancer cell; Phenotype; Chromatography; Artificial intelligence; Genetics; Gene","score_opus":0.16581169265453438,"score_gpt":0.5168562717667535,"score_spread":0.35104457911221915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2948592660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02095408,0.00022503514,0.9780132,0.00015422855,0.000012634618,0.000115761744,0.00011716272,0.0001965142,0.00021143079],"genre_scores_gemma":[0.27602416,0.00042228148,0.7201562,0.0004911881,0.00007077197,0.0009978658,0.0006968482,0.00009715133,0.0010436408],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9948992,0.0031750414,0.00022348967,0.00088349776,0.0007020343,0.00011678275],"domain_scores_gemma":[0.9672561,0.027383273,0.0016312641,0.002161816,0.0011628582,0.00040463987],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018734286,0.0007117108,0.0015657627,0.001234348,0.00095981546,0.0011362636,0.0018527806,0.0018279204,0.0010902107],"category_scores_gemma":[0.03836264,0.0008056321,0.0013327245,0.0010095186,0.0016766032,0.0013503091,0.0017126658,0.0022495515,0.00025123518],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013236676,0.00046860447,0.020845756,0.00059597264,0.0010756684,0.0006062004,0.0006049475,0.68716156,0.055423774,0.044035245,0.0023005658,0.18555813],"study_design_scores_gemma":[0.00006746658,0.0001322541,0.0034352446,0.000020558608,0.00008956564,0.00009720738,0.000030176372,0.96421593,0.0041132867,0.026881415,0.000877928,0.00003901584],"about_ca_topic_score_codex":0.004090948,"about_ca_topic_score_gemma":0.0067508705,"teacher_disagreement_score":0.018734286,"about_ca_system_score_codex":0.001019957,"about_ca_system_score_gemma":0.0015432171,"threshold_uncertainty_score":0.09907758},"labels":[],"label_agreement":null},{"id":"W2951322845","doi":"10.1177/0962280217747054","title":"Fitting mechanistic epidemic models to data: A comparison of simple Markov chain Monte Carlo approaches","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Markov chain Monte Carlo; Computer science; Markov chain; Simple (philosophy); Bayesian probability; Monte Carlo method; Approximate Bayesian computation; Data mining; Econometrics; Machine learning; Artificial intelligence; Statistics; Mathematics; Inference","score_opus":0.8933866589386059,"score_gpt":0.704013528761424,"score_spread":0.18937313017718194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2951322845","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14669386,0.0037557732,0.83960676,0.0025802567,0.00015388113,0.0004859416,0.00063665764,0.001057122,0.005029743],"genre_scores_gemma":[0.61840296,0.004120944,0.37366614,0.00060966343,0.00017570045,0.00068553456,0.0008679918,0.00053572154,0.00093541783],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98950887,0.007786504,0.0005717824,0.00075229694,0.0012003588,0.0001802085],"domain_scores_gemma":[0.8679067,0.11997457,0.0029073944,0.005877267,0.002571798,0.0007623057],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026902178,0.0014163752,0.0022665553,0.0035323245,0.00076273497,0.0023332206,0.004052769,0.0033579138,0.0016216448],"category_scores_gemma":[0.11377139,0.0013045626,0.0018275647,0.0028195907,0.0014337002,0.0041077323,0.0028021126,0.0024822177,0.00035535105],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003343361,0.00014531161,0.006960114,0.00034023554,0.00043719658,0.00009133679,0.00045629457,0.906721,0.0002588805,0.041973334,0.0006641298,0.04161784],"study_design_scores_gemma":[0.000054343167,0.0000640845,0.0013760694,0.00007521977,0.000051435236,0.00004916435,0.000078175246,0.96752644,0.00013958923,0.029894086,0.0006500414,0.000041422416],"about_ca_topic_score_codex":0.018389575,"about_ca_topic_score_gemma":0.015358468,"teacher_disagreement_score":0.9730978,"about_ca_system_score_codex":0.002265697,"about_ca_system_score_gemma":0.003392815,"threshold_uncertainty_score":0.14227402},"labels":[],"label_agreement":null},{"id":"W2952368191","doi":"10.1177/0962280219852747","title":"Statistical methods for detecting outlying and influential studies in meta-analysis of diagnostic test accuracy studies","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Forest ecology and management","field":"Environmental Science","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Bivariate analysis; Computer science; Meta-analysis; Statistics; Sensitivity (control systems); Data mining; Random effects model; Statistical hypothesis testing; Econometrics; Machine learning; Mathematics; Medicine","score_opus":0.35820890604690775,"score_gpt":0.6359007442394153,"score_spread":0.2776918381925076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2952368191","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010191071,0.0017330189,0.994113,0.00026269633,0.00015779339,0.0017403567,0.0003324091,0.00045832575,0.00018315266],"genre_scores_gemma":[0.045311045,0.0011300695,0.9393177,0.00043500133,0.00018783976,0.012699976,0.0004046475,0.00030048587,0.00021313207],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.40535763,0.5263293,0.034341313,0.014692379,0.01849121,0.0007881626],"domain_scores_gemma":[0.21441807,0.7038586,0.02665625,0.04432545,0.010018898,0.0007226837],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47995096,0.0044499445,0.007459447,0.016160794,0.0017535599,0.005876908,0.0072631254,0.004217348,0.0059270277],"category_scores_gemma":[0.69714123,0.0028741457,0.018009178,0.015201943,0.0052793478,0.004530937,0.0064341994,0.00790636,0.00079647644],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004083046,0.00050361775,0.030906782,0.041902762,0.12220163,0.0014129308,0.0035598127,0.082557306,0.0037101915,0.12943485,0.014598446,0.56512874],"study_design_scores_gemma":[0.0038028345,0.0025067923,0.017150935,0.009435418,0.052887186,0.0014147635,0.00067191455,0.3329453,0.009797657,0.5258087,0.04246018,0.0011183309],"about_ca_topic_score_codex":0.001640665,"about_ca_topic_score_gemma":0.0020514033,"teacher_disagreement_score":0.52004904,"about_ca_system_score_codex":0.0027093983,"about_ca_system_score_gemma":0.006334853,"threshold_uncertainty_score":0.6413131},"labels":[],"label_agreement":null},{"id":"W2953345044","doi":"10.1177/0962280216660128","title":"Principal component of explained variance: An efficient and optimal data dimension reduction framework for association studies","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Douglas Mental Health University Institute; McGill University; Jewish General Hospital","funders":"National Institute on Aging; Canadian Institutes of Health Research","keywords":"Dimensionality reduction; Principal component analysis; Covariate; Dimension (graph theory); Context (archaeology); Computer science; Variance (accounting); Component (thermodynamics); Variance reduction; Data mining; Mathematics; Machine learning; Artificial intelligence","score_opus":0.23584234104567728,"score_gpt":0.5864195385407014,"score_spread":0.35057719749502414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2953345044","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006025138,0.00036315128,0.9984201,0.00020309808,0.000025939098,0.00003726861,0.00007261103,0.00009008341,0.0001852272],"genre_scores_gemma":[0.041137233,0.001173996,0.9551674,0.0002366412,0.00026047914,0.0006349538,0.0004961009,0.0002065433,0.0006866335],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9816809,0.014231003,0.00058118964,0.0012665569,0.0019367078,0.0003036927],"domain_scores_gemma":[0.982337,0.013099717,0.0008745934,0.00204048,0.0014178017,0.00023035357],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019213315,0.0019425536,0.0024751318,0.0034794705,0.0011417293,0.0028069227,0.002792906,0.0018095389,0.001890869],"category_scores_gemma":[0.04279627,0.0011094026,0.002898704,0.0041824724,0.0029599888,0.0021795265,0.003763452,0.004397822,0.0009948664],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021329997,0.00014233855,0.0041621653,0.00067889615,0.000687947,0.00029226817,0.0005286946,0.19642949,0.0028615326,0.47964454,0.009614066,0.30474478],"study_design_scores_gemma":[0.00006211811,0.00014233818,0.0014340129,0.0001282313,0.00011026034,0.00022167036,0.000074147734,0.5345895,0.0011249037,0.44911888,0.012894177,0.000099743855],"about_ca_topic_score_codex":0.0031301216,"about_ca_topic_score_gemma":0.0037158167,"teacher_disagreement_score":0.019213315,"about_ca_system_score_codex":0.0012563212,"about_ca_system_score_gemma":0.0036578737,"threshold_uncertainty_score":0.10161096},"labels":[],"label_agreement":null},{"id":"W2954051196","doi":"10.1177/0962280219859037","title":"A novel model for the X-chromosome inactivation association on survival data","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Skewness; Population; Chromosome; Locus (genetics); Mathematics; Genetics; Biological data; Biology; Computer science; Statistics; Computational biology; Gene; Medicine","score_opus":0.19955920848409536,"score_gpt":0.5290297773718313,"score_spread":0.32947056888773596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954051196","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023166921,0.00066874985,0.97181207,0.000971994,0.00013764919,0.000191357,0.0010186735,0.00028605008,0.0017464943],"genre_scores_gemma":[0.683681,0.0038262818,0.259838,0.0012022696,0.0006264485,0.0024292152,0.004271492,0.00027566508,0.043849617],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9969606,0.0014982363,0.00013957993,0.00071952044,0.0003801493,0.00030195623],"domain_scores_gemma":[0.9899663,0.007883948,0.00069710397,0.0004185279,0.0008194148,0.00021478816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010332175,0.001326119,0.002320899,0.0015067145,0.00068064773,0.0020590797,0.004437865,0.003007628,0.005145935],"category_scores_gemma":[0.015143679,0.0008283463,0.0022002922,0.0022511906,0.0019213659,0.0019783927,0.0018818743,0.003160835,0.0012233858],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027627187,0.00008980482,0.0069945226,0.000303309,0.00021051556,0.000667221,0.00038285836,0.81735486,0.0019483116,0.14122888,0.0025505337,0.027992846],"study_design_scores_gemma":[0.00004707888,0.0000732688,0.0008630956,0.000028729684,0.00005993534,0.00013843918,0.000025565749,0.9757662,0.00020788566,0.02136009,0.0014029372,0.00002671496],"about_ca_topic_score_codex":0.011088927,"about_ca_topic_score_gemma":0.00777224,"teacher_disagreement_score":0.011088927,"about_ca_system_score_codex":0.0014440846,"about_ca_system_score_gemma":0.0020336623,"threshold_uncertainty_score":0.05464244},"labels":[],"label_agreement":null},{"id":"W2964567104","doi":"10.1177/0962280219863076","title":"Joint nested frailty models for clustered recurrent and terminal events: An application to colonoscopy screening visits and colorectal cancer risks in Lynch Syndrome families","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic factors in colorectal cancer","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Public Health Ontario; University of Toronto; Memorial University of Newfoundland; Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Family history; Colonoscopy; Colorectal cancer; Lynch syndrome; Medicine; Covariate; Disease; Cancer; Event (particle physics); Computer science; Internal medicine; Machine learning","score_opus":0.21744779482678706,"score_gpt":0.5662762707348751,"score_spread":0.348828475908088,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964567104","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.45089155,0.0006278411,0.54395425,0.0012110675,0.000053369058,0.00015178858,0.001289925,0.0003368343,0.0014832934],"genre_scores_gemma":[0.9549279,0.0003362378,0.038292825,0.0001264789,0.000041272393,0.00019841095,0.0008274605,0.00006356205,0.005185771],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980465,0.0009962106,0.0000701825,0.00043743127,0.00015194954,0.00029768978],"domain_scores_gemma":[0.9886828,0.007873037,0.0015812813,0.0008341564,0.0005625411,0.0004660589],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007842688,0.0008568236,0.0016703146,0.001157127,0.00078633294,0.0011358698,0.0030095035,0.0013561171,0.0027664222],"category_scores_gemma":[0.019105276,0.00071726687,0.0024247712,0.0010007685,0.0014235589,0.0011756737,0.0016933928,0.002401243,0.00031543753],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031577167,0.00014289592,0.07587869,0.000073229094,0.00062677596,0.001104471,0.0008352905,0.8483075,0.0007785876,0.048621718,0.0017673568,0.021547882],"study_design_scores_gemma":[0.000038846974,0.00007561318,0.010565103,0.000028856264,0.00010906578,0.00013328185,0.000096067815,0.9659516,0.000101523874,0.022331936,0.0005331782,0.000034954825],"about_ca_topic_score_codex":0.09024147,"about_ca_topic_score_gemma":0.08803539,"teacher_disagreement_score":0.09024147,"about_ca_system_score_codex":0.001993071,"about_ca_system_score_gemma":0.0021017492,"threshold_uncertainty_score":0.17943239},"labels":[],"label_agreement":null},{"id":"W2979956400","doi":"10.1177/0962280219881032","title":"Time-stratified case-crossover design applied with conditional logistic regression is not free from overlap bias","year":2019,"lang":"en","type":"letter","venue":"Statistical Methods in Medical Research","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Alberta Health Services","funders":"","keywords":"Logistic regression; Crossover; Statistics; Crossover study; Econometrics; Mathematics; Computer science; Medicine; Artificial intelligence","score_opus":0.6160523859351099,"score_gpt":0.6265387992108831,"score_spread":0.010486413275773154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2979956400","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04847004,0.01026921,0.6535801,0.23751387,0.032750137,0.0040991525,0.0011459999,0.001177812,0.010993686],"genre_scores_gemma":[0.3277472,0.0028788531,0.4733837,0.16313523,0.015577691,0.010036796,0.00038131,0.00029241433,0.006566824],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6886546,0.2808269,0.009785715,0.00722953,0.012232109,0.001271151],"domain_scores_gemma":[0.37934345,0.58060265,0.010384183,0.021151887,0.0072212582,0.0012965921],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2496505,0.00077953807,0.0044527445,0.001438945,0.0012741921,0.0023491639,0.002798395,0.012724905,0.0047040414],"category_scores_gemma":[0.44455153,0.0011523245,0.002442089,0.0019005049,0.004812997,0.002617153,0.0014653102,0.008389671,0.001284379],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.047443923,0.001375128,0.019470682,0.004034567,0.0045140237,0.002428995,0.0017841683,0.0052890247,0.002033727,0.13324125,0.12936255,0.6490219],"study_design_scores_gemma":[0.051443893,0.012974922,0.04062823,0.0032475323,0.005987258,0.0064825304,0.00071321335,0.12435753,0.0061472366,0.5836201,0.16375962,0.00063804054],"about_ca_topic_score_codex":0.0009771512,"about_ca_topic_score_gemma":0.0019636275,"teacher_disagreement_score":0.7503495,"about_ca_system_score_codex":0.0014213306,"about_ca_system_score_gemma":0.0030428374,"threshold_uncertainty_score":0.92531455},"labels":[],"label_agreement":null},{"id":"W2980191247","doi":"10.1177/0962280219880571","title":"Causal variance decompositions for institutional comparisons in healthcare","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University Health Network; Public Health Ontario; University of Toronto","funders":"","keywords":"Variance (accounting); Pairwise comparison; Health care; Estimator; Variation (astronomy); Contrast (vision); Causal inference; Quality (philosophy)","score_opus":0.5111091620525015,"score_gpt":0.6978161455830484,"score_spread":0.18670698353054693,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2980191247","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016839212,0.00018774904,0.9972248,0.00015234294,0.00004822898,0.00009983169,0.00008953089,0.00010751938,0.0004061446],"genre_scores_gemma":[0.12872389,0.00066020805,0.86559963,0.0003257837,0.00027098745,0.0021107222,0.00068785547,0.00018524381,0.0014357243],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94216645,0.048521668,0.0015584093,0.0031897675,0.0036605913,0.00090322155],"domain_scores_gemma":[0.8175889,0.15925318,0.00634666,0.0121273715,0.003881175,0.00080263085],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07991772,0.0017567355,0.0021966195,0.006505089,0.0010829122,0.0028733038,0.002615491,0.0024852455,0.009516133],"category_scores_gemma":[0.20505895,0.0010635529,0.00483456,0.005940523,0.0043311026,0.004585431,0.0046585514,0.0049079107,0.0009808695],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012350449,0.00012682192,0.004286748,0.00026167155,0.0005404246,0.00013014853,0.00040931534,0.06462722,0.0003744413,0.83804053,0.0021015136,0.088977724],"study_design_scores_gemma":[0.000049538987,0.00008660623,0.0012381617,0.000107680156,0.00007162681,0.000047753438,0.000096649965,0.26394942,0.00035943397,0.73105186,0.0028995776,0.00004168789],"about_ca_topic_score_codex":0.0033469114,"about_ca_topic_score_gemma":0.0023987624,"teacher_disagreement_score":0.07991772,"about_ca_system_score_codex":0.0025051343,"about_ca_system_score_gemma":0.0034971917,"threshold_uncertainty_score":0.42265034},"labels":[],"label_agreement":null},{"id":"W2981954851","doi":"10.1177/0962280219882968","title":"Estimating the quantile medical cost under time-dependent covariates and right censored time-to-event variable based on a state process","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Covariate; Quantile; Censoring (clinical trials); Estimator; Statistics; Inverse probability weighting; Econometrics; Computer science; Quantile function; Weighting; Quantile regression; Cumulative distribution function; Event (particle physics); Mathematics; Medicine; Probability density function","score_opus":0.09840022808209999,"score_gpt":0.5383808817050073,"score_spread":0.43998065362290734,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2981954851","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19055367,0.00044061875,0.8073699,0.00039808807,0.000024265784,0.000088240464,0.00025801384,0.00013928961,0.0007279263],"genre_scores_gemma":[0.94831055,0.0005392049,0.049127158,0.00005971851,0.000039429873,0.00015758703,0.00046268443,0.000025209667,0.0012785054],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99904495,0.0005229281,0.00004119971,0.00016459513,0.00011277557,0.00011348592],"domain_scores_gemma":[0.9923497,0.006127291,0.00075394753,0.00029171948,0.00038289084,0.00009442679],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004951302,0.0004112155,0.0009797814,0.00090072723,0.0002658503,0.00089366746,0.0010252299,0.000856595,0.0014796794],"category_scores_gemma":[0.014805181,0.00026181713,0.0006179876,0.0012299153,0.00065579946,0.0012457228,0.00083399966,0.0010552845,0.000097088916],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016303436,0.00012756579,0.040410876,0.00014888172,0.00014240277,0.0002598089,0.0001542063,0.8353772,0.001422591,0.07364916,0.00077914394,0.047365107],"study_design_scores_gemma":[0.000010133238,0.000027727749,0.0036671541,0.000008808412,0.000020641506,0.00002682163,0.000024539971,0.98656183,0.00024475454,0.009243911,0.00015424467,0.000009453463],"about_ca_topic_score_codex":0.007597794,"about_ca_topic_score_gemma":0.0039395364,"teacher_disagreement_score":0.007597794,"about_ca_system_score_codex":0.0007944427,"about_ca_system_score_gemma":0.0013294562,"threshold_uncertainty_score":0.026185274},"labels":[],"label_agreement":null},{"id":"W2990322717","doi":"10.1177/0962280219888741","title":"Random forests for homogeneous and non-homogeneous Poisson processes with excess zeros","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"Fonds de recherche du Québec – Nature et technologies; Natural Sciences and Engineering Research Council of Canada; Fondation HEC","keywords":"Homogeneous; Poisson distribution; Zero-inflated model; Zero (linguistics); Applied mathematics; Mathematics; Compound Poisson process; Statistics; Poisson process; Poisson regression; Statistical physics; Computer science; Mathematical optimization; Combinatorics; Physics","score_opus":0.14256903439322716,"score_gpt":0.5536162434177959,"score_spread":0.41104720902456876,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2990322717","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007174571,0.0001482099,0.9920753,0.00008354668,0.000026023174,0.000039973933,0.00007648781,0.00011593114,0.00025985736],"genre_scores_gemma":[0.41302443,0.0009976482,0.57689786,0.0004311649,0.000409256,0.0008695197,0.0011384557,0.0002865927,0.005945161],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9952455,0.0028317678,0.00019327145,0.0008688979,0.00044338475,0.0004171348],"domain_scores_gemma":[0.98310447,0.01226809,0.0019223324,0.0012063184,0.0010338046,0.00046503154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012493358,0.0012293666,0.0020211027,0.002494807,0.0011087708,0.0019334761,0.004097214,0.0018514055,0.0034867565],"category_scores_gemma":[0.020769803,0.0010856392,0.003277944,0.0017097822,0.0021219603,0.0027880906,0.001959175,0.0024172442,0.0010200051],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018729498,0.00011145722,0.00812598,0.00019278645,0.00027624617,0.0005290213,0.00039558474,0.6406699,0.0017041558,0.30204755,0.0018325072,0.043927524],"study_design_scores_gemma":[0.000018397077,0.000031447806,0.0006580149,0.000026438509,0.000029769757,0.000081616876,0.000026996959,0.919092,0.00023030462,0.07883026,0.0009483732,0.000026374793],"about_ca_topic_score_codex":0.0074399197,"about_ca_topic_score_gemma":0.007530997,"teacher_disagreement_score":0.012493358,"about_ca_system_score_codex":0.001126457,"about_ca_system_score_gemma":0.0014373297,"threshold_uncertainty_score":0.06607199},"labels":[],"label_agreement":null},{"id":"W3003262140","doi":"10.1177/0962280220901728","title":"Variable selection via penalized generalized estimating equations for a marginal survival model","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Covariate; Multivariate statistics; Estimator; Marginal model; Generalized estimating equation; Estimating equations; Model selection; Feature selection; Mathematics; Proportional hazards model; Statistics; Generalized linear model; Selection (genetic algorithm); Applied mathematics; Regression; Econometrics; Regression analysis; Computer science; Artificial intelligence","score_opus":0.5164316858740705,"score_gpt":0.6278889334165795,"score_spread":0.11145724754250896,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3003262140","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035132251,0.00012911201,0.9958811,0.00013164044,0.000014175172,0.000048420792,0.00008029372,0.00010332439,0.00009867485],"genre_scores_gemma":[0.14788605,0.00079889625,0.84562016,0.00026502286,0.00014107255,0.0010935843,0.001516594,0.00016179324,0.002516686],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99228173,0.006271637,0.00019891343,0.0005937422,0.00047297904,0.00018098255],"domain_scores_gemma":[0.98110366,0.015760433,0.0010018285,0.00079792406,0.0011637545,0.00017242039],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011871879,0.00093515276,0.0016623441,0.0011052318,0.000375964,0.0011135691,0.001925531,0.0009596028,0.0030009116],"category_scores_gemma":[0.027803835,0.00065738166,0.0017738458,0.0015917495,0.0008961188,0.0013369127,0.0016556367,0.0023939072,0.0006513725],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034950802,0.0001348035,0.0108291535,0.00040679213,0.00058611785,0.00044007436,0.00040969063,0.5814927,0.002023786,0.20877996,0.008416178,0.18613115],"study_design_scores_gemma":[0.00005203181,0.00005001198,0.0008706105,0.000023497978,0.000049982606,0.00006239567,0.00001620726,0.95972526,0.00024446467,0.03716418,0.0017204158,0.000020954358],"about_ca_topic_score_codex":0.0052593052,"about_ca_topic_score_gemma":0.006126674,"teacher_disagreement_score":0.011871879,"about_ca_system_score_codex":0.00075847126,"about_ca_system_score_gemma":0.0021002307,"threshold_uncertainty_score":0.06278521},"labels":[],"label_agreement":null},{"id":"W3004330284","doi":"10.1177/0962280219900362","title":"Estimation of causal effects with repeatedly measured outcomes in a Bayesian framework","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Causal inference; Observational study; Bayesian probability; Markov chain Monte Carlo; Propensity score matching; Computer science; Inverse probability; Marginal structural model; Econometrics; Bayesian inference; Machine learning; Posterior probability; Statistics; Artificial intelligence; Mathematics","score_opus":0.29924381672434486,"score_gpt":0.6201955815925178,"score_spread":0.3209517648681729,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3004330284","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032713108,0.00023086995,0.9956031,0.00035404766,0.000021380005,0.000086661974,0.0000836236,0.00007542122,0.0002735396],"genre_scores_gemma":[0.18235093,0.0014377141,0.8120573,0.00037969046,0.00023180617,0.0013323325,0.00053316937,0.000086471235,0.0015905572],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97092515,0.023771377,0.00087827304,0.001982538,0.0019973326,0.000445224],"domain_scores_gemma":[0.8406437,0.14602481,0.005926484,0.0046550394,0.002169788,0.0005801693],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0488748,0.0013857142,0.0029595217,0.0035094419,0.0009864988,0.002156837,0.0034887418,0.0025011315,0.0039867926],"category_scores_gemma":[0.14450312,0.001514811,0.0030583632,0.003520105,0.002827727,0.0038506673,0.0027732698,0.0049115685,0.0005554434],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021863969,0.00021435172,0.00751655,0.0005742748,0.0009759487,0.00032266814,0.0006257065,0.34796664,0.0005377276,0.5141058,0.0019932454,0.1249484],"study_design_scores_gemma":[0.00012032607,0.000083867046,0.0013358959,0.00011761552,0.00014918645,0.000091102826,0.000054378357,0.5609816,0.00021704346,0.43492734,0.001881651,0.00003999473],"about_ca_topic_score_codex":0.008695924,"about_ca_topic_score_gemma":0.008585002,"teacher_disagreement_score":0.9511252,"about_ca_system_score_codex":0.001917542,"about_ca_system_score_gemma":0.0041173566,"threshold_uncertainty_score":0.2584777},"labels":[],"label_agreement":null},{"id":"W3005076266","doi":"10.1177/0962280220902179","title":"Modeling of cumulative effects of time-varying drug exposures on within-subject changes in a continuous outcome","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Institute of Population and Public Health; Canadian Institutes of Health Research","keywords":"Random effects model; Statistics; Outcome (game theory); Econometrics; Mixed model; Medicine; Regression analysis; Correlation; Mathematics; Computer science; Meta-analysis; Internal medicine","score_opus":0.6354828221668393,"score_gpt":0.6687579758259045,"score_spread":0.03327515365906519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3005076266","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13415346,0.0006422006,0.8617375,0.000587463,0.00012649153,0.00029269088,0.0010014346,0.00032185882,0.0011368974],"genre_scores_gemma":[0.8491136,0.00076825544,0.14145651,0.0003256391,0.000086411674,0.0012505065,0.0012236185,0.00008491911,0.005690532],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99715155,0.0016996218,0.00012239395,0.0006207698,0.00022398407,0.00018173657],"domain_scores_gemma":[0.98620063,0.01070512,0.0013149878,0.0010411303,0.00054348004,0.00019459157],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011078443,0.0010674079,0.0014624951,0.0009546757,0.00042831703,0.0011987688,0.0024390216,0.0018919971,0.0028870157],"category_scores_gemma":[0.021177337,0.0006665279,0.003027646,0.0010320555,0.0011974837,0.00095855346,0.0013674794,0.0022740492,0.00034872044],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026694444,0.000097017524,0.016055932,0.00011521875,0.00041074617,0.00025536324,0.00017409977,0.9443371,0.0010126161,0.019667234,0.0004049941,0.017202666],"study_design_scores_gemma":[0.000063238185,0.00013380416,0.0035137287,0.000030062138,0.00013799337,0.00005910541,0.000024373567,0.98153955,0.0004296024,0.01318966,0.00084951514,0.00002943436],"about_ca_topic_score_codex":0.01704205,"about_ca_topic_score_gemma":0.010841134,"teacher_disagreement_score":0.9889216,"about_ca_system_score_codex":0.001051938,"about_ca_system_score_gemma":0.0021694524,"threshold_uncertainty_score":0.0585891},"labels":[],"label_agreement":null},{"id":"W3009413281","doi":"10.1177/0962280220907113","title":"Expanding attributable fraction applications to outcomes wholly attributable to a risk factor","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Alcohol Consumption and Health Effects","field":"Medicine","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Attributable risk; Fraction (chemistry); Econometrics; Disease; Risk factor; Statistics; Estimation; Epidemiology; Mathematics; Medicine; Economics; Chemistry; Pathology","score_opus":0.48967691462226376,"score_gpt":0.6623582638765955,"score_spread":0.1726813492543317,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3009413281","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023020743,0.0026940207,0.9879346,0.00304447,0.00032936985,0.00013484905,0.00016826497,0.00015658436,0.003235743],"genre_scores_gemma":[0.25689024,0.014397968,0.7120969,0.0043227244,0.0038106637,0.0020388085,0.00042674312,0.0007063636,0.005309633],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94919544,0.040745307,0.0018010422,0.0028121273,0.00500363,0.00044244766],"domain_scores_gemma":[0.70974237,0.256826,0.007842058,0.016524324,0.008449842,0.0006154433],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07198309,0.002355216,0.0027562708,0.0067353044,0.0014239881,0.003597101,0.0028712281,0.0028955154,0.006520284],"category_scores_gemma":[0.2893924,0.00085941015,0.0039337664,0.0058989823,0.0060166796,0.006564262,0.0068906136,0.007814587,0.0011428964],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010599041,0.00014431367,0.011044924,0.00089332124,0.0007827249,0.00033891323,0.0010825709,0.033764083,0.00048729026,0.7918552,0.004426712,0.15507391],"study_design_scores_gemma":[0.000041138563,0.000118214215,0.0020847153,0.0005779403,0.00019246066,0.00027405747,0.00025455543,0.058038097,0.0006512245,0.9178665,0.019851686,0.00004939029],"about_ca_topic_score_codex":0.0048159077,"about_ca_topic_score_gemma":0.0024822117,"teacher_disagreement_score":0.9280169,"about_ca_system_score_codex":0.0022116168,"about_ca_system_score_gemma":0.0034660527,"threshold_uncertainty_score":0.38068753},"labels":[],"label_agreement":null},{"id":"W3010790150","doi":"10.1177/0962280220907625","title":"A study of alternative approaches to non-normal latent trait distributions in item response theory models used for health outcome measurement","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Polytomous Rasch model; Item response theory; Skewness; Normality; Statistics; Econometrics; Outcome (game theory); Mathematics; Psychology; Psychometrics","score_opus":0.957603297598445,"score_gpt":0.7042964429288336,"score_spread":0.25330685466961134,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3010790150","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07599372,0.0025087984,0.9164325,0.0015763466,0.00011816682,0.00053514173,0.00011585674,0.00016920934,0.0025502415],"genre_scores_gemma":[0.48519322,0.0015491996,0.5092392,0.00079829124,0.00011989034,0.0016821567,0.0003140874,0.00019271561,0.00091121043],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.75212437,0.2232007,0.0033758762,0.008163998,0.0123544205,0.00078056956],"domain_scores_gemma":[0.2782409,0.67917264,0.011582923,0.02218715,0.00824254,0.0005739025],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2478018,0.0017869319,0.0017060767,0.0035497826,0.0012788092,0.0045707584,0.0038171224,0.002930547,0.002600902],"category_scores_gemma":[0.55289084,0.0010826591,0.0038997964,0.0049386346,0.005475963,0.0073661986,0.0038689296,0.005509888,0.00052427594],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010398903,0.00041235032,0.046603434,0.0013810168,0.0021576898,0.00039038103,0.0052845837,0.07515,0.0010004906,0.57491475,0.0016519215,0.29001343],"study_design_scores_gemma":[0.00031804232,0.0012400287,0.022319132,0.0011871919,0.000513402,0.0008183523,0.0016033076,0.5800882,0.001329806,0.3844549,0.005813824,0.0003138275],"about_ca_topic_score_codex":0.0033523412,"about_ca_topic_score_gemma":0.0032834543,"teacher_disagreement_score":0.2478018,"about_ca_system_score_codex":0.0049756104,"about_ca_system_score_gemma":0.0028169146,"threshold_uncertainty_score":0.9275943},"labels":[],"label_agreement":null},{"id":"W3011337113","doi":"10.1177/0962280221995963","title":"Causal simulation experiments: Lessons from bias amplification","year":2021,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"Canadian Institutes of Health Research","keywords":"Causal inference; Estimator; Context (archaeology); Computer science; Confounding; Econometrics; Inference; Parametric statistics; Set (abstract data type); Class (philosophy); Selection bias; Sensitivity (control systems); Artificial intelligence; Statistics; Mathematics; Engineering","score_opus":0.8123613022187561,"score_gpt":0.7422349751842946,"score_spread":0.07012632703446153,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3011337113","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02092341,0.0019331772,0.95740575,0.00978376,0.0004127231,0.0006755229,0.00026753996,0.00038946889,0.008208675],"genre_scores_gemma":[0.63318664,0.0018291089,0.3538792,0.0053122267,0.00067663606,0.0028972102,0.00024440387,0.00021694571,0.0017575898],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.77595127,0.20880696,0.003325033,0.004946655,0.0061202985,0.0008497918],"domain_scores_gemma":[0.14942843,0.80536085,0.009246688,0.030824007,0.0044328733,0.0007071683],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.20969826,0.0017425756,0.0024604145,0.0016961964,0.0015780027,0.0039345794,0.0047330344,0.0055037825,0.0090379855],"category_scores_gemma":[0.6408678,0.0011763698,0.002365685,0.0020648679,0.009724843,0.010018478,0.006202068,0.0077036223,0.00065415644],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008843899,0.0002970712,0.0064415457,0.0009445848,0.00097378955,0.0002969991,0.0010886812,0.06785407,0.00046300923,0.86253375,0.003087311,0.05513491],"study_design_scores_gemma":[0.00033656962,0.0001815792,0.0005175627,0.0002087032,0.00016951827,0.000108365326,0.00008765337,0.076946236,0.00052784994,0.91832805,0.00255268,0.000035141333],"about_ca_topic_score_codex":0.0014773154,"about_ca_topic_score_gemma":0.00094778516,"teacher_disagreement_score":0.20969826,"about_ca_system_score_codex":0.0021654107,"about_ca_system_score_gemma":0.0030903663,"threshold_uncertainty_score":0.97458273},"labels":[],"label_agreement":null},{"id":"W3012516591","doi":"10.1177/0962280220912772","title":"A threshold linear mixed model for identification of treatment-sensitive subsets in a clinical trial based on longitudinal outcomes and a continuous covariate","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Smoothing; Mixed model; Clinical trial; Statistics; Randomized controlled trial; Mathematics; Medicine; Computer science; Internal medicine","score_opus":0.6259681310711347,"score_gpt":0.6463079348273147,"score_spread":0.020339803756180053,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3012516591","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01429376,0.0005154491,0.98352367,0.0005306951,0.00006545258,0.00038237314,0.000239953,0.00018298236,0.0002656182],"genre_scores_gemma":[0.38096163,0.0010226431,0.6058091,0.00097121065,0.00026310087,0.0058967182,0.0015764884,0.00011830594,0.0033806863],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.965327,0.028487304,0.0011817098,0.002945736,0.0014792053,0.000579042],"domain_scores_gemma":[0.91778296,0.073299386,0.0035955464,0.0029296302,0.0016640016,0.0007284753],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.075314395,0.001682382,0.004796838,0.0025317122,0.00083042285,0.0023578485,0.0037151831,0.0031575044,0.0032464045],"category_scores_gemma":[0.08819273,0.0012272466,0.0038848915,0.002566525,0.0023382874,0.003193943,0.0024182575,0.003895082,0.0006091267],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0045490926,0.0005226108,0.026484793,0.0018331112,0.0039204373,0.0013848066,0.0014453733,0.44993675,0.004684986,0.32616892,0.0038978083,0.17517133],"study_design_scores_gemma":[0.0004422578,0.00077431725,0.0022261343,0.00013324479,0.0005537071,0.0001985455,0.00007740839,0.8733759,0.0008728325,0.11914106,0.002138343,0.00006627193],"about_ca_topic_score_codex":0.002024999,"about_ca_topic_score_gemma":0.0017199364,"teacher_disagreement_score":0.075314395,"about_ca_system_score_codex":0.0013938759,"about_ca_system_score_gemma":0.0034009023,"threshold_uncertainty_score":0.39830536},"labels":[],"label_agreement":null},{"id":"W3012656410","doi":"10.1177/0962280220902794","title":"Comparing two counterfactual-outcome approaches in causal mediation analysis of a multicategorical exposure: An application for the estimation of the effect of maternal intake of inhaled corticosteroids doses on birthweight","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre Hospitalier de l’Université de Montréal; Université de Montréal; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Counterfactual thinking; Categorical variable; Mediation; Marginal structural model; Econometrics; Robustness (evolution); Causal inference; Regression; Medicine; Regression analysis; Outcome (game theory); Statistics; Psychology; Mathematics; Social psychology","score_opus":0.435067383054229,"score_gpt":0.5923306492432306,"score_spread":0.15726326618900166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3012656410","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022223856,0.00093827426,0.97396696,0.0009124223,0.00013225335,0.0004832925,0.00013659082,0.000102801954,0.0011035395],"genre_scores_gemma":[0.341972,0.00091389206,0.6515383,0.00063420204,0.00010816269,0.0033977628,0.00024309628,0.000098212186,0.0010943444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79307884,0.19652721,0.0017794471,0.0040013017,0.003792712,0.000820471],"domain_scores_gemma":[0.5857799,0.3944582,0.0053503113,0.011922744,0.0020835176,0.00040522416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16389862,0.0015408964,0.0022056638,0.002424815,0.00097235217,0.002661424,0.005066837,0.0029644477,0.0063317833],"category_scores_gemma":[0.29495877,0.00094677793,0.0048119854,0.0028940963,0.0036453304,0.0033036831,0.006189446,0.0042136586,0.00039344223],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025447556,0.0009449829,0.030006198,0.0019310515,0.0065684807,0.0011470418,0.00393629,0.09124656,0.0013325679,0.668214,0.001549432,0.19057854],"study_design_scores_gemma":[0.0007627665,0.001667298,0.010741975,0.0005018579,0.0017647962,0.00043203545,0.0012895485,0.4852355,0.0018815527,0.48827282,0.007216933,0.00023292589],"about_ca_topic_score_codex":0.0042265113,"about_ca_topic_score_gemma":0.0025426198,"teacher_disagreement_score":0.16389862,"about_ca_system_score_codex":0.0017635906,"about_ca_system_score_gemma":0.0026125705,"threshold_uncertainty_score":0.8667891},"labels":[],"label_agreement":null},{"id":"W3030652012","doi":"10.1177/09622802221146313","title":"A generalization of moderated statistics to data adaptive semiparametric estimation in high-dimensional biology","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Environmental Health Sciences; Natural Sciences and Engineering Research Council of Canada; National Institute of Allergy and Infectious Diseases; National Science Foundation; National Cancer Institute; Fogarty International Center","keywords":"Estimator; Semiparametric regression; Computer science; Nonparametric statistics; Variance (accounting); Generalization; Semiparametric model; Parametric statistics; Econometrics; Curse of dimensionality; Statistics; Mathematics; Machine learning","score_opus":0.439192402014067,"score_gpt":0.6232240612529034,"score_spread":0.1840316592388364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3030652012","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010924028,0.00010722985,0.9984053,0.00014351717,0.000019817186,0.00001582043,0.000031525455,0.000049512288,0.00013484273],"genre_scores_gemma":[0.13918069,0.0007765083,0.8567157,0.00071714877,0.00032151584,0.00066817127,0.00033048136,0.00022288089,0.001066928],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98166645,0.01398797,0.0006534136,0.0016581535,0.0018215857,0.00021238861],"domain_scores_gemma":[0.9211974,0.064744994,0.0027406004,0.008048507,0.002816461,0.000452054],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031249054,0.0010728058,0.0014662218,0.0018289115,0.00057022274,0.0018176395,0.002668208,0.001634009,0.0014275856],"category_scores_gemma":[0.12294456,0.00088868564,0.002389958,0.0020379983,0.0046745287,0.0024242569,0.0045010773,0.004541457,0.0004952566],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011057719,0.000057873996,0.0038771408,0.00039553057,0.00037225892,0.00022527926,0.0005312739,0.14081803,0.0038573598,0.73543787,0.0021640097,0.11215282],"study_design_scores_gemma":[0.000033534234,0.00010107108,0.0011300253,0.000074453324,0.000050467657,0.00011661123,0.000034576427,0.4729747,0.001239372,0.5197244,0.0044664815,0.000054316573],"about_ca_topic_score_codex":0.0012911027,"about_ca_topic_score_gemma":0.0011588903,"teacher_disagreement_score":0.031249054,"about_ca_system_score_codex":0.0010701877,"about_ca_system_score_gemma":0.001937958,"threshold_uncertainty_score":0.16526282},"labels":[],"label_agreement":null},{"id":"W3031396609","doi":"10.1177/0962280220925840","title":"Robust bivariate random-effects model for accommodating outlying and influential studies in meta-analysis of diagnostic test accuracy studies","year":2020,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Bivariate analysis; Random effects model; Statistics; Weighting; Point estimation; Inference; Mathematics; Confidence interval; Econometrics; Meta-analysis; Computer science; Artificial intelligence; Medicine","score_opus":0.8395150209186724,"score_gpt":0.7124022221931562,"score_spread":0.12711279872551617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3031396609","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014925266,0.002400368,0.99484766,0.0003095563,0.00007548059,0.00022537565,0.00016601368,0.00022810974,0.00025487653],"genre_scores_gemma":[0.13457295,0.0057071312,0.8503318,0.0011526627,0.00032626244,0.004373314,0.0010599042,0.00038869563,0.00208733],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.940826,0.048048344,0.0025735113,0.004450158,0.0034770546,0.00062497216],"domain_scores_gemma":[0.92465687,0.06582517,0.0033656168,0.0035907258,0.002266763,0.00029497838],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.089153774,0.0028435234,0.0053007356,0.0060771215,0.00083758147,0.0035236878,0.0063478663,0.003794111,0.0035402388],"category_scores_gemma":[0.14509451,0.001888156,0.009216029,0.0066366256,0.002214781,0.0036162261,0.0031747737,0.004483425,0.00078950706],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010568192,0.00018147806,0.010193564,0.006067735,0.013456574,0.0015073986,0.0010870912,0.5034568,0.0023188698,0.23614016,0.007163773,0.21736974],"study_design_scores_gemma":[0.0006314749,0.00035402804,0.0026798411,0.0010774498,0.0074165193,0.0006746017,0.0000871061,0.72803485,0.0015560308,0.2445798,0.012671095,0.000237233],"about_ca_topic_score_codex":0.008055938,"about_ca_topic_score_gemma":0.0058830874,"teacher_disagreement_score":0.91084623,"about_ca_system_score_codex":0.0021495486,"about_ca_system_score_gemma":0.0046761353,"threshold_uncertainty_score":0.47149587},"labels":[],"label_agreement":null},{"id":"W3041396397","doi":"10.1177/0962280220932962","title":"Mixed-effects models for the design and analysis of stepped wedge cluster randomized trials: An overview","year":2020,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":206,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital","funders":"National Center for Advancing Translational Sciences; National Institute on Drug Abuse; National Institute for Health and Care Research","keywords":"Computer science; Confounding; Research design; Cluster (spacecraft); Clinical study design; Econometrics; Management science; Risk analysis (engineering); Data science; Operations research; Medicine; Statistics; Mathematics; Clinical trial; Engineering","score_opus":0.9463831388066777,"score_gpt":0.7778418496968618,"score_spread":0.16854128910981592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3041396397","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002661482,0.21070987,0.7805289,0.0022675518,0.0010022613,0.0011803455,0.0005787741,0.00036366927,0.0031025298],"genre_scores_gemma":[0.016116733,0.19087447,0.7757669,0.0024438212,0.0015644489,0.010721239,0.00078345335,0.00028583247,0.0014431063],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.93182796,0.057073154,0.0036165207,0.0021339946,0.0049906652,0.00035770243],"domain_scores_gemma":[0.88839793,0.101745896,0.0043723136,0.0024247058,0.002745556,0.0003135776],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.054628056,0.003972836,0.0069293394,0.0050962386,0.0006784623,0.0040927064,0.0062441495,0.004984868,0.009014885],"category_scores_gemma":[0.1008005,0.0018378621,0.006918975,0.0075228647,0.0027733846,0.00389157,0.0024237575,0.008338206,0.0034718583],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003047025,0.00013944523,0.0006106828,0.031188592,0.002654319,0.00020832279,0.0005033607,0.02688253,0.0003493131,0.641744,0.021777755,0.27363697],"study_design_scores_gemma":[0.00045472593,0.00044357244,0.00048544796,0.013636978,0.0018336092,0.00044320716,0.00012797007,0.05088254,0.0006888653,0.7855474,0.14524466,0.00021106827],"about_ca_topic_score_codex":0.002436043,"about_ca_topic_score_gemma":0.002262274,"teacher_disagreement_score":0.9453719,"about_ca_system_score_codex":0.004381355,"about_ca_system_score_gemma":0.006819952,"threshold_uncertainty_score":0.28890425},"labels":[],"label_agreement":null},{"id":"W3042988590","doi":"10.1177/0962280220938418","title":"Random effects models for complex designs","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Grains Research and Development Corporation","keywords":"Variety (cybernetics); Variance (accounting); Computer science; Set (abstract data type); Row; Table (database); Block (permutation group theory); Algorithm; Data mining; Statistics; Mathematics; Artificial intelligence","score_opus":0.7962302970634183,"score_gpt":0.7196117283011839,"score_spread":0.07661856876223438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3042988590","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009059846,0.0015727303,0.9914198,0.00056430156,0.00063932006,0.0019594992,0.0006190189,0.00046654887,0.001852849],"genre_scores_gemma":[0.02774936,0.0019680834,0.9435075,0.0007568663,0.0005346383,0.021073507,0.0007270789,0.00018624024,0.0034967952],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8198647,0.15107125,0.0053461455,0.0112501765,0.0107029565,0.0017648151],"domain_scores_gemma":[0.7057664,0.2647509,0.0103267515,0.01218871,0.0062849005,0.00068238867],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.142043,0.006511052,0.007207597,0.005528948,0.001707787,0.0055373334,0.008133709,0.0080484925,0.034393676],"category_scores_gemma":[0.20870595,0.0029521103,0.007046172,0.00583368,0.0058250693,0.0062208497,0.0046042562,0.010770079,0.0051777894],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006736229,0.0003014384,0.0014255524,0.003356022,0.0015333041,0.00033828046,0.0008611689,0.1067618,0.00045023847,0.7824966,0.011702518,0.090099454],"study_design_scores_gemma":[0.0010443616,0.0008701869,0.00075843115,0.0008672193,0.00046614138,0.00016103624,0.00013918568,0.2526851,0.00044984865,0.70534605,0.037025727,0.00018673194],"about_ca_topic_score_codex":0.0049535763,"about_ca_topic_score_gemma":0.004928042,"teacher_disagreement_score":0.142043,"about_ca_system_score_codex":0.005605184,"about_ca_system_score_gemma":0.005732999,"threshold_uncertainty_score":0.75120413},"labels":[],"label_agreement":null},{"id":"W3045459365","doi":"10.1177/0962280220941874","title":"Relative efficiencies of alternative preference-based designs for randomised trials","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Preference; Selection (genetic algorithm); Clinical trial; Medicine; Treatment effect; Randomized controlled trial; Computer science; Statistics; Mathematics; Machine learning; Surgery; Internal medicine","score_opus":0.9296075659363878,"score_gpt":0.6965327909158466,"score_spread":0.2330747750205412,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3045459365","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009412851,0.004227073,0.97629136,0.00112993,0.0003444955,0.004738318,0.00030556056,0.0002049172,0.0033454655],"genre_scores_gemma":[0.16490544,0.0030576182,0.8041506,0.0009863417,0.0003418974,0.024601247,0.00032021827,0.00016658808,0.0014700772],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.17639127,0.7757141,0.017130664,0.007528264,0.02199605,0.0012395844],"domain_scores_gemma":[0.12601085,0.8139669,0.01880931,0.032373857,0.00801647,0.0008226423],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.611475,0.0044248896,0.008788645,0.0060041137,0.0010458018,0.008054106,0.006344853,0.0069157393,0.009694467],"category_scores_gemma":[0.7518943,0.0038875183,0.009394094,0.0062554623,0.009336985,0.012443886,0.009124805,0.008281383,0.0013562002],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009945573,0.0004123088,0.0042408025,0.0077577517,0.007211344,0.0001976776,0.0016021136,0.07026661,0.0006856054,0.6931215,0.0018299766,0.20272885],"study_design_scores_gemma":[0.0077719297,0.0046020276,0.00342153,0.0024978733,0.0029297157,0.00046711115,0.00032243907,0.19475839,0.0020966118,0.771234,0.009545235,0.00035308176],"about_ca_topic_score_codex":0.0007524929,"about_ca_topic_score_gemma":0.000518535,"teacher_disagreement_score":0.388525,"about_ca_system_score_codex":0.0061658057,"about_ca_system_score_gemma":0.006684839,"threshold_uncertainty_score":0.47912055},"labels":[],"label_agreement":null},{"id":"W3067784497","doi":"10.1177/0962280220948159","title":"Model-robust designs for nonlinear quantile regression","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Quantile regression; Quantile; Statistics; Computer science; Nonlinear regression; Nonlinear system; Econometrics; Regression; Regression analysis; Mathematics","score_opus":0.7951379235756372,"score_gpt":0.7090320201533811,"score_spread":0.0861059034222561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3067784497","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017764646,0.00008200552,0.99744165,0.000054028933,0.000022324162,0.00024016076,0.0000470362,0.00008183911,0.00025439655],"genre_scores_gemma":[0.08263521,0.00020785099,0.91267693,0.00013515168,0.000059017948,0.0033153384,0.00015669856,0.000077241435,0.000736542],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9404145,0.049959812,0.0011641281,0.0032031373,0.0046288576,0.00062964554],"domain_scores_gemma":[0.9481903,0.034884494,0.0061796163,0.007105464,0.0031962818,0.00044393164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05255911,0.0017807472,0.0021938612,0.0014190206,0.0005140746,0.0014274496,0.0028645534,0.0021847426,0.005639582],"category_scores_gemma":[0.10325348,0.0010923279,0.002278046,0.0012609505,0.0024466224,0.0016952795,0.00281105,0.0027566813,0.0015975572],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018572354,0.00048660772,0.0033413568,0.0012823531,0.0008247289,0.00013522792,0.0004939717,0.27780607,0.0077830846,0.53235185,0.0027445413,0.17089288],"study_design_scores_gemma":[0.00113912,0.0022702813,0.0018975197,0.00020520278,0.0002589303,0.000093820556,0.00006515938,0.6929358,0.005333241,0.28701186,0.008653299,0.00013581029],"about_ca_topic_score_codex":0.00063605903,"about_ca_topic_score_gemma":0.00067122345,"teacher_disagreement_score":0.05255911,"about_ca_system_score_codex":0.0015169805,"about_ca_system_score_gemma":0.00247673,"threshold_uncertainty_score":0.27796245},"labels":[],"label_agreement":null},{"id":"W3088077156","doi":"10.1177/0962280220951834","title":"Pattern discovery of health curves using an ordered probit model with Bayesian smoothing and functional principal component analysis","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia; Actua; Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Principal component analysis; Bayesian probability; Functional principal component analysis; Econometrics; Smoothing; Component (thermodynamics); Probit model; Functional data analysis; Statistics; Mathematics; Ordered probit; Computer science; Physics","score_opus":0.45791737199466426,"score_gpt":0.5783035747154114,"score_spread":0.12038620272074713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3088077156","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018839758,0.00020430888,0.97884345,0.00057435606,0.00002311647,0.00012681387,0.00037088007,0.00037153778,0.00064582773],"genre_scores_gemma":[0.47324312,0.0006500356,0.5188756,0.00029976203,0.00013403733,0.000787091,0.0020106204,0.00024296662,0.0037567704],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99341774,0.0043380493,0.00031617595,0.0010229921,0.000619297,0.00028574525],"domain_scores_gemma":[0.96434313,0.02963719,0.002230523,0.0020485742,0.0013378997,0.00040263947],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011921339,0.0011302701,0.0018895837,0.0037063216,0.00097466214,0.002521129,0.0025271634,0.0019825774,0.003367139],"category_scores_gemma":[0.05075823,0.0010481442,0.0027829516,0.0032545712,0.0018771322,0.0023951079,0.002285421,0.0035546299,0.00078798615],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003081424,0.00024983348,0.031886775,0.000419066,0.000542641,0.00062329305,0.0011319304,0.6195767,0.0010761699,0.19754454,0.0043835263,0.14225738],"study_design_scores_gemma":[0.000017046343,0.000028178096,0.001937347,0.000039579958,0.00002637758,0.000056092733,0.000054535656,0.9260592,0.0001732614,0.070589386,0.0009866693,0.000032292115],"about_ca_topic_score_codex":0.02715747,"about_ca_topic_score_gemma":0.020719096,"teacher_disagreement_score":0.02715747,"about_ca_system_score_codex":0.0019107488,"about_ca_system_score_gemma":0.0028782317,"threshold_uncertainty_score":0.06304675},"labels":[],"label_agreement":null},{"id":"W3109789378","doi":"10.1177/09622802211032713","title":"General regression methods for respondent-driven sampling data","year":2021,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"HIV, Drug Use, Sexual Risk","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Institut National de Santé Publique du Québec; Public Health Ontario; University of Toronto; Toronto Metropolitan University; McGill University","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Homophily; Multivariate statistics; Respondent; Sampling (signal processing); Covariate; Regression; Psychology; Sample (material); Econometrics; Statistics; Computer science; Social psychology; Mathematics; Political science","score_opus":0.6374063881264357,"score_gpt":0.7194754488290467,"score_spread":0.082069060702611,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3109789378","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010057556,0.00014547816,0.9965641,0.00019544402,0.00006543321,0.0006268497,0.0005635333,0.0005573202,0.00027602876],"genre_scores_gemma":[0.030130737,0.0006049865,0.95636106,0.00034801904,0.0001865345,0.007435623,0.002145236,0.00038184013,0.0024060134],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90480417,0.082984954,0.0022691595,0.0051863473,0.00405718,0.0006981226],"domain_scores_gemma":[0.82894415,0.13536745,0.006194345,0.02297069,0.0059738094,0.0005496311],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08813384,0.0024561419,0.0029710087,0.0038697547,0.0010854232,0.0026655875,0.007231874,0.0034819827,0.012844313],"category_scores_gemma":[0.21567996,0.001717867,0.0044809827,0.007442393,0.002312239,0.0029721204,0.0036694363,0.0061653415,0.006014809],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004364191,0.00046532662,0.016409343,0.0019952569,0.0023797469,0.0005028181,0.0021013045,0.1205549,0.0014232993,0.4588897,0.03060082,0.36424103],"study_design_scores_gemma":[0.00037723785,0.00036183037,0.0051956223,0.00047629105,0.00028312718,0.0003347426,0.00045586986,0.6076501,0.0009926663,0.3415653,0.042156328,0.00015088009],"about_ca_topic_score_codex":0.0061713224,"about_ca_topic_score_gemma":0.0052275076,"teacher_disagreement_score":0.08813384,"about_ca_system_score_codex":0.0019933395,"about_ca_system_score_gemma":0.0029049418,"threshold_uncertainty_score":0.46610188},"labels":[],"label_agreement":null},{"id":"W3120262376","doi":"10.1177/09622802211046383","title":"Modeling treatment effect modification in multidrug-resistant tuberculosis in an individual patientdata meta-analysis","year":2021,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University","funders":"Canadian Institutes of Health Research","keywords":"Observational study; Meta-analysis; Covariate; Confounding; Random effects model; Context (archaeology); Marginal structural model; Estimator; Econometrics; Computer science; Medicine; Treatment effect; Statistics; Mathematics; Internal medicine; Biology","score_opus":0.7887158097793469,"score_gpt":0.6989781964767243,"score_spread":0.08973761330262253,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3120262376","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029327122,0.94838333,0.045867946,0.0012155748,0.00025196714,0.0002988824,0.00037802334,0.00013535212,0.00053616747],"genre_scores_gemma":[0.15788932,0.75102115,0.08431534,0.0017506048,0.0006466119,0.0019125547,0.0012937512,0.00015910505,0.0010116425],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.9670707,0.028823216,0.0017748693,0.0009498007,0.0011767374,0.00020467397],"domain_scores_gemma":[0.9382263,0.058108166,0.0017132577,0.0010960472,0.0007439536,0.000112296526],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.037298057,0.0021012053,0.009170888,0.0039870352,0.0002299349,0.0026340843,0.0031291232,0.0023313165,0.002233986],"category_scores_gemma":[0.07876547,0.001164515,0.016779833,0.004116938,0.00056555215,0.0016895239,0.0015269963,0.0028666107,0.0003121292],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018763861,0.00015402572,0.0053711403,0.16020237,0.41337153,0.00028548535,0.00022419587,0.053964317,0.0006567989,0.017818354,0.004755318,0.34132013],"study_design_scores_gemma":[0.0027088542,0.0011879926,0.01122822,0.04824569,0.67197496,0.0009087749,0.00016834917,0.093553096,0.0021146734,0.11513107,0.052520122,0.00025817024],"about_ca_topic_score_codex":0.0034734905,"about_ca_topic_score_gemma":0.0051554004,"teacher_disagreement_score":0.9908291,"about_ca_system_score_codex":0.0019966995,"about_ca_system_score_gemma":0.0032645152,"threshold_uncertainty_score":0.19725335},"labels":[],"label_agreement":null},{"id":"W3123045227","doi":"10.1177/0962280220986193","title":"Clustered longitudinal data subject to irregular observation","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Urban Transport and Accessibility","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"St. Michael's Hospital; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Cluster analysis; Econometrics; Random effects model; Computer science; Outcome (game theory); Statistics; Parametric statistics; Mathematics; Medicine","score_opus":0.5085080922538269,"score_gpt":0.6444488331804581,"score_spread":0.13594074092663122,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3123045227","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11570872,0.0012699346,0.86538994,0.0014708855,0.000653581,0.0006398812,0.01097269,0.0011250557,0.0027694004],"genre_scores_gemma":[0.77455693,0.0012756315,0.19774401,0.00078484975,0.00043652148,0.002454442,0.015240752,0.00023281657,0.0072740223],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98166704,0.009615846,0.0015331475,0.0045508393,0.0018396523,0.0007935536],"domain_scores_gemma":[0.90821874,0.051352933,0.012285245,0.020617522,0.0066876067,0.0008378595],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036193065,0.0007191895,0.0019589998,0.002508529,0.0012116532,0.0024260068,0.0040608896,0.0024087697,0.0040537603],"category_scores_gemma":[0.095206074,0.0011271412,0.0015957252,0.0064454693,0.002106895,0.0020566736,0.0027148472,0.0021179314,0.0009829669],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008546551,0.00028542033,0.24570745,0.0013513248,0.0020207923,0.0020891808,0.0023180966,0.3831848,0.0014062494,0.21790491,0.020689905,0.12218722],"study_design_scores_gemma":[0.00020242912,0.00035576595,0.065700285,0.0003601622,0.0005114358,0.0008507034,0.00092574,0.6918041,0.00087233685,0.21610662,0.022110298,0.00020007227],"about_ca_topic_score_codex":0.01673418,"about_ca_topic_score_gemma":0.011750253,"teacher_disagreement_score":0.036193065,"about_ca_system_score_codex":0.0029398075,"about_ca_system_score_gemma":0.002395795,"threshold_uncertainty_score":0.19140947},"labels":[],"label_agreement":null},{"id":"W3132771408","doi":"10.1177/0962280220983587","title":"Marginal analysis of bivariate mixed responses with measurement error and misclassification","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Western University; University of Waterloo","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Bivariate analysis; Computer science; Estimator; Binary number; Observational error; Statistics; Component (thermodynamics); Binary data; Econometrics; Data mining; Mathematics","score_opus":0.16133991538509762,"score_gpt":0.498852410879384,"score_spread":0.33751249549428636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3132771408","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026176414,0.0004928391,0.9721807,0.00024678346,0.000045059336,0.00011188662,0.00023043432,0.00014074607,0.00037513315],"genre_scores_gemma":[0.6994938,0.0010007222,0.2921169,0.00046112307,0.0002056138,0.000972664,0.001019521,0.000113708615,0.0046158093],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98100156,0.014364049,0.0005976339,0.0024559838,0.0011164186,0.00046432676],"domain_scores_gemma":[0.923471,0.06268376,0.004817686,0.0065275575,0.0020568294,0.0004431546],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.042550545,0.0011022,0.0018318745,0.0014983674,0.00054615206,0.0015263277,0.0026096015,0.0012797541,0.0034689247],"category_scores_gemma":[0.0782577,0.0006829444,0.002328684,0.0014258777,0.002384414,0.001488145,0.0023055936,0.0016757444,0.00039638812],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015656153,0.00031857967,0.095350504,0.0011738583,0.0032921908,0.0011985715,0.0019203838,0.21106783,0.0037804157,0.41040298,0.0037203918,0.26620868],"study_design_scores_gemma":[0.000110043264,0.0003405808,0.021683436,0.00020009915,0.000646511,0.0004619965,0.00032218875,0.7474922,0.002912738,0.21977831,0.0059324615,0.000119321594],"about_ca_topic_score_codex":0.0029478678,"about_ca_topic_score_gemma":0.0020938413,"teacher_disagreement_score":0.042550545,"about_ca_system_score_codex":0.001104886,"about_ca_system_score_gemma":0.0013483204,"threshold_uncertainty_score":0.2250315},"labels":[],"label_agreement":null},{"id":"W3137061630","doi":"10.1177/0962280221997505","title":"Variable selection for causal mediation analysis using LASSO-based methods","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Propensity score matching; Estimator; Lasso (programming language); Inverse probability weighting; Causal inference; Weighting; Econometrics; Computer science; Statistics; Regularization (linguistics); Marginal structural model; Mediation; Mathematics; Artificial intelligence; Medicine","score_opus":0.5215065702757662,"score_gpt":0.7100065237874281,"score_spread":0.18849995351166193,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137061630","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011347418,0.00019968933,0.9971409,0.00019067324,0.00003541864,0.00013117895,0.00037944282,0.00035677748,0.00043122986],"genre_scores_gemma":[0.04844179,0.0005555965,0.9436929,0.00033382457,0.00016424456,0.0023095142,0.0025521144,0.000519831,0.0014300884],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98428303,0.012653438,0.00057180505,0.0009559317,0.0012878553,0.00024798774],"domain_scores_gemma":[0.97696507,0.018121816,0.0012411727,0.001930792,0.0014867656,0.000254454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022266526,0.001403852,0.002447273,0.002103477,0.0009934391,0.002348824,0.0028834327,0.0015257195,0.009985182],"category_scores_gemma":[0.046286825,0.00070666854,0.002466434,0.0030398865,0.0011128257,0.0014176934,0.0029524164,0.0037312876,0.0017359136],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065472815,0.00034080594,0.0062976936,0.0014653452,0.0009031346,0.0005295467,0.0005249629,0.2712654,0.0023142986,0.2818508,0.0505549,0.38329837],"study_design_scores_gemma":[0.00018428838,0.00005426326,0.0005031339,0.00008918643,0.00006769583,0.000078002624,0.000051722305,0.86086255,0.00086254586,0.12764283,0.009572836,0.000030938332],"about_ca_topic_score_codex":0.002066535,"about_ca_topic_score_gemma":0.0026653758,"teacher_disagreement_score":0.022266526,"about_ca_system_score_codex":0.00081688986,"about_ca_system_score_gemma":0.003664887,"threshold_uncertainty_score":0.117758036},"labels":[],"label_agreement":null},{"id":"W3154875751","doi":"10.1177/09622802211002861","title":"A method for systematically ranking therapeutic drug candidates using multiple uncertain screening criteria","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Computational Drug Discovery Methods","field":"Computer Science","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Genome British Columbia; University of British Columbia","funders":"Alberta Prion Research Institute; Canadian Institutes of Health Research","keywords":"Ranking (information retrieval); Computer science; Robustness (evolution); Data mining; Machine learning; Artificial intelligence","score_opus":0.23236172444489472,"score_gpt":0.5975037064072967,"score_spread":0.36514198196240194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3154875751","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022945576,0.00011606161,0.99624443,0.00010044984,0.000025907144,0.00010940643,0.0001653799,0.00050682144,0.00043693758],"genre_scores_gemma":[0.060310908,0.000121805955,0.9376654,0.000105176194,0.000058475256,0.00039731426,0.00048118053,0.00011336123,0.0007463919],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9949314,0.0020267032,0.000446312,0.0007195561,0.0017019733,0.00017399417],"domain_scores_gemma":[0.98049796,0.014105467,0.001237386,0.001409401,0.0024356875,0.00031416706],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00859765,0.0018774807,0.0020923493,0.006502735,0.0012715438,0.0021942703,0.0016394929,0.0016723322,0.0049592513],"category_scores_gemma":[0.02896574,0.0008542715,0.0020535628,0.0040882365,0.0011530663,0.0015649989,0.0020275523,0.0024540375,0.0011785844],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043365455,0.00028298667,0.006710331,0.000758929,0.00064992096,0.00024225687,0.00025857482,0.28776655,0.008745109,0.037967954,0.010056549,0.64612716],"study_design_scores_gemma":[0.000127305,0.00020458693,0.0011276045,0.00007671016,0.00013204417,0.0002089727,0.000046108224,0.94835234,0.0035172103,0.041897304,0.0042431927,0.000066657114],"about_ca_topic_score_codex":0.0028238425,"about_ca_topic_score_gemma":0.003910085,"teacher_disagreement_score":0.00859765,"about_ca_system_score_codex":0.0011313694,"about_ca_system_score_gemma":0.003405819,"threshold_uncertainty_score":0.045469284},"labels":[],"label_agreement":null},{"id":"W3154888856","doi":"10.1177/09622802211003620","title":"Calibration of surgical tools using multilevel modeling with LINEX loss function: Theory and experiment","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Surgical Simulation and Training","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Aga Khan Foundation","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Exponential function; Bayesian probability; Computer science; Calibration; Function (biology); Mean squared error; Likelihood function; Linear model; Multilevel model; Statistics; Mathematics; Algorithm; Artificial intelligence; Machine learning; Estimation theory","score_opus":0.34924827873567577,"score_gpt":0.5901490617878591,"score_spread":0.24090078305218332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3154888856","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20332329,0.0001891801,0.7934437,0.00036694665,0.000044257995,0.00013262586,0.00014704053,0.0005174573,0.0018354561],"genre_scores_gemma":[0.88690704,0.00011512693,0.11169033,0.00010305799,0.000012693727,0.00017880302,0.00013476542,0.00008834576,0.00076993584],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981299,0.00070752046,0.00008655954,0.00034982074,0.0005857898,0.00014054235],"domain_scores_gemma":[0.9939932,0.0036694994,0.0007993508,0.00082295947,0.0005924311,0.00012246278],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036907413,0.00058099837,0.0006905701,0.00061394746,0.0003909494,0.00096439227,0.0013754861,0.0015078175,0.0019081116],"category_scores_gemma":[0.014005391,0.00047434305,0.0009431819,0.0007838554,0.000806914,0.0012789608,0.0016529661,0.0012402099,0.00045190216],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080211007,0.0005550456,0.011848903,0.00027016707,0.00015924557,0.00013710125,0.00047355198,0.82287633,0.041775227,0.011509464,0.0014275673,0.10816524],"study_design_scores_gemma":[0.000021357833,0.00021047085,0.0020353005,0.000014416964,0.00001613441,0.000022555465,0.000026676651,0.99008864,0.0047381287,0.002511598,0.00028409733,0.000030651452],"about_ca_topic_score_codex":0.0030784092,"about_ca_topic_score_gemma":0.0020903053,"teacher_disagreement_score":0.0036907413,"about_ca_system_score_codex":0.0007393168,"about_ca_system_score_gemma":0.00071370415,"threshold_uncertainty_score":0.019518673},"labels":[],"label_agreement":null},{"id":"W3156127058","doi":"10.1177/09622802211002867","title":"Predictive performance of machine and statistical learning methods: Impact of data-generating processes on external validity in the “large N, small p” setting","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":74,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Sunnybrook Health Science Centre","funders":"National Center for Advancing Translational Sciences; Canadian Institutes of Health Research; National Institutes of Health; Ontario Ministry of Health and Long-Term Care; Georgia Clinical and Translational Science Alliance; Heart and Stroke Foundation of Canada","keywords":"Brier score; Machine learning; Random forest; Artificial intelligence; Logistic regression; Lasso (programming language); Computer science; Regression; Statistic; Gradient boosting; Sample size determination; Statistics; Mathematics","score_opus":0.25922347666239887,"score_gpt":0.6037200504579326,"score_spread":0.3444965737955338,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3156127058","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.66534126,0.0019300182,0.3248189,0.0031569134,0.00022229535,0.00054948864,0.00052181975,0.0004560691,0.0030032147],"genre_scores_gemma":[0.9690702,0.00017040862,0.029560719,0.00034285177,0.00005527337,0.00020081761,0.0003670797,0.000050846942,0.00018189636],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9311699,0.05540435,0.002346374,0.0048476667,0.0052899877,0.000941621],"domain_scores_gemma":[0.46076822,0.48735535,0.014903736,0.028597318,0.007024448,0.0013508288],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14510114,0.0011769381,0.0011817485,0.0014051902,0.0014930725,0.0028093744,0.002221342,0.0023635782,0.000724477],"category_scores_gemma":[0.35707667,0.00063205406,0.001502978,0.0012550516,0.0059950934,0.004424081,0.0031845202,0.003757482,0.00018568373],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022175428,0.0005542612,0.23374055,0.0004238366,0.0012397802,0.0007032985,0.0008341354,0.6602946,0.0018680957,0.034923434,0.0018956005,0.06130481],"study_design_scores_gemma":[0.00020111937,0.0006120049,0.01885801,0.00013390376,0.00011120062,0.00021120794,0.0001933464,0.9416933,0.004119608,0.033028305,0.0007711488,0.00006677005],"about_ca_topic_score_codex":0.0037901895,"about_ca_topic_score_gemma":0.0020392246,"teacher_disagreement_score":0.85489887,"about_ca_system_score_codex":0.0015619313,"about_ca_system_score_gemma":0.002456919,"threshold_uncertainty_score":0.7673774},"labels":[],"label_agreement":null},{"id":"W3160907971","doi":"10.1177/09622802211009265","title":"Functional joint models for chronic kidney disease in kidney transplant recipients","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"","keywords":"Kidney disease; Renal function; Kidney transplantation; Medicine; Kidney; Transplantation; Intensive care medicine; Internal medicine","score_opus":0.3647057370632163,"score_gpt":0.5578741015699356,"score_spread":0.19316836450671926,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3160907971","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027162587,0.0017597382,0.96364903,0.0021490392,0.00026746487,0.00010538349,0.0009444421,0.0001932883,0.003769103],"genre_scores_gemma":[0.8504935,0.0038487418,0.108542636,0.0009578806,0.0007072759,0.0016680595,0.0034680145,0.00020300903,0.030110812],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99642485,0.001986972,0.00014531447,0.00061139255,0.000373336,0.00045820692],"domain_scores_gemma":[0.9946026,0.0033951167,0.00064382935,0.00028040982,0.00072861626,0.0003493866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0072369175,0.0019659007,0.0021033029,0.0015588966,0.0006960943,0.0021024034,0.00369848,0.002334386,0.006125562],"category_scores_gemma":[0.010110683,0.0007524495,0.002866747,0.0014997135,0.0017807863,0.0025735842,0.0027069475,0.002876843,0.0008685403],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014950642,0.0001310516,0.010477846,0.0002264038,0.00034670666,0.00041034826,0.0003637894,0.60745865,0.00040079228,0.3547941,0.0046608252,0.020579917],"study_design_scores_gemma":[0.000032181713,0.0000883998,0.0013454201,0.00003810079,0.000093753726,0.00008341357,0.000075341064,0.8962372,0.00007399539,0.09956217,0.0023308233,0.000039236078],"about_ca_topic_score_codex":0.017710937,"about_ca_topic_score_gemma":0.01422536,"teacher_disagreement_score":0.017710937,"about_ca_system_score_codex":0.0020647047,"about_ca_system_score_gemma":0.002705371,"threshold_uncertainty_score":0.038272917},"labels":[],"label_agreement":null},{"id":"W3178431826","doi":"10.1177/09622802211008945","title":"A competing risks model with binary time varying covariates for estimation of breast cancer risks in <i>BRCA1</i> families","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"BRCA gene mutations in cancer","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital; Western University","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; National Center for Advancing Translational Sciences; Canadian Cancer Society","keywords":"Covariate; Breast cancer; Medicine; Estimator; Ovarian cancer; Prophylactic Surgery; Oncology; Statistics; Cancer; Econometrics; Internal medicine; Mathematics","score_opus":0.11853154554642018,"score_gpt":0.528629270064907,"score_spread":0.4100977245184868,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3178431826","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06120457,0.00072858675,0.93541116,0.00087441533,0.000105799416,0.00022598132,0.0007521721,0.0002334687,0.00046388127],"genre_scores_gemma":[0.66272366,0.0013341266,0.32639304,0.0005449411,0.00023584253,0.0015744937,0.0022527142,0.00016604445,0.004775199],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98731136,0.010668189,0.00032322155,0.0009097493,0.0003852856,0.00040215024],"domain_scores_gemma":[0.9488126,0.046026602,0.0019856114,0.0015845454,0.000986647,0.00060396607],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028018296,0.0016309214,0.0022972177,0.0019428272,0.0008571902,0.001611359,0.004528879,0.0027525693,0.003692911],"category_scores_gemma":[0.04214598,0.0009802753,0.0036924619,0.0019999451,0.0013582355,0.0014574579,0.001873637,0.0036617056,0.0004762509],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001222733,0.00019421618,0.028191693,0.00045322633,0.0013021864,0.0012480756,0.00066503213,0.8338411,0.0011392934,0.09417004,0.0021675504,0.03540495],"study_design_scores_gemma":[0.00014696943,0.00020827119,0.0022585944,0.00005076202,0.00021931421,0.00021957328,0.0000638245,0.9736699,0.00019381248,0.021983992,0.0009274413,0.000057504392],"about_ca_topic_score_codex":0.014418103,"about_ca_topic_score_gemma":0.007640615,"teacher_disagreement_score":0.028018296,"about_ca_system_score_codex":0.0013688906,"about_ca_system_score_gemma":0.002253396,"threshold_uncertainty_score":0.14817667},"labels":[],"label_agreement":null},{"id":"W3182035769","doi":"10.1177/09622802211025989","title":"Estimation of ordinal population with multi-observer ranked set samples using ties information","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Categorical variable; Ordinal data; Ranking (information retrieval); Estimator; Statistics; Data mining; Ordinal regression; Computer science; Simple random sample; Data set; Sampling (signal processing); Population; Mathematics; Artificial intelligence","score_opus":0.5037992234895545,"score_gpt":0.6368357119655043,"score_spread":0.13303648847594973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3182035769","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041770536,0.00008701492,0.95720637,0.000052804604,0.00001640416,0.00014968346,0.00011467363,0.00010553074,0.0004970125],"genre_scores_gemma":[0.55380976,0.00016086813,0.4423869,0.00007880926,0.000041591953,0.0005786072,0.0010653832,0.000040715946,0.0018373714],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99196166,0.0058268625,0.00024539998,0.0007734113,0.00088100974,0.00031173843],"domain_scores_gemma":[0.9825973,0.012137078,0.0015482212,0.0018086908,0.0016596325,0.0002491084],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013025768,0.00079316134,0.0014618037,0.002072975,0.00080785336,0.0014276278,0.0024222373,0.0011130208,0.0020550848],"category_scores_gemma":[0.029007034,0.00068568735,0.0017728691,0.0017692518,0.0008404432,0.0016829772,0.0018553503,0.0012113266,0.0004373425],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009978478,0.00056900724,0.049868237,0.0004471459,0.00064723927,0.00045899616,0.00090975425,0.6139024,0.0037696757,0.066322826,0.0017755247,0.2603313],"study_design_scores_gemma":[0.000025415724,0.00011268918,0.0036396885,0.00001982384,0.000035027973,0.000039572642,0.00007078686,0.98452604,0.00085116795,0.010189445,0.00046146903,0.000028842638],"about_ca_topic_score_codex":0.0043303855,"about_ca_topic_score_gemma":0.0043224525,"teacher_disagreement_score":0.013025768,"about_ca_system_score_codex":0.0010410035,"about_ca_system_score_gemma":0.00088297564,"threshold_uncertainty_score":0.06888771},"labels":[],"label_agreement":null},{"id":"W3187850904","doi":"10.1177/09622802211034219","title":"The change in estimate method for selecting confounders: A simulation study","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; The Quebec Population Health Research Network","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Confounding; Statistics; Confidence interval; Estimator; Standard error; Computer science; Econometrics; Medicine; Mathematics","score_opus":0.7422332657896927,"score_gpt":0.7739657669283295,"score_spread":0.03173250113863679,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3187850904","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3774579,0.0025718869,0.6057291,0.002245697,0.00032045657,0.0023484905,0.0010713156,0.00036837434,0.007886819],"genre_scores_gemma":[0.8016229,0.0010581522,0.19295184,0.00032842372,0.00007424879,0.0022206956,0.0006192993,0.00008056709,0.0010438176],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9706652,0.026423682,0.0005640973,0.0006739981,0.0012059667,0.00046708147],"domain_scores_gemma":[0.65385264,0.32645145,0.00409206,0.008184131,0.0063654403,0.0010542993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043959208,0.0009579431,0.0013657861,0.0015068724,0.0006612968,0.0013217869,0.0019540584,0.0019368264,0.003986931],"category_scores_gemma":[0.15450503,0.0005323153,0.0022182,0.0016375872,0.0011750836,0.001866433,0.0015940928,0.0032000807,0.00033098567],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009080545,0.003297917,0.05530663,0.0018028946,0.00202633,0.00078499166,0.0011412834,0.7607966,0.0010750587,0.07586548,0.005689794,0.08313239],"study_design_scores_gemma":[0.001344987,0.0015835098,0.003411377,0.00024271234,0.00041381246,0.00023575603,0.00020372284,0.9704677,0.00084947195,0.019168139,0.0020084586,0.00007034848],"about_ca_topic_score_codex":0.008145616,"about_ca_topic_score_gemma":0.0037532146,"teacher_disagreement_score":0.043959208,"about_ca_system_score_codex":0.0019035772,"about_ca_system_score_gemma":0.002197824,"threshold_uncertainty_score":0.2324813},"labels":[],"label_agreement":null},{"id":"W3196511958","doi":"10.1177/09622802211037070","title":"A unified Bayesian framework for exact inference of area under the receiver operating characteristic curve","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Simon Fraser University","funders":"National Cancer Institute; National Heart, Lung, and Blood Institute; Cancer Prevention and Research Institute of Texas","keywords":"Receiver operating characteristic; Inference; Frequentist inference; Computer science; Bayesian probability; Gibbs sampling; Computation; Mathematics; Bayesian inference; Algorithm; Statistics; Mathematical optimization; Artificial intelligence","score_opus":0.3778272087755035,"score_gpt":0.6123346236579378,"score_spread":0.23450741488243426,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3196511958","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034534078,0.00025953286,0.9987571,0.00013056691,0.000019593715,0.000029029192,0.00005221614,0.0000697238,0.00033675565],"genre_scores_gemma":[0.07396292,0.0026716471,0.91813505,0.00050162245,0.0006236521,0.0008225192,0.00068007625,0.00019675185,0.002405768],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98861235,0.0066642095,0.00052625383,0.0017129019,0.0020957252,0.00038861835],"domain_scores_gemma":[0.9752034,0.018974483,0.0014445828,0.0015824394,0.0024201476,0.0003749018],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02122741,0.0018438594,0.0029138264,0.0050571593,0.0011255909,0.0033915592,0.0043327855,0.0022056564,0.0043803607],"category_scores_gemma":[0.059493594,0.0014774413,0.0028553759,0.0037403426,0.002963625,0.003287567,0.0028927715,0.004371004,0.0014571879],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000902867,0.000097494165,0.0021626528,0.00044307922,0.00032169715,0.00039371054,0.00037412203,0.30402505,0.0016514998,0.547565,0.0049361577,0.13793926],"study_design_scores_gemma":[0.000052052837,0.000071466726,0.0007114416,0.00011726339,0.000120042845,0.00023891909,0.000032966036,0.7206973,0.00047189507,0.26981425,0.007597737,0.00007469598],"about_ca_topic_score_codex":0.0100939255,"about_ca_topic_score_gemma":0.008847736,"teacher_disagreement_score":0.02122741,"about_ca_system_score_codex":0.0023271865,"about_ca_system_score_gemma":0.004937803,"threshold_uncertainty_score":0.11226261},"labels":[],"label_agreement":null},{"id":"W3200290661","doi":"10.1177/09622802211041759","title":"Flexible extension of the accelerated failure time model to account for nonlinear and time-dependent effects of covariates on the hazard","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"Fonds de Recherche du Québec - Santé; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Proportional hazards model; Accelerated failure time model; Hazard ratio; Hazard; Nonlinear system; Econometrics; Parametric statistics; Statistics; Survival analysis; Computer science; Mathematics; Confidence interval","score_opus":0.47478398657457216,"score_gpt":0.5943613382920601,"score_spread":0.1195773517174879,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3200290661","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012826903,0.00036909076,0.98505026,0.00039536567,0.00010744483,0.00008511372,0.00022621489,0.00016676063,0.00077298],"genre_scores_gemma":[0.6806705,0.0020541777,0.29866,0.0005158281,0.00052719633,0.0013188666,0.0013006001,0.00025898227,0.0146938255],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99455535,0.0032308688,0.00022141034,0.0007211662,0.00077474024,0.00049649284],"domain_scores_gemma":[0.984535,0.009640445,0.0015893526,0.0021473884,0.0015851415,0.0005026479],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016152736,0.0013588604,0.0019599183,0.0014004844,0.0005617006,0.0014885652,0.0037851017,0.0016619128,0.0050339447],"category_scores_gemma":[0.02538824,0.0007236163,0.003635638,0.001839813,0.0014770657,0.0022123693,0.0026134653,0.0044865953,0.0009861558],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047776097,0.00022447263,0.012116188,0.00041572494,0.00048532858,0.0011507332,0.0008315331,0.5804249,0.0031326772,0.2815625,0.005364541,0.11381362],"study_design_scores_gemma":[0.00013070619,0.00033913733,0.0028554306,0.000066445245,0.00017641071,0.00046029556,0.000055890217,0.8899104,0.00047651434,0.098274104,0.0071760667,0.000078544035],"about_ca_topic_score_codex":0.006094505,"about_ca_topic_score_gemma":0.003866793,"teacher_disagreement_score":0.016152736,"about_ca_system_score_codex":0.0008479212,"about_ca_system_score_gemma":0.0036033222,"threshold_uncertainty_score":0.0854249},"labels":[],"label_agreement":null},{"id":"W3201651551","doi":"10.1177/09622802241293776","title":"A Bayesian hierarchical model for disease mapping that accounts for scaling and heavy-tailed latent effects","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; McGill University","funders":"Institut de Valorisation des Données","keywords":"Bayesian probability; Hierarchical database model; Bayesian hierarchical modeling; Scaling; Econometrics; Statistics; Multilevel model; Bayesian inference; Computer science; Mathematics; Data mining","score_opus":0.2650383660648522,"score_gpt":0.5778734444830911,"score_spread":0.3128350784182389,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3201651551","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015306529,0.0007580071,0.97615814,0.0014664155,0.00011412878,0.00017749026,0.0018752369,0.00052955415,0.0036144743],"genre_scores_gemma":[0.5618547,0.0024149446,0.402324,0.0009396923,0.0005173459,0.0016007145,0.0040709367,0.000302446,0.025975162],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9970438,0.0015575383,0.00012636752,0.0007092569,0.0003162732,0.00024682196],"domain_scores_gemma":[0.9937937,0.0044572772,0.00060915475,0.00038026416,0.00053337007,0.00022620567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0060536247,0.0012317243,0.002406565,0.0022790744,0.0011922778,0.0024154936,0.005651236,0.0025575624,0.008648461],"category_scores_gemma":[0.0133626405,0.0011939723,0.0024165555,0.003776635,0.0017172652,0.0030583283,0.0017454487,0.0029533105,0.0015817168],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020048475,0.00018256048,0.012238454,0.00034709126,0.00048134467,0.00066991826,0.0010288924,0.49853256,0.0011282129,0.39753368,0.010800417,0.07685641],"study_design_scores_gemma":[0.00008687066,0.00006800315,0.0026762516,0.000061958744,0.00015193544,0.00022721912,0.00007818603,0.81934357,0.000112412876,0.17082345,0.0063057314,0.00006442162],"about_ca_topic_score_codex":0.048942216,"about_ca_topic_score_gemma":0.050030477,"teacher_disagreement_score":0.048942216,"about_ca_system_score_codex":0.0029144748,"about_ca_system_score_gemma":0.0027248168,"threshold_uncertainty_score":0.097314656},"labels":[],"label_agreement":null},{"id":"W3202627776","doi":"10.1177/09622802211037079","title":"Commentary on the use of the reproduction number <i>R</i> during the COVID-19 pandemic","year":2021,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Fields Institute for Research in Mathematical Sciences; York University","funders":"Marsden Fund; National Institute of Allergy and Infectious Diseases; Natural Sciences and Engineering Research Council of Canada; Medical Research Council; Wellcome; Royal Society; Engineering and Physical Sciences Research Council; Canadian Institutes of Health Research; National Institute for Health and Care Research; Wellcome Trust; James S. McDonnell Foundation","keywords":"Value (mathematics); Basic reproduction number; Metric (unit); Coronavirus disease 2019 (COVID-19); Statistics; Computer science; Mathematics; Population; Medicine; Sociology; Demography; Disease","score_opus":0.8608263610088677,"score_gpt":0.7112668188145757,"score_spread":0.14955954219429202,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3202627776","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001444743,0.15884101,0.0005616662,0.70552313,0.13120891,0.000016841881,0.00030008727,0.0000630837,0.0033407996],"genre_scores_gemma":[0.0026994594,0.07477219,0.00043845412,0.8080023,0.11040614,0.00006499889,0.00012398072,0.00012703586,0.003365443],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98199594,0.0072053415,0.002480363,0.002511375,0.005034953,0.0007720611],"domain_scores_gemma":[0.9102891,0.0663482,0.0032678745,0.001416595,0.016909152,0.0017691166],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026447378,0.001812312,0.003209322,0.0024229034,0.0020766035,0.004685568,0.009826218,0.024108715,0.0044909553],"category_scores_gemma":[0.09454009,0.0011277491,0.0030124192,0.0021027594,0.011853321,0.008482235,0.0031817334,0.047069564,0.006102344],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005604964,0.000007825037,0.000065412154,0.0013997843,0.000040566127,0.00018534141,0.00034293253,0.00011298273,0.00009243076,0.017390406,0.96742,0.012886334],"study_design_scores_gemma":[0.000028858185,0.0000328886,0.00026156704,0.0032308155,0.000043671615,0.00028289668,0.00020109338,0.00005817684,0.00014903116,0.007954501,0.98769814,0.00005826295],"about_ca_topic_score_codex":0.013244803,"about_ca_topic_score_gemma":0.009884474,"teacher_disagreement_score":0.026447378,"about_ca_system_score_codex":0.0074225916,"about_ca_system_score_gemma":0.0083201565,"threshold_uncertainty_score":0.13986874},"labels":[],"label_agreement":null},{"id":"W3215501451","doi":"10.1177/09622802211055856","title":"Impact of minimal sufficient balance, minimization, and stratified permuted blocks on bias and power in the estimation of treatment effect in sequential clinical trials with a binary endpoint","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"National Center for Advancing Translational Sciences; National Institute of Arthritis and Musculoskeletal and Skin Diseases; National Institute of Neurological Disorders and Stroke; National Institute of General Medical Sciences","keywords":"Covariate; Statistics; Restricted randomization; Randomization; Econometrics; Predictability; Mathematics; Selection bias; Minification; Clinical trial; Medicine; Mathematical optimization","score_opus":0.686350801538035,"score_gpt":0.717561028463486,"score_spread":0.031210226925451057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215501451","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09963793,0.011236164,0.8666049,0.0050807684,0.0007510389,0.006900168,0.0010190773,0.00082046574,0.007949425],"genre_scores_gemma":[0.6231953,0.002029443,0.3552068,0.0020378642,0.00031204545,0.014678198,0.00062356313,0.00034844765,0.0015683322],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.631871,0.32259044,0.016547812,0.00891329,0.018447576,0.0016299234],"domain_scores_gemma":[0.45952588,0.48430476,0.024665477,0.02283741,0.0071617616,0.0015047207],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21122879,0.0013352095,0.004195943,0.002231441,0.0011575752,0.002344003,0.0013252647,0.0022951642,0.005178391],"category_scores_gemma":[0.48186308,0.0010532937,0.004133491,0.0019641558,0.0032231598,0.0038535618,0.0034145212,0.002633061,0.0007130145],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.049421825,0.0010439288,0.025520926,0.010055996,0.011872476,0.0004183865,0.003935925,0.05410354,0.006865347,0.14605933,0.008516834,0.68218553],"study_design_scores_gemma":[0.020844903,0.026321793,0.04704822,0.007596188,0.00915191,0.0013780693,0.00066020555,0.1630329,0.018346524,0.6650206,0.039911665,0.00068699045],"about_ca_topic_score_codex":0.00071201293,"about_ca_topic_score_gemma":0.00062784087,"teacher_disagreement_score":0.7887712,"about_ca_system_score_codex":0.0018543105,"about_ca_system_score_gemma":0.0063578803,"threshold_uncertainty_score":0.97269535},"labels":[],"label_agreement":null},{"id":"W3215656175","doi":"10.1177/09622802211052972","title":"A functional proportional hazard cure rate model for interval-censored data","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"National Institute on Aging; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Censoring (clinical trials); Covariate; Nonparametric statistics; Proportional hazards model; Functional data analysis; Functional principal component analysis; Computer science; Statistics; Poisson distribution; Econometrics; Mathematics","score_opus":0.632474033616922,"score_gpt":0.6491351215039572,"score_spread":0.016661087887035242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3215656175","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011168459,0.00034577277,0.985836,0.0007538505,0.00007373239,0.0000956598,0.00046657491,0.00031701793,0.0009430112],"genre_scores_gemma":[0.6397787,0.0019602575,0.33161113,0.0010258983,0.00042439677,0.0018650712,0.0032126338,0.00034628512,0.019775642],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99624926,0.0019887562,0.00013804586,0.00080945174,0.00051759917,0.00029692962],"domain_scores_gemma":[0.9869566,0.009155898,0.0012688704,0.0012230306,0.0010580437,0.0003374837],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014952148,0.0012525581,0.0019121396,0.0020287877,0.0005255367,0.0017782146,0.004473945,0.0024230934,0.005013114],"category_scores_gemma":[0.030191151,0.00079010415,0.0024252292,0.0019847692,0.0020253623,0.0029826262,0.0017272736,0.004681338,0.0014587778],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046305286,0.00017468176,0.008703166,0.00034554777,0.0002565072,0.00061555096,0.0006770341,0.502966,0.0018813848,0.4006974,0.0077911136,0.07542851],"study_design_scores_gemma":[0.000044471897,0.00009744907,0.0010480526,0.000044644763,0.00006231182,0.00032228322,0.00003973924,0.92676276,0.00029437515,0.0681495,0.0030829136,0.000051550927],"about_ca_topic_score_codex":0.004607081,"about_ca_topic_score_gemma":0.002677809,"teacher_disagreement_score":0.014952148,"about_ca_system_score_codex":0.0013520342,"about_ca_system_score_gemma":0.0015954564,"threshold_uncertainty_score":0.079075515},"labels":[],"label_agreement":null},{"id":"W37750213","doi":"10.1177/09622802231198795","title":"Iconography : Localisation primitive « anale et œsophagienne » d'un lymphome non hodgkinien du Malt","year":2008,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Lymphoma Diagnosis and Treatment","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research","keywords":"MALT lymphoma; Medicine; Lymphoma; Pathology","score_opus":0.12630805879344958,"score_gpt":0.5251216464006785,"score_spread":0.3988135876072289,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W37750213","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7640436,0.032008704,0.115127444,0.0057191723,0.0011107245,0.00056742463,0.013141357,0.0026069416,0.06567462],"genre_scores_gemma":[0.9577567,0.0057117497,0.018344225,0.00050114415,0.00023225824,0.0001223525,0.0029869499,0.00018525966,0.014159376],"study_design_codex":"design_other","study_design_gemma":"case_report","domain_scores_codex":[0.99964225,0.00011411296,0.000023212988,0.00008630003,0.00008602476,0.000047996018],"domain_scores_gemma":[0.99899095,0.00059245026,0.00014142277,0.00008044052,0.00012378301,0.00007090353],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00052896596,0.00044433316,0.00045507815,0.0017830527,0.00037106447,0.0014301357,0.00046854798,0.00085803354,0.013826968],"category_scores_gemma":[0.004092475,0.00022138367,0.0004332962,0.0014999527,0.00042315602,0.00092974625,0.0006261473,0.000816491,0.001814247],"study_design_candidate":"case_report","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030202616,0.00016169173,0.30513635,0.0017804479,0.00021842719,0.01914634,0.0011604215,0.01673896,0.017552692,0.015085347,0.040063106,0.57993597],"study_design_scores_gemma":[0.00048002103,0.0007796424,0.3440797,0.00162824,0.0005562042,0.14992389,0.0022692988,0.11090817,0.05613262,0.019933427,0.31305674,0.00025202867],"about_ca_topic_score_codex":0.013555874,"about_ca_topic_score_gemma":0.010102634,"teacher_disagreement_score":0.013826968,"about_ca_system_score_codex":0.0012722234,"about_ca_system_score_gemma":0.00065248966,"threshold_uncertainty_score":0.046255827},"labels":[],"label_agreement":null},{"id":"W4200003768","doi":"10.1177/09622802211061634","title":"Functional response regression model on correlated longitudinal microbiome sequencing data","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Gut microbiota and health","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Princess Margaret Cancer Centre; University Health Network","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Princess Margaret Cancer Foundation","keywords":"Functional data analysis; Regression; Regression analysis; Microbiome; Estimator; Computer science; Functional principal component analysis; Functional response; Statistics; Machine learning; Mathematics; Biology; Bioinformatics; Ecology","score_opus":0.3527100488831351,"score_gpt":0.5862111740909964,"score_spread":0.23350112520786132,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200003768","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013946575,0.0001925469,0.9836352,0.00057129003,0.000058607115,0.000098697645,0.0004596172,0.0004258096,0.00061164907],"genre_scores_gemma":[0.59710586,0.0010843255,0.376193,0.0015522464,0.00031397818,0.0022079004,0.0029946724,0.0006363906,0.017911695],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99089956,0.0061747036,0.00024824028,0.0016039195,0.0006393241,0.00043422656],"domain_scores_gemma":[0.9752706,0.018269414,0.001836805,0.0020870345,0.0022012596,0.00033480415],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020868424,0.001966739,0.0018606042,0.0015261554,0.0005829678,0.0011607502,0.0041511687,0.0024456368,0.0058711492],"category_scores_gemma":[0.037768148,0.00073824736,0.0024688414,0.0019121415,0.0019885774,0.002364307,0.0019377475,0.0028115392,0.001957916],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064474676,0.0002742962,0.024352653,0.00062124844,0.00075018493,0.000856406,0.00058772275,0.69682354,0.005719152,0.14349534,0.0053556575,0.120519064],"study_design_scores_gemma":[0.000033966364,0.00012079308,0.0016430295,0.000030363628,0.000063677166,0.00010103059,0.00005492954,0.964028,0.000760297,0.031273097,0.0018578977,0.000032933105],"about_ca_topic_score_codex":0.006320782,"about_ca_topic_score_gemma":0.0034483057,"teacher_disagreement_score":0.020868424,"about_ca_system_score_codex":0.0010733197,"about_ca_system_score_gemma":0.0017238831,"threshold_uncertainty_score":0.11036408},"labels":[],"label_agreement":null},{"id":"W4200043579","doi":"10.1177/09622802211032705","title":"Repeated measures discriminant analysis using multivariate generalized estimation equations","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Calgary","funders":"","keywords":"Multivariate statistics; Generalized estimating equation; Statistics; Mathematics; Estimator; Multivariate analysis; Linear discriminant analysis; Covariance; Repeated measures design; Multivariate normal distribution","score_opus":0.47383637507703746,"score_gpt":0.6449874666862396,"score_spread":0.17115109160920217,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200043579","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015102512,0.0002939084,0.9830421,0.00010884043,0.000061467224,0.0003222877,0.0002402478,0.00049899565,0.0003296852],"genre_scores_gemma":[0.16968967,0.00045420654,0.82627606,0.00008985938,0.000076367316,0.0017018968,0.00047948223,0.0001384046,0.0010941018],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98374593,0.011622574,0.0006661656,0.0021091201,0.0015578484,0.00029830923],"domain_scores_gemma":[0.97618335,0.01735143,0.0020579782,0.002342222,0.0019294062,0.00013563162],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02093452,0.0020123003,0.0026188989,0.002697501,0.0005581851,0.0014185247,0.0019874715,0.00097131374,0.003805096],"category_scores_gemma":[0.058883246,0.0005488686,0.003939346,0.002889673,0.0010167747,0.0012643713,0.0014550831,0.0026225285,0.00092899095],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011992374,0.00071850745,0.04034477,0.0013528863,0.004643423,0.00040551787,0.0015027439,0.1457853,0.009925094,0.086033456,0.005734639,0.70235443],"study_design_scores_gemma":[0.00038262812,0.0016038975,0.028296344,0.00020042708,0.00080143235,0.0003553319,0.00027219893,0.8610715,0.0061821993,0.09049814,0.010057555,0.00027835992],"about_ca_topic_score_codex":0.0034045712,"about_ca_topic_score_gemma":0.002906793,"teacher_disagreement_score":0.02093452,"about_ca_system_score_codex":0.00096712826,"about_ca_system_score_gemma":0.0020170491,"threshold_uncertainty_score":0.11071366},"labels":[],"label_agreement":null},{"id":"W4205908064","doi":"10.1177/09622802211065158","title":"A potential outcomes approach to defining and estimating gestational age-specific exposure effects during pregnancy","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Pregnancy and Medication Impact","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Hôpital du Sacré-Cœur de Montréal; Université de Montréal; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Inverse probability weighting; Marginal structural model; Pregnancy; Confounding; Observational study; Causal inference; Weighting; Pharmacoepidemiology; Medicine; Inverse probability; Statistics; Estimator; Econometrics; Computer science; Internal medicine; Posterior probability; Bayesian probability; Mathematics","score_opus":0.10330201926296295,"score_gpt":0.5091531585592045,"score_spread":0.40585113929624156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205908064","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006083271,0.00057776796,0.9898677,0.0007157855,0.00009408665,0.00068267545,0.00040602585,0.00012489728,0.001447812],"genre_scores_gemma":[0.23358625,0.0017853868,0.74975157,0.0011424317,0.0002505928,0.008574259,0.00070751295,0.000109867375,0.004092206],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94692576,0.045665804,0.001627731,0.0028967122,0.002407594,0.0004764341],"domain_scores_gemma":[0.9153976,0.071395814,0.0044102906,0.0064794626,0.0018700099,0.00044687808],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058782488,0.0014326941,0.0019787448,0.0030113983,0.00061994384,0.0021441174,0.0037694853,0.0026426944,0.0071941554],"category_scores_gemma":[0.17538728,0.000852094,0.003834421,0.002871007,0.0022091812,0.003070746,0.0033629506,0.003665237,0.00068120554],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013781091,0.0003341555,0.034107853,0.0014148185,0.0018087022,0.0005731368,0.0011204605,0.09176971,0.001201945,0.5978999,0.003387771,0.26500344],"study_design_scores_gemma":[0.00078252325,0.0018270578,0.015221367,0.00092538877,0.0016416843,0.00056020817,0.00029783204,0.21788427,0.0021325655,0.733834,0.024772124,0.00012100594],"about_ca_topic_score_codex":0.0030006745,"about_ca_topic_score_gemma":0.0016379904,"teacher_disagreement_score":0.058782488,"about_ca_system_score_codex":0.0013348331,"about_ca_system_score_gemma":0.003033086,"threshold_uncertainty_score":0.31087524},"labels":[],"label_agreement":null},{"id":"W4234725231","doi":"10.1177/0962280212448971","title":"Editorial","year":2013,"lang":"en","type":"editorial","venue":"Statistical Methods in Medical Research","topic":"","field":"","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Victoria","funders":"","keywords":"Computer science","score_opus":0.12314646047684008,"score_gpt":0.6309105247237368,"score_spread":0.5077640642468967,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234725231","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000022906435,0.0042023817,0.00014920044,0.04619476,0.9469877,0.000045678695,0.00009695741,0.000076686825,0.0022237415],"genre_scores_gemma":[0.00033098552,0.0027067906,0.00018833537,0.047680933,0.93670917,0.00008339386,0.000074826174,0.00007885887,0.012146773],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9862627,0.003645575,0.0015649388,0.00127914,0.0063019386,0.00094560237],"domain_scores_gemma":[0.93838865,0.020494148,0.005706827,0.002422796,0.026289035,0.006698581],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.013055478,0.0031965098,0.0050506257,0.006045135,0.003787877,0.010193074,0.0042279284,0.016594578,0.03390988],"category_scores_gemma":[0.08148079,0.0013207318,0.0040184893,0.0026338226,0.0030079128,0.0032873033,0.0025981944,0.01799551,0.02584592],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000154966,0.00000431052,0.000011343556,0.000075412005,0.00001267985,0.00003283541,0.0000032848109,0.0000061664673,0.000006970052,0.00007652225,0.99728215,0.0024727604],"study_design_scores_gemma":[0.00015792779,0.000021405267,0.0002383938,0.00091493205,0.000102918566,0.00023327862,0.000028930132,0.00010706248,0.000063481195,0.0014564829,0.99665207,0.000023165327],"about_ca_topic_score_codex":0.0028199593,"about_ca_topic_score_gemma":0.0076408316,"teacher_disagreement_score":0.96609014,"about_ca_system_score_codex":0.00409404,"about_ca_system_score_gemma":0.006543715,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4235408669","doi":"10.1177/0962280216660410","title":"Editorial","year":2016,"lang":"en","type":"editorial","venue":"Statistical Methods in Medical Research","topic":"","field":"","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia Hospital","funders":"","keywords":"Medicine; Computer science","score_opus":0.11590070309343611,"score_gpt":0.6424679445791774,"score_spread":0.5265672414857413,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4235408669","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000013875552,0.0035169339,0.00013215526,0.026334861,0.96642447,0.00004919958,0.00017717702,0.000095187504,0.0032561284],"genre_scores_gemma":[0.00029708783,0.0044431165,0.00017126634,0.027507368,0.939786,0.0000934037,0.00017593379,0.000104374296,0.027421411],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99102366,0.0019354185,0.0010930137,0.0009977523,0.0044707544,0.00047939928],"domain_scores_gemma":[0.9528978,0.0150482785,0.003751363,0.0016821183,0.021510096,0.005110329],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008676293,0.0032827803,0.005436247,0.005239433,0.0029460746,0.008411219,0.005342617,0.010837279,0.08465227],"category_scores_gemma":[0.068428196,0.0013512251,0.003665688,0.0022507268,0.0023562205,0.004270219,0.0016316072,0.015863635,0.07569404],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003258227,0.0000050561257,0.0000067892865,0.00019307146,0.000012815118,0.000037442067,0.0000028285526,0.00001098934,0.000014569969,0.00016225068,0.9965138,0.0030078117],"study_design_scores_gemma":[0.00012068277,0.000022454014,0.00010255105,0.001009303,0.000050079205,0.0001713595,0.000015670794,0.00009465031,0.00007211859,0.0012727163,0.99705315,0.000015317184],"about_ca_topic_score_codex":0.001854305,"about_ca_topic_score_gemma":0.0037762402,"teacher_disagreement_score":0.08465227,"about_ca_system_score_codex":0.0030931733,"about_ca_system_score_gemma":0.003981461,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4239067159","doi":"10.1177/0962280218811186","title":"Authors' reply: Letter to the Editor: Comparison of statistical approaches dealing with time-dependent confounding in drug effectiveness studies (SMMR, Vol 27, Issue 6, 2018)","year":2018,"lang":"en","type":"letter","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Centre for Advancing Health Outcomes; University of British Columbia; Jewish General Hospital; Providence Health Care","funders":"","keywords":"Confounding; Computer science; Econometrics; Statistics; Mathematics","score_opus":0.4172799159375314,"score_gpt":0.6239339484163909,"score_spread":0.20665403247885955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4239067159","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012562884,0.0008610757,0.00008583262,0.9590567,0.039350472,0.000009673783,0.00011801693,0.000019374702,0.000373348],"genre_scores_gemma":[0.0012208215,0.0006940158,0.00023286624,0.9407913,0.055161893,0.00004557889,0.000037649144,0.000021689328,0.0017941381],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9900321,0.0035869305,0.0019575555,0.0011392584,0.0024843204,0.00079988915],"domain_scores_gemma":[0.9421837,0.03894826,0.0043916693,0.0011734337,0.01004338,0.00325954],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011834068,0.0009160994,0.002627516,0.0015557684,0.002918324,0.0041686585,0.0026333015,0.050538354,0.007321174],"category_scores_gemma":[0.10837782,0.0010536053,0.0018467729,0.0015568763,0.0031557456,0.003357906,0.0017503452,0.044803273,0.0071606836],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005990377,0.000015439162,0.00029692877,0.000087347114,0.000022484855,0.00032097084,0.000061766375,0.00003859399,0.000042529733,0.00087366655,0.99501204,0.0031683368],"study_design_scores_gemma":[0.00036297392,0.00010738927,0.0021169072,0.0010579369,0.00013110273,0.0016081783,0.00046338927,0.00069207995,0.00034683174,0.009300501,0.9836633,0.00014938557],"about_ca_topic_score_codex":0.003860522,"about_ca_topic_score_gemma":0.005386713,"teacher_disagreement_score":0.9881659,"about_ca_system_score_codex":0.004369697,"about_ca_system_score_gemma":0.006798002,"threshold_uncertainty_score":0.062585294},"labels":[],"label_agreement":null},{"id":"W4281715747","doi":"10.1177/09622802221102628","title":"A Poisson-multinomial spatial model for simultaneous outbreaks with application to arboviral diseases","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Mosquito-borne diseases and control","field":"Medicine","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Institut de Valorisation des Données; Fundação Carlos Chagas Filho de Amparo à Pesquisa do Estado do Rio de Janeiro; Conselho Nacional de Desenvolvimento Científico e Tecnológico; Natural Sciences and Engineering Research Council of Canada; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Dengue fever; Chikungunya; Outbreak; Poisson distribution; Aedes; Poisson regression; Statistics; Geography; Estimation; Aedes aegypti; Population; Demography; Environmental health; Medicine; Biology; Mathematics; Virology; Ecology","score_opus":0.05066987677574371,"score_gpt":0.5120117923460398,"score_spread":0.4613419155702961,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281715747","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04879446,0.002075442,0.9382096,0.0027840477,0.00052709924,0.00036837065,0.0023711405,0.00066198735,0.0042077936],"genre_scores_gemma":[0.7328423,0.0040660994,0.21803905,0.0009517446,0.0011170987,0.0021498029,0.0049348557,0.00044271038,0.03545628],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99413043,0.0033040654,0.0003164695,0.001108054,0.0005508919,0.00059003796],"domain_scores_gemma":[0.98275733,0.013150983,0.0016176332,0.0004544769,0.0015115318,0.0005080855],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013065859,0.0019410896,0.0033985337,0.0026709842,0.0015281811,0.0032712347,0.0075378423,0.0037883378,0.009675798],"category_scores_gemma":[0.021974167,0.0020673473,0.0043559726,0.0032321217,0.0023101773,0.0031812678,0.003451722,0.0040886425,0.0016470875],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020270566,0.0001799423,0.014120293,0.00028886905,0.00043214893,0.0009830084,0.0006220381,0.81912696,0.00043425173,0.1417205,0.0045466814,0.017342543],"study_design_scores_gemma":[0.000049003145,0.000046312045,0.0009362307,0.0000313943,0.000061802864,0.00009639014,0.00010047009,0.97920966,0.000037512724,0.017741784,0.0016547263,0.000034827193],"about_ca_topic_score_codex":0.064356826,"about_ca_topic_score_gemma":0.03489924,"teacher_disagreement_score":0.064356826,"about_ca_system_score_codex":0.0033435328,"about_ca_system_score_gemma":0.003481225,"threshold_uncertainty_score":0.1279645},"labels":[],"label_agreement":null},{"id":"W4283576203","doi":"10.1177/09622802221108579","title":"Analysis of survival data with cure fraction and variable selection: A pseudo-observations approach","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Thermo Fisher Scientific (Canada); Jewish General Hospital","funders":"National Center for Advancing Translational Sciences; National Institutes of Health; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Proportional hazards model; Hazard ratio; Fraction (chemistry); Statistics; Estimator; Survival analysis; Bounded function; Hazard; Mathematics; Data set; Accelerated failure time model; Econometrics; Computer science; Confidence interval","score_opus":0.4607902702741043,"score_gpt":0.595003016830086,"score_spread":0.13421274655598175,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283576203","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015226254,0.0002580577,0.9838299,0.00012201169,0.00003269061,0.00008831053,0.00012716098,0.000119430704,0.00019623683],"genre_scores_gemma":[0.4515157,0.0011391402,0.5419076,0.00026977668,0.0002460375,0.0012442388,0.0015940038,0.00014866664,0.0019348068],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9902069,0.0072397967,0.0003057367,0.0010196255,0.001027913,0.00020008792],"domain_scores_gemma":[0.96253985,0.030177899,0.0023044534,0.00333422,0.0013603123,0.00028339543],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015674688,0.000879044,0.001321826,0.001941523,0.0006961932,0.0012898755,0.0020005705,0.0012699595,0.0022422834],"category_scores_gemma":[0.048401497,0.00055851747,0.0022599697,0.0020751206,0.0018378175,0.0017551398,0.001947212,0.0020660993,0.00035006812],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011017097,0.00048218845,0.06035465,0.00088983873,0.0009146491,0.0009976162,0.0015012358,0.2279485,0.0059727766,0.2184729,0.0036520602,0.47771192],"study_design_scores_gemma":[0.000106776504,0.00052246003,0.012506926,0.00012524723,0.00019360117,0.00042039136,0.00022168137,0.8398965,0.0027716157,0.13719217,0.005941503,0.00010116601],"about_ca_topic_score_codex":0.0015498712,"about_ca_topic_score_gemma":0.0013240416,"teacher_disagreement_score":0.015674688,"about_ca_system_score_codex":0.00050383504,"about_ca_system_score_gemma":0.0012371453,"threshold_uncertainty_score":0.08289671},"labels":[],"label_agreement":null},{"id":"W4285023678","doi":"10.1177/09622802221111546","title":"Unified approach to optimal estimation of mean and standard deviation from sample summaries","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Standard deviation; Sample mean and sample covariance; Statistics; Sample size determination; Variance (accounting); Sample (material); Mathematics; Standard error; Estimation; Computer science","score_opus":0.2764146378609897,"score_gpt":0.5686667043651459,"score_spread":0.2922520665041562,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285023678","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000679698,0.0005230526,0.99826777,0.00010255062,0.00002521148,0.00002531643,0.000046765108,0.00007950811,0.0002500919],"genre_scores_gemma":[0.047385406,0.0016853388,0.9488965,0.00022422675,0.00030384088,0.00041346642,0.00036482752,0.00014355658,0.0005827601],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96803856,0.021011347,0.0024915065,0.0034599428,0.004478391,0.0005202334],"domain_scores_gemma":[0.9514503,0.036397267,0.0029098731,0.004181138,0.004735571,0.00032592233],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038933083,0.0014809432,0.0035888266,0.0059658093,0.0007498054,0.0038092555,0.0032394165,0.0020288522,0.0023935498],"category_scores_gemma":[0.1316747,0.0015286701,0.0019183819,0.004316333,0.0018277769,0.004943304,0.0037784348,0.0035150007,0.0006394126],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019739433,0.00011816431,0.002551752,0.000783598,0.0006862601,0.00023108724,0.0005334544,0.17650619,0.0031605407,0.49506366,0.005638194,0.31452972],"study_design_scores_gemma":[0.000101361846,0.00020350229,0.0017328067,0.00031533107,0.0002848112,0.00020929244,0.000090227244,0.6960728,0.0038513644,0.2849294,0.012080108,0.00012904959],"about_ca_topic_score_codex":0.0017657545,"about_ca_topic_score_gemma":0.0016983981,"teacher_disagreement_score":0.038933083,"about_ca_system_score_codex":0.0017861837,"about_ca_system_score_gemma":0.003538071,"threshold_uncertainty_score":0.20590031},"labels":[],"label_agreement":null},{"id":"W4287773546","doi":"10.1177/09622802221111549","title":"Ensemble methods for survival function estimation with time-varying covariates","year":2022,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Covariate; Statistics; Estimation; Computer science; Econometrics; Mathematics","score_opus":0.5077012381482325,"score_gpt":0.6628222937762495,"score_spread":0.15512105562801692,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4287773546","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016361054,0.5373319,0.45511895,0.0014717921,0.0007743376,0.00008227886,0.00039651978,0.00039127917,0.0027967102],"genre_scores_gemma":[0.041744072,0.74288887,0.20753051,0.0009573411,0.002108339,0.0005096928,0.0014118803,0.00020989848,0.0026395288],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99822694,0.00090064056,0.0001129841,0.00027631142,0.00043342967,0.00004984567],"domain_scores_gemma":[0.9930269,0.005658363,0.0003414062,0.00034547865,0.0005524114,0.000075394775],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061470056,0.0012180059,0.0020714172,0.0028459055,0.00023643274,0.00092859677,0.001731496,0.0012818048,0.0030981102],"category_scores_gemma":[0.013721113,0.0005041845,0.00274895,0.003814166,0.00068437547,0.0016261595,0.0008631772,0.003036146,0.0015280697],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000048879527,0.000050506213,0.0014095259,0.0036763458,0.00068659795,0.00005263227,0.000058162575,0.031044131,0.0003407335,0.027875457,0.01369538,0.9210617],"study_design_scores_gemma":[0.00015046757,0.00048372636,0.010326228,0.008997879,0.0018858839,0.0018908823,0.0001425925,0.25063545,0.0029620347,0.27351287,0.4487074,0.00030464178],"about_ca_topic_score_codex":0.0021483717,"about_ca_topic_score_gemma":0.0024995212,"teacher_disagreement_score":0.0061470056,"about_ca_system_score_codex":0.00065766054,"about_ca_system_score_gemma":0.0012229257,"threshold_uncertainty_score":0.03250891},"labels":[],"label_agreement":null},{"id":"W4296710640","doi":"10.1177/09622802221125912","title":"A nonparametric test for equality of survival medians using right-censored prevalent cohort survival data","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Nonparametric statistics; Statistics; Censoring (clinical trials); Estimator; Statistic; Population; Kaplan–Meier estimator; Survival analysis; Sample size determination; Cohort; Medicine; Survival function; Test statistic; Mathematics; Statistical hypothesis testing","score_opus":0.551658796265615,"score_gpt":0.6396868315058465,"score_spread":0.0880280352402315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4296710640","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09672354,0.0003465329,0.89810085,0.0004696191,0.00013524003,0.00028324543,0.0011391819,0.0006330252,0.0021688724],"genre_scores_gemma":[0.7617884,0.00023701487,0.2328552,0.00031041398,0.00022594538,0.0009859387,0.0021854446,0.0001238565,0.0012877302],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9870172,0.007900535,0.0006418616,0.0018411184,0.0021577287,0.00044156195],"domain_scores_gemma":[0.8978404,0.08802166,0.004766441,0.0056355116,0.0028575894,0.0008784351],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020280832,0.0004818166,0.0013638604,0.0026845222,0.0008338593,0.0014063094,0.0018104815,0.0013526897,0.0040262397],"category_scores_gemma":[0.12636308,0.00024909948,0.0012671031,0.0020985354,0.0024834566,0.001958599,0.0021742026,0.002026308,0.00047318017],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018619134,0.0006885445,0.11735174,0.0008064008,0.0016005451,0.0012091565,0.0011923168,0.08520745,0.0086781625,0.1905846,0.008249082,0.58257014],"study_design_scores_gemma":[0.00048417275,0.0030815823,0.085592166,0.00029874567,0.00029904643,0.0016764421,0.0009671545,0.6474776,0.007824041,0.23902631,0.013029352,0.00024334688],"about_ca_topic_score_codex":0.0011685792,"about_ca_topic_score_gemma":0.00072808407,"teacher_disagreement_score":0.020280832,"about_ca_system_score_codex":0.0007134818,"about_ca_system_score_gemma":0.0022058822,"threshold_uncertainty_score":0.10725659},"labels":[],"label_agreement":null},{"id":"W4307761721","doi":"10.1177/09622802221129040","title":"Revisiting Gaussian Markov random fields and Bayesian disease mapping","year":2022,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Autoregressive model; Covariance; Bayesian probability; Gaussian; Bayesian inference; Variable-order Bayesian network; Computer science; Random field; Markov chain; Conditional independence; Mathematics; Econometrics; Artificial intelligence; Statistics; Machine learning; Physics","score_opus":0.3179237316478053,"score_gpt":0.6023718682123013,"score_spread":0.28444813656449597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307761721","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00065092137,0.9265384,0.059708714,0.007234747,0.00073162414,0.000019977157,0.00009543302,0.00005323991,0.0049670343],"genre_scores_gemma":[0.017909085,0.95417535,0.021563979,0.0021573429,0.0019554743,0.00006455262,0.00014377885,0.000035224813,0.001995063],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99866724,0.0007241741,0.00007764761,0.00016025912,0.00032945472,0.000041260246],"domain_scores_gemma":[0.99269956,0.006185053,0.00023907507,0.00017841786,0.00062067446,0.00007729624],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0056239846,0.0008057419,0.001337131,0.0030239956,0.00030248592,0.0017641169,0.0017238247,0.0019861772,0.0017542586],"category_scores_gemma":[0.010879751,0.0005586162,0.00078806723,0.0038583588,0.002651817,0.0032926945,0.0010737957,0.0032527263,0.0008992562],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002357321,0.000034894143,0.00040890448,0.002875348,0.00011391973,0.000117968826,0.00024920102,0.010307108,0.00019501128,0.6113132,0.015362152,0.35899875],"study_design_scores_gemma":[0.000015912294,0.00004776209,0.00086579635,0.0030702099,0.000086829605,0.0005795827,0.00010540564,0.010850182,0.00026376417,0.6067491,0.37729782,0.0000676356],"about_ca_topic_score_codex":0.007205632,"about_ca_topic_score_gemma":0.0049145822,"teacher_disagreement_score":0.007205632,"about_ca_system_score_codex":0.0021403702,"about_ca_system_score_gemma":0.0032764114,"threshold_uncertainty_score":0.029742837},"labels":[],"label_agreement":null},{"id":"W4307835686","doi":"10.1177/09622802221134172","title":"Bayesian inference for Cox proportional hazard models with partial likelihoods, nonlinear covariate effects and correlated observations","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Global Health Research; St. Michael's Hospital; University of Waterloo; University of Toronto","funders":"","keywords":"Covariate; Laplace's method; Markov chain Monte Carlo; Bayesian probability; Inference; Parametric statistics; Proportional hazards model; Computer science; Bayesian inference; Mathematics; Econometrics; Applied mathematics; Statistics; Algorithm; Artificial intelligence","score_opus":0.23490634914787176,"score_gpt":0.5408256184953694,"score_spread":0.3059192693474976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307835686","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013704464,0.00009595639,0.9981238,0.00012263322,0.000008399165,0.000019217468,0.00004197401,0.0000601469,0.00015741147],"genre_scores_gemma":[0.153574,0.0010074821,0.84190774,0.00024494567,0.00018184076,0.0005826562,0.0004452903,0.00014102162,0.0019149213],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9962437,0.0023368897,0.00014823233,0.00044201696,0.00067097787,0.00015822888],"domain_scores_gemma":[0.98651516,0.011258955,0.00079161016,0.0007340703,0.0005250343,0.00017512389],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010240088,0.0007567176,0.0014810382,0.0009924273,0.000619221,0.0016222262,0.0026986764,0.001026171,0.0029733838],"category_scores_gemma":[0.033794563,0.000956874,0.0014445818,0.001461023,0.0014365017,0.0018736469,0.0021578602,0.002459351,0.00049199216],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012613813,0.000071172886,0.003061749,0.00026913956,0.00020121303,0.00025134246,0.0002351036,0.64395213,0.0010883451,0.24520354,0.0026967232,0.102843404],"study_design_scores_gemma":[0.000040878494,0.0000177888,0.00027868748,0.0000205226,0.0000281582,0.000051638013,0.0000144446585,0.9011579,0.00021576355,0.09664145,0.0015170608,0.000015648158],"about_ca_topic_score_codex":0.008809822,"about_ca_topic_score_gemma":0.008283811,"teacher_disagreement_score":0.010240088,"about_ca_system_score_codex":0.0012557763,"about_ca_system_score_gemma":0.0037729966,"threshold_uncertainty_score":0.05415541},"labels":[],"label_agreement":null},{"id":"W4309662782","doi":"10.1177/09622802221139233","title":"Standard error estimation in meta-analysis of studies reporting medians","year":2022,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"National Science Foundation","keywords":"Standard deviation; Statistics; Meta-analysis; Standard error; Sample size determination; Quartile; Weighting; Context (archaeology); Random effects model; Econometrics; Median; Pooled variance; Mathematics; Computer science; Medicine; Confidence interval","score_opus":0.9687413692421736,"score_gpt":0.8023260236013716,"score_spread":0.16641534564080196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309662782","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002679572,0.04483261,0.9447075,0.0021365746,0.0015406504,0.0010075264,0.0011475846,0.00064661866,0.0013013161],"genre_scores_gemma":[0.20098585,0.030466955,0.7481303,0.003910742,0.0020824892,0.01082642,0.0018467698,0.0006786175,0.0010719071],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.47690174,0.44778144,0.03761715,0.01945395,0.01707902,0.0011667178],"domain_scores_gemma":[0.33706555,0.5900873,0.03135733,0.033348903,0.0077129775,0.00042787477],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.35354882,0.0034003141,0.012470882,0.0139997555,0.0010813685,0.007942956,0.0079198815,0.0062568076,0.0028705772],"category_scores_gemma":[0.70225877,0.0029267026,0.020709883,0.014836639,0.0040243394,0.006628919,0.005899307,0.007684363,0.00074566336],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002586345,0.00017903945,0.024172349,0.06632795,0.20385237,0.0012487774,0.0021604036,0.13224989,0.0013119885,0.17707764,0.017930996,0.37090218],"study_design_scores_gemma":[0.0014878989,0.0009246247,0.008602658,0.01930239,0.053511336,0.0012317053,0.0004995652,0.13530922,0.0034885702,0.7319555,0.043089446,0.00059699337],"about_ca_topic_score_codex":0.0025292123,"about_ca_topic_score_gemma":0.001548035,"teacher_disagreement_score":0.6464512,"about_ca_system_score_codex":0.0031005929,"about_ca_system_score_gemma":0.004232813,"threshold_uncertainty_score":0.7971894},"labels":[],"label_agreement":null},{"id":"W4313488348","doi":"10.1177/09622802221146311","title":"Intervention treatment distributions that depend on the observed treatment process and model double robustness in causal survival analysis","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Estimator; Robustness (evolution); Average treatment effect; Computer science; Mathematics; Convergence (economics); Mathematical optimization; Econometrics; Statistics; Economics","score_opus":0.6785915120642826,"score_gpt":0.6541200482433555,"score_spread":0.02447146382092713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313488348","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01842873,0.00028653882,0.97994137,0.0003899768,0.000024208633,0.00009102082,0.000090743386,0.00013602749,0.00061131915],"genre_scores_gemma":[0.74540484,0.00069806393,0.24968575,0.0005383507,0.00021503544,0.00094567327,0.00035320857,0.00014322686,0.0020157746],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9780025,0.016365988,0.00073473534,0.0020940483,0.002167518,0.00063532003],"domain_scores_gemma":[0.8315191,0.14428067,0.009904618,0.011250682,0.0023860433,0.000658809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035264194,0.00086677936,0.0017432816,0.001860086,0.0005381523,0.0018267,0.0023786973,0.002652936,0.0024885589],"category_scores_gemma":[0.1649359,0.0007920861,0.0020198277,0.00107383,0.003791371,0.0025260877,0.0025287312,0.0032173127,0.00028151236],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040442045,0.00018424598,0.012366716,0.00032960842,0.00052410515,0.00040638878,0.0005547531,0.33094424,0.0020971126,0.5656036,0.0011704615,0.085414335],"study_design_scores_gemma":[0.000085737876,0.00022725655,0.0029130243,0.00008802978,0.00014633127,0.00015084508,0.000048272515,0.7029588,0.001750123,0.29012844,0.0014471111,0.000055929795],"about_ca_topic_score_codex":0.0021108727,"about_ca_topic_score_gemma":0.00094418984,"teacher_disagreement_score":0.035264194,"about_ca_system_score_codex":0.0015097088,"about_ca_system_score_gemma":0.0014793349,"threshold_uncertainty_score":0.18649709},"labels":[],"label_agreement":null},{"id":"W4315619190","doi":"10.1177/09622802221146305","title":"Taking a chance: How likely am I to receive my preferred treatment in a clinical trial?","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; Georgia Clinical and Translational Science Alliance; National Center for Advancing Translational Sciences; Yale University","keywords":"Concordance; Medicine; Randomized controlled trial; Clinical trial; Clinical study design; Research design; Clinical equipoise; Physical therapy; Statistics; Surgery; Internal medicine","score_opus":0.8797528067101806,"score_gpt":0.7306201066902023,"score_spread":0.14913270001997836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4315619190","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3367999,0.0915953,0.31187853,0.20395496,0.0072499067,0.00820781,0.0019209996,0.00062729145,0.037765246],"genre_scores_gemma":[0.8873766,0.0084215505,0.0758776,0.01841275,0.0030728902,0.0050863624,0.00024220442,0.00008997952,0.0014200717],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5063729,0.4284974,0.021249512,0.017379994,0.024228921,0.0022712513],"domain_scores_gemma":[0.2765335,0.6074002,0.07598465,0.027640987,0.006475892,0.0059647793],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3715461,0.0009612079,0.003630682,0.0018351994,0.0016798618,0.0071922014,0.0025889839,0.0073795468,0.008494628],"category_scores_gemma":[0.6550851,0.00094019866,0.0036371306,0.0021478585,0.010129422,0.011611899,0.0033946855,0.0074850824,0.001344083],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.039823063,0.0014155676,0.09896322,0.011265323,0.009555751,0.00066120754,0.007039971,0.007385454,0.0025772466,0.0993463,0.017846843,0.7041201],"study_design_scores_gemma":[0.01661869,0.038844306,0.1762132,0.02811598,0.013545477,0.0074901152,0.008682536,0.053259958,0.009061208,0.5542721,0.09206303,0.00183329],"about_ca_topic_score_codex":0.00065489474,"about_ca_topic_score_gemma":0.0007604542,"teacher_disagreement_score":0.3715461,"about_ca_system_score_codex":0.003047364,"about_ca_system_score_gemma":0.0037539387,"threshold_uncertainty_score":0.77499557},"labels":[],"label_agreement":null},{"id":"W4317910164","doi":"10.1177/09622802221146308","title":"Estimation of the average treatment effect with variable selection and measurement error simultaneously addressed for potential confounders","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Estimator; Weighting; Inference; Inverse probability weighting; Statistics; Confounding; Causal inference; Mathematics; Computer science; Inverse probability; Selection (genetic algorithm); Average treatment effect; Econometrics; Machine learning; Artificial intelligence; Posterior probability; Bayesian probability; Medicine","score_opus":0.34778535028016205,"score_gpt":0.5989775910914773,"score_spread":0.25119224081131525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4317910164","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001824423,0.00035796632,0.99693716,0.00023623221,0.000057153862,0.00008939903,0.00004785646,0.000054128395,0.00039556055],"genre_scores_gemma":[0.11853694,0.0017477142,0.87553775,0.0005524538,0.00036918256,0.001174788,0.00027799487,0.00007407264,0.0017290561],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9796305,0.014967403,0.0007831159,0.0022681286,0.001979847,0.000371048],"domain_scores_gemma":[0.9336473,0.055772647,0.0028937524,0.0055443943,0.0018944474,0.0002475024],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0420512,0.0012255074,0.002831427,0.0024392097,0.00081373175,0.0017757787,0.0032555487,0.0025714294,0.0048071607],"category_scores_gemma":[0.1269335,0.0007250631,0.0026933455,0.0030197748,0.0023751277,0.0035951124,0.0022758543,0.0034822673,0.00070630596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025939345,0.00020207805,0.0084629655,0.0013287818,0.0011777132,0.00024193399,0.00050880486,0.06340087,0.0017964722,0.5993944,0.0034367987,0.31978986],"study_design_scores_gemma":[0.00018977774,0.0003564185,0.0031180931,0.00042366792,0.00073521974,0.00034677988,0.00011438598,0.2223134,0.0024481723,0.7606435,0.009234769,0.00007584341],"about_ca_topic_score_codex":0.0018232265,"about_ca_topic_score_gemma":0.0014565574,"teacher_disagreement_score":0.0420512,"about_ca_system_score_codex":0.0010050347,"about_ca_system_score_gemma":0.0035267514,"threshold_uncertainty_score":0.22239065},"labels":[],"label_agreement":null},{"id":"W4318917969","doi":"10.1177/09622802231151210","title":"Revisiting sample size planning for receiver operating characteristic studies: A confidence interval approach with precision and assurance","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Sample size determination; Calculator; Variance (accounting); Computer science; Confidence interval; Coverage probability; Sample (material); Statistics; Range (aeronautics); Estimator; Central limit theorem; Function (biology); Limit (mathematics); Receiver operating characteristic; Mathematics","score_opus":0.7934405002011646,"score_gpt":0.7264650259137247,"score_spread":0.06697547428743988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318917969","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010624406,0.0006386033,0.99665004,0.0004970098,0.000052703243,0.0001323675,0.000046773195,0.00026361877,0.0006563789],"genre_scores_gemma":[0.1000108,0.0012445087,0.8948487,0.00096723076,0.00039019232,0.0012105748,0.00022308568,0.00047802943,0.0006269565],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9194829,0.058739927,0.0041739023,0.0048878603,0.011955826,0.00075968384],"domain_scores_gemma":[0.5652002,0.3930527,0.010177722,0.01609304,0.014494559,0.0009817496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.098872446,0.001954396,0.0027557912,0.00491052,0.00069497275,0.004464975,0.004788179,0.0031309042,0.0033770509],"category_scores_gemma":[0.42537114,0.0016489509,0.0021939415,0.0033175696,0.0035270012,0.0061138305,0.0047089425,0.0080602495,0.0009716881],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057282875,0.00019398627,0.0070860903,0.0020770587,0.0005608997,0.00041824183,0.0016949112,0.16494551,0.0035768987,0.29383174,0.008904538,0.5161373],"study_design_scores_gemma":[0.00036585744,0.00078797736,0.003404137,0.0014806668,0.00038982052,0.00083695655,0.00017548967,0.6187364,0.006660983,0.3442674,0.022701526,0.00019278385],"about_ca_topic_score_codex":0.002221342,"about_ca_topic_score_gemma":0.0014726236,"teacher_disagreement_score":0.098872446,"about_ca_system_score_codex":0.0022640151,"about_ca_system_score_gemma":0.0042780945,"threshold_uncertainty_score":0.5228937},"labels":[],"label_agreement":null},{"id":"W4327584872","doi":"10.1177/09622802231158733","title":"Estimating individualized treatment rules in longitudinal studies with covariate-driven observation times","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; Université de Montréal","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; University of Toronto; Government of Ontario; Fonds de Recherche du Québec - Santé; Compute Canada","keywords":"Covariate; Econometrics; Longitudinal data; Statistics; Computer science; Medicine; Mathematics; Data mining","score_opus":0.7436792954420733,"score_gpt":0.6962814676362851,"score_spread":0.04739782780578827,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4327584872","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020366056,0.0003333628,0.97819513,0.00033075784,0.000029256344,0.00017625872,0.00010187879,0.0001307476,0.0003365306],"genre_scores_gemma":[0.31243333,0.0006746267,0.6835168,0.00036285323,0.00012767702,0.0013146562,0.00043321494,0.00007029751,0.0010665292],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9589452,0.032782435,0.0015930649,0.0041687638,0.0020480265,0.0004624099],"domain_scores_gemma":[0.817861,0.15789934,0.012463625,0.00937696,0.0017877657,0.00061136385],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05825569,0.00076346326,0.002765174,0.0019092943,0.0007814096,0.0021525505,0.0025466355,0.002361836,0.0013893527],"category_scores_gemma":[0.17550896,0.0013956605,0.0016027525,0.0023695808,0.0023129366,0.0027811974,0.0018486081,0.0038748167,0.00029892445],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006218962,0.00033062603,0.028721552,0.0003955117,0.0010115805,0.00023457574,0.00080790365,0.5565392,0.0010516174,0.17966332,0.0015419833,0.2290802],"study_design_scores_gemma":[0.00013019255,0.00018564684,0.0046694204,0.00010392583,0.00018030872,0.000079435726,0.00006258543,0.75367004,0.0009772341,0.23786867,0.0020198636,0.000052710162],"about_ca_topic_score_codex":0.0023531457,"about_ca_topic_score_gemma":0.0031635452,"teacher_disagreement_score":0.9417443,"about_ca_system_score_codex":0.0015092733,"about_ca_system_score_gemma":0.002386729,"threshold_uncertainty_score":0.3080892},"labels":[],"label_agreement":null},{"id":"W4360600249","doi":"10.1177/09622802231160551","title":"Identifying regions of interest in mammogram images","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"AI in cancer detection","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; Breast Cancer Research Foundation","keywords":"Breast cancer; Mammography; Computer science; Bivariate analysis; Lasso (programming language); Artificial intelligence; Breast cancer screening; Noise (video); Boundary (topology); Domain (mathematical analysis); Medicine; Triangulation; Region of interest; Segmentation; Data mining; Pattern recognition (psychology); Cancer; Machine learning; Mathematics; Image (mathematics); Internal medicine","score_opus":0.5030285996736024,"score_gpt":0.6263801075811303,"score_spread":0.12335150790752791,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360600249","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32770318,0.004552838,0.6517981,0.0025027934,0.00021703118,0.0004911987,0.0053207646,0.0021634253,0.0052507017],"genre_scores_gemma":[0.70814955,0.0019683654,0.28128457,0.000435484,0.00022985587,0.00024143494,0.0041835243,0.0002713152,0.0032359264],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99931335,0.00020597395,0.00004953913,0.00016498435,0.0001828877,0.00008321838],"domain_scores_gemma":[0.99846566,0.00082540355,0.0002603303,0.00019188489,0.00019519012,0.00006152423],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014070121,0.00038715175,0.0005797012,0.0018727302,0.0003157191,0.001480597,0.0005278992,0.0010330126,0.0017015501],"category_scores_gemma":[0.0058563785,0.00030449076,0.0005883213,0.0013097946,0.00051082607,0.00046633522,0.0010409902,0.00062019203,0.00078065455],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020939645,0.00044295733,0.09096345,0.0011592999,0.0003021597,0.005196529,0.0014138129,0.045992132,0.1597429,0.018521868,0.027393106,0.64677775],"study_design_scores_gemma":[0.00014003046,0.0004968484,0.2512603,0.0004080281,0.0002926297,0.014483636,0.0020510438,0.53778857,0.08914424,0.037186265,0.066533916,0.00021453558],"about_ca_topic_score_codex":0.002579818,"about_ca_topic_score_gemma":0.0036421502,"teacher_disagreement_score":0.002579818,"about_ca_system_score_codex":0.0002611455,"about_ca_system_score_gemma":0.0006671571,"threshold_uncertainty_score":0.0074411035},"labels":[],"label_agreement":null},{"id":"W4361190400","doi":"10.1177/09622802231164730","title":"Adaptive aggregation for longitudinal quantile regression based on censored history process","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"China Scholarship Council; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Quantile; Estimator; Quantile regression; Computer science; Econometrics; Random effects model; Smoothing; Weighting; Mathematics; Mathematical optimization; Statistics","score_opus":0.4848764879169074,"score_gpt":0.626966810046468,"score_spread":0.14209032212956063,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4361190400","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059286663,0.00024499485,0.9932996,0.00007189767,0.00001973603,0.000024129466,0.00002103289,0.000121300196,0.0002686114],"genre_scores_gemma":[0.5707811,0.0015313864,0.42363396,0.0002127854,0.00021618615,0.00035994346,0.00036503217,0.00017247522,0.0027272373],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99630827,0.0021015396,0.00021312886,0.00050324417,0.0006565594,0.00021723383],"domain_scores_gemma":[0.9903949,0.0069045876,0.0008295582,0.0008472385,0.0008072346,0.00021662225],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010360336,0.0009282367,0.0015330972,0.0012836336,0.00041349954,0.00118006,0.0017869686,0.000933328,0.0018896142],"category_scores_gemma":[0.024556622,0.0004160431,0.0011719402,0.0015698539,0.0010885898,0.0020729958,0.0018469775,0.0019859,0.00029505388],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023998368,0.00011115474,0.008134214,0.00039414805,0.00025748162,0.00040840666,0.00039355498,0.59126365,0.003803599,0.18892564,0.0022194842,0.20384872],"study_design_scores_gemma":[0.0000085362135,0.000048720955,0.0007816968,0.000017979934,0.000025078967,0.00003869366,0.000015156195,0.97664887,0.000567227,0.021212608,0.0006226741,0.000012739302],"about_ca_topic_score_codex":0.0030474886,"about_ca_topic_score_gemma":0.0018941603,"teacher_disagreement_score":0.010360336,"about_ca_system_score_codex":0.0010967327,"about_ca_system_score_gemma":0.00094067806,"threshold_uncertainty_score":0.05479133},"labels":[],"label_agreement":null},{"id":"W4366463553","doi":"10.1177/09622802231163332","title":"Design and analysis of factorial clinical trials: The impact of one treatment's effectiveness on the statistical power and required sample size of the other","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Sample size determination; Statistics; Statistical power; Factorial; Factorial experiment; Multiplicative function; Mathematics; Odds ratio; Outcome (game theory); Treatment effect; Type I and type II errors; Treatment and control groups; Power (physics); Sample (material); Econometrics; Medicine; Physics","score_opus":0.8881970642432903,"score_gpt":0.7718697113697441,"score_spread":0.11632735287354612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366463553","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02137433,0.0048854193,0.9569518,0.0026494674,0.00058794627,0.008366521,0.00023300997,0.00044487766,0.004506537],"genre_scores_gemma":[0.19515888,0.0013704302,0.7804524,0.0012067332,0.0002599883,0.020949656,0.000085963125,0.000114926996,0.0004010197],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.52598625,0.43728915,0.010188076,0.007194896,0.018140053,0.0012015952],"domain_scores_gemma":[0.41930005,0.5196496,0.025625126,0.02742617,0.0067093745,0.0012896251],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2934357,0.0020563477,0.0049883225,0.0023361125,0.0010837471,0.005124742,0.0022448194,0.0049712164,0.0037270945],"category_scores_gemma":[0.5618506,0.0013172771,0.0028404181,0.0025547699,0.0058108866,0.0053015426,0.0028308614,0.0038719391,0.0006491764],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016984424,0.00087561726,0.017800054,0.011556951,0.0047528297,0.0006888094,0.0015107536,0.066089325,0.0123507725,0.4165996,0.008477414,0.44231343],"study_design_scores_gemma":[0.011968445,0.019403651,0.020061227,0.0034503532,0.0028490496,0.001466,0.00034752346,0.2540361,0.016066017,0.6419515,0.027574142,0.00082610094],"about_ca_topic_score_codex":0.00033526254,"about_ca_topic_score_gemma":0.00040447357,"teacher_disagreement_score":0.7065643,"about_ca_system_score_codex":0.002837543,"about_ca_system_score_gemma":0.004445747,"threshold_uncertainty_score":0.8713196},"labels":[],"label_agreement":null},{"id":"W4379509156","doi":"10.1177/09622802231176034","title":"qTPI: A quasi-toxicity probability interval design for phase I trials with multiple-grade toxicities","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Science Foundation of Shanghai","keywords":"Toxicity; Dosing; Confidence interval; Interval (graph theory); Computer science; Common Terminology Criteria for Adverse Events; Clinical study design; Medicine; Clinical trial; Statistics; Mathematics; Internal medicine","score_opus":0.9107704970381562,"score_gpt":0.7548613736585712,"score_spread":0.15590912337958496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379509156","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008470313,0.00024696332,0.9868427,0.0001800166,0.00015801072,0.002945062,0.00018189852,0.00027849257,0.00069658144],"genre_scores_gemma":[0.18606582,0.00038966167,0.7922961,0.0005450283,0.00014274268,0.019114643,0.00037636838,0.00010220854,0.0009674143],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92794913,0.063126676,0.0022538304,0.0027501446,0.0034306278,0.00048948865],"domain_scores_gemma":[0.91186124,0.06684608,0.008466025,0.0077700205,0.0036504527,0.0014061306],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.070202254,0.0013763208,0.0016648861,0.0011552513,0.00042713626,0.0013587582,0.0022186085,0.0017808065,0.0074434564],"category_scores_gemma":[0.10959377,0.0008580102,0.0020246683,0.0011434898,0.00198325,0.0017746135,0.0019932883,0.0030246065,0.00065506925],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.026085682,0.0013824849,0.007823102,0.00337127,0.0020462768,0.00042150705,0.0008908025,0.21461636,0.01202842,0.29759166,0.0058304067,0.427912],"study_design_scores_gemma":[0.0111611765,0.03127031,0.0056913183,0.00044763033,0.0012389704,0.00048615882,0.00010461987,0.72487295,0.007226951,0.19763313,0.019586444,0.000280423],"about_ca_topic_score_codex":0.00033457033,"about_ca_topic_score_gemma":0.0002544602,"teacher_disagreement_score":0.070202254,"about_ca_system_score_codex":0.0010498166,"about_ca_system_score_gemma":0.0029056354,"threshold_uncertainty_score":0.37126946},"labels":[],"label_agreement":null},{"id":"W4380264232","doi":"10.1177/09622802231172032","title":"Methods for comparative effectiveness based on time to confirmed disability progression with irregular observations in multiple sclerosis","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Imputation (statistics); Missing data; Covariate; Computer science; Multilevel model; Longitudinal data; Statistics; Medicine; Data mining; Machine learning; Mathematics","score_opus":0.8312643475469137,"score_gpt":0.6918060476561978,"score_spread":0.1394582998907159,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380264232","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02002719,0.024325471,0.93993545,0.0027187828,0.00092792086,0.004254571,0.0017338332,0.000380709,0.005696102],"genre_scores_gemma":[0.35892516,0.006934032,0.61092395,0.0011124476,0.0006345751,0.018117297,0.0014039595,0.0003091987,0.0016394308],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.63048536,0.346473,0.0059131784,0.005743903,0.010358972,0.0010255959],"domain_scores_gemma":[0.3188773,0.6497191,0.015111665,0.0130333565,0.002546492,0.00071210763],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.27852282,0.0018762364,0.006428297,0.008436922,0.0008178233,0.0035395909,0.0042603766,0.0032182734,0.010185116],"category_scores_gemma":[0.52897316,0.0010405157,0.007402317,0.0067902827,0.004252117,0.004473223,0.004890183,0.006056101,0.0005697846],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0050769374,0.0005794598,0.018181192,0.008167346,0.025042394,0.00030637492,0.0014063588,0.16607597,0.0003377721,0.3958855,0.0056003383,0.37334043],"study_design_scores_gemma":[0.0020127303,0.002760481,0.014064405,0.004238089,0.0051323934,0.00053070654,0.00042761772,0.37588847,0.0011385486,0.5775682,0.015906971,0.00033150607],"about_ca_topic_score_codex":0.0024375382,"about_ca_topic_score_gemma":0.0014426468,"teacher_disagreement_score":0.27852282,"about_ca_system_score_codex":0.00486143,"about_ca_system_score_gemma":0.0035525546,"threshold_uncertainty_score":0.88970983},"labels":[],"label_agreement":null},{"id":"W4381308498","doi":"10.1177/09622802231181224","title":"Model detection for semiparametric accelerated failure additive model with right-censored data","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Accelerated failure time model; Computer science; Inference; Nonparametric statistics; Covariate; Model selection; Spline (mechanical); Econometrics; Semiparametric model; Consistency (knowledge bases); Data mining; Mathematics; Machine learning; Artificial intelligence","score_opus":0.5371735080338076,"score_gpt":0.6177541225214012,"score_spread":0.08058061448759357,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4381308498","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076918458,0.000071672985,0.9919476,0.000060811246,0.000007824677,0.000014859024,0.000019430528,0.00008536642,0.00010065867],"genre_scores_gemma":[0.5615658,0.00048583612,0.43482977,0.00016523035,0.00010371524,0.0003920766,0.000439898,0.00010396152,0.0019138216],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9938747,0.0042070877,0.00021070041,0.00069969764,0.00077279226,0.00023493408],"domain_scores_gemma":[0.9821228,0.013457051,0.0014027765,0.0017102219,0.0010430003,0.00026408033],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011684119,0.0009270475,0.0017936315,0.0014452554,0.0005264979,0.0010591914,0.0023302375,0.0014396886,0.0016127356],"category_scores_gemma":[0.03304116,0.00064193073,0.0019001703,0.0013643313,0.001333944,0.0017239345,0.003131175,0.0026859038,0.0003599212],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038901006,0.00020537274,0.011940714,0.0005797394,0.00039786162,0.00072316994,0.0009148353,0.518122,0.0084056435,0.25389504,0.0021410964,0.20228551],"study_design_scores_gemma":[0.000019217408,0.000058006815,0.0006274315,0.000013329396,0.0000189316,0.00012656715,0.000030239915,0.9623343,0.0008592963,0.035284217,0.00060823874,0.000020316646],"about_ca_topic_score_codex":0.0013039892,"about_ca_topic_score_gemma":0.0009830138,"teacher_disagreement_score":0.011684119,"about_ca_system_score_codex":0.00050212845,"about_ca_system_score_gemma":0.0011713611,"threshold_uncertainty_score":0.061792254},"labels":[],"label_agreement":null},{"id":"W4381309562","doi":"10.1177/09622802231181220","title":"Two-stage multivariate Mendelian randomization on multiple outcomes with mixed distributions","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Princess Margaret Cancer Centre; Queen's University; University Health Network","funders":"Natural Sciences and Engineering Research Council of Canada; Princess Margaret Cancer Foundation","keywords":"Mendelian randomization; Multivariate statistics; Univariate; Confounding; Causal inference; Instrumental variable; Multivariate analysis; Statistics; Outcome (game theory); Computer science; Econometrics; Randomized controlled trial; Medicine; Mathematics; Genetic variants; Internal medicine; Biology","score_opus":0.7000715705924438,"score_gpt":0.7152868082466625,"score_spread":0.015215237654218616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4381309562","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027159962,0.00016927964,0.99595475,0.00018334102,0.00004852025,0.00034871136,0.00008163727,0.00029470265,0.00020306236],"genre_scores_gemma":[0.08853259,0.00036075816,0.9066014,0.00042879797,0.0001255137,0.0026474225,0.00021822113,0.00014615353,0.00093913486],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96392196,0.030275788,0.0009077766,0.0024494382,0.0018825063,0.0005625311],"domain_scores_gemma":[0.95552963,0.037663277,0.002438442,0.0028084074,0.0011267862,0.00043348037],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038889322,0.0016283372,0.002946796,0.0017996123,0.0008023706,0.0013122244,0.0030439226,0.00162575,0.0059389663],"category_scores_gemma":[0.07444606,0.0009033766,0.0024312378,0.0024060798,0.0021146375,0.0019820754,0.0024223262,0.0025969814,0.000679665],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003098493,0.00036487362,0.009922631,0.0010879317,0.0015609409,0.0011411895,0.000593495,0.12984361,0.003073606,0.48797724,0.006481753,0.35485426],"study_design_scores_gemma":[0.0015664774,0.00056382274,0.0012826214,0.00013288455,0.000342676,0.000507635,0.000041201693,0.6847766,0.0019133525,0.30130547,0.0074748993,0.0000923756],"about_ca_topic_score_codex":0.0022322065,"about_ca_topic_score_gemma":0.0024076975,"teacher_disagreement_score":0.038889322,"about_ca_system_score_codex":0.0011856712,"about_ca_system_score_gemma":0.004220571,"threshold_uncertainty_score":0.2056688},"labels":[],"label_agreement":null},{"id":"W4382343881","doi":"10.1177/09622802231181231","title":"A Bayesian genomic selection approach incorporating prior feature ordering and population structures with application to coronary artery disease","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Feature selection; Coronary artery disease; Disease; Bayesian probability; Population; Selection (genetic algorithm); Computer science; Medicine; Machine learning; Artificial intelligence; Internal medicine","score_opus":0.037237744423225125,"score_gpt":0.4451527032697196,"score_spread":0.4079149588464945,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382343881","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008659523,0.00024183317,0.99012846,0.00024417357,0.000021941945,0.00004366928,0.00006387885,0.00016426902,0.00043229398],"genre_scores_gemma":[0.41050377,0.0010381489,0.580501,0.0006421822,0.0003606651,0.0005583802,0.0010736206,0.00020452737,0.0051177316],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970035,0.0019351196,0.00007659512,0.00042085975,0.00039012558,0.00017387996],"domain_scores_gemma":[0.9938024,0.0048314133,0.00027624422,0.0003094178,0.00057900895,0.00020150797],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006496974,0.0009260733,0.0016498743,0.0016651406,0.0008883186,0.00107414,0.0022711451,0.0014343316,0.0025049928],"category_scores_gemma":[0.014353036,0.00074190105,0.0014432727,0.0020283551,0.0009994826,0.0013887297,0.0015048985,0.0016320336,0.0005225447],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027396748,0.0001783237,0.008728223,0.00011374685,0.00037047654,0.00043999584,0.00029040227,0.68464655,0.0021296602,0.07236075,0.0034144437,0.2270534],"study_design_scores_gemma":[0.000050918068,0.000046786354,0.0010269702,0.00001695351,0.00005257738,0.00007146229,0.0000165769,0.9698706,0.0002010918,0.02759074,0.0010320451,0.000023133134],"about_ca_topic_score_codex":0.014326764,"about_ca_topic_score_gemma":0.015539679,"teacher_disagreement_score":0.014326764,"about_ca_system_score_codex":0.0010579121,"about_ca_system_score_gemma":0.0023894897,"threshold_uncertainty_score":0.034359753},"labels":[],"label_agreement":null},{"id":"W4385264158","doi":"10.1177/09622802231188513","title":"A flexible micro-randomized trial design and sample size considerations","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Mobile Health and mHealth Applications","field":"Health Professions","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vector Institute; University of Toronto","funders":"University of California, San Francisco; Agency for Healthcare Research and Quality; Ministry of Education - Singapore; Ministry of Education, India; Duke-NUS Medical School","keywords":"Randomized controlled trial; Calculator; Sample size determination; Computer science; Psychological intervention; Sample (material); Computerized adaptive testing; Statistic; Research design; Extant taxon; Medicine; Statistics; Mathematics; Clinical psychology; Nursing","score_opus":0.4291837682673149,"score_gpt":0.6933266062721429,"score_spread":0.264142838004828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385264158","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059638666,0.00097501744,0.9387538,0.003059704,0.0010642438,0.046401694,0.00054601487,0.0005166958,0.0027190056],"genre_scores_gemma":[0.0751108,0.00030756096,0.8047562,0.0020056316,0.00024876778,0.116142526,0.00016709461,0.000073925585,0.0011874319],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.60615534,0.35070115,0.014723597,0.009666691,0.01716123,0.0015919722],"domain_scores_gemma":[0.60554963,0.345372,0.010450801,0.027341887,0.009577189,0.0017083542],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.32937506,0.00196267,0.0043175956,0.0018702328,0.0012991676,0.0028952511,0.004767008,0.0052440874,0.011306566],"category_scores_gemma":[0.4493489,0.0019075222,0.004333707,0.0021856346,0.0039614215,0.004830785,0.0032491942,0.006376213,0.001613804],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.030030696,0.0020884145,0.0073820218,0.010042862,0.00419797,0.0008991744,0.002078233,0.07435016,0.0049777827,0.43394023,0.018282399,0.41173002],"study_design_scores_gemma":[0.03281329,0.022734022,0.0063454974,0.0029618274,0.00393673,0.00089350686,0.00031767387,0.319152,0.009460726,0.51556075,0.08543436,0.00038970914],"about_ca_topic_score_codex":0.0008050025,"about_ca_topic_score_gemma":0.0010179082,"teacher_disagreement_score":0.32937506,"about_ca_system_score_codex":0.0022228812,"about_ca_system_score_gemma":0.006104305,"threshold_uncertainty_score":0.82699996},"labels":[],"label_agreement":null},{"id":"W4385897997","doi":"10.1177/09622802231194753","title":"Does it decay? Obtaining decaying correlation parameter values from previously analysed cluster randomised trials","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Health and Medical Research Council; Medical Research Council","keywords":"Correlation; Intracluster medium; Cluster (spacecraft); Statistics; Confidence interval; Physics; Computer science; Mathematics; Galaxy cluster; Astrophysics","score_opus":0.36825796646254416,"score_gpt":0.6185888883650825,"score_spread":0.25033092190253836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385897997","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01613729,0.0046586706,0.9594702,0.0070062703,0.0009753936,0.0026522507,0.0016714482,0.002375318,0.0050531453],"genre_scores_gemma":[0.39453152,0.002363972,0.5737185,0.008925145,0.00051641354,0.014896284,0.0015413931,0.0016862464,0.0018205427],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.52341145,0.38528875,0.03610192,0.027236948,0.025384635,0.0025763197],"domain_scores_gemma":[0.098465994,0.7672425,0.04041075,0.08130407,0.011873908,0.0007027675],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.45920348,0.0027812938,0.005252243,0.0030291567,0.0014318812,0.009149702,0.0063896766,0.0067248777,0.00932618],"category_scores_gemma":[0.8670749,0.0030411237,0.0077790823,0.0045190393,0.00717729,0.015014197,0.005894535,0.011852065,0.0028947655],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00859785,0.0004058203,0.050497953,0.020044785,0.01585244,0.0013592441,0.013526327,0.076823525,0.0026484863,0.26724872,0.032235563,0.5107592],"study_design_scores_gemma":[0.0025654247,0.0023744998,0.017282464,0.011774884,0.0056431056,0.0015073684,0.0010600376,0.16052976,0.007628957,0.7377838,0.05099499,0.0008547587],"about_ca_topic_score_codex":0.0019972725,"about_ca_topic_score_gemma":0.0015650614,"teacher_disagreement_score":0.5407965,"about_ca_system_score_codex":0.00445825,"about_ca_system_score_gemma":0.005208177,"threshold_uncertainty_score":0.6668984},"labels":[],"label_agreement":null},{"id":"W4387033470","doi":"10.1177/09622802231202384","title":"Marginal structural models with latent class growth analysis of treatment trajectories: Statins for primary prevention among older adults","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; University of Manitoba; Institut National de Santé Publique du Québec; McGill University Health Centre; Université de Sherbrooke; Université Laval; Université de Montréal; McGill University; Centre hospitalier de l'Université Laval","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research; Université Laval","keywords":"Marginal structural model; Covariate; Confounding; Latent class model; Proportional hazards model; Estimator; Statistics; Econometrics; Confidence interval; Latent variable; Estimating equations; Inverse probability; Computer science; Mathematics; Medicine; Bayesian probability; Posterior probability","score_opus":0.2977127906117732,"score_gpt":0.5958492655166311,"score_spread":0.2981364749048579,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387033470","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05370562,0.00035433035,0.9438305,0.0006358169,0.000034078166,0.00018588107,0.00048160943,0.00022000639,0.00055214897],"genre_scores_gemma":[0.684976,0.0006372265,0.30999336,0.00014481756,0.000072562965,0.00073906063,0.0013199252,0.000096849544,0.0020202503],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99543947,0.003623421,0.000097163276,0.0003839219,0.00030402138,0.00015196539],"domain_scores_gemma":[0.9799154,0.016416118,0.0010958199,0.0014256438,0.00094753224,0.00019945804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013868819,0.0008079123,0.0010743606,0.0017237944,0.000627044,0.001095103,0.0020128416,0.0007302897,0.002347401],"category_scores_gemma":[0.037579875,0.000341988,0.0020510752,0.0019611304,0.0012990272,0.001466638,0.0020052353,0.0022341637,0.00026484596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006010961,0.00024532463,0.07429375,0.0002798285,0.0007779866,0.0002833007,0.0016775642,0.45554897,0.0008884882,0.2864519,0.003152848,0.17579901],"study_design_scores_gemma":[0.00003356178,0.000057185985,0.0043044547,0.000035306002,0.00006876882,0.000038690134,0.00012845953,0.9028611,0.00019108882,0.09125916,0.0010010572,0.0000211638],"about_ca_topic_score_codex":0.040154714,"about_ca_topic_score_gemma":0.037778005,"teacher_disagreement_score":0.040154714,"about_ca_system_score_codex":0.0021952812,"about_ca_system_score_gemma":0.0026973202,"threshold_uncertainty_score":0.07984197},"labels":[],"label_agreement":null},{"id":"W4387033650","doi":"10.1177/09622802231198795","title":"Logistic regression vs. predictive mean matching for imputing binary covariates","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":54,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Missing data; Imputation (statistics); Logistic regression; Statistics; Binary data; Parametric statistics; Covariate; Mathematics; Regression analysis; Multivariate statistics; Matching (statistics); Computer science; Binary number","score_opus":0.3427619520314442,"score_gpt":0.6290504285419702,"score_spread":0.286288476510526,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387033650","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013798451,0.0015308191,0.9762683,0.0007939578,0.00031888782,0.00057447614,0.0016070654,0.0026028182,0.0025051355],"genre_scores_gemma":[0.297784,0.0013356953,0.6867305,0.0017132441,0.00033330216,0.0029331837,0.0038056825,0.001468253,0.0038962534],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9536055,0.03427377,0.0024027585,0.005426126,0.003383029,0.00090886373],"domain_scores_gemma":[0.9175589,0.060759876,0.0053648846,0.011517367,0.0042130346,0.0005859397],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.052358236,0.0015884436,0.0027958944,0.002120198,0.0010075297,0.0022487328,0.0032649701,0.0022200805,0.013320961],"category_scores_gemma":[0.15928936,0.0010199633,0.0040524495,0.0040993723,0.0013885915,0.0033522423,0.003486672,0.0044728387,0.003638292],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0040610335,0.0004141762,0.04679423,0.0025844488,0.0040830895,0.0004128937,0.0010223531,0.14838007,0.0018539232,0.12549499,0.032586046,0.6323127],"study_design_scores_gemma":[0.001166286,0.0012248068,0.01117687,0.0011659318,0.0012756775,0.00081501185,0.00019436034,0.72955656,0.006355714,0.20476152,0.042042665,0.00026451336],"about_ca_topic_score_codex":0.0035655827,"about_ca_topic_score_gemma":0.0031202456,"teacher_disagreement_score":0.052358236,"about_ca_system_score_codex":0.0012624022,"about_ca_system_score_gemma":0.0035030856,"threshold_uncertainty_score":0.27690017},"labels":[],"label_agreement":null},{"id":"W4387607247","doi":"10.1177/09622802231197977","title":"A novel rare variants association test for binary traits in family-based designs via copulas","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research","keywords":"Genetic association; Genome-wide association study; Copula (linguistics); Computer science; Score test; Mathematics; Statistics; Data mining; Statistical hypothesis testing; Genetics; Biology; Econometrics; Genotype","score_opus":0.19509139702643266,"score_gpt":0.5361241933542098,"score_spread":0.34103279632777717,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387607247","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04149611,0.00023587668,0.95609957,0.00016831305,0.000053218853,0.00019501004,0.00041826666,0.00052967586,0.00080395903],"genre_scores_gemma":[0.5665861,0.00024281321,0.4297505,0.0003125075,0.00007541885,0.0009029232,0.00083750795,0.00011387353,0.0011783382],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9917762,0.0055902787,0.0002666674,0.001270716,0.0008307057,0.00026531966],"domain_scores_gemma":[0.9742711,0.021012042,0.0017399698,0.0013394087,0.0011422673,0.00049522496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01143612,0.00084361556,0.0016224734,0.0017036744,0.00052220345,0.0010035555,0.0022614733,0.0010350065,0.004173224],"category_scores_gemma":[0.03378781,0.00034438685,0.0014782534,0.0019401865,0.0011903096,0.0010673602,0.0013348992,0.0011730515,0.0005035671],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018361828,0.0005312408,0.12338795,0.00054331985,0.0028626127,0.0019810074,0.00049920066,0.29105657,0.009966153,0.10624905,0.0072668116,0.45381993],"study_design_scores_gemma":[0.00025087854,0.00045545527,0.015354206,0.000036878457,0.00021928431,0.0005670609,0.00006482551,0.95902085,0.0013102584,0.020762576,0.0018933538,0.0000643751],"about_ca_topic_score_codex":0.0045001307,"about_ca_topic_score_gemma":0.003528874,"teacher_disagreement_score":0.01143612,"about_ca_system_score_codex":0.0008082411,"about_ca_system_score_gemma":0.0022764574,"threshold_uncertainty_score":0.060480714},"labels":[],"label_agreement":null},{"id":"W4388498740","doi":"10.1177/09622802231210917","title":"A support vector machine-based cure rate model for interval censored data","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Support vector machine; Interval (graph theory); Interval data; Computer science; Statistics; Data mining; Artificial intelligence; Mathematics; Combinatorics","score_opus":0.5100163218704702,"score_gpt":0.6517688622124422,"score_spread":0.14175254034197204,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388498740","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0207947,0.00045009665,0.9768237,0.00047412273,0.000058112586,0.00008731115,0.0003693695,0.00036677375,0.00057585695],"genre_scores_gemma":[0.7337969,0.001179929,0.2535946,0.00037127105,0.00025005624,0.0010533687,0.0021299038,0.00012815486,0.0074957595],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9964729,0.0017334109,0.00018964702,0.0007666947,0.0005536448,0.00028365053],"domain_scores_gemma":[0.99174047,0.0058261636,0.0008002141,0.00047113723,0.000986085,0.00017579895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007864899,0.0010404448,0.0020009484,0.0016096905,0.00045373317,0.0013954339,0.0031151758,0.0018636511,0.003062533],"category_scores_gemma":[0.019927647,0.0005718657,0.0015867271,0.0018758354,0.0008976597,0.0023087075,0.0009889007,0.003574566,0.00092748395],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004661215,0.00023401788,0.008917282,0.00025025895,0.00016746945,0.0002592695,0.000288014,0.7736384,0.001418138,0.079693936,0.0035399348,0.13112716],"study_design_scores_gemma":[0.000014029426,0.000060893297,0.00066645176,0.000014493112,0.000015236351,0.000050207967,0.000009401483,0.98819613,0.00014987316,0.010167925,0.0006392039,0.000016141534],"about_ca_topic_score_codex":0.0046751923,"about_ca_topic_score_gemma":0.0023139114,"teacher_disagreement_score":0.007864899,"about_ca_system_score_codex":0.0010437582,"about_ca_system_score_gemma":0.0010557275,"threshold_uncertainty_score":0.04159403},"labels":[],"label_agreement":null},{"id":"W4389765971","doi":"10.1177/09622802231215804","title":"Privacy-preserving analysis of time-to-event data under nested case-control sampling","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Privacy-Preserving Technologies in Data","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Nested case-control study; Pooling; Computer science; Estimator; Event (particle physics); Data mining; Covariate; Sampling (signal processing); Statistics; Proportional hazards model; Regression analysis; Econometrics; Cohort; Machine learning; Artificial intelligence; Mathematics","score_opus":0.29428541173847383,"score_gpt":0.5638527579653154,"score_spread":0.2695673462268416,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389765971","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01655736,0.00021260882,0.9819264,0.00032132101,0.000027210113,0.000114266644,0.00030462243,0.00019199346,0.00034424782],"genre_scores_gemma":[0.69681364,0.00090402336,0.29610538,0.00051236415,0.00027545556,0.00083974074,0.0019988448,0.000120442906,0.0024301126],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98082364,0.012173576,0.0008435112,0.0027855374,0.0026876715,0.00068608666],"domain_scores_gemma":[0.88210374,0.0941945,0.007284076,0.012228624,0.002996892,0.0011921357],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036390357,0.0012647718,0.001848272,0.0013060122,0.0008228214,0.0019227993,0.0036503891,0.001278139,0.0019003936],"category_scores_gemma":[0.10044298,0.0010535632,0.0020113823,0.0015601981,0.0030807178,0.002735875,0.003437563,0.0024874534,0.00035783934],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00102195,0.0002556781,0.021937782,0.00045616948,0.0006490371,0.001965443,0.0010006557,0.65296274,0.0043036784,0.22078438,0.0029039774,0.091758475],"study_design_scores_gemma":[0.00006024109,0.00009806728,0.0012911925,0.00002165536,0.00005566159,0.0002297915,0.00004581332,0.90635514,0.0013207847,0.08973726,0.0007618167,0.000022486402],"about_ca_topic_score_codex":0.0026945844,"about_ca_topic_score_gemma":0.0015505886,"teacher_disagreement_score":0.036390357,"about_ca_system_score_codex":0.0012855148,"about_ca_system_score_gemma":0.0027189676,"threshold_uncertainty_score":0.19245285},"labels":[],"label_agreement":null},{"id":"W4391635477","doi":"10.1177/09622802241227957","title":"Covariate adjustment in Bayesian adaptive randomized controlled trials","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds de recherche du Québec – Nature et technologies; Alliance de recherche numérique du Canada; Fonds de Recherche du Québec - Santé; Compute Canada","keywords":"Covariate; Frequentist inference; Statistics; Econometrics; Bayesian probability; Early stopping; Propensity score matching; Sample size determination; Bayes' theorem; Statistical power; Computer science; Mathematics; Bayesian inference; Machine learning","score_opus":0.7649940798972175,"score_gpt":0.7342759921159407,"score_spread":0.030718087781276715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391635477","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059553003,0.0037906733,0.9860967,0.0012280945,0.00020225476,0.0009279962,0.00018989426,0.00040076397,0.0012083169],"genre_scores_gemma":[0.3235801,0.004035523,0.66243577,0.0017022346,0.0003679049,0.0058887405,0.0004921914,0.00019493123,0.0013025423],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7811991,0.20310985,0.00435362,0.004621641,0.00581238,0.00090342935],"domain_scores_gemma":[0.8017408,0.17105298,0.012234882,0.010320791,0.0038682155,0.00078235957],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1151248,0.0014463534,0.0029838784,0.0018988773,0.00075983634,0.0021917745,0.0031996625,0.003435589,0.0029783356],"category_scores_gemma":[0.33534616,0.0012579168,0.0026893432,0.002977346,0.0028077716,0.0035758775,0.0024247677,0.004495182,0.0007007582],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0068351245,0.0003124624,0.010701455,0.0039391494,0.0029503882,0.0003944802,0.00091293163,0.21269056,0.0015322899,0.37762898,0.0074392417,0.37466288],"study_design_scores_gemma":[0.004422166,0.0018254999,0.0025658773,0.0010887131,0.00088124844,0.00032713744,0.00007595543,0.402828,0.0015465788,0.5693859,0.01487158,0.00018129432],"about_ca_topic_score_codex":0.0015238225,"about_ca_topic_score_gemma":0.0010473626,"teacher_disagreement_score":0.8848752,"about_ca_system_score_codex":0.0017632399,"about_ca_system_score_gemma":0.003653865,"threshold_uncertainty_score":0.6088454},"labels":[],"label_agreement":null},{"id":"W4393043332","doi":"10.1177/09622802231225963","title":"A latent class linear mixed model for monotonic continuous processes measured with error","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University Health Network; Western University","funders":"Alliance de recherche numérique du Canada; Innovation, Science and Economic Development Canada; National Institute of Mental Health; University of Toronto; National Institute of Arthritis and Musculoskeletal and Skin Diseases; Dirección General de Asuntos del Personal Académico, Universidad Nacional Autónoma de México","keywords":"Monotonic function; Latent class model; Bayesian probability; Mathematics; Statistics; Class (philosophy); Homogeneous; Computer science; Observational error; Applied mathematics; Econometrics; Artificial intelligence; Mathematical analysis; Combinatorics","score_opus":0.18046242781057098,"score_gpt":0.5227246603787071,"score_spread":0.34226223256813615,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393043332","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0055379895,0.0004268607,0.9922856,0.0005376285,0.00006130925,0.00007630926,0.00027525736,0.00011052127,0.0006884595],"genre_scores_gemma":[0.39945218,0.0021414794,0.57871425,0.00075829163,0.00059256254,0.0023192063,0.0018813083,0.00018847453,0.013952224],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99108106,0.0052762483,0.00034023455,0.0018114841,0.0009828858,0.0005080585],"domain_scores_gemma":[0.9820024,0.013763574,0.0018200172,0.0010023536,0.0011002796,0.00031142854],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013413903,0.0018627057,0.0026913953,0.0022107793,0.00081114675,0.003375252,0.005289798,0.0032619783,0.004353388],"category_scores_gemma":[0.029598273,0.0010699776,0.0028828362,0.0026812726,0.002604602,0.003857529,0.0025254653,0.004482712,0.0013774328],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032870984,0.0001936324,0.0060698898,0.0003937255,0.00044563957,0.0003126981,0.0008336867,0.25448698,0.0016333654,0.6748051,0.0026059034,0.057890672],"study_design_scores_gemma":[0.00006455162,0.0001247561,0.0010575653,0.00009980936,0.00013094668,0.00010421288,0.000056599827,0.8096218,0.00036273547,0.18520464,0.0031040069,0.00006838653],"about_ca_topic_score_codex":0.006335697,"about_ca_topic_score_gemma":0.005853545,"teacher_disagreement_score":0.013413903,"about_ca_system_score_codex":0.0021942495,"about_ca_system_score_gemma":0.0021850304,"threshold_uncertainty_score":0.070940375},"labels":[],"label_agreement":null},{"id":"W4394847663","doi":"10.1177/09622802241242313","title":"Estimating dynamic treatment regimes for ordinal outcomes with household interference: Application in household smoking cessation","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Government of Ontario","keywords":"Odds; Ordinal regression; Smoking cessation; Covariate; Robustness (evolution); Ordered logit; Context (archaeology); Econometrics; Ordinal data; Propensity score matching; Computer science; Odds ratio; Statistics; Medicine; Mathematics; Logistic regression","score_opus":0.3968361982278458,"score_gpt":0.6277471862914228,"score_spread":0.23091098806357696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394847663","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02785047,0.00023958208,0.9705218,0.00036624345,0.00001993014,0.00016193518,0.00008169276,0.0000838719,0.0006744858],"genre_scores_gemma":[0.64979124,0.0005460155,0.3466001,0.00029412884,0.000083384635,0.0007592029,0.00028445266,0.00006431328,0.001577301],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98903406,0.008339508,0.00035083527,0.0011281578,0.0008063995,0.00034093304],"domain_scores_gemma":[0.95666796,0.0365886,0.0033692326,0.0022705577,0.00074885366,0.0003548799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017270936,0.0006459462,0.0019335911,0.00082932995,0.00068976206,0.0011539469,0.0018381823,0.00135041,0.003091587],"category_scores_gemma":[0.06778213,0.00066693523,0.0015128469,0.0013741166,0.001268983,0.0018530648,0.0023970557,0.0021657425,0.00020526587],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051005924,0.0004286763,0.022050153,0.00031852358,0.0007701056,0.0003246614,0.00070685847,0.630817,0.0010656829,0.13800953,0.0012156769,0.20378315],"study_design_scores_gemma":[0.000071883296,0.00013923888,0.0022167782,0.000043984142,0.00009000782,0.000050289036,0.00008097649,0.9058989,0.00041419055,0.08957633,0.0013897391,0.000027614653],"about_ca_topic_score_codex":0.0054202713,"about_ca_topic_score_gemma":0.0036791693,"teacher_disagreement_score":0.017270936,"about_ca_system_score_codex":0.0012345045,"about_ca_system_score_gemma":0.0017528081,"threshold_uncertainty_score":0.091338515},"labels":[],"label_agreement":null},{"id":"W4395113354","doi":"10.1177/09622802241247742","title":"The performance of marginal structural models for estimating risk differences and relative risks using weighted univariate generalized linear models","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Statistics; Mathematics; Estimator; Weighting; Univariate; Generalized linear model; Sample size determination; Econometrics; Multivariate statistics; Medicine","score_opus":0.5319458761194644,"score_gpt":0.6391596200709405,"score_spread":0.10721374395147609,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395113354","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.056834288,0.00088692195,0.9393739,0.00056086044,0.00007249509,0.00039003932,0.0003138439,0.0004497124,0.0011178183],"genre_scores_gemma":[0.41568252,0.0006434721,0.58019364,0.00024755148,0.000058063415,0.001803778,0.00044378813,0.00027720284,0.00065000256],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8785439,0.111089535,0.0024610448,0.0037272838,0.0034214167,0.00075670844],"domain_scores_gemma":[0.6106351,0.36100984,0.009698137,0.012626404,0.0052751596,0.000755364],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13859008,0.0019409595,0.0027828524,0.0039370097,0.0007665089,0.0027866806,0.0037030177,0.0019595472,0.003828162],"category_scores_gemma":[0.348771,0.0013907738,0.0053972877,0.003693048,0.0021245284,0.0044101155,0.0034219185,0.0036144555,0.0005245841],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011495886,0.00018422955,0.022047825,0.00074721564,0.0031548413,0.0002408411,0.0011269338,0.7811946,0.00062927743,0.09214615,0.0012841497,0.096094295],"study_design_scores_gemma":[0.00017598098,0.00033724928,0.002976185,0.00023477417,0.00038552305,0.000079090234,0.00012766897,0.9388224,0.00048582707,0.055310242,0.0009695978,0.00009553989],"about_ca_topic_score_codex":0.013399814,"about_ca_topic_score_gemma":0.012383534,"teacher_disagreement_score":0.8614099,"about_ca_system_score_codex":0.0025522618,"about_ca_system_score_gemma":0.003403403,"threshold_uncertainty_score":0.7329432},"labels":[],"label_agreement":null},{"id":"W4396555757","doi":"10.1177/09622802241247736","title":"Sample size and power calculation for testing treatment effect heterogeneity in cluster randomized crossover designs","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Center for Advancing Translational Sciences; National Institute on Aging; National Institutes of Health; Patient-Centered Outcomes Research Institute","keywords":"Crossover; Sample size determination; Crossover study; Covariate; Randomized controlled trial; Statistics; Statistical power; Cluster (spacecraft); Cluster size; Statistical hypothesis testing; Computer science; Mathematics; Medicine; Artificial intelligence","score_opus":0.7061155154350921,"score_gpt":0.7199084202257027,"score_spread":0.013792904790610572,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396555757","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002366952,0.00088096625,0.9915165,0.0004546164,0.00020022475,0.0029511023,0.0001430598,0.00023309936,0.0012536254],"genre_scores_gemma":[0.07574241,0.0006578445,0.900988,0.00054269296,0.00020128551,0.021029437,0.00020925252,0.00018042841,0.00044873566],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85493845,0.12423991,0.0057265526,0.004669416,0.009774924,0.0006507549],"domain_scores_gemma":[0.675536,0.29664293,0.007938221,0.011857856,0.007469312,0.00055568485],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13283114,0.0016542793,0.003057661,0.0047090678,0.0010570276,0.0016083722,0.003340031,0.0029786485,0.00630199],"category_scores_gemma":[0.42202798,0.0010551779,0.0026982927,0.0037677558,0.003338273,0.0025840017,0.00231661,0.0046073324,0.0007482836],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024051473,0.00040251703,0.006181429,0.0040451735,0.0017420929,0.0004470205,0.0010904089,0.041804537,0.0020691417,0.32888404,0.013221294,0.59770715],"study_design_scores_gemma":[0.006224612,0.0037977835,0.008076699,0.0029160941,0.0017451511,0.0012292434,0.00034308084,0.36993727,0.009025371,0.5543576,0.04207493,0.00027218155],"about_ca_topic_score_codex":0.0008385949,"about_ca_topic_score_gemma":0.00065224216,"teacher_disagreement_score":0.86716884,"about_ca_system_score_codex":0.0018957846,"about_ca_system_score_gemma":0.0039918097,"threshold_uncertainty_score":0.70248663},"labels":[],"label_agreement":null},{"id":"W4398235233","doi":"10.1177/09622802241254197","title":"Demystifying estimands in cluster-randomised trials","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"National Center for Advancing Translational Sciences; National Heart, Lung, and Blood Institute; Medical Research Council; National Institutes of Health; Patient-Centered Outcomes Research Institute","keywords":"Estimator; Cluster (spacecraft); Cluster randomised controlled trial; Consistency (knowledge bases); Econometrics; Statistics; Odds; Psychology; Computer science; Logistic regression; Mathematics; Artificial intelligence; Intervention (counseling); Psychiatry","score_opus":0.4900046249090602,"score_gpt":0.6860493952461615,"score_spread":0.19604477033710127,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398235233","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016494504,0.0056117186,0.98298395,0.0056091794,0.00085112476,0.0010180725,0.00021463091,0.00028185674,0.0017799282],"genre_scores_gemma":[0.08326042,0.0034574769,0.8982137,0.0047753965,0.0010268642,0.007818195,0.00030296153,0.00032273005,0.0008224086],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.36055985,0.5604565,0.039620515,0.011773546,0.026120095,0.0014695683],"domain_scores_gemma":[0.20323025,0.7036929,0.03101403,0.050219405,0.011085919,0.00075749506],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.48826525,0.0023207357,0.0057734107,0.0065091425,0.0020789367,0.010798194,0.006848787,0.0065762354,0.00304871],"category_scores_gemma":[0.74871737,0.0027844526,0.006591957,0.007236928,0.014161032,0.017869147,0.00926322,0.016765827,0.00096155226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005995094,0.00005474649,0.003133778,0.00596445,0.0018021311,0.0002598661,0.0030439673,0.013447937,0.00038477094,0.8324956,0.0059730764,0.13284011],"study_design_scores_gemma":[0.00031772768,0.0002187172,0.00075334375,0.0031904408,0.0005563795,0.00019225413,0.0002397879,0.019348633,0.0010497004,0.95518786,0.018814068,0.00013111504],"about_ca_topic_score_codex":0.0024840601,"about_ca_topic_score_gemma":0.0019770411,"teacher_disagreement_score":0.5117347,"about_ca_system_score_codex":0.0069510294,"about_ca_system_score_gemma":0.01153259,"threshold_uncertainty_score":0.63106006},"labels":[],"label_agreement":null},{"id":"W4399131742","doi":"10.1177/09622802241248382","title":"Maintaining the validity of inference from linear mixed models in stepped-wedge cluster randomized trials under misspecified random-effects structures","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Center for Advancing Translational Sciences; Patient-Centered Outcomes Research Institute; National Institute on Aging; National Institutes of Health; Canadian Institutes of Health Research; Alliance de recherche numérique du Canada","keywords":"Estimator; Random effects model; Statistics; Linear model; Mathematics; Mixed model; Robust statistics; Variance (accounting); Cluster (spacecraft); Computer science; Econometrics","score_opus":0.46295632730046754,"score_gpt":0.6140813913553269,"score_spread":0.15112506405485937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399131742","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039357822,0.0013371357,0.99052304,0.0015999353,0.0001558528,0.0005541082,0.00031528654,0.00028210264,0.0012968408],"genre_scores_gemma":[0.21006708,0.002120715,0.7765323,0.0032450145,0.00044034887,0.0050923037,0.00082859,0.00043578434,0.0012378837],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.73898304,0.21930675,0.010490582,0.015629834,0.014021653,0.0015681447],"domain_scores_gemma":[0.27451232,0.659463,0.01996073,0.03523287,0.010153524,0.00067760947],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2822117,0.0025264146,0.0054146014,0.0028707844,0.001725534,0.006643208,0.007861287,0.0061389417,0.0045368983],"category_scores_gemma":[0.7019325,0.0024941901,0.0058629503,0.003710583,0.00869045,0.008996081,0.00557448,0.008961902,0.001486008],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012484288,0.00021298422,0.016113218,0.0053136237,0.004932742,0.0011499799,0.0030269374,0.14445068,0.0011257074,0.6006798,0.0076594222,0.21408655],"study_design_scores_gemma":[0.00073399185,0.0005250638,0.0028467174,0.0017082316,0.0009437755,0.00045147273,0.00038352862,0.2264386,0.002164093,0.7546214,0.009003225,0.00017988306],"about_ca_topic_score_codex":0.0039803847,"about_ca_topic_score_gemma":0.0024664598,"teacher_disagreement_score":0.71778834,"about_ca_system_score_codex":0.0034929698,"about_ca_system_score_gemma":0.009136275,"threshold_uncertainty_score":0.8851608},"labels":[],"label_agreement":null},{"id":"W4399385251","doi":"10.1177/09622802241254211","title":"Group sequential methods based on supremum logrank statistics under proportional and nonproportional hazards","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Ligue Contre le Cancer","keywords":"Infimum and supremum; Log-rank test; Statistics; Proportional hazards model; Interim analysis; Interim; Monte Carlo method; Statistical hypothesis testing; Multiple comparisons problem; Computer science; Mathematics; Clinical trial; Medicine; Internal medicine; Law","score_opus":0.6393074929333418,"score_gpt":0.7234070603281539,"score_spread":0.08409956739481217,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399385251","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015361959,0.00009743428,0.997563,0.000077357276,0.000036638907,0.0001504314,0.000023495279,0.00015126866,0.00036411066],"genre_scores_gemma":[0.07354215,0.00030563402,0.9224048,0.0001645685,0.00021682723,0.0016380431,0.00012367859,0.00019807275,0.0014061579],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98264205,0.013654236,0.00048829656,0.0008715132,0.0021142205,0.0002296474],"domain_scores_gemma":[0.94603974,0.045384582,0.0025917701,0.0035297791,0.0019839325,0.00047019662],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026448643,0.00120806,0.0019173467,0.0022208209,0.0006573406,0.0013950884,0.0021048386,0.0014784124,0.008434972],"category_scores_gemma":[0.078629605,0.00054261484,0.0012916389,0.0019091208,0.0023145273,0.0023132393,0.0019560661,0.0031526017,0.00170231],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010829181,0.00025081422,0.0035060092,0.00077343424,0.00028680096,0.0005119997,0.00068685156,0.11640225,0.0037666198,0.4225176,0.0052918517,0.44492286],"study_design_scores_gemma":[0.00048304413,0.000982652,0.0008575638,0.00013478576,0.00009721901,0.0004638555,0.00007701005,0.591179,0.0034641474,0.3939331,0.008265117,0.0000624871],"about_ca_topic_score_codex":0.00063628645,"about_ca_topic_score_gemma":0.00081881636,"teacher_disagreement_score":0.97355133,"about_ca_system_score_codex":0.0007405846,"about_ca_system_score_gemma":0.0020393836,"threshold_uncertainty_score":0.13987541},"labels":[],"label_agreement":null},{"id":"W4400969513","doi":"10.1177/09622802241262521","title":"Analyzing heterogeneity in biomarker discriminative performance through partial time-dependent receiver operating characteristic curve modeling","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"AI in cancer detection","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Diabetes and Digestive and Kidney Diseases; National Cancer Institute; National Institute on Aging; Canadian Institutes of Health Research; National Institutes of Health; Genentech; IXICO; H. Lundbeck A/S; Servier; Eisai; Northern California Institute for Research and Education; University of Texas at Austin; Pfizer; Novartis Pharmaceuticals Corporation; U.S. Department of Defense; Alzheimer's Disease Neuroimaging Initiative; Meso Scale Diagnostics; University of Southern California; BioClinica; Bristol-Myers Squibb; Eli Lilly and Company; Biogen","keywords":"Discriminative model; Receiver operating characteristic; Biomarker; Computer science; Artificial intelligence; Biology; Machine learning","score_opus":0.19317553433438792,"score_gpt":0.5356551573303712,"score_spread":0.3424796229959832,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400969513","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36241424,0.0015714149,0.6317602,0.0013111169,0.000060830036,0.00025189485,0.00093261164,0.00044611268,0.0012516696],"genre_scores_gemma":[0.9728123,0.0002469381,0.025547309,0.00020432919,0.000072951414,0.00017303956,0.0005736437,0.000042134798,0.000327365],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9785321,0.016123027,0.000819754,0.0025081658,0.0015242224,0.00049280503],"domain_scores_gemma":[0.77342474,0.19240884,0.014805428,0.014704298,0.003849926,0.00080666743],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05469594,0.0009456564,0.0019666606,0.0026490605,0.00046288763,0.0021813677,0.001998655,0.0014998356,0.0009801311],"category_scores_gemma":[0.16968383,0.00041803785,0.002316328,0.0028803868,0.0018859367,0.0024226487,0.0017281093,0.001638651,0.0002490565],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016456137,0.00029205825,0.40773326,0.0004324842,0.0036127155,0.0009978401,0.0012212413,0.4013043,0.0034070762,0.039061245,0.0019417048,0.13835047],"study_design_scores_gemma":[0.00010681454,0.0007037904,0.06891069,0.00007456963,0.0006347892,0.000781026,0.0002075195,0.865557,0.0019253914,0.05890284,0.0020770363,0.00011859904],"about_ca_topic_score_codex":0.0021520252,"about_ca_topic_score_gemma":0.0010376766,"teacher_disagreement_score":0.05469594,"about_ca_system_score_codex":0.0008463778,"about_ca_system_score_gemma":0.001382226,"threshold_uncertainty_score":0.2892633},"labels":[],"label_agreement":null},{"id":"W4400969532","doi":"10.1177/09622802241262527","title":"Minimizing confounding in comparative observational studies with time-to-event outcomes: An extensive comparison of covariate balancing methods using Monte Carlo simulation","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"","keywords":"Covariate; Confounding; Observational study; Monte Carlo method; Econometrics; Computer science; Statistics; Event (particle physics); Mathematics","score_opus":0.8432242746118068,"score_gpt":0.7654410243786494,"score_spread":0.07778325023315746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400969532","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13135527,0.009116324,0.8518018,0.0013985928,0.00016275681,0.0021689862,0.00026734953,0.0002761375,0.0034527755],"genre_scores_gemma":[0.61165947,0.0033329574,0.38018894,0.0004973469,0.00012846087,0.003303485,0.0002906698,0.00011522364,0.00048343712],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8425495,0.14683673,0.0038932997,0.0021651287,0.0041483934,0.00040692795],"domain_scores_gemma":[0.36825258,0.60662997,0.008374231,0.01191042,0.004187998,0.00064482883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18000585,0.001422689,0.0029926214,0.002475345,0.00066416623,0.001997784,0.0022089614,0.0021742717,0.0020021286],"category_scores_gemma":[0.36879927,0.0009334116,0.0035124165,0.0020449872,0.0016534477,0.0032109225,0.002918087,0.0017501785,0.00012547479],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0044430527,0.0005727911,0.017518593,0.0015490174,0.0057443604,0.0001320099,0.0010375424,0.7814373,0.0006007452,0.048015345,0.00078188034,0.13816735],"study_design_scores_gemma":[0.0016357236,0.0025875664,0.008166098,0.0012088644,0.001566665,0.00016939317,0.00023249153,0.9156039,0.0011063074,0.063369855,0.004183772,0.00016933243],"about_ca_topic_score_codex":0.002736044,"about_ca_topic_score_gemma":0.0026753435,"teacher_disagreement_score":0.18000585,"about_ca_system_score_codex":0.002068789,"about_ca_system_score_gemma":0.0028651212,"threshold_uncertainty_score":0.9519733},"labels":[],"label_agreement":null},{"id":"W4401390114","doi":"10.1177/09622802241267812","title":"Inference for restricted mean survival time as a function of restriction time under length-biased sampling","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Fundamental Research Funds for the Central Universities; Health Canada; Medical Research Council; Pfizer Canada; National Institutes of Health; Medical Research Council Canada; National Natural Science Foundation of China; Pfizer; University of International Business and Economics; Southwestern University of Finance and Economics","keywords":"Estimator; Covariate; Statistics; Survival function; Mathematics; Inference; Sampling (signal processing); Sample size determination; Survival analysis; Function (biology); Econometrics; Computer science; Artificial intelligence; Biology","score_opus":0.39626837284745836,"score_gpt":0.617300448325334,"score_spread":0.22103207547787568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401390114","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014013357,0.00033206883,0.9849978,0.00018542015,0.000019519595,0.00005160878,0.00007928579,0.00010939529,0.00021156088],"genre_scores_gemma":[0.4585984,0.002181452,0.53319,0.0004782698,0.00030126047,0.0011441797,0.0013641274,0.000230121,0.002512026],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98747265,0.008570355,0.0005341441,0.0019616513,0.0010561395,0.00040492023],"domain_scores_gemma":[0.82903117,0.15049715,0.009383197,0.0075668255,0.0027296806,0.00079196785],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048238073,0.00125129,0.002759938,0.002145099,0.00070622854,0.001736087,0.0028315198,0.002029252,0.002271052],"category_scores_gemma":[0.15784231,0.00095374975,0.002468745,0.0021836648,0.003475751,0.0034539374,0.0028674859,0.003329174,0.00041146154],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00066669617,0.00020315745,0.04090751,0.00077441323,0.0008176529,0.0009007259,0.001319246,0.44611612,0.0038322986,0.38060305,0.002344548,0.12151449],"study_design_scores_gemma":[0.00009597336,0.00017697747,0.004398983,0.00013840978,0.00023170147,0.00038739468,0.00009294227,0.8125325,0.0016141168,0.17861266,0.0016475441,0.000070854374],"about_ca_topic_score_codex":0.003404382,"about_ca_topic_score_gemma":0.0023386388,"teacher_disagreement_score":0.048238073,"about_ca_system_score_codex":0.0017774218,"about_ca_system_score_gemma":0.0026674173,"threshold_uncertainty_score":0.25511032},"labels":[],"label_agreement":null},{"id":"W4401959276","doi":"10.1177/09622802241259175","title":"Unsupervised Liu-type shrinkage estimators for mixture of regression models","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Multicollinearity; Covariate; Estimator; Regression; Expectation–maximization algorithm; Computer science; Statistics; Shrinkage estimator; Regression analysis; Lasso (programming language); Artificial intelligence; Mathematics; Econometrics; Maximum likelihood","score_opus":0.13749339727712664,"score_gpt":0.5495093220074783,"score_spread":0.41201592473035165,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401959276","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020041992,0.000071350885,0.9976325,0.00004012336,0.0000069215994,0.000015039259,0.00002043403,0.00010050436,0.000108857734],"genre_scores_gemma":[0.11867428,0.0005063436,0.8767307,0.00016987228,0.00014168637,0.0005106786,0.0005500202,0.00024517192,0.0024712181],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9962619,0.0024725143,0.00014419937,0.0004920151,0.00052232126,0.00010701873],"domain_scores_gemma":[0.9862076,0.00974682,0.0012446179,0.0012725858,0.0013766458,0.00015158152],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012557857,0.00088264,0.0014470649,0.0015038514,0.00045595807,0.00092115666,0.0024944937,0.0015273315,0.0015005678],"category_scores_gemma":[0.03555128,0.0007341537,0.0015089149,0.0013688111,0.0013329592,0.002218201,0.002002078,0.002428077,0.00092030666],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020738672,0.00017359616,0.007744097,0.00037146025,0.00040633828,0.00014059841,0.00043048456,0.5034709,0.008842927,0.16396092,0.0050915764,0.30915976],"study_design_scores_gemma":[0.00001700716,0.000035186862,0.0007216815,0.00002445973,0.000020930116,0.000051445804,0.000012284285,0.9687816,0.0013680528,0.027465727,0.0014762436,0.00002540738],"about_ca_topic_score_codex":0.0009692785,"about_ca_topic_score_gemma":0.0015265871,"teacher_disagreement_score":0.012557857,"about_ca_system_score_codex":0.00065705815,"about_ca_system_score_gemma":0.0009922548,"threshold_uncertainty_score":0.066413045},"labels":[],"label_agreement":null},{"id":"W4403203326","doi":"10.1177/09622802241268466","title":"Joint modeling of zero-inflated longitudinal measurements and time-to-event outcomes with applications to dynamic prediction","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Generalized linear mixed model; Random effects model; Event (particle physics); Computer science; Count data; Poisson distribution; Statistics; Mixed model; Bayesian probability; Markov chain Monte Carlo; Negative binomial distribution; Marginal model; Linear model; Econometrics; Mathematics; Regression analysis; Medicine","score_opus":0.28591415939095105,"score_gpt":0.5747006451452177,"score_spread":0.28878648575426663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403203326","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008484526,0.00042483234,0.9896597,0.0004161823,0.000055013024,0.0000465711,0.00021482057,0.00016585442,0.00053246267],"genre_scores_gemma":[0.58557314,0.001990208,0.40029588,0.0005883413,0.0004459776,0.0011826527,0.0020562685,0.00024951622,0.0076180394],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9901878,0.0054525053,0.00044862804,0.0023288482,0.0010561397,0.00052607036],"domain_scores_gemma":[0.9664283,0.025724405,0.0033159894,0.002518577,0.001491843,0.00052097364],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01843882,0.0013760666,0.0027337645,0.001829368,0.0009049446,0.0024221982,0.0044049346,0.0019754244,0.0029549624],"category_scores_gemma":[0.053093795,0.001284472,0.002440923,0.0025387276,0.0020453786,0.0030104623,0.0033741214,0.0038379505,0.0005695131],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020369737,0.00012972945,0.019335357,0.0002548829,0.0005141676,0.0005343138,0.00073863746,0.60640144,0.0005984573,0.29525852,0.0020072092,0.074023545],"study_design_scores_gemma":[0.00001740393,0.000064981265,0.0015337502,0.00005500234,0.0000747122,0.000098607416,0.000054670883,0.8690026,0.00021952187,0.12709211,0.0017422598,0.000044313667],"about_ca_topic_score_codex":0.009774826,"about_ca_topic_score_gemma":0.0070857825,"teacher_disagreement_score":0.01843882,"about_ca_system_score_codex":0.0016752947,"about_ca_system_score_gemma":0.0028387387,"threshold_uncertainty_score":0.09751493},"labels":[],"label_agreement":null},{"id":"W4403257741","doi":"10.1177/09622802241275401","title":"Comparison of random forest methods for conditional average treatment effect estimation with a continuous treatment","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Random forest; Proxy (statistics); Estimation; Average treatment effect; Statistics; Confounding; Computer science; Treatment effect; Random effects model; Econometrics; Mathematics; Machine learning; Medicine; Propensity score matching; Meta-analysis","score_opus":0.3691927658630903,"score_gpt":0.707653083796802,"score_spread":0.33846031793371173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403257741","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021590484,0.0032834818,0.9727821,0.0005011066,0.00011858433,0.00028133832,0.00017372104,0.000498856,0.0007703801],"genre_scores_gemma":[0.18332489,0.0023709186,0.8110747,0.00028692328,0.00018912637,0.0010541044,0.0005804899,0.0002927405,0.0008260818],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9496184,0.04596017,0.0008812325,0.0013786156,0.0017047261,0.00045681914],"domain_scores_gemma":[0.6814566,0.30369604,0.003465628,0.0055506793,0.004797948,0.0010331043],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09213449,0.0014703899,0.002583922,0.0027703783,0.00074792566,0.0013751194,0.0030143776,0.002192585,0.0025912703],"category_scores_gemma":[0.15733905,0.0007802879,0.0026839157,0.0028610537,0.0011169922,0.0036682088,0.0019524381,0.0028758065,0.0004986193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027597104,0.00038992963,0.012925244,0.0009999786,0.0031160638,0.00015395571,0.00072946463,0.52293706,0.0004718695,0.055850845,0.0036424794,0.39602333],"study_design_scores_gemma":[0.0003585028,0.00033070397,0.0024571323,0.00023046098,0.00027519744,0.00009848664,0.000107803506,0.95527947,0.00034836537,0.03898873,0.0014536177,0.000071567105],"about_ca_topic_score_codex":0.009396535,"about_ca_topic_score_gemma":0.010063118,"teacher_disagreement_score":0.09213449,"about_ca_system_score_codex":0.0013654382,"about_ca_system_score_gemma":0.0032171858,"threshold_uncertainty_score":0.48725957},"labels":[],"label_agreement":null},{"id":"W4403609944","doi":"10.1177/09622802241287707","title":"Graphical methods to illustrate the nature of the relation between a continuous variable and the outcome when using restricted cubic splines with a Cox proportional hazards model","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Proportional hazards model; Outcome (game theory); Hazard; Hazard ratio; Statistics; Mathematics; Variable (mathematics); Regression analysis; Relation (database); Econometrics; Computer science; Confidence interval; Mathematical analysis; Data mining; Mathematical economics","score_opus":0.2313114365674053,"score_gpt":0.5948531851561868,"score_spread":0.3635417485887815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403609944","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006123532,0.00043226688,0.99135274,0.0006051238,0.00022200617,0.00028186763,0.0013492001,0.0024001398,0.0027441543],"genre_scores_gemma":[0.024797438,0.0012720616,0.96350545,0.00088003674,0.00032511947,0.0028601333,0.0012985959,0.0013144792,0.0037467089],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99001795,0.007485679,0.0005449472,0.00050003786,0.0012454614,0.00020600749],"domain_scores_gemma":[0.9465422,0.04559599,0.0026939914,0.002647623,0.0022429726,0.0002772364],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009911587,0.0023725722,0.0008740966,0.0063228044,0.00075297855,0.0023922578,0.0025300737,0.0019588517,0.052445818],"category_scores_gemma":[0.06497856,0.0010097658,0.0022641013,0.004897268,0.0016744368,0.0019462373,0.0025086878,0.0035679587,0.0076332],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035922162,0.00025668237,0.004440745,0.0027986672,0.00043724562,0.0008420438,0.0013110065,0.04986746,0.003491496,0.47961724,0.15862663,0.29795158],"study_design_scores_gemma":[0.00040293278,0.00024887023,0.0032950914,0.0011515623,0.00024278379,0.002224031,0.00040467572,0.15918683,0.003820627,0.45369866,0.37499142,0.0003325475],"about_ca_topic_score_codex":0.0044094604,"about_ca_topic_score_gemma":0.0047403066,"teacher_disagreement_score":0.052445818,"about_ca_system_score_codex":0.0011443829,"about_ca_system_score_gemma":0.0023136837,"threshold_uncertainty_score":0.17544872},"labels":[],"label_agreement":null},{"id":"W4403691889","doi":"10.1177/09622802241282091","title":"Applying survey weights to ordinal regression models for improved inference in outcome-dependent samples with ordinal outcomes","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Institute for Work & Health; Western University; Public Health Ontario; University of Toronto","funders":"Agencia Estatal de Investigación; Natural Sciences and Engineering Research Council of Canada; Ministerio de Ciencia e Innovación; University of Toronto; Instituto de Salud Carlos III; Alliance de recherche numérique du Canada; Generalitat de Catalunya; Innovation, Science and Economic Development Canada","keywords":"Statistics; Ordinal regression; Mathematics; Econometrics; Logistic regression; Ordinal data; Ordered logit; Logit; Outcome (game theory); Regression analysis; Sampling bias; Sample size determination","score_opus":0.4117070033392049,"score_gpt":0.6242060080290859,"score_spread":0.21249900468988098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403691889","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0065306136,0.0004898166,0.9911412,0.00027203702,0.00014004909,0.00043134863,0.00023471552,0.00038654744,0.0003735871],"genre_scores_gemma":[0.14731057,0.00088988745,0.84630513,0.0005104398,0.00021821567,0.0028240988,0.00079131435,0.00027168106,0.00087855675],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.80349505,0.17767158,0.005079777,0.007356644,0.005362288,0.001034648],"domain_scores_gemma":[0.63903254,0.31323045,0.012839398,0.026059097,0.008017847,0.0008206783],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1782217,0.0032016037,0.004051018,0.0062034056,0.0014680044,0.0042417645,0.005495294,0.0030896934,0.0056266063],"category_scores_gemma":[0.43218112,0.0023581132,0.005492483,0.0090307025,0.0027489827,0.0058547105,0.0055589434,0.0071108034,0.0009743032],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009830003,0.00044151145,0.039476976,0.0024838466,0.005483998,0.0007878227,0.0023885076,0.43614954,0.0016181453,0.18732204,0.005347419,0.3175172],"study_design_scores_gemma":[0.00033121443,0.0004129776,0.0041189534,0.00047346912,0.00060525525,0.00015875512,0.00024060445,0.780439,0.0009827653,0.20499071,0.007103754,0.00014255126],"about_ca_topic_score_codex":0.011129647,"about_ca_topic_score_gemma":0.010527626,"teacher_disagreement_score":0.1782217,"about_ca_system_score_codex":0.0022783352,"about_ca_system_score_gemma":0.003394921,"threshold_uncertainty_score":0.9425377},"labels":[],"label_agreement":null},{"id":"W4404422780","doi":"10.1177/09622802241281035","title":"LASSO-type instrumental variable selection methods with an application to Mendelian randomization","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"National Institute on Aging","keywords":"Instrumental variable; Mendelian randomization; Estimator; Lasso (programming language); Heteroscedasticity; Computer science; Jackknife resampling; Econometrics; Statistics; Mathematics","score_opus":0.17063553148990346,"score_gpt":0.6105062295924588,"score_spread":0.43987069810255536,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404422780","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00038045915,0.00015223939,0.9988267,0.00016102257,0.00003606356,0.00005809093,0.00003956926,0.000096474745,0.00024946182],"genre_scores_gemma":[0.039993957,0.0007783438,0.95522845,0.0004718621,0.00023671702,0.0013118048,0.00025975454,0.00018860816,0.0015305786],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9804787,0.016307581,0.0005484276,0.0008749417,0.0015290369,0.00026128645],"domain_scores_gemma":[0.9745345,0.020476222,0.0020746621,0.0015840015,0.0010732762,0.00025731546],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022382539,0.00153634,0.0025195025,0.0017907838,0.00086355885,0.001648308,0.0026783145,0.0017009582,0.0041600605],"category_scores_gemma":[0.054274675,0.00091347063,0.0018507122,0.0026673542,0.001979435,0.0014243129,0.0026363176,0.0039296527,0.0008759204],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024277087,0.00012391726,0.0035964253,0.0007467532,0.00064343156,0.0004136652,0.00030319585,0.15557837,0.0016746325,0.5946444,0.009658241,0.23237415],"study_design_scores_gemma":[0.00023291238,0.00014783649,0.000632019,0.00017654557,0.00008862812,0.00022134926,0.000046503195,0.66680145,0.0013262604,0.3185544,0.011687966,0.000084080675],"about_ca_topic_score_codex":0.001221179,"about_ca_topic_score_gemma":0.0013199269,"teacher_disagreement_score":0.022382539,"about_ca_system_score_codex":0.0008693479,"about_ca_system_score_gemma":0.0028665576,"threshold_uncertainty_score":0.118371606},"labels":[],"label_agreement":null},{"id":"W4405260740","doi":"10.1177/09622802241293768","title":"Hierarchical selection of genetic and gene by environment interaction effects in high-dimensional mixed models","year":2024,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University","funders":"National Institute of Dental and Craniofacial Research; National Institute of Neurological Disorders and Stroke; Fonds de Recherche du Québec - Santé; Compute Canada; University at Buffalo; University of North Carolina at Chapel Hill; National Institutes of Health; National Heart, Lung, and Blood Institute; McGill University; Canada Excellence Research Chairs, Government of Canada; Natural Sciences and Engineering Research Council of Canada; Johns Hopkins University","keywords":"Gene–environment interaction; Selection (genetic algorithm); Random effects model; Computer science; Population; Mixed model; Generalized linear mixed model; Multilevel model; Machine learning; Gene; Genetics; Biology","score_opus":0.062179025335524635,"score_gpt":0.4703002740679868,"score_spread":0.40812124873246214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405260740","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027798269,0.00019371224,0.9711803,0.00015852258,0.000015596588,0.000059060694,0.00009086437,0.00036768362,0.00013599845],"genre_scores_gemma":[0.5201589,0.00036943413,0.4758283,0.00031244953,0.00009862391,0.0005818326,0.00085659226,0.00016752303,0.0016262623],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99098784,0.007347422,0.00024676116,0.0008255565,0.00038325036,0.00020915622],"domain_scores_gemma":[0.9664248,0.02942744,0.0016007534,0.0013717212,0.00079652027,0.00037871746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014027157,0.0011456639,0.0016724421,0.0014018688,0.0007983917,0.0011137897,0.0029432296,0.0013183779,0.0015365859],"category_scores_gemma":[0.026545733,0.000816979,0.0025305348,0.0011269646,0.0015064556,0.0013165916,0.0014682324,0.0017447418,0.00034696868],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004193495,0.00011946274,0.015398674,0.00017272781,0.0008304276,0.0005655217,0.0003036266,0.8907087,0.002036459,0.028519101,0.00107728,0.059848692],"study_design_scores_gemma":[0.000027079075,0.000029511553,0.00071440445,0.000006359203,0.000042748732,0.000032271604,0.000010470165,0.99205256,0.00020176663,0.0067041176,0.00016625575,0.000012450025],"about_ca_topic_score_codex":0.01065334,"about_ca_topic_score_gemma":0.012230827,"teacher_disagreement_score":0.014027157,"about_ca_system_score_codex":0.0010104266,"about_ca_system_score_gemma":0.0015931383,"threshold_uncertainty_score":0.07418364},"labels":[],"label_agreement":null},{"id":"W4405260884","doi":"10.1177/09622802241295335","title":"Marginal semiparametric accelerated failure time cure model for clustered survival data","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"National Cancer Institute; Fundamental Research Funds for the Central Universities; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Accelerated failure time model; Estimator; Semiparametric regression; Semiparametric model; Estimating equations; Correlation; Proportional hazards model; Computer science; Expectation–maximization algorithm; Mathematics; Mixture model; Statistics; Econometrics; Maximum likelihood","score_opus":0.6123641329876975,"score_gpt":0.6574912683814603,"score_spread":0.045127135393762785,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405260884","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02011569,0.00018706106,0.97871166,0.00017363543,0.000022406975,0.00004768003,0.0001534853,0.00016430349,0.00042404162],"genre_scores_gemma":[0.76362246,0.0008905048,0.22442274,0.0002682634,0.00017666633,0.0008266578,0.00143931,0.0001598887,0.008193551],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99734503,0.0015217407,0.0000971458,0.00043363296,0.0003863742,0.00021604948],"domain_scores_gemma":[0.99301696,0.0042416183,0.0009694564,0.0008726572,0.0006818415,0.00021746106],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0073698186,0.00097198394,0.0017743711,0.0015212217,0.00033840808,0.0011188665,0.0027171064,0.0012749449,0.0032838336],"category_scores_gemma":[0.014340608,0.0005741431,0.002428295,0.0014116707,0.0012273525,0.0014835324,0.0016951236,0.002273981,0.00068548776],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036444404,0.0001326631,0.010029458,0.0003176363,0.0003933648,0.0005874263,0.0005778654,0.5941862,0.00420555,0.3116197,0.003031725,0.07455399],"study_design_scores_gemma":[0.000028618355,0.00007893014,0.0017326983,0.000019408297,0.000061893865,0.00015165292,0.00003354873,0.94992274,0.00043852776,0.0459976,0.001501422,0.00003297353],"about_ca_topic_score_codex":0.0024685806,"about_ca_topic_score_gemma":0.0018176612,"teacher_disagreement_score":0.0073698186,"about_ca_system_score_codex":0.000684484,"about_ca_system_score_gemma":0.0011343127,"threshold_uncertainty_score":0.038975775},"labels":[],"label_agreement":null},{"id":"W4405382992","doi":"10.1177/09622802241293750","title":"Approximation to the optimal allocation for response adaptive designs","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Memorial University of Newfoundland","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Sample size determination; Bayesian probability; Statistical power; Mathematical optimization; Markov decision process; Coverage probability; Mathematics; Computer science; Randomization; Posterior probability; Probability distribution; Operator (biology); Statistics; Markov process; Clinical trial; Confidence interval","score_opus":0.8459332953070716,"score_gpt":0.7486349097033211,"score_spread":0.09729838560375048,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405382992","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0070915623,0.00028628166,0.99123025,0.00031409014,0.00003160201,0.00022627767,0.000023279428,0.00008654332,0.0007101179],"genre_scores_gemma":[0.3252993,0.00082575204,0.6670429,0.00061502657,0.00013648221,0.0027970115,0.00017216151,0.00012436557,0.0029870132],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9735931,0.022665694,0.00051732705,0.001185331,0.0014626691,0.00057582394],"domain_scores_gemma":[0.9339477,0.059225094,0.0026856242,0.0015510017,0.0019894347,0.0006011056],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.037847806,0.0017102675,0.003419136,0.0019162018,0.00050903857,0.0013885635,0.0021701562,0.0023957584,0.003933432],"category_scores_gemma":[0.0924604,0.0013302015,0.001742286,0.0014503035,0.0030115386,0.00246261,0.0023729468,0.0033820148,0.0006084081],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00085003814,0.00018406994,0.0014919018,0.0005223384,0.00024028112,0.00013763567,0.0002910581,0.7498275,0.0009920303,0.18819961,0.001328955,0.05593453],"study_design_scores_gemma":[0.000188377,0.00026778012,0.00013676062,0.000051058698,0.000028244332,0.000034873105,0.000015488697,0.9261775,0.00035606662,0.07205964,0.00066821097,0.00001605812],"about_ca_topic_score_codex":0.0015894853,"about_ca_topic_score_gemma":0.00074184977,"teacher_disagreement_score":0.9621522,"about_ca_system_score_codex":0.0019770777,"about_ca_system_score_gemma":0.0036287056,"threshold_uncertainty_score":0.20016068},"labels":[],"label_agreement":null},{"id":"W4405382998","doi":"10.1177/09622802241298704","title":"A Bayesian latent class approach to causal inference with longitudinal data","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto; University Health Network; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"Canadian Institutes of Health Research; Hospital for Sick Children","keywords":"Causal inference; Confounding; Covariate; Bayesian probability; Latent class model; Latent variable; Econometrics; Computer science; Bayesian inference; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.6368623295240852,"score_gpt":0.6762469425986279,"score_spread":0.039384613074542774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405382998","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00091727305,0.0002618045,0.9977053,0.0004398617,0.000026887128,0.00004618648,0.000077004086,0.000066274326,0.00045947486],"genre_scores_gemma":[0.12671715,0.0016491957,0.8661746,0.00052080065,0.00044803732,0.000932244,0.00047727133,0.0001282705,0.0029524972],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826401,0.014129431,0.00045971395,0.0010657782,0.0013859936,0.0003190291],"domain_scores_gemma":[0.934519,0.058547687,0.002291205,0.002751172,0.0014332664,0.00045763372],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02724833,0.0011182337,0.0021588583,0.0030890708,0.0011503285,0.0025385877,0.0032706328,0.0021855775,0.005838837],"category_scores_gemma":[0.0736578,0.00103827,0.002606886,0.0033154085,0.0031154288,0.0036443174,0.002930182,0.0047624763,0.00067041663],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008967276,0.000085637366,0.0021233214,0.00024408687,0.00032057235,0.000119285956,0.0003198337,0.16647811,0.00020581792,0.746222,0.0023918084,0.0813998],"study_design_scores_gemma":[0.000052416133,0.000035167646,0.00036528986,0.00006885018,0.000055282486,0.00005493976,0.000037025995,0.39334288,0.00010092534,0.60286325,0.002996621,0.000027370388],"about_ca_topic_score_codex":0.0078073028,"about_ca_topic_score_gemma":0.0073958063,"teacher_disagreement_score":0.9727517,"about_ca_system_score_codex":0.0025107015,"about_ca_system_score_gemma":0.004242252,"threshold_uncertainty_score":0.14410472},"labels":[],"label_agreement":null},{"id":"W4407415052","doi":"10.1177/09622802241310326","title":"Using Bayesian evidence synthesis to quantify uncertainty in population trends in smoking behaviour","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Air Quality and Health Impacts","field":"Environmental Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University; Simon Fraser University","funders":"National Health and Medical Research Council; Department of Health and Aged Care, Australian Government","keywords":"Bayesian probability; Econometrics; Bayesian inference; Credible interval; Tobacco control; Bayesian hierarchical modeling; Population; Calibration; Blueprint; Prediction interval; Confidence interval; Smoking cessation; Uncertainty analysis; Psychological intervention; Statistics; Medicine; Computer science; Environmental health; Mathematics; Engineering","score_opus":0.4034743928626631,"score_gpt":0.6493406843584507,"score_spread":0.2458662914957876,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407415052","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016041595,0.0612112,0.8885889,0.012328694,0.00096801243,0.0037823557,0.0063951886,0.0006085927,0.010075504],"genre_scores_gemma":[0.47583118,0.031719286,0.47706804,0.0031395827,0.0008622732,0.006828481,0.003066439,0.00013461564,0.0013501722],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8641592,0.117072634,0.0076923845,0.0036371094,0.006934674,0.0005039223],"domain_scores_gemma":[0.60480344,0.36952576,0.011117451,0.0075314012,0.0063109463,0.0007109764],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.14668436,0.0021831007,0.0044551445,0.012375303,0.0006459222,0.0057713888,0.002367635,0.0032471376,0.006435425],"category_scores_gemma":[0.37149206,0.0011560428,0.0064271307,0.0073138545,0.0017281437,0.004698339,0.0044849473,0.004830336,0.00049500033],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010331486,0.00023888431,0.010926819,0.03212676,0.031638063,0.00028231594,0.00075217907,0.43946126,0.00043205015,0.16182949,0.0081069255,0.31317204],"study_design_scores_gemma":[0.00077399047,0.0005073909,0.0037507613,0.015016018,0.010438071,0.00014585833,0.0003410397,0.25234702,0.0007261623,0.6921294,0.023612374,0.00021188325],"about_ca_topic_score_codex":0.009880807,"about_ca_topic_score_gemma":0.009896012,"teacher_disagreement_score":0.14668436,"about_ca_system_score_codex":0.0063353484,"about_ca_system_score_gemma":0.008372057,"threshold_uncertainty_score":0.77575034},"labels":[],"label_agreement":null},{"id":"W4409900557","doi":"10.1177/09622802241313289","title":"On flexible inverse probability of treatment and intensity weighting: Informative censoring, variable selection, and weight trimming","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Weighting; Censoring (clinical trials); Inverse probability weighting; Inverse probability; Statistics; Marginal structural model; Confounding; Trimming; Econometrics; Computer science; Observational study; A-weighting; Mathematics; Propensity score matching; Posterior probability; Bayesian probability; Medicine","score_opus":0.2843125504702238,"score_gpt":0.5949416301576912,"score_spread":0.3106290796874674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409900557","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035547547,0.00037065227,0.9947994,0.00039035163,0.000057371046,0.00014867655,0.000042341384,0.00006469752,0.00057179487],"genre_scores_gemma":[0.15606074,0.0013045043,0.83728486,0.0009188423,0.00045959753,0.001793821,0.00026094838,0.0001514709,0.0017652839],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9164655,0.07055742,0.001962254,0.0046671405,0.0053192307,0.0010284124],"domain_scores_gemma":[0.7411192,0.21177356,0.011942522,0.029347155,0.0049571665,0.0008604833],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10424958,0.0017692331,0.0026311872,0.0035640122,0.001594306,0.0024197947,0.004848676,0.0038594585,0.0031034993],"category_scores_gemma":[0.25418228,0.001075448,0.0035922232,0.00552824,0.0074368576,0.0042477525,0.0049099396,0.0077969935,0.00052738417],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028174772,0.00019855952,0.007791507,0.00059602497,0.0007055556,0.00040599715,0.0013867877,0.09311841,0.0009875704,0.6869362,0.0022695693,0.2053221],"study_design_scores_gemma":[0.00017787264,0.00026243512,0.0027776996,0.00039305046,0.00024961523,0.00029807587,0.00015402214,0.25834164,0.0014151016,0.72940975,0.0064162766,0.000104515086],"about_ca_topic_score_codex":0.0037278663,"about_ca_topic_score_gemma":0.002850389,"teacher_disagreement_score":0.10424958,"about_ca_system_score_codex":0.002032682,"about_ca_system_score_gemma":0.003543758,"threshold_uncertainty_score":0.55133104},"labels":[],"label_agreement":null},{"id":"W4410351772","doi":"10.1177/09622802251338387","title":"Rank-based estimators of global treatment effects for cluster randomized trials with multiple endpoints on different scales","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health","keywords":"Estimator; Statistics; Wilcoxon signed-rank test; Confidence interval; Sample size determination; Mathematics; Fraction (chemistry); Variance (accounting); Coverage probability; Point estimation; Cluster (spacecraft); Rank (graph theory); Interval (graph theory); Econometrics; Computer science; Mann–Whitney U test","score_opus":0.19560503028694087,"score_gpt":0.6096647113663234,"score_spread":0.4140596810793825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410351772","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009801699,0.00085055217,0.99562055,0.00019221104,0.00006889046,0.00087301276,0.000312593,0.00039735093,0.00070466904],"genre_scores_gemma":[0.055296253,0.0010824318,0.93207586,0.0006129546,0.00022012347,0.008177585,0.0010236298,0.00041454533,0.0010966182],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.83272314,0.14836228,0.0046597407,0.0049811825,0.008536232,0.00073743094],"domain_scores_gemma":[0.6623189,0.2897534,0.018400053,0.020179635,0.008629505,0.00071844197],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15559705,0.0021058917,0.0047060535,0.0049891295,0.00060158677,0.0030838065,0.003683262,0.002436006,0.0108564235],"category_scores_gemma":[0.38192895,0.0010746584,0.0045193094,0.0053346287,0.0022255331,0.0031155755,0.0032097492,0.005680413,0.002205521],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017909771,0.0003140449,0.0065702237,0.0069532352,0.004827945,0.00019248822,0.00081353256,0.09634864,0.0014420663,0.3266417,0.023714844,0.53039026],"study_design_scores_gemma":[0.0019681335,0.0021105877,0.0068574464,0.0025350857,0.0024765118,0.00047658297,0.00029347176,0.40678063,0.004034773,0.529716,0.042466715,0.0002840392],"about_ca_topic_score_codex":0.0010419689,"about_ca_topic_score_gemma":0.001268722,"teacher_disagreement_score":0.84440297,"about_ca_system_score_codex":0.001811084,"about_ca_system_score_gemma":0.0036985008,"threshold_uncertainty_score":0.82288563},"labels":[],"label_agreement":null},{"id":"W4411436605","doi":"10.1177/09622802251348999","title":"Permutation tests for detecting treatment effect heterogeneity in cluster randomized trials","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; Patient-Centered Outcomes Research Institute","keywords":"Permutation (music); Resampling; Randomized controlled trial; Cluster (spacecraft); Statistics; Computer science; Mathematics; Multiple comparisons problem; Medicine; Internal medicine; Physics","score_opus":0.5711598577785493,"score_gpt":0.7277796225742554,"score_spread":0.15661976479570616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411436605","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005071901,0.001089923,0.98572713,0.0007772514,0.00056972646,0.0038654434,0.00076158217,0.0008703703,0.0012667073],"genre_scores_gemma":[0.1468499,0.0009556106,0.8158815,0.0012278183,0.0006034805,0.032018628,0.0011169981,0.00044077408,0.00090530113],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6825508,0.27224392,0.014060179,0.013225944,0.01639569,0.0015234435],"domain_scores_gemma":[0.35263297,0.57766974,0.021868283,0.03832454,0.008290795,0.001213666],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21802713,0.0026514488,0.0057533523,0.007224729,0.0019208586,0.003928949,0.006053673,0.0044681365,0.01096515],"category_scores_gemma":[0.6048235,0.0016334848,0.0073204427,0.0080177905,0.00672771,0.0050923843,0.0044530486,0.009613728,0.0012583224],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0062953415,0.0006830687,0.01707242,0.010007179,0.015887586,0.0016695979,0.0029730238,0.06590141,0.0019772516,0.40931278,0.022452336,0.44576806],"study_design_scores_gemma":[0.0032707194,0.0025808373,0.005570811,0.0016128174,0.0025590528,0.0006686169,0.00045968968,0.2598833,0.0029358868,0.70447797,0.0156803,0.00029996052],"about_ca_topic_score_codex":0.0016095028,"about_ca_topic_score_gemma":0.00097305275,"teacher_disagreement_score":0.7819729,"about_ca_system_score_codex":0.0025107374,"about_ca_system_score_gemma":0.0071861637,"threshold_uncertainty_score":0.9643118},"labels":[],"label_agreement":null},{"id":"W4411932894","doi":"10.1177/09622802251350263","title":"Group sequential analysis of marked point processes: Plasma donation trials","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; McMaster University; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Interim; Donation; Medicine; Interim analysis; Clinical endpoint; Adverse effect; Sample size determination; Computer science; Statistics; Intensive care medicine; Clinical trial; Internal medicine; Mathematics","score_opus":0.7478914177986117,"score_gpt":0.7468351539420226,"score_spread":0.0010562638565890792,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411932894","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20846193,0.03669128,0.6975297,0.006679439,0.008862894,0.034479212,0.00079517794,0.0010282402,0.005472117],"genre_scores_gemma":[0.6186651,0.008749764,0.30704054,0.0028553125,0.0018243666,0.057779957,0.0005002568,0.00011790409,0.0024668216],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7823057,0.20464806,0.0036510476,0.004141691,0.0044395546,0.0008139234],"domain_scores_gemma":[0.79734534,0.18052204,0.009064821,0.00875512,0.0028841104,0.0014285329],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11450949,0.0020588622,0.0075164833,0.0014239664,0.0008404143,0.0026473615,0.0019734774,0.0067962795,0.004289768],"category_scores_gemma":[0.18936889,0.0007634804,0.004557972,0.0019114172,0.0034022664,0.00290338,0.0020609812,0.0059130057,0.00047852207],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.35478467,0.005999326,0.006042894,0.026847152,0.019731464,0.0012137656,0.0011955121,0.067907624,0.0036452946,0.11751171,0.0065791747,0.38854137],"study_design_scores_gemma":[0.2576586,0.15267935,0.0034161725,0.0034340022,0.010846679,0.000799855,0.00042825378,0.23659088,0.0036696468,0.31352183,0.016513137,0.0004415797],"about_ca_topic_score_codex":0.00022594482,"about_ca_topic_score_gemma":0.00024490064,"teacher_disagreement_score":0.11450949,"about_ca_system_score_codex":0.0009096638,"about_ca_system_score_gemma":0.0019232541,"threshold_uncertainty_score":0.6055913},"labels":[],"label_agreement":null},{"id":"W4412115660","doi":"10.1177/09622802251338409","title":"Health utility adjusted survival: A composite endpoint for clinical trial designs","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University Health Network","funders":"Princess Margaret Cancer Foundation","keywords":"Sample size determination; Clinical endpoint; Clinical trial; Survival analysis; Quality of life (healthcare); Medicine; Randomized controlled trial; Statistical power; Statistics; Econometrics; Mathematics; Surgery; Internal medicine","score_opus":0.9207298509088987,"score_gpt":0.7660337274815276,"score_spread":0.15469612342737105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412115660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006884723,0.006007789,0.9622627,0.0025134385,0.0018003655,0.013885372,0.0014962273,0.0011547409,0.003994653],"genre_scores_gemma":[0.13313894,0.0029062447,0.7781893,0.0028785232,0.0011973584,0.07799359,0.0012849058,0.0005985736,0.0018125875],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.63449204,0.3301824,0.012784982,0.0063186763,0.015230367,0.0009916201],"domain_scores_gemma":[0.65754116,0.2786661,0.029405253,0.023616523,0.009096213,0.0016747232],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25520536,0.002314241,0.0039776014,0.0053601763,0.0009393986,0.0034935642,0.0023799255,0.0033503184,0.007213711],"category_scores_gemma":[0.37400055,0.00091160473,0.008604094,0.0051099462,0.0032273952,0.003412158,0.0038608483,0.0063506453,0.001299826],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012612252,0.00082715193,0.017780142,0.016446907,0.016773364,0.00018170774,0.0011598023,0.026027504,0.002270658,0.19858107,0.032541174,0.6747983],"study_design_scores_gemma":[0.014315245,0.015706474,0.037547767,0.0069312206,0.011281167,0.0010186603,0.0003640662,0.2011164,0.0075765587,0.5767792,0.12644194,0.0009214245],"about_ca_topic_score_codex":0.0004598187,"about_ca_topic_score_gemma":0.0005602316,"teacher_disagreement_score":0.7447946,"about_ca_system_score_codex":0.0025013706,"about_ca_system_score_gemma":0.005375958,"threshold_uncertainty_score":0.91846436},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W4412488270","doi":"10.1177/09622802251357021","title":"Design of egocentric network-based studies to estimate causal effects under interference","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Roche (Canada)","funders":"National Institute on Drug Abuse; National Institute of Mental Health","keywords":"Spillover effect; Psychological intervention; Leverage (statistics); Sample size determination; Randomized experiment; Randomized controlled trial; Intervention (counseling); Population; Psychology; Causal inference; Econometrics; Statistics; Computer science; Medicine; Mathematics; Environmental health","score_opus":0.47673270997648753,"score_gpt":0.6947664410253729,"score_spread":0.21803373104888535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412488270","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028654724,0.00015942269,0.95484614,0.0006111355,0.00015866886,0.012841208,0.00030178824,0.00019338148,0.0022336186],"genre_scores_gemma":[0.25877267,0.00028843043,0.6624374,0.00057758996,0.00010733177,0.07571098,0.00023722167,0.000033580418,0.0018348536],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9052009,0.08567848,0.0015371933,0.004755057,0.0019615856,0.000866834],"domain_scores_gemma":[0.92273796,0.055843122,0.00712471,0.009695677,0.003456876,0.0011417264],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08852015,0.0017209043,0.0025689844,0.0017201991,0.001023445,0.0018334403,0.0039223,0.0027081242,0.007823443],"category_scores_gemma":[0.10154846,0.0014598756,0.0020694803,0.0010738376,0.0036509582,0.0028960013,0.0037444492,0.0024811022,0.0006693272],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012927443,0.0029203447,0.01264455,0.0022700157,0.0017162354,0.00034658975,0.0014637032,0.19361575,0.0052572475,0.644048,0.002538762,0.12025145],"study_design_scores_gemma":[0.008491239,0.008433692,0.0047160047,0.00038014754,0.0010933521,0.00017568364,0.00044496843,0.5548351,0.0044610994,0.40708658,0.009710699,0.00017148552],"about_ca_topic_score_codex":0.0010560297,"about_ca_topic_score_gemma":0.0008414228,"teacher_disagreement_score":0.91147983,"about_ca_system_score_codex":0.0021276989,"about_ca_system_score_gemma":0.0033507308,"threshold_uncertainty_score":0.4681449},"labels":[],"label_agreement":null},{"id":"W4413298197","doi":"10.1177/09622802251362642","title":"Imputation of incomplete ordinal and nominal data by predictive mean matching","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Categorical variable; Missing data; Imputation (statistics); Statistics; Multinomial logistic regression; Mathematics; Ordinal data; Logistic regression; Ordinal regression; Regression analysis; Econometrics; Computer science","score_opus":0.23644908515090432,"score_gpt":0.619632349005499,"score_spread":0.38318326385459467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413298197","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00873054,0.0005763416,0.98702884,0.00029644553,0.00019461854,0.0002623906,0.00093462155,0.0008374188,0.0011388323],"genre_scores_gemma":[0.17974582,0.0007494167,0.8106193,0.00058972614,0.0002147297,0.0015123374,0.004229957,0.0004920385,0.0018466541],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9668032,0.023961117,0.0018017363,0.0028115402,0.0039422205,0.00068026426],"domain_scores_gemma":[0.91394067,0.059354056,0.005395551,0.014238064,0.0065132515,0.0005584132],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04089844,0.0011880555,0.0031912266,0.0030981663,0.0011390119,0.0030024168,0.003972653,0.0017573861,0.009889618],"category_scores_gemma":[0.16127473,0.0011501889,0.0034312326,0.006468124,0.001273631,0.002802102,0.0039819805,0.004511255,0.0026938925],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017382224,0.00034262933,0.051166825,0.001933707,0.002207045,0.00080058875,0.001216948,0.1590863,0.0020512405,0.10759936,0.027348842,0.6445083],"study_design_scores_gemma":[0.00041829338,0.0003081121,0.008710013,0.0006695148,0.0004854774,0.00062282925,0.00018325457,0.72836936,0.003295367,0.23416278,0.022601731,0.00017330579],"about_ca_topic_score_codex":0.0033646133,"about_ca_topic_score_gemma":0.003063938,"teacher_disagreement_score":0.04089844,"about_ca_system_score_codex":0.0014111021,"about_ca_system_score_gemma":0.0043187975,"threshold_uncertainty_score":0.21629423},"labels":[],"label_agreement":null},{"id":"W4414642432","doi":"10.1177/09622802251374838","title":"Augmented two-stage estimation for treatment switching in oncology trials: Leveraging external data for improved precision","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MD Precision (Canada); University of British Columbia","funders":"","keywords":"Censoring (clinical trials); Randomized controlled trial; Estimation; Control (management); Sample size determination; Randomized response","score_opus":0.772245160354316,"score_gpt":0.7629188039075026,"score_spread":0.009326356446813455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414642432","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015730176,0.00076393987,0.98072344,0.00057444395,0.00010052393,0.00065342,0.00026450353,0.000522579,0.0006670374],"genre_scores_gemma":[0.38903195,0.0006847605,0.60470986,0.00078361493,0.00018461373,0.0018992367,0.001099577,0.00016225973,0.0014441502],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9053063,0.08350394,0.0028197998,0.0044075805,0.0033601688,0.00060229865],"domain_scores_gemma":[0.66344696,0.29155567,0.0136445975,0.023282472,0.006935853,0.0011344281],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10338942,0.0017418532,0.0037262307,0.0015031418,0.000825659,0.0029598007,0.0027472563,0.0028145888,0.0028555428],"category_scores_gemma":[0.266479,0.001573931,0.00382947,0.0017929068,0.0017981977,0.0034369815,0.0037634948,0.0049999543,0.00053743133],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004479808,0.0007132472,0.038670734,0.0024404398,0.0038838799,0.0005618147,0.0015445773,0.47612876,0.0039156014,0.11378197,0.0050340365,0.34884515],"study_design_scores_gemma":[0.00084247236,0.00093882816,0.0044984897,0.00024147969,0.0004892896,0.00014931698,0.000073074785,0.9126696,0.0020820603,0.07399128,0.0039011943,0.00012292888],"about_ca_topic_score_codex":0.0033774553,"about_ca_topic_score_gemma":0.0033665325,"teacher_disagreement_score":0.89661056,"about_ca_system_score_codex":0.0012392133,"about_ca_system_score_gemma":0.0037241972,"threshold_uncertainty_score":0.546782},"labels":[],"label_agreement":null},{"id":"W4414897958","doi":"10.1177/09622802251382586","title":"Assessing spillover effects: Handling missing outcomes in network-based studies","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health; National Institute of Mental Health; National Institute on Drug Abuse; Center for Drug Use and HIV Research; NYU Grossman School of Medicine; York University","keywords":"Censoring (clinical trials); Spillover effect; Estimator; Inverse probability; Observational study; Consistency (knowledge bases); Missing data; Intervention (counseling)","score_opus":0.5414715348528748,"score_gpt":0.7334598063847874,"score_spread":0.19198827153191256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414897958","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02906183,0.0024164096,0.96489424,0.0009561539,0.00018745603,0.0009041406,0.00057766464,0.00020087828,0.0008013313],"genre_scores_gemma":[0.5739193,0.0018236462,0.41471246,0.000979541,0.00037534747,0.006370929,0.0009835357,0.00011540746,0.0007198511],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7773355,0.19283001,0.01155876,0.011036764,0.0063122893,0.00092661736],"domain_scores_gemma":[0.349041,0.5849289,0.031326126,0.028589632,0.0050347876,0.0010796428],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21005848,0.0017383884,0.0031168095,0.0046160966,0.001566372,0.003023806,0.004803904,0.0044141137,0.0029323085],"category_scores_gemma":[0.48504612,0.0014692477,0.004288841,0.0048396853,0.003580209,0.005018761,0.0059276293,0.0034491215,0.00023457153],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018969509,0.0006299241,0.38312376,0.012318886,0.02840808,0.0023416397,0.0054944274,0.12645628,0.0023038734,0.113494106,0.0031342164,0.32039788],"study_design_scores_gemma":[0.0009707656,0.0027682323,0.10324908,0.0044214167,0.012147035,0.001717649,0.0019320714,0.41096067,0.0048007667,0.4398547,0.016818002,0.0003596059],"about_ca_topic_score_codex":0.0030698895,"about_ca_topic_score_gemma":0.0020171094,"teacher_disagreement_score":0.78994155,"about_ca_system_score_codex":0.0013288681,"about_ca_system_score_gemma":0.0031882368,"threshold_uncertainty_score":0.9741385},"labels":[],"label_agreement":null},{"id":"W4415525767","doi":"10.1177/09622802251387430","title":"Two-stage Bayesian network meta-analysis of individualized treatment rules for multiple treatments with siloed data","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Generalizability theory; Leverage (statistics); Covariate; Bayesian probability; Statistical power; Patient data; Missing data; Data sharing; Bayesian network","score_opus":0.6766060736978984,"score_gpt":0.7188792600766557,"score_spread":0.04227318637875732,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415525767","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024325104,0.014995425,0.95135385,0.0017212979,0.0003521864,0.0032777411,0.0017050131,0.00069178105,0.0015776405],"genre_scores_gemma":[0.3840945,0.0046381983,0.5945376,0.0014893305,0.00024328032,0.010386961,0.0023829958,0.00021963648,0.0020074015],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8837239,0.10451878,0.0030777364,0.0057933396,0.0023148663,0.0005714405],"domain_scores_gemma":[0.8192261,0.16567525,0.0051664286,0.0072500287,0.002104478,0.0005776926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12234552,0.0038120938,0.010169159,0.0055023287,0.0010757277,0.0043141227,0.006102974,0.0035311114,0.0047910702],"category_scores_gemma":[0.17272358,0.0027689978,0.01873208,0.004009421,0.0015128194,0.004693859,0.0028587962,0.0059882435,0.00046435025],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009914504,0.0005980118,0.013656593,0.01248189,0.15489812,0.00056815456,0.0005975424,0.60229623,0.0010234684,0.04779459,0.00509693,0.15107396],"study_design_scores_gemma":[0.003642926,0.00095385103,0.003840242,0.0013365927,0.07081911,0.00020834728,0.00008036112,0.77309084,0.00080975366,0.1401517,0.0048593055,0.00020702992],"about_ca_topic_score_codex":0.010546114,"about_ca_topic_score_gemma":0.012778356,"teacher_disagreement_score":0.12234552,"about_ca_system_score_codex":0.0036386063,"about_ca_system_score_gemma":0.0042906906,"threshold_uncertainty_score":0.64703274},"labels":[],"label_agreement":null},{"id":"W4417427848","doi":"10.1177/09622802251403355","title":"Joint mixed-effects models for causal inference in clustered network-based observational studies","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de recherche du Québec – Nature et technologies; Fonds de Recherche du Québec - Santé; University of North Carolina at Chapel Hill; National Institute of Child Health and Human Development; Alliance de recherche numérique du Canada; Natural Sciences and Engineering Research Council of Canada; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Canada Research Chairs; McGill University","keywords":"Causal inference; Inference; Observational study; Context (archaeology); Outcome (game theory); Bayesian inference; Causal model; Bayesian probability; Latent variable","score_opus":0.7591763701323779,"score_gpt":0.7047860776338563,"score_spread":0.054390292498521675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417427848","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011129112,0.0004850928,0.99710935,0.00039754267,0.00006852972,0.00014486742,0.00026555493,0.0001026586,0.00031356272],"genre_scores_gemma":[0.092996575,0.0018073706,0.8971602,0.00064188073,0.0003871854,0.0040216893,0.0010455381,0.00012486792,0.0018147802],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9386349,0.052530047,0.0019345748,0.003976613,0.0024089,0.00051508757],"domain_scores_gemma":[0.7901857,0.18859889,0.007026287,0.010654095,0.0028409131,0.0006942054],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.075760946,0.0018307285,0.0036227333,0.004107621,0.0013854284,0.003244398,0.0074880724,0.0035264904,0.007915518],"category_scores_gemma":[0.18956596,0.0018445195,0.0049683442,0.0054507633,0.0034327984,0.0044643558,0.004621808,0.006179007,0.0009874075],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015728163,0.00008355945,0.0047698044,0.00088823156,0.0015993186,0.00029270747,0.00078612135,0.085993245,0.00025871355,0.8537647,0.0027439024,0.048662327],"study_design_scores_gemma":[0.00010339795,0.00007785981,0.0008401838,0.00026581748,0.00034367287,0.00008313418,0.00008934371,0.25226724,0.00022495797,0.7409384,0.0047201854,0.000045790068],"about_ca_topic_score_codex":0.0080273645,"about_ca_topic_score_gemma":0.007864587,"teacher_disagreement_score":0.075760946,"about_ca_system_score_codex":0.0026928422,"about_ca_system_score_gemma":0.003525554,"threshold_uncertainty_score":0.40066695},"labels":[],"label_agreement":null}]}