{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":1557,"total_is_capped":false,"direct_labels_cover":46,"predictions_cover":1557,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"90175592dfae","filters":{"topic":"Statistical Methods in Clinical Trials"}},"results":[{"id":"W2153109441","doi":"10.1093/bioinformatics/btu494","title":"STAMP: statistical analysis of taxonomic and functional profiles","year":2014,"lang":"en","type":"article","venue":"Bioinformatics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":4314,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"","keywords":"Python (programming language); Computer science; Graphical user interface; Software; R package; Exploratory data analysis; Statistical analysis; Data mining; Source code; Software package; Information retrieval; Programming language; Statistics; Mathematics","authors":[{"name":"Donovan H. Parks","is_ca":true},{"name":"Gene W. Tyson","is_ca":true},{"name":"Philip Hugenholtz","is_ca":true},{"name":"Robert G. Beiko","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3681394256237464,"gpt":0.471576120107807,"spread":0.1034366944840607,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02003762,0.001520003,0.00316289,0.008829535,0.001355737,0.00373493,0.003355234,0.001419373,0.114391],"category_scores_gemma":[0.1416755,0.0007712414,0.003383039,0.01024328,0.002401869,0.003468786,0.003236532,0.004096156,0.02314666],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001356342,"about_ca_system_score_gemma":0.004611631,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001631333,"about_ca_topic_score_gemma":0.001969012,"domain_scores_codex":[0.9778321,0.007996794,0.002514683,0.004227796,0.006488256,0.0009402781],"domain_scores_gemma":[0.8872508,0.07546181,0.01239239,0.0139541,0.008773975,0.00216699],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","study_design_scores_codex":[0.003820785,0.0004108643,0.04352606,0.009883556,0.002933931,0.000636265,0.001527806,0.01179755,0.009364958,0.02861386,0.4903833,0.397101],"study_design_scores_gemma":[0.001012193,0.002144739,0.1019799,0.003091398,0.002652654,0.001835426,0.001111036,0.1113656,0.01733536,0.1754192,0.5812758,0.0007767494],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02292874,0.001501718,0.6190777,0.002430947,0.001956389,0.002813897,0.2913143,0.04659692,0.01137938],"genre_scores_gemma":[0.1696749,0.001153528,0.6179495,0.001759301,0.001247934,0.02187442,0.1485705,0.02501386,0.01275602],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.114391,"threshold_uncertainty_score":0.382676,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2187089918","doi":"10.20982/tqmp.04.2.p061","title":"Confidence Intervals from Normalized Data: A correction to Cousineau (2005)","year":2008,"lang":"en","type":"article","venue":"Tutorials in Quantitative Methods for Psychology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":2083,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"","keywords":"Confidence interval; Robust confidence intervals; Statistics; Mathematics","authors":[{"name":"Richard D. Morey","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8522175965034989,"gpt":0.719531494817121,"spread":0.132686101686378,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07496887,0.002996143,0.002867947,0.007954308,0.00271356,0.005454363,0.006538503,0.004476216,0.02734458],"category_scores_gemma":[0.5189958,0.001674228,0.004633697,0.01083132,0.005026883,0.007467472,0.005937638,0.01824585,0.007288536],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002500361,"about_ca_system_score_gemma":0.004145826,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0036597,"about_ca_topic_score_gemma":0.00299067,"domain_scores_codex":[0.9020898,0.05866794,0.006036709,0.007122465,0.02479918,0.001283822],"domain_scores_gemma":[0.6031021,0.3192003,0.009691479,0.03297913,0.0337152,0.001311732],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004608014,0.0001632816,0.002039029,0.002872546,0.0007980362,0.0005804915,0.003618661,0.004679909,0.001672556,0.3249361,0.2196674,0.4385113],"study_design_scores_gemma":[0.0001798133,0.0003445143,0.004003238,0.002493673,0.0004645323,0.001671628,0.0007059325,0.01353359,0.006548978,0.5272993,0.4423218,0.0004329828],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001527319,0.005960098,0.9661195,0.004457343,0.009715171,0.0003032493,0.001029802,0.002089254,0.008798148],"genre_scores_gemma":[0.06513305,0.004907955,0.8951932,0.007334176,0.004536955,0.002883991,0.001239792,0.005280355,0.01349057],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.07496887,"threshold_uncertainty_score":0.396478,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3008867523","doi":"10.1136/fmch-2019-000262","title":"Variable selection strategies and its importance in clinical prediction modelling","year":2020,"lang":"en","type":"article","venue":"Family Medicine and Community Health","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":995,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"","keywords":"Akaike information criterion; Feature selection; Selection (genetic algorithm); Bayesian information criterion; Variable (mathematics); Statistic; Computer science; Model selection; Bayesian probability; Statistics; Machine learning; Mathematics; Artificial intelligence","authors":[{"name":"Tanvir Chowdhury Turin","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7929098891837675,"gpt":0.5963941095425003,"spread":0.1965157796412672,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07325398,0.001690352,0.002455366,0.003396194,0.0007384366,0.003453143,0.002084605,0.002108182,0.00155127],"category_scores_gemma":[0.1877508,0.0007378996,0.001475092,0.003668165,0.002732543,0.002950258,0.002402723,0.004083756,0.0004029741],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001010844,"about_ca_system_score_gemma":0.003006023,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002131199,"about_ca_topic_score_gemma":0.001721847,"domain_scores_codex":[0.9193141,0.07310569,0.002021698,0.001509451,0.003698687,0.000350277],"domain_scores_gemma":[0.8013338,0.1888973,0.003211485,0.002505795,0.003567514,0.000484037],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003080996,0.0001890167,0.01111928,0.001443528,0.0009231921,0.0006602273,0.00131395,0.2360925,0.0006148086,0.423216,0.007943912,0.3161753],"study_design_scores_gemma":[0.0001087081,0.0002204547,0.001551995,0.000561858,0.0001528043,0.0001654769,0.0001680595,0.4874945,0.0006837909,0.4996164,0.009195459,0.00008045236],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.00396704,0.003073339,0.989148,0.002510699,0.0001485836,0.0002073553,0.00006907037,0.000102901,0.0007730297],"genre_scores_gemma":[0.1649728,0.005680989,0.8243889,0.0008243105,0.0006637945,0.001826627,0.0002370698,0.0001461355,0.001259417],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.926746,"threshold_uncertainty_score":0.3874087,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2095437242","doi":"10.1186/1471-2288-13-92","title":"A tutorial on sensitivity analyses in clinical trials: the what, why, when and how","year":2013,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":901,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University; University of Waterloo; Toronto General Hospital; Hamilton Health Sciences; University of Ottawa; GlaxoSmithKline (Canada); St. Joseph’s Healthcare Hamilton; McMaster University; Population Health Research Institute","funders":"","keywords":"Sensitivity (control systems); Clinical trial; Missing data; Computer science; Protocol (science); Outlier; Data science; Robustness (evolution); Research design; Data mining; Medical physics; Medicine; Management science; Alternative medicine; Machine learning; Artificial intelligence; Statistics; Mathematics","authors":[{"name":"Lehana Thabane","is_ca":true},{"name":"Lawrence Mbuagbaw","is_ca":true},{"name":"Shiyuan Zhang","is_ca":true},{"name":"Zainab Samaan","is_ca":true},{"name":"Maura Marcucci","is_ca":true},{"name":"Chenglin Ye","is_ca":true},{"name":"Marroon Thabane","is_ca":true},{"name":"Lora Giangregorio","is_ca":true},{"name":"Brittany B. Dennis","is_ca":true},{"name":"Sarah Daisy Kosa","is_ca":true},{"name":"Victoria Borg Debono","is_ca":true},{"name":"Rejane Dillenburg","is_ca":true},{"name":"Vincent Fruci","is_ca":true},{"name":"Monica Bawor","is_ca":true},{"name":"Juneyoung Lee","is_ca":false},{"name":"George A. Wells","is_ca":true},{"name":"Charles H. Goldsmith","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9873875398748938,"gpt":0.8105356203029017,"spread":0.1768519195719921,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06575552,0.003674216,0.002751559,0.005061835,0.0009706698,0.004134932,0.002672628,0.006354047,0.02852116],"category_scores_gemma":[0.2415994,0.001525737,0.004827579,0.004329265,0.003920719,0.007636169,0.003425744,0.01144296,0.01047342],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002785721,"about_ca_system_score_gemma":0.004064386,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001181833,"about_ca_topic_score_gemma":0.001244626,"domain_scores_codex":[0.944242,0.04664485,0.003485997,0.001145434,0.004088386,0.0003934578],"domain_scores_gemma":[0.6338488,0.3488909,0.004457357,0.003158207,0.008537513,0.001107216],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002638699,0.0001810981,0.0005376074,0.01577912,0.0006128733,0.0009475079,0.002249748,0.009159451,0.001152758,0.2122965,0.4432526,0.3135669],"study_design_scores_gemma":[0.000150029,0.0001999722,0.0005416336,0.01105003,0.000191649,0.001258422,0.0003053017,0.005323636,0.0008598962,0.4522056,0.5277445,0.0001694147],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0007967143,0.1014065,0.7851431,0.06898426,0.01696661,0.001598338,0.001301627,0.001964373,0.02183843],"genre_scores_gemma":[0.01756202,0.1279716,0.7511542,0.05076736,0.02731556,0.005346777,0.001045965,0.002524129,0.01631245],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.06575552,"threshold_uncertainty_score":0.3477526,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2096864872","doi":"10.1200/jco.2006.10.3523","title":"Proposal for Standardized Definitions for Efficacy End Points in Adjuvant Breast Cancer Trials: The STEEP System","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Oncology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":885,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University; Sunnybrook Health Science Centre","funders":"","keywords":"Breast cancer; Medicine; Clinical trial; Clinical endpoint; Cancer; Medical physics; End point; Oncology; Internal medicine; Computer science","authors":[{"name":"Clifford A. Hudis","is_ca":false},{"name":"William E. Barlow","is_ca":true},{"name":"Joseph P. Costantino","is_ca":true},{"name":"Robert J. Gray","is_ca":true},{"name":"Kathleen I. Pritchard","is_ca":true},{"name":"J. W. Chapman","is_ca":true},{"name":"Joseph A. Sparano","is_ca":true},{"name":"Sally Hunsberger","is_ca":true},{"name":"Rebecca A. Enos","is_ca":true},{"name":"Richard D. Gelber","is_ca":true},{"name":"Jo Anne Zujewski","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.793096103122032,"gpt":0.685672168665247,"spread":0.107423934456785,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2847648,0.003317879,0.005729687,0.01251343,0.002799971,0.01254651,0.007423729,0.006960947,0.003979648],"category_scores_gemma":[0.4182676,0.002370246,0.007694088,0.01275792,0.009273764,0.01335534,0.01175857,0.01794212,0.004804572],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006968694,"about_ca_system_score_gemma":0.02066331,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002714745,"about_ca_topic_score_gemma":0.001799209,"domain_scores_codex":[0.7493958,0.1732488,0.04622837,0.008841626,0.01948177,0.002803585],"domain_scores_gemma":[0.6162207,0.2350011,0.03371181,0.02776476,0.08277685,0.004524777],"domain_codex":null,"domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000673413,0.0001747291,0.005066461,0.002242928,0.0005939539,0.0001784671,0.0009444477,0.007416785,0.0006184903,0.7942971,0.04467054,0.1431227],"study_design_scores_gemma":[0.001269747,0.001021473,0.003791056,0.002997748,0.0008697893,0.0005824706,0.000474774,0.04535991,0.001543244,0.8042807,0.1374329,0.0003761903],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001782054,0.001649076,0.9755207,0.01132519,0.001404984,0.002536726,0.001076707,0.0007313768,0.003973102],"genre_scores_gemma":[0.01956383,0.00102352,0.9615528,0.00548469,0.001014316,0.009178863,0.001103888,0.000246161,0.0008318826],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7152352,"threshold_uncertainty_score":0.8820124,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2115499099","doi":"10.1093/jnci/djp079","title":"Dose Escalation Methods in Phase I Cancer Clinical Trials","year":2009,"lang":"en","type":"review","venue":"JNCI Journal of the National Cancer Institute","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":861,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto; University Health Network","funders":"National Cancer Institute; Fondation de France","keywords":"Clinical trial; Medicine; Clinical endpoint; Maximum tolerated dose; Phases of clinical research; Drug; Surrogate endpoint; Pharmacology; Oncology; Drug development; Internal medicine","authors":[{"name":"Christophe Le Tourneau","is_ca":true},{"name":"Lillian L. Siu","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9534115106481834,"gpt":0.8140813552163118,"spread":0.1393301554318717,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05615478,0.001645376,0.00344403,0.003406996,0.0002901199,0.001970982,0.002911402,0.001449616,0.003839913],"category_scores_gemma":[0.104972,0.0008761557,0.002370764,0.003794861,0.002578513,0.001872565,0.001549193,0.005478716,0.001684164],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002096019,"about_ca_system_score_gemma":0.003864562,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0004841558,"about_ca_topic_score_gemma":0.0004693788,"domain_scores_codex":[0.9443575,0.04380819,0.003502785,0.001581536,0.006542708,0.0002072181],"domain_scores_gemma":[0.8993792,0.0864977,0.006637951,0.003881556,0.003251662,0.0003518492],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0003797091,0.0001050733,0.0004066243,0.01591721,0.0008602172,0.00003843039,0.0001472078,0.008832602,0.0005199668,0.0333194,0.01277038,0.9267031],"study_design_scores_gemma":[0.00306674,0.002893656,0.004479916,0.03110537,0.002711107,0.001657816,0.0002422119,0.03449866,0.005895419,0.2747669,0.6384243,0.0002578819],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.001244209,0.5660234,0.4129408,0.004207243,0.00163595,0.004221859,0.0003954674,0.0007339843,0.008597218],"genre_scores_gemma":[0.03312354,0.4731533,0.469949,0.003608933,0.002119901,0.01391918,0.0005992948,0.0003860646,0.003140858],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9438452,"threshold_uncertainty_score":0.2969785,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1966359789","doi":"10.1037/1082-989x.12.4.399","title":"Toward using confidence intervals to compare correlations.","year":2007,"lang":"en","type":"article","venue":"Psychological Methods","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":758,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confidence interval; Statistics; Robust confidence intervals; Mathematics; Sample size determination; Dependency (UML); Correlation; Nominal level; Sampling (signal processing); Confidence distribution; Sample (material); Econometrics; Computer science; Artificial intelligence","authors":[{"name":"Guangyong Zou","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.915936087266207,"gpt":0.7443180110581955,"spread":0.1716180762080115,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2390345,0.003490868,0.004550701,0.0157368,0.001440823,0.01109304,0.009213609,0.004900471,0.005464592],"category_scores_gemma":[0.6294144,0.001941559,0.00354942,0.01222719,0.00829594,0.01171666,0.008167849,0.01524748,0.002446061],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003411958,"about_ca_system_score_gemma":0.004707754,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002270672,"about_ca_topic_score_gemma":0.001374659,"domain_scores_codex":[0.6678985,0.2856264,0.009899836,0.00941344,0.02624428,0.0009175248],"domain_scores_gemma":[0.3238142,0.6005755,0.02014317,0.03532253,0.01874742,0.001397184],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004113586,0.0002037004,0.003684848,0.002090142,0.001485524,0.0003616612,0.0023401,0.03021924,0.0008086057,0.5715664,0.01235186,0.3744765],"study_design_scores_gemma":[0.0002670361,0.0004368704,0.002340025,0.002241748,0.0003869546,0.0007398527,0.0007861437,0.08251865,0.002052568,0.8614325,0.04651105,0.0002866724],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0007366174,0.002166641,0.9932911,0.0006576921,0.0002489617,0.0001919657,0.0001170683,0.000518439,0.002071378],"genre_scores_gemma":[0.03045672,0.001422801,0.9651164,0.000506959,0.000372998,0.001223512,0.0002262377,0.0002763975,0.0003979507],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7609655,"threshold_uncertainty_score":0.9384059,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2900742318","doi":"10.1136/bmj.k3532","title":"The reporting of studies conducted using observational routinely collected health data statement for pharmacoepidemiology (RECORD-PE)","year":2018,"lang":"en","type":"article","venue":"BMJ","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":620,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Hospital for Sick Children; SickKids Foundation; University of Toronto; University of Ottawa; Jewish General Hospital; Children's Hospital of Eastern Ontario; Institute for Clinical Evaluative Sciences; McGill University; Ottawa Hospital","funders":"Medical Research Council; Fonds de Recherche du Québec - Santé; Wellcome Trust; Crohn's and Colitis Canada; Canadian Institutes of Health Research; National Institute for Health and Care Research; International Society for Pharmacoepidemiology; Canadian Association of Gastroenterology","keywords":"Pharmacoepidemiology; Observational study; Statement (logic); Medicine; Data science; Computer science; Pharmacovigilance; Data mining; Family medicine; Information retrieval; Pharmacology; Internal medicine; Adverse effect","authors":[{"name":"Sinéad Langan","is_ca":false},{"name":"Sigrún Alba Jóhannesdóttir Schmidt","is_ca":false},{"name":"Kevin Wing","is_ca":false},{"name":"Véra Ehrenstein","is_ca":false},{"name":"Stuart G. Nicholls","is_ca":true},{"name":"Kristian B. Filion","is_ca":true},{"name":"Olaf H. Klungel","is_ca":false},{"name":"Irene Petersen","is_ca":false},{"name":"Henrik Toft Sørensen","is_ca":false},{"name":"William G Dixon","is_ca":false},{"name":"Astrid Guttmann","is_ca":true},{"name":"Katie Harron","is_ca":false},{"name":"Lars G. Hemkens","is_ca":false},{"name":"David Moher","is_ca":true},{"name":"Sebastian Schneeweiß","is_ca":false},{"name":"Liam Smeeth","is_ca":false},{"name":"Miriam Sturkenboom","is_ca":false},{"name":"Erik von Elm","is_ca":false},{"name":"Shirley Wang","is_ca":false},{"name":"Eric I. Benchimol","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9784678425915878,"gpt":0.7711311390194552,"spread":0.2073367035721326,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5881335,0.002663622,0.005827029,0.01755159,0.004110814,0.009799073,0.006426211,0.01066136,0.01388496],"category_scores_gemma":[0.7564669,0.004180034,0.01108634,0.02056893,0.006622883,0.009182411,0.009893069,0.01197791,0.01094413],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006640229,"about_ca_system_score_gemma":0.04073059,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003875325,"about_ca_topic_score_gemma":0.003579729,"domain_scores_codex":[0.161724,0.4464181,0.3515617,0.006457579,0.03134397,0.00249468],"domain_scores_gemma":[0.09642306,0.4818207,0.1658963,0.1167276,0.1348378,0.004294486],"domain_codex":"methods","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.002517873,0.0004246309,0.01244578,0.1383063,0.003633469,0.0004649924,0.006927716,0.001760322,0.002549933,0.04394339,0.5737164,0.2133093],"study_design_scores_gemma":[0.003447076,0.0009442979,0.01701086,0.08531707,0.002538813,0.001097183,0.002749293,0.003008464,0.004077683,0.03755966,0.8414174,0.0008322067],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007590726,0.01828897,0.4372694,0.07138786,0.03171,0.2634735,0.1366306,0.005985137,0.02766368],"genre_scores_gemma":[0.02116894,0.01143125,0.5338831,0.02068589,0.003643906,0.3523782,0.0512278,0.001038293,0.004542667],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.4118665,"threshold_uncertainty_score":0.5079048,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2118852500","doi":"10.1093/beheco/arn020","title":"Time for some a priori thinking about post hoc testing","year":2008,"lang":"en","type":"article","venue":"Behavioral Ecology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":602,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Université de Montréal","funders":"University of Glasgow","keywords":"Biology; A priori and a posteriori; Post hoc; Post-hoc analysis; Statistics; Mathematics; Epistemology; Internal medicine","authors":[{"name":"Graeme D. Ruxton","is_ca":false},{"name":"Guy Beauchamp","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6153986132544237,"gpt":0.5598863649413716,"spread":0.05551224831305213,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1296086,0.002328263,0.003288522,0.003439163,0.004843051,0.009276463,0.006730547,0.009973273,0.03260478],"category_scores_gemma":[0.3524127,0.002057648,0.003801703,0.002956015,0.02150434,0.01381795,0.005429389,0.03771743,0.02464315],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004018529,"about_ca_system_score_gemma":0.006592579,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001043228,"about_ca_topic_score_gemma":0.001852428,"domain_scores_codex":[0.899364,0.07060625,0.007032374,0.006732077,0.01497469,0.001290549],"domain_scores_gemma":[0.6342897,0.2661619,0.0135396,0.05252861,0.02935441,0.004125792],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001513436,0.0003369547,0.000818154,0.003356511,0.0006972481,0.001355603,0.006525938,0.001311384,0.005056299,0.3129905,0.4778406,0.1881974],"study_design_scores_gemma":[0.0003048883,0.0005812513,0.000684505,0.002511476,0.000107173,0.0007628588,0.001184653,0.002473083,0.002467463,0.4100625,0.5786782,0.0001818416],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.002018961,0.00585258,0.7518067,0.1372091,0.06662786,0.001846707,0.0006008716,0.003543655,0.03049355],"genre_scores_gemma":[0.03503869,0.003826562,0.7941747,0.1025218,0.03170187,0.0073278,0.0004064221,0.002962,0.0220402],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8703914,"threshold_uncertainty_score":0.6854441,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2042805913","doi":"10.1136/bmj.39136.682083.ae","title":"Problems with use of composite end points in cardiovascular trials: systematic review of randomised controlled trials","year":2007,"lang":"en","type":"review","venue":"BMJ","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":456,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University; Canadian College of Naturopathic Medicine; Western University; McMaster University","funders":"Canadian Institutes of Health Research; Mayo Foundation for Medical Education and Research","keywords":"Medicine; End point; Randomized controlled trial; Relative risk; Clinical trial; Clinical endpoint; Internal medicine; Confidence interval; Mathematics","authors":[{"name":"Ignacio Ferreira‐González","is_ca":false},{"name":"Gaiet Permanyer-Miralda","is_ca":false},{"name":"Antònia Domingo‐Salvany","is_ca":false},{"name":"Jason W. Busse","is_ca":true},{"name":"Diane Heels‐Ansdell","is_ca":true},{"name":"Víctor M. Montori","is_ca":false},{"name":"Elie A. Akl","is_ca":false},{"name":"Dianne Bryant","is_ca":true},{"name":"Pablo Alonso‐Coello","is_ca":false},{"name":"Jordi Alonso","is_ca":false},{"name":"Andrew Worster","is_ca":true},{"name":"Suneel Upadhye","is_ca":true},{"name":"Roman Jaeschke","is_ca":true},{"name":"Holger J. Schünemann","is_ca":false},{"name":"Valeria Pacheco‐Huergo","is_ca":false},{"name":"Ping Wu","is_ca":true},{"name":"Edward J. Mills","is_ca":true},{"name":"Gordon Guyatt","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7630812926026873,"gpt":0.6042377862803687,"spread":0.1588435063223186,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.480403,0.004381018,0.02494362,0.01516892,0.001683248,0.00961583,0.006282592,0.006520772,0.003664259],"category_scores_gemma":[0.7576292,0.004671832,0.01965874,0.01811416,0.007935403,0.008836227,0.005397246,0.006415683,0.0007527891],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01002706,"about_ca_system_score_gemma":0.01506442,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004482682,"about_ca_topic_score_gemma":0.008791329,"domain_scores_codex":[0.204297,0.5598769,0.1753732,0.01515121,0.04415899,0.001142668],"domain_scores_gemma":[0.1320706,0.7457887,0.08646621,0.01638873,0.01817014,0.001115578],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.001943394,0.00003279708,0.002629588,0.8354002,0.089085,0.0001358074,0.0008476252,0.0009420892,0.0001698398,0.003497088,0.006915757,0.05840074],"study_design_scores_gemma":[0.0106899,0.001206759,0.01095511,0.7344447,0.1628545,0.0009459571,0.001030225,0.003685386,0.001006654,0.03206896,0.04049615,0.0006157964],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.002418753,0.9640229,0.01577992,0.006201118,0.002567609,0.006073469,0.001600998,0.0002401184,0.001095086],"genre_scores_gemma":[0.2202178,0.5811712,0.104738,0.01744847,0.004473244,0.06753008,0.002858517,0.000563138,0.0009996259],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.519597,"threshold_uncertainty_score":0.6407557,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1835051027","doi":"10.3758/s13423-015-0913-5","title":"Hidden multiplicity in exploratory multiway ANOVA: Prevalence and remedies","year":2015,"lang":"en","type":"article","venue":"Psychonomic Bulletin & Review","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":437,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"PricewaterhouseCoopers (Canada)","funders":"","keywords":"Psychology; False discovery rate; Null hypothesis; Multiple comparisons problem; Type I and type II errors; Statistical hypothesis testing; Statistics; Analysis of variance; Variance (accounting); Null (SQL); Test (biology); Cognitive psychology; Control (management); Social psychology; Mathematics; Artificial intelligence; Computer science; Data mining","authors":[{"name":"Angélique O. J. Cramer","is_ca":false},{"name":"Don van Ravenzwaaij","is_ca":false},{"name":"Dóra Matzke","is_ca":false},{"name":"Helen Steingroever","is_ca":false},{"name":"Ruud Wetzels","is_ca":true},{"name":"Raoul P. P. P. Grasman","is_ca":false},{"name":"Lourens Waldorp","is_ca":false},{"name":"Eric‐Jan Wagenmakers","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5931554158815283,"gpt":0.536563227896454,"spread":0.05659218798507426,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2385886,0.001508315,0.002949772,0.005630919,0.002481356,0.00443463,0.004947493,0.004953149,0.003256163],"category_scores_gemma":[0.6150032,0.001833625,0.002168614,0.00486665,0.02179714,0.01054216,0.00854829,0.007735512,0.0006843383],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002558509,"about_ca_system_score_gemma":0.003578855,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008828919,"about_ca_topic_score_gemma":0.001467107,"domain_scores_codex":[0.6933132,0.198931,0.0249244,0.01995285,0.06126025,0.001618234],"domain_scores_gemma":[0.2843198,0.6057715,0.04358625,0.04936254,0.01546424,0.001495717],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0008718118,0.0004029474,0.0537552,0.007921451,0.001301946,0.003722745,0.01789959,0.001840388,0.003166176,0.2477929,0.02231823,0.6390066],"study_design_scores_gemma":[0.0005386174,0.002067187,0.05179284,0.01547623,0.001531646,0.02028219,0.006461631,0.0245342,0.01187062,0.7762334,0.08840336,0.000808031],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04262714,0.03944338,0.8610963,0.04223088,0.002894669,0.0009535534,0.0002508047,0.001979197,0.008524076],"genre_scores_gemma":[0.5887557,0.01918656,0.3703974,0.01218809,0.003810784,0.002433423,0.000170867,0.0007503935,0.002306847],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.2385886,"threshold_uncertainty_score":0.9389558,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2973459418","doi":"10.1186/s13063-019-3664-1","title":"Systematic review of basket trials, umbrella trials, and platform trials: a landscape analysis of master protocols","year":2019,"lang":"en","type":"review","venue":"Trials","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":435,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; Stantec (Canada); HIV Legal Network; McMaster University Medical Centre; University of British Columbia; Impact","funders":"","keywords":"Medicine; Clinical trial; Interquartile range; MEDLINE; Randomization; Protocol (science); Randomized controlled trial; Sample size determination; Research design; Alternative medicine; Internal medicine; Pathology; Statistics","authors":[{"name":"Jay Park","is_ca":false},{"name":"Ellie Siden","is_ca":false},{"name":"Michael J. Zoratti","is_ca":true},{"name":"Louis Dron","is_ca":false},{"name":"Ofir Harari","is_ca":false},{"name":"Joel Singer","is_ca":true},{"name":"Richard Lester","is_ca":false},{"name":"Kristian Thorlund","is_ca":true},{"name":"Edward J. Mills","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9347214944396993,"gpt":0.7018322329760908,"spread":0.2328892614636086,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22121,0.002971463,0.0145982,0.0341958,0.001638251,0.007881477,0.004325382,0.003626205,0.005228926],"category_scores_gemma":[0.5187391,0.002333092,0.01565237,0.03979532,0.003032659,0.01086243,0.006303167,0.002625855,0.0005909264],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01142796,"about_ca_system_score_gemma":0.02172863,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002916171,"about_ca_topic_score_gemma":0.01001888,"domain_scores_codex":[0.5849226,0.2438818,0.1213689,0.01094878,0.03655125,0.002326654],"domain_scores_gemma":[0.4472405,0.4446028,0.07412708,0.01057298,0.0221798,0.001276808],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.001013195,0.00003354968,0.003673209,0.9019281,0.03085562,0.0001918109,0.0007792988,0.0006163133,0.0002496402,0.003358603,0.002878823,0.05442173],"study_design_scores_gemma":[0.001733246,0.0005519122,0.008090214,0.8576778,0.1015592,0.0003226181,0.0009725608,0.001166134,0.0003092483,0.007011232,0.02050027,0.0001054232],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.01066866,0.9344116,0.01368019,0.003214388,0.0005200235,0.02803934,0.006123919,0.0001390325,0.003202887],"genre_scores_gemma":[0.1938341,0.6139468,0.08202736,0.005990684,0.0005423285,0.09736516,0.005409191,0.0001918758,0.0006925481],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9854018,"threshold_uncertainty_score":0.9603867,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2075535893","doi":"10.1371/journal.pone.0115065","title":"Network Meta-Analysis Using R: A Review of Currently Available Automated Packages","year":2014,"lang":"en","type":"review","venue":"PLoS ONE","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":389,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Computer science; Meta-analysis; Computational biology; Medicine; Bioinformatics; Data science; Biology; Internal medicine","authors":[{"name":"Binod Neupane","is_ca":true},{"name":"Danielle Richer","is_ca":true},{"name":"Ashley Bonner","is_ca":true},{"name":"Taddele Kibret","is_ca":true},{"name":"Joseph Beyene","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.921579771556096,"gpt":0.6141508616884526,"spread":0.3074289098676435,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02918982,0.003302879,0.004910149,0.0116519,0.0004586921,0.002249259,0.004663469,0.001550857,0.01958704],"category_scores_gemma":[0.1095837,0.001833014,0.007633897,0.01288929,0.001057548,0.001951165,0.0021399,0.003190255,0.008969007],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001505053,"about_ca_system_score_gemma":0.004582952,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00315119,"about_ca_topic_score_gemma":0.003920599,"domain_scores_codex":[0.9787911,0.01482656,0.002454681,0.001317546,0.002441867,0.000168094],"domain_scores_gemma":[0.8973534,0.08948135,0.004673146,0.004017667,0.004113987,0.0003606143],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00038364,0.00005325352,0.00146284,0.07123394,0.008448173,0.0001785387,0.0001880185,0.009150366,0.0004655154,0.01986259,0.1147875,0.7737857],"study_design_scores_gemma":[0.0007172562,0.0002771632,0.005586122,0.03485241,0.01272728,0.001396444,0.0001335858,0.02024294,0.002444405,0.1285573,0.7926726,0.0003924872],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.001046035,0.5780367,0.3785172,0.007850064,0.001228571,0.001071707,0.01382808,0.01123616,0.007185472],"genre_scores_gemma":[0.01697877,0.4785749,0.4765965,0.002405923,0.001490617,0.007384925,0.00936569,0.004802251,0.002400419],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9708102,"threshold_uncertainty_score":0.1543724,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2567636536","doi":"10.1093/ije/dyw320","title":"An introduction to multiplicity issues in clinical trials: the what, why, when and how","year":2016,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":379,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Hamilton Health Sciences; Ottawa Hospital; University of Ottawa; Population Health Research Institute; McMaster University; St. Joseph’s Healthcare Hamilton","funders":"","keywords":"Confusion; Multiplicity (mathematics); Clinical trial; Population; Computer science; Risk analysis (engineering); Medicine; Intensive care medicine; Psychology; Mathematics; Pathology","authors":[{"name":"Guowei Li","is_ca":true},{"name":"Monica Taljaard","is_ca":true},{"name":"Edwin R. van den Heuvel","is_ca":false},{"name":"Mitchell Levine","is_ca":true},{"name":"George A. Wells","is_ca":true},{"name":"P.J. Devereaux","is_ca":true},{"name":"Lehana Thabane","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7812381245744865,"gpt":0.6905686159584271,"spread":0.09066950861605938,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06412707,0.002765874,0.003174695,0.004248515,0.001648565,0.007030565,0.003599611,0.01002166,0.02662847],"category_scores_gemma":[0.2149507,0.00196577,0.004017371,0.00487863,0.00975446,0.01358634,0.004214523,0.01846547,0.01461985],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003467959,"about_ca_system_score_gemma":0.004699322,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001045211,"about_ca_topic_score_gemma":0.001355127,"domain_scores_codex":[0.9226676,0.05564739,0.00896028,0.00240611,0.009590098,0.0007285259],"domain_scores_gemma":[0.6478316,0.3277218,0.007592374,0.00553373,0.009373801,0.001946655],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0004015712,0.0001482385,0.0006877995,0.01114422,0.000317065,0.0005363706,0.00198397,0.001826472,0.001029742,0.1840284,0.4798651,0.3180311],"study_design_scores_gemma":[0.0001303624,0.0003429349,0.0005124731,0.007357007,0.0001029951,0.001630735,0.000298468,0.001378447,0.0004598447,0.2899051,0.6977386,0.0001431049],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0006688929,0.1770888,0.5778958,0.170551,0.0381333,0.001886854,0.001642061,0.00229764,0.02983573],"genre_scores_gemma":[0.01037624,0.1624163,0.5903018,0.1509874,0.05791185,0.006473583,0.00094246,0.002400398,0.01819003],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.9358729,"threshold_uncertainty_score":0.3391404,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1987973071","doi":"10.1002/sim.5941","title":"Graphical assessment of internal and external calibration of logistic regression models by using loess smoothers","year":2013,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":357,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Health Sciences Centre; University of Toronto; Public Health Ontario; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Overfitting; Calibration; Logistic regression; Statistics; Computer science; Covariate; Loess; Econometrics; Mathematics; Artificial intelligence","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Ewout W. Steyerberg","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4241021929435487,"gpt":0.5779164790022724,"spread":0.1538142860587237,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07874872,0.001715407,0.001688042,0.004584369,0.0008355074,0.003093741,0.002132752,0.002363902,0.003445942],"category_scores_gemma":[0.3413173,0.0008258577,0.002036219,0.002491859,0.002252361,0.003270011,0.002967285,0.00340351,0.0007052567],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001084529,"about_ca_system_score_gemma":0.001235826,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001843078,"about_ca_topic_score_gemma":0.001545215,"domain_scores_codex":[0.9562913,0.03630672,0.001905734,0.002001901,0.002995259,0.0004992372],"domain_scores_gemma":[0.6342739,0.3166513,0.01714059,0.02058585,0.01048043,0.0008679633],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002475566,0.0003367301,0.0852329,0.001680568,0.002119622,0.0007577693,0.003053861,0.501369,0.008543511,0.07525796,0.00686803,0.3123046],"study_design_scores_gemma":[0.0001717481,0.0006038301,0.01588172,0.0002858764,0.0002785015,0.000429949,0.0002596489,0.9132946,0.004890879,0.06033158,0.003342779,0.0002289165],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04190331,0.0005035912,0.9541317,0.000409401,0.0000654274,0.0001816116,0.0002090454,0.001883068,0.0007128027],"genre_scores_gemma":[0.6047517,0.0004517274,0.3913553,0.0003482339,0.00007691968,0.0006768335,0.0007867817,0.0007790966,0.0007734009],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.07874872,"threshold_uncertainty_score":0.416468,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2151070032","doi":"10.3945/ajcn.115.113548","title":"Best (but oft-forgotten) practices: the multiple problems of multiplicity—whether and how to correct for many statistical tests","year":2015,"lang":"en","type":"article","venue":"American Journal of Clinical Nutrition","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":348,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; University of Toronto","funders":"","keywords":"Multiple comparisons problem; Resampling; False discovery rate; Bonferroni correction; Statistical hypothesis testing; Null hypothesis; Multiplicity (mathematics); Statistics; Econometrics; Statistic; Mathematics; Computer science","authors":[{"name":"David L. Streiner","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6155333581101351,"gpt":0.5890310654222888,"spread":0.02650229268784632,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2900035,0.003029831,0.006531009,0.006624518,0.005477383,0.01198752,0.01002672,0.01044915,0.003329829],"category_scores_gemma":[0.777993,0.002612429,0.004587529,0.005755033,0.02359568,0.02082847,0.008575154,0.02853706,0.00267177],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003337657,"about_ca_system_score_gemma":0.01088937,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004023458,"about_ca_topic_score_gemma":0.00569315,"domain_scores_codex":[0.6425246,0.2830797,0.0264304,0.01561912,0.0308313,0.001514949],"domain_scores_gemma":[0.2139986,0.6059278,0.03306151,0.09631433,0.04507247,0.005625459],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0009260791,0.0001992169,0.01384791,0.003319398,0.003893176,0.0007537839,0.003600026,0.004332228,0.001095047,0.1119119,0.1127518,0.7433695],"study_design_scores_gemma":[0.0003580278,0.0002458296,0.0039637,0.004938607,0.001090702,0.002694439,0.0009705285,0.02291565,0.00298938,0.9159584,0.04323164,0.0006432683],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.003429736,0.01802339,0.7959598,0.1723265,0.006530399,0.0001428975,0.0002020932,0.001879885,0.001505174],"genre_scores_gemma":[0.06178282,0.005169678,0.8994331,0.02424214,0.007507322,0.0003752515,0.00008989219,0.0006691644,0.0007306156],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7099965,"threshold_uncertainty_score":0.8755521,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2043994334","doi":"10.1021/pr200021n","title":"Biospecimen Reporting for Improved Study Quality (BRISQ)","year":2011,"lang":"en","type":"article","venue":"Journal of Proteome Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":331,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"BC Cancer Agency","funders":"National Cancer Institute; National Institutes of Health","keywords":"Quality (philosophy); Consistency (knowledge bases); Data science; Biorepository; Computer science; Medicine; Risk analysis (engineering); Biobank; Bioinformatics; Biology","authors":[{"name":"Helen M. Moore","is_ca":false},{"name":"Andréa B. Kelly","is_ca":false},{"name":"Scott D. Jewell","is_ca":false},{"name":"Lisa M. McShane","is_ca":false},{"name":"Douglas P. Clark","is_ca":false},{"name":"Renata Greenspan","is_ca":false},{"name":"Daniel F. Hayes","is_ca":false},{"name":"Pierre Hainaut","is_ca":false},{"name":"Paula Kim","is_ca":false},{"name":"Elizabeth Mansfield","is_ca":false},{"name":"Olga Potapova","is_ca":false},{"name":"Peter Riegman","is_ca":false},{"name":"Yaffa Rubinstein","is_ca":false},{"name":"Edward Seijo","is_ca":false},{"name":"Stella Somiari","is_ca":false},{"name":"Peter H. Watson","is_ca":true},{"name":"Heinz-Ulrich G. Weier","is_ca":false},{"name":"Claire S. Zhu","is_ca":false},{"name":"Jim Vaught","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9770253359502199,"gpt":0.7704332796433205,"spread":0.2065920563068994,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6091382,0.004014579,0.008194204,0.02448592,0.005188442,0.02311823,0.0123858,0.01659416,0.03472414],"category_scores_gemma":[0.7833521,0.006751327,0.00629158,0.03170905,0.009176943,0.01395158,0.0137745,0.02098078,0.05059879],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009991774,"about_ca_system_score_gemma":0.05082435,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005498933,"about_ca_topic_score_gemma":0.003996647,"domain_scores_codex":[0.2771132,0.3600938,0.2585693,0.01119732,0.08470248,0.008323849],"domain_scores_gemma":[0.07061742,0.223267,0.1425366,0.1818807,0.3749845,0.006713845],"domain_codex":"methods","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.002167495,0.0004704289,0.005300208,0.0123803,0.0006156838,0.0005232237,0.002954384,0.001478708,0.004872828,0.01921456,0.7665662,0.1834559],"study_design_scores_gemma":[0.001498872,0.0008827526,0.02056038,0.01217579,0.0004626546,0.0009979449,0.001189701,0.007876375,0.009511185,0.01954155,0.9246266,0.000676207],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007616108,0.006185236,0.6363992,0.08776538,0.05039036,0.1021163,0.03918315,0.02214795,0.04819631],"genre_scores_gemma":[0.02818847,0.003879794,0.8079565,0.03059871,0.009678852,0.07214957,0.02257586,0.007209758,0.01776244],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.3908618,"threshold_uncertainty_score":0.4820023,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2042378780","doi":"10.1186/1745-6215-10-27","title":"Design, analysis, and presentation of crossover trials","year":2009,"lang":"en","type":"review","venue":"Trials","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":325,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; Simon Fraser University","funders":"","keywords":"Sample size determination; Crossover study; Medicine; Crossover; Clinical trial; Randomized controlled trial; Research design; MEDLINE; Drug trial; Clinical study design; Medical physics; Alternative medicine; Statistics; Internal medicine; Computer science; Pathology","authors":[{"name":"Edward J. Mills","is_ca":true},{"name":"An‐Wen Chan","is_ca":false},{"name":"Ping Wu","is_ca":false},{"name":"Andy Vail","is_ca":false},{"name":"Gordon Guyatt","is_ca":true},{"name":"Douglas G. Altman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9412843850960871,"gpt":0.7413113448083124,"spread":0.1999730402877747,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3046266,0.007150175,0.01467006,0.01015003,0.001976854,0.006745951,0.004868658,0.006570761,0.0159786],"category_scores_gemma":[0.5075518,0.002914936,0.01062811,0.00819803,0.003930401,0.004611137,0.002207286,0.005045414,0.003021162],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004245914,"about_ca_system_score_gemma":0.01481961,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005148967,"about_ca_topic_score_gemma":0.0005312681,"domain_scores_codex":[0.5176964,0.3467818,0.09711357,0.01494507,0.02104456,0.002418491],"domain_scores_gemma":[0.5917031,0.2285486,0.1098842,0.03367176,0.03314618,0.003046221],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","study_design_scores_codex":[0.1154737,0.00139519,0.01040099,0.4613532,0.04521135,0.0007294593,0.002311812,0.005212119,0.003199591,0.01801976,0.03875259,0.2979403],"study_design_scores_gemma":[0.4017055,0.03765946,0.02019402,0.2256613,0.06935382,0.0011353,0.001008498,0.01372658,0.01298833,0.06667819,0.1488583,0.001030783],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"protocol","genre_gemma":"review","genre_scores_codex":[0.005859196,0.03458565,0.09900793,0.002185456,0.004831127,0.8440527,0.005102308,0.001130929,0.003244681],"genre_scores_gemma":[0.01899455,0.005786443,0.1080819,0.001410753,0.0007533986,0.863701,0.0006950208,0.000131374,0.00044548],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.6953734,"threshold_uncertainty_score":0.8575191,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2168627095","doi":"10.1348/000711004849222","title":"A note on preliminary tests of equality of variances","year":2004,"lang":"en","type":"article","venue":"British Journal of Mathematical and Statistical Psychology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":313,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Carleton University","funders":"","keywords":"F-test of equality of variances; Statistics; Test (biology); Type I and type II errors; Levene's test; Mathematics; Sample size determination; Econometrics; Nominal level; Statistical hypothesis testing; Test statistic","authors":[{"name":"Donald W. Zimmerman","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3838805211543762,"gpt":0.5674083538348488,"spread":0.1835278326804726,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3721899,0.003206858,0.005624107,0.005257437,0.003712828,0.00754857,0.009801039,0.008205086,0.01105718],"category_scores_gemma":[0.808348,0.002686398,0.007288687,0.00681569,0.01800375,0.0155075,0.007128354,0.03231106,0.004372611],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003227923,"about_ca_system_score_gemma":0.008891927,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00271704,"about_ca_topic_score_gemma":0.002015022,"domain_scores_codex":[0.5201839,0.3841525,0.02878077,0.01539795,0.04871037,0.002774398],"domain_scores_gemma":[0.07748074,0.8434336,0.01134365,0.04256412,0.02391483,0.00126303],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.003434019,0.0006565785,0.01825583,0.004752213,0.001759979,0.004861321,0.01106174,0.01483721,0.006110269,0.4475262,0.1042025,0.3825422],"study_design_scores_gemma":[0.0007301967,0.003981824,0.01296932,0.004971502,0.0006074524,0.002808628,0.002297726,0.04201091,0.01555789,0.7357137,0.1774138,0.0009370472],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007456451,0.003776297,0.9513534,0.01405473,0.007327001,0.001489421,0.0006107238,0.001332912,0.01259913],"genre_scores_gemma":[0.09574228,0.002348832,0.8760217,0.01054319,0.004008872,0.005508857,0.0005287995,0.001129901,0.004167534],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.3721899,"threshold_uncertainty_score":0.7742016,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2563861885","doi":"10.3768/rtipress.2009.mr.0009.0903","title":"A mixed model approach for intent-to-treat analysis in longitudinal clinical trials with missing values","year":2009,"lang":"en","type":"report","venue":"","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":297,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University","funders":"","keywords":"Missing data; Imputation (statistics); Post hoc; Clinical trial; Confusion; Population; Longitudinal data; Mixed model; Protocol (science); Medicine; Statistics; Computer science; Data mining; Psychology; Mathematics; Alternative medicine","authors":[{"name":"Hrishikesh Chakraborty","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9271468758360674,"gpt":0.6894751672155476,"spread":0.2376717086205198,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1939569,0.003342224,0.004488638,0.004092466,0.001408278,0.003250759,0.005148413,0.004434807,0.01620343],"category_scores_gemma":[0.26689,0.001382013,0.007987984,0.004447554,0.002182659,0.003390125,0.002789795,0.008033952,0.002769775],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002917064,"about_ca_system_score_gemma":0.005553985,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009420346,"about_ca_topic_score_gemma":0.001155238,"domain_scores_codex":[0.6780347,0.3008659,0.00633976,0.00543556,0.00848759,0.0008364529],"domain_scores_gemma":[0.7912841,0.1834571,0.00815877,0.01100251,0.005332464,0.0007651036],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.005041011,0.001089906,0.004471658,0.00831356,0.008160583,0.0008130562,0.002427142,0.08803617,0.002033385,0.4239128,0.03681195,0.4188889],"study_design_scores_gemma":[0.005408113,0.007977625,0.002458863,0.002750757,0.003021495,0.0009730597,0.000360464,0.4968688,0.004490698,0.4116995,0.0635222,0.0004683651],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0009708725,0.0005601122,0.9922057,0.0006454545,0.0003676649,0.003766474,0.0003264841,0.0003456657,0.0008115908],"genre_scores_gemma":[0.01968439,0.00060719,0.9506351,0.000749801,0.0002016613,0.02686196,0.0003031519,0.0001270449,0.0008296533],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1939569,"threshold_uncertainty_score":0.9939947,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1980718559","doi":"10.1037/1082-989x.10.3.317","title":"An Alternative to Cohen's Standardized Mean Difference Effect Size: A Robust Parameter and Confidence Interval in the Two Independent Groups Case.","year":2005,"lang":"en","type":"article","venue":"Psychological Methods","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":292,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Manitoba","funders":"","keywords":"Statistics; Percentile; Confidence interval; Mathematics; Robust confidence intervals; Coverage probability; Truncated mean; Confidence distribution; CDF-based nonparametric confidence interval; Population; Standard deviation; Tolerance interval; Range (aeronautics); Measure (data warehouse); Medicine","authors":[{"name":"James Algina","is_ca":false},{"name":"H. J. Keselman","is_ca":true},{"name":"Randall D. Penfield","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4903035578928938,"gpt":0.6284214039490661,"spread":0.1381178460561723,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.156198,0.001902478,0.003762876,0.01178859,0.001487624,0.006113538,0.007917622,0.008413523,0.00638169],"category_scores_gemma":[0.5203384,0.001025038,0.00417984,0.01030081,0.007579938,0.01014015,0.00530811,0.009762796,0.00210821],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002968655,"about_ca_system_score_gemma":0.003570158,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001359488,"about_ca_topic_score_gemma":0.0009684995,"domain_scores_codex":[0.7832637,0.1512082,0.01405688,0.01737113,0.03277044,0.001329643],"domain_scores_gemma":[0.4902961,0.4255528,0.02759134,0.03116524,0.02364115,0.001753337],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001018996,0.0002479117,0.006050284,0.005625471,0.003222669,0.0003878167,0.002857143,0.002997463,0.001193528,0.4989917,0.03654748,0.4408594],"study_design_scores_gemma":[0.0008856446,0.001360108,0.0102985,0.003294703,0.001754326,0.002868542,0.001077408,0.01505169,0.002992973,0.8485402,0.1113928,0.0004831542],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005138597,0.02323101,0.9401139,0.007479403,0.005053491,0.0009789307,0.001004315,0.0008151158,0.0161853],"genre_scores_gemma":[0.2021122,0.005037784,0.7731439,0.006877162,0.002592443,0.006408423,0.0005619382,0.0006126289,0.002653575],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.156198,"threshold_uncertainty_score":0.8260636,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1594888675","doi":"10.1002/pds.2343","title":"The U.S. Food and Drug Administration's Mini‐Sentinel program: status and direction","year":2012,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":290,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Hamilton Health Sciences Foundation; U.S. Department of Health and Human Services","keywords":"Medicine; Medical prescription; Food and drug administration; Pharmacy; Formulary; Mandate; Health care; Medical diagnosis; Medical emergency; Family medicine; Nursing","authors":[{"name":"Richard Platt","is_ca":false},{"name":"Ryan M. Carnahan","is_ca":false},{"name":"Jeffrey S. Brown","is_ca":false},{"name":"Elizabeth A. Chrischilles","is_ca":false},{"name":"Lesley H. Curtis","is_ca":false},{"name":"Sean Hennessy","is_ca":false},{"name":"Jennifer C. Nelson","is_ca":false},{"name":"Judith A. Racoosin","is_ca":false},{"name":"Melissa A. Robb","is_ca":false},{"name":"Sebastian Schneeweiß","is_ca":false},{"name":"Sengwee Toh","is_ca":false},{"name":"Mark G. Weiner","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2928198787070505,"gpt":0.5376139426936772,"spread":0.2447940639866267,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.142876,0.002116888,0.002247124,0.003920413,0.003382851,0.01146899,0.008518742,0.01113853,0.01461932],"category_scores_gemma":[0.07638527,0.001340979,0.002710807,0.00680253,0.004442199,0.008714543,0.005988428,0.01052793,0.007993751],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.008199089,"about_ca_system_score_gemma":0.1393919,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02478246,"about_ca_topic_score_gemma":0.02929873,"domain_scores_codex":[0.9587988,0.01508178,0.002814574,0.002057706,0.01766346,0.003583739],"domain_scores_gemma":[0.7684073,0.04224407,0.01660683,0.009267758,0.0985674,0.06490656],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001065268,0.002137763,0.006273824,0.001758892,0.0001096824,0.00008104129,0.000195258,0.0006110563,0.001118151,0.01248248,0.7390212,0.2351453],"study_design_scores_gemma":[0.00277725,0.003704583,0.01592749,0.005788982,0.0002017355,0.0001550848,0.0005271277,0.002822888,0.001653319,0.008232849,0.9580066,0.0002019651],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"commentary","genre_gemma":"review","genre_scores_codex":[0.01094796,0.03058659,0.0193633,0.8082464,0.020208,0.014734,0.02315838,0.004640724,0.06811474],"genre_scores_gemma":[0.04959758,0.07628685,0.3448316,0.365812,0.01645515,0.02824819,0.06042316,0.001691833,0.05665361],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.142876,"threshold_uncertainty_score":0.7556095,"prediction_status":"machine_predicted_unvalidated"},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"not_applicable","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"agree"},{"id":"W2116750865","doi":"10.1093/aje/kwn104","title":"On the Estimation of Additive Interaction by Use of the Four-by-two Table and Beyond","year":2008,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":278,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Robarts Clinical Trials; Western University","funders":"Ontario Ministry of Research and Innovation","keywords":"Confidence interval; Table (database); Row; Set (abstract data type); Computer science; Statistics; Perspective (graphical); Interval (graph theory); Mathematics; Data mining; Artificial intelligence; Combinatorics; Database","authors":[{"name":"Guangyong Zou","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4928062528372004,"gpt":0.5403994502683522,"spread":0.04759319743115181,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06699918,0.001514947,0.003240952,0.003018315,0.001084282,0.00270393,0.002526212,0.001280431,0.008134821],"category_scores_gemma":[0.2216226,0.0006419863,0.002477279,0.004450357,0.003323333,0.003912671,0.002492044,0.004120789,0.001414304],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009598996,"about_ca_system_score_gemma":0.002697582,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00212452,"about_ca_topic_score_gemma":0.001573964,"domain_scores_codex":[0.9001526,0.08832813,0.002202874,0.002938777,0.00597082,0.0004068398],"domain_scores_gemma":[0.6411262,0.333981,0.005786438,0.01459777,0.003981004,0.0005275764],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001341708,0.0002592015,0.01534777,0.001217935,0.001052326,0.0008724008,0.001226364,0.01964304,0.001801483,0.3782302,0.01529469,0.5637128],"study_design_scores_gemma":[0.0003814096,0.001302274,0.008537892,0.0006217156,0.000485191,0.001429642,0.0003817273,0.1853751,0.004585393,0.7591222,0.03739684,0.0003805661],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004309141,0.0003656318,0.9923793,0.0004477756,0.0002196622,0.0002169305,0.0002623848,0.0003002135,0.001498947],"genre_scores_gemma":[0.06147506,0.0005202952,0.9349431,0.000604624,0.0001873878,0.0009303458,0.0003689111,0.0001641482,0.0008061611],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.06699918,"threshold_uncertainty_score":0.3543298,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2160929550","doi":"10.1198/016214504000002069","title":"Limited- and Full-Information Estimation and Goodness-of-Fit Testing in 2<i><sup>n</sup></i>Contingency Tables","year":2005,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":264,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Government of British Columbia","funders":"","keywords":"Statistics; Goodness of fit; Mathematics; Contingency table; Pooling; Estimator; Multivariate statistics; Statistical hypothesis testing; Parametric statistics; Econometrics; Computer science","authors":[{"name":"Alberto Maydeu‐Olivares","is_ca":true},{"name":"Harry Joe","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1892562064606019,"gpt":0.455272008541823,"spread":0.2660158020812211,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05732268,0.001039062,0.002634869,0.002905568,0.0007342936,0.002049182,0.00282756,0.001602411,0.00496987],"category_scores_gemma":[0.318028,0.0007879133,0.001840035,0.002936101,0.003974323,0.004642046,0.00250974,0.002804131,0.0007126195],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007293094,"about_ca_system_score_gemma":0.001397995,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0006517352,"about_ca_topic_score_gemma":0.0006317502,"domain_scores_codex":[0.9465315,0.04391118,0.002208469,0.00330427,0.00350644,0.0005382072],"domain_scores_gemma":[0.539906,0.4235904,0.01181756,0.020068,0.003671082,0.000946946],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.002078975,0.0004173776,0.04902672,0.001469724,0.001528247,0.00152209,0.001685722,0.1532352,0.003175345,0.3659093,0.007449926,0.4125015],"study_design_scores_gemma":[0.000185464,0.000600263,0.01177491,0.0002146293,0.0001719407,0.000613562,0.0001940042,0.5460886,0.00234521,0.4353825,0.002317892,0.000111059],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02745413,0.0004172602,0.9702836,0.0003135751,0.00003329022,0.0001418465,0.0002779483,0.0002758737,0.0008025044],"genre_scores_gemma":[0.5305017,0.0004992369,0.4648521,0.0003240494,0.0001956344,0.001608646,0.001081038,0.0001565202,0.0007810808],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.05732268,"threshold_uncertainty_score":0.3031549,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2129733505","doi":"10.1186/1745-6215-13-120","title":"Allocation techniques for balance at baseline in cluster randomized trials: a methodological review","year":2012,"lang":"en","type":"review","venue":"Trials","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":259,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Toronto Western Hospital; Health Sciences Centre; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre; University Health Network; University of Toronto; Women's College Hospital","funders":"Canadian Institutes of Health Research; Department of Family and Community Medicine, University of Toronto; University of Toronto","keywords":"Randomized controlled trial; Covariate; Medicine; Randomization; External validity; Statistical power; Matching (statistics); Baseline (sea); Observational study; Credibility; Research design; Cluster randomised controlled trial; Statistics; Surgery; Mathematics; Internal medicine","authors":[{"name":"Noah Ivers","is_ca":true},{"name":"Ilana Halperin","is_ca":true},{"name":"Jan Barnsley","is_ca":true},{"name":"Jeremy Grimshaw","is_ca":false},{"name":"Baiju R. Shah","is_ca":true},{"name":"Karen Tu","is_ca":true},{"name":"Ross Upshur","is_ca":true},{"name":"Merrick Zwarenstein","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9616323734160546,"gpt":0.7454275232970856,"spread":0.2162048501189689,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.073543,0.002319894,0.009321441,0.01204466,0.0009849281,0.004279237,0.00400712,0.003845551,0.005080309],"category_scores_gemma":[0.2025487,0.001716664,0.009557936,0.01239333,0.002965369,0.005008214,0.002890256,0.004826042,0.001500914],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006598452,"about_ca_system_score_gemma":0.0133338,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002848973,"about_ca_topic_score_gemma":0.003295259,"domain_scores_codex":[0.9160913,0.05754277,0.01355739,0.002172367,0.01018762,0.0004485169],"domain_scores_gemma":[0.8196743,0.1590301,0.009187446,0.003575941,0.008170414,0.0003618542],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"systematic_review","study_design_scores_codex":[0.0003487151,0.00005744969,0.0002907709,0.3009416,0.003435962,0.00006759139,0.0003696649,0.002035311,0.0002126536,0.02841538,0.01428933,0.6495356],"study_design_scores_gemma":[0.001239536,0.0005340029,0.001906084,0.613674,0.01762149,0.0009253567,0.0003316163,0.00310942,0.0009938541,0.09202895,0.2673762,0.0002594305],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.00008404453,0.9876063,0.009307691,0.001309755,0.0004031161,0.0004613458,0.00005615336,0.00003088869,0.000740681],"genre_scores_gemma":[0.00360302,0.9592264,0.03314191,0.001021094,0.0004406927,0.002170195,0.00007170384,0.00003661439,0.0002882902],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.926457,"threshold_uncertainty_score":0.3889372,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3022623176","doi":"10.2147/clep.s242097","title":"&lt;p&gt;Synthetic and External Controls in Clinical Trials – A Primer for Researchers&lt;/p&gt;","year":2020,"lang":"en","type":"review","venue":"Clinical Epidemiology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":258,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; University of British Columbia; Impact","funders":"","keywords":"Medicine; Critical appraisal; Control (management); Set (abstract data type); Key (lock); Computational biology; Computer science; Data science; Alternative medicine; Biology; Pathology; Artificial intelligence","authors":[{"name":"Kristian Thorlund","is_ca":true},{"name":"Louis Dron","is_ca":false},{"name":"Jay Park","is_ca":true},{"name":"Edward J. Mills","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9492111274371475,"gpt":0.7575105690970199,"spread":0.1917005583401277,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.327206,0.00238134,0.004203829,0.008774761,0.00147037,0.01205999,0.004750716,0.008403214,0.01228036],"category_scores_gemma":[0.5347183,0.001532869,0.003555567,0.01013181,0.01751256,0.01302071,0.006073091,0.01753507,0.00457323],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006611439,"about_ca_system_score_gemma":0.01768797,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002229945,"about_ca_topic_score_gemma":0.001824835,"domain_scores_codex":[0.6463249,0.3059716,0.01998364,0.005602858,0.02127302,0.0008440057],"domain_scores_gemma":[0.2373524,0.7031643,0.01721139,0.01945833,0.02139203,0.001421541],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0002062604,0.00005525643,0.0004069796,0.0238504,0.0004671216,0.0001081145,0.00118704,0.001913916,0.0002035701,0.5125589,0.09296665,0.3660758],"study_design_scores_gemma":[0.0001917788,0.0001930917,0.0004926103,0.04598299,0.0002634272,0.0002284807,0.0004363004,0.003109107,0.0005218731,0.5227267,0.4257495,0.0001040146],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"methods","genre_scores_codex":[0.000327969,0.4544345,0.3432151,0.1679209,0.01424203,0.002407986,0.0008871586,0.0006281464,0.01593613],"genre_scores_gemma":[0.02087354,0.3470403,0.5381942,0.04646432,0.02067012,0.0184388,0.0008125202,0.0009423048,0.006563938],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.672794,"threshold_uncertainty_score":0.8296748,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2995118312","doi":"10.1002/pds.4932","title":"Trial designs using real‐world data: The changing landscape of the regulatory approval process","year":2019,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":257,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University; Jewish General Hospital; McGill University Health Centre","funders":"Pfizer","keywords":"Observational study; Leverage (statistics); Risk analysis (engineering); Medicine; Randomized controlled trial; Clinical study design; Real world data; Data collection; Clinical trial; Process (computing); Management science; Computer science; Data science; Machine learning; Engineering","authors":[{"name":"Elodie Baumfeld Andre","is_ca":false},{"name":"Robert F. Reynolds","is_ca":false},{"name":"Patrick Caubel","is_ca":false},{"name":"Laurent Azoulay","is_ca":true},{"name":"Nancy A Dreyer","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8271081619909781,"gpt":0.6490336892071032,"spread":0.1780744727838749,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6666732,0.001935866,0.009284183,0.006924295,0.001933392,0.02068758,0.00904536,0.01360269,0.004868297],"category_scores_gemma":[0.7872049,0.002316413,0.0063543,0.008118475,0.02244813,0.02339218,0.007948361,0.02432421,0.002027984],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009331452,"about_ca_system_score_gemma":0.01750626,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001967065,"about_ca_topic_score_gemma":0.002127215,"domain_scores_codex":[0.1930611,0.7277545,0.02788281,0.01113542,0.03926346,0.0009028009],"domain_scores_gemma":[0.04876998,0.8903289,0.02072958,0.02168261,0.01762554,0.0008633441],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001095185,0.0002591998,0.004056753,0.05845653,0.00412037,0.0001892558,0.003032057,0.008256599,0.0008301351,0.3611234,0.02183996,0.5367405],"study_design_scores_gemma":[0.001662942,0.001617693,0.004217523,0.1149396,0.002209028,0.0008268565,0.001586476,0.01298824,0.0014934,0.6658474,0.1920341,0.0005767439],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.005337652,0.4462931,0.3490772,0.1767904,0.007743618,0.0027157,0.0007727789,0.0004969107,0.01077266],"genre_scores_gemma":[0.14331,0.1939256,0.5254996,0.108764,0.01258958,0.01301872,0.0007923093,0.0007239702,0.001376295],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.3333268,"threshold_uncertainty_score":0.4110513,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3008310671","doi":"10.1093/ije/dyz237","title":"A tutorial on sample size calculation for multiple-period cluster randomized parallel, cross-over and stepped-wedge trials using the Shiny CRT Calculator","year":2019,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":250,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"Collaboration for Leadership in Applied Health Research and Care - Greater Manchester; National Institute for Health and Care Research; NHS Blood and Transplant","keywords":"Sample size determination; Calculator; Cluster analysis; Cluster (spacecraft); Computer science; Cluster randomised controlled trial; Statistics; Sample (material); Statistical power; Randomized controlled trial; Data mining; Mathematics; Medicine","authors":[{"name":"Karla Hemming","is_ca":false},{"name":"Jessica Kasza","is_ca":false},{"name":"Richard Hooper","is_ca":false},{"name":"Andrew Forbes","is_ca":false},{"name":"Monica Taljaard","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5529050393700715,"gpt":0.614777663946381,"spread":0.06187262457630949,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02794001,0.003526299,0.003079667,0.004567078,0.0005354533,0.002802429,0.003156469,0.003059989,0.1220885],"category_scores_gemma":[0.1479851,0.002120447,0.003021128,0.003554909,0.001333162,0.003312656,0.002078428,0.004768836,0.03769796],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001582315,"about_ca_system_score_gemma":0.002871354,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001248737,"about_ca_topic_score_gemma":0.001419046,"domain_scores_codex":[0.9788456,0.01343329,0.002393678,0.001010466,0.004059071,0.0002578412],"domain_scores_gemma":[0.8946677,0.09429988,0.003594988,0.002361319,0.004413935,0.0006623032],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0007508771,0.0001818794,0.0005149374,0.01190209,0.0003509865,0.0003648151,0.0004765225,0.009825854,0.002097509,0.05950979,0.2932055,0.6208193],"study_design_scores_gemma":[0.001773344,0.0009625246,0.001739367,0.008337343,0.0003117514,0.001099625,0.0001480982,0.03354801,0.004905592,0.1729946,0.7738253,0.0003544677],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.000763159,0.01005978,0.9332608,0.002234709,0.002037611,0.006005783,0.005519958,0.01956502,0.02055323],"genre_scores_gemma":[0.004559458,0.00694883,0.9490854,0.002550229,0.0009758047,0.018201,0.001916879,0.006482046,0.009280259],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1220885,"threshold_uncertainty_score":0.4084268,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2089415104","doi":"10.1002/sim.1687","title":"Inflation of the type I error rate when a continuous confounding variable is categorized in logistic regression analyses","year":2004,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":248,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Confounding; Statistics; Categorical variable; Type I and type II errors; Logistic regression; Mathematics; Inflation (cosmology); Sample size determination; Econometrics; Variable (mathematics); Regression analysis","authors":[{"name":"Peter C. Austin","is_ca":true},{"name":"Lawrence J. Brunner","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5624346742081207,"gpt":0.6001798666323802,"spread":0.03774519242425955,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4783034,0.002276254,0.00370262,0.004241432,0.001905786,0.004399271,0.003450413,0.005750129,0.001969605],"category_scores_gemma":[0.7635874,0.00161082,0.00482435,0.005101701,0.009339102,0.005247748,0.00556312,0.01027712,0.0007312943],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004499334,"about_ca_system_score_gemma":0.003941691,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002364938,"about_ca_topic_score_gemma":0.002308478,"domain_scores_codex":[0.3503839,0.5251655,0.04071745,0.02961154,0.0511537,0.002967902],"domain_scores_gemma":[0.08561659,0.8228095,0.03795846,0.0398222,0.0128536,0.000939805],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.01489818,0.001153811,0.3242511,0.006483751,0.01559317,0.007480071,0.01484226,0.08283249,0.007979672,0.1433687,0.0150659,0.3660508],"study_design_scores_gemma":[0.001807121,0.006062985,0.144685,0.006466531,0.008517521,0.01012712,0.003422387,0.4521603,0.03348206,0.3083527,0.02316189,0.001754396],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.04300847,0.0044373,0.9408407,0.003113846,0.001976466,0.002134117,0.0003753471,0.0009323945,0.003181328],"genre_scores_gemma":[0.5759999,0.001706388,0.4078554,0.004886552,0.001013534,0.005482162,0.0005758298,0.0007114265,0.001768901],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.5216966,"threshold_uncertainty_score":0.6433448,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2090386787","doi":"10.4236/jbise.2011.411090","title":"Implementation of an open-source customizable minimization program for allocation of patients to parallel groups in clinical trials","year":2011,"lang":"en","type":"article","venue":"Journal of Biomedical Science and Engineering","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":247,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Minification; Computer science; Python (programming language); Open source; Data center; Clinical trial; Computer network; Programming language; Software; Medicine","authors":[{"name":"Mahmoud Saghaei","is_ca":false},{"name":"Sara Saghaei","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4627300461880791,"gpt":0.5825008320195479,"spread":0.1197707858314688,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009028787,0.001019,0.0008897167,0.0009165394,0.00050789,0.001139987,0.002229529,0.0007617144,0.03198916],"category_scores_gemma":[0.02885555,0.0009891094,0.001152219,0.0009317931,0.0004723837,0.0009976256,0.00194116,0.00180129,0.006477238],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008396012,"about_ca_system_score_gemma":0.003335577,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001651182,"about_ca_topic_score_gemma":0.00258191,"domain_scores_codex":[0.9972298,0.001433275,0.0003639958,0.0003175942,0.0005113352,0.000144021],"domain_scores_gemma":[0.9866049,0.009939469,0.0007177034,0.001362992,0.001072758,0.0003022781],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.003115357,0.0006987744,0.007575821,0.001856982,0.0008977615,0.0005813249,0.0008925307,0.08217616,0.01363091,0.02807507,0.1440413,0.716458],"study_design_scores_gemma":[0.003324414,0.0003226936,0.005277687,0.000294904,0.0002353652,0.0006930822,0.00009368859,0.7405007,0.0389942,0.07273283,0.1373074,0.0002229732],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"software","genre_scores_codex":[0.00439697,0.00006285153,0.935896,0.0003389756,0.00008790737,0.0008265713,0.001650505,0.05422331,0.002516867],"genre_scores_gemma":[0.04449773,0.0001050585,0.9303411,0.0004782109,0.00006856332,0.004736677,0.002273314,0.01261188,0.004887459],"genre_candidate":"software","genre_consensus":null,"teacher_disagreement_score":0.9909712,"threshold_uncertainty_score":0.1070144,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2974839292","doi":"10.1136/bmj.l5221","title":"Design characteristics, risk of bias, and reporting of randomised controlled trials supporting approvals of cancer drugs by European Medicines Agency, 2014-16: cross sectional analysis","year":2019,"lang":"en","type":"article","venue":"BMJ","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":244,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"Medical Research Council; Economic and Social Research Council; U.S. Department of the Treasury; National Institute for Health and Care Research; Bill and Melinda Gates Foundation; Harvard University; National Institutes of Health; National Science Foundation","keywords":"Medicine; Clinical trial; Randomized controlled trial; Reporting bias; Research design; Clinical endpoint; Publication bias; MEDLINE; Family medicine; Meta-analysis; Internal medicine; Statistics","authors":[{"name":"Huseyin Naci","is_ca":false},{"name":"Courtney Davis","is_ca":false},{"name":"Jelena Savović","is_ca":false},{"name":"Julian P. T. Higgins","is_ca":false},{"name":"Jonathan A C Sterne","is_ca":false},{"name":"Bishal Gyawali","is_ca":true},{"name":"Xochitl Romo-Sandoval","is_ca":false},{"name":"Nicola Handley","is_ca":false},{"name":"Christopher M. Booth","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4469013499055617,"gpt":0.5635049915159488,"spread":0.1166036416103871,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6450285,0.0021913,0.006266205,0.01198376,0.00196811,0.005883213,0.002997078,0.005164702,0.006228661],"category_scores_gemma":[0.8449664,0.002676211,0.01213026,0.01553428,0.005229427,0.006059894,0.003830969,0.002885047,0.001007294],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005677098,"about_ca_system_score_gemma":0.008222014,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001538478,"about_ca_topic_score_gemma":0.001510154,"domain_scores_codex":[0.1217564,0.4970197,0.320729,0.0180935,0.04031717,0.002084221],"domain_scores_gemma":[0.05955838,0.5664591,0.294699,0.04283508,0.03516418,0.001284192],"domain_codex":"methods","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.03235218,0.0007589188,0.5050488,0.1719225,0.1145649,0.000658588,0.00760388,0.004748803,0.001288801,0.0155873,0.02192213,0.1235431],"study_design_scores_gemma":[0.0287481,0.01365109,0.5120597,0.1544842,0.1096675,0.003691179,0.004544062,0.02465289,0.01013528,0.05233168,0.08415463,0.001879681],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2730195,0.2065643,0.2777817,0.01247431,0.00483051,0.1680326,0.04551891,0.001050085,0.01072807],"genre_scores_gemma":[0.6841466,0.008750313,0.1098765,0.00598193,0.0007435187,0.1820627,0.007452783,0.000243407,0.0007421763],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.3549715,"threshold_uncertainty_score":0.4377431,"prediction_status":"machine_predicted_unvalidated"},"labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad"],"domain":"reporting","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2155086368","doi":"10.1016/j.cca.2005.11.007","title":"Testing experimental data for univariate normality","year":2006,"lang":"en","type":"review","venue":"Clinica Chimica Acta","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":236,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Normality; Statistics; Normality test; Kurtosis; Skewness; Anderson–Darling test; Sample size determination; Percentile; Mathematics; Quantile; Univariate; Goodness of fit; Statistical hypothesis testing; Econometrics; Kolmogorov–Smirnov test; Multivariate statistics","authors":[{"name":"A R Henderson","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8925548796379184,"gpt":0.6694180607045064,"spread":0.223136818933412,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02873636,0.001718623,0.006861386,0.003644445,0.000241797,0.00205184,0.002741491,0.001890167,0.004196148],"category_scores_gemma":[0.08280908,0.0007521792,0.002946216,0.003742873,0.003621093,0.00232533,0.0009758333,0.003125211,0.00126289],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001218088,"about_ca_system_score_gemma":0.003124256,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009470391,"about_ca_topic_score_gemma":0.0009213392,"domain_scores_codex":[0.9750112,0.01504953,0.002441498,0.001415786,0.005894107,0.0001878738],"domain_scores_gemma":[0.8296077,0.1587245,0.004750026,0.003336472,0.003339575,0.000241719],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.000304446,0.00009147205,0.0007770587,0.04059275,0.0013507,0.00009887412,0.000105855,0.001332151,0.000620572,0.01387666,0.006123102,0.9347264],"study_design_scores_gemma":[0.001982495,0.003414007,0.02458983,0.08408069,0.01113042,0.00661466,0.0006122863,0.01536898,0.01228327,0.2907337,0.5486085,0.0005812921],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0007528788,0.9561139,0.04022028,0.0007071981,0.0004876996,0.000138838,0.0001480587,0.0001229547,0.001308214],"genre_scores_gemma":[0.01718457,0.9432713,0.03618823,0.0009512003,0.0009018203,0.0005776407,0.000299783,0.00005492909,0.0005704568],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.02873636,"threshold_uncertainty_score":0.1519742,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2978462138","doi":"10.11919/j.issn.1002-0829.217070","title":"The Differences and Similarities Between Two-Sample <i>T</i>-Test and Paired <i>T</i>-Test.","year":2017,"lang":"en","type":"article","venue":"PubMed","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":230,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University","funders":"","keywords":"Test (biology); Statistics; Student's t-test; Confusion; Mathematics; Sample (material); Medicine; Psychology; Statistical significance; Biology; Physics","authors":[{"name":"Manfei Xu","is_ca":false},{"name":"Drew Fralick","is_ca":false},{"name":"Julia Z Zheng","is_ca":true},{"name":"Bokai Wang","is_ca":false},{"name":"Xin Tu","is_ca":false},{"name":"Changyong Feng","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.590758071255841,"gpt":0.4869642464323993,"spread":0.1037938248234417,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1127689,0.001073528,0.002992763,0.004361185,0.001132469,0.002751071,0.003449207,0.002348211,0.01532527],"category_scores_gemma":[0.456624,0.0007943056,0.003557938,0.004613983,0.00765495,0.005115083,0.002361906,0.004712141,0.002325717],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001567116,"about_ca_system_score_gemma":0.002352575,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009369771,"about_ca_topic_score_gemma":0.001443877,"domain_scores_codex":[0.7642921,0.1791218,0.01369885,0.01814921,0.02292482,0.001813286],"domain_scores_gemma":[0.431187,0.5179085,0.01300383,0.02462258,0.01114727,0.002130793],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.02669679,0.001165187,0.08170856,0.02482255,0.02229443,0.002996105,0.005373829,0.00909408,0.009214802,0.1458943,0.0752903,0.5954491],"study_design_scores_gemma":[0.004884924,0.01237676,0.1990272,0.005464861,0.01454791,0.009847108,0.006165851,0.1106151,0.02265919,0.4783568,0.1349798,0.001074366],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.1028004,0.02252669,0.8206788,0.003550521,0.008824832,0.006214347,0.008585478,0.002820338,0.02399853],"genre_scores_gemma":[0.5602526,0.002852306,0.4120702,0.002419458,0.001803147,0.01162599,0.003310676,0.001269142,0.004396554],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1127689,"threshold_uncertainty_score":0.5963863,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2021382870","doi":"10.1097/mlr.0b013e318215d90d","title":"N-of-1 Trials in the Medical Literature","year":2011,"lang":"en","type":"review","venue":"Medical Care","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":224,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Alberta","funders":"","keywords":"Clinical trial; Medicine; Population; Randomization; Medical physics; Internal medicine","authors":[{"name":"Nicole B. Gabler","is_ca":false},{"name":"Naihua Duan","is_ca":false},{"name":"Sunita Vohra","is_ca":true},{"name":"Richard L. Kravitz","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8591717291981216,"gpt":0.6998938575083188,"spread":0.1592778716898028,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3762608,0.002283637,0.01300431,0.03263134,0.00257527,0.01145342,0.00544628,0.01056286,0.008985993],"category_scores_gemma":[0.7623349,0.003674249,0.008253156,0.02561221,0.009415929,0.01883934,0.007465278,0.00700286,0.001343633],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00764899,"about_ca_system_score_gemma":0.0178147,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00179545,"about_ca_topic_score_gemma":0.002939327,"domain_scores_codex":[0.3274238,0.4577097,0.1535032,0.02108483,0.03876347,0.001515005],"domain_scores_gemma":[0.08370668,0.77415,0.1090966,0.01633694,0.01547438,0.001235472],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"systematic_review","study_design_gemma":"systematic_review","study_design_scores_codex":[0.005229109,0.0002007436,0.01276881,0.7554756,0.03031927,0.0005404928,0.002194465,0.001185312,0.0004268243,0.01690768,0.01818791,0.1565639],"study_design_scores_gemma":[0.004885256,0.001358945,0.01067159,0.8388588,0.03264372,0.001087449,0.001035932,0.001945488,0.0007703076,0.04808925,0.05837052,0.0002826641],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.00887458,0.9332689,0.01783272,0.01799355,0.006643761,0.007452868,0.002340029,0.0002241237,0.005369582],"genre_scores_gemma":[0.2830206,0.4744631,0.1177543,0.05075426,0.01083506,0.05618395,0.004819896,0.00053603,0.001632741],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.6237392,"threshold_uncertainty_score":0.7691815,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2128373232","doi":"10.1093/jnci/djh182","title":"Phase I Trial Design for Solid Tumor Studies of Targeted, Non-Cytotoxic Agents: Theory and Practice","year":2004,"lang":"en","type":"review","venue":"JNCI Journal of the National Cancer Institute","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":221,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"","keywords":"Cytotoxic T cell; Solid tumor; Medicine; Biology; Cancer; Internal medicine; Genetics; In vitro","authors":[{"name":"Wendy R. Parulekar","is_ca":true},{"name":"Elizabeth A. Eisenhauer","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8358492860840319,"gpt":0.7003415538770064,"spread":0.1355077322070255,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3194078,0.001560662,0.005934948,0.003459548,0.0009087533,0.005356214,0.003001863,0.003249183,0.005671809],"category_scores_gemma":[0.4266425,0.001191629,0.004223303,0.004081019,0.003049779,0.00465023,0.001971575,0.0052213,0.002156008],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002590116,"about_ca_system_score_gemma":0.00752894,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0001633254,"about_ca_topic_score_gemma":0.0002768795,"domain_scores_codex":[0.564978,0.3891165,0.02670722,0.007107849,0.01141356,0.0006768671],"domain_scores_gemma":[0.501379,0.392657,0.05443522,0.03022017,0.01873856,0.002569953],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.02837257,0.001225875,0.01695211,0.05582066,0.01427176,0.0003897944,0.00150706,0.01494494,0.002242511,0.06644087,0.03774733,0.7600845],"study_design_scores_gemma":[0.08334972,0.03784472,0.02030832,0.07432694,0.02214349,0.002023669,0.0009918626,0.08533227,0.01092514,0.4042468,0.2577547,0.0007523622],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.01604062,0.08997559,0.736289,0.01197101,0.005131353,0.126092,0.0023518,0.0008593013,0.01128942],"genre_scores_gemma":[0.1334764,0.02247773,0.6310937,0.008687553,0.002847189,0.1975696,0.001842905,0.0003319794,0.001672933],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.3194078,"threshold_uncertainty_score":0.8392913,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2059469444","doi":"10.1016/j.pain.2008.06.025","title":"Analyzing multiple endpoints in clinical trials of pain treatments: IMMPACT recommendations","year":2008,"lang":"en","type":"review","venue":"Pain","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":219,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Dalhousie University; Centre for Global Health Research; University of Toronto","funders":"Allergan; National Institutes of Health; University of Rochester; U.S. Department of Veterans Affairs","keywords":"Clinical trial; Medicine; Type I and type II errors; Clinical endpoint; Intensive care medicine; Gatekeeping; Randomized controlled trial; Medical physics; Statistics; Internal medicine","authors":[{"name":"Dennis C. Turk","is_ca":false},{"name":"Robert H. Dworkin","is_ca":false},{"name":"Michael McDermott","is_ca":false},{"name":"Nicholas Bellamy","is_ca":false},{"name":"Laurie B. Burke","is_ca":false},{"name":"Charles S. Cleeland","is_ca":false},{"name":"Penney Cowan","is_ca":false},{"name":"Rozalina Dimitrova","is_ca":false},{"name":"John T. Farrar","is_ca":false},{"name":"Sharon Hertz","is_ca":false},{"name":"Joseph F. Heyse","is_ca":false},{"name":"Smriti Iyengar","is_ca":false},{"name":"Alejandro R. Jadad","is_ca":true},{"name":"Gary W. Jay","is_ca":false},{"name":"John Jermano","is_ca":false},{"name":"Nathaniel P. Katz","is_ca":false},{"name":"Donald C. Manning","is_ca":false},{"name":"Susan Martin","is_ca":false},{"name":"Mitchell B. Max","is_ca":false},{"name":"Patrick J. McGrath","is_ca":true},{"name":"Henry J McQuay","is_ca":false},{"name":"Steve Quessy","is_ca":false},{"name":"Bob A. Rappaport","is_ca":false},{"name":"Dennis A. Revicki","is_ca":false},{"name":"Margaret Rothman","is_ca":false},{"name":"Joseph Stauffer","is_ca":false},{"name":"Ola Svensson","is_ca":false},{"name":"Richard E. White","is_ca":false},{"name":"James Witter","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8869929090371754,"gpt":0.7068485700059751,"spread":0.1801443390312003,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3055332,0.004195465,0.0129013,0.01327867,0.00154841,0.007103639,0.01108347,0.01566326,0.006864354],"category_scores_gemma":[0.4763118,0.003651817,0.01372537,0.01213545,0.008672258,0.01272927,0.005405067,0.02254909,0.006790916],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006755854,"about_ca_system_score_gemma":0.02134711,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003606525,"about_ca_topic_score_gemma":0.005220811,"domain_scores_codex":[0.7509893,0.1734353,0.03573034,0.004749628,0.03401481,0.001080459],"domain_scores_gemma":[0.3791592,0.5111899,0.02816619,0.01941944,0.05890161,0.003163754],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0006149447,0.0001921745,0.0006458707,0.09751874,0.002907102,0.000218392,0.0006622738,0.001820977,0.0003501968,0.05142893,0.1738673,0.669773],"study_design_scores_gemma":[0.001443235,0.0003740314,0.001739278,0.2802115,0.006686785,0.0005042047,0.0002202518,0.004315373,0.0008994912,0.2023452,0.5010424,0.0002182012],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.000259232,0.697329,0.120042,0.1472196,0.02192432,0.003943451,0.001059008,0.0006396841,0.007583831],"genre_scores_gemma":[0.005753797,0.4810157,0.4118466,0.06725992,0.0143124,0.01456295,0.0009808772,0.0003040819,0.003963739],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.6944668,"threshold_uncertainty_score":0.8564012,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1971159432","doi":"10.1016/s1470-2045(14)70375-4","title":"Outcomes and endpoints in trials of cancer treatment: the past, present, and future","year":2014,"lang":"en","type":"review","venue":"The Lancet Oncology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":218,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre","funders":"","keywords":"Surrogate endpoint; Clinical endpoint; Clinical trial; Intensive care medicine; Quality of life (healthcare); Medicine; Endpoint Determination; Overall survival; Cancer; Disease; Oncology; Internal medicine; Nursing","authors":[{"name":"Michelle Wilson","is_ca":true},{"name":"Katherine Karakasis","is_ca":true},{"name":"Amit M. Oza","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7857781232112138,"gpt":0.682581246318719,"spread":0.1031968768924948,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0568311,0.001363901,0.009130762,0.003262774,0.0003129964,0.003718439,0.002906722,0.00316709,0.00262355],"category_scores_gemma":[0.09888586,0.0007707444,0.003048864,0.005472087,0.003869863,0.004147683,0.001932265,0.006372045,0.0005750308],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002265492,"about_ca_system_score_gemma":0.007084789,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001805212,"about_ca_topic_score_gemma":0.003208233,"domain_scores_codex":[0.9612128,0.03103015,0.002731938,0.0009997876,0.003739061,0.0002862293],"domain_scores_gemma":[0.8078995,0.1797229,0.007018483,0.001954184,0.002781889,0.0006229132],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0006876352,0.00005542431,0.0006322184,0.1002965,0.003002917,0.0000334439,0.0001649037,0.001584125,0.0001228294,0.02906918,0.01006746,0.8542833],"study_design_scores_gemma":[0.003136754,0.001222958,0.005215854,0.2056083,0.01088987,0.000965228,0.0005859591,0.005320551,0.000731716,0.3865942,0.3794491,0.0002794725],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.00007789589,0.9966108,0.001100875,0.00181644,0.000202121,0.0000148734,0.00002063926,0.000008172319,0.000148181],"genre_scores_gemma":[0.004952701,0.9888466,0.003311264,0.001677165,0.0009672673,0.0001061857,0.00003588017,0.00001299421,0.00008990344],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.9431689,"threshold_uncertainty_score":0.3005552,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2148973996","doi":"","title":"A New Nonparametric Levene Test for Equal Variances","year":2010,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":214,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia; University of Calgary","funders":"","keywords":"Nonparametric statistics; Levene's test; Statistics; F-test of equality of variances; Mathematics; Type I and type II errors; Population; Sampling (signal processing); Goldfeld–Quandt test; Econometrics; Test (biology); Statistical hypothesis testing; Computer science; Z-test; Test statistic; Demography","authors":[{"name":"David Nordstokke","is_ca":true},{"name":"Bruno D. Zumbo","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8284200588886782,"gpt":0.7350414308632734,"spread":0.09337862802540475,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02661472,0.001272091,0.00223113,0.004545965,0.001578605,0.004356641,0.003698171,0.002348703,0.02138771],"category_scores_gemma":[0.1389403,0.0005050653,0.002502594,0.003764659,0.002813971,0.004160934,0.003765514,0.004684167,0.004326156],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002051325,"about_ca_system_score_gemma":0.005221795,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001878215,"about_ca_topic_score_gemma":0.001597513,"domain_scores_codex":[0.9607152,0.01844172,0.002426086,0.004214814,0.01335651,0.0008456325],"domain_scores_gemma":[0.9126078,0.06424124,0.007186681,0.006512019,0.008485487,0.0009667324],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00143334,0.0004956775,0.04121588,0.002397212,0.001821797,0.001065374,0.001610523,0.01333336,0.005734629,0.1633571,0.1044744,0.6630607],"study_design_scores_gemma":[0.0009725962,0.003988717,0.07996015,0.002879279,0.001636031,0.007451065,0.002146435,0.115494,0.01618445,0.2954155,0.4727774,0.001094292],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01914954,0.003166741,0.9328703,0.002139163,0.001502813,0.001437101,0.005078347,0.002184534,0.03247134],"genre_scores_gemma":[0.2897415,0.002834518,0.6636286,0.003864327,0.00177786,0.009051697,0.007889987,0.001485827,0.0197257],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02661472,"threshold_uncertainty_score":0.1407538,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2897801176","doi":"10.1111/2041-210x.13159","title":"I can see clearly now: Reinterpreting statistical significance","year":2019,"lang":"en","type":"article","venue":"Methods in Ecology and Evolution","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":211,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"","keywords":"CLARITY; Null hypothesis; Statistical hypothesis testing; Meaning (existential); Alternative hypothesis; Psychology; Context (archaeology); Cognitive psychology; Computer science; Econometrics; Statistics; Mathematics; Geography; Biology","authors":[{"name":"Jonathan Dushoff","is_ca":true},{"name":"Morgan P. Kain","is_ca":true},{"name":"Benjamin M. Bolker","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2100571163939553,"gpt":0.537255500117731,"spread":0.3271983837237757,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1900026,0.001932747,0.002726668,0.005547968,0.003450538,0.01489932,0.005354868,0.006667223,0.004234572],"category_scores_gemma":[0.4867391,0.001292675,0.002291849,0.003944416,0.0695689,0.01815699,0.01059579,0.02776078,0.002288903],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004467659,"about_ca_system_score_gemma":0.005212245,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001552425,"about_ca_topic_score_gemma":0.000981234,"domain_scores_codex":[0.6896831,0.2703494,0.012746,0.006724721,0.01898595,0.001510812],"domain_scores_gemma":[0.4091038,0.512822,0.02551362,0.02448873,0.0246915,0.003380365],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000251105,0.0000260442,0.001017368,0.001104305,0.0001715594,0.000524783,0.01561701,0.0009248483,0.0008140532,0.8999739,0.04573451,0.03384061],"study_design_scores_gemma":[0.00006071936,0.0001346436,0.0006178299,0.001550423,0.00009825,0.0006868919,0.003052825,0.003060267,0.001052856,0.8812923,0.1082727,0.0001203368],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007776561,0.02193676,0.5195422,0.3955086,0.03886946,0.0001649174,0.000331014,0.0008576621,0.01501274],"genre_scores_gemma":[0.4247344,0.01071719,0.3372243,0.1921482,0.0279813,0.001028029,0.0002049435,0.001614601,0.004346951],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8099974,"threshold_uncertainty_score":0.998871,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3041396397","doi":"10.1177/0962280220932962","title":"Mixed-effects models for the design and analysis of stepped wedge cluster randomized trials: An overview","year":2020,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":206,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Ottawa Hospital","funders":"National Center for Advancing Translational Sciences; National Institute on Drug Abuse; National Institute for Health and Care Research","keywords":"Computer science; Confounding; Research design; Cluster (spacecraft); Clinical study design; Econometrics; Management science; Risk analysis (engineering); Data science; Operations research; Medicine; Statistics; Mathematics; Clinical trial; Engineering","authors":[{"name":"Fan Li","is_ca":false},{"name":"James P. Hughes","is_ca":false},{"name":"Karla Hemming","is_ca":false},{"name":"Monica Taljaard","is_ca":true},{"name":"Edward R. Melnick","is_ca":false},{"name":"Patrick J. Heagerty","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9463831388066777,"gpt":0.7778418496968618,"spread":0.1685412891098159,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05462806,0.003972836,0.006929339,0.005096239,0.0006784623,0.004092706,0.00624415,0.004984868,0.009014885],"category_scores_gemma":[0.1008005,0.001837862,0.006918975,0.007522865,0.002773385,0.00389157,0.002423757,0.008338206,0.003471858],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004381355,"about_ca_system_score_gemma":0.006819952,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002436043,"about_ca_topic_score_gemma":0.002262274,"domain_scores_codex":[0.931828,0.05707315,0.003616521,0.002133995,0.004990665,0.0003577024],"domain_scores_gemma":[0.8883979,0.1017459,0.004372314,0.002424706,0.002745556,0.0003135776],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0003047025,0.0001394452,0.0006106828,0.03118859,0.002654319,0.0002083228,0.0005033607,0.02688253,0.0003493131,0.641744,0.02177775,0.273637],"study_design_scores_gemma":[0.0004547259,0.0004435724,0.000485448,0.01363698,0.001833609,0.0004432072,0.0001279701,0.05088254,0.0006888653,0.7855474,0.1452447,0.0002110683],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"review","genre_scores_codex":[0.0002661482,0.2107099,0.7805289,0.002267552,0.001002261,0.001180346,0.0005787741,0.0003636693,0.00310253],"genre_scores_gemma":[0.01611673,0.1908745,0.7757669,0.002443821,0.001564449,0.01072124,0.0007834533,0.0002858325,0.001443106],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.9453719,"threshold_uncertainty_score":0.2889042,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3137427440","doi":"10.1001/jamaoncol.2021.0379","title":"Evolution of the Randomized Clinical Trial in the Era of Precision Oncology","year":2021,"lang":"en","type":"article","venue":"JAMA Oncology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":202,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University; NOSM University; Kingston Health Sciences Centre; Thunder Bay Regional Health Sciences Centre","funders":"","keywords":"Medicine; Randomized controlled trial; Internal medicine; Surrogate endpoint; Breast cancer; Oncology; Clinical endpoint; Colorectal cancer; Cohort; Lung cancer; Cancer","authors":[{"name":"Joseph C. Del Paggio","is_ca":true},{"name":"John Berry","is_ca":true},{"name":"Wilma M. Hopman","is_ca":true},{"name":"Elizabeth A. Eisenhauer","is_ca":true},{"name":"Vinay Prasad","is_ca":false},{"name":"Bishal Gyawali","is_ca":true},{"name":"Christopher M. Booth","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5062045424251019,"gpt":0.6209226704404257,"spread":0.1147181280153238,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7043592,0.001598844,0.009549882,0.01109464,0.001949209,0.02014906,0.006473544,0.01427278,0.003841168],"category_scores_gemma":[0.8001654,0.00229432,0.005072177,0.01624016,0.03496675,0.02984585,0.008311215,0.02159214,0.0009859994],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01837224,"about_ca_system_score_gemma":0.02920063,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002899943,"about_ca_topic_score_gemma":0.002066212,"domain_scores_codex":[0.2096371,0.6765438,0.05084325,0.01912658,0.04252733,0.001321853],"domain_scores_gemma":[0.06764428,0.8466977,0.0288158,0.0307783,0.02408088,0.001983181],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.005905099,0.0003756392,0.02191906,0.04133962,0.0078139,0.000319898,0.005140611,0.005962398,0.000898763,0.4411921,0.02879954,0.4403334],"study_design_scores_gemma":[0.00601271,0.004220798,0.01281998,0.106264,0.004149165,0.001209297,0.002436639,0.01804307,0.001640838,0.6337883,0.2086543,0.0007609248],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.01012991,0.3944216,0.218418,0.344237,0.02098408,0.002676802,0.000866921,0.0004516947,0.007813977],"genre_scores_gemma":[0.2317989,0.1133502,0.4321446,0.1747463,0.03617417,0.008715068,0.0006364498,0.0007881443,0.001646219],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.2956408,"threshold_uncertainty_score":0.3645778,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2116831767","doi":"10.1158/1078-0432.ccr-09-1961","title":"Approaches to Phase 1 Clinical Trial Design Focused on Safety, Efficiency, and Selected Patient Populations: A Report from the Clinical Trial Design Task Force of the National Cancer Institute Investigational Drug Steering Committee","year":2010,"lang":"en","type":"article","venue":"Clinical Cancer Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":199,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Princess Margaret Cancer Centre","funders":"National Institutes of Health","keywords":"Clinical trial; Medicine; Clinical study design; Population; Drug development; Investigational Drugs; Phases of clinical research; Patient safety; Intensive care medicine; Medical physics; Drug; Oncology; Pharmacology; Internal medicine; Health care","authors":[{"name":"S. Percy Ivy","is_ca":true},{"name":"Lillian L. Siu","is_ca":true},{"name":"Elizabeth Garrett‐Mayer","is_ca":true},{"name":"Larry Rubinstein","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9461285919310349,"gpt":0.6823623987532028,"spread":0.2637661931778321,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3633127,0.002543186,0.002616449,0.003347826,0.002193728,0.01034797,0.005456337,0.007287952,0.001589409],"category_scores_gemma":[0.2071073,0.002176599,0.003501884,0.004504286,0.00471255,0.004277928,0.003495213,0.02013117,0.001439036],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.009679984,"about_ca_system_score_gemma":0.04165762,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007155186,"about_ca_topic_score_gemma":0.01477945,"domain_scores_codex":[0.7618151,0.1560448,0.02268634,0.005668562,0.0500359,0.003749288],"domain_scores_gemma":[0.7171371,0.1481759,0.02862592,0.01141606,0.08647066,0.008174328],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001250675,0.001029553,0.004750947,0.004824711,0.0005314246,0.0002919871,0.001568015,0.006596709,0.004795644,0.03333565,0.1888377,0.752187],"study_design_scores_gemma":[0.00269586,0.003232361,0.01109963,0.01161886,0.0009183137,0.0008975929,0.0004940599,0.006304085,0.00774995,0.02203986,0.9325008,0.0004487383],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01096874,0.2412601,0.3961247,0.2420173,0.01347548,0.04600129,0.001699283,0.001571731,0.04688139],"genre_scores_gemma":[0.04701016,0.2162161,0.5451788,0.1244683,0.01110807,0.03791676,0.002508144,0.0009825451,0.01461121],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.3633127,"threshold_uncertainty_score":0.7851488,"prediction_status":"machine_predicted_unvalidated"},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W2126022166","doi":"10.1002/cjs.5550340410","title":"Classification with reject option","year":2006,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":194,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":true,"about_ca":false},"ca_institutions":"","funders":"","keywords":"Class (philosophy); Binary number; Mathematical economics; Mathematics; Computer science; Econometrics; Actuarial science; Artificial intelligence; Economics; Arithmetic","authors":[{"name":"Radu Herbei","is_ca":false},{"name":"Marten Wegkamp","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.4361016309661956,"gpt":0.4725475954723197,"spread":0.03644596450612408,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02964007,0.001515166,0.004403559,0.001710765,0.001508021,0.005065647,0.003586432,0.005629534,0.01833601],"category_scores_gemma":[0.1204968,0.000554486,0.001756877,0.001893141,0.003343052,0.004227517,0.002442779,0.006943055,0.003133994],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001834806,"about_ca_system_score_gemma":0.001210894,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008960211,"about_ca_topic_score_gemma":0.0006032668,"domain_scores_codex":[0.976543,0.01489155,0.001093864,0.002523888,0.003512393,0.001435317],"domain_scores_gemma":[0.7480475,0.2175999,0.009757439,0.01549627,0.006306861,0.00279206],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.006010106,0.001525479,0.02828499,0.001190091,0.0007028017,0.001174153,0.0007144461,0.1195851,0.001224217,0.4503573,0.06371579,0.3255155],"study_design_scores_gemma":[0.0007061437,0.0006061878,0.003313313,0.0002802972,0.0001795,0.0005078964,0.0001765625,0.5066394,0.001560863,0.4767362,0.009209284,0.00008440024],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.222841,0.00286556,0.7188227,0.01580605,0.001866929,0.0007291643,0.002470027,0.00142492,0.03317371],"genre_scores_gemma":[0.904301,0.0004514696,0.07178223,0.001896443,0.001090209,0.0005328739,0.001727833,0.0002308995,0.01798705],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02964007,"threshold_uncertainty_score":0.1567536,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4235450985","doi":"10.1002/cncy.20147","title":"Biospecimen reporting for improved study quality (BRISQ)","year":2011,"lang":"en","type":"article","venue":"Cancer Cytopathology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":191,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"BC Cancer Agency","funders":"National Cancer Institute; U.S. Public Health Service; National Institutes of Health","keywords":"Medicine; Quality (philosophy); Consistency (knowledge bases); Data science; Medical physics; Computer science","authors":[{"name":"Helen M. Moore","is_ca":false},{"name":"Andréa B. Kelly","is_ca":false},{"name":"Scott D. Jewell","is_ca":false},{"name":"Lisa M. McShane","is_ca":false},{"name":"Douglas P. Clark","is_ca":false},{"name":"Renata Greenspan","is_ca":false},{"name":"Daniel F. Hayes","is_ca":false},{"name":"Pierre Hainaut","is_ca":false},{"name":"Paula Kim","is_ca":false},{"name":"Elizabeth Mansfield","is_ca":false},{"name":"Olga Potapova","is_ca":false},{"name":"Peter Riegman","is_ca":false},{"name":"Yaffa Rubinstein","is_ca":false},{"name":"Edward Seijo","is_ca":false},{"name":"Stella Somiari","is_ca":false},{"name":"Peter H. Watson","is_ca":true},{"name":"Heinz‐Ulrich Weier","is_ca":false},{"name":"Claire S. Zhu","is_ca":false},{"name":"Jim Vaught","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9032678520110035,"gpt":0.6778586125422745,"spread":0.2254092394687289,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6196091,0.004048702,0.007782358,0.02506401,0.005098998,0.02214675,0.01280486,0.01766064,0.03408006],"category_scores_gemma":[0.784392,0.006634177,0.006197743,0.03034462,0.009906763,0.01283762,0.01294518,0.02192022,0.0472292],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01042107,"about_ca_system_score_gemma":0.0549543,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00610857,"about_ca_topic_score_gemma":0.004514387,"domain_scores_codex":[0.2603177,0.3859657,0.2465732,0.0108635,0.08829661,0.007983323],"domain_scores_gemma":[0.06720942,0.2389446,0.1390735,0.1838678,0.3643723,0.006532323],"domain_codex":"methods","domain_gemma":"reporting","domain_candidate":"reporting","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.002109861,0.0004625406,0.005670192,0.01272085,0.0005555832,0.0005339184,0.003042694,0.001504677,0.00479588,0.02411391,0.7567553,0.1877346],"study_design_scores_gemma":[0.001349546,0.0008147979,0.01807167,0.0116163,0.0004155271,0.0009852264,0.001079323,0.00704258,0.008572352,0.01946329,0.9300002,0.0005890098],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.006638159,0.006181729,0.6284547,0.08820218,0.0482151,0.1098626,0.03709013,0.01837567,0.0569797],"genre_scores_gemma":[0.02814052,0.003970484,0.7973878,0.03315311,0.009782384,0.07912634,0.02174898,0.006180903,0.0205095],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.3803909,"threshold_uncertainty_score":0.4690897,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2105400786","doi":"10.1158/1078-0432.ccr-09-1357","title":"The Cross-Validated Adaptive Signature Design","year":2010,"lang":"en","type":"article","venue":"Clinical Cancer Research","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":190,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Queen's University","funders":"","keywords":"Classifier (UML); Adaptive design; Computer science; Signature (topology); Clinical trial; Cross-validation; Data mining; Medicine; Artificial intelligence; Machine learning; Mathematics; Pathology","authors":[{"name":"Boris Freidlin","is_ca":true},{"name":"Wenyu Jiang","is_ca":true},{"name":"Richard Simon","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9293997658481492,"gpt":0.77552257358576,"spread":0.1538771922623892,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04221978,0.001674202,0.001805543,0.001023542,0.0005306671,0.001095551,0.002618027,0.001947634,0.003723001],"category_scores_gemma":[0.05423239,0.0007700499,0.001828106,0.0007127764,0.002525831,0.001361406,0.002028939,0.002208229,0.0006402679],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.000971571,"about_ca_system_score_gemma":0.002020516,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0005321141,"about_ca_topic_score_gemma":0.0003521039,"domain_scores_codex":[0.9699589,0.02468626,0.0008501245,0.002208736,0.001846604,0.0004494131],"domain_scores_gemma":[0.946595,0.03682836,0.00339784,0.006461304,0.005970668,0.0007469541],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.004636618,0.0006760247,0.009860823,0.0004087546,0.0008170244,0.0002297131,0.0001848818,0.6919904,0.007815803,0.06671737,0.001734095,0.2149285],"study_design_scores_gemma":[0.0006462603,0.002036654,0.001315699,0.0000401138,0.0001519329,0.0001099979,0.00001199698,0.9690472,0.00377476,0.02151787,0.001302792,0.00004462046],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02694632,0.0001383632,0.9714348,0.0001708148,0.00006390613,0.000469242,0.00006799173,0.000190016,0.0005184615],"genre_scores_gemma":[0.6070409,0.0001627739,0.3873692,0.0004833752,0.0001049088,0.002345163,0.000439724,0.00006783612,0.00198608],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.04221978,"threshold_uncertainty_score":0.2232822,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2138878140","doi":"10.1002/sim.2069","title":"The value of information and optimal clinical trial design","year":2005,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":186,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto; Population Health Research Institute; SickKids Foundation; Hospital for Sick Children","funders":"Natural Sciences and Engineering Research Council of Canada; Sick Kids Foundation","keywords":"Type I and type II errors; Sample size determination; Null hypothesis; Value (mathematics); Sample (material); Set (abstract data type); Value of information; Computer science; Perspective (graphical); Statistics; Clinical trial; Medicine; Mathematics; Artificial intelligence; Internal medicine","authors":[{"name":"Andrew R. Willan","is_ca":true},{"name":"Eleanor M. Pinto","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5587308049738138,"gpt":0.6187845387614808,"spread":0.06005373378766699,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2538993,0.00278958,0.0084427,0.005413027,0.001588863,0.009079531,0.004238263,0.01007982,0.004927876],"category_scores_gemma":[0.4715581,0.002269035,0.002745816,0.00419071,0.01411737,0.01009675,0.005995966,0.009394662,0.001605662],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007548877,"about_ca_system_score_gemma":0.01306581,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0008697406,"about_ca_topic_score_gemma":0.0006673049,"domain_scores_codex":[0.4880716,0.4784879,0.01011296,0.006774519,0.01470176,0.00185132],"domain_scores_gemma":[0.5101001,0.457734,0.01219265,0.01107191,0.00668196,0.002219413],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.002815019,0.0002114406,0.001479882,0.002676286,0.001011283,0.0002760562,0.0005277171,0.04480235,0.0002463675,0.795221,0.007363433,0.1433693],"study_design_scores_gemma":[0.001237931,0.0005935722,0.0003101188,0.001060911,0.0002873836,0.0001344085,0.00006181325,0.02628577,0.0002805321,0.9629857,0.006681844,0.00007989151],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.004441577,0.01474317,0.9270771,0.03322632,0.001123221,0.003228072,0.0003702887,0.0002288017,0.01556136],"genre_scores_gemma":[0.2215912,0.01192722,0.7372145,0.009704753,0.002272189,0.01485978,0.0002437704,0.0001472111,0.002039407],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7461007,"threshold_uncertainty_score":0.920075,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2791409969","doi":"10.1136/bmj.k698","title":"Key design considerations for adaptive clinical trials: a primer for clinicians","year":2018,"lang":"en","type":"article","venue":"BMJ","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":184,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; Impact","funders":"Bill and Melinda Gates Foundation","keywords":"Clinical trial; Adaptive design; Computer science; Resource (disambiguation); Key (lock); Psychological intervention; Clinical study design; Research design; Risk analysis (engineering); Drug trial; Medical physics; Medicine; Management science; Intensive care medicine; Engineering; Psychiatry; Pathology; Computer security","authors":[{"name":"Kristian Thorlund","is_ca":true},{"name":"Jonas Häggström","is_ca":false},{"name":"Jay Park","is_ca":true},{"name":"Edward J. Mills","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9552590505586375,"gpt":0.7305588347048191,"spread":0.2247002158538184,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2912608,0.003656127,0.005470556,0.005746379,0.003059399,0.01523888,0.009797356,0.02349686,0.005857708],"category_scores_gemma":[0.4570105,0.00332248,0.003826829,0.00481631,0.03236227,0.02581771,0.008370932,0.05224796,0.004466246],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00872157,"about_ca_system_score_gemma":0.01748732,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001478533,"about_ca_topic_score_gemma":0.001641115,"domain_scores_codex":[0.6861898,0.2668246,0.02100812,0.004888721,0.01969225,0.001396602],"domain_scores_gemma":[0.4273971,0.5274654,0.01346616,0.009582599,0.0175777,0.00451102],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","study_design_scores_codex":[0.0005600473,0.0003239879,0.001129869,0.01237968,0.0003660639,0.0009675969,0.007241868,0.005048308,0.0006340217,0.5470588,0.1264087,0.2978811],"study_design_scores_gemma":[0.0003809795,0.0004774819,0.0002932567,0.01642458,0.0001251759,0.001368496,0.001649243,0.002736844,0.0003293285,0.5919183,0.3841195,0.0001767563],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"methods","genre_scores_codex":[0.0005104601,0.1527151,0.3176871,0.5075511,0.01080414,0.001813152,0.0001315905,0.0004079815,0.008379413],"genre_scores_gemma":[0.01734179,0.1180285,0.6098425,0.2157829,0.02157186,0.01338272,0.0001196342,0.0006253195,0.003304771],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.2912608,"threshold_uncertainty_score":0.8740016,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2109054675","doi":"10.1177/1740774507087551","title":"Sensible approaches for reducing clinical trial costs","year":2008,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":181,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Population Health Research Institute","funders":"","keywords":"Clinical trial; Medicine; Randomized controlled trial; Payment; Duration (music); Cost–benefit analysis; Operations management; Operations research; Business; Surgery; Engineering; Finance; Internal medicine","authors":[{"name":"Eric L. Eisenstein","is_ca":false},{"name":"Rory Collins","is_ca":false},{"name":"Beena S Cracknell","is_ca":true},{"name":"Oscar Podesta","is_ca":false},{"name":"Elizabeth Reid","is_ca":false},{"name":"Peter Sandercock","is_ca":false},{"name":"Yuriy Shakhov","is_ca":false},{"name":"Michael L. Terrin","is_ca":false},{"name":"Mary Ann Sellers","is_ca":false},{"name":"Robert M. Califf","is_ca":false},{"name":"Christopher B. Granger","is_ca":false},{"name":"Rafael Díaz","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9772817153848696,"gpt":0.7307094998449754,"spread":0.2465722155398943,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1683198,0.002459813,0.002338024,0.006114505,0.001473907,0.009528978,0.0060365,0.006096178,0.01428739],"category_scores_gemma":[0.4220425,0.002232024,0.002962496,0.004518259,0.004775293,0.008580409,0.006325956,0.008659629,0.003310473],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007600167,"about_ca_system_score_gemma":0.0180291,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001572778,"about_ca_topic_score_gemma":0.001790215,"domain_scores_codex":[0.758072,0.2030222,0.009955908,0.005786319,0.02070289,0.00246081],"domain_scores_gemma":[0.5982597,0.3239374,0.01912539,0.03271465,0.02228499,0.00367783],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.001180603,0.0008493579,0.002976695,0.003212227,0.001067423,0.000219041,0.001312907,0.06954669,0.001561374,0.4528287,0.02289898,0.442346],"study_design_scores_gemma":[0.002824402,0.001349357,0.003560564,0.003984121,0.0008130694,0.0003716482,0.0008015846,0.1008438,0.001830595,0.8125173,0.07091353,0.0001899339],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.008651144,0.007180687,0.8835191,0.05324959,0.0008532532,0.006741075,0.0003388199,0.000685569,0.03878087],"genre_scores_gemma":[0.1991345,0.003816103,0.7644281,0.01269949,0.0014191,0.01434337,0.0002587102,0.0002685218,0.003632061],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.8316802,"threshold_uncertainty_score":0.8901709,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W1981114551","doi":"10.1016/j.jclinepi.2008.07.006","title":"Bayesian statistical inference enhances the interpretation of contemporary randomized controlled trials","year":2008,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":178,"is_retracted":false,"has_abstract":false,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"St. Michael's Hospital; Health Sciences Centre; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences; Toronto General Hospital; University of Toronto","funders":"","keywords":"Randomized controlled trial; Interpretation (philosophy); Statistical inference; Inference; Bayesian probability; Bayesian inference; Bayesian statistics; Computer science; Statistics; Econometrics; Artificial intelligence; Medicine; Machine learning; Mathematics; Internal medicine","authors":[{"name":"Duminda N. Wijeysundera","is_ca":true},{"name":"Peter C. Austin","is_ca":true},{"name":"Janet E. Hux","is_ca":true},{"name":"W. Scott Beattie","is_ca":true},{"name":"Andreas Laupacis","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7954584011993118,"gpt":0.678490372859101,"spread":0.1169680283402108,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2163911,0.002668643,0.006265338,0.004938639,0.001412112,0.007220171,0.003678373,0.006319321,0.005863671],"category_scores_gemma":[0.6939294,0.002780805,0.00372054,0.003600639,0.006517748,0.008278226,0.005713127,0.01127366,0.0009602976],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002645826,"about_ca_system_score_gemma":0.007277077,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002158929,"about_ca_topic_score_gemma":0.001929956,"domain_scores_codex":[0.7266642,0.250184,0.006896018,0.007132564,0.008324795,0.0007983854],"domain_scores_gemma":[0.176513,0.7955302,0.0100385,0.01267185,0.00439674,0.0008496277],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00255819,0.0003368489,0.008247913,0.004858196,0.004853953,0.0006631548,0.002023211,0.1359536,0.00105059,0.4924594,0.01379175,0.3332033],"study_design_scores_gemma":[0.0006349632,0.0002420103,0.0009730635,0.0007028472,0.0008776002,0.0001854728,0.00006210675,0.150454,0.0003841249,0.8398286,0.005586294,0.00006892223],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004014732,0.005564715,0.9788973,0.008400173,0.0004678754,0.0002029593,0.0001566766,0.0003709307,0.001924583],"genre_scores_gemma":[0.2893751,0.008187582,0.6887788,0.006714847,0.003476236,0.001101578,0.000367084,0.0006253564,0.001373409],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7836089,"threshold_uncertainty_score":0.9663293,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2400385987","doi":"10.1002/sim.6986","title":"Quantifying the impact of different approaches for handling continuous predictors on the performance of a prognostic model","year":2016,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":177,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; Population Health Research Institute","funders":"Medical Research Council; National Institute for Health and Care Research; Cancer Research UK","keywords":"Computer science; Outcome (game theory); Ignorance; Calibration; Statistics; Econometrics; Machine learning; Mathematics","authors":[{"name":"Gary S. Collins","is_ca":false},{"name":"Emmanuel Ogundimu","is_ca":false},{"name":"Jonathan Cook","is_ca":false},{"name":"Yannick Le Manach","is_ca":true},{"name":"Douglas G. Altman","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6090490742207253,"gpt":0.5329850486829449,"spread":0.07606402553778036,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1710393,0.002825563,0.003210726,0.003971879,0.001252538,0.005826093,0.002374124,0.003255126,0.001776205],"category_scores_gemma":[0.3729456,0.000867778,0.004497413,0.004331924,0.004047245,0.005243704,0.004891267,0.007014605,0.0006662454],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001883448,"about_ca_system_score_gemma":0.002890497,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002745558,"about_ca_topic_score_gemma":0.00274145,"domain_scores_codex":[0.8925464,0.0866133,0.006134266,0.0051504,0.008396836,0.001158817],"domain_scores_gemma":[0.4730465,0.4878442,0.01104025,0.02044895,0.006271353,0.001348739],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.005366056,0.0005530912,0.1864207,0.00246386,0.009841758,0.0005390573,0.001757809,0.4737023,0.003253051,0.02829788,0.003941333,0.2838632],"study_design_scores_gemma":[0.0006781768,0.004829661,0.06508611,0.002078689,0.003133206,0.00122357,0.001187027,0.7559267,0.007873443,0.1505599,0.00673961,0.0006840514],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.2596059,0.0139263,0.7102767,0.006599986,0.000547694,0.00109318,0.001737014,0.0007261062,0.005487072],"genre_scores_gemma":[0.7334692,0.003137388,0.2587851,0.000932119,0.0002419616,0.0009148062,0.001612097,0.000270162,0.0006371347],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1710393,"threshold_uncertainty_score":0.9045531,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}