{"meta":{"query_hash":"805c37b54ad1","filters":{"venue":"Biostatistics & Epidemiology"},"cohort_total":7,"direct_labels_cover":0,"predictions_cover":7,"exported":7,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/805c37b54ad1","api":"https://metacan.xera.ac/api/v1/cohort?venue=Biostatistics+%26+Epidemiology"},"results":[{"id":"W2760713401","doi":"10.1080/24709360.2017.1359356","title":"Analysis of progressive multi-state models with misclassified states: likelihood and pairwise likelihood methods","year":2017,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Pairwise comparison; Inference; Computer science; Maximum likelihood; State (computer science); Data mining; Artificial intelligence; Machine learning; Econometrics; Statistics; Mathematics; Algorithm","score_opus":0.19242330087441353,"score_gpt":0.4705267785926885,"score_spread":0.2781034777182749,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2760713401","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043794396,0.0003754471,0.99199754,0.0003772187,0.00010208471,0.00047396435,0.0019683149,0.000058172704,0.00026781127],"genre_scores_gemma":[0.043201692,0.00028488817,0.9560614,0.0001850938,0.000026271011,0.000070221635,0.0000691447,0.0000471209,0.000054157816],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99486285,0.0019628613,0.0013133511,0.0008198744,0.00019906745,0.00084200327],"domain_scores_gemma":[0.9806904,0.015368178,0.0018363618,0.0012030402,0.00049776654,0.00040421094],"candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.0040459405,0.0004625613,0.0021248255,0.00029236096,0.0003347827,0.00005753616,0.00050527725,0.0002398029,0.0000656749],"category_scores_gemma":[0.020461101,0.0003359345,0.0001567815,0.00025117307,0.001401649,0.00012853577,0.0002484526,0.0003465169,0.0000024885487],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040280417,0.00049658946,0.05181101,0.000529419,0.0028946728,0.000118957774,0.001473755,0.000057418456,0.00019684473,0.6661965,0.00078067847,0.27504134],"study_design_scores_gemma":[0.0007430559,0.00032367086,0.03336865,0.000095467694,0.0016780904,0.000008926371,0.00013117991,0.28489366,0.00014209247,0.67823523,0.000042703654,0.00033727166],"about_ca_topic_score_codex":0.00030719032,"about_ca_topic_score_gemma":0.0002443939,"teacher_disagreement_score":0.28483623,"about_ca_system_score_codex":0.000041722193,"about_ca_system_score_gemma":0.0001375455,"threshold_uncertainty_score":0.9999093},"labels":[],"label_agreement":null},{"id":"W2971936035","doi":"10.1080/24709360.2019.1660110","title":"A frequentist mixture modeling of stop signal reaction times","year":2019,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Blind Source Separation Techniques","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"","keywords":"Frequentist inference; SIGNAL (programming language); Computer science; Econometrics; Statistics; Algorithm; Mathematics; Bayesian probability; Bayesian inference","score_opus":0.035524784508415765,"score_gpt":0.3131540366445244,"score_spread":0.2776292521361086,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2971936035","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0071822796,0.00017089484,0.9891166,0.0010032795,0.00024311915,0.00018809226,0.000028851933,0.0001540135,0.0019128872],"genre_scores_gemma":[0.6216811,0.000037066184,0.37732202,0.0007216262,0.000025345214,0.0000059784456,0.000030129113,0.000007647082,0.00016909663],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99823505,0.00048662542,0.0005563802,0.00036378985,0.00011635832,0.00024182291],"domain_scores_gemma":[0.9979467,0.0010366226,0.00032805407,0.0004597855,0.0001679533,0.000060889644],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001311154,0.00013388194,0.00038330382,0.00013443544,0.00003824015,0.000012279683,0.0004088212,0.00017787736,0.000044632856],"category_scores_gemma":[0.00054658117,0.00012585106,0.00006323393,0.00016476861,0.00005875168,0.0002169527,0.000106096166,0.00020634431,0.00007833083],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00000994593,0.000034381046,0.0012156902,0.000024638604,0.000020103074,0.000002646881,0.00024316354,0.0017513019,0.008808347,0.98058474,0.0034735294,0.0038315225],"study_design_scores_gemma":[0.00016620243,0.00019174152,0.0008951912,0.000025867217,0.000009435832,0.000020375292,0.000017855216,0.7997234,0.0012617875,0.1950896,0.0024259035,0.0001726404],"about_ca_topic_score_codex":0.00016147303,"about_ca_topic_score_gemma":0.000007805797,"teacher_disagreement_score":0.7979721,"about_ca_system_score_codex":0.00003633659,"about_ca_system_score_gemma":0.00008280139,"threshold_uncertainty_score":0.5132057},"labels":[],"label_agreement":null},{"id":"W2997098473","doi":"10.1080/24709360.2019.1699341","title":"Cohort study design for illness-death processes with disease status under intermittent observation","year":2019,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of Toronto","funders":"","keywords":"Censoring (clinical trials); Cohort; Medicine; Cohort study; Sample size determination; Prospective cohort study; Disease; Incidence (geometry); Confidence interval; Event (particle physics); Demography; Statistics; Internal medicine; Mathematics; Pathology","score_opus":0.25519801630112465,"score_gpt":0.4321040283620619,"score_spread":0.17690601206093726,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2997098473","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12440864,0.00007960471,0.8714901,0.00020630186,0.00022934703,0.0030218572,0.00042554448,0.000075251424,0.0000633097],"genre_scores_gemma":[0.40350777,0.000048027523,0.5951195,0.0004790417,0.000049053564,0.00047374098,0.00008055166,0.000042377145,0.00019997585],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99681836,0.00089533825,0.00079708855,0.00066328904,0.00019276753,0.0006331618],"domain_scores_gemma":[0.96311074,0.0351599,0.00042956983,0.0004932122,0.00054194557,0.00026462792],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0020602958,0.00032384088,0.0008424356,0.000073457726,0.00012009106,0.000023205115,0.00020944727,0.00009828244,0.00011228842],"category_scores_gemma":[0.04275905,0.00023250918,0.000044080865,0.00016626102,0.00013211917,0.0000658339,0.00006236671,0.00015726594,0.000027135098],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004654136,0.00034568118,0.6162453,0.00045335287,0.00012701866,0.0000070439305,0.00014742909,0.00016069227,0.000009039661,0.3783358,0.0015749624,0.0021282246],"study_design_scores_gemma":[0.00075518974,0.0012132874,0.47843373,0.000076304845,0.00024060157,0.0000022234449,0.00026470845,0.006194482,0.000009044449,0.51220447,0.00029588965,0.0003100883],"about_ca_topic_score_codex":0.00006812138,"about_ca_topic_score_gemma":0.000033162516,"teacher_disagreement_score":0.2790991,"about_ca_system_score_codex":0.00010142217,"about_ca_system_score_gemma":0.0003756446,"threshold_uncertainty_score":0.9653042},"labels":[],"label_agreement":null},{"id":"W3047938449","doi":"10.1080/24709360.2020.1796176","title":"Number needed to test: quantifying risk stratification provided by diagnostic tests and risk predictions","year":2020,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"BRCA gene mutations in cancer","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Division of Cancer Epidemiology and Genetics, National Cancer Institute; Fonds de Recherche du Québec-Société et Culture; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Risk stratification; Genetic testing; Medicine; Risk assessment; Psychological intervention; Disease; Metric (unit); Test (biology); Actuarial science; Econometrics; Computer science; Risk analysis (engineering); Mathematics; Internal medicine; Economics; Biology; Operations management","score_opus":0.04071876991350831,"score_gpt":0.3399215882456961,"score_spread":0.2992028183321878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3047938449","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.56011736,0.0012989757,0.42499927,0.0072764964,0.00033181577,0.00092320825,0.004817448,0.00008202377,0.00015336416],"genre_scores_gemma":[0.9382087,0.0018516476,0.05611602,0.0023366888,0.0003244489,0.00018642384,0.00087818166,0.000043724827,0.00005414187],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99768376,0.0004856676,0.000607621,0.00075568754,0.000089800335,0.00037748742],"domain_scores_gemma":[0.9957746,0.002998214,0.00036325929,0.00037279783,0.00016969528,0.00032141272],"candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.00056027237,0.00024690654,0.00031568037,0.00003509483,0.00024722965,0.000025421334,0.00018396508,0.0002466268,0.00003471973],"category_scores_gemma":[0.05565287,0.00025353883,0.000048009282,0.00020577812,0.00014890498,0.0000070134242,0.00011572759,0.00023832984,0.00007846227],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007973745,0.000114318624,0.6147794,0.000050813385,0.00015350965,0.000002855095,0.00038870916,0.001245678,0.059291143,0.0010000893,0.31612304,0.006770705],"study_design_scores_gemma":[0.003410542,0.0049061743,0.6379256,0.00009500473,0.0011974461,0.00011939239,0.0014818248,0.037285548,0.047630176,0.008175032,0.2553043,0.0024689082],"about_ca_topic_score_codex":0.0004566489,"about_ca_topic_score_gemma":0.00030921266,"teacher_disagreement_score":0.37809134,"about_ca_system_score_codex":0.000047798854,"about_ca_system_score_gemma":0.00015323152,"threshold_uncertainty_score":0.99999166},"labels":[],"label_agreement":null},{"id":"W4280498397","doi":"10.1080/24709360.2022.2069457","title":"Doubly weighted estimating equations and weighted multiple imputation for causal inference with an incomplete subgroup variable","year":2022,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Missing data; Statistics; Observational study; Mathematics; Estimator; Causal inference; Inference; Imputation (statistics); Subgroup analysis; Variable (mathematics); Propensity score matching; Econometrics; Medicine; Computer science; Artificial intelligence","score_opus":0.18093787325331165,"score_gpt":0.4283506853874128,"score_spread":0.24741281213410113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4280498397","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02317812,0.000033014876,0.97384316,0.00026226757,0.00014177371,0.0010387157,0.0010742516,0.00037532684,0.000053398537],"genre_scores_gemma":[0.32296827,0.0000041111675,0.67525494,0.0002474019,0.00005566662,0.0005734715,0.0008312848,0.000043045624,0.000021824508],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9970446,0.0007452972,0.0008738036,0.0005932982,0.00017234383,0.00057061895],"domain_scores_gemma":[0.9722161,0.02620832,0.000698876,0.0003978069,0.00031661443,0.00016226343],"candidate_categories":["metaresearch","metaepi_narrow"],"consensus_categories":[],"category_scores_codex":[0.001968676,0.00031412588,0.00066412496,0.00018571244,0.0006854188,0.000025612497,0.00023907349,0.00012628296,0.0000793927],"category_scores_gemma":[0.010906924,0.0002913339,0.000029930174,0.00030158134,0.00024276934,0.00022309994,0.0001959698,0.00035859743,0.0000016866585],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017887524,0.00011968438,0.004409668,0.00010084015,0.00005049161,0.0000060388998,0.000380509,0.0012009707,0.00083371036,0.9883765,0.0005506751,0.0037920605],"study_design_scores_gemma":[0.00052148633,0.0008984138,0.00038434035,0.000016874677,0.0000551443,0.000020532372,0.00008156097,0.43214044,0.00004834503,0.56528324,0.0003196055,0.00023000226],"about_ca_topic_score_codex":0.00033470266,"about_ca_topic_score_gemma":0.00019259106,"teacher_disagreement_score":0.4309395,"about_ca_system_score_codex":0.00017790924,"about_ca_system_score_gemma":0.00016681821,"threshold_uncertainty_score":0.99995387},"labels":[],"label_agreement":null},{"id":"W4406596694","doi":"10.1080/24709360.2025.2451519","title":"Finite Markov chains with absorbing states and mis-specified random effects: application to cognitive data","year":2025,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Center for Advancing Translational Sciences; National Institute on Aging","keywords":"Markov chain; Statistical physics; Cognition; Computer science; Mathematics; Physics; Psychology; Statistics","score_opus":0.03042029286051502,"score_gpt":0.33965049095912536,"score_spread":0.30923019809861035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406596694","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003351633,0.0011918702,0.9945172,0.002355382,0.00016408505,0.00066660927,0.00021946625,0.00007228476,0.00047791045],"genre_scores_gemma":[0.042280924,0.00042421932,0.95076376,0.0060609546,0.000049091457,0.00008386126,0.0002008272,0.000011588891,0.0001247868],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99745226,0.000846405,0.00039457815,0.0008536254,0.000072576826,0.00038055234],"domain_scores_gemma":[0.98280674,0.016010052,0.0001575182,0.00076133094,0.000120990844,0.00014334539],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002126764,0.0002086542,0.0005237465,0.00014293853,0.00014494314,0.000038466274,0.00059644855,0.00010462909,0.0000017369929],"category_scores_gemma":[0.0038663798,0.00016629056,0.00001791901,0.0003175547,0.0001488162,0.00009928662,0.00036150223,0.00016978057,0.00000807166],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025571306,0.00003541918,0.001078029,0.00010749812,0.000086194865,0.000017017848,0.0004324734,0.000033145105,0.0001302566,0.4233112,0.0039226916,0.5705904],"study_design_scores_gemma":[0.0032777924,0.00035571412,0.017758423,0.00033246537,0.00013166554,0.000018585282,0.000054426822,0.75498694,0.00034670276,0.21242198,0.009743415,0.0005719062],"about_ca_topic_score_codex":0.00008879394,"about_ca_topic_score_gemma":0.000052950436,"teacher_disagreement_score":0.7549538,"about_ca_system_score_codex":0.000022224256,"about_ca_system_score_gemma":0.00006465093,"threshold_uncertainty_score":0.6781132},"labels":[],"label_agreement":null},{"id":"W4413019256","doi":"10.1080/24709360.2025.2539589","title":"Selection of mediators and dependence structure for high-dimensional mediation analysis","year":2025,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Child and Adolescent Psychosocial and Emotional Development","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Mediation; Psychology; Selection (genetic algorithm); Computer science; Artificial intelligence; Political science","score_opus":0.017883454270799872,"score_gpt":0.3335996795926779,"score_spread":0.31571622532187804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413019256","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7197443,0.0008991905,0.26804844,0.00518785,0.0039041007,0.0005185289,0.0014184111,0.000042619824,0.00023650455],"genre_scores_gemma":[0.98312455,0.00005533713,0.015005233,0.0009944515,0.00011687956,0.000010536489,0.0004802934,0.0000043615482,0.00020836481],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99884945,0.00016411177,0.00044307922,0.00029180184,0.00006574662,0.00018578277],"domain_scores_gemma":[0.99815273,0.0013952461,0.00020190605,0.00007500721,0.00012508982,0.000050028975],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00039244376,0.00010775496,0.00036865188,0.00021528648,0.000088613015,0.000002324863,0.00005921269,0.00016299747,0.0002078579],"category_scores_gemma":[0.00072041224,0.000094489864,0.000056349414,0.00033163984,0.00009777605,0.000015845044,0.000019419082,0.00008558344,0.000002072622],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014185156,0.000060120557,0.44292006,0.00005495578,0.00067816046,4.19486e-7,0.00011264245,0.00006266961,0.00037961153,0.5298652,0.014576913,0.011147403],"study_design_scores_gemma":[0.0004064518,0.000046090845,0.9071652,0.00001129465,0.00018667868,9.134453e-7,0.000022082515,0.0005173373,0.000057288766,0.09078911,0.00071698584,0.00008056558],"about_ca_topic_score_codex":0.000101711215,"about_ca_topic_score_gemma":0.00015733553,"teacher_disagreement_score":0.46424514,"about_ca_system_score_codex":0.00002658201,"about_ca_system_score_gemma":0.000053403775,"threshold_uncertainty_score":0.38531846},"labels":[],"label_agreement":null}]}