{"meta":{"query_hash":"e802a3299282","filters":{"topic":"Advanced Causal Inference Techniques"},"cohort_total":1326,"direct_labels_cover":35,"predictions_cover":1326,"exported":1326,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/e802a3299282","api":"https://metacan.xera.ac/api/v1/cohort?topic=Advanced+Causal+Inference+Techniques"},"results":[{"id":"W103747493","doi":"10.1007/978-1-4939-2428-8_7","title":"Longitudinal Studies 4: Matching Strategies to Evaluate Risk","year":2015,"lang":"en","type":"article","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Foothills Medical Centre; University of Calgary","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Matching (statistics); Psychological intervention; Contrast (vision); Outcome (game theory); Medicine; Econometrics; Statistics; Computer science; Mathematics; Artificial intelligence","score_opus":0.40862711632687365,"score_gpt":0.6147512186106135,"score_spread":0.2061241022837399,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W103747493","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010626156,0.0018303792,0.98258036,0.0020661629,0.00027898123,0.0002468407,0.0005597769,0.00031734293,0.0014939925],"genre_scores_gemma":[0.27427858,0.0022521303,0.7079014,0.0017523984,0.0007512182,0.0018119257,0.0011269756,0.0003617482,0.009763595],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9698005,0.026148139,0.00086669554,0.0017549287,0.0010721426,0.00035756562],"domain_scores_gemma":[0.8867811,0.09214204,0.003853553,0.013810256,0.0024979506,0.00091508403],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0672327,0.0014429052,0.0019425757,0.0035207556,0.0010367221,0.0023051635,0.0038387126,0.0037409929,0.01625965],"category_scores_gemma":[0.19319563,0.001274486,0.0032696303,0.0036844327,0.0019719275,0.004773301,0.0034476812,0.003538241,0.0011815964],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014035532,0.0005010254,0.023035089,0.00077205704,0.00389316,0.00034042442,0.0006881824,0.033296447,0.00082905026,0.5705704,0.015630653,0.34903988],"study_design_scores_gemma":[0.0005010271,0.00030088815,0.0034775883,0.00017465527,0.00095719035,0.00016664117,0.00012038803,0.12720291,0.00061266194,0.8599521,0.0064835427,0.000050490267],"about_ca_topic_score_codex":0.003565081,"about_ca_topic_score_gemma":0.0027662618,"teacher_disagreement_score":0.0672327,"about_ca_system_score_codex":0.001036334,"about_ca_system_score_gemma":0.0031760398,"threshold_uncertainty_score":0.3555647},"labels":[],"label_agreement":null},{"id":"W104160504","doi":"10.1007/978-94-007-4044-0_6","title":"Distinctive Population Segments in Multi-mode Risk Management","year":2012,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Mode (computer interface); Geography; Business; Computer science","score_opus":0.1553271555204005,"score_gpt":0.41090055369748707,"score_spread":0.2555733981770866,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W104160504","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008309411,0.0019330509,0.96504873,0.0011734923,0.00011118259,0.000028046721,0.000073501644,0.000091245136,0.023231324],"genre_scores_gemma":[0.5179058,0.005584094,0.41140482,0.0006974312,0.00086356356,0.00027299792,0.0003551906,0.00021612912,0.0627001],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99963725,0.00017422478,0.000013645648,0.000075854616,0.000076136035,0.000022831271],"domain_scores_gemma":[0.99816436,0.0015167494,0.00006230526,0.00012598811,0.00009849802,0.000032039992],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013022665,0.00050613924,0.0005140861,0.00067642215,0.00045533656,0.0011677119,0.0008094257,0.0008821431,0.007155786],"category_scores_gemma":[0.0050675035,0.00036627462,0.00054426177,0.000978839,0.0012496754,0.0026387912,0.0009413057,0.00222472,0.00080226245],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000011861749,0.000020622629,0.00083871937,0.000051014533,0.000020317275,0.000051155137,0.00028581065,0.012569273,0.00027114284,0.9143252,0.003865311,0.06768965],"study_design_scores_gemma":[0.0000017065448,0.000006059431,0.0003453706,0.00001672469,0.0000069664916,0.000039777642,0.000047663478,0.03124923,0.00012008818,0.96397746,0.0041832933,0.000005616465],"about_ca_topic_score_codex":0.00082805706,"about_ca_topic_score_gemma":0.0010242937,"teacher_disagreement_score":0.007155786,"about_ca_system_score_codex":0.00061207725,"about_ca_system_score_gemma":0.0003866638,"threshold_uncertainty_score":0.023938477},"labels":[],"label_agreement":null},{"id":"W142749920","doi":"10.1055/s-2003-39997","title":"Characteristics of Good Causation Studies","year":2003,"lang":"en","type":"review","venue":"Seminars in Reproductive Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Confounding; Odds ratio; Causation; Medicine; Causality (physics); Population; Causal inference; Internal medicine; Environmental health; Pathology","score_opus":0.2982394417425489,"score_gpt":0.5066656835073107,"score_spread":0.20842624176476177,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W142749920","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035280474,0.88181305,0.040143643,0.03098467,0.002125986,0.0025460934,0.002463661,0.00015224071,0.036242563],"genre_scores_gemma":[0.07109107,0.759109,0.12099975,0.021352392,0.0050872965,0.010586231,0.002848167,0.00022676209,0.008699252],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94240457,0.028847042,0.013140932,0.002212014,0.012594353,0.0008010402],"domain_scores_gemma":[0.6315633,0.30525184,0.027528808,0.013287402,0.020064425,0.0023042685],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07451705,0.0009020942,0.002632961,0.0077903788,0.0014605904,0.005568924,0.002237324,0.0037900961,0.015573358],"category_scores_gemma":[0.23833899,0.0010120783,0.0018922988,0.013002799,0.0022396052,0.006556536,0.0031888888,0.002433509,0.003436699],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004867119,0.00006375686,0.0071297437,0.05603316,0.0008077817,0.0008281136,0.0010910562,0.0006292174,0.00045715642,0.12347742,0.07084349,0.7381524],"study_design_scores_gemma":[0.00027233336,0.00022198094,0.0067833504,0.029602092,0.0008884388,0.005019208,0.0005880802,0.00032176293,0.00048595827,0.1192393,0.83651924,0.000058394544],"about_ca_topic_score_codex":0.0011309454,"about_ca_topic_score_gemma":0.0023359747,"teacher_disagreement_score":0.9254829,"about_ca_system_score_codex":0.002650284,"about_ca_system_score_gemma":0.006025158,"threshold_uncertainty_score":0.3940885},"labels":[],"label_agreement":null},{"id":"W143496817","doi":"10.1007/978-1-4939-2428-8_14","title":"Randomized Controlled Trials 6: On Contamination and Estimating the Actual Treatment Effect","year":2015,"lang":"en","type":"article","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Randomized controlled trial; Contamination; Environmental science; Econometrics; Statistics; Medicine; Mathematics; Biology; Internal medicine; Ecology","score_opus":0.22326473890545312,"score_gpt":0.5631080594861806,"score_spread":0.33984332058072747,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W143496817","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029364717,0.02097359,0.96117854,0.0081004,0.0028014786,0.001607533,0.00034087084,0.000492223,0.0015689025],"genre_scores_gemma":[0.15403707,0.00990651,0.8083338,0.0113359885,0.0030702313,0.010095232,0.00040751664,0.0004809109,0.002332679],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.36284137,0.6073094,0.009971385,0.009935864,0.009136228,0.00080574077],"domain_scores_gemma":[0.19249414,0.76509464,0.012269978,0.02635087,0.002966674,0.00082369975],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.37555805,0.004728248,0.012316386,0.0042834305,0.0017994933,0.0053777816,0.007190417,0.011969852,0.008500237],"category_scores_gemma":[0.6509763,0.00443714,0.010120466,0.004340269,0.014904425,0.0105797835,0.0052479943,0.016559962,0.0011031522],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010187496,0.0003867084,0.0023476018,0.015731584,0.014092894,0.00038403872,0.00096380216,0.021461066,0.00040853018,0.7451925,0.013763063,0.1750807],"study_design_scores_gemma":[0.006989512,0.0007745809,0.0005567425,0.002936804,0.0034808274,0.00021345245,0.000058754256,0.05039553,0.00064100715,0.9245037,0.009320683,0.00012836831],"about_ca_topic_score_codex":0.002427102,"about_ca_topic_score_gemma":0.001605719,"teacher_disagreement_score":0.624442,"about_ca_system_score_codex":0.0034018203,"about_ca_system_score_gemma":0.008192438,"threshold_uncertainty_score":0.77004814},"labels":[],"label_agreement":null},{"id":"W1486734343","doi":"10.3747/co.v0i0.339","title":"Panel Discussion 1","year":2008,"lang":"en","type":"article","venue":"Current Oncology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Medicine; Data science; Bioinformatics; Computer science; Biology","score_opus":0.6416160428976948,"score_gpt":0.542421122104341,"score_spread":0.09919492079335379,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1486734343","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007471966,0.000926916,0.0005979822,0.9047878,0.03428836,0.0004238461,0.004531482,0.0001026005,0.053593937],"genre_scores_gemma":[0.0030256733,0.00037148493,0.00044819168,0.934622,0.009681859,0.000727147,0.00061408355,0.000058995007,0.050450522],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9857329,0.003480127,0.00073363795,0.0029284572,0.0038764207,0.003248525],"domain_scores_gemma":[0.93961656,0.041066315,0.0017420187,0.0029158997,0.011263091,0.003396237],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028136346,0.001559529,0.0026217164,0.0022391523,0.009645497,0.013696356,0.006460122,0.07855267,0.16328987],"category_scores_gemma":[0.08923358,0.0015333731,0.004122639,0.0030502323,0.0029844716,0.0071609137,0.005927267,0.04360753,0.055005968],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004203141,0.000016598848,0.00015325338,0.00006340389,0.0000108633485,0.000055934317,0.00007351453,0.000049236143,0.00008101542,0.0049770367,0.99254054,0.0019365884],"study_design_scores_gemma":[0.00021652023,0.000028867076,0.0024482834,0.00064182316,0.000104222265,0.00007124415,0.0008468646,0.00018724294,0.00043934103,0.014542097,0.9803961,0.00007747113],"about_ca_topic_score_codex":0.026863305,"about_ca_topic_score_gemma":0.04962309,"teacher_disagreement_score":0.16328987,"about_ca_system_score_codex":0.007378967,"about_ca_system_score_gemma":0.015590708,"threshold_uncertainty_score":0.54625905},"labels":[],"label_agreement":null},{"id":"W1493983723","doi":"10.2139/ssrn.1617262","title":"Efficient Estimation of Average Treatment Effects Under Treatment-Based Sampling, Second Version","year":2010,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Statistics; Estimation; Sampling (signal processing); Mathematics; Econometrics; Computer science; Economics; Telecommunications","score_opus":0.048264251346877104,"score_gpt":0.3639097914497442,"score_spread":0.3156455401028671,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1493983723","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010245806,0.000616087,0.98581463,0.0006831028,0.00019583118,0.00047990974,0.0006245477,0.00034074052,0.0009994912],"genre_scores_gemma":[0.3947112,0.0022134408,0.5853549,0.0011490826,0.0008866044,0.0032509852,0.0022587895,0.00032341765,0.009851596],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94936275,0.039370067,0.0016566156,0.005402763,0.002809934,0.0013978587],"domain_scores_gemma":[0.7498331,0.21481206,0.0053930725,0.024665102,0.0042309808,0.0010656458],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058397576,0.0021083723,0.007783552,0.002723919,0.0013207764,0.004335331,0.0064054322,0.00490619,0.015843546],"category_scores_gemma":[0.21584798,0.0037067651,0.004813625,0.004364124,0.0045327437,0.0053238557,0.0031157976,0.0065240846,0.0015303727],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037001495,0.00095388986,0.009435633,0.0031677727,0.004607533,0.0005910724,0.0012530917,0.1881298,0.0021855754,0.41665712,0.013845475,0.35547286],"study_design_scores_gemma":[0.0008937567,0.0005370555,0.0044199885,0.00030406276,0.0011511705,0.00034028987,0.00014873552,0.53690886,0.002039472,0.44924098,0.0039197896,0.000095892676],"about_ca_topic_score_codex":0.006538881,"about_ca_topic_score_gemma":0.0057046227,"teacher_disagreement_score":0.058397576,"about_ca_system_score_codex":0.00235209,"about_ca_system_score_gemma":0.006023499,"threshold_uncertainty_score":0.30883962},"labels":[],"label_agreement":null},{"id":"W1504811022","doi":"10.2139/ssrn.1360961","title":"Efficient Estimation of Average Treatment Effects Under Treatment-Based Sampling","year":2009,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Statistics; Estimation; Sampling (signal processing); Mathematics; Econometrics; Computer science; Engineering","score_opus":0.07719717332674914,"score_gpt":0.3892253488116601,"score_spread":0.31202817548491096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1504811022","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018372735,0.0005608738,0.9785841,0.00059842085,0.000089911046,0.00030568166,0.00032050628,0.0003059558,0.0008618329],"genre_scores_gemma":[0.49793923,0.001283679,0.49317014,0.0006503756,0.0004334165,0.0017157216,0.0013064664,0.00014926746,0.0033517252],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9522238,0.03940303,0.0014642838,0.003757957,0.0021812432,0.0009695615],"domain_scores_gemma":[0.69860035,0.27568558,0.0052547767,0.016575767,0.003037869,0.0008456732],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05205022,0.0014896486,0.006084877,0.002328777,0.0011676468,0.0031140666,0.006059727,0.00374111,0.006799225],"category_scores_gemma":[0.2020473,0.002471994,0.0031258839,0.0034687861,0.0030340957,0.0042218016,0.0026316575,0.0047346475,0.0007645251],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029285944,0.0011289439,0.01679311,0.0015378862,0.0031599586,0.00039104954,0.00097203656,0.27855992,0.0015808542,0.35772383,0.0065267948,0.32869712],"study_design_scores_gemma":[0.0006286537,0.00032547538,0.0035314928,0.00012364,0.00061049167,0.00016477655,0.000113258546,0.5647173,0.0012403913,0.4268592,0.0016360257,0.00004924381],"about_ca_topic_score_codex":0.0046365615,"about_ca_topic_score_gemma":0.0053504813,"teacher_disagreement_score":0.94794977,"about_ca_system_score_codex":0.0021035972,"about_ca_system_score_gemma":0.0042862557,"threshold_uncertainty_score":0.27527118},"labels":[],"label_agreement":null},{"id":"W1534104826","doi":"10.1002/pds.3299","title":"Comparing the cohort design and the nested case–control design in the presence of both time‐invariant and time‐dependent treatment and competing risks: bias and precision","year":2012,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Institute for Clinical Evaluative Sciences; Women's College Hospital; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; U.S. Public Health Service; Government of Ontario; Heart and Stroke Foundation of Canada; Institute for Clinical Evaluative Sciences; Cancer Care Ontario","keywords":"Confidence interval; Statistics; Medicine; Mean squared error; Observational study; Cohort; Monte Carlo method; Clinical study design; Cohort study; Econometrics; Research design; Event (particle physics); Clinical trial; Mathematics; Internal medicine","score_opus":0.23166504252237438,"score_gpt":0.4193350163465059,"score_spread":0.1876699738241315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1534104826","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.092461705,0.009360222,0.8846198,0.0014118659,0.0013680183,0.0065948484,0.0007036242,0.0002659718,0.0032139558],"genre_scores_gemma":[0.5020018,0.0022784043,0.47859755,0.0015263638,0.0005257124,0.013400236,0.0006379869,0.00008238439,0.0009494896],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.42242628,0.52307284,0.01677865,0.01781771,0.018717263,0.0011873038],"domain_scores_gemma":[0.19096057,0.7157673,0.043269183,0.039701756,0.009218732,0.0010824075],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.44185972,0.00238422,0.005580325,0.003776983,0.0018411645,0.004700741,0.0045557483,0.006749205,0.003959838],"category_scores_gemma":[0.6629459,0.0017796592,0.009494897,0.0032910989,0.0073953406,0.004279954,0.0042691766,0.0038695193,0.00043468646],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.02611077,0.0016606891,0.16942856,0.012905131,0.066912815,0.0013529378,0.006262671,0.15551957,0.0025150883,0.24111782,0.004756915,0.31145707],"study_design_scores_gemma":[0.013870273,0.017549898,0.06376903,0.0069402363,0.024850516,0.0019914855,0.00095922337,0.36901262,0.0071305893,0.46969736,0.023109214,0.0011195617],"about_ca_topic_score_codex":0.0036422575,"about_ca_topic_score_gemma":0.002565357,"teacher_disagreement_score":0.9944197,"about_ca_system_score_codex":0.0036829116,"about_ca_system_score_gemma":0.007087158,"threshold_uncertainty_score":0.68828636},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W1534864278","doi":"10.1111/j.1360-0443.2009.02896.x","title":"Modeling missing binary outcome data in a successful web‐based smokeless tobacco cessation program","year":2010,"lang":"en","type":"article","venue":"Addiction","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Cancer Institute","keywords":"Missing data; Imputation (statistics); Abstinence; Smokeless tobacco; Randomized controlled trial; Attrition; Medicine; Smoking cessation; Statistics; Environmental health; Psychiatry; Mathematics; Tobacco use","score_opus":0.1909148593675436,"score_gpt":0.4403831945771234,"score_spread":0.24946833520957978,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1534864278","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5883412,0.0032935422,0.39805785,0.0042453026,0.00022923936,0.0025193652,0.00084381684,0.0003458141,0.0021239303],"genre_scores_gemma":[0.85277444,0.0011137888,0.14019015,0.00053542014,0.0001178784,0.003748457,0.00045310246,0.000038298283,0.0010284141],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9531827,0.042801183,0.00075907854,0.0011649431,0.0015508056,0.00054132944],"domain_scores_gemma":[0.6807141,0.30029005,0.011476596,0.00414139,0.0026012252,0.0007766217],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.103757754,0.00085189915,0.0022556335,0.0016626258,0.00070776173,0.00178309,0.002757756,0.001983708,0.0023790912],"category_scores_gemma":[0.24259478,0.0009163722,0.002610916,0.0015602821,0.00124392,0.0018448726,0.0016465998,0.0023319966,0.00016616833],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019138703,0.004793475,0.13918294,0.0040172585,0.008576685,0.00038963166,0.0017191805,0.44341195,0.00044349223,0.026130116,0.003290841,0.3489058],"study_design_scores_gemma":[0.0033441354,0.0036182126,0.0211268,0.00093311386,0.002511601,0.00013639206,0.00033821096,0.92342085,0.0009043385,0.042133678,0.0014301804,0.00010240381],"about_ca_topic_score_codex":0.0051845117,"about_ca_topic_score_gemma":0.0057390314,"teacher_disagreement_score":0.103757754,"about_ca_system_score_codex":0.0015809626,"about_ca_system_score_gemma":0.0034621302,"threshold_uncertainty_score":0.54873},"labels":[],"label_agreement":null},{"id":"W1541868835","doi":"10.1186/1471-2288-1-11","title":"Sample size requirements for case-control study designs","year":2001,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Royal Victoria Hospital","funders":"","keywords":"Confounding; Sample size determination; Odds ratio; Fortran; Statistics; Computer science; Control (management); Sample (material); Case-control study; Odds; Software; Medicine; Mathematics; Logistic regression; Programming language; Artificial intelligence","score_opus":0.9182700472002921,"score_gpt":0.6957823635411999,"score_spread":0.22248768365909222,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1541868835","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076975427,0.0031099743,0.9334317,0.0043431227,0.0014572834,0.032081388,0.0078076744,0.0010382753,0.009033042],"genre_scores_gemma":[0.043106154,0.0017953272,0.823258,0.0019704446,0.0006075848,0.123002715,0.0039945594,0.000373743,0.0018914175],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.76064265,0.17802279,0.027238812,0.0051383246,0.027616622,0.0013408493],"domain_scores_gemma":[0.37197882,0.5760485,0.009450626,0.017496353,0.02362545,0.0014001594],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2000522,0.0014679093,0.003193187,0.0036250835,0.0012106397,0.002173403,0.0044600302,0.004810702,0.024153227],"category_scores_gemma":[0.5731917,0.0017971608,0.0022227238,0.0029394133,0.0015255263,0.002916908,0.0027443732,0.0031511276,0.004705274],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008994222,0.0007177526,0.013634826,0.013345811,0.0010598657,0.0014415807,0.00290797,0.019858748,0.0068108384,0.19566856,0.09837338,0.63718647],"study_design_scores_gemma":[0.017540796,0.009504863,0.02793662,0.007843969,0.0021717784,0.00475398,0.0010330166,0.06940199,0.016424777,0.4589634,0.38398802,0.00043683316],"about_ca_topic_score_codex":0.0011014427,"about_ca_topic_score_gemma":0.0010761009,"teacher_disagreement_score":0.7999478,"about_ca_system_score_codex":0.0013340445,"about_ca_system_score_gemma":0.004648626,"threshold_uncertainty_score":0.98647803},"labels":[],"label_agreement":null},{"id":"W1546136735","doi":"10.1002/pds.3773","title":"On the role of marginal confounder prevalence – implications for the high‐dimensional propensity score algorithm","year":2015,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research; McGill University Health Centre","keywords":"Propensity score matching; Confounding; Covariate; Medicine; Statistics; Selection bias; Pharmacoepidemiology; Sample size determination; Econometrics; Demography; Mathematics; Internal medicine; Medical prescription","score_opus":0.25710149254751674,"score_gpt":0.4312125604105927,"score_spread":0.17411106786307595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1546136735","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020662023,0.00083492463,0.9731929,0.0027237462,0.00004907952,0.00011270719,0.000064019034,0.00012793804,0.0022326943],"genre_scores_gemma":[0.4007682,0.0007470541,0.5960383,0.0008897308,0.00020855485,0.0004383867,0.00012730368,0.00009401827,0.00068840064],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96187025,0.030458411,0.0014029043,0.0018577513,0.0039868276,0.0004238006],"domain_scores_gemma":[0.6262323,0.3426163,0.009351251,0.014290248,0.006483188,0.0010267205],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09178283,0.0006964082,0.0012944846,0.0021925452,0.00093879376,0.0027423992,0.0021623117,0.0018638036,0.00249814],"category_scores_gemma":[0.34004322,0.00062953384,0.0012992796,0.0015583164,0.0054250853,0.0046224548,0.0049073314,0.0035109445,0.00026393446],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004324301,0.00013932062,0.0352733,0.0005219255,0.00032849892,0.00031452594,0.00064751535,0.112144455,0.0009064483,0.7411807,0.0024147471,0.10569606],"study_design_scores_gemma":[0.00016167464,0.00017367161,0.008159746,0.00037541648,0.00013089702,0.0005946356,0.00011801845,0.4701805,0.0014658541,0.5152257,0.0033572572,0.00005658711],"about_ca_topic_score_codex":0.0011918657,"about_ca_topic_score_gemma":0.00075658533,"teacher_disagreement_score":0.09178283,"about_ca_system_score_codex":0.0016057678,"about_ca_system_score_gemma":0.0021953408,"threshold_uncertainty_score":0.48539978},"labels":[],"label_agreement":null},{"id":"W1556145289","doi":"","title":"Impact Evaluation for Policy Making: A Close Look at Latin American Countries with Weaker Research Capacities","year":2012,"lang":"en","type":"article","venue":"LA Referencia (Red Federada de Repositorios Institucionales de Publicaciones Científicas)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"International Development Research Centre","keywords":"Latin Americans; Political science; Humanities; Economics; Economic growth; Economy; Sociology; Development economics; Economic history; Welfare economics; Art; Law","score_opus":0.12314337036769715,"score_gpt":0.410159697722024,"score_spread":0.2870163273543268,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1556145289","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041485272,0.50047344,0.056759648,0.25606441,0.0019778775,0.001562481,0.0010363617,0.00034687316,0.1402937],"genre_scores_gemma":[0.5736943,0.30762064,0.07868219,0.0291365,0.002114382,0.0034197797,0.0010411959,0.00025188248,0.0040392578],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.7484388,0.21027015,0.014192299,0.0026341258,0.019994747,0.004469952],"domain_scores_gemma":[0.38179165,0.5312376,0.020724041,0.015988886,0.04678819,0.0034695638],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3241385,0.0013858507,0.0041449345,0.029416194,0.004920507,0.025880225,0.0025572646,0.0039355084,0.0063036447],"category_scores_gemma":[0.37665203,0.0008888227,0.0022704094,0.038907077,0.012887141,0.020942936,0.011789453,0.0074747945,0.00033678723],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042283253,0.00030696928,0.029756682,0.032101642,0.00089126156,0.0008615067,0.018413626,0.004700656,0.0007419746,0.4340386,0.01936224,0.45840195],"study_design_scores_gemma":[0.00026601675,0.0005122186,0.05237329,0.11503693,0.0011797483,0.0005721721,0.054148383,0.0036990824,0.0020538457,0.26654243,0.5032914,0.0003243587],"about_ca_topic_score_codex":0.011707477,"about_ca_topic_score_gemma":0.009145229,"teacher_disagreement_score":0.3241385,"about_ca_system_score_codex":0.020859946,"about_ca_system_score_gemma":0.043586552,"threshold_uncertainty_score":0.8334576},"labels":[],"label_agreement":null},{"id":"W1556389145","doi":"10.1002/cjs.11254","title":"An imputation based empirical likelihood approach to pretest–posttest studies","year":2015,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Confidence interval; Imputation (statistics); Statistics; Missing data; Treatment effect; Empirical likelihood; Type I and type II errors; Parametric statistics; Statistical hypothesis testing; Treatment and control groups; Mathematics; Econometrics; Computer science; Psychology; Medicine","score_opus":0.3289284696619818,"score_gpt":0.45212187221249617,"score_spread":0.12319340255051436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1556389145","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013754497,0.00041655815,0.9964359,0.0004159722,0.000051373965,0.00021813424,0.00021255469,0.00017778554,0.0006963663],"genre_scores_gemma":[0.13295335,0.0011312914,0.857973,0.0005345053,0.0004127218,0.0027009689,0.0010812028,0.00018264621,0.0030302845],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93212765,0.059065886,0.0019339648,0.0028548,0.0034126663,0.00060502515],"domain_scores_gemma":[0.77101004,0.20281947,0.008348412,0.010322582,0.0065991636,0.0009002593],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.087096445,0.0014413464,0.0038277677,0.005444308,0.00096304534,0.0034417098,0.009362919,0.004084214,0.010197516],"category_scores_gemma":[0.22473317,0.0015714989,0.0033320165,0.0076015084,0.00230868,0.0036157744,0.0031212752,0.0060908613,0.0017065639],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045403375,0.00045871205,0.014629291,0.0016199367,0.0017724696,0.0010825293,0.0017222113,0.1893385,0.00041340914,0.46948513,0.008691618,0.31033224],"study_design_scores_gemma":[0.000197839,0.0002656184,0.0030892054,0.00037299743,0.0002751489,0.0002508618,0.00020880393,0.52436626,0.0004541546,0.46154067,0.00890099,0.000077471384],"about_ca_topic_score_codex":0.0052091777,"about_ca_topic_score_gemma":0.004176981,"teacher_disagreement_score":0.91290355,"about_ca_system_score_codex":0.0024072176,"about_ca_system_score_gemma":0.003584178,"threshold_uncertainty_score":0.46061552},"labels":[],"label_agreement":null},{"id":"W1558639712","doi":"10.1002/pds.3485","title":"Evidence of subgroup‐specific treatment effect in the absence of an overall effect: is there really a contradiction?","year":2013,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Subgroup analysis; Medicine; Odds ratio; Treatment effect; Randomization; Sample size determination; Internal medicine; Statistics; Randomized controlled trial; Confidence interval; Mathematics; Traditional medicine","score_opus":0.10108559944306415,"score_gpt":0.4221100691319647,"score_spread":0.3210244696889005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1558639712","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1759869,0.32561797,0.2768625,0.16885704,0.018242706,0.003121152,0.0047368817,0.0017423845,0.024832495],"genre_scores_gemma":[0.8705815,0.010636077,0.05553114,0.053490877,0.0064812987,0.0014423874,0.00085224723,0.00034447925,0.0006400235],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.51814824,0.32464656,0.05412361,0.057547867,0.0420453,0.0034884296],"domain_scores_gemma":[0.10948838,0.80307615,0.03284041,0.044763204,0.008609924,0.0012219886],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.41942874,0.0019601572,0.013398464,0.0069716284,0.0017159946,0.00713257,0.008712023,0.013428791,0.00826304],"category_scores_gemma":[0.7130848,0.0019912072,0.022866186,0.00571875,0.019727776,0.012324875,0.0053618695,0.008707679,0.001198706],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.024784707,0.00066266657,0.21290389,0.066052824,0.19729388,0.0037782437,0.007408392,0.0073796646,0.00201124,0.12416429,0.024426896,0.32913336],"study_design_scores_gemma":[0.009407489,0.0055496907,0.09597292,0.02635558,0.10111047,0.006241834,0.003917724,0.022931412,0.0044615455,0.6726844,0.05030192,0.0010650712],"about_ca_topic_score_codex":0.0014470167,"about_ca_topic_score_gemma":0.0009130469,"teacher_disagreement_score":0.5805713,"about_ca_system_score_codex":0.0036537608,"about_ca_system_score_gemma":0.0030418236,"threshold_uncertainty_score":0.71594775},"labels":[],"label_agreement":null},{"id":"W1563314065","doi":"10.29012/jpc.v1i2.571","title":"Maintaining Analytic Utility while Protecting Confidentiality of Survey and Nonsurvey Data","year":2010,"lang":"en","type":"article","venue":"Journal of Privacy and Confidentiality","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Nutrition Obesity Research Center, University of North Carolina; RTI International; University of Chicago","keywords":"Confidentiality; Computer science; Macro; Actuarial science; Econometrics; Statistics; Data mining; Mathematics; Business; Computer security","score_opus":0.2908189185928526,"score_gpt":0.43491223749864016,"score_spread":0.14409331890578758,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1563314065","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051085528,0.00033585945,0.9351879,0.004926803,0.00007928967,0.00064252416,0.0015075513,0.0008194366,0.0054151183],"genre_scores_gemma":[0.6063928,0.00040519834,0.38717023,0.00090173155,0.0002860175,0.0013015965,0.0013022944,0.00022896744,0.0020111874],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9135728,0.05914164,0.0044942605,0.0060082353,0.014648093,0.0021349639],"domain_scores_gemma":[0.6372611,0.1813993,0.025348904,0.14091007,0.013749855,0.001330746],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.073261626,0.0009112287,0.0019323613,0.0028839083,0.0016767364,0.0074082264,0.004591823,0.0022510588,0.003714851],"category_scores_gemma":[0.27267238,0.0012420298,0.0010880978,0.008219884,0.0053109685,0.009920707,0.00714721,0.002538631,0.0016513043],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010810043,0.00043039277,0.034200456,0.0006487634,0.0003429725,0.0007537563,0.0057001193,0.038858827,0.008052898,0.55520797,0.0104424795,0.34428033],"study_design_scores_gemma":[0.0003482154,0.00079639145,0.01672406,0.00040052604,0.00027376978,0.0011596316,0.002572191,0.19299719,0.02543655,0.71258545,0.046487097,0.00021895881],"about_ca_topic_score_codex":0.0025746368,"about_ca_topic_score_gemma":0.0013835483,"teacher_disagreement_score":0.9267384,"about_ca_system_score_codex":0.0022036866,"about_ca_system_score_gemma":0.0060234903,"threshold_uncertainty_score":0.38744915},"labels":[],"label_agreement":null},{"id":"W1570060061","doi":"10.1002/0470842555.ch43","title":"Bias and Confounding in Pharmacoepidemiology","year":2000,"lang":"en","type":"other","venue":"Pharmacoepidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":85,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Pharmacoepidemiology; Confounding; Computer science; Econometrics; Medicine; Mathematics; Pharmacology; Internal medicine","score_opus":0.40457020891237205,"score_gpt":0.5390313703409946,"score_spread":0.13446116142862252,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1570060061","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047091837,0.12981342,0.5705078,0.10421844,0.003947362,0.00015865311,0.0007785792,0.00052722875,0.1853394],"genre_scores_gemma":[0.24816187,0.19254436,0.37206975,0.01692804,0.017297683,0.000777587,0.00071414694,0.00040615766,0.15110035],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9903734,0.007279445,0.0003597488,0.0004336284,0.0014651731,0.00008873822],"domain_scores_gemma":[0.95459265,0.04119168,0.00094673707,0.0017103152,0.0013546712,0.00020397895],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0146587705,0.0008907668,0.0011821251,0.0029272675,0.00070822326,0.0026401056,0.0010732148,0.001539737,0.018012404],"category_scores_gemma":[0.06346907,0.00050215836,0.0004993125,0.0053053233,0.0030025297,0.0046675126,0.0014847536,0.0026731077,0.0017178123],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023471348,0.00001841748,0.0008242064,0.000376274,0.00004380808,0.00005521691,0.00014446295,0.0025775665,0.00003362997,0.8091808,0.03403644,0.15268575],"study_design_scores_gemma":[0.00001093899,0.000003860045,0.0002594393,0.00011761084,0.000012028576,0.00005185105,0.000027042419,0.0024272834,0.000052374522,0.9716717,0.025360327,0.0000055252217],"about_ca_topic_score_codex":0.0023751603,"about_ca_topic_score_gemma":0.0022091675,"teacher_disagreement_score":0.98534125,"about_ca_system_score_codex":0.0021816303,"about_ca_system_score_gemma":0.0020712614,"threshold_uncertainty_score":0.07752389},"labels":[],"label_agreement":null},{"id":"W1576880634","doi":"10.17848/rpt204","title":"What Works for Whom in Public Employment Policy?","year":2011,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Human Resources and Skills Development Canada; Institut für Arbeitsmarkt- und Berufsforschung; Australian Government; W.E. Upjohn Institute for Employment Research","keywords":"Public policy; Political science; Labour economics; Public administration; Sociology; Economics; Law","score_opus":0.5168958004630927,"score_gpt":0.5017415248250681,"score_spread":0.015154275638024628,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1576880634","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005313622,0.015474814,0.0030752958,0.9057869,0.0014204463,0.000054496963,0.00085270556,0.00013887571,0.06788286],"genre_scores_gemma":[0.71961105,0.063733526,0.008836011,0.1495924,0.0059005166,0.000660788,0.0014371268,0.00038326558,0.049845435],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99110806,0.0045687784,0.00024096777,0.00096665655,0.0012806023,0.0018348573],"domain_scores_gemma":[0.9752315,0.01429496,0.0025096869,0.0009758705,0.003788412,0.0031995517],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016731402,0.0007128613,0.0012457393,0.002954291,0.005449562,0.015195462,0.001675423,0.0057513807,0.035555817],"category_scores_gemma":[0.049950253,0.00044758242,0.0008501071,0.0049573197,0.0062054577,0.014985538,0.0024220403,0.0047109295,0.0059978873],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019410189,0.0003061755,0.016318059,0.0012758768,0.00015947281,0.00019255962,0.0033895264,0.0012747414,0.000101351136,0.41942734,0.3336045,0.22375627],"study_design_scores_gemma":[0.00015894201,0.00006446591,0.012727008,0.005336232,0.00026790443,0.00014687036,0.016486106,0.0026657635,0.0003497463,0.65926623,0.3024512,0.00007949007],"about_ca_topic_score_codex":0.10675703,"about_ca_topic_score_gemma":0.117023624,"teacher_disagreement_score":0.10675703,"about_ca_system_score_codex":0.019430084,"about_ca_system_score_gemma":0.040819366,"threshold_uncertainty_score":0.21227127},"labels":[],"label_agreement":null},{"id":"W1577677789","doi":"10.1002/bimj.201400153","title":"Predictive Bayesian inference and dynamic treatment regimes","year":2015,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Frequentist inference; Covariate; Bayesian probability; Inference; Bayesian inference; Econometrics; Inverse probability weighting; Computer science; Estimator; Mathematics; Statistics; Artificial intelligence","score_opus":0.2574949456410719,"score_gpt":0.4554466655597026,"score_spread":0.1979517199186307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1577677789","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042018443,0.00027041257,0.9918624,0.0012416933,0.000038483857,0.00006994907,0.000137384,0.000091037924,0.0020867805],"genre_scores_gemma":[0.38688365,0.0015440359,0.6039602,0.0010525504,0.00034108767,0.0011353703,0.0005686103,0.00010740488,0.0044070473],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98221225,0.012706364,0.0005410715,0.0022160406,0.0018525842,0.00047175054],"domain_scores_gemma":[0.93932164,0.0512237,0.0034596298,0.004181695,0.001457279,0.0003560728],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039429948,0.0009728998,0.002450059,0.0026324876,0.0011718074,0.0029865282,0.0038038217,0.003070244,0.007137198],"category_scores_gemma":[0.13015299,0.0012809786,0.0022478462,0.0029131684,0.004355305,0.0056999456,0.002637712,0.0054953196,0.00061425293],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005341343,0.0000511869,0.0012818815,0.00011190487,0.00011615775,0.000095257805,0.00022009555,0.069844894,0.00013895596,0.89353067,0.001060372,0.033495232],"study_design_scores_gemma":[0.000029154795,0.000019759094,0.0003778923,0.000062230654,0.000034592475,0.00004591083,0.000026898799,0.15050979,0.00011416263,0.847425,0.0013371279,0.000017541819],"about_ca_topic_score_codex":0.0058624423,"about_ca_topic_score_gemma":0.005197022,"teacher_disagreement_score":0.039429948,"about_ca_system_score_codex":0.0031535549,"about_ca_system_score_gemma":0.003029636,"threshold_uncertainty_score":0.20852798},"labels":[],"label_agreement":null},{"id":"W1578220446","doi":"10.1007/s00362-007-0099-7","title":"Robert E. Weiss (2006): Modeling longitudinal data","year":2008,"lang":"en","type":"article","venue":"Statistical Papers","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Longitudinal data; Sociology; Demography","score_opus":0.292524825356008,"score_gpt":0.4326743019312527,"score_spread":0.14014947657524474,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1578220446","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020760528,0.044987567,0.9200073,0.025662811,0.0018163347,0.00004966428,0.00059902127,0.000496708,0.0043045483],"genre_scores_gemma":[0.11619773,0.11002724,0.72282934,0.0066288454,0.007665013,0.00043071457,0.0017648034,0.0008773297,0.03357903],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99704164,0.002024371,0.00013422879,0.00033176763,0.00040002615,0.00006797015],"domain_scores_gemma":[0.98348355,0.01308566,0.0009087774,0.0011819241,0.0010344665,0.00030578746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011203585,0.0017290999,0.0013269818,0.0027375356,0.0007535377,0.0023940438,0.0016326802,0.0022360438,0.006975528],"category_scores_gemma":[0.037624326,0.0011702185,0.0013168562,0.0061776596,0.0016367994,0.004381646,0.0014444524,0.00426883,0.0036646575],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008264745,0.000068803085,0.003964663,0.0007933637,0.00044984955,0.000223434,0.00064369035,0.017470976,0.00039295896,0.58423966,0.17819916,0.2134707],"study_design_scores_gemma":[0.00003542492,0.00004383723,0.0015427638,0.00039687046,0.0002363262,0.00029810934,0.00008569238,0.02099135,0.0008527095,0.85075176,0.12470182,0.00006340302],"about_ca_topic_score_codex":0.003188275,"about_ca_topic_score_gemma":0.003842907,"teacher_disagreement_score":0.011203585,"about_ca_system_score_codex":0.0011192508,"about_ca_system_score_gemma":0.0016491996,"threshold_uncertainty_score":0.05925095},"labels":[],"label_agreement":null},{"id":"W1583915132","doi":"10.3917/inso.150.0056","title":"L'apport des expérimentations dans l'évaluation de l'impact des dispositifs publics","year":2009,"lang":"fr","type":"article","venue":"Informations sociales","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Musée de la Civilisation","funders":"","keywords":"Humanities; Publics; Political science; Philosophy","score_opus":0.24036194099422475,"score_gpt":0.4615485375554111,"score_spread":0.22118659656118633,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1583915132","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.73780173,0.0016956712,0.21058577,0.0033569376,0.00034465638,0.0055539804,0.00091606297,0.0006079629,0.039137226],"genre_scores_gemma":[0.85711503,0.00090181374,0.1292769,0.0006774859,0.00011418138,0.004204532,0.00026536445,0.00011281486,0.007331852],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9574454,0.035054054,0.0015410617,0.0016862073,0.0037244733,0.00054873154],"domain_scores_gemma":[0.72946894,0.24825758,0.00518044,0.008762739,0.007288941,0.001041423],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02664522,0.0008778442,0.00083229324,0.0009118797,0.0012051585,0.0021639408,0.0013192924,0.0023227911,0.009984899],"category_scores_gemma":[0.09963288,0.0006061904,0.0012181544,0.0009778697,0.003007531,0.002010849,0.0019303757,0.0017009936,0.0009047799],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.018123433,0.023844214,0.043911077,0.0091357855,0.0016411756,0.0013915543,0.028218161,0.107968144,0.061601266,0.0916541,0.008117101,0.604394],"study_design_scores_gemma":[0.0087017715,0.08574948,0.1006707,0.0050776014,0.003601216,0.0013480409,0.025657777,0.16607946,0.24058937,0.18061665,0.18093055,0.0009773906],"about_ca_topic_score_codex":0.0041202023,"about_ca_topic_score_gemma":0.0032501423,"teacher_disagreement_score":0.02664522,"about_ca_system_score_codex":0.0022235096,"about_ca_system_score_gemma":0.0023243662,"threshold_uncertainty_score":0.1409151},"labels":[],"label_agreement":null},{"id":"W1593489106","doi":"10.1002/9781118900772.etrds0284","title":"Repeated Cross‐Sections in Survey Data","year":2015,"lang":"en","type":"other","venue":"Emerging Trends in the Social and Behavioral Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Representativeness heuristic; Smoothing; Sample (material); Population; Noise (video); Econometrics; Computer science; Comparability; Voting; Statistics; Mathematics; Politics; Artificial intelligence; Political science; Demography; Sociology","score_opus":0.6413700468407519,"score_gpt":0.5913505308481036,"score_spread":0.05001951599264831,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1593489106","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039650273,0.003341291,0.93530184,0.0024458477,0.00069760956,0.0010348537,0.007821959,0.00083595986,0.00887046],"genre_scores_gemma":[0.566037,0.0029367413,0.3970713,0.0016409291,0.0011011725,0.0053079706,0.012381837,0.00025031518,0.013272666],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.919751,0.060418364,0.003527186,0.01037018,0.00500961,0.00092367304],"domain_scores_gemma":[0.7369794,0.19378848,0.023574343,0.03835472,0.006470489,0.00083249086],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.061355103,0.0010739363,0.0017297701,0.0044049765,0.0014356655,0.0025294037,0.0033099772,0.002092651,0.015529499],"category_scores_gemma":[0.17365152,0.0012623107,0.0024924574,0.008739917,0.002690666,0.0034409857,0.003191116,0.0032845282,0.0024982495],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043477723,0.0004641422,0.14712967,0.0018515569,0.0030625253,0.0014898692,0.0033116443,0.041187037,0.0004926291,0.5596639,0.024338873,0.21657345],"study_design_scores_gemma":[0.00019570779,0.0005245795,0.06400736,0.000957045,0.0007947655,0.000885035,0.0015584677,0.108748764,0.0018414324,0.741832,0.078463174,0.00019173604],"about_ca_topic_score_codex":0.007229655,"about_ca_topic_score_gemma":0.00607114,"teacher_disagreement_score":0.9386449,"about_ca_system_score_codex":0.0022769212,"about_ca_system_score_gemma":0.0018202135,"threshold_uncertainty_score":0.32448065},"labels":[],"label_agreement":null},{"id":"W1603529668","doi":"10.18438/b8w90x","title":"Cara Bradley Receives Robert H. Blackburn Distinguished Paper Award for Paper Published in EBLIP Journal","year":2014,"lang":"en","type":"article","venue":"Evidence Based Library and Information Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Library science; Computer science","score_opus":0.03978912817808283,"score_gpt":0.3383699424486019,"score_spread":0.2985808142705191,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1603529668","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011087043,0.015804823,0.0034824584,0.48416036,0.18817356,0.0002531906,0.0019899728,0.0004824604,0.30454445],"genre_scores_gemma":[0.014917043,0.016476687,0.0040083374,0.020930152,0.024885884,0.00008665732,0.0012557475,0.00048693383,0.9169526],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9921394,0.00093948684,0.00031594172,0.0008703894,0.0051731043,0.00056169555],"domain_scores_gemma":[0.9107283,0.01585155,0.0019012173,0.0032457346,0.049352713,0.018920515],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0102749625,0.00072525034,0.0021526322,0.0038394583,0.0035178747,0.008880034,0.0018669919,0.0058685727,0.28129008],"category_scores_gemma":[0.06633283,0.00046744075,0.0009905424,0.003162906,0.0015383126,0.0036593876,0.0029035416,0.0047883657,0.1281313],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000056347224,0.000026047923,0.00014485767,0.000077389566,0.000010948354,0.00007237411,0.000035124092,0.00003218287,0.000099412915,0.008256308,0.9624834,0.028705552],"study_design_scores_gemma":[0.000020100466,0.000032094085,0.00038256953,0.00008203707,0.000016460483,0.00015244735,0.00012667409,0.0001416556,0.0002882098,0.0044219745,0.9943183,0.000017424607],"about_ca_topic_score_codex":0.008228529,"about_ca_topic_score_gemma":0.02719543,"teacher_disagreement_score":0.28129008,"about_ca_system_score_codex":0.0065094084,"about_ca_system_score_gemma":0.012410704,"threshold_uncertainty_score":0.9410091},"labels":[],"label_agreement":null},{"id":"W1616123277","doi":"10.1002/cncr.28359","title":"Which of these things is not like the others?","year":2013,"lang":"en","type":"article","venue":"Cancer","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":112,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Medicine; Epidemiology; Subgroup analysis; Pathology; Meta-analysis","score_opus":0.12941733138142505,"score_gpt":0.4024220275477411,"score_spread":0.27300469616631606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1616123277","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006656657,0.033620875,0.07721103,0.8459118,0.01283562,0.00008002548,0.0009483537,0.0003148334,0.022420842],"genre_scores_gemma":[0.35124734,0.06594793,0.117739685,0.40147215,0.038955916,0.0003667245,0.001028698,0.0008693499,0.022372292],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98157173,0.008180691,0.0014600533,0.0036118198,0.004253654,0.0009220911],"domain_scores_gemma":[0.9017957,0.05904711,0.0104284,0.012778531,0.012769718,0.0031806522],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043865133,0.0010587742,0.0025952032,0.002433691,0.0026933863,0.0057591596,0.0038290604,0.006511135,0.014756387],"category_scores_gemma":[0.15233365,0.00059902295,0.0026467573,0.0028142866,0.019624619,0.025568075,0.003721129,0.014184676,0.004991699],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007054386,0.00013137772,0.010074712,0.0026587667,0.0011265418,0.0005672268,0.0017822398,0.0013619773,0.00088201684,0.6930043,0.14309959,0.14460586],"study_design_scores_gemma":[0.000060594277,0.00005361893,0.0018891699,0.0009182063,0.00015343215,0.00048800829,0.0012697199,0.0005751898,0.00030523553,0.94851285,0.045690916,0.000083037274],"about_ca_topic_score_codex":0.0050404784,"about_ca_topic_score_gemma":0.007341735,"teacher_disagreement_score":0.043865133,"about_ca_system_score_codex":0.0023539874,"about_ca_system_score_gemma":0.0035455802,"threshold_uncertainty_score":0.23198372},"labels":[],"label_agreement":null},{"id":"W1658181916","doi":"10.3747/co.v0i0.340","title":"Panel Discussion 2","year":2008,"lang":"en","type":"article","venue":"Current Oncology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Medicine; Data science; Computer science","score_opus":0.6308189263392884,"score_gpt":0.5414606696635275,"score_spread":0.08935825667576092,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1658181916","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00072361424,0.0007609304,0.00054948754,0.91794103,0.03082589,0.00028450112,0.0032891806,0.00008463494,0.04554076],"genre_scores_gemma":[0.0033063334,0.00030034207,0.00038307495,0.9401459,0.009447404,0.00054191967,0.00046683569,0.000049557886,0.045358695],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9871837,0.003160625,0.00061047764,0.0027261365,0.003387223,0.0029318037],"domain_scores_gemma":[0.94762933,0.03596066,0.0013858471,0.0025568767,0.009436881,0.0030304517],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024972765,0.0014900175,0.0023125317,0.0019567152,0.008877147,0.013225379,0.0057265665,0.07342348,0.14781617],"category_scores_gemma":[0.08327108,0.0013847194,0.0037929977,0.0025184099,0.0030206766,0.006946943,0.0053702523,0.043506466,0.049576383],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004535229,0.000017084814,0.00016942447,0.00005237904,0.000011309952,0.0000618802,0.00007275038,0.000053277923,0.000083484316,0.0056968997,0.9917651,0.0019712027],"study_design_scores_gemma":[0.00023003525,0.00003013857,0.002498324,0.0005533668,0.00011152298,0.00008374045,0.0008504267,0.0002330229,0.00048665708,0.017336324,0.97751015,0.000076350305],"about_ca_topic_score_codex":0.025425658,"about_ca_topic_score_gemma":0.04361413,"teacher_disagreement_score":0.14781617,"about_ca_system_score_codex":0.006796782,"about_ca_system_score_gemma":0.013334838,"threshold_uncertainty_score":0.49449432},"labels":[],"label_agreement":null},{"id":"W1683369961","doi":"10.1111/biom.12269","title":"On Bayesian Estimation of Marginal Structural Models","year":2015,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; University of Toronto","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Censoring (clinical trials); Marginal structural model; Inverse probability; Bayesian probability; Weighting; Bayesian inference; Posterior probability; Inverse probability weighting; Statistics; Inference; Covariate; Marginal likelihood; Population; Econometrics; Computer science; Marginal distribution; Mathematics; Confounding; Estimator; Artificial intelligence; Medicine; Random variable","score_opus":0.2902512635374343,"score_gpt":0.4371757447731041,"score_spread":0.1469244812356698,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1683369961","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024828708,0.00015486577,0.99635637,0.00022936186,0.000014213294,0.000046863788,0.000062829684,0.000063587286,0.0005890039],"genre_scores_gemma":[0.17879559,0.0013206874,0.814623,0.00032409068,0.00021172431,0.0011690375,0.00065095595,0.00017019504,0.002734707],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9838378,0.0133541785,0.0003936086,0.0008925228,0.0012079634,0.0003139567],"domain_scores_gemma":[0.93753654,0.056346226,0.0016699133,0.002782877,0.0013733627,0.00029108868],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02640595,0.0014255343,0.0022047542,0.0025212958,0.0010669418,0.0021889429,0.003537703,0.0017604931,0.0049982583],"category_scores_gemma":[0.10295958,0.0014156698,0.0018413996,0.0031774412,0.0033048228,0.0034095629,0.0032861584,0.0045608026,0.0007411216],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000088502704,0.00006228559,0.0017700805,0.00019434767,0.00017748779,0.00010930502,0.00036987817,0.23136346,0.00036676432,0.7042312,0.0015063636,0.059760306],"study_design_scores_gemma":[0.000031965064,0.00002385724,0.00040825343,0.000060768347,0.000031144446,0.000035544268,0.00003468134,0.43554384,0.00017633056,0.5620187,0.001612656,0.000022317849],"about_ca_topic_score_codex":0.010276587,"about_ca_topic_score_gemma":0.011287323,"teacher_disagreement_score":0.02640595,"about_ca_system_score_codex":0.0023573472,"about_ca_system_score_gemma":0.003478312,"threshold_uncertainty_score":0.13964963},"labels":[],"label_agreement":null},{"id":"W1691896301","doi":"10.1111/j.1365-2966.2007.00428.x","title":"Viewpoint: Replication in economics","year":2007,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":275,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Replication (statistics); Incentive; Work (physics); Positive economics; Computer science; Economics; Biology; Microeconomics","score_opus":0.3158663132890136,"score_gpt":0.28711981340215564,"score_spread":0.028746499886857957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1691896301","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005520999,0.05187108,0.27536628,0.4933173,0.03171669,0.00076243456,0.0009312195,0.00056625856,0.13994774],"genre_scores_gemma":[0.5623304,0.029305454,0.1692837,0.14569592,0.049233906,0.0032980042,0.0005836599,0.0006599431,0.03960891],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8000734,0.1320417,0.008427947,0.026127672,0.030935004,0.0023943088],"domain_scores_gemma":[0.59024745,0.26161677,0.016803874,0.101876326,0.026709272,0.0027463203],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17475685,0.0014435841,0.0041591735,0.004771281,0.0044993493,0.011299127,0.0060070856,0.014879088,0.016615119],"category_scores_gemma":[0.3404649,0.0011482483,0.0034940357,0.0033109635,0.05860931,0.028821187,0.0066842246,0.018741824,0.0035430607],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004426929,0.000011628836,0.00026715556,0.00042140155,0.00010013441,0.00011021595,0.00056354515,0.00044640867,0.00007047197,0.9755677,0.012517101,0.009880024],"study_design_scores_gemma":[0.000044663026,0.000023224165,0.00012513208,0.0003535236,0.000030609506,0.0001301448,0.000115542876,0.000721986,0.00011470539,0.96680486,0.03151242,0.000023240516],"about_ca_topic_score_codex":0.0034927293,"about_ca_topic_score_gemma":0.0015338996,"teacher_disagreement_score":0.8252431,"about_ca_system_score_codex":0.008782342,"about_ca_system_score_gemma":0.010227308,"threshold_uncertainty_score":0.92421365},"labels":[],"label_agreement":null},{"id":"W1746442198","doi":"10.1111/ssqu.12074","title":"A General Approach to Effect Decomposition","year":2014,"lang":"en","type":"article","venue":"Social Science Quarterly","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria; Statistics Canada","funders":"","keywords":"Covariate; Mediation; Decomposition; Path analysis (statistics); Outcome (game theory); Econometrics; Simple (philosophy); Psychology; Regression analysis; Computer science; Mathematics; Statistics; Sociology; Social science; Epistemology; Mathematical economics","score_opus":0.049040049093019136,"score_gpt":0.41327736973003937,"score_spread":0.36423732063702025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1746442198","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003341294,0.00023511396,0.9951756,0.000450506,0.000085935484,0.00018342592,0.0002031591,0.00015125128,0.003180916],"genre_scores_gemma":[0.022534534,0.0005730441,0.97028786,0.0004926193,0.00018315956,0.0022882537,0.00032354708,0.00017078813,0.003146238],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9711349,0.019299636,0.0014477526,0.00463854,0.0028611384,0.0006179649],"domain_scores_gemma":[0.9765994,0.01606255,0.0010701582,0.0035705331,0.00245705,0.00024029755],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033865433,0.0033299003,0.0023178768,0.004138018,0.0014138159,0.004963354,0.0038017158,0.001990848,0.023968503],"category_scores_gemma":[0.0542872,0.001692628,0.0066087595,0.0050200275,0.003985589,0.0050284043,0.004726426,0.005281439,0.0039811884],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005280132,0.000055413144,0.0009267224,0.00047202397,0.00032575725,0.0000913678,0.00078405254,0.005924099,0.00043406617,0.90944284,0.0045732856,0.07691757],"study_design_scores_gemma":[0.000056781282,0.00006249582,0.0005080552,0.000246641,0.00014915927,0.000107537795,0.00018350192,0.021094562,0.00035540087,0.94800025,0.029204711,0.00003091375],"about_ca_topic_score_codex":0.0043820683,"about_ca_topic_score_gemma":0.0027959263,"teacher_disagreement_score":0.033865433,"about_ca_system_score_codex":0.0022785258,"about_ca_system_score_gemma":0.006858563,"threshold_uncertainty_score":0.17909968},"labels":[],"label_agreement":null},{"id":"W1773473668","doi":"10.1186/1742-7622-3-5","title":"Causal criteria and counterfactuals; nothing more (or less) than scientific common sense","year":2006,"lang":"en","type":"article","venue":"Emerging Themes in Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Counterfactual thinking; Counterfactual conditional; Causation; Common sense; Epistemology; Causality (physics); Set (abstract data type); Consilience; Scientific method; Nothing; Scientific evidence; Computer science; Philosophy","score_opus":0.23304713007442762,"score_gpt":0.47796856405748694,"score_spread":0.24492143398305932,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1773473668","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0071110283,0.024501348,0.8017666,0.11441928,0.0027835688,0.0001685879,0.00043940236,0.00024946872,0.048560705],"genre_scores_gemma":[0.5384789,0.017216543,0.39206707,0.031417094,0.007528762,0.0017211244,0.0005924219,0.00042481135,0.010553249],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9351084,0.04535086,0.002752578,0.005420245,0.010365478,0.0010023348],"domain_scores_gemma":[0.8263992,0.14375167,0.007956208,0.014168878,0.00630479,0.001419165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06846395,0.0016695132,0.0035444128,0.00714309,0.0030735268,0.0103019,0.0036141565,0.0064124255,0.0071652033],"category_scores_gemma":[0.119232036,0.0010970336,0.0026425086,0.004937378,0.056118906,0.028726442,0.006323721,0.0120763155,0.0011198369],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000008454208,0.000004875895,0.00012857176,0.000073545816,0.000022621098,0.0000151551685,0.00017456249,0.00027533708,0.000016335653,0.99572635,0.0009370862,0.0026170257],"study_design_scores_gemma":[0.000008790073,0.0000062042186,0.00007016098,0.00006014852,0.000008810911,0.000028993783,0.00006403204,0.0004696989,0.00003473565,0.9938403,0.005400417,0.000007831365],"about_ca_topic_score_codex":0.0021130412,"about_ca_topic_score_gemma":0.0012773223,"teacher_disagreement_score":0.06846395,"about_ca_system_score_codex":0.004872365,"about_ca_system_score_gemma":0.00470629,"threshold_uncertainty_score":0.36207628},"labels":[],"label_agreement":null},{"id":"W1775522749","doi":"10.1186/1471-2288-5-5","title":"Comparison of nested case-control and survival analysis methodologies for analysis of time-dependent exposure","year":2005,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":235,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"Canadian Institutes of Health Research; McGill University","keywords":"Nested case-control study; Covariate; Proportional hazards model; Statistics; Regression analysis; Cohort; Nested set model; Cohort study; Regression; Medicine; Survival analysis; Econometrics; Mathematics; Computer science; Data mining","score_opus":0.7964481715181267,"score_gpt":0.6724582142401484,"score_spread":0.12398995727797835,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1775522749","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016691064,0.0005237297,0.9817462,0.0001406777,0.000073823925,0.00034300875,0.000076122466,0.00017043251,0.00023499125],"genre_scores_gemma":[0.14370118,0.00071659015,0.8531851,0.00011511733,0.000057577963,0.0015447858,0.0002938965,0.00009323738,0.00029243858],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9679602,0.026303396,0.0010018452,0.0016547387,0.0028384249,0.0002413922],"domain_scores_gemma":[0.82483166,0.15087236,0.006536686,0.009324895,0.00747036,0.00096402643],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.058339696,0.0008930567,0.0013494355,0.0018938729,0.00038799192,0.00095505285,0.0021913992,0.0008162375,0.0025499444],"category_scores_gemma":[0.1783362,0.00081986137,0.0020610373,0.0009835023,0.0010262785,0.0013147008,0.0015455091,0.0014204964,0.00037839814],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0057166973,0.0012357255,0.06303276,0.0025185298,0.008496619,0.00090941327,0.00275425,0.257364,0.018384358,0.15334263,0.0036383397,0.48260665],"study_design_scores_gemma":[0.0014407947,0.0016641073,0.015021432,0.00029633386,0.0011998187,0.0010100635,0.00027045692,0.8504319,0.0068536336,0.11532601,0.006315462,0.00016998817],"about_ca_topic_score_codex":0.0025664675,"about_ca_topic_score_gemma":0.002421038,"teacher_disagreement_score":0.9416603,"about_ca_system_score_codex":0.0009750568,"about_ca_system_score_gemma":0.002486662,"threshold_uncertainty_score":0.3085335},"labels":[],"label_agreement":null},{"id":"W1826708385","doi":"10.1007/978-3-642-57615-7_4","title":"Evaluating profiling as a means of allocating government services","year":2001,"lang":"en","type":"book-chapter","venue":"ZEW economic studies","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":76,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Profiling (computer programming); CLARITY; Equity (law); Racial profiling; Actuarial science; Computer science; Business; Political science; Law; Sociology","score_opus":0.31366495377120945,"score_gpt":0.4627022160364899,"score_spread":0.14903726226528047,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1826708385","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7446767,0.0013442565,0.23239127,0.0036363248,0.00008342241,0.00039476162,0.0006539503,0.0002825871,0.016536683],"genre_scores_gemma":[0.97558254,0.00020574914,0.023030773,0.000080504156,0.000026135724,0.00006585401,0.00014943736,0.000009996737,0.00084900344],"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","domain_scores_codex":[0.9802059,0.016329411,0.0004790908,0.0010176515,0.0013860572,0.00058188004],"domain_scores_gemma":[0.92128587,0.06239253,0.009826021,0.0034747114,0.002335325,0.0006856149],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022189794,0.00076420023,0.0008741082,0.0017408635,0.00068328716,0.0024575968,0.00093016814,0.0010250654,0.003002083],"category_scores_gemma":[0.084003106,0.00029097227,0.00049432565,0.0019614103,0.0012547073,0.0032200343,0.001596701,0.0011906889,0.00023653713],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012801327,0.0010326986,0.24458206,0.00025872453,0.00042988235,0.000125467,0.001039456,0.31771857,0.0009394509,0.14042875,0.0025735337,0.2895912],"study_design_scores_gemma":[0.00012519896,0.0010171797,0.06065456,0.00015414649,0.00016179422,0.000049297272,0.001156739,0.83397645,0.0032313713,0.09518015,0.0042200973,0.00007298321],"about_ca_topic_score_codex":0.008970987,"about_ca_topic_score_gemma":0.008625226,"teacher_disagreement_score":0.022189794,"about_ca_system_score_codex":0.002974444,"about_ca_system_score_gemma":0.0027362993,"threshold_uncertainty_score":0.11735225},"labels":[],"label_agreement":null},{"id":"W1828732580","doi":"10.6000/1929-6029.2015.04.03.1","title":"Assessment of the Performance of Imputation Techniques in Observational Studies with Two Measurements","year":2015,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Euskal Herriko Unibertsitatea; Eusko Jaurlaritza","keywords":"Missing data; Statistics; Imputation (statistics); Markov chain Monte Carlo; Observational study; Propensity score matching; Sample size determination; Econometrics; Monte Carlo method; Mathematics","score_opus":0.6416042088483054,"score_gpt":0.6419404073228557,"score_spread":0.00033619847455035323,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1828732580","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15373288,0.011057544,0.82580465,0.0016197952,0.00041751252,0.0024361643,0.0018122207,0.00082099636,0.0022981623],"genre_scores_gemma":[0.5406044,0.0021915303,0.45174757,0.00042646925,0.00016980972,0.002948772,0.0011886287,0.00019072622,0.0005320669],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.75543356,0.21323912,0.013229409,0.007029166,0.010058723,0.0010100009],"domain_scores_gemma":[0.32767117,0.604445,0.030087328,0.023029374,0.013844929,0.00092220993],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.30562538,0.0015602405,0.0024177306,0.0030184803,0.0011174205,0.0021812797,0.0023152716,0.0035628967,0.0019781732],"category_scores_gemma":[0.4772981,0.0009190237,0.005859033,0.0044999537,0.0016371531,0.0025044803,0.0027030625,0.0025949404,0.00042442573],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008482501,0.000598813,0.41882327,0.008654515,0.028242204,0.0013107762,0.004173324,0.1684113,0.0035528932,0.016151555,0.004364213,0.33723465],"study_design_scores_gemma":[0.0012388221,0.007652266,0.18603441,0.0034751196,0.009874633,0.003003384,0.0013612418,0.7373487,0.0076124477,0.028072042,0.013737836,0.00058910163],"about_ca_topic_score_codex":0.0019440175,"about_ca_topic_score_gemma":0.0014894501,"teacher_disagreement_score":0.6943746,"about_ca_system_score_codex":0.001012618,"about_ca_system_score_gemma":0.0022088995,"threshold_uncertainty_score":0.85628754},"labels":[],"label_agreement":null},{"id":"W1839338819","doi":"10.1111/peps.12020","title":"Balancing Treatment and Control Groups in Quasi‐Experiments: An Introduction to Propensity Scoring","year":2012,"lang":"en","type":"article","venue":"Personnel Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Propensity score matching; Causal inference; Covariate; Matching (statistics); Psychology; Average treatment effect; Inference; Coaching; Econometrics; Statistics; Computer science; Artificial intelligence; Mathematics","score_opus":0.18058103285990598,"score_gpt":0.4453034020683257,"score_spread":0.26472236920841974,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1839338819","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003944961,0.0016476379,0.99361974,0.0012949057,0.00036351295,0.000801038,0.00015171725,0.00016802683,0.0015588382],"genre_scores_gemma":[0.009876717,0.0023500358,0.98060834,0.0009732284,0.00058297755,0.004641254,0.0001150471,0.00010257171,0.00074981863],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85142726,0.13238278,0.0043083713,0.0039493404,0.0074205096,0.00051172543],"domain_scores_gemma":[0.7719751,0.20649324,0.005065385,0.011906636,0.0038467338,0.0007129021],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13206767,0.0020063166,0.0028947073,0.004285906,0.0017055033,0.0034034438,0.003512892,0.0054584565,0.009955022],"category_scores_gemma":[0.18017508,0.0015966523,0.0035230166,0.006146901,0.009041194,0.0054708235,0.0031223854,0.009148678,0.0015377429],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000113169146,0.0001744154,0.0017222262,0.0017562895,0.00044721548,0.00015623689,0.001673102,0.0077504315,0.0008595767,0.79329467,0.010420413,0.18163235],"study_design_scores_gemma":[0.00025054303,0.00036060135,0.0014342782,0.0010733153,0.0001853984,0.0002673171,0.00019874494,0.037508477,0.0009697752,0.88272655,0.0748518,0.00017322562],"about_ca_topic_score_codex":0.0018221108,"about_ca_topic_score_gemma":0.002290151,"teacher_disagreement_score":0.8679323,"about_ca_system_score_codex":0.0029080855,"about_ca_system_score_gemma":0.0038271968,"threshold_uncertainty_score":0.6984489},"labels":[],"label_agreement":null},{"id":"W1856101391","doi":"10.1177/0272989x15600708","title":"Does Introducing Imprecision around Probabilities for Benefit and Harm Influence the Way People Value Treatments?","year":2015,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre for Advancing Health Outcomes; St. Paul's Hospital; University of British Columbia; Memorial University of Newfoundland","funders":"","keywords":"Harm; Population; Actuarial science; Value (mathematics); Confidence interval; Sample (material); Psychology; Medicine; Econometrics; Statistics; Social psychology; Mathematics; Economics; Environmental health","score_opus":0.08853594138880048,"score_gpt":0.41667049148711355,"score_spread":0.32813455009831305,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1856101391","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80330276,0.005248404,0.13302268,0.02459744,0.00045813865,0.0017257386,0.0009768261,0.00014604728,0.03052199],"genre_scores_gemma":[0.9709113,0.0010021578,0.024483465,0.0024508513,0.00010214048,0.0005946219,0.00006543726,0.000019967061,0.0003699777],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8550744,0.121090904,0.004484725,0.0041275565,0.013781752,0.0014407199],"domain_scores_gemma":[0.42971367,0.5015197,0.0430721,0.015916478,0.008644653,0.0011334186],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13100553,0.00075706636,0.0012865487,0.0012375932,0.0012668557,0.0057834396,0.0015504136,0.0025082808,0.0044531506],"category_scores_gemma":[0.30746415,0.00072563684,0.0021837896,0.0010626687,0.010060995,0.00525097,0.0024547952,0.0039074114,0.00034072043],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012558836,0.0023314513,0.33933455,0.0075843064,0.005112803,0.00064758613,0.09768721,0.020736625,0.0077633215,0.11573616,0.0043293564,0.38617787],"study_design_scores_gemma":[0.0035882175,0.012011284,0.37086606,0.010407731,0.006234279,0.0014852339,0.0420097,0.054374527,0.020352125,0.4137439,0.06301618,0.0019108099],"about_ca_topic_score_codex":0.011032674,"about_ca_topic_score_gemma":0.0067408797,"teacher_disagreement_score":0.13100553,"about_ca_system_score_codex":0.0067276205,"about_ca_system_score_gemma":0.0053948998,"threshold_uncertainty_score":0.69283175},"labels":[],"label_agreement":null},{"id":"W1874471881","doi":"","title":"Outcome evaluation of an early psychosis program using pre-post comparison and propensity matching","year":2005,"lang":"en","type":"dissertation","venue":"Memorial University Research Repository (Memorial University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Propensity score matching; Matching (statistics); Population; Quality of life (healthcare); Psychosis; Psychology; Medicine; Outcome (game theory); Psychiatry; Clinical psychology; Gerontology; Environmental health; Nursing; Surgery","score_opus":0.2370272762245498,"score_gpt":0.4585523490014368,"score_spread":0.22152507277688702,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1874471881","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95539373,0.00047484753,0.032307584,0.00057622057,0.00035169444,0.0061679496,0.0015592445,0.000125644,0.0030430509],"genre_scores_gemma":[0.9792054,0.00012617484,0.012836285,0.00014634723,0.00007529481,0.005798958,0.0008164255,0.000017349692,0.0009778148],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9705052,0.021155821,0.0023514326,0.001705421,0.003252363,0.001029795],"domain_scores_gemma":[0.9602828,0.01816073,0.011285921,0.0053875633,0.0037834425,0.0010995676],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033893026,0.00066956674,0.0012208818,0.0017997125,0.00089418824,0.00094779965,0.0012427678,0.0009553782,0.005074035],"category_scores_gemma":[0.05795178,0.000276488,0.0031908264,0.0016770444,0.0007839776,0.0014077981,0.0014362569,0.0014232195,0.00044741458],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.05551038,0.014215783,0.6798169,0.0014503021,0.007528633,0.00028277872,0.0014909595,0.0063876216,0.0015769793,0.009890022,0.006052664,0.21579695],"study_design_scores_gemma":[0.008348947,0.12437456,0.758911,0.0003908903,0.006912137,0.00040060445,0.0023573206,0.06501051,0.011031189,0.012390616,0.009610212,0.00026199647],"about_ca_topic_score_codex":0.0017767475,"about_ca_topic_score_gemma":0.0011843396,"teacher_disagreement_score":0.033893026,"about_ca_system_score_codex":0.0015501574,"about_ca_system_score_gemma":0.0025604286,"threshold_uncertainty_score":0.17924565},"labels":[],"label_agreement":null},{"id":"W1888549093","doi":"10.1515/jci-2015-0021","title":"Design and Analysis of Experiments in Networks: Reducing Bias from Interference","year":2016,"lang":"en","type":"preprint","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":50,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Stanford Graduate School of Business; University of California, Davis; York University; Carnegie Mellon University; Johns Hopkins University","keywords":"Estimator; Computer science; Random assignment; Cluster analysis; Graph; Randomized experiment; Interference (communication); Machine learning; Theoretical computer science; Mathematics; Statistics","score_opus":0.2956729877312846,"score_gpt":0.4513108218755544,"score_spread":0.1556378341442698,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1888549093","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008528804,0.00029003754,0.9888861,0.0008442417,0.000047391277,0.0002980029,0.00004483007,0.00011665032,0.00094400067],"genre_scores_gemma":[0.33844745,0.0005056602,0.65680164,0.0008342422,0.00020042829,0.0023537246,0.00011895316,0.000092768656,0.0006451989],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.78679365,0.1908691,0.0038614573,0.0079278145,0.009360465,0.0011875578],"domain_scores_gemma":[0.37042153,0.5700967,0.02243803,0.02862072,0.006865583,0.0015573909],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.124103084,0.0015130976,0.003092594,0.0019768756,0.0012075681,0.003516688,0.003408027,0.003022561,0.0030798232],"category_scores_gemma":[0.39197946,0.0014275801,0.002087872,0.0018886944,0.00747146,0.004882657,0.0051251194,0.004714157,0.00042100402],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015456564,0.00043302227,0.008850582,0.0015403382,0.0012625948,0.00022464739,0.0011452411,0.34727362,0.0034483105,0.5030957,0.0016364439,0.12954387],"study_design_scores_gemma":[0.000532638,0.00050794194,0.0013209176,0.00026257607,0.00019922522,0.00006142386,0.00007119939,0.34358177,0.0025342116,0.6481791,0.0027028613,0.000046026547],"about_ca_topic_score_codex":0.0010162484,"about_ca_topic_score_gemma":0.0007307857,"teacher_disagreement_score":0.87589693,"about_ca_system_score_codex":0.0032710573,"about_ca_system_score_gemma":0.0051124752,"threshold_uncertainty_score":0.6563277},"labels":[],"label_agreement":null},{"id":"W1902826538","doi":"10.1111/j.1540-5982.2010.01622.x","title":"Viewpoint: An extended class of instrumental variables for the estimation of causal effects","year":2011,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Endogeneity; Instrumental variable; Econometrics; Identification (biology); Covariate; Class (philosophy); Estimation; Causal model; Contrast (vision); Causality (physics); Mathematics; Economics; Statistics; Computer science; Artificial intelligence","score_opus":0.2702152426523947,"score_gpt":0.2734589607369842,"score_spread":0.0032437180845895086,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1902826538","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026668767,0.00013442991,0.99478394,0.00032212463,0.000029367246,0.000044687466,0.00014124939,0.000081632876,0.0017956906],"genre_scores_gemma":[0.34897944,0.0012821519,0.6402439,0.0008275306,0.0005876443,0.00095864304,0.00096499606,0.0002887221,0.005866946],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9896069,0.0072303303,0.0003875849,0.0011168041,0.0013370141,0.0003214307],"domain_scores_gemma":[0.95327884,0.03676225,0.002849855,0.005066974,0.0016683281,0.0003737152],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01767411,0.0012578568,0.0015285303,0.0028626008,0.00084638014,0.0026744772,0.0030585711,0.0014130265,0.009646308],"category_scores_gemma":[0.068270534,0.0009096144,0.002394585,0.0024232666,0.003980625,0.003403295,0.0037411777,0.004484466,0.0009975462],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002907855,0.000036880927,0.0013869789,0.000097159784,0.00012687017,0.000065339074,0.00013376107,0.02210796,0.0003302577,0.9568778,0.0007996831,0.018008204],"study_design_scores_gemma":[0.000045073342,0.000042868338,0.0005804922,0.00009485086,0.000057547022,0.000044382883,0.00003794445,0.15170416,0.0006141376,0.841548,0.0052072867,0.000023320761],"about_ca_topic_score_codex":0.0020783728,"about_ca_topic_score_gemma":0.0015891569,"teacher_disagreement_score":0.01767411,"about_ca_system_score_codex":0.0014039422,"about_ca_system_score_gemma":0.0027711908,"threshold_uncertainty_score":0.09347069},"labels":[],"label_agreement":null},{"id":"W1904240997","doi":"10.1186/1742-5573-3-2","title":"Causal analysis of case-control data","year":2006,"lang":"en","type":"article","venue":"Epidemiologic Perspectives & Innovations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; University of Alberta Hospital; University of Alberta","funders":"","keywords":"Computer science; Counterfactual thinking; Marginal structural model; Inverse probability; Weighting; Inverse probability weighting; Estimation; Data mining; Econometrics; Statistics; Causal inference; Artificial intelligence; Medicine; Mathematics; Bayesian probability; Estimator","score_opus":0.2722278384757412,"score_gpt":0.4688558202934981,"score_spread":0.19662798181775687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1904240997","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006958439,0.0031600487,0.9835792,0.0024299084,0.00044801735,0.0008527658,0.0007197147,0.00017793829,0.001674014],"genre_scores_gemma":[0.3184341,0.0058040326,0.6579774,0.0032108044,0.0012086645,0.0082223825,0.002690804,0.00012094,0.0023308874],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82105505,0.15358542,0.0041080415,0.008748716,0.011564924,0.00093790627],"domain_scores_gemma":[0.63006926,0.32832944,0.012133663,0.022929665,0.0060295174,0.0005084398],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12749314,0.0011896883,0.0027550443,0.0071389824,0.0015357967,0.0024368626,0.0033403914,0.0023226487,0.0064312615],"category_scores_gemma":[0.34940973,0.0010164024,0.0031136656,0.007997427,0.0036730291,0.003500109,0.0036254213,0.0037256216,0.00057272916],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047218052,0.00041029314,0.023498856,0.0025292982,0.0044786218,0.00065824814,0.0015975804,0.014949104,0.00042598383,0.73118263,0.006948254,0.21284895],"study_design_scores_gemma":[0.0003681081,0.00024624317,0.0050782016,0.00060731673,0.0009204318,0.0004487358,0.00033334416,0.04765485,0.0007062925,0.9267849,0.01678348,0.00006805755],"about_ca_topic_score_codex":0.0029251669,"about_ca_topic_score_gemma":0.001440484,"teacher_disagreement_score":0.12749314,"about_ca_system_score_codex":0.002073938,"about_ca_system_score_gemma":0.0029191968,"threshold_uncertainty_score":0.6742562},"labels":[],"label_agreement":null},{"id":"W1932363030","doi":"10.1186/s12874-015-0081-3","title":"Statistical power in parallel group point exposure studies with time-to-event outcomes: an empirical comparison of the performance of randomized controlled trials and the inverse probability of treatment weighting (IPTW) approach","year":2015,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; McGill University; Heart and Stroke Foundation of Canada","keywords":"Observational study; Statistical power; Inverse probability; Statistics; Marginal structural model; Randomized controlled trial; Weighting; Power analysis; Inverse probability weighting; Propensity score matching; Sample size determination; Computer science; Mathematics; Econometrics; Medicine; Algorithm; Posterior probability; Bayesian probability; Internal medicine","score_opus":0.7529466825685419,"score_gpt":0.6219541855890501,"score_spread":0.13099249697949178,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1932363030","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.048281826,0.02400884,0.9087942,0.0050444333,0.0011794989,0.005415333,0.0004010927,0.00035555757,0.0065191654],"genre_scores_gemma":[0.6552216,0.006081315,0.32070887,0.0022588675,0.0007030224,0.013679807,0.0003822633,0.00036011176,0.00060407206],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.30025277,0.6456198,0.018520566,0.0123642385,0.02201644,0.0012261329],"domain_scores_gemma":[0.052861884,0.90481627,0.019362649,0.017987538,0.004386585,0.0005850111],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.58810383,0.0026509229,0.0075658937,0.006890597,0.0012180761,0.00571589,0.0059932014,0.008492724,0.0063763396],"category_scores_gemma":[0.86099774,0.0017233668,0.012333643,0.0060144495,0.012167225,0.012904913,0.0074398075,0.00773552,0.00053802074],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.022881093,0.0011851366,0.04273148,0.02347331,0.058304366,0.00074108667,0.0052008643,0.14765833,0.001409344,0.33651307,0.0057553328,0.35414666],"study_design_scores_gemma":[0.009974327,0.008961805,0.01877856,0.008599059,0.014826368,0.0010924462,0.00071477983,0.26440936,0.002629819,0.6578789,0.011730272,0.000404251],"about_ca_topic_score_codex":0.00091670494,"about_ca_topic_score_gemma":0.00039227807,"teacher_disagreement_score":0.41189617,"about_ca_system_score_codex":0.004613972,"about_ca_system_score_gemma":0.0053159404,"threshold_uncertainty_score":0.50794137},"labels":[],"label_agreement":null},{"id":"W1935711966","doi":"10.1080/01621459.2012.665615","title":"Comment","year":2012,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute on Drug Abuse; National Institute of Mental Health","keywords":"Mathematics","score_opus":0.08176577088976356,"score_gpt":0.42506965710657935,"score_spread":0.3433038862168158,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1935711966","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012747062,0.00080305705,0.0037077565,0.78449184,0.09776777,0.00038721864,0.010306581,0.006104878,0.09515618],"genre_scores_gemma":[0.009714755,0.0009703371,0.0029492087,0.73339504,0.014983645,0.0006075951,0.0028024425,0.0017357154,0.2328413],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9969111,0.00043274648,0.00033468896,0.0003464999,0.0015968488,0.00037809488],"domain_scores_gemma":[0.9792514,0.007043455,0.0009656939,0.0014817591,0.010018552,0.0012392254],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038197576,0.0006468734,0.0005987672,0.0010293116,0.0016267202,0.0020977128,0.0026043358,0.010753941,0.37421292],"category_scores_gemma":[0.06645735,0.0004514393,0.001145927,0.00084602943,0.0013817402,0.003534729,0.002306267,0.006784301,0.21708417],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026636244,0.000006082719,0.000117013195,0.00003497847,0.0000017059627,0.000035521716,0.000028331211,0.000013257858,0.00005645355,0.00055302435,0.99544877,0.0036780986],"study_design_scores_gemma":[0.0000554008,0.000015047848,0.0006832512,0.00018730789,0.000006428386,0.0001625752,0.00018824679,0.00009500289,0.00046177418,0.0017366577,0.9963819,0.00002639922],"about_ca_topic_score_codex":0.01947837,"about_ca_topic_score_gemma":0.014832637,"teacher_disagreement_score":0.37421292,"about_ca_system_score_codex":0.0024767017,"about_ca_system_score_gemma":0.0029211934,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W1943072312","doi":"10.1177/0962280215601134","title":"Estimating the effect of treatment on binary outcomes using full matching on the propensity score","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":125,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Mental Health","keywords":"Propensity score matching; Covariate; Confounding; Matching (statistics); Average treatment effect; Inverse probability weighting; Calipers; Statistics; Weighting; Binary number; Mathematics; Computer science; Medicine","score_opus":0.6971779961484548,"score_gpt":0.6699345220452536,"score_spread":0.02724347410320116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1943072312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026127398,0.00094398606,0.9679213,0.00088008476,0.00010902034,0.0012560352,0.00048043806,0.00029799002,0.0019837227],"genre_scores_gemma":[0.35036018,0.0013477575,0.6417786,0.00076114334,0.00015594494,0.0034335714,0.00077741564,0.000105850435,0.001279367],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94147825,0.04940484,0.0020333107,0.0030027376,0.0036091988,0.0004716393],"domain_scores_gemma":[0.86460394,0.11133538,0.007247235,0.014529067,0.0018503134,0.0004340702],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.077549085,0.0012351837,0.0029377188,0.002966739,0.0011341836,0.0019258498,0.0026633877,0.001744889,0.0072856555],"category_scores_gemma":[0.2152091,0.00086679583,0.0042689317,0.003563293,0.0023926117,0.0033411537,0.0037545946,0.0027992812,0.0007214517],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021090398,0.0008776338,0.04631654,0.0023549297,0.0058735707,0.00024134573,0.0015109283,0.12698752,0.0015830557,0.26783466,0.0045737172,0.5397371],"study_design_scores_gemma":[0.0015107553,0.001838526,0.030440765,0.00088476227,0.0021507812,0.00037313043,0.00035914418,0.30603123,0.0034143315,0.63804734,0.014723018,0.0002261595],"about_ca_topic_score_codex":0.004218916,"about_ca_topic_score_gemma":0.0025637532,"teacher_disagreement_score":0.077549085,"about_ca_system_score_codex":0.0018996149,"about_ca_system_score_gemma":0.0031839905,"threshold_uncertainty_score":0.41012365},"labels":[],"label_agreement":null},{"id":"W1953676460","doi":"10.6000/1929-6029.2015.04.02.7","title":"Using Propensity Score Matching in Clinical Investigations: A Discussion and Illustration","year":2015,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Propensity score matching; Observational study; Matching (statistics); Randomized controlled trial; Computer science; Percutaneous coronary intervention; Conventional PCI; Medicine; Internal medicine; Pathology","score_opus":0.7586343223110931,"score_gpt":0.6327789393899821,"score_spread":0.12585538292111098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1953676460","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018233143,0.24302876,0.61421716,0.12458963,0.004662345,0.000594711,0.00022279809,0.00020140017,0.010659882],"genre_scores_gemma":[0.054301772,0.34571314,0.5487906,0.029469231,0.016488757,0.0024546098,0.00022397056,0.0002002901,0.0023576291],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92981905,0.059020977,0.0041441866,0.001928033,0.004647887,0.00043982983],"domain_scores_gemma":[0.8712616,0.118281856,0.0032009583,0.0027333016,0.004106166,0.0004160357],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.100616746,0.0015546868,0.002121398,0.0065338523,0.0016136296,0.005459166,0.0042427955,0.008066099,0.0033518965],"category_scores_gemma":[0.13419615,0.0010452385,0.0028473742,0.009377269,0.010781373,0.006543349,0.004204204,0.011495111,0.0012305763],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077542674,0.00007275546,0.0023745003,0.005257128,0.00028454178,0.0009612371,0.0011395209,0.00433808,0.000312549,0.8353381,0.02546428,0.12437972],"study_design_scores_gemma":[0.00008571346,0.00017939715,0.0017458012,0.0072770854,0.00014513233,0.0024015938,0.00043199077,0.011143108,0.00045881496,0.8305512,0.14544255,0.00013766417],"about_ca_topic_score_codex":0.0027505832,"about_ca_topic_score_gemma":0.0022687442,"teacher_disagreement_score":0.89938325,"about_ca_system_score_codex":0.0027116153,"about_ca_system_score_gemma":0.0043982957,"threshold_uncertainty_score":0.53211856},"labels":[],"label_agreement":null},{"id":"W1955780894","doi":"10.1186/1742-5573-2-9","title":"An easy approach to the Robins-Breslow-Greenland variance estimator","year":2005,"lang":"en","type":"article","venue":"Epidemiologic Perspectives & Innovations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Variance (accounting); Estimator; Statistics; Odds; Variance components; Logarithm; Odds ratio; Computer science; Mathematics; Econometrics; Logistic regression","score_opus":0.18189499696771005,"score_gpt":0.4375992348551201,"score_spread":0.25570423788741004,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1955780894","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048532526,0.0012007111,0.9928577,0.0012622153,0.00026747372,0.000057676414,0.00010838664,0.000120389916,0.0036400142],"genre_scores_gemma":[0.031998657,0.0030305327,0.95437795,0.0010951355,0.0009215582,0.00052150857,0.00025726212,0.00023800142,0.0075594084],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99143106,0.005262297,0.00052867667,0.0008630294,0.0017255419,0.00018939671],"domain_scores_gemma":[0.99095696,0.006839245,0.00044906238,0.0008577836,0.00082509866,0.00007190227],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.014180889,0.00090167654,0.0012814972,0.0037926252,0.00078952056,0.0018194226,0.0020576017,0.0018978943,0.010876704],"category_scores_gemma":[0.055016592,0.00064446486,0.0016978541,0.002779866,0.0021663515,0.0029960792,0.0031225558,0.004477472,0.0041084657],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014969022,0.000025596342,0.00066063344,0.0001661153,0.00007872366,0.00014353763,0.00017679627,0.0021453307,0.00040142308,0.8960951,0.009139475,0.09095214],"study_design_scores_gemma":[0.00001822405,0.000039129605,0.00076919637,0.00015502189,0.000040115337,0.00054355717,0.00005366162,0.008223283,0.0005793748,0.9406044,0.04893079,0.000043246153],"about_ca_topic_score_codex":0.0017464004,"about_ca_topic_score_gemma":0.002304201,"teacher_disagreement_score":0.9858191,"about_ca_system_score_codex":0.0010360675,"about_ca_system_score_gemma":0.0018091283,"threshold_uncertainty_score":0.07499659},"labels":[],"label_agreement":null},{"id":"W1960011844","doi":"10.1002/sim.6123","title":"Extending the Bayesian Adjustment for Confounding algorithm to binary treatment covariates to estimate the effect of smoking on carotid intima-media thickness: the Multi-Ethnic Study of Atherosclerosis","year":2014,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"National Center for Advancing Translational Sciences; National Heart, Lung, and Blood Institute; Fonds de Recherche du Québec - Santé; National Center for Research Resources; Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Covariate; Statistics; Bayesian probability; Sample size determination; Medicine; Mathematics; Weighting; Algorithm; Econometrics; Radiology","score_opus":0.10143956355485871,"score_gpt":0.46787909410228273,"score_spread":0.366439530547424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1960011844","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013673043,0.00041888354,0.98404145,0.00044086404,0.000051369178,0.00013612652,0.0001379683,0.0004307993,0.0006694375],"genre_scores_gemma":[0.1400332,0.0005096341,0.85659933,0.00043300126,0.00008703658,0.0005950288,0.000499282,0.00020704027,0.0010364233],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9869653,0.010400602,0.0003646612,0.0008179556,0.0012308395,0.00022074366],"domain_scores_gemma":[0.9822396,0.012897566,0.0012460104,0.0015800121,0.0017838948,0.00025300597],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026323326,0.00083219993,0.0012037124,0.0015806358,0.0007761768,0.0013700514,0.0017709597,0.0010850132,0.0023542754],"category_scores_gemma":[0.07904331,0.000693425,0.0017968067,0.0014995729,0.0008197742,0.00088472053,0.0024013105,0.0018593018,0.0006069891],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009771651,0.00038507953,0.07168107,0.0008155641,0.0033042538,0.0003280052,0.0016185357,0.13801885,0.00703021,0.0823541,0.007885609,0.6856016],"study_design_scores_gemma":[0.0006653594,0.000557649,0.024705261,0.0003585913,0.00085668726,0.0005622055,0.00023452578,0.785659,0.0047260914,0.15625975,0.025211131,0.0002037428],"about_ca_topic_score_codex":0.011952209,"about_ca_topic_score_gemma":0.010908587,"teacher_disagreement_score":0.9736767,"about_ca_system_score_codex":0.00060708134,"about_ca_system_score_gemma":0.0033734834,"threshold_uncertainty_score":0.13921273},"labels":[],"label_agreement":null},{"id":"W1964475341","doi":"10.1002/sim.3150","title":"A critical appraisal of propensity‐score matching in the medical literature between 1996 and 2003","year":2007,"lang":"en","type":"review","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1250,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Wilcoxon signed-rank test; Statistics; Observational study; Matching (statistics); Selection bias; Logistic regression; Sample size determination; Statistical significance; Medicine; Mathematics; Mann–Whitney U test","score_opus":0.2610013184506083,"score_gpt":0.5385518179316583,"score_spread":0.27755049948105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1964475341","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00045947757,0.9956713,0.00040804213,0.00229579,0.0005183068,0.00018478419,0.00007661323,0.00000605359,0.0003796209],"genre_scores_gemma":[0.006608132,0.98858225,0.0015709675,0.0018563104,0.00067722035,0.00038617576,0.00014450811,0.000005954185,0.00016851345],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9621062,0.015441939,0.012662008,0.0013482538,0.008068171,0.00037344985],"domain_scores_gemma":[0.7730316,0.13998975,0.039433226,0.0032070626,0.043422252,0.00091617316],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.058335125,0.0013294391,0.004062122,0.025843741,0.00076119305,0.003283175,0.001759189,0.0022280144,0.0022598226],"category_scores_gemma":[0.22393522,0.0014739647,0.0033697658,0.025962556,0.0019595884,0.004014051,0.001824863,0.0014567912,0.0005482028],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007162528,0.0000383889,0.002134661,0.27778885,0.0030601502,0.00038370836,0.0006293024,0.00044973314,0.0003200697,0.0042567453,0.028776998,0.6814451],"study_design_scores_gemma":[0.00046920058,0.0005288425,0.017088953,0.5946848,0.016222928,0.001766398,0.0008723705,0.000550853,0.0011958124,0.0068741157,0.3596042,0.00014154024],"about_ca_topic_score_codex":0.003820794,"about_ca_topic_score_gemma":0.0065435944,"teacher_disagreement_score":0.9416649,"about_ca_system_score_codex":0.008626286,"about_ca_system_score_gemma":0.014943245,"threshold_uncertainty_score":0.3085093},"labels":[],"label_agreement":null},{"id":"W1964746590","doi":"10.1037/a0023910","title":"On the confounds among retest gains and age-cohort differences in the estimation of within-person change in longitudinal studies: A simulation study.","year":2011,"lang":"en","type":"article","venue":"Psychology and Aging","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":75,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"National Institute on Aging; National Institutes of Health","keywords":"Psychology; Longitudinal study; Cohort; Cognition; Cohort study; Convergence (economics); Cohort effect; Developmental psychology; Statistics; Mathematics","score_opus":0.5414389222022995,"score_gpt":0.4989594419450636,"score_spread":0.04247948025723591,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1964746590","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6950684,0.0042058295,0.28977647,0.0024677387,0.00024449118,0.0018547416,0.0011782947,0.0003592513,0.0048446762],"genre_scores_gemma":[0.87768245,0.000934046,0.11708622,0.0006796166,0.000052498544,0.0015655208,0.0007099771,0.000048213613,0.0012415543],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96661377,0.030441212,0.0007108955,0.0012576779,0.00063590094,0.00034055053],"domain_scores_gemma":[0.4476199,0.5224758,0.009074548,0.014636545,0.0052112862,0.0009819379],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11458224,0.0010766607,0.0014648673,0.0014147843,0.00080137886,0.0013392472,0.001908028,0.0026546826,0.0022926943],"category_scores_gemma":[0.25477803,0.00070039666,0.003931805,0.0016156919,0.0014150107,0.002703794,0.00211595,0.0034836412,0.00025365915],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009580169,0.0022578924,0.26777944,0.0013762191,0.0068563055,0.0015826345,0.0033829329,0.5773008,0.0021431095,0.058290016,0.005333497,0.06411694],"study_design_scores_gemma":[0.0009004532,0.002424532,0.026936922,0.00038264075,0.0019261179,0.00066619535,0.0005329939,0.93621844,0.001617377,0.025668839,0.0025815608,0.0001440648],"about_ca_topic_score_codex":0.01696141,"about_ca_topic_score_gemma":0.014806434,"teacher_disagreement_score":0.88541776,"about_ca_system_score_codex":0.001618045,"about_ca_system_score_gemma":0.0024114181,"threshold_uncertainty_score":0.60597605},"labels":[],"label_agreement":null},{"id":"W1966553403","doi":"10.1002/bimj.201000038","title":"When should one adjust for measurement error in baseline variables in observational studies?","year":2011,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Covariate; Estimator; Statistics; Baseline (sea); Observational study; Observational error; Mathematics; Sample size determination; Standard error; Variable (mathematics); Reliability (semiconductor); Econometrics; Power (physics)","score_opus":0.9081606865968035,"score_gpt":0.5170141048256166,"score_spread":0.3911465817711869,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1966553403","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0113278655,0.024522118,0.887326,0.068490535,0.005020635,0.00069423823,0.00034523042,0.0007462764,0.0015270598],"genre_scores_gemma":[0.2672096,0.00932567,0.69514126,0.020712227,0.0043024453,0.0016045464,0.0002185062,0.0004631197,0.0010227013],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.63725656,0.29616874,0.02545904,0.014353279,0.02463538,0.0021270434],"domain_scores_gemma":[0.21978481,0.6672646,0.045653585,0.044478655,0.021356303,0.0014620204],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.42900148,0.0018122464,0.0053013563,0.0048861895,0.0016467464,0.005941838,0.0058384603,0.0069785514,0.0012677093],"category_scores_gemma":[0.79321975,0.0013729505,0.0051292377,0.0064466023,0.007439072,0.010224948,0.0034536878,0.0100481175,0.0005150057],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018101232,0.00028043703,0.06968239,0.011270271,0.017168714,0.0009944851,0.0063840877,0.022997279,0.0023974061,0.19740045,0.02191202,0.6477024],"study_design_scores_gemma":[0.0012561178,0.0015928717,0.046087492,0.008670627,0.0063605406,0.0015117466,0.0014365112,0.0636,0.007021106,0.80680376,0.054954294,0.00070492877],"about_ca_topic_score_codex":0.008505892,"about_ca_topic_score_gemma":0.0054218834,"teacher_disagreement_score":0.57099855,"about_ca_system_score_codex":0.0042440207,"about_ca_system_score_gemma":0.0081893075,"threshold_uncertainty_score":0.7041428},"labels":[],"label_agreement":null},{"id":"W1967188199","doi":"10.2202/1557-4679.1198","title":"Comparing Approaches to Causal Inference for Longitudinal Data: Inverse Probability Weighting versus Propensity Scores","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Propensity score matching; Causal inference; Inverse probability weighting; Estimator; Covariate; Statistics; Inverse probability; Weighting; Observational study; Average treatment effect; Econometrics; Marginal structural model; Mathematics; Inference; Mean squared error; Global Positioning System; Confidence interval; Computer science; Bayesian probability; Medicine; Posterior probability; Artificial intelligence","score_opus":0.6633736756072357,"score_gpt":0.4530269615981859,"score_spread":0.2103467140090498,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967188199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013772886,0.003558679,0.97907287,0.0015372774,0.00016913164,0.00041649552,0.00011826755,0.000086976775,0.0012675405],"genre_scores_gemma":[0.21005043,0.0054738633,0.7791818,0.0010045437,0.00048261802,0.002371414,0.00037607824,0.00013682146,0.00092241337],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.791556,0.19105457,0.0038652443,0.004471632,0.008401134,0.0006514592],"domain_scores_gemma":[0.47856212,0.47554588,0.013404661,0.023781957,0.0076217414,0.0010837438],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16704217,0.0018821616,0.0030113724,0.0052021304,0.001211371,0.0034478582,0.0036736678,0.003432418,0.0039567263],"category_scores_gemma":[0.45431075,0.0009666079,0.003978767,0.0064383033,0.005080252,0.007334548,0.006196868,0.0049656504,0.00051613105],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001113901,0.00032916456,0.016952397,0.0020567393,0.004419539,0.00016013432,0.0016553322,0.084079504,0.000479427,0.55298644,0.0021878867,0.3335796],"study_design_scores_gemma":[0.0007090471,0.0006841912,0.005400006,0.0006302241,0.00078008504,0.00019361434,0.00033741992,0.19280916,0.00075792667,0.7909673,0.006600848,0.0001302255],"about_ca_topic_score_codex":0.0023228342,"about_ca_topic_score_gemma":0.0020360877,"teacher_disagreement_score":0.83295786,"about_ca_system_score_codex":0.002187781,"about_ca_system_score_gemma":0.0034487988,"threshold_uncertainty_score":0.883414},"labels":[],"label_agreement":null},{"id":"W1968518701","doi":"10.1016/j.jclinepi.2014.06.021","title":"Regression discontinuity designs are underutilized in medicine, epidemiology, and public health: a review of current and best practice","year":2015,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":243,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Medical Association; Wellcome Trust; Society for the Psychological Study of Social Issues; World Health Organization","keywords":"Regression discontinuity design; Epidemiology; Public health; Medicine; Regression; MEDLINE; Family medicine; Environmental health; Political science; Statistics; Mathematics; Pathology","score_opus":0.927473019810263,"score_gpt":0.7333156026957495,"score_spread":0.1941574171145135,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1968518701","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001748141,0.994216,0.0028334325,0.002164431,0.00023466066,0.000029728077,0.000063358646,0.000019608062,0.00026394782],"genre_scores_gemma":[0.0029025096,0.9867343,0.00773317,0.0017801989,0.00051034446,0.00009761315,0.0000722012,0.000018396395,0.00015121388],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.98089427,0.011226161,0.0025802986,0.0016710779,0.003365376,0.00026271874],"domain_scores_gemma":[0.7810408,0.20376647,0.006068648,0.002446688,0.005886958,0.0007904252],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.047931984,0.0012464605,0.006322574,0.0048352573,0.0006983478,0.0043259305,0.0045328424,0.0047489144,0.005856037],"category_scores_gemma":[0.09986376,0.0011333255,0.0042412207,0.0072176424,0.0028038332,0.0037992748,0.0025298053,0.006737187,0.0009814098],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031892932,0.000112621456,0.0016212037,0.06759559,0.0015916256,0.00007152813,0.0002933565,0.0007640393,0.00013452426,0.019924833,0.010802924,0.89676875],"study_design_scores_gemma":[0.0008975484,0.0008597183,0.008120092,0.20795007,0.009836009,0.0017964214,0.0008897104,0.003004566,0.0010235057,0.10268004,0.66259545,0.0003468705],"about_ca_topic_score_codex":0.0038076579,"about_ca_topic_score_gemma":0.0053682253,"teacher_disagreement_score":0.95206803,"about_ca_system_score_codex":0.002262455,"about_ca_system_score_gemma":0.007465748,"threshold_uncertainty_score":0.25349158},"labels":[],"label_agreement":null},{"id":"W1970310544","doi":"10.1016/s1098-3015(10)61081-9","title":"PMH15 PREVALENCE AND COSTS OF TREATMENT-RESISTANT DEPRESSION IN A CANADIAN CLAIMS DATABASE","year":2002,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Depression (economics); Treatment-resistant depression; Database; Medicine; Business; Psychiatry; Computer science; Economics; Major depressive disorder","score_opus":0.18937100839147772,"score_gpt":0.40805489499402336,"score_spread":0.21868388660254565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970310544","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8883417,0.0020332031,0.00029864212,0.0014371151,0.00003840319,0.00011242892,0.10375591,0.00006543776,0.00391703],"genre_scores_gemma":[0.97518945,0.00095197925,0.0005791412,0.00017145376,0.000020184752,0.000047498655,0.021974029,0.000010534243,0.0010556525],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.997789,0.00022887714,0.00025483465,0.0003297346,0.0009597275,0.0004378313],"domain_scores_gemma":[0.99363387,0.0013375867,0.0018110339,0.0004630661,0.0020621275,0.00069241825],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016804121,0.00048927055,0.00093806814,0.0036863133,0.0017026666,0.0017590984,0.0031600178,0.0011592419,0.0046326546],"category_scores_gemma":[0.014771592,0.0006768384,0.0017256481,0.0076554604,0.00068078074,0.00061673904,0.0009171553,0.0012989319,0.00028446532],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047187085,0.0000938459,0.9789956,0.00014618336,0.0005394333,0.00015806718,0.00019814198,0.0016397106,0.000095590854,0.001259784,0.010126686,0.006275031],"study_design_scores_gemma":[0.00007052469,0.000018255409,0.9937557,0.000053392345,0.00019442764,0.00013921685,0.00022717415,0.0038692618,0.000049919436,0.00019284562,0.0014012028,0.000027989185],"about_ca_topic_score_codex":0.99355763,"about_ca_topic_score_gemma":0.99210656,"teacher_disagreement_score":0.030729808,"about_ca_system_score_codex":0.030729808,"about_ca_system_score_gemma":0.030771112,"threshold_uncertainty_score":0.22296143},"labels":[],"label_agreement":null},{"id":"W1970517271","doi":"10.1080/01621459.2011.643743","title":"Partially Hidden Markov Model for Time-Varying Principal Stratification in HIV Prevention Trials","year":2012,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Human immunodeficiency virus (HIV); Markov model; Markov chain; Principal (computer security); Mathematics; Econometrics; Statistics; Computer science; Medicine; Virology","score_opus":0.14586056066597575,"score_gpt":0.44569357495264006,"score_spread":0.2998330142866643,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970517271","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015250492,0.0016909903,0.9749808,0.003724794,0.0002775512,0.0010521713,0.0012477454,0.0004468009,0.0013286184],"genre_scores_gemma":[0.46491092,0.0036178727,0.49913985,0.002694707,0.0008260096,0.016353315,0.0032253696,0.00018116372,0.009050808],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93991774,0.051576756,0.0017894165,0.003847256,0.0019187334,0.000950138],"domain_scores_gemma":[0.75712365,0.22316049,0.009267196,0.0066887545,0.0026494884,0.0011104214],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.105167,0.00213997,0.0049263122,0.002827275,0.0011164364,0.0027984043,0.0054367995,0.005025661,0.0096325055],"category_scores_gemma":[0.17990462,0.0020540827,0.0036887343,0.0027928716,0.003618574,0.0048959483,0.0031408106,0.0069873035,0.0014828693],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002463348,0.0002138008,0.010922434,0.001587343,0.001743751,0.00068702333,0.0011076801,0.28075182,0.00070407835,0.63998556,0.005577519,0.054255717],"study_design_scores_gemma":[0.00088104064,0.00034864963,0.0014687694,0.00025846198,0.00043513716,0.000102837024,0.00005263413,0.61430997,0.0002874577,0.378986,0.002799868,0.000069159214],"about_ca_topic_score_codex":0.0071824086,"about_ca_topic_score_gemma":0.0061750757,"teacher_disagreement_score":0.105167,"about_ca_system_score_codex":0.003311856,"about_ca_system_score_gemma":0.0056977165,"threshold_uncertainty_score":0.5561829},"labels":[],"label_agreement":null},{"id":"W1972445384","doi":"10.1002/sim.5690","title":"On estimating average effects for multiple treatment groups","year":2012,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital","funders":"","keywords":"Covariate; Statistics; Propensity score matching; Robustness (evolution); Population; Econometrics; Observational study; Variable (mathematics); Average treatment effect; Instrumental variable; Mathematics; Medicine; Biology","score_opus":0.10760751865554542,"score_gpt":0.4506370219169127,"score_spread":0.3430295032613673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972445384","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064106006,0.0007319258,0.99126935,0.0005217336,0.00006828283,0.00016437614,0.0001492719,0.00012080997,0.00056377496],"genre_scores_gemma":[0.19233733,0.0019991093,0.7998372,0.0010961086,0.00038024643,0.0019552337,0.0005891422,0.000112451504,0.0016932526],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93514043,0.0549181,0.0012493181,0.0049746414,0.0031081946,0.00060925214],"domain_scores_gemma":[0.79745966,0.18419266,0.0063718935,0.009533756,0.0019879893,0.0004540768],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10081509,0.0016421238,0.0038194223,0.0032058032,0.0010214896,0.0022467417,0.0038538366,0.0028723394,0.0043519214],"category_scores_gemma":[0.17153092,0.0011125803,0.004363994,0.0041326904,0.0034681023,0.0044399067,0.0032063338,0.0041392012,0.0005134536],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007435588,0.00040184142,0.023272805,0.0012980071,0.004604495,0.00033320973,0.001101859,0.17201622,0.0010391922,0.4670351,0.0024871707,0.3256665],"study_design_scores_gemma":[0.0003730832,0.00057295326,0.0060309204,0.00036489955,0.0010379574,0.00021392207,0.00015442049,0.28058007,0.0011397031,0.7023504,0.007088661,0.00009299421],"about_ca_topic_score_codex":0.004217518,"about_ca_topic_score_gemma":0.0032438706,"teacher_disagreement_score":0.89918494,"about_ca_system_score_codex":0.0017268066,"about_ca_system_score_gemma":0.00294185,"threshold_uncertainty_score":0.5331675},"labels":[],"label_agreement":null},{"id":"W1972795335","doi":"10.1002/sim.3989","title":"Estimation of relative risk and prevalence ratio","year":2010,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Statistics; Mathematics; Binomial regression; Logistic regression; Binomial (polynomial); Negative binomial distribution; Confounding; Point estimation; Relative risk; Econometrics; Computer science; Confidence interval; Poisson distribution","score_opus":0.056982222668341694,"score_gpt":0.4327492605441972,"score_spread":0.3757670378758555,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972795335","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013561536,0.020472705,0.9508863,0.0023385864,0.00094668625,0.0018973836,0.0041865413,0.00095936446,0.0047509],"genre_scores_gemma":[0.22223395,0.01464046,0.7441075,0.0016687427,0.0013741584,0.009087064,0.00422549,0.00049585896,0.0021667061],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85419184,0.107839376,0.011213841,0.012263523,0.013707838,0.0007835379],"domain_scores_gemma":[0.7094652,0.2482422,0.020143278,0.014150789,0.00742498,0.0005735632],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10925594,0.0022169002,0.006200499,0.009280175,0.00055044,0.0034560272,0.004774776,0.0030672844,0.0072560012],"category_scores_gemma":[0.39152455,0.0010279514,0.005029657,0.0073890295,0.0028641473,0.0041448814,0.0038251034,0.0052787266,0.0018239097],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013729916,0.00037114322,0.08224302,0.010933805,0.015160322,0.0008095126,0.0012676573,0.049175348,0.001361816,0.16082661,0.025149167,0.6513286],"study_design_scores_gemma":[0.00081133586,0.0016371071,0.050758407,0.006666841,0.007866381,0.0047443104,0.00142761,0.1797575,0.005721675,0.60621756,0.13370387,0.00068728655],"about_ca_topic_score_codex":0.0018203051,"about_ca_topic_score_gemma":0.00064281235,"teacher_disagreement_score":0.8907441,"about_ca_system_score_codex":0.0017520665,"about_ca_system_score_gemma":0.0030542572,"threshold_uncertainty_score":0.57780755},"labels":[],"label_agreement":null},{"id":"W1972903893","doi":"10.2202/1557-4679.1207","title":"Impact of Outcome Model Misspecification on Regression and Doubly-Robust Inverse Probability Weighting to Estimate Causal Effect","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Inverse probability weighting; Covariate; Estimator; Propensity score matching; Statistics; Average treatment effect; Econometrics; Confounding; Outcome (game theory); Regression analysis; Regression; Weighting; Mathematics; Observational study; Inverse probability; Medicine; Bayesian probability","score_opus":0.14815524905517047,"score_gpt":0.470020886576831,"score_spread":0.32186563752166053,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972903893","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010601382,0.00044916113,0.98757344,0.00040894872,0.00004022725,0.00008740557,0.000060276463,0.00021565297,0.00056353357],"genre_scores_gemma":[0.27461788,0.00066297955,0.7214687,0.00053633377,0.00013804963,0.0006378074,0.0004346357,0.00026726865,0.0012363459],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9033379,0.081817545,0.0028690181,0.004216874,0.006947817,0.0008108784],"domain_scores_gemma":[0.5505553,0.38622144,0.0150355175,0.04057668,0.006974287,0.00063673314],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1450336,0.001427099,0.0023516652,0.001796221,0.00068035943,0.0019000517,0.003358841,0.00225234,0.002711988],"category_scores_gemma":[0.42296863,0.0008446484,0.0023688471,0.0023409675,0.0027766149,0.003709892,0.0036989723,0.0034807886,0.00065370806],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001071179,0.00033634057,0.033691466,0.000976797,0.0021083585,0.0005262213,0.00124495,0.23674169,0.0033869115,0.41113752,0.0035652819,0.3052133],"study_design_scores_gemma":[0.00015507701,0.00050433114,0.008362232,0.00021200778,0.00045876694,0.00056710583,0.00016013691,0.82633406,0.004985373,0.15418996,0.003955216,0.000115686445],"about_ca_topic_score_codex":0.0033913981,"about_ca_topic_score_gemma":0.0017845045,"teacher_disagreement_score":0.8549664,"about_ca_system_score_codex":0.0009947006,"about_ca_system_score_gemma":0.0018197093,"threshold_uncertainty_score":0.76702017},"labels":[],"label_agreement":null},{"id":"W1973426926","doi":"10.1111/j.1365-2753.2005.00624.x","title":"Quantifying the impact of survivor treatment bias in observational studies","year":2005,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":86,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Ottawa Hospital; University of Ottawa; Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Institute for Clinical Evaluative Sciences","keywords":"Observational study; Medicine; Hazard ratio; Treatment effect; Proportional hazards model; Survival analysis; Average treatment effect; Intensive care medicine; Emergency medicine; Confidence interval; Propensity score matching; Internal medicine","score_opus":0.9136852754774484,"score_gpt":0.7239443433973133,"score_spread":0.1897409320801351,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1973426926","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.079404965,0.014707498,0.88208777,0.009963147,0.0010610946,0.0039960505,0.0023962643,0.00045899145,0.005924183],"genre_scores_gemma":[0.83338076,0.0022689407,0.15586883,0.0034923274,0.0005477938,0.0028925142,0.0007465315,0.000083675484,0.00071865576],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.5542366,0.39835677,0.020273538,0.01032389,0.015525924,0.0012832393],"domain_scores_gemma":[0.12279212,0.7960856,0.04764668,0.025992258,0.0068556075,0.0006276943],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3516994,0.0015378644,0.0018842223,0.0036874814,0.0012335653,0.0041514253,0.003341368,0.0051446776,0.0020100446],"category_scores_gemma":[0.70607287,0.001064379,0.0040627318,0.004458011,0.0056242887,0.0041161855,0.0041828854,0.0037048901,0.00023968205],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017047141,0.00026517425,0.473853,0.0064919554,0.018796148,0.0009666902,0.0028782587,0.18737033,0.00091118424,0.1707739,0.005355066,0.1306336],"study_design_scores_gemma":[0.0008749189,0.0019350561,0.13090158,0.0061196056,0.006979035,0.0019573532,0.0011006821,0.3511207,0.0032415763,0.47114852,0.024125434,0.0004955201],"about_ca_topic_score_codex":0.0077977646,"about_ca_topic_score_gemma":0.004978042,"teacher_disagreement_score":0.6483006,"about_ca_system_score_codex":0.00470389,"about_ca_system_score_gemma":0.0055976566,"threshold_uncertainty_score":0.79947007},"labels":[],"label_agreement":null},{"id":"W1973852387","doi":"10.1007/978-1-4939-2428-8_4","title":"Longitudinal Studies 1: Determination of Risk","year":2015,"lang":"en","type":"article","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Observational study; Confounding; Casual; Selection bias; Computer science; Clinical study design; Risk analysis (engineering); Econometrics; Psychology; Medicine; Statistics; Clinical trial; Mathematics","score_opus":0.3593001423795641,"score_gpt":0.5920642771108096,"score_spread":0.23276413473124546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1973852387","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019173251,0.03620936,0.9283405,0.010387117,0.0008389348,0.0002011154,0.0020510328,0.00040815197,0.0023906734],"genre_scores_gemma":[0.41944057,0.040317666,0.51504695,0.0038392309,0.0041771866,0.0018200026,0.0023287367,0.00032098632,0.0127087375],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9691715,0.02552687,0.00083239493,0.0029046608,0.0012597434,0.000304696],"domain_scores_gemma":[0.8114917,0.16605094,0.007929467,0.011229181,0.002443982,0.00085475424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040490896,0.0017410077,0.002999903,0.0031767557,0.0010014266,0.0027911523,0.0027269672,0.004102679,0.0071045],"category_scores_gemma":[0.15108491,0.001641733,0.002454105,0.003468361,0.0037279248,0.004403766,0.0026595844,0.0049738353,0.000897563],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006013362,0.00022270574,0.051660962,0.0031118558,0.0031063668,0.00059346756,0.0008531845,0.013024702,0.0010760943,0.69445854,0.014810543,0.21648017],"study_design_scores_gemma":[0.00018440183,0.00022913466,0.009745452,0.0005714461,0.0007935666,0.0005930171,0.0001529881,0.023428898,0.0003828916,0.9541859,0.009668233,0.00006419732],"about_ca_topic_score_codex":0.0028411192,"about_ca_topic_score_gemma":0.0022998443,"teacher_disagreement_score":0.040490896,"about_ca_system_score_codex":0.0011082033,"about_ca_system_score_gemma":0.0027446302,"threshold_uncertainty_score":0.21413887},"labels":[],"label_agreement":null},{"id":"W1974429147","doi":"10.1136/annrheumdis-2014-eular.2210","title":"THU0416 Attrition Bias in Rheumatoid Arthritis Randomised Trials with Different Modified Intention-To-Treat Approaches: A Meta-Epidemiological Study","year":2014,"lang":"en","type":"article","venue":"Annals of the Rheumatic Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Medicine; Randomized controlled trial; Population; Rheumatoid arthritis; Meta-analysis; Internal medicine; Intention-to-treat analysis; Sample size determination; Physical therapy; Imputation (statistics); Study heterogeneity; Missing data; Statistics","score_opus":0.6572351615281036,"score_gpt":0.44747438123377986,"score_spread":0.2097607802943237,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1974429147","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2201201,0.53177387,0.21544708,0.006859262,0.007442755,0.0066567957,0.0038825967,0.0018694941,0.005948176],"genre_scores_gemma":[0.9259026,0.019297602,0.040109705,0.0042571756,0.0017780937,0.004320605,0.0012725047,0.0004284045,0.002633349],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.71683407,0.24901652,0.017323535,0.009084807,0.0054378677,0.0023032199],"domain_scores_gemma":[0.7330773,0.2265989,0.012093969,0.022740567,0.0043926258,0.0010966012],"candidate_categories":["metaresearch","metaepi_narrow","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.15971294,0.0043580392,0.015147193,0.0037484374,0.0014220421,0.006236112,0.0053462167,0.009724429,0.010320503],"category_scores_gemma":[0.26303396,0.003115857,0.05516843,0.00518877,0.0025584265,0.005347708,0.0029046931,0.008572807,0.0010380801],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.09953756,0.0003573877,0.008694963,0.025308566,0.8238805,0.0004406815,0.00028900022,0.0029145805,0.0004368626,0.0039619417,0.0021779842,0.032],"study_design_scores_gemma":[0.07975696,0.004145932,0.0066345595,0.0035629068,0.8773566,0.00039666987,0.0001588531,0.011368132,0.00052467646,0.013089339,0.002778087,0.00022737173],"about_ca_topic_score_codex":0.003990686,"about_ca_topic_score_gemma":0.0030434395,"teacher_disagreement_score":0.99564195,"about_ca_system_score_codex":0.0019539236,"about_ca_system_score_gemma":0.0031206745,"threshold_uncertainty_score":0.8446529},"labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad","metaepi_narrow"],"domain":"methods","study_design":"meta_analysis","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch","metaepi_narrow","metaepi_broad"],"domain":"methods","study_design":"meta_analysis","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W1974723978","doi":"10.1002/sim.6378","title":"A cautionary note concerning the use of stabilized weights in marginal structural models","year":2014,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University; Hôpital du Sacré-Cœur de Montréal; Université Laval; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Marginal structural model; Inverse probability; Econometrics; Confounding; Inverse; Statistics; Computer science; Mathematics; Posterior probability; Bayesian probability","score_opus":0.20423091439008736,"score_gpt":0.4260492700041732,"score_spread":0.22181835561408583,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1974723978","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014610201,0.009863703,0.6458306,0.2916277,0.014632057,0.0004947173,0.0016118623,0.0015335073,0.01979571],"genre_scores_gemma":[0.25910616,0.0050739697,0.5837298,0.12216453,0.011269415,0.0017864419,0.00032287938,0.0010331883,0.01551353],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.87160546,0.0990234,0.008361461,0.007398121,0.012495981,0.0011156456],"domain_scores_gemma":[0.53780884,0.4004866,0.008746064,0.03246846,0.019418208,0.0010717822],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15095167,0.0017531894,0.00293237,0.0024141003,0.0035790761,0.0054068286,0.010171702,0.006464516,0.005285103],"category_scores_gemma":[0.4746552,0.0012663202,0.0032579778,0.004971943,0.012598175,0.008105897,0.0038210573,0.027294362,0.002415156],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003670965,0.00008625444,0.007415635,0.0011471948,0.000580426,0.0014394508,0.0058751744,0.0060068197,0.0010358064,0.6676476,0.21992359,0.08847499],"study_design_scores_gemma":[0.00020481633,0.00019942525,0.0050165127,0.0016203297,0.0002513642,0.0013401776,0.0016615664,0.028037712,0.0032305042,0.8314678,0.12664215,0.00032761972],"about_ca_topic_score_codex":0.01084188,"about_ca_topic_score_gemma":0.01906889,"teacher_disagreement_score":0.8490483,"about_ca_system_score_codex":0.00218829,"about_ca_system_score_gemma":0.0035465069,"threshold_uncertainty_score":0.79831827},"labels":[],"label_agreement":null},{"id":"W1975001673","doi":"10.1016/j.scitotenv.2012.01.006","title":"Response to Letter to the editor from Guzzi, Ronchi, Pigatto and Monoia","year":2012,"lang":"en","type":"article","venue":"The Science of The Total Environment","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SNC-Lavalin (Canada)","funders":"","keywords":"Art","score_opus":0.040051548860422614,"score_gpt":0.3073556102019574,"score_spread":0.2673040613415348,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1975001673","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012619777,0.0022857664,0.00012609058,0.8529277,0.14388178,0.000012103004,0.00007827276,0.00003756657,0.0005245739],"genre_scores_gemma":[0.0022937928,0.0025853992,0.00021396553,0.83959216,0.15021375,0.000051104274,0.00004941735,0.0000600666,0.00494039],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99634725,0.0009087997,0.0007004674,0.0005607713,0.0011075581,0.00037522952],"domain_scores_gemma":[0.9760884,0.012884728,0.0014451846,0.000564791,0.0072841146,0.0017328592],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0058460487,0.0013949854,0.0030301763,0.0013267588,0.0027398486,0.004733632,0.002855081,0.029451523,0.008748704],"category_scores_gemma":[0.052783836,0.0008865796,0.0014714825,0.0011375926,0.0025968836,0.0035400032,0.0016558897,0.034043223,0.007596373],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000038587037,0.000008347325,0.00007290696,0.00007495067,0.0000119215,0.00014032185,0.00004983776,0.00002182402,0.000032273285,0.00053150114,0.99736637,0.0016512272],"study_design_scores_gemma":[0.000107619744,0.000046468103,0.0012313328,0.0004514501,0.000065515465,0.0007707078,0.00050147966,0.00032804254,0.00023674729,0.002773368,0.99341595,0.00007120425],"about_ca_topic_score_codex":0.00498088,"about_ca_topic_score_gemma":0.0049255313,"teacher_disagreement_score":0.029451523,"about_ca_system_score_codex":0.004060895,"about_ca_system_score_gemma":0.004034602,"threshold_uncertainty_score":0.030917227},"labels":[],"label_agreement":null},{"id":"W1975477455","doi":"10.1097/ede.0b013e3181a48c33","title":"Improving Multilevel Analyses","year":2009,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; University of Toronto; Centre for Addiction and Mental Health","funders":"","keywords":"Multilevel model; Estimation; Computer science; Variation (astronomy); Hierarchical database model; Statistics; Risk analysis (engineering); Econometrics; Data mining; Medicine; Mathematics; Engineering; Systems engineering","score_opus":0.619359881176276,"score_gpt":0.5811842964023198,"score_spread":0.03817558477395622,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1975477455","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002591925,0.0008700382,0.9919926,0.0010971767,0.00026315142,0.00014988583,0.0005254323,0.00085009856,0.001659657],"genre_scores_gemma":[0.049904287,0.0010399026,0.94434476,0.0005994899,0.00034898674,0.00078523066,0.0009907217,0.0007767229,0.0012097309],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94044733,0.04795544,0.0024302623,0.00383877,0.0046242713,0.0007039302],"domain_scores_gemma":[0.8114106,0.14420137,0.006074452,0.0247044,0.012451854,0.0011572808],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05362612,0.0019760309,0.003158372,0.004392626,0.002054863,0.004872198,0.0036307892,0.0021981532,0.016201807],"category_scores_gemma":[0.254969,0.0017044538,0.006031183,0.0062392866,0.0013793369,0.0059291073,0.008664276,0.0054824143,0.0027531427],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000463894,0.00018725413,0.025109328,0.0025426433,0.0050732545,0.0005140576,0.0044751465,0.037709344,0.0024193448,0.33801714,0.04474609,0.5387425],"study_design_scores_gemma":[0.00031915182,0.00035561778,0.011346127,0.0012337624,0.0018372734,0.0005063442,0.0010280774,0.22142456,0.0025315606,0.65105337,0.10814802,0.00021615622],"about_ca_topic_score_codex":0.0062456764,"about_ca_topic_score_gemma":0.009443268,"teacher_disagreement_score":0.05362612,"about_ca_system_score_codex":0.0016740988,"about_ca_system_score_gemma":0.0042939917,"threshold_uncertainty_score":0.2836054},"labels":[],"label_agreement":null},{"id":"W1975579902","doi":"10.1016/s0840-4704(10)60455-3","title":"Commentary on the Feature Article","year":2009,"lang":"en","type":"letter","venue":"Healthcare Management Forum","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre hospitalier universitaire de Québec","funders":"","keywords":"Feature (linguistics); Computer science; Philosophy; Linguistics","score_opus":0.09739661024137902,"score_gpt":0.38588553148050425,"score_spread":0.28848892123912523,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1975579902","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001975298,0.0005652951,0.000100713296,0.957504,0.038927298,0.000031629734,0.00008713998,0.000024544011,0.0025618596],"genre_scores_gemma":[0.0009172504,0.00019242286,0.00008811324,0.9738507,0.018859083,0.000046957794,0.000018167075,0.00001917629,0.006008179],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.989321,0.0022918696,0.0009761546,0.0021320262,0.0029215359,0.002357476],"domain_scores_gemma":[0.97813034,0.01369651,0.0013840242,0.00061088434,0.0031295763,0.003048564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010757594,0.0017995738,0.0038558051,0.0014851317,0.009881198,0.0107419,0.006508902,0.20297717,0.0137482295],"category_scores_gemma":[0.064548604,0.0019977326,0.0039703595,0.0014667244,0.0061541703,0.005508015,0.003788996,0.12231704,0.010612317],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004662037,0.000018178967,0.00014253336,0.00003761306,0.000019276775,0.00063141977,0.00013029175,0.00004149267,0.000064679756,0.0024479674,0.99495333,0.0014665143],"study_design_scores_gemma":[0.00025751567,0.00009604112,0.0016234505,0.0007557371,0.00016116488,0.0005996333,0.00076819665,0.0008518547,0.00044043388,0.01371334,0.9805696,0.00016304271],"about_ca_topic_score_codex":0.021562692,"about_ca_topic_score_gemma":0.03536331,"teacher_disagreement_score":0.20297717,"about_ca_system_score_codex":0.01088375,"about_ca_system_score_gemma":0.011913495,"threshold_uncertainty_score":0.07896751},"labels":[],"label_agreement":null},{"id":"W1975994236","doi":"10.1002/sim.3854","title":"The performance of different propensity-score methods for estimating differences in proportions (risk differences or absolute risk reductions) in observational studies","year":2010,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":359,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Confidence interval; Observational study; Estimator; Mean squared error; Relative risk; Matching (statistics); Inverse probability weighting; Mathematics; Econometrics; Medicine","score_opus":0.4011751616883879,"score_gpt":0.5200551633034011,"score_spread":0.11888000161501316,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1975994236","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034756232,0.013078188,0.94167495,0.0017615819,0.0005445868,0.004067523,0.0015214102,0.00046991062,0.0021255938],"genre_scores_gemma":[0.32929915,0.0063689854,0.65108514,0.0012509812,0.00041274802,0.008857602,0.0017233668,0.00043490963,0.000567083],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.508193,0.413272,0.036204834,0.016259324,0.024826331,0.001244452],"domain_scores_gemma":[0.27542666,0.62126666,0.04339208,0.041158132,0.017916646,0.0008398208],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4396123,0.002058965,0.0039445283,0.0076464596,0.00156653,0.005256041,0.0043506776,0.0032430969,0.0028180587],"category_scores_gemma":[0.70922977,0.0017790443,0.0104674315,0.012402589,0.003932175,0.0054547046,0.004308516,0.004812075,0.00058150606],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0042364323,0.00041647328,0.1859894,0.00841173,0.034373183,0.00047081528,0.0034810076,0.15720506,0.0012784553,0.091546625,0.0094453115,0.5031455],"study_design_scores_gemma":[0.003740691,0.0034452432,0.14565928,0.007521451,0.014589313,0.0017052256,0.0009385151,0.50861615,0.007220493,0.2627421,0.04248298,0.001338544],"about_ca_topic_score_codex":0.005815591,"about_ca_topic_score_gemma":0.003693299,"teacher_disagreement_score":0.56038773,"about_ca_system_score_codex":0.003350895,"about_ca_system_score_gemma":0.004824952,"threshold_uncertainty_score":0.6910578},"labels":[],"label_agreement":null},{"id":"W1976017085","doi":"10.2165/00002018-200225090-00006","title":"Adverse Effects of Observational Studies When Examining Adverse Outcomes of Drugs","year":2002,"lang":"en","type":"article","venue":"Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Medicine; Observational study; Adverse effect; Intensive care medicine; Pharmacology; Internal medicine","score_opus":0.2316084619514706,"score_gpt":0.3963446661703264,"score_spread":0.16473620421885576,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1976017085","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03366365,0.02414142,0.92551386,0.0074415966,0.0014862291,0.0010953762,0.001818312,0.0003839672,0.004455566],"genre_scores_gemma":[0.7316641,0.007958211,0.24936926,0.0027000948,0.0027232098,0.002012147,0.00080180855,0.0001152298,0.0026560011],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5694576,0.37472084,0.025968213,0.012320478,0.01637599,0.0011568691],"domain_scores_gemma":[0.050815113,0.9185866,0.0134693645,0.014737337,0.0018104744,0.00058106467],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.28295252,0.0018331854,0.0054646884,0.007605305,0.0013660861,0.0042682425,0.005010365,0.0041827783,0.008485484],"category_scores_gemma":[0.72519684,0.0019065058,0.010130914,0.0053717988,0.0062342095,0.0083303405,0.0047428715,0.008806271,0.00040319088],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006482761,0.0005383025,0.17999516,0.012571883,0.045089092,0.0062438445,0.0028508469,0.043999624,0.0012960553,0.33223605,0.009897452,0.35879895],"study_design_scores_gemma":[0.0011380283,0.0012197373,0.02447192,0.0029429724,0.022996522,0.003913607,0.0006080683,0.13020946,0.0030185967,0.79618156,0.013115394,0.00018415666],"about_ca_topic_score_codex":0.0033329702,"about_ca_topic_score_gemma":0.003673048,"teacher_disagreement_score":0.71704745,"about_ca_system_score_codex":0.001754055,"about_ca_system_score_gemma":0.0037076015,"threshold_uncertainty_score":0.8842472},"labels":[],"label_agreement":null},{"id":"W1976472169","doi":"10.1177/0020715204048308","title":"Comparing Social Groups: Wald Statistics for Testing Equality Among Multiple Logit Models","year":2004,"lang":"en","type":"article","venue":"International Journal of Comparative Sociology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":66,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Wald test; Statistic; Statistics; Econometrics; Likelihood-ratio test; Test statistic; Score test; Logistic regression; Logit; Mathematics; Test (biology); Statistical hypothesis testing","score_opus":0.5330289314502004,"score_gpt":0.5120957602004778,"score_spread":0.020933171249722604,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1976472169","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018292714,0.0011991032,0.9719507,0.0011950299,0.00038176298,0.00035137404,0.0012373828,0.001211012,0.004180991],"genre_scores_gemma":[0.38956016,0.0011654933,0.59887826,0.00091837265,0.0011362722,0.003316887,0.0022283248,0.000757759,0.0020383112],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9227765,0.061547928,0.0027304727,0.0042288047,0.00736006,0.0013561974],"domain_scores_gemma":[0.6715997,0.29932934,0.008179573,0.014455174,0.005085562,0.001350639],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06714882,0.002009182,0.0035236394,0.008479688,0.0017766537,0.0033852502,0.0039052332,0.003740762,0.012901141],"category_scores_gemma":[0.30928537,0.0010591943,0.0038609656,0.008861244,0.006294541,0.009377398,0.0038180219,0.0055767405,0.001975602],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008138416,0.00045490486,0.047315493,0.0013661482,0.0042662015,0.0016617518,0.0022302673,0.028373718,0.0016353313,0.6020534,0.030032372,0.27979657],"study_design_scores_gemma":[0.00030047627,0.0007199689,0.012441805,0.00037687842,0.00056323456,0.0007187752,0.0012237655,0.14880866,0.002087872,0.8143025,0.018226927,0.00022906359],"about_ca_topic_score_codex":0.001727485,"about_ca_topic_score_gemma":0.001109196,"teacher_disagreement_score":0.06714882,"about_ca_system_score_codex":0.0011869147,"about_ca_system_score_gemma":0.0025320542,"threshold_uncertainty_score":0.35512114},"labels":[],"label_agreement":null},{"id":"W1977200598","doi":"10.6000/1929-6029.2012.01.02.01","title":"Estimating the Complier Average Causal Effect for Exponential Survival in the Presence of Mid-Trial Switching","year":2012,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Counterfactual thinking; Estimator; Econometrics; Treatment effect; Delta method; Aggregate (composite); Statistics; Economics; Computer science; Mathematics; Psychology; Medicine; Social psychology","score_opus":0.25044803211524236,"score_gpt":0.5602161870279413,"score_spread":0.30976815491269893,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977200598","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04126619,0.00084331376,0.9547841,0.00075313664,0.00009684498,0.0005276779,0.0001915882,0.00027481667,0.0012623176],"genre_scores_gemma":[0.60352,0.00081876956,0.39004433,0.0011282555,0.00025055133,0.0017007156,0.0005573994,0.000116667245,0.0018632744],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.867619,0.11656214,0.0036960442,0.0063608633,0.0046596806,0.001102371],"domain_scores_gemma":[0.4663152,0.47892046,0.021283198,0.029304385,0.0033378007,0.00083901256],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.22666231,0.0010805159,0.003418424,0.0024862115,0.0007448143,0.0028057685,0.0029208031,0.0034756798,0.003880213],"category_scores_gemma":[0.4054307,0.0010204065,0.004716446,0.0021031809,0.0035831495,0.003889138,0.003038819,0.0044930335,0.00044507714],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0049132546,0.00068681716,0.0722191,0.002357856,0.0059781303,0.0013740123,0.0031198768,0.16262402,0.0021754832,0.4339933,0.0030463105,0.3075118],"study_design_scores_gemma":[0.0008662608,0.002404455,0.016890556,0.00041739238,0.0020060376,0.00083521754,0.00027698593,0.53650373,0.0027140654,0.43192843,0.004985086,0.0001717876],"about_ca_topic_score_codex":0.0016139968,"about_ca_topic_score_gemma":0.0012806894,"teacher_disagreement_score":0.22666231,"about_ca_system_score_codex":0.0013412131,"about_ca_system_score_gemma":0.0022201901,"threshold_uncertainty_score":0.95366305},"labels":[],"label_agreement":null},{"id":"W1977271642","doi":"10.1503/cmaj.1060113","title":"Not-so-surprising findings","year":2006,"lang":"en","type":"article","venue":"Canadian Medical Association Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Randomized controlled trial; Computer science; Data science; Medicine; Pathology","score_opus":0.05183931871537081,"score_gpt":0.3413053131063495,"score_spread":0.2894659943909787,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977271642","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006524569,0.0013930554,0.0007906657,0.97383255,0.02153545,0.000012187651,0.00034424057,0.000090106696,0.0013493614],"genre_scores_gemma":[0.013260987,0.0008999119,0.0013621663,0.9664583,0.014475065,0.00006247824,0.0002113392,0.0001226119,0.003147124],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.97223973,0.007759413,0.0023783257,0.0045792917,0.011720136,0.0013231685],"domain_scores_gemma":[0.7704651,0.12794885,0.017785717,0.017010992,0.05833486,0.008454445],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.041966107,0.00072565547,0.0009399081,0.0015482316,0.0022547557,0.0034772607,0.003914909,0.008865357,0.016961552],"category_scores_gemma":[0.2517331,0.00055607775,0.0017504509,0.0016656638,0.005419238,0.0052466528,0.0038479704,0.021678044,0.0068965685],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009454885,0.000014698909,0.0020987627,0.0002672529,0.0001210115,0.00028769148,0.0005817234,0.00004420357,0.00013989763,0.007256229,0.9808686,0.0082254205],"study_design_scores_gemma":[0.00017808117,0.000087913024,0.017725961,0.0013078756,0.0003697202,0.0027803793,0.0047880653,0.00062238297,0.0012433772,0.047397707,0.92329806,0.00020043299],"about_ca_topic_score_codex":0.0038906736,"about_ca_topic_score_gemma":0.0074168914,"teacher_disagreement_score":0.9580339,"about_ca_system_score_codex":0.0025935944,"about_ca_system_score_gemma":0.0042855563,"threshold_uncertainty_score":0.22194064},"labels":[],"label_agreement":null},{"id":"W1977538915","doi":"10.7326/0003-4819-159-8-201310150-00018","title":"Statin Toxicity From Macrolide Antibiotic Coprescription","year":2013,"lang":"en","type":"letter","venue":"Annals of Internal Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Western University","funders":"","keywords":"Medicine; Antibiotics; Confounding; Macrolide Antibiotics; Population; Family medicine; Internal medicine; Erythromycin; Environmental health","score_opus":0.198259883138723,"score_gpt":0.4345395120581955,"score_spread":0.23627962891947252,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1977538915","genre_codex":"review","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12429621,0.3864914,0.003723219,0.18744998,0.02159181,0.0011604707,0.053738773,0.00063493353,0.22091319],"genre_scores_gemma":[0.54707384,0.22405009,0.001965514,0.09961935,0.023694035,0.0008117869,0.027766872,0.00029884084,0.07471968],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99486226,0.0013819217,0.0008554241,0.00024806065,0.00232775,0.0003246231],"domain_scores_gemma":[0.9826728,0.00757689,0.0050479104,0.00069114636,0.0035029887,0.0005082121],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036630107,0.00024840742,0.0008101633,0.0010708021,0.0003854987,0.001135244,0.0004001075,0.00078466855,0.024680289],"category_scores_gemma":[0.026366124,0.00017101182,0.0014087169,0.0021325508,0.0002732518,0.00042495367,0.00043231796,0.0010462572,0.0046486785],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00801755,0.000161972,0.036081746,0.007355988,0.0010132301,0.0017236315,0.00014920635,0.00014447542,0.000931558,0.0011880718,0.4926925,0.45054004],"study_design_scores_gemma":[0.0024378556,0.0032958037,0.26628557,0.014673262,0.0025695753,0.009420034,0.00047188697,0.00055252283,0.0067864065,0.003932783,0.6894264,0.00014782613],"about_ca_topic_score_codex":0.0042049782,"about_ca_topic_score_gemma":0.0069044232,"teacher_disagreement_score":0.024680289,"about_ca_system_score_codex":0.0019525589,"about_ca_system_score_gemma":0.0012788696,"threshold_uncertainty_score":0.08256376},"labels":[],"label_agreement":null},{"id":"W1980091283","doi":"10.1097/ede.0b013e31815c4d0e","title":"Estimating Interaction Between Genetic and Environmental Risk Factors","year":2008,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"National Heart, Lung, and Blood Institute","keywords":"Cohort; Nested case-control study; Framingham Heart Study; Statistics; Cohort study; Environmental health; Demography; Medicine; Econometrics; Framingham Risk Score; Disease; Internal medicine; Mathematics","score_opus":0.26043985756527305,"score_gpt":0.4336198720691994,"score_spread":0.17318001450392634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980091283","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21401955,0.00039242714,0.78397244,0.00020252961,0.000023983886,0.000057539513,0.00021645178,0.00020549665,0.0009095222],"genre_scores_gemma":[0.715788,0.00036099172,0.2817474,0.00008397348,0.000054736465,0.0001485392,0.0005641771,0.00004612271,0.0012061339],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9946536,0.0036606544,0.00015800435,0.00076898944,0.00059866573,0.00015998994],"domain_scores_gemma":[0.9453788,0.051476378,0.0010400965,0.0014014927,0.0005225965,0.00018068567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011167995,0.0006331049,0.0012204802,0.0014444063,0.00030448032,0.00079540926,0.0010060554,0.0008137748,0.0016529527],"category_scores_gemma":[0.05477229,0.0006259674,0.0010617358,0.0011168928,0.00077305484,0.0009035906,0.0011285519,0.0011106727,0.00016896792],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00077680266,0.00028374064,0.13047343,0.00028157225,0.0017297267,0.0006003364,0.000329169,0.6234632,0.0040816395,0.07096617,0.0008004665,0.16621374],"study_design_scores_gemma":[0.00008176399,0.000160799,0.019261008,0.000023956158,0.00023622921,0.0001546063,0.00003924988,0.9130782,0.0011034303,0.06503527,0.0007951391,0.000030364625],"about_ca_topic_score_codex":0.0048686736,"about_ca_topic_score_gemma":0.0036513812,"teacher_disagreement_score":0.011167995,"about_ca_system_score_codex":0.0005402556,"about_ca_system_score_gemma":0.0011001633,"threshold_uncertainty_score":0.05906266},"labels":[],"label_agreement":null},{"id":"W1980199310","doi":"10.2202/1557-4679.1400","title":"Special Issue on Causal Inference in Health Research","year":2012,"lang":"en","type":"editorial","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Biostatistics; Inference; Library science; Data science; Computer science; Econometrics; Mathematics; Public health; Medicine; Artificial intelligence","score_opus":0.26051950652904116,"score_gpt":0.5478536902653409,"score_spread":0.28733418373629976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980199310","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00001733472,0.0070583182,0.00033455226,0.012175577,0.9792509,0.000019221341,0.00008975951,0.000055994693,0.0009982908],"genre_scores_gemma":[0.00019396377,0.0040449793,0.0002011071,0.0046827304,0.9872136,0.00003073032,0.000045967387,0.000050315386,0.0035366472],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98930687,0.0025320586,0.001700448,0.0013337363,0.0046037496,0.00052318146],"domain_scores_gemma":[0.9390982,0.033997424,0.003555599,0.0019278938,0.01641288,0.0050080763],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013037224,0.004541727,0.0059539047,0.008654956,0.0028722917,0.009612416,0.0035158026,0.009729739,0.0332571],"category_scores_gemma":[0.049167957,0.0012295072,0.0038479122,0.0040122117,0.0030331123,0.0044705803,0.0018391195,0.015695183,0.014900419],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035971934,0.00001638012,0.000035790028,0.0004399714,0.000031051415,0.00006192366,0.000015039101,0.000047900023,0.00006178186,0.00062244956,0.9914929,0.0071388395],"study_design_scores_gemma":[0.00007779648,0.00004387456,0.0004440408,0.0009089122,0.000098915945,0.0003252181,0.00003667871,0.0003327911,0.00013602771,0.0038980849,0.9936706,0.000027019738],"about_ca_topic_score_codex":0.0014872142,"about_ca_topic_score_gemma":0.0035419264,"teacher_disagreement_score":0.0332571,"about_ca_system_score_codex":0.0036551475,"about_ca_system_score_gemma":0.005172992,"threshold_uncertainty_score":0.11125606},"labels":[],"label_agreement":null},{"id":"W1980722267","doi":"10.1016/j.jclinepi.2008.11.004","title":"Absolute risk reductions, relative risks, relative risk reductions, and numbers needed to treat can be obtained from a logistic regression model","year":2009,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":193,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Logistic regression; Relative risk; Confounding; Medicine; Absolute risk reduction; Cohort; Statistics; Odds ratio; Population; Cohort study; Regression analysis; Number needed to treat; Covariate; Confidence interval; Demography; Internal medicine; Mathematics; Environmental health","score_opus":0.5899278137115219,"score_gpt":0.5881755421570074,"score_spread":0.0017522715545145173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980722267","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021541217,0.010842449,0.9466807,0.011951253,0.0007558162,0.00031615447,0.002152889,0.0009857287,0.0047736904],"genre_scores_gemma":[0.5799871,0.017779142,0.3830839,0.0030542482,0.001896508,0.0023207148,0.0018074487,0.0005262589,0.009544784],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97581077,0.019292368,0.00087234215,0.0016052794,0.0020636793,0.00035550306],"domain_scores_gemma":[0.8423654,0.14747179,0.003243064,0.00573368,0.0009193352,0.00026675404],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04079945,0.0020476962,0.0047217673,0.0034779697,0.0003620999,0.002564097,0.0029317276,0.003367011,0.009289882],"category_scores_gemma":[0.18665595,0.0013436377,0.004787732,0.0030604952,0.0014486188,0.00481159,0.0017420416,0.0072669284,0.0013248507],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005824809,0.00079938094,0.013788053,0.0049938853,0.0068021277,0.00056677713,0.00051092973,0.26734275,0.0016978545,0.33389148,0.022642767,0.3411392],"study_design_scores_gemma":[0.0005955785,0.0005366214,0.0038642357,0.00047495952,0.0021550015,0.0006043509,0.000121300895,0.24406874,0.00076165044,0.7404193,0.0062571885,0.00014107187],"about_ca_topic_score_codex":0.0017434916,"about_ca_topic_score_gemma":0.0015326688,"teacher_disagreement_score":0.04079945,"about_ca_system_score_codex":0.0010988703,"about_ca_system_score_gemma":0.0016248347,"threshold_uncertainty_score":0.21577072},"labels":[],"label_agreement":null},{"id":"W1981158530","doi":"10.1002/cjs.11162","title":"Q‐learning for estimating optimal dynamic treatment rules from observational data","year":2012,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":88,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Neurological Disorders and Stroke; Canadian Institutes of Health Research; Mailman School of Public Health, Columbia University; National Institutes of Health","keywords":"Observational study; Covariate; Randomized experiment; Propensity score matching; Causal inference; Randomized controlled trial; Computer science; Analysis of covariance; Machine learning; Inference; Econometrics; Vocabulary; Statistics; Set (abstract data type); Artificial intelligence; Medicine; Mathematics","score_opus":0.3868564774755924,"score_gpt":0.4250497342740967,"score_spread":0.03819325679850433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981158530","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031961142,0.00061543874,0.9946719,0.0005111167,0.000049534658,0.00020679239,0.00016249304,0.000212263,0.00037445014],"genre_scores_gemma":[0.21636267,0.002237421,0.77242404,0.0009707886,0.00041369224,0.0027227672,0.0014278339,0.0002465936,0.0031941878],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9779012,0.017869212,0.00071422703,0.0019533779,0.0011256823,0.0004362141],"domain_scores_gemma":[0.7700515,0.21781486,0.0044916035,0.0042679347,0.0024540997,0.0009200145],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.050811313,0.0021463824,0.005093036,0.0031033254,0.0011514785,0.0022778453,0.003943273,0.0032207065,0.006876971],"category_scores_gemma":[0.18638402,0.0019134934,0.0027885695,0.003196101,0.0040777274,0.0033142022,0.0028781113,0.0072379424,0.00096258166],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047504716,0.0003101415,0.0059149847,0.00076449325,0.0006456995,0.00017970939,0.00033824844,0.6799341,0.00043612302,0.15927133,0.0043641054,0.14736599],"study_design_scores_gemma":[0.00014768362,0.00009914007,0.00039805163,0.00009511312,0.000045489905,0.000027754963,0.000019247702,0.858085,0.00020988315,0.13974434,0.0010996041,0.000028765879],"about_ca_topic_score_codex":0.012337739,"about_ca_topic_score_gemma":0.007475909,"teacher_disagreement_score":0.050811313,"about_ca_system_score_codex":0.0030712613,"about_ca_system_score_gemma":0.0055367346,"threshold_uncertainty_score":0.26871908},"labels":[],"label_agreement":null},{"id":"W1981620646","doi":"10.6000/1929-6029.2013.02.02.04","title":"Comparison of Post Hoc Multiple Pairwise Testing Procedures as Applied to Small k-Group Logrank Tests","year":2013,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Mental Health","keywords":"Bonferroni correction; Multiple comparisons problem; Pairwise comparison; Post-hoc analysis; Post hoc; False discovery rate; Statistics; Type I and type II errors; Log-rank test; Statistical hypothesis testing; Mathematics; Censoring (clinical trials); Computer science; Medicine; Survival analysis; Internal medicine; Biology","score_opus":0.302127508600054,"score_gpt":0.5532020893034955,"score_spread":0.25107458070344146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981620646","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06220643,0.0003618494,0.9295013,0.00040251447,0.00052768365,0.0027683736,0.00040925754,0.001029337,0.0027933463],"genre_scores_gemma":[0.28635314,0.00019000378,0.704615,0.00024728224,0.000107213906,0.0068797753,0.0002922031,0.00041379192,0.0009015183],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8051486,0.17247267,0.0041400497,0.0064792777,0.01040033,0.0013591119],"domain_scores_gemma":[0.42054722,0.5268731,0.012099343,0.028897146,0.010093744,0.0014895197],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14203994,0.0015062583,0.0025586782,0.002661958,0.0017535357,0.0023598257,0.0033928778,0.0016405422,0.007682891],"category_scores_gemma":[0.45768026,0.00078249676,0.0030296766,0.0028481486,0.0040039103,0.0042330865,0.002662391,0.0041603334,0.00076133304],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.023663811,0.0022498076,0.029650599,0.0034134302,0.0075485567,0.0012853624,0.0060968366,0.06943594,0.013796531,0.18210682,0.014864138,0.6458881],"study_design_scores_gemma":[0.003668732,0.037457958,0.05165072,0.0010316178,0.0025586316,0.0015452575,0.0030307767,0.4971972,0.039883517,0.33169714,0.029504614,0.0007738259],"about_ca_topic_score_codex":0.0009782908,"about_ca_topic_score_gemma":0.0011221777,"teacher_disagreement_score":0.85796005,"about_ca_system_score_codex":0.0017762394,"about_ca_system_score_gemma":0.004031354,"threshold_uncertainty_score":0.751188},"labels":[],"label_agreement":null},{"id":"W1981772720","doi":"10.2202/1557-4679.1285","title":"A Tutorial on Methods to Estimating Clinically and Policy-Meaningful Measures of Treatment Effects in Prospective Observational Studies: A Review","year":2011,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":98,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Observational study; Covariate; Number needed to treat; Propensity score matching; Medicine; Randomized controlled trial; Average treatment effect; Absolute risk reduction; Relative risk; Regression toward the mean; Treatment effect; Statistics; Confidence interval; Econometrics; Mathematics; Internal medicine","score_opus":0.6067013277402696,"score_gpt":0.62685556926826,"score_spread":0.02015424152799039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981772720","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012121071,0.82661223,0.1629498,0.003126887,0.0018662584,0.0004980777,0.0007264602,0.00025636167,0.0038426553],"genre_scores_gemma":[0.0015423747,0.8211832,0.16788207,0.0022164194,0.0020745224,0.0022268894,0.0006331602,0.000156188,0.002085254],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98510635,0.009168173,0.0020200028,0.00081395917,0.0027511932,0.00014035204],"domain_scores_gemma":[0.91569495,0.07725851,0.0025071453,0.0013741442,0.0028876942,0.0002775555],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.021620426,0.0032189956,0.0051364936,0.009730883,0.00047410413,0.0026234302,0.0033997886,0.004047595,0.01344192],"category_scores_gemma":[0.076569885,0.001713403,0.004170728,0.013134905,0.0019099223,0.0046237693,0.0017233677,0.005102483,0.008252285],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009113369,0.00011708284,0.00045710697,0.062336843,0.0009136949,0.0002454392,0.00026469503,0.0053633116,0.00069193967,0.08400664,0.099336736,0.74617547],"study_design_scores_gemma":[0.0001232604,0.00020150158,0.0014800765,0.04123127,0.0006747498,0.0009639252,0.00013555528,0.004265593,0.0006201425,0.19552574,0.7545768,0.0002013431],"about_ca_topic_score_codex":0.00327963,"about_ca_topic_score_gemma":0.0036914095,"teacher_disagreement_score":0.97837955,"about_ca_system_score_codex":0.0023913078,"about_ca_system_score_gemma":0.0044627176,"threshold_uncertainty_score":0.11434108},"labels":[],"label_agreement":null},{"id":"W1982364633","doi":"10.1016/j.jspi.2009.03.024","title":"Analytic bounds on causal risk differences in directed acyclic graphs involving three observed binary variables","year":2009,"lang":"en","type":"article","venue":"Journal of Statistical Planning and Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":41,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Mathematics; Directed acyclic graph; Combinatorics; Covariate; Monotonic function; Binary number; Upper and lower bounds; Measure (data warehouse); Discrete mathematics; Statistics","score_opus":0.1552871777379599,"score_gpt":0.3901827679038079,"score_spread":0.234895590165848,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982364633","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06592165,0.001939059,0.92268395,0.0025650365,0.000105613835,0.00014464364,0.0005026158,0.00038379183,0.0057536312],"genre_scores_gemma":[0.8314084,0.0023403468,0.1589354,0.0010275656,0.00046482054,0.0005314139,0.00081588235,0.00021375445,0.0042624725],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98990273,0.0057009687,0.0004015869,0.0014941631,0.0016914705,0.0008090718],"domain_scores_gemma":[0.56798667,0.40866327,0.009523118,0.007948115,0.003582407,0.0022963928],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03102879,0.0019562673,0.0036700985,0.004868713,0.001209031,0.0038390958,0.006135399,0.0036807584,0.006925672],"category_scores_gemma":[0.17909697,0.0019454826,0.00204346,0.0042818096,0.0065467567,0.009124331,0.0044982433,0.007883667,0.0004092102],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028210168,0.0001401594,0.0031239437,0.00025417714,0.00016773684,0.00021817608,0.000397219,0.20927723,0.00039842908,0.7654014,0.0015779465,0.018761449],"study_design_scores_gemma":[0.0000326885,0.000039656043,0.00051597407,0.00005686016,0.00006446923,0.00007754213,0.00004852657,0.31643948,0.0001915951,0.6819942,0.0005148798,0.000024039007],"about_ca_topic_score_codex":0.003014769,"about_ca_topic_score_gemma":0.0024990528,"teacher_disagreement_score":0.03102879,"about_ca_system_score_codex":0.0042660567,"about_ca_system_score_gemma":0.0022033209,"threshold_uncertainty_score":0.1640979},"labels":[],"label_agreement":null},{"id":"W1982959065","doi":"10.1002/sim.5795","title":"Propensity scores used for analysis of cluster randomized trials with selection bias: a simulation study","year":2013,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Propensity score matching; CRTS; Inverse probability weighting; Statistics; Selection bias; Weighting; Regression; Causal inference; Selection (genetic algorithm); Type I and type II errors; Matching (statistics); Randomization; Econometrics; Randomized controlled trial; Computer science; Mathematics; Medicine; Artificial intelligence; Internal medicine","score_opus":0.32206622457838024,"score_gpt":0.502459386483331,"score_spread":0.18039316190495075,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982959065","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1906442,0.0047871005,0.7917142,0.0020565945,0.0002765046,0.0056628594,0.00057129096,0.0005064257,0.003780835],"genre_scores_gemma":[0.7488573,0.0016171574,0.24340427,0.0004703908,0.00009648567,0.004777638,0.0002823983,0.00007412163,0.0004202974],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.88969827,0.104735784,0.0020576478,0.001217954,0.0018255534,0.0004648118],"domain_scores_gemma":[0.5069065,0.46086642,0.010461975,0.014422093,0.0061518955,0.0011911911],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09905737,0.0011306588,0.0022897697,0.0017336599,0.0005726208,0.0015131811,0.0016638244,0.0020460286,0.0031614555],"category_scores_gemma":[0.32553363,0.00066955783,0.003061156,0.0028103387,0.0012062255,0.0015781703,0.001682845,0.00236792,0.00022759063],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016097132,0.0018823321,0.03497265,0.0037835422,0.008827877,0.0009075506,0.00097291433,0.6722412,0.001078544,0.12947413,0.0056342524,0.12412783],"study_design_scores_gemma":[0.005829375,0.0030244056,0.002957641,0.0005985437,0.0019237369,0.0003120412,0.00014148491,0.9227362,0.00080105074,0.058282726,0.0032828,0.00010992961],"about_ca_topic_score_codex":0.0032079113,"about_ca_topic_score_gemma":0.0018531396,"teacher_disagreement_score":0.9009426,"about_ca_system_score_codex":0.0016278387,"about_ca_system_score_gemma":0.003600037,"threshold_uncertainty_score":0.52387166},"labels":[],"label_agreement":null},{"id":"W1982990880","doi":"10.1037/0012-1649.44.2.407","title":"Effects of kindergarten retention on children's social-emotional development: An application of propensity score method to multivariate, multilevel data.","year":2008,"lang":"en","type":"article","venue":"Developmental Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":110,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; Spencer Foundation","keywords":"Psychology; Developmental psychology; Multivariate statistics; Multilevel model; Grade retention; Propensity score matching; Child development; Early childhood; Academic achievement; Statistics","score_opus":0.3121952142747555,"score_gpt":0.45775660082990777,"score_spread":0.14556138655515227,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982990880","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.82986623,0.0012284555,0.16314247,0.0011356936,0.00015853149,0.00073594274,0.0019684203,0.00037745366,0.0013869526],"genre_scores_gemma":[0.9616744,0.00022319543,0.035848383,0.00011108659,0.000034138317,0.00067664654,0.0007395126,0.00004921776,0.0006433072],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.94259244,0.04782957,0.0017205946,0.0041198214,0.0027451883,0.000992396],"domain_scores_gemma":[0.849083,0.108045004,0.020674413,0.018591149,0.0022511098,0.0013553782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.059024364,0.0007815307,0.001368181,0.0023162817,0.0014087289,0.0016231672,0.0018114366,0.0014084855,0.004456712],"category_scores_gemma":[0.10699157,0.00056471594,0.004864012,0.0037357218,0.0013801628,0.0015142413,0.0035306164,0.0028275817,0.000261606],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00089643063,0.0003273063,0.9372947,0.0001426559,0.007271858,0.00021195992,0.0014569709,0.0033749556,0.00040148574,0.00513913,0.0012554192,0.042226978],"study_design_scores_gemma":[0.00024430666,0.0017042047,0.9005912,0.00014984941,0.0053840713,0.0002588082,0.0012943835,0.078354865,0.0013401816,0.007797936,0.0027609684,0.00011923545],"about_ca_topic_score_codex":0.02383905,"about_ca_topic_score_gemma":0.01862382,"teacher_disagreement_score":0.059024364,"about_ca_system_score_codex":0.0012826376,"about_ca_system_score_gemma":0.0018500834,"threshold_uncertainty_score":0.3121544},"labels":[],"label_agreement":null},{"id":"W1984304455","doi":"10.1007/s00038-012-0357-x","title":"Context by treatment interactions as the primary object of study in cluster randomized controlled trials of population health interventions","year":2012,"lang":"en","type":"article","venue":"International Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Randomized controlled trial; Context (archaeology); Psychological intervention; Intervention (counseling); Population; Cluster randomised controlled trial; Randomization; Population health; Public health; Medicine; Psychology; Nursing; Environmental health; Geography","score_opus":0.32418478063056677,"score_gpt":0.5514621425283893,"score_spread":0.22727736189782255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1984304455","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12922789,0.045776844,0.7899184,0.0070166257,0.006353216,0.014317398,0.0015087851,0.0012201885,0.004660625],"genre_scores_gemma":[0.6576438,0.0034978495,0.30134806,0.0027530838,0.0011842052,0.03126955,0.0005021083,0.00021883794,0.0015826315],"study_design_codex":"randomized_trial","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.39614767,0.5671155,0.008680032,0.018316887,0.007437385,0.0023025204],"domain_scores_gemma":[0.51612747,0.44232002,0.013639401,0.024301887,0.00215086,0.0014603804],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2523797,0.0043784706,0.01651588,0.0037353458,0.0033722154,0.0043284614,0.0052037295,0.010053683,0.008242859],"category_scores_gemma":[0.33724865,0.003829563,0.01979674,0.0043176534,0.009014352,0.009068495,0.0058000567,0.01443139,0.00041505872],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.30000114,0.004979457,0.022211784,0.029937746,0.15178436,0.00060349767,0.0037930205,0.0506789,0.0021379143,0.22119553,0.0065893135,0.20608737],"study_design_scores_gemma":[0.13083895,0.03531734,0.010390309,0.0041089775,0.11710303,0.00037435646,0.0007281582,0.13738045,0.0032239172,0.5511947,0.008710534,0.00062933244],"about_ca_topic_score_codex":0.0029395795,"about_ca_topic_score_gemma":0.0039021703,"teacher_disagreement_score":0.74762034,"about_ca_system_score_codex":0.0027841283,"about_ca_system_score_gemma":0.007929726,"threshold_uncertainty_score":0.92194897},"labels":[],"label_agreement":null},{"id":"W1985629392","doi":"10.1198/073500102288618702","title":"Was There a Riverside Miracle? A Hierarchical Framework for Evaluating Programs With Grouped Data","year":2003,"lang":"en","type":"article","venue":"Journal of Business and Economic Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Connaught Fund","keywords":"Pooling; Computer science; Econometrics; Independence (probability theory); Statistics; Mathematics; Artificial intelligence","score_opus":0.25498042265165877,"score_gpt":0.42733799986754506,"score_spread":0.1723575772158863,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1985629392","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.046496738,0.0010834761,0.93887544,0.0031392754,0.000104543506,0.0017264566,0.0013100207,0.0006270086,0.006637026],"genre_scores_gemma":[0.37420765,0.00038930043,0.6198512,0.00076598936,0.000085502244,0.0025611774,0.0007972191,0.000120386874,0.0012215477],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8124772,0.16406776,0.0037380878,0.007569761,0.010313752,0.0018334535],"domain_scores_gemma":[0.72951907,0.22248565,0.017450323,0.022013782,0.006171466,0.002359647],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13722448,0.0016897466,0.003186507,0.0053724535,0.0019174389,0.0042280746,0.0037140062,0.0027437871,0.0042619994],"category_scores_gemma":[0.2682575,0.0012303413,0.0040514567,0.004839745,0.005050017,0.007988214,0.0054612737,0.0038897088,0.00044828438],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010593305,0.0006646292,0.04240867,0.0009421499,0.0031797108,0.00031274342,0.0018533316,0.33867642,0.00086759997,0.41816092,0.005750299,0.18612415],"study_design_scores_gemma":[0.00030241773,0.0016769225,0.011167577,0.00041371415,0.00056390977,0.00007248791,0.000540628,0.63857114,0.00088961155,0.3399256,0.00574102,0.0001350757],"about_ca_topic_score_codex":0.027175454,"about_ca_topic_score_gemma":0.031561673,"teacher_disagreement_score":0.13722448,"about_ca_system_score_codex":0.007822596,"about_ca_system_score_gemma":0.0067128935,"threshold_uncertainty_score":0.7257211},"labels":[],"label_agreement":null},{"id":"W1986440280","doi":"10.1002/sim.3276","title":"The performance of different propensity score methods for estimating marginal odds ratios, <i>Statistics in Medicine</i> 2007; <b>26</b>:3078–3094","year":2008,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Citation; Library science; Odds; Sociology; Medicine; Statistics; Mathematics; Computer science; Logistic regression","score_opus":0.19247240902296991,"score_gpt":0.4680823787825111,"score_spread":0.27560996975954116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1986440280","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13476305,0.0057316693,0.8531286,0.0020215537,0.00038810307,0.00026063118,0.00084461697,0.0012361186,0.0016255945],"genre_scores_gemma":[0.4551406,0.0023046695,0.5380627,0.0004574114,0.000205368,0.00042763073,0.0015041581,0.0005111231,0.001386359],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9675721,0.027199484,0.0014745404,0.0013817892,0.0020650935,0.0003070155],"domain_scores_gemma":[0.6931232,0.283589,0.0045205345,0.012471291,0.005324556,0.0009714675],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.076192655,0.0012332851,0.0018796991,0.0036760161,0.000887246,0.0028459744,0.0028499109,0.0026117656,0.0035424314],"category_scores_gemma":[0.29111487,0.0009145431,0.0033480087,0.0035622467,0.0017756426,0.0038870566,0.0025416985,0.0024441795,0.0007171134],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009570111,0.00058190926,0.0761856,0.0016056858,0.0069268816,0.00019913349,0.0013889786,0.13802549,0.0017064667,0.074481525,0.014473802,0.67485446],"study_design_scores_gemma":[0.0019664664,0.0008691674,0.03100358,0.00030126225,0.001829089,0.00057083264,0.00038403974,0.8370856,0.0043409243,0.11712655,0.004258585,0.0002639099],"about_ca_topic_score_codex":0.0047654766,"about_ca_topic_score_gemma":0.0050034453,"teacher_disagreement_score":0.9238073,"about_ca_system_score_codex":0.0011230733,"about_ca_system_score_gemma":0.002965254,"threshold_uncertainty_score":0.4029501},"labels":[],"label_agreement":null},{"id":"W1986731614","doi":"10.1002/pds.1733","title":"The concept of the marginally matched subject in propensity‐score matched analyses","year":2009,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Medicine; Covariate; Calipers; Observational study; Internal medicine; Matching (statistics); Selection bias; Sample size determination; Statistics; Cardiology; Mathematics","score_opus":0.216395270431413,"score_gpt":0.4526145897411571,"score_spread":0.2362193193097441,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1986731614","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047421833,0.00060089765,0.99177307,0.0007863637,0.00019352617,0.0003304025,0.00017936128,0.00008912316,0.0013050814],"genre_scores_gemma":[0.17794202,0.0016391021,0.811781,0.0015660018,0.00092006207,0.0037728588,0.0005107906,0.0001331279,0.0017350067],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88877684,0.09676078,0.0028922735,0.0048561967,0.006053092,0.00066091813],"domain_scores_gemma":[0.8226305,0.1433675,0.012375991,0.017422888,0.0031228352,0.0010802682],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11825522,0.0011430107,0.002480208,0.003764033,0.0018116419,0.003426556,0.0032917918,0.0040540453,0.0050891936],"category_scores_gemma":[0.2327496,0.0010513954,0.002571329,0.0058396007,0.008425417,0.0063085384,0.0054293787,0.0067678085,0.0008362644],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052484684,0.00012604098,0.013387029,0.0005284827,0.0006870512,0.00042142216,0.0011061048,0.01959271,0.0007459076,0.85985625,0.0048891865,0.0981349],"study_design_scores_gemma":[0.00016962843,0.0004913302,0.004540761,0.0003034083,0.00039588983,0.00053686276,0.00029235883,0.081324555,0.0015534313,0.8859914,0.024277475,0.00012285869],"about_ca_topic_score_codex":0.0011786406,"about_ca_topic_score_gemma":0.00077515905,"teacher_disagreement_score":0.8817448,"about_ca_system_score_codex":0.0016212241,"about_ca_system_score_gemma":0.0034973861,"threshold_uncertainty_score":0.62540084},"labels":[],"label_agreement":null},{"id":"W1987839835","doi":"10.1503/cmaj.120592","title":"Adjustment for continuous confounders: an example of how to prevent residual confounding","year":2013,"lang":"en","type":"review","venue":"Canadian Medical Association Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":114,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Confounding; Observational study; Psychology; Medicine; Internal medicine","score_opus":0.2625521002949927,"score_gpt":0.4363196477322771,"score_spread":0.1737675474372844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1987839835","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00082143425,0.58823794,0.3952921,0.009057462,0.0017080848,0.00021434094,0.0008445208,0.00037249,0.0034515974],"genre_scores_gemma":[0.030389097,0.64756054,0.3109579,0.0045695873,0.0020403813,0.00085363485,0.000998262,0.00021506895,0.0024155073],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9906226,0.007056569,0.00059526804,0.0005362823,0.0010881545,0.00010101376],"domain_scores_gemma":[0.9643876,0.031760212,0.0010232505,0.0016217984,0.0011112741,0.00009589918],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.023473995,0.0016220007,0.003294656,0.0026667225,0.00046432656,0.0014201142,0.0026521664,0.0022716443,0.0052112467],"category_scores_gemma":[0.049595483,0.00063999486,0.004889425,0.003778234,0.001642338,0.0017266573,0.0014510446,0.004642366,0.0019369059],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017986697,0.000084749656,0.0016560114,0.019743802,0.003164391,0.00013555154,0.00028874067,0.0032958025,0.0005479184,0.08997836,0.021864846,0.85906],"study_design_scores_gemma":[0.00046507196,0.0002925629,0.0054200464,0.0193907,0.0040596304,0.0011662542,0.00024394524,0.0069247233,0.002269016,0.51981467,0.43975085,0.00020257782],"about_ca_topic_score_codex":0.004495421,"about_ca_topic_score_gemma":0.0051089036,"teacher_disagreement_score":0.976526,"about_ca_system_score_codex":0.0007285574,"about_ca_system_score_gemma":0.0030009071,"threshold_uncertainty_score":0.12414384},"labels":[],"label_agreement":null},{"id":"W1988058236","doi":"10.1016/j.jval.2013.03.280","title":"Properties of propensity score matching procedures on covariate balancing and estimation: Influence of the number of propensity score digits used on matched sets created","year":2013,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Propensity score matching; Covariate; Confounding; Statistics; Matching (statistics); Confidence interval; Numerical digit; Demography; Mathematics; Medicine; Arithmetic","score_opus":0.22731307978205686,"score_gpt":0.3683948052331946,"score_spread":0.14108172545113776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1988058236","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055183213,0.00071953825,0.9396523,0.0013246235,0.00011436389,0.00036301793,0.00040654748,0.00046936588,0.0017670785],"genre_scores_gemma":[0.51245147,0.0016245595,0.47858256,0.0010004193,0.0006467508,0.0012484068,0.0015313606,0.0010517212,0.0018627088],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.84959114,0.12693888,0.005572434,0.0073365853,0.008976465,0.001584422],"domain_scores_gemma":[0.08423024,0.86322737,0.012180974,0.03414028,0.0051846337,0.0010364255],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2574831,0.001601626,0.0040825307,0.003930519,0.002868214,0.005164158,0.004874874,0.0045783105,0.004773881],"category_scores_gemma":[0.7314806,0.0020489672,0.0029246316,0.006014612,0.007795555,0.012492129,0.0069460054,0.0055787005,0.0008738425],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0051032915,0.0008196716,0.055369366,0.0011907399,0.0024700626,0.00051515026,0.002827353,0.28705293,0.0040836884,0.35990825,0.0074761105,0.27318332],"study_design_scores_gemma":[0.0006712996,0.0004775495,0.00879493,0.0003733728,0.00059928064,0.0004229188,0.00032665444,0.5817201,0.0044918843,0.3995442,0.0024449122,0.00013290481],"about_ca_topic_score_codex":0.0033931,"about_ca_topic_score_gemma":0.002256958,"teacher_disagreement_score":0.7425169,"about_ca_system_score_codex":0.0012418175,"about_ca_system_score_gemma":0.0064391,"threshold_uncertainty_score":0.91565555},"labels":[],"label_agreement":null},{"id":"W1988221738","doi":"10.1080/00273171.2010.498292","title":"Assessing Mediational Models: Testing and Interval Estimation for Indirect Effects","year":2010,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":398,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Markov chain Monte Carlo; Bootstrapping (finance); Computer science; Type I and type II errors; Bayesian probability; Statistics; Confidence interval; Statistical hypothesis testing; Econometrics; Null hypothesis; Prior probability; Mathematics","score_opus":0.6989123915737223,"score_gpt":0.608930368580515,"score_spread":0.08998202299320734,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1988221738","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050216336,0.0020170363,0.93326795,0.00090172,0.00040184447,0.0027860329,0.0017468184,0.0011969535,0.00746526],"genre_scores_gemma":[0.3299869,0.00083363836,0.65456843,0.00033197686,0.00014960842,0.0120715,0.0011025518,0.0004195652,0.00053586194],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.69539905,0.25203192,0.009691572,0.017723426,0.023451751,0.0017021847],"domain_scores_gemma":[0.14683373,0.80524796,0.01644277,0.021765443,0.008976197,0.0007338804],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21447277,0.0026955903,0.003986045,0.008753337,0.0023170258,0.004694523,0.009248227,0.0033796194,0.012620694],"category_scores_gemma":[0.6872378,0.0015022112,0.008435718,0.011407826,0.004947328,0.011112189,0.007221518,0.006815868,0.0009996388],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029910787,0.0010810517,0.16130604,0.0069699436,0.018833056,0.0007750303,0.0119246505,0.02884867,0.0012201451,0.22463615,0.012522051,0.52889216],"study_design_scores_gemma":[0.0011806297,0.0052532465,0.094552085,0.004552107,0.007185369,0.00193225,0.008381294,0.33742955,0.005326481,0.50693685,0.026531816,0.0007384128],"about_ca_topic_score_codex":0.0024895496,"about_ca_topic_score_gemma":0.0012154735,"teacher_disagreement_score":0.21447277,"about_ca_system_score_codex":0.0017937459,"about_ca_system_score_gemma":0.004242151,"threshold_uncertainty_score":0.9686949},"labels":[],"label_agreement":null},{"id":"W1989087635","doi":"10.2139/ssrn.720061","title":"Estimation of Panel Data Models with Binary Indicators when Treatment Effects are not Constant over Time","year":2004,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Constant (computer programming); Panel data; Econometrics; Binary number; Estimation; Statistics; Binary data; Mathematics; Computer science; Economics","score_opus":0.09702859518878437,"score_gpt":0.35155092146082867,"score_spread":0.2545223262720443,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1989087635","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11520343,0.0024831928,0.8679446,0.003764461,0.00033346692,0.00035772115,0.005769044,0.00057816546,0.003565939],"genre_scores_gemma":[0.8336953,0.0026142225,0.1415922,0.0007817696,0.00037461866,0.0012833658,0.008294539,0.00012910122,0.011234869],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9887058,0.008877144,0.00032852325,0.0012280233,0.00030496944,0.0005556536],"domain_scores_gemma":[0.8961044,0.0917853,0.0052019786,0.0056823995,0.00074716343,0.00047876092],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022173733,0.0011200289,0.0036047536,0.0013504056,0.0007019058,0.0029028044,0.0028001468,0.003060606,0.009588191],"category_scores_gemma":[0.06810539,0.0017135204,0.0028539519,0.0033696764,0.00092236383,0.0020777667,0.0016109898,0.0039044803,0.0013256795],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024714572,0.0010267001,0.094959766,0.0011860408,0.007955272,0.00093143544,0.0010018899,0.5129068,0.0007440523,0.17788436,0.016890593,0.18204163],"study_design_scores_gemma":[0.0005615548,0.00033573434,0.015797133,0.00023540521,0.002364216,0.00017985122,0.00027486836,0.7117703,0.000791039,0.2602533,0.007349797,0.000086731576],"about_ca_topic_score_codex":0.010931723,"about_ca_topic_score_gemma":0.011223602,"teacher_disagreement_score":0.022173733,"about_ca_system_score_codex":0.0011956636,"about_ca_system_score_gemma":0.0021530339,"threshold_uncertainty_score":0.11726731},"labels":[],"label_agreement":null},{"id":"W1991570465","doi":"10.1016/s0895-4356(00)00210-9","title":"Choice of effect measure for epidemiological data","year":2000,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":196,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Relative risk; Number needed to treat; Measure (data warehouse); Statistics; Econometrics; Medicine; Absolute risk reduction; Odds ratio; Statistical model; Confidence interval; Mathematics; Actuarial science; Computer science; Data mining; Economics","score_opus":0.8208651165333847,"score_gpt":0.6680076360632555,"score_spread":0.15285748047012915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1991570465","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012980175,0.0008366384,0.98114866,0.0032529791,0.000086302694,0.00015326995,0.00035370103,0.00017927961,0.0010089957],"genre_scores_gemma":[0.41452813,0.0019544698,0.5759477,0.0015090215,0.00063430803,0.0014380933,0.0008373737,0.00021702562,0.0029339532],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93433934,0.05338709,0.0024773513,0.004754204,0.0041232076,0.00091875286],"domain_scores_gemma":[0.6082539,0.36944634,0.004087036,0.013648411,0.0027942006,0.0017700705],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11400994,0.0014079403,0.005336762,0.0066959965,0.0009644144,0.005211167,0.0054508876,0.005669747,0.0053503388],"category_scores_gemma":[0.284961,0.002011164,0.0045930436,0.004157495,0.0042029065,0.007565661,0.0051323483,0.006753681,0.00064934907],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001399758,0.00043354894,0.0089956755,0.0016740995,0.0018156269,0.0005263678,0.00046452082,0.043617595,0.0016395401,0.78317815,0.00394073,0.15231434],"study_design_scores_gemma":[0.00052822457,0.0003034212,0.0018586882,0.00029154003,0.00061117887,0.00041378813,0.000075438096,0.14194888,0.001451466,0.8495935,0.002861053,0.000062794745],"about_ca_topic_score_codex":0.0007819541,"about_ca_topic_score_gemma":0.00063005905,"teacher_disagreement_score":0.8859901,"about_ca_system_score_codex":0.001856877,"about_ca_system_score_gemma":0.0024325484,"threshold_uncertainty_score":0.6029494},"labels":[],"label_agreement":null},{"id":"W1993260957","doi":"10.1037/a0024918","title":"Marginal mean weighting through stratification: A generalized method for evaluating multivalued and multiple treatments with nonexperimental data.","year":2011,"lang":"en","type":"article","venue":"Psychological Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Academy of Education; Spencer Foundation; Social Sciences and Humanities Research Council of Canada; William T. Grant Foundation","keywords":"Causal inference; Covariate; Propensity score matching; Weighting; Average treatment effect; Inverse probability weighting; Statistics; Mathematics; Randomized experiment; Econometrics; Nonparametric statistics; Inference; Binary data; Computer science; Artificial intelligence; Binary number","score_opus":0.793516695385926,"score_gpt":0.6567447400249953,"score_spread":0.13677195536093067,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1993260957","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008678468,0.00077454903,0.99500376,0.00029506916,0.00016641893,0.0012580244,0.0002252099,0.0003133252,0.0010957641],"genre_scores_gemma":[0.018492635,0.0008521231,0.9743406,0.00033669273,0.00009976841,0.0047049527,0.00029017392,0.00019301086,0.0006900327],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8507547,0.13168994,0.0037170965,0.0041177482,0.009042163,0.00067834626],"domain_scores_gemma":[0.83727866,0.13022807,0.0082661295,0.016095951,0.0070015574,0.0011296945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1238361,0.0024136512,0.0038901397,0.0074761673,0.0017559455,0.0037977102,0.0036098734,0.0026289558,0.011373541],"category_scores_gemma":[0.2568608,0.0015689647,0.0060199485,0.0073901345,0.00573038,0.0046860417,0.007082033,0.005841863,0.0014945406],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045908327,0.00019125358,0.00535722,0.0025550576,0.0029950824,0.00023847312,0.0021952705,0.023756951,0.0012111122,0.3658085,0.014599153,0.58063275],"study_design_scores_gemma":[0.00040968476,0.00059201673,0.0040582046,0.001697769,0.0012413079,0.00039923,0.00048581793,0.10758884,0.0019328446,0.8190166,0.06230559,0.00027205813],"about_ca_topic_score_codex":0.004315569,"about_ca_topic_score_gemma":0.005233668,"teacher_disagreement_score":0.1238361,"about_ca_system_score_codex":0.0039730337,"about_ca_system_score_gemma":0.009438946,"threshold_uncertainty_score":0.6549157},"labels":[],"label_agreement":null},{"id":"W1993593244","doi":"10.1037/a0030785","title":"Correct effect size estimates for strength of association statistics: Comment on Odgaard and Fowler (2010).","year":2013,"lang":"en","type":"letter","venue":"Journal of Consulting and Clinical Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Jefferson Scholars Foundation; International Max Planck Research School for Environmental, Cellular and Molecular Microbiology; Association for Psychological Science; National Institute of Mental Health; American Psychological Foundation","keywords":"Statistics; Association (psychology); Psychology; Confidence interval; Econometrics; Estimation; Mathematics; Engineering","score_opus":0.1792739430403617,"score_gpt":0.507155372582864,"score_spread":0.3278814295425023,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1993593244","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001483603,0.00058187725,0.00037509642,0.97806245,0.019656422,0.000020878513,0.00015895955,0.00008759538,0.00090836943],"genre_scores_gemma":[0.0013793221,0.00030493416,0.00071982486,0.98081124,0.014759504,0.000064335545,0.000028842695,0.00004383267,0.0018881079],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9776372,0.005544924,0.00471002,0.0022492846,0.00889175,0.0009668399],"domain_scores_gemma":[0.8997691,0.060374204,0.006014201,0.0028240082,0.027999401,0.0030190153],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.020352142,0.0015005369,0.0018637219,0.0017626742,0.0034703608,0.003367512,0.005554403,0.056935806,0.0065467474],"category_scores_gemma":[0.17887713,0.0013412123,0.0025347786,0.0018734924,0.0066262153,0.0059163948,0.0027611954,0.046944793,0.012679637],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035667977,0.000013258171,0.000276913,0.00005262455,0.0000071004533,0.0003297675,0.00014867441,0.000044394936,0.00007204841,0.002348959,0.9926548,0.004015885],"study_design_scores_gemma":[0.00025469507,0.00013700723,0.0032865936,0.0011616077,0.00006822988,0.0033374205,0.0007233924,0.0011970898,0.00082618603,0.02951115,0.95930403,0.00019253905],"about_ca_topic_score_codex":0.025036367,"about_ca_topic_score_gemma":0.021113446,"teacher_disagreement_score":0.9796479,"about_ca_system_score_codex":0.0085700555,"about_ca_system_score_gemma":0.008404171,"threshold_uncertainty_score":0.10763371},"labels":[],"label_agreement":null},{"id":"W1995014100","doi":"10.1016/j.jclinepi.2012.02.012","title":"Treatment effects on patient-important outcomes can be small, even with large effects on surrogate markers","year":2012,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Surrogate endpoint; Medicine; Randomized controlled trial; Confidence interval; Intensive care medicine; Clinical trial; Outcome (game theory); Internal medicine","score_opus":0.32462153297885415,"score_gpt":0.5232699659370967,"score_spread":0.19864843295824258,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1995014100","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.089893766,0.013648531,0.85784703,0.021319242,0.0012338307,0.00084837223,0.0024445558,0.0007396537,0.012025052],"genre_scores_gemma":[0.89719814,0.0045218663,0.08568814,0.0059111672,0.000970995,0.0010253228,0.00070089084,0.00013266441,0.00385068],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9501876,0.035282828,0.0027313707,0.0065149446,0.0040115155,0.0012717254],"domain_scores_gemma":[0.5002495,0.46217388,0.014549275,0.020169929,0.0019666282,0.0008907302],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.099190965,0.0023459173,0.004625231,0.0020406079,0.0008754256,0.004214145,0.0025942975,0.004764495,0.0060516563],"category_scores_gemma":[0.30589032,0.0018608237,0.0039909324,0.0024715741,0.0075911516,0.0058932975,0.0043803956,0.009451014,0.00074213755],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036887366,0.00086128275,0.07692194,0.00482658,0.0099837445,0.0031299961,0.0012992137,0.051642887,0.0045924853,0.64809656,0.008487915,0.18646866],"study_design_scores_gemma":[0.0009235199,0.0004116336,0.022059541,0.00048237765,0.003294784,0.00092388556,0.0001976008,0.04035978,0.0016501673,0.9241558,0.005459358,0.00008173521],"about_ca_topic_score_codex":0.0016432725,"about_ca_topic_score_gemma":0.0014647369,"teacher_disagreement_score":0.90080905,"about_ca_system_score_codex":0.0013359936,"about_ca_system_score_gemma":0.0019494124,"threshold_uncertainty_score":0.5245782},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W1995405631","doi":"10.1592/phco.24.13.1105.38083","title":"Pharmacoepidemiology II: The Nested Case‐Control Study—A Novel Approach in Pharmacoepidemiologic Research","year":2004,"lang":"en","type":"article","venue":"Pharmacotherapy The Journal of Human Pharmacology and Drug Therapy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":74,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Royal Victoria Hospital","funders":"","keywords":"Pharmacoepidemiology; Nested case-control study; Confounding; Matching (statistics); Medicine; Propensity score matching; Cohort study; Case-control study; Cohort; Epidemiology; Research design; Control (management); Statistics; Econometrics; Computer science; Internal medicine; Mathematics; Pathology; Artificial intelligence","score_opus":0.34458929487121653,"score_gpt":0.538914238796219,"score_spread":0.1943249439250025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1995405631","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021314597,0.016357334,0.94754815,0.007200602,0.0019597453,0.0010355895,0.00032648206,0.00007217624,0.004185246],"genre_scores_gemma":[0.2484063,0.016099963,0.71696794,0.008436332,0.0038196933,0.0035394288,0.00035941467,0.00008447921,0.0022864041],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9688681,0.024639023,0.0010136915,0.0026232544,0.0025941222,0.00026178223],"domain_scores_gemma":[0.9629008,0.02841538,0.0024431546,0.0047981944,0.0009822457,0.00046024902],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02526967,0.00046228,0.0018700921,0.0017179627,0.00061260833,0.0020465057,0.001799322,0.0018060757,0.001151705],"category_scores_gemma":[0.053230304,0.0006046607,0.0016044077,0.0020336863,0.0033036734,0.0020240624,0.002049451,0.0030987584,0.00018834813],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047643902,0.0003794437,0.04320246,0.002340046,0.0021940547,0.0024019002,0.0035775516,0.0056172106,0.003372304,0.70098865,0.009814268,0.22563562],"study_design_scores_gemma":[0.0005500331,0.0013701178,0.022792544,0.001423948,0.0012392818,0.009093893,0.0013256462,0.045874406,0.0023131084,0.80834347,0.105523154,0.00015037887],"about_ca_topic_score_codex":0.0019390113,"about_ca_topic_score_gemma":0.0018607076,"teacher_disagreement_score":0.9747303,"about_ca_system_score_codex":0.0010186053,"about_ca_system_score_gemma":0.002875358,"threshold_uncertainty_score":0.13364041},"labels":[],"label_agreement":null},{"id":"W1995875958","doi":"10.1257/aer.91.2.112","title":"Reconciling Conflicting Evidence on the Performance of Propensity-Score Matching Methods","year":2001,"lang":"en","type":"article","venue":"American Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":336,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Propensity score matching; Economics; Matching (statistics); Econometrics; Actuarial science; Positive economics; Statistics; Mathematics","score_opus":0.43998595875878393,"score_gpt":0.49663935314736035,"score_spread":0.05665339438857642,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1995875958","genre_codex":"review","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09689811,0.37769789,0.308378,0.19234414,0.0063913,0.0005525378,0.0032538404,0.00069089694,0.013793357],"genre_scores_gemma":[0.7870291,0.07057434,0.10384523,0.023912665,0.009456587,0.0006483958,0.0025667807,0.0005172906,0.001449629],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.43222392,0.5130273,0.019269422,0.012275739,0.021366047,0.001837561],"domain_scores_gemma":[0.061315887,0.88929874,0.015778242,0.020171616,0.012279503,0.0011560051],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.44281587,0.0033573124,0.0063868347,0.015124206,0.0020885963,0.010493205,0.009567719,0.008925912,0.006394959],"category_scores_gemma":[0.83827764,0.0024358379,0.0048256144,0.020458331,0.01095486,0.009833198,0.010313556,0.00910789,0.0012804577],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010378912,0.00040074246,0.08546851,0.014374686,0.058856167,0.00089867023,0.003017033,0.025957827,0.00048582186,0.23708363,0.04815839,0.51491976],"study_design_scores_gemma":[0.0036618675,0.00078675046,0.031772755,0.009339084,0.019634077,0.00072431617,0.0011653816,0.049034216,0.0019937824,0.8475447,0.03386707,0.00047598634],"about_ca_topic_score_codex":0.0037523233,"about_ca_topic_score_gemma":0.002710696,"teacher_disagreement_score":0.5571841,"about_ca_system_score_codex":0.0032678265,"about_ca_system_score_gemma":0.004948714,"threshold_uncertainty_score":0.6871072},"labels":[],"label_agreement":null},{"id":"W1996144317","doi":"10.1515/jci-2014-0022","title":"A Boosting Algorithm for Estimating Generalized Propensity Scores with Continuous Treatments","year":2014,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":153,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Diabetes and Digestive and Kidney Diseases; National Institute of Child Health and Human Development; National Institute on Drug Abuse; National Institutes of Health","keywords":"Covariate; Mathematics; Propensity score matching; Statistics; Boosting (machine learning); Causal inference; Estimator; Average treatment effect; Nonparametric statistics; Curse of dimensionality; Weighting; Econometrics; Algorithm; Computer science; Machine learning; Medicine","score_opus":0.13914851500014766,"score_gpt":0.40452671844930155,"score_spread":0.26537820344915386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1996144317","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012939174,0.00014714533,0.9980738,0.00006663177,0.000024966623,0.000054493434,0.000026753285,0.00016838357,0.00014383846],"genre_scores_gemma":[0.06381825,0.0003765261,0.9332635,0.0002318334,0.0001425246,0.0006416026,0.00035993184,0.00012141023,0.0010444187],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9938116,0.00428676,0.00024683165,0.00067009096,0.0007480054,0.00023666503],"domain_scores_gemma":[0.9912982,0.0062533473,0.00050374086,0.0007817083,0.00093009206,0.00023288741],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01363919,0.0013453497,0.003590624,0.0021982202,0.0010895941,0.0012986066,0.0031525777,0.0020385785,0.004099896],"category_scores_gemma":[0.02545111,0.0014370395,0.0024509472,0.0027240342,0.0011960143,0.0018994387,0.0024120524,0.003350067,0.0015789518],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002931386,0.00017999958,0.0038351421,0.00033530963,0.0004475964,0.00017303243,0.00019908953,0.5200761,0.0017176411,0.08204456,0.005571033,0.38512737],"study_design_scores_gemma":[0.00010371683,0.00007612171,0.0003660598,0.000030559535,0.000047682384,0.000060026185,0.000011291942,0.9363454,0.00036801174,0.060149092,0.0024223241,0.000019823818],"about_ca_topic_score_codex":0.0028848809,"about_ca_topic_score_gemma":0.0024463872,"teacher_disagreement_score":0.01363919,"about_ca_system_score_codex":0.0009872231,"about_ca_system_score_gemma":0.0026056627,"threshold_uncertainty_score":0.07213181},"labels":[],"label_agreement":null},{"id":"W1996851858","doi":"10.1214/14-ejs920","title":"Dynamic treatment regimes: Technical challenges and applications","year":2014,"lang":"en","type":"article","venue":"Electronic Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":170,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute of Biomedical Imaging and Bioengineering; National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; University of Waterloo; Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute on Drug Abuse; University of Michigan; National Cancer Institute; National Institutes of Health; National Science Foundation","keywords":"Estimator; Operationalization; Inference; Mathematics; Variety (cybernetics); Decision rule; Machine learning; Econometrics; Computer science; Mathematical optimization; Artificial intelligence; Statistics","score_opus":0.0495202221317277,"score_gpt":0.3737772155890598,"score_spread":0.3242569934573321,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1996851858","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004633817,0.0048853564,0.97642773,0.00875691,0.00020429018,0.00020990925,0.0003266008,0.00015384701,0.004401549],"genre_scores_gemma":[0.25666,0.008910781,0.7251828,0.0030485387,0.0011772015,0.001936693,0.00043927642,0.00018774677,0.0024570557],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9785847,0.01460016,0.0010764024,0.0026211764,0.0027886387,0.00032891645],"domain_scores_gemma":[0.8613757,0.12208248,0.004783264,0.008195692,0.0028180324,0.00074486964],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037142437,0.0008312976,0.0022454818,0.0016971293,0.0010608253,0.0042789523,0.0037498302,0.003652813,0.0051165344],"category_scores_gemma":[0.16779087,0.0011550748,0.001425983,0.0021908225,0.0052926214,0.0053892657,0.0034210407,0.009174,0.00076050096],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014201344,0.00011329643,0.0034129072,0.00049548794,0.00013792087,0.00017850363,0.00037023675,0.057944644,0.00046349713,0.79393697,0.0037588014,0.13904567],"study_design_scores_gemma":[0.00005636011,0.00006446848,0.00062392716,0.00020649713,0.000030021278,0.00013903204,0.00009546923,0.10925456,0.0002685203,0.88054633,0.008672597,0.000042181993],"about_ca_topic_score_codex":0.0034204929,"about_ca_topic_score_gemma":0.0017411172,"teacher_disagreement_score":0.037142437,"about_ca_system_score_codex":0.0031594515,"about_ca_system_score_gemma":0.0031282338,"threshold_uncertainty_score":0.19643033},"labels":[],"label_agreement":null},{"id":"W1996867876","doi":"10.1200/jco.2007.11.3670","title":"Statistical Power of Negative Randomized Controlled Trials Presented at American Society for Clinical Oncology Annual Meetings","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Oncology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":61,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto","funders":"","keywords":"Sample size determination; Medicine; Post-hoc analysis; Randomized controlled trial; Hazard ratio; Odds ratio; Logistic regression; Internal medicine; Post hoc; Clinical endpoint; Statistical power; Confidence interval; Clinical trial; Clinical Oncology; Statistics; Cancer","score_opus":0.41193859149800466,"score_gpt":0.6415961380156108,"score_spread":0.22965754651760611,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1996867876","genre_codex":"review","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20559296,0.32742247,0.28702092,0.04821676,0.017740918,0.07188785,0.010391742,0.0014474984,0.030278923],"genre_scores_gemma":[0.8399038,0.009887587,0.07372599,0.010786772,0.002819774,0.059630565,0.0017984031,0.0003078208,0.0011393309],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.15803827,0.66912323,0.107436635,0.017296266,0.046122123,0.00198349],"domain_scores_gemma":[0.031241456,0.881694,0.05370222,0.017324435,0.01483402,0.0012038386],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7238745,0.002488714,0.008963897,0.010505014,0.0018927898,0.009596736,0.0040623536,0.006907733,0.0065718475],"category_scores_gemma":[0.90536207,0.0023693058,0.009702403,0.007986551,0.0076045124,0.008567407,0.0054390766,0.0047494937,0.0008278366],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.06747259,0.001145531,0.32351875,0.13478228,0.101373434,0.0027044755,0.005826664,0.006998605,0.0028249046,0.029603105,0.034779266,0.28897038],"study_design_scores_gemma":[0.051953815,0.026339259,0.27718866,0.11830042,0.12384575,0.007095055,0.005452368,0.06418246,0.0101555325,0.16116998,0.15315777,0.0011590577],"about_ca_topic_score_codex":0.0004827285,"about_ca_topic_score_gemma":0.00049124355,"teacher_disagreement_score":0.2761255,"about_ca_system_score_codex":0.0036269787,"about_ca_system_score_gemma":0.0056014373,"threshold_uncertainty_score":0.34051192},"labels":[],"label_agreement":null},{"id":"W1997094667","doi":"10.1016/j.jclinepi.2007.10.024","title":"Fitting marginal structural models: estimating covariate-treatment associations in the reweighted data set can guide model fitting","year":2008,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; University of Toronto; McMaster University; St. Joseph’s Healthcare Hamilton","funders":"","keywords":"Covariate; Marginal structural model; Inverse probability weighting; Observational study; Inverse probability; Confounding; Data set; Econometrics; Statistics; Set (abstract data type); Weighting; Computer science; Medicine; Mathematics; Propensity score matching; Bayesian probability; Posterior probability","score_opus":0.8597393166556409,"score_gpt":0.631203739722787,"score_spread":0.22853557693285387,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1997094667","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0055076624,0.00032202518,0.9920982,0.00066882145,0.00006145202,0.00019051632,0.0003513873,0.0005832736,0.00021662202],"genre_scores_gemma":[0.09329949,0.00055691565,0.90190846,0.00046458436,0.00012998853,0.0011975105,0.0012503301,0.0005320128,0.0006608131],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.950013,0.042970918,0.0016072509,0.0037869965,0.0012931508,0.0003286952],"domain_scores_gemma":[0.64175516,0.32150254,0.005781645,0.025840165,0.004085137,0.0010353179],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09373927,0.0036342354,0.007098256,0.0052183135,0.0016922865,0.0049566845,0.0068631405,0.0050891936,0.009011823],"category_scores_gemma":[0.44402015,0.0040545673,0.005985738,0.00561279,0.002763339,0.0067044254,0.0054390663,0.012598809,0.0024042274],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023662918,0.00075412035,0.03604725,0.001975169,0.0062242616,0.000903549,0.002766993,0.34743762,0.0028418396,0.16893452,0.019934526,0.4098139],"study_design_scores_gemma":[0.0002659056,0.00017330563,0.0025864793,0.00027601895,0.0006251805,0.00021822804,0.00023409961,0.49899077,0.00075986783,0.49062976,0.0051020025,0.00013828675],"about_ca_topic_score_codex":0.011370851,"about_ca_topic_score_gemma":0.019974446,"teacher_disagreement_score":0.09373927,"about_ca_system_score_codex":0.0019411655,"about_ca_system_score_gemma":0.0062158555,"threshold_uncertainty_score":0.49574655},"labels":[],"label_agreement":null},{"id":"W1997700012","doi":"10.1016/j.annepidem.2015.02.008","title":"Does selection bias explain the obesity paradox among individuals with cardiovascular disease?","year":2015,"lang":"en","type":"article","venue":"Annals of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":113,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Confounding; Obesity; Confidence interval; Selection bias; National Health and Nutrition Examination Survey; Demography; Disease; Meta-analysis; Collider; Internal medicine; Information bias; Environmental health; Population; Pathology","score_opus":0.4596529075982262,"score_gpt":0.4456589622107649,"score_spread":0.013993945387461293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1997700012","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5498637,0.022573482,0.24334133,0.17153859,0.002124479,0.000207091,0.0013459735,0.00033678586,0.008668601],"genre_scores_gemma":[0.97389436,0.002793642,0.011647103,0.007637662,0.0020681391,0.000084224215,0.00023777396,0.000058278572,0.0015787531],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98246264,0.013305819,0.00070075924,0.0018078033,0.0010451544,0.00067787647],"domain_scores_gemma":[0.67823577,0.2864439,0.015128272,0.015919562,0.0029187694,0.0013536987],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05869412,0.0007678333,0.0022851143,0.002032685,0.00089781405,0.0019289227,0.0032804406,0.003597713,0.006792608],"category_scores_gemma":[0.23604503,0.0006902911,0.001962868,0.0023769373,0.0035767728,0.0038397086,0.00216286,0.0037493566,0.00046177223],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029669725,0.00042471944,0.49956807,0.0010509276,0.008250973,0.0023406623,0.0022413642,0.0077507915,0.0009799141,0.31527314,0.011274074,0.14787851],"study_design_scores_gemma":[0.0008465076,0.00021977027,0.053429652,0.00026360663,0.002592478,0.0014185362,0.00066546194,0.046754234,0.00042665296,0.88827837,0.0050492235,0.00005560876],"about_ca_topic_score_codex":0.0042505064,"about_ca_topic_score_gemma":0.0031261262,"teacher_disagreement_score":0.9413059,"about_ca_system_score_codex":0.0006119136,"about_ca_system_score_gemma":0.0015439028,"threshold_uncertainty_score":0.31040794},"labels":[],"label_agreement":null},{"id":"W1998083820","doi":"10.1007/s11336-004-1261-y","title":"Causal Inferences with Group Based Trajectory Models","year":2005,"lang":"en","type":"article","venue":"Psychometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":111,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Trajectory; Observational study; Causal inference; Psychology; Juvenile delinquency; Propensity score matching; Event (particle physics); Covariate; Econometrics; Longitudinal study; Outcome (game theory); Psychopathology; Time point; Causal model; Computer science; Developmental psychology; Statistics; Mathematics; Clinical psychology","score_opus":0.18948909795287625,"score_gpt":0.3953022201017843,"score_spread":0.20581312214890804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1998083820","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045447936,0.00025827973,0.99272597,0.0007396272,0.000056463887,0.00012985039,0.0003013276,0.00017780229,0.0010658613],"genre_scores_gemma":[0.29644635,0.0013207484,0.6937646,0.00057509885,0.00054919487,0.0019759224,0.0016466279,0.00015519674,0.003566218],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97246706,0.021261165,0.00089570973,0.0027637389,0.0021192038,0.00049316377],"domain_scores_gemma":[0.7189316,0.26216304,0.0055849147,0.010244011,0.0023342313,0.0007421017],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048668426,0.0016633874,0.0023306701,0.0055857734,0.0019467933,0.0032884516,0.004614835,0.0029732864,0.011591444],"category_scores_gemma":[0.20329484,0.0013458643,0.003931428,0.005911436,0.0031470545,0.0071255835,0.004351037,0.0063898703,0.00094973954],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015778525,0.00017094873,0.006354621,0.00030049312,0.00083646184,0.0003877035,0.0011992606,0.12887347,0.00014997592,0.7862177,0.0025654773,0.07278603],"study_design_scores_gemma":[0.0000514311,0.000022228684,0.00035725496,0.000039112314,0.0000786413,0.00006137706,0.00009053579,0.212729,0.000090590715,0.7848009,0.001661786,0.000017051436],"about_ca_topic_score_codex":0.011677601,"about_ca_topic_score_gemma":0.007726638,"teacher_disagreement_score":0.048668426,"about_ca_system_score_codex":0.0020527763,"about_ca_system_score_gemma":0.0027758915,"threshold_uncertainty_score":0.25738633},"labels":[],"label_agreement":null},{"id":"W1998147618","doi":"10.5555/3191835.3191958","title":"Adjustments to propensity score matching for network structures","year":2014,"lang":"en","type":"article","venue":"Advances in Social Networks Analysis and Mining","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Imperial Bank of Commerce (Canada)","funders":"","keywords":"Propensity score matching; Computer science; Inference; Metric (unit); Matching (statistics); Data mining; Observational study; Robustness (evolution); Machine learning; Artificial intelligence; Econometrics; Statistics; Mathematics; Engineering","score_opus":0.08983792281091064,"score_gpt":0.394851842228658,"score_spread":0.30501391941774736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1998147618","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009268376,0.00019314024,0.9848585,0.0011393738,0.0001968848,0.0008167803,0.00038286854,0.00047195223,0.0026721563],"genre_scores_gemma":[0.30966523,0.0003303924,0.6797278,0.0010510748,0.00026841607,0.0038969202,0.00083485624,0.00036015798,0.0038651142],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9021446,0.078144625,0.003727402,0.0080192955,0.006826409,0.0011377006],"domain_scores_gemma":[0.7913286,0.12795435,0.01554115,0.05703098,0.007200038,0.00094483263],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09013803,0.0010215314,0.0011507598,0.0026873897,0.0016466727,0.0031290445,0.0030101088,0.0020347114,0.010385869],"category_scores_gemma":[0.3499242,0.0008474458,0.0022696208,0.004545471,0.0031529511,0.0049404786,0.0035337312,0.0038511977,0.0014913576],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010956117,0.00036354671,0.04070523,0.0006635653,0.0015422514,0.00028064637,0.0019126124,0.041607954,0.0036186012,0.4719758,0.013725568,0.4225086],"study_design_scores_gemma":[0.0005105716,0.0007141769,0.027968701,0.00025370033,0.00062494224,0.0003626841,0.00036266836,0.11963154,0.0061585396,0.79285,0.050418764,0.00014370272],"about_ca_topic_score_codex":0.002785863,"about_ca_topic_score_gemma":0.0021262607,"teacher_disagreement_score":0.09013803,"about_ca_system_score_codex":0.0023239471,"about_ca_system_score_gemma":0.0028941764,"threshold_uncertainty_score":0.4767012},"labels":[],"label_agreement":null},{"id":"W2002688922","doi":"10.1007/s10654-005-7919-7","title":"Methods to Account for Attrition in Longitudinal Data: Do They Work? A Simulation Study","year":2005,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":112,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; University of Toronto; Mount Sinai Hospital; Institute for Work & Health","funders":"","keywords":"Missing data; Imputation (statistics); Attrition; Statistics; Weighting; Confounding; Inverse probability weighting; Selection bias; Logistic regression; Econometrics; Medicine; Mathematics; Propensity score matching","score_opus":0.6859470613835384,"score_gpt":0.6042021005713848,"score_spread":0.08174496081215366,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2002688922","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25351587,0.007124172,0.71557,0.015814196,0.0005800269,0.0011140795,0.0007687626,0.00060637115,0.0049065384],"genre_scores_gemma":[0.79823816,0.002658953,0.19107714,0.0021472834,0.0003200447,0.00171932,0.0004943169,0.00026512417,0.0030796763],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95665586,0.04060171,0.00059087353,0.00087989494,0.00082977756,0.0004419333],"domain_scores_gemma":[0.41568023,0.55879873,0.0061538,0.012917994,0.0047759623,0.0016733436],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10776533,0.0016920713,0.0031239144,0.0016552568,0.0012399879,0.0026277981,0.00382436,0.0055862553,0.008446381],"category_scores_gemma":[0.3774207,0.0010389409,0.0037360592,0.0021625534,0.001999574,0.0077795573,0.0019054371,0.005626617,0.0007205887],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007631063,0.0033247822,0.079356715,0.0015559619,0.00589836,0.00068074645,0.0030248,0.5210357,0.00032122395,0.1731366,0.0150821945,0.1889518],"study_design_scores_gemma":[0.0020846538,0.00073353056,0.0037411768,0.00026257205,0.0009077125,0.0002295895,0.00038289884,0.85535234,0.00017088854,0.13379885,0.0022532595,0.000082569255],"about_ca_topic_score_codex":0.010575457,"about_ca_topic_score_gemma":0.0068188086,"teacher_disagreement_score":0.8922347,"about_ca_system_score_codex":0.001494875,"about_ca_system_score_gemma":0.003410454,"threshold_uncertainty_score":0.56992435},"labels":[],"label_agreement":null},{"id":"W2004722883","doi":"10.1097/ede.0b013e3181a819a1","title":"Overadjustment Bias and Unnecessary Adjustment in Epidemiologic Studies","year":2009,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1947,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health","keywords":"Selection bias; Omitted-variable bias; Confounding; Information bias; Econometrics; Statistics; Proxy (statistics); Causal structure; Sampling bias; Non-response bias; Outcome (game theory); Causal inference; Sample size determination; Mathematics","score_opus":0.6176038876181804,"score_gpt":0.5397161510959915,"score_spread":0.07788773652218894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2004722883","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028283153,0.009278389,0.94678074,0.008163262,0.0007159318,0.00047834255,0.00036222266,0.00026340148,0.0056746243],"genre_scores_gemma":[0.54144186,0.0049769594,0.44333902,0.004845949,0.0013450575,0.0015231513,0.0002834737,0.00021259666,0.0020319293],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7199392,0.22702481,0.016489867,0.014259661,0.020363733,0.0019227709],"domain_scores_gemma":[0.4040785,0.49687868,0.040064,0.048697628,0.009363513,0.0009177378],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1786922,0.0012094756,0.0023020972,0.004016202,0.0018494636,0.0046407795,0.0034159736,0.0026916054,0.0018773797],"category_scores_gemma":[0.52926207,0.001250007,0.0026024538,0.0077802856,0.011869586,0.0054893345,0.006130153,0.0035057117,0.00033333502],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003154188,0.000066779474,0.042987097,0.0014849674,0.0013796241,0.00041159755,0.0030696436,0.025967909,0.00059304986,0.7975662,0.0035180731,0.12263969],"study_design_scores_gemma":[0.00011369898,0.000098788005,0.007090492,0.000573914,0.00038147965,0.0004669182,0.00026453185,0.029022656,0.0011011175,0.9449137,0.015888881,0.00008391789],"about_ca_topic_score_codex":0.0035867572,"about_ca_topic_score_gemma":0.002899771,"teacher_disagreement_score":0.8213078,"about_ca_system_score_codex":0.0034911246,"about_ca_system_score_gemma":0.004403013,"threshold_uncertainty_score":0.94502604},"labels":[],"label_agreement":null},{"id":"W2005088899","doi":"10.1080/03610910801942430","title":"The Performance of Two Data-Generation Processes for Data with Specified Marginal Treatment Odds Ratios","year":2008,"lang":"en","type":"article","venue":"Communications in Statistics - Simulation and Computation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Estimator; Monte Carlo method; Marginal model; Marginal structural model; Statistics; Econometrics; Marginal distribution; Marginal likelihood; Computer science; Random effects model; Observational study; Mathematics; Regression analysis; Meta-analysis; Random variable; Maximum likelihood; Medicine","score_opus":0.6337313364642472,"score_gpt":0.5459520870387204,"score_spread":0.08777924942552673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005088899","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06382266,0.0007070593,0.931799,0.00061095774,0.00007483908,0.0008719334,0.00026737672,0.00074893597,0.001097238],"genre_scores_gemma":[0.2851097,0.00052279833,0.7110157,0.00018328826,0.000048105132,0.0015116755,0.0007693364,0.00018704952,0.00065235974],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9556652,0.03301467,0.0021458124,0.0027784477,0.005580946,0.0008150284],"domain_scores_gemma":[0.6248366,0.333789,0.008502202,0.02178105,0.009553551,0.0015376064],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.082914345,0.0016695721,0.0027616287,0.003782826,0.001229084,0.0032964277,0.00370096,0.003639402,0.0032633985],"category_scores_gemma":[0.3178239,0.0011459079,0.002743743,0.0027585758,0.0027955715,0.0046033827,0.004472622,0.00379608,0.00081010157],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004771371,0.00077720603,0.04259729,0.0008876844,0.00086562074,0.0004331568,0.0018089911,0.41207984,0.003144981,0.19686803,0.0026048578,0.33316094],"study_design_scores_gemma":[0.00043737478,0.00038226953,0.0037291104,0.00014448116,0.000109007706,0.00022987663,0.00009508257,0.9409842,0.0031910238,0.04940322,0.0011900049,0.0001043333],"about_ca_topic_score_codex":0.0059563043,"about_ca_topic_score_gemma":0.003649146,"teacher_disagreement_score":0.082914345,"about_ca_system_score_codex":0.0024419995,"about_ca_system_score_gemma":0.0041507077,"threshold_uncertainty_score":0.4384982},"labels":[],"label_agreement":null},{"id":"W2006163668","doi":"10.1002/cjs.11161","title":"Effect of vitamin A deficiency on respiratory infection: Causal inference for a discretely observed continuous time non‐stationary Markov process","year":2012,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"Markov chain Monte Carlo; Humanities; Markov chain; Computer science; Mathematics; Algorithm; Statistics; Philosophy; Monte Carlo method","score_opus":0.07634929076482239,"score_gpt":0.3699508109128798,"score_spread":0.2936015201480574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2006163668","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5536504,0.0014169749,0.43751547,0.0037814875,0.00014710418,0.00025454725,0.0014406459,0.00026428432,0.0015290274],"genre_scores_gemma":[0.9638358,0.0004426626,0.03360652,0.00022794142,0.00009306494,0.00017894348,0.000519445,0.000015196521,0.0010804576],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9924671,0.005273139,0.00025294223,0.001277756,0.00040967442,0.00031936984],"domain_scores_gemma":[0.85115343,0.13578217,0.006408265,0.0046619875,0.0011565113,0.0008376437],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021324534,0.0005581495,0.0015709492,0.001641454,0.0010365078,0.0016905352,0.0020999867,0.001796735,0.005049109],"category_scores_gemma":[0.0687247,0.0007580936,0.0021396584,0.0014282527,0.0025738175,0.0015723498,0.0014269848,0.0033858889,0.0002519356],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024291098,0.0010864987,0.36112148,0.0006402258,0.0032361099,0.0017819242,0.0013830246,0.34664732,0.0023381258,0.20292805,0.0030924163,0.07331561],"study_design_scores_gemma":[0.00033357195,0.00029231302,0.031379655,0.000098425546,0.00073306443,0.0002173521,0.00017794744,0.8857148,0.00078317046,0.07887919,0.0013293445,0.00006107361],"about_ca_topic_score_codex":0.03255951,"about_ca_topic_score_gemma":0.017962324,"teacher_disagreement_score":0.03255951,"about_ca_system_score_codex":0.0017332234,"about_ca_system_score_gemma":0.0019438048,"threshold_uncertainty_score":0.11277622},"labels":[],"label_agreement":null},{"id":"W2006185186","doi":"10.1080/00036840701721315","title":"The impact of the employment insurance repayment policy: nonexperimental approaches","year":2008,"lang":"en","type":"article","venue":"Applied Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Ontario Ministry of Labour; Statistics Canada","funders":"","keywords":"Economics; Sample (material); Matching (statistics); Currency; Estimation; Quality (philosophy); Income Support; Percentage point; Actuarial science; Econometrics; Demographic economics; Labour economics; Statistics; Macroeconomics; Finance; Mathematics","score_opus":0.18490539785629295,"score_gpt":0.3678257837093825,"score_spread":0.18292038585308956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2006185186","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6238172,0.0033721335,0.33863902,0.003012796,0.00080684863,0.015657766,0.001975207,0.00033885907,0.0123800775],"genre_scores_gemma":[0.8569392,0.0008516292,0.12015334,0.0018700525,0.00023912848,0.015322166,0.00044479893,0.00004752915,0.00413218],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.83696944,0.14720911,0.0037092997,0.005643975,0.0048771426,0.0015910296],"domain_scores_gemma":[0.53676444,0.41713458,0.020950198,0.021223957,0.0034663186,0.000460561],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12446596,0.0016079985,0.0029692238,0.002099605,0.0017177109,0.0022398918,0.005730165,0.0029007928,0.0061220587],"category_scores_gemma":[0.24429512,0.0012197347,0.00483582,0.001602542,0.0039688037,0.0028535542,0.0030132958,0.0025733856,0.0005652986],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.024384368,0.048548594,0.13380322,0.0104140155,0.026889373,0.0056029866,0.007999138,0.17770962,0.009220962,0.29962856,0.0072886986,0.24851051],"study_design_scores_gemma":[0.016932223,0.06842871,0.0689885,0.0013176809,0.021395234,0.0012402867,0.006848205,0.40928164,0.034962326,0.33766726,0.032230582,0.0007072908],"about_ca_topic_score_codex":0.005939436,"about_ca_topic_score_gemma":0.0029238667,"teacher_disagreement_score":0.12446596,"about_ca_system_score_codex":0.0023533604,"about_ca_system_score_gemma":0.003027003,"threshold_uncertainty_score":0.65824676},"labels":[],"label_agreement":null},{"id":"W2006416503","doi":"10.1016/j.ahj.2013.04.016","title":"Effects of nonpersistence with medication on outcomes in high-risk patients with cardiovascular disease","year":2013,"lang":"en","type":"article","venue":"American Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":62,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Population Health Research Institute","funders":"","keywords":"Medicine; Hazard ratio; Internal medicine; Myocardial infarction; Heart failure; Stroke (engine); Cardiology; Clinical endpoint; Diabetes mellitus; Placebo; Randomized controlled trial; Confidence interval","score_opus":0.026138853117505963,"score_gpt":0.30273977181490114,"score_spread":0.27660091869739517,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2006416503","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99498546,0.0013164536,0.0010619201,0.0014862277,0.00007571253,0.000011992837,0.0003430207,0.000013680297,0.0007054638],"genre_scores_gemma":[0.9986364,0.00029004723,0.00046095953,0.00010054651,0.00008677038,0.0000116745,0.00016202881,0.0000034407815,0.0002481438],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99668866,0.002293107,0.00015106273,0.00046374195,0.00014824125,0.0002551836],"domain_scores_gemma":[0.9475874,0.043137837,0.0043133413,0.0030124213,0.00046598972,0.001483117],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005119115,0.0005181032,0.0009351038,0.0003906221,0.00068709865,0.0010891483,0.0010699715,0.0012903012,0.0047924304],"category_scores_gemma":[0.03712728,0.0006098511,0.0025937362,0.0006011087,0.0006448157,0.0011270022,0.0012949618,0.00361969,0.00016654111],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010468211,0.0010425942,0.96530074,0.000098357275,0.00440126,0.00029292176,0.0001714987,0.0014082803,0.0002956271,0.000858667,0.0004504866,0.015211357],"study_design_scores_gemma":[0.00068308756,0.0021905524,0.9711406,0.00004215962,0.0047025126,0.00026668963,0.00040287466,0.012073114,0.00027642274,0.007829183,0.00036068514,0.000031969303],"about_ca_topic_score_codex":0.0063458993,"about_ca_topic_score_gemma":0.0054840865,"teacher_disagreement_score":0.0063458993,"about_ca_system_score_codex":0.00037047593,"about_ca_system_score_gemma":0.0008986471,"threshold_uncertainty_score":0.027072787},"labels":[],"label_agreement":null},{"id":"W2007805548","doi":"10.1080/0266476032000075976","title":"Impact evaluation of job training programmes: Selection bias in multilevel models","year":2003,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Regione Lombardia; Memorial University of Newfoundland","keywords":"Selection (genetic algorithm); Multilevel model; Computer science; Selection bias; Observational study; Propensity score matching; Set (abstract data type); Hierarchical database model; Random effects model; Sample (material); Sample size determination; Statistics; Econometrics; Machine learning; Data mining; Mathematics; Meta-analysis","score_opus":0.47239335593781373,"score_gpt":0.4972340829281534,"score_spread":0.02484072699033968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2007805548","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5726318,0.008547816,0.3941671,0.005733388,0.00039916,0.0021919534,0.0018336738,0.00029431202,0.014200925],"genre_scores_gemma":[0.96654797,0.00071745855,0.030561022,0.00025871687,0.00013172606,0.0007497323,0.00033187922,0.00003665307,0.00066485535],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.83525366,0.14906038,0.0027965966,0.002544148,0.008716521,0.0016285565],"domain_scores_gemma":[0.6629124,0.30563176,0.014733581,0.012494062,0.003027301,0.0012008657],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09885072,0.0010391121,0.0024346705,0.0030357463,0.00078193995,0.002687308,0.0016935484,0.0020250615,0.0049549234],"category_scores_gemma":[0.25382552,0.00040715528,0.003575602,0.0034853779,0.0020853062,0.0027276704,0.004457266,0.0021842935,0.0002539769],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011289763,0.001892728,0.27469483,0.0044353055,0.016761422,0.0006591993,0.0022050973,0.21487965,0.001862516,0.12580025,0.0033679751,0.34215128],"study_design_scores_gemma":[0.0019391435,0.010172548,0.2317738,0.0014970707,0.009803337,0.00035907942,0.0017053701,0.51763666,0.0062004495,0.21161991,0.0069967597,0.0002959473],"about_ca_topic_score_codex":0.0029985968,"about_ca_topic_score_gemma":0.0022235084,"teacher_disagreement_score":0.09885072,"about_ca_system_score_codex":0.0022304729,"about_ca_system_score_gemma":0.0019181845,"threshold_uncertainty_score":0.5227788},"labels":[],"label_agreement":null},{"id":"W2010284623","doi":"10.1515/jci-2012-0003","title":"A Marginal Structural Modeling Approach with Super Learning for a Study on Oral Bisphosphonate Therapy and Atrial Fibrillation","year":2013,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"U.S. Food and Drug Administration; Hamilton Health Sciences Foundation","keywords":"Marginal structural model; Medicine; Observational study; Pharmacoepidemiology; Confounding; Inverse probability weighting; Atrial fibrillation; Protocol (science); Inverse probability; Population; Intensive care medicine; Computer science; Alternative medicine; Surgery; Propensity score matching; Medical prescription; Internal medicine; Artificial intelligence","score_opus":0.18807789415654155,"score_gpt":0.4048811529188942,"score_spread":0.21680325876235265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010284623","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019386405,0.00023776568,0.97702515,0.001692877,0.00007186851,0.0004896413,0.00022877326,0.00018303852,0.0006844605],"genre_scores_gemma":[0.3332852,0.0004400572,0.65807545,0.001194584,0.00026744884,0.0033795356,0.00064301526,0.00009731967,0.0026173405],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9657478,0.030646691,0.00053849973,0.0016568565,0.00094763166,0.00046256476],"domain_scores_gemma":[0.8646798,0.12254524,0.0036366705,0.0045703137,0.0034550214,0.0011128598],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.055847194,0.0013241564,0.0023644262,0.0024225148,0.0015565034,0.0018698509,0.005074617,0.0028111357,0.006678411],"category_scores_gemma":[0.109070085,0.0014267918,0.0042041996,0.002252952,0.0036948868,0.0022812106,0.005057824,0.0054233824,0.0004793708],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012838896,0.000747384,0.028897515,0.000722766,0.0019004304,0.0011994623,0.002178119,0.5189366,0.00095713785,0.31876573,0.0057567144,0.1186543],"study_design_scores_gemma":[0.00010929936,0.00017637038,0.0012006081,0.00005839476,0.00017060901,0.00004972606,0.000100676116,0.8858909,0.0001688059,0.11047673,0.0015659383,0.000032014446],"about_ca_topic_score_codex":0.015237527,"about_ca_topic_score_gemma":0.014980957,"teacher_disagreement_score":0.055847194,"about_ca_system_score_codex":0.0024104076,"about_ca_system_score_gemma":0.005233732,"threshold_uncertainty_score":0.29535174},"labels":[],"label_agreement":null},{"id":"W201096548","doi":"10.1023/a:1015777918028","title":"Guest Editorial: Revealing the spaces of urban health","year":2001,"lang":"en","type":"article","venue":"GeoJournal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University; University of Calgary","funders":"","keywords":"Human geography; Geography; Economic geography","score_opus":0.13768216906553424,"score_gpt":0.42979501540699777,"score_spread":0.2921128463414635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W201096548","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009369575,0.0023025263,0.00027890128,0.08067814,0.9156111,0.000014178305,0.00010786085,0.000051585255,0.00086207944],"genre_scores_gemma":[0.0016143748,0.0018080237,0.00019167959,0.026330547,0.9647177,0.000023974542,0.000039358143,0.000049717404,0.0052246717],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.997232,0.00092277036,0.0003254845,0.00047944885,0.0008275973,0.00021260182],"domain_scores_gemma":[0.9731563,0.01619572,0.0012254897,0.0010252922,0.005829186,0.0025679441],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006581757,0.0034077212,0.0032796254,0.0044933944,0.0029562607,0.0062582074,0.0034579474,0.017281435,0.013105196],"category_scores_gemma":[0.036409985,0.001244682,0.0025381118,0.0019735263,0.0030300885,0.0032725048,0.0016670512,0.016730523,0.0046063834],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003622877,0.000009109349,0.00004348692,0.00011511063,0.000020225418,0.0001645387,0.000018219123,0.000026562622,0.0000424529,0.00054250564,0.99718636,0.0017952562],"study_design_scores_gemma":[0.00014511783,0.00006335939,0.0010512817,0.00049247564,0.00020652053,0.00070189027,0.00016775532,0.00069984497,0.00027114607,0.004510817,0.99164903,0.0000408141],"about_ca_topic_score_codex":0.001362962,"about_ca_topic_score_gemma":0.0035843824,"teacher_disagreement_score":0.017281435,"about_ca_system_score_codex":0.0018628618,"about_ca_system_score_gemma":0.0016227089,"threshold_uncertainty_score":0.043841183},"labels":[],"label_agreement":null},{"id":"W2010986175","doi":"10.1007/bf02753910","title":"Exact analysis of a paired sibling study","year":2004,"lang":"en","type":"article","venue":"Computational Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; National Science Foundation","keywords":"Goodness of fit; Exact test; Sibling; Monte Carlo method; Mathematics; Independence (probability theory); Statistics; Set (abstract data type); Combinatorics; Computer science; Psychology; Developmental psychology","score_opus":0.18145033049602313,"score_gpt":0.44952925693685314,"score_spread":0.26807892644083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010986175","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.30740237,0.0017499317,0.6784809,0.00178846,0.00038933588,0.0002307783,0.0013277816,0.00023150153,0.008398851],"genre_scores_gemma":[0.9399864,0.00026384497,0.05462619,0.00029715063,0.00015184902,0.00018303566,0.00042159852,0.000031711723,0.004038289],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98345196,0.012356478,0.00041864614,0.0022466641,0.0009869413,0.0005393972],"domain_scores_gemma":[0.8917059,0.08651168,0.003722369,0.014620898,0.0022385123,0.0012006074],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02779911,0.00043428404,0.0013639306,0.0011467978,0.0009807196,0.0013848513,0.0027302136,0.0015237116,0.016844708],"category_scores_gemma":[0.09866755,0.00056855124,0.0013091798,0.00163756,0.00206369,0.0023305723,0.0019335138,0.0016060966,0.00053906994],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025333252,0.0006018911,0.09137092,0.0005660411,0.0026162392,0.0046343817,0.0018933538,0.019075474,0.0024679299,0.7033376,0.009077255,0.16182548],"study_design_scores_gemma":[0.0006058074,0.0006598817,0.01910689,0.00012263074,0.0013486495,0.0026818232,0.0008726856,0.14007474,0.001913925,0.8270799,0.0054762852,0.000056873043],"about_ca_topic_score_codex":0.002402614,"about_ca_topic_score_gemma":0.0028950488,"teacher_disagreement_score":0.02779911,"about_ca_system_score_codex":0.0005994647,"about_ca_system_score_gemma":0.0016421112,"threshold_uncertainty_score":0.14701754},"labels":[],"label_agreement":null},{"id":"W2012160149","doi":"10.1016/j.healthpol.2014.10.006","title":"Inclusion of quasi-experimental studies in systematic reviews of health systems research","year":2014,"lang":"en","type":"article","venue":"Health Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":100,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Alliance for Health Policy and Systems Research; Wellcome Trust; World Health Organization","keywords":"Causal inference; Systematic review; Management science; Clinical study design; Research design; Quasi-experiment; Instrumental variable; Inclusion (mineral); Inference; Data science; Computer science; Regression discontinuity design; Critical appraisal; Psychology; MEDLINE; Medicine; Econometrics; Sociology; Social science; Clinical trial; Alternative medicine; Social psychology; Political science; Artificial intelligence; Machine learning; Mathematics; Engineering","score_opus":0.7361369618667926,"score_gpt":0.6844399371634319,"score_spread":0.05169702470336068,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2012160149","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020192381,0.21692047,0.6716729,0.011787521,0.0120950565,0.05109002,0.0068801558,0.0009771723,0.008384325],"genre_scores_gemma":[0.39023277,0.025868552,0.40619904,0.0066546877,0.0026130658,0.16455181,0.0017406888,0.00024059045,0.0018987773],"study_design_codex":"systematic_review","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.14010613,0.7605746,0.06666973,0.014188467,0.017382486,0.0010787003],"domain_scores_gemma":[0.04558688,0.89606,0.023900513,0.02936213,0.004556649,0.00053388404],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5732857,0.004730432,0.018691791,0.009761053,0.0036047609,0.0074687367,0.008221217,0.011061082,0.022087691],"category_scores_gemma":[0.8707491,0.005978122,0.024846846,0.010629113,0.009793466,0.018654559,0.009389822,0.008512317,0.0012487546],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019670237,0.0011445875,0.008374441,0.46813217,0.21331997,0.00068298035,0.004038053,0.007199336,0.0010576426,0.09385476,0.005779348,0.17674646],"study_design_scores_gemma":[0.05591851,0.010457125,0.014023385,0.122659355,0.24795397,0.000778698,0.0014236025,0.02020979,0.003470139,0.4851414,0.037308294,0.00065573637],"about_ca_topic_score_codex":0.0038713138,"about_ca_topic_score_gemma":0.005741045,"teacher_disagreement_score":0.4267143,"about_ca_system_score_codex":0.0065856716,"about_ca_system_score_gemma":0.017441757,"threshold_uncertainty_score":0.5262147},"labels":[],"label_agreement":null},{"id":"W2012650559","doi":"10.1016/j.jclinepi.2009.02.001","title":"Local estimates of population attributable risk","year":2009,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Statistics; Variance (accounting); Population; Attributable risk; Econometrics; Sample size determination; Mathematics; Estimation; Medicine; Environmental health; Economics","score_opus":0.5435159796539971,"score_gpt":0.6108650887029108,"score_spread":0.06734910904891367,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2012650559","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04446803,0.0033785112,0.9442521,0.0010137771,0.00006613627,0.00010686905,0.0008954891,0.00041922968,0.0053999345],"genre_scores_gemma":[0.8167724,0.0026129733,0.17329955,0.00031653576,0.00025743846,0.0005529652,0.0011669829,0.00012212644,0.0048990236],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.994586,0.003943228,0.00013618433,0.00074973423,0.0004717484,0.00011305173],"domain_scores_gemma":[0.9695631,0.023813171,0.0015311934,0.0034869183,0.0013092271,0.0002963907],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011163983,0.0006336524,0.0020946825,0.00325692,0.000547069,0.0024481742,0.0016927257,0.00084255805,0.0073633506],"category_scores_gemma":[0.050949585,0.00064408913,0.0015771459,0.0022273604,0.0012840598,0.0027913805,0.0027431534,0.002608744,0.0010065737],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00079059193,0.00030669358,0.05104599,0.0013974294,0.003111562,0.0006857956,0.0012371073,0.19371626,0.0022075877,0.5200297,0.010334872,0.2151364],"study_design_scores_gemma":[0.00023573321,0.00026256518,0.018399995,0.00036809064,0.0011505791,0.0008141774,0.00040128245,0.2897223,0.0017902537,0.6769473,0.009830389,0.00007725267],"about_ca_topic_score_codex":0.0018750117,"about_ca_topic_score_gemma":0.002139688,"teacher_disagreement_score":0.011163983,"about_ca_system_score_codex":0.0009202799,"about_ca_system_score_gemma":0.0010330874,"threshold_uncertainty_score":0.0590415},"labels":[],"label_agreement":null},{"id":"W2013010700","doi":"10.1002/pds.1692","title":"Validating a method that deals with missing drug information in the Saskatchewan Drug Plan database","year":2008,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Jewish General Hospital","funders":"","keywords":"Medicine; Prostate cancer; Logistic regression; Conditional logistic regression; Warfarin; Drug; Incidence (geometry); Confidence interval; Cancer; Internal medicine; Pharmacology","score_opus":0.17595479739598152,"score_gpt":0.43304702020577746,"score_spread":0.25709222280979593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013010700","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23408942,0.0010157326,0.68527687,0.0022086496,0.00047519908,0.0025931967,0.060066488,0.007456785,0.0068175998],"genre_scores_gemma":[0.40360644,0.00031842725,0.5484771,0.00087119074,0.00013692853,0.0028340407,0.04137066,0.00048683074,0.0018983189],"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.95488596,0.027846476,0.005472858,0.0061115776,0.0050042192,0.00067891914],"domain_scores_gemma":[0.83087313,0.119231954,0.009471057,0.026013214,0.013739182,0.00067145925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.055355564,0.0008779487,0.001342998,0.0045359763,0.0013533538,0.0035502398,0.0026121568,0.0020068754,0.0061303996],"category_scores_gemma":[0.21123129,0.0009787318,0.0017391911,0.007368849,0.0007306036,0.0020219667,0.0018666969,0.0013631871,0.0022335323],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002031579,0.0004707429,0.5969771,0.0007947148,0.0034681966,0.0004647269,0.0006866791,0.034354374,0.0026907863,0.007998535,0.034092944,0.31596956],"study_design_scores_gemma":[0.0015950697,0.00063678256,0.32782152,0.00087363936,0.0011693039,0.0013838756,0.0008406773,0.5719556,0.014024895,0.018851832,0.06055235,0.000294378],"about_ca_topic_score_codex":0.04344014,"about_ca_topic_score_gemma":0.031897567,"teacher_disagreement_score":0.055355564,"about_ca_system_score_codex":0.001793033,"about_ca_system_score_gemma":0.0078064324,"threshold_uncertainty_score":0.29275173},"labels":[],"label_agreement":null},{"id":"W2013188809","doi":"10.1023/b:ejep.0000036568.02655.f8","title":"Loss to Follow-Up in Cohort Studies: How Much is Too Much?","year":2004,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":732,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lunenfeld-Tanenbaum Research Institute; Mount Sinai Hospital; Institute for Work & Health; University of Toronto","funders":"","keywords":"Medicine; Confounding; Cohort; Logistic regression; Missing data; Cohort study; Odds; Statistics; Demography; Internal medicine; Mathematics","score_opus":0.3441335696772531,"score_gpt":0.4711298412925512,"score_spread":0.12699627161529808,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013188809","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0689307,0.24881718,0.4104423,0.25411436,0.0105989305,0.0008532885,0.0029213917,0.0006815958,0.0026403475],"genre_scores_gemma":[0.7433625,0.053130653,0.09774308,0.0818928,0.01595168,0.00214357,0.0018260318,0.0003945596,0.0035550962],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.6709807,0.27060533,0.021979036,0.018067932,0.015575732,0.0027912832],"domain_scores_gemma":[0.14902036,0.7876668,0.024386683,0.030906968,0.0054197474,0.0025995828],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4180975,0.0018785462,0.009481296,0.0031882687,0.0031992474,0.005921212,0.009879319,0.011020366,0.004982052],"category_scores_gemma":[0.6889658,0.002675734,0.009446476,0.006276231,0.01173415,0.018275153,0.006952909,0.018427556,0.0005774865],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0076618767,0.0008631864,0.28495845,0.01834326,0.05167634,0.0018343078,0.0066185547,0.013976774,0.00036818293,0.101763286,0.03998075,0.47195515],"study_design_scores_gemma":[0.0025264937,0.0015907462,0.099720195,0.012400149,0.038866796,0.0026865676,0.0021426477,0.045601998,0.00077777304,0.7590706,0.034043275,0.000572673],"about_ca_topic_score_codex":0.008757475,"about_ca_topic_score_gemma":0.011739842,"teacher_disagreement_score":0.5819025,"about_ca_system_score_codex":0.0030167904,"about_ca_system_score_gemma":0.004877098,"threshold_uncertainty_score":0.7175894},"labels":[],"label_agreement":null},{"id":"W2013245256","doi":"10.1002/sim.3764","title":"A weighted Cox model for modelling time‐dependent exposures in the analysis of case–control studies","year":2010,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal","funders":"Canadian Institutes of Health Research; Health Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; McGill University","keywords":"Proportional hazards model; Computer science; Econometrics; Statistics; Mathematics","score_opus":0.14315108448926323,"score_gpt":0.4545637737110838,"score_spread":0.3114126892218206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013245256","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031441825,0.001964703,0.9917053,0.0006525217,0.0002975965,0.0006009729,0.0007412516,0.00022806705,0.00066541054],"genre_scores_gemma":[0.1970546,0.0089030685,0.7670521,0.0014695522,0.0012587919,0.011299488,0.0039310534,0.0003313955,0.008699853],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96220756,0.02975758,0.001597011,0.0033416832,0.0024983347,0.0005978423],"domain_scores_gemma":[0.9284231,0.061503924,0.0040192106,0.0034957228,0.0020897815,0.00046828666],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.060938936,0.0020766438,0.0027475397,0.004145216,0.0008270658,0.0028092435,0.005984206,0.0041600307,0.0064977836],"category_scores_gemma":[0.09774366,0.0014704318,0.0045630196,0.005550675,0.0017554222,0.0029954424,0.0020908725,0.005227666,0.0013659364],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000898121,0.00017543316,0.01599218,0.0018814572,0.002961656,0.0013414699,0.001132633,0.423824,0.0013292102,0.42813385,0.012463332,0.10986662],"study_design_scores_gemma":[0.0003506804,0.00045541333,0.001998965,0.00036947613,0.0007225769,0.00049829733,0.00010119567,0.7265714,0.0004919491,0.2510856,0.01722385,0.00013060957],"about_ca_topic_score_codex":0.009112414,"about_ca_topic_score_gemma":0.0059592547,"teacher_disagreement_score":0.060938936,"about_ca_system_score_codex":0.002029479,"about_ca_system_score_gemma":0.003967805,"threshold_uncertainty_score":0.32227975},"labels":[],"label_agreement":null},{"id":"W2013850221","doi":"10.1186/1742-5573-6-5","title":"Covariate balance in a Bayesian propensity score analysis of beta blocker therapy in heart failure patients","year":2009,"lang":"en","type":"article","venue":"Epidemiologic Perspectives & Innovations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto; University of British Columbia; Simon Fraser University","funders":"","keywords":"Propensity score matching; Covariate; Observational study; Confounding; Frequentist inference; Statistics; Medicine; Bayesian probability; Context (archaeology); Outcome (game theory); Econometrics; Internal medicine; Bayesian inference; Mathematics","score_opus":0.17663021973562892,"score_gpt":0.4049208873765729,"score_spread":0.22829066764094397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013850221","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32750908,0.0009182922,0.66594696,0.0026718539,0.00004309393,0.00028367335,0.00033828957,0.00018007266,0.002108722],"genre_scores_gemma":[0.9165699,0.00045025095,0.081021525,0.00028485828,0.00008333334,0.00023509047,0.0003413667,0.00003252552,0.000981068],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9781171,0.018575024,0.0005186446,0.0011831141,0.0012462478,0.0003598847],"domain_scores_gemma":[0.94829834,0.043324694,0.0047011813,0.0023651384,0.0009268142,0.00038389853],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05208913,0.00059417123,0.0014756739,0.0013248558,0.00064464577,0.0017352386,0.0011996804,0.0014945022,0.002535854],"category_scores_gemma":[0.126696,0.0005484162,0.0011490334,0.0015520517,0.0016022932,0.0024675545,0.0018205356,0.0013398546,0.00032272557],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002851977,0.0005530436,0.16861612,0.00031214574,0.0018197016,0.0004401577,0.0015816492,0.22497925,0.0029215256,0.34020475,0.0029846889,0.25273508],"study_design_scores_gemma":[0.0006027713,0.0007205846,0.041944597,0.000119050026,0.00059215026,0.00029567233,0.00021857167,0.61165816,0.0011528315,0.33877146,0.0038477676,0.000076335724],"about_ca_topic_score_codex":0.0021375867,"about_ca_topic_score_gemma":0.0012330173,"teacher_disagreement_score":0.05208913,"about_ca_system_score_codex":0.00080063345,"about_ca_system_score_gemma":0.0015679304,"threshold_uncertainty_score":0.27547693},"labels":[],"label_agreement":null},{"id":"W2013920814","doi":"10.1002/sim.4200","title":"Comparing paired vs non‐paired statistical methods of analyses when making inferences about absolute risk reductions in propensity‐score matched samples","year":2011,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":325,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Confidence interval; Confounding; Sample size determination; Selection bias; Observational study; Statistical significance; Statistical inference; Matching (statistics); Causal inference; Medicine; Mathematics","score_opus":0.6053372113795614,"score_gpt":0.5275261212026646,"score_spread":0.0778110901768968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013920814","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021434557,0.0020797662,0.9641409,0.0013563719,0.0014501314,0.004995408,0.0005793584,0.000549677,0.003413794],"genre_scores_gemma":[0.23323654,0.0009323264,0.7443196,0.0019420466,0.0005003312,0.016895536,0.0005524331,0.0005322728,0.0010888737],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.33207357,0.6052327,0.01939249,0.01550575,0.026587034,0.0012083781],"domain_scores_gemma":[0.14402986,0.75664485,0.0317837,0.05181341,0.014913506,0.0008146727],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3921677,0.0019584787,0.0038270568,0.003772027,0.0015521995,0.005874407,0.004651726,0.0037557436,0.008487406],"category_scores_gemma":[0.7571114,0.0017094209,0.007897763,0.0045128763,0.0068211155,0.0068406416,0.0049218354,0.008159158,0.0011846179],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013014706,0.0021766522,0.06633946,0.013094984,0.034942903,0.0011937494,0.010030798,0.044497408,0.0038848305,0.21430022,0.023765368,0.57275885],"study_design_scores_gemma":[0.006752149,0.016204834,0.07463906,0.00922901,0.014768853,0.0021743355,0.003535578,0.26513398,0.029514616,0.50069165,0.07604178,0.0013142325],"about_ca_topic_score_codex":0.0010846179,"about_ca_topic_score_gemma":0.0010714934,"teacher_disagreement_score":0.6078323,"about_ca_system_score_codex":0.002002545,"about_ca_system_score_gemma":0.0032877624,"threshold_uncertainty_score":0.7495655},"labels":[],"label_agreement":null},{"id":"W2016251103","doi":"10.1016/s0895-4356(02)00571-1","title":"Neyman's bias re-visited","year":2003,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":76,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Spurious relationship; Risk factor; Disease; Medicine; Statistics; Econometrics; Mathematics; Internal medicine","score_opus":0.8056101711120327,"score_gpt":0.6447404634119401,"score_spread":0.16086970770009257,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2016251103","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031756794,0.0072844215,0.9376846,0.017105721,0.007892571,0.00010683344,0.00023072235,0.000611814,0.02590765],"genre_scores_gemma":[0.2381602,0.0099652605,0.5716421,0.01442765,0.0124805,0.00029295782,0.0003309846,0.0011745635,0.15152581],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9860388,0.0077250306,0.0010628296,0.0017598829,0.0029527973,0.0004605769],"domain_scores_gemma":[0.9551311,0.027878791,0.0015599648,0.008406519,0.006557517,0.00046597357],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.023729615,0.0012787867,0.002265821,0.0031250415,0.0015806902,0.0034307027,0.0025819724,0.0034074767,0.015371865],"category_scores_gemma":[0.094933234,0.0009193811,0.0018442938,0.002706739,0.0027583856,0.004638635,0.0024431124,0.0064474517,0.005566321],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018364952,0.00007183936,0.001879481,0.00038378563,0.0002958569,0.00032684725,0.00023936579,0.003314131,0.00066121685,0.68528694,0.04319744,0.26415947],"study_design_scores_gemma":[0.00009328701,0.00007953961,0.0009350519,0.000202903,0.00021094832,0.0009942988,0.00006772861,0.024764128,0.0021260313,0.83201945,0.1384357,0.00007093728],"about_ca_topic_score_codex":0.0033831564,"about_ca_topic_score_gemma":0.0048162,"teacher_disagreement_score":0.9762704,"about_ca_system_score_codex":0.0025869503,"about_ca_system_score_gemma":0.004207375,"threshold_uncertainty_score":0.12549567},"labels":[],"label_agreement":null},{"id":"W2016403661","doi":"10.1002/bimj.200810488","title":"Some Methods of Propensity‐Score Matching had Superior Performance to Others: Results of an Empirical Investigation and Monte Carlo simulations","year":2009,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":769,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Statistics; Monte Carlo method; Matching (statistics); Standard deviation; Logit; Mathematics; Medicine","score_opus":0.37447359939304903,"score_gpt":0.48375300248447506,"score_spread":0.10927940309142603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2016403661","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6003972,0.0059387702,0.3795111,0.0024302914,0.00019766517,0.0021409178,0.0016521128,0.000975211,0.006756803],"genre_scores_gemma":[0.85446304,0.0016378096,0.14018112,0.00044390187,0.00013548782,0.0009740955,0.0010441194,0.00027172416,0.000848673],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9190413,0.06629736,0.0043550516,0.0043718405,0.004895106,0.0010393715],"domain_scores_gemma":[0.27386144,0.66941875,0.014195545,0.028030606,0.013535321,0.00095834525],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1601167,0.0016004683,0.003490126,0.0040280907,0.0013348552,0.0029385753,0.0020639228,0.0028881154,0.0034804975],"category_scores_gemma":[0.42404118,0.0009736824,0.0043670135,0.005659943,0.0025888619,0.0055450764,0.0017419228,0.0022245315,0.00061222166],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00733176,0.0013883512,0.15871006,0.0027992958,0.009898307,0.00037322837,0.0018669743,0.5436212,0.0011685349,0.03923329,0.0066587557,0.22695029],"study_design_scores_gemma":[0.0009120329,0.0017206797,0.04012752,0.00043549537,0.0012746687,0.00028236117,0.00038547607,0.92390794,0.0019722178,0.025220841,0.0034816926,0.00027904363],"about_ca_topic_score_codex":0.010982048,"about_ca_topic_score_gemma":0.004551782,"teacher_disagreement_score":0.8398833,"about_ca_system_score_codex":0.0019192968,"about_ca_system_score_gemma":0.0027676024,"threshold_uncertainty_score":0.84678817},"labels":[],"label_agreement":null},{"id":"W2017135084","doi":"10.1016/j.prevetmed.2013.09.006","title":"Making valid causal inferences from observational data","year":2013,"lang":"en","type":"review","venue":"Preventive Veterinary Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Counterfactual thinking; Causal inference; Observational study; Confounding; Causation; Causal model; Outcome (game theory); Propensity score matching; Causality (physics); Econometrics; Marginal structural model; Randomized experiment; Psychology; Computer science; Statistics; Mathematics; Social psychology; Epistemology","score_opus":0.8719276078117765,"score_gpt":0.607940885409455,"score_spread":0.26398672240232146,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2017135084","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00020826235,0.97552186,0.021138836,0.0016377136,0.00027185702,0.000043113167,0.000105384126,0.00004950044,0.0010233754],"genre_scores_gemma":[0.005780152,0.97608715,0.016263403,0.00067572575,0.0005945317,0.00008156888,0.00016099385,0.000015606998,0.00034088249],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99345654,0.004206404,0.0005944202,0.0005451897,0.0011109224,0.00008663568],"domain_scores_gemma":[0.9154521,0.07936756,0.0018899185,0.0014126624,0.00169579,0.00018200692],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01699028,0.0019108533,0.0038428593,0.004393665,0.00043375348,0.0018708486,0.0032159674,0.0031291975,0.0043815793],"category_scores_gemma":[0.06533469,0.000926346,0.0025662002,0.004004707,0.0024297766,0.00314615,0.001605352,0.003934602,0.0010899226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000098147815,0.00005922557,0.00048772185,0.049620047,0.001151991,0.000117448275,0.000099197976,0.0035261784,0.00016166538,0.030586282,0.01025495,0.9038371],"study_design_scores_gemma":[0.00034487684,0.00019656487,0.0026413172,0.061841123,0.0039202976,0.0013001831,0.00028841986,0.008717758,0.0012414933,0.5336387,0.38568133,0.00018789418],"about_ca_topic_score_codex":0.0027638031,"about_ca_topic_score_gemma":0.0032421153,"teacher_disagreement_score":0.9830097,"about_ca_system_score_codex":0.001192993,"about_ca_system_score_gemma":0.005536845,"threshold_uncertainty_score":0.08985424},"labels":[],"label_agreement":null},{"id":"W2017582953","doi":"10.3109/13693786.2011.635387","title":"Comment on the paper by Kpodzo<i>et al.</i>","year":2012,"lang":"en","type":"letter","venue":"Medical Mycology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"MEDLINE; Political science; Law","score_opus":0.10164081757898306,"score_gpt":0.3981729930860049,"score_spread":0.2965321755070218,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2017582953","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000091126945,0.00041756182,0.000057204168,0.9846073,0.01398175,0.000006986282,0.000061377024,0.000027085734,0.0007496259],"genre_scores_gemma":[0.00081676454,0.00030518297,0.00008745607,0.9776028,0.019650204,0.000020199845,0.00002081337,0.000017349867,0.0014792178],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99582326,0.0009690276,0.00058380316,0.0007049987,0.0013128729,0.0006061164],"domain_scores_gemma":[0.98600847,0.007693352,0.0011430422,0.0004935995,0.003033164,0.0016283836],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005909464,0.001285322,0.0021866716,0.0014223834,0.0045297127,0.0054910867,0.0044768983,0.07758878,0.008583854],"category_scores_gemma":[0.047615543,0.0011419817,0.0020049298,0.0016565039,0.0051737083,0.0057626907,0.00218214,0.06251986,0.0118820695],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026712622,0.0000072055223,0.00016512374,0.000027452546,0.0000067145565,0.00044189807,0.000054569624,0.000018521725,0.0000313145,0.0009832421,0.99687994,0.0013574208],"study_design_scores_gemma":[0.00018551463,0.00006786869,0.0013518472,0.00045947792,0.000064620705,0.0032300127,0.00066974503,0.00055521197,0.0004414529,0.016144713,0.97670084,0.00012862986],"about_ca_topic_score_codex":0.010977066,"about_ca_topic_score_gemma":0.013024946,"teacher_disagreement_score":0.07758878,"about_ca_system_score_codex":0.0059066936,"about_ca_system_score_gemma":0.004952775,"threshold_uncertainty_score":0.042856216},"labels":[],"label_agreement":null},{"id":"W2018472295","doi":"10.1007/s12561-013-9103-z","title":"Q-Learning: Flexible Learning About Useful Utilities","year":2013,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":110,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Machine learning; Biostatistics; Computer science; Covariate; Linear model; Artificial intelligence; Econometrics; Mathematical optimization; Mathematics; Statistics; Medicine","score_opus":0.1224448115109042,"score_gpt":0.40824360456375525,"score_spread":0.28579879305285105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2018472295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020924376,0.00014100879,0.9965056,0.00021045703,0.0000215251,0.000025232368,0.00009644149,0.00059521996,0.0003119711],"genre_scores_gemma":[0.21314412,0.0005462425,0.7810761,0.0005041546,0.00018944565,0.00038908183,0.0007857919,0.00055567175,0.0028094063],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9966972,0.0020242254,0.00017655818,0.00051127333,0.00047336332,0.0001174629],"domain_scores_gemma":[0.96668184,0.029085346,0.0005589903,0.0020837048,0.0011620603,0.00042796638],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009963545,0.0011523799,0.0018692849,0.0016431959,0.00073804933,0.0021107593,0.0035604783,0.001968005,0.007966569],"category_scores_gemma":[0.05269017,0.0010922925,0.0013940212,0.0022163475,0.0020091524,0.0052261287,0.0043671336,0.0047402456,0.0015224998],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005134556,0.00033963245,0.0025729325,0.00041402993,0.00017547423,0.00016455079,0.00024227638,0.3262294,0.0010765144,0.22294696,0.012984144,0.43234065],"study_design_scores_gemma":[0.000057040903,0.000028943443,0.00008589246,0.000020924823,0.000014301478,0.0000162198,0.000011609889,0.7791514,0.0004317581,0.21906306,0.0011093585,0.000009574675],"about_ca_topic_score_codex":0.002623636,"about_ca_topic_score_gemma":0.003363598,"teacher_disagreement_score":0.009963545,"about_ca_system_score_codex":0.0011630467,"about_ca_system_score_gemma":0.0023952776,"threshold_uncertainty_score":0.05269289},"labels":[],"label_agreement":null},{"id":"W2019126071","doi":"10.1007/s10260-012-0193-4","title":"Assessing the effect of the amount of financial aids to Piedmont firms using the generalized propensity score","year":2012,"lang":"en","type":"article","venue":"Statistical Methods & Applications","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for International Peace and Security","funders":"Regione Piemonte; European Commission","keywords":"Propensity score matching; Business; Economics; Econometrics; Internal medicine; Medicine","score_opus":0.27944644578738637,"score_gpt":0.5413451885789704,"score_spread":0.26189874279158404,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2019126071","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9953407,0.00023515747,0.001970125,0.0005463889,0.000031857562,0.000054725846,0.00037296143,0.000016776568,0.0014314825],"genre_scores_gemma":[0.99789494,0.000086557164,0.00094260124,0.00008001061,0.000015400014,0.000029765379,0.00017454405,0.000002836993,0.00077351666],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99028075,0.00708608,0.00033922447,0.0011057328,0.0005821195,0.00060604094],"domain_scores_gemma":[0.9361079,0.050791554,0.0074092722,0.0033284524,0.00063524843,0.0017274983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011441156,0.0005615558,0.0008591449,0.0012129726,0.00063947844,0.0019814803,0.001130716,0.0019154607,0.006797136],"category_scores_gemma":[0.04614438,0.0002239882,0.001899136,0.0016924178,0.0012734594,0.00096460275,0.0016570551,0.0020506352,0.0003161857],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015663257,0.003294132,0.873629,0.00028675195,0.004194028,0.00037295537,0.00070045376,0.023208661,0.0021263808,0.013411869,0.0018554452,0.061257087],"study_design_scores_gemma":[0.0014288244,0.010073294,0.9024948,0.00011573868,0.00482597,0.00022325327,0.0022267406,0.05726445,0.0032022113,0.013408758,0.004632907,0.00010315819],"about_ca_topic_score_codex":0.013860005,"about_ca_topic_score_gemma":0.013993399,"teacher_disagreement_score":0.013860005,"about_ca_system_score_codex":0.001071496,"about_ca_system_score_gemma":0.0014178501,"threshold_uncertainty_score":0.060507357},"labels":[],"label_agreement":null},{"id":"W2020018188","doi":"10.1002/oby.20666","title":"Selection bias: A missing factor in the obesity paradox debate","year":2013,"lang":"en","type":"letter","venue":"Obesity","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Cancer Institute","keywords":"Obesity paradox; Obesity; Selection bias; Disease; Population; Risk factor; Medicine; Selection (genetic algorithm); Outcome (game theory); Demography; Internal medicine; Economics; Environmental health; Pathology","score_opus":0.17870836129354653,"score_gpt":0.3700703666514758,"score_spread":0.19136200535792927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2020018188","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001159527,0.028743139,0.002530643,0.9549565,0.010478281,0.00002239886,0.00009475184,0.000021955198,0.0019928163],"genre_scores_gemma":[0.043302547,0.021735026,0.0033826795,0.8245351,0.10558137,0.0001680584,0.00013606968,0.00015090554,0.001008309],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.77577674,0.15493087,0.014569372,0.01600511,0.034201507,0.004516412],"domain_scores_gemma":[0.19771272,0.76190835,0.011579386,0.010297966,0.014100554,0.0044009993],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.33691344,0.0012087679,0.0052600317,0.004615293,0.0065704216,0.01076371,0.008975774,0.037810545,0.008990156],"category_scores_gemma":[0.5588618,0.001440683,0.004083225,0.0043141185,0.03775681,0.025920551,0.009931691,0.04026082,0.0013586831],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00077531126,0.00015976017,0.004705839,0.0026957965,0.0013263045,0.0008451265,0.006323337,0.00048527782,0.00014556696,0.54186535,0.30567554,0.13499682],"study_design_scores_gemma":[0.00067332864,0.00010840165,0.0028510517,0.007362418,0.00046308408,0.00062242855,0.0016686266,0.0011798575,0.00021287907,0.79906297,0.18563028,0.00016462953],"about_ca_topic_score_codex":0.0030306173,"about_ca_topic_score_gemma":0.0028156263,"teacher_disagreement_score":0.66308653,"about_ca_system_score_codex":0.008478298,"about_ca_system_score_gemma":0.011149033,"threshold_uncertainty_score":0.8177038},"labels":[],"label_agreement":null},{"id":"W2020811073","doi":"10.1093/aje/kwh266","title":"Bias due to Aggregation of Individual Covariates in the Cox Regression Model","year":2004,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariate; Censoring (clinical trials); Statistics; Proportional hazards model; Econometrics; Confidence interval; Regression; Regression analysis; Linear regression; Mathematics","score_opus":0.25939609129629715,"score_gpt":0.4621107514322537,"score_spread":0.20271466013595657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2020811073","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13340393,0.0018520711,0.86086255,0.0013037362,0.00016277685,0.00019263719,0.00021505587,0.00031051485,0.0016967786],"genre_scores_gemma":[0.86904466,0.0010004744,0.12833324,0.00039550348,0.00009236173,0.0001836857,0.0001824037,0.00006233187,0.0007052747],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9667923,0.027211413,0.0011961441,0.0017931376,0.0025070643,0.0004999007],"domain_scores_gemma":[0.767114,0.208159,0.007947951,0.014229258,0.0022642347,0.0002855566],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06809112,0.00070793845,0.0015256322,0.0008908785,0.00072958437,0.0018876233,0.0010836796,0.0012114813,0.000979668],"category_scores_gemma":[0.15248075,0.00054391637,0.0016918428,0.001488556,0.001884015,0.0020436903,0.002072545,0.0016116367,0.00018075212],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022549925,0.00013457658,0.11396751,0.0010558475,0.0028876194,0.00086367334,0.0021838176,0.53672576,0.0034735904,0.13113682,0.0025588684,0.20275687],"study_design_scores_gemma":[0.00031819558,0.00073166983,0.023730984,0.00034802788,0.0016571187,0.0012377776,0.0003721384,0.6835297,0.008123004,0.27339336,0.006334657,0.00022334192],"about_ca_topic_score_codex":0.0020570592,"about_ca_topic_score_gemma":0.0018838106,"teacher_disagreement_score":0.06809112,"about_ca_system_score_codex":0.0010646583,"about_ca_system_score_gemma":0.0010261446,"threshold_uncertainty_score":0.36010456},"labels":[],"label_agreement":null},{"id":"W2020907145","doi":"10.1007/s10985-013-9255-7","title":"On computing standard errors for marginal structural Cox models","year":2013,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Social Innovation; General Dynamics (Canada); Ottawa Public Health; University of Guelph","funders":"H2020 Marie Skłodowska-Curie Actions; Natural Sciences and Engineering Research Council of Canada","keywords":"Marginal structural model; Weighting; Standard error; Computer science; Parametric statistics; Marginal model; Econometrics; Parametric model; Confidence interval; Statistics; Marginal likelihood; Algorithm; Mathematics; Regression analysis; Maximum likelihood","score_opus":0.1554158125401682,"score_gpt":0.4239885117570113,"score_spread":0.2685726992168431,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2020907145","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019187084,0.00037256122,0.99636275,0.00019370906,0.000081445774,0.000046439516,0.00013225514,0.00039049666,0.00050176145],"genre_scores_gemma":[0.07271462,0.0012382858,0.92113924,0.00020539488,0.00038676028,0.00053117424,0.0010822369,0.0006252155,0.0020770468],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.980889,0.012710489,0.0012376412,0.002076418,0.0025251333,0.0005614068],"domain_scores_gemma":[0.78403217,0.18740925,0.0031412423,0.018668225,0.0059214085,0.00082768314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04037747,0.0022622128,0.0034324261,0.004982137,0.0017050739,0.0041635586,0.005547607,0.002313523,0.010296947],"category_scores_gemma":[0.23475738,0.0018764006,0.0039103674,0.007243643,0.0028607761,0.005803429,0.004072783,0.007474582,0.0024592786],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020678563,0.00015210135,0.0046880436,0.00041507964,0.0006882141,0.0001831329,0.0005183748,0.1673826,0.00080058497,0.5011812,0.0072073713,0.31657654],"study_design_scores_gemma":[0.000060182294,0.00006796985,0.0011473243,0.00016450294,0.00015504242,0.00010182835,0.00013950153,0.3633735,0.00092964526,0.6297597,0.004048844,0.000051959156],"about_ca_topic_score_codex":0.007700925,"about_ca_topic_score_gemma":0.012079268,"teacher_disagreement_score":0.04037747,"about_ca_system_score_codex":0.002208036,"about_ca_system_score_gemma":0.005370871,"threshold_uncertainty_score":0.213539},"labels":[],"label_agreement":null},{"id":"W2021261432","doi":"10.1016/j.jclinepi.2009.05.009","title":"Survivor treatment bias, treatment selection bias, and propensity scores in observational research","year":2010,"lang":"en","type":"letter","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":63,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Institute for Clinical Evaluative Sciences; University of Toronto; Public Health Ontario","funders":"","keywords":"Selection bias; Observational study; Scopus; Publication bias; Medicine; Propensity score matching; Meta-analysis; MEDLINE; Internal medicine; Pathology; Political science","score_opus":0.93795884518816,"score_gpt":0.6625431311432628,"score_spread":0.2754157140448972,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021261432","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00445357,0.0122459335,0.029411675,0.9436579,0.006963755,0.00005063112,0.00032637792,0.00006986354,0.0028203034],"genre_scores_gemma":[0.24444239,0.03376025,0.054763317,0.46658668,0.19277644,0.0005816605,0.0003122756,0.00017226776,0.006604728],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9601698,0.03163347,0.0030504134,0.0019432073,0.0027882783,0.00041488544],"domain_scores_gemma":[0.43953067,0.53701186,0.005802546,0.008895981,0.0074424604,0.0013164754],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06554228,0.0005867332,0.0026209012,0.002098098,0.0017248391,0.0038720847,0.0023622506,0.017789494,0.00366233],"category_scores_gemma":[0.38705444,0.00079481525,0.001280204,0.0035141523,0.009547483,0.0055491305,0.0015605467,0.024524683,0.0007063504],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001335017,0.00018663116,0.026644051,0.0017445172,0.0010506192,0.004547637,0.0011989285,0.00424673,0.00018301162,0.34036577,0.4097074,0.20878969],"study_design_scores_gemma":[0.0007171493,0.000083456296,0.0042086947,0.0004461289,0.00024781583,0.0023992828,0.00025582578,0.012767341,0.00014095366,0.94769824,0.030957919,0.00007722474],"about_ca_topic_score_codex":0.0051092673,"about_ca_topic_score_gemma":0.006571222,"teacher_disagreement_score":0.9344577,"about_ca_system_score_codex":0.0028184392,"about_ca_system_score_gemma":0.0037314012,"threshold_uncertainty_score":0.34662485},"labels":[],"label_agreement":null},{"id":"W2021583648","doi":"10.2202/1557-4679.1208","title":"Accuracy of Conventional and Marginal Structural Cox Model Estimators: A Simulation Study","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":82,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Gas Technologies Centre; Montreal General Hospital; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Covariate; Marginal structural model; Proportional hazards model; Estimator; Statistics; Inverse probability weighting; Weighting; Logistic regression; Marginal model; Confounding; Econometrics; Inverse probability; Mathematics; Censoring (clinical trials); Accelerated failure time model; Regression analysis; Computer science; Medicine; Bayesian probability","score_opus":0.0926583015508293,"score_gpt":0.4578373595405563,"score_spread":0.36517905798972705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021583648","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.59911644,0.0024763965,0.38995466,0.0017793442,0.0001221879,0.00040003852,0.0011164721,0.00039658713,0.004637905],"genre_scores_gemma":[0.92547673,0.00043917142,0.07222096,0.00012099325,0.00003565506,0.00027404676,0.0006306698,0.00007962912,0.00072214723],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98446757,0.013023257,0.0005064835,0.00082748453,0.0008568872,0.00031823455],"domain_scores_gemma":[0.6138229,0.35689494,0.0073841033,0.013829649,0.007083357,0.0009850486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05044941,0.00079981104,0.0013931182,0.0012323023,0.0005939521,0.0011018546,0.001982216,0.0019150048,0.0026562004],"category_scores_gemma":[0.18257326,0.00042516415,0.0012018346,0.0015286119,0.0014811787,0.0021411504,0.001632953,0.0019239343,0.00026469247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021193814,0.00037889276,0.040580973,0.0004155975,0.00059366773,0.00024748157,0.00072553894,0.8532263,0.0010756386,0.059880063,0.0025389718,0.038217407],"study_design_scores_gemma":[0.00020294265,0.0003487495,0.0033718864,0.00008678751,0.000112602356,0.00013163933,0.00013611159,0.97535056,0.00072310417,0.01862945,0.0008575462,0.000048668808],"about_ca_topic_score_codex":0.0063602095,"about_ca_topic_score_gemma":0.0043331576,"teacher_disagreement_score":0.94955057,"about_ca_system_score_codex":0.0014908705,"about_ca_system_score_gemma":0.0013957376,"threshold_uncertainty_score":0.26680523},"labels":[],"label_agreement":null},{"id":"W2021688446","doi":"10.1046/j.0039-0402.2003.00254.x","title":"Regressor and random‐effects dependencies in multilevel models","year":2004,"lang":"en","type":"article","venue":"Statistica Neerlandica","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":81,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Independence (probability theory); Econometrics; Monte Carlo method; Random effects model; Computer science; Multilevel model; Statistics; Machine learning; Mathematics; Meta-analysis","score_opus":0.10038898709520844,"score_gpt":0.38229869015186063,"score_spread":0.2819097030566522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021688446","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0128924,0.0015819089,0.98194075,0.0010608609,0.00007148097,0.00013614054,0.00028647605,0.00019144885,0.0018386417],"genre_scores_gemma":[0.34227362,0.0032747681,0.6483158,0.0005885996,0.0003271921,0.0014466306,0.00083354453,0.00023409659,0.0027058222],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9215731,0.06756457,0.001760258,0.003760204,0.00431325,0.0010286828],"domain_scores_gemma":[0.752109,0.22569986,0.008245251,0.010782436,0.0025065788,0.0006568292],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0545257,0.0013480695,0.0026057754,0.0029248316,0.0014206311,0.0029470075,0.0038956737,0.0027906972,0.0066278577],"category_scores_gemma":[0.20773533,0.0016318044,0.003961497,0.00431221,0.0034419126,0.0054394454,0.0035396516,0.00546073,0.00091576943],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021135423,0.0001388324,0.013158617,0.0008190303,0.0014728156,0.00036613343,0.0011100699,0.088475145,0.00034392523,0.8185272,0.0022914503,0.07308548],"study_design_scores_gemma":[0.000106283274,0.00018961087,0.006081402,0.00040790756,0.00068814086,0.00020513344,0.00019634506,0.25370693,0.0006005461,0.7311198,0.0065943254,0.00010345899],"about_ca_topic_score_codex":0.0070658554,"about_ca_topic_score_gemma":0.008350268,"teacher_disagreement_score":0.0545257,"about_ca_system_score_codex":0.0018658087,"about_ca_system_score_gemma":0.0035232843,"threshold_uncertainty_score":0.28836292},"labels":[],"label_agreement":null},{"id":"W2021792499","doi":"10.1016/j.jval.2014.03.1130","title":"The inherent bias from using partitioned survival models in economic evaluation","year":2014,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Lethbridge; University of Ottawa","funders":"","keywords":"Survival analysis; Clinical trial; Markov model; Medicine; Randomized controlled trial; Progression-free survival; Markov chain; Overall survival; Statistics; Oncology; Internal medicine; Mathematics","score_opus":0.659809391040091,"score_gpt":0.4838394291682127,"score_spread":0.17596996187187824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021792499","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015189789,0.0039470904,0.9712468,0.005672895,0.00025931542,0.000104620936,0.00024010884,0.00017776979,0.0031616585],"genre_scores_gemma":[0.66353947,0.004915137,0.32201958,0.0029277247,0.00091855356,0.00058629084,0.0003184539,0.00026790742,0.004506853],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9208544,0.07100094,0.0016208163,0.0024926632,0.0035235342,0.00050763524],"domain_scores_gemma":[0.47660097,0.49898937,0.0060674194,0.014725847,0.0032096833,0.00040666858],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10568117,0.00093879603,0.0021576777,0.0015736305,0.0007127312,0.0032932707,0.0025700843,0.0024450424,0.006748415],"category_scores_gemma":[0.37740907,0.0010875029,0.0015072074,0.0023900762,0.0037003448,0.006697763,0.0027329857,0.0059142974,0.0005943805],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042550615,0.00011726946,0.008049957,0.00069721695,0.0011674172,0.00017531584,0.00068041094,0.066004574,0.00024023106,0.7955824,0.0047585536,0.12210111],"study_design_scores_gemma":[0.00006524289,0.00004542481,0.0005404577,0.000102437974,0.00013169285,0.000071222545,0.000052001884,0.068683505,0.0002506491,0.92829025,0.0017525983,0.000014592906],"about_ca_topic_score_codex":0.0025704901,"about_ca_topic_score_gemma":0.0027824237,"teacher_disagreement_score":0.8943188,"about_ca_system_score_codex":0.0014069069,"about_ca_system_score_gemma":0.0020991964,"threshold_uncertainty_score":0.55890214},"labels":[],"label_agreement":null},{"id":"W2024255505","doi":"10.6000/1929-6029.2014.03.02.13","title":"Adjusting Complex Heterogeneity in Treatment Assignment in Observational Studies","year":2014,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Pfizer","keywords":"Propensity score matching; Observational study; Estimator; Statistics; Cluster analysis; Weighting; Inverse probability weighting; Regression; Econometrics; Partial least squares regression; Inverse probability; Regression analysis; Mathematics; Computer science; Medicine","score_opus":0.7635707781039781,"score_gpt":0.6555082445573583,"score_spread":0.10806253354661977,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2024255505","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07731473,0.0019295643,0.9159342,0.0016056146,0.0002080651,0.0010543059,0.0005708875,0.0003142696,0.0010684988],"genre_scores_gemma":[0.7966609,0.0009358511,0.19835387,0.00077335356,0.00019356134,0.00117531,0.0007230762,0.00007986195,0.0011042238],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90199816,0.08303126,0.0037433747,0.006287108,0.003933434,0.0010067185],"domain_scores_gemma":[0.6825175,0.26866412,0.024050055,0.020871887,0.0032657941,0.0006305654],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11067636,0.00080741505,0.0019576512,0.0017775622,0.0012375101,0.002512443,0.0028770098,0.002223079,0.002849713],"category_scores_gemma":[0.2671361,0.0005663551,0.0037289506,0.003896388,0.002240835,0.0020698612,0.0022025881,0.002153332,0.00034127015],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014310388,0.00048788852,0.15544923,0.0019857623,0.006298916,0.0015672327,0.0022259748,0.332089,0.0022753573,0.23930746,0.0060784,0.25080377],"study_design_scores_gemma":[0.0012927151,0.0008758025,0.035909686,0.0005050878,0.0023024427,0.0006866016,0.0005234845,0.5193001,0.002289517,0.42757338,0.008479255,0.0002618929],"about_ca_topic_score_codex":0.0051290747,"about_ca_topic_score_gemma":0.0036985346,"teacher_disagreement_score":0.88932365,"about_ca_system_score_codex":0.0017857748,"about_ca_system_score_gemma":0.0029487102,"threshold_uncertainty_score":0.5853195},"labels":[],"label_agreement":null},{"id":"W2024692342","doi":"10.1016/j.jeconom.2003.10.006","title":"How robust is the evidence on the effects of college quality? Evidence from matching","year":2004,"lang":"en","type":"article","venue":"Journal of Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":690,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Propensity score matching; Matching (statistics); Regression; Quality (philosophy); Linear regression; Econometrics; Statistics; Average treatment effect; Regression analysis; Mathematics","score_opus":0.49673908869137284,"score_gpt":0.40482836758179297,"score_spread":0.09191072110957987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2024692342","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8438649,0.042334907,0.03775464,0.026204513,0.0011451464,0.0005830307,0.005830029,0.0002264087,0.04205636],"genre_scores_gemma":[0.9878555,0.0033833773,0.0030299344,0.0021939478,0.0004942612,0.00007312796,0.0009640863,0.000049051847,0.0019567811],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9018046,0.06829105,0.009099577,0.0089380825,0.0085881855,0.0032785477],"domain_scores_gemma":[0.25881368,0.58089,0.061744545,0.084663056,0.010031366,0.0038573653],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08900952,0.0010908595,0.004936589,0.0043719797,0.0020256736,0.005759739,0.0072542047,0.006589694,0.032215375],"category_scores_gemma":[0.46706793,0.0009970024,0.0046859793,0.011392746,0.006261171,0.00597164,0.0061401753,0.0038889905,0.002467104],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.027746132,0.0036379772,0.52685285,0.006603045,0.04148316,0.00086033583,0.0036103083,0.013209624,0.0012874637,0.108979814,0.016145304,0.249584],"study_design_scores_gemma":[0.011881303,0.004747625,0.5432152,0.0030006343,0.04937813,0.0008295741,0.0046065724,0.0180531,0.009565986,0.30953652,0.044743434,0.0004419575],"about_ca_topic_score_codex":0.015960207,"about_ca_topic_score_gemma":0.0055915182,"teacher_disagreement_score":0.9109905,"about_ca_system_score_codex":0.0013543345,"about_ca_system_score_gemma":0.0018687992,"threshold_uncertainty_score":0.470733},"labels":[],"label_agreement":null},{"id":"W2024981049","doi":"10.1093/jnci/djk189","title":"Statisticians Set Sights on Observational Studies","year":2007,"lang":"en","type":"article","venue":"JNCI Journal of the National Cancer Institute","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Observational study; Checklist; Strengthening the reporting of observational studies in epidemiology; Set (abstract data type); Quality (philosophy); Research design; Clinical study design; Reliability (semiconductor); Randomized controlled trial; Computer science; Medical physics; Medicine; Medical education; Psychology; Statistics; Clinical trial; Mathematics; Pathology; Cognitive psychology; Epistemology","score_opus":0.6932597929031257,"score_gpt":0.5775303768137539,"score_spread":0.11572941608937182,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2024981049","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00062947714,0.037602406,0.08256035,0.7898686,0.079848275,0.0005905073,0.0005449079,0.00069802336,0.0076575037],"genre_scores_gemma":[0.01989276,0.025885705,0.09527742,0.7636022,0.08705806,0.0041377526,0.0004532335,0.0014262095,0.0022665889],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.26154193,0.5489344,0.079346366,0.021098847,0.08495004,0.004128362],"domain_scores_gemma":[0.06170855,0.7953383,0.031240271,0.052766036,0.05249157,0.0064552585],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5992267,0.0048440555,0.014003317,0.02199126,0.009959731,0.02511775,0.012507296,0.033099618,0.011324982],"category_scores_gemma":[0.8535104,0.005742564,0.00755943,0.016178468,0.08771492,0.0417227,0.02137699,0.12259929,0.009184751],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061190175,0.00010362549,0.001991807,0.0061709275,0.0014684822,0.00037382529,0.0075326846,0.0012493632,0.00035801172,0.2569977,0.6371665,0.085975215],"study_design_scores_gemma":[0.00057863555,0.00024421234,0.00094904855,0.01916639,0.00028709407,0.0004950347,0.0019332056,0.0021109285,0.00040426332,0.59840316,0.37511253,0.0003155202],"about_ca_topic_score_codex":0.004170716,"about_ca_topic_score_gemma":0.00247677,"teacher_disagreement_score":0.4007733,"about_ca_system_score_codex":0.011549915,"about_ca_system_score_gemma":0.02666494,"threshold_uncertainty_score":0.49422485},"labels":[],"label_agreement":null},{"id":"W2026576563","doi":"10.5301/jn.2011.6429","title":"Propensity score methods and their application in nephrology research","year":2011,"lang":"en","type":"article","venue":"Journal of Nephrology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Propensity score matching; Medicine; Covariate; Observational study; Internal medicine; Selection bias; Matching (statistics); Statistics; Mathematics; Pathology","score_opus":0.5116448045137748,"score_gpt":0.5133853228660754,"score_spread":0.0017405183523006018,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2026576563","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021412887,0.0110750785,0.97888076,0.0035394514,0.00029399723,0.00017995613,0.00016465662,0.00012938166,0.0035954555],"genre_scores_gemma":[0.11186205,0.035077658,0.84345603,0.0013450965,0.002035992,0.0014445884,0.0004712504,0.0001671177,0.00414027],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9780595,0.01716559,0.00080078724,0.0010693121,0.0027065556,0.0001982285],"domain_scores_gemma":[0.9361295,0.05497369,0.0033042273,0.002627976,0.0024821262,0.0004824372],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035321534,0.0012454073,0.00205503,0.0047798813,0.0011055877,0.0032051238,0.0019233925,0.0023668387,0.0055147503],"category_scores_gemma":[0.09557188,0.00083665183,0.0016009124,0.007692658,0.0038292098,0.003782603,0.003519152,0.0051420648,0.0013037025],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053240987,0.000062319144,0.004557201,0.00061170873,0.0003525011,0.0001750688,0.00038488716,0.026665894,0.00017114141,0.8101082,0.008639763,0.148218],"study_design_scores_gemma":[0.000042823813,0.00004130267,0.0011062949,0.00020717044,0.000035939353,0.000094484254,0.000063754866,0.03437706,0.00011465898,0.94876605,0.015118756,0.000031750806],"about_ca_topic_score_codex":0.0029655572,"about_ca_topic_score_gemma":0.0017689621,"teacher_disagreement_score":0.035321534,"about_ca_system_score_codex":0.001730017,"about_ca_system_score_gemma":0.004278974,"threshold_uncertainty_score":0.18680036},"labels":[],"label_agreement":null},{"id":"W2026656096","doi":"10.1136/bmj.b5087","title":"Problem of immortal time bias in cohort studies: example using statins for preventing progression of diabetes","year":2010,"lang":"en","type":"article","venue":"BMJ","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1155,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; Kingston Health Sciences Centre; McGill University; Queen's University","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Diabetes mellitus; Cohort; Internal medicine; Endocrinology","score_opus":0.2976455350419575,"score_gpt":0.5009101891130961,"score_spread":0.20326465407113864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2026656096","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041181695,0.030447071,0.80605906,0.109636925,0.0033281022,0.00040527573,0.0010976383,0.0004744086,0.0073698345],"genre_scores_gemma":[0.656632,0.014243894,0.2910028,0.023775011,0.006298621,0.0009157691,0.00045197725,0.0002846548,0.0063952175],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8743265,0.110520534,0.003619842,0.0059412587,0.0047891596,0.0008026496],"domain_scores_gemma":[0.39473385,0.5614565,0.011394448,0.024406051,0.007198845,0.0008102486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17674871,0.0010557696,0.0035027794,0.002412648,0.0017853915,0.003184696,0.0026844353,0.008718506,0.0030243304],"category_scores_gemma":[0.43387264,0.0009828607,0.0047365464,0.0031866825,0.0072117676,0.0063714357,0.0034550007,0.010787208,0.00040880698],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022082801,0.0002173703,0.040886663,0.003756139,0.0069905063,0.003198452,0.003457029,0.022637986,0.0014743618,0.7132538,0.029361572,0.17255777],"study_design_scores_gemma":[0.0006909545,0.00019695095,0.0040380317,0.0006176957,0.0013664542,0.0018196183,0.00030584348,0.03141654,0.00079641386,0.9452678,0.013362193,0.000121473066],"about_ca_topic_score_codex":0.0047282185,"about_ca_topic_score_gemma":0.0035236194,"teacher_disagreement_score":0.8232513,"about_ca_system_score_codex":0.0015342063,"about_ca_system_score_gemma":0.0019006821,"threshold_uncertainty_score":0.9347477},"labels":[],"label_agreement":null},{"id":"W2028610170","doi":"10.1097/ede.0b013e31823b539c","title":"Is Probabilistic Bias Analysis Approximately Bayesian?","year":2011,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Frequentist inference; Probabilistic logic; Bayesian probability; Statistics; Computer science; Bayes' theorem; Econometrics; Bayesian inference; Artificial intelligence; Mathematics","score_opus":0.6188697775386927,"score_gpt":0.47532603402570855,"score_spread":0.1435437435129841,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028610170","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007486554,0.002725464,0.97583973,0.00750601,0.0001872023,0.000108083186,0.0002573811,0.00013206495,0.0057574837],"genre_scores_gemma":[0.45549834,0.010167759,0.5152941,0.0068757287,0.0022878728,0.0016100787,0.00081088813,0.00030630012,0.0071489173],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9621806,0.025445638,0.0016406043,0.0040945113,0.005781391,0.0008572828],"domain_scores_gemma":[0.79233676,0.17672704,0.011177345,0.012175009,0.00704364,0.000540154],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.055294685,0.00094978476,0.0030075568,0.0024880606,0.0011092827,0.00445292,0.0034959142,0.0032892693,0.0061064344],"category_scores_gemma":[0.28207514,0.0014068378,0.0022948615,0.0035093464,0.005060541,0.010384492,0.0026402774,0.004360498,0.0010356352],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007958676,0.000029812665,0.004282997,0.00037435011,0.0004305864,0.00011047505,0.0004754163,0.025292384,0.00013088869,0.88838834,0.0034957468,0.07690932],"study_design_scores_gemma":[0.000021672526,0.000014190976,0.000535906,0.00008708012,0.000059831258,0.00009120368,0.000039298553,0.028342979,0.000081347775,0.9673721,0.0033344107,0.000019905017],"about_ca_topic_score_codex":0.0042923065,"about_ca_topic_score_gemma":0.0025334684,"teacher_disagreement_score":0.055294685,"about_ca_system_score_codex":0.0025034249,"about_ca_system_score_gemma":0.002305609,"threshold_uncertainty_score":0.2924297},"labels":[],"label_agreement":null},{"id":"W2028695612","doi":"10.1016/j.jclinepi.2009.07.018","title":"Author's response: the design of observational studies—defining baseline time","year":2010,"lang":"en","type":"letter","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of Toronto; Public Health Ontario; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Observational study; Propensity score matching; Selection bias; Medicine; Randomized controlled trial; Baseline (sea); Selection (genetic algorithm); Surgery; Internal medicine; Computer science; Political science; Pathology; Artificial intelligence","score_opus":0.8515153525868473,"score_gpt":0.6448775021619372,"score_spread":0.20663785042491012,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028695612","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016143803,0.0002231698,0.00032107375,0.984379,0.014462023,0.000019992727,0.00008242979,0.000015795864,0.00033510337],"genre_scores_gemma":[0.0029851082,0.00054918916,0.0015405373,0.9542127,0.038153715,0.00017893584,0.000038476715,0.00002974484,0.0023116688],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9784249,0.012297056,0.0038260815,0.0018184263,0.0025939054,0.0010396446],"domain_scores_gemma":[0.78291607,0.17871174,0.007837235,0.0045957267,0.020278903,0.0056602797],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031820636,0.0011536474,0.004349759,0.001779799,0.003449456,0.004160892,0.0031372134,0.05898291,0.009089155],"category_scores_gemma":[0.25864294,0.0018964561,0.0018816538,0.0019095606,0.004858471,0.0038255355,0.002368651,0.06618291,0.0054217675],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021444079,0.00005019416,0.0013706814,0.00026256352,0.00006572783,0.0009060934,0.00028450976,0.00027916787,0.000117558,0.0046698153,0.9841084,0.0076708966],"study_design_scores_gemma":[0.0013009568,0.0002864631,0.0053143054,0.002413886,0.00032526834,0.006168045,0.002055267,0.0064305,0.00086183794,0.060437974,0.913911,0.0004945731],"about_ca_topic_score_codex":0.004982419,"about_ca_topic_score_gemma":0.007615514,"teacher_disagreement_score":0.96817935,"about_ca_system_score_codex":0.005871918,"about_ca_system_score_gemma":0.0074504525,"threshold_uncertainty_score":0.16828567},"labels":[],"label_agreement":null},{"id":"W2028896959","doi":"10.1016/s0025-5564(01)00050-5","title":"Resource allocation for epidemic control over short time horizons","year":2001,"lang":"en","type":"article","venue":"Mathematical Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":115,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Division of Mathematical Sciences; National Institute on Drug Abuse","keywords":"Heuristics; Time horizon; Mathematical optimization; Resource allocation; Computer science; Constraint (computer-aided design); Set (abstract data type); Function (biology); Production (economics); Operations research; Mathematics; Economics; Microeconomics","score_opus":0.11517627921030515,"score_gpt":0.4088815399018293,"score_spread":0.29370526069152414,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028896959","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031130672,0.001145624,0.95769745,0.0032315503,0.00024453254,0.000088289235,0.00020157982,0.00024976674,0.0060105654],"genre_scores_gemma":[0.9105787,0.0021362896,0.072299294,0.00067811256,0.00051625195,0.00042510376,0.00018004283,0.0001615763,0.013024648],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978217,0.0011798056,0.00009135295,0.00035005508,0.0002447839,0.00031237],"domain_scores_gemma":[0.973354,0.023337906,0.0010307628,0.0007522202,0.00093151774,0.000593646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007282198,0.0015118972,0.003708255,0.0014691141,0.0011628241,0.0028523607,0.002934151,0.0033548833,0.007612037],"category_scores_gemma":[0.03684981,0.001434204,0.0012606754,0.0015014332,0.00318154,0.005995878,0.0024374074,0.0040363674,0.00040531927],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014292225,0.00007094198,0.00029222973,0.00016774893,0.000083865474,0.0000618022,0.00008922011,0.56612337,0.0004858684,0.4177267,0.0018901511,0.012865076],"study_design_scores_gemma":[0.00003327505,0.000016273807,0.00008407632,0.000014047026,0.00002493527,0.0000102761605,0.000016917547,0.7710688,0.00010778392,0.22819807,0.00041217226,0.000013331214],"about_ca_topic_score_codex":0.005972186,"about_ca_topic_score_gemma":0.0027776146,"teacher_disagreement_score":0.007612037,"about_ca_system_score_codex":0.0029177095,"about_ca_system_score_gemma":0.0027991338,"threshold_uncertainty_score":0.03851241},"labels":[],"label_agreement":null},{"id":"W2029059557","doi":"10.1080/03610911003650383","title":"How Big is a Big Odds Ratio? Interpreting the Magnitudes of Odds Ratios in Epidemiological Studies","year":2010,"lang":"en","type":"article","venue":"Communications in Statistics - Simulation and Computation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1932,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Canada; Columbia College","funders":"","keywords":"Odds ratio; Odds; Epidemiology; Index (typography); Statistics; Medicine; Demography; Psychology; Mathematics; Computer science; Internal medicine; Sociology; Logistic regression","score_opus":0.5103286940819939,"score_gpt":0.559314319333483,"score_spread":0.048985625251489084,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029059557","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03525531,0.052874062,0.8177851,0.0706789,0.008446748,0.0005517156,0.00082711433,0.0010825839,0.012498561],"genre_scores_gemma":[0.4991066,0.010891616,0.4678124,0.01394852,0.0061781076,0.00080563227,0.00017655114,0.00032850585,0.0007521639],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.74589306,0.21554622,0.012708059,0.008113209,0.017030476,0.0007090129],"domain_scores_gemma":[0.21119173,0.7446097,0.01947299,0.01519928,0.008146442,0.0013797425],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17697991,0.0015418563,0.003228707,0.008016573,0.0014890579,0.009343868,0.0031766787,0.0043286467,0.0023475518],"category_scores_gemma":[0.724739,0.0010820816,0.0022925495,0.0077506104,0.01414063,0.011417957,0.0047474816,0.006986049,0.00072056777],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012465053,0.00016857407,0.078307495,0.008932225,0.0051509314,0.0014057818,0.008349321,0.00789358,0.0031257684,0.34524903,0.032281235,0.50788957],"study_design_scores_gemma":[0.00019303856,0.0003373337,0.015735392,0.0018033183,0.00098857,0.0017715186,0.0020791707,0.006739135,0.0016455698,0.9465638,0.021931177,0.00021204416],"about_ca_topic_score_codex":0.0011416831,"about_ca_topic_score_gemma":0.0009331218,"teacher_disagreement_score":0.8230201,"about_ca_system_score_codex":0.0020410002,"about_ca_system_score_gemma":0.0025574896,"threshold_uncertainty_score":0.9359704},"labels":[],"label_agreement":null},{"id":"W2029739696","doi":"10.1080/03610918.2011.575505","title":"Comparison of Selected Methods for Modeling of Multi-State Disease Progression Processes: A Simulation Study","year":2011,"lang":"en","type":"article","venue":"Communications in Statistics - Simulation and Computation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariate; Proportional hazards model; Markov model; Markov chain; Event (particle physics); Computer science; Econometrics; Regression analysis; Regression; Statistics; Type I and type II errors; Mathematics; Machine learning","score_opus":0.642218000239422,"score_gpt":0.6481872947404852,"score_spread":0.005969294501063205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029739696","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.50433046,0.0034486935,0.48193964,0.0016499518,0.00019128362,0.00087090913,0.0009951057,0.00060992356,0.005964055],"genre_scores_gemma":[0.88492066,0.0015280339,0.11055132,0.00019153368,0.00006329672,0.0009738638,0.0006496479,0.00012137929,0.0010002702],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9932098,0.005713205,0.00021935222,0.00027628677,0.0003350804,0.00024622644],"domain_scores_gemma":[0.877923,0.11453228,0.002244474,0.0018587781,0.002791735,0.00064977567],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.017017033,0.0012212947,0.0017032778,0.00244511,0.0006942863,0.0012904555,0.0017686085,0.0021357473,0.0019698078],"category_scores_gemma":[0.040319104,0.00055758795,0.0018891449,0.0015923466,0.00077817315,0.0015055141,0.0014578132,0.001896439,0.00017608843],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034190263,0.00016936242,0.003739376,0.000113120615,0.0001513532,0.000038256185,0.000076602795,0.9823846,0.00011748568,0.005976957,0.00027921944,0.0066117975],"study_design_scores_gemma":[0.000053610074,0.00011276924,0.00040822994,0.000021470865,0.00002388405,0.000010300999,0.000034327462,0.99715364,0.000087764565,0.0019433493,0.00013716143,0.000013487246],"about_ca_topic_score_codex":0.020003393,"about_ca_topic_score_gemma":0.010975994,"teacher_disagreement_score":0.982983,"about_ca_system_score_codex":0.002225097,"about_ca_system_score_gemma":0.001965755,"threshold_uncertainty_score":0.08999574},"labels":[],"label_agreement":null},{"id":"W2030531780","doi":"10.1177/1740774509105223","title":"Evaluating the benefit of event adjudication of cardiovascular outcomes in large simple RCTs","year":2009,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":114,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Population Health Research Institute","funders":"","keywords":"Adjudication; Medicine; Randomized controlled trial; Event (particle physics); Simple (philosophy); Cardiovascular event; Medical physics; Intensive care medicine; Internal medicine; Myocardial infarction; Political science","score_opus":0.7228107795496578,"score_gpt":0.6578663880181861,"score_spread":0.06494439153147169,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2030531780","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12920038,0.34275502,0.40656966,0.015991738,0.008388402,0.07799686,0.0074286303,0.0016522626,0.010017065],"genre_scores_gemma":[0.7412166,0.019399941,0.18156828,0.0049254512,0.0034350317,0.047229562,0.0013613232,0.00029695037,0.0005669368],"study_design_codex":"meta_analysis","study_design_gemma":"observational","domain_scores_codex":[0.2680429,0.62715816,0.07644279,0.01171775,0.015473627,0.0011647353],"domain_scores_gemma":[0.09386229,0.8210931,0.052006148,0.025613712,0.0066327504,0.00079193676],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4897454,0.0048733847,0.01491154,0.0062139085,0.0012828729,0.0067664655,0.0036574216,0.005844985,0.0062545645],"category_scores_gemma":[0.7648508,0.002373586,0.027300945,0.0064190207,0.0045366595,0.008850601,0.004501915,0.0059904805,0.00074029254],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.13369268,0.0010511021,0.03786325,0.18534496,0.48303512,0.0006811304,0.0012156002,0.012185013,0.002562949,0.010587214,0.0052249166,0.12655614],"study_design_scores_gemma":[0.15528582,0.02981156,0.049840968,0.039190788,0.53432626,0.0012589658,0.00040961272,0.043403182,0.0061720433,0.1118568,0.02744127,0.001002773],"about_ca_topic_score_codex":0.0009666064,"about_ca_topic_score_gemma":0.0013488625,"teacher_disagreement_score":0.5102546,"about_ca_system_score_codex":0.0032303636,"about_ca_system_score_gemma":0.0049064695,"threshold_uncertainty_score":0.6292348},"labels":[],"label_agreement":null},{"id":"W2030555037","doi":"10.1016/j.ahj.2010.07.004","title":"Determination of hospitalization type by investigator case report form or adjudication committee in a large heart failure clinical trial (β-Blocker Evaluation of Survival Trial [BEST])","year":2010,"lang":"en","type":"article","venue":"American Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Montreal Heart Institute","funders":"U.S. Food and Drug Administration","keywords":"Medicine; Adjudication; Heart failure; Clinical trial; Randomized controlled trial; Surgery; Internal medicine; Law","score_opus":0.26140179206123343,"score_gpt":0.5129205021851289,"score_spread":0.25151871012389543,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2030555037","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5034135,0.0053921966,0.2627847,0.008927979,0.004005001,0.049594052,0.12644906,0.00456181,0.034871757],"genre_scores_gemma":[0.807356,0.0007084086,0.10838527,0.003772449,0.0014698585,0.031379074,0.030078923,0.0003886741,0.01646133],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.93015474,0.05130949,0.0073523135,0.0048062745,0.00487053,0.0015066464],"domain_scores_gemma":[0.85864544,0.07500726,0.030209128,0.02459212,0.008807882,0.0027381887],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.071157694,0.0008910351,0.0026557748,0.0024008101,0.0012980371,0.0015071672,0.0019771154,0.0020887253,0.015748866],"category_scores_gemma":[0.13495062,0.0011209681,0.0024954586,0.001932383,0.0005762939,0.0011631874,0.0010630311,0.00256794,0.002312063],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.17662922,0.0037099686,0.33838174,0.0025970046,0.008344855,0.0005295707,0.00070424005,0.00501728,0.00262132,0.010972856,0.23246706,0.21802491],"study_design_scores_gemma":[0.1323435,0.01957372,0.53620625,0.0012189207,0.02059977,0.0021340821,0.00041660748,0.14095795,0.011417223,0.051522058,0.083001554,0.000608303],"about_ca_topic_score_codex":0.002518555,"about_ca_topic_score_gemma":0.003015563,"teacher_disagreement_score":0.9288423,"about_ca_system_score_codex":0.0008355129,"about_ca_system_score_gemma":0.0035899456,"threshold_uncertainty_score":0.37632233},"labels":[],"label_agreement":null},{"id":"W2030597325","doi":"10.1097/mlr.0b013e31805371bf","title":"Studying Prescription Drug Use and Outcomes With Medicaid Claims Data","year":2007,"lang":"en","type":"article","venue":"Medical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":150,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Services and Policy Research","funders":"National Institute of Mental Health; Agency for Healthcare Research and Quality","keywords":"Medicaid; Identification (biology); Medical prescription; Prescription drug; Data science; Medicine; MEDLINE; Outcomes research; Computer science; Health care; Alternative medicine; Nursing","score_opus":0.22936142604086154,"score_gpt":0.4384770445704938,"score_spread":0.20911561852963226,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2030597325","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52791756,0.00771867,0.3478422,0.022151932,0.00035108626,0.0017496386,0.071158074,0.0005812647,0.020529563],"genre_scores_gemma":[0.83543116,0.0043971376,0.12701538,0.0012480842,0.00034032314,0.0020275095,0.028383728,0.00006428886,0.0010922725],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95997375,0.029419579,0.0031157755,0.0018560505,0.005102282,0.00053248776],"domain_scores_gemma":[0.8061921,0.1533443,0.023095788,0.013410757,0.0034715475,0.00048546828],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.035169195,0.0005845318,0.0009927707,0.0061605633,0.0012256999,0.0022055767,0.0016519522,0.0009072981,0.0021912158],"category_scores_gemma":[0.19312324,0.000632743,0.0014558822,0.014142531,0.0013406005,0.0037830523,0.003595418,0.0016351957,0.00036776374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024007598,0.00040769367,0.7418225,0.001402548,0.0022661749,0.0003733646,0.0022180595,0.020833703,0.00037839884,0.06043072,0.008591653,0.16103514],"study_design_scores_gemma":[0.00021519596,0.00047956646,0.6460087,0.0025726545,0.0014495513,0.0006444504,0.0036036584,0.08325845,0.0028523423,0.20884623,0.049772974,0.00029626762],"about_ca_topic_score_codex":0.023673177,"about_ca_topic_score_gemma":0.018669948,"teacher_disagreement_score":0.9648308,"about_ca_system_score_codex":0.001716367,"about_ca_system_score_gemma":0.0033104443,"threshold_uncertainty_score":0.18599474},"labels":[],"label_agreement":null},{"id":"W2033230645","doi":"10.1016/j.jclinepi.2008.10.008","title":"Nonrandomized quality improvement intervention trials might overstate the strength of causal inference of their findings","year":2009,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; Institute of Population and Public Health; Research Canada; Simon Fraser University; Arthritis Research Centre of Canada; University of British Columbia","funders":"","keywords":"Causal inference; Causality (physics); Randomized controlled trial; Medicine; Inference; Psychological intervention; Intervention (counseling); Randomized experiment; Physical therapy; Internal medicine; Psychiatry; Pathology; Artificial intelligence","score_opus":0.6187292978161297,"score_gpt":0.6310399181908967,"score_spread":0.012310620374766934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2033230645","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.071793765,0.021993164,0.8462089,0.03537666,0.0057149986,0.0063388413,0.0018238625,0.0010895439,0.009660367],"genre_scores_gemma":[0.68739176,0.0028273924,0.2792183,0.019862454,0.00260375,0.0058701993,0.0006601392,0.00019461103,0.0013713865],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.32534403,0.58481807,0.03724834,0.032106988,0.018331341,0.0021512855],"domain_scores_gemma":[0.050145958,0.87298,0.022089845,0.04770267,0.0063841045,0.00069733034],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.70285696,0.0038503709,0.01072889,0.0063876365,0.0030222868,0.008174484,0.010435249,0.008287102,0.008674763],"category_scores_gemma":[0.8829129,0.004150759,0.01025449,0.0069948207,0.01822953,0.016289437,0.009164577,0.012588149,0.0010823951],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.021192865,0.0018603493,0.11199982,0.025360795,0.10814145,0.0013260153,0.0049887476,0.026158083,0.0025362894,0.39244315,0.014573369,0.28941908],"study_design_scores_gemma":[0.012319672,0.0030576698,0.022528306,0.0028482438,0.03135515,0.0009450149,0.00044705105,0.054697316,0.0032421367,0.8562169,0.0120886145,0.00025390237],"about_ca_topic_score_codex":0.002423943,"about_ca_topic_score_gemma":0.0025690994,"teacher_disagreement_score":0.29714304,"about_ca_system_score_codex":0.0028884972,"about_ca_system_score_gemma":0.008234649,"threshold_uncertainty_score":0.36643034},"labels":[],"label_agreement":null},{"id":"W2033411871","doi":"10.1198/0003130031450","title":"Type I Error Inflation in the Presence of a Ceiling Effect","year":2003,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":125,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"","keywords":"Statistics; Ceiling (cloud); Econometrics; Statistical significance; Variables; Ceiling effect; Type I and type II errors; Mathematics; Standard error; Alcohol consumption; Variable (mathematics); Linear regression; Psychology; Medicine; Engineering; Biology; Alcohol","score_opus":0.09602044591037069,"score_gpt":0.43714101278193035,"score_spread":0.34112056687155967,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2033411871","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051419467,0.0036118538,0.9071278,0.009989097,0.003639398,0.002366991,0.0011422391,0.0014301947,0.019272989],"genre_scores_gemma":[0.66866106,0.0011340728,0.30980265,0.008419215,0.0015644198,0.0044522653,0.0007937006,0.00043597844,0.0047365534],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.60596365,0.2925323,0.023848902,0.033737093,0.03969298,0.0042251465],"domain_scores_gemma":[0.15382041,0.7199995,0.041441523,0.06562034,0.017668802,0.0014494449],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2854362,0.0014334503,0.0033740816,0.003136098,0.002106835,0.0043734806,0.0030612156,0.0050618662,0.006183084],"category_scores_gemma":[0.65221953,0.0013289042,0.0032142254,0.0041705654,0.006778882,0.0050981375,0.0043172413,0.007547798,0.0013987848],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004793254,0.00070543104,0.19949384,0.0029707488,0.00448009,0.0040207384,0.008454369,0.033759423,0.0025433463,0.32040527,0.04613732,0.37223613],"study_design_scores_gemma":[0.0013320805,0.0018125108,0.097762845,0.003235465,0.0031521083,0.005151125,0.0030520747,0.19548959,0.010107285,0.6492752,0.028981265,0.00064847834],"about_ca_topic_score_codex":0.0025403884,"about_ca_topic_score_gemma":0.0024567307,"teacher_disagreement_score":0.7145638,"about_ca_system_score_codex":0.0037612303,"about_ca_system_score_gemma":0.004257806,"threshold_uncertainty_score":0.88118434},"labels":[],"label_agreement":null},{"id":"W2033511646","doi":"10.1016/j.csda.2013.09.011","title":"The effect of the prior distribution in the Bayesian Adjustment for Confounding algorithm","year":2013,"lang":"en","type":"article","venue":"Computational Statistics & Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Statistics; Confounding; Outcome (game theory); Estimator; Prior probability; Bayesian probability; Mathematics; Econometrics","score_opus":0.0632994742926309,"score_gpt":0.4135541767843135,"score_spread":0.3502547024916826,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2033511646","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004168302,0.00049691624,0.9906391,0.002075978,0.00014222653,0.000057174013,0.00010228789,0.0002585736,0.0020594269],"genre_scores_gemma":[0.19116831,0.0014304619,0.79807067,0.0018967772,0.00070267625,0.0004957956,0.00042069,0.0008651361,0.004949455],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9342741,0.05421864,0.0016993537,0.004860357,0.0041594626,0.0007880325],"domain_scores_gemma":[0.6306994,0.33175865,0.003895859,0.023723152,0.008675731,0.0012472428],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.087786324,0.0013897138,0.0020762447,0.001728825,0.0018624514,0.0045074318,0.004123301,0.0035625887,0.010102687],"category_scores_gemma":[0.38496915,0.0013617702,0.0018127571,0.0027762519,0.00458436,0.0077725817,0.0043449537,0.008198721,0.0015662466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012212977,0.00016085031,0.006070419,0.00050117983,0.00067972013,0.0001802839,0.0006815123,0.053158823,0.0015099735,0.72732514,0.0070277946,0.20148315],"study_design_scores_gemma":[0.00042808856,0.00019204535,0.0028255382,0.00034941768,0.00043923326,0.00038405426,0.00012780674,0.31519732,0.0025021543,0.6675398,0.00989424,0.00012032765],"about_ca_topic_score_codex":0.005426792,"about_ca_topic_score_gemma":0.0040744888,"teacher_disagreement_score":0.087786324,"about_ca_system_score_codex":0.0014794235,"about_ca_system_score_gemma":0.0050012097,"threshold_uncertainty_score":0.46426404},"labels":[],"label_agreement":null},{"id":"W2034959910","doi":"10.1002/pds.1757","title":"Bias–variance trade‐off in pharmacoepidemiological studies using physician‐preference‐based instrumental variables: a simulation study","year":2009,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Confounding; Medicine; Instrumental variable; Preference; Variance (accounting); Operationalization; Statistics; Econometrics; Omitted-variable bias; Pharmacoepidemiology; Mathematics; Internal medicine; Medical prescription; Economics","score_opus":0.5073631578960011,"score_gpt":0.5216853837449187,"score_spread":0.014322225848917625,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034959910","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6050683,0.005377674,0.37806493,0.002783959,0.00022686292,0.0014400984,0.0015134612,0.00030878527,0.0052159145],"genre_scores_gemma":[0.96371853,0.0004964614,0.03393654,0.0003220895,0.000042078053,0.0005668975,0.0003427719,0.000031764874,0.0005428898],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9470036,0.048729084,0.0011773679,0.0014413765,0.0009447433,0.0007037864],"domain_scores_gemma":[0.43784764,0.533094,0.01334754,0.010449105,0.0043751025,0.0008866222],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09879947,0.001263329,0.002320325,0.0013157643,0.0006137032,0.0021279259,0.0022084329,0.0027327973,0.003243758],"category_scores_gemma":[0.23004779,0.0008055542,0.0039312653,0.0017506393,0.0019279997,0.0019272721,0.002272391,0.002671673,0.00020783831],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006353815,0.0006808894,0.06904336,0.0011011469,0.0042342977,0.000749515,0.00041766473,0.8468948,0.0006867289,0.044939756,0.0018341005,0.023063917],"study_design_scores_gemma":[0.0014963144,0.00096013263,0.005499166,0.0003133801,0.0012279849,0.00026411758,0.00016831106,0.96378267,0.0010126357,0.024063034,0.0011312771,0.00008101586],"about_ca_topic_score_codex":0.0068330877,"about_ca_topic_score_gemma":0.002299734,"teacher_disagreement_score":0.90120053,"about_ca_system_score_codex":0.0020854443,"about_ca_system_score_gemma":0.0016779621,"threshold_uncertainty_score":0.5225078},"labels":[],"label_agreement":null},{"id":"W2035194246","doi":"10.1007/s11749-010-0230-2","title":"Rejoinder on: Nonparametric inference based on panel count data","year":2010,"lang":"en","type":"article","venue":"Test","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":58,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Medicine; Magnetic resonance imaging; Pathological; Ultrasound; Concordance; Radiology; Immunohistochemistry; Radiofrequency ablation; Retrospective cohort study; Internal medicine; Surgery; Ablation","score_opus":0.3627079804759021,"score_gpt":0.4519888626851039,"score_spread":0.08928088220920183,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035194246","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064620026,0.008122748,0.70260507,0.23319812,0.030180646,0.0002442853,0.0015351828,0.0007579245,0.016894031],"genre_scores_gemma":[0.18108566,0.0059118913,0.5276823,0.15264754,0.0778244,0.0016397014,0.0012552835,0.0013422732,0.050611027],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9808328,0.011869939,0.0010151792,0.002790895,0.0031269842,0.00036413118],"domain_scores_gemma":[0.82478607,0.14617905,0.0022042007,0.015588062,0.010167822,0.0010748622],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.032552242,0.0012335529,0.0042081163,0.0029882053,0.0027476822,0.0026824127,0.0057041734,0.008281175,0.010202715],"category_scores_gemma":[0.1797573,0.00063428865,0.0025314232,0.0025670754,0.007081674,0.0059620067,0.004503138,0.017392738,0.0026820926],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036333367,0.00008311966,0.0011800304,0.0002996544,0.00034815294,0.00045999332,0.000764384,0.0024861197,0.00032297187,0.72307557,0.20613313,0.06448359],"study_design_scores_gemma":[0.00015968947,0.00002906101,0.0004922123,0.00011532228,0.000113656024,0.00013285226,0.000115038325,0.0069971518,0.00031756802,0.9438408,0.04764392,0.00004275984],"about_ca_topic_score_codex":0.003070542,"about_ca_topic_score_gemma":0.0030927232,"teacher_disagreement_score":0.032552242,"about_ca_system_score_codex":0.0010524788,"about_ca_system_score_gemma":0.0019520732,"threshold_uncertainty_score":0.17215478},"labels":[],"label_agreement":null},{"id":"W2035305268","doi":"10.1002/pds.1674","title":"Assessing balance in measured baseline covariates when using many‐to‐one matching on the propensity‐score","year":2008,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":184,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Covariate; Medicine; Matching (statistics); Statistics; Inverse probability weighting; Internal medicine; Mathematics","score_opus":0.41891381304108016,"score_gpt":0.4484603936667629,"score_spread":0.029546580625682717,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035305268","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08278932,0.00029679405,0.9126828,0.000678803,0.00006143663,0.0005233945,0.000612444,0.00021126468,0.0021438056],"genre_scores_gemma":[0.6671162,0.0003018013,0.32897064,0.00039727634,0.00009777798,0.0011015051,0.0010215202,0.00006800299,0.0009252773],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9629813,0.028936971,0.002269576,0.0021598858,0.0033061039,0.000346191],"domain_scores_gemma":[0.89350003,0.08189541,0.011429492,0.0103252875,0.0025129074,0.00033683787],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.052261505,0.00076763425,0.0014389368,0.0032201568,0.0007691841,0.0015881343,0.0012561429,0.0012783045,0.0041437023],"category_scores_gemma":[0.20231041,0.00039718507,0.0010091735,0.003288122,0.002015371,0.0032009038,0.0027153327,0.0011434049,0.0003959998],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017319163,0.00064674136,0.23363009,0.0009004626,0.0020412442,0.00059074955,0.0023111925,0.049410347,0.0043412396,0.20520055,0.0055131675,0.49368235],"study_design_scores_gemma":[0.00055346603,0.0009673418,0.112565756,0.00030725618,0.0006335225,0.000868423,0.00092666247,0.297678,0.00885726,0.56678796,0.0096756285,0.00017880983],"about_ca_topic_score_codex":0.0012044269,"about_ca_topic_score_gemma":0.0009534476,"teacher_disagreement_score":0.94773847,"about_ca_system_score_codex":0.00074091856,"about_ca_system_score_gemma":0.0012070943,"threshold_uncertainty_score":0.27638853},"labels":[],"label_agreement":null},{"id":"W2035404753","doi":"10.1177/0962280215584401","title":"The performance of inverse probability of treatment weighting and full matching on the propensity score in the presence of model misspecification when estimating the effect of treatment on survival outcomes","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":325,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Mental Health","keywords":"Propensity score matching; Observational study; Matching (statistics); Statistics; Inverse probability weighting; Hazard ratio; Inverse probability; Covariate; Average treatment effect; Selection bias; Confounding; Weighting; Marginal structural model; Econometrics; Selection (genetic algorithm); Mathematics; Computer science; Medicine; Confidence interval; Posterior probability; Bayesian probability; Artificial intelligence","score_opus":0.5863130353224311,"score_gpt":0.5806095152849405,"score_spread":0.005703520037490528,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035404753","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09423201,0.0023148803,0.8993744,0.0005758584,0.00016761711,0.0006758491,0.00019946888,0.00039660855,0.002063386],"genre_scores_gemma":[0.5164662,0.0011806686,0.4796246,0.00040021463,0.00012342053,0.0008669392,0.0004346655,0.00018545902,0.00071776536],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.90809554,0.077786826,0.0035322122,0.004155118,0.0057218834,0.0007084448],"domain_scores_gemma":[0.75116295,0.20471425,0.011598333,0.02604081,0.005690562,0.0007931436],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12336686,0.0014464215,0.0025211615,0.0031427373,0.000909724,0.0025380298,0.0021013743,0.0019634492,0.002198558],"category_scores_gemma":[0.3221789,0.0011204729,0.003246184,0.0029108287,0.0021188345,0.0037910144,0.004931708,0.0024346446,0.0004148356],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027574566,0.00030098803,0.050361026,0.0013928354,0.004375666,0.00025958163,0.0012226802,0.27737272,0.0025224022,0.051737223,0.001979167,0.6057182],"study_design_scores_gemma":[0.0005681652,0.0011255981,0.021924304,0.0005419058,0.001210023,0.0005680492,0.00019849787,0.84129256,0.003994491,0.12326427,0.0050497022,0.00026241003],"about_ca_topic_score_codex":0.003744821,"about_ca_topic_score_gemma":0.0021041988,"teacher_disagreement_score":0.87663317,"about_ca_system_score_codex":0.001351644,"about_ca_system_score_gemma":0.0028754154,"threshold_uncertainty_score":0.6524341},"labels":[],"label_agreement":null},{"id":"W2036193982","doi":"10.1080/00273171.2011.568786","title":"An Introduction to Propensity Score Methods for Reducing the Effects of Confounding in Observational Studies","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11884,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Observational study; Covariate; Confounding; Statistics; Inverse probability weighting; Econometrics; Mathematics","score_opus":0.8974226593536919,"score_gpt":0.6794649079660394,"score_spread":0.2179577513876525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036193982","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00024350666,0.0043060374,0.99055266,0.0014779316,0.00049117365,0.00024828452,0.00035706715,0.00030074306,0.0020225036],"genre_scores_gemma":[0.00894371,0.012724371,0.96868503,0.0012558167,0.002510169,0.0017467625,0.00064014713,0.00033695766,0.003156957],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.976929,0.01696536,0.0011463742,0.0011722144,0.0035489518,0.0002380372],"domain_scores_gemma":[0.95614725,0.03687255,0.001960655,0.002791513,0.0018839876,0.0003440085],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025659665,0.0021313883,0.0022606354,0.004319488,0.0010787607,0.002945566,0.0031866478,0.0030984636,0.017817618],"category_scores_gemma":[0.07310484,0.0012348326,0.003387682,0.008909905,0.002494858,0.0036621075,0.0029166888,0.007835088,0.006071698],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006495276,0.00011448645,0.0023710271,0.0019816728,0.00058784976,0.00025796302,0.0004048448,0.015073315,0.0008950936,0.55955637,0.069797106,0.34889534],"study_design_scores_gemma":[0.000119599645,0.00012052664,0.0016455252,0.0007699517,0.00016579543,0.00050272816,0.000073335344,0.037325427,0.0007373698,0.8075804,0.15083297,0.00012635336],"about_ca_topic_score_codex":0.0018122713,"about_ca_topic_score_gemma":0.0020777825,"teacher_disagreement_score":0.025659665,"about_ca_system_score_codex":0.0014363396,"about_ca_system_score_gemma":0.0032271836,"threshold_uncertainty_score":0.13570291},"labels":[],"label_agreement":null},{"id":"W2036514462","doi":"10.1080/00273171.2011.589280","title":"Multilevel SEM Strategies for Evaluating Mediation in Three-Level Data","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Mount Allison University","keywords":"Mediation; Multilevel model; Computer science; Structural equation modeling; Psychology; Data mining; Econometrics; Statistics; Mathematics; Machine learning; Sociology","score_opus":0.9563346823471308,"score_gpt":0.6781517874356203,"score_spread":0.2781828949115105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036514462","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036023753,0.00032144936,0.99132675,0.0003045137,0.000103532984,0.0011958833,0.00043687416,0.00048697318,0.0022216842],"genre_scores_gemma":[0.036202673,0.00028990547,0.9547879,0.00016418807,0.000036048415,0.007572813,0.0003073838,0.00014821123,0.0004908861],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.87192535,0.1130432,0.004045983,0.0037157766,0.0064549893,0.0008146897],"domain_scores_gemma":[0.7844976,0.18693133,0.006280156,0.012915023,0.008613111,0.00076266576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10486733,0.0026706364,0.003733756,0.0071347286,0.0022213326,0.0044105886,0.004860567,0.0021103956,0.023026016],"category_scores_gemma":[0.24336916,0.0014575113,0.0058892174,0.011604683,0.0027062756,0.0046110554,0.0049161036,0.0056153378,0.0016946445],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005141526,0.00047042817,0.0126455715,0.0029824923,0.0055430885,0.00038477298,0.006031349,0.015570536,0.0015444028,0.60883194,0.013069507,0.3324117],"study_design_scores_gemma":[0.00066208147,0.0017092112,0.012664137,0.0018920576,0.0022003457,0.00047858193,0.0041749566,0.18834797,0.00438361,0.7344545,0.048712287,0.000320335],"about_ca_topic_score_codex":0.0029115167,"about_ca_topic_score_gemma":0.004286938,"teacher_disagreement_score":0.10486733,"about_ca_system_score_codex":0.0022197678,"about_ca_system_score_gemma":0.0050181444,"threshold_uncertainty_score":0.5545981},"labels":[],"label_agreement":null},{"id":"W2037889113","doi":"10.1002/sim.5530","title":"Efficient analysis of case‐control studies with sample weights","year":2012,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital","funders":"","keywords":"Estimator; Covariate; Statistics; Sample (material); Population; Sample size determination; Mathematics; Bootstrapping (finance); Robustness (evolution); Econometrics; Computer science","score_opus":0.1146731685975503,"score_gpt":0.4553308516164282,"score_spread":0.3406576830188779,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037889113","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075977673,0.00079212163,0.9902367,0.0003538218,0.000057906364,0.0004378643,0.000075781696,0.000077273195,0.00037073734],"genre_scores_gemma":[0.23923804,0.0015793404,0.752868,0.00037080096,0.00023713829,0.0044761957,0.00044092388,0.00006856123,0.00072106987],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8450673,0.13609628,0.0053353505,0.0044383137,0.008407385,0.0006553762],"domain_scores_gemma":[0.52558386,0.42874008,0.01672916,0.023092894,0.005342094,0.0005118879],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15428536,0.0012467116,0.0037344105,0.0047080414,0.0007083461,0.0027519201,0.003099924,0.0024566173,0.002423664],"category_scores_gemma":[0.43598393,0.0015767067,0.0020872103,0.0041157496,0.002608171,0.0034480647,0.0034212582,0.002560854,0.00027724533],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008235381,0.00035476286,0.02667009,0.0021775977,0.004093574,0.00080805237,0.0006571353,0.28059602,0.0020763124,0.355106,0.002648629,0.3239883],"study_design_scores_gemma":[0.00053529034,0.00038843034,0.006086852,0.0005025428,0.0008616698,0.00032773014,0.00013115439,0.56730026,0.0014675966,0.41692615,0.005414659,0.00005766115],"about_ca_topic_score_codex":0.0010401595,"about_ca_topic_score_gemma":0.00083986676,"teacher_disagreement_score":0.15428536,"about_ca_system_score_codex":0.0016820288,"about_ca_system_score_gemma":0.0027959223,"threshold_uncertainty_score":0.8159487},"labels":[],"label_agreement":null},{"id":"W2043051651","doi":"10.1089/pop.2011.0104","title":"Exploring Robust Methods for Evaluating Treatment and Comparison Groups in Chronic Care Management Programs","year":2012,"lang":"en","type":"article","venue":"Population Health Management","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":78,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Toyota Motor Corporation; York University; Institute for Quantitative Social Science, Harvard University; Harvard University","keywords":"Matching (statistics); Propensity score matching; Average treatment effect; Statistic; Medicine; Psychological intervention; Variance (accounting); Statistics; Health care; Population; Analysis of variance; Operations management; Mathematics; Nursing; Environmental health; Engineering","score_opus":0.7243465867818727,"score_gpt":0.5958023742768924,"score_spread":0.12854421250498027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2043051651","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025720153,0.0019846202,0.95524615,0.0017623918,0.00048872246,0.010606175,0.0008489998,0.0005236141,0.0028191935],"genre_scores_gemma":[0.22043204,0.00049108075,0.7477709,0.0008715483,0.0001784479,0.028841125,0.0006039489,0.0001188531,0.0006920483],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.40260583,0.5460693,0.01382033,0.016562244,0.019466951,0.0014752689],"domain_scores_gemma":[0.25594094,0.6336832,0.046869684,0.052467734,0.009533385,0.0015050641],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.45882463,0.001978919,0.0037700061,0.005413854,0.0020587496,0.004268518,0.005960809,0.0040375367,0.006837962],"category_scores_gemma":[0.6772752,0.0011949604,0.005853681,0.0053665787,0.005817651,0.004546271,0.0069258427,0.0057967636,0.00081889634],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0076130643,0.0024123155,0.06545058,0.006511792,0.01758459,0.00039608043,0.004519293,0.041532733,0.0020035354,0.16722038,0.0066520595,0.67810357],"study_design_scores_gemma":[0.005852462,0.01722926,0.067484684,0.0064413166,0.0071935044,0.0005331271,0.0032967476,0.3297446,0.0072712153,0.51710445,0.037358746,0.0004898192],"about_ca_topic_score_codex":0.0034540603,"about_ca_topic_score_gemma":0.0024890583,"teacher_disagreement_score":0.54117537,"about_ca_system_score_codex":0.0045105526,"about_ca_system_score_gemma":0.0068251737,"threshold_uncertainty_score":0.6673656},"labels":[],"label_agreement":null},{"id":"W2044678740","doi":"10.1016/j.jclinepi.2003.07.014","title":"Commonalities in the classical, collapsibility and counterfactual concepts of confounding","year":2004,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Counterfactual thinking; Confounding; Counterfactual conditional; Econometrics; Key (lock); Abstraction; Computer science; Covariate; Observational study; Medicine; Risk analysis (engineering); Statistics; Mathematics; Psychology; Epistemology; Social psychology; Computer security","score_opus":0.7854842182921576,"score_gpt":0.6818694211313308,"score_spread":0.10361479716082689,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2044678740","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019418667,0.7454814,0.23523231,0.011720188,0.00076416665,0.00006013136,0.00009569065,0.000068834976,0.0046354285],"genre_scores_gemma":[0.0627899,0.80684614,0.11975679,0.0038797148,0.0044285613,0.00039451578,0.00015370073,0.000059660586,0.001690967],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.978235,0.013377491,0.0017074741,0.0018892176,0.0045691677,0.00022157055],"domain_scores_gemma":[0.85615355,0.1329821,0.0025777088,0.0045028604,0.0034347775,0.00034899422],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.049675222,0.0016253833,0.004456295,0.0053551095,0.0008907969,0.0062541403,0.0055354615,0.0046922173,0.0020795304],"category_scores_gemma":[0.07579734,0.0013029675,0.002126194,0.009244431,0.016744578,0.014584174,0.0039731907,0.009329552,0.0005658603],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007372808,0.00004348808,0.0007222152,0.0038999864,0.00029697004,0.0001611374,0.0007318667,0.0017158214,0.00015128798,0.8129279,0.0027446102,0.17653096],"study_design_scores_gemma":[0.00002093726,0.00003503036,0.0005656461,0.0012197953,0.000108213026,0.0007015797,0.00017250178,0.0016418508,0.0001776064,0.96638405,0.028927106,0.000045754125],"about_ca_topic_score_codex":0.0015251559,"about_ca_topic_score_gemma":0.0016209247,"teacher_disagreement_score":0.049675222,"about_ca_system_score_codex":0.0024623969,"about_ca_system_score_gemma":0.0034351156,"threshold_uncertainty_score":0.26271087},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2046661414","doi":"10.1016/j.jmpt.2013.07.009","title":"Examination of the Relationship Between Theory-Driven Policies and Allowed Lost-Time Back Claims in Workers' Compensation: A System Dynamics Model","year":2013,"lang":"en","type":"article","venue":"Journal of Manipulative and Physiological Therapeutics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Ontario Tech University; University of Toronto; Canadian Memorial Chiropractic College","funders":"","keywords":"Compensation (psychology); Econometrics; Gini coefficient; Statistics; Actuarial science; Operations research; Inequality; Economics; Mathematics; Economic inequality","score_opus":0.480003074903353,"score_gpt":0.40753078081697447,"score_spread":0.07247229408637851,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2046661414","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.93838406,0.00019537688,0.03782957,0.001442858,0.000037915943,0.00022730092,0.0018813501,0.00016761702,0.019834006],"genre_scores_gemma":[0.994769,0.00008883827,0.0019298446,0.00003555051,0.000004353295,0.000095798176,0.0002714816,0.000007739597,0.0027974418],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995443,0.0001326022,0.000016406739,0.00009238306,0.0000879676,0.00012632614],"domain_scores_gemma":[0.9977411,0.0013474918,0.00031800623,0.00004400432,0.0004556624,0.00009367957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015915025,0.0006959912,0.00062275527,0.00077117013,0.0008730723,0.0015562196,0.0013525692,0.0012814532,0.0035363855],"category_scores_gemma":[0.005496044,0.00046842403,0.0006993019,0.0005116179,0.00083013804,0.0008900809,0.0008248621,0.0011360743,0.00021574875],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000028525692,0.00002959475,0.0066078976,0.000020823121,0.000017369257,0.000047068246,0.00007610552,0.9895844,0.00014187784,0.0024693054,0.00019341389,0.00078357285],"study_design_scores_gemma":[0.000016464444,0.000036223217,0.0028627594,0.000007282735,0.000014123512,0.0000098495475,0.00010001121,0.99548006,0.000080551166,0.0010096045,0.000374691,0.000008425174],"about_ca_topic_score_codex":0.42136422,"about_ca_topic_score_gemma":0.20562176,"teacher_disagreement_score":0.42136422,"about_ca_system_score_codex":0.009835761,"about_ca_system_score_gemma":0.0077072387,"threshold_uncertainty_score":0.8378232},"labels":[],"label_agreement":null},{"id":"W2046889498","doi":"10.1093/cid/ciu036","title":"Reply to Strandberg and Tienari","year":2014,"lang":"en","type":"letter","venue":"Clinical Infectious Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto; St. Michael's Hospital","funders":"","keywords":"Medicine; Dermatology","score_opus":0.1764704338020869,"score_gpt":0.4638362948799244,"score_spread":0.28736586107783746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2046889498","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000058702444,0.0005787434,0.00006108013,0.98839915,0.010312125,0.0000061403957,0.000036931553,0.000007834834,0.00053935783],"genre_scores_gemma":[0.0008407876,0.00043213862,0.00007937326,0.9797395,0.016970275,0.000031116324,0.000011431281,0.000010897573,0.0018845802],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.994816,0.002009477,0.0005818494,0.0008051383,0.0010896419,0.0006979676],"domain_scores_gemma":[0.96840835,0.023544913,0.0014515071,0.0007670199,0.0031705147,0.00265765],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009567579,0.0010285631,0.0026659793,0.001242673,0.005743966,0.007015767,0.0034631668,0.11661804,0.009028775],"category_scores_gemma":[0.094639495,0.0016839114,0.0015888907,0.0013228656,0.006560236,0.0062383674,0.0036800015,0.081177056,0.006560516],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003183473,0.000008714618,0.00019360804,0.00003373145,0.0000136872095,0.00026701685,0.00008447299,0.000045122775,0.000022763108,0.0024896269,0.99467295,0.0021365348],"study_design_scores_gemma":[0.00025136888,0.00005237486,0.0012027313,0.00081178907,0.00009621312,0.00094870327,0.0007367,0.0008894463,0.00022394277,0.041975163,0.9526669,0.00014456143],"about_ca_topic_score_codex":0.00869073,"about_ca_topic_score_gemma":0.011946449,"teacher_disagreement_score":0.11661804,"about_ca_system_score_codex":0.006248841,"about_ca_system_score_gemma":0.007856971,"threshold_uncertainty_score":0.0505988},"labels":[],"label_agreement":null},{"id":"W2048433325","doi":"10.1016/j.prevetmed.2008.02.013","title":"Linking causal concepts, study design, analysis and inference in support of one epidemiology for population health","year":2008,"lang":"en","type":"article","venue":"Preventive Veterinary Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Observational study; Causal inference; Causation; Interpretation (philosophy); Inference; Management science; Research design; Population; Causality (physics); Observational methods in psychology; Computer science; Data science; Psychology; Medicine; Epistemology; Engineering; Environmental health; Mathematics; Statistics; Artificial intelligence; Pathology","score_opus":0.46485013698536204,"score_gpt":0.5435031123947849,"score_spread":0.07865297540942284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2048433325","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006827086,0.00067205075,0.9882499,0.0029302225,0.00007255442,0.00011001006,0.00008148268,0.00007279325,0.000983822],"genre_scores_gemma":[0.24880905,0.0014559651,0.74636334,0.0010206621,0.00048117078,0.0007738917,0.00013628347,0.00004568775,0.0009138822],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92585474,0.065141656,0.0018341634,0.0031764654,0.0035457043,0.00044735678],"domain_scores_gemma":[0.45567572,0.50871015,0.013911916,0.01561313,0.0048958547,0.0011931714],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0797608,0.0012246112,0.002637055,0.0038038113,0.0015732483,0.004261613,0.0030253083,0.0035751213,0.0047496175],"category_scores_gemma":[0.3370533,0.0011546364,0.002407063,0.0036588276,0.0052598114,0.0066149165,0.0051048747,0.0066558546,0.00045234003],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000318671,0.00037677842,0.008928124,0.001164454,0.00075174513,0.00046270943,0.001256741,0.048617993,0.0005465496,0.8381324,0.001817226,0.09762666],"study_design_scores_gemma":[0.00010010497,0.000088113215,0.00086306996,0.00011933023,0.00016046342,0.00012238909,0.000091095695,0.09021488,0.00022594897,0.906481,0.001514831,0.000018796436],"about_ca_topic_score_codex":0.0022005036,"about_ca_topic_score_gemma":0.001991226,"teacher_disagreement_score":0.9202392,"about_ca_system_score_codex":0.0022515324,"about_ca_system_score_gemma":0.007303275,"threshold_uncertainty_score":0.42182046},"labels":[],"label_agreement":null},{"id":"W2050044081","doi":"10.1093/aje/kwq154","title":"RE: \"SMOKING AND PARKINSON'S DISEASE: USING PARENTAL SMOKING AS A PROXY TO EXPLORE CAUSALITY\"","year":2010,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causality (physics); Proxy (statistics); Medicine; Disease; Environmental health; Internal medicine; Statistics; Mathematics","score_opus":0.23258208226122842,"score_gpt":0.45636287507312523,"score_spread":0.2237807928118968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2050044081","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034703623,0.00077141554,0.00050939096,0.97572315,0.021079762,0.000019407316,0.00021887268,0.00006557582,0.0012653205],"genre_scores_gemma":[0.0024515102,0.0006382445,0.0007527085,0.9448233,0.04560039,0.00009167133,0.00008602556,0.000039061437,0.0055170264],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932494,0.0026839606,0.0013069295,0.0010186359,0.00130519,0.0004358659],"domain_scores_gemma":[0.9272752,0.056759935,0.0027326546,0.0017852407,0.008634108,0.002812875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011363976,0.0020286553,0.0033362505,0.0020946297,0.004624219,0.0048074704,0.004640271,0.06947827,0.007773037],"category_scores_gemma":[0.091090485,0.001973593,0.00187092,0.0018943596,0.005278344,0.004281307,0.0023449666,0.09286469,0.012237102],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000050359144,0.000031323172,0.0011601977,0.000056821154,0.000049721442,0.00051781937,0.0001681304,0.00008557666,0.00008571266,0.0022777882,0.9868385,0.008678138],"study_design_scores_gemma":[0.00068302033,0.00012706347,0.008303706,0.0018643467,0.0005470459,0.004594582,0.0020712742,0.00452571,0.0008676271,0.052117452,0.9239491,0.00034906834],"about_ca_topic_score_codex":0.023907416,"about_ca_topic_score_gemma":0.036427137,"teacher_disagreement_score":0.06947827,"about_ca_system_score_codex":0.00493694,"about_ca_system_score_gemma":0.0063419463,"threshold_uncertainty_score":0.060099125},"labels":[],"label_agreement":null},{"id":"W2050419204","doi":"10.1111/1468-2354.t01-1-00074","title":"2001 Lawrence R. Klein Lecture Estimating Distributions of Treatment Effects with an Application to the Returns to Schooling and Measurement of the Effects of Uncertainty on College Choice*","year":2003,"lang":"en","type":"article","venue":"International Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":351,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Counterfactual conditional; LISREL; Veil of ignorance; Econometrics; Economics; Matching (statistics); Pairwise comparison; Probit model; Actuarial science; Mathematics; Statistics; Psychology; Microeconomics; Structural equation modeling; Counterfactual thinking; Social psychology","score_opus":0.052827051661603466,"score_gpt":0.3680734952222458,"score_spread":0.31524644356064235,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2050419204","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022203655,0.0077308174,0.96361315,0.010339503,0.00030910104,0.00007123325,0.0005860317,0.00060961954,0.014520174],"genre_scores_gemma":[0.11011771,0.026722502,0.82396716,0.0015179105,0.00096942385,0.00074144866,0.0013095719,0.0008415853,0.033812765],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9949515,0.0036327974,0.00020259217,0.00049368804,0.00060763827,0.000111804475],"domain_scores_gemma":[0.9569334,0.037563104,0.001122686,0.0024421213,0.0016856358,0.00025301432],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01971663,0.0013650839,0.002363477,0.0044800425,0.0009198937,0.0037335749,0.0016490387,0.0022269005,0.02682458],"category_scores_gemma":[0.07212189,0.0020290492,0.0022843839,0.006162832,0.003167674,0.005536459,0.0031112244,0.0045792167,0.005894071],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000101278674,0.00007746326,0.0038689803,0.00027530952,0.00038163897,0.00014754804,0.0002249306,0.058369797,0.0002487883,0.53060347,0.06159702,0.3441037],"study_design_scores_gemma":[0.00006548693,0.00001990289,0.001265124,0.00022597633,0.00009643376,0.000108428976,0.000075729135,0.085683204,0.00024296773,0.87560624,0.036562834,0.000047672027],"about_ca_topic_score_codex":0.012120763,"about_ca_topic_score_gemma":0.010360718,"teacher_disagreement_score":0.02682458,"about_ca_system_score_codex":0.003303581,"about_ca_system_score_gemma":0.0035419432,"threshold_uncertainty_score":0.10427278},"labels":[],"label_agreement":null},{"id":"W2050791524","doi":"10.1097/ede.0b013e3181f2f8e8","title":"The Multitime Case-control Design for Time-varying Exposures","year":2010,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Confidence interval; Odds ratio; Estimator; Statistics; Mathematics; Variance (accounting); Moment (physics); Control (management); Correlation; Odds; Medicine; Econometrics; Computer science; Logistic regression; Economics","score_opus":0.22077592784573954,"score_gpt":0.4448999796850942,"score_spread":0.22412405183935466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2050791524","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06613142,0.0007772224,0.91984415,0.00067144586,0.0012505369,0.008766463,0.0007127706,0.0005524635,0.001293596],"genre_scores_gemma":[0.3335082,0.00035417327,0.62529916,0.00065684534,0.00048042086,0.03640842,0.00060119457,0.0000707942,0.0026207834],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84574294,0.12882288,0.003815513,0.0131788505,0.0067907656,0.0016490138],"domain_scores_gemma":[0.8754143,0.07383455,0.015766183,0.02828839,0.005672689,0.0010238675],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09583567,0.002201133,0.0035402977,0.0017390971,0.0016805376,0.0018942703,0.0043670717,0.005655289,0.011401187],"category_scores_gemma":[0.13378823,0.0014486457,0.003801295,0.0019626652,0.0040717134,0.0022506786,0.0021858853,0.0034464642,0.0010910523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1050711,0.0057186657,0.06312348,0.0058257245,0.008926139,0.0021853284,0.0035293852,0.17426267,0.02115057,0.24702875,0.009464608,0.3537136],"study_design_scores_gemma":[0.033862606,0.059598412,0.03984652,0.0008402539,0.004608444,0.0017282687,0.00045096065,0.6821052,0.012425001,0.12364725,0.040216234,0.0006708698],"about_ca_topic_score_codex":0.0011409813,"about_ca_topic_score_gemma":0.0008013567,"teacher_disagreement_score":0.09583567,"about_ca_system_score_codex":0.0017954756,"about_ca_system_score_gemma":0.00220959,"threshold_uncertainty_score":0.50683355},"labels":[],"label_agreement":null},{"id":"W2051341588","doi":"10.1016/j.jclinepi.2009.06.003","title":"Methods to elicit beliefs for Bayesian priors: a systematic review","year":2009,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Women's College Hospital; University Health Network; University of Toronto; Toronto General Hospital; Hospital for Sick Children; Public Health Ontario; Sinai Health System","funders":"Canadian Institutes of Health Research; Canada Research Chairs","keywords":"Expert elicitation; Prior probability; Bayes' theorem; Bayesian probability; Reliability (semiconductor); Context (archaeology); Point estimation; Statistics; Medicine; Computer science; Mathematics","score_opus":0.7724243414633696,"score_gpt":0.7300403061625055,"score_spread":0.0423840353008641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2051341588","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007567973,0.9601728,0.03584312,0.0011581318,0.0001726823,0.0008356863,0.00039859087,0.00008435967,0.0005779244],"genre_scores_gemma":[0.026451278,0.8931679,0.07603628,0.0011338744,0.00027783474,0.0021804108,0.00039092352,0.000043727363,0.00031782206],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.95486075,0.032924496,0.005704289,0.0014518322,0.004864954,0.00019376307],"domain_scores_gemma":[0.6849687,0.29824954,0.008388233,0.0038012392,0.0042919377,0.0003003581],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.065924935,0.0026694566,0.009031091,0.0071949726,0.00045588572,0.0026591164,0.00344484,0.0031391182,0.0054956246],"category_scores_gemma":[0.29797107,0.0019115574,0.008762672,0.0060427254,0.0013662884,0.004697447,0.0020103324,0.0039331294,0.00070274615],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006063483,0.00008780016,0.0007911859,0.36438727,0.02363124,0.000074249794,0.00021972733,0.003271008,0.00012445355,0.006453464,0.0055952426,0.59475803],"study_design_scores_gemma":[0.0061824876,0.0014156188,0.0067536747,0.58794695,0.16773859,0.0013732751,0.0004998125,0.013049238,0.001646747,0.13078776,0.08214782,0.00045804042],"about_ca_topic_score_codex":0.0040733633,"about_ca_topic_score_gemma":0.0086226575,"teacher_disagreement_score":0.93407506,"about_ca_system_score_codex":0.002673667,"about_ca_system_score_gemma":0.006704282,"threshold_uncertainty_score":0.34864855},"labels":[],"label_agreement":null},{"id":"W2051866975","doi":"10.1016/j.jtcvs.2007.07.021","title":"Propensity-score matching in the cardiovascular surgery literature from 2004 to 2006: A systematic review and suggestions for improvement","year":2007,"lang":"en","type":"review","venue":"Journal of Thoracic and Cardiovascular Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":598,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Systematic review; Matching (statistics); Medicine; MEDLINE; General surgery; Surgery; Political science; Pathology","score_opus":0.19215338945083002,"score_gpt":0.4069807759266218,"score_spread":0.21482738647579178,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2051866975","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013729619,0.9953467,0.0015186699,0.00095959456,0.0001998291,0.00024078305,0.00024919797,0.000012439892,0.00009985153],"genre_scores_gemma":[0.039495982,0.9491074,0.008787117,0.0011680583,0.00029180467,0.0006590014,0.00038503692,0.000009346149,0.000096204945],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9665933,0.016658768,0.010524564,0.0026343386,0.0032133483,0.00037568095],"domain_scores_gemma":[0.89398116,0.081206635,0.016601393,0.0021796683,0.0055362103,0.0004948701],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.046903778,0.0015977899,0.012987204,0.010889563,0.00063380104,0.0029267583,0.0027558436,0.002086148,0.0031963168],"category_scores_gemma":[0.13641343,0.0013390235,0.014280706,0.014467685,0.0013077933,0.0042675436,0.0022703954,0.0017166766,0.0002397552],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006999846,0.000054505683,0.006894065,0.7202207,0.07717006,0.00012300746,0.0002836117,0.00068920205,0.00017860615,0.0012630896,0.0031350693,0.18928812],"study_design_scores_gemma":[0.002648001,0.000743149,0.024512216,0.4401195,0.49556294,0.00067836355,0.00066205295,0.001150823,0.00059594633,0.006676752,0.026495768,0.00015446272],"about_ca_topic_score_codex":0.0067032883,"about_ca_topic_score_gemma":0.020488417,"teacher_disagreement_score":0.9870128,"about_ca_system_score_codex":0.0030672317,"about_ca_system_score_gemma":0.018061139,"threshold_uncertainty_score":0.24805385},"labels":[],"label_agreement":null},{"id":"W2052420143","doi":"10.1016/j.cct.2006.08.007","title":"The effect of omitted covariates on confidence interval and study power in binary outcome analysis: A simulation study","year":2006,"lang":"en","type":"article","venue":"Contemporary Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariate; Statistics; Confidence interval; Medicine; Coverage probability; Outcome (game theory); Point estimation; Econometrics; Statistical power; Demography; Mathematics","score_opus":0.5132328047401201,"score_gpt":0.6017763023662334,"score_spread":0.08854349762611324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052420143","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5434271,0.011130361,0.4273958,0.0064222775,0.0003197061,0.0015892158,0.00083919516,0.00049899874,0.008377335],"genre_scores_gemma":[0.9615437,0.0009989277,0.035119712,0.0006240382,0.00009537223,0.00061847724,0.00013464707,0.00007916776,0.00078602857],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8402935,0.151782,0.0019605814,0.002576569,0.0021530555,0.0012343074],"domain_scores_gemma":[0.075952396,0.907634,0.0064729284,0.007758926,0.0014614309,0.00072022324],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1915658,0.0019348818,0.0041079996,0.0018813958,0.0009134049,0.0034869085,0.0036188732,0.006184054,0.006689207],"category_scores_gemma":[0.5670816,0.0014954197,0.0042322366,0.0021560725,0.006988045,0.005068381,0.0031196435,0.0072217537,0.00043078556],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.074943826,0.0039754654,0.045377508,0.0032388961,0.010397996,0.0021750208,0.0028431076,0.5564062,0.0021845435,0.21560003,0.005240588,0.07761681],"study_design_scores_gemma":[0.014845052,0.007085106,0.0067191133,0.0006299758,0.0062432652,0.001207244,0.000307109,0.8148938,0.0013985384,0.1449235,0.0015231238,0.00022420126],"about_ca_topic_score_codex":0.0024112505,"about_ca_topic_score_gemma":0.0009833229,"teacher_disagreement_score":0.8084342,"about_ca_system_score_codex":0.0019990478,"about_ca_system_score_gemma":0.0022308666,"threshold_uncertainty_score":0.9969433},"labels":[],"label_agreement":null},{"id":"W2052462306","doi":"10.1016/j.jclinepi.2014.10.003","title":"A reanalysis of cluster randomized trials showed interrupted time-series studies were valuable in health system evaluation","year":2014,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":133,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Norges Forskningsråd; McMaster University","keywords":"Randomized controlled trial; Interrupted time series; Medicine; N of 1 trial; Interrupted Time Series Analysis; Psychological intervention; Research design; Cluster (spacecraft); Cluster randomised controlled trial; Statistics; Computer science; Surgery; Mathematics","score_opus":0.7544714292539911,"score_gpt":0.66713741394165,"score_spread":0.08733401531234108,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052462306","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.101542436,0.01972459,0.8597993,0.0029937006,0.0031595707,0.0033984177,0.0051733362,0.0018919895,0.002316633],"genre_scores_gemma":[0.67423093,0.002673464,0.31483123,0.0014960512,0.00060998905,0.0018005029,0.0021240728,0.00059653184,0.0016373406],"study_design_codex":"design_other","study_design_gemma":"meta_analysis","domain_scores_codex":[0.7483954,0.2093723,0.016382061,0.01261276,0.011859692,0.0013778288],"domain_scores_gemma":[0.25829333,0.6174621,0.020627754,0.08271958,0.019862004,0.0010352314],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2380133,0.0018474199,0.006441761,0.0046525146,0.0014348823,0.004554883,0.002992607,0.0021836825,0.0064674225],"category_scores_gemma":[0.58983064,0.0012457002,0.015378108,0.0066648447,0.0018091903,0.0040808483,0.0013875379,0.0060930355,0.0007730607],"study_design_candidate":"meta_analysis","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.033225805,0.0006780111,0.10742022,0.02027511,0.11632882,0.0013266531,0.0027000327,0.035214715,0.0053503877,0.036382306,0.02368844,0.6174096],"study_design_scores_gemma":[0.008743622,0.013405486,0.18219976,0.0069388924,0.22116551,0.002469733,0.0018548522,0.31004822,0.016681377,0.18140326,0.0538168,0.0012724727],"about_ca_topic_score_codex":0.005270508,"about_ca_topic_score_gemma":0.0067899963,"teacher_disagreement_score":0.9935582,"about_ca_system_score_codex":0.0015304798,"about_ca_system_score_gemma":0.0057385005,"threshold_uncertainty_score":0.93966526},"labels":[],"label_agreement":null},{"id":"W2052567024","doi":"10.1037/1082-989x.12.3.247","title":"Combining propensity score matching and group-based trajectory analysis in an observational study.","year":2007,"lang":"en","type":"article","venue":"Psychological Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":285,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Institute of Mental Health","keywords":"Propensity score matching; Covariate; Observational study; Matching (statistics); Mahalanobis distance; Statistics; Trajectory; Mathematics; Econometrics","score_opus":0.7505569186862165,"score_gpt":0.6029601374272204,"score_spread":0.1475967812589961,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052567024","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013449521,0.0012892657,0.98045105,0.00073794374,0.0002665622,0.0017484695,0.0005220608,0.00037821545,0.0011568983],"genre_scores_gemma":[0.23188546,0.0014232802,0.76051503,0.0006034064,0.00029046254,0.0032461402,0.001129962,0.00013335797,0.0007728262],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8568908,0.13051654,0.0031465457,0.0043555005,0.0046053994,0.0004852359],"domain_scores_gemma":[0.8617817,0.101223,0.010020178,0.022330243,0.003583957,0.0010609328],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11793492,0.0012689318,0.0025489489,0.0065897065,0.0008403763,0.0025513358,0.0020115871,0.0015055721,0.003739397],"category_scores_gemma":[0.21283753,0.0008797659,0.0030862745,0.011334265,0.0013111477,0.0022668464,0.0044352617,0.0023033668,0.0006858302],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024342632,0.0009505604,0.15381618,0.0024143986,0.018474802,0.0005647708,0.001177857,0.06416535,0.0014386411,0.09799723,0.012510141,0.64405584],"study_design_scores_gemma":[0.002754193,0.0030985458,0.09804085,0.0009167027,0.007038114,0.0010404966,0.0006788975,0.37238145,0.002636098,0.48273063,0.028314091,0.00037000113],"about_ca_topic_score_codex":0.0035297945,"about_ca_topic_score_gemma":0.0032670954,"teacher_disagreement_score":0.11793492,"about_ca_system_score_codex":0.0011312142,"about_ca_system_score_gemma":0.0034806146,"threshold_uncertainty_score":0.62370694},"labels":[],"label_agreement":null},{"id":"W2052946410","doi":"10.1007/s10654-009-9341-z","title":"The impact of unmeasured baseline effect modification on estimates from an inverse probability of treatment weighted logistic model","year":2009,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Logistic regression; Marginal structural model; Statistics; Confounding; Inverse probability; Medicine; Econometrics; Marginal model; Conditional probability; Outcome (game theory); Inverse; Mathematics; Regression analysis; Posterior probability","score_opus":0.3754827724468073,"score_gpt":0.4844572698861677,"score_spread":0.10897449743936044,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052946410","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08228906,0.0030967253,0.90711594,0.0034465843,0.00030905046,0.00026082277,0.0006752256,0.0007282199,0.0020784107],"genre_scores_gemma":[0.7612572,0.001538611,0.23171,0.0014219963,0.00033564924,0.00043551842,0.0006946276,0.00039068967,0.0022157053],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.81731796,0.16032143,0.0050559943,0.009116082,0.006737884,0.0014506356],"domain_scores_gemma":[0.23005322,0.7306283,0.007803061,0.027668977,0.0033882656,0.0004581036],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1909507,0.0016257641,0.003601371,0.001570864,0.0007002412,0.0041595963,0.0043045026,0.00415149,0.0036574686],"category_scores_gemma":[0.5782426,0.0017246519,0.004130236,0.0031809562,0.0040334105,0.0053544333,0.0031781208,0.007165801,0.00046338077],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014458227,0.00085995544,0.10393538,0.0041748383,0.020665595,0.0024775423,0.0026514083,0.26575696,0.004880611,0.21430005,0.0059547983,0.3598847],"study_design_scores_gemma":[0.0019397532,0.0018626204,0.03218086,0.00058780843,0.012312694,0.0014624769,0.0002783963,0.68279874,0.0058452454,0.25524247,0.0051890314,0.00029994242],"about_ca_topic_score_codex":0.0054253424,"about_ca_topic_score_gemma":0.0031634863,"teacher_disagreement_score":0.1909507,"about_ca_system_score_codex":0.0012695863,"about_ca_system_score_gemma":0.0021999434,"threshold_uncertainty_score":0.9977018},"labels":[],"label_agreement":null},{"id":"W2053148876","doi":"10.1007/s10464-013-9604-4","title":"Drawing Causal Inferences Using Propensity Scores: A Practical Guide for Community Psychologists","year":2013,"lang":"en","type":"article","venue":"American Journal of Community Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":114,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Drug Policy Research Network; St. Michael's Hospital","funders":"National Institute on Drug Abuse","keywords":"Propensity score matching; Causal inference; Observational study; Confounding; Psychology; Context (archaeology); Matching (statistics); Population; Reading (process); Developmental psychology; Medicine","score_opus":0.4407666304698102,"score_gpt":0.5491168697343298,"score_spread":0.10835023926451964,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2053148876","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00032109392,0.00036370623,0.9875683,0.0029336552,0.00023953398,0.0013903753,0.0012371622,0.0040843408,0.0018616937],"genre_scores_gemma":[0.0018134679,0.00038269645,0.99253464,0.0004212832,0.00014940486,0.0029350067,0.0003769372,0.0005428965,0.00084363774],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9519107,0.03915287,0.0041822535,0.0014301927,0.0030554049,0.00026857923],"domain_scores_gemma":[0.66234004,0.30136135,0.0059543406,0.015874533,0.012636957,0.0018328237],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10862357,0.0034964918,0.0041514845,0.010713171,0.0020237428,0.00542559,0.006080582,0.004206646,0.0470806],"category_scores_gemma":[0.24661055,0.004490147,0.0036255352,0.008732612,0.0041806456,0.0065269102,0.005577626,0.014126166,0.015425356],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022879966,0.0007087264,0.0025988496,0.0026015264,0.0008883947,0.00073900766,0.0045083864,0.016625267,0.0014035382,0.17701143,0.35212237,0.4405637],"study_design_scores_gemma":[0.0005943169,0.00018865119,0.0017337307,0.0017053068,0.00021091152,0.00068871916,0.0021215267,0.06709258,0.0011032681,0.5911639,0.33306795,0.0003290816],"about_ca_topic_score_codex":0.0057813893,"about_ca_topic_score_gemma":0.009283293,"teacher_disagreement_score":0.10862357,"about_ca_system_score_codex":0.002151798,"about_ca_system_score_gemma":0.0092386585,"threshold_uncertainty_score":0.57446325},"labels":[],"label_agreement":null},{"id":"W2053903767","doi":"10.1016/j.jclinepi.2006.07.016","title":"Simulations showed that validation of database-derived diagnostic criteria based on a small subsample reduced bias","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Arthritis Research Centre of Canada; McGill University Health Centre; Montreal General Hospital; University of British Columbia; McGill University","funders":"","keywords":"Statistics; Database; Medicine; Computer science; Mathematics","score_opus":0.7902486332320969,"score_gpt":0.6113332320112396,"score_spread":0.17891540122085736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2053903767","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40318182,0.0009277287,0.5848454,0.003238008,0.00045186124,0.0011530827,0.0020775073,0.0005116568,0.003612989],"genre_scores_gemma":[0.9190842,0.0001328894,0.07815414,0.0008355831,0.00005014144,0.00038431195,0.00077486027,0.000045950583,0.0005380007],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97116494,0.022406181,0.0014534827,0.002745899,0.00160894,0.00062048325],"domain_scores_gemma":[0.5243886,0.4445658,0.004411484,0.017849388,0.0076131704,0.0011716657],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08861096,0.0009062846,0.0023169387,0.0011845598,0.0009132526,0.0027635347,0.002143139,0.0032643853,0.0036965741],"category_scores_gemma":[0.37133425,0.0005439672,0.0017406564,0.0008880088,0.0014356074,0.0020686788,0.0016921164,0.002673802,0.0005929405],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011668813,0.0016365771,0.14209577,0.0011478348,0.0031828946,0.0011648642,0.0014222233,0.5510532,0.0049610105,0.10458094,0.009992582,0.16709322],"study_design_scores_gemma":[0.0022592247,0.0011367926,0.0137272775,0.00016671205,0.001131675,0.00074171775,0.0002157252,0.8880888,0.00410069,0.08598425,0.0023603942,0.00008670413],"about_ca_topic_score_codex":0.008127868,"about_ca_topic_score_gemma":0.0046416014,"teacher_disagreement_score":0.91138905,"about_ca_system_score_codex":0.0015333892,"about_ca_system_score_gemma":0.003456132,"threshold_uncertainty_score":0.4686252},"labels":[],"label_agreement":null},{"id":"W2054723033","doi":"10.2202/1557-4679.1146","title":"Type I Error Rates, Coverage of Confidence Intervals, and Variance Estimation in Propensity-Score Matched Analyses","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":189,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Confidence interval; Matching (statistics); Sample size determination; Observational study; Hazard ratio; Poisson regression; Type I and type II errors; Mathematics; Selection bias; Poisson distribution; Econometrics; Medicine; Population","score_opus":0.23169680834955775,"score_gpt":0.46242425669277515,"score_spread":0.2307274483432174,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2054723033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0052441065,0.0044810395,0.9867426,0.0008945862,0.00024909517,0.00047202318,0.0003055808,0.00023315655,0.0013777409],"genre_scores_gemma":[0.29661176,0.0060852175,0.6869287,0.0013255121,0.0010812387,0.005370577,0.0011197515,0.00040716465,0.0010702069],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.6799797,0.26440543,0.016456863,0.017397465,0.020204082,0.0015565029],"domain_scores_gemma":[0.19884063,0.7287346,0.03428483,0.026753936,0.01088512,0.00050084066],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27885512,0.0023112427,0.004143573,0.0075397408,0.001485885,0.004678737,0.005224054,0.0055937828,0.0035350027],"category_scores_gemma":[0.7340432,0.0016432436,0.0048892577,0.008723359,0.0062710135,0.005747603,0.0049688537,0.006971731,0.0006051914],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010232007,0.00030270024,0.06469521,0.0060871798,0.005972852,0.0013285363,0.0031087517,0.1631899,0.0012244701,0.44423738,0.010575034,0.2982547],"study_design_scores_gemma":[0.00032693593,0.00042555292,0.014341702,0.0025950603,0.0022136122,0.001020498,0.00045832281,0.3275161,0.0033883885,0.6320861,0.015382019,0.00024569387],"about_ca_topic_score_codex":0.0044321236,"about_ca_topic_score_gemma":0.0019413539,"teacher_disagreement_score":0.7211449,"about_ca_system_score_codex":0.002807183,"about_ca_system_score_gemma":0.0051946584,"threshold_uncertainty_score":0.88930005},"labels":[],"label_agreement":null},{"id":"W2054826081","doi":"10.1002/sim.3036","title":"Use of instrumental variables in the analysis of generalized linear models in the presence of unmeasured confounding with applications to epidemiological research","year":2007,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":72,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; University of Toronto; St. Paul's Hospital; University of British Columbia","funders":"Canadian Institutes of Health Research; Michael Smith Health Research BC","keywords":"Confounding; Generalized linear model; Instrumental variable; Epidemiology; Poisson distribution; Econometrics; Poisson regression; Linear model; Statistics; Logistic regression; Medicine; Computer science; Mathematics; Population; Environmental health; Internal medicine","score_opus":0.4857623800456914,"score_gpt":0.5493356677123323,"score_spread":0.06357328766664094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2054826081","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001464764,0.0007901925,0.996307,0.0006847647,0.00007771339,0.00003446712,0.000050335657,0.00008533543,0.00050542643],"genre_scores_gemma":[0.13855723,0.004330619,0.8519346,0.00077839143,0.0006756864,0.0008804359,0.00021341903,0.00016454668,0.0024650376],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96728045,0.028230477,0.0006778575,0.0012428911,0.0021634852,0.0004047919],"domain_scores_gemma":[0.8836389,0.10477941,0.0045388825,0.005167772,0.0015495629,0.00032545766],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.032968163,0.0018509483,0.0027181827,0.0033160297,0.0009385675,0.0024055543,0.0033833107,0.0026236635,0.0029663383],"category_scores_gemma":[0.11961974,0.001051728,0.0029773316,0.005087154,0.0042048227,0.002869256,0.004063635,0.0053109056,0.0005080233],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000631717,0.000047238667,0.0030051963,0.00035888734,0.000667702,0.00047771513,0.00037955798,0.07703005,0.00037016932,0.8695071,0.0016334365,0.046459645],"study_design_scores_gemma":[0.00006735956,0.000068988316,0.0006670454,0.0001454793,0.00014729584,0.00013456611,0.00006245385,0.2129383,0.00038351983,0.7794422,0.0058880732,0.000054804208],"about_ca_topic_score_codex":0.0040628784,"about_ca_topic_score_gemma":0.0030921118,"teacher_disagreement_score":0.032968163,"about_ca_system_score_codex":0.001514958,"about_ca_system_score_gemma":0.0038841257,"threshold_uncertainty_score":0.17435437},"labels":[],"label_agreement":null},{"id":"W2054829060","doi":"10.2202/1557-4679.1205","title":"Cutting Feedback in Bayesian Regression Adjustment for the Propensity Score","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Bayesian probability; Outcome (game theory); Bayesian linear regression; Statistics; Regression; Econometrics; Bayes' theorem; Confounding; Regression analysis; Posterior probability; Mathematics; Bayesian inference; Computer science","score_opus":0.1513029616466612,"score_gpt":0.41370864719192163,"score_spread":0.26240568554526045,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2054829060","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014185753,0.00020420365,0.9973737,0.000307983,0.00003043895,0.000034776363,0.000022506476,0.00014547948,0.00046233373],"genre_scores_gemma":[0.12666117,0.0008134567,0.86700237,0.0007323013,0.00024777153,0.00046196807,0.00012903877,0.00028810394,0.0036637667],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.976103,0.017796306,0.0005350171,0.001687865,0.0033118727,0.00056591176],"domain_scores_gemma":[0.9611466,0.03235106,0.0019183517,0.0026123628,0.0016921405,0.0002794004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026536591,0.0010208426,0.0018403272,0.0018118713,0.0010151081,0.0016819366,0.002475014,0.0018651542,0.004949836],"category_scores_gemma":[0.107863516,0.0012178818,0.0016692955,0.0022321767,0.0022317998,0.0031733252,0.0030143776,0.0041376287,0.0011186523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026589676,0.00010087294,0.0028843367,0.00027277818,0.00034028065,0.00016366331,0.0005637614,0.12262138,0.001498988,0.55034393,0.005064047,0.31588],"study_design_scores_gemma":[0.0001263694,0.000084613835,0.0010730192,0.00008241448,0.00008703201,0.00010624182,0.000031557447,0.51690173,0.0011569439,0.4724357,0.007849329,0.00006511816],"about_ca_topic_score_codex":0.006390815,"about_ca_topic_score_gemma":0.005764041,"teacher_disagreement_score":0.026536591,"about_ca_system_score_codex":0.00182357,"about_ca_system_score_gemma":0.0025326419,"threshold_uncertainty_score":0.14034063},"labels":[],"label_agreement":null},{"id":"W2055216855","doi":"10.1016/j.jclinepi.2013.05.003","title":"The exposure-crossover design is a new method for studying sustained changes in recurrent events","year":2013,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences; Health Sciences Centre","funders":"","keywords":"Confounding; Crossover; Crossover study; Confidence interval; Research design; Matching (statistics); Statistical power; Relative risk; Clinical study design; Statistics; Causal inference; Medicine; Psychology; Computer science; Mathematics; Artificial intelligence; Clinical trial; Internal medicine","score_opus":0.7022817653295406,"score_gpt":0.6384360823110963,"score_spread":0.06384568301844429,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2055216855","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020174371,0.0012533531,0.97438395,0.00074454816,0.0006711102,0.0010830566,0.0006724755,0.00028538972,0.0007318173],"genre_scores_gemma":[0.33552235,0.0020111743,0.6379041,0.001986328,0.001204392,0.013308978,0.0012651724,0.00019974854,0.006597737],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.89423543,0.09232254,0.0018832668,0.008094336,0.002813906,0.000650553],"domain_scores_gemma":[0.80947286,0.1597264,0.0061355396,0.02183479,0.0016014843,0.0012288862],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10179208,0.0018539442,0.004916854,0.0024993417,0.0012914219,0.0016592289,0.004327153,0.0046437476,0.011723091],"category_scores_gemma":[0.13804069,0.0013673987,0.0047491756,0.0023408963,0.0029473999,0.002876352,0.0027887975,0.0049754237,0.00079684606],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.04642481,0.003858621,0.050425913,0.0045298473,0.020579753,0.0016393415,0.0025912274,0.0343623,0.009434623,0.4397318,0.009373659,0.3770481],"study_design_scores_gemma":[0.038190145,0.0254985,0.021413604,0.0008107192,0.011129709,0.0022925283,0.0005270588,0.20836937,0.0041898163,0.6607985,0.026265055,0.0005149718],"about_ca_topic_score_codex":0.0014655684,"about_ca_topic_score_gemma":0.0009005371,"teacher_disagreement_score":0.8982079,"about_ca_system_score_codex":0.0008031122,"about_ca_system_score_gemma":0.0021538055,"threshold_uncertainty_score":0.5383344},"labels":[],"label_agreement":null},{"id":"W2055588546","doi":"10.2202/1557-4679.1240","title":"Special Issue on Causal Inference","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Biostatistics; Inference; Computer science; Library science; Econometrics; Data science; Management science; Mathematics; Engineering; Medicine; Artificial intelligence; Public health","score_opus":0.07737566703058796,"score_gpt":0.4291898214705514,"score_spread":0.35181415443996344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2055588546","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00008727104,0.016625071,0.0022531336,0.033489514,0.9413385,0.000059404123,0.00035589893,0.00016135568,0.0056298883],"genre_scores_gemma":[0.0005545886,0.0066117966,0.0006086984,0.009102243,0.97406805,0.000070772345,0.00020950385,0.00013704906,0.008637333],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9921745,0.0018353362,0.0011273725,0.0015169651,0.002864813,0.00048106955],"domain_scores_gemma":[0.9422838,0.034613848,0.003326264,0.0033946158,0.0117289405,0.004652549],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010176586,0.0028715339,0.0044758446,0.0067593483,0.002354955,0.0072211623,0.0029775342,0.008857664,0.06821808],"category_scores_gemma":[0.047069535,0.0011212352,0.0032258693,0.0030615197,0.0025533317,0.004492968,0.00272718,0.011437286,0.0243401],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003128047,0.000020701702,0.000089211964,0.00037160734,0.00003841719,0.00008960171,0.000019970035,0.00008244685,0.00010773781,0.0024674227,0.98086965,0.015811985],"study_design_scores_gemma":[0.0000334536,0.00004457021,0.0004852819,0.000452836,0.00005505996,0.000366469,0.00002594994,0.00027145282,0.00009377464,0.009284961,0.98886466,0.000021609429],"about_ca_topic_score_codex":0.0011372676,"about_ca_topic_score_gemma":0.0016057441,"teacher_disagreement_score":0.06821808,"about_ca_system_score_codex":0.003035172,"about_ca_system_score_gemma":0.003972249,"threshold_uncertainty_score":0.22821224},"labels":[],"label_agreement":null},{"id":"W2055787965","doi":"10.3138/cpp.34.3.321","title":"The Employment Impacts of Active Labour Market Policy: The Case of SSP Plus","year":2008,"lang":"fr","type":"article","venue":"Canadian Public Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Carleton University","funders":"","keywords":"Humanities; Political science; Art","score_opus":0.08530499071836906,"score_gpt":0.3722538840639553,"score_spread":0.28694889334558626,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2055787965","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8942006,0.0013636886,0.0021505393,0.011878819,0.0001016009,0.00007154892,0.00039699665,0.000028278711,0.08980784],"genre_scores_gemma":[0.98823315,0.0005724902,0.000214026,0.0005012452,0.00005071042,0.000029692854,0.000072803676,0.0000061555743,0.010319764],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99746656,0.0009846785,0.00006648419,0.0001723201,0.00036172534,0.00094829046],"domain_scores_gemma":[0.9940936,0.0030650955,0.0006927575,0.00028299,0.00072284526,0.0011426575],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00275539,0.0002811835,0.0005720014,0.00074379786,0.0023549576,0.0038899323,0.0013182241,0.0020099739,0.019111834],"category_scores_gemma":[0.0077922954,0.0001645522,0.00043704666,0.001284661,0.0021834488,0.0017577711,0.0039937496,0.0022157812,0.0009703716],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035825148,0.0020614464,0.1197809,0.0009837805,0.0003858283,0.005868948,0.019471709,0.06274009,0.0037990222,0.6380607,0.016079983,0.12718515],"study_design_scores_gemma":[0.00119998,0.0026887085,0.22710733,0.0013757674,0.0006582859,0.0008575878,0.15895312,0.056179862,0.0048620612,0.3215003,0.22439596,0.00022109076],"about_ca_topic_score_codex":0.04756267,"about_ca_topic_score_gemma":0.058291852,"teacher_disagreement_score":0.95243734,"about_ca_system_score_codex":0.004521307,"about_ca_system_score_gemma":0.004505139,"threshold_uncertainty_score":0.09457165},"labels":[],"label_agreement":null},{"id":"W2056327417","doi":"10.1007/s10928-012-9285-x","title":"Compliance spectrum as a drug fingerprint of drug intake and drug disposition","year":2012,"lang":"en","type":"article","venue":"Journal of Pharmacokinetics and Pharmacodynamics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University Health Centre; Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds Québécois de la Recherche sur la Nature et les Technologies; World Health Organization","keywords":"Drug; Disposition; Computer science; Population; Bayesian probability; Compliance (psychology); Quality (philosophy); Risk analysis (engineering); Medicine; Econometrics; Pharmacology; Artificial intelligence; Mathematics; Psychology; Social psychology","score_opus":0.060639695914000286,"score_gpt":0.39738881001022913,"score_spread":0.3367491140962289,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056327417","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4016601,0.00041559804,0.5936639,0.00068590656,0.000024791192,0.00006331293,0.0006259131,0.000403932,0.002456526],"genre_scores_gemma":[0.9754258,0.00011979681,0.023546811,0.000052929994,0.000033201493,0.000026181116,0.000161612,0.000023023546,0.00061058823],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99807334,0.0011037111,0.000095880736,0.0003489265,0.0002885083,0.00008963212],"domain_scores_gemma":[0.9680454,0.025369076,0.0030033262,0.0025257352,0.0006694132,0.00038711875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004102198,0.0003691778,0.0007350445,0.001763373,0.00032679946,0.0010093523,0.00064848975,0.0007368823,0.00259606],"category_scores_gemma":[0.024705293,0.00040046405,0.00077189173,0.0009767648,0.00090458244,0.00176327,0.0007800448,0.0011843285,0.00015052765],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019320138,0.0010201057,0.3154155,0.0002946482,0.0011380308,0.0012669477,0.0008584979,0.1948822,0.017898753,0.24823742,0.0021013163,0.21495467],"study_design_scores_gemma":[0.00005517477,0.0003654052,0.062155325,0.000028642839,0.00018059394,0.0007815502,0.00011570451,0.7730611,0.002967801,0.15937006,0.0008596843,0.000059018923],"about_ca_topic_score_codex":0.0016242315,"about_ca_topic_score_gemma":0.00090720213,"teacher_disagreement_score":0.004102198,"about_ca_system_score_codex":0.00037150088,"about_ca_system_score_gemma":0.00055290776,"threshold_uncertainty_score":0.02169478},"labels":[],"label_agreement":null},{"id":"W2056621649","doi":"10.1214/10-sts321","title":"Identification, Inference and Sensitivity Analysis for Causal Mediation Effects","year":2010,"lang":"en","type":"article","venue":"Statistical Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1558,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; University of Wisconsin-Madison; University of Pennsylvania; Harvard University; National Science Foundation","keywords":"Causal inference; Estimator; Robustness (evolution); Identification (biology); Sensitivity (control systems); Randomized experiment; Inference; Causal model; Parametric statistics","score_opus":0.05207382361030993,"score_gpt":0.4371451219746848,"score_spread":0.38507129836437487,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056621649","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008993672,0.00089362945,0.9843215,0.0010868497,0.000108856075,0.00081599137,0.00021556464,0.00016110885,0.0034029013],"genre_scores_gemma":[0.49501795,0.0018066578,0.49221358,0.001310742,0.0003164785,0.007036163,0.00032903175,0.00013240986,0.0018369391],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.81093514,0.17198369,0.0030703836,0.0060669454,0.0067183916,0.001225491],"domain_scores_gemma":[0.3751533,0.5904462,0.009655176,0.020315966,0.0040000454,0.00042935018],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18517108,0.0021291634,0.0041336953,0.0057519944,0.0021707069,0.0033838798,0.003480107,0.0040988857,0.007821467],"category_scores_gemma":[0.47418568,0.0013427153,0.0058378954,0.0038913556,0.006409148,0.0068610706,0.0074822805,0.007115659,0.000420116],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045763233,0.00025576094,0.005671546,0.0016425176,0.0020606176,0.00059545087,0.00096143247,0.11072028,0.000849895,0.8128421,0.0018318933,0.062111],"study_design_scores_gemma":[0.00014928893,0.00020551166,0.0015733498,0.00026839532,0.0005821406,0.00024481385,0.00025536635,0.19189237,0.0012695969,0.80053854,0.002939982,0.00008069586],"about_ca_topic_score_codex":0.0020682684,"about_ca_topic_score_gemma":0.0010371889,"teacher_disagreement_score":0.18517108,"about_ca_system_score_codex":0.0037885462,"about_ca_system_score_gemma":0.0037098953,"threshold_uncertainty_score":0.97929},"labels":[],"label_agreement":null},{"id":"W2057800162","doi":"10.1515/em-2013-0017","title":"On the Impact of Misclassification in an Ordinal Exposure Variable","year":2014,"lang":"en","type":"article","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Statistics; Variable (mathematics); Ordinal data; Variables; Ordinal regression; Econometrics; Linear regression; Outcome (game theory); Mathematics; Regression analysis; Test (biology); Power (physics); Psychology; Mathematical economics","score_opus":0.49120425733089457,"score_gpt":0.5830706497350668,"score_spread":0.09186639240417227,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2057800162","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27285117,0.010571654,0.65332204,0.034778044,0.0021394815,0.0004918459,0.0014723644,0.00047944486,0.023893978],"genre_scores_gemma":[0.95564526,0.0013213949,0.036147363,0.0026595136,0.00081693515,0.00025839996,0.00032148242,0.00012838314,0.0027013342],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.846402,0.1290426,0.004664284,0.007854424,0.010331292,0.0017054704],"domain_scores_gemma":[0.14717928,0.8083862,0.016380798,0.022753268,0.004639438,0.00066105963],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1530742,0.0006691811,0.0014600634,0.0020649934,0.0012282751,0.0033475792,0.00224741,0.00256539,0.0073655047],"category_scores_gemma":[0.60897213,0.0005056493,0.0014887084,0.0025769167,0.0058991387,0.004988325,0.0039062724,0.005213098,0.00062853174],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036755402,0.00034639903,0.21646942,0.0016447285,0.0030265555,0.0024102782,0.0041478565,0.09341063,0.0012799914,0.38856155,0.012920589,0.27210653],"study_design_scores_gemma":[0.0003288549,0.00087384623,0.08189614,0.0018586711,0.0030834018,0.0018778574,0.0015594783,0.2560421,0.004501737,0.6350808,0.0126707,0.00022640644],"about_ca_topic_score_codex":0.0034878068,"about_ca_topic_score_gemma":0.0018388097,"teacher_disagreement_score":0.8469258,"about_ca_system_score_codex":0.001741244,"about_ca_system_score_gemma":0.0013496721,"threshold_uncertainty_score":0.80954343},"labels":[],"label_agreement":null},{"id":"W2058108606","doi":"10.1007/s11135-011-9452-y","title":"Reporting missing data: a study of selected articles published from 2003–2007","year":2011,"lang":"en","type":"article","venue":"Quality & Quantity","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Missing data; Empirical research; Consistency (knowledge bases); Set (abstract data type); Psychology; Medicine; Computer science; Statistics; Mathematics; Artificial intelligence","score_opus":0.7002650406185921,"score_gpt":0.5250751842288542,"score_spread":0.17518985638973783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2058108606","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.100757405,0.8239402,0.0024547605,0.0049900534,0.0011018536,0.000928813,0.060199343,0.00007015707,0.0055574337],"genre_scores_gemma":[0.54513717,0.3996296,0.009826645,0.005717141,0.0022526402,0.0027062981,0.03247834,0.00025572182,0.0019963984],"study_design_codex":"systematic_review","study_design_gemma":"observational","domain_scores_codex":[0.9050427,0.02665639,0.04510281,0.005056901,0.016530653,0.001610611],"domain_scores_gemma":[0.29345843,0.5567063,0.099970624,0.011703367,0.03623461,0.0019266215],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06455773,0.000960449,0.0038618133,0.060189765,0.0013175174,0.0064201225,0.0025337106,0.0031362874,0.005266697],"category_scores_gemma":[0.4087529,0.0012805357,0.005685624,0.07992793,0.0019814728,0.0045427615,0.0021973825,0.0013479962,0.00084937795],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0060904236,0.00026973564,0.20813106,0.47460127,0.051909897,0.0033277823,0.01566702,0.0006464435,0.0011728308,0.002658846,0.038677238,0.1968475],"study_design_scores_gemma":[0.0016549588,0.0008073367,0.3638805,0.30591542,0.10974227,0.005534728,0.014275546,0.0004108552,0.002522284,0.0031722933,0.19174753,0.000336292],"about_ca_topic_score_codex":0.0072436673,"about_ca_topic_score_gemma":0.01274343,"teacher_disagreement_score":0.93544227,"about_ca_system_score_codex":0.003696894,"about_ca_system_score_gemma":0.014304601,"threshold_uncertainty_score":0.34141797},"labels":[],"label_agreement":null},{"id":"W2058823385","doi":"10.1002/pds.1360","title":"Application of lag‐time into exposure definitions to control for protopathic bias","year":2007,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":174,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Hôtel-Dieu de Montréal; Montreal General Hospital; Hotel Dieu Hospital","funders":"","keywords":"Quartile; Medicine; Lag; Logistic regression; Odds ratio; Distributed lag; Statistics; Lag time; Pharmacoepidemiology; Time lag; Confidence interval; Internal medicine; Mathematics; Computer science","score_opus":0.15843834965811754,"score_gpt":0.44706519676730516,"score_spread":0.2886268471091876,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2058823385","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07601325,0.005432567,0.9107293,0.0008661011,0.00083738065,0.002526434,0.001654075,0.0006358875,0.0013050496],"genre_scores_gemma":[0.4689857,0.0012988588,0.5177637,0.00069274346,0.00039516078,0.0077626924,0.0017531049,0.0002853006,0.0010627673],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82076925,0.13600543,0.01977894,0.0118557755,0.010376671,0.0012139196],"domain_scores_gemma":[0.6179044,0.28417093,0.043531403,0.041063696,0.012356837,0.0009727342],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14956768,0.0015098253,0.002236879,0.0032133167,0.0011108974,0.0023360236,0.0031672644,0.0026353449,0.0039815647],"category_scores_gemma":[0.29727694,0.00070585177,0.0056995507,0.0052554673,0.0019862622,0.0025875387,0.0026799033,0.0029949867,0.00044790385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009752247,0.0008148886,0.5392796,0.009647123,0.015724003,0.0007298466,0.004152903,0.031602677,0.009577316,0.034846183,0.0046659666,0.33920717],"study_design_scores_gemma":[0.0026117996,0.018348057,0.5611739,0.00631828,0.012684746,0.0022270642,0.0023310052,0.19339703,0.039501853,0.07710688,0.08339474,0.0009046916],"about_ca_topic_score_codex":0.0020969512,"about_ca_topic_score_gemma":0.0019740176,"teacher_disagreement_score":0.85043234,"about_ca_system_score_codex":0.001447814,"about_ca_system_score_gemma":0.0036269133,"threshold_uncertainty_score":0.79099894},"labels":[],"label_agreement":null},{"id":"W2059088090","doi":"10.5539/jmr.v4n4p40","title":"Index for Proportional Reduction in Error in Two-way Contingency Tables with Ordinal Categories","year":2012,"lang":"en","type":"article","venue":"Journal of Mathematics Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Contingency table; Mathematics; Measure (data warehouse); Statistics; Ordinal data; Variable (mathematics); Degree (music); Value (mathematics); Index (typography); Contingency; Data mining; Computer science","score_opus":0.3614183464519599,"score_gpt":0.5403584006621065,"score_spread":0.17894005421014658,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059088090","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030972755,0.00055712793,0.9588675,0.00045882913,0.00033562878,0.00066422124,0.0012029391,0.0010976909,0.005843291],"genre_scores_gemma":[0.38015807,0.0003298469,0.61377984,0.00029432625,0.00031646827,0.002123282,0.0013925201,0.00029034336,0.0013153374],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9580233,0.021165378,0.004733535,0.0038975803,0.011496892,0.0006832922],"domain_scores_gemma":[0.6925227,0.24278559,0.016299281,0.03128481,0.0152663095,0.0018413111],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036283586,0.0011065686,0.0013729824,0.005655957,0.0010966804,0.0025262558,0.0021890712,0.0013585829,0.0054696277],"category_scores_gemma":[0.19002534,0.0005169016,0.0014858136,0.004253385,0.003345561,0.004431337,0.0027137399,0.0033323017,0.00094280817],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023116842,0.0007186636,0.09332041,0.0019259352,0.0015962498,0.00077746314,0.0027472477,0.043396186,0.013302108,0.21166725,0.015461691,0.612775],"study_design_scores_gemma":[0.00047496593,0.0050860303,0.1263175,0.0009780006,0.00085988326,0.004681549,0.0019767934,0.30231944,0.032543797,0.47953904,0.044368878,0.0008541026],"about_ca_topic_score_codex":0.00041266257,"about_ca_topic_score_gemma":0.00045414077,"teacher_disagreement_score":0.036283586,"about_ca_system_score_codex":0.0014167569,"about_ca_system_score_gemma":0.0013574098,"threshold_uncertainty_score":0.19188821},"labels":[],"label_agreement":null},{"id":"W2060057132","doi":"10.5539/ijsp.v2n4p93","title":"Performance of Principal Stratification Method Adjusting for Treatment Noncompliance in Two Arms of a Randomized Trial","year":2013,"lang":"en","type":"article","venue":"International Journal of Statistics and Probability","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Covariate; Statistics; Mathematics; Econometrics; Robustness (evolution); Stratification (seeds); Hazard ratio; Confidence interval","score_opus":0.14819206932506174,"score_gpt":0.4638851354841705,"score_spread":0.31569306615910875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2060057132","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.114109084,0.0052162455,0.869821,0.0019523499,0.0005722757,0.0025506278,0.0005901518,0.0019007924,0.0032874737],"genre_scores_gemma":[0.48305318,0.0008548738,0.5118513,0.0005615823,0.00018989915,0.0017397307,0.0005746751,0.00029272953,0.00088206463],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7897979,0.19328116,0.0043851133,0.0053905365,0.006285537,0.0008597331],"domain_scores_gemma":[0.5151802,0.43852898,0.012667568,0.02358889,0.008326178,0.0017081251],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19804843,0.0015914813,0.0054429416,0.0024111771,0.0011893638,0.0021087544,0.0023333458,0.0036797482,0.0035246308],"category_scores_gemma":[0.32503462,0.001025482,0.004143787,0.001956136,0.0021752382,0.0026554528,0.0029591294,0.0036393134,0.0007575347],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.045402657,0.00096582965,0.078019105,0.004249442,0.01343778,0.00071852165,0.0030255048,0.1808083,0.004808812,0.047298316,0.008237676,0.61302805],"study_design_scores_gemma":[0.0049215322,0.0059706387,0.013309838,0.0005685624,0.0030535797,0.0007717747,0.0002636312,0.91581637,0.0048811072,0.045482155,0.004629054,0.00033167668],"about_ca_topic_score_codex":0.002034912,"about_ca_topic_score_gemma":0.0008946907,"teacher_disagreement_score":0.19804843,"about_ca_system_score_codex":0.0011946389,"about_ca_system_score_gemma":0.00493105,"threshold_uncertainty_score":0.98894906},"labels":[],"label_agreement":null},{"id":"W2061078339","doi":"10.4212/cjhp.v67i5.1391","title":"An Introduction to the Fundamentals of Cohort and Case–Control Studies","year":2014,"lang":"en","type":"article","venue":"The Canadian Journal of Hospital Pharmacy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"Canadian Institutes of Health Research; Canadian Diabetes Association","keywords":"Observational study; Critical appraisal; Clinical study design; Randomized controlled trial; Cohort study; Medicine; Pharmacist; Control (management); Research design; Cohort; Family medicine; Psychology; Clinical trial; Alternative medicine; Computer science; Pharmacy; Artificial intelligence; Surgery; Pathology","score_opus":0.07284946037865118,"score_gpt":0.4074823582009747,"score_spread":0.3346328978223235,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061078339","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006750663,0.040664393,0.9289723,0.013237909,0.004564943,0.0016633823,0.001690078,0.00042897923,0.008102929],"genre_scores_gemma":[0.01843852,0.05035816,0.8933431,0.011308201,0.010931613,0.0098982835,0.0012173128,0.0002419165,0.0042628194],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.92856663,0.05788367,0.005039593,0.0033709682,0.004648146,0.0004910367],"domain_scores_gemma":[0.7128699,0.2636397,0.0067650164,0.010523301,0.005215039,0.0009871186],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09512796,0.0021722843,0.0026682308,0.0075144777,0.0014037798,0.004565594,0.005267839,0.005776597,0.011363262],"category_scores_gemma":[0.15767889,0.0016111034,0.0038860913,0.008326804,0.007690911,0.005336291,0.0031309072,0.009896446,0.004068893],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000092483715,0.00014458729,0.0033204874,0.0040196916,0.00038403066,0.00056419196,0.0007387966,0.002808103,0.0004143544,0.836157,0.04798974,0.1033665],"study_design_scores_gemma":[0.00011915324,0.00023821843,0.0022187242,0.0030182982,0.00016739227,0.0014546227,0.0001983721,0.007246292,0.00025516146,0.78456616,0.20039088,0.00012668093],"about_ca_topic_score_codex":0.0035081145,"about_ca_topic_score_gemma":0.002732436,"teacher_disagreement_score":0.90487206,"about_ca_system_score_codex":0.0027201418,"about_ca_system_score_gemma":0.004279893,"threshold_uncertainty_score":0.50309074},"labels":[],"label_agreement":null},{"id":"W2061407842","doi":"10.1002/sim.2618","title":"Conditioning on the propensity score can result in biased estimation of common measures of treatment effect: a Monte Carlo study","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":227,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Statistics; Covariate; Hazard ratio; Observational study; Mathematics; Econometrics; Confidence interval","score_opus":0.20389167045157128,"score_gpt":0.42466937770647534,"score_spread":0.22077770725490406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061407842","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13272342,0.0032676551,0.8559098,0.0030779766,0.00012438741,0.00071364007,0.00017974981,0.00018504335,0.0038183236],"genre_scores_gemma":[0.79145455,0.0022342294,0.20181584,0.0011636517,0.00022239605,0.001207999,0.0002587823,0.00013184424,0.0015107505],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9323142,0.060450494,0.0013897805,0.0025868067,0.0025566318,0.0007019682],"domain_scores_gemma":[0.38426343,0.57759416,0.011918635,0.020673998,0.0047915885,0.00075812824],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.108449146,0.0009352491,0.0021855845,0.001543988,0.0012448292,0.0023884326,0.0019820556,0.0023933414,0.0038905775],"category_scores_gemma":[0.35288936,0.0009293345,0.0025632775,0.0020616935,0.003917318,0.003463022,0.0022682585,0.003538779,0.00034756376],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016179839,0.0006440202,0.059713844,0.00070209196,0.0029265974,0.0008825893,0.0012868638,0.2971936,0.0011870158,0.5228561,0.0042911377,0.10669817],"study_design_scores_gemma":[0.00043698415,0.00041436183,0.0072761755,0.00038271348,0.000696883,0.0003848098,0.00013120931,0.72067034,0.0016239857,0.26372036,0.0041526444,0.00010952247],"about_ca_topic_score_codex":0.004296117,"about_ca_topic_score_gemma":0.0030238605,"teacher_disagreement_score":0.89155084,"about_ca_system_score_codex":0.00214579,"about_ca_system_score_gemma":0.0027180535,"threshold_uncertainty_score":0.57354075},"labels":[],"label_agreement":null},{"id":"W2061691003","doi":"10.1002/sim.3200","title":"Impact of mis‐specification of the treatment model on estimates from a marginal structural model","year":2008,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":66,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Estimator; Marginal structural model; Confounding; Inverse probability; Context (archaeology); Computer science; Econometrics; Specification; Mean squared error; Average treatment effect; Statistics; Sample size determination; Mathematics; Bayesian probability","score_opus":0.1925234186916368,"score_gpt":0.4631170529289025,"score_spread":0.2705936342372657,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2061691003","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11762835,0.0020413373,0.8726347,0.0031953866,0.00018292085,0.00050875644,0.0004943679,0.00051907235,0.0027950949],"genre_scores_gemma":[0.7427659,0.00069584174,0.2532707,0.0010068264,0.00008775815,0.00065707887,0.0006480678,0.00023831648,0.0006295453],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.82712185,0.15550418,0.0052026506,0.0045085126,0.006659472,0.0010032633],"domain_scores_gemma":[0.19498135,0.7673295,0.009984944,0.022648742,0.0045366175,0.0005188508],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1822475,0.0015455687,0.0030327775,0.0014421042,0.0012548789,0.003018476,0.0027956793,0.002747963,0.0033182339],"category_scores_gemma":[0.6028127,0.0015041226,0.002557628,0.0020957883,0.0032179644,0.0042158724,0.003305566,0.0051173284,0.0005364305],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029681935,0.0002305159,0.07197668,0.0016186078,0.0046192324,0.00082983664,0.0018891912,0.61772215,0.0014646042,0.14891237,0.0036711327,0.14409746],"study_design_scores_gemma":[0.00048007406,0.00057687174,0.011969246,0.0007540555,0.0008926656,0.0006114596,0.00041804468,0.7979594,0.0037121754,0.17895941,0.0034972262,0.00016929762],"about_ca_topic_score_codex":0.010335222,"about_ca_topic_score_gemma":0.0074810805,"teacher_disagreement_score":0.1822475,"about_ca_system_score_codex":0.0029952785,"about_ca_system_score_gemma":0.0038033396,"threshold_uncertainty_score":0.96382844},"labels":[],"label_agreement":null},{"id":"W2062040186","doi":"10.1002/jrsm.1056","title":"Issues relating to study design and risk of bias when including non‐randomized studies in systematic reviews on the effects of interventions","year":2012,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":187,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Population and Public Health; University of Ottawa","funders":"National Institutes of Health; National Institute for Health and Care Research; Scottish Government","keywords":"Randomized controlled trial; Psychological intervention; Systematic review; Randomized experiment; Research design; Clinical study design; Psychology; Computer science; MEDLINE; Management science; Medicine; Applied psychology; Clinical trial; Social science; Psychiatry; Sociology; Engineering","score_opus":0.8578401848948041,"score_gpt":0.6814907782416452,"score_spread":0.1763494066531589,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2062040186","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005466405,0.093066946,0.7699588,0.059828594,0.020352252,0.038535476,0.0013716555,0.0012972419,0.010122668],"genre_scores_gemma":[0.083662085,0.015461312,0.79066116,0.024311816,0.005742584,0.077443644,0.00038626438,0.00052254694,0.00180861],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.043247186,0.78857124,0.124008566,0.008471682,0.03463398,0.0010674124],"domain_scores_gemma":[0.02309063,0.8951322,0.036199592,0.03156824,0.013393135,0.0006162431],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.8740686,0.0069640367,0.020283876,0.024901656,0.007198039,0.020964574,0.015572846,0.025325295,0.006734153],"category_scores_gemma":[0.94473106,0.0065961145,0.02225484,0.034746762,0.03334202,0.03276982,0.014924117,0.025202664,0.0021673176],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0048020366,0.00032450524,0.011666991,0.16852602,0.021627959,0.0022080268,0.023097532,0.006205532,0.0010936349,0.33182982,0.039243292,0.38937458],"study_design_scores_gemma":[0.003405322,0.0011910131,0.0048381845,0.13256525,0.014366172,0.0027413815,0.0037735128,0.019776268,0.0036656389,0.7336728,0.07880071,0.0012037315],"about_ca_topic_score_codex":0.0028599452,"about_ca_topic_score_gemma":0.007048124,"teacher_disagreement_score":0.12593138,"about_ca_system_score_codex":0.016506039,"about_ca_system_score_gemma":0.01846929,"threshold_uncertainty_score":0.15529591},"labels":[],"label_agreement":null},{"id":"W2062834232","doi":"10.1097/ede.0b013e318162afb9","title":"Case-Crossover Designs Compared With Dynamic Follow-up Designs","year":2008,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Ministry of Health; University of Victoria","funders":"","keywords":"Crossover; Crossover study; Computer science; Medicine; Artificial intelligence","score_opus":0.4774975879361858,"score_gpt":0.45694392957968044,"score_spread":0.020553658356505355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2062834232","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08912908,0.029658461,0.59451604,0.003458566,0.019605774,0.24403651,0.004499259,0.001196066,0.013900237],"genre_scores_gemma":[0.21159108,0.005332183,0.42635262,0.003193685,0.0034193713,0.3439108,0.0012986944,0.00015592383,0.004745623],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.81244034,0.15299143,0.011762884,0.014336395,0.0071562137,0.0013128374],"domain_scores_gemma":[0.79380816,0.14310986,0.0186234,0.03400217,0.008831123,0.0016253652],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15457703,0.002668204,0.004154109,0.0031110144,0.0021444876,0.0021340845,0.0040938025,0.0039017755,0.018598644],"category_scores_gemma":[0.25844482,0.0016735563,0.0024155027,0.0035429194,0.0037747016,0.0037293541,0.003419526,0.0042113387,0.0019897304],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.16565317,0.014246216,0.035348278,0.028791584,0.02162743,0.0014599636,0.012468301,0.01064816,0.0038866438,0.30670246,0.022606738,0.37656105],"study_design_scores_gemma":[0.16372253,0.13974741,0.03710468,0.009824961,0.015792036,0.0017995653,0.003654282,0.033378866,0.008536218,0.39680275,0.18858637,0.0010503381],"about_ca_topic_score_codex":0.0015455788,"about_ca_topic_score_gemma":0.0015308071,"teacher_disagreement_score":0.845423,"about_ca_system_score_codex":0.0020574508,"about_ca_system_score_gemma":0.0021475211,"threshold_uncertainty_score":0.81749123},"labels":[],"label_agreement":null},{"id":"W2063548620","doi":"10.1016/j.jclinepi.2004.10.016","title":"Propensity score methods gave similar results to traditional regression modeling in observational studies: a systematic review","year":2005,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":497,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Propensity score matching; Observational study; Confounding; Medicine; Odds ratio; Statistics; Regression analysis; Hazard ratio; Confidence interval; Internal medicine; Mathematics","score_opus":0.9794651742196404,"score_gpt":0.7432106376404088,"score_spread":0.23625453657923157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063548620","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036343196,0.97684866,0.016924383,0.00056488736,0.00026806715,0.00059022283,0.00057163334,0.000087838554,0.0005100413],"genre_scores_gemma":[0.10612747,0.8625534,0.02733249,0.0014983811,0.00041841762,0.000944937,0.0006005228,0.00011367953,0.0004105956],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9458497,0.03603142,0.010213304,0.0032951112,0.0043031657,0.00030733857],"domain_scores_gemma":[0.7112432,0.26820025,0.00826977,0.0051586316,0.00680604,0.00032216337],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.07861588,0.0024956996,0.013125873,0.0057644104,0.0005051288,0.0027088663,0.0020887523,0.0024258604,0.004821931],"category_scores_gemma":[0.25019705,0.001669266,0.025005067,0.008211569,0.0012005977,0.0034064439,0.0015209573,0.0027947887,0.0005729907],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037754695,0.000078193625,0.007380491,0.35298336,0.22483952,0.00023849565,0.000265107,0.002646494,0.0003074433,0.0019970813,0.004173695,0.40131474],"study_design_scores_gemma":[0.0054570455,0.0017264013,0.01468176,0.06888321,0.8759802,0.00071487465,0.00018949539,0.002767567,0.00089097116,0.008738724,0.019819723,0.00015004035],"about_ca_topic_score_codex":0.0042793117,"about_ca_topic_score_gemma":0.007452198,"teacher_disagreement_score":0.9868741,"about_ca_system_score_codex":0.0018333121,"about_ca_system_score_gemma":0.0042241258,"threshold_uncertainty_score":0.41576546},"labels":[],"label_agreement":null},{"id":"W2063846874","doi":"10.1002/sim.3460","title":"Bayesian propensity score analysis for observational data","year":2008,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":117,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto; University of British Columbia; Simon Fraser University","funders":"","keywords":"Propensity score matching; Observational study; Statistics; Confounding; Confidence interval; Bayesian probability; Markov chain Monte Carlo; Credible interval; Econometrics; Odds ratio; Outcome (game theory); Medicine; Mathematics","score_opus":0.5909869107336676,"score_gpt":0.490360892353943,"score_spread":0.10062601837972462,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063846874","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015200055,0.00043512374,0.9970471,0.0002928573,0.000027095684,0.00011844811,0.000118972945,0.00017011349,0.00027022458],"genre_scores_gemma":[0.1478337,0.002442408,0.84404916,0.00049942214,0.00036135863,0.0020355864,0.0012676907,0.00021610393,0.0012944874],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95127076,0.040541932,0.0015169596,0.0024832103,0.003717237,0.0004698537],"domain_scores_gemma":[0.851211,0.12892343,0.007827906,0.007819886,0.003556833,0.0006609784],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06296529,0.0014678178,0.0032457197,0.0062193205,0.001218935,0.0028857575,0.0032141493,0.002833264,0.004752407],"category_scores_gemma":[0.22713225,0.0014069834,0.0024209493,0.006348886,0.0032413246,0.004603465,0.0039506406,0.004547124,0.001159238],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027162393,0.000119878736,0.011425284,0.0008230133,0.0011624537,0.0003174461,0.00049282593,0.1894581,0.0005250712,0.5808557,0.0059101786,0.20863853],"study_design_scores_gemma":[0.0001626168,0.0000731428,0.0020126218,0.00015633067,0.00012095112,0.00013319781,0.00004052274,0.42823339,0.00027642245,0.5637193,0.0050130263,0.00005853629],"about_ca_topic_score_codex":0.005453109,"about_ca_topic_score_gemma":0.0029534665,"teacher_disagreement_score":0.06296529,"about_ca_system_score_codex":0.0024328309,"about_ca_system_score_gemma":0.00484258,"threshold_uncertainty_score":0.33299625},"labels":[],"label_agreement":null},{"id":"W2064228679","doi":"10.1198/016214506000000258","title":"Statistical Inference for the Difference Between the Best Treatment Mean and a Control Mean","year":2006,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Confidence interval; Mathematics; Mean difference; Inference; Upper and lower bounds; Homogeneous; Statistics; Coverage probability; Mathematical optimization; Computer science; Artificial intelligence","score_opus":0.05773673034347347,"score_gpt":0.39316321320818587,"score_spread":0.3354264828647124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064228679","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013091587,0.0004045433,0.9834042,0.0006368412,0.000116274256,0.0003730271,0.0002603954,0.00036991885,0.0013431538],"genre_scores_gemma":[0.22593348,0.0005798918,0.76844335,0.0006782516,0.00026324336,0.0021083304,0.0007820521,0.00027720907,0.00093417114],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90005845,0.066975,0.00395654,0.013307443,0.014249726,0.0014528332],"domain_scores_gemma":[0.39678493,0.55674833,0.011079254,0.025794014,0.008570823,0.0010227489],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1392924,0.0021134987,0.0056612366,0.0070399228,0.0024647743,0.004131882,0.005152315,0.0045916643,0.008828734],"category_scores_gemma":[0.44965813,0.0012156032,0.0043775523,0.0052644094,0.008329328,0.00596095,0.0037724054,0.010086358,0.0011641202],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003154678,0.0010246605,0.018738125,0.0016273782,0.0029671967,0.00046324264,0.001339054,0.10736642,0.0056712744,0.4770005,0.008848201,0.37179935],"study_design_scores_gemma":[0.00078239053,0.0015917552,0.01282524,0.0006774701,0.0010192252,0.0005262868,0.00049514667,0.4681198,0.014205931,0.49190417,0.007618716,0.0002338352],"about_ca_topic_score_codex":0.002467597,"about_ca_topic_score_gemma":0.0017716282,"teacher_disagreement_score":0.1392924,"about_ca_system_score_codex":0.0032371583,"about_ca_system_score_gemma":0.0047480087,"threshold_uncertainty_score":0.73665744},"labels":[],"label_agreement":null},{"id":"W2064579426","doi":"10.1097/ccm.0b013e3181b785a2","title":"Ten reasons why we should NOT use severity scores as entry criteria for clinical trials or in our treatment decisions*","year":2009,"lang":"en","type":"review","venue":"Critical Care Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":133,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital","funders":"","keywords":"Medicine; Clinical trial; Intensive care medicine; Psychological intervention; Context (archaeology); Illness severity; MEDLINE; Severity of illness; Physical therapy; Internal medicine; Psychiatry","score_opus":0.8033210656543764,"score_gpt":0.6755904427212177,"score_spread":0.12773062293315873,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064579426","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00090907636,0.817968,0.0136299245,0.15880981,0.005637953,0.000713824,0.00030802513,0.00008684201,0.0019365074],"genre_scores_gemma":[0.057202715,0.6468753,0.112905346,0.16555172,0.009119828,0.005724764,0.000525799,0.00012908423,0.0019655076],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.75508195,0.18021768,0.034968596,0.0043831863,0.024143271,0.0012053131],"domain_scores_gemma":[0.49259552,0.43790808,0.03074317,0.009236608,0.02742754,0.002089098],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.30570406,0.0014757743,0.0035511067,0.0034826035,0.0009584237,0.0046883887,0.0044370247,0.0056342226,0.0023466428],"category_scores_gemma":[0.36484104,0.0012930748,0.0026660606,0.005806244,0.0071340934,0.0074482462,0.0025185319,0.010398667,0.0010125403],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019962501,0.00008945906,0.0028343147,0.07447227,0.0022368447,0.00015555568,0.0010324847,0.0011994247,0.0003785005,0.06483378,0.10599503,0.74477607],"study_design_scores_gemma":[0.0038158188,0.0007411979,0.0072035477,0.30861148,0.00611142,0.000912307,0.0016670482,0.006215552,0.0011477221,0.26906952,0.3941178,0.00038665425],"about_ca_topic_score_codex":0.0019849914,"about_ca_topic_score_gemma":0.004887096,"teacher_disagreement_score":0.69429594,"about_ca_system_score_codex":0.0060485625,"about_ca_system_score_gemma":0.015190326,"threshold_uncertainty_score":0.8561905},"labels":[],"label_agreement":null},{"id":"W2065171209","doi":"10.1016/j.jclinepi.2013.06.011","title":"Limitations of within-person study designs","year":2013,"lang":"en","type":"letter","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Population and Public Health","funders":"","keywords":"Censoring (clinical trials); Confounding; Context (archaeology); Scopus; Chen; Clinical study design; Psychology; Statistics; Research design; Econometrics; Assertion; Computer science; Medicine; MEDLINE; Mathematics; Clinical trial","score_opus":0.9047580115839973,"score_gpt":0.6154556940241707,"score_spread":0.2893023175598266,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065171209","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018487146,0.029083585,0.3089302,0.5543125,0.053570434,0.0049224803,0.0060195993,0.0007921693,0.023881905],"genre_scores_gemma":[0.23229079,0.012557191,0.28932628,0.39840558,0.039913934,0.018766416,0.0012326624,0.00052553025,0.0069816727],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.51901037,0.37787607,0.04575491,0.015937412,0.03968812,0.0017331686],"domain_scores_gemma":[0.13597879,0.8123595,0.0128631955,0.02071189,0.016223673,0.0018629055],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.41973177,0.0010985667,0.0041069775,0.0024858734,0.0024950018,0.0045306548,0.006107632,0.0074599837,0.008979622],"category_scores_gemma":[0.74024546,0.002010126,0.00320101,0.005083634,0.007105697,0.005800893,0.0037326226,0.014129485,0.002317651],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003253088,0.0005205435,0.048075806,0.009823445,0.0045659556,0.0028379378,0.0060275556,0.004148706,0.00055708044,0.14730506,0.39363688,0.37924787],"study_design_scores_gemma":[0.0031808396,0.0011336481,0.04021349,0.008622074,0.0035346558,0.011744901,0.0044297935,0.017816028,0.0018019832,0.5492313,0.35775414,0.00053719716],"about_ca_topic_score_codex":0.008717906,"about_ca_topic_score_gemma":0.015421952,"teacher_disagreement_score":0.58026826,"about_ca_system_score_codex":0.0039011622,"about_ca_system_score_gemma":0.0070029,"threshold_uncertainty_score":0.715574},"labels":[],"label_agreement":null},{"id":"W2065314067","doi":"10.1162/rest_a_00475","title":"Estimating and Testing Models with Many Treatment Levels and Limited Instruments","year":2014,"lang":"en","type":"article","venue":"The Review of Economics and Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Endogeneity; Instrumental variable; Econometrics; Estimator; Hausman test; Ordinary least squares; Test (biology); Statistical hypothesis testing; Value (mathematics); Statistics; Economics; Mathematics; Fixed effects model; Panel data","score_opus":0.2115334824506652,"score_gpt":0.3665306850046302,"score_spread":0.154997202553965,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065314067","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041932285,0.0025872802,0.94492155,0.0045426763,0.00024185028,0.0003104625,0.0007990411,0.0003261274,0.0043387385],"genre_scores_gemma":[0.48489025,0.00451433,0.4998,0.0021778191,0.0010757406,0.002666632,0.001543225,0.00014996578,0.0031821537],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9315435,0.055882238,0.002247809,0.005253341,0.0039576506,0.0011153554],"domain_scores_gemma":[0.66983896,0.2964067,0.012672826,0.01751268,0.0029324386,0.00063632283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.057088345,0.0015933401,0.0035083196,0.0024617573,0.001152061,0.004017173,0.004820856,0.0042194086,0.0070048533],"category_scores_gemma":[0.24657965,0.0013734965,0.0031033857,0.004771951,0.0043356703,0.0054232795,0.0034493085,0.005114251,0.0009854424],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042608107,0.00055836776,0.02784722,0.0012606835,0.0021618463,0.00053274154,0.0007860348,0.11315386,0.000491005,0.6646179,0.0046882755,0.18347597],"study_design_scores_gemma":[0.00029959314,0.0002497526,0.00420696,0.00028201716,0.00038944063,0.00013322463,0.00021818552,0.18043047,0.000730877,0.80703723,0.005953091,0.000069070826],"about_ca_topic_score_codex":0.0029922242,"about_ca_topic_score_gemma":0.002240546,"teacher_disagreement_score":0.057088345,"about_ca_system_score_codex":0.0022943234,"about_ca_system_score_gemma":0.0034108108,"threshold_uncertainty_score":0.30191565},"labels":[],"label_agreement":null},{"id":"W2065417422","doi":"10.1080/00273171.2011.540480","title":"A Tutorial and Case Study in Propensity Score Analysis: An Application to Estimating the Effect of In-Hospital Smoking Cessation Counseling on Mortality","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":421,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; U.S. Public Health Service; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Covariate; Medicine; Inverse probability weighting; Observational study; Matching (statistics); Statistics; Internal medicine; Mathematics","score_opus":0.49956942762470347,"score_gpt":0.5544291490721748,"score_spread":0.05485972144747131,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065417422","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008189544,0.0008730586,0.9917429,0.002588795,0.0002828768,0.00021931462,0.00018440704,0.00029442794,0.0029952922],"genre_scores_gemma":[0.014026163,0.0021552313,0.9776562,0.0008737294,0.0006053913,0.0012035826,0.00021352747,0.00015664836,0.0031095291],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9867932,0.010955217,0.00054772996,0.0005663426,0.0010084211,0.00012916834],"domain_scores_gemma":[0.95052826,0.04532723,0.00091285765,0.0017056583,0.0011387295,0.00038720472],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026334452,0.0018231301,0.0016063628,0.0029508194,0.0011791212,0.0020555065,0.0022791156,0.0036344375,0.015412812],"category_scores_gemma":[0.06575539,0.0009831543,0.0026285956,0.0036343858,0.0025689832,0.0037367549,0.0034599479,0.0055338107,0.0030062415],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016322729,0.0003867101,0.005960238,0.001001484,0.00035777903,0.002391269,0.0010855745,0.029151779,0.00076116365,0.5999829,0.07783631,0.28092158],"study_design_scores_gemma":[0.00018169377,0.00019564187,0.0016100876,0.00046582712,0.0001233946,0.0028569628,0.00025788747,0.15691513,0.0006518859,0.7326699,0.10394293,0.00012865278],"about_ca_topic_score_codex":0.0034266245,"about_ca_topic_score_gemma":0.0034823436,"teacher_disagreement_score":0.97366554,"about_ca_system_score_codex":0.0013051833,"about_ca_system_score_gemma":0.0021724228,"threshold_uncertainty_score":0.13927156},"labels":[],"label_agreement":null},{"id":"W2067158811","doi":"10.1097/ede.0b013e3181e00730","title":"Marginalia","year":2010,"lang":"fr","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute on Minority Health and Health Disparities","keywords":"Marginal structural model; Covariate; Inverse probability; Marginal distribution; Econometrics; Statistics; Inverse probability weighting; Mathematics; Confounding; Contrast (vision); Marginal model; Weighting; Computer science; Posterior probability; Propensity score matching; Regression analysis; Medicine; Bayesian probability; Artificial intelligence","score_opus":0.31837564892118636,"score_gpt":0.4717226469922707,"score_spread":0.15334699807108432,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2067158811","genre_codex":"other","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00582316,0.009395658,0.26894203,0.010492535,0.004530048,0.00060670933,0.007195922,0.0029823068,0.69003165],"genre_scores_gemma":[0.2309897,0.019986328,0.21040599,0.013055167,0.005377193,0.0026680033,0.017064225,0.0046374197,0.49581602],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9910357,0.0026350166,0.0007544716,0.0023348548,0.0022443836,0.0009955309],"domain_scores_gemma":[0.99297756,0.002014331,0.0005713177,0.0019999759,0.0021202606,0.0003166329],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005015307,0.0019002461,0.0015122591,0.003125951,0.0034591176,0.009243474,0.003632247,0.0026367689,0.1790444],"category_scores_gemma":[0.022951731,0.0008883783,0.0026096574,0.0034500186,0.00545562,0.010172505,0.0072542527,0.0043837996,0.08502839],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000062911495,0.000028170905,0.0006705324,0.00031628142,0.00004649898,0.00017893862,0.0006381725,0.0005165371,0.00022799718,0.8787679,0.058192287,0.06035377],"study_design_scores_gemma":[0.000016079122,0.000022450235,0.0003539911,0.0002720959,0.000030522446,0.0005774298,0.00026526354,0.0010883161,0.00037050608,0.3689464,0.6280313,0.00002568797],"about_ca_topic_score_codex":0.0041376036,"about_ca_topic_score_gemma":0.0032373786,"teacher_disagreement_score":0.1790444,"about_ca_system_score_codex":0.0037962443,"about_ca_system_score_gemma":0.0034981056,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2068432346","doi":"10.1016/j.socscimed.2012.10.013","title":"Some models just can't be fixed. A commentary on Mortensen","year":2012,"lang":"en","type":"letter","venue":"Social Science & Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canada Research Chairs","keywords":"Econometrics; Economics; Demography; Mathematical economics; Sociology","score_opus":0.2135639124965578,"score_gpt":0.4319060999376298,"score_spread":0.218342187441072,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068432346","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000034912064,0.001162395,0.00019729578,0.99331254,0.004717671,0.000002330946,0.00002850875,0.000008620508,0.0005356674],"genre_scores_gemma":[0.0014288464,0.00070828944,0.00029521252,0.9830875,0.013102713,0.00002304349,0.0000131401075,0.000021605325,0.0013197854],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9718698,0.014227206,0.0019462693,0.0042782724,0.0061843353,0.0014940308],"domain_scores_gemma":[0.7997158,0.18386674,0.003093428,0.0036758373,0.0070654266,0.002582728],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040679533,0.001946294,0.004544405,0.0015296711,0.0074590826,0.008558485,0.008210982,0.09507124,0.009352351],"category_scores_gemma":[0.178128,0.0021028714,0.004141159,0.0016765855,0.029179083,0.02459716,0.004895447,0.15606199,0.006165087],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039719685,0.00001104934,0.00007895436,0.000102628655,0.000032024294,0.00019362177,0.00032457165,0.0000925683,0.000031674783,0.04131368,0.95337856,0.004400944],"study_design_scores_gemma":[0.00021115865,0.00004466749,0.000466589,0.0010816758,0.00008130735,0.00060179725,0.0008479146,0.00079190347,0.00024788768,0.28623274,0.7092289,0.0001634804],"about_ca_topic_score_codex":0.0165164,"about_ca_topic_score_gemma":0.025422947,"teacher_disagreement_score":0.09507124,"about_ca_system_score_codex":0.008415882,"about_ca_system_score_gemma":0.009453068,"threshold_uncertainty_score":0.21513647},"labels":[],"label_agreement":null},{"id":"W2068564314","doi":"10.1007/s10742-014-0124-y","title":"A data-adaptive strategy for inverse weighted estimation of causal effects","year":2014,"lang":"en","type":"article","venue":"Health Services and Outcomes Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute on Drug Abuse; National Institutes of Health; National Science Foundation","keywords":"Causal inference; Propensity score matching; Observational study; Nonparametric statistics; Covariate; Estimator; Confounding; Inverse probability; Econometrics; Statistics; Average treatment effect; Logistic regression; Consistency (knowledge bases); Randomized experiment; Marginal structural model; Computer science; Mathematics; Artificial intelligence; Posterior probability; Bayesian probability","score_opus":0.6899585491834566,"score_gpt":0.6385585072369091,"score_spread":0.05140004194654746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068564314","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003106876,0.000030825522,0.9993761,0.00005932269,0.000014170907,0.00003621499,0.00001864097,0.00005296324,0.000101176585],"genre_scores_gemma":[0.021637665,0.00013091741,0.9759746,0.00018021003,0.00007694469,0.00063825294,0.0002063503,0.00010400514,0.00105106],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9791566,0.015783338,0.0009714323,0.0020209292,0.001787831,0.0002798229],"domain_scores_gemma":[0.914182,0.072174445,0.0016730442,0.0080812555,0.0034402905,0.000448991],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040019304,0.0018512971,0.0028872986,0.00331327,0.0010659543,0.0022797803,0.0067456863,0.0029779405,0.008939011],"category_scores_gemma":[0.15365593,0.0021106547,0.0037967185,0.0040669283,0.0024987794,0.004121721,0.0062173726,0.0069878325,0.0019110753],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047260398,0.0003602321,0.0025974524,0.0006510273,0.0010985176,0.00032243502,0.0007003133,0.11616158,0.00378835,0.50037783,0.004518075,0.36895165],"study_design_scores_gemma":[0.00018277,0.00010818329,0.0005152515,0.00011329945,0.00020701511,0.00016557149,0.00007009716,0.6517258,0.0016228841,0.33999893,0.0052328566,0.000057359357],"about_ca_topic_score_codex":0.0041872873,"about_ca_topic_score_gemma":0.0045926534,"teacher_disagreement_score":0.040019304,"about_ca_system_score_codex":0.0010308052,"about_ca_system_score_gemma":0.0033248116,"threshold_uncertainty_score":0.21164483},"labels":[],"label_agreement":null},{"id":"W2068928172","doi":"10.1016/s0895-4356(02)00437-7","title":"Quasi-experimental longitudinal designs to evaluate drug benefit policy changes with low policy compliance","year":2002,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":41,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"National Institute on Aging; Agency for Healthcare Research and Quality","keywords":"Counterfactual thinking; Null hypothesis; Compliance (psychology); Econometrics; Policy analysis; Population; Medicine; Longitudinal study; Public economics; Economics; Actuarial science; Psychology; Social psychology; Political science; Environmental health","score_opus":0.7124647347952494,"score_gpt":0.6126733016475715,"score_spread":0.09979143314767791,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068928172","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6554205,0.002377397,0.30543822,0.005300937,0.0027752498,0.018932771,0.004751682,0.001062795,0.0039404603],"genre_scores_gemma":[0.8800169,0.00034487384,0.07627441,0.0017367734,0.00032491263,0.03729219,0.001154518,0.00007023242,0.0027851255],"study_design_codex":"randomized_trial","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.71344763,0.26364338,0.0063179834,0.0093432665,0.004958836,0.0022889648],"domain_scores_gemma":[0.3280939,0.5898111,0.038387936,0.037211556,0.004581933,0.0019136339],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1999679,0.0026959623,0.0035169353,0.0016186953,0.0022295096,0.002157074,0.0045957305,0.005983486,0.017834708],"category_scores_gemma":[0.41758564,0.0022429333,0.004168892,0.0016868936,0.006326817,0.004909816,0.0030950897,0.0054093315,0.0013009532],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.3641982,0.06844285,0.12019449,0.006030109,0.044603217,0.0011014915,0.0054736426,0.05583623,0.003744051,0.18670487,0.012103218,0.13156761],"study_design_scores_gemma":[0.17941286,0.16523544,0.06328942,0.0009982529,0.02239003,0.0006516939,0.0020814566,0.30022442,0.0061220527,0.24785462,0.011136559,0.0006031806],"about_ca_topic_score_codex":0.0030681738,"about_ca_topic_score_gemma":0.0016320731,"teacher_disagreement_score":0.8000321,"about_ca_system_score_codex":0.0025168052,"about_ca_system_score_gemma":0.004870793,"threshold_uncertainty_score":0.986582},"labels":[],"label_agreement":null},{"id":"W2068953434","doi":"10.1002/sim.2053","title":"The use of the propensity score for estimating treatment effects: administrative versus clinical data","year":2005,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":225,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences; Women's College Hospital; University of Toronto","funders":"","keywords":"Propensity score matching; Statistics; Econometrics; Medicine; Mathematics","score_opus":0.7319400186447765,"score_gpt":0.5861486378777672,"score_spread":0.14579138076700937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068953434","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0364692,0.0041089007,0.9514685,0.003570345,0.00027585315,0.0005688406,0.0009930548,0.00013629052,0.0024090211],"genre_scores_gemma":[0.5472874,0.005537903,0.43988684,0.0015729341,0.0008182395,0.0020212666,0.001690907,0.000096226846,0.0010883813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85470194,0.13003151,0.0042553744,0.0033543592,0.0071845897,0.0004722185],"domain_scores_gemma":[0.72279996,0.22674589,0.023218872,0.022041984,0.004294283,0.0008990102],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.095158994,0.0008925841,0.0020318988,0.006047806,0.0007102516,0.0032147602,0.0016511565,0.002075332,0.0023562617],"category_scores_gemma":[0.30990645,0.00061488873,0.0018132059,0.009455675,0.0030704862,0.0038919342,0.0027785907,0.0027932182,0.00038834792],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001110565,0.00044092053,0.18150733,0.0017057343,0.0050639706,0.00031222534,0.0011785183,0.045426257,0.0010096373,0.36768228,0.0050201965,0.38954234],"study_design_scores_gemma":[0.001220227,0.002130459,0.11269043,0.0012174647,0.0016851872,0.0011136697,0.00074880134,0.19971742,0.0029143845,0.64831156,0.027934873,0.000315627],"about_ca_topic_score_codex":0.0020962171,"about_ca_topic_score_gemma":0.0014703604,"teacher_disagreement_score":0.904841,"about_ca_system_score_codex":0.0012378779,"about_ca_system_score_gemma":0.0023278897,"threshold_uncertainty_score":0.5032549},"labels":[],"label_agreement":null},{"id":"W2070570347","doi":"10.5539/jmr.v7n2p90","title":"Probabilistic Analysis of Balancing Scores for Causal Inference","year":2015,"lang":"en","type":"article","venue":"Journal of Mathematics Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Forskningsrådet om Hälsa, Arbetsliv och Välfärd; Vetenskapsrådet","keywords":"Propensity score matching; Causal inference; Covariate; Confounding; Observational study; Outcome (game theory); Causal model; Inference","score_opus":0.5381036112364946,"score_gpt":0.5669298269646585,"score_spread":0.028826215728163906,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070570347","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048238616,0.0003568638,0.99148387,0.0007484815,0.000040900028,0.00006849525,0.000122593,0.00011124982,0.0022437137],"genre_scores_gemma":[0.4037103,0.0026884957,0.57499117,0.0012126892,0.0010597992,0.0018407024,0.0016672901,0.00043229474,0.012397329],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97760403,0.015685624,0.0007293199,0.0018452153,0.0033053216,0.0008305584],"domain_scores_gemma":[0.8899697,0.09383423,0.00521297,0.0057186484,0.0040169903,0.0012475003],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036472093,0.0017065891,0.0025383122,0.004536797,0.002029678,0.0040895804,0.0033989297,0.003101548,0.011262352],"category_scores_gemma":[0.14346263,0.0014061615,0.0028647345,0.0038482172,0.0058577945,0.00804957,0.0056813555,0.0055306074,0.0012588396],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005115352,0.000030481957,0.000983012,0.0001031032,0.00008867841,0.00008216334,0.00013535222,0.052457843,0.00021321367,0.9271404,0.0012504635,0.017464194],"study_design_scores_gemma":[0.000022581296,0.000023568531,0.00022527318,0.0000421302,0.000023761922,0.00003842622,0.000017500872,0.20922005,0.00012081844,0.78879875,0.0014523289,0.000014689517],"about_ca_topic_score_codex":0.0026296198,"about_ca_topic_score_gemma":0.0016901795,"teacher_disagreement_score":0.036472093,"about_ca_system_score_codex":0.0030090443,"about_ca_system_score_gemma":0.0028424705,"threshold_uncertainty_score":0.19288522},"labels":[],"label_agreement":null},{"id":"W2070754959","doi":"10.1002/1098-2272(200102)20:2<149::aid-gepi1>3.0.co;2-a","title":"Design considerations for association studies of candidate genes in families","year":2001,"lang":"en","type":"article","venue":"Genetic Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Mount Sinai Hospital; Montreal General Hospital; University of Toronto; Lunenfeld-Tanenbaum Research Institute","funders":"National Institute of General Medical Sciences; Health Canada; National Institutes of Health","keywords":"Sample size determination; Covariate; Statistics; Correlation; Proband; Trait; Family aggregation; Sample (material); Econometrics; Generalized linear model; Mathematics; Genetics; Biology; Medicine; Computer science; Population; Gene; Mutation; Environmental health","score_opus":0.4847477091923624,"score_gpt":0.4999049966129594,"score_spread":0.015157287420597021,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2070754959","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011219621,0.002255929,0.96781373,0.0051234895,0.00054090685,0.0070183375,0.00029867355,0.00025105162,0.005478234],"genre_scores_gemma":[0.061817862,0.0011601908,0.9114111,0.0024165423,0.00029281867,0.021744141,0.00013428171,0.000057152683,0.0009658083],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.73078597,0.2503774,0.004199072,0.0038828494,0.009843054,0.0009117099],"domain_scores_gemma":[0.72607523,0.23791526,0.011791968,0.01474114,0.008218698,0.0012576227],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16360368,0.0016207866,0.0023719966,0.0013329954,0.0014994608,0.0023171944,0.0026158416,0.0046848697,0.0050141653],"category_scores_gemma":[0.32221368,0.0014193308,0.0017534455,0.0018085756,0.0023607127,0.002449001,0.0022396222,0.0032544474,0.0009635221],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005409637,0.0008630275,0.01758388,0.0037497075,0.0015156749,0.0011745101,0.0035456347,0.03694135,0.005484014,0.6636493,0.0147983,0.24528493],"study_design_scores_gemma":[0.006384576,0.007848536,0.011633083,0.0015134336,0.0014768628,0.0019076425,0.0007625303,0.051392395,0.0040724752,0.80739486,0.10532692,0.00028672058],"about_ca_topic_score_codex":0.0007188439,"about_ca_topic_score_gemma":0.0016638926,"teacher_disagreement_score":0.16360368,"about_ca_system_score_codex":0.0019676837,"about_ca_system_score_gemma":0.0034630368,"threshold_uncertainty_score":0.8652293},"labels":[],"label_agreement":null},{"id":"W2071109714","doi":"10.1002/sim.2655","title":"Analysing and interpreting competing risk data","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":184,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Institute for Cancer Research","funders":"","keywords":"Hazard; Computer science; Event (particle physics); Population; Interpretation (philosophy); Econometrics; Statistics; Risk analysis (engineering); Mathematics; Medicine; Environmental health","score_opus":0.11141470997664706,"score_gpt":0.46070952155919104,"score_spread":0.349294811582544,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2071109714","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018013746,0.0045151818,0.96241254,0.0060393712,0.0006741503,0.0009587769,0.0028505358,0.00063578127,0.003899962],"genre_scores_gemma":[0.20004313,0.0035948763,0.7856989,0.0025936444,0.0014021136,0.0021682554,0.0031058681,0.0003927074,0.0010005557],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8442545,0.12791862,0.008531388,0.004872096,0.013522712,0.0009007505],"domain_scores_gemma":[0.35922506,0.596873,0.01804977,0.01848089,0.0063100387,0.0010612769],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13751419,0.0023197818,0.0040415754,0.010610085,0.0011941895,0.0076174103,0.0048409966,0.00507532,0.0048368364],"category_scores_gemma":[0.39639276,0.0011364656,0.0038345777,0.0075119,0.004155857,0.005939,0.004699115,0.0052844263,0.00077139755],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015064839,0.00035175378,0.03594054,0.008025832,0.0031501027,0.0040959893,0.011514056,0.053201716,0.0032725565,0.4905457,0.022580722,0.3658146],"study_design_scores_gemma":[0.0002659672,0.00033938297,0.0075704553,0.0019399994,0.00061931467,0.0019387205,0.0024292073,0.062376745,0.0023657416,0.88041645,0.039483674,0.00025432868],"about_ca_topic_score_codex":0.0016834465,"about_ca_topic_score_gemma":0.0010780714,"teacher_disagreement_score":0.13751419,"about_ca_system_score_codex":0.0018657517,"about_ca_system_score_gemma":0.0033598486,"threshold_uncertainty_score":0.7272532},"labels":[],"label_agreement":null},{"id":"W2075432660","doi":"10.1177/0962280214544251","title":"Statistical methods for incomplete data: Some results on model misspecification","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Estimator; Inverse probability weighting; Inverse probability; Imputation (statistics); Weighting; Mathematics; Covariate; Estimating equations; Applied mathematics; Statistics; Inverse; Asymptotic distribution; Empirical likelihood; Delta method; Econometrics; Computer science; Missing data; Posterior probability; Bayesian probability","score_opus":0.7813321794790806,"score_gpt":0.7350020607206029,"score_spread":0.0463301187584777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075432660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002023441,0.0019849373,0.9939214,0.0010373784,0.000053419175,0.00004205426,0.00004266412,0.00008029966,0.0008144175],"genre_scores_gemma":[0.15285665,0.01051916,0.8278579,0.0019578843,0.001333686,0.0014573896,0.00048805217,0.0004980832,0.0030312624],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9337068,0.05015266,0.0025143751,0.003555147,0.009268709,0.00080222747],"domain_scores_gemma":[0.53445244,0.4157063,0.013765912,0.026118992,0.009215391,0.00074094476],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.109440655,0.0023188274,0.0042634183,0.004408495,0.0012333432,0.0038805357,0.005807505,0.003936009,0.0034719824],"category_scores_gemma":[0.4008269,0.0017930407,0.0047495007,0.0071693733,0.009288777,0.009809636,0.005389565,0.0096238945,0.0007717307],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006628806,0.000060441685,0.0038904322,0.0007641988,0.0005361027,0.0004903842,0.00082252716,0.08053775,0.00037657248,0.83058923,0.0023173764,0.0795487],"study_design_scores_gemma":[0.000035759986,0.000060254784,0.0007102877,0.00029173776,0.000118749165,0.000324156,0.00006680737,0.207193,0.00053715875,0.7859089,0.0047091856,0.00004406589],"about_ca_topic_score_codex":0.0023285765,"about_ca_topic_score_gemma":0.0011851145,"teacher_disagreement_score":0.109440655,"about_ca_system_score_codex":0.0032026735,"about_ca_system_score_gemma":0.003023652,"threshold_uncertainty_score":0.5787844},"labels":[],"label_agreement":null},{"id":"W2075615602","doi":"10.1007/s11292-007-9023-3","title":"Using group-based trajectory modeling in conjunction with propensity scores to improve balance","year":2007,"lang":"en","type":"article","venue":"Journal of Experimental Criminology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; RAND Corporation; National Science Foundation","keywords":"Covariate; Causal inference; Propensity score matching; Observational study; Trajectory; Econometrics; Matching (statistics); Inference; Statistics; Randomized experiment; Balance (ability); Psychology; Computer science; Mathematics; Artificial intelligence","score_opus":0.37432864595407206,"score_gpt":0.4279812160766541,"score_spread":0.053652570122582066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075615602","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033385392,0.0000926442,0.96390986,0.00027241724,0.000059906128,0.00012377814,0.00016320136,0.0008372332,0.0011555763],"genre_scores_gemma":[0.56154585,0.00011071848,0.4353013,0.00009895989,0.00004869441,0.0003182244,0.0004951502,0.00026219047,0.0018189078],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99250704,0.0055441805,0.00027383928,0.0009417756,0.000548295,0.00018498611],"domain_scores_gemma":[0.9566071,0.033345804,0.0020744265,0.0056603462,0.0016782227,0.00063408253],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020293672,0.0012708253,0.002259156,0.0028849822,0.0016355476,0.0021096005,0.001985459,0.0019221873,0.009233104],"category_scores_gemma":[0.08317883,0.00086080265,0.0012905132,0.0037096648,0.00073481124,0.00519541,0.0031577519,0.0023996856,0.001289811],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00223139,0.0014667904,0.05201438,0.0002940863,0.0018667,0.00030694122,0.0016170943,0.23369189,0.0027024837,0.11853839,0.006706432,0.5785634],"study_design_scores_gemma":[0.00020846205,0.00022881741,0.004220516,0.000035434037,0.0003175198,0.000068725865,0.00014116068,0.8035099,0.0011237839,0.18841909,0.0016832347,0.000043390024],"about_ca_topic_score_codex":0.0044524423,"about_ca_topic_score_gemma":0.0057200463,"teacher_disagreement_score":0.020293672,"about_ca_system_score_codex":0.0007896135,"about_ca_system_score_gemma":0.0019475835,"threshold_uncertainty_score":0.10732448},"labels":[],"label_agreement":null},{"id":"W2077156951","doi":"10.1016/j.jclinepi.2007.07.007","title":"New insights on the relation between untreated and treated outcomes for a given therapy effect model is not necessarily linear","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Linear model; Outcome (game theory); Econometrics; Relation (database); Disease; Medicine; Constant (computer programming); Mathematics; Computer science; Statistics; Mathematical economics; Internal medicine; Data mining","score_opus":0.5645195566477534,"score_gpt":0.581479820362613,"score_spread":0.01696026371485959,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077156951","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06514809,0.0042213225,0.8991407,0.02441739,0.00043013328,0.00010608194,0.0011247766,0.0002904103,0.005121021],"genre_scores_gemma":[0.8053021,0.007974094,0.15590055,0.011247662,0.0030528568,0.0005868412,0.0014875408,0.00025488363,0.014193421],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.985107,0.009436035,0.0005460343,0.0031193339,0.0011877157,0.00060383556],"domain_scores_gemma":[0.7681252,0.21295029,0.007721838,0.008563785,0.0017976537,0.0008413598],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03434175,0.0014588917,0.0037577425,0.0021300085,0.0008594139,0.0036161835,0.0037368312,0.0029737612,0.009391379],"category_scores_gemma":[0.13051683,0.0018182591,0.004063145,0.0022612659,0.0042691748,0.009060502,0.0029104606,0.011067087,0.0007800463],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006898981,0.0005211571,0.02472296,0.0009199588,0.002067898,0.00081302266,0.0016908373,0.057372943,0.0011907672,0.8230953,0.006419246,0.08049604],"study_design_scores_gemma":[0.00014406233,0.00013329268,0.0037700548,0.00008827559,0.00044187205,0.00033102828,0.00011640184,0.098403804,0.00017641831,0.89434487,0.002009726,0.000040303315],"about_ca_topic_score_codex":0.0055331914,"about_ca_topic_score_gemma":0.0054352083,"teacher_disagreement_score":0.96565825,"about_ca_system_score_codex":0.0021576602,"about_ca_system_score_gemma":0.0029694156,"threshold_uncertainty_score":0.18161869},"labels":[],"label_agreement":null},{"id":"W2077482180","doi":"10.1016/j.jclinepi.2007.05.006","title":"A sensitivity analysis using information about measured confounders yielded improved uncertainty assessments for unmeasured confounding","year":2007,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Michael Smith Health Research BC","keywords":"Confounding; Observational study; Statistics; Prior probability; Odds ratio; Medicine; Credible interval; Confidence interval; Econometrics; Bayesian probability; Mathematics","score_opus":0.5885736479901069,"score_gpt":0.6149718249995361,"score_spread":0.026398177009429147,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077482180","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016456,0.0014362455,0.9794266,0.00062412117,0.00019731255,0.00018357663,0.0005508278,0.00031441994,0.00081079185],"genre_scores_gemma":[0.55082023,0.001728697,0.4438852,0.0007795018,0.00039185648,0.00044180546,0.00070874946,0.0002993288,0.0009446275],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9606117,0.03156799,0.0019562212,0.0028563445,0.0025621522,0.00044553776],"domain_scores_gemma":[0.6458995,0.3251348,0.0032377478,0.020946328,0.0044148387,0.0003667808],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07020913,0.003442608,0.004621334,0.004103757,0.0010896879,0.0038640078,0.0020250105,0.0029741812,0.003832582],"category_scores_gemma":[0.30129158,0.0012565802,0.0072757197,0.0029588677,0.0012098288,0.004700533,0.0031793192,0.0051420596,0.0003387391],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029703083,0.0005656183,0.01042278,0.00312257,0.0076821847,0.0019150063,0.0007621718,0.6349973,0.013732917,0.128423,0.0041067605,0.1912994],"study_design_scores_gemma":[0.0003964054,0.0005153595,0.0040070936,0.000386087,0.0043396386,0.0012641051,0.00009228581,0.6710883,0.010914987,0.30254713,0.0041341153,0.00031458293],"about_ca_topic_score_codex":0.0023070814,"about_ca_topic_score_gemma":0.0012745393,"teacher_disagreement_score":0.92979085,"about_ca_system_score_codex":0.0011812807,"about_ca_system_score_gemma":0.002259498,"threshold_uncertainty_score":0.37130582},"labels":[],"label_agreement":null},{"id":"W2077926906","doi":"10.1161/circoutcomes.108.790634","title":"Primer on Statistical Interpretation or Methods Report Card on Propensity-Score Matching in the Cardiology Literature From 2004 to 2006","year":2008,"lang":"en","type":"review","venue":"Circulation Cardiovascular Quality and Outcomes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":154,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Matching (statistics); Medicine; Internal medicine; Covariate; Cardiology; Statistics; Mathematics; Pathology","score_opus":0.41148365305155504,"score_gpt":0.5222492141402588,"score_spread":0.11076556108870378,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077926906","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010695977,0.03123147,0.5573363,0.21192908,0.10374227,0.01459556,0.042200055,0.0059338654,0.0319618],"genre_scores_gemma":[0.008664384,0.029715376,0.7466767,0.08284666,0.028565736,0.056089003,0.017954573,0.0034632937,0.026024373],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.86620474,0.08985566,0.024713553,0.004733603,0.013198971,0.0012934726],"domain_scores_gemma":[0.437093,0.430548,0.038551506,0.02534154,0.06479496,0.0036710983],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13256678,0.0023639558,0.0022485799,0.017604504,0.0016862424,0.009100324,0.004747741,0.005215302,0.07901495],"category_scores_gemma":[0.5109758,0.0018945822,0.0047006966,0.01890344,0.00324357,0.006208728,0.0069716447,0.008370719,0.023884004],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000374175,0.00008863236,0.0016984696,0.009391955,0.00026607173,0.00014939441,0.0005532137,0.00056547066,0.00031366764,0.036357563,0.73376167,0.21647976],"study_design_scores_gemma":[0.00039964452,0.00012594655,0.0027331605,0.016444286,0.0002727324,0.00036502295,0.00035702484,0.0021314803,0.0008227837,0.052925497,0.9233149,0.00010734976],"about_ca_topic_score_codex":0.002341296,"about_ca_topic_score_gemma":0.0014889139,"teacher_disagreement_score":0.8674332,"about_ca_system_score_codex":0.0031327787,"about_ca_system_score_gemma":0.017117137,"threshold_uncertainty_score":0.70108855},"labels":[],"label_agreement":null},{"id":"W2078671558","doi":"10.1016/j.jclinepi.2011.06.012","title":"Treatment effect estimates varied depending on the definition of the provider prescribing preference-based instrumental variables","year":2011,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"","keywords":"Covariate; Confounding; Instrumental variable; Medicine; Observational study; Statistics; Average treatment effect; Point estimation; Confidence interval; Population; Variance (accounting); Econometrics; Demography; Affect (linguistics); Mathematics; Propensity score matching; Psychology; Economics; Environmental health","score_opus":0.7143918541365805,"score_gpt":0.5086633126554404,"score_spread":0.20572854148114006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2078671558","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18646766,0.014208322,0.7610142,0.016748495,0.0011319807,0.0014452877,0.0051909923,0.0020206082,0.011772449],"genre_scores_gemma":[0.90878683,0.002340785,0.08206536,0.00287389,0.00032291358,0.00044195115,0.0010139897,0.0005497399,0.0016044588],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.91994536,0.06419946,0.0049438393,0.0057973536,0.0031848233,0.0019291469],"domain_scores_gemma":[0.25051495,0.72103137,0.007944274,0.01591014,0.003975472,0.00062385446],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1492918,0.0018205842,0.0036120503,0.0024356283,0.0007301488,0.006325699,0.002741921,0.004325647,0.012774134],"category_scores_gemma":[0.5195354,0.0017675397,0.008519939,0.0031131743,0.0021927862,0.0062992885,0.0035315494,0.013682558,0.0015304084],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012521052,0.00173426,0.23681332,0.00591156,0.030816017,0.0008427483,0.00438952,0.07598703,0.0067225075,0.16346131,0.011974802,0.4488259],"study_design_scores_gemma":[0.0026177608,0.0014625405,0.18139566,0.0030079926,0.0377519,0.0016590151,0.0025581606,0.24840592,0.011097317,0.49271628,0.016677283,0.0006501246],"about_ca_topic_score_codex":0.004816456,"about_ca_topic_score_gemma":0.0047115246,"teacher_disagreement_score":0.8507082,"about_ca_system_score_codex":0.0015658775,"about_ca_system_score_gemma":0.0028769292,"threshold_uncertainty_score":0.78953993},"labels":[],"label_agreement":null},{"id":"W2079118756","doi":"10.1002/pds.1201","title":"Estimation of time‐dependent rate ratios in case‐control studies: comparison of two approaches for exposure assessment","year":2006,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Canadian Institutes of Health Research; Canadian Lung Association","keywords":"Medicine; Duration (music); Pharmacoepidemiology; Statistics; Relative risk; Cohort; Confidence interval; Exposure duration; Cohort study; Toxicology; Internal medicine; Environmental health; Pharmacology; Mathematics","score_opus":0.21786663133218764,"score_gpt":0.5032988095763224,"score_spread":0.2854321782441348,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2079118756","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043217536,0.010469087,0.9411394,0.00045745494,0.0003501959,0.0027799814,0.0003519461,0.00049471995,0.0007397051],"genre_scores_gemma":[0.3743714,0.0047563002,0.6114184,0.0006133224,0.00035084438,0.006547021,0.0010280239,0.000338046,0.0005766221],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.4229432,0.521791,0.016439732,0.021354219,0.016637852,0.0008339809],"domain_scores_gemma":[0.1730789,0.77468026,0.027624825,0.018877035,0.005117555,0.0006214465],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39002407,0.0037171976,0.0068129343,0.010703266,0.0007833152,0.004297994,0.008333851,0.0063676904,0.002264447],"category_scores_gemma":[0.6125448,0.0024197926,0.015203556,0.0065408545,0.004431848,0.0061119874,0.004082374,0.0050759367,0.00042630945],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015542901,0.00086065225,0.2231059,0.011820051,0.12913813,0.0013144523,0.0034972008,0.17409386,0.0030880722,0.048781283,0.002299744,0.38645774],"study_design_scores_gemma":[0.0058555068,0.009870916,0.101183206,0.0036520215,0.026089141,0.0030797687,0.0011345508,0.7544802,0.0047912276,0.07950365,0.009135645,0.001224151],"about_ca_topic_score_codex":0.0032485332,"about_ca_topic_score_gemma":0.0015852277,"teacher_disagreement_score":0.60997593,"about_ca_system_score_codex":0.0027776107,"about_ca_system_score_gemma":0.0020156528,"threshold_uncertainty_score":0.75220895},"labels":[],"label_agreement":null},{"id":"W2079826663","doi":"10.2202/1557-4679.1210","title":"Model Checking with Residuals for g-estimation of Optimal Dynamic Treatment Regimes","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Health Canada; UNICEF; Thrasher Research Fund","keywords":"Counterfactual thinking; Residual; Context (archaeology); Estimation; Computer science; Econometrics; Mathematics; Statistics; Algorithm; Economics","score_opus":0.08719899470162384,"score_gpt":0.4254682716849469,"score_spread":0.33826927698332304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2079826663","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008914877,0.00015258371,0.9892897,0.00030608394,0.00003821733,0.00007193083,0.00013714269,0.0006158631,0.00047361772],"genre_scores_gemma":[0.3732713,0.00023511346,0.62380505,0.00040475078,0.000066719746,0.00064744597,0.00071302167,0.0003779309,0.0004788056],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9397137,0.053283494,0.0015772181,0.002751378,0.0020161173,0.000658179],"domain_scores_gemma":[0.58372647,0.37557474,0.012543806,0.023074366,0.0043932223,0.00068749243],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07700393,0.0015975876,0.0027769858,0.0029224646,0.0010564403,0.0024645973,0.0031943575,0.0027588329,0.007994342],"category_scores_gemma":[0.35283902,0.00090839574,0.002938177,0.0023118982,0.0032938232,0.0041232146,0.00351858,0.004802279,0.0006709363],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010070484,0.0002656694,0.022132954,0.0007715857,0.0010688221,0.0005851255,0.0010279448,0.47344354,0.0018195049,0.35298562,0.0040664887,0.14082576],"study_design_scores_gemma":[0.00017063174,0.0002343139,0.0014991312,0.00015888693,0.00010611147,0.00010290318,0.00013340938,0.7913116,0.0019407695,0.20164785,0.0026319872,0.000062428335],"about_ca_topic_score_codex":0.004265643,"about_ca_topic_score_gemma":0.001953417,"teacher_disagreement_score":0.07700393,"about_ca_system_score_codex":0.0013483147,"about_ca_system_score_gemma":0.0029890551,"threshold_uncertainty_score":0.40724057},"labels":[],"label_agreement":null},{"id":"W2081922084","doi":"10.1007/s40471-014-0030-4","title":"Counterfactual Theory in Social Epidemiology: Reconciling Analysis and Action for the Social Determinants of Health","year":2015,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":33,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Counterfactual thinking; Social epidemiology; Causality (physics); Observational study; Health equity; Social determinants of health; Socioeconomic status; Causal model; Race and health; Consistency (knowledge bases); Inference; Psychology; Econometrics; Social psychology; Medicine; Public health; Computer science; Mathematics; Population; Statistics; Environmental health","score_opus":0.6977796672949589,"score_gpt":0.6023984078918089,"score_spread":0.09538125940315001,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2081922084","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010567694,0.0036144918,0.9713442,0.010517512,0.00043911344,0.00010205434,0.00011899283,0.00008484794,0.0032111232],"genre_scores_gemma":[0.59531933,0.0072696083,0.38787377,0.0028479192,0.0022826556,0.0011384243,0.00024121767,0.00015230464,0.0028747374],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.883761,0.106094204,0.0015990706,0.0038332902,0.003922271,0.00079024],"domain_scores_gemma":[0.4867826,0.4853664,0.0077783545,0.01596941,0.0030296915,0.0010734062],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10875937,0.0023383074,0.0048751216,0.004634269,0.0020320467,0.006851022,0.0058179903,0.004822327,0.0061277393],"category_scores_gemma":[0.3027628,0.0013160688,0.0036432978,0.004593249,0.014264992,0.012655841,0.0062033143,0.009482779,0.00035509942],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005492784,0.00005028008,0.0010694115,0.00014716228,0.00018171614,0.00007042416,0.00032464392,0.0077868747,0.000044387252,0.98100626,0.00049992366,0.008763953],"study_design_scores_gemma":[0.000020216876,0.000017028426,0.00015520275,0.000040171446,0.000036682366,0.00002813039,0.000044380504,0.02920342,0.000036964993,0.96987176,0.00053328625,0.000012755999],"about_ca_topic_score_codex":0.0056525115,"about_ca_topic_score_gemma":0.0034562966,"teacher_disagreement_score":0.10875937,"about_ca_system_score_codex":0.0036609804,"about_ca_system_score_gemma":0.0051420624,"threshold_uncertainty_score":0.5751814},"labels":[],"label_agreement":null},{"id":"W2082209076","doi":"10.1016/j.jclinepi.2012.07.012","title":"Calculating additive treatment effects from multiple randomized trials provides useful estimates of combination therapies","year":2012,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":46,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; University of Ottawa","funders":"Canadian Institutes of Health Research","keywords":"Randomized controlled trial; Pairwise comparison; Medicine; Meta-analysis; Additive function; Treatment effect; Clinical trial; Intensive care medicine; Econometrics; Statistics; Internal medicine; Mathematics; Traditional medicine","score_opus":0.6189721366302209,"score_gpt":0.5998256028561627,"score_spread":0.019146533774058172,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082209076","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006699279,0.0038152507,0.9862294,0.0009936056,0.00018609001,0.00030852086,0.0004065731,0.00038713333,0.00097420724],"genre_scores_gemma":[0.24560122,0.0033287646,0.74489695,0.0013392359,0.0007572805,0.0018230821,0.00064278545,0.00021857412,0.0013921057],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.83395785,0.14687409,0.0062832157,0.0061429907,0.006105084,0.0006366554],"domain_scores_gemma":[0.41838738,0.5438321,0.009802849,0.024321012,0.0028384645,0.00081820425],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12103915,0.003382301,0.0088259755,0.0059528183,0.00094717357,0.005712011,0.0039656986,0.0036655471,0.0065398724],"category_scores_gemma":[0.37522566,0.0028287717,0.00925675,0.0045857662,0.0018809824,0.006372012,0.0038855302,0.0075125364,0.0007908055],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0051275278,0.00064517837,0.014639695,0.0067039076,0.032231275,0.00090043194,0.0007021612,0.14343575,0.0014792031,0.25106525,0.008428897,0.5346407],"study_design_scores_gemma":[0.0012874973,0.0010394611,0.0033378105,0.0008324484,0.011777757,0.0006986063,0.00009334323,0.19881567,0.0015767294,0.7729871,0.00743875,0.00011485509],"about_ca_topic_score_codex":0.00086548645,"about_ca_topic_score_gemma":0.0011714045,"teacher_disagreement_score":0.87896085,"about_ca_system_score_codex":0.0011520803,"about_ca_system_score_gemma":0.0029313636,"threshold_uncertainty_score":0.64012384},"labels":[],"label_agreement":null},{"id":"W2082644600","doi":"10.1002/bimj.200800182","title":"Risk Factor Adjustment in Marginal Structural Model Estimation of Optimal Treatment Regimes","year":2009,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Marginal structural model; Confounding; Weighting; Econometrics; Context (archaeology); Inverse probability weighting; Marginal model; Statistics; Propensity score matching; Model selection; Selection (genetic algorithm); Marginal distribution; Outcome (game theory); Computer science; Mathematics; Regression analysis; Medicine; Machine learning; Random variable","score_opus":0.1747576457312704,"score_gpt":0.42918240355515974,"score_spread":0.25442475782388935,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082644600","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007140284,0.0004501927,0.99131197,0.00039733478,0.000028103563,0.000055109285,0.000063714375,0.000116909934,0.000436276],"genre_scores_gemma":[0.35433343,0.0016135336,0.6400267,0.00028290242,0.0001813086,0.00081973884,0.0005212031,0.00017849018,0.002042669],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9812501,0.015508783,0.00047168904,0.0014783213,0.00085218943,0.00043897083],"domain_scores_gemma":[0.9612606,0.033562906,0.0015510201,0.0024805681,0.00088296446,0.00026195336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023713684,0.0009551147,0.0026272633,0.0018494742,0.0006427017,0.001675928,0.0021345783,0.0016442601,0.00392369],"category_scores_gemma":[0.10482828,0.001014198,0.0023615574,0.0021425476,0.0017464336,0.0021544152,0.0025038358,0.0031162482,0.0005979101],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038925614,0.00014366668,0.00807776,0.00038731893,0.000658907,0.000117613694,0.0006193643,0.3352227,0.0005850266,0.45357794,0.0024524597,0.19776805],"study_design_scores_gemma":[0.000069130816,0.000101396945,0.001258464,0.000085782434,0.00012757069,0.000050421775,0.00006161994,0.5449431,0.0003931095,0.45025343,0.0026234847,0.00003254146],"about_ca_topic_score_codex":0.0040030316,"about_ca_topic_score_gemma":0.0028764287,"teacher_disagreement_score":0.023713684,"about_ca_system_score_codex":0.001452524,"about_ca_system_score_gemma":0.0034510707,"threshold_uncertainty_score":0.12541139},"labels":[],"label_agreement":null},{"id":"W2082859497","doi":"10.1038/jes.2009.61","title":"Selection bias in case–control studies on household exposure to pesticides and childhood acute leukemia","year":2009,"lang":"en","type":"review","venue":"Journal of Exposure Science & Environmental Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Association pour la Recherche sur le Cancer","keywords":"Selection bias; Selection (genetic algorithm); Pesticide; Childhood leukemia; Exposure assessment; Environmental health; Information bias; Case-control study; Medicine; Psychology; Leukemia; Biology; Immunology; Internal medicine; Computer science; Lymphoblastic Leukemia; Pathology","score_opus":0.2599263132490099,"score_gpt":0.4546188708369223,"score_spread":0.19469255758791243,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082859497","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008132252,0.9918737,0.006001891,0.0007493844,0.00017086549,0.000037323174,0.00009324028,0.000011619705,0.00024876624],"genre_scores_gemma":[0.02300311,0.967862,0.006824094,0.00079921517,0.0009168912,0.00011165995,0.00020732268,0.000010675654,0.00026510627],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.97486615,0.016688738,0.0032093145,0.0018735284,0.0031436768,0.00021862102],"domain_scores_gemma":[0.7834731,0.20251465,0.007981982,0.0023414977,0.003464847,0.00022386771],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04278208,0.0010934393,0.005485465,0.0038753874,0.00033812074,0.0014766079,0.003270176,0.0027037982,0.0029619175],"category_scores_gemma":[0.132949,0.0010028081,0.004917363,0.0055013713,0.0014778192,0.0019488399,0.0013551138,0.0015321457,0.0002992364],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00067244,0.00007293154,0.011120919,0.08138196,0.019025888,0.00033046614,0.00017885322,0.0019608005,0.00015803774,0.009267636,0.0060032182,0.8698268],"study_design_scores_gemma":[0.003629161,0.0017696188,0.08239283,0.15005238,0.16068198,0.010796962,0.00074610027,0.015248188,0.0028427427,0.280853,0.29046476,0.00052236824],"about_ca_topic_score_codex":0.0032910423,"about_ca_topic_score_gemma":0.0031243984,"teacher_disagreement_score":0.95721793,"about_ca_system_score_codex":0.001087722,"about_ca_system_score_gemma":0.002905671,"threshold_uncertainty_score":0.22625601},"labels":[],"label_agreement":null},{"id":"W2082908413","doi":"10.1007/s10654-011-9637-7","title":"The positivity assumption and marginal structural models: the example of warfarin use and risk of bleeding","year":2011,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"Canadian Institutes of Health Research; McGill University Health Centre","keywords":"Medicine; Warfarin; Confidence interval; Inverse probability weighting; Marginal structural model; Odds ratio; Logistic regression; Statistics; Randomized controlled trial; Internal medicine; Surgery; Mathematics; Propensity score matching; Atrial fibrillation","score_opus":0.47016498274215435,"score_gpt":0.39560946937919,"score_spread":0.07455551336296434,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2082908413","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2346324,0.0075247493,0.65963733,0.057982903,0.0003454352,0.00015774273,0.0014869096,0.000361813,0.03787077],"genre_scores_gemma":[0.9313068,0.004502805,0.05086071,0.0010590006,0.0006228284,0.00012943544,0.00022550358,0.000078742385,0.011214146],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9959317,0.0032001378,0.00007501929,0.00028803863,0.00026652557,0.00023852997],"domain_scores_gemma":[0.9516783,0.04399871,0.0014842831,0.0016662974,0.0006013692,0.0005710417],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010528525,0.0009760346,0.0024734759,0.0012444634,0.0017013281,0.002637322,0.002685513,0.005055794,0.008528478],"category_scores_gemma":[0.043268874,0.00073599146,0.0021973178,0.0028717893,0.0041311188,0.004479028,0.0024457276,0.005553692,0.0004916797],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051292183,0.00018907529,0.008457616,0.00022452197,0.00028413054,0.0019754495,0.0009911761,0.037192192,0.00050296215,0.92567915,0.0045792935,0.01941155],"study_design_scores_gemma":[0.00011100908,0.00006189095,0.0013461036,0.000029330557,0.00011219868,0.00051121233,0.00015380692,0.066250026,0.00008071647,0.92940974,0.0019076584,0.000026259839],"about_ca_topic_score_codex":0.016071295,"about_ca_topic_score_gemma":0.012345783,"teacher_disagreement_score":0.016071295,"about_ca_system_score_codex":0.0012548615,"about_ca_system_score_gemma":0.0019261836,"threshold_uncertainty_score":0.05568081},"labels":[],"label_agreement":null},{"id":"W2084602542","doi":"10.1097/mlr.0b013e3181e419fd","title":"Using Administrative Datasets to Study Outcomes in Dialysis Patients","year":2010,"lang":"en","type":"article","venue":"Medical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Public Health Ontario; University of Toronto; St. Michael's Hospital; Western University; Health Sciences Centre; London Health Sciences Centre; University of Calgary; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"Dialysis; Medicine; Baseline (sea); Medical record; Intensive care medicine; Modality (human–computer interaction); Health care; Emergency medicine; Computer science; Internal medicine","score_opus":0.23539668479596035,"score_gpt":0.5217783212771887,"score_spread":0.2863816364812284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2084602542","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86975753,0.0018181021,0.06333301,0.0029613886,0.0001358383,0.0019772793,0.053454854,0.00022185773,0.006340157],"genre_scores_gemma":[0.9394779,0.0005753792,0.03370322,0.0003381857,0.00009071078,0.0013215647,0.02422282,0.000021547447,0.00024859296],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9541844,0.035333022,0.0029186746,0.001555337,0.005349641,0.00065897603],"domain_scores_gemma":[0.78175515,0.13123204,0.047122736,0.024624653,0.013486914,0.0017785163],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0416496,0.00051381276,0.00064798194,0.004352349,0.0010861565,0.0019253579,0.0015920064,0.0005853162,0.0007123995],"category_scores_gemma":[0.14833938,0.0003917978,0.00076308724,0.0087533,0.0010018259,0.0009528392,0.0019288126,0.000990782,0.00015589967],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020716933,0.00020066045,0.9633407,0.0002880126,0.0009509775,0.00009646891,0.0009406093,0.008184455,0.00011345048,0.0037127393,0.0025646964,0.0194],"study_design_scores_gemma":[0.00021809519,0.00029546348,0.946357,0.00040326745,0.00042806467,0.0001817524,0.0012558259,0.02948375,0.00085281517,0.009135382,0.011320891,0.000067582136],"about_ca_topic_score_codex":0.11562354,"about_ca_topic_score_gemma":0.0946331,"teacher_disagreement_score":0.11562354,"about_ca_system_score_codex":0.0033439174,"about_ca_system_score_gemma":0.007286315,"threshold_uncertainty_score":0.22990108},"labels":[],"label_agreement":null},{"id":"W2085721543","doi":"10.12927/hcpol.2015.24044","title":"“Frankly, My Dear, I Don’t Give a Damn”","year":2014,"lang":"fr","type":"article","venue":"Healthcare policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Philosophy","score_opus":0.12900457714244246,"score_gpt":0.4559563712802988,"score_spread":0.32695179413785636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2085721543","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001060266,0.011319945,0.00989262,0.9459053,0.014893976,0.00002483422,0.0003011067,0.00018933453,0.01641268],"genre_scores_gemma":[0.072813906,0.016461479,0.021722523,0.7777181,0.015830358,0.00020478359,0.0004726958,0.0005481286,0.09422798],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9892518,0.0055241073,0.0004371773,0.0015931504,0.002583917,0.00060981576],"domain_scores_gemma":[0.9746738,0.012658675,0.0025141228,0.0024722114,0.0060461466,0.0016349781],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016159346,0.0013202576,0.0012345697,0.0016951011,0.004666084,0.008980959,0.0023455971,0.007244287,0.030810812],"category_scores_gemma":[0.08020201,0.0007252974,0.001440469,0.0013140229,0.01740928,0.017742405,0.0032604453,0.024393653,0.021899879],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012194441,0.000040238014,0.0013813514,0.00021078205,0.000077451994,0.00018033547,0.0029620037,0.0001908719,0.0002310614,0.15231273,0.80603737,0.03625387],"study_design_scores_gemma":[0.00003207419,0.00004917543,0.0007008702,0.00078009185,0.000035363133,0.00069630356,0.003354401,0.00050187024,0.00043738016,0.14649546,0.846815,0.00010197309],"about_ca_topic_score_codex":0.010211459,"about_ca_topic_score_gemma":0.013334944,"teacher_disagreement_score":0.030810812,"about_ca_system_score_codex":0.0042109764,"about_ca_system_score_gemma":0.004107471,"threshold_uncertainty_score":0.103072405},"labels":[],"label_agreement":null},{"id":"W2086560295","doi":"10.1007/s12561-011-9038-1","title":"A Data Augmentation Method for Estimating the Causal Effect of Adherence to Treatment Regimens Targeting Control of an Intermediate Measure","year":2011,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Regimen; Censoring (clinical trials); Covariate; Causal inference; Medicine; Observational study; Inverse probability weighting; Hazard ratio; Proportional hazards model; Repeated measures design; Statistics; Internal medicine; Econometrics; Mathematics; Confidence interval","score_opus":0.2405471980053799,"score_gpt":0.49007497699211644,"score_spread":0.24952777898673653,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2086560295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0044292514,0.000340207,0.993573,0.0003992623,0.00013543593,0.00013869265,0.0002760777,0.00026396863,0.00044403045],"genre_scores_gemma":[0.22013767,0.00093122176,0.7702382,0.0007879742,0.0007462595,0.002573471,0.0010784523,0.00013406812,0.0033727824],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826166,0.014412904,0.00040793626,0.0012712891,0.0010572341,0.0002338875],"domain_scores_gemma":[0.8672448,0.116910815,0.002654762,0.010488719,0.002181555,0.00051931833],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030427925,0.0015366788,0.0030975847,0.001753035,0.0009471149,0.0016389748,0.00405605,0.002506667,0.005409347],"category_scores_gemma":[0.09580054,0.0012590267,0.003558569,0.0022251594,0.0025793102,0.002608863,0.0029177205,0.0042521874,0.0006575167],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024940234,0.00066224,0.008974237,0.0008855794,0.0017017059,0.00042157993,0.00059105584,0.22982837,0.00269372,0.32906258,0.007819652,0.41486531],"study_design_scores_gemma":[0.0003345057,0.00037770515,0.0011441419,0.00013042812,0.00042543223,0.00018958113,0.00002978779,0.814077,0.001069308,0.17808448,0.0040712697,0.00006631957],"about_ca_topic_score_codex":0.0025592416,"about_ca_topic_score_gemma":0.0024084866,"teacher_disagreement_score":0.030427925,"about_ca_system_score_codex":0.00091342704,"about_ca_system_score_gemma":0.0029374072,"threshold_uncertainty_score":0.16092014},"labels":[],"label_agreement":null},{"id":"W2086622613","doi":"10.1111/j.0006-341x.2004.00234.x","title":"Marginal Analysis of Incomplete Longitudinal Binary Data: A Cautionary Note on LOCF Imputation","year":2004,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":87,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; University of Waterloo","keywords":"Missing data; Imputation (statistics); Estimator; Inverse probability; Econometrics; Inverse probability weighting; Statistics; Longitudinal data; Binary data; Computer science; Drop out; Mathematics; Binary number; Data mining; Bayesian probability; Posterior probability; Economics","score_opus":0.30781272951886274,"score_gpt":0.4634387367916948,"score_spread":0.15562600727283205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2086622613","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003497758,0.015630137,0.8432762,0.12843865,0.0040738946,0.00030763587,0.0006366854,0.00061709457,0.003521895],"genre_scores_gemma":[0.0892094,0.0120848175,0.7738434,0.10240106,0.0143033005,0.0016162976,0.00028109446,0.0007736171,0.00548702],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.77165127,0.19161043,0.009912213,0.0101045435,0.015548267,0.0011731691],"domain_scores_gemma":[0.4594537,0.48860914,0.008583185,0.031585727,0.010890326,0.00087789027],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22325009,0.0014940042,0.005932866,0.003281838,0.0021388095,0.0046264273,0.011286903,0.008548156,0.0024507397],"category_scores_gemma":[0.48190185,0.0013858969,0.0060926457,0.005888048,0.014237664,0.009826436,0.0055896416,0.027386015,0.0012079686],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048626686,0.000079786325,0.01377515,0.0026461445,0.0018969629,0.0031638443,0.004546942,0.011092474,0.00068498275,0.59492284,0.12900315,0.23770148],"study_design_scores_gemma":[0.0001456558,0.0001393228,0.00478777,0.0023206535,0.00037246977,0.0023467403,0.0005385383,0.037983753,0.0009835963,0.8764084,0.07376289,0.00021011331],"about_ca_topic_score_codex":0.008284222,"about_ca_topic_score_gemma":0.0071403855,"teacher_disagreement_score":0.7767499,"about_ca_system_score_codex":0.0024042684,"about_ca_system_score_gemma":0.0036247754,"threshold_uncertainty_score":0.9578709},"labels":[],"label_agreement":null},{"id":"W2087644214","doi":"10.1080/00273171.2013.752267","title":"Abstract: Longitudinal Examination of the Interpersonal Impact of Behavioral Variability","year":2013,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Interpersonal communication; Psychology; Supervisor; Longitudinal study; Interpersonal relationship; Behavioural sciences; Applied psychology; Social psychology; Political science; Medicine; Psychotherapist; Law","score_opus":0.5059692537244797,"score_gpt":0.5698292122761865,"score_spread":0.0638599585517069,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2087644214","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98915315,0.00080067926,0.001503774,0.002580286,0.00011475119,0.000046480192,0.0036867773,0.000050536604,0.002063655],"genre_scores_gemma":[0.9957807,0.0002753705,0.0005786602,0.00013316325,0.000052118645,0.00008669463,0.0016661576,0.000008991713,0.0014180936],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989895,0.00042283194,0.00006725343,0.00017748753,0.00023747738,0.00010536457],"domain_scores_gemma":[0.9799013,0.0050316267,0.0072477018,0.002527467,0.0027298192,0.002562097],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043173498,0.00026875996,0.00032835503,0.0007851438,0.0007282287,0.0010265689,0.0006804749,0.0008250311,0.006236954],"category_scores_gemma":[0.028637677,0.00026315777,0.00062991737,0.0008398287,0.00033696485,0.0011689155,0.0012730949,0.0020864129,0.0009971648],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004280449,0.00037218884,0.96815187,0.00004891632,0.0002991725,0.00013980367,0.0013426191,0.0004774157,0.00035728182,0.001124144,0.0066395155,0.020619133],"study_design_scores_gemma":[0.000011723212,0.0001993175,0.9962262,0.000030969288,0.00009201853,0.00013003363,0.00046669313,0.0006295919,0.00024154063,0.0007382957,0.0012160314,0.000017623886],"about_ca_topic_score_codex":0.007194476,"about_ca_topic_score_gemma":0.006902913,"teacher_disagreement_score":0.007194476,"about_ca_system_score_codex":0.00059511146,"about_ca_system_score_gemma":0.0009660104,"threshold_uncertainty_score":0.022832572},"labels":[],"label_agreement":null},{"id":"W2089198100","doi":"10.1186/1471-2288-8-70","title":"Reducing bias through directed acyclic graphs","year":2008,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1410,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"McGill University Health Centre; McGill University","keywords":"Directed acyclic graph; Confounding; Causal inference; Selection bias; Computer science; Outcome (game theory); Econometrics; Simple (philosophy); Causality (physics); Statistics; Mathematics; Algorithm","score_opus":0.9122827611924192,"score_gpt":0.6583154278917019,"score_spread":0.2539673333007173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2089198100","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026451752,0.0005367111,0.9929096,0.0011048816,0.00009985557,0.00018605763,0.0003406481,0.00037308838,0.0018039499],"genre_scores_gemma":[0.12157194,0.0017680619,0.87039685,0.0011941466,0.00037674484,0.0014110206,0.0009015774,0.00020984955,0.002169794],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9499737,0.040942054,0.0014608497,0.003475646,0.0035818543,0.00056585384],"domain_scores_gemma":[0.62789226,0.34569675,0.007997833,0.0120770885,0.005485676,0.0008503661],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.037039954,0.0016621572,0.0019060584,0.006052916,0.001784208,0.0027746838,0.0036224942,0.0026303052,0.007855822],"category_scores_gemma":[0.17192924,0.0014833297,0.0024843249,0.005784775,0.003535888,0.0053353193,0.0041623665,0.0037860293,0.0012968397],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029268535,0.00012333083,0.005089389,0.0014338035,0.00062656694,0.00041626178,0.0010111637,0.12500557,0.00066537544,0.6188703,0.01036382,0.23610182],"study_design_scores_gemma":[0.000077679906,0.000037562368,0.00032254038,0.0001731952,0.00012085959,0.00011962562,0.00005991811,0.11846537,0.00037784025,0.87235415,0.007864072,0.000027242897],"about_ca_topic_score_codex":0.003274582,"about_ca_topic_score_gemma":0.0034619954,"teacher_disagreement_score":0.96296006,"about_ca_system_score_codex":0.0022704753,"about_ca_system_score_gemma":0.0037870097,"threshold_uncertainty_score":0.19588834},"labels":[],"label_agreement":null},{"id":"W2091956653","doi":"10.2202/1557-4679.1106","title":"Missing Confounding Data in Marginal Structural Models: A Comparison of Inverse Probability Weighting and Multiple Imputation","year":2008,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; McGill University","funders":"","keywords":"Inverse probability weighting; Missing data; Inverse probability; Imputation (statistics); Marginal structural model; Statistics; Weighting; Confounding; Censoring (clinical trials); Computer science; Econometrics; Mathematics; Inverse distance weighting; Estimator; Data mining; Posterior probability; Bayesian probability; Medicine","score_opus":0.33358293714958803,"score_gpt":0.4591081692735752,"score_spread":0.12552523212398714,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2091956653","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01956308,0.0028250685,0.97449774,0.0010844083,0.00015118235,0.00033476815,0.00009213379,0.00012171791,0.0013299126],"genre_scores_gemma":[0.23595826,0.0033029192,0.7573376,0.0005616293,0.00025284605,0.0012370071,0.0003160755,0.00021804655,0.0008156099],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7929951,0.19296263,0.0027536608,0.003675652,0.0068370937,0.00077598984],"domain_scores_gemma":[0.58483654,0.3792959,0.0072482685,0.02168112,0.0060137664,0.0009243318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1793651,0.0017030111,0.0040404084,0.0028723697,0.0010751954,0.002948751,0.0049065463,0.0030840617,0.002629402],"category_scores_gemma":[0.38827014,0.0013751129,0.0041610505,0.004634702,0.0032002144,0.007791617,0.0057004965,0.004291907,0.0004253681],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029710042,0.0004126206,0.013747667,0.0018076326,0.005174484,0.00024224995,0.003130805,0.13969663,0.0005526336,0.45454398,0.002919258,0.37480116],"study_design_scores_gemma":[0.00090827065,0.0010967774,0.0037756758,0.0007787714,0.0013152519,0.00034416906,0.00043943114,0.45117512,0.0008065079,0.5318533,0.0073273913,0.00017922079],"about_ca_topic_score_codex":0.0025259869,"about_ca_topic_score_gemma":0.0023725405,"teacher_disagreement_score":0.1793651,"about_ca_system_score_codex":0.0018057851,"about_ca_system_score_gemma":0.0029961402,"threshold_uncertainty_score":0.9485846},"labels":[],"label_agreement":null},{"id":"W2096521417","doi":"10.1002/sim.5317","title":"A simulation study of finite‐sample properties of marginal structural Cox proportional hazards models","year":2012,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Center for Research Resources; National Institute of Allergy and Infectious Diseases; National Institute on Alcohol Abuse and Alcoholism; National Institutes of Health","keywords":"Statistics; Confidence interval; Hazard ratio; Proportional hazards model; Mathematics; Estimator; Standard error; Confounding; Mean squared error; Sample size determination; Marginal structural model; Range (aeronautics); Nominal level; Econometrics; Coverage probability","score_opus":0.21699590011067962,"score_gpt":0.45071684087391395,"score_spread":0.23372094076323432,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096521417","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.56112224,0.000984355,0.42927277,0.001456739,0.0001215727,0.0004333277,0.0010917956,0.00036097385,0.005156279],"genre_scores_gemma":[0.9434386,0.00026266198,0.05411174,0.00020909587,0.000027142121,0.00052993436,0.00061520643,0.000048761372,0.00075685215],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9893328,0.009016928,0.00025374055,0.0006355422,0.00045087494,0.00031023874],"domain_scores_gemma":[0.62804174,0.3522179,0.0068807737,0.0072418563,0.004629756,0.0009878979],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0356744,0.00062752346,0.0012069696,0.00088605133,0.0005803345,0.0010067491,0.0021970742,0.0013101758,0.002973535],"category_scores_gemma":[0.14191005,0.00054351526,0.001705669,0.001015332,0.00149626,0.0015368558,0.0010387142,0.0021765418,0.00017669392],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057885324,0.00016118106,0.019396221,0.0002238025,0.000328884,0.00024746754,0.00041054614,0.92724353,0.0004476966,0.041859586,0.0009200516,0.008182231],"study_design_scores_gemma":[0.00010766812,0.00015725239,0.0015220435,0.000048174024,0.000065183995,0.00005592806,0.000088821,0.98442185,0.00025752338,0.0128598055,0.0003938986,0.00002172005],"about_ca_topic_score_codex":0.0102083795,"about_ca_topic_score_gemma":0.006847843,"teacher_disagreement_score":0.9643256,"about_ca_system_score_codex":0.0014166428,"about_ca_system_score_gemma":0.0016628823,"threshold_uncertainty_score":0.18866658},"labels":[],"label_agreement":null},{"id":"W2096945117","doi":"10.1142/s0217590809003483","title":"DECRIMINALIZATION POLICY AND MARIJUANA SMOKING PREVALENCE: A LOOK AT THE LITERATURE","year":2009,"lang":"en","type":"article","venue":"The Singapore Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Agency for Healthcare Research and Quality; McGill University","keywords":"Decriminalization; Marijuana smoking; Econometrics; Economics; Smoking prevalence; Psychology; Actuarial science; Environmental health; Medicine; Substance use; Criminology; Psychiatry","score_opus":0.08718352098033268,"score_gpt":0.4013340714161663,"score_spread":0.3141505504358336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2096945117","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07986944,0.84680605,0.00334889,0.03988657,0.0006372485,0.000028663346,0.00020351648,0.000024824281,0.02919478],"genre_scores_gemma":[0.36638594,0.6241803,0.0017311169,0.003569343,0.002254037,0.000025990637,0.00015165965,0.000021067417,0.0016805448],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9962017,0.0019017354,0.00038003904,0.0003786468,0.0009532025,0.00018467063],"domain_scores_gemma":[0.9387779,0.05308763,0.0049234503,0.0006409939,0.002231786,0.00033825357],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005932073,0.00033338714,0.0011831868,0.005063483,0.00070580235,0.0030293625,0.0010555907,0.0017186865,0.0033155032],"category_scores_gemma":[0.02252128,0.00034153086,0.0009999445,0.0065852627,0.0016493377,0.0018346703,0.0011213004,0.0018412381,0.00045001454],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00072503765,0.00064427295,0.154296,0.021175252,0.002425259,0.0013164444,0.0031826845,0.005333146,0.0013331071,0.17936969,0.01093117,0.61926794],"study_design_scores_gemma":[0.0001352002,0.0011374424,0.5401409,0.051619045,0.0054823784,0.0028942416,0.012376673,0.009089014,0.0059578484,0.13443032,0.2364689,0.00026807864],"about_ca_topic_score_codex":0.006344658,"about_ca_topic_score_gemma":0.006799177,"teacher_disagreement_score":0.006344658,"about_ca_system_score_codex":0.0024426489,"about_ca_system_score_gemma":0.002453538,"threshold_uncertainty_score":0.03137219},"labels":[],"label_agreement":null},{"id":"W2097027506","doi":"10.1002/1097-0258(20000730)19:14<1849::aid-sim506>3.0.co;2-1","title":"Estimating treatment effects in randomized clinical trials in the presence of non-compliance","year":2000,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":159,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Universiteit Leiden","keywords":"Confounding; Randomization; Randomized controlled trial; Outcome (game theory); Clinical trial; Medicine; Placebo; Estimator; Statistics; Instrumental variable; Causal inference; Econometrics; Internal medicine; Mathematics","score_opus":0.28974091353382553,"score_gpt":0.5720931192616544,"score_spread":0.2823522057278289,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2097027506","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008835229,0.012252669,0.968828,0.0032339583,0.0008413474,0.0038735308,0.00035655257,0.00043881044,0.0013399214],"genre_scores_gemma":[0.22968785,0.007883799,0.7375632,0.0033997083,0.0011301116,0.018172627,0.0007097764,0.00016056298,0.0012923252],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.29246777,0.66639924,0.018153146,0.009995091,0.011806282,0.0011784156],"domain_scores_gemma":[0.15420438,0.80438566,0.023548776,0.014657194,0.002617696,0.00058625307],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.46716672,0.0040790155,0.01291666,0.0075416393,0.0013071134,0.0062311734,0.005770726,0.011145333,0.0043017524],"category_scores_gemma":[0.7364189,0.003865177,0.010118636,0.008388656,0.009720949,0.008364313,0.005010463,0.009223339,0.0010201372],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009097969,0.0007565379,0.018481435,0.024998214,0.027722666,0.0017028404,0.0024193702,0.18664436,0.0011695323,0.41532207,0.0063449885,0.30533996],"study_design_scores_gemma":[0.0045931824,0.002670834,0.0031925966,0.002905105,0.005243473,0.0005121393,0.0001967368,0.16590329,0.0013341713,0.80432224,0.008910054,0.0002161842],"about_ca_topic_score_codex":0.0020743595,"about_ca_topic_score_gemma":0.0013228984,"teacher_disagreement_score":0.5328333,"about_ca_system_score_codex":0.0046092924,"about_ca_system_score_gemma":0.007826042,"threshold_uncertainty_score":0.6570783},"labels":[],"label_agreement":null},{"id":"W2097413632","doi":"10.1093/aje/kws127","title":"\"Toward a Clearer Definition of Confounding\" Revisited With Directed Acyclic Graphs","year":2012,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":142,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Environmental Health Sciences; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Directed acyclic graph; Confounding; Medicine; Computer science; Mathematics; Combinatorics; Statistics","score_opus":0.22031216098194287,"score_gpt":0.4361126226322491,"score_spread":0.21580046165030622,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2097413632","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028972365,0.02032838,0.9135905,0.053646255,0.002100262,0.00010462115,0.0003337217,0.00013379705,0.0068652807],"genre_scores_gemma":[0.18769419,0.03008764,0.7244134,0.044020146,0.0071338257,0.0010080283,0.00041189077,0.0003367344,0.0048941146],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94913125,0.039875723,0.0018531292,0.0048557264,0.0036446282,0.0006395393],"domain_scores_gemma":[0.85437334,0.12891746,0.0043955,0.006946137,0.004397387,0.0009702048],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.060435027,0.0027840608,0.0030752677,0.009173544,0.00309989,0.007105617,0.0053505064,0.007191779,0.0032291077],"category_scores_gemma":[0.09562354,0.002035928,0.0041205604,0.011170428,0.035310555,0.027283981,0.007225943,0.020585965,0.0006426984],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010591783,0.0000052697515,0.0002493334,0.00007970291,0.000026682268,0.000036707508,0.0002453782,0.0010861072,0.000022234353,0.99241954,0.0012251752,0.00459317],"study_design_scores_gemma":[0.000014640303,0.000008635407,0.00008261771,0.00009237359,0.00001552591,0.000053137795,0.000049942384,0.0025070207,0.000029922525,0.9869234,0.01020944,0.000013440016],"about_ca_topic_score_codex":0.008806346,"about_ca_topic_score_gemma":0.005204969,"teacher_disagreement_score":0.93956494,"about_ca_system_score_codex":0.007153988,"about_ca_system_score_gemma":0.004076014,"threshold_uncertainty_score":0.31961477},"labels":[],"label_agreement":null},{"id":"W2097814090","doi":"","title":"Estimation of Dose-Response Functions for Longitudinal Data","year":2007,"lang":"en","type":"article","venue":"Collection of Biostatistics Research Archive","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Propensity score matching; Statistics; Estimation; Confounding; Regression; Global Positioning System; Generalization; Longitudinal study; Binary data; Mathematics; Regression analysis; Computer science; Econometrics; Medicine; Binary number","score_opus":0.4378421577236633,"score_gpt":0.5507619228625688,"score_spread":0.11291976513890545,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2097814090","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022202875,0.0014555065,0.97210556,0.001313158,0.00009764258,0.0008617848,0.00076172734,0.00055899203,0.00064283534],"genre_scores_gemma":[0.41699833,0.0036770834,0.56049377,0.0015846553,0.00029647624,0.009062377,0.002793448,0.0002942184,0.00479966],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.87641966,0.11222686,0.0019898254,0.0057796515,0.002692927,0.0008909987],"domain_scores_gemma":[0.6251821,0.33323264,0.016150473,0.021841457,0.0029166988,0.0006766966],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17700033,0.0024574238,0.004684078,0.007228294,0.0012914767,0.0026067968,0.0044858926,0.0059460024,0.006832434],"category_scores_gemma":[0.29642102,0.0018901016,0.005615958,0.005523125,0.0042431667,0.0047509167,0.0047011757,0.005649597,0.0013692909],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018283533,0.0007466474,0.095083654,0.0024912136,0.00851639,0.0011868497,0.0022772383,0.30619988,0.0015665954,0.3559998,0.006655313,0.21744823],"study_design_scores_gemma":[0.00056709925,0.0009768986,0.015838815,0.0005167924,0.0010975384,0.0005733752,0.0004102071,0.60518265,0.0010814628,0.364889,0.008689371,0.00017674753],"about_ca_topic_score_codex":0.0030423095,"about_ca_topic_score_gemma":0.0016696723,"teacher_disagreement_score":0.17700033,"about_ca_system_score_codex":0.0031773536,"about_ca_system_score_gemma":0.0022442567,"threshold_uncertainty_score":0.9360784},"labels":[],"label_agreement":null},{"id":"W2098643226","doi":"10.1177/0272989x15598540","title":"The CREATE Method for Expressing Continuous Outcome Data in Absolute Terms for Use in Patient Treatment Decision Aids","year":2015,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; Montreal Heart Institute; McMaster University; University of Toronto; University Health Network","funders":"","keywords":"Absolute risk reduction; Outcome (game theory); Statistics; Kurtosis; Computer science; Medicine; Mathematics; Confidence interval","score_opus":0.4356436343332973,"score_gpt":0.5447473935557257,"score_spread":0.10910375922242838,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2098643226","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017957914,0.00025574642,0.98696995,0.00077391346,0.00037374915,0.0006511619,0.0025288556,0.003623092,0.0030277304],"genre_scores_gemma":[0.033864424,0.00036892094,0.954245,0.0008111684,0.00023954595,0.005570832,0.0018826481,0.0012532759,0.0017642077],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9091096,0.069281295,0.007105409,0.0031853102,0.010801832,0.00051640323],"domain_scores_gemma":[0.6483726,0.30455247,0.0149702225,0.019572228,0.011751341,0.00078120275],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06525844,0.0020933214,0.0018844554,0.006610137,0.0008221732,0.0056155478,0.0026172602,0.0023001528,0.042977225],"category_scores_gemma":[0.3460059,0.001486856,0.0035477914,0.0052505266,0.0022402091,0.0039024,0.004532789,0.0056063323,0.009111769],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014056796,0.00036249324,0.009989112,0.0032580288,0.0011665914,0.00035872817,0.0024188156,0.026313901,0.001908367,0.19737658,0.10368231,0.6517594],"study_design_scores_gemma":[0.0015168532,0.001346628,0.00841574,0.002681826,0.00074531767,0.0025878446,0.0009697187,0.2862405,0.012029517,0.38724387,0.2954137,0.0008085753],"about_ca_topic_score_codex":0.0010255597,"about_ca_topic_score_gemma":0.0012282494,"teacher_disagreement_score":0.93474156,"about_ca_system_score_codex":0.0013776841,"about_ca_system_score_gemma":0.0050466782,"threshold_uncertainty_score":0.34512377},"labels":[],"label_agreement":null},{"id":"W2102334823","doi":"10.1093/aje/kwt215","title":"Causal Inference in Occupational Epidemiology: Accounting for the Healthy Worker Effect by Using Structural Nested Models","year":2013,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Cancer Institute","keywords":"Causal inference; Inference; Occupational exposure; Epidemiology; Medicine; Occupational medicine; Econometrics; Environmental health; Computer science; Mathematics; Internal medicine; Artificial intelligence","score_opus":0.2635172900198451,"score_gpt":0.4950818798051624,"score_spread":0.2315645897853173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2102334823","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017970423,0.007978431,0.5675432,0.4125667,0.0058418224,0.000060058082,0.0002886791,0.00022620293,0.003697879],"genre_scores_gemma":[0.14259155,0.021211963,0.5950105,0.19995655,0.033647824,0.0008308722,0.000320167,0.00040115544,0.00602939],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96129936,0.031933233,0.0012184563,0.0021549873,0.0031400693,0.00025386107],"domain_scores_gemma":[0.67142683,0.30867863,0.0044929218,0.009541282,0.0053739427,0.00048650047],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051547397,0.0007848443,0.0010740524,0.0022827098,0.0015156448,0.0025638188,0.003028873,0.009505155,0.0036645026],"category_scores_gemma":[0.31021222,0.00079627836,0.002276842,0.002286145,0.00637547,0.0067719156,0.0024559048,0.015676733,0.0014031056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000094456336,0.00005624309,0.004217494,0.00069163827,0.00028718368,0.0008185339,0.00087241194,0.010964592,0.0001627825,0.6975191,0.12087207,0.16344348],"study_design_scores_gemma":[0.00004093415,0.000016308806,0.00033377297,0.0002239865,0.00003352703,0.0004004653,0.000055845652,0.016750477,0.00008822715,0.94603395,0.035998948,0.000023500543],"about_ca_topic_score_codex":0.0065105055,"about_ca_topic_score_gemma":0.008569205,"teacher_disagreement_score":0.051547397,"about_ca_system_score_codex":0.0030461242,"about_ca_system_score_gemma":0.0029191414,"threshold_uncertainty_score":0.27261192},"labels":[],"label_agreement":null},{"id":"W2102520493","doi":"10.1002/sim.2328","title":"A comparison of propensity score methods: a case‐study estimating the effectiveness of post‐AMI statin use","year":2005,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":565,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Statin; Statistics; Medicine; Internal medicine; Computer science; Mathematics","score_opus":0.31956570844757465,"score_gpt":0.5520056064708857,"score_spread":0.23243989802331105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2102520493","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6975621,0.0377024,0.24866512,0.005035453,0.0010272039,0.0038723464,0.0014047244,0.00017060655,0.0045599616],"genre_scores_gemma":[0.93658614,0.004597637,0.055002306,0.0003704702,0.0002762365,0.0020230748,0.00049367937,0.00004849537,0.0006019714],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7997295,0.18372197,0.0059872465,0.0035064,0.0062885564,0.00076621916],"domain_scores_gemma":[0.5786208,0.38148198,0.014774143,0.01982217,0.004505003,0.00079589646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16027315,0.0013869968,0.0029620416,0.0039393306,0.0009784806,0.0025346568,0.0025756927,0.004596793,0.0041961144],"category_scores_gemma":[0.31711867,0.0011565369,0.007926463,0.0028993094,0.0021425162,0.0027391997,0.0025308717,0.0020612099,0.00043433707],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.12084996,0.0068618553,0.31445304,0.006946105,0.07888829,0.0022134779,0.0024510033,0.06738662,0.00223261,0.07985225,0.005979885,0.31188497],"study_design_scores_gemma":[0.04950507,0.05221142,0.1831572,0.003986435,0.06093164,0.0064549493,0.0034745326,0.5229113,0.005480115,0.090080224,0.0206837,0.0011235134],"about_ca_topic_score_codex":0.002435663,"about_ca_topic_score_gemma":0.0013692948,"teacher_disagreement_score":0.16027315,"about_ca_system_score_codex":0.0017199396,"about_ca_system_score_gemma":0.0017386375,"threshold_uncertainty_score":0.84761554},"labels":[],"label_agreement":null},{"id":"W2102880415","doi":"10.1093/ije/dyu107","title":"Mediation misgivings: ambiguous clinical and public health interpretations of natural direct and indirect effects","year":2014,"lang":"en","type":"review","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":92,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Causal inference; Public health; Independence (probability theory); Inference; Ambiguity; Natural (archaeology); Mediation; Identifiability; Object (grammar); Notation; Population; Epistemology; Econometrics; Psychology; Medicine; Computer science; Sociology; Mathematics; Statistics; Social science; Environmental health; Artificial intelligence; Geography","score_opus":0.32729662388970787,"score_gpt":0.5706358608900225,"score_spread":0.24333923700031462,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2102880415","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00041492074,0.9645492,0.018793633,0.01256596,0.0009540488,0.00003175014,0.000055977456,0.000028443412,0.0026060725],"genre_scores_gemma":[0.025249075,0.948522,0.015073705,0.0073569175,0.00250394,0.00019510758,0.000083866726,0.000038245173,0.0009770592],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9660663,0.025156023,0.0020165022,0.002125982,0.0043330425,0.00030213574],"domain_scores_gemma":[0.8363869,0.15267368,0.0037392443,0.0039312937,0.002893192,0.00037566418],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.051122043,0.0015516802,0.0034819248,0.0045562475,0.0008339865,0.004613164,0.0047808294,0.0045246845,0.00394545],"category_scores_gemma":[0.10816651,0.0008617714,0.0025410203,0.0052613867,0.013397879,0.007216259,0.0033543238,0.0074294377,0.001025166],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013621757,0.000040729527,0.0007582999,0.023579173,0.001206026,0.00034919172,0.0013759994,0.0012033002,0.0002080728,0.48083386,0.012076937,0.47823218],"study_design_scores_gemma":[0.00008201669,0.000094151765,0.0013862087,0.025288146,0.00097590307,0.0020102805,0.0010638378,0.00094008254,0.00073574064,0.7407501,0.22657649,0.00009714788],"about_ca_topic_score_codex":0.0014572359,"about_ca_topic_score_gemma":0.0016552545,"teacher_disagreement_score":0.94887793,"about_ca_system_score_codex":0.0024418507,"about_ca_system_score_gemma":0.005133227,"threshold_uncertainty_score":0.27036244},"labels":[],"label_agreement":null},{"id":"W2103171295","doi":"10.3390/ijerph120809391","title":"Model Averaging for Improving Inference from Causal Diagrams","year":2015,"lang":"en","type":"article","venue":"International Journal of Environmental Research and Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Center for Research Resources; National Institute of Child Health and Human Development; National Cancer Institute; March of Dimes Foundation; University of North Carolina at Chapel Hill; Canada Research Chairs; Centers for Disease Control and Prevention; National Institute of Diabetes and Digestive and Kidney Diseases; Electric Power Research Institute","keywords":"Causal inference; Spurious relationship; Weighting; Model selection; Computer science; A priori and a posteriori; Bootstrapping (finance); Inference; Directed acyclic graph; Causal model; Variance (accounting); Econometrics; Selection (genetic algorithm); Statistics; Machine learning; Mathematics; Algorithm; Artificial intelligence; Medicine","score_opus":0.4529308440761285,"score_gpt":0.5176326384787479,"score_spread":0.06470179440261936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2103171295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008193408,0.00042450853,0.9979417,0.00016015032,0.000026990134,0.000037597376,0.00006137688,0.00023795245,0.00029038277],"genre_scores_gemma":[0.04617235,0.001103852,0.9511495,0.00017607107,0.00014587634,0.00033962936,0.0003462817,0.00019206453,0.0003743875],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.959133,0.03146879,0.001909237,0.0030410117,0.004076756,0.0003713031],"domain_scores_gemma":[0.7982719,0.18071853,0.004764837,0.011664749,0.004025749,0.00055433926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0514475,0.002626495,0.0030506195,0.0084813805,0.0015662928,0.0032306411,0.0036757349,0.0020396807,0.0042786086],"category_scores_gemma":[0.22572173,0.0018256189,0.0047663813,0.006588196,0.002679697,0.005939183,0.0048522525,0.00537961,0.00082328374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015839534,0.000105203166,0.0045258584,0.0011914325,0.0013209216,0.0002900324,0.0008061535,0.28294614,0.0015909501,0.4159389,0.0036758808,0.2874502],"study_design_scores_gemma":[0.000038363163,0.00006924105,0.0004935024,0.00013430679,0.00018726596,0.000077900084,0.00004695331,0.43232164,0.000979514,0.5596905,0.0059229555,0.000037896596],"about_ca_topic_score_codex":0.005941255,"about_ca_topic_score_gemma":0.00565891,"teacher_disagreement_score":0.0514475,"about_ca_system_score_codex":0.0022247117,"about_ca_system_score_gemma":0.0034275544,"threshold_uncertainty_score":0.27208364},"labels":[],"label_agreement":null},{"id":"W2103371988","doi":"10.1002/sim.5705","title":"The performance of different propensity score methods for estimating marginal hazard ratios","year":2012,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":995,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Work & Health; Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Odds ratio; Estimator; Matching (statistics); Medicine; Mathematics","score_opus":0.22020753118718697,"score_gpt":0.4904911441960751,"score_spread":0.27028361300888815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2103371988","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01159006,0.0024820564,0.982255,0.00056120637,0.00014961678,0.00073941465,0.0005586121,0.0005693061,0.0010946308],"genre_scores_gemma":[0.14935502,0.003587149,0.8403804,0.0004836649,0.0002539513,0.0024482338,0.0017602328,0.00059194735,0.0011394751],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9445329,0.0427882,0.0035351135,0.0037981137,0.0048376773,0.00050803693],"domain_scores_gemma":[0.8561339,0.113713674,0.00880006,0.012644682,0.008081779,0.0006259437],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08822343,0.0021359937,0.0026043802,0.006001812,0.0010824611,0.0032505195,0.003723077,0.0019756246,0.0049142726],"category_scores_gemma":[0.25330463,0.0012780768,0.0054498767,0.0072197267,0.0017110875,0.0040718545,0.0029290218,0.003688971,0.0011512208],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012503407,0.00030038226,0.061745383,0.0020094574,0.006442712,0.00027854647,0.001276182,0.20269658,0.0014115591,0.109685615,0.010446728,0.60245657],"study_design_scores_gemma":[0.00076576904,0.00059238414,0.026055261,0.0010103391,0.0015148267,0.000585917,0.0003417928,0.788509,0.003236327,0.15512212,0.021806056,0.00046029844],"about_ca_topic_score_codex":0.008023952,"about_ca_topic_score_gemma":0.006251296,"teacher_disagreement_score":0.91177654,"about_ca_system_score_codex":0.0019360386,"about_ca_system_score_gemma":0.0034830058,"threshold_uncertainty_score":0.46657568},"labels":[],"label_agreement":null},{"id":"W2104419597","doi":"10.1016/j.jclinepi.2006.06.012","title":"Triggered sampling could help improve longitudinal studies of persons with elevated mortality risk","year":2006,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute on Aging","keywords":"Sampling (signal processing); Medicine; Longitudinal study; Longitudinal data; Environmental health; Demography; Statistics; Gerontology; Mathematics; Computer science; Pathology","score_opus":0.6790793147285508,"score_gpt":0.6119558115004203,"score_spread":0.06712350322813043,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2104419597","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09522993,0.0007404765,0.8965747,0.0023044026,0.00063341024,0.00082937896,0.0013766105,0.00065973,0.0016514017],"genre_scores_gemma":[0.6549662,0.0007606174,0.3348405,0.0020095254,0.0005961549,0.0024249547,0.0021695578,0.00014833223,0.00208422],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9827024,0.014334545,0.0005612011,0.0014310715,0.00071084814,0.00025992235],"domain_scores_gemma":[0.9144223,0.05980877,0.0049899146,0.016935091,0.0027400295,0.0011039344],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.044769768,0.0011829614,0.0015265107,0.0016446015,0.0010939456,0.0014373556,0.00276847,0.0022415356,0.006525185],"category_scores_gemma":[0.15657613,0.0011099771,0.0017342485,0.0020297717,0.00065654423,0.0028233659,0.0024067974,0.002330087,0.0008219614],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0070496392,0.0030003227,0.4337913,0.0011674397,0.0027694267,0.0018566676,0.002465909,0.050648358,0.011100886,0.10922611,0.017353805,0.3595701],"study_design_scores_gemma":[0.0025353625,0.0032468857,0.10142436,0.00033954898,0.0017049863,0.0018980423,0.0007112512,0.26142263,0.009001821,0.60454863,0.012965924,0.00020055582],"about_ca_topic_score_codex":0.0018340129,"about_ca_topic_score_gemma":0.0026918973,"teacher_disagreement_score":0.95523024,"about_ca_system_score_codex":0.00064312055,"about_ca_system_score_gemma":0.0022237857,"threshold_uncertainty_score":0.23676795},"labels":[],"label_agreement":null},{"id":"W2104878768","doi":"10.1002/pds.817","title":"Bringing epidemiology into drug utilisation research","year":2003,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hôtel-Dieu de Montréal; Université de Montréal","funders":"","keywords":"Medicine; Research centre; Library science; Population; Family medicine","score_opus":0.38318131780470827,"score_gpt":0.5487537221390125,"score_spread":0.16557240433430426,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2104878768","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010383772,0.049424075,0.826682,0.10148869,0.0022399235,0.000057592817,0.00033184918,0.00028990064,0.009102194],"genre_scores_gemma":[0.4915688,0.08938183,0.37530786,0.016023789,0.014505598,0.00046316747,0.00039681056,0.0002198166,0.012132282],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99201113,0.006009321,0.0003799312,0.0005364939,0.0009005196,0.00016256717],"domain_scores_gemma":[0.83851105,0.14889126,0.003922602,0.004774835,0.002867543,0.0010327724],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014154456,0.00092258665,0.0018911067,0.005854111,0.000894058,0.003939778,0.0015937961,0.0032238,0.0072977706],"category_scores_gemma":[0.08094295,0.001167841,0.0013576412,0.0036694412,0.006187296,0.012262939,0.004989345,0.0072405604,0.00071081024],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000031804255,0.00008598982,0.0036379818,0.0005105398,0.00026560517,0.00014539673,0.00034462943,0.0091288155,0.00021025148,0.9116389,0.0051644626,0.06883556],"study_design_scores_gemma":[0.000011420913,0.000008243437,0.0003697129,0.00006808194,0.000022591723,0.000029372186,0.00005946175,0.0032077548,0.00005580207,0.9900153,0.006145567,0.000006570837],"about_ca_topic_score_codex":0.0023126935,"about_ca_topic_score_gemma":0.001771485,"teacher_disagreement_score":0.014154456,"about_ca_system_score_codex":0.0017696418,"about_ca_system_score_gemma":0.0035678567,"threshold_uncertainty_score":0.07485676},"labels":[],"label_agreement":null},{"id":"W2106121516","doi":"10.1177/1740774513504151","title":"Beyond intention to treat: What is the right question?","year":2013,"lang":"en","type":"review","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Randomized controlled trial; Causal inference; Medicine; Terminology; Treatment effect; Treatment and control groups; Population; Protocol (science); Instrumental variable; Psychology; Alternative medicine; Statistics; Mathematics; Surgery; Internal medicine","score_opus":0.7023504462850969,"score_gpt":0.6546002616242445,"score_spread":0.04775018466085246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2106121516","genre_codex":"commentary","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001364286,0.2407482,0.23008427,0.44886428,0.062068038,0.0074718758,0.0014910626,0.00059942296,0.007308629],"genre_scores_gemma":[0.06896425,0.10263465,0.4168229,0.29085442,0.05857201,0.05765643,0.0010186413,0.0014540494,0.002022656],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.16651885,0.73694885,0.03997251,0.0107546,0.04452841,0.001276697],"domain_scores_gemma":[0.0719285,0.8679406,0.019430954,0.016063401,0.023114992,0.0015215995],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.63129765,0.0031041706,0.015343584,0.0078079877,0.0036160594,0.015164495,0.009038481,0.022432137,0.00705251],"category_scores_gemma":[0.82067794,0.002022723,0.007964915,0.01324383,0.032654256,0.021355016,0.004290756,0.036002655,0.004269049],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027275435,0.0003688102,0.002611342,0.1225825,0.0074936883,0.00030431995,0.008009333,0.0018802207,0.0004404566,0.24958467,0.17851289,0.42548433],"study_design_scores_gemma":[0.0015129178,0.00083117775,0.0016787641,0.16649112,0.0026927448,0.00042981462,0.0017413478,0.007773235,0.0010007161,0.59438324,0.22102976,0.0004352149],"about_ca_topic_score_codex":0.00255361,"about_ca_topic_score_gemma":0.0011499866,"teacher_disagreement_score":0.36870235,"about_ca_system_score_codex":0.01498606,"about_ca_system_score_gemma":0.025118425,"threshold_uncertainty_score":0.45467567},"labels":[],"label_agreement":null},{"id":"W2106436016","doi":"10.1007/s00038-010-0184-x","title":"Using Directed Acyclic Graphs to detect limitations of traditional regression in longitudinal studies","year":2010,"lang":"en","type":"article","venue":"International Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Confounding; Mediation; Regression; Longitudinal data; Longitudinal study; Econometrics; Statistics; Directed acyclic graph; Regression analysis; Computer science; Mathematics; Data mining; Algorithm; Sociology","score_opus":0.7059062973471197,"score_gpt":0.5424706144778019,"score_spread":0.16343568286931787,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2106436016","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08411619,0.0022039933,0.9095117,0.00076221017,0.00014632865,0.00024450672,0.0012277656,0.0011132685,0.0006740702],"genre_scores_gemma":[0.6955621,0.0009387983,0.30026245,0.00039404238,0.00016693797,0.0005789817,0.0014251203,0.00015529466,0.00051627925],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9691572,0.025709137,0.0011065376,0.0026153955,0.0011162373,0.00029547658],"domain_scores_gemma":[0.32821554,0.64325345,0.0106427,0.014042454,0.003082172,0.00076371507],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05886178,0.0011909287,0.0014452258,0.0059219673,0.0010024719,0.0020125648,0.0027708313,0.0020265875,0.00182708],"category_scores_gemma":[0.28988826,0.0011218382,0.0017362011,0.0041791927,0.001726317,0.0036615906,0.0016935752,0.0026333167,0.00021106069],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022850628,0.0007367938,0.3527536,0.0020697895,0.007862981,0.0015483205,0.001448087,0.19006112,0.002707458,0.10930292,0.0060897414,0.32313415],"study_design_scores_gemma":[0.00036010004,0.0003174101,0.016549077,0.00024159194,0.0018224703,0.00044258058,0.0002485656,0.6235923,0.0017521838,0.3505872,0.004021402,0.00006513419],"about_ca_topic_score_codex":0.0056371544,"about_ca_topic_score_gemma":0.006508483,"teacher_disagreement_score":0.05886178,"about_ca_system_score_codex":0.00090234954,"about_ca_system_score_gemma":0.0020459,"threshold_uncertainty_score":0.31129456},"labels":[],"label_agreement":null},{"id":"W2107843102","doi":"10.1378/chest.12-1920","title":"The Pros and Cons of Propensity Scores","year":2012,"lang":"en","type":"article","venue":"CHEST Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":84,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; McMaster University; University of Toronto","funders":"","keywords":"cons; Propensity score matching; Psychology; Data science; Computer science; Statistics; Mathematics","score_opus":0.35258928646648297,"score_gpt":0.4242491405310891,"score_spread":0.07165985406460612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2107843102","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027676478,0.006276932,0.9337876,0.020661758,0.00056871027,0.00018422268,0.00048299885,0.00036931707,0.009992],"genre_scores_gemma":[0.6092314,0.008373413,0.36624214,0.005349997,0.003822566,0.000806027,0.0004988091,0.000339976,0.005335681],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93078536,0.060205176,0.0014498568,0.0027675275,0.0042587924,0.00053329597],"domain_scores_gemma":[0.5616542,0.40457416,0.00823057,0.019163381,0.0047111427,0.0016665594],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.077136345,0.0012513745,0.0025329022,0.0041340995,0.0014287416,0.0056921137,0.00317826,0.0039271093,0.0074481117],"category_scores_gemma":[0.29959267,0.0009920709,0.0016976036,0.005777367,0.0079176035,0.011642668,0.005915641,0.0060159266,0.00097432086],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026193383,0.0000735959,0.0065462296,0.0002683524,0.00033219188,0.00006277341,0.0003142226,0.010088829,0.00007540069,0.8682509,0.0038360073,0.10988961],"study_design_scores_gemma":[0.00009148608,0.00006820449,0.0010094121,0.00009918349,0.00009951159,0.000068421694,0.00007169273,0.038926754,0.00009376677,0.95669085,0.0027545532,0.000026229427],"about_ca_topic_score_codex":0.0015931467,"about_ca_topic_score_gemma":0.0016314805,"teacher_disagreement_score":0.92286366,"about_ca_system_score_codex":0.0009564798,"about_ca_system_score_gemma":0.002145251,"threshold_uncertainty_score":0.40794086},"labels":[],"label_agreement":null},{"id":"W2109203991","doi":"10.1161/circoutcomes.114.001023","title":"Impact of Drug Policy on Regional Trends in Ezetimibe Use","year":2014,"lang":"en","type":"article","venue":"Circulation Cardiovascular Quality and Outcomes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Health Sciences Centre; University Health Network; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Heart, Lung, and Blood Institute; National Institute on Aging; Canadian Institutes of Health Research; Health Canada","keywords":"Ezetimibe; Formulary; Restrictiveness; Population; Medicine; Demography; Geography; Environmental health; Family medicine","score_opus":0.2536716822313487,"score_gpt":0.4643739662308443,"score_spread":0.2107022839994956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2109203991","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9720643,0.0041230856,0.0006455926,0.005277829,0.00004501825,0.000049870738,0.00951219,0.000039612132,0.008242571],"genre_scores_gemma":[0.997136,0.00082720234,0.00027164404,0.00026268873,0.0000162423,0.000012592283,0.0010660634,0.000009970402,0.00039754057],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.997505,0.0006447034,0.00019244432,0.0004529255,0.00054950686,0.0006554576],"domain_scores_gemma":[0.9895169,0.0016186818,0.0044646803,0.00046520995,0.0030057833,0.00092878554],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020827777,0.00018692082,0.000347366,0.0011340248,0.0006607755,0.0015246258,0.0007674883,0.00038982957,0.0021658598],"category_scores_gemma":[0.011172082,0.00020152499,0.00079230504,0.0027129578,0.00067185704,0.00056097057,0.00074709684,0.00082620647,0.0002621618],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019296134,0.000021556787,0.99026287,0.000065091575,0.0001695453,0.000109505294,0.0002551412,0.0010666623,0.00021348121,0.0004102415,0.001357026,0.005875985],"study_design_scores_gemma":[0.0000048664588,0.000017037184,0.99798393,0.000029192655,0.000036798036,0.00005045583,0.0002719974,0.00035447435,0.00007898579,0.000036289985,0.001129697,0.0000062329145],"about_ca_topic_score_codex":0.8732829,"about_ca_topic_score_gemma":0.8881062,"teacher_disagreement_score":0.8732829,"about_ca_system_score_codex":0.0099035,"about_ca_system_score_gemma":0.010496869,"threshold_uncertainty_score":0.25492668},"labels":[],"label_agreement":null},{"id":"W2110219473","doi":"10.1186/1745-6215-15-377","title":"Accounting for center in the Early External Cephalic Version trials: an empirical comparison of statistical methods to adjust for center in a multicenter trial with binary outcomes","year":2014,"lang":"en","type":"article","venue":"Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; McMaster University","funders":"Canadian Institutes of Health Research","keywords":"Center (category theory); Medicine; Medical physics; Clinical trial; Statistics; Internal medicine; Mathematics","score_opus":0.5515340864068206,"score_gpt":0.6247378332791531,"score_spread":0.07320374687233255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2110219473","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10762734,0.04946284,0.78345567,0.0053659026,0.004227732,0.041217443,0.0018740696,0.0020269486,0.0047419704],"genre_scores_gemma":[0.53576225,0.0038741126,0.3796813,0.002508251,0.0007828554,0.074822605,0.0007481123,0.00081714854,0.0010033492],"study_design_codex":"meta_analysis","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.21687452,0.72388685,0.030489014,0.012455184,0.014799434,0.0014950661],"domain_scores_gemma":[0.10310464,0.7943193,0.05111825,0.04161006,0.008730846,0.0011169486],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.57843214,0.0036569873,0.009679272,0.005566318,0.001496003,0.004810207,0.00657754,0.0062020095,0.007005384],"category_scores_gemma":[0.75819385,0.0018598214,0.028754752,0.008441156,0.00538934,0.007734349,0.0062670805,0.008448654,0.0008961688],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1373968,0.002249946,0.099842176,0.03564466,0.32918447,0.0006138434,0.006123948,0.028947568,0.0017315643,0.044427842,0.011421276,0.3024159],"study_design_scores_gemma":[0.09661955,0.056989506,0.0836593,0.023515778,0.21883158,0.0012523906,0.0024732894,0.3104697,0.008536655,0.15685058,0.039170202,0.0016315586],"about_ca_topic_score_codex":0.0015154803,"about_ca_topic_score_gemma":0.0011078353,"teacher_disagreement_score":0.42156786,"about_ca_system_score_codex":0.004173513,"about_ca_system_score_gemma":0.006201295,"threshold_uncertainty_score":0.51986825},"labels":[],"label_agreement":null},{"id":"W2110425652","doi":"10.1111/j.1537-2995.2011.03324.x","title":"Causal inference in nonrandomized studies via propensity score methods","year":2011,"lang":"en","type":"review","venue":"Transfusion","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Citation; Statistics; Library science; Medicine; Mathematics; Computer science","score_opus":0.6001654820672533,"score_gpt":0.5487720596401654,"score_spread":0.05139342242708789,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2110425652","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006186742,0.84082866,0.15422237,0.0023952117,0.0003948225,0.00011503971,0.00023418955,0.00014159412,0.001049335],"genre_scores_gemma":[0.026535572,0.8805685,0.08766537,0.0012979159,0.002012298,0.0003908005,0.00034327433,0.000074716896,0.0011115402],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98316956,0.012991694,0.0010998743,0.0009741754,0.0016465673,0.000118147866],"domain_scores_gemma":[0.88772315,0.10536132,0.0028530925,0.0021955825,0.0016897309,0.00017717053],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031005573,0.0018209654,0.00601502,0.0037394313,0.00040118225,0.0020714584,0.00343008,0.0025558104,0.0055679576],"category_scores_gemma":[0.087469004,0.0009873012,0.004284685,0.004959538,0.0020859991,0.002543522,0.0014465263,0.0044725165,0.0009787752],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021903277,0.00012207936,0.0016266309,0.03487236,0.00576531,0.00015025616,0.00011742319,0.0126708485,0.0001754093,0.07536102,0.01117236,0.85774726],"study_design_scores_gemma":[0.00066020765,0.00033002955,0.00475161,0.028293157,0.009668453,0.0011972866,0.00013572871,0.037560664,0.0012408278,0.77558815,0.1403913,0.00018253674],"about_ca_topic_score_codex":0.0021769311,"about_ca_topic_score_gemma":0.002185022,"teacher_disagreement_score":0.96899444,"about_ca_system_score_codex":0.0011740945,"about_ca_system_score_gemma":0.0036523894,"threshold_uncertainty_score":0.16397512},"labels":[],"label_agreement":null},{"id":"W2110818436","doi":"10.1002/sim.6607","title":"Moving towards best practice when using inverse probability of treatment weighting (IPTW) using the propensity score to estimate causal treatment effects in observational studies","year":2015,"lang":"en","type":"review","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4309,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; National Institute of Mental Health; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Inverse probability weighting; Observational study; Inverse probability; Weighting; Average treatment effect; Statistics; Treatment and control groups; Econometrics; Sample size determination; Baseline (sea); Mathematics; Selection bias; Computer science; Posterior probability; Medicine; Bayesian probability","score_opus":0.6765608631638398,"score_gpt":0.5702584500397571,"score_spread":0.10630241312408273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2110818436","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011510972,0.011566644,0.9593448,0.024299862,0.0008635535,0.00033289206,0.00014521787,0.0001886445,0.0021072277],"genre_scores_gemma":[0.038703844,0.01061026,0.93793243,0.008251778,0.0014695745,0.0022595103,0.00017426923,0.0001940757,0.00040422703],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.5464783,0.39535573,0.020927593,0.012663006,0.023506425,0.0010689197],"domain_scores_gemma":[0.41138324,0.51226383,0.024449145,0.035749022,0.014978078,0.001176717],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3219493,0.0019577893,0.0045696697,0.009172669,0.001790489,0.010723759,0.007313782,0.0075355354,0.0028489665],"category_scores_gemma":[0.5747454,0.0020863882,0.0039077513,0.010450662,0.022694346,0.01663251,0.010227887,0.018560374,0.001250197],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009943253,0.00008329565,0.0029052375,0.0061633694,0.001226492,0.00017664388,0.0031357645,0.009738759,0.00032214788,0.7230092,0.010978963,0.24216083],"study_design_scores_gemma":[0.000079399935,0.00007738317,0.00053198554,0.0032035762,0.00013955709,0.0001094208,0.00023244694,0.008052526,0.00039390815,0.96894157,0.018168384,0.000069756825],"about_ca_topic_score_codex":0.0044023506,"about_ca_topic_score_gemma":0.003131632,"teacher_disagreement_score":0.6780507,"about_ca_system_score_codex":0.00563736,"about_ca_system_score_gemma":0.011039628,"threshold_uncertainty_score":0.8361572},"labels":[],"label_agreement":null},{"id":"W2111635289","doi":"10.1002/pst.433","title":"Optimal caliper widths for propensity‐score matching when estimating differences in means and differences in proportions in observational studies","year":2010,"lang":"en","type":"article","venue":"Pharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3895,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Calipers; Statistics; Estimator; Mathematics; Logit; Matching (statistics); Observational study; Econometrics; Standard deviation; Confidence interval; Logistic regression; Medicine","score_opus":0.5850172035475715,"score_gpt":0.5093227869028153,"score_spread":0.07569441664475618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2111635289","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002250815,0.0005286876,0.99541795,0.00027136042,0.00007565333,0.0003410179,0.00008470524,0.00024608904,0.0007836892],"genre_scores_gemma":[0.03348788,0.0004953936,0.9635423,0.00023668988,0.00010187675,0.0014498917,0.00016161289,0.00016032356,0.00036403758],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9359957,0.053232953,0.0027454912,0.0036741116,0.0038319442,0.0005197449],"domain_scores_gemma":[0.8081051,0.16614056,0.009309796,0.012038122,0.003731029,0.00067545235],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08407174,0.001653233,0.0021917901,0.003623212,0.0012450062,0.002821066,0.0031498307,0.00283857,0.0055735684],"category_scores_gemma":[0.35259444,0.0016904122,0.0024485327,0.004770826,0.0027041375,0.0046465937,0.003786211,0.0059000757,0.0013438899],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009411592,0.0002998363,0.008877102,0.0012399664,0.0005341051,0.00042425597,0.0010601606,0.13590644,0.002644177,0.495127,0.009719002,0.34322676],"study_design_scores_gemma":[0.000567504,0.00043505727,0.003966538,0.0007937132,0.00022062175,0.00040449735,0.00020577048,0.36192673,0.004012359,0.6027439,0.024579884,0.00014338098],"about_ca_topic_score_codex":0.0023298142,"about_ca_topic_score_gemma":0.002309705,"teacher_disagreement_score":0.91592824,"about_ca_system_score_codex":0.0017164839,"about_ca_system_score_gemma":0.0037810132,"threshold_uncertainty_score":0.44461918},"labels":[],"label_agreement":null},{"id":"W2111736598","doi":"10.1920/wp.cem.2013.6113","title":"Covariate selection and model averaging in semiparametric estimation of treatment effects","year":2013,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Economic and Social Research Council; Yale University","keywords":"Covariate; Semiparametric model; Selection (genetic algorithm); Econometrics; Estimation; Statistics; Semiparametric regression; Model selection; Mathematics; Computer science; Artificial intelligence; Parametric statistics; Economics","score_opus":0.12366938119572668,"score_gpt":0.40286961887864225,"score_spread":0.2792002376829156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2111736598","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004785674,0.00023662986,0.9943938,0.00015379746,0.000015961909,0.00005205971,0.00003103713,0.000093190574,0.00023781735],"genre_scores_gemma":[0.27253518,0.00086621806,0.72349805,0.00037809883,0.00017467298,0.00096023065,0.00021241073,0.00011589835,0.0012592956],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96993744,0.025989095,0.00061781984,0.001688858,0.0014788515,0.00028793953],"domain_scores_gemma":[0.9407205,0.049103875,0.0030935071,0.0055624857,0.0012858632,0.00023380689],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034560625,0.0011584228,0.0019467598,0.0016209625,0.00067448773,0.0012885408,0.0024579396,0.0020226086,0.0022767424],"category_scores_gemma":[0.10678586,0.00080834236,0.0020860725,0.0019955272,0.0027941773,0.0027053826,0.0022325602,0.0018251106,0.00036124946],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027523402,0.00019175049,0.006215519,0.00062111544,0.00092696096,0.00019994336,0.0007765743,0.25634384,0.0033817273,0.4947101,0.0016592493,0.23469812],"study_design_scores_gemma":[0.000093320945,0.0002974951,0.0026827573,0.000089142966,0.00016629054,0.00008803782,0.000047952097,0.56118286,0.0024964765,0.4299278,0.0028585282,0.00006929094],"about_ca_topic_score_codex":0.002060096,"about_ca_topic_score_gemma":0.0018585012,"teacher_disagreement_score":0.034560625,"about_ca_system_score_codex":0.0011602892,"about_ca_system_score_gemma":0.0018016608,"threshold_uncertainty_score":0.18277621},"labels":[],"label_agreement":null},{"id":"W2113489980","doi":"10.1177/0962280209340213","title":"Estimation of dose–response functions for longitudinal data using the generalised propensity score","year":2010,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Longitudinal data; Statistics; Estimation; Covariate; Econometrics; Mathematics; Computer science; Medicine; Data mining; Economics","score_opus":0.8340373806115695,"score_gpt":0.7034432853645637,"score_spread":0.13059409524700583,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2113489980","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017328456,0.0007771431,0.97942585,0.0006933663,0.00006986981,0.00054621045,0.0003836984,0.00031719927,0.0004581667],"genre_scores_gemma":[0.39834324,0.0026945532,0.5865023,0.0008345331,0.00022271465,0.0054217507,0.0017059002,0.00022877746,0.0040461496],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9268305,0.0654925,0.0013673434,0.0034004706,0.0022465505,0.00066263543],"domain_scores_gemma":[0.8366641,0.1392688,0.009462344,0.011758212,0.0022408615,0.0006057341],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10663662,0.0019603157,0.0041422625,0.0059022214,0.0007929115,0.0021599394,0.0031765697,0.0040635346,0.007206389],"category_scores_gemma":[0.1857062,0.001227069,0.005809551,0.005037363,0.003746851,0.0036327234,0.004559404,0.0042132908,0.0013040222],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00151635,0.00041853116,0.06311394,0.002022414,0.008152704,0.0011796908,0.0019542647,0.30965707,0.0018479665,0.36062688,0.0056213546,0.24388885],"study_design_scores_gemma":[0.0007911005,0.0012390523,0.019321417,0.00042431915,0.0011711181,0.00065741024,0.0003290644,0.52936894,0.00091736275,0.43711573,0.008463628,0.0002009222],"about_ca_topic_score_codex":0.002897821,"about_ca_topic_score_gemma":0.001796663,"teacher_disagreement_score":0.10663662,"about_ca_system_score_codex":0.0018577485,"about_ca_system_score_gemma":0.002283028,"threshold_uncertainty_score":0.56395507},"labels":[],"label_agreement":null},{"id":"W2115556810","doi":"10.1002/sim.6602","title":"Optimal full matching for survival outcomes: a method that merits more widespread use","year":2015,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; National Institute of Mental Health; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Matching (statistics); Computer science; Statistics; Survival analysis; Propensity score matching; Econometrics; Mathematics","score_opus":0.33550950521288825,"score_gpt":0.5206100027822268,"score_spread":0.18510049756933855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2115556810","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031386863,0.0005170628,0.99447495,0.0007597556,0.000049882063,0.0001312121,0.000069486596,0.00021686904,0.0006421075],"genre_scores_gemma":[0.11996162,0.0010078885,0.87577707,0.0007731022,0.0002688373,0.0006382907,0.00033513867,0.00019346384,0.0010446187],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9799875,0.014626402,0.0007781136,0.0018269477,0.0024996898,0.000281289],"domain_scores_gemma":[0.9493768,0.03707037,0.002627945,0.008395829,0.002106033,0.00042298323],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037296895,0.0008866053,0.0030719172,0.0029200325,0.0009354927,0.0018835436,0.002335986,0.0018868813,0.004646351],"category_scores_gemma":[0.119907856,0.0008743598,0.0024556874,0.0034841842,0.0021427607,0.004479817,0.0039888364,0.0028414151,0.0008914427],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051815953,0.00025459589,0.008028397,0.0006080171,0.00068386627,0.00013323591,0.00045507113,0.10409128,0.0011664206,0.25619632,0.008159012,0.6197057],"study_design_scores_gemma":[0.00027843504,0.00024449776,0.0028613282,0.00019482439,0.0001520443,0.0002707527,0.00008017912,0.45860323,0.0011211189,0.5235429,0.012561686,0.000088996574],"about_ca_topic_score_codex":0.0028551463,"about_ca_topic_score_gemma":0.0016902856,"teacher_disagreement_score":0.037296895,"about_ca_system_score_codex":0.0014027682,"about_ca_system_score_gemma":0.0044154283,"threshold_uncertainty_score":0.19724715},"labels":[],"label_agreement":null},{"id":"W2115685617","doi":"10.1093/aje/kwu276","title":"A Cautionary Note About Estimating Effects of Secondary Exposures in Cohort Studies","year":2015,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health","keywords":"Cohort; Cohort study; Medicine; Epidemiology; Statistics; Econometrics; Demography; Mathematics; Internal medicine","score_opus":0.1736686592204544,"score_gpt":0.4889863480783091,"score_spread":0.3153176888578547,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2115685617","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009467602,0.018372722,0.83466285,0.11454139,0.012315997,0.0010679434,0.001244094,0.0013102485,0.0070170746],"genre_scores_gemma":[0.15544726,0.006390987,0.74295795,0.077701464,0.00791203,0.002654515,0.0003270547,0.0007588145,0.0058499686],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6550379,0.29328898,0.020321552,0.012949564,0.01738451,0.0010175001],"domain_scores_gemma":[0.24343729,0.69553703,0.010962375,0.03367827,0.01530949,0.0010754605],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.38265336,0.0025366214,0.0041854046,0.0045571565,0.0035926637,0.006269831,0.009585525,0.0064926166,0.0034163098],"category_scores_gemma":[0.6731661,0.002032383,0.006787669,0.0052388865,0.011890935,0.008438554,0.0053692413,0.022131532,0.0014423014],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020504731,0.00024527297,0.043850027,0.011595498,0.009900426,0.005022565,0.016270868,0.023043545,0.0032981124,0.45499593,0.15495911,0.2747682],"study_design_scores_gemma":[0.0005811073,0.00043075823,0.012345246,0.008623048,0.0022803938,0.0034261819,0.00236748,0.02853759,0.00535274,0.7844195,0.15115798,0.00047793015],"about_ca_topic_score_codex":0.013363621,"about_ca_topic_score_gemma":0.016545905,"teacher_disagreement_score":0.61734664,"about_ca_system_score_codex":0.003268392,"about_ca_system_score_gemma":0.0050172894,"threshold_uncertainty_score":0.7612983},"labels":[],"label_agreement":null},{"id":"W2116345053","doi":"10.1007/s10985-006-9012-2","title":"A formal test for the stationarity of the incidence rate using data from a prevalent cohort study with follow-up","year":2006,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":83,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Incidence (geometry); Statistics; Cohort; Null hypothesis; Test (biology); Econometrics; Statistical hypothesis testing; Null (SQL); Medicine; Mathematics; Demography; Computer science; Data mining; Biology","score_opus":0.16039986620700372,"score_gpt":0.4110143209759239,"score_spread":0.2506144547689202,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2116345053","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24436389,0.000467986,0.7465474,0.0022795326,0.0001531427,0.00032053847,0.0017867115,0.0006489249,0.0034319516],"genre_scores_gemma":[0.8901526,0.00022731748,0.104911655,0.00039898505,0.0003539696,0.000517834,0.0019337212,0.00008643959,0.0014174856],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97097325,0.019532243,0.0016430237,0.003949551,0.0026338454,0.0012679689],"domain_scores_gemma":[0.3980643,0.5637871,0.011981256,0.02017639,0.0043999385,0.0015910034],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05840151,0.0010563562,0.0021398999,0.0032608975,0.0015556721,0.0025398182,0.0040980508,0.0022517713,0.009639168],"category_scores_gemma":[0.28134984,0.0007657883,0.004077654,0.0033977602,0.004768232,0.004450948,0.0030120038,0.0030012054,0.00051580154],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017348252,0.0012375455,0.22581878,0.0011813928,0.004479037,0.0027498833,0.0026254638,0.06769074,0.005118364,0.55737215,0.005847733,0.12414414],"study_design_scores_gemma":[0.0013304326,0.001873837,0.06781149,0.00020778595,0.0011145006,0.0015379163,0.0011645675,0.38472667,0.0028127588,0.5336498,0.0036223296,0.00014791574],"about_ca_topic_score_codex":0.003288469,"about_ca_topic_score_gemma":0.0023898238,"teacher_disagreement_score":0.05840151,"about_ca_system_score_codex":0.001282659,"about_ca_system_score_gemma":0.0061658267,"threshold_uncertainty_score":0.30886042},"labels":[],"label_agreement":null},{"id":"W2117317003","doi":"10.1002/pds.1357","title":"Immortal time bias in observational studies of drug effects","year":2007,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":569,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Canadian Institutes of Health Research; AstraZeneca","keywords":"Medicine; Observational study; Pharmacoepidemiology; COPD; Cohort study; Drug; Disease; Pulmonary disease; Cohort; Internal medicine; Intensive care medicine; Pharmacology; Medical prescription","score_opus":0.3359460404749271,"score_gpt":0.5112862260978849,"score_spread":0.17534018562295778,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2117317003","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17326641,0.04072936,0.75472546,0.011437965,0.003863508,0.0028997916,0.00344698,0.0007644944,0.00886607],"genre_scores_gemma":[0.9009963,0.004534064,0.082308605,0.004726306,0.0013003821,0.002631056,0.0014163275,0.00019136493,0.0018956532],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5990047,0.3397064,0.023823155,0.019008372,0.016485684,0.001971628],"domain_scores_gemma":[0.29209247,0.5566009,0.059831314,0.080243215,0.010179602,0.0010525574],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.35607618,0.0014690972,0.002964022,0.004330137,0.001682092,0.0036702796,0.0037872489,0.00356492,0.0027248415],"category_scores_gemma":[0.6126016,0.0012760564,0.006300724,0.0046203006,0.0083845155,0.0039931564,0.0042241816,0.0044607245,0.0005386668],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035500824,0.00018475084,0.6575087,0.006006694,0.022391457,0.002032014,0.0067228135,0.027737988,0.00091699476,0.16309811,0.005734733,0.10411567],"study_design_scores_gemma":[0.0016612315,0.0018896363,0.29830945,0.0064912317,0.012720179,0.0047988025,0.0016872747,0.098155424,0.005799208,0.5242372,0.043548297,0.00070213294],"about_ca_topic_score_codex":0.00504805,"about_ca_topic_score_gemma":0.0026928652,"teacher_disagreement_score":0.6439238,"about_ca_system_score_codex":0.0024901645,"about_ca_system_score_gemma":0.002745578,"threshold_uncertainty_score":0.79407275},"labels":[],"label_agreement":null},{"id":"W2117578563","doi":"10.1002/sim.6185","title":"Propensity score methods for estimating relative risks in cluster randomized trials with low‐incidence binary outcomes and selection bias","year":2014,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Agence Nationale de la Recherche","keywords":"Propensity score matching; Covariate; Selection bias; Statistics; Inverse probability weighting; Weighting; Randomization; Regression; Randomized controlled trial; Selection (genetic algorithm); Relative risk; Cluster (spacecraft); Medicine; Econometrics; Mathematics; Computer science; Internal medicine; Artificial intelligence; Confidence interval","score_opus":0.39037839286313425,"score_gpt":0.5488097609618341,"score_spread":0.15843136809869984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2117578563","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032508317,0.0018724389,0.9927209,0.00039741636,0.00009973563,0.0008924893,0.00013212912,0.00016903311,0.00046482714],"genre_scores_gemma":[0.12615655,0.002686744,0.86288697,0.0005971826,0.0003036494,0.0061701154,0.0003812289,0.00014506334,0.0006725953],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85052896,0.13808306,0.003412385,0.002946146,0.0046033007,0.0004262206],"domain_scores_gemma":[0.7509046,0.22179084,0.012453481,0.010129171,0.004143762,0.0005781698],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12713994,0.0016245208,0.0031811285,0.00470197,0.0005857755,0.002132429,0.0027527567,0.0020421972,0.0043922197],"category_scores_gemma":[0.28488266,0.00095118576,0.0038216019,0.005318604,0.0019199519,0.0026569702,0.002940772,0.0043701907,0.00064741896],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020126652,0.00026775038,0.0089411745,0.004996541,0.006773013,0.00026981797,0.00086711015,0.1818671,0.0008861265,0.44969153,0.0077448105,0.33568233],"study_design_scores_gemma":[0.0021451192,0.0007759674,0.0031814598,0.0009036648,0.0015413935,0.0002375041,0.000101187994,0.39901263,0.0010282354,0.5812407,0.009708297,0.00012385464],"about_ca_topic_score_codex":0.0017262995,"about_ca_topic_score_gemma":0.0013198892,"teacher_disagreement_score":0.8728601,"about_ca_system_score_codex":0.0016386494,"about_ca_system_score_gemma":0.004232546,"threshold_uncertainty_score":0.6723883},"labels":[],"label_agreement":null},{"id":"W2117770228","doi":"10.1136/bmjopen-2014-005362","title":"Estimating treatment effects in randomised controlled trials with non-compliance: a simulation study","year":2014,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":73,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St. Joseph’s Healthcare Hamilton","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Randomized controlled trial; Psychological intervention; Type I and type II errors; Treatment and control groups; Sample size determination; Instrumental variable; Intention-to-treat analysis; Statistics; Surgery; Mathematics; Internal medicine","score_opus":0.35392174226404155,"score_gpt":0.5547976196864092,"score_spread":0.20087587742236762,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2117770228","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24341162,0.0129863545,0.70873964,0.006225451,0.0011204054,0.013954039,0.003130583,0.0007888564,0.009643128],"genre_scores_gemma":[0.765509,0.0023359295,0.2136357,0.0017161579,0.00015617826,0.014049102,0.0010421907,0.00008912153,0.0014666839],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.6703673,0.31260762,0.006865139,0.004971485,0.0035537363,0.0016346383],"domain_scores_gemma":[0.19473355,0.7669289,0.019323274,0.012758257,0.005215205,0.0010408048],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25544214,0.0028478208,0.006093272,0.0026626887,0.0010009487,0.0040074945,0.0035125797,0.0068485956,0.0075465087],"category_scores_gemma":[0.47701618,0.0019273353,0.012533035,0.0034840186,0.0034336632,0.0041412436,0.0035124796,0.0068547446,0.0007223072],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.02068322,0.00135792,0.02642449,0.006736317,0.013934352,0.0010101536,0.0014331624,0.8056867,0.00048348244,0.0824023,0.0033320864,0.036515784],"study_design_scores_gemma":[0.0114742,0.004212699,0.0029116424,0.0027411655,0.0047138296,0.00046315833,0.00023729086,0.8952973,0.0005101733,0.07328514,0.003971268,0.00018210751],"about_ca_topic_score_codex":0.0057975114,"about_ca_topic_score_gemma":0.0028918916,"teacher_disagreement_score":0.74455786,"about_ca_system_score_codex":0.0044684564,"about_ca_system_score_gemma":0.0051814355,"threshold_uncertainty_score":0.9181724},"labels":[],"label_agreement":null},{"id":"W2119030200","doi":"10.1002/0470011815.b2a04017","title":"Drug Utilization Patterns","year":2005,"lang":"en","type":"other","venue":"Encyclopedia of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Data collection; Nonparametric statistics; Drug; Computer science; Data science; Medicine; Econometrics; Pharmacology; Statistics; Economics; Mathematics","score_opus":0.0715196213504441,"score_gpt":0.38155852799319634,"score_spread":0.31003890664275224,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119030200","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44439146,0.15470919,0.07274082,0.019616604,0.00083010655,0.000969155,0.12963821,0.0006822717,0.17642218],"genre_scores_gemma":[0.858879,0.07759417,0.021009568,0.0020180384,0.00042243497,0.0004273676,0.026319567,0.00013393197,0.013195833],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99770457,0.0007623298,0.0004198776,0.00038264302,0.0006455101,0.00008523423],"domain_scores_gemma":[0.99438196,0.0019178035,0.0019490424,0.0005186157,0.0010886836,0.00014399014],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015785242,0.00018136032,0.00039537065,0.0039123218,0.00017637998,0.001158772,0.0005875189,0.0003202824,0.005534272],"category_scores_gemma":[0.011407853,0.00012782485,0.00049939484,0.0067523,0.00016944145,0.000740021,0.0005747538,0.00046354512,0.0011449177],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000121160345,0.00009117612,0.39691386,0.001928836,0.00059819117,0.00020595314,0.0005930867,0.002037111,0.000441141,0.023695715,0.030557891,0.5428159],"study_design_scores_gemma":[0.000020127536,0.000084222695,0.85493076,0.002089175,0.0002212194,0.0014863751,0.0011187507,0.004989761,0.0009212765,0.015705094,0.118381456,0.000051757423],"about_ca_topic_score_codex":0.009055949,"about_ca_topic_score_gemma":0.008252664,"teacher_disagreement_score":0.009055949,"about_ca_system_score_codex":0.0007426002,"about_ca_system_score_gemma":0.00071369024,"threshold_uncertainty_score":0.018513978},"labels":[],"label_agreement":null},{"id":"W2119138019","doi":"10.1515/em-2012-0006","title":"Comparison of Approaches to Weight Truncation for Marginal Structural Cox Models","year":2013,"lang":"en","type":"article","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":98,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Institut National d'Excellence en Santé et en Services Sociaux","funders":"National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; Johns Hopkins Bloomberg School of Public Health; Feinberg School of Medicine; University of California, Los Angeles; Deutsches Krebsforschungszentrum; Natural Sciences and Engineering Research Council of Canada; University of Pittsburgh; Johns Hopkins University; National Cancer Institute; Fonds Québécois de la Recherche sur la Nature et les Technologies; McGill University; Northwestern University","keywords":"Truncation (statistics); Estimator; Weighting; Marginal structural model; Mean squared error; Mathematics; Statistics; Percentile; Applied mathematics; Computer science; Econometrics; Mathematical optimization; Confounding","score_opus":0.8429178298825912,"score_gpt":0.5997911695234979,"score_spread":0.24312666035909336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119138019","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0135672325,0.0018937308,0.9826136,0.0004133061,0.000106082436,0.0001840393,0.0001270698,0.00018406931,0.0009107774],"genre_scores_gemma":[0.23086755,0.0034891358,0.761057,0.00045817767,0.0003027815,0.0008948851,0.0008563213,0.0003036066,0.0017704656],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97602606,0.019035898,0.0012230244,0.0012317144,0.0021070312,0.0003763886],"domain_scores_gemma":[0.876513,0.10538776,0.0037008352,0.008589191,0.004785584,0.0010236363],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.059563205,0.0014232716,0.0023547134,0.0021272171,0.0008504789,0.0016642666,0.0045628464,0.0022491373,0.0032998587],"category_scores_gemma":[0.14921048,0.0010556504,0.0034685638,0.0019024787,0.0017399357,0.0039501316,0.004585383,0.0038694737,0.00058716425],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013621158,0.00022624554,0.007915055,0.0009279048,0.0014653506,0.00020790128,0.0012249652,0.38452414,0.0011521188,0.2528554,0.003224385,0.34491438],"study_design_scores_gemma":[0.00027745453,0.00029870006,0.00219733,0.00026433772,0.00029612242,0.00012914,0.00014502453,0.8418245,0.00080184394,0.14984879,0.0038260035,0.000090795154],"about_ca_topic_score_codex":0.003742445,"about_ca_topic_score_gemma":0.00412542,"teacher_disagreement_score":0.9404368,"about_ca_system_score_codex":0.0021637422,"about_ca_system_score_gemma":0.0033734143,"threshold_uncertainty_score":0.3150041},"labels":[],"label_agreement":null},{"id":"W2119511462","doi":"10.1002/sim.6433","title":"Penalized regression procedures for variable selection in the potential outcomes framework","year":2015,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute of Environmental Health Sciences; National Cancer Institute; National Institute on Drug Abuse; National Institutes of Health","keywords":"Causal inference; Imputation (statistics); Computer science; Inference; Missing data; Regression; Multivariate statistics; Feature selection; Regression analysis; Artificial intelligence; Model selection; Selection (genetic algorithm); Machine learning; Data mining; Econometrics; Statistics; Mathematics","score_opus":0.11775119733631027,"score_gpt":0.4738352817476763,"score_spread":0.356084084411366,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119511462","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00033755656,0.0003000026,0.9983695,0.0003249143,0.00003428218,0.00004254171,0.000056773883,0.00009145577,0.0004429521],"genre_scores_gemma":[0.040985793,0.0018025762,0.9504919,0.0006004841,0.00048514776,0.0013012805,0.0005845635,0.0003865583,0.0033617276],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96886975,0.026371459,0.0006571953,0.0014638782,0.0022391237,0.00039855455],"domain_scores_gemma":[0.92590964,0.06366038,0.0029046147,0.0043589314,0.0027318643,0.00043463038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039579958,0.0019526955,0.002471559,0.0032904749,0.0010885913,0.0024047627,0.0041446257,0.0023290163,0.0087832175],"category_scores_gemma":[0.09556364,0.000922098,0.0025635445,0.004282696,0.0034959752,0.003630347,0.0036973206,0.0070728343,0.0024143907],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006356919,0.00006246069,0.00079894497,0.00028332745,0.00024305108,0.00011049477,0.00018510975,0.0711074,0.00035168586,0.83886224,0.0076330476,0.08029862],"study_design_scores_gemma":[0.00006811566,0.00005400755,0.00038049222,0.0001018099,0.000050298433,0.00006995098,0.000033357534,0.28067786,0.0003852117,0.7085497,0.009592368,0.000037014386],"about_ca_topic_score_codex":0.002940726,"about_ca_topic_score_gemma":0.0025345397,"teacher_disagreement_score":0.039579958,"about_ca_system_score_codex":0.0018008678,"about_ca_system_score_gemma":0.003619716,"threshold_uncertainty_score":0.20932132},"labels":[],"label_agreement":null},{"id":"W2119675638","doi":"10.1007/3-540-44886-1_4","title":"The Structure Model Interpretation of Wright’s NESS Test","year":2003,"lang":"en","type":"book-chapter","venue":"Lecture notes in computer science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"","keywords":"Wright; Causation; Overdetermination; Epistemology; Test (biology); Interpretation (philosophy); Pearl; Terminology; Philosophy; Computer science; Linguistics; Theology","score_opus":0.049103651438285316,"score_gpt":0.3350629119220473,"score_spread":0.28595926048376197,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119675638","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11441063,0.0008829955,0.5415585,0.017343033,0.000741559,0.00011435843,0.0008649033,0.00036258876,0.3237214],"genre_scores_gemma":[0.9451928,0.00036143276,0.033992622,0.001210748,0.00040317775,0.000118536416,0.00033532942,0.00013103367,0.018254325],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996545,0.0018645041,0.00014883123,0.0006377989,0.00057938363,0.00022448169],"domain_scores_gemma":[0.98961323,0.0073730564,0.00047325663,0.001535784,0.00079906976,0.00020564145],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0049372474,0.00073606195,0.0011700256,0.0018164649,0.0011631292,0.002187348,0.0017838546,0.0024923508,0.024285762],"category_scores_gemma":[0.028185824,0.00057421153,0.0014691765,0.0012748592,0.0061941314,0.0076221223,0.0022278118,0.0033745512,0.0010360852],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016599246,0.000010413828,0.00021780493,0.000017969456,0.000011336772,0.00005154489,0.00010315316,0.0006064996,0.00009004793,0.9943929,0.00090321037,0.0035785134],"study_design_scores_gemma":[0.000010975166,0.000006975096,0.00015010955,0.000007611714,0.000006308726,0.000027865894,0.00003238014,0.0028678162,0.00008589523,0.99586844,0.00093197945,0.0000035615485],"about_ca_topic_score_codex":0.0010036664,"about_ca_topic_score_gemma":0.0011172428,"teacher_disagreement_score":0.024285762,"about_ca_system_score_codex":0.0013394698,"about_ca_system_score_gemma":0.001060651,"threshold_uncertainty_score":0.08124399},"labels":[],"label_agreement":null},{"id":"W2119762928","doi":"10.1093/aje/kwn299","title":"Instrumental Variable Analysis for Estimation of Treatment Effects With Dichotomous Outcomes","year":2008,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":168,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Instrumental variable; Estimation; Medicine; Statistics; Variable (mathematics); Econometrics; Mathematics; Economics","score_opus":0.1069183705597743,"score_gpt":0.42547931669381167,"score_spread":0.3185609461340374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119762928","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00060473545,0.0008234239,0.99705136,0.0002920667,0.00011352516,0.00017956817,0.00014125241,0.00017023171,0.0006238947],"genre_scores_gemma":[0.05821299,0.0032282784,0.9300166,0.00081191154,0.00048595582,0.0028997206,0.0008455496,0.00029588462,0.0032030903],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9424933,0.048693307,0.0017985309,0.00246305,0.004007189,0.00054450694],"domain_scores_gemma":[0.86805445,0.1158559,0.005451721,0.007935113,0.0024321573,0.0002705819],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.057140876,0.0021892232,0.0034957593,0.004562797,0.00096925226,0.002586135,0.0054128934,0.0035303414,0.011106045],"category_scores_gemma":[0.2173702,0.0013598729,0.0041363263,0.005892753,0.0025386673,0.0033082159,0.0036718722,0.007072614,0.0018785587],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021716939,0.00016982606,0.0063583455,0.0018092006,0.0023069826,0.00034939437,0.00047566526,0.06294254,0.0007536306,0.7150992,0.008628186,0.20088978],"study_design_scores_gemma":[0.00033676965,0.00029391487,0.002830509,0.0009617322,0.0005562776,0.00026668824,0.0001533935,0.28485778,0.0018885274,0.68290854,0.024757566,0.00018831895],"about_ca_topic_score_codex":0.0025598784,"about_ca_topic_score_gemma":0.0015304856,"teacher_disagreement_score":0.057140876,"about_ca_system_score_codex":0.0018651267,"about_ca_system_score_gemma":0.0034977733,"threshold_uncertainty_score":0.3021934},"labels":[],"label_agreement":null},{"id":"W2119863846","doi":"10.1016/j.jclinepi.2014.12.018","title":"Interrupted time series analysis in drug utilization research is increasing: systematic review and recommendations","year":2015,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":486,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University; St. Michael's Hospital; University of Toronto","funders":"","keywords":"Interrupted time series; Interrupted Time Series Analysis; Medicine; MEDLINE; Systematic review; Psychological intervention; Meta-analysis; Research design; Statistics; Pathology; Mathematics","score_opus":0.8623636112980363,"score_gpt":0.7162576385668367,"score_spread":0.14610597273119963,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2119863846","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00017867293,0.9889981,0.0016869644,0.0071488153,0.0011233839,0.00042966113,0.0001784495,0.000026404747,0.0002295092],"genre_scores_gemma":[0.0036494157,0.9805649,0.009963559,0.0033697933,0.0006516038,0.0014269861,0.00021244204,0.00001366282,0.0001476632],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9190809,0.04480172,0.02290744,0.0025402915,0.009843199,0.00082640315],"domain_scores_gemma":[0.62963885,0.28862664,0.039011743,0.005362835,0.035728414,0.0016315272],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.11575033,0.0020043668,0.00934683,0.018255992,0.0012235448,0.005792519,0.0047804443,0.0050575193,0.005805454],"category_scores_gemma":[0.28838056,0.001811084,0.00969514,0.01639019,0.001940181,0.008568156,0.0023879032,0.004352239,0.0008347995],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022111849,0.000051423132,0.0013246818,0.7331922,0.0064320746,0.00012367479,0.0004662008,0.00054236554,0.00017586937,0.0033622703,0.019668136,0.23444003],"study_design_scores_gemma":[0.00023872791,0.0001322356,0.0017672589,0.89835405,0.017102744,0.00017700969,0.00042035873,0.00066609395,0.0002045819,0.004168294,0.076690204,0.000078484],"about_ca_topic_score_codex":0.011616805,"about_ca_topic_score_gemma":0.02432096,"teacher_disagreement_score":0.99065316,"about_ca_system_score_codex":0.008411096,"about_ca_system_score_gemma":0.043381467,"threshold_uncertainty_score":0.61215353},"labels":[],"label_agreement":null},{"id":"W2120052464","doi":"10.1093/ije/dyh330","title":"Commentary: Insights from cross-population studies: Rose revisited","year":2005,"lang":"en","type":"letter","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Population Health Research Institute","funders":"","keywords":"Rose (mathematics); Population; Medicine; Demography; Biology; Environmental health; Sociology","score_opus":0.28225431656014194,"score_gpt":0.5234674852899659,"score_spread":0.24121316872982396,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2120052464","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000046216937,0.0008016807,0.00011549294,0.9867771,0.011904823,0.0000049637924,0.00004911639,0.000009703436,0.00029103426],"genre_scores_gemma":[0.0007589472,0.0004498014,0.0002236501,0.96674466,0.03115639,0.000021766182,0.0000122447045,0.0000150554415,0.00061736465],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9783651,0.009300478,0.0030912892,0.0035584166,0.0045293136,0.0011553538],"domain_scores_gemma":[0.78546345,0.17799756,0.0065058162,0.0037671546,0.019941755,0.00632433],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035068348,0.0019039967,0.004768322,0.0029313844,0.0065694726,0.007815205,0.009567068,0.11109386,0.009022436],"category_scores_gemma":[0.24373713,0.0017419643,0.003341471,0.0038745904,0.010132769,0.011655663,0.004759555,0.10536631,0.007314973],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004855457,0.000010134954,0.00016923745,0.00012862118,0.000040892628,0.00038817734,0.00023757982,0.000055181543,0.00003471482,0.0044393735,0.98992133,0.0045262375],"study_design_scores_gemma":[0.0005071723,0.000066417815,0.0011616861,0.0023673265,0.00032073923,0.0016578285,0.0014524441,0.0010014168,0.00025551306,0.08673923,0.9042391,0.0002311126],"about_ca_topic_score_codex":0.021453012,"about_ca_topic_score_gemma":0.02630878,"teacher_disagreement_score":0.11109386,"about_ca_system_score_codex":0.008683121,"about_ca_system_score_gemma":0.010968672,"threshold_uncertainty_score":0.18546134},"labels":[],"label_agreement":null},{"id":"W2122067453","doi":"10.1093/aje/kwt435","title":"Re: \"Estimating the Relative Risk in Cohort Studies and Clinical Trials of Common Outcomes\"","year":2014,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Relative risk; Cohort study; Cohort; Clinical trial; Confidence interval; Internal medicine","score_opus":0.5212791738585023,"score_gpt":0.6000301761944622,"score_spread":0.07875100233595989,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2122067453","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00014636824,0.0020763422,0.0018417762,0.9735734,0.020267395,0.000030540792,0.00023745497,0.00008559759,0.0017410467],"genre_scores_gemma":[0.0018332305,0.000877745,0.0022206358,0.9391428,0.051821064,0.00015494657,0.000058956473,0.000077648474,0.0038129361],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.95725125,0.02649484,0.0055226837,0.003758633,0.006076337,0.00089625973],"domain_scores_gemma":[0.66126263,0.29790112,0.008690954,0.009086327,0.018956952,0.0041019702],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048926316,0.0019512501,0.005019447,0.0024492608,0.0034607847,0.0061166384,0.0060172356,0.0721903,0.0076281987],"category_scores_gemma":[0.32495588,0.0021286153,0.0022977425,0.0025744103,0.010089206,0.006390567,0.003398285,0.095424004,0.011009925],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000115343064,0.000020884727,0.00041926338,0.0001210333,0.00009411495,0.00023287434,0.000090039575,0.00016586608,0.00006916621,0.008540881,0.9780214,0.012109149],"study_design_scores_gemma":[0.0012080286,0.00012498256,0.0030320378,0.0030774088,0.0005853601,0.0018398353,0.00039626675,0.005118865,0.0008738842,0.17706433,0.806342,0.0003371473],"about_ca_topic_score_codex":0.011301978,"about_ca_topic_score_gemma":0.013999986,"teacher_disagreement_score":0.0721903,"about_ca_system_score_codex":0.005956157,"about_ca_system_score_gemma":0.008013192,"threshold_uncertainty_score":0.25875014},"labels":[],"label_agreement":null},{"id":"W2122527396","doi":"10.1002/sim.3801","title":"Missing data in the exposure of interest and marginal structural models: A simulation study based on the Framingham Heart Study","year":2009,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Medical Research Council; National Health and Medical Research Council","keywords":"Missing data; Inverse probability; Framingham Heart Study; Marginal structural model; Statistics; Confounding; Propensity score matching; Computer science; Econometrics; Outcome (game theory); Mathematics; Medicine; Framingham Risk Score; Bayesian probability","score_opus":0.3765319600692848,"score_gpt":0.49942054001456876,"score_spread":0.12288857994528396,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2122527396","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92634994,0.0011893981,0.065184586,0.002060245,0.00010021054,0.00030841742,0.0008846046,0.00010859477,0.003814023],"genre_scores_gemma":[0.97081673,0.0005381205,0.026576292,0.00021738303,0.00006000052,0.00038636065,0.00062686123,0.000029905204,0.0007484317],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9837879,0.014773292,0.00023389491,0.0004824824,0.0003386949,0.00038372903],"domain_scores_gemma":[0.7724994,0.21669784,0.003070669,0.004139351,0.0025032808,0.0010894344],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031875517,0.00081070163,0.0014627345,0.0013845447,0.0009030785,0.0010283251,0.0013831662,0.0017879154,0.0026969379],"category_scores_gemma":[0.08979665,0.0005439765,0.0021693716,0.00142932,0.0012759252,0.0015458644,0.0014420466,0.00249957,0.00016200611],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002508184,0.0012128444,0.049652185,0.0003322202,0.0010597595,0.00086833787,0.0011652537,0.86165416,0.00033406733,0.061282374,0.0033888638,0.016541794],"study_design_scores_gemma":[0.0005624424,0.00065536186,0.005766041,0.00011516354,0.00027268555,0.00014031511,0.0003688454,0.968814,0.00023161291,0.022083625,0.0009244482,0.00006535995],"about_ca_topic_score_codex":0.015275358,"about_ca_topic_score_gemma":0.008876367,"teacher_disagreement_score":0.9681245,"about_ca_system_score_codex":0.001351794,"about_ca_system_score_gemma":0.0012592005,"threshold_uncertainty_score":0.16857588},"labels":[],"label_agreement":null},{"id":"W2122817910","doi":"10.1093/ije/dyp163","title":"Commentary: Gilding the black box","year":2009,"lang":"en","type":"letter","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Pearl; Vintage; Field (mathematics); History; Sociology; Classics; Archaeology","score_opus":0.25191257663776434,"score_gpt":0.4847451640458476,"score_spread":0.23283258740808327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2122817910","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00007837668,0.0005345564,0.000040938008,0.9639514,0.034247093,0.000008275358,0.000046761856,0.000017015998,0.0010755535],"genre_scores_gemma":[0.000739691,0.00027894822,0.000060795417,0.9797162,0.015970968,0.000019403473,0.0000111429135,0.000014912573,0.0031879332],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9944193,0.0016585788,0.00055586797,0.0011139376,0.0016010479,0.00065132306],"domain_scores_gemma":[0.98081493,0.012195569,0.0009911547,0.0005834071,0.003613226,0.001801638],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00811165,0.0012950166,0.0020087566,0.001156577,0.0058560036,0.004451276,0.0037946396,0.07081866,0.015672209],"category_scores_gemma":[0.05534472,0.0011008641,0.002211685,0.0012101146,0.0061406875,0.007221364,0.0027757501,0.074448034,0.013357185],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002041576,0.000006102101,0.00005413656,0.00003452585,0.00000572278,0.0002828155,0.00011196099,0.000017432441,0.000026106625,0.0011791366,0.99716455,0.0010970676],"study_design_scores_gemma":[0.00006355566,0.000024407178,0.00039250904,0.00044868645,0.000023288136,0.00093886064,0.0005454601,0.00018390827,0.00015985224,0.005888554,0.9912872,0.000043689957],"about_ca_topic_score_codex":0.014852796,"about_ca_topic_score_gemma":0.0172116,"teacher_disagreement_score":0.07081866,"about_ca_system_score_codex":0.008364,"about_ca_system_score_gemma":0.008129902,"threshold_uncertainty_score":0.060685396},"labels":[],"label_agreement":null},{"id":"W2123190102","doi":"10.1093/ejcts/ezt455","title":"Reply to Yamamoto et al.","year":2013,"lang":"en","type":"letter","venue":"European Journal of Cardio-Thoracic Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Toronto General Hospital; University of Toronto; University Health Network","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Covariate; Selection bias; Medicine; Matching (statistics); Lung cancer; Surgery; Statistics; Internal medicine; Pathology; Mathematics","score_opus":0.1518692357781406,"score_gpt":0.38860158545271467,"score_spread":0.23673234967457407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2123190102","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00014976485,0.0027899449,0.0001426071,0.86693466,0.1293589,0.000012107195,0.00006247821,0.00006655111,0.0004830231],"genre_scores_gemma":[0.0012753262,0.0016325196,0.00020068836,0.89000094,0.104102485,0.00004589815,0.000040980874,0.000039934395,0.0026612573],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99430627,0.0012340663,0.0009428951,0.00097400934,0.0018979886,0.000644693],"domain_scores_gemma":[0.9708288,0.011316836,0.0024768042,0.0011134739,0.010168789,0.004095402],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00858732,0.0016217383,0.0024315245,0.0016944169,0.0032172808,0.00520156,0.0050189183,0.051332995,0.009156366],"category_scores_gemma":[0.07028777,0.001258031,0.0022274547,0.0013061994,0.0041957917,0.008739153,0.0041015493,0.055831008,0.011408676],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025793657,0.000011352137,0.00017916714,0.000077777055,0.000013712318,0.00045612454,0.0000638728,0.000025897773,0.000057209578,0.00046835523,0.99544626,0.0031745082],"study_design_scores_gemma":[0.00006749112,0.00004297879,0.00076118804,0.00040352688,0.000034677003,0.0029959574,0.00037114986,0.00017495548,0.00026484265,0.0027394108,0.99203837,0.000105443316],"about_ca_topic_score_codex":0.002712567,"about_ca_topic_score_gemma":0.0024019184,"teacher_disagreement_score":0.051332995,"about_ca_system_score_codex":0.0037247776,"about_ca_system_score_gemma":0.0050044423,"threshold_uncertainty_score":0.045414627},"labels":[],"label_agreement":null},{"id":"W2126049444","doi":"10.1002/sim.3697","title":"Balance diagnostics for comparing the distribution of baseline covariates between treatment groups in propensity‐score matched samples","year":2009,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6487,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Matching (statistics); Quantile; Mathematics; Medicine","score_opus":0.2114497428934903,"score_gpt":0.42025483801624836,"score_spread":0.20880509512275805,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2126049444","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019821076,0.0011584124,0.9687081,0.0006563682,0.00032063096,0.0013083165,0.002772326,0.0014111813,0.003843636],"genre_scores_gemma":[0.3184685,0.0007240424,0.6667436,0.00094305497,0.0003946361,0.005830506,0.0042151785,0.0007186478,0.0019619437],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.880947,0.09332233,0.0062487973,0.0068518925,0.011639399,0.0009905659],"domain_scores_gemma":[0.6266996,0.32235757,0.0240376,0.01971458,0.0062293005,0.0009612389],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.091588035,0.0015410535,0.0026246258,0.010805282,0.0011945798,0.0027790968,0.003842496,0.0034303325,0.013733185],"category_scores_gemma":[0.35920033,0.0010315916,0.002396284,0.0075444845,0.0039576227,0.003772966,0.0030415764,0.0034888461,0.0020550897],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035098165,0.0005444972,0.16194321,0.0034802172,0.005085194,0.0011750255,0.0018956327,0.025033046,0.004060078,0.26699764,0.033703484,0.49257213],"study_design_scores_gemma":[0.0013958912,0.0026014582,0.12813275,0.0015717695,0.0016916456,0.0029879673,0.0013979635,0.30865055,0.012307788,0.4764229,0.062398642,0.00044061488],"about_ca_topic_score_codex":0.0019102904,"about_ca_topic_score_gemma":0.0010333966,"teacher_disagreement_score":0.091588035,"about_ca_system_score_codex":0.0014513901,"about_ca_system_score_gemma":0.0024643394,"threshold_uncertainty_score":0.48436964},"labels":[],"label_agreement":null},{"id":"W2126497011","doi":"10.1093/aje/kwq329","title":"Invited Commentary: Decomposing with a Lot of Supposing","year":2010,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Canada Research Chairs","keywords":"Medicine; Computer science; Intensive care medicine","score_opus":0.1314046313524887,"score_gpt":0.433510131570431,"score_spread":0.3021055002179423,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2126497011","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000051813135,0.0007411269,0.00010043204,0.97063524,0.027939325,0.000004420733,0.000027940454,0.000014431069,0.0004852708],"genre_scores_gemma":[0.00076443556,0.0007232907,0.00021760975,0.9406787,0.05577924,0.00001873647,0.00001559215,0.00002008704,0.001782267],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9943455,0.0020810552,0.0005757264,0.00094425195,0.0017217364,0.00033170043],"domain_scores_gemma":[0.9754817,0.016496902,0.0008874752,0.00071049895,0.004919261,0.0015041464],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00850911,0.0012822229,0.0017084292,0.0010054216,0.0033022936,0.0036976475,0.0034492596,0.041012734,0.007965053],"category_scores_gemma":[0.05809038,0.000801896,0.0019173184,0.0009986194,0.005446164,0.007972389,0.0020165346,0.05241996,0.007269358],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021183007,0.00000900867,0.000059002283,0.00003240099,0.0000048660363,0.00019009806,0.000043191867,0.000026087666,0.00003024647,0.0016692994,0.99512696,0.0027876117],"study_design_scores_gemma":[0.00016234603,0.000045041295,0.000656652,0.0004427925,0.00003700367,0.0018646546,0.0003428704,0.0007581679,0.00023623866,0.028348662,0.96701926,0.000086352],"about_ca_topic_score_codex":0.0055942736,"about_ca_topic_score_gemma":0.005573373,"teacher_disagreement_score":0.041012734,"about_ca_system_score_codex":0.004558177,"about_ca_system_score_gemma":0.0043844427,"threshold_uncertainty_score":0.04500103},"labels":[],"label_agreement":null},{"id":"W2126632863","doi":"10.5334/jopd.ad","title":"Data from Investigating Variation in Replicability: A “Many Labs” Replication Project","year":2014,"lang":"en","type":"article","venue":"Journal of Open Psychology Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":83,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Wilfrid Laurier University; Mount Saint Vincent University","funders":"","keywords":"Generalizability theory; Replication (statistics); Computer science; Variation (astronomy); Open science; Class (philosophy); Data science; Psychology; World Wide Web; Statistics; Artificial intelligence; Mathematics","score_opus":0.6351073594100903,"score_gpt":0.5925521228023779,"score_spread":0.04255523660771243,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2126632863","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.43514836,0.0013184405,0.23542745,0.003557341,0.0019677689,0.03758327,0.22833097,0.0041591856,0.05250729],"genre_scores_gemma":[0.5883323,0.00033621042,0.14684375,0.002475142,0.000277836,0.09916209,0.14562778,0.0043268516,0.012618056],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.8528098,0.08779613,0.01356659,0.015938092,0.027341317,0.0025480536],"domain_scores_gemma":[0.4497785,0.2500409,0.016797783,0.21225336,0.06799385,0.0031356353],"candidate_categories":["metaresearch","open_science"],"consensus_categories":[],"category_scores_codex":[0.1137186,0.00135673,0.0020414258,0.0026941395,0.0043503637,0.0031027144,0.002736708,0.0023838128,0.022675883],"category_scores_gemma":[0.4139389,0.0012673084,0.0025166245,0.005383761,0.0037648184,0.0028029575,0.0045637474,0.0047496017,0.006970922],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010374738,0.0042829216,0.0784737,0.0055184374,0.0028091457,0.0013172344,0.03296525,0.0037652652,0.016340673,0.035763543,0.5926976,0.21569154],"study_design_scores_gemma":[0.0061644344,0.003060606,0.2866988,0.0023707314,0.0017331687,0.0019565213,0.010189647,0.0065542352,0.02237111,0.048841357,0.60926145,0.0007979326],"about_ca_topic_score_codex":0.004949721,"about_ca_topic_score_gemma":0.0064823306,"teacher_disagreement_score":0.9972633,"about_ca_system_score_codex":0.0017664001,"about_ca_system_score_gemma":0.00423165,"threshold_uncertainty_score":0.6014086},"labels":[],"label_agreement":null},{"id":"W2127843972","doi":"10.3102/1076998614524823","title":"A State Space Modeling Approach to Mediation Analysis","year":2014,"lang":"en","type":"article","venue":"Journal of Educational and Behavioral Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Mediation; Computer science; Process (computing); Population; State space; Data science; Econometrics; Mathematics; Statistics; Sociology; Social science","score_opus":0.1615246983656391,"score_gpt":0.44512262690147375,"score_spread":0.28359792853583465,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2127843972","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028261289,0.000444679,0.9898032,0.0015509549,0.00012687535,0.00027564337,0.00034829503,0.00016693985,0.004457254],"genre_scores_gemma":[0.30399114,0.0026627125,0.67595255,0.0012065938,0.00056130555,0.0047147344,0.0008111545,0.00016994316,0.0099299885],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9741587,0.02094092,0.00065797794,0.0018577422,0.0017347127,0.00064991263],"domain_scores_gemma":[0.9719686,0.024042001,0.0011943444,0.0013036216,0.0012191634,0.0002723118],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021991225,0.0018888426,0.0025147423,0.0035360593,0.0019352022,0.0035961918,0.0045066085,0.0027282697,0.017273128],"category_scores_gemma":[0.042080414,0.0008357617,0.0041344687,0.0048202886,0.0025097798,0.003965222,0.003962656,0.0060590412,0.0014056861],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000064507054,0.00014558004,0.002885143,0.0002528592,0.00065303955,0.00017669851,0.0010246547,0.023088135,0.00021556328,0.93713224,0.0026509238,0.031710632],"study_design_scores_gemma":[0.00008039114,0.00019260056,0.0011167299,0.00012850107,0.0002853728,0.00013431396,0.00037326306,0.16973357,0.00031214653,0.8154033,0.012174142,0.00006570708],"about_ca_topic_score_codex":0.007519131,"about_ca_topic_score_gemma":0.005909486,"teacher_disagreement_score":0.021991225,"about_ca_system_score_codex":0.002779241,"about_ca_system_score_gemma":0.005693382,"threshold_uncertainty_score":0.11630207},"labels":[],"label_agreement":null},{"id":"W2127992265","doi":"10.1093/ije/dyp334","title":"Illustrating bias due to conditioning on a collider","year":2009,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":823,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases; National Cancer Institute; National Institute on Alcohol Abuse and Alcoholism","keywords":"Collider; Conditioning; Selection bias; Outcome (game theory); Selection (genetic algorithm); Association (psychology); Confounding; Computer science; Physics; Statistics; Psychology; Mathematics; Artificial intelligence; Particle physics; Mathematical economics","score_opus":0.3891479896255752,"score_gpt":0.5215592792262753,"score_spread":0.13241128960070014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2127992265","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09242499,0.0014329252,0.86861736,0.018380756,0.00040958458,0.0005151324,0.00058602844,0.00036498965,0.01726815],"genre_scores_gemma":[0.8258871,0.0007643208,0.16415617,0.0053613563,0.00040287248,0.00058137695,0.00022363263,0.00007693269,0.0025462008],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9584944,0.031959683,0.0014437382,0.0029689427,0.003901902,0.0012313819],"domain_scores_gemma":[0.67694366,0.28358302,0.011915844,0.02202625,0.004650919,0.00088025624],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0687522,0.0007451895,0.0015559366,0.0010484557,0.0014814404,0.0018367472,0.0019288247,0.0028119243,0.008119376],"category_scores_gemma":[0.21538559,0.0005230742,0.0021863293,0.00183031,0.0064747804,0.0034498954,0.0045889667,0.004704218,0.0004520124],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008913076,0.00014486878,0.02647579,0.0003752189,0.00070344424,0.0014770657,0.0030172628,0.01670218,0.0012084892,0.87711495,0.0058195936,0.06606987],"study_design_scores_gemma":[0.0003216781,0.00018603634,0.0037003492,0.00014489007,0.00025207805,0.0007364415,0.00022680525,0.046608005,0.0015049727,0.93982047,0.006440674,0.00005756803],"about_ca_topic_score_codex":0.004566786,"about_ca_topic_score_gemma":0.0024480028,"teacher_disagreement_score":0.93124783,"about_ca_system_score_codex":0.0018269027,"about_ca_system_score_gemma":0.0016256364,"threshold_uncertainty_score":0.36360073},"labels":[],"label_agreement":null},{"id":"W2128334938","doi":"10.1016/j.jclinepi.2009.07.006","title":"Different measures of treatment effect for different research questions","year":2009,"lang":"en","type":"letter","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"","keywords":"Observational study; Scopus; Randomized controlled trial; Logistic regression; Medicine; Relative risk; Family medicine; MEDLINE; Psychology; Confidence interval; Internal medicine; Political science","score_opus":0.8291083080550481,"score_gpt":0.6756286593504679,"score_spread":0.1534796487045802,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2128334938","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009250844,0.0008612085,0.005976036,0.982505,0.0076680896,0.000035678433,0.00017771024,0.000037365437,0.001813752],"genre_scores_gemma":[0.03535872,0.0014072179,0.020079115,0.9033925,0.03557816,0.00038693106,0.00011602088,0.00009064819,0.0035906702],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92339146,0.055256326,0.008515754,0.0037541427,0.007979695,0.0011026412],"domain_scores_gemma":[0.41854614,0.55273426,0.0046022777,0.008489596,0.013190981,0.002436783],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.082865715,0.0009740105,0.003336081,0.0019500175,0.0022512057,0.004565964,0.0027528717,0.030652767,0.006273189],"category_scores_gemma":[0.43005666,0.0010696587,0.001953164,0.0025319855,0.0072896224,0.00564924,0.00254835,0.03937357,0.002409705],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011117109,0.00020563605,0.006308816,0.0007844244,0.000463955,0.0026496428,0.0008886117,0.0010845036,0.00035222262,0.107369095,0.76410615,0.114675365],"study_design_scores_gemma":[0.002238035,0.00023959065,0.00864739,0.0011842587,0.00049908843,0.0069836364,0.0010499338,0.012099287,0.0012475956,0.7264892,0.23897932,0.00034271745],"about_ca_topic_score_codex":0.002899752,"about_ca_topic_score_gemma":0.004674564,"teacher_disagreement_score":0.9171343,"about_ca_system_score_codex":0.004773133,"about_ca_system_score_gemma":0.002686103,"threshold_uncertainty_score":0.438241},"labels":[],"label_agreement":null},{"id":"W2129095037","doi":"10.1111/j.1540-5982.2012.01733.x","title":"Comparing features of convenient estimators for binary choice models with endogenous regressors","year":2012,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":226,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Estimator; Heteroscedasticity; Control function; Binary number; Econometrics; M-estimator; Statistics; Function (biology); Mathematics; Computer science; Control (management); Artificial intelligence","score_opus":0.4673828165059883,"score_gpt":0.28297669831909533,"score_spread":0.18440611818689295,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2129095037","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039047565,0.0007012145,0.9579652,0.0004480646,0.000040764833,0.00015994161,0.00017478521,0.00027489683,0.0011875265],"genre_scores_gemma":[0.53361255,0.0009111468,0.46271878,0.00022444112,0.00017863358,0.00086902647,0.0005360664,0.00016324133,0.0007860807],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9592146,0.03477322,0.0013639721,0.0011426662,0.003008537,0.00049700646],"domain_scores_gemma":[0.5574119,0.41019103,0.013896279,0.0137559585,0.003943575,0.0008011771],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.073557526,0.00082609826,0.0016106816,0.0037698704,0.00041043598,0.0022131505,0.0018961565,0.0017136193,0.0032887424],"category_scores_gemma":[0.26752675,0.00074329047,0.0014150935,0.0027353638,0.0020906676,0.0036056428,0.0027203397,0.0016007327,0.00035450462],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006205199,0.00036049273,0.031492893,0.0008756527,0.00070150284,0.00021897687,0.0010295463,0.079096034,0.0012566422,0.67695385,0.0036334188,0.20376049],"study_design_scores_gemma":[0.00042624885,0.00038206312,0.0125959795,0.00025845066,0.00023706874,0.0002369539,0.00026548211,0.5590431,0.0020872606,0.42064303,0.003707997,0.00011638674],"about_ca_topic_score_codex":0.0012269018,"about_ca_topic_score_gemma":0.0013147909,"teacher_disagreement_score":0.073557526,"about_ca_system_score_codex":0.0009660899,"about_ca_system_score_gemma":0.0012428222,"threshold_uncertainty_score":0.389014},"labels":[],"label_agreement":null},{"id":"W2130266492","doi":"10.1002/cjs.10080","title":"Nonparametric likelihood and doubly robust estimating equations for marginal and nested structural models","year":2010,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Estimator; Mathematics; Nonparametric statistics; Statistics; Marginal likelihood; Regression analysis; Propensity score matching; Estimating equations; Restricted maximum likelihood; Econometrics; Covariate; Maximum likelihood","score_opus":0.11948689421199453,"score_gpt":0.35287077898084285,"score_spread":0.2333838847688483,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130266492","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005953145,0.00021045012,0.9925436,0.0003047558,0.000014419147,0.000039064656,0.00021310027,0.00010471806,0.0006167063],"genre_scores_gemma":[0.31582698,0.0010445099,0.673785,0.00021373687,0.0001655952,0.0008227938,0.0016830403,0.00020286496,0.006255477],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98473614,0.011424603,0.0005580207,0.0012845143,0.0015706716,0.00042599908],"domain_scores_gemma":[0.93986773,0.049218003,0.004236529,0.003819804,0.0024171048,0.00044089372],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023123477,0.0007805143,0.0025536001,0.0020871875,0.00059420156,0.002093442,0.0038069258,0.0016052519,0.0056184614],"category_scores_gemma":[0.10534279,0.0011144541,0.00210648,0.0024226718,0.002470272,0.0037376923,0.0033270987,0.0035812962,0.0008894251],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000054376706,0.000057774996,0.0051036025,0.00013305832,0.00019595346,0.00017324905,0.00033522374,0.14157276,0.00025051145,0.79481715,0.0022490346,0.055057332],"study_design_scores_gemma":[0.000028274062,0.000023257742,0.0014324642,0.000041698855,0.000038209302,0.00007646544,0.000040385323,0.5806986,0.00011544714,0.41523618,0.0022378701,0.000031102772],"about_ca_topic_score_codex":0.009991962,"about_ca_topic_score_gemma":0.00992862,"teacher_disagreement_score":0.023123477,"about_ca_system_score_codex":0.0018443123,"about_ca_system_score_gemma":0.002897733,"threshold_uncertainty_score":0.122290075},"labels":[],"label_agreement":null},{"id":"W2130620033","doi":"10.1136/bmjopen-2013-003143","title":"A generalised model for individualising a treatment recommendation based on group-level evidence from randomised clinical trials","year":2013,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"McMaster University","keywords":"Harm; Medicine; Relative risk; Clinical trial; Randomized controlled trial; Number needed to harm; Placebo; Number needed to treat; Confidence interval; Alternative medicine; Internal medicine; Psychology; Social psychology","score_opus":0.9068940734743981,"score_gpt":0.657280030729765,"score_spread":0.24961404274463306,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130620033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007114493,0.0030168227,0.97426003,0.0044296933,0.0003549354,0.0037635108,0.0021880788,0.00068486814,0.004187551],"genre_scores_gemma":[0.20163982,0.0039667673,0.76292723,0.0036710857,0.0004381111,0.01914346,0.0023487676,0.0002422504,0.0056225215],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.78346294,0.18964642,0.007708979,0.00895376,0.008383881,0.001844053],"domain_scores_gemma":[0.72767675,0.24678841,0.011098146,0.0075136214,0.005806116,0.0011169376],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14554204,0.004830771,0.009219422,0.0059180614,0.00088787643,0.006627101,0.0087438505,0.010556778,0.0117072575],"category_scores_gemma":[0.30107737,0.0031292585,0.010455505,0.005537711,0.0043825507,0.006462409,0.004024582,0.009052813,0.0035319703],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002061431,0.00016647181,0.0030397498,0.0058891247,0.004888026,0.00048201258,0.0010249309,0.7211246,0.00037540306,0.15942702,0.007328173,0.094193116],"study_design_scores_gemma":[0.0026413272,0.0011685338,0.0013871315,0.0030567462,0.003369708,0.00036523477,0.00010732742,0.56649625,0.00044525746,0.40802658,0.012664032,0.00027191307],"about_ca_topic_score_codex":0.008268743,"about_ca_topic_score_gemma":0.0076565365,"teacher_disagreement_score":0.854458,"about_ca_system_score_codex":0.00680986,"about_ca_system_score_gemma":0.0067902314,"threshold_uncertainty_score":0.7697091},"labels":[],"label_agreement":null},{"id":"W2130892140","doi":"10.1177/0962280214543508","title":"Double propensity-score adjustment: A solution to design bias or bias due to incomplete matching","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":90,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Matching (statistics); Covariate; Statistics; Confounding; Average treatment effect; Mathematics; Selection bias; Observational study; Econometrics","score_opus":0.8048558980284114,"score_gpt":0.6387257078840167,"score_spread":0.16613019014439467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2130892140","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013764779,0.0005064569,0.99606055,0.00075977267,0.00016256337,0.00027101173,0.000079096615,0.00016426206,0.0006197208],"genre_scores_gemma":[0.07423034,0.0012626362,0.91813254,0.0012525008,0.0005215333,0.001972207,0.00024699618,0.00022537821,0.0021558425],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8918604,0.082103804,0.0060116006,0.008381745,0.010489888,0.0011524981],"domain_scores_gemma":[0.8741279,0.0739572,0.014350555,0.02755882,0.009177556,0.0008278901],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09249119,0.0016634349,0.003753038,0.0037789803,0.0016490103,0.0031189718,0.003650724,0.0034162286,0.005562055],"category_scores_gemma":[0.23697141,0.0014385799,0.0038014608,0.0061780997,0.0032020782,0.0037109246,0.0057304013,0.0047014975,0.0010996525],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054940785,0.00014250982,0.009139227,0.002139546,0.002599002,0.00053513196,0.0013403618,0.023413032,0.0016174549,0.42772326,0.016084654,0.5147164],"study_design_scores_gemma":[0.00082422467,0.0005231058,0.0047862004,0.0009528445,0.0013138806,0.0014297842,0.00021459312,0.11654836,0.004353899,0.7955638,0.07317979,0.0003095068],"about_ca_topic_score_codex":0.0019104923,"about_ca_topic_score_gemma":0.0016704927,"teacher_disagreement_score":0.9075088,"about_ca_system_score_codex":0.0019359428,"about_ca_system_score_gemma":0.0074247033,"threshold_uncertainty_score":0.489146},"labels":[],"label_agreement":null},{"id":"W2131839274","doi":"10.1002/sim.6621","title":"Terminating observation within matched pairs of subjects in a matched cohort analysis: a Monte Carlo simulation study","year":2015,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital; Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Censoring (clinical trials); Monte Carlo method; Statistics; Observational study; Cohort; Event (particle physics); Computer science; Cohort study; Econometrics; Mathematics; Physics","score_opus":0.17266836408797095,"score_gpt":0.45042957816131257,"score_spread":0.27776121407334164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2131839274","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5243766,0.0017215031,0.46761996,0.0013102945,0.00019113049,0.0017423836,0.00038755286,0.000120599856,0.0025300533],"genre_scores_gemma":[0.8796818,0.0005348828,0.117089465,0.00041033034,0.00006258757,0.0013555897,0.00027445325,0.000031391603,0.0005594341],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.944,0.04919599,0.0014257882,0.002977881,0.0015888427,0.0008113892],"domain_scores_gemma":[0.51194084,0.45912036,0.009009577,0.014540388,0.0038913114,0.0014975218],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1235493,0.00086992054,0.0021291613,0.0012838037,0.0013562746,0.0022855462,0.002533654,0.0025994107,0.0026827636],"category_scores_gemma":[0.2662152,0.0008396019,0.0034106793,0.0016681419,0.0019322195,0.002842933,0.0024212913,0.0038246398,0.0002962041],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015926518,0.0053056814,0.19350022,0.0010659519,0.0070528067,0.00256752,0.0035389354,0.44155023,0.001521581,0.22495888,0.0029252393,0.10008651],"study_design_scores_gemma":[0.0011180755,0.0017024236,0.0073128454,0.00025092124,0.0016534275,0.00035662114,0.00041878916,0.9263402,0.00088934624,0.058060464,0.0017733655,0.00012350193],"about_ca_topic_score_codex":0.009209069,"about_ca_topic_score_gemma":0.006097357,"teacher_disagreement_score":0.8764507,"about_ca_system_score_codex":0.0022209235,"about_ca_system_score_gemma":0.0038093387,"threshold_uncertainty_score":0.653399},"labels":[],"label_agreement":null},{"id":"W2131931738","doi":"10.1016/j.clinthera.2006.09.021","title":"Toward a standard definition and measurement of persistence with drug therapy: Examples from research on statin and antihypertensive utilization","year":2006,"lang":"en","type":"review","venue":"Clinical Therapeutics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":159,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Persistence (discontinuity); Medicine; Medical prescription; Terminology; MEDLINE; Ranking (information retrieval); Intensive care medicine; Pharmacology; Information retrieval; Computer science","score_opus":0.9320255751568463,"score_gpt":0.5942286578077858,"score_spread":0.3377969173490605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2131931738","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013217273,0.87313,0.11264079,0.009505679,0.00051957456,0.000060138405,0.00026302048,0.000081367885,0.002477629],"genre_scores_gemma":[0.028764028,0.88416696,0.08205318,0.0026895294,0.0011126723,0.00017363542,0.00031249665,0.00003027197,0.0006973857],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9955063,0.0023510184,0.0005253977,0.00048653295,0.0010722836,0.000058451275],"domain_scores_gemma":[0.9641982,0.030206267,0.0014781923,0.0012867809,0.0026730623,0.00015754238],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016341615,0.0013949183,0.0036070393,0.003910391,0.0003731272,0.0021880725,0.002527822,0.0026517464,0.0010080496],"category_scores_gemma":[0.030790444,0.00062826945,0.0015778007,0.00552257,0.00322439,0.003173277,0.0013701374,0.0050988845,0.0005231769],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000085630614,0.00011450154,0.0026072836,0.00798204,0.00062861067,0.00010611974,0.0002730611,0.0037246118,0.0003350327,0.13346523,0.013296454,0.8373815],"study_design_scores_gemma":[0.000096388874,0.0002445958,0.010992294,0.0119289225,0.00090317405,0.0015262016,0.0005949256,0.0087403245,0.0015985458,0.7085757,0.25462374,0.00017515918],"about_ca_topic_score_codex":0.0035311684,"about_ca_topic_score_gemma":0.003971402,"teacher_disagreement_score":0.016341615,"about_ca_system_score_codex":0.0018745959,"about_ca_system_score_gemma":0.0035917982,"threshold_uncertainty_score":0.086423755},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"observational","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2132557528","doi":"10.3386/w13039","title":"Regression Discontinuity Designs: A Guide to Practice","year":2007,"lang":"en","type":"report","venue":"National Bureau of Economic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":888,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada; National Science Foundation","keywords":"Regression discontinuity design; Discontinuity (linguistics); Regression; Computer science; Econometrics; Statistics; Mathematics","score_opus":0.7507059545647676,"score_gpt":0.6941272470872978,"score_spread":0.05657870747746985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2132557528","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00032195493,0.008900467,0.9714057,0.003726405,0.0008750232,0.00293971,0.0017495215,0.001617827,0.008463297],"genre_scores_gemma":[0.0038522757,0.0075827707,0.97589684,0.0012200436,0.00035509156,0.0077322638,0.0006187738,0.00058011786,0.002161747],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.909315,0.07429093,0.0050184773,0.002735717,0.008197663,0.00044232377],"domain_scores_gemma":[0.8346459,0.1426892,0.003602442,0.008811633,0.009305669,0.0009451432],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.090301044,0.0027589945,0.004278574,0.0057663727,0.0012783867,0.00638596,0.0073612076,0.0071500936,0.021319874],"category_scores_gemma":[0.17311779,0.003018493,0.0033722296,0.007005304,0.0039426773,0.0037257914,0.0037170458,0.0107967425,0.011037671],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028888407,0.00042598884,0.0014814375,0.006675344,0.00070140744,0.0005027069,0.0023317232,0.016607484,0.0009840616,0.37302458,0.17602558,0.4209507],"study_design_scores_gemma":[0.000566496,0.00039016755,0.0009278332,0.005714095,0.00024323851,0.0005597613,0.00053520413,0.028294059,0.0011438841,0.50187194,0.45951337,0.0002400545],"about_ca_topic_score_codex":0.004150753,"about_ca_topic_score_gemma":0.0051033106,"teacher_disagreement_score":0.090301044,"about_ca_system_score_codex":0.0026697335,"about_ca_system_score_gemma":0.008812854,"threshold_uncertainty_score":0.47756326},"labels":[],"label_agreement":null},{"id":"W2133519275","doi":"10.1002/sim.5599","title":"An information criterion for marginal structural models","year":2012,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Center for Research Resources; National Institute of Child Health and Human Development; National Institute of Allergy and Infectious Diseases; National Cancer Institute; National Institute on Aging","keywords":"Marginal structural model; Marginal model; Econometrics; Specification; Inference; Computer science; Metric (unit); Observational study; Parametric statistics; Causal inference; Regression; Semiparametric regression; Marginal likelihood; Regression analysis; Statistics; Mathematics; Machine learning; Bayesian probability; Artificial intelligence; Economics","score_opus":0.1399503500513534,"score_gpt":0.47609368767591403,"score_spread":0.3361433376245606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2133519275","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047072936,0.00028398278,0.9928281,0.0004694949,0.000022387669,0.00007278231,0.00022472,0.0001336345,0.0012575962],"genre_scores_gemma":[0.34119007,0.0014091856,0.6502185,0.0009605248,0.0003925837,0.0013557014,0.0014839073,0.0003964824,0.002593098],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9799519,0.015276574,0.00083541,0.001239483,0.002233625,0.00046306313],"domain_scores_gemma":[0.83564305,0.14899895,0.0037331085,0.0059602587,0.0049171457,0.00074737536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033657312,0.0013363252,0.0025247568,0.004179405,0.0010503387,0.0021829482,0.0031654611,0.0026795287,0.0053373547],"category_scores_gemma":[0.1350731,0.0008615724,0.00271779,0.003282657,0.004392643,0.004976911,0.0034540717,0.0038412956,0.0008328338],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008433645,0.00005386924,0.0026400788,0.0003662811,0.00020833002,0.00016355597,0.00032825352,0.093467936,0.0006058139,0.8613619,0.0026688578,0.038050797],"study_design_scores_gemma":[0.000034678673,0.00010352468,0.0008250524,0.00013332877,0.00004646152,0.00010084551,0.000049654303,0.29792726,0.0004370673,0.6976032,0.0026934615,0.000045430796],"about_ca_topic_score_codex":0.0020234808,"about_ca_topic_score_gemma":0.0012757576,"teacher_disagreement_score":0.033657312,"about_ca_system_score_codex":0.0021561545,"about_ca_system_score_gemma":0.0025850763,"threshold_uncertainty_score":0.17799902},"labels":[],"label_agreement":null},{"id":"W2133554893","doi":"10.1111/j.1467-985x.2012.01032.x","title":"Experimental Designs for Identifying Causal Mechanisms","year":2012,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series A (Statistics in Society)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":407,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; National Science Foundation","keywords":"Causality (physics); Imperfect; Causation; Computer science; Causal model; Causal inference; Process (computing); Criticism; Key (lock); Natural (archaeology); Black box; Data science; Cognitive psychology; Psychology; Management science; Artificial intelligence; Epistemology; Econometrics; Engineering; Mathematics; Computer security","score_opus":0.1689160987547828,"score_gpt":0.425026705623513,"score_spread":0.2561106068687302,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2133554893","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008232003,0.0011558835,0.9729522,0.0033890498,0.0006158042,0.0044232537,0.0005665064,0.0002550079,0.008410315],"genre_scores_gemma":[0.13328548,0.0010618735,0.83038044,0.001560359,0.0005128513,0.031594384,0.00026695052,0.00007365017,0.001263942],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.75280064,0.22068112,0.0063386243,0.008151219,0.011133891,0.00089450233],"domain_scores_gemma":[0.38088366,0.5377774,0.028207537,0.04051205,0.011310608,0.0013086478],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15410848,0.0018372962,0.0025253862,0.003004183,0.0017976536,0.003417612,0.0035655997,0.0045295088,0.015414938],"category_scores_gemma":[0.39011624,0.0012207964,0.0026000277,0.0029073115,0.009954951,0.005753833,0.0039698216,0.00673982,0.0014404737],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069828704,0.00022221312,0.0015561511,0.0015793263,0.00042083507,0.00009496213,0.00070113334,0.0070477594,0.00086792355,0.9384453,0.0026844372,0.045681696],"study_design_scores_gemma":[0.0010063936,0.0011875383,0.0013094776,0.0008108995,0.00028365146,0.00010209311,0.00022642958,0.023064906,0.0012193028,0.95584834,0.014844547,0.00009643698],"about_ca_topic_score_codex":0.00059084134,"about_ca_topic_score_gemma":0.0005012686,"teacher_disagreement_score":0.84589154,"about_ca_system_score_codex":0.003276631,"about_ca_system_score_gemma":0.003578692,"threshold_uncertainty_score":0.8150133},"labels":[],"label_agreement":null},{"id":"W2133940194","doi":"10.1177/1740774512440636","title":"Temporal compliance trends in a cluster randomization with crossover trial of out-of-hospital cardiac arrest","year":2012,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Ottawa Public Health; St. Michael's Hospital; Ottawa Hospital; University of Ottawa","funders":"National Heart, Lung, and Blood Institute; Canadian Institutes of Health Research","keywords":"Crossover study; Medicine; Cardiopulmonary resuscitation; Randomized controlled trial; Randomization; Logistic regression; Emergency medicine; Cluster randomised controlled trial; Resuscitation; Data monitoring committee; Cluster (spacecraft); Internal medicine; Placebo","score_opus":0.5222422213995487,"score_gpt":0.56778038428529,"score_spread":0.04553816288574131,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2133940194","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.991738,0.0008253093,0.0031378176,0.00036408694,0.00027073344,0.002233421,0.00047968354,0.00010185147,0.00084914075],"genre_scores_gemma":[0.9931853,0.0000805021,0.0034400783,0.00023712861,0.000098365614,0.0021356274,0.00034312383,0.000018324901,0.0004614724],"study_design_codex":"randomized_trial","study_design_gemma":"observational","domain_scores_codex":[0.94089514,0.049881388,0.0023337742,0.0037735892,0.0020010434,0.0011151341],"domain_scores_gemma":[0.92639893,0.04003003,0.01901939,0.009513584,0.0028926227,0.002145486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.052774835,0.0006404668,0.0014696143,0.00059518294,0.0004951424,0.001114409,0.0009501246,0.0014663147,0.0026339102],"category_scores_gemma":[0.079769306,0.00052281603,0.0022337406,0.00070838217,0.0011277787,0.0012277184,0.0007955896,0.0017968033,0.00024208461],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.9216851,0.009389332,0.027519507,0.0006889438,0.005268076,0.000053659267,0.00059270795,0.0024696696,0.0012280035,0.0009864426,0.0020702966,0.028048119],"study_design_scores_gemma":[0.4825548,0.31603667,0.14962731,0.00032456272,0.009606851,0.00016691243,0.0003322392,0.03079085,0.0030880524,0.0040128226,0.003245242,0.00021372219],"about_ca_topic_score_codex":0.0010054244,"about_ca_topic_score_gemma":0.00087116647,"teacher_disagreement_score":0.94722515,"about_ca_system_score_codex":0.001212015,"about_ca_system_score_gemma":0.00228894,"threshold_uncertainty_score":0.27910334},"labels":[],"label_agreement":null},{"id":"W2134369111","doi":"","title":"The Effects of Cancer on Employment and Earnings of Cancer Survivors","year":2014,"lang":"en","type":"article","venue":"Analytical Studies Branch Research Paper Series","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Microdata (statistics); Earnings; Demography; Cancer registry; Wage; Cancer; Matching (statistics); Medicine; Propensity score matching; Causal inference; Econometrics; Actuarial science; Demographic economics; Economics; Census; Environmental health; Labour economics; Surgery; Population; Accounting; Internal medicine; Sociology","score_opus":0.15941032812625305,"score_gpt":0.503943175039,"score_spread":0.34453284691274694,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134369111","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99851996,0.00039761368,0.00009007532,0.00021862112,0.0000055844484,0.00000495256,0.0002088476,0.0000012507329,0.0005531877],"genre_scores_gemma":[0.99918157,0.00023635797,0.00005517593,0.000020497402,0.000008003737,0.0000030702022,0.00015527394,6.9214104e-7,0.00033932386],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99940145,0.00027835058,0.000020810854,0.00004795765,0.00010535606,0.00014610107],"domain_scores_gemma":[0.99614006,0.0023355582,0.0008050897,0.00019320678,0.00019880862,0.00032722592],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012464385,0.00014821222,0.00019293076,0.0005659067,0.00036983195,0.00046818747,0.00032895664,0.00030442516,0.001605875],"category_scores_gemma":[0.007736494,0.00011395633,0.00038241746,0.00071391644,0.0004214901,0.0002733782,0.0005485788,0.0004118465,0.00013031384],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034787584,0.00016861288,0.98901653,0.000011500697,0.00013339342,0.000113884154,0.00020346977,0.0009029019,0.00021701463,0.0003963191,0.0002216924,0.00826675],"study_design_scores_gemma":[0.000008398177,0.00007873118,0.9984946,0.000004960158,0.000041837073,0.00002695805,0.00017525694,0.000623813,0.00006587861,0.0002706063,0.00020605166,0.0000028653963],"about_ca_topic_score_codex":0.099406786,"about_ca_topic_score_gemma":0.10165499,"teacher_disagreement_score":0.099406786,"about_ca_system_score_codex":0.0009004878,"about_ca_system_score_gemma":0.0011205422,"threshold_uncertainty_score":0.19765633},"labels":[],"label_agreement":null},{"id":"W2134429012","doi":"10.1111/j.1467-9876.2012.01041.x","title":"Estimating the Optimal Dynamic Antipsychotic Treatment Regime: Evidence from the Sequential Multiple-Assignment Randomized Clinical Antipsychotic Trials of Intervention and Effectiveness Schizophrenia Study","year":2012,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series C (Applied Statistics)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Antipsychotic; Schizophrenia (object-oriented programming); Perphenazine; Randomized controlled trial; Psychiatry; Intervention (counseling); Marginal structural model; Clinical trial; Psychology; Medicine; Confidence interval; Internal medicine","score_opus":0.14126718593338197,"score_gpt":0.45643209670626445,"score_spread":0.31516491077288245,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134429012","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.55795777,0.19527917,0.18297958,0.024922458,0.0051442906,0.009934636,0.0057728468,0.0010439093,0.016965313],"genre_scores_gemma":[0.941518,0.01537342,0.03513997,0.0027183786,0.0008065611,0.0020101052,0.0015229624,0.00007813612,0.0008325796],"study_design_codex":"randomized_trial","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.83172387,0.15830919,0.0041858926,0.002339387,0.0029234393,0.00051826733],"domain_scores_gemma":[0.6627822,0.30538192,0.017901557,0.009634984,0.0027966737,0.0015026585],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.096714124,0.0014067802,0.0055406033,0.0011579716,0.0004975157,0.0015406574,0.001767384,0.002069297,0.007809147],"category_scores_gemma":[0.2568448,0.00084997143,0.0058636065,0.0016084702,0.0021144082,0.0024387492,0.0018144128,0.004877169,0.00042199466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.507051,0.0027651638,0.013391038,0.020454396,0.09067459,0.00020478055,0.0006484386,0.031697907,0.00057264883,0.028271558,0.009678896,0.29458952],"study_design_scores_gemma":[0.51853275,0.04682411,0.023624694,0.0068889987,0.1465496,0.00049512554,0.00033452048,0.09688801,0.001576736,0.14028864,0.017709251,0.0002876277],"about_ca_topic_score_codex":0.0021487654,"about_ca_topic_score_gemma":0.0013836062,"teacher_disagreement_score":0.096714124,"about_ca_system_score_codex":0.0010314451,"about_ca_system_score_gemma":0.0026226493,"threshold_uncertainty_score":0.51147926},"labels":[],"label_agreement":null},{"id":"W2134608496","doi":"10.1093/aje/kwp175","title":"Time-modified Confounding","year":2009,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institutes of Health; Thrasher Research Fund; National Institute on Alcohol Abuse and Alcoholism; National Institute of Allergy and Infectious Diseases; American Chemistry Council; World Health Organization","keywords":"Confounding; Marginal structural model; Statistics; Econometrics; Medicine; Mathematics","score_opus":0.180643880859676,"score_gpt":0.4805533217382027,"score_spread":0.29990944087852667,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134608496","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016470576,0.002858365,0.9640795,0.0041395333,0.0016020824,0.00040462313,0.0005891306,0.00020237158,0.009653891],"genre_scores_gemma":[0.6191606,0.004212462,0.34296373,0.0058121327,0.0021245577,0.0012653001,0.0009400967,0.00021626493,0.023304783],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97283936,0.014476846,0.0022857687,0.005271419,0.0042826934,0.0008438558],"domain_scores_gemma":[0.9323462,0.03808313,0.0074564363,0.017109334,0.00457705,0.00042779828],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025547674,0.0010752334,0.0015005785,0.0011930936,0.0010941259,0.0029547347,0.0035578997,0.0033252805,0.00689567],"category_scores_gemma":[0.109403,0.0007377955,0.0041712504,0.0024616448,0.0040991507,0.0048450325,0.0035550806,0.0038196323,0.0009450188],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002878829,0.00005837718,0.014515993,0.0005525789,0.0007361632,0.00045795634,0.001418418,0.011692657,0.000789981,0.877687,0.006293703,0.08550934],"study_design_scores_gemma":[0.00023798444,0.00027276596,0.0071562347,0.00050262554,0.001294997,0.002332905,0.0003124701,0.05466446,0.0031446724,0.85120046,0.07871445,0.00016600086],"about_ca_topic_score_codex":0.0035771907,"about_ca_topic_score_gemma":0.0033438492,"teacher_disagreement_score":0.025547674,"about_ca_system_score_codex":0.0028910695,"about_ca_system_score_gemma":0.002890672,"threshold_uncertainty_score":0.13511062},"labels":[],"label_agreement":null},{"id":"W2134743308","doi":"10.1146/annurev-statistics-010814-020403","title":"Using Longitudinal Complex Survey Data","year":2015,"lang":"en","type":"article","venue":"Annual Review of Statistics and Its Application","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Attrition; Dropout (neural networks); Computer science; Sample (material); Inference; Longitudinal data; Causal inference; Sampling (signal processing); Longitudinal study; Econometrics; Survey data collection; Sampling design; Statistics; Data science; Data mining; Artificial intelligence; Machine learning; Mathematics; Medicine","score_opus":0.6067950786125046,"score_gpt":0.5342187549497273,"score_spread":0.07257632366277733,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2134743308","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075375685,0.0050836783,0.9654057,0.00494705,0.00069724635,0.0005916582,0.0041289316,0.0005832627,0.011024977],"genre_scores_gemma":[0.20253766,0.017996103,0.759181,0.0035520252,0.0019041917,0.003615791,0.006428241,0.0003761323,0.0044088457],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9353112,0.053103197,0.0022812618,0.0038228147,0.005022523,0.0004590215],"domain_scores_gemma":[0.83519346,0.121211894,0.0116850175,0.02352099,0.007310178,0.0010785037],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.047741584,0.0013917199,0.0021715485,0.0052841105,0.0016109738,0.007143009,0.0028758447,0.0021121586,0.010810329],"category_scores_gemma":[0.21389958,0.0009886256,0.0018675596,0.011109874,0.0026286133,0.008284583,0.0052909344,0.003636726,0.0027006909],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008261421,0.0001429722,0.018895492,0.0016820895,0.0009456481,0.000318203,0.0020727904,0.016177643,0.00023972263,0.7152673,0.021202967,0.22297251],"study_design_scores_gemma":[0.00007358372,0.00013013573,0.005722626,0.0012141512,0.00021159324,0.00035089234,0.0008664434,0.037464626,0.00036373176,0.85220027,0.10129312,0.00010871983],"about_ca_topic_score_codex":0.005949766,"about_ca_topic_score_gemma":0.0039421627,"teacher_disagreement_score":0.047741584,"about_ca_system_score_codex":0.0017194926,"about_ca_system_score_gemma":0.0035652048,"threshold_uncertainty_score":0.25248462},"labels":[],"label_agreement":null},{"id":"W2135189416","doi":"10.1093/biostatistics/kxg041","title":"Analysis of longitudinal marginal structural models","year":2004,"lang":"en","type":"article","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Estimator; Censoring (clinical trials); Inverse probability; Marginal structural model; Confounding; Statistics; Econometrics; Mathematics; Computer science","score_opus":0.15749982260053155,"score_gpt":0.4178060521425315,"score_spread":0.260306229542,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2135189416","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027388493,0.0005774605,0.96956664,0.00076006656,0.00003815985,0.00008028994,0.00039471764,0.00023046677,0.00096376595],"genre_scores_gemma":[0.69962096,0.0018379148,0.29018918,0.00046476698,0.0002722264,0.0010764259,0.0016955596,0.00016681576,0.0046761683],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9922415,0.005923012,0.00018036354,0.00070870406,0.00065944873,0.00028696287],"domain_scores_gemma":[0.94635755,0.045303416,0.003154156,0.0029985162,0.0016624586,0.0005239074],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018808352,0.0007913011,0.0015270755,0.002004716,0.00057762273,0.0015242796,0.002419782,0.0012454191,0.008210074],"category_scores_gemma":[0.06943927,0.00069830095,0.0020458086,0.0016075645,0.0015512797,0.002596901,0.002481475,0.0019825085,0.0005705807],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015772728,0.00013626162,0.015399318,0.00032059968,0.00066459196,0.00018684298,0.0005958049,0.15537402,0.0004303099,0.77573746,0.0023722614,0.04862488],"study_design_scores_gemma":[0.000048931997,0.0000796866,0.0019961067,0.000050089904,0.00008832329,0.000057480298,0.000085909945,0.5435757,0.00023489802,0.45158157,0.0021746447,0.000026639256],"about_ca_topic_score_codex":0.0036736117,"about_ca_topic_score_gemma":0.0032533247,"teacher_disagreement_score":0.018808352,"about_ca_system_score_codex":0.0015211651,"about_ca_system_score_gemma":0.001908118,"threshold_uncertainty_score":0.099469244},"labels":[],"label_agreement":null},{"id":"W2136204757","doi":"10.2202/1557-4679.1349","title":"Double-Robust Estimators: Slightly More Bayesian than Meets the Eye?","year":2012,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Confounding; Bayesian probability; Outcome (game theory); Parametric statistics; Econometrics; Statistics; Mathematics; Nonparametric statistics; Parametric model; Mathematical economics","score_opus":0.12095443698415621,"score_gpt":0.4227510600308651,"score_spread":0.3017966230467089,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2136204757","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015182645,0.0023773583,0.98313403,0.0085285185,0.00069663883,0.000028549171,0.0001201651,0.000259399,0.0033370538],"genre_scores_gemma":[0.10438579,0.0040394035,0.87554204,0.0068355124,0.0028972598,0.00028731851,0.00025617055,0.00078818615,0.004968298],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97317153,0.01778462,0.0012954389,0.0027907393,0.0045304215,0.0004271531],"domain_scores_gemma":[0.9106753,0.06172142,0.004957364,0.015574207,0.00624637,0.0008253626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04842608,0.0013295772,0.0020227828,0.0015680701,0.0008483228,0.0048446576,0.0028013438,0.0043039527,0.008791051],"category_scores_gemma":[0.2365231,0.0010738682,0.001260852,0.002289356,0.0038690402,0.011525014,0.0031678984,0.0060493564,0.0032182168],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000144356,0.000038318554,0.0012928017,0.00044521978,0.000253727,0.000104396924,0.00047369293,0.0036425807,0.000680745,0.83733517,0.014935348,0.14065358],"study_design_scores_gemma":[0.00005446174,0.000059520782,0.00044126651,0.0003112269,0.000074369054,0.00028338234,0.00011745721,0.018745933,0.0008124389,0.9466583,0.03237241,0.00006927543],"about_ca_topic_score_codex":0.0022120366,"about_ca_topic_score_gemma":0.0027843255,"teacher_disagreement_score":0.04842608,"about_ca_system_score_codex":0.0011470753,"about_ca_system_score_gemma":0.0020786526,"threshold_uncertainty_score":0.25610465},"labels":[],"label_agreement":null},{"id":"W213628847","doi":"10.1016/j.cjca.2015.05.015","title":"A Review of Propensity-Score Methods and Their Use in Cardiovascular Research","year":2015,"lang":"en","type":"review","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":283,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto; St. Michael's Hospital","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Observational study; Medicine; Covariate; Matching (statistics); Weighting; Inverse probability weighting; Selection bias; Strengths and weaknesses; Randomized controlled trial; Econometrics; Statistics; Internal medicine; Mathematics; Pathology; Psychology","score_opus":0.7264268470364439,"score_gpt":0.5542337611935539,"score_spread":0.17219308584288995,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W213628847","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00007776628,0.9956844,0.0030884491,0.0006220864,0.00014948615,0.000011363573,0.00006132963,0.000014876645,0.00029028658],"genre_scores_gemma":[0.0008955181,0.9942311,0.0038795967,0.0003488054,0.0004098759,0.000024420042,0.00005957116,0.000005870162,0.0001453283],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99693227,0.0013824548,0.0005887823,0.00034850498,0.0006903361,0.000057657737],"domain_scores_gemma":[0.97530544,0.021785703,0.0010789813,0.00042839258,0.0012433842,0.00015816597],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008752034,0.0012506192,0.0035103739,0.005378904,0.0003474445,0.00190234,0.0018352066,0.0020524461,0.00507448],"category_scores_gemma":[0.025392419,0.00071623136,0.0021051383,0.007760947,0.0012589702,0.0020730263,0.0012209975,0.0028533686,0.0013873396],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008547947,0.00007068961,0.0006054663,0.050798435,0.00068315683,0.00009277593,0.00007020468,0.001595824,0.00021359812,0.015183747,0.019274581,0.91132605],"study_design_scores_gemma":[0.00022554999,0.0004157383,0.006290864,0.056244668,0.003307434,0.002165121,0.00019413349,0.004248604,0.00086795713,0.09535995,0.8304283,0.00025178245],"about_ca_topic_score_codex":0.002418691,"about_ca_topic_score_gemma":0.0035690437,"teacher_disagreement_score":0.99124795,"about_ca_system_score_codex":0.00087636954,"about_ca_system_score_gemma":0.0037560114,"threshold_uncertainty_score":0.04628575},"labels":[],"label_agreement":null},{"id":"W2138153404","doi":"10.1016/j.jclinepi.2007.07.011","title":"The performance of different propensity-score methods for estimating relative risks","year":2008,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":215,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Statistics; Confounding; Relative risk; Matching (statistics); Mathematics; Medicine; Confidence interval","score_opus":0.8314351686646472,"score_gpt":0.6606402731520815,"score_spread":0.17079489551256566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138153404","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09419583,0.0051745144,0.8964667,0.0015378856,0.0002109995,0.00016609307,0.00045971802,0.0007484878,0.0010397512],"genre_scores_gemma":[0.4432219,0.0033027576,0.55039406,0.0003268098,0.00024001437,0.00036242264,0.0008959624,0.00037049607,0.0008856254],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.944005,0.047539342,0.0024229395,0.0018267231,0.003819202,0.00038672442],"domain_scores_gemma":[0.4967372,0.47436318,0.0059193755,0.015754813,0.0063373735,0.00088796986],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.110829175,0.0015993364,0.0024923366,0.006362337,0.0007061192,0.003439998,0.0028425597,0.0027253998,0.00256885],"category_scores_gemma":[0.36563283,0.00094687636,0.0034448432,0.005602755,0.0017578572,0.0039211134,0.0028491807,0.0029265832,0.0005462957],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005220592,0.0004885433,0.054644044,0.0015795454,0.006733747,0.00016538489,0.0011569043,0.1844856,0.0015758269,0.09360616,0.0051615494,0.64518213],"study_design_scores_gemma":[0.0015687867,0.0009735802,0.030364837,0.0004319832,0.0020812964,0.0005247615,0.0002831257,0.7777609,0.0030746693,0.17963788,0.0029615469,0.00033649802],"about_ca_topic_score_codex":0.0025826134,"about_ca_topic_score_gemma":0.002422136,"teacher_disagreement_score":0.8891708,"about_ca_system_score_codex":0.0010643014,"about_ca_system_score_gemma":0.002220504,"threshold_uncertainty_score":0.5861277},"labels":[],"label_agreement":null},{"id":"W2138898032","doi":"10.1067/mhj.2000.106610","title":"Subgroups, treatment effects, and baseline risks: Some lessons from major cardiovascular trials","year":2000,"lang":"en","type":"article","venue":"American Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Medicine; Subgroup analysis; Randomized controlled trial; Pharmacotherapy; Clinical trial; Myocardial infarction; Internal medicine; Angina; Randomization; Heart failure; Cardiology; Meta-analysis","score_opus":0.2342638152514535,"score_gpt":0.45158630911453546,"score_spread":0.21732249386308194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138898032","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02947709,0.16705424,0.5116651,0.27876896,0.0024215083,0.0003344994,0.0010310444,0.0004591899,0.008788367],"genre_scores_gemma":[0.575402,0.101334214,0.23256405,0.068660975,0.014460279,0.0013431786,0.0006908726,0.0005585926,0.004985738],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9479114,0.0466563,0.001462941,0.0017464418,0.0018675049,0.0003554267],"domain_scores_gemma":[0.51014346,0.4724367,0.00385005,0.009464375,0.0030415347,0.0010638635],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10721659,0.0019575786,0.0067411605,0.001930555,0.0012363814,0.004075923,0.0038067608,0.006617549,0.005101914],"category_scores_gemma":[0.30464643,0.0012713985,0.0034655293,0.003245192,0.008803325,0.0110500185,0.0032265703,0.017074246,0.00038374038],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024808205,0.00029649597,0.017269868,0.0033495754,0.005403562,0.0008018889,0.0021323955,0.019210283,0.0002741236,0.5763655,0.036560047,0.3358555],"study_design_scores_gemma":[0.00046927313,0.00008742546,0.0012001573,0.00034689554,0.00047551672,0.00008990392,0.00014263588,0.00813258,0.00007420615,0.9840719,0.0048792735,0.000030205852],"about_ca_topic_score_codex":0.009108269,"about_ca_topic_score_gemma":0.008695861,"teacher_disagreement_score":0.8927834,"about_ca_system_score_codex":0.0021551852,"about_ca_system_score_gemma":0.0038138202,"threshold_uncertainty_score":0.5670223},"labels":[],"label_agreement":null},{"id":"W2138916823","doi":"10.1093/biostatistics/kxs024","title":"Targeted maximum likelihood estimation for marginal time-dependent treatment effects under density misspecification","year":2012,"lang":"en","type":"article","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Canadian Institutes of Health Research; McGill University","keywords":"Estimator; Statistics; Generalized estimating equation; Mathematics; Econometrics; Delta method; Parametric statistics; Confounding; Random effects model; Variance (accounting); Computer science; Medicine; Meta-analysis","score_opus":0.08074750171030778,"score_gpt":0.3757055195828782,"score_spread":0.29495801787257037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138916823","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004371953,0.00023587944,0.99478215,0.00015803745,0.000012647064,0.00005165332,0.000049516722,0.00011599949,0.00022214322],"genre_scores_gemma":[0.37687644,0.0011217378,0.617166,0.0005046583,0.0001281063,0.0011900875,0.0005531622,0.00018317,0.0022766145],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9860409,0.011603523,0.00035898827,0.00087412994,0.0008763695,0.0002460009],"domain_scores_gemma":[0.92484474,0.06730395,0.0028625904,0.0036266188,0.0011086303,0.00025342128],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027295807,0.0011570426,0.0022601997,0.0015251653,0.0004964073,0.0015519084,0.0028042027,0.0019040684,0.0028269175],"category_scores_gemma":[0.118610606,0.00074963755,0.0021311815,0.0018617184,0.0021314714,0.0020591707,0.002552632,0.0028127867,0.00053848553],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062862464,0.00019624754,0.013974779,0.0010768626,0.0015242727,0.0006218575,0.0010256711,0.3440421,0.002562787,0.35089132,0.003404771,0.28005078],"study_design_scores_gemma":[0.0001544091,0.00017563297,0.0025499102,0.00011913778,0.00019801297,0.00022132939,0.00006501923,0.71136564,0.0014357424,0.281445,0.0022317092,0.00003839202],"about_ca_topic_score_codex":0.0016610197,"about_ca_topic_score_gemma":0.0014163285,"teacher_disagreement_score":0.027295807,"about_ca_system_score_codex":0.0010366505,"about_ca_system_score_gemma":0.002030303,"threshold_uncertainty_score":0.14435577},"labels":[],"label_agreement":null},{"id":"W2139138216","doi":"","title":"Relaxing monotonicity in the identification of local average treatment effects","year":2012,"lang":"en","type":"preprint","venue":"Alexandria (UniSG) (University of St.Gallen)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"Monotonic function; Identification (biology); Endogeneity; Instrumental variable; Econometrics; Independence (probability theory); Average treatment effect; Mathematical economics; Mathematics; Quarter (Canadian coin); Economics; Statistics; Estimator; Mathematical analysis; Geography","score_opus":0.07965942016178558,"score_gpt":0.3226038725276926,"score_spread":0.24294445236590706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2139138216","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039087556,0.0006525035,0.95129997,0.0019677386,0.000082027735,0.00024713343,0.0004973583,0.00026945485,0.005896219],"genre_scores_gemma":[0.6244332,0.0011605176,0.36187848,0.0017796715,0.00048318275,0.0017507058,0.0008100216,0.00022421258,0.007479996],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97081,0.022549886,0.0009802746,0.0032709714,0.0013139122,0.0010750472],"domain_scores_gemma":[0.8293703,0.14127102,0.011838773,0.013759836,0.0028146366,0.0009455139],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.055180687,0.0011302949,0.0037274875,0.0020144708,0.0012151327,0.002997052,0.002872498,0.0029169382,0.007894001],"category_scores_gemma":[0.14090918,0.0013076576,0.0027511509,0.002254494,0.0040850462,0.0065553216,0.0046302457,0.0059361286,0.00097512326],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046380368,0.0003330464,0.030927332,0.00075577066,0.00070238084,0.00053154316,0.0014396643,0.049393646,0.0013479583,0.7985793,0.00279083,0.1127348],"study_design_scores_gemma":[0.00014575182,0.0003144795,0.0052705477,0.00020017652,0.00020996472,0.0002851536,0.00028731392,0.1714823,0.0014736694,0.81422156,0.006051444,0.000057569356],"about_ca_topic_score_codex":0.0023181944,"about_ca_topic_score_gemma":0.0025515545,"teacher_disagreement_score":0.055180687,"about_ca_system_score_codex":0.0015516209,"about_ca_system_score_gemma":0.0039454987,"threshold_uncertainty_score":0.29182684},"labels":[],"label_agreement":null},{"id":"W2139491581","doi":"10.1080/00273171.2012.640600","title":"Using Ensemble-Based Methods for Directly Estimating Causal Effects: An Investigation of Tree-Based G-Computation","year":2012,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; U.S. Public Health Service; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Inverse probability weighting; Statistics; Observational study; Logistic regression; Random forest; Regression; Confounding; Causal inference; Regression analysis; Inverse probability; Econometrics; Mathematics; Computer science; Machine learning; Bayesian probability","score_opus":0.6865806864982038,"score_gpt":0.6435797549976086,"score_spread":0.04300093150059525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2139491581","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008914194,0.00035540515,0.98969007,0.00025112845,0.000027845952,0.00005187298,0.000033334207,0.0001204128,0.0005557312],"genre_scores_gemma":[0.21743083,0.0009437215,0.77986497,0.0002964344,0.0001020871,0.00035555457,0.0001631033,0.000108369575,0.0007349227],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99407154,0.004630181,0.00017833199,0.0003970255,0.0005873246,0.0001356479],"domain_scores_gemma":[0.9191429,0.073088154,0.0016414667,0.0039226706,0.0018694598,0.00033529746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018551677,0.0011601284,0.0023465,0.0023853022,0.0007753023,0.0013472884,0.0021945336,0.0014070624,0.001914767],"category_scores_gemma":[0.0788781,0.00070240133,0.0016133446,0.0023605477,0.0014298728,0.0026353549,0.0020448451,0.002491904,0.0002460634],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010664286,0.00007160735,0.0052033886,0.00017532872,0.00034003338,0.00008916082,0.00030085092,0.73993313,0.00037133522,0.13438922,0.0011597237,0.11785954],"study_design_scores_gemma":[0.000018539049,0.000028165985,0.000306534,0.000032865028,0.00002470651,0.000025902822,0.000018024924,0.9335522,0.00010890238,0.065264836,0.00060983025,0.000009528543],"about_ca_topic_score_codex":0.008694078,"about_ca_topic_score_gemma":0.007373078,"teacher_disagreement_score":0.018551677,"about_ca_system_score_codex":0.0012633301,"about_ca_system_score_gemma":0.0020332208,"threshold_uncertainty_score":0.09811181},"labels":[],"label_agreement":null},{"id":"W2139552401","doi":"10.1007/s00181-006-0095-0","title":"Evaluating multi-treatment programs: theory and evidence from the U.S. Job Training Partnership Act experiment","year":2007,"lang":"en","type":"article","venue":"Empirical Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Benchmark (surveying); General partnership; Computer science; Sample (material); Training (meteorology); Work (physics); Operations research; Business; Finance; Mathematics; Engineering","score_opus":0.6798412018231792,"score_gpt":0.5532420723404441,"score_spread":0.1265991294827351,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2139552401","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9467675,0.0029341823,0.01599597,0.008331783,0.0005513759,0.0029001695,0.001160765,0.000119053984,0.02123916],"genre_scores_gemma":[0.98494476,0.0011405471,0.005413846,0.0014921923,0.00019756999,0.0028369918,0.00045908432,0.000024325533,0.0034906317],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.93665886,0.056354523,0.0007614233,0.0016750618,0.0035168543,0.0010332386],"domain_scores_gemma":[0.7097826,0.24722868,0.023901965,0.011333004,0.004090687,0.0036630987],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.062130332,0.0012222979,0.002308045,0.0009262206,0.002334415,0.0022925723,0.002497818,0.0042355675,0.0109625645],"category_scores_gemma":[0.16589296,0.00071338733,0.0010689705,0.001816899,0.0036251713,0.0026281443,0.0019338173,0.0060377046,0.0013529538],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.19451545,0.15525782,0.09990324,0.0026303187,0.007793377,0.0003283172,0.0035075983,0.04206894,0.0015655581,0.096020624,0.022838848,0.37356985],"study_design_scores_gemma":[0.16035718,0.12605792,0.24540941,0.0024668965,0.012886456,0.00038036602,0.0050206645,0.1470412,0.008003184,0.2571631,0.03460505,0.00060858333],"about_ca_topic_score_codex":0.010300232,"about_ca_topic_score_gemma":0.00890844,"teacher_disagreement_score":0.062130332,"about_ca_system_score_codex":0.00292848,"about_ca_system_score_gemma":0.006234493,"threshold_uncertainty_score":0.3285805},"labels":[],"label_agreement":null},{"id":"W2140873752","doi":"10.1177/0962280213519716","title":"The performance of different propensity score methods for estimating absolute effects of treatments on survival outcomes: A simulation study","year":2014,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":195,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital; University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Observational study; Inverse probability weighting; Statistics; Hazard ratio; Weighting; Average treatment effect; Medicine; Absolute risk reduction; Matching (statistics); Marginal structural model; Inverse probability; Mathematics; Confidence interval; Bayesian probability; Posterior probability","score_opus":0.5155792263631098,"score_gpt":0.6760756832121154,"score_spread":0.1604964568490056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140873752","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.45749053,0.0037024864,0.5289248,0.0019979903,0.00015894951,0.0014000831,0.0011494526,0.0003753363,0.004800288],"genre_scores_gemma":[0.81738955,0.0014254104,0.17748827,0.00032360366,0.00007147383,0.001492866,0.00088508945,0.0000893964,0.00083426124],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96598214,0.029937202,0.0012031589,0.0011382207,0.0013335071,0.00040583347],"domain_scores_gemma":[0.6150419,0.36300597,0.0068366304,0.008953953,0.0050874176,0.0010741471],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06970628,0.0011800594,0.0017018327,0.0028020486,0.0008174933,0.0016019165,0.0017975551,0.0020897684,0.0022492209],"category_scores_gemma":[0.17810358,0.00078942656,0.0032832278,0.0025158045,0.0014058481,0.002541828,0.0018784798,0.0026561401,0.00026644103],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002621951,0.0008229974,0.03794523,0.00042342706,0.0016896782,0.00015559759,0.00042402674,0.870237,0.00044012448,0.0363859,0.0015748872,0.04727917],"study_design_scores_gemma":[0.0004731285,0.00057186425,0.0043032933,0.0001432035,0.00025134938,0.000091788446,0.00009336158,0.9753049,0.00054140907,0.017234001,0.00092847785,0.000063300235],"about_ca_topic_score_codex":0.008581277,"about_ca_topic_score_gemma":0.005417457,"teacher_disagreement_score":0.93029374,"about_ca_system_score_codex":0.00229714,"about_ca_system_score_gemma":0.0021475193,"threshold_uncertainty_score":0.36864644},"labels":[],"label_agreement":null},{"id":"W2142912667","doi":"10.1001/jama.297.3.278","title":"Analysis of Observational Studies in the Presence of Treatment Selection Bias","year":2007,"lang":"en","type":"article","venue":"JAMA","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":788,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; St. Michael's Hospital; Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences; University of Toronto; York University","funders":"National Institute on Aging; Institute for Clinical Evaluative Sciences; Canadian Institutes of Health Research; Dartmouth College","keywords":"Medicine; Propensity score matching; Relative risk; Observational study; Confidence interval; Cardiac catheterization; Myocardial infarction; Selection bias; Internal medicine; Proportional hazards model; Cohort study; Emergency medicine","score_opus":0.5264523418573861,"score_gpt":0.503462976493724,"score_spread":0.02298936536366214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2142912667","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13110386,0.065969035,0.7570085,0.011498677,0.0049840845,0.016621392,0.006409445,0.0007865221,0.0056185205],"genre_scores_gemma":[0.71616715,0.008176116,0.23603186,0.0062866746,0.0029186944,0.026321413,0.0029700876,0.00017215757,0.0009558853],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.22436656,0.68422866,0.048575796,0.01800681,0.023441782,0.0013803656],"domain_scores_gemma":[0.11625405,0.74284226,0.086071186,0.04569504,0.0083561335,0.0007812799],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.49620908,0.0017775656,0.006804421,0.0070686964,0.0016478035,0.005792558,0.003936998,0.005081857,0.0026046825],"category_scores_gemma":[0.737581,0.0017355119,0.009700562,0.010771521,0.0044506653,0.0036805733,0.004875804,0.0040192567,0.000342213],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0065611918,0.00036355574,0.55230975,0.028260008,0.18176466,0.0023864533,0.003417478,0.014624189,0.0012913747,0.052693103,0.010431595,0.14589675],"study_design_scores_gemma":[0.01097617,0.004788965,0.36241382,0.020772813,0.12635703,0.004365416,0.0023119834,0.13096115,0.0052326475,0.27554747,0.05533636,0.00093620067],"about_ca_topic_score_codex":0.0020514366,"about_ca_topic_score_gemma":0.0015011544,"teacher_disagreement_score":0.5037909,"about_ca_system_score_codex":0.0030710176,"about_ca_system_score_gemma":0.006512826,"threshold_uncertainty_score":0.6212639},"labels":[],"label_agreement":null},{"id":"W2144168223","doi":"10.1002/sim.5984","title":"The use of propensity score methods with survival or time‐to‐event outcomes: reporting measures of effect similar to those used in randomized experiments","year":2013,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1441,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Observational study; Marginal structural model; Inverse probability weighting; Medicine; Covariate; Randomized controlled trial; Confounding; Average treatment effect; Statistics; Hazard ratio; Selection bias; Population; Survival analysis; Matching (statistics); Proportional hazards model; Confidence interval; Internal medicine; Mathematics","score_opus":0.45447001760427186,"score_gpt":0.5290019207742545,"score_spread":0.0745319031699826,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2144168223","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007856977,0.0074109593,0.9824929,0.0023354762,0.0010918033,0.0013159605,0.001651181,0.000509948,0.0024059967],"genre_scores_gemma":[0.03131308,0.015987866,0.9277407,0.004357662,0.0027333263,0.012668828,0.0022718462,0.0008063878,0.00212038],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.63943064,0.2924809,0.02367798,0.010842903,0.03267649,0.0008911327],"domain_scores_gemma":[0.429904,0.4315079,0.056376863,0.06826769,0.01300956,0.0009340929],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21747023,0.0041576964,0.004999245,0.010260479,0.0015755405,0.0082487855,0.006004136,0.008134787,0.010013883],"category_scores_gemma":[0.5252035,0.0018896988,0.008818037,0.018248314,0.0061053378,0.012372686,0.008749089,0.012322884,0.0034431724],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004632436,0.00022067092,0.007671661,0.011343051,0.0060817325,0.00021697623,0.0017149311,0.019727986,0.0010024324,0.55355334,0.055481337,0.34252262],"study_design_scores_gemma":[0.0006025329,0.0006282846,0.004716466,0.0050013294,0.0018165468,0.0007356432,0.00039693873,0.034774665,0.0034194917,0.78427774,0.16314241,0.00048801024],"about_ca_topic_score_codex":0.0029941082,"about_ca_topic_score_gemma":0.0019002688,"teacher_disagreement_score":0.7825298,"about_ca_system_score_codex":0.003038803,"about_ca_system_score_gemma":0.008339749,"threshold_uncertainty_score":0.96499854},"labels":[],"label_agreement":null},{"id":"W2145140835","doi":"10.2307/3316021","title":"Semiparametric efficient estimation for the auxiliary outcome problem with the conditional mean model","year":2004,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Estimator; Covariate; Semiparametric regression; Semiparametric model; Outcome (game theory); Mathematics; Conditional expectation; Econometrics; Statistics; Delta method; Score; Variance (accounting); Economics","score_opus":0.12275730340290829,"score_gpt":0.36404272083084915,"score_spread":0.24128541742794085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2145140835","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0097681405,0.00011328166,0.9892117,0.00026461013,0.000011603869,0.000028931692,0.000054623088,0.000051487124,0.0004956224],"genre_scores_gemma":[0.5447542,0.00056792627,0.44882825,0.0003262256,0.00012791806,0.00046380155,0.00063974835,0.00011941698,0.004172489],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9900242,0.007815094,0.00026332145,0.0006943917,0.00086437486,0.00033864597],"domain_scores_gemma":[0.9555917,0.03705224,0.0024517456,0.0030997873,0.0014417061,0.0003628312],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01776881,0.000874174,0.0026525208,0.0014122684,0.00041479824,0.0018978519,0.0027217905,0.0017934948,0.0030030962],"category_scores_gemma":[0.05788252,0.0009614845,0.0015595849,0.001493775,0.0025055944,0.0026113072,0.00299401,0.0024775467,0.0003425327],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017493383,0.00013861441,0.003196921,0.0001837264,0.00034015847,0.00021880685,0.0001893027,0.34527767,0.0007789647,0.6066379,0.0016815026,0.0411814],"study_design_scores_gemma":[0.000047223446,0.000042416657,0.0006651605,0.00003659412,0.00004710717,0.00006149279,0.000022150181,0.7249909,0.0004008521,0.2728028,0.00086102425,0.000022273167],"about_ca_topic_score_codex":0.0026893164,"about_ca_topic_score_gemma":0.0024468214,"teacher_disagreement_score":0.01776881,"about_ca_system_score_codex":0.0013995396,"about_ca_system_score_gemma":0.0021627478,"threshold_uncertainty_score":0.09397161},"labels":[],"label_agreement":null},{"id":"W2146231646","doi":"10.3386/w15301","title":"Matching on the Estimated Propensity Score","year":2009,"lang":"en","type":"report","venue":"National Bureau of Economic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":131,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Banff Centre","funders":"","keywords":"Propensity score matching; Statistics; Matching (statistics); Econometrics; Mathematics; Computer science; Geography","score_opus":0.8414961098396947,"score_gpt":0.6266463557701262,"score_spread":0.21484975406956852,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2146231646","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009676548,0.00033121035,0.98282903,0.0010648964,0.00006533248,0.00020076495,0.000364264,0.00018531333,0.005282664],"genre_scores_gemma":[0.5136899,0.0026423868,0.46022964,0.0017375059,0.00062542217,0.0016226418,0.001649838,0.00036096622,0.017441686],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9862235,0.009285441,0.00045177038,0.0017806677,0.001820772,0.00043786],"domain_scores_gemma":[0.94725287,0.040033244,0.0033769796,0.006409023,0.0026108245,0.00031702872],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022052504,0.00069752836,0.0017462882,0.0025257752,0.00084765133,0.0023088316,0.0021829617,0.0018254407,0.016130457],"category_scores_gemma":[0.15123653,0.0006551591,0.0010740228,0.0037163924,0.002607811,0.0052099833,0.0027752526,0.0036938305,0.0028570571],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006808634,0.000059519654,0.0070941974,0.00016480013,0.00012216331,0.00012201324,0.00019276094,0.05316538,0.00050841033,0.84574336,0.007440922,0.0853184],"study_design_scores_gemma":[0.00008167235,0.00007391462,0.0052698003,0.00017383452,0.000073957424,0.00018829884,0.0000926087,0.24660881,0.0012633982,0.7351077,0.011030485,0.000035545105],"about_ca_topic_score_codex":0.0026744148,"about_ca_topic_score_gemma":0.0016282931,"teacher_disagreement_score":0.022052504,"about_ca_system_score_codex":0.0021540187,"about_ca_system_score_gemma":0.0026068636,"threshold_uncertainty_score":0.1166262},"labels":[],"label_agreement":null},{"id":"W2147784336","doi":"10.1007/s00038-010-0198-4","title":"Marginal Structural Models: unbiased estimation for longitudinal studies","year":2010,"lang":"en","type":"article","venue":"International Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Marginal structural model; Confounding; Weighting; Latent variable; Unbiased Estimation; Estimation; Statistics; Econometrics; Inverse probability weighting; Mathematics; Computer science; Medicine; Economics; Estimator","score_opus":0.5599853245882525,"score_gpt":0.564452031610165,"score_spread":0.0044667070219125415,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147784336","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009021989,0.00059209956,0.99772614,0.00020550407,0.000034440487,0.000050645634,0.0001289128,0.00020573626,0.0001542487],"genre_scores_gemma":[0.10042093,0.0036948626,0.88669443,0.00034991596,0.00050390087,0.0021573629,0.0014240991,0.0005180295,0.004236508],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9773373,0.019119764,0.0005685823,0.0016814499,0.00095766486,0.00033530747],"domain_scores_gemma":[0.83579725,0.14936925,0.0030902033,0.008777069,0.0024383606,0.0005278306],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043337896,0.002778226,0.0050529744,0.0037733298,0.0013656587,0.0031126123,0.0051247594,0.003518921,0.008777084],"category_scores_gemma":[0.19458981,0.0033197275,0.0033520276,0.0047798953,0.0025997953,0.0051607247,0.0038530566,0.0061811386,0.0018393813],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047731373,0.00022551639,0.006281574,0.0010432841,0.0022501668,0.00042824112,0.00071663526,0.20303564,0.00082892535,0.56166995,0.01168211,0.21136071],"study_design_scores_gemma":[0.00009746991,0.000054344313,0.0007039128,0.00014166323,0.000316448,0.00011055537,0.00007062397,0.46105552,0.00031170982,0.53371435,0.003379075,0.00004437171],"about_ca_topic_score_codex":0.007431372,"about_ca_topic_score_gemma":0.0089350995,"teacher_disagreement_score":0.043337896,"about_ca_system_score_codex":0.001462048,"about_ca_system_score_gemma":0.004362036,"threshold_uncertainty_score":0.22919542},"labels":[],"label_agreement":null},{"id":"W2148009828","doi":"10.1002/bimj.200900277","title":"Simulation‐based power calculations for large cohort studies","year":2010,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cancer Care Ontario; McMaster University; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Partenariat Canadien Contre Le Cancer; Ontario Institute for Cancer Research","keywords":"Covariate; Statistics; Proportional hazards model; Cohort; Statistical power; Econometrics; Correlation; Cohort study; Demography; Medicine; Mathematics","score_opus":0.33478582725947154,"score_gpt":0.5248926449178022,"score_spread":0.19010681765833065,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2148009828","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0063111857,0.0005665465,0.9887616,0.0004524471,0.00014644965,0.0010464672,0.00024780014,0.00043449568,0.0020329622],"genre_scores_gemma":[0.17376469,0.00084814755,0.8153566,0.00041618326,0.00014872645,0.0074476185,0.0005174698,0.00030234334,0.0011982855],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9701075,0.026376111,0.000992002,0.00081940554,0.001458645,0.00024636407],"domain_scores_gemma":[0.6732081,0.31026888,0.0040648994,0.0082700215,0.003716675,0.0004714064],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.073534586,0.0010905006,0.0017038138,0.0024685664,0.0007603383,0.0015698074,0.0025875561,0.0019481734,0.010451949],"category_scores_gemma":[0.30306977,0.0008181846,0.0017497112,0.0019509883,0.0010890476,0.001834623,0.0019045849,0.0027090143,0.00084403454],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015901787,0.00023508345,0.009959577,0.0019279817,0.0017314181,0.0007007982,0.00077959977,0.4835545,0.0011935937,0.27708504,0.014106682,0.20713556],"study_design_scores_gemma":[0.00061308854,0.00036446017,0.0012922295,0.00056571036,0.00032061152,0.00044884768,0.00010809773,0.69094074,0.0013864553,0.29177254,0.01214199,0.000045240624],"about_ca_topic_score_codex":0.0011861845,"about_ca_topic_score_gemma":0.00089086016,"teacher_disagreement_score":0.9264654,"about_ca_system_score_codex":0.00087529805,"about_ca_system_score_gemma":0.001753924,"threshold_uncertainty_score":0.3888927},"labels":[],"label_agreement":null},{"id":"W2149706056","doi":"10.1002/sta4.46","title":"Propensity score estimation in the presence of length‐biased sampling: a non‐parametric adjustment approach","year":2014,"lang":"en","type":"article","venue":"Stat","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Propensity score matching; Estimator; Statistics; Econometrics; Hazard ratio; Parametric statistics; Survival analysis; Proportional hazards model; Estimation; Survival function; Sample size determination; Mathematics; Parametric model; Economics; Confidence interval","score_opus":0.3111569212399656,"score_gpt":0.40695715277719324,"score_spread":0.09580023153722766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2149706056","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035658942,0.000099534744,0.9958585,0.00011492293,0.000019058489,0.000048966627,0.00002382368,0.00007853643,0.0001906268],"genre_scores_gemma":[0.38300958,0.0007288946,0.6115434,0.00025593623,0.00023005773,0.0006524519,0.00032777176,0.0001413528,0.00311057],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9893265,0.008031247,0.00036754427,0.0010631006,0.0009307245,0.00028098637],"domain_scores_gemma":[0.97514784,0.018056836,0.0026214302,0.002957746,0.0009982559,0.00021783785],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015473603,0.0007274848,0.0013093855,0.0015123752,0.0006516038,0.0011689138,0.00251149,0.0011653218,0.0024607738],"category_scores_gemma":[0.067146674,0.0006618826,0.0013897087,0.0021474732,0.0013009995,0.0015851491,0.002087101,0.002193381,0.00041591682],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003720724,0.00020607722,0.025086652,0.00032466414,0.0009722825,0.0009972141,0.00064653245,0.25535068,0.0034756337,0.30402565,0.0040258425,0.40451667],"study_design_scores_gemma":[0.00008339275,0.00015093754,0.0046800226,0.00003780033,0.0001457742,0.0002644316,0.00005201528,0.86420447,0.000848184,0.12380966,0.0056717917,0.000051516075],"about_ca_topic_score_codex":0.0037277709,"about_ca_topic_score_gemma":0.0029082585,"teacher_disagreement_score":0.015473603,"about_ca_system_score_codex":0.00082732126,"about_ca_system_score_gemma":0.00198401,"threshold_uncertainty_score":0.08183324},"labels":[],"label_agreement":null},{"id":"W2151471947","doi":"10.1093/bioinformatics/btv219","title":"ESPRESSO: taking into account assessment errors on outcome and exposures in power analysis for association studies","year":2015,"lang":"en","type":"article","venue":"Bioinformatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"FP7 Health; Canadian Institutes of Health Research; European Commission","keywords":"Association (psychology); Outcome (game theory); Computer science; Meta-analysis; Econometrics; Statistics; Psychology; Environmental health; Medicine; Mathematics; Internal medicine","score_opus":0.2878465843490817,"score_gpt":0.4961217734300007,"score_spread":0.20827518908091897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2151471947","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033610906,0.00055601005,0.955059,0.0025204923,0.00043587325,0.0009857652,0.0052764486,0.018113568,0.013691739],"genre_scores_gemma":[0.04320765,0.00041730664,0.92769194,0.0014428811,0.00029132032,0.0046047107,0.003214306,0.012902826,0.006227082],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9625031,0.029689407,0.002132621,0.0020906923,0.0032668752,0.00031727794],"domain_scores_gemma":[0.7271067,0.24573383,0.0059078066,0.015046517,0.005519036,0.0006861599],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07365601,0.001506688,0.0012375583,0.0025052356,0.00080019224,0.0029075865,0.0028302032,0.0022383428,0.09908532],"category_scores_gemma":[0.30136657,0.0015873678,0.0028288108,0.0029569722,0.0019098386,0.003749296,0.0045270436,0.0029876984,0.024278333],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010833397,0.00016279257,0.011672919,0.005304643,0.0012109946,0.00061781757,0.0019971526,0.016783584,0.0023183818,0.14857924,0.28582934,0.5244398],"study_design_scores_gemma":[0.0016720621,0.0005330437,0.0129426215,0.003374276,0.00087194645,0.002141887,0.00027274922,0.1572784,0.010833216,0.40432325,0.40549225,0.0002643271],"about_ca_topic_score_codex":0.0014440193,"about_ca_topic_score_gemma":0.001858074,"teacher_disagreement_score":0.926344,"about_ca_system_score_codex":0.0010582241,"about_ca_system_score_gemma":0.002952481,"threshold_uncertainty_score":0.38953483},"labels":[],"label_agreement":null},{"id":"W2152590022","doi":"10.1002/pds.1673","title":"Goodness‐of‐fit diagnostics for the propensity score model when estimating treatment effects using covariate adjustment with the propensity score","year":2008,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":237,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Medicine; Goodness of fit; Statistics; Econometrics; Internal medicine; Mathematics","score_opus":0.4490533302099411,"score_gpt":0.428672555624695,"score_spread":0.02038077458524612,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2152590022","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014943876,0.00055563357,0.9803814,0.0006224261,0.00012366779,0.0005852072,0.0008447599,0.00060871773,0.0013343125],"genre_scores_gemma":[0.4619717,0.00071972504,0.52600485,0.0010722051,0.00033715647,0.0039525167,0.0035472391,0.00062181253,0.0017727207],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8822712,0.10307251,0.0039507477,0.005149629,0.004801914,0.0007539637],"domain_scores_gemma":[0.53463864,0.43198836,0.01105436,0.016128013,0.0052511515,0.0009394163],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.109984994,0.0017348537,0.0032667988,0.0061215074,0.0011245431,0.0027623207,0.003280637,0.0027852193,0.009021644],"category_scores_gemma":[0.42184395,0.0010065511,0.0033411311,0.0055588223,0.003374644,0.0036948868,0.0039093015,0.0046758913,0.0014984637],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023247083,0.000525869,0.20995905,0.0018842794,0.0068062637,0.0013367544,0.0015102545,0.18298703,0.0014575038,0.20920977,0.027985552,0.3540129],"study_design_scores_gemma":[0.00044914157,0.0010662875,0.03326358,0.0005131447,0.0005499,0.0008488094,0.0004814213,0.7245102,0.0012480879,0.22391714,0.012958947,0.00019331915],"about_ca_topic_score_codex":0.0033579029,"about_ca_topic_score_gemma":0.002004736,"teacher_disagreement_score":0.890015,"about_ca_system_score_codex":0.0012330731,"about_ca_system_score_gemma":0.0034270235,"threshold_uncertainty_score":0.5816632},"labels":[],"label_agreement":null},{"id":"W2153012086","doi":"10.1111/j.1524-4733.2009.00602.x","title":"Good Research Practices for Comparative Effectiveness Research: Analytic Methods to Improve Causal Inference from Nonrandomized Studies of Treatment Effects Using Secondary Data Sources: The ISPOR Good Research Practices for Retrospective Database Analysis Task Force Report—Part III","year":2009,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":290,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Causal inference; Inference; Confounding; Statistical inference; Comparative effectiveness research; Marginal structural model; Medicine; Propensity score matching; Instrumental variable; Outcomes research; Research design; Computer science; Econometrics; Management science; Statistics; Machine learning; Alternative medicine; Artificial intelligence; Engineering; Mathematics","score_opus":0.8166517374954501,"score_gpt":0.7018213479349174,"score_spread":0.11483038956053271,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2153012086","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007430957,0.0063399733,0.974567,0.005983197,0.0008310063,0.007809747,0.00086774386,0.00096649455,0.0018917179],"genre_scores_gemma":[0.0055483025,0.0013530938,0.98064834,0.00072128186,0.00021126682,0.010941559,0.00016423565,0.00024274862,0.00016915212],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.1846051,0.6939537,0.06974253,0.0068140347,0.044064023,0.0008206039],"domain_scores_gemma":[0.068709925,0.7520049,0.022843193,0.107571244,0.04724993,0.0016208022],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6625069,0.0045049936,0.008170646,0.014673661,0.004130589,0.008334371,0.008192461,0.009741425,0.00858853],"category_scores_gemma":[0.85819036,0.008448055,0.008323249,0.013923876,0.010181987,0.007947354,0.008001915,0.018891452,0.0038864457],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015401662,0.00061617716,0.006060954,0.043675218,0.00830146,0.0003621519,0.010879524,0.005616106,0.0019280501,0.13466388,0.110014126,0.6763422],"study_design_scores_gemma":[0.005615057,0.0015032677,0.013216229,0.07513554,0.0102809835,0.0022390073,0.0019329594,0.03648195,0.014895748,0.64448065,0.19331583,0.0009027511],"about_ca_topic_score_codex":0.002488,"about_ca_topic_score_gemma":0.0038120467,"teacher_disagreement_score":0.33749312,"about_ca_system_score_codex":0.004597995,"about_ca_system_score_gemma":0.01878429,"threshold_uncertainty_score":0.41618913},"labels":[],"label_agreement":null},{"id":"W2153434255","doi":"10.1111/j.1524-4733.2009.00600.x","title":"Good Research Practices for Comparative Effectiveness Research: Defining, Reporting and Interpreting Nonrandomized Studies of Treatment Effects Using Secondary Data Sources: The ISPOR Good Research Practices for Retrospective Database Analysis Task Force Report—Part I","year":2009,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":410,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; St. Michael's Hospital","funders":"","keywords":"Comparative effectiveness research; Observational study; Medicine; Outcomes research; Research design; MEDLINE; Management science; Medical education; Alternative medicine; Political science","score_opus":0.827067872307364,"score_gpt":0.6782163137175784,"score_spread":0.1488515585897856,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2153434255","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026086846,0.028451553,0.8551591,0.041641288,0.004527185,0.05206628,0.003922966,0.0023635959,0.009259432],"genre_scores_gemma":[0.011723814,0.0053060916,0.94130754,0.004026701,0.0008203619,0.035165764,0.00065260153,0.0004787897,0.0005182768],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.07467246,0.727362,0.1487023,0.005365074,0.042896297,0.001001934],"domain_scores_gemma":[0.03152167,0.71007997,0.04355283,0.13438125,0.07832268,0.0021415977],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.8188614,0.004278625,0.009915556,0.022719547,0.006520698,0.015469158,0.012684575,0.015987273,0.0057026134],"category_scores_gemma":[0.9128755,0.010650094,0.010172428,0.022344345,0.018065698,0.009132237,0.010010248,0.02305412,0.0050095734],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022072983,0.00077344145,0.0118009485,0.06770996,0.0074018305,0.0006186959,0.027346881,0.003605696,0.0034499892,0.09682884,0.19254196,0.5857146],"study_design_scores_gemma":[0.0054057217,0.002235779,0.032868102,0.19027258,0.009962453,0.0037192297,0.005144582,0.012725346,0.019770388,0.28660047,0.42988905,0.0014063378],"about_ca_topic_score_codex":0.0048467065,"about_ca_topic_score_gemma":0.0076370765,"teacher_disagreement_score":0.18113858,"about_ca_system_score_codex":0.006934171,"about_ca_system_score_gemma":0.040728934,"threshold_uncertainty_score":0.22337615},"labels":[],"label_agreement":null},{"id":"W2153720865","doi":"10.55016/ojs/ajer.v49i3.54984","title":"Which Model is Best? Robustness Properties to Justify Model Choice Among Unidimensional IRT Models under Item Parameter Drift","year":2003,"lang":"en","type":"article","venue":"Alberta Journal of Educational Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Robustness (evolution); Econometrics; Item response theory; Statistical physics; Computer science; Mathematics; Statistics; Psychometrics; Physics","score_opus":0.4434345342535627,"score_gpt":0.4856145623288259,"score_spread":0.042180028075263165,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2153720865","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10025518,0.0011116207,0.8868089,0.0060937325,0.00016067438,0.0003467185,0.0005738188,0.00051055854,0.0041388585],"genre_scores_gemma":[0.8385682,0.0006220308,0.1576775,0.0009956186,0.0003307009,0.00041196207,0.00058789505,0.00021015195,0.0005959765],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9506567,0.03823514,0.002170407,0.0056299134,0.0023193173,0.0009884901],"domain_scores_gemma":[0.59357375,0.35847172,0.016642628,0.026744632,0.003165794,0.0014014759],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09368901,0.0020831572,0.0035689624,0.0035608183,0.0013128233,0.004802101,0.0032742165,0.0048344294,0.0047225],"category_scores_gemma":[0.34233454,0.0011635748,0.0040773614,0.00293077,0.0038608373,0.009890272,0.004481031,0.0061520794,0.00073528197],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026335483,0.00039323515,0.03200592,0.00096095144,0.005220399,0.000810069,0.0018677298,0.32988974,0.0023573847,0.5197732,0.0030820188,0.10100583],"study_design_scores_gemma":[0.00020641243,0.00030589505,0.0030272207,0.00015221305,0.0004076876,0.00025211458,0.00021577638,0.542392,0.0009712331,0.45080775,0.0011643327,0.000097349206],"about_ca_topic_score_codex":0.0025312111,"about_ca_topic_score_gemma":0.0015582925,"teacher_disagreement_score":0.09368901,"about_ca_system_score_codex":0.0019697514,"about_ca_system_score_gemma":0.0019499395,"threshold_uncertainty_score":0.49548078},"labels":[],"label_agreement":null},{"id":"W2154068546","doi":"10.1162/rest.2009.11453","title":"Estimating Treatment Effects from Contaminated Multiperiod Education Experiments: The Dynamic Impacts of Class Size Reductions","year":2010,"lang":"en","type":"article","venue":"The Review of Economics and Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Attrition; Treatment and control groups; Treatment effect; Randomized experiment; Sample size determination; Randomized controlled trial; Class size; Class (philosophy); Econometrics; Cognition; Average treatment effect; Statistics; Mathematics; Psychology; Computer science; Medicine; Propensity score matching; Mathematics education; Artificial intelligence","score_opus":0.037657090147877555,"score_gpt":0.3925355550934054,"score_spread":0.3548784649455278,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2154068546","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.132895,0.0016351035,0.8588195,0.0013092153,0.00027347283,0.0012171358,0.00050989434,0.00040407648,0.002936669],"genre_scores_gemma":[0.7876437,0.00087810477,0.20405692,0.0013252962,0.00023853079,0.0024355073,0.0006405344,0.000107184496,0.0026742886],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93993616,0.049056325,0.0012939493,0.0048646973,0.0041517173,0.00069711194],"domain_scores_gemma":[0.46992624,0.4715364,0.021228174,0.034132864,0.002455354,0.0007209835],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08723218,0.00086391566,0.0026952804,0.0013185065,0.0009239589,0.0023581984,0.0026137314,0.0027874666,0.004342807],"category_scores_gemma":[0.29714784,0.0011180451,0.0021649338,0.0012797839,0.004066643,0.0031277253,0.0025411195,0.0037190362,0.0003545472],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007667327,0.0025857135,0.064498164,0.002082441,0.005883469,0.00050596317,0.0015427114,0.2415532,0.005448391,0.35223755,0.0034353333,0.31255966],"study_design_scores_gemma":[0.0020921973,0.004148744,0.040527623,0.0004396713,0.0022886263,0.0002953358,0.00033794073,0.35364953,0.0075976253,0.57822216,0.010169733,0.00023080263],"about_ca_topic_score_codex":0.0022881376,"about_ca_topic_score_gemma":0.0016942766,"teacher_disagreement_score":0.9127678,"about_ca_system_score_codex":0.0020375503,"about_ca_system_score_gemma":0.0021933008,"threshold_uncertainty_score":0.4613334},"labels":[],"label_agreement":null},{"id":"W2154175900","doi":"10.1186/1471-2288-13-109","title":"Beyond case fatality rate: using potential impact fraction to estimate the effect of increasing treatment uptake on mortality","year":2013,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University Health Network; Sunnybrook Health Science Centre; University of Toronto; Toronto General Hospital; Toronto Public Health","funders":"","keywords":"Case fatality rate; Fraction (chemistry); Medicine; Mortality rate; Demography; Environmental health; Statistics; Emergency medicine; Population; Internal medicine; Mathematics; Chemistry","score_opus":0.6528163280579211,"score_gpt":0.6790984179224019,"score_spread":0.026282089864480773,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2154175900","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058653153,0.0023001018,0.9313868,0.0017303374,0.000098392804,0.0005336189,0.0012374971,0.00029037672,0.003769622],"genre_scores_gemma":[0.80649656,0.0010317351,0.18877137,0.0003592068,0.00013138405,0.00082791125,0.0006055967,0.00008319974,0.0016930462],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9840316,0.011907003,0.00041582595,0.0015217108,0.0018039579,0.000319894],"domain_scores_gemma":[0.9197697,0.06896418,0.0040873694,0.004827281,0.0020909535,0.0002604914],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031220144,0.00088030176,0.0010842951,0.003251918,0.0004722058,0.0013723694,0.0019933889,0.0014414857,0.0030728446],"category_scores_gemma":[0.11430238,0.00035132284,0.0030741084,0.0022253436,0.0018509236,0.0019118786,0.0013081353,0.0015997025,0.00023412665],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009544735,0.00032921313,0.19363433,0.0020297808,0.00362438,0.0004157104,0.0022173747,0.2465223,0.0023895495,0.19934678,0.006582086,0.3419541],"study_design_scores_gemma":[0.00023922315,0.0006919145,0.12133396,0.00072620943,0.0016383622,0.0005404276,0.0004103334,0.5652957,0.0049952096,0.28801396,0.01592276,0.00019204979],"about_ca_topic_score_codex":0.02597823,"about_ca_topic_score_gemma":0.011561838,"teacher_disagreement_score":0.96877986,"about_ca_system_score_codex":0.0033104145,"about_ca_system_score_gemma":0.002624406,"threshold_uncertainty_score":0.16510987},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2154570063","doi":"10.1037/0012-1649.44.2.422","title":"Combining group-based trajectory modeling and propensity score matching for causal inferences in nonexperimental longitudinal data.","year":2008,"lang":"en","type":"article","venue":"Developmental Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":116,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Institute of Mental Health; Canadian Institutes of Health Research; Social Sciences and Humanities Research Council of Canada; Molson Foundation","keywords":"Propensity score matching; Trajectory; Psychology; Observational study; Causal inference; Juvenile delinquency; Matching (statistics); Developmental psychology; Longitudinal study; Covariate; Econometrics; Cognitive psychology; Statistics; Mathematics","score_opus":0.5332881575547377,"score_gpt":0.4577601112091447,"score_spread":0.07552804634559296,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2154570063","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004261232,0.0002507658,0.9937831,0.00037738006,0.000068849076,0.00044635503,0.0002082956,0.00029810317,0.0003059844],"genre_scores_gemma":[0.15019388,0.00050133414,0.8437624,0.0003280297,0.0001996333,0.0031760137,0.0008306789,0.00012588913,0.0008820271],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8882136,0.09986991,0.0021042032,0.006008056,0.0032286271,0.0005756526],"domain_scores_gemma":[0.6218613,0.33904457,0.01048805,0.024438249,0.0031107846,0.0010569688],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13061316,0.0021979483,0.0036846846,0.008274023,0.0022617057,0.003743215,0.00481432,0.0030244354,0.006888858],"category_scores_gemma":[0.33025822,0.0015476546,0.005590638,0.009663131,0.0030623933,0.004565076,0.0063739717,0.0061700884,0.0010276551],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00074166746,0.00095392787,0.051539674,0.0011897427,0.011983136,0.00082756585,0.0030624538,0.14760274,0.00070192514,0.34839165,0.0071404106,0.42586508],"study_design_scores_gemma":[0.00025752658,0.00031205922,0.004301529,0.0001599205,0.00079414446,0.00021911133,0.0002747618,0.5208155,0.00042077422,0.46803844,0.0043235295,0.00008266207],"about_ca_topic_score_codex":0.009630504,"about_ca_topic_score_gemma":0.0070665213,"teacher_disagreement_score":0.13061316,"about_ca_system_score_codex":0.0021062645,"about_ca_system_score_gemma":0.004213785,"threshold_uncertainty_score":0.6907567},"labels":[],"label_agreement":null},{"id":"W2156131834","doi":"10.1177/1740774507085279","title":"Using causal models to show the effect of untestable assumptions on effect estimates in randomized controlled trials","year":2007,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Estimator; Statistics; Randomized controlled trial; Randomization; Econometrics; Range (aeronautics); Mathematics; Sample size determination; Medicine; Treatment effect; Internal medicine","score_opus":0.6583151342331587,"score_gpt":0.6273959759153646,"score_spread":0.030919158317794126,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2156131834","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039543626,0.010336463,0.96387845,0.010284904,0.0016829111,0.0030162074,0.00073628157,0.0006787149,0.0054317396],"genre_scores_gemma":[0.25843912,0.009957446,0.68253905,0.0129814455,0.0025689995,0.030790217,0.0007059196,0.0004166895,0.0016012117],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.2622833,0.68065715,0.016982552,0.012526927,0.02569882,0.0018512794],"domain_scores_gemma":[0.057540752,0.9028795,0.018858034,0.017549833,0.00287444,0.0002974353],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.53476673,0.0047009056,0.008747802,0.0071163666,0.0021303196,0.009569142,0.008383303,0.013064445,0.015495405],"category_scores_gemma":[0.785936,0.0032428824,0.016889328,0.0068281544,0.014062266,0.016363788,0.0063604657,0.019474722,0.001883896],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0041124127,0.00042997132,0.0069936686,0.02448614,0.0163598,0.0008491276,0.0021188671,0.07589251,0.00064519816,0.7492612,0.009808088,0.10904301],"study_design_scores_gemma":[0.0023711917,0.0010132563,0.0013424521,0.005371975,0.0042683873,0.00035732126,0.0001250354,0.120744646,0.0015670507,0.85343224,0.009238531,0.000167984],"about_ca_topic_score_codex":0.0030393,"about_ca_topic_score_gemma":0.0016067825,"teacher_disagreement_score":0.46523327,"about_ca_system_score_codex":0.010566928,"about_ca_system_score_gemma":0.0099145025,"threshold_uncertainty_score":0.57371545},"labels":[],"label_agreement":null},{"id":"W2156390601","doi":"10.1162/003355300554764","title":"Substitution and Dropout Bias in Social Experiments: A Study of an Influential Social Experiment","year":2000,"lang":"en","type":"article","venue":"The Quarterly Journal of Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":270,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Sage Foundation; National Science Foundation","keywords":"Randomized experiment; Substitution (logic); Dropout (neural networks); Drop out; Randomized controlled trial; Treatment and control groups; Psychology; Interpretation (philosophy); Social psychology; Empirical evidence; Econometrics; Computer science; Economics; Statistics; Demographic economics; Medicine; Mathematics","score_opus":0.18143271779288664,"score_gpt":0.41693618600704485,"score_spread":0.2355034682141582,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2156390601","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.650483,0.0047376766,0.29856634,0.009118774,0.00064157334,0.0043316297,0.0002625264,0.00029303684,0.031565443],"genre_scores_gemma":[0.95546174,0.0006466953,0.036097746,0.0020670972,0.0004088127,0.002395804,0.00008150328,0.0000658923,0.0027747718],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.6723409,0.29774,0.004241262,0.011817995,0.011532036,0.002327784],"domain_scores_gemma":[0.13206387,0.7820484,0.034266934,0.042574473,0.007278572,0.0017677941],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27304757,0.0017487803,0.0042698844,0.0030217767,0.00547823,0.0044164215,0.004287605,0.0070731263,0.0070489007],"category_scores_gemma":[0.54660165,0.0010076468,0.0023227194,0.0025051164,0.017672546,0.007425272,0.0039936285,0.0059683914,0.0006588079],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013862462,0.0071686213,0.11621834,0.002299008,0.006297657,0.0023771767,0.039714728,0.014065769,0.0056043994,0.64946306,0.004379195,0.13854966],"study_design_scores_gemma":[0.007873165,0.011083434,0.036349274,0.0007696862,0.003032086,0.0013654535,0.0066936105,0.13071515,0.007265125,0.77450305,0.019984087,0.0003658791],"about_ca_topic_score_codex":0.002465009,"about_ca_topic_score_gemma":0.0015065258,"teacher_disagreement_score":0.72695243,"about_ca_system_score_codex":0.0033101707,"about_ca_system_score_gemma":0.003087764,"threshold_uncertainty_score":0.8964618},"labels":[],"label_agreement":null},{"id":"W2156712261","doi":"10.1016/j.jclinepi.2006.11.008","title":"Readers should systematically assess methods used to identify, measure and analyze confounding in observational cohort studies","year":2007,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Confounding; Medicine; Observational study; Propensity score matching; Cohort study; Internal medicine","score_opus":0.9663047621034415,"score_gpt":0.7829941344178378,"score_spread":0.1833106276856037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2156712261","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00072327425,0.8546933,0.10317311,0.030855846,0.005532067,0.0015307125,0.00069314544,0.00044890295,0.0023495243],"genre_scores_gemma":[0.0066243196,0.67591333,0.2941928,0.013842346,0.004490597,0.0029414336,0.00045904054,0.00020990908,0.001326317],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.8612526,0.09544043,0.020829767,0.0021424904,0.019882103,0.00045261235],"domain_scores_gemma":[0.2619846,0.6717022,0.018277716,0.01169586,0.035495937,0.0008436227],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19095582,0.0023479604,0.010364513,0.01128751,0.0011655699,0.0056397608,0.0075457837,0.008539545,0.0044874963],"category_scores_gemma":[0.5439762,0.002647598,0.0050184918,0.006886373,0.0035264434,0.011157969,0.0031447099,0.009533218,0.004472448],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000267243,0.00013533016,0.0030116162,0.089269295,0.0033915194,0.00023627064,0.0007596962,0.0009772178,0.00044797524,0.012365072,0.06141474,0.82772404],"study_design_scores_gemma":[0.001072718,0.0005065755,0.011511343,0.25034663,0.012398822,0.001966286,0.0014417252,0.0052938657,0.0031088146,0.1854337,0.5263759,0.00054362806],"about_ca_topic_score_codex":0.0029557098,"about_ca_topic_score_gemma":0.00507527,"teacher_disagreement_score":0.8090442,"about_ca_system_score_codex":0.0023744702,"about_ca_system_score_gemma":0.012649265,"threshold_uncertainty_score":0.9976955},"labels":[],"label_agreement":null},{"id":"W2157937931","doi":"10.1016/j.jclinepi.2014.12.012","title":"Confounding, effect modification, and the odds ratio: common misinterpretations","year":2015,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Confounding; Observational study; Covariate; Medicine; Odds ratio; Randomized controlled trial; Odds; Multivariate statistics; Causal inference; Marginal structural model; Effect modification; Logistic regression; Internal medicine; Statistics; Confidence interval; Mathematics; Pathology","score_opus":0.6242836383000328,"score_gpt":0.639468897836851,"score_spread":0.015185259536818263,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2157937931","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012429156,0.15457636,0.51593316,0.29434198,0.012692115,0.00014564856,0.0006986405,0.00073871546,0.00844422],"genre_scores_gemma":[0.4610588,0.075565994,0.30404484,0.09099038,0.06077658,0.00076905434,0.00031446497,0.00076796894,0.0057119257],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90517557,0.06323188,0.011495384,0.0058838907,0.013562664,0.00065061526],"domain_scores_gemma":[0.48422784,0.4724163,0.010405152,0.021250742,0.010759758,0.0009402258],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11363066,0.0016696325,0.0028239484,0.0075186114,0.0017440352,0.00913329,0.0058325487,0.008868568,0.002394692],"category_scores_gemma":[0.4086931,0.0014723304,0.0019840866,0.005192946,0.026515001,0.009744706,0.005486409,0.013584686,0.0007054204],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027316913,0.000062701096,0.0030396385,0.00199818,0.0005588344,0.0015747678,0.0047809696,0.0017504786,0.0004222981,0.86902404,0.03112996,0.08538504],"study_design_scores_gemma":[0.00006263983,0.000018660652,0.0004580639,0.0006479696,0.00012332779,0.0014146697,0.0004912933,0.0030054064,0.00041032146,0.97149223,0.0218119,0.000063555555],"about_ca_topic_score_codex":0.0021769726,"about_ca_topic_score_gemma":0.0016733395,"teacher_disagreement_score":0.88636935,"about_ca_system_score_codex":0.002526679,"about_ca_system_score_gemma":0.003162482,"threshold_uncertainty_score":0.60094357},"labels":[],"label_agreement":null},{"id":"W2158224660","doi":"10.1111/ppe.12107","title":"Case–Crossover Designs for More Patient‐Centred Epidemiology","year":2014,"lang":"en","type":"letter","venue":"Paediatric and Perinatal Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Anesthesiology; Medicine; Library science; Columbia university; Citation; Original research; Family medicine; Media studies; Sociology; Psychiatry; Computer science","score_opus":0.31685544979276065,"score_gpt":0.42745046414195775,"score_spread":0.11059501434919711,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158224660","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026407435,0.010626888,0.31308815,0.6472431,0.01994682,0.00043066652,0.00076967664,0.0003065486,0.0049473704],"genre_scores_gemma":[0.05144027,0.007617979,0.31904364,0.5429806,0.07003323,0.0030373123,0.00036236952,0.00026584187,0.005218731],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90278745,0.0851916,0.0033014163,0.0039190263,0.004434091,0.0003664763],"domain_scores_gemma":[0.31964457,0.65097076,0.0055144434,0.017127682,0.0053638155,0.0013786209],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1424572,0.0009018609,0.0025391513,0.0014185903,0.0009372316,0.0028187917,0.004838811,0.016876997,0.0138844475],"category_scores_gemma":[0.4106994,0.0013212941,0.0025316807,0.0019479796,0.0064151296,0.006468602,0.0021750128,0.02804582,0.0017593204],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016139006,0.00035720482,0.0058805253,0.0027638604,0.0015562276,0.002948517,0.0008762266,0.0060098446,0.00051633717,0.40649414,0.35393628,0.21704695],"study_design_scores_gemma":[0.003676788,0.00032563927,0.002157424,0.0007897579,0.00031375434,0.0020322343,0.00012013097,0.0121146515,0.00020289636,0.879422,0.09874423,0.000100467034],"about_ca_topic_score_codex":0.0014712486,"about_ca_topic_score_gemma":0.0025595252,"teacher_disagreement_score":0.8575428,"about_ca_system_score_codex":0.0023644092,"about_ca_system_score_gemma":0.003006136,"threshold_uncertainty_score":0.7533947},"labels":[],"label_agreement":null},{"id":"W2158460222","doi":"10.1177/0272989x09341755","title":"The Relative Ability of Different Propensity Score Methods to Balance Measured Covariates Between Treated and Untreated Subjects in Observational Studies","year":2009,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":456,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Covariate; Statistics; Observational study; Inverse probability weighting; Weighting; Medicine; Mathematics","score_opus":0.4399813510196111,"score_gpt":0.5151726562683904,"score_spread":0.07519130524877926,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158460222","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02521487,0.009473683,0.9587231,0.0029756497,0.00030374122,0.0007306787,0.00030581743,0.00020284089,0.002069565],"genre_scores_gemma":[0.27254713,0.0066873436,0.71613,0.0011837224,0.00053473265,0.0015414926,0.0004669664,0.00011935834,0.00078924414],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.71544194,0.2575209,0.009908682,0.0067778965,0.0098615885,0.00048904493],"domain_scores_gemma":[0.44453183,0.51053554,0.019087626,0.019621452,0.005527124,0.0006965204],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26412725,0.0015090348,0.002079567,0.006519463,0.0007846547,0.0041158083,0.0027313747,0.0023385477,0.0023178635],"category_scores_gemma":[0.47963735,0.0012805723,0.0033752343,0.007904064,0.0036110687,0.0041248403,0.0035716342,0.003065813,0.00047996818],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016029237,0.00032109863,0.112522,0.003486309,0.011178799,0.00020662523,0.0020837705,0.070020884,0.001411484,0.16012813,0.0042734486,0.63276464],"study_design_scores_gemma":[0.0014390188,0.0016940497,0.090367064,0.0027886997,0.003965213,0.0010073101,0.0006323428,0.28589618,0.005507547,0.58017254,0.026067188,0.00046273356],"about_ca_topic_score_codex":0.00197236,"about_ca_topic_score_gemma":0.0017587024,"teacher_disagreement_score":0.73587275,"about_ca_system_score_codex":0.0018831429,"about_ca_system_score_gemma":0.0022812302,"threshold_uncertainty_score":0.9074621},"labels":[],"label_agreement":null},{"id":"W2158691927","doi":"10.3747/co.v0i0.341","title":"Panel Discussion 3","year":2008,"lang":"en","type":"article","venue":"Current Oncology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Medicine; Data science; Computer science","score_opus":0.6356910130670933,"score_gpt":0.5415724644534431,"score_spread":0.09411854861365021,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158691927","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00069644605,0.0007456723,0.00057330227,0.9159603,0.030809293,0.00029162862,0.0030909826,0.00008896521,0.04774337],"genre_scores_gemma":[0.0031965398,0.00029780125,0.00038156952,0.94318,0.009111398,0.00052065135,0.0004304414,0.00004950742,0.042832136],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9864385,0.003272294,0.0006638756,0.002845583,0.0036360712,0.003143584],"domain_scores_gemma":[0.9451863,0.03700655,0.0014652355,0.0028187234,0.010329339,0.0031938374],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.026430208,0.001488926,0.0024201563,0.0019362228,0.009116302,0.0139733525,0.006118224,0.07580391,0.1418093],"category_scores_gemma":[0.085977554,0.0013828177,0.0041406145,0.0026265688,0.0032635445,0.006782013,0.0054839593,0.046184234,0.050829105],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000046432175,0.000017871127,0.00017639011,0.00005089641,0.000012151211,0.00006240622,0.00007247186,0.00005624797,0.00008302753,0.0063034096,0.99108243,0.002036304],"study_design_scores_gemma":[0.00023220699,0.000031422445,0.002469033,0.000559379,0.00012275932,0.0000812727,0.00083383283,0.0002516063,0.00049798196,0.018881015,0.9759602,0.0000793845],"about_ca_topic_score_codex":0.02813205,"about_ca_topic_score_gemma":0.048399597,"teacher_disagreement_score":0.8581907,"about_ca_system_score_codex":0.0073414575,"about_ca_system_score_gemma":0.014482419,"threshold_uncertainty_score":0.4743994},"labels":[],"label_agreement":null},{"id":"W2159655250","doi":"10.1093/ntr/ntq170","title":"Using Propensity Score Modeling to Minimize the Influence of Confounding Risks Related to Prenatal Tobacco Exposure","year":2010,"lang":"en","type":"article","venue":"Nicotine & Tobacco Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute on Drug Abuse; National Institute of Mental Health; National Institutes of Health","keywords":"Propensity score matching; Confounding; Covariate; Observational study; Selection bias; Medicine; Selection (genetic algorithm); Causal inference; Statistics; Demography; Mathematics; Internal medicine","score_opus":0.5025077699357767,"score_gpt":0.5157942981070719,"score_spread":0.013286528171295164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159655250","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010221803,0.00009950033,0.98850864,0.00028473994,0.000026068217,0.00031729194,0.00009984795,0.0001758245,0.0002663544],"genre_scores_gemma":[0.2677842,0.00041540345,0.72812766,0.00021050753,0.00008452438,0.0021481556,0.00038008287,0.00007787902,0.0007714907],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.974918,0.022191864,0.00057266024,0.00093313464,0.0011325256,0.00025181726],"domain_scores_gemma":[0.9598898,0.03169133,0.0037286484,0.003229875,0.0011864653,0.00027385892],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0381037,0.0012021192,0.001464582,0.002298559,0.0007070926,0.0014586471,0.0017845869,0.0012675371,0.0031414842],"category_scores_gemma":[0.09054371,0.0007002592,0.002544616,0.0031753394,0.0011177267,0.0013188381,0.0023398385,0.001966757,0.00035578542],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007688353,0.0004290508,0.08819484,0.000700307,0.004893633,0.00068311364,0.0011948053,0.38395354,0.0017895412,0.18507268,0.0063988063,0.32592085],"study_design_scores_gemma":[0.00039565147,0.0004831529,0.013145117,0.00018107612,0.00076013926,0.00029051266,0.000113886555,0.7740599,0.0014678984,0.20232676,0.006694136,0.000081712096],"about_ca_topic_score_codex":0.0043650195,"about_ca_topic_score_gemma":0.0036189868,"teacher_disagreement_score":0.0381037,"about_ca_system_score_codex":0.001098371,"about_ca_system_score_gemma":0.004591812,"threshold_uncertainty_score":0.201514},"labels":[],"label_agreement":null},{"id":"W2159845576","doi":"10.1111/j.1541-0420.2009.01380.x","title":"Statistical Identifiability and the Surrogate Endpoint Problem, with Application to Vaccine Trials","year":2010,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health; Fonds Québécois de la Recherche sur la Nature et les Technologies","keywords":"Identifiability; Surrogate endpoint; Computer science; Mathematics; Statistics; Econometrics; Computational biology; Medicine; Biology; Internal medicine","score_opus":0.10773568475868464,"score_gpt":0.4320993986802391,"score_spread":0.3243637139215545,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159845576","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064919414,0.0023200936,0.9817514,0.006866944,0.00013692385,0.00023872634,0.00019859022,0.00008062045,0.0019146998],"genre_scores_gemma":[0.35820037,0.0063202917,0.62404996,0.0030349428,0.0014743506,0.00317582,0.0005174663,0.0001704154,0.003056333],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8460726,0.1374391,0.0033849534,0.0054933047,0.0069124,0.00069757126],"domain_scores_gemma":[0.2867206,0.67549753,0.01647968,0.015526005,0.004895105,0.00088110165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18210499,0.0019836305,0.004052334,0.0038411475,0.0016358044,0.0040099486,0.0028029254,0.0052810987,0.0036266374],"category_scores_gemma":[0.47472107,0.0014545012,0.0040458464,0.0041732555,0.014016003,0.00909113,0.0054521183,0.01104481,0.0003942333],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026225072,0.000057455916,0.003945402,0.00047616666,0.00042888874,0.0004203547,0.0005764536,0.041107614,0.00030951475,0.91173345,0.0014212321,0.039261173],"study_design_scores_gemma":[0.00007365564,0.00007638324,0.00049591664,0.00010857769,0.00005520073,0.00012731494,0.00004669098,0.0641145,0.00018149367,0.9334632,0.0012303999,0.00002677203],"about_ca_topic_score_codex":0.0017483715,"about_ca_topic_score_gemma":0.0008935788,"teacher_disagreement_score":0.18210499,"about_ca_system_score_codex":0.003456418,"about_ca_system_score_gemma":0.0043160506,"threshold_uncertainty_score":0.96307474},"labels":[],"label_agreement":null},{"id":"W2159915215","doi":"10.1002/sim.3012","title":"Effect of exposure misclassification on the mean squared error of population attributable risk and prevented fraction estimates","year":2007,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Statistics; Mean squared error; Attributable risk; Fraction (chemistry); Observational error; Population; Variance (accounting); Econometrics; Accuracy and precision; Mathematics; Medicine; Chemistry; Environmental health; Economics","score_opus":0.07347620403333992,"score_gpt":0.4348047438118476,"score_spread":0.36132853977850765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159915215","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2244652,0.01577966,0.7406015,0.007575578,0.00068617245,0.00027916438,0.0010422779,0.000621434,0.008948923],"genre_scores_gemma":[0.9057229,0.0020238357,0.08954417,0.00067776715,0.00023778473,0.00014571378,0.00033590136,0.00015516774,0.0011568146],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8846031,0.091013335,0.0051760683,0.0073211496,0.010688609,0.0011977892],"domain_scores_gemma":[0.25944754,0.6899979,0.015871145,0.027635342,0.006584912,0.000463192],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12997034,0.001026947,0.001969118,0.0026786025,0.0006352963,0.002226407,0.0020532412,0.0031337317,0.0017135114],"category_scores_gemma":[0.51344556,0.0008303417,0.0021645771,0.0026715943,0.0034605693,0.003923211,0.003403392,0.002776438,0.00031840062],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002287875,0.00012894622,0.21891937,0.0011891092,0.005486035,0.0009881969,0.0019303807,0.43983984,0.0015921321,0.13395397,0.002929836,0.19075434],"study_design_scores_gemma":[0.00039995398,0.0011896064,0.1373666,0.0014142541,0.0024073476,0.0033225785,0.0007102539,0.50068283,0.00832382,0.33650368,0.007228241,0.00045090463],"about_ca_topic_score_codex":0.0034899602,"about_ca_topic_score_gemma":0.002539689,"teacher_disagreement_score":0.8700297,"about_ca_system_score_codex":0.0019476829,"about_ca_system_score_gemma":0.0014414501,"threshold_uncertainty_score":0.68735707},"labels":[],"label_agreement":null},{"id":"W2159968952","doi":"10.1002/sim.3243","title":"Discussion of ‘A critical appraisal of propensity‐score matching in the medical literature between 1996 and 2003’","year":2008,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Institute for Clinical Evaluative Sciences","keywords":"Critical appraisal; Matching (statistics); Library science; Citation; Propensity score matching; Psychology; Operations research; Computer science; Medicine; Alternative medicine; Mathematics; Pathology; Surgery","score_opus":0.12894851090037607,"score_gpt":0.4533669741319672,"score_spread":0.3244184632315911,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159968952","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020378572,0.08564556,0.0099525405,0.8730117,0.025910143,0.00017358348,0.0007389204,0.000060047623,0.0024696845],"genre_scores_gemma":[0.05879097,0.045340616,0.026232721,0.80876315,0.05728844,0.00078086747,0.00063544494,0.00015203057,0.0020156582],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.73682934,0.15257514,0.04086598,0.013494276,0.05142085,0.00481444],"domain_scores_gemma":[0.20151609,0.68991446,0.04865548,0.011385188,0.045970522,0.0025582789],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.369296,0.0010606949,0.0017864548,0.018984709,0.0039290274,0.01251598,0.010692033,0.023463609,0.005054329],"category_scores_gemma":[0.7181724,0.0014703843,0.0058056223,0.017484326,0.016536534,0.013353652,0.0054349536,0.015876824,0.0007538879],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046086506,0.000052720254,0.007799437,0.007364628,0.0016272445,0.00089766126,0.0064607086,0.0013928731,0.00037386522,0.1657014,0.6944119,0.113456786],"study_design_scores_gemma":[0.00034325707,0.00019036312,0.021624336,0.025122399,0.0016027928,0.0016075673,0.0037751344,0.001547304,0.001506243,0.09346278,0.84889853,0.00031935144],"about_ca_topic_score_codex":0.030321775,"about_ca_topic_score_gemma":0.047267072,"teacher_disagreement_score":0.630704,"about_ca_system_score_codex":0.013252633,"about_ca_system_score_gemma":0.03097724,"threshold_uncertainty_score":0.7777703},"labels":[],"label_agreement":null},{"id":"W2160044639","doi":"10.1111/j.1365-2753.2008.01053.x","title":"Are (the log‐odds of) hospital mortality rates normally distributed? Implications for studying variations in outcomes of medical care","year":2009,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Odds; Medicine; Odds ratio; Mortality rate; Health care; Demography; Emergency medicine; Logistic regression; Internal medicine; Political science","score_opus":0.4096959235620088,"score_gpt":0.6266666729180642,"score_spread":0.21697074935605543,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2160044639","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6753866,0.01712629,0.25671086,0.03219715,0.00060879055,0.0010427284,0.0022231182,0.00043851635,0.014266026],"genre_scores_gemma":[0.98412895,0.00067789387,0.013166336,0.0011310133,0.00017349556,0.0002714581,0.00022480874,0.000029466282,0.00019655179],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7921283,0.15784074,0.008493166,0.019967167,0.019443583,0.0021270309],"domain_scores_gemma":[0.16439463,0.762131,0.044537406,0.022222247,0.005462572,0.0012522079],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21207279,0.0010355382,0.0027898813,0.0037953826,0.0009421172,0.0046085506,0.00452235,0.004554559,0.0030858286],"category_scores_gemma":[0.72484785,0.0009189213,0.0035386765,0.004770622,0.015490749,0.007861994,0.0026060096,0.00464571,0.00033911405],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015774766,0.00022584773,0.7884632,0.0011187574,0.0059380643,0.0009195304,0.0045839334,0.021161921,0.00033743086,0.059119307,0.0023386143,0.11421598],"study_design_scores_gemma":[0.00043619392,0.0014169059,0.6113672,0.001927048,0.0019583246,0.0019054275,0.0038012888,0.114454225,0.00080096925,0.25763643,0.004010476,0.00028557517],"about_ca_topic_score_codex":0.021083344,"about_ca_topic_score_gemma":0.0062974915,"teacher_disagreement_score":0.7879272,"about_ca_system_score_codex":0.0050025173,"about_ca_system_score_gemma":0.0038336413,"threshold_uncertainty_score":0.97165453},"labels":[],"label_agreement":null},{"id":"W2160584604","doi":"10.1177/0165025410375912","title":"The effect of population heterogeneity on statistical power in the design and evaluation of interventions","year":2010,"lang":"en","type":"article","venue":"International Journal of Behavioral Development","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; York University; University of Toronto; St. Michael's Hospital","funders":"","keywords":"Psychological intervention; Covariate; Population; Statistical power; Intervention (counseling); Psychology; Outcome (game theory); Statistics; Homogeneous; Power (physics); Econometrics; Demography; Mathematics; Sociology","score_opus":0.23233457129123217,"score_gpt":0.5249256250806007,"score_spread":0.29259105378936856,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2160584604","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06668273,0.0057577197,0.902836,0.01225707,0.0005829616,0.002389698,0.00029166337,0.00032422325,0.008877883],"genre_scores_gemma":[0.8324838,0.0011268248,0.15849885,0.002512888,0.00033289217,0.004339797,0.00009318592,0.00017691003,0.00043482773],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.3954743,0.55452573,0.014872838,0.01355758,0.019170932,0.0023985764],"domain_scores_gemma":[0.10073804,0.85502636,0.013654658,0.025974358,0.0040076645,0.0005988771],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.48201758,0.0016937056,0.004621016,0.0024432566,0.0015741535,0.004954291,0.0032813512,0.0050747376,0.0029488239],"category_scores_gemma":[0.79886574,0.0018393383,0.0036149276,0.0022841382,0.011363455,0.009669404,0.005766203,0.0060513522,0.000362423],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0076563675,0.00079379394,0.059271134,0.005099992,0.012719964,0.0010373922,0.010102578,0.10332482,0.004649906,0.35920918,0.004949452,0.43118545],"study_design_scores_gemma":[0.0024595943,0.0035598564,0.02644786,0.0022615732,0.0026269031,0.0006640426,0.0007755149,0.12197612,0.008110572,0.8213526,0.009398003,0.00036739442],"about_ca_topic_score_codex":0.0019045551,"about_ca_topic_score_gemma":0.0014270222,"teacher_disagreement_score":0.5179824,"about_ca_system_score_codex":0.0034110781,"about_ca_system_score_gemma":0.004316141,"threshold_uncertainty_score":0.6387646},"labels":[],"label_agreement":null},{"id":"W2160704894","doi":"10.1093/aje/kwq224","title":"Statistical Criteria for Selecting the Optimal Number of Untreated Subjects Matched to Each Treated Subject When Using Many-to-One Matching on the Propensity Score","year":2010,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":667,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; University of Toronto","keywords":"Propensity score matching; Matching (statistics); Statistics; Estimator; Mathematics; Average treatment effect; Mean squared error; Observational study; Medicine","score_opus":0.26098998981920396,"score_gpt":0.46223968140121985,"score_spread":0.2012496915820159,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2160704894","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034336023,0.001586408,0.9554309,0.0021802783,0.0002031991,0.0035032327,0.0003865751,0.0003191236,0.002054253],"genre_scores_gemma":[0.16094819,0.0004902479,0.8323458,0.00090436335,0.00021351557,0.0040626456,0.00044674528,0.0001009241,0.0004875907],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.88179266,0.094613716,0.009956491,0.004485859,0.008235248,0.00091609574],"domain_scores_gemma":[0.61707485,0.3365382,0.016995555,0.013361994,0.01368485,0.0023446546],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14827183,0.0013108966,0.005615314,0.006165978,0.0016771882,0.0029547138,0.003664391,0.003901966,0.003036596],"category_scores_gemma":[0.3915726,0.0012452553,0.0023898056,0.0050680297,0.0031272543,0.0026881606,0.0031019137,0.00332539,0.00059881055],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008826949,0.001685319,0.061013114,0.002980879,0.0031425112,0.00096594665,0.0010784853,0.17737998,0.0045800335,0.16378559,0.01653469,0.55802655],"study_design_scores_gemma":[0.005095374,0.003955806,0.029213687,0.0019015196,0.0016758151,0.0011194733,0.0005274167,0.61938715,0.008762997,0.30935192,0.018576121,0.00043279026],"about_ca_topic_score_codex":0.0012455715,"about_ca_topic_score_gemma":0.0011257238,"teacher_disagreement_score":0.8517282,"about_ca_system_score_codex":0.0016334171,"about_ca_system_score_gemma":0.003623835,"threshold_uncertainty_score":0.7841458},"labels":[],"label_agreement":null},{"id":"W2161040745","doi":"10.1002/sim.2073","title":"Using generalized additive models to reduce residual confounding","year":2004,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":103,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal General Hospital","funders":"","keywords":"Covariate; Confounding; Statistics; Logistic regression; Mathematics; Parametric statistics; Context (archaeology); Generalized linear model; Econometrics; Linear regression","score_opus":0.3116101435216381,"score_gpt":0.5048658643751648,"score_spread":0.19325572085352666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2161040745","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031662893,0.00077574456,0.9934495,0.00035071932,0.00015449717,0.00012923652,0.0003065706,0.0005886152,0.0010788841],"genre_scores_gemma":[0.12969592,0.0024438205,0.8584077,0.0007146479,0.00031080924,0.0014266436,0.0011008956,0.0007191746,0.0051804157],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98415923,0.012078535,0.00059117266,0.0015066495,0.0012829276,0.0003814747],"domain_scores_gemma":[0.9756437,0.019855196,0.001293358,0.0015716474,0.0014771161,0.00015903545],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019493867,0.0028054162,0.0032419008,0.0027075536,0.00089577225,0.0033452385,0.004014543,0.0024534913,0.0076556634],"category_scores_gemma":[0.052948758,0.0012958118,0.005238638,0.0035455027,0.0011005584,0.0020763038,0.0036452336,0.0041571045,0.0016296501],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030060372,0.00022520738,0.008845039,0.0015626871,0.0035418996,0.0011851116,0.0010570273,0.5401752,0.002183527,0.23730049,0.011308967,0.19231424],"study_design_scores_gemma":[0.00012558843,0.00023114451,0.0017677001,0.0002983254,0.0008455682,0.00032788972,0.00016027718,0.73966295,0.00096782844,0.22840813,0.027066484,0.00013817033],"about_ca_topic_score_codex":0.013381085,"about_ca_topic_score_gemma":0.013697355,"teacher_disagreement_score":0.019493867,"about_ca_system_score_codex":0.0014895145,"about_ca_system_score_gemma":0.0036471908,"threshold_uncertainty_score":0.10309464},"labels":[],"label_agreement":null},{"id":"W2162163884","doi":"10.1136/jech.55.7.508","title":"A heuristic approach to the formulas for population attributable fraction","year":2001,"lang":"en","type":"article","venue":"Journal of Epidemiology & Community Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":289,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Confounding; Fraction (chemistry); Attributable risk; Medicine; Heuristic; Population; Representation (politics); Limit (mathematics); USable; Econometrics; Statistics; Public health; Distribution (mathematics); Estimation; Environmental health; Computer science; Artificial intelligence; Mathematics; Pathology","score_opus":0.5047912795363017,"score_gpt":0.5411379398954912,"score_spread":0.03634666035918954,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2162163884","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005234293,0.00044888537,0.9942755,0.0009204717,0.00014127513,0.000058532987,0.00009050528,0.00017092074,0.0033704296],"genre_scores_gemma":[0.037449524,0.001092968,0.9560311,0.0009052032,0.00045568464,0.0006041339,0.00017937414,0.00024463912,0.0030373835],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9898545,0.0061377636,0.00058225536,0.00080041715,0.0023598059,0.0002654037],"domain_scores_gemma":[0.9753945,0.019561866,0.001019375,0.001926927,0.0019679929,0.00012939361],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014722174,0.0018688135,0.0012849559,0.0052859676,0.0010332173,0.00365482,0.0036573678,0.0022653178,0.011715248],"category_scores_gemma":[0.07911607,0.0008467226,0.0018528441,0.004482408,0.00405439,0.0064149387,0.0031013668,0.0052282237,0.0034738884],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002186692,0.000021484138,0.00042556552,0.0001506201,0.00003116122,0.00014642495,0.00023349487,0.014622443,0.00017478052,0.9212099,0.008649228,0.054313138],"study_design_scores_gemma":[0.000024017889,0.000029251227,0.00018804785,0.00014819608,0.00003420764,0.00034763917,0.00007068007,0.06796742,0.00040134706,0.90810263,0.022653086,0.000033628417],"about_ca_topic_score_codex":0.0024942872,"about_ca_topic_score_gemma":0.002086011,"teacher_disagreement_score":0.014722174,"about_ca_system_score_codex":0.002706726,"about_ca_system_score_gemma":0.0023984532,"threshold_uncertainty_score":0.07785922},"labels":[],"label_agreement":null},{"id":"W2163206453","doi":"10.1111/biom.12271","title":"Discussion of “On Bayesian Estimation of Marginal Structural Models”","year":2015,"lang":"en","type":"letter","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Bayesian probability; Bayesian inference; Posterior probability; Outcome (game theory); Computer science; Inference; Context (archaeology); Model selection; Econometrics; Statistics; Mathematics; Artificial intelligence; Mathematical economics","score_opus":0.21176795249765404,"score_gpt":0.4128808229036175,"score_spread":0.20111287040596346,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2163206453","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012665499,0.012198468,0.89662135,0.07052465,0.0027913651,0.00010017386,0.00040702795,0.0001821844,0.015908314],"genre_scores_gemma":[0.13242283,0.022924542,0.75224507,0.0532546,0.016524637,0.0016263303,0.0008240458,0.0006801844,0.019497862],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96530205,0.028545287,0.0009736831,0.0019083391,0.002799937,0.0004707084],"domain_scores_gemma":[0.9283647,0.06346703,0.0017213394,0.0037019628,0.002299727,0.00044521183],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.046050258,0.0020243735,0.0022768138,0.0025190555,0.0018333242,0.004048741,0.0075552273,0.008237761,0.011265139],"category_scores_gemma":[0.11078001,0.001646777,0.00400295,0.0041548703,0.009977148,0.010109519,0.004386797,0.013078809,0.0022629339],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00000847862,0.000010691724,0.00014417992,0.00011844217,0.00005433756,0.000038922215,0.0001330219,0.0037263623,0.000029761213,0.9761297,0.008781871,0.010824205],"study_design_scores_gemma":[0.000007627553,0.000009878161,0.00011319099,0.00011901226,0.000013825261,0.000036319056,0.000025032046,0.012305317,0.00005221686,0.96810293,0.019196944,0.000017683082],"about_ca_topic_score_codex":0.0070597935,"about_ca_topic_score_gemma":0.0068199974,"teacher_disagreement_score":0.046050258,"about_ca_system_score_codex":0.004733661,"about_ca_system_score_gemma":0.002922677,"threshold_uncertainty_score":0.24353999},"labels":[],"label_agreement":null},{"id":"W2164404559","doi":"10.1136/bmjopen-2014-005297","title":"Interpreting trial results following use of different intention-to-treat approaches for preventing attrition bias: a meta-epidemiological study protocol","year":2014,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Parker Institute for Cancer Immunotherapy; Oak Foundation","keywords":"Medicine; Protocol (science); Attrition; Epidemiology; Selection bias; Publication bias; Alternative medicine; Meta-analysis; Environmental health; Pathology","score_opus":0.8468178363736624,"score_gpt":0.5865171235954936,"score_spread":0.2603007127781688,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164404559","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010408907,0.0010347948,0.04775416,0.0009540493,0.0018322314,0.9420783,0.003314861,0.00081436307,0.0011763771],"genre_scores_gemma":[0.0014028169,0.00017918232,0.027719384,0.00026143002,0.00006183653,0.9698574,0.00025840692,0.00004161815,0.000217945],"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","domain_scores_codex":[0.54440296,0.34130138,0.076611534,0.017654557,0.017225143,0.0028044123],"domain_scores_gemma":[0.60683924,0.21771897,0.050441064,0.07725621,0.043380693,0.0043638097],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.36633945,0.008920852,0.015082846,0.0118787335,0.0026640175,0.00762315,0.005937747,0.019838732,0.03449022],"category_scores_gemma":[0.5241475,0.0060673426,0.022887312,0.011838195,0.0068304506,0.0071342457,0.004395207,0.017662292,0.013579774],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.12153967,0.0026936934,0.005643968,0.42069325,0.055879924,0.0016332599,0.007095133,0.014072113,0.006710199,0.07735243,0.10666287,0.18002355],"study_design_scores_gemma":[0.25204304,0.013221734,0.014405627,0.12759033,0.05286732,0.0013696677,0.0010068043,0.07255606,0.017332098,0.19788301,0.24734941,0.002374888],"about_ca_topic_score_codex":0.00096050743,"about_ca_topic_score_gemma":0.001170588,"teacher_disagreement_score":0.98491716,"about_ca_system_score_codex":0.0062880307,"about_ca_system_score_gemma":0.019142982,"threshold_uncertainty_score":0.7814163},"labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad"],"domain":"methods","study_design":"meta_analysis","genre":"protocol","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["metaresearch","metaepi_narrow","metaepi_broad"],"domain":"methods","study_design":"meta_analysis","genre":"protocol","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2164498941","doi":"10.1002/sim.2580","title":"A comparison of the ability of different propensity score models to balance measured variables between treated and untreated subjects: a Monte Carlo study","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1134,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Outcome (game theory); Statistics; Matching (statistics); Medicine; Average treatment effect; Variables; Econometrics; Mathematics","score_opus":0.20433493146265783,"score_gpt":0.40639983108407973,"score_spread":0.2020648996214219,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164498941","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.84632206,0.0015261852,0.14794803,0.00065516296,0.00006792765,0.0006625701,0.0003037346,0.00015572982,0.0023586429],"genre_scores_gemma":[0.9491639,0.0005614044,0.04845314,0.00026119972,0.000036917125,0.00046521844,0.000405913,0.00005329924,0.0005989801],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9815192,0.015978612,0.0005199485,0.0008710177,0.00074026966,0.0003708512],"domain_scores_gemma":[0.740361,0.24029021,0.005693611,0.009473369,0.0030889215,0.0010929554],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04845132,0.0008524176,0.0016802121,0.0014264224,0.0007175,0.0013477242,0.001399815,0.0018137979,0.0011688459],"category_scores_gemma":[0.122049816,0.0007098514,0.0024247332,0.0011862394,0.0016824844,0.0019069549,0.0011314055,0.0016368141,0.00015688929],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0060498635,0.0012473614,0.048527118,0.00029503863,0.0025140315,0.0002295064,0.00064618123,0.86531645,0.0011689281,0.038750008,0.001361311,0.03389415],"study_design_scores_gemma":[0.0004035115,0.0011159499,0.007384622,0.00008313108,0.0002840767,0.00010269539,0.00010450498,0.9747498,0.0009780137,0.014049841,0.00067083293,0.000073083254],"about_ca_topic_score_codex":0.007454513,"about_ca_topic_score_gemma":0.003993871,"teacher_disagreement_score":0.9515487,"about_ca_system_score_codex":0.0019863462,"about_ca_system_score_gemma":0.0016740398,"threshold_uncertainty_score":0.2562381},"labels":[],"label_agreement":null},{"id":"W2164621115","doi":"10.1186/s13104-015-1042-y","title":"Intracluster correlation coefficients for sample size calculations related to cardiovascular disease prevention and management in primary care practices","year":2015,"lang":"en","type":"article","venue":"BMC Research Notes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Ottawa Hospital; University of Ottawa; Bruyère","funders":"Canadian Institutes of Health Research; Pfizer Canada; Pfizer","keywords":"Medicine; Dyslipidemia; Rurality; Sample size determination; Kidney disease; Emergency medicine; Family medicine; Disease; Demography; Internal medicine; Rural area; Statistics","score_opus":0.4115931239208963,"score_gpt":0.5210959032071013,"score_spread":0.109502779286205,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164621115","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28600875,0.0070821303,0.66345924,0.00203329,0.0024116917,0.011184663,0.007716155,0.0024448205,0.017659297],"genre_scores_gemma":[0.7679944,0.00048039985,0.21326706,0.0004900894,0.00042363658,0.014155234,0.0018925116,0.0005097261,0.0007869325],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.62486356,0.26589987,0.03131422,0.026742514,0.049571995,0.0016078827],"domain_scores_gemma":[0.24187921,0.6455297,0.04569572,0.040682323,0.025191113,0.0010219124],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21891378,0.0016839748,0.0028805756,0.0083729355,0.0017238,0.0020904785,0.0027148693,0.0023593453,0.003149606],"category_scores_gemma":[0.62590903,0.0009975467,0.0051745255,0.00802377,0.0054424335,0.003103567,0.0031108563,0.0039031084,0.00096699013],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017830489,0.00042923552,0.7862074,0.0034583602,0.012212394,0.00058291253,0.006582943,0.009624814,0.0016583665,0.015324896,0.022651877,0.13948373],"study_design_scores_gemma":[0.0010397094,0.0060994662,0.76050425,0.0033061565,0.0051909825,0.0025736762,0.004570605,0.11398037,0.00935131,0.04789286,0.044780955,0.0007097576],"about_ca_topic_score_codex":0.0024398165,"about_ca_topic_score_gemma":0.0024074041,"teacher_disagreement_score":0.7810862,"about_ca_system_score_codex":0.002483531,"about_ca_system_score_gemma":0.0025453991,"threshold_uncertainty_score":0.9632184},"labels":[],"label_agreement":null},{"id":"W2168014332","doi":"10.1186/1742-5573-6-4","title":"Identifiability, exchangeability and confounding revisited","year":2009,"lang":"en","type":"article","venue":"Epidemiologic Perspectives & Innovations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":158,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Confounding; Identifiability; Perspective (graphical); Epidemiology; Quarter (Canadian coin); Medicine; Data science; Computer science; History; Pathology; Artificial intelligence","score_opus":0.25201067295649354,"score_gpt":0.4872205454819779,"score_spread":0.23520987252548436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2168014332","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024758467,0.046941705,0.83188224,0.06999145,0.0018727633,0.00012985012,0.00046189828,0.00010171467,0.02385989],"genre_scores_gemma":[0.76407975,0.044821315,0.14640409,0.019289108,0.010129219,0.0007084432,0.0006237393,0.00016304996,0.013781183],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95760465,0.028033372,0.0023388395,0.004570988,0.0060268347,0.0014253963],"domain_scores_gemma":[0.8176879,0.16191787,0.009197238,0.007122511,0.0034204046,0.00065407186],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.058227573,0.0015375649,0.0035885095,0.0039028043,0.0018502286,0.0053173755,0.0026996469,0.0043561775,0.0051064324],"category_scores_gemma":[0.11568008,0.00094028556,0.0029401248,0.0058967266,0.017679285,0.012891545,0.0071022403,0.010852767,0.00043142174],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002941564,0.0000096247595,0.0010929585,0.00018086183,0.00011842052,0.0001517024,0.00046991988,0.0013984661,0.00008172157,0.9842137,0.00071900274,0.011534182],"study_design_scores_gemma":[0.00001393385,0.000015048005,0.00030942637,0.00009088576,0.00003531925,0.00013357558,0.000056929235,0.0012934983,0.00007856061,0.9943779,0.003582087,0.000012788041],"about_ca_topic_score_codex":0.0026048522,"about_ca_topic_score_gemma":0.001042988,"teacher_disagreement_score":0.9417724,"about_ca_system_score_codex":0.0035475283,"about_ca_system_score_gemma":0.0034958276,"threshold_uncertainty_score":0.30794048},"labels":[],"label_agreement":null},{"id":"W2168082315","doi":"10.1002/sim.6020","title":"Marginal structural models for skewed outcomes: identifying causal relationships in health care utilization","year":2013,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Institut National de Santé Publique du Québec; Sante Montreal; McGill University; McGill University Health Centre","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Negative binomial distribution; Causal inference; Generalized linear model; Marginal structural model; Inference; Marginal model; Emergency department; Propensity score matching; Econometrics; Poisson distribution; Psychological intervention; Statistics; Baseline (sea); Generalized linear mixed model; Robustness (evolution); Count data; Medicine; Computer science; Mathematics","score_opus":0.3202027902674543,"score_gpt":0.4968382609247534,"score_spread":0.17663547065729912,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2168082315","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20636442,0.00066399906,0.7869327,0.002403895,0.000063412735,0.00039864326,0.0007558538,0.00029511194,0.002121967],"genre_scores_gemma":[0.90294313,0.0004986846,0.09377538,0.00024891287,0.00009480736,0.0004995904,0.00048993237,0.00004691515,0.0014025758],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98165417,0.01491744,0.00040733267,0.0014856724,0.0009003903,0.00063497835],"domain_scores_gemma":[0.770366,0.20348348,0.011695347,0.011311071,0.0023251646,0.00081889157],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040777378,0.00095325836,0.0017639677,0.002094201,0.0008815238,0.0018828103,0.003063973,0.0013840965,0.0062560164],"category_scores_gemma":[0.17871334,0.0007062097,0.0029564647,0.0024610069,0.0035666926,0.003207521,0.0031976264,0.0035754475,0.00038767213],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069524377,0.00032647725,0.10425092,0.0003813853,0.0014123063,0.0007044756,0.0023292825,0.29670662,0.0005640402,0.4934606,0.0026196684,0.09654895],"study_design_scores_gemma":[0.00014794226,0.00019243965,0.012159452,0.00009294873,0.00023404397,0.00014681157,0.0003964502,0.5704511,0.0003095624,0.41441378,0.0014132606,0.000042210137],"about_ca_topic_score_codex":0.016279882,"about_ca_topic_score_gemma":0.014989972,"teacher_disagreement_score":0.040777378,"about_ca_system_score_codex":0.002572402,"about_ca_system_score_gemma":0.0027413096,"threshold_uncertainty_score":0.2156539},"labels":[],"label_agreement":null},{"id":"W2168397874","doi":"10.1177/0002716209351525","title":"Strategies for Dealing with the Problem of Non-overlapping Units of Assignment and Outcome Measurement in Field Experiments","year":2010,"lang":"en","type":"article","venue":"The Annals of the American Academy of Political and Social Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Outcome (game theory); Field (mathematics); Unit (ring theory); Interpretation (philosophy); Operations research; Computer science; Contrast (vision); Measure (data warehouse); Units of measurement; Econometrics; Mathematical economics; Data mining; Mathematics; Artificial intelligence; Mathematics education; Physics","score_opus":0.3526738755658821,"score_gpt":0.4957994352009775,"score_spread":0.14312555963509543,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2168397874","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027167948,0.0002966976,0.99095166,0.0018471569,0.00022897667,0.0018446211,0.00007581074,0.00015213009,0.0018860803],"genre_scores_gemma":[0.044681042,0.00022753593,0.9303995,0.0011853148,0.00030637116,0.021986252,0.000107633,0.000077337274,0.0010290423],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.34715152,0.59772044,0.013625852,0.02210291,0.017631775,0.0017674267],"domain_scores_gemma":[0.14848375,0.7232573,0.03100344,0.08526392,0.010135429,0.0018561155],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5110725,0.0050928793,0.010138535,0.005749704,0.0070816134,0.009381275,0.014071703,0.013377768,0.011037702],"category_scores_gemma":[0.71463865,0.006228587,0.0052297944,0.009144486,0.020031845,0.016349228,0.014644603,0.017781897,0.0021445],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017049994,0.0008707612,0.0066066924,0.0019258944,0.0026756786,0.0006108173,0.009347319,0.021106243,0.0013356026,0.7843129,0.0066189207,0.16288416],"study_design_scores_gemma":[0.0011401118,0.0006545632,0.001743512,0.00045187026,0.00039600942,0.00024281048,0.0006223678,0.037531346,0.001519065,0.9447206,0.010827654,0.00015008707],"about_ca_topic_score_codex":0.003345844,"about_ca_topic_score_gemma":0.0029262812,"teacher_disagreement_score":0.48892748,"about_ca_system_score_codex":0.007710788,"about_ca_system_score_gemma":0.010548871,"threshold_uncertainty_score":0.60293466},"labels":[],"label_agreement":null},{"id":"W2169425545","doi":"10.1002/sim.6276","title":"The use of bootstrapping when using propensity‐score matching without replacement: a simulation study","year":2014,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":278,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Services and Policy Research; University of Toronto; Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Bootstrapping (finance); Statistics; Resampling; Standard error; Matching (statistics); Confidence interval; Sample size determination; Standard deviation; Sampling distribution; Observational study; Econometrics; Mathematics","score_opus":0.38854138632668395,"score_gpt":0.46673056535998564,"score_spread":0.07818917903330169,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2169425545","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5119101,0.0042368346,0.4669323,0.0023386364,0.0002870101,0.0028826233,0.0009938418,0.00029600348,0.010122686],"genre_scores_gemma":[0.81787974,0.0020100994,0.17528425,0.0003949073,0.00012632327,0.002420425,0.00071192434,0.00008999816,0.0010823831],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9766982,0.020502148,0.0007575348,0.0006807402,0.00095544965,0.0004059921],"domain_scores_gemma":[0.7162633,0.26068512,0.0054048337,0.0099404985,0.0068631875,0.00084315095],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.050555594,0.001215734,0.0017522867,0.001828218,0.0012101728,0.0015970112,0.0021306246,0.002479335,0.0032218164],"category_scores_gemma":[0.15563107,0.0006687638,0.002725584,0.0028805838,0.0013004261,0.0026859983,0.0018765338,0.003218769,0.00034245828],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0047195964,0.003925244,0.056405105,0.001437992,0.00201607,0.0012231233,0.0015842897,0.7029054,0.0012146996,0.12480492,0.0071539143,0.09260957],"study_design_scores_gemma":[0.0008707447,0.0012199797,0.003987448,0.00036791514,0.00055677403,0.00028524044,0.00035243962,0.9548794,0.0011498989,0.03293831,0.003290683,0.00010116572],"about_ca_topic_score_codex":0.008527655,"about_ca_topic_score_gemma":0.00665656,"teacher_disagreement_score":0.9494444,"about_ca_system_score_codex":0.0018566762,"about_ca_system_score_gemma":0.0017759546,"threshold_uncertainty_score":0.26736677},"labels":[],"label_agreement":null},{"id":"W2169900945","doi":"10.1002/sim.2733","title":"Accounting for expected attrition in the planning of community intervention trials","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Robarts Clinical Trials; Western University; Ottawa Hospital","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Attrition; Sample size determination; Statistics; Randomization; Cohort; Demography; Population; Cluster randomised controlled trial; Sample (material); Cluster (spacecraft); Psychological intervention; Standard error; Econometrics; Medicine; Randomized controlled trial; Mathematics; Computer science; Environmental health; Surgery","score_opus":0.39420011802620225,"score_gpt":0.5438528487911372,"score_spread":0.1496527307649349,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2169900945","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019387754,0.0010838736,0.99108535,0.0017231061,0.00014272265,0.0020935081,0.00013671993,0.00033051043,0.0014654583],"genre_scores_gemma":[0.07161114,0.0014533702,0.91345716,0.0010872101,0.00024957562,0.01076553,0.00025662428,0.00015044611,0.0009688686],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.607767,0.35690066,0.013179721,0.00740574,0.01340082,0.0013460519],"domain_scores_gemma":[0.29556453,0.6514468,0.02185399,0.019941904,0.01014112,0.0010515712],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3630015,0.002867408,0.0046194345,0.0044585145,0.0012117184,0.004043929,0.0050326074,0.0040011425,0.0045096707],"category_scores_gemma":[0.689842,0.0026758614,0.0033725505,0.0042917766,0.0036198634,0.008783027,0.0040946444,0.0064266864,0.0012755212],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018255045,0.00027967477,0.009941005,0.0055948533,0.0018692637,0.00071128475,0.0020972209,0.13808157,0.00064438937,0.3371189,0.009669697,0.49216667],"study_design_scores_gemma":[0.0010417887,0.0009978279,0.0025691367,0.0023751683,0.0010261402,0.000308994,0.0002034473,0.28029275,0.0026770344,0.69123954,0.017122565,0.00014554914],"about_ca_topic_score_codex":0.0026344678,"about_ca_topic_score_gemma":0.0029938237,"teacher_disagreement_score":0.63699853,"about_ca_system_score_codex":0.003962654,"about_ca_system_score_gemma":0.013576786,"threshold_uncertainty_score":0.7855326},"labels":[],"label_agreement":null},{"id":"W2170832176","doi":"10.20982/tqmp.08.2.p070","title":"Using partial components to restore and use the concurrent validity of the Index of Readiness","year":2012,"lang":"en","type":"article","venue":"Tutorials in Quantitative Methods for Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Index (typography); Concurrent validity; Computer science; Psychology; Reliability engineering; Statistics; Mathematics; Engineering; Programming language; Psychometrics; Internal consistency","score_opus":0.8114562747743347,"score_gpt":0.6701349316774364,"score_spread":0.14132134309689826,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2170832176","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024082014,0.00053778925,0.9606425,0.0006809279,0.00064979953,0.0008984293,0.00054410135,0.001195145,0.010769319],"genre_scores_gemma":[0.22612311,0.0006849443,0.7633448,0.000317514,0.00024792113,0.0034832822,0.0010944658,0.0006568639,0.0040470585],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9859205,0.0071472125,0.001779148,0.0020383818,0.0026968552,0.00041785886],"domain_scores_gemma":[0.95957166,0.017535772,0.0020915668,0.013895704,0.0065570152,0.00034822518],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022510003,0.002468919,0.0013114954,0.0049643978,0.0017719351,0.004567848,0.0017197471,0.00094408065,0.010747748],"category_scores_gemma":[0.12058222,0.0011069071,0.0033079155,0.007894427,0.0034626385,0.0059971,0.005072771,0.003433454,0.002419935],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030027842,0.00022797337,0.03379104,0.0010880219,0.0009533769,0.00025298857,0.003383825,0.0052778693,0.0035217751,0.24082568,0.0074133878,0.7029637],"study_design_scores_gemma":[0.00018953318,0.0010776225,0.06464968,0.00094386155,0.0014373111,0.00079951726,0.0021742226,0.07391699,0.016175203,0.741557,0.09654321,0.0005358011],"about_ca_topic_score_codex":0.006399281,"about_ca_topic_score_gemma":0.006572492,"teacher_disagreement_score":0.022510003,"about_ca_system_score_codex":0.00123158,"about_ca_system_score_gemma":0.005702892,"threshold_uncertainty_score":0.119045734},"labels":[],"label_agreement":null},{"id":"W2171478866","doi":"10.1111/ppe.12073","title":"Accuracy Loss Due to Selection Bias in Cohort Studies with Left Truncation","year":2013,"lang":"en","type":"article","venue":"Paediatric and Perinatal Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":110,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Institutes of Health","keywords":"Truncation (statistics); Statistics; Medicine; Censoring (clinical trials); Variable (mathematics); Mathematics; Econometrics; Mathematical analysis","score_opus":0.17765060372843616,"score_gpt":0.42979341336149796,"score_spread":0.2521428096330618,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2171478866","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07071232,0.008881922,0.904696,0.006285613,0.0009665728,0.001025561,0.0012293067,0.0005984475,0.0056043174],"genre_scores_gemma":[0.8176932,0.002528074,0.17182763,0.003086443,0.00052284036,0.0013619578,0.0010181689,0.00015098078,0.0018106321],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8170516,0.14454733,0.014032405,0.010568785,0.011943603,0.0018562861],"domain_scores_gemma":[0.24594836,0.6472053,0.037857793,0.05929966,0.0088124005,0.00087651866],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24887605,0.0010695292,0.0024629156,0.0032294653,0.0019113036,0.0041153156,0.0039725318,0.0034309,0.0040844507],"category_scores_gemma":[0.56110716,0.001120792,0.00492858,0.0038376134,0.0059713763,0.0037109286,0.0044766027,0.0035623938,0.0005320366],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029890358,0.0002011866,0.35235834,0.0051978896,0.008520038,0.0040232097,0.005731379,0.11038056,0.0018948124,0.25691572,0.010484597,0.24130319],"study_design_scores_gemma":[0.0009169421,0.0010048123,0.07121023,0.0036734042,0.004715069,0.003731405,0.00086601893,0.22544475,0.0048563723,0.66951126,0.013781896,0.00028786514],"about_ca_topic_score_codex":0.0056039747,"about_ca_topic_score_gemma":0.0039382065,"teacher_disagreement_score":0.75112396,"about_ca_system_score_codex":0.0029165626,"about_ca_system_score_gemma":0.0040048575,"threshold_uncertainty_score":0.92626953},"labels":[],"label_agreement":null},{"id":"W2171914249","doi":"10.1027/1614-2241/a000041","title":"An Improved Model for Evaluating Change in Randomized Pretest, Posttest, Follow-Up Designs","year":2011,"lang":"en","type":"article","venue":"Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Treatment and control groups; Research design; Monte Carlo method; Randomized controlled trial; Randomized experiment; Treatment effect; Computer science; Psychology; Mathematics education; Statistics; Mathematics; Medicine","score_opus":0.8674030637400533,"score_gpt":0.5803188037493868,"score_spread":0.28708425999066645,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2171914249","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0072591067,0.0002631918,0.9886896,0.00052423566,0.00011551533,0.0014210255,0.0005328584,0.00036943023,0.0008251372],"genre_scores_gemma":[0.19026336,0.0006123575,0.7877144,0.00084094197,0.0002003649,0.015791908,0.00086229685,0.00013186323,0.003582468],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.87929004,0.10517727,0.0020552704,0.0065346956,0.005476304,0.0014663801],"domain_scores_gemma":[0.6556242,0.3142026,0.008675078,0.013614464,0.006880514,0.0010031359],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1501059,0.002963284,0.004538244,0.0029136408,0.0008858121,0.002526221,0.0060912743,0.0052762036,0.011488091],"category_scores_gemma":[0.25311694,0.0015598142,0.0043362346,0.0032632546,0.0028552075,0.005073072,0.0025746897,0.0064022527,0.0015420545],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0051168106,0.0012004437,0.009233175,0.0014369299,0.0020059666,0.0002987837,0.0012650484,0.39123264,0.001432777,0.44031832,0.0065200487,0.13993916],"study_design_scores_gemma":[0.0013334363,0.001996881,0.001879725,0.00018446516,0.00064925296,0.00009392904,0.00007340176,0.82646614,0.0007843894,0.16191547,0.0045326976,0.00009021066],"about_ca_topic_score_codex":0.005907551,"about_ca_topic_score_gemma":0.0037549892,"teacher_disagreement_score":0.8498941,"about_ca_system_score_codex":0.00391392,"about_ca_system_score_gemma":0.0052828747,"threshold_uncertainty_score":0.7938453},"labels":[],"label_agreement":null},{"id":"W2172095467","doi":"10.1002/sim.2663","title":"On estimating treatment effects under non‐compliance in randomized clinical trials: are intent‐to‐treat or instrumental variables analyses perfect solutions?","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":46,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"U.S. Food and Drug Administration; Ministère de l'Économie, de la Science et de l'Innovation - Québec","keywords":"Instrumental variable; Estimator; Protocol (science); Econometrics; Estimation; Randomized controlled trial; Average treatment effect; Statistics; Computer science; Medicine; Mathematics; Economics; Surgery; Alternative medicine","score_opus":0.5017714453619644,"score_gpt":0.591935176063639,"score_spread":0.0901637307016746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2172095467","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015859243,0.0019172671,0.9756988,0.0034195024,0.00016197882,0.00064238417,0.00016213521,0.00019152505,0.001947094],"genre_scores_gemma":[0.505818,0.0029715346,0.48362595,0.0025536423,0.0004005723,0.0032237188,0.0003255128,0.00014375371,0.0009372762],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.57682467,0.3973459,0.007745134,0.005454746,0.011212034,0.0014174707],"domain_scores_gemma":[0.19561014,0.7655203,0.01688059,0.017087542,0.0043987427,0.00050273555],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.36633128,0.0017249624,0.004264637,0.0022652585,0.0009281942,0.0036303592,0.0030148332,0.004673433,0.003521246],"category_scores_gemma":[0.6860341,0.0013869896,0.0033373146,0.0027472654,0.0074878954,0.008798009,0.0037468267,0.0055041607,0.0005647525],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026415628,0.00040868946,0.012253825,0.0026414078,0.003219709,0.0001744989,0.0013791532,0.11978162,0.0005239825,0.6504811,0.0026432246,0.20385137],"study_design_scores_gemma":[0.001196514,0.0012342306,0.003132682,0.0010067172,0.00078437047,0.00015766076,0.00024213539,0.19176745,0.0019353031,0.7949737,0.0034450286,0.00012422646],"about_ca_topic_score_codex":0.0008940801,"about_ca_topic_score_gemma":0.00058502646,"teacher_disagreement_score":0.6336687,"about_ca_system_score_codex":0.0019777787,"about_ca_system_score_gemma":0.007409425,"threshold_uncertainty_score":0.78142637},"labels":[],"label_agreement":null},{"id":"W2173613996","doi":"10.1515/jci-2017-0010","title":"Variable Selection in Causal Inference using a Simultaneous Penalization Method","year":2017,"lang":"en","type":"preprint","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Econometrics; Spurious relationship; Estimator; Outcome (game theory); Variance inflation factor; Confounding; Statistics; Variable (mathematics); Lasso (programming language); Propensity score matching; Average treatment effect; Feature selection; Inflation (cosmology); Mathematics; Population; Computer science; Regression analysis; Medicine; Multicollinearity; Artificial intelligence","score_opus":0.2161748627753796,"score_gpt":0.501343022183107,"score_spread":0.28516815940772744,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2173613996","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016011676,0.00009515645,0.99763834,0.00024683753,0.000026185622,0.0000480859,0.000030211124,0.00008094128,0.00023306183],"genre_scores_gemma":[0.18154283,0.00046812702,0.81251186,0.00043797432,0.00049497496,0.0008428533,0.00035591648,0.00023085855,0.0031145765],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96957415,0.026164316,0.00055615883,0.0015505448,0.001707313,0.00044758013],"domain_scores_gemma":[0.8986317,0.08910146,0.003355132,0.00541481,0.0028395895,0.00065730745],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034200322,0.0014739886,0.002149521,0.0026121095,0.0010301439,0.0019676136,0.0033261832,0.001939785,0.005658567],"category_scores_gemma":[0.083186485,0.0011222066,0.0022120704,0.0025326684,0.0033817692,0.0020737494,0.0035387657,0.004095088,0.0006753648],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041092973,0.00026978756,0.0053063217,0.00058472547,0.00084526796,0.00055176456,0.0003252869,0.25860822,0.00194072,0.6006125,0.0056175175,0.124927014],"study_design_scores_gemma":[0.00008228624,0.00006284586,0.000544423,0.00004886391,0.00005768551,0.0000702286,0.000013757722,0.8471124,0.00066199334,0.14960259,0.0017192783,0.00002367194],"about_ca_topic_score_codex":0.0030199657,"about_ca_topic_score_gemma":0.002458698,"teacher_disagreement_score":0.034200322,"about_ca_system_score_codex":0.0011884278,"about_ca_system_score_gemma":0.0025699842,"threshold_uncertainty_score":0.18087077},"labels":[],"label_agreement":null},{"id":"W2174743136","doi":"10.1515/jci-2014-0035","title":"The Bayesian Causal Effect Estimation Algorithm","year":2015,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Government of Canada","keywords":"Causal inference; Covariate; Model selection; Econometrics; Bayesian probability; Outcome (game theory); Computer science; Causal model; Observational study; Bayesian inference; Confounding; Inference; Regression; Identification (biology); Regression analysis; Machine learning; Statistics; Artificial intelligence; Mathematics","score_opus":0.10409491640823053,"score_gpt":0.4294884247078383,"score_spread":0.3253935082996078,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2174743136","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010929022,0.00021223509,0.9969112,0.00034935362,0.00003324062,0.00009441688,0.00015221459,0.0003127291,0.00084163365],"genre_scores_gemma":[0.05430926,0.00047315398,0.9405338,0.00034817623,0.00015166239,0.0007154596,0.00085211755,0.00020220042,0.002414204],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9942052,0.0034685433,0.00033803243,0.000858365,0.000921099,0.00020879127],"domain_scores_gemma":[0.9790365,0.017271554,0.00058876665,0.0009530806,0.0018947917,0.00025526964],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01060475,0.0009813458,0.002113703,0.0031255423,0.0010422881,0.0023874796,0.0037204816,0.0022609925,0.0132825775],"category_scores_gemma":[0.046599224,0.0011156141,0.0016260118,0.0033356214,0.0013128984,0.002588484,0.0032503759,0.0031847078,0.0024432484],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002794202,0.0001545476,0.003084943,0.00048002662,0.00033272375,0.0001604768,0.00019062999,0.2628342,0.00062135677,0.22469622,0.01592814,0.4912373],"study_design_scores_gemma":[0.000113298905,0.000028032538,0.00036050557,0.00009770229,0.000061700615,0.00009247787,0.000025418638,0.76574063,0.00044446095,0.22748461,0.0055300985,0.000021027001],"about_ca_topic_score_codex":0.007892239,"about_ca_topic_score_gemma":0.005545858,"teacher_disagreement_score":0.0132825775,"about_ca_system_score_codex":0.0015620912,"about_ca_system_score_gemma":0.005625846,"threshold_uncertainty_score":0.056083977},"labels":[],"label_agreement":null},{"id":"W2176403014","doi":"10.1002/cjs.11272","title":"Semiparametric maximum likelihood estimation for a two‐sample density ratio model with right‐censored data","year":2015,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"National Natural Science Foundation of China","keywords":"Estimator; Statistics; Mathematics; Statistic; Consistency (knowledge bases); Empirical likelihood; Asymptotic distribution; Likelihood-ratio test; Test statistic; Semiparametric model; Sample (material); Econometrics; Statistical hypothesis testing","score_opus":0.22465987501282447,"score_gpt":0.37762342614858946,"score_spread":0.15296355113576499,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2176403014","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017245956,0.00022109279,0.98136306,0.00031185983,0.000017448356,0.00007503711,0.000088552944,0.000096933036,0.00057997846],"genre_scores_gemma":[0.6825709,0.000513083,0.31249386,0.00026436627,0.00009854848,0.0005880675,0.00043262859,0.00008121327,0.0029572698],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98583823,0.010881929,0.00037075096,0.0013566015,0.0011248476,0.00042763472],"domain_scores_gemma":[0.9487741,0.04369575,0.002910532,0.0026910217,0.0015282353,0.00040034702],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021763165,0.00097586267,0.0029492879,0.0020033943,0.00046040025,0.002302612,0.0038995282,0.0020429932,0.0038184463],"category_scores_gemma":[0.06734029,0.0008200587,0.0022219762,0.0019285834,0.002769751,0.0031630427,0.0026171072,0.0027713412,0.0006209242],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004489434,0.00034771915,0.009217681,0.0006448375,0.0005308127,0.000965828,0.0008432148,0.46016464,0.001711026,0.4366805,0.0020438696,0.086400904],"study_design_scores_gemma":[0.00006260705,0.00008020731,0.0012785827,0.000039279388,0.00004881164,0.0001531139,0.000078398196,0.8969612,0.00038796067,0.09995144,0.0009219334,0.000036537873],"about_ca_topic_score_codex":0.003448561,"about_ca_topic_score_gemma":0.0016255922,"teacher_disagreement_score":0.021763165,"about_ca_system_score_codex":0.0014098899,"about_ca_system_score_gemma":0.0013259503,"threshold_uncertainty_score":0.11509597},"labels":[],"label_agreement":null},{"id":"W2197328861","doi":"","title":"A Distributional Analysis of Treatment Effects on Subpopulations of a Socioeconomic Experiment","year":2009,"lang":"en","type":"preprint","venue":"Carleton University's Institutional Repository (MacOdrum Library, Carleton University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; Carleton University","funders":"","keywords":"Treatment and control groups; Intersection (aeronautics); Econometrics; Treatment effect; Socioeconomic status; Control (management); Statistics; Scope (computer science); Distribution (mathematics); Test (biology); Mathematics; Statistical hypothesis testing; Computer science; Medicine; Geography; Artificial intelligence; Cartography; Environmental health","score_opus":0.04025246183550726,"score_gpt":0.29192691483646477,"score_spread":0.25167445300095753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2197328861","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5560001,0.0010406639,0.4193639,0.0024909175,0.00012445409,0.00084922015,0.0014091487,0.0002998487,0.018421767],"genre_scores_gemma":[0.9672674,0.0001926284,0.029366737,0.00026416834,0.00006774002,0.0006883987,0.00036358496,0.000031823067,0.0017575644],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9452071,0.042924482,0.0011579487,0.0052242586,0.004337904,0.0011483367],"domain_scores_gemma":[0.7499028,0.2043201,0.014941509,0.023948327,0.005280407,0.0016068589],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05422462,0.00048024207,0.0018097112,0.00256323,0.0016135958,0.0028075902,0.0018897365,0.002145293,0.012377243],"category_scores_gemma":[0.18435915,0.00033951405,0.0019938785,0.0018175382,0.0068112635,0.0041496926,0.0038638315,0.0029104743,0.00048399714],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025152222,0.00068881083,0.113504104,0.0005657299,0.0015126368,0.00046348167,0.003120379,0.037574966,0.0035082796,0.72794956,0.0023075815,0.10628922],"study_design_scores_gemma":[0.00046694448,0.004220226,0.17243893,0.00035164462,0.0011102073,0.0005734727,0.0040185926,0.19758655,0.0062615606,0.60012984,0.012634775,0.00020716563],"about_ca_topic_score_codex":0.0020336572,"about_ca_topic_score_gemma":0.00097563205,"teacher_disagreement_score":0.05422462,"about_ca_system_score_codex":0.0020518377,"about_ca_system_score_gemma":0.0016264701,"threshold_uncertainty_score":0.28677064},"labels":[],"label_agreement":null},{"id":"W2198637531","doi":"10.1093/biostatistics/kxv028","title":"Double robust and efficient estimation of a prognostic model for events in the presence of dependent censoring","year":2015,"lang":"en","type":"article","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"National Institutes of Health; National Institute of Allergy and Infectious Diseases; ACT Government","keywords":"Censoring (clinical trials); Inverse probability weighting; Inverse probability; Estimator; Computer science; Inference; Statistics; Econometrics; Weighting; Missing data; Estimation; Causal inference; Parametric model; Parametric statistics; Mathematics; Artificial intelligence; Posterior probability","score_opus":0.2544352714323289,"score_gpt":0.4149531699672734,"score_spread":0.16051789853494447,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2198637531","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042324886,0.00023146327,0.9947408,0.00023218113,0.000013841214,0.000027083506,0.0000833841,0.00015454523,0.00028424594],"genre_scores_gemma":[0.4029343,0.0010808114,0.59096164,0.00034226375,0.00017693856,0.00035097878,0.0009567115,0.00017386394,0.0030225143],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99412006,0.0039793137,0.00023719588,0.0007317845,0.00070493453,0.00022669723],"domain_scores_gemma":[0.9762241,0.017539417,0.002032281,0.0028910951,0.0010250392,0.00028813086],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015466734,0.000983738,0.0018218032,0.0011728907,0.00038883393,0.0013600943,0.0026342233,0.0017379574,0.0022904626],"category_scores_gemma":[0.049556904,0.00071036565,0.0014526214,0.0011854396,0.0014036008,0.0026123556,0.0025971518,0.002497262,0.000634373],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042453085,0.00015193301,0.0070351134,0.00032890815,0.00037607708,0.00036893203,0.00025583338,0.6175855,0.0022506877,0.19349022,0.003720292,0.174012],"study_design_scores_gemma":[0.00003849406,0.00006248168,0.00076170184,0.000027726259,0.00004370631,0.000118396056,0.0000164976,0.90647054,0.0007465077,0.09024184,0.0014517626,0.000020389407],"about_ca_topic_score_codex":0.0028246671,"about_ca_topic_score_gemma":0.0022972757,"teacher_disagreement_score":0.015466734,"about_ca_system_score_codex":0.0009965887,"about_ca_system_score_gemma":0.0019947581,"threshold_uncertainty_score":0.081796885},"labels":[],"label_agreement":null},{"id":"W2208184784","doi":"10.2139/ssrn.2377483","title":"Difference-in-Differences When Treatment Status Is Observed in Only One Period","year":2014,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Period (music); Demography; Medicine; Psychology; Sociology; Philosophy","score_opus":0.13685328697736185,"score_gpt":0.35453460264447295,"score_spread":0.2176813156671111,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2208184784","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5997285,0.004702909,0.31248924,0.012314286,0.0058965283,0.0024643315,0.029490445,0.0010894648,0.031824246],"genre_scores_gemma":[0.95513546,0.0009773793,0.01946211,0.0010515696,0.0006911924,0.0009781774,0.003140148,0.000061715764,0.018502306],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98282844,0.008671242,0.0013408058,0.004016878,0.0012366256,0.0019059284],"domain_scores_gemma":[0.83909196,0.13708518,0.006318341,0.014988846,0.001372084,0.0011436422],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03816146,0.0007087144,0.0029981208,0.001308283,0.00062979735,0.0022750956,0.0028618076,0.0036656393,0.029841144],"category_scores_gemma":[0.1076737,0.00090435235,0.0033104443,0.0017400689,0.0020694437,0.0047351173,0.0020037862,0.0051347665,0.0017741481],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.033353105,0.0031289624,0.2802308,0.0029831084,0.010291419,0.0018666871,0.0025708866,0.02347882,0.0022125733,0.33945143,0.022374935,0.2780572],"study_design_scores_gemma":[0.003939371,0.0036458806,0.13805558,0.00058247364,0.009863161,0.0012852146,0.0017693314,0.18837261,0.00575004,0.62517166,0.021230366,0.0003343248],"about_ca_topic_score_codex":0.0059432858,"about_ca_topic_score_gemma":0.005223881,"teacher_disagreement_score":0.96183854,"about_ca_system_score_codex":0.0008040005,"about_ca_system_score_gemma":0.0019387059,"threshold_uncertainty_score":0.20181948},"labels":[],"label_agreement":null},{"id":"W2216967333","doi":"10.1002/pds.3924","title":"Conditions for confounding of interactions","year":2015,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; The Quebec Population Health Research Network; Université de Montréal; McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Confounding; Pharmacoepidemiology; Pharmacology; Internal medicine; Medical prescription","score_opus":0.35547554723151903,"score_gpt":0.5507731981639249,"score_spread":0.19529765093240586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2216967333","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032205097,0.0030066583,0.94578457,0.006647758,0.00046989974,0.0007628505,0.0011763122,0.00037526872,0.009571603],"genre_scores_gemma":[0.7251251,0.0032272676,0.2583027,0.00367868,0.001678546,0.0030994418,0.0012898906,0.00018231031,0.003416169],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8456536,0.08962279,0.015304616,0.023922052,0.021315504,0.0041813785],"domain_scores_gemma":[0.26010522,0.651903,0.04732432,0.030007022,0.009293425,0.0013670648],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11952393,0.0017807063,0.0038580985,0.0027723773,0.0022232027,0.0041632126,0.0032132692,0.0050190324,0.009811151],"category_scores_gemma":[0.505779,0.0013519364,0.0058251047,0.0029104413,0.010819822,0.009091913,0.0081728175,0.0060323356,0.0009769291],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00085082353,0.00019056744,0.058511674,0.0019144353,0.0019013549,0.0029261725,0.001833817,0.035670355,0.0014480853,0.83339036,0.0048627774,0.056499638],"study_design_scores_gemma":[0.00036993012,0.00035323933,0.010700579,0.0005233894,0.00056527025,0.0025281426,0.00028783025,0.05432865,0.0021723772,0.9196364,0.008401564,0.00013258532],"about_ca_topic_score_codex":0.0030066345,"about_ca_topic_score_gemma":0.0010331494,"teacher_disagreement_score":0.88047606,"about_ca_system_score_codex":0.0024732442,"about_ca_system_score_gemma":0.004361852,"threshold_uncertainty_score":0.6321105},"labels":[],"label_agreement":null},{"id":"W2242307981","doi":"10.1002/sim.6818","title":"The missing cause approach to unmeasured confounding in pharmacoepidemiology","year":2016,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Bruyère; University of Ottawa; McGill University; Ottawa Public Health; McGill University Health Centre","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Confounding; Pharmacoepidemiology; Spurious relationship; Statistics; Observational study; Missing data; Econometrics; Medicine; Instrumental variable; Average treatment effect; Variance (accounting); Mathematics; Propensity score matching; Medical prescription","score_opus":0.2739779879782596,"score_gpt":0.5135117581148383,"score_spread":0.23953377013657867,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2242307981","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008158916,0.00061149226,0.9885725,0.0010937416,0.00016405922,0.00025358668,0.0003263622,0.00013188276,0.00068753655],"genre_scores_gemma":[0.5144419,0.0011539853,0.4770767,0.0019146041,0.0006648949,0.0020441995,0.00070630223,0.000111724046,0.00188566],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8986723,0.08281395,0.003617767,0.0063249627,0.007622997,0.0009480208],"domain_scores_gemma":[0.7318843,0.21736205,0.016251352,0.028284447,0.0053083817,0.0009095534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08874108,0.0014461303,0.0030313737,0.0034481648,0.001473757,0.002759468,0.005448657,0.0030028366,0.0028176648],"category_scores_gemma":[0.27506724,0.0012442191,0.0043447763,0.003607826,0.0038899102,0.0028056325,0.004462811,0.0048369234,0.0002814917],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013970678,0.00034126325,0.10000933,0.0023365424,0.005385956,0.0015104335,0.0021843014,0.09902861,0.0015371697,0.57372344,0.0061689713,0.20637685],"study_design_scores_gemma":[0.0007535802,0.00062802836,0.015339574,0.0006006208,0.0017501423,0.00094388874,0.0002847465,0.2893139,0.0028778925,0.6757121,0.011585166,0.00021026727],"about_ca_topic_score_codex":0.004592464,"about_ca_topic_score_gemma":0.002673947,"teacher_disagreement_score":0.08874108,"about_ca_system_score_codex":0.0017136876,"about_ca_system_score_gemma":0.0041395547,"threshold_uncertainty_score":0.46931326},"labels":[],"label_agreement":null},{"id":"W2246264012","doi":"10.82308/26320","title":"Flexible marginal structural models for survival analysis","year":2012,"lang":"en","type":"article","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Fonds Québécois de la Recherche sur la Nature et les Technologies","keywords":"Marginal structural model; Proportional hazards model; Estimator; Covariate; Econometrics; Inverse probability weighting; Weighting; Statistics; Hazard; Confounding; Computer science; Hazard ratio; Truncation (statistics); Mathematics; Confidence interval; Medicine","score_opus":0.15421599477603773,"score_gpt":0.3743980072475583,"score_spread":0.22018201247152056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2246264012","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009348466,0.0018270871,0.9840333,0.0011747731,0.00018519902,0.00015140694,0.0011407469,0.00047504908,0.0016639634],"genre_scores_gemma":[0.5385633,0.00642703,0.41047108,0.0009111117,0.0011113388,0.00307099,0.0059024757,0.00070660765,0.032836143],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9910206,0.006785458,0.0002379185,0.0010493082,0.00047085367,0.00043578606],"domain_scores_gemma":[0.9685892,0.02686146,0.0012867422,0.0018572662,0.00094958267,0.00045582833],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016224504,0.0018086281,0.002711093,0.0024818114,0.0010161636,0.002870985,0.004784695,0.0026227364,0.015148894],"category_scores_gemma":[0.04000388,0.001271496,0.004057485,0.0033030612,0.002327313,0.0028858192,0.0037925688,0.005180032,0.0025073276],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036759695,0.000105091836,0.006943497,0.00037456624,0.0006684263,0.00028366747,0.0007922817,0.45373753,0.00045100745,0.46457204,0.00502478,0.06667951],"study_design_scores_gemma":[0.000049281887,0.00007114813,0.0012010967,0.00008472352,0.00010496688,0.00006255867,0.000088626555,0.68618804,0.000091847396,0.30622315,0.005785304,0.00004918333],"about_ca_topic_score_codex":0.01362598,"about_ca_topic_score_gemma":0.013888992,"teacher_disagreement_score":0.016224504,"about_ca_system_score_codex":0.0024951037,"about_ca_system_score_gemma":0.0029466348,"threshold_uncertainty_score":0.0858044},"labels":[],"label_agreement":null},{"id":"W2256970024","doi":"","title":"Les effets du cancer sur l'emploi et les gains des survivants du cancer","year":2014,"lang":"fr","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Humanities; Political science; Gynecology; Medicine; Art","score_opus":0.19047221043256038,"score_gpt":0.44995255628912134,"score_spread":0.259480345856561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2256970024","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9761267,0.007312422,0.002668281,0.0033959253,0.00010570964,0.00017123566,0.0020044274,0.000037927104,0.008177471],"genre_scores_gemma":[0.98433834,0.0037521909,0.0012950788,0.00043879123,0.000054650052,0.00015420336,0.0007159209,0.000011700831,0.009239099],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9985512,0.00067005155,0.000037126065,0.00022605249,0.00027585527,0.00023975408],"domain_scores_gemma":[0.9873273,0.008981121,0.0016467659,0.00056100584,0.0006033398,0.0008805676],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0037512823,0.00036788316,0.00063076057,0.0006777133,0.00064103934,0.0009620508,0.0005610246,0.001307647,0.008890305],"category_scores_gemma":[0.014171947,0.00019556335,0.0014653242,0.00094907964,0.00081469887,0.00080155715,0.0009303218,0.0012121507,0.000638403],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010173937,0.0026212907,0.73110163,0.0010324683,0.0018675206,0.00033101457,0.0026552912,0.009361273,0.0032354419,0.008050588,0.0031526003,0.22641696],"study_design_scores_gemma":[0.0002507178,0.0052875276,0.9719092,0.0003068626,0.0010759032,0.00018338866,0.0016662763,0.0027141618,0.0019745154,0.0049836873,0.0096015865,0.000046155394],"about_ca_topic_score_codex":0.02993964,"about_ca_topic_score_gemma":0.04368535,"teacher_disagreement_score":0.02993964,"about_ca_system_score_codex":0.0015536575,"about_ca_system_score_gemma":0.0024833265,"threshold_uncertainty_score":0.059530795},"labels":[],"label_agreement":null},{"id":"W2258095781","doi":"10.1089/end.2015.0653","title":"Editorial Comment for Wiener <i>et al.</i>","year":2015,"lang":"es","type":"editorial","venue":"Journal of Endourology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Paul's Hospital; University of British Columbia","funders":"","keywords":"Download; Library science; World Wide Web; Computer science","score_opus":0.09450927870251402,"score_gpt":0.4365783207313075,"score_spread":0.34206904202879346,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2258095781","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00005565446,0.0013173963,0.00016208184,0.27991468,0.71683997,0.000023475495,0.00022470365,0.0000897852,0.0013722669],"genre_scores_gemma":[0.00100525,0.0017834497,0.00023604225,0.23487672,0.7539783,0.00006719753,0.000092470385,0.000090369154,0.007870166],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9931473,0.001028379,0.001129506,0.0008323619,0.003295498,0.0005670448],"domain_scores_gemma":[0.9647128,0.014378735,0.0026114983,0.0012788821,0.014078179,0.002939969],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010029333,0.0023561576,0.0032618789,0.0032497053,0.0038398034,0.007092301,0.0041556535,0.025462473,0.021349031],"category_scores_gemma":[0.07507524,0.0012050614,0.0031393273,0.0018414214,0.0036320952,0.0037523482,0.0019520723,0.028215181,0.01640848],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000015080625,0.0000033153337,0.000021308566,0.00004099988,0.0000071335085,0.000051478364,0.0000071785093,0.000007664796,0.0000105311265,0.0001827761,0.9989103,0.0007423103],"study_design_scores_gemma":[0.00016170062,0.000034326513,0.0006814534,0.0006555221,0.000104693805,0.0004959093,0.000105684114,0.00030011515,0.00024090358,0.0029453041,0.99422616,0.00004820944],"about_ca_topic_score_codex":0.0044948556,"about_ca_topic_score_gemma":0.008190679,"teacher_disagreement_score":0.025462473,"about_ca_system_score_codex":0.003838472,"about_ca_system_score_gemma":0.0060382765,"threshold_uncertainty_score":0.07141966},"labels":[],"label_agreement":null},{"id":"W2262143275","doi":"10.1093/aje/kwv152","title":"The Impact of Sparse Follow-up on Marginal Structural Models for Time-to-Event Data","year":2015,"lang":"en","type":"review","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"Université de Montréal; Health Canada; Centre Hospitalier Universitaire de Québec; Canadian Institutes of Health Research; University of Ottawa; McGill University; Institute for Clinical Evaluative Sciences; McGill University Health Centre; McMaster University; Ottawa Hospital Research Institute; Natural Sciences and Engineering Research Council of Canada; Faculty of Medicine, McGill University","keywords":"Missing data; Covariate; Hazard ratio; Statistics; Confounding; Marginal structural model; Medicine; Imputation (statistics); Confidence interval; Proportional hazards model; Event (particle physics); Econometrics; Mathematics","score_opus":0.4973999321594651,"score_gpt":0.5646419536567407,"score_spread":0.06724202149727565,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2262143275","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006281892,0.5286911,0.45088634,0.008846895,0.00063310674,0.00017719953,0.0006476329,0.00021400546,0.003621734],"genre_scores_gemma":[0.15109748,0.63337916,0.20555109,0.002418523,0.0023527725,0.0009940803,0.0012647567,0.00019908547,0.0027430295],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98479927,0.012446855,0.00057692046,0.00095430936,0.0010523084,0.0001703233],"domain_scores_gemma":[0.80554646,0.18508932,0.0027037312,0.004129053,0.002283326,0.00024811248],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.033851832,0.0011868825,0.0033643001,0.0021518706,0.00044641085,0.002092934,0.0040216628,0.0025583655,0.003578114],"category_scores_gemma":[0.09012329,0.00095321884,0.0035965454,0.0035664977,0.0020620576,0.004073375,0.0017954321,0.005095939,0.0007245664],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021536057,0.00010956482,0.005828702,0.0101962155,0.0031469888,0.00024152407,0.000504838,0.046277706,0.00025035092,0.29269066,0.008675366,0.63186276],"study_design_scores_gemma":[0.00020359168,0.0002814956,0.0069904374,0.0075347545,0.0023308035,0.0010890532,0.0002759569,0.11231867,0.0007903406,0.7645911,0.1034411,0.0001527687],"about_ca_topic_score_codex":0.0063152947,"about_ca_topic_score_gemma":0.0064951433,"teacher_disagreement_score":0.96614814,"about_ca_system_score_codex":0.002250594,"about_ca_system_score_gemma":0.0034917884,"threshold_uncertainty_score":0.17902774},"labels":[],"label_agreement":null},{"id":"W2263960472","doi":"10.1287/orsc.2015.1034","title":"Bridging Qualitative and Quantitative Methods in Organizational Research: Applications of Synthetic Control Methodology in the U.S. Automobile Industry","year":2016,"lang":"en","type":"article","venue":"Organization Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Counterfactual thinking; Bridging (networking); Context (archaeology); Bridge (graph theory); Empirical research; Control (management); Econometrics; Computer science; Economics; Operations management; Business; Psychology; Mathematics; Statistics; Artificial intelligence","score_opus":0.542484474409773,"score_gpt":0.6232486399900531,"score_spread":0.0807641655802801,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2263960472","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07159634,0.0012600528,0.9150402,0.003308193,0.00028851765,0.00083756295,0.0002952563,0.000092518894,0.0072812983],"genre_scores_gemma":[0.64472514,0.00055103196,0.3494033,0.00095286814,0.00017244015,0.0031552012,0.000228748,0.000045051787,0.0007662036],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8792929,0.110619776,0.0017736601,0.0026696282,0.0052340166,0.00041005173],"domain_scores_gemma":[0.5496629,0.39796,0.02302089,0.019544456,0.008922989,0.00088881963],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09950162,0.0008180061,0.00079648744,0.004215734,0.0018406073,0.0030013523,0.0019261186,0.001086262,0.0021752475],"category_scores_gemma":[0.24176048,0.00045470305,0.00096184824,0.004418766,0.007159151,0.0019474734,0.003655615,0.0016054208,0.00014154504],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032258764,0.00071673014,0.032470237,0.0008085279,0.0005358358,0.00028273533,0.012364957,0.038825188,0.0011399168,0.7484751,0.0032319198,0.16082624],"study_design_scores_gemma":[0.0003681624,0.0007992871,0.014644321,0.0006219591,0.00017811169,0.00018210974,0.0044220267,0.15774688,0.0026758728,0.8001823,0.01805768,0.000121266945],"about_ca_topic_score_codex":0.005204744,"about_ca_topic_score_gemma":0.0041060396,"teacher_disagreement_score":0.09950162,"about_ca_system_score_codex":0.0031454589,"about_ca_system_score_gemma":0.0030318405,"threshold_uncertainty_score":0.52622116},"labels":[],"label_agreement":null},{"id":"W2264767503","doi":"10.1161/circulationaha.115.017719","title":"Introduction to the Analysis of Survival Data in the Presence of Competing Risks","year":2016,"lang":"en","type":"article","venue":"Circulation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2536,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University Health Network; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Covariate; Medicine; Proportional hazards model; Survival analysis; Cumulative incidence; Incidence (geometry); Survival function; Event (particle physics); Statistics; Hazard ratio; Outcome (game theory); Hazard; Demography; Accelerated failure time model; Econometrics; Confidence interval; Internal medicine; Cohort; Mathematics","score_opus":0.2664686297936992,"score_gpt":0.44262911585399767,"score_spread":0.1761604860602985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2264767503","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048637527,0.0047376053,0.9862852,0.0025503922,0.0005880888,0.00027484025,0.0011766539,0.000993361,0.0029074454],"genre_scores_gemma":[0.012070056,0.008027072,0.9697362,0.0018220149,0.0024321002,0.0020637119,0.0011617943,0.0006487923,0.0020381801],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96309084,0.028832309,0.0019781182,0.0018642333,0.0039281766,0.00030627043],"domain_scores_gemma":[0.7887508,0.19623141,0.004274825,0.006289776,0.0035613265,0.00089184265],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03189606,0.0018699665,0.0017184444,0.003986382,0.00084563455,0.0030898566,0.0036536339,0.003057933,0.0267117],"category_scores_gemma":[0.097309805,0.0015242477,0.0042247716,0.00630443,0.0037391202,0.0029751728,0.003005893,0.010982886,0.00729861],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019000031,0.00018157467,0.004430406,0.0043682964,0.0007682825,0.0011655946,0.0012932767,0.018670082,0.0016429503,0.5426522,0.09931553,0.3253218],"study_design_scores_gemma":[0.00012650415,0.00024744513,0.0035331177,0.001977228,0.00019484172,0.002198645,0.00017885634,0.052763242,0.00074377784,0.6568273,0.28101444,0.00019455317],"about_ca_topic_score_codex":0.002594965,"about_ca_topic_score_gemma":0.0022378645,"teacher_disagreement_score":0.03189606,"about_ca_system_score_codex":0.0013362048,"about_ca_system_score_gemma":0.003676947,"threshold_uncertainty_score":0.16868448},"labels":[],"label_agreement":null},{"id":"W2267083177","doi":"10.2139/ssrn.2266821","title":"Program Quality and Treatment Completion for Youth Training Programs","year":2013,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Training (meteorology); Quality (philosophy); Completion (oil and gas wells); Medical education; Psychology; Operations management; Political science; Medicine; Engineering; Geography","score_opus":0.4143963875844185,"score_gpt":0.4623795294929555,"score_spread":0.04798314190853703,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2267083177","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9949033,0.0006109292,0.0006843196,0.0009856457,0.000042803225,0.0001392777,0.0016603018,0.000041349802,0.0009319957],"genre_scores_gemma":[0.99660385,0.0001595712,0.00034004461,0.000110314286,0.000028043341,0.00007968579,0.0013762314,0.000025014753,0.0012772394],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9930207,0.0030793778,0.00043422543,0.00061896094,0.00105106,0.0017957039],"domain_scores_gemma":[0.933456,0.026600141,0.018083155,0.0035921375,0.0036069672,0.01466161],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010603945,0.00030332655,0.0009292818,0.001517648,0.0017807294,0.0020877626,0.0020290792,0.0016673704,0.0145908715],"category_scores_gemma":[0.087056346,0.0005774513,0.0018258204,0.0027333912,0.0007447529,0.001921559,0.0027972388,0.0040457095,0.0006016309],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029551291,0.0021503852,0.97096205,0.00011222567,0.0007513233,0.000036626545,0.000968482,0.0014116442,0.00011548406,0.00064798916,0.0015124921,0.018376168],"study_design_scores_gemma":[0.0002070101,0.00096750556,0.99369276,0.00012716274,0.00032254952,0.000024535688,0.0010934247,0.0020514808,0.00014124243,0.0007399085,0.0006111835,0.000021136364],"about_ca_topic_score_codex":0.08516805,"about_ca_topic_score_gemma":0.09653769,"teacher_disagreement_score":0.08516805,"about_ca_system_score_codex":0.003701864,"about_ca_system_score_gemma":0.006259314,"threshold_uncertainty_score":0.16934466},"labels":[],"label_agreement":null},{"id":"W2278177624","doi":"10.1515/ijb-2015-0017","title":"Variable Selection for Confounder Control, Flexible Modeling and Collaborative Targeted Minimum Loss-Based Estimation in Causal Inference","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Polytechnique Montréal","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Causal inference; Propensity score matching; Estimator; Computer science; Covariate; Inverse probability weighting; Inverse probability; Average treatment effect; Econometrics; Marginal structural model; Inference; Statistics; Nonparametric statistics; Weighting; Selection bias; Machine learning; Artificial intelligence; Mathematics; Posterior probability","score_opus":0.10003523274824203,"score_gpt":0.4231658834685216,"score_spread":0.3231306507202796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2278177624","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014559379,0.00021145368,0.99757534,0.00034817166,0.00001647916,0.000026900016,0.000024609551,0.000058740185,0.00028235032],"genre_scores_gemma":[0.32971388,0.0009665071,0.66437626,0.0011177367,0.00031825854,0.0008912513,0.0003398715,0.00022370079,0.0020525276],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9613752,0.031765122,0.00090392143,0.002725229,0.0026552794,0.00057526916],"domain_scores_gemma":[0.90057987,0.08088961,0.0051345597,0.010673068,0.0021852597,0.0005376325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04498668,0.0015753695,0.0028544746,0.0021470073,0.0011007389,0.0029444543,0.003973619,0.0027921174,0.003233288],"category_scores_gemma":[0.14475344,0.0012338297,0.0033344214,0.0025504283,0.0051125865,0.0047655874,0.0054178527,0.0048740506,0.00056896295],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015094277,0.00009102445,0.0037483175,0.00036539254,0.00052791886,0.00025685452,0.0005665579,0.2614369,0.0007561685,0.64822686,0.002276649,0.08159645],"study_design_scores_gemma":[0.00007797243,0.000075098214,0.0008040436,0.00008355429,0.00007990779,0.00007320146,0.000027031694,0.5379588,0.00068727724,0.4575428,0.0025555266,0.00003467431],"about_ca_topic_score_codex":0.0033700797,"about_ca_topic_score_gemma":0.0020935684,"teacher_disagreement_score":0.04498668,"about_ca_system_score_codex":0.00224117,"about_ca_system_score_gemma":0.0027794007,"threshold_uncertainty_score":0.23791516},"labels":[],"label_agreement":null},{"id":"W2278756228","doi":"10.1093/ije/dyv135","title":"Imputation approaches for potential outcomes in causal inference","year":2015,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":71,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institutes of Health","keywords":"Causal inference; Inference; Imputation (statistics); Missing data; Computer science; Intuition; Causal model; Causal structure; Machine learning; Econometrics; Data science; Artificial intelligence; Psychology; Mathematics; Statistics; Cognitive science","score_opus":0.49969905682162113,"score_gpt":0.5278363928453237,"score_spread":0.028137336023702553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2278756228","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005505727,0.0026888587,0.9913585,0.0030831005,0.00018398729,0.000065969594,0.00009771697,0.00007887323,0.0018924032],"genre_scores_gemma":[0.0762272,0.007905409,0.90696585,0.0026329358,0.0017334839,0.0011436983,0.00035305627,0.00018068448,0.0028577833],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93817663,0.051482048,0.0017828923,0.0032148545,0.0047018356,0.00064169616],"domain_scores_gemma":[0.7555254,0.22223924,0.0055700014,0.010838244,0.0050615426,0.00076554954],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07265433,0.0022755521,0.0031309908,0.004757414,0.00174587,0.0040183556,0.006884156,0.005620551,0.007918798],"category_scores_gemma":[0.18600336,0.0015033745,0.0049327184,0.0067694597,0.008510897,0.008962652,0.005535312,0.015119398,0.0019029232],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000031761494,0.000030937692,0.00066954654,0.00043026835,0.00021904691,0.00016046858,0.0003548978,0.012892033,0.00007284784,0.9544307,0.0034118865,0.027295657],"study_design_scores_gemma":[0.000021667542,0.000012465568,0.00008610376,0.00011912159,0.0000332021,0.00007164387,0.000028183202,0.021547772,0.00005429378,0.97432613,0.0036869296,0.00001254332],"about_ca_topic_score_codex":0.0032964726,"about_ca_topic_score_gemma":0.0020432577,"teacher_disagreement_score":0.9273457,"about_ca_system_score_codex":0.0035226298,"about_ca_system_score_gemma":0.0046713306,"threshold_uncertainty_score":0.3842374},"labels":[],"label_agreement":null},{"id":"W2284187917","doi":"10.1186/s12874-016-0119-1","title":"Head to head comparison of the propensity score and the high-dimensional propensity score matching methods","year":2016,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":50,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"St. Joseph’s Healthcare Hamilton; University of British Columbia; Centre Hospitalier de l’Université de Montréal; McGill University; McMaster University; McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Confounding; Medicine; Matching (statistics); Cohort; Context (archaeology); Confidence interval; Cohort study; Internal medicine; Statistics; Mathematics; Pathology; Biology","score_opus":0.8646910788517377,"score_gpt":0.6556494814906167,"score_spread":0.20904159736112093,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2284187917","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3990645,0.021591762,0.55401254,0.0038592368,0.001947349,0.0031456328,0.0057885274,0.0006282589,0.009962205],"genre_scores_gemma":[0.89200646,0.0028771188,0.09873526,0.00074027217,0.0005388025,0.0013955722,0.0017480373,0.0001114184,0.0018470482],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8819967,0.10673842,0.0026967959,0.0032486843,0.0047949296,0.0005245271],"domain_scores_gemma":[0.78302836,0.18210107,0.012972644,0.0141735505,0.006623055,0.0011013262],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10477198,0.0009215609,0.0016522038,0.00266767,0.0005465517,0.0019852861,0.0015327454,0.0011918367,0.0083257565],"category_scores_gemma":[0.19904582,0.0003749105,0.0035039014,0.0029991928,0.0010592141,0.0015883974,0.002396691,0.0011269496,0.0007898039],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.043056123,0.00059934123,0.31121206,0.0053868336,0.0633897,0.00020509533,0.00086633506,0.03287555,0.0015977435,0.041655418,0.012852598,0.48630312],"study_design_scores_gemma":[0.010820942,0.018690791,0.51182663,0.0028741085,0.021019848,0.00092322234,0.0016570422,0.31181675,0.005531991,0.08833746,0.026016112,0.0004851932],"about_ca_topic_score_codex":0.0038327312,"about_ca_topic_score_gemma":0.0031080744,"teacher_disagreement_score":0.895228,"about_ca_system_score_codex":0.0014231537,"about_ca_system_score_gemma":0.0023021288,"threshold_uncertainty_score":0.55409384},"labels":[],"label_agreement":null},{"id":"W2284501626","doi":"10.1093/ije/dyv295","title":"Using observational data to emulate a randomized trial of dynamic treatment-switching strategies: an application to antiretroviral therapy","year":2015,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"AIDS Vancouver; Simon Fraser University; University of Calgary","funders":"National Institute of Allergy and Infectious Diseases; National Heart, Lung, and Blood Institute; Department for International Development; National Institute on Alcohol Abuse and Alcoholism; National Institutes of Health; Medical Research Council; National Institute for Health and Care Research","keywords":"Medicine; Observational study; Randomized controlled trial; Hazard ratio; Regimen; Confidence interval; Cohort; Cohort study; Internal medicine","score_opus":0.6825081891066951,"score_gpt":0.5939492754641644,"score_spread":0.08855891364253066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2284501626","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09110935,0.020752275,0.86664313,0.007835375,0.0016579858,0.0066163237,0.00094647735,0.0005289719,0.003910183],"genre_scores_gemma":[0.5535964,0.0052352445,0.42348698,0.0043005585,0.0007389242,0.010526603,0.00061642705,0.00012581788,0.0013730922],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.40656984,0.57589304,0.005760544,0.005434654,0.0053543895,0.0009874905],"domain_scores_gemma":[0.22465248,0.73231447,0.02085785,0.016892616,0.004263902,0.0010186759],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3930784,0.0035507458,0.007157568,0.00306184,0.0008647343,0.003499775,0.0057765455,0.0058001694,0.0036818467],"category_scores_gemma":[0.5762027,0.001901045,0.011235473,0.0027959144,0.004484685,0.004498418,0.004027033,0.0059015946,0.00031653437],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016415466,0.002003047,0.033941172,0.007727429,0.05445882,0.0007937673,0.0011300908,0.5053055,0.0007928677,0.16710524,0.0037961192,0.2065304],"study_design_scores_gemma":[0.013305964,0.010062252,0.006986379,0.0021924179,0.010688904,0.00033949982,0.00026614743,0.7221369,0.0012939979,0.22186285,0.010450696,0.00041396456],"about_ca_topic_score_codex":0.005132287,"about_ca_topic_score_gemma":0.0031715806,"teacher_disagreement_score":0.6069216,"about_ca_system_score_codex":0.005397802,"about_ca_system_score_gemma":0.0053785695,"threshold_uncertainty_score":0.7484424},"labels":[],"label_agreement":null},{"id":"W2288430971","doi":"10.1093/aje/kwv060","title":"Invited Commentary: Boundless Science—Putting Natural Direct and Indirect Effects in a Clearer Empirical Context: Figure 1.","year":2015,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McGill University","keywords":"Context (archaeology); Natural (archaeology); Psychology; History","score_opus":0.16087419727058952,"score_gpt":0.4625113059421708,"score_spread":0.30163710867158133,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2288430971","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000058195925,0.0014916752,0.00029126616,0.9438407,0.053686883,0.000008851206,0.00007741824,0.000026871427,0.0005181421],"genre_scores_gemma":[0.0011744354,0.0010179464,0.0004671171,0.9232111,0.07202094,0.000038524595,0.000025402009,0.000052632076,0.0019919535],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9867611,0.005190209,0.0010672436,0.0023255656,0.0040422617,0.000613575],"domain_scores_gemma":[0.9284995,0.053868778,0.0021807607,0.0017346925,0.011522854,0.0021934467],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020162297,0.0019106569,0.0023459417,0.0016918691,0.0049566543,0.004781451,0.008721395,0.051606994,0.011479311],"category_scores_gemma":[0.121970825,0.0012964661,0.0032323278,0.0016493512,0.010534677,0.009792648,0.0035347189,0.07127049,0.008891066],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022585144,0.0000056249223,0.000050454935,0.00009568786,0.000010686847,0.00011013657,0.0001637736,0.000043629974,0.000043018692,0.004366141,0.9932672,0.0018212214],"study_design_scores_gemma":[0.00011543124,0.00003885899,0.0004961063,0.0009899957,0.000071247436,0.0007129056,0.00056617014,0.0005697363,0.00031038775,0.045630213,0.9503742,0.00012488988],"about_ca_topic_score_codex":0.009853554,"about_ca_topic_score_gemma":0.009924337,"teacher_disagreement_score":0.051606994,"about_ca_system_score_codex":0.00607949,"about_ca_system_score_gemma":0.0065994714,"threshold_uncertainty_score":0.10662973},"labels":[],"label_agreement":null},{"id":"W2292670616","doi":"10.1177/2168479015604183","title":"Defining Regions in Multiregional Clinical Trials: An Analytical Approach to Considering Impact of Intrinsic and Extrinsic Factors","year":2015,"lang":"en","type":"article","venue":"Therapeutic Innovation & Regulatory Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"inVentiv Health Clinical","funders":"","keywords":"Sample size determination; Medicine; Intervention (counseling); Epidemiology; Cluster (spacecraft); Ethnic group; Checklist; Psychology; Family medicine; Computer science; Cognitive psychology; Statistics; Pathology; Political science; Psychiatry","score_opus":0.6558268703743527,"score_gpt":0.5578808159228008,"score_spread":0.09794605445155191,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2292670616","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015392506,0.0034957605,0.9766766,0.0020456824,0.00008366394,0.00043234607,0.00024252497,0.0001086725,0.0015222551],"genre_scores_gemma":[0.5277366,0.0023658378,0.46554005,0.00091850135,0.00044236777,0.00157487,0.0003010425,0.0001397282,0.0009809099],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.86177826,0.12336273,0.0028838008,0.007528977,0.0034821704,0.0009640823],"domain_scores_gemma":[0.4191723,0.54182196,0.019347945,0.013517461,0.0042772945,0.0018630733],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.16136898,0.0017975988,0.006100513,0.0041625462,0.0013021555,0.0057083154,0.004832663,0.002760446,0.0032326733],"category_scores_gemma":[0.29965535,0.0019247138,0.0061756964,0.0040591583,0.0068758633,0.0064181606,0.0061390726,0.005652876,0.00016944774],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015521307,0.00025381384,0.024808444,0.0020568932,0.0064349035,0.0007717205,0.0018033342,0.21316166,0.0013560441,0.6574236,0.002416776,0.087960616],"study_design_scores_gemma":[0.00033654628,0.00039990645,0.004568974,0.00040243243,0.002533684,0.00029093534,0.00037266136,0.21298845,0.0011160129,0.77171856,0.005211699,0.000060123275],"about_ca_topic_score_codex":0.003927559,"about_ca_topic_score_gemma":0.003345267,"teacher_disagreement_score":0.99389946,"about_ca_system_score_codex":0.0031307156,"about_ca_system_score_gemma":0.0072019044,"threshold_uncertainty_score":0.85341096},"labels":[],"label_agreement":null},{"id":"W2293988153","doi":"10.1002/pds.3923","title":"Confounding by drug formulary restriction in pharmacoepidemiologic research","year":2015,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Formulary; Salmeterol; Fluticasone; Confounding; Confidence interval; Hazard ratio; Pharmacoepidemiology; Rate ratio; COPD; Cohort study; Medical prescription; Asthma; Pediatrics; Internal medicine; Family medicine; Pharmacology","score_opus":0.45341142571709747,"score_gpt":0.5628320553648178,"score_spread":0.10942062964772037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2293988153","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.78298676,0.072227895,0.09257748,0.019589474,0.0012868071,0.0035619487,0.008839079,0.0002360499,0.018694513],"genre_scores_gemma":[0.96997607,0.004063555,0.018545141,0.0033728096,0.0006080299,0.00095835305,0.001566528,0.000054392967,0.0008552284],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.73450506,0.20921569,0.021056466,0.013996292,0.018888338,0.0023382187],"domain_scores_gemma":[0.57280374,0.28092024,0.09216508,0.042513993,0.009727767,0.001869146],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16582505,0.00074633793,0.0017756603,0.002847611,0.0017709092,0.0031221237,0.0024738123,0.0015344329,0.0012423736],"category_scores_gemma":[0.29597038,0.00088050554,0.0017796913,0.008421036,0.0042002453,0.0022327534,0.0021998556,0.00164754,0.00025828453],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012838251,0.00014435465,0.95311856,0.0014898364,0.0029673288,0.00025339573,0.0010410022,0.0011149604,0.00046234962,0.0058168774,0.0011527153,0.031154808],"study_design_scores_gemma":[0.00034042617,0.0011944277,0.9562201,0.0016879613,0.002998127,0.0013891241,0.0005488781,0.0044201245,0.0017983452,0.011191457,0.018097151,0.000114015755],"about_ca_topic_score_codex":0.025029797,"about_ca_topic_score_gemma":0.016440194,"teacher_disagreement_score":0.83417493,"about_ca_system_score_codex":0.0025814087,"about_ca_system_score_gemma":0.0045075156,"threshold_uncertainty_score":0.8769772},"labels":[],"label_agreement":null},{"id":"W2294745036","doi":"10.1177/2158244015625445","title":"Two Cross-Platform Programs for Inferences and Interval Estimation About Indirect Effects in Mediational Models","year":2016,"lang":"en","type":"article","venue":"SAGE Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":95,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Resampling; Confidence interval; Posterior probability; Statistics; Bayesian probability; Computer science; Mathematics; Algorithm; Regression; Credible interval","score_opus":0.16955858983009428,"score_gpt":0.4589606541649033,"score_spread":0.289402064334809,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2294745036","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015023773,0.000052603256,0.98776287,0.00009344202,0.00005351124,0.00011720087,0.00030238944,0.00926236,0.00085311045],"genre_scores_gemma":[0.022308981,0.000104630904,0.97075313,0.00015598422,0.000059932307,0.0013170467,0.00078432186,0.0027326525,0.0017832979],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99419504,0.0028970963,0.00051313976,0.00078986055,0.0013482285,0.000256603],"domain_scores_gemma":[0.9393672,0.052007005,0.001891906,0.0034183697,0.0028765486,0.00043896958],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01469761,0.0019808703,0.0011224898,0.003294769,0.0008277218,0.0022147917,0.0033253853,0.0018146511,0.027686689],"category_scores_gemma":[0.093103774,0.0014601543,0.0023806207,0.002579434,0.0010460971,0.0025223407,0.0035272276,0.004572362,0.004928056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012844341,0.0006038217,0.009226986,0.0009153592,0.0009017534,0.00071646617,0.001382743,0.07270992,0.003773285,0.15772079,0.047173273,0.7035912],"study_design_scores_gemma":[0.0006511774,0.00018886599,0.0042877574,0.00021495702,0.00027926618,0.00063096255,0.00019948643,0.79350543,0.015673835,0.14005676,0.044150893,0.00016051979],"about_ca_topic_score_codex":0.004902764,"about_ca_topic_score_gemma":0.005822725,"teacher_disagreement_score":0.027686689,"about_ca_system_score_codex":0.0011147201,"about_ca_system_score_gemma":0.0027982765,"threshold_uncertainty_score":0.09262121},"labels":[],"label_agreement":null},{"id":"W2302088160","doi":"10.1016/j.jtcvs.2016.01.002","title":"It's not what you put in that is important, it's what you take out","year":2016,"lang":"en","type":"letter","venue":"Journal of Thoracic and Cardiovascular Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; MEDLINE; Law","score_opus":0.13748950557913775,"score_gpt":0.369904981765231,"score_spread":0.23241547618609326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2302088160","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016540202,0.0003556241,0.00024616736,0.9915093,0.006489039,0.0000039557917,0.000020294403,0.000008959269,0.0012012734],"genre_scores_gemma":[0.008920625,0.0014475253,0.0013373792,0.9181372,0.063012674,0.000037200174,0.000023591541,0.000029176395,0.0070546283],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99738604,0.0009546807,0.00038170404,0.00032660167,0.00071857544,0.00023237779],"domain_scores_gemma":[0.982808,0.011166839,0.0009657105,0.0005980901,0.002723357,0.0017380195],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038823385,0.0006056576,0.001290965,0.00059283455,0.003288275,0.0040007606,0.00088701776,0.028285462,0.006195464],"category_scores_gemma":[0.06249938,0.00045689018,0.00094821554,0.00045204474,0.0036378251,0.0038729932,0.001086427,0.052402686,0.0040591448],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000064447464,0.00005598572,0.001294046,0.00009814206,0.00004044644,0.003476357,0.00036129297,0.00019931384,0.00015076439,0.0156702,0.9606402,0.017948886],"study_design_scores_gemma":[0.00025448098,0.00011001665,0.0016856018,0.00087467715,0.00010141252,0.011243621,0.0014626329,0.0025706622,0.00035881173,0.20117667,0.7800532,0.00010813162],"about_ca_topic_score_codex":0.0033736834,"about_ca_topic_score_gemma":0.006053946,"teacher_disagreement_score":0.028285462,"about_ca_system_score_codex":0.0032132342,"about_ca_system_score_gemma":0.0035945743,"threshold_uncertainty_score":0.02331382},"labels":[],"label_agreement":null},{"id":"W2304863478","doi":"10.1136/eb-2015-102294","title":"Control or overcontrol for covariates?","year":2016,"lang":"en","type":"article","venue":"Evidence-Based Mental Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Covariate; Baseline (sea); Outcome (game theory); Statistics; Variance (accounting); Econometrics; Medicine; Psychology; Demography; Mathematics; Economics; Biology","score_opus":0.2714903255851573,"score_gpt":0.4785412563800963,"score_spread":0.20705093079493903,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2304863478","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008881933,0.037676428,0.8720756,0.06309839,0.0056644357,0.0015191609,0.0013229757,0.0008915174,0.008869431],"genre_scores_gemma":[0.39048243,0.021006932,0.51500154,0.047788344,0.0100955935,0.00871373,0.0011110449,0.00056662667,0.00523376],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8305464,0.14360107,0.0069000903,0.010225938,0.0075027593,0.0012237643],"domain_scores_gemma":[0.54041386,0.3695977,0.031856097,0.050652936,0.0063777072,0.0011016888],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.20845625,0.002254408,0.004418332,0.0019317386,0.0011180562,0.0035257398,0.0031433094,0.004029788,0.008730408],"category_scores_gemma":[0.44917282,0.0012980043,0.0041244524,0.0037494116,0.0047831945,0.00883411,0.0036714587,0.0066730613,0.0011408764],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002188341,0.00042812937,0.024100875,0.009333547,0.011706931,0.00039460295,0.002691879,0.008360958,0.00097591104,0.5449444,0.029494757,0.3653797],"study_design_scores_gemma":[0.0013253307,0.0006735596,0.006078443,0.003026853,0.0031021913,0.00031694357,0.00027416364,0.014305117,0.0011323588,0.88809764,0.08150784,0.00015961335],"about_ca_topic_score_codex":0.0055038347,"about_ca_topic_score_gemma":0.0040054107,"teacher_disagreement_score":0.7915437,"about_ca_system_score_codex":0.002637455,"about_ca_system_score_gemma":0.0061222995,"threshold_uncertainty_score":0.9761144},"labels":[],"label_agreement":null},{"id":"W2312181596","doi":"10.1111/spc3.12237","title":"On the (In)Validity of Tests of Simple Mediation: Threats and Solutions","year":2016,"lang":"en","type":"article","venue":"Social and Personality Psychology Compass","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":104,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"National Institute on Drug Abuse","keywords":"Mediation; Conceptualization; Simple (philosophy); Psychology; Context (archaeology); Social psychology; Epistemology; Computer science; Sociology; Social science; Artificial intelligence","score_opus":0.4013222090578177,"score_gpt":0.48602044924771803,"score_spread":0.08469824018990035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2312181596","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.091895245,0.01683706,0.71564597,0.103137664,0.0046214447,0.0034704944,0.0015054968,0.0010229668,0.061863672],"genre_scores_gemma":[0.7760728,0.0027252978,0.19264032,0.015619768,0.0026516637,0.008079466,0.0004614972,0.00028931585,0.0014599138],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.41166165,0.48098084,0.021722108,0.033707667,0.047992535,0.0039350605],"domain_scores_gemma":[0.037875317,0.9123589,0.013637696,0.027272038,0.007993311,0.00086278503],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.5048162,0.0031065368,0.006230798,0.008526193,0.008737216,0.00862645,0.009452214,0.010213073,0.011333474],"category_scores_gemma":[0.8213135,0.001974151,0.0055086366,0.01015005,0.050676744,0.02383293,0.015449484,0.015361965,0.0014590361],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011087229,0.00032987611,0.047283996,0.003927407,0.0033508288,0.0010463115,0.009831939,0.003809224,0.00058058224,0.7913888,0.011518086,0.12582429],"study_design_scores_gemma":[0.00068845716,0.00064919156,0.010221226,0.0033956477,0.00090142066,0.0009672115,0.0034919374,0.022241965,0.0018848508,0.9386788,0.016700085,0.00017909742],"about_ca_topic_score_codex":0.0030638569,"about_ca_topic_score_gemma":0.0015856706,"teacher_disagreement_score":0.5048162,"about_ca_system_score_codex":0.0053285672,"about_ca_system_score_gemma":0.011513608,"threshold_uncertainty_score":0.6106498},"labels":[],"label_agreement":null},{"id":"W2312523744","doi":"10.1371/journal.pmed.1001987","title":"Risk of Bias in Systematic Reviews of Non-Randomized Studies of Adverse Cardiovascular Effects of Thiazolidinediones and Cyclooxygenase-2 Inhibitors: Application of a New Cochrane Risk of Bias Tool","year":2016,"lang":"en","type":"article","venue":"PLoS Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":61,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto; Public Health Ontario","funders":"","keywords":"Medicine; Randomized controlled trial; Systematic review; Meta-analysis; Publication bias; Population; Confounding; Information bias; Internal medicine; MEDLINE; Selection bias; Pathology; Environmental health","score_opus":0.11158745063136817,"score_gpt":0.3768265426239632,"score_spread":0.26523909199259504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2312523744","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014354055,0.32906973,0.49239856,0.009936779,0.004979087,0.12981234,0.011559668,0.0034296105,0.0044601564],"genre_scores_gemma":[0.093989685,0.024877906,0.63529134,0.0020786284,0.00075846363,0.24009602,0.0020814005,0.00030706747,0.00051939697],"study_design_codex":"systematic_review","study_design_gemma":"observational","domain_scores_codex":[0.14668655,0.53214,0.24968524,0.015727177,0.054512918,0.0012481983],"domain_scores_gemma":[0.08458862,0.7995578,0.065793924,0.018665908,0.030196998,0.0011967869],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.60747606,0.0077764,0.029958459,0.06803398,0.002711552,0.010719037,0.0091882,0.009133601,0.004975603],"category_scores_gemma":[0.81683284,0.005999781,0.045747537,0.036022536,0.007229385,0.0102827195,0.015529711,0.00679431,0.0006019506],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030472104,0.0001059103,0.012752223,0.6550034,0.1634816,0.0005247505,0.003266269,0.0058511216,0.00066768174,0.01236827,0.009206971,0.13372454],"study_design_scores_gemma":[0.015836647,0.0021148871,0.025150012,0.40526432,0.34870923,0.0035805944,0.0028003636,0.050938644,0.004110676,0.077949986,0.061255384,0.0022892605],"about_ca_topic_score_codex":0.0047460105,"about_ca_topic_score_gemma":0.0074642138,"teacher_disagreement_score":0.39252394,"about_ca_system_score_codex":0.018041238,"about_ca_system_score_gemma":0.023158545,"threshold_uncertainty_score":0.48405194},"labels":[],"label_agreement":null},{"id":"W2312871991","doi":"10.1097/ede.0000000000000015","title":"Estimating Causal Effect with RCTs","year":2013,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Jewish General Hospital","funders":"","keywords":"Randomized controlled trial; Context (archaeology); Medicine; Covert; Deception; Physical therapy; Psychology; Internal medicine; Social psychology","score_opus":0.19768131595661156,"score_gpt":0.4445952550901146,"score_spread":0.24691393913350304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2312871991","genre_codex":"methods","genre_gemma":"commentary","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021592965,0.08531815,0.433401,0.42015776,0.035634976,0.006172395,0.0046824645,0.0023609498,0.01011298],"genre_scores_gemma":[0.062130682,0.033858486,0.6044305,0.23481305,0.029694846,0.029245201,0.0018810022,0.001138452,0.002807768],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.28401113,0.6595883,0.026113229,0.009782227,0.01959738,0.0009077939],"domain_scores_gemma":[0.039170727,0.9058438,0.016714722,0.026911525,0.010610048,0.00074923213],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47436446,0.0038083638,0.009043083,0.011034569,0.0024967978,0.0122699225,0.008467558,0.015717018,0.02600734],"category_scores_gemma":[0.8884449,0.004244976,0.013744112,0.011656509,0.009287508,0.019535735,0.01137678,0.028045502,0.004490066],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024506864,0.00037643904,0.00997101,0.046228506,0.02150996,0.0007947379,0.0027475902,0.009904228,0.00024320801,0.21386561,0.30473596,0.38717207],"study_design_scores_gemma":[0.0032678084,0.001009653,0.0033009865,0.034804672,0.0065008895,0.0010718621,0.0005489514,0.017704634,0.000623798,0.67902565,0.25168145,0.0004597135],"about_ca_topic_score_codex":0.0044425363,"about_ca_topic_score_gemma":0.0039299587,"teacher_disagreement_score":0.52563554,"about_ca_system_score_codex":0.006121757,"about_ca_system_score_gemma":0.011417338,"threshold_uncertainty_score":0.64820224},"labels":[],"label_agreement":null},{"id":"W2314210616","doi":"10.7202/1035914ar","title":"Le score de propension : un guide méthodologique pour les recherches expérimentales et quasi expérimentales en éducation","year":2016,"lang":"fr","type":"article","venue":"Mesure et évaluation en éducation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Carleton University; University of Ottawa","funders":"","keywords":"Humanities; Psychology; Political science; Art","score_opus":0.45761709353281127,"score_gpt":0.5102915203679868,"score_spread":0.05267442683517548,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2314210616","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015696226,0.0030681344,0.79678303,0.001427514,0.0018382579,0.16154905,0.0031255805,0.0014474642,0.015064861],"genre_scores_gemma":[0.02286938,0.00073659257,0.51410913,0.000607132,0.00008897506,0.45817617,0.00034307715,0.00027953665,0.0027899519],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.5917587,0.36609322,0.013678347,0.009091645,0.017970612,0.0014075943],"domain_scores_gemma":[0.5237525,0.41395193,0.010980225,0.032916166,0.017347043,0.0010521645],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21405426,0.0033213543,0.0043101204,0.0040649683,0.0027753504,0.0051414524,0.0036789372,0.003219583,0.019502705],"category_scores_gemma":[0.3341374,0.0027793874,0.0052465484,0.0040996214,0.005190006,0.003481842,0.003531004,0.0059603797,0.0040688138],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010823754,0.003970476,0.012339935,0.04088948,0.0075290217,0.00034051487,0.02432759,0.008444308,0.007470046,0.16951498,0.04343259,0.6709173],"study_design_scores_gemma":[0.024582349,0.027162787,0.0449131,0.021588983,0.006212648,0.00050393183,0.007237792,0.041814066,0.024203556,0.26126808,0.539113,0.00139971],"about_ca_topic_score_codex":0.0041043884,"about_ca_topic_score_gemma":0.0046242084,"teacher_disagreement_score":0.7859458,"about_ca_system_score_codex":0.0035682297,"about_ca_system_score_gemma":0.009624862,"threshold_uncertainty_score":0.96921104},"labels":[],"label_agreement":null},{"id":"W2314463908","doi":"10.1515/ijb-2012-0039","title":"The Effect of Error-in-Confounders on the Estimation of the Causal Parameter When Using Marginal Structural Models and Inverse Probability-of-Treatment Weights: A Simulation Study","year":2014,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Marginal structural model; Econometrics; Weighting; Inverse probability weighting; Statistics; Sign (mathematics); Inverse probability; Confounding; Logistic regression; Mathematics; Empirical research; Empirical likelihood; Estimator; Posterior probability; Bayesian probability; Medicine","score_opus":0.14099169658779223,"score_gpt":0.41563104355077823,"score_spread":0.274639346962986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2314463908","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.63885134,0.00076853274,0.35213256,0.0020599216,0.00006533235,0.0010563331,0.00047474104,0.00021910024,0.0043721576],"genre_scores_gemma":[0.922848,0.00015271446,0.075825006,0.00016156188,0.0000133992835,0.0004986297,0.00012448392,0.000029637138,0.00034650302],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.90012336,0.0924575,0.0021146704,0.0022327055,0.002144347,0.0009273965],"domain_scores_gemma":[0.20870009,0.75396174,0.01085974,0.020304905,0.005596684,0.0005768469],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15947758,0.0009774617,0.0014803016,0.00092639984,0.00092345336,0.001962205,0.0024775136,0.0019320355,0.003057414],"category_scores_gemma":[0.45774952,0.00082647614,0.0018625604,0.0016313818,0.0036872956,0.0028023364,0.0022718844,0.0030329407,0.00022386157],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005749658,0.0014199266,0.10342884,0.0008230002,0.0015952708,0.00073451706,0.0019381738,0.72181493,0.0017096943,0.10737344,0.001251104,0.05216141],"study_design_scores_gemma":[0.0010841021,0.0017943743,0.008144312,0.0003703886,0.0007835894,0.00028235785,0.00067016383,0.9301208,0.0046299906,0.05047215,0.0015272842,0.000120441655],"about_ca_topic_score_codex":0.007467341,"about_ca_topic_score_gemma":0.004749095,"teacher_disagreement_score":0.8405224,"about_ca_system_score_codex":0.0023069617,"about_ca_system_score_gemma":0.002768142,"threshold_uncertainty_score":0.8434081},"labels":[],"label_agreement":null},{"id":"W2316013226","doi":"10.1097/ede.0b013e3181f56fc0","title":"Accounting for Center Effects in Multicenter Trials","year":2010,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Studies","funders":"Canadian Institutes of Health Research","keywords":"Confounding; Medicine; Randomized controlled trial; Population; MEDLINE; Observational study; Sample size determination; Clinical trial; Family medicine; Internal medicine; Statistics; Environmental health","score_opus":0.3682306560980438,"score_gpt":0.5170263155245894,"score_spread":0.14879565942654566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2316013226","genre_codex":"review","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01444843,0.35595822,0.122295596,0.18372278,0.292153,0.015181362,0.0075199823,0.0025656843,0.0061549414],"genre_scores_gemma":[0.2511043,0.07435233,0.24155793,0.18248336,0.20836718,0.03446877,0.0022111877,0.001509365,0.0039456673],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.3162754,0.4192284,0.1838539,0.019843075,0.05883987,0.0019593923],"domain_scores_gemma":[0.046682406,0.79621595,0.09549987,0.025668714,0.03443691,0.0014961971],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47414523,0.0033085397,0.010583013,0.011488053,0.001950163,0.008817946,0.009851145,0.009289062,0.0068575013],"category_scores_gemma":[0.88632727,0.002384852,0.0081952475,0.018550415,0.00489062,0.009756132,0.0042329216,0.008917602,0.0011666034],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010145161,0.00021714912,0.03547176,0.20257735,0.053527232,0.001512671,0.0021592567,0.003842451,0.00072255166,0.017353997,0.3578288,0.3146416],"study_design_scores_gemma":[0.009818994,0.004439931,0.06405807,0.20064656,0.08182299,0.002924988,0.0011428248,0.042209122,0.005323577,0.116477765,0.46954677,0.0015883513],"about_ca_topic_score_codex":0.0009904532,"about_ca_topic_score_gemma":0.002054341,"teacher_disagreement_score":0.52585477,"about_ca_system_score_codex":0.004944221,"about_ca_system_score_gemma":0.008158355,"threshold_uncertainty_score":0.64847255},"labels":[],"label_agreement":null},{"id":"W2316188450","doi":"10.9778/cmajo.20150036","title":"Current use of routinely collected health data to complement randomized controlled trials: a meta-epidemiological survey","year":2016,"lang":"en","type":"article","venue":"CMAJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Epidemiology; Randomized controlled trial; Complement (music); Medicine; Environmental health; Internal medicine; Biology","score_opus":0.9025846780532691,"score_gpt":0.6125923435989659,"score_spread":0.2899923344543033,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2316188450","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.040683992,0.9160859,0.022336142,0.007723218,0.0010411717,0.0026157862,0.0068388204,0.00021826707,0.0024566853],"genre_scores_gemma":[0.6350433,0.2813197,0.057925865,0.008044317,0.0014813623,0.0076423273,0.00804446,0.00024557026,0.0002530879],"study_design_codex":"systematic_review","study_design_gemma":"observational","domain_scores_codex":[0.37612823,0.3350783,0.20407149,0.017103568,0.06589002,0.0017283483],"domain_scores_gemma":[0.07759088,0.7120894,0.13308586,0.042112235,0.033828266,0.0012932689],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.44227636,0.0024604497,0.01018016,0.05129476,0.0013623617,0.013055324,0.0056802784,0.005022158,0.0034323137],"category_scores_gemma":[0.7725924,0.0032451877,0.024042774,0.046114106,0.0039747213,0.011569671,0.005183675,0.004218894,0.0005526308],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024656905,0.00019481458,0.24026443,0.3167334,0.3139064,0.00029843504,0.002294657,0.001338304,0.00046963678,0.0045481506,0.005190829,0.1122952],"study_design_scores_gemma":[0.001867309,0.0013516353,0.18472944,0.3307624,0.42760217,0.0021654824,0.0029927462,0.0037729924,0.0016342582,0.011625914,0.030892754,0.0006029704],"about_ca_topic_score_codex":0.003781374,"about_ca_topic_score_gemma":0.0042579677,"teacher_disagreement_score":0.9898198,"about_ca_system_score_codex":0.0066612344,"about_ca_system_score_gemma":0.010437445,"threshold_uncertainty_score":0.6877726},"labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch","metaepi_broad"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W2316976792","doi":"10.1097/ede.0000000000000160","title":"The Parametric g-Formula for Time-to-event Data","year":2014,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":189,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute for Occupational Safety and Health; National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases; National Cancer Institute","keywords":"Event (particle physics); Event data; Parametric statistics; Statistics; Computer science; Mathematics; Econometrics; Physics; Covariate","score_opus":0.4063686748368892,"score_gpt":0.5184250915114785,"score_spread":0.11205641667458932,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2316976792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001574225,0.0006413739,0.99410546,0.0010354222,0.00019140274,0.0003589154,0.0007019359,0.00045750782,0.000933741],"genre_scores_gemma":[0.119839884,0.0025579971,0.8596608,0.002054178,0.0008629951,0.005926674,0.002877139,0.0006931968,0.0055271424],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9394874,0.04624719,0.002470214,0.005400329,0.005486041,0.0009088735],"domain_scores_gemma":[0.5955256,0.35711884,0.008972153,0.030977456,0.0066653,0.00074064004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09183082,0.0027212247,0.0038277789,0.0068561207,0.0010693969,0.0032818895,0.0067918296,0.0056264945,0.017013334],"category_scores_gemma":[0.37100044,0.0014864646,0.0053736307,0.0063792923,0.005436998,0.006621014,0.004067728,0.010365682,0.0038143797],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053811196,0.00014688655,0.012453944,0.0018288278,0.0011944497,0.0014301788,0.0009776253,0.10226306,0.0008704579,0.63960797,0.022532145,0.21615644],"study_design_scores_gemma":[0.00021475664,0.00023252708,0.002462823,0.00055886625,0.00030854196,0.0009432798,0.00013937481,0.25141323,0.0006585745,0.72238344,0.020591095,0.000093553805],"about_ca_topic_score_codex":0.0044588093,"about_ca_topic_score_gemma":0.0022534505,"teacher_disagreement_score":0.09183082,"about_ca_system_score_codex":0.0024367594,"about_ca_system_score_gemma":0.0035877354,"threshold_uncertainty_score":0.48565358},"labels":[],"label_agreement":null},{"id":"W2319214962","doi":"10.1097/ede.0000000000000188","title":"Time at Risk and Intention-to-treat Analyses","year":2014,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institutes of Health","keywords":"Causal inference; Inference; Population; Medicine; Randomized controlled trial; Psychology; Actuarial science; Surgery; Computer science; Economics; Environmental health","score_opus":0.2919902481500145,"score_gpt":0.4978836412572379,"score_spread":0.20589339310722338,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2319214962","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02843833,0.011848381,0.81637555,0.007581271,0.0122644715,0.08701369,0.018043077,0.0025475968,0.015887678],"genre_scores_gemma":[0.18063234,0.002829789,0.42742932,0.0072370707,0.0018113214,0.35646942,0.005979134,0.0011864264,0.016425151],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7167942,0.21949849,0.015748035,0.021799184,0.02193665,0.0042234985],"domain_scores_gemma":[0.8043883,0.14867719,0.013886451,0.025578242,0.006613881,0.000855952],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1842425,0.00353947,0.011850591,0.0054853633,0.001160727,0.003653054,0.0076696407,0.00921447,0.04008486],"category_scores_gemma":[0.390436,0.0016347948,0.02092528,0.0057223975,0.00471143,0.006914871,0.0032979692,0.014411091,0.0044820886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1120927,0.0038110185,0.013712849,0.054188266,0.0892557,0.0017372377,0.0046904143,0.039390177,0.0028068214,0.3173704,0.08042373,0.2805207],"study_design_scores_gemma":[0.02662828,0.01768902,0.015683139,0.009491833,0.033044696,0.0011279556,0.0010151383,0.23194753,0.009592933,0.49244022,0.16050695,0.00083233434],"about_ca_topic_score_codex":0.001737275,"about_ca_topic_score_gemma":0.0011581231,"teacher_disagreement_score":0.8157575,"about_ca_system_score_codex":0.003540252,"about_ca_system_score_gemma":0.005421559,"threshold_uncertainty_score":0.9743791},"labels":[],"label_agreement":null},{"id":"W2319338665","doi":"10.1111/caje.12249","title":"Viewpoint: The human capital approach to inference","year":2017,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Inference; Context (archaeology); Computer science; Artificial intelligence; Machine learning; Causal inference; Econometrics; Economics","score_opus":0.4020192808062404,"score_gpt":0.3037138214272396,"score_spread":0.09830545937900076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2319338665","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009078381,0.004027698,0.91285014,0.048208,0.00065359165,0.00012504315,0.00051319005,0.00011968602,0.024424253],"genre_scores_gemma":[0.7143784,0.0070966682,0.24390312,0.012427265,0.006105019,0.0008248212,0.00046771878,0.00012827087,0.014668701],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96189725,0.028697696,0.00089154625,0.0033390461,0.0042919572,0.00088250666],"domain_scores_gemma":[0.79035026,0.19084892,0.0058319466,0.008293628,0.0037325558,0.0009426608],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04454968,0.0012578417,0.0024613193,0.0034484465,0.0015789963,0.0051759277,0.0041274712,0.0035733294,0.0092833415],"category_scores_gemma":[0.15052135,0.00071468705,0.002176814,0.0027020886,0.010557395,0.008099003,0.0033679886,0.008473601,0.00065482734],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002118037,0.000029367835,0.0007497148,0.00008505202,0.00009461979,0.00006655499,0.00011984789,0.00699114,0.00003043511,0.98251766,0.0016246107,0.0076698633],"study_design_scores_gemma":[0.000019752595,0.000012047811,0.00020574003,0.000044732195,0.0000178013,0.000024347832,0.00002485008,0.017289035,0.000052130075,0.9804191,0.0018827535,0.000007787855],"about_ca_topic_score_codex":0.0070886584,"about_ca_topic_score_gemma":0.0034580182,"teacher_disagreement_score":0.04454968,"about_ca_system_score_codex":0.004645275,"about_ca_system_score_gemma":0.0038518768,"threshold_uncertainty_score":0.2356041},"labels":[],"label_agreement":null},{"id":"W2322253843","doi":"10.1097/ede.0000000000000053","title":"Constructing Inverse Probability Weights for Continuous Exposures","year":2014,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":139,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"","keywords":"Heteroscedasticity; Homoscedasticity; Mathematics; Statistics; Probability distribution; Quantile","score_opus":0.266417665166968,"score_gpt":0.4377748148809384,"score_spread":0.17135714971397037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2322253843","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039452963,0.00020620039,0.9584786,0.00012373056,0.000054464534,0.00022695893,0.00017022967,0.00026307866,0.00102378],"genre_scores_gemma":[0.34309623,0.00037717068,0.65361995,0.00014835423,0.000040641888,0.00080597936,0.0004779416,0.00022088701,0.0012127706],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9873372,0.008830325,0.0005060072,0.0014743421,0.001590701,0.00026149917],"domain_scores_gemma":[0.9481909,0.040772427,0.0032118908,0.00476309,0.0027573118,0.00030443753],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023454595,0.0011017061,0.0014293868,0.0033225794,0.0005442195,0.0018517211,0.0022120893,0.0015056947,0.004535503],"category_scores_gemma":[0.13450894,0.0009033844,0.001940396,0.0026147882,0.0017104896,0.0027651344,0.0023074215,0.002730419,0.00064603734],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005152567,0.00033400388,0.047655154,0.00063865085,0.001205904,0.00029786877,0.0012321586,0.4492166,0.0026554163,0.23838086,0.0030727289,0.25479543],"study_design_scores_gemma":[0.00015174563,0.00023771918,0.009093756,0.00023318143,0.00022282072,0.00023733694,0.00018287737,0.7085482,0.0019828437,0.27369693,0.0052868365,0.00012580982],"about_ca_topic_score_codex":0.0055599133,"about_ca_topic_score_gemma":0.004070345,"teacher_disagreement_score":0.023454595,"about_ca_system_score_codex":0.0014747833,"about_ca_system_score_gemma":0.0016600167,"threshold_uncertainty_score":0.1240412},"labels":[],"label_agreement":null},{"id":"W2322636499","doi":"10.1097/mlr.0000000000000464","title":"Adjustment for Variable Adherence Under Hierarchical Structure","year":2016,"lang":"en","type":"article","venue":"Medical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Infection and Immunity","funders":"National Heart, Lung, and Blood Institute; U.S. Department of Veterans Affairs","keywords":"Confounding; Statistics; Econometrics; Random effects model; Instrumental variable; Randomized controlled trial; Multilevel model; Mathematics; Nonparametric statistics; Observational study; Categorical variable; Medicine; Meta-analysis; Internal medicine","score_opus":0.0889677207723866,"score_gpt":0.4064756191708927,"score_spread":0.3175078983985061,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2322636499","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02040488,0.0007083729,0.97382486,0.0015130506,0.00010716414,0.001060732,0.0005090736,0.000418841,0.0014530468],"genre_scores_gemma":[0.60908866,0.00074979925,0.3817211,0.0008614336,0.00026630875,0.004602757,0.00089414214,0.000115701594,0.001700114],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92778,0.056918968,0.0029450147,0.0045547076,0.0065872753,0.001214061],"domain_scores_gemma":[0.8428187,0.10932604,0.021784883,0.021490043,0.0037243473,0.0008559657],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.072242334,0.0010040064,0.0017785617,0.0014800923,0.00097264955,0.0013786703,0.0035203444,0.0014738757,0.0046629244],"category_scores_gemma":[0.19173688,0.0007050672,0.0037371845,0.0022033919,0.002749031,0.0019504433,0.0029753312,0.0027626099,0.00045196115],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014336662,0.00040534767,0.091342494,0.0022652678,0.0044872523,0.00044534597,0.0015380407,0.19666488,0.0016972327,0.3646514,0.007893597,0.32717547],"study_design_scores_gemma":[0.0009853173,0.0016224171,0.0358103,0.0006856689,0.0018672082,0.0003698594,0.00015957831,0.43978775,0.002490727,0.5060512,0.010047116,0.00012285067],"about_ca_topic_score_codex":0.006221661,"about_ca_topic_score_gemma":0.006545857,"teacher_disagreement_score":0.9277577,"about_ca_system_score_codex":0.0028873151,"about_ca_system_score_gemma":0.009244379,"threshold_uncertainty_score":0.38205856},"labels":[],"label_agreement":null},{"id":"W2324021236","doi":"10.1097/ede.0000000000000237","title":"Variable Selection for Propensity Score Estimation via Balancing Covariates","year":2015,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Covariate; Propensity score matching; Statistics; Confounding; Average treatment effect; Estimator; Outcome (game theory); Matching (statistics); Causal inference; Inverse probability weighting; Poisson distribution; Econometrics; Mathematics","score_opus":0.35843125810130666,"score_gpt":0.43624797812403504,"score_spread":0.07781672002272838,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2324021236","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029106943,0.015125967,0.17163366,0.4644103,0.33917072,0.00026043513,0.0009782634,0.0012142503,0.004295791],"genre_scores_gemma":[0.05681478,0.016581818,0.08596,0.18266642,0.635294,0.0007598865,0.0007601837,0.0012425048,0.01992031],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98851043,0.0079111755,0.0007989363,0.0009113286,0.0016352511,0.0002328239],"domain_scores_gemma":[0.9041687,0.0745644,0.003847491,0.004073742,0.01178284,0.0015627824],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02542902,0.0010601919,0.0014978894,0.0011188607,0.0009665991,0.003179251,0.003479123,0.005359624,0.021822952],"category_scores_gemma":[0.17655584,0.0006596932,0.0013195499,0.001876057,0.0023463392,0.002367119,0.0015407072,0.010757878,0.005929821],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028579272,0.00005386057,0.0021069716,0.0006210192,0.00029068775,0.00038919382,0.00013396227,0.0019054628,0.00011091023,0.011549553,0.8634273,0.11912528],"study_design_scores_gemma":[0.0005796836,0.00024006888,0.0029784243,0.0015522556,0.0004976079,0.0015567201,0.00011740305,0.042139605,0.00083003775,0.07756368,0.8717836,0.00016086843],"about_ca_topic_score_codex":0.0014003728,"about_ca_topic_score_gemma":0.0020428065,"teacher_disagreement_score":0.02542902,"about_ca_system_score_codex":0.0010297205,"about_ca_system_score_gemma":0.0026359742,"threshold_uncertainty_score":0.13448316},"labels":[],"label_agreement":null},{"id":"W2326057587","doi":"10.1371/journal.pone.0153010","title":"Quantification of Treatment Effect Modification on Both an Additive and Multiplicative Scale","year":2016,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Hazard ratio; Context (archaeology); Medicine; Multiplicative function; Observational study; Propensity score matching; Proportional hazards model; Absolute risk reduction; Relative risk; Survival analysis; Randomized controlled trial; Additive model; Internal medicine; Statistics; Confidence interval; Mathematics; Biology","score_opus":0.2446653644634531,"score_gpt":0.39605357708173533,"score_spread":0.15138821261828223,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2326057587","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15493733,0.01086192,0.81622046,0.0023688124,0.00090093486,0.0016660799,0.002024646,0.0008162452,0.0102036055],"genre_scores_gemma":[0.84642786,0.0015400121,0.14739816,0.00079427485,0.00034733032,0.0013774043,0.0005905556,0.0001672679,0.0013571455],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9482475,0.038475625,0.003048594,0.0034669521,0.006313413,0.00044797093],"domain_scores_gemma":[0.8466694,0.123927295,0.012250276,0.01432204,0.0024065103,0.0004245315],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.052899174,0.0013501837,0.0015190757,0.0027843453,0.00024482477,0.00223884,0.001208925,0.0010993268,0.0032941145],"category_scores_gemma":[0.10500359,0.00044916812,0.0046481094,0.0017309117,0.0014283933,0.0015395802,0.0021030738,0.0019415582,0.000317202],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003616912,0.0010672506,0.29169744,0.006071473,0.034953754,0.00062275334,0.0015193275,0.083910845,0.013392963,0.07667762,0.006842338,0.47962737],"study_design_scores_gemma":[0.00063205796,0.008551884,0.37055746,0.0016382255,0.019816821,0.0027988004,0.0006197835,0.3369051,0.018081887,0.20734435,0.032443263,0.0006103734],"about_ca_topic_score_codex":0.00073299947,"about_ca_topic_score_gemma":0.0007336645,"teacher_disagreement_score":0.052899174,"about_ca_system_score_codex":0.00089583365,"about_ca_system_score_gemma":0.0011758399,"threshold_uncertainty_score":0.2797609},"labels":[],"label_agreement":null},{"id":"W2326293200","doi":"10.1097/ede.0000000000000221","title":"The Quasi-cohort Approach in Pharmacoepidemiology","year":2014,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Pharmacoepidemiology; Medicine; Cohort; Cohort study; Observational study; Nested case-control study; Pneumonia; Covariate; Intensive care medicine; Statistics; Internal medicine","score_opus":0.2639147808630067,"score_gpt":0.48437447309761084,"score_spread":0.22045969223460415,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2326293200","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042773136,0.0020930455,0.9851892,0.0044066515,0.00065565837,0.0004983478,0.00057549065,0.00011149386,0.002192854],"genre_scores_gemma":[0.19114146,0.005590814,0.78594565,0.0032947843,0.0017274749,0.0052190027,0.0008107994,0.00011407022,0.0061558485],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9417438,0.05269132,0.00089949515,0.002309774,0.0020512731,0.00030440587],"domain_scores_gemma":[0.8352988,0.14432336,0.004782155,0.012311746,0.0025348107,0.00074923475],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06645967,0.0008638519,0.0016025634,0.002622783,0.0014649188,0.0021898637,0.0033195175,0.002473196,0.006916757],"category_scores_gemma":[0.13172726,0.0009941558,0.0022117188,0.0032930481,0.004148542,0.0034462647,0.002830611,0.0046131704,0.0008052687],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012689814,0.00010405953,0.009325115,0.0005332832,0.0005216257,0.0004159409,0.0009361527,0.013213068,0.00014777378,0.9158848,0.0054133288,0.053377986],"study_design_scores_gemma":[0.00015372699,0.00020879589,0.0021627913,0.00024352418,0.00012298404,0.00032185306,0.00027155742,0.06268891,0.00014197233,0.9159355,0.017704742,0.00004361263],"about_ca_topic_score_codex":0.006712117,"about_ca_topic_score_gemma":0.004808011,"teacher_disagreement_score":0.93354034,"about_ca_system_score_codex":0.001902638,"about_ca_system_score_gemma":0.0034820756,"threshold_uncertainty_score":0.35147655},"labels":[],"label_agreement":null},{"id":"W2327805644","doi":"10.3233/jem-160423","title":"Model specification tests and the estimation of treatment effects: An application with random and non-random administrative records","year":2016,"lang":"en","type":"article","venue":"Journal of Economic and Social Measurement","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Bounding overwatch; Test (biology); Econometrics; Nonparametric statistics; Earnings; Computer science; Estimation; Limiting; Random effects model; Statistics; Economics; Mathematics; Accounting; Engineering; Artificial intelligence; Medicine","score_opus":0.16290518276954313,"score_gpt":0.3770801067298768,"score_spread":0.21417492396033366,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2327805644","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01003845,0.00023147088,0.98716575,0.00053327857,0.00005622715,0.0002884768,0.00034615168,0.00053450465,0.0008057294],"genre_scores_gemma":[0.24992698,0.00051675166,0.74329233,0.00045357182,0.00019481602,0.0028098517,0.0012538942,0.00030030447,0.0012514577],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85384685,0.13706289,0.0019982976,0.0029341972,0.0033631078,0.0007947304],"domain_scores_gemma":[0.4481305,0.5238298,0.008738213,0.015628295,0.0032010537,0.00047212257],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09486962,0.0017392931,0.0024500054,0.004262104,0.0012364668,0.0018191949,0.0042196293,0.002832868,0.010054742],"category_scores_gemma":[0.32192206,0.001288844,0.004083636,0.0046923175,0.0028540713,0.0030177142,0.0029817172,0.005619176,0.00071325887],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00116719,0.00097533717,0.04407282,0.0011566024,0.004416181,0.0012455145,0.001586021,0.20686765,0.0008372798,0.35322747,0.008837874,0.37561014],"study_design_scores_gemma":[0.00060349057,0.000701014,0.007730476,0.0002568793,0.00048459333,0.00030487112,0.00055942027,0.6601135,0.0013954551,0.3220412,0.005675677,0.00013348462],"about_ca_topic_score_codex":0.007077079,"about_ca_topic_score_gemma":0.005382076,"teacher_disagreement_score":0.09486962,"about_ca_system_score_codex":0.0014939444,"about_ca_system_score_gemma":0.0048019825,"threshold_uncertainty_score":0.5017245},"labels":[],"label_agreement":null},{"id":"W2337894698","doi":"10.2139/ssrn.2692274","title":"Sharp Instrumental Inequalities: Testing IV Independence Assumption","year":2015,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Independence (probability theory); Inequality; Instrumental variable; Econometrics; Mathematics; Statistics; Mathematical analysis","score_opus":0.28188118066557294,"score_gpt":0.4112924642807069,"score_spread":0.129411283615134,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2337894698","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.092302404,0.00088634103,0.88487,0.0037815396,0.00022617243,0.00024265824,0.0010205581,0.00027944686,0.016390936],"genre_scores_gemma":[0.9338145,0.0005922903,0.058883507,0.0010940697,0.00047877428,0.00045681588,0.0008442189,0.00010546483,0.0037303658],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97243667,0.017395597,0.0012959873,0.0041039027,0.0029780983,0.001789761],"domain_scores_gemma":[0.4637887,0.4902814,0.015946344,0.022773959,0.004415807,0.002793816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040048495,0.001810174,0.00389189,0.0032790317,0.0016711083,0.004566968,0.005220398,0.003343638,0.026866825],"category_scores_gemma":[0.2935736,0.0014431464,0.0038597095,0.0030528957,0.008559982,0.009237952,0.0071742563,0.011532536,0.0009932602],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011681991,0.00038119886,0.014307615,0.00058254716,0.0011868683,0.00075524655,0.00077779737,0.023679005,0.0008595542,0.91565824,0.003733397,0.036910277],"study_design_scores_gemma":[0.00039894067,0.00026942304,0.003410453,0.000104824576,0.00030446792,0.00014205302,0.00027764903,0.07502306,0.00076997146,0.91767,0.0015957878,0.000033261735],"about_ca_topic_score_codex":0.0014550006,"about_ca_topic_score_gemma":0.001077985,"teacher_disagreement_score":0.040048495,"about_ca_system_score_codex":0.001496776,"about_ca_system_score_gemma":0.002348786,"threshold_uncertainty_score":0.2117992},"labels":[],"label_agreement":null},{"id":"W2340048191","doi":"10.1097/ede.0000000000000487","title":"Targeted Maximum Likelihood Estimation for Pharmacoepidemiologic Research","year":2016,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Estimation; Statistics; Maximum likelihood; Mathematics; Economics","score_opus":0.5866250288778323,"score_gpt":0.5867883144975042,"score_spread":0.0001632856196719379,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2340048191","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029101379,0.00060907553,0.99507844,0.0004707799,0.00004044685,0.00015750754,0.0000771179,0.0001665745,0.00048997987],"genre_scores_gemma":[0.25269535,0.0016037303,0.74097884,0.0008334898,0.00022328999,0.0017512765,0.00048596077,0.00028955733,0.0011384917],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93046063,0.063777976,0.0011818754,0.0022174772,0.002013934,0.0003480526],"domain_scores_gemma":[0.77016634,0.21127412,0.006508983,0.0085742595,0.003014464,0.00046185343],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.069655925,0.0018540977,0.0028374,0.0029411959,0.0008573357,0.0031756593,0.003130004,0.0027140433,0.004775295],"category_scores_gemma":[0.26847115,0.0017841543,0.0034898259,0.003284428,0.0031708241,0.0029606617,0.003545912,0.00440852,0.0010459338],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068608794,0.0002829719,0.024320751,0.0021586944,0.0037138371,0.00076311966,0.0009798902,0.49909374,0.0015758735,0.2202063,0.005804902,0.24041373],"study_design_scores_gemma":[0.0002617996,0.00023729546,0.00275102,0.00043941263,0.00024826123,0.00021121404,0.00008636776,0.6587913,0.0010859171,0.3308058,0.005004834,0.000076702076],"about_ca_topic_score_codex":0.0034872666,"about_ca_topic_score_gemma":0.0020163935,"teacher_disagreement_score":0.069655925,"about_ca_system_score_codex":0.0022329616,"about_ca_system_score_gemma":0.003366763,"threshold_uncertainty_score":0.36838013},"labels":[],"label_agreement":null},{"id":"W2342168697","doi":"10.1002/hec.3342","title":"The Long-Term Effects of Cancer on Employment and Earnings","year":2016,"lang":"en","type":"article","venue":"Health Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Statistics Canada","funders":"Pennsylvania State University","keywords":"Microdata (statistics); Earnings; Census; Demography; History; Medicine; Gerontology; Sociology; Economics; Accounting; Population","score_opus":0.08672492711953217,"score_gpt":0.42082808021937634,"score_spread":0.3341031530998442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2342168697","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99265677,0.0030193597,0.0009817124,0.0010360867,0.000024656447,0.000016708193,0.00082855875,0.0000097219645,0.0014264316],"genre_scores_gemma":[0.99767464,0.0007895284,0.00016982477,0.000058623133,0.000018947156,0.0000063895477,0.0004123573,0.000001953018,0.000867694],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9991617,0.00027725782,0.000040495168,0.000093617055,0.00017497542,0.00025189543],"domain_scores_gemma":[0.99301153,0.0040884777,0.001677256,0.00034481304,0.00031377174,0.0005640206],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002104231,0.00024970298,0.00028988076,0.000760025,0.00048227725,0.0007615591,0.0006040855,0.0005780237,0.002801625],"category_scores_gemma":[0.010510999,0.00018572163,0.00064570864,0.0010331194,0.00081454206,0.00049297797,0.001061669,0.0008721407,0.00023254333],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028747958,0.0001534251,0.97814494,0.000037057915,0.0003241734,0.00020765305,0.00020167619,0.0039654877,0.00027410124,0.0014261439,0.00042791662,0.014549886],"study_design_scores_gemma":[0.000012028842,0.00008820919,0.9950427,0.00002425517,0.00012605594,0.00004109756,0.00020811871,0.0023447745,0.00012304194,0.001385471,0.0005959509,0.000008251942],"about_ca_topic_score_codex":0.16026124,"about_ca_topic_score_gemma":0.2044959,"teacher_disagreement_score":0.16026124,"about_ca_system_score_codex":0.001924559,"about_ca_system_score_gemma":0.0019818896,"threshold_uncertainty_score":0.31865686},"labels":[],"label_agreement":null},{"id":"W2342351145","doi":"10.2139/ssrn.2748490","title":"Stress-Testing with Parametric Models and Flexible Probabilities","year":2016,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke; HEC Montréal","funders":"","keywords":"Stress testing (software); Stress (linguistics); Parametric statistics; Structural engineering; Computer science; Reliability engineering; Engineering; Mathematics; Statistics","score_opus":0.163380266897334,"score_gpt":0.3589149930101895,"score_spread":0.19553472611285547,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2342351145","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02686039,0.00022658936,0.9704478,0.00062771793,0.00007625067,0.00006704653,0.0001772915,0.00025380024,0.0012630206],"genre_scores_gemma":[0.82277334,0.00043140954,0.17086267,0.0002700029,0.00037788923,0.0005250804,0.00048950885,0.0001737711,0.004096286],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9632169,0.026543727,0.001381091,0.005394275,0.0021246823,0.0013393137],"domain_scores_gemma":[0.59178233,0.37203816,0.008981023,0.023265053,0.002496172,0.0014372411],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040528942,0.0019096131,0.0038143706,0.0029352559,0.0020009438,0.0038151373,0.0058869375,0.0036850842,0.011300236],"category_scores_gemma":[0.25952977,0.0018726973,0.0040708934,0.0038692055,0.0073265093,0.0099688675,0.0067184656,0.0065492475,0.00072155317],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00060258183,0.00021507574,0.01319917,0.00029597772,0.0008045359,0.0012912495,0.0013061863,0.12143133,0.00043420974,0.769281,0.0020795332,0.08905918],"study_design_scores_gemma":[0.0000542551,0.00006864488,0.0011031006,0.000030649808,0.000079387726,0.00013167775,0.00009465255,0.16159782,0.00018711737,0.83618265,0.000442129,0.000027883128],"about_ca_topic_score_codex":0.0034019432,"about_ca_topic_score_gemma":0.002684466,"teacher_disagreement_score":0.040528942,"about_ca_system_score_codex":0.0013028354,"about_ca_system_score_gemma":0.002472269,"threshold_uncertainty_score":0.21434009},"labels":[],"label_agreement":null},{"id":"W2345813927","doi":"","title":"Event History Analysis in Longitudinal Cohort Studies with Intermittent Inspection Times","year":2016,"lang":"en","type":"dissertation","venue":"UWSpace (University of Waterloo)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Event (particle physics); History; Cohort; Aeronautics; Statistics; Engineering; Mathematics; Physics","score_opus":0.0530679014943403,"score_gpt":0.3110483358790242,"score_spread":0.2579804343846839,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2345813927","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031332683,0.0022924528,0.96377546,0.0007755959,0.000117144045,0.0001828488,0.0002426464,0.00017269004,0.0011084356],"genre_scores_gemma":[0.55153406,0.005510876,0.43259832,0.0006561002,0.0005045418,0.0017546454,0.0009561345,0.00011511893,0.006370174],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98648643,0.010513011,0.00047787666,0.0012811561,0.0009487235,0.00029284676],"domain_scores_gemma":[0.815101,0.16759618,0.007886577,0.007014945,0.0017233196,0.0006778682],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.050079454,0.00081318873,0.0014856807,0.0031249346,0.00085768045,0.001817733,0.002427571,0.001588933,0.0035136063],"category_scores_gemma":[0.16178025,0.00084092945,0.0021272565,0.0034442034,0.0018689682,0.00231445,0.002289737,0.0026273322,0.00037527885],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069475,0.00030337737,0.1113684,0.0011463802,0.0021330775,0.0009952708,0.0024402791,0.15029188,0.0011989719,0.4368139,0.00437743,0.28823632],"study_design_scores_gemma":[0.00014114295,0.00035851717,0.024053954,0.00038601022,0.000574083,0.00028183925,0.00044379514,0.55983526,0.0006440557,0.40600726,0.0071892077,0.00008492303],"about_ca_topic_score_codex":0.0041326177,"about_ca_topic_score_gemma":0.003713025,"teacher_disagreement_score":0.050079454,"about_ca_system_score_codex":0.0011383932,"about_ca_system_score_gemma":0.0016610238,"threshold_uncertainty_score":0.2648486},"labels":[],"label_agreement":null},{"id":"W2373287088","doi":"10.1177/0962280215590432","title":"Accounting for dropout reason in longitudinal studies with nonignorable dropout","year":2015,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vancouver Infectious Diseases Centre; McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Institute on Drug Abuse","keywords":"Dropout (neural networks); Longitudinal data; Econometrics; Psychology; Medicine; Statistics; Computer science; Economics; Mathematics; Data mining; Machine learning","score_opus":0.7294024134950148,"score_gpt":0.7194349984114543,"score_spread":0.009967415083560471,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2373287088","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029303242,0.0033707484,0.9589019,0.002971497,0.00059043866,0.0020958583,0.0010255809,0.0006783934,0.0010624116],"genre_scores_gemma":[0.5252749,0.002276001,0.45285246,0.0034813187,0.0008027818,0.009741918,0.0020858431,0.00031529172,0.0031695212],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.71927947,0.23262478,0.022487821,0.014268037,0.009302052,0.0020378581],"domain_scores_gemma":[0.37370425,0.5074503,0.048111465,0.06269979,0.0065242522,0.0015099699],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.34978458,0.0014925458,0.004164211,0.005324131,0.002345202,0.0031236708,0.0055993265,0.005495476,0.0043798867],"category_scores_gemma":[0.5652913,0.0016186228,0.0078020534,0.0067914403,0.0037852167,0.004560718,0.0045209597,0.0056580654,0.00058060256],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032824683,0.0006534311,0.3634597,0.0064886045,0.012669854,0.0030513213,0.006846675,0.03305586,0.0011830596,0.12779881,0.015158926,0.42635122],"study_design_scores_gemma":[0.0014622938,0.0029677919,0.13755953,0.0053059915,0.00889441,0.0027961822,0.002040864,0.2632439,0.0033442262,0.53152096,0.04030594,0.00055795547],"about_ca_topic_score_codex":0.004162649,"about_ca_topic_score_gemma":0.0050742296,"teacher_disagreement_score":0.6502154,"about_ca_system_score_codex":0.0016874743,"about_ca_system_score_gemma":0.0050929203,"threshold_uncertainty_score":0.80183136},"labels":[],"label_agreement":null},{"id":"W2378268168","doi":"10.1002/sim.6979","title":"A flexible parametric approach for estimating continuous‐time inverse probability of treatment and censoring weights","year":2016,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cancer Care Ontario; Public Health Ontario; University of Toronto","funders":"","keywords":"Inverse probability; Censoring (clinical trials); Marginal structural model; Inverse probability weighting; Parametric statistics; Statistics; Weighting; Event (particle physics); Computer science; Marginal distribution; Proportional hazards model; Confounding; Parametric model; Econometrics; Mathematics; Posterior probability; Medicine; Estimator; Random variable","score_opus":0.13772868312824896,"score_gpt":0.40989090075438367,"score_spread":0.2721622176261347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2378268168","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001207697,0.00006354825,0.9983053,0.00006471417,0.000013227569,0.000042398722,0.000051561532,0.00007233198,0.00017924103],"genre_scores_gemma":[0.2208025,0.0006319204,0.77255946,0.00029618983,0.00020211955,0.0014538016,0.0006732758,0.00021378581,0.0031669207],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826099,0.012403051,0.00056551,0.0018910888,0.0019574936,0.00057291565],"domain_scores_gemma":[0.94067377,0.04522385,0.0035570175,0.008331578,0.0017398513,0.00047404965],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026620982,0.0015705214,0.0024545453,0.0030514302,0.0007352648,0.0025629338,0.0053960998,0.0028129807,0.005372311],"category_scores_gemma":[0.1031211,0.0016912814,0.0037633162,0.0038305868,0.0028752913,0.0030668352,0.004557059,0.0067307632,0.0008420428],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002727301,0.00021553338,0.007579504,0.00039459608,0.0009826559,0.00059786113,0.00078042527,0.32593244,0.0019346174,0.4392083,0.0030149126,0.21908635],"study_design_scores_gemma":[0.00006838751,0.00014215552,0.0019957304,0.000078146586,0.00015239095,0.00029219786,0.0000720383,0.7112534,0.0009311364,0.2805478,0.0043859514,0.00008053501],"about_ca_topic_score_codex":0.0034474863,"about_ca_topic_score_gemma":0.0029629485,"teacher_disagreement_score":0.026620982,"about_ca_system_score_codex":0.0015839443,"about_ca_system_score_gemma":0.0026729591,"threshold_uncertainty_score":0.14078689},"labels":[],"label_agreement":null},{"id":"W2400611004","doi":"10.1515/ijb-2015-0015","title":"Influence Re-weighted G-Estimation","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Estimator; Weighting; Estimation; Parametric statistics; Computer science; Robust statistics; Marginal structural model; Average treatment effect; Econometrics; Mathematical optimization; Inverse probability weighting; Outcome (game theory); Mathematics; Parametric model; Statistics; Causal inference; Medicine; Economics","score_opus":0.14528751352761418,"score_gpt":0.43528432890430363,"score_spread":0.2899968153766894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2400611004","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025985537,0.00014658974,0.9960069,0.00018414813,0.000044599692,0.000051506442,0.00006146116,0.00013543533,0.0007707543],"genre_scores_gemma":[0.23339367,0.0006102596,0.757713,0.0006851442,0.00029637947,0.0005302408,0.00086762296,0.00041653152,0.0054872395],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99358976,0.0038709277,0.0002819078,0.0010698406,0.00093207275,0.00025548425],"domain_scores_gemma":[0.9694556,0.020385,0.0015366084,0.005779224,0.0025422657,0.00030128556],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010883221,0.001391362,0.002397731,0.0020709154,0.00077114406,0.001667168,0.0034262177,0.0023270128,0.0043069636],"category_scores_gemma":[0.07206411,0.0007184669,0.0018064033,0.0017806303,0.0017167756,0.0026144749,0.0030673149,0.0026002675,0.0012248707],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023432936,0.00012010925,0.0062878667,0.0003677629,0.0005073018,0.00039598483,0.0003134428,0.42526573,0.0029099751,0.31892052,0.007980038,0.23669696],"study_design_scores_gemma":[0.000034204215,0.0000503204,0.00070583215,0.00004983918,0.00007126214,0.0001155009,0.000030059377,0.8682125,0.0011937778,0.124712944,0.0047922167,0.000031512685],"about_ca_topic_score_codex":0.004125825,"about_ca_topic_score_gemma":0.0048471736,"teacher_disagreement_score":0.010883221,"about_ca_system_score_codex":0.0009893827,"about_ca_system_score_gemma":0.0018114884,"threshold_uncertainty_score":0.05755669},"labels":[],"label_agreement":null},{"id":"W2403763108","doi":"10.1097/sla.0000000000001797","title":"Potential Pitfalls of Reporting and Bias in Observational Studies With Propensity Score Analysis Assessing a Surgical Procedure","year":2016,"lang":"en","type":"review","venue":"Annals of Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":141,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"","keywords":"Observational study; Propensity score matching; Medicine; Sample size determination; Randomized controlled trial; Covariate; Selection bias; Missing data; Meta-analysis; MEDLINE; Study heterogeneity; Medical physics; Statistics; Surgery; Internal medicine; Pathology","score_opus":0.9070000380051212,"score_gpt":0.5712733601569768,"score_spread":0.33572667784814436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2403763108","genre_codex":"review","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042456813,0.5199168,0.34357902,0.048275348,0.009318531,0.01976289,0.0070478083,0.000806252,0.008836511],"genre_scores_gemma":[0.47597742,0.10472455,0.3184159,0.03710937,0.008356985,0.049899116,0.0034345079,0.0006687208,0.0014134371],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.1459437,0.5155138,0.28479025,0.012294861,0.0401744,0.0012829582],"domain_scores_gemma":[0.04763543,0.7688477,0.12544332,0.03164955,0.025876004,0.00054796867],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6514186,0.0022852318,0.0060483534,0.01645976,0.003047244,0.008566115,0.0051698494,0.0050866283,0.0029304258],"category_scores_gemma":[0.8571727,0.0026261327,0.0073196627,0.020255798,0.008775831,0.010220601,0.007582417,0.003675759,0.0007022266],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032691308,0.00019668121,0.111573346,0.36575228,0.031685416,0.0014601034,0.02675183,0.004211224,0.0023216787,0.071156286,0.030914545,0.3507075],"study_design_scores_gemma":[0.0026835594,0.0014401044,0.06348369,0.5348615,0.029900348,0.0051803454,0.009131832,0.012950446,0.008569027,0.1859642,0.14462043,0.0012144464],"about_ca_topic_score_codex":0.003544743,"about_ca_topic_score_gemma":0.0034826696,"teacher_disagreement_score":0.34858137,"about_ca_system_score_codex":0.006968384,"about_ca_system_score_gemma":0.014515355,"threshold_uncertainty_score":0.42986292},"labels":[],"label_agreement":null},{"id":"W2404984931","doi":"10.1016/j.jclinepi.2016.04.014","title":"Specifying a target trial prevents immortal time bias and other self-inflicted injuries in observational analyses","year":2016,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":974,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"National Center for Advancing Translational Sciences; National Cancer Institute","keywords":"Observational study; Emulation; Randomized controlled trial; Computer science; Medical physics; Research design; Simple (philosophy); Clinical trial; Medicine; Psychology; Statistics; Social psychology; Surgery; Mathematics","score_opus":0.8894193828691276,"score_gpt":0.6870352047744127,"score_spread":0.20238417809471487,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2404984931","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006353679,0.5020225,0.4755419,0.008640566,0.001262983,0.00054017705,0.0007292248,0.00041826128,0.0044907113],"genre_scores_gemma":[0.26045266,0.398072,0.32177958,0.008448577,0.0038328143,0.0028422207,0.001144804,0.00031756333,0.0031097843],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.95318246,0.0390859,0.002961678,0.0016608875,0.0028322153,0.000276917],"domain_scores_gemma":[0.7363408,0.2502698,0.00575043,0.005638171,0.0017186843,0.0002820024],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.058512185,0.000979829,0.0036489,0.0014517654,0.0003373972,0.0022479037,0.003214155,0.0035959184,0.0042484803],"category_scores_gemma":[0.19123179,0.00075435214,0.004541694,0.0018032951,0.0018704053,0.0029409833,0.0013066019,0.0046687312,0.00063964055],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014480117,0.00020927947,0.0030081032,0.047365654,0.007548453,0.0001866949,0.00032793832,0.011820651,0.00028342177,0.124919556,0.01003843,0.7928438],"study_design_scores_gemma":[0.0037969258,0.0010732859,0.0054035545,0.031273644,0.017885523,0.0014295973,0.00018759175,0.039178044,0.001595954,0.80606467,0.09194345,0.00016768549],"about_ca_topic_score_codex":0.00080031046,"about_ca_topic_score_gemma":0.00093274744,"teacher_disagreement_score":0.9414878,"about_ca_system_score_codex":0.00070712966,"about_ca_system_score_gemma":0.0034770607,"threshold_uncertainty_score":0.30944568},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W2405799747","doi":"10.13063/2327-9214.1221","title":"Observational Studies of Drug Safety in Multi-Database Studies: Methodological Challenges and Opportunities","year":2016,"lang":"en","type":"article","venue":"eGEMs (Generating Evidence & Methods to improve patient outcomes)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Manitoba; University of British Columbia; McGill University","funders":"Canadian Institutes of Health Research","keywords":"Observational study; Drug; Database; Data science; Medicine; Computer science; Pharmacology; Internal medicine","score_opus":0.8874851599926737,"score_gpt":0.6117314557646698,"score_spread":0.27575370422800394,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2405799747","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029122971,0.03606759,0.830535,0.09184974,0.002241545,0.0030839446,0.0021481044,0.00022185309,0.004729274],"genre_scores_gemma":[0.46150652,0.009985199,0.50336754,0.01169698,0.0031994092,0.008491463,0.0009114612,0.00011103795,0.00073040946],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.32097685,0.6252853,0.02252225,0.012917033,0.01723554,0.001063109],"domain_scores_gemma":[0.059352774,0.87605494,0.0300219,0.026009824,0.0072158095,0.0013447965],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.51432174,0.0012722089,0.003904178,0.0059753656,0.003212889,0.008503797,0.0065710256,0.004560805,0.0022922102],"category_scores_gemma":[0.7185065,0.0023777832,0.0033365123,0.0115543315,0.011455764,0.008953909,0.0081262505,0.006290069,0.0003318122],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016330626,0.0004891813,0.21133721,0.016345335,0.016556472,0.0016352077,0.008432707,0.040356915,0.00075291825,0.40848243,0.017047366,0.2769312],"study_design_scores_gemma":[0.00084326376,0.00052444165,0.027409658,0.008093834,0.0019520163,0.0011469546,0.0035265824,0.051626362,0.0005108336,0.88011765,0.024022717,0.00022562763],"about_ca_topic_score_codex":0.01178677,"about_ca_topic_score_gemma":0.012581791,"teacher_disagreement_score":0.48567826,"about_ca_system_score_codex":0.0064370716,"about_ca_system_score_gemma":0.010216998,"threshold_uncertainty_score":0.5989278},"labels":[],"label_agreement":null},{"id":"W2409841663","doi":"","title":"Illustration of time-dependent bias using individual patient data from the Canadian study","year":2016,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Computer science; Econometrics; Statistics; Psychology; Mathematics","score_opus":0.5698719868315746,"score_gpt":0.43072566136371876,"score_spread":0.13914632546785582,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2409841663","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.473842,0.0056996816,0.44235602,0.015805464,0.0004173079,0.00079408323,0.022183526,0.0015697341,0.037332077],"genre_scores_gemma":[0.9415221,0.00069525343,0.052116383,0.0005125343,0.000031155083,0.00013642025,0.0015703081,0.0000690117,0.0033468178],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9959407,0.0027671098,0.00017113745,0.00032582466,0.0005068711,0.00028846206],"domain_scores_gemma":[0.9397074,0.051766492,0.0015981947,0.003777649,0.0027543397,0.0003959144],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01802934,0.00038125555,0.00077242556,0.0012694539,0.0014659236,0.0012271198,0.0023612808,0.001873564,0.009341591],"category_scores_gemma":[0.057547513,0.00027879863,0.0014489886,0.0041571516,0.0017108627,0.000523742,0.0008490826,0.0017006805,0.00022343214],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022544914,0.00014695592,0.1201882,0.0010994327,0.0013490623,0.0022279622,0.0036837885,0.18686114,0.0015074629,0.5152243,0.033837147,0.13162006],"study_design_scores_gemma":[0.0014345818,0.00016451288,0.0760839,0.000518991,0.0013442582,0.0011098081,0.0017774119,0.54513544,0.0014849537,0.32351488,0.047228515,0.00020264977],"about_ca_topic_score_codex":0.81148094,"about_ca_topic_score_gemma":0.79754746,"teacher_disagreement_score":0.98197067,"about_ca_system_score_codex":0.004636007,"about_ca_system_score_gemma":0.011377917,"threshold_uncertainty_score":0.3792585},"labels":[],"label_agreement":null},{"id":"W2413921790","doi":"","title":"Causal inference under directed acyclic graphs","year":2015,"lang":"en","type":"dissertation","venue":"Memorial University Research Repository (Memorial University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Memorial University of Newfoundland","keywords":"Directed acyclic graph; Censoring (clinical trials); Inference; Phenotype; Causal inference; Genetic marker; Genetics; Statistics; Mathematics; Biology; Computer science; Algorithm; Artificial intelligence; Gene","score_opus":0.12514192518061737,"score_gpt":0.3894251269416274,"score_spread":0.26428320176101006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2413921790","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004322873,0.0013321572,0.9865871,0.0014961585,0.00014304927,0.000247019,0.0033076825,0.00059719145,0.0019667966],"genre_scores_gemma":[0.31435335,0.006639471,0.65515524,0.0022655337,0.0013573609,0.0028488145,0.01221164,0.00033957558,0.0048289183],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9683141,0.021734746,0.0015525992,0.005528242,0.002137024,0.0007333228],"domain_scores_gemma":[0.803099,0.17821155,0.0074465713,0.0073715188,0.0030995868,0.0007718095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024590202,0.0023633442,0.0026886594,0.007291417,0.0016638744,0.0038840023,0.00418338,0.002778535,0.0108964415],"category_scores_gemma":[0.11432019,0.0020190908,0.0042690393,0.008295203,0.0027256422,0.007509962,0.0037790344,0.005196739,0.0012323252],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037437194,0.00013808382,0.010823357,0.0014855736,0.0011310678,0.00066961953,0.00048484743,0.21504062,0.00034604597,0.65296024,0.012038369,0.10450776],"study_design_scores_gemma":[0.00009183767,0.000027595896,0.00049811543,0.00011587368,0.00015049624,0.000111442816,0.000052720537,0.26539516,0.00017992778,0.72866356,0.0046853223,0.000027845854],"about_ca_topic_score_codex":0.014552295,"about_ca_topic_score_gemma":0.012436299,"teacher_disagreement_score":0.024590202,"about_ca_system_score_codex":0.0033549357,"about_ca_system_score_gemma":0.004759207,"threshold_uncertainty_score":0.13004702},"labels":[],"label_agreement":null},{"id":"W2414683219","doi":"10.1016/j.athoracsur.2014.04.038","title":"Reply","year":2014,"lang":"en","type":"letter","venue":"The Annals of Thoracic Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Propensity score matching; Confounding; Medicine; Observational study; Sample size determination; Scopus; Randomized controlled trial; Internal medicine; Cardiology; Publication bias; Odds ratio; MEDLINE; Statistics; Mathematics","score_opus":0.46050029952635,"score_gpt":0.4922971498443505,"score_spread":0.0317968503180005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2414683219","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012862874,0.0005245042,0.000060911745,0.98270273,0.015150751,0.000010106295,0.000038851947,0.000015013181,0.001368449],"genre_scores_gemma":[0.00093411584,0.00022959607,0.00005475288,0.9849629,0.009799277,0.000025409061,0.000010552198,0.000009322108,0.003974074],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9946525,0.0011875757,0.00059406745,0.0009898136,0.0013830726,0.0011930104],"domain_scores_gemma":[0.98411614,0.008722082,0.0011088834,0.00052277144,0.0029610437,0.0025691327],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006120443,0.0009548431,0.0020877735,0.0013225186,0.0072190673,0.008424056,0.0034467753,0.11756214,0.014368607],"category_scores_gemma":[0.062389724,0.0016021103,0.0021104126,0.0011272002,0.0062431316,0.00588309,0.0046766284,0.08655171,0.009929014],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023756786,0.000011603048,0.0004811681,0.000036200494,0.000019600348,0.00062561856,0.00017408964,0.000051503168,0.000045470937,0.002644375,0.9930982,0.002788424],"study_design_scores_gemma":[0.00012402418,0.000040432256,0.0014587966,0.00050825207,0.00007596203,0.0011566991,0.0010980538,0.0004197073,0.00020740986,0.02039723,0.9743688,0.00014469464],"about_ca_topic_score_codex":0.012251571,"about_ca_topic_score_gemma":0.017198892,"teacher_disagreement_score":0.11756214,"about_ca_system_score_codex":0.006996556,"about_ca_system_score_gemma":0.009446051,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2414768697","doi":"10.1097/ede.0000000000000117","title":"Commentary","year":2014,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Counterfactual thinking; Argument (complex analysis); Meaning (existential); Psychological intervention; Causal inference; Race (biology); Sociology; Psychology; Epistemology; Social psychology; Econometrics; Gender studies; Mathematics; Medicine; Philosophy","score_opus":0.37566383627024375,"score_gpt":0.48119846562411694,"score_spread":0.1055346293538732,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2414768697","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00018171761,0.005480303,0.00023084051,0.7320956,0.20517364,0.000053263768,0.00067055813,0.00013610334,0.05597795],"genre_scores_gemma":[0.0025891638,0.0029673798,0.00021937898,0.8397368,0.043217205,0.00012160727,0.0003712399,0.00018621526,0.11059102],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9923469,0.0015546744,0.00039674036,0.0012542858,0.0031095445,0.0013378749],"domain_scores_gemma":[0.9752989,0.009148935,0.00072403194,0.0015761072,0.010299749,0.0029523533],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075577884,0.0010421507,0.0012712386,0.0017439481,0.006026803,0.0072248722,0.0048832316,0.027617665,0.1755164],"category_scores_gemma":[0.060768057,0.0006264168,0.0017669922,0.0014099389,0.003996,0.006003186,0.0042805066,0.023291029,0.06811788],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000008622869,0.0000026257894,0.000015246862,0.000040217128,0.0000018551996,0.000039123453,0.00003928797,0.000004848616,0.0000096926415,0.0025616763,0.9944443,0.0028324875],"study_design_scores_gemma":[0.0000072146972,0.0000031255984,0.00006137284,0.00024450768,0.0000026446235,0.000059557027,0.00009372952,0.000008207461,0.000025468884,0.0013875747,0.99810165,0.000004960873],"about_ca_topic_score_codex":0.012695712,"about_ca_topic_score_gemma":0.015059339,"teacher_disagreement_score":0.1755164,"about_ca_system_score_codex":0.007586042,"about_ca_system_score_gemma":0.016468793,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2417381186","doi":"10.1097/ede.0000000000000485","title":"Commentary","year":2016,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université du Québec; McGill University Health Centre; Canadian Institutes of Health Research","funders":"","keywords":"Medicine","score_opus":0.3637801306346827,"score_gpt":0.4849162716428969,"score_spread":0.12113614100821424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2417381186","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000466095,0.013365647,0.0008301826,0.47721124,0.280996,0.00025884167,0.0040012687,0.0005431295,0.22232758],"genre_scores_gemma":[0.00810582,0.010934444,0.00091675774,0.5418829,0.0709683,0.00061154965,0.0028527628,0.00065516465,0.36307228],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9938857,0.0015258468,0.0004251801,0.00094982586,0.0023305847,0.00088276394],"domain_scores_gemma":[0.98095787,0.0062568984,0.000735127,0.0017900927,0.007963581,0.0022965516],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052668494,0.00094655424,0.0012021603,0.0018874767,0.0034783385,0.0066604274,0.0043074526,0.012761644,0.36347598],"category_scores_gemma":[0.05129293,0.00052962103,0.0018177927,0.0014377485,0.0026348173,0.00464696,0.003929884,0.011156874,0.14203127],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000027307668,0.000005265159,0.000031405583,0.00021669253,0.00000483919,0.00007025892,0.000050245075,0.000010871545,0.000019621031,0.0041792765,0.98595536,0.009428961],"study_design_scores_gemma":[0.000014365002,0.0000057894904,0.00007851725,0.00055549986,0.000005139952,0.00010138972,0.00006840146,0.000012053602,0.00003443245,0.0018145145,0.9973049,0.000004965591],"about_ca_topic_score_codex":0.0068345726,"about_ca_topic_score_gemma":0.0075591044,"teacher_disagreement_score":0.36347598,"about_ca_system_score_codex":0.0051337406,"about_ca_system_score_gemma":0.013701871,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2425980697","doi":"10.1111/biom.12468","title":"Model Assessment in Dynamic Treatment Regimen Estimation via Double Robustness","year":2016,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Center for Advancing Translational Sciences; University of California, Los Angeles; University of Pittsburgh; Northwestern University","keywords":"Robustness (evolution); Regimen; Mathematics; Computer science; Statistics; Medicine; Econometrics; Internal medicine; Biology","score_opus":0.20103595473419972,"score_gpt":0.4506263431265718,"score_spread":0.24959038839237208,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2425980697","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012409107,0.0003069904,0.98534334,0.0005569998,0.000025413568,0.000060146886,0.00009894883,0.00012482505,0.0010743381],"genre_scores_gemma":[0.7393029,0.0007007295,0.25630948,0.00041105642,0.00014594787,0.00047776895,0.0004462833,0.00014852005,0.0020573875],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98683274,0.010353606,0.0004199131,0.0012096612,0.0008289103,0.0003552685],"domain_scores_gemma":[0.90872455,0.08163356,0.004388148,0.0033751328,0.0014323693,0.0004462804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027663471,0.0012206034,0.0019259232,0.0019382023,0.00054594595,0.002293819,0.0020762268,0.002129807,0.002532802],"category_scores_gemma":[0.1011735,0.000896838,0.002392283,0.0011219286,0.0025385139,0.002523183,0.0033047255,0.0027074716,0.00026659452],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019693068,0.00005769352,0.0043930407,0.00017037096,0.0003492586,0.00028810496,0.00019304361,0.77485865,0.00064990134,0.184696,0.0008989635,0.033248056],"study_design_scores_gemma":[0.000028890603,0.000060885326,0.00048207364,0.000027399494,0.000036938185,0.000042464613,0.000021351529,0.9076804,0.00030520948,0.090668105,0.00062312715,0.000023293376],"about_ca_topic_score_codex":0.003777699,"about_ca_topic_score_gemma":0.0016023054,"teacher_disagreement_score":0.027663471,"about_ca_system_score_codex":0.0015502253,"about_ca_system_score_gemma":0.0017192087,"threshold_uncertainty_score":0.14630014},"labels":[],"label_agreement":null},{"id":"W246160853","doi":"10.1080/07350015.2015.1044008","title":"Treatment Effects With Unobserved Heterogeneity: A Set Identification Approach","year":2015,"lang":"en","type":"article","venue":"Journal of Business and Economic Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; National Science Foundation","keywords":"Econometrics; Average treatment effect; Identification (biology); Outcome (game theory); Covariate; Set (abstract data type); Panel data; Treatment effect; Statistics; Mathematics; Computer science; Medicine; Estimator; Mathematical economics","score_opus":0.19657782441177,"score_gpt":0.3694869541265559,"score_spread":0.17290912971478592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W246160853","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028532916,0.00023112366,0.99409807,0.0007179183,0.000042385036,0.00012076803,0.00020466211,0.00008139708,0.001650424],"genre_scores_gemma":[0.4593451,0.0025136021,0.5148737,0.0018479322,0.00078782946,0.0038238957,0.001493564,0.00019419454,0.015120232],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97929436,0.014973902,0.0005893437,0.0020949119,0.0022001562,0.00084740465],"domain_scores_gemma":[0.8903432,0.09691992,0.0044622542,0.0054608644,0.0020518235,0.0007619412],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03228901,0.0018308914,0.004311254,0.0044530085,0.0013426049,0.0035900136,0.00609729,0.004353655,0.012208305],"category_scores_gemma":[0.087748714,0.001976535,0.00489412,0.0032773458,0.0035116887,0.004891005,0.005063317,0.0077790604,0.001032056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008719012,0.00012635533,0.001836431,0.00022067929,0.000636965,0.00022286085,0.0003787449,0.13363495,0.000292961,0.8324757,0.001946744,0.028140314],"study_design_scores_gemma":[0.000054047592,0.000049304046,0.00045416618,0.00008201436,0.00011498802,0.00005313725,0.00005360751,0.3666549,0.00022234004,0.63023573,0.001986918,0.000038862952],"about_ca_topic_score_codex":0.0035522426,"about_ca_topic_score_gemma":0.002463477,"teacher_disagreement_score":0.03228901,"about_ca_system_score_codex":0.0029778967,"about_ca_system_score_gemma":0.003199147,"threshold_uncertainty_score":0.17076266},"labels":[],"label_agreement":null},{"id":"W2466391332","doi":"10.1002/sim.7012","title":"Martingale residual‐based method to control for confounders measured only in a validation sample in time‐to‐event analysis","year":2016,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Statistics; Residual; Confounding; Computer science; Econometrics; Control chart; Event (particle physics); Sample (material); Sample size determination; Martingale (probability theory); Mathematics; Algorithm; Chromatography","score_opus":0.1189508705834617,"score_gpt":0.47092695879781293,"score_spread":0.3519760882143512,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2466391332","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015062285,0.00014102011,0.997743,0.00012092024,0.000035430832,0.000056833844,0.00007391022,0.0001459414,0.00017683516],"genre_scores_gemma":[0.1412878,0.0005127842,0.85335857,0.00041596647,0.00020014078,0.0010632874,0.00080981496,0.0002512819,0.002100332],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9863914,0.010984069,0.00045247687,0.00097574445,0.0009756394,0.00022069612],"domain_scores_gemma":[0.92596084,0.06026468,0.003325701,0.007800108,0.0023245318,0.00032412572],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04667363,0.0012612771,0.0016357572,0.0025470427,0.00048550233,0.0010295876,0.003387843,0.0015826554,0.0038115182],"category_scores_gemma":[0.10791395,0.0006414644,0.0021480261,0.0019913048,0.0019214482,0.0017376421,0.0023639088,0.0033467633,0.00074389036],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052324025,0.00021313455,0.01677709,0.0008168312,0.0014774281,0.00038114053,0.000557814,0.22081551,0.0024202531,0.47245747,0.007922661,0.2756375],"study_design_scores_gemma":[0.0002760594,0.00028487557,0.003454768,0.00017307265,0.0002441891,0.0002508487,0.00004247233,0.75625074,0.0023441631,0.22576381,0.010843721,0.00007124114],"about_ca_topic_score_codex":0.00308412,"about_ca_topic_score_gemma":0.0024588772,"teacher_disagreement_score":0.04667363,"about_ca_system_score_codex":0.00079953676,"about_ca_system_score_gemma":0.0027747445,"threshold_uncertainty_score":0.24683666},"labels":[],"label_agreement":null},{"id":"W2468938072","doi":"10.1093/aje/kww068","title":"Correcting for Measurement Error in Time-Varying Covariates in Marginal Structural Models","year":2016,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research","keywords":"Covariate; Marginal structural model; Statistics; Estimator; Confounding; Observational error; Econometrics; Inverse probability weighting; Errors-in-variables models; Lasso (programming language); Regression; Mathematics; Medicine; Computer science","score_opus":0.27974429685642044,"score_gpt":0.44757565314153613,"score_spread":0.1678313562851157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2468938072","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01656503,0.0002400286,0.9822922,0.0002855833,0.000026032441,0.000056055043,0.000051846593,0.00014130105,0.00034193866],"genre_scores_gemma":[0.5562784,0.0007523772,0.4409308,0.00026100836,0.00010803819,0.00039012756,0.0002365847,0.000078822624,0.0009638412],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98204505,0.015466504,0.00043309154,0.000880823,0.00092332694,0.00025125485],"domain_scores_gemma":[0.90385437,0.083567284,0.003617826,0.007111381,0.0015545259,0.0002946388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036652558,0.0011304143,0.0012581337,0.0013384447,0.0006383354,0.0010254473,0.0020447848,0.0014318499,0.0018014233],"category_scores_gemma":[0.14821252,0.0005568391,0.0017077244,0.0017162273,0.001966201,0.0017816179,0.0025213438,0.002043671,0.00022979027],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033937633,0.000113024995,0.029980328,0.00049706956,0.001133771,0.00044209146,0.0011772336,0.48796454,0.001315383,0.32152823,0.0012429116,0.15426607],"study_design_scores_gemma":[0.00010109664,0.00020851303,0.0039233174,0.00016989488,0.00019826216,0.00015860761,0.00014003456,0.677548,0.0015102113,0.31337953,0.0026146423,0.00004788967],"about_ca_topic_score_codex":0.005484219,"about_ca_topic_score_gemma":0.0055135945,"teacher_disagreement_score":0.036652558,"about_ca_system_score_codex":0.0009672661,"about_ca_system_score_gemma":0.002662343,"threshold_uncertainty_score":0.19383955},"labels":[],"label_agreement":null},{"id":"W2469474306","doi":"10.6000/1929-6029.2016.05.02.3","title":"Intention-to-Treat Analysis but for Treatment Intention: How should Consumer Product Randomized Controlled Trials be Analyzed?","year":2016,"lang":"en","type":"article","venue":"International Journal of Statistics in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Philip Morris International","keywords":"Blinding; Randomized controlled trial; Randomization; Protocol (science); Product (mathematics); De facto; Population; Intention-to-treat analysis; Marketing; Medicine; Psychology; Business; Alternative medicine; Mathematics; Surgery","score_opus":0.4179813978358019,"score_gpt":0.5845818989366804,"score_spread":0.16660050110087854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2469474306","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004024238,0.062436838,0.6959597,0.1856772,0.031674042,0.0098856725,0.0012573862,0.0012130326,0.007871896],"genre_scores_gemma":[0.1323184,0.015430093,0.6822657,0.08911582,0.015011911,0.06261583,0.00080582267,0.000718716,0.0017177413],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.21280807,0.7014348,0.03424969,0.014834207,0.035408385,0.0012648958],"domain_scores_gemma":[0.090851106,0.8250283,0.02517801,0.039881054,0.017896893,0.0011646524],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.62631243,0.0035057268,0.016538009,0.0065564676,0.0028433166,0.012654935,0.007732139,0.019710282,0.007715189],"category_scores_gemma":[0.8266307,0.0025790513,0.009033319,0.010014057,0.02312676,0.016232533,0.003923498,0.027901106,0.0031463008],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005301989,0.00050586456,0.0034385603,0.055027355,0.013055871,0.00043759332,0.0055518947,0.0056944187,0.0005677435,0.55424553,0.09868908,0.25748417],"study_design_scores_gemma":[0.0030447482,0.0010083119,0.0016992423,0.023186468,0.0033817664,0.00027268814,0.00047206576,0.021592082,0.0010165807,0.8950243,0.048966214,0.0003355766],"about_ca_topic_score_codex":0.0018432864,"about_ca_topic_score_gemma":0.001085919,"teacher_disagreement_score":0.37368757,"about_ca_system_score_codex":0.00846554,"about_ca_system_score_gemma":0.018024001,"threshold_uncertainty_score":0.46082336},"labels":[],"label_agreement":null},{"id":"W2469842794","doi":"10.1097/ede.0000000000000521","title":"Sufficient Cause Representation of the Four-way Decomposition for Mediation and Interaction","year":2016,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Jewish General Hospital","funders":"National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases","keywords":"Outcome (game theory); Counterfactual thinking; Mediation; Context (archaeology); Set (abstract data type); Consistency (knowledge bases); Representation (politics); Computer science; Decomposition; Component (thermodynamics); Psychology; Social psychology; Mathematics; Chemistry; Sociology; Physics; Political science; Artificial intelligence; History; Mathematical economics","score_opus":0.34802142461126384,"score_gpt":0.5045439834955416,"score_spread":0.1565225588842778,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2469842794","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075391987,0.008851064,0.3708228,0.4657852,0.12228105,0.00022712354,0.0019695526,0.000645947,0.021878077],"genre_scores_gemma":[0.3507291,0.010922151,0.22342889,0.15219282,0.20729452,0.0019512459,0.0016744998,0.0010003988,0.05080639],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9916334,0.004915398,0.0005870139,0.0012664424,0.0012213774,0.0003762631],"domain_scores_gemma":[0.96547735,0.026510471,0.0016439578,0.0019286207,0.0038323537,0.00060709316],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016080905,0.001432716,0.0013634851,0.0010502227,0.002082949,0.003085434,0.00385843,0.0060698567,0.020719517],"category_scores_gemma":[0.065151215,0.00074844935,0.002143083,0.0010340121,0.0044606295,0.004556877,0.0023091016,0.009881096,0.0032960032],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024708777,0.000082541366,0.0019504403,0.00070544065,0.00022897805,0.0012963337,0.0008484054,0.002620935,0.00022097811,0.5998208,0.34982795,0.04215013],"study_design_scores_gemma":[0.00013697172,0.00007324705,0.001136134,0.00036352233,0.00021649836,0.00090249995,0.00015794995,0.017387403,0.00036093264,0.7386493,0.24054888,0.00006679888],"about_ca_topic_score_codex":0.0021115658,"about_ca_topic_score_gemma":0.0030118837,"teacher_disagreement_score":0.020719517,"about_ca_system_score_codex":0.0018952579,"about_ca_system_score_gemma":0.004344003,"threshold_uncertainty_score":0.08504492},"labels":[],"label_agreement":null},{"id":"W2484604119","doi":"10.1177/0962280216658920","title":"Propensity score matching and complex surveys","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Covariate; Statistics; Confounding; Matching (statistics); Sample size determination; Medicine; Population; Demography; Econometrics; Mathematics; Environmental health","score_opus":0.7553058634596144,"score_gpt":0.6754228526511649,"score_spread":0.0798830108084495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2484604119","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00897838,0.0014236021,0.9850831,0.0017869514,0.00013220604,0.00050312915,0.00022045092,0.00017187098,0.0017004061],"genre_scores_gemma":[0.23704852,0.004521309,0.75244033,0.0011065725,0.00047169946,0.002355793,0.0006960278,0.000118856675,0.0012408961],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.903447,0.08604067,0.0025873682,0.0033031257,0.004150601,0.0004712125],"domain_scores_gemma":[0.86045116,0.109223194,0.01368039,0.012702521,0.0032374272,0.0007053124],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.077933855,0.00092445157,0.001968686,0.0036565633,0.00095408515,0.002544535,0.002075485,0.0019018811,0.0050491304],"category_scores_gemma":[0.22930801,0.00087257376,0.0014798125,0.008054586,0.0033814558,0.0039868024,0.0034367286,0.0033309276,0.00050423574],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021743076,0.00015795058,0.021490838,0.0009660525,0.0009873833,0.0001672903,0.0008921417,0.054544613,0.00032091,0.7105243,0.006167427,0.20356362],"study_design_scores_gemma":[0.00019562728,0.00020106905,0.007529591,0.00043402184,0.00013879765,0.00018239666,0.0001732423,0.11117597,0.0003700685,0.862163,0.017367521,0.000068689515],"about_ca_topic_score_codex":0.0036569175,"about_ca_topic_score_gemma":0.0023443755,"teacher_disagreement_score":0.077933855,"about_ca_system_score_codex":0.0023875819,"about_ca_system_score_gemma":0.0040439577,"threshold_uncertainty_score":0.41215855},"labels":[],"label_agreement":null},{"id":"W2492495737","doi":"10.1016/j.jcrc.2016.07.017","title":"Immortal time bias in observational studies of time-to-event outcomes","year":2016,"lang":"en","type":"article","venue":"Journal of Critical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":180,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; Sunnybrook Health Science Centre","funders":"","keywords":"Observational study; Proportional hazards model; Medicine; Logistic regression; Hazard ratio; Survival analysis; Statistics; Regression analysis; Econometrics; Internal medicine; Confidence interval; Mathematics","score_opus":0.4412060308633293,"score_gpt":0.5311251808301917,"score_spread":0.08991914996686234,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2492495737","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03948163,0.0098623615,0.94332826,0.003889815,0.00063191814,0.00017653899,0.00047254786,0.00026398525,0.0018929163],"genre_scores_gemma":[0.8089165,0.007990402,0.16964447,0.0025648598,0.0022283038,0.0012518566,0.0010140169,0.00022284409,0.006166689],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9091518,0.075570345,0.0038334343,0.0068284115,0.0033863087,0.0012297202],"domain_scores_gemma":[0.2765081,0.67782766,0.014996499,0.02614517,0.0033795245,0.0011431121],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19256628,0.0012014785,0.0032679709,0.0042907232,0.0015551745,0.0034195064,0.0058088847,0.0036101576,0.0060823313],"category_scores_gemma":[0.49728504,0.0016217582,0.004308082,0.0047603543,0.007173699,0.007793409,0.005223596,0.0063010524,0.000386045],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011052281,0.00015929846,0.05374491,0.0022762693,0.0037389782,0.0009767464,0.0021019639,0.024708116,0.00049120426,0.8327074,0.0028757663,0.07511404],"study_design_scores_gemma":[0.00020534346,0.000139527,0.0053281016,0.0003106854,0.00093739905,0.0004811499,0.0001842895,0.046984825,0.0004688611,0.94230604,0.0026132825,0.000040566272],"about_ca_topic_score_codex":0.004009318,"about_ca_topic_score_gemma":0.0030934175,"teacher_disagreement_score":0.8074337,"about_ca_system_score_codex":0.001954527,"about_ca_system_score_gemma":0.0038654213,"threshold_uncertainty_score":0.99570954},"labels":[],"label_agreement":null},{"id":"W249493256","doi":"10.1515/ijb-2014-0037","title":"Double Bias: Estimation of Causal Effects from Length-Biased Samples in the Presence of Confounding","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Estimator; Statistics; Econometrics; Hazard ratio; Causal inference; Sample size determination; Proportional hazards model; Sampling bias; Survival analysis; Estimation; Information bias; Mathematics; Selection bias; Point estimation; Data set; Pooling; Confidence interval; Computer science; Economics","score_opus":0.24735357801031266,"score_gpt":0.4444989250048111,"score_spread":0.19714534699449843,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W249493256","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012860016,0.00042795073,0.9856818,0.0003113565,0.00004358645,0.00018428572,0.000101833786,0.00008082318,0.0003084225],"genre_scores_gemma":[0.40242216,0.0010178189,0.59266615,0.00066700304,0.0002225103,0.0010926968,0.0005135024,0.000062712796,0.0013354234],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9705903,0.022282097,0.0012328172,0.0029819952,0.0025308733,0.00038191714],"domain_scores_gemma":[0.7795859,0.18992296,0.011843037,0.0149579365,0.0031444868,0.00054567086],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06578167,0.00085436023,0.001771888,0.0018529147,0.0007139447,0.001700631,0.0021949136,0.0020555006,0.0020496617],"category_scores_gemma":[0.23549408,0.00074682955,0.0020123809,0.001929066,0.0025800706,0.0023666057,0.0031183003,0.0022672627,0.00020482206],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006885879,0.00020799016,0.09039904,0.0013850832,0.0022938936,0.0014004502,0.0017935773,0.14372176,0.003103913,0.4275375,0.0024221714,0.32504606],"study_design_scores_gemma":[0.0003244046,0.00041664782,0.01533414,0.00050918065,0.00072678115,0.00095788157,0.00027591462,0.45285398,0.003830111,0.5160084,0.008653962,0.00010866622],"about_ca_topic_score_codex":0.0027566077,"about_ca_topic_score_gemma":0.0019561874,"teacher_disagreement_score":0.93421835,"about_ca_system_score_codex":0.0010260278,"about_ca_system_score_gemma":0.0021631708,"threshold_uncertainty_score":0.34789085},"labels":[],"label_agreement":null},{"id":"W2495538325","doi":"10.1177/1740774516656583","title":"A practical Bayesian stepped wedge design for community-based cluster-randomized clinical trials: The British Columbia Telehealth Trial","year":2016,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Cancer Institute","keywords":"Telehealth; Sample size determination; Clinical trial; Cluster randomised controlled trial; Medicine; Randomized controlled trial; Type I and type II errors; Research design; Confidence interval; Cluster (spacecraft); Health care; Computer science; Telemedicine; Physical therapy; Statistics; Mathematics; Surgery; Internal medicine","score_opus":0.7739321541510332,"score_gpt":0.6354475128676494,"score_spread":0.13848464128338378,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2495538325","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.046565767,0.0053410707,0.49935848,0.008726358,0.003205891,0.4109402,0.0037760544,0.0021050598,0.019981124],"genre_scores_gemma":[0.13517906,0.0007088499,0.38582054,0.004279142,0.00018318363,0.46942806,0.00079971354,0.00014598887,0.0034555383],"study_design_codex":"design_other","study_design_gemma":"nonrandomized_trial","domain_scores_codex":[0.64304304,0.3286982,0.008730508,0.00622799,0.011528817,0.0017715128],"domain_scores_gemma":[0.8320199,0.1098269,0.01254556,0.0240873,0.017592555,0.0039277365],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19996013,0.0023993694,0.0049448125,0.0022774835,0.00241898,0.0036691418,0.0036417176,0.0060006827,0.017714588],"category_scores_gemma":[0.26262015,0.0016145603,0.0029321287,0.0035516687,0.0037482865,0.0027923125,0.0034289798,0.005141128,0.0019276345],"study_design_candidate":"nonrandomized_trial","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.30032912,0.005294791,0.011461621,0.02074592,0.010538775,0.0009009345,0.0021003585,0.058659434,0.0022069225,0.13548826,0.07205019,0.3802236],"study_design_scores_gemma":[0.47106495,0.038482826,0.013863006,0.0095900055,0.0063982024,0.00064190343,0.00045870044,0.19258018,0.0025184704,0.15568817,0.10788258,0.0008310053],"about_ca_topic_score_codex":0.012084128,"about_ca_topic_score_gemma":0.018163351,"teacher_disagreement_score":0.19996013,"about_ca_system_score_codex":0.0050602457,"about_ca_system_score_gemma":0.018273156,"threshold_uncertainty_score":0.9865916},"labels":[],"label_agreement":null},{"id":"W2501992360","doi":"10.1080/00273171.2016.1200454","title":"Using Marginal Structural Modeling for Grade Retention Effects","year":2016,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Simon Fraser University; Fordham University","keywords":"Equating; Covariate; Confounding; Propensity score matching; Statistics; Analysis of covariance; Marginal structural model; Econometrics; Missing data; Psychology; Computer science; Mathematics","score_opus":0.8116577974541808,"score_gpt":0.63032002163345,"score_spread":0.18133777582073074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2501992360","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0093439445,0.0032918144,0.97364897,0.008879617,0.00062130933,0.00022482437,0.00092417665,0.0003305089,0.0027348993],"genre_scores_gemma":[0.40080276,0.006309407,0.5764747,0.0045611556,0.0013956609,0.0023726255,0.0013526422,0.00046905532,0.006262006],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9595366,0.035115678,0.0010126209,0.0024432538,0.0014231408,0.00046853037],"domain_scores_gemma":[0.87568474,0.11218732,0.0038589162,0.0054355543,0.0024713415,0.00036214985],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.044582687,0.0018326604,0.0018775798,0.002345974,0.00091864384,0.0032747036,0.0041983626,0.0029818933,0.008213577],"category_scores_gemma":[0.14296502,0.0010332661,0.005579539,0.0038059456,0.0022918994,0.004162305,0.0030340294,0.0057876585,0.0007217247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019022608,0.000098614604,0.016623907,0.0010100148,0.0036361765,0.00024577227,0.0028198028,0.04305338,0.00020623537,0.8113613,0.013441197,0.107313305],"study_design_scores_gemma":[0.00011798663,0.00015610088,0.0038082232,0.00060982176,0.0013299119,0.00011392421,0.0004719002,0.15922135,0.00040321331,0.8057617,0.027934574,0.00007126401],"about_ca_topic_score_codex":0.022313278,"about_ca_topic_score_gemma":0.026128737,"teacher_disagreement_score":0.044582687,"about_ca_system_score_codex":0.0037146448,"about_ca_system_score_gemma":0.003935194,"threshold_uncertainty_score":0.23577857},"labels":[],"label_agreement":null},{"id":"W2505126815","doi":"10.1016/s0731-9053(07)00004-7","title":"Instrumental variables estimation of the average treatment effect in the correlated random coefficient model","year":2008,"lang":"en","type":"book-chapter","venue":"Advances in econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":87,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of British Columbia; Michigan State University","keywords":"Instrumental variable; Tobit model; Mathematics; Variables; Econometrics; Statistics; Random variable; Estimation; Random effects model; Variable (mathematics); Economics; Mathematical analysis","score_opus":0.066085663606183,"score_gpt":0.3263762946920296,"score_spread":0.2602906310858466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2505126815","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029538732,0.0005532991,0.9906645,0.00082373695,0.00010590587,0.0001262404,0.00025550334,0.00014527366,0.004371622],"genre_scores_gemma":[0.2626223,0.0043327236,0.70253253,0.0018285426,0.00083328673,0.0020775357,0.0011600173,0.0004205806,0.024192417],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9832454,0.012667637,0.00039402113,0.0015076016,0.0015487504,0.0006365923],"domain_scores_gemma":[0.9659864,0.027422614,0.0020468084,0.0031742458,0.0011181957,0.00025187255],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0199737,0.0012678421,0.003244682,0.0016603345,0.00075084757,0.0029177899,0.004508485,0.0027262387,0.012287532],"category_scores_gemma":[0.06101432,0.0010304477,0.0022616596,0.0030397463,0.002902131,0.0029695483,0.0024484128,0.004648822,0.0023587258],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000088557725,0.0001144039,0.0016850084,0.00027521283,0.0003146487,0.00012340846,0.0001915269,0.06760054,0.00040416565,0.8692061,0.0054944386,0.054502085],"study_design_scores_gemma":[0.00012907585,0.00009395664,0.001162735,0.0002444342,0.00025694852,0.00008664271,0.000077497185,0.28738284,0.0010434454,0.6972969,0.012163224,0.000062340136],"about_ca_topic_score_codex":0.0026348513,"about_ca_topic_score_gemma":0.0020805984,"teacher_disagreement_score":0.0199737,"about_ca_system_score_codex":0.0018402779,"about_ca_system_score_gemma":0.0034511823,"threshold_uncertainty_score":0.105632246},"labels":[],"label_agreement":null},{"id":"W2507759746","doi":"10.1007/s00228-016-2118-x","title":"Performance of the high-dimensional propensity score in adjusting for unmeasured confounders","year":2016,"lang":"en","type":"article","venue":"European Journal of Clinical Pharmacology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McMaster University; McGill University; Centre Hospitalier de l’Université de Montréal; Programs for Assessment of Technology in Health Research Institute","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Confounding; Medicine; Statistics; Econometrics; Internal medicine; Psychology; Mathematics","score_opus":0.4570305638231168,"score_gpt":0.4816920596247215,"score_spread":0.024661495801604705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2507759746","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58761895,0.0036439628,0.40148908,0.0012794507,0.00029424293,0.0006998724,0.0013590191,0.00033336369,0.003282115],"genre_scores_gemma":[0.93924546,0.00034961852,0.0592684,0.00013390806,0.00006779099,0.0001776108,0.00047592007,0.000018255601,0.0002630049],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96357703,0.02911159,0.00172647,0.0021297894,0.0031420717,0.00031301216],"domain_scores_gemma":[0.9443164,0.03823634,0.0069418405,0.00785749,0.0021316132,0.0005162813],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04064358,0.00089824485,0.00096695963,0.0016756441,0.00047374185,0.0015883899,0.0007772615,0.0007358828,0.0019803396],"category_scores_gemma":[0.08693853,0.000359797,0.001970181,0.0017734895,0.0009801992,0.0012192787,0.002219921,0.0009796064,0.00026213733],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027418972,0.00028496582,0.7575237,0.0005155997,0.005737573,0.00011686667,0.00029969984,0.030927563,0.001057743,0.005287676,0.0016184971,0.19388817],"study_design_scores_gemma":[0.00073490647,0.0031177711,0.6655529,0.00033010816,0.0024995962,0.0009867289,0.00031169044,0.28891012,0.0052437643,0.025001947,0.0070793093,0.00023111985],"about_ca_topic_score_codex":0.0015592017,"about_ca_topic_score_gemma":0.0012113019,"teacher_disagreement_score":0.9593564,"about_ca_system_score_codex":0.00065708574,"about_ca_system_score_gemma":0.001576038,"threshold_uncertainty_score":0.21494639},"labels":[],"label_agreement":null},{"id":"W2509712226","doi":"10.1016/j.jclinepi.2016.05.017","title":"Propensity score model overfitting led to inflated variance of estimated odds ratios","year":2016,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":60,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Children's Hospital; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Overfitting; Propensity score matching; Statistics; Type I and type II errors; Confounding; Logistic regression; Inference; Econometrics; Mathematics; Computer science; Artificial intelligence; Artificial neural network","score_opus":0.7352681527672233,"score_gpt":0.5929485520547376,"score_spread":0.14231960071248573,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2509712226","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01655746,0.00022305714,0.98073727,0.0009974424,0.00017930206,0.000071121874,0.00011636993,0.00054058083,0.0005773167],"genre_scores_gemma":[0.6475312,0.00030109906,0.34644967,0.0016109333,0.00030047915,0.00034293978,0.0004438855,0.0008112783,0.0022084662],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9587513,0.027430095,0.0023967111,0.0063239457,0.004147192,0.00095073006],"domain_scores_gemma":[0.76873666,0.18919843,0.005696596,0.027333215,0.008487498,0.0005476955],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.083157524,0.0012678088,0.0022981907,0.001774453,0.0010169869,0.0037413482,0.0023864894,0.0023134197,0.0034458127],"category_scores_gemma":[0.3488279,0.0014666672,0.0022974757,0.0022893124,0.0020300855,0.0029370962,0.0022079905,0.007915907,0.0008134899],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008959538,0.00037379234,0.055959772,0.0006720183,0.002201431,0.0028290648,0.0029098473,0.30701813,0.006458688,0.34275925,0.015922166,0.26199988],"study_design_scores_gemma":[0.00013534773,0.00010396142,0.008523117,0.00013338667,0.00047945045,0.0010864077,0.00009027795,0.6747529,0.0044195675,0.3055602,0.004611536,0.00010386529],"about_ca_topic_score_codex":0.003937202,"about_ca_topic_score_gemma":0.0032782743,"teacher_disagreement_score":0.91684246,"about_ca_system_score_codex":0.0014306743,"about_ca_system_score_gemma":0.0023368595,"threshold_uncertainty_score":0.4397843},"labels":[],"label_agreement":null},{"id":"W2513257670","doi":"10.1002/cjs.11301","title":"Survey estimation of domain means that respect natural orderings","year":2016,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"Estimator; Estimation; Mathematics; Bootstrapping (finance); Domain (mathematical analysis); Statistics; Pooling; Econometrics; Computer science; Economics; Artificial intelligence; Mathematical analysis","score_opus":0.11370152141497193,"score_gpt":0.35557705279460516,"score_spread":0.24187553137963325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2513257670","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1124092,0.00021066093,0.8845975,0.00015181051,0.000020020165,0.00010670503,0.00046179316,0.00018640222,0.0018558949],"genre_scores_gemma":[0.7817423,0.00021254292,0.21544088,0.000111082,0.00003919885,0.0004528516,0.0010847138,0.00004978703,0.00086666865],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97758454,0.0171316,0.0007042508,0.0026005139,0.0016116742,0.00036745606],"domain_scores_gemma":[0.8509474,0.106974974,0.013418704,0.02139577,0.0065398104,0.00072339654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02528922,0.00048348532,0.0012263329,0.0020437895,0.00058761856,0.0017746075,0.0013466193,0.0008274083,0.0027273044],"category_scores_gemma":[0.13928255,0.0005849701,0.0012584464,0.0022858754,0.0027451601,0.002789722,0.0016132471,0.001830324,0.00036686243],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005577175,0.00029040972,0.0979398,0.00058403384,0.0005703464,0.00026090918,0.0011811926,0.19007218,0.0042837216,0.560234,0.00288915,0.14113654],"study_design_scores_gemma":[0.00009441229,0.0003455369,0.03237415,0.00015980657,0.000082487066,0.0001783975,0.0004545806,0.43555337,0.003139428,0.5233257,0.0041896827,0.00010237202],"about_ca_topic_score_codex":0.002108644,"about_ca_topic_score_gemma":0.0013992845,"teacher_disagreement_score":0.02528922,"about_ca_system_score_codex":0.00082865305,"about_ca_system_score_gemma":0.0012854156,"threshold_uncertainty_score":0.13374376},"labels":[],"label_agreement":null},{"id":"W2514070870","doi":"10.6339/jds.201604_14(2).0002","title":"Comparing Pre-Post Change Across Groups: Guidelines for Choosing between Difference Scores, ANCOVA, and Residual Change Scores","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":60,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Analysis of covariance; Residual; Statistics; Significant difference; Psychology; Mathematics","score_opus":0.732100748033184,"score_gpt":0.5505718425854673,"score_spread":0.18152890544771672,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2514070870","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033405514,0.0064681587,0.9115558,0.0065684076,0.007176665,0.031600576,0.019626739,0.005497623,0.008165485],"genre_scores_gemma":[0.005084194,0.0013100739,0.93308514,0.0018164126,0.00041172543,0.051001295,0.0027314248,0.0017586808,0.0028009787],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.73558253,0.19329822,0.04210356,0.005777583,0.02221792,0.0010202153],"domain_scores_gemma":[0.45448256,0.44665036,0.015782848,0.029067703,0.05170177,0.0023146884],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21547356,0.004881492,0.007278097,0.012681763,0.002076542,0.0040135724,0.0073169954,0.0070860847,0.0268219],"category_scores_gemma":[0.5365975,0.0041824207,0.006591364,0.012926361,0.0048708827,0.0048685856,0.0032634854,0.013790033,0.0154905515],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030881916,0.0014715728,0.005912216,0.011193919,0.0017523716,0.00087789877,0.0025254793,0.0031437327,0.0036406026,0.03207331,0.590018,0.3443028],"study_design_scores_gemma":[0.0057225716,0.0047497037,0.04369739,0.025648413,0.0021818248,0.0020371045,0.0039534764,0.029607149,0.016826553,0.22356327,0.64040315,0.0016094665],"about_ca_topic_score_codex":0.0040097926,"about_ca_topic_score_gemma":0.010289136,"teacher_disagreement_score":0.78452647,"about_ca_system_score_codex":0.0016585697,"about_ca_system_score_gemma":0.0057255025,"threshold_uncertainty_score":0.96746075},"labels":[],"label_agreement":null},{"id":"W2516296618","doi":"10.1016/j.jclinepi.2016.08.006","title":"A simple method for analyzing matched designs with double controls: McNemar's test can be extended","year":2016,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"McNemar's test; Logistic regression; Computer science; Matching (statistics); Statistics; Simple (philosophy); Null hypothesis; Score test; Data mining; Statistical hypothesis testing; Mathematics","score_opus":0.5988744036316583,"score_gpt":0.6051541069230387,"score_spread":0.00627970329138039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2516296618","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019377071,0.00076280284,0.9943434,0.00028369078,0.00040015628,0.00092867896,0.00041239936,0.0004252611,0.0005058739],"genre_scores_gemma":[0.033809487,0.0007805618,0.95770574,0.0004571651,0.00034186052,0.0048306272,0.0004725366,0.00031884116,0.0012830931],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8297513,0.13282709,0.012296408,0.011008059,0.012959497,0.0011576611],"domain_scores_gemma":[0.6483191,0.286296,0.010188135,0.046828788,0.007457514,0.00091035716],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15565221,0.003084906,0.007728558,0.009863012,0.0017689394,0.0028760117,0.008348693,0.0039590066,0.026371952],"category_scores_gemma":[0.4306915,0.001933039,0.008118628,0.010191145,0.0033391789,0.004359436,0.0041944887,0.0062991213,0.002531405],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029987295,0.00077787426,0.010426639,0.0057760915,0.012477939,0.001338736,0.001182376,0.012511388,0.0041315625,0.13818367,0.015246772,0.79494816],"study_design_scores_gemma":[0.0046012597,0.0071059666,0.026244925,0.0027800815,0.008416121,0.005966899,0.0010185426,0.15458101,0.010565356,0.6913413,0.08628725,0.0010913755],"about_ca_topic_score_codex":0.003897569,"about_ca_topic_score_gemma":0.0031545132,"teacher_disagreement_score":0.15565221,"about_ca_system_score_codex":0.0012548036,"about_ca_system_score_gemma":0.004673067,"threshold_uncertainty_score":0.8231774},"labels":[],"label_agreement":null},{"id":"W2517555654","doi":"10.1111/caje.12217","title":"Viewpoint: Estimating the causal effects of policies and programs","year":2016,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Credibility; Interpretation (philosophy); Causal inference; Identification (biology); Context (archaeology); Internal validity; Positive economics; Inference; Estimation; Economics; Epistemology; Econometrics; Computer science","score_opus":0.21164262474422046,"score_gpt":0.26770295389089455,"score_spread":0.05606032914667408,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2517555654","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013881423,0.0036363727,0.93290406,0.030992042,0.0005415351,0.00023215625,0.0008574882,0.00018596515,0.016768994],"genre_scores_gemma":[0.68924606,0.006915049,0.28851154,0.0041994606,0.0022943544,0.00069111364,0.00075902237,0.0001388561,0.007244425],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96975523,0.02278692,0.0008718295,0.0028449974,0.0033704035,0.00037056056],"domain_scores_gemma":[0.80709976,0.17527446,0.0061992463,0.0072094076,0.003642186,0.000574966],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03936895,0.0013338984,0.0021372896,0.003976228,0.0011590585,0.0041259862,0.003251887,0.0034097089,0.010303198],"category_scores_gemma":[0.19875744,0.0007651151,0.0018255493,0.0031349042,0.0063006226,0.0062778727,0.0024574273,0.004838781,0.0006735181],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005342648,0.000056929715,0.0018075386,0.0003383859,0.00024601413,0.000066295,0.00018573379,0.019363789,0.00012599357,0.9521105,0.002187856,0.02345745],"study_design_scores_gemma":[0.000033896285,0.000018286753,0.0005324115,0.00015341099,0.00008910531,0.00002277719,0.00006810825,0.022593748,0.00024118969,0.9730311,0.003204381,0.00001159559],"about_ca_topic_score_codex":0.011291842,"about_ca_topic_score_gemma":0.0055748504,"teacher_disagreement_score":0.9606311,"about_ca_system_score_codex":0.003408447,"about_ca_system_score_gemma":0.005793055,"threshold_uncertainty_score":0.20820534},"labels":[],"label_agreement":null},{"id":"W2519327609","doi":"10.3982/ecta16437","title":"Model Selection for Treatment Choice: Penalized Welfare Maximization","year":2021,"lang":"en","type":"preprint","venue":"Econometrica","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Shanxi Scholarship Council of China; Northwestern University","keywords":"Oracle; Regret; Maximization; Selection (genetic algorithm); Covariate; Mathematical optimization; Class (philosophy); Computer science; Mathematics; Econometrics; Machine learning; Artificial intelligence","score_opus":0.3036878530973369,"score_gpt":0.437126187165306,"score_spread":0.13343833406796907,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2519327609","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060173175,0.00039463307,0.99036205,0.0013654707,0.000050346574,0.00011156398,0.00007717338,0.00009543274,0.001526011],"genre_scores_gemma":[0.4818801,0.0013836261,0.50632,0.0019394212,0.0006159892,0.0013677588,0.0006733234,0.00024366398,0.005576216],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9757623,0.019163482,0.00043275795,0.001987206,0.0019762134,0.0006781379],"domain_scores_gemma":[0.9526709,0.04147644,0.0018150447,0.0023384562,0.0010692196,0.0006299658],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02316558,0.0015943949,0.0033209804,0.0013005282,0.0007506501,0.0029514565,0.003248235,0.0025915697,0.0031737597],"category_scores_gemma":[0.060122482,0.00090443686,0.0014350734,0.0015802092,0.0035373147,0.0033933064,0.0025878253,0.0059553073,0.000669584],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028004995,0.00031950575,0.0020401326,0.00028702285,0.0002990122,0.00014838148,0.00020049591,0.5471107,0.00059442973,0.38657162,0.0042098714,0.05793887],"study_design_scores_gemma":[0.00007275163,0.00009176702,0.0002154158,0.000048407976,0.000022264918,0.000038659957,0.000012816553,0.7712025,0.000376631,0.22669311,0.0012099455,0.000015629033],"about_ca_topic_score_codex":0.0018014858,"about_ca_topic_score_gemma":0.0012930256,"teacher_disagreement_score":0.02316558,"about_ca_system_score_codex":0.0027895204,"about_ca_system_score_gemma":0.0026378867,"threshold_uncertainty_score":0.12251276},"labels":[],"label_agreement":null},{"id":"W2521300970","doi":"10.1177/0962280216668554","title":"Comparison of statistical approaches dealing with time-dependent confounding in drug effectiveness studies","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; University of British Columbia; McGill University; Jewish General Hospital","funders":"IC Design Education Center; Canadian Institutes of Health Research; Biogen; EMD Serono; Pfizer","keywords":"Covariate; Confounding; Marginal structural model; Proportional hazards model; Econometrics; Statistics; Event (particle physics); Marginal model; Estimation; Computer science; Medicine; Regression analysis; Mathematics","score_opus":0.6270859484776903,"score_gpt":0.6922224989551746,"score_spread":0.06513655047748435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2521300970","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033492904,0.00783755,0.9523555,0.0023035058,0.0005546054,0.0014160656,0.00025513806,0.0003106607,0.0014741247],"genre_scores_gemma":[0.3017767,0.004813529,0.68644756,0.00093998824,0.0004465042,0.0043930165,0.00036693,0.0001869864,0.0006287813],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5427789,0.43029562,0.008078948,0.0054355636,0.012425522,0.0009854476],"domain_scores_gemma":[0.17579934,0.7935578,0.0090899095,0.014280328,0.0064828577,0.0007895986],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.34798846,0.0019191972,0.0035188426,0.005725866,0.0011788876,0.003123469,0.00509438,0.0037857362,0.0037357695],"category_scores_gemma":[0.5692863,0.0011420257,0.008435263,0.006801792,0.004840859,0.004981142,0.0049372846,0.0042754286,0.00033308213],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0069506783,0.00052146823,0.036109123,0.0064593363,0.034367304,0.00049211556,0.0039227335,0.14193593,0.0015254722,0.25496352,0.0032091064,0.50954324],"study_design_scores_gemma":[0.0030213222,0.006294737,0.03186902,0.0020996018,0.008511062,0.0008985689,0.0013822217,0.5026683,0.0024883691,0.42881048,0.011455292,0.00050103647],"about_ca_topic_score_codex":0.0026216628,"about_ca_topic_score_gemma":0.0021810045,"teacher_disagreement_score":0.6520115,"about_ca_system_score_codex":0.0032300595,"about_ca_system_score_gemma":0.00570972,"threshold_uncertainty_score":0.80404633},"labels":[],"label_agreement":null},{"id":"W2522161560","doi":"10.1186/s12874-016-0225-0","title":"The use of relative incidence ratios in self-controlled case series studies: an overview","year":2016,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Children's Hospital of Eastern Ontario; Ottawa Hospital; Manitoba Beekeepers' Association; University of Ottawa","funders":"Canadian Institutes of Health Research; Crohn's and Colitis Canada; Ontario Ministry of Health and Long-Term Care; Canadian Association of Gastroenterology; Institute for Clinical Evaluative Sciences","keywords":"Context (archaeology); Medicine; Subgroup analysis; Incidence (geometry); Covariate; Vaccination; Statistics; Mathematics; Meta-analysis; Internal medicine; Immunology","score_opus":0.920688573393072,"score_gpt":0.6823189290759659,"score_spread":0.23836964431710606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2522161560","genre_codex":"review","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023148833,0.8267936,0.15594499,0.0039150966,0.0020011305,0.0044530933,0.001281173,0.00029651306,0.0029995195],"genre_scores_gemma":[0.09131377,0.46645933,0.40159178,0.004625345,0.0049612676,0.028123716,0.0018204235,0.0005162556,0.0005881095],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.2874201,0.57429606,0.089313515,0.016541896,0.031503055,0.0009252911],"domain_scores_gemma":[0.10615728,0.8198795,0.04491143,0.01645489,0.012160982,0.000436017],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5303099,0.0037769815,0.015031132,0.04065981,0.0010065914,0.011281221,0.012310668,0.006352551,0.004223093],"category_scores_gemma":[0.7525079,0.0038025628,0.019624462,0.033760794,0.007850427,0.00901457,0.006471585,0.0074870484,0.0008978272],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013727923,0.0002730401,0.035026245,0.3157728,0.04369841,0.001133857,0.0047864392,0.006200593,0.00059386744,0.088637896,0.014841393,0.48766264],"study_design_scores_gemma":[0.0015702739,0.0030712588,0.03504197,0.46981147,0.042452626,0.011609135,0.0039843847,0.020396013,0.0031796275,0.1648823,0.2428394,0.0011615441],"about_ca_topic_score_codex":0.0032297738,"about_ca_topic_score_gemma":0.0018284129,"teacher_disagreement_score":0.46969008,"about_ca_system_score_codex":0.008180703,"about_ca_system_score_gemma":0.008344483,"threshold_uncertainty_score":0.57921153},"labels":[],"label_agreement":null},{"id":"W2525074234","doi":"10.1097/ede.0000000000000562","title":"Re","year":2016,"lang":"war","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Carleton University; McGill University; McGill University Health Centre; University of New Brunswick","funders":"","keywords":"Confounding; Causality (physics); Medicine; Demography; Regression analysis; Statistics; Environmental health; Psychology; Mathematics","score_opus":0.3826505297407446,"score_gpt":0.48573912331077257,"score_spread":0.10308859357002798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2525074234","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00036709453,0.008003395,0.0013599622,0.2582993,0.65922946,0.000080248516,0.0011556156,0.0011140032,0.07039099],"genre_scores_gemma":[0.0052971756,0.009504879,0.0013931803,0.33964708,0.30587956,0.000141663,0.0011379642,0.0007885903,0.3362099],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.998111,0.00038206513,0.00021557485,0.00038761736,0.000685089,0.0002185862],"domain_scores_gemma":[0.99464816,0.0013498712,0.00044586806,0.0005378662,0.0021931748,0.00082507194],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002009311,0.0009036849,0.00087369647,0.0011228829,0.0014383956,0.005483322,0.0026106543,0.008149551,0.30976096],"category_scores_gemma":[0.018737182,0.0004094962,0.00089319074,0.00068340177,0.0010878692,0.0033079986,0.0019135561,0.007504676,0.23142724],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023321598,0.000010523543,0.000058579462,0.00008709763,0.0000051475176,0.00013933567,0.000019785288,0.000015191421,0.000051783678,0.0009556448,0.9797911,0.018842423],"study_design_scores_gemma":[0.0000063425914,0.000005772854,0.00006350869,0.00009306799,0.0000030729882,0.00018430925,0.00002648224,0.000019478011,0.000038711914,0.0004135296,0.9991417,0.000004113505],"about_ca_topic_score_codex":0.0015869681,"about_ca_topic_score_gemma":0.0021410792,"teacher_disagreement_score":0.6902391,"about_ca_system_score_codex":0.0014951932,"about_ca_system_score_gemma":0.0020852457,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W2528615349","doi":"10.1093/ije/dyw195","title":"Strategies for evaluating the assumptions of the regression discontinuity design: a case study using a human papillomavirus vaccination programme","year":2016,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; McGill University; Queen's University","funders":"Canadian Institutes of Health Research; Canada Research Chairs; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Regression discontinuity design; Psychological intervention; Causal inference; Context (archaeology); Confounding; Popularity; Computer science; Instrumental variable; Variable (mathematics); Econometrics; Intervention (counseling); Inference; Clinical study design; Medicine; Actuarial science; Risk analysis (engineering); Psychology; Statistics; Social psychology; Economics; Machine learning; Mathematics; Clinical trial; Artificial intelligence","score_opus":0.7044133549907624,"score_gpt":0.6179033162114459,"score_spread":0.08651003877931651,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2528615349","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037766904,0.0017954955,0.9403698,0.0029389185,0.0002751833,0.011971535,0.00037425786,0.00014969593,0.004358255],"genre_scores_gemma":[0.19628115,0.0008746275,0.77869856,0.0006514542,0.00008241135,0.022371894,0.00014737116,0.00003458229,0.000857889],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.4637302,0.51124465,0.008868738,0.00512247,0.008780718,0.0022532076],"domain_scores_gemma":[0.15458085,0.8182833,0.012381239,0.007631458,0.006282557,0.00084060885],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.42554075,0.0024633422,0.0044966354,0.006564169,0.002850632,0.005072499,0.007832253,0.009983419,0.009100895],"category_scores_gemma":[0.61737156,0.0019343613,0.0065750885,0.004683167,0.0052794227,0.005164433,0.006846812,0.0074394387,0.00047705535],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005337106,0.0026902985,0.04347776,0.008402246,0.0050268397,0.0055586244,0.016537992,0.14323336,0.0012653712,0.5371915,0.0055439943,0.22573486],"study_design_scores_gemma":[0.0037496095,0.007599747,0.008789111,0.005707162,0.003020955,0.0014230942,0.008192548,0.61867416,0.0026590766,0.32378393,0.015861882,0.00053879357],"about_ca_topic_score_codex":0.007624099,"about_ca_topic_score_gemma":0.005878368,"teacher_disagreement_score":0.57445925,"about_ca_system_score_codex":0.0077276765,"about_ca_system_score_gemma":0.008356924,"threshold_uncertainty_score":0.70841056},"labels":[],"label_agreement":null},{"id":"W2531513535","doi":"10.3945/ajcn.115.123315","title":"Best (but oft-forgotten) practices: intention-to-treat, treatment adherence, and missing participant outcome data in the nutrition literature","year":2016,"lang":"en","type":"article","venue":"American Journal of Clinical Nutrition","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":37,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"","keywords":"Missing data; Randomization; Medicine; Randomized controlled trial; Outcome (game theory); Clinical trial; Intervention (counseling); Intention-to-treat analysis; Family medicine; Surgery; Internal medicine; Nursing; Statistics","score_opus":0.5813004497897212,"score_gpt":0.5783115260801194,"score_spread":0.0029889237096017984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2531513535","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1618544,0.104550466,0.57917976,0.14034149,0.0042387694,0.00071481813,0.0015387225,0.00048457552,0.007097036],"genre_scores_gemma":[0.8195084,0.008192593,0.16015849,0.007782128,0.0020968188,0.0012264292,0.00035839804,0.00011889379,0.00055791903],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.640755,0.31231192,0.017306596,0.014238333,0.0137852365,0.0016029661],"domain_scores_gemma":[0.12906598,0.8183628,0.021145035,0.024710856,0.0056480137,0.0010673628],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3172034,0.0011759077,0.0046162917,0.0040792325,0.002692226,0.0062665697,0.006553484,0.0070962203,0.0033195997],"category_scores_gemma":[0.6711769,0.0019000401,0.0055770134,0.0057389685,0.009540912,0.014918978,0.004234476,0.015796019,0.00032436874],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0057760277,0.0013154204,0.08249399,0.0117224,0.02106904,0.000836282,0.010490421,0.00835761,0.00028413185,0.25287113,0.011768277,0.5930154],"study_design_scores_gemma":[0.00074036524,0.0008498637,0.01457567,0.007318591,0.00810231,0.0005152853,0.0016503303,0.044526894,0.0007228417,0.9164207,0.004395874,0.00018127433],"about_ca_topic_score_codex":0.0057365964,"about_ca_topic_score_gemma":0.0064717014,"teacher_disagreement_score":0.6827966,"about_ca_system_score_codex":0.0031695506,"about_ca_system_score_gemma":0.006025486,"threshold_uncertainty_score":0.8420098},"labels":[],"label_agreement":null},{"id":"W2536203341","doi":"10.1016/j.jalz.2016.06.1674","title":"P3‐017: The Impact of Central Rating Review Programs on ADAS‐COG Error Variance","year":2016,"lang":"en","type":"article","venue":"Alzheimer s & Dementia","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"inVentiv Health Clinical","funders":"","keywords":"Medicine; Cog; Clinical trial; Standard error; Sample size determination; Cohort; Statistics; Computer science; Internal medicine; Mathematics; Artificial intelligence","score_opus":0.17279656204449148,"score_gpt":0.424872197208631,"score_spread":0.25207563516413956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2536203341","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.56575227,0.034338724,0.2107601,0.03859821,0.0072963396,0.034671646,0.024276616,0.0064919414,0.07781417],"genre_scores_gemma":[0.88034254,0.0025136604,0.08419763,0.0055226265,0.0013248977,0.014434171,0.0037107493,0.0014550821,0.006498615],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.461782,0.39215297,0.042379253,0.017637383,0.08363342,0.0024149504],"domain_scores_gemma":[0.121824,0.6970286,0.06310427,0.039300974,0.07543057,0.0033115435],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.3518288,0.0010701208,0.0019346523,0.0023894168,0.002051544,0.0051874486,0.0037558759,0.0021975772,0.009492642],"category_scores_gemma":[0.6851357,0.0011186454,0.0035977557,0.0046641505,0.0022588228,0.004248547,0.005067179,0.0025587159,0.003003386],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.02747754,0.002041546,0.18289098,0.010139499,0.009694417,0.00041673676,0.0042519374,0.0049884897,0.004362525,0.0054632127,0.11301164,0.6352615],"study_design_scores_gemma":[0.008462338,0.015585497,0.73278964,0.0071100905,0.0109656155,0.0026131605,0.0020939603,0.062001392,0.019367084,0.0121849505,0.12611134,0.0007148829],"about_ca_topic_score_codex":0.0055942577,"about_ca_topic_score_gemma":0.0076834685,"teacher_disagreement_score":0.3518288,"about_ca_system_score_codex":0.0043753805,"about_ca_system_score_gemma":0.012010478,"threshold_uncertainty_score":0.79931045},"labels":[],"label_agreement":null},{"id":"W2541915084","doi":"10.1007/978-3-319-41259-7_6","title":"Propensity Score Modeling and Evaluation","year":2016,"lang":"en","type":"book-chapter","venue":"ICSA book series in statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Propensity score matching; Causal inference; Covariate; Categorical variable; Observational study; Inference; Statistics; Nonparametric statistics; Econometrics; Average treatment effect; Parametric statistics; Mathematics; Computer science; Artificial intelligence","score_opus":0.307241050441393,"score_gpt":0.4090020091499489,"score_spread":0.1017609587085559,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2541915084","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037470148,0.004560512,0.96019137,0.003309521,0.00046589362,0.00018300465,0.0010784693,0.0014444679,0.025019703],"genre_scores_gemma":[0.26102415,0.008660359,0.66448987,0.0017224223,0.0012510059,0.0013095972,0.0051214937,0.0018480718,0.054573044],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98617524,0.00973571,0.00039307566,0.00073233206,0.0027125997,0.00025092863],"domain_scores_gemma":[0.97793317,0.014669542,0.00073534844,0.0038086907,0.0024390456,0.0004141597],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019955289,0.0010095802,0.0020978744,0.0020613903,0.0006983911,0.00417565,0.0016841777,0.0018826778,0.021958036],"category_scores_gemma":[0.08001209,0.0005571653,0.0011649333,0.003205366,0.001548733,0.0032649112,0.0024275226,0.0023395347,0.007010218],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017715721,0.00013699429,0.0034098856,0.0002283406,0.0002440411,0.00003861368,0.0000929462,0.033997755,0.00018743696,0.35658494,0.09124228,0.51365966],"study_design_scores_gemma":[0.000060130667,0.00008726137,0.0016603472,0.00017761468,0.000090412075,0.00009981693,0.000057981164,0.20421,0.0006695444,0.7568874,0.03596417,0.00003540905],"about_ca_topic_score_codex":0.0026679286,"about_ca_topic_score_gemma":0.0024269728,"teacher_disagreement_score":0.021958036,"about_ca_system_score_codex":0.0014641276,"about_ca_system_score_gemma":0.0031114419,"threshold_uncertainty_score":0.10553491},"labels":[],"label_agreement":null},{"id":"W2545262557","doi":"10.1002/sim.7153","title":"Goodness‐of‐fit test for monotone proportional subdistribution hazards assumptions based on weighted residuals","year":2016,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Institute of Cancer Research; Institut National Du Cancer","keywords":"Goodness of fit; Mathematics; Monotone polygon; Statistics; Regression analysis; Monte Carlo method; Regression; Proportional hazards model; Applied mathematics","score_opus":0.11451533146660954,"score_gpt":0.4452264803293031,"score_spread":0.3307111488626936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2545262557","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18277983,0.0005953649,0.8121374,0.0005545316,0.00011325889,0.0003084909,0.0005594098,0.00059570087,0.0023559604],"genre_scores_gemma":[0.90882444,0.00017213509,0.08825973,0.0002507268,0.0000681432,0.00054530083,0.00090219814,0.00017779428,0.0007995515],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96654886,0.024328828,0.0016500893,0.0033931558,0.0032587205,0.0008203543],"domain_scores_gemma":[0.6948715,0.27518415,0.009740038,0.012601253,0.0062041925,0.0013989552],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048477117,0.0013038849,0.0026765983,0.004267959,0.001001037,0.0017481644,0.0034207138,0.002430604,0.005930333],"category_scores_gemma":[0.25502002,0.00061632216,0.00356921,0.003149389,0.0058062053,0.004296939,0.0028220022,0.003312999,0.0008051497],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004513015,0.00062911597,0.21990456,0.0012622786,0.0047791908,0.001920092,0.0019109289,0.24043263,0.005027214,0.27688566,0.004238138,0.23849724],"study_design_scores_gemma":[0.00063969364,0.0028115262,0.055470027,0.00019471392,0.00076374796,0.0014441297,0.00076019665,0.68207645,0.0051496257,0.24547048,0.00496633,0.00025302087],"about_ca_topic_score_codex":0.0015687055,"about_ca_topic_score_gemma":0.0008259947,"teacher_disagreement_score":0.048477117,"about_ca_system_score_codex":0.0010644352,"about_ca_system_score_gemma":0.0021272686,"threshold_uncertainty_score":0.25637454},"labels":[],"label_agreement":null},{"id":"W2547225625","doi":"10.1097/ede.0000000000000586","title":"An R Package for G-estimation of Structural Nested Mean Models","year":2016,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Heart, Lung, and Blood Institute","keywords":"Confounding; Nested case-control study; Statistics; Estimation; Structural equation modeling; Nested set model; R package; Econometrics; Computer science; Generalized estimating equation; Random effects model; Mathematics; Medicine; Confidence interval; Data mining; Meta-analysis; Internal medicine; Engineering","score_opus":0.34084432123626573,"score_gpt":0.4867982272452088,"score_spread":0.1459539060089431,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2547225625","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015553655,0.0014712014,0.823775,0.004570929,0.0037148043,0.0006705164,0.06945471,0.08925212,0.005535383],"genre_scores_gemma":[0.018434763,0.0014111529,0.8273687,0.0038120905,0.0013019313,0.003910565,0.041912526,0.08934854,0.012499733],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9887782,0.0064292587,0.0010109753,0.0018385043,0.0015886925,0.00035446123],"domain_scores_gemma":[0.9135822,0.06838612,0.0034675729,0.008100291,0.0055555743,0.00090816594],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016789433,0.0044797957,0.00335473,0.00341744,0.0008628454,0.0035351068,0.006480381,0.0032841798,0.20463718],"category_scores_gemma":[0.1373456,0.0027338397,0.0044876835,0.0042787977,0.0015285733,0.0033464564,0.004203082,0.006852995,0.08969422],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022052095,0.000066811626,0.0023333721,0.0029203822,0.000934757,0.00050688896,0.00024641133,0.0133553315,0.0007652868,0.023788197,0.8597089,0.09515317],"study_design_scores_gemma":[0.0004832874,0.00011164256,0.0022329546,0.0012593841,0.00047902,0.00073630497,0.000108570195,0.07747482,0.0019479864,0.1612737,0.7536378,0.000254566],"about_ca_topic_score_codex":0.0047024945,"about_ca_topic_score_gemma":0.0068445588,"teacher_disagreement_score":0.20463718,"about_ca_system_score_codex":0.001132591,"about_ca_system_score_gemma":0.005997205,"threshold_uncertainty_score":0.6845796},"labels":[],"label_agreement":null},{"id":"W2550362301","doi":"10.1093/ije/dyw278","title":"The epidemiology of two things considered together. Commentary on:<i>Explanation in Causal Inference: Developments in Mediation and Interaction</i>, by Tyler J. VanderWeele","year":2016,"lang":"en","type":"letter","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Mediation; Inference; Epidemiology; Causal model; Psychology; Medicine; Epistemology; Sociology; Philosophy; Internal medicine; Social science; Pathology","score_opus":0.1624964604773908,"score_gpt":0.47211000467438774,"score_spread":0.30961354419699694,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2550362301","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000023323988,0.0017552633,0.000061117855,0.9851697,0.012698459,0.0000030102315,0.000047070655,0.000007982411,0.00023407159],"genre_scores_gemma":[0.00053410453,0.00093391567,0.00012849034,0.96555394,0.031744465,0.000025494459,0.000019694808,0.000014404549,0.0010455339],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9850455,0.0066661197,0.0017491695,0.002125535,0.0036313487,0.0007823672],"domain_scores_gemma":[0.93030804,0.05668492,0.0028331121,0.0015477504,0.0059040203,0.0027221127],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019757932,0.0019681707,0.0037617518,0.0015531087,0.0057508056,0.0062013627,0.0070126583,0.079573125,0.007733877],"category_scores_gemma":[0.12098268,0.0018481436,0.0034386923,0.0020790207,0.011121667,0.013876836,0.004114182,0.10216125,0.008507111],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000324517,0.0000051757393,0.00006606913,0.000059997983,0.000010167244,0.00013819679,0.000092584625,0.000021541797,0.000024917508,0.0027232333,0.9945793,0.0022463677],"study_design_scores_gemma":[0.00025184095,0.00005202874,0.0008344386,0.0012805583,0.00006914204,0.0011357979,0.00056424737,0.000500236,0.00022220754,0.04621496,0.9487496,0.00012485165],"about_ca_topic_score_codex":0.019856274,"about_ca_topic_score_gemma":0.027381444,"teacher_disagreement_score":0.079573125,"about_ca_system_score_codex":0.007687226,"about_ca_system_score_gemma":0.010614226,"threshold_uncertainty_score":0.104491174},"labels":[],"label_agreement":null},{"id":"W2552901719","doi":"10.1016/j.je.2016.09.003","title":"A typology of four notions of confounding in epidemiology","year":2016,"lang":"en","type":"review","venue":"Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Japan Society for the Promotion of Science; University of California, San Francisco; McGill University","keywords":"Medicine; Typology; Confounding; Epidemiology; Internal medicine; Anthropology","score_opus":0.7065898224638333,"score_gpt":0.611025391161835,"score_spread":0.09556443130199832,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2552901719","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020843062,0.7253836,0.20693162,0.025796521,0.003644352,0.00028641796,0.00027391198,0.00016213895,0.035437126],"genre_scores_gemma":[0.08302785,0.7392338,0.14293227,0.018470464,0.0065677045,0.0019724518,0.00034780268,0.0001395725,0.0073081087],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9788946,0.01231902,0.0020271472,0.0019731212,0.0042520566,0.00053397904],"domain_scores_gemma":[0.97199136,0.02233765,0.0017399366,0.0017500774,0.0018391762,0.00034180432],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.022380268,0.0018543431,0.0019219576,0.009390576,0.0018937627,0.0069880476,0.003580765,0.00509688,0.003477322],"category_scores_gemma":[0.026408968,0.0008957044,0.0024825754,0.011801759,0.022501426,0.009478686,0.0059924424,0.009350527,0.0011058089],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000037564,0.000017870972,0.0005198097,0.0033637977,0.0001175323,0.00016756692,0.0016310853,0.00041735533,0.00019514628,0.8873498,0.006227529,0.09995495],"study_design_scores_gemma":[0.000022033362,0.00004580674,0.0009297378,0.0045063966,0.00008589075,0.001306648,0.00073883374,0.00042895688,0.00031371517,0.7354731,0.25608152,0.00006750965],"about_ca_topic_score_codex":0.002034937,"about_ca_topic_score_gemma":0.0013879548,"teacher_disagreement_score":0.9776197,"about_ca_system_score_codex":0.004668367,"about_ca_system_score_gemma":0.004627385,"threshold_uncertainty_score":0.118359566},"labels":[],"label_agreement":null},{"id":"W2557277836","doi":"10.1515/ijb-2015-0034","title":"Effect Estimation in Point-Exposure Studies with Binary Outcomes and High-Dimensional Covariate Data – A Comparison of Targeted Maximum Likelihood Estimation and Inverse Probability of Treatment Weighting","year":2016,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Inverse probability weighting; Estimator; Statistics; Marginal structural model; Average treatment effect; Inverse probability; Econometrics; Weighting; Computer science; Causal inference; Mathematics; Medicine; Bayesian probability","score_opus":0.10122401502630411,"score_gpt":0.4121929389408524,"score_spread":0.3109689239145483,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2557277836","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02052338,0.0032405616,0.973754,0.00080152793,0.00007033364,0.00047184216,0.00014014808,0.00016069083,0.0008375543],"genre_scores_gemma":[0.3818469,0.003076372,0.610705,0.0009624414,0.00016925097,0.0017026929,0.00048075418,0.00015737125,0.00089919165],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89255637,0.098539636,0.001998221,0.0036760024,0.002758973,0.00047077195],"domain_scores_gemma":[0.70374995,0.27436745,0.00802066,0.010156425,0.003033249,0.0006723068],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11464012,0.0015507982,0.00380804,0.0026609378,0.00048818302,0.0028659117,0.0032863207,0.0033717044,0.0027314045],"category_scores_gemma":[0.26346406,0.0012356491,0.004460532,0.0021335832,0.0025227568,0.0051196376,0.0042121643,0.00368902,0.0003811353],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031892338,0.00057119806,0.02775409,0.00604267,0.009817992,0.0006123877,0.002134223,0.3428716,0.00294058,0.17771581,0.0021936116,0.42415652],"study_design_scores_gemma":[0.0012296396,0.0016294996,0.008652855,0.0011716055,0.0017439176,0.0005794028,0.00030502622,0.71549195,0.0027246128,0.2585103,0.0077699726,0.0001913138],"about_ca_topic_score_codex":0.0017312288,"about_ca_topic_score_gemma":0.0012502755,"teacher_disagreement_score":0.11464012,"about_ca_system_score_codex":0.0011331965,"about_ca_system_score_gemma":0.0021452357,"threshold_uncertainty_score":0.6062821},"labels":[],"label_agreement":null},{"id":"W2559863382","doi":"10.1177/0962280216680834","title":"A graphical perspective of marginal structural models: An application for the estimation of the effect of physical activity on blood pressure","year":2016,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University; Hôpital du Sacré-Cœur de Montréal; McGill University Health Centre; Université Laval; The Quebec Population Health Research Network; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Marginal structural model; Counterfactual thinking; Causal inference; Causal model; Computer science; Marginal model; Graphical model; Econometrics; Causal structure; Graph; Inference; Context (archaeology); Data mining; Mathematics; Machine learning; Statistics; Artificial intelligence; Regression analysis; Theoretical computer science; Psychology","score_opus":0.20943349816461482,"score_gpt":0.6226692917242447,"score_spread":0.41323579355962986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2559863382","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00074098125,0.00031635544,0.99748945,0.0004724492,0.000030080559,0.000016354375,0.00008195581,0.000083548504,0.00076882547],"genre_scores_gemma":[0.12618043,0.0030894615,0.8662198,0.00062392594,0.00052446686,0.00045204954,0.00039331344,0.00025416331,0.0022623893],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9903861,0.007975346,0.00020247311,0.00065422134,0.0006426088,0.00013927348],"domain_scores_gemma":[0.92725796,0.066106886,0.0022957874,0.0026201978,0.001360874,0.00035838832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016001014,0.0017957926,0.001454022,0.0044866763,0.0008787827,0.0018393602,0.0028143239,0.0019436687,0.008975855],"category_scores_gemma":[0.072924644,0.001081758,0.0037469831,0.004885269,0.0039317957,0.003688701,0.0024747846,0.004428956,0.00092124793],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021996684,0.00003656287,0.0017556816,0.0001301006,0.00016791723,0.00013765259,0.00029130356,0.05850883,0.00019015506,0.90475786,0.0013634524,0.032638542],"study_design_scores_gemma":[0.000015499736,0.000030563653,0.00043915963,0.0000619727,0.000059630915,0.00009043033,0.00005244064,0.14364831,0.00010636657,0.85027486,0.005198131,0.000022560353],"about_ca_topic_score_codex":0.008698362,"about_ca_topic_score_gemma":0.006874278,"teacher_disagreement_score":0.016001014,"about_ca_system_score_codex":0.0019064577,"about_ca_system_score_gemma":0.0024466699,"threshold_uncertainty_score":0.08462244},"labels":[],"label_agreement":null},{"id":"W2560696316","doi":"10.1016/j.jclinepi.2016.12.001","title":"Criteria for use of composite end points for competing risks—a systematic survey of the literature with recommendations","year":2016,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; McMaster University Medical Centre","funders":"","keywords":"CINAHL; MEDLINE; Systematic review; Medicine; Event (particle physics); Point (geometry); Computer science; Psychological intervention; Mathematics; Nursing","score_opus":0.8235246654930325,"score_gpt":0.6620055426811549,"score_spread":0.16151912281187764,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2560696316","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019801834,0.96258736,0.019795472,0.006653593,0.0015708627,0.0027631316,0.0029126264,0.00015609736,0.0015806976],"genre_scores_gemma":[0.13901442,0.6005209,0.20727554,0.017425269,0.0027636762,0.023103066,0.00838557,0.00040350656,0.0011080491],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.7047611,0.12917428,0.11630161,0.009885121,0.038487837,0.0013900567],"domain_scores_gemma":[0.51694137,0.40649754,0.042304475,0.008086064,0.024507068,0.0016635158],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.207672,0.0030713445,0.016933946,0.015854547,0.0019099003,0.00928911,0.011803412,0.006594999,0.008163396],"category_scores_gemma":[0.45027003,0.0025186732,0.02740746,0.01301951,0.0043600653,0.006677962,0.005807918,0.008556806,0.0011436881],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028545607,0.00012463523,0.014969945,0.59371674,0.05460326,0.00023612272,0.0012915066,0.0012704444,0.000330938,0.011656054,0.021791026,0.29715478],"study_design_scores_gemma":[0.0058974675,0.00077420153,0.021415766,0.704509,0.14145009,0.0011319476,0.0014707773,0.006203067,0.0010300423,0.04472508,0.07066652,0.0007260432],"about_ca_topic_score_codex":0.009175182,"about_ca_topic_score_gemma":0.0147081595,"teacher_disagreement_score":0.792328,"about_ca_system_score_codex":0.006221292,"about_ca_system_score_gemma":0.014590961,"threshold_uncertainty_score":0.9770815},"labels":[],"label_agreement":null},{"id":"W2560833249","doi":"10.1056/nejmra1510065","title":"Interpreting Geographic Variations in Results of Randomized, Controlled Trials","year":2016,"lang":"en","type":"article","venue":"New England Journal of Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":97,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; McMaster University; Population Health Research Institute","funders":"","keywords":"Medicine; Randomized controlled trial; MEDLINE; Surgery","score_opus":0.08639357282908044,"score_gpt":0.4075397463559389,"score_spread":0.3211461735268585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2560833249","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28742623,0.08963603,0.5454432,0.037087914,0.0055540325,0.0055276197,0.0069260146,0.0018819149,0.020517139],"genre_scores_gemma":[0.92317706,0.0025677194,0.06470836,0.004082564,0.0011545836,0.002557942,0.0009349672,0.00017062917,0.00064626127],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.35400042,0.5457403,0.040198036,0.036985748,0.02075581,0.002319722],"domain_scores_gemma":[0.1308514,0.7529595,0.064112745,0.043434273,0.0079808645,0.00066116883],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.44412103,0.0012251997,0.0038491732,0.004927577,0.001420424,0.0050913673,0.004682098,0.0035256024,0.0025647408],"category_scores_gemma":[0.77784055,0.0013601681,0.0043202452,0.008121884,0.0071949973,0.0040016253,0.005246501,0.003915002,0.00038131335],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012143768,0.0003048769,0.4330356,0.014231746,0.08305238,0.0027106658,0.008701937,0.055670172,0.0012709126,0.13180098,0.015976336,0.24110061],"study_design_scores_gemma":[0.006824629,0.003036643,0.3274466,0.0044138622,0.04586872,0.0021879794,0.00416415,0.07446584,0.0047726263,0.48419976,0.042199574,0.0004195731],"about_ca_topic_score_codex":0.007955004,"about_ca_topic_score_gemma":0.0053271875,"teacher_disagreement_score":0.555879,"about_ca_system_score_codex":0.004095053,"about_ca_system_score_gemma":0.003468704,"threshold_uncertainty_score":0.68549776},"labels":[],"label_agreement":null},{"id":"W2588316907","doi":"10.1093/aje/163.suppl_11.s222-c","title":"Bayesian Propensity Score Analysis for Observational Data","year":2006,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Propensity score matching; Observational study; Confidence interval; Confounding; Statistics; Medicine; Bayesian probability; Markov chain Monte Carlo; Credible interval; Odds ratio; Outcome (game theory); Econometrics; Mathematics","score_opus":0.5585941002671695,"score_gpt":0.4887832849630621,"score_spread":0.06981081530410738,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2588316907","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012058159,0.0015236716,0.9954015,0.000988985,0.00007862154,0.00005860676,0.000091194226,0.00018208787,0.00046951298],"genre_scores_gemma":[0.15301381,0.0060561746,0.8317234,0.0008482913,0.00072846847,0.0012860139,0.0010247919,0.00031149894,0.005007636],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9797742,0.01633456,0.0005659284,0.0009091417,0.0021244946,0.00029176482],"domain_scores_gemma":[0.9472319,0.04337688,0.0026503508,0.0037412848,0.0024944085,0.00050519],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028616872,0.0011150361,0.002835408,0.0038003146,0.0008151543,0.0026979079,0.0026201047,0.0024422517,0.0047819847],"category_scores_gemma":[0.1379598,0.0013805421,0.0019141866,0.0043824012,0.0019614692,0.003108265,0.0027027668,0.00460352,0.0010438423],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025012155,0.0001295094,0.005707289,0.0005216713,0.0009661414,0.00019213127,0.00027466443,0.0638102,0.00039431461,0.6431359,0.028084254,0.2565338],"study_design_scores_gemma":[0.00017657342,0.000041301337,0.0013922555,0.00009685229,0.00017161724,0.00015319999,0.000023284549,0.24338391,0.00016474187,0.7469321,0.0074265143,0.000037573463],"about_ca_topic_score_codex":0.0047137607,"about_ca_topic_score_gemma":0.0045142607,"teacher_disagreement_score":0.028616872,"about_ca_system_score_codex":0.0015687923,"about_ca_system_score_gemma":0.0041750455,"threshold_uncertainty_score":0.15134233},"labels":[],"label_agreement":null},{"id":"W2588941913","doi":"10.1097/ede.0000000000000445","title":"The Authors Respond","year":2016,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Jewish General Hospital","funders":"National Institute of Environmental Health Sciences","keywords":"Homogeneity (statistics); Odds ratio; Statistics; Statistic; Mathematics; Econometrics; Sample size determination; Statistical hypothesis testing; Type I and type II errors; Medicine; Psychology","score_opus":0.4243224623500017,"score_gpt":0.5097027519094776,"score_spread":0.08538028955947585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2588941913","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00046964665,0.003555511,0.0013382254,0.59865,0.33438691,0.00031755737,0.0025068983,0.0011645419,0.057610787],"genre_scores_gemma":[0.0049251462,0.003860919,0.0017243327,0.7030975,0.06398034,0.00077845267,0.0023838514,0.0007290482,0.21852042],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9962714,0.00097157765,0.00047311754,0.000622916,0.0011887228,0.00047220904],"domain_scores_gemma":[0.98002476,0.0038198992,0.0009970538,0.0011219467,0.011603657,0.0024327228],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0040851003,0.000800347,0.0010153775,0.0009843722,0.001971055,0.0036124003,0.0025925867,0.009621032,0.34360018],"category_scores_gemma":[0.06576388,0.00048978126,0.0012105999,0.00063561276,0.0009247723,0.0031971799,0.0035923054,0.009934702,0.27100432],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014732124,0.000003894841,0.00007848622,0.000050988834,0.0000018537537,0.00003790285,0.000022279239,0.000008038359,0.00002249099,0.00044772247,0.9899851,0.0093265595],"study_design_scores_gemma":[0.000010951571,0.000008924358,0.00016466688,0.00014217135,0.0000037773336,0.00016233814,0.000097308126,0.000025284777,0.00004999372,0.0006567858,0.9986687,0.000009208833],"about_ca_topic_score_codex":0.0018661692,"about_ca_topic_score_gemma":0.0019276821,"teacher_disagreement_score":0.34360018,"about_ca_system_score_codex":0.0017975406,"about_ca_system_score_gemma":0.004303066,"threshold_uncertainty_score":0.93627465},"labels":[],"label_agreement":null},{"id":"W2591072037","doi":"10.1186/s12874-017-0304-x","title":"Estimation of treatment preference effects in clinical trials when some participants are indifferent to treatment choice","year":2017,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Preference; Test (biology); Clinical trial; Medicine; Randomized controlled trial; Treatment effect; Psychological intervention; Treatment and control groups; Research design; Psychology; Statistics; Surgery; Psychiatry; Mathematics","score_opus":0.9639534187192589,"score_gpt":0.7552924577096153,"score_spread":0.2086609610096436,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2591072037","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05403775,0.005193455,0.92307365,0.0017137119,0.000334305,0.010221353,0.00047815972,0.00024735727,0.004700266],"genre_scores_gemma":[0.52383834,0.0015067655,0.4525721,0.0017670026,0.00020143818,0.018327517,0.0005361086,0.00007363052,0.0011770304],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.24606189,0.7006791,0.019316077,0.011886554,0.020276757,0.0017796765],"domain_scores_gemma":[0.124353945,0.8268928,0.026330873,0.018268382,0.0034958306,0.000658188],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.54880565,0.003354459,0.0072117746,0.0054630223,0.0010501347,0.0055399598,0.0044979486,0.008131398,0.005471555],"category_scores_gemma":[0.76557714,0.0024306388,0.011576164,0.0040691597,0.013859223,0.007996251,0.005689874,0.007864948,0.00064114813],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.028047511,0.0013421018,0.0505606,0.017141309,0.01802573,0.0021885235,0.004682124,0.13423602,0.0029812553,0.40981638,0.003501407,0.3274771],"study_design_scores_gemma":[0.0065783532,0.012169693,0.025097234,0.00580122,0.006800938,0.002317834,0.00074266474,0.28799593,0.007158091,0.63377273,0.010880654,0.00068464834],"about_ca_topic_score_codex":0.0008084629,"about_ca_topic_score_gemma":0.0005634014,"teacher_disagreement_score":0.45119435,"about_ca_system_score_codex":0.0047067977,"about_ca_system_score_gemma":0.0041010315,"threshold_uncertainty_score":0.55640304},"labels":[],"label_agreement":null},{"id":"W2594198997","doi":"10.1002/cjs.11311","title":"Nested case‐control study designs for left‐truncated survival data","year":2017,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"McGill University","funders":"National Cancer Institute; National Institutes of Health; National Science Council","keywords":"Covariate; Nested case-control study; Context (archaeology); Cohort; Cohort study; Medicine; Proportional hazards model; Hazard ratio; Statistics; Demography; Survival analysis; Cumulative incidence; Confidence interval; Surgery; Internal medicine; Mathematics; Geography","score_opus":0.49695850643656436,"score_gpt":0.4503157207576387,"score_spread":0.04664278567892566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2594198997","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01868925,0.0013188681,0.97268176,0.00047375317,0.00040875885,0.004198948,0.00088355504,0.0002557679,0.0010893136],"genre_scores_gemma":[0.18169664,0.0019057023,0.7939643,0.0007308202,0.0002552554,0.017117169,0.0013591886,0.00008295113,0.0028880113],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9368149,0.04991936,0.0029411057,0.0058142035,0.003928463,0.00058195426],"domain_scores_gemma":[0.90430546,0.06549334,0.009485651,0.016689194,0.003287812,0.00073845155],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08620336,0.0014827506,0.002315333,0.0013858811,0.0011586326,0.0017678905,0.0049812347,0.002805432,0.006088114],"category_scores_gemma":[0.1786231,0.0014309591,0.0028228543,0.0015154768,0.0020703066,0.001827334,0.0025235873,0.0028752757,0.0008456954],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006091384,0.0015212103,0.08795981,0.0050889743,0.0062612584,0.0028101571,0.006740053,0.04063067,0.008553254,0.60057896,0.01028001,0.22348432],"study_design_scores_gemma":[0.004794714,0.008722618,0.034609042,0.001777377,0.0053408463,0.0034614413,0.0009875635,0.27230576,0.005599613,0.6075961,0.05442905,0.00037596707],"about_ca_topic_score_codex":0.0031780954,"about_ca_topic_score_gemma":0.0050869924,"teacher_disagreement_score":0.91379666,"about_ca_system_score_codex":0.001301486,"about_ca_system_score_gemma":0.0027243039,"threshold_uncertainty_score":0.45589238},"labels":[],"label_agreement":null},{"id":"W2599145178","doi":"10.2139/ssrn.2861669","title":"Testing the IV Zero-Covariance Assumption and Identification with an Invalid Instrument","year":2016,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Covariance; Zero (linguistics); Identification (biology); Mathematics; Econometrics; Statistics; Applied mathematics; Philosophy","score_opus":0.13935600021998235,"score_gpt":0.35867747474161726,"score_spread":0.21932147452163492,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2599145178","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20433916,0.0005407785,0.77402884,0.0056550573,0.000699338,0.00034129442,0.00091996975,0.0004000817,0.013075463],"genre_scores_gemma":[0.928092,0.00024807174,0.06658272,0.0009880075,0.0002927734,0.0003812121,0.0007019508,0.00010330395,0.0026099347],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9354675,0.04361114,0.0038073778,0.00849547,0.006261222,0.0023573355],"domain_scores_gemma":[0.47153676,0.46467936,0.022012094,0.034600172,0.0059455754,0.0012260533],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06397922,0.0013459855,0.0029556241,0.0017776324,0.0019498662,0.0039904243,0.0039465013,0.0041336794,0.0125886],"category_scores_gemma":[0.36515385,0.0010068072,0.0026389959,0.002705676,0.0045344653,0.005361417,0.004522735,0.0052487664,0.0010873005],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012648642,0.0009401824,0.1273574,0.001063283,0.0031288052,0.0017272453,0.0027199062,0.0371488,0.0013664084,0.705141,0.008458218,0.10968381],"study_design_scores_gemma":[0.00075309747,0.0006883133,0.01648816,0.00029359251,0.0010415129,0.0005954398,0.0018308483,0.16818741,0.0030950299,0.800009,0.00692633,0.000091239104],"about_ca_topic_score_codex":0.0029382382,"about_ca_topic_score_gemma":0.001838794,"teacher_disagreement_score":0.06397922,"about_ca_system_score_codex":0.0011515372,"about_ca_system_score_gemma":0.005105258,"threshold_uncertainty_score":0.33835852},"labels":[],"label_agreement":null},{"id":"W2599388927","doi":"10.1007/978-3-662-53994-1_11","title":"Statistical Analysis in the Identification of Pain Biomarkers","year":2017,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"","keywords":"Identification (biology); Context (archaeology); Data science; Construct (python library); Intervention (counseling); Computer science; Medicine; Psychiatry; Geography","score_opus":0.14548699693747963,"score_gpt":0.42092076791410576,"score_spread":0.27543377097662614,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2599388927","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010398055,0.10474813,0.8316295,0.007551976,0.0027574208,0.000040228853,0.00035975553,0.0005054493,0.05136765],"genre_scores_gemma":[0.073552355,0.17883448,0.60882366,0.0063094688,0.014610992,0.0003644159,0.0009729237,0.001031959,0.11549979],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99879515,0.0005523753,0.000055215325,0.00017823266,0.00038766323,0.00003128634],"domain_scores_gemma":[0.9924164,0.006896915,0.00011750331,0.00023354065,0.00029412145,0.000041575648],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0030257758,0.0014036521,0.0013358403,0.0016141183,0.00040280996,0.0023845138,0.0014061882,0.0015194439,0.008700504],"category_scores_gemma":[0.008938411,0.0006275806,0.001086037,0.0025023348,0.0028900828,0.002774924,0.0010992221,0.0045141918,0.0051141493],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017561797,0.00003521776,0.00019830321,0.0006279577,0.00006349283,0.00006231175,0.00012349723,0.005614453,0.0004932517,0.80200344,0.03715504,0.15360543],"study_design_scores_gemma":[0.00000434001,0.000012690138,0.0002159076,0.00015239505,0.000017718548,0.000082220766,0.00001846295,0.009484002,0.00022875308,0.928516,0.061250687,0.000016811075],"about_ca_topic_score_codex":0.0010840859,"about_ca_topic_score_gemma":0.0011798785,"teacher_disagreement_score":0.008700504,"about_ca_system_score_codex":0.0011575382,"about_ca_system_score_gemma":0.0011642838,"threshold_uncertainty_score":0.02910602},"labels":[],"label_agreement":null},{"id":"W2600361628","doi":"10.1016/j.jclinepi.2017.02.017","title":"Quasi-experimental study designs series—paper 7: assessing the assumptions","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":150,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Economic and Social Research Council","keywords":"Causal inference; Regression discontinuity design; Instrumental variable; Series (stratigraphy); Inference; Randomized experiment; Research design; Popularity; Computer science; Econometrics; Clinical study design; Interrupted time series; Quasi-experiment; Management science; Medicine; Statistics; Mathematics; Psychology; Machine learning; Artificial intelligence; Clinical trial; Social psychology; Engineering; Environmental health","score_opus":0.8002265442453002,"score_gpt":0.6851954560928973,"score_spread":0.11503108815240282,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2600361628","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042259004,0.0019149395,0.9128956,0.0070526884,0.004341736,0.022019913,0.0018091066,0.00062632596,0.0070806434],"genre_scores_gemma":[0.28273186,0.0008300302,0.6530752,0.0043117986,0.001687031,0.050904717,0.0011813585,0.00030090255,0.0049770833],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.38366428,0.5602147,0.01641298,0.015204007,0.02272618,0.0017778438],"domain_scores_gemma":[0.06538582,0.84495515,0.017068837,0.06019099,0.01123425,0.0011648886],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.53273207,0.0023700274,0.0048409784,0.0017763915,0.0021486771,0.003851209,0.0070276307,0.007935415,0.03365374],"category_scores_gemma":[0.76615,0.0023737475,0.0075499313,0.0012874894,0.0094970465,0.007332146,0.0045936042,0.00960511,0.0022450245],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.07586529,0.007584588,0.019652085,0.015338343,0.02059089,0.0005398167,0.0037553238,0.025527466,0.0034961414,0.5665295,0.029563826,0.2315567],"study_design_scores_gemma":[0.048581734,0.027486453,0.016938033,0.003862738,0.01093171,0.0009251661,0.00091240247,0.17984886,0.009181412,0.6621492,0.038688168,0.00049410097],"about_ca_topic_score_codex":0.0013090221,"about_ca_topic_score_gemma":0.0009156116,"teacher_disagreement_score":0.46726793,"about_ca_system_score_codex":0.003233852,"about_ca_system_score_gemma":0.009766415,"threshold_uncertainty_score":0.57622457},"labels":[],"label_agreement":null},{"id":"W2600481469","doi":"10.1016/j.jclinepi.2017.03.012","title":"Quasi-experimental study designs series—paper 4: uses and value","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":247,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact; University of Ottawa","funders":"World Health Organization","keywords":"Internal validity; Causal inference; External validity; Intervention (counseling); Rivalry; Randomized experiment; Causal model; Randomized controlled trial; Psychology; Causality (physics); Econometrics; Cognitive psychology; Medicine; Social psychology; Economics; Microeconomics; Psychiatry","score_opus":0.7297338715489702,"score_gpt":0.6445861734780254,"score_spread":0.0851476980709448,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2600481469","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011771362,0.003625695,0.9595654,0.0073113404,0.0029336035,0.00362322,0.0013951177,0.00049840135,0.009275968],"genre_scores_gemma":[0.3285381,0.002416292,0.62573344,0.0034681258,0.0026668408,0.02180591,0.0009593525,0.00048800313,0.0139239365],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4537168,0.4913059,0.0138378795,0.016901998,0.022844117,0.0013931991],"domain_scores_gemma":[0.15438248,0.7342241,0.012514532,0.08643787,0.011331525,0.0011094718],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.29017264,0.002134311,0.005157705,0.0026171508,0.0020208412,0.00561516,0.0070353006,0.006583423,0.031933375],"category_scores_gemma":[0.6468568,0.002396675,0.006402984,0.0025634666,0.008841474,0.0104431845,0.0063274284,0.008338333,0.0020371906],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0053503187,0.00060484326,0.012384996,0.0042047068,0.0072096996,0.00035156394,0.0015329109,0.007083517,0.0009701817,0.7131076,0.016047932,0.23115167],"study_design_scores_gemma":[0.0019612974,0.0013533338,0.0039129476,0.0011200928,0.0031577358,0.0005814946,0.00034125068,0.06071936,0.0027835595,0.89151376,0.032399375,0.00015571408],"about_ca_topic_score_codex":0.0010105344,"about_ca_topic_score_gemma":0.00086679123,"teacher_disagreement_score":0.70982736,"about_ca_system_score_codex":0.0040312544,"about_ca_system_score_gemma":0.004515662,"threshold_uncertainty_score":0.8753435},"labels":[],"label_agreement":null},{"id":"W2602609302","doi":"10.1007/s00068-017-0786-6","title":"A systematic review of propensity score methods in the acute care surgery literature: avoiding the pitfalls and proposing a set of reporting guidelines","year":2017,"lang":"en","type":"review","venue":"European Journal of Trauma and Emergency Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":78,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Health Science Centre; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Propensity score matching; Observational study; Medicine; Matching (statistics); Confounding; MEDLINE; Data extraction; Intensive care medicine; Statistics; Internal medicine; Mathematics; Pathology","score_opus":0.6400521993009686,"score_gpt":0.5400017519275301,"score_spread":0.10005044737343849,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2602609302","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000489873,0.98530364,0.0063848123,0.0033749703,0.0008679254,0.0019915479,0.0010181041,0.000054093867,0.0005151673],"genre_scores_gemma":[0.013077964,0.945266,0.029689524,0.0042488147,0.00083552976,0.0056449273,0.0008533069,0.000051242914,0.0003327434],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.88901144,0.046434388,0.04905645,0.003673737,0.011161446,0.00066250603],"domain_scores_gemma":[0.7612112,0.18748651,0.030780608,0.006188649,0.013383645,0.00094928645],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.090978526,0.002504191,0.01100406,0.016396571,0.0012054392,0.0063603236,0.005042882,0.004217692,0.0048396853],"category_scores_gemma":[0.33600453,0.0016703368,0.014500882,0.013560472,0.0023077596,0.006574537,0.0043038996,0.003965113,0.0006068346],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026451488,0.000025954605,0.0009424462,0.8508096,0.025314912,0.0001026691,0.00029562818,0.0002996966,0.00014443441,0.0029105896,0.007841699,0.11104788],"study_design_scores_gemma":[0.00057688955,0.00013737878,0.0019611502,0.8570514,0.095087804,0.00023947637,0.00019493572,0.00032101054,0.00025168498,0.0064233923,0.03767498,0.00007995508],"about_ca_topic_score_codex":0.0062521137,"about_ca_topic_score_gemma":0.01925159,"teacher_disagreement_score":0.9090215,"about_ca_system_score_codex":0.0044520176,"about_ca_system_score_gemma":0.031212304,"threshold_uncertainty_score":0.48114616},"labels":[],"label_agreement":null},{"id":"W2602905072","doi":"10.1097/ede.0000000000000657","title":"Treatment Prediction, Balance, and Propensity Score Adjustment","year":2017,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Propensity score matching; Covariate; Confounding; Causal inference; Statistics; Logistic regression; Econometrics; National Health and Nutrition Examination Survey; Medicine; Inverse probability weighting; Average treatment effect; Weighting; Mathematics; Population; Environmental health","score_opus":0.39520376771656374,"score_gpt":0.43289861150205045,"score_spread":0.03769484378548671,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2602905072","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010683589,0.012244194,0.004377348,0.6674803,0.3125917,0.000080658116,0.00035982675,0.00011334724,0.001684227],"genre_scores_gemma":[0.02385718,0.0122454865,0.0052853003,0.2628057,0.6892425,0.00019921911,0.0002488373,0.00019898919,0.005916831],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98134756,0.011474475,0.0019914706,0.0011612646,0.0035989156,0.00042629679],"domain_scores_gemma":[0.83302677,0.12560356,0.007850438,0.005420432,0.025668144,0.0024307105],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.045796864,0.0010057263,0.0017964784,0.0016123948,0.0012134041,0.0034942515,0.0045008194,0.00893317,0.008498797],"category_scores_gemma":[0.30029714,0.0007475733,0.0011821605,0.0017946886,0.0035395522,0.0029911748,0.0013659644,0.015494029,0.002696693],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002440951,0.00004284671,0.0013005012,0.00042269332,0.00017420518,0.00019827881,0.00007147758,0.00033869414,0.000032867945,0.0039036376,0.95261246,0.04065834],"study_design_scores_gemma":[0.00068659394,0.00029435198,0.009079694,0.0035113385,0.0007451109,0.001058485,0.00020179164,0.009656476,0.0006998234,0.036259793,0.93759197,0.00021453442],"about_ca_topic_score_codex":0.002588468,"about_ca_topic_score_gemma":0.0036031783,"teacher_disagreement_score":0.045796864,"about_ca_system_score_codex":0.0017859124,"about_ca_system_score_gemma":0.0036080778,"threshold_uncertainty_score":0.24219984},"labels":[],"label_agreement":null},{"id":"W2604427595","doi":"10.1016/j.jclinepi.2017.03.016","title":"Quasi-experimental study designs series—paper 13: realizing the full potential of quasi-experiments for health research","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; Bruyère","funders":"","keywords":"Quasi-experiment; Management science; Work (physics); Computer science; Medicine; Engineering; Environmental health","score_opus":0.8447639045687289,"score_gpt":0.7027608747233955,"score_spread":0.1420030298453333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2604427595","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033066666,0.00074977666,0.98550516,0.004301566,0.0014929993,0.0014794556,0.00037690156,0.00017640248,0.0026110034],"genre_scores_gemma":[0.076492675,0.00071803207,0.90851647,0.0028137157,0.0010178696,0.008082049,0.00022170594,0.00011224777,0.0020252436],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7099876,0.27228108,0.0036274893,0.0063078073,0.007143041,0.0006531003],"domain_scores_gemma":[0.4527155,0.47484004,0.009425214,0.052329224,0.008304386,0.0023856058],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21310298,0.0014076125,0.0024083047,0.00084309047,0.0012045617,0.00288486,0.0032263645,0.004097212,0.017136771],"category_scores_gemma":[0.3342301,0.0017105783,0.0025632994,0.0009299408,0.0070083304,0.005940191,0.0047075767,0.005760528,0.0013859728],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028522164,0.0006272031,0.0024474133,0.0024018823,0.0011918688,0.00010060744,0.00075346744,0.0049747303,0.0017429213,0.8552143,0.00980852,0.11788486],"study_design_scores_gemma":[0.003463515,0.0021307534,0.0014678878,0.00063951075,0.000479607,0.00024797683,0.00012265012,0.035931535,0.0021047436,0.9261828,0.027135463,0.000093504874],"about_ca_topic_score_codex":0.00047644865,"about_ca_topic_score_gemma":0.00050394767,"teacher_disagreement_score":0.786897,"about_ca_system_score_codex":0.0012384941,"about_ca_system_score_gemma":0.0050828625,"threshold_uncertainty_score":0.9703841},"labels":[],"label_agreement":null},{"id":"W2604738972","doi":"10.1111/ectj.12092","title":"Oracle and adaptive false discovery rate controlling methods for one‐sided testing: theory and application in treatment effect evaluation","year":2017,"lang":"en","type":"article","venue":"Econometrics Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Connaught Fund; Simon Fraser University; Deutsche Forschungsgemeinschaft; Royal Economic Society; Royal Society","keywords":"False discovery rate; Oracle; Multiple comparisons problem; Computer science; Monte Carlo method; Parametric statistics; Econometrics; Sample size determination; Deconvolution; Statistics; Machine learning; Mathematics; Algorithm","score_opus":0.4302061907665916,"score_gpt":0.515759728347448,"score_spread":0.08555353758085638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2604738972","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002349484,0.0005191186,0.9955153,0.00040875713,0.00008563057,0.00027792685,0.00008154703,0.00034322363,0.00041898264],"genre_scores_gemma":[0.18513528,0.0008116081,0.8082548,0.000878095,0.00031923584,0.0030708534,0.00035528254,0.0002584427,0.0009163897],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.75883496,0.21504438,0.005316792,0.00972936,0.009879038,0.0011954445],"domain_scores_gemma":[0.30756906,0.6446021,0.014854615,0.025473762,0.006159641,0.0013408817],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21163285,0.0027841944,0.005029359,0.0057435036,0.0015493061,0.0041468954,0.0077280276,0.006908888,0.0046972283],"category_scores_gemma":[0.5058984,0.001469981,0.0038530603,0.0052470537,0.010999022,0.005605521,0.004355255,0.009046352,0.0008045538],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027640627,0.0005097349,0.0225286,0.0024108423,0.0038402528,0.0014741472,0.0015683058,0.107367195,0.0032874607,0.47914845,0.005562792,0.3695382],"study_design_scores_gemma":[0.0007577276,0.0009013556,0.0047846376,0.0004927791,0.00056258996,0.0008827281,0.00018284403,0.51558244,0.003919928,0.4658364,0.0058798,0.00021679436],"about_ca_topic_score_codex":0.0021129046,"about_ca_topic_score_gemma":0.0012141869,"teacher_disagreement_score":0.21163285,"about_ca_system_score_codex":0.0024325901,"about_ca_system_score_gemma":0.0045946813,"threshold_uncertainty_score":0.97219706},"labels":[],"label_agreement":null},{"id":"W2605813800","doi":"10.23889/ijpds.v1i1.171","title":"Modelling Diagnostic Validity Estimates from Administrative Health Data","year":2017,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Statistics; Univariate; Bivariate analysis; Confidence interval; Youden's J statistic; Mean squared error; Mathematics; Sensitivity (control systems); Complement (music); Variance (accounting); Regression; Correlation; Regression analysis; Standard error; Econometrics; Multivariate statistics","score_opus":0.7832932054931357,"score_gpt":0.6179929298057897,"score_spread":0.16530027568734607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2605813800","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.29165226,0.0011140041,0.695029,0.0017757202,0.00016288887,0.0018404266,0.0026854463,0.0008482865,0.004891956],"genre_scores_gemma":[0.8234986,0.0005286602,0.17002858,0.00025148995,0.00006277357,0.0023034788,0.001548099,0.00008243864,0.0016959173],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9567237,0.036879852,0.0012556431,0.0025068405,0.0020598595,0.00057402754],"domain_scores_gemma":[0.5333216,0.44161898,0.012043886,0.0048739654,0.0075335265,0.0006080468],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07773107,0.001374205,0.0017734582,0.004425226,0.00064036367,0.0038361445,0.0040896484,0.003067723,0.003044248],"category_scores_gemma":[0.26864374,0.0013553055,0.0031768645,0.002864639,0.0022210926,0.002499853,0.0026665865,0.0024946362,0.00059298176],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003069314,0.000101272795,0.016235055,0.00021938393,0.0002885106,0.00012662806,0.0003306529,0.95041424,0.00008891503,0.016834753,0.0005676056,0.014486011],"study_design_scores_gemma":[0.000059437163,0.00006464913,0.0014111177,0.000097140946,0.000050880142,0.000032857268,0.000049141956,0.98711,0.0001250695,0.0106864935,0.00029184992,0.00002137908],"about_ca_topic_score_codex":0.022263937,"about_ca_topic_score_gemma":0.008342959,"teacher_disagreement_score":0.07773107,"about_ca_system_score_codex":0.0055510066,"about_ca_system_score_gemma":0.0028765409,"threshold_uncertainty_score":0.41108614},"labels":[],"label_agreement":null},{"id":"W2605897081","doi":"10.1186/s41512-017-0012-3","title":"Validation of prediction models: examining temporal and geographic stability of baseline risk and estimated covariate effects","year":2017,"lang":"en","type":"article","venue":"Diagnostic and Prognostic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Neurological Disorders and Stroke; Canadian Institutes of Health Research; Nederlandse Organisatie voor Wetenschappelijk Onderzoek","keywords":"Covariate; Baseline (sea); Stability (learning theory); Statistics; Econometrics; Computer science; Mathematics; Machine learning; Biology","score_opus":0.3648981795435242,"score_gpt":0.46175307836447255,"score_spread":0.09685489882094833,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2605897081","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6788971,0.00092093856,0.3166277,0.0010500271,0.000070734015,0.00023495301,0.00062439014,0.0002306277,0.0013435553],"genre_scores_gemma":[0.97666174,0.000087697204,0.022081695,0.00008560673,0.000033341574,0.00012340675,0.0007522373,0.000034868102,0.00013949996],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8815401,0.10527974,0.003287277,0.006399221,0.0026782036,0.0008155163],"domain_scores_gemma":[0.4270358,0.5178553,0.021146169,0.02666483,0.0063830297,0.0009149051],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1938306,0.0008487805,0.0011196235,0.0018155004,0.0012327724,0.0020649473,0.0026163815,0.0015470564,0.0007394753],"category_scores_gemma":[0.39661518,0.00072446634,0.002076548,0.0025070906,0.002788673,0.0030164463,0.003348582,0.002190442,0.00014628084],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011981166,0.00017741621,0.7869083,0.00016369869,0.0044052415,0.00037772924,0.0013150864,0.1573466,0.00062436843,0.007544541,0.0005520891,0.039386805],"study_design_scores_gemma":[0.00026631413,0.00068530184,0.21658413,0.00016137109,0.00066547334,0.00036012512,0.0010423795,0.75281954,0.0014103194,0.024292087,0.001621258,0.00009173146],"about_ca_topic_score_codex":0.017714605,"about_ca_topic_score_gemma":0.010954539,"teacher_disagreement_score":0.8061694,"about_ca_system_score_codex":0.0016422779,"about_ca_system_score_gemma":0.0028147053,"threshold_uncertainty_score":0.9941504},"labels":[],"label_agreement":null},{"id":"W2606149955","doi":"10.1016/j.jclinepi.2017.04.001","title":"Magnitude and direction of missing confounders had different consequences on treatment effect estimation in propensity score analysis","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Population Health Research Institute","funders":"Cancer Research UK","keywords":"Confounding; Propensity score matching; Medicine; Inverse probability weighting; Observational study; Statistics; Population; Odds ratio; Internal medicine; Mathematics; Environmental health","score_opus":0.6695902067594982,"score_gpt":0.6039816511912118,"score_spread":0.06560855556828638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2606149955","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15995191,0.0041156835,0.8258988,0.0058663283,0.00079438207,0.0004036056,0.00083997665,0.0005717918,0.0015574086],"genre_scores_gemma":[0.874765,0.0010833184,0.12047717,0.0011649213,0.00043659806,0.00036459623,0.00045357866,0.0003729382,0.00088194263],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8486611,0.12588611,0.009377437,0.008905272,0.0051284633,0.0020416386],"domain_scores_gemma":[0.28706956,0.66403013,0.009324659,0.033079587,0.0055836737,0.0009124329],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23457333,0.0014733346,0.0029910638,0.0017758065,0.0011072451,0.0052504046,0.002220692,0.00424748,0.005389519],"category_scores_gemma":[0.59718364,0.001800962,0.005589485,0.002810288,0.0037471112,0.0073758876,0.0029330826,0.0075637135,0.0006778041],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019528585,0.0014238363,0.32486698,0.0030889949,0.011344368,0.0013940184,0.0044236286,0.07029447,0.00905219,0.20315276,0.006497683,0.34493244],"study_design_scores_gemma":[0.0030499354,0.0017920156,0.10230035,0.0014987809,0.018279415,0.0017729218,0.0009016485,0.24654898,0.011888502,0.6068154,0.0045983135,0.00055378216],"about_ca_topic_score_codex":0.0016974177,"about_ca_topic_score_gemma":0.0014707176,"teacher_disagreement_score":0.76542664,"about_ca_system_score_codex":0.00083080435,"about_ca_system_score_gemma":0.0028411394,"threshold_uncertainty_score":0.9439074},"labels":[],"label_agreement":null},{"id":"W2607186425","doi":"10.1002/cjs.11317","title":"Estimating treatment effects in observational studies with both prevalent and incident cohorts","year":2017,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Cancer Institute","keywords":"Propensity score matching; Observational study; Medicine; Selection bias; Cohort; Cohort study; Population; Cancer registry; Demography; Internal medicine; Environmental health","score_opus":0.2298392366367948,"score_gpt":0.42379400865753053,"score_spread":0.19395477202073572,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2607186425","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.044392858,0.0027375505,0.94719136,0.001524438,0.00020521723,0.0012811592,0.0013731023,0.00023217841,0.0010620827],"genre_scores_gemma":[0.5000629,0.003543299,0.4872821,0.0013778586,0.00045823093,0.0036608428,0.0025196215,0.00006680918,0.0010283918],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9162081,0.06979352,0.0046895887,0.0047615133,0.003946468,0.0006007698],"domain_scores_gemma":[0.71661127,0.24091586,0.021032114,0.018001163,0.0027174524,0.00072212383],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14192045,0.0012420807,0.0023560768,0.004042677,0.001259146,0.0025609452,0.003217345,0.002356765,0.0032175116],"category_scores_gemma":[0.275337,0.0012126461,0.005325179,0.0051827948,0.0021354398,0.0024392642,0.0036454445,0.0035208743,0.00036357105],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014232404,0.00071314984,0.28736928,0.0028971508,0.014224562,0.00095266773,0.0013275298,0.18116613,0.00076355634,0.22895098,0.0044279974,0.27578375],"study_design_scores_gemma":[0.0020360071,0.0013567001,0.071451336,0.0013341628,0.0075983047,0.000832295,0.0006436195,0.41111308,0.0018659163,0.48584098,0.015729545,0.00019806792],"about_ca_topic_score_codex":0.00914902,"about_ca_topic_score_gemma":0.006648513,"teacher_disagreement_score":0.85807955,"about_ca_system_score_codex":0.00162508,"about_ca_system_score_gemma":0.0036863063,"threshold_uncertainty_score":0.75055605},"labels":[],"label_agreement":null},{"id":"W2608829643","doi":"10.1177/0081175017701180","title":"Estimating Moderated Causal Effects with Time-varying Treatments and Time-varying Moderators: Structural Nested Mean Models and Regression with Residuals","year":2017,"lang":"en","type":"article","venue":"Sociological Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; National Institute on Drug Abuse; National Institute of Mental Health; U.S. Department of Health and Human Services","keywords":"Regression analysis; Statistics; Econometrics; Regression; Mathematics; Psychology","score_opus":0.28897851064091584,"score_gpt":0.46085075050692603,"score_spread":0.1718722398660102,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2608829643","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008149216,0.0002913177,0.99003744,0.00042707147,0.000046456662,0.00012795682,0.00010532561,0.00017589805,0.00063946977],"genre_scores_gemma":[0.2349883,0.00072810013,0.7593233,0.00037316998,0.00020455674,0.0016753724,0.0004519799,0.00018715035,0.0020681664],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95123416,0.041428465,0.0009440678,0.0036817277,0.0020636525,0.0006479337],"domain_scores_gemma":[0.8371474,0.13808548,0.008002549,0.013672533,0.0023640955,0.000728017],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058653694,0.0016714607,0.0026041993,0.0022926356,0.001132454,0.0023589414,0.004647547,0.0022909073,0.0039665555],"category_scores_gemma":[0.16937692,0.0014277324,0.0047191936,0.0026859257,0.0036883065,0.0044519627,0.0043844325,0.0055169314,0.00055790483],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020679782,0.00029771405,0.022641879,0.0005314461,0.0017401383,0.00022156037,0.0023683738,0.09435167,0.00068306865,0.7824521,0.0015867109,0.09291856],"study_design_scores_gemma":[0.00009909253,0.00022109658,0.0034403668,0.00017654728,0.0003894992,0.0000761623,0.00023001658,0.28443158,0.00070236746,0.70517606,0.0049896706,0.00006753677],"about_ca_topic_score_codex":0.010561959,"about_ca_topic_score_gemma":0.009969252,"teacher_disagreement_score":0.058653694,"about_ca_system_score_codex":0.0023801834,"about_ca_system_score_gemma":0.0038391359,"threshold_uncertainty_score":0.31019413},"labels":[],"label_agreement":null},{"id":"W2609185034","doi":"10.1186/s12874-017-0338-0","title":"Double-adjustment in propensity score matching analysis: choosing a threshold for considering residual imbalance","year":2017,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":491,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; McMaster University; Population Health Research Institute","funders":"University of Oxford; Cancer Research UK","keywords":"Covariate; Propensity score matching; Confounding; Statistics; Residual; Matching (statistics); Logistic regression; Regression; Mathematics; Regression analysis; Econometrics; Medicine","score_opus":0.8896096151371321,"score_gpt":0.6436425630183503,"score_spread":0.24596705211878178,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2609185034","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031888925,0.0005892638,0.96565294,0.0005447534,0.000114581395,0.00036709447,0.0000696229,0.0003500978,0.0004227745],"genre_scores_gemma":[0.51142853,0.00023806223,0.4863264,0.00038428314,0.00010957647,0.0008301976,0.00017274855,0.0001652647,0.00034504058],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95534694,0.035284743,0.002519446,0.0032890635,0.0027958278,0.00076404895],"domain_scores_gemma":[0.89377993,0.084838755,0.008100331,0.010040668,0.002545616,0.000694756],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06941801,0.0009543284,0.0017375934,0.0014024663,0.0008438102,0.0015650406,0.0020648432,0.0016198277,0.0018197118],"category_scores_gemma":[0.17762883,0.0006040176,0.002167034,0.0017397716,0.0018809385,0.0021167083,0.0025137425,0.0021567426,0.0002565408],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0050741923,0.00067122024,0.15290485,0.0026710238,0.004823809,0.0013917957,0.0027463397,0.12836537,0.01785288,0.10354469,0.0072714672,0.5726824],"study_design_scores_gemma":[0.0010560883,0.0022762024,0.035777766,0.0006992397,0.0018129756,0.0014558516,0.0003686956,0.666053,0.020897735,0.25619805,0.013137339,0.0002670366],"about_ca_topic_score_codex":0.0013631294,"about_ca_topic_score_gemma":0.0012995506,"teacher_disagreement_score":0.930582,"about_ca_system_score_codex":0.00088557875,"about_ca_system_score_gemma":0.0022364182,"threshold_uncertainty_score":0.36712193},"labels":[],"label_agreement":null},{"id":"W2609604109","doi":"10.1177/0962280217708662","title":"Prediction and tolerance intervals for dynamic treatment regimes","year":2017,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Tolerance interval; Interval (graph theory); Computer science; Confidence interval; Estimation; Econometrics; Prediction interval; Data mining; Statistics; Machine learning; Mathematics; Engineering","score_opus":0.5751032498731449,"score_gpt":0.6926307709134367,"score_spread":0.11752752104029185,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2609604109","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009206009,0.0013940943,0.98568,0.0008562457,0.000110538596,0.00014801238,0.00028909717,0.00030545756,0.0020105247],"genre_scores_gemma":[0.4847628,0.0022029139,0.5065758,0.0009198433,0.0005347596,0.0013284354,0.0012122436,0.00026960965,0.00219352],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97691935,0.015603816,0.0009783078,0.0028437835,0.0030698464,0.000584843],"domain_scores_gemma":[0.70291173,0.25934348,0.01800378,0.013041153,0.0050418433,0.0016578648],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043403972,0.0012715166,0.0022960508,0.0035230033,0.00061155594,0.0031536676,0.0039940365,0.0026509974,0.0071146484],"category_scores_gemma":[0.25561717,0.0006450671,0.0019480212,0.0031850408,0.0030687936,0.0049267537,0.0031980749,0.0061475565,0.0008477172],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005409402,0.00018416547,0.013268818,0.0007219741,0.00040158667,0.00020226641,0.0007271518,0.3274464,0.000677474,0.40316832,0.004416514,0.2482444],"study_design_scores_gemma":[0.00010804403,0.00025385397,0.0022646915,0.0003071887,0.00010843793,0.00017131893,0.00008980412,0.6454596,0.0007635957,0.34608185,0.0043178024,0.0000737685],"about_ca_topic_score_codex":0.002147089,"about_ca_topic_score_gemma":0.001035689,"teacher_disagreement_score":0.043403972,"about_ca_system_score_codex":0.0017342295,"about_ca_system_score_gemma":0.0022469063,"threshold_uncertainty_score":0.22954488},"labels":[],"label_agreement":null},{"id":"W261013088","doi":"10.3138/cjpe.24.002","title":"A Promising New Approach to Eliminating Selection Bias","year":2009,"lang":"en","type":"article","venue":"Canadian Journal of Program Evaluation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Selection (genetic algorithm); Variance (accounting); Computer science; Process (computing); Selection bias; Transformation (genetics); Econometrics; Data science; Data mining; Machine learning; Artificial intelligence; Statistics; Mathematics; Economics","score_opus":0.5436381024989055,"score_gpt":0.5032713346008978,"score_spread":0.04036676789800775,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W261013088","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018002453,0.00018783116,0.99339914,0.0018210179,0.00017419388,0.00011591857,0.00012628597,0.00015651135,0.0022188465],"genre_scores_gemma":[0.071324654,0.0005594312,0.91967213,0.0018308349,0.00065637956,0.0010352538,0.00026901925,0.00016662799,0.004485658],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9619994,0.027777376,0.0011305233,0.0032992682,0.005354843,0.00043856012],"domain_scores_gemma":[0.95485353,0.031297702,0.002586777,0.0077966014,0.003088538,0.00037684108],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03433065,0.0011992137,0.001868006,0.0029431204,0.0015140913,0.0030422993,0.0034668287,0.0017943999,0.011481763],"category_scores_gemma":[0.088304065,0.0006123001,0.0029368459,0.004183227,0.0037062296,0.0041866372,0.003559105,0.0043697823,0.002001518],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012292038,0.00015031478,0.0027796929,0.00042716158,0.0005891283,0.00011251692,0.00092059694,0.005970741,0.0010355422,0.7502031,0.00710261,0.23058563],"study_design_scores_gemma":[0.00020784567,0.00018406678,0.0017411388,0.00014730245,0.00013324265,0.00027665,0.00019610222,0.03087467,0.0011795467,0.93501234,0.029991597,0.00005552765],"about_ca_topic_score_codex":0.0016120694,"about_ca_topic_score_gemma":0.0015884785,"teacher_disagreement_score":0.96566933,"about_ca_system_score_codex":0.0011323807,"about_ca_system_score_gemma":0.0045562065,"threshold_uncertainty_score":0.18155998},"labels":[],"label_agreement":null},{"id":"W2611759197","doi":"10.1093/aje/kwx027","title":"Tools for the Precision Medicine Era: How to Develop Highly Personalized Treatment Recommendations From Cohort and Registry Data Using Q-Learning","year":2017,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; National Cancer Institute; Office of Naval Research; National Heart, Lung, and Blood Institute; Department of Internal Medicine, University of Utah; Juno Therapeutics; Sanofi Genzyme; Takeda Oncology; U.S. Navy; Kite Pharma; Janssen Scientific Affairs; Health Resources and Services Administration; Otsuka Pharmaceutical; Center for International Blood and Marrow Transplant Research; Astellas Pharma; Swedish Orphan Biovitrum; U.S. Department of Health and Human Services; Miltenyi Biotec; National Institutes of Health; Seattle Genetics; Telomere Diagnostics; Pharmacyclics; bluebird bio; Atara Biotherapeutics; Meso Scale Diagnostics; Cerus Corporation; Novartis Pharmaceuticals Canada; Jazz Pharmaceuticals; Sunesis; Department of Epidemiology, Biostatistics and Occupational Health, McGill University; Medac; Actinium Pharmaceuticals; Chimerix; U.S. Department of Defense; Medical College of Wisconsin; McGill University; Karyopharm Therapeutics; University of Minnesota; Fred Hutchinson Cancer Research Center; Division of Intramural Research, National Institute of Allergy and Infectious Diseases; Faculty of Medicine, McGill University; Celgene; Merck; Spectrum Pharmaceuticals; Patient-Centered Outcomes Research Institute; Incyte; Pfizer; Angiocrine Bioscience; Astellas Pharma US; Bristol-Myers Squibb; Be The Match Foundation; Shire; Novartis Pharmaceuticals Corporation; Amgen; Gilead Sciences; HistoGenetics; MedImmune; Moffitt Cancer Center; Sanofi; National Marrow Donor Program","keywords":"Medicine; Randomized controlled trial; Personalized medicine; Population; Precision medicine; Cohort; Clinical trial; Medical physics; Machine learning; Computer science; Bioinformatics; Surgery; Internal medicine; Pathology","score_opus":0.4737298912114096,"score_gpt":0.5235393196854121,"score_spread":0.04980942847400249,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2611759197","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018936129,0.0010893743,0.9835054,0.010489132,0.00016902853,0.00023610755,0.0006386496,0.0008633071,0.0011153729],"genre_scores_gemma":[0.07021306,0.0012926135,0.9233432,0.0026181876,0.00031244004,0.0008770758,0.0005830756,0.00018460705,0.0005757852],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9643453,0.029627988,0.0017111856,0.0022288864,0.0018417641,0.00024500443],"domain_scores_gemma":[0.6952845,0.27620977,0.00758649,0.014041768,0.0056972825,0.0011802278],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07309196,0.0018829089,0.0029648764,0.005599247,0.0010244581,0.003840097,0.0029296319,0.0026557571,0.008369563],"category_scores_gemma":[0.27504715,0.001429271,0.0026704231,0.003735129,0.0031004732,0.005741657,0.0036406955,0.006614716,0.0018003782],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054975675,0.00039061374,0.018322779,0.0020171131,0.0025096752,0.00037521345,0.0012723278,0.20081207,0.0005004241,0.16144481,0.038275816,0.5735294],"study_design_scores_gemma":[0.00030436646,0.00012494795,0.0014183178,0.0008737303,0.00020518343,0.00013031175,0.0002065144,0.2406353,0.000537342,0.74026483,0.015183876,0.000115205425],"about_ca_topic_score_codex":0.007957658,"about_ca_topic_score_gemma":0.006650594,"teacher_disagreement_score":0.07309196,"about_ca_system_score_codex":0.0019912452,"about_ca_system_score_gemma":0.0055639166,"threshold_uncertainty_score":0.38655186},"labels":[],"label_agreement":null},{"id":"W2611803101","doi":"10.1089/end.2017.0290","title":"Editorial Comment on Tay <i>et al</i> .","year":2017,"lang":"he","type":"editorial","venue":"Journal of Endourology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Medicine; Chin; Library science; Anatomy; Computer science","score_opus":0.07674665673909771,"score_gpt":0.4266599938582919,"score_spread":0.3499133371191942,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2611803101","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00006969321,0.0013814709,0.00015612511,0.26914743,0.72751117,0.000021039617,0.00019141607,0.000065446875,0.0014562743],"genre_scores_gemma":[0.001182148,0.0019463171,0.0002128645,0.18390366,0.80469227,0.000050688945,0.00008454287,0.000070108086,0.007857385],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9945431,0.000872637,0.00081289554,0.0007106651,0.0025574807,0.00050333183],"domain_scores_gemma":[0.97200394,0.01206189,0.0018892465,0.0009568415,0.010343153,0.00274481],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007963754,0.0018881541,0.0028796033,0.0027239837,0.0031968092,0.0054169125,0.0037404066,0.02088366,0.017009513],"category_scores_gemma":[0.056264013,0.00089894474,0.0023399421,0.0015082138,0.0031103978,0.0033998534,0.0016652017,0.028335556,0.012107826],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017684393,0.000004028532,0.00002636332,0.00004682264,0.00000808679,0.00010344243,0.000008297603,0.00000877227,0.000012497337,0.00027713057,0.9986193,0.00086757983],"study_design_scores_gemma":[0.00013482918,0.00003056743,0.00062543526,0.0004675548,0.000089310386,0.0006271147,0.00010878618,0.00026911334,0.00025291857,0.003064681,0.9942859,0.000043722146],"about_ca_topic_score_codex":0.0032861738,"about_ca_topic_score_gemma":0.0069838096,"teacher_disagreement_score":0.02088366,"about_ca_system_score_codex":0.0032021163,"about_ca_system_score_gemma":0.004940315,"threshold_uncertainty_score":0.056902528},"labels":[],"label_agreement":null},{"id":"W2612495025","doi":"10.1177/0962280217708665","title":"Model validation and selection for personalized medicine using dynamic-weighted ordinary least squares","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; University of Texas Southwestern Medical Center","keywords":"Ordinary least squares; Robustness (evolution); Computer science; Personalized medicine; Selection (genetic algorithm); Generalized least squares; Econometrics; Data mining; Statistics; Mathematics; Machine learning; Bioinformatics; Estimator","score_opus":0.6475070671778674,"score_gpt":0.7094544250062448,"score_spread":0.06194735782837735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2612495025","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005558367,0.00026409366,0.99290484,0.00053416606,0.000031043543,0.0000783079,0.000056023033,0.0001401711,0.0004330382],"genre_scores_gemma":[0.39361927,0.0007309737,0.6021989,0.00063377956,0.000174248,0.0007999604,0.00065563223,0.00016618521,0.0010211101],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97890615,0.017629756,0.0005451982,0.001299944,0.0013937688,0.00022516843],"domain_scores_gemma":[0.9599147,0.03359153,0.0016019262,0.0030975502,0.0014961442,0.00029813164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02757543,0.0011061877,0.0022635777,0.0020453425,0.0009199187,0.0017641742,0.0021504804,0.0011885359,0.0027765646],"category_scores_gemma":[0.090891905,0.00076672813,0.0022715912,0.0016283791,0.0015096649,0.0019118821,0.0025661439,0.0032494739,0.00059626315],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004219372,0.00027438582,0.00949275,0.00057042274,0.0014342848,0.0002587256,0.00042268066,0.5049478,0.0020779173,0.20058912,0.004206553,0.27530345],"study_design_scores_gemma":[0.00007546735,0.00015023354,0.0010632448,0.00008480621,0.00009186238,0.000051431485,0.000046272253,0.83405167,0.00067395275,0.16173548,0.0019382727,0.000037278474],"about_ca_topic_score_codex":0.0031064542,"about_ca_topic_score_gemma":0.0036754273,"teacher_disagreement_score":0.02757543,"about_ca_system_score_codex":0.0011833344,"about_ca_system_score_gemma":0.0039108186,"threshold_uncertainty_score":0.14583457},"labels":[],"label_agreement":null},{"id":"W2617884986","doi":"10.1016/j.jclinepi.2017.02.015","title":"Quasi-experimental study designs series—paper 6: risk of bias assessment","year":2017,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":95,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Economic and Social Research Council","keywords":"Unobservable; Regression discontinuity design; Selection bias; Confounding; Econometrics; Internal validity; Computer science; Selection (genetic algorithm); Instrumental variable; Information bias; Systematic review; External validity; Discontinuity (linguistics); Statistics; Machine learning; MEDLINE; Mathematics","score_opus":0.9095861097698986,"score_gpt":0.7252836017000012,"score_spread":0.18430250806989745,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2617884986","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026466514,0.75052065,0.22083333,0.00832913,0.005739864,0.0056546465,0.001365423,0.00026786063,0.0046425443],"genre_scores_gemma":[0.13117753,0.41897225,0.39617285,0.013029716,0.009066915,0.024640137,0.0015585228,0.00023389126,0.0051482045],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.7686297,0.19926035,0.015384311,0.0049531017,0.0112607805,0.0005117987],"domain_scores_gemma":[0.35577646,0.6074099,0.015915763,0.012869665,0.0075522684,0.000475933],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17273377,0.002123537,0.0065402724,0.0026721254,0.00071940926,0.0029486765,0.0043977136,0.0056145685,0.017760681],"category_scores_gemma":[0.4062542,0.0012671207,0.007655026,0.0024121017,0.002856189,0.0033549375,0.00198476,0.004917132,0.0012353825],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0046569975,0.00043653042,0.0024557905,0.17562611,0.036883734,0.00014291177,0.00037819328,0.0017768391,0.00025752914,0.06477328,0.01577002,0.696842],"study_design_scores_gemma":[0.021564582,0.0058827833,0.011125147,0.18682848,0.11378695,0.0023019027,0.000524803,0.013640133,0.00298333,0.4360919,0.20479955,0.0004704717],"about_ca_topic_score_codex":0.0009494468,"about_ca_topic_score_gemma":0.0010512383,"teacher_disagreement_score":0.8272662,"about_ca_system_score_codex":0.002124474,"about_ca_system_score_gemma":0.0053667873,"threshold_uncertainty_score":0.9135144},"labels":[],"label_agreement":null},{"id":"W2621147310","doi":"10.1016/j.jclinepi.2017.05.016","title":"A systematic survey of the methods literature on the reporting quality and optimal methods of handling participants with missing outcome data for continuous outcomes in randomized controlled trials","year":2017,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; McMaster University; Impact","funders":"","keywords":"Missing data; Ranking (information retrieval); Imputation (statistics); Randomized controlled trial; Data quality; Statistics; Type I and type II errors; Data collection; Systematic review; Meta-analysis; Computer science; Medicine; MEDLINE; Mathematics; Machine learning; Operations management","score_opus":0.968639756689589,"score_gpt":0.7980095567593587,"score_spread":0.17063019993023032,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2621147310","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00039617423,0.99188155,0.0048925932,0.0015593587,0.00024019663,0.00038835855,0.00034673224,0.000027562364,0.00026754683],"genre_scores_gemma":[0.012189349,0.9665376,0.016139567,0.0023716998,0.00039750326,0.0018322375,0.0003520216,0.000054763634,0.00012533824],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.7735434,0.1222913,0.075489245,0.006390835,0.021200303,0.0010848935],"domain_scores_gemma":[0.27495039,0.6663529,0.034897532,0.0079126,0.015113788,0.0007727281],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.209227,0.0023592869,0.013143784,0.012147432,0.000927453,0.0059648873,0.004203589,0.004735191,0.005001487],"category_scores_gemma":[0.5708185,0.0023719063,0.014413957,0.0124446,0.0034430479,0.0064613097,0.0034878151,0.005663151,0.00053352426],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000697026,0.00003545841,0.0010613649,0.7721143,0.022126062,0.00006473108,0.00037313008,0.0006369844,0.00016460822,0.0040953406,0.004201466,0.19442953],"study_design_scores_gemma":[0.0008310954,0.00031017823,0.0027577947,0.85460657,0.09352266,0.000424365,0.00023534233,0.0008460402,0.0004229396,0.011668236,0.034248494,0.00012619572],"about_ca_topic_score_codex":0.0062270765,"about_ca_topic_score_gemma":0.01163296,"teacher_disagreement_score":0.79077303,"about_ca_system_score_codex":0.007503003,"about_ca_system_score_gemma":0.023135375,"threshold_uncertainty_score":0.9751639},"labels":[],"label_agreement":null},{"id":"W2624445525","doi":"10.1016/j.jclinepi.2017.06.003","title":"Graphic report of the results from propensity score method analyses","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Fonds de Recherche du Québec-Société et Culture; Jewish General Hospital","keywords":"Propensity score matching; Statistics; Medicine; Computer science; Medical physics; Mathematics","score_opus":0.8981984549665861,"score_gpt":0.6914254145489367,"score_spread":0.20677304041764943,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2624445525","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.057600986,0.004282974,0.28110415,0.013194772,0.008916904,0.0041649533,0.53010637,0.032580603,0.068048425],"genre_scores_gemma":[0.3924133,0.0036432738,0.37006477,0.008690302,0.0029163302,0.0060971444,0.15538518,0.0079289,0.05286086],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9940123,0.0030945407,0.0004905477,0.0006263977,0.0014465598,0.0003296332],"domain_scores_gemma":[0.87715226,0.10243794,0.004799467,0.0050555794,0.010024129,0.00053066795],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.006979305,0.0024004425,0.002189297,0.0075712013,0.00045444348,0.002182382,0.0011285217,0.00171248,0.21832846],"category_scores_gemma":[0.0759767,0.00064708985,0.0027912958,0.0049351654,0.00086764403,0.0008828019,0.0012468225,0.0024355866,0.0127494],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036671949,0.00070672034,0.015301949,0.0041478286,0.0017417953,0.0006824098,0.00033581845,0.014978115,0.0015312297,0.022005899,0.7846573,0.15024376],"study_design_scores_gemma":[0.008677034,0.0022740571,0.21092372,0.0056741065,0.0038202459,0.0042446,0.0013855621,0.17657258,0.007947313,0.112250075,0.4652435,0.0009873029],"about_ca_topic_score_codex":0.012219822,"about_ca_topic_score_gemma":0.007679987,"teacher_disagreement_score":0.9930207,"about_ca_system_score_codex":0.0006769303,"about_ca_system_score_gemma":0.0017851263,"threshold_uncertainty_score":0.7303815},"labels":[],"label_agreement":null},{"id":"W2626910779","doi":"10.1111/bju.13930","title":"Critical appraisal of the application of propensity score methods in the urology literature","year":2017,"lang":"en","type":"article","venue":"British Journal of Urology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre; Princess Margaret Cancer Centre; University Health Network; University of Toronto; Health Sciences Centre","funders":"","keywords":"Critical appraisal; Propensity score matching; Urology; Medicine; Psychology; Internal medicine; Alternative medicine; Pathology","score_opus":0.13348753793058846,"score_gpt":0.4717279809260477,"score_spread":0.3382404429954592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2626910779","genre_codex":"review","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010289227,0.84771055,0.033376016,0.0611357,0.01578816,0.022706773,0.0025843442,0.0002729908,0.0061362246],"genre_scores_gemma":[0.29228014,0.44519186,0.13603474,0.035972763,0.024550078,0.06085071,0.0029546563,0.0005064392,0.0016587046],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.3510311,0.35983163,0.20943716,0.009241989,0.06807193,0.0023861772],"domain_scores_gemma":[0.058715872,0.72471714,0.10578838,0.017247764,0.091958396,0.0015725648],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.51824313,0.0034697077,0.008839452,0.05316372,0.004270578,0.013830851,0.006644593,0.006202344,0.0072719874],"category_scores_gemma":[0.86255777,0.0030839704,0.012501703,0.024397958,0.008643503,0.010960409,0.0070052515,0.00512354,0.0009082201],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002554849,0.00008702323,0.009080477,0.70081633,0.02868838,0.0007685712,0.0059355334,0.0014529498,0.00065595965,0.011435449,0.025672708,0.21285187],"study_design_scores_gemma":[0.0013863004,0.0009595674,0.011263209,0.8278169,0.03643079,0.00085069455,0.0027121808,0.0021484336,0.0016475737,0.026850069,0.08760685,0.0003274725],"about_ca_topic_score_codex":0.0037376904,"about_ca_topic_score_gemma":0.004742305,"teacher_disagreement_score":0.48175687,"about_ca_system_score_codex":0.0192153,"about_ca_system_score_gemma":0.03972465,"threshold_uncertainty_score":0.594092},"labels":[],"label_agreement":null},{"id":"W2683857909","doi":"10.22237/jmasm/1209614460","title":"Confidence Intervals for the Squared Multiple Semipartial Correlation Coefficient","year":2008,"lang":"en","type":"article","venue":"Journal of Modern Applied Statistical Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Mathematics; Confidence interval; Statistics; Correlation coefficient; Coverage probability; Mean squared error; CDF-based nonparametric confidence interval; Correlation; Robust confidence intervals; Fisher transformation; Linear regression; Correlation ratio; Population; Medicine","score_opus":0.2641471578532747,"score_gpt":0.49408629685120936,"score_spread":0.22993913899793467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2683857909","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.088878475,0.0069677867,0.8842153,0.0014376297,0.00057129876,0.00091460376,0.0020823544,0.0017497671,0.013182792],"genre_scores_gemma":[0.6589297,0.0016649421,0.33107328,0.00071681954,0.0004511774,0.0025709656,0.0027099058,0.00047218055,0.0014109012],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9068429,0.058712646,0.004549356,0.009735555,0.018729554,0.0014300032],"domain_scores_gemma":[0.2254945,0.7101918,0.016570307,0.025080452,0.021232687,0.001430245],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.115114056,0.0014811116,0.0029209128,0.007952698,0.0014801543,0.0045713573,0.0057484205,0.0048895106,0.0073520527],"category_scores_gemma":[0.59539753,0.0008155882,0.0034977049,0.0058500497,0.003969373,0.004681225,0.0045245793,0.005802758,0.0011905001],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005167598,0.00046398045,0.06319885,0.0035794936,0.0042675007,0.0014748292,0.0039704596,0.09697105,0.0037965279,0.49712378,0.016815871,0.30317008],"study_design_scores_gemma":[0.0011993262,0.0025720624,0.062907785,0.005392038,0.002750827,0.0036591396,0.0028236164,0.46400562,0.014892874,0.40135556,0.037568145,0.00087304617],"about_ca_topic_score_codex":0.00279103,"about_ca_topic_score_gemma":0.0012962945,"teacher_disagreement_score":0.115114056,"about_ca_system_score_codex":0.0016348906,"about_ca_system_score_gemma":0.0015994079,"threshold_uncertainty_score":0.6087886},"labels":[],"label_agreement":null},{"id":"W2713091059","doi":"10.1093/ije/dyx023","title":"Assessing the impact of unmeasured confounding for binary outcomes using confounding functions","year":2017,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":32,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Confounding; Causal inference; Econometrics; Observational study; Statistics; Inference; Instrumental variable; Odds; Information bias; Computer science; Selection bias; Mathematics; Logistic regression; Artificial intelligence","score_opus":0.593533639452308,"score_gpt":0.6345018749151049,"score_spread":0.04096823546279693,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2713091059","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004140235,0.0008785029,0.9913948,0.0010642936,0.00006828314,0.00020209333,0.00025904665,0.00018340172,0.0018092627],"genre_scores_gemma":[0.21731502,0.002285078,0.77422357,0.0012923268,0.00036862938,0.0016370603,0.00057307124,0.00030868387,0.0019965267],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.864884,0.10748816,0.0059106736,0.0070965323,0.01343518,0.001185477],"domain_scores_gemma":[0.41663897,0.5345336,0.019829765,0.022895034,0.0055732485,0.0005293508],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18077184,0.0024620758,0.0038253977,0.0060442355,0.0016984199,0.0064205728,0.0043840515,0.0045328233,0.0075784717],"category_scores_gemma":[0.45833096,0.0011930396,0.005237977,0.0057628993,0.0071028154,0.010358756,0.0065519596,0.0061685387,0.0013187156],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002828802,0.00016881943,0.029032938,0.0029110233,0.0023794249,0.00060903834,0.0017659811,0.055670533,0.0009279714,0.7074034,0.0040545445,0.19479331],"study_design_scores_gemma":[0.00007071658,0.0001665404,0.006345838,0.000945528,0.00047351996,0.0005407511,0.000234337,0.09806084,0.0017276331,0.8790774,0.01225942,0.00009756143],"about_ca_topic_score_codex":0.003388028,"about_ca_topic_score_gemma":0.0015338799,"teacher_disagreement_score":0.8192282,"about_ca_system_score_codex":0.0025719027,"about_ca_system_score_gemma":0.004349393,"threshold_uncertainty_score":0.9560243},"labels":[],"label_agreement":null},{"id":"W2726070247","doi":"10.1093/geroni/igx004.4107","title":"NONRANDOMIZED STUDIES: THE HAZARDOUS PRACTICE OF TESTING FOR BASELINE IMBALANCES","year":2017,"lang":"en","type":"article","venue":"Innovation in Aging","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Observational study; Baseline (sea); Confounding; Medicine; False positive paradox; Psychological intervention; Strengthening the reporting of observational studies in epidemiology; Randomization; Randomized controlled trial; Medical physics; Computer science; Surgery; Nursing; Political science","score_opus":0.2968175987650567,"score_gpt":0.509430155691871,"score_spread":0.2126125569268143,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2726070247","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007927315,0.102861606,0.6594914,0.17227088,0.022661466,0.014243912,0.0033745093,0.0016800684,0.015488894],"genre_scores_gemma":[0.14825286,0.035330217,0.657181,0.1062012,0.014869834,0.03197274,0.0013419633,0.0011239294,0.0037262612],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.081350386,0.78176427,0.069429465,0.017115332,0.049504794,0.000835779],"domain_scores_gemma":[0.029580299,0.8130173,0.052449767,0.072471656,0.03129759,0.0011833883],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.79423225,0.0027505334,0.008881192,0.010798596,0.0036173451,0.014671931,0.009030164,0.009917583,0.0062456257],"category_scores_gemma":[0.88996744,0.0032238432,0.0058940435,0.013242005,0.026112616,0.016892489,0.0076358737,0.015180784,0.002738373],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028917615,0.00029290072,0.018217945,0.08390581,0.012941704,0.0007269086,0.017900757,0.0022792637,0.0015970531,0.27770698,0.12763272,0.45390612],"study_design_scores_gemma":[0.0023691251,0.0014337181,0.012665563,0.14450705,0.0057188617,0.0017345153,0.0032613743,0.0092356885,0.003960152,0.55313975,0.2611854,0.00078875216],"about_ca_topic_score_codex":0.0028705606,"about_ca_topic_score_gemma":0.0028165234,"teacher_disagreement_score":0.20576775,"about_ca_system_score_codex":0.0076768957,"about_ca_system_score_gemma":0.025275292,"threshold_uncertainty_score":0.25374836},"labels":[],"label_agreement":null},{"id":"W2729335696","doi":"10.48550/arxiv.1707.01473","title":"Machine-Learning Tests for Effects on Multiple Outcomes","year":2017,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Booth University College","funders":"","keywords":"Intuition; Computer science; Machine learning; Randomized experiment; Inference; Artificial intelligence; Outcome (game theory); Data collection; Set (abstract data type); Data science; Psychology; Statistics; Mathematics","score_opus":0.2748012721513939,"score_gpt":0.32440054044851513,"score_spread":0.049599268297121246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2729335696","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03354111,0.0036007788,0.9351123,0.010727464,0.001098736,0.00085382594,0.0029764245,0.0013893463,0.0107000265],"genre_scores_gemma":[0.696153,0.0016180367,0.2869235,0.0040637227,0.002038508,0.0036408952,0.0021173817,0.0003381171,0.0031068185],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.87542075,0.09589401,0.0042208578,0.012499894,0.010697959,0.00126655],"domain_scores_gemma":[0.303881,0.65169924,0.013894737,0.02523123,0.004153465,0.0011403323],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.112131804,0.0025533922,0.0050919154,0.0060461923,0.0014550159,0.0035410123,0.006471772,0.004178161,0.020396814],"category_scores_gemma":[0.46310604,0.00081992935,0.0058335084,0.004611872,0.007685996,0.009362216,0.0034358744,0.00966686,0.0027027878],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027111028,0.0014044844,0.055225745,0.0036537757,0.00992394,0.0009574746,0.0006450869,0.045916528,0.0010891844,0.57481587,0.013413556,0.2902433],"study_design_scores_gemma":[0.00083551975,0.0010285367,0.009755987,0.0005911363,0.0012464711,0.00028029302,0.00016392829,0.13081954,0.0018659036,0.84592557,0.0074007134,0.000086417254],"about_ca_topic_score_codex":0.0011515624,"about_ca_topic_score_gemma":0.0007675319,"teacher_disagreement_score":0.112131804,"about_ca_system_score_codex":0.0021679045,"about_ca_system_score_gemma":0.003322881,"threshold_uncertainty_score":0.59301674},"labels":[],"label_agreement":null},{"id":"W2730038733","doi":"10.1177/0962280217713347","title":"Causality on longitudinal data: Stable specification search in constrained structural equation modeling","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research; National Institutes of Health; IXICO; H. Lundbeck A/S; Eisai; Servier; University of California, San Diego; University of Glasgow; Radboud Universiteit; University of Aberdeen; Newcastle University; Northern California Institute for Research and Education; Genentech; University of Dundee; BioClinica; Biogen; Pfizer; Novartis Pharmaceuticals Corporation; University of Southern California; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Meso Scale Diagnostics; Leids Universitair Medisch Centrum; Universiteit Leiden; Alzheimer's Disease Neuroimaging Initiative; Alzheimer's Association","keywords":"Computer science; Causal model; Causality (physics); Stability (learning theory); Structural equation modeling; Set (abstract data type); Machine learning; Artificial intelligence; Data mining; Mathematics; Statistics","score_opus":0.8721763018702403,"score_gpt":0.725111040097272,"score_spread":0.1470652617729683,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2730038733","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069092433,0.00022966591,0.9922524,0.00021598974,0.000006951804,0.000036675574,0.000035322526,0.00012652343,0.00018726183],"genre_scores_gemma":[0.28221396,0.000555362,0.7150893,0.00026431278,0.00006737833,0.0004599307,0.000521391,0.00018537321,0.00064303086],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9929069,0.0056146737,0.00021565681,0.0005655246,0.00055947574,0.00013768642],"domain_scores_gemma":[0.94529027,0.049835112,0.0017037231,0.0015433666,0.0012310736,0.0003964079],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015682481,0.0010865368,0.0019544212,0.003222524,0.0010799,0.0014783632,0.0022316575,0.001615612,0.0020410235],"category_scores_gemma":[0.06258542,0.0010594547,0.0016509066,0.0026116464,0.0014854373,0.0024813465,0.002874989,0.0025303434,0.00035277344],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014930095,0.0001295038,0.007972664,0.00025632803,0.00042751193,0.00026665287,0.00045332004,0.749392,0.0008192224,0.10858853,0.0015190765,0.13002595],"study_design_scores_gemma":[0.000018993538,0.000020767107,0.0002640511,0.000021008416,0.00001525909,0.0000177662,0.000026519392,0.945356,0.00016643746,0.053737484,0.00034686114,0.000008810681],"about_ca_topic_score_codex":0.0050175684,"about_ca_topic_score_gemma":0.00615103,"teacher_disagreement_score":0.015682481,"about_ca_system_score_codex":0.0010206306,"about_ca_system_score_gemma":0.0025704023,"threshold_uncertainty_score":0.08293784},"labels":[],"label_agreement":null},{"id":"W2731112398","doi":"10.1016/j.jclinepi.2017.02.020","title":"Quasi-experimental study designs series—paper 1: introduction: two historical lineages","year":2017,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":74,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Causal inference; Counterfactual conditional; Computer science; Inference; Contrast (vision); Management science; Data science; Clinical study design; Operations research; Clinical trial; Medicine; Psychology; Econometrics; Counterfactual thinking; Artificial intelligence; Mathematics; Social psychology; Engineering","score_opus":0.6842402606492697,"score_gpt":0.6275217179570611,"score_spread":0.05671854269220855,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2731112398","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00984244,0.05747211,0.70706224,0.16288199,0.021745663,0.0019533047,0.0020439678,0.00030282835,0.036695372],"genre_scores_gemma":[0.1667992,0.039306708,0.6250391,0.06566359,0.034728844,0.0142626725,0.0012441823,0.00057556067,0.052380152],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8828128,0.097424835,0.0045699235,0.0059761754,0.008554442,0.00066192704],"domain_scores_gemma":[0.5699055,0.36981082,0.00840187,0.032980327,0.016791036,0.0021104407],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19563445,0.0009159205,0.0018996196,0.001931767,0.0017432211,0.0032972174,0.002871041,0.0052524623,0.015353442],"category_scores_gemma":[0.28375715,0.0014578196,0.0014775441,0.0018482368,0.011410757,0.007441248,0.0034848927,0.008449437,0.0020916427],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036087603,0.00008114424,0.00090122997,0.00079553947,0.00008627896,0.00006240685,0.00065078936,0.0004256498,0.000171841,0.91756123,0.01862882,0.060274128],"study_design_scores_gemma":[0.0007099643,0.0004946903,0.0019024778,0.0015699919,0.00014167323,0.0005186384,0.00021214718,0.0032500923,0.0010223914,0.77524596,0.21485125,0.00008065049],"about_ca_topic_score_codex":0.0010258026,"about_ca_topic_score_gemma":0.00081319263,"teacher_disagreement_score":0.8043655,"about_ca_system_score_codex":0.0040606717,"about_ca_system_score_gemma":0.004407411,"threshold_uncertainty_score":0.9919259},"labels":[],"label_agreement":null},{"id":"W2732843100","doi":"10.1136/bmjopen-2017-016018","title":"Methods, applications, interpretations and challenges of interrupted time series (ITS) data: protocol for a scoping review","year":2017,"lang":"en","type":"review","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; St. Michael's Hospital; University of Toronto; McMaster University; Impact","funders":"","keywords":"Medicine; Data science; Psychological intervention; Protocol (science); Interrupted Time Series Analysis; Transparency (behavior); Interrupted time series; Intervention (counseling); Outcome (game theory); MEDLINE; Research design; Data collection; Computer science; Data mining; Alternative medicine; Pathology; Statistics","score_opus":0.8927701739897943,"score_gpt":0.7420679777621761,"score_spread":0.15070219622761816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2732843100","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00024144276,0.0010071774,0.0053833206,0.0010433843,0.0005976965,0.98709434,0.0034405575,0.00013744405,0.0010546264],"genre_scores_gemma":[0.00019006892,0.0004315077,0.008034888,0.0001603881,0.000029326658,0.99066645,0.00028584365,0.000012120562,0.00018934072],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.78687006,0.12015856,0.06520856,0.008231492,0.015538062,0.003993238],"domain_scores_gemma":[0.649885,0.17225389,0.04232065,0.03290962,0.09698692,0.0056439075],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2795868,0.00586329,0.010657421,0.02257616,0.006350405,0.0105837425,0.007219402,0.013465355,0.0720581],"category_scores_gemma":[0.3645171,0.0064529646,0.013758416,0.020819305,0.0075709075,0.010469955,0.0094637545,0.011694039,0.020951893],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0071099335,0.00068100606,0.0013665777,0.64436233,0.0016332335,0.0012775296,0.012614106,0.0032595168,0.00256856,0.026694976,0.16103017,0.13740201],"study_design_scores_gemma":[0.011215418,0.0015244328,0.0035548948,0.44812554,0.0019962299,0.00064755685,0.0048198053,0.0025769076,0.002922603,0.034976795,0.4870088,0.0006310119],"about_ca_topic_score_codex":0.0035881177,"about_ca_topic_score_gemma":0.006033019,"teacher_disagreement_score":0.7204132,"about_ca_system_score_codex":0.014507656,"about_ca_system_score_gemma":0.08834853,"threshold_uncertainty_score":0.88839775},"labels":[],"label_agreement":null},{"id":"W2736383080","doi":"10.1177/0962280217715487","title":"A model averaging approach for estimating propensity scores by optimizing balance","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Propensity score matching; Covariate; Estimator; Statistics; Statistic; Nonparametric statistics; Inverse probability weighting; Causal inference; Weighting; Mathematics; Parametric statistics; Econometrics; Parametric model; Computer science; Medicine","score_opus":0.6341758442076512,"score_gpt":0.6615234680562492,"score_spread":0.027347623848598013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2736383080","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001329835,0.00011492777,0.9980987,0.0000758944,0.000014283711,0.000022677024,0.00002546927,0.00008269005,0.00023556338],"genre_scores_gemma":[0.14400944,0.0007843263,0.8516718,0.00024990828,0.00018768439,0.00061208504,0.00038255972,0.00016376963,0.0019383752],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9928318,0.0048425756,0.00032156793,0.00085397187,0.0009509057,0.00019911957],"domain_scores_gemma":[0.99503714,0.0031648849,0.0005245389,0.000630468,0.00054687803,0.00009613337],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011603825,0.0012951493,0.0020671752,0.001953918,0.0006867733,0.0013268631,0.0018430207,0.0012503541,0.0030144076],"category_scores_gemma":[0.0228576,0.0008166646,0.0023565188,0.0028340805,0.00095200766,0.00215489,0.0020371121,0.001935811,0.0005143297],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012323471,0.00011005637,0.0035476068,0.0002643085,0.00076371315,0.00015657952,0.0002555373,0.54207593,0.0020917829,0.16946231,0.003448882,0.2777],"study_design_scores_gemma":[0.00004225546,0.00015341329,0.00095552317,0.000036294434,0.00013314547,0.00010749626,0.00002168755,0.9065355,0.0008915012,0.08679685,0.004287022,0.000039379356],"about_ca_topic_score_codex":0.003321951,"about_ca_topic_score_gemma":0.0024985704,"teacher_disagreement_score":0.011603825,"about_ca_system_score_codex":0.0010014385,"about_ca_system_score_gemma":0.0022789282,"threshold_uncertainty_score":0.06136757},"labels":[],"label_agreement":null},{"id":"W2740759698","doi":"","title":"Deep IV: a flexible approach for counterfactual prediction","year":2017,"lang":"en","type":"article","venue":"Research Explorer (The University of Manchester)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":154,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Counterfactual thinking; Artificial intelligence; Computer science; Machine learning; Deep learning; Artificial neural network; Conditional independence; Function (biology); Outcome (game theory); Mathematics","score_opus":0.43680739955367165,"score_gpt":0.43826711998452905,"score_spread":0.001459720430857403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2740759698","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003203116,0.00020547472,0.9943808,0.00059746765,0.000046645426,0.00004192106,0.0001708611,0.00030372842,0.0010499998],"genre_scores_gemma":[0.47351813,0.00077184214,0.5160892,0.0009687534,0.00026389887,0.0006466503,0.00080026843,0.00026970054,0.006671531],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99677724,0.0019592873,0.00014705062,0.00044270264,0.00048402496,0.00018968],"domain_scores_gemma":[0.98713034,0.00946702,0.0010000848,0.001588367,0.0005277898,0.0002863171],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010611677,0.0011823282,0.0015469181,0.0012045079,0.00053749816,0.0020707056,0.0036487873,0.0020348208,0.0074127153],"category_scores_gemma":[0.030618297,0.0011294575,0.0012569807,0.0011839669,0.0019977554,0.003580801,0.0038474693,0.0055426243,0.0007419865],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002275062,0.000116179624,0.0032811966,0.00016269542,0.0002732463,0.00015331047,0.00015858425,0.5502654,0.0008028287,0.31163272,0.004195848,0.1287306],"study_design_scores_gemma":[0.000022537197,0.00002096153,0.00016164445,0.000030409858,0.00001846563,0.00001337936,0.000008554269,0.79819065,0.000299026,0.20004562,0.0011789664,0.000009723478],"about_ca_topic_score_codex":0.0051667434,"about_ca_topic_score_gemma":0.0066132527,"teacher_disagreement_score":0.010611677,"about_ca_system_score_codex":0.0022050468,"about_ca_system_score_gemma":0.0025977793,"threshold_uncertainty_score":0.056120634},"labels":[],"label_agreement":null},{"id":"W2742688241","doi":"10.3389/feduc.2017.00039","title":"Is Difference in Measurement Outcome between Groups Differential Responding, Bias or Disparity? A Methodology for Detecting Bias and Impact from an Attributional Stance","year":2017,"lang":"en","type":"article","venue":"Frontiers in Education","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Propensity score matching; Matching (statistics); Differential (mechanical device); Outcome (game theory); Confounding; Test (biology); Covariate; Psychology; Selection bias; Closing (real estate); Differential effects; Differential item functioning; Computer science; Econometrics; Cognitive psychology; Social psychology; Applied psychology; Statistics; Psychometrics; Mathematics; Engineering; Developmental psychology; Political science; Item response theory","score_opus":0.5655473824026596,"score_gpt":0.5239767990681791,"score_spread":0.04157058333448049,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2742688241","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033362128,0.0021561484,0.92639434,0.017828668,0.0013440696,0.0011872244,0.00051560544,0.00024793437,0.016963877],"genre_scores_gemma":[0.6022624,0.0011569872,0.3802456,0.0060889707,0.00144128,0.0054667713,0.00034701754,0.00016853098,0.002822429],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.76006764,0.17739403,0.013200439,0.015335051,0.031706303,0.0022964366],"domain_scores_gemma":[0.5266312,0.35069826,0.034197986,0.0718723,0.01537293,0.0012274055],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25161138,0.0011468782,0.0023171876,0.0045331568,0.0027114581,0.0060068774,0.004250252,0.003096345,0.00702292],"category_scores_gemma":[0.5772631,0.0008303955,0.0028025352,0.005038271,0.02156578,0.010587513,0.0078351665,0.006534267,0.00090577354],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003126638,0.00014093009,0.031619556,0.0011101344,0.000905516,0.0002069021,0.009367747,0.0016756121,0.0009060243,0.83522224,0.003831184,0.114701554],"study_design_scores_gemma":[0.00009251907,0.00033494545,0.01716196,0.0009564981,0.00034496712,0.00039066453,0.00205423,0.005539317,0.002314625,0.95745885,0.013223033,0.00012827605],"about_ca_topic_score_codex":0.0015985195,"about_ca_topic_score_gemma":0.0011824116,"teacher_disagreement_score":0.74838865,"about_ca_system_score_codex":0.0029773193,"about_ca_system_score_gemma":0.0035369615,"threshold_uncertainty_score":0.9228964},"labels":[],"label_agreement":null},{"id":"W2745473302","doi":"10.1177/0962280217726800","title":"Adjustment for time-dependent unmeasured confounders in marginal structural Cox models using validation sample data","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Marginal structural model; Confounding; Proportional hazards model; Econometrics; Statistics; Computer science; Sample (material); Sample size determination; Marginal model; Mathematics; Regression analysis; Chemistry","score_opus":0.7887223164067655,"score_gpt":0.7025856314109221,"score_spread":0.08613668499584337,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2745473302","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012495008,0.00035005505,0.9861172,0.0004034136,0.000041225012,0.000090819194,0.0001256626,0.00019237795,0.00018422565],"genre_scores_gemma":[0.48040888,0.00091463205,0.51449805,0.0005531754,0.00019844697,0.001029636,0.0010044348,0.00018223524,0.0012105709],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9757446,0.021054987,0.0005509732,0.0012824262,0.0009955688,0.00037145958],"domain_scores_gemma":[0.86268127,0.11427339,0.006353203,0.013216202,0.0027767743,0.000699219],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06590363,0.0010501122,0.0017605351,0.0012919762,0.00074322283,0.0013670393,0.0037182432,0.001395947,0.002470191],"category_scores_gemma":[0.15148821,0.0008851869,0.0033466902,0.0014064749,0.0016229245,0.0022508705,0.0025133397,0.0030380548,0.0003277386],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017394102,0.00030464618,0.070226155,0.0009435983,0.0032561605,0.00062861777,0.0011941926,0.40494373,0.0016491067,0.2683575,0.005267719,0.24148914],"study_design_scores_gemma":[0.00028344535,0.00031858622,0.004854546,0.00017847563,0.00045785174,0.0001894345,0.00009281119,0.7981195,0.0012772905,0.19086225,0.003296773,0.00006899405],"about_ca_topic_score_codex":0.004580125,"about_ca_topic_score_gemma":0.0052315504,"teacher_disagreement_score":0.06590363,"about_ca_system_score_codex":0.00095896266,"about_ca_system_score_gemma":0.003270087,"threshold_uncertainty_score":0.34853584},"labels":[],"label_agreement":null},{"id":"W2745537878","doi":"","title":"Power Analysis for a Proposed Group Randomized Control Trial (GRCT) on the Road to Mental Readiness (R2MP) Program","year":2014,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Intraclass correlation; Mental health; Data collection; Statistical power; Sample size determination; Randomized controlled trial; Sample (material); Population; Psychology; Test (biology); Statistics; Control (management); Applied psychology; Medicine; Computer science; Mathematics; Environmental health; Psychiatry; Psychometrics; Artificial intelligence","score_opus":0.06832250445262944,"score_gpt":0.40222322890821416,"score_spread":0.3339007244555847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2745537878","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09704522,0.0026457282,0.5827643,0.004960175,0.0051239403,0.2858701,0.0038784277,0.0017378716,0.015974205],"genre_scores_gemma":[0.35508624,0.00024565202,0.2725856,0.0016688056,0.00029379773,0.36677945,0.00081189966,0.00019353552,0.0023350976],"study_design_codex":"randomized_trial","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.54723674,0.39185706,0.01729559,0.017506508,0.02304682,0.0030573115],"domain_scores_gemma":[0.4782333,0.44866866,0.019665033,0.037012614,0.014335854,0.0020844599],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.37591356,0.0023676914,0.0068039633,0.0024934786,0.0016520356,0.0023654453,0.0030740513,0.0065590744,0.020892706],"category_scores_gemma":[0.6018942,0.0012674098,0.010540503,0.0028449774,0.00399353,0.0050369594,0.002760371,0.0063872915,0.0016150429],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.352257,0.008126335,0.027764622,0.026074577,0.05359953,0.0010411842,0.0040467037,0.037581224,0.006029835,0.16638297,0.04170842,0.2753876],"study_design_scores_gemma":[0.3139623,0.110697515,0.050008513,0.0074903797,0.046685,0.0009441319,0.0009670838,0.25396237,0.011845451,0.13756186,0.065174535,0.00070088997],"about_ca_topic_score_codex":0.0010861027,"about_ca_topic_score_gemma":0.0007370597,"teacher_disagreement_score":0.62408644,"about_ca_system_score_codex":0.00274838,"about_ca_system_score_gemma":0.0055983416,"threshold_uncertainty_score":0.7696097},"labels":[],"label_agreement":null},{"id":"W2751885691","doi":"10.1177/0962280217729844","title":"Bayesian sensitivity analysis for unmeasured confounding in causal mediation analysis","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Bayesian probability; Causal inference; Sensitivity (control systems); Mediation; Econometrics; Causal analysis; Statistics; Causal model; Computer science; Psychology; Mathematics; Sociology","score_opus":0.4857710251652698,"score_gpt":0.6844394513291232,"score_spread":0.19866842616385338,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2751885691","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024697483,0.0009400544,0.9932161,0.00075937004,0.00008957747,0.00033347134,0.00019650153,0.00011184036,0.0018832806],"genre_scores_gemma":[0.2753888,0.0034253371,0.7108998,0.0014230622,0.00052128936,0.0047510876,0.0005600341,0.00027796914,0.0027526428],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89367896,0.09476661,0.0021498702,0.003461805,0.0049955524,0.0009472008],"domain_scores_gemma":[0.6193834,0.3574319,0.006703099,0.010876468,0.004879376,0.00072572875],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13144606,0.002209342,0.0040146494,0.0055249664,0.0017189132,0.003407768,0.004231073,0.0037366764,0.009534465],"category_scores_gemma":[0.35254908,0.0016706932,0.005238129,0.0040042526,0.004222714,0.0057717552,0.006162248,0.007411821,0.00064168696],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029984076,0.0001068872,0.004264975,0.0012105401,0.0016752133,0.00044578512,0.0007106072,0.16503508,0.00049145933,0.765398,0.004130489,0.0562311],"study_design_scores_gemma":[0.00012127119,0.0000969607,0.0010078015,0.00036000286,0.00039509987,0.00017061316,0.000089589106,0.2596416,0.0004291399,0.732055,0.005548708,0.00008430425],"about_ca_topic_score_codex":0.006008179,"about_ca_topic_score_gemma":0.003746597,"teacher_disagreement_score":0.13144606,"about_ca_system_score_codex":0.004391738,"about_ca_system_score_gemma":0.0047467784,"threshold_uncertainty_score":0.6951615},"labels":[],"label_agreement":null},{"id":"W2752219857","doi":"10.1007/s10729-017-9415-5","title":"Population-level intervention and information collection in dynamic healthcare policy","year":2017,"lang":"en","type":"article","venue":"Health Care Management Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Centers for Disease Control and Prevention","keywords":"Health informatics; Health administration; Health care; Markov decision process; Population; Actuarial science; Health policy; Computer science; Intervention (counseling); Medicine; Econometrics; Partially observable Markov decision process; Markov process; Public health; Mathematical optimization; Mathematics; Statistics; Economics; Environmental health; Nursing","score_opus":0.09169459837060301,"score_gpt":0.48229282230643256,"score_spread":0.39059822393582955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2752219857","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009978446,0.00039648596,0.98075986,0.0034915444,0.000070583956,0.00031442576,0.0002806652,0.000100808866,0.004607075],"genre_scores_gemma":[0.6696629,0.0016516026,0.3176988,0.0011910765,0.00032250636,0.0020214575,0.00035211816,0.00008256292,0.0070169955],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9863064,0.0098559875,0.0003844911,0.0017599175,0.00085168437,0.000841528],"domain_scores_gemma":[0.96436685,0.03095505,0.0025376114,0.0008554777,0.00072141574,0.00056358136],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0175202,0.0016281853,0.003499449,0.0017126405,0.0010161714,0.0030964597,0.0033684338,0.0041268542,0.0093540205],"category_scores_gemma":[0.047025748,0.0017773584,0.0017051914,0.0019379568,0.0043725753,0.0051027783,0.0026096038,0.0041047977,0.0005708772],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010246913,0.00014180389,0.0007526252,0.00019123864,0.00010094574,0.00011665605,0.00013984315,0.4951622,0.0003561986,0.49117598,0.00079182425,0.010968295],"study_design_scores_gemma":[0.00012685664,0.00016971893,0.00037929544,0.000061528124,0.00004450442,0.00004069201,0.000053913966,0.535061,0.00028751933,0.46149868,0.0022349744,0.000041372015],"about_ca_topic_score_codex":0.006294917,"about_ca_topic_score_gemma":0.004008334,"teacher_disagreement_score":0.0175202,"about_ca_system_score_codex":0.006306142,"about_ca_system_score_gemma":0.007023499,"threshold_uncertainty_score":0.09265679},"labels":[],"label_agreement":null},{"id":"W275349574","doi":"10.1007/978-1-4614-7428-9_3","title":"Statistical Reinforcement Learning","year":2013,"lang":"en","type":"book-chapter","venue":"Statistics in the health sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Reinforcement learning; Computer science; Artificial intelligence; Sequence (biology); Machine learning; Reinforcement; Engineering","score_opus":0.22600644500450368,"score_gpt":0.46972514238981633,"score_spread":0.24371869738531265,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W275349574","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015395836,0.015419537,0.8926371,0.0026694888,0.00092050165,0.000041863866,0.00030592343,0.0010018977,0.085464194],"genre_scores_gemma":[0.176416,0.03265905,0.504004,0.0023678124,0.002869494,0.00046305807,0.0016782077,0.0012783383,0.27826414],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99966073,0.00010948257,0.000014874534,0.00007860746,0.00011944476,0.000016851938],"domain_scores_gemma":[0.99893886,0.00079369446,0.000029290255,0.00010262838,0.00010641296,0.000029114775],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009427421,0.00094795856,0.0008566753,0.0005836739,0.00029202498,0.0013196686,0.0009355525,0.00088494574,0.01524709],"category_scores_gemma":[0.0032875019,0.0003687998,0.00044558442,0.0010108448,0.0011888852,0.001226879,0.0007690705,0.0026940703,0.005115872],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024515935,0.00007597693,0.00022302032,0.00024621267,0.00004851189,0.000050720504,0.00008544719,0.040270064,0.0007988131,0.5227569,0.07836745,0.35705248],"study_design_scores_gemma":[0.000011326013,0.000029574809,0.0002516132,0.000114577226,0.00001541847,0.00007644429,0.000018024866,0.09736302,0.0007832502,0.7906008,0.110711806,0.000024141567],"about_ca_topic_score_codex":0.0014671484,"about_ca_topic_score_gemma":0.0022533692,"teacher_disagreement_score":0.01524709,"about_ca_system_score_codex":0.0009836063,"about_ca_system_score_gemma":0.0009138928,"threshold_uncertainty_score":0.051006556},"labels":[],"label_agreement":null},{"id":"W2760941800","doi":"10.1002/pds.4325","title":"Comparison of the ability of double‐robust estimators to correct bias in propensity score matching analysis. <scp>A M</scp>onte <scp>C</scp>arlo simulation study","year":2017,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hamilton Health Sciences; McMaster University; Population Health Research Institute","funders":"","keywords":"Propensity score matching; Covariate; Confounding; Estimator; Statistics; Matching (statistics); Logistic regression; Econometrics; Observational study; Residual; Mathematics; Average treatment effect; Medicine; Algorithm","score_opus":0.39422076301799786,"score_gpt":0.5000812465376048,"score_spread":0.10586048351960692,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2760941800","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08291289,0.0017916708,0.9120498,0.0005575234,0.00013063983,0.00047306358,0.00029225025,0.0004885128,0.001303635],"genre_scores_gemma":[0.6078243,0.00054715265,0.38921756,0.0002264416,0.00007237246,0.000874508,0.0004240922,0.00015945335,0.0006540905],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9534819,0.041209813,0.0012108111,0.0018189971,0.0018850417,0.0003934373],"domain_scores_gemma":[0.6657483,0.29849216,0.013909155,0.015296686,0.005655166,0.0008984918],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09425223,0.0010598828,0.0014908116,0.0018680177,0.000437265,0.0014084324,0.0019492046,0.0017817316,0.0025083583],"category_scores_gemma":[0.26593626,0.0006694066,0.002324622,0.0014834795,0.0011397462,0.002344235,0.0021011534,0.0012932528,0.00032708593],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00536501,0.0005263846,0.04086815,0.0013700557,0.0046972223,0.0003108502,0.00056608894,0.59741277,0.0018564325,0.08042747,0.0038103422,0.26278922],"study_design_scores_gemma":[0.0006326434,0.0006352964,0.0041255634,0.0001605957,0.00042943118,0.00014996712,0.00005348803,0.9646146,0.0019318948,0.025465509,0.0017379901,0.00006308485],"about_ca_topic_score_codex":0.0028800373,"about_ca_topic_score_gemma":0.0012376203,"teacher_disagreement_score":0.9057478,"about_ca_system_score_codex":0.0012248125,"about_ca_system_score_gemma":0.0017578639,"threshold_uncertainty_score":0.4984594},"labels":[],"label_agreement":null},{"id":"W2766207844","doi":"10.1136/bmj.j4587","title":"Handling time varying confounding in observational research","year":2017,"lang":"en","type":"review","venue":"BMJ","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":346,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of British Columbia","funders":"","keywords":"Confounding; Observational study; Weighting; Marginal structural model; Statistics; Econometrics; Parametric statistics; Inverse probability weighting; Estimation; Causal inference; Medicine; Computer science; Mathematics; Propensity score matching; Engineering","score_opus":0.8963818942939966,"score_gpt":0.6776851293144192,"score_spread":0.21869676497957746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2766207844","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00040555763,0.9193934,0.06716642,0.0090488605,0.0014509879,0.00014953628,0.00015129376,0.00006745008,0.0021665506],"genre_scores_gemma":[0.008762324,0.93743235,0.045990203,0.0038157336,0.002783596,0.00044190817,0.00015310348,0.000048388465,0.0005724315],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9440285,0.044698004,0.0027241,0.002061628,0.0061086584,0.0003791717],"domain_scores_gemma":[0.8379079,0.14928001,0.0048539704,0.004130792,0.0034757368,0.00035149688],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06189795,0.0012637737,0.0032009128,0.004645024,0.0008936159,0.0029784872,0.0038299086,0.004973656,0.004718808],"category_scores_gemma":[0.14098205,0.0007353167,0.0036652612,0.007957282,0.005055876,0.0042476715,0.0034014648,0.005678431,0.0015767291],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008720256,0.000048283233,0.0012191114,0.036167767,0.0014930442,0.0001479795,0.00067702285,0.0022065933,0.00013692446,0.13781889,0.016714463,0.8032827],"study_design_scores_gemma":[0.00015922937,0.00016466156,0.0035702595,0.051807873,0.001356472,0.0012586247,0.0004138802,0.002718173,0.0004498983,0.60163856,0.3363289,0.00013346047],"about_ca_topic_score_codex":0.0038753024,"about_ca_topic_score_gemma":0.0035074279,"teacher_disagreement_score":0.93810207,"about_ca_system_score_codex":0.002296924,"about_ca_system_score_gemma":0.007384914,"threshold_uncertainty_score":0.32735157},"labels":[],"label_agreement":null},{"id":"W2766219675","doi":"10.1002/sim.7527","title":"Collaborative targeted learning using regression shrinkage","year":2017,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Université de Montréal","keywords":"Covariate; Causal inference; Propensity score matching; Estimator; Statistics; Regression; Regression analysis; Inference; Computer science; Stepwise regression; Mean squared error; Model selection; Outcome (game theory); Econometrics; Mathematics; Artificial intelligence","score_opus":0.11734741745116913,"score_gpt":0.4830962113690352,"score_spread":0.3657487939178661,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2766219675","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041919677,0.00011239319,0.994827,0.00016529742,0.000015387788,0.000044293953,0.000027819131,0.00020231411,0.0004135144],"genre_scores_gemma":[0.42744938,0.0005461033,0.5663723,0.0005946813,0.00019626589,0.0007871857,0.00047583197,0.00018346153,0.0033947672],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994111,0.0037989526,0.0002501636,0.00081649894,0.0007785208,0.0002449131],"domain_scores_gemma":[0.97129244,0.023069518,0.0013589837,0.0025465605,0.0014007158,0.000331811],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012519174,0.0012159772,0.002591243,0.0014622249,0.0006373856,0.001326297,0.0027924068,0.0018456973,0.0026737473],"category_scores_gemma":[0.045459352,0.0008906438,0.0017998462,0.0014900245,0.001661999,0.0021143458,0.0035215975,0.002635943,0.0006716912],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027610004,0.00017440849,0.003977405,0.00024354381,0.0003035618,0.00021196334,0.00025902045,0.71141034,0.0016482292,0.08624688,0.0032996996,0.1919488],"study_design_scores_gemma":[0.000042657895,0.000050219256,0.00019703942,0.000018570672,0.000026018148,0.000026186874,0.0000097768125,0.96500236,0.00052780844,0.033476878,0.0006136841,0.000008824043],"about_ca_topic_score_codex":0.0030087996,"about_ca_topic_score_gemma":0.0031987578,"teacher_disagreement_score":0.012519174,"about_ca_system_score_codex":0.0011313069,"about_ca_system_score_gemma":0.0021582157,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W2766434410","doi":"10.1002/sim.7522","title":"Weighted estimation for confounded binary outcomes subject to misclassification","year":2017,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Institute of Population and Public Health; University of Ottawa","funders":"","keywords":"Covariate; Estimator; Statistics; Logistic regression; Confounding; Computer science; Estimation; Inverse probability; Econometrics; Inverse probability weighting; Consistency (knowledge bases); Identification (biology); Mathematics; Artificial intelligence; Posterior probability","score_opus":0.19441443568362424,"score_gpt":0.500652691376323,"score_spread":0.3062382556926987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2766434410","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047178743,0.0002752085,0.99426335,0.00015432778,0.000041483592,0.00007511307,0.000075943564,0.00007945159,0.00031720893],"genre_scores_gemma":[0.20456441,0.0009835096,0.78989214,0.00045627652,0.00018588672,0.00095159066,0.00074988505,0.00011172391,0.0021045362],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9837286,0.011059581,0.0008953827,0.0021357762,0.0018089074,0.0003718163],"domain_scores_gemma":[0.9492394,0.03868092,0.003629277,0.0063361423,0.0018947155,0.00021950509],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03513706,0.0010486506,0.0019387688,0.0024950563,0.0004942969,0.0017052678,0.003452485,0.001986597,0.0031022027],"category_scores_gemma":[0.15084349,0.0008042077,0.0019817925,0.0026524856,0.0014185072,0.0027165636,0.0022942405,0.0022269546,0.00044533153],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026810754,0.00020474396,0.017549343,0.00079173123,0.0013741428,0.00042475102,0.0007823051,0.13162714,0.0020566883,0.585344,0.0031434968,0.25643358],"study_design_scores_gemma":[0.000092324226,0.00013615156,0.0037021216,0.00026065382,0.00030761186,0.00028121623,0.00010349945,0.34536955,0.0015703975,0.6400019,0.008122146,0.00005237319],"about_ca_topic_score_codex":0.002268892,"about_ca_topic_score_gemma":0.001853879,"teacher_disagreement_score":0.03513706,"about_ca_system_score_codex":0.00082732196,"about_ca_system_score_gemma":0.0012872762,"threshold_uncertainty_score":0.18582475},"labels":[],"label_agreement":null},{"id":"W2772202324","doi":"10.1177/0962280217743777","title":"Causal inference with measurement error in outcomes: Bias analysis and estimation methods","year":2017,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; University of Waterloo","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Observational error; Statistics; Outcome (game theory); Weighting; Inverse probability weighting; Inference; Causal inference; Errors-in-variables models; Computer science; Econometrics; Estimation; Statistical inference; Mathematics; Artificial intelligence","score_opus":0.738761936625469,"score_gpt":0.7244365658423263,"score_spread":0.014325370783142666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2772202324","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00089909707,0.0007132318,0.9974547,0.00042041848,0.00005602068,0.00007488221,0.00004325567,0.000047165773,0.00029131063],"genre_scores_gemma":[0.1617975,0.00431031,0.8277572,0.0010064478,0.0009514972,0.0018252819,0.00034820172,0.00015643933,0.0018470761],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9052433,0.079697154,0.0026284326,0.0052502668,0.0063864063,0.0007944225],"domain_scores_gemma":[0.6984421,0.2669937,0.01073981,0.017652793,0.0057025566,0.00046911123],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.111860394,0.0021472424,0.0038259882,0.0052699456,0.001429094,0.0033383807,0.004874305,0.0045965356,0.0032972018],"category_scores_gemma":[0.33588153,0.0013939032,0.0036599839,0.0063410304,0.0052141836,0.0049402798,0.004667078,0.0052570705,0.00066947355],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000966554,0.000087604894,0.005844951,0.0010204929,0.0013032493,0.00023353375,0.00045411108,0.07790352,0.0004842071,0.7632996,0.0021649536,0.14710712],"study_design_scores_gemma":[0.00008569346,0.00007761297,0.0009496335,0.00035898705,0.00029335413,0.00018209164,0.000059493,0.20147963,0.00078589097,0.7910973,0.004570651,0.000059717077],"about_ca_topic_score_codex":0.0028426677,"about_ca_topic_score_gemma":0.0013437126,"teacher_disagreement_score":0.8881396,"about_ca_system_score_codex":0.0022918994,"about_ca_system_score_gemma":0.00377221,"threshold_uncertainty_score":0.59158134},"labels":[],"label_agreement":null},{"id":"W2773073055","doi":"10.22374/1710-6222.24.3.6","title":"Development and validation of an index score to adjust for healthy user bias in observational studies","year":2017,"lang":"en","type":"article","venue":"Journal of Population Therapeutics and Clinical Pharmacology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Observational study; Logistic regression; Index (typography); Medicine; Confounding; Cohort; Cohort study; Statistic; Statistics; Vaccination; Internal medicine; Computer science; Mathematics; Immunology","score_opus":0.8034101812282828,"score_gpt":0.641222978353865,"score_spread":0.1621872028744178,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2773073055","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15540436,0.001117775,0.8336889,0.0010839045,0.00035043532,0.002360248,0.0019331985,0.0007673042,0.003293849],"genre_scores_gemma":[0.4628294,0.00031956876,0.53200835,0.00031222135,0.0001848719,0.0024317228,0.0014292955,0.0001164921,0.00036801054],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9139597,0.06499782,0.0072701694,0.0030452784,0.010134488,0.00059247424],"domain_scores_gemma":[0.68972474,0.23987742,0.020315787,0.02228194,0.025944304,0.0018558447],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1506191,0.0011409171,0.0015217208,0.006678715,0.00075873546,0.0026489862,0.0021175758,0.001268374,0.0016533871],"category_scores_gemma":[0.30625483,0.0005249537,0.0029337646,0.005006314,0.0013736731,0.0019096741,0.0029624782,0.0018105394,0.00037073297],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010776019,0.00030713103,0.695223,0.00067250483,0.0037375796,0.00011451536,0.0007042572,0.01936495,0.0010405777,0.011009473,0.0044236886,0.26232466],"study_design_scores_gemma":[0.0007451082,0.002920138,0.4765054,0.00075518363,0.002077523,0.00069041754,0.00046292535,0.45866567,0.0052485014,0.040322747,0.011378427,0.00022792189],"about_ca_topic_score_codex":0.0014523,"about_ca_topic_score_gemma":0.0014763218,"teacher_disagreement_score":0.8493809,"about_ca_system_score_codex":0.001369842,"about_ca_system_score_gemma":0.00286975,"threshold_uncertainty_score":0.79655945},"labels":[],"label_agreement":null},{"id":"W2778295401","doi":"10.1177/0098858817723659","title":"Statistics, Adjusted Statistics, and Maladjusted Statistics","year":2017,"lang":"en","type":"article","venue":"American Journal of Law & Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":72,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Health Canada","funders":"","keywords":"Mistake; Statistics; The Imaginary; Statistical inference; Psychology; Econometrics; Economics; Law; Mathematics; Political science","score_opus":0.10561203037843124,"score_gpt":0.4254545307045736,"score_spread":0.31984250032614236,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2778295401","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016616944,0.010546047,0.92082834,0.010405627,0.006299726,0.0010509224,0.009282495,0.0029516378,0.02201828],"genre_scores_gemma":[0.41284442,0.007023483,0.54522216,0.006751668,0.0056417086,0.0058898614,0.005439953,0.003408322,0.0077784183],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84547955,0.10702917,0.010476408,0.0140164625,0.0212518,0.0017466883],"domain_scores_gemma":[0.48421073,0.41115695,0.029493919,0.057939593,0.015726408,0.0014723933],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06889858,0.0017798243,0.0020310024,0.008520974,0.0016057672,0.0052339262,0.003925008,0.002684424,0.019189745],"category_scores_gemma":[0.4961239,0.0009624339,0.0026964443,0.01520954,0.009666737,0.008582616,0.003705749,0.009155108,0.003541391],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00082836195,0.00012213517,0.026291702,0.0032946712,0.0023987077,0.00076156843,0.0025396799,0.00796358,0.0007138285,0.60967654,0.10326839,0.24214081],"study_design_scores_gemma":[0.000103517894,0.00039506654,0.012350522,0.0011534509,0.00064546836,0.001013103,0.001160983,0.019326027,0.0012517194,0.78419673,0.17815289,0.0002506346],"about_ca_topic_score_codex":0.0020668337,"about_ca_topic_score_gemma":0.0018263785,"teacher_disagreement_score":0.93110144,"about_ca_system_score_codex":0.0021468776,"about_ca_system_score_gemma":0.0037106008,"threshold_uncertainty_score":0.36437488},"labels":[],"label_agreement":null},{"id":"W2785275695","doi":"10.1016/j.cjca.2018.01.013","title":"Accounting for Selection Bias in Studies of Acute Cardiac Events","year":2018,"lang":"en","type":"article","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Censoring (clinical trials); Selection bias; Statistics; Confidence interval; Dyslipidemia; Demography; Internal medicine; Disease; Mathematics","score_opus":0.22038827112810347,"score_gpt":0.43670359222566657,"score_spread":0.2163153210975631,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2785275695","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055163387,0.02629849,0.893653,0.015154733,0.001795989,0.001082425,0.0015794758,0.0006342803,0.004638196],"genre_scores_gemma":[0.7782425,0.0053854045,0.20110685,0.005052798,0.00237652,0.0019796705,0.0010391102,0.00020602137,0.004611101],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7120101,0.2536984,0.015158231,0.011480419,0.005600248,0.002052608],"domain_scores_gemma":[0.20969237,0.73935187,0.020211957,0.026543094,0.0032519875,0.00094867445],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2678354,0.0021022453,0.0048687505,0.004337981,0.0016808921,0.0042286813,0.005702094,0.0050559524,0.008364523],"category_scores_gemma":[0.55885476,0.0023065764,0.007981608,0.005728109,0.0035272678,0.005096674,0.0048383675,0.005042889,0.0005417965],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005104236,0.0004038324,0.206723,0.0093626045,0.062599614,0.003616599,0.0036443837,0.05073672,0.00086478784,0.38995498,0.013827687,0.2531616],"study_design_scores_gemma":[0.0016058334,0.0005572741,0.01690264,0.0014245943,0.017668676,0.0010981379,0.0004744214,0.097031265,0.0009324959,0.8518963,0.010298511,0.00011000326],"about_ca_topic_score_codex":0.0071392227,"about_ca_topic_score_gemma":0.0065018567,"teacher_disagreement_score":0.7321646,"about_ca_system_score_codex":0.0017735738,"about_ca_system_score_gemma":0.0054105786,"threshold_uncertainty_score":0.9028893},"labels":[],"label_agreement":null},{"id":"W2789124538","doi":"10.1016/j.rdc.2018.01.001","title":"Alternative Design and Analytical Techniques for Longitudinal Rheumatology Studies","year":2018,"lang":"en","type":"review","venue":"Rheumatic Disease Clinics of North America","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Manitoba","funders":"","keywords":"Medicine; Covariate; Longitudinal data; Accrual; Missing data; Longitudinal study; Clinical study design; Research design; Data collection; Cohort study; Statistical power; Cohort; Statistics; Medical physics; Clinical trial; Data mining; Internal medicine; Computer science","score_opus":0.3730737574498898,"score_gpt":0.5254522191495213,"score_spread":0.15237846169963154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2789124538","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005993582,0.8401953,0.1536193,0.002960632,0.0008122218,0.00011494823,0.00028350842,0.000104132865,0.0013105877],"genre_scores_gemma":[0.02762932,0.7791858,0.18517557,0.002360841,0.0029819729,0.00096655963,0.0004337973,0.00007530047,0.0011908523],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97407454,0.021313682,0.0012762207,0.0011955764,0.001980251,0.00015972037],"domain_scores_gemma":[0.7954924,0.19568448,0.0028103618,0.0033806195,0.0023640252,0.00026813932],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.040457394,0.0019647914,0.0045594214,0.0041941605,0.0005322744,0.002563531,0.0043977303,0.003425615,0.008538645],"category_scores_gemma":[0.103649445,0.0009376152,0.003834776,0.0054803453,0.0025941643,0.0026382192,0.0017926072,0.0051693246,0.0010029648],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034472093,0.0001572638,0.0016842933,0.042205177,0.0030795205,0.0002268697,0.00030503367,0.010878677,0.00017977996,0.15766656,0.013257908,0.7700143],"study_design_scores_gemma":[0.0006194598,0.00040793503,0.0027986863,0.023204412,0.003664426,0.0009450403,0.00023770075,0.01772247,0.00049443997,0.8102563,0.13948865,0.0001605204],"about_ca_topic_score_codex":0.002329067,"about_ca_topic_score_gemma":0.0023051177,"teacher_disagreement_score":0.95954263,"about_ca_system_score_codex":0.0014528083,"about_ca_system_score_gemma":0.0045108655,"threshold_uncertainty_score":0.21396172},"labels":[],"label_agreement":null},{"id":"W2789415476","doi":"10.1007/978-981-10-8743-1_17","title":"Open Research and Observational Study for 21st Century Learning","year":2018,"lang":"en","type":"book-chapter","venue":"Lecture notes in educational technology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Athabasca University","funders":"","keywords":"Notice; Formative assessment; Computer science; Observational study; Context (archaeology); Data science; Mathematics education; Psychology; Political science; Mathematics; Statistics","score_opus":0.4145621311745445,"score_gpt":0.5172044997028824,"score_spread":0.10264236852833791,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2789415476","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062600016,0.052799728,0.7959774,0.039038423,0.002286639,0.00015374574,0.00059871277,0.0003695069,0.10251579],"genre_scores_gemma":[0.489609,0.056143433,0.37919858,0.0052774968,0.0063479827,0.0011139899,0.0010010378,0.00038193687,0.060926512],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.98878956,0.008833199,0.00041811535,0.00079506147,0.0010038047,0.0001602978],"domain_scores_gemma":[0.87966967,0.11016527,0.001553023,0.0063448893,0.0015847073,0.00068247924],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.018839085,0.0009009749,0.0011493098,0.0022334591,0.002103423,0.004751924,0.0019838014,0.0031669303,0.014940894],"category_scores_gemma":[0.049367145,0.00077277457,0.00096576737,0.003412771,0.017620586,0.013559025,0.004569921,0.0059579136,0.001248808],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000053299295,0.000012283828,0.0002033212,0.00013452533,0.000007118785,0.00001964516,0.00045857017,0.00024257108,0.00003052828,0.97675985,0.0036246146,0.018501693],"study_design_scores_gemma":[0.000001758612,0.000002343042,0.00011871039,0.00007131919,0.0000028096858,0.000013953402,0.00017565422,0.0005422111,0.000025087085,0.9904392,0.00860361,0.0000034158525],"about_ca_topic_score_codex":0.0024464384,"about_ca_topic_score_gemma":0.003350559,"teacher_disagreement_score":0.9980162,"about_ca_system_score_codex":0.003585888,"about_ca_system_score_gemma":0.0037876249,"threshold_uncertainty_score":0.099631846},"labels":[],"label_agreement":null},{"id":"W2791760629","doi":"10.1093/bjps/axx015","title":"The Confounding Question of Confounding Causes in Randomized Trials","year":2017,"lang":"en","type":"article","venue":"The British Journal for the Philosophy of Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":60,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Canadian Institutes of Health Research; University of Johannesburg; W. Garfield Weston Foundation; Università degli Studi di Genova; University of Toronto; King's College London","keywords":"Confounding; Causal inference; Randomized controlled trial; Ideal (ethics); Randomization; Inference; Balance (ability); Psychology; Medicine; Statistics; Computer science; Mathematics; Philosophy; Epistemology; Internal medicine; Artificial intelligence","score_opus":0.30365044426729587,"score_gpt":0.4922772733783582,"score_spread":0.18862682911106232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2791760629","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006981726,0.027119663,0.8036731,0.12804809,0.004724924,0.0011699413,0.0003610472,0.00025336765,0.027668059],"genre_scores_gemma":[0.47261083,0.018856548,0.40488416,0.07056789,0.015599295,0.006893195,0.00030524796,0.00031293588,0.009969889],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6664827,0.2846481,0.009417089,0.013246514,0.02459547,0.0016102397],"domain_scores_gemma":[0.47657445,0.47388813,0.017354239,0.024299012,0.0069352407,0.00094893086],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24937335,0.0014573046,0.0031483832,0.0029800832,0.003702286,0.0061386507,0.0034349344,0.0069837077,0.009265728],"category_scores_gemma":[0.43944484,0.0015425495,0.003170331,0.0036678258,0.028867338,0.015296065,0.0062742713,0.012906761,0.0011798745],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002037882,0.000021647375,0.0007705775,0.0007140623,0.00017150576,0.00009127436,0.0007827631,0.001071588,0.000091028975,0.97200745,0.0038762707,0.020198038],"study_design_scores_gemma":[0.00016102193,0.00007470818,0.00019494508,0.0004506494,0.00009263048,0.00008846942,0.00009754075,0.0017036445,0.00024858495,0.9825865,0.014282429,0.000018914061],"about_ca_topic_score_codex":0.0015259107,"about_ca_topic_score_gemma":0.0008777213,"teacher_disagreement_score":0.7506267,"about_ca_system_score_codex":0.004986273,"about_ca_system_score_gemma":0.008770789,"threshold_uncertainty_score":0.9256563},"labels":[],"label_agreement":null},{"id":"W2791924225","doi":"10.1002/sim.7615","title":"Assessing the performance of the generalized propensity score for estimating the effect of quantitative or continuous exposures on binary outcomes","year":2018,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":85,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Confounding; Mathematics; Ordinary least squares; Medicine","score_opus":0.215693518484249,"score_gpt":0.4913806844402001,"score_spread":0.2756871659559511,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2791924225","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.102251515,0.0011898255,0.8924076,0.00062188454,0.000069698355,0.0005410864,0.000581627,0.00028603972,0.0020507684],"genre_scores_gemma":[0.49070236,0.0013095593,0.50521857,0.00023675297,0.0000951063,0.0009372741,0.00083358947,0.00019520268,0.00047159696],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9321754,0.059082,0.002059848,0.0026273031,0.003679029,0.00037659853],"domain_scores_gemma":[0.67107356,0.29337218,0.0119911805,0.018121459,0.004803966,0.0006376775],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.100310445,0.0012252225,0.0014141351,0.0035023615,0.00062723015,0.0016515984,0.0013976856,0.0016302787,0.002778472],"category_scores_gemma":[0.32012492,0.00052581384,0.0026960429,0.004267148,0.0019919209,0.0023367738,0.0022196209,0.0015477283,0.00031175508],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016258927,0.00047164888,0.19902515,0.002091007,0.007928977,0.00043297268,0.001756356,0.38145775,0.0025026938,0.12017827,0.004563851,0.27796546],"study_design_scores_gemma":[0.00060255383,0.0022450192,0.087037854,0.00075415114,0.0013726538,0.00063427695,0.00052027224,0.7284478,0.0033573029,0.16633888,0.008441861,0.0002473652],"about_ca_topic_score_codex":0.005430653,"about_ca_topic_score_gemma":0.0039596516,"teacher_disagreement_score":0.89968956,"about_ca_system_score_codex":0.0010992242,"about_ca_system_score_gemma":0.0029491223,"threshold_uncertainty_score":0.5304987},"labels":[],"label_agreement":null},{"id":"W2792390571","doi":"10.1177/0962280218756159","title":"Assessing covariate balance when using the generalized propensity score with quantitative or continuous exposures","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":118,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Covariate; Statistics; Observational study; Logistic regression; Mathematics; Medicine","score_opus":0.7850233477568593,"score_gpt":0.6838532647255835,"score_spread":0.10117008303127584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2792390571","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012176019,0.00040611508,0.98510057,0.00034979073,0.000041710344,0.00028142065,0.00028153183,0.00020392433,0.0011589477],"genre_scores_gemma":[0.24116354,0.0010668703,0.753661,0.00043658225,0.00015662883,0.0013949869,0.0009909732,0.00018147305,0.0009479245],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96406275,0.028130168,0.0018066979,0.00230595,0.003352868,0.0003415748],"domain_scores_gemma":[0.8966837,0.08162999,0.00946182,0.009067093,0.0027650197,0.00039236332],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04939106,0.0010202724,0.00134821,0.0029195591,0.00074104354,0.002218956,0.0012837285,0.0012198554,0.005084946],"category_scores_gemma":[0.19008744,0.00051923876,0.0017490899,0.003340574,0.0020079175,0.0034221606,0.003240511,0.002001496,0.00044940028],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000606958,0.00023958393,0.08360512,0.0015763289,0.0025944002,0.00045130594,0.0016657856,0.15899904,0.0029174606,0.31884354,0.006946823,0.42155358],"study_design_scores_gemma":[0.00025483398,0.0005792576,0.028823946,0.000565997,0.00047968156,0.0004815218,0.00046979883,0.2833111,0.002869125,0.6558675,0.026152749,0.00014443712],"about_ca_topic_score_codex":0.0029426392,"about_ca_topic_score_gemma":0.002722439,"teacher_disagreement_score":0.04939106,"about_ca_system_score_codex":0.0010556153,"about_ca_system_score_gemma":0.0028090829,"threshold_uncertainty_score":0.261208},"labels":[],"label_agreement":null},{"id":"W2792491629","doi":"10.1007/s12561-018-9213-8","title":"Estimation of Causal Effect Measures in the Presence of Measurement Error in Confounders","year":2018,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Estimator; Statistics; Context (archaeology); Odds ratio; Econometrics; Biostatistics; Estimation; Causal inference; Mathematics; Medicine; Epidemiology; Engineering; Geography; Internal medicine","score_opus":0.21513680053283413,"score_gpt":0.4531936732303652,"score_spread":0.23805687269753106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2792491629","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006735734,0.0010518203,0.99047756,0.0008526987,0.00008179683,0.0000671029,0.00013004775,0.000097768774,0.0005055584],"genre_scores_gemma":[0.4329345,0.004153867,0.55663526,0.0008539005,0.0009830537,0.0010210781,0.0007692389,0.00012491143,0.0025241694],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9410753,0.047118455,0.002311138,0.004867392,0.0038303556,0.0007973863],"domain_scores_gemma":[0.5552384,0.41496345,0.009852179,0.01619756,0.0030911877,0.0006571079],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08812229,0.001829097,0.0046694996,0.004069067,0.00091466424,0.0042366576,0.004957468,0.003636645,0.002856519],"category_scores_gemma":[0.3403566,0.0017237294,0.0039033492,0.00453838,0.0049027083,0.0063473308,0.0048858393,0.006474725,0.00033761925],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023492846,0.00018906435,0.008835635,0.00093788735,0.001984436,0.00041438182,0.00055207167,0.059577744,0.00047191928,0.853229,0.001285686,0.07228719],"study_design_scores_gemma":[0.00010303569,0.00009705318,0.0015834939,0.00015756726,0.00049844995,0.00014416102,0.00006163518,0.15032102,0.00051962025,0.84475493,0.001727812,0.000031224437],"about_ca_topic_score_codex":0.003144837,"about_ca_topic_score_gemma":0.0015876937,"teacher_disagreement_score":0.9118777,"about_ca_system_score_codex":0.0020554643,"about_ca_system_score_gemma":0.005058623,"threshold_uncertainty_score":0.4660408},"labels":[],"label_agreement":null},{"id":"W2793831746","doi":"10.1002/pds.4440","title":"Assumptions made when preparing drug exposure data for analysis have an impact on results: <scp>A</scp>n unreported step in pharmacoepidemiology studies","year":2018,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":66,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Medical Research Council; National Institute for Health and Care Research; Canadian Institutes of Health Research; Manchester Biomedical Research Centre; Versus Arthritis; Arthritis Research UK","keywords":"Pharmacoepidemiology; Medicine; Comparability; Observational study; Hazard ratio; Data mining; Confidence interval; Medical prescription; Drug; Consistency (knowledge bases); Hazard; Prescription drug; Statistics; Computer science; Pharmacology; Internal medicine; Mathematics","score_opus":0.3673463826858171,"score_gpt":0.5450930492236101,"score_spread":0.17774666653779303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2793831746","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0716656,0.0024056172,0.87545264,0.026448265,0.0015905071,0.005867597,0.0042807027,0.0025651474,0.009723952],"genre_scores_gemma":[0.22195399,0.00087530876,0.7628983,0.0058133793,0.00035728794,0.005102613,0.001799699,0.00058019056,0.00061923097],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.58342844,0.3185782,0.04469326,0.012606457,0.03884334,0.0018502568],"domain_scores_gemma":[0.13890415,0.7602095,0.04116168,0.04359417,0.015170787,0.0009597349],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3880819,0.0016493613,0.0012365398,0.0031893891,0.0029690699,0.009021111,0.0045445324,0.004012911,0.0038476835],"category_scores_gemma":[0.6854237,0.0021830166,0.003936138,0.004140611,0.005243555,0.0068963296,0.006229511,0.0069505256,0.0014666491],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00514208,0.0009204917,0.19104116,0.009992996,0.0036726664,0.0032527812,0.013391533,0.08053069,0.007369224,0.12850742,0.06400696,0.49217194],"study_design_scores_gemma":[0.0018608745,0.0021307045,0.08816978,0.025341524,0.002775194,0.0034216866,0.0054914732,0.18448067,0.058708142,0.39449367,0.23177351,0.0013527148],"about_ca_topic_score_codex":0.0062358254,"about_ca_topic_score_gemma":0.006149109,"teacher_disagreement_score":0.6119181,"about_ca_system_score_codex":0.007537635,"about_ca_system_score_gemma":0.015840014,"threshold_uncertainty_score":0.754604},"labels":[],"label_agreement":null},{"id":"W2795791984","doi":"10.1016/j.rdc.2018.01.002","title":"Propensity Score Methods for Bias Reduction in Observational Studies of Treatment Effect","year":2018,"lang":"en","type":"review","venue":"Rheumatic Disease Clinics of North America","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":74,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Women's College Hospital; University Health Network; University of Toronto; Toronto General Hospital; Hospital for Sick Children; Public Health Ontario; Toronto Western Hospital; Mount Sinai Hospital","funders":"Canadian Institutes of Health Research","keywords":"Observational study; Propensity score matching; Reduction (mathematics); Statistics; Medicine; Econometrics; Mathematics","score_opus":0.7393426480676626,"score_gpt":0.599232833209911,"score_spread":0.14010981485775154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2795791984","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017191223,0.70122576,0.2907223,0.002687218,0.0007855268,0.0004562151,0.0009929473,0.00026379892,0.0011470537],"genre_scores_gemma":[0.0746727,0.65957403,0.25507468,0.0023786454,0.0027557982,0.0026215028,0.0013345907,0.0001692149,0.0014188825],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9498784,0.041591413,0.0032139558,0.0018104512,0.00326744,0.00023833974],"domain_scores_gemma":[0.8064869,0.18388464,0.0037722066,0.0035235286,0.0021064081,0.00022630129],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05528791,0.0019619192,0.0069788084,0.0043810466,0.00042571267,0.0023858456,0.0034444733,0.0024302353,0.0074005686],"category_scores_gemma":[0.15116508,0.0009983866,0.009006203,0.005481138,0.0014758672,0.0023385845,0.0020029852,0.0051889597,0.00080006226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051093684,0.0001258058,0.0032303336,0.06957602,0.023560505,0.00011617417,0.00027018157,0.011252028,0.00017385607,0.062199958,0.009850209,0.819134],"study_design_scores_gemma":[0.0024330723,0.00097015366,0.013007136,0.053339634,0.041534252,0.0010750375,0.00033037213,0.05116783,0.0011492592,0.73272026,0.10199399,0.00027895588],"about_ca_topic_score_codex":0.0029538698,"about_ca_topic_score_gemma":0.0025503496,"teacher_disagreement_score":0.9447121,"about_ca_system_score_codex":0.001094617,"about_ca_system_score_gemma":0.004080889,"threshold_uncertainty_score":0.29239392},"labels":[],"label_agreement":null},{"id":"W2800148206","doi":"10.1093/fampra/cmy005","title":"Daring to draw causal claims from non-randomized studies of primary care interventions","year":2018,"lang":"en","type":"article","venue":"Family Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":132,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Primary care; Psychological intervention; Randomized controlled trial; Primary health care; MEDLINE; Family medicine; Nursing; Environmental health; Internal medicine","score_opus":0.2966887458985632,"score_gpt":0.5001152720724805,"score_spread":0.20342652617391732,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2800148206","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012957456,0.0061857547,0.9634654,0.0062438385,0.0013974687,0.0032857764,0.0015493521,0.00048271308,0.004432185],"genre_scores_gemma":[0.41936737,0.004069451,0.549019,0.0044250037,0.0020370067,0.014498011,0.0013946351,0.00019771514,0.0049918233],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.76677436,0.2027577,0.010713733,0.0103811305,0.008261091,0.0011120251],"domain_scores_gemma":[0.15708926,0.79766417,0.009827655,0.03169227,0.0029478606,0.00077874894],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2619774,0.00320698,0.008353807,0.007628465,0.0024799022,0.0057340213,0.0085455505,0.0062822765,0.030267],"category_scores_gemma":[0.6567727,0.002901756,0.01210826,0.0044900444,0.006456995,0.010613579,0.006556421,0.011434525,0.0012983395],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0044789393,0.0012446708,0.0125898905,0.014700447,0.02289089,0.00097507314,0.0017687707,0.027384765,0.0005615684,0.7014906,0.012950122,0.19896434],"study_design_scores_gemma":[0.0021594404,0.00036737524,0.0009719868,0.0010362191,0.0042443066,0.00017396577,0.00019988061,0.055272646,0.0005789669,0.9299365,0.005017573,0.000041151547],"about_ca_topic_score_codex":0.0033072191,"about_ca_topic_score_gemma":0.0030407235,"teacher_disagreement_score":0.73802257,"about_ca_system_score_codex":0.0025789533,"about_ca_system_score_gemma":0.0057780407,"threshold_uncertainty_score":0.9101133},"labels":[],"label_agreement":null},{"id":"W2800160739","doi":"10.1177/0962280218772065","title":"Understanding and diagnosing the potential for bias when using machine learning methods with doubly robust causal estimators","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hôpital du Sacré-Cœur de Montréal; Université de Montréal","funders":"Canadian Institutes of Health Research; Université de Montréal; Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Propensity score matching; Resampling; Estimator; Causal inference; Average treatment effect; Computer science; Parametric statistics; Statistics; Econometrics; Mathematics","score_opus":0.7613136427473822,"score_gpt":0.6566960719608058,"score_spread":0.10461757078657641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2800160739","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019881934,0.00051453226,0.9780963,0.0006460855,0.00003789253,0.000077339835,0.000051495957,0.0001130576,0.00058124046],"genre_scores_gemma":[0.44428092,0.000602021,0.552982,0.0005770903,0.00014379196,0.0005363322,0.00020807114,0.000120208,0.00054961833],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9531012,0.03809416,0.0020504287,0.0021886763,0.0040049995,0.0005603943],"domain_scores_gemma":[0.62056446,0.34365508,0.013750978,0.015411667,0.006102091,0.0005156869],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07292441,0.0009516353,0.0013177521,0.0024308446,0.00085559854,0.002698865,0.002377919,0.0031401243,0.0019231507],"category_scores_gemma":[0.3782891,0.0006969211,0.0012161349,0.0020225286,0.0031314045,0.0035084262,0.003695856,0.0030122846,0.00026425876],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005049084,0.00019570405,0.048413053,0.0010937144,0.0007741065,0.00081841904,0.0017843442,0.238063,0.003523044,0.4822849,0.0022872933,0.2202575],"study_design_scores_gemma":[0.000104847546,0.00017937565,0.005784141,0.000289007,0.00013585332,0.00043638758,0.0002137649,0.63336515,0.003942187,0.35146067,0.0040085237,0.00008009294],"about_ca_topic_score_codex":0.0020147918,"about_ca_topic_score_gemma":0.0012617385,"teacher_disagreement_score":0.92707556,"about_ca_system_score_codex":0.0011170789,"about_ca_system_score_gemma":0.0020222052,"threshold_uncertainty_score":0.38566577},"labels":[],"label_agreement":null},{"id":"W2801485033","doi":"10.3386/w22892","title":"Bounds on Treatment Effects in Regression Discontinuity Designs with a Manipulated Running Variable","year":2016,"lang":"en","type":"report","venue":"National Bureau of Economic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Science Foundation","keywords":"Regression discontinuity design; Variable (mathematics); Discontinuity (linguistics); Regression; Statistics; Mathematics; Computer science; Mathematical analysis","score_opus":0.6752177241422713,"score_gpt":0.6085671321910054,"score_spread":0.06665059195126588,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2801485033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020644652,0.0017202802,0.9657015,0.0014555334,0.000092324844,0.0006262763,0.00036939906,0.00024314523,0.009146875],"genre_scores_gemma":[0.6200084,0.0024270613,0.3624091,0.001566646,0.0002944754,0.005654128,0.0005756911,0.00019652757,0.006867872],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8881159,0.08781505,0.0035984041,0.00935583,0.0086817155,0.0024332118],"domain_scores_gemma":[0.38033023,0.5672663,0.018413724,0.028425159,0.0040312414,0.0015332693],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15388495,0.0023818281,0.0049993373,0.003655787,0.0015462884,0.006503832,0.0057400516,0.0069168815,0.014187603],"category_scores_gemma":[0.43724298,0.0023545309,0.003970874,0.0027743736,0.01061982,0.011047523,0.008102437,0.01371901,0.0010009201],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052453094,0.00018375779,0.0026232188,0.0005646719,0.000483162,0.00019040899,0.0012480428,0.02298118,0.0008750373,0.93418986,0.00072674634,0.035409413],"study_design_scores_gemma":[0.000325929,0.0006418807,0.0024682889,0.0004262375,0.0004607579,0.0001230703,0.0002740713,0.095123574,0.0014221976,0.89459866,0.004055115,0.00008017064],"about_ca_topic_score_codex":0.0013647337,"about_ca_topic_score_gemma":0.0009232193,"teacher_disagreement_score":0.15388495,"about_ca_system_score_codex":0.0037698091,"about_ca_system_score_gemma":0.0023784507,"threshold_uncertainty_score":0.8138311},"labels":[],"label_agreement":null},{"id":"W2802284801","doi":"10.1002/sim.7628","title":"Targeted maximum likelihood estimation for a binary treatment: A tutorial","year":2018,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":134,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Instituto de Salud Carlos III; Canadian Institutes of Health Research; Cancer Research UK","keywords":"Computer science; Outcome (game theory); Nonparametric statistics; Contrast (vision); Propensity score matching; Code (set theory); Parametric statistics; Binary number; Estimation; Specification; Statistics; Machine learning; Artificial intelligence; Programming language; Mathematics","score_opus":0.08412398744132396,"score_gpt":0.43726232599602827,"score_spread":0.35313833855470433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2802284801","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004310138,0.008905142,0.95930916,0.0026118972,0.0009918371,0.00025526687,0.0021145435,0.0053397506,0.020041471],"genre_scores_gemma":[0.0066937697,0.0157833,0.9348167,0.0026146304,0.0019809469,0.0011891208,0.0036618137,0.0036382878,0.02962148],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99892265,0.00044853982,0.000101570455,0.00018848095,0.0003013434,0.000037375805],"domain_scores_gemma":[0.99437135,0.004674042,0.00015952776,0.00019946524,0.00049408624,0.000101522965],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025557468,0.0022686492,0.0010925521,0.001695089,0.0003664037,0.0015554589,0.001314588,0.001973995,0.07930793],"category_scores_gemma":[0.014318027,0.0010379327,0.0013215591,0.0015640566,0.00056420907,0.0025576404,0.0013400046,0.0036088186,0.04035589],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005726251,0.00016190844,0.00047519666,0.0025179328,0.00010222867,0.0005548483,0.0002888383,0.007934279,0.0022707877,0.11432061,0.35977745,0.5115387],"study_design_scores_gemma":[0.00005677262,0.00007028812,0.0006696883,0.0008946168,0.00003918998,0.00089690165,0.000056273413,0.025923692,0.0016735424,0.21909972,0.7505281,0.000091265356],"about_ca_topic_score_codex":0.0014243354,"about_ca_topic_score_gemma":0.001966785,"teacher_disagreement_score":0.07930793,"about_ca_system_score_codex":0.000808661,"about_ca_system_score_gemma":0.0011522713,"threshold_uncertainty_score":0.26531148},"labels":[],"label_agreement":null},{"id":"W2802314382","doi":"10.1177/0049124118769087","title":"Regression-based Adjustment for Time-varying Confounders","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Marginal structural model; Econometrics; Estimator; Inverse probability; Regression; Average treatment effect; Statistics; Propensity score matching; Matching (statistics); Regression analysis; Computer science; Conditional expectation; Observational study; Outcome (game theory); Confounding; Estimation; Mathematics; Economics; Bayesian probability","score_opus":0.6894510924192692,"score_gpt":0.6691776798557132,"score_spread":0.02027341256355597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2802314382","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007112032,0.00046622095,0.99045944,0.00037223886,0.000093701674,0.00012314174,0.00019813294,0.0005166599,0.0006584257],"genre_scores_gemma":[0.25255656,0.00095624436,0.73969316,0.0003760249,0.00019268398,0.0008267977,0.0010102901,0.0004535112,0.003934804],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826158,0.013201843,0.00061030703,0.0019875767,0.0011904008,0.00039407445],"domain_scores_gemma":[0.96978474,0.018243518,0.0030257946,0.006908947,0.0018266166,0.00021036573],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031245165,0.0014031583,0.001966524,0.0015604612,0.0005628746,0.0010219407,0.00341263,0.001170481,0.004546224],"category_scores_gemma":[0.10108384,0.0007112029,0.0029175999,0.0030242861,0.0007594162,0.0017954234,0.0018762319,0.0031677824,0.001217934],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063641416,0.00038217762,0.041459154,0.0009176156,0.003998749,0.00032581078,0.0009839383,0.18262309,0.004618431,0.22163285,0.00966442,0.5327574],"study_design_scores_gemma":[0.00034836016,0.00058744085,0.021392498,0.0002267585,0.0015180489,0.00033439082,0.00022223478,0.73446894,0.0064057354,0.20590837,0.028442943,0.00014424813],"about_ca_topic_score_codex":0.00811251,"about_ca_topic_score_gemma":0.005644895,"teacher_disagreement_score":0.031245165,"about_ca_system_score_codex":0.0008369313,"about_ca_system_score_gemma":0.003159546,"threshold_uncertainty_score":0.16524214},"labels":[],"label_agreement":null},{"id":"W280240657","doi":"","title":"Commentary on Reed & Walton","year":2007,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"History","score_opus":0.1483875117826421,"score_gpt":0.44081826809666524,"score_spread":0.29243075631402315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W280240657","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000060318638,0.0020278823,0.00015626496,0.9750392,0.021239635,0.0000036890203,0.000057797526,0.000011050478,0.001404247],"genre_scores_gemma":[0.00211282,0.0010926077,0.00028012748,0.9574232,0.036017396,0.00003451443,0.000022917662,0.00003297557,0.0029834334],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98858297,0.0036175807,0.0009901514,0.0023001584,0.0036084,0.00090070866],"domain_scores_gemma":[0.90245414,0.07923649,0.0022127212,0.0022511722,0.0117298905,0.0021155674],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017393673,0.0016158198,0.0029263438,0.0028572378,0.007283083,0.007184799,0.00848104,0.07390291,0.012278807],"category_scores_gemma":[0.12046021,0.0013044873,0.0025285375,0.002921559,0.013580273,0.010806076,0.004722955,0.08964918,0.00807019],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000028652894,0.0000047231692,0.000037253707,0.00007794088,0.000025937157,0.000085089036,0.0002809895,0.000036948077,0.000025122114,0.019893972,0.97687095,0.0026323656],"study_design_scores_gemma":[0.00012221902,0.000014957337,0.00039609443,0.0011082094,0.00011423245,0.00022391407,0.00067025446,0.0002190956,0.00018093282,0.096540995,0.90032595,0.00008306831],"about_ca_topic_score_codex":0.021068338,"about_ca_topic_score_gemma":0.028618315,"teacher_disagreement_score":0.07390291,"about_ca_system_score_codex":0.008225822,"about_ca_system_score_gemma":0.0074159857,"threshold_uncertainty_score":0.09198767},"labels":[],"label_agreement":null},{"id":"W2803815837","doi":"10.1007/s10985-018-9430-y","title":"The effect of omitted covariates in marginal and partially conditional recurrent event analyses","year":2018,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Medical Research Council; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Marginal model; Econometrics; Covariate; Censoring (clinical trials); Statistics; Causal inference; Conditional probability distribution; Event (particle physics); Multiplicative function; Inference; Marginal structural model; Confounding; Semiparametric regression; Mathematics; Computer science; Regression analysis; Nonparametric statistics; Artificial intelligence","score_opus":0.12705361535163198,"score_gpt":0.4741786875827103,"score_spread":0.34712507223107836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2803815837","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025965342,0.0022886358,0.9688325,0.001372568,0.000102825645,0.000077484256,0.0003100506,0.00023367825,0.00081685494],"genre_scores_gemma":[0.6400146,0.0032381876,0.3495048,0.0013835795,0.00048371404,0.00066257577,0.0010727746,0.00033594982,0.0033038158],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9042172,0.08132453,0.0031194566,0.0061697015,0.003969001,0.0012001233],"domain_scores_gemma":[0.45828992,0.48986015,0.01703127,0.029349156,0.0045137387,0.00095577945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13667983,0.001257168,0.0028283254,0.0018907584,0.001033525,0.002422667,0.003667007,0.0022897273,0.00386836],"category_scores_gemma":[0.3728921,0.0010416906,0.003777577,0.002651189,0.0047421446,0.0050930604,0.004025966,0.004554263,0.00036971967],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010494677,0.00018240641,0.048921406,0.0015896871,0.0032156156,0.0010706264,0.002302537,0.07521686,0.0010950561,0.7078398,0.0035819043,0.15393458],"study_design_scores_gemma":[0.00016330625,0.00042535036,0.010874632,0.0004946589,0.0016269853,0.00051356293,0.00024534657,0.2468447,0.0021719583,0.7290009,0.0075251698,0.00011335068],"about_ca_topic_score_codex":0.0035529484,"about_ca_topic_score_gemma":0.0024564362,"teacher_disagreement_score":0.13667983,"about_ca_system_score_codex":0.0014170065,"about_ca_system_score_gemma":0.0028124938,"threshold_uncertainty_score":0.72284067},"labels":[],"label_agreement":null},{"id":"W2804738343","doi":"10.1515/jci-2016-0029","title":"A Kernel-Based Metric for Balance Assessment","year":2018,"lang":"en","type":"article","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada","keywords":"Kernel (algebra); Covariate; Causal inference; Metric (unit); Mathematics; Statistics; Matching (statistics); Balance (ability); Econometrics; Psychology","score_opus":0.1431727040585479,"score_gpt":0.47568054090603085,"score_spread":0.332507836847483,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2804738343","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018454574,0.0004374733,0.97923344,0.00025378674,0.000055912747,0.00008559257,0.00018211956,0.00016677156,0.0011302555],"genre_scores_gemma":[0.58651066,0.0009567321,0.40650877,0.00032962885,0.00025771995,0.0006368798,0.0011556955,0.00019309891,0.0034507453],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99283385,0.0034683025,0.00061282783,0.0012335016,0.0015575414,0.0002939849],"domain_scores_gemma":[0.98441297,0.008142734,0.0020313556,0.0022162148,0.0026339693,0.0005628528],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010642701,0.0009020834,0.0014602189,0.0032882625,0.0010208553,0.0019498959,0.0016264166,0.0017740722,0.0030256938],"category_scores_gemma":[0.042581026,0.00034153688,0.0012320476,0.0023575455,0.0019685156,0.004912277,0.002860798,0.0022483103,0.00064798153],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00074387726,0.00037318948,0.017374428,0.00045928068,0.00050142856,0.0003305035,0.00070325256,0.11721794,0.008893234,0.43172193,0.00532323,0.41635787],"study_design_scores_gemma":[0.00007792545,0.0005154422,0.008841051,0.000085005515,0.00012962917,0.0003901489,0.00022648722,0.62845546,0.0037616936,0.3474163,0.009986472,0.00011436659],"about_ca_topic_score_codex":0.0018337963,"about_ca_topic_score_gemma":0.00070823095,"teacher_disagreement_score":0.010642701,"about_ca_system_score_codex":0.001467657,"about_ca_system_score_gemma":0.0012319379,"threshold_uncertainty_score":0.056284666},"labels":[],"label_agreement":null},{"id":"W2805084035","doi":"10.1007/s10985-018-9434-7","title":"New approaches for censored longitudinal data in joint modelling of longitudinal and survival data, with application to HIV vaccine studies","year":2018,"lang":"en","type":"review","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health; Bill and Melinda Gates Foundation","keywords":"Censoring (clinical trials); Proportional hazards model; Survival analysis; Longitudinal data; Human immunodeficiency virus (HIV); Statistics; Longitudinal study; Econometrics; Event data; Computer science; Medicine; Immunology; Covariate; Mathematics; Data mining","score_opus":0.5447526708032592,"score_gpt":0.46424108354286475,"score_spread":0.08051158726039442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2805084035","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00065553264,0.8110853,0.18349345,0.002461864,0.00053592684,0.00004297563,0.0002617835,0.00010839513,0.0013548732],"genre_scores_gemma":[0.016540943,0.8789026,0.10009188,0.0010808588,0.0015552628,0.0002155299,0.00045816659,0.000067798406,0.0010869263],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9954791,0.0029343255,0.0003165273,0.00042984536,0.0007599594,0.00008028183],"domain_scores_gemma":[0.9660057,0.031047061,0.00084904814,0.00097098155,0.00099019,0.00013700147],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.013059865,0.0015293864,0.0030188104,0.0038818223,0.00039526907,0.0024054365,0.0032321494,0.002422991,0.0034897795],"category_scores_gemma":[0.029903315,0.000716486,0.0028908288,0.006279646,0.0019187926,0.0032250888,0.0018812716,0.005907142,0.001014067],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008217398,0.000120602024,0.001601654,0.016056277,0.0013231331,0.00019312829,0.00031725803,0.021921426,0.00039466386,0.2957573,0.013110658,0.64912176],"study_design_scores_gemma":[0.0000704948,0.00012517862,0.0023113696,0.0074396743,0.0007734381,0.00075848494,0.00021574537,0.037560552,0.00042762095,0.7407258,0.20945403,0.00013753689],"about_ca_topic_score_codex":0.0033780634,"about_ca_topic_score_gemma":0.003561565,"teacher_disagreement_score":0.98694015,"about_ca_system_score_codex":0.0014057257,"about_ca_system_score_gemma":0.0029286025,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W2805193208","doi":"10.1177/0962280218776690","title":"Assessing the performance of the generalized propensity score for estimating the effect of quantitative or continuous exposures on survival or time-to-event outcomes","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Heart, Lung, and Blood Institute; Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Statistics; Global Positioning System; Medicine; Inverse probability weighting; Observational study; Weighting; Mathematics; Computer science","score_opus":0.5441098280577505,"score_gpt":0.667460193097909,"score_spread":0.1233503650401585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2805193208","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12096183,0.0014705127,0.874051,0.0006537766,0.0000829162,0.0004981143,0.0005475931,0.0002803425,0.0014539817],"genre_scores_gemma":[0.53999066,0.0014649999,0.4557453,0.00022237784,0.00010211885,0.0009329956,0.00088407734,0.00016973393,0.00048767173],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9503818,0.043376256,0.0014184345,0.0020293184,0.0024862483,0.0003079181],"domain_scores_gemma":[0.7420651,0.23066488,0.009656298,0.013211668,0.0038260245,0.0005760166],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.076196425,0.0012513978,0.0014348078,0.00283208,0.00051604427,0.0014362513,0.001318199,0.0017630158,0.0022906763],"category_scores_gemma":[0.27733946,0.0005020205,0.002584958,0.003253105,0.0017262199,0.0020722758,0.0022511233,0.0014550609,0.00027139258],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017236281,0.00038717777,0.14146763,0.0021500022,0.0074109985,0.00038214258,0.0012916662,0.5018997,0.0025759768,0.08612075,0.003524865,0.25106543],"study_design_scores_gemma":[0.00050186215,0.0019445098,0.06038803,0.0005322385,0.0011480012,0.00049456756,0.00036358743,0.8030776,0.0028239386,0.123034105,0.005491541,0.0002000163],"about_ca_topic_score_codex":0.0044178586,"about_ca_topic_score_gemma":0.0028703737,"teacher_disagreement_score":0.92380357,"about_ca_system_score_codex":0.0009958684,"about_ca_system_score_gemma":0.0025916004,"threshold_uncertainty_score":0.40297002},"labels":[],"label_agreement":null},{"id":"W2806520546","doi":"10.1002/bimj.201700322","title":"Reward ignorant modeling of dynamic treatment regimes","year":2018,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of Waterloo","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Personalized medicine; Outcome (game theory); Causal inference; Inference; Computer science; Covariate; Precision medicine; Variety (cybernetics); Identification (biology); Observational study; Machine learning; Data science; Risk analysis (engineering); Data mining; Artificial intelligence; Econometrics; Medicine; Bioinformatics; Statistics; Mathematics","score_opus":0.32878468985498016,"score_gpt":0.4667132777993857,"score_spread":0.13792858794440555,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2806520546","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035560954,0.0007400764,0.9488884,0.005642786,0.00014800414,0.00021132466,0.0010295198,0.00025951938,0.0075194538],"genre_scores_gemma":[0.83833766,0.00154764,0.14198317,0.0015196438,0.00041682398,0.0008186437,0.00069180096,0.0001090549,0.014575528],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99218655,0.0050843027,0.00026108138,0.0011948397,0.00067152333,0.0006016873],"domain_scores_gemma":[0.95733196,0.03550693,0.0040012095,0.0016722288,0.0008322199,0.0006553746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013888012,0.0016544195,0.0028995022,0.0013345547,0.00064382,0.002861002,0.0029285427,0.0032188043,0.0064967335],"category_scores_gemma":[0.047473915,0.0010424271,0.0018364884,0.0014565262,0.0027349293,0.003212208,0.0018051389,0.0040136543,0.00066355034],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020795867,0.000112476904,0.0027277956,0.00012674394,0.00014066412,0.00019153011,0.00016901584,0.66921484,0.00028789527,0.31147447,0.0019847238,0.013361913],"study_design_scores_gemma":[0.000068406625,0.000058620644,0.00044099631,0.000036519385,0.00004494472,0.000039162656,0.000018668827,0.8102892,0.00012869298,0.18756808,0.0012861692,0.000020480597],"about_ca_topic_score_codex":0.006023171,"about_ca_topic_score_gemma":0.0052021747,"teacher_disagreement_score":0.013888012,"about_ca_system_score_codex":0.0031961026,"about_ca_system_score_gemma":0.0024166622,"threshold_uncertainty_score":0.073447704},"labels":[],"label_agreement":null},{"id":"W2809710353","doi":"10.1111/1475-6773.12993","title":"Matching and Regression to the Mean in Difference‐in‐Differences Analysis","year":2018,"lang":"en","type":"article","venue":"Health Services Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":258,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research; National Institute on Aging; National Institutes of Health","keywords":"Covariate; Statistics; Matching (statistics); Estimator; Average treatment effect; Regression toward the mean; Regression analysis; Difference in differences; Propensity score matching; Mathematics; Correlation; Regression; Econometrics; Outcome (game theory); Linear regression","score_opus":0.2801946559073915,"score_gpt":0.5611277229491156,"score_spread":0.2809330670417241,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2809710353","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01890885,0.0008331138,0.97567165,0.0010029462,0.00024760087,0.0009810368,0.00031287863,0.00024902978,0.0017929743],"genre_scores_gemma":[0.3536454,0.0006206507,0.63831717,0.0011537503,0.00019993757,0.0038034208,0.0003543797,0.00020320274,0.0017020953],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7110766,0.26193568,0.005710343,0.010859148,0.009155502,0.0012627407],"domain_scores_gemma":[0.4176608,0.5156252,0.019165603,0.040382963,0.0065553472,0.0006100634],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.22813232,0.0014401755,0.0031111639,0.0025304204,0.0012345597,0.0025551647,0.0042038006,0.003072059,0.010504781],"category_scores_gemma":[0.60725504,0.0011604964,0.0052598515,0.0032495433,0.004482655,0.0045968215,0.004226541,0.0049164835,0.0009468167],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031290883,0.0006620537,0.05064739,0.0025462802,0.0072292713,0.00065085845,0.0024699806,0.12777288,0.0014966131,0.58393043,0.0059814225,0.21348374],"study_design_scores_gemma":[0.0014498864,0.001593892,0.011069917,0.0010977903,0.0014165118,0.00035207803,0.00030987136,0.3916699,0.005686542,0.570776,0.014424843,0.00015287215],"about_ca_topic_score_codex":0.003341282,"about_ca_topic_score_gemma":0.0017996072,"teacher_disagreement_score":0.22813232,"about_ca_system_score_codex":0.0024088384,"about_ca_system_score_gemma":0.0033943644,"threshold_uncertainty_score":0.9518503},"labels":[],"label_agreement":null},{"id":"W2809826847","doi":"10.1080/13645579.2018.1488449","title":"Natural experiment methodology for research: a review of how different methods can support real-world research","year":2018,"lang":"en","type":"review","venue":"International Journal of Social Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":335,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Canadian Institutes of Health Research; Public Health Agency of Canada","keywords":"Randomized experiment; Research design; Randomized controlled trial; Natural experiment; Natural (archaeology); Intervention (counseling); Management science; Psychological intervention; Computer science; Risk analysis (engineering); Psychology; Sociology; Engineering; Medicine; Social science; Mathematics; Statistics","score_opus":0.967881105314908,"score_gpt":0.8051552063693992,"score_spread":0.16272589894550882,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2809826847","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00011440615,0.9691339,0.021447873,0.0035471218,0.0010517905,0.00045512553,0.00013673493,0.000070197486,0.004042895],"genre_scores_gemma":[0.003748277,0.9466132,0.044040322,0.0022861944,0.00073106843,0.0019155967,0.00011700621,0.000072580304,0.00047577202],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.8937596,0.07661869,0.010665719,0.0037618414,0.0146511905,0.00054292084],"domain_scores_gemma":[0.5735026,0.40410393,0.005710071,0.0071170274,0.008977191,0.00058918615],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09554453,0.0026738707,0.00621125,0.012693017,0.0016744178,0.007904281,0.0042860503,0.0056123966,0.008575454],"category_scores_gemma":[0.20806326,0.0015979375,0.0043086326,0.014494477,0.0071471455,0.0072757024,0.0035956777,0.005624624,0.0025090983],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014477446,0.00010747024,0.0005393108,0.1844176,0.0013166681,0.00016129964,0.001257004,0.001213593,0.00039316228,0.119214885,0.019963516,0.67127067],"study_design_scores_gemma":[0.00016904561,0.0003179654,0.0018573529,0.20076174,0.0018161122,0.0006345849,0.0006295406,0.0009102423,0.0006503645,0.12500544,0.66701514,0.00023246555],"about_ca_topic_score_codex":0.004539828,"about_ca_topic_score_gemma":0.0072376546,"teacher_disagreement_score":0.9044555,"about_ca_system_score_codex":0.007129967,"about_ca_system_score_gemma":0.014582229,"threshold_uncertainty_score":0.50529385},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"systematic_review","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2811159429","doi":"10.1108/s0731-905320190000039003","title":"Wild Bootstrap Randomization Inference for Few Treated Clusters","year":2019,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; Queen's University","funders":"","keywords":"Estimator; Inference; Cluster (spacecraft); Variance (accounting); Randomization; Statistics; Mathematics; Algorithm; Computer science; Artificial intelligence; Randomized controlled trial; Medicine","score_opus":0.16679452841082418,"score_gpt":0.39838990841661104,"score_spread":0.23159538000578686,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2811159429","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030154479,0.00030555148,0.9927321,0.0005511465,0.00012223906,0.000062054176,0.00015489706,0.00029033673,0.0027661514],"genre_scores_gemma":[0.22846448,0.00056544255,0.7581794,0.0014785915,0.0005609104,0.00079554244,0.00079286983,0.00052051956,0.008642205],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.974857,0.0204818,0.00040597306,0.0021547533,0.0017750601,0.0003254969],"domain_scores_gemma":[0.89918756,0.08484767,0.0030486728,0.009533638,0.0028310749,0.00055150496],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026589997,0.00090625265,0.0015874623,0.0017717708,0.001198552,0.0019617996,0.0030188705,0.0019896016,0.012852569],"category_scores_gemma":[0.11008218,0.0004992028,0.001436449,0.002401965,0.004262888,0.0028470573,0.0022894647,0.0045150425,0.0025351546],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022904554,0.000099657176,0.0024714197,0.00026085752,0.00019724503,0.00022387906,0.00019148698,0.025639642,0.0008280995,0.8391145,0.014713165,0.11603112],"study_design_scores_gemma":[0.00008380381,0.00005970933,0.0006930418,0.0000949206,0.000047798723,0.00010067886,0.000052436688,0.16326416,0.0011520113,0.8254794,0.008942143,0.000029926741],"about_ca_topic_score_codex":0.0015327964,"about_ca_topic_score_gemma":0.0014844319,"teacher_disagreement_score":0.026589997,"about_ca_system_score_codex":0.0015748071,"about_ca_system_score_gemma":0.0019103241,"threshold_uncertainty_score":0.1406231},"labels":[],"label_agreement":null},{"id":"W2855200104","doi":"10.1136/bmjebm-2018-110972","title":"‘Depletion of the susceptibles’ taught through a story, a table and basic arithmetic","year":2018,"lang":"en","type":"letter","venue":"BMJ evidence-based medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Phrase; Arithmetic; Table (database); Psychology; Statistics; Computer science; Natural language processing; Mathematics; Data mining","score_opus":0.22595200651833938,"score_gpt":0.4243785418092606,"score_spread":0.19842653529092122,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2855200104","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00021560761,0.0013104803,0.0006908819,0.99177295,0.004358878,0.000014378495,0.000034766585,0.000022436165,0.0015796063],"genre_scores_gemma":[0.006086809,0.0016200861,0.00160091,0.9726662,0.014730388,0.00008563542,0.000024588158,0.000031763746,0.0031535844],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9935529,0.004275716,0.0006033744,0.00042348122,0.00093242,0.00021219312],"domain_scores_gemma":[0.96502995,0.029137924,0.0017381712,0.00096113863,0.0018709215,0.0012619144],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009283495,0.0007538986,0.0009017023,0.00074467197,0.0019813727,0.0022671388,0.0010910289,0.018801171,0.010294027],"category_scores_gemma":[0.09994937,0.000534392,0.00082173775,0.0004782061,0.0050675827,0.0084072435,0.0019245197,0.030267986,0.0061458987],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008078515,0.000024719184,0.00042146223,0.00011643307,0.000014894664,0.0016043172,0.0006536948,0.000078949895,0.00017439792,0.016999668,0.96189994,0.01793068],"study_design_scores_gemma":[0.0001868019,0.000110789566,0.0009674099,0.0010774931,0.00002833089,0.009595878,0.001060339,0.0007929437,0.00027888108,0.090967774,0.8948592,0.000074096904],"about_ca_topic_score_codex":0.002305,"about_ca_topic_score_gemma":0.002476564,"teacher_disagreement_score":0.018801171,"about_ca_system_score_codex":0.002981444,"about_ca_system_score_gemma":0.0017723789,"threshold_uncertainty_score":0.049096406},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"not_applicable","genre":"editorial","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"not_applicable","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2888204156","doi":"10.1016/j.jclinepi.2018.08.012","title":"Don't forget about the “R” in cmRCT: reply to Groenwold and van Smeden","year":2018,"lang":"en","type":"letter","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; Jewish General Hospital","funders":"","keywords":"Randomization; Clinical trial; Medicine; Randomized controlled trial; Cohort; Physical therapy; Psychology; Internal medicine","score_opus":0.5280353855673746,"score_gpt":0.5820072379877822,"score_spread":0.053971852420407584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2888204156","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000030409492,0.00058957294,0.000057143552,0.9921908,0.006943018,0.000002079327,0.000016636573,0.000006968464,0.00016340853],"genre_scores_gemma":[0.00067641353,0.00042555341,0.00013542191,0.96705675,0.03120099,0.000016012966,0.0000098413975,0.00001625459,0.00046282943],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98821706,0.0051382356,0.002053101,0.0017135867,0.002171133,0.0007069176],"domain_scores_gemma":[0.8996738,0.07662131,0.004755755,0.0024300932,0.010603527,0.0059154667],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.016832858,0.0011452002,0.003060903,0.001518926,0.005409768,0.0062261974,0.00334407,0.0964801,0.0065682773],"category_scores_gemma":[0.17124112,0.0015238922,0.0016381736,0.0016290395,0.0097023025,0.00842108,0.0037712497,0.105911024,0.007458447],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000027271812,0.000010512175,0.0003145231,0.000050503455,0.000017624689,0.0003521257,0.00011183085,0.000033304746,0.000028680111,0.0020456184,0.9928352,0.0041727186],"study_design_scores_gemma":[0.0003376002,0.00006716188,0.0014161571,0.0016636334,0.00011600924,0.0031099324,0.0010729143,0.00089996634,0.00026245284,0.05664803,0.9341631,0.00024296241],"about_ca_topic_score_codex":0.005820688,"about_ca_topic_score_gemma":0.008476001,"teacher_disagreement_score":0.9831672,"about_ca_system_score_codex":0.005242889,"about_ca_system_score_gemma":0.005752717,"threshold_uncertainty_score":0.08902174},"labels":[],"label_agreement":null},{"id":"W2888601585","doi":"10.1007/s10654-018-0434-4","title":"Individually-matched etiologic studies: classical estimators made new again","year":2018,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Calculator; Statistics; Estimator; Matching (statistics); Econometrics; Statistician; Regression; Multinomial logistic regression; Regression analysis; Computer science; Medicine; Mathematics","score_opus":0.4704787764606337,"score_gpt":0.4991463389490607,"score_spread":0.028667562488427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2888601585","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0072699236,0.005298104,0.9823215,0.0025682633,0.00052636233,0.00009351856,0.00016500987,0.00009835906,0.0016589934],"genre_scores_gemma":[0.40918192,0.009623776,0.5642801,0.0045073377,0.0041769887,0.0009296854,0.0005411109,0.00021236837,0.006546671],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9537473,0.037160013,0.0015968183,0.0048736543,0.002225784,0.00039640142],"domain_scores_gemma":[0.7877403,0.17223921,0.006977141,0.028745705,0.0033348082,0.0009628743],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09672004,0.0015616391,0.004147569,0.003200035,0.0009352526,0.0037414653,0.00468684,0.003829961,0.005400416],"category_scores_gemma":[0.22631486,0.0013972218,0.002926458,0.003591885,0.0055477303,0.0074129994,0.0044247173,0.00650101,0.0006060503],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004893693,0.00020570989,0.019358948,0.0011282518,0.004608907,0.0004305345,0.00079496973,0.012821709,0.0007893114,0.7944685,0.0056017586,0.15930198],"study_design_scores_gemma":[0.00020156597,0.00019180789,0.002861368,0.0003177611,0.0011800415,0.00037062363,0.0001707415,0.029081222,0.0004273346,0.95721257,0.007945815,0.00003915749],"about_ca_topic_score_codex":0.0017319905,"about_ca_topic_score_gemma":0.001436075,"teacher_disagreement_score":0.90327996,"about_ca_system_score_codex":0.0009672591,"about_ca_system_score_gemma":0.002234657,"threshold_uncertainty_score":0.5115106},"labels":[],"label_agreement":null},{"id":"W2889374799","doi":"10.1007/s10742-018-0187-2","title":"Causal inference for multi-level treatments with machine-learned propensity scores","year":2018,"lang":"en","type":"article","venue":"Health Services and Outcomes Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Propensity score matching; Causal inference; Inverse probability; Inverse probability weighting; Multinomial logistic regression; Statistics; Econometrics; Observational study; Logistic regression; Matching (statistics); Computer science; Estimator; Bayesian probability; Average treatment effect; Mathematics; Posterior probability","score_opus":0.8430232517073458,"score_gpt":0.6674423948286655,"score_spread":0.1755808568786803,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2889374799","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005778077,0.0005850529,0.99022746,0.0016014604,0.000115386705,0.00019756205,0.00060512335,0.00029034648,0.00059953507],"genre_scores_gemma":[0.43019396,0.0019179379,0.5516037,0.0016248542,0.0011695275,0.0031704595,0.0027215756,0.00023746934,0.007360514],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9677829,0.025238143,0.0012385504,0.0034599823,0.001436323,0.0008440358],"domain_scores_gemma":[0.73755103,0.24287288,0.006503494,0.009794982,0.0021230318,0.0011545843],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.050732896,0.0018976497,0.005038728,0.0041510463,0.0015640596,0.0042910613,0.0054570306,0.004392186,0.017659668],"category_scores_gemma":[0.18059744,0.002539259,0.0052613313,0.0044719833,0.004050018,0.0066280644,0.0045009493,0.008481104,0.0014096723],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000664085,0.00059437315,0.008638517,0.0010115393,0.0017854285,0.00034678422,0.00044667843,0.26126164,0.0002469391,0.5985048,0.0072469334,0.119252235],"study_design_scores_gemma":[0.00022699911,0.00005406824,0.00079587044,0.00010128712,0.00022612943,0.00005570704,0.00003107301,0.4518765,0.00014612271,0.545364,0.0010943934,0.000027757222],"about_ca_topic_score_codex":0.008350644,"about_ca_topic_score_gemma":0.008583022,"teacher_disagreement_score":0.050732896,"about_ca_system_score_codex":0.0030798877,"about_ca_system_score_gemma":0.005442534,"threshold_uncertainty_score":0.2683044},"labels":[],"label_agreement":null},{"id":"W2889955345","doi":"10.23889/ijpds.v3i4.611","title":"Estimating the effect of referral for nephrology care on the survival of adults with advanced chronic kidney disease in a real-world clinical setting","year":2018,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia; University of Calgary","funders":"","keywords":"Medicine; Hazard ratio; Proportional hazards model; Referral; Nephrology; Confounding; Kidney disease; Internal medicine; Survival analysis; Cohort; Randomized controlled trial; Confidence interval; Clinical trial; Selection bias; Marginal structural model; Emergency medicine; Family medicine; Pathology","score_opus":0.1553901981825603,"score_gpt":0.515340847866065,"score_spread":0.35995064968350476,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2889955345","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9410386,0.009640999,0.037395798,0.0030375747,0.00024087023,0.002632663,0.004006231,0.00013277477,0.0018745194],"genre_scores_gemma":[0.9730349,0.0009656361,0.021966439,0.00053157593,0.00008524508,0.0013585301,0.001562846,0.000012051104,0.00048282105],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9445109,0.047212467,0.0026483359,0.003159358,0.001730964,0.00073807075],"domain_scores_gemma":[0.8421696,0.13072947,0.019160213,0.004442634,0.002462997,0.0010351065],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06770607,0.0011455057,0.0016650653,0.0011865286,0.00047368312,0.0013694227,0.0020413878,0.001562414,0.002668321],"category_scores_gemma":[0.1496841,0.0008653521,0.005038762,0.0013023943,0.0014684364,0.0009858242,0.0019109389,0.001309441,0.0001560496],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011572679,0.0006851369,0.8311936,0.0032324984,0.02397822,0.0002064911,0.00044416983,0.05566171,0.00044644653,0.0049495897,0.002396689,0.06523267],"study_design_scores_gemma":[0.008070924,0.011549621,0.67603844,0.0017138745,0.032327246,0.00060378684,0.00069506007,0.23379661,0.0026246335,0.022263773,0.00999148,0.000324529],"about_ca_topic_score_codex":0.0380325,"about_ca_topic_score_gemma":0.03742512,"teacher_disagreement_score":0.06770607,"about_ca_system_score_codex":0.0032230862,"about_ca_system_score_gemma":0.005421796,"threshold_uncertainty_score":0.35806823},"labels":[],"label_agreement":null},{"id":"W2891367027","doi":"10.1513/annalsats.201808-564ps","title":"Control of Confounding and Reporting of Results in Causal Inference Studies. Guidance for Authors from Editors of Respiratory, Sleep, and Critical Care Journals","year":2018,"lang":"en","type":"article","venue":"Annals of the American Thoracic Society","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":722,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; McGill University; Queen's University","funders":"","keywords":"Confounding; Causal inference; Fallacy; Medicine; Statistics; Econometrics; Computer science; Mathematics; Linguistics","score_opus":0.40907458202425123,"score_gpt":0.5752142049379743,"score_spread":0.16613962291372303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891367027","genre_codex":"commentary","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009950303,0.055864878,0.3329791,0.49364847,0.103129044,0.0047226944,0.001144186,0.0016255697,0.005890992],"genre_scores_gemma":[0.02196413,0.04012019,0.6968084,0.13683406,0.08304755,0.014668082,0.0007092392,0.001783141,0.0040652296],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.20809512,0.62308156,0.09536444,0.008904447,0.06252616,0.00202835],"domain_scores_gemma":[0.027268363,0.8163003,0.05429543,0.033405732,0.066270106,0.002460033],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7191381,0.0029348135,0.007901735,0.015310479,0.0064522093,0.02012183,0.013676485,0.020377733,0.011528063],"category_scores_gemma":[0.92624557,0.0042836517,0.0044780546,0.013232799,0.02010208,0.023816857,0.012292447,0.029155547,0.010038953],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065731694,0.00014628714,0.0019351144,0.011287524,0.0008118724,0.00039959894,0.009037915,0.0007392662,0.000607822,0.0508524,0.70710176,0.2164231],"study_design_scores_gemma":[0.00090846414,0.00043824405,0.002376979,0.024213627,0.00072805304,0.0010537846,0.0023252603,0.0051396564,0.0017139099,0.22892176,0.73169386,0.00048652675],"about_ca_topic_score_codex":0.0023606475,"about_ca_topic_score_gemma":0.0035588008,"teacher_disagreement_score":0.2808619,"about_ca_system_score_codex":0.0063604447,"about_ca_system_score_gemma":0.035623416,"threshold_uncertainty_score":0.34635282},"labels":[],"label_agreement":null},{"id":"W2891506233","doi":"10.1177/0962280218799540","title":"A review and empirical comparison of causal inference methods for clustered observational data with application to the evaluation of the effectiveness of medical devices","year":2018,"lang":"en","type":"review","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"","keywords":"Observational study; Causal inference; Propensity score matching; Confounding; Matching (statistics); Cluster analysis; Metric (unit); Variance (accounting); Computer science; Statistics; Econometrics; Inference; Cluster (spacecraft); Data mining; Medicine; Mathematics; Artificial intelligence; Engineering; Operations management","score_opus":0.885421416171426,"score_gpt":0.8016456215590271,"score_spread":0.08377579461239892,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891506233","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012508809,0.9932308,0.004609069,0.00085457746,0.00019334006,0.00002645458,0.00007405374,0.00001617679,0.0008705536],"genre_scores_gemma":[0.001950993,0.9917434,0.005390107,0.0003139822,0.00026769788,0.00008761498,0.00007095271,0.00001126775,0.00016400775],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9930059,0.0036853405,0.0010099191,0.00067580334,0.0015209694,0.00010208443],"domain_scores_gemma":[0.90117514,0.091339156,0.0025280889,0.0013115313,0.0033490425,0.0002969302],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.015062487,0.0012870486,0.0029198257,0.0071683484,0.00050553266,0.0019694674,0.0023988853,0.0023120048,0.0053291917],"category_scores_gemma":[0.062373612,0.00075367413,0.0025370074,0.009361902,0.0017844264,0.0025204758,0.0011297496,0.0024262262,0.0012455353],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008249877,0.00007083044,0.0007639191,0.08613579,0.0009480164,0.000102766695,0.000199326,0.0019022776,0.00020807904,0.03399103,0.015458285,0.8601372],"study_design_scores_gemma":[0.0000920864,0.00030786026,0.007441673,0.14037938,0.003248113,0.0014844072,0.00036988282,0.0026605977,0.00074699573,0.087976396,0.75512224,0.00017040421],"about_ca_topic_score_codex":0.0027306343,"about_ca_topic_score_gemma":0.002777308,"teacher_disagreement_score":0.9849375,"about_ca_system_score_codex":0.0021534602,"about_ca_system_score_gemma":0.005427803,"threshold_uncertainty_score":0.079658985},"labels":[],"label_agreement":null},{"id":"W2892038960","doi":"10.1145/3287560.3287564","title":"Fairness through Causal Awareness","year":2019,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":105,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Vector Institute; University of Toronto","funders":"","keywords":"Replicate; Computer science; Outcome (game theory); Causal model; Observational study; Machine learning; Artificial intelligence; Generative grammar; Confounding; Intervention (counseling); Causal structure; Affect (linguistics); Econometrics; Cognitive psychology; Psychology; Statistics; Mathematics","score_opus":0.17918138593962896,"score_gpt":0.44090865532862894,"score_spread":0.261727269389,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2892038960","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045429584,0.0023593737,0.9109584,0.027152976,0.0004209935,0.00026963992,0.0010607037,0.0005274704,0.011820862],"genre_scores_gemma":[0.86130583,0.0015138711,0.1266904,0.005193129,0.0007891429,0.000541598,0.00062653946,0.00019690943,0.0031425431],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96892506,0.021914003,0.0011468455,0.0046547754,0.0024014043,0.000957843],"domain_scores_gemma":[0.7557998,0.20278585,0.012301392,0.022918854,0.0041751205,0.0020189756],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05310955,0.0012190017,0.002527679,0.0020231977,0.0020825288,0.006261648,0.0025848572,0.0037004205,0.007948914],"category_scores_gemma":[0.26401705,0.0012472734,0.0015647694,0.0015545713,0.00816852,0.01444676,0.004936179,0.0076323077,0.00069340586],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038913704,0.00017704071,0.01330256,0.00049422507,0.0004627357,0.00022089753,0.0013632451,0.06471307,0.00044949903,0.8094408,0.0061054733,0.102881305],"study_design_scores_gemma":[0.00004121727,0.000028652217,0.00070613157,0.000091659385,0.000045561876,0.00004597097,0.000063411935,0.042303693,0.00021384125,0.9544368,0.0020017424,0.000021318143],"about_ca_topic_score_codex":0.003117632,"about_ca_topic_score_gemma":0.002551404,"teacher_disagreement_score":0.05310955,"about_ca_system_score_codex":0.0033516798,"about_ca_system_score_gemma":0.004216831,"threshold_uncertainty_score":0.28087348},"labels":[],"label_agreement":null},{"id":"W2892362469","doi":"10.3386/t0337","title":"Regression Discontinuity Designs: A Guide to Practice","year":2007,"lang":"en","type":"preprint","venue":"National Bureau of Economic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada; National Science Foundation","keywords":"Regression discontinuity design; Regression; Discontinuity (linguistics); Computer science; Statistics; Mathematics","score_opus":0.6921272203478509,"score_gpt":0.6760656725899765,"score_spread":0.016061547757874384,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2892362469","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002958304,0.010073127,0.97264886,0.0038260692,0.0008497889,0.0018995922,0.0014249381,0.0013561151,0.0076257954],"genre_scores_gemma":[0.004594306,0.0090312045,0.97495735,0.0014004635,0.0004578634,0.0061805313,0.00058603013,0.0005865407,0.0022057665],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92315096,0.062479235,0.004199451,0.0026340373,0.007138008,0.00039825268],"domain_scores_gemma":[0.8543373,0.12581399,0.0031502107,0.008105922,0.0077277315,0.00086493016],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08011851,0.0026750828,0.004218015,0.0054649967,0.0011912085,0.0063181203,0.0070812586,0.007226832,0.018960427],"category_scores_gemma":[0.15828124,0.0028745022,0.0031868462,0.0066370717,0.0042371545,0.00376273,0.0036799037,0.010889161,0.009949261],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002528408,0.00036583532,0.0013467479,0.005806806,0.000633474,0.00048760066,0.0020367017,0.017312381,0.00094313157,0.4568795,0.15092905,0.363006],"study_design_scores_gemma":[0.00042175734,0.0002954154,0.00069620827,0.004224761,0.0001832606,0.0004543333,0.00040384254,0.026536914,0.00089955505,0.5952292,0.37046143,0.00019336124],"about_ca_topic_score_codex":0.0038025717,"about_ca_topic_score_gemma":0.004295393,"teacher_disagreement_score":0.08011851,"about_ca_system_score_codex":0.0025928926,"about_ca_system_score_gemma":0.007904329,"threshold_uncertainty_score":0.42371225},"labels":[],"label_agreement":null},{"id":"W2893335949","doi":"10.1007/s40471-018-0172-x","title":"The Curse of the Perinatal Epidemiologist: Inferring Causation Amidst Selection","year":2018,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":50,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Causation; Outcome (game theory); Selection bias; Selection (genetic algorithm); Epidemiology; Pregnancy; Medicine; Psychology; Computer science; Biology; Economics; Epistemology","score_opus":0.29643878629705167,"score_gpt":0.49660026095631526,"score_spread":0.2001614746592636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2893335949","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.048723433,0.013467845,0.8435506,0.08719675,0.0010345095,0.0001435267,0.00042891517,0.00024727752,0.005207119],"genre_scores_gemma":[0.701808,0.010809674,0.26329347,0.011418837,0.00413319,0.00053675345,0.00034695253,0.00022022634,0.007432917],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9673282,0.027944217,0.00063790457,0.0020947575,0.0015184138,0.00047643916],"domain_scores_gemma":[0.5889806,0.38887712,0.006220842,0.011737995,0.0024030427,0.0017803176],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05159761,0.0009785066,0.0025023571,0.0033341076,0.0023814905,0.0027111305,0.0029003187,0.003786549,0.0046270513],"category_scores_gemma":[0.29051602,0.0011552712,0.0013727014,0.0032395564,0.00931314,0.007062247,0.0051566698,0.00691106,0.00033518072],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033870447,0.00020125943,0.03694129,0.0008518867,0.00096578465,0.0018145266,0.002776484,0.01603213,0.0003924279,0.81190884,0.01244186,0.115334734],"study_design_scores_gemma":[0.00011625345,0.00004967811,0.003085258,0.00014108855,0.0001919626,0.00036289886,0.000288314,0.034275766,0.00024102865,0.9574412,0.0037793224,0.000027167598],"about_ca_topic_score_codex":0.011075549,"about_ca_topic_score_gemma":0.008896836,"teacher_disagreement_score":0.9484024,"about_ca_system_score_codex":0.0019899567,"about_ca_system_score_gemma":0.0053350744,"threshold_uncertainty_score":0.2728775},"labels":[],"label_agreement":null},{"id":"W2893874018","doi":"10.1097/olq.0000000000000911","title":"Risk Factor Reversal in Studies of Infectious Disease: Making Counterintuitive Results Intuitive Again","year":2018,"lang":"en","type":"letter","venue":"Sexually Transmitted Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Counterintuitive; Medicine; Abstinence; Sexual abstinence; Disease; Internal medicine; Psychiatry; Population; Environmental health; Epistemology; Family planning; Research methodology","score_opus":0.08965879946146911,"score_gpt":0.39388591544713614,"score_spread":0.30422711598566704,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2893874018","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010252462,0.0032466983,0.0027807357,0.9867822,0.0051017706,0.0000126327595,0.000031011234,0.00002985064,0.000989891],"genre_scores_gemma":[0.04725729,0.0046189493,0.010361112,0.8582913,0.07784946,0.00019039605,0.00004921809,0.00009336799,0.0012887781],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9499963,0.03676832,0.0037266584,0.003948904,0.0050455187,0.0005142764],"domain_scores_gemma":[0.5547493,0.41130376,0.0072114007,0.015673026,0.008607436,0.0024550431],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.111594066,0.00067978166,0.0014857909,0.0017050543,0.0018004065,0.004012442,0.0035116535,0.018310763,0.0044363886],"category_scores_gemma":[0.40065873,0.0006038006,0.0013290739,0.001191011,0.019033762,0.012829932,0.00377066,0.031689126,0.0020232515],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011466094,0.0001493785,0.007827341,0.0013057553,0.0007280318,0.005247356,0.0019714476,0.0010180738,0.0010217215,0.34834793,0.46508026,0.16615613],"study_design_scores_gemma":[0.00096640416,0.00013950729,0.0022411668,0.0007190725,0.00016109263,0.00221548,0.000508345,0.0020978164,0.0005004932,0.87465864,0.115696505,0.000095483185],"about_ca_topic_score_codex":0.0011758663,"about_ca_topic_score_gemma":0.0012338244,"teacher_disagreement_score":0.111594066,"about_ca_system_score_codex":0.0026446674,"about_ca_system_score_gemma":0.0017239683,"threshold_uncertainty_score":0.5901729},"labels":[],"label_agreement":null},{"id":"W2894669578","doi":"10.1002/sta4.205","title":"A doubly robust weighting estimator of the average treatment effect on the treated","year":2018,"lang":"en","type":"article","venue":"Stat","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; McGill University; McGill University Health Centre","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Weighting; Mathematics; Statistics; Matching (statistics); Inverse probability weighting; Minimum-variance unbiased estimator; Estimation; Sampling (signal processing); Inverse; Computer science; Medicine; Engineering","score_opus":0.12477632230546995,"score_gpt":0.3810167172586393,"score_spread":0.2562403949531693,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2894669578","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047531617,0.0002001688,0.9924672,0.00030864633,0.000102988655,0.00020954398,0.0003421945,0.00014036958,0.0014757462],"genre_scores_gemma":[0.18957579,0.0008960765,0.8014241,0.0007244938,0.0003454218,0.0015006764,0.0011765287,0.00012131889,0.0042356006],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9927205,0.0043049078,0.00035297175,0.0010512976,0.0013337546,0.00023666461],"domain_scores_gemma":[0.9757293,0.016825037,0.0020067024,0.0035739923,0.0016407066,0.00022424108],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017113127,0.00065618614,0.0016576169,0.0018216374,0.0004253306,0.001168354,0.0023394367,0.0015660037,0.008036437],"category_scores_gemma":[0.07373928,0.00049565715,0.0015529039,0.0020525085,0.0011941525,0.0020537337,0.0016522204,0.0024158715,0.0010023945],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021226729,0.0003283064,0.010884551,0.00042467634,0.0004910726,0.00015246123,0.0003251379,0.05735965,0.0032431833,0.59572285,0.006951652,0.32390425],"study_design_scores_gemma":[0.0003084098,0.0005828346,0.009910036,0.0003797793,0.0007323238,0.00046982028,0.00012856242,0.49375394,0.0053764363,0.46334094,0.024897516,0.00011933339],"about_ca_topic_score_codex":0.0021139625,"about_ca_topic_score_gemma":0.0019936915,"teacher_disagreement_score":0.017113127,"about_ca_system_score_codex":0.0007847609,"about_ca_system_score_gemma":0.0017901005,"threshold_uncertainty_score":0.09050399},"labels":[],"label_agreement":null},{"id":"W2895514839","doi":"10.1186/s41073-018-0053-3","title":"Protocol for the development of a CONSORT extension for RCTs using cohorts and routinely collected health data","year":2018,"lang":"en","type":"article","venue":"Research Integrity and Peer Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Multiple Sclerosis Society of Canada; Jewish General Hospital; University of Ottawa; Dalhousie University; McMaster University; Western University; Children's Hospital of Eastern Ontario; Impact; Ottawa Hospital","funders":"Medical Research Council; Canadian Institutes of Health Research; Wellcome Trust","keywords":"Consolidated Standards of Reporting Trials; Checklist; Observational study; Generalizability theory; Guideline; Protocol (science); Randomized controlled trial; Medicine; Systematic review; Strengthening the reporting of observational studies in epidemiology; Research design; MEDLINE; Family medicine; Alternative medicine; Psychology; Statistics; Political science; Surgery","score_opus":0.9111252944079001,"score_gpt":0.6940410504859482,"score_spread":0.2170842439219519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2895514839","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00045460204,0.00041086678,0.02286061,0.0016533575,0.0025249745,0.95797765,0.0108832065,0.0010499919,0.0021847],"genre_scores_gemma":[0.00032641744,0.00012226899,0.018434877,0.00028964772,0.00008499758,0.9793627,0.00085130776,0.000054849417,0.00047289283],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.7849015,0.1420957,0.04776129,0.010765806,0.010986369,0.003489407],"domain_scores_gemma":[0.58866376,0.19609019,0.04257508,0.060200367,0.103845105,0.008625504],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2358814,0.004960204,0.007900625,0.009491073,0.0047792215,0.008269932,0.0057781944,0.011394896,0.14432344],"category_scores_gemma":[0.40170678,0.0061629782,0.011627402,0.011514871,0.00671428,0.0073030647,0.006394104,0.020601982,0.049153525],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.03187019,0.0018203921,0.0015895104,0.1843981,0.0025683593,0.00092684646,0.0065934667,0.0038401939,0.0033958452,0.052393228,0.52901644,0.18158737],"study_design_scores_gemma":[0.07604972,0.0025667173,0.0053331293,0.11759807,0.0017791352,0.00067581603,0.0015581725,0.0070675495,0.003898098,0.057314903,0.72533363,0.00082499563],"about_ca_topic_score_codex":0.0017861215,"about_ca_topic_score_gemma":0.0029605408,"teacher_disagreement_score":0.7641186,"about_ca_system_score_codex":0.012948379,"about_ca_system_score_gemma":0.046809807,"threshold_uncertainty_score":0.94229424},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"not_applicable","genre":"protocol","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch"],"domain":"reporting","study_design":"not_applicable","genre":"protocol","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W2896610735","doi":"10.1515/jci-2018-0015","title":"Learning Heterogeneity in Causal Inference Using Sufficient Dimension Reduction","year":2018,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Causal inference; Dimensionality reduction; Inference; Outcome (game theory); Sufficient dimension reduction; Dimension (graph theory); Econometrics; Regression; Regression analysis; Feature selection; Statistics; Computer science; Mathematics; Machine learning; Artificial intelligence","score_opus":0.1798803548296694,"score_gpt":0.4531881813150275,"score_spread":0.2733078264853581,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896610735","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011494578,0.00044258463,0.9864537,0.0006877049,0.00003612899,0.000070924376,0.000115410614,0.00013866572,0.0005603401],"genre_scores_gemma":[0.5264948,0.0009859013,0.4680432,0.00084848126,0.00045977972,0.00087877375,0.0008726343,0.00012357692,0.0012928826],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9766987,0.018698547,0.0008533483,0.0016250939,0.0016588847,0.0004655024],"domain_scores_gemma":[0.82102275,0.16014373,0.0040806727,0.010100167,0.0038126137,0.00084009627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028232079,0.0013357735,0.0034255763,0.0036757106,0.0014028115,0.0027914562,0.0021227843,0.0018551889,0.0027764828],"category_scores_gemma":[0.10370214,0.0012706037,0.0032620712,0.002715941,0.0035052118,0.0037165636,0.004537301,0.005243339,0.00031418505],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056314166,0.0003847164,0.011173191,0.00063302135,0.0010368711,0.00044175176,0.00072360423,0.3686813,0.0013987132,0.5135003,0.005120505,0.09634295],"study_design_scores_gemma":[0.000077266894,0.000056197638,0.0007424473,0.0000783451,0.000083571336,0.000044916327,0.000041421932,0.6553875,0.00041205136,0.34202936,0.001013382,0.000033565593],"about_ca_topic_score_codex":0.0045426064,"about_ca_topic_score_gemma":0.0032320053,"teacher_disagreement_score":0.028232079,"about_ca_system_score_codex":0.0018747458,"about_ca_system_score_gemma":0.0029916086,"threshold_uncertainty_score":0.14930731},"labels":[],"label_agreement":null},{"id":"W2896981660","doi":"10.1002/sim.8008","title":"Propensity‐score matching with competing risks in survival analysis","year":2018,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":147,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Covariate; Observational study; Matching (statistics); Hazard ratio; Confounding; Sample size determination; Medicine; Absolute risk reduction; Confidence interval; Econometrics; Mathematics","score_opus":0.23846640406203207,"score_gpt":0.45839961939779816,"score_spread":0.2199332153357661,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896981660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011680148,0.00048904406,0.9971131,0.00026509946,0.000058804308,0.0002051022,0.00010539911,0.00019118248,0.00040423457],"genre_scores_gemma":[0.07508327,0.0020113464,0.9173923,0.00029397226,0.00041798822,0.0022758234,0.000695556,0.00023157302,0.0015982051],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95360243,0.040152974,0.0012774811,0.0020497781,0.0025263403,0.00039084902],"domain_scores_gemma":[0.9225355,0.06704519,0.0037716373,0.004637277,0.0016384189,0.000372027],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.048631843,0.0014369081,0.002671584,0.0048871865,0.00085913634,0.0024228366,0.0032238693,0.0023027577,0.0067480505],"category_scores_gemma":[0.14023486,0.0013484393,0.0033089,0.0066310447,0.0023870934,0.0026912868,0.0038259246,0.0047140806,0.0011244258],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030730575,0.00023046382,0.012941035,0.00095909403,0.0014810251,0.0004607292,0.0004223752,0.21208046,0.00051816023,0.52344567,0.011017365,0.23613638],"study_design_scores_gemma":[0.00015794863,0.000115455456,0.0020733087,0.00019227967,0.00013774094,0.00022547058,0.000048244572,0.51815975,0.0004674872,0.46951815,0.008840635,0.000063571184],"about_ca_topic_score_codex":0.004160546,"about_ca_topic_score_gemma":0.0025858989,"teacher_disagreement_score":0.95136815,"about_ca_system_score_codex":0.0018272123,"about_ca_system_score_gemma":0.004349089,"threshold_uncertainty_score":0.25719285},"labels":[],"label_agreement":null},{"id":"W2898839296","doi":"10.1177/0962280218808817","title":"Causal inference with multiple concurrent medications: A comparison of methods and an application in multidrug-resistant tuberculosis","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Université de Montréal; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada; National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Causal inference; Propensity score matching; Marginal structural model; Inverse probability weighting; Estimation; Statistics; Econometrics; Outcome (game theory); Inference; Tuberculosis; Weighting; Medicine; Counterfactual thinking; Parametric statistics; Computer science; Intensive care medicine; Mathematics; Artificial intelligence; Psychology","score_opus":0.3771174340888153,"score_gpt":0.6903954447855432,"score_spread":0.31327801069672784,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2898839296","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023263773,0.006060019,0.9662883,0.0017014085,0.00016425298,0.0005669499,0.00011945604,0.00016310663,0.0016726856],"genre_scores_gemma":[0.26465458,0.0052398276,0.72671425,0.00053445925,0.00029965094,0.0012802402,0.0001590596,0.00012884013,0.0009891044],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8581013,0.13161156,0.0021467386,0.0029309802,0.0048169997,0.0003923538],"domain_scores_gemma":[0.28239265,0.6981025,0.0072699552,0.008900512,0.0027936334,0.0005408371],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15416194,0.0013183089,0.0023427769,0.0030188807,0.00089661585,0.002264319,0.0033324554,0.0023117715,0.0042633996],"category_scores_gemma":[0.36180443,0.0009071299,0.004257111,0.0030813226,0.0021955518,0.004499862,0.0034388637,0.0033753852,0.00030437933],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037127286,0.0008868621,0.027964208,0.0033864635,0.009210776,0.0004653351,0.0022988366,0.13927063,0.0007565415,0.20847042,0.0021546981,0.60142255],"study_design_scores_gemma":[0.0023081466,0.0015812712,0.014617536,0.0014122988,0.0025854998,0.0007384727,0.00060594274,0.6025082,0.0013355528,0.362908,0.009106655,0.00029243645],"about_ca_topic_score_codex":0.0049362937,"about_ca_topic_score_gemma":0.005184017,"teacher_disagreement_score":0.84583807,"about_ca_system_score_codex":0.0019378213,"about_ca_system_score_gemma":0.0040667006,"threshold_uncertainty_score":0.81529605},"labels":[],"label_agreement":null},{"id":"W2899570500","doi":"10.1017/pan.2018.53","title":"A Regression-with-Residuals Method for Estimating Controlled Direct Effects","year":2018,"lang":"en","type":"article","venue":"Political Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Moderation; Respondent; Econometrics; Regression analysis; Regression; Causal inference; Confounding; Estimation; Mediation; Statistics; Outcome (game theory); Psychology; Computer science; Social psychology; Mathematics; Economics; Political science","score_opus":0.07879243387603321,"score_gpt":0.4727019433909369,"score_spread":0.39390950951490367,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2899570500","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00081846584,0.0001399465,0.9978224,0.00013768252,0.000043117307,0.00009333388,0.000116497366,0.0002229722,0.0006056393],"genre_scores_gemma":[0.04243194,0.00047753894,0.952587,0.00021670862,0.00015201926,0.00097070675,0.00047612423,0.00028760007,0.0024004222],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97769755,0.017505884,0.0006587212,0.0020958146,0.0017275464,0.0003144758],"domain_scores_gemma":[0.9559105,0.03486425,0.0019698332,0.0052462476,0.0018196779,0.0001894577],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026687995,0.0022302128,0.0019069323,0.0036376626,0.00071372563,0.0016349023,0.00395595,0.002027147,0.014005141],"category_scores_gemma":[0.102502644,0.0008545191,0.003212156,0.0054244655,0.0019085575,0.0033398422,0.0024782019,0.0047146576,0.003344693],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012805976,0.00017069027,0.004751493,0.00056467176,0.0006166609,0.00018744942,0.0005415826,0.03704831,0.001375843,0.70181954,0.005641825,0.24715392],"study_design_scores_gemma":[0.00018309367,0.00034740003,0.0033661877,0.00024331664,0.0003417761,0.00024133497,0.00022496791,0.3923951,0.0024557593,0.5555339,0.044526134,0.00014100969],"about_ca_topic_score_codex":0.007366481,"about_ca_topic_score_gemma":0.0055037723,"teacher_disagreement_score":0.026687995,"about_ca_system_score_codex":0.0010493496,"about_ca_system_score_gemma":0.00287208,"threshold_uncertainty_score":0.1411413},"labels":[],"label_agreement":null},{"id":"W2900917686","doi":"10.1038/s41562-018-0466-5","title":"Quasi-experimental causality in neuroscience and behavioural research","year":2018,"lang":"en","type":"review","venue":"Nature Human Behaviour","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":109,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Advanced Research","funders":"","keywords":"Causality (physics); Psychology; Behavioural sciences; Neuroscience; Cognitive psychology; Cognitive science; Psychotherapist; Physics","score_opus":0.603559070223279,"score_gpt":0.6178682674572226,"score_spread":0.014309197233943527,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2900917686","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001456343,0.98640406,0.009869168,0.0014600875,0.0004649113,0.000020986754,0.000048838076,0.000022431997,0.0015639],"genre_scores_gemma":[0.007602106,0.97863674,0.009798856,0.0011039894,0.001448769,0.0001297111,0.000090584384,0.000028671964,0.0011605289],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99426454,0.003754242,0.0004631917,0.000617864,0.0007966105,0.00010357167],"domain_scores_gemma":[0.93295157,0.06278688,0.0011091637,0.0015272193,0.0014036034,0.00022163417],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.014067066,0.001414909,0.0032251733,0.0027730837,0.00056028523,0.00256762,0.0025591748,0.003728926,0.009356115],"category_scores_gemma":[0.038446873,0.00074895483,0.0013304366,0.0043190964,0.00547948,0.004677771,0.001956731,0.003500448,0.001294068],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015774541,0.00009925394,0.00040418308,0.04364423,0.0005419689,0.000096084696,0.00023674926,0.001902079,0.00016224742,0.22486812,0.012798294,0.7150891],"study_design_scores_gemma":[0.00011260758,0.00011368598,0.0013833372,0.022373911,0.00058800884,0.00045291227,0.00016518275,0.0014371453,0.0003619896,0.58409137,0.388837,0.00008272117],"about_ca_topic_score_codex":0.002598354,"about_ca_topic_score_gemma":0.003286966,"teacher_disagreement_score":0.98593295,"about_ca_system_score_codex":0.0020607107,"about_ca_system_score_gemma":0.006138392,"threshold_uncertainty_score":0.07439464},"labels":[],"label_agreement":null},{"id":"W2900937465","doi":"10.1097/mlr.0000000000001014","title":"Lasso Regression for the Prediction of Intermediate Outcomes Related to Cardiovascular Disease Prevention Using the TRANSIT Quality Indicators","year":2018,"lang":"en","type":"article","venue":"Medical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal; Sanofi (Canada); Université de Montréal","funders":"","keywords":"Dyslipidemia; Medicine; Population; Diabetes mellitus; Disease; Physical therapy; Internal medicine; Environmental health","score_opus":0.14898389659221287,"score_gpt":0.460383819457116,"score_spread":0.31139992286490314,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2900937465","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2058404,0.0017806228,0.78536165,0.0018096772,0.00023777256,0.0002887379,0.0018905582,0.0013120816,0.0014785863],"genre_scores_gemma":[0.8751631,0.0005044548,0.118587166,0.00030861824,0.00029425425,0.0005421825,0.003155277,0.00013118044,0.0013137995],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9937209,0.004949429,0.00023259455,0.0004942787,0.0004059578,0.00019691043],"domain_scores_gemma":[0.9771234,0.018499777,0.0020589966,0.00061155,0.0013444622,0.00036192767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017910633,0.0015183209,0.0014653438,0.0011520633,0.0004530313,0.0011982898,0.0013261006,0.0007710103,0.0014287634],"category_scores_gemma":[0.032839805,0.00040219486,0.0013056383,0.0011502928,0.0006297622,0.00073087204,0.0010128471,0.002330803,0.000429847],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018709904,0.00041877333,0.10464648,0.00045844296,0.0013038737,0.00028460214,0.0002054241,0.7523106,0.0012067731,0.005825253,0.010435616,0.12103321],"study_design_scores_gemma":[0.00003459692,0.00008305094,0.0026473687,0.000019895344,0.000027318794,0.0000149584175,0.000012651028,0.99561405,0.00015131547,0.0011371503,0.00024814915,0.000009449067],"about_ca_topic_score_codex":0.0058189803,"about_ca_topic_score_gemma":0.0028993604,"teacher_disagreement_score":0.017910633,"about_ca_system_score_codex":0.0006703218,"about_ca_system_score_gemma":0.0016386127,"threshold_uncertainty_score":0.094721615},"labels":[],"label_agreement":null},{"id":"W2902725358","doi":"10.1097/jcp.0000000000000991","title":"Statistics Commentary Series","year":2018,"lang":"en","type":"editorial","venue":"Journal of Clinical Psychopharmacology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; McMaster University","funders":"","keywords":"Library science; Series (stratigraphy); Psychiatry; Psychology; Medicine; Gerontology; Computer science; Biology","score_opus":0.1918737897963293,"score_gpt":0.5953596048181747,"score_spread":0.40348581502184544,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2902725358","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00003577353,0.0056191226,0.0003785626,0.31077728,0.67173713,0.00012290943,0.0014144732,0.00017970528,0.009735069],"genre_scores_gemma":[0.0011462239,0.0059867036,0.000627892,0.26351306,0.6824358,0.00042304446,0.0008153312,0.0002641334,0.044787847],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9894985,0.0026390485,0.0012774755,0.0011108234,0.004934677,0.00053955085],"domain_scores_gemma":[0.9294658,0.036614303,0.0024757837,0.0026241494,0.024180034,0.0046400805],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015074179,0.0016350563,0.0025583655,0.003127898,0.0025787877,0.005211637,0.003780767,0.0147935925,0.07471874],"category_scores_gemma":[0.11200891,0.0010883238,0.002532755,0.00234275,0.002091995,0.0027462505,0.0014121776,0.023528542,0.033792846],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001062163,0.0000024255128,0.0000071651034,0.00006142174,0.0000057045154,0.000013342345,0.0000032493092,0.000008016389,0.000004356424,0.00030650804,0.99778205,0.0017951725],"study_design_scores_gemma":[0.00006728253,0.000010403014,0.00013879022,0.00049613963,0.000021542968,0.000045882614,0.000011432135,0.00006081404,0.000025852769,0.0017799004,0.9973309,0.000011064229],"about_ca_topic_score_codex":0.006414759,"about_ca_topic_score_gemma":0.012237661,"teacher_disagreement_score":0.07471874,"about_ca_system_score_codex":0.005545629,"about_ca_system_score_gemma":0.011067446,"threshold_uncertainty_score":0.24995911},"labels":[],"label_agreement":null},{"id":"W2902926083","doi":"10.1002/sim.8048","title":"Using a monotone single‐index model to stabilize the propensity score in missing data problems and causal inference","year":2018,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Causal inference; Propensity score matching; Inference; Missing data; Index (typography); Statistics; Monotone polygon; Computer science; Econometrics; Causal model; Mathematics; Artificial intelligence","score_opus":0.5427102071927957,"score_gpt":0.4837563441874663,"score_spread":0.0589538630053294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2902926083","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025479114,0.00010535132,0.9966383,0.00021452722,0.00002176869,0.000033293152,0.00003730986,0.00006376726,0.00033784422],"genre_scores_gemma":[0.16565685,0.00073111645,0.8289205,0.00044714788,0.0002978755,0.0007310827,0.0003387474,0.00014847364,0.0027282857],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9857664,0.011074599,0.00033119714,0.0012143791,0.0012876749,0.00032571156],"domain_scores_gemma":[0.9605853,0.030024635,0.0030921942,0.0040410277,0.001872944,0.00038388994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031485084,0.00094326196,0.0018400318,0.0021265978,0.0009759361,0.0014680002,0.0033198947,0.0020143364,0.0043834415],"category_scores_gemma":[0.06883758,0.00075230934,0.002028028,0.003149793,0.002916536,0.0037309527,0.0029013404,0.0039142994,0.0007475601],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017626764,0.00012651276,0.0041238843,0.00028863963,0.000230806,0.00026739392,0.00050265266,0.1553807,0.0012817123,0.71363187,0.002634611,0.121354975],"study_design_scores_gemma":[0.0000735361,0.00012941645,0.00077405147,0.00005985529,0.000058320555,0.00013060175,0.0000417205,0.59092784,0.0006492111,0.40356058,0.003553928,0.000040898576],"about_ca_topic_score_codex":0.003128469,"about_ca_topic_score_gemma":0.0028681688,"teacher_disagreement_score":0.031485084,"about_ca_system_score_codex":0.0011646898,"about_ca_system_score_gemma":0.0032153653,"threshold_uncertainty_score":0.166511},"labels":[],"label_agreement":null},{"id":"W2903123620","doi":"10.3386/w25307","title":"Treatment Effects with Multiple Outcomes","year":2018,"lang":"en","type":"report","venue":"National Bureau of Economic Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Queen's University; Queen's University Belfast; University of Wisconsin-Madison; University of Chicago; Università degli studi di Bergamo; Robert Wood Johnson Foundation","keywords":"Econometrics; Statistics; Mathematics","score_opus":0.6441062607732273,"score_gpt":0.6258726786431317,"score_spread":0.018233582130095627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2903123620","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0066925604,0.0012300776,0.9828116,0.0019697119,0.0001845883,0.00053825206,0.00033589813,0.00015039861,0.0060868384],"genre_scores_gemma":[0.33634463,0.002232982,0.649497,0.00187999,0.00061676046,0.004845119,0.0005034582,0.000114364375,0.0039657312],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9453264,0.040257867,0.0018560211,0.0060484316,0.005705597,0.00080574106],"domain_scores_gemma":[0.83083165,0.14044653,0.009108875,0.016174216,0.0027556056,0.00068314606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.052805744,0.0013237812,0.002974655,0.0031619517,0.0011982014,0.004960223,0.003647756,0.0029409735,0.014709728],"category_scores_gemma":[0.1867765,0.0011748133,0.002828519,0.0037895162,0.0047912137,0.008282578,0.0049628457,0.007596905,0.0011702819],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017891,0.000122864,0.004731996,0.00063382,0.0004346218,0.00013053881,0.0005351374,0.013605988,0.0002100856,0.8828052,0.001603752,0.09500714],"study_design_scores_gemma":[0.000094000294,0.00018155147,0.0021276183,0.00029992525,0.00019675169,0.0001519111,0.00013465871,0.028264333,0.00039848223,0.96072483,0.0073784003,0.000047597703],"about_ca_topic_score_codex":0.001073247,"about_ca_topic_score_gemma":0.0009946143,"teacher_disagreement_score":0.052805744,"about_ca_system_score_codex":0.0026086671,"about_ca_system_score_gemma":0.0024560322,"threshold_uncertainty_score":0.27926677},"labels":[],"label_agreement":null},{"id":"W2905572727","doi":"10.2139/ssrn.3249910","title":"Methods Matter: P-Hacking and Causal Inference in Economics","year":2018,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Causal inference; Hacker; Regression discontinuity design; Randomized experiment; Credibility; Instrumental variable; Identification (biology); Randomized controlled trial; Inference; Statistical inference; Econometrics; Psychology; Statistical hypothesis testing; Statistics; Economics; Computer science; Medicine; Epistemology; Mathematics; Artificial intelligence; Philosophy; Computer security; Internal medicine","score_opus":0.10364846881948976,"score_gpt":0.4459160187302236,"score_spread":0.3422675499107338,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2905572727","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0052731982,0.0018323963,0.974877,0.011229725,0.00057915645,0.000048527025,0.00013561362,0.0002654591,0.0057588317],"genre_scores_gemma":[0.53647065,0.004558645,0.43596134,0.0047975443,0.0041045104,0.0007185869,0.00032339524,0.0006074241,0.012457848],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9570742,0.03534196,0.0011759616,0.0031984262,0.0026945216,0.0005149475],"domain_scores_gemma":[0.59510994,0.362572,0.0064174356,0.029586272,0.0050409064,0.0012733144],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04703324,0.0012587412,0.0025691031,0.0031731215,0.002282129,0.0052931127,0.003060616,0.00443895,0.013939027],"category_scores_gemma":[0.28887495,0.0012807272,0.0026301262,0.0041111885,0.011873087,0.018742984,0.0047326796,0.011945622,0.0014764371],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000072291965,0.00003564889,0.0019398822,0.00018268783,0.00014327781,0.00010315997,0.0002505388,0.0035036812,0.00007229072,0.95772773,0.0034409293,0.032527786],"study_design_scores_gemma":[0.000014147434,0.0000056144236,0.000110577865,0.000029254763,0.000016390446,0.000028553102,0.000015994035,0.009319746,0.00006201407,0.98912877,0.0012628004,0.000006096143],"about_ca_topic_score_codex":0.0023937866,"about_ca_topic_score_gemma":0.0015337054,"teacher_disagreement_score":0.95296675,"about_ca_system_score_codex":0.001694738,"about_ca_system_score_gemma":0.0034455098,"threshold_uncertainty_score":0.24873847},"labels":[],"label_agreement":null},{"id":"W2906156120","doi":"10.1093/aje/kwy275","title":"Point: Risk Ratio Equations for Natural Direct and Indirect Effects in Causal Mediation Analysis of a Binary Mediator and a Binary Outcome—A Fresh Look at the Formulas","year":2018,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Centre Hospitalier de l’Université de Montréal; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Mediation; Binary number; Outcome (game theory); Mediator; Econometrics; Mathematics; Binomial (polynomial); Statistics; Medicine; Mathematical economics; Internal medicine; Sociology","score_opus":0.06949414447764476,"score_gpt":0.4023079516010788,"score_spread":0.332813807123434,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906156120","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017830576,0.011505552,0.900208,0.07120735,0.003967169,0.00015064461,0.0005448902,0.0002877801,0.0103455065],"genre_scores_gemma":[0.085035294,0.02089919,0.8116312,0.038747173,0.011709499,0.0017964619,0.00059532834,0.0007540646,0.028831825],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99121803,0.005642788,0.0006189991,0.00061010226,0.0017697943,0.00014013115],"domain_scores_gemma":[0.95274174,0.03985942,0.0012548136,0.0019840626,0.00397924,0.0001807129],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023685765,0.0013258045,0.0009737882,0.0024123462,0.0005249025,0.0021877165,0.003595826,0.0032194974,0.010184861],"category_scores_gemma":[0.13475335,0.0006457212,0.0015770872,0.0018463993,0.0034214554,0.008506452,0.0017320209,0.011286233,0.004443633],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003127915,0.000021909915,0.000605722,0.00018938347,0.0000408467,0.00017782704,0.00023479303,0.000841058,0.00016967111,0.9086469,0.035675466,0.05336511],"study_design_scores_gemma":[0.000060830105,0.000040352716,0.000450245,0.00026860627,0.000039418097,0.0010954004,0.000073238094,0.010200342,0.0003531756,0.90749395,0.0798857,0.000038715632],"about_ca_topic_score_codex":0.0017606315,"about_ca_topic_score_gemma":0.0011542586,"teacher_disagreement_score":0.023685765,"about_ca_system_score_codex":0.0024616132,"about_ca_system_score_gemma":0.0015207386,"threshold_uncertainty_score":0.12526381},"labels":[],"label_agreement":null},{"id":"W2906515425","doi":"10.1177/0962280218817926","title":"Covariate-adjusted survival analyses in propensity-score matched samples: Imputing potential time-to-event outcomes","year":2018,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"National Institute of Allergy and Infectious Diseases; Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada; National Institutes of Health; National Science Foundation","keywords":"Propensity score matching; Covariate; Statistics; Proportional hazards model; Matching (statistics); Hazard ratio; Survival analysis; Observational study; Accelerated failure time model; Sample size determination; Outcome (game theory); Econometrics; Mathematics; Confidence interval","score_opus":0.7075499601632524,"score_gpt":0.6697690744611742,"score_spread":0.03778088570207827,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906515425","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011159478,0.0002972811,0.9876139,0.00017557158,0.000042140393,0.00015843475,0.00014533951,0.00022159409,0.00018634326],"genre_scores_gemma":[0.3428342,0.00091037195,0.6530678,0.0003563363,0.00016678958,0.0010451904,0.00069231784,0.00010371767,0.00082324585],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98242444,0.014343731,0.00063606264,0.001262804,0.0010942955,0.00023869483],"domain_scores_gemma":[0.963519,0.027673528,0.0032847936,0.0040417355,0.0012509851,0.00023005987],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.028546914,0.0008199118,0.0013568068,0.0020715038,0.0005833763,0.0009881529,0.0019807469,0.0014777825,0.0024097369],"category_scores_gemma":[0.09016752,0.00050481135,0.0023209034,0.0029693225,0.0009995817,0.0014505348,0.0017431695,0.0018174786,0.00030239107],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001538847,0.0004572926,0.056813635,0.0010071695,0.0029677772,0.0007447068,0.0010561474,0.23389038,0.0032956956,0.19753876,0.0045242966,0.49616528],"study_design_scores_gemma":[0.0004485475,0.0007014332,0.013824009,0.00014384152,0.0005861035,0.00036946408,0.00013444904,0.73609656,0.003072294,0.23623426,0.008288607,0.00010034817],"about_ca_topic_score_codex":0.0023855178,"about_ca_topic_score_gemma":0.0016228613,"teacher_disagreement_score":0.9714531,"about_ca_system_score_codex":0.0007206848,"about_ca_system_score_gemma":0.0022438606,"threshold_uncertainty_score":0.1509723},"labels":[],"label_agreement":null},{"id":"W2906741671","doi":"10.1002/sim.8075","title":"Should a propensity score model be super? The utility of ensemble procedures for causal adjustment","year":2018,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Covariate; Logistic regression; Statistics; Inverse probability weighting; Overfitting; Weighting; Regression; Matching (statistics); Mean squared error; Econometrics; Mathematics; Confounding; Computer science; Artificial intelligence; Medicine","score_opus":0.352053424871457,"score_gpt":0.4614552599099146,"score_spread":0.10940183503845757,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906741671","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051162294,0.00027314946,0.9931681,0.00059897744,0.000044441153,0.000033841792,0.000052380212,0.0001954969,0.00051744416],"genre_scores_gemma":[0.35050544,0.0012307265,0.64299583,0.0014689396,0.00039490152,0.00049570075,0.00037089677,0.00034569568,0.0021917948],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9839675,0.0127116805,0.0003951665,0.0013390706,0.0013109659,0.00027569424],"domain_scores_gemma":[0.9247022,0.055892043,0.0028794096,0.013418931,0.002599351,0.00050810666],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.047776204,0.00091029494,0.002164606,0.0015221714,0.0007539026,0.0018754551,0.001934412,0.0014286328,0.004046321],"category_scores_gemma":[0.120453715,0.0008137058,0.0017521498,0.0020302855,0.0020600716,0.0056367507,0.002949504,0.0045901146,0.0007447908],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005211242,0.00012409544,0.012904895,0.0003340294,0.0010767753,0.00015448566,0.0005834086,0.26106444,0.0010277749,0.42792484,0.005799554,0.28848457],"study_design_scores_gemma":[0.000055903867,0.0001239183,0.0013521243,0.00008143565,0.000087762375,0.00008196032,0.000042304226,0.56137294,0.00084887125,0.43125752,0.0046603843,0.0000348157],"about_ca_topic_score_codex":0.002871396,"about_ca_topic_score_gemma":0.0021112766,"teacher_disagreement_score":0.9522238,"about_ca_system_score_codex":0.00086187077,"about_ca_system_score_gemma":0.0022627003,"threshold_uncertainty_score":0.25266773},"labels":[],"label_agreement":null},{"id":"W2908053812","doi":"10.1146/annurev-publhealth-040218-043735","title":"Commentary: Causal Inference for Social Exposures","year":2019,"lang":"en","type":"review","venue":"Annual Review of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Observational study; Confounding; Epidemiology; Inference; Social epidemiology; Causal model; Causality (physics); Causal structure; Psychology; Task (project management); Marginal structural model; Cognitive psychology; Medicine; Computer science; Public health; Social determinants of health; Pathology; Artificial intelligence","score_opus":0.48796161388773407,"score_gpt":0.5757151415730767,"score_spread":0.08775352768534261,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2908053812","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000038395996,0.06360021,0.0006435159,0.84418017,0.08957371,0.00001919927,0.00039438307,0.00004790413,0.0015025202],"genre_scores_gemma":[0.001956164,0.055807844,0.0008388884,0.8021206,0.13586146,0.00012187725,0.00017705018,0.00005714277,0.0030588931],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97740173,0.010541234,0.002210096,0.0026555092,0.0064897835,0.0007017012],"domain_scores_gemma":[0.78470266,0.1788352,0.005041826,0.0036196474,0.025446123,0.0023546498],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03349424,0.0023414877,0.004827634,0.004325378,0.002892575,0.004623326,0.012470606,0.03798432,0.015377286],"category_scores_gemma":[0.18259564,0.0015332425,0.0047787023,0.005511916,0.011449514,0.008338179,0.003066061,0.05030678,0.012978667],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000049794617,0.0000053791673,0.000028836259,0.0017417852,0.000087160464,0.00009499432,0.0001128828,0.00007928137,0.000033767672,0.01169324,0.97497976,0.011093153],"study_design_scores_gemma":[0.00017680391,0.000027553373,0.00031185965,0.01026555,0.00027217527,0.00038571443,0.0001554762,0.0002644353,0.00011619347,0.059219535,0.92873454,0.000070198745],"about_ca_topic_score_codex":0.017700711,"about_ca_topic_score_gemma":0.011870319,"teacher_disagreement_score":0.96650577,"about_ca_system_score_codex":0.0082869725,"about_ca_system_score_gemma":0.016914295,"threshold_uncertainty_score":0.17713666},"labels":[],"label_agreement":null},{"id":"W2908350920","doi":"10.1002/sim.8073","title":"Weighted causal inference methods with mismeasured covariates and misclassified outcomes","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Causal inference; Inverse probability weighting; Logistic regression; Econometrics; Computer science; Statistics; Weighting; Inference; Observational error; Regression; Estimation; Mathematics; Estimator; Artificial intelligence; Medicine","score_opus":0.1192263844432153,"score_gpt":0.4720951276343318,"score_spread":0.3528687431911165,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2908350920","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011993265,0.00046992511,0.9974475,0.0002813318,0.00006072587,0.000060084134,0.00004252006,0.000050776696,0.00038790662],"genre_scores_gemma":[0.16262579,0.0029534907,0.8287,0.0006899707,0.00072413887,0.0011155636,0.00042019621,0.00014085505,0.0026299972],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97159,0.021570161,0.001057791,0.0026426434,0.0026797943,0.00045964736],"domain_scores_gemma":[0.87656814,0.104172446,0.0068775257,0.008952854,0.0030213185,0.00040767735],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.048348486,0.002005827,0.002649746,0.0038130903,0.0012052745,0.0024427476,0.0050764666,0.003162903,0.0052676415],"category_scores_gemma":[0.17079332,0.0010948929,0.0026196588,0.0048373025,0.0034554768,0.0054021887,0.0036420065,0.004754748,0.0007584113],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000911449,0.00009964533,0.0034060522,0.00070611195,0.00060943497,0.00023172874,0.00041400592,0.07715682,0.0004691393,0.7230208,0.0025988214,0.19119626],"study_design_scores_gemma":[0.00007538774,0.00007173503,0.000664822,0.00021380189,0.00017048226,0.00017288233,0.00006294011,0.25628948,0.0006884603,0.736787,0.004763966,0.00003903295],"about_ca_topic_score_codex":0.0029683923,"about_ca_topic_score_gemma":0.002270486,"teacher_disagreement_score":0.9516515,"about_ca_system_score_codex":0.0017794584,"about_ca_system_score_gemma":0.0032975243,"threshold_uncertainty_score":0.25569427},"labels":[],"label_agreement":null},{"id":"W2910054248","doi":"10.1002/pds.4708","title":"Extreme restriction design as a method for reducing confounding by indication in pharmacoepidemiologic research","year":2019,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Manitoba Health; University of British Columbia; McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research; Pfizer; McGill University; Amgen","keywords":"Medicine; Confounding; Propensity score matching; Hazard ratio; Cohort study; Confidence interval; Internal medicine; Proportional hazards model; Population; Observational study; Cohort; Environmental health","score_opus":0.456338404685651,"score_gpt":0.5781146390572948,"score_spread":0.12177623437164375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2910054248","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02527322,0.0015976873,0.94953156,0.0018990483,0.0018964892,0.01469683,0.001141472,0.0011266402,0.002837122],"genre_scores_gemma":[0.15872379,0.0004467259,0.75337905,0.0030637186,0.00079553813,0.080646396,0.00084622914,0.00031638498,0.0017823203],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.3534481,0.6014447,0.015160066,0.01492817,0.013555114,0.0014638638],"domain_scores_gemma":[0.5026962,0.33802095,0.02826421,0.11851113,0.010695987,0.0018116039],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3385477,0.0025482045,0.0049264496,0.0031763827,0.002432472,0.0031555989,0.0042284825,0.0065768366,0.007903051],"category_scores_gemma":[0.40726885,0.0018456595,0.008138577,0.004400716,0.00716574,0.0028707804,0.005843234,0.0074764504,0.0011499817],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.07070312,0.0038255502,0.12076373,0.013493647,0.05317673,0.0030826465,0.009952106,0.022109168,0.0136513645,0.22075869,0.036831263,0.431652],"study_design_scores_gemma":[0.05320703,0.044977944,0.093611486,0.006035777,0.02262067,0.0033063996,0.001782146,0.14231646,0.02211575,0.38727203,0.22115533,0.0015989626],"about_ca_topic_score_codex":0.0011202092,"about_ca_topic_score_gemma":0.0008229296,"teacher_disagreement_score":0.6614523,"about_ca_system_score_codex":0.0015926401,"about_ca_system_score_gemma":0.003602266,"threshold_uncertainty_score":0.81568843},"labels":[],"label_agreement":null},{"id":"W2911416111","doi":"10.1136/bmjebm-2018-111069","title":"Causal inference for clinicians","year":2019,"lang":"en","type":"article","venue":"BMJ evidence-based medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital","funders":"","keywords":"Inference; Causal inference; Psychology; Computer science; Artificial intelligence; Econometrics; Mathematics","score_opus":0.38310932339326553,"score_gpt":0.5368590741435255,"score_spread":0.15374975075025998,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2911416111","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010245813,0.010517914,0.82330376,0.13148777,0.003511692,0.0005379261,0.00087280513,0.00060868025,0.028134916],"genre_scores_gemma":[0.10478613,0.016911425,0.82452714,0.029835826,0.009032702,0.0035353398,0.0011517666,0.000462189,0.009757541],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.92437714,0.061859425,0.0033987125,0.0044709714,0.005227085,0.00066661095],"domain_scores_gemma":[0.673441,0.28606725,0.008927881,0.01679979,0.012900952,0.0018630952],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.095994756,0.0018417476,0.0028760103,0.0059007835,0.0028388319,0.009466123,0.004762341,0.0089463685,0.031455826],"category_scores_gemma":[0.33025423,0.0015890806,0.0030731936,0.0043149274,0.012683518,0.012403453,0.006053475,0.016934175,0.0065989494],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008380202,0.000044910397,0.0007514376,0.0010613069,0.00016977623,0.00020297205,0.0010728516,0.003387652,0.00009821145,0.8656096,0.04249931,0.085018195],"study_design_scores_gemma":[0.000036898877,0.000011539558,0.000072514595,0.00049528794,0.000024368652,0.00008613234,0.00012014419,0.0034867888,0.00006548674,0.9647131,0.030870315,0.000017343258],"about_ca_topic_score_codex":0.0042017153,"about_ca_topic_score_gemma":0.002708673,"teacher_disagreement_score":0.095994756,"about_ca_system_score_codex":0.0052030734,"about_ca_system_score_gemma":0.011103861,"threshold_uncertainty_score":0.5076749},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2912071366","doi":"10.1136/bmjopen-2018-024096","title":"Design characteristics and statistical methods used in interrupted time series studies evaluating public health interventions: protocol for a review","year":2019,"lang":"en","type":"review","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Health and Medical Research Council; Medical Research Council; Monash University","keywords":"Medicine; Research design; Clinical study design; Observational study; Public health; Psychological intervention; Sample size determination; Interrupted Time Series Analysis; Protocol (science); Interrupted time series; Stratified sampling; Sample (material); Data science; Management science; Computer science; Statistics; Alternative medicine; Clinical trial; Engineering; Nursing","score_opus":0.9469505657783722,"score_gpt":0.779869026220801,"score_spread":0.1670815395575712,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2912071366","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002542214,0.0022068748,0.0026675605,0.00056007784,0.00056882424,0.9860691,0.006716058,0.0001501346,0.0008071106],"genre_scores_gemma":[0.00022360178,0.0008071665,0.003007484,0.0001572689,0.000032246946,0.9951231,0.00043726066,0.00001409637,0.00019779646],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.91555333,0.03655816,0.030882532,0.004860533,0.009527359,0.0026180616],"domain_scores_gemma":[0.8217229,0.075617604,0.039365232,0.012403657,0.0476591,0.0032314684],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.110669985,0.004772257,0.013418644,0.016776443,0.0036308581,0.0077020624,0.0051647485,0.00755403,0.081843615],"category_scores_gemma":[0.23711278,0.0041345432,0.015045398,0.018007496,0.0042184894,0.0076389415,0.004329559,0.006752565,0.016473057],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0046239346,0.0003444402,0.0007119761,0.8471145,0.0024586928,0.00038973484,0.0014030829,0.0013135119,0.00091630843,0.006491534,0.08288048,0.051351797],"study_design_scores_gemma":[0.019132977,0.0016273883,0.0047064316,0.6146361,0.0057579717,0.00043352263,0.0017013896,0.0015694606,0.0019539753,0.014730722,0.3333429,0.00040708322],"about_ca_topic_score_codex":0.0035138086,"about_ca_topic_score_gemma":0.006677756,"teacher_disagreement_score":0.88933,"about_ca_system_score_codex":0.015313824,"about_ca_system_score_gemma":0.050778933,"threshold_uncertainty_score":0.5852858},"labels":[],"label_agreement":null},{"id":"W2912909587","doi":"10.2139/ssrn.1133595","title":"Assessing Racial Discrimination in Parole Release in the U.S.: An Approach Based on Outcome Tests","year":2008,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University; HEC Montréal","funders":"","keywords":"Outcome (game theory); Psychology; Criminology; Political science; Social psychology; Economics; Mathematical economics","score_opus":0.2069318959140339,"score_gpt":0.4347749968915277,"score_spread":0.2278431009774938,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2912909587","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9843365,0.00019534313,0.010759669,0.0005269308,0.000042880267,0.00015599145,0.0005187786,0.000026083831,0.0034378378],"genre_scores_gemma":[0.9956155,0.000071603914,0.0033434583,0.00008219629,0.00001960565,0.00014422706,0.00033671595,0.0000050519147,0.00038169982],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9879924,0.009242909,0.00031820533,0.0007120035,0.0012256472,0.00050888385],"domain_scores_gemma":[0.9569635,0.031006915,0.007166818,0.0017587413,0.001719136,0.0013849393],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016405256,0.0007008684,0.0010518213,0.0029416264,0.0017067906,0.0020541667,0.0018745261,0.001573271,0.0031363904],"category_scores_gemma":[0.063290484,0.00029872442,0.0010156197,0.002674673,0.0017723182,0.0014206452,0.0030870743,0.0026891015,0.00047167254],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054617994,0.00095657347,0.9624364,0.000060485763,0.00031473153,0.00009624389,0.0009651436,0.0028078535,0.0002570097,0.006509034,0.0009165532,0.02413378],"study_design_scores_gemma":[0.00017668991,0.0023240054,0.9178634,0.00013997706,0.0006646907,0.0001907113,0.005335805,0.05031792,0.0018501402,0.019345917,0.0017214607,0.0000692294],"about_ca_topic_score_codex":0.0176837,"about_ca_topic_score_gemma":0.02064019,"teacher_disagreement_score":0.0176837,"about_ca_system_score_codex":0.00095455203,"about_ca_system_score_gemma":0.0019794134,"threshold_uncertainty_score":0.08676034},"labels":[],"label_agreement":null},{"id":"W2913795110","doi":"","title":"My Friend Far Far Away: Asymptotic Properties of Pairwise Stable Networks","year":2013,"lang":"en","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; University of Cambridge; Université Laval","keywords":"Pairwise comparison; Homophily; Estimator; Set (abstract data type); Computer science; Mathematics; Mathematical optimization; Theoretical computer science; Statistics; Combinatorics; Artificial intelligence","score_opus":0.13140597674026105,"score_gpt":0.3698184686459345,"score_spread":0.23841249190567343,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2913795110","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1583227,0.0011275783,0.82334477,0.002053877,0.00006762909,0.000090030546,0.0005802355,0.00037563167,0.014037577],"genre_scores_gemma":[0.92079854,0.0013634961,0.069271356,0.00040936336,0.00020294488,0.000382277,0.0009506236,0.00024682577,0.0063746506],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9977386,0.0010957234,0.000054492593,0.00054957526,0.00040155245,0.00016003713],"domain_scores_gemma":[0.9565703,0.033982746,0.003345783,0.0030831853,0.0019657293,0.0010522347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0073580234,0.00056997035,0.00096952886,0.0024882536,0.0015530495,0.0019734164,0.0020176836,0.0014606168,0.009879211],"category_scores_gemma":[0.09151264,0.0005979021,0.00090304273,0.0021706736,0.0025622207,0.0067107794,0.0025335094,0.0031192922,0.0009968266],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021087393,0.00011074938,0.01825329,0.00024152707,0.00016574743,0.0005869704,0.0016210716,0.05372213,0.00227829,0.8434914,0.005517296,0.07380068],"study_design_scores_gemma":[0.000032075754,0.00006879936,0.0043589114,0.00007575756,0.000048899565,0.00044560237,0.0002967936,0.2671286,0.0011249094,0.7233418,0.0030353456,0.00004243293],"about_ca_topic_score_codex":0.0026336284,"about_ca_topic_score_gemma":0.0024920425,"teacher_disagreement_score":0.009879211,"about_ca_system_score_codex":0.0013181431,"about_ca_system_score_gemma":0.00064662314,"threshold_uncertainty_score":0.03891343},"labels":[],"label_agreement":null},{"id":"W2913892683","doi":"10.1513/annalsats.201901-070le","title":"Reply: More on Causal Inference Studies","year":2019,"lang":"en","type":"letter","venue":"Annals of the American Thoracic Society","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Western University","funders":"","keywords":"Medicine; Causal inference; Inference; MEDLINE; Intensive care medicine; Artificial intelligence; Pathology","score_opus":0.42315660559657453,"score_gpt":0.5451764451784764,"score_spread":0.12201983958190188,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2913892683","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000056617442,0.0003662904,0.000057509365,0.988633,0.010178348,0.000006571024,0.000110637804,0.00001845193,0.00057258236],"genre_scores_gemma":[0.00038624028,0.00013132018,0.00007799645,0.98987013,0.008168987,0.000015148737,0.000024340488,0.000011204897,0.0013146047],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.991627,0.002783749,0.0012847439,0.0012776535,0.0022770187,0.00074996677],"domain_scores_gemma":[0.9592469,0.028275074,0.0017775428,0.0014221426,0.0065229796,0.0027554038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013414623,0.0010961785,0.002275559,0.0015574509,0.005356252,0.006113752,0.0031560264,0.079502404,0.015846863],"category_scores_gemma":[0.076981574,0.0011845569,0.0026140122,0.0015326403,0.005600327,0.008419472,0.0033579282,0.08023439,0.01645976],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039017246,0.000013210791,0.00024445012,0.000034009703,0.000010912846,0.00018218474,0.00005560201,0.000020229973,0.00005685888,0.0016102743,0.9953166,0.0024166016],"study_design_scores_gemma":[0.0002961682,0.000058867034,0.0017185506,0.0005144836,0.000055031203,0.0008993155,0.00043726017,0.00038358718,0.00029622132,0.023025682,0.9721728,0.00014210658],"about_ca_topic_score_codex":0.011425494,"about_ca_topic_score_gemma":0.013431653,"teacher_disagreement_score":0.079502404,"about_ca_system_score_codex":0.0056764847,"about_ca_system_score_gemma":0.007065207,"threshold_uncertainty_score":0.07094413},"labels":[],"label_agreement":null},{"id":"W2914109878","doi":"10.1289/isee.2014.p1-263","title":"Case: Control Matching Strategies on Associations between Cellular Telephone Use and Glioma Risk in the INTERPHONE Study","year":2014,"lang":"en","type":"article","venue":"ISEE Conference Abstracts","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université de Montréal; Université du Québec; BC Cancer Agency; University of Ottawa","funders":"","keywords":"Library science; Agency (philosophy); History; Sociology; Computer science; Social science","score_opus":0.1253507366700997,"score_gpt":0.36936287307082266,"score_spread":0.24401213640072297,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2914109878","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9435941,0.0030367596,0.040048044,0.0006542445,0.00043178862,0.0046525854,0.0024542077,0.00011014091,0.0050180275],"genre_scores_gemma":[0.9782708,0.0006263073,0.012340958,0.00044183328,0.00012959559,0.0028363257,0.0024526687,0.000025608506,0.002875909],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98111284,0.01399258,0.0013436957,0.0014317828,0.0013516113,0.00076747744],"domain_scores_gemma":[0.98496705,0.008371956,0.001701604,0.0032600113,0.0013236096,0.0003757437],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019232765,0.00073516497,0.0009437596,0.0020676581,0.0008680294,0.00080908067,0.0017809853,0.0012727063,0.005577846],"category_scores_gemma":[0.059355315,0.00058043347,0.001087848,0.0016940105,0.0002877333,0.0008558212,0.0012960859,0.00057524326,0.00061292574],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.060421802,0.0043799346,0.7095248,0.00084948837,0.008768788,0.00089166325,0.0016648901,0.004454988,0.005101567,0.005733672,0.012026386,0.1861821],"study_design_scores_gemma":[0.0149822105,0.009348387,0.8688016,0.00052451674,0.010110523,0.0010723274,0.001770077,0.057600003,0.004731448,0.011887101,0.019003106,0.00016870223],"about_ca_topic_score_codex":0.004306412,"about_ca_topic_score_gemma":0.0031898043,"teacher_disagreement_score":0.019232765,"about_ca_system_score_codex":0.0006058132,"about_ca_system_score_gemma":0.0006692219,"threshold_uncertainty_score":0.10171378},"labels":[],"label_agreement":null},{"id":"W2914649162","doi":"10.4324/9781315755649-2","title":"Analysis of Variance","year":2018,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Observational study; Repeated measures design; Variance (accounting); Research design; Statistics; Sample size determination; Analysis of variance; Clinical study design; Psychology; Design of experiments; Sample (material); Econometrics; Variable (mathematics); Mathematics; Computer science; Medicine; Clinical trial","score_opus":0.17167256795051344,"score_gpt":0.4059815696570885,"score_spread":0.23430900170657504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2914649162","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01931648,0.0044372366,0.8250179,0.0024556716,0.0067977267,0.011270889,0.027922478,0.0106636565,0.09211802],"genre_scores_gemma":[0.106514126,0.0036098098,0.803551,0.0014726232,0.0010073247,0.03630497,0.012196909,0.0041544316,0.031188868],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9756007,0.0096372655,0.001728075,0.00424951,0.008288434,0.00049603893],"domain_scores_gemma":[0.9496671,0.031410746,0.0023187771,0.006411041,0.009768568,0.00042378937],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019517144,0.0024370793,0.0027658946,0.0032040395,0.0012070058,0.0039562657,0.0022213547,0.0010973796,0.048421863],"category_scores_gemma":[0.08303247,0.0005295567,0.0020612383,0.0043030498,0.0013543101,0.0016411359,0.002046572,0.0032412738,0.012774633],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013595227,0.0006109654,0.004172536,0.0035773504,0.0015896324,0.000192668,0.0023602725,0.0048524304,0.0036603848,0.05452058,0.14511818,0.77798545],"study_design_scores_gemma":[0.00058573426,0.002973465,0.022016931,0.0027467855,0.0012757255,0.00037374723,0.0019322254,0.022396076,0.006841461,0.1007454,0.83779556,0.00031690366],"about_ca_topic_score_codex":0.0029162534,"about_ca_topic_score_gemma":0.0025739525,"teacher_disagreement_score":0.048421863,"about_ca_system_score_codex":0.002069873,"about_ca_system_score_gemma":0.004892971,"threshold_uncertainty_score":0.16198725},"labels":[],"label_agreement":null},{"id":"W2915065822","doi":"10.1007/s40471-019-0180-5","title":"Immortal Time Bias in Epidemiology","year":2019,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":47,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; McGill University; Jewish General Hospital; McGill University Health Centre","funders":"","keywords":"Epidemiology; Context (archaeology); Pharmacoepidemiology; Medicine; Pathology; Biology; Pharmacology","score_opus":0.45766667753120593,"score_gpt":0.5141528458328342,"score_spread":0.056486168301628226,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2915065822","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042059086,0.039580964,0.87001646,0.029214522,0.0019674017,0.00008760509,0.000552535,0.0004367936,0.01608468],"genre_scores_gemma":[0.83505654,0.025911124,0.10756432,0.004842017,0.006469897,0.00023326318,0.0005483183,0.00023761018,0.019136783],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9886509,0.008353626,0.00037415387,0.0011302872,0.0011806658,0.00031028106],"domain_scores_gemma":[0.8548271,0.12498181,0.0056900163,0.009216689,0.0042462233,0.0010381707],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02868354,0.0006332063,0.0013488457,0.0031209693,0.0007627949,0.002290162,0.0017771086,0.0018084757,0.006638748],"category_scores_gemma":[0.14332123,0.00055523985,0.0012268241,0.00316399,0.0038395186,0.004924349,0.0023191285,0.005068395,0.0007581009],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007472355,0.000037036305,0.00805704,0.00037383303,0.00022670919,0.00013572988,0.00052325014,0.0058770482,0.00013339525,0.9338175,0.0055496083,0.045194123],"study_design_scores_gemma":[0.000015130954,0.000017313147,0.0014320911,0.00007935662,0.000061658415,0.00014072357,0.00005345208,0.008037764,0.00011683929,0.9849475,0.005088557,0.000009652258],"about_ca_topic_score_codex":0.0018385961,"about_ca_topic_score_gemma":0.0011357063,"teacher_disagreement_score":0.97131646,"about_ca_system_score_codex":0.0013884612,"about_ca_system_score_gemma":0.0019052887,"threshold_uncertainty_score":0.1516949},"labels":[],"label_agreement":null},{"id":"W2915181725","doi":"10.48550/arxiv.1902.07343","title":"Estimation and Inference for Synthetic Control Methods with Spillover Effects","year":2019,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Booth University College","funders":"","keywords":"Spillover effect; Estimator; Inference; Econometrics; Estimation; Control (management); Computer science; Statistics; Mathematics; Economics; Artificial intelligence","score_opus":0.15216136572999706,"score_gpt":0.33093074034018455,"score_spread":0.1787693746101875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2915181725","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028615245,0.00011756733,0.9959188,0.00018330364,0.00003347024,0.00008174815,0.00008041631,0.00009108687,0.00063217536],"genre_scores_gemma":[0.30147767,0.00041668757,0.69271857,0.00048426577,0.00020373179,0.0012397493,0.0008099761,0.00015904233,0.0024902488],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9610081,0.032053597,0.0011616453,0.002593968,0.0028202245,0.00036236874],"domain_scores_gemma":[0.83564365,0.13632154,0.0074903457,0.015790783,0.0044052373,0.0003483944],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05578272,0.0010744669,0.001412754,0.002532808,0.0009541051,0.002369768,0.0026311434,0.0020261314,0.006412216],"category_scores_gemma":[0.20252928,0.00093250716,0.0017637064,0.0020690903,0.0030007758,0.0024901691,0.0027003055,0.0025643469,0.0005891389],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014284381,0.00014414467,0.007879766,0.00039573363,0.00069791917,0.0001708883,0.0004944803,0.17206834,0.00081785495,0.70343703,0.0026644524,0.11108655],"study_design_scores_gemma":[0.00008811262,0.00007195384,0.0015298271,0.00013149003,0.000105105675,0.00009495878,0.00008058432,0.52517605,0.0013473018,0.4663012,0.0050333655,0.000040123577],"about_ca_topic_score_codex":0.003116313,"about_ca_topic_score_gemma":0.0020155187,"teacher_disagreement_score":0.05578272,"about_ca_system_score_codex":0.001556708,"about_ca_system_score_gemma":0.001983466,"threshold_uncertainty_score":0.29501075},"labels":[],"label_agreement":null},{"id":"W2918520331","doi":"10.1002/cjs.11490","title":"When exposure is subject to nondifferential misclassification, are validation data helpful in testing for an exposure–disease association?","year":2019,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"Centre for Advancing Health Outcomes; Providence Health Care; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Variable (mathematics); Statistics; Surrogate endpoint; Disease; Research design; Variables; Clinical study design; Medicine; Econometrics; Computer science; Mathematics; Clinical trial; Pathology","score_opus":0.22232079577962238,"score_gpt":0.378983718950411,"score_spread":0.15666292317078861,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2918520331","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16396326,0.006894281,0.7860831,0.030757016,0.00082716823,0.00080501067,0.002483907,0.00024965993,0.00793656],"genre_scores_gemma":[0.84452564,0.0014023251,0.14585227,0.0046265167,0.00046495438,0.00074661284,0.000625377,0.00009931468,0.0016570041],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84911126,0.12305864,0.009245674,0.008670673,0.008827927,0.0010857764],"domain_scores_gemma":[0.21013659,0.7095343,0.031464648,0.041605923,0.0063916235,0.0008669624],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26835313,0.0007317673,0.0032816743,0.0025777072,0.0010762777,0.0040785563,0.0031797984,0.0042780763,0.0063468646],"category_scores_gemma":[0.6276854,0.0008535344,0.002791403,0.0037895632,0.008401208,0.0050283163,0.0030724895,0.0044532097,0.00044336254],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004300008,0.00041455217,0.25687495,0.003021662,0.006761553,0.0018035976,0.00234245,0.05425698,0.002268412,0.31591856,0.01207575,0.3399615],"study_design_scores_gemma":[0.0007173878,0.000841276,0.07144844,0.0015773422,0.0023053272,0.0015913963,0.00078112254,0.07574735,0.004353875,0.8255884,0.014852104,0.00019596363],"about_ca_topic_score_codex":0.0054174755,"about_ca_topic_score_gemma":0.004435927,"teacher_disagreement_score":0.7316469,"about_ca_system_score_codex":0.0019079171,"about_ca_system_score_gemma":0.0030375507,"threshold_uncertainty_score":0.9022508},"labels":[],"label_agreement":null},{"id":"W2920887687","doi":"10.1093/aje/kwy280","title":"A Future for Observational Epidemiology: Clarity, Credibility, Transparency","year":2018,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Epidemiology; CLARITY; Credibility; Transparency (behavior); Psychological intervention; Medicine; Causal inference; Population; Environmental health; Computer science; Pathology; Psychiatry; Biology","score_opus":0.45769032009790966,"score_gpt":0.5216762008091765,"score_spread":0.06398588071126687,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2920887687","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015253755,0.043459814,0.12974642,0.8073306,0.008063375,0.00012211259,0.00016181593,0.00019514837,0.009395376],"genre_scores_gemma":[0.26248094,0.06561676,0.4431236,0.1717531,0.0474084,0.0017457274,0.00038450546,0.00043337906,0.007053615],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7996644,0.16600281,0.0073649692,0.0066159456,0.018741434,0.0016104147],"domain_scores_gemma":[0.2943023,0.60389066,0.01512753,0.046006218,0.03451206,0.0061611817],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.31207275,0.0012077746,0.0035295615,0.005170502,0.005564268,0.020422796,0.0044878433,0.015416827,0.007538385],"category_scores_gemma":[0.51654005,0.0014672512,0.0028932006,0.0029206602,0.043426134,0.052150343,0.011660593,0.03428441,0.0017308953],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010064336,0.000045354995,0.0006553103,0.0005816916,0.00007441018,0.00010280273,0.0015555843,0.00092088355,0.00013792086,0.93248636,0.020844903,0.04249422],"study_design_scores_gemma":[0.00003239692,0.000020404617,0.00023730131,0.00074252055,0.0000239792,0.00007858684,0.00031948832,0.0009871325,0.00007094755,0.96296734,0.034481276,0.000038545124],"about_ca_topic_score_codex":0.0031818994,"about_ca_topic_score_gemma":0.0020782235,"teacher_disagreement_score":0.68792725,"about_ca_system_score_codex":0.0074162525,"about_ca_system_score_gemma":0.016454024,"threshold_uncertainty_score":0.84833676},"labels":[],"label_agreement":null},{"id":"W2921058067","doi":"10.5539/mas.v13n4p40","title":"A Weighted Covariate Balancing Method of Estimating Causal Effects in Case-Control Studies","year":2019,"lang":"en","type":"article","venue":"Modern Applied Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Covariate; Observational study; Mahalanobis distance; Statistics; Weighting; Computer science; Econometrics; Mathematics; Propensity score matching; Monte Carlo method; Rank (graph theory); Medicine","score_opus":0.08025093776596098,"score_gpt":0.41369464480832424,"score_spread":0.33344370704236326,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2921058067","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033848793,0.0002907727,0.99526155,0.00017830334,0.00005478938,0.00019425152,0.00010833049,0.00013390151,0.00039329988],"genre_scores_gemma":[0.122773185,0.00062283746,0.8718494,0.00030951315,0.00026336208,0.0019197759,0.00066365325,0.00011418546,0.0014840566],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96591,0.0277638,0.0011599815,0.002290918,0.002532381,0.000342873],"domain_scores_gemma":[0.95960516,0.029556766,0.0029767489,0.00480466,0.0026862004,0.00037045073],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.038494844,0.0011009045,0.0017805438,0.0037402357,0.0013054077,0.0016443235,0.0027862103,0.002183615,0.005149896],"category_scores_gemma":[0.10040086,0.00064372335,0.0022877466,0.0041619474,0.0015717383,0.0024172717,0.0028153865,0.0022636522,0.00078172056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00066629384,0.00033501777,0.0162009,0.001125695,0.0015807177,0.00038624732,0.00093462586,0.095797,0.003500281,0.27954236,0.0065853125,0.5933456],"study_design_scores_gemma":[0.0005956034,0.000705456,0.007179868,0.0004652889,0.0006250175,0.0005343854,0.0002347246,0.60506445,0.0034138993,0.35652378,0.024482029,0.00017552135],"about_ca_topic_score_codex":0.0020514776,"about_ca_topic_score_gemma":0.0015785369,"teacher_disagreement_score":0.9615052,"about_ca_system_score_codex":0.0008055292,"about_ca_system_score_gemma":0.0023565174,"threshold_uncertainty_score":0.20358258},"labels":[],"label_agreement":null},{"id":"W2921476564","doi":"10.1002/sim.8132","title":"A test for the correct specification of marginal structural models","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; The Quebec Population Health Research Network","funders":"Natural Sciences and Engineering Research Council of Canada; Fondation du CHUM","keywords":"Marginal structural model; Inverse probability; Computer science; Estimator; Econometrics; Outcome (game theory); Confounding; Statistics; Causal model; Mathematics; Bayesian probability; Posterior probability","score_opus":0.14322652898192254,"score_gpt":0.43763620167038475,"score_spread":0.2944096726884622,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2921476564","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18010063,0.00033629168,0.80738884,0.0026947795,0.00022877027,0.00060114526,0.002481255,0.0010573923,0.0051108385],"genre_scores_gemma":[0.8217149,0.00014111269,0.17383282,0.0004910215,0.00015124647,0.00095598283,0.0015942121,0.00013836141,0.0009803469],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92477506,0.05655202,0.0031390542,0.008213588,0.0057261446,0.0015940618],"domain_scores_gemma":[0.32797372,0.6402159,0.010114361,0.014775012,0.0056568068,0.0012641312],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.062834494,0.0014556645,0.002962367,0.0029728496,0.0014925253,0.0023330397,0.003840146,0.0040395064,0.015070986],"category_scores_gemma":[0.44042715,0.0009139377,0.0031043016,0.0038852643,0.0047693495,0.0039891205,0.0025191416,0.0041654925,0.001125446],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032049709,0.0009858547,0.2700348,0.0015665288,0.008088588,0.002406408,0.0033806989,0.11677309,0.004018512,0.30943337,0.012171131,0.26793608],"study_design_scores_gemma":[0.0011864555,0.0028649918,0.0626245,0.00040942512,0.0009816772,0.001309642,0.001655177,0.69370544,0.0041335807,0.21946992,0.011461753,0.00019747847],"about_ca_topic_score_codex":0.005548864,"about_ca_topic_score_gemma":0.0025979795,"teacher_disagreement_score":0.062834494,"about_ca_system_score_codex":0.0014535437,"about_ca_system_score_gemma":0.005931668,"threshold_uncertainty_score":0.33230448},"labels":[],"label_agreement":null},{"id":"W2921943956","doi":"10.1002/sim.8121","title":"Bayesian estimation of the average treatment effect on the treated using inverse weighting","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Vanderbilt University","keywords":"Confounding; Statistics; Marginal structural model; Context (archaeology); Bayesian probability; Weighting; Posterior probability; Inverse probability; Econometrics; Estimation; Sample size determination; Average treatment effect; Inverse probability weighting; Marginal likelihood; Mathematics; Computer science; Medicine; Propensity score matching; Economics","score_opus":0.06999270852247445,"score_gpt":0.4013656679853423,"score_spread":0.3313729594628678,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2921943956","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038244901,0.00019532652,0.99467975,0.0002769668,0.00002439753,0.00007064765,0.0000746405,0.000060647868,0.000793258],"genre_scores_gemma":[0.20311071,0.0010674213,0.7913427,0.00043720283,0.00018800954,0.0008630157,0.00044429998,0.00009951345,0.0024471306],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9843321,0.011073149,0.000560023,0.0014901771,0.0021484247,0.00039613058],"domain_scores_gemma":[0.95598865,0.036830492,0.0019949637,0.0031701587,0.0017392718,0.00027654954],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026091967,0.00086466793,0.0025507924,0.002635439,0.00059017073,0.0018117651,0.0032274183,0.0016791926,0.0052363873],"category_scores_gemma":[0.09408993,0.00077021646,0.0021110817,0.002282676,0.0017107739,0.0026344638,0.0022913958,0.0031930096,0.0006312846],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022347775,0.00022714555,0.008641398,0.00043310496,0.0007454652,0.00020360594,0.0005648762,0.17123388,0.0018088565,0.5950545,0.0026700043,0.21819371],"study_design_scores_gemma":[0.00010936257,0.00013204683,0.0025409765,0.00015023607,0.00023679966,0.00014517426,0.000060437753,0.45328405,0.0012021598,0.536917,0.005170188,0.000051613024],"about_ca_topic_score_codex":0.004689835,"about_ca_topic_score_gemma":0.0036190057,"teacher_disagreement_score":0.026091967,"about_ca_system_score_codex":0.0012149289,"about_ca_system_score_gemma":0.00263149,"threshold_uncertainty_score":0.13798916},"labels":[],"label_agreement":null},{"id":"W2927518299","doi":"10.1007/s43441-019-00061-x","title":"Choosing Estimands in Clinical Trials: Putting the ICH E9(R1) Into Practice","year":2020,"lang":"en","type":"article","venue":"Therapeutic Innovation & Regulatory Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":78,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Eli Lilly (Canada)","funders":"","keywords":"Generalizability theory; Clinical trial; Psychology; Causal inference; Management science; Medical education; Medicine","score_opus":0.5758803589607833,"score_gpt":0.5856898343720771,"score_spread":0.009809475411293844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2927518299","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039744116,0.0042392323,0.9677861,0.018403033,0.0004665493,0.00048484682,0.00020350855,0.00022485178,0.004217495],"genre_scores_gemma":[0.17167254,0.0036341134,0.81008583,0.007980899,0.0015770519,0.0019758905,0.00026748833,0.0003520928,0.0024540278],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5287726,0.43795946,0.009801364,0.010310854,0.012125195,0.0010305623],"domain_scores_gemma":[0.13981274,0.8303871,0.006687082,0.016939247,0.004698954,0.0014748187],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.33461797,0.0028273612,0.009718444,0.0036532294,0.001829433,0.0069674705,0.0059378822,0.010379151,0.008250639],"category_scores_gemma":[0.65900385,0.0028485034,0.0047119716,0.0032243673,0.012243091,0.010262222,0.007901215,0.021503681,0.001497123],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025906495,0.00028791584,0.0045018955,0.00280767,0.0021371625,0.0005591162,0.0012030716,0.043340616,0.0004056997,0.7000087,0.013722335,0.22843523],"study_design_scores_gemma":[0.00070730556,0.00030976295,0.0004962876,0.0006679018,0.00032576697,0.00009714745,0.00009528017,0.061875585,0.00035657323,0.92972606,0.005287604,0.00005468293],"about_ca_topic_score_codex":0.0034643388,"about_ca_topic_score_gemma":0.003347145,"teacher_disagreement_score":0.665382,"about_ca_system_score_codex":0.0030735368,"about_ca_system_score_gemma":0.01102231,"threshold_uncertainty_score":0.8205345},"labels":[],"label_agreement":null},{"id":"W2933605766","doi":"10.1177/0962280219837656","title":"Handling ties in continuous outcomes for confounder adjustment with rank-ordered logit and its application to ordinal outcomes","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Institut universitaire en santé mentale de Montréal","funders":"National Medical Research Council; Cancerfonden","keywords":"Econometrics; Odds; Statistics; Ordered logit; Ordinal data; Logit; Confounding; Ordinal regression; Mathematics; Scaling; Equivalence (formal languages); Computer science; Logistic regression; Discrete mathematics","score_opus":0.2995074587587282,"score_gpt":0.6181559167719965,"score_spread":0.31864845801326835,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2933605766","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009055408,0.00036540828,0.9888487,0.0005985941,0.000059466947,0.00014170574,0.00014121196,0.00022597394,0.0005635936],"genre_scores_gemma":[0.32354268,0.00083092635,0.6709551,0.0007625059,0.0002231759,0.0011898078,0.00043978955,0.00021453631,0.001841412],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94492656,0.046956725,0.0013956713,0.002837319,0.0033532402,0.00053055026],"domain_scores_gemma":[0.834626,0.13929456,0.0111728,0.010850904,0.00337634,0.0006793654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.062340267,0.00095367525,0.0013761177,0.002706009,0.0011067141,0.0026638235,0.002108958,0.0018683065,0.005370084],"category_scores_gemma":[0.24111249,0.00065811706,0.0024258245,0.0036227715,0.00324799,0.0034494149,0.0037589849,0.0036857685,0.0006815422],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010375461,0.00021679173,0.049593277,0.0012071745,0.0015480816,0.0014141438,0.003324197,0.15355788,0.0023387687,0.4475108,0.006322395,0.33192894],"study_design_scores_gemma":[0.0001729872,0.00023795043,0.006881914,0.0002756751,0.00029421074,0.00056069397,0.00035154642,0.3803805,0.0017190009,0.59648675,0.012499603,0.0001392423],"about_ca_topic_score_codex":0.0033096059,"about_ca_topic_score_gemma":0.002706919,"teacher_disagreement_score":0.062340267,"about_ca_system_score_codex":0.0012120797,"about_ca_system_score_gemma":0.0029907126,"threshold_uncertainty_score":0.3296908},"labels":[],"label_agreement":null},{"id":"W2937710358","doi":"10.1177/0962280219842362","title":"Comparing the high-dimensional propensity score for use with administrative data with propensity scores derived from high-quality clinical data","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University Health Network; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Covariate; Confounding; Medicine; Hazard ratio; Proxy (statistics); Statistics; Internal medicine; Mathematics; Confidence interval","score_opus":0.899460556396185,"score_gpt":0.6935688475760646,"score_spread":0.20589170882012042,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2937710358","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28422734,0.003170917,0.6890529,0.0031459092,0.000910259,0.003617599,0.008342335,0.00083892065,0.006693829],"genre_scores_gemma":[0.8178158,0.0010816618,0.16901596,0.00078306795,0.0003107222,0.0031208994,0.006680466,0.00037151924,0.0008199891],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7637499,0.20660488,0.009401776,0.0075723627,0.011530155,0.0011409275],"domain_scores_gemma":[0.59224933,0.32324582,0.029958647,0.038512453,0.014149445,0.0018842213],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15550713,0.0015015253,0.0022850793,0.004823865,0.0008100982,0.0045949123,0.0026449012,0.0014764371,0.008601874],"category_scores_gemma":[0.43937397,0.0008103344,0.005597482,0.009547222,0.0017260655,0.004506249,0.0051618996,0.0030493885,0.0010538272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008913641,0.0011520415,0.5591396,0.002229408,0.040611207,0.00030201595,0.00155548,0.0675488,0.00063714973,0.04533185,0.014402476,0.2581764],"study_design_scores_gemma":[0.005482201,0.0065946053,0.4648247,0.0014511578,0.008822635,0.0009377317,0.0017314121,0.37787914,0.0017540818,0.09263455,0.03715437,0.00073343585],"about_ca_topic_score_codex":0.0049719126,"about_ca_topic_score_gemma":0.002977387,"teacher_disagreement_score":0.15550713,"about_ca_system_score_codex":0.0018003988,"about_ca_system_score_gemma":0.0026411754,"threshold_uncertainty_score":0.82241017},"labels":[],"label_agreement":null},{"id":"W2938511274","doi":"10.1002/sim.8162","title":"One‐step validation method for surrogate endpoints using data from multiple randomized cancer clinical trials with failure‐time endpoints","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Secrétariat Général pour les Affaires Régionales, Etat en Région Aquitaine; Institute of Cancer Research; Institut National de la Santé et de la Recherche Médicale; Institut National Du Cancer; Association pour la Recherche sur le Cancer","keywords":"Surrogate endpoint; Context (archaeology); Estimator; Statistics; Clinical trial; Computer science; Random effects model; Medicine; Mathematics; Meta-analysis; Internal medicine","score_opus":0.5056720796718315,"score_gpt":0.5934294578687577,"score_spread":0.0877573781969262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2938511274","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059387824,0.0011525196,0.990803,0.0002754538,0.00012989981,0.00083002425,0.00030687798,0.00023785721,0.00032565248],"genre_scores_gemma":[0.22337835,0.0011804176,0.7641288,0.0007731357,0.00025985303,0.0068406817,0.001618303,0.00020913128,0.0016113193],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.89578956,0.08897864,0.004533345,0.005424519,0.0048188292,0.00045516802],"domain_scores_gemma":[0.6747041,0.28560704,0.010918437,0.021131996,0.0068663214,0.000772164],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17823577,0.002323504,0.0040886346,0.0042011044,0.00097173254,0.0028051494,0.0039824555,0.00324016,0.004025907],"category_scores_gemma":[0.28028885,0.0011417712,0.0076058265,0.0031166999,0.0021790254,0.0026111258,0.0029421512,0.004477234,0.00075447035],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0041944957,0.00063716155,0.03826179,0.0077013657,0.020040365,0.0014839066,0.0012510712,0.26551977,0.0057924516,0.14684118,0.00701874,0.5012577],"study_design_scores_gemma":[0.0013594868,0.0018853649,0.008173769,0.0012697052,0.0046482985,0.0007871296,0.0001507431,0.8085291,0.0055680224,0.15392314,0.013451574,0.0002536843],"about_ca_topic_score_codex":0.001223034,"about_ca_topic_score_gemma":0.0009972331,"teacher_disagreement_score":0.82176423,"about_ca_system_score_codex":0.0011060054,"about_ca_system_score_gemma":0.003680472,"threshold_uncertainty_score":0.9426121},"labels":[],"label_agreement":null},{"id":"W2939670107","doi":"10.1093/aje/kwz100","title":"Effect Estimates in Randomized Trials and Observational Studies: Comparing Apples With Apples","year":2019,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":115,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Alberta Hip and Knee Clinic; University of Calgary","funders":"Cilag; National Institute of Allergy and Infectious Diseases; Instituto de Salud Carlos III; National Center for Advancing Translational Sciences; Medical Research Council; University of North Carolina at Chapel Hill; National Institutes of Health; U.S. Department of Defense; Université de Bordeaux; Center for AIDS Research, University of Washington; Uniformed Services University of the Health Sciences; Universiteit van Amsterdam; Gilead Sciences; University of Bristol; Uniwersytet Warszawski; University College London; Harvard T.H. Chan School of Public Health; National Institute for Health and Care Research; Rowan University; Rigshospitalet; National and Kapodistrian University of Athens; Bill and Melinda Gates Foundation; ViiV Healthcare; Universität Basel; Centre Hospitalier Universitaire de Bordeaux; Stichting HIV Monitoring; Warszawski Uniwersytet Medyczny; Harvard University Center for AIDS Research; Harvard University; Yale University; Sorbonne Université; Institut National de la Santé et de la Recherche Médicale; University of Minnesota","keywords":"Observational study; Randomized controlled trial; Medicine; Internal medicine","score_opus":0.4249577462813197,"score_gpt":0.5321859369904708,"score_spread":0.10722819070915107,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2939670107","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011734601,0.019038308,0.95436233,0.004664496,0.0024479667,0.0025994286,0.0010199584,0.0005924947,0.003540469],"genre_scores_gemma":[0.12582874,0.0039817477,0.8583569,0.0035305321,0.0010175488,0.0058657476,0.00033284895,0.00040538632,0.00068060734],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.25117314,0.70426255,0.02028948,0.00892752,0.014587571,0.00075975666],"domain_scores_gemma":[0.11795999,0.8348158,0.018440641,0.024289714,0.004084607,0.00040922666],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5013976,0.0024830904,0.009527735,0.009371752,0.0011359579,0.010085358,0.0054100137,0.006358667,0.0071370727],"category_scores_gemma":[0.7627646,0.0023587034,0.011439814,0.011670213,0.01006069,0.012337454,0.008183501,0.012567487,0.0007051411],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013088895,0.0004148632,0.011350432,0.03406157,0.056515507,0.000809702,0.004293761,0.033985678,0.0020891621,0.4472438,0.0104963025,0.3856504],"study_design_scores_gemma":[0.00730748,0.0042503066,0.009688517,0.012535894,0.022269143,0.00096599857,0.0010680791,0.06497365,0.0036037806,0.8266944,0.04608315,0.00055956753],"about_ca_topic_score_codex":0.0012433188,"about_ca_topic_score_gemma":0.0010132061,"teacher_disagreement_score":0.4986024,"about_ca_system_score_codex":0.0030387768,"about_ca_system_score_gemma":0.0025321818,"threshold_uncertainty_score":0.61486554},"labels":[],"label_agreement":null},{"id":"W2939937326","doi":"10.1017/s026646662200024x","title":"A DECOMPOSITION ANALYSIS OF DIFFUSION OVER A LARGE NETWORK","year":2022,"lang":"en","type":"article","venue":"Econometric Theory","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Diffusion; Inference; Mathematics; Covariate; Measure (data warehouse); Decomposition; Econometrics; Statistics; Diffusion process; Preprint; Statistical physics; Computer science; Data mining; Innovation diffusion; Artificial intelligence","score_opus":0.050236692760370495,"score_gpt":0.37410826264417407,"score_spread":0.32387156988380356,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2939937326","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042816214,0.00067000353,0.9517515,0.0008633643,0.00004684726,0.000058362046,0.00021211657,0.00012396119,0.0034576526],"genre_scores_gemma":[0.7589793,0.0023034348,0.227644,0.0003077864,0.0002575053,0.0003388105,0.00063269294,0.0001580862,0.009378459],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99797446,0.0011662722,0.000068795925,0.00037866045,0.00026892268,0.00014298483],"domain_scores_gemma":[0.9811747,0.013983151,0.0015438509,0.0014803042,0.0012525244,0.00056540663],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007150642,0.00067311287,0.0009140583,0.0022102082,0.0006640156,0.0016840566,0.001178085,0.0011878494,0.0043651415],"category_scores_gemma":[0.031090165,0.0005550597,0.0011712282,0.0017716011,0.0020467143,0.0034845963,0.0015811229,0.0020780554,0.00039149408],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000066397726,0.000037366357,0.0028840895,0.00011154831,0.00009002154,0.00011319511,0.00029557067,0.13844495,0.0018368169,0.8328889,0.0019596217,0.021271553],"study_design_scores_gemma":[0.000012060158,0.000022809374,0.0011807815,0.000029418741,0.00002273482,0.000044605724,0.000051197563,0.68586737,0.000242551,0.31104407,0.0014642045,0.000018264265],"about_ca_topic_score_codex":0.004560744,"about_ca_topic_score_gemma":0.002558935,"teacher_disagreement_score":0.007150642,"about_ca_system_score_codex":0.0018375576,"about_ca_system_score_gemma":0.0009987117,"threshold_uncertainty_score":0.037816644},"labels":[],"label_agreement":null},{"id":"W2943292425","doi":"10.30834/kjp.31.1.2018.153","title":"Common errors in reporting of statistical analyses","year":2019,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Thomas Hospital","funders":"","keywords":"Computer science; Econometrics; Statistics; Mathematics","score_opus":0.6765648551574031,"score_gpt":0.696991294786385,"score_spread":0.02042643962898194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2943292425","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025741528,0.005282713,0.97658896,0.0027889933,0.0038582038,0.0032057918,0.001594981,0.0016131498,0.002493128],"genre_scores_gemma":[0.15387863,0.005076457,0.79889715,0.0052209394,0.00376199,0.02595936,0.0024081743,0.0018307804,0.0029665376],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.13468155,0.7174608,0.07610664,0.03294709,0.036883246,0.0019207357],"domain_scores_gemma":[0.031820886,0.86098325,0.028258264,0.06662283,0.011478992,0.00083574624],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4911096,0.0050887037,0.012521946,0.016185824,0.004072895,0.012292771,0.011542221,0.013628514,0.011252193],"category_scores_gemma":[0.8845531,0.0060007223,0.00979501,0.026272662,0.018861504,0.0074131545,0.009072263,0.023470726,0.0035628865],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00404134,0.00063111243,0.016565703,0.026925266,0.019580366,0.0028826518,0.011865955,0.031800658,0.0019789215,0.54066074,0.068012424,0.27505475],"study_design_scores_gemma":[0.0017767757,0.0007640145,0.007732391,0.013141917,0.0055103763,0.0019350733,0.001293585,0.08113247,0.0055023157,0.8266678,0.05398694,0.0005563558],"about_ca_topic_score_codex":0.0045436244,"about_ca_topic_score_gemma":0.0037958203,"teacher_disagreement_score":0.5088904,"about_ca_system_score_codex":0.009227243,"about_ca_system_score_gemma":0.01518748,"threshold_uncertainty_score":0.6275525},"labels":[],"label_agreement":null},{"id":"W2949045795","doi":"10.1097/ede.0000000000001015","title":"Causal Mediation Analysis for Standardized Mortality Ratios","year":2019,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Princess Margaret Cancer Centre; Public Health Ontario; University of Toronto","funders":"","keywords":"Mediation; Estimator; Health care; Causal model; Medicine; Intervention (counseling); Outcome (game theory); Standardized mortality ratio; Econometrics; Psychology; Statistics; Cancer; Internal medicine; Nursing; Mathematics","score_opus":0.2800238229706258,"score_gpt":0.5032093866688059,"score_spread":0.2231855636981801,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2949045795","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076558096,0.0009256704,0.9876446,0.00089294044,0.00010153724,0.00028191987,0.00061447936,0.00028091777,0.0016021384],"genre_scores_gemma":[0.54902226,0.0026624638,0.4358121,0.00092877593,0.00055733067,0.004190687,0.0016928394,0.00032588805,0.0048076306],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95690453,0.03681487,0.00087693526,0.002554702,0.0021712657,0.00067763013],"domain_scores_gemma":[0.8264452,0.15699098,0.0049734325,0.008675417,0.0025467144,0.0003683049],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06351633,0.0016637025,0.0022475028,0.0039036812,0.0006713629,0.0018760274,0.0033081055,0.0016207965,0.014355195],"category_scores_gemma":[0.20943494,0.00066961336,0.0041570826,0.0040265475,0.002540613,0.0036071094,0.0031413932,0.0039865733,0.0008448021],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023681311,0.00015911607,0.014060074,0.00082969514,0.0025419756,0.0006274265,0.0005307482,0.07226361,0.0006844238,0.7933859,0.0054600886,0.1092201],"study_design_scores_gemma":[0.00013498527,0.00015583215,0.0038841404,0.0001683232,0.0005065712,0.00017517137,0.0001664431,0.24058506,0.0007640281,0.7474343,0.0059810793,0.000043958666],"about_ca_topic_score_codex":0.002897489,"about_ca_topic_score_gemma":0.0014573226,"teacher_disagreement_score":0.06351633,"about_ca_system_score_codex":0.0015284263,"about_ca_system_score_gemma":0.0024977648,"threshold_uncertainty_score":0.3359105},"labels":[],"label_agreement":null},{"id":"W2949052936","doi":"10.1007/s10654-019-00529-y","title":"A descriptive review of variable selection methods in four epidemiologic journals: there is still room for improvement","year":2019,"lang":"en","type":"review","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":96,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; The Quebec Population Health Research Network","funders":"Fonds de Recherche du Québec - Santé; Centre Hospitalier Universitaire de Québec","keywords":"Medicine; Observational study; Univariate; Confounding; Epidemiology; Selection (genetic algorithm); Selection bias; Descriptive statistics; Variable (mathematics); Statistics; Multivariate statistics; Computer science; Pathology; Machine learning; Mathematics","score_opus":0.6514226894111171,"score_gpt":0.5780220217195277,"score_spread":0.07340066769158948,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2949052936","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000055280714,0.9980763,0.00055107096,0.0008842502,0.00021533499,0.000014265775,0.000064695814,0.0000072764606,0.000131497],"genre_scores_gemma":[0.00063989224,0.9964056,0.0016686348,0.00082679227,0.0002821457,0.000030128333,0.00006942511,0.0000062256927,0.00007111494],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.991714,0.00370838,0.0022184416,0.00073437934,0.0014538063,0.00017112088],"domain_scores_gemma":[0.89036155,0.09678518,0.004335651,0.0010778825,0.0068021924,0.00063760707],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.023122136,0.0013979297,0.0054132245,0.012252073,0.0006059452,0.0034057673,0.002272081,0.0024260704,0.0060140365],"category_scores_gemma":[0.058288425,0.0008517068,0.004142723,0.015800133,0.0015447836,0.0035248068,0.0015688019,0.003959941,0.0010330107],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023836773,0.00007980215,0.0009690199,0.3302268,0.0028523959,0.0000761792,0.00019290393,0.00049071776,0.00025613912,0.0074772667,0.028115252,0.62902516],"study_design_scores_gemma":[0.00024676695,0.00035280376,0.0074245487,0.38777685,0.014687157,0.0008930325,0.00044047242,0.000716378,0.0005882926,0.014860077,0.5718361,0.00017744252],"about_ca_topic_score_codex":0.003915768,"about_ca_topic_score_gemma":0.008249495,"teacher_disagreement_score":0.99458677,"about_ca_system_score_codex":0.0023978108,"about_ca_system_score_gemma":0.011187654,"threshold_uncertainty_score":0.12228298},"labels":[],"label_agreement":null},{"id":"W2949392217","doi":"10.1111/jgs.16022","title":"Investigating and Remediating Selection Bias in Geriatrics Research: The Selection Bias Toolkit","year":2019,"lang":"en","type":"review","venue":"Journal of the American Geriatrics Society","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":86,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Aging","keywords":"Geriatrics; Selection bias; Selection (genetic algorithm); Context (archaeology); Medicine; Publication bias; Gerontology; Computer science; Psychiatry; Meta-analysis; Machine learning; Pathology","score_opus":0.5513045905054362,"score_gpt":0.5063414029643264,"score_spread":0.04496318754110984,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2949392217","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003775482,0.037058756,0.8468031,0.059377726,0.0039848494,0.019557733,0.0032905508,0.011829552,0.0143222045],"genre_scores_gemma":[0.012286994,0.013810522,0.93824273,0.006675406,0.0009999706,0.023566538,0.0010810879,0.0010643591,0.0022723626],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.3622622,0.49146986,0.08199248,0.0068377526,0.055417627,0.0020201623],"domain_scores_gemma":[0.12563728,0.7324974,0.031121131,0.042169858,0.06481886,0.0037555003],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5261841,0.003732607,0.006921721,0.026009051,0.0043068207,0.0117854765,0.009722722,0.0069228592,0.013082435],"category_scores_gemma":[0.69246954,0.004251536,0.012524475,0.013424776,0.009968703,0.016214345,0.023832304,0.012808931,0.006085809],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045126778,0.0003038381,0.008791701,0.03743737,0.0020315314,0.0005417569,0.01645335,0.0043207277,0.0009994796,0.04914415,0.098148644,0.7813762],"study_design_scores_gemma":[0.00173068,0.000998703,0.013504252,0.12709619,0.0031005072,0.0026991405,0.0066329576,0.017103499,0.0046789525,0.23329277,0.5878362,0.0013261482],"about_ca_topic_score_codex":0.0052937283,"about_ca_topic_score_gemma":0.009539275,"teacher_disagreement_score":0.47381592,"about_ca_system_score_codex":0.007871908,"about_ca_system_score_gemma":0.046065196,"threshold_uncertainty_score":0.58429945},"labels":[],"label_agreement":null},{"id":"W2950335439","doi":"10.1111/biom.13104","title":"Model Selection for G-Estimation of Dynamic Treatment Regimes","year":2019,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of Waterloo","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; National Institute of Mental Health; University of Waterloo","keywords":"Selection (genetic algorithm); Computer science; Model selection; Identification (biology); Variety (cybernetics); Function (biology); Information Criteria; Estimation; Quadratic equation; Maximum likelihood; Mathematical optimization; Machine learning; Data mining; Econometrics; Artificial intelligence; Mathematics; Statistics; Biology","score_opus":0.17582160060611435,"score_gpt":0.43713139605817636,"score_spread":0.261309795452062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2950335439","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028721516,0.00015612332,0.9957241,0.00044685634,0.000025318332,0.00011210694,0.00012135601,0.00011478715,0.00042725098],"genre_scores_gemma":[0.26384124,0.0009715458,0.7265736,0.0008821198,0.00023513022,0.0022614205,0.0012987038,0.00024588444,0.0036904712],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98106223,0.016014384,0.00040690345,0.0013814671,0.0007997155,0.00033536725],"domain_scores_gemma":[0.9516759,0.04341742,0.0015937068,0.0018838642,0.0011213438,0.00030777033],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024478914,0.0015463481,0.0029606223,0.0021617285,0.00093731016,0.0017930679,0.0031210422,0.0026490237,0.0063423705],"category_scores_gemma":[0.08025454,0.0010865554,0.0027364723,0.0023149466,0.0026259043,0.002202431,0.0029119346,0.004755678,0.001240929],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024454814,0.00012432973,0.0039205244,0.0003935475,0.00051947177,0.00032051103,0.000391613,0.49188542,0.0007450161,0.4060632,0.0048320848,0.09055979],"study_design_scores_gemma":[0.00007387529,0.00008731591,0.0005831279,0.0000726991,0.000059668822,0.000049138485,0.00003966693,0.7750694,0.0002973979,0.22130509,0.0023314185,0.000031133],"about_ca_topic_score_codex":0.006624273,"about_ca_topic_score_gemma":0.005393631,"teacher_disagreement_score":0.024478914,"about_ca_system_score_codex":0.0022407006,"about_ca_system_score_gemma":0.0038534852,"threshold_uncertainty_score":0.12945843},"labels":[],"label_agreement":null},{"id":"W2951994252","doi":"10.1002/cjs.11509","title":"New perspective on the benefits of the gene–environment independence in case–control studies","year":2019,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Independence (probability theory); Econometrics; Bridging (networking); Logistic regression; Computer science; Maximum likelihood; Statistics; Perspective (graphical); Estimation; Mathematical optimization; Mathematics; Artificial intelligence; Economics","score_opus":0.08972304379449776,"score_gpt":0.33465631020641035,"score_spread":0.2449332664119126,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2951994252","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009869354,0.002751359,0.973711,0.009797926,0.00022785335,0.000059585356,0.00014065819,0.00012196751,0.0033202937],"genre_scores_gemma":[0.48562032,0.0062193708,0.49677217,0.00485279,0.0030399899,0.00039093997,0.0003091382,0.00019840973,0.0025969513],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.952169,0.0405009,0.000913044,0.0026756607,0.0034004806,0.0003408817],"domain_scores_gemma":[0.65041924,0.31980297,0.006193246,0.018190736,0.004425198,0.00096855994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09058401,0.0010168527,0.0021777528,0.0023496377,0.0009024901,0.0035282297,0.0037069463,0.0027438605,0.004936081],"category_scores_gemma":[0.2776767,0.001166414,0.001682659,0.0029021644,0.007397707,0.0057082158,0.003937071,0.0069541372,0.0004736468],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002152937,0.00012105986,0.011236073,0.00047330794,0.0006601621,0.0010582356,0.001037787,0.023876045,0.0007349521,0.8518212,0.0037355747,0.10503032],"study_design_scores_gemma":[0.0001897799,0.00019353846,0.0053157797,0.00030184578,0.00025520293,0.00096600683,0.00021492291,0.12971681,0.00085333746,0.8497478,0.012167813,0.00007722237],"about_ca_topic_score_codex":0.004057894,"about_ca_topic_score_gemma":0.0023761583,"teacher_disagreement_score":0.09058401,"about_ca_system_score_codex":0.0013450979,"about_ca_system_score_gemma":0.002294878,"threshold_uncertainty_score":0.47905976},"labels":[],"label_agreement":null},{"id":"W2952566994","doi":"10.1214/19-ejs1566","title":"Empirical likelihood inference for non-randomized pretest-posttest studies with missing data","year":2019,"lang":"en","type":"article","venue":"Electronic Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Empirical likelihood; Mathematics; Statistics; Confidence interval; Wald test; Missing data; Score test; Inference; Propensity score matching; Randomized experiment; Statistic; Coverage probability; Likelihood-ratio test; Test statistic; Restricted maximum likelihood; Statistical hypothesis testing; Econometrics; Maximum likelihood; Artificial intelligence; Computer science","score_opus":0.14204327335502406,"score_gpt":0.4623509266687351,"score_spread":0.320307653313711,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2952566994","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028303454,0.0005209382,0.99507576,0.00036129775,0.00004624447,0.00021828464,0.00015958596,0.00021354634,0.000574033],"genre_scores_gemma":[0.22548006,0.0014655765,0.7650897,0.0006544045,0.00037317103,0.003508947,0.0009861364,0.00025845843,0.0021835307],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9388063,0.051699422,0.0022499845,0.003283019,0.0034107927,0.0005504045],"domain_scores_gemma":[0.52038693,0.44421062,0.01428292,0.01617774,0.004117675,0.00082408916],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11034545,0.001778665,0.004341978,0.0045278664,0.0010452848,0.0033395293,0.006127092,0.0034017703,0.01070102],"category_scores_gemma":[0.4093603,0.001554994,0.0033580735,0.004110874,0.0037938193,0.005213647,0.0035445627,0.004494224,0.0011173354],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00090137025,0.0003468679,0.017649759,0.002435794,0.0017518629,0.0012428509,0.0009201024,0.11298689,0.0008420289,0.6161676,0.0053333878,0.23942153],"study_design_scores_gemma":[0.00040483277,0.0002584082,0.0019518896,0.00043547954,0.0003518689,0.0003231455,0.0001430446,0.3655489,0.0012329741,0.6253164,0.003976828,0.000056132583],"about_ca_topic_score_codex":0.0019722427,"about_ca_topic_score_gemma":0.0013248099,"teacher_disagreement_score":0.11034545,"about_ca_system_score_codex":0.0017456989,"about_ca_system_score_gemma":0.0031187318,"threshold_uncertainty_score":0.5835695},"labels":[],"label_agreement":null},{"id":"W2954516837","doi":"10.1016/j.jval.2019.04.1375","title":"PNS9 PROPENSITY SCORE MATCHING AND REWEIGHTING TO ASSESS COMPARATIVE EFFICACY OF SINGLE-ARM TRIALS: A GENERAL FRAMEWORK AND SIMULATION STUDY","year":2019,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital","funders":"","keywords":"Propensity score matching; Replicate; Observational study; Computer science; Inverse probability weighting; Matching (statistics); Weighting; Sample size determination; Flexibility (engineering); Comparative effectiveness research; Average treatment effect; Data mining; Statistics; Mathematics; Medicine","score_opus":0.6619148956200791,"score_gpt":0.5295113976503267,"score_spread":0.13240349796975237,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954516837","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018427186,0.0012793134,0.97524524,0.0013041656,0.00008922218,0.0005458723,0.0002901294,0.0001881014,0.002630791],"genre_scores_gemma":[0.5216419,0.0016328886,0.4688739,0.0006402303,0.00023927847,0.001980537,0.00045103993,0.00014203257,0.0043981853],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9544431,0.041915357,0.0007441418,0.0011500835,0.0013456471,0.00040167186],"domain_scores_gemma":[0.8417604,0.14671457,0.0040452746,0.005279893,0.0015043906,0.0006955399],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08198539,0.0012022445,0.003565796,0.0023921041,0.0005314261,0.0019538966,0.0027709643,0.0024154957,0.009646263],"category_scores_gemma":[0.16891691,0.00096929976,0.003982669,0.0023847134,0.0019642247,0.002962623,0.0022605076,0.003081185,0.0004967935],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002241846,0.00029500521,0.005850068,0.0006333943,0.0018159862,0.00028170986,0.00025053357,0.36239225,0.0003605721,0.51576334,0.0033909508,0.10672438],"study_design_scores_gemma":[0.00086786074,0.00039197048,0.00087067636,0.0001438183,0.0004010787,0.00012963085,0.000026256206,0.74096805,0.00028831424,0.25379184,0.0020901035,0.000030348592],"about_ca_topic_score_codex":0.0038856112,"about_ca_topic_score_gemma":0.0019642473,"teacher_disagreement_score":0.9180146,"about_ca_system_score_codex":0.0015630368,"about_ca_system_score_gemma":0.0036692063,"threshold_uncertainty_score":0.43358535},"labels":[],"label_agreement":null},{"id":"W2954560470","doi":"10.5539/ijsp.v8n4p60","title":"Medical Intervention for Disease Stages Using Game Theory, Markov Chains, and Bayesian Inference","year":2019,"lang":"en","type":"article","venue":"International Journal of Statistics and Probability","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Markov chain; Bayesian probability; Inference; Mathematics; Bayesian inference; Bayesian game; Computer science; Markov process; Artificial intelligence; Game theory; Econometrics; Mathematical economics; Mathematical optimization; Machine learning; Statistics; Sequential game","score_opus":0.05640725535649568,"score_gpt":0.4160866617305908,"score_spread":0.3596794063740951,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954560470","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010603711,0.0005947777,0.9843158,0.0020126961,0.00005346066,0.000110893554,0.00009342057,0.00007560697,0.0021396708],"genre_scores_gemma":[0.660057,0.0023615656,0.32949266,0.00078811246,0.0003069074,0.0007065905,0.00021540813,0.00009327078,0.00597846],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994589,0.003687627,0.0001582856,0.0006225174,0.00061586243,0.0003268186],"domain_scores_gemma":[0.9774016,0.020567568,0.0010517925,0.00025993068,0.00041639808,0.00030267038],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010070269,0.0016300078,0.0020211798,0.0025003988,0.0012060847,0.002471987,0.0023288191,0.0026690518,0.0045367214],"category_scores_gemma":[0.03159816,0.0010086995,0.0019588573,0.001361101,0.0029273415,0.0037261138,0.0018917441,0.0033713884,0.00029767337],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000083873274,0.000106386535,0.0030056648,0.00014228123,0.00019763348,0.00020679018,0.00025144266,0.5292219,0.00032328983,0.4451468,0.0011658035,0.02014814],"study_design_scores_gemma":[0.000045620283,0.000037834398,0.0004791301,0.000041177365,0.0000432994,0.000056708963,0.000041553667,0.6720192,0.00010561641,0.32642817,0.00067171373,0.000029931129],"about_ca_topic_score_codex":0.0236041,"about_ca_topic_score_gemma":0.01962793,"teacher_disagreement_score":0.0236041,"about_ca_system_score_codex":0.004093721,"about_ca_system_score_gemma":0.0041683796,"threshold_uncertainty_score":0.053257287},"labels":[],"label_agreement":null},{"id":"W2956147361","doi":"10.1002/sim.8741","title":"Formulating causal questions and principled statistical answers","year":2020,"lang":"en","type":"preprint","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Lorentz Center; Medical Research Council; Vetenskapsrådet","keywords":"Causal inference; Covariate; Outcome (game theory); Computer science; Observational study; Set (abstract data type); Confounding; Variable (mathematics); Code (set theory); Statistical inference; Inference; Propensity score matching; Econometrics; Data science; Machine learning; Statistics; Artificial intelligence; Mathematics","score_opus":0.15779582121857488,"score_gpt":0.47360673047319685,"score_spread":0.31581090925462196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2956147361","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044627694,0.0061883004,0.97662145,0.012356399,0.00058881677,0.00025941947,0.0003845792,0.00021712547,0.00293774],"genre_scores_gemma":[0.038891524,0.016165033,0.9273694,0.0074301204,0.0032728543,0.003974911,0.00088024786,0.00033718706,0.001678754],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9023748,0.07867232,0.0051823216,0.00503629,0.008045228,0.00068896136],"domain_scores_gemma":[0.62990654,0.3495545,0.0061766873,0.008421992,0.005406196,0.0005341098],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11979465,0.0026848326,0.004178431,0.005885442,0.001640779,0.0076009077,0.006059299,0.00774062,0.014402317],"category_scores_gemma":[0.2952356,0.0023243465,0.005118921,0.004722359,0.011939158,0.009630354,0.0057886597,0.013450193,0.0024526336],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030455141,0.000030241548,0.00030781992,0.001942093,0.00027865786,0.00009609452,0.00038669442,0.0070711467,0.00006946,0.9345165,0.0058895126,0.04938129],"study_design_scores_gemma":[0.000024326133,0.0000086711125,0.000047641748,0.00045484776,0.000025167788,0.000027746366,0.000035340418,0.005008957,0.00006985941,0.9882237,0.0060600378,0.000013543975],"about_ca_topic_score_codex":0.0025959327,"about_ca_topic_score_gemma":0.0019088048,"teacher_disagreement_score":0.88020533,"about_ca_system_score_codex":0.0041132625,"about_ca_system_score_gemma":0.007788996,"threshold_uncertainty_score":0.63354224},"labels":[],"label_agreement":null},{"id":"W2957839981","doi":"10.2139/ssrn.3272396","title":"Estimating Average Treatment Effects With Propensity Scores Estimated With Four Machine Learning Procedures: Simulation Results in High Dimensional Settings and With Time to Event Outcomes","year":2018,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Group for Research in Decision Analysis; Université de Sherbrooke; Université du Québec à Montréal","funders":"","keywords":"Propensity score matching; Event (particle physics); Statistics; Computer science; Econometrics; Machine learning; Artificial intelligence; Psychology; Mathematics","score_opus":0.033983390593026554,"score_gpt":0.33123923631771407,"score_spread":0.2972558457246875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2957839981","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4878779,0.0017865332,0.5026687,0.0019448142,0.0001292075,0.00075416436,0.00091181166,0.00046400458,0.0034629118],"genre_scores_gemma":[0.8200082,0.000803652,0.1742843,0.00033446564,0.00008601547,0.000983707,0.0009726031,0.000106891595,0.0024200426],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98503137,0.012564377,0.0004989094,0.0007773341,0.00054368685,0.00058427633],"domain_scores_gemma":[0.6447721,0.33398408,0.0060755913,0.010470924,0.0033012214,0.0013959807],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05233813,0.0012843123,0.0032330928,0.0019283906,0.0011089535,0.0029262311,0.0030795317,0.003798999,0.006961923],"category_scores_gemma":[0.17120495,0.0010026552,0.0036982691,0.0032500173,0.0027305903,0.0048611066,0.003094881,0.0050464747,0.00049150514],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029612205,0.0011046727,0.013067512,0.00034900205,0.00085368427,0.00012554278,0.00044908116,0.8795951,0.00021301703,0.0538041,0.0016801226,0.045796886],"study_design_scores_gemma":[0.000850129,0.0003632813,0.0028527442,0.00007554368,0.00026141165,0.000055173034,0.00015681506,0.9435355,0.00035613455,0.051017597,0.0004155459,0.000060055107],"about_ca_topic_score_codex":0.0154243205,"about_ca_topic_score_gemma":0.008465596,"teacher_disagreement_score":0.05233813,"about_ca_system_score_codex":0.0023160384,"about_ca_system_score_gemma":0.0034523143,"threshold_uncertainty_score":0.27679384},"labels":[],"label_agreement":null},{"id":"W2962931983","doi":"10.1097/mcc.0000000000000642","title":"Defining standard of practice: pros and cons of the usual care arm","year":2019,"lang":"en","type":"review","venue":"Current Opinion in Critical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre Hospitalier Universitaire de Sherbrooke; Université de Sherbrooke; Health Sciences Centre; University of Toronto; Sunnybrook Health Science Centre","funders":"","keywords":"Generalizability theory; Medicine; Protocol (science); Randomization; Clinical equipoise; Randomized controlled trial; Selection bias; MEDLINE; Standard of care; Alternative medicine; Surgery; Psychology","score_opus":0.45607620734391213,"score_gpt":0.602160831643227,"score_spread":0.14608462429931485,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2962931983","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00023582036,0.9912464,0.0026602885,0.0037640599,0.0009259622,0.00017407251,0.00006656239,0.000013834168,0.0009130747],"genre_scores_gemma":[0.026719198,0.93629986,0.021162473,0.011116225,0.0023115193,0.0018880821,0.00015599259,0.000050583814,0.00029606427],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.85882634,0.09518376,0.019592952,0.006228069,0.019382749,0.0007860694],"domain_scores_gemma":[0.63665074,0.3266883,0.018961534,0.0063520996,0.010582674,0.00076474395],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.093790606,0.0013340045,0.0082069095,0.0043939278,0.0008335972,0.0070292377,0.004745648,0.0067042066,0.0035770973],"category_scores_gemma":[0.25611332,0.0010680682,0.004642073,0.005719333,0.007066793,0.0060577025,0.0031745248,0.0070224344,0.0007402721],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009806101,0.00005995659,0.00076399464,0.3873297,0.005658324,0.000060855542,0.0007746815,0.0008268271,0.00018437995,0.062132947,0.01074982,0.5304778],"study_design_scores_gemma":[0.0012138368,0.0006332576,0.0040531657,0.7174426,0.013478787,0.0005979043,0.0008963003,0.001112774,0.0005684838,0.059526335,0.20029661,0.00018006975],"about_ca_topic_score_codex":0.003168969,"about_ca_topic_score_gemma":0.0037383887,"teacher_disagreement_score":0.093790606,"about_ca_system_score_codex":0.0044682655,"about_ca_system_score_gemma":0.010065464,"threshold_uncertainty_score":0.49601805},"labels":[],"label_agreement":null},{"id":"W2963624793","doi":"10.1515/jci-2017-0010","title":"Variable Selection in Causal Inference using a Simultaneous Penalization Method","year":2018,"lang":"en","type":"article","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Estimator; Spurious relationship; Econometrics; Confounding; Statistics; Lasso (programming language); Outcome (game theory); Variance inflation factor; Feature selection; Average treatment effect; Variable (mathematics); Mathematics; Inflation (cosmology); Regression analysis; Computer science; Multicollinearity; Artificial intelligence","score_opus":0.1427988771873353,"score_gpt":0.47745571021162403,"score_spread":0.3346568330242887,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2963624793","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010093933,0.000072712326,0.99838173,0.00015476189,0.000021487984,0.000046644476,0.000024587087,0.00008980152,0.00019879459],"genre_scores_gemma":[0.11766532,0.00045094872,0.87658435,0.000338871,0.0003841175,0.00091624487,0.0003515826,0.00022799702,0.0030805662],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9731866,0.02258965,0.00054737716,0.0014803178,0.0017029914,0.00049313065],"domain_scores_gemma":[0.93902403,0.052523352,0.0018490838,0.004094258,0.002077203,0.00043213757],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030911459,0.0015895322,0.0022335981,0.002134942,0.0009831749,0.0019391414,0.0031976083,0.0018884822,0.005103328],"category_scores_gemma":[0.06360893,0.0011193975,0.0023217946,0.0023387545,0.0028283657,0.0020489944,0.003358594,0.0038118947,0.0008317033],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004655207,0.00023911953,0.0041206386,0.000612987,0.000905888,0.00055011944,0.0003717764,0.27981836,0.0025902728,0.5383406,0.005416441,0.1665684],"study_design_scores_gemma":[0.00008874777,0.000075170865,0.0005287768,0.000043097516,0.00006526935,0.00008405484,0.000014341492,0.8691911,0.00080438936,0.12673138,0.0023431613,0.000030519503],"about_ca_topic_score_codex":0.0032830783,"about_ca_topic_score_gemma":0.0028735416,"teacher_disagreement_score":0.030911459,"about_ca_system_score_codex":0.0011242668,"about_ca_system_score_gemma":0.0027570245,"threshold_uncertainty_score":0.16347736},"labels":[],"label_agreement":null},{"id":"W2964028530","doi":"10.1111/sjos.12398","title":"Novel criteria to exclude the surrogate paradox and their optimalities","year":2019,"lang":"en","type":"article","venue":"Scandinavian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Alberta; Harvard University; University of Minnesota; University of Wisconsin-Madison","keywords":"Surrogate endpoint; Surrogate data; Surrogate model; Outcome (game theory); Mathematics; Clinical endpoint; Econometrics; Statistics; Mathematical economics; Medicine; Internal medicine; Clinical trial","score_opus":0.11013643131589221,"score_gpt":0.390690188280301,"score_spread":0.28055375696440876,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964028530","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050616253,0.0040574637,0.9184276,0.0068194377,0.00059576763,0.0004640489,0.0008546911,0.00024977067,0.017914996],"genre_scores_gemma":[0.657243,0.0015614185,0.33053303,0.0030281404,0.0017285594,0.001730664,0.0010294567,0.00033237657,0.002813392],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94295096,0.036046118,0.0051473523,0.0055149635,0.008490431,0.0018501747],"domain_scores_gemma":[0.49195263,0.45135695,0.018088607,0.015670963,0.01715376,0.0057770866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.079946354,0.0019497279,0.0051066624,0.005242456,0.0025001895,0.0052657654,0.0034258366,0.005042662,0.0056639784],"category_scores_gemma":[0.340591,0.0012740914,0.002604887,0.00316566,0.009654716,0.0092512285,0.0071870578,0.008916169,0.0007241716],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033341974,0.00019676858,0.0033501917,0.00073283823,0.00023547176,0.00043343002,0.00039183363,0.03109504,0.00075760594,0.934581,0.0041026995,0.023789825],"study_design_scores_gemma":[0.000117476404,0.00015966951,0.00075835205,0.0002689857,0.00004593073,0.00024712863,0.00009078185,0.10032868,0.00086929277,0.8933148,0.0037291136,0.000069877555],"about_ca_topic_score_codex":0.000860007,"about_ca_topic_score_gemma":0.0005593088,"teacher_disagreement_score":0.079946354,"about_ca_system_score_codex":0.0024645329,"about_ca_system_score_gemma":0.005706605,"threshold_uncertainty_score":0.4228018},"labels":[],"label_agreement":null},{"id":"W2964417596","doi":"10.1093/bioinformatics/btz602","title":"Non-parametric individual treatment effect estimation for survival data with random forests","year":2019,"lang":"en","type":"article","venue":"Bioinformatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Random forest; Censoring (clinical trials); Computer science; Estimation; Statistics; Parametric statistics; Population; Random effects model; Survival analysis; Average treatment effect; Machine learning; Artificial intelligence; Data mining; Mathematics; Medicine; Propensity score matching; Engineering","score_opus":0.112018737931895,"score_gpt":0.39302598033528546,"score_spread":0.2810072424033905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964417596","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0065254094,0.001891606,0.9879666,0.0004409289,0.0001497679,0.00018718917,0.0013333464,0.001097976,0.0004072178],"genre_scores_gemma":[0.31990448,0.0020892718,0.66523504,0.00085180526,0.00079696975,0.001615054,0.0069177877,0.00055483077,0.002034852],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9929309,0.005046937,0.00024503635,0.0009784971,0.0005850829,0.0002134935],"domain_scores_gemma":[0.9711048,0.024001926,0.0015108396,0.0019743142,0.0011304416,0.00027764603],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020549217,0.0012794421,0.0019463189,0.0013585201,0.000532346,0.0010796223,0.0023570354,0.0016985274,0.0039327224],"category_scores_gemma":[0.03832948,0.00064061,0.0027544287,0.0016647379,0.0011119938,0.0012126826,0.0010807326,0.003105403,0.0015083561],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001262202,0.00027896502,0.019156015,0.0020070544,0.0011127638,0.00043644564,0.00029177972,0.490398,0.004299866,0.032203734,0.025904922,0.42264828],"study_design_scores_gemma":[0.00017801463,0.00016966296,0.0051178914,0.00030703176,0.00023879923,0.00035855122,0.000039367977,0.89176965,0.0024168487,0.08986528,0.009462648,0.000076307355],"about_ca_topic_score_codex":0.0031243656,"about_ca_topic_score_gemma":0.004007761,"teacher_disagreement_score":0.020549217,"about_ca_system_score_codex":0.00073890336,"about_ca_system_score_gemma":0.0013669691,"threshold_uncertainty_score":0.10867596},"labels":[],"label_agreement":null},{"id":"W2966416868","doi":"10.1002/sim.8690","title":"Measurement error and precision medicine: Error‐prone tailoring covariates in dynamic treatment regimes","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Precision medicine; Observational error; Context (archaeology); Accuracy and precision; Simple (philosophy); Error detection and correction","score_opus":0.1879669184940262,"score_gpt":0.4346654424349814,"score_spread":0.2466985239409552,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2966416868","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008443927,0.0015887807,0.9823685,0.004696418,0.00024119095,0.00016078827,0.00021381665,0.00014569033,0.002140826],"genre_scores_gemma":[0.515312,0.0027042069,0.4743597,0.0029466473,0.00078919297,0.00096522307,0.00032618138,0.00013306993,0.0024637647],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9109691,0.071642295,0.0026566552,0.007813376,0.005842624,0.0010760182],"domain_scores_gemma":[0.6473408,0.30119005,0.01698687,0.028790107,0.004791242,0.0009010306],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.082757264,0.0016545006,0.0031230266,0.0021906768,0.0015236384,0.0050592106,0.00395673,0.0040985085,0.00428763],"category_scores_gemma":[0.33802173,0.001149743,0.002661753,0.0033004438,0.0082056755,0.00733857,0.004927273,0.007608011,0.000536374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038592453,0.00013675721,0.010040212,0.0005469879,0.00085960835,0.00021286837,0.00091853726,0.088147044,0.0006411463,0.77843046,0.0023502896,0.11733011],"study_design_scores_gemma":[0.00015780683,0.00020940788,0.0019407333,0.00027887398,0.00020667155,0.00011779878,0.00008499987,0.109034665,0.0008229683,0.883035,0.004033303,0.00007784108],"about_ca_topic_score_codex":0.0046277298,"about_ca_topic_score_gemma":0.0033790653,"teacher_disagreement_score":0.91724277,"about_ca_system_score_codex":0.0031043403,"about_ca_system_score_gemma":0.0056739366,"threshold_uncertainty_score":0.4376675},"labels":[],"label_agreement":null},{"id":"W2968938401","doi":"10.1111/biom.13135","title":"Data‐adaptive longitudinal model selection in causal inference with collaborative targeted minimum loss‐based estimation","year":2019,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Statistics Canada; Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Covariate; Causal inference; Confounding; Counterfactual thinking; Statistics; Marginal structural model; Observational study; Inverse probability weighting; Computer science; Population; Econometrics; Outcome (game theory); Mathematics; Medicine; Propensity score matching; Psychology; Environmental health","score_opus":0.18956229312117323,"score_gpt":0.41666249240000175,"score_spread":0.22710019927882852,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2968938401","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011801235,0.000120613906,0.9982724,0.0001317566,0.000013938977,0.000056755856,0.000026227068,0.000077393095,0.00012080316],"genre_scores_gemma":[0.09891485,0.00038126096,0.8977644,0.00036866576,0.00010752047,0.0011035682,0.00031439937,0.00012166272,0.00092359004],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9741511,0.021559197,0.0007035606,0.0017309759,0.0015016514,0.00035355156],"domain_scores_gemma":[0.9128807,0.07713503,0.002371847,0.0049746046,0.0021512804,0.0004865688],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043989383,0.0015041692,0.0028612756,0.0019422494,0.0010337741,0.0017067345,0.0047667995,0.0025433395,0.0032583878],"category_scores_gemma":[0.11021414,0.001398111,0.0028377846,0.0024673033,0.002584341,0.0028475812,0.005211998,0.0048451475,0.0006285048],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005013013,0.00025978466,0.0057220366,0.00068383984,0.0009234625,0.00040081318,0.00061834423,0.58259755,0.0013176255,0.21837217,0.0036640698,0.18493906],"study_design_scores_gemma":[0.00011715924,0.000091634465,0.0003645633,0.00005212393,0.00006111487,0.000054189357,0.00002521044,0.9066465,0.0005134361,0.09064367,0.0014091466,0.000021294121],"about_ca_topic_score_codex":0.0059300377,"about_ca_topic_score_gemma":0.0053090765,"teacher_disagreement_score":0.043989383,"about_ca_system_score_codex":0.0017770495,"about_ca_system_score_gemma":0.0042481436,"threshold_uncertainty_score":0.2326408},"labels":[],"label_agreement":null},{"id":"W2969528659","doi":"10.1002/pds.4888","title":"An empirical assessment of immeasurable time bias in the setting of nested case‐control studies: Statins and all‐cause mortality among patients with heart failure","year":2019,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Yuhan; McGill University","keywords":"Medicine; Confidence interval; Nested case-control study; Hazard ratio; Pharmacoepidemiology; Odds ratio; Proportional hazards model; Emergency medicine; Weighting; Inverse probability weighting; Statistics; Internal medicine; Propensity score matching; Pharmacology","score_opus":0.16791865048048754,"score_gpt":0.4942670090386634,"score_spread":0.32634835855817584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2969528659","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.4564452,0.022823405,0.5103834,0.0037593886,0.00066155643,0.0024732244,0.00071484904,0.00021955512,0.0025194609],"genre_scores_gemma":[0.9156061,0.0006721847,0.08105243,0.0010149836,0.00015816223,0.0010898364,0.00020945398,0.000031486983,0.00016530727],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.53431815,0.40144846,0.02520046,0.019482527,0.018278135,0.0012722709],"domain_scores_gemma":[0.25393206,0.57660407,0.0939656,0.061236616,0.012978725,0.0012829716],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.35585442,0.0014194206,0.0019540174,0.0022180153,0.001590985,0.002566276,0.0045437277,0.0030628883,0.0009796838],"category_scores_gemma":[0.6113179,0.0010423205,0.0056784824,0.0021968747,0.005492748,0.0025924153,0.0040400727,0.002454871,0.00009845843],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030409372,0.00039288774,0.8276681,0.00329983,0.0446055,0.0008890855,0.003963561,0.01825092,0.0014374059,0.028835924,0.0011725076,0.06644334],"study_design_scores_gemma":[0.0034799178,0.0041288096,0.54908365,0.00430104,0.057759292,0.0045845723,0.0024788866,0.19311315,0.011972996,0.15358086,0.014804778,0.00071204366],"about_ca_topic_score_codex":0.0029011916,"about_ca_topic_score_gemma":0.0024503132,"teacher_disagreement_score":0.6441456,"about_ca_system_score_codex":0.0021804266,"about_ca_system_score_gemma":0.0026976306,"threshold_uncertainty_score":0.7943462},"labels":[],"label_agreement":null},{"id":"W2969601771","doi":"10.1136/bmjebm-2019-111225","title":"Challenges in interpreting results from ‘multiple regression’ when there is interaction between covariates","year":2019,"lang":"en","type":"article","venue":"BMJ evidence-based medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; McGill University; Jewish General Hospital","funders":"","keywords":"Covariate; Observational study; Outcome (game theory); Popularity; Meta-regression; Regression; Population; Econometrics; Regression analysis; Statistics; Regression toward the mean; Pace; Baseline (sea); Medicine; Psychology; Meta-analysis; Mathematics; Geography; Social psychology; Internal medicine","score_opus":0.4058680440234082,"score_gpt":0.4765542601293872,"score_spread":0.07068621610597897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2969601771","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028281035,0.01695735,0.8986076,0.0663288,0.007105791,0.00063074636,0.0007471026,0.0010425302,0.0057520634],"genre_scores_gemma":[0.105742395,0.011529177,0.8250647,0.040016696,0.01016809,0.0025541082,0.00047361944,0.001975047,0.0024761935],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.36043748,0.54414386,0.03732034,0.01606362,0.040510494,0.001524228],"domain_scores_gemma":[0.11505887,0.81109583,0.02683652,0.032560404,0.013710051,0.0007382973],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.49097246,0.0030907656,0.0063886987,0.006976268,0.003003038,0.013150924,0.00822909,0.00825945,0.006006943],"category_scores_gemma":[0.841028,0.0028542439,0.008171708,0.0089480765,0.017116914,0.012329758,0.008648192,0.022466136,0.0034884585],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011958467,0.00019106221,0.02293351,0.015064785,0.010301799,0.0032803358,0.011724391,0.011844326,0.0018476401,0.34766552,0.09628245,0.4776684],"study_design_scores_gemma":[0.00030415264,0.00025254753,0.0059679537,0.005970404,0.0014396855,0.0024725795,0.0014419926,0.014666115,0.0017805602,0.8989168,0.066479206,0.00030799126],"about_ca_topic_score_codex":0.006414877,"about_ca_topic_score_gemma":0.0048768823,"teacher_disagreement_score":0.50902754,"about_ca_system_score_codex":0.0032212562,"about_ca_system_score_gemma":0.007521761,"threshold_uncertainty_score":0.6277216},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W2969619689","doi":"10.1111/rssa.12497","title":"Regression-With-Residuals Estimation of Marginal Effects: A Method of Adjusting for Treatment-Induced Confounders That may also be Effect Modifiers","year":2019,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series A (Statistics in Society)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Marginal structural model; Confounding; Spurious relationship; Statistics; Marginal model; Econometrics; Regression; Mathematics; Set (abstract data type); Regression analysis; Point estimation; Estimation; Computer science; Engineering","score_opus":0.06958519297076769,"score_gpt":0.4071576483818013,"score_spread":0.3375724554110336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2969619689","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011495756,0.00014125189,0.9979171,0.00012291138,0.000036199413,0.00006452788,0.00005731287,0.00021130618,0.0002997772],"genre_scores_gemma":[0.07248865,0.00041910258,0.92396945,0.00022309374,0.00010968389,0.00065148226,0.00027436603,0.00036588905,0.0014982484],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97170174,0.023607671,0.0007341678,0.0021039376,0.0015583772,0.00029409383],"domain_scores_gemma":[0.9364921,0.048414078,0.002926473,0.0101436665,0.0018049779,0.00021870778],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037636008,0.0014121667,0.0023924855,0.0020037997,0.00059406646,0.0015153172,0.0034635125,0.0014307594,0.0068045342],"category_scores_gemma":[0.12148985,0.00088456046,0.0036663848,0.0029363155,0.0023628476,0.0024976472,0.0025559755,0.00420065,0.0012690701],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032038742,0.00014562099,0.007835343,0.00077411154,0.0021608763,0.0002445316,0.0008152616,0.10221739,0.002123365,0.51499355,0.008046959,0.3603226],"study_design_scores_gemma":[0.00017070104,0.0002693931,0.003069668,0.00025971796,0.0005300419,0.00021529259,0.000109554356,0.47590882,0.0027599917,0.49442136,0.022183096,0.000102383274],"about_ca_topic_score_codex":0.0066684894,"about_ca_topic_score_gemma":0.004695935,"teacher_disagreement_score":0.037636008,"about_ca_system_score_codex":0.0010755925,"about_ca_system_score_gemma":0.0034073861,"threshold_uncertainty_score":0.19904065},"labels":[],"label_agreement":null},{"id":"W2969784647","doi":"10.1002/sim.8986","title":"Incorporating partial adherence into the principal stratification analysis framework","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; Providence Health Care; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Estimator; Stratification (seeds); Principal (computer security); Computer science; Principal component analysis; Population; Clinical trial; Monte Carlo method; Statistics; Econometrics; Mathematics; Artificial intelligence; Medicine","score_opus":0.11815568465399728,"score_gpt":0.45816061350439785,"score_spread":0.34000492885040057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2969784647","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037216705,0.00034235383,0.9939161,0.0006459937,0.000086990105,0.00043306497,0.00008874263,0.00013790998,0.000627089],"genre_scores_gemma":[0.20622401,0.00067003537,0.7876383,0.0008932011,0.000286557,0.0028405695,0.0002762739,0.00010100316,0.0010700498],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84817255,0.13712822,0.0032666593,0.005151569,0.005142147,0.001138847],"domain_scores_gemma":[0.8199343,0.15054555,0.0075014485,0.015256568,0.0056655286,0.0010966058],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1299705,0.0018852224,0.003425467,0.002831848,0.0016877186,0.0026865925,0.0026791554,0.0025433637,0.004159725],"category_scores_gemma":[0.22506355,0.0016273941,0.004515413,0.002597668,0.0040318286,0.0039377725,0.0047461027,0.0059289723,0.0007361686],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013334085,0.00031055827,0.019918123,0.001436887,0.0028117804,0.00059843087,0.0030323863,0.10762351,0.0012670208,0.6169737,0.0051172525,0.23957705],"study_design_scores_gemma":[0.0005092153,0.00048268534,0.0026738984,0.0002772245,0.0006433031,0.00019032812,0.00013007638,0.31163368,0.000655093,0.675956,0.006733848,0.000114638184],"about_ca_topic_score_codex":0.0048910608,"about_ca_topic_score_gemma":0.00535341,"teacher_disagreement_score":0.8700295,"about_ca_system_score_codex":0.0019344949,"about_ca_system_score_gemma":0.007641186,"threshold_uncertainty_score":0.68735796},"labels":[],"label_agreement":null},{"id":"W2970371236","doi":"10.1002/bimj.201600228","title":"Inverse‐probability‐of‐treatment weighted estimation of causal parameters in the presence of error‐contaminated and time‐dependent confounders","year":2019,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Marginal structural model; Causal inference; Confounding; Estimation; Statistics; Inference; Econometrics; Inverse probability; Mathematics; Observational error; Computer science; Bayesian probability; Artificial intelligence; Economics","score_opus":0.16967966074865296,"score_gpt":0.3903522632045267,"score_spread":0.22067260245587375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2970371236","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028753928,0.00033308918,0.9958287,0.00017499583,0.000043325665,0.00017804527,0.00007819009,0.00006905709,0.00041906175],"genre_scores_gemma":[0.20836964,0.0015067661,0.7841697,0.00045619294,0.00019566834,0.001988955,0.0005668659,0.00012798145,0.0026182607],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9735734,0.021328146,0.0007696682,0.002213122,0.0016495357,0.00046612273],"domain_scores_gemma":[0.8747551,0.10709168,0.0054829326,0.009641162,0.002671992,0.00035716133],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.049945556,0.0018577548,0.003439035,0.0025122615,0.0008811258,0.002193741,0.0045939507,0.003194077,0.006595137],"category_scores_gemma":[0.19028245,0.0010672824,0.0035351976,0.0037519706,0.0029558644,0.0046531926,0.0034771005,0.0048122522,0.0006941772],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045676477,0.00027906295,0.010012843,0.0013695926,0.0016437456,0.0005207455,0.0008758086,0.17183597,0.0012423651,0.5023798,0.0026473259,0.30673593],"study_design_scores_gemma":[0.0001545613,0.00022097024,0.0028978882,0.0002985133,0.0006332718,0.00033934537,0.00015772629,0.49141866,0.0016211927,0.49630225,0.0058636256,0.00009193007],"about_ca_topic_score_codex":0.0044946955,"about_ca_topic_score_gemma":0.0036148452,"teacher_disagreement_score":0.049945556,"about_ca_system_score_codex":0.0016449733,"about_ca_system_score_gemma":0.0040535987,"threshold_uncertainty_score":0.2641405},"labels":[],"label_agreement":null},{"id":"W2970689096","doi":"10.32614/rj-2019-029","title":"ipwErrorY: An R Package for Estimation of Average Treatment Effect with Misclassified Binary Outcome","year":2019,"lang":"en","type":"article","venue":"The R Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"R package; Outcome (game theory); Statistics; Estimation; Binary number; Econometrics; Mathematics; Computer science; Economics; Arithmetic; Mathematical economics","score_opus":0.17842987736422145,"score_gpt":0.42649781193230446,"score_spread":0.24806793456808302,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2970689096","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001647841,0.00079648563,0.89898753,0.000840021,0.00036169123,0.0007952674,0.031880002,0.061033566,0.0036575934],"genre_scores_gemma":[0.024479683,0.00084738684,0.9087196,0.0011757714,0.00023959109,0.007123552,0.014776668,0.036878284,0.005759362],"study_design_codex":"not_applicable","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99263155,0.004766444,0.0005972704,0.00085121504,0.00095012074,0.00020355938],"domain_scores_gemma":[0.9472685,0.044836465,0.0024005347,0.003604475,0.0016060732,0.00028394684],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011646187,0.0023269807,0.0021540287,0.0025208294,0.00042178112,0.0014937716,0.0030484363,0.0012325165,0.07920791],"category_scores_gemma":[0.09589531,0.0014954531,0.0033894223,0.0021380384,0.0008875858,0.0016796059,0.0021130312,0.0035435269,0.02212935],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007528259,0.00017403431,0.009803544,0.0068511004,0.003888315,0.0006684779,0.0007204186,0.017567232,0.0021884313,0.06534004,0.5795104,0.3125352],"study_design_scores_gemma":[0.0009992844,0.00039260703,0.0108959265,0.0013782675,0.0017579952,0.0011306715,0.00013447541,0.110639185,0.0062486767,0.24863265,0.61749154,0.00029861912],"about_ca_topic_score_codex":0.002496761,"about_ca_topic_score_gemma":0.0038562773,"teacher_disagreement_score":0.07920791,"about_ca_system_score_codex":0.00064445904,"about_ca_system_score_gemma":0.0032057255,"threshold_uncertainty_score":0.26497686},"labels":[],"label_agreement":null},{"id":"W2970862519","doi":"10.1016/j.ahj.2019.08.017","title":"Variations in stepped-wedge cluster randomized trial design: Insights from the Patient-Centered Care Transitions in Heart Failure trial","year":2019,"lang":"en","type":"article","venue":"American Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; Population Health Research Institute; McMaster University; University of Ottawa","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Medicine; Sample size determination; Randomized controlled trial; Cluster randomised controlled trial; Research design; Statistical power; Clinical study design; Cluster (spacecraft); Psychological intervention; Computer science; Clinical trial; Statistics; Nursing; Surgery","score_opus":0.08799311841661227,"score_gpt":0.362863905260655,"score_spread":0.2748707868440427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2970862519","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23672491,0.00704698,0.73870814,0.0053325454,0.00087970507,0.0052315844,0.0013655376,0.0012045203,0.0035060947],"genre_scores_gemma":[0.7453015,0.0007368165,0.24575035,0.0019742025,0.00015564154,0.003940774,0.0007824748,0.0001728764,0.0011852831],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.7433638,0.24772376,0.002281891,0.0034238289,0.0025156725,0.0006910381],"domain_scores_gemma":[0.6722921,0.29964018,0.0053423527,0.017945366,0.003232347,0.0015476628],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14529029,0.0013942749,0.004499728,0.0006608851,0.00063030445,0.0016647531,0.0037615395,0.0029741698,0.0056574265],"category_scores_gemma":[0.22430873,0.00093126943,0.0038313917,0.0012643605,0.00242707,0.0026830505,0.0026890952,0.0058841025,0.00042472038],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.26914355,0.0035515055,0.01563868,0.0065428577,0.041323002,0.0008596927,0.001881626,0.18568803,0.0017661353,0.17882666,0.016394135,0.27838406],"study_design_scores_gemma":[0.114741534,0.012418024,0.0044379765,0.00073954347,0.009690649,0.00032548807,0.00028767218,0.54968464,0.0012106065,0.3007569,0.005464062,0.0002428539],"about_ca_topic_score_codex":0.0018439762,"about_ca_topic_score_gemma":0.0017710212,"teacher_disagreement_score":0.85470974,"about_ca_system_score_codex":0.0011146202,"about_ca_system_score_gemma":0.003679283,"threshold_uncertainty_score":0.76837766},"labels":[],"label_agreement":null},{"id":"W2972232169","doi":"10.1002/pds.4876","title":"Multiple imputation for systematically missing confounders within a distributed data drug safety network: A simulation study and real‐world example","year":2019,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; University of British Columbia; McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Missing data; Imputation (statistics); Confounding; Medicine; Hazard ratio; Statistics; Confidence interval; Univariate; Multivariate statistics; Data mining; Computer science; Internal medicine; Mathematics","score_opus":0.2291901691434829,"score_gpt":0.4677311089516778,"score_spread":0.2385409398081949,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2972232169","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86280686,0.0008902252,0.126089,0.0035900294,0.00012340008,0.0008211572,0.0012633794,0.00022498955,0.00419091],"genre_scores_gemma":[0.9659511,0.00024355951,0.03209396,0.00025039693,0.000028990828,0.0004520463,0.0005039547,0.000016561633,0.00045943374],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98106545,0.016331242,0.0004910437,0.00086670945,0.0006348049,0.0006106926],"domain_scores_gemma":[0.82632333,0.15345357,0.0072839083,0.0065012304,0.004814098,0.0016239017],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03138913,0.0008510914,0.0011334189,0.0012808058,0.00086504087,0.0015584424,0.002425145,0.0026693488,0.002214405],"category_scores_gemma":[0.072020374,0.0007132364,0.0026776525,0.0025359157,0.0015311234,0.0017792823,0.0017908418,0.0026982375,0.00017341015],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016479348,0.0010668875,0.067885585,0.000311633,0.00075138116,0.0009027901,0.0005600019,0.89735335,0.00021714052,0.011558744,0.0027965773,0.014947902],"study_design_scores_gemma":[0.0011696878,0.0007290525,0.008862158,0.00009797729,0.00023785436,0.00028223527,0.00041837862,0.9782597,0.0003193634,0.008506348,0.0010613693,0.00005596838],"about_ca_topic_score_codex":0.025303219,"about_ca_topic_score_gemma":0.016247444,"teacher_disagreement_score":0.9686109,"about_ca_system_score_codex":0.0029949467,"about_ca_system_score_gemma":0.0025725155,"threshold_uncertainty_score":0.16600358},"labels":[],"label_agreement":null},{"id":"W2972461329","doi":"10.1002/cjs.11634","title":"Synthetic estimation for the complier average causal effect","year":2021,"lang":"en","type":"preprint","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Mental Health","keywords":"Estimator; Minimum-variance unbiased estimator; Mean squared error; Variance (accounting); Robustness (evolution); Efficiency; Efficient estimator; Bias of an estimator; Statistics; Robust statistics; Mathematics; Econometrics; Computer science; Economics","score_opus":0.10320913308488103,"score_gpt":0.3740226324498933,"score_spread":0.2708134993650123,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2972461329","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012175652,0.0003974206,0.98480034,0.00054519164,0.00007501537,0.00008813256,0.00034090257,0.00014069221,0.0014367324],"genre_scores_gemma":[0.4200738,0.00076901645,0.57346565,0.0006684155,0.00030468014,0.00052458677,0.001464642,0.00010048866,0.0026287974],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99017054,0.0064797145,0.00042195502,0.0013360329,0.0014380229,0.00015372153],"domain_scores_gemma":[0.9469221,0.03805986,0.0048743435,0.006516549,0.00315829,0.00046879976],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023407744,0.0007372606,0.0013617144,0.0023258452,0.00052025757,0.002238953,0.0020449823,0.0016425696,0.005767015],"category_scores_gemma":[0.09069521,0.0004997279,0.0011644496,0.002193041,0.0013470023,0.0022893592,0.0018272375,0.0014489458,0.0005331498],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027020552,0.00012183809,0.019674744,0.00049512973,0.00082752696,0.00026379433,0.00026858182,0.21733402,0.0026034212,0.6020425,0.005779995,0.1503182],"study_design_scores_gemma":[0.00012399802,0.00026031822,0.0056561134,0.00014530998,0.00022565218,0.00032434132,0.00007559843,0.6469553,0.0019119848,0.33301237,0.011234437,0.00007466618],"about_ca_topic_score_codex":0.0012744409,"about_ca_topic_score_gemma":0.0014133959,"teacher_disagreement_score":0.023407744,"about_ca_system_score_codex":0.0009039583,"about_ca_system_score_gemma":0.0014763358,"threshold_uncertainty_score":0.12379348},"labels":[],"label_agreement":null},{"id":"W2974998223","doi":"10.1080/00273171.2019.1660605","title":"New Recommendations on the Use of R-Squared Differences in Multilevel Model Comparisons","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":96,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Set (abstract data type); Mean squared error; Measure (data warehouse); Multilevel model; Computer science; Class (philosophy); Confusion; Data mining; Statistics; Mathematics; Artificial intelligence; Psychology","score_opus":0.8895675119762272,"score_gpt":0.598556855129321,"score_spread":0.2910106568469062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2974998223","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018016231,0.035344362,0.6432895,0.2318324,0.039306726,0.0028897712,0.01009374,0.008009012,0.027432837],"genre_scores_gemma":[0.0084382575,0.012250973,0.9158364,0.03771412,0.0053218766,0.0059406776,0.0027029323,0.0043067853,0.007487909],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7019737,0.22433618,0.032521363,0.00995785,0.029265305,0.001945707],"domain_scores_gemma":[0.21624403,0.58907735,0.022468967,0.049719255,0.11777425,0.0047160597],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24952894,0.0041712504,0.004346988,0.012078642,0.0027010979,0.008575032,0.013065754,0.0120226955,0.044693694],"category_scores_gemma":[0.7133957,0.005385472,0.009831156,0.01675979,0.008873775,0.02023868,0.007440882,0.028293353,0.026348611],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003580295,0.00032090972,0.0023484675,0.0060049277,0.000436534,0.00020296719,0.0016965589,0.0025253051,0.000525263,0.053368278,0.7031774,0.22903547],"study_design_scores_gemma":[0.0008929859,0.000429068,0.005978473,0.034593876,0.0006505762,0.00062567095,0.001664713,0.010425886,0.0023206845,0.16451612,0.77701974,0.0008821504],"about_ca_topic_score_codex":0.017825056,"about_ca_topic_score_gemma":0.024006803,"teacher_disagreement_score":0.75047106,"about_ca_system_score_codex":0.005653981,"about_ca_system_score_gemma":0.014752582,"threshold_uncertainty_score":0.9254644},"labels":[],"label_agreement":null},{"id":"W2975824420","doi":"10.1016/j.apmr.2019.04.007","title":"Comparative Effectiveness of Inpatient Rehabilitation Interventions for Traumatic Brain Injury: Introduction","year":2019,"lang":"en","type":"article","venue":"Archives of Physical Medicine and Rehabilitation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Center for Medical Rehabilitation Research; National Institutes of Health; National Institute on Disability, Independent Living, and Rehabilitation Research; Ontario Neurotrauma Foundation; Patient-Centered Outcomes Research Institute","keywords":"Observational study; Rehabilitation; Propensity score matching; Traumatic brain injury; Causal inference; Psychological intervention; Comparative effectiveness research; Confounding; Randomized controlled trial; Medicine; Physical therapy; Physical medicine and rehabilitation; Marginal structural model; Consistency (knowledge bases); Psychiatry; Computer science; Alternative medicine; Surgery","score_opus":0.07253782938070465,"score_gpt":0.44738257168161294,"score_spread":0.3748447423009083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2975824420","genre_codex":"empirical","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8526249,0.09785707,0.02480093,0.0032524718,0.002080795,0.0036344775,0.0039629545,0.00018751262,0.011598904],"genre_scores_gemma":[0.9783035,0.008495943,0.009556592,0.0002857733,0.0004290146,0.0013075261,0.0006861075,0.000023293629,0.00091228035],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9759384,0.019849354,0.0015240348,0.000950331,0.0013282731,0.00040966496],"domain_scores_gemma":[0.9649829,0.030994624,0.0020567605,0.0010051597,0.00060636865,0.00035428588],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0145407785,0.0012304479,0.003948337,0.0014933662,0.00029991212,0.0011328906,0.0015309579,0.0013773784,0.010251863],"category_scores_gemma":[0.0601575,0.00047364456,0.005098575,0.001194198,0.0010539598,0.0021532604,0.0014949697,0.0014117197,0.000220845],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.35794222,0.008908363,0.01486442,0.024893917,0.034924302,0.000102671176,0.00097267673,0.016503649,0.0024524159,0.018502003,0.002039349,0.51789397],"study_design_scores_gemma":[0.23958813,0.3164117,0.12521735,0.012596881,0.15003403,0.00061939703,0.0027116283,0.05905325,0.010566969,0.06929149,0.0133525515,0.00055667636],"about_ca_topic_score_codex":0.0020747168,"about_ca_topic_score_gemma":0.0021654528,"teacher_disagreement_score":0.0145407785,"about_ca_system_score_codex":0.0015742404,"about_ca_system_score_gemma":0.0018668381,"threshold_uncertainty_score":0.076899886},"labels":[],"label_agreement":null},{"id":"W2976627433","doi":"10.1093/biomet/asz048","title":"Causal inference with confounders missing not at random","year":2019,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":54,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Science Foundation of Sri Lanka; Natural Sciences and Engineering Research Council of Canada; Institute of Education Sciences","keywords":"Confounding; Causal inference; Missing data; Estimator; Statistics; Econometrics; Observational study; Mathematics; Nonparametric statistics; Outcome (game theory); Inference; Causal model; Computer science; Artificial intelligence","score_opus":0.14942930539156363,"score_gpt":0.4019501723183518,"score_spread":0.25252086692678816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2976627433","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042879987,0.00092794414,0.99071103,0.0021049513,0.0001584139,0.0000844767,0.00030749338,0.0001094569,0.0013082216],"genre_scores_gemma":[0.4471087,0.003550396,0.5393544,0.0022880381,0.0012698807,0.0010695375,0.0009771032,0.00014472436,0.0042372816],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9673198,0.025239535,0.0011802856,0.0027381002,0.0029872945,0.0005350112],"domain_scores_gemma":[0.8868431,0.0936775,0.0062086983,0.009534664,0.0032142797,0.0005217079],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.047929373,0.0009052757,0.002815641,0.0021580667,0.00086126575,0.0021316092,0.0026704497,0.0019392004,0.005639036],"category_scores_gemma":[0.14848427,0.0007871384,0.0024693299,0.0022714615,0.0033575404,0.003868647,0.0026107647,0.006221882,0.0005397461],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023274851,0.00007331025,0.0045973742,0.00087960425,0.0007068445,0.00039388938,0.00039368996,0.031544663,0.0004708335,0.8818045,0.004159018,0.074743606],"study_design_scores_gemma":[0.0000710216,0.00004529324,0.00080717256,0.00020930344,0.00013637842,0.00010544098,0.000048239104,0.048461094,0.00034377672,0.94578564,0.0039627105,0.00002391279],"about_ca_topic_score_codex":0.0019749883,"about_ca_topic_score_gemma":0.0013247026,"teacher_disagreement_score":0.047929373,"about_ca_system_score_codex":0.0012812719,"about_ca_system_score_gemma":0.0038517816,"threshold_uncertainty_score":0.2534778},"labels":[],"label_agreement":null},{"id":"W2977740587","doi":"10.1016/j.jclinepi.2019.08.012","title":"Calculation of absolute risk for important outcomes in patients with and without a prognostic factor of interest","year":2019,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; McMaster University; University Health Network; Toronto General Hospital; Impact; Ted Rogers Centre for Heart Research","funders":"","keywords":"Absolute risk reduction; Medicine; Risk factor; Relative risk; Guideline; Odds ratio; Outcome (game theory); Risk assessment; Statistics; Actuarial science; Confidence interval; Internal medicine; Mathematics; Computer science; Pathology","score_opus":0.43000849667316116,"score_gpt":0.5486397522909624,"score_spread":0.11863125561780125,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2977740587","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18895277,0.009197905,0.788963,0.0050082863,0.00083787856,0.00049652864,0.0021922064,0.00055919465,0.0037921646],"genre_scores_gemma":[0.84329724,0.002141208,0.14950532,0.0006210666,0.00054931483,0.00069110893,0.0013530528,0.00008685109,0.0017549717],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9878328,0.00875187,0.0008623119,0.001174462,0.0011095358,0.00026901747],"domain_scores_gemma":[0.8270862,0.15985347,0.003844549,0.006705054,0.0015555486,0.00095507374],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.030200163,0.0009124229,0.0028415706,0.002748984,0.00036021828,0.0022588444,0.0024709348,0.0018955889,0.0044884807],"category_scores_gemma":[0.16388637,0.000706418,0.0032160485,0.0012769562,0.0013793028,0.002470843,0.0026239732,0.004087303,0.000311398],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.017924963,0.0008161043,0.1978316,0.0042571113,0.013513923,0.0014735787,0.0010200322,0.14263071,0.0020027545,0.20920488,0.008759066,0.40056527],"study_design_scores_gemma":[0.0015669649,0.0018002181,0.03763427,0.0006710719,0.0049463413,0.0028701555,0.00034958214,0.3514993,0.0030948466,0.58905196,0.0063632075,0.0001520745],"about_ca_topic_score_codex":0.0009327848,"about_ca_topic_score_gemma":0.00070966943,"teacher_disagreement_score":0.9697998,"about_ca_system_score_codex":0.0006262542,"about_ca_system_score_gemma":0.001650733,"threshold_uncertainty_score":0.15971565},"labels":[],"label_agreement":null},{"id":"W2978101249","doi":"10.1017/s0140525x18000912","title":"Holding replication studies to mainstream standards of evidence","year":2018,"lang":"en","type":"letter","venue":"Behavioral and Brain Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Replication (statistics); Mainstream; Psychology; Value (mathematics); Cognitive psychology; Social psychology; Statistics; Mathematics; Political science; Law","score_opus":0.6873896146597199,"score_gpt":0.582156676757374,"score_spread":0.10523293790234589,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2978101249","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001750704,0.012819563,0.07266571,0.85412353,0.046006415,0.00069185614,0.00020321745,0.00066311413,0.011075844],"genre_scores_gemma":[0.11160663,0.009893014,0.21363184,0.5674118,0.08390131,0.0047201295,0.0004617432,0.00078249426,0.0075911204],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.5421586,0.26180676,0.060368903,0.036077507,0.0950079,0.0045803604],"domain_scores_gemma":[0.13255073,0.61428094,0.03010947,0.15606518,0.06099734,0.00599634],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4524232,0.0018190303,0.005485876,0.004897972,0.005616328,0.014670538,0.011017763,0.0392928,0.008593745],"category_scores_gemma":[0.8392849,0.0020284362,0.003172241,0.0035925799,0.045634236,0.02614216,0.011408779,0.06441535,0.009581786],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007618947,0.0002298339,0.0031003396,0.005037231,0.0007792298,0.0034669954,0.005574518,0.00064095616,0.0016983461,0.39905873,0.3852442,0.19440775],"study_design_scores_gemma":[0.00046264566,0.00015782723,0.0011903119,0.0039048947,0.00015294296,0.0018244409,0.0006305427,0.0022412378,0.0009968227,0.815122,0.17314899,0.00016731514],"about_ca_topic_score_codex":0.0018606138,"about_ca_topic_score_gemma":0.0020403992,"teacher_disagreement_score":0.5475768,"about_ca_system_score_codex":0.009055033,"about_ca_system_score_gemma":0.013300626,"threshold_uncertainty_score":0.6752597},"labels":[],"label_agreement":null},{"id":"W2978569536","doi":"10.1002/pds.4890","title":"Estimation of high‐dimensional propensity scores with multiple exposure levels","year":2019,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Covariate; Propensity score matching; Pairwise comparison; Bupropion; Multinomial distribution; Varenicline; Statistics; Confounding; Cohort; Smoking cessation; Internal medicine; Nicotine; Mathematics","score_opus":0.1076302195864092,"score_gpt":0.38881148004335414,"score_spread":0.2811812604569449,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2978569536","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059642375,0.00074192695,0.9372609,0.00077984633,0.00006109933,0.000316887,0.0003504464,0.00021099653,0.0006354216],"genre_scores_gemma":[0.59104925,0.000550542,0.4058249,0.0003334058,0.00012664749,0.0007476761,0.00075417536,0.000044058546,0.00056930044],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95267713,0.038994353,0.0018846623,0.003621196,0.002402846,0.00041974432],"domain_scores_gemma":[0.864964,0.10298122,0.016532663,0.012399469,0.0022328761,0.0008898143],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048535492,0.0010524788,0.0017443076,0.0026839224,0.00079072145,0.0021522823,0.002145,0.0014676648,0.004623442],"category_scores_gemma":[0.1387171,0.00092256075,0.0032990777,0.0030266591,0.002428824,0.0022744124,0.0045717307,0.0031031778,0.00040830421],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009776361,0.00047690267,0.3093269,0.0015791304,0.0064736097,0.00041173966,0.0009708397,0.18668057,0.0014892796,0.11289782,0.0031354004,0.37558022],"study_design_scores_gemma":[0.00055378024,0.0011375844,0.09487803,0.0005417452,0.00103958,0.0007096717,0.0003642788,0.5762753,0.0018150345,0.31623155,0.0062982505,0.00015520985],"about_ca_topic_score_codex":0.0019117784,"about_ca_topic_score_gemma":0.001475178,"teacher_disagreement_score":0.048535492,"about_ca_system_score_codex":0.0012231312,"about_ca_system_score_gemma":0.0018349785,"threshold_uncertainty_score":0.2566833},"labels":[],"label_agreement":null},{"id":"W2980191247","doi":"10.1177/0962280219880571","title":"Causal variance decompositions for institutional comparisons in healthcare","year":2019,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University Health Network; Public Health Ontario; University of Toronto","funders":"","keywords":"Variance (accounting); Pairwise comparison; Health care; Estimator; Variation (astronomy); Contrast (vision); Causal inference; Quality (philosophy)","score_opus":0.5111091620525015,"score_gpt":0.6978161455830484,"score_spread":0.18670698353054693,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2980191247","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016839212,0.00018774904,0.9972248,0.00015234294,0.00004822898,0.00009983169,0.00008953089,0.00010751938,0.0004061446],"genre_scores_gemma":[0.12872389,0.00066020805,0.86559963,0.0003257837,0.00027098745,0.0021107222,0.00068785547,0.00018524381,0.0014357243],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94216645,0.048521668,0.0015584093,0.0031897675,0.0036605913,0.00090322155],"domain_scores_gemma":[0.8175889,0.15925318,0.00634666,0.0121273715,0.003881175,0.00080263085],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07991772,0.0017567355,0.0021966195,0.006505089,0.0010829122,0.0028733038,0.002615491,0.0024852455,0.009516133],"category_scores_gemma":[0.20505895,0.0010635529,0.00483456,0.005940523,0.0043311026,0.004585431,0.0046585514,0.0049079107,0.0009808695],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012350449,0.00012682192,0.004286748,0.00026167155,0.0005404246,0.00013014853,0.00040931534,0.06462722,0.0003744413,0.83804053,0.0021015136,0.088977724],"study_design_scores_gemma":[0.000049538987,0.00008660623,0.0012381617,0.000107680156,0.00007162681,0.000047753438,0.000096649965,0.26394942,0.00035943397,0.73105186,0.0028995776,0.00004168789],"about_ca_topic_score_codex":0.0033469114,"about_ca_topic_score_gemma":0.0023987624,"teacher_disagreement_score":0.07991772,"about_ca_system_score_codex":0.0025051343,"about_ca_system_score_gemma":0.0034971917,"threshold_uncertainty_score":0.42265034},"labels":[],"label_agreement":null},{"id":"W2980305249","doi":"10.1093/aje/kwz233","title":"The Critical Importance of Asking Good Questions: The Role of Epidemiology Doctoral Training Programs","year":2019,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; University of North Carolina at Chapel Hill; National Institutes of Health; McGill University","keywords":"Coursework; Curriculum; Process (computing); Focus (optics); Computer science; Space (punctuation); Medical education; Data science; Management science; Engineering ethics; Mathematics education; Psychology; Medicine; Pedagogy","score_opus":0.19970712353999379,"score_gpt":0.47289733371775317,"score_spread":0.27319021017775935,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2980305249","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00463261,0.019070214,0.020182189,0.9406187,0.006004374,0.00023186849,0.000042549706,0.00019132464,0.009026231],"genre_scores_gemma":[0.2178217,0.036509767,0.13714899,0.5850902,0.010634573,0.0030912755,0.00015293271,0.0007128877,0.008837597],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6643877,0.2857634,0.009642015,0.009924892,0.022963993,0.0073179514],"domain_scores_gemma":[0.30103523,0.5067837,0.017734924,0.027418023,0.053698137,0.09332988],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4225322,0.0014049902,0.0033854835,0.004761563,0.018539404,0.023510799,0.005070748,0.017143905,0.010512209],"category_scores_gemma":[0.54568404,0.0022704548,0.0015680419,0.0025187584,0.0501129,0.032355722,0.030869575,0.046832953,0.0032592895],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036026814,0.0011274922,0.0102972295,0.0036351057,0.00029905638,0.00092750904,0.10393477,0.000876936,0.0009662271,0.19525424,0.2746415,0.40767965],"study_design_scores_gemma":[0.0002439593,0.0005240074,0.0052531413,0.012167975,0.00013352412,0.0012855518,0.052589584,0.0014451857,0.0006421063,0.53944206,0.38592297,0.00034988244],"about_ca_topic_score_codex":0.0025671488,"about_ca_topic_score_gemma":0.0050540245,"teacher_disagreement_score":0.5774678,"about_ca_system_score_codex":0.012747763,"about_ca_system_score_gemma":0.070111886,"threshold_uncertainty_score":0.71212065},"labels":[],"label_agreement":null},{"id":"W2980883791","doi":"10.1002/cpt.1698","title":"Reproducing Protocol‐Based Studies Using Parameterizable Tools—Comparison of Analytic Approaches Used by Two Medical Product Surveillance Networks","year":2019,"lang":"en","type":"article","venue":"Clinical Pharmacology & Therapeutics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Canadian Society of Nephrology; Institut universitaire en santé mentale de Montréal; Jewish General Hospital; McGill University","funders":"Canadian Institutes of Health Research; U.S. Food and Drug Administration","keywords":"Protocol (science); Medicine; Observational study; Hazard; Acute pancreatitis; Emergency medicine; Pharmacology; Computer science; Internal medicine; Pathology; Alternative medicine","score_opus":0.7218767300534139,"score_gpt":0.6223373168771107,"score_spread":0.09953941317630322,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2980883791","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10685164,0.0007142109,0.87635034,0.0012733279,0.00033680515,0.00964227,0.0013141937,0.00075508974,0.0027620324],"genre_scores_gemma":[0.57816756,0.00031121916,0.4039041,0.00066373695,0.00011300576,0.0149729615,0.0012155927,0.00021921491,0.00043253214],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.2610403,0.7058179,0.013170546,0.007636078,0.011314612,0.0010206476],"domain_scores_gemma":[0.12611593,0.7296189,0.024157241,0.10688067,0.012059073,0.0011682175],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.56774753,0.0016935855,0.0025265624,0.0027056746,0.0008670337,0.0040932917,0.004476471,0.0038227271,0.0026481724],"category_scores_gemma":[0.7787768,0.0017765786,0.005857384,0.0028413178,0.003925679,0.0046313927,0.005437266,0.003655818,0.00039050667],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.03430159,0.002861611,0.10538891,0.005170525,0.0385045,0.0005894319,0.00906373,0.27890116,0.0042026495,0.124081425,0.0052450644,0.3916895],"study_design_scores_gemma":[0.023848591,0.016430277,0.070982434,0.0022638468,0.013336778,0.00066471664,0.0015315633,0.60784805,0.008771992,0.24066192,0.012740985,0.0009188902],"about_ca_topic_score_codex":0.0042967126,"about_ca_topic_score_gemma":0.002409118,"teacher_disagreement_score":0.43225247,"about_ca_system_score_codex":0.0041612224,"about_ca_system_score_gemma":0.007361601,"threshold_uncertainty_score":0.5330443},"labels":[],"label_agreement":null},{"id":"W2981744747","doi":"10.1503/cmaj.190085","title":"Testing group differences for confounder selection in nonrandomized studies: flawed practice","year":2019,"lang":"en","type":"article","venue":"Canadian Medical Association Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Confounding; Random assignment; Selection (genetic algorithm); Medicine; Key (lock); Selection bias; Intervention (counseling); Computer science; Family medicine; Pathology; Machine learning; Computer security; Nursing","score_opus":0.1467618169955665,"score_gpt":0.41679078570413347,"score_spread":0.27002896870856696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2981744747","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013659833,0.0054745264,0.9571088,0.013024121,0.0018229418,0.004037015,0.0005049901,0.00073484035,0.0036328612],"genre_scores_gemma":[0.3445635,0.0013998641,0.63557,0.008873169,0.0013542753,0.006748285,0.000290778,0.0002565571,0.00094350945],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.16345066,0.6949196,0.04772253,0.048152238,0.04440368,0.0013512392],"domain_scores_gemma":[0.027795114,0.8972758,0.019353136,0.04733611,0.007500984,0.00073895673],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7227249,0.0032600781,0.007877702,0.0075804335,0.0033130022,0.008058622,0.010129752,0.009683926,0.0072227796],"category_scores_gemma":[0.915151,0.0032833733,0.007263276,0.00677488,0.032020357,0.012410739,0.008195825,0.015269959,0.0011266876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005364241,0.0006829579,0.08375614,0.018797908,0.026538555,0.0032557389,0.012602585,0.01832529,0.0021337094,0.4299316,0.024689015,0.37392223],"study_design_scores_gemma":[0.0018158393,0.0012098503,0.010299707,0.0060215145,0.0031551218,0.0014458038,0.00088925235,0.047261227,0.0031455872,0.9108894,0.013616686,0.00024994081],"about_ca_topic_score_codex":0.002395484,"about_ca_topic_score_gemma":0.001537767,"teacher_disagreement_score":0.2772751,"about_ca_system_score_codex":0.0048652007,"about_ca_system_score_gemma":0.007017233,"threshold_uncertainty_score":0.3419296},"labels":[],"label_agreement":null},{"id":"W2981913938","doi":"10.1016/b978-0-12-811316-5.00008-2","title":"Detailed Treatment Plan","year":2019,"lang":"en","type":"book-chapter","venue":"Elsevier eBooks","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Centre for Interdisciplinary Research in Rehabilitation","funders":"","keywords":"Plan (archaeology); Computer science; Geography; Archaeology","score_opus":0.11963435797991798,"score_gpt":0.35094809074189165,"score_spread":0.23131373276197367,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2981913938","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004768029,0.0019708558,0.005275005,0.010099522,0.012143468,0.002457587,0.021269668,0.0015799749,0.944727],"genre_scores_gemma":[0.00086752686,0.00089132227,0.0016494881,0.0040717423,0.00094936515,0.0017176967,0.004344308,0.00031823383,0.98519033],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994073,0.00012137737,0.00003139377,0.00008051988,0.0002803906,0.00007897536],"domain_scores_gemma":[0.9981958,0.0005458098,0.00007499862,0.00023341614,0.00068658555,0.00026336397],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0012754628,0.0009796863,0.00086326804,0.0034731722,0.0014995564,0.0021118573,0.0017475713,0.0026491284,0.8274852],"category_scores_gemma":[0.007085927,0.00039643628,0.00078061514,0.0019524985,0.0005639075,0.001306062,0.0018158167,0.0019503745,0.60737485],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024938872,0.000042195166,0.000033597826,0.00010450836,0.000001369147,0.000029033215,0.0000125006845,0.000064333246,0.00006493931,0.004792279,0.945912,0.048918318],"study_design_scores_gemma":[0.000018996665,0.000014658192,0.00019001041,0.00013549459,0.0000022131364,0.00004672936,0.000033826418,0.000057672085,0.00007961814,0.0035126277,0.9959031,0.000005145098],"about_ca_topic_score_codex":0.0045986,"about_ca_topic_score_gemma":0.013186046,"teacher_disagreement_score":0.8274852,"about_ca_system_score_codex":0.001679714,"about_ca_system_score_gemma":0.0026795238,"threshold_uncertainty_score":0.24607134},"labels":[],"label_agreement":null},{"id":"W2982005826","doi":"10.1016/j.jamcollsurg.2019.10.003","title":"Use of Propensity Score Methodology in Contemporary High-Impact Surgical Literature","year":2019,"lang":"en","type":"article","venue":"Journal of the American College of Surgeons","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; McGill University Health Centre; University of Ottawa","funders":"","keywords":"Propensity score matching; Medicine; Covariate; Confounding; Observational study; Odds ratio; Univariate; Odds; Selection bias; Meta-analysis; Study heterogeneity; Multivariate statistics; Univariate analysis; Multivariate analysis; Internal medicine; Statistics; Logistic regression; Pathology","score_opus":0.37125641664828146,"score_gpt":0.42437729479580066,"score_spread":0.0531208781475192,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2982005826","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026075827,0.9109418,0.03994483,0.011221381,0.0017813535,0.0036151311,0.0023087235,0.00015095482,0.0039598756],"genre_scores_gemma":[0.42859793,0.45854077,0.088307835,0.008017194,0.0042955405,0.008633958,0.0027093948,0.00019719944,0.000700213],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.6428298,0.18209167,0.120686315,0.0111159915,0.041962627,0.0013136155],"domain_scores_gemma":[0.16870499,0.59484375,0.18039656,0.019352445,0.035570223,0.001132116],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25230336,0.0013648019,0.004112223,0.060693283,0.0014407357,0.00818436,0.0033512006,0.002695811,0.004694679],"category_scores_gemma":[0.60549587,0.0015042939,0.0061901086,0.044513986,0.0043174895,0.008380295,0.0056861658,0.0021489963,0.0005575141],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009038467,0.00010055382,0.102006346,0.41971827,0.021304116,0.0006850916,0.0046889526,0.0017384227,0.00090733153,0.013556594,0.009988162,0.42440233],"study_design_scores_gemma":[0.000980765,0.0015221962,0.14410447,0.6068861,0.044677075,0.004962811,0.0057550557,0.005053974,0.0034827206,0.047551718,0.13446467,0.000558494],"about_ca_topic_score_codex":0.0021308945,"about_ca_topic_score_gemma":0.002664519,"teacher_disagreement_score":0.74769664,"about_ca_system_score_codex":0.00464189,"about_ca_system_score_gemma":0.014248047,"threshold_uncertainty_score":0.9220431},"labels":[],"label_agreement":null},{"id":"W2982251593","doi":"10.1093/eurheartj/ehz746.0648","title":"P5707An evaluation of the use of propensity scores in cardiovascular literature: a systematic review and recommendations","year":2019,"lang":"en","type":"review","venue":"European Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"","keywords":"Medicine; Observational study; Systematic review; MEDLINE; Medical literature; Randomized controlled trial; Psychological intervention; New england; Family medicine; Internal medicine; Pathology; Psychiatry","score_opus":0.6694194216818972,"score_gpt":0.4876004993261666,"score_spread":0.18181892235573055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2982251593","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020450852,0.92001384,0.0054810224,0.04970868,0.008002676,0.010141338,0.0018371623,0.00014082633,0.002629274],"genre_scores_gemma":[0.031650007,0.87257993,0.035827845,0.031133154,0.0037916494,0.02190971,0.0014277039,0.00008555622,0.0015944308],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.8356552,0.08284928,0.053336997,0.0045736115,0.02191205,0.0016728553],"domain_scores_gemma":[0.53930265,0.27028638,0.08469001,0.008484372,0.09335064,0.0038859125],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1524466,0.0023863749,0.0074126525,0.022994349,0.0019200232,0.0066251517,0.0061454414,0.006218077,0.0098365415],"category_scores_gemma":[0.42651728,0.0021186701,0.011360868,0.01507602,0.003084189,0.011425807,0.004215566,0.0039550355,0.002553346],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003573279,0.0000593962,0.003086929,0.82675534,0.008924474,0.00014750344,0.00059575925,0.00023334996,0.0002596988,0.0015019367,0.026516171,0.13156201],"study_design_scores_gemma":[0.00035875652,0.00009765232,0.002261703,0.9537086,0.012189034,0.00007901515,0.000335992,0.000272009,0.00019474473,0.0017489382,0.028706796,0.00004673116],"about_ca_topic_score_codex":0.010813046,"about_ca_topic_score_gemma":0.019695481,"teacher_disagreement_score":0.8475534,"about_ca_system_score_codex":0.010893436,"about_ca_system_score_gemma":0.045500506,"threshold_uncertainty_score":0.8062243},"labels":[],"label_agreement":null},{"id":"W2982419922","doi":"10.1080/07350015.2019.1684300","title":"Sharp Bounds on Functionals of the Joint Distribution in the Analysis of Treatment Effects","year":2019,"lang":"en","type":"article","venue":"Journal of Business and Economic Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Mathematical optimization; Identification (biology); Computer science; Joint (building); Focus (optics); Distribution (mathematics); Selection (genetic algorithm); Upper and lower bounds; Joint probability distribution; Econometrics; Applied mathematics; Mathematics; Statistics; Machine learning; Engineering","score_opus":0.07145711777495668,"score_gpt":0.3386223486793442,"score_spread":0.26716523090438754,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2982419922","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028427127,0.00089295045,0.9943262,0.0005796559,0.00003464677,0.000052187745,0.000059573336,0.000099174154,0.001112812],"genre_scores_gemma":[0.2927221,0.003940056,0.69337815,0.0016484493,0.0006040122,0.0016969135,0.0007515079,0.0005864306,0.0046724016],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9465235,0.043194976,0.001237181,0.0035158736,0.004514497,0.0010138808],"domain_scores_gemma":[0.59573513,0.37585607,0.00774695,0.015575197,0.003938015,0.0011485426],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10173873,0.002864962,0.0042528077,0.005067991,0.0014417253,0.0052484325,0.0049312045,0.0046025477,0.005022356],"category_scores_gemma":[0.30820435,0.0022052294,0.0034567234,0.0038819406,0.010995553,0.01307876,0.0074373363,0.015069258,0.0010426571],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013055684,0.00007822881,0.0019274324,0.0003791105,0.00029132213,0.00016951929,0.0005526209,0.06289096,0.00084179966,0.89552695,0.0012695845,0.035941817],"study_design_scores_gemma":[0.000041133637,0.00008628976,0.0010184796,0.00020033124,0.00008586167,0.00013010144,0.00008184442,0.15632232,0.0009434467,0.83869666,0.0023424337,0.000051145522],"about_ca_topic_score_codex":0.0015525772,"about_ca_topic_score_gemma":0.0010461864,"teacher_disagreement_score":0.10173873,"about_ca_system_score_codex":0.0035705483,"about_ca_system_score_gemma":0.0032195202,"threshold_uncertainty_score":0.53805226},"labels":[],"label_agreement":null},{"id":"W2983970670","doi":"10.1920/wp.cem.2019.2119","title":"Optimal Data Collection for Randomized Control Trials","year":2019,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; Economic and Social Research Council; University of Pennsylvania; Princeton University","keywords":"Randomized controlled trial; Data collection; Geography; Computer science; Statistics; Mathematics; Medicine","score_opus":0.5368749035102747,"score_gpt":0.5423176930024491,"score_spread":0.005442789492174471,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2983970670","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024862066,0.0030719226,0.98304015,0.0035788452,0.00041985675,0.0032377809,0.00056357554,0.000410148,0.0031916066],"genre_scores_gemma":[0.06835187,0.0027114828,0.90891033,0.0018387843,0.00069840084,0.014881751,0.00087320636,0.00024391152,0.0014903076],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.71139526,0.25888577,0.008677777,0.009177586,0.010327458,0.0015361651],"domain_scores_gemma":[0.6032674,0.3417211,0.018647384,0.027555393,0.006763886,0.0020449406],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15274039,0.0030300855,0.007818396,0.0034383505,0.0015573351,0.004023015,0.0050142007,0.0053527094,0.013684985],"category_scores_gemma":[0.44081986,0.0042536175,0.0039576245,0.0049717426,0.004173392,0.006701403,0.0044950093,0.009052945,0.0029485729],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006458795,0.0007971521,0.0027149983,0.006274041,0.0017365566,0.00030572974,0.0006178482,0.07049675,0.0011475203,0.5171957,0.025801806,0.36645305],"study_design_scores_gemma":[0.0056792144,0.0009830013,0.001392475,0.0020161194,0.000695533,0.00029071516,0.00011841025,0.14172707,0.0017127407,0.82065475,0.024608718,0.00012121816],"about_ca_topic_score_codex":0.0020041743,"about_ca_topic_score_gemma":0.0016612271,"teacher_disagreement_score":0.84725964,"about_ca_system_score_codex":0.0045815865,"about_ca_system_score_gemma":0.011471646,"threshold_uncertainty_score":0.80777806},"labels":[],"label_agreement":null},{"id":"W2991051464","doi":"10.23889/ijpds.v4i3.1319","title":"High-dimensional propensity score adjustment in HIV research using linked administrative health data","year":2019,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"AIDS Vancouver","funders":"","keywords":"Observational study; Medicine; Confounding; Context (archaeology); Propensity score matching; Population; Environmental health; Geography","score_opus":0.8021241040371514,"score_gpt":0.6189031968739147,"score_spread":0.1832209071632367,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2991051464","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12847185,0.01662797,0.80025095,0.02037794,0.002556715,0.0035478438,0.017933121,0.0014974633,0.008736201],"genre_scores_gemma":[0.6443368,0.004973899,0.3226512,0.003519449,0.0017040317,0.0064003863,0.013565684,0.00033352897,0.0025150352],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8839164,0.09367764,0.007383186,0.0073939553,0.0061014476,0.001527421],"domain_scores_gemma":[0.7888786,0.14224656,0.031043379,0.027052209,0.008713571,0.002065685],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11531552,0.001163658,0.0018841962,0.00656438,0.002177248,0.0045610494,0.0033289222,0.0017883503,0.0064224927],"category_scores_gemma":[0.22562937,0.0010736586,0.004086224,0.01261192,0.0019172153,0.0025479647,0.0060847504,0.0033211776,0.0010147832],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006593997,0.00042412087,0.6601977,0.0020812845,0.010552332,0.0004208163,0.001029469,0.020441033,0.00028990934,0.05379384,0.041394427,0.20871574],"study_design_scores_gemma":[0.0008380806,0.00088267063,0.43436036,0.0031773415,0.0037406469,0.0010825123,0.001512526,0.15044379,0.0013538188,0.31725693,0.08488037,0.00047092757],"about_ca_topic_score_codex":0.010955138,"about_ca_topic_score_gemma":0.009460446,"teacher_disagreement_score":0.8846845,"about_ca_system_score_codex":0.0021703113,"about_ca_system_score_gemma":0.00535783,"threshold_uncertainty_score":0.60985404},"labels":[],"label_agreement":null},{"id":"W2992485813","doi":"10.1080/02664763.2021.1911966","title":"Confounding adjustment methods for multi-level treatment comparisons under lack of positivity and unknown model specification","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Université Laval","keywords":"Covariate; Estimator; Observational study; Context (archaeology); Specification; Confounding; Matching (statistics); Variance (accounting); Propensity score matching","score_opus":0.6386904553834739,"score_gpt":0.5704813769769004,"score_spread":0.06820907840657353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2992485813","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069481125,0.00030424885,0.99135476,0.0002403937,0.000077280354,0.0004238946,0.00007199922,0.00022233058,0.0003569855],"genre_scores_gemma":[0.24559945,0.00032792834,0.749485,0.0004343222,0.00016662717,0.002740784,0.00028217328,0.00016068912,0.0008031192],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90476596,0.07974041,0.003626709,0.0056586843,0.0052753943,0.0009328796],"domain_scores_gemma":[0.7690945,0.18397819,0.015398738,0.025558712,0.005129316,0.0008405609],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09793293,0.0013224763,0.0021840825,0.0019241285,0.0013591439,0.0018071143,0.0034847022,0.0022742634,0.005721012],"category_scores_gemma":[0.30091643,0.00079125626,0.00398652,0.0024876487,0.0030021628,0.0030731307,0.004094722,0.003271505,0.0004685299],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023843574,0.00041687224,0.03440333,0.0018603071,0.005265258,0.0004878334,0.0015431072,0.07420706,0.003275932,0.28420556,0.004830739,0.5871197],"study_design_scores_gemma":[0.0015335897,0.0020631705,0.0179988,0.0005817295,0.0018619809,0.0005299191,0.00034687316,0.42318055,0.006586961,0.52814,0.01697202,0.0002043255],"about_ca_topic_score_codex":0.00209293,"about_ca_topic_score_gemma":0.0019646147,"teacher_disagreement_score":0.09793293,"about_ca_system_score_codex":0.0012797322,"about_ca_system_score_gemma":0.0041149794,"threshold_uncertainty_score":0.517925},"labels":[],"label_agreement":null},{"id":"W2993516287","doi":"10.1093/neuros/nyz509","title":"Comparing Effects of Treatment: Controlling for Confounding","year":2019,"lang":"en","type":"review","venue":"Neurosurgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Confounding; Medicine; Propensity score matching; Sample size determination; Causal inference; Matching (statistics); Research design; Statistics; Surgery; Internal medicine; Mathematics","score_opus":0.3940133581819556,"score_gpt":0.47494344151657364,"score_spread":0.08093008333461804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2993516287","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006434995,0.9883946,0.007591108,0.0012343648,0.0005773094,0.00018284775,0.00010647406,0.000017083878,0.0012526906],"genre_scores_gemma":[0.02485697,0.9512796,0.020227822,0.0011797415,0.0009862737,0.00097526534,0.00014675253,0.000023626748,0.00032393596],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9563119,0.034525305,0.003438496,0.0017720059,0.003661943,0.00029033553],"domain_scores_gemma":[0.8992532,0.093535066,0.0040358016,0.0016440898,0.0013644771,0.00016736642],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.033473533,0.0011979247,0.0049946103,0.003866712,0.00038242075,0.0019332431,0.0025423465,0.0021056833,0.004562509],"category_scores_gemma":[0.07549871,0.0004620395,0.005788945,0.003419771,0.002273029,0.00213494,0.0011193121,0.002462433,0.00036371284],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052554725,0.000093960356,0.0014450883,0.14375554,0.010253941,0.000086178145,0.0002574832,0.0023578675,0.0002523126,0.039797645,0.003677636,0.79749674],"study_design_scores_gemma":[0.001956759,0.0021524401,0.018124957,0.3305858,0.05163701,0.0015608174,0.0007877662,0.0061366744,0.0033711046,0.265778,0.31762183,0.0002868776],"about_ca_topic_score_codex":0.0021835205,"about_ca_topic_score_gemma":0.001995718,"teacher_disagreement_score":0.96652645,"about_ca_system_score_codex":0.0020789683,"about_ca_system_score_gemma":0.0043916064,"threshold_uncertainty_score":0.1770271},"labels":[],"label_agreement":null},{"id":"W2993745637","doi":"10.1002/sim.8419","title":"Causal inference with noisy data: Bias analysis and estimation approaches to simultaneously addressing missingness and misclassification in binary outcomes","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Missing data; Estimator; Inference; Causal inference; Computer science; Statistics; Estimation; Statistical inference; Econometrics; Binary number; Artificial intelligence; Mathematics; Machine learning","score_opus":0.43835106484182346,"score_gpt":0.46189622136305486,"score_spread":0.023545156521231403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2993745637","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012739946,0.00095451693,0.99681085,0.00050433836,0.00006314434,0.000031249205,0.00003670854,0.000036585418,0.00028853962],"genre_scores_gemma":[0.18567896,0.00651273,0.8024429,0.0008970616,0.0012584535,0.0007274041,0.0002704956,0.00013024657,0.0020817367],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9662651,0.026191326,0.0011306141,0.0025430862,0.0033962366,0.00047372733],"domain_scores_gemma":[0.8807174,0.1002733,0.008213503,0.007154925,0.003160829,0.00047991908],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.051228125,0.0019946585,0.003254667,0.0053228233,0.001191044,0.0027187879,0.0046728896,0.003744787,0.0028795882],"category_scores_gemma":[0.16266638,0.0010198039,0.0034096243,0.0064836326,0.0042413655,0.004346053,0.00378166,0.004418565,0.00042008056],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000081554,0.00010486281,0.0060183206,0.0009875956,0.0009017912,0.0002796083,0.0006212875,0.11541111,0.0008675067,0.69984734,0.0017053492,0.17317377],"study_design_scores_gemma":[0.000046234385,0.00008125182,0.0012032894,0.00026827745,0.00024768463,0.00018811645,0.00009295768,0.26411974,0.00093982695,0.7284229,0.004318308,0.00007145429],"about_ca_topic_score_codex":0.002652686,"about_ca_topic_score_gemma":0.0017849351,"teacher_disagreement_score":0.9487719,"about_ca_system_score_codex":0.0020805162,"about_ca_system_score_gemma":0.003482274,"threshold_uncertainty_score":0.27092344},"labels":[],"label_agreement":null},{"id":"W2995122033","doi":"","title":"Learning Disentangled Representations for CounterFactual Regression","year":2020,"lang":"en","type":"article","venue":"International Conference on Learning Representations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Counterfactual thinking; Leverage (statistics); Computer science; Observational study; Selection bias; Covariate; Machine learning; Selection (genetic algorithm); Econometrics; Population; Model selection; Regression; Artificial intelligence; Statistics; Mathematics; Psychology","score_opus":0.279971621243436,"score_gpt":0.48483052989203934,"score_spread":0.20485890864860334,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2995122033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0081157675,0.0006762504,0.9893189,0.00056567136,0.00004458834,0.000076745935,0.00027304637,0.0003946022,0.0005344184],"genre_scores_gemma":[0.4508722,0.0013976453,0.5392421,0.0009603118,0.00041102196,0.000873602,0.0034283793,0.00020224505,0.0026124825],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9908924,0.006774746,0.00035456123,0.0010365924,0.0006968404,0.00024478647],"domain_scores_gemma":[0.95002484,0.041008532,0.002395305,0.005133995,0.0010187948,0.00041861684],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019216161,0.001696005,0.002600135,0.0022472418,0.0006242189,0.003091718,0.0035422763,0.0027403997,0.0035170622],"category_scores_gemma":[0.06536238,0.00085121795,0.0020360558,0.00300602,0.0017981259,0.004726478,0.003652858,0.0057523325,0.0009987858],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005602501,0.00045873257,0.0066690063,0.0005568768,0.0006243375,0.0001942646,0.00044801692,0.3890463,0.0008707336,0.20928161,0.0061796186,0.38511023],"study_design_scores_gemma":[0.000046769004,0.000056056157,0.00037609637,0.00006870915,0.00004428579,0.000046045152,0.000024343171,0.8266334,0.00038834408,0.17084894,0.001447382,0.000019656087],"about_ca_topic_score_codex":0.002224409,"about_ca_topic_score_gemma":0.0022877064,"teacher_disagreement_score":0.019216161,"about_ca_system_score_codex":0.0016490874,"about_ca_system_score_gemma":0.001963866,"threshold_uncertainty_score":0.10162598},"labels":[],"label_agreement":null},{"id":"W2995591168","doi":"10.1111/bmsp.12194","title":"The danger of conflating level‐specific effects of control variables when primary interest lies in level‐2 effects","year":2019,"lang":"en","type":"article","venue":"British Journal of Mathematical and Statistical Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Conflation; Cluster (spacecraft); Variable (mathematics); Control variable; Econometrics; Multilevel model; Estimation; Control (management); Statistics; Variables; Psychology; Computer science; Mathematics; Economics; Epistemology; Artificial intelligence","score_opus":0.0946494624905834,"score_gpt":0.3728073056028315,"score_spread":0.2781578431122481,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2995591168","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018651726,0.0023765655,0.955196,0.010593482,0.0017242417,0.00032411327,0.00045386815,0.0009470012,0.009732953],"genre_scores_gemma":[0.36678034,0.0017161584,0.6093718,0.013263452,0.0013066146,0.0017703363,0.00053379487,0.0011831993,0.0040743896],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8167135,0.13480504,0.011473543,0.012319761,0.023198655,0.0014895357],"domain_scores_gemma":[0.5868557,0.2912759,0.028999822,0.07641584,0.015358238,0.0010944951],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14596398,0.00183239,0.0031974732,0.0027506968,0.002662772,0.0055341646,0.003775885,0.0032166003,0.0042164368],"category_scores_gemma":[0.46376657,0.0016742726,0.002321546,0.0052447096,0.010593778,0.007612426,0.00851299,0.013037918,0.001926974],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062986684,0.0001630341,0.026452232,0.0019807424,0.0011365394,0.00064418756,0.019155564,0.008385325,0.0043511204,0.6821377,0.029954378,0.22500928],"study_design_scores_gemma":[0.000109081804,0.00029006563,0.013016979,0.001385972,0.000345155,0.00086290936,0.0025371595,0.02616815,0.010009819,0.8825261,0.06246445,0.00028427926],"about_ca_topic_score_codex":0.0055482117,"about_ca_topic_score_gemma":0.0047724107,"teacher_disagreement_score":0.85403603,"about_ca_system_score_codex":0.0026656168,"about_ca_system_score_gemma":0.0030529827,"threshold_uncertainty_score":0.7719405},"labels":[],"label_agreement":null},{"id":"W2995714276","doi":"10.1016/j.annepidem.2019.12.006","title":"Visualization tool of variable selection in bias–variance tradeoff for inverse probability weights","year":2019,"lang":"en","type":"article","venue":"Annals of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; McGill University; Jewish General Hospital","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development","keywords":"Confounding; Propensity score matching; Statistics; Inverse probability; Estimator; Medicine; Variance (accounting); Econometrics; Mathematics","score_opus":0.44819868361695125,"score_gpt":0.49089526374425557,"score_spread":0.04269658012730432,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2995714276","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0081873555,0.00031981067,0.9734125,0.0008840173,0.00018935437,0.000072337374,0.0009137698,0.013247052,0.0027737408],"genre_scores_gemma":[0.19062297,0.0004261755,0.8011742,0.00026671644,0.000178918,0.00036853759,0.0010629578,0.0029867052,0.0029127116],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976902,0.0013520382,0.00017502526,0.00021494851,0.0004557139,0.000112060276],"domain_scores_gemma":[0.98046243,0.015636455,0.0007689035,0.001146406,0.0016699608,0.00031575933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007666629,0.0015078419,0.0011402598,0.004062232,0.0007337949,0.0034542212,0.0016788058,0.0018329533,0.02786366],"category_scores_gemma":[0.041813716,0.00073157623,0.0011156555,0.002378281,0.00054618146,0.0026907336,0.0020563654,0.0023168968,0.0021399811],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013018154,0.00037842774,0.0069399695,0.0013556272,0.00035969669,0.001163429,0.0018999302,0.094826095,0.013874675,0.20823026,0.09054863,0.57912153],"study_design_scores_gemma":[0.00031139373,0.00014001029,0.0014529646,0.00024958418,0.00014673219,0.00049931515,0.00021081914,0.81219065,0.013254974,0.13989009,0.031547755,0.00010572807],"about_ca_topic_score_codex":0.0027867972,"about_ca_topic_score_gemma":0.0020960164,"teacher_disagreement_score":0.02786366,"about_ca_system_score_codex":0.0005723398,"about_ca_system_score_gemma":0.0015242493,"threshold_uncertainty_score":0.0932132},"labels":[],"label_agreement":null},{"id":"W2995768992","doi":"10.1002/sim.8410","title":"Safety surveillance and the estimation of risk in select populations: Flexible methods to control for confounding while targeting marginal comparisons via standardization","year":2019,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institutes of Health; U.S. Food and Drug Administration; Hamilton Health Sciences Foundation; National Center for Advancing Translational Sciences; U.S. Department of Health and Human Services","keywords":"Covariate; Causal inference; Confounding; Computer science; Inference; Statistics; Context (archaeology); Econometrics; Machine learning; Mathematics; Artificial intelligence","score_opus":0.07507788337893141,"score_gpt":0.472539222786533,"score_spread":0.3974613394076016,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2995768992","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0068595516,0.00015846627,0.992161,0.00028481253,0.000022486016,0.0000855553,0.00004355454,0.00009117751,0.00029342808],"genre_scores_gemma":[0.35497716,0.0005560233,0.6416765,0.00046486603,0.00021333902,0.0008715341,0.00026494547,0.00010558187,0.00086998206],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9613798,0.03141581,0.0010745815,0.0032528283,0.0023873851,0.00048969284],"domain_scores_gemma":[0.922535,0.057929765,0.0056978236,0.011473907,0.0018926795,0.0004708516],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04870896,0.001189314,0.0019532803,0.0023527169,0.000864553,0.0019308957,0.0025988235,0.0014248393,0.0017230716],"category_scores_gemma":[0.1294689,0.0007232426,0.0028629696,0.0023589593,0.003955954,0.0026322736,0.0043850695,0.0033111037,0.00022411681],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003163221,0.00019816821,0.038751323,0.00037243427,0.001451501,0.0005526995,0.0014928731,0.20910494,0.0018341405,0.37082398,0.002070936,0.37303063],"study_design_scores_gemma":[0.00015241264,0.00025850837,0.008508856,0.00012336198,0.00026669248,0.00021173745,0.00016146571,0.5191088,0.001802864,0.46491665,0.0044030137,0.00008575126],"about_ca_topic_score_codex":0.0037753074,"about_ca_topic_score_gemma":0.002356123,"teacher_disagreement_score":0.04870896,"about_ca_system_score_codex":0.0009879689,"about_ca_system_score_gemma":0.0028839386,"threshold_uncertainty_score":0.25760067},"labels":[],"label_agreement":null},{"id":"W2996569227","doi":"10.1257/aer.20171634","title":"A Theory of Experimenters: Robustness, Randomization, and Balance","year":2020,"lang":"en","type":"article","venue":"American Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":78,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Robustness (evolution); Ambiguity; Quantile; Economics; Econometrics; Decision maker; SAFER; Computer science; Balance (ability); Randomization; Sample size determination; Preference; Microeconomics; Mathematics; Statistics; Randomized controlled trial; Psychology; Management science; Medicine","score_opus":0.09297531679658333,"score_gpt":0.3749022126952344,"score_spread":0.28192689589865105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2996569227","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016247539,0.0017998026,0.9436564,0.014981367,0.00029696277,0.0004459381,0.00017267175,0.00019853674,0.022200793],"genre_scores_gemma":[0.75331205,0.0020318183,0.22777955,0.005850203,0.0013209372,0.0025995632,0.00014933565,0.00018062208,0.0067760297],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82200766,0.15165773,0.003450589,0.010293391,0.010283202,0.0023074327],"domain_scores_gemma":[0.5164699,0.4117871,0.0326278,0.030015212,0.0068698917,0.002230139],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14730625,0.0021786212,0.0036489747,0.0024383385,0.002261326,0.008092735,0.0042351373,0.0082402,0.012141404],"category_scores_gemma":[0.35976645,0.0014577683,0.0020088207,0.0026525133,0.021502087,0.013068848,0.0051660007,0.00825344,0.0014087979],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024813783,0.000060290648,0.0012646517,0.00019676285,0.00013105519,0.000066881315,0.0003177547,0.015508008,0.00032963863,0.9639714,0.0011224449,0.016782993],"study_design_scores_gemma":[0.00022057179,0.0002138628,0.0004491666,0.00009245509,0.000047253878,0.00006141183,0.00007760222,0.029429886,0.00027958612,0.96604073,0.003055214,0.000032231907],"about_ca_topic_score_codex":0.0012039641,"about_ca_topic_score_gemma":0.0005510587,"teacher_disagreement_score":0.85269374,"about_ca_system_score_codex":0.0059303893,"about_ca_system_score_gemma":0.004042819,"threshold_uncertainty_score":0.7790392},"labels":[],"label_agreement":null},{"id":"W2997303312","doi":"10.1146/annurev-publhealth-040119-094027","title":"Essential Ingredients and Innovations in the Design and Analysis of Group-Randomized Trials","year":2019,"lang":"en","type":"review","venue":"Annual Review of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":54,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"","keywords":"Randomized controlled trial; Research design; Clinical study design; Alternative medicine; Medical physics; Medicine; Management science; Computer science; Clinical trial; Engineering; Surgery; Mathematics; Pathology; Statistics","score_opus":0.5427499544596217,"score_gpt":0.5734347809793503,"score_spread":0.030684826519728592,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2997303312","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00026616087,0.61680907,0.3563802,0.016271902,0.00388219,0.0009691222,0.00033896195,0.00028372914,0.0047985874],"genre_scores_gemma":[0.008050906,0.49274504,0.47865388,0.006815524,0.007852371,0.004355598,0.00026337875,0.00024351609,0.0010197482],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.73301333,0.2104752,0.018799216,0.0074568028,0.029321808,0.0009336635],"domain_scores_gemma":[0.5430904,0.4229457,0.009558973,0.013119229,0.010569337,0.0007164001],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18648481,0.00245719,0.0066466075,0.012281347,0.0013124663,0.00642496,0.005191555,0.00592357,0.005517076],"category_scores_gemma":[0.31697673,0.002251362,0.004571032,0.015640449,0.013803827,0.009472653,0.0038211949,0.013993583,0.003316463],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002130208,0.00009330566,0.00039500507,0.04039958,0.00079946406,0.00010661878,0.00068123406,0.0023488211,0.00029619524,0.37662926,0.014857984,0.56317955],"study_design_scores_gemma":[0.00033547427,0.00033595867,0.0009989799,0.039851613,0.0008262845,0.0005121388,0.00022440434,0.0034441694,0.0010510326,0.61760724,0.33461586,0.00019684632],"about_ca_topic_score_codex":0.002095154,"about_ca_topic_score_gemma":0.0016971714,"teacher_disagreement_score":0.8135152,"about_ca_system_score_codex":0.0064355773,"about_ca_system_score_gemma":0.012001887,"threshold_uncertainty_score":0.98623776},"labels":[],"label_agreement":null},{"id":"W2998463403","doi":"10.1002/sim.8481","title":"A threshold‐free summary index for quantifying the capacity of covariates to yield efficient treatment rules","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Context (archaeology); Econometrics; Estimator; Index (typography); Computer science; Metric (unit); Statistics; Parametric statistics; Mathematics; Economics","score_opus":0.28486632970212217,"score_gpt":0.4353815638659449,"score_spread":0.15051523416382273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2998463403","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03196518,0.0024683094,0.9530537,0.0010070466,0.00018932867,0.00049250136,0.0052849427,0.0010170577,0.0045219855],"genre_scores_gemma":[0.46931192,0.0014840679,0.5160487,0.00083976233,0.00046744052,0.0018259805,0.0077088973,0.0005080241,0.0018052193],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97840524,0.011998924,0.0029264598,0.0021618516,0.0040827575,0.00042464607],"domain_scores_gemma":[0.82739985,0.13692027,0.013482535,0.0136793805,0.0071430537,0.0013749443],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035937913,0.0011747758,0.002782916,0.0059949,0.00046916254,0.0033217822,0.001814619,0.0021439102,0.0055614663],"category_scores_gemma":[0.18011642,0.0005215791,0.002178188,0.0046069496,0.0013127194,0.0039167637,0.0018258481,0.002669204,0.0011013687],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016682375,0.00030868474,0.056661207,0.0029560812,0.003312315,0.0002737624,0.00050679676,0.27131698,0.0049361354,0.18972886,0.023725027,0.44460595],"study_design_scores_gemma":[0.00033636345,0.0020857635,0.034908753,0.0007646946,0.0012073677,0.00080777856,0.00015735642,0.64857626,0.0071077636,0.28013656,0.023560533,0.00035084705],"about_ca_topic_score_codex":0.00076624384,"about_ca_topic_score_gemma":0.00071593927,"teacher_disagreement_score":0.035937913,"about_ca_system_score_codex":0.0016031945,"about_ca_system_score_gemma":0.0017933719,"threshold_uncertainty_score":0.19006014},"labels":[],"label_agreement":null},{"id":"W3003482288","doi":"10.1371/journal.pone.0228098","title":"How to use frailtypack for validating failure-time surrogate endpoints using individual patient data from meta-analyses of randomized controlled trials","year":2020,"lang":"en","type":"review","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Institute of Cancer Research; Institut National de la Santé et de la Recherche Médicale; Institut National Du Cancer; Association pour la Recherche sur le Cancer","keywords":"Surrogate endpoint; Context (archaeology); Surrogate model; Computer science; Randomized controlled trial; Clinical endpoint; Surrogate data; Data mining; Machine learning; Medicine; Surgery","score_opus":0.8963449595823894,"score_gpt":0.5377973172268874,"score_spread":0.35854764235550196,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3003482288","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010491789,0.0050402554,0.9701201,0.003386127,0.0006503533,0.0009730159,0.0029860416,0.0052444683,0.001107899],"genre_scores_gemma":[0.117900364,0.001889144,0.87028605,0.0019755943,0.00027024694,0.002571801,0.0027830403,0.0017669015,0.000556963],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.88487947,0.09972653,0.005762406,0.0045490908,0.004586939,0.00049553585],"domain_scores_gemma":[0.6281386,0.31649593,0.013832918,0.02921819,0.011121346,0.0011930118],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14676002,0.002186009,0.0029088212,0.003576708,0.00065277016,0.004529816,0.0031281002,0.002423617,0.006082608],"category_scores_gemma":[0.45332888,0.0011980691,0.0071262955,0.0031166791,0.0012397759,0.0037497878,0.002489841,0.0037994804,0.0018938791],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0042792093,0.00027375514,0.038529407,0.015859606,0.02321523,0.0008850452,0.0014595422,0.12889217,0.0031562692,0.027493697,0.06586946,0.69008666],"study_design_scores_gemma":[0.0030093691,0.0009311799,0.014777316,0.010274072,0.009348722,0.0010908797,0.00034726222,0.7160956,0.01301538,0.16056374,0.0697602,0.00078616926],"about_ca_topic_score_codex":0.002201626,"about_ca_topic_score_gemma":0.0023859094,"teacher_disagreement_score":0.85324,"about_ca_system_score_codex":0.0010707668,"about_ca_system_score_gemma":0.0044317828,"threshold_uncertainty_score":0.77615047},"labels":[],"label_agreement":null},{"id":"W3004330284","doi":"10.1177/0962280219900362","title":"Estimation of causal effects with repeatedly measured outcomes in a Bayesian framework","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Causal inference; Observational study; Bayesian probability; Markov chain Monte Carlo; Propensity score matching; Computer science; Inverse probability; Marginal structural model; Econometrics; Bayesian inference; Machine learning; Posterior probability; Statistics; Artificial intelligence; Mathematics","score_opus":0.29924381672434486,"score_gpt":0.6201955815925178,"score_spread":0.3209517648681729,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3004330284","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032713108,0.00023086995,0.9956031,0.00035404766,0.000021380005,0.000086661974,0.0000836236,0.00007542122,0.0002735396],"genre_scores_gemma":[0.18235093,0.0014377141,0.8120573,0.00037969046,0.00023180617,0.0013323325,0.00053316937,0.000086471235,0.0015905572],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97092515,0.023771377,0.00087827304,0.001982538,0.0019973326,0.000445224],"domain_scores_gemma":[0.8406437,0.14602481,0.005926484,0.0046550394,0.002169788,0.0005801693],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0488748,0.0013857142,0.0029595217,0.0035094419,0.0009864988,0.002156837,0.0034887418,0.0025011315,0.0039867926],"category_scores_gemma":[0.14450312,0.001514811,0.0030583632,0.003520105,0.002827727,0.0038506673,0.0027732698,0.0049115685,0.0005554434],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021863969,0.00021435172,0.00751655,0.0005742748,0.0009759487,0.00032266814,0.0006257065,0.34796664,0.0005377276,0.5141058,0.0019932454,0.1249484],"study_design_scores_gemma":[0.00012032607,0.000083867046,0.0013358959,0.00011761552,0.00014918645,0.000091102826,0.000054378357,0.5609816,0.00021704346,0.43492734,0.001881651,0.00003999473],"about_ca_topic_score_codex":0.008695924,"about_ca_topic_score_gemma":0.008585002,"teacher_disagreement_score":0.9511252,"about_ca_system_score_codex":0.001917542,"about_ca_system_score_gemma":0.0041173566,"threshold_uncertainty_score":0.2584777},"labels":[],"label_agreement":null},{"id":"W3004365348","doi":"10.1097/ede.0000000000001165","title":"A Graphical Description of Partial Exchangeability","year":2020,"lang":"en","type":"review","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"National Institute of Allergy and Infectious Diseases; National Institute of Mental Health","keywords":"Context (archaeology); Graphical model; Identification (biology); Computer science; Mathematics; Artificial intelligence; History; Biology","score_opus":0.6643106012507909,"score_gpt":0.5440173253947438,"score_spread":0.1202932758560471,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3004365348","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028460305,0.024987435,0.9266991,0.0050503104,0.0004073552,0.00016427328,0.0037004435,0.0006311705,0.03551389],"genre_scores_gemma":[0.36963174,0.08879238,0.4993395,0.0063741957,0.0016066425,0.0021988228,0.006317659,0.0004595467,0.025279434],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99806815,0.0010629152,0.00013011774,0.00039939873,0.0002645163,0.00007483936],"domain_scores_gemma":[0.9935563,0.004807574,0.00065463135,0.0005163493,0.00039775154,0.00006734711],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0030949074,0.0014606683,0.0011617462,0.004035547,0.0005758354,0.0024841735,0.0014926092,0.0019198341,0.02157546],"category_scores_gemma":[0.010674262,0.0005772779,0.0017491999,0.003953373,0.002989574,0.003379939,0.0013324223,0.0025394415,0.0026924796],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000015491132,0.000011281728,0.0003198966,0.0008809544,0.000101183694,0.00021459724,0.00016586934,0.00734511,0.0004072445,0.94848025,0.0063682436,0.035689835],"study_design_scores_gemma":[0.000014447248,0.000017639715,0.00042742415,0.0004051615,0.00009544538,0.0005520158,0.000050507577,0.0067805666,0.00021170959,0.9244835,0.066934414,0.000027238999],"about_ca_topic_score_codex":0.0034269176,"about_ca_topic_score_gemma":0.002484527,"teacher_disagreement_score":0.9969051,"about_ca_system_score_codex":0.0013170996,"about_ca_system_score_gemma":0.0012667889,"threshold_uncertainty_score":0.07217705},"labels":[],"label_agreement":null},{"id":"W3005330424","doi":"10.1515/em-2018-0016","title":"Meeting the Assumptions of Inverse-Intensity Weighting for Longitudinal Data Subject to Irregular Follow-Up: Suggestions for the Design and Analysis of Clinic-Based Cohort Studies","year":2020,"lang":"en","type":"article","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"","keywords":"Conditional independence; Weighting; Cohort; Independence (probability theory); Outcome (game theory); Inverse probability weighting; Cohort study; Medicine; Marginal structural model; Statistics; Psychology; Computer science; Econometrics; Observational study; Mathematics; Propensity score matching","score_opus":0.7908480222615445,"score_gpt":0.5966324160977184,"score_spread":0.19421560616382605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3005330424","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015475559,0.00027243388,0.99290425,0.003816635,0.00019041181,0.0006426448,0.00010012089,0.00013804382,0.00038797082],"genre_scores_gemma":[0.020461679,0.00040808055,0.9725487,0.0016433528,0.00044604656,0.0036885946,0.00014740987,0.00008335396,0.00057278154],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6955022,0.27681506,0.009741379,0.0063082012,0.010343801,0.0012892904],"domain_scores_gemma":[0.22221035,0.7043711,0.016597755,0.03494136,0.01984783,0.002031682],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39046332,0.0025683849,0.004524867,0.00375913,0.0016692645,0.004052823,0.00939729,0.006211321,0.0066300808],"category_scores_gemma":[0.7287521,0.0026951942,0.0058560227,0.0051567233,0.006987942,0.008514748,0.0053145005,0.010960549,0.0015393976],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018977743,0.00083591073,0.026782325,0.0026044575,0.0019021339,0.0017216572,0.0052950196,0.07325858,0.0018877473,0.57487595,0.023362596,0.28557593],"study_design_scores_gemma":[0.00070406066,0.00075261516,0.005811349,0.0012218271,0.00045171662,0.00041439987,0.00080620515,0.14762507,0.0010309658,0.81977713,0.02114387,0.00026090673],"about_ca_topic_score_codex":0.010576415,"about_ca_topic_score_gemma":0.008772505,"teacher_disagreement_score":0.60953665,"about_ca_system_score_codex":0.002455579,"about_ca_system_score_gemma":0.008268078,"threshold_uncertainty_score":0.75166726},"labels":[],"label_agreement":null},{"id":"W3005979941","doi":"10.1186/s12874-019-0876-8","title":"LEVEL (Logical Explanations &amp; Visualizations of Estimates in Linear mixed models): recommendations for reporting multilevel data and analyses","year":2020,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":127,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Population Health Research Institute; McMaster University","funders":"","keywords":"Multilevel model; Computer science; Data science; Statistics; Data mining; Mathematics; Machine learning","score_opus":0.9892096136300748,"score_gpt":0.7711307624025253,"score_spread":0.21807885122754944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3005979941","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008937174,0.0034278773,0.7144529,0.01786268,0.0039393026,0.006945011,0.0988969,0.13096169,0.022620007],"genre_scores_gemma":[0.0036342142,0.0015656101,0.94763166,0.0026004815,0.0004904916,0.011971915,0.009756922,0.018315086,0.0040336144],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9195457,0.05510779,0.0134142,0.002565341,0.008412873,0.00095407607],"domain_scores_gemma":[0.58240676,0.33698335,0.016943248,0.020217277,0.041025467,0.0024238832],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.101009406,0.0043309242,0.0031998446,0.013818271,0.0023356737,0.013302016,0.009701112,0.007769699,0.28602692],"category_scores_gemma":[0.4266371,0.0070961425,0.0099415425,0.0129500255,0.002035116,0.011892207,0.010645031,0.008116183,0.09698503],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002931725,0.0001057085,0.0013858721,0.01141923,0.00039439948,0.00022752675,0.0024013447,0.0016272294,0.0003982912,0.033635475,0.82777464,0.1203371],"study_design_scores_gemma":[0.00065846846,0.00012614712,0.0017555541,0.018266996,0.00041236487,0.00031125374,0.00084425224,0.0078745475,0.0016688608,0.08499714,0.88273185,0.00035257716],"about_ca_topic_score_codex":0.007305748,"about_ca_topic_score_gemma":0.011794048,"teacher_disagreement_score":0.8989906,"about_ca_system_score_codex":0.003188995,"about_ca_system_score_gemma":0.010896179,"threshold_uncertainty_score":0.9568554},"labels":[],"label_agreement":null},{"id":"W3007145966","doi":"10.1093/biomet/asaa003","title":"Generalized instrumental inequalities: testing the instrumental variable independence assumption","year":2020,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Instrumental variable; Mathematics; Independence (probability theory); Variable (mathematics); Outcome (game theory); Econometrics; Inference; Intersection (aeronautics); Conditional independence; Binary number; Variables; Statistics; Mathematical economics; Computer science; Artificial intelligence; Arithmetic","score_opus":0.3397669956737207,"score_gpt":0.3936904073599447,"score_spread":0.053923411686224,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3007145966","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.115209214,0.0004481608,0.87125224,0.0029061367,0.00017633343,0.00033093372,0.0011414252,0.00030259023,0.008232974],"genre_scores_gemma":[0.8817485,0.00022940712,0.11415295,0.0008874363,0.0002353139,0.00086750905,0.00067844347,0.00008295377,0.0011173094],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90990776,0.06901968,0.0028631554,0.0077810744,0.0078218235,0.0026064876],"domain_scores_gemma":[0.4206861,0.52109313,0.020970715,0.02884531,0.006548281,0.0018565035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.060043737,0.0012614321,0.0035499968,0.0027559143,0.0016513233,0.003137227,0.0050948802,0.0022240418,0.010699],"category_scores_gemma":[0.30591384,0.0006133511,0.003602102,0.003467542,0.009554245,0.0047948416,0.005826737,0.0072929636,0.0004609845],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008826641,0.00036277116,0.035250112,0.0005522354,0.0018003309,0.00080828206,0.0009898893,0.03853829,0.00095309416,0.85702604,0.003132012,0.059704285],"study_design_scores_gemma":[0.0003701179,0.00024005698,0.008653932,0.00016926882,0.0002439401,0.00011445189,0.0004869497,0.112122364,0.0013575992,0.8736679,0.002509459,0.000063959626],"about_ca_topic_score_codex":0.0033638892,"about_ca_topic_score_gemma":0.0014701365,"teacher_disagreement_score":0.060043737,"about_ca_system_score_codex":0.0019257134,"about_ca_system_score_gemma":0.004430813,"threshold_uncertainty_score":0.3175454},"labels":[],"label_agreement":null},{"id":"W3007256858","doi":"10.1016/j.jclinepi.2020.02.006","title":"Design characteristics and statistical methods used in interrupted time series studies evaluating public health interventions: a review","year":2020,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":143,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Wilfrid Laurier University; Ottawa Hospital; University of Ottawa","funders":"National Health and Medical Research Council; Canadian Institutes of Health Research","keywords":"Interrupted time series; Public health; Series (stratigraphy); Psychological intervention; Public health interventions; Interrupted Time Series Analysis; Statistics; Statistical analysis; Time series; Medicine; Computer science; Mathematics; Nursing","score_opus":0.9578941774010222,"score_gpt":0.7853317705012486,"score_spread":0.17256240689977365,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3007256858","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016164224,0.998072,0.0013986536,0.00012890647,0.0000696425,0.000043441898,0.000051359726,0.000006642954,0.000067647],"genre_scores_gemma":[0.0035397694,0.99050796,0.005175378,0.000260425,0.00013365639,0.00023713891,0.00008229912,0.000011689809,0.000051654395],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9714796,0.015453229,0.0067723896,0.0020886993,0.0039201677,0.0002858879],"domain_scores_gemma":[0.8346783,0.15214206,0.008325698,0.001457197,0.0031046988,0.00029198214],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.042782262,0.0015309936,0.01059259,0.0053439657,0.00047429584,0.0035783416,0.0039799046,0.0033814379,0.003960041],"category_scores_gemma":[0.113926835,0.001388003,0.0075723375,0.0075975815,0.0015126999,0.0028454305,0.0014733276,0.0030808875,0.00054570043],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00067582895,0.00010082986,0.0016748867,0.43344516,0.011106017,0.000057656183,0.00016974351,0.0011697802,0.00015860994,0.0033352836,0.0031417531,0.5449645],"study_design_scores_gemma":[0.0023616694,0.002094864,0.014676695,0.67683303,0.12366731,0.0017332252,0.00065756013,0.0038538652,0.0012221033,0.023853125,0.14862135,0.00042515926],"about_ca_topic_score_codex":0.0035647359,"about_ca_topic_score_gemma":0.004834523,"teacher_disagreement_score":0.95721775,"about_ca_system_score_codex":0.0024576213,"about_ca_system_score_gemma":0.0066902395,"threshold_uncertainty_score":0.2262569},"labels":[],"label_agreement":null},{"id":"W3008269149","doi":"10.31235/osf.io/86d2k","title":"Effect Decomposition in the Presence of Treatment-induced Confounding: A Regression-with-residuals Approach","year":2019,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Confounding; Estimator; Statistics; Outcome (game theory); Econometrics; Weighting; Mediation; Regression; Set (abstract data type); Conditional expectation; Inverse probability weighting; Mathematics; Medicine; Computer science","score_opus":0.09187174120657353,"score_gpt":0.42975942178175586,"score_spread":0.3378876805751823,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008269149","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013990422,0.00023613477,0.9972656,0.0002489753,0.000040407915,0.000078338686,0.00009445738,0.00020965519,0.00042735244],"genre_scores_gemma":[0.12890029,0.000835322,0.8639345,0.00034195636,0.00023300614,0.0008399545,0.00059156114,0.0004939206,0.0038294725],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9507288,0.04233771,0.0013461586,0.002812575,0.002009734,0.00076499744],"domain_scores_gemma":[0.92140687,0.064550444,0.003405863,0.0071171634,0.003001981,0.00051782187],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0543199,0.002327593,0.003485802,0.0037221082,0.0005836027,0.0020404535,0.005303718,0.0023134735,0.008279919],"category_scores_gemma":[0.12617403,0.0016249671,0.004217216,0.00404237,0.0022536316,0.0024441574,0.004105129,0.004139832,0.0013458239],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044980488,0.00028845074,0.013684318,0.0009840607,0.0024082982,0.0006181811,0.00078626635,0.184767,0.0009091731,0.58780605,0.006545216,0.2007533],"study_design_scores_gemma":[0.00017456425,0.0002452745,0.0029643609,0.00029718404,0.00055118464,0.00014768468,0.00022688683,0.55239403,0.0009992037,0.42981425,0.012103049,0.00008232011],"about_ca_topic_score_codex":0.0109992195,"about_ca_topic_score_gemma":0.007181507,"teacher_disagreement_score":0.0543199,"about_ca_system_score_codex":0.0014677367,"about_ca_system_score_gemma":0.0040155896,"threshold_uncertainty_score":0.28727454},"labels":[],"label_agreement":null},{"id":"W3008905790","doi":"10.1002/sim.8502","title":"Variance estimation when using propensity‐score matching with replacement with survival or time‐to‐event outcomes","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":86,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Event data; Matching (statistics); Variance (accounting); Estimation; Event (particle physics); Survival analysis; Econometrics; Computer science; Mathematics; Covariate","score_opus":0.1810926378835545,"score_gpt":0.4193115110956037,"score_spread":0.2382188732120492,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008905790","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018678621,0.00018374616,0.99687517,0.00016609774,0.000052914605,0.00013856562,0.00008040792,0.000139564,0.0004956486],"genre_scores_gemma":[0.13688096,0.0007917577,0.85758156,0.00046051995,0.0002553126,0.0015496506,0.0007228439,0.00018927407,0.0015680646],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96054405,0.031701457,0.0013979598,0.0025849927,0.0032568465,0.00051465846],"domain_scores_gemma":[0.93285334,0.051921483,0.0043057324,0.008588676,0.0021088545,0.00022185635],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04785462,0.0011279677,0.0018629399,0.0030295944,0.00072280125,0.0018869791,0.00263779,0.0019474298,0.003658494],"category_scores_gemma":[0.18165366,0.000826866,0.0026055821,0.0040811272,0.001770384,0.0028191227,0.0027345133,0.0025834758,0.0007202231],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028613047,0.00023555305,0.024559198,0.000700607,0.0016658185,0.00036993765,0.0006562025,0.14850783,0.0009291477,0.51428354,0.008739842,0.29906622],"study_design_scores_gemma":[0.00017736718,0.00021749457,0.005203915,0.00023485259,0.00025203524,0.00029916517,0.00013999222,0.43006966,0.0016347741,0.5460188,0.015660204,0.000091891736],"about_ca_topic_score_codex":0.003867557,"about_ca_topic_score_gemma":0.0021978375,"teacher_disagreement_score":0.04785462,"about_ca_system_score_codex":0.0011004442,"about_ca_system_score_gemma":0.0024568674,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W3010656855","doi":"10.1142/9789811232701_0019","title":"ParKCa: Causal Inference with Partially Known Causes","year":2020,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Inference; Causal inference; Artificial intelligence; Econometrics; Mathematics","score_opus":0.19317662007528785,"score_gpt":0.40157336232931395,"score_spread":0.2083967422540261,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3010656855","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001289855,0.00039248602,0.9903419,0.0008459762,0.00016499849,0.000082810555,0.0008891507,0.0020799297,0.003912937],"genre_scores_gemma":[0.15441136,0.0011823239,0.82617927,0.000928366,0.0007063033,0.0005834993,0.0029954603,0.0009445484,0.012068913],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9942212,0.0031441431,0.00027060573,0.00110891,0.0010665565,0.00018858006],"domain_scores_gemma":[0.9742415,0.019623313,0.0007437322,0.0039384817,0.0011986465,0.00025431148],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006974224,0.0013357144,0.0016823964,0.0034047668,0.0018639358,0.0031805069,0.0038420383,0.0019149301,0.031842712],"category_scores_gemma":[0.042313438,0.0016424396,0.0037800143,0.0030855513,0.002053774,0.0069751125,0.004128281,0.0052303867,0.0034445438],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021471918,0.00008637876,0.0013471324,0.00058902416,0.00038827077,0.0002643578,0.0002719541,0.022052625,0.0003783863,0.813981,0.027466917,0.13295935],"study_design_scores_gemma":[0.00009925628,0.00001618799,0.00018618382,0.00007887144,0.00015903656,0.00010793738,0.000035668185,0.118899405,0.00075102097,0.8641377,0.01550853,0.000020210999],"about_ca_topic_score_codex":0.0053356537,"about_ca_topic_score_gemma":0.007523356,"teacher_disagreement_score":0.031842712,"about_ca_system_score_codex":0.0013203255,"about_ca_system_score_gemma":0.0037940808,"threshold_uncertainty_score":0.10652447},"labels":[],"label_agreement":null},{"id":"W3011337113","doi":"10.1177/0962280221995963","title":"Causal simulation experiments: Lessons from bias amplification","year":2021,"lang":"en","type":"preprint","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"Canadian Institutes of Health Research","keywords":"Causal inference; Estimator; Context (archaeology); Computer science; Confounding; Econometrics; Inference; Parametric statistics; Set (abstract data type); Class (philosophy); Selection bias; Sensitivity (control systems); Artificial intelligence; Statistics; Mathematics; Engineering","score_opus":0.8123613022187561,"score_gpt":0.7422349751842946,"score_spread":0.07012632703446153,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3011337113","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02092341,0.0019331772,0.95740575,0.00978376,0.0004127231,0.0006755229,0.00026753996,0.00038946889,0.008208675],"genre_scores_gemma":[0.63318664,0.0018291089,0.3538792,0.0053122267,0.00067663606,0.0028972102,0.00024440387,0.00021694571,0.0017575898],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.77595127,0.20880696,0.003325033,0.004946655,0.0061202985,0.0008497918],"domain_scores_gemma":[0.14942843,0.80536085,0.009246688,0.030824007,0.0044328733,0.0007071683],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.20969826,0.0017425756,0.0024604145,0.0016961964,0.0015780027,0.0039345794,0.0047330344,0.0055037825,0.0090379855],"category_scores_gemma":[0.6408678,0.0011763698,0.002365685,0.0020648679,0.009724843,0.010018478,0.006202068,0.0077036223,0.00065415644],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008843899,0.0002970712,0.0064415457,0.0009445848,0.00097378955,0.0002969991,0.0010886812,0.06785407,0.00046300923,0.86253375,0.003087311,0.05513491],"study_design_scores_gemma":[0.00033656962,0.0001815792,0.0005175627,0.0002087032,0.00016951827,0.000108365326,0.00008765337,0.076946236,0.00052784994,0.91832805,0.00255268,0.000035141333],"about_ca_topic_score_codex":0.0014773154,"about_ca_topic_score_gemma":0.00094778516,"teacher_disagreement_score":0.20969826,"about_ca_system_score_codex":0.0021654107,"about_ca_system_score_gemma":0.0030903663,"threshold_uncertainty_score":0.97458273},"labels":[],"label_agreement":null},{"id":"W3011550827","doi":"10.1186/s12874-020-00945-9","title":"Incorporating sampling weights into robust estimation of Cox proportional hazards regression model, with illustration in the Multi-Ethnic Study of Atherosclerosis","year":2020,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"National Center for Advancing Translational Sciences; National Heart, Lung, and Blood Institute","keywords":"Proportional hazards model; Statistics; Estimation; Regression analysis; Regression; Econometrics; Medicine; Computer science; Mathematics","score_opus":0.8839438527848583,"score_gpt":0.6241169862692942,"score_spread":0.2598268665155641,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3011550827","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005995515,0.00029987536,0.9928474,0.00021829842,0.000054399075,0.00006258322,0.000035509795,0.000083911254,0.00040249043],"genre_scores_gemma":[0.27610755,0.0010986625,0.7202894,0.00024277814,0.00020689279,0.0005654815,0.00018188481,0.00014938894,0.0011580066],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9803356,0.016670391,0.00040510806,0.00087611645,0.0014862749,0.00022661439],"domain_scores_gemma":[0.92212254,0.06682544,0.003933134,0.0042574145,0.0025632447,0.00029819293],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040140748,0.0008671039,0.0007591636,0.0013424143,0.0005843432,0.0011380641,0.001973451,0.0014586924,0.0015256694],"category_scores_gemma":[0.14003138,0.00050861586,0.0015979969,0.0019397053,0.00139093,0.002106967,0.0019625,0.0022828379,0.0002214962],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038921458,0.00016619866,0.016926017,0.0005832152,0.00058372633,0.0009895223,0.0009016568,0.3778376,0.0018199815,0.39237896,0.0038188598,0.20360501],"study_design_scores_gemma":[0.00007475885,0.00012117849,0.0018759642,0.000114657516,0.00013939061,0.00019910556,0.00007818225,0.8295343,0.00097242894,0.16269407,0.0041510025,0.000045010325],"about_ca_topic_score_codex":0.0052378625,"about_ca_topic_score_gemma":0.0036837398,"teacher_disagreement_score":0.040140748,"about_ca_system_score_codex":0.0009137187,"about_ca_system_score_gemma":0.0016108834,"threshold_uncertainty_score":0.21228713},"labels":[],"label_agreement":null},{"id":"W3011937366","doi":"10.1038/s41390-020-0835-4","title":"Privacy-preserving statistical analyses in Learning Health Systems","year":2020,"lang":"en","type":"letter","venue":"Pediatric Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Canadian Institutes of Health Research","keywords":"Statistical learning; Computer science; Internet privacy; Psychology; Data science; Artificial intelligence","score_opus":0.6413351111834622,"score_gpt":0.5988428338972334,"score_spread":0.04249227728622884,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3011937366","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00084677205,0.0007132576,0.024360223,0.9669912,0.0017252655,0.000020826825,0.00020752725,0.00013119684,0.005003787],"genre_scores_gemma":[0.1379079,0.004599264,0.05557185,0.72939384,0.04982585,0.00035316462,0.00034366958,0.00025229176,0.021752205],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9855825,0.009483597,0.00075021735,0.0009791703,0.0027194626,0.00048511432],"domain_scores_gemma":[0.7739413,0.21243231,0.0021658128,0.0050864723,0.0047072177,0.0016668391],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.018089723,0.0004329403,0.0010281762,0.0007993367,0.0021307687,0.0046170675,0.001838583,0.018919695,0.0048011895],"category_scores_gemma":[0.14127062,0.00059876294,0.0007805021,0.0009700753,0.0074101305,0.0055062133,0.0019106177,0.022796623,0.0023134416],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021401262,0.00007265452,0.0031077245,0.0001653785,0.0000741058,0.0008340195,0.000365045,0.0035238094,0.00029059328,0.20823802,0.6657167,0.11739796],"study_design_scores_gemma":[0.00012609908,0.000046334968,0.00082303735,0.0001456458,0.000025507077,0.0004418167,0.0001921579,0.024668375,0.0005753711,0.82689774,0.14602056,0.000037319067],"about_ca_topic_score_codex":0.0049241553,"about_ca_topic_score_gemma":0.008093642,"teacher_disagreement_score":0.9819103,"about_ca_system_score_codex":0.0030326983,"about_ca_system_score_gemma":0.0040253964,"threshold_uncertainty_score":0.09566873},"labels":[],"label_agreement":null},{"id":"W3012656410","doi":"10.1177/0962280220902794","title":"Comparing two counterfactual-outcome approaches in causal mediation analysis of a multicategorical exposure: An application for the estimation of the effect of maternal intake of inhaled corticosteroids doses on birthweight","year":2020,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre Hospitalier de l’Université de Montréal; Université de Montréal; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Counterfactual thinking; Categorical variable; Mediation; Marginal structural model; Econometrics; Robustness (evolution); Causal inference; Regression; Medicine; Regression analysis; Outcome (game theory); Statistics; Psychology; Mathematics; Social psychology","score_opus":0.435067383054229,"score_gpt":0.5923306492432306,"score_spread":0.15726326618900166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3012656410","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022223856,0.00093827426,0.97396696,0.0009124223,0.00013225335,0.0004832925,0.00013659082,0.000102801954,0.0011035395],"genre_scores_gemma":[0.341972,0.00091389206,0.6515383,0.00063420204,0.00010816269,0.0033977628,0.00024309628,0.000098212186,0.0010943444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79307884,0.19652721,0.0017794471,0.0040013017,0.003792712,0.000820471],"domain_scores_gemma":[0.5857799,0.3944582,0.0053503113,0.011922744,0.0020835176,0.00040522416],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16389862,0.0015408964,0.0022056638,0.002424815,0.00097235217,0.002661424,0.005066837,0.0029644477,0.0063317833],"category_scores_gemma":[0.29495877,0.00094677793,0.0048119854,0.0028940963,0.0036453304,0.0033036831,0.006189446,0.0042136586,0.00039344223],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025447556,0.0009449829,0.030006198,0.0019310515,0.0065684807,0.0011470418,0.00393629,0.09124656,0.0013325679,0.668214,0.001549432,0.19057854],"study_design_scores_gemma":[0.0007627665,0.001667298,0.010741975,0.0005018579,0.0017647962,0.00043203545,0.0012895485,0.4852355,0.0018815527,0.48827282,0.007216933,0.00023292589],"about_ca_topic_score_codex":0.0042265113,"about_ca_topic_score_gemma":0.0025426198,"teacher_disagreement_score":0.16389862,"about_ca_system_score_codex":0.0017635906,"about_ca_system_score_gemma":0.0026125705,"threshold_uncertainty_score":0.8667891},"labels":[],"label_agreement":null},{"id":"W3013573462","doi":"10.1515/jci-2021-0023","title":"A generalized double robust Bayesian model averaging approach to causal effect estimation with application to the study of osteoporotic fractures","year":2022,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institut National de Santé Publique du Québec; Université Laval; Centre hospitalier de l'Université Laval","funders":"Natural Sciences and Engineering Research Council of Canada; National Institute on Aging; National Institutes of Health","keywords":"Causal inference; Covariate; Estimator; Confounding; Bayesian probability; Estimation; Shrinkage estimator; Econometrics; Confidence interval; Statistics; Interval estimation; Computer science; Bayes estimator; Selection (genetic algorithm); Mathematics; Machine learning; Bias of an estimator; Engineering; Minimum-variance unbiased estimator","score_opus":0.07273394108806942,"score_gpt":0.382152650539416,"score_spread":0.3094187094513466,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3013573462","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00097148976,0.00016020925,0.99838877,0.00011230303,0.000017587128,0.000025488946,0.00002706095,0.00008749681,0.00020963686],"genre_scores_gemma":[0.08447049,0.0005584714,0.9132021,0.00018996096,0.0001263581,0.00030018162,0.00017214767,0.00009072038,0.0008895538],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9909644,0.0067490176,0.00033309826,0.0007938139,0.0010031366,0.00015640762],"domain_scores_gemma":[0.9761839,0.019117737,0.0010012626,0.0018267079,0.0016452848,0.00022519162],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016638672,0.000898247,0.0018620986,0.0020579502,0.0005951469,0.0012664486,0.00235859,0.0011738188,0.0032098028],"category_scores_gemma":[0.052320763,0.00066468574,0.0020033857,0.0022727025,0.001002948,0.0012981083,0.0021529796,0.0020888944,0.00038634616],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001961159,0.00011598999,0.0031722789,0.00046561976,0.0008464817,0.00039364528,0.00029047058,0.41028744,0.0023543728,0.27150086,0.0038122733,0.30656442],"study_design_scores_gemma":[0.000054067896,0.00008618933,0.0006276638,0.000044341254,0.000100592224,0.00011367361,0.000023732488,0.85303086,0.00068092125,0.14161766,0.003588069,0.000032313477],"about_ca_topic_score_codex":0.0067061055,"about_ca_topic_score_gemma":0.0070815166,"teacher_disagreement_score":0.016638672,"about_ca_system_score_codex":0.00078672153,"about_ca_system_score_gemma":0.0022763752,"threshold_uncertainty_score":0.087994754},"labels":[],"label_agreement":null},{"id":"W3016292706","doi":"10.1038/s41598-020-63465-y","title":"Determining organ weight toxicity with Bayesian causal models: Improving on the analysis of relative organ weights","year":2020,"lang":"en","type":"article","venue":"Scientific Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":131,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Prioris.ai (Canada)","funders":"","keywords":"Analysis of covariance; Bayesian probability; Covariance; Computer science; Chemical toxicity; Organ system; Interpretation (philosophy); Body weight; Approximate Bayesian computation; Statistics; Toxicity; Medicine; Mathematics; Machine learning; Artificial intelligence; Internal medicine","score_opus":0.08902112929955784,"score_gpt":0.31892822014240263,"score_spread":0.22990709084284477,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3016292706","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019261308,0.00041316595,0.9962896,0.00033804326,0.000037775953,0.000047267833,0.00011434329,0.00014085404,0.00069283956],"genre_scores_gemma":[0.19725344,0.0030511527,0.7934838,0.00072454335,0.00057744206,0.0005910019,0.0010553007,0.00035817726,0.0029051565],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9878462,0.007833928,0.0005969952,0.0016350518,0.0017984713,0.00028934953],"domain_scores_gemma":[0.9098456,0.07835373,0.00466103,0.003560754,0.0030165564,0.00056231086],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024748974,0.0022881865,0.0027971766,0.0048180334,0.0010005339,0.0033690182,0.0030539974,0.0022582167,0.00627453],"category_scores_gemma":[0.09179203,0.001330932,0.0043685604,0.0031785527,0.002342137,0.004863151,0.003233523,0.004874728,0.0009943916],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022927563,0.00020013994,0.0086389,0.0009166461,0.0009852665,0.00042420404,0.00034356874,0.5593573,0.0016119767,0.25758973,0.0031308453,0.16657212],"study_design_scores_gemma":[0.00004936,0.00008614868,0.0010782917,0.00015874692,0.00021699126,0.00014628762,0.00004280748,0.59288865,0.00058374566,0.40066224,0.004031825,0.00005483563],"about_ca_topic_score_codex":0.009353631,"about_ca_topic_score_gemma":0.009927964,"teacher_disagreement_score":0.024748974,"about_ca_system_score_codex":0.001731186,"about_ca_system_score_gemma":0.0038492428,"threshold_uncertainty_score":0.13088661},"labels":[],"label_agreement":null},{"id":"W3016548487","doi":"10.22237/jmasm/1556669280","title":"Investigating the Performance of Propensity Score Approaches for Differential Item Functioning Analysis","year":2020,"lang":"en","type":"article","venue":"Journal of Modern Applied Statistical Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Covariate; Propensity score matching; Differential item functioning; Statistics; Mathematics; Type I and type II errors; Mean squared error; Econometrics; Missing data; Item response theory; Psychometrics","score_opus":0.46701448305474397,"score_gpt":0.44107681053009584,"score_spread":0.025937672524648125,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3016548487","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21279784,0.0014697813,0.77957064,0.0012273954,0.00012802311,0.0013376775,0.00027945192,0.00032193755,0.0028673506],"genre_scores_gemma":[0.67140627,0.0005284434,0.32562512,0.00031149748,0.000043506865,0.0011420834,0.00027617422,0.000076202705,0.0005906974],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8534315,0.13324118,0.0025012414,0.0038313835,0.0059768106,0.0010178816],"domain_scores_gemma":[0.48520896,0.47330216,0.011187445,0.022133283,0.006926746,0.0012413827],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23415096,0.0014565596,0.0017047769,0.003595474,0.00092551584,0.0022419558,0.0022585897,0.001984231,0.002748538],"category_scores_gemma":[0.41793236,0.0006573328,0.002953934,0.0036988633,0.0022601064,0.003892315,0.005257068,0.0033945197,0.00033957913],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007263169,0.001262763,0.10866916,0.0014043692,0.0074707684,0.00038802528,0.0036355124,0.4002149,0.0018383294,0.19680518,0.002509299,0.2685385],"study_design_scores_gemma":[0.0010720548,0.0024264294,0.017047036,0.00032947236,0.0008420785,0.00036660986,0.0005632835,0.87146616,0.0016980815,0.10189393,0.0021589664,0.0001358278],"about_ca_topic_score_codex":0.0034699088,"about_ca_topic_score_gemma":0.002436494,"teacher_disagreement_score":0.76584905,"about_ca_system_score_codex":0.0017162192,"about_ca_system_score_gemma":0.003993518,"threshold_uncertainty_score":0.9444282},"labels":[],"label_agreement":null},{"id":"W3018281085","doi":"10.1111/biom.13285","title":"Weighted regression analysis to correct for informative monitoring times and confounders in longitudinal studies","year":2020,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Confounding; Inverse probability; Outcome (game theory); Statistics; Context (archaeology); Observational study; Marginal structural model; Econometrics; Ordinary least squares; Generalized linear model; Computer science; Mathematics; Bayesian probability","score_opus":0.4591560821512847,"score_gpt":0.5072392278805445,"score_spread":0.04808314572925987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3018281085","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00480937,0.00049746555,0.99414885,0.00014427827,0.0000333962,0.00004022696,0.00005705312,0.0001234679,0.0001459723],"genre_scores_gemma":[0.16872646,0.0011663125,0.8269398,0.00026376432,0.00018624925,0.00066785497,0.00036716368,0.0001696587,0.0015126385],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96405315,0.030369245,0.0010270892,0.002343925,0.0018710714,0.00033556367],"domain_scores_gemma":[0.87859124,0.100677356,0.0072873617,0.0102305785,0.0028120533,0.00040149904],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.053771093,0.0014369156,0.0020364192,0.0028398482,0.0006594741,0.0014921004,0.0040771156,0.0018832136,0.0022110739],"category_scores_gemma":[0.20178159,0.0009855457,0.0022995973,0.0043312614,0.0014149117,0.0029270619,0.0026358988,0.003221063,0.00043814207],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005339415,0.00029799147,0.035337757,0.0009630453,0.0042023314,0.0004925523,0.0010042717,0.20926648,0.0030207383,0.2846963,0.0029028652,0.4572817],"study_design_scores_gemma":[0.0001991676,0.00035876982,0.0068852417,0.00026438668,0.00078882487,0.00025093462,0.00010414325,0.7043119,0.002270215,0.276349,0.00813081,0.00008668431],"about_ca_topic_score_codex":0.004034955,"about_ca_topic_score_gemma":0.0033636156,"teacher_disagreement_score":0.053771093,"about_ca_system_score_codex":0.0009046329,"about_ca_system_score_gemma":0.0021940959,"threshold_uncertainty_score":0.28437215},"labels":[],"label_agreement":null},{"id":"W301845562","doi":"10.1007/978-0-387-71393-9_13","title":"Missing Data in Longitudinal Studies","year":2007,"lang":"en","type":"book-chapter","venue":"Springer series in statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Longitudinal data; Missing data; Computer science; Data mining; Machine learning","score_opus":0.5009964620410728,"score_gpt":0.499865245040885,"score_spread":0.0011312170001878674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W301845562","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013683066,0.14814304,0.80301064,0.011191851,0.0034697661,0.00006173646,0.0009007363,0.0006279532,0.031226087],"genre_scores_gemma":[0.10844883,0.265529,0.44557628,0.0077666687,0.014940062,0.00082680554,0.0027396076,0.0013532448,0.15281951],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9979352,0.0012858273,0.0001202092,0.0002127144,0.00040801222,0.000038090588],"domain_scores_gemma":[0.97722,0.020442894,0.0004073027,0.0012365917,0.0005874373,0.00010582673],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0063249976,0.0009781012,0.001849865,0.0021353564,0.00044227517,0.0017763628,0.0015969237,0.001708087,0.016514564],"category_scores_gemma":[0.023561701,0.0011812779,0.0006727746,0.0035821488,0.0015067525,0.0039504957,0.001124991,0.0035444598,0.0044282265],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018892017,0.000040758805,0.000633072,0.0009962813,0.00011045273,0.00013523482,0.00037026734,0.0029270162,0.00015822666,0.59699917,0.11562641,0.2819842],"study_design_scores_gemma":[0.0000075377216,0.000012995652,0.0004906059,0.0003807555,0.00004500376,0.00019980673,0.00006105004,0.0051520467,0.00012219742,0.9071517,0.08635996,0.000016325184],"about_ca_topic_score_codex":0.0005852565,"about_ca_topic_score_gemma":0.001028962,"teacher_disagreement_score":0.016514564,"about_ca_system_score_codex":0.0005486931,"about_ca_system_score_gemma":0.0010830201,"threshold_uncertainty_score":0.05524671},"labels":[],"label_agreement":null},{"id":"W3019567365","doi":"10.1002/sim.8541","title":"Doubly robust estimation and causal inference for recurrent event data","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Semiparametric regression; Causal inference; Computer science; Statistics; Semiparametric model; Inference; Event (particle physics); Econometrics; Estimating equations; Mathematics; Artificial intelligence","score_opus":0.32461444492443875,"score_gpt":0.5000145513770762,"score_spread":0.17540010645263743,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3019567365","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0055185095,0.0003593078,0.9930733,0.00017977378,0.000026856056,0.000034055596,0.00025234764,0.00016133915,0.00039457987],"genre_scores_gemma":[0.44559282,0.0014461385,0.54724854,0.00035166257,0.00025921047,0.00054547505,0.0019374941,0.00015054809,0.002468114],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9895377,0.0073270244,0.0005015093,0.0013461123,0.0010856807,0.00020196923],"domain_scores_gemma":[0.9445382,0.04245719,0.004831881,0.0062550805,0.0016678917,0.00024970795],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021237196,0.0007002605,0.0017644025,0.0026544502,0.00045925667,0.0014763345,0.0030860456,0.0015169046,0.003246229],"category_scores_gemma":[0.096683435,0.0005269766,0.0016841159,0.002407922,0.0013344809,0.0019852426,0.0017529624,0.0022175235,0.0005486113],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025646598,0.00019563649,0.022549061,0.00054055615,0.0011260669,0.00037597236,0.00044897507,0.18346137,0.001732697,0.51652527,0.0036919971,0.269096],"study_design_scores_gemma":[0.00006617786,0.00012905312,0.004972631,0.00011334408,0.00022286412,0.00024045337,0.00006995918,0.6511586,0.001770808,0.3353276,0.005859147,0.00006945706],"about_ca_topic_score_codex":0.002758307,"about_ca_topic_score_gemma":0.0018829824,"teacher_disagreement_score":0.021237196,"about_ca_system_score_codex":0.0007351401,"about_ca_system_score_gemma":0.0010632293,"threshold_uncertainty_score":0.11231434},"labels":[],"label_agreement":null},{"id":"W3021067680","doi":"10.1136/injuryprev-2020-savir.37","title":"107 Can synthetic controls improve causal inference in interrupted time series evaluations of public health interventions?","year":2020,"lang":"en","type":"article","venue":"Oral Presentations","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital","funders":"","keywords":"Causal inference; Psychological intervention; Interrupted time series; Observational study; Computer science; Inference; Interrupted Time Series Analysis; Confounding; Risk analysis (engineering); Control (management); Time series; Poison control; Rigour; Management science; Engineering; Machine learning; Econometrics; Artificial intelligence; Psychology; Medicine; Environmental health; Mathematics","score_opus":0.3480507879678849,"score_gpt":0.5051622501842452,"score_spread":0.1571114622163603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3021067680","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027415136,0.0061562373,0.9228002,0.015663486,0.0035854573,0.009996797,0.0021069476,0.0007806658,0.011495088],"genre_scores_gemma":[0.4541592,0.0018673949,0.50146145,0.007115637,0.0013667704,0.030890927,0.001306657,0.00022275164,0.0016091488],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.40059254,0.56311655,0.014831743,0.009871237,0.010439107,0.0011488363],"domain_scores_gemma":[0.19082823,0.7091827,0.03483493,0.0521379,0.012039162,0.0009770395],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.44815612,0.0020824326,0.003144145,0.0025930947,0.0019759012,0.0063219503,0.004177532,0.0050771385,0.017458804],"category_scores_gemma":[0.7487587,0.0015508293,0.0069162627,0.0035076113,0.0077807023,0.0069613922,0.0049048234,0.005076493,0.0016655695],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009525068,0.0009001922,0.0360866,0.017639015,0.010039028,0.00052909524,0.0065427483,0.050872784,0.0010589957,0.5222601,0.022176722,0.32236964],"study_design_scores_gemma":[0.006718711,0.0072166985,0.021540612,0.013605228,0.0052098315,0.0003907478,0.0016671739,0.17803515,0.0035237318,0.69023246,0.07136916,0.0004905375],"about_ca_topic_score_codex":0.0034021307,"about_ca_topic_score_gemma":0.0026803634,"teacher_disagreement_score":0.5518439,"about_ca_system_score_codex":0.004264525,"about_ca_system_score_gemma":0.007419757,"threshold_uncertainty_score":0.6805218},"labels":[],"label_agreement":null},{"id":"W3021470514","doi":"10.1002/jrsm.1511","title":"Methods for population adjustment with limited access to individual patient data: A review and simulation study","year":2021,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Engineering and Physical Sciences Research Council; Canadian Institutes of Health Research; Institute of Conservation","keywords":"Covariate; Estimator; Standard error; Sample size determination; Measure (data warehouse); Variance (accounting); Population; Standard deviation; Confidence interval","score_opus":0.7644489907710884,"score_gpt":0.7005175490144144,"score_spread":0.06393144175667398,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3021470514","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011981152,0.90994954,0.07830948,0.0031336227,0.0008617418,0.0014764274,0.0009378754,0.00025118375,0.003882049],"genre_scores_gemma":[0.031706844,0.8498082,0.10808992,0.0019631966,0.00067643204,0.0053332425,0.0009252442,0.00014749286,0.0013494944],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9797896,0.015475857,0.0017958388,0.0006215641,0.0021537142,0.00016342763],"domain_scores_gemma":[0.8996425,0.08931813,0.004231153,0.002119373,0.004396641,0.00029214035],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0335491,0.0013806381,0.0036198706,0.0071206633,0.00037782136,0.0018337494,0.002438154,0.0017871726,0.011796628],"category_scores_gemma":[0.12204997,0.00069200364,0.00935422,0.008465924,0.0006625841,0.00241247,0.0011085062,0.0021194878,0.0012408674],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046302628,0.00011678268,0.0019375738,0.14963698,0.008424442,0.00022141747,0.00021762932,0.017320873,0.00012368563,0.028535783,0.029553434,0.7634484],"study_design_scores_gemma":[0.0014424443,0.0010364132,0.008777523,0.28335527,0.034128703,0.002260186,0.00038903396,0.04898312,0.00066572113,0.116288744,0.5022785,0.00039436712],"about_ca_topic_score_codex":0.0060287626,"about_ca_topic_score_gemma":0.006660673,"teacher_disagreement_score":0.9664509,"about_ca_system_score_codex":0.003150265,"about_ca_system_score_gemma":0.007046172,"threshold_uncertainty_score":0.1774267},"labels":[],"label_agreement":null},{"id":"W3022994372","doi":"10.1002/jrsm.1416","title":"Equivalence of entropy balancing and the method of moments for matching‐adjusted indirect comparison","year":2020,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada; Department of Health and Social Care; University of Bristol; National Institute for Health and Care Research; University Hospitals Bristol NHS Foundation Trust; AstraZeneca","keywords":"Covariate; Statistics; Population; Mathematics; Entropy (arrow of time); Nonparametric statistics; Standard error; Econometrics; Computer science","score_opus":0.5557337790460275,"score_gpt":0.6078522747330801,"score_spread":0.052118495687052624,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3022994372","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039127674,0.0013446971,0.987743,0.0010790457,0.0003032318,0.00044025813,0.00022245757,0.00012010945,0.004834435],"genre_scores_gemma":[0.24938837,0.003165112,0.73420304,0.0016885684,0.0016262733,0.0047773584,0.00047397803,0.00038912776,0.0042881854],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9090299,0.077063575,0.0024975133,0.0035280925,0.0070545203,0.0008264084],"domain_scores_gemma":[0.8268272,0.14995423,0.0075112893,0.01151127,0.0035730517,0.00062287995],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.082194895,0.0016896679,0.0030685677,0.004549836,0.0009779806,0.0028880194,0.0026390825,0.0025166566,0.0124777015],"category_scores_gemma":[0.26114982,0.00084733526,0.003137837,0.003281693,0.0054381895,0.005411877,0.004517635,0.0041313656,0.0010446043],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042051633,0.000057452333,0.00088250905,0.0008350441,0.00052774674,0.000073792915,0.00039584973,0.016402705,0.00044506622,0.84310347,0.0018986069,0.13495727],"study_design_scores_gemma":[0.00026913974,0.00030174377,0.0014166338,0.00037320555,0.0002392893,0.00011404357,0.00006189777,0.057140216,0.0009988741,0.93003005,0.008984712,0.000070119764],"about_ca_topic_score_codex":0.0011666473,"about_ca_topic_score_gemma":0.00073481933,"teacher_disagreement_score":0.9178051,"about_ca_system_score_codex":0.003434164,"about_ca_system_score_gemma":0.0037942412,"threshold_uncertainty_score":0.43469334},"labels":[],"label_agreement":null},{"id":"W3023009578","doi":"10.1002/9781118445112.stat05236","title":"Drug Utilization Patterns","year":2014,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Nonparametric statistics; Data collection; Drug; Data science; Computer science; Medicine; Econometrics; Pharmacology; Statistics; Economics; Mathematics","score_opus":0.19819524501425995,"score_gpt":0.4350969791750898,"score_spread":0.23690173416082988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3023009578","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27719912,0.30553666,0.084093094,0.030884005,0.0015474741,0.0010022015,0.13501768,0.0007811561,0.16393857],"genre_scores_gemma":[0.7390926,0.18418369,0.024143938,0.0034635707,0.0009410425,0.00057941285,0.03348569,0.0002160469,0.013894011],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9970469,0.0009581918,0.0005651795,0.0005352148,0.0007799031,0.00011462658],"domain_scores_gemma":[0.9940672,0.002270438,0.0019290764,0.0005205852,0.0010594648,0.00015325245],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002076804,0.00022238774,0.00040811332,0.0043306425,0.00018177844,0.0011845101,0.0006501253,0.0003827428,0.0063809454],"category_scores_gemma":[0.014001085,0.00014548267,0.0006509881,0.0072091464,0.00023946208,0.00088694127,0.0007234976,0.0005985481,0.0011720257],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001359108,0.00009308287,0.23404741,0.0032157628,0.0007457471,0.0001618529,0.0005980046,0.0020971878,0.00033219755,0.03349466,0.042357743,0.6827205],"study_design_scores_gemma":[0.000032340857,0.00010803464,0.72679496,0.0062037418,0.00038044664,0.0016094222,0.0012671598,0.005414412,0.0009822113,0.03142022,0.22570881,0.000078192774],"about_ca_topic_score_codex":0.009036725,"about_ca_topic_score_gemma":0.0077197864,"teacher_disagreement_score":0.009036725,"about_ca_system_score_codex":0.00082472374,"about_ca_system_score_gemma":0.00089139974,"threshold_uncertainty_score":0.02134639},"labels":[],"label_agreement":null},{"id":"W3023265660","doi":"10.1016/j.jeconom.2006.07.021","title":"A structural analysis of the correlated random coefficient wage regression model","year":2006,"lang":"en","type":"article","venue":"Journal of Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Concordia University; Center for Interuniversity Research and Analysis on Organizations","funders":"Koç Üniversitesi","keywords":"Econometrics; Mathematics; Monotonic function; Regression; Wage; Regression analysis; Statistics; Function (biology); Economics","score_opus":0.21169313368412038,"score_gpt":0.3561619053662627,"score_spread":0.1444687716821423,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3023265660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038058527,0.00043935963,0.9515051,0.0019460922,0.00009245973,0.00006627388,0.00038074248,0.00023331634,0.007278003],"genre_scores_gemma":[0.8256743,0.0021090703,0.14158748,0.00060129224,0.00061323383,0.00031708274,0.0012341281,0.00031807704,0.02754541],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9973115,0.001477754,0.000079765196,0.00045655077,0.00040512823,0.00026926943],"domain_scores_gemma":[0.979362,0.014937972,0.0020276762,0.0019152449,0.0013620798,0.00039493904],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005023719,0.00079533376,0.0020239344,0.001863951,0.00082044705,0.0017838037,0.0028924828,0.001977504,0.01297352],"category_scores_gemma":[0.030002868,0.0012748041,0.002038011,0.00247397,0.0018816817,0.0030237339,0.001789734,0.0033821112,0.0015550316],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000037094604,0.000070624774,0.0013584082,0.00005726442,0.00008662301,0.0001408152,0.0001750756,0.08860039,0.0003519438,0.89662576,0.0021305187,0.01036552],"study_design_scores_gemma":[0.000038017683,0.000029770097,0.00079498027,0.000024177056,0.00006212377,0.000076621225,0.000041573145,0.5758962,0.00012936845,0.42124847,0.0016292271,0.000029483936],"about_ca_topic_score_codex":0.0069532683,"about_ca_topic_score_gemma":0.0068009873,"teacher_disagreement_score":0.01297352,"about_ca_system_score_codex":0.0013117503,"about_ca_system_score_gemma":0.0025438028,"threshold_uncertainty_score":0.043400764},"labels":[],"label_agreement":null},{"id":"W3024135636","doi":"10.1007/s10742-023-00301-6","title":"Hierarchical causal variance decomposition for institution and provider comparisons in healthcare","year":2023,"lang":"en","type":"article","venue":"Health Services and Outcomes Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University Health Network; University of Toronto; Public Health Ontario","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Ontario Institute for Cancer Research","keywords":"Multinomial logistic regression; Multilevel model; Context (archaeology); Variance (accounting); Health administration; Health care; Variation (astronomy); Logistic regression; Medicine; Quality (philosophy); Statistics; Public health; Nursing; Mathematics; Geography","score_opus":0.6102249160260278,"score_gpt":0.6500267204155956,"score_spread":0.03980180438956782,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3024135636","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00925721,0.0002835448,0.9887212,0.00025594723,0.00006278331,0.00017289228,0.00024731734,0.00014726407,0.0008518769],"genre_scores_gemma":[0.3161379,0.00041862624,0.67768717,0.00023619992,0.000203144,0.0019124504,0.000936211,0.00019013707,0.0022782325],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.932596,0.057314295,0.0016014492,0.0040379306,0.0032018083,0.0012484279],"domain_scores_gemma":[0.7002099,0.27457324,0.0048056976,0.015557511,0.003570668,0.0012829733],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05905682,0.0014591333,0.0031970355,0.0047610844,0.0023044376,0.0035857994,0.003385601,0.0018089156,0.012094453],"category_scores_gemma":[0.19106984,0.0013412227,0.0051770406,0.006524641,0.0034348264,0.0043905247,0.003955405,0.0043364116,0.000775455],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027075634,0.00041020653,0.0118008815,0.00039810906,0.0014234483,0.00018383085,0.001313153,0.027568864,0.00041156507,0.82681787,0.0034665323,0.12593484],"study_design_scores_gemma":[0.000082506136,0.00012695848,0.0042840564,0.00011850885,0.00029959742,0.00007394603,0.00039294656,0.20462368,0.000306751,0.78766596,0.0019797592,0.000045217046],"about_ca_topic_score_codex":0.011634359,"about_ca_topic_score_gemma":0.011410828,"teacher_disagreement_score":0.05905682,"about_ca_system_score_codex":0.002509708,"about_ca_system_score_gemma":0.00748815,"threshold_uncertainty_score":0.312326},"labels":[],"label_agreement":null},{"id":"W3024190863","doi":"10.1177/1740774520920893","title":"Adjusting for adherence in randomized trials when adherence is measured as a continuous variable: An application to the Lipid Research Clinics Coronary Primary Prevention Trial","year":2020,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre; Western University","funders":"Patient-Centered Outcomes Research Institute","keywords":"Medicine; Randomized controlled trial; Primary prevention; Research design; Clinical trial; Secondary prevention; Coronary heart disease; Physical therapy; Internal medicine; Statistics; Disease; Mathematics","score_opus":0.8094234507609317,"score_gpt":0.642819391213717,"score_spread":0.1666040595472147,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3024190863","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0528411,0.036499795,0.84385693,0.031270213,0.004313529,0.022356378,0.001437194,0.0014048971,0.006020024],"genre_scores_gemma":[0.34531438,0.005989876,0.597528,0.008768233,0.0013860033,0.0384245,0.00066993316,0.00029190918,0.0016272136],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.26984283,0.7009823,0.01251473,0.005898247,0.009795833,0.00096611306],"domain_scores_gemma":[0.2721089,0.67334324,0.02341526,0.022211757,0.00747638,0.0014444252],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.48851565,0.0026795338,0.0075179525,0.002786687,0.0017559764,0.0048796856,0.004174375,0.008423493,0.0069770543],"category_scores_gemma":[0.66982293,0.0015798,0.014937547,0.006186133,0.0038029402,0.005116879,0.0044541424,0.010584492,0.0006449949],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.061206277,0.001849199,0.036242723,0.028025717,0.1064922,0.0019058185,0.002900143,0.06791235,0.0011791426,0.12575062,0.028238745,0.53829706],"study_design_scores_gemma":[0.110576205,0.008859939,0.024037225,0.013006821,0.05148984,0.0013257985,0.00038800933,0.42701086,0.0019861595,0.33074328,0.029844452,0.0007313791],"about_ca_topic_score_codex":0.0031992076,"about_ca_topic_score_gemma":0.0027069154,"teacher_disagreement_score":0.48851565,"about_ca_system_score_codex":0.003007584,"about_ca_system_score_gemma":0.009234614,"threshold_uncertainty_score":0.63075125},"labels":[],"label_agreement":null},{"id":"W3025042862","doi":"10.2147/jmdh.s241085","title":"&lt;p&gt;Methods, Applications and Challenges in the Analysis of Interrupted Time Series Data: A Scoping Review&lt;/p&gt;","year":2020,"lang":"en","type":"article","venue":"Journal of Multidisciplinary Healthcare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":159,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; St. Michael's Hospital; University of Toronto; McMaster University; Children's Hospital of Eastern Ontario; Impact","funders":"","keywords":"CINAHL; MEDLINE; Interrupted time series; Descriptive statistics; Computer science; Data science; Research design; Systematic review; Medicine; Web of science; Health care; Psychological intervention; Meta-analysis; Data mining; Statistics; Mathematics; Pathology; Nursing","score_opus":0.40645321681616026,"score_gpt":0.5238091338564785,"score_spread":0.11735591704031828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3025042862","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014010436,0.8295798,0.08785343,0.035801128,0.0077514485,0.02233049,0.0021409183,0.0003767423,0.012764996],"genre_scores_gemma":[0.019343229,0.6392545,0.22909856,0.010124839,0.0037168355,0.09315122,0.0015541498,0.00044022145,0.0033164017],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.6742519,0.22239715,0.060346097,0.0070529296,0.03425581,0.0016960542],"domain_scores_gemma":[0.20255663,0.6998148,0.033739384,0.017430617,0.045403596,0.0010549633],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.31471983,0.0028237337,0.0081358645,0.022135591,0.004061391,0.016085055,0.005798916,0.010376571,0.010744191],"category_scores_gemma":[0.60680676,0.0035657317,0.009178408,0.04023115,0.008414883,0.015666708,0.0072480263,0.009134342,0.004203106],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024782622,0.00009438177,0.001565814,0.4678221,0.0018602508,0.00040060893,0.0048474376,0.000937505,0.00057004316,0.03858864,0.05293847,0.43012682],"study_design_scores_gemma":[0.00022900633,0.00020440145,0.0023877725,0.7588583,0.0027540433,0.00049671234,0.0019594685,0.0017288112,0.00073281815,0.034036484,0.19645278,0.00015941224],"about_ca_topic_score_codex":0.005813584,"about_ca_topic_score_gemma":0.009962788,"teacher_disagreement_score":0.31471983,"about_ca_system_score_codex":0.011287409,"about_ca_system_score_gemma":0.039576054,"threshold_uncertainty_score":0.84507245},"labels":[],"label_agreement":null},{"id":"W3025280704","doi":"10.1257/pandp.20201078","title":"A Proposed Specification Check for <i>p</i>-Hacking","year":2020,"lang":"en","type":"article","venue":"AEA Papers and Proceedings","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Hacker; Computer science; Specification; Set (abstract data type); Control (management); Programming language; Computer security; Artificial intelligence; Machine learning","score_opus":0.22378057856440436,"score_gpt":0.3763875279604566,"score_spread":0.15260694939605224,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3025280704","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026855597,0.00038920811,0.9380248,0.0099297725,0.0008366852,0.0029115293,0.0075302813,0.0036144007,0.009907776],"genre_scores_gemma":[0.34965274,0.00030090805,0.6198369,0.0077100922,0.00082822045,0.012397764,0.0057949354,0.0009840484,0.0024943836],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8178054,0.103356026,0.02619505,0.022888359,0.0254805,0.004274634],"domain_scores_gemma":[0.17117871,0.71907365,0.03559717,0.04240079,0.02986556,0.0018842422],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19255225,0.0018057887,0.0031592487,0.0062629334,0.0028315426,0.0070109223,0.0070239473,0.006592054,0.026387706],"category_scores_gemma":[0.63394034,0.0017805973,0.0058431593,0.009062938,0.006993065,0.008782483,0.0062184893,0.00703225,0.004353339],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014250515,0.0006281155,0.14179975,0.0036556192,0.0017168644,0.0022425267,0.0050845277,0.01547773,0.0038043961,0.5750694,0.06372049,0.1853755],"study_design_scores_gemma":[0.00306307,0.0018153549,0.04065619,0.0032137458,0.0019628096,0.003033734,0.0033715502,0.11125692,0.018585956,0.7167736,0.09550375,0.0007632725],"about_ca_topic_score_codex":0.0049853316,"about_ca_topic_score_gemma":0.0022273837,"teacher_disagreement_score":0.80744773,"about_ca_system_score_codex":0.002467497,"about_ca_system_score_gemma":0.013071314,"threshold_uncertainty_score":0.9957268},"labels":[],"label_agreement":null},{"id":"W3027809961","doi":"10.1002/bimj.201900277","title":"Propensity score methods for time‐dependent cluster confounding","year":2020,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Work & Health; Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"","keywords":"Propensity score matching; Covariate; Confounding; Matching (statistics); Observational study; Cluster (spacecraft); Statistics; Computer science; Outcome (game theory); Econometrics; Mathematics","score_opus":0.5549064887138153,"score_gpt":0.5202090427054289,"score_spread":0.03469744600838642,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3027809961","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00067758915,0.0002664024,0.9978885,0.00020365424,0.000053426505,0.00017591994,0.00008383195,0.00014598134,0.00050467346],"genre_scores_gemma":[0.06753864,0.0014516377,0.9238082,0.0004540454,0.00041195666,0.0019375458,0.00057029864,0.00022685152,0.0036008046],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97558844,0.019047135,0.000773758,0.0018196211,0.0024429807,0.00032803338],"domain_scores_gemma":[0.9458451,0.039776415,0.004026373,0.007341218,0.002544035,0.00046667832],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04070731,0.0016367806,0.0022691544,0.0039260425,0.0012273864,0.0024422249,0.0042244806,0.0023831031,0.011133347],"category_scores_gemma":[0.09234229,0.0008743202,0.0029560681,0.005629115,0.0024888322,0.0042595775,0.004350709,0.0052522225,0.0017600633],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018479816,0.00014290394,0.0048959237,0.00047552405,0.00084546633,0.00014610765,0.00048335805,0.059939682,0.00037998444,0.7290125,0.008161434,0.19533235],"study_design_scores_gemma":[0.00021954581,0.00014964043,0.0023195038,0.00020924487,0.00017445789,0.00019345529,0.000109423956,0.24190535,0.00045869517,0.7311306,0.023053806,0.00007617751],"about_ca_topic_score_codex":0.003987003,"about_ca_topic_score_gemma":0.0034977733,"teacher_disagreement_score":0.04070731,"about_ca_system_score_codex":0.0016433399,"about_ca_system_score_gemma":0.004584182,"threshold_uncertainty_score":0.2152834},"labels":[],"label_agreement":null},{"id":"W3028305733","doi":"10.1016/j.patter.2020.100008","title":"gfoRmula: An R Package for Estimating the Effects of Sustained Treatment Strategies via the Parametric g-formula","year":2020,"lang":"en","type":"article","venue":"Patterns","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":90,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Mental Health; National Institute of Allergy and Infectious Diseases; U.S. National Library of Medicine; Fonds de recherche du Québec – Nature et technologies; National Institutes of Health; National Science Foundation","keywords":"R package; Package design; Parametric statistics; Mathematics; Computer science; Econometrics; Statistics; Engineering; Manufacturing engineering","score_opus":0.1078923772644685,"score_gpt":0.398412433487412,"score_spread":0.2905200562229435,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3028305733","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012274667,0.00064866693,0.89784896,0.0009430589,0.00023367177,0.0004465079,0.03070042,0.063790955,0.004160247],"genre_scores_gemma":[0.023400465,0.0010336306,0.8998441,0.0011804149,0.00026735893,0.0042699445,0.017698217,0.046147995,0.006157806],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9942503,0.0034027146,0.00046820132,0.00063695817,0.0010687851,0.00017313345],"domain_scores_gemma":[0.9387531,0.05230632,0.0027437052,0.0039035312,0.0019891006,0.00030425692],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0105386535,0.0023241076,0.0018532781,0.0027442349,0.00041282448,0.0017727467,0.0030622096,0.0014728177,0.09430412],"category_scores_gemma":[0.097898684,0.001479039,0.0030994331,0.002438733,0.0010480962,0.0024201802,0.0024545803,0.0037950252,0.034086004],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004498624,0.000120153076,0.006042552,0.0035360246,0.0012744891,0.00045537058,0.00039380902,0.02460881,0.0013944204,0.061397403,0.5891055,0.31122166],"study_design_scores_gemma":[0.0008952692,0.00025987436,0.005781712,0.0011292843,0.0006400583,0.0009762242,0.00008822853,0.12134607,0.004183171,0.277602,0.5868602,0.0002379868],"about_ca_topic_score_codex":0.003326482,"about_ca_topic_score_gemma":0.004505789,"teacher_disagreement_score":0.09430412,"about_ca_system_score_codex":0.00082015636,"about_ca_system_score_gemma":0.003599643,"threshold_uncertainty_score":0.31547868},"labels":[],"label_agreement":null},{"id":"W3029886377","doi":"10.1111/sjos.12471","title":"Failure time studies with intermittent observation and losses to follow‐up","year":2020,"lang":"en","type":"article","venue":"Scandinavian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Parametric statistics; Nonparametric statistics; Econometrics; Mathematics; Sample size determination; Statistics; Parametric model; Joint (building); Engineering","score_opus":0.18056090870356195,"score_gpt":0.39020543207076624,"score_spread":0.2096445233672043,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3029886377","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33385378,0.0019901092,0.6594635,0.0012621533,0.00018360316,0.0003241977,0.000688377,0.00020365254,0.0020307004],"genre_scores_gemma":[0.97131854,0.0005096742,0.024130033,0.0001410778,0.000083905135,0.0004961366,0.00034287988,0.00003825397,0.0029394953],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9866403,0.009262816,0.0005867535,0.0015972767,0.001197049,0.0007157517],"domain_scores_gemma":[0.74724203,0.21211825,0.02028032,0.014562454,0.0041744397,0.0016223859],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06590474,0.0009667045,0.0019024606,0.002036828,0.001189033,0.002666479,0.004282631,0.0028961268,0.00550614],"category_scores_gemma":[0.15121478,0.000730052,0.002878897,0.002461186,0.003416146,0.0029852209,0.002912429,0.0037251187,0.00043308435],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022856663,0.0006137902,0.17830768,0.00084304094,0.0018440348,0.0015422894,0.003211908,0.48574632,0.0015766894,0.24903323,0.0025153747,0.0724799],"study_design_scores_gemma":[0.00016858416,0.0010299156,0.028737279,0.0002810316,0.00065444765,0.00041947005,0.00071585015,0.8068341,0.0010741189,0.15700366,0.0029585308,0.00012301974],"about_ca_topic_score_codex":0.0072824694,"about_ca_topic_score_gemma":0.0028561552,"teacher_disagreement_score":0.06590474,"about_ca_system_score_codex":0.0013674462,"about_ca_system_score_gemma":0.001730452,"threshold_uncertainty_score":0.34854174},"labels":[],"label_agreement":null},{"id":"W3033114400","doi":"10.1214/22-sts879","title":"The Role of Exchangeability in Causal Inference","year":2023,"lang":"en","type":"article","venue":"Statistical Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of Toronto","funders":"","keywords":"Causal inference; Inference; Property (philosophy); Contrast (vision); Bayesian probability; Predictive inference; Bayesian inference; Econometrics; Causal model; Frequentist inference; Computer science; Causal structure; Statistical inference; Mathematics; Artificial intelligence; Epistemology; Statistics; Philosophy","score_opus":0.12924522197799054,"score_gpt":0.4691296344740189,"score_spread":0.33988441249602835,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3033114400","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010822509,0.000929812,0.9760573,0.0035499467,0.00013082953,0.00012491082,0.00017535633,0.00007781723,0.008131595],"genre_scores_gemma":[0.70885116,0.0018311363,0.28076908,0.0020480177,0.0011048269,0.00088621216,0.00035580827,0.00018871765,0.003964949],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.928901,0.051710088,0.0033949327,0.008322223,0.0062374044,0.0014342649],"domain_scores_gemma":[0.6418846,0.3125967,0.015576181,0.024005793,0.004461589,0.001475027],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09960356,0.0012498975,0.0028726317,0.0032302712,0.0026924093,0.0057974095,0.00438309,0.003948933,0.00885619],"category_scores_gemma":[0.25620452,0.0013968977,0.0039504357,0.0035925116,0.020971078,0.025595041,0.008395898,0.010384178,0.0006872028],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003206854,0.000015954896,0.00085035915,0.00006459915,0.00007338153,0.00010914439,0.0003022274,0.0021824227,0.00010003348,0.9900725,0.0001690634,0.0060282247],"study_design_scores_gemma":[0.000013591988,0.000022419148,0.00024205109,0.000026815296,0.000020496003,0.00008054949,0.00003290179,0.0058141695,0.000103565384,0.99298084,0.0006511806,0.000011423683],"about_ca_topic_score_codex":0.001792166,"about_ca_topic_score_gemma":0.00093322445,"teacher_disagreement_score":0.09960356,"about_ca_system_score_codex":0.0025255915,"about_ca_system_score_gemma":0.0022346121,"threshold_uncertainty_score":0.5267603},"labels":[],"label_agreement":null},{"id":"W3034619260","doi":"10.1002/pds.5031","title":"Bias in case‐crossover studies of medications due to persistent use: A simulation study","year":2020,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; Brigham and Women's Hospital","keywords":"Medicine; Pharmacoepidemiology; Crossover; Crossover study; Intensive care medicine; Pharmacology; Alternative medicine; Medical prescription","score_opus":0.5388691683247122,"score_gpt":0.5460614077403486,"score_spread":0.007192239415636403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3034619260","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7698891,0.005338284,0.21236423,0.0014476206,0.00042145015,0.004640026,0.0016530375,0.0003225616,0.0039236527],"genre_scores_gemma":[0.9718613,0.00050039525,0.024685487,0.0003298608,0.000063377745,0.0014825211,0.00047130985,0.000021643003,0.0005840606],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8981384,0.091722935,0.0028996503,0.0039444906,0.0020813637,0.0012131355],"domain_scores_gemma":[0.4555394,0.4940119,0.024680316,0.018166138,0.006154444,0.0014477684],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1577518,0.0014627305,0.0025195275,0.0015111588,0.00080041116,0.002115972,0.002659067,0.0034625959,0.004674573],"category_scores_gemma":[0.260618,0.0010108536,0.0076999012,0.0013860473,0.0017345176,0.0019732446,0.001991683,0.002623977,0.00033000013],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.049553912,0.0033579702,0.23319583,0.0024351387,0.023905423,0.002214871,0.0016931357,0.59808546,0.0014361223,0.035458896,0.0035040241,0.04515918],"study_design_scores_gemma":[0.010178176,0.00862266,0.021592474,0.0007743735,0.007448338,0.0009045162,0.00038046922,0.91949713,0.0012141186,0.025967184,0.0031863481,0.00023426833],"about_ca_topic_score_codex":0.008311423,"about_ca_topic_score_gemma":0.0034277157,"teacher_disagreement_score":0.8422482,"about_ca_system_score_codex":0.0023615202,"about_ca_system_score_gemma":0.0021030668,"threshold_uncertainty_score":0.8342812},"labels":[],"label_agreement":null},{"id":"W3035052016","doi":"10.1016/j.ijrobp.2020.02.638","title":"Understanding Propensity Score Analyses","year":2020,"lang":"en","type":"article","venue":"International Journal of Radiation Oncology*Biology*Physics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":54,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Propensity score matching; Observational study; Confounding; Medicine; Statistics; Randomized controlled trial; Sample size determination; Internal medicine; Mathematics","score_opus":0.5087663686543212,"score_gpt":0.4766493267535492,"score_spread":0.032117041900772025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3035052016","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0075150966,0.0009984648,0.9757663,0.009831107,0.00012590027,0.000041871866,0.00020867007,0.00021907616,0.005293497],"genre_scores_gemma":[0.42436168,0.0032775248,0.55421686,0.0044830423,0.0014732934,0.000416258,0.0008670533,0.00035124284,0.010553034],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9871889,0.009249997,0.0005729449,0.0010807259,0.0016217824,0.00028560756],"domain_scores_gemma":[0.91517353,0.07409314,0.0025950419,0.0051258695,0.0024791008,0.0005331807],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.021794738,0.00082729803,0.001152712,0.0023136684,0.0010258176,0.004751205,0.0019083676,0.001993865,0.009400717],"category_scores_gemma":[0.113197275,0.0009194162,0.0015388429,0.0021455074,0.0029199992,0.007612938,0.0042304,0.0045501487,0.0011204627],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020901538,0.00003933657,0.002689186,0.00006665022,0.000083982464,0.000063514075,0.00029938173,0.0077641797,0.00013482229,0.9448998,0.00340093,0.040537294],"study_design_scores_gemma":[0.0000061616847,0.000005227788,0.00026441526,0.000020251999,0.000013625378,0.000024720208,0.000030594834,0.016463103,0.000058078283,0.980456,0.002652916,0.00000483722],"about_ca_topic_score_codex":0.002230908,"about_ca_topic_score_gemma":0.0016273971,"teacher_disagreement_score":0.97820526,"about_ca_system_score_codex":0.0012875538,"about_ca_system_score_gemma":0.0024328597,"threshold_uncertainty_score":0.115262985},"labels":[],"label_agreement":null},{"id":"W3037840142","doi":"10.1186/s12874-020-01050-7","title":"A conceptual framework for prognostic research","year":2020,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tech University; Public Health Ontario; University of Toronto; Canadian Memorial Chiropractic College","funders":"","keywords":"Computer science; Conceptual framework; Data science; MEDLINE; Medicine; Management science; Sociology; Political science","score_opus":0.9537009219251084,"score_gpt":0.7282200696729361,"score_spread":0.2254808522521723,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3037840142","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011188065,0.030184476,0.6023218,0.1888745,0.0020681357,0.0015215039,0.0014403819,0.0004491882,0.16195193],"genre_scores_gemma":[0.65313417,0.019350067,0.2890982,0.018432168,0.0034744916,0.0069871005,0.0011122403,0.00018040146,0.00823125],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9267724,0.059861913,0.0028753467,0.004057086,0.0047453404,0.001687892],"domain_scores_gemma":[0.84459364,0.12508655,0.009695834,0.005798452,0.0117566455,0.0030689153],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07809777,0.0019761417,0.0015606255,0.0106775565,0.005037552,0.012373367,0.005060923,0.005983191,0.011187206],"category_scores_gemma":[0.08805794,0.000880785,0.0021517465,0.011257323,0.038660746,0.028184844,0.008089042,0.006526935,0.0015508818],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000007943383,0.000009814326,0.00035700598,0.00013662741,0.000013485283,0.00002928648,0.0013332682,0.00028702218,0.000010097555,0.99275416,0.0012085381,0.0038528014],"study_design_scores_gemma":[0.000030240224,0.00003052336,0.00033881512,0.00051608717,0.000026288324,0.00009612761,0.0012759074,0.0015079086,0.00003477798,0.96931475,0.026809858,0.000018766163],"about_ca_topic_score_codex":0.004450741,"about_ca_topic_score_gemma":0.0017941283,"teacher_disagreement_score":0.92190224,"about_ca_system_score_codex":0.014338479,"about_ca_system_score_gemma":0.015399755,"threshold_uncertainty_score":0.41302544},"labels":[],"label_agreement":null},{"id":"W3039902043","doi":"10.1016/j.chest.2020.03.011","title":"Using Causal Diagrams to Improve the Design and Interpretation of Medical Research","year":2020,"lang":"en","type":"review","venue":"CHEST Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":142,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Cancer Research UK","keywords":"Causal inference; Observational study; Terminology; Medicine; Confounding; Interpretation (philosophy); Directed acyclic graph; Causal structure; Relation (database); Inference; Selection bias; Outcome (game theory); Computer science; Artificial intelligence; Data mining; Linguistics; Algorithm; Pathology; Mathematics","score_opus":0.6701582115990727,"score_gpt":0.5913517703700976,"score_spread":0.07880644122897518,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3039902043","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00022142174,0.92848825,0.06499591,0.0034041917,0.00063922437,0.00007519878,0.00016954115,0.00023143116,0.0017749174],"genre_scores_gemma":[0.009519423,0.9029548,0.08457581,0.0009237291,0.000921641,0.00016849702,0.00024877556,0.000058035414,0.0006292992],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98238766,0.012371814,0.0013071633,0.0010123879,0.0027680565,0.00015297502],"domain_scores_gemma":[0.8638571,0.12449118,0.0032086095,0.0039192354,0.004056378,0.00046745155],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.027443785,0.002192702,0.0035434545,0.011626378,0.000679642,0.003909693,0.0035183143,0.0032121972,0.0074811717],"category_scores_gemma":[0.07346326,0.0013901957,0.0030874999,0.009686693,0.0038696758,0.005524054,0.002378349,0.0065053576,0.0017290474],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000105140505,0.000071682705,0.00068089704,0.03944711,0.0016097178,0.00008709441,0.00024619617,0.006951972,0.00035292484,0.17793824,0.016175171,0.7563338],"study_design_scores_gemma":[0.00016075994,0.00011323006,0.0013942347,0.029312527,0.0019423084,0.0004976038,0.0001527684,0.007908895,0.0010305571,0.5939498,0.3633947,0.00014256293],"about_ca_topic_score_codex":0.0043229125,"about_ca_topic_score_gemma":0.005310807,"teacher_disagreement_score":0.97255623,"about_ca_system_score_codex":0.003473276,"about_ca_system_score_gemma":0.0067977537,"threshold_uncertainty_score":0.14513832},"labels":[],"label_agreement":null},{"id":"W3047016911","doi":"10.1257/aer.20190687","title":"Methods Matter: p-Hacking and Publication Bias in Causal Analysis in Economics","year":2020,"lang":"en","type":"article","venue":"American Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":333,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Credibility; Regression discontinuity design; Instrumental variable; Publication bias; Hacker; Causal inference; Omitted-variable bias; Economics; Identification (biology); Econometrics; Randomized experiment; Selection bias; Psychology; Statistics; Political science; Computer science; Law; MEDLINE; Mathematics; Computer security","score_opus":0.23393224661412015,"score_gpt":0.47090079454139366,"score_spread":0.2369685479272735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3047016911","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014262709,0.06523076,0.65069985,0.21362469,0.012087856,0.00088603375,0.0018349524,0.0014283519,0.0399447],"genre_scores_gemma":[0.64658415,0.034511823,0.23247117,0.050041568,0.019140879,0.0032765628,0.00082804513,0.0011328878,0.012012873],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.64599097,0.29674208,0.014199506,0.016987307,0.02458312,0.0014969222],"domain_scores_gemma":[0.11821515,0.8003928,0.034260996,0.03518365,0.010772608,0.001174823],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24364659,0.0014140476,0.002444718,0.00677963,0.0026663926,0.009806413,0.0033942065,0.0075279395,0.021201102],"category_scores_gemma":[0.73547506,0.0010635752,0.0022935278,0.016873952,0.017206777,0.012044073,0.004310194,0.008946305,0.002696216],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007289485,0.00010282032,0.032334622,0.006073265,0.0029542975,0.0006603128,0.0024139078,0.0048716543,0.00032708794,0.5415632,0.0831809,0.32478905],"study_design_scores_gemma":[0.00026247418,0.00014174606,0.006315905,0.0025737663,0.00051480846,0.0006691461,0.00040892494,0.009815304,0.0005533712,0.9341918,0.044465438,0.00008728425],"about_ca_topic_score_codex":0.0022621816,"about_ca_topic_score_gemma":0.0013638319,"teacher_disagreement_score":0.7563534,"about_ca_system_score_codex":0.0034434684,"about_ca_system_score_gemma":0.00938127,"threshold_uncertainty_score":0.9327184},"labels":[],"label_agreement":null},{"id":"W3048846123","doi":"10.1002/pds.5083","title":"Time‐related biases in pharmacoepidemiology","year":2020,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":161,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research; Canada Foundation for Innovation","keywords":"Medicine; Pharmacoepidemiology; COPD; Lung cancer; Hazard ratio; Observational study; Cohort; Cohort study; Internal medicine; Emergency medicine; Medical prescription; Pharmacology; Confidence interval","score_opus":0.2100696790819873,"score_gpt":0.4555282154921335,"score_spread":0.24545853641014623,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3048846123","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6061777,0.12171103,0.18079415,0.025543176,0.0031222058,0.0031269616,0.036093704,0.00058486307,0.022846222],"genre_scores_gemma":[0.96523976,0.0073211887,0.01652147,0.003719308,0.0009207935,0.00068191474,0.0040581543,0.00006795208,0.001469595],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8995704,0.06577328,0.0124873435,0.008993819,0.012126429,0.0010488201],"domain_scores_gemma":[0.6734349,0.20664117,0.0761471,0.03154478,0.011359625,0.0008724036],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.116008244,0.00072274543,0.0011693715,0.0023277914,0.0009190785,0.0027924376,0.0020158496,0.0015399965,0.002367422],"category_scores_gemma":[0.2614867,0.0006064487,0.0028586169,0.007120765,0.0020324672,0.0023663377,0.0018580147,0.0017944298,0.00031603323],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000846737,0.000066244764,0.93438107,0.0014711845,0.0065616043,0.00021426614,0.0008325644,0.0042314203,0.00020480603,0.0091070095,0.0025687218,0.03951431],"study_design_scores_gemma":[0.00039278605,0.00042609574,0.9109787,0.0024526045,0.00533577,0.0010314725,0.0005524929,0.016306363,0.0019193601,0.027746359,0.03269063,0.00016726783],"about_ca_topic_score_codex":0.03222155,"about_ca_topic_score_gemma":0.0154961515,"teacher_disagreement_score":0.8839918,"about_ca_system_score_codex":0.0029163489,"about_ca_system_score_gemma":0.0044072648,"threshold_uncertainty_score":0.6135176},"labels":[],"label_agreement":null},{"id":"W3049285076","doi":"10.1016/j.conctc.2020.100639","title":"An empirical comparison of time-to-event models to analyse a composite outcome in the presence of death as a competing risk","year":2020,"lang":"en","type":"article","venue":"Contemporary Clinical Trials Communications","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St. Joseph’s Healthcare Hamilton; Impact","funders":"Fogarty International Center; National Institutes of Health","keywords":"Hazard ratio; Proportional hazards model; Confidence interval; Medicine; Covariate; Observational study; Accelerated failure time model; Demography; Internal medicine; Statistics","score_opus":0.8439229051582652,"score_gpt":0.6493708172970246,"score_spread":0.19455208786124056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3049285076","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.54700005,0.012480265,0.42700475,0.0024081143,0.000932489,0.0020701485,0.0026431368,0.0006222231,0.004838928],"genre_scores_gemma":[0.9395469,0.0020896634,0.051395103,0.0004793335,0.00039422794,0.0017758776,0.00162586,0.00019759145,0.0024953878],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8886624,0.10070809,0.0020027666,0.0049418807,0.0022581099,0.0014267754],"domain_scores_gemma":[0.27526283,0.70044583,0.012608277,0.0073990705,0.0026610577,0.0016229159],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19125536,0.0024301785,0.0036208339,0.004416011,0.0007868209,0.003716212,0.005658186,0.0036787658,0.010191823],"category_scores_gemma":[0.24612322,0.00094848295,0.009133311,0.0023486442,0.002295331,0.004698734,0.0030504905,0.0049353596,0.0008046373],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016217802,0.001967401,0.20704007,0.0041829445,0.03810732,0.0012125673,0.0021174126,0.56480235,0.00085304637,0.07507049,0.004932541,0.08349599],"study_design_scores_gemma":[0.00067193474,0.003400045,0.020477727,0.00053625647,0.003190243,0.0005157873,0.0007541743,0.93962014,0.00025455822,0.028464602,0.0019741303,0.00014047977],"about_ca_topic_score_codex":0.003674139,"about_ca_topic_score_gemma":0.0015556981,"teacher_disagreement_score":0.80874467,"about_ca_system_score_codex":0.0027538864,"about_ca_system_score_gemma":0.0021138247,"threshold_uncertainty_score":0.99732614},"labels":[],"label_agreement":null},{"id":"W3052338136","doi":"10.1097/bsd.0000000000001055","title":"Propensity Score Matching","year":2020,"lang":"en","type":"article","venue":"Clinical Spine Surgery A Spine Publication","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Propensity score matching; Observational study; Outcome (game theory); Matching (statistics); Confounding; Medicine; Computer science; Econometrics; Internal medicine; Mathematics; Pathology","score_opus":0.503363480811191,"score_gpt":0.4645952154944371,"score_spread":0.03876826531675387,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3052338136","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00392435,0.0009968149,0.9796277,0.0010723481,0.00034987423,0.0027002497,0.0021301797,0.0006795136,0.008518988],"genre_scores_gemma":[0.14682329,0.0043021156,0.8182541,0.0014836666,0.0009176621,0.009208961,0.006308422,0.0005196966,0.012181965],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9767239,0.015337611,0.0021060335,0.0023004464,0.003061106,0.00047088138],"domain_scores_gemma":[0.9753162,0.013442813,0.0030462588,0.0062786504,0.0016106911,0.00030540035],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.027877847,0.0010858849,0.0024173534,0.0052621397,0.0010162605,0.0028785958,0.0021473018,0.0018981358,0.027069882],"category_scores_gemma":[0.0975768,0.0006039042,0.002342485,0.008460802,0.0014535071,0.0028888378,0.0036540125,0.0023062965,0.006533147],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043114237,0.00024581197,0.013927326,0.0011011853,0.0012579865,0.00019676513,0.00038118602,0.015445318,0.0005603003,0.37289974,0.05042549,0.5431278],"study_design_scores_gemma":[0.0007739574,0.0005323874,0.008768197,0.00089338893,0.0008905903,0.0014907938,0.00024179922,0.07320712,0.0015990055,0.71086276,0.20057976,0.00016029547],"about_ca_topic_score_codex":0.001588846,"about_ca_topic_score_gemma":0.0012214832,"teacher_disagreement_score":0.97212213,"about_ca_system_score_codex":0.0012319766,"about_ca_system_score_gemma":0.004576789,"threshold_uncertainty_score":0.14743394},"labels":[],"label_agreement":null},{"id":"W307107294","doi":"10.22237/jmasm/1177992660","title":"Tests for Treatment Group Equality When Data are Nonnormal and Heteroscedastic","year":2007,"lang":"en","type":"article","venue":"Journal of Modern Applied Statistical Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; York University","funders":"","keywords":"Heteroscedasticity; Mathematics; Nonparametric statistics; Statistics; Type I and type II errors; Econometrics; Monte Carlo method; Group (periodic table)","score_opus":0.49317632282399754,"score_gpt":0.5732767093652745,"score_spread":0.08010038654127699,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W307107294","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08127867,0.0015347335,0.9026697,0.00091290375,0.00045916793,0.003323207,0.0019826258,0.0006017289,0.007237262],"genre_scores_gemma":[0.62196654,0.0006397889,0.3589334,0.00068788964,0.00025449347,0.013176548,0.0016649233,0.00031577583,0.0023605812],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84645283,0.11259998,0.00902211,0.010815882,0.018968413,0.0021407474],"domain_scores_gemma":[0.43572968,0.5070185,0.017634332,0.028030116,0.010355083,0.001232214],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.106958166,0.0011323979,0.0032557377,0.0032556325,0.0016568383,0.0024565437,0.004405796,0.003285148,0.020386212],"category_scores_gemma":[0.41667137,0.00061937806,0.003707413,0.00508865,0.005322404,0.0042637703,0.003265254,0.0040122136,0.0013241022],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012191735,0.0015424596,0.09375811,0.005848981,0.0107745305,0.0015649974,0.008226734,0.013911865,0.0053901784,0.22049248,0.011571979,0.614726],"study_design_scores_gemma":[0.004368591,0.013845684,0.28460902,0.002181482,0.006371745,0.002857623,0.0042801583,0.10674606,0.03225926,0.5068438,0.03484177,0.0007947643],"about_ca_topic_score_codex":0.00063095294,"about_ca_topic_score_gemma":0.00063506054,"teacher_disagreement_score":0.106958166,"about_ca_system_score_codex":0.0017191612,"about_ca_system_score_gemma":0.0035065396,"threshold_uncertainty_score":0.5656556},"labels":[],"label_agreement":null},{"id":"W3080867134","doi":"10.1136/bmjopen-2020-036961","title":"Evaluation of propensity score used in cardiovascular research: a cross-sectional survey and guidance document","year":2020,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research","keywords":"Medicine; Propensity score matching; Covariate; Data extraction; Impact factor; Matching (statistics); MEDLINE; Family medicine; Internal medicine; Statistics; Pathology","score_opus":0.8584909049281757,"score_gpt":0.6073207296458257,"score_spread":0.25117017528235,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3080867134","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12019098,0.37674347,0.27522144,0.11477205,0.00485842,0.031467434,0.041581318,0.0013814571,0.03378339],"genre_scores_gemma":[0.38842604,0.16780283,0.36535364,0.013511223,0.0029102806,0.039833855,0.018568346,0.0005907332,0.0030030136],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.6129462,0.20712936,0.11504014,0.0071660113,0.056401316,0.0013169205],"domain_scores_gemma":[0.2415471,0.5126298,0.12555622,0.023803866,0.09380264,0.0026603618],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.33866104,0.0007780871,0.0019235893,0.023257054,0.0012706443,0.006139931,0.0024059948,0.002109964,0.006935721],"category_scores_gemma":[0.6024026,0.0008969688,0.0030391498,0.024131382,0.0023294007,0.00536693,0.0039260034,0.0022537068,0.0020053391],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007406084,0.00025789443,0.20100357,0.07318092,0.002382419,0.00023038483,0.0045892736,0.0012034858,0.0006439839,0.012709903,0.060307786,0.64274985],"study_design_scores_gemma":[0.000820816,0.0019525788,0.37478364,0.25648186,0.005658772,0.0023374099,0.005868819,0.007462825,0.0045553884,0.022937784,0.3166521,0.00048808203],"about_ca_topic_score_codex":0.004178996,"about_ca_topic_score_gemma":0.0038510605,"teacher_disagreement_score":0.6613389,"about_ca_system_score_codex":0.0047672023,"about_ca_system_score_gemma":0.020970926,"threshold_uncertainty_score":0.81554866},"labels":[],"label_agreement":null},{"id":"W3081944489","doi":"10.1002/sim.8710","title":"Impact of discretization of the timeline for longitudinal causal inference methods","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hôpital du Sacré-Cœur de Montréal; Université de Montréal; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Timeline; Causal inference; Inference; Computer science; Econometrics; Discretization; Statistics; Mathematics; Artificial intelligence","score_opus":0.22839864773798854,"score_gpt":0.5624154422413042,"score_spread":0.3340167945033157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3081944489","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06161997,0.0019082795,0.9276191,0.0040429365,0.00048461708,0.00056778477,0.00075713656,0.00044896032,0.0025511954],"genre_scores_gemma":[0.49561742,0.0010410687,0.49884647,0.0011791011,0.00018542426,0.0012938598,0.00090095185,0.00015357815,0.00078217924],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89526594,0.08817572,0.0060284263,0.0039179227,0.0059027052,0.0007092889],"domain_scores_gemma":[0.3750693,0.56479466,0.015495279,0.038698718,0.004790054,0.001151986],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11885788,0.0008054529,0.0013677367,0.00096878415,0.0014055583,0.0035639158,0.0029886956,0.0024982449,0.0032107153],"category_scores_gemma":[0.4100285,0.0011034281,0.0018487999,0.001986005,0.0033333534,0.004474387,0.003612807,0.006035776,0.00039959175],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0033877962,0.00053194864,0.07314793,0.0017024296,0.0012928165,0.0010182025,0.007141698,0.3666005,0.0034674243,0.33231816,0.005223279,0.20416778],"study_design_scores_gemma":[0.0009246971,0.0013354005,0.014364355,0.0019900769,0.00046133835,0.0006445866,0.0021998342,0.6210288,0.0052254004,0.33395597,0.017644582,0.00022491706],"about_ca_topic_score_codex":0.007926384,"about_ca_topic_score_gemma":0.0055456185,"teacher_disagreement_score":0.11885788,"about_ca_system_score_codex":0.002715884,"about_ca_system_score_gemma":0.0036251713,"threshold_uncertainty_score":0.6285881},"labels":[],"label_agreement":null},{"id":"W3082894717","doi":"10.1002/sim.8722","title":"Multiply robust estimation of causal quantile treatment effects","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Roche (Canada)","funders":"","keywords":"Quantile; Causal inference; Estimator; Propensity score matching; Econometrics; Statistics; Inverse probability weighting; Empirical likelihood; Weighting; Average treatment effect; Inference; Computer science; Estimation; Mathematics; Artificial intelligence; Medicine; Economics","score_opus":0.1383377641491244,"score_gpt":0.4358404304734299,"score_spread":0.2975026663243055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3082894717","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031544173,0.00021280635,0.99585706,0.00014471293,0.000016451184,0.00004616599,0.00006547952,0.00012954712,0.00037321792],"genre_scores_gemma":[0.2945203,0.00095795054,0.7004204,0.00031437541,0.00024092774,0.0006306437,0.00046970005,0.00013628844,0.0023094655],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9934881,0.004347686,0.00024426437,0.0007469879,0.0009773752,0.00019555113],"domain_scores_gemma":[0.9747704,0.019750113,0.0017522662,0.0027254403,0.000843947,0.00015771162],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012897742,0.000689577,0.0018319618,0.0017507917,0.0003985304,0.0011059216,0.0018972225,0.0014303746,0.005400232],"category_scores_gemma":[0.05471754,0.0006043942,0.0015899158,0.0018794655,0.0013743901,0.0016225327,0.002364363,0.002485651,0.00049799186],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028441023,0.00012944404,0.006560375,0.0003840661,0.00060968,0.00021080379,0.0002454212,0.23805161,0.0031699722,0.49320245,0.0020300506,0.25512183],"study_design_scores_gemma":[0.000095462055,0.00016802724,0.0031955168,0.00007754027,0.00013959353,0.000178787,0.000034513123,0.6596077,0.0025875159,0.32970443,0.004164181,0.000046680223],"about_ca_topic_score_codex":0.0012156415,"about_ca_topic_score_gemma":0.0007749349,"teacher_disagreement_score":0.012897742,"about_ca_system_score_codex":0.0008045588,"about_ca_system_score_gemma":0.0012270041,"threshold_uncertainty_score":0.0682106},"labels":[],"label_agreement":null},{"id":"W3083830176","doi":"10.1214/20-sts786","title":"On Nearly Assumption-Free Tests of Nominal Confidence Interval Coverage for Causal Parameters Estimated by Machine Learning","year":2020,"lang":"en","type":"article","venue":"Statistical Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Shanghai University of Finance and Economics; University of Toronto; Eidgenössische Technische Hochschule Zürich; University of Washington; Office of Naval Research; Harvard University; National Science Foundation","keywords":"Estimator; Mathematics; Smoothness; Statistics; Confidence interval; Null hypothesis; Null (SQL); Algorithm; Computer science; Mathematical analysis","score_opus":0.14827249785666008,"score_gpt":0.42738724172025827,"score_spread":0.2791147438635982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3083830176","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07639241,0.004871472,0.90048414,0.0032070472,0.00032804225,0.00031793216,0.0019120023,0.00094391016,0.011542909],"genre_scores_gemma":[0.8549904,0.002035806,0.13384862,0.002423785,0.0011685619,0.0011989707,0.0030704215,0.00033426753,0.00092909404],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9070449,0.06290876,0.004211684,0.010373526,0.013398319,0.0020628516],"domain_scores_gemma":[0.18686557,0.77420753,0.01626034,0.015953356,0.005371536,0.0013417248],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09213686,0.002029962,0.0039606616,0.005596853,0.0016891315,0.0049096225,0.005704682,0.0040669264,0.005661245],"category_scores_gemma":[0.55774504,0.000922098,0.0034443554,0.0056192614,0.013540949,0.009473423,0.0072099925,0.0065207104,0.0009943149],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022471652,0.00023568793,0.057264734,0.0017139019,0.002453558,0.0017614014,0.0016209095,0.120092615,0.001808531,0.6576873,0.0055826926,0.1475316],"study_design_scores_gemma":[0.0003493077,0.0006996385,0.016349567,0.00090292393,0.00042056027,0.001106255,0.00054260157,0.2737927,0.0029480837,0.69569415,0.0069645415,0.00022966762],"about_ca_topic_score_codex":0.0021236816,"about_ca_topic_score_gemma":0.0008198161,"teacher_disagreement_score":0.09213686,"about_ca_system_score_codex":0.0017711569,"about_ca_system_score_gemma":0.0022715435,"threshold_uncertainty_score":0.48727208},"labels":[],"label_agreement":null},{"id":"W3085668815","doi":"10.47302/jsr.2018520205","title":"Bootstrap bias correction for average treatment effects with inverse propensity weights","year":2019,"lang":"en","type":"article","venue":"Journal of Statistical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; Memorial University of Newfoundland","funders":"","keywords":"Propensity score matching; Estimator; Average treatment effect; Endogeneity; Observational study; Econometrics; Statistics; Mathematics; Instrumental variable; Confounding; Inverse; Treatment effect; Medicine","score_opus":0.42776929817582293,"score_gpt":0.5138247682271289,"score_spread":0.08605547005130593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3085668815","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061495956,0.0004929322,0.99173903,0.0002334939,0.000116137904,0.00014714118,0.0000981264,0.00027145553,0.00075211556],"genre_scores_gemma":[0.28663996,0.00090618123,0.70681953,0.0007317259,0.00033971426,0.0011633872,0.000563359,0.00029641314,0.0025396382],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96917254,0.024233093,0.0010477448,0.0017152503,0.0033088846,0.00052239344],"domain_scores_gemma":[0.8996779,0.07646418,0.005840808,0.012323217,0.0052591464,0.00043483215],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.046258964,0.00066132075,0.0013896418,0.002343926,0.0005535616,0.0012790083,0.0021071467,0.0015349969,0.003951716],"category_scores_gemma":[0.18708485,0.000548039,0.0016254544,0.0025386938,0.0014354098,0.0012650309,0.0020251214,0.0021889275,0.0008639556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007818386,0.00023911176,0.02957261,0.001386514,0.0018369047,0.0006756183,0.0009206557,0.11505445,0.0049304934,0.24122502,0.010228162,0.5931485],"study_design_scores_gemma":[0.000351379,0.00038080677,0.016330305,0.000691518,0.00060514227,0.00075461034,0.00022250989,0.6541256,0.009537914,0.29092187,0.025963927,0.0001144877],"about_ca_topic_score_codex":0.00263808,"about_ca_topic_score_gemma":0.0018200782,"teacher_disagreement_score":0.046258964,"about_ca_system_score_codex":0.0007344637,"about_ca_system_score_gemma":0.0017661906,"threshold_uncertainty_score":0.24464375},"labels":[],"label_agreement":null},{"id":"W3087032669","doi":"10.1002/pds.5121","title":"Implementing high‐dimensional propensity score principles to improve confounder adjustment in <scp>UK</scp> electronic health records","year":2020,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada","keywords":"Medicine; Confounding; Propensity score matching; Clopidogrel; Observational study; Hazard ratio; Pharmacoepidemiology; Health records; Internal medicine; Psychological intervention; Confidence interval; Emergency medicine; Myocardial infarction; Medical prescription; Pharmacology; Psychiatry","score_opus":0.18407368460946416,"score_gpt":0.4199496426328565,"score_spread":0.23587595802339234,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3087032669","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050766274,0.0011043384,0.9408217,0.0023252303,0.00022705487,0.0016196092,0.0012218218,0.00065930234,0.0012547267],"genre_scores_gemma":[0.43328455,0.0008405439,0.5595787,0.0010211192,0.00035547023,0.002238054,0.0018760266,0.0001390619,0.0006664673],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8020371,0.1725392,0.010132328,0.0060016657,0.008643446,0.0006463256],"domain_scores_gemma":[0.744313,0.17304212,0.030960703,0.038123306,0.012731744,0.00082919915],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12896411,0.0008614024,0.0014011167,0.0039810278,0.0008448264,0.0034820857,0.002105002,0.0010103894,0.0031825725],"category_scores_gemma":[0.29457137,0.0009702033,0.0034476095,0.0069660447,0.0018127459,0.002366491,0.004331967,0.002056245,0.00075452396],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012446046,0.00042759156,0.44302446,0.0025055248,0.011033057,0.00028748618,0.001864688,0.054706305,0.001755085,0.027132029,0.010202317,0.44581679],"study_design_scores_gemma":[0.0019147254,0.0027931172,0.4475842,0.0016362808,0.0039410326,0.001079833,0.0010771573,0.36161852,0.0059890207,0.12705085,0.044829946,0.00048541796],"about_ca_topic_score_codex":0.005545966,"about_ca_topic_score_gemma":0.005112851,"teacher_disagreement_score":0.12896411,"about_ca_system_score_codex":0.0012237821,"about_ca_system_score_gemma":0.003949952,"threshold_uncertainty_score":0.68203557},"labels":[],"label_agreement":null},{"id":"W3088227231","doi":"10.1177/1536867x20953572","title":"Causal mediation analysis in instrumental-variables regressions","year":2020,"lang":"en","type":"article","venue":"The Stata Journal Promoting communications on statistics and Stata","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":186,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Instrumental variable; Mediation; Causal inference; Econometrics; Mediator; Psychology; Causal analysis; Causal model; Variables; Estimation; Statistics; Mathematics; Medicine; Sociology; Economics; Social science; Internal medicine","score_opus":0.19406576556761382,"score_gpt":0.43369128149908953,"score_spread":0.2396255159314757,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3088227231","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031820158,0.0007185279,0.98986465,0.0007986506,0.00017156581,0.0003065172,0.00051388715,0.00044098822,0.004003165],"genre_scores_gemma":[0.37284082,0.002390756,0.6083587,0.0014563947,0.0007521498,0.0043280656,0.0018284571,0.0007731078,0.0072715925],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9019281,0.086066164,0.0019348009,0.0036922258,0.004911537,0.0014671581],"domain_scores_gemma":[0.7860908,0.18835656,0.0063648266,0.014255775,0.00426618,0.00066587585],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.068657815,0.0024256525,0.0028800864,0.0036610118,0.0016971042,0.003956901,0.0048018503,0.001921386,0.023116967],"category_scores_gemma":[0.28803787,0.0011378684,0.0030998618,0.0048125787,0.0030146926,0.004518222,0.005995116,0.0059605995,0.0022450853],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024120264,0.00019936898,0.009775219,0.00094812125,0.0014940436,0.00034089948,0.0007702293,0.030995222,0.00024783064,0.8538588,0.0073830155,0.093746044],"study_design_scores_gemma":[0.00022285212,0.000110411056,0.0016899457,0.00041038927,0.00046508337,0.00009179685,0.00027122072,0.13077152,0.0012365488,0.8481358,0.01653137,0.00006304762],"about_ca_topic_score_codex":0.004283019,"about_ca_topic_score_gemma":0.0032141062,"teacher_disagreement_score":0.068657815,"about_ca_system_score_codex":0.0019192577,"about_ca_system_score_gemma":0.005518344,"threshold_uncertainty_score":0.3631016},"labels":[],"label_agreement":null},{"id":"W3088839437","doi":"10.1515/jqas-2020-0060","title":"A contextual analysis of crossing the ball in soccer","year":2020,"lang":"en","type":"article","venue":"Journal of Quantitative Analysis in Sports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Level crossing; Computer science; Inference; Ball (mathematics); Border crossing; Causal inference; Artificial intelligence; Machine learning; Econometrics; Mathematics; Engineering","score_opus":0.24222184916877643,"score_gpt":0.4724619200366338,"score_spread":0.23024007086785736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3088839437","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8166633,0.0010419067,0.16508855,0.0007566363,0.000059448594,0.0001755407,0.0024404915,0.00029483828,0.01347923],"genre_scores_gemma":[0.9901439,0.00009196768,0.009235943,0.000019906562,0.0000111683585,0.000020875588,0.00026663937,0.000013950106,0.00019560082],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9986034,0.0007116571,0.00005761334,0.00028562304,0.00022931135,0.00011246244],"domain_scores_gemma":[0.992531,0.0050056544,0.0010652033,0.00051569025,0.0006524169,0.00023004366],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017607304,0.00023274696,0.00032234337,0.0020699077,0.00079007715,0.0012633656,0.0005192494,0.00049214624,0.005476573],"category_scores_gemma":[0.010869052,0.00023623128,0.00040272376,0.0022960443,0.0011551122,0.0010152695,0.0011150052,0.0007126694,0.00015904167],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014324359,0.00084090355,0.27681762,0.001472855,0.00072428084,0.0029138457,0.009253588,0.14866816,0.015041838,0.41351196,0.005783253,0.12353929],"study_design_scores_gemma":[0.00009064698,0.0006486534,0.37511715,0.00044429392,0.00049914164,0.00061992236,0.013355697,0.3823862,0.0077341762,0.18579336,0.03311163,0.00019918261],"about_ca_topic_score_codex":0.017438285,"about_ca_topic_score_gemma":0.025303114,"teacher_disagreement_score":0.017438285,"about_ca_system_score_codex":0.0010419412,"about_ca_system_score_gemma":0.000794994,"threshold_uncertainty_score":0.03467357},"labels":[],"label_agreement":null},{"id":"W3089978665","doi":"10.1097/ede.0000000000001267","title":"Single-arm Trials with Historical Controls","year":2020,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Long arm; Biology; Genetics","score_opus":0.6572075309335021,"score_gpt":0.4891268965738019,"score_spread":0.16808063435970028,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3089978665","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33335298,0.0940132,0.4565307,0.009628933,0.015168229,0.053234447,0.010471154,0.0016110358,0.02598937],"genre_scores_gemma":[0.9067239,0.004962432,0.04575265,0.0025888467,0.0015765395,0.033730015,0.0024212953,0.000101098136,0.0021432533],"study_design_codex":"randomized_trial","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8273874,0.14310482,0.012051727,0.010243572,0.0060065887,0.0012059171],"domain_scores_gemma":[0.7379406,0.1589012,0.0517443,0.04239154,0.007385699,0.0016365752],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16743913,0.0021626728,0.0039237514,0.0012468761,0.0009899437,0.0030851685,0.003214835,0.003772131,0.007830157],"category_scores_gemma":[0.24318352,0.0010252016,0.007998619,0.001845821,0.003561052,0.0036657315,0.001976265,0.0035305524,0.0011354527],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.34689757,0.003565596,0.12061834,0.030723456,0.07267101,0.00095361716,0.0010483448,0.105852045,0.0028913654,0.09676676,0.0158225,0.20218939],"study_design_scores_gemma":[0.2447655,0.0821304,0.05181441,0.015310132,0.062374488,0.0014507946,0.0004258206,0.13710572,0.011516904,0.2660562,0.12633166,0.00071786024],"about_ca_topic_score_codex":0.0008584196,"about_ca_topic_score_gemma":0.00056581874,"teacher_disagreement_score":0.8325609,"about_ca_system_score_codex":0.0024638202,"about_ca_system_score_gemma":0.0028680149,"threshold_uncertainty_score":0.88551337},"labels":[],"label_agreement":null},{"id":"W3090620836","doi":"10.1016/j.jclinepi.2020.09.017","title":"GRADE Guidelines: 29. Rating the certainty in time-to-event outcomes—Study limitations due to censoring of participants with missing data in intervention studies","year":2020,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cochrane; McMaster University; Impact","funders":"","keywords":"Censoring (clinical trials); Missing data; Medicine; Survival analysis; Proportional hazards model; Statistics; Mathematics","score_opus":0.9206566054490741,"score_gpt":0.6874685182399085,"score_spread":0.23318808720916562,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3090620836","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018900196,0.06962631,0.19882414,0.13164665,0.03992352,0.14088464,0.32552484,0.014232767,0.077447124],"genre_scores_gemma":[0.021549428,0.036410615,0.47231674,0.08032186,0.0074089486,0.2553185,0.073624,0.006479495,0.046570417],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84891003,0.07532243,0.045346927,0.0031820266,0.02445437,0.0027841916],"domain_scores_gemma":[0.6012987,0.21658127,0.027295962,0.016192343,0.13310857,0.00552318],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.104054205,0.0043354398,0.0089605935,0.007927202,0.0022369192,0.007515043,0.015925623,0.027805585,0.050186526],"category_scores_gemma":[0.44793865,0.0059208022,0.023327118,0.0064036665,0.0028939066,0.002821546,0.007473164,0.016533403,0.03866008],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012275876,0.0001307639,0.0007232237,0.054510757,0.0016440016,0.000104511906,0.00033894667,0.0010183451,0.0002790665,0.006726151,0.8810721,0.052224506],"study_design_scores_gemma":[0.008134165,0.00042668145,0.008335915,0.15478231,0.007295157,0.0005121701,0.00026361566,0.003362802,0.0016203366,0.044388026,0.770423,0.0004558955],"about_ca_topic_score_codex":0.039821673,"about_ca_topic_score_gemma":0.03576453,"teacher_disagreement_score":0.8959458,"about_ca_system_score_codex":0.007839568,"about_ca_system_score_gemma":0.020731432,"threshold_uncertainty_score":0.5502978},"labels":[],"label_agreement":null},{"id":"W3090836172","doi":"10.1097/ede.0000000000001253","title":"Postmyocardial Infarction Statin Exposure and the Risk of Stroke with Weighting for Outcome Misclassification","year":2020,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital; University of Ottawa","funders":"Biogen; Eli Lilly and Company; Canadian Institutes of Health Research; Mitacs; McGill University; Amgen","keywords":"Medicine; Confidence interval; Confounding; Observational study; Inverse probability weighting; Odds ratio; Randomized controlled trial; Stroke (engine); Statin; Inverse probability; Outcome (game theory); Statistics; Internal medicine; Emergency medicine; Propensity score matching; Mathematics","score_opus":0.22109227161303385,"score_gpt":0.4148833491069785,"score_spread":0.19379107749394464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3090836172","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09460148,0.0016738645,0.89892304,0.0019888156,0.00017497732,0.00045406184,0.0003156556,0.00022520067,0.00164285],"genre_scores_gemma":[0.69754934,0.0006813479,0.2995245,0.0004932663,0.00013678962,0.00062524533,0.0002487339,0.00006362243,0.0006770925],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.94924575,0.039669108,0.0029740832,0.003637909,0.0037943705,0.00067890715],"domain_scores_gemma":[0.80665386,0.14731422,0.017934762,0.024359252,0.003378145,0.00035985536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06860932,0.0008819868,0.0009882767,0.002383588,0.00056392926,0.0019923097,0.0022049828,0.0016348984,0.0019575572],"category_scores_gemma":[0.283095,0.00057502097,0.003440101,0.0029642533,0.0020315882,0.0024203658,0.0025733528,0.0019644464,0.00018476677],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012543725,0.00042908007,0.2067754,0.0017041318,0.0076191006,0.00065929984,0.0018854099,0.14796919,0.0028149313,0.17618114,0.0039634653,0.44874445],"study_design_scores_gemma":[0.000723261,0.00095653994,0.08238197,0.0011562826,0.004725941,0.0016589517,0.0003698589,0.45490804,0.006171441,0.436675,0.010059372,0.00021338978],"about_ca_topic_score_codex":0.0036764333,"about_ca_topic_score_gemma":0.002040336,"teacher_disagreement_score":0.06860932,"about_ca_system_score_codex":0.0014032819,"about_ca_system_score_gemma":0.00227324,"threshold_uncertainty_score":0.36284512},"labels":[],"label_agreement":null},{"id":"W3091170675","doi":"10.1093/ije/dyaa127","title":"Bias factor, maximum bias and the E-value: insight and extended applications","year":2020,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Centre Hospitalier Universitaire Sainte-Justine","funders":"","keywords":"Value (mathematics); Statistics; Factor (programming language); Econometrics; Mathematics; Computer science","score_opus":0.3817986940034575,"score_gpt":0.47124402102576,"score_spread":0.08944532702230251,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3091170675","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060325125,0.024806658,0.94483745,0.010283722,0.00077721756,0.000315634,0.00038851242,0.00030334954,0.012254894],"genre_scores_gemma":[0.2465615,0.030780701,0.7084943,0.0036746226,0.003431796,0.0019471499,0.00040337417,0.00046701566,0.004239508],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9019033,0.08068745,0.0045696506,0.0042330264,0.007819272,0.00078730274],"domain_scores_gemma":[0.43935958,0.52869076,0.010079962,0.011415053,0.0098227775,0.00063183333],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11431287,0.003255436,0.0032972486,0.007871574,0.001131059,0.0055510197,0.003436198,0.0054123728,0.007987205],"category_scores_gemma":[0.39495727,0.0016465725,0.004439947,0.008375818,0.008583699,0.010820337,0.00514479,0.010144661,0.0012002365],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017379617,0.00007590884,0.0057838405,0.0020046777,0.00075304223,0.00048119147,0.0007428065,0.026821626,0.00032185583,0.80310035,0.007874219,0.15186672],"study_design_scores_gemma":[0.000055592045,0.000053770986,0.0011605392,0.00110663,0.00017048746,0.0005516534,0.0001288233,0.037520975,0.0003432421,0.9473949,0.0114225205,0.000090752605],"about_ca_topic_score_codex":0.0030798083,"about_ca_topic_score_gemma":0.0014331084,"teacher_disagreement_score":0.8856871,"about_ca_system_score_codex":0.004501319,"about_ca_system_score_gemma":0.0033238165,"threshold_uncertainty_score":0.60455143},"labels":[],"label_agreement":null},{"id":"W3091744499","doi":"10.1093/ije/dyaa152","title":"Can synthetic controls improve causal inference in interrupted time series evaluations of public health interventions?","year":2020,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital","funders":"Joyce Foundation","keywords":"Interrupted time series; Causal inference; Counterfactual thinking; Psychological intervention; Interrupted Time Series Analysis; Observational study; Computer science; Inference; Time series; Control (management); Public health; Research design; Confounding; Clinical study design; Series (stratigraphy); Machine learning; Econometrics; Artificial intelligence; Medicine; Psychology; Mathematics; Statistics; Clinical trial","score_opus":0.3983787466085861,"score_gpt":0.5332732795590025,"score_spread":0.13489453295041642,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3091744499","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014479143,0.0071570603,0.9600287,0.0068856054,0.0026136232,0.0028214185,0.0007034354,0.00058138807,0.0047295694],"genre_scores_gemma":[0.37615362,0.004256388,0.5981818,0.0047804974,0.0015016624,0.012409217,0.0008875343,0.0003106562,0.001518731],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.5268082,0.4371852,0.01396633,0.010883204,0.010028104,0.0011289996],"domain_scores_gemma":[0.2096415,0.693797,0.037532587,0.04755653,0.010552195,0.0009201142],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.41525856,0.0026553303,0.0039741267,0.0037289292,0.0016095074,0.0061975755,0.004625637,0.0048096725,0.010716644],"category_scores_gemma":[0.74603695,0.0016009453,0.006484505,0.0041453596,0.006590996,0.008697613,0.00487947,0.006133451,0.0009352071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005807357,0.00071139546,0.022686,0.010220088,0.010308453,0.00038221368,0.0055119344,0.065282136,0.00095962366,0.48683453,0.008936844,0.38235945],"study_design_scores_gemma":[0.0039601456,0.0043938295,0.010241074,0.008240297,0.0057800408,0.0003439236,0.0010766069,0.18731275,0.0036473246,0.72570664,0.048883095,0.0004142859],"about_ca_topic_score_codex":0.0033428674,"about_ca_topic_score_gemma":0.002123531,"teacher_disagreement_score":0.5847415,"about_ca_system_score_codex":0.0037528635,"about_ca_system_score_gemma":0.0061245514,"threshold_uncertainty_score":0.7210903},"labels":[],"label_agreement":null},{"id":"W3092385491","doi":"10.1002/sim.8764","title":"The effect of a constraint on the maximum number of controls matched to each treated subject on the performance of full matching on the propensity score when estimating risk differences","year":2020,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Matching (statistics); Observational study; Calipers; Constraint (computer-aided design); Statistics; Mathematics; Average treatment effect; Econometrics; Medicine","score_opus":0.09042720693450075,"score_gpt":0.3650431871051201,"score_spread":0.2746159801706194,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3092385491","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10948783,0.002114078,0.8760247,0.003893214,0.00022840145,0.000749913,0.00055745174,0.00045454816,0.0064898725],"genre_scores_gemma":[0.43621588,0.0008343258,0.55847496,0.0014480217,0.00017930211,0.0014613279,0.00044720125,0.00021750352,0.0007215786],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.820243,0.15314928,0.008282544,0.00782053,0.008877868,0.0016267697],"domain_scores_gemma":[0.2438081,0.70485014,0.012190739,0.033601575,0.004547433,0.0010021002],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.20277078,0.0015388187,0.0026365747,0.0015205265,0.0019244519,0.0027396232,0.0031836713,0.0033451398,0.003977214],"category_scores_gemma":[0.6049281,0.0009959048,0.002951044,0.00291398,0.004673641,0.0054106014,0.005352867,0.0047610304,0.0003845816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01174413,0.001050148,0.040263142,0.0020286718,0.0026943798,0.001218645,0.0022019648,0.36665905,0.009632327,0.23754828,0.0057771746,0.31918216],"study_design_scores_gemma":[0.0032536834,0.0044032284,0.036068387,0.0017209906,0.0015168771,0.0014473838,0.0005419241,0.6029772,0.016599884,0.3169092,0.014016332,0.00054488133],"about_ca_topic_score_codex":0.0041537285,"about_ca_topic_score_gemma":0.0024490056,"teacher_disagreement_score":0.79722923,"about_ca_system_score_codex":0.001657677,"about_ca_system_score_gemma":0.00427074,"threshold_uncertainty_score":0.98312557},"labels":[],"label_agreement":null},{"id":"W3092939691","doi":"10.1101/2020.10.12.20211706","title":"Evaluation of statistical methods used in the analysis of interrupted time series studies: a simulation study","year":2020,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"Monash University","keywords":"Autocorrelation; Statistics; Series (stratigraphy); Ordinary least squares; Mathematics; Restricted maximum likelihood; Econometrics; Population; Autocorrelation technique; Maximum likelihood; Demography; Biology","score_opus":0.5710198001624486,"score_gpt":0.6137507411071274,"score_spread":0.042730940944678775,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3092939691","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27690634,0.0043405094,0.70513695,0.0020666989,0.00039059462,0.0038485914,0.0018264592,0.0006749417,0.0048089116],"genre_scores_gemma":[0.71087754,0.0015755321,0.28129655,0.00034457693,0.00008741214,0.004449794,0.0007441435,0.00012146663,0.00050299824],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.87432134,0.11810143,0.002534713,0.0016350046,0.0028322996,0.0005752849],"domain_scores_gemma":[0.32943714,0.6336636,0.014260428,0.009476776,0.0120596355,0.0011023799],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15193033,0.0011347331,0.001871441,0.0021405842,0.0007447891,0.0020426451,0.002420832,0.0019811145,0.004089528],"category_scores_gemma":[0.32855052,0.00064771116,0.0029797237,0.002881914,0.0011157092,0.0017037878,0.0017376274,0.002649049,0.00031584586],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005603382,0.0012766069,0.06523799,0.0033831655,0.004693923,0.00064421317,0.0009432592,0.7670963,0.0011769154,0.048504766,0.0045470186,0.096892506],"study_design_scores_gemma":[0.0008317632,0.0022470162,0.0054652686,0.0009385578,0.0008555749,0.00019587153,0.00024527012,0.97103006,0.001116077,0.014121329,0.0028670651,0.000086209984],"about_ca_topic_score_codex":0.0053083664,"about_ca_topic_score_gemma":0.0026648194,"teacher_disagreement_score":0.84806967,"about_ca_system_score_codex":0.0022291765,"about_ca_system_score_gemma":0.0030768875,"threshold_uncertainty_score":0.803494},"labels":[],"label_agreement":null},{"id":"W3093094898","doi":"10.1101/2020.10.15.20212886","title":"Population attributable fraction for continuously distributed exposures","year":2020,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Population Health Research Institute","funders":"","keywords":"Econometrics; Inference; Attributable risk; Statistics; Categorical variable; Population; Estimator; Categorization; Risk factor; Causal inference; Computer science; Mathematics; Medicine; Environmental health; Artificial intelligence","score_opus":0.20869255994259875,"score_gpt":0.4191759803314865,"score_spread":0.21048342038888776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3093094898","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017738413,0.0015825001,0.97387356,0.0016578337,0.0001581615,0.0001114175,0.0008574914,0.0003539585,0.0036666861],"genre_scores_gemma":[0.709545,0.0024232853,0.2784558,0.00096485903,0.0006250609,0.00082789134,0.0016195398,0.00027651162,0.005262059],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9911239,0.005548916,0.0003302092,0.0015116659,0.0012716423,0.0002136652],"domain_scores_gemma":[0.933787,0.053788275,0.0039224722,0.0065128054,0.0017273468,0.00026225814],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018083178,0.0006580794,0.001166689,0.0030226258,0.0004438954,0.0020749865,0.001841985,0.001897347,0.008191148],"category_scores_gemma":[0.11025085,0.00029691635,0.001473221,0.002117856,0.0024246639,0.0029032945,0.0015645622,0.0031188086,0.00090768543],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013915138,0.00008521767,0.023463476,0.000557823,0.0005209319,0.00028962237,0.0005366954,0.089335814,0.00093466777,0.76570183,0.00847121,0.10996354],"study_design_scores_gemma":[0.00003278858,0.00008366329,0.006372764,0.00031111715,0.00011768141,0.00029219102,0.0001057839,0.12963466,0.0008734075,0.8519975,0.010136489,0.000042010488],"about_ca_topic_score_codex":0.0017756511,"about_ca_topic_score_gemma":0.00089303334,"teacher_disagreement_score":0.018083178,"about_ca_system_score_codex":0.0012397033,"about_ca_system_score_gemma":0.00087726477,"threshold_uncertainty_score":0.0956341},"labels":[],"label_agreement":null},{"id":"W3093632891","doi":"10.1515/em-2019-0021","title":"A comparison of approaches for estimating combined population attributable risks (PARs) for multiple risk factors","year":2020,"lang":"en","type":"article","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; McMaster University; Impact; Alberta Health Services","funders":"Canadian Cancer Society","keywords":"Statistics; Econometrics; Population; Estimation; Attributable risk; Risk factor; Relative risk; Risk assessment; Mathematics; Computer science; Medicine; Environmental health; Economics; Confidence interval","score_opus":0.8704649646198399,"score_gpt":0.6146697198316243,"score_spread":0.2557952447882156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3093632891","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009446812,0.0054391143,0.98160285,0.00049587974,0.0001817287,0.000646213,0.00036784465,0.00029928528,0.0015202381],"genre_scores_gemma":[0.15483803,0.0039192727,0.83629113,0.0004552569,0.00026234516,0.002467355,0.0005735353,0.00020246785,0.0009905794],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84954613,0.12679167,0.004553513,0.006802366,0.011766185,0.00054014823],"domain_scores_gemma":[0.6876945,0.28111038,0.010556173,0.009829878,0.010038023,0.00077112555],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10920968,0.0022272556,0.0036682244,0.008338238,0.0007518421,0.004044246,0.0050507886,0.0029818,0.003901362],"category_scores_gemma":[0.27840495,0.0018169795,0.0059977337,0.0052556624,0.0016839171,0.0037998236,0.0051546204,0.0037234875,0.0006369517],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023565656,0.0003193475,0.04104148,0.005362513,0.021237561,0.00038456943,0.0019884564,0.27992883,0.0013904672,0.076630235,0.004249995,0.56510997],"study_design_scores_gemma":[0.0007803004,0.0010430755,0.028177142,0.0032304006,0.0044703265,0.0009853335,0.0007045263,0.7859021,0.0021206243,0.1583723,0.013612563,0.0006013967],"about_ca_topic_score_codex":0.0073324386,"about_ca_topic_score_gemma":0.0077597178,"teacher_disagreement_score":0.89079034,"about_ca_system_score_codex":0.002728856,"about_ca_system_score_gemma":0.0039578294,"threshold_uncertainty_score":0.5775629},"labels":[],"label_agreement":null},{"id":"W3099982168","doi":"10.1214/23-sts889","title":"Causal Inference Methods for Combining Randomized Trials and Observational Studies: A Review","year":2024,"lang":"en","type":"review","venue":"Statistical Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":40,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Google (Canada)","funders":"National Institute on Aging; U.S. Food and Drug Administration","keywords":"Observational study; Causal inference; Inference; Randomized controlled trial; Econometrics; Computer science; Statistics; Medicine; Artificial intelligence; Mathematics; Internal medicine","score_opus":0.85000118132543,"score_gpt":0.7220045213661083,"score_spread":0.12799665995932175,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3099982168","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000044532255,0.9901912,0.00769327,0.00083354977,0.0002871299,0.00014573616,0.00011227945,0.000037830312,0.0006544126],"genre_scores_gemma":[0.0012058703,0.9840373,0.013234085,0.00048642387,0.000340642,0.00039162845,0.00010243634,0.000021824582,0.00017969584],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9805644,0.0120476615,0.0027801124,0.0010900749,0.003306838,0.00021078628],"domain_scores_gemma":[0.8738598,0.11693716,0.00351258,0.0016841749,0.003670159,0.00033604278],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.030786518,0.0020693166,0.0061954292,0.009688971,0.00063349603,0.0027953296,0.003909955,0.0034299935,0.009882323],"category_scores_gemma":[0.08855056,0.0013090925,0.0063159503,0.010921369,0.0018442317,0.003340766,0.0017627741,0.004144238,0.0023497965],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010409484,0.00005846084,0.0002992343,0.16575164,0.0028456333,0.00008969566,0.00015248699,0.0017849251,0.00013533983,0.02287331,0.01593625,0.7899689],"study_design_scores_gemma":[0.00038172884,0.00027714123,0.0022846628,0.27252468,0.011193364,0.001163357,0.00018062752,0.0031596085,0.00060541346,0.10394499,0.60407645,0.00020794106],"about_ca_topic_score_codex":0.003427737,"about_ca_topic_score_gemma":0.0036261603,"teacher_disagreement_score":0.9692135,"about_ca_system_score_codex":0.002965529,"about_ca_system_score_gemma":0.009011729,"threshold_uncertainty_score":0.16281658},"labels":[],"label_agreement":null},{"id":"W3105768632","doi":"10.1002/sim.8857","title":"Conflating marginal and conditional treatment effects: Comments on “Assessing the performance of population adjustment methods for anchored indirect comparisons: A simulation study”","year":2021,"lang":"en","type":"letter","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Engineering and Physical Sciences Research Council; Canadian Institutes of Health Research","keywords":"Inference; Marginal structural model; Econometrics; Marginal model; Population; Treatment effect; Causal inference; Statistics; Statistical inference; Computer science; Medicine; Mathematics; Artificial intelligence; Regression analysis","score_opus":0.20791701651492495,"score_gpt":0.5391972190249351,"score_spread":0.33128020251001017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3105768632","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012291552,0.000663771,0.00049313187,0.9865866,0.011486241,0.000013976152,0.00006250168,0.000024071804,0.00054675137],"genre_scores_gemma":[0.0010370467,0.00029285924,0.0006971334,0.9857789,0.011396575,0.000057934474,0.000013593766,0.000030325764,0.000695595],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93768835,0.035859052,0.007845438,0.0046985685,0.011826186,0.0020822687],"domain_scores_gemma":[0.7575847,0.20616914,0.006066254,0.003351086,0.023811374,0.0030174446],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0668757,0.0014682127,0.0022997789,0.0011741358,0.006036915,0.0045557246,0.007324765,0.06753303,0.004877028],"category_scores_gemma":[0.32914245,0.0014782111,0.0034227334,0.0018435067,0.009829109,0.0075120064,0.0033686915,0.071105,0.0052292114],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006580007,0.000017929755,0.00027705324,0.000103960294,0.000017673745,0.00033021567,0.0003708015,0.00013142878,0.00008125744,0.006869944,0.986086,0.005648015],"study_design_scores_gemma":[0.00025764084,0.00012490283,0.0013061704,0.0015938642,0.00011794174,0.0013515439,0.00097467983,0.0018592135,0.00081802625,0.045275852,0.9460632,0.00025693123],"about_ca_topic_score_codex":0.020905731,"about_ca_topic_score_gemma":0.028348474,"teacher_disagreement_score":0.9331243,"about_ca_system_score_codex":0.008353424,"about_ca_system_score_gemma":0.013725857,"threshold_uncertainty_score":0.35367674},"labels":[],"label_agreement":null},{"id":"W3107334064","doi":"10.1515/ijb-2020-0073","title":"Doubly robust adaptive LASSO for effect modifier discovery","year":2022,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal","funders":"Canadian Institutes of Health Research","keywords":"Counterfactual thinking; Lasso (programming language); Propensity score matching; Outcome (game theory); Observational study; Covariate; Marginal structural model; Set (abstract data type); Conditional expectation","score_opus":0.13319771240494277,"score_gpt":0.3993879005224699,"score_spread":0.26619018811752715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3107334064","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012428348,0.0005133891,0.9967141,0.00038611688,0.00006443891,0.00009214195,0.00023494738,0.00051862944,0.00023340575],"genre_scores_gemma":[0.10107954,0.0011211112,0.88751894,0.0010091603,0.0007256969,0.0022623884,0.0024831463,0.00076745125,0.0030326014],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97781634,0.017154384,0.00074680586,0.0017415348,0.0019882654,0.00055274146],"domain_scores_gemma":[0.96013725,0.032084975,0.0024039166,0.0032480867,0.0016163207,0.0005093478],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036002316,0.0028389008,0.00508782,0.0022047122,0.0013202432,0.0023372509,0.0051599415,0.0027306462,0.0049808375],"category_scores_gemma":[0.047621954,0.0015213367,0.0033170874,0.0027526545,0.0022863443,0.0016156897,0.003984557,0.0073069585,0.0013096911],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000980876,0.00041606787,0.0069047324,0.0022168562,0.0029547329,0.0007440254,0.00038692442,0.45243284,0.0039137434,0.17203002,0.028894829,0.32812434],"study_design_scores_gemma":[0.00018740217,0.00012198179,0.0005449261,0.00008508687,0.000099271354,0.00009200988,0.00002586183,0.9106457,0.0009751244,0.08288774,0.004284478,0.000050384235],"about_ca_topic_score_codex":0.0036066656,"about_ca_topic_score_gemma":0.004324423,"teacher_disagreement_score":0.036002316,"about_ca_system_score_codex":0.0012640246,"about_ca_system_score_gemma":0.005155745,"threshold_uncertainty_score":0.19040078},"labels":[],"label_agreement":null},{"id":"W3108260275","doi":"10.5539/ijsp.v10n1p40","title":"Causal Subclassification Tree Algorithm and Robust Causal Effect Estimation via Subclassification","year":2020,"lang":"en","type":"article","venue":"International Journal of Statistics and Probability","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Japan Society for the Promotion of Science","keywords":"Estimator; Propensity score matching; Mathematics; Causal inference; Observational study; Consistency (knowledge bases); Confounding; Statistics; Econometrics; Weighting; Inverse probability weighting; Medicine; Discrete mathematics","score_opus":0.09041582394700515,"score_gpt":0.3658715823730794,"score_spread":0.2754557584260742,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3108260275","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021241002,0.00021126171,0.99653566,0.00012768731,0.0000227694,0.00009761448,0.000104401566,0.00027137357,0.0005050962],"genre_scores_gemma":[0.07178066,0.0004948734,0.92296976,0.00030318092,0.00009508303,0.0005945553,0.001345326,0.00021287568,0.0022037667],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9965383,0.0016544753,0.0002585269,0.0006974684,0.00063303084,0.00021819868],"domain_scores_gemma":[0.98528165,0.009505607,0.0009380387,0.0020651796,0.001885405,0.00032424877],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011339646,0.00077132,0.0023376134,0.0034324701,0.0011064954,0.0017213622,0.002441809,0.0017776528,0.0058363494],"category_scores_gemma":[0.033431258,0.00076242536,0.0022943278,0.002930611,0.0011912715,0.0032840755,0.002652642,0.0037043865,0.0014314082],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003874163,0.00020720277,0.008539765,0.00038478177,0.00036495642,0.00025502156,0.000649401,0.11687709,0.0019520473,0.26277298,0.010553965,0.59705544],"study_design_scores_gemma":[0.00007724296,0.000056849192,0.001057044,0.00010465594,0.000096396114,0.00014468147,0.00006298071,0.7470208,0.0010711256,0.24051858,0.009760819,0.00002877605],"about_ca_topic_score_codex":0.0048615127,"about_ca_topic_score_gemma":0.003690082,"teacher_disagreement_score":0.011339646,"about_ca_system_score_codex":0.0012588929,"about_ca_system_score_gemma":0.0029933539,"threshold_uncertainty_score":0.059970498},"labels":[],"label_agreement":null},{"id":"W3108536614","doi":"10.1093/ehjci/ehaa946.3551","title":"Effect of immortal time bias on the association between atrial fibrillation ablation and incident stroke: a meta-analysis","year":2020,"lang":"en","type":"article","venue":"European Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Montreal Heart Institute","funders":"","keywords":"Medicine; Observational study; Atrial fibrillation; Randomized controlled trial; Stroke (engine); Meta-analysis; Internal medicine; Cardiology; Catheter ablation; Ablation; Subgroup analysis; Cryoablation; Epidemiology; Surgery","score_opus":0.3201336256414198,"score_gpt":0.41296496097908386,"score_spread":0.09283133533766408,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3108536614","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014116042,0.973332,0.006913287,0.0009168697,0.0010689943,0.00076191884,0.001957519,0.00014435567,0.0007889738],"genre_scores_gemma":[0.5742274,0.39516923,0.015781745,0.0029061513,0.001892382,0.0053576087,0.0032465835,0.00022026619,0.0011985954],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.9537052,0.029787002,0.00902624,0.003676531,0.002971295,0.00083371176],"domain_scores_gemma":[0.8559207,0.124299325,0.009883081,0.0052987114,0.0039428836,0.0006553486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.054602094,0.0029798949,0.015814109,0.007181987,0.0007389502,0.0052996296,0.0034005516,0.0032101977,0.004921716],"category_scores_gemma":[0.10950169,0.0016261092,0.08119243,0.0077551953,0.001182107,0.002836522,0.002378204,0.0033498632,0.00047155362],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025955613,0.000018665616,0.007965094,0.06690518,0.915413,0.000098889715,0.000050762024,0.00076331635,0.00009603604,0.00026301396,0.00055193005,0.0052785287],"study_design_scores_gemma":[0.00073965907,0.00012263317,0.0032414827,0.00558508,0.98795426,0.00006600526,0.00001733929,0.00055289286,0.00010042378,0.0007228685,0.0008724898,0.000024769402],"about_ca_topic_score_codex":0.003993518,"about_ca_topic_score_gemma":0.004462714,"teacher_disagreement_score":0.9453979,"about_ca_system_score_codex":0.0023060027,"about_ca_system_score_gemma":0.003092397,"threshold_uncertainty_score":0.28876698},"labels":[],"label_agreement":null},{"id":"W3108711748","doi":"10.1038/s41366-020-00720-2","title":"Selection bias can creep into unselected cohorts and produce counterintuitive findings","year":2020,"lang":"en","type":"letter","venue":"International Journal of Obesity","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Counterintuitive; Selection bias; Selection (genetic algorithm); Medicine; Demography; Internal medicine; Computer science; Physics; Pathology; Artificial intelligence","score_opus":0.08674983111192126,"score_gpt":0.36616000392843073,"score_spread":0.2794101728165095,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3108711748","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036915464,0.0012603236,0.014236068,0.96658874,0.010284612,0.00004850167,0.00022919562,0.00008624172,0.0035747464],"genre_scores_gemma":[0.10777405,0.0025599077,0.019611806,0.7920185,0.07254732,0.0003585521,0.00015869131,0.00023607918,0.0047351527],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9785373,0.014447236,0.0017249014,0.0022261306,0.0024988977,0.0005655402],"domain_scores_gemma":[0.57288677,0.40468508,0.004911835,0.010031234,0.005798136,0.0016868758],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.050121978,0.000782142,0.0015816438,0.0014260109,0.0014290934,0.0028684568,0.0024841262,0.01199919,0.0072098323],"category_scores_gemma":[0.34952343,0.00053347717,0.0010267411,0.0011648722,0.0061919396,0.0038112882,0.0017286176,0.01888452,0.0023237648],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007881925,0.00019170145,0.029097853,0.0007142442,0.0007873548,0.016328765,0.0022983693,0.0013978869,0.00064927136,0.23547997,0.5641972,0.14806923],"study_design_scores_gemma":[0.00055245945,0.000083152016,0.0049063526,0.0004298283,0.00023908996,0.0064191506,0.00061735604,0.0075029186,0.0006773831,0.89221185,0.08627493,0.00008546766],"about_ca_topic_score_codex":0.001741249,"about_ca_topic_score_gemma":0.0023696057,"teacher_disagreement_score":0.94987804,"about_ca_system_score_codex":0.0014389162,"about_ca_system_score_gemma":0.0014291934,"threshold_uncertainty_score":0.26507354},"labels":[],"label_agreement":null},{"id":"W3109567526","doi":"10.48550/arxiv.1907.13323","title":"Identifiability of causal effects with multiple causes and a binary outcome","year":2019,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Confounding; Outcome (game theory); Causal inference; Identifiability; Econometrics; Observational study; Inference; Latent variable; Probit; Probit model; Instrumental variable; Causal model; Statistics; Computer science; Mathematics; Artificial intelligence","score_opus":0.17387976192086851,"score_gpt":0.2878945172744816,"score_spread":0.1140147553536131,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3109567526","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0068580233,0.00095187704,0.98686117,0.002790158,0.00012047178,0.00021354876,0.00033011613,0.00012104576,0.0017535221],"genre_scores_gemma":[0.426164,0.002835489,0.5585245,0.0027632765,0.0009022366,0.0021419066,0.0012053036,0.0001671933,0.0052960045],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92456,0.05172091,0.0037838884,0.010835617,0.007818656,0.0012808465],"domain_scores_gemma":[0.6282755,0.32317066,0.019047298,0.025713257,0.0031217274,0.0006715813],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.109560266,0.0016472915,0.0054561477,0.004030755,0.002235648,0.0046540806,0.005000785,0.0061373236,0.0074551436],"category_scores_gemma":[0.2703473,0.0020465117,0.005142443,0.0052637253,0.009345246,0.008483278,0.007946154,0.009730745,0.0010486146],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000120327546,0.00010199648,0.007003089,0.0008282063,0.0006537739,0.00048019673,0.0009067365,0.010220485,0.00030767857,0.9396698,0.001457874,0.038249794],"study_design_scores_gemma":[0.000056787776,0.000035807305,0.0010380676,0.00014705952,0.00013581714,0.00020666137,0.00008245578,0.021179715,0.00026824302,0.97483927,0.0019833408,0.000026745282],"about_ca_topic_score_codex":0.0037701281,"about_ca_topic_score_gemma":0.0021283168,"teacher_disagreement_score":0.109560266,"about_ca_system_score_codex":0.0029939802,"about_ca_system_score_gemma":0.0056633577,"threshold_uncertainty_score":0.579417},"labels":[],"label_agreement":null},{"id":"W3109871844","doi":"10.1093/ehjci/ehaa946.3010","title":"REDUCE-IT: accumulation of data across prespecified interim analyses to final results","year":2020,"lang":"en","type":"article","venue":"European Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Montreal Heart Institute","funders":"Amarin Pharma; Amarin Corporation","keywords":"Medicine; Clinical endpoint; Interim analysis; Myocardial infarction; Internal medicine; Randomized controlled trial; Placebo","score_opus":0.9390778783731909,"score_gpt":0.6534559555338757,"score_spread":0.2856219228393152,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3109871844","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1326184,0.0023983766,0.78436846,0.0028683983,0.0025431036,0.037106253,0.014141848,0.00587316,0.018082054],"genre_scores_gemma":[0.5045357,0.00039209123,0.41467926,0.002466434,0.0006815571,0.06586585,0.006605585,0.0015689385,0.0032046891],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8795146,0.08993392,0.008321883,0.007889456,0.011620502,0.0027196244],"domain_scores_gemma":[0.7694131,0.13085885,0.01966038,0.06212941,0.0162661,0.0016721593],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17700708,0.0029064103,0.0035159413,0.0022533326,0.0013032418,0.0035609286,0.0020745886,0.0014553714,0.012132718],"category_scores_gemma":[0.28841755,0.0013192105,0.008958557,0.001553258,0.0014829541,0.002562496,0.0026790127,0.005830182,0.0027932222],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.135015,0.0049860356,0.046204384,0.0064565185,0.020989768,0.0007758576,0.0018317593,0.032898095,0.0112574585,0.037615463,0.07664294,0.62532675],"study_design_scores_gemma":[0.0592207,0.10478684,0.10335544,0.0044568805,0.03447194,0.0014555333,0.0011373198,0.17939197,0.12801789,0.19238804,0.19027066,0.0010468262],"about_ca_topic_score_codex":0.00039446505,"about_ca_topic_score_gemma":0.00049595203,"teacher_disagreement_score":0.17700708,"about_ca_system_score_codex":0.0013721798,"about_ca_system_score_gemma":0.0049251905,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W3109899857","doi":"10.3390/jrfm13110290","title":"Propensity Score Weighting with Mismeasured Covariates: An Application to Two Financial Literacy Interventions","year":2020,"lang":"en","type":"article","venue":"Journal of risk and financial management","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Propensity score matching; Covariate; Estimator; Inverse probability weighting; Econometrics; Average treatment effect; Statistics; Weighting; Instrumental variable; Causal inference; Kernel density estimation; Kernel (algebra); Computer science; Mathematics; Medicine","score_opus":0.09952639413194576,"score_gpt":0.35829909527204684,"score_spread":0.2587727011401011,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3109899857","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019218432,0.0002975875,0.97825235,0.00086306705,0.000057592337,0.00036285468,0.000073209165,0.0001469078,0.00072790385],"genre_scores_gemma":[0.4007943,0.0006500016,0.59375453,0.0005970566,0.00016336558,0.0012012491,0.00014896721,0.00006640849,0.0026241383],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98092306,0.015945131,0.00048504473,0.001082958,0.0012419709,0.00032178656],"domain_scores_gemma":[0.938795,0.0509929,0.0030729144,0.004613121,0.0019476624,0.00057853747],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.038592596,0.00082593766,0.001934597,0.0020008637,0.00084037037,0.0013708749,0.0025401444,0.003167251,0.005089276],"category_scores_gemma":[0.113694355,0.0005073018,0.0019558764,0.002600151,0.0028116049,0.0021315983,0.0034439268,0.003113025,0.00030403823],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006839713,0.00077223487,0.020482551,0.0005521188,0.0008224883,0.0007851277,0.0013675521,0.13456632,0.0010624459,0.4720697,0.002698268,0.3641373],"study_design_scores_gemma":[0.0004817965,0.00047930435,0.0058524543,0.0001866647,0.00025103346,0.000341315,0.00021236714,0.5878458,0.0010103585,0.3972872,0.0059611327,0.000090586385],"about_ca_topic_score_codex":0.004781141,"about_ca_topic_score_gemma":0.002959221,"teacher_disagreement_score":0.9614074,"about_ca_system_score_codex":0.0014472773,"about_ca_system_score_gemma":0.0030067733,"threshold_uncertainty_score":0.2040996},"labels":[],"label_agreement":null},{"id":"W3111500892","doi":"10.1002/cjs.11685","title":"Better experimental design by hybridizing binary matching with imbalance optimization","year":2022,"lang":"en","type":"preprint","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"United States-Israel Binational Science Foundation","keywords":"Covariate; Estimator; Matching (statistics); Extant taxon; Statistics; Robustness (evolution); Heuristic; Mathematics; Design of experiments; Mean squared error; Word error rate; Greedy algorithm; Binary number; Set (abstract data type); Computer science; Mathematical optimization; Algorithm; Artificial intelligence","score_opus":0.09052559107560555,"score_gpt":0.33924781787011926,"score_spread":0.24872222679451372,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3111500892","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008327113,0.000081785176,0.98928386,0.00030390415,0.000070531874,0.00078589696,0.000097452416,0.00044879527,0.00060061255],"genre_scores_gemma":[0.08591064,0.000055913257,0.9092721,0.00047505196,0.0000808333,0.0029751135,0.00016747882,0.0001750379,0.0008878102],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9079776,0.07663053,0.0024846524,0.006215421,0.0055723973,0.0011194487],"domain_scores_gemma":[0.9066472,0.05911216,0.008253989,0.019338895,0.004998474,0.0016492786],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06897121,0.0014857776,0.0030899518,0.0019646594,0.001133954,0.0018552224,0.0036755567,0.0026105533,0.010338804],"category_scores_gemma":[0.13500902,0.0014098067,0.0019792684,0.0024059846,0.0028309824,0.0026072022,0.0052733663,0.0030319316,0.0019522225],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008763493,0.002879408,0.008347336,0.0013289275,0.0008827881,0.00016947332,0.0011121155,0.11356695,0.024802439,0.25338095,0.007100901,0.5776652],"study_design_scores_gemma":[0.004588036,0.0039798017,0.0055345595,0.00019994321,0.0003690595,0.00015394727,0.00012513153,0.47052705,0.016743777,0.48087895,0.016722593,0.00017720035],"about_ca_topic_score_codex":0.00064166647,"about_ca_topic_score_gemma":0.00071381236,"teacher_disagreement_score":0.06897121,"about_ca_system_score_codex":0.001892815,"about_ca_system_score_gemma":0.0031160037,"threshold_uncertainty_score":0.36475897},"labels":[],"label_agreement":null},{"id":"W3112629828","doi":"10.48550/arxiv.2012.05849","title":"The Promises of Parallel Outcomes","year":2020,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Causal inference; Identifiability; Conditional independence; Observational study; Identification (biology); Key (lock); Computer science; Nonparametric statistics; Inference; Confounding; Set (abstract data type); Contrast (vision); Causal model; Independence (probability theory); Parametric statistics; Econometrics; Machine learning; Instrumental variable; Outcome (game theory); Artificial intelligence; Mathematics; Statistics","score_opus":0.3713705675728355,"score_gpt":0.3073641142223964,"score_spread":0.06400645335043909,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3112629828","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012129198,0.002489824,0.9322748,0.030345496,0.00057499594,0.00023270275,0.0007799206,0.0002805411,0.020892499],"genre_scores_gemma":[0.57288086,0.0043860623,0.40021506,0.008113496,0.0026410343,0.0018469509,0.0009941561,0.00046546836,0.008456864],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94234836,0.04150141,0.0015500562,0.006824206,0.00688268,0.00089340593],"domain_scores_gemma":[0.7583356,0.18256654,0.013066201,0.036118895,0.007881607,0.0020312069],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08158701,0.0014663711,0.0026337036,0.0022727598,0.0026624252,0.0056639267,0.0036450706,0.0040342575,0.012181337],"category_scores_gemma":[0.23896924,0.0013027001,0.0030027567,0.0030599264,0.012719767,0.017442698,0.0110031925,0.012714804,0.0015783859],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000872849,0.000038068432,0.0018447224,0.00013900586,0.00010872627,0.00009388912,0.000431002,0.0024123173,0.000072580675,0.9655425,0.0016601465,0.027569722],"study_design_scores_gemma":[0.000024975956,0.000019474384,0.00033133442,0.000050932387,0.000023893803,0.00003822044,0.000041784988,0.0042112474,0.00008675375,0.9912799,0.0038818258,0.000009637127],"about_ca_topic_score_codex":0.0024969464,"about_ca_topic_score_gemma":0.0013083434,"teacher_disagreement_score":0.08158701,"about_ca_system_score_codex":0.0028964614,"about_ca_system_score_gemma":0.005581299,"threshold_uncertainty_score":0.4314785},"labels":[],"label_agreement":null},{"id":"W3112964578","doi":"10.1161/circulationaha.120.051718","title":"Emulating Randomized Clinical Trials With Nonrandomized Real-World Evidence Studies","year":2020,"lang":"en","type":"article","venue":"Circulation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":297,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Heart, Lung, and Blood Institute; McGill University; National Institute on Aging; Harvard University; Vanderbilt University","keywords":"Medicine; Randomized controlled trial; Confounding; Propensity score matching; Hazard ratio; Placebo; Clinical trial; Clinical endpoint; Research design; Proxy (statistics); Clinical study design; Confidence interval; Internal medicine; Statistics; Alternative medicine","score_opus":0.7113316494914241,"score_gpt":0.5902829400891217,"score_spread":0.12104870940230239,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3112964578","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013259204,0.0062817307,0.9239872,0.0047478257,0.0020324741,0.044604644,0.0010707653,0.0008312997,0.003184829],"genre_scores_gemma":[0.121333994,0.001659505,0.8086676,0.0027230328,0.0007665109,0.06374163,0.00065774145,0.00014727961,0.00030273062],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.053022627,0.8649918,0.0505246,0.012901047,0.017879901,0.000680089],"domain_scores_gemma":[0.038632266,0.8140991,0.049699325,0.08574565,0.011102085,0.0007216009],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.83198893,0.0047136466,0.009840949,0.01134424,0.0016144702,0.012883265,0.011915133,0.008400866,0.007398614],"category_scores_gemma":[0.9054288,0.005331047,0.014386622,0.008763396,0.013117733,0.012690836,0.010437208,0.008229705,0.0018845334],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.026382398,0.00264973,0.043807764,0.06881231,0.07255123,0.0013980266,0.006214097,0.12634067,0.0026022901,0.27406865,0.01117268,0.36400023],"study_design_scores_gemma":[0.040038235,0.017352799,0.012603913,0.029058112,0.025150621,0.0012358051,0.0011130013,0.22041568,0.009435215,0.56548756,0.07704242,0.0010667131],"about_ca_topic_score_codex":0.00077809487,"about_ca_topic_score_gemma":0.0007830357,"teacher_disagreement_score":0.16801107,"about_ca_system_score_codex":0.0076186243,"about_ca_system_score_gemma":0.012481897,"threshold_uncertainty_score":0.2071876},"labels":[],"label_agreement":null},{"id":"W3114661150","doi":"10.1515/em-2019-0037","title":"Population attributable fractions for continuously distributed exposures","year":2020,"lang":"en","type":"article","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Population Health Research Institute","funders":"Health Research Board","keywords":"Econometrics; Inference; Categorical variable; Categorization; Population; Statistics; Estimator; Risk factor; Causal inference; Attributable risk; Computer science; Mathematics; Medicine; Environmental health; Artificial intelligence","score_opus":0.580190986490552,"score_gpt":0.5732593142264173,"score_spread":0.006931672264134714,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3114661150","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019406138,0.0013556683,0.9738897,0.0010916603,0.00011652919,0.000113054535,0.0005583264,0.00023151933,0.0032374284],"genre_scores_gemma":[0.730569,0.001960304,0.2610164,0.00054188096,0.00038704523,0.00078021444,0.0009742474,0.00015479718,0.0036160506],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9896494,0.0070351167,0.0003814119,0.0012753415,0.0014449584,0.00021377056],"domain_scores_gemma":[0.93017334,0.05735177,0.0041287486,0.006473489,0.0016536214,0.00021907395],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020098168,0.0006453395,0.0009604974,0.0037863513,0.00045461784,0.0020184028,0.001753297,0.0015214324,0.006863339],"category_scores_gemma":[0.11705905,0.00028416252,0.0014584215,0.0023689622,0.0025369206,0.003301608,0.001719821,0.0029411593,0.0006703342],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000088764835,0.00007354597,0.02334411,0.00036276595,0.00041998873,0.00020930768,0.0005702344,0.0733363,0.00061033515,0.79878503,0.00464957,0.09755012],"study_design_scores_gemma":[0.000023576844,0.000074041694,0.00695638,0.0003227015,0.00009800927,0.00022677772,0.00015630992,0.09852201,0.0006007258,0.884775,0.0082062045,0.00003826823],"about_ca_topic_score_codex":0.0017402994,"about_ca_topic_score_gemma":0.0010876387,"teacher_disagreement_score":0.020098168,"about_ca_system_score_codex":0.0011268927,"about_ca_system_score_gemma":0.00083841034,"threshold_uncertainty_score":0.10629052},"labels":[],"label_agreement":null},{"id":"W3115153714","doi":"10.1093/ije/dyaa251","title":"Analytical approaches to minimizing immeasurable time bias in cohort studies","year":2020,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"McGill University","keywords":"Medicine; Hazard ratio; Medical prescription; Pharmacoepidemiology; Confidence interval; Proportional hazards model; Cohort study; Gold standard (test); Emergency medicine; Statistics; Internal medicine; Pharmacology; Mathematics","score_opus":0.8518547459120639,"score_gpt":0.5325737713499968,"score_spread":0.31928097456206705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3115153714","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003747698,0.0037583117,0.9873037,0.002264156,0.00042285764,0.0013442207,0.00026312505,0.00020755736,0.00068835914],"genre_scores_gemma":[0.12608324,0.0026542933,0.86039156,0.0019679114,0.0008347399,0.00709513,0.00034835815,0.00015884668,0.00046587654],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.43124133,0.51470697,0.021634236,0.012659759,0.018504124,0.0012534687],"domain_scores_gemma":[0.18953936,0.702628,0.035823762,0.053231534,0.017863106,0.0009142634],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5081821,0.004065569,0.0039037184,0.008319908,0.002230991,0.004878639,0.00845795,0.0051632444,0.0020984926],"category_scores_gemma":[0.75046873,0.0026362801,0.00786966,0.008572288,0.0061638546,0.0034701843,0.00805083,0.0061803777,0.0004293368],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019289156,0.000494019,0.09804422,0.013317949,0.054364912,0.0015499544,0.0071906704,0.11648859,0.0021917855,0.32574305,0.009180471,0.3695055],"study_design_scores_gemma":[0.0013605568,0.0015635476,0.022045499,0.0045645544,0.011589987,0.0012047216,0.00089992513,0.20343436,0.004447746,0.7167748,0.031582218,0.00053204567],"about_ca_topic_score_codex":0.005070074,"about_ca_topic_score_gemma":0.0031628308,"teacher_disagreement_score":0.4918179,"about_ca_system_score_codex":0.003902333,"about_ca_system_score_gemma":0.009031147,"threshold_uncertainty_score":0.6064991},"labels":[],"label_agreement":null},{"id":"W3115405644","doi":"10.1515/ijb-2021-0072","title":"Increasing the efficiency of randomized trial estimates via linear adjustment for a prognostic score","year":2021,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research","keywords":"Covariate; Estimator; Statistics; Econometrics; Variance (accounting); Sample size determination; Mathematics; Standard error; Delta method","score_opus":0.09452364034429618,"score_gpt":0.4134439329947414,"score_spread":0.31892029265044525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3115405644","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006991232,0.00037151968,0.99000204,0.0010207818,0.00006852692,0.0001377886,0.000056465546,0.00042106365,0.000930616],"genre_scores_gemma":[0.4392724,0.00047265922,0.5560738,0.00089508254,0.00027602198,0.0008891275,0.00019812532,0.00035297166,0.0015697918],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94391006,0.048489235,0.0015206094,0.00230128,0.0032233035,0.00055549986],"domain_scores_gemma":[0.71861744,0.24236651,0.011398118,0.021313688,0.005746598,0.0005576182],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06531253,0.0010923195,0.0015149342,0.00165056,0.00044591224,0.0015393917,0.002191056,0.0014447812,0.0029761826],"category_scores_gemma":[0.3130362,0.00080104097,0.0013256465,0.0016060859,0.0020558762,0.0024572543,0.002531382,0.0030689936,0.00079950556],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019221887,0.0003838214,0.021837732,0.0010966033,0.0018734148,0.0003831901,0.00037487227,0.38044974,0.008198875,0.21882665,0.008307898,0.35634506],"study_design_scores_gemma":[0.00034188043,0.00039261472,0.0030062536,0.000194252,0.00023637117,0.00011264595,0.000033189273,0.8829432,0.004254907,0.10500576,0.0034301255,0.000048803544],"about_ca_topic_score_codex":0.0014915158,"about_ca_topic_score_gemma":0.0010993953,"teacher_disagreement_score":0.9346875,"about_ca_system_score_codex":0.0015419085,"about_ca_system_score_gemma":0.0032833,"threshold_uncertainty_score":0.3454098},"labels":[],"label_agreement":null},{"id":"W3116999980","doi":"10.47004/wp.cem.2021.1921","title":"Discordant relaxations of misspecified models","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Mathematics; Econometrics; Environmental science; Statistics","score_opus":0.39898016621774574,"score_gpt":0.4477138834706251,"score_spread":0.04873371725287934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3116999980","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0846748,0.0005693594,0.90265155,0.001153346,0.00004887551,0.000099610326,0.00054582965,0.00026297919,0.009993666],"genre_scores_gemma":[0.7870188,0.00056034443,0.20606959,0.00059791026,0.00014858982,0.00043179057,0.0012942628,0.0002869709,0.003591744],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9833492,0.007845997,0.00097310997,0.0037230595,0.0027510158,0.0013575814],"domain_scores_gemma":[0.87494576,0.09071759,0.0151560465,0.013920397,0.0035733734,0.0016868636],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025084633,0.0014892359,0.0030235124,0.0034512202,0.0020426451,0.0046152268,0.0056889486,0.0025083167,0.005744767],"category_scores_gemma":[0.13592511,0.0020992225,0.0037643677,0.002277905,0.0061513013,0.008980628,0.008029693,0.009940754,0.0004269089],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033056867,0.00013270987,0.004380785,0.00033293615,0.00022794308,0.0004754286,0.00156586,0.1669484,0.0012121083,0.80203813,0.0021688177,0.020186273],"study_design_scores_gemma":[0.00004106352,0.000090804664,0.0013648814,0.00014025714,0.00006211569,0.00021376688,0.0003085629,0.31085196,0.0014098063,0.6828239,0.002640395,0.00005241821],"about_ca_topic_score_codex":0.0024762258,"about_ca_topic_score_gemma":0.0017989674,"teacher_disagreement_score":0.025084633,"about_ca_system_score_codex":0.0035963596,"about_ca_system_score_gemma":0.0017641312,"threshold_uncertainty_score":0.13266176},"labels":[],"label_agreement":null},{"id":"W3119329857","doi":"10.1002/cjs.11586","title":"An approximate Bayesian inference on propensity score estimation under unit nonresponse","year":2021,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Frequentist inference; Statistics; Propensity score matching; Bayesian probability; Econometrics; Mathematics; Weighting; Statistical inference; Bayesian inference; Computer science","score_opus":0.23824473122960516,"score_gpt":0.3957939407962062,"score_spread":0.15754920956660107,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3119329857","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037993381,0.00017825345,0.9950134,0.00021986943,0.000021611713,0.000056395504,0.0000532448,0.00007199714,0.0005858574],"genre_scores_gemma":[0.3097215,0.0017282843,0.681792,0.0005543053,0.0003504181,0.0011434172,0.00069690694,0.00013275293,0.003880375],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9836046,0.012284824,0.00050548126,0.0014331369,0.0018313257,0.00034059875],"domain_scores_gemma":[0.958654,0.03356209,0.0021646195,0.0027389997,0.0025752212,0.00030513204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022689804,0.00086896494,0.002213717,0.0024173683,0.0011208641,0.001607948,0.002825633,0.0017679367,0.0045897746],"category_scores_gemma":[0.11093979,0.001036851,0.0017399291,0.0036796622,0.001946974,0.0037463973,0.0026380986,0.002817169,0.0007253914],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018763405,0.00015457526,0.0059841992,0.00053523225,0.00039318102,0.00025988746,0.0007366966,0.22324564,0.0008399325,0.52789885,0.0039430754,0.23582113],"study_design_scores_gemma":[0.000094206815,0.00006912941,0.0018184504,0.0001114643,0.00011678964,0.0001407887,0.00009660352,0.6251414,0.00045343768,0.3681199,0.0037887113,0.000049118185],"about_ca_topic_score_codex":0.010337676,"about_ca_topic_score_gemma":0.006640578,"teacher_disagreement_score":0.022689804,"about_ca_system_score_codex":0.0016899736,"about_ca_system_score_gemma":0.0033510765,"threshold_uncertainty_score":0.11999661},"labels":[],"label_agreement":null},{"id":"W3121695905","doi":"10.1162/rest_a_00622","title":"Testing Local Average Treatment Effect Assumptions","year":2016,"lang":"en","type":"preprint","venue":"The Review of Economics and Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Intersection (aeronautics); Sign (mathematics); Instrumental variable; Econometrics; Monotonic function; Set (abstract data type); Identification (biology); Computer science; Algorithm; Mathematics; Engineering; Programming language","score_opus":0.15950357126852724,"score_gpt":0.4066505584022922,"score_spread":0.24714698713376496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3121695905","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10280106,0.0011328107,0.86234045,0.006861991,0.0005993845,0.0023744502,0.0030942159,0.00068638916,0.02010921],"genre_scores_gemma":[0.84721196,0.00040082377,0.13367632,0.0036872851,0.0007131521,0.008517509,0.002149866,0.00018887191,0.0034542445],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.80873626,0.14313713,0.007610622,0.022316126,0.014150132,0.0040497957],"domain_scores_gemma":[0.3659278,0.54207456,0.028926456,0.05063705,0.010095568,0.0023385359],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14474809,0.0013108461,0.005411053,0.0021250814,0.0035002455,0.0045291283,0.0073551717,0.005500036,0.027936665],"category_scores_gemma":[0.5097785,0.00097395986,0.004973637,0.0029630049,0.009527627,0.011099469,0.0068794303,0.008384329,0.002527662],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003035286,0.0012647454,0.09728664,0.0017186895,0.0030651665,0.0010999684,0.0036171463,0.01843264,0.0011454914,0.7228084,0.008786364,0.13773942],"study_design_scores_gemma":[0.001666194,0.0026109482,0.026713865,0.00069962814,0.0012942838,0.00073479646,0.0019881988,0.08382901,0.0042721895,0.861167,0.014862461,0.00016140906],"about_ca_topic_score_codex":0.002457141,"about_ca_topic_score_gemma":0.0015209073,"teacher_disagreement_score":0.8552519,"about_ca_system_score_codex":0.0022863834,"about_ca_system_score_gemma":0.0053145643,"threshold_uncertainty_score":0.7655102},"labels":[],"label_agreement":null},{"id":"W3122218197","doi":"10.1287/ijds.2022.0020","title":"A Robust Approach to Quantifying Uncertainty in Matching Problems of Causal Inference","year":2022,"lang":"en","type":"article","venue":"INFORMS Journal on Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Causal inference; Matching (statistics); Test statistic; Inference; Computer science; Set (abstract data type); Statistical hypothesis testing; Observational study; Type I and type II errors; Randomized experiment; Statistic; Econometrics; Statistics; Mathematics; Artificial intelligence","score_opus":0.4344220118695823,"score_gpt":0.4456203986695917,"score_spread":0.011198386800009397,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3122218197","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00090841844,0.00031354427,0.9968586,0.00052715105,0.00004915802,0.0000888045,0.00009183735,0.000069329544,0.0010931003],"genre_scores_gemma":[0.118596196,0.0012512602,0.8748273,0.0007903921,0.00060591067,0.0011656506,0.00041572878,0.00030582352,0.002041737],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9279459,0.055056453,0.0025198788,0.0062489416,0.0071889865,0.0010398056],"domain_scores_gemma":[0.65541875,0.30419257,0.016786978,0.015057604,0.0069626775,0.0015814445],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08018158,0.0033017744,0.004376442,0.006360155,0.001868334,0.006864818,0.0071204575,0.005143936,0.007010654],"category_scores_gemma":[0.27021793,0.0021439295,0.0050039985,0.006263815,0.011150347,0.008932039,0.0073600924,0.011040736,0.0009599934],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009281913,0.00007705051,0.0012839009,0.0005516757,0.00045266506,0.00015034196,0.00031267104,0.22907202,0.0004025117,0.7271062,0.0019383467,0.038559806],"study_design_scores_gemma":[0.000028438677,0.0000788225,0.00033681642,0.00013978558,0.000063732215,0.00005662809,0.000049164024,0.33609888,0.00051952,0.65980697,0.0027708684,0.000050339895],"about_ca_topic_score_codex":0.004369784,"about_ca_topic_score_gemma":0.001980791,"teacher_disagreement_score":0.08018158,"about_ca_system_score_codex":0.0066202767,"about_ca_system_score_gemma":0.00577404,"threshold_uncertainty_score":0.4240458},"labels":[],"label_agreement":null},{"id":"W3122538678","doi":"10.1108/s0731-905320170000038019?utm_campaign=repec&amp;wt.mc_id=repec","title":"The Devil is in the Tails: Regression Discontinuity Design with Measurement Error in the Assignment Variable","year":2016,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Regression discontinuity design; Covariate; Discontinuity (linguistics); Variable (mathematics); Identification (biology); Observational error; Instrumental variable; Econometrics; Omitted-variable bias; Statistics; Mathematics; Regression; Computer science","score_opus":0.18305358370719607,"score_gpt":0.37218072425919335,"score_spread":0.18912714055199728,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3122538678","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.057745535,0.00065330754,0.9352405,0.0018772429,0.00013111111,0.0004028409,0.000469142,0.00024318698,0.0032371632],"genre_scores_gemma":[0.84065753,0.0006738635,0.14892155,0.0007771811,0.0002105404,0.0014894643,0.00043142957,0.00007972235,0.006758674],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96340376,0.02903851,0.0011477546,0.0031072914,0.002232183,0.0010705071],"domain_scores_gemma":[0.78149545,0.18710805,0.013162134,0.01321249,0.0037876535,0.001234202],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.061030768,0.0008275771,0.003577121,0.0019455696,0.0012574267,0.0027838568,0.005174889,0.0038858014,0.0092687225],"category_scores_gemma":[0.1494519,0.0010819332,0.0018496007,0.0021904786,0.0045737014,0.002687832,0.0035346227,0.0055041765,0.00065098034],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011271818,0.0004916888,0.027684374,0.0005091838,0.0007608387,0.0008756385,0.0012355362,0.05837291,0.0012118282,0.839287,0.0028333578,0.06561054],"study_design_scores_gemma":[0.0005955156,0.0008994376,0.009579875,0.0003258641,0.00054131896,0.00029859113,0.00045835937,0.44155884,0.0018002859,0.53863174,0.0051780343,0.00013214807],"about_ca_topic_score_codex":0.0032944195,"about_ca_topic_score_gemma":0.0017096944,"teacher_disagreement_score":0.061030768,"about_ca_system_score_codex":0.0016332072,"about_ca_system_score_gemma":0.001836157,"threshold_uncertainty_score":0.32276535},"labels":[],"label_agreement":null},{"id":"W3122958054","doi":"10.1016/j.jeconom.2007.05.001","title":"Regression discontinuity designs: A guide to practice","year":2007,"lang":"en","type":"article","venue":"Journal of Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3773,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada; National Science Foundation","keywords":"Regression discontinuity design; Covariate; Econometrics; Discontinuity (linguistics); Regression; Value (mathematics); Regression analysis; Statistics; Mathematics; Computer science; Economics; Psychology","score_opus":0.4194458121712126,"score_gpt":0.48015923405399336,"score_spread":0.06071342188278078,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3122958054","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001812599,0.0016147216,0.9943152,0.0008057201,0.00014636853,0.0003941654,0.000272776,0.00084145577,0.001428357],"genre_scores_gemma":[0.0033979898,0.001869414,0.9906617,0.00030397586,0.00014818317,0.0019291703,0.00018156526,0.0004161349,0.00109197],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9579268,0.035193577,0.0021096305,0.0011679388,0.0033782166,0.00022386217],"domain_scores_gemma":[0.8458677,0.13599306,0.0019701382,0.007121723,0.008200283,0.00084704004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04673511,0.0029508783,0.0036601126,0.0044880738,0.0011978546,0.0057166275,0.0066332337,0.0052143345,0.016689561],"category_scores_gemma":[0.14464353,0.00446376,0.0025870109,0.004915842,0.0031726842,0.003209397,0.003226354,0.011405821,0.008301846],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040839807,0.0008483504,0.0017166404,0.003876817,0.00070636795,0.00063037465,0.0016463985,0.027226856,0.0020481555,0.34558645,0.1265098,0.48879534],"study_design_scores_gemma":[0.0010041837,0.00042492244,0.0013579887,0.0030152898,0.00045686797,0.0011750653,0.0006237741,0.1303616,0.0035307454,0.6651215,0.19258912,0.00033897645],"about_ca_topic_score_codex":0.0037807096,"about_ca_topic_score_gemma":0.005073522,"teacher_disagreement_score":0.04673511,"about_ca_system_score_codex":0.0016271183,"about_ca_system_score_gemma":0.0064113652,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"grok","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"},{"model":"opus","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W3123542241","doi":"10.1017/bpp.2020.24","title":"Successfully scaled solutions need not be homogenous","year":2020,"lang":"en","type":"article","venue":"Behavioural Public Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Scalability; Temptation; Context (archaeology); Computer science; Psychological intervention; Relevance (law); Intervention (counseling); Open research; Risk analysis (engineering); Data science; Process management; Psychology; Business; Medicine; Political science; World Wide Web; Social psychology; Nursing","score_opus":0.41364885089965364,"score_gpt":0.4161054610316193,"score_spread":0.002456610131965631,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3123542241","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.079866454,0.0028200839,0.7675162,0.055146217,0.0028604125,0.0060602073,0.0013872476,0.0018502676,0.0824929],"genre_scores_gemma":[0.5210755,0.00078790827,0.45461592,0.0076251384,0.00045002968,0.009431291,0.0005630921,0.0005990467,0.004852151],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.86216563,0.10209907,0.009019073,0.012141067,0.011840856,0.002734211],"domain_scores_gemma":[0.77639234,0.14504857,0.011906877,0.05376185,0.010994999,0.0018952765],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.113289416,0.001302707,0.0030011812,0.0018934835,0.0023448863,0.007410029,0.0031179462,0.0035358174,0.018666038],"category_scores_gemma":[0.35444957,0.0012288983,0.002426741,0.0019613535,0.0065925224,0.012293483,0.010819107,0.007085934,0.002801826],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005568284,0.00057983736,0.005666321,0.00160297,0.00090295327,0.00034341044,0.0029894304,0.014319526,0.0015643633,0.7545145,0.015030385,0.20192945],"study_design_scores_gemma":[0.00054515025,0.0003800015,0.0021559517,0.00068274984,0.00020225371,0.00009449293,0.0009865013,0.018576836,0.0009807965,0.9475592,0.027781019,0.000055001616],"about_ca_topic_score_codex":0.0015766,"about_ca_topic_score_gemma":0.0010798908,"teacher_disagreement_score":0.113289416,"about_ca_system_score_codex":0.003350968,"about_ca_system_score_gemma":0.0046910797,"threshold_uncertainty_score":0.59913886},"labels":[],"label_agreement":null},{"id":"W3123549106","doi":"10.1097/ede.0000000000001315","title":"Incremental Propensity Score Effects for Time-fixed Exposures","year":2021,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; University of California, Irvine; Northwestern University; University of Pittsburgh; University of Pennsylvania; National Institutes of Health; RTI International; Case Western Reserve University; National Science Foundation","keywords":"Propensity score matching; Causal inference; Medicine; Preeclampsia; Average treatment effect; Statistics; Odds ratio; Consistency (knowledge bases); Psychological intervention; Econometrics; Pregnancy; Demography; Mathematics; Internal medicine","score_opus":0.35652440237283917,"score_gpt":0.45002139779034983,"score_spread":0.09349699541751066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3123549106","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0128844725,0.00049924327,0.9818813,0.0004313147,0.00015617385,0.0007987427,0.0007985374,0.0004275078,0.0021227754],"genre_scores_gemma":[0.37932813,0.0010575665,0.609632,0.0006942745,0.00033432257,0.0034695424,0.0011475681,0.00022950453,0.0041070627],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97749627,0.01676715,0.00071680243,0.0024385836,0.0020881558,0.00049313414],"domain_scores_gemma":[0.9136638,0.06835048,0.004548484,0.0111239785,0.0019256978,0.0003875588],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05120098,0.0012442607,0.0013787473,0.0038039556,0.00054123957,0.0019886123,0.0026792726,0.0015505679,0.014275409],"category_scores_gemma":[0.15983814,0.000698228,0.0047795502,0.00326522,0.001989191,0.0037900996,0.0029060165,0.0040678824,0.000904274],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013604098,0.00035050584,0.046601072,0.0012829128,0.004402697,0.0004249299,0.0007856407,0.089050315,0.0012261656,0.55264956,0.0058008432,0.29606497],"study_design_scores_gemma":[0.0006230271,0.0012877428,0.030756293,0.00053633127,0.0030775766,0.00049873337,0.00015751098,0.26060683,0.0024382626,0.6744174,0.025433583,0.00016684442],"about_ca_topic_score_codex":0.0035491788,"about_ca_topic_score_gemma":0.0033701342,"teacher_disagreement_score":0.05120098,"about_ca_system_score_codex":0.0014002629,"about_ca_system_score_gemma":0.0022468057,"threshold_uncertainty_score":0.27077985},"labels":[],"label_agreement":null},{"id":"W3124305122","doi":"10.1002/mde.3496","title":"Test Sensitivity for Infection versus Infectiousness of SARS-CoV-2","year":2020,"lang":"en","type":"article","venue":"Managerial and Decision Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); False positive paradox; Test (biology); Coronavirus disease 2019 (COVID-19); Medicine; 2019-20 coronavirus outbreak; Virology; Statistics; Infectious disease (medical specialty); Biology; Internal medicine; Outbreak; Mathematics","score_opus":0.1855592832765327,"score_gpt":0.3868124033624004,"score_spread":0.2012531200858677,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3124305122","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7039989,0.0024008933,0.278728,0.0025072314,0.00039002558,0.00038498463,0.0021264672,0.0005926724,0.0088708745],"genre_scores_gemma":[0.9890338,0.00014218185,0.00879598,0.00026912245,0.00008435435,0.00007062065,0.0005576602,0.000034907687,0.0010113964],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.94698596,0.040224332,0.0019470927,0.0064584734,0.0029409225,0.001443278],"domain_scores_gemma":[0.33019546,0.6459002,0.0072599105,0.0129295625,0.0024328416,0.0012820583],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0766189,0.0015363379,0.0027713925,0.0030648136,0.00074719655,0.0033273848,0.002274208,0.003819072,0.00781546],"category_scores_gemma":[0.3165847,0.0009764262,0.0044994433,0.0011087873,0.0029151137,0.0035263044,0.0029769992,0.003986717,0.00051920017],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01476844,0.0014288359,0.4314827,0.0019570873,0.014940031,0.0023330592,0.0014245549,0.32313347,0.010906497,0.08021453,0.0038640213,0.113546774],"study_design_scores_gemma":[0.000599695,0.004073522,0.07993647,0.00024061222,0.0033451652,0.0022162676,0.00059494644,0.73419553,0.011330393,0.16068795,0.0026061716,0.0001732825],"about_ca_topic_score_codex":0.0014397283,"about_ca_topic_score_gemma":0.00075067446,"teacher_disagreement_score":0.0766189,"about_ca_system_score_codex":0.001331171,"about_ca_system_score_gemma":0.0013809563,"threshold_uncertainty_score":0.40520436},"labels":[],"label_agreement":null},{"id":"W3124523117","doi":"","title":"A Simple, Graphical Approach to Comparing Multiple Treatments","year":2017,"lang":"en","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; Toronto Metropolitan University","funders":"","keywords":"Spurious relationship; Graphical model; Resampling; Simple (philosophy); Computer science; Algorithm; Multiple comparisons problem; Zero (linguistics); Jackknife resampling; Mathematics; Machine learning; Statistics","score_opus":0.2667984675321099,"score_gpt":0.4595448809158001,"score_spread":0.1927464133836902,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3124523117","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001098232,0.00014459068,0.99466187,0.0006915358,0.00013256737,0.0003589576,0.0004165198,0.00046235227,0.0020334015],"genre_scores_gemma":[0.056891624,0.0002794687,0.9374199,0.0011043134,0.00018777946,0.0023893935,0.00035073626,0.00021891069,0.0011577989],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92112106,0.064579025,0.0017331662,0.0051229172,0.006643177,0.0008006196],"domain_scores_gemma":[0.8498831,0.11798174,0.008768402,0.01657099,0.0055156564,0.0012801447],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04645616,0.0021345385,0.0026152856,0.0050870455,0.0014139317,0.0038348981,0.0055356054,0.0035547868,0.026514078],"category_scores_gemma":[0.16312091,0.0009993884,0.003886839,0.0034930927,0.0048960927,0.005163085,0.004171884,0.0074518775,0.002922035],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00077343115,0.0004922643,0.0024887584,0.001412021,0.0010702317,0.0002504795,0.00084964803,0.031637613,0.0044152895,0.7159011,0.00949455,0.23121466],"study_design_scores_gemma":[0.00039939574,0.00053859066,0.0016749105,0.00019991692,0.0004083545,0.00020313506,0.00010027904,0.04522152,0.0020846082,0.9312282,0.017809087,0.00013194773],"about_ca_topic_score_codex":0.0016862442,"about_ca_topic_score_gemma":0.0019579653,"teacher_disagreement_score":0.04645616,"about_ca_system_score_codex":0.0026846142,"about_ca_system_score_gemma":0.0031821826,"threshold_uncertainty_score":0.24568659},"labels":[],"label_agreement":null},{"id":"W3124873071","doi":"10.1002/jae.2583","title":"Difference‐in‐differences when the treatment status is observed in only one period","year":2017,"lang":"en","type":"article","venue":"Journal of Applied Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Proxy (statistics); Conditional cash transfer; Estimator; Econometrics; Propensity score matching; Average treatment effect; Treatment effect; Difference in differences; Statistics; Time point; Instrumental variable; Mathematics; Economics; Medicine","score_opus":0.31502552485901403,"score_gpt":0.37108907204825997,"score_spread":0.056063547189245944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3124873071","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49978372,0.0009380287,0.48249212,0.0017403469,0.0011854905,0.0006765261,0.0041519455,0.00032482596,0.008707001],"genre_scores_gemma":[0.95268655,0.00020036186,0.040162552,0.00026570202,0.00017750957,0.00068251754,0.0015511119,0.000038779035,0.004234925],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9831964,0.011960985,0.0008547832,0.002102912,0.0012665944,0.00061829266],"domain_scores_gemma":[0.9429527,0.03729654,0.0053147315,0.012590668,0.0014798262,0.00036561646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017030392,0.00036188282,0.0011630402,0.00080220855,0.00045597114,0.0010209676,0.0018326542,0.001005973,0.007594214],"category_scores_gemma":[0.051113397,0.00037845602,0.0013988414,0.0008966394,0.0012879419,0.0009771074,0.0012110993,0.0019751799,0.00061673846],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004339416,0.0014029484,0.3831509,0.0011676606,0.005937561,0.0009078988,0.0018739197,0.038513914,0.0037926384,0.19070148,0.009214288,0.35899746],"study_design_scores_gemma":[0.00085630605,0.004114271,0.4099551,0.00058684073,0.0023720562,0.00080541224,0.0021061944,0.27303365,0.01895955,0.23020117,0.05664275,0.00036681132],"about_ca_topic_score_codex":0.0032468198,"about_ca_topic_score_gemma":0.0018193698,"teacher_disagreement_score":0.017030392,"about_ca_system_score_codex":0.0008701995,"about_ca_system_score_gemma":0.000830709,"threshold_uncertainty_score":0.09006637},"labels":[],"label_agreement":null},{"id":"W3124954008","doi":"10.2139/ssrn.3761992","title":"Prison Rehabilitation Programs: Efficiency and Targeting","year":2021,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Université de Montréal; Center for Interuniversity Research and Analysis on Organizations; Université du Québec; University of Toronto","funders":"Ministry of Public Security of the People's Republic of China","keywords":"Prison; Rehabilitation; Physical medicine and rehabilitation; Psychology; Medicine; Criminology; Physical therapy","score_opus":0.04727063454987291,"score_gpt":0.3631881595415629,"score_spread":0.31591752499169,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3124954008","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16724914,0.0016021554,0.78099173,0.00779783,0.00011687054,0.0007013928,0.0006331708,0.0007349184,0.04017279],"genre_scores_gemma":[0.92733157,0.00061442365,0.060244285,0.00029002954,0.0000878009,0.00035854962,0.00021279625,0.0001134289,0.010747066],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.98574454,0.01134018,0.00037572108,0.0008647797,0.0010520073,0.00062287],"domain_scores_gemma":[0.8999201,0.08643696,0.004263804,0.006020817,0.0026009805,0.00075730286],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015837153,0.00080164196,0.0025179356,0.0016144525,0.0013724602,0.0035498075,0.0022810912,0.002204512,0.011675141],"category_scores_gemma":[0.08722246,0.0007841027,0.0011123085,0.0020213104,0.001657508,0.005199034,0.00257272,0.0024182883,0.00072735833],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012695215,0.0013901846,0.024632096,0.00060684554,0.00049895124,0.00017953142,0.001486686,0.13306922,0.00080116146,0.5286739,0.008526145,0.2988658],"study_design_scores_gemma":[0.00026021255,0.00033394436,0.006210248,0.00013140206,0.000320752,0.00011087875,0.00082551694,0.3590367,0.0010120549,0.62807125,0.0036602763,0.000026807897],"about_ca_topic_score_codex":0.0065227,"about_ca_topic_score_gemma":0.0070730755,"teacher_disagreement_score":0.015837153,"about_ca_system_score_codex":0.0025673856,"about_ca_system_score_gemma":0.0058299066,"threshold_uncertainty_score":0.08375585},"labels":[],"label_agreement":null},{"id":"W3124998720","doi":"","title":"Population-Level Intervention and Information Collection in Dynamic Healthcare Policy","year":2017,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Markov decision process; Partially observable Markov decision process; Population; Health care; Monotonic function; Actuarial science; Intervention (counseling); Markov process; Computer science; Econometrics; Medicine; Mathematics; Economics; Statistics; Environmental health","score_opus":0.0840389501912132,"score_gpt":0.4337004996604655,"score_spread":0.34966154946925226,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3124998720","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011111235,0.0004121849,0.9791307,0.0035695555,0.00007376485,0.00035027915,0.00033602273,0.000112772264,0.004903521],"genre_scores_gemma":[0.67756236,0.0016105674,0.30888352,0.0012359736,0.0003221193,0.0022052447,0.00040183705,0.00008639895,0.007691997],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98600775,0.010043451,0.00038413669,0.0018140393,0.0008486993,0.00090193603],"domain_scores_gemma":[0.9616624,0.033447105,0.0026622012,0.000916349,0.0007131013,0.0005989972],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01798013,0.0016493864,0.0038211695,0.0017744403,0.0010484782,0.0030930336,0.003569493,0.004387368,0.0107624],"category_scores_gemma":[0.048802942,0.0018787894,0.0017800693,0.0020700947,0.0042219018,0.0051954226,0.0026504023,0.0043672477,0.0006265828],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012253148,0.00015537751,0.0008710292,0.0002038504,0.000112334026,0.00013660917,0.00015223584,0.4811554,0.00035438454,0.5046165,0.0008676756,0.011252075],"study_design_scores_gemma":[0.0001470576,0.00018358164,0.00040851222,0.00006444322,0.000049530114,0.000046306126,0.00005818934,0.51803964,0.0002872542,0.47834224,0.0023291814,0.000044095614],"about_ca_topic_score_codex":0.006653884,"about_ca_topic_score_gemma":0.004327272,"teacher_disagreement_score":0.01798013,"about_ca_system_score_codex":0.00648124,"about_ca_system_score_gemma":0.0069360007,"threshold_uncertainty_score":0.09508914},"labels":[],"label_agreement":null},{"id":"W3125018148","doi":"","title":"Program Quality and Treatment Completion for Youth Training Programs","year":2013,"lang":"en","type":"preprint","venue":"RePEc: Research Papers in Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Propensity score matching; Quality (philosophy); Training (meteorology); Psychology; Medicine; Physical therapy; Statistics; Mathematics; Geography","score_opus":0.5495414068579555,"score_gpt":0.5181398152830163,"score_spread":0.03140159157493916,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3125018148","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99292505,0.00052152964,0.0033234735,0.0008827855,0.000016725786,0.00012400202,0.001072592,0.00004667737,0.0010872291],"genre_scores_gemma":[0.99700385,0.00014280995,0.00090925075,0.00009042827,0.000020498186,0.00008273021,0.0007656323,0.00001912663,0.0009657924],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9926317,0.0045753303,0.0003434844,0.00069554563,0.0009029846,0.0008510012],"domain_scores_gemma":[0.92847663,0.031565286,0.031054595,0.0033833513,0.0017404495,0.0037797142],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0123846065,0.00026304112,0.0007195481,0.0011269549,0.00063882815,0.0013292201,0.0008965514,0.0009444859,0.009029051],"category_scores_gemma":[0.07761383,0.00031394997,0.0011866054,0.0017360928,0.00068957766,0.00089343154,0.0018330616,0.0019924187,0.00047507498],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018603717,0.0011983579,0.96302396,0.0001373761,0.000851947,0.00005155412,0.00065688236,0.004896371,0.0002473029,0.0012529755,0.0007363149,0.025086606],"study_design_scores_gemma":[0.00021120578,0.0010628434,0.98790437,0.00009769303,0.00033329145,0.00006820346,0.0004747157,0.0062193247,0.00039122332,0.0022056266,0.0010084226,0.0000231304],"about_ca_topic_score_codex":0.008441423,"about_ca_topic_score_gemma":0.009343683,"teacher_disagreement_score":0.0123846065,"about_ca_system_score_codex":0.0015399026,"about_ca_system_score_gemma":0.0014584103,"threshold_uncertainty_score":0.06549686},"labels":[],"label_agreement":null},{"id":"W3125772486","doi":"","title":"Estimating the Impact of an Improvement to a Revenue Management System: An Airline Application.","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Counterfactual thinking; Revenue; Econometrics; Computer science; Focus (optics); Value (mathematics); Revenue management; Operations research; Economics; Engineering; Finance; Machine learning","score_opus":0.14320608756952574,"score_gpt":0.3164780128141871,"score_spread":0.17327192524466134,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3125772486","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8114567,0.003749996,0.14230134,0.014120453,0.00042997996,0.00038918795,0.014682346,0.00095973397,0.011910316],"genre_scores_gemma":[0.96792823,0.00045931002,0.024885181,0.00032205123,0.00007735866,0.00013007491,0.0031959831,0.000049230384,0.0029525855],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99817586,0.0013235935,0.000034949822,0.00017701247,0.00019613815,0.000092477414],"domain_scores_gemma":[0.9754226,0.020660877,0.0015224961,0.0012352238,0.00084544765,0.00031334368],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005836584,0.00067559717,0.00046563102,0.00081871066,0.0005026955,0.00091161346,0.0014138301,0.0018858686,0.0077760317],"category_scores_gemma":[0.025783427,0.0002626279,0.00069238665,0.0013438495,0.0011253903,0.0012641101,0.00088113756,0.0022928624,0.00052839203],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014946943,0.0014859348,0.069129474,0.00048288863,0.00052094186,0.00048945897,0.00028953401,0.73496056,0.0008984186,0.065016024,0.043277092,0.081955],"study_design_scores_gemma":[0.00018144617,0.00023824777,0.017584296,0.000049955215,0.00009067304,0.000067446,0.00012716767,0.94152266,0.001217077,0.032136485,0.006747583,0.000037035585],"about_ca_topic_score_codex":0.038711913,"about_ca_topic_score_gemma":0.04961676,"teacher_disagreement_score":0.038711913,"about_ca_system_score_codex":0.0026423703,"about_ca_system_score_gemma":0.0010958617,"threshold_uncertainty_score":0.07697314},"labels":[],"label_agreement":null},{"id":"W3126063643","doi":"10.1093/ectj/utaa013","title":"Two-way exclusion restrictions in models with heterogeneous treatment effects","year":2020,"lang":"en","type":"article","venue":"Econometrics Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; National Natural Science Foundation of China","keywords":"Outcome (game theory); Estimator; Latent variable; Instrumental variable; Econometrics; Structural equation modeling; Mathematics; Treatment effect; Monotone polygon; Variable (mathematics); Selection (genetic algorithm); Contrast (vision); Statistics; Applied mathematics; Computer science; Medicine; Mathematical economics; Artificial intelligence; Mathematical analysis","score_opus":0.2922863835589675,"score_gpt":0.3783037642443129,"score_spread":0.08601738068534537,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3126063643","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030391717,0.00020407395,0.966459,0.0006674597,0.00004969782,0.00014506826,0.0002654214,0.00018706602,0.0016303799],"genre_scores_gemma":[0.7721192,0.00041256455,0.214275,0.0006830117,0.00028190843,0.0013603352,0.0010824923,0.00015331378,0.009632138],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9804673,0.014512341,0.0006859562,0.0021734603,0.0013169686,0.00084392074],"domain_scores_gemma":[0.9096304,0.07535094,0.0062695597,0.0063071074,0.0017516894,0.0006902287],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027745567,0.0007105058,0.0029402045,0.0016514702,0.0010685042,0.0022583555,0.0027720397,0.0019767513,0.0071539977],"category_scores_gemma":[0.073158026,0.0007931303,0.0026413314,0.001851411,0.0032772787,0.002956269,0.0033678128,0.0040793796,0.0005806933],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039403982,0.0002674927,0.02227079,0.00028173366,0.0008832165,0.0008853302,0.00093153474,0.15091051,0.0007583385,0.74374723,0.0029393167,0.07573054],"study_design_scores_gemma":[0.00018074135,0.00012436324,0.0066588437,0.00010646578,0.00017895552,0.00016990807,0.00019633943,0.48219863,0.0009814544,0.5025377,0.006593394,0.00007322067],"about_ca_topic_score_codex":0.0042484943,"about_ca_topic_score_gemma":0.003015183,"teacher_disagreement_score":0.027745567,"about_ca_system_score_codex":0.0012892154,"about_ca_system_score_gemma":0.0024000532,"threshold_uncertainty_score":0.1467343},"labels":[],"label_agreement":null},{"id":"W3126099178","doi":"10.2139/ssrn.1016131","title":"Limited Information Goodness-of-Fit Testing in Multidimensional Contingency Tables","year":2005,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Goodness of fit; Contingency table; Econometrics; Statistics; Computer science; Mathematics","score_opus":0.12984033626226146,"score_gpt":0.37228271373172384,"score_spread":0.24244237746946237,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3126099178","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10054743,0.000803669,0.89462996,0.00087481376,0.00010553606,0.00022053954,0.0006586893,0.00044113694,0.0017181725],"genre_scores_gemma":[0.8441636,0.00031846002,0.15299433,0.00023088303,0.00017578212,0.00085405505,0.0007715292,0.00007315519,0.00041824626],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7999481,0.1749218,0.005151998,0.012094738,0.0066045485,0.00127879],"domain_scores_gemma":[0.12181375,0.8528422,0.0059923106,0.016490204,0.0021029653,0.00075848564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.115194395,0.0016463883,0.0051957406,0.005104042,0.002268019,0.00444082,0.0064174677,0.003235265,0.00964337],"category_scores_gemma":[0.5413933,0.0014989611,0.0040789437,0.00655452,0.006293658,0.008898632,0.003959364,0.0059670955,0.00051530276],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0041305814,0.0010165499,0.13001134,0.002326816,0.0074487124,0.0033432161,0.0035991461,0.18836491,0.00091585563,0.44213998,0.0050802827,0.21162261],"study_design_scores_gemma":[0.00045745532,0.00081787666,0.00956176,0.00024618558,0.0006312221,0.00066665513,0.0005117814,0.41534612,0.0005104709,0.56997114,0.0011792122,0.00010009449],"about_ca_topic_score_codex":0.001495639,"about_ca_topic_score_gemma":0.0012455685,"teacher_disagreement_score":0.115194395,"about_ca_system_score_codex":0.0012014576,"about_ca_system_score_gemma":0.0022232481,"threshold_uncertainty_score":0.6092135},"labels":[],"label_agreement":null},{"id":"W3126812739","doi":"10.1002/env.2668","title":"Causal inference for quantile treatment effects","year":2021,"lang":"en","type":"article","venue":"Environmetrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Quantile; Estimator; Causal inference; Inference; Statistics; Quantile regression; Econometrics; Population; Mathematics; Computer science; Demography; Artificial intelligence","score_opus":0.14503351945885762,"score_gpt":0.4149983745832314,"score_spread":0.2699648551243738,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3126812739","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020314366,0.00031573395,0.9768688,0.0005450339,0.000060466635,0.000107126485,0.00021364912,0.0002186141,0.0013560914],"genre_scores_gemma":[0.748085,0.0006616717,0.24619985,0.00051531143,0.00021829442,0.00066042034,0.00051941746,0.000097522505,0.0030425217],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9807287,0.015723893,0.00038021567,0.0015155801,0.0012067948,0.00044488488],"domain_scores_gemma":[0.8712373,0.1130081,0.006087932,0.006810173,0.002408052,0.00044842012],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04009145,0.00070347247,0.0011875553,0.0024525812,0.00070867187,0.0014621497,0.0020928003,0.0016682802,0.009750762],"category_scores_gemma":[0.14061525,0.000511896,0.0015401783,0.0028535516,0.0025411218,0.002524429,0.0020881859,0.0027727464,0.00038530346],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002702434,0.00020830717,0.023067407,0.0002931845,0.00070025516,0.00020762473,0.0004848738,0.18567494,0.00059194403,0.6472521,0.0028452305,0.13840382],"study_design_scores_gemma":[0.00011157232,0.000078667836,0.0049135736,0.000091454225,0.00014216865,0.000053429296,0.000090434536,0.5182795,0.0006267599,0.4731211,0.002467561,0.000023703702],"about_ca_topic_score_codex":0.004894183,"about_ca_topic_score_gemma":0.0029974708,"teacher_disagreement_score":0.04009145,"about_ca_system_score_codex":0.0015039194,"about_ca_system_score_gemma":0.0013814924,"threshold_uncertainty_score":0.21202642},"labels":[],"label_agreement":null},{"id":"W3127376134","doi":"10.1093/biomet/asab003","title":"Estimation of local treatment effects under the binary instrumental variable model","year":2021,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Instrumental variable; Interpretability; Observational study; Econometrics; Robustness (evolution); Estimation; Outcome (game theory); Imperfect; Confounding; Binary number; Mathematics; Endogeneity; Statistics; Computer science; Machine learning; Economics","score_opus":0.10829330849576933,"score_gpt":0.3882440437363961,"score_spread":0.27995073524062675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3127376134","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0074682687,0.000509002,0.9897686,0.00069241534,0.00004235099,0.00008841119,0.0001907623,0.000120926205,0.0011190946],"genre_scores_gemma":[0.5817662,0.001724913,0.40904468,0.0009063408,0.0002679528,0.0012849768,0.00061695446,0.00013498412,0.004253013],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9667968,0.027925642,0.00069603947,0.0021900192,0.0017960015,0.00059559004],"domain_scores_gemma":[0.9210817,0.06568496,0.0059881588,0.0052056154,0.0015769033,0.00046278222],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036709204,0.0007783585,0.003018242,0.0015250534,0.0005842925,0.0023060269,0.0028758817,0.0021997215,0.004969146],"category_scores_gemma":[0.10040551,0.00055477646,0.0019553124,0.0020013303,0.0027723338,0.0022573736,0.0029831294,0.0034364755,0.0007491719],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004935248,0.00012489263,0.008751701,0.0010294154,0.0006936339,0.00027445803,0.00044556733,0.16603641,0.00074545224,0.7180454,0.0031452023,0.10021438],"study_design_scores_gemma":[0.00019767336,0.00024452494,0.0028054954,0.0003218138,0.00029192172,0.00011413333,0.00012720356,0.32438564,0.0011062587,0.6659943,0.00434983,0.0000611722],"about_ca_topic_score_codex":0.0014685987,"about_ca_topic_score_gemma":0.0008722354,"teacher_disagreement_score":0.036709204,"about_ca_system_score_codex":0.0011013456,"about_ca_system_score_gemma":0.0016670115,"threshold_uncertainty_score":0.19413912},"labels":[],"label_agreement":null},{"id":"W3129669709","doi":"10.48550/arxiv.2111.06486","title":"Variational Auto-Encoder Architectures that Excel at Causal Inference","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Causal inference; Inference; Discriminative model; Generative grammar; Computer science; Artificial intelligence; Machine learning; Generative model; Observational study; Sequence (biology); Causal model; Series (stratigraphy); Econometrics; Mathematics","score_opus":0.2576327158538822,"score_gpt":0.295841922690196,"score_spread":0.03820920683631379,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3129669709","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006026076,0.0006187703,0.99076277,0.00040943138,0.000042451702,0.000025748777,0.00014388507,0.00042238703,0.0015484741],"genre_scores_gemma":[0.5134983,0.0017325997,0.47355476,0.0007591223,0.0003208244,0.00023802045,0.0012930024,0.00046663245,0.00813669],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99837214,0.00094388163,0.00006304224,0.00033468884,0.00020104776,0.00008522231],"domain_scores_gemma":[0.9918372,0.006561494,0.00034774563,0.00073930906,0.0003651908,0.00014906513],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038207397,0.0011377637,0.0013467696,0.0010716532,0.00054748997,0.0013560944,0.0026021071,0.0016252735,0.0043237456],"category_scores_gemma":[0.015280811,0.0011004962,0.0013044438,0.0011989715,0.0014005643,0.0028272308,0.0024785732,0.0037173477,0.0010288743],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001285067,0.000118722506,0.0032599145,0.00019217143,0.00028075406,0.00012343975,0.00023437307,0.59165066,0.0013845331,0.25740615,0.004595678,0.14062513],"study_design_scores_gemma":[0.000008236705,0.0000115301245,0.00014970043,0.000016691556,0.000016929884,0.000023045706,0.0000068089726,0.9364443,0.00022028014,0.0623338,0.00076090154,0.000007707767],"about_ca_topic_score_codex":0.0070474893,"about_ca_topic_score_gemma":0.013353886,"teacher_disagreement_score":0.0070474893,"about_ca_system_score_codex":0.0013219971,"about_ca_system_score_gemma":0.0016694632,"threshold_uncertainty_score":0.020206213},"labels":[],"label_agreement":null},{"id":"W3131939934","doi":"10.48550/arxiv.2102.10003","title":"Treatment effect estimation with Multilevel Regression and Poststratification","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Estimator; Causal inference; Covariate; Statistics; Econometrics; Average treatment effect; Population; Small area estimation; Cluster sampling; Inference; Regression; Nonparametric statistics; Computer science; Sampling (signal processing); Statistical inference; Regression analysis; Mathematics; Demography; Artificial intelligence","score_opus":0.21118456809185446,"score_gpt":0.30243442094547507,"score_spread":0.09124985285362061,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3131939934","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030196824,0.00012979684,0.99507326,0.00037220752,0.000048687187,0.0001287639,0.00022983257,0.0001956744,0.00080205034],"genre_scores_gemma":[0.13428253,0.0003824451,0.85927284,0.0004116602,0.00018299953,0.0015423051,0.0007128062,0.00019908296,0.0030132632],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.972912,0.022200841,0.00077852135,0.0017423198,0.0018135393,0.0005526814],"domain_scores_gemma":[0.9248092,0.05783367,0.0041338215,0.009535012,0.0031924844,0.0004957914],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02963132,0.0008666921,0.0021914523,0.0016668347,0.00087646215,0.0019437225,0.0042489143,0.002317612,0.011438121],"category_scores_gemma":[0.1135812,0.0009212462,0.004001308,0.0033805284,0.0013354435,0.0025046351,0.0029046077,0.004423812,0.0014963804],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003519534,0.00025346444,0.011292778,0.00065683725,0.0011923348,0.00027482046,0.0009943324,0.12709269,0.0006718894,0.6618391,0.008804337,0.18657538],"study_design_scores_gemma":[0.0002257541,0.00025129472,0.0024379678,0.00011887469,0.00023063258,0.000110152694,0.00013732369,0.5752409,0.00088435004,0.41053623,0.009757662,0.00006881232],"about_ca_topic_score_codex":0.008431646,"about_ca_topic_score_gemma":0.008598389,"teacher_disagreement_score":0.02963132,"about_ca_system_score_codex":0.0014725983,"about_ca_system_score_gemma":0.003187023,"threshold_uncertainty_score":0.15670723},"labels":[],"label_agreement":null},{"id":"W3133445812","doi":"10.2147/rmhp.s275831","title":"Three Statistical Approaches for Assessment of Intervention Effects: A Primer for Practitioners","year":2021,"lang":"en","type":"article","venue":"Risk Management and Healthcare Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":49,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; London Health Sciences Centre","funders":"National Cancer Institute; National Institute on Aging; Icahn School of Medicine at Mount Sinai","keywords":"Autoregressive integrated moving average; Medicine; Medicaid; Health care; Emergency medicine; Interrupted Time Series Analysis; Regression toward the mean; Regression analysis; Statistics; Time series; Mathematics","score_opus":0.22271926986229418,"score_gpt":0.5021859580156652,"score_spread":0.27946668815337106,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3133445812","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00047822107,0.04757497,0.88964826,0.053600088,0.0029635103,0.0015273783,0.0004116222,0.001216093,0.0025799472],"genre_scores_gemma":[0.005133562,0.025940428,0.9433858,0.012775582,0.0046491427,0.006741764,0.0002472171,0.00066881865,0.00045773137],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5886806,0.33538797,0.031859115,0.0091037955,0.03372453,0.0012439977],"domain_scores_gemma":[0.2571551,0.6929772,0.012460438,0.013482463,0.0218768,0.0020479665],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.35123935,0.004877796,0.0069497097,0.019235585,0.001880789,0.011590603,0.012741815,0.012950731,0.005451188],"category_scores_gemma":[0.45430797,0.004845596,0.0066010505,0.011260418,0.022909675,0.013255196,0.008480358,0.0378041,0.0036337692],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004690443,0.00073202705,0.004795546,0.017113116,0.0015931522,0.00061509974,0.005640111,0.005596604,0.0012494609,0.32395557,0.1210126,0.51722777],"study_design_scores_gemma":[0.0005380605,0.0010310186,0.0028787644,0.022132266,0.00047080242,0.0015126958,0.001655262,0.019250467,0.0012595595,0.6398244,0.30897424,0.00047252496],"about_ca_topic_score_codex":0.0027380798,"about_ca_topic_score_gemma":0.0016207981,"teacher_disagreement_score":0.35123935,"about_ca_system_score_codex":0.0062584626,"about_ca_system_score_gemma":0.011415229,"threshold_uncertainty_score":0.8000374},"labels":[],"label_agreement":null},{"id":"W3133809934","doi":"10.1093/aje/kwab055","title":"Parametric-Regression–Based Causal Mediation Analysis of Binary Outcomes and Binary Mediators: Moving Beyond the Rareness or Commonness of the Outcome","year":2021,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Outcome (game theory); Mediation; Binary number; Parametric statistics; Regression analysis; Econometrics; Psychology; Medicine; Clinical psychology; Statistics; Mathematics; Sociology","score_opus":0.13680713593318722,"score_gpt":0.4469185093233275,"score_spread":0.3101113733901403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3133809934","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048645986,0.000533911,0.9934189,0.00032130087,0.00003063926,0.00008325756,0.00007072537,0.000113549926,0.00056317507],"genre_scores_gemma":[0.39749587,0.001800653,0.5971945,0.0005100254,0.00027210164,0.0008393254,0.0003133306,0.0001098878,0.0014643088],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9634313,0.030836264,0.000719097,0.0022532546,0.002275523,0.0004845942],"domain_scores_gemma":[0.864386,0.119463354,0.005202497,0.008633614,0.0018347078,0.00047975848],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051918652,0.0012400037,0.0027076246,0.0026347386,0.0006255264,0.0022260775,0.004545991,0.0017598455,0.0045278063],"category_scores_gemma":[0.15560873,0.0007348498,0.0029374883,0.0031879337,0.003028792,0.0042805797,0.0050379606,0.004436163,0.0003726162],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035306232,0.00034152775,0.019074148,0.0016120995,0.0022442702,0.0008685642,0.0015479123,0.13546841,0.00160515,0.5896681,0.0021094843,0.24510725],"study_design_scores_gemma":[0.00013499253,0.00040081778,0.005014785,0.0002438055,0.0005597714,0.00055879634,0.00030415424,0.46624446,0.001377733,0.5204323,0.0046230033,0.00010533211],"about_ca_topic_score_codex":0.0020348113,"about_ca_topic_score_gemma":0.0015370161,"teacher_disagreement_score":0.051918652,"about_ca_system_score_codex":0.0009556928,"about_ca_system_score_gemma":0.00257551,"threshold_uncertainty_score":0.27457535},"labels":[],"label_agreement":null},{"id":"W3134059791","doi":"10.1007/s10985-021-09527-3","title":"Instrumental variable estimation of early treatment effect in randomized screening trials","year":2021,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University Health Network; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; Ontario Institute for Cancer Research","keywords":"Instrumental variable; Randomized controlled trial; Context (archaeology); Lung cancer screening; Estimator; Treatment effect; Estimation; Causal inference; Cancer screening","score_opus":0.1739607699834338,"score_gpt":0.4512018372006999,"score_spread":0.2772410672172661,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3134059791","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011543986,0.0025505084,0.9807834,0.0027804868,0.00015829135,0.00019407122,0.00048145608,0.00035491528,0.0011529343],"genre_scores_gemma":[0.60187095,0.0060671866,0.3679563,0.0022942252,0.0010697768,0.0028143781,0.001676186,0.00047287022,0.015778178],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9291304,0.06463391,0.0012810599,0.002337773,0.0016446923,0.0009722211],"domain_scores_gemma":[0.45963416,0.5204252,0.0073157297,0.009487915,0.0020642332,0.0010727111],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0941426,0.001975287,0.005720724,0.0026951751,0.0007931662,0.0028825374,0.0054818555,0.0031631389,0.0098891705],"category_scores_gemma":[0.29639632,0.0021383038,0.0035546129,0.002801881,0.0032678468,0.0052795303,0.0031879158,0.008318204,0.00082519505],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018484634,0.0004836323,0.009769366,0.0019894764,0.0029849347,0.00044338545,0.0005867078,0.1319816,0.0004501408,0.7408034,0.008570356,0.1000886],"study_design_scores_gemma":[0.00074673374,0.0002493942,0.0014009498,0.00030945128,0.0006805683,0.00008278909,0.00007119049,0.34829363,0.00058047107,0.6446934,0.002842738,0.00004870676],"about_ca_topic_score_codex":0.004469708,"about_ca_topic_score_gemma":0.0034665253,"teacher_disagreement_score":0.9058574,"about_ca_system_score_codex":0.0019027104,"about_ca_system_score_gemma":0.0051515354,"threshold_uncertainty_score":0.49787962},"labels":[],"label_agreement":null},{"id":"W3134225231","doi":"10.1177/0049124121995548","title":"Marginal and Conditional Confounding Using Logits","year":2021,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Medical Research Council; Chief Scientist Office","keywords":"Confounding; Statistics; Weighting; Econometrics; Marginal structural model; Conditional probability; Odds; Conditional probability distribution; Logistic regression; Marginal model; Inverse probability weighting; Conditional logistic regression; Mathematics; Odds ratio; Regression analysis; Medicine; Propensity score matching","score_opus":0.8690128158201307,"score_gpt":0.7315306657257828,"score_spread":0.13748215009434783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3134225231","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01028356,0.00046601036,0.98424697,0.0007622349,0.00007501829,0.00009877711,0.00022982206,0.0001628685,0.0036747132],"genre_scores_gemma":[0.51437575,0.0015199385,0.47277716,0.0007383485,0.0003733082,0.0014691266,0.00062568777,0.0002671758,0.007853547],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95044,0.037300263,0.001634205,0.0046558077,0.0048173964,0.0011523669],"domain_scores_gemma":[0.92491746,0.05919262,0.004686766,0.008261687,0.0024001412,0.0005413378],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03944655,0.0014130984,0.0016542367,0.0032477565,0.0011502145,0.0039887833,0.002948155,0.001518717,0.010067869],"category_scores_gemma":[0.13930632,0.0008161888,0.003102359,0.00391218,0.0054695727,0.007111244,0.007903197,0.0036770864,0.00088312454],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008242302,0.000039077313,0.0069784066,0.00019663417,0.00024725622,0.00013523299,0.0013927369,0.009968308,0.00030026308,0.93227214,0.00091999874,0.04746747],"study_design_scores_gemma":[0.000033408764,0.00004428028,0.0024630593,0.00010380408,0.0001147469,0.00015562463,0.00022115282,0.027299283,0.0005949166,0.96072346,0.008184902,0.00006130986],"about_ca_topic_score_codex":0.0029207838,"about_ca_topic_score_gemma":0.002171899,"teacher_disagreement_score":0.96055347,"about_ca_system_score_codex":0.0016835484,"about_ca_system_score_gemma":0.002473589,"threshold_uncertainty_score":0.20861578},"labels":[],"label_agreement":null},{"id":"W3135053972","doi":"10.1002/sim.8906","title":"The impact of adjusting for pure predictors of exposure, mediator, and outcome on the variance of natural direct and indirect effect estimators","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université du Québec à Montréal; Université Laval","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Statistics; Estimator; Confounding; Outcome (game theory); Mediation; Inverse probability weighting; Variance (accounting); Weighting; Econometrics; Mathematics; Linear regression; Regression analysis; Medicine; Economics","score_opus":0.05564411871493614,"score_gpt":0.42065357746469295,"score_spread":0.3650094587497568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3135053972","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.047560785,0.0029284281,0.94448733,0.0015977577,0.00017978375,0.00025150465,0.00020488075,0.00026443414,0.0025251273],"genre_scores_gemma":[0.6266172,0.001898673,0.36835095,0.00068975455,0.00017879298,0.0007234579,0.00034597743,0.0001982825,0.000996863],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8737059,0.10996435,0.0032653606,0.0054358225,0.0064613274,0.0011672875],"domain_scores_gemma":[0.31477886,0.65013283,0.00523968,0.02536105,0.00412829,0.0003593558],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16134569,0.0013349017,0.0019681735,0.0015368353,0.0008950031,0.002366339,0.002136027,0.002029081,0.0012814074],"category_scores_gemma":[0.44734928,0.0008167618,0.002835346,0.002295651,0.0038417333,0.003252536,0.003345294,0.0031419802,0.00021600172],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014441438,0.00030672038,0.1422686,0.001527808,0.0060389023,0.0009897175,0.0022481538,0.17980126,0.0040649567,0.31097722,0.0023772505,0.3479553],"study_design_scores_gemma":[0.0003675032,0.0013273216,0.05995217,0.0010298614,0.0030184588,0.0012470613,0.0007805545,0.5647208,0.0077447644,0.3515558,0.007952079,0.00030364285],"about_ca_topic_score_codex":0.0075937025,"about_ca_topic_score_gemma":0.006088492,"teacher_disagreement_score":0.16134569,"about_ca_system_score_codex":0.0012407245,"about_ca_system_score_gemma":0.0035852015,"threshold_uncertainty_score":0.85328776},"labels":[],"label_agreement":null},{"id":"W3137061630","doi":"10.1177/0962280221997505","title":"Variable selection for causal mediation analysis using LASSO-based methods","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Propensity score matching; Estimator; Lasso (programming language); Inverse probability weighting; Causal inference; Weighting; Econometrics; Computer science; Statistics; Regularization (linguistics); Marginal structural model; Mediation; Mathematics; Artificial intelligence; Medicine","score_opus":0.5215065702757662,"score_gpt":0.7100065237874281,"score_spread":0.18849995351166193,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137061630","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011347418,0.00019968933,0.9971409,0.00019067324,0.00003541864,0.00013117895,0.00037944282,0.00035677748,0.00043122986],"genre_scores_gemma":[0.04844179,0.0005555965,0.9436929,0.00033382457,0.00016424456,0.0023095142,0.0025521144,0.000519831,0.0014300884],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98428303,0.012653438,0.00057180505,0.0009559317,0.0012878553,0.00024798774],"domain_scores_gemma":[0.97696507,0.018121816,0.0012411727,0.001930792,0.0014867656,0.000254454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022266526,0.001403852,0.002447273,0.002103477,0.0009934391,0.002348824,0.0028834327,0.0015257195,0.009985182],"category_scores_gemma":[0.046286825,0.00070666854,0.002466434,0.0030398865,0.0011128257,0.0014176934,0.0029524164,0.0037312876,0.0017359136],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065472815,0.00034080594,0.0062976936,0.0014653452,0.0009031346,0.0005295467,0.0005249629,0.2712654,0.0023142986,0.2818508,0.0505549,0.38329837],"study_design_scores_gemma":[0.00018428838,0.00005426326,0.0005031339,0.00008918643,0.00006769583,0.000078002624,0.000051722305,0.86086255,0.00086254586,0.12764283,0.009572836,0.000030938332],"about_ca_topic_score_codex":0.002066535,"about_ca_topic_score_gemma":0.0026653758,"teacher_disagreement_score":0.022266526,"about_ca_system_score_codex":0.00081688986,"about_ca_system_score_gemma":0.003664887,"threshold_uncertainty_score":0.117758036},"labels":[],"label_agreement":null},{"id":"W3137325329","doi":"10.11124/jbies-20-00403","title":"Strategies for measuring prescription medication switching with pharmacy claims data: a scoping review protocol","year":2021,"lang":"en","type":"review","venue":"JBI Evidence Synthesis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Rehabilitation Institute; Centre for Excellence in Mining Innovation; Institute for Work & Health; St. Michael's Hospital; Public Health Ontario; University Health Network; University of Toronto","funders":"","keywords":"Pharmacy; Medical prescription; Protocol (science); Medicine; Family medicine; Alternative medicine; Pharmacology","score_opus":0.43626730247438156,"score_gpt":0.5549240835973895,"score_spread":0.11865678112300798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137325329","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00021073758,0.0012328533,0.0015074661,0.0003440277,0.00012655408,0.99365956,0.0022452483,0.000049717593,0.0006238321],"genre_scores_gemma":[0.00020430255,0.001384142,0.0049414635,0.00016649422,0.00001793972,0.9925551,0.0004985661,0.000005965839,0.00022603794],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9284805,0.027603403,0.027679,0.004268837,0.009456587,0.0025116724],"domain_scores_gemma":[0.92087996,0.026244711,0.014393909,0.0058059446,0.028856192,0.0038192126],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1510883,0.0062314332,0.01384415,0.029218849,0.005989575,0.0103203375,0.007898775,0.01197076,0.07065843],"category_scores_gemma":[0.12948292,0.0069029457,0.018191822,0.021617258,0.005645486,0.01259365,0.011218264,0.0076123616,0.017256673],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035315824,0.0006406809,0.0014127985,0.8332775,0.0015175238,0.0009680822,0.005193838,0.001952574,0.0017302807,0.01004456,0.039512485,0.10021814],"study_design_scores_gemma":[0.009182117,0.0017817286,0.0058893203,0.6934256,0.00508789,0.0008119341,0.005118124,0.0014678115,0.0024759015,0.011057294,0.26318553,0.00051681505],"about_ca_topic_score_codex":0.0057730796,"about_ca_topic_score_gemma":0.011346524,"teacher_disagreement_score":0.8489117,"about_ca_system_score_codex":0.017640878,"about_ca_system_score_gemma":0.11053173,"threshold_uncertainty_score":0.79904085},"labels":[],"label_agreement":null},{"id":"W3137498389","doi":"10.1002/pds.5227","title":"Control yourself: <scp>ISPE‐endorsed</scp> guidance in the application of <scp>self‐controlled</scp> study designs in pharmacoepidemiology","year":2021,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":80,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of British Columbia; Women's College Hospital; Public Health Ontario; University of Toronto","funders":"Medical Research Council; International Society for Pharmacoepidemiology; Johnson and Johnson; Novartis Pharmaceuticals Corporation; Brigham and Women's Hospital; Eli Lilly and Company","keywords":"Medicine; Pharmacoepidemiology; Pharmacology","score_opus":0.18511305950100923,"score_gpt":0.4859422869113026,"score_spread":0.3008292274102934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137498389","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004336233,0.09850847,0.3730346,0.2804607,0.044375144,0.10811962,0.015526831,0.003868225,0.07177023],"genre_scores_gemma":[0.024192201,0.04562441,0.66517925,0.09288511,0.0061782207,0.14960985,0.004171956,0.0018321287,0.010326823],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.33917332,0.5084975,0.098439395,0.0079917535,0.043548983,0.0023490658],"domain_scores_gemma":[0.14306107,0.61669487,0.04771882,0.07091131,0.11682002,0.0047938754],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.56615543,0.0026836453,0.0068270615,0.010894474,0.003310449,0.011941778,0.010880327,0.020197794,0.020026127],"category_scores_gemma":[0.7408286,0.0032135,0.010946813,0.014552884,0.012634314,0.011081562,0.010142732,0.01443736,0.015122331],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017024908,0.0004192427,0.002534217,0.08413618,0.0024523095,0.00037099156,0.0061213966,0.0014677516,0.0012618243,0.038828757,0.5482402,0.31246462],"study_design_scores_gemma":[0.003956852,0.00080085,0.006981902,0.22469662,0.0024748575,0.00070658466,0.0020531225,0.003315598,0.0032421947,0.05333611,0.69786906,0.00056624424],"about_ca_topic_score_codex":0.012368049,"about_ca_topic_score_gemma":0.015597296,"teacher_disagreement_score":0.43384457,"about_ca_system_score_codex":0.0070080915,"about_ca_system_score_gemma":0.056091335,"threshold_uncertainty_score":0.5350076},"labels":[],"label_agreement":null},{"id":"W3138340382","doi":"10.1016/j.ahj.2021.03.008","title":"To Adjust or Not to Adjust: The Role of Different Covariates in Cardiovascular Observational Studies","year":2021,"lang":"en","type":"review","venue":"American Heart Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":101,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; University of British Columbia","funders":"Cancer Research UK","keywords":"Confounding; Observational study; Covariate; Econometrics; Causal inference; Outcome (game theory); Regression analysis; Variables; Statistics; Psychology; Computer science; Medicine; Mathematics","score_opus":0.47779239218442265,"score_gpt":0.5094929273474985,"score_spread":0.03170053516307586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3138340382","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003960457,0.97587013,0.019953012,0.0029127218,0.00043186406,0.000019272526,0.00012202015,0.00003000914,0.00026486727],"genre_scores_gemma":[0.020310845,0.9465305,0.02611704,0.0037144283,0.0024871298,0.0001455225,0.0002509112,0.00006078332,0.00038276197],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9723656,0.02290543,0.0013564891,0.0015689023,0.0016185641,0.00018513472],"domain_scores_gemma":[0.8340165,0.15830055,0.0028520636,0.0028552613,0.0016954044,0.00028023048],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04646317,0.0014959361,0.005738727,0.0019905593,0.00032750904,0.001906689,0.0032262113,0.0032060288,0.0032076582],"category_scores_gemma":[0.112975,0.0008514548,0.0042495257,0.003937174,0.0024831966,0.002593355,0.0016922503,0.0054670754,0.0005723526],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051195244,0.000074875374,0.0022914517,0.030978775,0.0071210125,0.00007624076,0.00019266989,0.0029686892,0.000115588424,0.04291498,0.009696938,0.90305674],"study_design_scores_gemma":[0.001462741,0.0005962706,0.014849765,0.046807088,0.022145277,0.0012147222,0.0002894456,0.018510725,0.00073868764,0.69266313,0.20043516,0.00028692742],"about_ca_topic_score_codex":0.0035609521,"about_ca_topic_score_gemma":0.004029507,"teacher_disagreement_score":0.9535368,"about_ca_system_score_codex":0.0009824216,"about_ca_system_score_gemma":0.003108658,"threshold_uncertainty_score":0.24572372},"labels":[],"label_agreement":null},{"id":"W3138456065","doi":"10.1093/biomet/asab016","title":"Identifiability of causal effects with multiple causes and a binary outcome","year":2021,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Institute of Environmental Health Sciences; National Institute on Aging","keywords":"Identifiability; Confounding; Outcome (game theory); Causal inference; Econometrics; Mathematics; Observational study; Latent variable; Probit; Inference; Probit model; Causal model; Statistics; Instrumental variable; Computer science; Artificial intelligence","score_opus":0.11765876254771182,"score_gpt":0.4010844052541662,"score_spread":0.28342564270645443,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3138456065","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006025372,0.0008441406,0.98898697,0.002002794,0.000114931,0.0002133703,0.00022614699,0.000093408045,0.0014928562],"genre_scores_gemma":[0.372994,0.0027503392,0.6133687,0.0022266938,0.00069684617,0.002238959,0.0008828755,0.00012795067,0.0047136457],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93748623,0.041357208,0.0034694662,0.009072841,0.00743202,0.001182185],"domain_scores_gemma":[0.6837601,0.27726102,0.0160215,0.019898068,0.0025121712,0.00054723414],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10031329,0.0014901189,0.0049837357,0.003520137,0.0020042525,0.0043026265,0.004472308,0.0052709505,0.0061931307],"category_scores_gemma":[0.25645795,0.0017784762,0.004810732,0.0043832418,0.007991495,0.007409359,0.0073367087,0.009086823,0.0008714852],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012439815,0.00010132151,0.007272625,0.0007945777,0.0005793306,0.00054069527,0.00097335025,0.010974828,0.00038072735,0.93499637,0.0013028631,0.041958887],"study_design_scores_gemma":[0.000057540154,0.000047543686,0.001271996,0.00017991514,0.00014397936,0.00027921292,0.00010857657,0.028753376,0.00036142798,0.9664179,0.0023456083,0.000032796965],"about_ca_topic_score_codex":0.003338582,"about_ca_topic_score_gemma":0.0019094124,"teacher_disagreement_score":0.10031329,"about_ca_system_score_codex":0.0024333098,"about_ca_system_score_gemma":0.0056145205,"threshold_uncertainty_score":0.53051376},"labels":[],"label_agreement":null},{"id":"W3139095225","doi":"10.1164/rccm.202008-3238cp","title":"Attention to Immortal Time Bias in Critical Care Research","year":2021,"lang":"en","type":"article","venue":"American Journal of Respiratory and Critical Care Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; University of Toronto; Sunnybrook Health Science Centre","funders":"","keywords":"Medicine; Critical illness; Intensive care medicine; Critically ill","score_opus":0.25876148731467413,"score_gpt":0.5310246238141766,"score_spread":0.27226313649950246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3139095225","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009634993,0.10684346,0.5904894,0.25967702,0.018594835,0.0019955384,0.0006948059,0.0009182151,0.011151825],"genre_scores_gemma":[0.26381007,0.047292553,0.46858376,0.1799862,0.028458053,0.007340501,0.0004350706,0.0009905968,0.0031032101],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.22191422,0.6585217,0.056827143,0.014859897,0.046186406,0.001690663],"domain_scores_gemma":[0.032832887,0.9018415,0.022016417,0.028580371,0.0138640385,0.00086479104],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6737839,0.0021180331,0.0048485403,0.009224332,0.006382594,0.011884707,0.00873232,0.013627084,0.0041468916],"category_scores_gemma":[0.8676214,0.0022526872,0.0059918696,0.0123678325,0.043655176,0.021103757,0.012131303,0.028309273,0.00086099375],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008724236,0.00010334753,0.016595155,0.018112417,0.0027132176,0.0014051757,0.023751508,0.0045859073,0.00060904224,0.5647812,0.063052654,0.30341795],"study_design_scores_gemma":[0.00033804483,0.0003792633,0.004757597,0.017926455,0.0009524855,0.0017230663,0.0028364444,0.0073529514,0.001397327,0.85327387,0.108618215,0.00044424666],"about_ca_topic_score_codex":0.0052571804,"about_ca_topic_score_gemma":0.0056375205,"teacher_disagreement_score":0.3262161,"about_ca_system_score_codex":0.008934584,"about_ca_system_score_gemma":0.019008933,"threshold_uncertainty_score":0.4022826},"labels":[],"label_agreement":null},{"id":"W3143149325","doi":"10.6084/m9.figshare.14381684.v1","title":"Confounding adjustment methods for multi-level treatment comparisons under lack of positivity and unknown model specification","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre hospitalier universitaire de Québec; Université Laval","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Estimator; Context (archaeology); Matching (statistics); Observational study; Propensity score matching; Confounding; Specification; Average treatment effect; Variance (accounting); Computer science; Statistics; Econometrics; Outcome (game theory); Contrast (vision); Mathematics; Machine learning; Artificial intelligence","score_opus":0.8348849125377892,"score_gpt":0.5963865798411815,"score_spread":0.2384983326966077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3143149325","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0044736587,0.00025397228,0.9939148,0.0002679235,0.00007471644,0.0003179262,0.000086416316,0.00021597702,0.00039467684],"genre_scores_gemma":[0.17788386,0.00029651882,0.8178732,0.00044234842,0.00015528793,0.0019441097,0.00028562723,0.00015893501,0.0009601173],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9213755,0.06632192,0.0026419985,0.004639983,0.004269041,0.00075153826],"domain_scores_gemma":[0.78220564,0.17699535,0.012297045,0.023237549,0.0045339344,0.0007305204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.090180725,0.0012904493,0.0022172546,0.0021848714,0.0012505905,0.0017169873,0.0038651368,0.002342857,0.008902999],"category_scores_gemma":[0.29694045,0.0008560784,0.0040995204,0.0025627704,0.002777094,0.003345116,0.004114085,0.0033855238,0.00064675225],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017904225,0.0003302663,0.021169301,0.0014173524,0.0040283743,0.00038839248,0.001103272,0.072432,0.0020421573,0.33685762,0.0054909037,0.55294997],"study_design_scores_gemma":[0.0011917166,0.0012777902,0.0109119965,0.00041202302,0.0011618091,0.0003851706,0.00024330326,0.36156046,0.004057534,0.602942,0.01570702,0.00014911388],"about_ca_topic_score_codex":0.0019490311,"about_ca_topic_score_gemma":0.0021591657,"teacher_disagreement_score":0.090180725,"about_ca_system_score_codex":0.001250594,"about_ca_system_score_gemma":0.0033678447,"threshold_uncertainty_score":0.47692698},"labels":[],"label_agreement":null},{"id":"W3143317772","doi":"10.1080/0886022x.2021.1903928","title":"Survival outcomes and adverse events in patients with chronic kidney disease after coronary artery bypass grafting and percutaneous coronary intervention: a meta-analysis of propensity score-matching studies","year":2021,"lang":"en","type":"article","venue":"Renal Failure","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Propensity score matching; Kidney disease; Conventional PCI; Percutaneous coronary intervention; Adverse effect; Coronary artery disease; Bypass grafting; Artery","score_opus":0.08804451007661503,"score_gpt":0.338607501394673,"score_spread":0.250562991318058,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3143317772","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.091429494,0.89238745,0.011652702,0.0007695872,0.00043522622,0.00063600723,0.0017488515,0.00014892487,0.00079176197],"genre_scores_gemma":[0.87417287,0.114391334,0.00776335,0.00059572456,0.0003837744,0.0008335907,0.0015059223,0.00005404087,0.00029937315],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.9756335,0.01610821,0.003788073,0.0024217926,0.0016479569,0.0004005282],"domain_scores_gemma":[0.9665396,0.025717746,0.004435284,0.0021494278,0.00086988177,0.00028799011],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03245381,0.0022439384,0.010162825,0.0071136383,0.00048261802,0.0033739032,0.0016624294,0.001708679,0.0022833701],"category_scores_gemma":[0.047711857,0.0012267008,0.054220524,0.007105341,0.000597934,0.0015010252,0.0016310324,0.0013733199,0.00019307063],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022974547,0.000020488007,0.020413287,0.0158014,0.9542874,0.000053587,0.00003380947,0.0010975705,0.00012464225,0.00013643497,0.00016531731,0.0055687297],"study_design_scores_gemma":[0.00053939887,0.0001932651,0.010376463,0.001402232,0.98530257,0.00006848253,0.000022542323,0.0009946402,0.000096465206,0.00052607397,0.00046179842,0.000015993119],"about_ca_topic_score_codex":0.0028142289,"about_ca_topic_score_gemma":0.003096342,"teacher_disagreement_score":0.03245381,"about_ca_system_score_codex":0.0012121819,"about_ca_system_score_gemma":0.0014890175,"threshold_uncertainty_score":0.1716342},"labels":[],"label_agreement":null},{"id":"W3153628378","doi":"10.2139/ssrn.3013430","title":"Sharp Bounds on Functionals of the Joint Distribution in the Analysis of Treatment Effects","year":2017,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Nonparametric statistics; Joint (building); Mathematical optimization; Selection (genetic algorithm); Basis (linear algebra); Identification (biology); Joint probability distribution; Computer science; Distribution (mathematics); Focus (optics); Applied mathematics; Upper and lower bounds; Mathematics; Algorithm; Econometrics; Statistics; Artificial intelligence; Mathematical analysis; Engineering; Geometry","score_opus":0.1110620422219345,"score_gpt":0.39481730790946434,"score_spread":0.28375526568752985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3153628378","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013715679,0.004839222,0.9726255,0.004129408,0.00015547266,0.0000949044,0.00034339854,0.00033342818,0.0037629288],"genre_scores_gemma":[0.57238233,0.015720995,0.38075992,0.004828948,0.0026890053,0.0017672133,0.0017290703,0.0012583645,0.018864196],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95960987,0.03260491,0.0009971717,0.0026128627,0.002951385,0.001223783],"domain_scores_gemma":[0.4250228,0.55257,0.0059772786,0.011273442,0.0035859,0.0015705788],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10819942,0.0032648165,0.0067777713,0.005516327,0.0018511385,0.0070901047,0.007504364,0.006421929,0.008924719],"category_scores_gemma":[0.305662,0.0039820545,0.0042822934,0.005577394,0.012554664,0.01667123,0.0075293537,0.017122,0.000818876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016778399,0.00009150873,0.0016352423,0.00056684215,0.00044447804,0.00016730881,0.0005256816,0.03760203,0.00035023323,0.9362469,0.0020223479,0.020179745],"study_design_scores_gemma":[0.00004026276,0.00003312717,0.00055692927,0.00012127646,0.0001127827,0.000057325316,0.0000389603,0.09125903,0.00015720347,0.9067844,0.00081077946,0.000028010454],"about_ca_topic_score_codex":0.004083173,"about_ca_topic_score_gemma":0.0033502022,"teacher_disagreement_score":0.8918006,"about_ca_system_score_codex":0.004304874,"about_ca_system_score_gemma":0.0038205797,"threshold_uncertainty_score":0.5722201},"labels":[],"label_agreement":null},{"id":"W3153692697","doi":"10.5539/hes.v11n2p155","title":"Program Specific Effects of a Semester Abroad on the Likelihood of Pursuing a PhD","year":2021,"lang":"en","type":"article","venue":"Higher Education Studies","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Propensity score matching; Psychology; Higher education; Study abroad; Sample (material); Matching (statistics); German; Mathematics education; Medical education; Pedagogy; Statistics; Political science; Mathematics; Medicine","score_opus":0.19384437347273922,"score_gpt":0.47402357170306214,"score_spread":0.2801791982303229,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3153692697","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"incentives","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"incentives","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99755716,0.00017958457,0.00026051197,0.0002584137,0.000015832578,0.000013617462,0.00026550877,0.000009361707,0.0014400689],"genre_scores_gemma":[0.9977673,0.00008836456,0.00011535819,0.000029893845,0.000015478432,0.000017408312,0.00026166256,0.0000032881646,0.0017012424],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99835664,0.00076109933,0.00009479521,0.00020128081,0.00020026218,0.00038583088],"domain_scores_gemma":[0.9792011,0.00938673,0.0050470266,0.00082444755,0.00035316174,0.005187561],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0025983478,0.00023714526,0.00033397946,0.00080151553,0.0005910793,0.0012594812,0.0005094245,0.00076792843,0.016056968],"category_scores_gemma":[0.009651539,0.00013443296,0.0013428075,0.00092739513,0.0006172374,0.00046785842,0.0015658024,0.001484658,0.0008374597],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007142895,0.0006284138,0.9877043,0.000025457315,0.00027541321,0.000113293325,0.00021577535,0.00072080136,0.00028630442,0.00036631923,0.00035857508,0.008591062],"study_design_scores_gemma":[0.000016732867,0.00064442575,0.99700516,0.000012114019,0.00014430708,0.00003609587,0.0005831871,0.00072188646,0.0001849774,0.00015124392,0.0004923005,0.0000076269744],"about_ca_topic_score_codex":0.0056325537,"about_ca_topic_score_gemma":0.0076087564,"teacher_disagreement_score":0.99740165,"about_ca_system_score_codex":0.00043852793,"about_ca_system_score_gemma":0.00085005973,"threshold_uncertainty_score":0.053715885},"labels":[],"label_agreement":null},{"id":"W3154094468","doi":"10.1007/978-1-0716-1138-8_6","title":"Longitudinal Studies 1: Determinants of Risk","year":2021,"lang":"en","type":"book-chapter","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Observational study; Confounding; Selection bias; Casual; Randomized controlled trial; Computer science; Risk analysis (engineering); Randomized experiment; Causal inference; Clinical study design; Econometrics; Medicine; Statistics; Clinical trial; Mathematics; Surgery","score_opus":0.28411791574331063,"score_gpt":0.554268203409184,"score_spread":0.2701502876658734,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3154094468","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004282634,0.18205006,0.626098,0.035401717,0.0051357946,0.00012831143,0.0035171688,0.0010096274,0.14237669],"genre_scores_gemma":[0.14545839,0.23037118,0.28974345,0.01749884,0.016642805,0.0011202901,0.0033665085,0.0014762861,0.29432222],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983747,0.0010497316,0.00005311072,0.00019117608,0.00029303896,0.000038322425],"domain_scores_gemma":[0.98258466,0.015929153,0.00035117086,0.00065539405,0.000382729,0.000096953605],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.004514835,0.0011188431,0.00121092,0.001287295,0.00039207056,0.0016200406,0.0010553111,0.0017890185,0.02103724],"category_scores_gemma":[0.0192867,0.0008773817,0.00059266534,0.002402533,0.0017036078,0.0034831364,0.0008954172,0.0032897713,0.0037865692],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002521489,0.0000396698,0.0015283596,0.0006189667,0.00007933987,0.00009005342,0.0002804551,0.002320197,0.0002258715,0.7259816,0.1157132,0.15309705],"study_design_scores_gemma":[0.000009515418,0.000018004248,0.0016471946,0.00031017547,0.00003652161,0.00013600466,0.000051439518,0.0022965053,0.00011125494,0.92459416,0.070774086,0.000015156327],"about_ca_topic_score_codex":0.001483803,"about_ca_topic_score_gemma":0.0022062338,"teacher_disagreement_score":0.9954852,"about_ca_system_score_codex":0.00071954157,"about_ca_system_score_gemma":0.0010968377,"threshold_uncertainty_score":0.070376635},"labels":[],"label_agreement":null},{"id":"W3155589879","doi":"10.1007/978-1-0716-1138-8_17","title":"Randomized Controlled Trials 7: On Contamination and Estimating the Actual Treatment Effect","year":2021,"lang":"en","type":"book-chapter","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Censoring (clinical trials); Randomized controlled trial; Discontinuation; Treatment effect; Treatment and control groups; Medicine; Sample size determination; Psychological intervention; Statistics; Mathematics; Surgery; Internal medicine","score_opus":0.1615683949677094,"score_gpt":0.523665076592925,"score_spread":0.3620966816252157,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3155589879","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005234466,0.08599453,0.86881393,0.018406734,0.006404869,0.00063539017,0.00082363765,0.000646149,0.01775137],"genre_scores_gemma":[0.037885606,0.058880553,0.83078665,0.038875666,0.011154933,0.0056695957,0.0007650196,0.0014418763,0.014540009],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7834548,0.19682918,0.005158239,0.0037995551,0.010235751,0.00052249734],"domain_scores_gemma":[0.556074,0.4276786,0.004419393,0.008303394,0.003072971,0.00045160553],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1265727,0.0034556412,0.0070571634,0.0029063246,0.0008322837,0.004004633,0.0055347187,0.008652813,0.0170693],"category_scores_gemma":[0.26981655,0.0030381745,0.0046758736,0.0037519243,0.009554786,0.007729414,0.0028836972,0.013516486,0.0036758098],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005471772,0.00007118656,0.00024829424,0.006542131,0.0010904623,0.000113822854,0.00030370336,0.004388078,0.0001939748,0.72474253,0.07285888,0.18889974],"study_design_scores_gemma":[0.0004340029,0.00012908535,0.00019244339,0.0021703849,0.00035502992,0.00013150474,0.000028024593,0.005962457,0.0003364961,0.9486315,0.041572224,0.00005691899],"about_ca_topic_score_codex":0.0019395928,"about_ca_topic_score_gemma":0.001983706,"teacher_disagreement_score":0.8734273,"about_ca_system_score_codex":0.0027406057,"about_ca_system_score_gemma":0.0045025134,"threshold_uncertainty_score":0.6693884},"labels":[],"label_agreement":null},{"id":"W3156818063","doi":"10.1002/sim.9002","title":"Semiparametric recurrent event vs time‐to‐first‐event analyses in randomized trials: Estimands and model misspecification","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Censoring (clinical trials); Estimator; Econometrics; Proportional hazards model; Event (particle physics); Semiparametric regression; Semiparametric model; Sample size determination; Statistics; Computer science; Mathematics","score_opus":0.30399888459233215,"score_gpt":0.5326979569422585,"score_spread":0.22869907234992637,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3156818063","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0066505317,0.001382029,0.98955524,0.0011469716,0.00008303695,0.00024343806,0.00009801524,0.00015407086,0.0006867622],"genre_scores_gemma":[0.46472093,0.0029519603,0.52384996,0.0019336051,0.0006534122,0.0033044408,0.0003798239,0.00026652173,0.0019392995],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7655823,0.21593732,0.0051072505,0.005548745,0.006843146,0.0009812468],"domain_scores_gemma":[0.26045296,0.6910486,0.015544456,0.02843304,0.0038134763,0.00070743554],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23377198,0.0016332826,0.0038620827,0.002451136,0.00054271467,0.003855457,0.0041952003,0.0038128763,0.004038772],"category_scores_gemma":[0.6072423,0.0010280958,0.0041527404,0.0024200617,0.004877081,0.0074556805,0.004515148,0.0060251546,0.0004511386],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011561698,0.00018331701,0.0087849,0.0023749436,0.0024919622,0.0005032517,0.0010387335,0.06938139,0.0012947043,0.7602597,0.0016128843,0.150918],"study_design_scores_gemma":[0.00035595038,0.00071016786,0.0026850181,0.00045640863,0.0008447925,0.0003915671,0.00013105378,0.25809652,0.0016534432,0.7315225,0.003073174,0.00007933757],"about_ca_topic_score_codex":0.0007492693,"about_ca_topic_score_gemma":0.00057882775,"teacher_disagreement_score":0.23377198,"about_ca_system_score_codex":0.001661321,"about_ca_system_score_gemma":0.0029369493,"threshold_uncertainty_score":0.94489557},"labels":[],"label_agreement":null},{"id":"W3157155409","doi":"10.1002/sim.8997","title":"Using generalized linear models to implement g‐estimation for survival data with time‐varying confounding","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"NIHR Cambridge Biomedical Research Centre; Bijzonder Onderzoeksfonds UGent; Medical Research Council Canada; Department of Health and Social Care; Medical Research Council; National Institute for Health and Care Research; UK Research and Innovation","keywords":"Confounding; Computer science; Estimation; Weighting; Statistics; Marginal structural model; Software; Proportional hazards model; Econometrics; Observational study; Data mining; Mathematics; Medicine","score_opus":0.4354915215451955,"score_gpt":0.5352801309584877,"score_spread":0.0997886094132922,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3157155409","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006032475,0.000088699504,0.9972356,0.00024887495,0.000052562344,0.000094940224,0.00022496397,0.0011419961,0.00030910314],"genre_scores_gemma":[0.021111075,0.0003984038,0.97377723,0.0003823502,0.00008373134,0.0015351304,0.0007249341,0.00087669154,0.0011104478],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96523327,0.029591205,0.0012932854,0.0017289526,0.0017881056,0.00036514402],"domain_scores_gemma":[0.90067935,0.08670541,0.0032642349,0.0070216316,0.002081049,0.00024829328],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04401878,0.0024652,0.0020438586,0.0036176648,0.0008171526,0.0026654152,0.003941889,0.002972892,0.017389731],"category_scores_gemma":[0.16469704,0.0018644973,0.0052795983,0.005416198,0.0020691336,0.0030004208,0.0045107156,0.0065843556,0.005658387],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030351413,0.0002054369,0.010413267,0.0019239059,0.002623977,0.00086622464,0.0019019521,0.19933102,0.0015193722,0.36267677,0.030997261,0.38723716],"study_design_scores_gemma":[0.00022975916,0.00019600122,0.0024412726,0.0004578301,0.0003436176,0.00032152305,0.00023503933,0.42344576,0.0016394024,0.5324415,0.038098413,0.00014982687],"about_ca_topic_score_codex":0.010417498,"about_ca_topic_score_gemma":0.009737975,"teacher_disagreement_score":0.04401878,"about_ca_system_score_codex":0.0016463294,"about_ca_system_score_gemma":0.0040669944,"threshold_uncertainty_score":0.23279631},"labels":[],"label_agreement":null},{"id":"W3157785707","doi":"10.1186/s12874-021-01306-w","title":"Comparison of six statistical methods for interrupted time series studies: empirical evaluation of 190 published series","year":2021,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":159,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Health and Medical Research Council; Medical Research Council; Canadian Institutes of Health Research; Monash University","keywords":"Statistics; Series (stratigraphy); Confidence interval; Autocorrelation; Pairwise comparison; Statistical significance; Sample size determination; Point estimation; Statistical hypothesis testing; Mathematics; Computer science; Econometrics","score_opus":0.9326180323716993,"score_gpt":0.7848555400066978,"score_spread":0.1477624923650015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3157785707","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.21394831,0.11725806,0.60480934,0.0028647932,0.002728323,0.03495205,0.01432646,0.001238736,0.007873867],"genre_scores_gemma":[0.52760035,0.017337848,0.39236504,0.0007211059,0.00065365795,0.052967306,0.006966024,0.00043892616,0.0009497515],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.45231467,0.43390167,0.05883449,0.0121757835,0.041425657,0.0013476853],"domain_scores_gemma":[0.08555351,0.84980845,0.03284982,0.017138712,0.014015133,0.00063436426],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.41353762,0.0023176915,0.005579103,0.019244405,0.0013111676,0.0056012254,0.004660057,0.00330479,0.0084797],"category_scores_gemma":[0.75597125,0.0012943094,0.020249743,0.022053706,0.0031251025,0.0052555744,0.0044108084,0.002963818,0.00072904985],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.028094018,0.0011534288,0.10998471,0.14648657,0.16115409,0.00089526107,0.009233447,0.035330936,0.0013702778,0.0242101,0.01019472,0.4718926],"study_design_scores_gemma":[0.015650189,0.03207581,0.2910154,0.09145404,0.18882276,0.0032690444,0.012324334,0.16308704,0.010045114,0.099474534,0.09079058,0.0019912587],"about_ca_topic_score_codex":0.0013490475,"about_ca_topic_score_gemma":0.0010792825,"teacher_disagreement_score":0.5864624,"about_ca_system_score_codex":0.0037056047,"about_ca_system_score_gemma":0.004161552,"threshold_uncertainty_score":0.72321254},"labels":[],"label_agreement":null},{"id":"W3158629300","doi":"10.1186/s12893-021-01278-0","title":"Bias estimation in study design: a meta-epidemiological analysis of transcatheter versus surgical aortic valve replacement","year":2021,"lang":"en","type":"article","venue":"BMC Surgery","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital; Women's College Hospital; University of Toronto; Institute for Work & Health; Western University","funders":"University of Toronto; Canadian Institutes of Health Research; University of Ottawa","keywords":"Medicine; Aortic valve replacement; Propensity score matching; Stenosis; Randomized controlled trial; Aortic valve stenosis; Surgery; Aortic valve; Internal medicine; Epidemiology; Cardiology; Meta-analysis","score_opus":0.6141875518604735,"score_gpt":0.4766740758921051,"score_spread":0.13751347596836838,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3158629300","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020234017,0.922825,0.048004396,0.0030548149,0.0019238403,0.001905623,0.0005388303,0.00017834353,0.0013352162],"genre_scores_gemma":[0.7426174,0.1665723,0.07295031,0.0061321026,0.0020130498,0.0074952347,0.0010253686,0.0002507127,0.00094350957],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.5743311,0.35355842,0.043111403,0.012283217,0.015303952,0.0014118548],"domain_scores_gemma":[0.42417705,0.5070992,0.038835097,0.019659044,0.009322677,0.0009068276],"candidate_categories":["metaresearch","metaepi_narrow","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2694727,0.0037435547,0.014914433,0.010112368,0.001172255,0.008179554,0.0036659476,0.0060864203,0.0024657617],"category_scores_gemma":[0.42866236,0.002320188,0.053836115,0.007657735,0.0023637433,0.0047767907,0.004073156,0.004660575,0.00025251682],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00424488,0.000068678564,0.02567949,0.06419703,0.8628185,0.0002103521,0.0002885996,0.0030688387,0.00021016944,0.0019536633,0.0010554839,0.03620439],"study_design_scores_gemma":[0.0038834931,0.00071082,0.01294536,0.026789317,0.9344085,0.00039981358,0.00016648893,0.0057633747,0.000509357,0.009884291,0.0044103884,0.00012882064],"about_ca_topic_score_codex":0.0030532528,"about_ca_topic_score_gemma":0.0037618487,"teacher_disagreement_score":0.9962565,"about_ca_system_score_codex":0.0037538726,"about_ca_system_score_gemma":0.0039044877,"threshold_uncertainty_score":0.9008702},"labels":[{"model":"gemma","categories":["metaresearch","metaepi_broad"],"domain":"methods","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch","metaepi_narrow","metaepi_broad"],"domain":"methods","study_design":"meta_analysis","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W3159118220","doi":"10.1371/journal.pone.0250778","title":"Current trends in the application of causal inference methods to pooled longitudinal observational infectious disease studies—A protocol for a methodological systematic review","year":2021,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Institute of Genetics; Horizon 2020; Canadian Institutes of Health Research; European Commission","keywords":"Observational study; Causal inference; Confounding; Pooling; Psychological intervention; CINAHL; Mendelian randomization; Sample size determination; Clinical study design; EconLit; Propensity score matching; Research design; Protocol (science); MEDLINE; Computer science; Psychology; Medicine; Clinical trial; Statistics; Artificial intelligence; Biology; Alternative medicine; Pathology","score_opus":0.7695121858504534,"score_gpt":0.6143971825879464,"score_spread":0.15511500326250705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3159118220","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00064519595,0.039238986,0.049119793,0.013923448,0.006821218,0.8700326,0.015683625,0.0010853229,0.0034498577],"genre_scores_gemma":[0.0007529413,0.010535594,0.04442218,0.0015445508,0.00021190423,0.9402963,0.0016595155,0.00007820243,0.0004987371],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.54089516,0.2625493,0.147452,0.010744855,0.035016444,0.003342291],"domain_scores_gemma":[0.5458766,0.27375644,0.0648888,0.032015827,0.07876518,0.0046971613],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39333844,0.0047588507,0.013018757,0.025956592,0.0039461004,0.012880986,0.00951092,0.012696267,0.028409947],"category_scores_gemma":[0.55454403,0.0054842085,0.020091949,0.031750582,0.008728311,0.011368256,0.010408162,0.012466114,0.011690867],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00094719155,0.00010981346,0.0005649212,0.8136632,0.0025532672,0.00021492824,0.0022559501,0.0010604513,0.00067649625,0.017339215,0.0809962,0.07961834],"study_design_scores_gemma":[0.003244536,0.00040210263,0.0015229933,0.76248324,0.0042008082,0.00027167617,0.0007009929,0.0014538484,0.00084288785,0.026514443,0.19804282,0.000319632],"about_ca_topic_score_codex":0.004351628,"about_ca_topic_score_gemma":0.0062841433,"teacher_disagreement_score":0.60666156,"about_ca_system_score_codex":0.02096861,"about_ca_system_score_gemma":0.084450975,"threshold_uncertainty_score":0.74812174},"labels":[],"label_agreement":null},{"id":"W3160551206","doi":"10.1161/circoutcomes.120.007903","title":"Accuracy of Cardiovascular Trial Outcome Ascertainment and Treatment Effect Estimates from Routine Health Data: A Systematic Review and Meta-Analysis","year":2021,"lang":"en","type":"review","venue":"Circulation Cardiovascular Quality and Outcomes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; St. Michael's Hospital; University Health Network; University of Toronto; Women's College Hospital; Queen's University","funders":"Canadian Institutes of Health Research","keywords":"Medicine; Hazard ratio; Randomized controlled trial; Meta-analysis; Stroke (engine); Clinical trial; Random effects model; Adjudication; Internal medicine; Myocardial infarction; Confidence interval","score_opus":0.5794287875974299,"score_gpt":0.5409709812143217,"score_spread":0.03845780638310814,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3160551206","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006674835,0.9829313,0.0071698236,0.0007061732,0.0002646019,0.0007206426,0.0009971986,0.00006976942,0.00046573114],"genre_scores_gemma":[0.4914318,0.4733139,0.024069488,0.002077803,0.00081361027,0.005483151,0.002346976,0.00014271538,0.00032053792],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.7292336,0.18429777,0.056592785,0.011700786,0.01688979,0.0012852276],"domain_scores_gemma":[0.439459,0.48181337,0.05019486,0.015860062,0.012047934,0.00062476983],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19512282,0.0029426434,0.020618094,0.0147152785,0.0007880338,0.006232121,0.003959232,0.0033535443,0.0017488685],"category_scores_gemma":[0.4467784,0.0025651155,0.034768984,0.012796161,0.002438436,0.0042112623,0.002732732,0.0024847738,0.00025350007],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014574353,0.000026782624,0.019048419,0.3245978,0.6235688,0.000130537,0.00029615217,0.0015261205,0.00016385142,0.00055051316,0.0010956983,0.02753798],"study_design_scores_gemma":[0.001485454,0.00037573712,0.017526044,0.0789093,0.89368814,0.00026958925,0.00013937586,0.0014665576,0.00037991212,0.002463041,0.0031864957,0.00011039804],"about_ca_topic_score_codex":0.0046387934,"about_ca_topic_score_gemma":0.007433951,"teacher_disagreement_score":0.9793819,"about_ca_system_score_codex":0.0042380905,"about_ca_system_score_gemma":0.0054925266,"threshold_uncertainty_score":0.99255687},"labels":[],"label_agreement":null},{"id":"W3164315881","doi":"10.2217/cer-2021-0069","title":"Propensity score matching versus coarsened exact matching in observational comparative effectiveness research","year":2021,"lang":"en","type":"article","venue":"Journal of Comparative Effectiveness Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"London Health Sciences Centre; Western University","funders":"Physicians' Services Incorporated Foundation","keywords":"Propensity score matching; Observational study; Medicine; Randomized controlled trial; Matching (statistics); Comparative effectiveness research; Clinical trial; Balance (ability); Statistics; Physical therapy; Internal medicine; Mathematics; Alternative medicine; Pathology","score_opus":0.8095129096967779,"score_gpt":0.6082277517660837,"score_spread":0.20128515793069424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3164315881","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16529652,0.011184355,0.811191,0.002011851,0.0005354608,0.0062150983,0.00089394755,0.00032984803,0.0023419515],"genre_scores_gemma":[0.68680614,0.0015373548,0.30733433,0.00053260237,0.00018164296,0.0028609866,0.00041679243,0.000034088906,0.00029605732],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.84985375,0.13049619,0.007526895,0.0049886233,0.0065082535,0.0006262965],"domain_scores_gemma":[0.7896785,0.16548425,0.022314971,0.0184597,0.0032468936,0.00081567094],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13672589,0.0010276219,0.0021836814,0.0030390108,0.00062192045,0.0016520977,0.0016414226,0.0011717578,0.0035101569],"category_scores_gemma":[0.33167684,0.0005579936,0.0029869725,0.0042103506,0.0018364874,0.0029391213,0.0035316616,0.0016101656,0.00014822918],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.017740456,0.00081291044,0.079465926,0.008780451,0.016169257,0.00020810495,0.0015791717,0.13240173,0.0017670846,0.11127606,0.0034329675,0.6263659],"study_design_scores_gemma":[0.011862557,0.012119357,0.08239315,0.0030811636,0.012921519,0.0006705862,0.000619623,0.3738008,0.005694079,0.483889,0.012568156,0.00037992597],"about_ca_topic_score_codex":0.0015926218,"about_ca_topic_score_gemma":0.0014112017,"teacher_disagreement_score":0.8632741,"about_ca_system_score_codex":0.0016733826,"about_ca_system_score_gemma":0.0029102142,"threshold_uncertainty_score":0.7230842},"labels":[],"label_agreement":null},{"id":"W3164974682","doi":"10.48550/arxiv.2105.12720","title":"Marginal structural models with Latent Class Growth Modeling of Treatment Trajectories","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Covariate; Marginal structural model; Confounding; Inverse probability weighting; Observational study; Estimator; Proportional hazards model; Econometrics; Weighting; Statistics; Estimating equations; Latent class model; Computer science; Mathematics; Medicine","score_opus":0.2642149883152034,"score_gpt":0.26888424256902577,"score_spread":0.004669254253822364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3164974682","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009832853,0.00035781207,0.98760104,0.00061302556,0.000047303252,0.00009265387,0.00039437556,0.00020646636,0.0008544377],"genre_scores_gemma":[0.47878543,0.0017079068,0.5064277,0.00042632368,0.00034814278,0.0015729376,0.0021416743,0.0002922662,0.008297646],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99403894,0.00451769,0.0001528062,0.0006639903,0.00037217542,0.00025430165],"domain_scores_gemma":[0.9761446,0.019835861,0.0013414941,0.0015450934,0.00084858696,0.00028447696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013926121,0.0014457282,0.0017802158,0.0017636762,0.0007485286,0.00188992,0.0032580798,0.0016869032,0.005887531],"category_scores_gemma":[0.034935288,0.0008990925,0.003131101,0.0023038327,0.0017300302,0.0027655067,0.0026171235,0.0044467878,0.0008694635],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019415091,0.00011389546,0.007229398,0.0001853497,0.00034305005,0.00014174845,0.00071579375,0.4070633,0.00028270137,0.5310582,0.0024248196,0.050247602],"study_design_scores_gemma":[0.000027385378,0.000027851807,0.0005032011,0.000031484473,0.000038460497,0.000026220601,0.00004756893,0.7657587,0.00007796474,0.23204428,0.0013998018,0.000017063618],"about_ca_topic_score_codex":0.013891139,"about_ca_topic_score_gemma":0.013170334,"teacher_disagreement_score":0.013926121,"about_ca_system_score_codex":0.0026209522,"about_ca_system_score_gemma":0.0025051201,"threshold_uncertainty_score":0.07364923},"labels":[],"label_agreement":null},{"id":"W3167041284","doi":"10.1371/journal.pone.0253057","title":"EA3: A softmax algorithm for evidence appraisal aggregation","year":2021,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medizinische Universität Wien; European Research Council; Universität Wien; University of Toronto; Deutsche Forschungsgemeinschaft","keywords":"Softmax function; Inference; Function (biology); Causal inference; Bayesian probability; Computer science; Aggregate (composite); Quality (philosophy); Risk analysis (engineering); Artificial intelligence; Machine learning; Data science; Management science; Medicine; Econometrics; Mathematics; Economics; Artificial neural network; Epistemology","score_opus":0.33230842506662195,"score_gpt":0.42308011353026176,"score_spread":0.09077168846363981,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3167041284","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029145645,0.00048114444,0.99384624,0.0005036437,0.00006334922,0.00021507997,0.00018614029,0.0007207414,0.0010691289],"genre_scores_gemma":[0.07915994,0.000425447,0.91648316,0.00046972188,0.00015640921,0.0008005001,0.00056358916,0.00021479887,0.0017263805],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9931409,0.0037559762,0.00091931515,0.0007260822,0.0011881402,0.0002695494],"domain_scores_gemma":[0.9797117,0.015519534,0.0010658371,0.0011572433,0.0022134143,0.00033227997],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015861275,0.0015288258,0.0020757962,0.0047848173,0.00095610716,0.0034405522,0.0024346367,0.0025601387,0.008447128],"category_scores_gemma":[0.046909545,0.00091080816,0.002414918,0.003899504,0.0010804645,0.003547457,0.004455707,0.0036674005,0.0020960765],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004863778,0.00018677466,0.0024541751,0.0007615731,0.00061559014,0.00021694339,0.00048609168,0.16955158,0.0023680348,0.046421077,0.011837802,0.7646141],"study_design_scores_gemma":[0.0001344842,0.00014676574,0.0007945401,0.00021390367,0.00014396972,0.0001200407,0.00010001293,0.8352284,0.0026644592,0.15150358,0.008902323,0.000047413738],"about_ca_topic_score_codex":0.0027016785,"about_ca_topic_score_gemma":0.003626043,"teacher_disagreement_score":0.015861275,"about_ca_system_score_codex":0.0016977547,"about_ca_system_score_gemma":0.00430524,"threshold_uncertainty_score":0.083883405},"labels":[],"label_agreement":null},{"id":"W3167159522","doi":"10.1016/j.cjca.2021.05.012","title":"Emulating a Randomised Controlled Trial With Observational Data: An Introduction to the Target Trial Framework","year":2021,"lang":"en","type":"review","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":64,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Montreal Heart Institute; Université de Montréal; McGill University Health Centre; McGill University","funders":"Faculty of Medicine, McGill University","keywords":"Medicine; Observational study; Randomized controlled trial; Physical therapy; Medical physics; Internal medicine","score_opus":0.3421173803111958,"score_gpt":0.45621014785226793,"score_spread":0.11409276754107212,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3167159522","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004868172,0.06423185,0.9269172,0.005482806,0.000794474,0.0002421544,0.00035168705,0.00024558106,0.0012474591],"genre_scores_gemma":[0.058354177,0.11962249,0.8034702,0.0049458053,0.0056071864,0.0045435037,0.0005460371,0.00031320768,0.0025974065],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9353949,0.05791328,0.0024074733,0.0014613696,0.0026013386,0.000221707],"domain_scores_gemma":[0.8127428,0.18106297,0.0020999233,0.0021284083,0.0016506421,0.00031527042],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.062269468,0.002421453,0.006994443,0.0025036286,0.0003538074,0.004058769,0.004631215,0.0041708266,0.004874971],"category_scores_gemma":[0.13435045,0.0013136925,0.0064091054,0.0030354243,0.0028364584,0.004204058,0.002461159,0.010150265,0.0010218521],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041423744,0.00010329571,0.0006321209,0.009308661,0.002599324,0.0002148011,0.00024137842,0.090259716,0.00029968782,0.68847466,0.008606104,0.19884607],"study_design_scores_gemma":[0.00053859013,0.00025777664,0.00028961472,0.0022544765,0.0008878134,0.00023652751,0.00003907793,0.15474631,0.0002974777,0.8208632,0.019496325,0.00009276721],"about_ca_topic_score_codex":0.0027466319,"about_ca_topic_score_gemma":0.0017572382,"teacher_disagreement_score":0.93773055,"about_ca_system_score_codex":0.0024142496,"about_ca_system_score_gemma":0.0044294586,"threshold_uncertainty_score":0.32931632},"labels":[],"label_agreement":null},{"id":"W3168529271","doi":"10.1002/9781118445112.stat07475","title":"<scp>J</scp> oint <scp>M</scp> odels","year":2014,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Conditional independence; Independence (probability theory); Computer science; Event (particle physics); Joint (building); Process (computing); Econometrics; Latent growth modeling; Longitudinal data; Artificial intelligence; Statistics; Machine learning; Mathematics; Data mining; Engineering","score_opus":0.11693235072682291,"score_gpt":0.3903701334789807,"score_spread":0.2734377827521578,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3168529271","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002323787,0.0028791907,0.2880784,0.020181818,0.004322369,0.00024093343,0.015591712,0.0052550454,0.66112673],"genre_scores_gemma":[0.10889514,0.0073110443,0.13063113,0.0039627394,0.0045179967,0.0006180557,0.017280802,0.0057778787,0.72100514],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980299,0.00042567635,0.00010672593,0.00044787064,0.0008799324,0.00010994619],"domain_scores_gemma":[0.9924125,0.0033031518,0.00050152914,0.0014531594,0.0019257515,0.00040395942],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0025894826,0.00091750093,0.0011494451,0.0032019126,0.001226684,0.005027994,0.0021651923,0.0018176585,0.3775341],"category_scores_gemma":[0.014134721,0.00046439824,0.00093614147,0.0060174605,0.0015733442,0.0030298838,0.0025006367,0.002311467,0.14697608],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000050162547,0.00008274256,0.00069965376,0.0002254822,0.00002817876,0.00019969932,0.000076252916,0.005174893,0.00040971691,0.23997127,0.5636315,0.18945052],"study_design_scores_gemma":[0.00002554914,0.000020268324,0.00093489554,0.0002453348,0.000015679421,0.00025577238,0.00005889776,0.03793868,0.0013473002,0.32047457,0.6386334,0.00004964487],"about_ca_topic_score_codex":0.0098486515,"about_ca_topic_score_gemma":0.011326835,"teacher_disagreement_score":0.3775341,"about_ca_system_score_codex":0.0032279997,"about_ca_system_score_gemma":0.0032266206,"threshold_uncertainty_score":0.8878721},"labels":[],"label_agreement":null},{"id":"W3168647111","doi":"10.1214/22-aoas1726","title":"Evaluating the use of generalized dynamic weighted ordinary least squares for individualized HIV treatment strategies","year":2023,"lang":"en","type":"article","venue":"The Annals of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Agence Nationale de la Recherche","keywords":"Categorical variable; Estimator; Ordinary least squares; Human immunodeficiency virus (HIV); Mathematics; Population; Mathematical optimization; Robustness (evolution); Computer science; Medicine; Statistics; Econometrics; Algorithm; Immunology","score_opus":0.6063138857192424,"score_gpt":0.5398848109691714,"score_spread":0.06642907475007098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3168647111","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14368768,0.0020325708,0.8480628,0.0011827071,0.00009305489,0.00038661915,0.00019333494,0.0003858762,0.0039754095],"genre_scores_gemma":[0.7748069,0.00051420496,0.22278605,0.00025374134,0.00004696349,0.00035040893,0.00022833556,0.00009114848,0.00092229026],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98791933,0.009859153,0.0003396042,0.00065290456,0.0010186582,0.00021028607],"domain_scores_gemma":[0.9040384,0.08937324,0.002472102,0.0017142475,0.001960357,0.00044160118],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022166196,0.0012566862,0.0016210852,0.0013342967,0.0004245512,0.0015611709,0.0015386641,0.0016709714,0.0017130027],"category_scores_gemma":[0.08644311,0.00064995646,0.0009513054,0.0010198788,0.0010849491,0.0017106527,0.0013684384,0.0014964275,0.00018450763],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003384024,0.00013317872,0.004176367,0.00016740507,0.00034071843,0.000039186376,0.0000779288,0.9277818,0.0003454479,0.010907743,0.00044000102,0.055251654],"study_design_scores_gemma":[0.000036689667,0.00018463007,0.00045987786,0.000022893339,0.000040584695,0.000011648887,0.000025946129,0.99175465,0.00025390342,0.00694284,0.0002562743,0.000010106541],"about_ca_topic_score_codex":0.0058653215,"about_ca_topic_score_gemma":0.005556967,"teacher_disagreement_score":0.022166196,"about_ca_system_score_codex":0.0015260865,"about_ca_system_score_gemma":0.0027872545,"threshold_uncertainty_score":0.117227435},"labels":[],"label_agreement":null},{"id":"W3170350666","doi":"10.1186/s12874-021-01452-1","title":"Evaluating the performance of propensity score matching based approaches in individual patient data meta-analysis","year":2021,"lang":"en","type":"review","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"","keywords":"Propensity score matching; Observational study; Confounding; Matching (statistics); Meta-analysis; Random effects model; Statistics; Logistic regression; Medicine; Odds ratio; Internal medicine; Mathematics","score_opus":0.9918079962204878,"score_gpt":0.7322729214567691,"score_spread":0.2595350747637186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3170350666","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15359421,0.081815235,0.7480682,0.003955765,0.0006164309,0.005435426,0.0028296446,0.0012278972,0.0024571286],"genre_scores_gemma":[0.69020045,0.007882346,0.29594103,0.00079074106,0.00022646903,0.003555206,0.0010188225,0.0001791034,0.00020584087],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.71916074,0.2638281,0.008127286,0.004228431,0.0041672303,0.00048826885],"domain_scores_gemma":[0.39534432,0.5690005,0.016359948,0.013380076,0.0050519556,0.00086316327],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2956173,0.003026921,0.0052956846,0.0072244518,0.0008041637,0.0036243242,0.0031262033,0.003012422,0.002303062],"category_scores_gemma":[0.40889233,0.0014802458,0.019546038,0.006941517,0.0011544786,0.0030114055,0.003368637,0.0027701792,0.00019546323],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009834159,0.00033708685,0.06883846,0.011634544,0.3053182,0.0002924455,0.0005238409,0.47442466,0.0005586608,0.009182461,0.0021153756,0.11694014],"study_design_scores_gemma":[0.0054520657,0.0040388196,0.017903302,0.002824263,0.1330357,0.0004540709,0.00019778595,0.7859434,0.0019728362,0.04280564,0.0050187116,0.00035348546],"about_ca_topic_score_codex":0.0031401732,"about_ca_topic_score_gemma":0.0020538121,"teacher_disagreement_score":0.70438266,"about_ca_system_score_codex":0.0030273614,"about_ca_system_score_gemma":0.004067902,"threshold_uncertainty_score":0.8686293},"labels":[],"label_agreement":null},{"id":"W3171631375","doi":"10.1002/jae.2985","title":"Multiple testing with covariate adjustment in experimental economics","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; National Science Foundation","keywords":"Covariate; Null hypothesis; Statistics; Statistical hypothesis testing; Null (SQL); Econometrics; Multiple comparisons problem; Statistical power; Mathematics; Alternative hypothesis; Sample size determination; Computer science; Data mining","score_opus":0.2636212041580691,"score_gpt":0.36247357626277843,"score_spread":0.09885237210470932,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3171631375","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016781129,0.0008213353,0.97366434,0.0024411778,0.00018545908,0.00031409165,0.0002502183,0.00031812614,0.005224109],"genre_scores_gemma":[0.46153647,0.0009910577,0.53140146,0.0009404069,0.0004445522,0.0016914712,0.00016341955,0.00014701749,0.0026841152],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9005677,0.08604086,0.0018924852,0.0050396,0.005740995,0.00071839156],"domain_scores_gemma":[0.75225693,0.20404674,0.013046807,0.023889031,0.0057003014,0.0010602114],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.064949706,0.0010702284,0.0021356673,0.0017476528,0.00090060197,0.0023537737,0.0029396357,0.0022732131,0.008212],"category_scores_gemma":[0.22037676,0.0006993462,0.0021163952,0.0024356456,0.0056255716,0.0042821406,0.002822978,0.003924307,0.0005721132],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052421156,0.00032144942,0.0063647837,0.0006412529,0.00053655176,0.00025174455,0.0004059537,0.032534584,0.0013413852,0.8515545,0.002342914,0.10318062],"study_design_scores_gemma":[0.000164223,0.00023768305,0.0031260182,0.000095316114,0.00008787517,0.00005489949,0.00006276455,0.07721886,0.0008940127,0.9138393,0.004178926,0.000040041068],"about_ca_topic_score_codex":0.0018998545,"about_ca_topic_score_gemma":0.0012024054,"teacher_disagreement_score":0.9350503,"about_ca_system_score_codex":0.0031464892,"about_ca_system_score_gemma":0.0032213128,"threshold_uncertainty_score":0.34349096},"labels":[],"label_agreement":null},{"id":"W3172234771","doi":"","title":"Commentary on Cox et al.","year":2019,"lang":"en","type":"article","venue":"Evidence-Based Mental Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Psychology","score_opus":0.19573689921768495,"score_gpt":0.47611042619721117,"score_spread":0.2803735269795262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3172234771","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000024978875,0.0038780614,0.0000881578,0.9313862,0.06367513,0.00001263534,0.00014736927,0.000014268659,0.0007730852],"genre_scores_gemma":[0.00050004903,0.00210475,0.00015643494,0.9455903,0.05007987,0.000058551646,0.00004281231,0.000030900017,0.0014362828],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9732271,0.009633716,0.0033367372,0.0032703301,0.009287491,0.00124461],"domain_scores_gemma":[0.8043729,0.14875396,0.004397929,0.0040281247,0.032173485,0.0062736385],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035065193,0.0020822543,0.0046922304,0.0034484973,0.0059266174,0.008970304,0.010934136,0.07288313,0.017914627],"category_scores_gemma":[0.25453565,0.0019199537,0.004709311,0.0041837473,0.008795041,0.010171232,0.0042718956,0.09861115,0.01350795],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026906408,0.000004249343,0.0000185888,0.00013126407,0.000018711506,0.000026928074,0.000034112094,0.00001709677,0.0000064950773,0.0019148744,0.99597,0.0018307582],"study_design_scores_gemma":[0.0002672664,0.000025753907,0.00029230086,0.0029443162,0.00014680566,0.00023971025,0.0002015577,0.00014976838,0.00012445636,0.016878666,0.97863925,0.00009011098],"about_ca_topic_score_codex":0.023507284,"about_ca_topic_score_gemma":0.028415877,"teacher_disagreement_score":0.07288313,"about_ca_system_score_codex":0.009419079,"about_ca_system_score_gemma":0.017570669,"threshold_uncertainty_score":0.18544465},"labels":[],"label_agreement":null},{"id":"W3173229721","doi":"","title":"Methods for Population Adjustment with Limited Access to Individual Patient Data: A Review and Simulation Study","year":2021,"lang":"en","type":"review","venue":"UCL Discovery (University College London)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Engineering and Physical Sciences Research Council; Canadian Institutes of Health Research; Institute of Conservation","keywords":"Computer science; Data collection; Research methodology; Population; Data science; Management science; Statistics; Demography; Sociology","score_opus":0.30749754247377786,"score_gpt":0.4937568482589888,"score_spread":0.18625930578521094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3173229721","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011981152,0.90994954,0.07830948,0.0031336227,0.0008617418,0.0014764274,0.0009378754,0.00025118375,0.003882049],"genre_scores_gemma":[0.031706844,0.8498082,0.10808992,0.0019631966,0.00067643204,0.0053332425,0.0009252442,0.00014749286,0.0013494944],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9797896,0.015475857,0.0017958388,0.0006215641,0.0021537142,0.00016342763],"domain_scores_gemma":[0.8996425,0.08931813,0.004231153,0.002119373,0.004396641,0.00029214035],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0335491,0.0013806381,0.0036198706,0.0071206633,0.00037782136,0.0018337494,0.002438154,0.0017871726,0.011796628],"category_scores_gemma":[0.12204997,0.00069200364,0.00935422,0.008465924,0.0006625841,0.00241247,0.0011085062,0.0021194878,0.0012408674],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046302628,0.00011678268,0.0019375738,0.14963698,0.008424442,0.00022141747,0.00021762932,0.017320873,0.00012368563,0.028535783,0.029553434,0.7634484],"study_design_scores_gemma":[0.0014424443,0.0010364132,0.008777523,0.28335527,0.034128703,0.002260186,0.00038903396,0.04898312,0.00066572113,0.116288744,0.5022785,0.00039436712],"about_ca_topic_score_codex":0.0060287626,"about_ca_topic_score_gemma":0.006660673,"teacher_disagreement_score":0.9664509,"about_ca_system_score_codex":0.003150265,"about_ca_system_score_gemma":0.007046172,"threshold_uncertainty_score":0.1774267},"labels":[],"label_agreement":null},{"id":"W3173591338","doi":"10.1136/bmjopen-2020-045410","title":"Simulation study on the validity of the average risk approach in estimating population attributable fractions for continuous exposures","year":2021,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Calgary; McMaster University; Queen's University; Impact; Alberta Health Services","funders":"Canadian Cancer Society","keywords":"Medicine; Attributable risk; Population; Environmental health; Epidemiology; Statistics; Internal medicine","score_opus":0.4618158466234644,"score_gpt":0.5231943004545682,"score_spread":0.06137845383110374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3173591338","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8750279,0.0022075472,0.11234007,0.0011917525,0.00013920103,0.00045458836,0.0017569871,0.00021926247,0.0066627986],"genre_scores_gemma":[0.96861935,0.0005013672,0.028711366,0.00016816634,0.000030532075,0.0003195302,0.00096827885,0.000029585844,0.00065184064],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99177706,0.0065859994,0.00026487818,0.0005860394,0.00045371425,0.00033237113],"domain_scores_gemma":[0.7440842,0.2383508,0.005403666,0.004565426,0.0068019237,0.0007940894],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.024498286,0.0010160345,0.0011997004,0.0018955328,0.0007222662,0.0012599342,0.0019689305,0.0018250507,0.0026528526],"category_scores_gemma":[0.0820959,0.0004780796,0.00230587,0.0020765727,0.00093719986,0.0014313175,0.0011628263,0.0022712422,0.00018622327],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006547869,0.00026960718,0.03619025,0.00023826104,0.00046588026,0.00017832255,0.00019610074,0.9433583,0.0002469034,0.008592921,0.0010055637,0.008603163],"study_design_scores_gemma":[0.00016982392,0.00029740203,0.005282211,0.00011857611,0.00020585963,0.00010758006,0.00013260581,0.9880967,0.000276918,0.0046542697,0.00061624986,0.000041886946],"about_ca_topic_score_codex":0.033029154,"about_ca_topic_score_gemma":0.015332444,"teacher_disagreement_score":0.9755017,"about_ca_system_score_codex":0.0021165311,"about_ca_system_score_gemma":0.0021089741,"threshold_uncertainty_score":0.12956083},"labels":[],"label_agreement":null},{"id":"W3174385715","doi":"10.1214/21-aoas1570","title":"Estimation of the marginal effect of antidepressants on body mass index under confounding and endogenous covariate-driven monitoring times","year":2022,"lang":"en","type":"article","venue":"The Annals of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariate; Endogeneity; Confounding; Statistics; Body mass index; Propensity score matching; Marginal structural model; Econometrics; Selection bias; Index (typography); Medicine; Computer science; Mathematics; Internal medicine","score_opus":0.17584202781014677,"score_gpt":0.41534126538013316,"score_spread":0.2394992375699864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3174385715","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.081939064,0.0030075342,0.9105866,0.0013649974,0.00016968344,0.00028910846,0.0009431789,0.00020079102,0.0014990692],"genre_scores_gemma":[0.6937077,0.004872694,0.2925583,0.0008060886,0.0004710756,0.0011112794,0.00176031,0.00011577654,0.004596738],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98673356,0.009455225,0.00064188836,0.0019386344,0.00084363687,0.00038699323],"domain_scores_gemma":[0.8961616,0.09132943,0.0053975764,0.005286582,0.0014735374,0.0003512397],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029537143,0.0010824157,0.0020344404,0.0014464841,0.00045296372,0.0016448277,0.002583616,0.001810678,0.0036884556],"category_scores_gemma":[0.12355511,0.00075036724,0.0034128423,0.0025237242,0.0018932772,0.0026150406,0.0019396594,0.0024443285,0.00037432194],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011324373,0.00035718826,0.15997376,0.0021846408,0.0055319634,0.001007261,0.0015445647,0.20340107,0.0017577886,0.35106912,0.0034839169,0.26855627],"study_design_scores_gemma":[0.0002779999,0.0006854186,0.052843165,0.00059706415,0.0025030815,0.0005724834,0.00028535913,0.5066868,0.0022196437,0.42273536,0.010472121,0.000121491736],"about_ca_topic_score_codex":0.007760918,"about_ca_topic_score_gemma":0.0045684464,"teacher_disagreement_score":0.029537143,"about_ca_system_score_codex":0.0013295321,"about_ca_system_score_gemma":0.0026861222,"threshold_uncertainty_score":0.15620923},"labels":[],"label_agreement":null},{"id":"W3180503092","doi":"10.1016/j.jeconom.2023.02.011","title":"Inference on individual treatment effects in nonseparable triangular models","year":2023,"lang":"en","type":"article","venue":"Journal of Econometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Japan Society for the Promotion of Science; National Natural Science Foundation of China; National Outstanding Youth Science Fund Project of National Natural Science Foundation of China; Social Sciences and Humanities Research Council of Canada; Renmin University of China; Japan Society for the Promotion of Science London","keywords":"Mathematics; Jackknife resampling; Estimator; Asymptotic distribution; Density estimation; Kernel density estimation; Instrumental variable; Applied mathematics; Inference; Nonparametric statistics; Statistics; Econometrics; Artificial intelligence; Computer science","score_opus":0.5512096984674635,"score_gpt":0.43109320865724554,"score_spread":0.12011648981021794,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3180503092","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.054935478,0.00053710514,0.9395275,0.001498053,0.00012749403,0.00029569364,0.0004259692,0.00026122955,0.0023916035],"genre_scores_gemma":[0.781648,0.0010069254,0.2074166,0.00074641895,0.00030091658,0.0009549597,0.00081108825,0.00013818099,0.0069769947],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96385807,0.027239481,0.0014002674,0.0044064145,0.0015444972,0.0015512559],"domain_scores_gemma":[0.60694027,0.37001634,0.0064537567,0.013230162,0.0021691357,0.0011903779],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.056868225,0.0011988002,0.004731209,0.0020192598,0.0012485256,0.0043450277,0.0050578765,0.0050808014,0.015179273],"category_scores_gemma":[0.20570984,0.0022351514,0.004028812,0.0026400439,0.0044348873,0.0075086905,0.0034903453,0.0064148894,0.0010513093],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017212906,0.0006933405,0.011004971,0.0005454887,0.0014156655,0.00057255995,0.001467951,0.17189655,0.00047854663,0.7010741,0.0029182336,0.10621121],"study_design_scores_gemma":[0.0002875205,0.00013593078,0.0009407235,0.00006659614,0.00029164331,0.00008013907,0.00013913252,0.363939,0.00023138752,0.633252,0.00060382724,0.000031972748],"about_ca_topic_score_codex":0.008674997,"about_ca_topic_score_gemma":0.0071905907,"teacher_disagreement_score":0.056868225,"about_ca_system_score_codex":0.0018926968,"about_ca_system_score_gemma":0.0027606625,"threshold_uncertainty_score":0.3007515},"labels":[],"label_agreement":null},{"id":"W3181564238","doi":"10.29173/cais1219","title":"A Bibliometric Analysis of Race-Related Research in LIS","year":2021,"lang":"en","type":"article","venue":"Proceedings of the Annual Conference of CAIS / Actes du congrès annuel de l ACSI","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University; Dalhousie University; Western University","funders":"","keywords":"Diversity (politics); Equity (law); Race (biology); Work (physics); Sociology; Political science; Library science; Regional science; Social science; Computer science; Engineering; Gender studies; Anthropology","score_opus":0.1645688386437193,"score_gpt":0.4133993316957991,"score_spread":0.24883049305207983,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3181564238","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.92416906,0.008897305,0.0034864866,0.0030763457,0.000102766695,0.00019932809,0.017087469,0.00018446759,0.042796638],"genre_scores_gemma":[0.98807275,0.0029354335,0.0019796141,0.00008808799,0.00018320845,0.000114717936,0.0052676424,0.00002556361,0.0013331203],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9848909,0.005655997,0.0021002516,0.0008194995,0.0058187856,0.0007146588],"domain_scores_gemma":[0.86811876,0.07579815,0.027437538,0.0053322017,0.021101892,0.0022114792],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.011813371,0.00025726264,0.00088604254,0.11681627,0.0016284945,0.004468049,0.0007341369,0.00060903234,0.0052009905],"category_scores_gemma":[0.097968064,0.00017477282,0.0007764324,0.20844632,0.0010178103,0.0035049622,0.0021853403,0.00046112054,0.0008206255],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023024502,0.00013663675,0.87562853,0.0020118393,0.0006737738,0.00022963714,0.00397331,0.0016645173,0.00094281416,0.011708027,0.0071075987,0.09569301],"study_design_scores_gemma":[0.0000185483,0.000109623994,0.9628999,0.00044690623,0.00027293802,0.00030789495,0.0061758165,0.0042924625,0.0005860921,0.0042240564,0.02062887,0.000036796282],"about_ca_topic_score_codex":0.011026049,"about_ca_topic_score_gemma":0.012358236,"teacher_disagreement_score":0.98818666,"about_ca_system_score_codex":0.0036564087,"about_ca_system_score_gemma":0.0041927146,"threshold_uncertainty_score":0.06247586},"labels":[{"model":"gemma","categories":["metaresearch","bibliometrics"],"domain":"incentives","study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["bibliometrics"],"domain":null,"study_design":"observational","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W3182566191","doi":"10.1016/j.hlpt.2021.100545","title":"Analysing electronic health records: The benefits of target trial emulation","year":2021,"lang":"en","type":"article","venue":"Health Policy and Technology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Horizon 2020; European Commission; Trent University; Kingston University; Nottingham Trent University","keywords":"Observational study; Confounding; Emulation; Selection bias; Information bias; Randomized controlled trial; Medicine; Health records; Clinical trial; Relevance (law); Computer science; Health care; Medical physics; Psychology; Internal medicine","score_opus":0.13086425565288243,"score_gpt":0.4726321239005088,"score_spread":0.3417678682476264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3182566191","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008355422,0.0010857146,0.98333746,0.00399708,0.00017214185,0.00028353528,0.00022286565,0.0005155769,0.002030197],"genre_scores_gemma":[0.39820105,0.0018509751,0.59100986,0.00229779,0.0008820707,0.0019017548,0.0006574006,0.00049175275,0.0027073086],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.78388286,0.2012338,0.0036250122,0.0046432535,0.0060990276,0.0005159918],"domain_scores_gemma":[0.21400179,0.7310291,0.010599257,0.038927376,0.0047983676,0.0006441192],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15297307,0.0016877789,0.0041889674,0.0028330442,0.0010818482,0.0056963954,0.004862712,0.004382033,0.007093896],"category_scores_gemma":[0.61052364,0.0015115818,0.0029227745,0.0040520877,0.003968233,0.013200094,0.005406654,0.006978121,0.0012826658],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004913038,0.00071417785,0.015131456,0.0019673575,0.0033059625,0.00034350288,0.0016786613,0.16407892,0.00120347,0.33452922,0.009062466,0.46307182],"study_design_scores_gemma":[0.00068648346,0.0003912338,0.0015113407,0.0003090061,0.0005336691,0.00020279858,0.0001547406,0.45399937,0.0014142839,0.53601724,0.004717961,0.00006180826],"about_ca_topic_score_codex":0.0014501488,"about_ca_topic_score_gemma":0.0008277352,"teacher_disagreement_score":0.84702694,"about_ca_system_score_codex":0.0017552495,"about_ca_system_score_gemma":0.004445625,"threshold_uncertainty_score":0.8090086},"labels":[],"label_agreement":null},{"id":"W3182851625","doi":"10.1097/ede.0000000000001379","title":"To Bound or Not to Bound","year":2021,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Columbia university; Statistics; History; Genealogy; Library science; Geography; Demography; Media studies; Mathematics; Sociology; Computer science","score_opus":0.4387032220054125,"score_gpt":0.5088100046339101,"score_spread":0.07010678262849762,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3182851625","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048747376,0.0030534975,0.002078275,0.94262147,0.016689276,0.000016977356,0.0001776781,0.000040044022,0.03483531],"genre_scores_gemma":[0.04317304,0.004617897,0.0025087013,0.8724221,0.031114584,0.000116457064,0.00019428466,0.000166984,0.04568594],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9854033,0.007102319,0.00092528656,0.0022305916,0.00301985,0.0013185579],"domain_scores_gemma":[0.94495934,0.040683962,0.0022127668,0.003775037,0.006653823,0.0017151566],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012842579,0.0006234234,0.001163141,0.0009276063,0.0024393967,0.003780733,0.001317363,0.013474024,0.030374698],"category_scores_gemma":[0.14816624,0.0004067371,0.0006559535,0.0008415077,0.0057468945,0.0046153953,0.0017878932,0.025431048,0.018179681],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011835725,0.000020592155,0.000674089,0.000081735496,0.0000264931,0.00025138687,0.00018677193,0.000109516026,0.000073301606,0.09886574,0.86850154,0.031090498],"study_design_scores_gemma":[0.00014140489,0.00004451119,0.00090490235,0.00063676,0.00004202488,0.00085947075,0.00045483973,0.00095816253,0.00026533552,0.34821135,0.6474279,0.00005332548],"about_ca_topic_score_codex":0.0073743793,"about_ca_topic_score_gemma":0.007468822,"teacher_disagreement_score":0.030374698,"about_ca_system_score_codex":0.0040252376,"about_ca_system_score_gemma":0.0041579413,"threshold_uncertainty_score":0.10161352},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"not_applicable","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W3186631519","doi":"10.1038/s41366-021-00909-z","title":"Errors in the implementation, analysis, and reporting of randomization within obesity and nutrition research: a guide to their avoidance","year":2021,"lang":"en","type":"review","venue":"International Journal of Obesity","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"National Institute of Diabetes and Digestive and Kidney Diseases; National Cancer Institute; National Heart, Lung, and Blood Institute","keywords":"Randomized controlled trial; Randomization; Pooling; Randomized experiment; Causal inference; Random assignment; Research design; Statistical power; Psychology; Computer science; Econometrics; Medicine; Statistics; Artificial intelligence; Mathematics","score_opus":0.3229823804839253,"score_gpt":0.569537068589849,"score_spread":0.24655468810592368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3186631519","genre_codex":"methods","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006546013,0.16126287,0.6954915,0.094885364,0.026664045,0.009327113,0.0013416441,0.0021086212,0.008264294],"genre_scores_gemma":[0.0037022266,0.08370665,0.8546082,0.029546248,0.00431464,0.017921137,0.0004690032,0.00093740236,0.0047945543],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.41296235,0.43125814,0.08268686,0.007560172,0.06408786,0.0014446252],"domain_scores_gemma":[0.24033836,0.6122121,0.046550903,0.040777292,0.05794614,0.002175104],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39016086,0.0042569996,0.005280818,0.012676147,0.0036384338,0.0102305235,0.011136775,0.01354214,0.0057334728],"category_scores_gemma":[0.6193075,0.004608699,0.0049584084,0.015004412,0.028697474,0.014778977,0.0086193355,0.026619306,0.009320103],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037536232,0.00015681102,0.0006326805,0.026510326,0.0004818008,0.00037339292,0.007555916,0.0016251748,0.0013609764,0.20301215,0.3108817,0.44703376],"study_design_scores_gemma":[0.00020210475,0.00022229827,0.0006532728,0.043152828,0.00028145092,0.0007932161,0.0011116435,0.0019997917,0.0015263505,0.13402028,0.81572956,0.00030716945],"about_ca_topic_score_codex":0.006060913,"about_ca_topic_score_gemma":0.008303142,"teacher_disagreement_score":0.60983914,"about_ca_system_score_codex":0.0074651567,"about_ca_system_score_gemma":0.032392126,"threshold_uncertainty_score":0.75204027},"labels":[],"label_agreement":null},{"id":"W3187148082","doi":"10.1002/cjs.11650","title":"Nested doubly robust estimating equations for causal analysis with an incomplete effect modifier","year":2021,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Causal inference; Estimator; Inverse probability; Inference; Confounding; Covariate; Estimating equations; Econometrics; Missing data; Mathematics; Causal model; Computer science; Statistics; Artificial intelligence; Posterior probability; Bayesian probability","score_opus":0.17286319533372785,"score_gpt":0.3824992649622621,"score_spread":0.20963606962853426,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3187148082","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011872556,0.00032495084,0.9975853,0.00022433081,0.000027186816,0.000071277194,0.00023986457,0.000094908326,0.00024491482],"genre_scores_gemma":[0.07044307,0.002065256,0.91977787,0.00045316672,0.00022717567,0.0016841267,0.0016387407,0.00012864603,0.0035818196],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9814082,0.014538886,0.0007477428,0.001486015,0.0014446862,0.00037459604],"domain_scores_gemma":[0.9228234,0.06530974,0.004412899,0.0044546537,0.002612971,0.00038628717],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037744835,0.0017109774,0.004149196,0.0023869753,0.00058476836,0.0017143249,0.004380814,0.0024173327,0.0067532877],"category_scores_gemma":[0.097692326,0.0016232342,0.004589964,0.0029157028,0.0015793488,0.0029155489,0.0031384036,0.0055940696,0.0013289618],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001344309,0.00012596835,0.0060962695,0.0005989306,0.0011125901,0.00041177007,0.00040493387,0.17845114,0.0008695468,0.7264838,0.0037659134,0.08154453],"study_design_scores_gemma":[0.00010463443,0.00010062259,0.0013115627,0.00013436825,0.00035969718,0.00014721032,0.000040889783,0.6305696,0.00037878647,0.36046916,0.0063276705,0.000055718396],"about_ca_topic_score_codex":0.010665258,"about_ca_topic_score_gemma":0.011263488,"teacher_disagreement_score":0.037744835,"about_ca_system_score_codex":0.0018301961,"about_ca_system_score_gemma":0.0041197347,"threshold_uncertainty_score":0.19961613},"labels":[],"label_agreement":null},{"id":"W3187664365","doi":"10.1002/cjs.11648","title":"Dummy endogenous treatment effect estimation using high‐dimensional instrumental variables","year":2021,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Instrumental variable; Estimator; Logistic regression; Average treatment effect; Propensity score matching; Econometrics; Statistics; Curse of dimensionality; Ordinary least squares; Mathematics; Estimation; Regression; Variables; Monte Carlo method; Linear regression; Variable (mathematics); Computer science; Economics","score_opus":0.12615962435199574,"score_gpt":0.34170076068560956,"score_spread":0.21554113633361383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3187664365","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035799402,0.00012056711,0.99432653,0.00027428794,0.000047422065,0.00023074837,0.00029461674,0.00021825553,0.0009076393],"genre_scores_gemma":[0.22890458,0.00055160205,0.75884336,0.0009260027,0.00020711192,0.0031141748,0.0014843061,0.00021277313,0.0057561197],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9761572,0.01888959,0.00078744726,0.0017882991,0.0017167712,0.0006606902],"domain_scores_gemma":[0.9488273,0.037666123,0.0051165964,0.006352062,0.0016816488,0.00035616072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025703657,0.0011563546,0.0024103308,0.002064231,0.0007677667,0.0025172865,0.0037767137,0.0017444903,0.01433391],"category_scores_gemma":[0.0854544,0.001020045,0.0028748917,0.0025945443,0.0021426182,0.0020467443,0.003588745,0.0039788196,0.0021052044],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048147465,0.0006552343,0.02938994,0.0009213921,0.001322324,0.0003590023,0.00072466023,0.13689919,0.0014595811,0.61494464,0.010490851,0.20235182],"study_design_scores_gemma":[0.0006564751,0.00038833334,0.008698865,0.00036994365,0.00049992406,0.00018855954,0.00025378919,0.58257043,0.0043662367,0.37883,0.023022138,0.00015526441],"about_ca_topic_score_codex":0.0031079296,"about_ca_topic_score_gemma":0.0027785788,"teacher_disagreement_score":0.025703657,"about_ca_system_score_codex":0.0012714148,"about_ca_system_score_gemma":0.0036766182,"threshold_uncertainty_score":0.13593554},"labels":[],"label_agreement":null},{"id":"W3187850904","doi":"10.1177/09622802211034219","title":"The change in estimate method for selecting confounders: A simulation study","year":2021,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université Laval; The Quebec Population Health Research Network","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Confounding; Statistics; Confidence interval; Estimator; Standard error; Computer science; Econometrics; Medicine; Mathematics","score_opus":0.7422332657896927,"score_gpt":0.7739657669283295,"score_spread":0.03173250113863679,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3187850904","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3774579,0.0025718869,0.6057291,0.002245697,0.00032045657,0.0023484905,0.0010713156,0.00036837434,0.007886819],"genre_scores_gemma":[0.8016229,0.0010581522,0.19295184,0.00032842372,0.00007424879,0.0022206956,0.0006192993,0.00008056709,0.0010438176],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9706652,0.026423682,0.0005640973,0.0006739981,0.0012059667,0.00046708147],"domain_scores_gemma":[0.65385264,0.32645145,0.00409206,0.008184131,0.0063654403,0.0010542993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043959208,0.0009579431,0.0013657861,0.0015068724,0.0006612968,0.0013217869,0.0019540584,0.0019368264,0.003986931],"category_scores_gemma":[0.15450503,0.0005323153,0.0022182,0.0016375872,0.0011750836,0.001866433,0.0015940928,0.0032000807,0.00033098567],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009080545,0.003297917,0.05530663,0.0018028946,0.00202633,0.00078499166,0.0011412834,0.7607966,0.0010750587,0.07586548,0.005689794,0.08313239],"study_design_scores_gemma":[0.001344987,0.0015835098,0.003411377,0.00024271234,0.00041381246,0.00023575603,0.00020372284,0.9704677,0.00084947195,0.019168139,0.0020084586,0.00007034848],"about_ca_topic_score_codex":0.008145616,"about_ca_topic_score_gemma":0.0037532146,"teacher_disagreement_score":0.043959208,"about_ca_system_score_codex":0.0019035772,"about_ca_system_score_gemma":0.002197824,"threshold_uncertainty_score":0.2324813},"labels":[],"label_agreement":null},{"id":"W3189430776","doi":"10.1002/sim.9141","title":"Estimating adjusted risk differences by multiply‐imputing missing control binary potential outcomes following propensity score‐matching","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Imputation (statistics); Missing data; Confidence interval; Matching (statistics); Mean squared error; Absolute risk reduction; Regression; Mathematics; Econometrics; Medicine","score_opus":0.0927472377061911,"score_gpt":0.39244463014258196,"score_spread":0.2996973924363909,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3189430776","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006702872,0.00017359434,0.9922902,0.00011782847,0.000034911605,0.00014865355,0.00008831689,0.00018761524,0.00025601688],"genre_scores_gemma":[0.13476676,0.00036064183,0.86256546,0.00023891352,0.00011325043,0.0008433916,0.00038982913,0.000098764474,0.0006230153],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9745755,0.018984744,0.0011451092,0.0019423268,0.0030113584,0.00034102326],"domain_scores_gemma":[0.9280536,0.057755202,0.0048682177,0.0073032985,0.0018158997,0.00020384304],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03975683,0.000915036,0.0027523076,0.003018562,0.00050926086,0.0013532424,0.0021710435,0.001349987,0.0028341599],"category_scores_gemma":[0.12220735,0.00088280486,0.0028313461,0.0034519518,0.001298815,0.0014829937,0.002310847,0.002412127,0.00034549803],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00082257605,0.00046386366,0.038601067,0.00092204567,0.0047821356,0.00043436675,0.0009769301,0.18910453,0.0044621485,0.1858926,0.0037664967,0.5697713],"study_design_scores_gemma":[0.0005319699,0.00067158975,0.016430626,0.00024343209,0.0010264379,0.00050291547,0.00008642108,0.70131797,0.006017245,0.26288044,0.01011098,0.00018000008],"about_ca_topic_score_codex":0.0029107041,"about_ca_topic_score_gemma":0.0020734721,"teacher_disagreement_score":0.03975683,"about_ca_system_score_codex":0.0007741544,"about_ca_system_score_gemma":0.0019739275,"threshold_uncertainty_score":0.21025676},"labels":[],"label_agreement":null},{"id":"W3191068200","doi":"10.1093/ije/dyab157","title":"Causal diagrams for immortal time bias","year":2021,"lang":"en","type":"editorial","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Medicine; Psychology; Computer science","score_opus":0.2682896299893995,"score_gpt":0.5137249393930979,"score_spread":0.24543530940369845,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3191068200","genre_codex":"editorial","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000042631204,0.007394775,0.0030923604,0.03662721,0.9515182,0.000024939687,0.00015477926,0.00016224841,0.0009828672],"genre_scores_gemma":[0.0012723921,0.0075542447,0.0015059622,0.014569612,0.96985346,0.00008992665,0.0000737551,0.00011073431,0.0049698083],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9907101,0.00419347,0.0013353465,0.00068233797,0.0028958558,0.00018280845],"domain_scores_gemma":[0.8807435,0.0949592,0.0022572856,0.002275784,0.01801378,0.0017504676],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.017504875,0.0042999163,0.004028854,0.0089861,0.002391598,0.0059667337,0.0047406713,0.015242013,0.020694898],"category_scores_gemma":[0.11895887,0.0017092485,0.003659869,0.003206512,0.003613798,0.0051556695,0.0015889435,0.018287266,0.005666549],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000051283347,0.0000107645,0.000035793008,0.000593056,0.000091256945,0.00013532292,0.00002186942,0.00015139961,0.000023653203,0.0048336633,0.9851613,0.008890641],"study_design_scores_gemma":[0.00043034062,0.00005125178,0.00048463792,0.00226132,0.0006011025,0.00064984726,0.00005557919,0.0031155748,0.00021783555,0.066194825,0.9258436,0.000094027084],"about_ca_topic_score_codex":0.0022669802,"about_ca_topic_score_gemma":0.0034277842,"teacher_disagreement_score":0.9824951,"about_ca_system_score_codex":0.0027924427,"about_ca_system_score_gemma":0.0031709294,"threshold_uncertainty_score":0.09257573},"labels":[],"label_agreement":null},{"id":"W3192788213","doi":"10.1177/0272989x211025525","title":"Testing for a Sweet Spot in Randomized Trials","year":2021,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences Centre; University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Canada Research Chairs; BrightFocus Foundation","keywords":"Sweet spot; Randomized controlled trial; Risk stratification; Clinical trial; MEDLINE; Blind spot","score_opus":0.39334255561661463,"score_gpt":0.5333925520726709,"score_spread":0.14004999645605626,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3192788213","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07367017,0.060414363,0.72397596,0.06702553,0.022199411,0.01862869,0.0042286683,0.005329265,0.024527984],"genre_scores_gemma":[0.61013985,0.0036714794,0.30468306,0.041977134,0.0067648184,0.02930345,0.00095306657,0.0006312218,0.0018759595],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.18871427,0.7005635,0.033989068,0.043731067,0.030622238,0.002379899],"domain_scores_gemma":[0.08344462,0.84706926,0.02873415,0.034215663,0.0047207684,0.0018155667],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.58863145,0.0036833824,0.012471053,0.008366137,0.0023748248,0.012383895,0.009027916,0.016266417,0.017570766],"category_scores_gemma":[0.7795535,0.0030832991,0.0133648915,0.009023805,0.029004699,0.0157169,0.007674,0.016339071,0.0019520974],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.042322826,0.00097382185,0.073458284,0.059741255,0.09193273,0.0065887654,0.0045946706,0.028273601,0.0026826356,0.34755674,0.047957234,0.29391745],"study_design_scores_gemma":[0.012232652,0.0099205375,0.014720227,0.017369207,0.010383584,0.0038771476,0.0011926424,0.12600052,0.0034815897,0.74464065,0.0554654,0.0007159117],"about_ca_topic_score_codex":0.0006070666,"about_ca_topic_score_gemma":0.00040990944,"teacher_disagreement_score":0.41136855,"about_ca_system_score_codex":0.005956883,"about_ca_system_score_gemma":0.005680421,"threshold_uncertainty_score":0.5072907},"labels":[],"label_agreement":null},{"id":"W3193216897","doi":"10.1002/sim.9151","title":"Estimating the marginal effect of a continuous exposure on an ordinal outcome using data subject to covariate‐driven treatment and visit processes","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Covariate; Marginal structural model; Outcome (game theory); Confounding; Causal inference; Econometrics; Inference; Statistics; Odds; Generalization; Computer science; Inverse probability weighting; Mathematics; Logistic regression; Artificial intelligence; Propensity score matching","score_opus":0.18254403681751505,"score_gpt":0.48358799182642537,"score_spread":0.30104395500891035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193216897","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03690725,0.00056517706,0.9595452,0.000797544,0.00009430249,0.00043172197,0.00063556555,0.00022400933,0.00079924613],"genre_scores_gemma":[0.57685536,0.0014361897,0.4116212,0.00079089036,0.00031598588,0.003055235,0.001712993,0.00011934551,0.004092717],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9744932,0.018798545,0.00097540003,0.0034493024,0.0016785415,0.0006050814],"domain_scores_gemma":[0.85712886,0.11912118,0.008334319,0.012697126,0.001988651,0.000729817],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.052224416,0.0012380995,0.0023729966,0.002947582,0.00090320193,0.0020773693,0.0035757823,0.0026186635,0.006549387],"category_scores_gemma":[0.15587588,0.0010758436,0.004198068,0.0034445864,0.0037257986,0.0034418849,0.0032146394,0.004562186,0.0006595706],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013201019,0.000874282,0.14142749,0.0014927718,0.003383348,0.00067932316,0.0024485413,0.111799106,0.0016527221,0.5472613,0.003127018,0.18453407],"study_design_scores_gemma":[0.0003916723,0.0008775617,0.033603016,0.00048359198,0.0013164587,0.0004403491,0.0004666034,0.37081382,0.0029248307,0.5803251,0.008208599,0.00014844381],"about_ca_topic_score_codex":0.0048220847,"about_ca_topic_score_gemma":0.0032175088,"teacher_disagreement_score":0.052224416,"about_ca_system_score_codex":0.0015272115,"about_ca_system_score_gemma":0.0030416008,"threshold_uncertainty_score":0.27619237},"labels":[],"label_agreement":null},{"id":"W3193794660","doi":"10.1515/ijb-2020-0144","title":"Quantifying the extent of visit irregularity in longitudinal data","year":2021,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Services and Policy Research; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"","keywords":"Bin; Observational study; Statistics; Longitudinal data; Sample size determination; Longitudinal study; Medicine; Repeated measures design; Mathematics; Demography; Computer science; Data mining","score_opus":0.3671022536769504,"score_gpt":0.48595958555317914,"score_spread":0.11885733187622877,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193794660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3075656,0.0016318484,0.68186426,0.0019351689,0.0001792957,0.00046848218,0.0026314065,0.0007023585,0.0030215555],"genre_scores_gemma":[0.8942146,0.00046456445,0.102277316,0.0003423379,0.00013500123,0.00038530337,0.0014489866,0.00010748455,0.0006246097],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93481386,0.04866228,0.0055002784,0.005546178,0.004422153,0.0010553888],"domain_scores_gemma":[0.5372262,0.3563364,0.051633522,0.046846036,0.0066076033,0.0013502032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1078882,0.00062880374,0.001379356,0.0038227872,0.001211314,0.0027151648,0.001691957,0.0018511827,0.0012480244],"category_scores_gemma":[0.3522281,0.0007389009,0.0020398826,0.00593654,0.0029038412,0.004194939,0.0033097742,0.0025573315,0.00021272604],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007391342,0.000117182804,0.8208955,0.0005279443,0.001633807,0.00031679997,0.0021788892,0.06426073,0.0011561326,0.020659037,0.001518406,0.08599641],"study_design_scores_gemma":[0.000093114526,0.00096767757,0.5388635,0.0006338342,0.0007019596,0.0013116628,0.0017613476,0.292594,0.0031552627,0.14873797,0.010885859,0.0002938366],"about_ca_topic_score_codex":0.006641651,"about_ca_topic_score_gemma":0.006492223,"teacher_disagreement_score":0.1078882,"about_ca_system_score_codex":0.0012853104,"about_ca_system_score_gemma":0.0016258414,"threshold_uncertainty_score":0.57057416},"labels":[],"label_agreement":null},{"id":"W3196495100","doi":"10.1093/ije/dyab168.399","title":"286Collider-stratification bias when estimating variable importance using Random Forests","year":2021,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University","funders":"","keywords":"Causal inference; Outcome (game theory); Feature selection; Random forest; Inference; Collider; Variable (mathematics); Econometrics; Variables; Statistics; Computer science; Selection bias; Machine learning; Artificial intelligence; Mathematics; Physics","score_opus":0.40156421078467736,"score_gpt":0.49848441269001376,"score_spread":0.0969202019053364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3196495100","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.073040344,0.0014655357,0.9196826,0.0019924382,0.0003040414,0.00035254355,0.0005014151,0.0006026994,0.0020583384],"genre_scores_gemma":[0.81253123,0.0004244977,0.18396771,0.0008691146,0.00027781166,0.000528043,0.000512729,0.00016693788,0.0007219909],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.92802346,0.060843617,0.0021570078,0.005101403,0.0029012072,0.0009732629],"domain_scores_gemma":[0.5827863,0.3800875,0.013654466,0.016856251,0.0057785516,0.00083698257],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11520314,0.001172077,0.001821985,0.0016671473,0.0012112914,0.0033968736,0.0029120827,0.0018800203,0.0032697143],"category_scores_gemma":[0.31365174,0.0008998364,0.00218709,0.0018421025,0.003866813,0.0028640793,0.0023657447,0.0038187688,0.0005490318],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010987894,0.00029573936,0.19292328,0.0017956517,0.0040346854,0.0011298144,0.0017112719,0.42188084,0.0021909545,0.18350285,0.008444619,0.18099156],"study_design_scores_gemma":[0.00016797127,0.00018873689,0.014434675,0.00062381435,0.0004257176,0.0003660721,0.00022059919,0.6666353,0.0026262575,0.30983764,0.004371608,0.00010165224],"about_ca_topic_score_codex":0.006277771,"about_ca_topic_score_gemma":0.005499809,"teacher_disagreement_score":0.88479686,"about_ca_system_score_codex":0.0015542131,"about_ca_system_score_gemma":0.0026568118,"threshold_uncertainty_score":0.6092597},"labels":[],"label_agreement":null},{"id":"W3196666600","doi":"10.48550/arxiv.2109.03757","title":"Causal Inference for Quantile Treatment Effects","year":2021,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds de Recherche du Québec - Santé; Institut de Valorisation des Données","keywords":"Quantile; Estimator; Causal inference; Quantile regression; Statistics; Inference; Econometrics; Population; Average treatment effect; Mathematics; Computer science; Artificial intelligence; Medicine; Environmental health","score_opus":0.2776922142114546,"score_gpt":0.3254229962819759,"score_spread":0.04773078207052128,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3196666600","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007219283,0.00046446346,0.98975146,0.00074013695,0.00007083411,0.00009548184,0.0002013468,0.00019286353,0.0012640491],"genre_scores_gemma":[0.5380637,0.0019489548,0.45087937,0.0010374638,0.0004981633,0.0013848895,0.00090920983,0.00017303253,0.0051051835],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97965884,0.015996668,0.00049232744,0.0019803033,0.0013967506,0.00047508092],"domain_scores_gemma":[0.8638685,0.120566465,0.0056213895,0.007297726,0.002228887,0.0004169269],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041399006,0.0008955316,0.0014805659,0.0028790091,0.0010157373,0.002103453,0.002631346,0.0023456393,0.010818336],"category_scores_gemma":[0.17214064,0.0006959852,0.0021274684,0.0036537277,0.0030726327,0.003688368,0.0026251327,0.003864619,0.00055346533],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011191524,0.00010680452,0.009860401,0.0003067558,0.00050263276,0.00016978414,0.0004434674,0.08222051,0.000329278,0.8032789,0.0022106308,0.10045892],"study_design_scores_gemma":[0.00008393346,0.000051108975,0.002473724,0.0000946355,0.00012264264,0.00006675008,0.00007115274,0.24689221,0.0003839473,0.7468587,0.002878589,0.000022611594],"about_ca_topic_score_codex":0.004873884,"about_ca_topic_score_gemma":0.0028668083,"teacher_disagreement_score":0.041399006,"about_ca_system_score_codex":0.001886873,"about_ca_system_score_gemma":0.0020039226,"threshold_uncertainty_score":0.21894145},"labels":[],"label_agreement":null},{"id":"W3196761963","doi":"10.1212/wnl.0000000000012777","title":"Applying Propensity Score Methods in Clinical Research in Neurology","year":2021,"lang":"en","type":"article","venue":"Neurology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":137,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Observational study; Covariate; Matching (statistics); Medicine; Weighting; Statistics; Internal medicine; Mathematics; Pathology; Radiology","score_opus":0.7483324935008868,"score_gpt":0.6275504623094126,"score_spread":0.12078203119147424,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3196761963","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001126499,0.006002193,0.98468786,0.004989921,0.000433016,0.00039471532,0.00021031404,0.00017103468,0.001984373],"genre_scores_gemma":[0.051643852,0.016051427,0.92377573,0.0022712767,0.0017812363,0.0026421624,0.000337014,0.00016832455,0.0013290315],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8443835,0.13870287,0.0060268575,0.0034403643,0.0069000702,0.00054639333],"domain_scores_gemma":[0.7051973,0.2553442,0.012848965,0.016189307,0.009153006,0.0012671355],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14193858,0.0014171286,0.0020685152,0.0066719805,0.0016849185,0.005488988,0.0027282087,0.0037052545,0.0077398284],"category_scores_gemma":[0.32395414,0.0013048286,0.003221769,0.010068676,0.005928059,0.00561545,0.0065528844,0.0069672987,0.0017863476],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001056063,0.00009585322,0.0067347814,0.001725209,0.0009525192,0.00022004555,0.0008123386,0.022249682,0.00027653974,0.713097,0.013059044,0.24067137],"study_design_scores_gemma":[0.000118456664,0.000092232855,0.0017643099,0.00087953155,0.000112693306,0.00014064046,0.00010565295,0.022939894,0.00027711646,0.95471174,0.01879166,0.00006613264],"about_ca_topic_score_codex":0.0044311727,"about_ca_topic_score_gemma":0.003599681,"teacher_disagreement_score":0.85806143,"about_ca_system_score_codex":0.0028558169,"about_ca_system_score_gemma":0.009766185,"threshold_uncertainty_score":0.75065196},"labels":[],"label_agreement":null},{"id":"W3197211443","doi":"10.1186/s12874-021-01364-0","title":"Evaluation of statistical methods used in the analysis of interrupted time series studies: a simulation study","year":2021,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":110,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Public Health; Ottawa Hospital","funders":"National Health and Medical Research Council; Medical Research Council; Monash University","keywords":"Autocorrelation; Statistics; Series (stratigraphy); Ordinary least squares; Mathematics; Restricted maximum likelihood; Econometrics; Population; Confidence interval; Maximum likelihood; Demography; Biology","score_opus":0.9376995805081113,"score_gpt":0.7822997123750204,"score_spread":0.15539986813309092,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3197211443","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20681065,0.0059733354,0.7689265,0.0021836064,0.00051449286,0.0075548384,0.0020985221,0.0007204005,0.005217668],"genre_scores_gemma":[0.55370134,0.0023468495,0.43167305,0.00046212188,0.000109562716,0.00995322,0.0010691264,0.00016130776,0.00052346167],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.78453225,0.20118406,0.0049114972,0.002681979,0.0058272127,0.00086301705],"domain_scores_gemma":[0.26944095,0.683264,0.017075783,0.010317292,0.018602585,0.0012993922],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22391586,0.0015263095,0.0025243089,0.0031667314,0.0009305377,0.002520561,0.0029937795,0.0028727138,0.0039443537],"category_scores_gemma":[0.40516636,0.00088120304,0.0043462864,0.0043293987,0.0013181368,0.0024245419,0.0022073707,0.0033490832,0.00038830607],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005753479,0.0013635898,0.07311286,0.005097139,0.006429484,0.00087155704,0.0015738596,0.7335207,0.0010635884,0.041340046,0.005845805,0.12402788],"study_design_scores_gemma":[0.0011553754,0.0033467847,0.009456278,0.0019141375,0.001080683,0.00033976737,0.00048113338,0.9617132,0.0010942338,0.014559956,0.0046983445,0.00016018518],"about_ca_topic_score_codex":0.0058181887,"about_ca_topic_score_gemma":0.00311164,"teacher_disagreement_score":0.7760841,"about_ca_system_score_codex":0.003681684,"about_ca_system_score_gemma":0.005094327,"threshold_uncertainty_score":0.9570499},"labels":[],"label_agreement":null},{"id":"W3197721016","doi":"10.1002/jrsm.1565","title":"Parametric G‐computation for compatible indirect treatment comparisons with limited individual patient data","year":2022,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Engineering and Physical Sciences Research Council; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Computation; Computer science; Parametric statistics; Econometrics; Statistics; Algorithm; Mathematics","score_opus":0.8280228066436652,"score_gpt":0.6339570443067984,"score_spread":0.1940657623368668,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3197721016","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036675322,0.00067794375,0.99225026,0.0003891986,0.000094772135,0.00089069374,0.00027468376,0.0004190331,0.0013359508],"genre_scores_gemma":[0.10820893,0.0006065322,0.8836864,0.00046138864,0.00009583472,0.005495034,0.00043978533,0.0002840277,0.0007219914],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88809246,0.099472865,0.0026810432,0.0043351767,0.004756745,0.00066168926],"domain_scores_gemma":[0.74713093,0.21964501,0.00876338,0.020178806,0.0037209732,0.0005609464],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.081215695,0.002125136,0.0040442534,0.0039583053,0.00096432754,0.0027130896,0.003405615,0.002046162,0.015466376],"category_scores_gemma":[0.3169702,0.0014301083,0.0048077465,0.00429346,0.0029092042,0.002844861,0.005648592,0.0043716556,0.0013371132],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017742554,0.00024332765,0.0071030343,0.0047697206,0.004256816,0.00045219957,0.0010937382,0.09530096,0.0010868424,0.31159103,0.007917421,0.5644106],"study_design_scores_gemma":[0.0011814752,0.00077866454,0.0043590236,0.0010789875,0.0014872799,0.00039562667,0.00022284075,0.24669413,0.0030742742,0.7188489,0.021729961,0.00014879034],"about_ca_topic_score_codex":0.00243466,"about_ca_topic_score_gemma":0.0021061692,"teacher_disagreement_score":0.9187843,"about_ca_system_score_codex":0.0020482624,"about_ca_system_score_gemma":0.0063493615,"threshold_uncertainty_score":0.42951477},"labels":[],"label_agreement":null},{"id":"W3197765782","doi":"10.1101/2021.08.25.21262631","title":"Causal and Associational Language in Observational Health Research: A systematic evaluation","year":2021,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; McGill University; AIDS Vancouver; Public Health Ontario; University of Toronto","funders":"","keywords":"Causality (physics); CLARITY; Observational study; Psychology; Interpretation (philosophy); Linguistics; Medicine; Pathology","score_opus":0.6989486828195921,"score_gpt":0.5697149354724764,"score_spread":0.12923374734711568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3197765782","genre_codex":"review","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.062110376,0.8307775,0.04496643,0.008415786,0.0026126965,0.03935994,0.007083555,0.00038889455,0.004284879],"genre_scores_gemma":[0.68298614,0.17400675,0.07153006,0.004677426,0.0018265927,0.06079562,0.003382034,0.0002148784,0.0005804988],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.34139493,0.4111397,0.17835636,0.014287838,0.05296837,0.0018527593],"domain_scores_gemma":[0.10450436,0.7172501,0.10780056,0.020793652,0.047911145,0.001740207],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47481856,0.00326477,0.0124879,0.016571304,0.0022540167,0.009966034,0.003588989,0.0042987163,0.005978329],"category_scores_gemma":[0.7575576,0.0030290629,0.023861352,0.0156862,0.007117138,0.010524715,0.0070509408,0.0038652509,0.00071008416],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0066281827,0.00017723082,0.024743311,0.7447156,0.16180891,0.0001780725,0.0025921778,0.0006945779,0.0003376655,0.0022234346,0.0019249014,0.053975996],"study_design_scores_gemma":[0.009871517,0.0040434115,0.03451273,0.4674068,0.4547928,0.0005104706,0.0019517757,0.0022978818,0.0013755014,0.007693244,0.015095044,0.00044884824],"about_ca_topic_score_codex":0.004978111,"about_ca_topic_score_gemma":0.00831237,"teacher_disagreement_score":0.5251814,"about_ca_system_score_codex":0.009783737,"about_ca_system_score_gemma":0.019625725,"threshold_uncertainty_score":0.64764225},"labels":[],"label_agreement":null},{"id":"W3197852285","doi":"10.1016/j.annepidem.2021.05.028","title":"The reliability of risk of bias tools for nonrandomized studies","year":2021,"lang":"en","type":"article","venue":"Annals of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Medicine; Reliability (semiconductor); Reliability engineering","score_opus":0.7295545469632841,"score_gpt":0.5783653061591613,"score_spread":0.15118924080412288,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3197852285","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01570631,0.0076073883,0.97232777,0.0019220487,0.00027266637,0.00022788276,0.00031139355,0.00031265555,0.0013119827],"genre_scores_gemma":[0.6515676,0.0046109557,0.33833072,0.0011856729,0.0010908283,0.0012435856,0.0005857741,0.0003025492,0.0010823674],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.43779856,0.4983352,0.020863615,0.01865904,0.023020161,0.0013234376],"domain_scores_gemma":[0.017897192,0.93814504,0.011914322,0.026491761,0.0052065607,0.0003451652],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.45019212,0.0028446312,0.0076092174,0.010183827,0.0015782483,0.007503948,0.007225166,0.0070096613,0.003276212],"category_scores_gemma":[0.8710599,0.0028471844,0.0070294435,0.006445127,0.014290166,0.010679129,0.00717251,0.008232079,0.00058098946],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0038354925,0.0003172045,0.09261495,0.008284153,0.023093244,0.0014644485,0.004400222,0.10629968,0.0013693162,0.5168037,0.007412577,0.234105],"study_design_scores_gemma":[0.00059977116,0.00060761475,0.008197829,0.0012189037,0.0031154368,0.0009244864,0.00022944255,0.19388323,0.0013862728,0.7855202,0.004149714,0.00016709072],"about_ca_topic_score_codex":0.0019729713,"about_ca_topic_score_gemma":0.00079729164,"teacher_disagreement_score":0.5498079,"about_ca_system_score_codex":0.0022412061,"about_ca_system_score_gemma":0.0037754418,"threshold_uncertainty_score":0.678011},"labels":[],"label_agreement":null},{"id":"W3198343911","doi":"10.1002/cjs.11772","title":"Optimal multiwave validation of secondary use data with outcome and exposure misclassification","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases; National Heart, Lung, and Blood Institute; University of North Carolina at Chapel Hill; National Institutes of Health; Vanderbilt University; Patient-Centered Outcomes Research Institute","keywords":"Estimator; Computer science; Variance (accounting); Outcome (game theory); Optimal design; Observational study; Data mining; Mathematical optimization; Grid; Resource (disambiguation); Machine learning; Statistics; Mathematics","score_opus":0.31193088679359926,"score_gpt":0.3904439519980124,"score_spread":0.07851306520441315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3198343911","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028331112,0.000109742905,0.97016406,0.0002839251,0.000028488374,0.0003265562,0.00011125529,0.00010228431,0.0005425743],"genre_scores_gemma":[0.53221864,0.00014358094,0.46466488,0.00028091655,0.000037888953,0.0014047441,0.00033290478,0.000042359305,0.0008740777],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9551377,0.039512727,0.0009418683,0.0022405474,0.0016177552,0.0005494385],"domain_scores_gemma":[0.8770315,0.0986953,0.007856169,0.011182934,0.004434847,0.00079934654],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.049786687,0.0008192061,0.0017316039,0.00082837156,0.0006604654,0.0012255446,0.0018398593,0.001826202,0.0024526336],"category_scores_gemma":[0.123751014,0.0009538066,0.0013634514,0.0009165062,0.0020297088,0.0015978834,0.0027878536,0.0016776067,0.00049670757],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031889542,0.00086148124,0.033247765,0.0005521436,0.0004927211,0.00023691244,0.00048392604,0.57925475,0.0064189355,0.13185988,0.0020720526,0.24133052],"study_design_scores_gemma":[0.00081888697,0.0011158731,0.006166882,0.00012740267,0.00010691764,0.000104907784,0.00007928285,0.865721,0.00432368,0.11965468,0.0017220651,0.00005843331],"about_ca_topic_score_codex":0.0011737763,"about_ca_topic_score_gemma":0.0009220827,"teacher_disagreement_score":0.049786687,"about_ca_system_score_codex":0.0008661518,"about_ca_system_score_gemma":0.002315861,"threshold_uncertainty_score":0.2633003},"labels":[],"label_agreement":null},{"id":"W3198361082","doi":"10.1177/0272989x221121747","title":"A Tutorial on Time-Dependent Cohort State-Transition Models in R using a Cost-Effectiveness Analysis Example","year":2021,"lang":"en","type":"article","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Ottawa; Hospital for Sick Children","funders":"National Institute of Allergy and Infectious Diseases; National Institute on Drug Abuse; National Cancer Institute; Gordon and Betty Moore Foundation","keywords":"Computer science; Probabilistic logic; Transition (genetics); Cohort; Constant (computer programming); Dependency (UML); Code (set theory); State (computer science); Statistics; Algorithm; Mathematics; Artificial intelligence; Programming language","score_opus":0.2636102031350876,"score_gpt":0.304842683778224,"score_spread":0.04123248064313639,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3198361082","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00064064795,0.0044755135,0.97274214,0.0021657913,0.00039295864,0.00025107292,0.0067748465,0.0038240138,0.008733039],"genre_scores_gemma":[0.020304983,0.008484391,0.94560236,0.002642624,0.00076810917,0.0032147837,0.0051877443,0.003407572,0.010387429],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965965,0.0023393496,0.00022063503,0.0002868677,0.00047313207,0.000083521496],"domain_scores_gemma":[0.97120845,0.026609363,0.00055185653,0.0007095209,0.00077205506,0.00014881587],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0074518532,0.0022160881,0.0013960745,0.0018418563,0.00035700537,0.0013308611,0.001670294,0.0014300907,0.054414704],"category_scores_gemma":[0.041027296,0.0009870614,0.0034485904,0.0019902864,0.00046834772,0.001551502,0.0013521732,0.0033007136,0.016027441],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012310212,0.00014942966,0.0017051989,0.0036983206,0.00058479805,0.0010627143,0.000305326,0.17879619,0.0012793781,0.3918128,0.2651813,0.15530148],"study_design_scores_gemma":[0.00018749009,0.00012398933,0.0009154218,0.0009147225,0.00019388492,0.0007712412,0.000054813278,0.18453436,0.0008815758,0.4666295,0.3446645,0.0001284462],"about_ca_topic_score_codex":0.005490029,"about_ca_topic_score_gemma":0.0066385777,"teacher_disagreement_score":0.054414704,"about_ca_system_score_codex":0.001080218,"about_ca_system_score_gemma":0.0021671744,"threshold_uncertainty_score":0.18203533},"labels":[],"label_agreement":null},{"id":"W3198388524","doi":"10.1093/ije/dyab168.716","title":"465Simplifying the Differences between Causal and Prediction Analyses","year":2021,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Alberta Health Services; University of Calgary","funders":"","keywords":"Presentation (obstetrics); Outcome (game theory); Causal model; Computer science; Regression analysis; Causal inference; Predictive modelling; Process (computing); Multivariable calculus; Variety (cybernetics); Key (lock); Management science; Data science; Econometrics; Artificial intelligence; Machine learning; Medicine; Statistics; Mathematics","score_opus":0.5420566679419827,"score_gpt":0.5551532219223125,"score_spread":0.013096553980329828,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3198388524","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015329804,0.004793953,0.89117455,0.057018235,0.002034591,0.0007995741,0.00095539744,0.00065360335,0.027240265],"genre_scores_gemma":[0.4729822,0.0051649287,0.49040282,0.014620204,0.0027286017,0.0028072584,0.0007693238,0.0007464087,0.009778284],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8963846,0.08612775,0.004410287,0.0030915297,0.0089669395,0.0010189174],"domain_scores_gemma":[0.592834,0.37738952,0.0073960354,0.011704675,0.009983653,0.0006921626],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10243517,0.0011551011,0.0010341982,0.0028966984,0.0011776788,0.006159381,0.0032507835,0.0021226127,0.020617979],"category_scores_gemma":[0.36247623,0.00084180414,0.0026175354,0.002213795,0.003674565,0.008090213,0.0042627216,0.005637486,0.0023936466],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002953646,0.00012467237,0.008422861,0.0017491229,0.00033487423,0.00039315954,0.0031861493,0.011296806,0.00060733553,0.8203067,0.019361226,0.1339217],"study_design_scores_gemma":[0.00010475303,0.00015387115,0.0032327024,0.0017058545,0.00024203103,0.0006304675,0.0013167474,0.047231153,0.0012594406,0.90474147,0.039303366,0.00007815678],"about_ca_topic_score_codex":0.0030214333,"about_ca_topic_score_gemma":0.002941085,"teacher_disagreement_score":0.8975648,"about_ca_system_score_codex":0.003052311,"about_ca_system_score_gemma":0.0046271086,"threshold_uncertainty_score":0.5417354},"labels":[],"label_agreement":null},{"id":"W3199775394","doi":"10.1002/sim.9176","title":"Informing power and sample size calculations when using inverse probability of treatment weighting using the propensity score","year":2021,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Institute of Health Services and Policy Research; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Observational study; Weighting; Statistics; Sample size determination; Average treatment effect; Mathematics; Statistic; Homogeneity (statistics); Econometrics; Inverse probability weighting; Medicine","score_opus":0.27352121820347886,"score_gpt":0.4268053675944418,"score_spread":0.15328414939096296,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3199775394","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027815374,0.001171811,0.9867786,0.0016953173,0.00046549854,0.0029085253,0.00035659422,0.0003366933,0.0035054935],"genre_scores_gemma":[0.055964828,0.0013069683,0.92605275,0.0013569895,0.00053100096,0.013274095,0.0003491103,0.00039663343,0.0007676927],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.64859754,0.31124583,0.015231026,0.0069968808,0.01685616,0.0010725169],"domain_scores_gemma":[0.4176637,0.50564605,0.019573424,0.04022536,0.015943129,0.00094843353],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27097908,0.0018234253,0.0033358748,0.0066871857,0.0013079988,0.005947248,0.003912028,0.0036212052,0.010119706],"category_scores_gemma":[0.67251515,0.0018013127,0.0031462633,0.0077788546,0.0043590427,0.0063376124,0.0057327603,0.0066690478,0.0021604903],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012434471,0.00022363475,0.012211488,0.004106768,0.0020192477,0.00035886836,0.00318894,0.021357529,0.0015777939,0.24093144,0.0282728,0.68450814],"study_design_scores_gemma":[0.0019296765,0.0011774981,0.011372444,0.004915281,0.0015870868,0.0007648875,0.0005188005,0.10330348,0.008707074,0.7361843,0.12920035,0.00033916472],"about_ca_topic_score_codex":0.0017346274,"about_ca_topic_score_gemma":0.0015988636,"teacher_disagreement_score":0.72902095,"about_ca_system_score_codex":0.0019158042,"about_ca_system_score_gemma":0.005166983,"threshold_uncertainty_score":0.89901257},"labels":[],"label_agreement":null},{"id":"W3200513035","doi":"10.1161/circoutcomes.121.008040","title":"Physician Network Connections Associated With Faster De-Adoption of Dronedarone for Permanent Atrial Fibrillation","year":2021,"lang":"en","type":"article","venue":"Circulation Cardiovascular Quality and Outcomes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Tellabs (Canada)","funders":"National Center for Advancing Translational Sciences; National Institutes of Health; Agency for Healthcare Research and Quality; National Heart, Lung, and Blood Institute; U.S. Food and Drug Administration; National Institute on Aging","keywords":"Dronedarone; Medicine; Medicaid; Quarter (Canadian coin); Atrial fibrillation; Emergency medicine; Family medicine; Medicare Part D; Medical emergency; Internal medicine; Amiodarone; Health care; Medical prescription; Nursing; Prescription drug","score_opus":0.1398828730401273,"score_gpt":0.37954967021984265,"score_spread":0.23966679717971534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3200513035","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9954072,0.00041352896,0.000626131,0.0011473702,0.000026728441,0.000015803127,0.000882408,0.000015902879,0.0014650336],"genre_scores_gemma":[0.99904054,0.00012017617,0.00014114063,0.000056808087,0.000033629858,0.00000981456,0.00030055488,0.000004306835,0.00029298392],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99880207,0.00036037594,0.000108313296,0.00031511363,0.00014042552,0.00027369926],"domain_scores_gemma":[0.97572845,0.007114491,0.01339492,0.0007568073,0.0009407536,0.0020645347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010283225,0.0001982545,0.0001619902,0.0008933972,0.0003565606,0.0009586205,0.00046132412,0.0006624196,0.0085365055],"category_scores_gemma":[0.01921354,0.00021385717,0.0005337549,0.0012310353,0.00022633078,0.0009629788,0.00074758223,0.0013221155,0.00040730665],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000093587274,0.00004700553,0.9960283,0.000011056461,0.000074807365,0.00006318135,0.00012135963,0.00036781223,0.000067339315,0.00014235558,0.0004828672,0.002500311],"study_design_scores_gemma":[0.0000112996495,0.000039262926,0.9950747,0.000022006934,0.00006786356,0.00025851876,0.00034191547,0.0031533341,0.000067678,0.00026814282,0.00068931497,0.0000059998365],"about_ca_topic_score_codex":0.010862569,"about_ca_topic_score_gemma":0.009675227,"teacher_disagreement_score":0.010862569,"about_ca_system_score_codex":0.00061967206,"about_ca_system_score_gemma":0.00059835677,"threshold_uncertainty_score":0.02855748},"labels":[],"label_agreement":null},{"id":"W3201688646","doi":"10.1257/aer.20230039","title":"Treatment Effects in Market Equilibrium","year":2025,"lang":"en","type":"preprint","venue":"American Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Booth University College","funders":"","keywords":"Estimator; Economics; Econometrics; Sensitivity (control systems); Consistency (knowledge bases); Market price; Microeconomics; Mathematics; Statistics","score_opus":0.0823559128946701,"score_gpt":0.4248523175273293,"score_spread":0.34249640463265923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3201688646","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08284221,0.0036203277,0.8293793,0.013812939,0.0011897344,0.0045892764,0.0028124498,0.0009828109,0.060770933],"genre_scores_gemma":[0.81274134,0.0016865655,0.16077141,0.0038322369,0.0006087177,0.0067536286,0.0003963208,0.00012301307,0.013086691],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94676566,0.042223886,0.0011789127,0.005902825,0.002545428,0.0013833282],"domain_scores_gemma":[0.8259554,0.15055068,0.010025007,0.010118374,0.0025800813,0.0007704622],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05361584,0.0012083098,0.0036460683,0.001444947,0.0013311241,0.0038078916,0.0025888584,0.005897249,0.044146508],"category_scores_gemma":[0.1841925,0.00085957116,0.0026464853,0.001620353,0.0057688802,0.0071783834,0.0026098457,0.0045730458,0.0017843556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012961066,0.0004962369,0.002666216,0.0010410383,0.0005901209,0.00014495985,0.00034171267,0.023598928,0.00064036984,0.88004994,0.0053765518,0.08375776],"study_design_scores_gemma":[0.0012369246,0.00088481675,0.0027686318,0.0002798892,0.00045106548,0.00007476275,0.0001271585,0.052149702,0.00079802546,0.93401694,0.0071553304,0.00005677971],"about_ca_topic_score_codex":0.0021852853,"about_ca_topic_score_gemma":0.0011253259,"teacher_disagreement_score":0.05361584,"about_ca_system_score_codex":0.0034728963,"about_ca_system_score_gemma":0.0029899434,"threshold_uncertainty_score":0.28355104},"labels":[],"label_agreement":null},{"id":"W3203445629","doi":"10.1002/sim.9718","title":"Causal inference in survival analysis using longitudinal observational data: Sequential trials and marginal structural models","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada; Norges Forskningsråd; UK Research and Innovation","keywords":"Marginal structural model; Causal inference; Censoring (clinical trials); Observational study; Inverse probability; Econometrics; Computer science; Confounding; Inference; Statistics; Inverse probability weighting; Propensity score matching; Mathematics; Artificial intelligence; Bayesian probability","score_opus":0.7073736049282677,"score_gpt":0.5705797811041333,"score_spread":0.1367938238241344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3203445629","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0119984215,0.004240668,0.97703415,0.0028479826,0.00041110587,0.00093165017,0.0005064818,0.00023562119,0.0017938368],"genre_scores_gemma":[0.3922407,0.00719747,0.5871201,0.0021860795,0.001158831,0.0056973174,0.0010172643,0.00020398422,0.0031782633],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85473335,0.13111381,0.0027321258,0.005642614,0.004795954,0.0009820651],"domain_scores_gemma":[0.6016759,0.36416098,0.013095996,0.014949889,0.0048609604,0.0012562762],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.14201562,0.0023574964,0.005053905,0.0035999597,0.0010830609,0.00332063,0.004800575,0.0039971787,0.007827482],"category_scores_gemma":[0.3508202,0.0015840206,0.006779306,0.0049563907,0.00486403,0.006322307,0.004682478,0.0064848587,0.00062880886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016619079,0.00030205128,0.015089594,0.0028343487,0.0045557194,0.0005751675,0.0013478887,0.14800885,0.00043722117,0.69343126,0.003467981,0.12828794],"study_design_scores_gemma":[0.0007016281,0.00037829933,0.0016246566,0.00050158834,0.00096313277,0.00016196698,0.0000996638,0.24490388,0.0003736559,0.74619627,0.0040182616,0.000076932294],"about_ca_topic_score_codex":0.007492426,"about_ca_topic_score_gemma":0.005284727,"teacher_disagreement_score":0.14201562,"about_ca_system_score_codex":0.0033244716,"about_ca_system_score_gemma":0.0058080833,"threshold_uncertainty_score":0.75105935},"labels":[],"label_agreement":null},{"id":"W3204186164","doi":"10.1016/j.simpa.2021.100147","title":"InteractionR: An R package for full reporting of effect modification and interaction","year":2021,"lang":"en","type":"article","venue":"Software Impacts","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":92,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé","keywords":"Bootstrapping (finance); Multiplicative function; Delta method; Percentile; R package; Interaction; Computer science; Confidence interval; Variance (accounting); Scale (ratio); Variance components; Additive model; Simple (philosophy); Econometrics; Statistics; Data mining; Mathematics; Machine learning; Estimator","score_opus":0.20723313807223007,"score_gpt":0.4870284351868094,"score_spread":0.2797952971145793,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3204186164","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002741733,0.0034158016,0.6937496,0.003453574,0.0020863716,0.002703944,0.2231641,0.06138779,0.007297068],"genre_scores_gemma":[0.0514954,0.0030431633,0.7988284,0.004382757,0.0011791947,0.025636783,0.06168874,0.04544211,0.0083034225],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.95798224,0.02710016,0.0057626874,0.0038135268,0.004738869,0.0006025837],"domain_scores_gemma":[0.65834886,0.28779536,0.017450051,0.026566485,0.008836273,0.0010029171],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.041597366,0.002952683,0.0035961836,0.0050205905,0.00061475695,0.0034454637,0.0042177364,0.0022422632,0.15949395],"category_scores_gemma":[0.34837672,0.002077908,0.006941843,0.0046000453,0.0014802587,0.0029746592,0.0041927844,0.0041288338,0.03217616],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010611599,0.000103171944,0.011400806,0.019844452,0.008521915,0.0006613144,0.0007936064,0.0055661444,0.0014255152,0.0258487,0.6942106,0.23056258],"study_design_scores_gemma":[0.0015347081,0.00047906305,0.01829884,0.006218755,0.0065722186,0.0017107971,0.00025624136,0.024343418,0.004942426,0.18042688,0.7545765,0.0006401701],"about_ca_topic_score_codex":0.0024859975,"about_ca_topic_score_gemma":0.0033744853,"teacher_disagreement_score":0.95840263,"about_ca_system_score_codex":0.0009850637,"about_ca_system_score_gemma":0.005267796,"threshold_uncertainty_score":0.5335604},"labels":[],"label_agreement":null},{"id":"W3204441930","doi":"10.1080/01621459.2023.2216909","title":"An Automated Approach to Causal Inference in Discrete Settings","year":2023,"lang":"en","type":"article","venue":"Journal of the American Statistical Association","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; Office of Naval Research; University of Pennsylvania; York University; National Institutes of Health; National Science Foundation; Yale University; Carnegie Corporation of New York","keywords":"Causal inference; Computer science; Inference; Range (aeronautics); Algorithm; Causal model; Mathematical optimization; Mathematics; Artificial intelligence; Econometrics; Statistics","score_opus":0.055280762557961514,"score_gpt":0.44274617951837264,"score_spread":0.38746541696041115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3204441930","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006484584,0.000033931232,0.9979824,0.00019728132,0.000008567613,0.000034518987,0.00008233985,0.0004450461,0.00056749734],"genre_scores_gemma":[0.044442233,0.00009614568,0.9537438,0.0001838978,0.000041597046,0.00032816987,0.00024241036,0.00025726066,0.0006645243],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9879423,0.0073100924,0.0006942617,0.0014696427,0.002228075,0.00035560658],"domain_scores_gemma":[0.9152931,0.07075437,0.002733841,0.008286801,0.002442729,0.0004892428],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016873945,0.0014539169,0.0019297989,0.0029608926,0.0014740918,0.0042523374,0.0041760425,0.0021182438,0.013357877],"category_scores_gemma":[0.106971115,0.0015413528,0.002841545,0.0028183574,0.0035998554,0.0047620195,0.0059450017,0.0070385626,0.0023328208],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016114654,0.00014767429,0.0025089493,0.00057694764,0.00020519133,0.00020652515,0.0005926789,0.22044118,0.0015891313,0.6171547,0.0052888566,0.15112704],"study_design_scores_gemma":[0.00006433691,0.000022441774,0.00019654528,0.00007367075,0.000025452333,0.000058409674,0.000044853838,0.37644395,0.0011749621,0.61769634,0.004177173,0.0000218117],"about_ca_topic_score_codex":0.003443992,"about_ca_topic_score_gemma":0.0054437835,"teacher_disagreement_score":0.016873945,"about_ca_system_score_codex":0.0025908982,"about_ca_system_score_gemma":0.006180087,"threshold_uncertainty_score":0.089239},"labels":[],"label_agreement":null},{"id":"W3206008197","doi":"10.1002/pds.5372","title":"A systematic, concept‐based method of developing the exposure measure for drug safety and effectiveness studies","year":2021,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; McGill University; Vancouver Coastal Health; Vancouver Coastal Health Research Institute; International Collaboration On Repair Discoveries; University of British Columbia","funders":"Michael J. Fox Foundation for Parkinson's Research","keywords":"Medicine; Measure (data warehouse); Drug; Pharmacoepidemiology; Risk analysis (engineering); Computer science; Pharmacology; Data mining","score_opus":0.30367479372413136,"score_gpt":0.5431034091767329,"score_spread":0.23942861545260158,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3206008197","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00071631727,0.009247848,0.9572118,0.0020802254,0.000814659,0.02442267,0.0017373094,0.0005284882,0.0032406643],"genre_scores_gemma":[0.006245113,0.0022771212,0.9614746,0.00052125636,0.000113139075,0.02850138,0.0004253141,0.000052766612,0.00038932305],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.74262166,0.19680409,0.025352776,0.010015143,0.024683213,0.00052318186],"domain_scores_gemma":[0.6554928,0.26102325,0.016939936,0.03724662,0.028408658,0.0008887917],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23936833,0.0029055965,0.005066561,0.01690808,0.0017207765,0.0045945807,0.0052035097,0.0037770101,0.010333136],"category_scores_gemma":[0.31774732,0.002055436,0.01076432,0.00964593,0.0050550313,0.005278349,0.0050627547,0.0075778943,0.0019473259],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006069731,0.00027983208,0.0017791697,0.07788676,0.006178898,0.00020733628,0.0021322323,0.0065667294,0.0016343831,0.26348507,0.0187829,0.62045974],"study_design_scores_gemma":[0.0032462557,0.0018434381,0.00505476,0.07012384,0.012814287,0.00079597236,0.0011501113,0.027129045,0.008043404,0.5387584,0.33038664,0.00065382494],"about_ca_topic_score_codex":0.0023111447,"about_ca_topic_score_gemma":0.0034170568,"teacher_disagreement_score":0.7606317,"about_ca_system_score_codex":0.007142383,"about_ca_system_score_gemma":0.025124358,"threshold_uncertainty_score":0.93799424},"labels":[],"label_agreement":null},{"id":"W3206852087","doi":"10.1097/j.pain.0000000000002506","title":"Compliance with telephone-based lifestyle weight loss programs improves low back pain but not knee pain outcomes: complier average causal effects analyses of 2 randomised trials","year":2021,"lang":"en","type":"article","venue":"Pain","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Medicine; Physical therapy; Osteoarthritis; Confidence interval; Randomized controlled trial; Weight loss; Back pain; Knee pain; Low back pain; Psychological intervention; WOMAC; Body mass index; Obesity; Internal medicine; Alternative medicine","score_opus":0.1410671350934605,"score_gpt":0.39632775365511175,"score_spread":0.2552606185616513,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3206852087","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.52045846,0.15079802,0.20803368,0.0052094604,0.0064512463,0.09290717,0.0059201345,0.0018195239,0.008402376],"genre_scores_gemma":[0.90219045,0.0050057075,0.045458082,0.0026711852,0.0008568093,0.04088358,0.0015486749,0.00014525931,0.0012402296],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.622369,0.32747898,0.028918784,0.010427192,0.008467332,0.002338745],"domain_scores_gemma":[0.6637234,0.27341238,0.0362419,0.01771848,0.0074508465,0.0014529104],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21009539,0.0045558843,0.01595782,0.0031791406,0.0010820605,0.0044519245,0.0026794015,0.0061211507,0.007710693],"category_scores_gemma":[0.29539993,0.0024249386,0.04668006,0.0028066102,0.0030440933,0.004766976,0.0029490835,0.0057352637,0.0003992108],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.28580838,0.00097005744,0.0077436734,0.03437301,0.6358545,0.0003827263,0.00068311975,0.004055872,0.00087301043,0.00299124,0.0012397009,0.025024768],"study_design_scores_gemma":[0.3708362,0.034332678,0.020011444,0.004869458,0.5271348,0.00053021294,0.00030992075,0.020946635,0.0017435024,0.012496584,0.0064017433,0.00038682268],"about_ca_topic_score_codex":0.0020982358,"about_ca_topic_score_gemma":0.0017726397,"teacher_disagreement_score":0.21009539,"about_ca_system_score_codex":0.0027641659,"about_ca_system_score_gemma":0.0025293664,"threshold_uncertainty_score":0.974093},"labels":[],"label_agreement":null},{"id":"W3207022311","doi":"10.1007/978-3-030-72437-5_5","title":"A Review of Multiply Robust Estimation with Missing Data","year":2021,"lang":"en","type":"review","venue":"Emerging topics in statistics and biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Imputation (statistics); Missing data; Weighting; Propensity score matching; Robustness (evolution); Computer science; Statistics; National Health and Nutrition Examination Survey; Econometrics; Data mining; Mathematics; Medicine; Population","score_opus":0.34760909233140475,"score_gpt":0.5043437967085805,"score_spread":0.1567347043771758,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3207022311","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00007285026,0.9815462,0.016439043,0.0007317206,0.00038679803,0.000011685347,0.00008768902,0.00004191913,0.0006820594],"genre_scores_gemma":[0.0014940333,0.98151326,0.014683778,0.00058646087,0.0011163608,0.000037577458,0.00013282974,0.000031959105,0.00040384685],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99748385,0.0011040585,0.00033158195,0.00038706567,0.00063229684,0.000061072606],"domain_scores_gemma":[0.9779447,0.01923019,0.00080833305,0.00057990296,0.0013035816,0.00013322118],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.007335587,0.0017005929,0.0036418005,0.0039720056,0.00030927162,0.001726215,0.0028842213,0.0022985754,0.005735661],"category_scores_gemma":[0.028711028,0.000958384,0.0015547845,0.00782529,0.0014307922,0.0027684858,0.0013185285,0.0028028972,0.0025395874],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000066758,0.000049610382,0.00027412418,0.024274092,0.00039144588,0.000092708884,0.00005604976,0.0027109026,0.0003044754,0.029996544,0.031451926,0.91033137],"study_design_scores_gemma":[0.00008525462,0.00022111888,0.0021153863,0.022115037,0.0011138977,0.0014232077,0.000102060745,0.005096433,0.0008125357,0.09323679,0.8734983,0.00017995981],"about_ca_topic_score_codex":0.0026830214,"about_ca_topic_score_gemma":0.0030269686,"teacher_disagreement_score":0.9926644,"about_ca_system_score_codex":0.0010695461,"about_ca_system_score_gemma":0.0031079915,"threshold_uncertainty_score":0.038794756},"labels":[],"label_agreement":null},{"id":"W3208637463","doi":"10.33137/utjph.v2i2.36827","title":"Evaluating the Impact of Alcohol Control Interventions on Suicide Mortality Rates","year":2021,"lang":"en","type":"article","venue":"University of Toronto Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Addiction and Mental Health; Public Health Ontario; University of Toronto","funders":"","keywords":"Psychological intervention; Demography; Suicide prevention; Medicine; Poison control; Injury prevention; Excise; Intervention (counseling); Unemployment; Mortality rate; Environmental health; Gerontology; Psychiatry; Economics; Surgery","score_opus":0.543377495980509,"score_gpt":0.5646551700270969,"score_spread":0.02127767404658787,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3208637463","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95159125,0.010796955,0.010358119,0.0032005287,0.0009183255,0.006748406,0.005913073,0.00025841309,0.010215003],"genre_scores_gemma":[0.98470426,0.0030948261,0.005427446,0.00046370734,0.0002557816,0.0036231943,0.001312905,0.000013564218,0.001104365],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.984144,0.01204136,0.0009781176,0.00071493007,0.0016420083,0.00047959428],"domain_scores_gemma":[0.9761513,0.014385302,0.005677697,0.0009122923,0.001960407,0.0009128797],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014871834,0.0008060533,0.0010878853,0.00090969197,0.00030847482,0.0007834806,0.0012374205,0.0008335766,0.00689297],"category_scores_gemma":[0.033856947,0.00026962924,0.004500193,0.000593211,0.00071239844,0.0006945553,0.001060509,0.0010177599,0.00055325194],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.09088557,0.028519105,0.1938899,0.02895444,0.030443324,0.00019519826,0.0009408471,0.028041873,0.0032133423,0.007107432,0.011538229,0.57627064],"study_design_scores_gemma":[0.0172133,0.36276695,0.52168274,0.00682916,0.025350435,0.00013473383,0.0012100259,0.025499195,0.020198576,0.0065092775,0.012358669,0.0002469403],"about_ca_topic_score_codex":0.0037313942,"about_ca_topic_score_gemma":0.0026762432,"teacher_disagreement_score":0.014871834,"about_ca_system_score_codex":0.0017987458,"about_ca_system_score_gemma":0.0029882938,"threshold_uncertainty_score":0.07865071},"labels":[],"label_agreement":null},{"id":"W3208912526","doi":"10.1002/cjs.11734","title":"Causal inference for multiple treatments using fractional factorial designs","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Division of Graduate Education; NIH Office of the Director; Faculty of Arts and Sciences","keywords":"Fractional factorial design; Factorial experiment; Causal inference; Factorial; Observational study; Plackett–Burman design; Inference; Design of experiments; Statistics; Computer science; Main effect; Mathematics; Regression; Artificial intelligence; Response surface methodology","score_opus":0.33946401693582756,"score_gpt":0.42734990250249033,"score_spread":0.08788588556666277,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3208912526","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005968061,0.00030034018,0.99148303,0.0004248518,0.00014357748,0.0004844352,0.00017335176,0.00010331167,0.00091906235],"genre_scores_gemma":[0.23592731,0.0005713727,0.7546635,0.0006147327,0.00029831834,0.0060922387,0.00022843061,0.000049967188,0.0015541675],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.81066096,0.1694983,0.0025936854,0.00913296,0.0064305016,0.0016835677],"domain_scores_gemma":[0.48933876,0.46896315,0.015294934,0.019728813,0.0054890974,0.0011852334],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19447884,0.0025169968,0.0050543863,0.004726424,0.0024957638,0.0030989263,0.0042480426,0.0048588193,0.013287259],"category_scores_gemma":[0.30853543,0.0014293833,0.00543139,0.0034181708,0.006951902,0.005550193,0.0037876682,0.0055204616,0.0007366011],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016922163,0.00061967067,0.004704992,0.0010059264,0.0011692579,0.00031183255,0.0009448625,0.07076004,0.0011841829,0.8406327,0.001689724,0.07528461],"study_design_scores_gemma":[0.00060871855,0.0007401512,0.00091835856,0.00015914362,0.00029013748,0.00006014039,0.000113674534,0.17205597,0.0007380402,0.8215861,0.0026621085,0.000067579174],"about_ca_topic_score_codex":0.0030923572,"about_ca_topic_score_gemma":0.0023655738,"teacher_disagreement_score":0.19447884,"about_ca_system_score_codex":0.004125539,"about_ca_system_score_gemma":0.004626759,"threshold_uncertainty_score":0.993351},"labels":[],"label_agreement":null},{"id":"W3209944773","doi":"10.1111/rssa.12716","title":"Propensity Score Analysis for a Semi-Continuous Exposure Variable: A Study of Gestational Alcohol Exposure and Childhood Cognition","year":2021,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series A (Statistics in Society)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Australian Research Council Centre of Excellence for Mathematical and Statistical Frontiers; National Institute on Alcohol Abuse and Alcoholism; National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Covariate; Statistics; Observational study; Econometrics; Instrumental variable; Regression analysis; Regression; Linear regression; Mathematics","score_opus":0.06640264768141525,"score_gpt":0.33270834563667184,"score_spread":0.2663056979552566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3209944773","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91666406,0.0025892225,0.076057926,0.0025309238,0.00008163822,0.000094321105,0.0004971911,0.00005791116,0.0014268307],"genre_scores_gemma":[0.9839175,0.00078231323,0.0141858915,0.00018498713,0.000050940354,0.000068998255,0.0002086235,0.0000152175335,0.00058557914],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.997122,0.0019990639,0.00010585274,0.00036236554,0.00031387096,0.00009668694],"domain_scores_gemma":[0.98590267,0.009175418,0.0020670942,0.001907408,0.00050734525,0.0004400325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0071333605,0.00035726052,0.000540235,0.0009356822,0.0005063272,0.00079224084,0.00072255125,0.0008429744,0.002053983],"category_scores_gemma":[0.028089825,0.00020264913,0.0019228918,0.0017500286,0.0010289365,0.00075916323,0.0013328055,0.001597507,0.0001801695],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002157771,0.0006515538,0.80385375,0.0004421132,0.0040577203,0.0012789383,0.0013886637,0.025973935,0.0018387253,0.04516862,0.0027328895,0.11045535],"study_design_scores_gemma":[0.00055312517,0.0016062862,0.72901523,0.00035717312,0.002013529,0.0015718061,0.0011031092,0.1788086,0.0014832523,0.076678894,0.006689203,0.000119804594],"about_ca_topic_score_codex":0.0098430915,"about_ca_topic_score_gemma":0.005713717,"teacher_disagreement_score":0.0098430915,"about_ca_system_score_codex":0.0005990906,"about_ca_system_score_gemma":0.0015263719,"threshold_uncertainty_score":0.03772527},"labels":[],"label_agreement":null},{"id":"W3210110199","doi":"10.1111/biom.13776","title":"Combining Parametric and Nonparametric Models to Estimate Treatment Effects in Observational Studies","year":2022,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Observational study; Nonparametric statistics; Econometrics; Parametric statistics; Statistics; Semiparametric model; Semiparametric regression; Mathematics; Computer science","score_opus":0.49491503928947006,"score_gpt":0.49405273154595414,"score_spread":0.0008623077435159221,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3210110199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016767883,0.00042918941,0.9968321,0.0004480474,0.00004315362,0.00006734014,0.00006393251,0.000092750364,0.00034676498],"genre_scores_gemma":[0.17048876,0.0019433519,0.8228903,0.00075493305,0.00039867786,0.0013495345,0.0003652117,0.00013245274,0.0016767686],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9555868,0.038198214,0.00082377304,0.0021089434,0.0028399376,0.00044244571],"domain_scores_gemma":[0.87474424,0.11041274,0.0044134106,0.007802404,0.0020529998,0.0005741859],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.053954355,0.0012798213,0.0022341763,0.0034434882,0.0010174331,0.002755778,0.0040621874,0.0026436988,0.0026790486],"category_scores_gemma":[0.16357806,0.0010120064,0.002727503,0.004481295,0.0032592444,0.003554625,0.0037742874,0.0052133454,0.0006066247],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017728335,0.0001548802,0.00914659,0.0006102988,0.00078629825,0.00036040304,0.00067394564,0.2274628,0.0004449539,0.59683406,0.0033932033,0.15995526],"study_design_scores_gemma":[0.00007785734,0.00008693188,0.0012582937,0.00013296145,0.00012948984,0.00015300719,0.00008572316,0.4550846,0.00028734875,0.53811127,0.004544416,0.000048184385],"about_ca_topic_score_codex":0.0056825704,"about_ca_topic_score_gemma":0.004905194,"teacher_disagreement_score":0.053954355,"about_ca_system_score_codex":0.0016360219,"about_ca_system_score_gemma":0.0034559811,"threshold_uncertainty_score":0.28534126},"labels":[],"label_agreement":null},{"id":"W3212311571","doi":"10.1136/bmjopen-2021-052969","title":"Current trends in the application of causal inference methods to pooled longitudinal non-randomised data: a protocol for a methodological systematic review","year":2021,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Institute of Genetics; Canadian Institutes of Health Research; European Commission","keywords":"Causal inference; Medicine; Protocol (science); Causality (physics); Observational study; Data science; MEDLINE; Medical education; Management science; Alternative medicine; Computer science; Pathology","score_opus":0.7630757976314549,"score_gpt":0.6992870156665126,"score_spread":0.06378878196494231,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3212311571","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000653086,0.020048887,0.024234701,0.0069781155,0.002989216,0.93701476,0.0057713618,0.00054308213,0.0017668057],"genre_scores_gemma":[0.000699724,0.0057983305,0.030759718,0.0009915517,0.00010611726,0.9606446,0.0006531267,0.00004793006,0.00029889029],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.48040912,0.30751646,0.16055577,0.0105048735,0.03647437,0.004539378],"domain_scores_gemma":[0.53706986,0.2648666,0.071372285,0.032228675,0.08930009,0.0051625343],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.45596486,0.00499874,0.015447721,0.02650801,0.005181438,0.013101718,0.009249162,0.014043258,0.022391122],"category_scores_gemma":[0.56412685,0.005997026,0.020567432,0.02867261,0.009541993,0.014481596,0.010481463,0.011646867,0.009754418],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015940679,0.0001583973,0.0008286502,0.8533722,0.0024902883,0.0003103544,0.0032808043,0.00090440025,0.0008754787,0.011813824,0.044569377,0.079802185],"study_design_scores_gemma":[0.004447469,0.000599852,0.001923081,0.83117807,0.0043792627,0.0003178108,0.0012855225,0.0013398217,0.0011530138,0.017418334,0.13561617,0.00034153383],"about_ca_topic_score_codex":0.004632228,"about_ca_topic_score_gemma":0.0072695264,"teacher_disagreement_score":0.54403514,"about_ca_system_score_codex":0.026700297,"about_ca_system_score_gemma":0.09677363,"threshold_uncertainty_score":0.67089224},"labels":[],"label_agreement":null},{"id":"W3213398770","doi":"10.33137/utjph.v2i2.36762","title":"Performance of statistical methods to address treatment non-adherence in pragmatic clinical trials with point-treatment settings: a simulation study","year":2021,"lang":"en","type":"article","venue":"University of Toronto Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"","keywords":"Instrumental variable; Confounding; Statistics; Inverse probability weighting; Mean squared error; Confidence interval; Marginal structural model; Nonparametric statistics; Average treatment effect; Inverse probability; Econometrics; Mathematics; Propensity score matching; Bayesian probability; Posterior probability","score_opus":0.36324283547822495,"score_gpt":0.5572104845341386,"score_spread":0.19396764905591363,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3213398770","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.46636212,0.01582722,0.49216205,0.005134301,0.00050474633,0.007503454,0.0022839187,0.0006203023,0.009601866],"genre_scores_gemma":[0.8680074,0.0019411029,0.12127071,0.000811699,0.00010833692,0.0061166426,0.00077057997,0.00008811737,0.0008853066],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9185354,0.0759278,0.001811859,0.0014371625,0.001458428,0.000829418],"domain_scores_gemma":[0.5286444,0.44140732,0.012913571,0.0077873487,0.007540836,0.0017065285],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09696617,0.0021376752,0.0035068963,0.0015228905,0.0007247888,0.0017767779,0.002634742,0.0031954113,0.004697761],"category_scores_gemma":[0.21642102,0.0010163282,0.004705701,0.0018964958,0.0017964493,0.002185488,0.0026333365,0.0039011587,0.00039528735],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009795765,0.001635483,0.015435081,0.004435997,0.004466057,0.00040711346,0.0005911025,0.88600904,0.00046464204,0.033750556,0.0033752467,0.039633825],"study_design_scores_gemma":[0.0035274026,0.002483429,0.0020930914,0.00081948313,0.0013410088,0.00014944882,0.000119139404,0.9661924,0.00054802344,0.021059388,0.0015490776,0.0001181595],"about_ca_topic_score_codex":0.0069074878,"about_ca_topic_score_gemma":0.0029120247,"teacher_disagreement_score":0.90303385,"about_ca_system_score_codex":0.0032397874,"about_ca_system_score_gemma":0.003886992,"threshold_uncertainty_score":0.51281226},"labels":[],"label_agreement":null},{"id":"W3213843957","doi":"10.3390/e24020179","title":"Normalized Augmented Inverse Probability Weighting with Neural Network Predictions","year":2022,"lang":"en","type":"article","venue":"Entropy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Estimator; Weighting; Regularization (linguistics); Computer science; Artificial neural network; Stochastic gradient descent; Parametric statistics; Mathematical optimization; Mathematics; Normalization (sociology); Robustness (evolution); Algorithm; Artificial intelligence; Statistics","score_opus":0.0720494997390497,"score_gpt":0.326328666726839,"score_spread":0.2542791669877893,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3213843957","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018745035,0.00018706238,0.9791835,0.00032169322,0.00005805,0.00006582985,0.00011348709,0.00028866823,0.0010367804],"genre_scores_gemma":[0.5747414,0.00038999118,0.4181742,0.00041640614,0.00019040197,0.00048215938,0.0005652774,0.000118660064,0.004921387],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9969421,0.0017180552,0.00015400098,0.00057730137,0.00047109608,0.00013742731],"domain_scores_gemma":[0.98850214,0.008134372,0.00088428723,0.0013837969,0.0009398549,0.0001555645],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008270949,0.000987052,0.0016584101,0.00094627246,0.00039371103,0.0013201922,0.0024991825,0.0016121806,0.0032189141],"category_scores_gemma":[0.034144163,0.0006438332,0.0008439968,0.0010628772,0.001409932,0.0032463244,0.001724386,0.0024997888,0.00047949285],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002818706,0.00010852468,0.0021196378,0.0001439005,0.00015098976,0.00010409262,0.00012319314,0.78938264,0.0011769456,0.08069726,0.0013443225,0.12436665],"study_design_scores_gemma":[0.000020460613,0.000021659365,0.0002733673,0.000012831135,0.000013487228,0.000015728489,0.000003725728,0.96482474,0.00048446134,0.033976767,0.0003417861,0.000010970175],"about_ca_topic_score_codex":0.004566376,"about_ca_topic_score_gemma":0.0033955988,"teacher_disagreement_score":0.008270949,"about_ca_system_score_codex":0.0011361917,"about_ca_system_score_gemma":0.0018182115,"threshold_uncertainty_score":0.043741465},"labels":[],"label_agreement":null},{"id":"W3214335189","doi":"10.33137/utjph.v2i2.36761","title":"Comparisons of Propensity Score Methods for Time to Event Outcomes: Evaluation through Simulations and Oral Squamous Cell Carcinoma Case Study","year":2021,"lang":"en","type":"article","venue":"University of Toronto Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Public Health Ontario; University of Toronto","funders":"","keywords":"Covariate; Propensity score matching; Confounding; Inverse probability weighting; Statistics; Hazard ratio; Proportional hazards model; Observational study; Population; Medicine; Mathematics; Confidence interval","score_opus":0.4349740173307456,"score_gpt":0.5034382312175022,"score_spread":0.06846421388675661,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3214335189","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87465453,0.0018210519,0.11706891,0.0013613305,0.00014552951,0.0012776766,0.0010771567,0.00019802983,0.0023957647],"genre_scores_gemma":[0.94616616,0.00048604666,0.050580714,0.00020111816,0.00005264519,0.0010899619,0.0008479238,0.000035939403,0.0005394823],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97746265,0.019367851,0.00080981216,0.00093266653,0.0010155365,0.00041145878],"domain_scores_gemma":[0.65217036,0.32261106,0.010236222,0.0071377554,0.006414733,0.0014298108],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.065702304,0.000988699,0.001466737,0.0015290931,0.00052549044,0.001269006,0.0022520935,0.0018549063,0.0025304444],"category_scores_gemma":[0.13939312,0.00068475254,0.0028447676,0.0013072771,0.0010317183,0.0013877816,0.001783387,0.0017802032,0.00017035757],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0039635575,0.0011197493,0.04787194,0.00041626472,0.0013907822,0.00022094151,0.00032850957,0.90554464,0.00025233903,0.011695438,0.0016715024,0.025524305],"study_design_scores_gemma":[0.00062344305,0.0007645628,0.0036540064,0.00007696009,0.00017286075,0.00006805151,0.0000859371,0.9903195,0.0002686653,0.0034862563,0.00044693396,0.00003299769],"about_ca_topic_score_codex":0.0115502095,"about_ca_topic_score_gemma":0.005609991,"teacher_disagreement_score":0.9342977,"about_ca_system_score_codex":0.0029699875,"about_ca_system_score_gemma":0.002309429,"threshold_uncertainty_score":0.34747118},"labels":[],"label_agreement":null},{"id":"W40055348","doi":"","title":"Predicting treatment outcome in chemically dependent women: A test of Marlatt and Gordon's Relapse Model.","year":2000,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Outcome (game theory); Test (biology); Internal medicine; Computer science; Oncology; Medicine; Mathematics; Biology; Mathematical economics","score_opus":0.06697021376643184,"score_gpt":0.30746608093270705,"score_spread":0.24049586716627522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W40055348","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9954189,0.0002897661,0.0021111516,0.0010463893,0.000026068581,0.00012120074,0.00013260325,0.00001783272,0.00083594624],"genre_scores_gemma":[0.9969843,0.00012046999,0.0021777006,0.0001565056,0.000014674471,0.000099224235,0.00018619704,0.0000055607356,0.00025543832],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99660945,0.0022418718,0.0001708716,0.00024604902,0.0005457144,0.00018612435],"domain_scores_gemma":[0.9862831,0.010219226,0.0011797582,0.00091681234,0.00079630566,0.00060483365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010090801,0.00057689013,0.0007162181,0.000969642,0.00063066644,0.0008482545,0.0011489803,0.0008308348,0.0018404794],"category_scores_gemma":[0.03425724,0.00036165884,0.0014110603,0.00056502764,0.0005821496,0.0010143429,0.0012400823,0.001620383,0.0003464418],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033531638,0.0003551086,0.9762556,0.000027476057,0.00016567149,0.00010345087,0.00052039156,0.0006255314,0.00009307414,0.00025937226,0.0003004825,0.020958431],"study_design_scores_gemma":[0.00022249403,0.003143623,0.8832293,0.00015487013,0.00045963062,0.0009855421,0.00253265,0.1029579,0.00034018458,0.004347027,0.0015713513,0.000055425407],"about_ca_topic_score_codex":0.008839564,"about_ca_topic_score_gemma":0.007782896,"teacher_disagreement_score":0.010090801,"about_ca_system_score_codex":0.000559883,"about_ca_system_score_gemma":0.0012316381,"threshold_uncertainty_score":0.053365886},"labels":[],"label_agreement":null},{"id":"W4200057099","doi":"10.1002/pds.5403","title":"A comparison of confounder selection and adjustment methods for estimating causal effects using large healthcare databases","year":2021,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McMaster University; Université Laval; Université de Montréal; Programs for Assessment of Technology in Health Research Institute; McMaster University Medical Centre; Impact; McGill University; Centre Hospitalier de l’Université de Montréal; The Quebec Population Health Research Network","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Université Laval","keywords":"Confounding; Propensity score matching; Lasso (programming language); Observational study; Medicine; Statistics; Bayesian probability; Selection bias; Collinearity; Machine learning; Computer science; Econometrics; Data mining; Artificial intelligence; Mathematics","score_opus":0.34295857249468426,"score_gpt":0.6076724006262337,"score_spread":0.2647138281315495,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200057099","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12442565,0.0059631704,0.862541,0.0025770748,0.00015148014,0.0014385164,0.0007217401,0.00050063396,0.0016807499],"genre_scores_gemma":[0.6214262,0.002169159,0.37250045,0.0005534566,0.000097858254,0.0019521249,0.00083548605,0.000082237224,0.00038301476],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9533505,0.040853485,0.0011871229,0.0019533804,0.0023720134,0.0002834736],"domain_scores_gemma":[0.7898147,0.19069256,0.0069908467,0.008070346,0.0035893763,0.0008421049],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07365565,0.0010959248,0.0015898583,0.0017199509,0.00056136213,0.0013150771,0.0020824238,0.0015652926,0.0017093413],"category_scores_gemma":[0.19354112,0.00068404974,0.0025228888,0.0021505295,0.001063295,0.0020241223,0.0020200403,0.0016319373,0.0001500832],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005908085,0.0005716845,0.06402383,0.0018747809,0.0065526017,0.00027472773,0.00066428917,0.51364666,0.00089281297,0.046990745,0.0039919144,0.35460785],"study_design_scores_gemma":[0.002012184,0.00081016915,0.015257408,0.0004821788,0.0009240562,0.0002168706,0.00016943186,0.9343908,0.00085274334,0.04158991,0.0031962558,0.00009798588],"about_ca_topic_score_codex":0.0075160316,"about_ca_topic_score_gemma":0.004059152,"teacher_disagreement_score":0.92634434,"about_ca_system_score_codex":0.0015360584,"about_ca_system_score_gemma":0.0037139177,"threshold_uncertainty_score":0.38953298},"labels":[],"label_agreement":null},{"id":"W4200191876","doi":"10.1109/embc46164.2021.9629697","title":"Machine Learning Model Validation for Early Stage Studies with Small Sample Sizes","year":2021,"lang":"en","type":"article","venue":"2021 43rd Annual International Conference of the IEEE Engineering in Medicine &amp; Biology Society (EMBC)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Overfitting; Feature selection; Feature (linguistics); Cross-validation; Selection (genetic algorithm); Sample size determination; Model selection; Sample (material)","score_opus":0.22964225839714317,"score_gpt":0.4107561751219546,"score_spread":0.18111391672481145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200191876","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018374315,0.00077838066,0.9761486,0.000580192,0.00019557396,0.0020306583,0.00034403015,0.0004740122,0.0010743112],"genre_scores_gemma":[0.28267217,0.0004945141,0.7027878,0.0010350837,0.00010200644,0.010637133,0.0010593754,0.00038534845,0.00082657184],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8673836,0.115617305,0.005766044,0.0048771016,0.0054907645,0.0008652745],"domain_scores_gemma":[0.4899657,0.4344595,0.012181926,0.04372811,0.018741028,0.0009236715],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26059565,0.0021507025,0.002066172,0.0019543439,0.0021439795,0.0030566305,0.0034559695,0.0026903911,0.0037244058],"category_scores_gemma":[0.49088717,0.0009975438,0.0033547843,0.001599778,0.003007654,0.003936213,0.0032989162,0.0054719415,0.0008118679],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0061903563,0.0022505126,0.11441036,0.006841378,0.0060442756,0.0013952751,0.00443129,0.22437932,0.021821482,0.11059285,0.016631206,0.4850117],"study_design_scores_gemma":[0.0012032356,0.0065705967,0.044471055,0.0035468792,0.0014715712,0.00076197134,0.0011246075,0.6648002,0.03414985,0.1935194,0.047957767,0.0004228212],"about_ca_topic_score_codex":0.0025251508,"about_ca_topic_score_gemma":0.0033661663,"teacher_disagreement_score":0.7394043,"about_ca_system_score_codex":0.0017191293,"about_ca_system_score_gemma":0.005408662,"threshold_uncertainty_score":0.9118172},"labels":[],"label_agreement":null},{"id":"W4200348404","doi":"10.1111/rssc.12533","title":"Ranking Tailoring Variables for Constructing Individualized Treatment Rules: An Application to Schizophrenia","year":2021,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series C (Applied Statistics)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Environmental Health Sciences; National Institute of Mental Health; National Institutes of Health; University of Washington","keywords":"Schizophrenia (object-oriented programming); Ranking (information retrieval); Matching (statistics); Intervention (counseling); Antipsychotic; Medicine; Selection (genetic algorithm); Computer science; Psychiatry; Intensive care medicine; Machine learning","score_opus":0.05566241879820685,"score_gpt":0.35889085328848286,"score_spread":0.30322843449027603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200348404","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05899483,0.0013916057,0.9354948,0.001926855,0.000071753544,0.00040685938,0.00022870241,0.00025089242,0.0012336682],"genre_scores_gemma":[0.4275911,0.0010292117,0.56876194,0.0005313786,0.00011811843,0.000512972,0.00021568123,0.00008377784,0.0011558471],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9774883,0.0200864,0.0005060496,0.0008526047,0.0007926663,0.00027392537],"domain_scores_gemma":[0.86315346,0.1281322,0.003539933,0.0025852134,0.0018434213,0.00074582064],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03763595,0.0010885571,0.0029201964,0.0024242846,0.0012651411,0.001932821,0.0016801466,0.002030962,0.0034172856],"category_scores_gemma":[0.12272336,0.0006792736,0.0020116514,0.0029369185,0.002038986,0.0019222888,0.0026945497,0.00388351,0.00028242636],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012669613,0.000532543,0.016266856,0.0004414705,0.00073820085,0.00042629713,0.000829328,0.5120113,0.00088233827,0.13723311,0.0030608128,0.32631075],"study_design_scores_gemma":[0.00043807793,0.00035096417,0.0018522324,0.00009724328,0.00015926777,0.000084614396,0.00015136138,0.7849966,0.00053271966,0.20935635,0.0019119817,0.00006858873],"about_ca_topic_score_codex":0.01089396,"about_ca_topic_score_gemma":0.013484219,"teacher_disagreement_score":0.03763595,"about_ca_system_score_codex":0.0017754837,"about_ca_system_score_gemma":0.003659069,"threshold_uncertainty_score":0.1990403},"labels":[],"label_agreement":null},{"id":"W4200496182","doi":"10.1017/s0272263121000838","title":"ARE REPLICATION STUDIES INFREQUENT BECAUSE OF NEGATIVE ATTITUDES?","year":2021,"lang":"en","type":"article","venue":"Studies in Second Language Acquisition","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Replication (statistics); Originality; Empirical research; Psychology; Field (mathematics); Quarter (Canadian coin); Computer science; Biology; Social psychology; Mathematics; Statistics; History","score_opus":0.22446288524017477,"score_gpt":0.4964301856562038,"score_spread":0.271967300416029,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200496182","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17453808,0.02230435,0.3187735,0.3949474,0.017322717,0.018506873,0.001397607,0.0025148713,0.04969459],"genre_scores_gemma":[0.7064678,0.0037566654,0.17934686,0.08130301,0.0059714443,0.018278938,0.00038952965,0.0007278969,0.003757762],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.13228896,0.68888587,0.08343356,0.0154810175,0.0769246,0.0029860288],"domain_scores_gemma":[0.02389357,0.79997224,0.061774284,0.066584,0.045073178,0.0027026907],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7962566,0.0011599051,0.0023119717,0.008824274,0.00435783,0.008578361,0.0057243817,0.007955659,0.007891992],"category_scores_gemma":[0.9324091,0.0023863385,0.0024139588,0.0058108317,0.01893995,0.012783332,0.007066097,0.007862396,0.0024382817],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031817746,0.0011147776,0.1171313,0.020371938,0.0028532601,0.00360222,0.113739125,0.0017663661,0.00659491,0.091015585,0.09501974,0.54360896],"study_design_scores_gemma":[0.001882242,0.004150123,0.09809787,0.051118262,0.0022588435,0.009369105,0.06545774,0.019933928,0.014795209,0.3057412,0.42592382,0.0012716929],"about_ca_topic_score_codex":0.0016628703,"about_ca_topic_score_gemma":0.0020712416,"teacher_disagreement_score":0.2037434,"about_ca_system_score_codex":0.0064531323,"about_ca_system_score_gemma":0.013336299,"threshold_uncertainty_score":0.25125194},"labels":[],"label_agreement":null},{"id":"W4205116055","doi":"10.1177/0272989x211072858","title":"Prioritizing Research in an Era of Personalized Medicine: The Potential Value of Unexplained Heterogeneity","year":2022,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Institute of Human Development, Child and Youth Health; Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Prioritization; Value (mathematics); Key (lock); Precision medicine; Personalized medicine; MEDLINE","score_opus":0.25720169022223494,"score_gpt":0.5324951527152464,"score_spread":0.27529346249301145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205116055","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09608478,0.029063893,0.6914637,0.14118408,0.0012630085,0.0013297413,0.0011753003,0.00040502445,0.0380305],"genre_scores_gemma":[0.89490896,0.0046191555,0.091811396,0.0060578957,0.0007947958,0.0006918852,0.00016106715,0.00009584145,0.00085909845],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.789304,0.18108988,0.0049630245,0.006991922,0.014590462,0.003060748],"domain_scores_gemma":[0.437088,0.5211327,0.016274778,0.016112152,0.006562758,0.0028296106],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.16166857,0.0017233265,0.0034804642,0.00584013,0.0021957052,0.012922942,0.003838585,0.0048769587,0.0039302665],"category_scores_gemma":[0.30456784,0.001047657,0.0034828202,0.0056566377,0.012688201,0.012801422,0.0070286714,0.0063098306,0.0003037465],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008648664,0.00017568188,0.020096363,0.0025262642,0.0032087674,0.0006178891,0.0021047425,0.11375934,0.0007780466,0.6976584,0.006496035,0.15171364],"study_design_scores_gemma":[0.00012078556,0.00013331024,0.0027885803,0.0005657615,0.00037464447,0.00013553037,0.00047518138,0.02471468,0.00036269252,0.96514255,0.005092847,0.00009338347],"about_ca_topic_score_codex":0.005579941,"about_ca_topic_score_gemma":0.004760488,"teacher_disagreement_score":0.16166857,"about_ca_system_score_codex":0.012749532,"about_ca_system_score_gemma":0.011833048,"threshold_uncertainty_score":0.8549953},"labels":[],"label_agreement":null},{"id":"W4205150711","doi":"10.1111/biom.13625","title":"Ultra-High Dimensional Variable Selection for Doubly Robust Causal Inference","year":2022,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Canadian Statistical Sciences Institute; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Causal inference; Covariate; Estimator; Feature selection; Propensity score matching; Computer science; Confounding; Econometrics; Outcome (game theory); Robustness (evolution); Causal model; Inference; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.16438772303541557,"score_gpt":0.38276504830221764,"score_spread":0.21837732526680206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205150711","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012116418,0.00014890108,0.997982,0.00020037555,0.000025078625,0.000040797026,0.00006819633,0.00010147395,0.0002214472],"genre_scores_gemma":[0.1309112,0.0009493566,0.86359286,0.0006084811,0.0003854763,0.0011506517,0.00080735906,0.00016889727,0.0014257253],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9750284,0.019578025,0.00081349426,0.0018061408,0.0023645062,0.00040944322],"domain_scores_gemma":[0.9056083,0.07214329,0.0048830626,0.013580748,0.0030379845,0.0007465491],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039001994,0.0012859905,0.0027091186,0.003396241,0.0016378586,0.0024718249,0.0038870866,0.0020130246,0.00562932],"category_scores_gemma":[0.12385936,0.0011874535,0.0031435082,0.0037949153,0.0040347977,0.0034398297,0.0060636774,0.0050633242,0.0011628751],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020323868,0.0001705566,0.005669164,0.0005339191,0.000615886,0.00044198107,0.00038953486,0.10101574,0.0012979921,0.75118417,0.0047242744,0.13375343],"study_design_scores_gemma":[0.00008421266,0.00008403392,0.0011558406,0.00009372819,0.00007592874,0.00014101043,0.000043079064,0.44636235,0.00081580115,0.54693294,0.004162245,0.00004884706],"about_ca_topic_score_codex":0.0023478074,"about_ca_topic_score_gemma":0.0021462373,"teacher_disagreement_score":0.039001994,"about_ca_system_score_codex":0.0013294035,"about_ca_system_score_gemma":0.0032264707,"threshold_uncertainty_score":0.20626467},"labels":[],"label_agreement":null},{"id":"W4205319590","doi":"10.31219/osf.io/d4brv","title":"R package regmedint: extension of regression-based causal mediation analysis with effect measure modification by covariates","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Arthritis and Musculoskeletal and Skin Diseases; Rheumatology Research Foundation; Brigham and Women's Hospital","keywords":"Covariate; Mediation; Measure (data warehouse); Regression analysis; Regression; Econometrics; Extension (predicate logic); Statistics; Computer science; Mathematics; Data mining","score_opus":0.0818531986761899,"score_gpt":0.3891027195687955,"score_spread":0.3072495208926056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205319590","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003303944,0.0013816052,0.8476654,0.0020415958,0.0008467277,0.00096277794,0.08363515,0.054435026,0.0057278364],"genre_scores_gemma":[0.0563905,0.001289408,0.850508,0.0018824164,0.0005433983,0.0080435155,0.027411534,0.04427548,0.0096556675],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98821104,0.0078061647,0.0007212922,0.0015961985,0.0013667861,0.000298565],"domain_scores_gemma":[0.9272302,0.058513388,0.0029430026,0.008030157,0.0028597421,0.0004235782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018038925,0.0030604927,0.0025842243,0.0023791513,0.00051772775,0.0025545633,0.003489468,0.0011895417,0.12504157],"category_scores_gemma":[0.13836472,0.0018882737,0.0046840296,0.0027009144,0.0010316407,0.0025998373,0.002894508,0.0038550796,0.032340184],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010716213,0.00017333134,0.012943886,0.0078067053,0.007158519,0.00069413846,0.0008126185,0.015432333,0.0016337952,0.089493565,0.6300546,0.23272492],"study_design_scores_gemma":[0.0016042489,0.00039237304,0.014181735,0.001365393,0.0034250084,0.0013493295,0.0001532961,0.0726206,0.0044451524,0.3249965,0.5750985,0.00036790626],"about_ca_topic_score_codex":0.004229089,"about_ca_topic_score_gemma":0.0048706126,"teacher_disagreement_score":0.12504157,"about_ca_system_score_codex":0.0007888373,"about_ca_system_score_gemma":0.004009939,"threshold_uncertainty_score":0.41830575},"labels":[],"label_agreement":null},{"id":"W4205396314","doi":"10.1016/j.jclinepi.2022.01.008","title":"Systematic Review Reveals Lack of Causal Methodology Applied to Pooled Longitudinal Observational Infectious Disease Studies","year":2022,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Observational study; Causal inference; Confounding; Pooling; Inference; Infectious disease (medical specialty); Meta-analysis; Systematic review; Medicine; Longitudinal study; Disease; MEDLINE; Psychology; Computer science; Pathology; Artificial intelligence; Biology","score_opus":0.9380984862681854,"score_gpt":0.7130274982901617,"score_spread":0.22507098797802372,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4205396314","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020204128,0.95635724,0.028667672,0.005845968,0.0011487865,0.0025284647,0.001426169,0.0001268089,0.0018784818],"genre_scores_gemma":[0.16167414,0.75805724,0.050913125,0.011454953,0.0013865888,0.014056288,0.0017304515,0.00020779394,0.0005194994],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.5209193,0.33944675,0.08760409,0.015411937,0.034697693,0.0019202185],"domain_scores_gemma":[0.18078539,0.7431203,0.040542636,0.020126041,0.014849391,0.00057623425],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.33916107,0.0026363328,0.010259267,0.013506025,0.0016268704,0.00925518,0.00514717,0.003991002,0.0062636277],"category_scores_gemma":[0.70213807,0.0028354106,0.014742369,0.017632242,0.0049877902,0.010785366,0.0053015784,0.0041504614,0.0009087667],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004959728,0.0000249693,0.0046249684,0.8139375,0.061988447,0.00022854556,0.001091911,0.0010757194,0.00015618559,0.010910242,0.005497041,0.09996853],"study_design_scores_gemma":[0.0007467178,0.00030985274,0.008366783,0.7782931,0.13207406,0.000635682,0.0010079623,0.0016258814,0.0006689483,0.03608856,0.040013164,0.00016931574],"about_ca_topic_score_codex":0.0068967086,"about_ca_topic_score_gemma":0.012368555,"teacher_disagreement_score":0.9897407,"about_ca_system_score_codex":0.009640716,"about_ca_system_score_gemma":0.023602117,"threshold_uncertainty_score":0.81493205},"labels":[],"label_agreement":null},{"id":"W4206590108","doi":"10.1093/biomet/asab064","title":"Multiplicative effect modelling: the general case","year":2021,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Mathematics; Categorical variable; Covariate; Statistics; Multiplicative function; Logistic regression; Econometrics; Generalized linear model; Outcome (game theory); Additive model; Poisson regression; Odds; Regression analysis; Population; Demography; Mathematical economics","score_opus":0.24769433042141864,"score_gpt":0.45285682211812733,"score_spread":0.2051624916967087,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206590108","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0052841036,0.000945516,0.98629016,0.0015016303,0.00009174044,0.00008537289,0.0004348438,0.00014427787,0.0052224095],"genre_scores_gemma":[0.44759238,0.0040848344,0.5164344,0.0021508094,0.0011642644,0.0017427871,0.0010835833,0.00039217144,0.025354853],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98781127,0.007546899,0.0005415412,0.0020089254,0.0016010553,0.00049036933],"domain_scores_gemma":[0.966822,0.027285358,0.0020480982,0.0023470728,0.0011236158,0.00037384286],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016136512,0.001809969,0.0026907313,0.0021310362,0.0007677246,0.0031614767,0.0042117345,0.0036536893,0.010976222],"category_scores_gemma":[0.051445007,0.001149479,0.004440647,0.0018665218,0.002289979,0.003315746,0.0030199871,0.0043597342,0.0016842585],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006532967,0.000049833317,0.0019533907,0.0002498643,0.00023290934,0.0005268459,0.0002926739,0.07717472,0.00033667934,0.89508235,0.002870391,0.021165011],"study_design_scores_gemma":[0.0000404485,0.000046507303,0.00037356786,0.00009188235,0.00011572946,0.00027113542,0.000039388673,0.19371264,0.00013439212,0.79799783,0.007150361,0.000026150654],"about_ca_topic_score_codex":0.0051806634,"about_ca_topic_score_gemma":0.0035122759,"teacher_disagreement_score":0.016136512,"about_ca_system_score_codex":0.0016296593,"about_ca_system_score_gemma":0.0014523062,"threshold_uncertainty_score":0.08533907},"labels":[],"label_agreement":null},{"id":"W4206712161","doi":"10.1016/j.psyneuen.2021.105514","title":"Self-selection bias in human stress research: a systematic review","year":2021,"lang":"en","type":"review","venue":"Psychoneuroendocrinology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"PsycINFO; Selection (genetic algorithm); Selection bias; Psychology; Publication bias; Social psychology; Attentional bias; Applied psychology; Clinical psychology; Meta-analysis; MEDLINE; Medicine; Computer science; Anxiety; Biology; Psychiatry","score_opus":0.6237328284153115,"score_gpt":0.5838207168140701,"score_spread":0.03991211160124142,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4206712161","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00045706076,0.9980666,0.00056742504,0.00022880462,0.000121263685,0.00026244886,0.00017118576,0.000008452956,0.00011675658],"genre_scores_gemma":[0.017830137,0.97734743,0.0025505596,0.0010709775,0.00017628275,0.00068433053,0.00020387759,0.000013308746,0.00012314666],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.97105473,0.013730334,0.008819123,0.0024250771,0.0035788878,0.00039188022],"domain_scores_gemma":[0.84334934,0.13931568,0.011297911,0.002167094,0.003395446,0.000474448],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03670291,0.0017414868,0.011347594,0.0069985413,0.0007946706,0.0040497254,0.0030009884,0.0035701527,0.008479885],"category_scores_gemma":[0.15018223,0.0017262675,0.01096197,0.0072767837,0.0018617024,0.003943567,0.0025940125,0.0022808297,0.0005235925],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001964448,0.00002225995,0.0012111481,0.91769844,0.030526895,0.00008968451,0.00021506687,0.00012943213,0.00006151735,0.0006401592,0.0014472097,0.047761727],"study_design_scores_gemma":[0.00069419126,0.00019137005,0.003979038,0.7579803,0.21880864,0.00029562227,0.00038172543,0.00027885474,0.00015291438,0.0023794572,0.014775419,0.000082528895],"about_ca_topic_score_codex":0.006944154,"about_ca_topic_score_gemma":0.025145113,"teacher_disagreement_score":0.96329707,"about_ca_system_score_codex":0.0028459327,"about_ca_system_score_gemma":0.013451307,"threshold_uncertainty_score":0.19410586},"labels":[],"label_agreement":null},{"id":"W4210433482","doi":"10.1016/j.ejor.2022.01.046","title":"Estimating causal effects with optimization-based methods: A review and empirical comparison","year":2022,"lang":"en","type":"review","venue":"European Journal of Operational Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; HEC Montréal","funders":"Fonds de recherche du Québec – Nature et technologies; National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada; Compute Canada","keywords":"Causal inference; Inference; Computer science; Covariate; Causal model; Econometrics; Randomized experiment; Machine learning; Artificial intelligence; Statistics; Mathematics","score_opus":0.6049499846790904,"score_gpt":0.6345053979722219,"score_spread":0.029555413293131494,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210433482","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00026449794,0.98167497,0.015941946,0.0005771483,0.00014625643,0.000029881883,0.000054916345,0.000027537093,0.001282931],"genre_scores_gemma":[0.0046236035,0.978211,0.01600933,0.0002924442,0.000341433,0.00008774723,0.0000906305,0.000027793736,0.000316153],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.99679047,0.0015073786,0.00040756573,0.0005108764,0.0007087022,0.00007502843],"domain_scores_gemma":[0.96094203,0.03579807,0.0009801999,0.0005665641,0.0015725386,0.00014047674],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.008849651,0.0018833714,0.0032215777,0.004366267,0.00040233295,0.002152735,0.0022234544,0.0022568344,0.004758121],"category_scores_gemma":[0.026180651,0.0009445966,0.0024618767,0.0072745834,0.0013918842,0.002523267,0.0009948722,0.0022079782,0.0013849094],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012719778,0.00012294805,0.00087598554,0.05122312,0.00077430304,0.00008339353,0.00016431694,0.0069301524,0.000290272,0.04422628,0.01042051,0.8847615],"study_design_scores_gemma":[0.00021120654,0.00075176946,0.00820533,0.06276422,0.0043137134,0.0017010986,0.00055528694,0.022193586,0.002041694,0.14630911,0.7506008,0.00035203891],"about_ca_topic_score_codex":0.003408259,"about_ca_topic_score_gemma":0.0028393408,"teacher_disagreement_score":0.9911504,"about_ca_system_score_codex":0.0014785103,"about_ca_system_score_gemma":0.0034136125,"threshold_uncertainty_score":0.046801984},"labels":[],"label_agreement":null},{"id":"W4210609813","doi":"10.1002/sim.9318","title":"Preserving data privacy when using multi‐site data to estimate individualized treatment rules","year":2022,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Computer science; Pooling; Robustness (evolution); Data mining; Covariate; Regression; Context (archaeology); Confidentiality; Machine learning; Artificial intelligence; Statistics; Mathematics","score_opus":0.5117738302480719,"score_gpt":0.5546970299518682,"score_spread":0.04292319970379632,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210609813","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.045095135,0.00033861274,0.9516599,0.0010122779,0.00003470954,0.00012035752,0.00051921955,0.00025030083,0.0009694781],"genre_scores_gemma":[0.72153425,0.00029764776,0.27619377,0.000342597,0.00007863005,0.00026298,0.0006470804,0.00007101893,0.0005720276],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9720167,0.021208564,0.0011274562,0.002433889,0.002688613,0.0005247675],"domain_scores_gemma":[0.85347277,0.10833555,0.008694361,0.026577875,0.0024648649,0.00045459997],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04267474,0.000646438,0.0013947091,0.0013115897,0.0009758515,0.002829742,0.0022708531,0.001725694,0.0009988273],"category_scores_gemma":[0.11094617,0.0007514242,0.0016451824,0.0025331962,0.0026369118,0.003934979,0.002540143,0.0026481282,0.0002625996],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009202228,0.00016297655,0.037868362,0.0003285237,0.00075268303,0.00063819165,0.00095213,0.6666054,0.0027075007,0.095445246,0.0022394056,0.19137923],"study_design_scores_gemma":[0.00012434236,0.0002113582,0.0060612494,0.000077144694,0.00013257387,0.00041300472,0.0002897931,0.77431506,0.004772721,0.20977817,0.0037604354,0.00006405121],"about_ca_topic_score_codex":0.0030921632,"about_ca_topic_score_gemma":0.0024643675,"teacher_disagreement_score":0.9573253,"about_ca_system_score_codex":0.0010791483,"about_ca_system_score_gemma":0.0019437326,"threshold_uncertainty_score":0.22568828},"labels":[],"label_agreement":null},{"id":"W4210644525","doi":"10.1177/00491241211036165","title":"Moving Beyond Linear Regression: Implementing and Interpreting Quantile Regression Models With Fixed Effects","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":104,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Quantile regression; Econometrics; Regression; Quantile; Linear regression; Fixed effects model; Regression analysis; Replication (statistics); Range (aeronautics); Wage; Statistics; Computer science; Mathematics; Economics; Panel data","score_opus":0.3809058897593379,"score_gpt":0.5984629512409576,"score_spread":0.21755706148161968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210644525","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005021138,0.0023643505,0.98309267,0.0046450514,0.00033472065,0.00012780106,0.00041109216,0.0004498398,0.0035533032],"genre_scores_gemma":[0.19570428,0.0043669264,0.7897656,0.0039358847,0.0006859746,0.0008488811,0.00065914384,0.00079140643,0.00324197],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93015856,0.061323885,0.001592121,0.003099928,0.0030524137,0.00077318255],"domain_scores_gemma":[0.82615113,0.14914323,0.008184696,0.011408393,0.004680841,0.00043169557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07441774,0.0014469664,0.0021463525,0.0026683055,0.0010308468,0.0059016366,0.004273809,0.0027461865,0.0052955565],"category_scores_gemma":[0.23801883,0.0010147033,0.0033284002,0.005182726,0.0038360425,0.0066626514,0.0041895024,0.0067092627,0.0012048193],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000094561365,0.00008205471,0.015603997,0.0010003347,0.0007319199,0.00042800783,0.004228794,0.036603533,0.00044788452,0.78074366,0.008254695,0.15178046],"study_design_scores_gemma":[0.00005446736,0.00011088413,0.004379037,0.0010458073,0.00021872198,0.0001301103,0.0011354578,0.08725816,0.00096981274,0.8690458,0.03554846,0.00010327783],"about_ca_topic_score_codex":0.015936425,"about_ca_topic_score_gemma":0.008407128,"teacher_disagreement_score":0.07441774,"about_ca_system_score_codex":0.001977217,"about_ca_system_score_gemma":0.0033278246,"threshold_uncertainty_score":0.39356333},"labels":[],"label_agreement":null},{"id":"W4210865241","doi":"10.1177/00491241221077238","title":"Comparing Single- and Multiple-Question Designs of Measuring Family Income in China Family Panel Studies","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Econometrics; Percentile; Economics; Contrast (vision); Quarter (Canadian coin); Demographic economics; Statistics; Mathematics; Geography; Computer science","score_opus":0.9006386086819724,"score_gpt":0.6303685016720665,"score_spread":0.27027010700990595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210865241","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80515677,0.0033105763,0.17980519,0.0014279244,0.00044229167,0.003071747,0.0023087095,0.00015366632,0.004323143],"genre_scores_gemma":[0.9478622,0.00054845726,0.04320765,0.00040995443,0.00011382884,0.005896637,0.0012797964,0.000029747283,0.0006517869],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7831442,0.19530681,0.0051614703,0.0074469163,0.0074728946,0.0014677224],"domain_scores_gemma":[0.7704344,0.16083865,0.02451498,0.02889454,0.014070876,0.0012465732],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15980399,0.0008911751,0.0011448807,0.002455997,0.0020178554,0.0020116244,0.0026229946,0.0012780258,0.002670348],"category_scores_gemma":[0.22509587,0.00078287494,0.0025779414,0.004258516,0.0016751862,0.0023297432,0.0026713782,0.001442835,0.00026856785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016798268,0.0004929083,0.83525425,0.0014138857,0.008655394,0.00023923733,0.009188066,0.011588871,0.0008533765,0.019282166,0.0034422835,0.107909806],"study_design_scores_gemma":[0.0010250042,0.0020543658,0.8716522,0.0009494184,0.0038954706,0.00018653553,0.0055265385,0.073958196,0.0035942602,0.025030121,0.011841394,0.0002865884],"about_ca_topic_score_codex":0.01759659,"about_ca_topic_score_gemma":0.015093084,"teacher_disagreement_score":0.840196,"about_ca_system_score_codex":0.0029441828,"about_ca_system_score_gemma":0.0027274094,"threshold_uncertainty_score":0.8451344},"labels":[],"label_agreement":null},{"id":"W4210865417","doi":"10.1038/s41366-021-00981-5","title":"Selection bias: “The unseen enemy is always the most fearsome”","year":2022,"lang":"en","type":"letter","venue":"International Journal of Obesity","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Department of Epidemiology, Biostatistics and Occupational Health, McGill University; University at Buffalo; McGill University; Department of Physiology and Biophysics, University at Buffalo; University of Minnesota","keywords":"Selection (genetic algorithm); Medicine; Psychology; Computer science; Artificial intelligence","score_opus":0.1434234288843806,"score_gpt":0.3891131524901326,"score_spread":0.24568972360575203,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210865417","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00027608097,0.00029731324,0.00026524081,0.9944701,0.003922782,0.0000029627274,0.000021851334,0.000005550803,0.0007381056],"genre_scores_gemma":[0.007913682,0.00047814287,0.0005049114,0.96216106,0.026035,0.000030485966,0.00001591292,0.000021069416,0.0028397406],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99298954,0.003352367,0.000603176,0.0011516181,0.0013248055,0.0005783591],"domain_scores_gemma":[0.9403986,0.04830764,0.0023069116,0.001479798,0.0045209387,0.0029861853],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.014555626,0.00081183,0.0022155081,0.0009285074,0.0050094333,0.004824522,0.0019466255,0.041029878,0.0068870187],"category_scores_gemma":[0.11439663,0.0006804804,0.0011147206,0.0009345867,0.010354882,0.005436933,0.0018454889,0.075170904,0.0041614636],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001254492,0.00004543022,0.0019409042,0.00006369399,0.00006961488,0.0009800909,0.00092147285,0.0000829125,0.00012827969,0.04123456,0.9371291,0.017278628],"study_design_scores_gemma":[0.0005265672,0.000089943045,0.004192223,0.0009279634,0.00018492606,0.003748469,0.0026777594,0.0025413432,0.00049828953,0.3668168,0.61760926,0.00018654646],"about_ca_topic_score_codex":0.0089624105,"about_ca_topic_score_gemma":0.010943576,"teacher_disagreement_score":0.98544437,"about_ca_system_score_codex":0.00406858,"about_ca_system_score_gemma":0.0058656246,"threshold_uncertainty_score":0.076978385},"labels":[],"label_agreement":null},{"id":"W4210899445","doi":"10.1007/s12561-022-09337-7","title":"Building an External Control Arm for Development of a New Molecular Entity: An Application in a Recurrent Glioblastoma Trial for MDNA55","year":2022,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Pharma Medica Research (Canada)","funders":"","keywords":"Randomized controlled trial; Observational study; Medicine; Clinical trial; Selection bias; Protocol (science); Propensity score matching; Drug development; Biostatistics; Medical physics; Physical therapy; Surgery; Alternative medicine; Internal medicine; Drug; Epidemiology; Pathology; Psychiatry","score_opus":0.1136866173941476,"score_gpt":0.4534375624280227,"score_spread":0.3397509450338751,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210899445","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1850715,0.0012282557,0.7896339,0.005064227,0.0007116531,0.0018362101,0.0013044007,0.004203648,0.010946155],"genre_scores_gemma":[0.873204,0.00021894865,0.11721531,0.0013534722,0.00019460458,0.0016883541,0.0005816301,0.00016017878,0.005383392],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99627715,0.0023967563,0.00009600373,0.0006477357,0.00034365163,0.00023865822],"domain_scores_gemma":[0.9938719,0.0048111863,0.00038824024,0.00042391868,0.00021349824,0.00029120673],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011403675,0.00095990463,0.0015006935,0.00062671927,0.0003971071,0.0016549707,0.001024424,0.0017992262,0.007207683],"category_scores_gemma":[0.01266217,0.0004659176,0.0012339137,0.0003530362,0.0009268757,0.0009863032,0.001176511,0.0022700583,0.0008453988],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.08061194,0.004063404,0.010011859,0.0008895352,0.0023284063,0.0004522724,0.000233086,0.26016524,0.013639378,0.05162961,0.015801644,0.5601737],"study_design_scores_gemma":[0.012894037,0.0069703045,0.0022019595,0.000076515935,0.0012457717,0.000116146744,0.00004213189,0.91770816,0.007893506,0.042060327,0.00872003,0.000071033974],"about_ca_topic_score_codex":0.0010823822,"about_ca_topic_score_gemma":0.0010849419,"teacher_disagreement_score":0.9885963,"about_ca_system_score_codex":0.00059961644,"about_ca_system_score_gemma":0.002322453,"threshold_uncertainty_score":0.06030917},"labels":[],"label_agreement":null},{"id":"W4213070302","doi":"10.1186/s12874-022-01518-8","title":"Analysis approaches to address treatment nonadherence in pragmatic trials with point-treatment settings: a simulation study","year":2022,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; St. Paul's Hospital; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Michael Smith Health Research BC","keywords":"Confounding; Statistics; Instrumental variable; Confidence interval; Nonparametric statistics; Mean squared error; Medicine; Marginal structural model; Type I and type II errors; Point estimation; Selection bias; Causal inference; Econometrics; Mathematics","score_opus":0.9212178228589814,"score_gpt":0.6612591426169402,"score_spread":0.25995868024204116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4213070302","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.34100202,0.013310981,0.6161165,0.0051764087,0.00044192976,0.008579624,0.002300876,0.00049919495,0.012572482],"genre_scores_gemma":[0.8314221,0.0024627019,0.15487298,0.0010553075,0.000114255665,0.008136734,0.0007110525,0.000066773384,0.0011580811],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9578887,0.03876205,0.0009672846,0.0008230839,0.00093580695,0.0006230672],"domain_scores_gemma":[0.70612997,0.2752034,0.008180126,0.0043900143,0.0048442674,0.0012522779],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.053206068,0.001786937,0.003324462,0.0015685591,0.0007132486,0.0015098994,0.0025817808,0.0030685996,0.006499332],"category_scores_gemma":[0.13349918,0.000999776,0.0049649724,0.001845496,0.0012276687,0.0018774424,0.002160917,0.0039031673,0.0003737787],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0033636575,0.0010840255,0.00893608,0.0029023488,0.0028808475,0.000438191,0.00039402719,0.9257491,0.00033302515,0.029743442,0.002203864,0.02197142],"study_design_scores_gemma":[0.0028201302,0.0016480223,0.0013736073,0.00065826846,0.0011638631,0.00016940932,0.00014631095,0.96510524,0.00034408024,0.024552604,0.0019439682,0.00007449607],"about_ca_topic_score_codex":0.008042852,"about_ca_topic_score_gemma":0.0044915327,"teacher_disagreement_score":0.9467939,"about_ca_system_score_codex":0.0031387184,"about_ca_system_score_gemma":0.004135305,"threshold_uncertainty_score":0.281384},"labels":[],"label_agreement":null},{"id":"W4214806201","doi":"10.1097/ede.0000000000001470","title":"Estimands and Estimation of COVID-19 Vaccine Effectiveness Under the Test-Negative Design","year":2022,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; McGill University","funders":"","keywords":"Estimator; Inverse probability weighting; Weighting; Counterfactual thinking; Logistic regression; Causal inference; Estimation","score_opus":0.2754382722377738,"score_gpt":0.4829411994696834,"score_spread":0.2075029272319096,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4214806201","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014450616,0.00022887581,0.98167163,0.00055363635,0.00006333036,0.0006045766,0.0002184938,0.00013231569,0.0020764612],"genre_scores_gemma":[0.36814502,0.00056357204,0.6228984,0.00065586914,0.0001417816,0.0041698585,0.0005264712,0.00007034251,0.002828631],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.879897,0.1077305,0.0019731089,0.004635623,0.0047263918,0.0010373786],"domain_scores_gemma":[0.6587884,0.30559313,0.012971124,0.017895676,0.0040356116,0.000716148],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.113199644,0.0013865326,0.002097064,0.0022318338,0.0009453083,0.0016896575,0.0029252071,0.0031640278,0.006903923],"category_scores_gemma":[0.27350792,0.0010737302,0.0024935103,0.0017819825,0.0051143817,0.0031977529,0.0028179956,0.0029129288,0.0006466047],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010156389,0.0003080116,0.013885634,0.0007520647,0.00060062815,0.00041401424,0.0004966991,0.056919437,0.0011451016,0.7832989,0.0023049572,0.13885882],"study_design_scores_gemma":[0.00073145796,0.000990724,0.0037604414,0.00024601145,0.0004079758,0.00044171725,0.000109421875,0.27132788,0.0027579411,0.7121482,0.007003311,0.00007494495],"about_ca_topic_score_codex":0.0015969374,"about_ca_topic_score_gemma":0.0009792257,"teacher_disagreement_score":0.88680035,"about_ca_system_score_codex":0.0016685694,"about_ca_system_score_gemma":0.002593343,"threshold_uncertainty_score":0.5986641},"labels":[],"label_agreement":null},{"id":"W4220656412","doi":"10.1007/s10654-022-00848-7","title":"The Authors Reply","year":2022,"lang":"en","type":"letter","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Medicine; Epidemiology; Public health; Environmental health; Family medicine; Pathology","score_opus":0.3301344712296689,"score_gpt":0.44458047575615944,"score_spread":0.11444600452649056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220656412","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016344956,0.0005267043,0.000072100716,0.97390723,0.024448784,0.000013968673,0.00004605758,0.000018521727,0.0008031263],"genre_scores_gemma":[0.00082653825,0.00015526885,0.000059655053,0.9845687,0.012013028,0.00002729981,0.000009688231,0.000010185202,0.0023295314],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9917368,0.0018424421,0.0009606436,0.0017340068,0.0020634714,0.0016625546],"domain_scores_gemma":[0.9730249,0.0149204675,0.0020183625,0.0010843474,0.0049250997,0.0040267785],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00887612,0.0012543944,0.0035261551,0.0016068316,0.007870062,0.009049648,0.0041785794,0.14970182,0.010535497],"category_scores_gemma":[0.07227442,0.0020762852,0.0027974595,0.0013507626,0.006674888,0.0058823964,0.004646305,0.12007622,0.010783774],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000507387,0.000017366227,0.00051473174,0.000049202026,0.00004258227,0.000928584,0.00027805896,0.00005088087,0.00009122894,0.002740035,0.993016,0.002220635],"study_design_scores_gemma":[0.00020078984,0.00006014189,0.0017171542,0.0005265379,0.000119793425,0.0011883777,0.0012292698,0.00046123168,0.0002753256,0.013832248,0.98019034,0.00019877749],"about_ca_topic_score_codex":0.015418745,"about_ca_topic_score_gemma":0.016991107,"teacher_disagreement_score":0.14970182,"about_ca_system_score_codex":0.007157914,"about_ca_system_score_gemma":0.009487864,"threshold_uncertainty_score":0.05193448},"labels":[],"label_agreement":null},{"id":"W4220703773","doi":"10.1093/ije/dyac056","title":"The quintessence of causal DAGs for immortal time bias: time-dependent models","year":2022,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Quintessence; Causal inference; Causal model; Causality (physics); Medicine; Psychology; Econometrics; Statistics; Mathematics; Physics; Cosmology","score_opus":0.2806987380650897,"score_gpt":0.4695180181210156,"score_spread":0.1888192800559259,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220703773","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013990983,0.06105217,0.4631521,0.36120242,0.099600755,0.00019913261,0.0026431116,0.0007478496,0.01000333],"genre_scores_gemma":[0.14770587,0.06956706,0.24341887,0.2997995,0.21608765,0.002494666,0.0017283581,0.0019011912,0.01729684],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9599427,0.028631423,0.0022523159,0.0038153993,0.0049430127,0.00041518404],"domain_scores_gemma":[0.5679693,0.40682918,0.006465316,0.010064393,0.0078887325,0.0007831657],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.053838458,0.0018369236,0.0023292955,0.0028813577,0.0019725084,0.005209845,0.0046130307,0.009333254,0.01377637],"category_scores_gemma":[0.25887454,0.0011581569,0.004604713,0.0035729324,0.008183106,0.00868063,0.0024900022,0.017405502,0.0025941692],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020482465,0.000027684497,0.00076385494,0.0025369823,0.00079862773,0.00025118463,0.00051526166,0.004936792,0.00006542439,0.66074634,0.2684528,0.060700238],"study_design_scores_gemma":[0.000106473424,0.0000202345,0.00017522769,0.00090003747,0.00023489956,0.00013751524,0.00003172569,0.006192549,0.00010873849,0.8914219,0.10061697,0.000053808464],"about_ca_topic_score_codex":0.004978314,"about_ca_topic_score_gemma":0.0033581147,"teacher_disagreement_score":0.94616157,"about_ca_system_score_codex":0.004585059,"about_ca_system_score_gemma":0.0034924787,"threshold_uncertainty_score":0.2847284},"labels":[],"label_agreement":null},{"id":"W4220729324","doi":"10.1093/ectj/utac008","title":"Estimation and inference on treatment effects under treatment-based sampling designs","year":2022,"lang":"en","type":"article","venue":"Econometrics Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Japan Society for the Promotion of Science; Social Sciences and Humanities Research Council of Canada","keywords":"Estimator; Population; Inference; Sampling (signal processing); Benchmark (surveying); Sampling design; Computer science; Sample size determination; Statistics; Econometrics; Causal inference; Statistical inference; Sample (material); Mathematics; Artificial intelligence","score_opus":0.5126904252324965,"score_gpt":0.45664355852416116,"score_spread":0.05604686670833536,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4220729324","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014106682,0.00017931128,0.98380417,0.0002821729,0.000027570199,0.00033217669,0.00010162062,0.00008621675,0.0010801425],"genre_scores_gemma":[0.48306686,0.00054145546,0.51216316,0.0003374939,0.00009555972,0.002286313,0.00037218767,0.000043825596,0.0010932102],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8598069,0.12529577,0.0028462408,0.004524451,0.0065203193,0.0010062864],"domain_scores_gemma":[0.77541703,0.1977358,0.0089126015,0.013903746,0.003509714,0.00052111055],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10832088,0.0009392702,0.002455865,0.0026865466,0.0007415801,0.0022453396,0.0025248022,0.0030162712,0.0033751559],"category_scores_gemma":[0.3213261,0.0009013055,0.0021681273,0.0022699644,0.0036097858,0.0024995867,0.0024174063,0.0028793693,0.0003248757],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064955244,0.00030005697,0.013216583,0.0007294942,0.0009408141,0.00020118992,0.0008301891,0.21077165,0.0009071113,0.6332257,0.0012665502,0.13696116],"study_design_scores_gemma":[0.00034916194,0.0005115481,0.004951176,0.0003359943,0.00031192743,0.000102661455,0.00014183095,0.4929304,0.00198253,0.4957378,0.0025901985,0.000054901422],"about_ca_topic_score_codex":0.002144814,"about_ca_topic_score_gemma":0.0011878631,"teacher_disagreement_score":0.8916791,"about_ca_system_score_codex":0.001928742,"about_ca_system_score_gemma":0.0025278088,"threshold_uncertainty_score":0.5728624},"labels":[],"label_agreement":null},{"id":"W4221004841","doi":"10.1002/sim.9364","title":"Assessing complier average causal effects from longitudinal trials with multiple endpoints and treatment noncompliance: An application to a study of Arthritis Health Journal","year":2022,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Research Canada; Simon Fraser University","funders":"National Cancer Institute; Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Econometrics; Medicine; Clinical trial; Arthritis; Internal medicine; Economics","score_opus":0.19042324253128365,"score_gpt":0.49042503604727183,"score_spread":0.3000017935159882,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221004841","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01780595,0.0026441864,0.97403324,0.0024609193,0.00017037717,0.0012114317,0.00040748043,0.00027095852,0.0009955368],"genre_scores_gemma":[0.34415865,0.0022637444,0.6441267,0.0016655963,0.0004469577,0.0050215945,0.0006243753,0.00013418632,0.0015581511],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7610776,0.2166703,0.005924141,0.008436138,0.0070414613,0.0008504051],"domain_scores_gemma":[0.2528913,0.7010043,0.021125507,0.019258754,0.004668809,0.0010513414],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2528539,0.0024089026,0.0051779267,0.0047755647,0.0013972197,0.003457586,0.0035827975,0.0044706143,0.006818573],"category_scores_gemma":[0.5138026,0.0014205755,0.009411936,0.0059006796,0.004618411,0.0048040953,0.0045850193,0.0071284785,0.00043212372],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032619222,0.0007034911,0.07984366,0.0045060394,0.017157413,0.002117036,0.002834792,0.20212203,0.0014539876,0.37234777,0.0056386385,0.30801314],"study_design_scores_gemma":[0.0011306929,0.0015493693,0.013196445,0.0007307184,0.0028973494,0.00067097135,0.00021154294,0.550816,0.000831735,0.42107803,0.0067150164,0.00017210987],"about_ca_topic_score_codex":0.0048325183,"about_ca_topic_score_gemma":0.0036787852,"teacher_disagreement_score":0.7471461,"about_ca_system_score_codex":0.0024618078,"about_ca_system_score_gemma":0.0056141666,"threshold_uncertainty_score":0.9213642},"labels":[],"label_agreement":null},{"id":"W4221019445","doi":"10.1038/s41431-022-01085-y","title":"Correction: Polygenic risk modeling for prediction of epithelial ovarian cancer risk","year":2022,"lang":"en","type":"erratum","venue":"European Journal of Human Genetics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université Laval; Royal Alexandra Hospital; Public Health Ontario; University of British Columbia; Alberta Health Services; Centre hospitalier universitaire de Québec; Mount Sinai Hospital; Lunenfeld-Tanenbaum Research Institute; Vancouver General Hospital; Princess Margaret Cancer Centre; University of Toronto; University Health Network","funders":"National Institute of General Medical Sciences; National Cancer Institute; Medical Research Council","keywords":"Ovarian cancer; Polygenic risk score; Computational biology; Biology; Bioinformatics; Medicine; Oncology; Genetics; Cancer; Gene; Single-nucleotide polymorphism; Genotype","score_opus":0.10388592556604903,"score_gpt":0.35782934395434685,"score_spread":0.2539434183882978,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221019445","genre_codex":"editorial","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011656198,0.0029721248,0.011816863,0.053322136,0.8880001,0.00015818884,0.035206087,0.0026009732,0.004757983],"genre_scores_gemma":[0.13596378,0.013800231,0.060610432,0.081123084,0.3104943,0.0026892223,0.059619818,0.012187178,0.32351187],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9939779,0.0022963355,0.0009801193,0.0010408253,0.0012324111,0.00047237132],"domain_scores_gemma":[0.94153816,0.028079612,0.0024168086,0.0053392523,0.02083936,0.0017867977],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010199499,0.0028194177,0.0028386996,0.004381931,0.002351816,0.004412411,0.005522009,0.0047661755,0.23789644],"category_scores_gemma":[0.1904155,0.0013558484,0.0033345907,0.005720407,0.0012188676,0.0035731615,0.0028343876,0.0062066754,0.0556527],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010054174,0.000006708759,0.0006873996,0.0004893928,0.000111193454,0.00018209041,0.000059413276,0.0002710873,0.000039943305,0.0011833581,0.98597115,0.010897869],"study_design_scores_gemma":[0.0007346245,0.000081787555,0.007592495,0.0029210993,0.0005664143,0.0019636636,0.00037410916,0.006374775,0.00059243664,0.014078323,0.96456116,0.00015905347],"about_ca_topic_score_codex":0.021261627,"about_ca_topic_score_gemma":0.019416679,"teacher_disagreement_score":0.23789644,"about_ca_system_score_codex":0.0022074527,"about_ca_system_score_gemma":0.007299101,"threshold_uncertainty_score":0.7958429},"labels":[],"label_agreement":null},{"id":"W4221060964","doi":"10.1093/ije/dyac067","title":"Time-fixed vs time-varying causal diagrams for immortal time bias","year":2022,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Causality (physics); Medicine; Statistics; Mathematics; Physics","score_opus":0.2364248504064162,"score_gpt":0.4574345538527232,"score_spread":0.221009703446307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4221060964","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002070591,0.05654979,0.67305493,0.1285874,0.12234717,0.00087189977,0.0018280782,0.00092792226,0.013762246],"genre_scores_gemma":[0.1468454,0.045919016,0.4923128,0.11555365,0.17568035,0.0064270548,0.0012758111,0.001711255,0.014274732],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8879918,0.08633844,0.008012672,0.004508807,0.012290255,0.0008580382],"domain_scores_gemma":[0.35787264,0.6031474,0.013954855,0.008072403,0.016023163,0.00092957285],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.097029306,0.0018743878,0.0018702745,0.0045060306,0.0018187023,0.005452876,0.0036930528,0.007908444,0.014954859],"category_scores_gemma":[0.42821917,0.0009144133,0.0053082937,0.0035261484,0.0062153195,0.0075071766,0.0019631344,0.01150982,0.0018993717],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000711786,0.000041036026,0.00103658,0.0057516354,0.00080133975,0.00035420278,0.0009461276,0.0040550902,0.00019645665,0.7111411,0.18285467,0.09211001],"study_design_scores_gemma":[0.00035468058,0.00013297859,0.00047707264,0.002552523,0.0008303335,0.00048090168,0.00013394821,0.008999867,0.00044365658,0.73042226,0.25504848,0.00012329171],"about_ca_topic_score_codex":0.0014301607,"about_ca_topic_score_gemma":0.0010509794,"teacher_disagreement_score":0.9029707,"about_ca_system_score_codex":0.004802908,"about_ca_system_score_gemma":0.003746045,"threshold_uncertainty_score":0.51314616},"labels":[],"label_agreement":null},{"id":"W4223522335","doi":"10.1177/13524585221085733","title":"Recommendations for the use of propensity score methods in multiple sclerosis research","year":2022,"lang":"en","type":"article","venue":"Multiple Sclerosis Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia; McGill University; Jewish General Hospital","funders":"","keywords":"Propensity score matching; Covariate; Matching (statistics); Context (archaeology); Weighting; Medicine; Comparative effectiveness research; Computer science; Machine learning; Alternative medicine; Surgery; Pathology","score_opus":0.9297887613391248,"score_gpt":0.5353901558312687,"score_spread":0.3943986055078561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4223522335","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014091068,0.070061296,0.26631206,0.5667848,0.038734186,0.0144780455,0.0094865635,0.0045084967,0.028225502],"genre_scores_gemma":[0.0064998586,0.050072815,0.7776668,0.123044744,0.007703208,0.0203174,0.0037330796,0.001063988,0.009898135],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7289345,0.19503061,0.04112048,0.004279704,0.028235832,0.0023988355],"domain_scores_gemma":[0.26089397,0.49876672,0.03643902,0.028674815,0.1665127,0.008712821],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23675625,0.0040524863,0.0050734957,0.011593548,0.002296502,0.007337914,0.011403284,0.024345871,0.0332117],"category_scores_gemma":[0.66290313,0.003530853,0.015722906,0.010481957,0.0061100964,0.012848098,0.006514989,0.025848066,0.022005994],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044479698,0.00031665122,0.0013871415,0.019075342,0.0008121732,0.00030733415,0.0010956802,0.0029690554,0.00030517273,0.017804306,0.67254233,0.28293997],"study_design_scores_gemma":[0.002315733,0.00033665984,0.0034759792,0.1529035,0.0021457223,0.0005753282,0.0009828593,0.0053903935,0.0008840467,0.10679239,0.7235422,0.0006552189],"about_ca_topic_score_codex":0.015958171,"about_ca_topic_score_gemma":0.01731948,"teacher_disagreement_score":0.76324373,"about_ca_system_score_codex":0.0057311677,"about_ca_system_score_gemma":0.03609441,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"design_other","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4225262102","doi":"10.1007/s10985-022-09554-8","title":"Privacy-preserving estimation of an optimal individualized treatment rule: a case study in maximizing time to severe depression-related outcomes","year":2022,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; McGill University Health Centre","funders":"National Institute of Mental Health; Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Robustness (evolution); Flexibility (engineering); Confounding; Computer science; Context (archaeology); Regression; Econometrics; Data mining; Regression analysis; Machine learning; Statistics; Mathematics","score_opus":0.11010661982874727,"score_gpt":0.4265556289728123,"score_spread":0.31644900914406504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4225262102","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5412383,0.0006728483,0.44675237,0.005467191,0.00005114556,0.00037057744,0.0005519661,0.00016073794,0.004734802],"genre_scores_gemma":[0.95687497,0.00017094454,0.04152924,0.000112534166,0.000028530234,0.00008443166,0.0001100809,0.000021797463,0.0010675397],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9935796,0.004867746,0.00017590776,0.00060789695,0.0003843267,0.00038452633],"domain_scores_gemma":[0.9117292,0.08214543,0.0019445767,0.0025984587,0.0008907257,0.0006915729],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01511433,0.0005432946,0.0015757484,0.0005352762,0.0006817095,0.0017148342,0.0016533077,0.002389044,0.0019259343],"category_scores_gemma":[0.06390969,0.0004860948,0.0009810494,0.0008725513,0.0014411288,0.0020937806,0.0012222147,0.0028387483,0.00014397307],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00255978,0.0013383672,0.02755269,0.00028814198,0.0003942673,0.0024830024,0.001050782,0.7272398,0.0016041029,0.13562098,0.0036568432,0.09621114],"study_design_scores_gemma":[0.00023325646,0.0003430658,0.0028377094,0.000025394967,0.0000892849,0.00041418552,0.00022178855,0.91949993,0.0007742743,0.07486767,0.0006593374,0.000034111355],"about_ca_topic_score_codex":0.0068268445,"about_ca_topic_score_gemma":0.004399551,"teacher_disagreement_score":0.01511433,"about_ca_system_score_codex":0.0015594868,"about_ca_system_score_gemma":0.0024214874,"threshold_uncertainty_score":0.07993311},"labels":[],"label_agreement":null},{"id":"W4225377897","doi":"10.1002/pds.5446","title":"Alternative analytic and matching approaches for the prevalent new‐user design: A simulation study","year":2022,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Janssen Pharmaceuticals; Johnson and Johnson; National Institutes of Health","keywords":"Propensity score matching; Matching (statistics); Weighting; Medicine; Statistics; Relative risk; Cohort; Efficiency; Econometrics; Mathematics; Internal medicine; Confidence interval","score_opus":0.3953143985526518,"score_gpt":0.4816124235455468,"score_spread":0.08629802499289496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4225377897","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44718033,0.0012784569,0.5372902,0.0018192392,0.00023554101,0.0067258403,0.0009259212,0.00028710385,0.0042574406],"genre_scores_gemma":[0.8123319,0.0003906551,0.17840846,0.0005935152,0.00007467603,0.007051145,0.0003482241,0.000032677443,0.0007687545],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9136361,0.08051061,0.0012371949,0.0020629817,0.001875928,0.00067731424],"domain_scores_gemma":[0.7344953,0.22534548,0.014916636,0.018110448,0.005682016,0.0014501013],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.116513185,0.0009206135,0.00158273,0.0014026493,0.000875993,0.0019296206,0.0034065326,0.0018496661,0.0034287958],"category_scores_gemma":[0.20797056,0.0008746494,0.0038413925,0.0015294228,0.0013819397,0.0015833292,0.0022168506,0.0022623106,0.00028637916],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019067423,0.0025388792,0.1297391,0.0012442421,0.0066002877,0.0007257208,0.0014346358,0.61180234,0.001034522,0.11628564,0.0032722002,0.10625498],"study_design_scores_gemma":[0.005876398,0.0036017615,0.0068400702,0.0002654211,0.0010713388,0.00027209296,0.00021671267,0.93690354,0.0009109137,0.04091452,0.0030286026,0.000098605706],"about_ca_topic_score_codex":0.0070569753,"about_ca_topic_score_gemma":0.003581349,"teacher_disagreement_score":0.8834868,"about_ca_system_score_codex":0.0027442453,"about_ca_system_score_gemma":0.0034076937,"threshold_uncertainty_score":0.616188},"labels":[],"label_agreement":null},{"id":"W4226189642","doi":"10.31219/osf.io/3gf64","title":"Effect Measure Modification by Covariates in Mediation: Extending Regression-Based Causal Mediation Analysis","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Arthritis and Musculoskeletal and Skin Diseases; Rheumatology Research Foundation; National Institutes of Health; Brigham and Women's Hospital","keywords":"Covariate; Mediation; Measure (data warehouse); Econometrics; Regression analysis; Regression; Mediator; Statistics; Index (typography); Psychology; Computer science; Mathematics; Data mining; Medicine; Political science; Internal medicine; World Wide Web","score_opus":0.09173009617309104,"score_gpt":0.42672781691702005,"score_spread":0.33499772074392903,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226189642","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004420178,0.0010356696,0.99126583,0.00076839677,0.00011066248,0.00023312267,0.00021353709,0.00038410645,0.001568583],"genre_scores_gemma":[0.31650326,0.002286284,0.6713378,0.0017369057,0.0007589089,0.0024570976,0.00046997258,0.0005772946,0.0038725347],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93155885,0.057381928,0.0013927143,0.0055375607,0.0032658868,0.0008631139],"domain_scores_gemma":[0.82101345,0.14626493,0.0060687587,0.021856617,0.004188781,0.0006074389],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09744325,0.0035391336,0.0038369682,0.0031588946,0.0012262155,0.0030898813,0.006625946,0.002599512,0.014426385],"category_scores_gemma":[0.258241,0.0013733519,0.005593563,0.004431297,0.0037703377,0.007999542,0.008029746,0.0057497527,0.0018724514],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032482043,0.0004212478,0.010518107,0.0016191571,0.0032371504,0.0007602615,0.0022852,0.032118656,0.0013405023,0.73273426,0.0042277817,0.21041277],"study_design_scores_gemma":[0.00019695779,0.0003103162,0.0023022573,0.00023734411,0.00090407423,0.0003492236,0.00017477556,0.11632834,0.00086691265,0.8687788,0.009460612,0.00009044221],"about_ca_topic_score_codex":0.003266173,"about_ca_topic_score_gemma":0.0020017696,"teacher_disagreement_score":0.9025568,"about_ca_system_score_codex":0.0013356527,"about_ca_system_score_gemma":0.003549528,"threshold_uncertainty_score":0.5153353},"labels":[],"label_agreement":null},{"id":"W4226278827","doi":"10.1093/ije/dyac090","title":"The primary importance of the research question: implications for understanding natural versus controlled direct effects","year":2022,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Natural (archaeology); Medicine; Psychology; Geography","score_opus":0.43804043204601734,"score_gpt":0.5543919310265762,"score_spread":0.11635149898055891,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226278827","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011684446,0.14197354,0.4096205,0.38920873,0.010570689,0.0028647527,0.0014810462,0.0002201071,0.032376237],"genre_scores_gemma":[0.4478709,0.034117162,0.30940473,0.16618504,0.022391295,0.01543827,0.00080550776,0.00039046092,0.003396668],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6525704,0.27107158,0.015052597,0.03723229,0.022113908,0.0019591986],"domain_scores_gemma":[0.107458085,0.86391217,0.009725357,0.013650303,0.0043463283,0.0009077136],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.37786692,0.0031359773,0.010069327,0.0037624883,0.0038344045,0.009860093,0.010066139,0.017364897,0.017092021],"category_scores_gemma":[0.6399826,0.0017387061,0.0047975024,0.004684861,0.055317678,0.03416479,0.00878749,0.019426886,0.001562403],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058815343,0.00018293942,0.0021550998,0.005744473,0.0007297624,0.00024094222,0.0032733157,0.0007787147,0.00014747659,0.9463461,0.004948398,0.034864545],"study_design_scores_gemma":[0.00020209752,0.0001233035,0.0009911183,0.0020094,0.00017189457,0.00010669044,0.0004780827,0.0016081793,0.00010128595,0.9848556,0.00930947,0.000042801654],"about_ca_topic_score_codex":0.0062265364,"about_ca_topic_score_gemma":0.004062813,"teacher_disagreement_score":0.6221331,"about_ca_system_score_codex":0.0077494145,"about_ca_system_score_gemma":0.011515709,"threshold_uncertainty_score":0.7672008},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4226297244","doi":"10.1162/qss_c_00178","title":"Towards a moralization of bibliometrics? A response to Kyle Siler","year":2022,"lang":"en","type":"article","venue":"Quantitative Science Studies","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Publication; Bibliometrics; Epistemology; Point (geometry); Sociology; Classics; Philosophy; History; Political science; Law; Computer science; Library science; Mathematics","score_opus":0.4986595425254802,"score_gpt":0.570894191989019,"score_spread":0.0722346494635388,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226297244","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001070631,0.00091427146,0.00030556883,0.99434423,0.0041016657,0.0000017779072,0.000010654267,0.000009507167,0.00020530695],"genre_scores_gemma":[0.016599277,0.0023811713,0.0017817649,0.93290716,0.04460772,0.00007026689,0.000026026064,0.00010398133,0.0015226406],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8607455,0.091678426,0.008778015,0.011122165,0.025205394,0.0024705399],"domain_scores_gemma":[0.41763264,0.5000102,0.01609145,0.010935878,0.04608128,0.009248546],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.12460789,0.0010930591,0.003665998,0.004893558,0.009547488,0.021323802,0.0039085997,0.034937795,0.00454343],"category_scores_gemma":[0.43478817,0.0012041584,0.0013877235,0.0060067605,0.04655663,0.023563754,0.00814468,0.0792421,0.0027600164],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000088381144,0.000031258103,0.00041787792,0.00021306917,0.000042457494,0.00012758312,0.0027793408,0.00018498886,0.000093025694,0.105406955,0.8787865,0.011828511],"study_design_scores_gemma":[0.00015958169,0.00005342091,0.0012229213,0.0021323895,0.000033000393,0.00026783664,0.003975192,0.0018381819,0.0005709153,0.35458168,0.63488543,0.0002794785],"about_ca_topic_score_codex":0.00466142,"about_ca_topic_score_gemma":0.0030698208,"teacher_disagreement_score":0.99510646,"about_ca_system_score_codex":0.012440816,"about_ca_system_score_gemma":0.010565812,"threshold_uncertainty_score":0.6589974},"labels":[{"model":"gemma","categories":["bibliometrics"],"domain":null,"study_design":"not_applicable","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["bibliometrics"],"domain":null,"study_design":"not_applicable","genre":"commentary","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W4226487945","doi":"10.1111/biom.13692","title":"Power Analysis for Cluster Randomized Trials with Continuous Coprimary Endpoints","year":2022,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Institute on Aging; Patient-Centered Outcomes Research Institute","keywords":"Sample size determination; Estimator; Intraclass correlation; Statistics; Cluster randomised controlled trial; Statistical power; Cluster (spacecraft); Computer science; Mathematics; Econometrics; Data mining; Randomized controlled trial; Medicine; Psychometrics","score_opus":0.18790196610096394,"score_gpt":0.42572147913694564,"score_spread":0.2378195130359817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226487945","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005315123,0.0011773907,0.9899541,0.00048993726,0.00011818719,0.0015558003,0.00014586003,0.00022361612,0.0010198673],"genre_scores_gemma":[0.30254093,0.0008163098,0.68330157,0.00068590284,0.00020871629,0.011359338,0.0003048774,0.00027126094,0.00051108195],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7543753,0.21532272,0.007681117,0.010338598,0.011182815,0.0010994107],"domain_scores_gemma":[0.4141394,0.5383031,0.016270429,0.022683209,0.0077262186,0.0008776751],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23455039,0.0016613511,0.0051169153,0.004656639,0.00088635867,0.0027823735,0.0041379845,0.0034259455,0.0070136017],"category_scores_gemma":[0.57999974,0.0009887085,0.004401379,0.0046174307,0.0039393064,0.00412113,0.0036237473,0.004755383,0.00063382514],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007876877,0.0004773653,0.011231936,0.011885379,0.008374763,0.0006498406,0.0013636508,0.16714254,0.0026997197,0.42307055,0.00912191,0.3561056],"study_design_scores_gemma":[0.00268686,0.0023957314,0.005019763,0.0021300365,0.001924961,0.00035414466,0.00018749785,0.5008851,0.0028948612,0.4727341,0.008639241,0.00014772067],"about_ca_topic_score_codex":0.000670507,"about_ca_topic_score_gemma":0.00038097272,"teacher_disagreement_score":0.23455039,"about_ca_system_score_codex":0.0021686049,"about_ca_system_score_gemma":0.003456155,"threshold_uncertainty_score":0.94393563},"labels":[],"label_agreement":null},{"id":"W4226517330","doi":"10.1002/ecs2.4009","title":"Utilizing causal diagrams across quasi‐experimental approaches","year":2022,"lang":"en","type":"article","venue":"Ecosphere","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Causal inference; Causal model; Computer science; Observational study; Instrumental variable; Causality (physics); Causal structure; Process (computing); Econometrics; Machine learning; Statistics; Mathematics","score_opus":0.2689129566122469,"score_gpt":0.4140008606688787,"score_spread":0.1450879040566318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4226517330","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018372402,0.00028325044,0.99463934,0.0004894128,0.00011993508,0.00044785516,0.00016996346,0.00019445954,0.001818547],"genre_scores_gemma":[0.11453125,0.00048428975,0.87756133,0.00047629682,0.00017647033,0.005640578,0.0002593847,0.00008499224,0.00078543794],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7334464,0.2433819,0.0050719064,0.0084086945,0.008876127,0.00081497064],"domain_scores_gemma":[0.34539646,0.59123206,0.018264849,0.035232384,0.00865051,0.0012238355],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.20389128,0.0015941855,0.0020592501,0.0051045576,0.0019859455,0.005520687,0.0037103824,0.0030859956,0.016899822],"category_scores_gemma":[0.39505398,0.0014781985,0.0028706028,0.003527883,0.00750159,0.007968261,0.006661648,0.004754369,0.0008930678],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001829499,0.00012426227,0.0013136031,0.0008653005,0.00034842273,0.00007699009,0.00082846096,0.009502153,0.00030132633,0.9363419,0.00095646625,0.049158156],"study_design_scores_gemma":[0.00016410618,0.00013710278,0.0005242276,0.0003175026,0.00015902183,0.000043374428,0.000120916426,0.044654932,0.00060354517,0.9452406,0.008007389,0.00002729889],"about_ca_topic_score_codex":0.0018062433,"about_ca_topic_score_gemma":0.0012327278,"teacher_disagreement_score":0.20389128,"about_ca_system_score_codex":0.003838669,"about_ca_system_score_gemma":0.005066789,"threshold_uncertainty_score":0.9817438},"labels":[],"label_agreement":null},{"id":"W4229035405","doi":"10.1111/biom.13687","title":"Coherent Modeling of Longitudinal Causal Effects on Binary Outcomes","year":2022,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Office of Naval Research; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Multiplicative function; Binary number; Variation (astronomy); Computer science; Mathematics; Econometrics","score_opus":0.2122266913199617,"score_gpt":0.4176687021793165,"score_spread":0.20544201085935482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4229035405","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006733257,0.00053275283,0.99063134,0.0007225887,0.000060850383,0.00008187189,0.00026677878,0.00008294907,0.0008875655],"genre_scores_gemma":[0.44704238,0.0029169668,0.53865665,0.001497768,0.000686882,0.0016921769,0.0013557259,0.00017465293,0.0059767794],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97810674,0.014779663,0.0008757951,0.0037188735,0.0019709882,0.0005480274],"domain_scores_gemma":[0.92019176,0.063857116,0.006626672,0.0068467734,0.0019054624,0.00057228777],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035681505,0.0014906944,0.0023651156,0.0024870667,0.0008500877,0.0025006938,0.0040626912,0.0025485246,0.005013356],"category_scores_gemma":[0.10781631,0.0013039378,0.0031843297,0.0023699775,0.0036543715,0.0040289825,0.004725462,0.004460947,0.00081385265],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011647989,0.00008668625,0.006986135,0.00041020676,0.0006763231,0.00023406872,0.0005903306,0.09099512,0.00089627726,0.8404357,0.0017197728,0.056852955],"study_design_scores_gemma":[0.000046893398,0.00010586191,0.0020150817,0.00017385831,0.00026411406,0.00009247654,0.00006392389,0.24650584,0.000537167,0.74683607,0.003316673,0.00004206264],"about_ca_topic_score_codex":0.0030878931,"about_ca_topic_score_gemma":0.00352176,"teacher_disagreement_score":0.035681505,"about_ca_system_score_codex":0.0016825973,"about_ca_system_score_gemma":0.0026552193,"threshold_uncertainty_score":0.18870407},"labels":[],"label_agreement":null},{"id":"W4229367060","doi":"10.1177/26320843221085649","title":"Considerations for choosing an imputation method for addressing sparse measurement issues dictated by the study design - An illustration from per-protocol analysis in pragmatic trials","year":2022,"lang":"en","type":"article","venue":"Research Methods in Medicine & Health Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Imputation (statistics); Confounding; Statistics; Computer science; Missing data; Protocol (science); Marginal structural model; Inverse probability; Econometrics; Data mining; Mathematics; Medicine; Bayesian probability; Posterior probability","score_opus":0.9263120700886384,"score_gpt":0.7689398625401077,"score_spread":0.15737220754853065,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4229367060","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001467015,0.0016634027,0.9860465,0.0071413703,0.00032085268,0.0014217094,0.00012151615,0.0001746385,0.00164296],"genre_scores_gemma":[0.035257634,0.001158956,0.95258194,0.0021753968,0.00044303664,0.007753747,0.00007949598,0.00015674518,0.00039310305],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4046266,0.56243515,0.012869726,0.00514418,0.013977896,0.0009465123],"domain_scores_gemma":[0.30639744,0.639265,0.013072428,0.027519861,0.012744857,0.0010004239],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4432609,0.001916583,0.0042134966,0.0030471177,0.0015682605,0.0064936043,0.0058606747,0.007897765,0.0060590385],"category_scores_gemma":[0.6392744,0.0018384886,0.004558344,0.0051799193,0.005144068,0.007745166,0.0053329137,0.010863707,0.0012950333],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019641418,0.00028964094,0.005153477,0.007558027,0.0023255895,0.00085120864,0.004903462,0.030121911,0.0013223126,0.5859555,0.016694132,0.34286058],"study_design_scores_gemma":[0.0022518828,0.001318689,0.002359487,0.0061574327,0.0010773845,0.0015217905,0.00063501316,0.17009273,0.0027322385,0.7680049,0.0434952,0.0003531417],"about_ca_topic_score_codex":0.0013800346,"about_ca_topic_score_gemma":0.0014658016,"teacher_disagreement_score":0.5567391,"about_ca_system_score_codex":0.002614016,"about_ca_system_score_gemma":0.008851809,"threshold_uncertainty_score":0.6865585},"labels":[],"label_agreement":null},{"id":"W4231108001","doi":"10.31219/osf.io/hrnwa","title":"Are Replication Studies Infrequent Because of Negative Attitudes? Insights From a Survey of Attitudes and Practices in Second Language Research","year":2021,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Pennsylvania State University; University of Pennsylvania","keywords":"Replication (statistics); Originality; Empirical research; Field (mathematics); Quarter (Canadian coin); Psychology; Computer science; Social psychology; Biology; Mathematics; Statistics","score_opus":0.5843522712943052,"score_gpt":0.5849804009726127,"score_spread":0.0006281296783074986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4231108001","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8552601,0.006362441,0.059672147,0.061136894,0.0003373249,0.0012060505,0.0003045393,0.00023211865,0.015488322],"genre_scores_gemma":[0.9736189,0.0016289923,0.01791088,0.005272193,0.00019585321,0.000682619,0.000089292655,0.00006537203,0.0005358761],"study_design_codex":"qualitative","study_design_gemma":"observational","domain_scores_codex":[0.40071714,0.47622466,0.04572717,0.011622798,0.060666528,0.0050417003],"domain_scores_gemma":[0.073461,0.77702385,0.073522575,0.042172205,0.03139364,0.0024267756],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5161142,0.00043067473,0.0013838836,0.006322681,0.0048935493,0.0100443,0.0030697552,0.004543952,0.0022980825],"category_scores_gemma":[0.76917285,0.0014716337,0.0012820129,0.007372533,0.011340353,0.011740527,0.003918721,0.0042697364,0.00054393243],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007101669,0.00060762715,0.3228832,0.005046631,0.0006434608,0.0026879362,0.35606796,0.00078950374,0.004083986,0.02922332,0.008107498,0.2691487],"study_design_scores_gemma":[0.00042195164,0.0023818442,0.41760716,0.009727368,0.00082930987,0.00986914,0.3600957,0.009833515,0.0064295875,0.083156414,0.09898347,0.0006645585],"about_ca_topic_score_codex":0.0035296436,"about_ca_topic_score_gemma":0.004253979,"teacher_disagreement_score":0.48388582,"about_ca_system_score_codex":0.0052014147,"about_ca_system_score_gemma":0.009496064,"threshold_uncertainty_score":0.5967174},"labels":[],"label_agreement":null},{"id":"W4232895294","doi":"10.1002/9780470057339.vnn143","title":"<scp>J</scp> oint <scp>M</scp> odels","year":2012,"lang":"en","type":"other","venue":"Encyclopedia of Environmetrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Independence (probability theory); Conditional independence; Computer science; Joint (building); Event (particle physics); Econometrics; Process (computing); Statistical model; Artificial intelligence; Statistics; Mathematics; Engineering","score_opus":0.05943035957120976,"score_gpt":0.31891827580323073,"score_spread":0.25948791623202094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4232895294","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027582229,0.0030734125,0.4765337,0.017315147,0.0035620944,0.00027209055,0.010740982,0.005352694,0.48039168],"genre_scores_gemma":[0.14113198,0.008869441,0.22274531,0.0033404855,0.0043518827,0.0007284356,0.015795385,0.0048656645,0.5981715],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9980763,0.00042788876,0.00010507418,0.0004706395,0.00081921456,0.00010089131],"domain_scores_gemma":[0.9929911,0.002789807,0.0005484677,0.0015496053,0.0017768592,0.00034416138],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0024153304,0.0010185844,0.001113968,0.0029852903,0.0013312763,0.0055759684,0.0022961055,0.0019113689,0.31140006],"category_scores_gemma":[0.013398729,0.00048406725,0.0011379751,0.005663068,0.0015800212,0.0036589422,0.0030296994,0.0023461708,0.11321711],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006042662,0.000104729945,0.0010939536,0.0003112794,0.000044038676,0.00032509374,0.000118988035,0.008238574,0.0006446486,0.29191664,0.4332373,0.26390415],"study_design_scores_gemma":[0.000023477878,0.000023223858,0.0010643208,0.0002822937,0.000020624979,0.00042758926,0.00009401941,0.05568753,0.0016832864,0.33791128,0.60272825,0.000054064694],"about_ca_topic_score_codex":0.009658815,"about_ca_topic_score_gemma":0.009598204,"teacher_disagreement_score":0.31140006,"about_ca_system_score_codex":0.0027777771,"about_ca_system_score_gemma":0.0028348216,"threshold_uncertainty_score":0.98220426},"labels":[],"label_agreement":null},{"id":"W4233426781","doi":"10.1002/9781118625392.wbecp401","title":"Correlational Designs","year":2015,"lang":"en","type":"other","venue":"The Encyclopedia of Clinical Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Psychology; Variety (cybernetics); Variables; Variable (mathematics); Causality (physics); Computer science; Statistics; Mathematics; Artificial intelligence","score_opus":0.5570764566826809,"score_gpt":0.5965892899140837,"score_spread":0.039512833231402755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233426781","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008503082,0.0027547935,0.9002394,0.0024345375,0.0022452848,0.030133713,0.00900491,0.0012948575,0.043389384],"genre_scores_gemma":[0.073834255,0.002314496,0.80182797,0.0016487144,0.0007873902,0.10499679,0.0033066599,0.0004384652,0.010845264],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.81715775,0.13934562,0.013439428,0.01045673,0.018085236,0.0015151753],"domain_scores_gemma":[0.6335928,0.2680435,0.020696392,0.044389963,0.031306263,0.0019711393],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10148917,0.0024413734,0.0027952497,0.004754473,0.002166097,0.005276584,0.00334445,0.00229258,0.08213581],"category_scores_gemma":[0.30078557,0.0014907625,0.0027921386,0.006544648,0.0045769415,0.0052274256,0.0044340575,0.004428834,0.012069286],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019059404,0.00066308025,0.005173459,0.0057510743,0.0007716567,0.00035205952,0.0030763664,0.004511281,0.00093957916,0.62184364,0.06518935,0.28982258],"study_design_scores_gemma":[0.0014375135,0.0017627396,0.0030572328,0.0041644755,0.0006518077,0.0005475896,0.0014831728,0.019727703,0.002802131,0.6671883,0.29696807,0.00020932681],"about_ca_topic_score_codex":0.0010030364,"about_ca_topic_score_gemma":0.0012681482,"teacher_disagreement_score":0.10148917,"about_ca_system_score_codex":0.0029636882,"about_ca_system_score_gemma":0.0076575032,"threshold_uncertainty_score":0.53673244},"labels":[],"label_agreement":null},{"id":"W4233910395","doi":"10.1086/503412","title":"Discussion","year":2001,"lang":"en","type":"article","venue":"Infection Control and Hospital Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta Hospital; Canadian Institutes of Health Research; Ottawa Hospital; Canadian Institute for Health Information","funders":"","keywords":"Computer science; World Wide Web; Medicine","score_opus":0.09288309211094997,"score_gpt":0.40935153118369694,"score_spread":0.31646843907274697,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4233910395","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03838814,0.012131397,0.023199888,0.23749183,0.022335812,0.00176483,0.040001977,0.0022904358,0.6223956],"genre_scores_gemma":[0.37282822,0.008311903,0.009039625,0.14176996,0.0077073015,0.002307737,0.023513824,0.0017161375,0.4328054],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9923064,0.0020355198,0.0003576642,0.0017067062,0.0022300705,0.0013635788],"domain_scores_gemma":[0.98363274,0.006899276,0.0011409298,0.0017257454,0.0049407566,0.0016605101],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.009858031,0.0008243254,0.00076423405,0.0012492107,0.0018891529,0.0035584066,0.0019506735,0.0031617605,0.2996916],"category_scores_gemma":[0.04332812,0.00025513046,0.0017256711,0.0010520237,0.0011633021,0.0029903813,0.0024740843,0.0034832787,0.062384713],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002156872,0.00022240578,0.0183552,0.001649856,0.00017941881,0.0011143805,0.0019874773,0.0005764535,0.0015985554,0.04811508,0.7062999,0.21774434],"study_design_scores_gemma":[0.00011980456,0.0001127404,0.015433891,0.00096211047,0.00008903594,0.0009834246,0.0028837852,0.00032725846,0.0016701007,0.016774243,0.9606108,0.00003274834],"about_ca_topic_score_codex":0.00911359,"about_ca_topic_score_gemma":0.007062669,"teacher_disagreement_score":0.70030844,"about_ca_system_score_codex":0.0038707587,"about_ca_system_score_gemma":0.0036532728,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4234921364","doi":"10.1002/sim.2781","title":"The performance of different propensity score methods for estimating marginal odds ratios","year":2006,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":244,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Covariate; Statistics; Odds ratio; Odds; Estimator; Matching (statistics); Medicine; Mathematics; Logistic regression","score_opus":0.16363719544178307,"score_gpt":0.47372662365848633,"score_spread":0.31008942821670327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234921364","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018347679,0.0022331222,0.97727,0.00031145514,0.00008146587,0.00032955123,0.0002892025,0.00029465772,0.0008429358],"genre_scores_gemma":[0.20714252,0.0031940392,0.7859131,0.00023492113,0.00016446278,0.0012984221,0.0009474799,0.0002972546,0.00080776744],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.93211895,0.05553478,0.0032220695,0.0035285666,0.0052170325,0.00037856406],"domain_scores_gemma":[0.7956067,0.17431645,0.00991007,0.013201423,0.0063590617,0.0006063514],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07765374,0.0018424876,0.0019094661,0.005909416,0.00064507074,0.0024748715,0.0023781485,0.0018511235,0.0030297036],"category_scores_gemma":[0.26014405,0.00090888405,0.0033946729,0.0051962603,0.0014983638,0.0031809288,0.0023108942,0.0020831393,0.00073593814],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018392295,0.00036405367,0.058345526,0.0015995405,0.005712131,0.00022578861,0.00084325875,0.3148263,0.0022086555,0.120061964,0.0038391661,0.4901344],"study_design_scores_gemma":[0.0006096481,0.0006888587,0.02177115,0.0005251091,0.00084596477,0.0005154789,0.0001579737,0.83451545,0.004067289,0.12890494,0.007118532,0.00027951066],"about_ca_topic_score_codex":0.0029077344,"about_ca_topic_score_gemma":0.0023901716,"teacher_disagreement_score":0.92234623,"about_ca_system_score_codex":0.0015311678,"about_ca_system_score_gemma":0.0019736285,"threshold_uncertainty_score":0.41067713},"labels":[],"label_agreement":null},{"id":"W4235026130","doi":"10.31234/osf.io/ydgh9","title":"Machine Learning to Analyze Single-Case Graphs: A Replication and Extension with Nonsimulated Data","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Institut universitaire en santé mentale de Montréal; Institut Universitaire en Santé Mentale de Québec","funders":"","keywords":"Replication (statistics); Computer science; Extension (predicate logic); Artificial intelligence; Replicate; Machine learning; False positive paradox; Dual (grammatical number); Type I and type II errors; Mathematics; Statistics; Programming language","score_opus":0.35248075217318375,"score_gpt":0.42572063644359853,"score_spread":0.07323988427041478,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4235026130","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.113729514,0.0019782265,0.8702595,0.003540099,0.001172885,0.0026522118,0.003368356,0.0016818411,0.0016173761],"genre_scores_gemma":[0.444918,0.0009576962,0.53964597,0.0017086429,0.0006667942,0.006175181,0.0041413708,0.0010142736,0.0007720802],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8692573,0.108182326,0.004283245,0.010846954,0.0065756603,0.0008545278],"domain_scores_gemma":[0.31842196,0.38902304,0.015159423,0.25488484,0.020756263,0.0017544057],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18168747,0.0023095894,0.002594453,0.0036634423,0.0014754505,0.0031644504,0.0076050814,0.0020919172,0.0054208986],"category_scores_gemma":[0.5021799,0.0010149963,0.0072057443,0.0043306937,0.0041811937,0.0074328077,0.003038017,0.006775393,0.0012554941],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00724677,0.007040214,0.19466989,0.0067524975,0.014334357,0.0021707918,0.0025605108,0.17463103,0.013588527,0.048559435,0.03864899,0.48979706],"study_design_scores_gemma":[0.002726039,0.0048266887,0.05473777,0.0012004293,0.0043207565,0.0017702457,0.00084003666,0.66449946,0.0150900455,0.22268888,0.026638925,0.00066072296],"about_ca_topic_score_codex":0.0062915864,"about_ca_topic_score_gemma":0.003511068,"teacher_disagreement_score":0.8183125,"about_ca_system_score_codex":0.0018715159,"about_ca_system_score_gemma":0.004378606,"threshold_uncertainty_score":0.9608667},"labels":[],"label_agreement":null},{"id":"W4236509688","doi":"10.1002/9781118445112.stat05748","title":"Explanatory Variables","year":2014,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cancer Care Ontario","funders":"","keywords":"Explanatory model; Econometrics; Variable (mathematics); Variables; Statistics; Outcome (game theory); Mathematics; Mathematical economics","score_opus":0.14152873997644777,"score_gpt":0.4119456737486882,"score_spread":0.2704169337722404,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4236509688","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07324421,0.00530979,0.19148487,0.016808152,0.0026772579,0.0031689228,0.5973019,0.0021764447,0.10782845],"genre_scores_gemma":[0.57205266,0.005792751,0.06818008,0.0042294487,0.0013499326,0.0074577993,0.19697456,0.00057331007,0.14338948],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9974842,0.00096211804,0.0002572789,0.00047778676,0.00058277266,0.00023572096],"domain_scores_gemma":[0.9850854,0.009527063,0.0019234691,0.0013442803,0.0016926544,0.00042703887],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005357116,0.0011293106,0.0009878408,0.0034765352,0.0005601472,0.0024488005,0.0019083685,0.0015662734,0.14348862],"category_scores_gemma":[0.029063456,0.0003874682,0.001141071,0.005585487,0.00080832234,0.00223454,0.0013126971,0.002595881,0.026221287],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009931101,0.00054536504,0.10012141,0.0036162983,0.0006961134,0.0006871415,0.0010065772,0.03404278,0.0007003177,0.3758789,0.3112761,0.170436],"study_design_scores_gemma":[0.0004068101,0.00043270012,0.044198006,0.002905549,0.00073156407,0.00043365086,0.0012103873,0.028017715,0.0019864505,0.2748001,0.6446753,0.00020164448],"about_ca_topic_score_codex":0.0049812016,"about_ca_topic_score_gemma":0.0030820537,"teacher_disagreement_score":0.14348862,"about_ca_system_score_codex":0.001477632,"about_ca_system_score_gemma":0.0027166295,"threshold_uncertainty_score":0.48001724},"labels":[],"label_agreement":null},{"id":"W4238135399","doi":"10.1093/pch/14.8.514","title":"Research Letter","year":2009,"lang":"en","type":"article","venue":"Paediatrics & Child Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Izaak Walton Killam Health Centre","funders":"","keywords":"Computer science; Medicine","score_opus":0.17723211282039164,"score_gpt":0.47835138657275705,"score_spread":0.3011192737523654,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4238135399","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008820528,0.001657683,0.0001352259,0.86336356,0.101990804,0.00004842009,0.00020418013,0.00007615392,0.031641856],"genre_scores_gemma":[0.011701795,0.0019866752,0.00037610228,0.80146605,0.066401325,0.00015338381,0.0001712305,0.00005532301,0.117688105],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.997274,0.00067593734,0.0002837665,0.0004941496,0.00082029705,0.0004519013],"domain_scores_gemma":[0.9862476,0.0064136544,0.00065127225,0.0010270957,0.0035150177,0.0021454338],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0025069236,0.00040182314,0.00092328404,0.00080197206,0.0023164372,0.0033188201,0.0018630525,0.023795867,0.09729026],"category_scores_gemma":[0.040750492,0.00041422885,0.0011189198,0.00045987588,0.0017091444,0.001864053,0.0015909737,0.015566357,0.04525987],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005646995,0.000020706251,0.00020166855,0.000059288406,0.00000862723,0.0007524948,0.000058385922,0.000017367936,0.000094048715,0.0029301017,0.9871132,0.008687789],"study_design_scores_gemma":[0.000064746084,0.000034229273,0.0004929558,0.00017773373,0.000013509611,0.0012001765,0.00020735388,0.000066922556,0.00016993258,0.0042242343,0.99333644,0.00001177909],"about_ca_topic_score_codex":0.0014626579,"about_ca_topic_score_gemma":0.0023116593,"teacher_disagreement_score":0.9027097,"about_ca_system_score_codex":0.0025777405,"about_ca_system_score_gemma":0.0033883401,"threshold_uncertainty_score":0.32546836},"labels":[],"label_agreement":null},{"id":"W4238440528","doi":"10.1016/s0895-4356(03)00382-2","title":"Commonalities in the classical, collapsibility and counterfactual concepts of confounding","year":2004,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Counterfactual thinking; Confounding; Counterfactual conditional; Key (lock); Econometrics; Abstraction; Observational study; Computer science; Medicine; Risk analysis (engineering); Psychology; Mathematics; Epistemology; Social psychology; Computer security","score_opus":0.6440032894371513,"score_gpt":0.6306114681949174,"score_spread":0.013391821242233926,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4238440528","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015049282,0.010205369,0.9575327,0.009032972,0.0003555172,0.0001029872,0.00024345903,0.00010302099,0.007374705],"genre_scores_gemma":[0.60032326,0.012318322,0.37541437,0.0029780485,0.0031152642,0.0010906726,0.00044829547,0.00015472404,0.0041570896],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92807806,0.048860595,0.005182748,0.0066841682,0.0102935685,0.0009008989],"domain_scores_gemma":[0.6527672,0.3043812,0.0105450535,0.024351344,0.0067380355,0.0012172281],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1018133,0.0016451495,0.0032386282,0.005293902,0.0017385605,0.009052958,0.0061955024,0.004019205,0.004809924],"category_scores_gemma":[0.22466706,0.0015824859,0.003097461,0.0061427946,0.02337617,0.022455212,0.009659195,0.0092656845,0.00045088324],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020514433,0.00001162769,0.0003793573,0.00009890098,0.000055363682,0.000038611684,0.00034983316,0.0007073981,0.000036760703,0.99258363,0.0003132124,0.005404816],"study_design_scores_gemma":[0.000012137162,0.00001019747,0.00015236302,0.00004196434,0.000023383573,0.00009496847,0.000039352057,0.0028785036,0.00003537896,0.9959335,0.0007684861,0.000009755321],"about_ca_topic_score_codex":0.0010528272,"about_ca_topic_score_gemma":0.000783842,"teacher_disagreement_score":0.1018133,"about_ca_system_score_codex":0.0024456563,"about_ca_system_score_gemma":0.0028342379,"threshold_uncertainty_score":0.53844666},"labels":[],"label_agreement":null},{"id":"W4239067159","doi":"10.1177/0962280218811186","title":"Authors' reply: Letter to the Editor: Comparison of statistical approaches dealing with time-dependent confounding in drug effectiveness studies (SMMR, Vol 27, Issue 6, 2018)","year":2018,"lang":"en","type":"letter","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Centre for Advancing Health Outcomes; University of British Columbia; Jewish General Hospital; Providence Health Care","funders":"","keywords":"Confounding; Computer science; Econometrics; Statistics; Mathematics","score_opus":0.4172799159375314,"score_gpt":0.6239339484163909,"score_spread":0.20665403247885955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4239067159","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012562884,0.0008610757,0.00008583262,0.9590567,0.039350472,0.000009673783,0.00011801693,0.000019374702,0.000373348],"genre_scores_gemma":[0.0012208215,0.0006940158,0.00023286624,0.9407913,0.055161893,0.00004557889,0.000037649144,0.000021689328,0.0017941381],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9900321,0.0035869305,0.0019575555,0.0011392584,0.0024843204,0.00079988915],"domain_scores_gemma":[0.9421837,0.03894826,0.0043916693,0.0011734337,0.01004338,0.00325954],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011834068,0.0009160994,0.002627516,0.0015557684,0.002918324,0.0041686585,0.0026333015,0.050538354,0.007321174],"category_scores_gemma":[0.10837782,0.0010536053,0.0018467729,0.0015568763,0.0031557456,0.003357906,0.0017503452,0.044803273,0.0071606836],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005990377,0.000015439162,0.00029692877,0.000087347114,0.000022484855,0.00032097084,0.000061766375,0.00003859399,0.000042529733,0.00087366655,0.99501204,0.0031683368],"study_design_scores_gemma":[0.00036297392,0.00010738927,0.0021169072,0.0010579369,0.00013110273,0.0016081783,0.00046338927,0.00069207995,0.00034683174,0.009300501,0.9836633,0.00014938557],"about_ca_topic_score_codex":0.003860522,"about_ca_topic_score_gemma":0.005386713,"teacher_disagreement_score":0.9881659,"about_ca_system_score_codex":0.004369697,"about_ca_system_score_gemma":0.006798002,"threshold_uncertainty_score":0.062585294},"labels":[],"label_agreement":null},{"id":"W4239929951","doi":"10.1002/0470011815.b2a09015","title":"Explanatory Variables","year":2005,"lang":"en","type":"other","venue":"Encyclopedia of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cancer Care Ontario","funders":"","keywords":"Explanatory model; Econometrics; Variable (mathematics); Variables; Statistics; Outcome (game theory); Psychology; Mathematics; Mathematical economics","score_opus":0.04665118484793098,"score_gpt":0.35852777983559364,"score_spread":0.3118765949876627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4239929951","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07632011,0.006172996,0.19332962,0.015993275,0.002659249,0.00319957,0.6013478,0.0023451098,0.098632164],"genre_scores_gemma":[0.5586741,0.006527955,0.067722164,0.00395551,0.0012077697,0.0071777864,0.20604114,0.00055497565,0.14813861],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9979837,0.00077344786,0.00020094078,0.00035930058,0.00048978673,0.00019284649],"domain_scores_gemma":[0.98910856,0.0069456543,0.0013323922,0.00093666464,0.0013304596,0.00034618587],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0046957014,0.001159328,0.0009743306,0.002895313,0.0004454623,0.0022084045,0.0019474289,0.0014384934,0.14512867],"category_scores_gemma":[0.023458779,0.0003695273,0.0011480488,0.004652665,0.00060868304,0.0018558396,0.001108653,0.0023489827,0.026692312],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013216843,0.0006272347,0.09986838,0.0041475184,0.0008161116,0.00081577315,0.0007101728,0.048957024,0.00088186597,0.28934026,0.34292415,0.20958975],"study_design_scores_gemma":[0.0005320312,0.00056328764,0.04694223,0.0028469171,0.0008137608,0.0005197535,0.001019492,0.04099602,0.002361482,0.2303751,0.6728251,0.0002047501],"about_ca_topic_score_codex":0.0041391617,"about_ca_topic_score_gemma":0.002547308,"teacher_disagreement_score":0.14512867,"about_ca_system_score_codex":0.0013208777,"about_ca_system_score_gemma":0.0023966064,"threshold_uncertainty_score":0.48550373},"labels":[],"label_agreement":null},{"id":"W4240041394","doi":"10.31234/osf.io/kdurz","title":"Measurement Practices in Large-Scale Replications: Insights from Many Labs 2","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"McGill University","keywords":"Replication (statistics); Interpretability; Reliability (semiconductor); Construct validity; Scale (ratio); Psychology; Applied psychology; Construct (python library); Sample (material); Data science; Psychometrics; Computer science; Clinical psychology; Statistics; Artificial intelligence; Mathematics; Geography; Cartography","score_opus":0.32815826370906565,"score_gpt":0.44358004137673246,"score_spread":0.11542177766766681,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240041394","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.25222808,0.025494896,0.659483,0.027741274,0.0011749553,0.0075438307,0.0024503404,0.0014945527,0.02238908],"genre_scores_gemma":[0.6664603,0.002078004,0.3197554,0.003277328,0.00036117045,0.0059750704,0.0008115713,0.0005207882,0.0007604143],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.30939686,0.63179713,0.02052958,0.0139676295,0.02252649,0.0017823527],"domain_scores_gemma":[0.059483137,0.77045614,0.028318172,0.09617253,0.044248074,0.0013218928],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.56966466,0.0018832333,0.0027634548,0.0063684895,0.004794655,0.0113339815,0.005801305,0.0033974065,0.0036635553],"category_scores_gemma":[0.8474924,0.0022487435,0.0036614793,0.009697077,0.010125125,0.012964868,0.008193937,0.004906304,0.00090220425],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018448143,0.0010735783,0.2113171,0.015909065,0.008105352,0.002227153,0.21788278,0.0080892695,0.0034007393,0.16325854,0.016990453,0.3499012],"study_design_scores_gemma":[0.0017454847,0.0028417846,0.17022331,0.020375997,0.0064054956,0.002315929,0.061924767,0.047992546,0.00791521,0.5700716,0.10707453,0.0011133465],"about_ca_topic_score_codex":0.0074871155,"about_ca_topic_score_gemma":0.012241505,"teacher_disagreement_score":0.43033534,"about_ca_system_score_codex":0.0055827466,"about_ca_system_score_gemma":0.014138184,"threshold_uncertainty_score":0.5306801},"labels":[],"label_agreement":null},{"id":"W4240909061","doi":"10.3410/f.733103952.793546483","title":"Faculty Opinions recommendation of Targeted maximum likelihood estimation for a binary treatment: A tutorial.","year":2018,"lang":"en","type":"dataset","venue":"Faculty Opinions – Post-Publication Peer Review of the Biomedical Literature","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Binary number; Maximum likelihood; Estimation; Computer science; Statistics; Medical physics; Mathematics; Medicine; Engineering","score_opus":0.09407374734897496,"score_gpt":0.438819592337892,"score_spread":0.344745844988917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4240909061","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000775426,0.001583854,0.019199392,0.0034779801,0.0010412748,0.00038405796,0.95421576,0.009971462,0.009350695],"genre_scores_gemma":[0.0037360461,0.00095942104,0.033943105,0.0016441558,0.0002952164,0.0012416145,0.94759494,0.00146334,0.009122112],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99444324,0.002527176,0.0005177145,0.0010460253,0.0012093972,0.00025648676],"domain_scores_gemma":[0.98314947,0.00849795,0.0007628124,0.0049681403,0.0020288888,0.0005926656],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011739245,0.0023761913,0.0018779506,0.0034324345,0.00079910865,0.0038688232,0.0046403655,0.0031015333,0.12632096],"category_scores_gemma":[0.05901746,0.0013421477,0.0026693793,0.0046620085,0.0005240169,0.0024967468,0.0028136307,0.0035093736,0.12589036],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004832175,0.000031623425,0.00055402506,0.00035826335,0.00006514369,0.000006951139,0.0000056417584,0.00044997397,0.000049166287,0.000762491,0.98551196,0.012156432],"study_design_scores_gemma":[0.0009418828,0.000055474946,0.0023194996,0.00064375176,0.00015106083,0.00010362879,0.00003921612,0.01245909,0.0010895189,0.021080168,0.96104765,0.00006908315],"about_ca_topic_score_codex":0.00724864,"about_ca_topic_score_gemma":0.027203433,"teacher_disagreement_score":0.98826075,"about_ca_system_score_codex":0.0019891348,"about_ca_system_score_gemma":0.0047183805,"threshold_uncertainty_score":0.42258573},"labels":[],"label_agreement":null},{"id":"W4241024539","doi":"10.2458/azu_jmmss.v1i2.100","title":"Patterns of Enrollment in Randomized and Preference Trials of Behavioral Treatments for Insomnia","year":2011,"lang":"en","type":"article","venue":"Journal of Methods and Measurement in the Social Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Toronto Metropolitan University","funders":"National Institute of Nursing Research; National Institutes of Health; U.S. Department of Veterans Affairs","keywords":"Randomized controlled trial; Insomnia; Context (archaeology); Medicine; Physical therapy; Representativeness heuristic; Psychology; Clinical psychology; Psychiatry; Internal medicine; Social psychology","score_opus":0.8256298650630722,"score_gpt":0.6032540980458749,"score_spread":0.2223757670171973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4241024539","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6690387,0.009571817,0.22083299,0.018087452,0.0022031392,0.06718692,0.0019162043,0.00070086936,0.010461858],"genre_scores_gemma":[0.87850416,0.0006829286,0.07667345,0.003436138,0.00037961107,0.03898883,0.0004249424,0.00003921071,0.00087077793],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.3168262,0.6108591,0.03915478,0.011766376,0.019379282,0.0020142917],"domain_scores_gemma":[0.36159778,0.50136185,0.07650324,0.050486565,0.008014142,0.0020364136],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47057107,0.0008540876,0.0027844275,0.002010522,0.0018948067,0.0026091882,0.002304897,0.0043254127,0.003943938],"category_scores_gemma":[0.56312823,0.0012214564,0.003693139,0.0026186348,0.004388739,0.004511861,0.002421743,0.0034413044,0.00057732634],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1245307,0.01294651,0.26562005,0.015461307,0.021420522,0.0006800322,0.009877774,0.008134039,0.004329553,0.052907575,0.0070373495,0.4770546],"study_design_scores_gemma":[0.12027697,0.13985825,0.37004116,0.008271002,0.015275439,0.0022622133,0.004192707,0.081185244,0.013960439,0.20595771,0.03786765,0.0008512366],"about_ca_topic_score_codex":0.00063465966,"about_ca_topic_score_gemma":0.0013028305,"teacher_disagreement_score":0.52942896,"about_ca_system_score_codex":0.0021296395,"about_ca_system_score_gemma":0.006245179,"threshold_uncertainty_score":0.65288013},"labels":[],"label_agreement":null},{"id":"W4242075296","doi":"10.1007/978-1-0716-1138-8_9","title":"Longitudinal Studies 4: Matching Strategies to Evaluate Risk","year":2021,"lang":"en","type":"book-chapter","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Matching (statistics); Psychological intervention; Contrast (vision); Outcome (game theory); Medicine; Econometrics; Statistics; Computer science; Mathematics; Artificial intelligence","score_opus":0.3028601004233612,"score_gpt":0.5709415834095312,"score_spread":0.26808148298616996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4242075296","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016569443,0.0075934296,0.9747379,0.0030297646,0.00057782116,0.0000978941,0.00049941416,0.00037718745,0.0114296395],"genre_scores_gemma":[0.07210027,0.010630673,0.863201,0.003348773,0.0015014723,0.00094716996,0.0009263099,0.0006713639,0.046672888],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9940486,0.0045466516,0.00022102101,0.00047410483,0.000610573,0.000099047895],"domain_scores_gemma":[0.9793627,0.017608063,0.00047361883,0.0017483626,0.0006606481,0.00014652689],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018168781,0.0011839174,0.0012371347,0.002075473,0.00045948284,0.0017736617,0.0023006138,0.0023980732,0.018646423],"category_scores_gemma":[0.05429378,0.001054478,0.0015134519,0.0028333634,0.0015767232,0.0040738485,0.0015067947,0.0026555613,0.0025293771],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009389559,0.00008590597,0.0018529033,0.00035532814,0.00032511557,0.00008389371,0.00020918009,0.009135103,0.0003371293,0.64249986,0.04319076,0.30183104],"study_design_scores_gemma":[0.00003395291,0.000031614385,0.00071629125,0.000091441914,0.00008239632,0.00006552332,0.000035378616,0.018190922,0.00025273123,0.96439636,0.016086373,0.000016963064],"about_ca_topic_score_codex":0.0028081497,"about_ca_topic_score_gemma":0.0029516923,"teacher_disagreement_score":0.018646423,"about_ca_system_score_codex":0.00095700845,"about_ca_system_score_gemma":0.0018153838,"threshold_uncertainty_score":0.0960868},"labels":[],"label_agreement":null},{"id":"W4242730459","doi":"10.1093/pch/16.suppl_a.9aa","title":"PDA Treatment and Mortality/Morbidity: Regression and Propensity Score Based Analyses after Adjustment for Treatment Selection Bias","year":2011,"lang":"en","type":"article","venue":"Paediatrics & Child Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Mount Sinai Hospital","funders":"","keywords":"Propensity score matching; Selection bias; Selection (genetic algorithm); Regression; Statistics; Medicine; Internal medicine; Computer science; Mathematics; Machine learning","score_opus":0.45235353733181244,"score_gpt":0.4477917747817245,"score_spread":0.004561762550087944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4242730459","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9114795,0.007979254,0.0714767,0.003009866,0.0004160646,0.00030814603,0.0032375546,0.00038162945,0.0017113928],"genre_scores_gemma":[0.9805562,0.0011344181,0.014463023,0.00019847124,0.00019242162,0.00019344389,0.0014323562,0.00013779559,0.0016918359],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9795599,0.01568117,0.0009194011,0.0015102181,0.0014399893,0.0008893024],"domain_scores_gemma":[0.95974755,0.028397372,0.005489366,0.0048346794,0.00097007025,0.00056103827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027434293,0.0010684986,0.0017587746,0.0021022973,0.00055534096,0.0017502835,0.002651397,0.0020376174,0.0046773893],"category_scores_gemma":[0.0649874,0.00088789675,0.007091279,0.00452372,0.0007462416,0.0022174339,0.0019008613,0.003653976,0.0006114321],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.015026567,0.00045915777,0.8543513,0.000566302,0.033170916,0.0004965648,0.00042831374,0.008509704,0.0009648277,0.005341587,0.005453601,0.07523126],"study_design_scores_gemma":[0.0014757889,0.0022726525,0.8112913,0.00021705253,0.02075306,0.0012373339,0.0007553614,0.14319545,0.0015775027,0.012008604,0.0049813553,0.00023469799],"about_ca_topic_score_codex":0.0068996875,"about_ca_topic_score_gemma":0.0056770314,"teacher_disagreement_score":0.027434293,"about_ca_system_score_codex":0.00053307414,"about_ca_system_score_gemma":0.0013148542,"threshold_uncertainty_score":0.14508814},"labels":[],"label_agreement":null},{"id":"W4243433825","doi":"10.1515/iupac.79.2239","title":"Rate in Epidemiology","year":2016,"lang":"en","type":"dataset","venue":"IUPAC Standards Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Terminology; Glossary; Chemical nomenclature; Relation (database); Meaning (existential); Computer science; Biostatistics; Management science; Epistemology; Chemistry; Medicine; Epidemiology; Linguistics; Engineering; Pathology; Philosophy; Data mining","score_opus":0.1529037961759136,"score_gpt":0.5649988680680189,"score_spread":0.4120950718921053,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4243433825","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005354094,0.0012991559,0.00064646266,0.00058198144,0.00014807726,0.000036581434,0.99410987,0.0003309445,0.0023115957],"genre_scores_gemma":[0.004791371,0.001322935,0.0019746677,0.0005336769,0.00013025936,0.0002650892,0.9885052,0.00016740506,0.0023094034],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9959943,0.0011798989,0.00071271,0.0011261761,0.0006689891,0.00031790094],"domain_scores_gemma":[0.98844147,0.0048804837,0.0019123809,0.002540971,0.0017008313,0.0005239442],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033299318,0.0014365872,0.0017841987,0.0056065875,0.0006852575,0.0035179283,0.0029014947,0.0018613329,0.07042854],"category_scores_gemma":[0.030304909,0.00064821873,0.0025103157,0.009151095,0.00042712686,0.002216897,0.002303243,0.002665864,0.051705077],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018525988,0.000034161592,0.014169084,0.0025119134,0.00023565926,0.000054228047,0.000052576674,0.0011022981,0.000064472,0.0033541177,0.9622182,0.016017977],"study_design_scores_gemma":[0.00030769836,0.000033366516,0.013814376,0.001034986,0.00018620893,0.00036721458,0.00010137559,0.0011982454,0.00017518886,0.006973126,0.9757633,0.000044797758],"about_ca_topic_score_codex":0.016339622,"about_ca_topic_score_gemma":0.024214724,"teacher_disagreement_score":0.07042854,"about_ca_system_score_codex":0.0017382536,"about_ca_system_score_gemma":0.0030538247,"threshold_uncertainty_score":0.23560697},"labels":[],"label_agreement":null},{"id":"W4245375786","doi":"10.1002/dc.10020.abs","title":"Comment on Gopez et al.","year":2002,"lang":"en","type":"article","venue":"Diagnostic Cytopathology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Mount Sinai Hospital","funders":"","keywords":"Medicine","score_opus":0.1492254624954979,"score_gpt":0.40266194453230414,"score_spread":0.25343648203680624,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4245375786","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00014929507,0.00077599846,0.00015121794,0.9702865,0.026993113,0.000015335916,0.00014503581,0.00005383528,0.0014297542],"genre_scores_gemma":[0.0010356158,0.00040624358,0.0001450072,0.9765425,0.019895608,0.000033100507,0.0000324858,0.000021249698,0.0018882039],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9931846,0.0012940423,0.0011500661,0.0011338001,0.0025506965,0.0006866711],"domain_scores_gemma":[0.95725834,0.027490089,0.001479415,0.0015530745,0.010296408,0.0019226733],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0105523355,0.0010607489,0.002166535,0.0017510402,0.0038187834,0.0036495242,0.0071495962,0.07122213,0.011731038],"category_scores_gemma":[0.07475048,0.00093675527,0.0027165597,0.0019174872,0.006280512,0.00550318,0.002355781,0.06098874,0.016031848],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000043192602,0.000010204148,0.00018228135,0.00007072289,0.000017755663,0.0002799266,0.000080045436,0.000035441342,0.000047527996,0.0022268107,0.9947653,0.0022408348],"study_design_scores_gemma":[0.00014895797,0.00003287502,0.0015024149,0.00048680915,0.00009033905,0.0011213927,0.00046231583,0.000334193,0.00061122293,0.018890496,0.9762013,0.00011771663],"about_ca_topic_score_codex":0.01977915,"about_ca_topic_score_gemma":0.019860273,"teacher_disagreement_score":0.07122213,"about_ca_system_score_codex":0.004209991,"about_ca_system_score_gemma":0.004811839,"threshold_uncertainty_score":0.055806756},"labels":[],"label_agreement":null},{"id":"W4246230500","doi":"10.1007/978-1-59745-385-1_2","title":"Longitudinal Studies and Determination of Risk","year":2008,"lang":"en","type":"book-chapter","venue":"Methods in molecular biology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland; St. John’s Health Sciences Centre","funders":"","keywords":"Observational study; Confounding; Casual; Selection bias; Computer science; Clinical study design; Risk analysis (engineering); Psychology; Medicine; Statistics; Clinical trial; Mathematics","score_opus":0.23388482166872585,"score_gpt":0.5290002017369217,"score_spread":0.29511538006819593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246230500","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007382008,0.30592525,0.5074507,0.076981194,0.0061320364,0.00057820353,0.0035857095,0.0005543813,0.09141041],"genre_scores_gemma":[0.10008409,0.34376648,0.509788,0.013949006,0.006694546,0.0021920917,0.001941992,0.00025536964,0.0213285],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9883581,0.0077662007,0.0005512047,0.0011802868,0.0019972434,0.00014705592],"domain_scores_gemma":[0.95836586,0.036212306,0.0018686787,0.0017348423,0.0015151146,0.00030309023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023932677,0.0010142386,0.0016521605,0.0033210989,0.000609336,0.0027178675,0.0019508408,0.0021159016,0.007293599],"category_scores_gemma":[0.055164628,0.0007267008,0.0010049964,0.0031911647,0.004075573,0.0039078863,0.0020994144,0.004817958,0.0018731786],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007164698,0.00004868118,0.0048532733,0.0014020021,0.0003991626,0.00021233989,0.0010289799,0.0031626713,0.00020015516,0.7224881,0.044085056,0.22204798],"study_design_scores_gemma":[0.000024964664,0.000049329778,0.0026967495,0.0013881061,0.000079633326,0.00029351684,0.0002603378,0.0020958367,0.00012608457,0.8924313,0.100514695,0.000039359555],"about_ca_topic_score_codex":0.0025813659,"about_ca_topic_score_gemma":0.0024402705,"teacher_disagreement_score":0.023932677,"about_ca_system_score_codex":0.0022720485,"about_ca_system_score_gemma":0.0032432228,"threshold_uncertainty_score":0.12656963},"labels":[],"label_agreement":null},{"id":"W4246504292","doi":"10.1007/978-94-007-0753-5_104098","title":"Surrogate Endpoint","year":2014,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brandon University; University of Northern British Columbia","funders":"","keywords":"Surrogate endpoint; Medicine; Internal medicine","score_opus":0.195517714390595,"score_gpt":0.38931771190457615,"score_spread":0.19379999751398114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4246504292","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006908853,0.0015997879,0.8553198,0.002982762,0.0014848508,0.00008298395,0.0007023235,0.0004703298,0.13666634],"genre_scores_gemma":[0.11190436,0.0070207804,0.46208984,0.004287806,0.003812421,0.00078711385,0.004170823,0.0016857273,0.40424117],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99588794,0.0018738536,0.00016042669,0.00078630744,0.0011898881,0.00010163282],"domain_scores_gemma":[0.99412185,0.0034212326,0.00028804925,0.0013308077,0.0007001223,0.0001378294],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00597286,0.0013838757,0.0016386961,0.0013797481,0.0008079454,0.003875194,0.0020607559,0.002493361,0.058775134],"category_scores_gemma":[0.024766894,0.00058132404,0.0013935321,0.0015303369,0.0017898865,0.0041694026,0.0027009603,0.0063557937,0.02002887],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006749653,0.000041581978,0.00016091763,0.00016526098,0.000026351381,0.00007002022,0.000048717247,0.004681481,0.0002890768,0.8617081,0.03666134,0.09607963],"study_design_scores_gemma":[0.000015189001,0.000026858968,0.00008489691,0.00013955508,0.00002149603,0.00015219791,0.00001752453,0.011571984,0.0005575901,0.90669364,0.08070398,0.00001517403],"about_ca_topic_score_codex":0.00035266127,"about_ca_topic_score_gemma":0.00043524124,"teacher_disagreement_score":0.058775134,"about_ca_system_score_codex":0.0010809663,"about_ca_system_score_gemma":0.0015937126,"threshold_uncertainty_score":0.19662237},"labels":[],"label_agreement":null},{"id":"W4249742129","doi":"10.31235/osf.io/znj38","title":"Moving Beyond Linear Regression: Implementing and Interpreting Quantile Regression Models with Fixed Effects","year":2020,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Quantile regression; Econometrics; Quantile; Regression; Linear regression; Fixed effects model; Replication (statistics); Range (aeronautics); Regression analysis; Distribution (mathematics); Wage; Statistics; Economics; Computer science; Mathematics; Panel data; Engineering","score_opus":0.10072276198218039,"score_gpt":0.40986231130290957,"score_spread":0.3091395493207292,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4249742129","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0040717274,0.0021657392,0.98560923,0.0040706852,0.00024276556,0.00007883173,0.0003563641,0.00038817714,0.0030164411],"genre_scores_gemma":[0.19016823,0.00493326,0.7941817,0.0036659932,0.0007692529,0.00067540334,0.00069469237,0.0007988525,0.004112536],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95330834,0.03976829,0.0011382832,0.0026444895,0.0025098643,0.00063088315],"domain_scores_gemma":[0.8704289,0.10910436,0.007137424,0.009485893,0.0034689794,0.00037440978],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.054190837,0.0015064339,0.002228535,0.0025607941,0.0010293213,0.0058261016,0.00431932,0.002956314,0.006644996],"category_scores_gemma":[0.1954396,0.0010290974,0.0031268173,0.0053830408,0.003902743,0.0066337558,0.004160116,0.007102859,0.0013944574],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006447873,0.00006269222,0.009408134,0.0006056468,0.0004400178,0.00030811902,0.002107115,0.032454357,0.00032531942,0.8333982,0.005950943,0.11487506],"study_design_scores_gemma":[0.00004012424,0.00006276682,0.0024815772,0.0004872086,0.00011785626,0.00009236116,0.0004831385,0.073242866,0.00061182596,0.90054524,0.02177159,0.000063389365],"about_ca_topic_score_codex":0.014678833,"about_ca_topic_score_gemma":0.0074232626,"teacher_disagreement_score":0.054190837,"about_ca_system_score_codex":0.0019716066,"about_ca_system_score_gemma":0.003012286,"threshold_uncertainty_score":0.28659195},"labels":[],"label_agreement":null},{"id":"W4253624503","doi":"10.1002/9780470061596.risk0640","title":"Causality/Causation","year":2008,"lang":"en","type":"other","venue":"Encyclopedia of Quantitative Risk Analysis and Assessment","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Causation; Causal inference; Causality (physics); Causal model; Inference; Causal structure; Epistemology; Causal reasoning; Confounding; Computer science; Psychology; Econometrics; Artificial intelligence; Mathematics; Cognition; Philosophy; Statistics","score_opus":0.09429476792521993,"score_gpt":0.4436265571106523,"score_spread":0.3493317891854324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4253624503","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00657179,0.06191165,0.47938913,0.10262956,0.0100564165,0.00057345134,0.0037481734,0.0007089523,0.33441088],"genre_scores_gemma":[0.52242947,0.08599153,0.245211,0.048771325,0.012932773,0.0023204284,0.0033191198,0.00082370266,0.07820059],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98343796,0.007774249,0.0013985529,0.0030280475,0.0039244415,0.0004367453],"domain_scores_gemma":[0.9737747,0.017263774,0.0027262287,0.0032883247,0.0024669808,0.00048002627],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011911941,0.0014013662,0.0019508278,0.0046562455,0.002407732,0.006880502,0.0021964973,0.0058998605,0.029509073],"category_scores_gemma":[0.03742899,0.00063530024,0.0014449622,0.005040203,0.01743166,0.009379715,0.0046651512,0.007349937,0.005068999],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000137771285,0.000010079534,0.0004495011,0.0003905311,0.000043346594,0.00013711452,0.0002124573,0.0005191064,0.00006997825,0.9713722,0.009887911,0.016893918],"study_design_scores_gemma":[0.0000071298446,0.000007750822,0.0002050763,0.0004174589,0.000022747889,0.00022508152,0.00013498151,0.00052355736,0.00009182414,0.9378734,0.060478628,0.000012492722],"about_ca_topic_score_codex":0.0028125285,"about_ca_topic_score_gemma":0.0015533387,"teacher_disagreement_score":0.029509073,"about_ca_system_score_codex":0.0032962754,"about_ca_system_score_gemma":0.0036625336,"threshold_uncertainty_score":0.09871769},"labels":[],"label_agreement":null},{"id":"W4254941116","doi":"10.2139/ssrn.2895032","title":"Targeting Policies: Multiple Testing and Distributional Treatment Effects","year":2017,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia Hospital; University of British Columbia; Queen's University","funders":"","keywords":"Econometrics; Economics; Actuarial science","score_opus":0.09878109757502405,"score_gpt":0.38931883459932987,"score_spread":0.2905377370243058,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4254941116","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055268165,0.00075893884,0.9269678,0.0076210764,0.0005058,0.0005686862,0.0005350619,0.0005823633,0.0071921186],"genre_scores_gemma":[0.8231745,0.00059098826,0.1643393,0.0011632651,0.0009281657,0.0016307458,0.00040392517,0.00020191491,0.0075671175],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8481188,0.12412811,0.003519074,0.013591837,0.0066537387,0.003988415],"domain_scores_gemma":[0.3923526,0.55035645,0.016006168,0.03460806,0.0046426626,0.0020340895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11105055,0.0025753926,0.007185629,0.0033719782,0.0033996352,0.0060500014,0.008626095,0.009059214,0.026329309],"category_scores_gemma":[0.4039224,0.0017236884,0.004862166,0.0040113046,0.009014029,0.013546299,0.0064143944,0.01159734,0.001210374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021348684,0.0012224185,0.018252406,0.0006906167,0.0019370673,0.0009892364,0.0012913363,0.044416808,0.00047165816,0.7781801,0.0065692295,0.14384429],"study_design_scores_gemma":[0.0004755357,0.00030655667,0.001815832,0.00011213126,0.00049359497,0.00021547021,0.00029477727,0.1697336,0.0006868578,0.82423615,0.0015818208,0.000047720547],"about_ca_topic_score_codex":0.003618689,"about_ca_topic_score_gemma":0.002756179,"teacher_disagreement_score":0.11105055,"about_ca_system_score_codex":0.0029740795,"about_ca_system_score_gemma":0.0050745886,"threshold_uncertainty_score":0.5872985},"labels":[],"label_agreement":null},{"id":"W4255302121","doi":"10.1002/9781118445112.stat08046","title":"<scp>G</scp>‐Estimation","year":2017,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; McGill University","funders":"","keywords":"Marginal structural model; Estimation; Context (archaeology); Econometrics; Computer science; Event (particle physics); Nested set model; Regression; Statistics; Confounding; Mathematics; Data mining; Economics; Geography","score_opus":0.16552744788920212,"score_gpt":0.4393178890863048,"score_spread":0.2737904411971027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255302121","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016959119,0.00087497645,0.85102576,0.0066700247,0.0013567806,0.00062047876,0.025330348,0.007964761,0.10446084],"genre_scores_gemma":[0.10502498,0.0028956195,0.7025679,0.0040855156,0.0016099836,0.0039655915,0.050213777,0.0150595335,0.11457708],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99592763,0.0016276763,0.00026089803,0.00055022136,0.0014401488,0.00019334434],"domain_scores_gemma":[0.97087145,0.018452957,0.0013365488,0.0050124372,0.004009937,0.00031673204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007380403,0.0011372074,0.0012931308,0.0031071838,0.0007582205,0.0025320807,0.0025277718,0.0016512988,0.2900409],"category_scores_gemma":[0.09394168,0.0006519271,0.0014635671,0.006045247,0.0013652366,0.0026587674,0.0027515145,0.0026883525,0.10103032],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053624946,0.00005765728,0.0012002613,0.0005113757,0.0000573708,0.00016552399,0.000092519615,0.007987534,0.00022998678,0.20649172,0.6140303,0.16912217],"study_design_scores_gemma":[0.000100528654,0.00003797479,0.0020190198,0.0007437163,0.000042960382,0.00029963808,0.00009063508,0.07949176,0.0019021432,0.49769953,0.41751108,0.000060999475],"about_ca_topic_score_codex":0.0054184003,"about_ca_topic_score_gemma":0.007740986,"teacher_disagreement_score":0.2900409,"about_ca_system_score_codex":0.0016467378,"about_ca_system_score_gemma":0.0046326215,"threshold_uncertainty_score":0.9702835},"labels":[],"label_agreement":null},{"id":"W4255808401","doi":"10.1002/9781118445112.stat03727","title":"Causality/Causation","year":2014,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Causation; Causal inference; Causality (physics); Causal model; Inference; Causal structure; Epistemology; Causal reasoning; Computer science; Psychology; Artificial intelligence; Econometrics; Mathematics; Cognition; Philosophy; Statistics","score_opus":0.1732879190351021,"score_gpt":0.4376534903414204,"score_spread":0.2643655713063183,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4255808401","genre_codex":"methods","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007091057,0.048691414,0.52718735,0.11055036,0.010599124,0.0006272477,0.004770905,0.00081986125,0.28966272],"genre_scores_gemma":[0.55969447,0.062939204,0.24666427,0.049539924,0.012486987,0.002327028,0.0037383642,0.0009484364,0.061661325],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9790462,0.010571601,0.0016576136,0.0038474293,0.004353026,0.0005241011],"domain_scores_gemma":[0.96277386,0.024667457,0.0038736335,0.0048712306,0.0031610732,0.00065274903],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015500992,0.0013483706,0.002002185,0.0048959,0.002422281,0.006626982,0.002278152,0.005301525,0.030730268],"category_scores_gemma":[0.05409811,0.0006875572,0.0015455517,0.0052555273,0.018570404,0.00973387,0.004829075,0.0076118787,0.0051279794],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016405576,0.000010894806,0.00065521064,0.0004367548,0.000056845554,0.00013059829,0.00023574055,0.00055894937,0.0000647274,0.9680931,0.011688761,0.018051952],"study_design_scores_gemma":[0.000008043676,0.000007712369,0.00024432087,0.00040107517,0.00002483671,0.00018678198,0.00013049759,0.00055070035,0.00008347807,0.9496231,0.048726585,0.000012789539],"about_ca_topic_score_codex":0.003015636,"about_ca_topic_score_gemma":0.0016850589,"teacher_disagreement_score":0.030730268,"about_ca_system_score_codex":0.0033326945,"about_ca_system_score_gemma":0.0040980666,"threshold_uncertainty_score":0.10280299},"labels":[],"label_agreement":null},{"id":"W4280489194","doi":"10.1002/jrsm.1569","title":"Causal assessment in evidence synthesis: A methodological review of reviews","year":2022,"lang":"en","type":"review","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada; Chief Scientist Office; Wellcome Trust","keywords":"Viewpoints; Systematic review; Causal inference; Causality (physics); Transparency (behavior); Population; Computer science; MEDLINE; Data science; Management science; Medicine; Pathology; Political science; Environmental health; Engineering","score_opus":0.9459944482734105,"score_gpt":0.7674090534540664,"score_spread":0.1785853948193441,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4280489194","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00071551127,0.9653689,0.012417268,0.006141951,0.0025497698,0.010150116,0.0010420873,0.000117445205,0.0014969066],"genre_scores_gemma":[0.021417415,0.86704874,0.06133045,0.0053521697,0.0012560434,0.041725356,0.0010661671,0.0001317237,0.0006718757],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.47674945,0.31219977,0.1494041,0.01311532,0.04560564,0.002925707],"domain_scores_gemma":[0.3511038,0.50679314,0.06949077,0.020005498,0.051100276,0.0015065498],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.32695743,0.004443852,0.017811822,0.0493907,0.0037946072,0.015780777,0.0074432483,0.008544916,0.008733219],"category_scores_gemma":[0.67516917,0.005884825,0.019620111,0.05437037,0.0063692112,0.018761203,0.0107616745,0.007089544,0.002119838],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018857619,0.000017004584,0.00042678253,0.9242241,0.0043351576,0.00009458778,0.001550582,0.00034032494,0.00018492031,0.0036560234,0.005563271,0.05941876],"study_design_scores_gemma":[0.00024864895,0.00006899585,0.0005555701,0.9540662,0.010487928,0.00014257508,0.0006280266,0.00020765117,0.0001978074,0.0041740425,0.029163705,0.000058902486],"about_ca_topic_score_codex":0.008788799,"about_ca_topic_score_gemma":0.017996779,"teacher_disagreement_score":0.67304254,"about_ca_system_score_codex":0.026100425,"about_ca_system_score_gemma":0.06093086,"threshold_uncertainty_score":0.8299813},"labels":[],"label_agreement":null},{"id":"W4280498397","doi":"10.1080/24709360.2022.2069457","title":"Doubly weighted estimating equations and weighted multiple imputation for causal inference with an incomplete subgroup variable","year":2022,"lang":"en","type":"article","venue":"Biostatistics & Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Missing data; Statistics; Observational study; Mathematics; Estimator; Causal inference; Inference; Imputation (statistics); Subgroup analysis; Variable (mathematics); Propensity score matching; Econometrics; Medicine; Computer science; Artificial intelligence","score_opus":0.18093787325331165,"score_gpt":0.4283506853874128,"score_spread":0.24741281213410113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4280498397","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009204439,0.00023751172,0.99822444,0.00015650477,0.000024460904,0.0000664773,0.000110339926,0.00007766005,0.0001822518],"genre_scores_gemma":[0.05255783,0.0012079512,0.9428252,0.0002064416,0.00015048092,0.0011442676,0.00068884547,0.00008945382,0.0011294802],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96314824,0.03198755,0.0010913241,0.0015532878,0.0018904402,0.00032918854],"domain_scores_gemma":[0.9233024,0.06291646,0.004631321,0.0066688736,0.0022252137,0.0002556799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037176948,0.0014989104,0.0028480673,0.0034392232,0.0006042957,0.001797065,0.0045069614,0.002216105,0.005063281],"category_scores_gemma":[0.1340474,0.0011827699,0.003379401,0.0059550167,0.0013532734,0.00296492,0.0029731987,0.004042274,0.0011216091],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001804425,0.00013518076,0.0069983737,0.00071468076,0.0017901644,0.00038661444,0.0005115935,0.18009755,0.0005517682,0.6010912,0.004110471,0.20343189],"study_design_scores_gemma":[0.00012885065,0.00010607235,0.0010951511,0.0001759827,0.0002474633,0.00014636044,0.00005149532,0.4723447,0.0003892964,0.51891446,0.006339387,0.00006070873],"about_ca_topic_score_codex":0.005871609,"about_ca_topic_score_gemma":0.005448453,"teacher_disagreement_score":0.037176948,"about_ca_system_score_codex":0.0012729015,"about_ca_system_score_gemma":0.0029657024,"threshold_uncertainty_score":0.19661283},"labels":[],"label_agreement":null},{"id":"W4280620201","doi":"10.1016/j.jclinepi.2022.05.006","title":"Meta-analysis of multi-jurisdictional health administrative data from distributed networks approximated individual-level multivariable regression","year":2022,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; University of Calgary; Children's Hospital of Eastern Ontario; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Agricultural Research Institute of Ontario; University of Ottawa","funders":"Canadian Institutes of Health Research","keywords":"Meta-analysis; Random effects model; Statistics; Odds ratio; Confidence interval; Odds; Logistic regression; Medicine; Regression analysis; Computer science; Econometrics; Mathematics; Internal medicine","score_opus":0.9644975495934363,"score_gpt":0.6988432325187129,"score_spread":0.2656543170747233,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4280620201","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004715718,0.9595788,0.033685792,0.00071576674,0.00026385006,0.0001096169,0.0005300717,0.00010041184,0.00029996573],"genre_scores_gemma":[0.21869305,0.7062631,0.06929836,0.0012233502,0.0011653012,0.00064262486,0.001889682,0.00015815777,0.0006662816],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.9718416,0.022450026,0.002062558,0.0018082765,0.0015951686,0.0002424316],"domain_scores_gemma":[0.89399576,0.09826073,0.0028615184,0.003076133,0.0016489272,0.00015703314],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030094156,0.002034396,0.009241845,0.0031301572,0.00028804538,0.0021731497,0.0033068513,0.0016430833,0.002310349],"category_scores_gemma":[0.10673944,0.0010729771,0.012978978,0.00538587,0.0005896872,0.002038304,0.0014998306,0.002936124,0.00028193567],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002608449,0.00010358317,0.014195572,0.11259014,0.4514068,0.00019117491,0.00019525475,0.015436777,0.00031546282,0.006874632,0.004424244,0.39165792],"study_design_scores_gemma":[0.0027761739,0.0009176926,0.026633736,0.031899177,0.7913821,0.001063687,0.00022133725,0.042297658,0.0010602871,0.0663268,0.03521001,0.00021134311],"about_ca_topic_score_codex":0.0045504877,"about_ca_topic_score_gemma":0.005661081,"teacher_disagreement_score":0.030094156,"about_ca_system_score_codex":0.0011345639,"about_ca_system_score_gemma":0.002359709,"threshold_uncertainty_score":0.15915501},"labels":[],"label_agreement":null},{"id":"W4281263407","doi":"10.1109/jbhi.2022.3175862","title":"Marginal Structural Models Using Calibrated Weights With SuperLearner: Application to Type II Diabetes Cohort","year":2022,"lang":"en","type":"article","venue":"IEEE Journal of Biomedical and Health Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital; North York General Hospital; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Type 2 diabetes; Machine learning; Medicine; Artificial intelligence; Context (archaeology); Causal inference; Metformin; Population; Diabetes mellitus; Computer science; Statistics; Mathematics; Endocrinology","score_opus":0.10088684928470844,"score_gpt":0.38704451659541,"score_spread":0.2861576673107016,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281263407","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.117634214,0.00046130005,0.8775684,0.0009765973,0.000100270765,0.0003107703,0.0008847316,0.000913177,0.0011505198],"genre_scores_gemma":[0.6117762,0.0003160428,0.3808793,0.00052456016,0.00011785614,0.00077338284,0.0015060933,0.00027673555,0.0038298578],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9959663,0.00305175,0.00012959655,0.00045648494,0.0002171224,0.00017859285],"domain_scores_gemma":[0.96089023,0.032592393,0.0013539566,0.0026434131,0.0019014315,0.0006185989],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027442874,0.001061222,0.002099909,0.0014658022,0.00099546,0.0015852774,0.004473113,0.002431298,0.0058318274],"category_scores_gemma":[0.052076653,0.0010001713,0.0033094662,0.0016936476,0.0015472745,0.0023249292,0.002590728,0.0045265597,0.0006649614],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00037755806,0.00018244617,0.012287742,0.00008478873,0.0003326084,0.00027322647,0.00030567916,0.9136881,0.0002324968,0.03796968,0.0015831974,0.032682385],"study_design_scores_gemma":[0.000044317414,0.000025883792,0.00042624868,0.00001272399,0.000021779673,0.000017399796,0.000020344185,0.979333,0.00008458236,0.019674173,0.00032474205,0.0000147300225],"about_ca_topic_score_codex":0.03842468,"about_ca_topic_score_gemma":0.031641033,"teacher_disagreement_score":0.03842468,"about_ca_system_score_codex":0.0022692753,"about_ca_system_score_gemma":0.0028257996,"threshold_uncertainty_score":0.1451335},"labels":[],"label_agreement":null},{"id":"W4281956449","doi":"10.1111/biom.13683","title":"Reader reaction to “Outcome‐adaptive lasso: Variable selection for causal inference” by Shortreed and Ertefaie (2017)","year":2022,"lang":"en","type":"letter","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Causal inference; Propensity score matching; Estimator; Statistics; Confounding; Collinearity; Lasso (programming language); Econometrics; Outcome (game theory); Computer science; Inference; Mathematics; Artificial intelligence","score_opus":0.2340422227013879,"score_gpt":0.4155220545397822,"score_spread":0.1814798318383943,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4281956449","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001679669,0.0014244483,0.00085324666,0.9591263,0.036749545,0.000023048065,0.00018221475,0.00011498092,0.0013581609],"genre_scores_gemma":[0.002409254,0.0015538018,0.001012232,0.92683333,0.05892582,0.00013230214,0.00007857653,0.00013323734,0.008921389],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9934587,0.0025167314,0.0009172427,0.0012224463,0.0014548321,0.0004301507],"domain_scores_gemma":[0.97587115,0.016714549,0.0011283982,0.000857738,0.0041919486,0.0012362422],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009144612,0.0016325396,0.0018308825,0.0012425581,0.0028514618,0.0058894297,0.0023734525,0.037387,0.015317641],"category_scores_gemma":[0.06068168,0.00087980396,0.0016078822,0.00095031614,0.003906018,0.005554635,0.0021972405,0.05112468,0.0194923],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000041702155,0.000016474587,0.00012434847,0.000027953241,0.000008489388,0.00017476175,0.000044382738,0.00004706691,0.00006961308,0.0017789307,0.9930789,0.004587413],"study_design_scores_gemma":[0.00014762547,0.00005684255,0.0006544641,0.0002976809,0.000020466285,0.00074888085,0.00021096741,0.0009106269,0.00030303063,0.010999783,0.9855592,0.000090391],"about_ca_topic_score_codex":0.003365829,"about_ca_topic_score_gemma":0.0034472554,"teacher_disagreement_score":0.037387,"about_ca_system_score_codex":0.0033839794,"about_ca_system_score_gemma":0.0024621743,"threshold_uncertainty_score":0.05124265},"labels":[],"label_agreement":null},{"id":"W4282927183","doi":"10.1177/0272989x221100717","title":"A Machine-Learning Approach for Estimating Subgroup- and Individual-Level Treatment Effects: An Illustration Using the 65 Trial","year":2022,"lang":"en","type":"article","venue":"Medical Decision Making","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre Hospitalier Universitaire de Sherbrooke; Université de Sherbrooke","funders":"Health Technology Assessment Programme; Medical Research Council; National Institute for Health and Care Research","keywords":"Covariate; Overfitting; Medicine; Parametric statistics; Causal inference; Subgroup analysis; Machine learning; Confidence interval; Econometrics; Statistics; Computer science; Mathematics; Internal medicine","score_opus":0.32824647215952396,"score_gpt":0.4587967880202238,"score_spread":0.13055031586069982,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4282927183","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07517216,0.010161548,0.8709968,0.020739919,0.00084494107,0.0032290714,0.0043276395,0.00086510036,0.013662752],"genre_scores_gemma":[0.5814778,0.0023736644,0.40329129,0.0040415553,0.00043572814,0.0050017997,0.001244956,0.00011230981,0.0020209386],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94235724,0.053566623,0.0012108455,0.0010395262,0.0015087292,0.0003169568],"domain_scores_gemma":[0.92131853,0.07282993,0.0017076549,0.0025602614,0.0013457151,0.00023790487],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.059684027,0.00086669176,0.00194983,0.0012645435,0.00055972935,0.001529125,0.0013750782,0.0022366492,0.004536211],"category_scores_gemma":[0.121413864,0.00032589753,0.004168647,0.0019167792,0.0008993093,0.0013831833,0.001188361,0.003061016,0.00041780755],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012150814,0.0005821262,0.025242558,0.003468493,0.0062539782,0.0010815555,0.0010185391,0.26715857,0.0009867478,0.12889686,0.025685497,0.5274742],"study_design_scores_gemma":[0.0074562104,0.0022124217,0.011232973,0.0012976124,0.0030202202,0.00067841413,0.00023662015,0.66133416,0.0010359108,0.27859622,0.03268481,0.00021438772],"about_ca_topic_score_codex":0.006037782,"about_ca_topic_score_gemma":0.004939546,"teacher_disagreement_score":0.059684027,"about_ca_system_score_codex":0.0010771095,"about_ca_system_score_gemma":0.0029215978,"threshold_uncertainty_score":0.31564307},"labels":[],"label_agreement":null},{"id":"W4282984288","doi":"10.5539/gjhs.v14n7p32","title":"Cumulative Equivalence: Controlling for Inter-Individual Differences at Baseline Characteristic Testing of RCTs","year":2022,"lang":"en","type":"article","venue":"Global Journal of Health Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Comparability; Randomization; Equivalence (formal languages); Randomized controlled trial; Medicine; Baseline (sea); Cumulative incidence; Intervention (counseling); Gold standard (test); Statistics; Mathematics; Surgery","score_opus":0.2835429106626777,"score_gpt":0.4721793295214461,"score_spread":0.18863641885876836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4282984288","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00658206,0.0009343584,0.9859918,0.0011645408,0.00032575804,0.0014284787,0.0002767759,0.00040180315,0.002894353],"genre_scores_gemma":[0.2428244,0.0008545184,0.7435683,0.0012697245,0.00069117185,0.0086166,0.0005781299,0.0004041569,0.0011930005],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5049123,0.40994903,0.02263724,0.028300405,0.03131199,0.0028890034],"domain_scores_gemma":[0.14062333,0.7601301,0.02529708,0.061225407,0.01149887,0.0012252933],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3697964,0.0023465245,0.004750168,0.007088598,0.0024426084,0.005830008,0.007567995,0.004261746,0.012798734],"category_scores_gemma":[0.80675864,0.0017986097,0.009078377,0.0075177466,0.010027998,0.011986619,0.009508029,0.009435407,0.0009084979],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023101254,0.00053433963,0.031158652,0.004490276,0.009079222,0.0006680287,0.0045099915,0.027016861,0.0011093885,0.43106332,0.004547831,0.48351204],"study_design_scores_gemma":[0.0009941063,0.0022918214,0.012884724,0.0017168733,0.0031541197,0.00045186497,0.000534088,0.09438618,0.0033721472,0.8644256,0.015595654,0.00019294885],"about_ca_topic_score_codex":0.0034497709,"about_ca_topic_score_gemma":0.0020665121,"teacher_disagreement_score":0.6302036,"about_ca_system_score_codex":0.0036769607,"about_ca_system_score_gemma":0.009582113,"threshold_uncertainty_score":0.77715325},"labels":[],"label_agreement":null},{"id":"W4283268556","doi":"10.1002/pds.5500","title":"Machine learning for improving high‐dimensional proxy confounder adjustment in healthcare database studies: An overview of the current literature","year":2022,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Agency for Drugs and Technologies in Health; McGill University; McGill University Health Centre","funders":"National Institute on Aging; International Society for Pharmacoepidemiology","keywords":"Confounding; Proxy (statistics); Prioritization; Covariate; Medicine; Feature selection; Computer science; Data mining; Machine learning; Management science","score_opus":0.43556118693804624,"score_gpt":0.5536874237850973,"score_spread":0.11812623684705104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283268556","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0078692725,0.4519698,0.5159632,0.018884296,0.0008194709,0.0005688662,0.0012816554,0.0006798458,0.0019635758],"genre_scores_gemma":[0.15742818,0.24999338,0.5777544,0.006027073,0.0039063627,0.0018364233,0.0021677206,0.0002221446,0.00066423684],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.96250695,0.02884924,0.003334505,0.002224559,0.0028512871,0.00023355112],"domain_scores_gemma":[0.8355105,0.14872274,0.0062024905,0.0038375296,0.005244078,0.0004826678],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.057306774,0.0012789303,0.0028235673,0.00459539,0.00055737194,0.0037056506,0.0022561238,0.0015170549,0.002116807],"category_scores_gemma":[0.14629884,0.00074784266,0.004087377,0.0057233367,0.0012013105,0.0024666768,0.0019851339,0.0038972653,0.00058607175],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003259007,0.0001488463,0.02605864,0.011203799,0.0033957753,0.000089273846,0.00029924457,0.018318063,0.00036463953,0.018057346,0.012289433,0.90944904],"study_design_scores_gemma":[0.00076170027,0.0010085416,0.060771164,0.03490771,0.0062615885,0.0011850426,0.00056561694,0.47032893,0.0032456247,0.26950592,0.15094578,0.000512365],"about_ca_topic_score_codex":0.00285288,"about_ca_topic_score_gemma":0.002777143,"teacher_disagreement_score":0.94269323,"about_ca_system_score_codex":0.0016820799,"about_ca_system_score_gemma":0.002872703,"threshold_uncertainty_score":0.30307084},"labels":[],"label_agreement":null},{"id":"W4283789559","doi":"10.1002/cjs.11718","title":"Causal inference: Critical developments, past and future","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Causality (physics); Statistical inference; Inference; Field (mathematics); Epistemology; Subject (documents); Causal model; Data science; Computer science; Econometrics; Mathematics; Philosophy; Statistics","score_opus":0.07887559240728977,"score_gpt":0.367192966318878,"score_spread":0.28831737391158824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283789559","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025559939,0.6627829,0.053207614,0.2583729,0.0057217893,0.00002939017,0.00015865675,0.000083799016,0.017086899],"genre_scores_gemma":[0.24793425,0.63399595,0.04030441,0.020184532,0.05323525,0.00013455846,0.00017980806,0.00014311918,0.0038882259],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98878396,0.007409788,0.00043973635,0.0011910398,0.0018890841,0.00028631167],"domain_scores_gemma":[0.7910047,0.18796547,0.0034940722,0.004018342,0.011760093,0.0017572901],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.047087457,0.000876094,0.0013846713,0.004546159,0.0016658114,0.0068579977,0.0019947079,0.0040092934,0.0062028207],"category_scores_gemma":[0.09092644,0.00053882133,0.0006436347,0.0033010978,0.017335566,0.01211727,0.0025958081,0.009918913,0.0008703226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000048988903,0.000025522857,0.00043195407,0.00083430787,0.00004265743,0.00010788157,0.0002942905,0.0011709569,0.0000692691,0.9348651,0.015233523,0.0468756],"study_design_scores_gemma":[0.000013058336,0.00001501153,0.00030127523,0.0012039114,0.000017741848,0.00014749069,0.00025667183,0.0023567327,0.00011276722,0.9415275,0.054023482,0.00002438974],"about_ca_topic_score_codex":0.00360893,"about_ca_topic_score_gemma":0.002041047,"teacher_disagreement_score":0.047087457,"about_ca_system_score_codex":0.006301596,"about_ca_system_score_gemma":0.0051767086,"threshold_uncertainty_score":0.24902529},"labels":[],"label_agreement":null},{"id":"W4283793196","doi":"10.1136/bmjopen-2022-062572","title":"Impact of time-varying exposure on estimated effects in observational studies using routinely collected data: protocol for a cross-sectional study","year":2022,"lang":"en","type":"article","venue":"BMJ Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"National Key Research and Development Program of China; National Natural Science Foundation of China","keywords":"Medicine; Observational study; Protocol (science); Cross-sectional study; Medical physics; Alternative medicine; Pathology","score_opus":0.7734215775216742,"score_gpt":0.6551119099695175,"score_spread":0.11830966755215666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283793196","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011892851,0.00054601073,0.0097843185,0.0007108644,0.0005909707,0.9820395,0.0042405655,0.0001820797,0.00071638136],"genre_scores_gemma":[0.00086948875,0.00012147461,0.0065859775,0.00019664937,0.000027156808,0.9917761,0.00029534224,0.000012281106,0.00011558579],"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","domain_scores_codex":[0.81668687,0.11682077,0.0480451,0.0064414553,0.008795576,0.0032102552],"domain_scores_gemma":[0.6902614,0.16183302,0.0440373,0.04907209,0.050249532,0.004546764],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23243865,0.0040513775,0.006606371,0.0062960414,0.002932964,0.004761787,0.003012461,0.009120482,0.041476365],"category_scores_gemma":[0.33383876,0.004529606,0.01124937,0.005805589,0.0041865893,0.004631692,0.0035365669,0.007806243,0.0106014125],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1146606,0.0042643393,0.012185554,0.38374925,0.011584159,0.0033519308,0.01207376,0.01109908,0.010003376,0.05203832,0.20522442,0.17976525],"study_design_scores_gemma":[0.105047904,0.014036952,0.042640984,0.21077365,0.007218107,0.0015843123,0.0031382267,0.015081955,0.012497142,0.07416755,0.51224166,0.0015715522],"about_ca_topic_score_codex":0.0019351855,"about_ca_topic_score_gemma":0.0026875252,"teacher_disagreement_score":0.7675613,"about_ca_system_score_codex":0.0066589005,"about_ca_system_score_gemma":0.024827143,"threshold_uncertainty_score":0.9465398},"labels":[],"label_agreement":null},{"id":"W4285013168","doi":"10.1016/j.gloepi.2022.100080","title":"A practical guide to handling competing events in etiologic time-to-event studies","year":2022,"lang":"en","type":"article","venue":"Global Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Event (particle physics); Data science; Computer science; Gray (unit); Psychology; Medicine","score_opus":0.35668389234934533,"score_gpt":0.5653202569144733,"score_spread":0.20863636456512796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285013168","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00025143556,0.0054436116,0.96327734,0.013785097,0.0018951636,0.0009442593,0.0020319982,0.0023845409,0.009986638],"genre_scores_gemma":[0.0035661887,0.00734975,0.9635091,0.0071462053,0.0018812694,0.0034486619,0.0011272238,0.0010993851,0.010872243],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9837716,0.011713008,0.0017254788,0.00068066147,0.0019308492,0.0001784158],"domain_scores_gemma":[0.8737658,0.11336768,0.0029450485,0.0028250148,0.0059473463,0.0011490018],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031384468,0.0023738954,0.0020576927,0.0052197916,0.00098107,0.0029444923,0.0038561586,0.0043252814,0.060023185],"category_scores_gemma":[0.13535973,0.0019765603,0.0021459137,0.0037485587,0.002674738,0.005330003,0.0026239732,0.009040941,0.02537321],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010412868,0.00017957076,0.0006783642,0.0025327308,0.00016690686,0.0006495339,0.00094715407,0.0052113603,0.0007367778,0.2061129,0.54703313,0.23564741],"study_design_scores_gemma":[0.00012103975,0.00013232965,0.0005820206,0.00169733,0.000055734195,0.0012784383,0.00025217157,0.009695063,0.0003918663,0.4026579,0.5830399,0.000096249656],"about_ca_topic_score_codex":0.0022917164,"about_ca_topic_score_gemma":0.0043899766,"teacher_disagreement_score":0.96861553,"about_ca_system_score_codex":0.0014094495,"about_ca_system_score_gemma":0.004957404,"threshold_uncertainty_score":0.20079756},"labels":[],"label_agreement":null},{"id":"W4285490771","doi":"10.1101/2022.07.13.22277596","title":"COVID-19 pandemic surges can induce bias in trials using response adaptive randomization: A simulation study","year":2022,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; Mount Sinai Hospital; Health Sciences Centre; University Health Network; University of Toronto; Institute for Clinical Evaluative Sciences; Sinai Health System; Sunnybrook Health Science Centre","funders":"University of Toronto","keywords":"Coronavirus disease 2019 (COVID-19); Pandemic; Randomization; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Computer science; Econometrics; Clinical trial; Medicine; Virology; Mathematics; Internal medicine; Outbreak; Infectious disease (medical specialty)","score_opus":0.7326986697119655,"score_gpt":0.552732320825076,"score_spread":0.17996634888688956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285490771","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40175945,0.009058862,0.55222595,0.009299143,0.0010349689,0.01042585,0.0032632076,0.0010667414,0.011865903],"genre_scores_gemma":[0.90101296,0.0008894025,0.08772921,0.001557625,0.00017029657,0.0064341472,0.00074891566,0.00008316453,0.0013743477],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8277927,0.163064,0.003452593,0.0026366657,0.001980098,0.0010738714],"domain_scores_gemma":[0.3067517,0.64830583,0.019519662,0.018981453,0.005267588,0.0011738589],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18883048,0.0013524655,0.002427743,0.0011548674,0.00062420964,0.0023596506,0.0018083492,0.0028093047,0.007712722],"category_scores_gemma":[0.3554687,0.00079064164,0.0060115084,0.0014010853,0.002174071,0.0021402205,0.0018565578,0.0036243156,0.0006231519],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.06777206,0.004099011,0.05503076,0.009175008,0.025278963,0.0016729715,0.0013910293,0.5235546,0.002207951,0.19812241,0.017059095,0.09463613],"study_design_scores_gemma":[0.0357224,0.00778097,0.0064712027,0.00182448,0.0070118946,0.0005797273,0.00026993704,0.74003124,0.0025773952,0.18927974,0.008214202,0.00023676886],"about_ca_topic_score_codex":0.0023759773,"about_ca_topic_score_gemma":0.0014671282,"teacher_disagreement_score":0.8111695,"about_ca_system_score_codex":0.001998732,"about_ca_system_score_gemma":0.00284552,"threshold_uncertainty_score":0.998643},"labels":[],"label_agreement":null},{"id":"W4285592479","doi":"10.1002/sim.9519","title":"Bootstrap vs asymptotic variance estimation when using propensity score weighting with continuous and binary outcomes","year":2022,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ministerio de Sanidad, Consumo y Bienestar Social; Heart and Stroke Foundation of Canada","keywords":"Statistics; Mathematics; Propensity score matching; Estimator; Confidence interval; Weighting; Average treatment effect; Sample size determination; Delta method; Matching (statistics); Inverse probability weighting; Medicine","score_opus":0.14787825533505633,"score_gpt":0.3957896493172065,"score_spread":0.24791139398215017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285592479","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034661956,0.0007184908,0.9621612,0.00026117408,0.00006789542,0.0002575507,0.00009234129,0.0002878013,0.0014916097],"genre_scores_gemma":[0.5012664,0.00058091624,0.49533364,0.0002825253,0.00009254265,0.0013716981,0.00032201275,0.00024256363,0.00050774304],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9187398,0.072013006,0.0018738831,0.0022011932,0.004449434,0.00072260055],"domain_scores_gemma":[0.69021803,0.281695,0.008022352,0.014831424,0.004794616,0.00043857377],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10069794,0.0008880088,0.0017914183,0.0026829143,0.0005499455,0.0018325923,0.0018646066,0.0020890445,0.0024782196],"category_scores_gemma":[0.39423493,0.00076731027,0.0018094073,0.002517194,0.0020922658,0.003921348,0.0025301205,0.0024039608,0.00035725284],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018348887,0.00047459383,0.036521792,0.0013170798,0.0018071609,0.0006261098,0.0014166728,0.45148188,0.0021615303,0.26753426,0.003771671,0.23105246],"study_design_scores_gemma":[0.00043307358,0.00056375837,0.0066005085,0.0005050956,0.0002521352,0.00036048633,0.00023620244,0.7745339,0.0023292857,0.2100247,0.004071845,0.00008907843],"about_ca_topic_score_codex":0.0027557139,"about_ca_topic_score_gemma":0.0020874022,"teacher_disagreement_score":0.89930207,"about_ca_system_score_codex":0.0009282522,"about_ca_system_score_gemma":0.0018560913,"threshold_uncertainty_score":0.53254795},"labels":[],"label_agreement":null},{"id":"W4285614247","doi":"10.20955/wp.2022.014","title":"The Sine Aggregatio Approach to Applied Macro","year":2022,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Sine; Macro; Mathematics; Computer science; Geometry; Programming language","score_opus":0.2598576242959587,"score_gpt":0.4368323145212753,"score_spread":0.1769746902253166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4285614247","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020535237,0.00019231519,0.9886086,0.00052405475,0.00012732101,0.00008766072,0.0007115937,0.0003805543,0.0073142764],"genre_scores_gemma":[0.115661494,0.0011095294,0.8688386,0.000663071,0.0006256048,0.0015089858,0.0017538252,0.0004357665,0.009403087],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99263775,0.0040283687,0.0004970933,0.0010566979,0.0015666271,0.00021352596],"domain_scores_gemma":[0.9841061,0.008535612,0.0014028405,0.0045209615,0.0012628827,0.00017159904],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010239296,0.0008796083,0.0014482774,0.003502811,0.0011404738,0.0028119162,0.0016028555,0.0007848166,0.012938511],"category_scores_gemma":[0.039427202,0.0008346802,0.002191473,0.004811647,0.0016366754,0.0027163285,0.0037268025,0.003736817,0.002344206],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026298372,0.000052763964,0.005362287,0.00016742355,0.00021289689,0.00012549099,0.00043371052,0.013948013,0.00045380509,0.8599681,0.0056684376,0.11358077],"study_design_scores_gemma":[0.000027376153,0.000052337702,0.0036579915,0.000085916654,0.00007866236,0.00009078728,0.0001382992,0.110484466,0.0010493847,0.8262699,0.05802502,0.000039818773],"about_ca_topic_score_codex":0.0056238216,"about_ca_topic_score_gemma":0.006148398,"teacher_disagreement_score":0.012938511,"about_ca_system_score_codex":0.0012735946,"about_ca_system_score_gemma":0.002682298,"threshold_uncertainty_score":0.054151177},"labels":[],"label_agreement":null},{"id":"W4288039325","doi":"10.1001/jama.2022.9262","title":"SARS-CoV-2 Omicron Variant Severity in Ontario, Canada—Reply","year":2022,"lang":"en","type":"letter","venue":"JAMA","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Public Health Ontario","funders":"","keywords":"Medicine; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Coronavirus disease 2019 (COVID-19); 2019-20 coronavirus outbreak; Virology; Pathology; Disease; Infectious disease (medical specialty)","score_opus":0.08714770748490701,"score_gpt":0.3286245882344564,"score_spread":0.24147688074954937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4288039325","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018984971,0.00080162816,0.00009254862,0.9790431,0.006301837,0.000034159166,0.0020377333,0.00006362065,0.009726871],"genre_scores_gemma":[0.01886515,0.0010064035,0.00028883922,0.94641155,0.006623211,0.000079807935,0.0007303971,0.000050003626,0.025944604],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9987752,0.00013978066,0.00014199164,0.00015500962,0.00040254547,0.00038539898],"domain_scores_gemma":[0.9963825,0.0011250662,0.00014445632,0.00010529315,0.0014418884,0.0008009123],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0013703189,0.00039524326,0.0008094361,0.00065308757,0.0051258076,0.0015058116,0.0014195713,0.017353494,0.010266586],"category_scores_gemma":[0.00859366,0.00045256084,0.0007599779,0.001132938,0.0017147135,0.0009938186,0.0006965714,0.010266495,0.0040739127],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000040802148,0.0000073258593,0.0027072201,0.000021805872,0.00000865049,0.0003777631,0.00011059982,0.00004091753,0.00009184853,0.00076360325,0.99317837,0.0026511273],"study_design_scores_gemma":[0.0002757145,0.00006259549,0.03421869,0.0006057014,0.000107241,0.0014776735,0.0023277074,0.0009962664,0.000377993,0.0056858016,0.9536868,0.0001779108],"about_ca_topic_score_codex":0.8955579,"about_ca_topic_score_gemma":0.92993623,"teacher_disagreement_score":0.10444212,"about_ca_system_score_codex":0.023530917,"about_ca_system_score_gemma":0.038850922,"threshold_uncertainty_score":0.21011436},"labels":[],"label_agreement":null},{"id":"W4289544708","doi":"10.1002/pst.2258","title":"Key considerations for choosing a statistical method to deal with incomplete treatment adherence in pragmatic trials","year":2022,"lang":"en","type":"review","venue":"Pharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Inverse probability weighting; Covariate; Computer science; Weighting; Statistical inference; Inference; Key (lock); Clinical trial; Medicine; Machine learning; Econometrics; Artificial intelligence; Statistics; Mathematics; Estimator","score_opus":0.7492029465102941,"score_gpt":0.639858577016374,"score_spread":0.10934436949392001,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4289544708","genre_codex":"methods","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013579415,0.013433882,0.9065529,0.06146482,0.002957521,0.0072500953,0.0006604337,0.00063539855,0.0056870324],"genre_scores_gemma":[0.016360072,0.0045052073,0.95229924,0.007091046,0.0011382293,0.017579516,0.00015954215,0.00031308384,0.00055409945],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.27049842,0.6496689,0.050825585,0.006102561,0.021825098,0.0010794449],"domain_scores_gemma":[0.11563481,0.831257,0.018251937,0.017885875,0.015787328,0.0011831224],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5355977,0.002632151,0.0055977046,0.006031406,0.0028251666,0.013405961,0.0068293605,0.01037003,0.010936435],"category_scores_gemma":[0.83608305,0.0030932645,0.0061320476,0.010651581,0.009738573,0.014371659,0.0059738085,0.018537926,0.0036125206],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011585872,0.00019427863,0.0030260037,0.030287473,0.0022023001,0.0006557943,0.006910423,0.009221804,0.0006655393,0.50298214,0.05237919,0.39031655],"study_design_scores_gemma":[0.0012551806,0.000414618,0.0014722971,0.034741506,0.0012742083,0.00087611226,0.0008205278,0.02622882,0.0016485929,0.81276935,0.11801005,0.00048879575],"about_ca_topic_score_codex":0.0025299606,"about_ca_topic_score_gemma":0.0040032887,"teacher_disagreement_score":0.46440232,"about_ca_system_score_codex":0.00570561,"about_ca_system_score_gemma":0.022273134,"threshold_uncertainty_score":0.5726908},"labels":[],"label_agreement":null},{"id":"W4289835801","doi":"10.1093/aje/kwac137","title":"Causal and Associational Language in Observational Health Research: A Systematic Evaluation","year":2022,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":84,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; McGill University; AIDS Vancouver; University of Toronto","funders":"National Center for Advancing Translational Sciences; National Institute of Biomedical Imaging and Bioengineering; National Institute of Mental Health; Medical Research Council; National Institutes of Health; Laura and John Arnold Foundation; Arnold Ventures; Stanford University; Bloomberg American Health Initiative","keywords":"Observational study; Medicine; Linguistics; Psychology; Pathology; Philosophy","score_opus":0.6763604971814872,"score_gpt":0.5975422495148568,"score_spread":0.07881824766663037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4289835801","genre_codex":"review","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.049651712,0.8485351,0.039585363,0.00649046,0.0021509125,0.0432797,0.005857181,0.0003722525,0.0040772757],"genre_scores_gemma":[0.62892276,0.20628913,0.080086514,0.0040871813,0.0015736605,0.07479187,0.0034668026,0.0002001976,0.00058187224],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.31604567,0.40205255,0.208224,0.013271157,0.058391068,0.002015627],"domain_scores_gemma":[0.115229465,0.6790448,0.12436822,0.021682914,0.057551563,0.0021231552],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.49904993,0.004152251,0.014149939,0.020724492,0.0025497142,0.009628258,0.003958944,0.004635569,0.0046414756],"category_scores_gemma":[0.76446116,0.003399897,0.026853783,0.017977132,0.006959893,0.011237692,0.007538196,0.003622508,0.00061087],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0058714603,0.00017306524,0.027683977,0.7363816,0.15701538,0.00019774116,0.0030191278,0.00078610226,0.00033279505,0.0018519693,0.0016572574,0.06502955],"study_design_scores_gemma":[0.0092807375,0.00423238,0.033343468,0.4686387,0.45793766,0.0005587176,0.002099815,0.002365474,0.001189756,0.0056108385,0.014278359,0.00046406133],"about_ca_topic_score_codex":0.007536323,"about_ca_topic_score_gemma":0.013654601,"teacher_disagreement_score":0.5009501,"about_ca_system_score_codex":0.012781538,"about_ca_system_score_gemma":0.024165597,"threshold_uncertainty_score":0.61776066},"labels":[],"label_agreement":null},{"id":"W4292111498","doi":"10.1002/pds.5527","title":"Meta‐analysis with sample‐standardization in multi‐site studies","year":2022,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Standardization; Estimator; Statistics; Meta-analysis; Econometrics; Population; Variance (accounting); Sample (material); Causal inference; Sample size determination; Consistency (knowledge bases); Random effects model; Mathematics; Computer science; Medicine; Artificial intelligence; Economics; Accounting","score_opus":0.6532422003705686,"score_gpt":0.5749269485207112,"score_spread":0.07831525184985733,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4292111498","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007407123,0.035193413,0.951746,0.0015597991,0.0005188737,0.0016773506,0.00035376876,0.0002921901,0.0012515003],"genre_scores_gemma":[0.2959379,0.02025713,0.66928005,0.0020278802,0.00070145424,0.010265571,0.0005791486,0.00021680987,0.00073412916],"study_design_codex":"design_other","study_design_gemma":"meta_analysis","domain_scores_codex":[0.8537151,0.13005796,0.006037631,0.0046720956,0.0051934063,0.00032387936],"domain_scores_gemma":[0.8181352,0.15332328,0.008243744,0.017296968,0.0027942911,0.00020647053],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10703173,0.001417354,0.0046201996,0.0031022087,0.0005656616,0.0032867314,0.0031073315,0.0019689791,0.0014308051],"category_scores_gemma":[0.26687577,0.00089364406,0.009333734,0.0048714075,0.0015169581,0.0032715907,0.0024646549,0.0029331523,0.00015109898],"study_design_candidate":"meta_analysis","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002718439,0.00027480224,0.03145133,0.05012302,0.18831412,0.0010930508,0.001079446,0.13809775,0.002371093,0.217,0.008323253,0.35915378],"study_design_scores_gemma":[0.0032734508,0.0012800186,0.013818458,0.014374672,0.14444995,0.0012644618,0.00037356358,0.17566063,0.004900988,0.6023575,0.03797945,0.00026697296],"about_ca_topic_score_codex":0.0013260059,"about_ca_topic_score_gemma":0.0015568215,"teacher_disagreement_score":0.8929683,"about_ca_system_score_codex":0.0017199519,"about_ca_system_score_gemma":0.0028930604,"threshold_uncertainty_score":0.5660447},"labels":[],"label_agreement":null},{"id":"W4292266545","doi":"10.1007/s40264-022-01221-z","title":"Analytical Approaches to Reduce Selection Bias in As-Treated Analyses with Missing In-Hospital Drug Information","year":2022,"lang":"en","type":"article","venue":"Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Korea Health Industry Development Institute; Ministry of Food and Drug Safety","keywords":"Medicine; Inverse probability weighting; Discontinuation; Hazard ratio; Selection bias; Proportional hazards model; Censoring (clinical trials); Medical prescription; Missing data; Emergency medicine; Confidence interval; Information bias; Internal medicine; Statistics; Propensity score matching; Pharmacology","score_opus":0.22544401059947272,"score_gpt":0.39293869514155394,"score_spread":0.16749468454208122,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4292266545","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018305271,0.00040382493,0.99591464,0.00084803265,0.000111076646,0.000121002224,0.00011379927,0.00014537295,0.00051168056],"genre_scores_gemma":[0.13955921,0.0013113366,0.85076433,0.0016200516,0.0010659627,0.0013861827,0.00046676284,0.00025173413,0.0035743609],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9359689,0.05583774,0.0015331531,0.0026926002,0.0032868255,0.00068079797],"domain_scores_gemma":[0.7134031,0.25935748,0.007183869,0.01386696,0.0052246465,0.00096401665],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09318324,0.0020497367,0.0034691175,0.0052180216,0.0015792293,0.0032337492,0.0063273204,0.002703299,0.009930331],"category_scores_gemma":[0.27281144,0.0015490553,0.0049140323,0.005429093,0.0030979074,0.0039522583,0.003959328,0.0065651913,0.0010237006],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008727471,0.00069247687,0.010256433,0.001659959,0.0053558284,0.0010413777,0.0013232807,0.0704837,0.0012590111,0.6382352,0.014488138,0.25433186],"study_design_scores_gemma":[0.00031267919,0.00016195304,0.001220833,0.00015059003,0.000682622,0.00018729761,0.00013724735,0.208734,0.0005862025,0.7820896,0.0056975214,0.00003944138],"about_ca_topic_score_codex":0.0025654328,"about_ca_topic_score_gemma":0.0029533375,"teacher_disagreement_score":0.9068168,"about_ca_system_score_codex":0.0013057261,"about_ca_system_score_gemma":0.0054851035,"threshold_uncertainty_score":0.49280596},"labels":[],"label_agreement":null},{"id":"W4292760984","doi":"10.1111/insr.12518","title":"Calibration Techniques Encompassing Survey Sampling, Missing Data Analysis and Causal Inference","year":2022,"lang":"en","type":"article","venue":"International Statistical Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Missing data; Causal inference; Calibration; Sampling (signal processing); Empirical likelihood; Computer science; Weighting; Data mining; Statistics; Econometrics; Mathematics; Artificial intelligence; Machine learning","score_opus":0.4095992104995709,"score_gpt":0.5409369624078981,"score_spread":0.13133775190832725,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4292760984","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001399427,0.094060495,0.891568,0.0066672135,0.0007789297,0.00015389697,0.0002377818,0.00022129549,0.004912922],"genre_scores_gemma":[0.12411267,0.2564418,0.60309184,0.0053678676,0.005236515,0.0014699578,0.00071258785,0.00035438788,0.0032122834],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95594823,0.03306146,0.0018707942,0.003109108,0.005525996,0.0004843805],"domain_scores_gemma":[0.8664342,0.11105658,0.0049617426,0.008076054,0.00902153,0.00045001862],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07117372,0.0018957747,0.0029022857,0.007402618,0.0012598658,0.0027984402,0.0039506666,0.0034258266,0.0045573423],"category_scores_gemma":[0.14476539,0.001191794,0.0028546182,0.010739433,0.006823874,0.0059410357,0.0034343123,0.0065027755,0.001219838],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004363303,0.000049271453,0.0016175121,0.0041863467,0.00048389452,0.000094900235,0.0005386927,0.017176054,0.00023688017,0.69524866,0.009581427,0.27074283],"study_design_scores_gemma":[0.000032534255,0.000068629866,0.0019841664,0.0033585208,0.00017618724,0.00030529153,0.00024574721,0.02396382,0.00083819136,0.89135593,0.07756587,0.000105083884],"about_ca_topic_score_codex":0.0032449255,"about_ca_topic_score_gemma":0.001615349,"teacher_disagreement_score":0.07117372,"about_ca_system_score_codex":0.003484537,"about_ca_system_score_gemma":0.005732665,"threshold_uncertainty_score":0.3764071},"labels":[],"label_agreement":null},{"id":"W4293064632","doi":"10.1002/cjs.11702","title":"Dynamic treatment regimes with interference","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Ontario Institute for Cancer Research","keywords":"Robustness (evolution); Observational study; Computer science; Ordinary least squares; Econometrics; Function (biology); Population; Data mining; Machine learning; Medicine; Mathematics; Statistics","score_opus":0.07877763027666349,"score_gpt":0.3395120526457993,"score_spread":0.2607344223691358,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4293064632","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05241353,0.00033603396,0.93394387,0.002577586,0.00013199348,0.00028573087,0.0005519011,0.00027191534,0.009487453],"genre_scores_gemma":[0.9043166,0.00027571217,0.08661237,0.0010418107,0.00022023112,0.0006809442,0.00035630603,0.000068888156,0.006427181],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98441494,0.008680564,0.00064394367,0.0036141623,0.0016972548,0.0009492315],"domain_scores_gemma":[0.9456302,0.03820749,0.006857269,0.0069626644,0.0016608777,0.00068148336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014189185,0.00060693413,0.0015995374,0.0010073363,0.0009930686,0.0024446622,0.0025702945,0.0028724407,0.008984707],"category_scores_gemma":[0.07691412,0.00071943976,0.0015801521,0.001069486,0.00386559,0.0032736452,0.0030428316,0.0031221937,0.0007538843],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036645035,0.00019819973,0.010035618,0.0002015572,0.0004138822,0.00038756433,0.00045331605,0.28532994,0.0011099209,0.63029486,0.0032640407,0.06794468],"study_design_scores_gemma":[0.00019239688,0.00024319818,0.0042081033,0.00009832643,0.00014140073,0.00017492026,0.000113711256,0.50996643,0.0009454315,0.47755197,0.00629227,0.00007178659],"about_ca_topic_score_codex":0.004344601,"about_ca_topic_score_gemma":0.0018808311,"teacher_disagreement_score":0.014189185,"about_ca_system_score_codex":0.0026179075,"about_ca_system_score_gemma":0.0015636508,"threshold_uncertainty_score":0.07504046},"labels":[],"label_agreement":null},{"id":"W4293568569","doi":"10.1257/aer.20220277","title":"Methods Matter: p-Hacking and Publication Bias in Causal Analysis in Economics: Reply","year":2022,"lang":"en","type":"article","venue":"American Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Wilfrid Laurier University; University of Ottawa","funders":"","keywords":"Rounding; Regression discontinuity design; Replicate; Difference in differences; Publication bias; Econometrics; Instrumental variable; Economics; Regression; Psychology; Significant difference; Statistics; Causal inference; Hacker; Computer science; Mathematics; Confidence interval; Computer security","score_opus":0.16278473372572494,"score_gpt":0.4591433702397555,"score_spread":0.29635863651403055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4293568569","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009427899,0.0025529773,0.0004729057,0.98649526,0.010068513,0.0000060013876,0.0000855912,0.000026600424,0.00019788496],"genre_scores_gemma":[0.003420423,0.0037201392,0.0012085594,0.9497345,0.04076082,0.000060454626,0.000050530234,0.00006209228,0.0009825331],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.963903,0.016009796,0.0054194774,0.0062456024,0.0072518894,0.0011702762],"domain_scores_gemma":[0.55483377,0.37658945,0.011324933,0.01298488,0.039020024,0.0052469564],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.072035715,0.0021103534,0.0031051654,0.0042249504,0.003613839,0.007446148,0.0068508796,0.04365438,0.015019501],"category_scores_gemma":[0.33563453,0.0012477878,0.0028807647,0.0056187655,0.020012109,0.021085292,0.005159229,0.060534798,0.008874688],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001006192,0.00003169571,0.0009873033,0.00044378955,0.000101924954,0.00015829396,0.00035980414,0.00015578634,0.00007751942,0.021766689,0.9586368,0.017179856],"study_design_scores_gemma":[0.00070023927,0.00013509775,0.004378084,0.0024826182,0.00026863223,0.0008865358,0.001802001,0.0017116512,0.00076056184,0.2525112,0.7338726,0.0004907862],"about_ca_topic_score_codex":0.007930323,"about_ca_topic_score_gemma":0.0056170872,"teacher_disagreement_score":0.92796427,"about_ca_system_score_codex":0.0045208996,"about_ca_system_score_gemma":0.00736242,"threshold_uncertainty_score":0.38096583},"labels":[],"label_agreement":null},{"id":"W4294310517","doi":"10.1515/ijb-2022-0056","title":"Causal inference for oncology: past developments and current challenges","year":2022,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé","keywords":"Causal inference; Inference; Current (fluid); Medical physics; Medicine; Econometrics; Data science; Computer science; Oncology; Mathematics; Artificial intelligence; Physics","score_opus":0.48275920743690715,"score_gpt":0.5532970978116655,"score_spread":0.07053789037475833,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294310517","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000061814084,0.99089056,0.0037051504,0.0045577567,0.00032757202,0.0000053229546,0.000013471102,0.000010200807,0.00042819267],"genre_scores_gemma":[0.0017370053,0.9920345,0.0031989592,0.0012976745,0.0015338757,0.000015126074,0.00002459019,0.000009486422,0.00014878954],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9954868,0.0027446768,0.0003577634,0.00050033134,0.0008068415,0.00010358217],"domain_scores_gemma":[0.9217266,0.07220649,0.0012245544,0.001076112,0.0032597065,0.00050659117],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.018522102,0.0010913559,0.0028637145,0.0032331927,0.0006675199,0.0026491045,0.0024053885,0.0038987042,0.0040329895],"category_scores_gemma":[0.040463466,0.00081259,0.0012999343,0.0042765713,0.004113608,0.005060812,0.0019389313,0.00762055,0.0015465145],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010903449,0.00007102768,0.00044300503,0.017324347,0.00026608098,0.0001586306,0.00024124858,0.0022970177,0.0002181614,0.14066452,0.021166438,0.81704044],"study_design_scores_gemma":[0.000058238944,0.000149607,0.0011244783,0.021397773,0.00029330148,0.000935998,0.00033269785,0.002074984,0.00039848656,0.2832964,0.68983996,0.00009805405],"about_ca_topic_score_codex":0.0025809372,"about_ca_topic_score_gemma":0.0027351596,"teacher_disagreement_score":0.9814779,"about_ca_system_score_codex":0.0021193014,"about_ca_system_score_gemma":0.0053187576,"threshold_uncertainty_score":0.097955406},"labels":[],"label_agreement":null},{"id":"W4294833180","doi":"10.3390/e24091235","title":"Simultaneous Maximum Likelihood Estimation for Piecewise Linear Instrumental Variable Models","year":2022,"lang":"en","type":"article","venue":"Entropy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Instrumental variable; Mathematics; Estimator; Statistics; Econometrics; Variable (mathematics); Variables; Piecewise","score_opus":0.06051922556134319,"score_gpt":0.3473483503281906,"score_spread":0.2868291247668474,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294833180","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042306758,0.00016449747,0.9949456,0.00009931385,0.00000917809,0.000019818419,0.00007790142,0.00009757293,0.00035548295],"genre_scores_gemma":[0.50920105,0.0013488887,0.48100713,0.00020081483,0.00013651767,0.0005949045,0.0009178856,0.0001939425,0.0063988394],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9957296,0.0030494903,0.00012962383,0.0004710224,0.0004212207,0.00019893679],"domain_scores_gemma":[0.97392017,0.022974959,0.001426436,0.0010492757,0.00048464024,0.00014456335],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006726493,0.0009214849,0.0018143447,0.0016906712,0.00057089544,0.0013269571,0.0027783236,0.0012672112,0.0040206905],"category_scores_gemma":[0.03875696,0.0010978162,0.0014711405,0.0028256853,0.0013434163,0.002589523,0.0023317956,0.0023966604,0.00046061355],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008632934,0.00005192726,0.004454899,0.00029747814,0.00027922067,0.0003266697,0.00034173919,0.5822338,0.000829049,0.34842685,0.0011483595,0.06152375],"study_design_scores_gemma":[0.000014101543,0.000016883325,0.00060225074,0.000025157424,0.000028931836,0.000036831163,0.00002892171,0.8641424,0.00025851006,0.13381067,0.0010203182,0.000014998336],"about_ca_topic_score_codex":0.0035503933,"about_ca_topic_score_gemma":0.0029807792,"teacher_disagreement_score":0.006726493,"about_ca_system_score_codex":0.0009565905,"about_ca_system_score_gemma":0.0013234661,"threshold_uncertainty_score":0.035573483},"labels":[],"label_agreement":null},{"id":"W4296527273","doi":"10.1007/s00184-022-00883-0","title":"A semiparametric multiply robust multiple imputation method for causal inference","year":2022,"lang":"en","type":"article","venue":"Metrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"National Institute on Minority Health and Health Disparities; National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Causal inference; Propensity score matching; Mathematics; Covariate; Observational study; Statistics; Average treatment effect; Parametric statistics; Econometrics; Semiparametric regression; Regression","score_opus":0.2165900280511105,"score_gpt":0.4543514871875161,"score_spread":0.23776145913640562,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4296527273","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006228616,0.00008911548,0.998587,0.00013791844,0.000027635137,0.000024289622,0.000102145095,0.00015393177,0.00025516102],"genre_scores_gemma":[0.042201914,0.00027772455,0.9515652,0.0002666649,0.00027338363,0.0004120689,0.0006609751,0.00022129591,0.0041206577],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9895891,0.0079448735,0.00035896857,0.00097772,0.00092042336,0.00020892535],"domain_scores_gemma":[0.9672674,0.02490967,0.0011965584,0.004434321,0.0018625112,0.000329571],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012247307,0.0010337268,0.002791921,0.0018619151,0.0011933822,0.002314287,0.0046890494,0.0021239351,0.010993474],"category_scores_gemma":[0.050994042,0.0013792076,0.002853542,0.003292823,0.0012961995,0.0022092853,0.003615058,0.004402601,0.0026652236],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004579997,0.00024335504,0.0024203935,0.00048436224,0.0013471685,0.00040836545,0.00036039602,0.09740296,0.0024582725,0.50744206,0.0154097555,0.37156492],"study_design_scores_gemma":[0.00011507251,0.00010261833,0.0008245081,0.000093630675,0.00021531257,0.0003570971,0.000037277325,0.64157856,0.00079671736,0.3464813,0.009329176,0.000068764064],"about_ca_topic_score_codex":0.002524777,"about_ca_topic_score_gemma":0.0035736235,"teacher_disagreement_score":0.012247307,"about_ca_system_score_codex":0.0007733201,"about_ca_system_score_gemma":0.002504105,"threshold_uncertainty_score":0.06477076},"labels":[],"label_agreement":null},{"id":"W4297412566","doi":"10.1002/cjs.11728","title":"Nonparametric tests for treatment effect heterogeneity in observational studies","year":2022,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Observational study; Nonparametric statistics; Propensity score matching; Econometrics; Statistics; Statistic; Parametric statistics; Confounding; Test statistic; Normality; Treatment effect; Asymptotic distribution; Mathematics; Average treatment effect; Statistical hypothesis testing; Computer science; Medicine; Estimator","score_opus":0.41402064646675224,"score_gpt":0.4684697448995436,"score_spread":0.05444909843279139,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4297412566","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038131412,0.0028777875,0.95284617,0.0016615955,0.000303326,0.0006236697,0.0007503468,0.00039087475,0.0024148813],"genre_scores_gemma":[0.82095313,0.00073711295,0.17343597,0.0006835076,0.00048930844,0.0023033528,0.00066250644,0.00011588582,0.0006192586],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82767475,0.14713724,0.0060196808,0.0068765045,0.011377732,0.0009141109],"domain_scores_gemma":[0.30303186,0.6502269,0.017526748,0.023073139,0.0054276413,0.0007137684],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13587381,0.0008135205,0.0026711368,0.0066907303,0.00082464324,0.0029624456,0.004300184,0.003109517,0.0042407373],"category_scores_gemma":[0.5371369,0.0005642755,0.00294516,0.0051070936,0.006520383,0.003936329,0.0033592915,0.0039341794,0.00030406055],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015365474,0.0003295244,0.06353936,0.0033239755,0.009602584,0.0015803978,0.001654017,0.081630565,0.0017371292,0.5388661,0.0076716566,0.2885281],"study_design_scores_gemma":[0.00045198956,0.00060820073,0.016642453,0.0008075344,0.00063119346,0.00069237215,0.0004289441,0.20248611,0.0012676293,0.7712249,0.0046389494,0.00011969959],"about_ca_topic_score_codex":0.0011238791,"about_ca_topic_score_gemma":0.00045144875,"teacher_disagreement_score":0.13587381,"about_ca_system_score_codex":0.0015168556,"about_ca_system_score_gemma":0.0022255785,"threshold_uncertainty_score":0.718578},"labels":[],"label_agreement":null},{"id":"W4297493265","doi":"10.1257/app.20200068","title":"Correction to “Temperature and Decisions: Evidence from 207,000 Court Cases” and Reply to Spamann","year":2022,"lang":"en","type":"article","venue":"American Economic Journal Applied Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Ottawa","funders":"","keywords":"Arbitration; Econometrics; Sample size determination; Sample (material); Sensitivity (control systems); Positive economics; Psychology; Economics; Statistics; Political science; Law and economics; Law; Mathematics; Engineering; Physics; Thermodynamics","score_opus":0.061078416682117054,"score_gpt":0.33712976948309,"score_spread":0.2760513528009729,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4297493265","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010385358,0.0014800079,0.0009859444,0.65504926,0.33698502,0.00005222537,0.0016466214,0.00042236742,0.0023399838],"genre_scores_gemma":[0.04707646,0.0034146493,0.003207231,0.7086393,0.2025047,0.00041576131,0.0015590121,0.000551638,0.03263121],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9856883,0.003988306,0.0030687028,0.0015243163,0.0048192395,0.0009110832],"domain_scores_gemma":[0.8223906,0.10290151,0.012770066,0.008654745,0.050307717,0.0029753922],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01758077,0.0010826148,0.0016359673,0.004890935,0.0042122765,0.0034354876,0.004111817,0.014158123,0.01674041],"category_scores_gemma":[0.25635427,0.0013236874,0.0016292924,0.006551643,0.0033947616,0.0026672995,0.0031379114,0.015016144,0.011304605],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000011024952,0.000003065489,0.00023696014,0.0000548596,0.000008162905,0.0001247157,0.00013147702,0.000026318812,0.000020443698,0.0004274243,0.99653614,0.0024192994],"study_design_scores_gemma":[0.000074968026,0.000028849543,0.004766367,0.0011957719,0.00007418689,0.000520188,0.0008157108,0.0007954786,0.0005104281,0.004511507,0.98657787,0.00012874579],"about_ca_topic_score_codex":0.020989118,"about_ca_topic_score_gemma":0.024303602,"teacher_disagreement_score":0.020989118,"about_ca_system_score_codex":0.0060814233,"about_ca_system_score_gemma":0.00725966,"threshold_uncertainty_score":0.09297705},"labels":[],"label_agreement":null},{"id":"W4300861756","doi":"10.47004/wp.cem.2022.1622","title":"IV Methods for Tobit Models","year":2022,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Economic and Social Research Council; University of Cambridge","keywords":"Tobit model; Computer science; Econometrics; Mathematics","score_opus":0.6572314321574739,"score_gpt":0.6175396490021837,"score_spread":0.039691783155290206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4300861756","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007806626,0.0008250404,0.99325126,0.00049159885,0.00016007536,0.00015311936,0.0008679606,0.0005161233,0.002954214],"genre_scores_gemma":[0.11176821,0.005517396,0.84744185,0.00080817926,0.0007572004,0.003947965,0.006267808,0.0021045273,0.021386925],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9872131,0.010307052,0.00041732015,0.00069066713,0.0009691073,0.00040276189],"domain_scores_gemma":[0.9824139,0.013352477,0.00091043464,0.0019912045,0.0010843943,0.00024765095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010067379,0.002090586,0.0024285123,0.004179532,0.0010326687,0.003817595,0.0035965403,0.0019258078,0.03665133],"category_scores_gemma":[0.0632824,0.0014274654,0.0025947602,0.007343132,0.001032086,0.0024403832,0.0032786934,0.0061696437,0.0102999555],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009298417,0.00011689118,0.002267202,0.00065245305,0.00080311205,0.00011651611,0.00036686254,0.13962004,0.00018047742,0.67528707,0.025039451,0.1554569],"study_design_scores_gemma":[0.00006447274,0.000049010127,0.0005157989,0.0002845555,0.00010764941,0.000053867963,0.00019891112,0.24937841,0.00018171202,0.70806634,0.04105446,0.00004480225],"about_ca_topic_score_codex":0.006553058,"about_ca_topic_score_gemma":0.005873215,"teacher_disagreement_score":0.03665133,"about_ca_system_score_codex":0.0016363155,"about_ca_system_score_gemma":0.0031933875,"threshold_uncertainty_score":0.122610986},"labels":[],"label_agreement":null},{"id":"W4307343125","doi":"10.1002/jrsm.1608","title":"Network meta‐interpolation: Effect modification adjustment in network meta‐analysis using subgroup analyses","year":2022,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":19,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Statistics; Meta-analysis; Standard error; Mean squared error; Mathematics; Sample size determination; Subgroup analysis; Confidence interval; Data mining; Econometrics; Computer science; Medicine","score_opus":0.8152217341987545,"score_gpt":0.6479104043905357,"score_spread":0.16731132980821883,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307343125","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01064047,0.055635985,0.9181163,0.0030092816,0.0012061073,0.0021595699,0.004219389,0.002226308,0.0027865805],"genre_scores_gemma":[0.3877486,0.014549311,0.57781005,0.0032274663,0.0009063124,0.0075710863,0.004862011,0.0012792887,0.0020459534],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8614539,0.12205749,0.006385153,0.006371266,0.0032222825,0.00050984544],"domain_scores_gemma":[0.8507123,0.12629889,0.0053354576,0.014488791,0.00285394,0.0003106231],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.108361505,0.0036644137,0.007107764,0.0067302343,0.0010315595,0.0039206273,0.0039734263,0.0021658598,0.0060861814],"category_scores_gemma":[0.25209233,0.0014984893,0.022281922,0.006442456,0.000992356,0.003805277,0.004132545,0.004210509,0.00065637095],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005008058,0.00018703699,0.030468415,0.041016396,0.33056292,0.0006156645,0.0010240478,0.1691365,0.0018628285,0.042056058,0.01825987,0.3598022],"study_design_scores_gemma":[0.0048370683,0.0014721908,0.012117646,0.007119335,0.30097768,0.00070270646,0.00024606907,0.37252954,0.004745959,0.23538584,0.059356328,0.00050977385],"about_ca_topic_score_codex":0.005471692,"about_ca_topic_score_gemma":0.006089115,"teacher_disagreement_score":0.8916385,"about_ca_system_score_codex":0.002170966,"about_ca_system_score_gemma":0.0037774513,"threshold_uncertainty_score":0.57307726},"labels":[],"label_agreement":null},{"id":"W4308636435","doi":"10.1002/pds.5566","title":"High‐dimensional propensity scores for empirical covariate selection in secondary database studies: Planning, implementation, and reporting","year":2022,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":49,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Institute of Diabetes and Digestive and Kidney Diseases; International Society for Pharmacoepidemiology","keywords":"Covariate; Medicine; Propensity score matching; Pharmacoepidemiology; Selection (genetic algorithm); Statistics; Econometrics; Internal medicine; Pharmacology; Computer science; Machine learning","score_opus":0.44729527161018,"score_gpt":0.5604829685782081,"score_spread":0.1131876969680281,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4308636435","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011855881,0.0019129203,0.9673689,0.009481747,0.00069178484,0.012028036,0.0030818472,0.0014708119,0.0027784307],"genre_scores_gemma":[0.013251036,0.0028442445,0.9517855,0.0016531287,0.0007509174,0.027139414,0.0018224833,0.00032161886,0.00043158955],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.33575085,0.50608325,0.10482825,0.008085216,0.043974187,0.0012782535],"domain_scores_gemma":[0.12659273,0.604529,0.08101193,0.124545105,0.0609984,0.002322794],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5616139,0.0030760118,0.0043771863,0.015584414,0.0027073426,0.014122627,0.007683247,0.0055721784,0.009543431],"category_scores_gemma":[0.80677676,0.003938021,0.0047710114,0.022815252,0.006866759,0.010974628,0.013079184,0.010461255,0.004796129],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007334634,0.00020911141,0.012979882,0.012439095,0.0016562407,0.00031723047,0.0030977533,0.01205819,0.00068430457,0.21315175,0.12733862,0.6153344],"study_design_scores_gemma":[0.0018871258,0.00087657035,0.011770137,0.02326196,0.001231178,0.0009319273,0.0015275918,0.07253629,0.00766819,0.5882328,0.2894926,0.00058361026],"about_ca_topic_score_codex":0.0032661078,"about_ca_topic_score_gemma":0.002883682,"teacher_disagreement_score":0.43838608,"about_ca_system_score_codex":0.0052784737,"about_ca_system_score_gemma":0.025214424,"threshold_uncertainty_score":0.54060817},"labels":[],"label_agreement":null},{"id":"W4308769045","doi":"10.1111/ppe.12932","title":"Multilevel modelling for measuring interaction of effects between multiple categorical variables: An illustrative application using risk factors for preeclampsia","year":2022,"lang":"en","type":"article","venue":"Paediatric and Perinatal Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Vetenskapsrådet; European Commission","keywords":"Categorical variable; Medicine; Statistics; Multilevel model; Interaction; Receiver operating characteristic; Linear regression; Parity (physics); Regression analysis; Econometrics; Mathematics; Internal medicine","score_opus":0.332833413740033,"score_gpt":0.42794708893066297,"score_spread":0.09511367519062996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4308769045","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014741838,0.0008712835,0.98139614,0.0012079016,0.00005078138,0.00024640546,0.0003316374,0.00021578638,0.00093822315],"genre_scores_gemma":[0.21775068,0.00085236493,0.77950263,0.0002319821,0.000065892695,0.0008188553,0.00024051065,0.00009874964,0.00043841705],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96883214,0.027906353,0.00075912074,0.0008868197,0.0013316607,0.00028393144],"domain_scores_gemma":[0.8844511,0.10598129,0.003397602,0.0036964072,0.0019860996,0.00048750275],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02896928,0.0008767261,0.0014060952,0.0024168394,0.0010434571,0.0016494532,0.0018060027,0.001453087,0.0028869994],"category_scores_gemma":[0.08003984,0.00045345686,0.005075535,0.0035023799,0.0010738003,0.0010791298,0.002556063,0.0029587494,0.0002674749],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007198556,0.00038597902,0.12591332,0.002700065,0.0057132416,0.0017803153,0.0069909934,0.26234266,0.0050456263,0.277866,0.008314716,0.3022272],"study_design_scores_gemma":[0.00016438674,0.0009566846,0.037989758,0.0007246273,0.0009110558,0.0010457257,0.0011244095,0.60913783,0.0018463377,0.33108994,0.014795175,0.00021412763],"about_ca_topic_score_codex":0.009831146,"about_ca_topic_score_gemma":0.013000755,"teacher_disagreement_score":0.02896928,"about_ca_system_score_codex":0.0017350197,"about_ca_system_score_gemma":0.0022220586,"threshold_uncertainty_score":0.15320599},"labels":[],"label_agreement":null},{"id":"W4309631339","doi":"10.1016/j.dialog.2022.100074","title":"Relative risk reduction: Misinformative measure in clinical trials and COVID-19 vaccine efficacy","year":2022,"lang":"en","type":"article","venue":"Dialogues in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"University of Waterloo","keywords":"Relative risk; Medicine; Clinical trial; Disinformation; Vaccine efficacy; Absolute risk reduction; Pandemic; Intensive care medicine; Disease; Coronavirus disease 2019 (COVID-19); Vaccination; Immunology; Internal medicine; Confidence interval; Infectious disease (medical specialty); Computer science","score_opus":0.5024346790845305,"score_gpt":0.5580280158501557,"score_spread":0.05559333676562517,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309631339","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016963989,0.13984086,0.5310814,0.22842577,0.016312514,0.0011268564,0.00106423,0.001133632,0.06405071],"genre_scores_gemma":[0.50876313,0.038830772,0.3442953,0.0790507,0.01726872,0.0033516663,0.00039978613,0.00080272736,0.007237197],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4599543,0.4441193,0.031064356,0.012117266,0.051406734,0.0013380549],"domain_scores_gemma":[0.17149873,0.74482936,0.0417073,0.02435089,0.01664291,0.0009707783],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3131154,0.0023629048,0.0029003269,0.008633739,0.002260643,0.012527507,0.0035444633,0.009457543,0.005884225],"category_scores_gemma":[0.60436547,0.0015613113,0.003884713,0.007162863,0.026139695,0.016895015,0.0074948976,0.015962912,0.0017119861],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012765952,0.00013412385,0.013944578,0.0071204123,0.0018227925,0.0006512094,0.011310347,0.0049520405,0.0012918281,0.5958413,0.040643975,0.3210108],"study_design_scores_gemma":[0.00041734456,0.0008272317,0.008494519,0.009191815,0.0016468854,0.0029803,0.0029027588,0.0083124945,0.0045466432,0.7911495,0.16899565,0.0005349497],"about_ca_topic_score_codex":0.0016738462,"about_ca_topic_score_gemma":0.001242025,"teacher_disagreement_score":0.68688464,"about_ca_system_score_codex":0.010040807,"about_ca_system_score_gemma":0.0054571778,"threshold_uncertainty_score":0.847051},"labels":[],"label_agreement":null},{"id":"W4309847907","doi":"10.1142/9789811270611_0028","title":"Multi-treatment Effect Estimation from Biomedical Data","year":2022,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Causal inference; Benchmark (surveying); Computer science; Machine learning; Inference; Task (project management); Artificial intelligence; Focus (optics); Estimation; Artificial neural network; Outcome (game theory); Data mining; Econometrics; Mathematics","score_opus":0.28531594039519925,"score_gpt":0.48049825684237407,"score_spread":0.19518231644717482,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4309847907","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.048192453,0.009985769,0.92781484,0.0041819606,0.0003456485,0.000694977,0.00541028,0.0011875088,0.0021865095],"genre_scores_gemma":[0.6386713,0.0024584136,0.3469427,0.0028223805,0.0004949453,0.0014513232,0.0053212806,0.00016146066,0.0016762493],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98191684,0.0142999375,0.0005393987,0.0021207165,0.0009021124,0.00022099406],"domain_scores_gemma":[0.90903157,0.08213351,0.0031165816,0.0038071345,0.0014800217,0.00043112575],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03242113,0.0015049836,0.002352445,0.0018086262,0.0005716104,0.0011136296,0.0025067579,0.0023526207,0.004355534],"category_scores_gemma":[0.09965853,0.00057093217,0.002838454,0.0016579042,0.0011767923,0.0017090816,0.001417759,0.0036436422,0.00052404386],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005062709,0.0013169196,0.030134613,0.005579032,0.0044030277,0.00052143383,0.00030290554,0.45661807,0.004827145,0.02900543,0.014281108,0.4479477],"study_design_scores_gemma":[0.0010768407,0.00093318993,0.015935302,0.0005867232,0.0016028384,0.00034164367,0.00008177196,0.78431433,0.008052344,0.17477955,0.012180828,0.000114596354],"about_ca_topic_score_codex":0.0033137044,"about_ca_topic_score_gemma":0.004947453,"teacher_disagreement_score":0.03242113,"about_ca_system_score_codex":0.0014056037,"about_ca_system_score_gemma":0.0020717147,"threshold_uncertainty_score":0.17146134},"labels":[],"label_agreement":null},{"id":"W4310461430","doi":"10.1111/biom.13793","title":"Rejoinder to Discussions on “Instrumental Variable Estimation of the Causal Hazard Ratio”","year":2022,"lang":"en","type":"letter","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Instrumental variable; Estimation; Econometrics; Statistics; Hazard ratio; Hazard; Psychology; Mathematics; Economics; Confidence interval; Biology","score_opus":0.12956008541337877,"score_gpt":0.3820493137410032,"score_spread":0.25248922832762444,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4310461430","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012233111,0.00053535885,0.0004956825,0.9886113,0.009103197,0.0000098087785,0.00009979073,0.00003192656,0.0009905859],"genre_scores_gemma":[0.0013565583,0.00021607411,0.00050943886,0.9855231,0.009806964,0.000050355364,0.000018732202,0.000039956198,0.0024788238],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95610106,0.019860148,0.0049729035,0.005094519,0.01129902,0.0026723184],"domain_scores_gemma":[0.8894839,0.08668533,0.005117637,0.0025655956,0.013421643,0.0027258373],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.039080996,0.0017626247,0.003136942,0.0016196558,0.008053214,0.009041569,0.0074955816,0.11408489,0.0062828837],"category_scores_gemma":[0.16218044,0.0018260647,0.0033032512,0.0025048319,0.009780564,0.009295427,0.004220549,0.106907696,0.0074017],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039071216,0.000018199631,0.00018630273,0.00004932432,0.000014231968,0.00024442925,0.00037864913,0.00008749721,0.00012210586,0.016750777,0.9793844,0.0027250429],"study_design_scores_gemma":[0.00011364764,0.000051114766,0.001417554,0.00044465857,0.00006310887,0.000365333,0.00080177205,0.0011031596,0.0006854242,0.044283833,0.9504524,0.00021802842],"about_ca_topic_score_codex":0.018095374,"about_ca_topic_score_gemma":0.02257223,"teacher_disagreement_score":0.960919,"about_ca_system_score_codex":0.008799582,"about_ca_system_score_gemma":0.011036958,"threshold_uncertainty_score":0.2066825},"labels":[],"label_agreement":null},{"id":"W4311277361","doi":"10.1002/sim.9629","title":"Consistent inverse probability of treatment weighted estimation of the average treatment effect with mismeasured time‐dependent confounders","year":2022,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"National Natural Science Foundation of China","keywords":"Observational error; Computer science; Confounding; Inverse probability; Inverse; Statistics; Function (biology); Estimation; Econometrics; Algorithm; Mathematics; Bayesian probability","score_opus":0.0685040974191771,"score_gpt":0.3618328318137441,"score_spread":0.29332873439456697,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311277361","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030602517,0.00053924695,0.9952852,0.0003623946,0.000074077805,0.00011695224,0.00014507657,0.00011948193,0.0002973498],"genre_scores_gemma":[0.24313618,0.0020653207,0.7471474,0.0012026338,0.00046489688,0.0018538592,0.0011404435,0.00022922087,0.0027600366],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97775686,0.016387403,0.0008052796,0.0028465118,0.0017968996,0.00040716268],"domain_scores_gemma":[0.91832274,0.0663108,0.004533238,0.0076109944,0.0029236395,0.00029855664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038565397,0.0013737568,0.0031146116,0.0024788338,0.0007921691,0.002157422,0.0035104793,0.002766263,0.0027218033],"category_scores_gemma":[0.12303817,0.00086412305,0.0031819118,0.0036093313,0.0025278763,0.003278545,0.0019712932,0.003929929,0.00061872107],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004017968,0.00026295902,0.024347931,0.0015747034,0.0023228251,0.00046907566,0.0008124863,0.17631502,0.0018850409,0.31517884,0.008494057,0.46793526],"study_design_scores_gemma":[0.00024621072,0.00032364376,0.007238534,0.00037779196,0.0009612926,0.00044902688,0.00018769625,0.5351745,0.0028694326,0.43918306,0.012856536,0.0001322305],"about_ca_topic_score_codex":0.003744056,"about_ca_topic_score_gemma":0.0025853037,"teacher_disagreement_score":0.038565397,"about_ca_system_score_codex":0.0013740727,"about_ca_system_score_gemma":0.0045259693,"threshold_uncertainty_score":0.20395577},"labels":[],"label_agreement":null},{"id":"W4311359314","doi":"10.1016/j.jval.2022.09.143","title":"CO64 Comparison of Propensity Score Matching to Inverse Probability Weighting in Obstructive Sleep Apnea Patients With Cardiovascular Diseases","year":2022,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Discovery Centre","funders":"","keywords":"Propensity score matching; Medicine; Confounding; Atrial fibrillation; Obstructive sleep apnea; Heart failure; Internal medicine; Cardiology; Sleep apnea; Inverse probability weighting; Matching (statistics); Intensive care medicine; Physical therapy","score_opus":0.15405656193558057,"score_gpt":0.35047196049547574,"score_spread":0.19641539855989518,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311359314","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8829172,0.008694161,0.09587083,0.0024275568,0.000885763,0.00086266914,0.001431904,0.00023352275,0.006676271],"genre_scores_gemma":[0.9867513,0.00074008666,0.010367335,0.00019631788,0.00011344283,0.00019560194,0.00046358292,0.000031346193,0.0011410449],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98028564,0.017156499,0.0006736597,0.00075889885,0.0007471019,0.00037818664],"domain_scores_gemma":[0.94480246,0.04663254,0.0026424946,0.003808788,0.0014638904,0.0006499277],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027323429,0.0006565418,0.0018174932,0.00088255375,0.00038806145,0.0013819936,0.0011158076,0.0011874388,0.0067780055],"category_scores_gemma":[0.100642055,0.0004607502,0.003426465,0.0013950273,0.00056178815,0.0012982399,0.0014186719,0.0013481715,0.00045935778],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.21187775,0.0024087778,0.1548018,0.0027624294,0.023694387,0.00021553415,0.00070500746,0.072594464,0.001066023,0.034571268,0.009792395,0.48551023],"study_design_scores_gemma":[0.03613139,0.031467825,0.15493721,0.0010339456,0.023722023,0.0006742304,0.0009226339,0.6262846,0.0029960182,0.10867818,0.01286533,0.00028671874],"about_ca_topic_score_codex":0.003319109,"about_ca_topic_score_gemma":0.0015847499,"teacher_disagreement_score":0.027323429,"about_ca_system_score_codex":0.0008812455,"about_ca_system_score_gemma":0.0017185328,"threshold_uncertainty_score":0.1445018},"labels":[],"label_agreement":null},{"id":"W4311514741","doi":"10.1111/ecin.13127","title":"Cautions when normalizing the dependent variable in a regression as a <i>z</i>‐score","year":2022,"lang":"en","type":"article","venue":"Economic Inquiry","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Normalization (sociology); Mathematics; Regression; Statistics; Variable (mathematics); Econometrics; Bounded function; Transformation (genetics); Linear regression; Omitted-variable bias; Regression analysis; Inference; Applied mathematics; Economics; Mathematical analysis; Computer science; Artificial intelligence","score_opus":0.1773966423125695,"score_gpt":0.3910471219627705,"score_spread":0.21365047965020104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311514741","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028979875,0.0037069614,0.8263627,0.10232253,0.009283393,0.00089834916,0.0008210918,0.0022634973,0.025361562],"genre_scores_gemma":[0.29381981,0.0018987786,0.6526552,0.034018196,0.003189085,0.0028661024,0.00027950923,0.0016792673,0.00959404],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.66109806,0.2841027,0.015652636,0.009589092,0.02861502,0.0009424567],"domain_scores_gemma":[0.3901274,0.5240567,0.018297976,0.042329673,0.02428147,0.0009067117],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.29934806,0.0015564909,0.0023375333,0.0033518886,0.0029455058,0.0061363326,0.0058196564,0.0033994575,0.0058602304],"category_scores_gemma":[0.6278941,0.0013226715,0.0018786401,0.0053185457,0.011607659,0.004847907,0.0035259523,0.013520678,0.0032142485],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008438682,0.00028011794,0.024485026,0.0014683668,0.0010046235,0.00071683625,0.01334874,0.0057679475,0.003992244,0.48725814,0.1295365,0.33129767],"study_design_scores_gemma":[0.00039184227,0.000498339,0.036881596,0.004032299,0.00061695575,0.001155279,0.007209695,0.03504569,0.01894527,0.7256018,0.16915311,0.000468267],"about_ca_topic_score_codex":0.00981546,"about_ca_topic_score_gemma":0.014154017,"teacher_disagreement_score":0.29934806,"about_ca_system_score_codex":0.003615125,"about_ca_system_score_gemma":0.004011562,"threshold_uncertainty_score":0.8640286},"labels":[],"label_agreement":null},{"id":"W4311644650","doi":"10.22541/au.167033288.86261766/v1","title":"External Validity in Distributed Data Networks","year":2022,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"External validity; Generalizability theory; Internal validity; Population; Observational study; Computer science; Data science; Psychology; Medicine; Statistics; Social psychology; Mathematics; Environmental health","score_opus":0.49059974418972874,"score_gpt":0.48499738617616894,"score_spread":0.005602358013559794,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311644650","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.052734952,0.016516255,0.7870978,0.07651119,0.0029003823,0.008367608,0.0030862663,0.00094427983,0.05184138],"genre_scores_gemma":[0.7457623,0.0053437436,0.19819862,0.023040742,0.0027767387,0.019121183,0.0027114628,0.0004871586,0.002558014],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.20412369,0.66077965,0.045384634,0.031553198,0.05461082,0.0035481125],"domain_scores_gemma":[0.03936689,0.83511317,0.05192982,0.04956233,0.022990756,0.0010371936],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6002214,0.0016820984,0.0038689224,0.010489052,0.0052777533,0.01366738,0.005961357,0.005612343,0.0072879386],"category_scores_gemma":[0.8471089,0.0016624905,0.0047706356,0.015064921,0.03457114,0.02052938,0.020116217,0.0085669,0.00090075476],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008989439,0.00016553467,0.14294142,0.00820428,0.0036774834,0.0008395848,0.016263323,0.012434193,0.00026541692,0.5952087,0.014971019,0.20413011],"study_design_scores_gemma":[0.0004042703,0.00022344312,0.01848947,0.013604002,0.00096646295,0.00069763104,0.0047716796,0.022138216,0.0009518278,0.88659096,0.050961472,0.00020058021],"about_ca_topic_score_codex":0.0076271123,"about_ca_topic_score_gemma":0.0040394105,"teacher_disagreement_score":0.3997786,"about_ca_system_score_codex":0.0150714535,"about_ca_system_score_gemma":0.021485299,"threshold_uncertainty_score":0.49299824},"labels":[],"label_agreement":null},{"id":"W4313488348","doi":"10.1177/09622802221146311","title":"Intervention treatment distributions that depend on the observed treatment process and model double robustness in causal survival analysis","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Estimator; Robustness (evolution); Average treatment effect; Computer science; Mathematics; Convergence (economics); Mathematical optimization; Econometrics; Statistics; Economics","score_opus":0.6785915120642826,"score_gpt":0.6541200482433555,"score_spread":0.02447146382092713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313488348","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01842873,0.00028653882,0.97994137,0.0003899768,0.000024208633,0.00009102082,0.000090743386,0.00013602749,0.00061131915],"genre_scores_gemma":[0.74540484,0.00069806393,0.24968575,0.0005383507,0.00021503544,0.00094567327,0.00035320857,0.00014322686,0.0020157746],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9780025,0.016365988,0.00073473534,0.0020940483,0.002167518,0.00063532003],"domain_scores_gemma":[0.8315191,0.14428067,0.009904618,0.011250682,0.0023860433,0.000658809],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035264194,0.00086677936,0.0017432816,0.001860086,0.0005381523,0.0018267,0.0023786973,0.002652936,0.0024885589],"category_scores_gemma":[0.1649359,0.0007920861,0.0020198277,0.00107383,0.003791371,0.0025260877,0.0025287312,0.0032173127,0.00028151236],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040442045,0.00018424598,0.012366716,0.00032960842,0.00052410515,0.00040638878,0.0005547531,0.33094424,0.0020971126,0.5656036,0.0011704615,0.085414335],"study_design_scores_gemma":[0.000085737876,0.00022725655,0.0029130243,0.00008802978,0.00014633127,0.00015084508,0.000048272515,0.7029588,0.001750123,0.29012844,0.0014471111,0.000055929795],"about_ca_topic_score_codex":0.0021108727,"about_ca_topic_score_gemma":0.00094418984,"teacher_disagreement_score":0.035264194,"about_ca_system_score_codex":0.0015097088,"about_ca_system_score_gemma":0.0014793349,"threshold_uncertainty_score":0.18649709},"labels":[],"label_agreement":null},{"id":"W4313532610","doi":"10.48550/arxiv.2301.01085","title":"The Chained Difference-in-Differences","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Estimator; Inference; Identification (biology); Panel data; Term (time); Missing data; Selection (genetic algorithm); Sample (material); Binary number; Econometrics; Relevance (law); Computer science; Average treatment effect; Variation (astronomy); Statistics; Mathematics; Artificial intelligence","score_opus":0.38040915584152923,"score_gpt":0.30079861071140973,"score_spread":0.0796105451301195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313532610","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008055715,0.00044060248,0.9892285,0.00039841197,0.00015116317,0.00008593965,0.0004207756,0.00010650892,0.001112354],"genre_scores_gemma":[0.33358508,0.0015427565,0.6550216,0.0005539628,0.00043359253,0.0007336281,0.0017085806,0.00013849598,0.006282308],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98999083,0.006416789,0.00042919896,0.0017781177,0.0010574573,0.00032767592],"domain_scores_gemma":[0.93880737,0.05158717,0.002333384,0.0047537247,0.002013979,0.0005043509],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017568972,0.00080306095,0.001788489,0.0015471273,0.00072152016,0.0014856241,0.0030533571,0.0017815307,0.008325442],"category_scores_gemma":[0.068360336,0.0007478252,0.0014314709,0.0022007853,0.0021632058,0.0030226014,0.0021891347,0.0032708598,0.0011589387],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002614883,0.00019576307,0.017011102,0.00049354444,0.00045851505,0.00018878256,0.00052375754,0.12799416,0.00083034823,0.71853125,0.0033441563,0.1301672],"study_design_scores_gemma":[0.00008897154,0.00015513715,0.0021435507,0.00010443962,0.0000899225,0.000095066884,0.000067851295,0.5581371,0.00109645,0.42945063,0.008519356,0.000051461455],"about_ca_topic_score_codex":0.003802135,"about_ca_topic_score_gemma":0.0036686673,"teacher_disagreement_score":0.017568972,"about_ca_system_score_codex":0.0014469837,"about_ca_system_score_gemma":0.002398664,"threshold_uncertainty_score":0.09291476},"labels":[],"label_agreement":null},{"id":"W4313564705","doi":"10.2196/39876","title":"The Current Status of Secondary Use of Claims, Electronic Medical Records, and Electronic Health Records in Epidemiology in Japan: Narrative Literature Review","year":2023,"lang":"en","type":"review","venue":"JMIR Medical Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Medicine; Epidemiology; Receipt; Medical record; Family medicine; MEDLINE; Population; Inclusion (mineral); World Wide Web; Psychology; Computer science; Pathology; Environmental health","score_opus":0.16428323579088036,"score_gpt":0.5074737274640504,"score_spread":0.34319049167317006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313564705","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037492213,0.99381834,0.0002204413,0.0009336031,0.00021469686,0.00015468341,0.0002869911,0.000007105631,0.0006148878],"genre_scores_gemma":[0.03253299,0.9638245,0.0014136758,0.0010041106,0.00034112972,0.00042006138,0.00034549352,0.000006154123,0.00011189432],"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","domain_scores_codex":[0.97946817,0.006368553,0.010315737,0.001137289,0.0022282875,0.00048195515],"domain_scores_gemma":[0.89393735,0.06720305,0.025740923,0.0010027929,0.011095454,0.0010205029],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018193664,0.0012380518,0.004342155,0.028955411,0.001150082,0.004767614,0.0020070176,0.0024876192,0.0024627435],"category_scores_gemma":[0.07250974,0.0011747484,0.003158492,0.027763085,0.0013829654,0.005154708,0.0018706413,0.0008434569,0.00030313115],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027545705,0.0000852995,0.010372536,0.8099907,0.0038434865,0.0012467763,0.0035406547,0.0001222514,0.0003859181,0.0011221394,0.005606739,0.163408],"study_design_scores_gemma":[0.00017329663,0.00045714874,0.039307877,0.8422423,0.0370094,0.0042096954,0.008201218,0.00037565283,0.00074522546,0.0010084775,0.06612409,0.00014572554],"about_ca_topic_score_codex":0.0073845326,"about_ca_topic_score_gemma":0.015561395,"teacher_disagreement_score":0.028955411,"about_ca_system_score_codex":0.0058199046,"about_ca_system_score_gemma":0.0160309,"threshold_uncertainty_score":0.09621841},"labels":[],"label_agreement":null},{"id":"W4313703179","doi":"10.1186/s12874-022-01831-2","title":"Estimation of marginal structural models under irregular visits and unmeasured confounder: calibrated inverse probability weights","year":2023,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Confounding; Observational study; Marginal structural model; Estimator; Glycemic; Medicine; Statistics; Inverse probability; Longitudinal study; Monte Carlo method; Calibration; Inverse probability weighting; Randomized controlled trial; Econometrics; Computer science; Mathematics; Diabetes mellitus; Bayesian probability; Internal medicine","score_opus":0.7798766947382557,"score_gpt":0.5947207635660053,"score_spread":0.18515593117225038,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313703179","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025599573,0.00012127571,0.9732668,0.00024732316,0.000025543442,0.00010985726,0.00012745416,0.00012155036,0.0003806214],"genre_scores_gemma":[0.56820375,0.0007229902,0.42591378,0.00023564664,0.00013710323,0.00093348336,0.00076941215,0.00012024684,0.0029636323],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9922009,0.005522247,0.0002434742,0.0011176186,0.0005848351,0.00033091087],"domain_scores_gemma":[0.9502163,0.041638143,0.003222288,0.0031802615,0.0013102238,0.00043276907],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021073407,0.0011734036,0.0019736325,0.0015962641,0.000557169,0.0017015395,0.0031557055,0.0018430934,0.003946681],"category_scores_gemma":[0.08568963,0.0009845059,0.0024031638,0.0019814586,0.0022123526,0.0030510023,0.002225081,0.0034439005,0.0003995152],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027728986,0.00017416965,0.008621587,0.0001700077,0.00043352004,0.00023198988,0.00040314515,0.7335675,0.0004653642,0.1982689,0.0011890003,0.056197487],"study_design_scores_gemma":[0.00006613564,0.00006654853,0.0011429454,0.000036563615,0.00009235252,0.000047332444,0.000051966428,0.8979064,0.0002786016,0.099601924,0.0006836414,0.0000255477],"about_ca_topic_score_codex":0.009949985,"about_ca_topic_score_gemma":0.0063325814,"teacher_disagreement_score":0.021073407,"about_ca_system_score_codex":0.0018706929,"about_ca_system_score_gemma":0.0028876308,"threshold_uncertainty_score":0.11144811},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4313892100","doi":"10.1002/cjs.11751","title":"Inducement of population sparsity","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Engineering and Physical Sciences Research Council","keywords":"Orthogonalization; Context (archaeology); Parameterized complexity; Inference; Transformation (genetics); Population; Nuisance parameter; Covariance; Path (computing); Computer science; Mathematics; Applied mathematics; Calculus (dental); Mathematical optimization; Algorithm; Artificial intelligence; Statistics","score_opus":0.24927693674633059,"score_gpt":0.3945791197856565,"score_spread":0.14530218303932593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4313892100","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058571782,0.00019152643,0.9208314,0.0016061534,0.00011951222,0.00010319589,0.0007355537,0.00031110883,0.01752972],"genre_scores_gemma":[0.8833142,0.0004770308,0.106679045,0.0009645563,0.0005320632,0.0006387207,0.001276337,0.00030701573,0.0058109835],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9891633,0.005925568,0.00039241413,0.0022585792,0.0016893722,0.0005707673],"domain_scores_gemma":[0.95971525,0.023929209,0.0036565918,0.0086991675,0.0026444243,0.0013554133],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007325001,0.00056403864,0.0013862349,0.0013417917,0.00094060105,0.0020708493,0.0014089771,0.0011502978,0.007657402],"category_scores_gemma":[0.0463071,0.00066395453,0.001195942,0.0011638618,0.004311762,0.0029705397,0.0058623943,0.0047732103,0.0006809702],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005960513,0.000038500297,0.0014591368,0.000053066047,0.000044332803,0.000087318906,0.00017347893,0.013475333,0.0017984108,0.9679031,0.001485776,0.013421844],"study_design_scores_gemma":[0.000025755919,0.00006673693,0.0013338937,0.00002345564,0.000012987648,0.000107992804,0.00005052941,0.098388985,0.001164444,0.8956464,0.0031571835,0.000021619106],"about_ca_topic_score_codex":0.00062344683,"about_ca_topic_score_gemma":0.0005662574,"teacher_disagreement_score":0.007657402,"about_ca_system_score_codex":0.0013922859,"about_ca_system_score_gemma":0.0010114445,"threshold_uncertainty_score":0.038738787},"labels":[],"label_agreement":null},{"id":"W4315436872","doi":"10.1093/aje/kwad009","title":"RE: “A FRAMEWORK FOR DESCRIPTIVE EPIDEMIOLOGY”","year":2023,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Biostatistics; Epidemiology; Medicine; Public health; Clinical epidemiology; Family medicine; Library science; Gerontology; Computer science; Pathology","score_opus":0.39698030705077686,"score_gpt":0.5023215673924645,"score_spread":0.10534126034168761,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4315436872","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034555697,0.0057356814,0.83989465,0.1257347,0.003604963,0.00022263809,0.0009059068,0.0005979507,0.02295797],"genre_scores_gemma":[0.07085066,0.013152074,0.82496315,0.05085205,0.01271692,0.0034435668,0.0013628341,0.0011362628,0.021522552],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.93047047,0.060162645,0.0024888366,0.002206082,0.0041541103,0.0005179417],"domain_scores_gemma":[0.8568101,0.120621085,0.0035000793,0.00832354,0.009334956,0.0014101393],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.065586865,0.0012980452,0.0012998316,0.0052285143,0.0018184928,0.0052472726,0.0029929143,0.0046054893,0.013884147],"category_scores_gemma":[0.14310728,0.0009042206,0.002248474,0.0044001588,0.010277688,0.009774844,0.0041379454,0.011313338,0.005343674],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010252792,0.000007459036,0.00020015467,0.0001956718,0.00002971509,0.00004718745,0.00028792713,0.0006385652,0.00002603869,0.93467176,0.04331874,0.020566557],"study_design_scores_gemma":[0.000016098034,0.0000096428375,0.00013380614,0.0003095433,0.00001404145,0.00014838685,0.000101508456,0.001966488,0.000042075953,0.90487283,0.092368774,0.000016841708],"about_ca_topic_score_codex":0.004984038,"about_ca_topic_score_gemma":0.003288022,"teacher_disagreement_score":0.065586865,"about_ca_system_score_codex":0.003795649,"about_ca_system_score_gemma":0.0077399686,"threshold_uncertainty_score":0.34686065},"labels":[],"label_agreement":null},{"id":"W4317779738","doi":"10.1080/10543406.2022.2162067","title":"Reweighting estimators to extend the external validity of clinical trials: methodological considerations","year":2023,"lang":"en","type":"article","venue":"Journal of Biopharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario","funders":"Eli Lilly and Company","keywords":"Inference; Estimator; External validity; Clinical trial; Internal validity; Population; Randomized controlled trial; Statistical inference; Computer science; Causal inference; Econometrics; Medicine; Machine learning; Artificial intelligence; Statistics; Mathematics; Pathology","score_opus":0.9259994941309059,"score_gpt":0.7137800258193395,"score_spread":0.21221946831156635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4317779738","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010416751,0.0025954556,0.99071383,0.0041717105,0.00025341765,0.000405221,0.000044603803,0.00014289655,0.0006311566],"genre_scores_gemma":[0.061021045,0.002461646,0.92940503,0.0027452412,0.0009060216,0.0025279713,0.000088108056,0.0002025219,0.0006425182],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.40183547,0.5547772,0.017624903,0.007912038,0.016971014,0.0008793651],"domain_scores_gemma":[0.08664775,0.84426844,0.012219337,0.046898328,0.009477652,0.0004885761],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5675748,0.003168007,0.0058972877,0.0046943203,0.0013798204,0.0065056565,0.006150592,0.0056734546,0.0025860379],"category_scores_gemma":[0.81460845,0.0023352948,0.005371417,0.0048063165,0.010511421,0.011658619,0.0064930846,0.015601989,0.00077570765],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00083577906,0.00015568247,0.008795092,0.0038798028,0.0055581843,0.00036419785,0.0024979468,0.035132337,0.00086260936,0.54545563,0.0061154277,0.39034733],"study_design_scores_gemma":[0.0006013844,0.0005626487,0.0018401658,0.002128582,0.00086086395,0.0003522702,0.00019935892,0.07936826,0.0012704654,0.8977008,0.014958111,0.00015708776],"about_ca_topic_score_codex":0.0027461722,"about_ca_topic_score_gemma":0.0021634467,"teacher_disagreement_score":0.4324252,"about_ca_system_score_codex":0.0024705634,"about_ca_system_score_gemma":0.006869003,"threshold_uncertainty_score":0.5332573},"labels":[],"label_agreement":null},{"id":"W4317910164","doi":"10.1177/09622802221146308","title":"Estimation of the average treatment effect with variable selection and measurement error simultaneously addressed for potential confounders","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Estimator; Weighting; Inference; Inverse probability weighting; Statistics; Confounding; Causal inference; Mathematics; Computer science; Inverse probability; Selection (genetic algorithm); Average treatment effect; Econometrics; Machine learning; Artificial intelligence; Posterior probability; Bayesian probability; Medicine","score_opus":0.34778535028016205,"score_gpt":0.5989775910914773,"score_spread":0.25119224081131525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4317910164","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001824423,0.00035796632,0.99693716,0.00023623221,0.000057153862,0.00008939903,0.00004785646,0.000054128395,0.00039556055],"genre_scores_gemma":[0.11853694,0.0017477142,0.87553775,0.0005524538,0.00036918256,0.001174788,0.00027799487,0.00007407264,0.0017290561],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9796305,0.014967403,0.0007831159,0.0022681286,0.001979847,0.000371048],"domain_scores_gemma":[0.9336473,0.055772647,0.0028937524,0.0055443943,0.0018944474,0.0002475024],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0420512,0.0012255074,0.002831427,0.0024392097,0.00081373175,0.0017757787,0.0032555487,0.0025714294,0.0048071607],"category_scores_gemma":[0.1269335,0.0007250631,0.0026933455,0.0030197748,0.0023751277,0.0035951124,0.0022758543,0.0034822673,0.00070630596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025939345,0.00020207805,0.0084629655,0.0013287818,0.0011777132,0.00024193399,0.00050880486,0.06340087,0.0017964722,0.5993944,0.0034367987,0.31978986],"study_design_scores_gemma":[0.00018977774,0.0003564185,0.0031180931,0.00042366792,0.00073521974,0.00034677988,0.00011438598,0.2223134,0.0024481723,0.7606435,0.009234769,0.00007584341],"about_ca_topic_score_codex":0.0018232265,"about_ca_topic_score_gemma":0.0014565574,"teacher_disagreement_score":0.0420512,"about_ca_system_score_codex":0.0010050347,"about_ca_system_score_gemma":0.0035267514,"threshold_uncertainty_score":0.22239065},"labels":[],"label_agreement":null},{"id":"W4318024824","doi":"10.1002/sim.9658","title":"Propensity score matching after multiple imputation when a confounder has missing data","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada","keywords":"Propensity score matching; Causal inference; Missing data; Imputation (statistics); Confounding; Statistics; Observational study; Average treatment effect; Matching (statistics); Estimator; Computer science; Confidence interval; Inference; Covariate; Econometrics; Mathematics; Artificial intelligence","score_opus":0.4066710686130003,"score_gpt":0.46171335322110957,"score_spread":0.05504228460810928,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318024824","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036323944,0.000394262,0.9944389,0.0003704796,0.00009286911,0.00013104576,0.0001336582,0.00027584838,0.00053069263],"genre_scores_gemma":[0.1683509,0.0013486923,0.82534236,0.0007161813,0.00041193032,0.0008765252,0.00091632386,0.00028517272,0.00175201],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95691305,0.030881766,0.0029298877,0.0036249084,0.004678513,0.0009719844],"domain_scores_gemma":[0.9136254,0.06365073,0.0060184225,0.013983706,0.0023154123,0.00040641692],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05754706,0.0010287468,0.003494705,0.0031785683,0.0012350526,0.0024637838,0.003337221,0.0028482855,0.0056487345],"category_scores_gemma":[0.17819262,0.00083227176,0.0026840586,0.00897083,0.0015570624,0.0035450056,0.003979283,0.0041336734,0.0011610454],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008266235,0.000260155,0.026577843,0.001283521,0.002359579,0.0013579204,0.001160214,0.09248371,0.0018393077,0.26748732,0.01456081,0.5898029],"study_design_scores_gemma":[0.00037989533,0.0003293149,0.009507656,0.00038762315,0.0006293431,0.0012671464,0.00019222732,0.36831313,0.003719857,0.5903515,0.024798598,0.00012363709],"about_ca_topic_score_codex":0.0026193822,"about_ca_topic_score_gemma":0.0019866403,"teacher_disagreement_score":0.94245297,"about_ca_system_score_codex":0.00078783074,"about_ca_system_score_gemma":0.0037175615,"threshold_uncertainty_score":0.3043416},"labels":[],"label_agreement":null},{"id":"W4318067345","doi":"10.1002/sim.9665","title":"Measuring the performance of prediction models to personalize treatment choice","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada; ZonMw; European Commission; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; National Science Foundation","keywords":"Computer science; Covariate; Calibration; Machine learning; Baseline (sea); Outcome (game theory); Range (aeronautics); Artificial intelligence; Predictive modelling; Data mining; Statistics; Mathematics","score_opus":0.2535139144086483,"score_gpt":0.4251422307621626,"score_spread":0.17162831635351433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318067345","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13509981,0.0037396797,0.84670544,0.005733678,0.00024847302,0.0004245713,0.0016792167,0.0011726444,0.0051964917],"genre_scores_gemma":[0.77792025,0.0010571851,0.21680593,0.0009108179,0.00029263648,0.00040022648,0.001732338,0.0001894263,0.0006911443],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94419914,0.044689663,0.0020824245,0.0039676153,0.0043250457,0.00073615124],"domain_scores_gemma":[0.527194,0.42897436,0.014881495,0.02306686,0.0045026424,0.0013806317],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.117213525,0.0027981023,0.002224666,0.004157509,0.00097564695,0.0039266488,0.0020512042,0.00397296,0.0020229619],"category_scores_gemma":[0.3105517,0.0010913075,0.0020517656,0.0035751518,0.0026645178,0.0053259647,0.0032485083,0.0050767893,0.0006948784],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012345838,0.00048398436,0.11322618,0.00055868045,0.0027107073,0.000094964395,0.00071655615,0.69426715,0.00079156173,0.036558762,0.005219519,0.14413738],"study_design_scores_gemma":[0.0001051701,0.00034355602,0.01152827,0.00018154667,0.00024567527,0.00011434923,0.0001169612,0.9287987,0.0013966692,0.055615634,0.0014636359,0.000089793044],"about_ca_topic_score_codex":0.0037223822,"about_ca_topic_score_gemma":0.0029091104,"teacher_disagreement_score":0.117213525,"about_ca_system_score_codex":0.0020623852,"about_ca_system_score_gemma":0.002880867,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W4318450495","doi":"10.1097/ede.0000000000001596","title":"Average Causal Effect Estimation Via Instrumental Variables: the No Simultaneous Heterogeneity Assumption","year":2023,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Economic and Social Research Council; Medical Research Council","keywords":"Instrumental variable; Econometrics; Homogeneity (statistics); Uncorrelated; Spatial heterogeneity; Average treatment effect; Identification (biology); Statistics; Study heterogeneity; Mathematics; Propensity score matching; Economics; Biology","score_opus":0.12763056610035575,"score_gpt":0.4334693375817595,"score_spread":0.3058387714814037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318450495","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0074836835,0.0016099524,0.9855993,0.0013725924,0.00015708756,0.00031623562,0.000547394,0.00014544,0.0027683612],"genre_scores_gemma":[0.59737855,0.0037860442,0.38958353,0.0016179442,0.0007969247,0.0024519789,0.0011601823,0.00014774362,0.0030771294],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92006266,0.06448488,0.0029054857,0.0061864164,0.0050756293,0.0012848765],"domain_scores_gemma":[0.7250381,0.24040173,0.013547932,0.01709866,0.0033874132,0.0005261289],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07341774,0.001665844,0.0036834264,0.0031296588,0.0009280956,0.0032903077,0.0045914743,0.002686383,0.0067796465],"category_scores_gemma":[0.22559513,0.0011303244,0.004760671,0.0037141843,0.0047586244,0.003840566,0.003215124,0.004244202,0.0007281583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034914908,0.00014669579,0.032534193,0.0024970793,0.005260954,0.0008201159,0.00078817515,0.07742993,0.0006070314,0.7678469,0.005237541,0.10648222],"study_design_scores_gemma":[0.00022656102,0.00021307037,0.0047358996,0.0007180052,0.0011702554,0.00031872105,0.00015783781,0.08732643,0.00092829484,0.8956815,0.008459413,0.000063977524],"about_ca_topic_score_codex":0.0042896233,"about_ca_topic_score_gemma":0.0022951444,"teacher_disagreement_score":0.9265823,"about_ca_system_score_codex":0.0019109962,"about_ca_system_score_gemma":0.00431171,"threshold_uncertainty_score":0.38827473},"labels":[],"label_agreement":null},{"id":"W4318480792","doi":"10.3390/pharmaceutics15020460","title":"Comparison of Seven Non-Linear Mixed Effect Model-Based Approaches to Test for Treatment Effect","year":2023,"lang":"en","type":"article","venue":"Pharmaceutics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Uppsala Multidisciplinary Center for Advanced Computational Science; Institut de Recherches Servier; National Institute of Biomedical Imaging and Bioengineering; Canadian Institutes of Health Research; National Institutes of Health; Genentech; IXICO; H. Lundbeck A/S; Servier; Vetenskapsrådet; Eisai; Northern California Institute for Research and Education; Alzheimer's Disease Neuroimaging Initiative; GE Healthcare; DoD Alzheimer's Disease Neuroimaging Initiative; Pfizer; Biogen; BioClinica; F. Hoffmann-La Roche; University of Southern California; Eli Lilly and Company; U.S. Department of Defense; Novartis Pharmaceuticals Corporation; Bristol-Myers Squibb; Merck; Alzheimer's Association; Foundation for the National Institutes of Health","keywords":"Akaike information criterion; Model selection; Type I and type II errors; Mixed model; Statistics; Linear model; Selection (genetic algorithm); Econometrics; Mathematics; Computer science; Artificial intelligence","score_opus":0.5686754144864963,"score_gpt":0.5318651782905018,"score_spread":0.03681023619599444,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318480792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03807997,0.006702677,0.9460696,0.00074289815,0.00032219198,0.0040602065,0.0010224764,0.0015052208,0.001494748],"genre_scores_gemma":[0.15770335,0.002482964,0.82027894,0.000530353,0.00011984463,0.016600087,0.0013022755,0.00032638846,0.0006557541],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.81796217,0.1647332,0.0045742434,0.0055744085,0.0065586087,0.00059728493],"domain_scores_gemma":[0.75282824,0.22304402,0.008428091,0.008838041,0.005967607,0.0008939799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12823506,0.0034958888,0.004012989,0.005054921,0.0008950862,0.0027436283,0.004700132,0.0024780969,0.0046184766],"category_scores_gemma":[0.22601339,0.0012770559,0.009656057,0.0026461054,0.0013909579,0.0028509898,0.0032445614,0.0037298414,0.00060025597],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016453398,0.0021445465,0.037734825,0.008969297,0.06497809,0.00017096593,0.0013564555,0.08024705,0.0028186347,0.04764214,0.004123054,0.73336154],"study_design_scores_gemma":[0.008175108,0.025995264,0.039179705,0.0025398978,0.024221309,0.0005220169,0.000637816,0.74550444,0.010109781,0.12724029,0.015118976,0.0007554472],"about_ca_topic_score_codex":0.0012801326,"about_ca_topic_score_gemma":0.0019109133,"teacher_disagreement_score":0.12823506,"about_ca_system_score_codex":0.00205819,"about_ca_system_score_gemma":0.003761879,"threshold_uncertainty_score":0.6781799},"labels":[],"label_agreement":null},{"id":"W4318754245","doi":"10.1093/aje/kwad026","title":"Invited Commentary: Cross-Sectional Studies and Causal Inference—It’s Complicated","year":2023,"lang":"en","type":"letter","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; McGill University; Centre Hospitalier Universitaire Sainte-Justine","funders":"Faculty of Medicine and Health, University of Sydney; McGill University","keywords":"Causal inference; Inference; Cross-sectional study; Causality (physics); Etiology; Medicine; Psychology; Computer science; Artificial intelligence; Psychiatry; Pathology","score_opus":0.42374208400239427,"score_gpt":0.5360242416523908,"score_spread":0.11228215764999655,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318754245","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000037770635,0.0010161026,0.00010528468,0.9696609,0.028948259,0.0000045545635,0.000039031198,0.000013097337,0.00017503866],"genre_scores_gemma":[0.00073215424,0.0009589684,0.0002943795,0.91889197,0.07821764,0.000027227901,0.000018368444,0.00002490641,0.0008344357],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9800499,0.009350514,0.0022738331,0.0026856808,0.0048730304,0.00076698005],"domain_scores_gemma":[0.85538036,0.11343814,0.0041893395,0.003010044,0.019224478,0.0047576944],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.032074567,0.0017749825,0.0035210953,0.0018902671,0.0055164895,0.0059985807,0.00538263,0.05872796,0.0074578933],"category_scores_gemma":[0.19352268,0.0015679013,0.0029959322,0.0021341322,0.008855826,0.009841698,0.0026810393,0.08601798,0.007168233],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030878567,0.000009238769,0.00012434144,0.000069836424,0.000016982087,0.0001907801,0.000100647056,0.000029712679,0.000032398068,0.0013672252,0.9949851,0.0030428409],"study_design_scores_gemma":[0.00035178786,0.00006281684,0.0010624533,0.0014432273,0.00013212505,0.0019569406,0.00070993905,0.0009189848,0.00027181985,0.04396612,0.94893605,0.00018774261],"about_ca_topic_score_codex":0.008539388,"about_ca_topic_score_gemma":0.009094061,"teacher_disagreement_score":0.9679254,"about_ca_system_score_codex":0.0056143585,"about_ca_system_score_gemma":0.008047929,"threshold_uncertainty_score":0.16962856},"labels":[],"label_agreement":null},{"id":"W4318755449","doi":"10.1002/sim.9675","title":"Multistate models as a framework for estimand specification in clinical trials of complex processes","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Inference; Econometrics; Computer science; Estimator; Limiting; Statistics; Artificial intelligence; Mathematics","score_opus":0.7226251117965159,"score_gpt":0.6472965689702329,"score_spread":0.07532854282628298,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318755449","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00087273517,0.0005080752,0.99685943,0.0009761408,0.000043618882,0.000080934406,0.0000659061,0.0000678844,0.00052528107],"genre_scores_gemma":[0.17414896,0.0031999033,0.8136955,0.0015526434,0.0005875218,0.003476662,0.0004668844,0.00020045375,0.0026714657],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.89692926,0.092945494,0.002418979,0.0029343772,0.003926001,0.00084594684],"domain_scores_gemma":[0.7094476,0.26556742,0.009303296,0.011645234,0.0030907248,0.0009457379],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11208782,0.002014671,0.0035890073,0.0026505261,0.0008646473,0.004808251,0.0047101495,0.0046926565,0.004646479],"category_scores_gemma":[0.21827535,0.001727119,0.0035715695,0.0032546176,0.00483851,0.005866665,0.004561015,0.011307244,0.0008971748],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000084365216,0.000049709022,0.0009964762,0.00021428628,0.00023900777,0.00011471754,0.00032043929,0.078415826,0.00016384677,0.9010161,0.0010625223,0.017322676],"study_design_scores_gemma":[0.00007548142,0.00011245283,0.0002477564,0.00013216322,0.0000769138,0.000052793715,0.000037007827,0.20313893,0.0001736696,0.7933784,0.0025415104,0.00003283765],"about_ca_topic_score_codex":0.0028487134,"about_ca_topic_score_gemma":0.002619431,"teacher_disagreement_score":0.88791215,"about_ca_system_score_codex":0.0028835903,"about_ca_system_score_gemma":0.0051465915,"threshold_uncertainty_score":0.59278417},"labels":[],"label_agreement":null},{"id":"W4319058127","doi":"10.1002/sim.9663","title":"The Personalised Randomized Controlled Trial: Evaluation of a new trial design","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Menzies Centre for Australian Studies, King's College London, University of London; Medical Research Council Canada; King's College London; Medical Research Council; National Institute for Health and Care Research","keywords":"Randomized controlled trial; Pooling; Randomization; Computer science; Clinical trial; Ranking (information retrieval); Outcome (game theory); Medicine; Intervention (counseling); Machine learning; Artificial intelligence; Mathematics; Surgery; Psychiatry","score_opus":0.32244574998036885,"score_gpt":0.5144343715594577,"score_spread":0.19198862157908886,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319058127","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030775668,0.0062628817,0.9298763,0.0053962776,0.0026657104,0.01753636,0.0010117322,0.0010832002,0.0053918026],"genre_scores_gemma":[0.2530475,0.002133051,0.7097323,0.0031448433,0.00062478025,0.02923241,0.00043121737,0.00015917186,0.0014947176],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.64446354,0.33528474,0.0063283555,0.0072666267,0.006060037,0.0005966563],"domain_scores_gemma":[0.6228229,0.32622728,0.013488608,0.02924208,0.0060252747,0.0021938526],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.235893,0.0027677207,0.0051674494,0.0019199528,0.00066518673,0.0033235366,0.003711683,0.0065236394,0.011055361],"category_scores_gemma":[0.35405624,0.0013195003,0.0057036486,0.0018427093,0.0032545077,0.006694874,0.0036413288,0.0052721784,0.00091091363],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.12156052,0.0022410282,0.007757852,0.021125901,0.033511534,0.0005882883,0.0011599639,0.26104048,0.0016845455,0.23203933,0.009875065,0.30741543],"study_design_scores_gemma":[0.11175642,0.030297419,0.0027539607,0.0037765421,0.015534851,0.0006897585,0.00015680151,0.523579,0.0024160661,0.28676274,0.02185385,0.00042261273],"about_ca_topic_score_codex":0.00078186847,"about_ca_topic_score_gemma":0.00064619037,"teacher_disagreement_score":0.764107,"about_ca_system_score_codex":0.0028752484,"about_ca_system_score_gemma":0.0048553594,"threshold_uncertainty_score":0.94228},"labels":[],"label_agreement":null},{"id":"W4319457358","doi":"10.1016/b978-0-44-318780-3.00014-2","title":"Confounding in Cohort Studies - Part I","year":2023,"lang":"en","type":"book-chapter","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Confounding; Counterfactual thinking; Context (archaeology); Odds; Econometrics; Odds ratio; Cohort; Medicine; Statistics; Mathematics; Psychology; Logistic regression; Geography; Social psychology","score_opus":0.7893719837301452,"score_gpt":0.6362134759019756,"score_spread":0.15315850782816953,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319457358","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014640264,0.16457476,0.6211095,0.015037221,0.0059834183,0.00023364984,0.0014900869,0.0004551513,0.18965216],"genre_scores_gemma":[0.046274975,0.17841683,0.35661858,0.009915917,0.015350785,0.0010057657,0.0019878442,0.00092765654,0.38950166],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986401,0.0007888133,0.000070443304,0.00015127004,0.0003152552,0.000034059933],"domain_scores_gemma":[0.99516606,0.0042433166,0.00008785625,0.0002628312,0.00020458149,0.00003538364],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003982915,0.0009988305,0.0009283212,0.001511846,0.00039109422,0.0016617491,0.0011846189,0.0011872059,0.020213578],"category_scores_gemma":[0.0083967475,0.0006683656,0.00083275524,0.0026260342,0.0017285371,0.0023229371,0.0010814278,0.0027128044,0.0056313705],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000010066451,0.000047672893,0.00038064062,0.0008506406,0.000056284203,0.0000735453,0.00017648068,0.00200907,0.00023717493,0.7241435,0.12002129,0.15199368],"study_design_scores_gemma":[0.0000056175554,0.000009608401,0.00054393447,0.00032176165,0.000021286047,0.00013204984,0.00003584641,0.0013614707,0.00013909758,0.8045432,0.19287612,0.00001003424],"about_ca_topic_score_codex":0.0014225107,"about_ca_topic_score_gemma":0.0020941512,"teacher_disagreement_score":0.020213578,"about_ca_system_score_codex":0.0010501547,"about_ca_system_score_gemma":0.0012602961,"threshold_uncertainty_score":0.06762117},"labels":[],"label_agreement":null},{"id":"W4319457428","doi":"10.1016/b978-0-44-318780-3.00019-1","title":"Case-Control Studies - Part II","year":2023,"lang":"en","type":"book-chapter","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Confounding; Matching (statistics); Context (archaeology); Selection bias; Control (management); Selection (genetic algorithm); Population; Information bias; Cohort; Econometrics; Statistics; Computer science; Geography; Medicine; Mathematics; Artificial intelligence; Environmental health","score_opus":0.7507360780608867,"score_gpt":0.5917191175720711,"score_spread":0.15901696048881564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319457428","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025016582,0.36865628,0.283746,0.015890956,0.01106741,0.0010256798,0.0061651487,0.00039114515,0.31055573],"genre_scores_gemma":[0.046741057,0.30625275,0.18845946,0.018697675,0.01623574,0.0035515816,0.0076588937,0.000550766,0.41185203],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99796474,0.001296152,0.00009827502,0.00020047414,0.00038983047,0.000050504495],"domain_scores_gemma":[0.99417806,0.0050321305,0.0001190504,0.0003571486,0.00026766447,0.000045933222],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047524767,0.00089038705,0.0010692496,0.0022381628,0.0003417701,0.001246403,0.0016090623,0.00144675,0.044254564],"category_scores_gemma":[0.010086039,0.00065062026,0.00066947454,0.002521561,0.0011522911,0.0014545545,0.0007006253,0.0014320429,0.008059806],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000051306164,0.00016310664,0.00082556286,0.0026748187,0.00013067572,0.0002452047,0.00022189887,0.0014500761,0.00054580945,0.3350662,0.31121144,0.34741396],"study_design_scores_gemma":[0.00003608545,0.00007796903,0.0031093278,0.0018882403,0.00009298979,0.00088840997,0.0001464769,0.0012052786,0.00048511877,0.4681561,0.5238939,0.000020145042],"about_ca_topic_score_codex":0.0010478093,"about_ca_topic_score_gemma":0.0016537241,"teacher_disagreement_score":0.044254564,"about_ca_system_score_codex":0.00061930576,"about_ca_system_score_gemma":0.001063008,"threshold_uncertainty_score":0.14804631},"labels":[],"label_agreement":null},{"id":"W4319457455","doi":"10.1016/b978-0-44-318780-3.00012-9","title":"Effect Modification in Cohort Studies","year":2023,"lang":"en","type":"book-chapter","venue":"Epidemiologic Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Multivariate statistics; Context (archaeology); Cohort; Measure (data warehouse); Property (philosophy); Symmetry (geometry); Multivariate analysis; Mathematics; Econometrics; Psychology; Statistics; Computer science; Geography; Data mining; Geometry; Epistemology; Philosophy","score_opus":0.7122359460271557,"score_gpt":0.6399342536554881,"score_spread":0.07230169237166761,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319457455","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010758615,0.05723305,0.8689646,0.008851054,0.0030003542,0.00011013997,0.00071872346,0.00060265994,0.059443656],"genre_scores_gemma":[0.07319654,0.10739806,0.5925999,0.009861003,0.011197145,0.0010671116,0.0011240132,0.0009354342,0.20262076],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9971758,0.0019725494,0.00009021455,0.00027608205,0.0004493112,0.000036005535],"domain_scores_gemma":[0.9870003,0.011927371,0.0001490175,0.00064579677,0.00023026462,0.000047271766],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006568896,0.0009327173,0.0012462722,0.0012121393,0.00028693586,0.0011655472,0.0012412664,0.0011134917,0.014101457],"category_scores_gemma":[0.019473657,0.0007441002,0.0008232912,0.0017163794,0.0015567383,0.0016471933,0.0008471354,0.0027968958,0.0032143902],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021027594,0.000039954997,0.00040978266,0.00079889235,0.00014406664,0.000075659605,0.00019894073,0.002995992,0.00017494717,0.67929727,0.074513495,0.24133003],"study_design_scores_gemma":[0.000010125231,0.000012809931,0.00036615488,0.0001435577,0.000044851902,0.00007671658,0.0000186398,0.0026203683,0.000097525015,0.93535054,0.06124928,0.00000947667],"about_ca_topic_score_codex":0.0011426323,"about_ca_topic_score_gemma":0.0018287131,"teacher_disagreement_score":0.014101457,"about_ca_system_score_codex":0.00064893335,"about_ca_system_score_gemma":0.0009760481,"threshold_uncertainty_score":0.047174037},"labels":[],"label_agreement":null},{"id":"W4319790982","doi":"10.1080/03610918.2023.2170412","title":"Measurement error correction in mediation analysis under the additive hazards model","year":2023,"lang":"en","type":"article","venue":"Communications in Statistics - Simulation and Computation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Confounding; Mediation; Econometrics; Causal model; Proportional hazards model; Observational error; Set (abstract data type); Computer science; Statistics; Psychology; Mathematics; Sociology","score_opus":0.39035368825593214,"score_gpt":0.5190396433365053,"score_spread":0.12868595508057318,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319790982","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008844082,0.0016692795,0.98516303,0.0018250605,0.00043432633,0.00031134344,0.00023177273,0.00024426327,0.001276782],"genre_scores_gemma":[0.48213252,0.002797234,0.50468147,0.00198979,0.0010450088,0.0033921795,0.00061719463,0.00022702976,0.0031176056],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.83479744,0.1446127,0.0032872143,0.0072034476,0.00793537,0.0021638307],"domain_scores_gemma":[0.7242258,0.24038519,0.008596982,0.019509977,0.006586199,0.0006957415],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13303111,0.0016216655,0.0029516474,0.0030958387,0.0017480786,0.0024332185,0.005187247,0.0027132148,0.006221575],"category_scores_gemma":[0.32974714,0.0008890151,0.0042831516,0.0051756576,0.0047208397,0.0036852856,0.004518576,0.0056564235,0.0007688965],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00083361403,0.00024796536,0.026507307,0.0019503223,0.0043081027,0.0013664946,0.002790724,0.048031457,0.000992537,0.6672925,0.00710392,0.23857512],"study_design_scores_gemma":[0.00040785177,0.00054638204,0.006370057,0.0005476064,0.0012290608,0.0004879315,0.00054980867,0.17381239,0.0016957107,0.8032305,0.010971479,0.00015120207],"about_ca_topic_score_codex":0.005199636,"about_ca_topic_score_gemma":0.0026736583,"teacher_disagreement_score":0.13303111,"about_ca_system_score_codex":0.0016106725,"about_ca_system_score_gemma":0.005916734,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"grok","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W4319836254","doi":"10.1080/03610926.2023.2166790","title":"Doubly weighted mean score estimating functions with a partially observed effect modifier","year":2023,"lang":"en","type":"article","venue":"Communication in Statistics- Theory and Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; London Health Sciences Centre","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Propensity score matching; Estimator; Causal inference; Inverse probability; Observational study; Statistics; Mathematics; Confounding; Imputation (statistics); Inverse probability weighting; Missing data; Inference; Medicine; Econometrics; Computer science; Artificial intelligence; Bayesian probability; Posterior probability","score_opus":0.2590116364723314,"score_gpt":0.4956085579918074,"score_spread":0.23659692151947603,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319836254","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015964026,0.00020974361,0.9976738,0.000160471,0.000020880789,0.000034906334,0.000052232423,0.00006593912,0.00018566349],"genre_scores_gemma":[0.097442456,0.0015912156,0.89518315,0.00032836743,0.00026311039,0.0010075027,0.00057095214,0.0001145165,0.0034988006],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98757035,0.009881025,0.00034651684,0.0010605408,0.0008652939,0.00027632713],"domain_scores_gemma":[0.9423889,0.049363136,0.0022567557,0.00359952,0.002134916,0.00025682827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0238366,0.0018304861,0.003176037,0.0019739452,0.00060424645,0.0017494347,0.0035475823,0.002458103,0.0034386052],"category_scores_gemma":[0.073984995,0.0011664546,0.0036069225,0.0025197468,0.0020863267,0.0028511784,0.002499357,0.004104096,0.00095856073],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023501916,0.00015515274,0.0075354604,0.00069533376,0.00093202776,0.00044678556,0.00037031295,0.323922,0.0016426585,0.4869688,0.0040455856,0.17305087],"study_design_scores_gemma":[0.00006210161,0.00016788924,0.0012027575,0.00011908684,0.0002484787,0.0001669536,0.000037852416,0.79115444,0.00075878407,0.20170644,0.00431433,0.00006099159],"about_ca_topic_score_codex":0.0038564277,"about_ca_topic_score_gemma":0.00347172,"teacher_disagreement_score":0.0238366,"about_ca_system_score_codex":0.0011328069,"about_ca_system_score_gemma":0.0025273424,"threshold_uncertainty_score":0.1260615},"labels":[],"label_agreement":null},{"id":"W4319984852","doi":"10.31234/osf.io/hmnrx","title":"A Problem in Theory and More: Measuring the Moderating Role of Culture in Many Labs 2","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Advanced Research; University of British Columbia; York University","funders":"Canadian Institute for Advanced Research","keywords":"Replication (statistics); Sample (material); Sample size determination; Conflation; Selection (genetic algorithm); Variable (mathematics); Population; Value (mathematics); Scale (ratio); Sampling (signal processing); Research design; Psychology; Computer science; Data science; Statistics; Sociology; Geography; Epistemology; Social science; Artificial intelligence; Mathematics; Demography; Machine learning; Cartography","score_opus":0.11053391071311729,"score_gpt":0.38890621282660726,"score_spread":0.27837230211348996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319984852","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19090475,0.008591321,0.673836,0.08147863,0.006232373,0.007154042,0.0012613548,0.0007639075,0.029777544],"genre_scores_gemma":[0.7269991,0.00083256024,0.2417006,0.0150707485,0.0008617824,0.012025133,0.00031211306,0.00035462488,0.0018432479],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.33357736,0.59764004,0.017528608,0.020329162,0.028964372,0.0019604615],"domain_scores_gemma":[0.14379066,0.64318645,0.036852308,0.13943069,0.034100935,0.0026389468],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.55548614,0.0017833853,0.0029950636,0.003924825,0.007743518,0.008270596,0.006804421,0.0054205107,0.0076702326],"category_scores_gemma":[0.7643107,0.0018612852,0.004280688,0.0058656307,0.027924607,0.015222829,0.008740532,0.009461219,0.001120222],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025439726,0.0011283455,0.18475656,0.007324269,0.0068553733,0.00091170735,0.08739056,0.0044850945,0.0027799166,0.38298243,0.025453575,0.29338825],"study_design_scores_gemma":[0.0020418987,0.0056315465,0.120955385,0.0091884835,0.0045510265,0.0016920206,0.036243174,0.027190644,0.009314592,0.67432976,0.10793621,0.0009253226],"about_ca_topic_score_codex":0.008398125,"about_ca_topic_score_gemma":0.006819868,"teacher_disagreement_score":0.44451386,"about_ca_system_score_codex":0.005662131,"about_ca_system_score_gemma":0.010576001,"threshold_uncertainty_score":0.5481647},"labels":[],"label_agreement":null},{"id":"W4320502556","doi":"10.1287/mnsc.2023.02575","title":"Estimating Effects of Long-Term Treatments","year":2023,"lang":"en","type":"article","venue":"Management Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Quest University Canada","funders":"","keywords":"Term (time); Computer science; Scale (ratio); Identification (biology); Sequence (biology); Randomized experiment; Estimation; Data mining; Machine learning; Statistics; Mathematics; Engineering","score_opus":0.09925678041252671,"score_gpt":0.4329090803853109,"score_spread":0.33365229997278417,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4320502556","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27192134,0.011870066,0.6943848,0.008765887,0.0011962593,0.0014166698,0.0026531657,0.00093974837,0.006852096],"genre_scores_gemma":[0.8752661,0.0036151495,0.10836376,0.00093534763,0.0006422098,0.0016002881,0.0010067798,0.00006892116,0.008501433],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97646654,0.018700922,0.00057464873,0.0025194243,0.00084480736,0.00089355174],"domain_scores_gemma":[0.67480874,0.30724436,0.007020541,0.008419147,0.0014830458,0.0010241373],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.045692552,0.0014440508,0.003911348,0.0020923126,0.0009783426,0.0032324982,0.0039835316,0.0045419536,0.0138886385],"category_scores_gemma":[0.13503096,0.0013630547,0.003866538,0.0020878958,0.002763016,0.004561593,0.0025200285,0.006516492,0.0008742565],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013485481,0.007888568,0.061192147,0.0039154855,0.01204235,0.0005530597,0.0011676054,0.25818363,0.0020187914,0.26648903,0.008678772,0.36438507],"study_design_scores_gemma":[0.0029554563,0.0035921861,0.02355205,0.0007901004,0.006655912,0.00013433532,0.0004809458,0.35881403,0.0022234,0.5946072,0.0060130754,0.0001813647],"about_ca_topic_score_codex":0.008695282,"about_ca_topic_score_gemma":0.009935841,"teacher_disagreement_score":0.95430744,"about_ca_system_score_codex":0.0033440287,"about_ca_system_score_gemma":0.0037059796,"threshold_uncertainty_score":0.2416482},"labels":[],"label_agreement":null},{"id":"W4320723608","doi":"10.1002/cjs.11763","title":"Subgroup analysis of linear models with measurement error","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Natural Science Foundation of China","keywords":"Pairwise comparison; Estimator; Mathematics; Convergence (economics); Function (biology); Penalty method; Statistics; Estimation; Observational error; Linear regression; Applied mathematics; Mathematical optimization; Algorithm; Computer science","score_opus":0.28932988325194814,"score_gpt":0.3746780008865957,"score_spread":0.08534811763464756,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4320723608","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13087183,0.0017359714,0.86417073,0.0010243579,0.0001588021,0.00046140308,0.0004412272,0.0002882613,0.0008474306],"genre_scores_gemma":[0.91819,0.0004970286,0.07872186,0.00024409476,0.00018687214,0.0006526299,0.00044659723,0.00006629854,0.0009946001],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9627619,0.03162032,0.00090081384,0.0025134261,0.0014860176,0.0007175235],"domain_scores_gemma":[0.87443584,0.10727976,0.0055771754,0.009392274,0.0027762025,0.0005386895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.043436255,0.0010147237,0.0031264264,0.0023040103,0.0007746454,0.0013856192,0.0022710303,0.0015361718,0.0025619953],"category_scores_gemma":[0.12204648,0.00058675697,0.0038024222,0.002159589,0.0013785221,0.0016688188,0.0019054952,0.001880558,0.00018462376],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029043986,0.0005147511,0.16443086,0.0014956166,0.012023682,0.0015548837,0.0018888001,0.34037435,0.0024561945,0.19559483,0.0066800974,0.2700816],"study_design_scores_gemma":[0.0002577222,0.0005392065,0.01172049,0.00017364656,0.0018947253,0.00019956123,0.00039533945,0.724205,0.0011825676,0.25603485,0.0033185827,0.00007831186],"about_ca_topic_score_codex":0.0048351563,"about_ca_topic_score_gemma":0.003072472,"teacher_disagreement_score":0.043436255,"about_ca_system_score_codex":0.0011361144,"about_ca_system_score_gemma":0.0013605439,"threshold_uncertainty_score":0.22971565},"labels":[],"label_agreement":null},{"id":"W4320738297","doi":"10.48550/arxiv.2302.00230","title":"Revisiting the Effects of Maternal Education on Adolescents' Academic Performance: Doubly Robust Estimation in a Network-Based Observational Study","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Compute Canada","keywords":"Observational study; Estimation; Econometrics; Computer science; Statistics; Mathematics; Economics","score_opus":0.3188153627781487,"score_gpt":0.3306301684062197,"score_spread":0.011814805628071023,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4320738297","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15720701,0.0014393083,0.8353726,0.0024101075,0.00012910225,0.0002491584,0.0010842535,0.00020813834,0.001900233],"genre_scores_gemma":[0.857018,0.0010487757,0.13804781,0.0005397641,0.00021098375,0.00054278516,0.000827293,0.00005843049,0.0017061698],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9796801,0.016163936,0.00070556125,0.0020814158,0.0010301844,0.0003388725],"domain_scores_gemma":[0.8385121,0.13689901,0.010361427,0.011834346,0.0018032156,0.0005898569],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038016837,0.00066335994,0.0014385799,0.0013865728,0.0006659479,0.001772416,0.0031726572,0.0018880366,0.0023319365],"category_scores_gemma":[0.14603178,0.0006784839,0.0017460164,0.0014123241,0.002021447,0.0018265652,0.0024575642,0.0024634288,0.00025850182],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000796044,0.0006197947,0.33761263,0.0009710901,0.0044668373,0.0010930636,0.002616403,0.13886163,0.0018109991,0.35822037,0.0035006148,0.14943063],"study_design_scores_gemma":[0.00023260449,0.00054073293,0.059715364,0.000360921,0.001536061,0.00032841897,0.00053612696,0.6360297,0.001579563,0.29175186,0.0072920253,0.000096646385],"about_ca_topic_score_codex":0.014418624,"about_ca_topic_score_gemma":0.0067771007,"teacher_disagreement_score":0.038016837,"about_ca_system_score_codex":0.0009105079,"about_ca_system_score_gemma":0.0014225513,"threshold_uncertainty_score":0.20105469},"labels":[],"label_agreement":null},{"id":"W4321236346","doi":"10.1186/s12874-023-01836-5","title":"The iterative bisection procedure: a useful tool for determining parameter values in data-generating processes in Monte Carlo simulations","year":2023,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"Monte Carlo method; Bisection method; Statistic; Computer science; Binary data; Statistics; Covariate; Outcome (game theory); Range (aeronautics); Population; Binary number; Algorithm; Mathematics; Medicine","score_opus":0.8555054034787316,"score_gpt":0.6606382105781666,"score_spread":0.19486719290056498,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321236346","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005351924,0.0000442575,0.9981377,0.000052979045,0.000016087628,0.00010688149,0.000050379265,0.0006757695,0.00038073095],"genre_scores_gemma":[0.02000935,0.00010507449,0.97758526,0.000089970075,0.000027585678,0.0010482208,0.00015281324,0.0006291496,0.00035259765],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9754508,0.019910743,0.0011287236,0.00094997714,0.0023289341,0.0002307145],"domain_scores_gemma":[0.83556765,0.14503612,0.0047177095,0.007395404,0.006600362,0.00068270596],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03359545,0.0023281777,0.0017568276,0.0054830434,0.0013385932,0.0023227083,0.002745787,0.0024936479,0.010204381],"category_scores_gemma":[0.20391905,0.0016602831,0.0019155563,0.0033507245,0.002218392,0.0029238488,0.003444426,0.0060915714,0.002579975],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064017955,0.000322011,0.0050376067,0.0011202995,0.0007049225,0.0005321435,0.0016242196,0.3707792,0.0043905023,0.30015576,0.012370552,0.3023226],"study_design_scores_gemma":[0.00021596819,0.00020773358,0.0006876764,0.00033877653,0.00011266138,0.00028483436,0.000100972145,0.76560044,0.006825069,0.2072081,0.01828577,0.00013201013],"about_ca_topic_score_codex":0.0024230718,"about_ca_topic_score_gemma":0.0022521194,"teacher_disagreement_score":0.96640456,"about_ca_system_score_codex":0.0013511196,"about_ca_system_score_gemma":0.0037128842,"threshold_uncertainty_score":0.17767191},"labels":[],"label_agreement":null},{"id":"W4321473461","doi":"10.48550/arxiv.2302.09694","title":"Disentangled Representation for Causal Mediation Analysis","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; University of South Australia","keywords":"Confounding; Mediation; Latent variable; Causal inference; Econometrics; Representation (politics); Causality (physics); Observational study; Computer science; Structural equation modeling; Outcome (game theory); Affect (linguistics); Mechanism (biology); Causal model; Artificial intelligence; Machine learning; Psychology; Statistics; Mathematics","score_opus":0.4045632747980406,"score_gpt":0.34888341111123383,"score_spread":0.055679863686806774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321473461","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064801243,0.0011444618,0.990243,0.00062652427,0.00005639748,0.000047214704,0.00034216215,0.00030026564,0.00075980474],"genre_scores_gemma":[0.56457335,0.0030909094,0.42212707,0.0012699635,0.00037039656,0.0007638501,0.0024167383,0.00027062246,0.00511712],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9973175,0.0016732427,0.00011986677,0.00047391435,0.00025950721,0.00015596166],"domain_scores_gemma":[0.99322367,0.0055665714,0.00029486898,0.0005532122,0.00026603366,0.00009568311],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004437836,0.0010534443,0.0013084032,0.0011457435,0.0004312885,0.0011046018,0.0019104823,0.0014380278,0.0046233675],"category_scores_gemma":[0.01699772,0.0006253056,0.0020911032,0.0012565432,0.0010321598,0.0019421626,0.0020847626,0.003348698,0.00043923684],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038584208,0.00025473803,0.009292986,0.00085912197,0.0013352499,0.00033897226,0.00057265593,0.38878104,0.0026238689,0.20082387,0.008732238,0.38599947],"study_design_scores_gemma":[0.000039687107,0.000041988555,0.0010157691,0.000086267726,0.00013760575,0.000056821948,0.000038356095,0.8119863,0.0006671437,0.18275729,0.0031518387,0.000020925567],"about_ca_topic_score_codex":0.0059414688,"about_ca_topic_score_gemma":0.007227651,"teacher_disagreement_score":0.0059414688,"about_ca_system_score_codex":0.0010485956,"about_ca_system_score_gemma":0.0019191682,"threshold_uncertainty_score":0.023469806},"labels":[],"label_agreement":null},{"id":"W4321486913","doi":"10.1093/aje/kwad041","title":"How Choice of Effect Measure Influences Minimally Sufficient Adjustment Sets for External Validity","year":2023,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Department of Epidemiology, Biostatistics and Occupational Health, McGill University; University of North Carolina at Chapel Hill; McGill University","keywords":"Measure (data warehouse); Class (philosophy); Outcome (game theory); Scale (ratio); Population; Variable (mathematics); Statistics; Mathematics; Econometrics; Conditional probability; Medicine; Computer science; Mathematical economics; Artificial intelligence; Data mining","score_opus":0.27284504910694357,"score_gpt":0.4778967647614582,"score_spread":0.20505171565451463,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321486913","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042984083,0.0029272935,0.9319322,0.0129380645,0.00069113285,0.0011435014,0.0009005437,0.0005209557,0.0059622466],"genre_scores_gemma":[0.35224366,0.000682678,0.6393428,0.002210878,0.00043835773,0.003636726,0.00057624915,0.000315885,0.00055279204],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6712579,0.2752097,0.02373363,0.0153104905,0.012552382,0.0019359041],"domain_scores_gemma":[0.15443158,0.7886992,0.012738042,0.033738524,0.009244454,0.0011482062],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3355383,0.001736501,0.004406878,0.004321899,0.0026073311,0.006840213,0.0051548523,0.00335554,0.004655689],"category_scores_gemma":[0.7358096,0.0017448141,0.0061925435,0.003349701,0.0078020273,0.01221599,0.008350181,0.009585085,0.0005717806],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030980012,0.00055387215,0.07090785,0.0059358063,0.0085800495,0.0005559458,0.0047251815,0.024333756,0.004259963,0.572524,0.009662719,0.29486284],"study_design_scores_gemma":[0.00089574873,0.0013219862,0.02341033,0.0021386205,0.0021199398,0.0006692932,0.00085912406,0.03889487,0.0039823656,0.9130414,0.012389776,0.00027660292],"about_ca_topic_score_codex":0.0018905697,"about_ca_topic_score_gemma":0.0016563957,"teacher_disagreement_score":0.66446173,"about_ca_system_score_codex":0.0024722375,"about_ca_system_score_gemma":0.0047745225,"threshold_uncertainty_score":0.8193996},"labels":[],"label_agreement":null},{"id":"W4321611071","doi":"10.1093/biostatistics/kxad002","title":"Assessing the causal effects of a stochastic intervention in time series data: are heat alerts effective in preventing deaths and hospitalizations?","year":2023,"lang":"en","type":"review","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Institute on Minority Health and Health Disparities; National Institute of Environmental Health Sciences; Wellcome Trust; Alfred P. Sloan Foundation; National Institute on Aging; National Institutes of Health; Harvard University","keywords":"Causal inference; Estimator; Context (archaeology); Computer science; Time series; Inference; Econometrics; Series (stratigraphy); Nonparametric statistics; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.13287255036280732,"score_gpt":0.4694060812927,"score_spread":0.3365335309298927,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4321611071","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13412493,0.004516642,0.8468956,0.0073833656,0.00071975746,0.0015768786,0.001570105,0.00031099422,0.0029017872],"genre_scores_gemma":[0.8805243,0.0020090668,0.11072529,0.0012465214,0.00056479144,0.0027100965,0.0007382261,0.00003745905,0.0014442288],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95095843,0.038478322,0.0024884653,0.0050675375,0.002326513,0.0006807379],"domain_scores_gemma":[0.78782177,0.17799495,0.017797988,0.013620108,0.0019741368,0.00079112116],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.060981378,0.001123747,0.002661876,0.002381963,0.0010422375,0.0023896578,0.0032654232,0.0031940797,0.0050011124],"category_scores_gemma":[0.16534628,0.00079226843,0.0052803396,0.0031248024,0.0031829495,0.0034882743,0.0030748814,0.0038998818,0.0002972919],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023330702,0.0014171199,0.23612884,0.0051471484,0.018558795,0.00070044753,0.0012452091,0.17222014,0.0015764459,0.37641174,0.0035225265,0.18073861],"study_design_scores_gemma":[0.0011977488,0.0037564058,0.06383262,0.0013982865,0.012317438,0.00038191662,0.000875482,0.3761005,0.0034502882,0.5231094,0.013341558,0.00023841829],"about_ca_topic_score_codex":0.004548769,"about_ca_topic_score_gemma":0.0024278034,"teacher_disagreement_score":0.9390186,"about_ca_system_score_codex":0.0015256229,"about_ca_system_score_gemma":0.0031889465,"threshold_uncertainty_score":0.32250422},"labels":[],"label_agreement":null},{"id":"W4323287872","doi":"10.2196/39455","title":"Effects of Antidepressants on COVID-19 Outcomes: Retrospective Study on Large-Scale Electronic Health Record Data","year":2023,"lang":"en","type":"article","venue":"Interactive Journal of Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Center for Advancing Translational Sciences; National Institute of General Medical Sciences","keywords":"Medicine; Propensity score matching; Logistic regression; Covariate; Psychiatry; Computer science; Internal medicine; Machine learning","score_opus":0.32409114746289336,"score_gpt":0.6173604092247256,"score_spread":0.2932692617618322,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323287872","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9358555,0.0030356534,0.0035815726,0.00039784206,0.00005618043,0.00046731805,0.055055976,0.000064118525,0.0014857881],"genre_scores_gemma":[0.95086735,0.0010478884,0.0036001762,0.00033853052,0.00007674441,0.00062934915,0.043154616,0.000039433,0.00024584454],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98741174,0.0033739873,0.0035095897,0.002732733,0.0024328108,0.00053907477],"domain_scores_gemma":[0.94810957,0.015980529,0.021925217,0.008097152,0.004765034,0.0011224636],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008651842,0.00044812268,0.0009998955,0.0038175192,0.00074374146,0.0012372927,0.0010356264,0.00071400485,0.0021087734],"category_scores_gemma":[0.03580221,0.00058857846,0.0013679106,0.0074995984,0.00063332304,0.001378159,0.001638215,0.001086202,0.0005795079],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016538778,0.000050307735,0.99464583,0.00022889757,0.00042556535,0.00009408462,0.00013782183,0.00013295772,0.00008170324,0.00009525505,0.0014947485,0.002447583],"study_design_scores_gemma":[0.000046725258,0.00009183852,0.99434376,0.00022788116,0.00047644495,0.00048240673,0.00034520405,0.0009835894,0.00020728367,0.00015190948,0.0026118185,0.000031216878],"about_ca_topic_score_codex":0.012879367,"about_ca_topic_score_gemma":0.017749047,"teacher_disagreement_score":0.012879367,"about_ca_system_score_codex":0.0009110377,"about_ca_system_score_gemma":0.001683244,"threshold_uncertainty_score":0.045755863},"labels":[],"label_agreement":null},{"id":"W4323665219","doi":"10.1016/j.jclinepi.2023.03.003","title":"GRADE guidance 36: updates to GRADE's approach to addressing inconsistency","year":2023,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":120,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Ted Rogers Centre for Heart Research; University Health Network; Impact","funders":"","keywords":"Computer science; Econometrics; Medicine; Mathematics","score_opus":0.7598412327577936,"score_gpt":0.6218911550729193,"score_spread":0.13795007768487433,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4323665219","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028759497,0.12932743,0.39180773,0.17022014,0.058765896,0.09280357,0.067305066,0.018254174,0.068640135],"genre_scores_gemma":[0.014564006,0.07139707,0.75945795,0.0145927435,0.004283743,0.09321195,0.023931801,0.0047234213,0.013837358],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.653373,0.16500698,0.11215927,0.0060805124,0.059522625,0.0038575171],"domain_scores_gemma":[0.3642635,0.2573377,0.048434347,0.023517182,0.30196956,0.0044777123],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24363233,0.004588677,0.01006803,0.04601886,0.004169593,0.014691935,0.02290414,0.013162186,0.04477708],"category_scores_gemma":[0.595599,0.0072272364,0.023794776,0.025547745,0.005607943,0.008218706,0.013168623,0.019052424,0.023919115],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039153424,0.000101474485,0.00079530175,0.055215046,0.0015393224,0.00013983634,0.0011214825,0.0018245458,0.00031109437,0.015063595,0.7341167,0.18938015],"study_design_scores_gemma":[0.0014107286,0.00030388692,0.0030941635,0.098973,0.0036279047,0.000759609,0.00069044303,0.004006057,0.0013854785,0.05111494,0.8339171,0.0007167855],"about_ca_topic_score_codex":0.037930064,"about_ca_topic_score_gemma":0.02946497,"teacher_disagreement_score":0.7563677,"about_ca_system_score_codex":0.021217614,"about_ca_system_score_gemma":0.06156428,"threshold_uncertainty_score":0.932736},"labels":[],"label_agreement":null},{"id":"W4327584872","doi":"10.1177/09622802231158733","title":"Estimating individualized treatment rules in longitudinal studies with covariate-driven observation times","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; Université de Montréal","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; University of Toronto; Government of Ontario; Fonds de Recherche du Québec - Santé; Compute Canada","keywords":"Covariate; Econometrics; Longitudinal data; Statistics; Computer science; Medicine; Mathematics; Data mining","score_opus":0.7436792954420733,"score_gpt":0.6962814676362851,"score_spread":0.04739782780578827,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4327584872","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020366056,0.0003333628,0.97819513,0.00033075784,0.000029256344,0.00017625872,0.00010187879,0.0001307476,0.0003365306],"genre_scores_gemma":[0.31243333,0.0006746267,0.6835168,0.00036285323,0.00012767702,0.0013146562,0.00043321494,0.00007029751,0.0010665292],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9589452,0.032782435,0.0015930649,0.0041687638,0.0020480265,0.0004624099],"domain_scores_gemma":[0.817861,0.15789934,0.012463625,0.00937696,0.0017877657,0.00061136385],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05825569,0.00076346326,0.002765174,0.0019092943,0.0007814096,0.0021525505,0.0025466355,0.002361836,0.0013893527],"category_scores_gemma":[0.17550896,0.0013956605,0.0016027525,0.0023695808,0.0023129366,0.0027811974,0.0018486081,0.0038748167,0.00029892445],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006218962,0.00033062603,0.028721552,0.0003955117,0.0010115805,0.00023457574,0.00080790365,0.5565392,0.0010516174,0.17966332,0.0015419833,0.2290802],"study_design_scores_gemma":[0.00013019255,0.00018564684,0.0046694204,0.00010392583,0.00018030872,0.000079435726,0.00006258543,0.75367004,0.0009772341,0.23786867,0.0020198636,0.000052710162],"about_ca_topic_score_codex":0.0023531457,"about_ca_topic_score_gemma":0.0031635452,"teacher_disagreement_score":0.9417443,"about_ca_system_score_codex":0.0015092733,"about_ca_system_score_gemma":0.002386729,"threshold_uncertainty_score":0.3080892},"labels":[],"label_agreement":null},{"id":"W4327973727","doi":"10.3390/a16030166","title":"Framework for Evaluating Potential Causes of Health Risk Factors Using Average Treatment Effect and Uplift Modelling","year":2023,"lang":"en","type":"article","venue":"Algorithms","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Humber Polytechnic; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Causation; Counterfactual thinking; Logistic regression; Statistics; Computer science; Econometrics; Psychology; Machine learning; Mathematics; Social psychology","score_opus":0.313532333990839,"score_gpt":0.4935268919504549,"score_spread":0.1799945579596159,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4327973727","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051526586,0.0005366183,0.99101454,0.0010707019,0.00006179234,0.00012998207,0.00045732883,0.00018672043,0.0013897326],"genre_scores_gemma":[0.41385233,0.0022814677,0.5702114,0.0009350786,0.0005917845,0.0022292081,0.0018967325,0.00016843146,0.007833433],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9934418,0.0041002766,0.0003243266,0.001005665,0.0007725993,0.0003552618],"domain_scores_gemma":[0.9712052,0.024937933,0.0015266207,0.000750929,0.0011203983,0.0004589221],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015914058,0.0018704319,0.003086728,0.0039068046,0.00086338446,0.002777674,0.0048109326,0.0033152057,0.007113941],"category_scores_gemma":[0.03808649,0.001208045,0.004139946,0.0024074845,0.0025141228,0.002296396,0.0033480313,0.0033318885,0.0006188331],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009453631,0.00009748244,0.004131134,0.00021599024,0.0003326216,0.0002461044,0.00015409327,0.7710939,0.00024392737,0.19992523,0.0011036174,0.02236135],"study_design_scores_gemma":[0.000027556027,0.000044292963,0.00033884333,0.000038519443,0.00008330752,0.000045752087,0.000021872329,0.894126,0.00007998597,0.10374777,0.001426619,0.000019431402],"about_ca_topic_score_codex":0.01919862,"about_ca_topic_score_gemma":0.010666707,"teacher_disagreement_score":0.01919862,"about_ca_system_score_codex":0.0024743502,"about_ca_system_score_gemma":0.004277851,"threshold_uncertainty_score":0.08416253},"labels":[],"label_agreement":null},{"id":"W4328050658","doi":"10.1093/jrsssb/qkad008","title":"Causal inference on distribution functions","year":2023,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series B (Statistical Methodology)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Causal inference; Euclidean space; Inference; Estimator; Space (punctuation); Contrast (vision); National Health and Nutrition Examination Survey; Econometrics; Computer science; Distribution (mathematics); Mathematics; Artificial intelligence; Statistics; Medicine; Pure mathematics","score_opus":0.2592960580704786,"score_gpt":0.46122099857806853,"score_spread":0.2019249405075899,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4328050658","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007591861,0.0005618736,0.9882311,0.0011150765,0.000066927016,0.000060691134,0.0002790669,0.00010114577,0.00199218],"genre_scores_gemma":[0.6255281,0.0042070965,0.3567444,0.0014196027,0.0011083124,0.0010756612,0.0012980298,0.00020996638,0.008408919],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97885203,0.014476505,0.0007027253,0.0028952209,0.0023948904,0.0006786833],"domain_scores_gemma":[0.79889286,0.18237032,0.006200633,0.008014698,0.0037877676,0.00073382567],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04045473,0.0013461418,0.002533966,0.0051340233,0.0011458473,0.0031905684,0.0032397336,0.0030222551,0.008456736],"category_scores_gemma":[0.1668147,0.0009951082,0.0027360076,0.0041277106,0.0069170226,0.0071218736,0.003931245,0.0059155873,0.0007864374],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029710154,0.00004036356,0.002705249,0.0001412443,0.00014325924,0.00013628627,0.00020743812,0.046687838,0.00014540856,0.9284041,0.00116182,0.020197354],"study_design_scores_gemma":[0.000017613633,0.000017650558,0.00071003224,0.000068725385,0.000030315296,0.0000579147,0.00004266788,0.13869764,0.00013223864,0.85864896,0.0015588164,0.000017417842],"about_ca_topic_score_codex":0.0072377785,"about_ca_topic_score_gemma":0.0030521355,"teacher_disagreement_score":0.04045473,"about_ca_system_score_codex":0.002871314,"about_ca_system_score_gemma":0.002164458,"threshold_uncertainty_score":0.2139476},"labels":[],"label_agreement":null},{"id":"W4360868772","doi":"10.31235/osf.io/kwscz","title":"Causal Mediation in Panel Data – Estimation Based on Difference in Differences","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Mediation; Exploit; Panel data; Mediator; Econometrics; Causal inference; Estimation; Treatment effect; Difference in differences; Computer science; Estimator; Psychology; Economics; Statistics; Mathematics; Medicine; Political science; Computer security","score_opus":0.4632158906435771,"score_gpt":0.4587096673121481,"score_spread":0.004506223331429027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4360868772","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009540121,0.00039284345,0.9866327,0.0008159199,0.00014230111,0.00026512254,0.0005059173,0.00025846285,0.0014465733],"genre_scores_gemma":[0.48944393,0.001320268,0.49687463,0.0012561524,0.0007312416,0.0030145359,0.0021201517,0.00018092572,0.0050581517],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9659453,0.027397627,0.00095719635,0.0030989628,0.0017957584,0.00080508366],"domain_scores_gemma":[0.8626428,0.1162637,0.0056052776,0.013140001,0.0017369043,0.00061135506],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03859143,0.0012419896,0.0025805766,0.0026893534,0.0012448101,0.002377996,0.0039583202,0.002070212,0.014232162],"category_scores_gemma":[0.13093515,0.0011941718,0.0035709129,0.003657498,0.0023704185,0.00328386,0.0038071426,0.0050536576,0.0012035564],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029799875,0.00047068423,0.036791246,0.0007467678,0.0029351404,0.00051608396,0.0010503221,0.04104916,0.0009427947,0.7711091,0.00530906,0.13878176],"study_design_scores_gemma":[0.00027104229,0.00020599231,0.00524498,0.00012289341,0.00066099217,0.00015790726,0.00017498854,0.15792663,0.001233294,0.82632506,0.007603052,0.000073194846],"about_ca_topic_score_codex":0.004541576,"about_ca_topic_score_gemma":0.0036457877,"teacher_disagreement_score":0.03859143,"about_ca_system_score_codex":0.0011772861,"about_ca_system_score_gemma":0.0026706515,"threshold_uncertainty_score":0.2040934},"labels":[],"label_agreement":null},{"id":"W4361194307","doi":"10.48550/arxiv.2303.15281","title":"Bayesian inference for optimal dynamic treatment regimes in practice","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Bayesian probability; Computer science; Inference; Bayesian inference; Machine learning; Estimator; Population; Artificial intelligence; Mathematics; Statistics; Medicine","score_opus":0.26532153320503576,"score_gpt":0.35121575966666563,"score_spread":0.08589422646162986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4361194307","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031004746,0.0008448239,0.99181056,0.0012404353,0.000059208225,0.00014476104,0.00022878556,0.00018130317,0.00238956],"genre_scores_gemma":[0.23980549,0.0036684386,0.74385077,0.001801575,0.0006158942,0.002289225,0.0013035111,0.00039371822,0.0062713576],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9711537,0.020867446,0.0009559194,0.0037373628,0.0025610253,0.0007245029],"domain_scores_gemma":[0.8307322,0.15783814,0.004335619,0.0038756658,0.0025847063,0.00063364394],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.050563492,0.0023930066,0.0054187574,0.004517729,0.0014198459,0.006054026,0.005171807,0.0048948424,0.011915448],"category_scores_gemma":[0.20272829,0.002985891,0.0030759766,0.004060697,0.0060382765,0.009107804,0.004290102,0.009874941,0.0018367295],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013965649,0.00010556192,0.0027951794,0.00048637966,0.0004088681,0.0001426819,0.00041025376,0.39224157,0.00016368159,0.54377097,0.004361352,0.0549738],"study_design_scores_gemma":[0.00007739799,0.000033846747,0.0004247324,0.00020789611,0.000047554913,0.000038913295,0.000046070967,0.46144363,0.000115576564,0.53461725,0.002907366,0.00003972596],"about_ca_topic_score_codex":0.013334931,"about_ca_topic_score_gemma":0.011967749,"teacher_disagreement_score":0.050563492,"about_ca_system_score_codex":0.0058466615,"about_ca_system_score_gemma":0.004603863,"threshold_uncertainty_score":0.26740855},"labels":[],"label_agreement":null},{"id":"W4361290027","doi":"10.1002/ece3.9947","title":"Reducing bias in experimental ecology through directed acyclic graphs","year":2023,"lang":"en","type":"review","venue":"Ecology and Evolution","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Causal inference; Directed acyclic graph; Computer science; Causal model; Set (abstract data type); Inference; Observational study; Process (computing); Data science; Ecology; Causal structure; Confounding; Artificial intelligence; Econometrics; Algorithm; Mathematics; Biology","score_opus":0.2738438791699867,"score_gpt":0.4631142801097817,"score_spread":0.18927040093979497,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4361290027","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023283667,0.3478785,0.6113161,0.014179087,0.0018088156,0.0009369561,0.0010265112,0.00094277906,0.019582896],"genre_scores_gemma":[0.09360064,0.42052972,0.46743235,0.007176987,0.002151215,0.004259564,0.00087493693,0.00041439562,0.0035601854],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95494986,0.03772998,0.0016544147,0.0019380659,0.0035139383,0.00021372006],"domain_scores_gemma":[0.71908987,0.26597708,0.005451121,0.005849879,0.0032340682,0.00039798085],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.050962057,0.0018406861,0.0025376917,0.0062007424,0.0008978645,0.0031721115,0.0039051257,0.003095877,0.008849073],"category_scores_gemma":[0.12927058,0.0012019697,0.0027833686,0.0052530724,0.006779036,0.005338737,0.00249454,0.0046648434,0.0012352954],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001537378,0.00007184631,0.00078204984,0.020730415,0.0009144658,0.0001120482,0.0004340354,0.01688046,0.00029792121,0.45108655,0.011165235,0.49737126],"study_design_scores_gemma":[0.0001641287,0.00011724815,0.00073846895,0.00908545,0.0005733169,0.00017697312,0.0001098366,0.008733123,0.00062177255,0.8777431,0.10186579,0.00007068248],"about_ca_topic_score_codex":0.0027492086,"about_ca_topic_score_gemma":0.0031952246,"teacher_disagreement_score":0.94903797,"about_ca_system_score_codex":0.0040132767,"about_ca_system_score_gemma":0.0052810535,"threshold_uncertainty_score":0.26951635},"labels":[],"label_agreement":null},{"id":"W4362601896","doi":"10.1002/bimj.202100359","title":"Monte Carlo sensitivity analysis for unmeasured confounding in dynamic treatment regimes","year":2023,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health","keywords":"Observational study; Monte Carlo method; Confounding; Sensitivity (control systems); Econometrics; Computer science; Sample size determination; Statistics; Probabilistic logic; Mathematics; Artificial intelligence; Engineering","score_opus":0.34084260410379097,"score_gpt":0.48306422044279523,"score_spread":0.14222161633900426,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4362601896","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011538032,0.0009399002,0.9827557,0.0010514524,0.00011029487,0.00071662833,0.0002755055,0.00018702587,0.0024254809],"genre_scores_gemma":[0.6193433,0.0018162818,0.3693022,0.0014329778,0.0002651615,0.003928912,0.0004772768,0.00015483513,0.0032790042],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9309446,0.061691508,0.0012606308,0.0028919778,0.0024001955,0.0008110868],"domain_scores_gemma":[0.5573575,0.42551845,0.006433159,0.007124312,0.002998897,0.0005676858],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.097885296,0.0018144111,0.0035525006,0.0038827958,0.0016055807,0.0032720647,0.0031352607,0.003287825,0.0081969295],"category_scores_gemma":[0.25585762,0.001375194,0.004770506,0.002724852,0.0039095427,0.0035396835,0.0042668846,0.0059305127,0.0003761395],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046747606,0.00015330281,0.007313707,0.00052341504,0.0014385127,0.00053724024,0.00040538138,0.69727683,0.0004428094,0.2507117,0.0021313329,0.038598258],"study_design_scores_gemma":[0.00014072559,0.00011787547,0.0012961184,0.00019495453,0.00030363642,0.00012844568,0.00006669549,0.7809729,0.00036450202,0.21426497,0.002084928,0.00006424793],"about_ca_topic_score_codex":0.008514177,"about_ca_topic_score_gemma":0.0047663497,"teacher_disagreement_score":0.9021147,"about_ca_system_score_codex":0.0041451845,"about_ca_system_score_gemma":0.004022736,"threshold_uncertainty_score":0.51767313},"labels":[],"label_agreement":null},{"id":"W4365459023","doi":"10.1002/sim.9727","title":"Causal inference with longitudinal data subject to irregular assessment times","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Inference; Subject (documents); Computer science; Longitudinal data; Statistics; Econometrics; Statistical inference; Artificial intelligence; Mathematics; Data mining","score_opus":0.21944373833936742,"score_gpt":0.5103172274469393,"score_spread":0.2908734891075719,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4365459023","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029566465,0.00033755696,0.96820974,0.0006636418,0.000046798126,0.00008815279,0.0001888025,0.00015996711,0.0007388608],"genre_scores_gemma":[0.5357679,0.0009439046,0.45820135,0.00030861387,0.00020626566,0.0007215538,0.0007843283,0.000120394725,0.0029456343],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9787709,0.016322711,0.0008027936,0.0022054857,0.0013722782,0.0005259359],"domain_scores_gemma":[0.7797603,0.19591095,0.009590052,0.011669123,0.002282175,0.0007875099],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.067806885,0.00083703216,0.0019693784,0.002473008,0.0011027273,0.0021265622,0.0030941954,0.0020697666,0.0030282352],"category_scores_gemma":[0.19418086,0.0012182692,0.0026164379,0.0033772113,0.0027695824,0.004694643,0.0035931293,0.0041376525,0.0003130008],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047941055,0.0001996864,0.030563364,0.0003437915,0.00067904766,0.0007955087,0.0014816143,0.35107532,0.00062219356,0.49458537,0.001515408,0.11765921],"study_design_scores_gemma":[0.00010212562,0.00008131735,0.00235659,0.000057928522,0.00008956278,0.0001420513,0.0001411075,0.58699536,0.000386141,0.40784582,0.001767133,0.000034866986],"about_ca_topic_score_codex":0.010186693,"about_ca_topic_score_gemma":0.007196274,"teacher_disagreement_score":0.067806885,"about_ca_system_score_codex":0.001824857,"about_ca_system_score_gemma":0.002636122,"threshold_uncertainty_score":0.3586014},"labels":[],"label_agreement":null},{"id":"W4366238420","doi":"10.1007/s12325-023-02503-3","title":"The Role of Expert Opinion in Projecting Long-Term Survival Outcomes Beyond the Horizon of a Clinical Trial","year":2023,"lang":"en","type":"article","venue":"Advances in Therapy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"Defense Acquisition Program Administration; AstraZeneca","keywords":"Frequentist inference; Medicine; Bayesian probability; Expert opinion; Population; Survival analysis; Placebo; Relative survival; Statistics; Bayesian inference; Internal medicine; Intensive care medicine; Mathematics","score_opus":0.26403437545403435,"score_gpt":0.5460801964420338,"score_spread":0.2820458209879994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366238420","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28353783,0.0054969313,0.6790518,0.009406885,0.00021728098,0.0008050564,0.0011000324,0.00031859113,0.02006562],"genre_scores_gemma":[0.87126917,0.0008398717,0.12596464,0.00088048686,0.00014359647,0.00031993634,0.00030321025,0.00003436384,0.0002446953],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79067934,0.18912722,0.0045264005,0.0051271133,0.009364776,0.0011751904],"domain_scores_gemma":[0.31384593,0.6434232,0.020724354,0.00896019,0.011458127,0.0015882672],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17087755,0.0011465952,0.0011373346,0.0034060278,0.0008506395,0.003993723,0.0014533243,0.0021041278,0.0019689333],"category_scores_gemma":[0.40851095,0.00066708395,0.0017060685,0.001780237,0.001904179,0.0048633493,0.0037603942,0.002105046,0.0003803148],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004175043,0.00036699127,0.2106822,0.00434236,0.0030921777,0.00046350338,0.009252594,0.13012466,0.002937521,0.029675085,0.0050903265,0.5997975],"study_design_scores_gemma":[0.00061079086,0.0016755402,0.090685695,0.004461143,0.0017219975,0.00067912595,0.0032096684,0.71836597,0.004544888,0.1622995,0.011258715,0.00048699282],"about_ca_topic_score_codex":0.0032196916,"about_ca_topic_score_gemma":0.003680897,"teacher_disagreement_score":0.8291224,"about_ca_system_score_codex":0.002155254,"about_ca_system_score_gemma":0.0030620699,"threshold_uncertainty_score":0.9036976},"labels":[],"label_agreement":null},{"id":"W4366590256","doi":"10.1186/s12874-023-01922-8","title":"Data source profile reporting by studies that use routinely collected health data to explore the effects of drug treatment","year":2023,"lang":"en","type":"review","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St. Joseph’s Healthcare Hamilton; Impact","funders":"West China Hospital, Sichuan University; National Key Research and Development Program of China; Sichuan University; National Natural Science Foundation of China","keywords":"Medicine; Credibility; Observational study; MEDLINE; Data source; Database; Record linkage; Family medicine; Internal medicine; Computer science; Environmental health; Population","score_opus":0.987954653323306,"score_gpt":0.7701015603537543,"score_spread":0.2178530929695517,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366590256","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.079642594,0.62792665,0.061660994,0.019254817,0.003928389,0.026842995,0.16537683,0.0005864124,0.014780352],"genre_scores_gemma":[0.48946753,0.2116138,0.11874638,0.014850605,0.0018515881,0.09093846,0.07016995,0.0006071786,0.0017545035],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.36595067,0.20573708,0.36133736,0.016974213,0.047924142,0.0020766172],"domain_scores_gemma":[0.10818095,0.57813627,0.22659247,0.045079257,0.04087601,0.0011351425],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27054715,0.002122953,0.0061469325,0.033360887,0.001985609,0.0075310827,0.0045657563,0.0037352373,0.0056025293],"category_scores_gemma":[0.69570434,0.0023031402,0.009897105,0.043807443,0.0034532675,0.008855103,0.007093778,0.0029181687,0.0010990896],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019611944,0.00010650456,0.15345035,0.6780802,0.038509227,0.0005361434,0.0072220294,0.0009710774,0.0012295305,0.006965267,0.018602079,0.09236642],"study_design_scores_gemma":[0.0013390398,0.0006791766,0.10835756,0.6692608,0.065486446,0.002129436,0.0071216114,0.0015740945,0.0053879535,0.015386009,0.122463934,0.00081390166],"about_ca_topic_score_codex":0.0073655886,"about_ca_topic_score_gemma":0.007381975,"teacher_disagreement_score":0.72945285,"about_ca_system_score_codex":0.005096899,"about_ca_system_score_gemma":0.015916852,"threshold_uncertainty_score":0.89954525},"labels":[],"label_agreement":null},{"id":"W4366992020","doi":"10.1001/jama.2023.4221","title":"Emulation of Randomized Clinical Trials With Nonrandomized Database Analyses","year":2023,"lang":"en","type":"article","venue":"JAMA","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":379,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Arthritis and Musculoskeletal and Skin Diseases; National Institute on Aging; National Heart, Lung, and Blood Institute; U.S. Food and Drug Administration","keywords":"Medicine; Emulation; Randomized controlled trial; Clinical trial; MEDLINE; Database; Internal medicine","score_opus":0.5650319051167182,"score_gpt":0.5950935289172615,"score_spread":0.030061623800543336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4366992020","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014368896,0.00275161,0.9214587,0.0039144643,0.0023846983,0.045827378,0.0025058198,0.001653215,0.005135189],"genre_scores_gemma":[0.1919209,0.0007741176,0.70334643,0.0031681568,0.00069092377,0.09758791,0.0013917435,0.0002656845,0.00085412787],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.09806203,0.8091662,0.049102254,0.020365579,0.022211784,0.0010921258],"domain_scores_gemma":[0.058610998,0.7818273,0.0465089,0.09988521,0.012200734,0.0009669637],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.77914226,0.004099497,0.008361276,0.008248789,0.0018037698,0.010270599,0.0081590805,0.007070943,0.012400579],"category_scores_gemma":[0.89271414,0.0039123977,0.0153033,0.007906293,0.010177384,0.012023976,0.0082153175,0.008251142,0.0027500156],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.032943793,0.001999385,0.068824284,0.029042397,0.055734932,0.0013475971,0.007038959,0.12951823,0.0024447567,0.26444182,0.029214265,0.37744954],"study_design_scores_gemma":[0.019887164,0.011914762,0.023639025,0.013816531,0.016384633,0.0011894576,0.0011113778,0.43124625,0.010829551,0.36907345,0.09999783,0.0009099571],"about_ca_topic_score_codex":0.00078046456,"about_ca_topic_score_gemma":0.0006301482,"teacher_disagreement_score":0.22085774,"about_ca_system_score_codex":0.006197435,"about_ca_system_score_gemma":0.008162488,"threshold_uncertainty_score":0.272357},"labels":[],"label_agreement":null},{"id":"W4367338397","doi":"10.51387/23-nejsds29","title":"General Additive Network Effect Models","year":2023,"lang":"en","type":"article","venue":"The New England Journal of Statistics in Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Estimator; Inference; Specification; Outcome (game theory); Computer science; Network model; Range (aeronautics); Power (physics); Mathematical optimization; Mathematics; Artificial intelligence; Statistics; Engineering; Machine learning; Mathematical economics","score_opus":0.17173287554959368,"score_gpt":0.4322849311017763,"score_spread":0.26055205555218264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4367338397","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0091976235,0.0016421066,0.9712877,0.0020096384,0.00025408797,0.0007274257,0.0042803385,0.0007169845,0.009884069],"genre_scores_gemma":[0.44393998,0.008233017,0.4451031,0.0034520822,0.0012491875,0.009193555,0.0067366282,0.0005383485,0.08155409],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98428047,0.009662603,0.0006817787,0.0032303007,0.0013655549,0.00077923515],"domain_scores_gemma":[0.96018267,0.03127508,0.00320862,0.0031566345,0.0016720387,0.0005049481],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02223228,0.004104285,0.004500605,0.003859695,0.00104252,0.0041823415,0.0083295135,0.0055376007,0.03328589],"category_scores_gemma":[0.047209326,0.0017291526,0.0048362277,0.004667594,0.0033430133,0.006727892,0.003436735,0.004930388,0.0070266654],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021292483,0.00019182444,0.002765501,0.0006353507,0.00051730155,0.00032694134,0.00044582275,0.13537866,0.0005175093,0.8164545,0.007125193,0.035428405],"study_design_scores_gemma":[0.00020586024,0.0001877413,0.0012039008,0.00016144277,0.00035185218,0.00021590228,0.00010847887,0.29304233,0.00023482642,0.68943447,0.014783761,0.000069388014],"about_ca_topic_score_codex":0.008691773,"about_ca_topic_score_gemma":0.007643634,"teacher_disagreement_score":0.03328589,"about_ca_system_score_codex":0.0031823975,"about_ca_system_score_gemma":0.001846053,"threshold_uncertainty_score":0.11757696},"labels":[],"label_agreement":null},{"id":"W4372185084","doi":"10.1002/pds.5635","title":"A review of the use of propensity score methods with multiple treatment groups in the general internal medicine literature","year":2023,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Western Hospital; North York General Hospital; Sunnybrook Health Science Centre; NOSM University; Health Sciences Centre; University Health Network; Health Sciences North; University of Toronto","funders":"","keywords":"Propensity score matching; Medicine; Confounding; Inverse probability weighting; MEDLINE; Covariate; Pairwise comparison; Weighting; Statistics; Internal medicine; Mathematics","score_opus":0.5643266496882013,"score_gpt":0.5568337737406952,"score_spread":0.007492875947506139,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4372185084","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00022276341,0.99840754,0.00029094366,0.0005160157,0.00013751256,0.000058166643,0.00009205122,0.0000063118973,0.00026868502],"genre_scores_gemma":[0.0022165335,0.9958924,0.0009907115,0.0005125568,0.00012939687,0.0001227451,0.00008880943,0.000005102234,0.000041705756],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9753466,0.009945967,0.009276162,0.0014536208,0.0036261834,0.000351419],"domain_scores_gemma":[0.8462391,0.13017675,0.013833338,0.0016239824,0.0075386916,0.0005881355],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.029229226,0.0014808923,0.0052297944,0.035127647,0.0009178122,0.0035733534,0.0029032035,0.0024664996,0.004649987],"category_scores_gemma":[0.0974447,0.0014238477,0.006647382,0.035137918,0.0015857846,0.0037334987,0.0023870743,0.00193011,0.0006133123],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015403592,0.000035108867,0.0013826436,0.63712525,0.0028550564,0.00020531709,0.00066827633,0.00025375217,0.00018525375,0.0017969433,0.0074831555,0.34785524],"study_design_scores_gemma":[0.000081464495,0.00014735216,0.0050991117,0.8862704,0.011511443,0.00077048276,0.00040837907,0.00014415497,0.00016631233,0.0013295708,0.094015,0.000056320474],"about_ca_topic_score_codex":0.00664981,"about_ca_topic_score_gemma":0.015365089,"teacher_disagreement_score":0.9707708,"about_ca_system_score_codex":0.0048873415,"about_ca_system_score_gemma":0.013154056,"threshold_uncertainty_score":0.15458077},"labels":[],"label_agreement":null},{"id":"W4375951527","doi":"10.1093/infdis/jiad144","title":"Causal Inference and Confounding: A Primer for Interpreting and Conducting Infectious Disease Research","year":2023,"lang":"en","type":"article","venue":"The Journal of Infectious Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Causal inference; Confounding; Inference; Infectious disease (medical specialty); Primer (cosmetics); Medicine; Disease; Biology; Computational biology; Virology; Computer science; Internal medicine; Artificial intelligence; Pathology; Chemistry","score_opus":0.2707588557568666,"score_gpt":0.498521321367356,"score_spread":0.2277624656104894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4375951527","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003330616,0.004067501,0.98629284,0.0071870475,0.00027700065,0.00018531014,0.00010490373,0.00012024668,0.0014320792],"genre_scores_gemma":[0.0269331,0.0053232824,0.9613071,0.0027568645,0.0009894852,0.0014276329,0.00012427926,0.00012550366,0.0010128913],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8444628,0.13847062,0.005904094,0.00446744,0.005949932,0.00074515713],"domain_scores_gemma":[0.51981854,0.45638043,0.006237396,0.011260034,0.0053209104,0.0009826699],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15827392,0.0031912602,0.00551154,0.008683544,0.0030313144,0.011940462,0.008202037,0.009079776,0.00718619],"category_scores_gemma":[0.28031757,0.0031409005,0.0065942276,0.007398285,0.023061574,0.011353351,0.0066626985,0.020108823,0.0013534809],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004970299,0.00007406642,0.0012396477,0.0010553921,0.00040947917,0.00033933014,0.0020144777,0.007104378,0.00028968987,0.94084704,0.0042146654,0.042362243],"study_design_scores_gemma":[0.000037713973,0.000021685895,0.00017864355,0.00034759467,0.00008318478,0.00019605321,0.00018134032,0.007481638,0.00019422684,0.9811085,0.010131092,0.000038525468],"about_ca_topic_score_codex":0.008776267,"about_ca_topic_score_gemma":0.007041102,"teacher_disagreement_score":0.84172606,"about_ca_system_score_codex":0.0045651384,"about_ca_system_score_gemma":0.013144039,"threshold_uncertainty_score":0.8370425},"labels":[],"label_agreement":null},{"id":"W4376271032","doi":"10.1093/jrsssc/qlad034","title":"The impact of directly observed therapy on the efficacy of Tuberculosis treatment: a Bayesian multilevel approach","year":2023,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series C (Applied Statistics)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Propensity score matching; Covariate; Confounding; Multilevel model; Econometrics; Bayesian probability; Random effects model; Causal inference; Outcome (game theory); Statistics; Psychology; Mathematics; Medicine; Meta-analysis; Internal medicine","score_opus":0.12054633364644328,"score_gpt":0.3744787153095136,"score_spread":0.2539323816630703,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376271032","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033446133,0.0016378646,0.95585346,0.0047280053,0.00011493146,0.00021872814,0.0005986553,0.00015076452,0.0032514667],"genre_scores_gemma":[0.7114818,0.0021149686,0.28001145,0.0012103675,0.0005282903,0.00081418705,0.000477758,0.00011178307,0.003249349],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96296793,0.03038077,0.0008662838,0.0024977326,0.0024074698,0.00087984407],"domain_scores_gemma":[0.8640771,0.120693915,0.006701138,0.005124117,0.0023552063,0.0010485462],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04262423,0.0007398056,0.0026928035,0.0020520927,0.00090435584,0.0025301762,0.0033944678,0.002892945,0.009324678],"category_scores_gemma":[0.12580861,0.001177104,0.0037963362,0.0017195139,0.0025622572,0.0023892156,0.004963599,0.0043581137,0.00057039835],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008915195,0.00036883235,0.02980103,0.00087112485,0.0032074216,0.00056268193,0.000860884,0.21680883,0.001553351,0.60167044,0.0033719845,0.14003186],"study_design_scores_gemma":[0.0002815916,0.00028712442,0.009263365,0.000406348,0.0013619023,0.00014625689,0.00008706512,0.60814375,0.0007460869,0.3753068,0.0038861143,0.00008356817],"about_ca_topic_score_codex":0.00877054,"about_ca_topic_score_gemma":0.007664471,"teacher_disagreement_score":0.04262423,"about_ca_system_score_codex":0.0023288545,"about_ca_system_score_gemma":0.002528528,"threshold_uncertainty_score":0.22542119},"labels":[],"label_agreement":null},{"id":"W4376470507","doi":"10.51744/cip8","title":"Using data differently and using different data","year":2018,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Identification (biology); Relevance (law); Computer science; Machine learning; Randomized experiment; Data mining; Data science; Risk analysis (engineering); Artificial intelligence; Mathematics; Statistics","score_opus":0.8815217562498705,"score_gpt":0.5958172277224624,"score_spread":0.28570452852740813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376470507","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.039472498,0.010620653,0.85015243,0.062272187,0.0035289773,0.0028567468,0.0065699033,0.00041052967,0.024116024],"genre_scores_gemma":[0.32024762,0.0061304145,0.63206625,0.020651799,0.0015635695,0.008468767,0.0055638407,0.00063108286,0.004676614],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.46746275,0.45101938,0.022916533,0.018695148,0.038287062,0.0016191378],"domain_scores_gemma":[0.3500996,0.4635132,0.026841093,0.14114383,0.017259944,0.0011423874],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2788585,0.0022472676,0.0038374513,0.0061039086,0.0037315378,0.016426075,0.006349734,0.0077526057,0.0061381734],"category_scores_gemma":[0.5835504,0.0018141485,0.0044420045,0.0136670135,0.014524278,0.02074247,0.00898258,0.013689002,0.0022115284],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006051557,0.00041329433,0.027751718,0.0044679632,0.0028129367,0.00047174635,0.005973886,0.010140319,0.0018298526,0.7183919,0.015189862,0.21195136],"study_design_scores_gemma":[0.00028900747,0.000271002,0.013110883,0.004386077,0.0009998505,0.0006341212,0.0029291296,0.011763161,0.004298114,0.864135,0.09678288,0.00040066513],"about_ca_topic_score_codex":0.0043718945,"about_ca_topic_score_gemma":0.0034826281,"teacher_disagreement_score":0.2788585,"about_ca_system_score_codex":0.005756419,"about_ca_system_score_gemma":0.0055548903,"threshold_uncertainty_score":0.8892958},"labels":[],"label_agreement":null},{"id":"W4376637825","doi":"10.1515/ijb-2022-0073","title":"Bayesian inference for optimal dynamic treatment regimes in practice","year":2023,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Inference; Bayesian inference; Bayesian probability; Frequentist inference; Biostatistics; Econometrics; Estimator; Machine learning; Computer science; Artificial intelligence; Mathematics; Statistics; Medicine","score_opus":0.22417419034281136,"score_gpt":0.5431292370587046,"score_spread":0.31895504671589325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376637825","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045812,0.00062844524,0.9900746,0.0012165604,0.000051248026,0.00016397053,0.00024510163,0.00021529772,0.0028234427],"genre_scores_gemma":[0.3479912,0.0023476493,0.63685566,0.0017416326,0.00042192996,0.00217598,0.0012897518,0.0003752411,0.006801018],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9627854,0.027059596,0.0011615872,0.0051990035,0.0028364283,0.0009579061],"domain_scores_gemma":[0.84834623,0.13820405,0.004607168,0.005121014,0.0030033914,0.0007180651],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.049635272,0.0015354325,0.0048366846,0.0035581547,0.0012253457,0.0051410524,0.004299535,0.0042453026,0.012584865],"category_scores_gemma":[0.21459825,0.0022128366,0.0029499107,0.0033613848,0.005511315,0.0073215165,0.0038841502,0.008633748,0.0019076876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020997168,0.00015480083,0.0034830072,0.0004119215,0.0004411945,0.00014103824,0.00040424615,0.34858498,0.00022845353,0.5649707,0.005487802,0.075481944],"study_design_scores_gemma":[0.000089899855,0.00003837963,0.0006364834,0.00022831932,0.000058329766,0.00003966513,0.000046634363,0.44929877,0.00017818378,0.5461238,0.003225429,0.000036116748],"about_ca_topic_score_codex":0.010229823,"about_ca_topic_score_gemma":0.007646862,"teacher_disagreement_score":0.049635272,"about_ca_system_score_codex":0.0050520347,"about_ca_system_score_gemma":0.0042707804,"threshold_uncertainty_score":0.26249957},"labels":[],"label_agreement":null},{"id":"W4376654146","doi":"10.48550/arxiv.2305.08651","title":"Methodological considerations for novel approaches to covariate-adjusted indirect treatment comparisons","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Econometrics; Robustness (evolution); Weighting; Outcome (game theory); Computer science; Extrapolation; Context (archaeology); Statistics; Mathematics; Medicine; Geography","score_opus":0.95394451213457,"score_gpt":0.4139994722693762,"score_spread":0.5399450398651937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376654146","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007023306,0.00091602094,0.9898606,0.0064836727,0.00034931855,0.00047305995,0.00014073851,0.00011417925,0.0009600211],"genre_scores_gemma":[0.03254309,0.0008784762,0.9544427,0.0042586303,0.000690495,0.0059313206,0.00016757219,0.0001827032,0.000905024],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5272706,0.44195092,0.009424095,0.008004302,0.012335794,0.0010142389],"domain_scores_gemma":[0.37372413,0.529194,0.01390812,0.0651923,0.016576478,0.0014050127],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.39758614,0.0022380361,0.0037481333,0.002911104,0.0022242058,0.0067411377,0.010085963,0.0050874604,0.010739063],"category_scores_gemma":[0.662929,0.001668729,0.0054555167,0.0046294387,0.0074631046,0.010013816,0.0075268815,0.01608409,0.0017519647],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046544088,0.00015396596,0.0018301836,0.0013325628,0.0018958193,0.00015821276,0.001654354,0.009889746,0.0004405189,0.8442531,0.00709265,0.1308334],"study_design_scores_gemma":[0.00024072608,0.00020667433,0.0007040494,0.0005944937,0.00030373916,0.000118838594,0.00015435132,0.02025401,0.0005853307,0.9623817,0.014393836,0.000062219275],"about_ca_topic_score_codex":0.0030568212,"about_ca_topic_score_gemma":0.003865592,"teacher_disagreement_score":0.39758614,"about_ca_system_score_codex":0.0032883298,"about_ca_system_score_gemma":0.008217994,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"grok","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"},{"model":"opus","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W4377093414","doi":"10.1177/17407745231174544","title":"Overview of modern approaches for identifying and evaluating heterogeneous treatment effects from clinical data","year":2023,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Bayer (Canada)","funders":"","keywords":"Computer science; Causal inference; Machine learning; Artificial intelligence; Set (abstract data type); Identification (biology); Usability; Observational study; Personalized medicine; Precision medicine; Statistical inference; Inference; Randomized experiment; Data science; Human–computer interaction; Bioinformatics; Medicine","score_opus":0.9791653892937205,"score_gpt":0.7317185737311261,"score_spread":0.2474468155625944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4377093414","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00041483188,0.047566563,0.945173,0.002554483,0.00026028557,0.00029236043,0.0008599731,0.00029016525,0.002588355],"genre_scores_gemma":[0.015458565,0.06725088,0.9095019,0.0017018124,0.0018193991,0.0015015018,0.0013040641,0.00014149219,0.0013203579],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9774433,0.012902065,0.0027172838,0.002077547,0.0045923884,0.00026746144],"domain_scores_gemma":[0.95992005,0.03373243,0.0016947512,0.0022921683,0.0021098128,0.0002508818],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.029406684,0.0022605732,0.0023949267,0.007145664,0.00064629014,0.0050277747,0.0027735916,0.0024652984,0.005146628],"category_scores_gemma":[0.046203457,0.00133611,0.0046950066,0.005604158,0.0023172584,0.0029900258,0.0025188457,0.005472383,0.0020959876],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014112164,0.00011117741,0.0024804955,0.0063378206,0.0012022137,0.0002433255,0.00031072667,0.024060097,0.0012851937,0.3937617,0.015616106,0.55445004],"study_design_scores_gemma":[0.000094336254,0.00020100303,0.002274367,0.0022557876,0.0005353149,0.0006456798,0.00008753722,0.05346161,0.0014702703,0.80083615,0.1380067,0.0001313191],"about_ca_topic_score_codex":0.0028569144,"about_ca_topic_score_gemma":0.0020755422,"teacher_disagreement_score":0.97059333,"about_ca_system_score_codex":0.0023579854,"about_ca_system_score_gemma":0.0040026116,"threshold_uncertainty_score":0.15551925},"labels":[],"label_agreement":null},{"id":"W4377138740","doi":"10.1002/pds.5639","title":"Differences in target estimands between different propensity score‐based weights","year":2023,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Weighting; Statistic; Average treatment effect; Statistics; Mathematics; Matching (statistics); Observational study; Inverse probability weighting; Medicine","score_opus":0.2828403345970821,"score_gpt":0.43182025817402725,"score_spread":0.14897992357694517,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4377138740","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.30004197,0.00077617937,0.6892981,0.0011402506,0.00008040408,0.0010705934,0.00047432553,0.00023812971,0.0068801898],"genre_scores_gemma":[0.9169761,0.00029402558,0.08064067,0.00021812628,0.000029858418,0.000927103,0.0003261937,0.000047139434,0.0005407968],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9486977,0.04054629,0.0022260146,0.0027207872,0.004968985,0.0008402433],"domain_scores_gemma":[0.7451169,0.22233728,0.010785856,0.01622013,0.0046035824,0.00093622855],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10013275,0.0008628803,0.0010999412,0.001903445,0.0005782863,0.0025266658,0.0016515031,0.0014400622,0.0034385617],"category_scores_gemma":[0.27272603,0.000568838,0.0022452904,0.0015661027,0.0023440633,0.0035118056,0.0026413326,0.002705671,0.0003360901],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004053774,0.0010081696,0.1315462,0.0010500089,0.0038076597,0.0003075679,0.0018606998,0.2747964,0.0032752282,0.38421455,0.0025369998,0.19154276],"study_design_scores_gemma":[0.001487465,0.0021060305,0.07335027,0.00063715933,0.0014082122,0.0006529914,0.00052779104,0.42975706,0.008525553,0.47526446,0.006074441,0.00020852964],"about_ca_topic_score_codex":0.000916494,"about_ca_topic_score_gemma":0.0005813603,"teacher_disagreement_score":0.89986724,"about_ca_system_score_codex":0.0016988518,"about_ca_system_score_gemma":0.0014394198,"threshold_uncertainty_score":0.5295589},"labels":[],"label_agreement":null},{"id":"W4378188995","doi":"10.1177/26320843231176662","title":"Implementing TMLE in the presence of a continuous outcome","year":2023,"lang":"en","type":"article","venue":"Research Methods in Medicine & Health Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Causal inference; Outcome (game theory); Inference; Machine learning; Observational study; Data mining; Artificial intelligence; Econometrics; Statistics; Mathematics","score_opus":0.8456818068301671,"score_gpt":0.7791294216930839,"score_spread":0.06655238513708328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4378188995","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026955483,0.000095704345,0.992338,0.0005702238,0.0000350226,0.00014174418,0.0005312683,0.0027565889,0.0008359048],"genre_scores_gemma":[0.04806361,0.00024160281,0.9474189,0.00045274576,0.000048341168,0.0010275658,0.0013594961,0.0004897343,0.00089805893],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9914841,0.0060459687,0.00069857034,0.00081420894,0.000777197,0.0001799691],"domain_scores_gemma":[0.94544977,0.047598194,0.0014458745,0.0035334025,0.0016554496,0.00031729706],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020448487,0.00076220674,0.0010524627,0.0013012897,0.00050047797,0.002142569,0.0019950676,0.0017106843,0.012200648],"category_scores_gemma":[0.10911138,0.0006665762,0.0015121383,0.0013388526,0.0007762889,0.002404615,0.003940227,0.002703789,0.0043285107],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012244263,0.0003777807,0.014564953,0.002156198,0.0005454978,0.0011679264,0.0017757779,0.12518,0.0034057545,0.104991496,0.030302575,0.7143076],"study_design_scores_gemma":[0.00055265863,0.00038757923,0.0024961228,0.0005588896,0.00013298004,0.0010126275,0.00046117432,0.69293654,0.0061290353,0.2507559,0.04447987,0.00009654807],"about_ca_topic_score_codex":0.001469671,"about_ca_topic_score_gemma":0.0028343578,"teacher_disagreement_score":0.020448487,"about_ca_system_score_codex":0.0005091264,"about_ca_system_score_gemma":0.0023303141,"threshold_uncertainty_score":0.10814327},"labels":[],"label_agreement":null},{"id":"W4378549577","doi":"10.1016/j.jclinepi.2023.05.015","title":"Trials using composite outcomes neglect the presence of competing risks: a methodological survey of cardiovascular studies","year":2023,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Joseph’s Healthcare Hamilton; University of Calgary; McMaster University; Impact","funders":"","keywords":"Medicine; CINAHL; Meta-analysis; Subgroup analysis; Sample size determination; Neglect; MEDLINE; Relative risk; Environmental health; Confidence interval; Statistics; Psychological intervention; Internal medicine; Psychiatry","score_opus":0.9869284378305098,"score_gpt":0.7807249804705765,"score_spread":0.20620345735993328,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4378549577","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00058345526,0.99533033,0.0027765008,0.00096345943,0.00007971659,0.000046166093,0.00005023407,0.0000059789095,0.00016427679],"genre_scores_gemma":[0.0284921,0.9584193,0.009690187,0.0023943712,0.00045915757,0.00025426855,0.00015603392,0.000034154327,0.00010051706],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.8816233,0.08465694,0.019756194,0.0046157045,0.0087152235,0.0006326275],"domain_scores_gemma":[0.35556206,0.60905313,0.02056446,0.0076190103,0.006530111,0.0006711968],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.16075008,0.0015290028,0.011918845,0.0052084215,0.00053260283,0.0052169645,0.0036598828,0.003955176,0.002298568],"category_scores_gemma":[0.3654064,0.0013825821,0.0088132,0.0079142405,0.0028862678,0.0051019187,0.0030506905,0.0043647666,0.00026779692],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018941626,0.000069663314,0.006857472,0.3110077,0.08021175,0.0001397496,0.00046149574,0.002644817,0.00036548372,0.015902165,0.003919892,0.5765255],"study_design_scores_gemma":[0.0030929556,0.0013222409,0.026100455,0.4507823,0.2791665,0.002266456,0.0009479425,0.0051797503,0.0010528673,0.1370791,0.092695184,0.00031419937],"about_ca_topic_score_codex":0.0023433252,"about_ca_topic_score_gemma":0.0041701216,"teacher_disagreement_score":0.98808116,"about_ca_system_score_codex":0.00237466,"about_ca_system_score_gemma":0.0062738075,"threshold_uncertainty_score":0.8501378},"labels":[],"label_agreement":null},{"id":"W4378803918","doi":"10.1002/pst.2317","title":"Variance estimation of the risk difference when using propensity‐score matching and weighting with time‐to‐event outcomes","year":2023,"lang":"en","type":"article","venue":"Pharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Ministry of Long-Term Care; Canadian Institutes of Health Research; Institute for Clinical Evaluative Sciences; Ministry of Health, Ontario","keywords":"Propensity score matching; Weighting; Statistics; Matching (statistics); Variance (accounting); Event (particle physics); Estimation; Mathematics; Event data; Econometrics; Inverse probability weighting; Medicine; Covariate; Economics","score_opus":0.20647756529539354,"score_gpt":0.4342598912393333,"score_spread":0.22778232594393974,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4378803918","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028531929,0.00043898996,0.99441695,0.00034244324,0.00013989302,0.00034841528,0.0002032109,0.00012025251,0.001136702],"genre_scores_gemma":[0.13474497,0.0012762293,0.85741305,0.00068461837,0.00035363343,0.0026263306,0.00086257525,0.00018591878,0.001852691],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93335986,0.049968448,0.0034677081,0.004925806,0.0075775455,0.0007007565],"domain_scores_gemma":[0.8828481,0.090223424,0.008439002,0.014091821,0.004150092,0.0002475994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06385167,0.0013619531,0.0019306366,0.0032243473,0.00064612506,0.0028202715,0.0026978834,0.0023304105,0.0048742495],"category_scores_gemma":[0.26792857,0.00078390026,0.003461265,0.0045581968,0.002149839,0.0035372877,0.0030310997,0.003493589,0.000709668],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003567664,0.00020727771,0.02218682,0.0012278579,0.0019237278,0.00029947757,0.0007424274,0.10638967,0.0009479965,0.55393565,0.008874602,0.30290776],"study_design_scores_gemma":[0.00027035578,0.0003151527,0.010175441,0.00059967325,0.00058917253,0.00039983023,0.00019204289,0.2546582,0.002363687,0.7092428,0.021024732,0.00016889753],"about_ca_topic_score_codex":0.004045733,"about_ca_topic_score_gemma":0.0023126241,"teacher_disagreement_score":0.06385167,"about_ca_system_score_codex":0.0014391827,"about_ca_system_score_gemma":0.0028696873,"threshold_uncertainty_score":0.33768392},"labels":[],"label_agreement":null},{"id":"W4379598444","doi":"10.1093/aje/kwad133","title":"NO UNMEASURED CONFOUNDING: KNOWN UNKNOWNS OR… NOT?","year":2023,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; HEC Montréal","funders":"National Institute of Mental Health; National Institutes of Health","keywords":"Biostatistics; Confounding; Epidemiology; Medicine; Library science; Gerontology; History; Family medicine; Pathology","score_opus":0.3037576488440687,"score_gpt":0.4933054180363789,"score_spread":0.1895477691923102,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379598444","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031671945,0.09387436,0.12546298,0.7422109,0.02580574,0.00012746315,0.0007773586,0.00018693534,0.00838707],"genre_scores_gemma":[0.20832115,0.11842891,0.09456182,0.4350567,0.13274847,0.00082937354,0.0010591327,0.00033877706,0.0086557325],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93474156,0.038084157,0.0052917683,0.013083613,0.007470554,0.0013282611],"domain_scores_gemma":[0.7224225,0.22518387,0.016677143,0.023560554,0.0097839,0.0023720853],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08929655,0.0012058273,0.004005696,0.001506957,0.0026715829,0.0066313655,0.0043640495,0.01005469,0.0065666065],"category_scores_gemma":[0.24750297,0.0012049674,0.0021059175,0.002268725,0.020534074,0.016283035,0.0052607153,0.015293783,0.0022558717],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032267274,0.00007343787,0.0075028604,0.0042687412,0.0010380165,0.0013393541,0.0026360885,0.0007737184,0.00031663547,0.6691795,0.08523919,0.22730975],"study_design_scores_gemma":[0.000055748413,0.00003960082,0.0014612222,0.0023234976,0.0001384331,0.0008144759,0.0005156274,0.0014371756,0.00023027856,0.9090622,0.08383616,0.00008550971],"about_ca_topic_score_codex":0.0033675293,"about_ca_topic_score_gemma":0.0033725102,"teacher_disagreement_score":0.9107034,"about_ca_system_score_codex":0.003417914,"about_ca_system_score_gemma":0.0062502446,"threshold_uncertainty_score":0.47225094},"labels":[],"label_agreement":null},{"id":"W4379599462","doi":"10.1002/pds.5649","title":"Evaluating the use of methods to mitigate bias from non‐transient medications in the case‐crossover design: A systematic review","year":2023,"lang":"en","type":"review","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Crossover study; Crossover; Medicine; Clinical study design; MEDLINE; Research design; Statistics; Computer science; Clinical trial; Internal medicine; Alternative medicine; Artificial intelligence; Mathematics","score_opus":0.8142931815136372,"score_gpt":0.656054551092285,"score_spread":0.1582386304213521,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379599462","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032082167,0.95156145,0.014550163,0.0013333429,0.0010742167,0.025931187,0.0012026241,0.000121499426,0.0010173225],"genre_scores_gemma":[0.12054938,0.67968136,0.089299664,0.0041375267,0.000925049,0.102996595,0.001589277,0.00014692698,0.0006741916],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.6148065,0.23186812,0.10711193,0.011175222,0.03367613,0.001362202],"domain_scores_gemma":[0.32159564,0.5749178,0.06322645,0.013058052,0.026377335,0.00082474545],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2590091,0.0038445627,0.019272322,0.01961663,0.0018689192,0.008414832,0.0060994583,0.0057098176,0.0060628727],"category_scores_gemma":[0.589229,0.003396046,0.025918396,0.01580344,0.0037800183,0.009917906,0.0037912827,0.0030963703,0.0007284026],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005797592,0.000044188735,0.0022310647,0.89338917,0.061060462,0.0000938982,0.0005578896,0.00035113553,0.00010738933,0.00089143787,0.00095343956,0.03974015],"study_design_scores_gemma":[0.0014104873,0.00052878016,0.0030430998,0.8104686,0.1710814,0.00018785585,0.00042659594,0.0008075986,0.0004508358,0.0020732812,0.009400644,0.00012073779],"about_ca_topic_score_codex":0.0065789954,"about_ca_topic_score_gemma":0.01377096,"teacher_disagreement_score":0.7409909,"about_ca_system_score_codex":0.011649541,"about_ca_system_score_gemma":0.026351254,"threshold_uncertainty_score":0.9137737},"labels":[],"label_agreement":null},{"id":"W4379768508","doi":"10.1002/jrsm.1645","title":"Methodological considerations for novel approaches to covariate‐adjusted indirect treatment comparisons","year":2023,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Econometrics; Weighting; Robustness (evolution); Outcome (game theory); Computer science; Context (archaeology); Extrapolation; Statistics; Mathematics; Medicine","score_opus":0.9848045933522044,"score_gpt":0.6880955858430207,"score_spread":0.2967090075091837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379768508","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00064907904,0.0015878351,0.98670375,0.008136156,0.00056619354,0.00093276694,0.00017142764,0.00010946348,0.0011433742],"genre_scores_gemma":[0.027549164,0.0011911078,0.9536996,0.0047714817,0.00077739457,0.0108499285,0.00015003755,0.00015689273,0.00085436535],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.40315598,0.5618756,0.01282338,0.0076526566,0.0135444,0.00094797957],"domain_scores_gemma":[0.28583387,0.6224692,0.014492515,0.05864461,0.017395737,0.0011640494],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4862871,0.0025441332,0.004381257,0.0034996867,0.0022530518,0.0074442704,0.009829828,0.0054687373,0.011480772],"category_scores_gemma":[0.7191393,0.0018321562,0.0066323485,0.005331371,0.007822914,0.010524587,0.007416429,0.015608003,0.0017812838],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00055491977,0.000157997,0.001465877,0.0025859675,0.0026337479,0.00014019842,0.0019958762,0.009301506,0.00037761556,0.828257,0.007783863,0.14474542],"study_design_scores_gemma":[0.00039826691,0.00031067833,0.00078303536,0.0013553264,0.0005643901,0.00012238965,0.00024163137,0.021836312,0.0006695594,0.9525121,0.021121658,0.000084728985],"about_ca_topic_score_codex":0.0031002965,"about_ca_topic_score_gemma":0.004513474,"teacher_disagreement_score":0.5137129,"about_ca_system_score_codex":0.0040424946,"about_ca_system_score_gemma":0.009521626,"threshold_uncertainty_score":0.6334995},"labels":[],"label_agreement":null},{"id":"W4379967395","doi":"10.1002/sim.9802","title":"Causal inference for recurrent events via aggregated marginal odds ratio","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Inference; Causal inference; Odds ratio; Odds; Econometrics; Statistics; Marginal structural model; Computer science; Mathematics; Artificial intelligence; Logistic regression","score_opus":0.14131302433752374,"score_gpt":0.4749063944263714,"score_spread":0.33359337008884765,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4379967395","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017609252,0.00047784238,0.98015267,0.00035500465,0.00005908835,0.000116132534,0.00023781741,0.0003006675,0.00069155474],"genre_scores_gemma":[0.5997719,0.0014087127,0.39306426,0.00036329892,0.0003719771,0.0009386434,0.0010887536,0.00017370238,0.0028186764],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98433995,0.0110251345,0.0006233988,0.0025906102,0.0010211017,0.00039980726],"domain_scores_gemma":[0.898275,0.08870178,0.004794291,0.006078235,0.0016485186,0.0005021237],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.033291444,0.0011427287,0.002295355,0.0038843306,0.0006735268,0.0020805132,0.0028376577,0.0014390197,0.00727923],"category_scores_gemma":[0.14748776,0.0008227375,0.0032174995,0.0035544136,0.0021540893,0.005147558,0.0025274267,0.003128722,0.0004820854],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050924934,0.00026659956,0.034986958,0.00060119596,0.0022719873,0.000520068,0.0010756798,0.123982,0.0007350303,0.6211749,0.0031235015,0.21075301],"study_design_scores_gemma":[0.00011745764,0.00015815167,0.0070206327,0.000099212506,0.0005689349,0.0001703138,0.0001409208,0.43863732,0.0006509249,0.5495216,0.0028536697,0.000060861188],"about_ca_topic_score_codex":0.004442332,"about_ca_topic_score_gemma":0.0031767646,"teacher_disagreement_score":0.033291444,"about_ca_system_score_codex":0.0012567107,"about_ca_system_score_gemma":0.0015055148,"threshold_uncertainty_score":0.17606407},"labels":[],"label_agreement":null},{"id":"W4380051600","doi":"10.1007/s00181-023-02441-7","title":"When to use matching and weighting or regression in instrumental variable estimation? Evidence from college proximity and returns to college","year":2023,"lang":"en","type":"article","venue":"Empirical Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Institut für Arbeitsmarkt- und Berufsforschung","keywords":"Instrumental variable; Covariate; Econometrics; Propensity score matching; Weighting; Estimator; Matching (statistics); Average treatment effect; Statistics; Variance (accounting); Regression; Economics; Estimation; Variance inflation factor; Linear regression; Mathematics; Multicollinearity","score_opus":0.21134094600946787,"score_gpt":0.41446308657484643,"score_spread":0.20312214056537856,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380051600","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07475849,0.007237301,0.87713706,0.03047453,0.0013854862,0.00062361034,0.00045349714,0.0004857233,0.007444292],"genre_scores_gemma":[0.61972773,0.003306959,0.36392987,0.006704775,0.0012642051,0.00085098203,0.0005243756,0.00027855329,0.003412511],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8881563,0.09808995,0.0041444274,0.003570024,0.004894631,0.0011446498],"domain_scores_gemma":[0.7790524,0.16407198,0.017507171,0.03214857,0.0062180036,0.0010018385],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11773091,0.001031971,0.0026928268,0.0026121757,0.0010979568,0.0038051067,0.0036278334,0.003036979,0.0045157433],"category_scores_gemma":[0.3552552,0.00084762916,0.0019231096,0.0060762465,0.004297037,0.00570574,0.0036924582,0.004016467,0.0013854766],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010153874,0.0005443326,0.095227145,0.001231699,0.0035838077,0.00029349592,0.001995281,0.026346473,0.0016050097,0.27348423,0.021670312,0.5730029],"study_design_scores_gemma":[0.0010960101,0.00063493574,0.028960213,0.0020041817,0.0010930665,0.00023915466,0.0017938842,0.14565417,0.006985832,0.77509964,0.036176696,0.00026218424],"about_ca_topic_score_codex":0.0045625935,"about_ca_topic_score_gemma":0.0031210154,"teacher_disagreement_score":0.11773091,"about_ca_system_score_codex":0.00086724275,"about_ca_system_score_gemma":0.0017299117,"threshold_uncertainty_score":0.622628},"labels":[],"label_agreement":null},{"id":"W4380150987","doi":"10.1016/j.jval.2023.03.1581","title":"MSR45 Identifying Longitudinal Treatment Effect Trajectories Using Flexible Outcome Modeling and Clustering","year":2023,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"EVERSANA (Canada)","funders":"","keywords":"Outcome (game theory); Cluster analysis; Interpretation (philosophy); Computer science; Longitudinal data; Treatment effect; Longitudinal study; Statistical power; Econometrics; Data mining; Artificial intelligence; Statistics; Medicine; Mathematics","score_opus":0.5678470637420231,"score_gpt":0.5187338618576554,"score_spread":0.04911320188436774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380150987","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03834882,0.0004967313,0.95599264,0.0008066483,0.000066144865,0.0001538928,0.001804197,0.0010373623,0.0012935742],"genre_scores_gemma":[0.6149059,0.00053633674,0.37068188,0.0003397013,0.00014028135,0.000657057,0.0056057423,0.00045558764,0.0066774106],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99354964,0.0039858753,0.00027517098,0.0012589166,0.00058173144,0.00034862052],"domain_scores_gemma":[0.96394956,0.027361862,0.0018551581,0.005129373,0.0012519835,0.00045213473],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01263936,0.00086197717,0.0019553031,0.0024190259,0.0011012041,0.0019100831,0.0030023984,0.001742223,0.007166696],"category_scores_gemma":[0.06265412,0.0010130212,0.0035839295,0.0026981952,0.0008333514,0.0016238883,0.0021850711,0.0031830175,0.0011220387],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008332064,0.00038784833,0.03347418,0.00042797736,0.0014511878,0.0003059233,0.0006641561,0.47274464,0.001154422,0.23671435,0.013472002,0.23837009],"study_design_scores_gemma":[0.000062047184,0.00006092547,0.0027423298,0.000059192957,0.00011479583,0.00005114845,0.000043658813,0.8562913,0.0004181211,0.13781017,0.0023165734,0.000029804596],"about_ca_topic_score_codex":0.018412,"about_ca_topic_score_gemma":0.016113576,"teacher_disagreement_score":0.018412,"about_ca_system_score_codex":0.0012384387,"about_ca_system_score_gemma":0.0031112307,"threshold_uncertainty_score":0.066844106},"labels":[],"label_agreement":null},{"id":"W4380263991","doi":"10.1002/hec.4719","title":"How does a local instrumental variable method perform across settings with instruments of differing strengths? A simulation study and an evaluation of emergency surgery","year":2023,"lang":"en","type":"article","venue":"Health Economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Economics","funders":"Division of Mathematical Sciences; School for Public Health Research; Economic and Social Research Council; Medical Research Council; National Cancer Institute; National University of Singapore; British Heart Foundation; University College London; Public Health England; Department of Health and Social Care; National Institute for Health and Care Research; United Kingdom Clinical Research Collaboration; Wellcome Trust; National Institutes of Health; Cancer Research UK","keywords":"Instrumental variable; Statistics; Covariate; Sample size determination; Homogeneity (statistics); Econometrics; Sample (material); Mathematics; Mean squared error; Medicine; Chemistry","score_opus":0.1932856635232457,"score_gpt":0.4838407135181443,"score_spread":0.29055504999489856,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380263991","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.33325237,0.0022581753,0.6457124,0.0063605774,0.0002020752,0.0015187284,0.00076991325,0.00039534646,0.009530357],"genre_scores_gemma":[0.90541583,0.00043549194,0.09109903,0.0007010566,0.00006049791,0.0008487471,0.0002644651,0.00006102744,0.0011137796],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.91231096,0.08159651,0.001209663,0.0021838932,0.0016586187,0.0010403283],"domain_scores_gemma":[0.6011237,0.3746154,0.010365377,0.007869352,0.004830846,0.0011952553],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10800683,0.0011150663,0.0021198601,0.001297282,0.00067075976,0.0026852041,0.002832283,0.002303025,0.0051249545],"category_scores_gemma":[0.293443,0.0006462202,0.0026886298,0.001668239,0.002339152,0.0034344052,0.0029292097,0.0030187054,0.0003783],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00369333,0.0010226482,0.07904807,0.0016133694,0.0035454126,0.00071947795,0.0010674248,0.6572527,0.00047412576,0.14006954,0.003552598,0.10794128],"study_design_scores_gemma":[0.001959418,0.002034842,0.009268979,0.0005584328,0.0007759421,0.00020878314,0.0008729848,0.89253956,0.000884911,0.08762857,0.0031405615,0.0001270946],"about_ca_topic_score_codex":0.0071698283,"about_ca_topic_score_gemma":0.0043762824,"teacher_disagreement_score":0.89199317,"about_ca_system_score_codex":0.0023375389,"about_ca_system_score_gemma":0.003102138,"threshold_uncertainty_score":0.57120156},"labels":[],"label_agreement":null},{"id":"W4380714779","doi":"10.1136/bmj-2021-068911","title":"Use of real world data to improve drug coverage decisions in China","year":2023,"lang":"en","type":"article","venue":"BMJ","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"China; Drug; Real world data; Data science; Business; Computer science; Risk analysis (engineering); Geography; Medicine; Pharmacology","score_opus":0.32239701413475724,"score_gpt":0.4823354814005586,"score_spread":0.15993846726580135,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380714779","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8924955,0.0057371594,0.02677086,0.052400496,0.00051104836,0.00043713948,0.009930655,0.00019695146,0.011520273],"genre_scores_gemma":[0.98730993,0.00057077734,0.008480799,0.0013797325,0.00010615121,0.00007180838,0.0015850067,0.000013197025,0.00048250848],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9829846,0.0137665635,0.00077638944,0.0007232719,0.0012827389,0.00046633882],"domain_scores_gemma":[0.89996,0.07817147,0.009863964,0.0057548755,0.0051351036,0.0011145558],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029588772,0.0007621537,0.0008283937,0.0029563508,0.0006116332,0.0022124345,0.0019216018,0.0017195211,0.0021562367],"category_scores_gemma":[0.117423944,0.00047727412,0.0013044712,0.0040579247,0.0013049154,0.0018737501,0.0017616717,0.0020327913,0.00022579772],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017333803,0.00097147346,0.72443694,0.0014245299,0.0042454093,0.0014501135,0.0014475533,0.10614737,0.0007713778,0.028006077,0.022674384,0.10669142],"study_design_scores_gemma":[0.0018401273,0.0011864654,0.4444318,0.0011139843,0.004076239,0.00046018648,0.0021177968,0.43624407,0.005988199,0.05396599,0.048246175,0.0003289209],"about_ca_topic_score_codex":0.060607288,"about_ca_topic_score_gemma":0.05663124,"teacher_disagreement_score":0.060607288,"about_ca_system_score_codex":0.0030583325,"about_ca_system_score_gemma":0.0037551243,"threshold_uncertainty_score":0.15648228},"labels":[],"label_agreement":null},{"id":"W4381617848","doi":"10.3390/ijerph20136194","title":"Table 2 Fallacy in Descriptive Epidemiology: Bringing Machine Learning to the Table","year":2023,"lang":"en","type":"article","venue":"International Journal of Environmental Research and Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tobacco Research Unit; Sunnybrook Hospital; Public Health Ontario; University of Toronto; Centre for Addiction and Mental Health","funders":"Center for Tobacco Products; National Cancer Institute; Canadian Institutes of Health Research","keywords":"Fallacy; Descriptive statistics; Contingency table; Outcome (game theory); Covariate; Table (database); Computer science; Statistics; Set (abstract data type); Psychology; Strengths and weaknesses; Data set; Machine learning; Data science; Artificial intelligence; Data mining; Mathematics; Social psychology","score_opus":0.37962706384979317,"score_gpt":0.5113429338242567,"score_spread":0.1317158699744635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4381617848","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009544754,0.033448733,0.46039698,0.17023411,0.0560422,0.0009655949,0.12666827,0.004247321,0.138452],"genre_scores_gemma":[0.22537833,0.05216677,0.40741017,0.09456093,0.034471963,0.0035094328,0.0839627,0.004796517,0.093743235],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.990406,0.005272396,0.0011300418,0.0009737338,0.0020376435,0.00018019754],"domain_scores_gemma":[0.87180156,0.096473515,0.0052842596,0.010152248,0.015063529,0.0012248361],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009431958,0.00059554924,0.0011687357,0.0026823347,0.0009933298,0.003710987,0.0016222117,0.000980614,0.077068254],"category_scores_gemma":[0.14742556,0.00044777297,0.00076356187,0.004835976,0.0013370253,0.0030388767,0.0012099596,0.0038728332,0.011672149],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017538344,0.000017674625,0.0040654023,0.00087386754,0.00010219708,0.00010749877,0.00018496274,0.0016326938,0.00015408946,0.1371904,0.72461206,0.13088381],"study_design_scores_gemma":[0.00006278087,0.000109157205,0.00436545,0.0020307412,0.00006433701,0.00050101295,0.00033017978,0.0051360657,0.00051820994,0.23020627,0.7566034,0.00007228446],"about_ca_topic_score_codex":0.005471404,"about_ca_topic_score_gemma":0.003775532,"teacher_disagreement_score":0.99056804,"about_ca_system_score_codex":0.0019266173,"about_ca_system_score_gemma":0.0038365782,"threshold_uncertainty_score":0.257819},"labels":[],"label_agreement":null},{"id":"W4382062812","doi":"10.3390/math11132830","title":"Estimation of Mediation Effect on Zero-Inflated Microbiome Mediators","year":2023,"lang":"en","type":"article","venue":"Mathematics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Mediation; Microbiome; Weighting; Causal inference; Computer science; Econometrics; Bioinformatics; Biology; Medicine; Mathematics","score_opus":0.057159393947662916,"score_gpt":0.3822569246866689,"score_spread":0.325097530739006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382062812","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02916259,0.00034624626,0.9691244,0.0002751851,0.00003132973,0.00018637936,0.00010841985,0.00016197875,0.0006035461],"genre_scores_gemma":[0.5996361,0.0005870487,0.39639416,0.00024276874,0.00008110466,0.0011467917,0.00035744518,0.000071924886,0.0014827064],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98885345,0.008887627,0.00030500622,0.0010241279,0.00060066825,0.00032908787],"domain_scores_gemma":[0.9364677,0.058424328,0.0014109559,0.002473706,0.0009736713,0.00024961226],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023568692,0.00086657406,0.0016639131,0.001473369,0.00067161216,0.0011239204,0.0024344192,0.0012834357,0.0060399515],"category_scores_gemma":[0.0838163,0.00043444015,0.0021953816,0.0016637058,0.0015988467,0.002004987,0.0028507216,0.0024794352,0.00038865363],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001125937,0.0005458851,0.051624462,0.0012634611,0.002060777,0.0013522608,0.001573215,0.21897015,0.004659873,0.34491655,0.0024342656,0.36947313],"study_design_scores_gemma":[0.00020323928,0.000317688,0.0054771323,0.00010406972,0.00033728528,0.00024443178,0.00029685636,0.77441466,0.00227141,0.21362415,0.002668,0.000041015566],"about_ca_topic_score_codex":0.002240785,"about_ca_topic_score_gemma":0.0016930655,"teacher_disagreement_score":0.023568692,"about_ca_system_score_codex":0.0006561671,"about_ca_system_score_gemma":0.0023049135,"threshold_uncertainty_score":0.12464464},"labels":[],"label_agreement":null},{"id":"W4382318232","doi":"10.1609/aaai.v37i9.26266","title":"Disentangled Representation for Causal Mediation Analysis","year":2023,"lang":"en","type":"article","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Australian Research Council; Natural Sciences and Engineering Research Council of Canada; University of South Australia","keywords":"Confounding; Mediation; Latent variable; Causal inference; Observational study; Econometrics; Causality (physics); Representation (politics); Computer science; Outcome (game theory); Structural equation modeling; Affect (linguistics); Mechanism (biology); Causal model; Artificial intelligence; Machine learning; Psychology; Statistics; Mathematics","score_opus":0.3166754638276828,"score_gpt":0.45770785517093737,"score_spread":0.14103239134325457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382318232","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007287476,0.0011030348,0.98970276,0.0005169216,0.000055775407,0.000047882764,0.00029102268,0.00032003428,0.00067504623],"genre_scores_gemma":[0.5799923,0.0026385402,0.40833706,0.0011765009,0.00030629808,0.0007413793,0.0021473747,0.00024415136,0.004416507],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9976411,0.0014495545,0.00010774722,0.00042038277,0.00023325284,0.00014803946],"domain_scores_gemma":[0.99434245,0.0046309195,0.00023600103,0.00046340784,0.00024435832,0.0000829088],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043224073,0.0010448227,0.001307642,0.001032959,0.00038908125,0.0010078317,0.0018662119,0.0013296905,0.0039273426],"category_scores_gemma":[0.015142343,0.00058803987,0.0019563958,0.0011255865,0.0009091161,0.0018404925,0.0019218543,0.0031725771,0.00038660847],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040745144,0.00026097367,0.008702382,0.00073373056,0.0012536345,0.00032027316,0.0005559577,0.42772815,0.0032015743,0.13995305,0.0075085512,0.40937433],"study_design_scores_gemma":[0.00003654181,0.00004433263,0.0009280935,0.00006872249,0.00012364952,0.00005232521,0.00003473203,0.87977004,0.00072874886,0.11565476,0.002537858,0.000020186404],"about_ca_topic_score_codex":0.0057905647,"about_ca_topic_score_gemma":0.00717713,"teacher_disagreement_score":0.0057905647,"about_ca_system_score_codex":0.00091867754,"about_ca_system_score_gemma":0.0017809753,"threshold_uncertainty_score":0.022859335},"labels":[],"label_agreement":null},{"id":"W4382987679","doi":"10.1002/cjs.11783","title":"Rerandomization and optimal matching","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"U.S. Food and Drug Administration; University of Waterloo","keywords":"Covariate; Randomization; Mean squared error; Robustness (evolution); Restricted randomization; Matching (statistics); Statistics; Balance (ability); Computer science; Mathematics; Factorial experiment; Measure (data warehouse); Mathematical optimization; Randomized controlled trial; Data mining; Medicine","score_opus":0.09737256076111298,"score_gpt":0.35830805078291467,"score_spread":0.2609354900218017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4382987679","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023442196,0.00023289197,0.971583,0.00047649757,0.00008381208,0.0011611558,0.000095906646,0.00025576274,0.0026687754],"genre_scores_gemma":[0.40489697,0.00017989388,0.5865647,0.0008204467,0.00009782535,0.003680883,0.00020453543,0.00010710815,0.0034475909],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9395458,0.051052045,0.0016318107,0.0039411285,0.002858626,0.00097059715],"domain_scores_gemma":[0.96087766,0.019675758,0.0049802195,0.011304948,0.0023762935,0.0007851718],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027531357,0.00079894764,0.0025209289,0.0012445599,0.00068806816,0.0009251636,0.0025623841,0.0019605267,0.008763769],"category_scores_gemma":[0.06915122,0.0007871902,0.0011222675,0.0013826842,0.0023893293,0.0016089367,0.002735015,0.0021285608,0.0012504256],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0073939036,0.0012536868,0.003891202,0.00081885327,0.0004876841,0.00016294271,0.00044107498,0.116257675,0.008391091,0.4195877,0.006031213,0.43528292],"study_design_scores_gemma":[0.0037600684,0.0041540377,0.0041616056,0.00034362826,0.00030578906,0.00033106862,0.00014168193,0.4218455,0.01055051,0.5385755,0.015700212,0.00013040492],"about_ca_topic_score_codex":0.00052708184,"about_ca_topic_score_gemma":0.00042797255,"teacher_disagreement_score":0.027531357,"about_ca_system_score_codex":0.0014274707,"about_ca_system_score_gemma":0.002011633,"threshold_uncertainty_score":0.14560145},"labels":[],"label_agreement":null},{"id":"W4383301689","doi":"10.1037/hea0001299","title":"Tutorial on causal mediation analysis with binary variables: An application to health psychology research.","year":2023,"lang":"en","type":"article","venue":"Health Psychology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Center for Tobacco Products; Office of Behavioral and Social Sciences Research; National Institute on Drug Abuse; National Cancer Institute; National Institutes of Health; York University; New York University","keywords":"Causal inference; Mediation; Outcome (game theory); Context (archaeology); Psychology; Confounding; Causal chain; Causality (physics); Weighting; Causal model; Mediator; Social psychology; Econometrics; Medicine; Statistics; Mathematics","score_opus":0.360900368256626,"score_gpt":0.6215082897469495,"score_spread":0.26060792149032347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4383301689","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000687846,0.0024705327,0.9753617,0.0036845144,0.0004093175,0.0006970721,0.0022046354,0.0055580973,0.008926288],"genre_scores_gemma":[0.0073486106,0.0032648842,0.972764,0.0011854836,0.00030790232,0.0019468658,0.0009987392,0.0010022601,0.011181296],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99834824,0.0010716182,0.00013326161,0.0001720612,0.00023495294,0.000039875104],"domain_scores_gemma":[0.97941315,0.018814689,0.00039772553,0.00037984148,0.00075660396,0.00023812756],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0076698544,0.0022537797,0.0009799546,0.0027954383,0.0006807736,0.0013022244,0.0018458931,0.0015512487,0.10133626],"category_scores_gemma":[0.02950637,0.0012031931,0.0022312105,0.0022670233,0.0009075963,0.0024539267,0.0020366313,0.0035064013,0.020537607],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013296878,0.00028309677,0.0016279266,0.004330509,0.00043931222,0.00092609343,0.0012231128,0.013006298,0.0025786925,0.15593754,0.33786586,0.48164862],"study_design_scores_gemma":[0.00017982099,0.00013337137,0.003435133,0.001532151,0.00018596063,0.0016021515,0.000301315,0.042114258,0.0023644813,0.4037828,0.544229,0.00013962625],"about_ca_topic_score_codex":0.0027369082,"about_ca_topic_score_gemma":0.0060289,"teacher_disagreement_score":0.99233013,"about_ca_system_score_codex":0.0009484708,"about_ca_system_score_gemma":0.0018199207,"threshold_uncertainty_score":0.33900362},"labels":[],"label_agreement":null},{"id":"W4383682360","doi":"10.3329/jsr.v56i2.67467","title":"Properties of inverse probability of adherence weighted estimator of the per-protocol effect for sustained treatment strategies under different data-generating mechanisms and adherence patterns","year":2023,"lang":"en","type":"article","venue":"Journal of Statistical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; St. Paul's Hospital; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; University of British Columbia; Biogen; Michael Smith Health Research BC; Compute Canada; Western Canada Research Grid","keywords":"Estimator; Confounding; Inverse probability; Context (archaeology); Statistics; Protocol (science); Medicine; Clinical trial; Randomized controlled trial; Mathematics; Demography; Econometrics; Internal medicine; Geography","score_opus":0.44855631455749523,"score_gpt":0.5266527973104499,"score_spread":0.07809648275295467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4383682360","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013458781,0.0014365119,0.98107374,0.00059087924,0.000120497476,0.001622647,0.00030545852,0.0002592346,0.0011323036],"genre_scores_gemma":[0.3405153,0.0017927112,0.64082634,0.0012362719,0.0003025522,0.010963898,0.0012327812,0.00032889657,0.0028013373],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.86890185,0.10617348,0.006968651,0.009345833,0.007340537,0.0012697428],"domain_scores_gemma":[0.30139396,0.64429057,0.017990692,0.026613291,0.008698075,0.0010134309],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23837492,0.0022563192,0.0047354475,0.0022629912,0.0006731803,0.0038680143,0.0051897326,0.0050251964,0.006168007],"category_scores_gemma":[0.58975244,0.0016280931,0.0049625537,0.0018642837,0.00523995,0.008891435,0.0042668,0.0054447027,0.0008521796],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037018058,0.00072386756,0.04363976,0.007245203,0.009559871,0.0008254066,0.002875591,0.1652503,0.003763789,0.4014301,0.004492724,0.3564916],"study_design_scores_gemma":[0.0017563187,0.0024810357,0.014337228,0.002067646,0.0035626919,0.0011276935,0.0004766233,0.67568123,0.00530064,0.28357136,0.009302598,0.00033502837],"about_ca_topic_score_codex":0.001161354,"about_ca_topic_score_gemma":0.0006353129,"teacher_disagreement_score":0.23837492,"about_ca_system_score_codex":0.0014568336,"about_ca_system_score_gemma":0.004064731,"threshold_uncertainty_score":0.9392193},"labels":[],"label_agreement":null},{"id":"W4384155640","doi":"10.1101/2023.07.13.23292601","title":"Design differences explain variation in results between randomized trials and their non-randomized emulations","year":2023,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"U.S. Food and Drug Administration; Hamilton Health Sciences Foundation; National Institutes of Health; Brigham and Women's Hospital","keywords":"Randomized controlled trial; Medicine; Confounding; Discontinuation; Randomized experiment; Research design; Sample size determination; Completely randomized design; Randomization; Observational study; Statistics; Surgery; Internal medicine","score_opus":0.4261275238457517,"score_gpt":0.44275476501233624,"score_spread":0.01662724116658454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384155640","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08223014,0.03393291,0.83982,0.0061602243,0.00456428,0.019154139,0.0037634973,0.0017273538,0.008647361],"genre_scores_gemma":[0.68497497,0.002900236,0.27580005,0.0042295507,0.0006440364,0.027626077,0.0017840558,0.00054028124,0.0015008106],"study_design_codex":"meta_analysis","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.18917784,0.66327363,0.07300937,0.045357987,0.026607703,0.0025735032],"domain_scores_gemma":[0.12656853,0.7520938,0.045282174,0.066269554,0.009159,0.0006270081],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5913207,0.003957021,0.0074379914,0.006132916,0.0011422874,0.006798507,0.0062270085,0.0053981245,0.005865934],"category_scores_gemma":[0.7772731,0.0027462621,0.023919215,0.006135905,0.0077136634,0.005542611,0.0060011065,0.0054835845,0.0011890744],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01890487,0.0011464183,0.1730767,0.05656978,0.31731486,0.0023244822,0.0071844724,0.045072395,0.0038556345,0.106899574,0.012749934,0.2549009],"study_design_scores_gemma":[0.015788203,0.008544485,0.14764035,0.027834967,0.14929073,0.0026196588,0.0024711273,0.17176138,0.015403118,0.4067048,0.050572645,0.0013684864],"about_ca_topic_score_codex":0.0017917881,"about_ca_topic_score_gemma":0.0015248844,"teacher_disagreement_score":0.4086793,"about_ca_system_score_codex":0.0043486906,"about_ca_system_score_gemma":0.0031213434,"threshold_uncertainty_score":0.5039744},"labels":[],"label_agreement":null},{"id":"W4384283005","doi":"10.1093/ije/dyad102","title":"Identifiability of causal effects in test-negative design studies","year":2023,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"Simons Institute for the Theory of Computing, University of California Berkeley","keywords":"Directed acyclic graph; Causal inference; Identifiability; Outcome (game theory); Causal model; Covariate; Computer science; Sampling (signal processing); Causality (physics); Econometrics; Statistics; Machine learning; Mathematics; Algorithm","score_opus":0.4196313907985724,"score_gpt":0.5530443079842668,"score_spread":0.13341291718569442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384283005","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026333411,0.0006186231,0.99282515,0.0013825975,0.00013960118,0.00032558508,0.00025428997,0.00039243925,0.0014283045],"genre_scores_gemma":[0.1621107,0.0010310202,0.8271152,0.0026075384,0.00040128652,0.004616435,0.0005786563,0.00035657245,0.0011825124],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6404644,0.31994376,0.012026885,0.012327375,0.014242853,0.0009948311],"domain_scores_gemma":[0.14153408,0.8103475,0.015822459,0.027365854,0.0043490124,0.0005811009],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.30553538,0.0021218553,0.0035003203,0.0052794977,0.0015284817,0.0057602385,0.0046510994,0.006383767,0.0115367705],"category_scores_gemma":[0.69265056,0.002356107,0.0049994634,0.0040201386,0.01065532,0.008111838,0.0054876893,0.0079178475,0.0010609673],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000828876,0.0001743613,0.011553274,0.0038233667,0.0015733066,0.0007442527,0.0017818465,0.027572377,0.00072538946,0.7686271,0.006981929,0.1756138],"study_design_scores_gemma":[0.00036012323,0.00015202831,0.00078672025,0.0006618796,0.00027150172,0.00025698647,0.00008470789,0.038163655,0.0010320302,0.950736,0.007449257,0.00004514524],"about_ca_topic_score_codex":0.0014801247,"about_ca_topic_score_gemma":0.001318177,"teacher_disagreement_score":0.6944646,"about_ca_system_score_codex":0.0025178995,"about_ca_system_score_gemma":0.0050366437,"threshold_uncertainty_score":0.8563985},"labels":[],"label_agreement":null},{"id":"W4384626449","doi":"10.1111/1471-0528.17528","title":"We can predict, but validation and implementation remain a challenge","year":2023,"lang":"en","type":"article","venue":"BJOG An International Journal of Obstetrics & Gynaecology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Children's Hospital; University of British Columbia","funders":"","keywords":"Psychology; Political science; Computer science","score_opus":0.12628446076782066,"score_gpt":0.43323865338135925,"score_spread":0.3069541926135386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384626449","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00029806994,0.009524032,0.022958666,0.95081013,0.00976297,0.000051478863,0.00029510373,0.0002330799,0.006066534],"genre_scores_gemma":[0.06469651,0.033823855,0.1331078,0.7168874,0.03317212,0.0011481524,0.0015329949,0.0021587508,0.013472516],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88381463,0.07574621,0.006154769,0.011144518,0.020130644,0.0030093023],"domain_scores_gemma":[0.48104224,0.40587687,0.008350579,0.040516313,0.057917673,0.006296237],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.20654881,0.0018153966,0.0029909117,0.0031811194,0.003811473,0.012121671,0.008165817,0.01482088,0.025827074],"category_scores_gemma":[0.51672006,0.0012719913,0.0029589885,0.0020548413,0.029274737,0.04092732,0.011250081,0.047265235,0.01400526],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013911408,0.00008720003,0.0015467531,0.0011754123,0.00025646947,0.00009055961,0.0016346755,0.0014191591,0.00021406237,0.42332366,0.47329614,0.09681674],"study_design_scores_gemma":[0.000074589254,0.00005456884,0.00061475957,0.0046382435,0.00008748397,0.00009317648,0.0014164133,0.00232897,0.00039493782,0.66832,0.32186735,0.00010957001],"about_ca_topic_score_codex":0.017599573,"about_ca_topic_score_gemma":0.01260123,"teacher_disagreement_score":0.20654881,"about_ca_system_score_codex":0.008358853,"about_ca_system_score_gemma":0.023466554,"threshold_uncertainty_score":0.9784666},"labels":[],"label_agreement":null},{"id":"W4385422417","doi":"10.1002/cjs.11788","title":"A calibration method to stabilize estimation with missing data","year":2023,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Estimator; Inverse probability weighting; Covariate; Weighting; Statistics; Mathematics; Property (philosophy); Calibration; Computer science; Econometrics; Applied mathematics","score_opus":0.3580087222115719,"score_gpt":0.45066885243959814,"score_spread":0.09266013022802627,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385422417","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013019787,0.00010380839,0.9979721,0.00007890972,0.000028852566,0.000024914132,0.000019576299,0.00015874907,0.00031106023],"genre_scores_gemma":[0.187029,0.00055643724,0.807108,0.000403205,0.00030844475,0.0005681871,0.00036202432,0.00039604315,0.0032686624],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99087465,0.005783094,0.00033555744,0.0013027445,0.001447516,0.00025649468],"domain_scores_gemma":[0.97281396,0.0176209,0.0021331736,0.0035551605,0.003505162,0.0003716388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018889021,0.0010794757,0.0016528842,0.0028298106,0.0008291696,0.0012967242,0.0025747458,0.0024221232,0.005906055],"category_scores_gemma":[0.07231147,0.0010479699,0.0014074356,0.0026687814,0.0018488625,0.0023067005,0.0036283904,0.0038199085,0.0013379807],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022498031,0.00014407281,0.0036351245,0.00033717515,0.00038347545,0.00023706067,0.00046693196,0.34610364,0.0051715053,0.2513295,0.006201852,0.38576472],"study_design_scores_gemma":[0.000060112125,0.00007341698,0.0006681489,0.000087330525,0.000059458285,0.00009010828,0.00003357465,0.92117333,0.0020204952,0.07013601,0.0055506714,0.00004737761],"about_ca_topic_score_codex":0.0019722925,"about_ca_topic_score_gemma":0.001131017,"teacher_disagreement_score":0.018889021,"about_ca_system_score_codex":0.0010884529,"about_ca_system_score_gemma":0.0022527548,"threshold_uncertainty_score":0.099895895},"labels":[],"label_agreement":null},{"id":"W4385450150","doi":"10.1097/ede.0000000000001643","title":"Effect Measure Modification by Covariates in Mediation: Extending Regression-based Causal Mediation Analysis","year":2023,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"AstraZeneca (Canada); McGill University","funders":"U.S. National Library of Medicine; National Center for Advancing Translational Sciences; National Institute of Arthritis and Musculoskeletal and Skin Diseases; National Institute of Diabetes and Digestive and Kidney Diseases; National Cancer Institute","keywords":"Mediation; Baseline (sea); Biomarker; Medicine; Covariate; Internal medicine; Oncology; Regression analysis; Effect modification; Regression; Psychology; Bioinformatics; Econometrics; Statistics; Biology; Confidence interval; Psychotherapist; Economics; Mathematics","score_opus":0.18077410192656415,"score_gpt":0.4787696919708121,"score_spread":0.2979955900442479,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385450150","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028432033,0.0005269599,0.9934295,0.00047595374,0.00010304763,0.00042022744,0.00038204406,0.0009284764,0.0008906754],"genre_scores_gemma":[0.13083117,0.0006839326,0.86221504,0.00069313595,0.00019070983,0.002982426,0.0003872978,0.0006675553,0.0013487246],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9094074,0.081375666,0.001724364,0.004196942,0.0026591923,0.0006364893],"domain_scores_gemma":[0.7241282,0.2520482,0.004451029,0.014923439,0.0039799744,0.00046910992],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.120477594,0.0033735007,0.0030456854,0.0031963987,0.0010300571,0.0031628474,0.0057261456,0.002490598,0.015643766],"category_scores_gemma":[0.27687228,0.0015307385,0.008386804,0.0041260957,0.0027154968,0.003801853,0.006583522,0.0049579386,0.0017369566],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012579382,0.00043180597,0.024292355,0.0045221797,0.012052756,0.0019576491,0.003244536,0.14814934,0.0017056065,0.32947245,0.0129800625,0.45993337],"study_design_scores_gemma":[0.0008927499,0.00058939116,0.004039997,0.0006585802,0.0025785426,0.000668415,0.00026890344,0.6098076,0.0016083067,0.35523126,0.023460174,0.0001961216],"about_ca_topic_score_codex":0.004788556,"about_ca_topic_score_gemma":0.0032415665,"teacher_disagreement_score":0.120477594,"about_ca_system_score_codex":0.0013850564,"about_ca_system_score_gemma":0.0042163786,"threshold_uncertainty_score":0.63715404},"labels":[],"label_agreement":null},{"id":"W4385582407","doi":"10.1177/00222437231195577","title":"Correcting Regressor-Endogeneity Bias via Instrument-Free Joint Estimation Using Semiparametric Odds Ratio Models","year":2023,"lang":"en","type":"article","venue":"Journal of Marketing Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Social Sciences and Humanities Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Endogeneity; Econometrics; Instrumental variable; Conditional independence; Inference; Statistics; Parametric statistics; Conditional probability distribution; Computer science; Mathematics; Artificial intelligence","score_opus":0.7075800244134491,"score_gpt":0.5166181316429215,"score_spread":0.19096189277052766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385582407","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004011441,0.00016207487,0.99444616,0.00020811499,0.000028414237,0.000043514494,0.000047994756,0.00023696209,0.0008153013],"genre_scores_gemma":[0.40369263,0.00090721063,0.5898617,0.000517594,0.00017057372,0.00035753736,0.00036774017,0.00029511453,0.003829898],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.986159,0.0095944535,0.00061057904,0.0013804642,0.0019025729,0.00035289885],"domain_scores_gemma":[0.92861426,0.056211907,0.005236622,0.0075082937,0.0021653054,0.00026362308],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018193167,0.0015593999,0.001688441,0.002119839,0.0005505148,0.0030793897,0.0032713667,0.0016246422,0.004548814],"category_scores_gemma":[0.089250535,0.0010204697,0.0023123578,0.0024198545,0.0016412077,0.0034258058,0.0034002007,0.0031168642,0.00072670396],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023383461,0.00031128395,0.022836406,0.0006409672,0.0015383456,0.00037947795,0.0008619372,0.17521612,0.0013721909,0.43055645,0.004000254,0.3620527],"study_design_scores_gemma":[0.000110048255,0.00011472613,0.0033753267,0.00016296418,0.0004195101,0.00021377893,0.00015313287,0.68536437,0.0026260824,0.29957122,0.0077943676,0.00009455618],"about_ca_topic_score_codex":0.003295497,"about_ca_topic_score_gemma":0.0028914188,"teacher_disagreement_score":0.018193167,"about_ca_system_score_codex":0.0011949143,"about_ca_system_score_gemma":0.0023619607,"threshold_uncertainty_score":0.096215844},"labels":[],"label_agreement":null},{"id":"W4385652443","doi":"10.1016/j.jclinepi.2023.08.003","title":"The implementation of target trial emulation for causal inference: a scoping review","year":2023,"lang":"en","type":"review","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; China Scholarship Council","keywords":"Emulation; Causal inference; Inference; Computer science; Data science; Medicine; Artificial intelligence; Psychology; Econometrics; Mathematics; Social psychology","score_opus":0.8632500706330115,"score_gpt":0.7560629111613295,"score_spread":0.107187159471682,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385652443","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00016619661,0.97997034,0.017690828,0.0010358175,0.00025589528,0.00020962788,0.00010072243,0.000069848,0.00050076406],"genre_scores_gemma":[0.007479784,0.9533811,0.03594588,0.0014519076,0.00042719053,0.00082558027,0.00016036382,0.000073931915,0.0002541515],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9580117,0.031313617,0.0050656046,0.001965081,0.0033134872,0.00033044885],"domain_scores_gemma":[0.6194028,0.3638279,0.006281623,0.004908452,0.0051505864,0.00042865876],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.093848005,0.002090184,0.010600013,0.0050451607,0.0005467104,0.0040877513,0.0063533126,0.0048461133,0.0077406787],"category_scores_gemma":[0.27116448,0.0017591177,0.010458298,0.0052492293,0.0020644758,0.0048228214,0.00289695,0.0065394635,0.0014783926],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051639107,0.0000640257,0.0004396003,0.18556985,0.0075882315,0.00007984193,0.0001393625,0.0041321525,0.00016149413,0.014454597,0.0054593827,0.78139514],"study_design_scores_gemma":[0.0017116199,0.00129259,0.0029826977,0.6008326,0.053307988,0.0015094163,0.00026613273,0.017273186,0.001643578,0.12045446,0.19842707,0.00029867297],"about_ca_topic_score_codex":0.0031966812,"about_ca_topic_score_gemma":0.0037523909,"teacher_disagreement_score":0.906152,"about_ca_system_score_codex":0.0030528738,"about_ca_system_score_gemma":0.009023379,"threshold_uncertainty_score":0.49632162},"labels":[],"label_agreement":null},{"id":"W4385681410","doi":"10.48550/arxiv.2308.03369","title":"Variable importance for causal forests: breaking down the heterogeneity of treatment effects","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Safran Electronics (Canada)","funders":"","keywords":"Consistency (knowledge bases); Confounding; Econometrics; Variable (mathematics); Random forest; Computer science; Measure (data warehouse); Regression; Causal inference; Mathematics; Statistics; Machine learning; Artificial intelligence; Data mining","score_opus":0.2595606165189933,"score_gpt":0.31303736055942316,"score_spread":0.05347674404042985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385681410","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003059088,0.00034956992,0.995799,0.00016000397,0.000038359256,0.000071686816,0.00005290282,0.00018384299,0.00028551221],"genre_scores_gemma":[0.25602838,0.0007769333,0.73959637,0.0005958713,0.00042534774,0.0005467425,0.00050660846,0.00033840022,0.0011853259],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99053216,0.0062737186,0.00032509962,0.0013583197,0.0011184368,0.0003922144],"domain_scores_gemma":[0.9482774,0.045164622,0.0016606596,0.0028500184,0.0015471169,0.0005002036],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021624284,0.0014693561,0.0021954598,0.002789539,0.0012669861,0.0018961428,0.0028255538,0.0022965698,0.003259686],"category_scores_gemma":[0.07164633,0.0009467044,0.0022012964,0.0020901721,0.0021717926,0.003337215,0.0028588208,0.004743304,0.0005619973],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045288538,0.00022183315,0.008986607,0.0009906597,0.000527254,0.00032985088,0.0005931769,0.3097697,0.0035146012,0.21311164,0.006857854,0.45464393],"study_design_scores_gemma":[0.00011344879,0.00009713094,0.0010234782,0.00016683638,0.00012350891,0.00016625729,0.000043892844,0.70666164,0.002092664,0.28559658,0.0038837858,0.000030803876],"about_ca_topic_score_codex":0.0024667648,"about_ca_topic_score_gemma":0.0035437595,"teacher_disagreement_score":0.021624284,"about_ca_system_score_codex":0.0013485061,"about_ca_system_score_gemma":0.0023304804,"threshold_uncertainty_score":0.114361525},"labels":[],"label_agreement":null},{"id":"W4386304228","doi":"10.21203/rs.3.rs-3282208/v1","title":"Application of Causal Inference Methods to Pooled Longitudinal Non- Randomized Studies: A Methodological Systematic Review","year":2023,"lang":"en","type":"preprint","venue":"Research Square","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Institute of Genetics; Canadian Institutes of Health Research; European Commission","keywords":"Causal inference; Observational study; Checklist; Confounding; Systematic review; MEDLINE; Meta-analysis; Inference; Computer science; Quality (philosophy); Psychology; Data science; Medicine; Artificial intelligence; Cognitive psychology; Political science; Pathology","score_opus":0.7301174082938059,"score_gpt":0.6883117075626177,"score_spread":0.04180570073118817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386304228","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025151544,0.35686404,0.6219131,0.002896141,0.0018198566,0.010523279,0.0018096542,0.00059889344,0.0010599616],"genre_scores_gemma":[0.09985474,0.15162489,0.6991456,0.003200906,0.0014034705,0.042204704,0.0013721162,0.00034013795,0.00085342675],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.48033616,0.44321468,0.043870892,0.01176018,0.019861009,0.0009570491],"domain_scores_gemma":[0.25052062,0.70230645,0.016804753,0.020382864,0.009383693,0.00060166477],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.36480886,0.0038947617,0.019531472,0.0141580505,0.0016764011,0.008409736,0.006548087,0.0061469562,0.007432526],"category_scores_gemma":[0.6786214,0.0040316773,0.03051937,0.014368315,0.0034311542,0.008852877,0.0053869793,0.0073306127,0.00082518754],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020284187,0.0002100614,0.0032834588,0.40476444,0.2682061,0.0002510342,0.0009462581,0.011304487,0.00035867663,0.039964054,0.006820125,0.26186284],"study_design_scores_gemma":[0.008880271,0.001601776,0.003878591,0.16125357,0.4480266,0.0006361031,0.000553212,0.03388506,0.0021262483,0.31084114,0.02786991,0.00044750937],"about_ca_topic_score_codex":0.0040150518,"about_ca_topic_score_gemma":0.00490259,"teacher_disagreement_score":0.63519114,"about_ca_system_score_codex":0.005841132,"about_ca_system_score_gemma":0.017621864,"threshold_uncertainty_score":0.78330374},"labels":[],"label_agreement":null},{"id":"W4386337675","doi":"10.21033/wp-2023-32","title":"Forecasted Treatment Effects","year":2023,"lang":"en","type":"report","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Social Sciences and Humanities Research Council of Canada; Canada Research Chairs","keywords":"Environmental science; Computer science","score_opus":0.5968615873136218,"score_gpt":0.5421047526194197,"score_spread":0.05475683469420212,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386337675","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023545982,0.0021373355,0.9550789,0.0040748003,0.0006628498,0.0005125258,0.003112337,0.0003751987,0.010500138],"genre_scores_gemma":[0.6612923,0.0046165856,0.31201574,0.0014938827,0.0009632316,0.0018247078,0.00287946,0.00017318413,0.014740875],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9906088,0.0053359144,0.00032703977,0.0018289394,0.0013891894,0.0005101894],"domain_scores_gemma":[0.9473885,0.04221462,0.0037127337,0.004782604,0.0015746151,0.0003270094],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020740896,0.0009998484,0.0021267526,0.0018932573,0.00048556505,0.0024795095,0.0025907292,0.0031026776,0.012247284],"category_scores_gemma":[0.109994695,0.0006045115,0.0014850287,0.0018144413,0.0015109234,0.0041995766,0.0012556799,0.0038639163,0.001747316],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004987235,0.0002648901,0.010923598,0.0005968879,0.0004635468,0.00015041707,0.00039977915,0.135019,0.0010773629,0.5886622,0.007803424,0.25414017],"study_design_scores_gemma":[0.00016012973,0.0003353377,0.004565153,0.00036804046,0.00042786132,0.00009470513,0.00016112851,0.21145801,0.0023583102,0.764425,0.01557268,0.000073641866],"about_ca_topic_score_codex":0.0032850138,"about_ca_topic_score_gemma":0.0020513663,"teacher_disagreement_score":0.020740896,"about_ca_system_score_codex":0.0017713846,"about_ca_system_score_gemma":0.0023083615,"threshold_uncertainty_score":0.10968965},"labels":[],"label_agreement":null},{"id":"W4386368771","doi":"10.2139/ssrn.4558108","title":"Forecasted Treatment Effects","year":2023,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Economic and Social Research Council","keywords":"Environmental science","score_opus":0.12316139753934119,"score_gpt":0.4023305954514776,"score_spread":0.2791691979121364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386368771","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08401762,0.0040288824,0.8253343,0.016484974,0.003482538,0.0012262285,0.032265887,0.0030383377,0.030121196],"genre_scores_gemma":[0.8508063,0.002523612,0.08925999,0.0019927502,0.0012624066,0.0012810105,0.008150756,0.00019704204,0.04452604],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9966815,0.0013993809,0.00011935256,0.0011175473,0.00039992438,0.0002821471],"domain_scores_gemma":[0.9677191,0.026588317,0.001252095,0.003018378,0.0010277297,0.00039429628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009059171,0.0011266898,0.0029764688,0.0017645749,0.0004591133,0.002536116,0.0021126051,0.0036584209,0.036509074],"category_scores_gemma":[0.05476057,0.0011006823,0.0023012233,0.0015042695,0.00089022296,0.0034018252,0.0008895624,0.006107667,0.0066999365],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026369842,0.0006652056,0.016260002,0.00072241237,0.00085455854,0.00039049465,0.00045500498,0.40479773,0.0011149042,0.3045121,0.054105893,0.21348476],"study_design_scores_gemma":[0.00049626565,0.00032431752,0.005882371,0.0002492512,0.0005767486,0.0001812347,0.00011607563,0.5321989,0.0010837169,0.44689754,0.01191448,0.00007911096],"about_ca_topic_score_codex":0.006683246,"about_ca_topic_score_gemma":0.0070676827,"teacher_disagreement_score":0.036509074,"about_ca_system_score_codex":0.0019431879,"about_ca_system_score_gemma":0.0026356583,"threshold_uncertainty_score":0.12213498},"labels":[],"label_agreement":null},{"id":"W4386387103","doi":"10.1007/s10985-023-09605-8","title":"Dynamic Treatment Regimes Using Bayesian Additive Regression Trees for Censored Outcomes","year":2023,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; Health Resources and Services Administration; National Cancer Institute; U.S. Department of Health and Human Services","keywords":"Frequentist inference; Computer science; Bayesian probability; Machine learning; Context (archaeology); Regression; Artificial intelligence; Bayesian linear regression; Bayesian inference; Censored regression model; Regression analysis; Statistics; Mathematics","score_opus":0.1547498798526498,"score_gpt":0.4599385546441727,"score_spread":0.3051886747915229,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386387103","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006819723,0.00032982347,0.9911253,0.0002946914,0.000027588825,0.00006213977,0.0000855628,0.00024149417,0.001013672],"genre_scores_gemma":[0.5134891,0.0013192621,0.47736314,0.0003745499,0.00018449711,0.0006619902,0.00064956455,0.00027310586,0.0056848465],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9945094,0.0036586788,0.00019577194,0.0005462089,0.0007725287,0.00031749177],"domain_scores_gemma":[0.98838985,0.008980665,0.0012217835,0.0004780892,0.0006810841,0.00024867122],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011498882,0.0010067769,0.0019951882,0.0018319834,0.0006124299,0.0016008797,0.00240475,0.001953941,0.003540671],"category_scores_gemma":[0.029073616,0.0007414911,0.001676766,0.00200812,0.0010017772,0.0023579372,0.0016103834,0.0029982335,0.000794359],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010076237,0.000073851756,0.0015686653,0.000081134116,0.00007268031,0.000080817656,0.00012294846,0.84317726,0.0003570783,0.08305966,0.001895144,0.069409996],"study_design_scores_gemma":[0.0000143265015,0.000026778653,0.00021653516,0.000018282033,0.000015138947,0.000020424804,0.000009236626,0.9589029,0.000107330976,0.039904397,0.0007540074,0.000010609607],"about_ca_topic_score_codex":0.0067463317,"about_ca_topic_score_gemma":0.0063244496,"teacher_disagreement_score":0.011498882,"about_ca_system_score_codex":0.002039442,"about_ca_system_score_gemma":0.002104405,"threshold_uncertainty_score":0.060812652},"labels":[],"label_agreement":null},{"id":"W4386404572","doi":"10.1093/biostatistics/kxad022","title":"Variable selection in high dimensions for discrete-outcome individualized treatment rules: Reducing severity of depression symptoms","year":2023,"lang":"en","type":"article","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; McGill University","funders":"National Institute of Mental Health; National Institutes of Health","keywords":"Depression (economics); Outcome (game theory); Feature selection; Selection (genetic algorithm); Variable (mathematics); Econometrics; Medicine; Statistics; Computer science; Internal medicine; Artificial intelligence; Mathematics; Mathematical economics; Economics","score_opus":0.10470571346149896,"score_gpt":0.41863948485896896,"score_spread":0.31393377139747003,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386404572","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09116226,0.00020512768,0.90636027,0.0009639319,0.000036029414,0.00018509751,0.000090562826,0.0001962207,0.0008005991],"genre_scores_gemma":[0.7306621,0.0001858306,0.26746905,0.00028068712,0.00007005323,0.0003464123,0.00027035305,0.000039191695,0.0006764324],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9907314,0.007529833,0.00027343386,0.000621517,0.00062938896,0.00021444188],"domain_scores_gemma":[0.95521986,0.03895224,0.0024517195,0.0020242308,0.00096371374,0.0003882461],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0138613405,0.00049123884,0.001478385,0.0008148821,0.0004944696,0.0011292143,0.0015669462,0.0010126092,0.0016710662],"category_scores_gemma":[0.054812565,0.0004562411,0.00086597237,0.00079442904,0.0009795952,0.001117104,0.0015184423,0.0019996585,0.00018143332],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063596753,0.0007030197,0.02876829,0.00024678817,0.0004864789,0.00027002455,0.0005115008,0.64780843,0.001593824,0.06280566,0.0029211768,0.25324884],"study_design_scores_gemma":[0.00009971081,0.00011903632,0.001994263,0.000022778031,0.000040292838,0.000025974061,0.000041546074,0.97129434,0.0005290021,0.025414834,0.0004035285,0.000014769865],"about_ca_topic_score_codex":0.003112072,"about_ca_topic_score_gemma":0.003679612,"teacher_disagreement_score":0.0138613405,"about_ca_system_score_codex":0.0007458996,"about_ca_system_score_gemma":0.0016039173,"threshold_uncertainty_score":0.07330668},"labels":[],"label_agreement":null},{"id":"W4386518242","doi":"10.1353/obs.2023.a906627","title":"Using Pilot Data for Power Analysis of Observational Studies for the Estimation of Dynamic Treatment Regimes","year":2023,"lang":"en","type":"article","venue":"Observational Studies","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Institute of Mental Health; National Institutes of Health","keywords":"Observational study; Sample size determination; A priori and a posteriori; Computer science; Outcome (game theory); Sample (material); Set (abstract data type); Power analysis; Population; Range (aeronautics); Value (mathematics); Econometrics; Statistics; Data mining; Medicine; Mathematics; Machine learning; Algorithm; Engineering","score_opus":0.8646860751030502,"score_gpt":0.5938313047322161,"score_spread":0.27085477037083405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386518242","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0067789904,0.0002773797,0.9888536,0.00037124837,0.00010773756,0.0016298655,0.0002889995,0.00025143672,0.001440714],"genre_scores_gemma":[0.2657373,0.00042275616,0.7228011,0.00051275163,0.00018176588,0.0090053305,0.00056188303,0.00013178238,0.00064531446],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.82970667,0.15201394,0.005021992,0.0052117864,0.007434551,0.00061104435],"domain_scores_gemma":[0.3369825,0.58602977,0.022445135,0.045778986,0.007888884,0.00087474316],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18293071,0.0015070273,0.0020590553,0.0032637196,0.0009864729,0.0021988614,0.0029082627,0.003043053,0.008982525],"category_scores_gemma":[0.57546663,0.0012193164,0.003267881,0.003296384,0.0038378085,0.004337647,0.0036407716,0.005201168,0.0008693247],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028086144,0.0010312872,0.052025065,0.0037172844,0.0026632121,0.0010579801,0.0033854488,0.09506667,0.004707536,0.30957812,0.008780031,0.51517874],"study_design_scores_gemma":[0.0021425507,0.0056924643,0.020850966,0.0018905951,0.0010609583,0.000857903,0.0006564119,0.36184162,0.0064459024,0.57076013,0.027596856,0.00020361044],"about_ca_topic_score_codex":0.0014595177,"about_ca_topic_score_gemma":0.0011246937,"teacher_disagreement_score":0.8170693,"about_ca_system_score_codex":0.00114886,"about_ca_system_score_gemma":0.0024221588,"threshold_uncertainty_score":0.9674416},"labels":[],"label_agreement":null},{"id":"W4386655763","doi":"10.48550/arxiv.2309.05639","title":"Forecasted Treatment Effects","year":2023,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada; Canada Research Chairs; McMaster University","keywords":"Environmental science","score_opus":0.43589951981110575,"score_gpt":0.30973709825296974,"score_spread":0.126162421558136,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386655763","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028702904,0.0013196685,0.95915645,0.0029055239,0.00047185217,0.00034611998,0.0015907678,0.000311734,0.0051949676],"genre_scores_gemma":[0.6857721,0.002904521,0.29711187,0.0012027096,0.0008331046,0.0014717795,0.0017553075,0.00012041746,0.008828105],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99124473,0.0051228493,0.0003068146,0.0018107329,0.0010930224,0.0004218818],"domain_scores_gemma":[0.9409402,0.048162024,0.004115511,0.004971213,0.001453906,0.00035718534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023565443,0.0010201955,0.002372613,0.002037853,0.00056135055,0.002293276,0.003019957,0.0036695702,0.009139523],"category_scores_gemma":[0.110720724,0.0006685797,0.0016477109,0.0018624186,0.0018024464,0.0038020445,0.0012088985,0.0037868242,0.0010203258],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042124806,0.0002835824,0.010820061,0.00057659653,0.00052299746,0.00020146876,0.00040175856,0.19474499,0.0010255283,0.6348112,0.0045791497,0.15161145],"study_design_scores_gemma":[0.00013975275,0.00021729966,0.002984217,0.000218934,0.00033977497,0.00007419142,0.00010044284,0.30320066,0.0017885291,0.6836543,0.00721305,0.000068883215],"about_ca_topic_score_codex":0.0037410446,"about_ca_topic_score_gemma":0.002173372,"teacher_disagreement_score":0.023565443,"about_ca_system_score_codex":0.002030534,"about_ca_system_score_gemma":0.0021720375,"threshold_uncertainty_score":0.12462747},"labels":[],"label_agreement":null},{"id":"W4386738802","doi":"10.1088/1742-6596/2580/1/012044","title":"Instrumental variables matter: towards causal inference using deep learning","year":2023,"lang":"en","type":"article","venue":"Journal of Physics Conference Series","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; University of Alberta","funders":"","keywords":"Causal inference; Inference; Artificial intelligence; Computer science; Machine learning; Instrumental variable; Casual; Artificial neural network; Causal model; Field (mathematics); Outcome (game theory); Econometrics; Mathematics; Statistics","score_opus":0.1313180717800485,"score_gpt":0.38890661842647195,"score_spread":0.25758854664642344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386738802","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019910399,0.0008454341,0.9728953,0.00301317,0.00008748298,0.0000662259,0.00043052417,0.0005783488,0.0021730699],"genre_scores_gemma":[0.74974996,0.0011703055,0.24082653,0.0019217874,0.00033414736,0.00024469648,0.0009598518,0.000176313,0.0046163863],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9966704,0.002071347,0.00013071828,0.00058082584,0.0003580672,0.00018864498],"domain_scores_gemma":[0.96974516,0.026346471,0.0013861895,0.0013069739,0.00081546546,0.0003997165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010057101,0.0010375902,0.0016173557,0.0018686686,0.0007851424,0.0019782984,0.0021899743,0.0014129147,0.0067046923],"category_scores_gemma":[0.03971311,0.00091064454,0.0013977188,0.0015943462,0.0021661227,0.002769007,0.0026171124,0.005257098,0.00049744244],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040365034,0.00028520246,0.021413269,0.0005862479,0.0007264674,0.00035638735,0.0004014163,0.4752419,0.00061906304,0.3206776,0.008991732,0.170297],"study_design_scores_gemma":[0.000039034847,0.000018390127,0.00073337206,0.00007824444,0.00005013999,0.000019799128,0.000022093442,0.7611471,0.0003060637,0.2363606,0.0012152183,0.0000099457],"about_ca_topic_score_codex":0.008943701,"about_ca_topic_score_gemma":0.008933516,"teacher_disagreement_score":0.010057101,"about_ca_system_score_codex":0.0018160034,"about_ca_system_score_gemma":0.003159064,"threshold_uncertainty_score":0.053187728},"labels":[],"label_agreement":null},{"id":"W4386790508","doi":"10.31234/osf.io/k2gzp","title":"The Causal Cookbook: Recipes for Propensity Scores, G-Computation, and Doubly Robust Standardization","year":2023,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Institut de Valorisation des Données","keywords":"Standardization; Propensity score matching; Computation; Computer science; Econometrics; Statistics; Mathematics; Algorithm; Operating system","score_opus":0.34445286847481943,"score_gpt":0.4287171338974771,"score_spread":0.08426426542265769,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386790508","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00015206709,0.000592173,0.99329114,0.00077908364,0.0003138197,0.00010022631,0.00056974357,0.0011277596,0.0030739864],"genre_scores_gemma":[0.004249913,0.0009799259,0.98645675,0.000550047,0.00029733262,0.0006369416,0.00047456648,0.0014816526,0.0048728543],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.997265,0.0014317298,0.00023061135,0.00033671665,0.0006519457,0.00008394128],"domain_scores_gemma":[0.9927007,0.0050383885,0.00028144073,0.0011908085,0.00063700945,0.00015162911],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0068373242,0.0023147254,0.0013504885,0.0027517723,0.0010182443,0.0022252547,0.0026500346,0.0024802503,0.061435092],"category_scores_gemma":[0.03833308,0.0013259244,0.0019484514,0.0032401094,0.0021268982,0.0035524264,0.0026316603,0.0059594414,0.022158612],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004008618,0.00006466223,0.00027724006,0.0005033794,0.00006467789,0.00023423004,0.00024978287,0.009924321,0.00064252835,0.73846316,0.09060938,0.15892652],"study_design_scores_gemma":[0.00004872679,0.000022534015,0.00021180451,0.00014018435,0.000022487946,0.00017109633,0.00003577103,0.028292596,0.0004926524,0.8611014,0.10940548,0.00005522169],"about_ca_topic_score_codex":0.0030233643,"about_ca_topic_score_gemma":0.004927902,"teacher_disagreement_score":0.9931627,"about_ca_system_score_codex":0.0011926696,"about_ca_system_score_gemma":0.0024875316,"threshold_uncertainty_score":0.20552087},"labels":[],"label_agreement":null},{"id":"W4386878567","doi":"10.1002/sim.9899","title":"Addressing missing data in the estimation of time‐varying treatments in comparative effectiveness research","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Medical Research Council; Medical Research Council Canada","keywords":"Missing data; Inverse probability weighting; Imputation (statistics); Weighting; Confounding; Statistics; Inverse probability; Covariate; Econometrics; Computer science; Mathematics; Medicine; Posterior probability; Propensity score matching; Bayesian probability","score_opus":0.6914773159287642,"score_gpt":0.6378653717663129,"score_spread":0.0536119441624513,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386878567","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037572694,0.006480613,0.984278,0.002398824,0.00039040495,0.0009185566,0.00029296128,0.00017083455,0.0013124581],"genre_scores_gemma":[0.17945355,0.008794849,0.80268943,0.001966842,0.00069423416,0.004986374,0.00053538725,0.00015877628,0.0007205687],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.54254216,0.4296343,0.00823657,0.00747027,0.010988819,0.0011278228],"domain_scores_gemma":[0.4054809,0.5604142,0.016151128,0.013274547,0.0040448657,0.00063436205],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.30661985,0.0026276708,0.006989851,0.005929638,0.0015371676,0.004398294,0.006267223,0.005644788,0.006920725],"category_scores_gemma":[0.5724815,0.0022647122,0.0085889725,0.008425967,0.005238302,0.007647086,0.005390102,0.010463228,0.00079298747],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013523303,0.0004717813,0.011491155,0.008246976,0.008726136,0.00036028266,0.0018979327,0.1661641,0.0004387258,0.48253497,0.0054146764,0.312901],"study_design_scores_gemma":[0.0009218707,0.0010763893,0.0027620632,0.00397324,0.0022640105,0.0002541168,0.00029720218,0.23270631,0.0011783879,0.7417546,0.012587033,0.00022476465],"about_ca_topic_score_codex":0.00612346,"about_ca_topic_score_gemma":0.0036325452,"teacher_disagreement_score":0.6933801,"about_ca_system_score_codex":0.004543566,"about_ca_system_score_gemma":0.00933388,"threshold_uncertainty_score":0.8550612},"labels":[],"label_agreement":null},{"id":"W4386937233","doi":"10.54254/2755-2721/6/20230930","title":"Multi-treatment casual analysis using improved meta learner and uplift tree","year":2023,"lang":"en","type":"article","venue":"Applied and Computational Engineering","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Causal inference; Causality (physics); Computer science; Inference; Machine learning; Artificial intelligence; Focus (optics); Casual; Tree (set theory); Causal model; Process (computing); Econometrics; Mathematics; Statistics","score_opus":0.14686260789798092,"score_gpt":0.3694765840489,"score_spread":0.22261397615091907,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386937233","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009619313,0.00069871196,0.9872321,0.0006943633,0.00008064517,0.00015958624,0.00024410652,0.00042736443,0.00084386027],"genre_scores_gemma":[0.33535933,0.00092051574,0.65672755,0.0008434586,0.0002523777,0.0009298844,0.001020948,0.00030864688,0.003637372],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9875894,0.008694973,0.00050788955,0.001528763,0.0012796618,0.0003993476],"domain_scores_gemma":[0.9474444,0.04381417,0.0018767529,0.0036598975,0.0025682843,0.0006365691],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029098673,0.0011429759,0.0033520944,0.003436384,0.001388526,0.0023025079,0.0031382411,0.0020853975,0.0069587124],"category_scores_gemma":[0.061770733,0.0007669141,0.0043975944,0.0028116887,0.0011889022,0.004271261,0.002632584,0.0042734803,0.00063921366],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011026509,0.00062937854,0.026452718,0.0008789808,0.0024194792,0.0008520219,0.0012582043,0.337717,0.0013108596,0.20155974,0.010501013,0.41531783],"study_design_scores_gemma":[0.00011487297,0.00014994339,0.0012119595,0.00008179584,0.0004282854,0.00015081736,0.000094160445,0.8573931,0.00056876795,0.13701622,0.0027500622,0.00004007811],"about_ca_topic_score_codex":0.004945214,"about_ca_topic_score_gemma":0.00520387,"teacher_disagreement_score":0.029098673,"about_ca_system_score_codex":0.0018968324,"about_ca_system_score_gemma":0.003541509,"threshold_uncertainty_score":0.15389031},"labels":[],"label_agreement":null},{"id":"W4387033470","doi":"10.1177/09622802231202384","title":"Marginal structural models with latent class growth analysis of treatment trajectories: Statins for primary prevention among older adults","year":2023,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; University of Manitoba; Institut National de Santé Publique du Québec; McGill University Health Centre; Université de Sherbrooke; Université Laval; Université de Montréal; McGill University; Centre hospitalier de l'Université Laval","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research; Université Laval","keywords":"Marginal structural model; Covariate; Confounding; Latent class model; Proportional hazards model; Estimator; Statistics; Econometrics; Confidence interval; Latent variable; Estimating equations; Inverse probability; Computer science; Mathematics; Medicine; Bayesian probability; Posterior probability","score_opus":0.2977127906117732,"score_gpt":0.5958492655166311,"score_spread":0.2981364749048579,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387033470","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05370562,0.00035433035,0.9438305,0.0006358169,0.000034078166,0.00018588107,0.00048160943,0.00022000639,0.00055214897],"genre_scores_gemma":[0.684976,0.0006372265,0.30999336,0.00014481756,0.000072562965,0.00073906063,0.0013199252,0.000096849544,0.0020202503],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99543947,0.003623421,0.000097163276,0.0003839219,0.00030402138,0.00015196539],"domain_scores_gemma":[0.9799154,0.016416118,0.0010958199,0.0014256438,0.00094753224,0.00019945804],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013868819,0.0008079123,0.0010743606,0.0017237944,0.000627044,0.001095103,0.0020128416,0.0007302897,0.002347401],"category_scores_gemma":[0.037579875,0.000341988,0.0020510752,0.0019611304,0.0012990272,0.001466638,0.0020052353,0.0022341637,0.00026484596],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006010961,0.00024532463,0.07429375,0.0002798285,0.0007779866,0.0002833007,0.0016775642,0.45554897,0.0008884882,0.2864519,0.003152848,0.17579901],"study_design_scores_gemma":[0.00003356178,0.000057185985,0.0043044547,0.000035306002,0.00006876882,0.000038690134,0.00012845953,0.9028611,0.00019108882,0.09125916,0.0010010572,0.0000211638],"about_ca_topic_score_codex":0.040154714,"about_ca_topic_score_gemma":0.037778005,"teacher_disagreement_score":0.040154714,"about_ca_system_score_codex":0.0021952812,"about_ca_system_score_gemma":0.0026973202,"threshold_uncertainty_score":0.07984197},"labels":[],"label_agreement":null},{"id":"W4387362492","doi":"10.1080/00031305.2023.2267597","title":"Causal Quartets: Different Ways to Attain the Same Average Treatment Effect","year":2023,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Science North","funders":"","keywords":"Variation (astronomy); Context (archaeology); Simple (philosophy); Epistemology; Mathematical economics; Mathematics; Computer science; Econometrics; Sociology; Philosophy; History; Physics","score_opus":0.10626714617887423,"score_gpt":0.4161824036868427,"score_spread":0.30991525750796844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387362492","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04550739,0.0016899493,0.8757094,0.014049871,0.0009988064,0.00029715293,0.0016287522,0.0014119233,0.05870676],"genre_scores_gemma":[0.7709697,0.001488308,0.21453696,0.0038194833,0.0004640726,0.00086166937,0.00067681016,0.0006658357,0.0065172696],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9923349,0.0048818327,0.00026752797,0.0012404415,0.00088299776,0.00039221632],"domain_scores_gemma":[0.95170236,0.035893343,0.0026897131,0.007522458,0.0015121996,0.0006799216],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.012325155,0.000798135,0.0011874054,0.0029118932,0.0017257041,0.0038671622,0.0016255172,0.0027131191,0.020219529],"category_scores_gemma":[0.080889225,0.00052573445,0.0016991178,0.003227874,0.007220677,0.008570829,0.0028847833,0.0048752995,0.0017052712],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006642718,0.000026883734,0.0010324107,0.00012822625,0.000077275065,0.00009432637,0.0003530999,0.0034420744,0.0003085595,0.9630449,0.0054717823,0.025954034],"study_design_scores_gemma":[0.00003619991,0.000026873615,0.00063772936,0.000031399268,0.000028500452,0.000060919418,0.00008039554,0.005357286,0.00022050228,0.9894992,0.00400716,0.000013913768],"about_ca_topic_score_codex":0.0013240095,"about_ca_topic_score_gemma":0.0012778784,"teacher_disagreement_score":0.98767483,"about_ca_system_score_codex":0.0017225237,"about_ca_system_score_gemma":0.001008665,"threshold_uncertainty_score":0.06764108},"labels":[],"label_agreement":null},{"id":"W4387392109","doi":"10.1002/bimj.202300027","title":"On “Reflections on the concept of optimality of single decision point treatment regimes”","year":2023,"lang":"en","type":"article","venue":"Biometrical Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; McGill University","funders":"Fonds de Recherche du Québec - Santé; Canadian Institutes of Health Research","keywords":"CONTEST; Point (geometry); Computer science; Mathematical economics; Operations research; Single point; Economics; Epistemology; Mathematics; Artificial intelligence; Philosophy; Political science; Law","score_opus":0.48936684789558677,"score_gpt":0.5017442050474353,"score_spread":0.012377357151848567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387392109","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034834486,0.011234625,0.34673792,0.56069374,0.0052124467,0.00023541045,0.0005318262,0.00019286797,0.07167768],"genre_scores_gemma":[0.35269138,0.009063823,0.325998,0.27977958,0.0154545205,0.0021379644,0.000265036,0.00061545754,0.0139942095],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9081541,0.06532419,0.0030773343,0.0075338236,0.014126633,0.0017839635],"domain_scores_gemma":[0.8409704,0.13999686,0.00393388,0.008477398,0.005942415,0.0006790808],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11122208,0.001000685,0.002679813,0.0015631663,0.0025601387,0.0065336516,0.0071995254,0.014034631,0.0077487403],"category_scores_gemma":[0.1595203,0.0010170474,0.0035024881,0.0018783263,0.044563778,0.016529417,0.0038741892,0.03139842,0.0014632439],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017939572,0.000008526927,0.00003112738,0.000041030504,0.000014661862,0.00000802142,0.00015391379,0.00063248014,0.000019272637,0.9891339,0.0065210746,0.003418055],"study_design_scores_gemma":[0.00002207363,0.000014334683,0.000057538287,0.000088964785,0.000010544211,0.0000101423675,0.000035790377,0.0015119348,0.00011226818,0.9876107,0.010508359,0.000017340568],"about_ca_topic_score_codex":0.004408449,"about_ca_topic_score_gemma":0.0021425234,"teacher_disagreement_score":0.11122208,"about_ca_system_score_codex":0.007905885,"about_ca_system_score_gemma":0.0054883896,"threshold_uncertainty_score":0.5882056},"labels":[],"label_agreement":null},{"id":"W4387493333","doi":"10.1007/s11121-023-01590-6","title":"Sample Size Requirements to Test Subgroup-Specific Treatment Effects in Cluster-Randomized Trials","year":2023,"lang":"en","type":"article","venue":"Prevention Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Center for Advancing Translational Sciences; National Institute on Aging; Patient-Centered Outcomes Research Institute","keywords":"CRTS; Sample size determination; Statistics; Subgroup analysis; Randomized controlled trial; Econometrics; Restricted randomization; Treatment and control groups; Statistical power; Mathematics; Medicine; Randomization; Computer science; Confidence interval; Internal medicine","score_opus":0.36915600751963046,"score_gpt":0.5157750821082986,"score_spread":0.14661907458866813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387493333","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059513533,0.0015323403,0.9608709,0.0034983165,0.0009790409,0.021501185,0.0011472048,0.0005098872,0.0040097744],"genre_scores_gemma":[0.10644807,0.0008748074,0.7980546,0.0024144785,0.0005488603,0.08954632,0.00097455,0.00024897532,0.00088930584],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.52899075,0.3916802,0.033756714,0.012905705,0.03057237,0.0020943158],"domain_scores_gemma":[0.21362674,0.72623205,0.011288883,0.033345666,0.014328422,0.0011782945],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.43441933,0.0026821527,0.0072680297,0.0041914606,0.0022489382,0.004184024,0.0068767103,0.0076567857,0.010863076],"category_scores_gemma":[0.77166855,0.0024553814,0.006055478,0.0041968934,0.0053601325,0.008181655,0.0056081186,0.0093420185,0.0018429533],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010666627,0.0008036323,0.012055841,0.00938529,0.0042795935,0.00092339836,0.0030987558,0.04330421,0.0026040322,0.6129385,0.021381028,0.2785591],"study_design_scores_gemma":[0.012054377,0.0055251447,0.0061895885,0.003454709,0.0020905817,0.0009920981,0.0005398191,0.15666427,0.0065739295,0.76694745,0.038695704,0.00027244736],"about_ca_topic_score_codex":0.0015801424,"about_ca_topic_score_gemma":0.0011786136,"teacher_disagreement_score":0.56558067,"about_ca_system_score_codex":0.0027985866,"about_ca_system_score_gemma":0.008808985,"threshold_uncertainty_score":0.69746166},"labels":[],"label_agreement":null},{"id":"W4387566508","doi":"10.1017/9781316718636.014","title":"Mixing Models","year":2023,"lang":"en","type":"book-chapter","venue":"Cambridge University Press eBooks","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Mixing (physics); Computer science; Data science; Observational study; Inference; Artificial intelligence; Machine learning; Mathematics; Statistics; Physics","score_opus":0.20050221067260104,"score_gpt":0.310172993102039,"score_spread":0.10967078242943795,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387566508","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002927018,0.0027926487,0.91167927,0.0032253996,0.0005648118,0.00008676385,0.0009977572,0.00064139464,0.07708482],"genre_scores_gemma":[0.26853526,0.01017587,0.556352,0.0036699502,0.0021052815,0.0009402457,0.004604288,0.001586431,0.1520307],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99587375,0.0022658715,0.00016069511,0.0007820951,0.00065137836,0.00026613925],"domain_scores_gemma":[0.99268955,0.005297889,0.0003474543,0.0009878866,0.00045346605,0.00022376211],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005074959,0.0017792358,0.0016166723,0.0016889016,0.0013584734,0.0042019007,0.0029335262,0.0028685837,0.04417695],"category_scores_gemma":[0.024012903,0.00085243146,0.0025372368,0.0018289256,0.0016591406,0.0055261194,0.0032317995,0.005100699,0.009781705],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000019603818,0.00002314549,0.00040051312,0.000065353604,0.00006673824,0.000054280994,0.00014166048,0.011954599,0.000110641915,0.95381767,0.009667954,0.023677846],"study_design_scores_gemma":[0.000011680146,0.000010575707,0.00014522467,0.000059563376,0.000024638362,0.000082168066,0.000034074397,0.04621084,0.00009304781,0.9216705,0.031640142,0.00001758381],"about_ca_topic_score_codex":0.0036757295,"about_ca_topic_score_gemma":0.0038601079,"teacher_disagreement_score":0.04417695,"about_ca_system_score_codex":0.0016953538,"about_ca_system_score_gemma":0.0011642134,"threshold_uncertainty_score":0.14778668},"labels":[],"label_agreement":null},{"id":"W4387664142","doi":"10.1117/12.3009382","title":"Application of propensity score and random forest in the causal inference: the causality of stroke","year":2023,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta; University of Toronto","funders":"","keywords":"Propensity score matching; Causal inference; Causality (physics); Stroke (engine); Weighting; Matching (statistics); Heart disease; Random forest; Disease; Medicine; Statistics; Econometrics; Computer science; Artificial intelligence; Internal medicine; Mathematics","score_opus":0.19599021130830027,"score_gpt":0.40765954338558885,"score_spread":0.21166933207728858,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387664142","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0133185005,0.00088239997,0.98434204,0.00059322634,0.000082185405,0.00009517912,0.00013922146,0.00011888328,0.00042843007],"genre_scores_gemma":[0.53537244,0.002167176,0.4583225,0.00056548585,0.0005527492,0.0005039779,0.0007983558,0.00008571755,0.001631658],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9778416,0.01924632,0.00046403767,0.0011964829,0.0009945962,0.00025695362],"domain_scores_gemma":[0.9244936,0.06627754,0.0030137126,0.004496118,0.0013684534,0.00035049778],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039364584,0.00076665473,0.0017879877,0.0036981339,0.00093872665,0.0012116925,0.0014008791,0.0013140555,0.0030578761],"category_scores_gemma":[0.10505881,0.0005223864,0.0023971242,0.0041538645,0.0015475419,0.0021274935,0.001899928,0.002387851,0.00028370344],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006162091,0.0004305814,0.053736944,0.000534025,0.00271667,0.00068259146,0.00037689434,0.27366585,0.00067055755,0.38161397,0.004200969,0.28075475],"study_design_scores_gemma":[0.00018286849,0.00014404375,0.0057198047,0.0001070628,0.00038817592,0.00021319554,0.000059571015,0.54118407,0.00030679698,0.44907063,0.0025724876,0.00005128197],"about_ca_topic_score_codex":0.0077917236,"about_ca_topic_score_gemma":0.0050992887,"teacher_disagreement_score":0.039364584,"about_ca_system_score_codex":0.00059127767,"about_ca_system_score_gemma":0.0025991462,"threshold_uncertainty_score":0.20818233},"labels":[],"label_agreement":null},{"id":"W4387736567","doi":"10.1186/s12874-023-02062-9","title":"Longitudinal plasmode algorithms to evaluate statistical methods in realistic scenarios: an illustration applied to occupational epidemiology","year":2023,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"The Quebec Population Health Research Network; Université Laval","funders":"Medical Research Council; Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Medical Research Council Canada; Canadian Institutes of Health Research; Université Laval","keywords":"Covariate; Marginal structural model; Estimator; Statistics; Confidence interval; Nonparametric statistics; Coverage probability; Weighting; Computer science; Algorithm; Inverse probability; Inverse probability weighting; Mathematics; Medicine; Bayesian probability","score_opus":0.9221876644056204,"score_gpt":0.7397021868237371,"score_spread":0.18248547758188327,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387736567","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015292698,0.00039209795,0.9798432,0.00078640186,0.00006657974,0.00028321941,0.000320762,0.00093712367,0.0020779727],"genre_scores_gemma":[0.12084237,0.00037724536,0.87581336,0.00028451707,0.000044421613,0.0012979788,0.00043318557,0.0002300504,0.0006768373],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98754245,0.0106055075,0.00039826013,0.00046920066,0.0008311535,0.00015344121],"domain_scores_gemma":[0.82071084,0.16659632,0.0025691395,0.0048916056,0.0047358107,0.00049628405],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.028190834,0.0010144714,0.0010252515,0.0018666454,0.00075306103,0.0016705594,0.0021415367,0.002479698,0.0060638557],"category_scores_gemma":[0.13109773,0.000732769,0.00096266874,0.0016184895,0.0012865737,0.0019382411,0.0030682685,0.0025409637,0.00073651486],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030525704,0.0002902722,0.0076095546,0.00040921438,0.00016719464,0.00022179748,0.00037217772,0.7827025,0.000817897,0.099671,0.0057848436,0.1016483],"study_design_scores_gemma":[0.00008161072,0.0000953331,0.00046001154,0.000070381764,0.000013374637,0.000074726115,0.000043316555,0.968574,0.0005984007,0.027268711,0.0027020902,0.0000180639],"about_ca_topic_score_codex":0.004808922,"about_ca_topic_score_gemma":0.0032247058,"teacher_disagreement_score":0.97180915,"about_ca_system_score_codex":0.0014410671,"about_ca_system_score_gemma":0.0019281298,"threshold_uncertainty_score":0.14908916},"labels":[],"label_agreement":null},{"id":"W4387808596","doi":"10.3138/cpp.2022-058","title":"A Scientific Approach to Addressing Social Issues Using Administrative Data","year":2023,"lang":"fr","type":"article","venue":"Canadian Public Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"McMaster University; Carleton University; University of British Columbia","funders":"","keywords":"Political science; Humanities; Philosophy","score_opus":0.7379816920415992,"score_gpt":0.5430589899139062,"score_spread":0.19492270212769303,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387808596","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019477718,0.0039207037,0.9466188,0.017358206,0.00032641386,0.00093558076,0.0026642764,0.00021592341,0.008482295],"genre_scores_gemma":[0.41868266,0.0062537943,0.5640035,0.0020928525,0.0010565291,0.0031374518,0.002088822,0.00006497201,0.0026193326],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8603579,0.11083273,0.004683147,0.0064157927,0.016314173,0.0013964125],"domain_scores_gemma":[0.45288682,0.4842474,0.025867837,0.02215375,0.013729902,0.0011142973],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1289214,0.0014855032,0.0024166545,0.015691036,0.0042818724,0.009141773,0.0062041287,0.0030624745,0.0046775136],"category_scores_gemma":[0.36227894,0.0013234818,0.00324967,0.024509339,0.008353349,0.0083792405,0.0058801235,0.005023137,0.00048077633],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000094810515,0.00018685019,0.040223215,0.0016526838,0.0019976336,0.00039115144,0.0034888873,0.041179426,0.00023700381,0.8295826,0.0030128206,0.07795306],"study_design_scores_gemma":[0.00011672765,0.00013985441,0.012699816,0.0010003177,0.0005556079,0.00014771006,0.0025015043,0.08877532,0.00044498485,0.8689509,0.024568018,0.00009922697],"about_ca_topic_score_codex":0.14850114,"about_ca_topic_score_gemma":0.08787254,"teacher_disagreement_score":0.14850114,"about_ca_system_score_codex":0.012794216,"about_ca_system_score_gemma":0.03176442,"threshold_uncertainty_score":0.68180966},"labels":[],"label_agreement":null},{"id":"W4387878214","doi":"10.3233/faia230655","title":"Hydranet: A Neural Network for the Estimation of Multi-Valued Treatment Effects","year":2023,"lang":"en","type":"book-chapter","venue":"Frontiers in artificial intelligence and applications","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Ministerio de Ciencia e Innovación; Generalitat de Catalunya","keywords":"Benchmarking; Estimator; Artificial neural network; Computer science; Inference; Binary number; Machine learning; Artificial intelligence; Estimation; Causal inference; Range (aeronautics); Focus (optics); Data mining; Mathematics; Econometrics; Engineering; Statistics","score_opus":0.17950489085210808,"score_gpt":0.39937386434686517,"score_spread":0.2198689734947571,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387878214","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020118111,0.0009188922,0.99439234,0.00043413698,0.00011836954,0.00012602127,0.00035758995,0.00046392877,0.0011768333],"genre_scores_gemma":[0.099975556,0.0016887505,0.8879038,0.00088468037,0.00023910357,0.0010853341,0.0010815705,0.00031498392,0.0068262443],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9975804,0.0016317845,0.00009368155,0.0003234923,0.00031087617,0.000059663522],"domain_scores_gemma":[0.99421835,0.004748062,0.00027975667,0.00036457865,0.00029784546,0.00009146135],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008094342,0.0010489792,0.0014519236,0.0010183777,0.00039463656,0.0012186767,0.0023140768,0.0016691412,0.0072780205],"category_scores_gemma":[0.022884412,0.00055423763,0.001135138,0.0010767253,0.00088019687,0.0017076951,0.0019115382,0.002470843,0.0010579056],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057122204,0.00010561116,0.0026981938,0.0008224346,0.00079660694,0.00016875795,0.00011526173,0.25435624,0.0015341176,0.090389825,0.013977936,0.6344637],"study_design_scores_gemma":[0.000085917345,0.00011655688,0.0008711307,0.00013959706,0.00012742756,0.00010893833,0.00001707777,0.87475514,0.0010982768,0.116071805,0.0065764044,0.00003175221],"about_ca_topic_score_codex":0.0031031054,"about_ca_topic_score_gemma":0.005044957,"teacher_disagreement_score":0.008094342,"about_ca_system_score_codex":0.0010953654,"about_ca_system_score_gemma":0.0016344329,"threshold_uncertainty_score":0.04280746},"labels":[],"label_agreement":null},{"id":"W4388083703","doi":"10.33137/utjph.v4i1.41675","title":"Modeling Longitudinal Outcomes in a Small Matched-Pair Sample Motivated by Cardiovascular Data: A Simulation Study","year":2023,"lang":"en","type":"article","venue":"University of Toronto Journal of Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ted Rogers Centre for Heart Research; University Health Network; Public Health Ontario; University of Toronto","funders":"","keywords":"Generalized estimating equation; Gee; Statistics; Consistency (knowledge bases); Correlation; Sample size determination; Independence (probability theory); Mathematics; Econometrics; Estimating equations; Standard deviation; Propensity score matching; Sample (material); Maximum likelihood; Physics","score_opus":0.4156574511401765,"score_gpt":0.4214156494535488,"score_spread":0.00575819831337232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388083703","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8872843,0.0004988344,0.108258605,0.0006981386,0.000058635662,0.00035432383,0.00064419996,0.000096609896,0.0021064386],"genre_scores_gemma":[0.97362566,0.00021952207,0.024565328,0.00010647737,0.00002363046,0.00028869833,0.00048085634,0.000013770203,0.00067595893],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99673563,0.002567596,0.000080400794,0.00027889002,0.00016211603,0.00017534406],"domain_scores_gemma":[0.9401496,0.053077217,0.0024731883,0.0020888555,0.0014851907,0.00072596205],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011431948,0.0006240609,0.0009820571,0.00083611306,0.00059629726,0.0008452893,0.0016439196,0.0015260741,0.0028043],"category_scores_gemma":[0.036313504,0.00045708887,0.0014883052,0.00097402476,0.0008967773,0.0011067289,0.0011931134,0.0017421128,0.00015755791],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063444953,0.00056079467,0.042813193,0.00013340845,0.000351694,0.00047294036,0.0002584467,0.9301536,0.0002516077,0.016116375,0.00092578516,0.007327644],"study_design_scores_gemma":[0.00013312852,0.00019542123,0.0028234501,0.000029522374,0.00006765322,0.00005636645,0.00008529395,0.99149406,0.00017734927,0.004643585,0.00027746047,0.000016725446],"about_ca_topic_score_codex":0.018408664,"about_ca_topic_score_gemma":0.0106485365,"teacher_disagreement_score":0.018408664,"about_ca_system_score_codex":0.0012004954,"about_ca_system_score_gemma":0.0014169491,"threshold_uncertainty_score":0.06045866},"labels":[],"label_agreement":null},{"id":"W4388095903","doi":"10.1007/978-3-031-35763-3_3","title":"Optimal Transport for Counterfactual Estimation: A Method for Causal Inference","year":2023,"lang":"en","type":"book-chapter","venue":"Studies in systems, decision and control","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Agence Nationale de la Recherche","keywords":"Covariate; Counterfactual thinking; Causal inference; Dimension (graph theory); Population; Econometrics; Mathematics; Average treatment effect; Quantile; Inference; Variable (mathematics); Instrumental variable; Statistics; Propensity score matching; Computer science; Psychology; Artificial intelligence; Combinatorics; Medicine; Social psychology","score_opus":0.28676399856255574,"score_gpt":0.5008328927146684,"score_spread":0.2140688941521126,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388095903","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002049151,0.00020609118,0.9986966,0.00009964312,0.000045520206,0.000016418042,0.0000357702,0.00008122481,0.0006139312],"genre_scores_gemma":[0.04089535,0.0015597519,0.94832426,0.00022085855,0.00035460843,0.0005059921,0.00032432572,0.00054921675,0.007265567],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9939393,0.0043713246,0.0003015434,0.0006190781,0.00061789196,0.0001508365],"domain_scores_gemma":[0.98087376,0.016253725,0.0005025278,0.0014882343,0.0007449138,0.00013675998],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0107192835,0.0019162721,0.0034157839,0.002906796,0.0014757799,0.0035943557,0.0038405037,0.0031618208,0.0124861775],"category_scores_gemma":[0.041986533,0.0023894783,0.0041626254,0.00420534,0.0038766835,0.0059640226,0.0035768661,0.006271664,0.00208587],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000099148216,0.000052084855,0.00030508303,0.00032018137,0.0002570939,0.00010455135,0.00019773094,0.07235854,0.00049029314,0.8517006,0.004682193,0.06943246],"study_design_scores_gemma":[0.000024989004,0.000025298543,0.00010688143,0.00006283643,0.00008806168,0.00006033482,0.000027456204,0.30263054,0.0003924366,0.68975747,0.0067914203,0.00003225664],"about_ca_topic_score_codex":0.005634867,"about_ca_topic_score_gemma":0.0034844954,"teacher_disagreement_score":0.0124861775,"about_ca_system_score_codex":0.0023226761,"about_ca_system_score_gemma":0.0031283842,"threshold_uncertainty_score":0.05668968},"labels":[],"label_agreement":null},{"id":"W4388124846","doi":"10.2139/ssrn.4615304","title":"A Lower Bound on the Variance of Treatment Effects Across Sites in Multi-site Randomized Controlled Trials","year":2023,"lang":"en","type":"article","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Estimator; Statistics; Randomized controlled trial; Variance (accounting); Context (archaeology); Mathematics; Econometrics; Bayes' theorem; Upper and lower bounds; Average treatment effect; Randomized experiment; Bayesian probability; Medicine; Geography; Economics; Internal medicine","score_opus":0.1293247085524912,"score_gpt":0.4339198741289803,"score_spread":0.30459516557648914,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388124846","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009288255,0.015134994,0.95937455,0.006918931,0.0013452224,0.0013614105,0.0009002219,0.00075933046,0.004917187],"genre_scores_gemma":[0.40009704,0.011318601,0.5523687,0.010633183,0.0032804564,0.012878455,0.0021967702,0.0010108121,0.006216041],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.56088835,0.38239697,0.014216684,0.020287232,0.019342232,0.002868529],"domain_scores_gemma":[0.1022791,0.8595557,0.0067555653,0.025563037,0.0044505848,0.0013960036],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.35005793,0.005302926,0.023135638,0.005821461,0.0022655742,0.010342136,0.011276819,0.015627239,0.011521305],"category_scores_gemma":[0.64089596,0.0062229964,0.012974874,0.006889788,0.009726091,0.013660427,0.008314115,0.02729198,0.0013045786],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.016234294,0.0011590074,0.006360656,0.012401915,0.022988357,0.0009208203,0.0015640066,0.101353794,0.0021701308,0.63305926,0.014179727,0.18760799],"study_design_scores_gemma":[0.0042206137,0.0014801526,0.0019326289,0.0023861197,0.006882738,0.0005605919,0.00015441263,0.21586329,0.0014699252,0.75841045,0.0064937584,0.00014527196],"about_ca_topic_score_codex":0.001714639,"about_ca_topic_score_gemma":0.0013504089,"teacher_disagreement_score":0.64994204,"about_ca_system_score_codex":0.004278755,"about_ca_system_score_gemma":0.0065220236,"threshold_uncertainty_score":0.8014943},"labels":[],"label_agreement":null},{"id":"W4388398918","doi":"10.1002/sim.9940","title":"Principal stratification for quantile causal effects under partial compliance","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Fonds de Recherche du Québec - Santé; Institut de Valorisation des Données; Compute Canada","keywords":"Quantile; Econometrics; Causal inference; Copula (linguistics); Covariate; Missing data; Statistics; Bivariate analysis; Identifiability; Inference; Mathematics; Computer science; Artificial intelligence","score_opus":0.2595680897329376,"score_gpt":0.5012533153693227,"score_spread":0.24168522563638511,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388398918","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009640127,0.00018973305,0.98804945,0.0003324558,0.000033827815,0.00022812563,0.00017648688,0.00021732949,0.0011326037],"genre_scores_gemma":[0.46346888,0.00082171254,0.5280201,0.00067392277,0.00027172378,0.0027750486,0.0007761017,0.00020861541,0.0029838553],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96133935,0.029776398,0.0012456538,0.0037848682,0.0026951488,0.0011584861],"domain_scores_gemma":[0.7968297,0.16807334,0.008661927,0.021090407,0.0044849073,0.00085966947],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07234291,0.0012331329,0.003450699,0.0029852053,0.0016354355,0.0025359702,0.002903906,0.0026727049,0.010710736],"category_scores_gemma":[0.20440735,0.0012462218,0.0047670417,0.0031807416,0.0060237213,0.005185062,0.0054404954,0.005557362,0.00081659685],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002494219,0.00015975411,0.01660361,0.0003613902,0.00053192955,0.00044021697,0.0012970372,0.076710105,0.0005895548,0.83682245,0.0018499879,0.06438457],"study_design_scores_gemma":[0.000076314835,0.0001959315,0.004384249,0.0001336263,0.00015959151,0.00015010503,0.00015756337,0.3407289,0.0006220008,0.6503136,0.0030350375,0.00004314832],"about_ca_topic_score_codex":0.0051891664,"about_ca_topic_score_gemma":0.0025855924,"teacher_disagreement_score":0.07234291,"about_ca_system_score_codex":0.0017766157,"about_ca_system_score_gemma":0.003710673,"threshold_uncertainty_score":0.38259047},"labels":[],"label_agreement":null},{"id":"W4388430092","doi":"10.1515/jci-2022-0032","title":"Identification of in-sample positivity violations using regression trees: The PoRT algorithm","year":2023,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Agence Nationale de la Recherche; Rhode Island State Council on the Arts","keywords":"Covariate; Regression; Sample (material); Identification (biology); Observational study; Algorithm; Statistics; Tree (set theory); Regression analysis; Decision tree; Computer science; Mathematics; Econometrics; Psychology; Artificial intelligence; Biology","score_opus":0.19089771261834143,"score_gpt":0.4657380321503103,"score_spread":0.27484031953196886,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388430092","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024099989,0.00050757563,0.970548,0.0007852281,0.00008489344,0.00048409335,0.00076047424,0.0017000246,0.0010296827],"genre_scores_gemma":[0.23553115,0.00023785049,0.7596616,0.00054111064,0.00013580207,0.00097407534,0.0016505577,0.00041820967,0.00084971945],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9715451,0.022213658,0.0018446347,0.0020744414,0.0018756716,0.00044647144],"domain_scores_gemma":[0.71575284,0.25654468,0.0090693915,0.010202988,0.0071630925,0.0012670564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.057147864,0.0014978083,0.0019245005,0.004191616,0.0012276184,0.0028694088,0.0031614613,0.0021942097,0.005884234],"category_scores_gemma":[0.25413513,0.0010080265,0.0028517342,0.0034693254,0.001411594,0.002346117,0.003133358,0.0037460844,0.0011983447],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002441352,0.0005955824,0.13732535,0.0016997373,0.003584114,0.002065048,0.0009898368,0.20314905,0.002668529,0.06122975,0.028582098,0.5556696],"study_design_scores_gemma":[0.00028570017,0.00021866192,0.0045946115,0.00023987734,0.00049210247,0.00072281004,0.000111948284,0.8863148,0.0016272736,0.09916409,0.006177704,0.000050428636],"about_ca_topic_score_codex":0.0028126235,"about_ca_topic_score_gemma":0.0030056657,"teacher_disagreement_score":0.057147864,"about_ca_system_score_codex":0.0007059756,"about_ca_system_score_gemma":0.0033867708,"threshold_uncertainty_score":0.30223036},"labels":[],"label_agreement":null},{"id":"W4388454889","doi":"10.1093/jrsssc/qlad096","title":"Variable selection for individualised treatment rules with discrete outcomes","year":2023,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series C (Applied Statistics)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; National Institutes of Health","keywords":"Observational study; Feature selection; Variable (mathematics); Selection (genetic algorithm); Computer science; Machine learning; Data mining; Mathematics; Statistics","score_opus":0.05987198688175837,"score_gpt":0.3608529226673868,"score_spread":0.3009809357856284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388454889","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006632159,0.00029666862,0.99179274,0.00023431296,0.000055872777,0.00027956083,0.00014339924,0.00020629828,0.00035897075],"genre_scores_gemma":[0.19284433,0.0005040609,0.80115974,0.0004729924,0.00025064105,0.0021507775,0.0010352061,0.00013665926,0.0014455736],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95467454,0.036797777,0.0016975072,0.003889713,0.0023847588,0.00055555045],"domain_scores_gemma":[0.79728234,0.18702613,0.005169775,0.0063831075,0.003329242,0.0008093095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06382431,0.0011735265,0.0038575816,0.0028714752,0.0008505742,0.0027073633,0.0039048917,0.0023307598,0.006573423],"category_scores_gemma":[0.15633997,0.0010794217,0.0024282928,0.0023735003,0.002502131,0.0021653138,0.002462085,0.005009947,0.0010801624],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017512739,0.00045924657,0.010130899,0.0008604266,0.0013716429,0.00045703386,0.0006923167,0.3924713,0.001050281,0.20033279,0.0057922234,0.3846306],"study_design_scores_gemma":[0.0003742693,0.00019426967,0.00089029025,0.00012469548,0.000122654,0.00007543677,0.000036872778,0.81756485,0.00058217824,0.1779109,0.0020858042,0.000037686583],"about_ca_topic_score_codex":0.0021939613,"about_ca_topic_score_gemma":0.0017662713,"teacher_disagreement_score":0.06382431,"about_ca_system_score_codex":0.0011664974,"about_ca_system_score_gemma":0.0022478302,"threshold_uncertainty_score":0.33753926},"labels":[],"label_agreement":null},{"id":"W4388717130","doi":"10.3899/jrheum.2023-0499","title":"Statistical and Scientific Considerations Concerning the Interpretation, Replicability, and Transportability of Research Findings","year":2023,"lang":"en","type":"article","venue":"The Journal of Rheumatology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Observational study; Interpretation (philosophy); Psychology; Intervention (counseling); Population; Affect (linguistics); Statistical analysis; Management science; Cognitive psychology; Computer science; Statistics; Medicine; Mathematics; Environmental health; Engineering; Psychiatry","score_opus":0.24853913203660724,"score_gpt":0.4777099926540065,"score_spread":0.22917086061739925,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388717130","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069089234,0.023453522,0.9055168,0.04315105,0.005787287,0.0035962244,0.0012459906,0.00054076954,0.0097994],"genre_scores_gemma":[0.29882798,0.014689857,0.62246853,0.025424533,0.008951662,0.02233284,0.0014216973,0.00088300876,0.0049999007],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.30393964,0.5820563,0.048031613,0.023069285,0.040765923,0.0021372684],"domain_scores_gemma":[0.0625179,0.81432647,0.025493482,0.083488606,0.013507066,0.0006664948],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.66983366,0.002197484,0.007112321,0.00633277,0.0036432028,0.009996313,0.008773426,0.011044788,0.007891847],"category_scores_gemma":[0.9021216,0.0024493833,0.0067618014,0.011204942,0.03106113,0.017996278,0.008095882,0.01704471,0.0020164761],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001599703,0.00025452772,0.015190171,0.009721979,0.006724437,0.0016088558,0.0066415453,0.0142729515,0.0018387944,0.7076888,0.025946619,0.20851156],"study_design_scores_gemma":[0.00046080176,0.00064954313,0.0057190796,0.004658238,0.0014218045,0.0011155945,0.00078598177,0.015092303,0.0019394956,0.93088883,0.037055537,0.00021285546],"about_ca_topic_score_codex":0.0037337225,"about_ca_topic_score_gemma":0.0026232393,"teacher_disagreement_score":0.33016634,"about_ca_system_score_codex":0.0054969722,"about_ca_system_score_gemma":0.009605501,"threshold_uncertainty_score":0.4071539},"labels":[],"label_agreement":null},{"id":"W4388795592","doi":"10.1007/s10742-023-00317-y","title":"Propensity score weighting with survey weighted data when outcomes are binary: a simulation study","year":2023,"lang":"en","type":"article","venue":"Health Services and Outcomes Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre","funders":"National Cancer Institute; National Institute on Aging; National Cancer Center","keywords":"Propensity score matching; Weighting; Statistics; Observational study; Average treatment effect; Population; Mathematics; Econometrics; Medicine","score_opus":0.8783707654311809,"score_gpt":0.649225151849151,"score_spread":0.2291456135820299,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388795592","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58278507,0.0014571458,0.40421772,0.0019959852,0.00017102624,0.001941983,0.0012475182,0.0002577288,0.0059258323],"genre_scores_gemma":[0.9044993,0.00070570596,0.08913326,0.00032160353,0.00006169336,0.0016026042,0.00077210355,0.0000875728,0.0028161244],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9657358,0.030997697,0.00062035525,0.0012616281,0.0007136453,0.0006708605],"domain_scores_gemma":[0.5648664,0.4115831,0.0072503164,0.010834917,0.004100042,0.0013651176],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07097892,0.00168284,0.0033001835,0.0019461095,0.0011687034,0.0027770335,0.00369695,0.0036013622,0.011120949],"category_scores_gemma":[0.23914696,0.0014139102,0.003846386,0.003939694,0.002421249,0.004931827,0.0028012295,0.0052297176,0.00075818185],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009027547,0.0037250512,0.036106165,0.0008555762,0.0024242168,0.00081264775,0.0017305526,0.7381366,0.00030884924,0.15307914,0.005199931,0.04859371],"study_design_scores_gemma":[0.0020691752,0.00083392137,0.0021976822,0.00013726923,0.0005378081,0.00018479118,0.0003712347,0.9431131,0.00018700314,0.049290564,0.0010112292,0.000066170935],"about_ca_topic_score_codex":0.020276092,"about_ca_topic_score_gemma":0.0076389266,"teacher_disagreement_score":0.92902106,"about_ca_system_score_codex":0.002287161,"about_ca_system_score_gemma":0.0030178803,"threshold_uncertainty_score":0.37537688},"labels":[],"label_agreement":null},{"id":"W4388851130","doi":"10.1002/sim.9963","title":"Two‐stage targeted maximum likelihood estimation for mixed aggregate and individual participant data analysis with an application to multidrug resistant tuberculosis","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University; McMaster University","funders":"Canadian Institutes of Health Research","keywords":"Aggregate data; Weighting; Computer science; Missing data; Estimation; Tuberculosis; Aggregate (composite); Inverse probability weighting; Meta-analysis; Statistics; Population; Contrast (vision); Medicine; Econometrics; Machine learning; Artificial intelligence; Mathematics; Internal medicine; Estimator; Pathology","score_opus":0.1470997536980372,"score_gpt":0.4430485501490196,"score_spread":0.2959487964509824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388851130","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011912417,0.00051694154,0.99757725,0.00020820339,0.000039985305,0.00012619603,0.00007926829,0.0001220511,0.00013879867],"genre_scores_gemma":[0.07679463,0.0008154121,0.91878873,0.0005039438,0.00017047022,0.0014938698,0.00040562364,0.00014555747,0.00088185404],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.951552,0.042844158,0.0012302158,0.002413998,0.0016686969,0.00029096747],"domain_scores_gemma":[0.8623272,0.12713863,0.0030332657,0.0051007112,0.0019797108,0.00042052826],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05683197,0.0016659312,0.0034196426,0.0032909862,0.0007611655,0.0023814621,0.003346439,0.0022215154,0.0034721042],"category_scores_gemma":[0.13934258,0.0014592494,0.006172033,0.0034454144,0.0014267021,0.0026764597,0.003068032,0.004132041,0.0006685357],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010340235,0.00029164008,0.015177412,0.0039061708,0.010875997,0.0011000338,0.0010333782,0.3061823,0.002680245,0.26009974,0.006060535,0.39155853],"study_design_scores_gemma":[0.00036434995,0.000388761,0.0021437178,0.0003487865,0.0010615463,0.00034782404,0.000095507145,0.71116906,0.001093002,0.27411163,0.008767915,0.00010789338],"about_ca_topic_score_codex":0.0034212256,"about_ca_topic_score_gemma":0.003920983,"teacher_disagreement_score":0.05683197,"about_ca_system_score_codex":0.001249513,"about_ca_system_score_gemma":0.0031975156,"threshold_uncertainty_score":0.30055976},"labels":[],"label_agreement":null},{"id":"W4388865742","doi":"10.1007/s40471-023-00339-7","title":"Emulating a Target Trial in Perinatal Pharmacoepidemiology: Challenges and Methodological Approaches","year":2023,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"","keywords":"Pharmacoepidemiology; Randomized controlled trial; Emulation; Medicine; Observational study; Clinical trial; Context (archaeology); Translational research; Clinical study design; Translational science; Causal inference; Data science; Intensive care medicine; Computer science; Psychology; Pharmacology; Internal medicine; Pathology","score_opus":0.8642482365844785,"score_gpt":0.5896862401110604,"score_spread":0.27456199647341806,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388865742","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006058377,0.0034078988,0.9643779,0.022826815,0.00077955227,0.00060031324,0.00030128227,0.00019462172,0.0014532848],"genre_scores_gemma":[0.31314763,0.004294283,0.66201466,0.010256308,0.0027117769,0.004610025,0.0005077751,0.00028611426,0.0021714768],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.59753484,0.37856576,0.007954751,0.0082006585,0.0067099975,0.0010340048],"domain_scores_gemma":[0.16875893,0.8041946,0.008847346,0.013304119,0.0037733524,0.0011216142],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.43126383,0.0020378917,0.009036888,0.0018348659,0.0013929801,0.009249245,0.009255206,0.0057704444,0.007671608],"category_scores_gemma":[0.6837169,0.0018441983,0.005027059,0.0030075912,0.0074801883,0.0113734985,0.0057993005,0.014964086,0.0010140467],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003558357,0.00066677056,0.013766759,0.004222606,0.010990757,0.000810401,0.0011708802,0.10592907,0.00042675633,0.66944355,0.011166428,0.17784776],"study_design_scores_gemma":[0.0013201555,0.00050764944,0.0010043189,0.0006523618,0.0012389944,0.00020899858,0.00022542579,0.16020258,0.00032471702,0.8300494,0.004211169,0.000054201344],"about_ca_topic_score_codex":0.0033280854,"about_ca_topic_score_gemma":0.0024893438,"teacher_disagreement_score":0.5687362,"about_ca_system_score_codex":0.0026793224,"about_ca_system_score_gemma":0.009192231,"threshold_uncertainty_score":0.70135295},"labels":[],"label_agreement":null},{"id":"W4389036121","doi":"10.23889/ijpds.v8i1.2176","title":"Generating synthetic data from administrative health records for drug safety and effectiveness studies","year":2023,"lang":"en","type":"article","venue":"International Journal for Population Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université de Montréal; Manitoba Health; McGill University; University of Manitoba","funders":"Canadian Institutes of Health Research","keywords":"Real world data; Population; Medical prescription; Computer science; Medicine; Data science; Pharmacology; Environmental health","score_opus":0.5555152502297888,"score_gpt":0.5974494260819023,"score_spread":0.041934175852113564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389036121","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.58773994,0.0014771151,0.20582253,0.005103218,0.000648599,0.003950485,0.18848564,0.0019685316,0.0048039565],"genre_scores_gemma":[0.6684603,0.00052765454,0.19059674,0.00090662827,0.00020820039,0.0028416167,0.13572083,0.0001138391,0.0006242156],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9827911,0.011734458,0.0016179341,0.0019142781,0.001585301,0.00035691497],"domain_scores_gemma":[0.8845395,0.08250091,0.010219722,0.0142900115,0.0074296826,0.0010201205],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.034752935,0.0008954019,0.0007303579,0.003280087,0.0005703774,0.0018524915,0.0023349137,0.0011343322,0.0021370172],"category_scores_gemma":[0.108986996,0.0006774883,0.0023480006,0.0036818325,0.000801752,0.0009901838,0.0018328783,0.0014529382,0.000509216],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013573222,0.0006500478,0.43151498,0.0014162984,0.0016681311,0.00068682374,0.000905706,0.44099632,0.0008954389,0.022370582,0.035511695,0.062026653],"study_design_scores_gemma":[0.0011144056,0.00070488744,0.09730221,0.0008220474,0.00053107925,0.0005157219,0.00086197327,0.80975103,0.0025651685,0.046847347,0.038757347,0.00022678231],"about_ca_topic_score_codex":0.016540196,"about_ca_topic_score_gemma":0.013425955,"teacher_disagreement_score":0.034752935,"about_ca_system_score_codex":0.0023543031,"about_ca_system_score_gemma":0.0036161337,"threshold_uncertainty_score":0.1837933},"labels":[],"label_agreement":null},{"id":"W4389238863","doi":"10.1007/s12561-023-09403-8","title":"Use of Generalized Propensity Scores for Assessing Effects of Multiple Exposures","year":2023,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute on Alcohol Abuse and Alcoholism","keywords":"Confounding; Statistics; Conditional independence; Propensity score matching; Econometrics; Causal inference; Bivariate analysis; Joint probability distribution; Estimator; Inverse probability weighting; Causal model; Regression analysis; Marginal structural model; Weighting; Biostatistics; Conditional probability distribution; Mathematics; Medicine; Epidemiology","score_opus":0.32523508943013857,"score_gpt":0.4596776250189145,"score_spread":0.13444253558877595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389238863","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007408968,0.00019431714,0.9915895,0.00013072438,0.000023140066,0.000073166826,0.00006856987,0.0002215141,0.00029010186],"genre_scores_gemma":[0.2315317,0.0007257931,0.7656191,0.00017923432,0.0000872124,0.00043852336,0.00033679974,0.00018014273,0.00090147497],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9738584,0.021955183,0.0007643176,0.0013071307,0.0018271323,0.00028770466],"domain_scores_gemma":[0.9171844,0.0662945,0.0047925278,0.008871874,0.0022421696,0.0006144523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026864346,0.0013669059,0.0018548763,0.0048111975,0.00062697165,0.002424003,0.0018622476,0.0014362944,0.0033925842],"category_scores_gemma":[0.13343076,0.00068053976,0.002733044,0.0047602914,0.0023756688,0.0026007623,0.0034445797,0.003074747,0.0004216599],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046652567,0.00027174494,0.029201524,0.00068230956,0.002844566,0.0006940508,0.00077874766,0.10115982,0.003153409,0.44431436,0.0031710102,0.41326192],"study_design_scores_gemma":[0.0002254992,0.00034549198,0.0074549764,0.00013531868,0.0005596119,0.0005537303,0.0001822465,0.24886346,0.0018392627,0.7360252,0.0037296521,0.000085456726],"about_ca_topic_score_codex":0.0029658843,"about_ca_topic_score_gemma":0.002995293,"teacher_disagreement_score":0.026864346,"about_ca_system_score_codex":0.0008499694,"about_ca_system_score_gemma":0.003438689,"threshold_uncertainty_score":0.14207399},"labels":[],"label_agreement":null},{"id":"W4389372502","doi":"10.1136/archdischild-2023-326340","title":"Building a better model: abandon kitchen sink regression","year":2023,"lang":"en","type":"review","venue":"Archives of Disease in Childhood Fetal & Neonatal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick; Dalhousie University","funders":"","keywords":"Overfitting; Directed acyclic graph; Regression; Regression analysis; Computer science; Outcome (game theory); Feature selection; Model selection; Econometrics; Logistic regression; Machine learning; Artificial intelligence; Statistics; Mathematics","score_opus":0.10328008754121099,"score_gpt":0.4137124541359426,"score_spread":0.3104323665947316,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389372502","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015616628,0.26753294,0.69991946,0.024481252,0.0016086941,0.00010218701,0.00036147857,0.0005307956,0.003901626],"genre_scores_gemma":[0.07208068,0.3452186,0.5568851,0.013880433,0.0040184013,0.00064825884,0.0008549488,0.0009148194,0.005498762],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98746014,0.008910619,0.0006974555,0.0011801381,0.00161709,0.00013460765],"domain_scores_gemma":[0.9459052,0.048824858,0.0013656312,0.0019428849,0.0017260974,0.00023528277],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.022998612,0.0016376036,0.0033454879,0.00269295,0.0004267014,0.0029523463,0.0037064923,0.002335986,0.004218157],"category_scores_gemma":[0.061546855,0.0008556838,0.0030753068,0.0022792665,0.0027078795,0.0055231615,0.0020927049,0.007924922,0.0023871025],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011231541,0.00006114391,0.0015213139,0.009896432,0.0015165828,0.00027450058,0.0004875392,0.04002027,0.00035057272,0.3877469,0.030846488,0.52716595],"study_design_scores_gemma":[0.000081866456,0.00022337874,0.00075755594,0.0066921664,0.00052021863,0.0005334074,0.00026715948,0.05453074,0.0006629262,0.6217676,0.31383017,0.00013288796],"about_ca_topic_score_codex":0.0037248041,"about_ca_topic_score_gemma":0.0037164346,"teacher_disagreement_score":0.97700137,"about_ca_system_score_codex":0.0020312646,"about_ca_system_score_gemma":0.0036391078,"threshold_uncertainty_score":0.121629775},"labels":[],"label_agreement":null},{"id":"W4389487798","doi":"10.1093/aje/kwad241","title":"The application of target trials with longitudinal targeted maximum likelihood estimation to assess the effect of alcohol consumption in adolescence on depressive symptoms in adulthood","year":2023,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre Hospitalier de l’Université de Montréal; Université de Montréal","funders":"Cancer Research Society","keywords":"Alcohol consumption; Estimation; Longitudinal study; Maximum likelihood; Medicine; Alcohol; Depressive symptoms; Consumption (sociology); Longitudinal data; Psychiatry; Clinical psychology; Environmental health; Demography; Psychology; Statistics; Cognition; Biology; Mathematics","score_opus":0.12295481846560558,"score_gpt":0.45446400099653117,"score_spread":0.3315091825309256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389487798","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041171424,0.0010061886,0.99124557,0.00075333886,0.00017665669,0.0015710711,0.00022380876,0.00031319464,0.000593026],"genre_scores_gemma":[0.21613279,0.0018872282,0.75713766,0.0013445795,0.00041338365,0.020350562,0.00071091525,0.00029300436,0.0017300129],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.7962868,0.1886217,0.005051615,0.0060127457,0.0033718315,0.00065525033],"domain_scores_gemma":[0.63506186,0.33329338,0.010604706,0.016946325,0.0033428464,0.00075086084],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.24640596,0.0021739118,0.0064723142,0.0030888843,0.0011107208,0.0034061035,0.0059964946,0.00469399,0.008759806],"category_scores_gemma":[0.45664397,0.0020393422,0.008120798,0.0036254541,0.0034979028,0.0056666965,0.004927813,0.0070526507,0.001086036],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005445352,0.0009279076,0.021231389,0.0072095552,0.016190069,0.00088526617,0.0023415869,0.2010402,0.001215228,0.4108718,0.0089169135,0.32372472],"study_design_scores_gemma":[0.0019005004,0.0021080421,0.0031671366,0.0008538451,0.002847926,0.0003036451,0.00015001778,0.55581754,0.0011953237,0.4241829,0.0073415013,0.00013163684],"about_ca_topic_score_codex":0.003120637,"about_ca_topic_score_gemma":0.0023844389,"teacher_disagreement_score":0.24640596,"about_ca_system_score_codex":0.0023440777,"about_ca_system_score_gemma":0.0041362303,"threshold_uncertainty_score":0.9293156},"labels":[],"label_agreement":null},{"id":"W4389676925","doi":"10.1002/sim.9973","title":"Accommodating misclassification effects on optimizing dynamic treatment regimes with Q‐learning","year":2023,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Covariate; Computer science; Econometrics; Estimation; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.09089600466695962,"score_gpt":0.43294174638760535,"score_spread":0.3420457417206457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389676925","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008921116,0.0007098665,0.98807484,0.0012496897,0.00006474899,0.00012537118,0.00004503238,0.00012405412,0.0006853134],"genre_scores_gemma":[0.5589623,0.0019411105,0.43292302,0.0019773652,0.0003961952,0.0008646546,0.0002862398,0.00014473537,0.0025043841],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98252213,0.0135876825,0.00063784746,0.0016732622,0.0010318451,0.0005471485],"domain_scores_gemma":[0.8560436,0.12926506,0.005153809,0.0058156187,0.0028293275,0.0008926517],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04004045,0.0013740015,0.0033313485,0.0011858784,0.0010196558,0.0022827045,0.0029980084,0.0033445803,0.002799441],"category_scores_gemma":[0.13024619,0.000900294,0.0012710795,0.0015056588,0.0038902874,0.0035329387,0.0025377786,0.00478942,0.00044993154],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043843818,0.00028409154,0.008398351,0.00061677396,0.0003465769,0.00018318284,0.0004305218,0.60601234,0.00076972006,0.19671084,0.002946283,0.18286291],"study_design_scores_gemma":[0.00010808996,0.000107884734,0.00053554436,0.00009300137,0.000053021733,0.000053275056,0.00003059131,0.84083086,0.00054113264,0.15647419,0.0011458402,0.000026588177],"about_ca_topic_score_codex":0.0038430328,"about_ca_topic_score_gemma":0.0022247306,"teacher_disagreement_score":0.04004045,"about_ca_system_score_codex":0.002025051,"about_ca_system_score_gemma":0.004497904,"threshold_uncertainty_score":0.21175665},"labels":[],"label_agreement":null},{"id":"W4389899943","doi":"10.1111/jebm.12577","title":"Reporting, handling, and interpretation of time‐varying drug treatments in observational studies using routinely collected healthcare data","year":2023,"lang":"en","type":"article","venue":"Journal of Evidence-Based Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"National Natural Science Foundation of China","keywords":"Observational study; Discontinuation; Medicine; Logistic regression; Protocol (science); Pharmacoepidemiology; Meta-analysis; Internal medicine; Alternative medicine; Pharmacology; Pathology; Medical prescription","score_opus":0.8265753926692315,"score_gpt":0.5867571796628459,"score_spread":0.23981821300638562,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389899943","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043052416,0.86641395,0.042143617,0.008569231,0.0024880255,0.0073265596,0.025683438,0.00020977744,0.0041129715],"genre_scores_gemma":[0.5763487,0.2771503,0.08445607,0.012616952,0.0016822875,0.029982325,0.016608825,0.0002931426,0.00086135906],"study_design_codex":"systematic_review","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4059044,0.3280374,0.21469456,0.015135176,0.034487303,0.001741202],"domain_scores_gemma":[0.16649874,0.63291824,0.14627063,0.03273306,0.020900974,0.00067837187],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2865461,0.0019062598,0.005448453,0.012177957,0.0016794205,0.00560019,0.004313209,0.0032057606,0.002577228],"category_scores_gemma":[0.66567695,0.0023703272,0.00741293,0.018788746,0.0036841896,0.0060474216,0.003673289,0.002273928,0.0004711571],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018483782,0.000102869104,0.100245714,0.74553084,0.045094892,0.00050290243,0.006424033,0.0013769668,0.001015027,0.0061135585,0.008466169,0.083278716],"study_design_scores_gemma":[0.0013358698,0.00077962776,0.10010474,0.7212529,0.073147856,0.0013477815,0.004800073,0.0023334594,0.0037536477,0.016294675,0.07420982,0.00063953624],"about_ca_topic_score_codex":0.011758771,"about_ca_topic_score_gemma":0.011242361,"teacher_disagreement_score":0.7134539,"about_ca_system_score_codex":0.004823354,"about_ca_system_score_gemma":0.015527216,"threshold_uncertainty_score":0.8798157},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"systematic_review","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch"],"domain":"reporting","study_design":"observational","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4389989768","doi":"10.1016/j.jval.2023.11.011","title":"Unanchored Population-Adjusted Indirect Comparison Methods for Time-to-Event Outcomes Using Inverse Odds Weighting, Regression Adjustment, and Doubly Robust Methods With Either Individual Patient or Aggregate Data","year":2023,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MD Precision (Canada); Precision Nanosystems (Canada); University of British Columbia","funders":"Medical Research Council; Bristol-Myers Squibb","keywords":"Inverse probability weighting; Statistics; Propensity score matching; Weighting; Confidence interval; Regression; Population; Hazard ratio; Proportional hazards model; Standard error; Medicine; Econometrics; Mathematics","score_opus":0.5243210205611497,"score_gpt":0.5456246118675028,"score_spread":0.021303591306353065,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389989768","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031848887,0.0005061607,0.9947954,0.00023221623,0.00013000771,0.00016414466,0.0002350006,0.00015393032,0.000598236],"genre_scores_gemma":[0.0926023,0.0007791751,0.89931875,0.0003333595,0.00027270667,0.0017713938,0.00067176775,0.0003265705,0.0039239344],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9627656,0.030584712,0.001379997,0.0020364113,0.002907978,0.00032533426],"domain_scores_gemma":[0.9504257,0.037953548,0.002311169,0.007359818,0.0017135671,0.00023622194],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.049971245,0.0010549171,0.0017979121,0.002106967,0.00045114435,0.001854735,0.004029698,0.0011116852,0.008554064],"category_scores_gemma":[0.14639564,0.0006758045,0.0030864843,0.0022404972,0.0010414326,0.0024380113,0.0030232498,0.0036075707,0.00077626377],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017286967,0.00047486395,0.0064906795,0.0012669798,0.0053671324,0.0001534828,0.0005111643,0.03306499,0.0010987888,0.4143351,0.008355033,0.5271532],"study_design_scores_gemma":[0.0007684648,0.00064313906,0.0057380856,0.0006098576,0.0020659964,0.00031975136,0.00013723786,0.2994877,0.0024698637,0.66664964,0.020983664,0.00012651592],"about_ca_topic_score_codex":0.0022938247,"about_ca_topic_score_gemma":0.00297078,"teacher_disagreement_score":0.9500288,"about_ca_system_score_codex":0.00078367506,"about_ca_system_score_gemma":0.002421129,"threshold_uncertainty_score":0.26427633},"labels":[],"label_agreement":null},{"id":"W4390127909","doi":"10.1016/j.jval.2023.09.2170","title":"MSR111 Causal Inference and Statistical Considerations for Indirectly Comparing Time-to-Event Endpoints for Treatments with Different Starting Points for Outcome Assessment in Resectable NSCLC","year":2023,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Roche (Canada)","funders":"","keywords":"Outcome (game theory); Causal inference; Inference; Event (particle physics); Statistical inference; Medicine; Internal medicine; Computer science; Statistics; Artificial intelligence; Mathematics; Pathology","score_opus":0.31694711317792057,"score_gpt":0.49713635470914014,"score_spread":0.18018924153121957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390127909","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01922392,0.0021547417,0.9684598,0.006144985,0.0002625491,0.0002471952,0.0005666303,0.00022185476,0.0027184081],"genre_scores_gemma":[0.552328,0.0021464957,0.4326825,0.002626029,0.0011687842,0.0016057647,0.00088360667,0.00021382669,0.006344984],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9291144,0.063358426,0.0015098447,0.002853557,0.0027072825,0.00045645895],"domain_scores_gemma":[0.49996835,0.48324484,0.0049420474,0.008545776,0.0025888956,0.0007101663],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0922029,0.0014334981,0.0033136304,0.002332357,0.0007362801,0.0031930567,0.0035090416,0.0024503225,0.008675223],"category_scores_gemma":[0.30920354,0.001271307,0.00451054,0.002090933,0.004029495,0.0040607164,0.0026479117,0.0077211815,0.00041546722],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018831299,0.00029095518,0.0076070935,0.0011009942,0.0022886293,0.0005305385,0.00038981478,0.11756567,0.0006325641,0.75041205,0.0045433515,0.11275527],"study_design_scores_gemma":[0.00036834046,0.00026706845,0.0011261859,0.00012082701,0.0005256666,0.0001381336,0.00004731735,0.18671449,0.00048199232,0.80810577,0.002077693,0.000026578771],"about_ca_topic_score_codex":0.0029084962,"about_ca_topic_score_gemma":0.0019770353,"teacher_disagreement_score":0.0922029,"about_ca_system_score_codex":0.0020319074,"about_ca_system_score_gemma":0.003734485,"threshold_uncertainty_score":0.48762137},"labels":[],"label_agreement":null},{"id":"W4390166159","doi":"10.1101/2023.12.21.23300389","title":"Distributed Statistical Analyses: A Scoping Review and Examples of Operational Frameworks Adapted to Healthcare","year":2023,"lang":"en","type":"review","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Data science; Statistical inference; Pooling; Health care; Data mining; Workflow; Inference; USable; Statistical model; Management science; Machine learning; Artificial intelligence; Statistics; Mathematics","score_opus":0.5197468601909546,"score_gpt":0.5752067852484413,"score_spread":0.05545992505748665,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390166159","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003713794,0.9811162,0.011411217,0.0024507826,0.0005673541,0.0006178731,0.0002856004,0.000066445544,0.0031131774],"genre_scores_gemma":[0.005021665,0.9679905,0.023367908,0.0010828758,0.00019675249,0.0015872376,0.00027194602,0.000045029166,0.0004360489],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9678398,0.01653376,0.008179097,0.0017025988,0.0053137224,0.00043108023],"domain_scores_gemma":[0.8292181,0.1474162,0.006299412,0.0040426482,0.012633228,0.00039043164],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04336226,0.001776876,0.0032883189,0.029993476,0.0014241312,0.005952217,0.002718086,0.003637239,0.0040343395],"category_scores_gemma":[0.14318095,0.0012860456,0.0051859627,0.03193106,0.003344663,0.0052133105,0.0038867819,0.003643857,0.0011984622],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000777374,0.000059575494,0.00047477867,0.28756258,0.00073097047,0.0003198994,0.0021943308,0.0016769349,0.00053961226,0.056919597,0.016024033,0.63342],"study_design_scores_gemma":[0.000031895957,0.00007713519,0.001058733,0.62799364,0.0014273371,0.00046854815,0.0011599846,0.00074616453,0.00048074892,0.022199478,0.34427443,0.000081868624],"about_ca_topic_score_codex":0.0074321954,"about_ca_topic_score_gemma":0.012581868,"teacher_disagreement_score":0.95663774,"about_ca_system_score_codex":0.005917817,"about_ca_system_score_gemma":0.023325717,"threshold_uncertainty_score":0.22932428},"labels":[],"label_agreement":null},{"id":"W4390743877","doi":"10.57264/cer-2023-0147","title":"Quantitative bias analysis for external control arms using real-world data in clinical trials: a primer for clinical researchers","year":2024,"lang":"en","type":"review","venue":"Journal of Comparative Effectiveness Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; McMaster University; Impact","funders":"","keywords":"Robustness (evolution); Missing data; External validity; Medicine; Confounding; Sample size determination; Population; Clinical trial; Data collection; Computer science; Statistics; Machine learning","score_opus":0.9834323930954177,"score_gpt":0.8240222415215248,"score_spread":0.15941015157389293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390743877","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00067436614,0.06143497,0.8469232,0.07615283,0.0056946767,0.0040208036,0.0008386913,0.0009768279,0.003283788],"genre_scores_gemma":[0.023616359,0.025602015,0.8998586,0.022207908,0.008105449,0.018672373,0.00047026968,0.0007060696,0.0007609798],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.23792715,0.68288696,0.039413802,0.010021574,0.028646575,0.0011039559],"domain_scores_gemma":[0.054111853,0.8778214,0.021314463,0.027484465,0.018000107,0.0012677694],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7145477,0.004599451,0.012916563,0.012949318,0.0025468585,0.028973881,0.012349173,0.015487455,0.0075163487],"category_scores_gemma":[0.87163717,0.0035523302,0.01185446,0.013113759,0.024983298,0.02366494,0.013551558,0.03669367,0.0027122148],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000788065,0.00024704717,0.0046770703,0.03005929,0.00606959,0.0003073297,0.0043881526,0.010400157,0.00058456045,0.5192027,0.047291346,0.37598473],"study_design_scores_gemma":[0.0007083017,0.0005585258,0.0011792262,0.026216133,0.00117509,0.00031549018,0.0008765698,0.021989694,0.00082196645,0.85332745,0.0924892,0.00034246463],"about_ca_topic_score_codex":0.0026432239,"about_ca_topic_score_gemma":0.0015636166,"teacher_disagreement_score":0.2854523,"about_ca_system_score_codex":0.0099908635,"about_ca_system_score_gemma":0.026144756,"threshold_uncertainty_score":0.3520136},"labels":[],"label_agreement":null},{"id":"W4390811869","doi":"10.1101/2024.01.11.575211","title":"Through the lens of causal inference: Decisions and pitfalls of covariate selection","year":2024,"lang":"en","type":"preprint","venue":"bioRxiv (Cold Spring Harbor Laboratory)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Neurological Institute and Hospital","funders":"National Institute of Mental Health; National Institutes of Health","keywords":"Covariate; Causal inference; Inference; Selection (genetic algorithm); Through-the-lens metering; Lens (geology); Econometrics; Computer science; Psychology; Economics; Artificial intelligence; Engineering","score_opus":0.10514839863080201,"score_gpt":0.35556451503322134,"score_spread":0.25041611640241934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390811869","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005196403,0.0034123966,0.89173365,0.08746495,0.0010844822,0.00060181424,0.00034466235,0.00043057822,0.009731114],"genre_scores_gemma":[0.24674048,0.0021876504,0.72154075,0.021337148,0.002740078,0.0031480768,0.00019079879,0.0005325493,0.0015825887],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.39650574,0.5435102,0.016320808,0.017278945,0.024659028,0.0017252746],"domain_scores_gemma":[0.1122732,0.7906398,0.01856915,0.061686773,0.015494438,0.0013366638],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.526837,0.0025347713,0.0038556254,0.0069175633,0.006116618,0.016499653,0.007779598,0.009322114,0.008945387],"category_scores_gemma":[0.77293235,0.0026545387,0.003970749,0.006058656,0.05529519,0.024643205,0.0144241685,0.022458022,0.0013293726],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025713583,0.000050449118,0.0022133722,0.00092698407,0.00034523784,0.0003419539,0.008779143,0.0031392877,0.00031311446,0.91487056,0.006800075,0.061962698],"study_design_scores_gemma":[0.00008630068,0.000033516782,0.0003237728,0.000742247,0.00009770861,0.000097105534,0.00039885053,0.0055308496,0.00047516284,0.9818024,0.0103706205,0.000041445484],"about_ca_topic_score_codex":0.0053745992,"about_ca_topic_score_gemma":0.0040353457,"teacher_disagreement_score":0.473163,"about_ca_system_score_codex":0.008623959,"about_ca_system_score_gemma":0.015122608,"threshold_uncertainty_score":0.5834943},"labels":[],"label_agreement":null},{"id":"W4390892810","doi":"10.1111/bcp.15998","title":"Observational studies to emulate randomized trials: Some real‐world barriers","year":2024,"lang":"en","type":"article","venue":"British Journal of Clinical Pharmacology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"McGill University","keywords":"Observational study; Randomized controlled trial; Medicine; Randomization; Emulation; Medical physics; Psychology; Surgery; Internal medicine","score_opus":0.6694319031572994,"score_gpt":0.6509946010066823,"score_spread":0.01843730215061712,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390892810","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0060168635,0.035636358,0.76564604,0.1673714,0.007237786,0.0049212407,0.001537102,0.00063231064,0.011000861],"genre_scores_gemma":[0.16378988,0.012360929,0.71625525,0.07653838,0.0074377605,0.02055494,0.00080092094,0.00056747155,0.0016944698],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.0771382,0.87010264,0.023722358,0.008490659,0.01987975,0.0006664379],"domain_scores_gemma":[0.0197684,0.9257157,0.015014467,0.030981392,0.0077729654,0.00074714597],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.8508392,0.003849201,0.008371257,0.005384984,0.0024457497,0.0142529765,0.012138545,0.010930778,0.008893545],"category_scores_gemma":[0.9265624,0.004022541,0.007936143,0.007491483,0.03081842,0.023036031,0.013363237,0.023070714,0.0022086652],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027132418,0.00049760105,0.010041074,0.013380828,0.008243221,0.00033158003,0.005181341,0.021877205,0.0003593272,0.7200499,0.026250558,0.19107413],"study_design_scores_gemma":[0.0022040738,0.0015316948,0.004134732,0.011939852,0.0011990676,0.00060361193,0.0010730545,0.024454784,0.0006385261,0.87882215,0.0730591,0.0003392802],"about_ca_topic_score_codex":0.0046288436,"about_ca_topic_score_gemma":0.003087736,"teacher_disagreement_score":0.1491608,"about_ca_system_score_codex":0.010642134,"about_ca_system_score_gemma":0.015407826,"threshold_uncertainty_score":0.1839419},"labels":[],"label_agreement":null},{"id":"W4390961241","doi":"10.48550/arxiv.2401.06909","title":"Sensitivity Analysis for Matched Observational Studies with Continuous Exposures and Binary Outcomes","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institutes of Health; York University","keywords":"Sensitivity (control systems); Binary number; Observational study; Matching (statistics); Population; Binary data; Statistics; Mathematics; Causal inference; Computer science; Algorithm; Medicine","score_opus":0.40646540614942905,"score_gpt":0.3405128909393795,"score_spread":0.06595251521004958,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390961241","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0050504394,0.005580555,0.9795857,0.001522699,0.0004274045,0.0021088729,0.0019479432,0.00040809173,0.0033682554],"genre_scores_gemma":[0.3182891,0.0068625836,0.64417833,0.0044500954,0.0010481598,0.018590314,0.003001017,0.0005099279,0.0030703915],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7993866,0.17106888,0.009826538,0.010145729,0.00834764,0.0012245312],"domain_scores_gemma":[0.5261786,0.43580723,0.015522563,0.01697079,0.0048815133,0.0006392136],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16789739,0.0025208786,0.005110923,0.0057981987,0.0013308136,0.0037684145,0.003967588,0.0036068368,0.013546134],"category_scores_gemma":[0.41081545,0.0016366887,0.011375638,0.004864935,0.0031744747,0.0051435577,0.005826753,0.0067084436,0.0008000538],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016197443,0.00026848685,0.023481518,0.017034631,0.017854106,0.001622664,0.0012806483,0.26243523,0.0018543162,0.45253834,0.018620865,0.20138954],"study_design_scores_gemma":[0.00060019223,0.00055624073,0.005721209,0.0029550262,0.005548267,0.0008432589,0.00030595795,0.2626243,0.0018730233,0.6881276,0.030586842,0.00025814146],"about_ca_topic_score_codex":0.0030255588,"about_ca_topic_score_gemma":0.0019005483,"teacher_disagreement_score":0.8321026,"about_ca_system_score_codex":0.004242939,"about_ca_system_score_gemma":0.00506664,"threshold_uncertainty_score":0.8879369},"labels":[],"label_agreement":null},{"id":"W4391368285","doi":"10.1097/ede.0000000000001694","title":"Visualizing External Validity: Graphical Displays to Inform the Extension of Treatment Effects from Trials to Clinical Practice","year":2023,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Environmental Health Sciences; UCB US; Patient-Centered Outcomes Research Institute; Novo Nordisk; Sanofi; GlaxoSmithKline; Pharmaceutical Research and Manufacturers of America Foundation","keywords":"Clinical trial; Clinical Practice; Medical physics; Covariate; Population; Visualization; Computer science; Randomized controlled trial; Measure (data warehouse); Medicine; Data science; Data mining; Family medicine; Machine learning; Surgery; Pathology","score_opus":0.6902984386938299,"score_gpt":0.635397533206193,"score_spread":0.05490090548763693,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391368285","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019078586,0.0027221867,0.88107896,0.01988425,0.00116391,0.0012409749,0.013927935,0.038388565,0.022514628],"genre_scores_gemma":[0.1905603,0.0021128352,0.7924222,0.0018287776,0.000531886,0.0024150677,0.0042141266,0.003624162,0.0022905918],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.985824,0.011480027,0.0007564923,0.00064348767,0.0010953341,0.00020073363],"domain_scores_gemma":[0.73903203,0.23022935,0.008361074,0.012174221,0.008910359,0.0012928912],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.030608311,0.0025879906,0.0011208476,0.007381852,0.0011461404,0.0063956403,0.0021964167,0.0020257912,0.030872636],"category_scores_gemma":[0.23387599,0.0011668041,0.0028033212,0.0043134694,0.002119233,0.0062569147,0.006748869,0.003224355,0.0026032298],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023982583,0.00036886605,0.01828014,0.00643032,0.00075017306,0.0010060314,0.014861306,0.060139704,0.0026024436,0.25680903,0.17999244,0.4563613],"study_design_scores_gemma":[0.0016579552,0.00058427127,0.010745301,0.0044181915,0.0006867876,0.00069273345,0.0026422627,0.17480764,0.0052485694,0.5099047,0.28819403,0.00041754753],"about_ca_topic_score_codex":0.0036828455,"about_ca_topic_score_gemma":0.003230058,"teacher_disagreement_score":0.9693917,"about_ca_system_score_codex":0.0019363851,"about_ca_system_score_gemma":0.003532157,"threshold_uncertainty_score":0.16187418},"labels":[],"label_agreement":null},{"id":"W4391368298","doi":"10.1097/ede.0000000000001711","title":"Differential Participation, a Potential Cause of Spurious Associations in Observational Cohorts in Environmental Epidemiology","year":2023,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Institute for Clinical Evaluative Sciences; Public Health Ontario; University of Toronto; Health Canada","funders":"National Institute on Aging; Health Canada; Government of Canada","keywords":"Spurious relationship; Observational study; Differential (mechanical device); Selection bias; Differential effects; Econometrics; Cohort study; Population; Information bias; Cohort; Medicine; Environmental health; Statistics; Mathematics; Physics","score_opus":0.40291812067690513,"score_gpt":0.4843232539837756,"score_spread":0.08140513330687049,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391368298","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09099952,0.0026462467,0.894063,0.005956617,0.0003296266,0.0006038179,0.00056292274,0.0003392682,0.004498905],"genre_scores_gemma":[0.79028267,0.0010247983,0.20035398,0.0029183624,0.0003774879,0.001426374,0.00043196278,0.00013127428,0.003053105],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9153616,0.0651067,0.0036845347,0.008957335,0.005659879,0.0012298771],"domain_scores_gemma":[0.52070475,0.41056013,0.023843508,0.039332714,0.0047270944,0.00083176594],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16178696,0.00080393616,0.0016693559,0.001966639,0.0024812496,0.0025680023,0.0032627843,0.0028964654,0.0027662748],"category_scores_gemma":[0.41556793,0.0011213062,0.002376847,0.003322944,0.006424528,0.0050137085,0.0042401375,0.0038526652,0.00033201976],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00069353264,0.00022265305,0.24701342,0.0017892917,0.002649006,0.0018141114,0.008960454,0.030425368,0.0014106624,0.49148062,0.004534282,0.20900665],"study_design_scores_gemma":[0.0002740385,0.0005217127,0.052337192,0.0007415761,0.0010474733,0.0016733196,0.0011624382,0.08654759,0.0029736827,0.83413404,0.018464668,0.0001223391],"about_ca_topic_score_codex":0.007030795,"about_ca_topic_score_gemma":0.00618488,"teacher_disagreement_score":0.838213,"about_ca_system_score_codex":0.0020078877,"about_ca_system_score_gemma":0.002938206,"threshold_uncertainty_score":0.85562146},"labels":[],"label_agreement":null},{"id":"W4391368301","doi":"10.1097/ede.0000000000001700","title":"It Is Time to Think About Time: The Impact of Secular Trends on Bias Parameter Values from Validation Studies","year":2023,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Selection bias; Statistics; Observational error; Categorical variable; Information bias; Econometrics; Non-response bias; Confounding; Errors-in-variables models; Computer science; Mathematics","score_opus":0.4446297754692033,"score_gpt":0.5345987961979093,"score_spread":0.089969020728706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391368301","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.116098665,0.09575252,0.5979484,0.10341952,0.01492805,0.0022705493,0.011444299,0.0015515878,0.056586426],"genre_scores_gemma":[0.7426221,0.012938435,0.19002625,0.035530325,0.0037434832,0.0026028338,0.005843489,0.0016868358,0.0050062295],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5944831,0.29695877,0.038631175,0.025714567,0.040639162,0.0035732628],"domain_scores_gemma":[0.08408023,0.7488475,0.06038738,0.06391921,0.04140681,0.0013588205],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4576906,0.0018088587,0.0028975427,0.005631301,0.0027191343,0.010778887,0.0055004978,0.0057096877,0.009434013],"category_scores_gemma":[0.8427619,0.001371402,0.008629361,0.011156427,0.0070038545,0.015642753,0.0089858575,0.012364449,0.0016869932],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032927592,0.00016677409,0.40245646,0.0061436314,0.021415899,0.00090136664,0.009955312,0.025307512,0.0005111625,0.13241452,0.0375852,0.35984924],"study_design_scores_gemma":[0.0010849858,0.001591286,0.22792326,0.02719781,0.017669812,0.0037165708,0.0069629643,0.06334396,0.0061283787,0.47245747,0.17098399,0.0009395045],"about_ca_topic_score_codex":0.018540276,"about_ca_topic_score_gemma":0.01057187,"teacher_disagreement_score":0.5423094,"about_ca_system_score_codex":0.0049005686,"about_ca_system_score_gemma":0.009623321,"threshold_uncertainty_score":0.6687641},"labels":[],"label_agreement":null},{"id":"W4391716914","doi":"10.1186/s12874-024-02147-z","title":"Comparison of statistical methods used to meta-analyse results from interrupted time series studies: an empirical study","year":2024,"lang":"en","type":"review","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Health and Medical Research Council; Monash University; Medical Research Council; Australian Government","keywords":"Interrupted time series; Interrupted Time Series Analysis; Series (stratigraphy); Meta-analysis; Time series; Computer science; Psychological intervention; Research design; Statistical analysis; Econometrics; Statistics; Data mining; Medicine; Machine learning; Mathematics","score_opus":0.9784031228965239,"score_gpt":0.81904854844297,"score_spread":0.15935457445355383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391716914","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019009577,0.39206764,0.5577851,0.0036558025,0.0030249383,0.016049836,0.0050701126,0.0013567522,0.0019802854],"genre_scores_gemma":[0.36241215,0.09668333,0.46684042,0.0029731002,0.0012486988,0.06370222,0.0043185623,0.0010159859,0.00080550654],"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","domain_scores_codex":[0.4083475,0.507256,0.048794936,0.013539849,0.020982677,0.0010790506],"domain_scores_gemma":[0.18559222,0.7504656,0.026797691,0.024663124,0.011873844,0.0006075012],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3845185,0.0046494463,0.015405989,0.016601,0.0011925107,0.007446706,0.00691,0.0050009624,0.00573179],"category_scores_gemma":[0.7111118,0.0027056143,0.06268821,0.01947567,0.002950449,0.006345214,0.0037713822,0.006313736,0.0007342524],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0058898265,0.00018352168,0.014662474,0.11884267,0.7521151,0.00043246153,0.00096844626,0.012894822,0.00037355753,0.006100861,0.003812998,0.08372325],"study_design_scores_gemma":[0.0077792704,0.0029538483,0.018420393,0.06443749,0.7984578,0.0009780749,0.0009485768,0.03545837,0.001774347,0.046708334,0.02151933,0.00056418777],"about_ca_topic_score_codex":0.0025109118,"about_ca_topic_score_gemma":0.0020718449,"teacher_disagreement_score":0.6154815,"about_ca_system_score_codex":0.0045927432,"about_ca_system_score_gemma":0.005250101,"threshold_uncertainty_score":0.7589983},"labels":[],"label_agreement":null},{"id":"W4391780126","doi":"10.1093/jrsssc/qlae008","title":"Revisiting the effects of maternal education on adolescents’ academic performance: Doubly robust estimation in a network-based observational study","year":2024,"lang":"en","type":"article","venue":"Journal of the Royal Statistical Society Series C (Applied Statistics)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Fonds de recherche du Québec; Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada; National Institute on Aging; University of North Carolina at Chapel Hill","keywords":"Observational study; Estimation; Psychology; Statistics; Mathematics; Economics","score_opus":0.06762390301399934,"score_gpt":0.3678736315680582,"score_spread":0.30024972855405885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391780126","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18165776,0.001675955,0.81077987,0.002312618,0.00015472194,0.00028350277,0.0011628679,0.00020828593,0.0017644989],"genre_scores_gemma":[0.86939836,0.00096966507,0.12606753,0.0005334982,0.00020512084,0.00055072614,0.0008163288,0.000052253137,0.0014064863],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.97566074,0.019480297,0.00091022905,0.00238744,0.0011794572,0.00038179406],"domain_scores_gemma":[0.82451975,0.14854681,0.011594266,0.01294042,0.0018023794,0.0005963708],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.044618405,0.00067466096,0.0015015812,0.0013698941,0.00065198774,0.0018105308,0.003082364,0.0018764953,0.0021513493],"category_scores_gemma":[0.15397683,0.000667373,0.0019169216,0.0014183107,0.0019803143,0.0017879665,0.0024921705,0.0025069248,0.0002558371],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009031104,0.00061586633,0.41103405,0.0010771134,0.0055186427,0.0012226643,0.002841472,0.12970018,0.0018280166,0.29120693,0.0034596506,0.15059224],"study_design_scores_gemma":[0.00024372512,0.000749389,0.076520145,0.0004552019,0.0019773939,0.00041423726,0.0006479001,0.65697503,0.00173717,0.25190976,0.008253273,0.0001168382],"about_ca_topic_score_codex":0.013718003,"about_ca_topic_score_gemma":0.006636682,"teacher_disagreement_score":0.044618405,"about_ca_system_score_codex":0.0008530765,"about_ca_system_score_gemma":0.001455338,"threshold_uncertainty_score":0.23596752},"labels":[],"label_agreement":null},{"id":"W4391813293","doi":"10.1007/s10260-024-00744-2","title":"Determining sample sizes for combined incident and prevalent cohort studies with and without follow-up","year":2024,"lang":"en","type":"article","venue":"Statistical Methods & Applications","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"","keywords":"Cohort; Sample size determination; Statistics; Event (particle physics); Sample (material); Sampling (signal processing); Cohort study; Econometrics; Computer science; Mathematics; Medicine","score_opus":0.2077124691976119,"score_gpt":0.5430278245062908,"score_spread":0.33531535530867895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391813293","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.57938284,0.018495606,0.35348386,0.0047625736,0.0034748332,0.013904128,0.0132032875,0.0008135194,0.012479479],"genre_scores_gemma":[0.90107876,0.0010873209,0.08099828,0.0012802123,0.0003739197,0.011233472,0.0027293551,0.00013261668,0.0010860483],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8630224,0.097557314,0.014797096,0.011826428,0.011185573,0.0016111872],"domain_scores_gemma":[0.48397952,0.47322968,0.006449635,0.028563205,0.005768055,0.002009937],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.20390353,0.0010323526,0.0037724627,0.00323742,0.0013329345,0.0032229621,0.003249347,0.0034759028,0.0060026455],"category_scores_gemma":[0.47131512,0.0014810786,0.0076073487,0.0020666646,0.0025458508,0.0031685894,0.0037849667,0.0031866448,0.00049402367],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.05356979,0.0012280357,0.43300426,0.008473846,0.05767559,0.0022468248,0.0063244584,0.008669661,0.0087132845,0.039193522,0.015293941,0.36560676],"study_design_scores_gemma":[0.033132277,0.013683044,0.50644684,0.0050833053,0.1008511,0.006445826,0.004432279,0.060063,0.020025855,0.16414937,0.085219145,0.00046798238],"about_ca_topic_score_codex":0.001631159,"about_ca_topic_score_gemma":0.0018642009,"teacher_disagreement_score":0.79609644,"about_ca_system_score_codex":0.0007323976,"about_ca_system_score_gemma":0.0015594141,"threshold_uncertainty_score":0.9817287},"labels":[],"label_agreement":null},{"id":"W4391847795","doi":"10.1016/j.cjca.2024.02.005","title":"Causal Inference Challenges in the Relationship Between Social Determinants and Cardiovascular Outcomes","year":2024,"lang":"en","type":"article","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Medicine; Causal inference; Inference; Artificial intelligence; Pathology","score_opus":0.36950571825910056,"score_gpt":0.4292176100910344,"score_spread":0.05971189183193382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391847795","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007933954,0.0030165971,0.9634562,0.022619767,0.00028972217,0.0000776824,0.00038540576,0.00011567648,0.0021049213],"genre_scores_gemma":[0.5438879,0.009868995,0.42697617,0.0048235264,0.005344914,0.0008553684,0.001009302,0.00020932789,0.0070245937],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9666157,0.026359439,0.0011911382,0.0029635115,0.0023635996,0.0005066964],"domain_scores_gemma":[0.36329788,0.62373984,0.0048510698,0.004111384,0.0031842533,0.0008155071],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07121613,0.001417709,0.0038902906,0.0031480151,0.002174273,0.00481407,0.005235366,0.0036735246,0.007079773],"category_scores_gemma":[0.27985477,0.0017962379,0.0030481261,0.003871312,0.006922875,0.007778641,0.0047775954,0.013379065,0.0004510831],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010737836,0.00011997785,0.0049717985,0.0005120771,0.0005456532,0.00044415498,0.0005437087,0.07719513,0.00009776276,0.87243736,0.0039605456,0.039064404],"study_design_scores_gemma":[0.000037112237,0.0000103761295,0.0002704373,0.000053207335,0.000054058786,0.000052436564,0.00005119506,0.09553399,0.0000394244,0.90298384,0.0009031344,0.000010839684],"about_ca_topic_score_codex":0.018287767,"about_ca_topic_score_gemma":0.011364147,"teacher_disagreement_score":0.07121613,"about_ca_system_score_codex":0.0032549873,"about_ca_system_score_gemma":0.0069109034,"threshold_uncertainty_score":0.37663138},"labels":[],"label_agreement":null},{"id":"W4391953805","doi":"10.21203/rs.3.rs-3824985/v1","title":"Accounting for center-level effects in multicenter randomized controlled trials","year":2024,"lang":"en","type":"preprint","venue":"Research Square","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"McMaster University","keywords":"Randomized controlled trial; Protocol (science); Random effects model; Fixed effects model; Medicine; Econometrics; Psychology; Statistics; Meta-analysis; Economics; Panel data; Mathematics; Alternative medicine; Surgery; Internal medicine","score_opus":0.37805691469864283,"score_gpt":0.5681275528826683,"score_spread":0.19007063818402542,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391953805","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0063983924,0.009782788,0.9755013,0.003204598,0.00069796445,0.0012958939,0.0007395296,0.0007102403,0.0016694093],"genre_scores_gemma":[0.30761874,0.004890416,0.671206,0.0029784811,0.0016018968,0.007025971,0.00089058874,0.0005684113,0.0032195277],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.50205064,0.45028242,0.016651439,0.019634327,0.009413486,0.001967679],"domain_scores_gemma":[0.15442973,0.7934261,0.016327158,0.030898005,0.0039532958,0.0009656771],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.356967,0.0031323559,0.010808212,0.0033601793,0.0014642061,0.005453328,0.0073029753,0.0061696293,0.014920648],"category_scores_gemma":[0.65529376,0.0039241095,0.012380082,0.006211615,0.0048505147,0.009340942,0.004413016,0.009232249,0.001056334],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01081093,0.00065041124,0.016258273,0.012084388,0.033298954,0.00082863204,0.0011612364,0.07449537,0.001049651,0.51775044,0.018400608,0.31321105],"study_design_scores_gemma":[0.0033406625,0.0008002259,0.002545704,0.001122533,0.008704867,0.00024721917,0.00011952185,0.17576674,0.0015429333,0.79769444,0.008028348,0.000086769935],"about_ca_topic_score_codex":0.003715395,"about_ca_topic_score_gemma":0.003050154,"teacher_disagreement_score":0.643033,"about_ca_system_score_codex":0.0037130571,"about_ca_system_score_gemma":0.011431846,"threshold_uncertainty_score":0.7929742},"labels":[],"label_agreement":null},{"id":"W4392231166","doi":"10.1101/2024.02.26.24303405","title":"Statistical pitfalls of multiple exposures in causal observational studies and tools to address them","year":2024,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Observational study; Computer science; Statistical analysis; Data science; Econometrics; Risk analysis (engineering); Management science; Statistics; Medicine; Mathematics; Engineering","score_opus":0.48566379628747175,"score_gpt":0.47650119864697077,"score_spread":0.00916259764050098,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392231166","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009847914,0.015149877,0.84998685,0.12444428,0.0054045473,0.00027036798,0.00023926471,0.00056122825,0.002958842],"genre_scores_gemma":[0.09085152,0.01340223,0.7967439,0.07641151,0.016486203,0.0034442418,0.00016606484,0.00070835376,0.0017859332],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4752469,0.4561365,0.02627465,0.01407042,0.027283689,0.0009878514],"domain_scores_gemma":[0.10856432,0.85049427,0.013264749,0.018352032,0.00858499,0.000739643],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.42903066,0.0019326279,0.0044727135,0.006278233,0.0030201322,0.012937785,0.007973114,0.01079471,0.009054049],"category_scores_gemma":[0.74316776,0.002205306,0.0045830635,0.005388392,0.036265884,0.01890619,0.01043388,0.025192726,0.0018291048],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017107683,0.000023805125,0.0014303257,0.0021286735,0.0005534686,0.0003533437,0.002753681,0.0022754362,0.00013066438,0.8761917,0.023405831,0.09058208],"study_design_scores_gemma":[0.000053374453,0.000029766685,0.00018198848,0.0016852529,0.000099075536,0.0002373446,0.00018197825,0.0038187027,0.00016091995,0.97279143,0.02071979,0.000040358027],"about_ca_topic_score_codex":0.0018780456,"about_ca_topic_score_gemma":0.0017221557,"teacher_disagreement_score":0.57096934,"about_ca_system_score_codex":0.005705515,"about_ca_system_score_gemma":0.0097569665,"threshold_uncertainty_score":0.70410687},"labels":[],"label_agreement":null},{"id":"W4392284023","doi":"10.7189/jogh.14.04046","title":"Reporting of equity in observational epidemiology: A methodological review","year":2024,"lang":"en","type":"review","venue":"Journal of Global Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University; SickKids Foundation; Hospital for Sick Children; Women's College Hospital; Impact; Ottawa Hospital; Public Health Ontario; University of British Columbia; McMaster University; Ottawa Public Health; Western University; University of Toronto; Royal College of Physicians and Surgeons of Canada; Bruyère; University of Ottawa","funders":"","keywords":"Observational study; Epidemiology; Equity (law); MEDLINE; Medicine; Data science; Computer science; Political science; Internal medicine","score_opus":0.9527690064534525,"score_gpt":0.7736420090006217,"score_spread":0.17912699745283078,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392284023","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011693535,0.9713454,0.016302738,0.004267903,0.0009028777,0.003850291,0.0011607418,0.0000557936,0.0009449407],"genre_scores_gemma":[0.03926085,0.8956777,0.04200325,0.0038747513,0.0009864158,0.016427783,0.0014624365,0.00008369008,0.00022314927],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.4204246,0.31593558,0.20850356,0.012049473,0.04087803,0.0022087297],"domain_scores_gemma":[0.15916961,0.6763344,0.08402453,0.028782789,0.050651994,0.001036717],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4183616,0.0028906928,0.012292047,0.03158185,0.002704275,0.012082484,0.0071481816,0.0054846117,0.0038996744],"category_scores_gemma":[0.7375113,0.004609474,0.015675925,0.035627253,0.00581903,0.011820515,0.010945037,0.004166828,0.0006996115],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032153877,0.00004398698,0.006415493,0.80718726,0.017417533,0.00012570835,0.0017105361,0.00064723025,0.00020685421,0.0049699983,0.0044496213,0.15650421],"study_design_scores_gemma":[0.00026130423,0.00013698211,0.004001006,0.93016785,0.027304007,0.00025204313,0.0007457023,0.0004983876,0.00039197036,0.0055164117,0.030625563,0.00009878381],"about_ca_topic_score_codex":0.008671143,"about_ca_topic_score_gemma":0.009578746,"teacher_disagreement_score":0.5816384,"about_ca_system_score_codex":0.013508707,"about_ca_system_score_gemma":0.043749765,"threshold_uncertainty_score":0.7172637},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"reporting","study_design":"not_applicable","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["metaresearch"],"domain":"reporting","study_design":"systematic_review","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4392289616","doi":"10.1111/ppe.13066","title":"Multiple mediators, causal assumptions and potential caveats","year":2024,"lang":"en","type":"editorial","venue":"Paediatric and Perinatal Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Children's Hospital; University of British Columbia","funders":"University of British Columbia; National Institute of Environmental Health Sciences; National Heart and Lung Institute","keywords":"Medicine","score_opus":0.06783392576210283,"score_gpt":0.3945308558003913,"score_spread":0.3266969300382885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392289616","genre_codex":"commentary","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006205403,0.028983343,0.18780412,0.68150425,0.052193303,0.0027030066,0.009241985,0.0012947096,0.030069824],"genre_scores_gemma":[0.22668898,0.01059307,0.3460608,0.33760887,0.03978201,0.019084321,0.0020637566,0.00067506667,0.017443076],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.85181147,0.09684596,0.015904836,0.0133388685,0.01969383,0.002405025],"domain_scores_gemma":[0.3755567,0.56178063,0.011882532,0.032341067,0.016557023,0.0018820316],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2111483,0.0035696405,0.004854215,0.005627863,0.0041072387,0.0064429385,0.013209899,0.009217331,0.040286496],"category_scores_gemma":[0.5631012,0.0024325058,0.0068992665,0.0062819226,0.013652359,0.01950308,0.008828229,0.024718303,0.0039536096],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00062699564,0.0001562423,0.005134896,0.005632283,0.0015951243,0.0023349295,0.00618332,0.002167608,0.00019613068,0.6997392,0.2187479,0.05748539],"study_design_scores_gemma":[0.0003321776,0.0000631479,0.0017329137,0.0037367826,0.00040168889,0.0012381612,0.0012180501,0.0056157783,0.0003232719,0.90017015,0.08502913,0.0001388926],"about_ca_topic_score_codex":0.006822992,"about_ca_topic_score_gemma":0.011712693,"teacher_disagreement_score":0.2111483,"about_ca_system_score_codex":0.0040467414,"about_ca_system_score_gemma":0.010291662,"threshold_uncertainty_score":0.9727946},"labels":[],"label_agreement":null},{"id":"W4392302028","doi":"10.23736/s1973-9087.24.08435-1","title":"Introduction to target trial emulation in rehabilitation: a systematic approach to emulate a randomized controlled trial using observational data","year":2024,"lang":"en","type":"article","venue":"European Journal of Physical and Rehabilitation Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Memorial Chiropractic College; University of Alberta; Ontario Tech University","funders":"Canada Research Chairs","keywords":"Randomized controlled trial; Observational study; Causal inference; Rehabilitation; Emulation; Medicine; Context (archaeology); Counterfactual thinking; Population; Psychological intervention; Physical medicine and rehabilitation; Physical therapy; Psychology; Nursing; Social psychology; Surgery","score_opus":0.13415060138641638,"score_gpt":0.4083997131747009,"score_spread":0.27424911178828454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392302028","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006646204,0.009899402,0.9578105,0.010216459,0.0024253016,0.01518053,0.00066451874,0.00066003937,0.002478677],"genre_scores_gemma":[0.014183546,0.003920199,0.8951938,0.0059071234,0.0010661669,0.07850432,0.00023634768,0.00017549854,0.0008129324],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.2847464,0.6560244,0.02983382,0.012324509,0.01644141,0.00062946236],"domain_scores_gemma":[0.17671028,0.7354195,0.02408695,0.04575689,0.016720127,0.001306278],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5223365,0.0041765384,0.0063741445,0.0083311,0.0019919968,0.006948282,0.007289071,0.010630195,0.012810265],"category_scores_gemma":[0.7142049,0.0030258736,0.012185475,0.0064327973,0.012515721,0.009057062,0.0061367713,0.015188835,0.0034513103],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024332847,0.00032393011,0.0017932944,0.05881349,0.0077843093,0.00041506358,0.005338727,0.016950982,0.0010910978,0.5590368,0.033598743,0.3124203],"study_design_scores_gemma":[0.0036299136,0.001604161,0.0010847482,0.05489771,0.004412415,0.0008052405,0.0005010396,0.042263146,0.0027759385,0.75013065,0.13734245,0.0005525922],"about_ca_topic_score_codex":0.0015906987,"about_ca_topic_score_gemma":0.0014595143,"teacher_disagreement_score":0.47766352,"about_ca_system_score_codex":0.0066567343,"about_ca_system_score_gemma":0.012550196,"threshold_uncertainty_score":0.5890442},"labels":[],"label_agreement":null},{"id":"W4392505897","doi":"10.2196/47744","title":"Real-World Data Quality Framework for Oncology Time to Treatment Discontinuation Use Case: Implementation and Evaluation Study","year":2024,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Medicine; Relevance (law); Terminology; Discontinuation; Quality (philosophy); Descriptive statistics; Data quality; Real world data; Medical physics; Computer science; Internal medicine; Statistics; Data science; Operations management; Mathematics","score_opus":0.43328506035763853,"score_gpt":0.6275695511884054,"score_spread":0.19428449083076688,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392505897","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5299371,0.002348999,0.3221718,0.0133510865,0.00047456403,0.09658149,0.014098169,0.002620318,0.018416518],"genre_scores_gemma":[0.54971033,0.00041596984,0.39332876,0.0009710613,0.00007795348,0.048858695,0.0058295866,0.00013114049,0.00067645765],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.7006872,0.22383483,0.027823612,0.010322945,0.03294282,0.004388568],"domain_scores_gemma":[0.529215,0.27768272,0.05475668,0.037193175,0.09461811,0.0065343305],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.2718578,0.0014696607,0.0014102724,0.0087397965,0.0030338431,0.0076265815,0.0046042893,0.0032561973,0.005236623],"category_scores_gemma":[0.3592514,0.0012167715,0.005677758,0.009153213,0.0031943438,0.0076110433,0.008729438,0.003553551,0.0006982972],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004698294,0.014470662,0.46856946,0.009795363,0.0026535934,0.001083558,0.020618381,0.047399886,0.0022448385,0.052761592,0.026139911,0.3495646],"study_design_scores_gemma":[0.0076916614,0.018575745,0.37982422,0.012293635,0.003981909,0.001272271,0.028629415,0.4124715,0.014127929,0.031837173,0.08822001,0.0010744072],"about_ca_topic_score_codex":0.027264683,"about_ca_topic_score_gemma":0.016144494,"teacher_disagreement_score":0.2718578,"about_ca_system_score_codex":0.023992969,"about_ca_system_score_gemma":0.034987923,"threshold_uncertainty_score":0.89792895},"labels":[],"label_agreement":null},{"id":"W4392822382","doi":"10.48550/arxiv.2403.08130","title":"Imputation of Counterfactual Outcomes when the Errors are Predictable","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; National Science Foundation","keywords":"Counterfactual thinking; Imputation (statistics); Econometrics; Statistics; Computer science; Missing data; Psychology; Economics; Mathematics; Social psychology","score_opus":0.22674297205928162,"score_gpt":0.29453571847325416,"score_spread":0.06779274641397254,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392822382","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008722106,0.00043525037,0.98643595,0.0015478292,0.000212613,0.00006488085,0.00036052224,0.00021100171,0.0020098328],"genre_scores_gemma":[0.48831955,0.0019862475,0.49852374,0.0015797673,0.000770277,0.000733107,0.001960769,0.00023788132,0.005888672],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9827355,0.011908752,0.0010120088,0.0019445898,0.001924031,0.00047522792],"domain_scores_gemma":[0.8762798,0.087826535,0.010151822,0.02237252,0.0029068028,0.00046250576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037357133,0.00089174684,0.0018547686,0.0017497838,0.00093358144,0.0029882682,0.0030861765,0.0025120727,0.0050657173],"category_scores_gemma":[0.15217584,0.0008560784,0.001658141,0.0032363585,0.0028138729,0.0037504754,0.0034980723,0.0042968267,0.0009787678],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024910268,0.000107533364,0.017042963,0.00035938498,0.00044031657,0.0004838865,0.00049412966,0.06979158,0.00039889873,0.78172916,0.006261871,0.12264119],"study_design_scores_gemma":[0.000054137592,0.0000616686,0.0027440279,0.00026409765,0.00012804734,0.00017269955,0.000077787096,0.18764408,0.0017162161,0.8003545,0.006739727,0.000043123287],"about_ca_topic_score_codex":0.0015484927,"about_ca_topic_score_gemma":0.0017793382,"teacher_disagreement_score":0.037357133,"about_ca_system_score_codex":0.001186032,"about_ca_system_score_gemma":0.00287876,"threshold_uncertainty_score":0.1975658},"labels":[],"label_agreement":null},{"id":"W4392846070","doi":"10.1086/730455","title":"Do Preregistration and Preanalysis Plans Reduce <i>p</i>-Hacking and Publication Bias? Evidence from 15,992 Test Statistics and Suggestions for Improvement","year":2024,"lang":"en","type":"article","venue":"Journal of Political Economy Microeconomics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Wilfrid Laurier University; University of Ottawa","funders":"Leibniz-Gemeinschaft","keywords":"Statistics; Test (biology); Hacker; Publication bias; Psychology; Computer science; Data science; Computer security; Mathematics; Biology","score_opus":0.12121629860942378,"score_gpt":0.3940866936875985,"score_spread":0.27287039507817473,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392846070","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2482569,0.085347414,0.5187605,0.090242125,0.008177889,0.015701393,0.007192724,0.00756611,0.018755022],"genre_scores_gemma":[0.65024114,0.0041488856,0.322873,0.011240918,0.0017373071,0.0068322555,0.0011908168,0.0007594038,0.0009762712],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.27802482,0.5811096,0.07703213,0.02111247,0.039182793,0.0035382402],"domain_scores_gemma":[0.01873268,0.8265535,0.07920977,0.06400357,0.009999532,0.0015009836],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7120254,0.0019582794,0.004507374,0.010293211,0.0023492419,0.0094919475,0.0074506155,0.0074825846,0.005735291],"category_scores_gemma":[0.9036897,0.0030960315,0.009682631,0.016374523,0.008420786,0.011990595,0.0044396184,0.007827282,0.001479077],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.017038148,0.0009931072,0.20109192,0.028613111,0.026886564,0.00070808537,0.007037697,0.0071790633,0.0027703317,0.022406712,0.030029971,0.6552453],"study_design_scores_gemma":[0.01325434,0.01984278,0.58545154,0.022073036,0.046882503,0.0023555136,0.0041815992,0.034810673,0.03128932,0.14042762,0.09815943,0.0012716578],"about_ca_topic_score_codex":0.0015510538,"about_ca_topic_score_gemma":0.0019267265,"teacher_disagreement_score":0.2879746,"about_ca_system_score_codex":0.0033030563,"about_ca_system_score_gemma":0.015032791,"threshold_uncertainty_score":0.355124},"labels":[],"label_agreement":null},{"id":"W4392938758","doi":"10.1111/jebm.12600","title":"Handling time‐varying treatments in observational studies: A scoping review and recommendations","year":2024,"lang":"en","type":"review","venue":"Journal of Evidence-Based Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St. Joseph’s Healthcare Hamilton; Impact","funders":"National Natural Science Foundation of China","keywords":"Observational study; Protocol (science); Workflow; Observational methods in psychology; Computer science; Set (abstract data type); Process (computing); Medical physics; Management science; Selection (genetic algorithm); Medicine; Alternative medicine; Machine learning; Engineering","score_opus":0.833002005037274,"score_gpt":0.6314645032262648,"score_spread":0.20153750181100916,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392938758","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026893467,0.4821428,0.10469786,0.32699344,0.029451786,0.042049717,0.0039310157,0.0012427593,0.006801251],"genre_scores_gemma":[0.015864378,0.36284536,0.49387354,0.052948043,0.0035985457,0.06478725,0.0032150815,0.0002882802,0.0025795747],"study_design_codex":"systematic_review","study_design_gemma":"not_applicable","domain_scores_codex":[0.60947543,0.22507839,0.12131178,0.010054047,0.030534467,0.0035459178],"domain_scores_gemma":[0.25608787,0.517913,0.05654802,0.021545364,0.14237739,0.0055283196],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.42446387,0.0052924654,0.009794344,0.03476973,0.005772929,0.015276592,0.0137451915,0.017611772,0.009018549],"category_scores_gemma":[0.6793048,0.005470053,0.017258799,0.024681022,0.0073821703,0.03165105,0.011461171,0.015448852,0.0041246596],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049643015,0.00022842147,0.0023953954,0.48936394,0.0038983892,0.0006411734,0.00854639,0.0017375791,0.00090825005,0.017274784,0.11815655,0.35635278],"study_design_scores_gemma":[0.00040483117,0.00010981555,0.0012062944,0.8716496,0.0055948277,0.00022055623,0.0031106307,0.0014153321,0.0005430106,0.019734666,0.09578035,0.00022999445],"about_ca_topic_score_codex":0.020243585,"about_ca_topic_score_gemma":0.03498764,"teacher_disagreement_score":0.57553613,"about_ca_system_score_codex":0.020795336,"about_ca_system_score_gemma":0.118887514,"threshold_uncertainty_score":0.7097385},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"systematic_review","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"systematic_review","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"agree"},{"id":"W4393008884","doi":"10.1186/s12874-024-02156-y","title":"An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Université de Montréal; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Alliance de recherche numérique du Canada","keywords":"Outcome (game theory); Estimator; Context (archaeology); Mediation; Logistic regression; Causal inference; Statistics; Binary number; Regression analysis; Parametric statistics; Regression; Computer science; Econometrics; Mathematics","score_opus":0.8753729356200297,"score_gpt":0.6686037868933843,"score_spread":0.20676914872664542,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393008884","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.105086476,0.01298224,0.8729899,0.001034285,0.00026774494,0.002081519,0.0007065012,0.00036245273,0.0044888104],"genre_scores_gemma":[0.56360143,0.0019876538,0.42875308,0.00048076943,0.00012648443,0.0036794192,0.00060471793,0.000115948154,0.000650454],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7013312,0.26901785,0.0063744537,0.008019082,0.014346031,0.0009112945],"domain_scores_gemma":[0.22866336,0.72727776,0.012644581,0.021259135,0.009118452,0.0010367536],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.26648054,0.0016539351,0.0025647935,0.0028691825,0.0009901776,0.0030137943,0.0048672925,0.003459785,0.006983192],"category_scores_gemma":[0.5594991,0.0009143976,0.0039674034,0.0036703565,0.0036399586,0.006349235,0.0046384763,0.0030316978,0.00050345314],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.010840649,0.0008463654,0.07781701,0.010416817,0.011313251,0.00076247344,0.005603368,0.2894058,0.0012685042,0.17223866,0.003885506,0.41560164],"study_design_scores_gemma":[0.0022556612,0.0074964846,0.041727927,0.004020878,0.0053643775,0.0014969718,0.0022362045,0.7300729,0.0022097228,0.18777907,0.014900031,0.0004397833],"about_ca_topic_score_codex":0.0022116157,"about_ca_topic_score_gemma":0.0015258183,"teacher_disagreement_score":0.26648054,"about_ca_system_score_codex":0.0028745981,"about_ca_system_score_gemma":0.003130306,"threshold_uncertainty_score":0.9045601},"labels":[],"label_agreement":null},{"id":"W4393132304","doi":"10.1016/j.envint.2024.108602","title":"A tool to assess risk of bias in non-randomized follow-up studies of exposure effects (ROBINS-E)","year":2024,"lang":"en","type":"article","venue":"Environment International","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":806,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cochrane; McMaster University; Ottawa Hospital; Impact","funders":"Medical Research Council; National Institute of Environmental Health Sciences; National Institute for Health and Care Research; National Institutes of Health; Cancer Research UK; CHDI Foundation; National Council for Air and Stream Improvement; NIHR Bristol Biomedical Research Centre; United Soybean Board","keywords":"Randomized controlled trial; Environmental health; Environmental science; Medicine; Internal medicine","score_opus":0.12522902878883774,"score_gpt":0.40282318924047794,"score_spread":0.2775941604516402,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393132304","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011385089,0.013620723,0.8329772,0.0070214714,0.0030496693,0.090381496,0.020467076,0.009005071,0.012092267],"genre_scores_gemma":[0.02838466,0.0013256154,0.87115556,0.0011060298,0.00026770288,0.09471441,0.001930522,0.00045757968,0.00065784133],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.21494424,0.5748643,0.15363249,0.010179129,0.04471756,0.0016623123],"domain_scores_gemma":[0.058518033,0.85617733,0.036217965,0.020517468,0.027726607,0.00084256905],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.63473505,0.0074796816,0.010385516,0.044062637,0.0024220415,0.009822313,0.006726859,0.0075887423,0.021824684],"category_scores_gemma":[0.8217387,0.004222886,0.033609122,0.023813188,0.006918431,0.013230228,0.017241856,0.007369274,0.0029658827],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009332706,0.00046018392,0.03545513,0.1625951,0.03750682,0.0007583775,0.007722257,0.015213246,0.0015652304,0.08792187,0.0741244,0.56734467],"study_design_scores_gemma":[0.018105133,0.0057931263,0.051025912,0.13851777,0.04958469,0.004248572,0.0060274666,0.099494174,0.010503858,0.28327385,0.33018348,0.0032421642],"about_ca_topic_score_codex":0.0018626384,"about_ca_topic_score_gemma":0.0034660362,"teacher_disagreement_score":0.36526495,"about_ca_system_score_codex":0.008568889,"about_ca_system_score_gemma":0.017198233,"threshold_uncertainty_score":0.45043677},"labels":[],"label_agreement":null},{"id":"W4393140763","doi":"10.1109/incc58754.2023.00013","title":"Short-term and Long-term Causal Effect Estimation with Double-head Transformer","year":2023,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Term (time); Computer science; Transformer; Estimation; Artificial intelligence; Risk analysis (engineering); Machine learning; Reliability engineering; Econometrics; Engineering; Mathematics; Systems engineering","score_opus":0.11039837924466502,"score_gpt":0.41948003132210654,"score_spread":0.30908165207744154,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393140763","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0058526625,0.00019036864,0.9921292,0.00032382915,0.00004684975,0.00010333682,0.00017431214,0.0003409122,0.0008384592],"genre_scores_gemma":[0.5436897,0.00081181637,0.44222775,0.0008706711,0.0001338702,0.0010944178,0.00080133905,0.00022237956,0.010148099],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983308,0.0009159174,0.00009503108,0.00036733638,0.00018483143,0.00010612488],"domain_scores_gemma":[0.99253064,0.005751507,0.0003909167,0.00070252095,0.00043599433,0.00018842822],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006388814,0.00094776397,0.0013076096,0.00071086443,0.00041344675,0.0012241738,0.002525482,0.0015606676,0.007071184],"category_scores_gemma":[0.0180199,0.00094581686,0.0016586652,0.00067062053,0.0019788672,0.0026008466,0.0023335845,0.002785679,0.0011013744],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000937587,0.00018381632,0.0046023377,0.00042855422,0.00036998867,0.0003682474,0.00043547718,0.61246675,0.0042165294,0.13611156,0.003682813,0.23619637],"study_design_scores_gemma":[0.00006177584,0.00013480199,0.00048721206,0.0000409924,0.00007955061,0.00007642425,0.00002937568,0.90734255,0.0012395651,0.08895684,0.0015285258,0.000022381626],"about_ca_topic_score_codex":0.006145383,"about_ca_topic_score_gemma":0.008950741,"teacher_disagreement_score":0.007071184,"about_ca_system_score_codex":0.001219209,"about_ca_system_score_gemma":0.0023313742,"threshold_uncertainty_score":0.033787668},"labels":[],"label_agreement":null},{"id":"W4393325638","doi":"10.1177/25152459241236149","title":"The Causal Cookbook: Recipes for Propensity Scores, G-Computation, and Doubly Robust Standardization","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Institut de Valorisation des Données","keywords":"Causal inference; Observational study; Identification (biology); Computer science; Consistency (knowledge bases); Causal model; Inference; Variable (mathematics); Estimator; Instrumental variable; Econometrics; Data science; Toolbox; Machine learning; Artificial intelligence; Mathematics; Statistics","score_opus":0.2889949678395071,"score_gpt":0.6290214928348979,"score_spread":0.3400265249953908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393325638","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00015146587,0.0006898388,0.9916453,0.00091783004,0.0004265779,0.00014706948,0.0007380326,0.0016823524,0.0036016053],"genre_scores_gemma":[0.0033997125,0.0010005288,0.9857841,0.0006279253,0.00030171804,0.00077594497,0.00053012813,0.0018443558,0.0057356204],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99724483,0.001416228,0.00023137814,0.00033533483,0.0006871538,0.000085146385],"domain_scores_gemma":[0.9914677,0.0060350997,0.00031841325,0.0012451543,0.0007545706,0.00017906015],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069952114,0.0024886841,0.0013742436,0.0028156263,0.0010647,0.0022963153,0.0027357345,0.002646459,0.08321889],"category_scores_gemma":[0.04119661,0.0015076437,0.0019997528,0.0032132172,0.0021662577,0.003632694,0.0026666918,0.0058418047,0.0285982],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053714495,0.00007812343,0.00032031562,0.0006797,0.000080563135,0.00027623549,0.0003073091,0.010693346,0.00073350745,0.63895077,0.1436389,0.20418756],"study_design_scores_gemma":[0.000070878785,0.000030943866,0.00025974493,0.00021400786,0.000029039118,0.00022887524,0.000048925325,0.029171793,0.00060603645,0.7969133,0.17234594,0.00008046469],"about_ca_topic_score_codex":0.0034710485,"about_ca_topic_score_gemma":0.0055463547,"teacher_disagreement_score":0.08321889,"about_ca_system_score_codex":0.0012051011,"about_ca_system_score_gemma":0.0026719118,"threshold_uncertainty_score":0.27839494},"labels":[],"label_agreement":null},{"id":"W4393900325","doi":"10.3389/fepid.2024.1326306","title":"Making predictions under interventions: a case study from the PREDICT-CVD cohort in New Zealand primary care","year":2024,"lang":"en","type":"article","venue":"Frontiers in Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"NIHR Cambridge Biomedical Research Centre; Economic and Social Research Council; Chief Scientist Office, Scottish Government Health and Social Care Directorate; Medical Research Council; National Heart Foundation of New Zealand; Public Health Agency; Department of Health and Social Care; UK Research and Innovation; Engineering and Physical Sciences Research Council; Health and Social Care Research and Development Division; National Institute for Health and Care Research; Scottish Government; British Heart Foundation; Wellcome Trust","keywords":"Causal inference; Psychological intervention; Medicine; Absolute risk reduction; Estimation; Observational study; Blood pressure; Cohort; Marginal structural model; Cohort study; Risk assessment; Econometrics; Statistics; Confidence interval; Internal medicine; Computer science; Mathematics","score_opus":0.258877684922014,"score_gpt":0.47204901177817493,"score_spread":0.21317132685616091,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393900325","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99496764,0.0001988733,0.0013923193,0.0016526477,0.00001746561,0.00038375382,0.00031997243,0.000009680454,0.0010577161],"genre_scores_gemma":[0.99281234,0.00034066508,0.005331616,0.000360835,0.000026072574,0.0003221304,0.00023968874,0.000011977559,0.0005547433],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9942273,0.0036836625,0.00025356878,0.0005475654,0.00077322195,0.00051470025],"domain_scores_gemma":[0.9749511,0.01713612,0.0025863654,0.0024857775,0.0014216988,0.0014189836],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012773424,0.00058602146,0.000788071,0.00053164875,0.0025302446,0.0014380162,0.0014854571,0.002229939,0.0026263276],"category_scores_gemma":[0.04318894,0.00051907153,0.0012829602,0.0008758749,0.0018133215,0.00096529967,0.0016681238,0.0026753766,0.00023551748],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013435177,0.0028254539,0.88715917,0.00047669257,0.00046085176,0.02581034,0.029756233,0.0049422737,0.0005234585,0.0041170847,0.0045034382,0.038081374],"study_design_scores_gemma":[0.0015654273,0.005091653,0.8529059,0.0008139497,0.00050299976,0.017729538,0.051899217,0.04984097,0.0008777868,0.008858412,0.009559086,0.00035496586],"about_ca_topic_score_codex":0.27282336,"about_ca_topic_score_gemma":0.27786022,"teacher_disagreement_score":0.27282336,"about_ca_system_score_codex":0.006286785,"about_ca_system_score_gemma":0.0062262793,"threshold_uncertainty_score":0.5424707},"labels":[],"label_agreement":null},{"id":"W4393985972","doi":"10.1002/pds.5790","title":"Clarifying the causal contrast: An empirical example applying the prevalent new user study design","year":2024,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"University of North Carolina at Chapel Hill; Cecil G. Sheps Center for Health Services Research, University of North Carolina, Chapel Hill; Agency for Healthcare Research and Quality","keywords":"Medicine; Propensity score matching; Hazard ratio; Confounding; Pharmacoepidemiology; Internal medicine; Population; Weighting; Oncology; Pharmacology; Environmental health; Confidence interval; Medical prescription","score_opus":0.3642857016108703,"score_gpt":0.503481748549599,"score_spread":0.13919604693872872,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393985972","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.27952787,0.014938562,0.649243,0.023347927,0.0022762842,0.007677871,0.001058029,0.0004547511,0.021475699],"genre_scores_gemma":[0.87022513,0.00084398524,0.117761254,0.005623285,0.00077313726,0.0031466195,0.00026238352,0.000065598506,0.001298552],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.46486655,0.5025625,0.0108921705,0.011906273,0.008208466,0.0015640642],"domain_scores_gemma":[0.12617731,0.8233553,0.018936958,0.025566667,0.0053812657,0.00058251363],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.39966047,0.0020131068,0.0027077624,0.0019951493,0.0026357872,0.0048204507,0.0044303485,0.0073138997,0.010015433],"category_scores_gemma":[0.5913433,0.0012521204,0.006696177,0.0022041048,0.008610662,0.010071985,0.0057355384,0.00725164,0.00059477886],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019574534,0.0023527227,0.22028832,0.0076400633,0.017016733,0.0036984256,0.012382706,0.011154291,0.0017963997,0.52072746,0.008680652,0.17468776],"study_design_scores_gemma":[0.012834264,0.00890578,0.049956407,0.0057324227,0.02223978,0.0035656698,0.0044864602,0.15482263,0.0054492713,0.67648244,0.054950777,0.0005740484],"about_ca_topic_score_codex":0.0035832555,"about_ca_topic_score_gemma":0.002277686,"teacher_disagreement_score":0.39966047,"about_ca_system_score_codex":0.0024844005,"about_ca_system_score_gemma":0.0033629125,"threshold_uncertainty_score":0.74032557},"labels":[],"label_agreement":null},{"id":"W4394780946","doi":"10.48550/arxiv.2404.07411","title":"Joint mixed-effects models for causal inference in clustered network-based observational studies","year":2024,"lang":"en","type":"preprint","venue":"ENLIGHTEN (Jurnal Bimbingan dan Konseling Islam)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; Alliance de recherche numérique du Canada","keywords":"Causal inference; Inference; Observational study; Context (archaeology); Confounding; Econometrics; Computer science; Outcome (game theory); Generalized linear mixed model; Mixed model; Random effects model; Bayesian inference; Multilevel model; Bayesian probability; Machine learning; Statistics; Artificial intelligence; Mathematics; Meta-analysis; Medicine; Geography","score_opus":0.36679597903241584,"score_gpt":0.4424464871940364,"score_spread":0.07565050816162056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394780946","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000892201,0.0005170811,0.9972187,0.00047724,0.000060742692,0.000100585574,0.00025172057,0.000103002625,0.0003787797],"genre_scores_gemma":[0.08005888,0.0021456238,0.90975124,0.00063877046,0.00045250644,0.003157923,0.0010620819,0.00014690614,0.002586087],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9484999,0.043658014,0.0015829487,0.003471505,0.0023131229,0.00047453874],"domain_scores_gemma":[0.8002624,0.17964596,0.0062951054,0.010256347,0.0028316374,0.0007086628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.065891586,0.0019731477,0.0035119988,0.004597454,0.001533568,0.0032712405,0.006721111,0.0037848533,0.009432395],"category_scores_gemma":[0.17765808,0.002239992,0.005499567,0.0056974357,0.0040293173,0.0049424083,0.0050407415,0.0066274023,0.0012347044],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009041381,0.000058664184,0.0028569053,0.0005663353,0.0010671038,0.00022175154,0.00061013293,0.05884336,0.00019913843,0.89583176,0.0023587213,0.03729589],"study_design_scores_gemma":[0.00007174734,0.000046430243,0.0005176747,0.00018667792,0.00020913815,0.00006505092,0.00006475221,0.16959316,0.0001706511,0.82488924,0.0041543646,0.000031074138],"about_ca_topic_score_codex":0.0075466586,"about_ca_topic_score_gemma":0.0075156833,"teacher_disagreement_score":0.065891586,"about_ca_system_score_codex":0.0029106294,"about_ca_system_score_gemma":0.0035572299,"threshold_uncertainty_score":0.34847218},"labels":[],"label_agreement":null},{"id":"W4394782483","doi":"10.1093/biomet/asae021","title":"Sensitivity analysis for matched observational studies with continuous exposures and binary outcomes","year":2024,"lang":"en","type":"article","venue":"Biometrika","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institutes of Health; York University","keywords":"Sensitivity (control systems); Mathematics; Binary number; Observational study; Matching (statistics); Statistics; Binary data; Population; Econometrics; Medicine","score_opus":0.34501543094769704,"score_gpt":0.4661735827427737,"score_spread":0.12115815179507666,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394782483","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012119679,0.008327109,0.96755666,0.0022636084,0.00042763207,0.0018939003,0.002534997,0.0004192813,0.0044571673],"genre_scores_gemma":[0.58153343,0.0075055608,0.38745764,0.004413756,0.0009139555,0.012098248,0.002680995,0.0004066385,0.0029897455],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8049209,0.16995971,0.008053093,0.008326764,0.007371576,0.0013679353],"domain_scores_gemma":[0.4964644,0.46848154,0.014205153,0.01538883,0.0047462042,0.0007139598],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16335699,0.0019859106,0.004814786,0.004673373,0.0009589567,0.0031473136,0.0032586697,0.0028244925,0.010154534],"category_scores_gemma":[0.417404,0.0014719653,0.009363194,0.0033443642,0.0025809202,0.003852427,0.004733142,0.0051970864,0.000517434],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021668172,0.00024769476,0.026862217,0.015341397,0.023427458,0.0017802621,0.0011244152,0.38280085,0.001626624,0.3649409,0.014746369,0.16493496],"study_design_scores_gemma":[0.0006471596,0.0005802008,0.008365061,0.0031781544,0.0069393776,0.00078740955,0.0002796864,0.3295247,0.0014482443,0.6274913,0.02052623,0.00023251232],"about_ca_topic_score_codex":0.0031224135,"about_ca_topic_score_gemma":0.0016121079,"teacher_disagreement_score":0.836643,"about_ca_system_score_codex":0.0036034933,"about_ca_system_score_gemma":0.0036108408,"threshold_uncertainty_score":0.8639247},"labels":[],"label_agreement":null},{"id":"W4394847663","doi":"10.1177/09622802241242313","title":"Estimating dynamic treatment regimes for ordinal outcomes with household interference: Application in household smoking cessation","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; Université de Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Government of Ontario","keywords":"Odds; Ordinal regression; Smoking cessation; Covariate; Robustness (evolution); Ordered logit; Context (archaeology); Econometrics; Ordinal data; Propensity score matching; Computer science; Odds ratio; Statistics; Medicine; Mathematics; Logistic regression","score_opus":0.3968361982278458,"score_gpt":0.6277471862914228,"score_spread":0.23091098806357696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394847663","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02785047,0.00023958208,0.9705218,0.00036624345,0.00001993014,0.00016193518,0.00008169276,0.0000838719,0.0006744858],"genre_scores_gemma":[0.64979124,0.0005460155,0.3466001,0.00029412884,0.000083384635,0.0007592029,0.00028445266,0.00006431328,0.001577301],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98903406,0.008339508,0.00035083527,0.0011281578,0.0008063995,0.00034093304],"domain_scores_gemma":[0.95666796,0.0365886,0.0033692326,0.0022705577,0.00074885366,0.0003548799],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017270936,0.0006459462,0.0019335911,0.00082932995,0.00068976206,0.0011539469,0.0018381823,0.00135041,0.003091587],"category_scores_gemma":[0.06778213,0.00066693523,0.0015128469,0.0013741166,0.001268983,0.0018530648,0.0023970557,0.0021657425,0.00020526587],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00051005924,0.0004286763,0.022050153,0.00031852358,0.0007701056,0.0003246614,0.00070685847,0.630817,0.0010656829,0.13800953,0.0012156769,0.20378315],"study_design_scores_gemma":[0.000071883296,0.00013923888,0.0022167782,0.000043984142,0.00009000782,0.000050289036,0.00008097649,0.9058989,0.00041419055,0.08957633,0.0013897391,0.000027614653],"about_ca_topic_score_codex":0.0054202713,"about_ca_topic_score_gemma":0.0036791693,"teacher_disagreement_score":0.017270936,"about_ca_system_score_codex":0.0012345045,"about_ca_system_score_gemma":0.0017528081,"threshold_uncertainty_score":0.091338515},"labels":[],"label_agreement":null},{"id":"W4394872301","doi":"10.1093/aje/kwae048","title":"Variable selection when estimating effects in external target populations","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Canadian Institutes of Health Research; National Institute on Aging; National Institutes of Health","keywords":"Covariate; Statistics; Outcome (game theory); Selection (genetic algorithm); Inverse probability weighting; Weighting; Selection bias; Econometrics; Medicine; Mathematics; Computer science; Machine learning; Propensity score matching","score_opus":0.12775130415988278,"score_gpt":0.45730091661832684,"score_spread":0.32954961245844405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394872301","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041709733,0.00048636686,0.9928544,0.00041163163,0.00010708034,0.0005608164,0.00017693295,0.00023857322,0.000993269],"genre_scores_gemma":[0.110763215,0.00077713584,0.8821053,0.0007343603,0.0001190033,0.0038781345,0.00046690647,0.00022121413,0.00093471014],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8943997,0.0943796,0.0031392514,0.0038169017,0.0036667143,0.00059783214],"domain_scores_gemma":[0.82046473,0.15928355,0.0051361728,0.011909893,0.0028844061,0.0003212339],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12850979,0.001645871,0.0032525007,0.0021396077,0.0011523718,0.0032269552,0.0034253953,0.0024070928,0.005833533],"category_scores_gemma":[0.31324458,0.0013422116,0.004507058,0.003081872,0.002712202,0.0039706156,0.0046536895,0.0051562465,0.000850853],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011220203,0.00023796999,0.018977677,0.0026086809,0.0034900354,0.00065582513,0.0018761691,0.19769253,0.0010987341,0.5386582,0.00672424,0.22685786],"study_design_scores_gemma":[0.00070545234,0.00035667254,0.0021458392,0.0008901337,0.0007730519,0.00021941813,0.00018312226,0.29066318,0.002166077,0.68739986,0.014420907,0.000076246426],"about_ca_topic_score_codex":0.0036510832,"about_ca_topic_score_gemma":0.0028374996,"teacher_disagreement_score":0.87149024,"about_ca_system_score_codex":0.0016076143,"about_ca_system_score_gemma":0.003465633,"threshold_uncertainty_score":0.67963284},"labels":[],"label_agreement":null},{"id":"W4394958256","doi":"10.1186/s12874-024-02210-9","title":"Application of causal inference methods in individual-participant data meta-analyses in medicine: addressing data handling and reporting gaps with new proposed reporting guidelines","year":2024,"lang":"en","type":"review","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Institute of Genetics; National Institute on Alcohol Abuse and Alcoholism; Universitätsklinikum Heidelberg; Canadian Institutes of Health Research; European Commission","keywords":"Causal inference; Inference; MEDLINE; Meta-analysis; Data science; Computer science; Medicine; Psychology; Data mining; Artificial intelligence","score_opus":0.9950486106954662,"score_gpt":0.8322164748674158,"score_spread":0.16283213582805045,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394958256","genre_codex":"methods","genre_gemma":"review","domain_codex":"methods","domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018607252,0.08607854,0.8361682,0.04401964,0.0063399374,0.016418021,0.004858431,0.0014430014,0.0028135017],"genre_scores_gemma":[0.020370582,0.02500501,0.8952783,0.009956661,0.0017839107,0.045401964,0.0015679165,0.0002846002,0.00035113384],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.13767654,0.6342635,0.18312706,0.009991429,0.034102093,0.00083932583],"domain_scores_gemma":[0.05123325,0.7739837,0.05951535,0.059658494,0.054739162,0.00087005174],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.74468166,0.0036086608,0.008783156,0.019672642,0.0032659944,0.016480785,0.011651149,0.011333607,0.0036333292],"category_scores_gemma":[0.900713,0.0054139355,0.017078944,0.021988405,0.009231944,0.012245865,0.0092027765,0.01572349,0.0013505245],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013173047,0.00018388985,0.009184701,0.28094617,0.033845723,0.0004753397,0.006955949,0.007968505,0.0011631872,0.13583657,0.07530703,0.44681558],"study_design_scores_gemma":[0.0041877357,0.00084755407,0.008029499,0.29491583,0.041123267,0.0010370129,0.0013834931,0.030994436,0.0067333453,0.36334932,0.24632059,0.001077934],"about_ca_topic_score_codex":0.0066786734,"about_ca_topic_score_gemma":0.0054719904,"teacher_disagreement_score":0.25531834,"about_ca_system_score_codex":0.009527448,"about_ca_system_score_gemma":0.03417158,"threshold_uncertainty_score":0.314853},"labels":[],"label_agreement":null},{"id":"W4395078282","doi":"10.1080/00949655.2024.2344126","title":"A threshold mixed-effects Tobit model for treatment-sensitive subgroup identification based on longitudinal measures with floor and ceiling effects and a continuous covariate","year":2024,"lang":"en","type":"article","venue":"Journal of Statistical Computation and Simulation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Mathematics; Covariate; Tobit model; Statistics; Econometrics; Ceiling effect; Ceiling (cloud); Medicine","score_opus":0.09827815014044103,"score_gpt":0.39856960133919783,"score_spread":0.3002914511987568,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395078282","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014227871,0.000600129,0.9814447,0.0009783047,0.00019607459,0.0005158018,0.00082996924,0.00028083147,0.00092631625],"genre_scores_gemma":[0.4204917,0.0016537288,0.561891,0.00095339754,0.0002528029,0.005619078,0.002799002,0.00019737586,0.006141867],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96453565,0.029267574,0.0012062439,0.0025636556,0.0015641532,0.00086266967],"domain_scores_gemma":[0.9485915,0.04297676,0.0026533664,0.0029881261,0.0021813845,0.00060899375],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.046761714,0.0022097626,0.0043248115,0.0033336848,0.0011479553,0.0038605386,0.004691413,0.0032438182,0.009085346],"category_scores_gemma":[0.08791014,0.0013785168,0.004596123,0.0058467947,0.0020246636,0.004485646,0.0031684765,0.0054885093,0.001470677],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025064712,0.00053135696,0.029796544,0.0011823702,0.00267927,0.0008923735,0.0016526429,0.2788545,0.0006922827,0.5695828,0.007726452,0.10390289],"study_design_scores_gemma":[0.00040825503,0.0005626515,0.003155661,0.00023584608,0.000778621,0.00029196838,0.00030179502,0.6835712,0.00038391794,0.30493608,0.0052535674,0.00012041716],"about_ca_topic_score_codex":0.0059156264,"about_ca_topic_score_gemma":0.0047659674,"teacher_disagreement_score":0.046761714,"about_ca_system_score_codex":0.0023569076,"about_ca_system_score_gemma":0.003170515,"threshold_uncertainty_score":0.24730247},"labels":[],"label_agreement":null},{"id":"W4395113354","doi":"10.1177/09622802241247742","title":"The performance of marginal structural models for estimating risk differences and relative risks using weighted univariate generalized linear models","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Statistics; Mathematics; Estimator; Weighting; Univariate; Generalized linear model; Sample size determination; Econometrics; Multivariate statistics; Medicine","score_opus":0.5319458761194644,"score_gpt":0.6391596200709405,"score_spread":0.10721374395147609,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395113354","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.056834288,0.00088692195,0.9393739,0.00056086044,0.00007249509,0.00039003932,0.0003138439,0.0004497124,0.0011178183],"genre_scores_gemma":[0.41568252,0.0006434721,0.58019364,0.00024755148,0.000058063415,0.001803778,0.00044378813,0.00027720284,0.00065000256],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8785439,0.111089535,0.0024610448,0.0037272838,0.0034214167,0.00075670844],"domain_scores_gemma":[0.6106351,0.36100984,0.009698137,0.012626404,0.0052751596,0.000755364],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13859008,0.0019409595,0.0027828524,0.0039370097,0.0007665089,0.0027866806,0.0037030177,0.0019595472,0.003828162],"category_scores_gemma":[0.348771,0.0013907738,0.0053972877,0.003693048,0.0021245284,0.0044101155,0.0034219185,0.0036144555,0.0005245841],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011495886,0.00018422955,0.022047825,0.00074721564,0.0031548413,0.0002408411,0.0011269338,0.7811946,0.00062927743,0.09214615,0.0012841497,0.096094295],"study_design_scores_gemma":[0.00017598098,0.00033724928,0.002976185,0.00023477417,0.00038552305,0.000079090234,0.00012766897,0.9388224,0.00048582707,0.055310242,0.0009695978,0.00009553989],"about_ca_topic_score_codex":0.013399814,"about_ca_topic_score_gemma":0.012383534,"teacher_disagreement_score":0.8614099,"about_ca_system_score_codex":0.0025522618,"about_ca_system_score_gemma":0.003403403,"threshold_uncertainty_score":0.7329432},"labels":[],"label_agreement":null},{"id":"W4396228487","doi":"10.1002/pds.5796","title":"Use of quantitative bias analysis to evaluate single‐arm trials with real‐world data external controls","year":2024,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Princess Margaret Cancer Centre; University of Toronto","funders":"International Society for Pharmacoepidemiology","keywords":"Publication bias; Confounding; Information bias; Meta-analysis; Econometrics; Statistics; Computer science; Selection bias; Medicine; Data mining; Internal medicine; Mathematics","score_opus":0.6914768235977365,"score_gpt":0.5761454646243113,"score_spread":0.11533135897342528,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396228487","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013247453,0.0045770295,0.9633989,0.002511756,0.00096658064,0.008401106,0.002434676,0.00079276913,0.0036698496],"genre_scores_gemma":[0.4301846,0.0013459768,0.5383726,0.0023547225,0.00038806425,0.02528518,0.0011734066,0.0003133124,0.0005821619],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.26695794,0.6797692,0.027356714,0.008596874,0.016517697,0.0008015135],"domain_scores_gemma":[0.10608577,0.81363785,0.035628367,0.032437783,0.0116572175,0.0005529463],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5562491,0.0031887202,0.0045527583,0.005215087,0.0010138246,0.005832903,0.003725588,0.0042828284,0.007774465],"category_scores_gemma":[0.7533862,0.001205112,0.0122984,0.003947251,0.0048490916,0.0042636325,0.005152075,0.0051964084,0.0006392475],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014340671,0.00077181973,0.063661195,0.043525048,0.06697143,0.00062888744,0.0020428253,0.23647533,0.0046899137,0.24717666,0.012698885,0.30701736],"study_design_scores_gemma":[0.0068359114,0.008542396,0.019188868,0.014827407,0.018179677,0.0006255027,0.0005713301,0.48953098,0.013155705,0.36964563,0.05820645,0.00069014943],"about_ca_topic_score_codex":0.0010970137,"about_ca_topic_score_gemma":0.0005532174,"teacher_disagreement_score":0.44375092,"about_ca_system_score_codex":0.004769533,"about_ca_system_score_gemma":0.0053129084,"threshold_uncertainty_score":0.5472239},"labels":[],"label_agreement":null},{"id":"W4396640278","doi":"10.52058/2786-6025-2024-4(32)-1192-1205","title":"МЕТОД ІНТЕРПОЛЯЦІЇ ДЛЯ ПРОГНОЗУВАННЯ МЕТРИК ВИКОРИСТАННЯ ХМАРНИХ ОБЧИСЛЕНЬ В СТАТИСТИЧНОМУ НАВЧАННІ","year":2024,"lang":"uk","type":"article","venue":"Наука і техніка сьогодні","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Tellabs (Canada)","funders":"","keywords":"Political science","score_opus":0.21565560629080563,"score_gpt":0.47545511865320317,"score_spread":0.2597995123623975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396640278","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03999963,0.013789739,0.4698777,0.0106839165,0.0019552922,0.00016281211,0.0013914522,0.00061027706,0.46152914],"genre_scores_gemma":[0.60671264,0.013335355,0.28957427,0.0006678355,0.00073017686,0.00040976203,0.0006867219,0.00051116076,0.08737197],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9980666,0.0005696639,0.000118838645,0.00033964837,0.000765189,0.0001401286],"domain_scores_gemma":[0.99758875,0.0009733653,0.00020693986,0.0005220937,0.0006027508,0.000106207735],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018710403,0.00047126063,0.00043689003,0.0021058626,0.001666327,0.005406564,0.00070093886,0.0009539929,0.02065581],"category_scores_gemma":[0.0075488235,0.00053892867,0.0005313681,0.0019628082,0.003385604,0.0033161903,0.0018450604,0.0021993325,0.0059564],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005405509,0.000020327729,0.0005361267,0.00018534441,0.000018673318,0.00020001654,0.001223475,0.0010084418,0.0024229705,0.93607324,0.00395297,0.054304466],"study_design_scores_gemma":[0.000029833494,0.000051344043,0.001799721,0.00023460624,0.00005885035,0.0006969872,0.0013526586,0.003431835,0.005353,0.6741535,0.31276813,0.000069530994],"about_ca_topic_score_codex":0.0037423952,"about_ca_topic_score_gemma":0.005852665,"teacher_disagreement_score":0.02065581,"about_ca_system_score_codex":0.001839264,"about_ca_system_score_gemma":0.002657398,"threshold_uncertainty_score":0.06910056},"labels":[],"label_agreement":null},{"id":"W4396646664","doi":"10.31234/osf.io/z4yqe","title":"Clarifying the reliability paradox: poor test-retest reliability attenuates group differences","year":2024,"lang":"en","type":"preprint","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Centre for Addiction and Mental Health","funders":"","keywords":"Reliability (semiconductor); Reliability engineering; Test (biology); Group (periodic table); Psychology; Computer science; Engineering; Chemistry; Physics; Biology","score_opus":0.1347329622286347,"score_gpt":0.39283176116411844,"score_spread":0.2580987989354837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396646664","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14146522,0.0028998966,0.8190151,0.023795538,0.00074615376,0.00036129498,0.00027123044,0.00079328107,0.010652259],"genre_scores_gemma":[0.8039874,0.0008039601,0.18797967,0.0042241034,0.00060270814,0.0007719753,0.00017283463,0.00035144726,0.0011059607],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8796202,0.10051598,0.0027756689,0.0075131194,0.008738284,0.00083670474],"domain_scores_gemma":[0.42336586,0.5001431,0.01763921,0.04681451,0.010916401,0.0011208855],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15421157,0.0013461354,0.0018220493,0.0019785422,0.001397402,0.0028413448,0.002589373,0.0023097345,0.0024750258],"category_scores_gemma":[0.4543578,0.0006903767,0.0015921298,0.00181388,0.010995874,0.0064876485,0.004902225,0.0054868646,0.00063714414],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017660882,0.00039388193,0.07814535,0.0017775175,0.0025857864,0.0011369495,0.018243603,0.019911775,0.015903847,0.608431,0.011138966,0.24056515],"study_design_scores_gemma":[0.00036700536,0.0012667495,0.030710947,0.0004345982,0.0008575144,0.00085676805,0.0011199989,0.048049282,0.013787867,0.890303,0.012109031,0.00013705177],"about_ca_topic_score_codex":0.0014791919,"about_ca_topic_score_gemma":0.00087157864,"teacher_disagreement_score":0.8457884,"about_ca_system_score_codex":0.0012982411,"about_ca_system_score_gemma":0.0028050507,"threshold_uncertainty_score":0.81555843},"labels":[],"label_agreement":null},{"id":"W4396659425","doi":"10.1038/s41598-024-60348-4","title":"Causal impact evaluation of occupational safety policies on firms’ default using machine learning uplift modelling","year":2024,"lang":"en","type":"article","venue":"Scientific Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Mila - Quebec Artificial Intelligence Institute","funders":"","keywords":"Gradient boosting; Computer science; Causality (physics); Context (archaeology); Machine learning; Boosting (machine learning); Artificial intelligence; Psychological intervention; Work (physics); Business; Operations research; Medicine; Engineering; Nursing","score_opus":0.30628914770360177,"score_gpt":0.49325954893740775,"score_spread":0.18697040123380598,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396659425","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8127153,0.0013463575,0.17787525,0.001859293,0.00013419894,0.00026965592,0.00097550324,0.00044470027,0.0043797623],"genre_scores_gemma":[0.9911171,0.0002188673,0.0075832526,0.00003389849,0.000030641153,0.000055710465,0.00027288788,0.000008069716,0.00067957654],"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","domain_scores_codex":[0.99673355,0.0024109553,0.00013457614,0.00024210679,0.0002384026,0.00024041774],"domain_scores_gemma":[0.9537304,0.042474397,0.0016290405,0.0010007478,0.0008216319,0.00034382028],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012430111,0.00066555897,0.0013239388,0.0017091403,0.0004556235,0.0014576488,0.0011372864,0.0013749787,0.0047989753],"category_scores_gemma":[0.025474936,0.00021578558,0.0019691105,0.0010545995,0.0008537703,0.0008994674,0.0011523679,0.0013391549,0.00021891126],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006069573,0.00044453784,0.058834005,0.0002679024,0.000435036,0.00023906643,0.00015813041,0.8824431,0.00038627235,0.016625958,0.0010198865,0.03853914],"study_design_scores_gemma":[0.000024383362,0.00014993879,0.008660348,0.00004081475,0.00014362928,0.000020912119,0.00006431357,0.9807342,0.00035568493,0.009393002,0.00040007688,0.000012782579],"about_ca_topic_score_codex":0.009540736,"about_ca_topic_score_gemma":0.0049551018,"teacher_disagreement_score":0.012430111,"about_ca_system_score_codex":0.0013310214,"about_ca_system_score_gemma":0.0016257276,"threshold_uncertainty_score":0.065737545},"labels":[],"label_agreement":null},{"id":"W4396722098","doi":"10.1093/aje/kwae058","title":"Data-driven simulations to assess the impact of study imperfections in time-to-event analyses","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Medical Research Council; Canadian Institutes of Health Research; Université de Bourgogne; Institut National de la Santé et de la Recherche Médicale; Deutsche Forschungsgemeinschaft; McGill University","keywords":"Computer science; Covariate; Event (particle physics); Confounding; Econometrics; Statistics; Flexibility (engineering); R package; Data mining; Mathematics; Machine learning","score_opus":0.46027936864257873,"score_gpt":0.6080347499274775,"score_spread":0.1477553812848988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396722098","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021846667,0.00038240897,0.97289735,0.00066557014,0.00015241352,0.001139909,0.0009356184,0.00052458874,0.0014554756],"genre_scores_gemma":[0.40672585,0.00043394754,0.58574826,0.0006372121,0.00008275157,0.0041876608,0.001053912,0.00023788091,0.0008925781],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9437454,0.051387705,0.0014698597,0.001474998,0.0015487755,0.00037341495],"domain_scores_gemma":[0.42394796,0.54231775,0.012245648,0.0148598235,0.005651538,0.000977236],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13971873,0.0014694898,0.0016689474,0.002144893,0.0007859943,0.0020373585,0.0030290312,0.0020876592,0.0063417065],"category_scores_gemma":[0.34836447,0.0013195523,0.002303138,0.0019160814,0.0018391283,0.0024257114,0.003100948,0.0037462371,0.0003866446],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00071425724,0.00013317226,0.01077963,0.0005405276,0.001096221,0.00016608505,0.00040169884,0.85553634,0.0004082391,0.10485156,0.0018919174,0.02348037],"study_design_scores_gemma":[0.00027808885,0.00021709819,0.0008337333,0.00018065707,0.00020373201,0.000082647115,0.00007153815,0.9081367,0.0006678026,0.08665015,0.0026398695,0.00003806079],"about_ca_topic_score_codex":0.0049262326,"about_ca_topic_score_gemma":0.0040971558,"teacher_disagreement_score":0.8602813,"about_ca_system_score_codex":0.0021118794,"about_ca_system_score_gemma":0.004164644,"threshold_uncertainty_score":0.7389121},"labels":[],"label_agreement":null},{"id":"W4396811591","doi":"10.1002/pds.5787","title":"Describing diversity of real world data sources in pharmacoepidemiologic studies: The <scp>DIVERSE</scp> scoping review","year":2024,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"International Society for Pharmacoepidemiology","keywords":"Diversity (politics); Standardization; Data science; Information retrieval; Set (abstract data type); Computer science; Medicine; Political science","score_opus":0.568981206596947,"score_gpt":0.5322999137570632,"score_spread":0.03668129283988375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396811591","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0072736195,0.892529,0.028618317,0.04048212,0.0040302277,0.011913495,0.005255415,0.0001595286,0.009738335],"genre_scores_gemma":[0.10287299,0.7399062,0.08918968,0.019035367,0.0023762207,0.039959073,0.0052952026,0.00023200532,0.0011332455],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.5617898,0.21970092,0.14470056,0.012210654,0.058970135,0.0026280181],"domain_scores_gemma":[0.14045931,0.7596563,0.043477222,0.018204141,0.036738787,0.0014642219],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.32889974,0.0020420826,0.007855673,0.04897724,0.0046730046,0.019228408,0.0059664845,0.008593461,0.0040578498],"category_scores_gemma":[0.6690633,0.0031364039,0.0064012366,0.052743986,0.007918046,0.018943597,0.012570517,0.0063530537,0.0008582032],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017969355,0.00005815875,0.0045933668,0.7389014,0.004110399,0.0006438646,0.012350824,0.00092198316,0.0008262317,0.013789201,0.017960915,0.20566395],"study_design_scores_gemma":[0.000048668644,0.00005229915,0.0019825993,0.93564326,0.0026769286,0.0003233467,0.0034430039,0.00036722253,0.00034255552,0.006279592,0.048762854,0.000077787474],"about_ca_topic_score_codex":0.010241901,"about_ca_topic_score_gemma":0.015073705,"teacher_disagreement_score":0.67110026,"about_ca_system_score_codex":0.015320907,"about_ca_system_score_gemma":0.07630585,"threshold_uncertainty_score":0.8275861},"labels":[],"label_agreement":null},{"id":"W4396860094","doi":"10.1007/978-3-031-49783-4_9","title":"Individual Fairness","year":2024,"lang":"ca","type":"book-chapter","venue":"Springer Actuarial","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science; Business","score_opus":0.12824130651895554,"score_gpt":0.3662141904112268,"score_spread":0.23797288389227128,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396860094","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025768923,0.00091457565,0.037884664,0.00405814,0.00041573742,0.00004247357,0.00012867847,0.00009501574,0.9538837],"genre_scores_gemma":[0.25584248,0.0011405728,0.012393412,0.0029979274,0.00078871776,0.00020383728,0.00017220387,0.0002122732,0.7262487],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99784434,0.00058498135,0.00006750418,0.0005329177,0.00069597363,0.00027434892],"domain_scores_gemma":[0.9982383,0.00060040574,0.00009109871,0.00053689454,0.00038218455,0.00015104387],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.002699249,0.0005300844,0.00058676314,0.00090072426,0.002624969,0.003883943,0.0009766839,0.0019134834,0.05062083],"category_scores_gemma":[0.007616339,0.00031084483,0.00047779645,0.00082520687,0.00423994,0.0041422606,0.002335288,0.0032569822,0.008039745],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000004132239,0.000005078753,0.00003978503,0.0000071571167,0.0000022348847,0.0000044239623,0.000097671495,0.00016333749,0.000027303593,0.9808858,0.008728409,0.010034743],"study_design_scores_gemma":[0.0000026266307,0.0000048898933,0.000113488524,0.000019834233,0.0000039482175,0.000023968136,0.000059678336,0.00043557776,0.00009503813,0.9257066,0.07353068,0.000003810763],"about_ca_topic_score_codex":0.0026108627,"about_ca_topic_score_gemma":0.0030077898,"teacher_disagreement_score":0.94937915,"about_ca_system_score_codex":0.0024308735,"about_ca_system_score_gemma":0.002447904,"threshold_uncertainty_score":0.16934353},"labels":[],"label_agreement":null},{"id":"W4396860482","doi":"10.1007/978-3-031-49783-4_12","title":"Post-Processing","year":2024,"lang":"en","type":"book-chapter","venue":"Springer Actuarial","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"","keywords":"Computer science","score_opus":0.10493613826065408,"score_gpt":0.36937943561441,"score_spread":0.26444329735375594,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396860482","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00807464,0.0011591725,0.92454207,0.0009932494,0.0026512402,0.00035701608,0.0055937907,0.01819536,0.038433403],"genre_scores_gemma":[0.096854575,0.0018949332,0.6304063,0.001514922,0.0019202152,0.00047312622,0.018427962,0.0049428134,0.24356508],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9993293,0.00006419807,0.000038318412,0.00019864255,0.00027903027,0.00009054329],"domain_scores_gemma":[0.9987412,0.00024999204,0.00003668288,0.0005398942,0.00039438411,0.00003778075],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00078898657,0.0017639247,0.0010199103,0.0011392811,0.00083445833,0.002448775,0.0011364878,0.0010065814,0.11109185],"category_scores_gemma":[0.003243533,0.0005400682,0.0010392601,0.0013553804,0.0005350681,0.0017486048,0.0014313973,0.0019379726,0.09011236],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041620058,0.00014440189,0.0004503795,0.0002434853,0.000069684625,0.000119429424,0.00005836612,0.0061274655,0.047460012,0.015194845,0.08473798,0.84497774],"study_design_scores_gemma":[0.000098301985,0.00052449055,0.0050276527,0.00016006817,0.00024988825,0.0006362744,0.00024060905,0.23905261,0.23825441,0.08290362,0.4327139,0.00013822553],"about_ca_topic_score_codex":0.0022201776,"about_ca_topic_score_gemma":0.003744026,"teacher_disagreement_score":0.11109185,"about_ca_system_score_codex":0.0003891924,"about_ca_system_score_gemma":0.0013242194,"threshold_uncertainty_score":0.37163925},"labels":[],"label_agreement":null},{"id":"W4397022047","doi":"10.1093/aje/kwae071","title":"Validation of algorithms in studies based on routinely collected health data: general principles","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; University of Toronto","funders":"Galderma; National Institutes of Health; Aarhus Universitet; Region Midtjylland; Sanofi","keywords":"Computer science; Operationalization; External validity; Data mining; Terminology; Algorithm; Context (archaeology); Covariate; Data science; Management science; Machine learning; Statistics; Mathematics","score_opus":0.48073120424196,"score_gpt":0.5450480657461021,"score_spread":0.06431686150414212,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4397022047","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0034659016,0.0035667266,0.9822411,0.0035534077,0.00038568454,0.0041970424,0.0002834764,0.00025879883,0.0020478638],"genre_scores_gemma":[0.042041555,0.0011962529,0.9451894,0.0016134729,0.0004618821,0.0088155875,0.0003046267,0.00014797004,0.00022908433],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.21967264,0.6555229,0.059662003,0.019332899,0.044295922,0.0015137565],"domain_scores_gemma":[0.07987326,0.79899967,0.028595936,0.062807344,0.02880435,0.00091941265],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.74852455,0.0037381058,0.008288046,0.014979852,0.0047205416,0.020639477,0.012563303,0.011692106,0.0019352657],"category_scores_gemma":[0.85592335,0.0045895353,0.009443387,0.01076754,0.03284246,0.01567928,0.017840464,0.013548384,0.0012589523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016932414,0.0005240602,0.047509387,0.012682101,0.0074047945,0.0005742051,0.0088447565,0.04735822,0.0015142536,0.6042644,0.0085041635,0.25912648],"study_design_scores_gemma":[0.0014297995,0.0010858711,0.009263342,0.01359835,0.0014069956,0.00083010097,0.0008367818,0.083181255,0.004450747,0.856177,0.02735681,0.0003829766],"about_ca_topic_score_codex":0.0037526104,"about_ca_topic_score_gemma":0.001941402,"teacher_disagreement_score":0.25147545,"about_ca_system_score_codex":0.006784667,"about_ca_system_score_gemma":0.018933628,"threshold_uncertainty_score":0.3101141},"labels":[],"label_agreement":null},{"id":"W4398400885","doi":"10.7910/dvn/hgihgc/xwzkab","title":"confirmatory study survey [coding details].pdf","year":2020,"lang":"en","type":"dataset","venue":"Harvard Dataverse","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Socioeconomic status; Entitlement (fair division); Replication (statistics); Privilege (computing); Psychology; Survey data collection; Coding (social sciences); Social psychology; Sociology; Social science; Political science; Demography; Statistics; Economics; Law; Mathematics; Mathematical economics","score_opus":0.18521111859153333,"score_gpt":0.38815769152307145,"score_spread":0.20294657293153812,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398400885","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00011830425,0.000031100502,0.00022823866,0.00009620498,0.000015988797,0.00009309872,0.99840087,0.00016511156,0.00085101643],"genre_scores_gemma":[0.0016367814,0.00007866042,0.0015191465,0.00020872604,0.000020936408,0.0024010628,0.9907404,0.00029471045,0.0030995493],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9967483,0.0011187375,0.00069712,0.0006054901,0.0005067145,0.0003236975],"domain_scores_gemma":[0.9631394,0.017156899,0.0027635458,0.007367425,0.008642372,0.0009302863],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.007077042,0.001540716,0.001106418,0.004899434,0.0011879955,0.0029639995,0.002854921,0.0017423608,0.30591038],"category_scores_gemma":[0.06303979,0.0011533315,0.0014953804,0.008538923,0.0005880747,0.0018619957,0.0026673172,0.0020194694,0.14181659],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053923482,0.000015627575,0.00084145967,0.0005731649,0.000021292166,0.000008198979,0.00002515253,0.000079223464,0.000024898738,0.00055325654,0.99556893,0.0022348105],"study_design_scores_gemma":[0.0010796946,0.000047258232,0.010201035,0.0014220735,0.000087175715,0.000072947114,0.00026111957,0.00035969436,0.00025078046,0.005847568,0.9803105,0.000060185703],"about_ca_topic_score_codex":0.015638048,"about_ca_topic_score_gemma":0.03383567,"teacher_disagreement_score":0.30591038,"about_ca_system_score_codex":0.001689614,"about_ca_system_score_gemma":0.0044936547,"threshold_uncertainty_score":0.9900346},"labels":[],"label_agreement":null},{"id":"W4399693737","doi":"10.1097/ede.0000000000001768","title":"Natural effects with a recanting witness: non-identifiability or meaningless estimand?","year":2024,"lang":"en","type":"letter","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Witness; Epidemiology; Judaism; University hospital; Clinical epidemiology; Library science; History; Medicine; Family medicine; Political science; Law; Pathology; Archaeology","score_opus":0.177492612641698,"score_gpt":0.44420275572671886,"score_spread":0.26671014308502083,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399693737","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00025239948,0.00082637224,0.0013150865,0.9940049,0.0018792939,0.0000073912656,0.00004878189,0.000012341429,0.0016535217],"genre_scores_gemma":[0.0186439,0.0034328888,0.004430145,0.9476342,0.020115018,0.00008632323,0.00006259047,0.00005774475,0.005537082],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9840655,0.0102101425,0.0013148892,0.0015254392,0.0023711585,0.0005128059],"domain_scores_gemma":[0.7927503,0.18853253,0.0038111059,0.006040647,0.0066536884,0.0022117116],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.028868927,0.0004999318,0.001569398,0.00089951116,0.0027488808,0.0028857575,0.0026720706,0.021905206,0.010604355],"category_scores_gemma":[0.2301667,0.0006494698,0.0012662098,0.00096948916,0.008692386,0.00840782,0.0019340088,0.04105574,0.004208406],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012703823,0.00003167982,0.0024522142,0.00017585667,0.000073161435,0.0030706236,0.0010514399,0.00029876907,0.000107700456,0.11860232,0.82049614,0.053513076],"study_design_scores_gemma":[0.00023040881,0.000058634985,0.0017018802,0.0013741088,0.00006976091,0.0059310915,0.0015003413,0.0024762342,0.00024364513,0.55533034,0.4309946,0.000088901106],"about_ca_topic_score_codex":0.008896311,"about_ca_topic_score_gemma":0.0099130375,"teacher_disagreement_score":0.9711311,"about_ca_system_score_codex":0.003534126,"about_ca_system_score_gemma":0.004870969,"threshold_uncertainty_score":0.15267533},"labels":[],"label_agreement":null},{"id":"W4399726225","doi":"10.1080/00031305.2024.2368794","title":"High-Dimensional Propensity Score and Its Machine Learning Extensions in Residual Confounding Control","year":2024,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Confounding; Residual; Computer science; Proxy (statistics); Exploit; Causal inference; Parametric statistics; Machine learning; Econometrics; Artificial intelligence; Data mining; Statistics; Algorithm; Mathematics","score_opus":0.12057004770728635,"score_gpt":0.39189234053654654,"score_spread":0.2713222928292602,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399726225","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020519602,0.001963767,0.9897758,0.003860153,0.00021109311,0.00007107227,0.00017101495,0.00018726265,0.0017078768],"genre_scores_gemma":[0.12698022,0.0052095638,0.85953677,0.002617202,0.0015302357,0.00095332577,0.000489572,0.00022402097,0.002459085],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9674065,0.025813026,0.0013644086,0.002272911,0.002774462,0.00036873794],"domain_scores_gemma":[0.9289892,0.05485203,0.004226819,0.008136365,0.0033925604,0.000403099],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051241115,0.0010062193,0.0012350526,0.0027204987,0.00087355904,0.003606587,0.0023120928,0.0021544911,0.004172762],"category_scores_gemma":[0.13324124,0.00070164097,0.002376296,0.0048421617,0.0057723545,0.00552905,0.0043670903,0.0071979575,0.0010476795],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077503835,0.00003022425,0.0028229414,0.00028213492,0.00017688924,0.00009609205,0.00027941284,0.015017865,0.0001757076,0.8695447,0.006099842,0.1053967],"study_design_scores_gemma":[0.000053313724,0.00006203604,0.0017225686,0.00021500641,0.00006876987,0.00013412209,0.000050307015,0.08518506,0.00048419132,0.89391565,0.01805186,0.000057151745],"about_ca_topic_score_codex":0.002806732,"about_ca_topic_score_gemma":0.0015516802,"teacher_disagreement_score":0.051241115,"about_ca_system_score_codex":0.0015131788,"about_ca_system_score_gemma":0.0030777345,"threshold_uncertainty_score":0.27099216},"labels":[],"label_agreement":null},{"id":"W4399754935","doi":"10.1080/26941899.2024.2360892","title":"Model Selection for Exposure-Mediator Interaction","year":2024,"lang":"en","type":"article","venue":"Data Science in Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Eisai Incorporated; Canadian Institutes of Health Research; University of Southern California; AbbVie Canada; National Institutes of Health; Genentech; Takeda Pharmaceutical Company; IXICO; H. Lundbeck A/S; Servier; Eisai; Northern California Institute for Research and Education; Alzheimer's Disease Neuroimaging Initiative; GE Healthcare; Pfizer; Biogen; BioClinica; Roche; U.S. Department of Defense; Eli Lilly and Company; Bristol-Myers Squibb; Meso Scale Diagnostics; Novartis Pharmaceuticals Corporation; Merck; Alzheimer's Association","keywords":"Mediator; Selection (genetic algorithm); Psychology; Computer science; Medicine; Artificial intelligence; Internal medicine","score_opus":0.405217553711427,"score_gpt":0.5323269213190341,"score_spread":0.12710936760760716,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399754935","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0114129195,0.00031886832,0.98615813,0.0005898361,0.000094384035,0.0003680806,0.00025752827,0.0004590263,0.00034127932],"genre_scores_gemma":[0.32584494,0.00051849446,0.66337025,0.0007522357,0.00039051654,0.003830854,0.0015658082,0.0002892388,0.003437724],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9746687,0.021787778,0.0005663877,0.001698955,0.0007958347,0.0004823075],"domain_scores_gemma":[0.96362036,0.03202059,0.0008557576,0.0017643725,0.0013520523,0.00038681665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03666107,0.0024937738,0.0032589626,0.0023307786,0.0016459957,0.0017062129,0.004066697,0.0023033745,0.009436379],"category_scores_gemma":[0.050928928,0.0010291914,0.0047713644,0.002528665,0.0013704534,0.0017074243,0.0027311721,0.004592246,0.0012714197],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028889833,0.0009090828,0.048427608,0.001553665,0.0071280934,0.0031160533,0.0019114262,0.41321456,0.005024012,0.1696377,0.017087294,0.32910153],"study_design_scores_gemma":[0.0003403265,0.00030709655,0.0022261366,0.000076149874,0.00047171538,0.00018380959,0.00013332524,0.92735547,0.00086880545,0.06477947,0.0032058905,0.00005191881],"about_ca_topic_score_codex":0.006050504,"about_ca_topic_score_gemma":0.0064616585,"teacher_disagreement_score":0.03666107,"about_ca_system_score_codex":0.0010829287,"about_ca_system_score_gemma":0.004684645,"threshold_uncertainty_score":0.19388461},"labels":[],"label_agreement":null},{"id":"W4399790739","doi":"10.1186/s13063-024-08202-w","title":"Accounting for center-level effects in multicenter randomized controlled trials","year":2024,"lang":"en","type":"article","venue":"Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Population Health Research Institute; McMaster University; Impact","funders":"McMaster University; Population Health Research Institute","keywords":"Randomized controlled trial; Medicine; Logistic regression; Random effects model; Protocol (science); Outcome (game theory); Fixed effects model; Test (biology); Econometrics; Statistics; Meta-analysis; Alternative medicine; Panel data; Internal medicine; Mathematics","score_opus":0.37717584300951007,"score_gpt":0.5227859937060347,"score_spread":0.14561015069652467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399790739","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005803833,0.049525633,0.9097396,0.0052560773,0.0050379923,0.016719438,0.002026584,0.0015865607,0.0043042386],"genre_scores_gemma":[0.13344404,0.0072939475,0.7976413,0.0044519533,0.0015536473,0.05272322,0.001039334,0.00068443886,0.0011682103],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.14165294,0.6827277,0.10904723,0.030690722,0.03371552,0.0021659834],"domain_scores_gemma":[0.11059124,0.7484349,0.06728262,0.05816372,0.0145217255,0.0010057973],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6479879,0.005594765,0.012597671,0.011177846,0.002961922,0.010285111,0.011122837,0.010449887,0.008806629],"category_scores_gemma":[0.82492274,0.0048215487,0.030900344,0.017552355,0.007156142,0.010688583,0.009865605,0.011595351,0.0012970405],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0115535585,0.0006537682,0.06767853,0.09117694,0.17584847,0.0015542053,0.0062113483,0.045911092,0.0014082988,0.20281029,0.01998015,0.37521333],"study_design_scores_gemma":[0.011472233,0.004988012,0.024616769,0.048707575,0.11561172,0.0013740357,0.0010401219,0.15688974,0.0068984395,0.5324249,0.0948065,0.0011699838],"about_ca_topic_score_codex":0.0061168005,"about_ca_topic_score_gemma":0.0068575786,"teacher_disagreement_score":0.3520121,"about_ca_system_score_codex":0.0113393795,"about_ca_system_score_gemma":0.020905424,"threshold_uncertainty_score":0.43409365},"labels":[],"label_agreement":null},{"id":"W4399815117","doi":"10.1145/3673761","title":"Learning Individual Treatment Effects under Heterogeneous Interference in Networks","year":2024,"lang":"en","type":"article","venue":"ACM Transactions on Knowledge Discovery from Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Natural Science Foundation of China","keywords":"Weighting; Benchmark (surveying); Interference (communication); Computer science; Generalization; Regression; Spillover effect; Observational study; Range (aeronautics); Confounding; Sample (material); Process (computing); Machine learning; Artificial intelligence; Mathematics; Statistics; Medicine","score_opus":0.16936547919897604,"score_gpt":0.4090027000751428,"score_spread":0.23963722087616673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399815117","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029533558,0.0013491531,0.9661303,0.0012075711,0.000062416846,0.00020365388,0.00030034207,0.00033730967,0.0008756701],"genre_scores_gemma":[0.6409831,0.0018330509,0.3485887,0.001561308,0.0005474329,0.0013555092,0.0016021045,0.00016215623,0.0033666994],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98580813,0.009180245,0.00048051385,0.0033215159,0.00082160183,0.0003879888],"domain_scores_gemma":[0.9393761,0.053543508,0.0029587066,0.0026431985,0.0010545137,0.00042399843],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02238196,0.001759375,0.003431172,0.0018728229,0.0010307226,0.0019294353,0.0041154777,0.0032085474,0.001976611],"category_scores_gemma":[0.066441864,0.001208616,0.0022521613,0.0022202018,0.002514911,0.0040796045,0.0030493161,0.004821913,0.00047225534],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006417006,0.00036883002,0.017248115,0.00073219603,0.0008809552,0.00025370275,0.0007145982,0.6464299,0.0010192061,0.050567094,0.0037410273,0.27740264],"study_design_scores_gemma":[0.00011366133,0.0000831752,0.0017729942,0.00007393608,0.00019814532,0.000050984887,0.00005771133,0.89086366,0.0005343805,0.104644045,0.0015845497,0.000022837366],"about_ca_topic_score_codex":0.0070678606,"about_ca_topic_score_gemma":0.00652333,"teacher_disagreement_score":0.02238196,"about_ca_system_score_codex":0.0025390114,"about_ca_system_score_gemma":0.0020513574,"threshold_uncertainty_score":0.118368566},"labels":[],"label_agreement":null},{"id":"W4400059274","doi":"10.1093/aje/kwae151","title":"Triple challenges—small sample size in both exposure and control groups to scan rare maternal outcomes in a signal identification approach: a simulation study","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Hamilton Health Sciences Foundation","keywords":"Sample size determination; Statistics; Incidence (geometry); Type I and type II errors; Poisson regression; Poisson distribution; Statistical power; Medicine; Statistic; Econometrics; Mathematics; Population","score_opus":0.17154134662257073,"score_gpt":0.4271610364481177,"score_spread":0.25561968982554695,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400059274","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5092743,0.0016612202,0.47192973,0.004735927,0.00027707338,0.002691328,0.0013124124,0.00032282234,0.0077952105],"genre_scores_gemma":[0.8851715,0.00040120992,0.109864466,0.000847966,0.00006091188,0.0024211148,0.00033933233,0.00004010938,0.00085343904],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96409756,0.03252878,0.0006349752,0.00132869,0.00092889584,0.0004811306],"domain_scores_gemma":[0.6085636,0.36689827,0.007057296,0.010142845,0.005697943,0.001640031],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07934582,0.001033306,0.0016669331,0.0009858842,0.0008525545,0.0016775612,0.0026310433,0.0027389626,0.00318769],"category_scores_gemma":[0.20018403,0.0007630552,0.0028371315,0.0011159775,0.0017467039,0.0023484027,0.0021396535,0.0035721667,0.00024111276],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008277244,0.0015783662,0.046104368,0.0011723881,0.0025842483,0.0011528648,0.00128664,0.8248955,0.0015198757,0.06975937,0.0033486395,0.038320493],"study_design_scores_gemma":[0.0023829672,0.0025477312,0.004428469,0.00032159474,0.000939971,0.00035396835,0.0002959816,0.9337862,0.0011638763,0.05169303,0.00200013,0.000086067725],"about_ca_topic_score_codex":0.0070359805,"about_ca_topic_score_gemma":0.004322524,"teacher_disagreement_score":0.9206542,"about_ca_system_score_codex":0.0019066209,"about_ca_system_score_gemma":0.0025348787,"threshold_uncertainty_score":0.41962582},"labels":[],"label_agreement":null},{"id":"W4400245371","doi":"10.6339/24-jds1143","title":"Physician Effects in Critical Care: A Causal Inference Approach Through Propensity Weighting with Parametric and Super Learning Methods","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Propensity score matching; Weighting; Causal inference; Covariate; Confounding; Inverse probability weighting; Estimator; Parametric statistics; Intensive care unit; Computer science; Medicine; Statistics; Intensive care medicine; Machine learning; Mathematics","score_opus":0.32995507111031813,"score_gpt":0.5379351258148638,"score_spread":0.20798005470454567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400245371","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006010718,0.0001466232,0.9930454,0.000251707,0.000017943583,0.00006864599,0.000035427573,0.00006876241,0.00035471353],"genre_scores_gemma":[0.44474405,0.00078438275,0.5505573,0.00043146586,0.00026088418,0.000651732,0.0002907125,0.00008631095,0.002193138],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98368686,0.013132438,0.00041365513,0.001195563,0.0012455835,0.00032583848],"domain_scores_gemma":[0.89263093,0.09252554,0.005293754,0.0064433613,0.0024838967,0.00062248105],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03688011,0.0008403507,0.0016356418,0.0024760386,0.0007713399,0.001666361,0.002895145,0.0016378281,0.0040227477],"category_scores_gemma":[0.09378984,0.0008275164,0.0018218941,0.0028030733,0.0023951752,0.0034945118,0.0034258266,0.0034745634,0.00027933635],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026231294,0.00027985653,0.014273856,0.000318161,0.000543161,0.00031682602,0.00063476316,0.48114848,0.00061463274,0.327477,0.0023203464,0.17181058],"study_design_scores_gemma":[0.000038524733,0.00005850409,0.0009145621,0.000038426508,0.000050637198,0.000058794485,0.000041637333,0.8317536,0.00023921044,0.165842,0.00094640057,0.00001771402],"about_ca_topic_score_codex":0.004684018,"about_ca_topic_score_gemma":0.0037570214,"teacher_disagreement_score":0.03688011,"about_ca_system_score_codex":0.0014485064,"about_ca_system_score_gemma":0.0026380597,"threshold_uncertainty_score":0.19504297},"labels":[],"label_agreement":null},{"id":"W4400421737","doi":"10.1093/aje/kwae188","title":"A simple Cox approach to estimating risk ratios without sharing individual-level data in multisite studies","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"CVS Health; Kaiser Permanente Washington Health Research Institute; Kaiser Permanente","keywords":"Computer science; Poisson regression; Confidence interval; Regression analysis; Data set; Meta-analysis; Statistics; Poisson distribution; Data mining; Software; Medicine; Mathematics; Population; Machine learning; Environmental health; Artificial intelligence","score_opus":0.5139494630489853,"score_gpt":0.535567055144398,"score_spread":0.021617592095412697,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400421737","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016226476,0.00032329006,0.99649185,0.00030062586,0.000068310575,0.00022173802,0.00025554473,0.0002385572,0.00047746327],"genre_scores_gemma":[0.08758729,0.00083423575,0.9064146,0.00034146284,0.0002764665,0.0016846386,0.0005144209,0.00018359559,0.0021631867],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96437275,0.0256842,0.0019355409,0.0038627656,0.0037836141,0.00036117493],"domain_scores_gemma":[0.90098476,0.07580368,0.004162933,0.016012343,0.002626208,0.00041006604],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051928896,0.0011164944,0.001722759,0.0038850745,0.00078483124,0.0021841305,0.0042960458,0.00162735,0.008493231],"category_scores_gemma":[0.14789465,0.0012377877,0.0040413565,0.0043403185,0.0012580156,0.0032228122,0.0030704483,0.0035205132,0.0012904813],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007423296,0.00024833702,0.022037804,0.0014606237,0.0038749564,0.0007403122,0.00085920404,0.07439442,0.0021274663,0.2826893,0.01390591,0.5969194],"study_design_scores_gemma":[0.00053267385,0.0005202119,0.008146806,0.00040949177,0.001501803,0.0013237346,0.00024758762,0.3244534,0.0027071515,0.63223934,0.027756352,0.00016141776],"about_ca_topic_score_codex":0.004446332,"about_ca_topic_score_gemma":0.0041217697,"teacher_disagreement_score":0.051928896,"about_ca_system_score_codex":0.001164509,"about_ca_system_score_gemma":0.0029371334,"threshold_uncertainty_score":0.27462953},"labels":[],"label_agreement":null},{"id":"W4400479474","doi":"10.1016/j.jclinepi.2024.111458","title":"Statistical analysis of self-reported health conditions in cohort studies: handling of missing onset age","year":2024,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"National Cancer Institute; National Institutes of Health; American Lebanese Syrian Associated Charities","keywords":"Epidemiology; Outcome (game theory); Medicine; Missing data; Cohort study; Cohort; Demography; Pediatrics; Internal medicine; Statistics","score_opus":0.6556764497310326,"score_gpt":0.676722069545854,"score_spread":0.021045619814821448,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400479474","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029365586,0.002883788,0.9649432,0.0012045797,0.00027852374,0.00015079074,0.0006243544,0.00035011335,0.00019904817],"genre_scores_gemma":[0.5132898,0.0033744534,0.4771117,0.0006941138,0.0010006598,0.0011512198,0.0015379577,0.00026658786,0.0015733987],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.83552265,0.14199398,0.007781564,0.007438616,0.006060369,0.0012027835],"domain_scores_gemma":[0.30779997,0.62308985,0.012180864,0.0513088,0.0044059865,0.0012145872],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2007749,0.0014946522,0.00449094,0.003534034,0.0014555604,0.0036112815,0.0075386204,0.0030454395,0.003099212],"category_scores_gemma":[0.48198414,0.0021000598,0.007298662,0.004702017,0.0026377349,0.004314688,0.003883261,0.0055111083,0.00032227024],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0057307165,0.00084514526,0.27097142,0.00490815,0.030998757,0.0023567546,0.002243004,0.14118089,0.0032111534,0.1515944,0.007971109,0.37798846],"study_design_scores_gemma":[0.0009534401,0.0013809685,0.042672206,0.00076706725,0.0064902557,0.0012172951,0.00038777397,0.6041334,0.0028961378,0.33324856,0.0056860805,0.00016673021],"about_ca_topic_score_codex":0.005001259,"about_ca_topic_score_gemma":0.0039235074,"teacher_disagreement_score":0.7992251,"about_ca_system_score_codex":0.0009132134,"about_ca_system_score_gemma":0.004581321,"threshold_uncertainty_score":0.9855868},"labels":[],"label_agreement":null},{"id":"W4400520097","doi":"10.1101/2024.07.11.24310262","title":"Instrumental variable analysis: choice of control variables is critical and can lead to biased results","year":2024,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute for Health and Care Research","keywords":"Lead (geology); Instrumental variable; Variable (mathematics); Econometrics; Control (management); Control variable; Economics; Statistics; Mathematics; Geology; Management","score_opus":0.11356824131295581,"score_gpt":0.4128930792674072,"score_spread":0.2993248379544514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400520097","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018067567,0.005185102,0.945063,0.019081784,0.0020637591,0.0009095287,0.0006466939,0.00052497257,0.008457559],"genre_scores_gemma":[0.5962124,0.0037774083,0.3763892,0.012728885,0.0017699342,0.00324382,0.000580201,0.00068268157,0.0046153865],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.708031,0.2568435,0.012029123,0.008237852,0.012942871,0.0019156465],"domain_scores_gemma":[0.25368285,0.68013704,0.025642049,0.030629158,0.009203959,0.0007049558],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2295927,0.0015244242,0.0031685368,0.0021636288,0.0019568661,0.005824693,0.003453448,0.0041377093,0.0069751316],"category_scores_gemma":[0.5767878,0.0009909477,0.0029145137,0.003391833,0.005788001,0.0037465915,0.0039891866,0.008445883,0.001019128],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00117085,0.00030351125,0.06285398,0.003553338,0.0068912464,0.001720655,0.0021970414,0.055732902,0.0010837223,0.59420687,0.036245827,0.23404007],"study_design_scores_gemma":[0.00065238524,0.000392303,0.011177394,0.0051972354,0.0014894808,0.00053439295,0.00085170695,0.13620977,0.0045936396,0.7967115,0.041891363,0.00029881333],"about_ca_topic_score_codex":0.004143199,"about_ca_topic_score_gemma":0.0022150804,"teacher_disagreement_score":0.7704073,"about_ca_system_score_codex":0.0025593392,"about_ca_system_score_gemma":0.00489566,"threshold_uncertainty_score":0.95004934},"labels":[],"label_agreement":null},{"id":"W4400599257","doi":"10.1186/s12874-024-02273-8","title":"SurvdigitizeR: an algorithm for automated survival curve digitization","year":2024,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; York University; Hospital for Sick Children; Public Health Ontario","funders":"","keywords":"Digitization; Algorithm; Computer science; Censoring (clinical trials); Mean squared error; Artificial intelligence; Statistics; Mathematics; Pattern recognition (psychology); Computer vision","score_opus":0.8083186803653117,"score_gpt":0.6766793295584699,"score_spread":0.13163935080684186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400599257","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004684112,0.00080751895,0.9345315,0.00036758147,0.00013468253,0.0004927697,0.00572042,0.052431587,0.000829871],"genre_scores_gemma":[0.030754836,0.00045708756,0.95515734,0.00021118196,0.00007795668,0.0021742107,0.0058923163,0.004201634,0.0010735614],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.995656,0.0018729251,0.0006899611,0.0008618976,0.000791331,0.00012790912],"domain_scores_gemma":[0.9722271,0.022174416,0.0018554913,0.0015447055,0.0019904522,0.00020782043],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.016119275,0.0027654357,0.0022264258,0.008761003,0.0008066465,0.0028480375,0.0033336354,0.0017708213,0.015788103],"category_scores_gemma":[0.049403306,0.0019944876,0.0035097934,0.0049824943,0.00070665334,0.0018953778,0.002768554,0.0035777707,0.005145456],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001371769,0.00020671386,0.017438402,0.0022376392,0.0022182777,0.0003511452,0.00093303464,0.10959386,0.003124583,0.012000236,0.10650403,0.7440203],"study_design_scores_gemma":[0.00080281915,0.00022361918,0.00448425,0.00031747555,0.0005351764,0.0005611191,0.0001412684,0.8863416,0.008014188,0.027203536,0.07115019,0.00022479842],"about_ca_topic_score_codex":0.0059318845,"about_ca_topic_score_gemma":0.007142184,"teacher_disagreement_score":0.9838807,"about_ca_system_score_codex":0.0017635268,"about_ca_system_score_gemma":0.004437806,"threshold_uncertainty_score":0.085247874},"labels":[],"label_agreement":null},{"id":"W4400692562","doi":"10.1093/biomtc/ujae065","title":"Multiply robust estimation of marginal structural models in observational studies subject to covariate-driven observations","year":2024,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"National Institute of Child Health and Human Development; National Institute of Environmental Health Sciences; National Institute on Aging; Eunice Kennedy Shriver National Institute of Child Health and Human Development; North Carolina State University; Fonds de Recherche du Québec - Santé; University of North Carolina; National Institutes of Health; National Science Foundation","keywords":"Covariate; Causal inference; Estimator; Observational study; Confounding; Econometrics; Marginal structural model; Inference; Computer science; Estimation; Specification; Statistics; Data mining; Mathematics; Artificial intelligence; Engineering","score_opus":0.649482041297089,"score_gpt":0.4852762919118487,"score_spread":0.1642057493852403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400692562","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048643635,0.00028877336,0.9941755,0.00019836506,0.000019625111,0.000048475064,0.00009556824,0.0001080982,0.00020140279],"genre_scores_gemma":[0.20366442,0.0011021184,0.79200953,0.00021578625,0.00018700444,0.0007690902,0.00060288043,0.00010089057,0.0013482913],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97947294,0.01605397,0.00073958276,0.0019571492,0.001485744,0.00029051417],"domain_scores_gemma":[0.8924818,0.09144476,0.005622754,0.008586921,0.001528555,0.0003352697],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031160885,0.0010001808,0.0022295974,0.0023602848,0.00061823067,0.0016389084,0.0032337322,0.0020223015,0.0033419],"category_scores_gemma":[0.13570856,0.001160989,0.0023194463,0.0032309853,0.0021689485,0.0024572741,0.003099439,0.0032593498,0.00048536883],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002246007,0.00013114137,0.015544789,0.00060360425,0.0013922667,0.00039773254,0.0006536939,0.17940319,0.0016713813,0.5937175,0.0019150351,0.20434497],"study_design_scores_gemma":[0.0000850668,0.0001630028,0.0034296915,0.00012674154,0.0002269229,0.0001694098,0.00008661092,0.51326543,0.00095948443,0.47760615,0.0038335172,0.00004801317],"about_ca_topic_score_codex":0.0036699208,"about_ca_topic_score_gemma":0.0033494572,"teacher_disagreement_score":0.9688391,"about_ca_system_score_codex":0.0011282907,"about_ca_system_score_gemma":0.0021317168,"threshold_uncertainty_score":0.16479653},"labels":[],"label_agreement":null},{"id":"W4400812228","doi":"10.2196/53622","title":"Distributed Statistical Analyses: A Scoping Review and Examples of Operational Frameworks Adapted to Health Analytics","year":2024,"lang":"en","type":"review","venue":"JMIR Medical Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"British Columbia Academic Health Science Network; British Columbia Environmental and Occupational Health Research Network; Université de Sherbrooke","funders":"","keywords":"Preprint; Analytics; Computer science; Data science; World Wide Web","score_opus":0.3043032434029367,"score_gpt":0.5666461887389151,"score_spread":0.26234294533597846,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400812228","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00063831377,0.93842214,0.043823015,0.0071634,0.0011950181,0.0016872437,0.0007305741,0.0002355227,0.0061048125],"genre_scores_gemma":[0.010144159,0.89427185,0.085812494,0.002673039,0.00044895866,0.005001172,0.0006803712,0.0001647989,0.00080311403],"study_design_codex":"design_other","study_design_gemma":"systematic_review","domain_scores_codex":[0.9085217,0.0517917,0.020979943,0.004281418,0.013396751,0.0010284898],"domain_scores_gemma":[0.58223075,0.369478,0.011992167,0.010019901,0.025580356,0.00069879834],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.100786276,0.0027072176,0.004561084,0.04141907,0.0026590684,0.0100817885,0.0050210357,0.0065576946,0.004880484],"category_scores_gemma":[0.26654536,0.0018908026,0.008943481,0.049446635,0.0066304356,0.009047989,0.0071038078,0.006318052,0.0015414306],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000097489006,0.00007656256,0.000923641,0.29997906,0.0010723511,0.0004299178,0.0053558247,0.0029143884,0.0005535684,0.08617218,0.020058092,0.5823668],"study_design_scores_gemma":[0.000044416945,0.00009013447,0.00115893,0.6395602,0.0015087236,0.00047924437,0.002591668,0.001331569,0.000588073,0.04531128,0.3071985,0.00013732022],"about_ca_topic_score_codex":0.011677822,"about_ca_topic_score_gemma":0.016754646,"teacher_disagreement_score":0.89921373,"about_ca_system_score_codex":0.010805164,"about_ca_system_score_gemma":0.038461458,"threshold_uncertainty_score":0.53301513},"labels":[],"label_agreement":null},{"id":"W4400899848","doi":"10.24072/pcjournal.564","title":"hdmax2, an R package to perform high dimension mediation analysis","year":2025,"lang":"en","type":"article","venue":"Peer Community Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre Hospitalier Universitaire Sainte-Justine; Université du Québec à Montréal","funders":"Agence Nationale de la Recherche","keywords":"Dimension (graph theory); Mediation; R package; Computer science; Mathematics; Sociology; Programming language; Combinatorics; Social science","score_opus":0.1767762054822567,"score_gpt":0.4470982631207183,"score_spread":0.2703220576384616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400899848","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0050983564,0.0016134786,0.80548877,0.0014705048,0.0008287911,0.00091012055,0.07102839,0.10905442,0.0045071063],"genre_scores_gemma":[0.04787874,0.0012880453,0.84502023,0.0018530685,0.00036618815,0.0090875,0.030268684,0.05736397,0.006873562],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9898767,0.00656276,0.000662041,0.0012725372,0.0012335195,0.00039252173],"domain_scores_gemma":[0.94483477,0.04806706,0.002048972,0.0027359324,0.0018068057,0.00050638267],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0145902885,0.0040070284,0.0029370694,0.0025812075,0.00089470006,0.0027008655,0.0040602684,0.001578316,0.07855315],"category_scores_gemma":[0.07747757,0.002211281,0.0058903233,0.0025761495,0.0013242926,0.0024375557,0.0042072413,0.005424283,0.021607213],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017461615,0.0002991441,0.025130756,0.009729586,0.010153977,0.0015854109,0.0017600766,0.025230588,0.004668538,0.04759076,0.65157235,0.2205326],"study_design_scores_gemma":[0.0015824834,0.0006574432,0.019875951,0.0016143393,0.0033097332,0.0015847428,0.0005350783,0.13657609,0.007920488,0.16563039,0.6601163,0.0005968426],"about_ca_topic_score_codex":0.0048739347,"about_ca_topic_score_gemma":0.007581779,"teacher_disagreement_score":0.07855315,"about_ca_system_score_codex":0.0007444208,"about_ca_system_score_gemma":0.0051612556,"threshold_uncertainty_score":0.26278645},"labels":[],"label_agreement":null},{"id":"W4400969532","doi":"10.1177/09622802241262527","title":"Minimizing confounding in comparative observational studies with time-to-event outcomes: An extensive comparison of covariate balancing methods using Monte Carlo simulation","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"","keywords":"Covariate; Confounding; Observational study; Monte Carlo method; Econometrics; Computer science; Statistics; Event (particle physics); Mathematics","score_opus":0.8432242746118068,"score_gpt":0.7654410243786494,"score_spread":0.07778325023315746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400969532","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13135527,0.009116324,0.8518018,0.0013985928,0.00016275681,0.0021689862,0.00026734953,0.0002761375,0.0034527755],"genre_scores_gemma":[0.61165947,0.0033329574,0.38018894,0.0004973469,0.00012846087,0.003303485,0.0002906698,0.00011522364,0.00048343712],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8425495,0.14683673,0.0038932997,0.0021651287,0.0041483934,0.00040692795],"domain_scores_gemma":[0.36825258,0.60662997,0.008374231,0.01191042,0.004187998,0.00064482883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18000585,0.001422689,0.0029926214,0.002475345,0.00066416623,0.001997784,0.0022089614,0.0021742717,0.0020021286],"category_scores_gemma":[0.36879927,0.0009334116,0.0035124165,0.0020449872,0.0016534477,0.0032109225,0.002918087,0.0017501785,0.00012547479],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0044430527,0.0005727911,0.017518593,0.0015490174,0.0057443604,0.0001320099,0.0010375424,0.7814373,0.0006007452,0.048015345,0.00078188034,0.13816735],"study_design_scores_gemma":[0.0016357236,0.0025875664,0.008166098,0.0012088644,0.001566665,0.00016939317,0.00023249153,0.9156039,0.0011063074,0.063369855,0.004183772,0.00016933243],"about_ca_topic_score_codex":0.002736044,"about_ca_topic_score_gemma":0.0026753435,"teacher_disagreement_score":0.18000585,"about_ca_system_score_codex":0.002068789,"about_ca_system_score_gemma":0.0028651212,"threshold_uncertainty_score":0.9519733},"labels":[],"label_agreement":null},{"id":"W4401037694","doi":"10.1002/sim.10167","title":"Modern approaches for evaluating treatment effect heterogeneity from clinical trials and observational data","year":2024,"lang":"en","type":"review","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Bayer (Canada)","funders":"","keywords":"Observational study; Computer science; Identification (biology); Rule of thumb; Clinical trial; Medical physics; Machine learning; Artificial intelligence; Medicine; Statistics; Mathematics; Algorithm","score_opus":0.9530672804330427,"score_gpt":0.7219823764569416,"score_spread":0.23108490397610104,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401037694","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008313991,0.26181307,0.7273455,0.005374742,0.0007459952,0.0005518164,0.0005391511,0.00023298638,0.0025653713],"genre_scores_gemma":[0.062910035,0.34903416,0.5722813,0.00480475,0.004273254,0.0042548208,0.0010663638,0.0002620183,0.0011133744],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.8919283,0.082296886,0.0068394653,0.0041135848,0.014443368,0.00037845827],"domain_scores_gemma":[0.60205597,0.37724167,0.007676662,0.0075172917,0.0050978903,0.00041058462],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11392827,0.002804964,0.0060016382,0.011195754,0.00063819526,0.004624818,0.0045167296,0.003348429,0.0037064443],"category_scores_gemma":[0.24017584,0.0012773758,0.0064831567,0.00898669,0.005203971,0.0051012556,0.0036168105,0.0068665706,0.0010087591],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001479982,0.00008683471,0.0023789548,0.023121176,0.0053670476,0.00016419851,0.0004444127,0.015679952,0.0002736667,0.24585216,0.0067725144,0.6997111],"study_design_scores_gemma":[0.00017998998,0.00024230093,0.0022484497,0.008596461,0.0020873817,0.00042485818,0.00015611351,0.018553482,0.0005470078,0.92268145,0.044140045,0.00014246297],"about_ca_topic_score_codex":0.0020475704,"about_ca_topic_score_gemma":0.0014715027,"teacher_disagreement_score":0.88607174,"about_ca_system_score_codex":0.0030722765,"about_ca_system_score_gemma":0.0059716254,"threshold_uncertainty_score":0.6025175},"labels":[],"label_agreement":null},{"id":"W4401195388","doi":"10.1002/sim.10188","title":"Evaluation and comparison of covariate balance metrics in studies with time‐dependent confounding","year":2024,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Centre hospitalier de l'Université Laval","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Confounding; Statistics; Inverse probability weighting; Censoring (clinical trials); Marginal structural model; Weighting; Inverse probability; Mahalanobis distance; Econometrics; Causal inference; Proportional hazards model; Residual; Propensity score matching; Computer science; Mathematics; Medicine; Bayesian probability; Posterior probability","score_opus":0.26558728525217706,"score_gpt":0.5410066149450267,"score_spread":0.2754193296928496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401195388","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2305296,0.014797657,0.745679,0.0022426245,0.00027062607,0.0012731855,0.0022713614,0.0006109609,0.002324855],"genre_scores_gemma":[0.6501953,0.0017760122,0.34447908,0.00019489686,0.00010931764,0.0013281,0.0014359083,0.00013986982,0.00034153572],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8838681,0.09994693,0.0068404945,0.002440838,0.0064912187,0.00041237034],"domain_scores_gemma":[0.47244114,0.4784858,0.021637654,0.015040635,0.011117664,0.0012771707],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22929187,0.0013586617,0.0022388594,0.0090062795,0.000887857,0.0027791364,0.0018097518,0.0023988262,0.0018437814],"category_scores_gemma":[0.4061198,0.00052496925,0.0026456849,0.0066528404,0.0017880226,0.0039959545,0.0037504148,0.001576564,0.0001366062],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0059937816,0.0003979044,0.22712405,0.0044802283,0.014034227,0.00036251242,0.002630454,0.2409045,0.002542395,0.08694503,0.0050373757,0.40954754],"study_design_scores_gemma":[0.0010391063,0.003302728,0.06905515,0.0013754978,0.0029449489,0.0006343696,0.0009940288,0.7939963,0.0036861377,0.1140434,0.008673485,0.00025480866],"about_ca_topic_score_codex":0.0022476858,"about_ca_topic_score_gemma":0.0019541087,"teacher_disagreement_score":0.77070814,"about_ca_system_score_codex":0.0022602526,"about_ca_system_score_gemma":0.0023113198,"threshold_uncertainty_score":0.9504203},"labels":[],"label_agreement":null},{"id":"W4401219712","doi":"10.1002/cjs.11825","title":"Bayesian jackknife empirical likelihood‐based inference for missing data and causal inference","year":2024,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Minority Health and Health Disparities; National Institute of General Medical Sciences; National Security Agency; Simons Foundation; National Science Foundation","keywords":"Jackknife resampling; Missing data; Inference; Causal inference; Estimator; Empirical likelihood; Econometrics; Imputation (statistics); Computer science; Bayesian inference; Statistics; Bayesian probability; Mathematics; Artificial intelligence","score_opus":0.23073993883908367,"score_gpt":0.4527775907923348,"score_spread":0.22203765195325115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401219712","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023819564,0.00023650081,0.99641305,0.00020977965,0.00003018104,0.000045198354,0.00006788649,0.00008116678,0.0005341991],"genre_scores_gemma":[0.2788306,0.0011868812,0.7157081,0.000552616,0.00021728448,0.0007458573,0.0005457033,0.00015062299,0.002062335],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.966123,0.026639763,0.0012402275,0.0023499567,0.0030343547,0.00061267713],"domain_scores_gemma":[0.907918,0.076653294,0.0052204453,0.0061700973,0.0034676113,0.0005705784],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048360594,0.0011948205,0.0032387297,0.0036847813,0.001418181,0.0025985355,0.0044353837,0.0024562152,0.0051957844],"category_scores_gemma":[0.20032719,0.0012745466,0.0023469252,0.0041680727,0.0039955615,0.0047017112,0.003093832,0.0046166554,0.0006544464],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003539043,0.00018495863,0.010907472,0.0009948538,0.0008989821,0.00071933446,0.0008772097,0.18203117,0.0008720557,0.63395905,0.0048381677,0.16336282],"study_design_scores_gemma":[0.00009940841,0.000061867526,0.001516317,0.00026144908,0.00012263622,0.00026598957,0.00014362794,0.4697849,0.00083683094,0.523216,0.0036350195,0.00005591771],"about_ca_topic_score_codex":0.00650309,"about_ca_topic_score_gemma":0.0048142397,"teacher_disagreement_score":0.048360594,"about_ca_system_score_codex":0.0016238111,"about_ca_system_score_gemma":0.0036289352,"threshold_uncertainty_score":0.25575835},"labels":[],"label_agreement":null},{"id":"W4401273264","doi":"10.1186/s12874-024-02284-5","title":"Can supervised deep learning architecture outperform autoencoders in building propensity score models for matching?","year":2024,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Autoencoder; Propensity score matching; Artificial intelligence; Computer science; Machine learning; Deep learning; Supervised learning; Matching (statistics); Unsupervised learning; Observational study; Variance (accounting); Statistics; Artificial neural network; Mathematics","score_opus":0.7400976786095773,"score_gpt":0.5810570523530081,"score_spread":0.15904062625656923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401273264","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16772415,0.0011115745,0.8248403,0.0026827566,0.00012383971,0.00015426188,0.00035106172,0.0005645289,0.0024475337],"genre_scores_gemma":[0.8447811,0.00061880244,0.15187772,0.0006821989,0.000093751776,0.00023284568,0.00034393705,0.000055722077,0.0013138916],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99639565,0.0026423729,0.00013213673,0.00041130194,0.0002609706,0.00015760673],"domain_scores_gemma":[0.97575265,0.018987402,0.001728382,0.0017171066,0.0014974163,0.000317137],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.014726511,0.0007714075,0.0007755495,0.0006725644,0.00032057625,0.0012678052,0.0011237732,0.0010301557,0.002348051],"category_scores_gemma":[0.062313724,0.00043998993,0.0008981592,0.0006215755,0.0010817627,0.0021897887,0.0012118765,0.0017353459,0.00045261733],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065203884,0.00029575208,0.040319677,0.0003468449,0.0006232161,0.000106943946,0.00028420004,0.67243576,0.0011984163,0.036310367,0.0034750095,0.24395174],"study_design_scores_gemma":[0.000054750788,0.00009739415,0.002226555,0.00008507119,0.00006164726,0.000023850216,0.000025648871,0.96287686,0.00074646354,0.033055514,0.0007316079,0.000014683788],"about_ca_topic_score_codex":0.0048421593,"about_ca_topic_score_gemma":0.006034849,"teacher_disagreement_score":0.9852735,"about_ca_system_score_codex":0.0011915449,"about_ca_system_score_gemma":0.0021307475,"threshold_uncertainty_score":0.07788211},"labels":[],"label_agreement":null},{"id":"W4401328848","doi":"10.1080/03155986.2024.2383095","title":"PresAIse, a prescriptive AI solution for enterprise","year":2024,"lang":"en","type":"article","venue":"INFOR Information Systems and Operational Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Computer science; Knowledge management","score_opus":0.23603342410095832,"score_gpt":0.4916251351898137,"score_spread":0.25559171108885537,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401328848","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019485077,0.00028260474,0.97965235,0.004163057,0.0001490106,0.0002476879,0.00043741634,0.0051356647,0.007983676],"genre_scores_gemma":[0.06959211,0.0004832882,0.91726524,0.0017545605,0.00012993472,0.0005506614,0.0008455187,0.00061149395,0.008767224],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9938176,0.0030240284,0.00035331902,0.0010740877,0.0015498092,0.00018108715],"domain_scores_gemma":[0.98629665,0.009410078,0.0005568325,0.002230277,0.0011357341,0.00037040215],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009844049,0.0012341512,0.0007117799,0.0015615381,0.001391739,0.004325462,0.0025300737,0.0025050081,0.010787529],"category_scores_gemma":[0.030213805,0.0008512642,0.0020002592,0.0010412758,0.002463451,0.0063294885,0.005852532,0.0049568773,0.0026880878],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029678518,0.00028606856,0.0018741541,0.00095350604,0.0002117478,0.000660225,0.0028806068,0.055708308,0.005303668,0.5737516,0.040122595,0.31795064],"study_design_scores_gemma":[0.00010007084,0.000078831064,0.00024461225,0.00025869513,0.000060272363,0.00023890434,0.00039264208,0.3013315,0.0033460483,0.5713449,0.12253827,0.000065160944],"about_ca_topic_score_codex":0.00331608,"about_ca_topic_score_gemma":0.0071698353,"teacher_disagreement_score":0.010787529,"about_ca_system_score_codex":0.001488289,"about_ca_system_score_gemma":0.00535371,"threshold_uncertainty_score":0.05206096},"labels":[],"label_agreement":null},{"id":"W4401386448","doi":"10.1080/07350015.2024.2388643","title":"Difference-in-Differences Estimator of Quantile Treatment Effect on the Treated","year":2024,"lang":"en","type":"article","venue":"Journal of Business and Economic Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"Alliance de recherche numérique du Canada","keywords":"Estimator; Quantile; Covariate; Econometrics; Consistency (knowledge bases); Mathematics; Statistics; Confidence interval; Outcome (game theory)","score_opus":0.09785292078610203,"score_gpt":0.3699782721082899,"score_spread":0.27212535132218785,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401386448","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010667747,0.00042919247,0.98434895,0.0008934521,0.00024882198,0.00030111766,0.0012870759,0.00027204232,0.0015516336],"genre_scores_gemma":[0.38602087,0.0007722073,0.6008807,0.0014810672,0.0004439472,0.0015780574,0.0030389798,0.00025898806,0.005525184],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98854864,0.0076268967,0.0004192807,0.0016034336,0.0012832229,0.0005186118],"domain_scores_gemma":[0.9700514,0.021226289,0.0019935817,0.004657487,0.001719324,0.0003518495],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01987534,0.000566493,0.0018711578,0.0013754633,0.00040446027,0.0013315901,0.003935852,0.0015876293,0.01072293],"category_scores_gemma":[0.065559365,0.0005498894,0.0015905671,0.001543165,0.0014607628,0.0015357176,0.0021355199,0.0034822011,0.0013509361],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001247617,0.0007100015,0.062242247,0.0010616669,0.0017662662,0.0002859451,0.00082677894,0.063576154,0.0030020124,0.40743273,0.017895412,0.43995312],"study_design_scores_gemma":[0.0010600903,0.0010617268,0.034301884,0.00034098444,0.0009807664,0.0005781251,0.00044809506,0.41730505,0.008608936,0.4798228,0.055289973,0.0002015797],"about_ca_topic_score_codex":0.003351441,"about_ca_topic_score_gemma":0.002210042,"teacher_disagreement_score":0.01987534,"about_ca_system_score_codex":0.001296129,"about_ca_system_score_gemma":0.0021051744,"threshold_uncertainty_score":0.105112076},"labels":[],"label_agreement":null},{"id":"W4401391220","doi":"10.1007/s40273-024-01401-y","title":"Improving Transparency of Decision Models Through the Application of Decision Analytic Models with Omitted Objects Displayed (DAMWOOD)","year":2024,"lang":"en","type":"article","venue":"PharmacoEconomics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa; Institute of Health Economics; University of Alberta","funders":"Medical Research Council","keywords":"Transparency (behavior); Computer science; Decision model; Decision analysis; Management science; Scrutiny; Data science; Economics; Machine learning; Computer security; Mathematical economics; Political science","score_opus":0.09701390709738864,"score_gpt":0.40910001256669143,"score_spread":0.3120861054693028,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401391220","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033900545,0.00015510406,0.99428153,0.0009013076,0.000044467775,0.000041799074,0.000053954303,0.00020128026,0.00093046774],"genre_scores_gemma":[0.24144527,0.00041763944,0.7557316,0.00040557946,0.00011417866,0.00017148192,0.00012730762,0.00014022201,0.001446707],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9554515,0.035702985,0.0014279259,0.0020110682,0.004870734,0.0005358091],"domain_scores_gemma":[0.83462846,0.1422621,0.0054053343,0.012859816,0.003993913,0.0008503317],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.035512853,0.0010004572,0.0016697358,0.0016836389,0.00079642556,0.004123338,0.001856398,0.0014494667,0.004330223],"category_scores_gemma":[0.16197418,0.0009888159,0.0019851595,0.0014432556,0.002068785,0.0049785078,0.0052372785,0.0057925885,0.00050186506],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040953915,0.00027852526,0.0019246314,0.0003254002,0.00034170016,0.00014242239,0.000596568,0.123156175,0.0015523519,0.6893893,0.0035611168,0.17832236],"study_design_scores_gemma":[0.00006913956,0.000063408705,0.00025895197,0.000061826824,0.00007519615,0.000038394275,0.000028583187,0.42530888,0.0014452799,0.5701266,0.0024864478,0.000037285048],"about_ca_topic_score_codex":0.002930844,"about_ca_topic_score_gemma":0.00216454,"teacher_disagreement_score":0.96448714,"about_ca_system_score_codex":0.0021741614,"about_ca_system_score_gemma":0.0046267943,"threshold_uncertainty_score":0.18781215},"labels":[],"label_agreement":null},{"id":"W4401484096","doi":"10.1515/jci-2022-0079","title":"Estimation of network treatment effects with non-ignorable missing confounders","year":2024,"lang":"en","type":"article","venue":"Journal of Causal Inference","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Estimation; Missing data; Statistics; Econometrics; Computer science; Mathematics; Economics","score_opus":0.08442930811171528,"score_gpt":0.4148608621997699,"score_spread":0.33043155408805464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401484096","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02120729,0.0006402022,0.9763442,0.0004950788,0.000052660267,0.00015652514,0.00026230337,0.00010020532,0.0007414566],"genre_scores_gemma":[0.66604733,0.001467853,0.3276746,0.00043222943,0.00023069321,0.0011006073,0.0007261179,0.000057763966,0.0022628054],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98727393,0.01016143,0.00028940453,0.0013112886,0.0007050366,0.00025878995],"domain_scores_gemma":[0.91128826,0.079380125,0.004091589,0.0036739048,0.0012933889,0.0002727623],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.024881622,0.0008924111,0.0018034395,0.0019674196,0.0006918358,0.0012602103,0.0031512051,0.0017398463,0.0038766132],"category_scores_gemma":[0.0804982,0.0006229559,0.0016691047,0.002213898,0.0019016059,0.0026923493,0.0018892806,0.0025405032,0.00019437227],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006890371,0.00031838365,0.026003879,0.001029641,0.0016740753,0.0004226201,0.00048503082,0.46008134,0.0006962005,0.37238628,0.0019785461,0.1342349],"study_design_scores_gemma":[0.00017070475,0.00012403754,0.0033540593,0.00019285305,0.00036938113,0.00007613507,0.00010014363,0.74271905,0.00065572007,0.24987572,0.0023278696,0.000034368906],"about_ca_topic_score_codex":0.0048831855,"about_ca_topic_score_gemma":0.0035679787,"teacher_disagreement_score":0.9751184,"about_ca_system_score_codex":0.0015479014,"about_ca_system_score_gemma":0.0018046802,"threshold_uncertainty_score":0.13158816},"labels":[],"label_agreement":null},{"id":"W4401499316","doi":"10.1177/00236772231217777","title":"Causal mediation analysis: How to avoid fooling yourself that <i>X</i> causes <i>Y</i>","year":2024,"lang":"en","type":"article","venue":"Laboratory Animals","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Prioris.ai (Canada)","funders":"","keywords":"Mediation; Causal inference; Outcome (game theory); Mechanism (biology); Causal analysis; Causal model; Psychology; Intervention (counseling); Statistical analysis; Computer science; Cognitive psychology; Medicine; Econometrics; Risk analysis (engineering); Statistics; Epistemology; Mathematics; Psychiatry; Pathology","score_opus":0.10422228867727054,"score_gpt":0.3861531258761427,"score_spread":0.28193083719887213,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401499316","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022359008,0.003607331,0.95810425,0.028794548,0.0012090491,0.0011988985,0.0003834184,0.00076038064,0.0037062978],"genre_scores_gemma":[0.049220353,0.0037223145,0.9340486,0.0059824237,0.0007877867,0.004541875,0.00020025065,0.00021957938,0.0012769017],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8994367,0.08573084,0.0031593372,0.0042685075,0.006775717,0.00062887126],"domain_scores_gemma":[0.704865,0.25418258,0.0104892375,0.020178478,0.0090694195,0.0012153221],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14937332,0.0022310386,0.0029298977,0.0031453003,0.0022714238,0.0035655217,0.004964864,0.005119399,0.014246762],"category_scores_gemma":[0.34884283,0.0012495065,0.0034932985,0.00335459,0.011002274,0.010644036,0.0040343897,0.008861307,0.0027202284],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00070825196,0.0003842324,0.0032660954,0.0053827222,0.0024976325,0.0003489616,0.0035586373,0.0047865286,0.0024646823,0.48476857,0.049080353,0.44275326],"study_design_scores_gemma":[0.00049146346,0.00023899991,0.0013143793,0.001618276,0.00066339754,0.00023041526,0.0004940735,0.008287753,0.002199615,0.9446022,0.03971065,0.00014887824],"about_ca_topic_score_codex":0.0034321067,"about_ca_topic_score_gemma":0.0043618064,"teacher_disagreement_score":0.8506267,"about_ca_system_score_codex":0.00228781,"about_ca_system_score_gemma":0.0075178035,"threshold_uncertainty_score":0.7899711},"labels":[],"label_agreement":null},{"id":"W4401517718","doi":"10.1515/ijb-2023-0116","title":"History-restricted marginal structural model and latent class growth analysis of treatment trajectories for a time-dependent outcome","year":2024,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University; Institut National de Santé Publique du Québec; Université Laval","funders":"Canadian Institutes of Health Research; Université Laval","keywords":"Econometrics; Marginal structural model; Outcome (game theory); Class (philosophy); Latent class model; Structural equation modeling; Statistics; Marginal model; Mathematics; Computer science; Causal inference; Mathematical economics; Regression analysis; Artificial intelligence","score_opus":0.10769438102764733,"score_gpt":0.39364910278080345,"score_spread":0.2859547217531561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401517718","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035105538,0.00053970265,0.9595855,0.0012090547,0.00009411671,0.0002780017,0.0012017471,0.00037369746,0.0016125857],"genre_scores_gemma":[0.7009097,0.00084326,0.28667793,0.0004749473,0.00017833199,0.0015714578,0.0021628616,0.00020044287,0.0069812173],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9928739,0.0049858238,0.00016406401,0.0012320019,0.00044934358,0.00029488633],"domain_scores_gemma":[0.98364246,0.011865777,0.0014210945,0.0018345522,0.00093858596,0.00029766292],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013449376,0.0012473031,0.0015630495,0.0020901153,0.00055069244,0.0015387894,0.0027757883,0.001503691,0.0088538295],"category_scores_gemma":[0.032622352,0.0005592859,0.0033135593,0.0021096969,0.002136213,0.0022875378,0.0019151523,0.0028726659,0.0008941385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042238258,0.00023423844,0.043390114,0.0004468113,0.0010988533,0.000314743,0.0018353832,0.27449173,0.0009945061,0.514562,0.0047489773,0.15746024],"study_design_scores_gemma":[0.000049636456,0.00015419484,0.008232173,0.00010854551,0.00020143641,0.00009822471,0.00018965168,0.7193125,0.00034419156,0.26664674,0.004602352,0.00006031186],"about_ca_topic_score_codex":0.015010686,"about_ca_topic_score_gemma":0.01541155,"teacher_disagreement_score":0.015010686,"about_ca_system_score_codex":0.0027669985,"about_ca_system_score_gemma":0.0029218046,"threshold_uncertainty_score":0.07112795},"labels":[],"label_agreement":null},{"id":"W4401613484","doi":"10.1097/ccm.0000000000006371","title":"Toward Precision in Critical Care Research: Methods for Observational and Interventional Studies","year":2024,"lang":"en","type":"review","venue":"Critical Care Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto General Hospital; University of Toronto; University Health Network","funders":"U.S. National Library of Medicine; Canadian Institutes of Health Research; National Institutes of Health; National Center for Advancing Translational Sciences; National Sanitarium Association; National Heart, Lung, and Blood Institute; National Security Agency; U.S. Department of Defense","keywords":"Medicine; Observational study; Psychological intervention; Intensive care medicine; Randomized controlled trial; Clinical trial; Intervention (counseling); Acute respiratory distress; External validity; Population; Research design; Treatment effect; Nursing; Surgery; Internal medicine","score_opus":0.9246768419156625,"score_gpt":0.7668087164089641,"score_spread":0.15786812550669838,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401613484","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00095010444,0.159511,0.8195887,0.010826837,0.0022034484,0.0025171132,0.0011211355,0.00036906925,0.0029125507],"genre_scores_gemma":[0.058891147,0.10556006,0.8010321,0.008928456,0.0039688693,0.01937494,0.0010930625,0.00028093858,0.00087031507],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.5681809,0.3856236,0.018196348,0.010836515,0.016490696,0.00067196373],"domain_scores_gemma":[0.23815095,0.6944234,0.016772678,0.04205394,0.007958781,0.0006403357],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3895204,0.0031028457,0.010757087,0.008702001,0.0013246073,0.007901615,0.006265299,0.0058894125,0.0046788016],"category_scores_gemma":[0.58057135,0.0024854785,0.0074872607,0.008880563,0.010019911,0.008934496,0.0067072646,0.009540452,0.0012150477],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000668427,0.0002642291,0.008956185,0.06457652,0.01874404,0.00029082448,0.0019285583,0.014738376,0.0004943568,0.42081854,0.01431816,0.45420173],"study_design_scores_gemma":[0.00067676336,0.0004090028,0.003990517,0.022377921,0.004351048,0.0002518616,0.0003793895,0.013002725,0.00047291268,0.90725374,0.04664406,0.00018990434],"about_ca_topic_score_codex":0.0033788758,"about_ca_topic_score_gemma":0.0023146989,"teacher_disagreement_score":0.6104796,"about_ca_system_score_codex":0.0042092316,"about_ca_system_score_gemma":0.011070871,"threshold_uncertainty_score":0.75283},"labels":[],"label_agreement":null},{"id":"W4401642076","doi":"10.1097/mcc.0000000000001186","title":"Subgroup analyses and heterogeneity of treatment effects in randomized trials: a primer for the clinician","year":2024,"lang":"en","type":"review","venue":"Current Opinion in Critical Care","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Medicine; Randomized controlled trial; Subgroup analysis; MEDLINE; Intensive care medicine; Internal medicine; Meta-analysis","score_opus":0.8215538829094038,"score_gpt":0.6981431834382862,"score_spread":0.1234106994711176,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401642076","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00013958772,0.91173077,0.03163836,0.051051818,0.004372014,0.0002537863,0.00013548828,0.00012691307,0.00055118685],"genre_scores_gemma":[0.013301743,0.8470499,0.07299238,0.038879998,0.024076907,0.0025806313,0.0002247801,0.00026786837,0.00062577013],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79603106,0.16236587,0.021871258,0.005231323,0.01375001,0.00075054896],"domain_scores_gemma":[0.3683784,0.59817743,0.013800198,0.009109067,0.009639019,0.0008958629],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21386628,0.0026558393,0.014545527,0.007829053,0.0010564423,0.009745584,0.00740361,0.0095894,0.0045435335],"category_scores_gemma":[0.41732624,0.0017756401,0.01027474,0.006758052,0.00921896,0.013020551,0.0047742366,0.023528473,0.0013750729],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006006346,0.000056821267,0.0013814484,0.12656774,0.009836565,0.0003812888,0.0016188055,0.0024059296,0.00031440705,0.12713896,0.08622632,0.64347106],"study_design_scores_gemma":[0.0006810948,0.00023002546,0.0011087977,0.19798823,0.0066462457,0.0010054699,0.00078736217,0.0034897607,0.0005832809,0.5630747,0.22415084,0.00025426116],"about_ca_topic_score_codex":0.002118879,"about_ca_topic_score_gemma":0.002068096,"teacher_disagreement_score":0.7861337,"about_ca_system_score_codex":0.0052960035,"about_ca_system_score_gemma":0.013802237,"threshold_uncertainty_score":0.96944284},"labels":[],"label_agreement":null},{"id":"W4401798123","doi":"10.1038/s41562-024-01939-z","title":"Causal inference on human behaviour","year":2024,"lang":"en","type":"review","venue":"Nature Human Behaviour","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":44,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Advanced Research; Alberta Children's Hospital; University of Calgary","funders":"","keywords":"Causal inference; Inference; Causal model; Key (lock); Data science; Observational study; Causal structure; Statistical inference; Computer science; Randomized experiment; Causal reasoning; Psychology; Cognitive psychology; Management science; Epistemology; Artificial intelligence; Econometrics; Cognition; Mathematics","score_opus":0.32275330399114127,"score_gpt":0.5595938479781803,"score_spread":0.23684054398703908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401798123","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001287143,0.98718435,0.0062774266,0.0023413703,0.00037470338,0.000008724653,0.00005674796,0.000040509472,0.0035874213],"genre_scores_gemma":[0.0043241195,0.9895976,0.0026931327,0.00073668285,0.0014265841,0.000020612935,0.0000877132,0.00001367154,0.0010998101],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9991955,0.00038288021,0.00005587675,0.00012734388,0.0002070606,0.000031377454],"domain_scores_gemma":[0.9932963,0.005699762,0.00022533473,0.00025907738,0.00045158263,0.000067929555],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002465505,0.0012599876,0.001734298,0.0027179413,0.00037440425,0.0016033448,0.0013156703,0.002391616,0.006643422],"category_scores_gemma":[0.009511194,0.0006873597,0.0006963541,0.0033196073,0.003231179,0.0032637196,0.0011514127,0.0039727795,0.0020543886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006032388,0.00006339192,0.00027317082,0.014629371,0.00026307863,0.00007562219,0.00011128015,0.0037420592,0.00021569485,0.17288046,0.045074143,0.7626113],"study_design_scores_gemma":[0.00004330536,0.00004213808,0.0011465393,0.008294834,0.00024325246,0.0003305559,0.00007256316,0.002111018,0.00032700872,0.47951317,0.50782204,0.000053578606],"about_ca_topic_score_codex":0.0046616234,"about_ca_topic_score_gemma":0.0040580593,"teacher_disagreement_score":0.006643422,"about_ca_system_score_codex":0.0016904532,"about_ca_system_score_gemma":0.0032864285,"threshold_uncertainty_score":0.022224426},"labels":[],"label_agreement":null},{"id":"W4401807474","doi":"10.1007/s40471-024-00353-3","title":"The Target Cohort Approach: An Extension of the Target Trial Framework to Nested Case-Control Studies with Incidence Density Sampling","year":2024,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Public Health Ontario; University of Toronto","funders":"","keywords":"Nested case-control study; Statistics; Extension (predicate logic); Incidence (geometry); Sampling (signal processing); Econometrics; Cohort; Mathematics; Computer science; Medicine","score_opus":0.34456670489819724,"score_gpt":0.5020242451527828,"score_spread":0.15745754025458553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401807474","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016752355,0.0004932001,0.9961578,0.00047200525,0.000119926925,0.00030542104,0.0001573793,0.000099111065,0.0005199072],"genre_scores_gemma":[0.16485378,0.0036038607,0.81848156,0.0014545217,0.0008708465,0.0047025825,0.0007707095,0.0003130057,0.0049490626],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95444894,0.038986545,0.0011274854,0.0025851508,0.0023960606,0.00045578036],"domain_scores_gemma":[0.9223653,0.06412677,0.0027398753,0.007061819,0.0027273097,0.0009789126],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07671642,0.0014565318,0.0043941154,0.0025976757,0.0007837143,0.0025740454,0.005332254,0.002260473,0.00609731],"category_scores_gemma":[0.13213104,0.0016146433,0.005000481,0.0027835392,0.0017778524,0.0033367404,0.0039814343,0.0050104456,0.00082926796],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017269123,0.0004211821,0.014599024,0.0019740718,0.0047657075,0.0013304453,0.001407828,0.074440226,0.0011659149,0.68869305,0.008897555,0.20057818],"study_design_scores_gemma":[0.0012201288,0.00087202084,0.00223362,0.00037530376,0.0019107991,0.0011833285,0.00013243205,0.46759024,0.00043860887,0.50973725,0.014206704,0.00009954485],"about_ca_topic_score_codex":0.004070219,"about_ca_topic_score_gemma":0.0033689141,"teacher_disagreement_score":0.9232836,"about_ca_system_score_codex":0.00077995745,"about_ca_system_score_gemma":0.0046866224,"threshold_uncertainty_score":0.40572006},"labels":[],"label_agreement":null},{"id":"W4401832609","doi":"10.1016/j.jpain.2024.104558","title":"Response Letter to Pamela E Macintyre’s Letter to the Editor","year":2024,"lang":"en","type":"letter","venue":"Journal of Pain","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Seqirus; Prince of Wales Hospital Foundation; Avant Foundation; Alberta Innovates","keywords":"Psychology; Letter to the editor; Psychoanalysis; Philosophy; Political science; Law","score_opus":0.07034623115932609,"score_gpt":0.3776135619668007,"score_spread":0.3072673308074746,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401832609","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00010826894,0.00062736537,0.00006889111,0.9648283,0.031879455,0.00001053227,0.00004457167,0.000020637612,0.0024120624],"genre_scores_gemma":[0.002289801,0.0007290841,0.00013845113,0.94519365,0.03622353,0.000040211005,0.000017163698,0.000033349574,0.015334641],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99758554,0.00059684063,0.00025095156,0.0003886439,0.00073246873,0.00044557778],"domain_scores_gemma":[0.9896438,0.006149938,0.00055509823,0.00023923136,0.002128475,0.0012834824],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031378681,0.00083304336,0.0018568812,0.0009654569,0.0041638035,0.0046430817,0.0017396996,0.040237527,0.020419462],"category_scores_gemma":[0.03919562,0.00082080136,0.0011961494,0.0006281542,0.0025044875,0.0030895846,0.0016375266,0.03962122,0.010953351],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025804373,0.0000078010235,0.00009884708,0.000022926866,0.0000061937403,0.00053153455,0.0000650979,0.000018197368,0.000029521898,0.0013863766,0.9959282,0.0018794902],"study_design_scores_gemma":[0.00007761986,0.000030321848,0.00059540005,0.00028711118,0.000020780502,0.001529574,0.0005055707,0.0002724928,0.00012650802,0.008166072,0.98833525,0.000053291053],"about_ca_topic_score_codex":0.00635486,"about_ca_topic_score_gemma":0.008214792,"teacher_disagreement_score":0.040237527,"about_ca_system_score_codex":0.0038766577,"about_ca_system_score_gemma":0.004983648,"threshold_uncertainty_score":0.06830984},"labels":[],"label_agreement":null},{"id":"W4401850710","doi":"10.1177/17407745241268054","title":"Estimands in clinical trials of complex disease processes","year":2024,"lang":"en","type":"article","venue":"Clinical Trials","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; University of Waterloo","keywords":"Context (archaeology); Causal inference; Meaning (existential); Disease; Clinical trial; Intensive care medicine; Medicine; Computer science; Psychology; Psychotherapist","score_opus":0.9162224055802772,"score_gpt":0.7317444564015385,"score_spread":0.18447794917873872,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401850710","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004602931,0.0049563656,0.97730196,0.00851801,0.0002679126,0.00037092686,0.0002038098,0.00017085653,0.003607191],"genre_scores_gemma":[0.30505103,0.0075619686,0.6736206,0.0037951947,0.0011772582,0.0040914426,0.0005006321,0.00016103193,0.0040408983],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8239501,0.15910932,0.0047856453,0.004807229,0.0064097545,0.0009380411],"domain_scores_gemma":[0.39611146,0.5775226,0.012129552,0.010529551,0.0029790208,0.00072783016],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19520035,0.001970794,0.0037532537,0.003605348,0.0010607899,0.005521996,0.0046078833,0.004667475,0.005481692],"category_scores_gemma":[0.45347613,0.0016557052,0.0032783537,0.003811319,0.010338432,0.011338005,0.0049808114,0.010732966,0.00067726494],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009659662,0.000029499071,0.0012018232,0.00063428195,0.00033872967,0.00014795929,0.0003528786,0.021742973,0.00005835316,0.94983023,0.0011978623,0.02436877],"study_design_scores_gemma":[0.00006611578,0.00005096681,0.00018290163,0.00022800016,0.000062839346,0.000037855454,0.000034229637,0.036587812,0.000099890516,0.9609788,0.0016562643,0.000014317521],"about_ca_topic_score_codex":0.002226049,"about_ca_topic_score_gemma":0.0017581291,"teacher_disagreement_score":0.8047997,"about_ca_system_score_codex":0.0046350826,"about_ca_system_score_gemma":0.0042259092,"threshold_uncertainty_score":0.99246126},"labels":[],"label_agreement":null},{"id":"W4402042387","doi":"10.1073/pnas.2402736121","title":"On the role of parameterization in models with a misspecified nuisance component","year":2024,"lang":"en","type":"article","venue":"Proceedings of the National Academy of Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Engineering and Physical Sciences Research Council; Natural Sciences and Engineering Research Council of Canada; UK Research and Innovation","keywords":"Orthogonality; Nuisance parameter; Consistency (knowledge bases); Estimator; Unification; Mathematics; Component (thermodynamics); Inference; Applied mathematics; Interpretation (philosophy); Econometrics; Computer science; Statistics; Discrete mathematics; Artificial intelligence; Physics","score_opus":0.17862417495625385,"score_gpt":0.3845647740426162,"score_spread":0.20594059908636234,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402042387","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02577756,0.0005023272,0.9662466,0.0027874778,0.000037634774,0.000037709495,0.000052879528,0.00006954748,0.0044882363],"genre_scores_gemma":[0.7494707,0.0014434147,0.24524742,0.0008999529,0.0003606553,0.00018908182,0.000127895,0.00016691124,0.0020939114],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97708195,0.017672,0.0005728527,0.0019922396,0.001884473,0.00079654285],"domain_scores_gemma":[0.72608274,0.24518636,0.010424332,0.015088405,0.0022001695,0.0010180085],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.053961135,0.0009857937,0.0020264497,0.0021456473,0.001676098,0.0033842304,0.003260439,0.002855783,0.0027818058],"category_scores_gemma":[0.17118746,0.0009527448,0.0020162766,0.002903793,0.0157746,0.013209284,0.007048624,0.0064603332,0.00022907014],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026547274,0.00001726815,0.0012578911,0.00003284265,0.000030858908,0.000093167706,0.00024976378,0.012953801,0.00017309214,0.9786379,0.00012463245,0.0064022844],"study_design_scores_gemma":[0.000007450603,0.000024502358,0.00029533665,0.000024842804,0.0000187943,0.00005986942,0.000087856264,0.05144059,0.000202158,0.94727695,0.0005438697,0.000017808243],"about_ca_topic_score_codex":0.0026284668,"about_ca_topic_score_gemma":0.001728476,"teacher_disagreement_score":0.053961135,"about_ca_system_score_codex":0.0018889093,"about_ca_system_score_gemma":0.0026396622,"threshold_uncertainty_score":0.2853772},"labels":[],"label_agreement":null},{"id":"W4402194648","doi":"10.1111/1475-6773.14376","title":"Addressing immortal time bias in precision medicine: Practical guidance and methods development","year":2024,"lang":"en","type":"article","venue":"Health Services Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia; Simon Fraser University","funders":"Terry Fox Research Institute; Genome British Columbia; Genome Canada","keywords":"Precision medicine; Pooling; Imputation (statistics); Missing data; Computer science; Data mining; Matching (statistics); Statistics; Sample size determination; Population; Personalized medicine; Selection bias; Econometrics; Machine learning; Medicine; Artificial intelligence; Mathematics; Bioinformatics","score_opus":0.6727635142755471,"score_gpt":0.6964341676211453,"score_spread":0.023670653345598147,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402194648","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006428112,0.0018507603,0.9874466,0.007213889,0.0003053118,0.0008143218,0.00015571616,0.00030872316,0.0012618015],"genre_scores_gemma":[0.017060025,0.0020156428,0.97246605,0.0026859068,0.0006036471,0.004448914,0.00018168679,0.00013267034,0.00040556025],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7178586,0.25272027,0.00963898,0.005607973,0.013375793,0.00079837284],"domain_scores_gemma":[0.48351192,0.44408968,0.015652671,0.02827374,0.027392369,0.0010796393],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.24226053,0.0030923956,0.0035768936,0.0047451933,0.0018520718,0.0053046066,0.00662145,0.007120832,0.0080374405],"category_scores_gemma":[0.5275839,0.0017694302,0.0041872016,0.0051977197,0.00591729,0.0077712215,0.0069194697,0.010311652,0.0020105527],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000594026,0.0003558465,0.007652446,0.005391758,0.0011215226,0.00043777886,0.0024835258,0.037836794,0.00095750456,0.34582382,0.04171767,0.55562735],"study_design_scores_gemma":[0.0008534256,0.00083467306,0.0034100956,0.0077254255,0.000652954,0.000724017,0.0006787792,0.12560172,0.003775634,0.7423996,0.112916276,0.00042747403],"about_ca_topic_score_codex":0.003582603,"about_ca_topic_score_gemma":0.003847294,"teacher_disagreement_score":0.24226053,"about_ca_system_score_codex":0.0033736324,"about_ca_system_score_gemma":0.0128069,"threshold_uncertainty_score":0.9344277},"labels":[],"label_agreement":null},{"id":"W4402323319","doi":"10.1002/pst.2436","title":"Propensity Score Analysis With Baseline and Follow‐Up Measurements of the Outcome Variable","year":2024,"lang":"en","type":"article","venue":"Pharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Baseline (sea); Statistics; Weighting; Estimator; Observational study; Variable (mathematics); Matching (statistics); Regression analysis; Mathematics; Medicine","score_opus":0.4838276404501285,"score_gpt":0.4782297378790365,"score_spread":0.005597902571091995,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402323319","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048025697,0.00043194016,0.9879552,0.0004304772,0.00020194145,0.002759252,0.0011179319,0.0005238212,0.0017768858],"genre_scores_gemma":[0.13694899,0.0011510988,0.8441992,0.00067457225,0.00026425524,0.010343807,0.0026320922,0.00041309895,0.0033729451],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9028565,0.07859636,0.005808572,0.0053934776,0.0064862953,0.00085876643],"domain_scores_gemma":[0.805305,0.13531613,0.014992374,0.034759697,0.008900907,0.00072582054],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12366636,0.0019206573,0.0026601662,0.0046359017,0.0012276962,0.0036697236,0.0036574963,0.002388369,0.01785894],"category_scores_gemma":[0.3298706,0.0012157116,0.0066776173,0.008079628,0.0018703687,0.0046186917,0.0035801274,0.0044209673,0.002470668],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023777455,0.0007736342,0.068119355,0.0033279513,0.012097734,0.00047314225,0.0014471306,0.08870691,0.0011737597,0.3253165,0.03856699,0.45761913],"study_design_scores_gemma":[0.0018497276,0.0018269663,0.027400242,0.0017030318,0.004345447,0.0006276006,0.00040074336,0.29351678,0.0039568255,0.5642409,0.09975441,0.00037724996],"about_ca_topic_score_codex":0.0061101224,"about_ca_topic_score_gemma":0.004463773,"teacher_disagreement_score":0.12366636,"about_ca_system_score_codex":0.0018615827,"about_ca_system_score_gemma":0.006587247,"threshold_uncertainty_score":0.65401804},"labels":[],"label_agreement":null},{"id":"W4402329644","doi":"10.1016/j.neuchi.2024.101589","title":"Understanding why restrictive trial eligibility criteria are inappropriate","year":2024,"lang":"en","type":"review","venue":"Neurochirurgie","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta Hospital; Health Sciences Centre; Centre Hospitalier de l’Université de Montréal","funders":"","keywords":"Medicine; MEDLINE; Intensive care medicine; Political science","score_opus":0.6175615042305665,"score_gpt":0.5330371539830381,"score_spread":0.08452435024752847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402329644","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033465188,0.51607436,0.11957822,0.33072084,0.012815086,0.00279218,0.0009010535,0.00031359348,0.013458205],"genre_scores_gemma":[0.16132525,0.22982585,0.22286133,0.3459064,0.013173347,0.023181727,0.0011245459,0.00054373936,0.0020578029],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.45673317,0.4453794,0.05690864,0.009512522,0.029180748,0.0022855839],"domain_scores_gemma":[0.17984049,0.77539086,0.01984854,0.010217419,0.013618944,0.0010837361],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.43845314,0.0017469573,0.0064382516,0.005521234,0.0016691118,0.00904016,0.0076959897,0.014976453,0.0050884336],"category_scores_gemma":[0.6532797,0.0019750888,0.0044987835,0.004978255,0.01554896,0.016557788,0.004873176,0.015432308,0.0018160804],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015828013,0.00008802217,0.001845089,0.08317192,0.0026026377,0.0005415026,0.006037704,0.0024615033,0.0006444125,0.48754254,0.0810316,0.33245024],"study_design_scores_gemma":[0.0014321902,0.00021390193,0.0019170762,0.11840584,0.0015670038,0.0007448956,0.0012472816,0.002931576,0.0006493025,0.69338715,0.17729737,0.00020640786],"about_ca_topic_score_codex":0.0020275735,"about_ca_topic_score_gemma":0.0018857185,"teacher_disagreement_score":0.56154686,"about_ca_system_score_codex":0.00750027,"about_ca_system_score_gemma":0.014545849,"threshold_uncertainty_score":0.69248724},"labels":[],"label_agreement":null},{"id":"W4402576198","doi":"10.1371/journal.pmed.1004455","title":"Behavioral risk factors and socioeconomic inequalities in ischemic heart disease mortality in the United States: A causal mediation analysis using record linkage data","year":2024,"lang":"en","type":"article","venue":"PLoS Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Centre for Addiction and Mental Health","funders":"National Institute on Alcohol Abuse and Alcoholism; Centers for Disease Control and Prevention; National Institutes of Health","keywords":"Socioeconomic status; Medicine; Demography; Marital status; National Death Index; Cohort study; Mediation; Proportional hazards model; Gerontology; Cohort; Hazard ratio; Population; Environmental health; Confidence interval; Internal medicine","score_opus":0.3274916916027929,"score_gpt":0.4624875178117706,"score_spread":0.1349958262089777,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402576198","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8898078,0.012053969,0.07046985,0.0064455518,0.00040284698,0.0018165488,0.015139481,0.0005940027,0.0032699655],"genre_scores_gemma":[0.9803648,0.0011753509,0.013620994,0.00040415887,0.00007912846,0.0014583797,0.0025009157,0.000041683852,0.0003546324],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9198465,0.0681153,0.0028232639,0.0050259805,0.0024532313,0.0017357542],"domain_scores_gemma":[0.869286,0.109649405,0.00921997,0.008636528,0.002440572,0.0007674516],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07408265,0.0014137371,0.0016802778,0.0035762493,0.0013158934,0.0022666426,0.0033577066,0.001408091,0.0050003314],"category_scores_gemma":[0.12689655,0.0010006217,0.0075398474,0.0061076647,0.0009532961,0.0023347072,0.004945779,0.0026228302,0.00033485526],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014023158,0.00038361357,0.9462507,0.00091035175,0.02330924,0.00039987543,0.00089953135,0.003560869,0.00009717732,0.0026634536,0.0024079033,0.017715044],"study_design_scores_gemma":[0.0028377988,0.0024551023,0.6809767,0.0023007817,0.09212546,0.0019489552,0.0037999614,0.16677138,0.0010442965,0.032884248,0.012454675,0.00040058114],"about_ca_topic_score_codex":0.015895871,"about_ca_topic_score_gemma":0.009654608,"teacher_disagreement_score":0.07408265,"about_ca_system_score_codex":0.00093518576,"about_ca_system_score_gemma":0.003465368,"threshold_uncertainty_score":0.39179116},"labels":[],"label_agreement":null},{"id":"W4402581782","doi":"10.1038/s41592-024-02405-4","title":"Propensity score matching","year":2024,"lang":"en","type":"article","venue":"Nature Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":32,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre","funders":"","keywords":"Propensity score matching; Matching (statistics); Computational biology; Computer science; Biology; Medicine; Internal medicine; Mathematics; Statistics","score_opus":0.2954066621601936,"score_gpt":0.548128130712416,"score_spread":0.25272146855222233,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402581782","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0066612856,0.0004483355,0.9701607,0.0014854438,0.00038734576,0.0006687529,0.0020133744,0.0007455598,0.017429117],"genre_scores_gemma":[0.39584213,0.0013489045,0.4992314,0.002851591,0.0012992264,0.0031221036,0.006657992,0.0005582033,0.08908846],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9915105,0.0050169826,0.00036686182,0.0015319586,0.0011107195,0.00046304349],"domain_scores_gemma":[0.990699,0.0037510137,0.0007521075,0.003745884,0.0007905804,0.00026142094],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008826026,0.00074811745,0.0017805175,0.0024509518,0.00107023,0.0024959464,0.0022473072,0.0022927227,0.053775776],"category_scores_gemma":[0.039012596,0.0006405245,0.0020811667,0.0033378731,0.0009312441,0.0021489575,0.0023543492,0.0022184711,0.013193494],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042120673,0.00033129196,0.0074230367,0.00027059717,0.000515999,0.00018559814,0.00010716343,0.011683773,0.00057962065,0.6331713,0.049399927,0.29591054],"study_design_scores_gemma":[0.0004173809,0.00018618691,0.002856887,0.00012381638,0.0003019764,0.0005977154,0.00006227589,0.09480957,0.0010438339,0.8449764,0.05458094,0.000043010437],"about_ca_topic_score_codex":0.001560618,"about_ca_topic_score_gemma":0.0016403705,"teacher_disagreement_score":0.053775776,"about_ca_system_score_codex":0.0007731226,"about_ca_system_score_gemma":0.00343189,"threshold_uncertainty_score":0.1798979},"labels":[],"label_agreement":null},{"id":"W4402615312","doi":"10.1016/j.jclinepi.2024.111532","title":"Using causal diagrams within the Grading of Recommendations, Assessment, Development and Evaluation framework to evaluate confounding adjustment in observational studies","year":2024,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Confounding; Observational study; Causal inference; Causal model; Medicine; Marginal structural model; Internal medicine; Pathology","score_opus":0.8879150233324599,"score_gpt":0.7146830698223894,"score_spread":0.17323195351007048,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402615312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041329837,0.03201447,0.8695206,0.027871963,0.0056587276,0.03269317,0.004544655,0.004214556,0.019348918],"genre_scores_gemma":[0.019376362,0.0070797354,0.95581955,0.0015091765,0.00044714886,0.013853273,0.0010470462,0.00024622955,0.00062157365],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.4516059,0.40837032,0.09017146,0.0070881755,0.040402398,0.0023618126],"domain_scores_gemma":[0.23204835,0.5524455,0.06105477,0.031459115,0.118594155,0.0043980945],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47499225,0.0039986675,0.005452961,0.044023477,0.004681005,0.016743887,0.009301357,0.006774594,0.0105714565],"category_scores_gemma":[0.7232607,0.0031863432,0.014156791,0.019171825,0.009966199,0.01210343,0.012856362,0.011653818,0.0028868879],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011093076,0.00025311092,0.0040374305,0.09918625,0.0040688096,0.00032358256,0.0076172487,0.011449505,0.0009866391,0.17754981,0.10264559,0.5907727],"study_design_scores_gemma":[0.002302543,0.0009905424,0.0053741215,0.1225648,0.007721194,0.000818356,0.0028881654,0.03258286,0.0033498467,0.47241452,0.34798226,0.0010108056],"about_ca_topic_score_codex":0.012243431,"about_ca_topic_score_gemma":0.016240882,"teacher_disagreement_score":0.5250077,"about_ca_system_score_codex":0.017232163,"about_ca_system_score_gemma":0.042906553,"threshold_uncertainty_score":0.64742804},"labels":[{"model":"gemma","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"agree"},{"id":"W4402652454","doi":"10.1002/cjs.11832","title":"Robust causal inference for point exposures with missing confounders","year":2024,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Diabetes and Digestive and Kidney Diseases; National Institutes of Health","keywords":"Missing data; Causal inference; Estimator; Confounding; Robustness (evolution); Computer science; Inference; Econometrics; Observational study; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.18440192511003298,"score_gpt":0.373473420600046,"score_spread":0.18907149549001304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402652454","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021083225,0.0006475438,0.9962831,0.00032963973,0.000040583498,0.00005300163,0.0001311729,0.0000882678,0.000318448],"genre_scores_gemma":[0.22219118,0.003071859,0.7702493,0.0007362463,0.00054982933,0.0008634003,0.0009347387,0.00012185234,0.0012816618],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98002064,0.015347464,0.00078195054,0.001773631,0.0017655878,0.00031071765],"domain_scores_gemma":[0.8435418,0.13413341,0.00729458,0.012028347,0.0025257978,0.00047604073],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051248234,0.0009828621,0.0020581372,0.0028843542,0.0007299366,0.002195608,0.0038797078,0.0020507348,0.0031101997],"category_scores_gemma":[0.19840272,0.00087411405,0.0028453819,0.0029770036,0.0025463703,0.0029152427,0.0031929247,0.0039148293,0.0004318692],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022755866,0.000103132326,0.008975225,0.0012563658,0.0015838753,0.00037057383,0.00049488456,0.15357594,0.0010745169,0.6613727,0.0035706696,0.16739456],"study_design_scores_gemma":[0.00009636637,0.00009928674,0.0015737877,0.00023529843,0.00026505822,0.00015885568,0.00006734537,0.25499153,0.00072949426,0.7365423,0.005207453,0.0000333195],"about_ca_topic_score_codex":0.0031316634,"about_ca_topic_score_gemma":0.0027584396,"teacher_disagreement_score":0.051248234,"about_ca_system_score_codex":0.0012899664,"about_ca_system_score_gemma":0.0033039371,"threshold_uncertainty_score":0.27102983},"labels":[],"label_agreement":null},{"id":"W4402979128","doi":"10.1371/journal.pone.0296951","title":"AteMeVs: An R package for the estimation of the average treatment effect with measurement error and variable selection for confounders","year":2024,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; National Science and Technology Council","keywords":"Spurious relationship; Computer science; Inference; R package; Weighting; Confounding; Data mining; Estimation; Statistics; Standard error; Causal inference; Software; Variable (mathematics); Machine learning; Mathematics; Artificial intelligence; Medicine; Engineering","score_opus":0.23819350771080977,"score_gpt":0.37140491475370685,"score_spread":0.13321140704289708,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402979128","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018836126,0.00092603086,0.9301916,0.0007219341,0.0003460112,0.00043308357,0.033415638,0.03034105,0.0017411051],"genre_scores_gemma":[0.03134687,0.0011630405,0.89822406,0.0012524303,0.00038296045,0.005618289,0.02680397,0.029517138,0.005691198],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9896297,0.0071286834,0.0006442458,0.001218448,0.0011307998,0.0002481781],"domain_scores_gemma":[0.9261464,0.0647542,0.0024365068,0.0045866654,0.0016873938,0.000388767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01633324,0.0025855592,0.0029462369,0.0030410832,0.00059488916,0.0019274618,0.0040209084,0.0016206809,0.051958025],"category_scores_gemma":[0.092485905,0.001733042,0.0051688617,0.0029745703,0.0011056989,0.0018486705,0.0025717046,0.0045509655,0.013773021],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011248436,0.00021090136,0.021319354,0.007069885,0.009999998,0.0011160442,0.0008438082,0.033807077,0.003972889,0.06550346,0.47551572,0.37951598],"study_design_scores_gemma":[0.0012826711,0.00052992906,0.020450542,0.0011804581,0.003164203,0.0017870306,0.0001709571,0.14934516,0.0070786458,0.22683078,0.5877705,0.00040911487],"about_ca_topic_score_codex":0.003292524,"about_ca_topic_score_gemma":0.004849,"teacher_disagreement_score":0.051958025,"about_ca_system_score_codex":0.0006133561,"about_ca_system_score_gemma":0.004055464,"threshold_uncertainty_score":0.17381692},"labels":[],"label_agreement":null},{"id":"W4403017633","doi":"10.2196/58085","title":"Addressing Information Biases Within Electronic Health Record Data to Improve the Examination of Epidemiologic Associations With Diabetes Prevalence Among Young Adults: Cross-Sectional Study","year":2024,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Behavioral Risk Factor Surveillance System; Medicine; Environmental health; Public health; National Health and Nutrition Examination Survey; Odds ratio; Population; Missing data; Public health surveillance; Causal inference; Information bias; Health equity; Odds; Ethnic group; Gerontology; Demography; Logistic regression; Statistics; Selection bias","score_opus":0.17580675024240525,"score_gpt":0.45769225470288116,"score_spread":0.2818855044604759,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403017633","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9321767,0.0041632024,0.05479944,0.0017361051,0.0003063557,0.0014272315,0.0030874512,0.00009816662,0.0022052564],"genre_scores_gemma":[0.9743823,0.00062685023,0.021119412,0.0012069109,0.00014055302,0.0011050903,0.0010957688,0.00003470167,0.0002884676],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9189538,0.06003696,0.007239146,0.004002155,0.008172151,0.0015958166],"domain_scores_gemma":[0.82942945,0.09345277,0.036066204,0.022106523,0.01745979,0.0014852621],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10975261,0.0007115408,0.00076974253,0.001917647,0.0008979283,0.0017618731,0.0015012181,0.001442618,0.0013598436],"category_scores_gemma":[0.18288615,0.0008902157,0.0026592745,0.0028826157,0.0007688115,0.0022749568,0.0021910623,0.0017828973,0.00026933223],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011031916,0.00016668854,0.98951083,0.00013837744,0.0011644561,0.000039194303,0.0005585749,0.00028996568,0.00011261653,0.00046886806,0.0006038604,0.006836302],"study_design_scores_gemma":[0.00015465435,0.00097503513,0.9780206,0.0007053664,0.002556448,0.00043426038,0.0010206497,0.0075373664,0.0012547647,0.001449445,0.0058248974,0.00006651188],"about_ca_topic_score_codex":0.009794021,"about_ca_topic_score_gemma":0.011137516,"teacher_disagreement_score":0.10975261,"about_ca_system_score_codex":0.0010577262,"about_ca_system_score_gemma":0.0030113454,"threshold_uncertainty_score":0.5804342},"labels":[],"label_agreement":null},{"id":"W4403177596","doi":"10.7326/m23-2907","title":"School Mask Mandates and COVID-19: The Challenge of Using Difference-in-Differences Analysis of Observational Data to Estimate the Effectiveness of a Public Health Intervention","year":2024,"lang":"en","type":"article","venue":"Annals of Internal Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Klinisk Institut, Syddansk Universitet; Rotman School of Management, University of Toronto; Sloan School of Management, Massachusetts Institute of Technology; University of Toronto Scarborough; Syddansk Universitet; St. George's, University of London; University of California, San Francisco; University of Toronto; Massachusetts Institute of Technology","keywords":"Medicine; Observational study; Coronavirus disease 2019 (COVID-19); Public health; 2019-20 coronavirus outbreak; Intervention (counseling); Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); MEDLINE; Family medicine; Nursing; Virology; Internal medicine; Disease","score_opus":0.5969371067729305,"score_gpt":0.578315589099546,"score_spread":0.018621517673384602,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403177596","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13700253,0.02258492,0.73397565,0.06582101,0.006832638,0.005144731,0.0076771053,0.00059893995,0.020362385],"genre_scores_gemma":[0.73467594,0.0031587016,0.23705141,0.014115891,0.0018892785,0.006442627,0.0014851046,0.00029150862,0.0008895544],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.38287622,0.54226726,0.027362898,0.014724727,0.03112632,0.0016425538],"domain_scores_gemma":[0.1414869,0.76481396,0.043446247,0.03719706,0.011630209,0.0014255495],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.46231318,0.001266164,0.003443146,0.004236312,0.0021558828,0.005883503,0.006689574,0.0032339767,0.0024502513],"category_scores_gemma":[0.67927384,0.0016039213,0.0051126396,0.006438691,0.010379455,0.0053522955,0.0073204148,0.010860987,0.0004684109],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026136017,0.0007851146,0.5006679,0.010665676,0.017959263,0.00047618017,0.0072828163,0.019401027,0.0006667516,0.14896703,0.022717796,0.26779693],"study_design_scores_gemma":[0.0013696252,0.0053931787,0.30354217,0.014001441,0.005613292,0.0011539842,0.0070947595,0.104064666,0.0051567103,0.4580167,0.09357378,0.0010196883],"about_ca_topic_score_codex":0.014547708,"about_ca_topic_score_gemma":0.010276688,"teacher_disagreement_score":0.5376868,"about_ca_system_score_codex":0.006303364,"about_ca_system_score_gemma":0.008098114,"threshold_uncertainty_score":0.66306365},"labels":[],"label_agreement":null},{"id":"W4403257741","doi":"10.1177/09622802241275401","title":"Comparison of random forest methods for conditional average treatment effect estimation with a continuous treatment","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Random forest; Proxy (statistics); Estimation; Average treatment effect; Statistics; Confounding; Computer science; Treatment effect; Random effects model; Econometrics; Mathematics; Machine learning; Medicine; Propensity score matching; Meta-analysis","score_opus":0.3691927658630903,"score_gpt":0.707653083796802,"score_spread":0.33846031793371173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403257741","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021590484,0.0032834818,0.9727821,0.0005011066,0.00011858433,0.00028133832,0.00017372104,0.000498856,0.0007703801],"genre_scores_gemma":[0.18332489,0.0023709186,0.8110747,0.00028692328,0.00018912637,0.0010541044,0.0005804899,0.0002927405,0.0008260818],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9496184,0.04596017,0.0008812325,0.0013786156,0.0017047261,0.00045681914],"domain_scores_gemma":[0.6814566,0.30369604,0.003465628,0.0055506793,0.004797948,0.0010331043],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09213449,0.0014703899,0.002583922,0.0027703783,0.00074792566,0.0013751194,0.0030143776,0.002192585,0.0025912703],"category_scores_gemma":[0.15733905,0.0007802879,0.0026839157,0.0028610537,0.0011169922,0.0036682088,0.0019524381,0.0028758065,0.0004986193],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027597104,0.00038992963,0.012925244,0.0009999786,0.0031160638,0.00015395571,0.00072946463,0.52293706,0.0004718695,0.055850845,0.0036424794,0.39602333],"study_design_scores_gemma":[0.0003585028,0.00033070397,0.0024571323,0.00023046098,0.00027519744,0.00009848664,0.000107803506,0.95527947,0.00034836537,0.03898873,0.0014536177,0.000071567105],"about_ca_topic_score_codex":0.009396535,"about_ca_topic_score_gemma":0.010063118,"teacher_disagreement_score":0.09213449,"about_ca_system_score_codex":0.0013654382,"about_ca_system_score_gemma":0.0032171858,"threshold_uncertainty_score":0.48725957},"labels":[],"label_agreement":null},{"id":"W4403274525","doi":"10.1093/infdis/jiae493","title":"SMART Designs: Bridging the Gap Between Clinical Trials and Practice in Infectious Diseases","year":2024,"lang":"en","type":"article","venue":"The Journal of Infectious Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Bridging (networking); Psychological intervention; Randomized controlled trial; Flexibility (engineering); Clinical trial; Personalized medicine; Medicine; Clinical Practice; Computer science; Intensive care medicine; Bioinformatics; Family medicine; Nursing; Biology","score_opus":0.31563343946283245,"score_gpt":0.5225529930281148,"score_spread":0.2069195535652823,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403274525","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0049885972,0.023736859,0.9318133,0.028802142,0.0022944352,0.002553062,0.00037839916,0.0006591162,0.004774176],"genre_scores_gemma":[0.11951711,0.01143246,0.8421882,0.012100988,0.0029787298,0.010323251,0.00030222666,0.00027286785,0.00088424707],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.41960353,0.5465823,0.011102159,0.008832901,0.0129786655,0.0009003937],"domain_scores_gemma":[0.16431284,0.79337555,0.013247784,0.022021977,0.0053739944,0.0016678447],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.43573463,0.0026059204,0.0065032067,0.00473104,0.0017285593,0.008445723,0.004588004,0.0078072813,0.008947168],"category_scores_gemma":[0.64719784,0.0029557084,0.0038601551,0.004852715,0.01570556,0.012742501,0.011508193,0.011380567,0.0014342463],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026731354,0.00029589658,0.0043319664,0.009639481,0.0033038799,0.00025381893,0.0020103033,0.024289412,0.0005188704,0.6486791,0.010813327,0.29319096],"study_design_scores_gemma":[0.0016164654,0.000841072,0.0007428305,0.0027080681,0.0004940561,0.00012682761,0.00015591586,0.030353189,0.00026893715,0.9444591,0.018133719,0.0000998983],"about_ca_topic_score_codex":0.001370007,"about_ca_topic_score_gemma":0.001576561,"teacher_disagreement_score":0.43573463,"about_ca_system_score_codex":0.004729776,"about_ca_system_score_gemma":0.015416806,"threshold_uncertainty_score":0.69583964},"labels":[],"label_agreement":null},{"id":"W4403324648","doi":"10.2139/ssrn.4984628","title":"Are Causal Effect Estimations Enough for Optimal Recommendations Under Multitreatment Scenarios?","year":2024,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Econometrics; Economics; Computer science","score_opus":0.13319135079358244,"score_gpt":0.44017721545306965,"score_spread":0.3069858646594872,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403324648","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027002335,0.0025852274,0.9277488,0.029195454,0.00089110935,0.0006447441,0.003584408,0.00068661064,0.0076612113],"genre_scores_gemma":[0.6842674,0.0023852328,0.2966344,0.006505755,0.0019674795,0.0015701103,0.0024083876,0.00022494921,0.0040362645],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9523439,0.035272207,0.002323428,0.006526243,0.002198454,0.0013356766],"domain_scores_gemma":[0.50302917,0.45574617,0.009930862,0.025780486,0.0043143174,0.0011990182],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06481952,0.0020642783,0.0064022313,0.002637001,0.0020348236,0.005781345,0.00464963,0.009962863,0.023439595],"category_scores_gemma":[0.34827355,0.0029873417,0.0035009538,0.003272852,0.0033362904,0.015414287,0.0022540113,0.010243698,0.0025955094],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0028742633,0.001251831,0.021062424,0.0031065352,0.004183443,0.0008246132,0.0010283149,0.120005906,0.0008408312,0.55815667,0.033201456,0.25346372],"study_design_scores_gemma":[0.0005206918,0.00011815337,0.0017961246,0.00027461187,0.0005457243,0.00012736606,0.00025251307,0.12841618,0.00050885923,0.8632424,0.004145497,0.000051824794],"about_ca_topic_score_codex":0.0050038514,"about_ca_topic_score_gemma":0.0040011103,"teacher_disagreement_score":0.06481952,"about_ca_system_score_codex":0.001833579,"about_ca_system_score_gemma":0.00405097,"threshold_uncertainty_score":0.34280252},"labels":[],"label_agreement":null},{"id":"W4403423632","doi":"10.1007/978-3-031-67604-8_5","title":"The Application of Randomized and Quasi-Experimental Designs in Federal Government Program Evaluation","year":2024,"lang":"en","type":"book-chapter","venue":"Contributions to economics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Employment and Social Development Canada","funders":"","keywords":"Government (linguistics); Computer science; Political science","score_opus":0.0852557673877345,"score_gpt":0.4114723712296289,"score_spread":0.3262166038418944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403423632","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002103421,0.0066988803,0.970564,0.0042906334,0.0011171392,0.000802669,0.00022854946,0.00013861763,0.014056166],"genre_scores_gemma":[0.10658564,0.0060646306,0.87182575,0.0026517478,0.0010785356,0.0061792457,0.000121398436,0.000136746,0.0053563095],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.5560255,0.4267273,0.0033306687,0.004283633,0.009026543,0.00060625194],"domain_scores_gemma":[0.31982145,0.66246957,0.004012752,0.010455461,0.0028489656,0.00039170837],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17222117,0.0019273317,0.003479497,0.0021021713,0.0016425459,0.004930226,0.004483436,0.00446182,0.010966624],"category_scores_gemma":[0.32205704,0.0021944072,0.002073716,0.003364383,0.013116957,0.007590786,0.0029852092,0.006547932,0.0008931039],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023559842,0.00017488914,0.0004551819,0.0007607481,0.00025929077,0.00003758644,0.00035320153,0.008209652,0.00011253539,0.89923036,0.0044592307,0.08571173],"study_design_scores_gemma":[0.00018439375,0.00014340713,0.00025696735,0.00022771042,0.000066449895,0.000026070866,0.00008145347,0.01870342,0.00022086262,0.9746382,0.0054221256,0.00002896264],"about_ca_topic_score_codex":0.0028068414,"about_ca_topic_score_gemma":0.003931996,"teacher_disagreement_score":0.17222117,"about_ca_system_score_codex":0.004384428,"about_ca_system_score_gemma":0.0070172027,"threshold_uncertainty_score":0.9108035},"labels":[],"label_agreement":null},{"id":"W4403431962","doi":"10.1093/ije/dyae137","title":"Staggered interventions with no control groups","year":2024,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canada Research Chairs; University of Toronto","funders":"Banting Research Foundation","keywords":"Psychological intervention; Medicine; Control (management); Psychology; Environmental health; Family medicine; Computer science; Nursing; Artificial intelligence","score_opus":0.24966978745009702,"score_gpt":0.5112616415463053,"score_spread":0.2615918540962082,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403431962","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07408593,0.0020933961,0.89662915,0.0024234669,0.0016200219,0.009865422,0.0026694175,0.00083461514,0.009778609],"genre_scores_gemma":[0.60118705,0.001290416,0.3554809,0.00228352,0.00031435763,0.028102584,0.0011939155,0.00008238359,0.010064915],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9431647,0.039747596,0.0034875101,0.008301575,0.0038991973,0.0013994658],"domain_scores_gemma":[0.9389735,0.03473519,0.006103505,0.016543804,0.0026703146,0.00097364356],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.046026636,0.0021468634,0.0040328056,0.0017895305,0.0008601762,0.0024822934,0.0055713905,0.0062249135,0.020287022],"category_scores_gemma":[0.09139192,0.0011688888,0.0038910154,0.0019977544,0.003394708,0.0049464814,0.0035302893,0.0045919972,0.0023778307],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.017690662,0.0037457473,0.005284895,0.006239368,0.0029790993,0.0004413352,0.0017418752,0.07830115,0.0021450599,0.6564144,0.0058148764,0.21920146],"study_design_scores_gemma":[0.013338032,0.020629644,0.005680781,0.002028659,0.004336542,0.00037585892,0.0005874415,0.21111584,0.004173332,0.7089477,0.028501477,0.000284671],"about_ca_topic_score_codex":0.0017621808,"about_ca_topic_score_gemma":0.0011594164,"teacher_disagreement_score":0.95397335,"about_ca_system_score_codex":0.0020722698,"about_ca_system_score_gemma":0.0032913147,"threshold_uncertainty_score":0.243415},"labels":[],"label_agreement":null},{"id":"W4403567836","doi":"10.1007/s12561-024-09461-6","title":"Benefits of Repeated Matched-Cohort and Nested Case–Control Analyses with Time-dependent Exposure in Observational Studies","year":2024,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Centre for Disease Control; St. Paul's Hospital; University of British Columbia","funders":"","keywords":"Observational study; Biostatistics; Cohort study; Econometrics; Medicine; Statistics; Epidemiology; Internal medicine; Mathematics","score_opus":0.24423021167723682,"score_gpt":0.45873918055149415,"score_spread":0.21450896887425733,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403567836","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07517779,0.008236313,0.9054893,0.003906775,0.0012107305,0.00054800045,0.0017748656,0.0013071671,0.0023489736],"genre_scores_gemma":[0.53399986,0.002322632,0.45592934,0.001184907,0.0017499989,0.0008706257,0.001280288,0.0004436851,0.0022187366],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8225481,0.15860124,0.0046666935,0.007822354,0.0057823826,0.0005792251],"domain_scores_gemma":[0.29526213,0.58471006,0.010251269,0.10168601,0.0065609613,0.0015294643],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15677772,0.0019321947,0.0047448147,0.0021330249,0.0014233264,0.0028801153,0.006135123,0.0036435123,0.0032289864],"category_scores_gemma":[0.49188703,0.0020641594,0.0063654943,0.0030130553,0.002872274,0.003718213,0.004125524,0.0036713714,0.00049620215],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.017532496,0.0027302157,0.19257498,0.002851855,0.044026874,0.005168065,0.004150931,0.10507406,0.006627911,0.10732744,0.01226122,0.499674],"study_design_scores_gemma":[0.0053569516,0.0038279472,0.09527752,0.00061073515,0.019145466,0.0026513725,0.00063056056,0.37073228,0.0037528381,0.4803411,0.01713349,0.0005396889],"about_ca_topic_score_codex":0.007544631,"about_ca_topic_score_gemma":0.0062725917,"teacher_disagreement_score":0.84322226,"about_ca_system_score_codex":0.0007582732,"about_ca_system_score_gemma":0.0035910886,"threshold_uncertainty_score":0.82912976},"labels":[],"label_agreement":null},{"id":"W4403707130","doi":"10.48550/arxiv.2409.11269","title":"Testing for racial bias using inconsistent perceptions of race","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institute for Advanced Research; Colorado State University; National Science Foundation","keywords":"Race (biology); Racial bias; Perception; Psychology; Social psychology; Sociology; Gender studies","score_opus":0.5281622615802808,"score_gpt":0.34887634735150397,"score_spread":0.17928591422877682,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403707130","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.72562975,0.0010709142,0.24687782,0.0058880183,0.000535769,0.00045503047,0.0063510714,0.00039838575,0.012793201],"genre_scores_gemma":[0.95837355,0.0001015059,0.036972374,0.0008388065,0.00018102546,0.00062084326,0.0021049296,0.00006907982,0.00073796604],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9229982,0.05273533,0.004087183,0.011692379,0.006799273,0.0016876538],"domain_scores_gemma":[0.568213,0.33541483,0.0423634,0.041298125,0.010349411,0.0023612727],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07537473,0.0009001623,0.0014861114,0.0019890384,0.0030900973,0.0035147553,0.0035927012,0.0024968453,0.00861216],"category_scores_gemma":[0.35714772,0.0004952023,0.0020509085,0.003605326,0.003949811,0.004199916,0.0041324156,0.0037861194,0.0009613182],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014263515,0.0004046991,0.86896324,0.00041762268,0.0022166665,0.00030949945,0.0047055082,0.0031333547,0.0012496033,0.050533064,0.0070722573,0.059568096],"study_design_scores_gemma":[0.0013127028,0.0011945345,0.46295276,0.0008097194,0.0021660589,0.0011330936,0.0113801295,0.11848182,0.010745424,0.35420603,0.03534896,0.00026876485],"about_ca_topic_score_codex":0.005938482,"about_ca_topic_score_gemma":0.0029315169,"teacher_disagreement_score":0.07537473,"about_ca_system_score_codex":0.00092313753,"about_ca_system_score_gemma":0.0017626163,"threshold_uncertainty_score":0.39862442},"labels":[],"label_agreement":null},{"id":"W4404021068","doi":"10.1097/ede.0000000000001808","title":"A Structural Description of Biases That Generate Immortal Time","year":2024,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":75,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Medical Research Council; National Institute for Health and Care Research","keywords":"Selection (genetic algorithm); Computer science; Emulation; Selection bias; Term (time); Observational study; Statistics; Artificial intelligence; Psychology; Mathematics; Social psychology","score_opus":0.5136780440079687,"score_gpt":0.47685382740507143,"score_spread":0.03682421660289725,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404021068","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008216008,0.0012170051,0.9730886,0.005280471,0.00026734287,0.00018333807,0.0007829522,0.00019650329,0.0107676415],"genre_scores_gemma":[0.5360181,0.0048854006,0.4146285,0.004921799,0.0018219337,0.0029907334,0.0017117923,0.0004149797,0.03260688],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9871252,0.006882741,0.0007508201,0.00208051,0.0023602205,0.00080054865],"domain_scores_gemma":[0.8797054,0.08749083,0.011353955,0.016077269,0.0046585742,0.0007138655],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.027695267,0.0009981485,0.0012551328,0.0023627698,0.0014441409,0.0028998277,0.003312213,0.0032772834,0.019680098],"category_scores_gemma":[0.11611114,0.0008034131,0.0031664665,0.0028599275,0.004814173,0.006367299,0.0039194096,0.0058308067,0.0023658122],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025438165,0.000014452462,0.0013414735,0.0001001142,0.000053755,0.000089308916,0.00025523323,0.004761717,0.00018552683,0.98040766,0.0016053347,0.011160066],"study_design_scores_gemma":[0.00002589717,0.00004307886,0.00071260234,0.00007564651,0.000048279315,0.00027016373,0.000041074352,0.01644503,0.00033714712,0.9729393,0.009037372,0.000024468329],"about_ca_topic_score_codex":0.0022630084,"about_ca_topic_score_gemma":0.0017742645,"teacher_disagreement_score":0.97230476,"about_ca_system_score_codex":0.0026097603,"about_ca_system_score_gemma":0.0023036804,"threshold_uncertainty_score":0.14646834},"labels":[],"label_agreement":null},{"id":"W4404420616","doi":"10.1016/j.neuchi.2024.101610","title":"Lies, damned lies, and statistical populations","year":2024,"lang":"en","type":"editorial","venue":"Neurochirurgie","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta Hospital; Health Sciences Centre; Centre Hospitalier de l’Université de Montréal","funders":"","keywords":"Medicine","score_opus":0.13536886320562494,"score_gpt":0.43699602258912074,"score_spread":0.3016271593834958,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404420616","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000016716762,0.020124651,0.0006920145,0.066531956,0.9116027,0.000013851216,0.000113721035,0.00005052581,0.00085398497],"genre_scores_gemma":[0.00039324714,0.0072477297,0.00040084225,0.025923869,0.961464,0.00003581357,0.000030013756,0.00004261785,0.0044618803],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9852895,0.0065304255,0.002085798,0.0011680503,0.004612232,0.00031394657],"domain_scores_gemma":[0.88555646,0.09279484,0.0022000964,0.002217851,0.014744507,0.0024862122],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.024588598,0.0043993257,0.005769531,0.008009516,0.0041502975,0.009684955,0.0057779043,0.02828834,0.010749132],"category_scores_gemma":[0.12434691,0.002429811,0.0039928225,0.0040261536,0.007765359,0.0072461427,0.002302048,0.034170188,0.006420469],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020971247,0.0000073823044,0.000018484501,0.00029297062,0.000048066056,0.000048615857,0.000018533996,0.000058182843,0.000008839608,0.0028121707,0.99397933,0.0026865518],"study_design_scores_gemma":[0.00022185237,0.000024722303,0.00039176995,0.0023538119,0.000269162,0.00027467523,0.00008425024,0.0013138854,0.000079581885,0.043341015,0.95156276,0.000082422455],"about_ca_topic_score_codex":0.00843918,"about_ca_topic_score_gemma":0.018749373,"teacher_disagreement_score":0.9754114,"about_ca_system_score_codex":0.0055646636,"about_ca_system_score_gemma":0.00611941,"threshold_uncertainty_score":0.1300385},"labels":[],"label_agreement":null},{"id":"W4404546549","doi":"10.30683/1929-2279.2024.13.08","title":"Scientific Tasks in Biomedical and Oncological Research: Describing, Predicting, and Explaining","year":2024,"lang":"en","type":"article","venue":"Journal of cancer research updates","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Task (project management); Scientific evidence; Computer science; Sociology of scientific knowledge; Scientific literature; Data science; Descriptive statistics; Management science; Artificial intelligence; Epistemology; Mathematics","score_opus":0.6179883343554925,"score_gpt":0.596347538729944,"score_spread":0.021640795625548548,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404546549","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012466093,0.013722141,0.9003124,0.053247202,0.0014842387,0.0013176779,0.000915487,0.0003436437,0.016191155],"genre_scores_gemma":[0.27420494,0.0133326715,0.6957791,0.0061989417,0.0027551772,0.0040979576,0.0011861854,0.00020897837,0.0022360075],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84433055,0.11499676,0.014201567,0.0070705772,0.017468091,0.0019324565],"domain_scores_gemma":[0.4697073,0.44654366,0.03082416,0.03451906,0.016011918,0.002393947],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.19573802,0.0028111555,0.0024269533,0.016573379,0.0043074135,0.017126035,0.0041009868,0.005626625,0.0041638925],"category_scores_gemma":[0.3632162,0.0015677821,0.0041148034,0.014302517,0.02515107,0.022126367,0.010189808,0.0077421363,0.0012727524],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000877789,0.00008832203,0.009564139,0.0027167262,0.00026248535,0.00010625513,0.0055643185,0.006505841,0.00027230615,0.8654686,0.006192564,0.10317065],"study_design_scores_gemma":[0.000023014001,0.000033838263,0.0019062036,0.0011483787,0.0000687749,0.000092250135,0.0011087556,0.007268027,0.00022669965,0.97455287,0.013517776,0.000053457945],"about_ca_topic_score_codex":0.0045817737,"about_ca_topic_score_gemma":0.0038863071,"teacher_disagreement_score":0.19573802,"about_ca_system_score_codex":0.008260809,"about_ca_system_score_gemma":0.019742383,"threshold_uncertainty_score":0.9917982},"labels":[],"label_agreement":null},{"id":"W4404567028","doi":"10.1002/sim.10223","title":"Q‐Learning in Dynamic Treatment Regimes With Misclassified Binary Outcome","year":2024,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Outcome (game theory); Artificial intelligence; Machine learning; Population; Binary classification; Statistics; Data mining; Medicine; Mathematics; Support vector machine","score_opus":0.10451381065403711,"score_gpt":0.4508819754438676,"score_spread":0.34636816478983046,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404567028","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029349865,0.0010812592,0.9669311,0.0013656219,0.000061404215,0.00017780425,0.0001048514,0.00014290598,0.0007852113],"genre_scores_gemma":[0.7269988,0.0013788895,0.26714373,0.0008205979,0.0002256274,0.0007454679,0.00031481715,0.00006919336,0.002302941],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9824614,0.013178543,0.0006328222,0.0022169168,0.0009197136,0.0005906757],"domain_scores_gemma":[0.8203136,0.16812448,0.00596136,0.0024543446,0.0023439075,0.00080233894],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04634653,0.001143395,0.0037088965,0.0015747381,0.0009953694,0.0019141356,0.0027366115,0.0027603789,0.002043276],"category_scores_gemma":[0.104782805,0.00095754483,0.0014395377,0.0017405519,0.003812018,0.0028068225,0.0018206154,0.0042742006,0.00024856522],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052682945,0.00020606774,0.006914867,0.00037259926,0.00022181483,0.0003048314,0.0003858534,0.8236507,0.0004713475,0.07643753,0.0011192538,0.08938829],"study_design_scores_gemma":[0.00008585947,0.00011391945,0.000707057,0.000042043728,0.000032817657,0.000049438477,0.000026580172,0.93455213,0.00026096747,0.06365238,0.00045745537,0.000019286343],"about_ca_topic_score_codex":0.008532523,"about_ca_topic_score_gemma":0.0036243962,"teacher_disagreement_score":0.04634653,"about_ca_system_score_codex":0.0027700618,"about_ca_system_score_gemma":0.0035213935,"threshold_uncertainty_score":0.24510682},"labels":[],"label_agreement":null},{"id":"W4404583154","doi":"10.3138/jmvfh-2024-0016","title":"Comments on Gray and Bourke ‘Remediation of intrusive symptoms of PTSD in fewer than five sessions: A 30-person pre-pilot study of the RTM Protocol’","year":2024,"lang":"en","type":"article","venue":"Journal of Military Veteran and Family Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Gray (unit); Protocol (science); Psychology; Clinical psychology; Psychiatry; Medicine; Alternative medicine; Nuclear medicine; Pathology","score_opus":0.11721478040038104,"score_gpt":0.4286900091009749,"score_spread":0.31147522870059385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404583154","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020239388,0.0010300772,0.0012792718,0.95631886,0.036596403,0.0004950903,0.00038430069,0.0003416498,0.0015304171],"genre_scores_gemma":[0.0043807942,0.00054989726,0.0031434412,0.9764459,0.00871749,0.00091953203,0.00006900332,0.00013941925,0.0056344736],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.978721,0.009947015,0.0041802526,0.0016891407,0.004389176,0.0010733877],"domain_scores_gemma":[0.83787465,0.11189286,0.006625355,0.0031798976,0.03512722,0.005299994],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.046414904,0.0011281752,0.0012656479,0.00080479804,0.0049218056,0.0025646654,0.0057705455,0.028154682,0.018144736],"category_scores_gemma":[0.23422062,0.0015638742,0.0024615768,0.001026237,0.0050882953,0.003992415,0.002368917,0.022843651,0.010342077],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023973166,0.000070470356,0.00042860705,0.00022151814,0.000020527043,0.00026282962,0.0012657893,0.00011303923,0.00036632954,0.0005908824,0.98550594,0.010914392],"study_design_scores_gemma":[0.00066660886,0.0007513682,0.008041704,0.0013070331,0.00013897613,0.0006592565,0.00438929,0.0007709738,0.0013333671,0.0022815745,0.9793743,0.00028566786],"about_ca_topic_score_codex":0.040836535,"about_ca_topic_score_gemma":0.079653054,"teacher_disagreement_score":0.046414904,"about_ca_system_score_codex":0.0061964393,"about_ca_system_score_gemma":0.010138472,"threshold_uncertainty_score":0.24546838},"labels":[],"label_agreement":null},{"id":"W4404589755","doi":"10.52294/001c.124817","title":"Through the lens of causal inference: Decisions and pitfalls of covariate selection","year":2024,"lang":"en","type":"article","venue":"Aperture Neuro","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health; National Institutes of Health","keywords":"Causal inference; Covariate; Selection (genetic algorithm); Inference; Lens (geology); Computer science; Econometrics; Psychology; Artificial intelligence; Machine learning; Mathematics; Optics; Physics","score_opus":0.16093200396003512,"score_gpt":0.4150338968016802,"score_spread":0.2541018928416451,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404589755","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004638068,0.004721988,0.85186744,0.123855375,0.0015086747,0.0007854826,0.00043645498,0.00047031502,0.011716143],"genre_scores_gemma":[0.1887916,0.0030292599,0.76661015,0.031461287,0.0033025774,0.004138743,0.00022205159,0.0006313156,0.0018129743],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.43808082,0.49629486,0.017574852,0.020922862,0.025092598,0.0020339927],"domain_scores_gemma":[0.1769156,0.7221458,0.020552328,0.063487075,0.01546689,0.0014322989],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.51676434,0.0030367104,0.004321591,0.0070182863,0.0068601742,0.01940771,0.008088999,0.01119406,0.0076167285],"category_scores_gemma":[0.71949756,0.0031107469,0.004866773,0.0061289067,0.06493584,0.03023662,0.016354198,0.027761266,0.0014573059],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020009576,0.000040419665,0.0018231678,0.00097031525,0.0003151054,0.00028909658,0.010816921,0.0023272482,0.0003248693,0.9174151,0.006916329,0.058561314],"study_design_scores_gemma":[0.00008826312,0.000032472108,0.00030501507,0.000762533,0.00009252983,0.0000984204,0.00048089575,0.003495238,0.0004581437,0.98130727,0.01283288,0.000046330635],"about_ca_topic_score_codex":0.007121075,"about_ca_topic_score_gemma":0.004852057,"teacher_disagreement_score":0.48323566,"about_ca_system_score_codex":0.009799183,"about_ca_system_score_gemma":0.018443476,"threshold_uncertainty_score":0.5959157},"labels":[],"label_agreement":null},{"id":"W4404681647","doi":"10.1093/aje/kwae437","title":"Modern sources of controls in case-control studies","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Public Health Ontario; University of Toronto","funders":"National Cancer Institute; National Heart, Lung, and Blood Institute; National Institute on Aging","keywords":"Medicine; Control (management); Computer science; Artificial intelligence","score_opus":0.1981083945195597,"score_gpt":0.48364762285779234,"score_spread":0.28553922833823264,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404681647","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024769974,0.017037872,0.9691751,0.005064185,0.0011251684,0.00094864226,0.0005454482,0.00015211706,0.0034744565],"genre_scores_gemma":[0.16509157,0.02339596,0.7825445,0.00682072,0.005442152,0.011893232,0.0016245226,0.00025400613,0.0029333467],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7534162,0.19602656,0.0122897765,0.014275477,0.022999493,0.0009924186],"domain_scores_gemma":[0.71487075,0.23400876,0.014819974,0.025929805,0.009728885,0.0006418242],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18308122,0.0018008719,0.0035306886,0.0092229685,0.0022433696,0.0053058774,0.0044205203,0.004420789,0.005474532],"category_scores_gemma":[0.30922234,0.0015007413,0.0025216485,0.011837682,0.0071942746,0.0069701197,0.006305571,0.0065314383,0.0010454177],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032559104,0.00012259901,0.010092066,0.0029731505,0.0013125543,0.00057499233,0.0028723513,0.0042362944,0.00047174378,0.7347574,0.008320422,0.23394077],"study_design_scores_gemma":[0.0003214292,0.00021070895,0.003296989,0.002706936,0.0004809401,0.0006233379,0.00045343544,0.008869982,0.0009182492,0.92876077,0.053249665,0.0001075801],"about_ca_topic_score_codex":0.0019695011,"about_ca_topic_score_gemma":0.000872117,"teacher_disagreement_score":0.8169188,"about_ca_system_score_codex":0.0028128792,"about_ca_system_score_gemma":0.0033834183,"threshold_uncertainty_score":0.96823764},"labels":[],"label_agreement":null},{"id":"W4404709178","doi":"10.1056/evide2400384","title":"Truncated, Not Forgotten — Handling Left Truncation in Time-to-Event Studies","year":2024,"lang":"en","type":"letter","venue":"NEJM Evidence","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Health Sciences North","funders":"","keywords":"Truncation (statistics); Event (particle physics); Computer science; Mathematics; Statistics; Physics","score_opus":0.3079535159591048,"score_gpt":0.4714579623514579,"score_spread":0.16350444639235312,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404709178","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003264592,0.013411045,0.10302011,0.84778255,0.015905896,0.00015135539,0.0012238561,0.00014669391,0.015093845],"genre_scores_gemma":[0.15576553,0.010525061,0.10900302,0.61917657,0.09390231,0.001253448,0.0003832892,0.0003153887,0.0096753435],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9127531,0.0678828,0.0064534596,0.005301186,0.0064049177,0.0012045254],"domain_scores_gemma":[0.35839474,0.60151285,0.0074723237,0.021972563,0.008507253,0.002140234],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16161682,0.00084147207,0.0038820289,0.0020794738,0.0027773303,0.0050597247,0.0050796513,0.020993045,0.0070595257],"category_scores_gemma":[0.566177,0.001200161,0.0026996736,0.0024786063,0.010172879,0.013629603,0.0031817954,0.040625583,0.0016097358],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080207357,0.000056939272,0.003056275,0.0012030588,0.00062770466,0.0019988767,0.0013558505,0.0011140011,0.0002102032,0.6468183,0.25346404,0.08929287],"study_design_scores_gemma":[0.0002194833,0.000027825194,0.0006462648,0.00058048207,0.00017763268,0.00038132333,0.000116637646,0.0024532792,0.00012996852,0.9659317,0.029298035,0.000037273054],"about_ca_topic_score_codex":0.0033477207,"about_ca_topic_score_gemma":0.005254615,"teacher_disagreement_score":0.8383832,"about_ca_system_score_codex":0.0024843083,"about_ca_system_score_gemma":0.005883815,"threshold_uncertainty_score":0.85472167},"labels":[],"label_agreement":null},{"id":"W4404725899","doi":"10.1186/s12874-024-02402-3","title":"Non-collapsibility and built-in selection bias of period-specific and conventional hazard ratio in randomized controlled trials","year":2024,"lang":"en","type":"article","venue":"BMC Medical Research Methodology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University; McGill University; McGill University Health Centre","funders":"","keywords":"Hazard ratio; Marginal structural model; Statistics; Weighting; Proportional hazards model; Inverse probability weighting; Hazard; Covariate; Econometrics; Confounding; Mathematics; Confidence interval; Medicine; Chemistry; Propensity score matching","score_opus":0.7400147912349078,"score_gpt":0.6258450755790635,"score_spread":0.11416971565584422,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404725899","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011474855,0.010038208,0.97022086,0.0035625703,0.0006135797,0.0013079774,0.00032309027,0.00026351734,0.0021954274],"genre_scores_gemma":[0.53336203,0.0064156577,0.44657522,0.003601608,0.0014858454,0.0063479138,0.00043561278,0.00024402338,0.0015321117],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5725814,0.3731241,0.01728533,0.016491719,0.01864545,0.0018720448],"domain_scores_gemma":[0.20674142,0.71092945,0.040060587,0.03536956,0.00624532,0.0006536908],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.38585386,0.0015922603,0.0039361757,0.0029645113,0.0009341625,0.0045676376,0.003949813,0.0038172982,0.004730726],"category_scores_gemma":[0.6184887,0.0012961995,0.0067934413,0.003662645,0.008474258,0.0054485514,0.004272456,0.0045657908,0.00044872303],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025286172,0.00017484286,0.041118205,0.011496959,0.0117896125,0.001042121,0.0025379898,0.047345944,0.0009439772,0.63868535,0.006211947,0.23612452],"study_design_scores_gemma":[0.0014516352,0.0008899958,0.009424811,0.0031847148,0.004731941,0.0011917724,0.00020070818,0.132942,0.0028054586,0.8326113,0.010353508,0.00021218728],"about_ca_topic_score_codex":0.0013777615,"about_ca_topic_score_gemma":0.0008505166,"teacher_disagreement_score":0.6141461,"about_ca_system_score_codex":0.0036408354,"about_ca_system_score_gemma":0.006091147,"threshold_uncertainty_score":0.7573515},"labels":[],"label_agreement":null},{"id":"W4404837160","doi":"10.1002/sim.10278","title":"Dynamic Treatment Regimes on Dyadic Networks","year":2024,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Dyad; Computer science; Context (archaeology); Outcome (game theory); Population; Path (computing); Mathematical optimization; Econometrics; Machine learning; Mathematics; Medicine; Psychology","score_opus":0.07713181625879532,"score_gpt":0.45058179005342597,"score_spread":0.37344997379463063,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404837160","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10225388,0.000800923,0.88937414,0.0013910716,0.0000766637,0.00029408644,0.0008012408,0.00016051673,0.004847463],"genre_scores_gemma":[0.8514774,0.0013140751,0.13519596,0.0003707272,0.00013338201,0.0010836956,0.0010104737,0.00008443411,0.009329797],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9930179,0.0047682016,0.00016788022,0.0013399592,0.00035239663,0.00035365546],"domain_scores_gemma":[0.977725,0.018432176,0.0020884234,0.0008268765,0.00053103425,0.0003964305],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.007943798,0.0009270126,0.002179682,0.0012016308,0.0009888838,0.0017757196,0.002632052,0.0018428083,0.0066444413],"category_scores_gemma":[0.031834114,0.0010193038,0.001243834,0.0014249933,0.0018503449,0.0030419424,0.0024669736,0.00242425,0.00059952383],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029896485,0.00012355373,0.0058977786,0.00015370529,0.00022003666,0.00033097758,0.00030945856,0.844201,0.00039933532,0.11486659,0.0016898772,0.03150869],"study_design_scores_gemma":[0.000050345705,0.00006647269,0.00163675,0.000039944418,0.00005798194,0.000057388792,0.000112031594,0.90538067,0.00013832671,0.091014,0.0014224392,0.00002364332],"about_ca_topic_score_codex":0.013482488,"about_ca_topic_score_gemma":0.011371596,"teacher_disagreement_score":0.9920562,"about_ca_system_score_codex":0.0022238777,"about_ca_system_score_gemma":0.0013258234,"threshold_uncertainty_score":0.04201132},"labels":[],"label_agreement":null},{"id":"W4404838868","doi":"10.1002/9781118445112.stat08040.pub2","title":"Dynamic Treatment Regimes (Updated)","year":2024,"lang":"en","type":"other","venue":"Wiley StatsRef: Statistics Reference Online","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science","score_opus":0.12673538890750674,"score_gpt":0.4386927029725705,"score_spread":0.3119573140650638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404838868","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03875172,0.010903736,0.6448076,0.021015817,0.005370757,0.0014962242,0.08344479,0.0040722336,0.19013722],"genre_scores_gemma":[0.60167587,0.01026737,0.24477689,0.0102349715,0.0036889338,0.0035106733,0.039720394,0.0012484549,0.08487655],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992841,0.0031303307,0.00048802362,0.001781967,0.0014136968,0.00034501826],"domain_scores_gemma":[0.97800577,0.011716854,0.0026579588,0.0049691596,0.0022687875,0.00038143643],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0068478924,0.0005404531,0.0013358238,0.002488018,0.00049673574,0.0031618103,0.0019433155,0.002054904,0.05539904],"category_scores_gemma":[0.070182025,0.0004977455,0.0011832026,0.0036971255,0.00085712736,0.003244091,0.001102983,0.003633878,0.010171396],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00058821903,0.00033780347,0.0076734433,0.000787718,0.00036657767,0.00018055538,0.0002556724,0.033859573,0.00046859714,0.22801188,0.14003877,0.5874312],"study_design_scores_gemma":[0.0005374343,0.00027471903,0.012683092,0.0011947724,0.00038213853,0.00072208286,0.00013176048,0.09483508,0.0014991021,0.5719986,0.31557438,0.00016684512],"about_ca_topic_score_codex":0.005466635,"about_ca_topic_score_gemma":0.0035820466,"teacher_disagreement_score":0.05539904,"about_ca_system_score_codex":0.0018578891,"about_ca_system_score_gemma":0.0017449786,"threshold_uncertainty_score":0.18532825},"labels":[],"label_agreement":null},{"id":"W4405184953","doi":"10.1016/j.jclinepi.2024.111638","title":"Empirical estimation of disutilities and decision thresholds for composite endpoints","year":2024,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University; Hamilton Health Sciences","funders":"","keywords":"Estimation; Composite number; Statistics; Econometrics; Mathematics; Computer science; Medicine; Economics; Algorithm","score_opus":0.6337335036538869,"score_gpt":0.6538808126028767,"score_spread":0.02014730894898975,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405184953","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.38096145,0.0049465043,0.5987524,0.006908946,0.00012612063,0.0005532979,0.001554452,0.00036935633,0.0058274395],"genre_scores_gemma":[0.9231092,0.0018225523,0.07117732,0.00048327105,0.00016607517,0.00036937496,0.0007426453,0.00007727353,0.0020522936],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98174196,0.014366886,0.0006156049,0.0013300427,0.0012013499,0.0007442173],"domain_scores_gemma":[0.52518946,0.46036375,0.005503407,0.005939172,0.0017736581,0.0012304907],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.056325495,0.0016967156,0.003996516,0.004294934,0.0005562124,0.0055846474,0.0032802755,0.0034175355,0.0063098124],"category_scores_gemma":[0.2581965,0.0011753539,0.003000368,0.0033909772,0.003954036,0.005604007,0.0026163815,0.006615177,0.00038219825],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036625073,0.0011774818,0.051322073,0.001120124,0.0017214074,0.00065160723,0.001307256,0.3392974,0.0011702572,0.47931156,0.005075325,0.11418293],"study_design_scores_gemma":[0.00039797084,0.0003724359,0.011177229,0.00031322386,0.00059412164,0.00041267104,0.00039005384,0.51774204,0.0006713398,0.46664846,0.0011938704,0.00008656971],"about_ca_topic_score_codex":0.00335032,"about_ca_topic_score_gemma":0.0017957328,"teacher_disagreement_score":0.9436745,"about_ca_system_score_codex":0.002482677,"about_ca_system_score_gemma":0.0029685744,"threshold_uncertainty_score":0.29788125},"labels":[],"label_agreement":null},{"id":"W4405382998","doi":"10.1177/09622802241298704","title":"A Bayesian latent class approach to causal inference with longitudinal data","year":2024,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto; University Health Network; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"Canadian Institutes of Health Research; Hospital for Sick Children","keywords":"Causal inference; Confounding; Covariate; Bayesian probability; Latent class model; Latent variable; Econometrics; Computer science; Bayesian inference; Statistics; Machine learning; Artificial intelligence; Mathematics","score_opus":0.6368623295240852,"score_gpt":0.6762469425986279,"score_spread":0.039384613074542774,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405382998","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00091727305,0.0002618045,0.9977053,0.0004398617,0.000026887128,0.00004618648,0.000077004086,0.000066274326,0.00045947486],"genre_scores_gemma":[0.12671715,0.0016491957,0.8661746,0.00052080065,0.00044803732,0.000932244,0.00047727133,0.0001282705,0.0029524972],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826401,0.014129431,0.00045971395,0.0010657782,0.0013859936,0.0003190291],"domain_scores_gemma":[0.934519,0.058547687,0.002291205,0.002751172,0.0014332664,0.00045763372],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02724833,0.0011182337,0.0021588583,0.0030890708,0.0011503285,0.0025385877,0.0032706328,0.0021855775,0.005838837],"category_scores_gemma":[0.0736578,0.00103827,0.002606886,0.0033154085,0.0031154288,0.0036443174,0.002930182,0.0047624763,0.00067041663],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008967276,0.000085637366,0.0021233214,0.00024408687,0.00032057235,0.000119285956,0.0003198337,0.16647811,0.00020581792,0.746222,0.0023918084,0.0813998],"study_design_scores_gemma":[0.000052416133,0.000035167646,0.00036528986,0.00006885018,0.000055282486,0.00005493976,0.000037025995,0.39334288,0.00010092534,0.60286325,0.002996621,0.000027370388],"about_ca_topic_score_codex":0.0078073028,"about_ca_topic_score_gemma":0.0073958063,"teacher_disagreement_score":0.9727517,"about_ca_system_score_codex":0.0025107015,"about_ca_system_score_gemma":0.004242252,"threshold_uncertainty_score":0.14410472},"labels":[],"label_agreement":null},{"id":"W4405393380","doi":"10.1093/aje/kwae447","title":"Towards robust causal inference in epidemiologic research: employing double cross-fit TMLE in right heart catheterization data","year":2024,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; British Columbia Centre for Disease Control; Michael Smith Health Research BC","keywords":"Observational study; Causal inference; Computer science; Inference; Epidemiology; Relevance (law); Data science; Machine learning; Data mining; Econometrics; Artificial intelligence; Medicine; Statistics; Mathematics; Pathology","score_opus":0.7041649067897078,"score_gpt":0.6040121800564162,"score_spread":0.10015272673329156,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405393380","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016049455,0.0002979763,0.9968886,0.00043520582,0.000040803116,0.000059082045,0.00018758766,0.00026258096,0.00022320416],"genre_scores_gemma":[0.065966375,0.0006335728,0.9299123,0.00086456625,0.00019868683,0.0005757178,0.0009495724,0.0002810173,0.00061817706],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96363914,0.030481426,0.0014407963,0.0025465812,0.0016146837,0.0002773813],"domain_scores_gemma":[0.82911915,0.14482188,0.005500421,0.015268393,0.0045217103,0.00076851295],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06490325,0.0012702686,0.0020403855,0.0031401303,0.0009766555,0.0040612696,0.002992005,0.002747639,0.004629213],"category_scores_gemma":[0.24941842,0.0014327652,0.0034138497,0.00343365,0.0020890257,0.003512508,0.005434469,0.0057086702,0.0016253276],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005852601,0.0002789803,0.027828962,0.0018069494,0.0025908842,0.0009041957,0.0014468518,0.20069598,0.0028825803,0.23369229,0.017041823,0.51024526],"study_design_scores_gemma":[0.00017171798,0.00026353443,0.00395629,0.00049850903,0.00032101374,0.000598216,0.00020057535,0.60506713,0.002093472,0.3692211,0.017478583,0.00012995595],"about_ca_topic_score_codex":0.0034312685,"about_ca_topic_score_gemma":0.0050135776,"teacher_disagreement_score":0.93509674,"about_ca_system_score_codex":0.0007921616,"about_ca_system_score_gemma":0.0032572078,"threshold_uncertainty_score":0.34324533},"labels":[],"label_agreement":null},{"id":"W4405627559","doi":"10.48550/arxiv.2412.14447","title":"Good Controls Gone Bad: Difference-in-Differences with Covariates","year":2024,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Econometrics; Statistics; Economics; Psychology; Mathematics","score_opus":0.16029442886371298,"score_gpt":0.27127922135343546,"score_spread":0.11098479248972248,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405627559","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03779446,0.002041498,0.9507761,0.0029884214,0.00043926173,0.00027152896,0.00072558655,0.00039460088,0.0045684706],"genre_scores_gemma":[0.72304136,0.00102405,0.26737565,0.0015944284,0.0006042281,0.0009648118,0.0007703537,0.00020717106,0.004417987],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93868625,0.04670987,0.0017422368,0.006673398,0.0047283676,0.0014598953],"domain_scores_gemma":[0.7584072,0.20131765,0.0112620825,0.024034247,0.003858001,0.0011208749],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.057939686,0.0009966253,0.0026954764,0.0015090507,0.0017941156,0.0041946685,0.003578617,0.0029464683,0.0090497285],"category_scores_gemma":[0.21319194,0.0009804454,0.0018696185,0.0030254535,0.005943827,0.0049018413,0.0033889394,0.0052658953,0.00060309],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00076085597,0.00023124604,0.024542773,0.00037837573,0.0010657433,0.00037743166,0.0012744778,0.021940751,0.00033408185,0.8270645,0.003985886,0.118043885],"study_design_scores_gemma":[0.00038494324,0.0004986612,0.008436125,0.00022874636,0.00050180074,0.00018208279,0.00030922078,0.10856366,0.0011410767,0.8628647,0.016785437,0.000103595296],"about_ca_topic_score_codex":0.0063946494,"about_ca_topic_score_gemma":0.0033892633,"teacher_disagreement_score":0.057939686,"about_ca_system_score_codex":0.0025328286,"about_ca_system_score_gemma":0.0033737433,"threshold_uncertainty_score":0.30641806},"labels":[],"label_agreement":null},{"id":"W4405744723","doi":"10.1007/978-3-031-65937-9_12","title":"Regression-Based Estimation of Optimal Adaptive Treatment Strategies: Key Methods","year":2024,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Centre Hospitalier de l’Université de Montréal; McGill University","funders":"","keywords":"Key (lock); Regression; Estimation; Computer science; Regression analysis; Statistics; Mathematics; Machine learning; Engineering","score_opus":0.23294005803725717,"score_gpt":0.48569731981574543,"score_spread":0.25275726177848823,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405744723","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00019742157,0.0026731207,0.9917794,0.0006447014,0.00013523138,0.000038057507,0.00013081638,0.00011910535,0.004282229],"genre_scores_gemma":[0.030994449,0.013989695,0.9295395,0.0007617945,0.00097089855,0.0006820003,0.00050678017,0.00039418298,0.022160767],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99734217,0.0017788294,0.00010457817,0.00032766265,0.00038348808,0.00006311946],"domain_scores_gemma":[0.9902924,0.008514563,0.00026689333,0.0004487304,0.00042334848,0.000054125434],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061830105,0.0017098498,0.002132966,0.0010983009,0.0003447375,0.0018049611,0.0032151653,0.0023378434,0.015809722],"category_scores_gemma":[0.028112225,0.0010988426,0.0013616482,0.0021132436,0.0014397907,0.0023642248,0.0014964589,0.0046461923,0.0049213707],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000402333,0.00007735287,0.00026028784,0.00057454535,0.00011482297,0.000053148342,0.00008061211,0.06296207,0.0007653131,0.7029694,0.02274385,0.20935836],"study_design_scores_gemma":[0.000026937674,0.000032302156,0.00037743463,0.0002355483,0.00007046913,0.00011721027,0.0000334141,0.23529556,0.0008456933,0.73677975,0.026138656,0.000047089718],"about_ca_topic_score_codex":0.0022354939,"about_ca_topic_score_gemma":0.002334425,"teacher_disagreement_score":0.015809722,"about_ca_system_score_codex":0.0010854313,"about_ca_system_score_gemma":0.0016905417,"threshold_uncertainty_score":0.05288875},"labels":[],"label_agreement":null},{"id":"W4405813361","doi":"10.1101/2024.12.20.24319429","title":"Causation and prevention in epidemiology: assumptions, derivations, and measures old and new","year":2024,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Montreal Police Service","funders":"","keywords":"Causation; Epidemiology; Epistemology; Psychology; Medicine; Philosophy","score_opus":0.3567433570850655,"score_gpt":0.463564339118824,"score_spread":0.1068209820337585,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405813361","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045115,0.009042563,0.95710117,0.018785235,0.00080642075,0.00005484743,0.00020250469,0.00012682987,0.009368938],"genre_scores_gemma":[0.35180762,0.017324118,0.61279505,0.0069935177,0.0035392498,0.00066315575,0.00037977577,0.0002543302,0.006243177],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98666114,0.008435392,0.00097463693,0.0010733259,0.0026481848,0.00020728227],"domain_scores_gemma":[0.9501616,0.04030765,0.0026121344,0.0036181845,0.0027673936,0.0005330814],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.028782599,0.0011350915,0.001386184,0.0042872205,0.0009705751,0.004272334,0.0027685752,0.0028960744,0.003969597],"category_scores_gemma":[0.06674345,0.0008304129,0.0018321667,0.0028981846,0.009697979,0.009895741,0.0046945005,0.007194632,0.0009033633],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000005107393,0.000009478678,0.00022338865,0.00007761386,0.000021742624,0.000027708935,0.00008180453,0.0020335445,0.00003182027,0.99057734,0.000921419,0.005989124],"study_design_scores_gemma":[0.0000039117704,0.0000057350553,0.00007373581,0.00006166671,0.0000075494513,0.000027560445,0.000014577869,0.0040156776,0.000060368344,0.9928213,0.0029029888,0.000005069806],"about_ca_topic_score_codex":0.0009535181,"about_ca_topic_score_gemma":0.0007027086,"teacher_disagreement_score":0.9712174,"about_ca_system_score_codex":0.0023678907,"about_ca_system_score_gemma":0.0023151273,"threshold_uncertainty_score":0.1522187},"labels":[],"label_agreement":null},{"id":"W4406096298","doi":"10.1080/10618600.2024.2449074","title":"Simultaneous Estimation of Multiple Treatment Effects from Observational Studies","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Canadian Statistical Sciences Institute; Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Instrumental variable; Observational study; Inference; Confounding; Proxy (statistics); Robustness (evolution); Marginal structural model; Computer science; Econometrics; Exploit; Machine learning; Statistics; Mathematics; Data mining; Artificial intelligence","score_opus":0.11160337066313168,"score_gpt":0.42757067412792427,"score_spread":0.31596730346479257,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406096298","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061812876,0.0020580213,0.98847055,0.0013983753,0.00015745928,0.00032825346,0.00053125684,0.00017046739,0.000704365],"genre_scores_gemma":[0.33163235,0.0044659674,0.6547704,0.0022481494,0.0010077528,0.0022961397,0.0016508439,0.00011847925,0.0018098868],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93459207,0.052804183,0.0024216897,0.0059815706,0.0036003836,0.0006000714],"domain_scores_gemma":[0.765545,0.20635985,0.009546893,0.015478898,0.0023372215,0.00073203765],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06388178,0.0013291017,0.004271551,0.0031540375,0.0011630866,0.0034436896,0.0038054974,0.003154507,0.0044113505],"category_scores_gemma":[0.17412154,0.0016109647,0.004855346,0.004841257,0.0035277156,0.0031988155,0.0044228653,0.006248257,0.00055165385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011536842,0.00034944777,0.040029816,0.005625765,0.008023242,0.0013289883,0.001467003,0.10220194,0.0027452558,0.4733603,0.0075560333,0.35615847],"study_design_scores_gemma":[0.00050718174,0.0002580172,0.007930231,0.00064791506,0.001981964,0.00043264462,0.00016529075,0.14545035,0.001415591,0.83005065,0.011065319,0.00009486329],"about_ca_topic_score_codex":0.0032198832,"about_ca_topic_score_gemma":0.003506966,"teacher_disagreement_score":0.93611825,"about_ca_system_score_codex":0.0014540076,"about_ca_system_score_gemma":0.004456287,"threshold_uncertainty_score":0.33784312},"labels":[],"label_agreement":null},{"id":"W4406234762","doi":"10.1002/alz.092745","title":"What happens next? Repeated administration of a social and structural determinants of health questionnaire in an Alzheimer’s Disease Research Center","year":2024,"lang":"en","type":"article","venue":"Alzheimer s & Dementia","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Center (category theory); Disease; Administration (probate law); Psychology; Gerontology; Medicine; Clinical psychology; Political science; Pathology","score_opus":0.28456953624418424,"score_gpt":0.5049184064742167,"score_spread":0.22034887023003247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406234762","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9973465,0.00005857424,0.00040693473,0.00014945635,0.000025042611,0.00035215667,0.0010208474,0.000024522598,0.0006158834],"genre_scores_gemma":[0.9956118,0.00008092081,0.0015577936,0.00020853028,0.000030330055,0.00069772307,0.0010881824,0.00000609861,0.0007184782],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9968784,0.001523381,0.00048659986,0.0004039444,0.00041550776,0.00029224032],"domain_scores_gemma":[0.9911566,0.002052489,0.0036248995,0.0008227279,0.0013653821,0.0009779527],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0048498376,0.0003678565,0.0004975506,0.00084797124,0.00096274354,0.00078307674,0.0006163163,0.0006432275,0.0018357655],"category_scores_gemma":[0.009295062,0.00032609268,0.0006835896,0.0006496704,0.00032922585,0.0006640757,0.0007756242,0.0010453933,0.00054244447],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019101247,0.00050861586,0.99022865,0.000046633173,0.00009240936,0.00007940139,0.0010967328,0.000080507,0.0006257768,0.000022318409,0.0011174034,0.0059105284],"study_design_scores_gemma":[0.000025028465,0.0004801299,0.99676895,0.000016123171,0.000021427384,0.000078134595,0.0010046061,0.00032165073,0.00044912682,0.00003413754,0.0007835933,0.000016940696],"about_ca_topic_score_codex":0.005837766,"about_ca_topic_score_gemma":0.007850068,"teacher_disagreement_score":0.005837766,"about_ca_system_score_codex":0.0006771368,"about_ca_system_score_gemma":0.00084304955,"threshold_uncertainty_score":0.025648713},"labels":[],"label_agreement":null},{"id":"W4406234893","doi":"10.1002/alz.085900","title":"Estimating Potential Eligibility for Disease Modifying Therapies for Alzheimer’s Disease Using Population‐Based Data in Alberta, Canada","year":2024,"lang":"en","type":"article","venue":"Alzheimer s & Dementia","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; McGill University; Hotchkiss Brain Institute; University of Alberta; University of Calgary","funders":"","keywords":"Disease; Medicine; Alzheimer's disease; Population; Gerontology; Environmental health; Internal medicine","score_opus":0.20633603041511392,"score_gpt":0.435868251140564,"score_spread":0.22953222072545007,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406234893","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9174171,0.0050177,0.003681577,0.0019275899,0.00012562728,0.0005709993,0.062723495,0.00017266553,0.008363104],"genre_scores_gemma":[0.97532666,0.0015513521,0.0039169244,0.00044988625,0.000028968067,0.00014540444,0.016758805,0.00001691903,0.0018051829],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99639124,0.00062758796,0.0003507455,0.0004614169,0.001477427,0.0006916535],"domain_scores_gemma":[0.99044585,0.0014858521,0.0011565251,0.00036445478,0.005430956,0.0011162723],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045914417,0.0007393446,0.0008684008,0.0048005474,0.0020668476,0.0018251566,0.002572671,0.0006309616,0.0017819011],"category_scores_gemma":[0.010088924,0.0005736,0.0012878145,0.009639736,0.00081251946,0.00042148994,0.0011226422,0.00086446083,0.0003175312],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020938994,0.00006421962,0.9807287,0.0001339389,0.00033138154,0.00015925599,0.0002932721,0.0031875656,0.000102903134,0.0004777226,0.0056296326,0.008681964],"study_design_scores_gemma":[0.00010529623,0.00004150731,0.9847233,0.00019514652,0.00024307694,0.00010397348,0.0009405649,0.00956973,0.00014159689,0.00024282763,0.003645883,0.00004719664],"about_ca_topic_score_codex":0.998204,"about_ca_topic_score_gemma":0.9976847,"teacher_disagreement_score":0.0555653,"about_ca_system_score_codex":0.0555653,"about_ca_system_score_gemma":0.06481678,"threshold_uncertainty_score":0.40315634},"labels":[],"label_agreement":null},{"id":"W4406245583","doi":"10.1214/24-ejs2338","title":"Pseudo-empirical likelihood methods for causal inference","year":2025,"lang":"en","type":"article","venue":"Electronic Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Mathematics; Empirical likelihood; Causal inference; Inference; Econometrics; Statistics; Artificial intelligence; Estimator; Computer science","score_opus":0.09943190733000731,"score_gpt":0.522855835819901,"score_spread":0.42342392848989374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406245583","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00032825014,0.00031498584,0.998395,0.0001842177,0.000042077485,0.00008353588,0.00008282637,0.0001023953,0.00046662896],"genre_scores_gemma":[0.061264575,0.0018765139,0.9304169,0.000520583,0.00053130183,0.0019914084,0.0006235657,0.00029674853,0.0024783844],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95271415,0.0400923,0.0012881843,0.0021325124,0.0034432597,0.00032957146],"domain_scores_gemma":[0.8041922,0.17404135,0.0054152766,0.012034459,0.00382889,0.0004878618],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05034734,0.0022185335,0.0033885012,0.0050618015,0.0011315779,0.0037409323,0.0063355677,0.003562494,0.013941636],"category_scores_gemma":[0.21082592,0.001373711,0.003677588,0.0061346167,0.0046424605,0.006440348,0.004393968,0.006621293,0.0029062154],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008350832,0.000083318744,0.0014425496,0.00071458257,0.0004391404,0.0002201316,0.00029734574,0.035563167,0.00026262613,0.8456662,0.0028487155,0.11237876],"study_design_scores_gemma":[0.00007265337,0.000058616948,0.00040506182,0.00017856466,0.00007800875,0.00019444941,0.00006597045,0.18091239,0.00035279852,0.81039965,0.0072379652,0.00004377952],"about_ca_topic_score_codex":0.0020863446,"about_ca_topic_score_gemma":0.0016511958,"teacher_disagreement_score":0.05034734,"about_ca_system_score_codex":0.0017922497,"about_ca_system_score_gemma":0.0033496036,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"grok","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"opus","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W4406856354","doi":"10.2196/58981","title":"Methods to Adjust for Confounding in Test-Negative Design COVID-19 Effectiveness Studies: Simulation Study","year":2025,"lang":"en","type":"article","venue":"JMIR Formative Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Covariate; Confounding; Multivariable calculus; Propensity score matching; Logistic regression; Multinomial logistic regression; Statistics; Medicine; Demography; Mathematics; Engineering","score_opus":0.6385098421897869,"score_gpt":0.7123872341679632,"score_spread":0.07387739197817633,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406856354","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08307981,0.0032114335,0.89720726,0.0016942848,0.0003957191,0.0063827015,0.0016003058,0.00049527077,0.005933246],"genre_scores_gemma":[0.5890101,0.0014728636,0.3925034,0.0011620495,0.00017456501,0.012521095,0.0009642372,0.00012135501,0.0020702796],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89234257,0.10162721,0.0017584356,0.0018207916,0.0017655401,0.0006855376],"domain_scores_gemma":[0.5424169,0.42335516,0.014372916,0.012672685,0.0062473477,0.0009350405],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14207618,0.0018145337,0.0020130589,0.0018376792,0.0006179379,0.001782898,0.002482142,0.0028106892,0.009200259],"category_scores_gemma":[0.28520063,0.00095276296,0.005181694,0.0015037367,0.0010295234,0.0017694707,0.0022159952,0.0026966494,0.0005459051],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0077261943,0.0012645618,0.062707566,0.0033587106,0.009150847,0.00060185464,0.0007284974,0.708313,0.0006398869,0.081269644,0.0069869417,0.117252335],"study_design_scores_gemma":[0.0040627844,0.0029396545,0.0057679527,0.0013798482,0.002218682,0.0004329256,0.00018484848,0.91713184,0.00081855076,0.055927992,0.009007375,0.0001274458],"about_ca_topic_score_codex":0.004979278,"about_ca_topic_score_gemma":0.0035633706,"teacher_disagreement_score":0.8579238,"about_ca_system_score_codex":0.0022268922,"about_ca_system_score_gemma":0.003236846,"threshold_uncertainty_score":0.7513796},"labels":[],"label_agreement":null},{"id":"W4406936496","doi":"10.1007/s10654-024-01191-9","title":"Risks and rates, and the mathematical link between them","year":2025,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Medicine; Public health; Epidemiology; Link (geometry); Intensive care medicine; Environmental health; Internal medicine; Pathology","score_opus":0.39737497137081135,"score_gpt":0.4767041794445317,"score_spread":0.07932920807372035,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406936496","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05168847,0.011022075,0.88960284,0.02594504,0.0013429045,0.00021279855,0.002337631,0.00042245243,0.017425682],"genre_scores_gemma":[0.671157,0.02115947,0.26875594,0.0037393987,0.003086378,0.0010609162,0.0011709689,0.000277195,0.029592682],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.988936,0.0054073576,0.00081728515,0.0026205566,0.0017257943,0.0004929316],"domain_scores_gemma":[0.92780584,0.0605952,0.0064375247,0.0030814465,0.0015799591,0.0005000201],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01577888,0.0015480954,0.002049443,0.0046022767,0.00063109334,0.0065683085,0.003676168,0.004229498,0.012359379],"category_scores_gemma":[0.13165101,0.0016328441,0.0019277417,0.0043721437,0.005022844,0.015176186,0.0031346197,0.008174836,0.0019055371],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005273622,0.000055480963,0.0049564494,0.0002762464,0.00014226646,0.00015618924,0.00029444552,0.007762664,0.00019450397,0.9679607,0.0014773852,0.016670803],"study_design_scores_gemma":[0.000035375517,0.000034239223,0.001797626,0.000110781264,0.00012026019,0.000531171,0.00009862237,0.022195622,0.00013714994,0.97104317,0.0038606145,0.00003540468],"about_ca_topic_score_codex":0.002106519,"about_ca_topic_score_gemma":0.0014663802,"teacher_disagreement_score":0.01577888,"about_ca_system_score_codex":0.002108026,"about_ca_system_score_gemma":0.002072916,"threshold_uncertainty_score":0.083447695},"labels":[],"label_agreement":null},{"id":"W4407149091","doi":"10.1002/pds.70112","title":"Evaluating the Role of High‐Dimensional Proxy Data in Confounding Adjustment in Multiple Sclerosis Research: A Case Study","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Canadian Institutes of Health Research; Multiple Sclerosis Society of Canada","keywords":"Medicine; Propensity score matching; Confounding; Proportional hazards model; Hazard ratio; Proxy (statistics); Cohort study; Retrospective cohort study; Glatiramer acetate; Pharmacoepidemiology; Demography; Covariate; Cohort; Medical prescription; Population; Internal medicine; Disease; Confidence interval; Environmental health; Statistics; Pharmacology","score_opus":0.6246042941558562,"score_gpt":0.5871360786941076,"score_spread":0.03746821546174861,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407149091","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86660784,0.020085614,0.09898523,0.006938358,0.0003512564,0.0012744657,0.0005925539,0.00009642781,0.005068283],"genre_scores_gemma":[0.95417136,0.0019978867,0.042157773,0.0006855614,0.00014200604,0.00045455736,0.00013517101,0.000022955688,0.00023271726],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.6339645,0.3360495,0.009746821,0.004627526,0.014346436,0.0012652206],"domain_scores_gemma":[0.5050121,0.38316137,0.046611264,0.048028238,0.015900172,0.0012869635],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2179289,0.00077595457,0.0010786051,0.0018001187,0.0021090987,0.0037118206,0.0020932308,0.0016592591,0.00095448433],"category_scores_gemma":[0.2997963,0.0009095338,0.0025812958,0.0038378849,0.0035508333,0.0025886453,0.003985292,0.0019909495,0.00013248036],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000825177,0.00029359665,0.9372315,0.0006303923,0.002614703,0.0008018858,0.0022938247,0.002040306,0.00028198448,0.0066860155,0.0010094403,0.04529111],"study_design_scores_gemma":[0.0011208337,0.0062599983,0.8115439,0.004615776,0.011725749,0.012157436,0.0103039,0.068138525,0.0077163954,0.024985056,0.040876657,0.00055584806],"about_ca_topic_score_codex":0.01667065,"about_ca_topic_score_gemma":0.018512554,"teacher_disagreement_score":0.7820711,"about_ca_system_score_codex":0.0031387156,"about_ca_system_score_gemma":0.004778244,"threshold_uncertainty_score":0.9644329},"labels":[],"label_agreement":null},{"id":"W4407173849","doi":"10.1002/sim.70000","title":"Regression—A Means, Not an End","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Statistics; Regression; Regression analysis; Mathematics","score_opus":0.1246073718061269,"score_gpt":0.4895811887662412,"score_spread":0.3649738169601143,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407173849","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048833108,0.030949203,0.61562526,0.25506115,0.011610174,0.00020209647,0.0015456998,0.0017053535,0.078417785],"genre_scores_gemma":[0.27823862,0.054923248,0.4698322,0.0822936,0.03664217,0.0013173489,0.0016792457,0.003106848,0.07196672],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97846884,0.011610426,0.0011213262,0.003879528,0.0044747563,0.00044516288],"domain_scores_gemma":[0.9503317,0.02831773,0.002903665,0.013205174,0.004318414,0.00092333247],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027956713,0.0018568151,0.0032286488,0.0024788515,0.0027653596,0.011911838,0.0026945216,0.0044068377,0.011686993],"category_scores_gemma":[0.066279456,0.0012738112,0.0015429439,0.0019518611,0.018110774,0.021140438,0.0066259583,0.011370668,0.010327879],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015367847,0.00006413778,0.0018569605,0.00072882423,0.00026244178,0.0001013153,0.0006715777,0.0012043878,0.00055244134,0.8522466,0.052914966,0.08924272],"study_design_scores_gemma":[0.00003306888,0.00009947698,0.00078783894,0.0008146671,0.000074595184,0.00021423721,0.0003649621,0.003450495,0.0007025951,0.89803416,0.09534507,0.00007886857],"about_ca_topic_score_codex":0.0012132515,"about_ca_topic_score_gemma":0.001528043,"teacher_disagreement_score":0.027956713,"about_ca_system_score_codex":0.0021107541,"about_ca_system_score_gemma":0.003950087,"threshold_uncertainty_score":0.14785099},"labels":[],"label_agreement":null},{"id":"W4407241761","doi":"10.1016/j.jclinepi.2025.111716","title":"Using methods to extend inferences to specific target populations to improve the precision of subgroup analyses","year":2025,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Aging; Vetenskapsrådet; Forté Foundation","keywords":"Statistics; Econometrics; Medicine; Mathematics; Computer science","score_opus":0.8483721148779694,"score_gpt":0.7299655129983066,"score_spread":0.11840660187966279,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407241761","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025657706,0.0009343828,0.99340594,0.00067282096,0.00023983435,0.0005602635,0.00035997597,0.0006133491,0.0006476373],"genre_scores_gemma":[0.13824625,0.0012402398,0.85252845,0.0015879134,0.0005867519,0.0035090612,0.0008666795,0.0005073645,0.0009273654],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7926434,0.18014784,0.008497474,0.011033751,0.006877416,0.0008001887],"domain_scores_gemma":[0.47904158,0.4495453,0.0129731335,0.050650265,0.007229166,0.0005604757],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.22262548,0.0034272142,0.0041017053,0.0059259767,0.0013914978,0.0047840164,0.0040538604,0.0034690055,0.0054777623],"category_scores_gemma":[0.52751416,0.0018578237,0.010056379,0.004621053,0.0027679945,0.00459003,0.0059846034,0.0075452086,0.0010856397],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021119108,0.00026919183,0.03876958,0.007449035,0.038249463,0.0008219222,0.0031855588,0.15624367,0.004027753,0.13229711,0.013619887,0.6029549],"study_design_scores_gemma":[0.0017841503,0.0008957725,0.009076767,0.0024788245,0.010047539,0.00061553123,0.00044296254,0.4104648,0.006973336,0.5170006,0.03985689,0.00036294496],"about_ca_topic_score_codex":0.0042209597,"about_ca_topic_score_gemma":0.0033767682,"teacher_disagreement_score":0.7773745,"about_ca_system_score_codex":0.0018452178,"about_ca_system_score_gemma":0.0038565889,"threshold_uncertainty_score":0.9586412},"labels":[],"label_agreement":null},{"id":"W4407262364","doi":"10.1002/sim.70009","title":"Inverse Probability of Treatment Weighting Using the Propensity Score With Competing Risks in Survival Analysis","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Inverse probability weighting; Inverse probability; Statistics; Weighting; Survival analysis; Econometrics; Inverse; Average treatment effect; Computer science; Posterior probability; Mathematics; Medicine; Bayesian probability","score_opus":0.3133595065600282,"score_gpt":0.4585707417670098,"score_spread":0.1452112352069816,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407262364","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010381333,0.00091188424,0.9863024,0.00050577405,0.00015046699,0.00086957106,0.00014268621,0.00015447271,0.0005814027],"genre_scores_gemma":[0.2972577,0.0013887846,0.69482034,0.0005318099,0.00029119282,0.004337751,0.00038158428,0.0001295278,0.0008613161],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.87236094,0.11398224,0.0039700647,0.0036779302,0.0052146865,0.000794175],"domain_scores_gemma":[0.90004545,0.0761983,0.009461967,0.01019146,0.0035219032,0.00058091374],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09151755,0.0012332745,0.002280286,0.0037967418,0.00073613424,0.0028589405,0.0024817996,0.0024866892,0.0029655613],"category_scores_gemma":[0.19616625,0.0009584384,0.0046631615,0.005011166,0.002634172,0.0029683104,0.0039003599,0.00426157,0.000345077],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013615149,0.0004963898,0.056466352,0.0020047512,0.00480065,0.0005062932,0.0016062767,0.210506,0.0013898077,0.2803167,0.006586877,0.43395832],"study_design_scores_gemma":[0.001125556,0.0014072354,0.016260859,0.0009177076,0.0013897349,0.0005906212,0.0002247537,0.5754505,0.002612992,0.3848627,0.014813914,0.00034350785],"about_ca_topic_score_codex":0.0032428454,"about_ca_topic_score_gemma":0.002188918,"teacher_disagreement_score":0.09151755,"about_ca_system_score_codex":0.0017898984,"about_ca_system_score_gemma":0.00338511,"threshold_uncertainty_score":0.48399687},"labels":[],"label_agreement":null},{"id":"W4407289331","doi":"10.1016/j.cjca.2025.02.012","title":"On the Consistency Assumption for Causal Inference in Cardiovascular Epidemiology: Reply","year":2025,"lang":"en","type":"letter","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Toronto; Public Health Ontario","funders":"","keywords":"Medicine; Causal inference; Consistency (knowledge bases); Epidemiology; Inference; Internal medicine; Artificial intelligence; Pathology","score_opus":0.20135572875256627,"score_gpt":0.39214995943747505,"score_spread":0.19079423068490878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407289331","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000074813885,0.0006278111,0.00023633655,0.9933981,0.0053927707,0.000004110093,0.000049753497,0.000007663221,0.00020870614],"genre_scores_gemma":[0.0019350491,0.0007047099,0.00051430095,0.9642727,0.03180155,0.000036573554,0.000024692023,0.000017436183,0.00069291616],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98754823,0.00561086,0.0020469157,0.0019113078,0.0022842987,0.00059841806],"domain_scores_gemma":[0.81564057,0.16082962,0.003444319,0.0034595628,0.0127250245,0.003900876],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026520312,0.0011468438,0.0035987985,0.001709294,0.0040684487,0.00496294,0.0044698524,0.083377376,0.007095824],"category_scores_gemma":[0.17285757,0.0013559232,0.001906221,0.0019166005,0.011234901,0.009753281,0.003951273,0.107182235,0.004101409],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012256434,0.000030556752,0.0008430205,0.00014380465,0.00007231523,0.00060765387,0.00031643556,0.00015436213,0.00009687523,0.0131347785,0.97712266,0.0073549305],"study_design_scores_gemma":[0.0011255502,0.000118189906,0.0042056176,0.0016703983,0.0002788234,0.0023069794,0.001606565,0.0027668392,0.00049857853,0.21626946,0.76872164,0.0004313883],"about_ca_topic_score_codex":0.015607365,"about_ca_topic_score_gemma":0.014982321,"teacher_disagreement_score":0.083377376,"about_ca_system_score_codex":0.0055184853,"about_ca_system_score_gemma":0.0068744053,"threshold_uncertainty_score":0.1402545},"labels":[],"label_agreement":null},{"id":"W4407318751","doi":"10.1016/j.cmpb.2025.108658","title":"Methods in dynamic treatment regimens using observational healthcare data: A systematic review","year":2025,"lang":"en","type":"review","venue":"Computer Methods and Programs in Biomedicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Alberta Innovates; Alberta Machine Intelligence Institute; Natural Sciences and Engineering Research Council of Canada; Canadian Institute for Advanced Research","keywords":"Observational study; Computer science; Health care; Intensive care medicine; Medicine; Data science; Internal medicine","score_opus":0.7636693510484898,"score_gpt":0.6750781406282522,"score_spread":0.08859121042023754,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407318751","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011254894,0.989247,0.004484737,0.0006681933,0.00028201615,0.0026681877,0.0009536844,0.000049266942,0.0005213022],"genre_scores_gemma":[0.04930191,0.9145374,0.020259636,0.0019826202,0.00026560124,0.012127296,0.0012423325,0.000050564046,0.00023263521],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.87233824,0.07860436,0.030195015,0.005593241,0.012479584,0.0007895365],"domain_scores_gemma":[0.617388,0.33711815,0.02784229,0.006918697,0.0102181975,0.00051473116],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09562594,0.0029314726,0.010329225,0.009869352,0.00095881685,0.005266832,0.0039392505,0.0029954996,0.006117027],"category_scores_gemma":[0.31243384,0.002486125,0.019402076,0.010623448,0.0018630329,0.005729774,0.0029378417,0.0030296464,0.0006734565],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029285692,0.000036571608,0.0012231983,0.9139082,0.02056608,0.000048324593,0.00024009455,0.0005636057,0.00004919934,0.0009263646,0.0013957692,0.060749784],"study_design_scores_gemma":[0.0006458725,0.00023377044,0.0024410905,0.91986305,0.05911586,0.00013440923,0.00025237133,0.0005995843,0.00021266719,0.0017830722,0.014642772,0.000075580174],"about_ca_topic_score_codex":0.009771955,"about_ca_topic_score_gemma":0.017912915,"teacher_disagreement_score":0.90437406,"about_ca_system_score_codex":0.007677876,"about_ca_system_score_gemma":0.020595064,"threshold_uncertainty_score":0.5057243},"labels":[],"label_agreement":null},{"id":"W4407402000","doi":"10.1101/2025.02.09.25321976","title":"Data-Driven Insights on Opioid Use and Health Behavior Trends Following Decriminalization: Zero-Shot Sentiment and Behavior Analysis","year":2025,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Schwartz/Reisman Emergency Medicine Institute; University of Toronto","funders":"Canadian Institutes of Health Research; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Decriminalization; Zero (linguistics); Shot (pellet); Psychology; Criminology; Chemistry","score_opus":0.3404336173703156,"score_gpt":0.4710067046048623,"score_spread":0.13057308723454675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407402000","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8713865,0.00047211625,0.10927268,0.0031577616,0.00013321108,0.00025217453,0.0069621485,0.0005547396,0.0078086695],"genre_scores_gemma":[0.9637056,0.000094144394,0.031170268,0.00023180679,0.000058719757,0.00013935912,0.0030505902,0.00004725308,0.0015022269],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.998684,0.0008223567,0.00005480473,0.000198644,0.00017501172,0.00006524386],"domain_scores_gemma":[0.9855042,0.01223476,0.0007810054,0.0006354254,0.0006983283,0.00014627166],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034581625,0.00026363894,0.00022330947,0.0015069325,0.00053534564,0.0010889678,0.00042999658,0.00046165867,0.0023994744],"category_scores_gemma":[0.016494727,0.00012332424,0.00038193347,0.0010670379,0.0007154261,0.0010661255,0.0009207263,0.0009682397,0.0005835134],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001088787,0.00092270394,0.48469082,0.0011481955,0.000315621,0.00086589454,0.02356873,0.020486714,0.031038715,0.039141964,0.021026516,0.3757054],"study_design_scores_gemma":[0.00005367163,0.0003452629,0.33996847,0.00026766982,0.00009597969,0.00032250278,0.013726241,0.51740545,0.010702167,0.08841073,0.028583813,0.000117970034],"about_ca_topic_score_codex":0.005880277,"about_ca_topic_score_gemma":0.007518095,"teacher_disagreement_score":0.005880277,"about_ca_system_score_codex":0.00081055606,"about_ca_system_score_gemma":0.0004836886,"threshold_uncertainty_score":0.018288732},"labels":[],"label_agreement":null},{"id":"W4407815305","doi":"10.1093/wber/lhaf004","title":"Does It Matter Who You Ask For Time Use Data?","year":2025,"lang":"en","type":"article","venue":"The World Bank Economic Review","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Ask price; Economics; Economy","score_opus":0.1377301586154332,"score_gpt":0.41703798619254956,"score_spread":0.27930782757711636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407815305","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5223224,0.02580596,0.048985556,0.14134838,0.008069028,0.00075062894,0.15959817,0.00069253467,0.092427246],"genre_scores_gemma":[0.9209242,0.008945553,0.010057631,0.0120212445,0.0021536178,0.0009485515,0.02900187,0.00041387175,0.015533489],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9854748,0.008538,0.001798163,0.0009762826,0.0024601438,0.0007526367],"domain_scores_gemma":[0.9098443,0.052059013,0.015449991,0.0063789436,0.014322228,0.0019455476],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.011985281,0.00021568686,0.0006086465,0.002101306,0.00057845964,0.002774011,0.00085903483,0.0007258578,0.013615448],"category_scores_gemma":[0.106871195,0.00026252426,0.00064945646,0.0075251004,0.0008419621,0.0020880278,0.00070193555,0.0014283226,0.0071225176],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042289554,0.00013369582,0.6602765,0.001416649,0.00035574037,0.00012434222,0.0038595388,0.00059751316,0.00038599438,0.011289854,0.16979836,0.15133898],"study_design_scores_gemma":[0.00006747481,0.0001547483,0.6721599,0.0029224562,0.00028550802,0.00047476197,0.0119747715,0.0023492575,0.002372183,0.010625963,0.29646122,0.00015179964],"about_ca_topic_score_codex":0.014336518,"about_ca_topic_score_gemma":0.010887909,"teacher_disagreement_score":0.9880147,"about_ca_system_score_codex":0.0011642628,"about_ca_system_score_gemma":0.0015337805,"threshold_uncertainty_score":0.06338501},"labels":[],"label_agreement":null},{"id":"W4408028303","doi":"10.2139/ssrn.5146292","title":"Improving Targeting Policies Using Transfer Learning","year":2025,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Transfer of learning; Policy learning; Computer science; Artificial intelligence; Machine learning","score_opus":0.08629939527334263,"score_gpt":0.3893813575189802,"score_spread":0.30308196224563755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408028303","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026812755,0.0003683428,0.96611905,0.0012888539,0.00012147998,0.00006271415,0.000114391856,0.0010966616,0.0040157563],"genre_scores_gemma":[0.86682117,0.00050272397,0.12283815,0.0006293193,0.00031316042,0.00018667225,0.00029640654,0.00030159255,0.008110843],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99738055,0.0014234217,0.0000968561,0.0004869281,0.00034493982,0.00026720518],"domain_scores_gemma":[0.97238785,0.023421306,0.0010965244,0.0017207497,0.00093681645,0.0004366657],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0053025465,0.0013880756,0.0021603259,0.0015103042,0.00086759985,0.0018470391,0.0019128823,0.0036554344,0.008520261],"category_scores_gemma":[0.04186757,0.0009543957,0.00094146526,0.0014823441,0.0014998806,0.005047018,0.0027304317,0.004667337,0.0016325924],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046576708,0.00041251024,0.0021817193,0.00025400642,0.00015745334,0.00012745732,0.00016435915,0.72329664,0.0019629549,0.106813505,0.007655144,0.15650849],"study_design_scores_gemma":[0.000029328772,0.00003305299,0.00011522158,0.000012312556,0.000018035997,0.0000117681,0.00001032711,0.92569035,0.0005257567,0.07320445,0.00034244137,0.00000691462],"about_ca_topic_score_codex":0.0029934323,"about_ca_topic_score_gemma":0.0019324834,"teacher_disagreement_score":0.008520261,"about_ca_system_score_codex":0.0014785089,"about_ca_system_score_gemma":0.002541019,"threshold_uncertainty_score":0.02850318},"labels":[],"label_agreement":null},{"id":"W4408119906","doi":"10.1161/circoutcomes.124.011188","title":"Association Between Use of WATCHMAN Device and 1-Year Mortality Using High-Dimensional Propensity Scores to Reduce Confounding","year":2025,"lang":"en","type":"article","venue":"Circulation Cardiovascular Quality and Outcomes","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; McGill University Health Centre","funders":"","keywords":"Medicine; Atrial fibrillation; Propensity score matching; Hazard ratio; Cohort; Confounding; Internal medicine; Left atrial appendage occlusion; Stroke (engine); Cohort study; Observational study; Proportional hazards model; Warfarin; Percutaneous coronary intervention; Cardiology; Confidence interval; Myocardial infarction","score_opus":0.3540911417097541,"score_gpt":0.45313742823230146,"score_spread":0.09904628652254738,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408119906","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91074497,0.000924604,0.084923625,0.0007914797,0.00008657762,0.00039532548,0.0010823555,0.000119998615,0.0009311407],"genre_scores_gemma":[0.9861347,0.00012770877,0.012895579,0.00008457586,0.00003379521,0.00013868131,0.00042198898,0.000007844649,0.00015512356],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9913071,0.005615783,0.0007842036,0.0012181632,0.0008297198,0.0002451214],"domain_scores_gemma":[0.98003906,0.009229334,0.0063284156,0.0029161086,0.0009776603,0.0005094905],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012864528,0.0006276216,0.0005303677,0.0017835592,0.00038717722,0.0009856777,0.0007520889,0.00050390756,0.0013068229],"category_scores_gemma":[0.02687152,0.0003048547,0.002522523,0.0017703435,0.00056293065,0.0008035888,0.0011712478,0.001046796,0.0001349701],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034512574,0.00011226572,0.9718422,0.0000690916,0.0019673863,0.00004125482,0.0000905485,0.0049839835,0.00021644613,0.00088034675,0.00053736253,0.01891397],"study_design_scores_gemma":[0.00025779396,0.001121248,0.8621079,0.00008835137,0.00190776,0.00027953982,0.00015476292,0.12383938,0.0013145742,0.0065418473,0.0022983565,0.00008843432],"about_ca_topic_score_codex":0.0023028804,"about_ca_topic_score_gemma":0.0026119158,"teacher_disagreement_score":0.012864528,"about_ca_system_score_codex":0.00055702945,"about_ca_system_score_gemma":0.0010018145,"threshold_uncertainty_score":0.06803495},"labels":[],"label_agreement":null},{"id":"W4408251803","doi":"10.1016/j.annepidem.2025.03.001","title":"Systematic review of applied transportability and generalizability analyses: A landscape analysis","year":2025,"lang":"en","type":"review","venue":"Annals of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St. Paul's Hospital; Willow Biosciences (Canada)","funders":"","keywords":"Generalizability theory; Medicine; Statistics","score_opus":0.5609992239350639,"score_gpt":0.5951165765724884,"score_spread":0.03411735263742455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408251803","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021856736,0.7665168,0.1245358,0.01064669,0.0012804203,0.04360886,0.020806909,0.0008669167,0.00988081],"genre_scores_gemma":[0.4156051,0.24764746,0.1899131,0.010974016,0.0009912361,0.11876132,0.01409503,0.0006802557,0.0013325615],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.40918973,0.35328886,0.16447575,0.017557504,0.052930925,0.0025572428],"domain_scores_gemma":[0.20220105,0.66628635,0.067771174,0.033640865,0.029394366,0.0007061632],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39271325,0.0034967195,0.0126710925,0.042787068,0.0026468062,0.009640675,0.005750402,0.00408224,0.0077080484],"category_scores_gemma":[0.7080605,0.0030037074,0.028742265,0.051986948,0.0045654722,0.011096852,0.008504694,0.0031869507,0.0008607161],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007493975,0.000059814247,0.02007405,0.7360234,0.11690087,0.00057068275,0.0022152297,0.0023175557,0.00045961025,0.008231762,0.0064907726,0.10590675],"study_design_scores_gemma":[0.0014120745,0.00059232616,0.025648605,0.64273757,0.2369044,0.00089662336,0.0018050143,0.004071334,0.0010251554,0.033496864,0.051098052,0.0003119896],"about_ca_topic_score_codex":0.008272717,"about_ca_topic_score_gemma":0.016504483,"teacher_disagreement_score":0.60728675,"about_ca_system_score_codex":0.012235287,"about_ca_system_score_gemma":0.023120994,"threshold_uncertainty_score":0.74889266},"labels":[],"label_agreement":null},{"id":"W4408297730","doi":"10.1017/rsm.2025.2","title":"Effect modification and non-collapsibility together may lead to conflicting treatment decisions: A review of marginal and conditional estimands and recommendations for decision-making","year":2025,"lang":"en","type":"review","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; SickKids Foundation; Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Medical Research Council","keywords":"Lead (geology); Marginal structural model; Computer science; Risk analysis (engineering); Actuarial science; Econometrics; Economics; Business; Causal inference","score_opus":0.536206654897272,"score_gpt":0.6934173618985573,"score_spread":0.15721070700128525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408297730","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00019078585,0.983799,0.007892624,0.00646021,0.0005500114,0.00013933548,0.000094446565,0.00003272957,0.0008407994],"genre_scores_gemma":[0.013085179,0.9441676,0.03084363,0.008790619,0.001345683,0.0009571933,0.00019824231,0.00007623631,0.00053572387],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9295043,0.04487207,0.013248528,0.003642767,0.008175113,0.00055721385],"domain_scores_gemma":[0.69346565,0.2834525,0.009232563,0.003101707,0.010134978,0.00061256683],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09206721,0.0022461475,0.007708906,0.006031558,0.001036026,0.0053033507,0.0057868515,0.0043916837,0.0039373217],"category_scores_gemma":[0.21593593,0.0017632365,0.011267093,0.005170166,0.0044357,0.0051794522,0.0023982306,0.007839501,0.0007020717],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044846637,0.00007666547,0.0013508452,0.16367605,0.010776725,0.000256412,0.00088418444,0.0018082401,0.000231289,0.036825273,0.021803938,0.761862],"study_design_scores_gemma":[0.00045385386,0.000375448,0.0034095768,0.46658808,0.035629824,0.001479212,0.0006103466,0.0032701828,0.0011837528,0.14413771,0.34251407,0.0003479143],"about_ca_topic_score_codex":0.007225943,"about_ca_topic_score_gemma":0.011673172,"teacher_disagreement_score":0.90793276,"about_ca_system_score_codex":0.0066665346,"about_ca_system_score_gemma":0.011803856,"threshold_uncertainty_score":0.4869038},"labels":[],"label_agreement":null},{"id":"W4408320751","doi":"10.1002/cjs.70000","title":"Sample empirical likelihood methods for causal inference","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Inference; Empirical likelihood; Sample (material); Econometrics; Computer science; Statistics; Mathematics; Artificial intelligence","score_opus":0.209577783021491,"score_gpt":0.5161440346327254,"score_spread":0.3065662516112344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408320751","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005272467,0.00031313635,0.99807703,0.00019524296,0.000029458897,0.00008396814,0.000083317165,0.00011884521,0.0005718182],"genre_scores_gemma":[0.09519302,0.0015138511,0.89663607,0.00030021014,0.00038091344,0.0020304827,0.0007207541,0.00029814243,0.0029265843],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9577995,0.036408316,0.000965079,0.0017085116,0.0027252592,0.00039345038],"domain_scores_gemma":[0.6918645,0.2889913,0.004957195,0.009194745,0.0043570157,0.0006352856],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.064978965,0.0023646948,0.0035776307,0.006123629,0.0012335242,0.0039078994,0.006075066,0.0032134433,0.013725702],"category_scores_gemma":[0.24944352,0.0016406844,0.0028987247,0.0062951646,0.0054444084,0.0060935696,0.00436872,0.00789956,0.0017569102],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008335045,0.00009676413,0.0015666285,0.00047303975,0.00032444615,0.00020886963,0.0003104998,0.0860839,0.00017033468,0.8439171,0.0028726961,0.063892476],"study_design_scores_gemma":[0.00006612951,0.000033640892,0.00034660325,0.0001450096,0.000044782817,0.000069424124,0.00006445578,0.33775797,0.000222154,0.6576124,0.0036104128,0.000027025568],"about_ca_topic_score_codex":0.006196783,"about_ca_topic_score_gemma":0.0038518966,"teacher_disagreement_score":0.064978965,"about_ca_system_score_codex":0.0032742664,"about_ca_system_score_gemma":0.003804391,"threshold_uncertainty_score":0.3436457},"labels":[],"label_agreement":null},{"id":"W4408340192","doi":"10.1002/cjs.70001","title":"Doubly robust criterion for causal inference","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Causal inference; Inference; Computer science; Mathematics; Artificial intelligence; Econometrics","score_opus":0.16039079229112435,"score_gpt":0.40598532928507336,"score_spread":0.245594536993949,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408340192","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038552172,0.00032335427,0.9932161,0.00042301783,0.00006112248,0.00007096942,0.00023434241,0.00013076761,0.0016851154],"genre_scores_gemma":[0.3614935,0.0011051381,0.62790096,0.0008304519,0.00058774214,0.0008763448,0.001742754,0.00035541333,0.005107647],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9825415,0.011142363,0.00097578013,0.0015030588,0.0034180842,0.00041933515],"domain_scores_gemma":[0.89660245,0.08067436,0.0043069124,0.0068347496,0.01064702,0.00093457685],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026826693,0.0010627259,0.0021680242,0.00452132,0.0010145496,0.0023818496,0.002860764,0.0023631654,0.008068637],"category_scores_gemma":[0.11178796,0.00060443394,0.0018102239,0.0027228505,0.0033920247,0.003096744,0.0028974323,0.0034240982,0.0011591463],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014277882,0.00009600126,0.0022194125,0.00040786955,0.00031848345,0.00021490111,0.0001473232,0.14735438,0.0010074826,0.78383034,0.0041325716,0.060128503],"study_design_scores_gemma":[0.0000376182,0.00007607264,0.0008076862,0.00011667325,0.00005308463,0.00012685734,0.00002824519,0.54776675,0.000926796,0.4470362,0.0029739027,0.000050080238],"about_ca_topic_score_codex":0.0029553222,"about_ca_topic_score_gemma":0.0013228416,"teacher_disagreement_score":0.9731733,"about_ca_system_score_codex":0.0022212437,"about_ca_system_score_gemma":0.0038929288,"threshold_uncertainty_score":0.14187479},"labels":[],"label_agreement":null},{"id":"W4408408683","doi":"10.1002/sim.70034","title":"Guidelines and Best Practices for the Use of Targeted Maximum Likelihood and Machine Learning When Estimating Causal Effects of Exposures on Time‐To‐Event Outcomes","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Université de Montréal; Institut National de Santé Publique du Québec; Université Laval","funders":"Canadian Institutes of Health Research; Canada Research Chairs; Fonds de Recherche du Québec - Santé; International Society for Pharmacoepidemiology","keywords":"Computer science; Outcome (game theory); Machine learning; Counterfactual thinking; Event (particle physics); Causal inference; Covariate; A priori and a posteriori; Artificial intelligence; Data mining; Statistics","score_opus":0.16736663226226037,"score_gpt":0.4647206712009353,"score_spread":0.29735403893867496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408408683","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007541157,0.0062302537,0.9473961,0.0066751908,0.0008687826,0.00096309336,0.0072229453,0.016165946,0.01372353],"genre_scores_gemma":[0.00408799,0.0058806487,0.96662116,0.003047697,0.00041697518,0.0035970712,0.004747573,0.006188829,0.0054121013],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9712355,0.018150482,0.0041303374,0.0016255353,0.004416645,0.00044140406],"domain_scores_gemma":[0.85315865,0.11806927,0.004535336,0.010785911,0.012026663,0.001424219],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.029976755,0.0031585882,0.0021224166,0.006100195,0.0011117879,0.0046556913,0.0060041677,0.0068896445,0.062241163],"category_scores_gemma":[0.16925088,0.0029589676,0.0037541026,0.005626542,0.0019980976,0.004420984,0.0035527623,0.007838032,0.051685583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020045166,0.0003246097,0.0016869914,0.006498113,0.00030235,0.0011411549,0.0015419202,0.015831111,0.002497226,0.12863722,0.45901904,0.38231975],"study_design_scores_gemma":[0.00025522924,0.00012980468,0.0014238366,0.0058198003,0.00012569396,0.0017881104,0.00029685395,0.024358071,0.004138627,0.24326523,0.718121,0.00027784315],"about_ca_topic_score_codex":0.0058073425,"about_ca_topic_score_gemma":0.009070295,"teacher_disagreement_score":0.9700233,"about_ca_system_score_codex":0.0018416888,"about_ca_system_score_gemma":0.005642826,"threshold_uncertainty_score":0.20821744},"labels":[],"label_agreement":null},{"id":"W4408502051","doi":"10.1038/s41592-025-02629-y","title":"Propensity score weighting","year":2025,"lang":"en","type":"article","venue":"Nature Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canada's Michael Smith Genome Sciences Centre","funders":"","keywords":"Propensity score matching; Weighting; Computational biology; Computer science; Biology; Internal medicine; Medicine","score_opus":0.2518400596419759,"score_gpt":0.5445541503713819,"score_spread":0.29271409072940596,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408502051","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022689449,0.00026638884,0.98543036,0.0005372823,0.00023499341,0.00032320071,0.00062965334,0.0004562675,0.009852873],"genre_scores_gemma":[0.22969073,0.0012470859,0.69001496,0.0015954623,0.0009857276,0.0022973302,0.0035294308,0.0006745622,0.069964655],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99184215,0.0050641885,0.00032031586,0.0012971865,0.0011595563,0.0003165889],"domain_scores_gemma":[0.99074954,0.0041808146,0.00057315925,0.0032018416,0.0010536202,0.00024099156],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008891935,0.0009511694,0.0016249446,0.0026434325,0.0009577711,0.0027618783,0.0019231234,0.0020192964,0.044218335],"category_scores_gemma":[0.04107661,0.00063604786,0.0018806563,0.0033207182,0.00089516945,0.0022066778,0.0021270015,0.0024959655,0.010877986],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017237877,0.00021161517,0.0031963089,0.00023370112,0.00042474235,0.000094042836,0.00009739688,0.012845052,0.00061629736,0.6380492,0.03732197,0.3067373],"study_design_scores_gemma":[0.000209397,0.00013122399,0.0019942014,0.00014913027,0.0002697546,0.00037065125,0.000052790383,0.104512796,0.0010886604,0.8305981,0.060576376,0.000047060592],"about_ca_topic_score_codex":0.0016818974,"about_ca_topic_score_gemma":0.0021066333,"teacher_disagreement_score":0.044218335,"about_ca_system_score_codex":0.00071832887,"about_ca_system_score_gemma":0.0026580642,"threshold_uncertainty_score":0.14792508},"labels":[],"label_agreement":null},{"id":"W4408540877","doi":"10.1093/ofid/ofaf173","title":"Quantifying Potential Immortal Time Bias in Observational Studies in Acute Severe Infection","year":2025,"lang":"en","type":"article","venue":"Open Forum Infectious Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Infection and Immunity","funders":"Medical Research Council; National Institute for Health and Care Research; Wellcome Trust","keywords":"Medicine; Observational study; Intensive care medicine; Internal medicine","score_opus":0.2998184884738356,"score_gpt":0.4849450123111662,"score_spread":0.18512652383733064,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408540877","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07201148,0.01886706,0.8733115,0.0069123497,0.001689319,0.0024769083,0.013607999,0.005625119,0.0054981704],"genre_scores_gemma":[0.62134576,0.002904608,0.35270554,0.004884734,0.0009238236,0.007143329,0.006598232,0.0019258324,0.0015681213],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7429272,0.22043939,0.017404567,0.009741203,0.008477215,0.001010439],"domain_scores_gemma":[0.19595426,0.73700285,0.028566658,0.03082658,0.006860998,0.0007886254],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24597853,0.0018553098,0.0020279912,0.0057238685,0.0009265239,0.0045179734,0.0037475654,0.0026337649,0.0060837152],"category_scores_gemma":[0.6445187,0.001408562,0.007943753,0.005046142,0.002362699,0.0025286302,0.005675104,0.0029464245,0.0007944366],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003176773,0.00016759674,0.40978706,0.023656566,0.040459987,0.0013197674,0.0061821314,0.1147992,0.001966309,0.06169096,0.037250057,0.29954362],"study_design_scores_gemma":[0.0017515555,0.0015228022,0.1302679,0.013848239,0.025160132,0.0039617033,0.0013378409,0.2703242,0.011750556,0.39860952,0.1404447,0.0010208718],"about_ca_topic_score_codex":0.002985285,"about_ca_topic_score_gemma":0.0029850136,"teacher_disagreement_score":0.75402147,"about_ca_system_score_codex":0.0017600367,"about_ca_system_score_gemma":0.0045826565,"threshold_uncertainty_score":0.9298427},"labels":[],"label_agreement":null},{"id":"W4408615022","doi":"10.1287/msom.2023.0548","title":"Policy Optimization for Personalized Interventions in Behavioral Health","year":2025,"lang":"en","type":"article","venue":"Manufacturing & Service Operations Management","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Psychological intervention; Personalized medicine; Business; Computer science; Operations management; Economics; Medicine; Nursing","score_opus":0.13566382763771526,"score_gpt":0.4651434924299436,"score_spread":0.32947966479222834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408615022","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013691021,0.0018665747,0.9656371,0.0069044204,0.00030293872,0.0004563428,0.00042131136,0.0003896649,0.010330672],"genre_scores_gemma":[0.6438734,0.0030954927,0.33090314,0.0027655247,0.00068216474,0.0027979692,0.00085084134,0.00044593567,0.014585558],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9927898,0.0046511944,0.00020668753,0.0011906393,0.0006750055,0.00048678415],"domain_scores_gemma":[0.96097606,0.03594079,0.0012193425,0.00062069297,0.0008156898,0.0004274671],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009135166,0.002724178,0.0037213832,0.0013740545,0.0009393686,0.0026695547,0.0023394611,0.004737704,0.01012037],"category_scores_gemma":[0.038612098,0.0015285042,0.0020064206,0.0015614369,0.0044695744,0.0032047536,0.002695216,0.005870587,0.0009004257],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015179907,0.00016006167,0.00079786364,0.0004217357,0.00011656533,0.000098926015,0.00012232403,0.87994695,0.00017292191,0.10124193,0.0033194518,0.01344939],"study_design_scores_gemma":[0.000085024876,0.000071248694,0.0001954885,0.00007427496,0.000028238494,0.000021997072,0.00003449228,0.92019093,0.00016095836,0.077470355,0.0016484334,0.000018530724],"about_ca_topic_score_codex":0.01072166,"about_ca_topic_score_gemma":0.004271594,"teacher_disagreement_score":0.01072166,"about_ca_system_score_codex":0.0054370025,"about_ca_system_score_gemma":0.006710261,"threshold_uncertainty_score":0.04831201},"labels":[],"label_agreement":null},{"id":"W4408884128","doi":"10.1001/jamanetworkopen.2025.2152","title":"Quantitative Bias Analysis for Single-Arm Trials With External Control Arms","year":2025,"lang":"en","type":"article","venue":"JAMA Network Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto","funders":"","keywords":"Confounding; Hazard ratio; Observational study; Randomized controlled trial; Medicine; Hazard; Statistics; Confidence interval; Internal medicine; Mathematics","score_opus":0.4142205521263314,"score_gpt":0.49229273442198207,"score_spread":0.07807218229565066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408884128","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064538666,0.024562893,0.9050786,0.009244403,0.0055405167,0.038591452,0.0036276977,0.0014098873,0.005490628],"genre_scores_gemma":[0.19950221,0.003767032,0.67498994,0.009212763,0.002079824,0.10730136,0.0016181952,0.00048252047,0.0010461502],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.0899179,0.81614536,0.056557804,0.012046452,0.02453766,0.00079484744],"domain_scores_gemma":[0.04799454,0.8439722,0.050217066,0.044970352,0.012216674,0.00062911207],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.769436,0.0047590127,0.012409546,0.010432909,0.0021305801,0.0111180805,0.00776792,0.00936603,0.009915144],"category_scores_gemma":[0.8915393,0.0027489383,0.027100634,0.01092816,0.009115583,0.009725792,0.008107289,0.009979814,0.0014676285],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0144449435,0.0006038069,0.049538247,0.1569277,0.21865933,0.0007954457,0.0042085536,0.03557741,0.0017604895,0.17506355,0.032521565,0.30989894],"study_design_scores_gemma":[0.01780461,0.008255716,0.025094839,0.061339356,0.072790116,0.0011567214,0.0011067742,0.15824227,0.00761271,0.5173502,0.12770031,0.0015462693],"about_ca_topic_score_codex":0.0017748567,"about_ca_topic_score_gemma":0.0011549669,"teacher_disagreement_score":0.230564,"about_ca_system_score_codex":0.007326901,"about_ca_system_score_gemma":0.012326303,"threshold_uncertainty_score":0.2843265},"labels":[],"label_agreement":null},{"id":"W4409055681","doi":"10.1016/j.apmr.2025.01.056","title":"Identifying What Matters to Adults with Mobility Limitations Regarding Their Experiences with Medications: A Concept Mapping Study 1131","year":2025,"lang":"en","type":"article","venue":"Archives of Physical Medicine and Rehabilitation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Psychology; Rehabilitation; Medicine; Physical therapy","score_opus":0.06485814509009839,"score_gpt":0.3825831507416942,"score_spread":0.3177250056515958,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409055681","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9987017,0.00012123061,0.0001981516,0.00020794349,0.0000058495325,0.000030019017,0.00003212818,0.000001162659,0.00070184347],"genre_scores_gemma":[0.9990746,0.0001471762,0.0003622696,0.000119209304,0.0000023490825,0.00003427774,0.00002918935,0.0000013506791,0.00022948282],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.99841917,0.0007379984,0.0001651861,0.00019080663,0.00024626366,0.00024061129],"domain_scores_gemma":[0.9904883,0.005733933,0.0019580913,0.00033390423,0.0007142159,0.0007715754],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004419377,0.00022805134,0.00042388737,0.0010604999,0.0020514452,0.0027558147,0.00066974835,0.00083746057,0.001762503],"category_scores_gemma":[0.02032729,0.0003169532,0.0006798251,0.0011410003,0.0015330133,0.0032978286,0.0029923024,0.0017383595,0.00011311761],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014248259,0.0007445979,0.46788627,0.00016467962,0.00008840863,0.0002939648,0.50923604,0.00010567877,0.0002686705,0.0011087491,0.0004390263,0.019521456],"study_design_scores_gemma":[0.00003905778,0.00038753205,0.27144906,0.00021126642,0.000089057714,0.00040982765,0.7224823,0.00051373226,0.00017183818,0.0013871406,0.0028168857,0.000042234147],"about_ca_topic_score_codex":0.012674678,"about_ca_topic_score_gemma":0.019755168,"teacher_disagreement_score":0.012674678,"about_ca_system_score_codex":0.0011723477,"about_ca_system_score_gemma":0.0029511198,"threshold_uncertainty_score":0.025201857},"labels":[],"label_agreement":null},{"id":"W4409423144","doi":"10.1177/25152459251326571","title":"Navigating Unmeasured Confounding in Nonexperimental Psychological Research: A Practical Guide to Computing and Interpreting E-Value","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Confounding; Value (mathematics); Psychology; Psychological research; Econometrics; Computer science; Statistics; Social psychology; Mathematics","score_opus":0.40287867640893543,"score_gpt":0.758232983432707,"score_spread":0.3553543070237715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409423144","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00023828751,0.0013874483,0.9812429,0.0049798363,0.00045797628,0.00093157665,0.0013211949,0.002246765,0.0071940683],"genre_scores_gemma":[0.003396163,0.0013984911,0.9874812,0.0009661279,0.0002483107,0.0038191478,0.00032378992,0.00084129936,0.0015254427],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9358778,0.05112612,0.0048092296,0.0020878431,0.005705576,0.00039340605],"domain_scores_gemma":[0.6013057,0.36373353,0.006442924,0.017473098,0.009812699,0.0012319806],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06564412,0.00250275,0.0032217046,0.0054990086,0.0012866884,0.010192218,0.006035129,0.0049621207,0.04377747],"category_scores_gemma":[0.32859227,0.0026505673,0.0033789657,0.0074391984,0.007219932,0.009885436,0.0064842966,0.010291176,0.019215617],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020286709,0.0001433342,0.0012205328,0.0034855169,0.00032226584,0.0003445502,0.0013321057,0.010553865,0.00077237363,0.58762574,0.10544793,0.28854892],"study_design_scores_gemma":[0.0001645504,0.0000816577,0.00041655934,0.002315095,0.00006421256,0.0002880513,0.00035655755,0.02020832,0.0010431558,0.77809334,0.19685353,0.000115092145],"about_ca_topic_score_codex":0.0017928546,"about_ca_topic_score_gemma":0.0022095912,"teacher_disagreement_score":0.93435585,"about_ca_system_score_codex":0.0021587908,"about_ca_system_score_gemma":0.00753943,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4409592567","doi":"10.1177/23969873251332118","title":"Conducting descriptive epidemiology and causal inference studies using observational data: A 10-point primer for stroke researchers","year":2025,"lang":"en","type":"review","venue":"European Stroke Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"","keywords":"Observational study; Causal inference; Interpretability; Observational methods in psychology; Inference; Data science; Psychological intervention; Computer science; Medicine; Machine learning; Artificial intelligence; Psychiatry; Pathology","score_opus":0.9514757015146624,"score_gpt":0.6367079876816275,"score_spread":0.3147677138330349,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409592567","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00032302982,0.26404616,0.47664678,0.23849124,0.010466341,0.0029771149,0.001096026,0.0010957876,0.004857484],"genre_scores_gemma":[0.004779961,0.19281012,0.7408495,0.038198303,0.009253334,0.010976467,0.0007271165,0.0005190484,0.0018861468],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.8003069,0.15488447,0.026420604,0.0041040312,0.013380766,0.00090316066],"domain_scores_gemma":[0.32555982,0.6164975,0.013416921,0.014444288,0.026743608,0.0033378282],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.30219167,0.0033889571,0.0070952056,0.0135483015,0.0023974972,0.013687965,0.009252111,0.014591173,0.011621617],"category_scores_gemma":[0.48646945,0.0041046166,0.006604719,0.012062476,0.015725784,0.028888432,0.01027199,0.03893271,0.006893185],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002811209,0.00028242823,0.0018232407,0.035306614,0.0008697817,0.0005492397,0.0045681107,0.0020300401,0.00042150664,0.3120909,0.17562523,0.4661518],"study_design_scores_gemma":[0.0002337731,0.00033697853,0.0008003175,0.047079057,0.00048632154,0.0008958623,0.0013698931,0.0029314712,0.00039066045,0.47808182,0.4671919,0.00020191283],"about_ca_topic_score_codex":0.002791824,"about_ca_topic_score_gemma":0.003681238,"teacher_disagreement_score":0.30219167,"about_ca_system_score_codex":0.005620495,"about_ca_system_score_gemma":0.024234764,"threshold_uncertainty_score":0.8605219},"labels":[],"label_agreement":null},{"id":"W4409802238","doi":"10.1093/biomtc/ujaf041","title":"Optimal dynamic treatment regime estimation in the presence of nonadherence","year":2025,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Waterloo; University of New Brunswick","funders":"Natural Sciences and Engineering Research Council of Canada; New Brunswick Innovation Foundation","keywords":"Estimator; Robustness (evolution); Estimation; Reliability (semiconductor); Computer science; Population; Outcome (game theory); Econometrics; Process (computing); Precision medicine; Medicine; Mathematics; Statistics; Economics","score_opus":0.11847246443711536,"score_gpt":0.4363638841518298,"score_spread":0.31789141971471446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409802238","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027260765,0.00028286863,0.9708629,0.0003883477,0.000025976962,0.00010829269,0.00011019754,0.00013083014,0.0008298327],"genre_scores_gemma":[0.62209576,0.0005297691,0.37471297,0.0003062687,0.00008259682,0.00045973837,0.000397205,0.000054227556,0.0013615234],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9879183,0.008292498,0.00062298303,0.001650138,0.0011494623,0.00036665483],"domain_scores_gemma":[0.9352038,0.054952335,0.0046480545,0.0034478419,0.0014413401,0.00030662277],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017744383,0.0006038374,0.0022257143,0.0012300911,0.00043852418,0.0017201419,0.0015475065,0.0017046105,0.0013749807],"category_scores_gemma":[0.0996581,0.0007566571,0.0012192781,0.0011798836,0.001600872,0.0017475653,0.0015223736,0.0023701682,0.00024201653],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050671387,0.00020343352,0.021643598,0.00029135324,0.00044954524,0.00021230236,0.00039210558,0.7045618,0.0018178,0.10491879,0.0012189738,0.16378354],"study_design_scores_gemma":[0.000069930764,0.0001299733,0.0028959245,0.000074022304,0.0000684505,0.000076019525,0.000040888553,0.9124233,0.0012667318,0.08180471,0.0011140152,0.00003606369],"about_ca_topic_score_codex":0.0049093408,"about_ca_topic_score_gemma":0.0025986333,"teacher_disagreement_score":0.017744383,"about_ca_system_score_codex":0.0015511039,"about_ca_system_score_gemma":0.0025309466,"threshold_uncertainty_score":0.09384239},"labels":[],"label_agreement":null},{"id":"W4409890912","doi":"10.1111/jre.13405","title":"Risk of Bias Evaluation of Cross‐Sectional Studies: Adaptation of the Newcastle‐Ottawa Scale","year":2025,"lang":"en","type":"article","venue":"Journal of Periodontal Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":120,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Cross-sectional study; Confounding; Context (archaeology); Scale (ratio); Cohort; Rating scale; Contrast (vision); Medicine; Psychology; Computer science; Geography; Statistics; Mathematics; Pathology; Artificial intelligence; Cartography","score_opus":0.6463724630743077,"score_gpt":0.607364568122784,"score_spread":0.03900789495152368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409890912","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050786264,0.097119674,0.64789665,0.015461942,0.0046184664,0.13451357,0.012645895,0.0018603965,0.03509712],"genre_scores_gemma":[0.18082663,0.011909642,0.6722685,0.0032743723,0.0007912707,0.12545042,0.003937691,0.0002219276,0.0013195972],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.37058485,0.26050988,0.28889674,0.010150078,0.06758067,0.002277809],"domain_scores_gemma":[0.20536341,0.57257295,0.093543164,0.027545547,0.09810182,0.0028730675],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.38666487,0.0024914783,0.006234812,0.01847331,0.003408894,0.006584277,0.0068079703,0.004670358,0.003913608],"category_scores_gemma":[0.65422636,0.0023540044,0.016315782,0.010410372,0.0061396398,0.006775775,0.01096331,0.0053217835,0.00066061434],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0036223757,0.00044070563,0.15336277,0.1874324,0.027817331,0.0010487746,0.017628813,0.006788312,0.002597245,0.051669016,0.035241414,0.51235086],"study_design_scores_gemma":[0.0061419825,0.0049288715,0.23557213,0.13022523,0.03007457,0.0076751807,0.012196119,0.04756695,0.0070801442,0.1673436,0.34772304,0.0034722097],"about_ca_topic_score_codex":0.006807606,"about_ca_topic_score_gemma":0.011550303,"teacher_disagreement_score":0.61333513,"about_ca_system_score_codex":0.010438357,"about_ca_system_score_gemma":0.022803072,"threshold_uncertainty_score":0.7563514},"labels":[],"label_agreement":null},{"id":"W4409900557","doi":"10.1177/09622802241313289","title":"On flexible inverse probability of treatment and intensity weighting: Informative censoring, variable selection, and weight trimming","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Weighting; Censoring (clinical trials); Inverse probability weighting; Inverse probability; Statistics; Marginal structural model; Confounding; Trimming; Econometrics; Computer science; Observational study; A-weighting; Mathematics; Propensity score matching; Posterior probability; Bayesian probability; Medicine","score_opus":0.2843125504702238,"score_gpt":0.5949416301576912,"score_spread":0.3106290796874674,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409900557","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0035547547,0.00037065227,0.9947994,0.00039035163,0.000057371046,0.00014867655,0.000042341384,0.00006469752,0.00057179487],"genre_scores_gemma":[0.15606074,0.0013045043,0.83728486,0.0009188423,0.00045959753,0.001793821,0.00026094838,0.0001514709,0.0017652839],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9164655,0.07055742,0.001962254,0.0046671405,0.0053192307,0.0010284124],"domain_scores_gemma":[0.7411192,0.21177356,0.011942522,0.029347155,0.0049571665,0.0008604833],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10424958,0.0017692331,0.0026311872,0.0035640122,0.001594306,0.0024197947,0.004848676,0.0038594585,0.0031034993],"category_scores_gemma":[0.25418228,0.001075448,0.0035922232,0.00552824,0.0074368576,0.0042477525,0.0049099396,0.0077969935,0.00052738417],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028174772,0.00019855952,0.007791507,0.00059602497,0.0007055556,0.00040599715,0.0013867877,0.09311841,0.0009875704,0.6869362,0.0022695693,0.2053221],"study_design_scores_gemma":[0.00017787264,0.00026243512,0.0027776996,0.00039305046,0.00024961523,0.00029807587,0.00015402214,0.25834164,0.0014151016,0.72940975,0.0064162766,0.000104515086],"about_ca_topic_score_codex":0.0037278663,"about_ca_topic_score_gemma":0.002850389,"teacher_disagreement_score":0.10424958,"about_ca_system_score_codex":0.002032682,"about_ca_system_score_gemma":0.003543758,"threshold_uncertainty_score":0.55133104},"labels":[],"label_agreement":null},{"id":"W4409918350","doi":"10.1080/13576275.2025.2497605","title":"Letter","year":2025,"lang":"en","type":"letter","venue":"Mortality","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Philosophy","score_opus":0.23741347383835726,"score_gpt":0.44715184643090433,"score_spread":0.20973837259254707,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409918350","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00022760934,0.0011774746,0.00007777576,0.9353078,0.058422886,0.000021183489,0.00011723288,0.000052065356,0.0045959568],"genre_scores_gemma":[0.0018250584,0.00061003445,0.00011988587,0.9553135,0.021299742,0.00004228179,0.000040172406,0.000029992687,0.020719333],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9981394,0.00041386834,0.00020672832,0.00037391367,0.0005528624,0.00031335934],"domain_scores_gemma":[0.99573153,0.0015248077,0.00022677172,0.00015546438,0.0013941061,0.0009673576],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0023247446,0.00086610194,0.0010911396,0.00065283856,0.0037357556,0.0037858547,0.0015877555,0.026205286,0.017595032],"category_scores_gemma":[0.023179563,0.00060051493,0.0010044992,0.0005202152,0.0015714421,0.0030853944,0.0013107999,0.029354658,0.01967187],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018080284,0.000009217559,0.00010865689,0.000015455213,0.0000032327157,0.00039962173,0.00003999597,0.0000123249565,0.000033667075,0.0005734395,0.9966736,0.0021125597],"study_design_scores_gemma":[0.00002897083,0.000022942939,0.0005183079,0.00013006416,0.000009821238,0.0011676247,0.0002952416,0.00012240629,0.00012264792,0.0024619394,0.9950917,0.000028414845],"about_ca_topic_score_codex":0.0050082356,"about_ca_topic_score_gemma":0.007871067,"teacher_disagreement_score":0.98240495,"about_ca_system_score_codex":0.0029172935,"about_ca_system_score_gemma":0.0047030905,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4410288395","doi":"10.2196/71873","title":"Advancing the Use of Longitudinal Electronic Health Records: Tutorial for Uncovering Real-World Evidence in Chronic Disease Outcomes","year":2025,"lang":"en","type":"article","venue":"Journal of Medical Internet Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"U.S. Food and Drug Administration; National Institute of Neurological Disorders and Stroke; U.S. Department of Health and Human Services","keywords":"Pipeline (software); Computer science; Scalability; Data science; Disease; Missing data; Health records; Sampling bias; Medicine; Clinical trial; MEDLINE; Machine learning; Data mining; Artificial intelligence; Sample size determination; Health care; Database","score_opus":0.35156122820201635,"score_gpt":0.5739641170098899,"score_spread":0.22240288880787357,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410288395","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014548821,0.0039674533,0.97906166,0.005753394,0.0002773686,0.00045807016,0.0038245942,0.0026264137,0.0025762431],"genre_scores_gemma":[0.019828016,0.0064586885,0.9659504,0.0010863728,0.00043814848,0.0008712119,0.0027099324,0.0003160464,0.0023411324],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99322295,0.004029759,0.00068031735,0.000561324,0.0013910428,0.000114505165],"domain_scores_gemma":[0.9489422,0.03967395,0.0025667474,0.004409383,0.0038330522,0.000574692],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019188203,0.0011113638,0.0008340306,0.0044555673,0.0006463074,0.0024255267,0.0018787258,0.0016791878,0.013249466],"category_scores_gemma":[0.082525484,0.0011971268,0.0021976589,0.003913372,0.00094735046,0.005637133,0.0028909016,0.0031735906,0.0047128703],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019764566,0.00014793169,0.008053198,0.00232239,0.0003449221,0.00041140633,0.00057322864,0.0092877215,0.0024017282,0.09837128,0.06455707,0.81333154],"study_design_scores_gemma":[0.00016343154,0.00018676593,0.007220114,0.0028414354,0.0003008797,0.0015271358,0.0003745683,0.14779654,0.007934018,0.4758739,0.3555894,0.00019182946],"about_ca_topic_score_codex":0.0022249105,"about_ca_topic_score_gemma":0.0040862956,"teacher_disagreement_score":0.019188203,"about_ca_system_score_codex":0.0009897047,"about_ca_system_score_gemma":0.0028412072,"threshold_uncertainty_score":0.10147816},"labels":[],"label_agreement":null},{"id":"W4410292011","doi":"10.1016/j.jclinepi.2025.111828","title":"There is no upper limit on the maximum effect that can be detected in randomized trials","year":2025,"lang":"en","type":"article","venue":"Journal of Clinical Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Institute of Neurological Disorders and Stroke; National Cancer Institute; National Institutes of Health","keywords":"Randomized controlled trial; Limit (mathematics); Medicine; Internal medicine; Mathematics; Mathematical analysis","score_opus":0.5842019234852277,"score_gpt":0.5934001139642046,"score_spread":0.009198190478976853,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410292011","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019130329,0.064635046,0.82963836,0.06463748,0.003253491,0.0011539457,0.0023100353,0.0015764056,0.013664967],"genre_scores_gemma":[0.54878026,0.022908999,0.34239477,0.063325256,0.0079390025,0.00695591,0.0016367831,0.0008913245,0.005167668],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6267514,0.30571052,0.021145863,0.02459701,0.018518943,0.0032762361],"domain_scores_gemma":[0.08433964,0.8852499,0.0073194313,0.018779524,0.0027837427,0.0015277521],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.37587336,0.0052220747,0.026092384,0.0073904977,0.0027541535,0.0146517325,0.011933247,0.022442067,0.00908287],"category_scores_gemma":[0.7179111,0.007299671,0.013382186,0.0054672263,0.016163409,0.025650494,0.01213185,0.03147253,0.0014458438],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014839335,0.0010229322,0.009713153,0.03145966,0.019466849,0.0016588032,0.0016583762,0.022378067,0.0024827651,0.6949515,0.016822893,0.18354566],"study_design_scores_gemma":[0.0025077753,0.00075141556,0.0017673624,0.0033108052,0.0047198595,0.0009811519,0.0001242157,0.020860856,0.0014170688,0.95293295,0.010483691,0.00014285556],"about_ca_topic_score_codex":0.00073400466,"about_ca_topic_score_gemma":0.0004812647,"teacher_disagreement_score":0.6241267,"about_ca_system_score_codex":0.0034596303,"about_ca_system_score_gemma":0.0053851246,"threshold_uncertainty_score":0.7696593},"labels":[],"label_agreement":null},{"id":"W4410337793","doi":"10.1016/j.arth.2025.04.032","title":"Total Hip Arthroplasty versus Education and Exercise: A Secondary Analysis of Propensity Matched Data Comparing Outcomes Across Hip Osteoarthritis Symptom Severity","year":2025,"lang":"en","type":"article","venue":"The Journal of Arthroplasty","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Rehabilitation Institute; University of Toronto; University Health Network","funders":"Department of Medicine, University of Toronto; European Research Council; Canadian Institutes of Health Research; University Health Network Foundation; Horizon 2020 Framework Programme; Ontario Trillium Foundation; Region Sjælland; Arthritis Society","keywords":"Propensity score matching; Osteoarthritis; Medicine; Physical therapy; Arthroplasty; Total hip arthroplasty; Hip arthroplasty; Hip surgery; Physical medicine and rehabilitation; Internal medicine; Surgery; Alternative medicine","score_opus":0.09348904435676114,"score_gpt":0.39046450475438904,"score_spread":0.2969754603976279,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410337793","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9929509,0.0012193933,0.0032353674,0.00018762238,0.00017830278,0.00020474085,0.0014791536,0.000036437665,0.00050818105],"genre_scores_gemma":[0.99710995,0.00015435218,0.0009156659,0.000115213836,0.00007170168,0.00020300884,0.00087999407,0.000016805492,0.00053329644],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98241156,0.011430943,0.0013439637,0.002716821,0.0009811198,0.001115463],"domain_scores_gemma":[0.9631154,0.02667324,0.0051764227,0.0032645247,0.0008191086,0.0009513288],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014597633,0.00086980575,0.0032200024,0.0011656332,0.00064278505,0.0014552105,0.0021386528,0.00183727,0.006396207],"category_scores_gemma":[0.04148354,0.00072673644,0.008110737,0.0016362976,0.001008017,0.0015257769,0.0016069501,0.0028054134,0.0004701145],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.31504348,0.0032710512,0.58023065,0.0019074415,0.064230725,0.00052423537,0.00068946974,0.0043763113,0.0023056194,0.0017233242,0.003317399,0.022380317],"study_design_scores_gemma":[0.0342203,0.04393647,0.80045825,0.00036027606,0.06008627,0.0010628361,0.00182875,0.045130067,0.0019350142,0.007961988,0.0027690174,0.0002507655],"about_ca_topic_score_codex":0.0039313664,"about_ca_topic_score_gemma":0.0035787122,"teacher_disagreement_score":0.014597633,"about_ca_system_score_codex":0.0005975492,"about_ca_system_score_gemma":0.0012551036,"threshold_uncertainty_score":0.07720059},"labels":[],"label_agreement":null},{"id":"W4410376957","doi":"10.1002/pds.70155","title":"How Effective Are Machine Learning and Doubly Robust Estimators in Incorporating High‐Dimensional Proxies to Reduce Residual Confounding?","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Confounding; Estimator; Propensity score matching; Logistic regression; Proxy (statistics); Lasso (programming language); Statistics; Observational study; Residual; Econometrics; Regression; Medicine; Computer science; Machine learning; Mathematics; Algorithm","score_opus":0.06151136878612086,"score_gpt":0.41288480805064215,"score_spread":0.3513734392645213,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410376957","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07510596,0.016146978,0.89095676,0.012232203,0.00042614972,0.00028255762,0.0011843878,0.0006197575,0.0030454183],"genre_scores_gemma":[0.6769701,0.0055334046,0.31062517,0.003441226,0.0006502185,0.00065066264,0.0010922023,0.0003006273,0.00073640316],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9399809,0.050757423,0.0016916773,0.003834677,0.003121722,0.00061349943],"domain_scores_gemma":[0.73855346,0.23144914,0.011423294,0.01209113,0.0055210786,0.0009618383],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0985372,0.0011586546,0.0024175628,0.0016632505,0.00064113864,0.0031969901,0.002542338,0.0025371693,0.0020364705],"category_scores_gemma":[0.3018132,0.00060889305,0.0025824867,0.0018857544,0.0028941543,0.005146882,0.0022057518,0.0028857219,0.00056485477],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013391875,0.00029008617,0.13032548,0.0026201722,0.0052945716,0.0002748142,0.0008186765,0.2772378,0.00095723383,0.07675354,0.010542628,0.49354583],"study_design_scores_gemma":[0.00053922145,0.00085385586,0.030931072,0.0024083792,0.0015933686,0.00056406244,0.00050508685,0.7366117,0.0033432154,0.19910623,0.023272155,0.0002715833],"about_ca_topic_score_codex":0.0034367414,"about_ca_topic_score_gemma":0.0025238227,"teacher_disagreement_score":0.9014628,"about_ca_system_score_codex":0.001101777,"about_ca_system_score_gemma":0.002903862,"threshold_uncertainty_score":0.5211208},"labels":[],"label_agreement":null},{"id":"W4410480739","doi":"10.1002/sim.70102","title":"Continuous‐Time Causal Inference With Marked Point Process Weights: An Example on Sodium‐Glucose Co‐Transporters 2 Inhibitor Medications and Urinary Tract Infection","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Marginal structural model; Covariate; Confounding; Medicine; Causal inference; Time point; Clinical endpoint; Internal medicine; Statistics; Clinical trial; Mathematics","score_opus":0.043079783093944224,"score_gpt":0.39116520241493435,"score_spread":0.34808541932099013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410480739","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.059592836,0.000649789,0.9365047,0.0013438875,0.00010344335,0.0001792472,0.00027250263,0.00014682033,0.0012067548],"genre_scores_gemma":[0.7415609,0.0009530227,0.2531124,0.00046382193,0.00023009787,0.000649848,0.00045648625,0.000095821975,0.0024775155],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97727394,0.018765785,0.0005058614,0.0021522846,0.00087170437,0.0004304407],"domain_scores_gemma":[0.8112254,0.17470136,0.0043131253,0.0064090146,0.0025468876,0.0008041224],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0471253,0.0011469962,0.0018537862,0.0017228042,0.0009999283,0.0017413857,0.0024532017,0.0024935838,0.0046405024],"category_scores_gemma":[0.13955776,0.0008499026,0.0041689733,0.0023683142,0.0028858176,0.0029448927,0.0028714645,0.004008111,0.00025809646],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000759637,0.00039887326,0.033278257,0.00044810245,0.0014999659,0.0011335799,0.0014097664,0.41960317,0.0009320573,0.45831734,0.0020915195,0.0801277],"study_design_scores_gemma":[0.00015818638,0.00015523599,0.003998718,0.00007985326,0.00024337374,0.00010954544,0.00013440849,0.6386197,0.00040428838,0.35425824,0.0017683711,0.000069984766],"about_ca_topic_score_codex":0.013946644,"about_ca_topic_score_gemma":0.009773958,"teacher_disagreement_score":0.0471253,"about_ca_system_score_codex":0.0016723712,"about_ca_system_score_gemma":0.0022822255,"threshold_uncertainty_score":0.24922538},"labels":[],"label_agreement":null},{"id":"W4410496288","doi":"10.1080/2330443x.2025.2505485","title":"Designing Randomized Experiments to Predict Unit-Specific Treatment Effects","year":2025,"lang":"en","type":"article","venue":"Statistics and Public Policy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada); Science North","funders":"Institute of Education Sciences","keywords":"Randomized controlled trial; Randomized experiment; Unit (ring theory); Statistics; Environmental science; Econometrics; Mathematics; Medicine; Internal medicine; Mathematics education","score_opus":0.10377384455206441,"score_gpt":0.43091742576745856,"score_spread":0.32714358121539416,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410496288","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01679862,0.0002564188,0.9732292,0.0009773801,0.00023452996,0.006085409,0.00023834145,0.00036126308,0.0018188546],"genre_scores_gemma":[0.17012496,0.0003338351,0.8074298,0.00065711176,0.00014360998,0.02052477,0.00018806255,0.00006245321,0.00053525314],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6670553,0.30614203,0.005262639,0.0112763755,0.008415895,0.0018477564],"domain_scores_gemma":[0.3692062,0.5753294,0.022845346,0.025262434,0.0064358935,0.00092067046],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.264763,0.0024523584,0.004193123,0.0030174172,0.0012424032,0.0047462606,0.0047879955,0.005789412,0.005231769],"category_scores_gemma":[0.5303108,0.00238831,0.0033882146,0.002440527,0.005920168,0.0076651126,0.0035340087,0.0059417253,0.0009669671],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005714993,0.002463834,0.013763826,0.0024456931,0.0025687614,0.00019151582,0.0011232204,0.24829349,0.0032230348,0.5834429,0.0033282905,0.13344042],"study_design_scores_gemma":[0.0039021703,0.004538858,0.0028009678,0.00045462398,0.0008796993,0.00007582459,0.00024088904,0.40249723,0.005594507,0.57497084,0.0038710167,0.00017335032],"about_ca_topic_score_codex":0.0010709898,"about_ca_topic_score_gemma":0.0008519475,"teacher_disagreement_score":0.735237,"about_ca_system_score_codex":0.0038101873,"about_ca_system_score_gemma":0.006357814,"threshold_uncertainty_score":0.90667814},"labels":[],"label_agreement":null},{"id":"W4410799412","doi":"10.1002/ejhf.3707","title":"Global Heart Failure Epidemiology Versus Enrolment in Pivotal Trials: A Formidable Mismatch","year":2025,"lang":"en","type":"article","venue":"European Journal of Heart Failure","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Population Health Research Institute; McMaster University; Hamilton Health Sciences","funders":"","keywords":"Representativeness heuristic; Medicine; Epidemiology; Clinical trial; Population; Demography; Environmental health; Internal medicine; Statistics","score_opus":0.18523273088193667,"score_gpt":0.44819951082789244,"score_spread":0.26296677994595574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410799412","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09134426,0.22435234,0.27352503,0.36704218,0.013136233,0.003924409,0.004790439,0.0005303675,0.021354841],"genre_scores_gemma":[0.77686775,0.028272562,0.07530356,0.09467751,0.013201491,0.007537929,0.002312628,0.00061819324,0.0012082928],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.33150876,0.54900163,0.059264515,0.027068624,0.030663673,0.0024927047],"domain_scores_gemma":[0.23009852,0.6331386,0.07560655,0.040076766,0.017810171,0.0032693984],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.60888505,0.0015747149,0.005364222,0.0054073697,0.0011480531,0.009123055,0.004657731,0.0044690524,0.0052399426],"category_scores_gemma":[0.7202681,0.0016174635,0.0041892044,0.007893489,0.008608325,0.013893759,0.008752853,0.0050136466,0.0012385926],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0055496306,0.00034487073,0.19132887,0.03210142,0.026767744,0.00027998764,0.00948013,0.0068212394,0.0010084151,0.13825956,0.033883337,0.55417484],"study_design_scores_gemma":[0.007375668,0.0032655823,0.27764982,0.05224795,0.014599459,0.0018714357,0.007225652,0.016638594,0.001991633,0.4579364,0.15847157,0.0007263434],"about_ca_topic_score_codex":0.0013360815,"about_ca_topic_score_gemma":0.0017689142,"teacher_disagreement_score":0.60888505,"about_ca_system_score_codex":0.0037571087,"about_ca_system_score_gemma":0.0057567167,"threshold_uncertainty_score":0.4823144},"labels":[],"label_agreement":null},{"id":"W4410810617","doi":"10.1371/journal.pone.0324639","title":"Is there a competitive advantage to using multivariate statistical or machine learning methods over the Bross formula in the hdPS framework for bias and variance estimation?","year":2025,"lang":"en","type":"article","venue":"PLoS ONE","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Paul's Hospital; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Statistics; Lasso (programming language); Computer science; Context (archaeology); Mean squared error; Random forest; Feature selection; Selection bias; Proxy (statistics); Machine learning; Mathematics; Biology","score_opus":0.29627820605033617,"score_gpt":0.5109115217999374,"score_spread":0.2146333157496012,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410810617","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024904583,0.004033898,0.96397555,0.0036187177,0.00024473865,0.00014950517,0.0002629782,0.00039146587,0.0024186242],"genre_scores_gemma":[0.44978753,0.0033842067,0.54132545,0.0019528177,0.00066171895,0.0005859138,0.00048698843,0.00028994447,0.0015253865],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97178394,0.021880176,0.00088015076,0.0018280933,0.003329574,0.00029805035],"domain_scores_gemma":[0.9055735,0.0784424,0.0061705667,0.005796388,0.0036080042,0.00040919386],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04266131,0.0010938857,0.002183825,0.0015951837,0.0004355089,0.0023812493,0.0022099002,0.0017237408,0.0029120564],"category_scores_gemma":[0.13607284,0.00045438172,0.0018631925,0.0019056386,0.0016691096,0.0026677677,0.0019354692,0.0024606206,0.0005908163],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00074629777,0.00018363005,0.07407243,0.0022515042,0.00324538,0.00029302065,0.0004401323,0.15857391,0.0020529095,0.11412784,0.0068572727,0.6371556],"study_design_scores_gemma":[0.00037622542,0.0008659239,0.02173502,0.0015840209,0.00082797825,0.0007866249,0.00029423783,0.7989262,0.003465546,0.15101705,0.01996683,0.00015436961],"about_ca_topic_score_codex":0.0027047072,"about_ca_topic_score_gemma":0.0029927776,"teacher_disagreement_score":0.9573387,"about_ca_system_score_codex":0.00076723576,"about_ca_system_score_gemma":0.0022202525,"threshold_uncertainty_score":0.22561729},"labels":[],"label_agreement":null},{"id":"W4410846226","doi":"10.1101/2025.05.29.25328403","title":"Glucose-lowering effects of physical activity in type 1 diabetes: A causal modelling and matched-pair analysis approach","year":2025,"lang":"en","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; Leona M. and Harry B. Helmsley Charitable Trust","keywords":"Type 2 diabetes; Physical activity; Internal medicine; Diabetes mellitus; Endocrinology; Psychology; Medicine; Chemistry; Econometrics; Mathematics; Physical medicine and rehabilitation","score_opus":0.07677183290813011,"score_gpt":0.36105178172942126,"score_spread":0.28427994882129115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410846226","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.48319098,0.0027547672,0.50689536,0.0012514775,0.0006436981,0.0017314617,0.0013694718,0.00043255513,0.0017302148],"genre_scores_gemma":[0.9224357,0.0004924953,0.073975086,0.00021020148,0.00016114324,0.0011932547,0.00045835663,0.000032544456,0.0010412433],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94365585,0.05103638,0.0006969952,0.003021827,0.0009775596,0.0006113192],"domain_scores_gemma":[0.92618257,0.06576693,0.0030906433,0.0035126575,0.0009316106,0.0005155385],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041732118,0.0013654364,0.0028506739,0.0023191385,0.0008872498,0.0014240226,0.0029506988,0.0017557483,0.0060212268],"category_scores_gemma":[0.08138241,0.001185897,0.006892366,0.001437316,0.0009805836,0.0012077619,0.0021840024,0.001623749,0.00028267154],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.032514725,0.004905865,0.28465503,0.002631694,0.07199211,0.0018776524,0.0015788582,0.38653606,0.002284422,0.038064748,0.0037608652,0.16919799],"study_design_scores_gemma":[0.0019576692,0.003924147,0.031632792,0.00017454955,0.011690825,0.00024666497,0.0003526129,0.91486275,0.0010948109,0.031980146,0.0019545334,0.00012847876],"about_ca_topic_score_codex":0.0081629865,"about_ca_topic_score_gemma":0.003520142,"teacher_disagreement_score":0.041732118,"about_ca_system_score_codex":0.0012686597,"about_ca_system_score_gemma":0.0014821487,"threshold_uncertainty_score":0.22070318},"labels":[],"label_agreement":null},{"id":"W4410953661","doi":"10.1016/j.fertnstert.2025.05.168","title":"Recommendation to improve the rigor and impact of nonrandomized studies of interventions in fertility treatment research","year":2025,"lang":"en","type":"article","venue":"Fertility and Sterility","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Merck KGaA; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Merck Healthcare KGaA","keywords":"Fertility; Psychological intervention; Randomized controlled trial; Rigour; Medicine; Psychology; Gynecology; Environmental health; Internal medicine; Mathematics; Psychiatry; Population","score_opus":0.4673525755076959,"score_gpt":0.588457109762856,"score_spread":0.12110453425516016,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410953661","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0027405778,0.06321011,0.07642444,0.6126568,0.064722754,0.10680043,0.01537354,0.004539221,0.05353216],"genre_scores_gemma":[0.011993427,0.031983353,0.42373508,0.4237645,0.007252289,0.08693434,0.0039066123,0.0010746842,0.009355769],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.5704352,0.2687361,0.08162825,0.011765318,0.060668603,0.006766508],"domain_scores_gemma":[0.16555718,0.51029855,0.064935975,0.0582517,0.18635714,0.014599445],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3461563,0.004607365,0.009749427,0.008231908,0.0035488026,0.012957164,0.014322974,0.062019687,0.028181702],"category_scores_gemma":[0.7141962,0.006512101,0.02428091,0.0084652845,0.010282679,0.020199249,0.008984787,0.03660733,0.022897713],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002482297,0.00052801927,0.0018943383,0.15455715,0.00451274,0.00039886913,0.0017270696,0.0019037359,0.0012560176,0.019704869,0.563233,0.2478019],"study_design_scores_gemma":[0.010239713,0.0006866398,0.0045217965,0.34323096,0.0053941,0.0003727939,0.00093946967,0.002339513,0.0017510366,0.031246096,0.5986205,0.0006573082],"about_ca_topic_score_codex":0.014205975,"about_ca_topic_score_gemma":0.019603943,"teacher_disagreement_score":0.6538437,"about_ca_system_score_codex":0.014633453,"about_ca_system_score_gemma":0.0745226,"threshold_uncertainty_score":0.8063057},"labels":[],"label_agreement":null},{"id":"W4410967593","doi":"10.29220/csam.2025.32.3.259","title":"A comparison of propensity score-based causal estimators for analyzing partially missing confounder","year":2025,"lang":"en","type":"article","venue":"Communications for Statistical Applications and Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; McGill University; Montreal Neurological Institute and Hospital","funders":"","keywords":"Propensity score matching; Missing data; Estimator; Statistics; Confounding; Econometrics; Mathematics; Causal inference","score_opus":0.4389368396050024,"score_gpt":0.6008971631796389,"score_spread":0.16196032357463652,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410967593","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03149436,0.0033233028,0.96250725,0.00057947956,0.00015141639,0.00030259535,0.00027611433,0.0003065476,0.001058944],"genre_scores_gemma":[0.3137034,0.0040894365,0.6780302,0.00035338508,0.00020560692,0.0010683713,0.0010273887,0.00018611105,0.0013361408],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9783876,0.017464679,0.0008322409,0.0010221828,0.0020552953,0.00023796601],"domain_scores_gemma":[0.91175854,0.07531838,0.0029892884,0.005067146,0.0043872907,0.00047939646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.048968647,0.0008789791,0.0017798914,0.0032145847,0.00047226527,0.0013882661,0.0015411619,0.0015535858,0.0030468686],"category_scores_gemma":[0.14642747,0.00057925965,0.0021382824,0.0028379234,0.0008632364,0.0040307357,0.0021006872,0.0017267517,0.0003447735],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027223376,0.0003391241,0.025035672,0.001517025,0.0025359204,0.000115895644,0.00056631485,0.20156173,0.001226804,0.14567092,0.0047674193,0.6139408],"study_design_scores_gemma":[0.0009247032,0.0011250841,0.015758635,0.0003736167,0.00074384944,0.00029662705,0.00026107312,0.8771049,0.0018940917,0.09246506,0.008898019,0.00015427705],"about_ca_topic_score_codex":0.0019712837,"about_ca_topic_score_gemma":0.0015112717,"teacher_disagreement_score":0.048968647,"about_ca_system_score_codex":0.0009436651,"about_ca_system_score_gemma":0.0024058428,"threshold_uncertainty_score":0.25897402},"labels":[],"label_agreement":null},{"id":"W4411394384","doi":"10.1007/s12561-025-09495-4","title":"Causal Inference on Missing Exposure via Robust Estimation","year":2025,"lang":"en","type":"article","venue":"Statistics in Biosciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Causal inference; Inference; Biostatistics; Estimation; Missing data; Econometrics; Computer science; Statistics; Data mining; Artificial intelligence; Machine learning; Mathematics; Public health; Economics; Medicine","score_opus":0.12353098767810926,"score_gpt":0.44517602030833536,"score_spread":0.3216450326302261,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411394384","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016995968,0.0004629825,0.9965004,0.00058275065,0.000070446586,0.000027645381,0.00013072952,0.000150391,0.00037512332],"genre_scores_gemma":[0.3211052,0.0043744347,0.66098636,0.0012480926,0.0018282766,0.00075700064,0.0012442534,0.00040866106,0.008047697],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97829264,0.014694203,0.0010280565,0.0033399386,0.0020745392,0.00057061116],"domain_scores_gemma":[0.7636452,0.20917687,0.008115535,0.014583673,0.0036533324,0.00082533935],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.037883528,0.0020053927,0.005429219,0.004099748,0.0010491956,0.004082614,0.006561066,0.004396008,0.008224966],"category_scores_gemma":[0.18481405,0.0026292158,0.004812186,0.004923443,0.005441246,0.0077882707,0.0045327223,0.008157437,0.0010382313],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017055088,0.00012280524,0.0017690036,0.0004754996,0.0008876076,0.00032965024,0.0003376217,0.09331886,0.000335903,0.854674,0.0026627402,0.04491571],"study_design_scores_gemma":[0.00005427731,0.000026970492,0.00037905437,0.000081538885,0.00018999736,0.00007912371,0.000027389706,0.20584151,0.0002563073,0.79156786,0.001470472,0.000025500596],"about_ca_topic_score_codex":0.0041524307,"about_ca_topic_score_gemma":0.0020229155,"teacher_disagreement_score":0.9621165,"about_ca_system_score_codex":0.0016234879,"about_ca_system_score_gemma":0.002917801,"threshold_uncertainty_score":0.20034969},"labels":[],"label_agreement":null},{"id":"W4411436605","doi":"10.1177/09622802251348999","title":"Permutation tests for detecting treatment effect heterogeneity in cluster randomized trials","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Allergy and Infectious Diseases; Patient-Centered Outcomes Research Institute","keywords":"Permutation (music); Resampling; Randomized controlled trial; Cluster (spacecraft); Statistics; Computer science; Mathematics; Multiple comparisons problem; Medicine; Internal medicine; Physics","score_opus":0.5711598577785493,"score_gpt":0.7277796225742554,"score_spread":0.15661976479570616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411436605","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005071901,0.001089923,0.98572713,0.0007772514,0.00056972646,0.0038654434,0.00076158217,0.0008703703,0.0012667073],"genre_scores_gemma":[0.1468499,0.0009556106,0.8158815,0.0012278183,0.0006034805,0.032018628,0.0011169981,0.00044077408,0.00090530113],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6825508,0.27224392,0.014060179,0.013225944,0.01639569,0.0015234435],"domain_scores_gemma":[0.35263297,0.57766974,0.021868283,0.03832454,0.008290795,0.001213666],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21802713,0.0026514488,0.0057533523,0.007224729,0.0019208586,0.003928949,0.006053673,0.0044681365,0.01096515],"category_scores_gemma":[0.6048235,0.0016334848,0.0073204427,0.0080177905,0.00672771,0.0050923843,0.0044530486,0.009613728,0.0012583224],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0062953415,0.0006830687,0.01707242,0.010007179,0.015887586,0.0016695979,0.0029730238,0.06590141,0.0019772516,0.40931278,0.022452336,0.44576806],"study_design_scores_gemma":[0.0032707194,0.0025808373,0.005570811,0.0016128174,0.0025590528,0.0006686169,0.00045968968,0.2598833,0.0029358868,0.70447797,0.0156803,0.00029996052],"about_ca_topic_score_codex":0.0016095028,"about_ca_topic_score_gemma":0.00097305275,"teacher_disagreement_score":0.7819729,"about_ca_system_score_codex":0.0025107374,"about_ca_system_score_gemma":0.0071861637,"threshold_uncertainty_score":0.9643118},"labels":[],"label_agreement":null},{"id":"W4411607629","doi":"10.1002/pds.70174","title":"Simultaneously Dealing With Immortal Time Bias and Residual Confounding: A Case Study of a High‐Dimensional Propensity Score Approach With a Nested Case–Control Framework in Multiple Sclerosis Research","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre for Advancing Health Outcomes; University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Propensity score matching; Confounding; Medicine; Observational study; Hazard ratio; Confidence interval; Residual; Matching (statistics); Meta-analysis; Statistics; Internal medicine; Computer science; Mathematics; Algorithm","score_opus":0.35328064349770466,"score_gpt":0.44569927190225594,"score_spread":0.09241862840455128,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411607629","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3186939,0.004092771,0.6692717,0.0030116907,0.00034567932,0.0015434097,0.00045886615,0.00014677632,0.0024351461],"genre_scores_gemma":[0.7839961,0.0006632711,0.21308936,0.00044201183,0.00013370808,0.0012183754,0.00019239828,0.00003062525,0.00023407378],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.85726297,0.12628572,0.00513823,0.0042267763,0.006271851,0.0008145227],"domain_scores_gemma":[0.8188793,0.12690803,0.017719554,0.030070016,0.005344539,0.0010784735],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1476763,0.0006693454,0.0011297577,0.0019986646,0.0016674997,0.0019111007,0.0024557377,0.002010834,0.0014720794],"category_scores_gemma":[0.2147042,0.00083054666,0.004200919,0.002235114,0.0031829358,0.0015711047,0.0032401278,0.0020780812,0.000146804],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023556305,0.00084650394,0.6599081,0.0014869159,0.009425592,0.0034628962,0.005827601,0.05261511,0.0025951061,0.106173895,0.004049304,0.15125342],"study_design_scores_gemma":[0.002037413,0.0030883662,0.2602542,0.0017133012,0.010494744,0.007599952,0.0025237899,0.3832261,0.0067664385,0.2965074,0.025231568,0.00055674434],"about_ca_topic_score_codex":0.0069947485,"about_ca_topic_score_gemma":0.0066092946,"teacher_disagreement_score":0.8523237,"about_ca_system_score_codex":0.001805121,"about_ca_system_score_gemma":0.0038760996,"threshold_uncertainty_score":0.78099626},"labels":[],"label_agreement":null},{"id":"W4411623088","doi":"10.1093/fampra/cmaf043","title":"Causal mediation analysis: what is it and how can it be used to inform practice and policy?","year":2025,"lang":"en","type":"article","venue":"Family Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke; Jewish General Hospital; Université du Québec en Abitibi-Témiscamingue; McGill University Health Centre; Université de Montréal; McGill University; Centre Hospitalier de l’Université de Montréal","funders":"Canadian Institutes of Health Research","keywords":"Mediation; Psychological intervention; Outcome (game theory); Medicine; Intervention (counseling); Toolbox; Causal model; Mechanism (biology); Causal analysis; Nursing; Risk analysis (engineering); Computer science; Epistemology","score_opus":0.1383430506533034,"score_gpt":0.45613738218223726,"score_spread":0.3177943315289339,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411623088","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036406075,0.07441245,0.62528634,0.27269274,0.0053273276,0.0017350999,0.0008193515,0.0010629663,0.015023208],"genre_scores_gemma":[0.20964983,0.07711956,0.67227525,0.024031421,0.00542578,0.008478064,0.0005361948,0.00075292937,0.001730972],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5541697,0.41408643,0.0062372363,0.0078021907,0.015503028,0.0022013348],"domain_scores_gemma":[0.28099215,0.6538885,0.011866604,0.02910288,0.021756526,0.0023932927],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.46427876,0.0034778388,0.009532884,0.012507956,0.005703949,0.019759994,0.009493108,0.009908396,0.013920807],"category_scores_gemma":[0.60727763,0.0021546942,0.006743252,0.020268247,0.02818706,0.03535018,0.008348551,0.014615354,0.0022887331],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039156977,0.00020981107,0.009605439,0.011727415,0.003039704,0.00034960962,0.0068008034,0.004496607,0.000214027,0.6307686,0.02629805,0.3060985],"study_design_scores_gemma":[0.00020387652,0.00020120115,0.0014286959,0.014869993,0.0008484318,0.00028360978,0.0035679322,0.008046074,0.00045904928,0.9214658,0.048389677,0.0002357135],"about_ca_topic_score_codex":0.009737065,"about_ca_topic_score_gemma":0.006616487,"teacher_disagreement_score":0.46427876,"about_ca_system_score_codex":0.010279574,"about_ca_system_score_gemma":0.028300947,"threshold_uncertainty_score":0.6606397},"labels":[],"label_agreement":null},{"id":"W4411699008","doi":"10.1353/obs.2025.a963647","title":"A new four-arm within-study comparison: Design, implementation, and data","year":2025,"lang":"en","type":"article","venue":"Observational Studies","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Education and Early Childhood Development","funders":"University of Virginia","keywords":"Computer science","score_opus":0.8056678441780485,"score_gpt":0.5920920188067013,"score_spread":0.21357582537134723,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411699008","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022233145,0.0015978843,0.72647667,0.002247311,0.0074544875,0.22633395,0.005207978,0.002205707,0.0062428727],"genre_scores_gemma":[0.03065813,0.00018231377,0.5528226,0.00084421475,0.00031496366,0.4139265,0.0005182795,0.00019900917,0.0005340152],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.40265164,0.49041373,0.044796605,0.026766716,0.0322871,0.0030842547],"domain_scores_gemma":[0.40548328,0.36036995,0.03868833,0.13873312,0.05108681,0.0056385472],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39306307,0.0043153805,0.009295423,0.0065894094,0.0044850367,0.006299852,0.0060521066,0.012049742,0.018482236],"category_scores_gemma":[0.5912436,0.0045398343,0.01022132,0.009218685,0.0072419965,0.011691225,0.00931976,0.0111824805,0.0035455935],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1294183,0.014062464,0.024037875,0.03765072,0.031559315,0.0006950377,0.007278305,0.0189742,0.009543931,0.15200195,0.03536837,0.5394097],"study_design_scores_gemma":[0.18016136,0.096671276,0.03130766,0.007437414,0.021983529,0.00094106345,0.0014144919,0.09758968,0.020394772,0.34323302,0.19661884,0.0022468932],"about_ca_topic_score_codex":0.0010237732,"about_ca_topic_score_gemma":0.001188549,"teacher_disagreement_score":0.60693693,"about_ca_system_score_codex":0.0050762645,"about_ca_system_score_gemma":0.012362044,"threshold_uncertainty_score":0.7484613},"labels":[],"label_agreement":null},{"id":"W4411734481","doi":"10.1007/978-3-031-87083-5_9","title":"Surrogate Endpoints","year":2025,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Surrogate endpoint; Medicine; Internal medicine","score_opus":0.17652251141792635,"score_gpt":0.40848504335957947,"score_spread":0.23196253194165312,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411734481","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00088802027,0.002911612,0.64534265,0.0038021454,0.0018748185,0.00014221217,0.0012409687,0.00060081645,0.34319678],"genre_scores_gemma":[0.08102699,0.0073740357,0.2865179,0.004033864,0.0029265764,0.0008152193,0.0037059379,0.0015361373,0.6120633],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99675083,0.0016388948,0.00012013273,0.0005071654,0.00090423477,0.000078704616],"domain_scores_gemma":[0.9930964,0.0041732076,0.00033083293,0.00144585,0.00077532313,0.00017834609],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0050660274,0.0012447579,0.0013740328,0.0014954916,0.00083106715,0.004187842,0.0018401046,0.0021834217,0.09654364],"category_scores_gemma":[0.024517965,0.00061665854,0.0010745919,0.0016591295,0.0015737714,0.0044947513,0.0024313026,0.0054495432,0.030339161],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000068354646,0.000040274932,0.00014724121,0.00017487643,0.000019456193,0.00006871812,0.00006940248,0.0026318065,0.0002249745,0.8382611,0.057281353,0.10101245],"study_design_scores_gemma":[0.000015978714,0.000030424353,0.00010386365,0.00018170304,0.000018380886,0.00015563569,0.000028896655,0.0048940964,0.00038527898,0.84010273,0.15407017,0.0000128187285],"about_ca_topic_score_codex":0.0003595313,"about_ca_topic_score_gemma":0.0005192982,"teacher_disagreement_score":0.99493396,"about_ca_system_score_codex":0.001015184,"about_ca_system_score_gemma":0.0012789255,"threshold_uncertainty_score":0.32297063},"labels":[],"label_agreement":null},{"id":"W4411777752","doi":"10.1093/cid/ciaf317","title":"Does Piperacillin-Tazobactam Increase Mortality Risk Compared With Cefepime? Collider Bias and the Importance of Assumptions in Instrumental Variable Analyses","year":2025,"lang":"en","type":"article","venue":"Clinical Infectious Diseases","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"National Institute for Health and Care Research","keywords":"Cefepime; Piperacillin/tazobactam; Medicine; Instrumental variable; Collider; Piperacillin; Variable (mathematics); Statistics; Intensive care medicine; Econometrics; Microbiology; Antibiotics; Particle physics; Mathematics; Bacteria; Physics","score_opus":0.17018066114500954,"score_gpt":0.4804230636962383,"score_spread":0.3102424025512287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411777752","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09126124,0.012636416,0.8676186,0.017879654,0.0010020433,0.0015456163,0.0011830952,0.00049861235,0.0063747074],"genre_scores_gemma":[0.842999,0.0026273616,0.14525351,0.005327274,0.00066258473,0.001468814,0.0004394536,0.00021760799,0.0010044095],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.77895975,0.18901365,0.0099035585,0.012164155,0.008178817,0.0017801281],"domain_scores_gemma":[0.24010405,0.7075265,0.027395014,0.020737035,0.0036625525,0.0005748685],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2680831,0.0013803324,0.002913062,0.0019652843,0.0010707868,0.004595931,0.0031602357,0.0035793483,0.0064309565],"category_scores_gemma":[0.52826333,0.0008144531,0.008358793,0.0023537131,0.004589123,0.00447166,0.0037540244,0.004673278,0.00033765947],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.007093697,0.0003459784,0.15913503,0.00642111,0.029586036,0.0016965194,0.0043224953,0.09836108,0.0013884103,0.45562577,0.008899365,0.22712454],"study_design_scores_gemma":[0.0015447575,0.00081040256,0.016135758,0.0022200088,0.0076958695,0.00039206824,0.0005417213,0.14876503,0.0036340184,0.8049919,0.013073367,0.00019506353],"about_ca_topic_score_codex":0.0037733712,"about_ca_topic_score_gemma":0.0020162966,"teacher_disagreement_score":0.7319169,"about_ca_system_score_codex":0.0029835193,"about_ca_system_score_gemma":0.0029893864,"threshold_uncertainty_score":0.90258384},"labels":[],"label_agreement":null},{"id":"W4412011438","doi":"10.1007/s10654-025-01245-6","title":"Revisiting the hazards of hazard ratios through simulations and case studies","year":2025,"lang":"en","type":"article","venue":"European Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"National Cancer Institute; Canadian Institutes of Health Research; National Institutes of Health; McGill University","keywords":"Hazard ratio; Proportional hazards model; Medicine; Hazard; Event (particle physics); Econometrics; Statistics; Internal medicine; Confidence interval; Mathematics","score_opus":0.3282653714412905,"score_gpt":0.5058808842061283,"score_spread":0.17761551276483784,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412011438","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15364368,0.0057864124,0.80797553,0.00796719,0.0006995376,0.000663598,0.0017963393,0.00036582866,0.02110194],"genre_scores_gemma":[0.7850763,0.0028838569,0.2069355,0.00088200916,0.0002454146,0.000894088,0.0005622377,0.000118365606,0.0024021945],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98493135,0.012720219,0.0004531984,0.00071605056,0.00087183574,0.00030737577],"domain_scores_gemma":[0.7640954,0.22323653,0.0048673134,0.0045591723,0.0027802193,0.00046129318],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.029160548,0.001112644,0.0013154311,0.0018080255,0.0006043323,0.0033055928,0.0023981677,0.0021004514,0.004203056],"category_scores_gemma":[0.116065346,0.0008350776,0.0017220195,0.001866187,0.0023237418,0.0028979932,0.0021604842,0.004354728,0.0002682518],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028449038,0.00015384906,0.012736637,0.0005318824,0.0003101113,0.00063908874,0.0008281298,0.72237843,0.0002599088,0.23777999,0.0028556043,0.0212419],"study_design_scores_gemma":[0.0001331436,0.00010656822,0.0009088515,0.0002527477,0.000099699784,0.00014248671,0.00033625358,0.8365754,0.00035576746,0.15602207,0.0050151427,0.00005190016],"about_ca_topic_score_codex":0.016769113,"about_ca_topic_score_gemma":0.009905525,"teacher_disagreement_score":0.97083944,"about_ca_system_score_codex":0.0022119253,"about_ca_system_score_gemma":0.0023628091,"threshold_uncertainty_score":0.15421754},"labels":[],"label_agreement":null},{"id":"W4412016582","doi":"10.1007/s10985-025-09663-0","title":"Multi-source analyses of average treatment effects with failure time outcomes","year":2025,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"U.S. National Library of Medicine; Natural Sciences and Engineering Research Council of Canada; Patient-Centered Outcomes Research Institute","keywords":"Econometrics; Statistics; Computer science; Mathematics","score_opus":0.11227128017266187,"score_gpt":0.4428673142433821,"score_spread":0.33059603407072025,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412016582","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035124242,0.0010264766,0.9584688,0.00058959814,0.000142595,0.00021790515,0.0025226637,0.0005798608,0.0013278313],"genre_scores_gemma":[0.7371613,0.0007670817,0.2502476,0.00043660216,0.00034298003,0.0011284972,0.0035548015,0.0006146781,0.0057465495],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9637751,0.028039943,0.0014856957,0.0040428424,0.002097456,0.00055899017],"domain_scores_gemma":[0.6314411,0.31895494,0.011098751,0.03315705,0.0045809234,0.0007673081],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058485486,0.0010114965,0.0018812633,0.002490816,0.0008912074,0.0024289375,0.0035792175,0.0015783176,0.0161925],"category_scores_gemma":[0.23222235,0.00071729015,0.005206058,0.0029827976,0.0011262434,0.005254929,0.0030109647,0.003269141,0.00092928705],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0048606107,0.000868452,0.13281848,0.003593571,0.030283555,0.0009294073,0.0022519012,0.098998025,0.0024406514,0.26647922,0.017200299,0.43927586],"study_design_scores_gemma":[0.000506161,0.00076903857,0.049079075,0.00073994684,0.006213469,0.00062234205,0.0006376052,0.32981864,0.0032027785,0.5977556,0.010495469,0.00015988195],"about_ca_topic_score_codex":0.0026766441,"about_ca_topic_score_gemma":0.0027279207,"teacher_disagreement_score":0.058485486,"about_ca_system_score_codex":0.0008530258,"about_ca_system_score_gemma":0.0015408216,"threshold_uncertainty_score":0.30930454},"labels":[],"label_agreement":null},{"id":"W4412063123","doi":"10.1002/pds.70172","title":"High‐Dimensional Disease Risk Score for Dealing With Residual Confounding Bias in Estimating Treatment Effects With a Survival Outcome","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Centre for Disease Control; Centre for Advancing Health Outcomes; St. Paul's Hospital; University of British Columbia","funders":"","keywords":"Confounding; Propensity score matching; Medicine; Hazard ratio; Proportional hazards model; Information bias; Statistics; Residual; Demography; Internal medicine; Selection bias; Confidence interval; Mathematics","score_opus":0.1726632869011169,"score_gpt":0.46878429929867044,"score_spread":0.2961210123975535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412063123","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.31295535,0.0029369134,0.6797517,0.0011017501,0.000116168136,0.0007633376,0.00054322096,0.00039954836,0.0014320307],"genre_scores_gemma":[0.74356073,0.00039701577,0.25480425,0.00022888735,0.000052682608,0.00041733266,0.00027461612,0.000027831611,0.00023672373],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9290166,0.06503927,0.0015074674,0.0016523921,0.0025661855,0.00021801936],"domain_scores_gemma":[0.85984015,0.11738222,0.009043425,0.009342354,0.0037845972,0.00060719455],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06282803,0.0007663369,0.0010319862,0.0016689848,0.0005726514,0.0012855075,0.0011166534,0.0011267842,0.0014375875],"category_scores_gemma":[0.12171244,0.0004533082,0.0021655136,0.00181593,0.0015452177,0.00097608764,0.0021126743,0.0013376488,0.00016179615],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013953273,0.00028696106,0.5085079,0.0013145894,0.0060457643,0.0002205667,0.00073966035,0.19756837,0.0014722226,0.019898865,0.00206233,0.26048738],"study_design_scores_gemma":[0.00073103234,0.0017952217,0.15937902,0.00053098064,0.00139688,0.00078481407,0.00022356749,0.7902183,0.003497106,0.034730878,0.006439708,0.0002725544],"about_ca_topic_score_codex":0.003798748,"about_ca_topic_score_gemma":0.003591201,"teacher_disagreement_score":0.937172,"about_ca_system_score_codex":0.0010961916,"about_ca_system_score_gemma":0.0017005572,"threshold_uncertainty_score":0.33227032},"labels":[],"label_agreement":null},{"id":"W4412082903","doi":"10.1093/ije/dyaf114","title":"Balancing scores and causal diagrams","year":2025,"lang":"en","type":"article","venue":"International Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Confounding; Propensity score matching; Medicine; Outcome (game theory); Statistics; Internal medicine; Mathematics","score_opus":0.15563451929346245,"score_gpt":0.49166695294933793,"score_spread":0.3360324336558755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412082903","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009851901,0.00087082165,0.9771967,0.0015600008,0.000091586444,0.00008830398,0.00029221983,0.00030546437,0.009743021],"genre_scores_gemma":[0.3945563,0.0021252304,0.5956981,0.000666362,0.00039480982,0.0007227678,0.00083414884,0.00023199632,0.0047702813],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9834751,0.011384945,0.0007806776,0.0015801118,0.0022746949,0.00050440116],"domain_scores_gemma":[0.92257535,0.06596689,0.0045923493,0.0032329133,0.0027952597,0.00083730894],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016650043,0.0012609434,0.0010617313,0.0056930445,0.0016587947,0.0043587387,0.0015616735,0.002281625,0.012314959],"category_scores_gemma":[0.084063,0.00075501914,0.0018006972,0.00430008,0.005365871,0.006712121,0.0032820236,0.0028188895,0.00097632996],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020524143,0.000012382406,0.0006198733,0.000078935314,0.000028095294,0.00004739103,0.00015344082,0.008801212,0.00009194994,0.9738274,0.00087313337,0.015445665],"study_design_scores_gemma":[0.000016889662,0.000006939764,0.00010478385,0.000028692464,0.000012021958,0.00003880769,0.000018904828,0.01124828,0.00007874053,0.98504466,0.0033939097,0.0000073091055],"about_ca_topic_score_codex":0.0023011994,"about_ca_topic_score_gemma":0.0012141665,"teacher_disagreement_score":0.016650043,"about_ca_system_score_codex":0.0022049188,"about_ca_system_score_gemma":0.0021279065,"threshold_uncertainty_score":0.088054836},"labels":[],"label_agreement":null},{"id":"W4412173418","doi":"10.1017/rsm.2025.10021","title":"Regression augmented weighting adjustment for indirect comparisons in health decision modelling","year":2025,"lang":"en","type":"article","venue":"Research Synthesis Methods","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Weighting; Computer science; Regression analysis; Econometrics; Statistics; Regression; Machine learning; Mathematics; Medicine","score_opus":0.6488356191652721,"score_gpt":0.6639908171596867,"score_spread":0.01515519799441456,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412173418","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003853264,0.0006114736,0.99346817,0.0004214617,0.000102735474,0.00039191075,0.00017911062,0.0002345971,0.00073723897],"genre_scores_gemma":[0.23208094,0.0009670534,0.7601582,0.000785334,0.0002500061,0.0029125097,0.0006601883,0.00031298306,0.0018727522],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94354194,0.050789416,0.0010989729,0.0020482056,0.001960556,0.0005609662],"domain_scores_gemma":[0.8447546,0.14205058,0.0043758964,0.0045842687,0.0036131025,0.00062154507],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.054807335,0.0022670634,0.003587398,0.0029012135,0.0007738327,0.002350893,0.004155123,0.0025102037,0.007915147],"category_scores_gemma":[0.1941421,0.0012266716,0.004097506,0.0029311674,0.002005717,0.0026094338,0.004023273,0.005224069,0.00078229926],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005692441,0.00014129892,0.0038168312,0.0010475506,0.0016910906,0.00022482642,0.00030343665,0.7426614,0.0003436039,0.11161641,0.0036152296,0.13396914],"study_design_scores_gemma":[0.00012604754,0.000121405224,0.00044046176,0.00014159342,0.00014032389,0.000033277473,0.00002235853,0.91740656,0.00022142738,0.07820548,0.003105858,0.000035133035],"about_ca_topic_score_codex":0.00881385,"about_ca_topic_score_gemma":0.0062728566,"teacher_disagreement_score":0.9451927,"about_ca_system_score_codex":0.0020025421,"about_ca_system_score_gemma":0.004303783,"threshold_uncertainty_score":0.28985238},"labels":[],"label_agreement":null},{"id":"W4412388536","doi":"10.1002/cjs.70016","title":"A class of directed acyclic graphs with mixed data types in mediation analysis","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Environmental Health Sciences; National Institutes of Health","keywords":"Directed acyclic graph; Class (philosophy); Mixed graph; Mediation; Computer science; Mathematics; Combinatorics; Sociology; Artificial intelligence; Graph; Line graph","score_opus":0.07980555718791991,"score_gpt":0.360890885522459,"score_spread":0.2810853283345391,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412388536","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007260735,0.00039609012,0.98944956,0.0007744677,0.000036904927,0.00016232688,0.00059686403,0.00023945577,0.001083702],"genre_scores_gemma":[0.3091571,0.0013824811,0.67981464,0.0011428738,0.00035651235,0.0027175015,0.0019032407,0.00022736703,0.0032982873],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97092485,0.02137943,0.0010719883,0.0041355933,0.0017896935,0.000698434],"domain_scores_gemma":[0.8658923,0.1105224,0.007455951,0.012192453,0.0031119438,0.00082495273],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031704064,0.0014136133,0.002187525,0.0040713577,0.0016086265,0.0030533632,0.0051086084,0.0027699328,0.0076986738],"category_scores_gemma":[0.09405431,0.0015793405,0.00437226,0.0054616365,0.0036763162,0.007154336,0.0043386086,0.0039956053,0.0008414432],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007300312,0.00006758063,0.0039813165,0.00021061393,0.0003388338,0.0004333397,0.00043194674,0.032687314,0.00032415014,0.9267479,0.0017711478,0.03293285],"study_design_scores_gemma":[0.00004692279,0.00003521521,0.0005278367,0.000053622225,0.00009090731,0.00016621935,0.00007120856,0.15389891,0.0001361672,0.84152466,0.0034260992,0.000022314154],"about_ca_topic_score_codex":0.004088398,"about_ca_topic_score_gemma":0.0029781812,"teacher_disagreement_score":0.031704064,"about_ca_system_score_codex":0.002077153,"about_ca_system_score_gemma":0.002603438,"threshold_uncertainty_score":0.16766912},"labels":[],"label_agreement":null},{"id":"W4412424131","doi":"10.1002/sim.70038","title":"Natural Effects in the Presence of an Intermediate Confounder: Evaluation of Pragmatic Estimation Strategies With an Emphasis on the Relationship Between Natural and Interventional Effects","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre; Université du Québec à Montréal","funders":"Fonds de recherche du Québec – Nature et technologies; Natural Sciences and Engineering Research Council of Canada; Fonds Québécois de la Recherche sur la Nature et les Technologies","keywords":"Estimator; Confounding; Outcome (game theory); Natural (archaeology); Econometrics; Statistics; Mediation; Computer science; Mathematics; Biology","score_opus":0.09314129423726326,"score_gpt":0.47612402867371983,"score_spread":0.3829827344364566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412424131","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08856714,0.00092025317,0.9036657,0.0014173038,0.00007627529,0.0010142542,0.00008768062,0.00014934404,0.004102],"genre_scores_gemma":[0.5708397,0.0003974284,0.4263647,0.00028917863,0.000039526763,0.0013123184,0.0000925236,0.000044595803,0.00062003214],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9042717,0.08960688,0.0015508552,0.0014797375,0.0027201956,0.00037056237],"domain_scores_gemma":[0.4376694,0.54525876,0.006186807,0.0066434084,0.0035245263,0.0007170975],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.106420554,0.001148662,0.0016255403,0.0013286973,0.0006980128,0.0024662907,0.0024819295,0.0019230986,0.003534022],"category_scores_gemma":[0.38370517,0.00080096617,0.0012067282,0.0009664301,0.002105513,0.0038389282,0.0039621363,0.002231217,0.00022133977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0030963763,0.0011759275,0.016124854,0.0027143501,0.0016233029,0.0005484196,0.0040988396,0.19906056,0.0019051977,0.53843564,0.0019037166,0.2293129],"study_design_scores_gemma":[0.0010237728,0.0015677301,0.0040234025,0.0006218353,0.0005427218,0.0002694625,0.00071988837,0.7581848,0.0012234158,0.22800565,0.0036881824,0.00012915174],"about_ca_topic_score_codex":0.002090742,"about_ca_topic_score_gemma":0.0018640184,"teacher_disagreement_score":0.8935794,"about_ca_system_score_codex":0.0012956841,"about_ca_system_score_gemma":0.0028571414,"threshold_uncertainty_score":0.56281245},"labels":[],"label_agreement":null},{"id":"W4412435511","doi":"10.1016/s2352-4642(25)00131-2","title":"Target trial emulation in paediatric research: how can causal effects be estimated from observational data?","year":2025,"lang":"en","type":"review","venue":"The Lancet Child & Adolescent Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Women's College Hospital; Hospital for Sick Children; Toronto Rehabilitation Institute; SickKids Foundation; University of Toronto; Institute for Clinical Evaluative Sciences","funders":"","keywords":"Observational study; Emulation; Randomized controlled trial; Causal inference; Observational methods in psychology; Medicine; Clinical trial; Medical physics; Computer science; Data science; Psychology; Surgery; Pathology","score_opus":0.6773655559287957,"score_gpt":0.55709968852989,"score_spread":0.12026586739890566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412435511","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020264946,0.6211624,0.34830186,0.021072274,0.0028884555,0.0005714821,0.0009371237,0.00058038754,0.002459409],"genre_scores_gemma":[0.15430643,0.48066908,0.3340443,0.016131302,0.0056551076,0.004797394,0.0011225126,0.00065714796,0.002616749],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.81285137,0.17658505,0.004204247,0.0026249895,0.003329429,0.00040488786],"domain_scores_gemma":[0.38510635,0.5977695,0.0063250572,0.007961366,0.0023655577,0.00047215755],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16820255,0.0021336176,0.01325075,0.0028327992,0.00041941876,0.0043775416,0.0053786743,0.0047638486,0.010513738],"category_scores_gemma":[0.43896386,0.0018639297,0.010096228,0.0038589123,0.0032384633,0.0065403064,0.0030572207,0.011506593,0.0014541107],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025445686,0.00014343692,0.002389887,0.07969839,0.030572223,0.00017181318,0.00048281974,0.032257956,0.0001540009,0.15549546,0.016868288,0.6792212],"study_design_scores_gemma":[0.0043606344,0.0007855848,0.0024846147,0.040408332,0.018473957,0.00037573042,0.00020626081,0.049318492,0.000483558,0.83988136,0.043036975,0.00018455945],"about_ca_topic_score_codex":0.003525413,"about_ca_topic_score_gemma":0.0030948,"teacher_disagreement_score":0.8317975,"about_ca_system_score_codex":0.0026469256,"about_ca_system_score_gemma":0.0063463715,"threshold_uncertainty_score":0.88955075},"labels":[],"label_agreement":null},{"id":"W4412488270","doi":"10.1177/09622802251357021","title":"Design of egocentric network-based studies to estimate causal effects under interference","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Roche (Canada)","funders":"National Institute on Drug Abuse; National Institute of Mental Health","keywords":"Spillover effect; Psychological intervention; Leverage (statistics); Sample size determination; Randomized experiment; Randomized controlled trial; Intervention (counseling); Population; Psychology; Causal inference; Econometrics; Statistics; Computer science; Medicine; Mathematics; Environmental health","score_opus":0.47673270997648753,"score_gpt":0.6947664410253729,"score_spread":0.21803373104888535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412488270","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028654724,0.00015942269,0.95484614,0.0006111355,0.00015866886,0.012841208,0.00030178824,0.00019338148,0.0022336186],"genre_scores_gemma":[0.25877267,0.00028843043,0.6624374,0.00057758996,0.00010733177,0.07571098,0.00023722167,0.000033580418,0.0018348536],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9052009,0.08567848,0.0015371933,0.004755057,0.0019615856,0.000866834],"domain_scores_gemma":[0.92273796,0.055843122,0.00712471,0.009695677,0.003456876,0.0011417264],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08852015,0.0017209043,0.0025689844,0.0017201991,0.001023445,0.0018334403,0.0039223,0.0027081242,0.007823443],"category_scores_gemma":[0.10154846,0.0014598756,0.0020694803,0.0010738376,0.0036509582,0.0028960013,0.0037444492,0.0024811022,0.0006693272],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012927443,0.0029203447,0.01264455,0.0022700157,0.0017162354,0.00034658975,0.0014637032,0.19361575,0.0052572475,0.644048,0.002538762,0.12025145],"study_design_scores_gemma":[0.008491239,0.008433692,0.0047160047,0.00038014754,0.0010933521,0.00017568364,0.00044496843,0.5548351,0.0044610994,0.40708658,0.009710699,0.00017148552],"about_ca_topic_score_codex":0.0010560297,"about_ca_topic_score_gemma":0.0008414228,"teacher_disagreement_score":0.91147983,"about_ca_system_score_codex":0.0021276989,"about_ca_system_score_gemma":0.0033507308,"threshold_uncertainty_score":0.4681449},"labels":[],"label_agreement":null},{"id":"W4412493510","doi":"10.1038/s41746-025-01821-w","title":"Negative control-calibrated difference-in-difference analyses: addressing unmeasured confounding in RWD with application to racial/ethnic differences","year":2025,"lang":"en","type":"article","venue":"npj Digital Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Center for Advancing Translational Sciences; National Institute of Diabetes and Digestive and Kidney Diseases; National Institute of Allergy and Infectious Diseases; National Eye Institute; National Institute of Mental Health; U.S. National Library of Medicine; Patient-Centered Outcomes Research Institute; National Institute on Aging; National Institutes of Health","keywords":"Confounding; Ethnic group; Causal inference; Health records; Health equity; Control (management); Health care; Medicine; Psychology; Computer science; Statistics; Mathematics; Public health; Artificial intelligence; Nursing; Internal medicine","score_opus":0.19159917289522901,"score_gpt":0.4660973734039519,"score_spread":0.27449820050872287,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412493510","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02220399,0.00058151153,0.97278553,0.0012963694,0.00024449266,0.0004543885,0.0007871975,0.00025634075,0.0013902743],"genre_scores_gemma":[0.6276954,0.00043761556,0.36613217,0.0013237828,0.00030050802,0.0014522427,0.0011385388,0.00013196246,0.001387767],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.92576885,0.061024293,0.0020677054,0.007601731,0.002834341,0.00070310524],"domain_scores_gemma":[0.77721,0.18707374,0.0114820255,0.019858569,0.0037231487,0.00065254833],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08577937,0.001363591,0.0018555473,0.0021285992,0.0012051631,0.0025826392,0.0042725387,0.002040869,0.003848685],"category_scores_gemma":[0.27552336,0.0008875237,0.0030758053,0.0025842488,0.0039897743,0.0025580248,0.0040348857,0.004215748,0.00030567282],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011793252,0.00049926277,0.17706358,0.0015744858,0.005720659,0.0012102998,0.0025308053,0.20597172,0.001266238,0.36556122,0.0064101075,0.23101233],"study_design_scores_gemma":[0.00048966776,0.00046484484,0.022158382,0.00043893076,0.0008978925,0.00043644255,0.00048565472,0.5408581,0.0028654218,0.41517976,0.015558119,0.00016690703],"about_ca_topic_score_codex":0.008231083,"about_ca_topic_score_gemma":0.0047501856,"teacher_disagreement_score":0.91422063,"about_ca_system_score_codex":0.0019547914,"about_ca_system_score_gemma":0.0030689149,"threshold_uncertainty_score":0.45365006},"labels":[],"label_agreement":null},{"id":"W4412527389","doi":"10.1002/sim.70194","title":"A Simple Diagnostic for the Positivity Assumption for Continuous Exposures","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal; McGill University","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Simple (philosophy); Statistics; Computer science; Econometrics; Mathematics","score_opus":0.0848985461080552,"score_gpt":0.46413627148375325,"score_spread":0.37923772537569805,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412527389","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022857497,0.0005918221,0.9625274,0.0057846056,0.00046522054,0.0004978661,0.0008957758,0.0004535706,0.0059262663],"genre_scores_gemma":[0.60213,0.00052645395,0.38665465,0.0039347843,0.0010211895,0.0018997565,0.0011027737,0.00014182388,0.0025885394],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96773595,0.019558685,0.001753852,0.0054277345,0.004670186,0.00085359596],"domain_scores_gemma":[0.6065036,0.34535494,0.019755943,0.017365534,0.0087665785,0.0022534016],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.055581428,0.0012574603,0.0022364182,0.004457298,0.0017244009,0.0036548108,0.004021943,0.0067104427,0.016414968],"category_scores_gemma":[0.4067241,0.0007217863,0.0020845404,0.0029171337,0.007955331,0.007727457,0.0050481344,0.008399821,0.0018409936],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011959146,0.000308594,0.026652467,0.00094501564,0.0002915812,0.0009760086,0.0013354928,0.0116038,0.0028433255,0.8188689,0.010777776,0.124201275],"study_design_scores_gemma":[0.0003073546,0.0004711087,0.0054967264,0.00036603629,0.00012254472,0.0015758113,0.00023825544,0.09461856,0.0020524329,0.8871074,0.0075383764,0.00010536337],"about_ca_topic_score_codex":0.0007477104,"about_ca_topic_score_gemma":0.00039649638,"teacher_disagreement_score":0.055581428,"about_ca_system_score_codex":0.0015142484,"about_ca_system_score_gemma":0.0035572234,"threshold_uncertainty_score":0.29394627},"labels":[],"label_agreement":null},{"id":"W4412611378","doi":"10.1080/03610918.2025.2534890","title":"Estimating average treatment effect using multiple imputation for handling confounder missingness","year":2025,"lang":"en","type":"article","venue":"Communications in Statistics - Simulation and Computation","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; McGill University","funders":"","keywords":"Missing data; Imputation (statistics); Confounding; Statistics; Econometrics; Computer science; Mathematics","score_opus":0.350366369946548,"score_gpt":0.5625194638831538,"score_spread":0.21215309393660575,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412611378","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013449484,0.00047540964,0.9973201,0.00014727771,0.000060477705,0.000092195856,0.000078601835,0.00018168981,0.00029939367],"genre_scores_gemma":[0.104941145,0.0011517365,0.8910679,0.00049615355,0.00028668554,0.0008446398,0.00042897763,0.00020034862,0.0005823725],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9578502,0.033642177,0.0017337867,0.0025676934,0.0037944468,0.0004116736],"domain_scores_gemma":[0.91271794,0.065301314,0.006523939,0.011606362,0.0034177566,0.00043270818],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.039946217,0.0010127341,0.002911792,0.0028166345,0.00072033814,0.0025118052,0.0032828785,0.0020541043,0.0033021711],"category_scores_gemma":[0.15773003,0.00073996244,0.0036981637,0.003090334,0.0008981528,0.0025168136,0.0025867021,0.0032892053,0.00075566804],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006356127,0.00027247227,0.01902719,0.0029256926,0.004539451,0.00034546686,0.0007652215,0.09977986,0.0032241342,0.19345568,0.006494035,0.6685352],"study_design_scores_gemma":[0.0004823604,0.00095189334,0.006344597,0.0010341926,0.0020397028,0.00085701694,0.0002021115,0.64497155,0.0068541807,0.3096598,0.026366632,0.00023588227],"about_ca_topic_score_codex":0.0012419997,"about_ca_topic_score_gemma":0.0010398999,"teacher_disagreement_score":0.9600538,"about_ca_system_score_codex":0.0006931498,"about_ca_system_score_gemma":0.0025319313,"threshold_uncertainty_score":0.21125829},"labels":[],"label_agreement":null},{"id":"W4412862751","doi":"10.1007/s43441-025-00849-0","title":"Real-World Data and Causal Machine Learning to Enhance Drug Development","year":2025,"lang":"en","type":"review","venue":"Therapeutic Innovation & Regulatory Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Sanofi","keywords":"Pharmacy; Drug development; Computer science; Drug; Data science; Machine learning; Artificial intelligence; Pharmacology; Medicine; Family medicine","score_opus":0.21358238904276414,"score_gpt":0.4842258044071093,"score_spread":0.2706434153643451,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412862751","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004900374,0.96251655,0.024699071,0.0071330667,0.0004941489,0.00008307496,0.00014390802,0.00007171489,0.004368389],"genre_scores_gemma":[0.018100543,0.9613396,0.016505793,0.0021353534,0.0008640881,0.00015821145,0.00015889216,0.000020290188,0.0007171742],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99557567,0.0030463506,0.00024904122,0.00029953537,0.00073638314,0.00009306132],"domain_scores_gemma":[0.97496563,0.02261574,0.00093257305,0.000604322,0.00073453813,0.00014722072],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010997834,0.00094378553,0.0016614991,0.003435091,0.00028962165,0.0019698509,0.0016509938,0.0019947677,0.005245864],"category_scores_gemma":[0.025856014,0.00043857624,0.0018176533,0.0030250251,0.0018691444,0.0028004276,0.0014425747,0.0037171587,0.0009500187],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008109736,0.000116813826,0.00064699346,0.023787629,0.00074624683,0.000101052385,0.00011439331,0.0063652773,0.00026545624,0.185697,0.013765359,0.7683126],"study_design_scores_gemma":[0.00018175386,0.00028711229,0.0022936785,0.03616849,0.0009848411,0.00071441435,0.00016287713,0.010001191,0.0011464357,0.41930795,0.528637,0.00011432897],"about_ca_topic_score_codex":0.0016317648,"about_ca_topic_score_gemma":0.0020225758,"teacher_disagreement_score":0.010997834,"about_ca_system_score_codex":0.0018377482,"about_ca_system_score_gemma":0.004000833,"threshold_uncertainty_score":0.05816281},"labels":[],"label_agreement":null},{"id":"W4413024598","doi":"10.1002/pst.70029","title":"Target Aggregate Data Adjustment Method for Transportability Analysis Utilizing Summary‐Level Data From the Target Population","year":2025,"lang":"en","type":"article","venue":"Pharmaceutical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; University of British Columbia; York University; Centre for Advancing Health Outcomes; Impact; Simon Fraser University","funders":"Canadian Statistical Sciences Institute; Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Censoring (clinical trials); Interpretability; Computer science; Weighting; Causal inference; Population; Statistics; Aggregate data; Statistical inference; Inference; Inverse probability weighting; Econometrics; Data mining; Estimator; Artificial intelligence; Mathematics; Medicine","score_opus":0.513051299481403,"score_gpt":0.5578152948638562,"score_spread":0.044763995382453126,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413024598","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002129619,0.000105231884,0.9966673,0.00011622587,0.000041060524,0.00019594598,0.00019063849,0.0001960557,0.00035789216],"genre_scores_gemma":[0.20056033,0.00045558618,0.7916574,0.0004374067,0.00023737612,0.002605142,0.0016912526,0.00035660728,0.001998937],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9829488,0.011116539,0.0012178604,0.0022365085,0.0021852187,0.00029506],"domain_scores_gemma":[0.9627758,0.023850178,0.0037411181,0.0062945094,0.0030379489,0.00030052342],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029208409,0.0011658231,0.0015812577,0.0035108863,0.0008398624,0.0015367848,0.0022035984,0.0012675885,0.006404094],"category_scores_gemma":[0.088023536,0.0005416622,0.0032111318,0.003880801,0.0011465232,0.0025952219,0.0028870527,0.0031830478,0.00076135335],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00071817293,0.00028208442,0.02504283,0.0010838116,0.002340155,0.00033581033,0.00082506635,0.09903526,0.0037283346,0.2345642,0.010248155,0.62179613],"study_design_scores_gemma":[0.00038288083,0.0006064433,0.0109311165,0.00021606438,0.000895532,0.00030053922,0.00017011927,0.6582608,0.0049086064,0.28836796,0.034826018,0.00013393397],"about_ca_topic_score_codex":0.0030450805,"about_ca_topic_score_gemma":0.0019838118,"teacher_disagreement_score":0.029208409,"about_ca_system_score_codex":0.0012427156,"about_ca_system_score_gemma":0.0025926298,"threshold_uncertainty_score":0.15447068},"labels":[],"label_agreement":null},{"id":"W4413113797","doi":"10.1007/s40264-025-01597-8","title":"The Extent and Magnitude of Bias in Case-Crossover Studies of Real-World Non-transient Medications Patterns: A Simulation Study with Real-World Examples","year":2025,"lang":"en","type":"article","venue":"Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Medicine; Crossover study; Statistics; Logistic regression; Magnitude (astronomy); Crossover; Cohort; Cohort study; Econometrics; Internal medicine; Mathematics; Computer science; Artificial intelligence; Pathology","score_opus":0.13412218584066074,"score_gpt":0.4441656779692209,"score_spread":0.3100434921285602,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413113797","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80145,0.0053798105,0.17902273,0.0010938679,0.00041533788,0.0075037396,0.0015463178,0.00024383087,0.00334441],"genre_scores_gemma":[0.9632041,0.00056843774,0.03197777,0.0002823728,0.00005264359,0.0029803899,0.00042431706,0.000015232368,0.00049473206],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.88011336,0.105217315,0.0046768677,0.005509864,0.003253717,0.001228856],"domain_scores_gemma":[0.455185,0.4923411,0.028030457,0.016353568,0.006959711,0.0011302237],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17684358,0.0013577285,0.0022731384,0.0013240038,0.00080300396,0.0023559986,0.0024240885,0.003844081,0.00363229],"category_scores_gemma":[0.25764236,0.0009810869,0.008212403,0.0012624689,0.002038759,0.002154322,0.001555844,0.0023913875,0.00027312365],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.05656951,0.004968932,0.30725023,0.0044936305,0.025471428,0.0028841714,0.0023541672,0.5125593,0.003159334,0.02283212,0.0031860403,0.0542712],"study_design_scores_gemma":[0.019669168,0.03736456,0.07658758,0.0018893289,0.01816571,0.0018492746,0.0011812997,0.7978213,0.0055105467,0.032048196,0.0073182276,0.0005948763],"about_ca_topic_score_codex":0.004624474,"about_ca_topic_score_gemma":0.0022703314,"teacher_disagreement_score":0.8231564,"about_ca_system_score_codex":0.0023037854,"about_ca_system_score_gemma":0.002045539,"threshold_uncertainty_score":0.93524945},"labels":[],"label_agreement":null},{"id":"W4413214703","doi":"10.15695/jstem/v8i1.05","title":"Testing the Efficacy of Educational Interventions on Matched Student Samples: A Primer for Propensity Score Matching in R","year":2025,"lang":"en","type":"article","venue":"The Journal of STEM Outreach","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"National Institutes of Health","keywords":"Propensity score matching; Matching (statistics); Psychological intervention; Primer (cosmetics); Psychology; Internal medicine; Statistics; Computer science; Medicine; Mathematics; Chemistry","score_opus":0.3755214620628621,"score_gpt":0.4685429570865438,"score_spread":0.09302149502368173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413214703","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013390306,0.0004622445,0.99148315,0.0012132997,0.00024331825,0.0014542686,0.0006631651,0.0018943169,0.001247216],"genre_scores_gemma":[0.014451526,0.00039968608,0.97432953,0.000505238,0.000106831314,0.00867542,0.0003138432,0.00070065627,0.0005171817],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.7566175,0.2171468,0.007905611,0.0075539243,0.009931084,0.00084512],"domain_scores_gemma":[0.4933018,0.4444153,0.014582993,0.038002957,0.0087102875,0.000986596],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21650699,0.0031705871,0.0042614164,0.005690524,0.0016539916,0.005830301,0.004870388,0.0035803316,0.01785567],"category_scores_gemma":[0.5365052,0.0023925493,0.007444591,0.007543145,0.0067850165,0.0047485493,0.0068680244,0.008983103,0.005836214],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015874584,0.0004651991,0.023176908,0.007406429,0.008116609,0.0011053504,0.0044062356,0.037720606,0.002038994,0.47313282,0.05769674,0.38314667],"study_design_scores_gemma":[0.0016480356,0.00082403276,0.007930721,0.0032280607,0.0015928139,0.00080948905,0.000791924,0.21620211,0.0043450235,0.6583006,0.10386523,0.00046191967],"about_ca_topic_score_codex":0.004832294,"about_ca_topic_score_gemma":0.0031088842,"teacher_disagreement_score":0.21650699,"about_ca_system_score_codex":0.0020081305,"about_ca_system_score_gemma":0.0071107927,"threshold_uncertainty_score":0.96618634},"labels":[],"label_agreement":null},{"id":"W4413251260","doi":"10.3389/jpps.2025.14587","title":"A review to determine regulatorily and reimbursement successes of studies conducted using data from Canadian patient support programs based on the real-world evidence guidelines published by Canadian drug agency and health Canada","year":2025,"lang":"en","type":"review","venue":"Journal of Pharmacy & Pharmaceutical Sciences","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Reimbursement; Checklist; Guideline; Medicine; Transparency (behavior); Agency (philosophy); Health care; Family medicine; Computer science; Psychology; Political science","score_opus":0.7435917888039851,"score_gpt":0.6146929825048406,"score_spread":0.12889880629914452,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413251260","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011062741,0.9900024,0.00054150133,0.0015494691,0.000427505,0.0017623301,0.0029013087,0.000028882509,0.0016802966],"genre_scores_gemma":[0.021134581,0.9682529,0.0031611996,0.0023642436,0.0001910803,0.0026848216,0.0018732524,0.000029551224,0.00030841283],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.9272602,0.015132415,0.031085705,0.0030562647,0.021818884,0.00164654],"domain_scores_gemma":[0.67751485,0.18935168,0.051201887,0.0062716994,0.073132776,0.0025271117],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05568166,0.001825631,0.009207781,0.034176696,0.0027484896,0.006981975,0.005192077,0.0031166598,0.004696611],"category_scores_gemma":[0.22962683,0.0017258953,0.008799547,0.03510004,0.0030110176,0.003822351,0.0027771166,0.0022002752,0.00056475034],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":true,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020659964,0.000016155105,0.0020043114,0.9255655,0.0049994113,0.00014424781,0.00050429633,0.00010260591,0.00021126153,0.00053091976,0.005826158,0.05988854],"study_design_scores_gemma":[0.00014645772,0.0000559556,0.0057966434,0.9285614,0.023000391,0.00018721691,0.0002670832,0.00005133639,0.00022700265,0.00020543624,0.041457433,0.00004364627],"about_ca_topic_score_codex":0.1894735,"about_ca_topic_score_gemma":0.3657697,"teacher_disagreement_score":0.9682541,"about_ca_system_score_codex":0.031745896,"about_ca_system_score_gemma":0.14291434,"threshold_uncertainty_score":0.3767413},"labels":[],"label_agreement":null},{"id":"W4413374629","doi":"10.1093/aje/kwaf182","title":"Use of causal inference methods in case–control studies: a methodology review","year":2025,"lang":"en","type":"review","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"AstraZeneca (Canada); Université de Montréal; Statistics Canada; Institut National de la Recherche Scientifique","funders":"","keywords":"Causal inference; Covariate; Inverse probability weighting; Inference; Propensity score matching; Statistics; Weighting; Confounding; Estimator; Econometrics; Computer science; Medicine; Artificial intelligence; Mathematics","score_opus":0.7751389073668156,"score_gpt":0.6853217108520706,"score_spread":0.08981719651474496,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413374629","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00006583436,0.9945445,0.004048375,0.00057026866,0.00020052887,0.00012717517,0.00006376876,0.000017021966,0.00036238888],"genre_scores_gemma":[0.0010901971,0.99097216,0.007099347,0.00025817184,0.00015498888,0.00025870002,0.000055854776,0.00001162686,0.00009891157],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9663343,0.020624654,0.0058675893,0.0016517191,0.0052042045,0.0003175118],"domain_scores_gemma":[0.80368054,0.17886205,0.0067883977,0.0027916338,0.0075073307,0.00036994374],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04672933,0.0018211337,0.005218469,0.01609937,0.0007684152,0.00302209,0.0033712476,0.0030353537,0.005629584],"category_scores_gemma":[0.12808356,0.0014438446,0.005553605,0.015614444,0.0017411885,0.0034983035,0.0017382966,0.0027081408,0.0014186125],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008454729,0.000059879523,0.0007651958,0.26550135,0.002477326,0.00013915078,0.0002859591,0.0009984666,0.00019560181,0.010440238,0.010734702,0.7083175],"study_design_scores_gemma":[0.00020284244,0.00030752833,0.0044975574,0.45784518,0.010020649,0.0018421,0.00037134677,0.0017792563,0.00091059913,0.027134048,0.49487936,0.00020954268],"about_ca_topic_score_codex":0.003969711,"about_ca_topic_score_gemma":0.0052368115,"teacher_disagreement_score":0.9532707,"about_ca_system_score_codex":0.0036701474,"about_ca_system_score_gemma":0.009300293,"threshold_uncertainty_score":0.24713123},"labels":[],"label_agreement":null},{"id":"W4413452402","doi":"10.31234/osf.io/rqexa_v1","title":"Think outside the box: Making up causal hypotheses from unreliable evidence","year":2025,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"Dalhousie University","keywords":"Psychology; Econometrics; Data science; Epistemology; Computer science; Economics; Philosophy","score_opus":0.26856933784134346,"score_gpt":0.4539863764565206,"score_spread":0.18541703861517717,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413452402","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20670469,0.00038859728,0.7858826,0.0024004364,0.00003260212,0.000113787595,0.00018094709,0.00036196198,0.003934394],"genre_scores_gemma":[0.77223206,0.00027714064,0.22610958,0.00025378578,0.000045936682,0.00011628914,0.00017543252,0.00008381283,0.00070589356],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9950767,0.0028634083,0.00025390982,0.0008076182,0.0007580369,0.00024047587],"domain_scores_gemma":[0.9160773,0.073518634,0.004345208,0.0039370614,0.0013448938,0.0007770113],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.010312845,0.00068813376,0.0009615464,0.0021473682,0.00083532144,0.0040919445,0.003002781,0.0017716433,0.003166161],"category_scores_gemma":[0.08699891,0.0013625337,0.0018366274,0.0013027182,0.006208555,0.0083310185,0.0026594691,0.0025698754,0.00034472518],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063930737,0.00019750612,0.035328794,0.0006382593,0.0005304752,0.0015269273,0.0050693424,0.22975445,0.004714018,0.5733599,0.001925775,0.14631517],"study_design_scores_gemma":[0.00007653884,0.000057598503,0.0026065703,0.000088659515,0.00009062467,0.00028924836,0.00034888746,0.42238468,0.003010489,0.56975377,0.0012448184,0.000048059763],"about_ca_topic_score_codex":0.0032906279,"about_ca_topic_score_gemma":0.0030035519,"teacher_disagreement_score":0.98968714,"about_ca_system_score_codex":0.0012199822,"about_ca_system_score_gemma":0.0018022964,"threshold_uncertainty_score":0.054540157},"labels":[],"label_agreement":null},{"id":"W4413696582","doi":"10.1097/ede.0000000000001902","title":"Is Checking for Sequential Positivity Violations Getting You Down? Try sPoRT!","year":2025,"lang":"en","type":"article","venue":"Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital; McGill University Health Centre; Université de Montréal","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Natural Sciences and Engineering Research Council of Canada; National Institute of Child Health and Human Development; Institut de Valorisation des Données; National Institute on Drug Abuse; National Cancer Institute; National Institute on Alcohol Abuse and Alcoholism; National Institute of Allergy and Infectious Diseases; National Institutes of Health; National Institute of Diabetes and Digestive and Kidney Diseases; Fogarty International Center; National Heart, Lung, and Blood Institute","keywords":"Computer science","score_opus":0.27364992656943876,"score_gpt":0.5105732487689053,"score_spread":0.23692332219946655,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413696582","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04898367,0.00094240793,0.92121047,0.01927069,0.00081920857,0.0004077472,0.001418253,0.0023215935,0.004625987],"genre_scores_gemma":[0.36445063,0.0007861918,0.62165654,0.0064459825,0.0007717134,0.0006189872,0.0014561453,0.0010668521,0.0027469958],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96392727,0.025627168,0.0024395962,0.0038293242,0.0036220353,0.0005546001],"domain_scores_gemma":[0.7045231,0.23580906,0.021608101,0.02397995,0.011848886,0.0022309264],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06532789,0.0010146289,0.0016611362,0.002384474,0.0017737048,0.0032760643,0.0028012253,0.002686213,0.013915106],"category_scores_gemma":[0.34767866,0.0009686152,0.0029045194,0.0026488537,0.003290614,0.0056668767,0.0029676673,0.005055094,0.002750625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017447566,0.00028020111,0.20786446,0.0011375896,0.0017156429,0.0013309876,0.0027461192,0.023617955,0.0025524087,0.10489358,0.06694257,0.5851738],"study_design_scores_gemma":[0.0005165273,0.0008351745,0.03006584,0.0013223098,0.0007228402,0.0026120557,0.0011909888,0.2436791,0.007018617,0.663055,0.04872544,0.00025613618],"about_ca_topic_score_codex":0.003904022,"about_ca_topic_score_gemma":0.0044595306,"teacher_disagreement_score":0.9346721,"about_ca_system_score_codex":0.00090553495,"about_ca_system_score_gemma":0.003700387,"threshold_uncertainty_score":0.34549105},"labels":[],"label_agreement":null},{"id":"W4413981169","doi":"10.1136/heartjnl-2025-326218","title":"Benefit–risk of colchicine and spironolactone in acute myocardial infarction: a prespecified generalised pairwise comparisons analysis of the CLEAR trial","year":2025,"lang":"en","type":"article","venue":"Heart","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"London Health Sciences Centre; Southlake Regional Health Center; Genome Prairie; Health Sciences Centre; Centre Hospitalier Universitaire de Sherbrooke; Sunnybrook Health Science Centre; University of Ottawa; Hamilton Health Sciences; Population Health Research Institute","funders":"Institute of Circulatory and Respiratory Health; Canadian Institutes of Health Research; Boston Scientific Corporation; Population Health Research Institute","keywords":"Medicine; Spironolactone; Myocardial infarction; Internal medicine; Placebo; Stroke (engine); Relative risk; Cardiology; Heart failure; Confidence interval","score_opus":0.08060094350871745,"score_gpt":0.3891539290421738,"score_spread":0.30855298553345634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413981169","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.81363535,0.019211413,0.13368651,0.0019805946,0.0012668984,0.015575157,0.0061124484,0.00082332693,0.0077083297],"genre_scores_gemma":[0.95203876,0.00077933446,0.035325725,0.0005852457,0.00020420803,0.00816452,0.0013187963,0.00019488936,0.0013885245],"study_design_codex":"randomized_trial","study_design_gemma":"nonrandomized_trial","domain_scores_codex":[0.820381,0.15951551,0.005056235,0.0068568466,0.0066869403,0.0015035367],"domain_scores_gemma":[0.8519601,0.12272501,0.010463484,0.011872804,0.0017944367,0.0011841826],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10083177,0.0029550397,0.0067785294,0.001506411,0.0003671502,0.0013940233,0.0019147506,0.0018930177,0.007886244],"category_scores_gemma":[0.1411917,0.0007343625,0.017076703,0.0011821109,0.001957167,0.0026931905,0.0027932795,0.0040457095,0.0004282693],"study_design_candidate":"nonrandomized_trial","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.6750724,0.0008626705,0.020761412,0.013400092,0.17913166,0.0008129684,0.0008570888,0.014255732,0.005563324,0.0073080068,0.005357843,0.07661693],"study_design_scores_gemma":[0.22724687,0.23089908,0.15836036,0.002595273,0.1903743,0.0013251674,0.00087042793,0.11777043,0.0077194823,0.04650315,0.015545367,0.0007899925],"about_ca_topic_score_codex":0.0004190954,"about_ca_topic_score_gemma":0.00062957406,"teacher_disagreement_score":0.10083177,"about_ca_system_score_codex":0.0008326585,"about_ca_system_score_gemma":0.0010325414,"threshold_uncertainty_score":0.5332557},"labels":[],"label_agreement":null},{"id":"W4413983884","doi":"10.1001/jamanetworkopen.2025.30277","title":"Design, Conduct, and Analysis of Externally Controlled Trials","year":2025,"lang":"en","type":"article","venue":"JAMA Network Open","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"National Science Fund for Distinguished Young Scholars; China Postdoctoral Science Foundation; National Natural Science Foundation of China","keywords":"External validity; Randomized controlled trial; Medicine; Research design; Selection bias; Clinical trial; Clinical study design; Covariate; Transparency (behavior); Protocol (science); Publication bias; Data collection; Meta-analysis; Medical physics; Statistics; Psychology; Alternative medicine; Computer science; Surgery; Internal medicine; Social psychology","score_opus":0.34572509597844836,"score_gpt":0.4984841668945698,"score_spread":0.15275907091612145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413983884","genre_codex":"protocol","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023555139,0.005625928,0.10243461,0.0046746987,0.0056361905,0.86858606,0.004585952,0.00082683953,0.0052741016],"genre_scores_gemma":[0.015775992,0.0012888244,0.14256206,0.0023027316,0.0006902972,0.83587503,0.00072686817,0.00016835403,0.00060986495],"study_design_codex":"systematic_review","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.15870559,0.6549615,0.12061009,0.019990137,0.04338706,0.002345583],"domain_scores_gemma":[0.15301137,0.4979058,0.12516452,0.13728496,0.08069162,0.005941786],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5616062,0.0063515035,0.016602308,0.017160794,0.0036584784,0.012969307,0.006433785,0.013454869,0.016023688],"category_scores_gemma":[0.7848698,0.004839736,0.009767208,0.018884346,0.013860827,0.010660917,0.006350721,0.011024769,0.007920871],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.03723298,0.0017043429,0.022776281,0.3956733,0.027277367,0.0011381134,0.009592577,0.006258559,0.004130789,0.066350944,0.081527084,0.34633765],"study_design_scores_gemma":[0.11878117,0.008373874,0.019971859,0.37347338,0.016816586,0.0009509588,0.0030895174,0.02775951,0.011773063,0.12034828,0.29720923,0.0014526619],"about_ca_topic_score_codex":0.0012714106,"about_ca_topic_score_gemma":0.0014001576,"teacher_disagreement_score":0.43839377,"about_ca_system_score_codex":0.008005818,"about_ca_system_score_gemma":0.045990646,"threshold_uncertainty_score":0.5406176},"labels":[],"label_agreement":null},{"id":"W4414120871","doi":"10.1007/s40487-025-00366-y","title":"A Practical Approach to Understanding Real-World Study Methodology in Cancer Research: A Vodcast","year":2025,"lang":"en","type":"article","venue":"Oncology and Therapy","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Pfizer","keywords":"Sample size determination; Research design; MEDLINE; Clinical Practice; Evidence-based medicine; Statistical analysis; Clinical trial; Statistical model","score_opus":0.8987679318139231,"score_gpt":0.6867908155549045,"score_spread":0.2119771162590186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414120871","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00018455368,0.0033991605,0.9294416,0.05069567,0.005735468,0.0014364435,0.00040843975,0.001113893,0.0075848023],"genre_scores_gemma":[0.0038517846,0.0039016784,0.9594689,0.017813995,0.0036773968,0.0047806078,0.00035828186,0.0008310045,0.005316385],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.80621856,0.1625981,0.0125031015,0.00341313,0.014347117,0.00092002854],"domain_scores_gemma":[0.57279766,0.35389185,0.008143751,0.02624992,0.033897735,0.0050191097],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.20122963,0.0020401138,0.002090957,0.0071224975,0.0028975122,0.011066653,0.006169948,0.0063202106,0.027741004],"category_scores_gemma":[0.41033795,0.0024617151,0.002903093,0.005359355,0.011699629,0.012892723,0.015362463,0.020423688,0.015993875],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010366061,0.000110377936,0.0008503595,0.0022171861,0.00010532347,0.00029278192,0.0023889374,0.0029755328,0.0004888096,0.32041076,0.38506278,0.28499362],"study_design_scores_gemma":[0.00011255026,0.0001829921,0.000382322,0.0035784387,0.000044955126,0.00080951187,0.0009277701,0.0063599763,0.00042678093,0.43723568,0.5498472,0.00009183606],"about_ca_topic_score_codex":0.0024172785,"about_ca_topic_score_gemma":0.0041666795,"teacher_disagreement_score":0.79877037,"about_ca_system_score_codex":0.0050461637,"about_ca_system_score_gemma":0.015877346,"threshold_uncertainty_score":0.98502606},"labels":[],"label_agreement":null},{"id":"W4414268632","doi":"10.32388/219by1","title":"Review of: \"Misestimation of Expected Genetic Differences: A Statistical Note on Some Recent Papers\"","year":2025,"lang":"en","type":"peer-review","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Statistical analysis; Genetic data; Statistical model; Statistical hypothesis testing","score_opus":0.17544894329272584,"score_gpt":0.4634740095513075,"score_spread":0.2880250662585817,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414268632","genre_codex":"commentary","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011203522,0.29777727,0.11868099,0.4299626,0.12736496,0.00023022575,0.0025349315,0.0008855491,0.02144312],"genre_scores_gemma":[0.03056601,0.44351214,0.08173277,0.121052474,0.26868603,0.000519739,0.0031948541,0.001905836,0.04883011],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9761571,0.010284769,0.0017761497,0.0022055982,0.009255184,0.00032127812],"domain_scores_gemma":[0.5972289,0.29327214,0.0073371585,0.012300928,0.087993406,0.001867401],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05720035,0.0009949853,0.0019712462,0.007566481,0.001750791,0.0049280515,0.003794782,0.004685441,0.012660079],"category_scores_gemma":[0.27921697,0.000763468,0.0010283358,0.0092952475,0.00444095,0.006714871,0.0019923588,0.0052291667,0.00788892],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055539535,0.000023539807,0.00053640106,0.0017555864,0.000114578055,0.00011167373,0.00012870225,0.00069927267,0.00021481543,0.04600422,0.75033724,0.20001854],"study_design_scores_gemma":[0.00002816914,0.000039920247,0.0030068983,0.0022136015,0.0001300987,0.00038343162,0.00011919382,0.001807578,0.00075912254,0.06188633,0.9295282,0.00009747206],"about_ca_topic_score_codex":0.0059441617,"about_ca_topic_score_gemma":0.0076290835,"teacher_disagreement_score":0.05720035,"about_ca_system_score_codex":0.0031389645,"about_ca_system_score_gemma":0.008161863,"threshold_uncertainty_score":0.302508},"labels":[],"label_agreement":null},{"id":"W4414404097","doi":"10.1002/pds.70223","title":"Demystifying Clone‐Censor‐Weighting to Study Treatment Initiation Windows: An Example Using Publicly Available Synthetic Medicare Claims Data","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Jewish General Hospital; McGill University","funders":"","keywords":"Pharmacoepidemiology; MEDLINE; Data collection; Research design","score_opus":0.4703262874495665,"score_gpt":0.5073642905431359,"score_spread":0.037038003093569416,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414404097","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6454609,0.0019449143,0.3238466,0.0030742846,0.00017045959,0.0007800377,0.018830463,0.0011001832,0.00479222],"genre_scores_gemma":[0.8700319,0.00032359804,0.12021739,0.0002725824,0.000062561,0.00035298878,0.008062425,0.00011019061,0.0005663799],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9908869,0.00704301,0.0003928886,0.00077670667,0.0006776993,0.00022285005],"domain_scores_gemma":[0.92830634,0.057330087,0.004707519,0.0069567016,0.002263488,0.0004358122],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025807008,0.00057503633,0.0006333279,0.0021994442,0.0005162359,0.0011585492,0.0011479214,0.0009949148,0.002199189],"category_scores_gemma":[0.06739653,0.00025854816,0.0023913702,0.002833533,0.0005838842,0.00087020616,0.0013665785,0.00145182,0.00021876645],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025049036,0.00048936316,0.50784665,0.0005919685,0.0021812555,0.0008389868,0.0019321177,0.18555474,0.0017531889,0.046357527,0.01793992,0.23200935],"study_design_scores_gemma":[0.000517411,0.0007434259,0.14837606,0.00034098802,0.000553805,0.00078202464,0.0009461795,0.72861004,0.0029457319,0.08905148,0.026988203,0.00014474461],"about_ca_topic_score_codex":0.013571326,"about_ca_topic_score_gemma":0.008612983,"teacher_disagreement_score":0.025807008,"about_ca_system_score_codex":0.001316104,"about_ca_system_score_gemma":0.0011171226,"threshold_uncertainty_score":0.13648212},"labels":[],"label_agreement":null},{"id":"W4414425742","doi":"10.1056/evidstat2500246","title":"How Propensity Scores Work","year":2025,"lang":"en","type":"review","venue":"NEJM Evidence","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sinai Health System; University of Toronto","funders":"","keywords":"","score_opus":0.5882542406166034,"score_gpt":0.5149152834846253,"score_spread":0.07333895713197802,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414425742","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00079412264,0.93514156,0.025558215,0.025968913,0.001534915,0.00013964907,0.0006910702,0.00010658303,0.010064913],"genre_scores_gemma":[0.04367724,0.9055391,0.024530578,0.016618427,0.004614603,0.00067215785,0.0005286681,0.00011811985,0.0037010557],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9806769,0.015047371,0.0013450173,0.0010806808,0.0016182417,0.00023181943],"domain_scores_gemma":[0.9579585,0.03729617,0.0017104257,0.0013636417,0.0014685472,0.00020267101],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.024858354,0.0013838237,0.0043728496,0.0038055787,0.0004965511,0.0044942712,0.0017828904,0.0030720225,0.01804277],"category_scores_gemma":[0.08570211,0.0009337176,0.002610546,0.0044081435,0.0028762415,0.0052781636,0.0019875008,0.006892539,0.0024591638],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003133313,0.000058485955,0.0007585181,0.037880905,0.004136021,0.000084516585,0.00021342613,0.0027767888,0.00007843194,0.17611136,0.034877546,0.7427106],"study_design_scores_gemma":[0.0009234379,0.00018913619,0.0015789584,0.05018492,0.0052501424,0.0003575789,0.00015917375,0.0027192985,0.00022563251,0.7149137,0.22341175,0.000086238],"about_ca_topic_score_codex":0.0031109273,"about_ca_topic_score_gemma":0.004525651,"teacher_disagreement_score":0.97514164,"about_ca_system_score_codex":0.0014975936,"about_ca_system_score_gemma":0.005554996,"threshold_uncertainty_score":0.13146514},"labels":[],"label_agreement":null},{"id":"W4414476142","doi":"10.1002/cjs.70014","title":"Rank‐based estimation of propensity score weights via subclassification","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Office of Naval Research; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Weighting; Estimator; Robustness (evolution); Consistency (knowledge bases); Propensity score matching; Estimation; A-weighting","score_opus":0.14609836062377696,"score_gpt":0.3524692437893049,"score_spread":0.20637088316552793,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414476142","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013546042,0.00021793092,0.9844244,0.00016161586,0.000024256497,0.000081637634,0.00012037412,0.00016088631,0.0012628544],"genre_scores_gemma":[0.47712374,0.0007444127,0.51411337,0.00033392006,0.00021427577,0.0006137345,0.0010351472,0.00026001208,0.005561499],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9944443,0.003436625,0.00026447134,0.00079246465,0.0008804026,0.00018166193],"domain_scores_gemma":[0.9617124,0.02365022,0.0040351846,0.0070185727,0.0029407789,0.00064283004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013623643,0.00076114334,0.0015288251,0.0027253816,0.000582302,0.001881182,0.0018141011,0.00094225275,0.0056641954],"category_scores_gemma":[0.056194995,0.0004159166,0.00095874665,0.0021144343,0.0015178568,0.0026566554,0.002353037,0.002470406,0.00094117475],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002375621,0.00021275807,0.01707994,0.0003503378,0.00023171733,0.00013239912,0.0004474944,0.16374005,0.002066528,0.44011727,0.0065103252,0.3688736],"study_design_scores_gemma":[0.000035142573,0.000059053335,0.002152759,0.000116280324,0.000045268745,0.00008294313,0.00006491099,0.7032825,0.0013645412,0.2870098,0.005758207,0.000028594755],"about_ca_topic_score_codex":0.0029373765,"about_ca_topic_score_gemma":0.0020971508,"teacher_disagreement_score":0.013623643,"about_ca_system_score_codex":0.0010894611,"about_ca_system_score_gemma":0.0016288117,"threshold_uncertainty_score":0.07204956},"labels":[],"label_agreement":null},{"id":"W4414484180","doi":"10.1002/sim.70273","title":"Designing Stepped Wedge Cluster Randomized Trials With a Baseline Measurement of the Outcome","year":2025,"lang":"en","type":"article","venue":"Statistics in Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital; University of Ottawa","funders":"National Center for Advancing Translational Sciences; National Institute on Aging; Patient-Centered Outcomes Research Institute","keywords":"Baseline (sea); Sample size determination; Outcome (game theory); Estimator; Randomized controlled trial; Context (archaeology); Cluster randomised controlled trial; Cluster (spacecraft)","score_opus":0.2478030119876625,"score_gpt":0.4705801716423711,"score_spread":0.2227771596547086,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414484180","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011705442,0.00042822873,0.97915524,0.0005805959,0.00014519965,0.006178532,0.00024644658,0.00027452913,0.0012858954],"genre_scores_gemma":[0.1121521,0.00037186808,0.8727492,0.0005407425,0.00005466412,0.013375664,0.00018330461,0.00005244408,0.00051997683],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9231418,0.06766854,0.0022663618,0.003366899,0.0030473468,0.00050911657],"domain_scores_gemma":[0.84852636,0.12908404,0.0079436945,0.009674435,0.00406111,0.0007104487],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10018456,0.0013186949,0.002590712,0.0015991483,0.00052577374,0.0015813516,0.002975403,0.0019426008,0.004615194],"category_scores_gemma":[0.2103621,0.0010297553,0.002267074,0.0017826409,0.0019873003,0.002575792,0.0020294634,0.002689127,0.00070742593],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.008114084,0.0010447359,0.010434551,0.0071568163,0.0027829576,0.00053408096,0.0011884357,0.17724885,0.0030048375,0.46633452,0.0075617977,0.3145943],"study_design_scores_gemma":[0.008510923,0.0050173374,0.0022041404,0.0012130077,0.0013394413,0.00028161402,0.0003334232,0.44147682,0.00598157,0.5212519,0.012218419,0.00017140812],"about_ca_topic_score_codex":0.00059270236,"about_ca_topic_score_gemma":0.00064557913,"teacher_disagreement_score":0.89981544,"about_ca_system_score_codex":0.0010409475,"about_ca_system_score_gemma":0.004340224,"threshold_uncertainty_score":0.52983296},"labels":[],"label_agreement":null},{"id":"W4414642432","doi":"10.1177/09622802251374838","title":"Augmented two-stage estimation for treatment switching in oncology trials: Leveraging external data for improved precision","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MD Precision (Canada); University of British Columbia","funders":"","keywords":"Censoring (clinical trials); Randomized controlled trial; Estimation; Control (management); Sample size determination; Randomized response","score_opus":0.772245160354316,"score_gpt":0.7629188039075026,"score_spread":0.009326356446813455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414642432","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015730176,0.00076393987,0.98072344,0.00057444395,0.00010052393,0.00065342,0.00026450353,0.000522579,0.0006670374],"genre_scores_gemma":[0.38903195,0.0006847605,0.60470986,0.00078361493,0.00018461373,0.0018992367,0.001099577,0.00016225973,0.0014441502],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9053063,0.08350394,0.0028197998,0.0044075805,0.0033601688,0.00060229865],"domain_scores_gemma":[0.66344696,0.29155567,0.0136445975,0.023282472,0.006935853,0.0011344281],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.10338942,0.0017418532,0.0037262307,0.0015031418,0.000825659,0.0029598007,0.0027472563,0.0028145888,0.0028555428],"category_scores_gemma":[0.266479,0.001573931,0.00382947,0.0017929068,0.0017981977,0.0034369815,0.0037634948,0.0049999543,0.00053743133],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004479808,0.0007132472,0.038670734,0.0024404398,0.0038838799,0.0005618147,0.0015445773,0.47612876,0.0039156014,0.11378197,0.0050340365,0.34884515],"study_design_scores_gemma":[0.00084247236,0.00093882816,0.0044984897,0.00024147969,0.0004892896,0.00014931698,0.000073074785,0.9126696,0.0020820603,0.07399128,0.0039011943,0.00012292888],"about_ca_topic_score_codex":0.0033774553,"about_ca_topic_score_gemma":0.0033665325,"teacher_disagreement_score":0.89661056,"about_ca_system_score_codex":0.0012392133,"about_ca_system_score_gemma":0.0037241972,"threshold_uncertainty_score":0.546782},"labels":[],"label_agreement":null},{"id":"W4414897958","doi":"10.1177/09622802251382586","title":"Assessing spillover effects: Handling missing outcomes in network-based studies","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Allergy and Infectious Diseases; National Institutes of Health; National Institute of Mental Health; National Institute on Drug Abuse; Center for Drug Use and HIV Research; NYU Grossman School of Medicine; York University","keywords":"Censoring (clinical trials); Spillover effect; Estimator; Inverse probability; Observational study; Consistency (knowledge bases); Missing data; Intervention (counseling)","score_opus":0.5414715348528748,"score_gpt":0.7334598063847874,"score_spread":0.19198827153191256,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414897958","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02906183,0.0024164096,0.96489424,0.0009561539,0.00018745603,0.0009041406,0.00057766464,0.00020087828,0.0008013313],"genre_scores_gemma":[0.5739193,0.0018236462,0.41471246,0.000979541,0.00037534747,0.006370929,0.0009835357,0.00011540746,0.0007198511],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7773355,0.19283001,0.01155876,0.011036764,0.0063122893,0.00092661736],"domain_scores_gemma":[0.349041,0.5849289,0.031326126,0.028589632,0.0050347876,0.0010796428],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21005848,0.0017383884,0.0031168095,0.0046160966,0.001566372,0.003023806,0.004803904,0.0044141137,0.0029323085],"category_scores_gemma":[0.48504612,0.0014692477,0.004288841,0.0048396853,0.003580209,0.005018761,0.0059276293,0.0034491215,0.00023457153],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018969509,0.0006299241,0.38312376,0.012318886,0.02840808,0.0023416397,0.0054944274,0.12645628,0.0023038734,0.113494106,0.0031342164,0.32039788],"study_design_scores_gemma":[0.0009707656,0.0027682323,0.10324908,0.0044214167,0.012147035,0.001717649,0.0019320714,0.41096067,0.0048007667,0.4398547,0.016818002,0.0003596059],"about_ca_topic_score_codex":0.0030698895,"about_ca_topic_score_gemma":0.0020171094,"teacher_disagreement_score":0.78994155,"about_ca_system_score_codex":0.0013288681,"about_ca_system_score_gemma":0.0031882368,"threshold_uncertainty_score":0.9741385},"labels":[],"label_agreement":null},{"id":"W4414966744","doi":"10.1093/biomtc/ujaf128","title":"Inverse-intensity weighted generalized estimating equations for longitudinal data subject to irregular observation: which variables should be included in the visit rate model?","year":2025,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; Public Health Ontario; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Outcome (game theory); Conditional independence; Regression analysis; Inverse probability weighting; Generalized estimating equation; Regression; Linear regression; Weighting","score_opus":0.5402143993276196,"score_gpt":0.47497695751935703,"score_spread":0.06523744180826258,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414966744","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010501465,0.0006746759,0.98684186,0.0009584763,0.000092452145,0.00012044186,0.00024570958,0.00017709343,0.00038768494],"genre_scores_gemma":[0.19896956,0.0026845033,0.78920466,0.0011774676,0.00041410734,0.0015758821,0.0016962627,0.0002688231,0.0040086964],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9779181,0.018000504,0.0008095234,0.001659385,0.0012043432,0.00040812502],"domain_scores_gemma":[0.92985946,0.054278407,0.005131891,0.00781091,0.0026300661,0.00028919033],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040986177,0.00092964753,0.0026324687,0.0015017277,0.0004486311,0.0017662874,0.0039838743,0.0019077328,0.003189718],"category_scores_gemma":[0.16419347,0.0010352392,0.0026838174,0.0038589123,0.0012198008,0.0039674374,0.0017749597,0.004087736,0.0007800611],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034804954,0.00024145824,0.05994097,0.0009477393,0.002437728,0.00036079288,0.0012199893,0.10597974,0.0011519267,0.418256,0.010501665,0.39861396],"study_design_scores_gemma":[0.0001582732,0.00020473507,0.013129927,0.0004304786,0.00066049566,0.0002108586,0.00022343364,0.46032476,0.00066039397,0.51028574,0.013593029,0.00011782746],"about_ca_topic_score_codex":0.010654737,"about_ca_topic_score_gemma":0.010454282,"teacher_disagreement_score":0.040986177,"about_ca_system_score_codex":0.0010129971,"about_ca_system_score_gemma":0.0020246636,"threshold_uncertainty_score":0.21675825},"labels":[],"label_agreement":null},{"id":"W4415036455","doi":"10.48550/arxiv.2505.20893","title":"A longitudinal Bayesian framework for estimating causal dose-response relationships","year":2025,"lang":"en","type":"preprint","venue":"ArXiv.org","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Engineering and Physical Sciences Research Council; Canadian Institutes of Health Research","keywords":"Bayesian probability; Outcome (game theory); Propensity score matching; Causal model; Marginal model; Confounding; Nonparametric statistics; Dirichlet process; Generalized estimating equation","score_opus":0.32400446500037133,"score_gpt":0.4596934005287543,"score_spread":0.13568893552838296,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415036455","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017750015,0.00044661996,0.99563736,0.00064966315,0.000041953943,0.00009602135,0.00047352698,0.00017437967,0.0007054542],"genre_scores_gemma":[0.13511463,0.0029130604,0.8482698,0.00093345804,0.0005987778,0.0022733642,0.002313871,0.0002292098,0.0073538027],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98294777,0.012777023,0.00057953526,0.0019474813,0.0013366335,0.00041148713],"domain_scores_gemma":[0.9441397,0.04607404,0.0030117747,0.0038328215,0.0023274901,0.00061417936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040177215,0.0018064212,0.002982758,0.00408615,0.0014493819,0.002942004,0.005244038,0.002978654,0.011987567],"category_scores_gemma":[0.09179867,0.0021758906,0.0034700674,0.005217279,0.0028540604,0.0040690014,0.0034239192,0.0054473598,0.0017434567],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022176882,0.0001887502,0.0071457196,0.0005318058,0.0007578908,0.00040365828,0.0005935733,0.15526214,0.0006980699,0.70355207,0.006457763,0.1241867],"study_design_scores_gemma":[0.00013529764,0.000093541756,0.0015877226,0.0001570892,0.00022803155,0.00020167172,0.00007975187,0.32669,0.00026376272,0.6607201,0.009785518,0.000057499845],"about_ca_topic_score_codex":0.01846819,"about_ca_topic_score_gemma":0.017422898,"teacher_disagreement_score":0.040177215,"about_ca_system_score_codex":0.0027474978,"about_ca_system_score_gemma":0.0053635505,"threshold_uncertainty_score":0.21247995},"labels":[],"label_agreement":null},{"id":"W4415059812","doi":"10.1080/10705511.2025.2559270","title":"Controlling for Large Sets of Measured Confounders in Mediation Analysis: Comparison of Bayesian Model Averaging, the LASSO, and Path Analysis","year":2025,"lang":"en","type":"article","venue":"Structural Equation Modeling A Multidisciplinary Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds de recherche du Québec","keywords":"Bayesian probability; Path analysis (statistics); Path (computing); Bayesian inference; Confounding; Mediation","score_opus":0.16874481179621337,"score_gpt":0.44927888921299813,"score_spread":0.28053407741678477,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415059812","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027852079,0.0017713272,0.9673145,0.0011352712,0.000066028675,0.00024757505,0.00009476634,0.00022549577,0.0012929704],"genre_scores_gemma":[0.32785782,0.0024263416,0.66636914,0.00044321662,0.0001910076,0.0014989794,0.00033155244,0.00027719143,0.0006047193],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8900596,0.10028581,0.0014845674,0.0024683883,0.004943841,0.00075765664],"domain_scores_gemma":[0.6876426,0.28710827,0.007458411,0.0122772595,0.004609983,0.00090342696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12937315,0.0020403233,0.0031458894,0.0029782222,0.0013720681,0.0023018376,0.0023924864,0.0017767585,0.0018345988],"category_scores_gemma":[0.27498367,0.00096258026,0.002883626,0.0032450934,0.0030881502,0.00583698,0.0055584926,0.0034958806,0.00023498341],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002015359,0.0005354086,0.021555377,0.0012450558,0.0047986507,0.00026457044,0.0033718834,0.14739822,0.0016228139,0.31507343,0.0031773914,0.4989418],"study_design_scores_gemma":[0.00046384643,0.0007781883,0.0073010465,0.00044883406,0.0012340047,0.0002355228,0.00057208637,0.52749735,0.0016316359,0.45427084,0.005394822,0.00017186248],"about_ca_topic_score_codex":0.0032111746,"about_ca_topic_score_gemma":0.0027024122,"teacher_disagreement_score":0.12937315,"about_ca_system_score_codex":0.0011450142,"about_ca_system_score_gemma":0.003909981,"threshold_uncertainty_score":0.68419874},"labels":[],"label_agreement":null},{"id":"W4415096581","doi":"10.1002/pds.70235","title":"Comparing <scp>IPCW</scp> Models to Adjust for Informative Censoring During <scp>COVID</scp> ‐19 Using Data From the Clinical Practice Research Datalink","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Censoring (clinical trials); Weighting; Pharmacoepidemiology; MEDLINE; Inverse probability weighting","score_opus":0.7158032594089283,"score_gpt":0.6151038036979035,"score_spread":0.10069945571102479,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415096581","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18252201,0.0063478467,0.6080709,0.0050819614,0.002962856,0.035636988,0.12991911,0.0067851995,0.022673167],"genre_scores_gemma":[0.5517523,0.0010688455,0.29491907,0.0024792082,0.00043830706,0.083255045,0.057736147,0.0022348172,0.0061162002],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.6696725,0.2715285,0.023348643,0.016214242,0.01663187,0.0026042473],"domain_scores_gemma":[0.4460693,0.43254185,0.03889212,0.06399506,0.016687635,0.0018141044],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.21774077,0.0019444858,0.0035865235,0.004609334,0.000921708,0.003084069,0.0042905947,0.003309636,0.041962925],"category_scores_gemma":[0.48448625,0.0015504379,0.014020748,0.0065478887,0.00173259,0.003206823,0.0052156188,0.0066616572,0.0043401066],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.042497408,0.0025369085,0.16467185,0.024211204,0.11692986,0.0007391588,0.0027540927,0.06424185,0.0016655518,0.058909096,0.14372516,0.37711793],"study_design_scores_gemma":[0.032417513,0.020747596,0.2144335,0.012473045,0.05784084,0.0008348537,0.0013315135,0.2758421,0.0077669327,0.10454704,0.27057526,0.00118973],"about_ca_topic_score_codex":0.0045760833,"about_ca_topic_score_gemma":0.003761064,"teacher_disagreement_score":0.7822592,"about_ca_system_score_codex":0.0020454407,"about_ca_system_score_gemma":0.0046676253,"threshold_uncertainty_score":0.9646649},"labels":[],"label_agreement":null},{"id":"W4415221337","doi":"10.1002/cjs.70021","title":"Kernel estimation of average treatment effects in models with unmeasured confounders","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"Basic and Applied Basic Research Foundation of Guangdong Province; National Key Research and Development Program of China; National Natural Science Foundation of China","keywords":"Estimator; Kernel density estimation; Kernel (algebra); Parametric statistics; Estimation; Inverse probability; Estimation theory; Kernel regression; Kernel method","score_opus":0.07484188317513137,"score_gpt":0.3414153379963154,"score_spread":0.26657345482118405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415221337","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0818609,0.0012015954,0.91505605,0.00056495296,0.00007488588,0.00008843805,0.00020022372,0.00012867416,0.00082425115],"genre_scores_gemma":[0.90783495,0.0010696586,0.08866577,0.00014805084,0.000103004866,0.00026480705,0.00031988943,0.00003295393,0.0015609938],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9895728,0.008355406,0.000286436,0.00089056656,0.00057128846,0.0003234112],"domain_scores_gemma":[0.9623186,0.030422114,0.0020174293,0.0035860003,0.0014323003,0.00022361432],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015890785,0.000572882,0.0016950454,0.0016243052,0.00043562392,0.0013901832,0.0018225176,0.0011031365,0.001663035],"category_scores_gemma":[0.07437313,0.0005265481,0.0017215811,0.0021030866,0.0013855017,0.0017615603,0.0015243225,0.0019092916,0.00012702995],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006654561,0.00034939457,0.05244946,0.00066952506,0.0026457864,0.0004916762,0.0008084741,0.35939384,0.0018466322,0.3626616,0.0026713547,0.21534677],"study_design_scores_gemma":[0.000113412396,0.00017800041,0.012059115,0.000104257735,0.00055391283,0.0001057744,0.00014707536,0.82518816,0.00091355795,0.15778586,0.0027949635,0.000055906305],"about_ca_topic_score_codex":0.008635695,"about_ca_topic_score_gemma":0.0036058433,"teacher_disagreement_score":0.015890785,"about_ca_system_score_codex":0.0009595997,"about_ca_system_score_gemma":0.001501153,"threshold_uncertainty_score":0.08403957},"labels":[],"label_agreement":null},{"id":"W4415322104","doi":"10.1007/s40471-025-00374-6","title":"Transporting: What Is It and How Do You Do It?","year":2025,"lang":"en","type":"article","venue":"Current Epidemiology Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Drug Abuse; Wake Forest University","keywords":"Generalizability theory; External validity; Estimator; Population; Internal validity; Field (mathematics)","score_opus":0.2733632021131419,"score_gpt":0.4917979683271415,"score_spread":0.2184347662139996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415322104","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006222908,0.90570825,0.02489303,0.05919149,0.0061599454,0.0008562475,0.0005884314,0.00014715457,0.0018330787],"genre_scores_gemma":[0.015698142,0.91762143,0.028176073,0.027243948,0.0061350316,0.0029615513,0.0006356422,0.00024734225,0.0012807489],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93502784,0.039082058,0.014283989,0.004091167,0.006622585,0.00089228066],"domain_scores_gemma":[0.6213089,0.3092027,0.031546198,0.014528573,0.021776823,0.0016368246],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1135385,0.0018017945,0.009417895,0.007192746,0.0016408992,0.009947181,0.004053081,0.004835916,0.009330261],"category_scores_gemma":[0.40128577,0.0016724677,0.0075380965,0.010259238,0.0062242937,0.02279836,0.0041499096,0.0082174735,0.0026607583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042187163,0.000060318074,0.0034155704,0.23271193,0.00568448,0.0002033403,0.002476847,0.0017631351,0.0003667225,0.06500808,0.047043767,0.6408439],"study_design_scores_gemma":[0.00024728704,0.00025614147,0.004101262,0.44170636,0.0086943265,0.00060874777,0.0023978928,0.0015708002,0.00069119595,0.1243804,0.41505,0.0002956218],"about_ca_topic_score_codex":0.0065560797,"about_ca_topic_score_gemma":0.0065746186,"teacher_disagreement_score":0.8864615,"about_ca_system_score_codex":0.0049572703,"about_ca_system_score_gemma":0.01982728,"threshold_uncertainty_score":0.6004562},"labels":[],"label_agreement":null},{"id":"W4415385981","doi":"10.1111/jep.70298","title":"Understanding and Managing Confounders, Mediators and Colliders in Research","year":2025,"lang":"en","type":"article","venue":"Journal of Evaluation in Clinical Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary; Memorial University of Newfoundland","funders":"","keywords":"Causal inference; Element (criminal law); Causality (physics); Causal structure; Causal model; Data collection; Causal reasoning","score_opus":0.8119926734466607,"score_gpt":0.6927171313995422,"score_spread":0.11927554204711854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415385981","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029924253,0.010075488,0.95322424,0.02677316,0.0005716263,0.0015426745,0.00022503512,0.00031439646,0.004280955],"genre_scores_gemma":[0.068197705,0.009112103,0.9091862,0.0043399977,0.000982423,0.0068704104,0.00018862267,0.00013936657,0.0009832388],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.66039616,0.28282157,0.021038745,0.01366044,0.020505166,0.001577963],"domain_scores_gemma":[0.28572652,0.6404091,0.036198013,0.02306164,0.012986619,0.0016181224],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.32745203,0.0027448665,0.003748176,0.00886889,0.00503868,0.014749006,0.0054265005,0.008963922,0.0076965643],"category_scores_gemma":[0.54306704,0.0041235513,0.004166462,0.010684262,0.02626558,0.03376719,0.01937683,0.011871414,0.0012368448],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020030575,0.00006407764,0.0052873036,0.004237508,0.000366172,0.0004350816,0.0129508935,0.004362452,0.0005317624,0.80302507,0.0047623618,0.16377705],"study_design_scores_gemma":[0.00008896307,0.00009930947,0.0010091845,0.004789141,0.00033210576,0.00031487131,0.0015294605,0.0056514586,0.0007048489,0.9569519,0.02842622,0.0001024872],"about_ca_topic_score_codex":0.0029975236,"about_ca_topic_score_gemma":0.0028030868,"teacher_disagreement_score":0.67254794,"about_ca_system_score_codex":0.0072077406,"about_ca_system_score_gemma":0.024202373,"threshold_uncertainty_score":0.8293714},"labels":[],"label_agreement":null},{"id":"W4415495055","doi":"10.1093/aje/kwaf239","title":"Evaluating treatment benefit predictors using observational data: contending with identification and confounding bias","year":2025,"lang":"en","type":"article","venue":"American Journal of Epidemiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Observational study; Confounding; Causal inference; Identification (biology); Intuition; Calibration; Measure (data warehouse); Instrumental variable","score_opus":0.7092128010368095,"score_gpt":0.577015850385838,"score_spread":0.13219695065097148,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415495055","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028190717,0.0038817136,0.95902115,0.0063924487,0.00012924374,0.0002670311,0.0003536491,0.000117248725,0.0016468146],"genre_scores_gemma":[0.56018525,0.0036891866,0.43000922,0.0026266281,0.0007174357,0.0012020662,0.0004735313,0.00012550717,0.00097123865],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8250595,0.15298477,0.0059577855,0.005659013,0.00938863,0.0009503776],"domain_scores_gemma":[0.33124548,0.6197416,0.021125006,0.02296206,0.004285036,0.0006408568],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2116155,0.001209744,0.0025424033,0.003260941,0.0011691449,0.004270764,0.002861727,0.0038730942,0.0013066491],"category_scores_gemma":[0.54075706,0.0010093254,0.0026059723,0.0044359486,0.0076240744,0.0076256115,0.0057066027,0.0062074927,0.00026338093],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00056542765,0.0002160502,0.111744225,0.001979337,0.0033187924,0.0005141136,0.002182984,0.11532732,0.00086849637,0.53447664,0.002678006,0.22612862],"study_design_scores_gemma":[0.00009506143,0.00020242883,0.01080464,0.0006260979,0.00038329928,0.0002977339,0.00021256605,0.12841123,0.0012715707,0.8536463,0.003973984,0.000075038086],"about_ca_topic_score_codex":0.0033319816,"about_ca_topic_score_gemma":0.0016960108,"teacher_disagreement_score":0.7883845,"about_ca_system_score_codex":0.0020253768,"about_ca_system_score_gemma":0.0037764087,"threshold_uncertainty_score":0.97221845},"labels":[],"label_agreement":null},{"id":"W4415614733","doi":"10.1093/biomtc/ujaf143","title":"Adaptive stratified sampling design in two-phase studies for average causal effect estimation","year":2025,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"National Natural Science Foundation of China; City University of Hong Kong","keywords":"Confounding; Estimator; Sampling design; Sampling (signal processing); Stratified sampling; Sample size determination; Causal inference; Observational study; Stratification (seeds)","score_opus":0.39395430355975664,"score_gpt":0.544197749972689,"score_spread":0.15024344641293236,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415614733","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003082643,0.00018871333,0.99521905,0.00008359493,0.00008755387,0.0009112579,0.0000617241,0.00011748169,0.0002480027],"genre_scores_gemma":[0.09593517,0.0003224868,0.8972825,0.00025871876,0.00012657883,0.0052865795,0.00023019438,0.00005066953,0.0005070694],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9093697,0.08136708,0.0018451861,0.003778033,0.0031044283,0.0005356778],"domain_scores_gemma":[0.908688,0.073856644,0.004354904,0.008631731,0.0037181445,0.000750561],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.071007565,0.0018609787,0.003089705,0.002230316,0.0010518308,0.0016920253,0.003513663,0.003075228,0.005642441],"category_scores_gemma":[0.110437095,0.001484227,0.003648172,0.0024803,0.0028629384,0.0019893327,0.0025900714,0.0036026083,0.00086217106],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0043899375,0.0006705941,0.018497625,0.002336939,0.002505304,0.0007288108,0.0017816946,0.23759085,0.0066153654,0.41962335,0.0048629637,0.30039662],"study_design_scores_gemma":[0.0020566697,0.0034727508,0.003724911,0.00042154104,0.0008561203,0.0003823833,0.00019209311,0.729134,0.0048661893,0.23826584,0.016441828,0.00018569257],"about_ca_topic_score_codex":0.0015327886,"about_ca_topic_score_gemma":0.0013641417,"teacher_disagreement_score":0.92899245,"about_ca_system_score_codex":0.0013538697,"about_ca_system_score_gemma":0.0036146047,"threshold_uncertainty_score":0.3755284},"labels":[],"label_agreement":null},{"id":"W4415827025","doi":"10.2196/84173","title":"Authors’ Response to Peer Reviews of “Assessing the Limitations of Large Language Models in Clinical Practice Guideline–Concordant Treatment Decision-Making on Real-World Data: Retrospective Study”","year":2025,"lang":"en","type":"article","venue":"JMIRx Med","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Clinical Practice; Peer review; MEDLINE; Language model; Peer group","score_opus":0.426025978404257,"score_gpt":0.6231956014630726,"score_spread":0.19716962305881564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415827025","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004925307,0.0017050863,0.00097582105,0.7391852,0.25205714,0.00028376695,0.0014773858,0.00034381705,0.0034792365],"genre_scores_gemma":[0.0151940305,0.0038757687,0.0045806337,0.78798056,0.14608924,0.0019004359,0.001478094,0.0008840187,0.03801717],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.87845296,0.04576901,0.020784859,0.0056394506,0.045655873,0.0036979078],"domain_scores_gemma":[0.40725565,0.18543993,0.036322247,0.016382542,0.34681824,0.007781342],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06530191,0.0011985793,0.00353119,0.0035984614,0.005429636,0.0069718324,0.0036813412,0.02105619,0.04934224],"category_scores_gemma":[0.5830297,0.0016350681,0.0036771302,0.0024908432,0.004392382,0.0032052686,0.0055765742,0.017006436,0.030318279],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006372421,0.000008257082,0.00016595409,0.00027591165,0.000028702054,0.000074058975,0.00014940833,0.000029854551,0.000032372925,0.0003106255,0.9957177,0.003143463],"study_design_scores_gemma":[0.00026520086,0.00006180431,0.0016066112,0.0024860236,0.00013272981,0.00028543788,0.0012661791,0.0007127796,0.00045681582,0.0023274233,0.99025035,0.00014862338],"about_ca_topic_score_codex":0.009668043,"about_ca_topic_score_gemma":0.013115061,"teacher_disagreement_score":0.06530191,"about_ca_system_score_codex":0.007906064,"about_ca_system_score_gemma":0.018228577,"threshold_uncertainty_score":0.34535366},"labels":[],"label_agreement":null},{"id":"W4415882029","doi":"10.1101/2025.11.02.25339322","title":"Target trial emulation of physical activity and cardiovascular disease risk: What is impact of the exposure assessment method?","year":2025,"lang":"","type":"preprint","venue":"medRxiv","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Causal inference; Confounding; Observational study; Randomized controlled trial; Pedometer; Risk assessment; Cohort; Physical activity; Poisson regression","score_opus":0.08296499534171012,"score_gpt":0.4432584972852671,"score_spread":0.360293501943557,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415882029","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07537527,0.0344524,0.8092134,0.02100103,0.009640433,0.03396333,0.0022905732,0.002120867,0.0119427005],"genre_scores_gemma":[0.6022437,0.0048337854,0.29418346,0.010118144,0.002219428,0.08194222,0.001183117,0.00065120385,0.0026248926],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.29987177,0.65025914,0.021321068,0.0115944045,0.015437455,0.0015161606],"domain_scores_gemma":[0.24221729,0.6244029,0.0495703,0.07046553,0.011760024,0.0015839675],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.53154725,0.0027346523,0.009017207,0.0015958551,0.0012492345,0.006446016,0.0063237483,0.007801015,0.009406847],"category_scores_gemma":[0.7382086,0.0020082758,0.015515261,0.0025010863,0.0060026483,0.008951697,0.005579478,0.0077932132,0.0019034885],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.15725207,0.0039484864,0.05784541,0.0355935,0.11494827,0.0005991993,0.0057853833,0.03985123,0.002186074,0.09016429,0.016339408,0.47548673],"study_design_scores_gemma":[0.10716392,0.07632915,0.07428622,0.040043905,0.09651635,0.0015476316,0.0015817793,0.18635286,0.014274221,0.29984775,0.10040414,0.0016520432],"about_ca_topic_score_codex":0.0010052741,"about_ca_topic_score_gemma":0.0005846235,"teacher_disagreement_score":0.46845275,"about_ca_system_score_codex":0.0030982855,"about_ca_system_score_gemma":0.005003137,"threshold_uncertainty_score":0.5776857},"labels":[],"label_agreement":null},{"id":"W4415907925","doi":"10.5539/gjhs.v17n6p98","title":"Quantitative Modeling of the Critical Impact of Socioeconomic Status on Body Mass Index Using Double Machine Learning","year":2025,"lang":"","type":"article","venue":"Global Journal of Health Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Socioeconomic status; Causal inference; Body mass index; National Health and Nutrition Examination Survey; Covariate; Causal model; Index (typography); Inference; Descriptive statistics","score_opus":0.15242326378727833,"score_gpt":0.5238442982923169,"score_spread":0.3714210345050386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415907925","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15035151,0.00046677017,0.8445506,0.001095672,0.00007120867,0.000117025425,0.00055802136,0.00015737735,0.0026317104],"genre_scores_gemma":[0.93938076,0.00036582412,0.056084488,0.00022771036,0.000064656146,0.00023710245,0.00038395703,0.000025568017,0.0032300805],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99696475,0.0020746596,0.000090915695,0.0004124126,0.00024742197,0.00020982235],"domain_scores_gemma":[0.97594255,0.020646948,0.0016987866,0.0009475432,0.0005475697,0.00021654415],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008676679,0.0006461888,0.001134074,0.0011206078,0.00034807058,0.0011971068,0.0013558373,0.00081928546,0.002290333],"category_scores_gemma":[0.025546,0.0004363348,0.0011585607,0.0008669358,0.001279631,0.0010586567,0.0013420627,0.0012310968,0.0002055287],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020975558,0.0001642266,0.037349895,0.00015918634,0.00032391457,0.00032145117,0.00026031412,0.7859942,0.00077771494,0.14294879,0.0007120279,0.030778488],"study_design_scores_gemma":[0.000012417755,0.00003352244,0.0017840603,0.000013561623,0.000025508123,0.000032441338,0.000019349265,0.97026324,0.00010956922,0.02732872,0.00036906597,0.00000847365],"about_ca_topic_score_codex":0.0072701867,"about_ca_topic_score_gemma":0.0032029399,"teacher_disagreement_score":0.008676679,"about_ca_system_score_codex":0.0009134101,"about_ca_system_score_gemma":0.00110575,"threshold_uncertainty_score":0.04588723},"labels":[],"label_agreement":null},{"id":"W4415945807","doi":"10.21203/rs.3.rs-7565524/v1","title":"The Impact of Dependency and Serial Correlation in Matched ITSA: Methodological Considerations","year":2025,"lang":"","type":"preprint","venue":"Research Square","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Correlation; Dependency (UML); Robustness (evolution); Autocorrelation; Type I and type II errors; Monte Carlo method; Series (stratigraphy); Regression analysis; Joint (building)","score_opus":0.5293367373186046,"score_gpt":0.6071778789169079,"score_spread":0.07784114159830324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415945807","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041114066,0.0018836881,0.93607163,0.0068508424,0.0005301838,0.0006259213,0.00061425817,0.00034138732,0.011967919],"genre_scores_gemma":[0.6951537,0.0012251616,0.28618494,0.0024059094,0.0013750365,0.0022839569,0.0004717411,0.00043655932,0.010463021],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7758427,0.1804118,0.012383283,0.01490091,0.013667879,0.002793321],"domain_scores_gemma":[0.14023788,0.7853893,0.016201032,0.048534777,0.00828556,0.0013513896],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.29231855,0.0017915939,0.004414768,0.0034404788,0.0044228965,0.008839038,0.011198083,0.0040883454,0.01484667],"category_scores_gemma":[0.67327607,0.0026354538,0.0046191956,0.0075929523,0.010438913,0.017095098,0.008434449,0.008827022,0.001308331],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012005056,0.00035668636,0.03518482,0.00076254725,0.0020496473,0.0009654183,0.002367402,0.021087255,0.0004932041,0.8661159,0.0043127104,0.0651039],"study_design_scores_gemma":[0.00037371417,0.0003010792,0.009036746,0.00023814577,0.001149268,0.00032686605,0.0007663295,0.10214788,0.0022498013,0.8767933,0.0064965235,0.00012027782],"about_ca_topic_score_codex":0.020541234,"about_ca_topic_score_gemma":0.01419591,"teacher_disagreement_score":0.29231855,"about_ca_system_score_codex":0.0032701367,"about_ca_system_score_gemma":0.006752648,"threshold_uncertainty_score":0.87269723},"labels":[],"label_agreement":null},{"id":"W4416148163","doi":"10.1093/ijpp/riaf111","title":"Realist evaluations: relevance to pharmacy practice and education","year":2025,"lang":"en","type":"article","venue":"International Journal of Pharmacy Practice","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Monash University","keywords":"Relevance (law); Psychological intervention; Pharmacy; Pharmacy practice; Population","score_opus":0.1676751014141028,"score_gpt":0.5932963085363024,"score_spread":0.42562120712219964,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416148163","genre_codex":"methods","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10783102,0.053754635,0.5580232,0.08332506,0.00482009,0.031431027,0.0018722682,0.00055019074,0.15839243],"genre_scores_gemma":[0.7348278,0.008234555,0.20982344,0.0093451645,0.0010907494,0.032849368,0.00029098857,0.00013700241,0.0034008655],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.46100384,0.5151045,0.005882422,0.0032868327,0.013557488,0.0011649067],"domain_scores_gemma":[0.18541667,0.7648752,0.019833067,0.014657271,0.013505631,0.0017121885],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26462507,0.0010488983,0.0022174297,0.0029990645,0.0023354471,0.008952603,0.0028702905,0.0037798928,0.010125722],"category_scores_gemma":[0.5512844,0.0007149582,0.0017924076,0.0031887735,0.0098656425,0.009953584,0.0053835926,0.0043525514,0.0005054874],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022338356,0.001633713,0.014055698,0.018211218,0.0017864278,0.0005137047,0.02577924,0.016743666,0.0002874156,0.5050593,0.019312555,0.39438316],"study_design_scores_gemma":[0.0018529893,0.0030213452,0.013025347,0.024477609,0.0006932942,0.0004529687,0.01776416,0.027641132,0.0009551347,0.8239649,0.0858688,0.00028220538],"about_ca_topic_score_codex":0.0027761261,"about_ca_topic_score_gemma":0.005056339,"teacher_disagreement_score":0.7353749,"about_ca_system_score_codex":0.0103082275,"about_ca_system_score_gemma":0.01643428,"threshold_uncertainty_score":0.9068482},"labels":[],"label_agreement":null},{"id":"W4416185308","doi":"10.1136/bmjph-2025-002918","title":"Associations between social determinants of health and COVID-19 outcomes by variants of concern: a Bayesian spatiotemporal analysis","year":2025,"lang":"en","type":"article","venue":"BMJ Public Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"St. Paul's Hospital; Institute for Clinical Evaluative Sciences; BC Centre for Disease Control; Public Health Ontario; University of British Columbia; Simon Fraser University; Toronto General Hospital; University Health Network; University of Toronto","funders":"Institute of Infection and Immunity; British Columbia Centre for Disease Control; Provincial Health Services Authority; Canada Research Chairs","keywords":"Socioeconomic status; Social determinants of health; Pandemic; Health equity; Disadvantaged; Preparedness; Bayesian probability; Disease","score_opus":0.3449884958753923,"score_gpt":0.5513007527290257,"score_spread":0.20631225685363336,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416185308","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8292764,0.0026868742,0.15224056,0.0022293671,0.00008279533,0.00039748283,0.010693459,0.00025341558,0.0021396922],"genre_scores_gemma":[0.97059906,0.00052739074,0.023740929,0.00017933748,0.00003692201,0.00021837767,0.003842111,0.00004175258,0.0008142108],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99124396,0.0053376304,0.0005935847,0.0019463885,0.00043752143,0.00044089407],"domain_scores_gemma":[0.9802171,0.01282919,0.0031757501,0.0019029991,0.0012826198,0.0005922637],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020692555,0.0007790167,0.0014370312,0.0025460653,0.0012093247,0.0018472201,0.002060495,0.001289881,0.004066123],"category_scores_gemma":[0.04014259,0.0009864822,0.005300776,0.0028352651,0.0015380615,0.0012305516,0.0027892722,0.0018545276,0.00043789615],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007676153,0.000090615154,0.9012471,0.00021993008,0.0052316077,0.0004148872,0.0009529833,0.059365444,0.00067525293,0.008655234,0.0025025196,0.019876756],"study_design_scores_gemma":[0.00018289225,0.0002868798,0.40876165,0.00047432986,0.0044274996,0.00088285946,0.0008703942,0.55151606,0.0003503456,0.0253349,0.0067368723,0.00017528645],"about_ca_topic_score_codex":0.1481379,"about_ca_topic_score_gemma":0.06823226,"teacher_disagreement_score":0.1481379,"about_ca_system_score_codex":0.0019773657,"about_ca_system_score_gemma":0.0021557668,"threshold_uncertainty_score":0.29455125},"labels":[],"label_agreement":null},{"id":"W4416208598","doi":"10.1002/pds.70255","title":"<scp>The Reporting</scp> and Methodological Recommendations for Observational Studies Estimating the Effects of Deprescribing Medications (REMROSE‐D) ISPE‐Endorsed Guidance","year":2025,"lang":"en","type":"article","venue":"Pharmacoepidemiology and Drug Safety","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"National Institute on Aging; International Society for Pharmacoepidemiology","keywords":"Observational study; Deprescribing; Confounding; Pharmacoepidemiology; MEDLINE","score_opus":0.49440347288314307,"score_gpt":0.5652237796287686,"score_spread":0.0708203067456255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416208598","genre_codex":"commentary","genre_gemma":"methods","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0033315388,0.031912588,0.15708758,0.43774384,0.066227265,0.15039493,0.050781615,0.006863156,0.09565748],"genre_scores_gemma":[0.017804723,0.021700844,0.57446927,0.12283882,0.00855168,0.21249573,0.02278204,0.0021013098,0.017255554],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.36705202,0.3646448,0.17807283,0.006492884,0.07707755,0.0066598747],"domain_scores_gemma":[0.13737167,0.46988684,0.068393335,0.051547717,0.2661642,0.0066361413],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.48132074,0.0032091998,0.006491408,0.013717629,0.004774699,0.013446341,0.013752769,0.029045446,0.03512885],"category_scores_gemma":[0.79296017,0.005894423,0.0219124,0.0121413125,0.008209045,0.01103615,0.014630565,0.020181254,0.032215606],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042794613,0.00016185704,0.0012562864,0.042817943,0.00047324185,0.00022853163,0.0022533913,0.0008087891,0.0005843133,0.00848917,0.8366116,0.10588691],"study_design_scores_gemma":[0.0018027615,0.00027141068,0.0058834464,0.22274321,0.0009203764,0.0006639788,0.0017053345,0.004165248,0.0020098304,0.020782745,0.7385393,0.00051248743],"about_ca_topic_score_codex":0.016161947,"about_ca_topic_score_gemma":0.010491289,"teacher_disagreement_score":0.51867926,"about_ca_system_score_codex":0.011292705,"about_ca_system_score_gemma":0.06907591,"threshold_uncertainty_score":0.6396239},"labels":[],"label_agreement":null},{"id":"W4416377097","doi":"10.1017/9781108641784.015","title":"The Future of Chilling Effects and How to Stop It","year":2025,"lang":"","type":"book-chapter","venue":"Cambridge University Press eBooks","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Dystopia; Enforcement; Automation; Law enforcement; Public policy","score_opus":0.03421890552399471,"score_gpt":0.26841114290517043,"score_spread":0.23419223738117573,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416377097","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01189166,0.06523336,0.100952186,0.23360133,0.003916423,0.00009990726,0.00022799554,0.0005201186,0.58355707],"genre_scores_gemma":[0.71003985,0.054273356,0.036268815,0.03906763,0.004907043,0.0003500358,0.000253038,0.0006427853,0.1541975],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99762136,0.0012016298,0.00007081415,0.00030938082,0.00053805485,0.00025882295],"domain_scores_gemma":[0.99139214,0.006491967,0.0003655751,0.0008979144,0.00062355195,0.00022892012],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005219596,0.0006551757,0.0006169381,0.0011703472,0.0022703218,0.00634728,0.0015490567,0.0029894374,0.010096662],"category_scores_gemma":[0.009697677,0.00039674027,0.00078579166,0.00084047124,0.025215864,0.013654151,0.0026858693,0.009080484,0.0013737084],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000029242515,0.0000043648993,0.00007597423,0.000025888798,0.0000032988928,0.000021217114,0.00034518662,0.00018749617,0.000026309004,0.988653,0.005265586,0.005388773],"study_design_scores_gemma":[0.0000034802852,0.000004280861,0.00009633982,0.000093616494,0.0000036702215,0.000028288194,0.00024200801,0.00027379356,0.00006975676,0.9379596,0.061218604,0.0000066390967],"about_ca_topic_score_codex":0.0031434381,"about_ca_topic_score_gemma":0.003464487,"teacher_disagreement_score":0.010096662,"about_ca_system_score_codex":0.0042965068,"about_ca_system_score_gemma":0.0033799792,"threshold_uncertainty_score":0.0337767},"labels":[],"label_agreement":null},{"id":"W4416404588","doi":"10.1007/s44199-025-00132-z","title":"The Modified Instrumental Variable (MIV) for Endogenous Instrumental Variables","year":2025,"lang":"en","type":"article","venue":"Journal of Statistical Theory and Applications","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Instrumental variable; Estimator; Lottery; Earnings; Variable (mathematics); Variables; Quarter (Canadian coin)","score_opus":0.0689276498258833,"score_gpt":0.38176654182534,"score_spread":0.3128388919994567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416404588","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036762652,0.0004138862,0.99386156,0.00033263167,0.00016903362,0.000116647825,0.00012249257,0.00021319611,0.0010942635],"genre_scores_gemma":[0.28376582,0.0009469925,0.70849407,0.000757448,0.0005985933,0.0013308005,0.00044261324,0.00035088568,0.0033127305],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.962648,0.028942265,0.001243695,0.0032132983,0.0031689373,0.0007838376],"domain_scores_gemma":[0.87136453,0.10208287,0.007192301,0.015032262,0.0039228494,0.00040518324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036230616,0.0013679523,0.002187814,0.0033756143,0.0008965723,0.0027382686,0.005338699,0.0028402398,0.006363007],"category_scores_gemma":[0.19254814,0.0009981984,0.0022404322,0.0033799147,0.0033485705,0.002872748,0.0032504315,0.0055040303,0.0010667259],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024281252,0.00014178845,0.010605383,0.0006880613,0.0011288418,0.0003760901,0.00052218523,0.062746875,0.0016325394,0.79241997,0.0050163665,0.124479085],"study_design_scores_gemma":[0.00027242646,0.00038105447,0.0042572687,0.00077869743,0.00033867278,0.0003630154,0.00020415479,0.47902182,0.0050879032,0.49102873,0.018069359,0.00019687672],"about_ca_topic_score_codex":0.0015595849,"about_ca_topic_score_gemma":0.0008593132,"teacher_disagreement_score":0.036230616,"about_ca_system_score_codex":0.0013278206,"about_ca_system_score_gemma":0.0025265852,"threshold_uncertainty_score":0.19160807},"labels":[],"label_agreement":null},{"id":"W4416423288","doi":"10.1097/hjh.0000000000004188","title":"Target trial emulation in hypertension research: a scoping review of current applications and methodological practices","year":2025,"lang":"en","type":"article","venue":"Journal of Hypertension","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Causal inference; Confounding; Observational study; Emulation; Marginal structural model; Weighting; Systematic review; MEDLINE","score_opus":0.8325902265006923,"score_gpt":0.6368799860046752,"score_spread":0.19571024049601704,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416423288","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00062426407,0.969933,0.018158635,0.005474268,0.0009695763,0.0026448297,0.0007013216,0.00015239914,0.0013417522],"genre_scores_gemma":[0.01702701,0.9237737,0.04070737,0.0042325812,0.0007984875,0.011916176,0.0009290768,0.00019427965,0.00042146008],"study_design_codex":"systematic_review","study_design_gemma":"systematic_review","domain_scores_codex":[0.73947215,0.16588555,0.06850195,0.007003534,0.017857382,0.0012795215],"domain_scores_gemma":[0.28447348,0.64281696,0.032663845,0.01604364,0.023237297,0.000764787],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.29830012,0.0027362106,0.010752886,0.018452926,0.0018478049,0.009464388,0.0052993856,0.005657008,0.007366167],"category_scores_gemma":[0.6390397,0.0028437846,0.019079044,0.023013163,0.0035182608,0.009230531,0.007331227,0.005232102,0.0014353865],"study_design_candidate":"systematic_review","study_design_consensus":"systematic_review","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046411649,0.000044003373,0.0014095436,0.6052376,0.010076927,0.00011898521,0.001214729,0.0014588812,0.00019369187,0.007924004,0.009097682,0.3627599],"study_design_scores_gemma":[0.00025140826,0.00018496695,0.0011380784,0.9143554,0.022064649,0.00020980158,0.0003632085,0.0010906204,0.00035376026,0.012002032,0.04790462,0.00008154375],"about_ca_topic_score_codex":0.005515187,"about_ca_topic_score_gemma":0.009895844,"teacher_disagreement_score":0.70169985,"about_ca_system_score_codex":0.008107125,"about_ca_system_score_gemma":0.029356737,"threshold_uncertainty_score":0.8653209},"labels":[],"label_agreement":null},{"id":"W4416524804","doi":"10.1016/b978-0-323-90509-1.00016-3","title":"Categorical variable analyses: Chi-square, Fisher's exact, and Mantel–Haenszel","year":2025,"lang":"en","type":"book-chapter","venue":"Elsevier eBooks","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Categorical variable; Nonparametric statistics; Statistical hypothesis testing; Confounding; Null hypothesis; Sample size determination; Robustness (evolution); Demographics","score_opus":0.11124870922501105,"score_gpt":0.3827075715131068,"score_spread":0.27145886228809574,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416524804","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01037908,0.022967976,0.89253825,0.0051204516,0.004419423,0.0016360126,0.026268277,0.008426798,0.028243814],"genre_scores_gemma":[0.052922893,0.010067798,0.8834783,0.0015198356,0.0016910471,0.007894788,0.011349375,0.0051194686,0.025956525],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9606116,0.02517885,0.0040077153,0.0038040397,0.005842868,0.00055496756],"domain_scores_gemma":[0.8681781,0.11497537,0.004018007,0.008489046,0.0037475184,0.00059190736],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040059682,0.0029921958,0.0050867973,0.01185077,0.0013307211,0.0034952909,0.0060643987,0.0023780998,0.1082822],"category_scores_gemma":[0.16408342,0.0016046155,0.0033532814,0.017451001,0.0040691076,0.005627684,0.0022358662,0.007452442,0.018343126],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008223172,0.00043477,0.009202545,0.007718372,0.0024129564,0.00084691995,0.0018456115,0.0046466175,0.0015592201,0.095348194,0.36468866,0.5104738],"study_design_scores_gemma":[0.00047613797,0.0018929845,0.045281816,0.008316465,0.001961328,0.0048139533,0.0037128325,0.04809352,0.004541272,0.43630135,0.4439172,0.00069107814],"about_ca_topic_score_codex":0.0035497013,"about_ca_topic_score_gemma":0.0045014857,"teacher_disagreement_score":0.1082822,"about_ca_system_score_codex":0.0016111449,"about_ca_system_score_gemma":0.0029584933,"threshold_uncertainty_score":0.36224008},"labels":[],"label_agreement":null},{"id":"W4416583604","doi":"10.2139/ssrn.5795725","title":"Forecasting Social Science: Evidence from 100 Projects","year":2025,"lang":"en","type":"preprint","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Download; Set (abstract data type); Consensus forecast; Field (mathematics); Affect (linguistics); Data set","score_opus":0.27771820100406813,"score_gpt":0.4491877264042935,"score_spread":0.17146952540022536,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416583604","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97798264,0.0023468512,0.004644621,0.0020849751,0.00005438176,0.00008083995,0.0050032483,0.00007798547,0.007724542],"genre_scores_gemma":[0.9847861,0.0021221014,0.0026318408,0.00013333214,0.00007385334,0.000093799346,0.008017176,0.000029439203,0.0021123693],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9947168,0.002915136,0.0002723885,0.0005722106,0.0012834228,0.00024007754],"domain_scores_gemma":[0.7686966,0.18834364,0.017815664,0.013121238,0.008193269,0.0038296191],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.012791416,0.0006337056,0.0007210033,0.0038382919,0.0011565165,0.0023505252,0.0014806371,0.0028481379,0.0068125497],"category_scores_gemma":[0.103508264,0.00059006416,0.0007808882,0.0077348356,0.0013691109,0.0035740817,0.0021324118,0.0025133325,0.0019282565],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003199395,0.0027365508,0.7392671,0.00090926926,0.0013869302,0.000656724,0.0016298088,0.067720085,0.00039870664,0.01711738,0.028455827,0.13652223],"study_design_scores_gemma":[0.0017912184,0.0018503624,0.6883348,0.00086145,0.0013103989,0.00044141625,0.0042588394,0.14523531,0.0025675863,0.100812204,0.05234877,0.0001875064],"about_ca_topic_score_codex":0.01017153,"about_ca_topic_score_gemma":0.0119452225,"teacher_disagreement_score":0.9872086,"about_ca_system_score_codex":0.0009182163,"about_ca_system_score_gemma":0.0016586162,"threshold_uncertainty_score":0.06764823},"labels":[],"label_agreement":null},{"id":"W4416667820","doi":"10.1007/s40572-025-00513-7","title":"Pitfalls of Using Negative Control Outcomes in Environmental Epidemiology","year":2025,"lang":"en","type":"article","venue":"Current Environmental Health Reports","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Environmental Health Sciences; Canadian Institutes of Health Research; National Institute on Aging; National Institutes of Health","keywords":"Epidemiology; Environmental epidemiology; MEDLINE; Incidence (geometry); Environmental pollution; Public health","score_opus":0.17524805033359694,"score_gpt":0.4832174802762613,"score_spread":0.3079694299426644,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416667820","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008158692,0.003997349,0.9566501,0.022488184,0.00073989236,0.00010266527,0.00020546305,0.0002720586,0.0073856427],"genre_scores_gemma":[0.5387679,0.004156321,0.43502045,0.014060192,0.0023167096,0.0006472928,0.00019756891,0.00027384824,0.004559702],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8424152,0.13465679,0.00452963,0.005115998,0.01270208,0.0005803397],"domain_scores_gemma":[0.3389845,0.61936647,0.010223328,0.021413399,0.008978152,0.001034172],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19817229,0.0013028596,0.00270302,0.0028972176,0.001634384,0.0041576535,0.0046197395,0.0026612014,0.0033047586],"category_scores_gemma":[0.49314427,0.0009767979,0.0012284466,0.0027866566,0.0129736895,0.008370038,0.0047498974,0.008981362,0.0006880134],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003297087,0.0001492641,0.01131355,0.0009218817,0.0005083895,0.00029340835,0.0013831813,0.010039925,0.00033012452,0.76408875,0.008388571,0.2022532],"study_design_scores_gemma":[0.00006843819,0.000057660145,0.0012861596,0.00029102978,0.00008490492,0.00019377834,0.00014852965,0.020056408,0.00045363553,0.9707625,0.006565175,0.000031841315],"about_ca_topic_score_codex":0.0075869714,"about_ca_topic_score_gemma":0.006590293,"teacher_disagreement_score":0.8018277,"about_ca_system_score_codex":0.0014239271,"about_ca_system_score_gemma":0.0035028262,"threshold_uncertainty_score":0.9887963},"labels":[],"label_agreement":null},{"id":"W4416705645","doi":"10.1177/01410768251380376","title":"Long overdue recognition of Klim McPherson’s 1974 article on sequential analysis of trial data JLL Bulletin: commentaries on the history of treatment evaluation","year":2025,"lang":"en","type":"article","venue":"Journal of the Royal Society of Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"","keywords":"Alternative medicine; MEDLINE; Clinical trial","score_opus":0.2798806997035428,"score_gpt":0.42528571711147817,"score_spread":0.14540501740793538,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416705645","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00004641356,0.0025016924,0.0005958042,0.9764445,0.019905543,0.000008652074,0.00005535424,0.000027383267,0.00041479475],"genre_scores_gemma":[0.001524453,0.0014040205,0.00091486593,0.9221624,0.0727756,0.00005918465,0.000015940685,0.000089121895,0.0010543789],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.88032275,0.0550518,0.014926435,0.013587028,0.032976057,0.0031359533],"domain_scores_gemma":[0.23838003,0.6695367,0.024492629,0.014237881,0.045041826,0.008310939],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1306593,0.0025763947,0.005040873,0.006516502,0.007477849,0.013663755,0.007840529,0.06835398,0.00953751],"category_scores_gemma":[0.5768607,0.0029133318,0.0034985777,0.008038536,0.029400928,0.01704109,0.006527167,0.1355099,0.0071564573],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005674684,0.000014249246,0.00016690422,0.00019436861,0.000050967865,0.0000846212,0.0003219548,0.00006441295,0.00004354198,0.014588808,0.9795192,0.0048944037],"study_design_scores_gemma":[0.00030444906,0.00008589206,0.0012103792,0.0019319349,0.00017904276,0.00041821963,0.00056476856,0.000892409,0.00079535414,0.07953616,0.91376203,0.00031926623],"about_ca_topic_score_codex":0.016566262,"about_ca_topic_score_gemma":0.024886394,"teacher_disagreement_score":0.8693407,"about_ca_system_score_codex":0.015537535,"about_ca_system_score_gemma":0.016371788,"threshold_uncertainty_score":0.6910007},"labels":[],"label_agreement":null},{"id":"W4416757099","doi":"10.1080/26941899.2025.2583507","title":"Are Neural Representation Learning Methods a Viable Alternative to TMLE for Causal Estimation?","year":2025,"lang":"en","type":"article","venue":"Data Science in Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Leverage (statistics); Feature learning; Representation (politics); Estimator; Variance (accounting); Causal inference; Artificial neural network; Deep learning","score_opus":0.42050086401940895,"score_gpt":0.6220922742342814,"score_spread":0.20159141021487242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416757099","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011920799,0.0008643266,0.98344594,0.0018848461,0.00005434735,0.00005781953,0.00023396083,0.0004396155,0.0010982447],"genre_scores_gemma":[0.4294671,0.0013434005,0.56343853,0.001828397,0.00018263189,0.0005698846,0.0010081857,0.00024712968,0.0019148157],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99240327,0.0061769155,0.00024964692,0.00054126425,0.00051762495,0.000111333546],"domain_scores_gemma":[0.93628436,0.05416998,0.0027977205,0.004666753,0.0016598091,0.00042132186],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02535079,0.000960428,0.0014801438,0.0015090842,0.00039538817,0.0018438841,0.002539439,0.0019336545,0.004384817],"category_scores_gemma":[0.102719225,0.00054981734,0.0013069946,0.0017523167,0.0016719264,0.004578697,0.0025378729,0.0032102023,0.0005526869],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005080155,0.00016106982,0.00957976,0.0008246999,0.0010131191,0.00016975543,0.00026259822,0.53495556,0.00088319567,0.19231735,0.006369065,0.2529558],"study_design_scores_gemma":[0.00007482604,0.00010514673,0.00068224134,0.000119364195,0.000055057888,0.00006368142,0.000027135651,0.8217729,0.0005832331,0.1743041,0.0021865058,0.00002588376],"about_ca_topic_score_codex":0.0027643077,"about_ca_topic_score_gemma":0.0033387805,"teacher_disagreement_score":0.9746492,"about_ca_system_score_codex":0.0011944694,"about_ca_system_score_gemma":0.0016466217,"threshold_uncertainty_score":0.13406944},"labels":[],"label_agreement":null},{"id":"W4416776461","doi":"10.52937/hira.25.5.2.e4","title":"Predictive Analytics on Drug Shortages and Future Challenges: A Review","year":2025,"lang":"en","type":"review","venue":"Health Insurance Review & Assessment Service Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Economic shortage; Predictive analytics; Analytics; Drug; Data analysis","score_opus":0.47794546858610765,"score_gpt":0.6274221429656508,"score_spread":0.14947667437954315,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416776461","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000076253134,0.9981735,0.00046578454,0.0006485065,0.00012399848,0.000009172082,0.000032223437,0.000010002548,0.0004605936],"genre_scores_gemma":[0.0009981018,0.9982167,0.00035448486,0.00016997587,0.00012691389,0.000009872207,0.000035100227,0.0000017527416,0.00008708824],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9991967,0.0002565548,0.00012897188,0.000103475584,0.00027231497,0.00004193182],"domain_scores_gemma":[0.99127734,0.0072097317,0.00052126107,0.00010578267,0.00078406424,0.000101908285],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002939039,0.0011363806,0.0017885213,0.004294157,0.00030333266,0.0017222951,0.0015473799,0.0015373747,0.0038748276],"category_scores_gemma":[0.0093399845,0.00048025948,0.0018462306,0.00470995,0.0006481261,0.0022619802,0.00093183084,0.0017420697,0.00096019683],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053109194,0.000058775247,0.0005037116,0.042562213,0.0004478463,0.00007971395,0.00009054016,0.0019228492,0.00013050869,0.011373638,0.024608744,0.91816825],"study_design_scores_gemma":[0.000050157174,0.0001808156,0.002217038,0.10192002,0.0016203747,0.00066812866,0.00022618813,0.0026139815,0.00034872035,0.023702743,0.86636156,0.00009025493],"about_ca_topic_score_codex":0.0033472246,"about_ca_topic_score_gemma":0.00389478,"teacher_disagreement_score":0.004294157,"about_ca_system_score_codex":0.0010033346,"about_ca_system_score_gemma":0.0033853145,"threshold_uncertainty_score":0.015543342},"labels":[],"label_agreement":null},{"id":"W4416781974","doi":"10.48550/arxiv.2511.20985","title":"Two-stage Estimation for Causal Inference Involving a Semi-continuous Exposure","year":2025,"lang":"","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Australian Research Council Centre of Excellence for Mathematical and Statistical Frontiers; National Institute on Alcohol Abuse and Alcoholism; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Causal inference; Causal model; Inference; Estimation; Propensity score matching; Consistency (knowledge bases); Estimator; Marginal structural model","score_opus":0.1793615873005519,"score_gpt":0.3095050894872094,"score_spread":0.1301435021866575,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416781974","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001056773,0.000103344784,0.99828964,0.0001229554,0.000021561376,0.00006523744,0.0000771452,0.00007250807,0.00019091438],"genre_scores_gemma":[0.12042271,0.0008022826,0.8717052,0.0004026255,0.00025762402,0.0014619099,0.0006484275,0.000114136965,0.004185116],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97845846,0.015870303,0.0008519518,0.0028853389,0.0015189776,0.00041495363],"domain_scores_gemma":[0.88161176,0.10168169,0.0046813865,0.009167467,0.0023375035,0.00052018586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039461423,0.0017381915,0.0028873684,0.0028010788,0.0010521404,0.0020067205,0.0045972317,0.0030627556,0.012088147],"category_scores_gemma":[0.10947896,0.0020244024,0.004017417,0.0031618432,0.0041954215,0.0040248,0.0043647103,0.0059545515,0.0014243048],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022401841,0.00017250254,0.006933876,0.0006773046,0.0009711614,0.00031975683,0.00048248356,0.09378591,0.0011981464,0.79481184,0.002309712,0.098113164],"study_design_scores_gemma":[0.00012210217,0.0001998205,0.0022600272,0.00014177315,0.0002381641,0.00016109711,0.0000541048,0.4518561,0.0011013547,0.5390683,0.0047206464,0.000076597455],"about_ca_topic_score_codex":0.005262849,"about_ca_topic_score_gemma":0.005397262,"teacher_disagreement_score":0.039461423,"about_ca_system_score_codex":0.0018643618,"about_ca_system_score_gemma":0.0037266994,"threshold_uncertainty_score":0.2086944},"labels":[],"label_agreement":null},{"id":"W4416833813","doi":"10.2196/80911","title":"Establish a PrEP (Pre-Exposure Prophylaxis) Epidemiology, Modeling, and Surveillance (PREMISE) System to Analyze Trends in PrEP Uptake and the Impact of PrEP Programs and Policies: Protocol for a Natural Experiment and Modeling Study in the United States","year":2025,"lang":"en","type":"article","venue":"JMIR Research Protocols","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Protocol (science); Data collection; Matching (statistics); Pre-exposure prophylaxis; Program evaluation","score_opus":0.3626300923104187,"score_gpt":0.6189278606352093,"score_spread":0.2562977683247906,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416833813","genre_codex":"protocol","genre_gemma":"protocol","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"protocol","genre_consensus":"protocol","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008938923,0.000059902755,0.021612303,0.0005015687,0.00021626458,0.95515245,0.01115842,0.00047918205,0.0018810575],"genre_scores_gemma":[0.0035335238,0.000028501323,0.01219607,0.00016725696,0.000020027384,0.9825783,0.0011839079,0.000017141721,0.00027533312],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9690581,0.021888569,0.0027593875,0.0023012315,0.0023956033,0.0015970384],"domain_scores_gemma":[0.9495195,0.009494881,0.0068736793,0.015888883,0.013736363,0.004486735],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06335031,0.002802964,0.0024150799,0.0018590613,0.0044578924,0.0020084383,0.0036914127,0.003734806,0.030030465],"category_scores_gemma":[0.05426939,0.002617371,0.0033827752,0.0021078265,0.002259084,0.002340461,0.0038024888,0.005474197,0.00855323],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.16468103,0.087528855,0.07994676,0.01117064,0.0034216752,0.0011230437,0.0054545323,0.031632584,0.015654406,0.02701594,0.31307787,0.25929272],"study_design_scores_gemma":[0.18651429,0.0964939,0.12075176,0.006539218,0.0024506324,0.00044564068,0.0025436569,0.04827335,0.022172244,0.017423535,0.49521872,0.0011730604],"about_ca_topic_score_codex":0.008186539,"about_ca_topic_score_gemma":0.0108081205,"teacher_disagreement_score":0.06335031,"about_ca_system_score_codex":0.0054675187,"about_ca_system_score_gemma":0.03160477,"threshold_uncertainty_score":0.33503246},"labels":[],"label_agreement":null},{"id":"W4417026703","doi":"10.48550/arxiv.2512.03254","title":"Assumption-Lean Differential Variance Inference for Heterogeneous Treatment Effect Detection","year":2025,"lang":"","type":"preprint","venue":"ArXiv.org","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Svenska Sällskapet för Medicinsk Forskning","keywords":"Causal inference; Estimator; Average treatment effect; Inference; Observational study; Homogeneous; Treatment effect; Randomized experiment; Covariate","score_opus":0.122897541158739,"score_gpt":0.40795764254051187,"score_spread":0.28506010138177285,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417026703","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024102647,0.00020401487,0.995669,0.00049271906,0.000058911988,0.0001286453,0.00015673334,0.00013117208,0.0007485652],"genre_scores_gemma":[0.30047175,0.0009305751,0.6895954,0.0018388716,0.00068118854,0.002084091,0.0010887345,0.00026361426,0.003045748],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9582228,0.030771388,0.0017343899,0.004719124,0.003772922,0.00077950064],"domain_scores_gemma":[0.6885633,0.2821078,0.0075780535,0.016637783,0.0042766626,0.0008363877],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07450532,0.0015879325,0.0030941674,0.0028077357,0.0012641714,0.002605359,0.004481708,0.0032897727,0.00804574],"category_scores_gemma":[0.30642903,0.0014101403,0.0036166732,0.0027312357,0.0059807245,0.0044923793,0.0048895827,0.007191595,0.0010260717],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00035883315,0.000177596,0.006239645,0.0007259684,0.00069550343,0.00037455495,0.000399863,0.06943114,0.00103046,0.8323798,0.0037908633,0.08439576],"study_design_scores_gemma":[0.00015821189,0.000109856584,0.0010162317,0.00012507322,0.00013081373,0.00014357503,0.000037824942,0.27268073,0.0011253273,0.72210395,0.0023402134,0.000028241473],"about_ca_topic_score_codex":0.0023767801,"about_ca_topic_score_gemma":0.001666377,"teacher_disagreement_score":0.07450532,"about_ca_system_score_codex":0.002462548,"about_ca_system_score_gemma":0.004164632,"threshold_uncertainty_score":0.39402652},"labels":[],"label_agreement":null},{"id":"W4417029871","doi":"10.1215/00703370-12344620","title":"A Commentary on “Gender Bias in Parental Attitude: An Experimental Approach” by Begum, Grossman, and Islam (2018)","year":2025,"lang":"en","type":"article","venue":"Demography","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Islam; Transparency (behavior); Randomization; Population; Random assignment; Research design","score_opus":0.1410463498715367,"score_gpt":0.40107064766773953,"score_spread":0.26002429779620284,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417029871","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00006920318,0.008902677,0.0002578351,0.9333273,0.056963526,0.0000084046715,0.00008075794,0.000017135182,0.0003731904],"genre_scores_gemma":[0.0016273826,0.003627843,0.000356948,0.947963,0.04550277,0.00008081043,0.000024330704,0.00004030575,0.000776564],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.92475754,0.04374859,0.0066564656,0.0077707567,0.015163583,0.0019030742],"domain_scores_gemma":[0.5715445,0.37957293,0.0072571025,0.00660635,0.031525385,0.0034936646],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058301188,0.002240978,0.0043097558,0.0025124908,0.007808796,0.007920814,0.012101878,0.065251485,0.007318166],"category_scores_gemma":[0.27498233,0.0017250347,0.00357114,0.0033929793,0.018997729,0.012012765,0.0057013296,0.08164727,0.0060128765],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000054279575,0.000012100892,0.000068200956,0.00066328706,0.000035176112,0.00007056857,0.0008221429,0.000037200927,0.000034030643,0.00740724,0.9857685,0.005027296],"study_design_scores_gemma":[0.00016303652,0.000059416892,0.00056690804,0.0064830948,0.000136166,0.00028885397,0.0014411797,0.00024038313,0.00030520232,0.031704277,0.9584973,0.000114227456],"about_ca_topic_score_codex":0.020421408,"about_ca_topic_score_gemma":0.016118279,"teacher_disagreement_score":0.065251485,"about_ca_system_score_codex":0.009423898,"about_ca_system_score_gemma":0.014202738,"threshold_uncertainty_score":0.30832988},"labels":[],"label_agreement":null},{"id":"W4417317269","doi":"10.57264/cer-2025-0196","title":"R WE ready for reimbursement? A round-up of developments in real-world evidence relating to health technology assessment: part 23","year":2025,"lang":"en","type":"article","venue":"Journal of Comparative Effectiveness Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kingston Health Sciences Centre; Public Health Ontario; University of Toronto","funders":"","keywords":"Transformative learning; Health technology; MEDLINE; Health information technology; Clinical trial; Evidence-based medicine; Real world evidence","score_opus":0.6211705210896415,"score_gpt":0.6597066368166193,"score_spread":0.03853611572697779,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417317269","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00027109846,0.65469027,0.00429159,0.30808446,0.028906299,0.00009894042,0.00021934968,0.00012912242,0.003308831],"genre_scores_gemma":[0.0066720354,0.78935355,0.018209346,0.1417679,0.040458087,0.0003891018,0.00037433722,0.00030980894,0.0024657864],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.96877205,0.017330075,0.0049588014,0.0014685474,0.006536779,0.0009338021],"domain_scores_gemma":[0.65783244,0.29336762,0.0116066085,0.007414909,0.025914092,0.0038643489],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08855732,0.0014855993,0.0046539106,0.0053139413,0.0014747615,0.011250081,0.0039508357,0.010449306,0.01762155],"category_scores_gemma":[0.2701551,0.0011202466,0.0040688044,0.006761756,0.0061811185,0.025463207,0.0055386885,0.021724198,0.0044277264],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002135665,0.00007092168,0.00034440597,0.010428998,0.00030225117,0.00016876515,0.00030255495,0.0006082072,0.0003141159,0.05007383,0.39833823,0.53883415],"study_design_scores_gemma":[0.00009234398,0.0001467801,0.00094451307,0.03350211,0.0002714601,0.0004166918,0.0003336018,0.0005054416,0.0001873072,0.060328543,0.9031572,0.00011392742],"about_ca_topic_score_codex":0.0035851505,"about_ca_topic_score_gemma":0.0068616555,"teacher_disagreement_score":0.9114427,"about_ca_system_score_codex":0.006420533,"about_ca_system_score_gemma":0.013354941,"threshold_uncertainty_score":0.46834147},"labels":[],"label_agreement":null},{"id":"W4417410525","doi":"10.1016/j.cmpb.2025.109187","title":"Random forests for individual treatment effect estimation with the R package ITERF","year":2025,"lang":"en","type":"article","venue":"Computer Methods and Programs in Biomedicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Random forest; Estimation; R package; Treatment effect; Random effects model; Average treatment effect","score_opus":0.13721998632751883,"score_gpt":0.48554932193520345,"score_spread":0.34832933560768464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417410525","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001724456,0.0013594284,0.8706373,0.0006473202,0.00051324966,0.000622679,0.038443174,0.08472847,0.0013239098],"genre_scores_gemma":[0.022234911,0.0006421864,0.9189466,0.00066560134,0.00026448615,0.0054477514,0.018498983,0.029723864,0.0035755977],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9840879,0.010926755,0.0010116798,0.0020986234,0.0013350887,0.0005398749],"domain_scores_gemma":[0.9284274,0.06020097,0.0020502273,0.0069408715,0.0019020635,0.00047845926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027467405,0.004141653,0.0067471014,0.0039507323,0.00092260283,0.0033362776,0.006554915,0.0021625678,0.0832885],"category_scores_gemma":[0.09742423,0.0032918372,0.009905941,0.0032440186,0.0015375942,0.0021829884,0.0027279207,0.0057485895,0.035036527],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018614205,0.0004803989,0.01013792,0.0077861412,0.012943481,0.0009146235,0.00088226685,0.04479754,0.002574936,0.087719604,0.55174434,0.27815744],"study_design_scores_gemma":[0.0034109126,0.00053914485,0.006873499,0.0017663909,0.0052623632,0.0015222797,0.00017622877,0.2902824,0.006945318,0.32013056,0.36252046,0.0005704119],"about_ca_topic_score_codex":0.006173671,"about_ca_topic_score_gemma":0.010192204,"teacher_disagreement_score":0.0832885,"about_ca_system_score_codex":0.0011161981,"about_ca_system_score_gemma":0.0044509866,"threshold_uncertainty_score":0.27862775},"labels":[],"label_agreement":null},{"id":"W4417426866","doi":"10.48550/arxiv.2507.14391","title":"Policy relevance of causal quantities in networks","year":2025,"lang":"en","type":"preprint","venue":"arXiv (Cornell University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Banff International Research Station for Mathematical Innovation and Discovery","keywords":"Relevance (law); Outcome (game theory); Representation (politics); Interpretation (philosophy); Contrast (vision); Causal inference","score_opus":0.20032257674614407,"score_gpt":0.30952604999941846,"score_spread":0.1092034732532744,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417426866","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.036505338,0.0014507538,0.94638497,0.006917372,0.00011231001,0.0001901832,0.00091249024,0.00031163622,0.007214961],"genre_scores_gemma":[0.77072924,0.0030783406,0.21732338,0.0013811179,0.00062169036,0.001177394,0.0009973153,0.00025498503,0.0044365553],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9804473,0.013993747,0.00079921505,0.0029172024,0.0013398274,0.00050277845],"domain_scores_gemma":[0.7763951,0.20760128,0.0074039414,0.005730294,0.0022571778,0.0006122143],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028173804,0.0011227893,0.002614292,0.003405432,0.0014914818,0.0048691244,0.0024996486,0.0029725966,0.0067411033],"category_scores_gemma":[0.18660474,0.0011049423,0.0017109751,0.003323276,0.005520682,0.012482767,0.002934314,0.005236538,0.00034437762],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007345628,0.000053406395,0.0022434245,0.00024663942,0.0001287377,0.00007970334,0.00036533453,0.076369256,0.00014884895,0.89927953,0.0012161309,0.01979556],"study_design_scores_gemma":[0.000016952405,0.000012651631,0.00040101208,0.000057418416,0.000030085284,0.000016043754,0.000044235832,0.08574327,0.00012300078,0.9124757,0.0010673838,0.000012404063],"about_ca_topic_score_codex":0.00455718,"about_ca_topic_score_gemma":0.0030853944,"teacher_disagreement_score":0.028173804,"about_ca_system_score_codex":0.0057066865,"about_ca_system_score_gemma":0.0023105126,"threshold_uncertainty_score":0.1489991},"labels":[],"label_agreement":null},{"id":"W4417427848","doi":"10.1177/09622802251403355","title":"Joint mixed-effects models for causal inference in clustered network-based observational studies","year":2025,"lang":"en","type":"article","venue":"Statistical Methods in Medical Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de recherche du Québec – Nature et technologies; Fonds de Recherche du Québec - Santé; University of North Carolina at Chapel Hill; National Institute of Child Health and Human Development; Alliance de recherche numérique du Canada; Natural Sciences and Engineering Research Council of Canada; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Canada Research Chairs; McGill University","keywords":"Causal inference; Inference; Observational study; Context (archaeology); Outcome (game theory); Bayesian inference; Causal model; Bayesian probability; Latent variable","score_opus":0.7591763701323779,"score_gpt":0.7047860776338563,"score_spread":0.054390292498521675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417427848","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011129112,0.0004850928,0.99710935,0.00039754267,0.00006852972,0.00014486742,0.00026555493,0.0001026586,0.00031356272],"genre_scores_gemma":[0.092996575,0.0018073706,0.8971602,0.00064188073,0.0003871854,0.0040216893,0.0010455381,0.00012486792,0.0018147802],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9386349,0.052530047,0.0019345748,0.003976613,0.0024089,0.00051508757],"domain_scores_gemma":[0.7901857,0.18859889,0.007026287,0.010654095,0.0028409131,0.0006942054],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.075760946,0.0018307285,0.0036227333,0.004107621,0.0013854284,0.003244398,0.0074880724,0.0035264904,0.007915518],"category_scores_gemma":[0.18956596,0.0018445195,0.0049683442,0.0054507633,0.0034327984,0.0044643558,0.004621808,0.006179007,0.0009874075],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015728163,0.00008355945,0.0047698044,0.00088823156,0.0015993186,0.00029270747,0.00078612135,0.085993245,0.00025871355,0.8537647,0.0027439024,0.048662327],"study_design_scores_gemma":[0.00010339795,0.00007785981,0.0008401838,0.00026581748,0.00034367287,0.00008313418,0.00008934371,0.25226724,0.00022495797,0.7409384,0.0047201854,0.000045790068],"about_ca_topic_score_codex":0.0080273645,"about_ca_topic_score_gemma":0.007864587,"teacher_disagreement_score":0.075760946,"about_ca_system_score_codex":0.0026928422,"about_ca_system_score_gemma":0.003525554,"threshold_uncertainty_score":0.40066695},"labels":[],"label_agreement":null},{"id":"W4417479607","doi":"10.1016/j.jval.2025.09.1447","title":"HPR37 Bridging the Gap: How Early Access Shapes Pricing and Reimbursed Populations in France","year":2025,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Network for Business Sustainability","funders":"","keywords":"Bridging (networking); Mode (computer interface)","score_opus":0.31934627059427295,"score_gpt":0.47770535900780214,"score_spread":0.1583590884135292,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417479607","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8598572,0.004266949,0.026055615,0.06741362,0.00042549943,0.00006677378,0.0050885943,0.00035466603,0.036471047],"genre_scores_gemma":[0.9872936,0.000410908,0.0026116476,0.0011769856,0.0001597273,0.000033445587,0.00074969593,0.00007602121,0.007487925],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.9928311,0.004405766,0.00014090263,0.0007281854,0.0006539674,0.0012400148],"domain_scores_gemma":[0.9808102,0.0145828,0.0013463567,0.0008404291,0.0015286811,0.0008915694],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008165635,0.00023006252,0.0007938562,0.0011564558,0.0010884269,0.004061765,0.0014628043,0.0019351939,0.01639811],"category_scores_gemma":[0.030321782,0.00023062939,0.0011054234,0.0015569971,0.000926666,0.0020161,0.0014651163,0.0028402237,0.0008647248],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00093809044,0.00055512687,0.3928136,0.0002138346,0.00056476763,0.00092218595,0.0045653894,0.032951575,0.00061435107,0.3963171,0.054766808,0.11477724],"study_design_scores_gemma":[0.00036650168,0.00055662816,0.51174283,0.00045988857,0.00045441542,0.00064565224,0.0072904876,0.13199656,0.0010695963,0.25741702,0.087755546,0.00024487646],"about_ca_topic_score_codex":0.24691601,"about_ca_topic_score_gemma":0.15507318,"teacher_disagreement_score":0.24691601,"about_ca_system_score_codex":0.005462149,"about_ca_system_score_gemma":0.00606506,"threshold_uncertainty_score":0.49095756},"labels":[],"label_agreement":null},{"id":"W4417479756","doi":"10.1016/j.jval.2025.09.2151","title":"HTA368 When Less Is More? Learnings From a Recent NICE Submission Utilizing a Novel Predictive Individual-Level Surrogacy Approach to Predict Overall Survival (OS) in the Absence of Trial-Level Evidence","year":2025,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"MD Precision (Canada)","funders":"","keywords":"Nice; Overall survival; Survival analysis; Baseline (sea); MEDLINE","score_opus":0.5191381405924437,"score_gpt":0.45008090499140646,"score_spread":0.06905723560103721,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417479756","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005936919,0.020505797,0.09221145,0.8132991,0.031989854,0.00048394137,0.007108327,0.00095734355,0.027507314],"genre_scores_gemma":[0.22679463,0.023144577,0.26541516,0.3633655,0.0645359,0.001588396,0.005922564,0.0028824026,0.046350878],"study_design_codex":"not_applicable","study_design_gemma":"case_report","domain_scores_codex":[0.962891,0.026371902,0.0022687456,0.0017705418,0.0060766656,0.0006212537],"domain_scores_gemma":[0.75569195,0.21532091,0.004217377,0.006249325,0.014931225,0.00358924],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.049342334,0.0009857988,0.0023211983,0.0017251907,0.0008222555,0.006333094,0.0022664163,0.0057379324,0.01757708],"category_scores_gemma":[0.34843513,0.00053907925,0.0039094426,0.0018828453,0.0026703088,0.0038257334,0.0030511606,0.0125337485,0.005308608],"study_design_candidate":"case_report","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002230039,0.0001031669,0.0040145684,0.0035134465,0.0018391385,0.0006681328,0.00046760388,0.0036856334,0.0003153444,0.08083675,0.71367794,0.18864825],"study_design_scores_gemma":[0.0029507033,0.0008558736,0.0040499335,0.0074821813,0.003346462,0.0015609754,0.00042784042,0.025112156,0.0014290565,0.39355627,0.55881685,0.00041166996],"about_ca_topic_score_codex":0.005779501,"about_ca_topic_score_gemma":0.0108448425,"teacher_disagreement_score":0.95065767,"about_ca_system_score_codex":0.0020477818,"about_ca_system_score_gemma":0.006725311,"threshold_uncertainty_score":0.26095033},"labels":[],"label_agreement":null},{"id":"W4417480375","doi":"10.1016/j.jval.2025.09.2882","title":"RWD132 Out of Sight, Out of Mind? A Simulation Study Assessing the Use of Quantitative Bias Analysis for Outcome Misclassification in Single-Arm Trials With External Control Comparisons","year":2025,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario","funders":"","keywords":"Outcome (game theory); Control (management); External validity; Clinical trial; Range (aeronautics)","score_opus":0.8275028844107982,"score_gpt":0.5910186809017658,"score_spread":0.23648420350903243,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417480375","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44782087,0.0071671493,0.52141654,0.0050270488,0.0009616304,0.0061516673,0.00084157323,0.00053635077,0.010077194],"genre_scores_gemma":[0.9233975,0.0005112981,0.071775615,0.000867083,0.000081586644,0.0024992838,0.00011010149,0.000063887666,0.0006936839],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7455772,0.24410842,0.0034883877,0.0034985058,0.002638481,0.0006889798],"domain_scores_gemma":[0.18745832,0.79096067,0.008244062,0.010320031,0.0023552782,0.0006616458],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19261374,0.0014388895,0.0031257668,0.0013552977,0.0007601883,0.0025717707,0.0023929076,0.0036950873,0.006381357],"category_scores_gemma":[0.5227494,0.0009819692,0.006211521,0.0014200378,0.0035843619,0.0035565423,0.0019802398,0.0045382637,0.00033613],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.1733459,0.007633043,0.040456735,0.009787639,0.029340578,0.0013565748,0.003445776,0.27986568,0.0020700363,0.23498024,0.006765977,0.21095183],"study_design_scores_gemma":[0.05841535,0.017176395,0.0067477026,0.0021222567,0.013265616,0.0007910609,0.00062772806,0.72944623,0.0017321479,0.16492064,0.004433848,0.00032109284],"about_ca_topic_score_codex":0.00338892,"about_ca_topic_score_gemma":0.0015453309,"teacher_disagreement_score":0.8073863,"about_ca_system_score_codex":0.0019795087,"about_ca_system_score_gemma":0.003833288,"threshold_uncertainty_score":0.995651},"labels":[],"label_agreement":null},{"id":"W4417481050","doi":"10.1016/j.jval.2025.09.3352","title":"MSR66 Dealing With Missing Data in Health Economic Studies of Small to Moderate Size: How to Minimize Bias","year":2025,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre hospitalier universitaire de Québec; Université Laval","funders":"","keywords":"Missing data; Imputation (statistics); Sample size determination; Matching (statistics); Sample (material); Propensity score matching","score_opus":0.538504278450313,"score_gpt":0.49361757745006957,"score_spread":0.044886701000243445,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417481050","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012643466,0.0017921384,0.9916768,0.0040151207,0.00026155717,0.0001386031,0.00011318564,0.00020390484,0.00053442584],"genre_scores_gemma":[0.044642024,0.0017314189,0.94871914,0.0012407488,0.0007247566,0.000826243,0.0001910669,0.00039669254,0.0015280127],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8710201,0.11466365,0.0055958917,0.0036020286,0.004473043,0.000645234],"domain_scores_gemma":[0.57841283,0.38112262,0.007421918,0.023898229,0.008175677,0.0009687306],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13759282,0.0019266092,0.0049062227,0.0041569364,0.0012905532,0.0028492296,0.0042748684,0.004639042,0.007715919],"category_scores_gemma":[0.434663,0.002056842,0.006386974,0.0051847794,0.0033948051,0.005506555,0.004622005,0.00722852,0.001402133],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007416555,0.0002077864,0.00533515,0.0040238653,0.0039987247,0.00069391786,0.0014959481,0.041951716,0.0014033805,0.38423222,0.024504812,0.53141075],"study_design_scores_gemma":[0.0003288351,0.0001793994,0.0011117825,0.0009950218,0.00077304523,0.00035231988,0.00019678345,0.116120934,0.0018804967,0.8588443,0.019116824,0.00010030129],"about_ca_topic_score_codex":0.0020395953,"about_ca_topic_score_gemma":0.001970614,"teacher_disagreement_score":0.8624072,"about_ca_system_score_codex":0.0010308856,"about_ca_system_score_gemma":0.0032291675,"threshold_uncertainty_score":0.7276691},"labels":[],"label_agreement":null},{"id":"W4417481417","doi":"10.1016/j.jval.2025.09.3482","title":"MSR206 Transporting Treatment Effects for Survival Outcomes Under Informative Censoring: A Simulation Study Using Summary-Level Data in the Target Population","year":2025,"lang":"en","type":"article","venue":"Value in Health","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; Simon Fraser University","funders":"","keywords":"Censoring (clinical trials); Weighting; Population; Inverse probability weighting; Aggregate data; Data source","score_opus":0.5533582391859345,"score_gpt":0.5444820383462802,"score_spread":0.008876200839654347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417481417","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7841088,0.0006745012,0.20499122,0.0019435732,0.000108403336,0.00061516964,0.0017346999,0.0004239797,0.0053995308],"genre_scores_gemma":[0.96255153,0.00024348893,0.03285618,0.00014856695,0.000029886063,0.00042037622,0.0008404558,0.00007738729,0.0028321815],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99537235,0.003925197,0.00007895284,0.00027817543,0.00014427053,0.00020102717],"domain_scores_gemma":[0.92795545,0.06528988,0.0019348245,0.0027266569,0.0012831925,0.00080992834],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.015362362,0.0006493175,0.0013550919,0.0009080198,0.00057545956,0.0014120081,0.0020136337,0.0021880432,0.008434142],"category_scores_gemma":[0.056385923,0.00062127324,0.002292569,0.0014807612,0.0010240205,0.001389567,0.0011207846,0.0027228182,0.0006336977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024221877,0.0006315286,0.0107595865,0.00015557434,0.0002825056,0.00029749548,0.00030466804,0.9342045,0.00027015732,0.027747473,0.0018603127,0.021064037],"study_design_scores_gemma":[0.00060487096,0.00047825303,0.001432579,0.000036175734,0.00010084096,0.000065752516,0.00008584967,0.9836766,0.00026992772,0.012796451,0.00042787183,0.000024783603],"about_ca_topic_score_codex":0.021219457,"about_ca_topic_score_gemma":0.0072575747,"teacher_disagreement_score":0.9846376,"about_ca_system_score_codex":0.001762706,"about_ca_system_score_gemma":0.00178916,"threshold_uncertainty_score":0.081244946},"labels":[],"label_agreement":null},{"id":"W6889009026","doi":"10.25384/sage.21150918","title":"sj-docx-5-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.22514693702797306,"score_gpt":0.44020639408531165,"score_spread":0.2150594570573386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6889009026","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004722026,0.0004867335,0.03560015,0.0028559323,0.0009329695,0.0006013843,0.894836,0.023414537,0.04080016],"genre_scores_gemma":[0.029674118,0.0021459658,0.12609205,0.007260574,0.0016070793,0.008207535,0.59523934,0.07269153,0.15708177],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99745446,0.0009717319,0.0002898521,0.00037286736,0.0007359696,0.0001749894],"domain_scores_gemma":[0.9387144,0.051295068,0.0020385513,0.002376611,0.0047011347,0.0008742251],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005305907,0.0015011416,0.0014898437,0.0025899815,0.0005893439,0.0031819872,0.0026908899,0.0020765846,0.8773519],"category_scores_gemma":[0.071205676,0.0016934122,0.0022975893,0.003412714,0.0005849476,0.0028221458,0.0020340744,0.0021322323,0.4889997],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006037336,0.000023381928,0.00027702228,0.0012299868,0.00004006447,0.000031461812,0.000027671716,0.001031484,0.00008130735,0.0035007983,0.9808972,0.012799257],"study_design_scores_gemma":[0.0006868249,0.00008083654,0.002076069,0.0014048102,0.00010628458,0.00016882457,0.00008879867,0.0048328224,0.00095663284,0.026977854,0.96253014,0.000090185866],"about_ca_topic_score_codex":0.0072503113,"about_ca_topic_score_gemma":0.012532586,"teacher_disagreement_score":0.8773519,"about_ca_system_score_codex":0.0017003882,"about_ca_system_score_gemma":0.00282738,"threshold_uncertainty_score":0.17494255},"labels":[],"label_agreement":null},{"id":"W6889071373","doi":"10.25384/sage.19561100","title":"sj-docx-1-msj-10.1177_13524585221085733 – Supplemental material for Recommendations for the use of propensity score methods in multiple sclerosis research","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Providence Health Care","funders":"","keywords":"Propensity score matching; Multiple sclerosis; MEDLINE; Fingolimod; Mallinckrodt","score_opus":0.8819585361904688,"score_gpt":0.5843098793734013,"score_spread":0.29764865681706754,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6889071373","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00022934673,0.00034654705,0.007184266,0.003421683,0.0017633259,0.0010005133,0.93612576,0.0118548535,0.03807373],"genre_scores_gemma":[0.005455016,0.001845381,0.041611325,0.0087234955,0.00292018,0.007909727,0.724575,0.036650177,0.17030977],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9943837,0.0013781765,0.0012030923,0.00067545957,0.0019977852,0.00036185613],"domain_scores_gemma":[0.88284427,0.07423984,0.0063799107,0.0068771904,0.025790485,0.0038681983],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.009865113,0.0015364819,0.0020792997,0.0075144926,0.0012358816,0.0059366245,0.0045909644,0.0038882461,0.92878306],"category_scores_gemma":[0.1421826,0.0025379776,0.0018349279,0.010473715,0.0008417118,0.005709948,0.0040037353,0.0033955874,0.79345673],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035280264,0.000029080762,0.00016811253,0.0005120722,0.000010269718,0.000008761515,0.000020622863,0.0000743572,0.0000399519,0.0005596864,0.98897386,0.009567963],"study_design_scores_gemma":[0.00043975384,0.000053026837,0.0025573296,0.0014590102,0.000035820947,0.00009290671,0.00012476106,0.0004938638,0.00035220475,0.0083707515,0.9859443,0.00007642159],"about_ca_topic_score_codex":0.0075189634,"about_ca_topic_score_gemma":0.0124555,"teacher_disagreement_score":0.9901349,"about_ca_system_score_codex":0.0025989558,"about_ca_system_score_gemma":0.005085764,"threshold_uncertainty_score":0.10158223},"labels":[],"label_agreement":null},{"id":"W6889103111","doi":"10.25384/sage.20210629","title":"sj-pdf-3-mdm-10.1177_0272989X221103163 – Supplemental material for An Introductory Tutorial on Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis","score_opus":0.2633656101172559,"score_gpt":0.4509371966833401,"score_spread":0.1875715865660842,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6889103111","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011180436,0.0018566415,0.2763921,0.0076400363,0.0017042294,0.0009585559,0.3744258,0.08651848,0.24938613],"genre_scores_gemma":[0.03288128,0.004339333,0.2884738,0.008430119,0.001844271,0.0054787835,0.2140654,0.13899198,0.30549505],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978435,0.0008586321,0.00018903476,0.00029664423,0.0006871357,0.0001249794],"domain_scores_gemma":[0.9700141,0.025479732,0.00084647234,0.001247944,0.0019380252,0.00047379034],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0047252174,0.0013611193,0.0011899649,0.0020261381,0.00044685713,0.0025966614,0.0021508457,0.002243691,0.7914453],"category_scores_gemma":[0.036560986,0.0014549119,0.0018254815,0.0024081718,0.0005133579,0.0025742366,0.0019307451,0.0020432859,0.5215508],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000057130073,0.00003438237,0.00024282146,0.00080729264,0.000037986596,0.00006197958,0.000038413193,0.001654182,0.00030030461,0.013229917,0.94559073,0.03794484],"study_design_scores_gemma":[0.00029039566,0.000065105865,0.0010852965,0.00063589105,0.000048886734,0.0002696325,0.000036791724,0.0061303466,0.0013534558,0.04945135,0.9405659,0.00006696991],"about_ca_topic_score_codex":0.0029534623,"about_ca_topic_score_gemma":0.005206004,"teacher_disagreement_score":0.7914453,"about_ca_system_score_codex":0.0012619254,"about_ca_system_score_gemma":0.0015966386,"threshold_uncertainty_score":0.2974779},"labels":[],"label_agreement":null},{"id":"W6889141474","doi":"10.25384/sage.21150909","title":"sj-docx-2-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.2244178642766549,"score_gpt":0.4398329656675916,"score_spread":0.21541510139093673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6889141474","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00047334,0.0004521426,0.035632677,0.0028045767,0.0009526616,0.0005790437,0.8957665,0.024373662,0.03896531],"genre_scores_gemma":[0.029772852,0.0020048798,0.12476194,0.007139983,0.0016269211,0.008224629,0.593609,0.079754315,0.15310547],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9974963,0.0009384954,0.00027896982,0.0003817446,0.00072640396,0.00017807084],"domain_scores_gemma":[0.9403805,0.049878348,0.0019495495,0.0023670804,0.004543004,0.0008814716],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0053255353,0.0015017828,0.0014670094,0.0025429488,0.0005970812,0.0032427944,0.0026851096,0.002058872,0.8715917],"category_scores_gemma":[0.070439234,0.0017104823,0.0022796872,0.003372589,0.00059876894,0.0027796982,0.0020217435,0.0021954963,0.48994705],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000060672566,0.000022927445,0.00028980811,0.0011703863,0.000040283037,0.000031593587,0.000027574139,0.0009919943,0.00008320636,0.003348388,0.98157173,0.012361408],"study_design_scores_gemma":[0.00070219534,0.00007704098,0.0021055054,0.0013468034,0.00010512443,0.00017297445,0.00008900175,0.0048105796,0.000968861,0.026340421,0.9631888,0.000092666225],"about_ca_topic_score_codex":0.007051098,"about_ca_topic_score_gemma":0.012455324,"teacher_disagreement_score":0.8715917,"about_ca_system_score_codex":0.0016218378,"about_ca_system_score_gemma":0.0028743139,"threshold_uncertainty_score":0.18315881},"labels":[],"label_agreement":null},{"id":"W6889165924","doi":"10.25384/sage.21150915","title":"sj-docx-4-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.22514693702797306,"score_gpt":0.44020639408531165,"score_spread":0.2150594570573386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6889165924","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048102613,0.00048094566,0.03641211,0.0029305662,0.00096081354,0.000611807,0.89088196,0.024325091,0.0429156],"genre_scores_gemma":[0.030112516,0.002132593,0.12352742,0.0070021823,0.0016454807,0.008277344,0.58421606,0.07756002,0.1655264],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99748456,0.0009508867,0.00028491748,0.00037072704,0.00073463557,0.000174293],"domain_scores_gemma":[0.9391641,0.050784647,0.0020043484,0.0023850796,0.004781414,0.0008803319],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005301832,0.0014893642,0.0014300988,0.002583391,0.0005894186,0.003129705,0.0026746462,0.0020140267,0.8757793],"category_scores_gemma":[0.07238375,0.001654777,0.0022463207,0.0034590436,0.00058896426,0.0028238988,0.002001296,0.0020969692,0.500869],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005770837,0.000022520308,0.00027216368,0.0011126355,0.00003711916,0.000029159515,0.000026559714,0.000961677,0.000079159836,0.0033134264,0.9814673,0.012620635],"study_design_scores_gemma":[0.0006720362,0.000078109675,0.0020656846,0.0013347293,0.00010157843,0.00016496771,0.00009007386,0.0047199763,0.0009562393,0.026711572,0.96301675,0.000088192624],"about_ca_topic_score_codex":0.0071225315,"about_ca_topic_score_gemma":0.012253349,"teacher_disagreement_score":0.8757793,"about_ca_system_score_codex":0.0016554286,"about_ca_system_score_gemma":0.0028159276,"threshold_uncertainty_score":0.17718571},"labels":[],"label_agreement":null},{"id":"W6901953627","doi":"10.6084/m9.figshare.16823703.v1","title":"Additional file 1 of Statistical reanalysis of vascular event outcomes in primary and secondary vascular prevention trials","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Vascular access; Event (particle physics); Clinical trial; Vascular disease; MEDLINE","score_opus":0.1257677356698285,"score_gpt":0.3932770141944738,"score_spread":0.26750927852464534,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6901953627","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002325047,0.0000634097,0.001756027,0.00018118313,0.0000517719,0.00046963658,0.9953863,0.00047937135,0.0013797996],"genre_scores_gemma":[0.03657204,0.00068252295,0.03868363,0.0028235237,0.00051686954,0.030902265,0.8525548,0.00399924,0.03326513],"study_design_codex":"not_applicable","study_design_gemma":"meta_analysis","domain_scores_codex":[0.9956735,0.0017078727,0.00090684625,0.00071297114,0.00066653366,0.000332299],"domain_scores_gemma":[0.7986702,0.18095744,0.0063926396,0.0061953436,0.0066436715,0.0011406984],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.008926191,0.0013083159,0.001835107,0.003615379,0.0008122095,0.0021198792,0.0020223083,0.0014991723,0.86960834],"category_scores_gemma":[0.14652264,0.0010914021,0.0020393052,0.0052899504,0.0005217064,0.0018261664,0.001219816,0.0017811457,0.110992156],"study_design_candidate":"meta_analysis","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009096103,0.00009880683,0.0027008755,0.00831724,0.00034550473,0.000075823016,0.00009057716,0.0014906159,0.00008059297,0.0027235297,0.9691599,0.014006915],"study_design_scores_gemma":[0.029309347,0.0010228823,0.030011645,0.011265406,0.0019506091,0.0010357557,0.00039903886,0.0099257985,0.0010697258,0.06199739,0.85168254,0.0003299435],"about_ca_topic_score_codex":0.004311571,"about_ca_topic_score_gemma":0.0085031865,"teacher_disagreement_score":0.86960834,"about_ca_system_score_codex":0.0012596461,"about_ca_system_score_gemma":0.0040445626,"threshold_uncertainty_score":0.18598789},"labels":[],"label_agreement":null},{"id":"W6901985572","doi":"10.6084/m9.figshare.20006741.v1","title":"Examining the correlation between treatment effects in clinical trials and economic modeling","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Centre for Addiction and Mental Health","funders":"","keywords":"Correlation; Clinical trial; Covariance; Depression (economics); Identification (biology); Analysis of covariance; Treatment effect; Statistical model","score_opus":0.6675690856680238,"score_gpt":0.5169106529655247,"score_spread":0.150658432702499,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6901985572","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031913344,0.0017748084,0.95755076,0.004027736,0.00013309851,0.00069894706,0.00045802974,0.00017907613,0.0032641622],"genre_scores_gemma":[0.690969,0.0024694193,0.29920846,0.0011688067,0.00020178352,0.002644818,0.0004143347,0.00009618418,0.00282723],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89576787,0.09414489,0.0021943988,0.00386796,0.0031043054,0.00092052465],"domain_scores_gemma":[0.43474638,0.54035914,0.014733481,0.0067234593,0.002623956,0.00081362866],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13983108,0.0014485877,0.0037084734,0.002773147,0.0008561421,0.0036255384,0.0025973753,0.00359893,0.009330226],"category_scores_gemma":[0.3510258,0.0015959296,0.0033665807,0.00458712,0.0043374803,0.006340655,0.0024612094,0.0054113586,0.00053091627],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004296868,0.00013409565,0.008412345,0.0005587111,0.0008648224,0.00026779633,0.00026062818,0.4785284,0.00019564839,0.47672576,0.0015049372,0.032117162],"study_design_scores_gemma":[0.00024663785,0.00024100444,0.0016278983,0.0001698747,0.0002670621,0.00008346543,0.000041802363,0.6215854,0.00026166686,0.3735211,0.001907979,0.000046069646],"about_ca_topic_score_codex":0.0040338417,"about_ca_topic_score_gemma":0.003169067,"teacher_disagreement_score":0.86016893,"about_ca_system_score_codex":0.0050099655,"about_ca_system_score_gemma":0.005636227,"threshold_uncertainty_score":0.73950624},"labels":[],"label_agreement":null},{"id":"W6902071779","doi":"10.6084/m9.figshare.20006741","title":"Examining the correlation between treatment effects in clinical trials and economic modeling","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Centre for Addiction and Mental Health","funders":"","keywords":"Correlation; Clinical trial; Covariance; Depression (economics); Identification (biology); Analysis of covariance; Treatment effect; Statistical model","score_opus":0.6675690856680238,"score_gpt":0.5169106529655247,"score_spread":0.150658432702499,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6902071779","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.031913344,0.0017748084,0.95755076,0.004027736,0.00013309851,0.00069894706,0.00045802974,0.00017907613,0.0032641622],"genre_scores_gemma":[0.690969,0.0024694193,0.29920846,0.0011688067,0.00020178352,0.002644818,0.0004143347,0.00009618418,0.00282723],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89576787,0.09414489,0.0021943988,0.00386796,0.0031043054,0.00092052465],"domain_scores_gemma":[0.43474638,0.54035914,0.014733481,0.0067234593,0.002623956,0.00081362866],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13983108,0.0014485877,0.0037084734,0.002773147,0.0008561421,0.0036255384,0.0025973753,0.00359893,0.009330226],"category_scores_gemma":[0.3510258,0.0015959296,0.0033665807,0.00458712,0.0043374803,0.006340655,0.0024612094,0.0054113586,0.00053091627],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004296868,0.00013409565,0.008412345,0.0005587111,0.0008648224,0.00026779633,0.00026062818,0.4785284,0.00019564839,0.47672576,0.0015049372,0.032117162],"study_design_scores_gemma":[0.00024663785,0.00024100444,0.0016278983,0.0001698747,0.0002670621,0.00008346543,0.000041802363,0.6215854,0.00026166686,0.3735211,0.001907979,0.000046069646],"about_ca_topic_score_codex":0.0040338417,"about_ca_topic_score_gemma":0.003169067,"teacher_disagreement_score":0.13983108,"about_ca_system_score_codex":0.0050099655,"about_ca_system_score_gemma":0.005636227,"threshold_uncertainty_score":0.73950624},"labels":[],"label_agreement":null},{"id":"W6902148588","doi":"10.6084/m9.figshare.26650401","title":"Additional file 1 of A blueprint for a multi-disease, multi-domain Bayesian adaptive platform trial incorporating adult and paediatric subgroups: the Staphylococcus aureus Network Adaptive Platform trial","year":2024,"lang":"en","type":"article","venue":"Open MIND","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Blueprint; Bayesian network; Bayesian probability; Adaptive design; Staphylococcus aureus; Clinical trial","score_opus":0.17231381836221704,"score_gpt":0.3783417479961035,"score_spread":0.20602792963388644,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6902148588","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007420941,0.00013636371,0.0032620567,0.00069567777,0.00012118959,0.0023325067,0.9858116,0.00090748933,0.0059910095],"genre_scores_gemma":[0.07908058,0.0010588244,0.05073751,0.007379938,0.00097427674,0.088780686,0.6784935,0.0042465716,0.089248136],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99757427,0.0012758911,0.00027534924,0.00035615524,0.00030653982,0.0002118311],"domain_scores_gemma":[0.9502577,0.042048424,0.0024881985,0.002513467,0.0017998297,0.0008924256],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005630297,0.0014030247,0.001836248,0.0013225916,0.0009460246,0.0018423104,0.0021815475,0.0020843877,0.8658842],"category_scores_gemma":[0.08121096,0.0009851065,0.002045172,0.0020990456,0.0004573238,0.0018416088,0.0011717087,0.00193259,0.11106725],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0034627828,0.00015214986,0.0016270106,0.004982167,0.00036431514,0.000099642726,0.000082903854,0.0018374161,0.00008250138,0.0040218295,0.9678248,0.015462498],"study_design_scores_gemma":[0.1361059,0.0035495437,0.01945106,0.011155834,0.0030048366,0.0015657184,0.00032553205,0.019438144,0.0014719615,0.08373392,0.719786,0.00041154426],"about_ca_topic_score_codex":0.0044926777,"about_ca_topic_score_gemma":0.008695163,"teacher_disagreement_score":0.8658842,"about_ca_system_score_codex":0.0011505723,"about_ca_system_score_gemma":0.0028596828,"threshold_uncertainty_score":0.19129986},"labels":[],"label_agreement":null},{"id":"W6902166563","doi":"10.6084/m9.figshare.26695770","title":"Additional file 2 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Relation (database); Mediation; Binary data; Sensitivity (control systems); Component (thermodynamics)","score_opus":0.42631790204951725,"score_gpt":0.46249822641172494,"score_spread":0.036180324362207694,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6902166563","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011303652,0.000101867634,0.008449243,0.00049245474,0.00010372385,0.0017640025,0.98191607,0.0012496262,0.004792704],"genre_scores_gemma":[0.076910004,0.0007191454,0.10340773,0.0027106132,0.0004190238,0.054345433,0.71464413,0.0066871652,0.040156733],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9941147,0.0034356138,0.0007522575,0.0005473197,0.0009005383,0.00024962524],"domain_scores_gemma":[0.59274024,0.38320512,0.00577733,0.00929902,0.00786426,0.0011140647],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.016600292,0.001368742,0.0013284658,0.002475059,0.000979,0.0016846907,0.0028316611,0.0019335055,0.8807802],"category_scores_gemma":[0.23870751,0.001109687,0.0017571562,0.0035301165,0.00049622485,0.002192975,0.0013399764,0.0019320238,0.11410781],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014140846,0.00035469062,0.0032045525,0.0048308657,0.00023237255,0.000109758104,0.00017143476,0.0027496412,0.000084518244,0.005284497,0.95583135,0.025732202],"study_design_scores_gemma":[0.041051727,0.002078802,0.034988835,0.013556023,0.0019447886,0.0020960078,0.0008581726,0.033088192,0.0021567566,0.081221476,0.78651553,0.00044366284],"about_ca_topic_score_codex":0.0039983424,"about_ca_topic_score_gemma":0.0069920653,"teacher_disagreement_score":0.8807802,"about_ca_system_score_codex":0.0016326002,"about_ca_system_score_gemma":0.0028882967,"threshold_uncertainty_score":0.17005247},"labels":[],"label_agreement":null},{"id":"W6907708011","doi":"10.25384/sage.21150921","title":"sj-pdf-7-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.2213778857077405,"score_gpt":0.4381728732261409,"score_spread":0.2167949875184004,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6907708011","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012691665,0.0026983372,0.42690217,0.007289006,0.0014791633,0.0009811878,0.29837075,0.071919404,0.18909077],"genre_scores_gemma":[0.04147741,0.006086481,0.44844612,0.007055057,0.0016411024,0.0058239307,0.17867765,0.11528281,0.19550939],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99706274,0.0014100416,0.00024803763,0.00032798943,0.0008147238,0.00013637227],"domain_scores_gemma":[0.964519,0.030673562,0.00094154297,0.0014567592,0.0019838745,0.00042520056],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0060204505,0.0014972413,0.0012050902,0.0020827607,0.00039620354,0.0025658011,0.002103428,0.0021210923,0.66883343],"category_scores_gemma":[0.04331333,0.0014729812,0.0020838242,0.0023428714,0.0005237338,0.0025478567,0.0019174033,0.0020863654,0.38718522],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077887846,0.000044895005,0.00038985448,0.0013451173,0.000087989305,0.000101762926,0.00005720732,0.0041709193,0.00046208303,0.02678718,0.91110694,0.05536818],"study_design_scores_gemma":[0.00037480314,0.000083825114,0.0012398608,0.00089050725,0.00008599944,0.00038917278,0.00004482622,0.015202519,0.0019365371,0.078390874,0.90127,0.00009115876],"about_ca_topic_score_codex":0.003214632,"about_ca_topic_score_gemma":0.005651944,"teacher_disagreement_score":0.66883343,"about_ca_system_score_codex":0.0011821807,"about_ca_system_score_gemma":0.0017704547,"threshold_uncertainty_score":0.4723689},"labels":[],"label_agreement":null},{"id":"W6907773071","doi":"10.25384/sage.21150906","title":"sj-docx-1-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.2244314052399313,"score_gpt":0.43983683059009443,"score_spread":0.21540542535016313,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6907773071","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044044768,0.0004480453,0.03496896,0.002788628,0.00090802315,0.0005523832,0.901361,0.022489538,0.036043074],"genre_scores_gemma":[0.027810186,0.002068023,0.12773935,0.0070262738,0.00159018,0.008182271,0.60816044,0.07315751,0.14426576],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9974942,0.00093821116,0.00028505476,0.00037670133,0.0007320012,0.00017379542],"domain_scores_gemma":[0.9382976,0.051533505,0.0021053336,0.0023664967,0.004823511,0.0008735628],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0053939535,0.0014960314,0.0014317217,0.002593033,0.0005803627,0.0031181935,0.0026831285,0.0020353536,0.86604136],"category_scores_gemma":[0.072726145,0.0016499693,0.0021580462,0.003449497,0.00058736885,0.0027659512,0.0020178698,0.0021239917,0.47896716],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055067154,0.000021473426,0.00028282616,0.0011832279,0.00003768287,0.000030292496,0.000027212192,0.0010123035,0.00008115742,0.003451909,0.9811926,0.012624132],"study_design_scores_gemma":[0.0006304564,0.00007397024,0.0020022062,0.001398518,0.00009921769,0.00016479252,0.000086507105,0.004738174,0.0009277721,0.02606279,0.9637277,0.000087845096],"about_ca_topic_score_codex":0.0071577984,"about_ca_topic_score_gemma":0.012704638,"teacher_disagreement_score":0.86604136,"about_ca_system_score_codex":0.0016753427,"about_ca_system_score_gemma":0.0029225326,"threshold_uncertainty_score":0.19107574},"labels":[],"label_agreement":null},{"id":"W6907780344","doi":"10.25384/sage.20210623","title":"sj-pdf-1-mdm-10.1177_0272989X221103163 – Supplemental material for An Introductory Tutorial on Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis","score_opus":0.26336814566487415,"score_gpt":0.4509560228082778,"score_spread":0.18758787714340364,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6907780344","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011188786,0.0019175108,0.30269796,0.007701993,0.0016357672,0.0009978934,0.3764896,0.0807072,0.22673316],"genre_scores_gemma":[0.032988597,0.00455386,0.32464626,0.008494874,0.0018507701,0.0057572173,0.21605124,0.12936737,0.27628988],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997872,0.0008782223,0.00018835669,0.00029228063,0.0006518792,0.00011732981],"domain_scores_gemma":[0.96992725,0.025648534,0.0008713541,0.0012113716,0.0019009447,0.0004405065],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0048139906,0.0013460226,0.0011439595,0.0020084688,0.00041510916,0.0024197141,0.0021238877,0.0021879862,0.77183264],"category_scores_gemma":[0.036736935,0.0014139822,0.0017204334,0.0023746835,0.00049371226,0.002487882,0.0018683261,0.0019759696,0.48973522],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055974433,0.00003558281,0.0002640662,0.0008865176,0.000040415194,0.00006282755,0.000040713297,0.0018595634,0.0003197966,0.01450616,0.941375,0.040553287],"study_design_scores_gemma":[0.00029737016,0.00006879745,0.0011532784,0.000710207,0.000052604057,0.0002796389,0.00003800045,0.0069873063,0.0014152373,0.053919483,0.93500954,0.000068514666],"about_ca_topic_score_codex":0.0028190783,"about_ca_topic_score_gemma":0.004957581,"teacher_disagreement_score":0.77183264,"about_ca_system_score_codex":0.0011962104,"about_ca_system_score_gemma":0.0015853001,"threshold_uncertainty_score":0.32545298},"labels":[],"label_agreement":null},{"id":"W6911956846","doi":"10.5281/zenodo.15318811","title":"La révolution causale à l'ère de l'IA : Vers une approche hybride entre théorie scientifique et découverte automatisée","year":2025,"lang":"fr","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Context (archaeology); Perspective (graphical); Identity (music); Identification (biology)","score_opus":0.04567019172075941,"score_gpt":0.32683687552926055,"score_spread":0.2811666838085011,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6911956846","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00919789,0.0021546455,0.95450443,0.012004429,0.0001990075,0.00013293877,0.00018951851,0.00055396464,0.021063125],"genre_scores_gemma":[0.34139833,0.0044211815,0.6310214,0.0029021942,0.0004234174,0.0009037415,0.00049414614,0.00057259994,0.01786303],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9821546,0.010107824,0.00076621276,0.0033823147,0.0030409885,0.00054815086],"domain_scores_gemma":[0.94164884,0.03944613,0.00196917,0.012409474,0.003697716,0.00082872825],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02041974,0.0017338209,0.0020173187,0.0042620134,0.0024326271,0.011562889,0.00469336,0.004365154,0.012212181],"category_scores_gemma":[0.047303963,0.0017643168,0.0037254996,0.003354542,0.015423872,0.018592149,0.008116374,0.00820095,0.002402853],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007152927,0.000047996014,0.0012265332,0.0003635698,0.00013296,0.00011421409,0.002714549,0.014773286,0.0007544204,0.94053423,0.0012294375,0.03803725],"study_design_scores_gemma":[0.000038982045,0.00006382379,0.0006468522,0.00031790286,0.000088953886,0.00015032609,0.00066625484,0.054218944,0.001110815,0.899581,0.04305846,0.000057746827],"about_ca_topic_score_codex":0.011099919,"about_ca_topic_score_gemma":0.008561293,"teacher_disagreement_score":0.02041974,"about_ca_system_score_codex":0.0065767807,"about_ca_system_score_gemma":0.007405674,"threshold_uncertainty_score":0.10799116},"labels":[],"label_agreement":null},{"id":"W6920632261","doi":"10.6084/m9.figshare.14190234.v1","title":"Additional file 2 of Waist circumference prediction for epidemiological research using gradient boosted trees","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Circumference; Decision tree; Waist; Tree (set theory); Variable (mathematics)","score_opus":0.6877278544306521,"score_gpt":0.5092984696801275,"score_spread":0.1784293847505246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920632261","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00024373623,0.00003911303,0.0019122293,0.00014693689,0.00003675048,0.00009200487,0.99574214,0.0010989526,0.0006879851],"genre_scores_gemma":[0.014396092,0.00026312965,0.02228651,0.00087314716,0.00017266968,0.0032260525,0.9448715,0.003562452,0.01034833],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990939,0.00026772651,0.00011738332,0.00027303427,0.00016055006,0.00008741602],"domain_scores_gemma":[0.973118,0.023192674,0.00067283073,0.0010744809,0.0015800617,0.0003619197],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00256658,0.0011938319,0.001395113,0.0016717702,0.0006017671,0.0018091317,0.002350767,0.0015659753,0.8481684],"category_scores_gemma":[0.040823605,0.0007917318,0.0011860387,0.002548275,0.0002579415,0.0013600612,0.0010100775,0.001213637,0.18887712],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003577633,0.000099382814,0.002488698,0.0030548472,0.000103740014,0.00007963077,0.000052978594,0.0013651039,0.00010732796,0.0012326689,0.9729288,0.01812899],"study_design_scores_gemma":[0.008974745,0.00050487055,0.023688871,0.004231669,0.0006718008,0.000808117,0.00035324812,0.018082527,0.0018333393,0.041027743,0.89960754,0.0002154854],"about_ca_topic_score_codex":0.0051543172,"about_ca_topic_score_gemma":0.010719764,"teacher_disagreement_score":0.8481684,"about_ca_system_score_codex":0.0008379858,"about_ca_system_score_gemma":0.0017665714,"threshold_uncertainty_score":0.2165693},"labels":[],"label_agreement":null},{"id":"W6920817604","doi":"10.6084/m9.figshare.14926918","title":"Additional file 1 of Comparing regression modeling strategies for predicting hometime","year":2021,"lang":"en","type":"article","venue":"Open MIND","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre; University of Calgary","funders":"","keywords":"Calibration; Data set; Set (abstract data type); Regression analysis; Regression; Test set; Linear regression; Statistical model","score_opus":0.3198960684744691,"score_gpt":0.4457362568877681,"score_spread":0.12584018841329897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920817604","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000908405,0.00005495992,0.0029287771,0.00026194393,0.00006115928,0.00029339042,0.99305314,0.0007780915,0.0016601437],"genre_scores_gemma":[0.049729053,0.00045828935,0.0424471,0.0015204033,0.00029455242,0.013422792,0.8678317,0.004563042,0.01973309],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984446,0.00067504775,0.00019776876,0.00030789676,0.00025329404,0.00012130591],"domain_scores_gemma":[0.8710854,0.12030463,0.0017897362,0.0025556707,0.0038119406,0.00045269533],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00505151,0.0015929275,0.0012817554,0.0017695887,0.0006564226,0.0013042309,0.0021266767,0.0014869488,0.8249147],"category_scores_gemma":[0.10468777,0.0007145059,0.001524234,0.0026450898,0.000238622,0.001539276,0.00091829116,0.0015954982,0.111474365],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001042296,0.00024073482,0.003693588,0.0032890341,0.00018404574,0.000065137494,0.00009316689,0.0023591453,0.00007892409,0.0016270654,0.9647839,0.022542983],"study_design_scores_gemma":[0.022372367,0.0016654033,0.051952194,0.006659381,0.0014552556,0.0008653276,0.0011990619,0.036065795,0.001820867,0.040866125,0.834674,0.00040421105],"about_ca_topic_score_codex":0.009118642,"about_ca_topic_score_gemma":0.013768701,"teacher_disagreement_score":0.8249147,"about_ca_system_score_codex":0.0009246392,"about_ca_system_score_gemma":0.001996499,"threshold_uncertainty_score":0.24973786},"labels":[],"label_agreement":null},{"id":"W6920865536","doi":"10.6084/m9.figshare.25909997.v1","title":"Additional file 1 of Metabolome-wide Mendelian randomization for age at menarche and age at natural menopause","year":2024,"lang":"en","type":"dataset","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Menarche; Mendelian randomization; Menopause; Natural (archaeology); Mendelian inheritance; Population","score_opus":0.11167110633416645,"score_gpt":0.3665287887164694,"score_spread":0.25485768238230294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920865536","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00013537769,0.00003993941,0.00040106263,0.000063097,0.00001987487,0.000057314595,0.9988212,0.00014765053,0.0003145171],"genre_scores_gemma":[0.008347618,0.0002227724,0.004966811,0.0007584551,0.0001047804,0.002558888,0.97721624,0.00070206204,0.0051222853],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982199,0.0005486037,0.00023058575,0.0006144187,0.00019878075,0.00018774148],"domain_scores_gemma":[0.97031677,0.023421658,0.0015639638,0.002497239,0.0015521268,0.0006483022],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0038336122,0.0019296538,0.002288586,0.0020956725,0.0011343473,0.002213797,0.00308825,0.002383983,0.66733366],"category_scores_gemma":[0.0452911,0.0010856362,0.002262626,0.0043086265,0.00058264565,0.0014035078,0.0012593745,0.0017012374,0.08965764],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068851875,0.00010349842,0.0047737597,0.0035728794,0.000422457,0.00010799084,0.00006850686,0.0012093068,0.00015700981,0.0018480581,0.97978026,0.0072677317],"study_design_scores_gemma":[0.01628423,0.0005282572,0.031745978,0.0047529596,0.0019279885,0.001206731,0.0002675171,0.004276907,0.0010597564,0.034756787,0.9029225,0.00027046513],"about_ca_topic_score_codex":0.012132359,"about_ca_topic_score_gemma":0.019956734,"teacher_disagreement_score":0.66733366,"about_ca_system_score_codex":0.0013073849,"about_ca_system_score_gemma":0.0029194315,"threshold_uncertainty_score":0.4745081},"labels":[],"label_agreement":null},{"id":"W6920889807","doi":"10.6084/m9.figshare.26695773","title":"Additional file 3 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Regression analysis; Regression; Binary data; Range (aeronautics); Sensitivity (control systems); Relation (database)","score_opus":0.42980216385569436,"score_gpt":0.4626210607415645,"score_spread":0.03281889688587014,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920889807","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022123053,0.00017335996,0.011891461,0.00069997256,0.00015395152,0.0017679445,0.9742512,0.0020464107,0.0068034283],"genre_scores_gemma":[0.1288441,0.0007658131,0.119520634,0.0034509953,0.00045306902,0.039472178,0.65209323,0.0075801406,0.04781989],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99486333,0.0031851486,0.00048603787,0.00048692172,0.00073473074,0.00024387159],"domain_scores_gemma":[0.67477167,0.30695018,0.004240235,0.0074266368,0.00560877,0.0010025098],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.014032989,0.001295079,0.0013244074,0.0020363233,0.00086813734,0.0015802485,0.0025006784,0.0020206163,0.8471173],"category_scores_gemma":[0.19597282,0.00088999735,0.0016272446,0.003291621,0.00049622724,0.00195493,0.0011548954,0.0020576057,0.10284652],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016871304,0.00052457093,0.0040598023,0.0053843535,0.00034599664,0.00013398797,0.00018360188,0.008633553,0.00011554252,0.006192455,0.9442764,0.028462619],"study_design_scores_gemma":[0.045914862,0.0027021351,0.03576577,0.010012151,0.0019815688,0.0018883393,0.0010132282,0.08596758,0.0023647456,0.09537328,0.7165107,0.0005056075],"about_ca_topic_score_codex":0.0049306196,"about_ca_topic_score_gemma":0.008751864,"teacher_disagreement_score":0.98596704,"about_ca_system_score_codex":0.0015572358,"about_ca_system_score_gemma":0.002676139,"threshold_uncertainty_score":0.21806854},"labels":[],"label_agreement":null},{"id":"W6920972916","doi":"10.6084/m9.figshare.26695770.v1","title":"Additional file 2 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Relation (database); Mediation; Binary data; Sensitivity (control systems); Component (thermodynamics)","score_opus":0.42631790204951725,"score_gpt":0.46249822641172494,"score_spread":0.036180324362207694,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6920972916","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011303652,0.000101867634,0.008449243,0.00049245474,0.00010372385,0.0017640025,0.98191607,0.0012496262,0.004792704],"genre_scores_gemma":[0.076910004,0.0007191454,0.10340773,0.0027106132,0.0004190238,0.054345433,0.71464413,0.0066871652,0.040156733],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9941147,0.0034356138,0.0007522575,0.0005473197,0.0009005383,0.00024962524],"domain_scores_gemma":[0.59274024,0.38320512,0.00577733,0.00929902,0.00786426,0.0011140647],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.016600292,0.001368742,0.0013284658,0.002475059,0.000979,0.0016846907,0.0028316611,0.0019335055,0.8807802],"category_scores_gemma":[0.23870751,0.001109687,0.0017571562,0.0035301165,0.00049622485,0.002192975,0.0013399764,0.0019320238,0.11410781],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014140846,0.00035469062,0.0032045525,0.0048308657,0.00023237255,0.000109758104,0.00017143476,0.0027496412,0.000084518244,0.005284497,0.95583135,0.025732202],"study_design_scores_gemma":[0.041051727,0.002078802,0.034988835,0.013556023,0.0019447886,0.0020960078,0.0008581726,0.033088192,0.0021567566,0.081221476,0.78651553,0.00044366284],"about_ca_topic_score_codex":0.0039983424,"about_ca_topic_score_gemma":0.0069920653,"teacher_disagreement_score":0.8807802,"about_ca_system_score_codex":0.0016326002,"about_ca_system_score_gemma":0.0028882967,"threshold_uncertainty_score":0.17005247},"labels":[],"label_agreement":null},{"id":"W6921023794","doi":"10.6084/m9.figshare.14926918.v1","title":"Additional file 1 of Comparing regression modeling strategies for predicting hometime","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre; University of Calgary","funders":"","keywords":"Calibration; Data set; Set (abstract data type); Regression analysis; Regression; Test set; Linear regression; Statistical model","score_opus":0.32268717896311905,"score_gpt":0.407488843836682,"score_spread":0.08480166487356294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921023794","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007879506,0.00006383988,0.0034336927,0.00026490082,0.00006637373,0.00029674728,0.99230087,0.0009025334,0.0018831815],"genre_scores_gemma":[0.046869975,0.0004967688,0.0449821,0.001596877,0.00030217675,0.012240079,0.8669077,0.005571153,0.021033214],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982272,0.0008020271,0.00021078321,0.00035067508,0.00027520693,0.0001341817],"domain_scores_gemma":[0.8630662,0.12804013,0.0017909898,0.00290652,0.003739873,0.0004562592],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0057674414,0.0016477243,0.0013291434,0.0019239563,0.0006743923,0.0013760685,0.0023392988,0.0015531537,0.8443014],"category_scores_gemma":[0.106966816,0.0007942205,0.0017348957,0.0028253696,0.00026864363,0.0016129323,0.0009891748,0.0016665435,0.13026412],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009446999,0.00021186321,0.0033609308,0.0031966285,0.00021051522,0.000063990665,0.000087923334,0.0027447958,0.00007456564,0.0019113305,0.96507835,0.022114417],"study_design_scores_gemma":[0.020409806,0.0014384115,0.044385124,0.006595543,0.0014359875,0.0008244709,0.0009503109,0.03585712,0.0016310152,0.04546052,0.840632,0.00037970534],"about_ca_topic_score_codex":0.008029104,"about_ca_topic_score_gemma":0.012280259,"teacher_disagreement_score":0.8443014,"about_ca_system_score_codex":0.0009362279,"about_ca_system_score_gemma":0.0019459903,"threshold_uncertainty_score":0.22208518},"labels":[],"label_agreement":null},{"id":"W6921090521","doi":"10.6084/m9.figshare.26729170.v1","title":"Additional file 18 of The IMPACT Survey: the economic impact of osteogenesis imperfecta in adults","year":2024,"lang":"en","type":"dataset","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Pairwise comparison; Population; Osteogenesis imperfecta; Table (database); Consumables; Economic impact analysis","score_opus":0.11969234191489812,"score_gpt":0.40438553586444725,"score_spread":0.2846931939495491,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921090521","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00009338679,0.00001624583,0.00003707754,0.00004361164,0.0000067650585,0.000015951871,0.9994493,0.000029597155,0.0003079906],"genre_scores_gemma":[0.003313157,0.000090008994,0.0006289087,0.00017162757,0.000027156226,0.0005768043,0.99319917,0.00008852796,0.0019045703],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9990816,0.00022009526,0.00020358627,0.0002184837,0.0001721968,0.000104024446],"domain_scores_gemma":[0.9899624,0.006071001,0.0012483684,0.0008297425,0.0015307646,0.0003577688],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0016306924,0.0008384914,0.0010540471,0.0019350529,0.0004483579,0.0014424346,0.0015213419,0.0012388881,0.4035235],"category_scores_gemma":[0.023972454,0.00068242225,0.0009012204,0.0043565724,0.00021523303,0.0010063417,0.0010939447,0.0011060939,0.067836575],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008359966,0.00003085907,0.004254027,0.0010834082,0.000060906477,0.000020743048,0.00002772216,0.00028822542,0.00001933404,0.0005317523,0.9909377,0.002661589],"study_design_scores_gemma":[0.0025220632,0.00011011811,0.07139824,0.002994627,0.00027205906,0.00021918092,0.00032104074,0.001078999,0.0002127026,0.0056177215,0.91516995,0.0000832382],"about_ca_topic_score_codex":0.021481775,"about_ca_topic_score_gemma":0.029997721,"teacher_disagreement_score":0.4035235,"about_ca_system_score_codex":0.0011893661,"about_ca_system_score_gemma":0.0016744385,"threshold_uncertainty_score":0.85080135},"labels":[],"label_agreement":null},{"id":"W6921117573","doi":"10.6084/m9.figshare.16755940","title":"Additional file 1 of Online clinical pathway for chronic kidney disease management in primary care: a retrospective cohort study","year":2021,"lang":"en","type":"article","venue":"Open MIND","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto; University of Alberta; University of Calgary","funders":"","keywords":"Cohort; Diabetes mellitus; Albuminuria; Statin; Retrospective cohort study; Cohort study","score_opus":0.10847890803775403,"score_gpt":0.43066372938390596,"score_spread":0.3221848213461519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921117573","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012202947,0.000034832687,0.00031394177,0.0001241025,0.000015757383,0.0004912264,0.9962907,0.00006764597,0.0014415348],"genre_scores_gemma":[0.05539906,0.00046594682,0.00582174,0.0013238856,0.00023012495,0.021732407,0.9006111,0.000372894,0.014042741],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.99876225,0.00025782094,0.00029674382,0.0003000946,0.00020910418,0.00017408107],"domain_scores_gemma":[0.9885528,0.006318714,0.0019083775,0.0008715568,0.001878823,0.00046980567],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0013590145,0.0007558971,0.0011013147,0.0020110358,0.001040829,0.0010688641,0.0011101242,0.00089019793,0.56613505],"category_scores_gemma":[0.02044248,0.00046983335,0.0006113493,0.0057730847,0.00019090816,0.0011192764,0.00086775154,0.0009498065,0.051048946],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003584507,0.00016204723,0.017962081,0.0018898774,0.00006478141,0.00010376226,0.00013430652,0.0003276711,0.000056181012,0.00077840924,0.9712748,0.006887628],"study_design_scores_gemma":[0.011777095,0.001291705,0.36322883,0.011292721,0.0005977633,0.0022052983,0.002128623,0.0065679136,0.00082309573,0.01137481,0.5884014,0.0003108255],"about_ca_topic_score_codex":0.01357051,"about_ca_topic_score_gemma":0.012970845,"teacher_disagreement_score":0.56613505,"about_ca_system_score_codex":0.0012922555,"about_ca_system_score_gemma":0.0023014292,"threshold_uncertainty_score":0.6188557},"labels":[],"label_agreement":null},{"id":"W6921337578","doi":"10.7507/1007-4848.202407072","title":"Causal inference in observational studies based on real-world data:Key points and case studies for target trial emulation","year":2024,"lang":"en","type":"article","venue":"University of Groningen research database (University of Groningen / Centre for Information Technology)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Observational study; Emulation; Causal inference; Randomized controlled trial; Psychological intervention; Standardization; Inference; Outcome (game theory)","score_opus":0.4339196817246158,"score_gpt":0.4784768401883782,"score_spread":0.0445571584637624,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6921337578","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008383323,0.004867604,0.9834238,0.0075960597,0.00023612758,0.0010289325,0.00011588843,0.0001232255,0.0017700285],"genre_scores_gemma":[0.046033017,0.005608475,0.937172,0.0021456508,0.0006289858,0.0075900024,0.00017559675,0.00012364051,0.0005225258],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.44232213,0.51618004,0.016376294,0.007659964,0.01635862,0.0011029205],"domain_scores_gemma":[0.17502755,0.7880477,0.012322407,0.019208735,0.0047255736,0.00066812034],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.45862305,0.0029934023,0.008037444,0.007861808,0.0023179098,0.011297034,0.007305388,0.010703342,0.007168851],"category_scores_gemma":[0.6335777,0.0027878697,0.008699077,0.008944069,0.016702816,0.019340152,0.011013593,0.017455319,0.0011293752],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028367213,0.00008117528,0.0010029504,0.0043443167,0.00077083794,0.0003842559,0.0011431654,0.008739901,0.00013790771,0.92115605,0.002633126,0.059322678],"study_design_scores_gemma":[0.00035842528,0.00012726798,0.0002353147,0.0029524944,0.00029444482,0.00033197636,0.0001608272,0.03360414,0.0004242677,0.95189434,0.009559443,0.000056974895],"about_ca_topic_score_codex":0.0015787407,"about_ca_topic_score_gemma":0.00091963157,"teacher_disagreement_score":0.54137695,"about_ca_system_score_codex":0.005489277,"about_ca_system_score_gemma":0.009056013,"threshold_uncertainty_score":0.6676142},"labels":[],"label_agreement":null},{"id":"W6924496159","doi":"10.15468/dl.qmtg9m","title":"Occurrence Download","year":2024,"lang":"en","type":"dataset","venue":"Global Biodiversity Information Facility","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Ornithology; Biodiversity; National Museum of Natural History; Extant taxon; Natural history; Vertebrate; National museum; Conservation biology","score_opus":0.06659044662203663,"score_gpt":0.3279915673806469,"score_spread":0.2614011207586103,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6924496159","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000059405083,0.0000362471,0.00012208804,0.00004520615,0.000026117817,0.000013186829,0.99600726,0.00192671,0.0017639105],"genre_scores_gemma":[0.00020411435,0.00004748112,0.0005870935,0.00006823217,0.000008008642,0.000060128783,0.9973627,0.00047660206,0.0011855793],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99869365,0.00013371465,0.00018231539,0.0004653336,0.00031058057,0.00021443971],"domain_scores_gemma":[0.9973404,0.00060261425,0.00018394204,0.0007616017,0.0007454258,0.00036597296],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.000933682,0.0028071455,0.0022332103,0.0065751355,0.0012161232,0.0037410639,0.0029411232,0.002066412,0.34247708],"category_scores_gemma":[0.005679317,0.0011856942,0.0019910983,0.010925434,0.00036808223,0.0037538868,0.003811576,0.0022946892,0.40796572],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005269209,0.000019062783,0.00028604554,0.0004865829,0.000014803596,0.000017032646,0.000020058855,0.00010698795,0.000107233114,0.00038015592,0.99497485,0.00353444],"study_design_scores_gemma":[0.00010577733,0.00001595443,0.0017237188,0.00014131062,0.000016562777,0.000044979894,0.00007466557,0.00036241507,0.00024493787,0.0012512798,0.9959927,0.000025669498],"about_ca_topic_score_codex":0.018879749,"about_ca_topic_score_gemma":0.032660183,"teacher_disagreement_score":0.6575229,"about_ca_system_score_codex":0.0016410414,"about_ca_system_score_gemma":0.0022983109,"threshold_uncertainty_score":0.93787664},"labels":[],"label_agreement":null},{"id":"W6926538345","doi":"10.25549/impa-m68313","title":"Missionary fathers building a wooden house, Canada, ca.1920-1940","year":2012,"lang":"fr","type":"dataset","venue":"University of Southern California Digital Library","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Period (music)","score_opus":0.025814856357586784,"score_gpt":0.22876133221277684,"score_spread":0.20294647585519004,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6926538345","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021318607,0.0002503861,0.00006159914,0.00016810591,0.000024747524,0.000009947913,0.99291915,0.0001052583,0.0043289596],"genre_scores_gemma":[0.010173924,0.0004191508,0.0002536529,0.00006338952,0.000014163646,0.000036413,0.97619915,0.00003845473,0.012801715],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9994062,0.000024581212,0.00003395502,0.00014169015,0.00021977258,0.0001737949],"domain_scores_gemma":[0.99820554,0.00015620493,0.00016833996,0.00015610798,0.00094275887,0.00037101802],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00040116464,0.0012455306,0.000719678,0.0034918962,0.0026060592,0.002514477,0.0017899222,0.0006977927,0.02984403],"category_scores_gemma":[0.0027706798,0.00046046695,0.000517433,0.010888304,0.00056464836,0.00066779036,0.0009305373,0.0014612254,0.01401665],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000082232196,0.000024167623,0.010803272,0.00019283468,0.000029938894,0.0000802257,0.0002051777,0.00035756797,0.000060578157,0.0012387141,0.98067915,0.006246107],"study_design_scores_gemma":[0.00009172889,0.000012336864,0.12016152,0.0002593945,0.000030357263,0.000080754304,0.0013510035,0.0005112121,0.00033375178,0.0004963101,0.8766359,0.000035715537],"about_ca_topic_score_codex":0.9751042,"about_ca_topic_score_gemma":0.9934669,"teacher_disagreement_score":0.02984403,"about_ca_system_score_codex":0.01467551,"about_ca_system_score_gemma":0.023495905,"threshold_uncertainty_score":0.10647881},"labels":[],"label_agreement":null},{"id":"W6927175633","doi":"10.3205/18ebm045","title":"Absolute Effekte auf der Basis von gepoolten Hazard ratios: eine Analyse von mehr als 500 systematischen Übersichtsarbeiten im Krebsbereich","year":2018,"lang":"de","type":"article","venue":"German Medical Science (German Research Foundation)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Cochrane","funders":"","keywords":"Hazard; Intervention (counseling); Hazard ratio","score_opus":0.1471346095077936,"score_gpt":0.49791964773762404,"score_spread":0.3507850382298304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6927175633","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5208477,0.25285783,0.15059993,0.0020899882,0.00065398955,0.012708145,0.050898917,0.0008922353,0.008451394],"genre_scores_gemma":[0.9106991,0.016926544,0.05316534,0.0003783482,0.00014905047,0.00833262,0.007915094,0.00020631024,0.0022275238],"study_design_codex":"design_other","study_design_gemma":"meta_analysis","domain_scores_codex":[0.94094557,0.04327583,0.007053484,0.003373023,0.004962294,0.00038983105],"domain_scores_gemma":[0.7536742,0.22631077,0.010497552,0.0067867287,0.0024169688,0.0003136485],"candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":[],"category_scores_codex":[0.057345632,0.001463588,0.003668469,0.0046407906,0.000407796,0.0025177689,0.0013481902,0.0011278501,0.01601013],"category_scores_gemma":[0.19583213,0.0010520312,0.0114592,0.0055408105,0.0010948501,0.002770909,0.0027468447,0.001692011,0.0009424255],"study_design_candidate":"meta_analysis","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.05996919,0.0007536412,0.09182095,0.10698089,0.1770535,0.00018736359,0.0028822706,0.010861189,0.003229009,0.008270079,0.006502939,0.53148896],"study_design_scores_gemma":[0.023086356,0.025143465,0.4582937,0.019005155,0.34286585,0.0011802843,0.0024612145,0.021323979,0.020052915,0.04503738,0.04074031,0.0008093797],"about_ca_topic_score_codex":0.0016158165,"about_ca_topic_score_gemma":0.0013162105,"teacher_disagreement_score":0.9963315,"about_ca_system_score_codex":0.0010625958,"about_ca_system_score_gemma":0.0016200591,"threshold_uncertainty_score":0.3032763},"labels":[],"label_agreement":null},{"id":"W6930612293","doi":"10.5281/zenodo.15217976","title":"FIGURE 40 in Revision of the western Nearctic species of Empis subgenus Enoplempis (Diptera: Empididae)","year":2025,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Food Inspection Agency","funders":"","keywords":"Subgenus; Nearctic ecozone; Taxonomy (biology); Holotype; Taxonomic key; Biogeography","score_opus":0.0900788398588798,"score_gpt":0.3378470182240885,"score_spread":0.24776817836520873,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930612293","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0073368046,0.007514762,0.023084102,0.0061470135,0.048758216,0.0009133806,0.04895379,0.0048029087,0.85248893],"genre_scores_gemma":[0.033778917,0.007792053,0.052680578,0.0024508052,0.004584404,0.00092154974,0.056652546,0.0027666898,0.83837247],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99944514,0.00007838556,0.00007659503,0.000112129856,0.00024179638,0.000045936486],"domain_scores_gemma":[0.99829775,0.00014697062,0.00012856627,0.00021253816,0.0011055248,0.00010864626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008692788,0.0008376837,0.0005078592,0.003971721,0.001680193,0.0011903368,0.0011774455,0.000833349,0.14928058],"category_scores_gemma":[0.0025983565,0.00037143254,0.0006323596,0.0020411722,0.0009777755,0.0021070433,0.0009528039,0.0019514619,0.07431701],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010392266,0.000022154705,0.0010297635,0.000658282,0.000013041119,0.00022424657,0.00037462503,0.00029540254,0.0017599101,0.00758266,0.86403674,0.123899214],"study_design_scores_gemma":[0.0000029359085,0.0000066895154,0.0016077207,0.000084486135,0.0000063044295,0.00013688588,0.00007105014,0.00005229046,0.00016880389,0.0003679283,0.99749064,0.000004327206],"about_ca_topic_score_codex":0.022322252,"about_ca_topic_score_gemma":0.050815456,"teacher_disagreement_score":0.14928058,"about_ca_system_score_codex":0.0010245509,"about_ca_system_score_gemma":0.0017472028,"threshold_uncertainty_score":0.49939328},"labels":[],"label_agreement":null},{"id":"W6930681723","doi":"10.5281/zenodo.14071670","title":"Smart Hemp Oil Official Website, Reviews [2025] &amp; Price For Sale In New Zealand (AU, NZ)","year":2024,"lang":"en","type":"other","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Product (mathematics); Order (exchange); Work (physics); Context (archaeology); Filter (signal processing); Natural (archaeology)","score_opus":0.1674605311708088,"score_gpt":0.3767397588006975,"score_spread":0.20927922762988868,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930681723","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005486678,0.005059076,0.0008464827,0.0018209417,0.0023157368,0.00028892007,0.004100612,0.0021711874,0.9828484],"genre_scores_gemma":[0.0012547618,0.0026389842,0.00047853685,0.0004412023,0.0002088077,0.000048840673,0.0013279064,0.0005503489,0.9930506],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99951625,0.000019457275,0.000018498042,0.00005375083,0.00034742872,0.000044592292],"domain_scores_gemma":[0.99897623,0.00009497885,0.000052862186,0.00005766415,0.0005686696,0.00024958342],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.00057648454,0.0008922028,0.0005789227,0.001365623,0.0009599755,0.0032252793,0.00072249275,0.0014489464,0.73534745],"category_scores_gemma":[0.0022770576,0.00045670517,0.0005709629,0.0010123961,0.00048996194,0.0028368023,0.0011106886,0.0015268618,0.5718732],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000034072054,0.000026296471,0.00003422146,0.0003086165,0.000002628969,0.000037682654,0.000032706645,0.000025508472,0.0011241646,0.0011791709,0.9026532,0.094541766],"study_design_scores_gemma":[0.0000075837306,0.00001478151,0.00015479627,0.00006137151,0.0000019217475,0.000022361939,0.000020854119,0.000015761267,0.00018271354,0.00013336755,0.99938107,0.0000034368513],"about_ca_topic_score_codex":0.021704778,"about_ca_topic_score_gemma":0.05620218,"teacher_disagreement_score":0.26465255,"about_ca_system_score_codex":0.0011718208,"about_ca_system_score_gemma":0.0024570895,"threshold_uncertainty_score":0.3774947},"labels":[],"label_agreement":null},{"id":"W6930901235","doi":"10.5281/zenodo.3867155","title":"Thalassisobates littoralis","year":2017,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Research (Canada)","funders":"","keywords":"Mediterranean climate; Habitat; Biological dispersal; Intertidal zone; Mediterranean sea; Mediterranean Islands","score_opus":0.2360289313917183,"score_gpt":0.3930810454266384,"score_spread":0.15705211403492012,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6930901235","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6278848,0.021624522,0.01224129,0.0008889084,0.00061301904,0.00046943605,0.018344866,0.0014147664,0.31651843],"genre_scores_gemma":[0.94431907,0.0037113838,0.005706383,0.0003085408,0.00013238093,0.00020117151,0.008162892,0.000059502716,0.037398633],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9998975,0.000008885534,0.000010111556,0.00004285381,0.000022570057,0.00001809621],"domain_scores_gemma":[0.99985313,0.000016775704,0.000061888975,0.000011279594,0.000027306058,0.000029670198],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00011621906,0.0006185554,0.00024786658,0.0014734041,0.0005520907,0.000379878,0.0002814885,0.00024981418,0.021971676],"category_scores_gemma":[0.0003571592,0.00020539254,0.00023930325,0.0010496186,0.0003834643,0.00043142276,0.0005978468,0.00029637362,0.0059659276],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033569444,0.00006871905,0.1735136,0.0012197488,0.00014932166,0.00052545086,0.0013883364,0.0011856727,0.037399177,0.0041497136,0.020191895,0.75987273],"study_design_scores_gemma":[0.00003686269,0.00016258705,0.8426328,0.00017396512,0.00006571773,0.0010147059,0.0006132964,0.00047932268,0.0015549485,0.0017390166,0.15150608,0.000020705584],"about_ca_topic_score_codex":0.0069403406,"about_ca_topic_score_gemma":0.015290414,"teacher_disagreement_score":0.021971676,"about_ca_system_score_codex":0.00060494686,"about_ca_system_score_gemma":0.00024391028,"threshold_uncertainty_score":0.07350254},"labels":[],"label_agreement":null},{"id":"W6931685926","doi":"10.5281/zenodo.7003346","title":"Copelatus alternatus Sharp 1882","year":2022,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Laurentian University","funders":"","keywords":"Instar; Larva; Head (geology); Dorsum; Constriction; Table (database)","score_opus":0.1539937030446855,"score_gpt":0.3554595231368441,"score_spread":0.2014658200921586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931685926","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.89958465,0.0028641173,0.0016242112,0.00014586137,0.00026242278,0.0002804915,0.004754662,0.0001447144,0.0903389],"genre_scores_gemma":[0.98660177,0.0010583508,0.0019258219,0.00014584586,0.000077429206,0.0000866841,0.0028326858,0.000009458598,0.0072620832],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9999224,0.000004836735,0.000010296879,0.00002649227,0.000027527063,0.00000847146],"domain_scores_gemma":[0.99989235,0.000012405368,0.00005174743,0.0000073682263,0.000020978174,0.000015152249],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000068366,0.00042521727,0.00018200788,0.0013106944,0.00043759047,0.00019051829,0.00024563514,0.00020203656,0.006992698],"category_scores_gemma":[0.00018291046,0.00013963688,0.00012979782,0.0007652354,0.0001883555,0.00033417568,0.00035346235,0.00023752022,0.0019913286],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011892417,0.00025087217,0.2744587,0.0012011603,0.00015671777,0.0038838417,0.0012270245,0.0007636026,0.12934664,0.0012536435,0.012263013,0.5740056],"study_design_scores_gemma":[0.000098272096,0.0007315303,0.88934416,0.00019454423,0.00008728648,0.007513895,0.0009571754,0.0005747504,0.006123948,0.00031720684,0.09403131,0.000026107718],"about_ca_topic_score_codex":0.0018809224,"about_ca_topic_score_gemma":0.005013254,"teacher_disagreement_score":0.006992698,"about_ca_system_score_codex":0.00021378763,"about_ca_system_score_gemma":0.00012586472,"threshold_uncertainty_score":0.023392916},"labels":[],"label_agreement":null},{"id":"W6931737912","doi":"10.5683/sp3/c11qwv","title":"Supplementary Information for Estimating Ancient Nuu-chah-nulth Fisheries Biomass at Shell Midden Sites on the Northwest Coast","year":2024,"lang":"en","type":"dataset","venue":"Borealis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Midden; Biomass (ecology); Fish <Actinopterygii>; Shell (structure); Fishing","score_opus":0.08837056643535036,"score_gpt":0.3561518207869787,"score_spread":0.26778125435162836,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931737912","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00010191694,0.000014802837,0.0000699511,0.000027151516,0.000009894048,0.000006514021,0.99914646,0.00007335672,0.0005498949],"genre_scores_gemma":[0.00077824993,0.000024480454,0.0006042669,0.00004806837,0.0000063139173,0.000086948894,0.9972422,0.000063145526,0.0011463008],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99925524,0.00012829808,0.00010489775,0.00021460818,0.00020490734,0.000091964255],"domain_scores_gemma":[0.9958406,0.001489545,0.00043351,0.0006011649,0.0013998145,0.00023520175],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012525271,0.0009866764,0.0007962275,0.0019025403,0.0005527496,0.0015791969,0.0016836983,0.0010181962,0.16780694],"category_scores_gemma":[0.007670018,0.0005725512,0.0007639796,0.0038891197,0.00022713278,0.00088195526,0.0011010257,0.0010997589,0.076141715],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000028188695,0.00002166643,0.002750824,0.00026578072,0.000024189467,0.00001284791,0.000017153832,0.0004019788,0.000046587258,0.0004972064,0.9938579,0.0020757515],"study_design_scores_gemma":[0.00034355963,0.000020943646,0.019721907,0.00034834747,0.000046175282,0.00005421872,0.00014656769,0.000921702,0.0002634658,0.0022827187,0.9758153,0.00003500984],"about_ca_topic_score_codex":0.055740714,"about_ca_topic_score_gemma":0.13299583,"teacher_disagreement_score":0.9442593,"about_ca_system_score_codex":0.0015783244,"about_ca_system_score_gemma":0.0021577247,"threshold_uncertainty_score":0.56137013},"labels":[],"label_agreement":null},{"id":"W6931892806","doi":"10.5683/sp3/bb2kda","title":"Can a social partner alleviate conditioned place aversion caused by isolation and pain in dairy calves?","year":2023,"lang":"en","type":"dataset","venue":"Borealis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Social isolation; Conditioning; Isolation (microbiology); Social stress; Stressor; Social behaviour; Animal welfare; Social relation","score_opus":0.07699492643641458,"score_gpt":0.3729293038414213,"score_spread":0.2959343774050067,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6931892806","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03239769,0.0019689212,0.0012309443,0.0012581648,0.00018023976,0.00007884702,0.96112305,0.00046103945,0.0013010188],"genre_scores_gemma":[0.07102188,0.00077879213,0.004711994,0.0006102954,0.000055034438,0.0006196269,0.92050993,0.0001372508,0.001555245],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.99892056,0.00041742844,0.00011058664,0.00033215454,0.00009998887,0.000119228556],"domain_scores_gemma":[0.9973328,0.0017445396,0.0003754845,0.00028198783,0.0001655694,0.00009955015],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023878135,0.00091198954,0.0011687251,0.0010402869,0.00054903945,0.001374845,0.0020818382,0.0017450018,0.011693517],"category_scores_gemma":[0.010914005,0.00032629733,0.0016078164,0.0014056365,0.00043331127,0.00071433565,0.0010402288,0.0010949539,0.003718653],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0038103901,0.00072494574,0.14300862,0.015592702,0.0026285786,0.0005060739,0.0006402659,0.007894825,0.0038097303,0.003580952,0.7637821,0.054020833],"study_design_scores_gemma":[0.004302444,0.0006573457,0.2952804,0.0020285442,0.0027372043,0.00069088326,0.001126884,0.017986197,0.0027727108,0.0073377695,0.66482717,0.0002523097],"about_ca_topic_score_codex":0.015246467,"about_ca_topic_score_gemma":0.033188075,"teacher_disagreement_score":0.015246467,"about_ca_system_score_codex":0.00077721116,"about_ca_system_score_gemma":0.00096958154,"threshold_uncertainty_score":0.039118707},"labels":[],"label_agreement":null},{"id":"W6932086906","doi":"10.5683/sp3/jcoxpx","title":"Indicateurs de performance financière des entreprises canadiennes, 2000-2002","year":2025,"lang":"fr","type":"dataset","venue":"Borealis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Statistical analysis; Work force","score_opus":0.04708391483540487,"score_gpt":0.3194062403264786,"score_spread":0.2723223254910737,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6932086906","genre_codex":"empirical","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8351599,0.003301225,0.00049619115,0.0008141275,0.00006414668,0.00005220373,0.124316506,0.00030621066,0.03548952],"genre_scores_gemma":[0.84239084,0.0019413254,0.00068655604,0.00013150208,0.00008077161,0.00008011538,0.12218067,0.00004197135,0.03246629],"study_design_codex":"observational","study_design_gemma":"not_applicable","domain_scores_codex":[0.9989944,0.0000869984,0.00009330691,0.0001892575,0.00048729734,0.00014862132],"domain_scores_gemma":[0.99103326,0.001128451,0.0029646915,0.00028058593,0.0038667219,0.00072624034],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0011844351,0.00044217188,0.00031256932,0.006219111,0.0003816927,0.0019027818,0.0005372324,0.0004403575,0.004617867],"category_scores_gemma":[0.0049696364,0.00018751132,0.00033976324,0.009526593,0.00019974036,0.0007568399,0.00063097395,0.00046148596,0.0012915572],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003832388,0.00005773043,0.9365806,0.00017467365,0.00023276928,0.00012789834,0.0007730209,0.0017260275,0.00050463877,0.0017949943,0.030352646,0.027291628],"study_design_scores_gemma":[0.000007781525,0.000025177997,0.9850745,0.000028545295,0.00002810864,0.00004907491,0.0003766043,0.00055462006,0.00024299878,0.000046400757,0.013555317,0.000010803495],"about_ca_topic_score_codex":0.30640543,"about_ca_topic_score_gemma":0.32232577,"teacher_disagreement_score":0.6935946,"about_ca_system_score_codex":0.0033015371,"about_ca_system_score_gemma":0.0023891146,"threshold_uncertainty_score":0.60924387},"labels":[],"label_agreement":null},{"id":"W6939467240","doi":"10.6084/m9.figshare.26695776.v1","title":"Additional file 4 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Mediation; Binary data; Empirical research; Binary relation; Relation (database)","score_opus":0.4314493148368384,"score_gpt":0.46305523481070243,"score_spread":0.03160591997386403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939467240","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014314074,0.00014698961,0.009088194,0.000530341,0.00011987369,0.0014808873,0.98101556,0.0017969056,0.0043898523],"genre_scores_gemma":[0.08638009,0.0008512976,0.10873612,0.002415543,0.000430758,0.04495668,0.70501935,0.0080888765,0.04312123],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9950352,0.0027612052,0.00065994926,0.0004948831,0.00081328873,0.00023556217],"domain_scores_gemma":[0.64120156,0.33694193,0.005053356,0.007559372,0.008248024,0.0009957866],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.012942536,0.0012778918,0.0012881579,0.0024155087,0.0008734555,0.0015948307,0.0024065191,0.001701491,0.8845806],"category_scores_gemma":[0.22163574,0.0009251874,0.0015985507,0.0036018742,0.00044626306,0.001983805,0.0011604837,0.0017030361,0.120169155],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015120298,0.00037942,0.0032014954,0.0061869603,0.000246299,0.0001056764,0.00015980538,0.0024640672,0.00011290734,0.003984599,0.94832224,0.03332444],"study_design_scores_gemma":[0.038545582,0.0021031993,0.04181141,0.013216172,0.0020878532,0.0017381829,0.001018667,0.029742401,0.00255983,0.07096875,0.795739,0.00046894964],"about_ca_topic_score_codex":0.0036924144,"about_ca_topic_score_gemma":0.006846724,"teacher_disagreement_score":0.98705745,"about_ca_system_score_codex":0.0014112003,"about_ca_system_score_gemma":0.0025015075,"threshold_uncertainty_score":0.16463166},"labels":[],"label_agreement":null},{"id":"W6939649051","doi":"10.6084/m9.figshare.27932635.v1","title":"Additional file 1 of Investigation of treatment delay in a complex healthcare process using physician insurance claims data: an application to symptomatic carotid artery stenosis","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Stenosis; Process (computing); Health care; Carotid arteries; MEDLINE","score_opus":0.28656438753837693,"score_gpt":0.4250100997574115,"score_spread":0.13844571221903457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939649051","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006628858,0.000027830472,0.00150654,0.00033648903,0.000024943814,0.00013865031,0.99453706,0.00037224795,0.0023934315],"genre_scores_gemma":[0.0805635,0.00037180222,0.026074981,0.0010676217,0.00025216676,0.0042876326,0.8672436,0.0011021805,0.0190366],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9987361,0.00047605054,0.00019584458,0.0002344411,0.0002691885,0.00008842902],"domain_scores_gemma":[0.9123169,0.07899481,0.00283059,0.002281153,0.0031282837,0.00044821622],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0031949605,0.00057622854,0.0005932661,0.001962035,0.00050028675,0.0011337093,0.0012116433,0.0013817647,0.7056883],"category_scores_gemma":[0.06889644,0.00042566663,0.0010325403,0.0030599283,0.00017243323,0.0010474429,0.00075616216,0.0008156582,0.05368226],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004159885,0.00015855928,0.010556274,0.0016450163,0.00011963673,0.00013512578,0.00009075151,0.0027895914,0.00006172701,0.00354013,0.95750946,0.02297777],"study_design_scores_gemma":[0.009559789,0.00066331186,0.10006907,0.0051760175,0.00069979264,0.0012258411,0.0009412588,0.051736016,0.0015475246,0.06229155,0.7658389,0.00025095398],"about_ca_topic_score_codex":0.011539316,"about_ca_topic_score_gemma":0.018476255,"teacher_disagreement_score":0.7056883,"about_ca_system_score_codex":0.0009669076,"about_ca_system_score_gemma":0.0019416404,"threshold_uncertainty_score":0.41979992},"labels":[],"label_agreement":null},{"id":"W6939668081","doi":"10.6084/m9.figshare.14381684","title":"Confounding adjustment methods for multi-level treatment comparisons under lack of positivity and unknown model specification","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Centre hospitalier universitaire de Québec","funders":"","keywords":"Covariate; Estimator; Context (archaeology); Observational study; Specification; Matching (statistics); Confounding; Variance (accounting); Propensity score matching","score_opus":0.8348849125377892,"score_gpt":0.5963865798411815,"score_spread":0.2384983326966077,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939668081","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0044736587,0.00025397228,0.9939148,0.0002679235,0.00007471644,0.0003179262,0.000086416316,0.00021597702,0.00039467684],"genre_scores_gemma":[0.17788386,0.00029651882,0.8178732,0.00044234842,0.00015528793,0.0019441097,0.00028562723,0.00015893501,0.0009601173],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9213755,0.06632192,0.0026419985,0.004639983,0.004269041,0.00075153826],"domain_scores_gemma":[0.78220564,0.17699535,0.012297045,0.023237549,0.0045339344,0.0007305204],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.090180725,0.0012904493,0.0022172546,0.0021848714,0.0012505905,0.0017169873,0.0038651368,0.002342857,0.008902999],"category_scores_gemma":[0.29694045,0.0008560784,0.0040995204,0.0025627704,0.002777094,0.003345116,0.004114085,0.0033855238,0.00064675225],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017904225,0.0003302663,0.021169301,0.0014173524,0.0040283743,0.00038839248,0.001103272,0.072432,0.0020421573,0.33685762,0.0054909037,0.55294997],"study_design_scores_gemma":[0.0011917166,0.0012777902,0.0109119965,0.00041202302,0.0011618091,0.0003851706,0.00024330326,0.36156046,0.004057534,0.602942,0.01570702,0.00014911388],"about_ca_topic_score_codex":0.0019490311,"about_ca_topic_score_gemma":0.0021591657,"teacher_disagreement_score":0.90981925,"about_ca_system_score_codex":0.001250594,"about_ca_system_score_gemma":0.0033678447,"threshold_uncertainty_score":0.47692698},"labels":[],"label_agreement":null},{"id":"W6939732679","doi":"10.6084/m9.figshare.21293449","title":"Additional file 1 of Examining evidence of time-dependent treatment effects: an illustration using regression methods","year":2022,"lang":"en","type":"article","venue":"Open MIND","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"PricewaterhouseCoopers (Canada)","funders":"","keywords":"Regression analysis; Regression; Linear regression; Feature (linguistics)","score_opus":0.47572153659079625,"score_gpt":0.5298866037232873,"score_spread":0.054165067132491085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6939732679","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000379173,0.000059353995,0.0029163437,0.00032278532,0.00006765109,0.00051575486,0.99235207,0.0005028978,0.0028839966],"genre_scores_gemma":[0.0555517,0.0008596592,0.08132088,0.0033101279,0.00058219227,0.028718341,0.7748516,0.0059899017,0.048815485],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9966529,0.0013766504,0.00051583047,0.00061822165,0.0006041411,0.0002321857],"domain_scores_gemma":[0.721586,0.25882655,0.0047332416,0.0059745684,0.007867898,0.0010117568],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0072551593,0.0012875937,0.0014837182,0.0031208522,0.0010291586,0.0018941783,0.0025178252,0.0017674371,0.92041624],"category_scores_gemma":[0.17482989,0.00091969734,0.0018009869,0.004907885,0.00046405842,0.0023664222,0.0013440152,0.0015426779,0.11634257],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006284735,0.00018152467,0.0027857574,0.0066665104,0.00016535466,0.00012290436,0.00014072521,0.0010666777,0.00008255328,0.0038670993,0.96322954,0.021062795],"study_design_scores_gemma":[0.0156088285,0.0009073169,0.027647516,0.011507677,0.0013173708,0.0015582023,0.00092901674,0.010387515,0.0013145356,0.082683615,0.8458185,0.0003199186],"about_ca_topic_score_codex":0.008201039,"about_ca_topic_score_gemma":0.013075159,"teacher_disagreement_score":0.92041624,"about_ca_system_score_codex":0.0014162604,"about_ca_system_score_gemma":0.003686,"threshold_uncertainty_score":0.11351651},"labels":[],"label_agreement":null},{"id":"W6940043713","doi":"10.6084/m9.figshare.26695767.v1","title":"Additional file 1 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Binary number; Variance (accounting); Outcome (game theory); Estimator; Binary data; Confidence interval; Mediation; Relation (database); Range (aeronautics)","score_opus":0.43388011366608537,"score_gpt":0.4631154158349202,"score_spread":0.029235302168834854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6940043713","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011829744,0.00012954888,0.008498924,0.00047558435,0.000097804295,0.0017896184,0.9826148,0.0010926445,0.0041181133],"genre_scores_gemma":[0.0745959,0.0009894524,0.12369332,0.002731925,0.00044876544,0.07036708,0.6795811,0.007060778,0.04053162],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99307007,0.004071122,0.00089672377,0.0006446601,0.0010498341,0.0002676062],"domain_scores_gemma":[0.50385207,0.4698333,0.006348516,0.009543509,0.00927392,0.0011487172],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.018150171,0.0012493256,0.0013788437,0.002879925,0.0010352185,0.0017599234,0.0027860682,0.0017513186,0.8834207],"category_scores_gemma":[0.29267487,0.001113575,0.0015259781,0.004673947,0.00051672495,0.0025106703,0.001401888,0.00198706,0.12256816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001106905,0.00028296682,0.0027489965,0.0047792797,0.0001749577,0.000077676035,0.00018201087,0.0013224639,0.00006331933,0.0044039413,0.9562878,0.02856976],"study_design_scores_gemma":[0.03413462,0.0020267034,0.044345006,0.015268611,0.0018387483,0.0019080194,0.001099222,0.021426698,0.0017650301,0.071557336,0.8041671,0.00046294],"about_ca_topic_score_codex":0.0037006612,"about_ca_topic_score_gemma":0.0068512815,"teacher_disagreement_score":0.8834207,"about_ca_system_score_codex":0.0017225435,"about_ca_system_score_gemma":0.00304212,"threshold_uncertainty_score":0.16628611},"labels":[],"label_agreement":null},{"id":"W6949721409","doi":"10.5281/zenodo.15318810","title":"La révolution causale à l'ère de l'IA : Vers une approche hybride entre théorie scientifique et découverte automatisée","year":2025,"lang":"fr","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Context (archaeology); Perspective (graphical); Identity (music); Identification (biology)","score_opus":0.04567019172075941,"score_gpt":0.32683687552926055,"score_spread":0.2811666838085011,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6949721409","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00919789,0.0021546455,0.95450443,0.012004429,0.0001990075,0.00013293877,0.00018951851,0.00055396464,0.021063125],"genre_scores_gemma":[0.34139833,0.0044211815,0.6310214,0.0029021942,0.0004234174,0.0009037415,0.00049414614,0.00057259994,0.01786303],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9821546,0.010107824,0.00076621276,0.0033823147,0.0030409885,0.00054815086],"domain_scores_gemma":[0.94164884,0.03944613,0.00196917,0.012409474,0.003697716,0.00082872825],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02041974,0.0017338209,0.0020173187,0.0042620134,0.0024326271,0.011562889,0.00469336,0.004365154,0.012212181],"category_scores_gemma":[0.047303963,0.0017643168,0.0037254996,0.003354542,0.015423872,0.018592149,0.008116374,0.00820095,0.002402853],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007152927,0.000047996014,0.0012265332,0.0003635698,0.00013296,0.00011421409,0.002714549,0.014773286,0.0007544204,0.94053423,0.0012294375,0.03803725],"study_design_scores_gemma":[0.000038982045,0.00006382379,0.0006468522,0.00031790286,0.000088953886,0.00015032609,0.00066625484,0.054218944,0.001110815,0.899581,0.04305846,0.000057746827],"about_ca_topic_score_codex":0.011099919,"about_ca_topic_score_gemma":0.008561293,"teacher_disagreement_score":0.02041974,"about_ca_system_score_codex":0.0065767807,"about_ca_system_score_gemma":0.007405674,"threshold_uncertainty_score":0.10799116},"labels":[],"label_agreement":null},{"id":"W6950129411","doi":"10.5281/zenodo.7877767","title":"Rethinking Residual Confounding Bias Reduction: Why Vanilla hdPS Alone is No Longer Enough","year":2023,"lang":"en","type":"article","venue":"Zenodo (CERN European Organization for Nuclear Research)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Confounding; Leverage (statistics); Estimator; Residual; Variance (accounting); Propensity score matching; Selection bias; Selection (genetic algorithm); Feature selection","score_opus":0.2736396246141182,"score_gpt":0.3759552686465703,"score_spread":0.10231564403245208,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6950129411","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041646313,0.0048807254,0.9353141,0.013309811,0.0003433071,0.00027328965,0.0003961681,0.0006877686,0.0031484906],"genre_scores_gemma":[0.5138173,0.0014590776,0.47690582,0.0047527715,0.00036033528,0.000597241,0.0005960722,0.00033205425,0.00117926],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.946588,0.046727173,0.0011314731,0.0022306326,0.0027407005,0.0005820571],"domain_scores_gemma":[0.8693005,0.11499089,0.0029953104,0.00782189,0.0041618254,0.00072957797],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07832352,0.00091300945,0.0022330743,0.0010848546,0.00094145455,0.0031710018,0.0030159159,0.0022855971,0.0028889258],"category_scores_gemma":[0.20195179,0.0005656492,0.001652085,0.0018047008,0.003114311,0.0046287007,0.0038724483,0.0039333724,0.0005368369],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019642292,0.00027009027,0.0313631,0.0014845979,0.0018726592,0.00025033735,0.0014344824,0.16512099,0.0011226166,0.20066774,0.017337784,0.57711136],"study_design_scores_gemma":[0.0008820772,0.0005277738,0.005618533,0.000971176,0.00039291877,0.00036754148,0.00044835004,0.6239271,0.0023492344,0.34898323,0.015403882,0.00012817238],"about_ca_topic_score_codex":0.0052306848,"about_ca_topic_score_gemma":0.004058863,"teacher_disagreement_score":0.07832352,"about_ca_system_score_codex":0.000945984,"about_ca_system_score_gemma":0.0035966157,"threshold_uncertainty_score":0.41421932},"labels":[],"label_agreement":null},{"id":"W6955111943","doi":"10.58066/01j0-7f44","title":"Interview with Ren Bowrun","year":2019,"lang":"en","type":"other","venue":"UVic’s Research and Learning Repository (University of Victoria)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Oral history; Interview; Data collection; Semi-structured interview; Perspective (graphical)","score_opus":0.09334983425806913,"score_gpt":0.3520457884284062,"score_spread":0.2586959541703371,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6955111943","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033953637,0.023268962,0.0024204045,0.74020356,0.024192857,0.0004964081,0.0030465156,0.0004126319,0.17200504],"genre_scores_gemma":[0.11569211,0.008934849,0.0021024037,0.31539237,0.0027951642,0.0016804439,0.00079917425,0.00059457,0.55200887],"study_design_codex":"not_applicable","study_design_gemma":"qualitative","domain_scores_codex":[0.9976292,0.0014228061,0.000051025145,0.00024596322,0.00035230877,0.00029880233],"domain_scores_gemma":[0.99440587,0.0017645655,0.00021783085,0.00014858713,0.0020138752,0.0014491889],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005533611,0.000679642,0.0008012013,0.0012678698,0.010209776,0.0030350245,0.0007291009,0.003433384,0.045003396],"category_scores_gemma":[0.020042406,0.00058724376,0.00031320797,0.0016204377,0.0024348614,0.004439418,0.00255898,0.0100622615,0.016083945],"study_design_candidate":"qualitative","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000049996597,0.000030303045,0.0006028926,0.00008553674,0.000004030373,0.00045749513,0.022282371,0.000053896485,0.00031428327,0.002512683,0.96603507,0.007571446],"study_design_scores_gemma":[0.0000054651646,0.000017415165,0.00093394035,0.00014034902,0.0000033878393,0.00028847856,0.046295352,0.00002817652,0.00014198039,0.0006338342,0.95148396,0.000027571337],"about_ca_topic_score_codex":0.03951806,"about_ca_topic_score_gemma":0.075962625,"teacher_disagreement_score":0.045003396,"about_ca_system_score_codex":0.004939288,"about_ca_system_score_gemma":0.0049477015,"threshold_uncertainty_score":0.15055132},"labels":[],"label_agreement":null},{"id":"W6958144574","doi":"10.6084/m9.figshare.18071026.v1","title":"Additional file 1 of Reporting of abstracts in studies that used routinely collected data for exploring drug treatment effects: a cross-sectional survey","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St Joseph's Health Centre","funders":"","keywords":"Drug treatment; MEDLINE; Data collection; Data file; Drug","score_opus":0.784504474706073,"score_gpt":0.5016852671014205,"score_spread":0.2828192076046525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958144574","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00021438414,0.0001822803,0.00035226386,0.00018814957,0.00003311312,0.00068703975,0.9969277,0.00019168654,0.0012234669],"genre_scores_gemma":[0.018953852,0.0026067868,0.01405282,0.0017798599,0.00035051614,0.05091664,0.88336724,0.0013634788,0.026608834],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.995312,0.0011262528,0.0020846163,0.0005944177,0.00057007745,0.00031261775],"domain_scores_gemma":[0.83435786,0.14167263,0.011999075,0.0032646726,0.0076510767,0.0010547254],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006841409,0.001721159,0.002992462,0.012756905,0.0010118907,0.002096674,0.0019054491,0.0017015346,0.8427545],"category_scores_gemma":[0.103536054,0.0009705815,0.0020212894,0.013964893,0.00047693396,0.0027335135,0.0017083781,0.0010565359,0.07431396],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00099605,0.00010581087,0.002476452,0.0999802,0.0003762783,0.00014765655,0.00024543973,0.0005646646,0.00022684058,0.0026028592,0.87624407,0.016033685],"study_design_scores_gemma":[0.015492554,0.0006260972,0.030623412,0.068685725,0.0019762265,0.0008604459,0.0010441359,0.0020662025,0.00126504,0.020430064,0.856597,0.0003331624],"about_ca_topic_score_codex":0.00571779,"about_ca_topic_score_gemma":0.010954177,"teacher_disagreement_score":0.9931586,"about_ca_system_score_codex":0.002469708,"about_ca_system_score_gemma":0.005037803,"threshold_uncertainty_score":0.22429156},"labels":[],"label_agreement":null},{"id":"W6958213777","doi":"10.6084/m9.figshare.26695779","title":"Additional file 5 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Mediation; Term (time); Binary data; Relation (database); Binary relation","score_opus":0.42972097942281373,"score_gpt":0.46274144100888837,"score_spread":0.033020461586074634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958213777","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009112803,0.00010238073,0.0070847673,0.0004574695,0.000111049536,0.0016247565,0.9836766,0.0014340334,0.004597687],"genre_scores_gemma":[0.06340978,0.00073830085,0.095183715,0.0026097929,0.00044617304,0.052278142,0.73059076,0.009119173,0.045624126],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9913687,0.0045595756,0.001343892,0.00078114605,0.0015500272,0.00039662683],"domain_scores_gemma":[0.5195185,0.44696224,0.0075158514,0.011222679,0.013403944,0.0013767619],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.019267278,0.0015278872,0.0016276815,0.003488737,0.0012378189,0.002110297,0.003320458,0.0020578015,0.9088676],"category_scores_gemma":[0.2877546,0.0012737566,0.0019427089,0.00464481,0.00059052097,0.0030165208,0.0017227557,0.0019941602,0.15006977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012707512,0.00035115104,0.0027584855,0.00554722,0.00018993864,0.00009117842,0.00020390857,0.0012698898,0.000079612364,0.003903578,0.9576437,0.02669072],"study_design_scores_gemma":[0.03246616,0.0016927674,0.045927472,0.015010066,0.0017497609,0.0015453319,0.0013370474,0.015786368,0.0021167665,0.0667798,0.8150764,0.0005120192],"about_ca_topic_score_codex":0.0050698337,"about_ca_topic_score_gemma":0.008510687,"teacher_disagreement_score":0.98073274,"about_ca_system_score_codex":0.0019561576,"about_ca_system_score_gemma":0.0034661565,"threshold_uncertainty_score":0.1299892},"labels":[],"label_agreement":null},{"id":"W6958357473","doi":"10.6084/m9.figshare.27932635","title":"Additional file 1 of Investigation of treatment delay in a complex healthcare process using physician insurance claims data: an application to symptomatic carotid artery stenosis","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Stenosis; Process (computing); Health care; Carotid arteries; MEDLINE","score_opus":0.28656438753837693,"score_gpt":0.4250100997574115,"score_spread":0.13844571221903457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958357473","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006628858,0.000027830472,0.00150654,0.00033648903,0.000024943814,0.00013865031,0.99453706,0.00037224795,0.0023934315],"genre_scores_gemma":[0.0805635,0.00037180222,0.026074981,0.0010676217,0.00025216676,0.0042876326,0.8672436,0.0011021805,0.0190366],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9987361,0.00047605054,0.00019584458,0.0002344411,0.0002691885,0.00008842902],"domain_scores_gemma":[0.9123169,0.07899481,0.00283059,0.002281153,0.0031282837,0.00044821622],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0031949605,0.00057622854,0.0005932661,0.001962035,0.00050028675,0.0011337093,0.0012116433,0.0013817647,0.7056883],"category_scores_gemma":[0.06889644,0.00042566663,0.0010325403,0.0030599283,0.00017243323,0.0010474429,0.00075616216,0.0008156582,0.05368226],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004159885,0.00015855928,0.010556274,0.0016450163,0.00011963673,0.00013512578,0.00009075151,0.0027895914,0.00006172701,0.00354013,0.95750946,0.02297777],"study_design_scores_gemma":[0.009559789,0.00066331186,0.10006907,0.0051760175,0.00069979264,0.0012258411,0.0009412588,0.051736016,0.0015475246,0.06229155,0.7658389,0.00025095398],"about_ca_topic_score_codex":0.011539316,"about_ca_topic_score_gemma":0.018476255,"teacher_disagreement_score":0.7056883,"about_ca_system_score_codex":0.0009669076,"about_ca_system_score_gemma":0.0019416404,"threshold_uncertainty_score":0.41979992},"labels":[],"label_agreement":null},{"id":"W6958460218","doi":"10.6084/m9.figshare.26577188.v1","title":"Additional file 1 of A method for generating synthetic longitudinal health data","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Economics; Children's Hospital of Eastern Ontario; University of Alberta","funders":"","keywords":"Longitudinal data; Data file; Health data","score_opus":0.504461716970461,"score_gpt":0.5126951724128155,"score_spread":0.008233455442354431,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958460218","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034435833,0.000024000728,0.006121768,0.00014867364,0.000044933528,0.0003194633,0.9897854,0.0013793269,0.0018321867],"genre_scores_gemma":[0.021025982,0.00021623205,0.051076464,0.0012537111,0.00020682416,0.008901481,0.8900812,0.0063126558,0.020925436],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99906117,0.00036182743,0.00012546469,0.0002373151,0.00014206508,0.0000721529],"domain_scores_gemma":[0.9620024,0.032461688,0.00088829716,0.0022604456,0.0019417021,0.000445406],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.004020177,0.000882926,0.00088144233,0.0014887644,0.0006471845,0.0012834772,0.0015121736,0.0012405141,0.82780766],"category_scores_gemma":[0.05052659,0.0007269311,0.00081355765,0.002086418,0.00026368193,0.00092399813,0.0011502638,0.0012075262,0.19307345],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028700105,0.00008980003,0.0030503257,0.001006345,0.00006948812,0.000059318605,0.000080975144,0.001947202,0.00012127092,0.0024937522,0.9702518,0.020542597],"study_design_scores_gemma":[0.0043848744,0.00035369126,0.015785037,0.0021378528,0.00032047386,0.000603919,0.00033924097,0.016833091,0.0014508457,0.053876903,0.9037399,0.00017417148],"about_ca_topic_score_codex":0.0043126275,"about_ca_topic_score_gemma":0.0084964195,"teacher_disagreement_score":0.82780766,"about_ca_system_score_codex":0.00088563235,"about_ca_system_score_gemma":0.0018847164,"threshold_uncertainty_score":0.24561137},"labels":[],"label_agreement":null},{"id":"W6958545144","doi":"10.6084/m9.figshare.26695779.v1","title":"Additional file 5 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Mediation; Term (time); Binary data; Relation (database); Binary relation","score_opus":0.42972097942281373,"score_gpt":0.46274144100888837,"score_spread":0.033020461586074634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958545144","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0009112803,0.00010238073,0.0070847673,0.0004574695,0.000111049536,0.0016247565,0.9836766,0.0014340334,0.004597687],"genre_scores_gemma":[0.06340978,0.00073830085,0.095183715,0.0026097929,0.00044617304,0.052278142,0.73059076,0.009119173,0.045624126],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9913687,0.0045595756,0.001343892,0.00078114605,0.0015500272,0.00039662683],"domain_scores_gemma":[0.5195185,0.44696224,0.0075158514,0.011222679,0.013403944,0.0013767619],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.019267278,0.0015278872,0.0016276815,0.003488737,0.0012378189,0.002110297,0.003320458,0.0020578015,0.9088676],"category_scores_gemma":[0.2877546,0.0012737566,0.0019427089,0.00464481,0.00059052097,0.0030165208,0.0017227557,0.0019941602,0.15006977],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012707512,0.00035115104,0.0027584855,0.00554722,0.00018993864,0.00009117842,0.00020390857,0.0012698898,0.000079612364,0.003903578,0.9576437,0.02669072],"study_design_scores_gemma":[0.03246616,0.0016927674,0.045927472,0.015010066,0.0017497609,0.0015453319,0.0013370474,0.015786368,0.0021167665,0.0667798,0.8150764,0.0005120192],"about_ca_topic_score_codex":0.0050698337,"about_ca_topic_score_gemma":0.008510687,"teacher_disagreement_score":0.98073274,"about_ca_system_score_codex":0.0019561576,"about_ca_system_score_gemma":0.0034661565,"threshold_uncertainty_score":0.1299892},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"dataset","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["insufficient_payload"],"domain":null,"study_design":"not_applicable","genre":"dataset","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W6958564969","doi":"10.6084/m9.figshare.18071026","title":"Additional file 1 of Reporting of abstracts in studies that used routinely collected data for exploring drug treatment effects: a cross-sectional survey","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; St Joseph's Health Centre","funders":"","keywords":"Drug treatment; MEDLINE; Data collection; Data file; Drug","score_opus":0.784504474706073,"score_gpt":0.5016852671014205,"score_spread":0.2828192076046525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958564969","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00021438414,0.0001822803,0.00035226386,0.00018814957,0.00003311312,0.00068703975,0.9969277,0.00019168654,0.0012234669],"genre_scores_gemma":[0.018953852,0.0026067868,0.01405282,0.0017798599,0.00035051614,0.05091664,0.88336724,0.0013634788,0.026608834],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.995312,0.0011262528,0.0020846163,0.0005944177,0.00057007745,0.00031261775],"domain_scores_gemma":[0.83435786,0.14167263,0.011999075,0.0032646726,0.0076510767,0.0010547254],"candidate_categories":["metaresearch","metaepi_broad","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.006841409,0.001721159,0.002992462,0.012756905,0.0010118907,0.002096674,0.0019054491,0.0017015346,0.8427545],"category_scores_gemma":[0.103536054,0.0009705815,0.0020212894,0.013964893,0.00047693396,0.0027335135,0.0017083781,0.0010565359,0.07431396],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00099605,0.00010581087,0.002476452,0.0999802,0.0003762783,0.00014765655,0.00024543973,0.0005646646,0.00022684058,0.0026028592,0.87624407,0.016033685],"study_design_scores_gemma":[0.015492554,0.0006260972,0.030623412,0.068685725,0.0019762265,0.0008604459,0.0010441359,0.0020662025,0.00126504,0.020430064,0.856597,0.0003331624],"about_ca_topic_score_codex":0.00571779,"about_ca_topic_score_gemma":0.010954177,"teacher_disagreement_score":0.99700755,"about_ca_system_score_codex":0.002469708,"about_ca_system_score_gemma":0.005037803,"threshold_uncertainty_score":0.22429156},"labels":[],"label_agreement":null},{"id":"W6958585884","doi":"10.6084/m9.figshare.26695776","title":"Additional file 4 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Outcome (game theory); Binary number; Mediation; Binary data; Empirical research; Binary relation; Relation (database)","score_opus":0.4314493148368384,"score_gpt":0.46305523481070243,"score_spread":0.03160591997386403,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6958585884","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014314074,0.00014698961,0.009088194,0.000530341,0.00011987369,0.0014808873,0.98101556,0.0017969056,0.0043898523],"genre_scores_gemma":[0.08638009,0.0008512976,0.10873612,0.002415543,0.000430758,0.04495668,0.70501935,0.0080888765,0.04312123],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9950352,0.0027612052,0.00065994926,0.0004948831,0.00081328873,0.00023556217],"domain_scores_gemma":[0.64120156,0.33694193,0.005053356,0.007559372,0.008248024,0.0009957866],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.012942536,0.0012778918,0.0012881579,0.0024155087,0.0008734555,0.0015948307,0.0024065191,0.001701491,0.8845806],"category_scores_gemma":[0.22163574,0.0009251874,0.0015985507,0.0036018742,0.00044626306,0.001983805,0.0011604837,0.0017030361,0.120169155],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015120298,0.00037942,0.0032014954,0.0061869603,0.000246299,0.0001056764,0.00015980538,0.0024640672,0.00011290734,0.003984599,0.94832224,0.03332444],"study_design_scores_gemma":[0.038545582,0.0021031993,0.04181141,0.013216172,0.0020878532,0.0017381829,0.001018667,0.029742401,0.00255983,0.07096875,0.795739,0.00046894964],"about_ca_topic_score_codex":0.0036924144,"about_ca_topic_score_gemma":0.006846724,"teacher_disagreement_score":0.8845806,"about_ca_system_score_codex":0.0014112003,"about_ca_system_score_gemma":0.0025015075,"threshold_uncertainty_score":0.16463166},"labels":[],"label_agreement":null},{"id":"W6964369708","doi":"10.25384/sage.21150912","title":"sj-docx-3-mdm-10.1177_0272989X221121747 – Supplemental material for A Tutorial on Time-Dependent Cohort State-Transition Models in R Using a Cost-Effectiveness Analysis Example","year":2022,"lang":"en","type":"article","venue":"Sage Journals Data","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"SickKids Foundation; Hospital for Sick Children; University of Toronto","funders":"","keywords":"Cohort; Cohort study; Statistical analysis; MEDLINE","score_opus":0.22442915652199655,"score_gpt":0.4398183123919964,"score_spread":0.21538915586999988,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6964369708","genre_codex":"dataset","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044051922,0.0004243437,0.032343395,0.0026181494,0.00083993305,0.00054175226,0.9001672,0.02384576,0.03877897],"genre_scores_gemma":[0.028830832,0.0019741724,0.11762814,0.007010927,0.001513688,0.008174415,0.600807,0.08069058,0.15337025],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9974585,0.0009480133,0.00029161893,0.00038299823,0.0007391209,0.00017970541],"domain_scores_gemma":[0.9397822,0.05023712,0.0020112393,0.0024106281,0.004696735,0.0008619234],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.005351826,0.0015144726,0.0014740637,0.0025306756,0.00060218736,0.0032666635,0.0027527607,0.002063801,0.8775773],"category_scores_gemma":[0.071178325,0.0017210238,0.002288241,0.0034882594,0.0005984278,0.0028425152,0.0020532843,0.002145695,0.5039507],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000059354545,0.00002171361,0.00027297647,0.0011359878,0.000039121824,0.000029918294,0.000027443888,0.0009512762,0.00007987781,0.0032627634,0.9821815,0.011938233],"study_design_scores_gemma":[0.00069388427,0.00007339059,0.0020176657,0.0013305303,0.000103320584,0.00016493602,0.000088618515,0.0045440234,0.0009435579,0.026419478,0.9635317,0.00008886547],"about_ca_topic_score_codex":0.007515068,"about_ca_topic_score_gemma":0.01310141,"teacher_disagreement_score":0.8775773,"about_ca_system_score_codex":0.0017060173,"about_ca_system_score_gemma":0.002890778,"threshold_uncertainty_score":0.17462105},"labels":[],"label_agreement":null},{"id":"W6977105027","doi":"10.6084/m9.figshare.14190234","title":"Additional file 2 of Waist circumference prediction for epidemiological research using gradient boosted trees","year":2021,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Circumference; Decision tree; Waist; Tree (set theory); Variable (mathematics)","score_opus":0.6877278544306521,"score_gpt":0.5092984696801275,"score_spread":0.1784293847505246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6977105027","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00024373623,0.00003911303,0.0019122293,0.00014693689,0.00003675048,0.00009200487,0.99574214,0.0010989526,0.0006879851],"genre_scores_gemma":[0.014396092,0.00026312965,0.02228651,0.00087314716,0.00017266968,0.0032260525,0.9448715,0.003562452,0.01034833],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990939,0.00026772651,0.00011738332,0.00027303427,0.00016055006,0.00008741602],"domain_scores_gemma":[0.973118,0.023192674,0.00067283073,0.0010744809,0.0015800617,0.0003619197],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.00256658,0.0011938319,0.001395113,0.0016717702,0.0006017671,0.0018091317,0.002350767,0.0015659753,0.8481684],"category_scores_gemma":[0.040823605,0.0007917318,0.0011860387,0.002548275,0.0002579415,0.0013600612,0.0010100775,0.001213637,0.18887712],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003577633,0.000099382814,0.002488698,0.0030548472,0.000103740014,0.00007963077,0.000052978594,0.0013651039,0.00010732796,0.0012326689,0.9729288,0.01812899],"study_design_scores_gemma":[0.008974745,0.00050487055,0.023688871,0.004231669,0.0006718008,0.000808117,0.00035324812,0.018082527,0.0018333393,0.041027743,0.89960754,0.0002154854],"about_ca_topic_score_codex":0.0051543172,"about_ca_topic_score_gemma":0.010719764,"teacher_disagreement_score":0.8481684,"about_ca_system_score_codex":0.0008379858,"about_ca_system_score_gemma":0.0017665714,"threshold_uncertainty_score":0.2165693},"labels":[],"label_agreement":null},{"id":"W6977162010","doi":"10.6084/m9.figshare.21293449.v1","title":"Additional file 1 of Examining evidence of time-dependent treatment effects: an illustration using regression methods","year":2022,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"PricewaterhouseCoopers (Canada)","funders":"","keywords":"Regression analysis; Regression; Linear regression; Feature (linguistics)","score_opus":0.4876346835237333,"score_gpt":0.4969911417975102,"score_spread":0.009356458273776902,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6977162010","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00034784837,0.000068758905,0.0044321744,0.00040976997,0.000088374516,0.00047415777,0.9895997,0.00080673303,0.0037724355],"genre_scores_gemma":[0.057820346,0.0009789439,0.09776238,0.0036606374,0.00068458944,0.021995757,0.7535464,0.009098632,0.05445223],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9966948,0.0014490657,0.00043810337,0.0006201653,0.00057479733,0.00022306459],"domain_scores_gemma":[0.73665327,0.24592888,0.003791085,0.0058815237,0.0067389896,0.0010063009],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.007750827,0.0013460816,0.0014547325,0.0032121313,0.0010369305,0.002099824,0.0026578205,0.0018667687,0.92917556],"category_scores_gemma":[0.16640629,0.0010108222,0.0019764286,0.0047386554,0.0005172949,0.00256688,0.0014808028,0.001661333,0.14960742],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00050904806,0.00014094872,0.0023402704,0.005018093,0.00015914976,0.0001205726,0.00012883867,0.0013130093,0.00007554096,0.004547595,0.96507597,0.020570934],"study_design_scores_gemma":[0.012775543,0.0007045985,0.019849073,0.009366069,0.0011532555,0.0013960327,0.00072028954,0.012105762,0.0012181699,0.10074497,0.8396705,0.00029573933],"about_ca_topic_score_codex":0.0068354565,"about_ca_topic_score_gemma":0.010993873,"teacher_disagreement_score":0.92917556,"about_ca_system_score_codex":0.0013344701,"about_ca_system_score_gemma":0.003494846,"threshold_uncertainty_score":0.10102248},"labels":[],"label_agreement":null},{"id":"W6977361464","doi":"10.6084/m9.figshare.26695767","title":"Additional file 1 of An empirical evaluation of approximate and exact regression-based causal mediation approaches for a binary outcome and a continuous or a binary mediator for case-control study designs","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal; Université du Québec à Montréal","funders":"","keywords":"Binary number; Variance (accounting); Outcome (game theory); Estimator; Binary data; Confidence interval; Mediation; Relation (database); Range (aeronautics)","score_opus":0.43388011366608537,"score_gpt":0.4631154158349202,"score_spread":0.029235302168834854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6977361464","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011829744,0.00012954888,0.008498924,0.00047558435,0.000097804295,0.0017896184,0.9826148,0.0010926445,0.0041181133],"genre_scores_gemma":[0.0745959,0.0009894524,0.12369332,0.002731925,0.00044876544,0.07036708,0.6795811,0.007060778,0.04053162],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99307007,0.004071122,0.00089672377,0.0006446601,0.0010498341,0.0002676062],"domain_scores_gemma":[0.50385207,0.4698333,0.006348516,0.009543509,0.00927392,0.0011487172],"candidate_categories":["metaresearch","insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.018150171,0.0012493256,0.0013788437,0.002879925,0.0010352185,0.0017599234,0.0027860682,0.0017513186,0.8834207],"category_scores_gemma":[0.29267487,0.001113575,0.0015259781,0.004673947,0.00051672495,0.0025106703,0.001401888,0.00198706,0.12256816],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001106905,0.00028296682,0.0027489965,0.0047792797,0.0001749577,0.000077676035,0.00018201087,0.0013224639,0.00006331933,0.0044039413,0.9562878,0.02856976],"study_design_scores_gemma":[0.03413462,0.0020267034,0.044345006,0.015268611,0.0018387483,0.0019080194,0.001099222,0.021426698,0.0017650301,0.071557336,0.8041671,0.00046294],"about_ca_topic_score_codex":0.0037006612,"about_ca_topic_score_gemma":0.0068512815,"teacher_disagreement_score":0.98184985,"about_ca_system_score_codex":0.0017225435,"about_ca_system_score_gemma":0.00304212,"threshold_uncertainty_score":0.16628611},"labels":[],"label_agreement":null},{"id":"W6977530810","doi":"10.6084/m9.figshare.26650401.v1","title":"Additional file 1 of A blueprint for a multi-disease, multi-domain Bayesian adaptive platform trial incorporating adult and paediatric subgroups: the Staphylococcus aureus Network Adaptive Platform trial","year":2024,"lang":"en","type":"article","venue":"Figshare","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Blueprint; Bayesian network; Bayesian probability; Adaptive design; Staphylococcus aureus; Clinical trial","score_opus":0.165584257030611,"score_gpt":0.35069281041370465,"score_spread":0.18510855338309365,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6977530810","genre_codex":"dataset","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006303515,0.0001261522,0.0035265659,0.0006444748,0.00012085713,0.0017635941,0.9862709,0.0010271479,0.0058899065],"genre_scores_gemma":[0.07382727,0.000993165,0.051988974,0.0070843254,0.0009496216,0.062878296,0.7121868,0.0052764327,0.084815025],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9976417,0.0012350695,0.00025712082,0.00036121448,0.00029338954,0.00021158656],"domain_scores_gemma":[0.9491246,0.043226715,0.0021804778,0.0027507115,0.0018004664,0.00091695675],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0059433817,0.0014101134,0.0018526528,0.0014487588,0.00094139227,0.0019327023,0.002372316,0.0021253524,0.8851217],"category_scores_gemma":[0.08371392,0.0010878532,0.0022897667,0.002259402,0.00048591298,0.0019491165,0.001268304,0.0019957665,0.14007553],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026867995,0.0001227557,0.0015470268,0.0039442354,0.00033467315,0.00009202634,0.00007253425,0.0021547677,0.00006913732,0.0038364958,0.97100633,0.014133231],"study_design_scores_gemma":[0.11481822,0.0029967923,0.018851431,0.010131624,0.0029284675,0.0016071028,0.00029559864,0.023480475,0.001337801,0.0944845,0.72864854,0.00041942458],"about_ca_topic_score_codex":0.0049778796,"about_ca_topic_score_gemma":0.008971185,"teacher_disagreement_score":0.8851217,"about_ca_system_score_codex":0.0011592336,"about_ca_system_score_gemma":0.002841187,"threshold_uncertainty_score":0.16385984},"labels":[],"label_agreement":null},{"id":"W6979860349","doi":"","title":"Amiodarone and the risk of pacemaker insertion in elderly patients with atrial fibrillation : analysis of time-dependent exposure using nested case-control and survival analysis methodologies","year":2003,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Canadian Institutes of Health Research","keywords":"Amiodarone; Nested case-control study; Atrial fibrillation; Confounding; Proportional hazards model; Cohort; Cohort study; Adverse effect","score_opus":0.051780270791267874,"score_gpt":0.3305015553312274,"score_spread":0.2787212845399595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6979860349","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96343344,0.0016798343,0.03393694,0.00019246047,0.00003191204,0.000106668376,0.00030506912,0.00003597859,0.0002776992],"genre_scores_gemma":[0.9883873,0.00020317205,0.010942509,0.00003857056,0.00001333759,0.00008138101,0.0002235059,0.0000046371247,0.00010555425],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9926721,0.005099339,0.00034530798,0.0008974747,0.0007958065,0.00019001757],"domain_scores_gemma":[0.9895096,0.0065975282,0.0018918872,0.0012087662,0.0004939667,0.00029822293],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010464064,0.0003511096,0.0005424093,0.00065246166,0.0002707178,0.00054686697,0.00084633747,0.00057870423,0.00057233055],"category_scores_gemma":[0.020910528,0.00029255726,0.0021429483,0.00046783502,0.00042812456,0.0003104616,0.0005563797,0.00053532014,0.00004317729],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013529205,0.00019775721,0.9708407,0.00015707282,0.0036343315,0.00035252018,0.00040344027,0.0046930485,0.0020480056,0.0011826075,0.00017650728,0.014961091],"study_design_scores_gemma":[0.00022948929,0.0012854927,0.9027028,0.00008298886,0.001978523,0.0009774668,0.00025245507,0.087854005,0.0011580655,0.00223595,0.001191959,0.000050784336],"about_ca_topic_score_codex":0.017768687,"about_ca_topic_score_gemma":0.013553152,"teacher_disagreement_score":0.017768687,"about_ca_system_score_codex":0.00068128476,"about_ca_system_score_gemma":0.0011467285,"threshold_uncertainty_score":0.055339873},"labels":[],"label_agreement":null},{"id":"W6980169674","doi":"","title":"Bayesian causal inference with longitudinal data","year":2021,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research; Hospital for Sick Children; Childhood Arthritis and Rheumatology Research Alliance","keywords":"Frequentist inference; Causal inference; Observational study; Bayesian probability; Marginal structural model; Bayesian statistics; Context (archaeology); Propensity score matching; Statistical inference","score_opus":0.21101959100071532,"score_gpt":0.48995238338930974,"score_spread":0.2789327923885944,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6980169674","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012047805,0.0011581654,0.9947901,0.0011358734,0.00009094546,0.00007248039,0.00015846263,0.00009288631,0.001296364],"genre_scores_gemma":[0.12758647,0.009105586,0.853681,0.0011955143,0.0011681105,0.0012970715,0.0010208291,0.00019345438,0.004751905],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9795425,0.015418935,0.00074263994,0.0016428536,0.0022509831,0.0004020177],"domain_scores_gemma":[0.8746543,0.1128693,0.0043940046,0.0041950177,0.0032212113,0.0006661634],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03862931,0.0013977708,0.002206577,0.003983604,0.0012891551,0.003631555,0.0027900138,0.0026369812,0.00643138],"category_scores_gemma":[0.14097075,0.0015053799,0.0027767483,0.0044322205,0.0037760127,0.0054077846,0.003730602,0.0073210937,0.0010644976],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000050677147,0.00005579943,0.0023276177,0.00045363774,0.00034490638,0.00015091646,0.00042903525,0.0958597,0.0001435185,0.8013845,0.0052293963,0.09357023],"study_design_scores_gemma":[0.000044739867,0.000021898037,0.0004288319,0.00017264036,0.000054704,0.00005000283,0.000051507057,0.15997374,0.00009716921,0.83175737,0.007320389,0.000027063012],"about_ca_topic_score_codex":0.008608244,"about_ca_topic_score_gemma":0.007190911,"teacher_disagreement_score":0.03862931,"about_ca_system_score_codex":0.0030118222,"about_ca_system_score_gemma":0.005591158,"threshold_uncertainty_score":0.20429373},"labels":[],"label_agreement":null},{"id":"W6980602840","doi":"","title":"Commentary on Santibanez Yanez","year":2007,"lang":"en","type":"article","venue":"Scholarship at UWindsor (University of Windsor)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Nucleofection; Gestational period; TSG101; Dysgeusia; Liquation; Diafiltration; Emperipolesis; Triacetin; Durvalumab","score_opus":0.08780777428797758,"score_gpt":0.3437218309558868,"score_spread":0.25591405666790923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6980602840","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00006861124,0.0016824976,0.00005024993,0.97471434,0.022385132,0.000002714411,0.000028061728,0.0000057954453,0.0010626027],"genre_scores_gemma":[0.0024459043,0.0012956046,0.00009066462,0.9666953,0.024868391,0.000024090037,0.000014441697,0.000029164465,0.004536417],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98814386,0.0035108007,0.0009916578,0.0026492374,0.0031620732,0.0015423696],"domain_scores_gemma":[0.9301664,0.05372163,0.0017728129,0.0018927088,0.008998164,0.0034482651],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020000763,0.0013848783,0.0035702682,0.0018454846,0.011078636,0.0083832955,0.0071219276,0.0865854,0.0105239265],"category_scores_gemma":[0.10408537,0.0014583756,0.002375253,0.002244088,0.013157794,0.009276888,0.006223091,0.11728571,0.0056987996],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030130723,0.000004853382,0.00005407587,0.00008690431,0.00002136356,0.00017632537,0.00058774004,0.00003273052,0.000037596976,0.016395733,0.98103,0.0015425651],"study_design_scores_gemma":[0.000073615476,0.000009988639,0.00033238926,0.00078452326,0.00006206883,0.00015805919,0.0011634788,0.00009729213,0.00015290707,0.02091903,0.97619313,0.00005360274],"about_ca_topic_score_codex":0.03683438,"about_ca_topic_score_gemma":0.049642928,"teacher_disagreement_score":0.0865854,"about_ca_system_score_codex":0.012504252,"about_ca_system_score_gemma":0.01596805,"threshold_uncertainty_score":0.105775476},"labels":[],"label_agreement":null},{"id":"W6981383349","doi":"","title":"Effets d'un entraînement combiné en force et en endurance sur la performance en course à pied","year":2012,"lang":"fr","type":"other","venue":"Papyrus : Institutional Repository (Université de Montréal)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Work (physics); Falling (accident); Control (management)","score_opus":0.010824079880901276,"score_gpt":0.22543143681146705,"score_spread":0.21460735693056576,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6981383349","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.990897,0.00065228523,0.00034720814,0.0010579873,0.00015576095,0.000035985577,0.002293991,0.00006334951,0.0044963276],"genre_scores_gemma":[0.966656,0.00040608636,0.0004605144,0.00015723956,0.00008483741,0.00010332715,0.0014351726,0.00003980719,0.030656973],"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9993753,0.00024153634,0.000017880697,0.00011889,0.00010059193,0.00014583915],"domain_scores_gemma":[0.9926697,0.004354597,0.0005852047,0.00029514244,0.0003819873,0.0017133979],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015010328,0.00062385516,0.0006891812,0.00028139373,0.0007267493,0.0010870354,0.0012085094,0.0012586466,0.020915274],"category_scores_gemma":[0.0118109,0.00028507784,0.00056659884,0.00037997527,0.0004505749,0.0004309291,0.0011057457,0.0014090079,0.0018328889],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.068604805,0.009388257,0.62639946,0.0006836143,0.0039351517,0.00069647137,0.004186467,0.009914244,0.0068045733,0.0021406487,0.039908,0.22733839],"study_design_scores_gemma":[0.0007775007,0.0037299483,0.9857838,0.00009232996,0.0008056473,0.000032159252,0.00082883035,0.0017917227,0.0008172866,0.00061552634,0.0046836333,0.000041529624],"about_ca_topic_score_codex":0.19531325,"about_ca_topic_score_gemma":0.20096117,"teacher_disagreement_score":0.19531325,"about_ca_system_score_codex":0.00130007,"about_ca_system_score_gemma":0.0018172882,"threshold_uncertainty_score":0.3883528},"labels":[],"label_agreement":null},{"id":"W6981661884","doi":"","title":"Essays in political economy","year":2004,"lang":"en","type":"other","venue":"Library and Archives Canada (Government of Canada)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Nucleofection; Gestational period; TSG101; Diafiltration; Liquation; Fusible alloy; Dysgeusia; Demotion; Hemopericardium","score_opus":0.014505821138513057,"score_gpt":0.22255010348214613,"score_spread":0.20804428234363306,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6981661884","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029751272,0.12436314,0.012760341,0.22963414,0.024223601,0.00003823609,0.00059365324,0.00014355985,0.6052683],"genre_scores_gemma":[0.17760764,0.15220988,0.012653691,0.04544668,0.059730332,0.00025626936,0.0010222147,0.0004539367,0.5506193],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99829143,0.00085055194,0.0000724198,0.0002096924,0.00048573344,0.00009006931],"domain_scores_gemma":[0.98944515,0.008109518,0.00030111987,0.0005313341,0.0011963669,0.00041653574],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0020846655,0.00074428745,0.00058307755,0.0026909949,0.0027884555,0.00471721,0.00059845654,0.0017254502,0.021401646],"category_scores_gemma":[0.011004179,0.00023066063,0.000533572,0.0030520454,0.005208466,0.0041312855,0.001021382,0.0037007034,0.0034261346],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012552062,0.00002052568,0.00023651095,0.00019384135,0.000012751139,0.00003672039,0.0005876594,0.00040749455,0.000044538585,0.65575534,0.3152307,0.02746127],"study_design_scores_gemma":[0.000006178696,0.00000628365,0.0004318119,0.00038506984,0.000005119076,0.000039982297,0.00036373117,0.00035446938,0.000036598012,0.24567561,0.75268924,0.0000059406625],"about_ca_topic_score_codex":0.0054753525,"about_ca_topic_score_gemma":0.0061313007,"teacher_disagreement_score":0.021401646,"about_ca_system_score_codex":0.0059629763,"about_ca_system_score_gemma":0.0025191777,"threshold_uncertainty_score":0.07159561},"labels":[],"label_agreement":null},{"id":"W6981761447","doi":"","title":"Faciliter l'apprentissage : mémoire de l'Institut canadien d'éducation des adultes présenté au Ministère de l'éducation dans le cadre de sa consultation sur les régimes pédagogiques","year":2015,"lang":"fr","type":"other","venue":"Bibliothèque et Archives nationales du Québec (Québec government)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Field (mathematics); Data collection; Work (physics)","score_opus":0.043868091663253075,"score_gpt":0.3064908963608217,"score_spread":0.26262280469756866,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6981761447","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12880163,0.02486182,0.0125018805,0.459919,0.00291612,0.00045890533,0.0047400496,0.00059517415,0.3652054],"genre_scores_gemma":[0.6695054,0.010030267,0.009618606,0.0131699545,0.0003841576,0.00046084318,0.0010127441,0.00021781544,0.29560015],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99531615,0.0023362117,0.00011431177,0.00034135883,0.0008848881,0.0010071921],"domain_scores_gemma":[0.9864125,0.0054988917,0.00056657917,0.0007020651,0.0044629104,0.0023570606],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010680629,0.00055261824,0.00050131715,0.0019375243,0.010245628,0.0067769242,0.0023504873,0.0026142187,0.027526457],"category_scores_gemma":[0.028012706,0.00034689045,0.00049822114,0.0033198313,0.0035659552,0.0037265986,0.0031525192,0.004276411,0.0014409695],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001747055,0.00020301767,0.022507295,0.0007211889,0.00006668371,0.00046209275,0.09560708,0.0012014835,0.00041050155,0.24871786,0.4109272,0.21900086],"study_design_scores_gemma":[0.00006388091,0.000059932547,0.060512446,0.0013892838,0.000095314346,0.00011606711,0.05479151,0.0013413607,0.0007441663,0.012289313,0.86850876,0.00008803039],"about_ca_topic_score_codex":0.97046024,"about_ca_topic_score_gemma":0.98428637,"teacher_disagreement_score":0.06636988,"about_ca_system_score_codex":0.06636988,"about_ca_system_score_gemma":0.12691617,"threshold_uncertainty_score":0.48154944},"labels":[],"label_agreement":null},{"id":"W6990555918","doi":"","title":"Do opportunities for low-income students at top colleges promote academic success? Evidence from Colombia's Ser Pilo Paga program","year":2023,"lang":"en","type":"other","venue":"Econstor (Econstor)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Scholarship; Test (biology); Socioeconomic status; Government (linguistics); Higher education; Regression discontinuity design","score_opus":0.16604362345088727,"score_gpt":0.4146045638726884,"score_spread":0.24856094042180113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6990555918","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9818938,0.0023212004,0.00021704279,0.0029420243,0.00004867735,0.00003598637,0.0018636736,0.000014845852,0.010662772],"genre_scores_gemma":[0.9968761,0.00075300405,0.00007541352,0.00019424518,0.000030141782,0.0000142822355,0.00049453217,0.000006029144,0.0015561895],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9983962,0.00069402024,0.00006295357,0.00025123908,0.00022489912,0.00037058102],"domain_scores_gemma":[0.9811164,0.0074157133,0.007056876,0.00079677626,0.001125321,0.0024888779],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0021715828,0.0002009072,0.00043180023,0.0012602756,0.0008896595,0.0020248052,0.0008927027,0.0006770113,0.01097793],"category_scores_gemma":[0.012820875,0.00015508349,0.0003019975,0.0017627204,0.0008011058,0.0006091946,0.0015392026,0.0010894269,0.00076238904],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006046932,0.0007838561,0.96201277,0.00024039068,0.00018130799,0.00023172842,0.0015945664,0.00015433483,0.00011090409,0.0016971773,0.005120127,0.02726812],"study_design_scores_gemma":[0.00004552985,0.00014182,0.9917218,0.00015667635,0.00011869897,0.000030410605,0.0031102425,0.00028509262,0.000099417986,0.00042554582,0.0038536668,0.000011091126],"about_ca_topic_score_codex":0.11159777,"about_ca_topic_score_gemma":0.12540974,"teacher_disagreement_score":0.11159777,"about_ca_system_score_codex":0.001162896,"about_ca_system_score_gemma":0.0013284069,"threshold_uncertainty_score":0.22189641},"labels":[],"label_agreement":null},{"id":"W6990707524","doi":"","title":"Effects of sparse follow-up on marginal structural models for time-to-event data","year":2012,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Missing data; Imputation (statistics); Proportional hazards model; Logistic regression; Confidence interval; Hazard ratio; Regression; Interval (graph theory)","score_opus":0.09454336714397679,"score_gpt":0.3606878515543809,"score_spread":0.26614448441040406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6990707524","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2456966,0.003166528,0.736959,0.0062188674,0.00031716676,0.0010862423,0.002866314,0.0008836732,0.0028057164],"genre_scores_gemma":[0.87636435,0.0010498879,0.115189314,0.0011718026,0.00031198372,0.001949391,0.0018632608,0.0001976973,0.0019023146],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.82597035,0.15186836,0.0051180366,0.009982943,0.0044281846,0.002632043],"domain_scores_gemma":[0.1098547,0.8418414,0.024542427,0.01998395,0.0026904913,0.0010870376],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.23907407,0.0017729054,0.003921525,0.0024055475,0.0019008387,0.0031874522,0.004947573,0.0038664402,0.008728742],"category_scores_gemma":[0.49460304,0.0016730631,0.0066236174,0.0028046682,0.0049798475,0.0071229464,0.00612328,0.006308031,0.00052373274],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013212771,0.00087317365,0.22678797,0.0025251363,0.009496184,0.002436627,0.0051447893,0.45082533,0.0009313691,0.15246421,0.0065286076,0.12877385],"study_design_scores_gemma":[0.0011194678,0.0017525153,0.038831916,0.0008061221,0.00344246,0.00068958243,0.0005377433,0.7266591,0.0011848453,0.21985772,0.004898362,0.00022011633],"about_ca_topic_score_codex":0.008148957,"about_ca_topic_score_gemma":0.006924213,"teacher_disagreement_score":0.23907407,"about_ca_system_score_codex":0.0031411648,"about_ca_system_score_gemma":0.0026557497,"threshold_uncertainty_score":0.9383572},"labels":[],"label_agreement":null},{"id":"W6990929614","doi":"","title":"Essays on Child Mental Health: Estimating Diagnostic Errors, Latent Risk, and Long-term Trajectories","year":2021,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Receipt; Mental health; Unemployment; Mental illness; Medical diagnosis; Educational attainment","score_opus":0.06374682333869622,"score_gpt":0.41943096214123937,"score_spread":0.3556841388025431,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6990929614","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15499121,0.069388226,0.21958163,0.49466482,0.018366653,0.0004760003,0.0038666641,0.0004371033,0.03822772],"genre_scores_gemma":[0.7057122,0.048557777,0.12717263,0.02795778,0.037732482,0.0013919906,0.0033222681,0.00056789035,0.047585025],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9919748,0.005577974,0.00045678308,0.00094154617,0.0009356215,0.000113253234],"domain_scores_gemma":[0.75196844,0.23142438,0.005766883,0.004794694,0.0049494184,0.0010961534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023607625,0.0009902206,0.0010444352,0.0023294373,0.0019969675,0.0044972547,0.0012389194,0.0024908078,0.0059309397],"category_scores_gemma":[0.15457168,0.0006196045,0.0013724674,0.0022369844,0.004197695,0.0035128216,0.0021671753,0.0050340113,0.0011075505],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004891875,0.0004267457,0.10542804,0.0011079729,0.000807765,0.0005640811,0.009770589,0.030971164,0.00043482645,0.21069191,0.28893125,0.35037646],"study_design_scores_gemma":[0.00020326122,0.000597165,0.084890686,0.0054834494,0.00029500615,0.00077716174,0.009559649,0.098899245,0.00092369487,0.5585955,0.23943296,0.00034232673],"about_ca_topic_score_codex":0.0030253027,"about_ca_topic_score_gemma":0.002423896,"teacher_disagreement_score":0.023607625,"about_ca_system_score_codex":0.002359187,"about_ca_system_score_gemma":0.0013996069,"threshold_uncertainty_score":0.12485057},"labels":[],"label_agreement":null},{"id":"W6991695571","doi":"","title":"Improved Inference for Causal Effects in Network-Based Observational Studies","year":2025,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Carolina Population Center, University of North Carolina at Chapel Hill; Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Child Health and Human Development; Natural Sciences and Engineering Research Council of Canada; University of North Carolina at Chapel Hill; University of Glasgow; Compute Canada; CHU Sainte-Justine Foundation; McGill University","keywords":"Observational study; Inference; Causal inference; Causal model; Bayesian probability","score_opus":0.14566278497070215,"score_gpt":0.40536658937855846,"score_spread":0.25970380440785634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6991695571","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011220641,0.0009549303,0.98489714,0.000982457,0.00010134781,0.00010724091,0.00037786836,0.00026306257,0.001095466],"genre_scores_gemma":[0.33688775,0.0019509301,0.65409744,0.00056112296,0.0005333271,0.0008706895,0.0012036831,0.0002341182,0.003660966],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93668574,0.05368681,0.0019985847,0.0051044207,0.0019837285,0.00054060604],"domain_scores_gemma":[0.3079024,0.6676869,0.0054536597,0.014903673,0.0031831977,0.0008702918],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07865796,0.0015279629,0.0051653516,0.0042491728,0.0018086262,0.003661535,0.005395465,0.0024096097,0.010418519],"category_scores_gemma":[0.39703605,0.0022589562,0.0042877295,0.0059352033,0.00349564,0.008780212,0.005163073,0.0077887047,0.0007708839],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012133459,0.00046106678,0.027844124,0.0018487099,0.0039074016,0.00057184894,0.0019206224,0.2028513,0.0010608303,0.5433853,0.0065905056,0.20834492],"study_design_scores_gemma":[0.00022823669,0.00009875676,0.0032019052,0.00019575334,0.0009174211,0.000114331735,0.00012314483,0.36199307,0.00044010748,0.63006943,0.0025767488,0.000041176467],"about_ca_topic_score_codex":0.010730505,"about_ca_topic_score_gemma":0.0086381,"teacher_disagreement_score":0.921342,"about_ca_system_score_codex":0.0023303065,"about_ca_system_score_gemma":0.002931386,"threshold_uncertainty_score":0.41598803},"labels":[],"label_agreement":null},{"id":"W6992591809","doi":"","title":"Map showing thickness of unconsolidated deposits in the western quarter of the Muncie and eastern quarter of the Lafayette 1:100,000 quadrangles, central Indiana","year":2000,"lang":"en","type":"other","venue":"IUScholarWorks (Indiana University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Period (music); Window (computing); Block (permutation group theory)","score_opus":0.03482545056237412,"score_gpt":0.2675815949386494,"score_spread":0.2327561443762753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W6992591809","genre_codex":"dataset","genre_gemma":"dataset","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"dataset","genre_consensus":"dataset","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1507678,0.0016134577,0.0028291433,0.00082769466,0.00026436197,0.00030489825,0.5380512,0.0019328911,0.30340856],"genre_scores_gemma":[0.55870515,0.002588906,0.016150206,0.00014333475,0.000101367645,0.0004211889,0.17111854,0.0003971555,0.25037417],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9998982,0.000015766042,0.0000057639504,0.000027881111,0.000031340103,0.00002101861],"domain_scores_gemma":[0.9996106,0.000042324307,0.000049460334,0.000022532315,0.00022946495,0.000045613084],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00010815461,0.00045351047,0.00022010884,0.0034224195,0.00077755004,0.00083281554,0.00046252378,0.00023829847,0.055548828],"category_scores_gemma":[0.00054530415,0.00025165855,0.00015914057,0.0040096515,0.00024153014,0.00037710872,0.00042755727,0.0003346804,0.008837447],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00065515493,0.00013567781,0.26880592,0.0009859571,0.0001038041,0.00073054613,0.0031053333,0.007526476,0.0028726086,0.008771475,0.571989,0.13431807],"study_design_scores_gemma":[0.00007403587,0.000041614014,0.6518918,0.00038535535,0.000064885564,0.0002471388,0.0059390552,0.0029350799,0.0020278904,0.0006105601,0.3357429,0.0000396908],"about_ca_topic_score_codex":0.38650453,"about_ca_topic_score_gemma":0.7174327,"teacher_disagreement_score":0.38650453,"about_ca_system_score_codex":0.0015689468,"about_ca_system_score_gemma":0.0014417616,"threshold_uncertainty_score":0.7685096},"labels":[],"label_agreement":null},{"id":"W7009393705","doi":"","title":"Empirical applications of the local likelihood method","year":2007,"lang":"en","type":"dissertation","venue":"The Atrium (University of Guelph)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nonparametric statistics; Endogeneity; Estimator; Unobservable; Capital asset pricing model; Matching (statistics); Average treatment effect; Propensity score matching; Parametric statistics","score_opus":0.06586044157958328,"score_gpt":0.38839628260470915,"score_spread":0.3225358410251259,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7009393705","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047302116,0.0018921829,0.98757964,0.0011399641,0.00007929667,0.0000958672,0.00015370008,0.00028593952,0.0040431637],"genre_scores_gemma":[0.45030493,0.005788752,0.5291061,0.0008897562,0.0008304092,0.001310895,0.0010024139,0.00043734748,0.010329423],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9838974,0.013263246,0.00035327798,0.001095067,0.0011517584,0.00023922055],"domain_scores_gemma":[0.9164042,0.07369699,0.0033159014,0.004077963,0.0021278046,0.0003771192],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019444557,0.001058266,0.0023018431,0.0039008395,0.0011012066,0.003018113,0.0033072035,0.0021754298,0.010426452],"category_scores_gemma":[0.097222194,0.0010342421,0.0019344322,0.0045562414,0.0031175206,0.0036501433,0.0037970718,0.0034717117,0.0015449233],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009610993,0.00018111996,0.012416111,0.0008915582,0.00066179456,0.00049310626,0.0007140414,0.13388892,0.00049441366,0.65572864,0.006858927,0.1875753],"study_design_scores_gemma":[0.000057523983,0.00008740797,0.0027999533,0.00029033198,0.00008352841,0.00022433962,0.00026402462,0.43780437,0.00038284555,0.54732025,0.010624659,0.000060852533],"about_ca_topic_score_codex":0.0044039288,"about_ca_topic_score_gemma":0.0030219434,"teacher_disagreement_score":0.019444557,"about_ca_system_score_codex":0.0018142135,"about_ca_system_score_gemma":0.002511558,"threshold_uncertainty_score":0.10283387},"labels":[],"label_agreement":null},{"id":"W7010008906","doi":"","title":"Futurpreneur announces 2024 Canadian delegation for the G20 Young Entrepreneurs' Alliance Summit in Brazil","year":2024,"lang":"en","type":"other","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Summit; Delegation; Alliance; Government (linguistics)","score_opus":0.06766321522002318,"score_gpt":0.3796711667029313,"score_spread":0.3120079514829081,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7010008906","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009013152,0.0020484542,0.004482051,0.32572225,0.014167856,0.0004000645,0.0148306135,0.0008278323,0.6285079],"genre_scores_gemma":[0.025903335,0.00050202775,0.0011434862,0.010610727,0.00055310776,0.000089120644,0.0013660761,0.00014969488,0.9596824],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9984598,0.00014489754,0.000023996921,0.00012877406,0.0006374726,0.00060493895],"domain_scores_gemma":[0.99669385,0.0006803206,0.00007613632,0.00016528007,0.0011846188,0.0011997555],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0033494793,0.00042974215,0.0005871741,0.0008499597,0.005799606,0.0048553618,0.0011062113,0.00506796,0.10074236],"category_scores_gemma":[0.008207574,0.00026431016,0.0007914949,0.000865216,0.0010093715,0.0012435699,0.0026010666,0.004499332,0.012453323],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006561711,0.000029030216,0.0008917496,0.00003710352,0.000008212992,0.0001876826,0.00018342692,0.00016319916,0.0001515062,0.049292877,0.9345965,0.01439307],"study_design_scores_gemma":[0.000024994213,0.000012332532,0.002897597,0.00004539406,0.000008034243,0.000020130876,0.00034931226,0.0004960301,0.00023440438,0.0067926487,0.9891026,0.00001643415],"about_ca_topic_score_codex":0.631368,"about_ca_topic_score_gemma":0.8486488,"teacher_disagreement_score":0.36863202,"about_ca_system_score_codex":0.010481996,"about_ca_system_score_gemma":0.03127274,"threshold_uncertainty_score":0.7416059},"labels":[],"label_agreement":null},{"id":"W7014274854","doi":"","title":"Optimal dynamic treatment regime structural nested mean models: improving efficiency through diagnostics and re-weighting and application to adaptive individual dosing","year":2013,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Department of Epidemiology, Biostatistics and Occupational Health, McGill University; Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Estimator; Residual; Regression; Dosing; Sample (material); Sample size determination; Estimation","score_opus":0.05737955984033674,"score_gpt":0.3292449294087006,"score_spread":0.2718653695683638,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7014274854","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023344073,0.00035065023,0.9747121,0.00031015888,0.000035232704,0.00013008404,0.000052785246,0.00016058118,0.00090434146],"genre_scores_gemma":[0.5888861,0.0005598278,0.4063177,0.00034735844,0.000096161835,0.0004893622,0.00025398226,0.00013287783,0.0029166404],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9919314,0.006032126,0.00027623077,0.0007617883,0.0006901855,0.00030824586],"domain_scores_gemma":[0.97167397,0.022835273,0.0018416537,0.001943164,0.0013645334,0.00034151776],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017003184,0.0009598017,0.002708874,0.00086136337,0.00045625112,0.0014284818,0.0031253505,0.0019347784,0.0023309195],"category_scores_gemma":[0.06261269,0.00093562336,0.0017085081,0.0009584817,0.0013420915,0.0019659859,0.0022436078,0.0028603126,0.0002929304],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00040995248,0.0002079433,0.0057313642,0.00016347702,0.00023449653,0.0001930097,0.0004999364,0.746923,0.0010792747,0.10964783,0.0009889852,0.13392065],"study_design_scores_gemma":[0.000029021654,0.00006111917,0.00038264404,0.000018606584,0.000030395586,0.000024256291,0.000016227343,0.97118324,0.00026930805,0.027412169,0.00056092825,0.000012026232],"about_ca_topic_score_codex":0.005832062,"about_ca_topic_score_gemma":0.004040773,"teacher_disagreement_score":0.017003184,"about_ca_system_score_codex":0.001217804,"about_ca_system_score_gemma":0.0019706853,"threshold_uncertainty_score":0.08992249},"labels":[],"label_agreement":null},{"id":"W7015539084","doi":"","title":"Towards an accessible methodology in precision medicine: methods for censored data and non-regular inferences","year":2020,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Fonds de recherche du Québec – Nature et technologies; McGill University Health Centre; Canadian Institutes of Health Research; Health Canada; McGill University; UNICEF","keywords":"Feature (linguistics); Bayesian probability; Data collection; Term (time); Estimation","score_opus":0.328821958760208,"score_gpt":0.5156193188424544,"score_spread":0.1867973600822464,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7015539084","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004370591,0.0034870806,0.9875668,0.004651756,0.00033139126,0.000065779095,0.00012675092,0.00011409515,0.003219164],"genre_scores_gemma":[0.045427002,0.0074920743,0.9344558,0.0033383116,0.002046107,0.0008494735,0.0003458276,0.00038043884,0.0056650206],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9489481,0.039808016,0.0015584629,0.0029278407,0.006343187,0.00041433837],"domain_scores_gemma":[0.8610855,0.113519356,0.0029730627,0.01614351,0.00552152,0.00075709634],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0723792,0.0013922335,0.0025174206,0.0037207857,0.0013636852,0.005719013,0.003482529,0.0035877798,0.0078103584],"category_scores_gemma":[0.14050978,0.0013931773,0.0031337705,0.0041946685,0.010505709,0.0068169427,0.0056825704,0.011212425,0.002737628],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000029240642,0.000031016567,0.00032813885,0.0005043244,0.00013302703,0.00004916024,0.00039548049,0.0033212104,0.00017929173,0.93646497,0.0074423617,0.051121794],"study_design_scores_gemma":[0.00001606531,0.000016737382,0.00014121283,0.00023110927,0.000023530336,0.000026009342,0.00002746301,0.0054327007,0.000144106,0.98288834,0.011038443,0.000014231299],"about_ca_topic_score_codex":0.0019132586,"about_ca_topic_score_gemma":0.0016224934,"teacher_disagreement_score":0.0723792,"about_ca_system_score_codex":0.0028058405,"about_ca_system_score_gemma":0.0053790086,"threshold_uncertainty_score":0.3827824},"labels":[],"label_agreement":null},{"id":"W7019432579","doi":"","title":"G-estimation of dynamic treatment regimes in the presence of shared parameters","year":2018,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"McGill University","keywords":"Outcome (game theory); Focus (optics); Estimation; Personalized medicine; Decision rule; Basis (linear algebra); Sensitivity (control systems)","score_opus":0.07114378011410935,"score_gpt":0.3629481029300055,"score_spread":0.2918043228158962,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7019432579","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03517826,0.00055690215,0.96124065,0.0009832548,0.00008470064,0.000316513,0.00025030694,0.00026455036,0.0011248182],"genre_scores_gemma":[0.6641813,0.000931443,0.32716644,0.0009975962,0.00018473493,0.0011451046,0.0012632083,0.00014238729,0.0039877766],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9849631,0.011073133,0.00046233434,0.0022362242,0.00072386354,0.00054126384],"domain_scores_gemma":[0.9240304,0.06704971,0.00327637,0.0041137827,0.0011667615,0.00036289514],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024758581,0.0020437497,0.003807669,0.0014406218,0.00072130945,0.0021131227,0.0024525416,0.002638278,0.0034629067],"category_scores_gemma":[0.08314949,0.0012492227,0.0026117233,0.0014835162,0.002934395,0.0026695556,0.0026830533,0.00430201,0.00057175284],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006247375,0.00022025214,0.01298519,0.00038296703,0.00093755237,0.00021117563,0.00027594145,0.8008906,0.0008978004,0.06667929,0.0025172564,0.113377206],"study_design_scores_gemma":[0.0001646566,0.00021309427,0.0023484395,0.000082332735,0.00013582662,0.000059132904,0.000059524213,0.9107983,0.0005655994,0.08409784,0.0014333158,0.00004189118],"about_ca_topic_score_codex":0.0071996925,"about_ca_topic_score_gemma":0.004808404,"teacher_disagreement_score":0.024758581,"about_ca_system_score_codex":0.0017968725,"about_ca_system_score_gemma":0.003882735,"threshold_uncertainty_score":0.13093746},"labels":[],"label_agreement":null},{"id":"W7020777066","doi":"","title":"Méthane dissous dans le système marin du Saint-Laurent","year":2021,"lang":"fr","type":"other","venue":"Sémaphore (Université du Québec à Rimouski)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Limiting; Decantation; Nucleofection","score_opus":0.02082806021085343,"score_gpt":0.2415939127381665,"score_spread":0.22076585252731307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7020777066","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9966685,0.0002707562,0.00054696394,0.000041410607,0.0000057003126,0.000012321438,0.000974878,0.00004810664,0.0014313395],"genre_scores_gemma":[0.99547887,0.00017162217,0.0017488558,0.000021948203,0.0000037213738,0.00001541712,0.0009890152,0.000010466752,0.0015602157],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9998642,0.00001058034,0.0000067056,0.000045866123,0.0000555471,0.000017148795],"domain_scores_gemma":[0.99987555,0.000023587012,0.00002298001,0.000006160191,0.00006125162,0.0000104626615],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00026788912,0.00026329854,0.00032235504,0.00074370427,0.0008139694,0.00056214165,0.000276941,0.00035337795,0.00090175605],"category_scores_gemma":[0.00021487339,0.00017048285,0.0003808972,0.0007336666,0.0003066255,0.00028568812,0.00031168046,0.00017978219,0.00016954633],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010691076,0.00006478139,0.4590711,0.001053582,0.00024012757,0.0010344709,0.0020174878,0.029860005,0.45863742,0.00054326083,0.0007896038,0.04561908],"study_design_scores_gemma":[0.000031176125,0.00023250413,0.8718,0.000049202794,0.00009685588,0.00016765276,0.0009965795,0.029750438,0.08098861,0.00013541232,0.015699964,0.000051559513],"about_ca_topic_score_codex":0.2901245,"about_ca_topic_score_gemma":0.3932908,"teacher_disagreement_score":0.70987546,"about_ca_system_score_codex":0.0026075917,"about_ca_system_score_gemma":0.0017480247,"threshold_uncertainty_score":0.5768716},"labels":[],"label_agreement":null},{"id":"W7025253789","doi":"","title":"Towards a Long-term Preservation Infrastructure for Earth Science Data: Paper - iPRES 2012 - Digital Curation Institute, iSchool, Toronto","year":2012,"lang":"en","type":"article","venue":"Phaidra (Universität Wien)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nucleofection; Gestational period; TSG101; Dysgeusia; Liquation; Diafiltration; Emperipolesis; Triacetin; Durvalumab","score_opus":0.1450269430265068,"score_gpt":0.39613635193838814,"score_spread":0.2511094089118814,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7025253789","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014258596,0.0007979624,0.9433305,0.014933442,0.00028419847,0.0003345216,0.010411079,0.01079778,0.0048518353],"genre_scores_gemma":[0.12337386,0.001053634,0.83288896,0.0012561448,0.0002943159,0.00033911155,0.032232944,0.002526816,0.006034129],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9897507,0.003275955,0.0013638336,0.0021875524,0.0027667256,0.00065531844],"domain_scores_gemma":[0.8543015,0.022607028,0.0073981723,0.07638263,0.034024704,0.0052859546],"candidate_categories":["scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.033752903,0.00049458107,0.0010495761,0.005356623,0.004035275,0.010099903,0.0050637615,0.0027689189,0.0078073065],"category_scores_gemma":[0.05928855,0.0015054997,0.0018918522,0.007762306,0.0032289375,0.021721385,0.015149648,0.00500596,0.0037786788],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000534602,0.00046529042,0.039116222,0.0014027907,0.00059263536,0.0005419937,0.0065962803,0.02775013,0.012911361,0.2912043,0.17466293,0.44422153],"study_design_scores_gemma":[0.00008125879,0.00019481931,0.02126348,0.0009820923,0.00058164634,0.00049237674,0.0032471882,0.12344758,0.020005612,0.19928595,0.6302087,0.00020935772],"about_ca_topic_score_codex":0.04929719,"about_ca_topic_score_gemma":0.060148638,"teacher_disagreement_score":0.9899001,"about_ca_system_score_codex":0.0046893945,"about_ca_system_score_gemma":0.021081978,"threshold_uncertainty_score":0.17850453},"labels":[],"label_agreement":null},{"id":"W7027096149","doi":"","title":"Causal quantile treatment effects at high and extreme quantile levels","year":2023,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Institut de Valorisation des Données; Compute Canada; Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Quantile; Quantile regression; Term (time); Context (archaeology); Causality (physics)","score_opus":0.13020250003138095,"score_gpt":0.3598972338347665,"score_spread":0.22969473380338556,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7027096149","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3108246,0.00658163,0.50170165,0.042002313,0.0025522767,0.0008694602,0.0075273113,0.0017875233,0.12615326],"genre_scores_gemma":[0.93583125,0.0015912071,0.030460257,0.0019889576,0.0005697851,0.00044843703,0.0007551259,0.00018605367,0.028168969],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.992014,0.0051179337,0.00015579132,0.0010570354,0.0007710924,0.0008842658],"domain_scores_gemma":[0.9268857,0.062383395,0.0027210186,0.004497403,0.0024740968,0.0010384324],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01595707,0.00043861053,0.0013242268,0.0009788171,0.0011994233,0.0026652694,0.0012302446,0.0017741945,0.057219557],"category_scores_gemma":[0.08431253,0.0005738482,0.0014100161,0.0016589558,0.0017327797,0.0022577033,0.0016534871,0.0049125194,0.002036902],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018580317,0.0007909247,0.036390856,0.00050196506,0.0004775266,0.00020765977,0.0019043542,0.011958403,0.0006998559,0.7083188,0.039326403,0.1975652],"study_design_scores_gemma":[0.00061354303,0.00036743365,0.0655554,0.00033334622,0.00079155416,0.00013364492,0.0012438011,0.026280561,0.0018316191,0.8832498,0.01952567,0.0000736014],"about_ca_topic_score_codex":0.0040212595,"about_ca_topic_score_gemma":0.0035897836,"teacher_disagreement_score":0.057219557,"about_ca_system_score_codex":0.0014185146,"about_ca_system_score_gemma":0.0019254384,"threshold_uncertainty_score":0.19141853},"labels":[],"label_agreement":null},{"id":"W7033279466","doi":"","title":"Professionelle Simulation: Begriff - Ausdeutungen - Dimensionen - Handlungsfelder","year":2020,"lang":"de","type":"book-chapter","venue":"OPUS (Augsburg University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hatch (Canada)","funders":"","keywords":"Nucleofection; Gestational period; TSG101; Dysgeusia; Liquation; Diafiltration; Emperipolesis; Triacetin; Demotion","score_opus":0.13338364586899812,"score_gpt":0.3298365050929562,"score_spread":0.19645285922395808,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7033279466","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015958754,0.01617856,0.17201011,0.010229182,0.0005232014,0.0000545193,0.00039146867,0.0006886758,0.7839656],"genre_scores_gemma":[0.6390732,0.01744888,0.07142634,0.0013244131,0.00034863883,0.00032709652,0.0007723031,0.0004906193,0.26878858],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99945945,0.00025779402,0.000020239397,0.00007680416,0.000137612,0.000048152],"domain_scores_gemma":[0.99881774,0.00090452895,0.000040196934,0.00010129031,0.00008591094,0.000050245595],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006926011,0.0006151253,0.00038635594,0.0007151697,0.0010208106,0.003150533,0.00057712087,0.001144125,0.024761079],"category_scores_gemma":[0.0032147802,0.00043275752,0.0004236862,0.0012167599,0.0031532792,0.0041698245,0.0018687369,0.002327459,0.0036236595],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014216131,0.00001916097,0.00024103328,0.00006710529,0.0000047862745,0.00003665761,0.00091494253,0.0031679755,0.00028356037,0.94948417,0.011294418,0.034472033],"study_design_scores_gemma":[0.0000054316733,0.00000835609,0.00027520634,0.0001017817,0.0000034090208,0.00006295737,0.00047155903,0.0049210954,0.00040455026,0.8925838,0.10115236,0.000009386119],"about_ca_topic_score_codex":0.0035452314,"about_ca_topic_score_gemma":0.00368486,"teacher_disagreement_score":0.024761079,"about_ca_system_score_codex":0.0023063493,"about_ca_system_score_gemma":0.0016279201,"threshold_uncertainty_score":0.082834065},"labels":[],"label_agreement":null},{"id":"W7037729294","doi":"","title":"The Effect of Taking a Paternity Leave on Men’s Career Outcomes","year":2020,"lang":"en","type":"other","venue":"OSF Preprints (OSF Preprints)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Parental leave; Perception; Agency (philosophy); Expectancy theory; Test (biology); Sample (material)","score_opus":0.06627739889284377,"score_gpt":0.357201921387949,"score_spread":0.2909245224951052,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7037729294","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99524504,0.0003608767,0.00024926994,0.0011776196,0.000053724518,0.000021954937,0.00022046847,0.000009948856,0.0026611742],"genre_scores_gemma":[0.9982868,0.00012649117,0.00014687695,0.00008615425,0.000023086646,0.000020528969,0.00011785552,0.0000037379432,0.0011883591],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9964497,0.0016781548,0.00014786591,0.00042068597,0.00056589727,0.0007376477],"domain_scores_gemma":[0.97521734,0.010177883,0.0068504144,0.0016261418,0.00094518944,0.005183016],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054333536,0.00026543648,0.00043307774,0.000508527,0.0020998148,0.0014981298,0.0007848383,0.000698933,0.011479197],"category_scores_gemma":[0.025263347,0.00018794127,0.0008318056,0.00054542423,0.001132254,0.00077346485,0.0016077037,0.0022000922,0.00062615634],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001437465,0.0013006071,0.9560395,0.00008471396,0.00029988054,0.00008851401,0.0026277483,0.00038936138,0.000266599,0.0017448958,0.001062806,0.03465795],"study_design_scores_gemma":[0.000051210387,0.0007952608,0.99373215,0.000057206733,0.00010180177,0.000025613266,0.00276546,0.0005076973,0.00021141002,0.0006940918,0.0010396697,0.000018486162],"about_ca_topic_score_codex":0.02590763,"about_ca_topic_score_gemma":0.03860362,"teacher_disagreement_score":0.02590763,"about_ca_system_score_codex":0.0012817993,"about_ca_system_score_gemma":0.0025255303,"threshold_uncertainty_score":0.051513672},"labels":[],"label_agreement":null},{"id":"W7037901270","doi":"","title":"Feet for FEAT, Ricky Atkinson Robyn Maynard","year":2017,"lang":"en","type":"other","venue":"Bulletin of Miscellaneous Information (Royal Gardens Kew)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Thursday; Prison; AKA; Memoir; Heron; Politics","score_opus":0.03714818296415547,"score_gpt":0.29226477486677177,"score_spread":0.2551165919026163,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7037901270","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028356505,0.02526692,0.006664526,0.190614,0.011170767,0.00012493692,0.003014192,0.002656043,0.757653],"genre_scores_gemma":[0.005883535,0.0036583785,0.0011444596,0.006111368,0.00048800782,0.000033657303,0.00030676392,0.00045433117,0.9819195],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99967146,0.00007552683,0.000014145642,0.00006208273,0.00013176345,0.000044960758],"domain_scores_gemma":[0.9989176,0.00035999095,0.00004832167,0.00007650716,0.0003684562,0.00022920595],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00071612286,0.00046854556,0.000407631,0.0009858983,0.0029655811,0.00318426,0.0006037376,0.0010138361,0.2565438],"category_scores_gemma":[0.0047292155,0.00044642386,0.00022073975,0.0011279339,0.00096198614,0.0032503202,0.0013244988,0.0021855317,0.07470899],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000053654035,0.0000048719166,0.00011189123,0.000015942636,8.7215557e-7,0.00003909373,0.00013746918,0.00001728218,0.00002599601,0.0030432267,0.983139,0.013458961],"study_design_scores_gemma":[0.0000022082277,0.0000027233384,0.00032108455,0.000045035198,0.0000014106588,0.00007169572,0.00058261346,0.00005644893,0.00005333185,0.0023172696,0.9965423,0.0000039542647],"about_ca_topic_score_codex":0.054444924,"about_ca_topic_score_gemma":0.14608899,"teacher_disagreement_score":0.2565438,"about_ca_system_score_codex":0.0022000787,"about_ca_system_score_gemma":0.0022318019,"threshold_uncertainty_score":0.85822445},"labels":[],"label_agreement":null},{"id":"W7042528796","doi":"","title":"Pharmacological interventions in type 2 diabetes: observational studies and bias related issues","year":2008,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Observational study; Confounding; Type 2 diabetes; Cohort study; Metformin; Myocardial infarction; Residual risk; Cohort; Psychological intervention","score_opus":0.37878548603621753,"score_gpt":0.4573771715734495,"score_spread":0.07859168553723195,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7042528796","genre_codex":"methods","genre_gemma":"review","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12900564,0.3597027,0.4030371,0.062738195,0.0141158765,0.008180699,0.009649463,0.0007890913,0.012781164],"genre_scores_gemma":[0.67902046,0.059013765,0.19547927,0.040649902,0.0069214217,0.012720333,0.0034305798,0.0004398774,0.0023244275],"study_design_codex":"observational","study_design_gemma":"systematic_review","domain_scores_codex":[0.3308269,0.5631897,0.062224638,0.015069191,0.027121855,0.0015677677],"domain_scores_gemma":[0.14764774,0.7213978,0.06589625,0.052235533,0.011611709,0.0012109387],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.509494,0.0017856004,0.0053323065,0.0049070166,0.0026750725,0.0061440463,0.0048897564,0.0060821697,0.0026143007],"category_scores_gemma":[0.6771972,0.0022584533,0.007827512,0.0141723985,0.006042966,0.0050251656,0.0037457624,0.004906337,0.00048652478],"study_design_candidate":"systematic_review","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0034136637,0.00048647303,0.6096816,0.031580046,0.07891848,0.0010420901,0.006080394,0.008116243,0.0005064751,0.07012668,0.018057972,0.17198987],"study_design_scores_gemma":[0.005720716,0.0029661253,0.39375904,0.061707817,0.05779371,0.0052696657,0.0052131247,0.052226733,0.0033029537,0.30645764,0.104335964,0.0012465711],"about_ca_topic_score_codex":0.011083031,"about_ca_topic_score_gemma":0.00851869,"teacher_disagreement_score":0.490506,"about_ca_system_score_codex":0.0031103624,"about_ca_system_score_gemma":0.0055387462,"threshold_uncertainty_score":0.6048813},"labels":[],"label_agreement":null},{"id":"W7071692116","doi":"","title":"Three Essays in Applied Micro-Econometrics","year":2022,"lang":"en","type":"dissertation","venue":"MacSphere (McMaster University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Medical prescription; Logistic regression; Opioid; Nonparametric statistics; Prescription drug; Pharmacoepidemiology; Consumption (sociology); Regression analysis","score_opus":0.06619181418996428,"score_gpt":0.2914325872298593,"score_spread":0.22524077303989504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7071692116","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006083708,0.18670854,0.23177807,0.40291205,0.026280703,0.00013130474,0.0008323214,0.00043488335,0.1448384],"genre_scores_gemma":[0.29698536,0.25638252,0.1160111,0.077757254,0.09159427,0.0011078126,0.0010423589,0.0012970151,0.15782225],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9925718,0.0042965296,0.00043681543,0.0006346738,0.001754256,0.00030589223],"domain_scores_gemma":[0.9568704,0.03692048,0.0009883335,0.002167478,0.0025833144,0.0004700923],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011360108,0.001101981,0.0012500517,0.0027876785,0.0016650107,0.0058943983,0.0014206966,0.0041644503,0.0104662115],"category_scores_gemma":[0.043351088,0.00074422365,0.0017243327,0.0043931454,0.008944136,0.0048452416,0.0029311168,0.0064273626,0.0030820742],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000023664852,0.0000469238,0.0009426865,0.00028739954,0.000065220534,0.00010229814,0.00081257254,0.003559038,0.000095627736,0.8481794,0.09853057,0.047354598],"study_design_scores_gemma":[0.000016613543,0.000020798127,0.0011146782,0.0006771693,0.00001908647,0.000086294414,0.00047176573,0.004885736,0.00011173561,0.6371588,0.35539898,0.000038317103],"about_ca_topic_score_codex":0.0037164013,"about_ca_topic_score_gemma":0.0026006226,"teacher_disagreement_score":0.011360108,"about_ca_system_score_codex":0.0051293224,"about_ca_system_score_gemma":0.0030715184,"threshold_uncertainty_score":0.06007874},"labels":[],"label_agreement":null},{"id":"W7071900186","doi":"","title":"Value search estimators of individualized treatment regimes using a new class of weights","year":2016,"lang":"en","type":"dissertation","venue":"eScholarship@McGill (McGill)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McGill University Health Centre","funders":"","keywords":"Class (philosophy); Estimator; Value (mathematics); Variation (astronomy); Feature (linguistics)","score_opus":0.11770364856513031,"score_gpt":0.3908484226601983,"score_spread":0.273144774095068,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7071900186","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01352236,0.0004387738,0.98318046,0.00069186656,0.00007806711,0.000117600925,0.0001549346,0.00013145508,0.0016844021],"genre_scores_gemma":[0.37039617,0.001768111,0.61395514,0.00073434034,0.00056114094,0.0013719703,0.000765048,0.0002896134,0.010158475],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98614836,0.010165668,0.00044592837,0.0016880342,0.0011074537,0.00044462644],"domain_scores_gemma":[0.87630075,0.10860538,0.004082318,0.008115964,0.0021411122,0.00075456325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030674808,0.0013141944,0.0036844625,0.0028798238,0.00080300745,0.0035857367,0.0043530823,0.0033534712,0.007133975],"category_scores_gemma":[0.13838169,0.001468593,0.002173857,0.003529565,0.0027433021,0.008208428,0.002832966,0.0066155405,0.0007708501],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047846965,0.0003419387,0.0075209085,0.00028839443,0.0007271306,0.0000852307,0.00041633841,0.14709288,0.00069542805,0.6063345,0.0046138796,0.23140489],"study_design_scores_gemma":[0.000264576,0.00016068584,0.0015768306,0.00013888799,0.00020294703,0.00007970632,0.000067503584,0.50387657,0.00041579205,0.4903461,0.0028202888,0.000050098333],"about_ca_topic_score_codex":0.002349906,"about_ca_topic_score_gemma":0.0021574826,"teacher_disagreement_score":0.030674808,"about_ca_system_score_codex":0.0017055691,"about_ca_system_score_gemma":0.0023040914,"threshold_uncertainty_score":0.16222578},"labels":[],"label_agreement":null},{"id":"W70905468","doi":"10.1007/978-1-4614-6852-3_18","title":"Survival Analysis in Social Neuroscience and Public Health: A Research Exemplar from the Field of Cognitive Epidemiology","year":2013,"lang":"en","type":"book-chapter","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Biostatistics; Confounding; Proportional hazards model; Cognition; Public health; Epidemiology; Psychology; Survival analysis; Event (particle physics); Association (psychology); Variable (mathematics); Field (mathematics); Cognitive psychology; Medicine; Data science; Clinical psychology; Psychiatry; Computer science; Psychotherapist; Pathology; Mathematics","score_opus":0.6960210118581102,"score_gpt":0.5617264515334086,"score_spread":0.13429456032470155,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W70905468","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042749397,0.050155185,0.88687307,0.020091752,0.0010974588,0.000039946903,0.00036753234,0.00030465142,0.036795452],"genre_scores_gemma":[0.28459352,0.12718329,0.5181862,0.007683687,0.007734363,0.0002500362,0.00077794323,0.0005884552,0.053002577],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.998938,0.0006929065,0.000044205044,0.0001010154,0.00018416486,0.000039683044],"domain_scores_gemma":[0.9813649,0.017611546,0.00017116823,0.00030667955,0.0004391773,0.00010654523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0039719697,0.0008702472,0.0007964115,0.0017248391,0.00058682665,0.0022116895,0.0009376317,0.0014188557,0.0051301643],"category_scores_gemma":[0.01036193,0.00028006302,0.00088786415,0.0030525243,0.003374325,0.0026171382,0.0009934163,0.0034029894,0.0012855558],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000009331111,0.000027138061,0.000609592,0.00025107188,0.000033044773,0.000061885956,0.00029173467,0.002834124,0.000117927,0.8987283,0.018038874,0.07899693],"study_design_scores_gemma":[0.0000028462925,0.0000071900204,0.00029764103,0.000062825035,0.000008189926,0.00008392605,0.0000676273,0.004154763,0.00006277239,0.9718979,0.023346582,0.000007838305],"about_ca_topic_score_codex":0.0024489718,"about_ca_topic_score_gemma":0.0035589326,"teacher_disagreement_score":0.0051301643,"about_ca_system_score_codex":0.0011354284,"about_ca_system_score_gemma":0.0019195032,"threshold_uncertainty_score":0.021005988},"labels":[],"label_agreement":null},{"id":"W7092316930","doi":"","title":"Marginal Causal Effect Estimation with Continuous Instrumental Variables","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Toronto; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China; Canada Research Chairs","keywords":"Covariate; Instrumental variable; Semiparametric regression; Categorical variable; Parametric statistics; Semiparametric model; Nonparametric statistics; Conditional probability distribution; Observational study; Tangent","score_opus":0.03893167561380536,"score_gpt":0.3455048819014478,"score_spread":0.30657320628764245,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7092316930","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002631774,0.00020026292,0.99625176,0.00021020505,0.000019753803,0.00003494775,0.000104873,0.00011189307,0.0004345176],"genre_scores_gemma":[0.35073778,0.0013247688,0.6408135,0.00059565785,0.0002668162,0.0006689986,0.00097452686,0.0002165669,0.0044014435],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9941549,0.0041939863,0.0002092218,0.00068446307,0.0005715615,0.00018597643],"domain_scores_gemma":[0.9684866,0.025459073,0.001842688,0.0031740384,0.00074677594,0.0002907983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0116496505,0.0009617227,0.001759044,0.00204155,0.00046100604,0.0016421182,0.0027508563,0.0014295677,0.004712421],"category_scores_gemma":[0.050755173,0.00062977633,0.0021690817,0.0022336196,0.0023566217,0.002190415,0.0030614557,0.003423542,0.0006176046],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010576989,0.00011905726,0.007672494,0.00039497565,0.000493433,0.00027291346,0.00030602104,0.159243,0.0009639394,0.7199803,0.0026358205,0.10781222],"study_design_scores_gemma":[0.00005727812,0.00006757693,0.0014328178,0.000103383885,0.00012202958,0.00008604461,0.000064588225,0.4544716,0.00080602075,0.53844786,0.0043058875,0.000034901565],"about_ca_topic_score_codex":0.003019096,"about_ca_topic_score_gemma":0.00290856,"teacher_disagreement_score":0.0116496505,"about_ca_system_score_codex":0.0011555959,"about_ca_system_score_gemma":0.0022693996,"threshold_uncertainty_score":0.061609983},"labels":[],"label_agreement":null},{"id":"W7095972670","doi":"","title":"DOI:10.1093/aje/kwn299 Practice of Epidemiology Instrumental Variable Analysis for Estimation of Treatment Effects With Dichotomous","year":2008,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Instrumental variable; Estimation; Probit; Logistic regression; Confounding; Relative risk; Probit model; Ordinary least squares","score_opus":0.11487245325733503,"score_gpt":0.4224846246551371,"score_spread":0.30761217139780206,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7095972670","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0053947857,0.012727361,0.10969184,0.085720524,0.015231671,0.001383977,0.031544812,0.003141842,0.7351632],"genre_scores_gemma":[0.12969325,0.034305714,0.12813267,0.042734295,0.014006712,0.00341684,0.032011345,0.0035950022,0.6121041],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9945381,0.0028784126,0.00050678954,0.00046257346,0.0014100678,0.00020406516],"domain_scores_gemma":[0.9723718,0.015291959,0.0018863034,0.004193449,0.005001075,0.0012554183],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.0079790065,0.0006615146,0.001173328,0.004338034,0.00059414573,0.0040248954,0.0012005914,0.0031035228,0.42347348],"category_scores_gemma":[0.033653986,0.00066022243,0.0008357769,0.004178927,0.0016792183,0.0028536997,0.0030819145,0.003704934,0.24285896],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022621687,0.00036015906,0.0070735635,0.0010256611,0.0001677432,0.00043561464,0.00009964022,0.0009219974,0.0007920149,0.035917304,0.5125979,0.4403821],"study_design_scores_gemma":[0.00015832989,0.0001372173,0.015299203,0.0018612185,0.000058692225,0.0016171494,0.00015767127,0.0028092545,0.0004695835,0.045176618,0.93220294,0.000052083],"about_ca_topic_score_codex":0.0025346822,"about_ca_topic_score_gemma":0.0035378293,"teacher_disagreement_score":0.42347348,"about_ca_system_score_codex":0.0012960216,"about_ca_system_score_gemma":0.0026452218,"threshold_uncertainty_score":0.82234514},"labels":[],"label_agreement":null},{"id":"W7096152232","doi":"","title":"Determinants of General Practitioner Utilization: Controlling for Unobserved Heterogeneity∗","year":2007,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nonparametric statistics; Socioeconomic status; Estimator; Parametric statistics; Kernel density estimation; Control (management); Longitudinal data; Semiparametric regression","score_opus":0.32197166175481706,"score_gpt":0.47722627791864947,"score_spread":0.1552546161638324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7096152232","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7394307,0.0014696452,0.25256622,0.0021013804,0.000059666694,0.00017112271,0.0015559748,0.00022053834,0.0024247712],"genre_scores_gemma":[0.98953587,0.00027233016,0.00894069,0.000036793328,0.000027035996,0.000045921537,0.00043078227,0.000010609937,0.0006999458],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9969458,0.0018044203,0.00012090695,0.00039369919,0.00039431316,0.00034094122],"domain_scores_gemma":[0.9719134,0.023348236,0.0024588301,0.0013629555,0.00065068377,0.00026593456],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0075711943,0.00036630483,0.0008119677,0.0013711237,0.00045740596,0.0014332174,0.0010242523,0.0007674459,0.002405955],"category_scores_gemma":[0.038642555,0.00037390323,0.0013598455,0.0024412095,0.0006941662,0.0011748294,0.0010499787,0.0011956226,0.00013589022],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023660553,0.0003467606,0.6977409,0.00019900512,0.0013155851,0.0007833886,0.00092276436,0.13497181,0.00049086974,0.06286258,0.0028425409,0.09728718],"study_design_scores_gemma":[0.00007528912,0.00012410803,0.2959785,0.000120273115,0.0005686973,0.00027915018,0.00051358587,0.64670235,0.00039587176,0.052422903,0.002757379,0.00006186243],"about_ca_topic_score_codex":0.13313358,"about_ca_topic_score_gemma":0.06787996,"teacher_disagreement_score":0.13313358,"about_ca_system_score_codex":0.0016892087,"about_ca_system_score_gemma":0.0031134288,"threshold_uncertainty_score":0.26471734},"labels":[],"label_agreement":null},{"id":"W7096490722","doi":"","title":"Explaining and Forecasting Results of the Self-Sufficiency Project,” research report, Social Research Demonstration Corporation, http://www.srdc.org","year":2015,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Counterfactual conditional; Social research; Welfare; Corporation; Market research; Value (mathematics); Control (management); Variation (astronomy); Applied research; Estimation","score_opus":0.7019742623877581,"score_gpt":0.5339549103549789,"score_spread":0.16801935203277918,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7096490722","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.51416093,0.0031672695,0.28451252,0.060109776,0.001337873,0.0017046254,0.050243802,0.003497164,0.08126593],"genre_scores_gemma":[0.8086034,0.00200128,0.13323407,0.00088432076,0.0001590238,0.0009107803,0.019985411,0.00064837665,0.033573296],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.99848086,0.0009649917,0.00004965052,0.00012297145,0.00027834676,0.0001033083],"domain_scores_gemma":[0.9937109,0.003983385,0.0004934827,0.0005651325,0.0010311974,0.000215873],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011808117,0.00052371406,0.0002607698,0.0010894577,0.00046707195,0.001196171,0.00091035484,0.00095794623,0.009494206],"category_scores_gemma":[0.017980264,0.00038669657,0.00066807494,0.0009860783,0.00053318613,0.0015170765,0.0007338196,0.001211476,0.0015682657],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00078915927,0.00095661014,0.12590533,0.0003445841,0.00015872008,0.0005120108,0.0016810683,0.15176697,0.0017403512,0.12889679,0.36207998,0.22516844],"study_design_scores_gemma":[0.00030751215,0.0006158827,0.08095848,0.00031941064,0.00010071628,0.00012323739,0.0011180682,0.6997257,0.0066713034,0.09407474,0.1158263,0.00015867986],"about_ca_topic_score_codex":0.024314307,"about_ca_topic_score_gemma":0.02154914,"teacher_disagreement_score":0.024314307,"about_ca_system_score_codex":0.0016578039,"about_ca_system_score_gemma":0.0016142143,"threshold_uncertainty_score":0.062448025},"labels":[],"label_agreement":null},{"id":"W7096775292","doi":"","title":"Assignment and Outcome Measurement in Field Experiments Strategies for Dealing with the Problem of Non-overlapping Units of Published by:","year":2016,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Field (mathematics); Outcome (game theory); Unit (ring theory); Interpretation (philosophy); Range (aeronautics)","score_opus":0.19840938938600078,"score_gpt":0.39266774091391776,"score_spread":0.19425835152791698,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7096775292","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037864717,0.00032014571,0.989666,0.0012168234,0.00027880684,0.0022631616,0.00021009911,0.00016534125,0.0020931482],"genre_scores_gemma":[0.09180771,0.00034178773,0.87739867,0.0011026826,0.00044126177,0.026487663,0.0002979224,0.00008837809,0.0020339137],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.42332703,0.51919985,0.011803181,0.028825857,0.015084379,0.0017597188],"domain_scores_gemma":[0.29999524,0.5500699,0.04072773,0.09737846,0.010049298,0.0017793857],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.39270487,0.004009438,0.008858404,0.0054702656,0.005523049,0.007879729,0.010386613,0.009178733,0.015318375],"category_scores_gemma":[0.56743854,0.003877908,0.0049240733,0.008331921,0.017803056,0.012676241,0.010249439,0.011745885,0.0022932605],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015197452,0.0007548545,0.007254746,0.0020558944,0.0021056153,0.0003133013,0.0052503436,0.016779264,0.0010603897,0.80466247,0.00450677,0.15373656],"study_design_scores_gemma":[0.0010858773,0.0007262222,0.0028279284,0.00043116623,0.00042267292,0.00014673246,0.00053622545,0.046849143,0.0013202095,0.93588096,0.009641217,0.00013160969],"about_ca_topic_score_codex":0.004091855,"about_ca_topic_score_gemma":0.0021116622,"teacher_disagreement_score":0.60729516,"about_ca_system_score_codex":0.0066629103,"about_ca_system_score_gemma":0.0066211643,"threshold_uncertainty_score":0.74890304},"labels":[],"label_agreement":null},{"id":"W7097889624","doi":"","title":"Practice of Epidemiology Immeasurable Time Bias in Observational Studies of Drug Effects on Mortality","year":2007,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Observational study; Epidemiology; Confidence interval; Cohort study; Medical prescription; Rate ratio; Drug; Cohort; Incidence (geometry)","score_opus":0.61656767343931,"score_gpt":0.5529522668860143,"score_spread":0.06361540655329567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7097889624","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01009211,0.048902296,0.7644671,0.13490072,0.020513663,0.0041577388,0.0011057524,0.0012226725,0.014637885],"genre_scores_gemma":[0.19928512,0.028985053,0.65447575,0.0709199,0.028938979,0.011838343,0.0006763236,0.0006539749,0.004226503],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.20288767,0.70449,0.04486457,0.018030487,0.028526327,0.0012009054],"domain_scores_gemma":[0.09355165,0.7581548,0.040490583,0.06929814,0.036477864,0.00202694],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6208899,0.003068178,0.0066062678,0.017826173,0.0040137535,0.012994486,0.007951314,0.010930351,0.002814518],"category_scores_gemma":[0.802057,0.003327616,0.0043149972,0.016438367,0.030269621,0.0104337465,0.010746704,0.018512927,0.0021393886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011012417,0.00040123265,0.10075248,0.02214472,0.008941474,0.0026173212,0.03235592,0.0049174144,0.0016941006,0.19111972,0.16133712,0.47261733],"study_design_scores_gemma":[0.0011389565,0.00079414604,0.03294373,0.03747837,0.0021410221,0.0063680387,0.009888163,0.014388845,0.0033772504,0.59388536,0.29692268,0.0006735172],"about_ca_topic_score_codex":0.0038815644,"about_ca_topic_score_gemma":0.0037655728,"teacher_disagreement_score":0.3791101,"about_ca_system_score_codex":0.004017062,"about_ca_system_score_gemma":0.012316264,"threshold_uncertainty_score":0.46751028},"labels":[],"label_agreement":null},{"id":"W7099779233","doi":"","title":"6. Performing Organization Code","year":2001,"lang":"en","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Crash; Visibility; Service (business); Highway system; Population; Unit (ring theory); Highway maintenance","score_opus":0.16120023130824954,"score_gpt":0.4118109641177616,"score_spread":0.25061073280951207,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7099779233","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025902172,0.0010309522,0.03757698,0.0118457675,0.035688847,0.01708124,0.18069588,0.030855557,0.68263453],"genre_scores_gemma":[0.016626416,0.0021405155,0.04781388,0.004541538,0.0050515346,0.0173704,0.18570295,0.010649786,0.710103],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98395085,0.0021385031,0.0032852297,0.0024357715,0.005780628,0.0024091029],"domain_scores_gemma":[0.8450227,0.009212398,0.0073332936,0.02624812,0.102796234,0.009387308],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.01024883,0.0032611578,0.0038573823,0.012660282,0.003505735,0.0112502305,0.0058393436,0.003765877,0.7971881],"category_scores_gemma":[0.09228707,0.0014052264,0.0017334628,0.014996317,0.0017614386,0.0040326887,0.004244595,0.0031887023,0.8068189],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009897652,0.0000553862,0.0005918895,0.00064536545,0.000008367227,0.00007098069,0.00013568049,0.00031634915,0.00030302414,0.005828696,0.9245736,0.0673717],"study_design_scores_gemma":[0.000067245186,0.000086951644,0.0029263345,0.0008281916,0.000010661927,0.00014616101,0.0002811889,0.0006685978,0.00035098701,0.0041297046,0.99046165,0.000042469044],"about_ca_topic_score_codex":0.008318028,"about_ca_topic_score_gemma":0.0037670867,"teacher_disagreement_score":0.2028119,"about_ca_system_score_codex":0.0046835425,"about_ca_system_score_gemma":0.014349697,"threshold_uncertainty_score":0.28928655},"labels":[],"label_agreement":null},{"id":"W7103204351","doi":"","title":"Causal Inference with Groupwise Matching","year":2025,"lang":"","type":"article","venue":"ArXiv.org","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Innovation Council; University of British Columbia","funders":"","keywords":"Matching (statistics); Causal inference; Inference; Extrapolation; Regret; Synthetic data; Parametric statistics; Fiducial inference","score_opus":0.11097318758821531,"score_gpt":0.3973181470675166,"score_spread":0.2863449594793013,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7103204351","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059705162,0.00016483747,0.99179673,0.00043149278,0.000083941006,0.00016881843,0.00008874363,0.00009933242,0.0011955063],"genre_scores_gemma":[0.431546,0.00039639045,0.56315917,0.0006038816,0.0003616446,0.0013018583,0.00031676987,0.0000766122,0.0022376261],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9294236,0.059432533,0.0013908503,0.005234647,0.0039166478,0.0006017709],"domain_scores_gemma":[0.7740773,0.18277355,0.011518448,0.027158534,0.0038906604,0.0005815742],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08002119,0.0012217602,0.0021420554,0.002783947,0.0014168014,0.0020365152,0.0041021355,0.002724515,0.0072327056],"category_scores_gemma":[0.24877006,0.00074705447,0.0022532372,0.0030087123,0.0061402163,0.0047695828,0.0033736692,0.0034640916,0.0005800301],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002904735,0.00014677527,0.0038106828,0.0002507565,0.00039150415,0.000111703666,0.0003511166,0.048564523,0.00037285086,0.8787956,0.001140725,0.06577329],"study_design_scores_gemma":[0.00016934083,0.0001732887,0.0006647771,0.000051156967,0.000097738695,0.00007667188,0.000060571405,0.23142685,0.0011389125,0.7636235,0.0024869342,0.000030246607],"about_ca_topic_score_codex":0.0020123809,"about_ca_topic_score_gemma":0.0010309058,"teacher_disagreement_score":0.08002119,"about_ca_system_score_codex":0.0024091534,"about_ca_system_score_gemma":0.0027454018,"threshold_uncertainty_score":0.42319757},"labels":[],"label_agreement":null},{"id":"W7103389697","doi":"","title":"Identifiable Causal Inference with Noisy Treatment and No Side Information","year":2024,"lang":"en","type":"article","venue":"Aaltodoc (Aalto University)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"Horizon 2020 Framework Programme; Finnish Center for Artificial Intelligence","keywords":"Inference; Pattern recognition (psychology); Identification (biology); Noise (video); Complete information; Noisy data; Causality (physics); Interpretation (philosophy)","score_opus":0.05382096482297451,"score_gpt":0.32067245357116436,"score_spread":0.26685148874818987,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7103389697","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008552829,0.0014452552,0.95999223,0.013556081,0.00083325774,0.00046107091,0.0034845187,0.0005819096,0.01109283],"genre_scores_gemma":[0.6320547,0.0023314073,0.31048456,0.005169278,0.002806368,0.0021862958,0.0032507034,0.00046257203,0.041254126],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94596624,0.04260241,0.001504313,0.0054133553,0.003148426,0.0013652064],"domain_scores_gemma":[0.7316097,0.23424198,0.009014636,0.021388534,0.002685383,0.0010598782],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04644388,0.0023827336,0.0053229164,0.00248787,0.0016626953,0.004257406,0.004059324,0.0075562545,0.026742175],"category_scores_gemma":[0.1938378,0.0031289554,0.0038868703,0.0023889826,0.0051338673,0.00650553,0.0045161746,0.010109485,0.0030624368],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001587757,0.00031681178,0.002290261,0.00094623124,0.0009848566,0.00083970994,0.0004293062,0.04453308,0.00026890828,0.8726979,0.018022977,0.05708217],"study_design_scores_gemma":[0.00035674984,0.000052423526,0.00035810648,0.00009533482,0.00018982425,0.00013428359,0.000027676362,0.056407966,0.0002340967,0.9394439,0.002676983,0.000022725695],"about_ca_topic_score_codex":0.0037016126,"about_ca_topic_score_gemma":0.0033305823,"teacher_disagreement_score":0.04644388,"about_ca_system_score_codex":0.002484326,"about_ca_system_score_gemma":0.0054715397,"threshold_uncertainty_score":0.24562162},"labels":[],"label_agreement":null},{"id":"W7103418229","doi":"","title":"Can Contemporary Large Language Models Provide the Domain Knowledge Needed for Causal Inference? Evaluating Automated Causal Graph Discovery Through an ASCVD Case Study","year":2025,"lang":"en","type":"article","venue":"DOAJ (DOAJ: Directory of Open Access Journals)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Population and Public Health","funders":"","keywords":"Causal inference; Directed acyclic graph; Inference; Consistency (knowledge bases); Population; Public health; Baseline (sea); Population health; Epidemiology","score_opus":0.5429744453255869,"score_gpt":0.6576209819113161,"score_spread":0.11464653658572921,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7103418229","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5944991,0.0015971179,0.384634,0.00862811,0.00023002028,0.0013382589,0.0037603031,0.0011820447,0.0041310843],"genre_scores_gemma":[0.76811916,0.00041415324,0.22700712,0.0006797695,0.00008325672,0.0009156297,0.002273756,0.00011570621,0.00039142845],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.95289063,0.040714208,0.0015567308,0.0021868586,0.002167803,0.0004837497],"domain_scores_gemma":[0.32301366,0.6488119,0.006254802,0.016108908,0.005041034,0.0007697189],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06304328,0.0010871042,0.00096738077,0.0022161945,0.0010866123,0.0026868735,0.0030401177,0.0024667624,0.00407087],"category_scores_gemma":[0.34394792,0.0011151901,0.0020944264,0.0020832731,0.0022989297,0.005862817,0.002631759,0.0034197597,0.00045442895],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005347824,0.0024649457,0.15020628,0.0029769056,0.0013559007,0.0024020998,0.0070492215,0.50032616,0.0022799086,0.06097116,0.01247256,0.25214708],"study_design_scores_gemma":[0.000918624,0.0006111616,0.0056490875,0.00036634444,0.0003274385,0.00030377714,0.0013880078,0.87982315,0.0022325898,0.10030393,0.008006564,0.000069208945],"about_ca_topic_score_codex":0.007836394,"about_ca_topic_score_gemma":0.014642711,"teacher_disagreement_score":0.9369567,"about_ca_system_score_codex":0.002974037,"about_ca_system_score_gemma":0.0036475374,"threshold_uncertainty_score":0.3334087},"labels":[],"label_agreement":null},{"id":"W7108076363","doi":"10.2196/76961","title":"Methodological Development and Assessing Prescribing Determinants Through Cumulative Drug Exposure in Hospitalized Patients: Proof-of-Concept Retrospective Study","year":2025,"lang":"en","type":"article","venue":"JMIR Medical Informatics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"MEDLINE; Drug; Risk assessment; Medication adherence","score_opus":0.17916804686598872,"score_gpt":0.46887480677739346,"score_spread":0.2897067599114047,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7108076363","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5175213,0.0027738903,0.42521623,0.0007503857,0.00030320472,0.046815567,0.0034439664,0.00031349476,0.0028619308],"genre_scores_gemma":[0.5826797,0.0008487544,0.3811514,0.0007274246,0.0001748885,0.032686453,0.0013950649,0.000069663496,0.0002666628],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.83863187,0.1234008,0.016242236,0.0065422487,0.014253298,0.0009295186],"domain_scores_gemma":[0.5989018,0.23631415,0.048864085,0.067961805,0.046057496,0.0019006736],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21613063,0.001419614,0.0011642189,0.0020224834,0.00097432325,0.0024298308,0.0025267212,0.0013506558,0.001874346],"category_scores_gemma":[0.34256572,0.001100969,0.0031134184,0.0017512561,0.0017451986,0.0015780403,0.002534828,0.0011858185,0.00043016634],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012096282,0.009461382,0.65346116,0.0073480024,0.007730817,0.0009018282,0.0073204166,0.01467589,0.006847214,0.011791674,0.0041432185,0.2642221],"study_design_scores_gemma":[0.015125891,0.1452077,0.5586905,0.007203377,0.017274655,0.006964887,0.012138004,0.10945084,0.044999592,0.014691971,0.06719104,0.0010615896],"about_ca_topic_score_codex":0.003179966,"about_ca_topic_score_gemma":0.0021489013,"teacher_disagreement_score":0.21613063,"about_ca_system_score_codex":0.0018591222,"about_ca_system_score_gemma":0.008245899,"threshold_uncertainty_score":0.9666505},"labels":[],"label_agreement":null},{"id":"W7108206144","doi":"10.2139/ssrn.5713122","title":"Data to DAGs to Dividends: A Scalable, LLM-Driven Pipeline for Causal Inference in Sustainability","year":2025,"lang":"","type":"preprint","venue":"SSRN Electronic Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Counterfactual thinking; Causal inference; Directed acyclic graph; Causal model; Observational study; Pipeline (software); Causal structure; Causality (physics); Inference","score_opus":0.15915348638800397,"score_gpt":0.4593264446126412,"score_spread":0.30017295822463724,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7108206144","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006936148,0.00048696357,0.90938497,0.0013788805,0.00023558487,0.00028570957,0.015926166,0.06161281,0.0037527853],"genre_scores_gemma":[0.14225052,0.00043234965,0.82117105,0.0007214043,0.00014894477,0.00050172047,0.023598343,0.0052166292,0.005959118],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988644,0.00032629565,0.0001035687,0.00030242698,0.00031084233,0.00009251138],"domain_scores_gemma":[0.99318403,0.004627532,0.00021482805,0.0012212426,0.0005378349,0.0002145369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025468573,0.0014053843,0.00145007,0.0031186873,0.0012193902,0.004084373,0.0028161954,0.0015792241,0.03696499],"category_scores_gemma":[0.027148603,0.0014290498,0.0036853116,0.0029287864,0.00089850253,0.0055390242,0.0043107998,0.003284461,0.008227005],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073039444,0.0004175835,0.008681096,0.0018068206,0.0004563013,0.0006655983,0.00110761,0.16379069,0.0046516373,0.15384446,0.11979265,0.54405516],"study_design_scores_gemma":[0.00013020453,0.000034488923,0.0006587486,0.0001045064,0.000060909235,0.000059827715,0.0002183255,0.6306798,0.0028989885,0.3309032,0.034212008,0.000039042625],"about_ca_topic_score_codex":0.01245099,"about_ca_topic_score_gemma":0.034643494,"teacher_disagreement_score":0.03696499,"about_ca_system_score_codex":0.0016648268,"about_ca_system_score_gemma":0.0036918162,"threshold_uncertainty_score":0.12366021},"labels":[],"label_agreement":null},{"id":"W7108457069","doi":"10.1201/9781003504795","title":"Causal Inference and Machine Learning","year":2025,"lang":"en","type":"book","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Causal inference; Raw data; Algorithmic learning theory; Deep learning; Inference; Artificial neural network; Computational learning theory; Active learning (machine learning); CLARITY","score_opus":0.12736591936775193,"score_gpt":0.40030138652418956,"score_spread":0.27293546715643763,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7108457069","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038499944,0.09088206,0.6718136,0.10978112,0.0059843636,0.00026090036,0.0014583125,0.00076068274,0.11520898],"genre_scores_gemma":[0.39604142,0.12780575,0.35318094,0.037944276,0.023371033,0.0022657402,0.002925776,0.000821343,0.05564366],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97982085,0.014121177,0.0007574078,0.002324143,0.0023864838,0.0005898782],"domain_scores_gemma":[0.9311882,0.06203055,0.0020180573,0.0027972725,0.0015952185,0.0003706166],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019460782,0.0018891601,0.0024425,0.00401902,0.0017661578,0.007236932,0.0027861095,0.0060496437,0.014200161],"category_scores_gemma":[0.061706305,0.0011043445,0.0021854327,0.0044471086,0.013806469,0.008599544,0.003787906,0.009455496,0.0022037716],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012362992,0.0000108849645,0.00039477056,0.0003134042,0.000093260925,0.00007143481,0.00021006474,0.003178866,0.000027734643,0.9579296,0.013172894,0.024584632],"study_design_scores_gemma":[0.000008628456,0.000005949341,0.00014564091,0.00021024497,0.0000135053715,0.0000417646,0.00004837456,0.0035375557,0.00002965762,0.9752744,0.020673681,0.0000106642565],"about_ca_topic_score_codex":0.0047396813,"about_ca_topic_score_gemma":0.0030009015,"teacher_disagreement_score":0.019460782,"about_ca_system_score_codex":0.0050376835,"about_ca_system_score_gemma":0.0044418992,"threshold_uncertainty_score":0.1029197},"labels":[],"label_agreement":null},{"id":"W7108721199","doi":"10.1182/blood-2025-6025","title":"Propensity score matching analysis comparing the efficacy and long-term outcomes of belumosudil to the best available treatment as a historical control, used as second-line therapy or beyond for chronic GVHD after steroid failure.","year":2025,"lang":"en","type":"article","venue":"Blood","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia; Hôpital Maisonneuve-Rosemont; University Health Network; Saskatchewan Cancer Agency; Princess Margaret Cancer Centre; University of Calgary; McMaster University; University of Toronto; Hamilton Health Sciences; Université de Montréal; Université Laval; BC Cancer Agency","funders":"","keywords":"Propensity score matching; Confounding; Randomized controlled trial; Clinical trial; Statistical significance; Sample size determination; Meta-analysis; Retrospective cohort study","score_opus":0.13267534313174487,"score_gpt":0.36915146620153577,"score_spread":0.2364761230697909,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7108721199","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9950069,0.001067994,0.0027055098,0.000060661918,0.00004059085,0.00016786408,0.00062384066,0.000012843126,0.0003137813],"genre_scores_gemma":[0.9985671,0.000086958615,0.0005112845,0.000024730953,0.000015282401,0.000092550894,0.0005701528,0.0000025895345,0.00012930133],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9972825,0.0012849515,0.00046186132,0.00043446323,0.00033549222,0.00020068436],"domain_scores_gemma":[0.9957898,0.0011798867,0.0019938683,0.00058776955,0.00022574578,0.00022292604],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005070476,0.00023439269,0.0007220622,0.0011757084,0.00028467586,0.0004387669,0.00038067176,0.000365347,0.0018940765],"category_scores_gemma":[0.00684266,0.00012541594,0.0017619502,0.0010520297,0.00035948466,0.00034099226,0.0004797177,0.0003550923,0.00012636163],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.042175062,0.00064579217,0.90489656,0.00032658657,0.0045575006,0.00017480535,0.00014987642,0.004495476,0.0015487133,0.0008688886,0.001168772,0.038992018],"study_design_scores_gemma":[0.0017640146,0.008676505,0.9588016,0.00005278024,0.0030850281,0.00039567705,0.00017630366,0.021515049,0.0014919837,0.0010528883,0.0029472345,0.00004088799],"about_ca_topic_score_codex":0.0011963191,"about_ca_topic_score_gemma":0.00090460584,"teacher_disagreement_score":0.005070476,"about_ca_system_score_codex":0.00088568503,"about_ca_system_score_gemma":0.00074723887,"threshold_uncertainty_score":0.026815593},"labels":[],"label_agreement":null},{"id":"W7113584415","doi":"","title":"MENTAL HEALTH ON THE MOVE: THE EFFECTS OF RELOCATION ON THE PSYCHOLOGICAL AND BEHAVIORAL HEALTH OF MILITARY CHILDREN","year":2025,"lang":"","type":"dissertation","venue":"Calhoun: The Naval Postgraduate School Institutional Archive (Naval Postgraduate School)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Relocation; Medical diagnosis; Mental health; Quarter (Canadian coin); Occupational safety and health; Suicide prevention; Military service","score_opus":0.06045519143712694,"score_gpt":0.3893842763711599,"score_spread":0.32892908493403294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7113584415","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9950446,0.0004811438,0.00022336548,0.0016141856,0.000045457808,0.000022218117,0.0012685824,0.000008845952,0.0012916079],"genre_scores_gemma":[0.99635196,0.00047130327,0.00021582283,0.00022051024,0.00004357664,0.000036138576,0.0011089353,0.0000051535167,0.0015465316],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9980551,0.0009747704,0.00006436856,0.00025514822,0.00012869167,0.00052196434],"domain_scores_gemma":[0.9913873,0.0037693281,0.0031762123,0.00039256964,0.00019592117,0.0010786933],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002202281,0.00033433628,0.0004362893,0.0006102616,0.0008475056,0.0014921814,0.0010159904,0.00097049,0.0078700995],"category_scores_gemma":[0.009911227,0.0002727492,0.0014664563,0.0010525099,0.0008424087,0.0008165848,0.0024372914,0.0025302845,0.00054248585],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047330922,0.00022595742,0.98543453,0.0000406263,0.000589847,0.0002703851,0.00069309934,0.001908114,0.000110424466,0.0007405228,0.0019320907,0.0075811637],"study_design_scores_gemma":[0.00003688078,0.00027449208,0.99325377,0.000050705956,0.000260079,0.00004905524,0.0030083656,0.0016169299,0.00010510687,0.0002740085,0.0010598707,0.000010744729],"about_ca_topic_score_codex":0.1322796,"about_ca_topic_score_gemma":0.15284891,"teacher_disagreement_score":0.1322796,"about_ca_system_score_codex":0.0017186751,"about_ca_system_score_gemma":0.0011728063,"threshold_uncertainty_score":0.26301932},"labels":[],"label_agreement":null},{"id":"W7115173317","doi":"10.1002/agj2.70260","title":"Improving causal inference from unreplicated on‐farm strip trials with propensity score matching: Application to plant growth regulator effects in wheat","year":2025,"lang":"en","type":"article","venue":"Agronomy Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Canada First Research Excellence Fund","keywords":"Propensity score matching; Covariate; Causal inference; Restricted randomization; Matching (statistics); Confounding; Replication (statistics); Benchmark (surveying); Inference; Randomization","score_opus":0.11446913192230342,"score_gpt":0.36258325031259675,"score_spread":0.24811411839029335,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115173317","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07160831,0.0008741804,0.92347676,0.0009048863,0.00015390608,0.0012537806,0.00035373846,0.00048395296,0.00089048914],"genre_scores_gemma":[0.5905214,0.00048511787,0.4052805,0.00059906975,0.00017277675,0.0018803426,0.00038700728,0.00008948908,0.00058434746],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8227781,0.16335128,0.003446118,0.0062259124,0.0034829013,0.00071559765],"domain_scores_gemma":[0.48774034,0.45821255,0.020756874,0.027007882,0.005169845,0.0011124476],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.18377852,0.0012613155,0.0026816167,0.0022620384,0.0011774489,0.0020380004,0.0031785485,0.0020061047,0.004936343],"category_scores_gemma":[0.36586478,0.0010368273,0.0039796666,0.0034092455,0.002365649,0.0022552868,0.004427348,0.002960607,0.000265114],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.006289446,0.0016733559,0.10470835,0.0026610713,0.0109788515,0.00076365547,0.0012887589,0.28478205,0.0019289618,0.08418902,0.005031026,0.49570543],"study_design_scores_gemma":[0.0017088397,0.0021063462,0.023691325,0.00044018833,0.0027114148,0.00016773537,0.00020571367,0.7826411,0.0020748645,0.17939232,0.0047523254,0.00010786158],"about_ca_topic_score_codex":0.004238968,"about_ca_topic_score_gemma":0.0026497925,"teacher_disagreement_score":0.8162215,"about_ca_system_score_codex":0.0015170209,"about_ca_system_score_gemma":0.0031910616,"threshold_uncertainty_score":0.9719254},"labels":[],"label_agreement":null},{"id":"W7115439340","doi":"","title":"Designing and Delivering Randomised Trials for Social Policy","year":2025,"lang":"en","type":"book","venue":"Research Portal (King's College London)","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact","funders":"","keywords":"Social policy; Public policy; Government (linguistics); Social care","score_opus":0.35671502083019047,"score_gpt":0.5101082543132096,"score_spread":0.15339323348301914,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115439340","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00044883913,0.009472579,0.9196545,0.0071887714,0.0017883519,0.007130985,0.0036923806,0.005949048,0.04467462],"genre_scores_gemma":[0.008882851,0.005556252,0.94196457,0.0020324795,0.0007561761,0.022828076,0.0010867497,0.0017402488,0.015152541],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.84004694,0.1415023,0.0062896865,0.0026879918,0.008917993,0.0005551097],"domain_scores_gemma":[0.49374598,0.48311827,0.0056638704,0.011969467,0.004310619,0.001191868],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11749859,0.0026432376,0.0043333718,0.0039190636,0.0009375218,0.006571349,0.002897293,0.0050826,0.12103762],"category_scores_gemma":[0.34714478,0.004092102,0.002280518,0.00415996,0.004026184,0.005577825,0.0044073127,0.0065805046,0.037286274],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010406894,0.00013247112,0.00024147745,0.009600574,0.00054710434,0.00008024939,0.00066894904,0.005880263,0.0007469797,0.21381766,0.18944639,0.5777971],"study_design_scores_gemma":[0.0023158386,0.0004096842,0.0002988873,0.004882574,0.00035019495,0.00013727204,0.0001751652,0.014061624,0.0015325733,0.7037297,0.2719979,0.00010854349],"about_ca_topic_score_codex":0.0014549543,"about_ca_topic_score_gemma":0.0020556424,"teacher_disagreement_score":0.8825014,"about_ca_system_score_codex":0.0034517974,"about_ca_system_score_gemma":0.007899388,"threshold_uncertainty_score":0.6213994},"labels":[],"label_agreement":null},{"id":"W7115574149","doi":"10.3138/ptc-2023-0034-cc","title":"Commentary on Mandel et al.","year":2025,"lang":"en","type":"article","venue":"Physiotherapy Canada","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"","score_opus":0.04361432301448193,"score_gpt":0.4141295529163176,"score_spread":0.37051522990183566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115574149","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000030051968,0.0019821818,0.00005509919,0.9586094,0.03839752,0.000008729706,0.0001091325,0.000011366598,0.0007965744],"genre_scores_gemma":[0.0005446768,0.0011890153,0.000118181015,0.96475875,0.031616952,0.00004492611,0.000032318723,0.000023031755,0.0016722061],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9770685,0.00675567,0.002475223,0.0032855908,0.008815887,0.0015990601],"domain_scores_gemma":[0.85332674,0.09925244,0.0032192552,0.0026984448,0.03499116,0.00651195],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027561566,0.0016039235,0.0038981966,0.0026530116,0.008975121,0.0085577965,0.010601143,0.075520046,0.015571399],"category_scores_gemma":[0.2046481,0.0016903066,0.0037319437,0.003336246,0.010064703,0.007959566,0.003890202,0.09558236,0.010673915],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000017262555,0.0000028292961,0.000021542459,0.00006180143,0.000010770762,0.000027369431,0.00004976087,0.000012385041,0.000006873718,0.001371043,0.9972474,0.0011708792],"study_design_scores_gemma":[0.00015348161,0.000015165422,0.0003404671,0.001508525,0.00008713617,0.00018973301,0.0002851366,0.00011779566,0.000116366915,0.011075518,0.98603487,0.0000758128],"about_ca_topic_score_codex":0.09415732,"about_ca_topic_score_gemma":0.116550945,"teacher_disagreement_score":0.09415732,"about_ca_system_score_codex":0.015049314,"about_ca_system_score_gemma":0.029964656,"threshold_uncertainty_score":0.18721855},"labels":[],"label_agreement":null},{"id":"W7115592647","doi":"10.3138/ptc-2023-0076-cc","title":"Commentary on Dhir et al.","year":2025,"lang":"en","type":"article","venue":"Physiotherapy Canada","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Canadian Physiotherapy Association","funders":"","keywords":"","score_opus":0.04247798333957591,"score_gpt":0.415432769188336,"score_spread":0.3729547858487601,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7115592647","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000027365943,0.0018180073,0.000051281306,0.9534272,0.043649834,0.000010321059,0.00013530526,0.000012014982,0.00086864515],"genre_scores_gemma":[0.00048047284,0.0012421237,0.000092446906,0.9630476,0.033250365,0.0000426267,0.000041204094,0.000024485504,0.0017786779],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.97805333,0.006429877,0.0023347158,0.0028600243,0.008629767,0.0016923782],"domain_scores_gemma":[0.865701,0.08490527,0.00323665,0.0024875693,0.036100846,0.0075687035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025821993,0.0016191956,0.0037172823,0.0025857843,0.0090430435,0.00936668,0.010054937,0.0749736,0.01943105],"category_scores_gemma":[0.1927452,0.0015895065,0.003835791,0.0035243493,0.0090788575,0.007786778,0.0041570705,0.09054801,0.012862493],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014334274,0.0000027306273,0.000018899547,0.00005511731,0.000009300931,0.000023235203,0.000042826287,0.000010253001,0.0000055232567,0.00085535314,0.99795914,0.0010032293],"study_design_scores_gemma":[0.00014564891,0.000014022697,0.00030160166,0.0013730408,0.00007771491,0.00015497566,0.000296228,0.00009524999,0.00008532025,0.007818097,0.9895739,0.00006414706],"about_ca_topic_score_codex":0.09828044,"about_ca_topic_score_gemma":0.12060166,"teacher_disagreement_score":0.09828044,"about_ca_system_score_codex":0.014809509,"about_ca_system_score_gemma":0.0317751,"threshold_uncertainty_score":0.19541675},"labels":[],"label_agreement":null},{"id":"W7116858593","doi":"10.1016/j.cjca.2025.12.016","title":"Probabilistic Quantitative Bias Analysis for Misclassification and Uncontrolled Confounding: A Methodological Tutorial Using Real-World Data","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Cardiology","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Calgary; Public Health Ontario","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Reliability (semiconductor); Probabilistic logic; Interpretation (philosophy); Statistical model; Estimation","score_opus":0.7201891238127621,"score_gpt":0.5461579239240665,"score_spread":0.17403119988869564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7116858593","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0001553903,0.0025808662,0.9957612,0.0010074489,0.0001003724,0.000054465254,0.00005143293,0.00008643668,0.00020243843],"genre_scores_gemma":[0.023288308,0.007671408,0.96304023,0.0015767218,0.0010771829,0.0014097148,0.00021578862,0.00030532118,0.001415316],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9004976,0.085698664,0.0041785426,0.003993975,0.005167001,0.00046432103],"domain_scores_gemma":[0.57728076,0.399687,0.00539414,0.011189773,0.005949385,0.00049883756],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15789807,0.0028891347,0.004200891,0.004399338,0.0011761137,0.0042366316,0.0066272453,0.0058594886,0.00627074],"category_scores_gemma":[0.32163545,0.0023651246,0.007518081,0.004948021,0.005800912,0.0064746733,0.005068595,0.012872827,0.0012636556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012659677,0.00013855622,0.002799137,0.0032867303,0.0024015864,0.00038664133,0.000866925,0.033073,0.0010424418,0.76211864,0.0133288205,0.18043086],"study_design_scores_gemma":[0.00010379377,0.000108279586,0.0007166836,0.0008936006,0.00046739544,0.0006236904,0.000113025424,0.10138516,0.00085457397,0.8763675,0.018256988,0.00010929516],"about_ca_topic_score_codex":0.003917225,"about_ca_topic_score_gemma":0.002855855,"teacher_disagreement_score":0.84210193,"about_ca_system_score_codex":0.0025051618,"about_ca_system_score_gemma":0.004617262,"threshold_uncertainty_score":0.83505476},"labels":[],"label_agreement":null},{"id":"W7117117856","doi":"10.54254/2753-8818/2026.ch30759","title":"Causal Inference with Observational Data via Propensity Score Matching: A Simple, Hands‑On Guide","year":2025,"lang":"","type":"article","venue":"Theoretical and Natural Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Propensity score matching; Causal inference; Observational study; Matching (statistics); Checklist; Replication (statistics); Workflow; Baseline (sea); Simple (philosophy)","score_opus":0.1522939937492116,"score_gpt":0.4137528535260652,"score_spread":0.2614588597768536,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7117117856","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00028510494,0.00063425564,0.98855686,0.0023903882,0.00043585108,0.0015018396,0.0009205165,0.0023506447,0.0029246227],"genre_scores_gemma":[0.002296267,0.0011000617,0.9901147,0.00094910135,0.0003493544,0.0020238992,0.00036285128,0.00045223293,0.0023515634],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.97949046,0.014999706,0.0017806698,0.0010534122,0.0025071052,0.00016872487],"domain_scores_gemma":[0.9358161,0.054387905,0.0016829039,0.003641047,0.0039223325,0.000549664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03931421,0.0027312045,0.0023058085,0.0056078103,0.0017209157,0.0046282965,0.0039843796,0.003874022,0.041825455],"category_scores_gemma":[0.118252724,0.002374006,0.003048368,0.0037602712,0.0029764588,0.0045861294,0.0049892315,0.008624876,0.023710998],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023937426,0.00034338917,0.0010428542,0.004753297,0.00026376336,0.0011995293,0.0040990342,0.014354525,0.0042338227,0.2655589,0.23711179,0.4667998],"study_design_scores_gemma":[0.00023578083,0.0001934334,0.0006822908,0.0026181312,0.000080614045,0.0012268914,0.0006474763,0.02937962,0.002338069,0.40815768,0.55420715,0.00023286216],"about_ca_topic_score_codex":0.0025040896,"about_ca_topic_score_gemma":0.003926701,"teacher_disagreement_score":0.041825455,"about_ca_system_score_codex":0.0018527646,"about_ca_system_score_gemma":0.006059621,"threshold_uncertainty_score":0.2079159},"labels":[],"label_agreement":null},{"id":"W7117304790","doi":"10.1002/cam4.71504","title":"The Impact of Distance and Income on Pediatric Solid Extracranial Tumors: A Report From <scp>CYP</scp> ‐C","year":2025,"lang":"en","type":"article","venue":"Cancer Medicine","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"SickKids Foundation; McMaster University; Izaak Walton Killam Health Centre; Nova Scotia Health Authority; Dalhousie University","funders":"McMaster University; Pediatric Oncology Group of Ontario; Public Health Agency; IWK Health Centre; Mach-Gaensslen Foundation of Canada; Public Health Agency of Canada","keywords":"Low income; MEDLINE; Severity of illness; Middle income; Household income","score_opus":0.04880591475714174,"score_gpt":0.4349519950197374,"score_spread":0.38614608026259567,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7117304790","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98538554,0.002807048,0.0001430998,0.00035790182,0.000014043339,0.000030786596,0.008869792,0.000010371375,0.0023813145],"genre_scores_gemma":[0.99163204,0.0032495742,0.00014646104,0.00010655675,0.000014787528,0.00001858004,0.004400802,0.00000768498,0.0004235078],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9995247,0.000023821187,0.000027832077,0.0000520725,0.00025532342,0.00011618596],"domain_scores_gemma":[0.99829227,0.00017617013,0.0003562456,0.000049934573,0.0008340434,0.00029134427],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00045510023,0.00021915937,0.00024323075,0.0007934867,0.0007254422,0.00067871425,0.0004394167,0.00019263796,0.0009785859],"category_scores_gemma":[0.0015297019,0.00011542256,0.0003879627,0.0025789863,0.00036358868,0.00015884888,0.0004599877,0.00043743115,0.00011816604],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018973782,0.0000068333698,0.9938198,0.000044491186,0.000039113504,0.000092076116,0.0002035818,0.00007242399,0.000041208605,0.0000280006,0.0013139955,0.0043195724],"study_design_scores_gemma":[0.0000017288519,0.00000974026,0.9981127,0.000027599785,0.000030322612,0.00010890908,0.00030187736,0.00006427131,0.000047818627,0.000005669071,0.0012857879,0.0000037424275],"about_ca_topic_score_codex":0.9420185,"about_ca_topic_score_gemma":0.9599974,"teacher_disagreement_score":0.9420185,"about_ca_system_score_codex":0.006106825,"about_ca_system_score_gemma":0.011197194,"threshold_uncertainty_score":0.11664587},"labels":[],"label_agreement":null},{"id":"W7117485707","doi":"10.1109/bdkcse67969.2025.11300540","title":"Learning Latent Trends: Artificial Intelligence-Augmented Difference-in-Differences Estimation","year":2025,"lang":"","type":"article","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Interpretability; Inference; Counterfactual thinking; Robustness (evolution); Nonparametric statistics; Identification (biology); Representation (politics); Generative model; Data-driven","score_opus":0.14821754824035932,"score_gpt":0.41225730348491635,"score_spread":0.26403975524455703,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7117485707","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012734473,0.00032667347,0.9846542,0.0006977031,0.00007976648,0.0000653481,0.00022684944,0.0003181562,0.0008968237],"genre_scores_gemma":[0.5349279,0.00052439707,0.45980856,0.0005365948,0.00022172267,0.00043981342,0.0008448401,0.0001057411,0.002590551],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9953923,0.00326806,0.00016325417,0.0005808527,0.00043076565,0.00016475127],"domain_scores_gemma":[0.9703793,0.024599476,0.0014662946,0.0023413028,0.0009469132,0.00026662217],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010720279,0.00074250397,0.0015124867,0.0012482533,0.0006062424,0.001674947,0.0023343163,0.0014952809,0.0039734603],"category_scores_gemma":[0.04635128,0.0006675113,0.0013046738,0.0015007599,0.0013297284,0.0019408374,0.0019565094,0.003239387,0.00054710684],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048060776,0.00026636748,0.01725097,0.00037801015,0.0005248937,0.00018571857,0.00039763728,0.43614292,0.00092955073,0.28610003,0.004339038,0.25300434],"study_design_scores_gemma":[0.00007162473,0.00006943345,0.000892498,0.00003248804,0.000038609287,0.00002176967,0.000028002622,0.8519588,0.00043437813,0.14416978,0.0022629225,0.000019719937],"about_ca_topic_score_codex":0.005095869,"about_ca_topic_score_gemma":0.0052624266,"teacher_disagreement_score":0.010720279,"about_ca_system_score_codex":0.0013183898,"about_ca_system_score_gemma":0.0020688558,"threshold_uncertainty_score":0.056694925},"labels":[],"label_agreement":null},{"id":"W7124436614","doi":"10.1093/biomtc/ujaf174","title":"Estimating optimal dynamic treatment regimes with Gaussian process emulation","year":2025,"lang":"en","type":"article","venue":"Biometrics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Hyperparameter optimization; Estimator; Emulation; Grid; Gaussian process; Process (computing); Parametric statistics; Noise (video); Gaussian; Estimation theory","score_opus":0.08512936259223094,"score_gpt":0.4365562607013978,"score_spread":0.35142689810916683,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7124436614","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010997224,0.00025374765,0.9866939,0.00054415443,0.000021458252,0.000089658795,0.00014817141,0.00015095282,0.0011007743],"genre_scores_gemma":[0.56416684,0.0009715704,0.42706957,0.00079937075,0.00008780412,0.001054344,0.0007976428,0.00015383467,0.004898981],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971969,0.001973655,0.0000987827,0.00034538907,0.00022563613,0.00015957376],"domain_scores_gemma":[0.9811921,0.016842967,0.0008381481,0.00057475135,0.0003953538,0.00015663619],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008367406,0.0009139956,0.0020934888,0.0013553604,0.00046915872,0.0015576184,0.0019318893,0.0022949304,0.004548123],"category_scores_gemma":[0.033219714,0.0010052305,0.0017508144,0.0015040446,0.0016060668,0.0016865588,0.0018273349,0.002653866,0.000640411],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011794997,0.00005999023,0.0018708175,0.00009510159,0.00009638748,0.00005853208,0.00007757984,0.9051754,0.00027213886,0.06289456,0.0009449177,0.02833665],"study_design_scores_gemma":[0.000028713788,0.000027433087,0.00028545724,0.000026850988,0.000016925487,0.000014706605,0.00001889758,0.95154923,0.00021637388,0.047236085,0.000568045,0.000011238724],"about_ca_topic_score_codex":0.0067399316,"about_ca_topic_score_gemma":0.006131396,"teacher_disagreement_score":0.008367406,"about_ca_system_score_codex":0.0018331743,"about_ca_system_score_gemma":0.0025579834,"threshold_uncertainty_score":0.04425162},"labels":[],"label_agreement":null},{"id":"W7124951972","doi":"10.1111/caje.70028","title":"On the role of the zero conditional mean assumption for causal inference in linear models","year":2025,"lang":"en","type":"article","venue":"Canadian Journal of Economics/Revue canadienne d économique","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Causal inference; Causal model; Instrumental variable; Ambiguity; Conditional independence; Ordinary least squares; Linear model; Outcome (game theory); Independence (probability theory); Conditional expectation","score_opus":0.24624384784960943,"score_gpt":0.28613618031513305,"score_spread":0.03989233246552362,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7124951972","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004298179,0.0015305661,0.97503144,0.009323078,0.00031492347,0.000055387587,0.00016393421,0.00013369412,0.009148868],"genre_scores_gemma":[0.51523304,0.007153929,0.45651284,0.005025808,0.0038089682,0.00096266036,0.00053256116,0.0005067322,0.010263428],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9624633,0.027961295,0.0013319036,0.002999837,0.0043503954,0.00089315884],"domain_scores_gemma":[0.5818281,0.38742298,0.009049043,0.014037516,0.00647825,0.0011841501],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07874523,0.0012038936,0.002806173,0.0037839115,0.002765846,0.0048525035,0.0039335703,0.0043864893,0.011364172],"category_scores_gemma":[0.26201034,0.0014080952,0.0035763036,0.004008482,0.015593957,0.011023308,0.0049715913,0.012761128,0.0013551726],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000009326011,0.000011614803,0.00026548633,0.00005819216,0.000025912483,0.000057923626,0.00014440092,0.0033217822,0.000033189415,0.99173707,0.0008263237,0.0035088223],"study_design_scores_gemma":[0.000008587091,0.0000064914157,0.00007831625,0.00004466672,0.000012964451,0.000025329287,0.000018205174,0.0137893865,0.000049898998,0.98507535,0.0008827012,0.00000814105],"about_ca_topic_score_codex":0.0071002264,"about_ca_topic_score_gemma":0.00388868,"teacher_disagreement_score":0.07874523,"about_ca_system_score_codex":0.0043433984,"about_ca_system_score_gemma":0.0047117346,"threshold_uncertainty_score":0.41644955},"labels":[],"label_agreement":null},{"id":"W7128215162","doi":"10.5465/amj.2025.4004","title":"Compelling Empirics in Quantitative Studies","year":2025,"lang":"en","type":"article","venue":"Academy of Management Journal","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"","score_opus":0.48466076019773907,"score_gpt":0.5545202349706227,"score_spread":0.06985947477288368,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7128215162","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025756959,0.01821426,0.82171327,0.083763145,0.0016208242,0.00033602025,0.0006067083,0.00029646445,0.047692366],"genre_scores_gemma":[0.81107396,0.0047659883,0.1669086,0.008156939,0.0031211318,0.0010231679,0.00028108005,0.00015567991,0.004513389],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9146945,0.07334317,0.0021295622,0.0039404253,0.005345592,0.00054680207],"domain_scores_gemma":[0.34323394,0.62352246,0.008297635,0.017906794,0.0056331656,0.0014060321],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08918348,0.0014388512,0.0032768974,0.0063894344,0.003502202,0.0068731224,0.0030423095,0.0042170715,0.012755571],"category_scores_gemma":[0.34175608,0.0015568273,0.0015302751,0.0039780964,0.023841185,0.014563706,0.0045966795,0.009552806,0.00070880895],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004438857,0.000044806395,0.0011902772,0.00031222397,0.00014976073,0.000098810255,0.0005108101,0.0012429104,0.000035058503,0.9852188,0.002389066,0.008763063],"study_design_scores_gemma":[0.00002322081,0.0000057211287,0.00020391571,0.00007320293,0.000020657682,0.000020199423,0.00010890304,0.0024754708,0.00002777373,0.9955942,0.0014418844,0.0000048923275],"about_ca_topic_score_codex":0.002091147,"about_ca_topic_score_gemma":0.002440355,"teacher_disagreement_score":0.91081655,"about_ca_system_score_codex":0.0031483967,"about_ca_system_score_gemma":0.0037274647,"threshold_uncertainty_score":0.47165298},"labels":[],"label_agreement":null},{"id":"W7132906676","doi":"","title":"Causal Inference using Electronic Health Records in Primary Care","year":2024,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto; Diabetes Action Research and Education Foundation","keywords":"Causal inference; Observational study; Inference; Marginal structural model; Randomized controlled trial; Instrumental variable; Estimation; Causality (physics); Health care; Propensity score matching","score_opus":0.0975769037204345,"score_gpt":0.48158313736556746,"score_spread":0.384006233645133,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132906676","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020605238,0.0024221714,0.9674764,0.003309504,0.00025986094,0.0006304293,0.0013124697,0.0003848705,0.0035989974],"genre_scores_gemma":[0.54770267,0.0032601056,0.44124717,0.0015935285,0.00061965635,0.0017281165,0.0014937983,0.00009470945,0.0022602386],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9072833,0.077940054,0.0024542937,0.0072644833,0.004412383,0.00064554345],"domain_scores_gemma":[0.64273244,0.32117572,0.015785793,0.015937127,0.0037932314,0.00057576195],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07484151,0.0010109325,0.0020600017,0.0028347822,0.0012558929,0.0041916063,0.0031520445,0.0030047845,0.0059042973],"category_scores_gemma":[0.2659777,0.0017737562,0.002952474,0.004767096,0.0029625006,0.005912851,0.0027575386,0.004231362,0.000584697],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005767392,0.00043458855,0.037635926,0.0022607401,0.0020418884,0.00061962946,0.0018355899,0.23103023,0.00033601891,0.53156674,0.0066975784,0.18496442],"study_design_scores_gemma":[0.0004698141,0.00023894547,0.006845825,0.000663261,0.0006107235,0.00016074034,0.00027512843,0.37886068,0.000628354,0.60085595,0.010291889,0.000098733704],"about_ca_topic_score_codex":0.014814051,"about_ca_topic_score_gemma":0.007909345,"teacher_disagreement_score":0.07484151,"about_ca_system_score_codex":0.003910869,"about_ca_system_score_gemma":0.0051828832,"threshold_uncertainty_score":0.39580446},"labels":[],"label_agreement":null},{"id":"W7132970944","doi":"","title":"Generalized Variable Importance Metric: An approach to identify important predictors from machine learning models","year":2025,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Metric (unit); Regression; Measure (data warehouse); Regression analysis; Black box; Variable (mathematics); Correlation; Generalized linear model; Instrumental variable","score_opus":0.12518113551008744,"score_gpt":0.4238559980188738,"score_spread":0.2986748625087864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132970944","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002620296,0.00081931823,0.9952136,0.00034284734,0.00008912481,0.00007815484,0.00018424308,0.00021934435,0.00043307533],"genre_scores_gemma":[0.16265409,0.0019306088,0.830235,0.0005517994,0.0006476101,0.00083983113,0.0012796714,0.0002903309,0.0015710363],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99134994,0.0053653894,0.00054266,0.0010692603,0.0014479072,0.00022481858],"domain_scores_gemma":[0.97942024,0.015901212,0.0013821683,0.0013330539,0.0016067651,0.00035650903],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01292184,0.0022518525,0.0026644594,0.005586798,0.0007344157,0.0028838427,0.002842092,0.0021255142,0.0022791137],"category_scores_gemma":[0.041059695,0.0007580879,0.0020196356,0.0041426225,0.0018423628,0.0033286992,0.0035316094,0.004203571,0.00057554763],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020882627,0.00021278075,0.015362033,0.0014270303,0.0011267455,0.00031765012,0.000534427,0.29213816,0.0027791902,0.27125388,0.015480892,0.3991583],"study_design_scores_gemma":[0.000027024214,0.00013509738,0.0016130782,0.00017913495,0.00007260513,0.00013824072,0.00007451428,0.7369831,0.0009272302,0.25179255,0.007994121,0.0000632984],"about_ca_topic_score_codex":0.0020406311,"about_ca_topic_score_gemma":0.0019232973,"teacher_disagreement_score":0.01292184,"about_ca_system_score_codex":0.0014677773,"about_ca_system_score_gemma":0.002563063,"threshold_uncertainty_score":0.06833804},"labels":[],"label_agreement":null},{"id":"W7132977956","doi":"","title":"Evaluating Machine Learning Methods for Estimating Heterogeneous Treatment Effects Within a Potential Outcomes Survival Analysis Framework","year":2025,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; Toronto Public Health","funders":"Alliance de recherche numérique du Canada; University of Toronto; Innovation, Science and Economic Development Canada","keywords":"Causal inference; Observational study; Bayesian probability; Survival analysis; Outcome (game theory); Inference; Average treatment effect; Confounding; Bayesian inference; Oracle","score_opus":0.16999694995480655,"score_gpt":0.5791987256780909,"score_spread":0.4092017757232844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7132977956","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08249947,0.0029357602,0.90832025,0.002456173,0.00011601326,0.00036402864,0.0005197901,0.00036800472,0.0024205048],"genre_scores_gemma":[0.52454376,0.0015609026,0.46979344,0.00057169894,0.00021392574,0.0008646936,0.0008466303,0.00012938702,0.0014755253],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9618198,0.034776382,0.0005961072,0.0011166149,0.0014112528,0.00027980018],"domain_scores_gemma":[0.60709095,0.37907624,0.0046855607,0.0053501343,0.0030282764,0.00076881953],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.07809071,0.0011241966,0.0012981379,0.001603515,0.0004953286,0.001707218,0.002114214,0.001476883,0.002859556],"category_scores_gemma":[0.18344533,0.0005710239,0.0016810561,0.0014879254,0.0016502386,0.0021144785,0.0019153266,0.0028233833,0.00030219796],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00071891263,0.00019283709,0.010068476,0.00047177533,0.00076996,0.00004722306,0.0002137796,0.8197696,0.00022778563,0.06737021,0.0016430005,0.098506525],"study_design_scores_gemma":[0.00009169444,0.00018929664,0.0010052102,0.0000849168,0.000076878525,0.000017844091,0.000033512664,0.9559863,0.00021765064,0.041661315,0.00062390167,0.000011545298],"about_ca_topic_score_codex":0.003898758,"about_ca_topic_score_gemma":0.003122225,"teacher_disagreement_score":0.9219093,"about_ca_system_score_codex":0.0022113675,"about_ca_system_score_gemma":0.0026014342,"threshold_uncertainty_score":0.41298813},"labels":[],"label_agreement":null},{"id":"W7133034134","doi":"","title":"Causal Inference with Neural Network Predictions","year":2024,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario","funders":"","keywords":"Estimator; Causal inference; Inverse probability weighting; Average treatment effect; Weighting; Artificial neural network; Inverse probability; Outcome (game theory)","score_opus":0.08206922318757381,"score_gpt":0.4389688164016163,"score_spread":0.35689959321404247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7133034134","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025843365,0.00093553355,0.96494037,0.002480453,0.00018821396,0.00007832857,0.00064747164,0.0005431655,0.004343123],"genre_scores_gemma":[0.81236327,0.0013569233,0.17658037,0.0011752187,0.0005472397,0.00049059745,0.0014327675,0.00012850956,0.0059250933],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9978352,0.0011780306,0.00011028018,0.0004902933,0.00025736995,0.0001288077],"domain_scores_gemma":[0.97630197,0.020735286,0.001034652,0.0009045221,0.000798915,0.00022472968],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0060265427,0.0010042345,0.001435915,0.0016724396,0.00062028016,0.0018366228,0.002073422,0.0019441277,0.00682753],"category_scores_gemma":[0.037898332,0.00090062513,0.0011234467,0.001467425,0.0013868469,0.002733056,0.0014556152,0.0036488755,0.0006037508],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019220792,0.00005618237,0.003831829,0.0001643195,0.00015214631,0.00015222351,0.000083382416,0.84967023,0.00019345438,0.09257339,0.002564996,0.05036573],"study_design_scores_gemma":[0.000019174933,0.0000071984423,0.00025320126,0.000022408854,0.000013604314,0.000011739961,0.000005699968,0.9261961,0.000087041575,0.0730024,0.0003737938,0.000007676818],"about_ca_topic_score_codex":0.012671313,"about_ca_topic_score_gemma":0.012245461,"teacher_disagreement_score":0.012671313,"about_ca_system_score_codex":0.0018537634,"about_ca_system_score_gemma":0.001699752,"threshold_uncertainty_score":0.031871736},"labels":[],"label_agreement":null},{"id":"W7133081946","doi":"","title":"Causal Variance Decompositions for Evaluating Healthcare Provider Performance","year":2023,"lang":"","type":"dissertation","venue":"TSpace","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Government of Ontario","keywords":"Variance (accounting); Quality (philosophy); Causal inference; Health care; Context (archaeology); Variation (astronomy); Variance decomposition of forecast errors; Inference","score_opus":0.26955459466488796,"score_gpt":0.5496522662516041,"score_spread":0.28009767158671617,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7133081946","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02976909,0.0010497588,0.9592925,0.0009022901,0.0002768893,0.0012085974,0.0024567335,0.00059871946,0.0044454224],"genre_scores_gemma":[0.5064547,0.0013489128,0.47777885,0.0003925485,0.00034626495,0.006776469,0.0041235182,0.0003410514,0.0024377345],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9441779,0.042606268,0.0022187673,0.004266084,0.005614231,0.0011167029],"domain_scores_gemma":[0.80584294,0.16806422,0.010227215,0.009208905,0.005707816,0.00094890426],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.060961865,0.0034030974,0.002127872,0.009461827,0.0011153138,0.0034588252,0.0020146344,0.0021313182,0.010645031],"category_scores_gemma":[0.17627484,0.00088049343,0.0073108985,0.008044899,0.0031374383,0.003225377,0.0038217034,0.004303015,0.0010953852],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006072867,0.0006503698,0.08886781,0.001372472,0.005884841,0.0003158911,0.002767577,0.23093745,0.0011127291,0.46057525,0.00834188,0.19856657],"study_design_scores_gemma":[0.00012728016,0.00049550284,0.027643349,0.00059154374,0.0005633208,0.00009360809,0.000883676,0.55906725,0.00091894827,0.40146577,0.007955463,0.0001942487],"about_ca_topic_score_codex":0.011156558,"about_ca_topic_score_gemma":0.004138906,"teacher_disagreement_score":0.060961865,"about_ca_system_score_codex":0.0042826207,"about_ca_system_score_gemma":0.004717281,"threshold_uncertainty_score":0.322401},"labels":[],"label_agreement":null},{"id":"W7154048392","doi":"10.1145/3772318.3808999","title":"10.1145/3772318.3808999","year":2000,"lang":"en","type":"article","venue":"Time to knit","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":true,"route_about_ca":false,"ca_institutions":"","funders":"","keywords":"Session (web analytics); Health equity; Equity (law); Public health; MEDLINE","score_opus":0.058533600213292604,"score_gpt":0.31988099477624055,"score_spread":0.2613473945629479,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7154048392","genre_codex":"other","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":"other","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025319876,0.006756988,0.03467175,0.0030287425,0.0032110983,0.000609573,0.034974482,0.028459074,0.88575625],"genre_scores_gemma":[0.008032952,0.0038898354,0.00637289,0.0011355531,0.00021381784,0.0003714871,0.015699467,0.0040854267,0.9601987],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9990012,0.00009911974,0.000092394424,0.00029108225,0.0003567826,0.0001593895],"domain_scores_gemma":[0.9977133,0.0006303105,0.00011050167,0.00089681987,0.0004287182,0.0002203458],"candidate_categories":["insufficient_payload"],"consensus_categories":["insufficient_payload"],"category_scores_codex":[0.0026316014,0.0033436967,0.0024902911,0.0032240513,0.0023417328,0.005213051,0.0031643165,0.0049504703,0.9378906],"category_scores_gemma":[0.005636855,0.0021631091,0.0016841713,0.0107420515,0.0020433646,0.010383506,0.0061718286,0.003192096,0.95236367],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026410117,0.0002113936,0.00076016254,0.0008003944,0.00007386609,0.00025797,0.00012907623,0.0014622413,0.0011290701,0.01832073,0.64496017,0.3316308],"study_design_scores_gemma":[0.000053869568,0.000028756558,0.00088069326,0.00033781034,0.000063483,0.00015686711,0.00009269196,0.0020558464,0.00067452947,0.006459135,0.9891544,0.000041891773],"about_ca_topic_score_codex":0.015689954,"about_ca_topic_score_gemma":0.013217728,"teacher_disagreement_score":0.06210941,"about_ca_system_score_codex":0.0029546197,"about_ca_system_score_gemma":0.0015234759,"threshold_uncertainty_score":0.088591516},"labels":[],"label_agreement":null},{"id":"W7161794840","doi":"10.82308/12937","title":"Targeted maximum likelihood estimation for longitudinal data","year":2013,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Causal inference; Robustness (evolution); Estimator; Inverse probability weighting; Likelihood function; Missing data; Confounding; Inference; Exponential family; Marginal structural model","score_opus":0.2025923458627461,"score_gpt":0.449120704485962,"score_spread":0.24652835862321587,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7161794840","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00058321457,0.0002215203,0.99863905,0.00009988874,0.000012621178,0.000028515651,0.000056676352,0.00011150804,0.00024704906],"genre_scores_gemma":[0.086159565,0.0020926753,0.905688,0.00033017815,0.00017456656,0.0011432084,0.00086116965,0.0002983941,0.0032523146],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9916808,0.006432596,0.0003023591,0.0007126223,0.00070398086,0.00016757888],"domain_scores_gemma":[0.963488,0.03119629,0.0013261059,0.0026003174,0.0012120666,0.00017715726],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014927853,0.0011777023,0.002224555,0.002163278,0.00058716733,0.002243631,0.002794507,0.0016854198,0.004713692],"category_scores_gemma":[0.05582215,0.0011847103,0.002254878,0.002756727,0.0014978887,0.0028064917,0.0030034247,0.003534356,0.0015562981],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000146825,0.000118761294,0.0039665913,0.0010931569,0.00071880955,0.00026668378,0.0004748162,0.29308173,0.0014308656,0.4487512,0.0070364694,0.24291411],"study_design_scores_gemma":[0.00004635853,0.000061493905,0.0006781631,0.0001283469,0.000058706886,0.00008697549,0.000060923023,0.71589553,0.0007353447,0.27504936,0.0071647903,0.000034097986],"about_ca_topic_score_codex":0.0018357586,"about_ca_topic_score_gemma":0.0017990668,"teacher_disagreement_score":0.014927853,"about_ca_system_score_codex":0.0013021382,"about_ca_system_score_gemma":0.0025377327,"threshold_uncertainty_score":0.07894695},"labels":[],"label_agreement":null},{"id":"W7161963721","doi":"10.82308/2506","title":"Amiodarone and the risk of pacemaker insertion in elderly patients with atrial fibrillation : analysis of time-dependent exposure using nested case-control and survival analysis methodologies","year":2003,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Amiodarone; Nested case-control study; Atrial fibrillation; Confounding; Proportional hazards model; Cohort; Cohort study; Adverse effect","score_opus":0.0631809756804065,"score_gpt":0.36906789267711354,"score_spread":0.30588691699670706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7161963721","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96343344,0.0016798343,0.03393694,0.00019246047,0.00003191204,0.000106668376,0.00030506912,0.00003597859,0.0002776992],"genre_scores_gemma":[0.9883873,0.00020317205,0.010942509,0.00003857056,0.00001333759,0.00008138101,0.0002235059,0.0000046371247,0.00010555425],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9926721,0.005099339,0.00034530798,0.0008974747,0.0007958065,0.00019001757],"domain_scores_gemma":[0.9895096,0.0065975282,0.0018918872,0.0012087662,0.0004939667,0.00029822293],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010464064,0.0003511096,0.0005424093,0.00065246166,0.0002707178,0.00054686697,0.00084633747,0.00057870423,0.00057233055],"category_scores_gemma":[0.020910528,0.00029255726,0.0021429483,0.00046783502,0.00042812456,0.0003104616,0.0005563797,0.00053532014,0.00004317729],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013529205,0.00019775721,0.9708407,0.00015707282,0.0036343315,0.00035252018,0.00040344027,0.0046930485,0.0020480056,0.0011826075,0.00017650728,0.014961091],"study_design_scores_gemma":[0.00022948929,0.0012854927,0.9027028,0.00008298886,0.001978523,0.0009774668,0.00025245507,0.087854005,0.0011580655,0.00223595,0.001191959,0.000050784336],"about_ca_topic_score_codex":0.017768687,"about_ca_topic_score_gemma":0.013553152,"teacher_disagreement_score":0.017768687,"about_ca_system_score_codex":0.00068128476,"about_ca_system_score_gemma":0.0011467285,"threshold_uncertainty_score":0.055339873},"labels":[],"label_agreement":null},{"id":"W7161968822","doi":"10.82308/39725","title":"Leveraging expert knowledge and public data to inform health interventions: Novel practical approaches for building causal directed acyclic graphs","year":2025,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Context (archaeology); Information scientist; Public policy; Knowledge production","score_opus":0.6146624171519397,"score_gpt":0.5468540298589458,"score_spread":0.06780838729299388,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7161968822","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020903908,0.00046630422,0.9938916,0.00106883,0.000031440417,0.00010746712,0.00031016616,0.00036549466,0.0016682085],"genre_scores_gemma":[0.09048966,0.0012486182,0.9049889,0.0003848429,0.00008602058,0.00036654208,0.00067142025,0.00013907898,0.0016249046],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9872799,0.00852627,0.0006160209,0.0020886126,0.0012587877,0.00023038103],"domain_scores_gemma":[0.93035686,0.059352774,0.0022558307,0.0056923167,0.0018760012,0.0004662507],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017050575,0.0015063221,0.0014216176,0.0062405253,0.0011540706,0.004548225,0.0031480135,0.0021200206,0.006862615],"category_scores_gemma":[0.06462336,0.0016087904,0.0027502796,0.004842373,0.0027914895,0.006860428,0.00442301,0.0029714988,0.0012498226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000157626,0.00019289787,0.0067350133,0.0015295786,0.00054498797,0.0003924512,0.0018379422,0.25002655,0.0013339472,0.34589562,0.004818066,0.38653532],"study_design_scores_gemma":[0.00004850042,0.00005750885,0.00083381694,0.00031862425,0.00016364304,0.0001318705,0.00033211813,0.3888018,0.00085778476,0.5897289,0.01867515,0.00005025544],"about_ca_topic_score_codex":0.0110607585,"about_ca_topic_score_gemma":0.01871411,"teacher_disagreement_score":0.017050575,"about_ca_system_score_codex":0.0023538633,"about_ca_system_score_gemma":0.005145752,"threshold_uncertainty_score":0.090173185},"labels":[],"label_agreement":null},{"id":"W7162001184","doi":"10.82308/942","title":"Innovations and opportunities for primary health care after hospital discharge: an application of causal inference methods in health services research","year":2017,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Health services; Primary health care; Primary care; Health care; Public health","score_opus":0.2555043268383185,"score_gpt":0.5826403002615346,"score_spread":0.3271359734232161,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7162001184","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08670194,0.01703257,0.8562261,0.02471451,0.001114389,0.0039447984,0.001028398,0.00040966147,0.008827738],"genre_scores_gemma":[0.6035554,0.0073373555,0.37976244,0.0019753056,0.0005361913,0.0047135334,0.00033407548,0.000055101693,0.0017306418],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.7673166,0.21209101,0.0046423865,0.008100745,0.0063343323,0.0015149931],"domain_scores_gemma":[0.31266505,0.6688572,0.009734329,0.0048351106,0.002823934,0.0010843925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17169018,0.0014688405,0.0027857386,0.008960208,0.0028235416,0.0069827754,0.0035987934,0.0038469557,0.00539631],"category_scores_gemma":[0.34542587,0.0014256496,0.0051489966,0.009086206,0.0060861204,0.008094297,0.0060943984,0.004258698,0.00030932383],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007178894,0.000897625,0.14505793,0.005953519,0.0075511336,0.0010484481,0.0106807165,0.04886203,0.0002858429,0.52068853,0.0036094803,0.25464696],"study_design_scores_gemma":[0.00060789264,0.00058975135,0.024753006,0.002638257,0.0021546322,0.00029350416,0.0050561074,0.20379359,0.00047928072,0.7486745,0.010719015,0.00024038642],"about_ca_topic_score_codex":0.02297804,"about_ca_topic_score_gemma":0.017983776,"teacher_disagreement_score":0.17169018,"about_ca_system_score_codex":0.0084530255,"about_ca_system_score_gemma":0.019384103,"threshold_uncertainty_score":0.90799534},"labels":[],"label_agreement":null},{"id":"W7162018817","doi":"10.82308/30565","title":"Methodological Advances to Address Measurement Error and Model Misspecification in HIV Research","year":2023,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Covariate; Marginal structural model; Observational error; Human immunodeficiency virus (HIV); Cohort; Clinical trial; Cohort study; Hepatitis C; Disease","score_opus":0.8930019370217708,"score_gpt":0.6359384519547808,"score_spread":0.25706348506698995,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7162018817","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006123169,0.00539855,0.97580576,0.008076307,0.0010988445,0.0011398188,0.00059312873,0.00019679543,0.001567573],"genre_scores_gemma":[0.2598467,0.0046253907,0.7138451,0.006104591,0.0018367267,0.010844939,0.0009855226,0.00025803217,0.0016530572],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.57558686,0.37156972,0.018979639,0.015387534,0.016911024,0.0015652973],"domain_scores_gemma":[0.36631584,0.5174606,0.03468529,0.061362714,0.019031353,0.0011442282],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.31305397,0.0024328274,0.0031159222,0.003786504,0.00287348,0.0053058015,0.0068434537,0.0040784054,0.0040173656],"category_scores_gemma":[0.6355252,0.001577347,0.0047753286,0.007923711,0.0062704966,0.004209849,0.007613529,0.008190737,0.0006192989],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007361037,0.00047180458,0.11090268,0.007021978,0.016237454,0.0007373332,0.0078009292,0.043152258,0.0012049549,0.49471897,0.015360004,0.30165562],"study_design_scores_gemma":[0.000682767,0.000994019,0.03260888,0.0038911258,0.0034180472,0.0006776475,0.0016303908,0.092800915,0.0021182515,0.8043478,0.056467935,0.00036215686],"about_ca_topic_score_codex":0.01758385,"about_ca_topic_score_gemma":0.015273767,"teacher_disagreement_score":0.31305397,"about_ca_system_score_codex":0.0038023188,"about_ca_system_score_gemma":0.012610495,"threshold_uncertainty_score":0.8471268},"labels":[],"label_agreement":null},{"id":"W7162035648","doi":"10.82308/23533","title":"The impact of human papillomavirus vaccination on adolescent health outcomes: an application of the regression discontinuity design","year":2015,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Vaccination; Ile de france; Meningococcal disease; Human papillomavirus; Public health; Urban environment","score_opus":0.20533511706712784,"score_gpt":0.5326317074237812,"score_spread":0.32729659035665337,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7162035648","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.30583006,0.007273572,0.6584839,0.0027481958,0.0020537213,0.012716155,0.004744849,0.0010027086,0.0051468317],"genre_scores_gemma":[0.7577761,0.0020329044,0.2034771,0.0009060966,0.00039571634,0.025185209,0.0019184004,0.00016912048,0.008139249],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.8422429,0.14504783,0.0023858605,0.0054701297,0.0023106178,0.0025426897],"domain_scores_gemma":[0.86167175,0.12397376,0.0057727164,0.0055875103,0.002158374,0.0008359376],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09976286,0.002663146,0.0058957143,0.0031498473,0.0016816509,0.0032201617,0.0070472523,0.004780281,0.009382422],"category_scores_gemma":[0.119969785,0.0017854628,0.009773999,0.0028517044,0.002608868,0.0020714437,0.004939583,0.0059947977,0.00092287763],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.07764321,0.0075524007,0.2674004,0.007661485,0.0461816,0.0020015866,0.004274837,0.19140129,0.0030361696,0.14831395,0.0070525114,0.23748055],"study_design_scores_gemma":[0.013447676,0.028609384,0.04761099,0.0011037531,0.016691895,0.0004696631,0.0011051403,0.81243944,0.0039340537,0.055533014,0.018590396,0.00046467897],"about_ca_topic_score_codex":0.0140241375,"about_ca_topic_score_gemma":0.004171102,"teacher_disagreement_score":0.09976286,"about_ca_system_score_codex":0.0028047469,"about_ca_system_score_gemma":0.0039261132,"threshold_uncertainty_score":0.52760273},"labels":[],"label_agreement":null},{"id":"W7162134529","doi":"10.82308/32610","title":"Effects of sparse follow-up on marginal structural models for time-to-event data","year":2012,"lang":"en","type":"dissertation","venue":"","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Missing data; Imputation (statistics); Proportional hazards model; Logistic regression; Confidence interval; Hazard ratio; Regression; Interval (graph theory)","score_opus":0.1386876719470322,"score_gpt":0.4221087123016835,"score_spread":0.2834210403546513,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7162134529","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2456966,0.003166528,0.736959,0.0062188674,0.00031716676,0.0010862423,0.002866314,0.0008836732,0.0028057164],"genre_scores_gemma":[0.87636435,0.0010498879,0.115189314,0.0011718026,0.00031198372,0.001949391,0.0018632608,0.0001976973,0.0019023146],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.82597035,0.15186836,0.0051180366,0.009982943,0.0044281846,0.002632043],"domain_scores_gemma":[0.1098547,0.8418414,0.024542427,0.01998395,0.0026904913,0.0010870376],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23907407,0.0017729054,0.003921525,0.0024055475,0.0019008387,0.0031874522,0.004947573,0.0038664402,0.008728742],"category_scores_gemma":[0.49460304,0.0016730631,0.0066236174,0.0028046682,0.0049798475,0.0071229464,0.00612328,0.006308031,0.00052373274],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013212771,0.00087317365,0.22678797,0.0025251363,0.009496184,0.002436627,0.0051447893,0.45082533,0.0009313691,0.15246421,0.0065286076,0.12877385],"study_design_scores_gemma":[0.0011194678,0.0017525153,0.038831916,0.0008061221,0.00344246,0.00068958243,0.0005377433,0.7266591,0.0011848453,0.21985772,0.004898362,0.00022011633],"about_ca_topic_score_codex":0.008148957,"about_ca_topic_score_gemma":0.006924213,"teacher_disagreement_score":0.76092595,"about_ca_system_score_codex":0.0031411648,"about_ca_system_score_gemma":0.0026557497,"threshold_uncertainty_score":0.9383572},"labels":[],"label_agreement":null},{"id":"W836196718","doi":"10.1007/s10985-015-9335-y","title":"Does Cox analysis of a randomized survival study yield a causal treatment effect?","year":2015,"lang":"en","type":"article","venue":"Lifetime Data Analysis","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":211,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Censoring (clinical trials); Statistics; Estimator; Econometrics; Causal inference; Proportional hazards model; Confounding; Regression; Inference; Randomized controlled trial; Survival analysis; Mathematics; Regression analysis; Randomized experiment; Hazard ratio; Computer science; Medicine; Confidence interval; Internal medicine; Artificial intelligence","score_opus":0.17248744099221144,"score_gpt":0.43685139860711714,"score_spread":0.2643639576149057,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W836196718","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.05520983,0.010475077,0.8906661,0.035310812,0.0017506127,0.0006184089,0.0012456758,0.000463701,0.004259835],"genre_scores_gemma":[0.82717633,0.0067749736,0.14599548,0.009381112,0.0029247056,0.001328207,0.000744125,0.00019159928,0.005483491],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8854355,0.09997618,0.0034836857,0.005756234,0.003908358,0.0014400482],"domain_scores_gemma":[0.25352353,0.69910765,0.014049428,0.029515706,0.002883772,0.0009198683],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1959315,0.0010349867,0.0038172328,0.001853721,0.0009875082,0.0031969673,0.00388685,0.0048773056,0.012668819],"category_scores_gemma":[0.5116619,0.0013990393,0.0054039136,0.002501762,0.005846517,0.007230032,0.0020306064,0.0059264097,0.00077734975],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005446662,0.00059809745,0.037847452,0.0044381903,0.011693485,0.0009121216,0.00091722276,0.016501267,0.0006705376,0.6866686,0.014016825,0.22028947],"study_design_scores_gemma":[0.0012521821,0.00051213073,0.003782606,0.00048299448,0.0031879311,0.00034588942,0.000210162,0.051497974,0.0007204257,0.9320176,0.0059265574,0.000063575644],"about_ca_topic_score_codex":0.0024583791,"about_ca_topic_score_gemma":0.0018259257,"teacher_disagreement_score":0.8040685,"about_ca_system_score_codex":0.0014497372,"about_ca_system_score_gemma":0.00405783,"threshold_uncertainty_score":0.9915596},"labels":[],"label_agreement":null},{"id":"W939145883","doi":"10.1093/biostatistics/kxw049","title":"Inequality in treatment benefits: Can we determine if a new treatment benefits the many or the few?","year":2016,"lang":"en","type":"article","venue":"Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Neurological Disorders and Stroke; Patient-Centered Outcomes Research Institute; U.S. Food and Drug Administration; National Institute on Aging; National Institutes of Health; Hamilton Health Sciences Foundation","keywords":"Randomized controlled trial; Estimator; Fraction (chemistry); Computer science; Statistics; Econometrics; Randomized response; Outcome (game theory); Mathematics; Medicine; Mathematical optimization; Mathematical economics","score_opus":0.2502387195907997,"score_gpt":0.4054696846381312,"score_spread":0.15523096504733153,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W939145883","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07654475,0.02712038,0.82765245,0.04618454,0.0010646032,0.0011349368,0.003986126,0.00032132966,0.015990864],"genre_scores_gemma":[0.8239372,0.0076049585,0.1443132,0.013600182,0.0018759731,0.002844637,0.001824615,0.00026545319,0.0037338366],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93646604,0.0472337,0.0028319207,0.0072072865,0.0047854455,0.0014755272],"domain_scores_gemma":[0.5435908,0.42867422,0.014417306,0.009568579,0.0027460752,0.0010030228],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11409813,0.0012558558,0.0076599745,0.0024032407,0.0010949831,0.0041931844,0.003377277,0.0044448143,0.012195695],"category_scores_gemma":[0.41495913,0.00090858364,0.0029176276,0.0030269686,0.0074649486,0.013041673,0.004020425,0.008993394,0.0009656073],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00426358,0.00048856856,0.04533226,0.0043198317,0.0033031339,0.00042271154,0.0017727371,0.022997214,0.0008384661,0.5008738,0.014272083,0.40111554],"study_design_scores_gemma":[0.0005145228,0.0003265785,0.010115388,0.0014830399,0.0009590246,0.00023183275,0.00021132138,0.03257346,0.00069212605,0.94427526,0.008552756,0.000064649576],"about_ca_topic_score_codex":0.0027730102,"about_ca_topic_score_gemma":0.0014602372,"teacher_disagreement_score":0.88590187,"about_ca_system_score_codex":0.0023679256,"about_ca_system_score_gemma":0.0026626468,"threshold_uncertainty_score":0.60341585},"labels":[],"label_agreement":null},{"id":"W980728949","doi":"10.59170/stattrans-2013-016","title":"The effect of unemployment benefits on labour market behaviour in Luxembourg","year":2013,"lang":"en","type":"article","venue":"Statistics in Transition New Series","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for International Peace and Security","funders":"","keywords":"Unemployment; Spell; Economics; Labour economics; Term (time); Demographic economics; Macroeconomics; Sociology","score_opus":0.030547993004667963,"score_gpt":0.3382962802949004,"score_spread":0.3077482872902324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W980728949","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99800056,0.0004865067,0.00048572346,0.00048637958,0.000011735226,0.000005713306,0.00019443329,0.000007660612,0.00032118475],"genre_scores_gemma":[0.99900144,0.00011787917,0.00013799555,0.000026476402,0.0000065882855,0.00000878803,0.00019702339,0.0000025386566,0.00050139177],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99893147,0.0006856848,0.000025738487,0.00009940618,0.000055784258,0.00020201167],"domain_scores_gemma":[0.99785835,0.0013597239,0.00043296107,0.00009156695,0.00008034027,0.00017710523],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024904972,0.0002499841,0.00054893846,0.000834815,0.000292972,0.00092444365,0.0004390353,0.00051905744,0.0023074546],"category_scores_gemma":[0.005630433,0.00013001943,0.00045386315,0.00085065234,0.00066933705,0.00037809467,0.00089328224,0.00066629355,0.00019377403],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001398146,0.0003241657,0.9087401,0.00012586702,0.00047759508,0.00087181106,0.0020284262,0.03646678,0.0010124138,0.010987882,0.002220423,0.035346426],"study_design_scores_gemma":[0.00013070651,0.00047098994,0.97172135,0.0000673906,0.0001276507,0.00005599946,0.0014126808,0.021858755,0.00013026847,0.0028347217,0.0011720998,0.00001751262],"about_ca_topic_score_codex":0.1121375,"about_ca_topic_score_gemma":0.10344148,"teacher_disagreement_score":0.1121375,"about_ca_system_score_codex":0.0019481648,"about_ca_system_score_gemma":0.00082127785,"threshold_uncertainty_score":0.22296959},"labels":[],"label_agreement":null}]}