{"meta":{"query_hash":"0289893b6e2e","filters":{"venue":"The International Journal of Biostatistics"},"cohort_total":68,"direct_labels_cover":0,"predictions_cover":68,"exported":68,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/0289893b6e2e","api":"https://metacan.xera.ac/api/v1/cohort?venue=The+International+Journal+of+Biostatistics"},"results":[{"id":"W1729931698","doi":"10.1515/ijb-2016-0004","title":"Multiple Comparisons Using Composite Likelihood in Clustered Data","year":2016,"lang":"en","type":"preprint","venue":"The International Journal of Biostatistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Multivariate statistics; Quasi-maximum likelihood; Statistics; Monte Carlo method; Computer science; Gaussian; Mathematics; Algorithm; Data mining; Econometrics; Expectation–maximization algorithm; Maximum likelihood","score_opus":0.683109364844231,"score_gpt":0.5842110733642264,"score_spread":0.09889829148000462,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1729931698","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0066565084,0.0007028053,0.99099964,0.0006205684,0.00016259373,0.00014024973,0.00008406125,0.0001212083,0.0005122955],"genre_scores_gemma":[0.23356047,0.0010716792,0.76079744,0.0007446487,0.000669578,0.0015367848,0.0003395355,0.00022446284,0.0010554071],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9105082,0.07631989,0.0015412,0.0049018012,0.005996504,0.0007324051],"domain_scores_gemma":[0.6151016,0.3432401,0.020189222,0.013898812,0.005862218,0.0017079945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08257935,0.0016217822,0.003317964,0.0038161378,0.00082892383,0.0028886385,0.004159863,0.0027115971,0.0042815795],"category_scores_gemma":[0.28759518,0.0007060226,0.0026316803,0.0048583047,0.0040815347,0.0035791986,0.003979814,0.004891525,0.0008670899],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021847007,0.00046271618,0.017013535,0.0028440384,0.003887501,0.0017548712,0.0016696278,0.16062178,0.0026267362,0.5240315,0.0072320164,0.27567092],"study_design_scores_gemma":[0.00032718942,0.0011194563,0.0029915108,0.00024918714,0.00029290692,0.0005598168,0.00015125614,0.33721262,0.0019500414,0.65072656,0.0043199817,0.00009950518],"about_ca_topic_score_codex":0.00041428293,"about_ca_topic_score_gemma":0.00035188513,"teacher_disagreement_score":0.08257935,"about_ca_system_score_codex":0.0013776079,"about_ca_system_score_gemma":0.0028555226,"threshold_uncertainty_score":0.43672657},"labels":[],"label_agreement":null},{"id":"W1965231589","doi":"10.2202/1557-4679.1216","title":"Estimation of Modified Concordance Ratio in Sib-Pairs: Effect of Consanguinity on the Risk of Congenital Heart Diseases","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Consanguinity; Concordance; Confidence interval; Statistics; Demography; Population; Sample (material); Sample size determination; Inference; Estimation; Econometrics; Medicine; Genetics; Mathematics; Biology; Computer science; Environmental health","score_opus":0.008290049680790001,"score_gpt":0.2870186780345715,"score_spread":0.2787286283537815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1965231589","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.87048465,0.0007716093,0.12689888,0.00015751678,0.000042104475,0.00011479431,0.00045850078,0.00017586097,0.00089605263],"genre_scores_gemma":[0.97729844,0.00010627256,0.022002133,0.000024733028,0.00002517187,0.000057358455,0.00026585563,0.000023465267,0.00019648486],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9800672,0.014320018,0.000805294,0.0028033236,0.0017432612,0.00026089695],"domain_scores_gemma":[0.8901362,0.090999015,0.007495511,0.008999581,0.001576381,0.00079333555],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017336052,0.0005046194,0.0010402784,0.002363694,0.00038153568,0.000867263,0.0019260636,0.0008647681,0.001293719],"category_scores_gemma":[0.08882664,0.0003094784,0.0009727891,0.0018838753,0.0013256465,0.0008064309,0.0010683872,0.00087911193,0.00019896125],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045137006,0.00007781958,0.9278873,0.00012173662,0.0015492833,0.0004138007,0.00040512407,0.009843169,0.0019784835,0.0026895667,0.00025696866,0.054325335],"study_design_scores_gemma":[0.00007639553,0.0006645273,0.8137834,0.00005383577,0.00057371886,0.002058634,0.0003274209,0.17057464,0.0030205022,0.007856738,0.0009058832,0.000104323764],"about_ca_topic_score_codex":0.0021599117,"about_ca_topic_score_gemma":0.0015304134,"teacher_disagreement_score":0.017336052,"about_ca_system_score_codex":0.00030458107,"about_ca_system_score_gemma":0.00052897027,"threshold_uncertainty_score":0.09168291},"labels":[],"label_agreement":null},{"id":"W1967188199","doi":"10.2202/1557-4679.1198","title":"Comparing Approaches to Causal Inference for Longitudinal Data: Inverse Probability Weighting versus Propensity Scores","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Propensity score matching; Causal inference; Inverse probability weighting; Estimator; Covariate; Statistics; Inverse probability; Weighting; Observational study; Average treatment effect; Econometrics; Marginal structural model; Mathematics; Inference; Mean squared error; Global Positioning System; Confidence interval; Computer science; Bayesian probability; Medicine; Posterior probability; Artificial intelligence","score_opus":0.6633736756072357,"score_gpt":0.4530269615981859,"score_spread":0.2103467140090498,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967188199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013772886,0.003558679,0.97907287,0.0015372774,0.00016913164,0.00041649552,0.00011826755,0.000086976775,0.0012675405],"genre_scores_gemma":[0.21005043,0.0054738633,0.7791818,0.0010045437,0.00048261802,0.002371414,0.00037607824,0.00013682146,0.00092241337],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.791556,0.19105457,0.0038652443,0.004471632,0.008401134,0.0006514592],"domain_scores_gemma":[0.47856212,0.47554588,0.013404661,0.023781957,0.0076217414,0.0010837438],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.16704217,0.0018821616,0.0030113724,0.0052021304,0.001211371,0.0034478582,0.0036736678,0.003432418,0.0039567263],"category_scores_gemma":[0.45431075,0.0009666079,0.003978767,0.0064383033,0.005080252,0.007334548,0.006196868,0.0049656504,0.00051613105],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001113901,0.00032916456,0.016952397,0.0020567393,0.004419539,0.00016013432,0.0016553322,0.084079504,0.000479427,0.55298644,0.0021878867,0.3335796],"study_design_scores_gemma":[0.0007090471,0.0006841912,0.005400006,0.0006302241,0.00078008504,0.00019361434,0.00033741992,0.19280916,0.00075792667,0.7909673,0.006600848,0.0001302255],"about_ca_topic_score_codex":0.0023228342,"about_ca_topic_score_gemma":0.0020360877,"teacher_disagreement_score":0.83295786,"about_ca_system_score_codex":0.002187781,"about_ca_system_score_gemma":0.0034487988,"threshold_uncertainty_score":0.883414},"labels":[],"label_agreement":null},{"id":"W1971149891","doi":"10.2202/1557-4679.1126","title":"Integration of Genetic Familial Dependence Structure in Latent Class Models","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Genomic variations and chromosomal abnormalities","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; Douglas Mental Health University Institute","funders":"National Institute of Mental Health; Canadian Institutes of Health Research","keywords":"Pedigree chart; Latent class model; Disease; Mendelian inheritance; Genetic heterogeneity; Class (philosophy); Genetics; Replicate; Local independence; Conditional independence; Econometrics; Latent variable model; Biology; Statistics; Computer science; Mathematics; Phenotype; Artificial intelligence; Gene; Medicine","score_opus":0.010834150917422828,"score_gpt":0.24257837076877728,"score_spread":0.23174421985135446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1971149891","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.074570276,0.00044774578,0.9223867,0.000630811,0.000044885674,0.00006625857,0.00033269104,0.00039337913,0.0011271742],"genre_scores_gemma":[0.873415,0.00048633007,0.12077506,0.00013262698,0.00011649658,0.00018351393,0.0007917348,0.00014767093,0.0039514964],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.994676,0.0036224278,0.00017049555,0.0008135521,0.00039978768,0.00031763458],"domain_scores_gemma":[0.976872,0.018778857,0.0014549318,0.00154167,0.0010240732,0.00032843568],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010781195,0.0009663068,0.001327198,0.001908495,0.00088890665,0.0019384199,0.001814075,0.0014539266,0.0027958918],"category_scores_gemma":[0.031199165,0.00085300504,0.0016518758,0.0017865425,0.0012907382,0.00204245,0.002154765,0.00214058,0.0005761569],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031637607,0.00016345207,0.033496063,0.000102716,0.0004636133,0.00041743089,0.0007704832,0.7527532,0.00065049337,0.1261196,0.0020661145,0.08268038],"study_design_scores_gemma":[0.000012567814,0.000015866312,0.0015738779,0.000012966536,0.000025901967,0.000058421327,0.00002379917,0.96108824,0.00007544796,0.036705475,0.00039063522,0.000016680959],"about_ca_topic_score_codex":0.015593796,"about_ca_topic_score_gemma":0.016679494,"teacher_disagreement_score":0.015593796,"about_ca_system_score_codex":0.0017419469,"about_ca_system_score_gemma":0.0012684345,"threshold_uncertainty_score":0.057017088},"labels":[],"label_agreement":null},{"id":"W1972903893","doi":"10.2202/1557-4679.1207","title":"Impact of Outcome Model Misspecification on Regression and Doubly-Robust Inverse Probability Weighting to Estimate Causal Effect","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Inverse probability weighting; Covariate; Estimator; Propensity score matching; Statistics; Average treatment effect; Econometrics; Confounding; Outcome (game theory); Regression analysis; Regression; Weighting; Mathematics; Observational study; Inverse probability; Medicine; Bayesian probability","score_opus":0.14815524905517047,"score_gpt":0.470020886576831,"score_spread":0.32186563752166053,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972903893","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010601382,0.00044916113,0.98757344,0.00040894872,0.00004022725,0.00008740557,0.000060276463,0.00021565297,0.00056353357],"genre_scores_gemma":[0.27461788,0.00066297955,0.7214687,0.00053633377,0.00013804963,0.0006378074,0.0004346357,0.00026726865,0.0012363459],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9033379,0.081817545,0.0028690181,0.004216874,0.006947817,0.0008108784],"domain_scores_gemma":[0.5505553,0.38622144,0.0150355175,0.04057668,0.006974287,0.00063673314],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1450336,0.001427099,0.0023516652,0.001796221,0.00068035943,0.0019000517,0.003358841,0.00225234,0.002711988],"category_scores_gemma":[0.42296863,0.0008446484,0.0023688471,0.0023409675,0.0027766149,0.003709892,0.0036989723,0.0034807886,0.00065370806],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001071179,0.00033634057,0.033691466,0.000976797,0.0021083585,0.0005262213,0.00124495,0.23674169,0.0033869115,0.41113752,0.0035652819,0.3052133],"study_design_scores_gemma":[0.00015507701,0.00050433114,0.008362232,0.00021200778,0.00045876694,0.00056710583,0.00016013691,0.82633406,0.004985373,0.15418996,0.003955216,0.000115686445],"about_ca_topic_score_codex":0.0033913981,"about_ca_topic_score_gemma":0.0017845045,"teacher_disagreement_score":0.8549664,"about_ca_system_score_codex":0.0009947006,"about_ca_system_score_gemma":0.0018197093,"threshold_uncertainty_score":0.76702017},"labels":[],"label_agreement":null},{"id":"W1978765295","doi":"10.2202/1557-4679.1275","title":"Sample Size Requirements for Interval Estimation of the Kappa Statistic for Interobserver Agreement Studies with a Binary Outcome and Multiple Raters","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Reliability and Agreement in Measurement","field":"Decision Sciences","cited_by":127,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Statistics; Cohen's kappa; Confidence interval; Kappa; Intraclass correlation; Mathematics; Interval estimation; Statistic; Sample size determination; Sample (material); Binary number; Limit (mathematics); Interval (graph theory); Psychometrics; Combinatorics","score_opus":0.2216258336390316,"score_gpt":0.43800712383045454,"score_spread":0.21638129019142294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1978765295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017150404,0.0012700787,0.9575879,0.0013345417,0.0005864576,0.008586189,0.0011863108,0.0006231448,0.011675022],"genre_scores_gemma":[0.13673833,0.0010202107,0.8089746,0.0013515002,0.00052799174,0.04652979,0.0019396343,0.00059599825,0.0023219078],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.79998744,0.13028161,0.020785455,0.004278774,0.04277185,0.001894894],"domain_scores_gemma":[0.24536298,0.70366955,0.009069589,0.01281633,0.028058892,0.0010226863],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17861864,0.0010694263,0.0029891576,0.0050496985,0.0012189965,0.0027049787,0.0041686567,0.0048182644,0.010825089],"category_scores_gemma":[0.5975481,0.0011060634,0.0016743371,0.002851962,0.0016209324,0.0026992282,0.0028399348,0.0028836958,0.0035946083],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.014262786,0.0013480182,0.02602221,0.0053842026,0.0004330233,0.0020249274,0.0046388023,0.036681812,0.020519309,0.14635795,0.047664132,0.6946628],"study_design_scores_gemma":[0.008194519,0.023979662,0.09354905,0.010985365,0.0014282943,0.011244902,0.0034470283,0.30837074,0.08315584,0.30145442,0.15320922,0.0009808949],"about_ca_topic_score_codex":0.0006303696,"about_ca_topic_score_gemma":0.0006430093,"teacher_disagreement_score":0.82138133,"about_ca_system_score_codex":0.0010351203,"about_ca_system_score_gemma":0.0025573082,"threshold_uncertainty_score":0.94463694},"labels":[],"label_agreement":null},{"id":"W1980199310","doi":"10.2202/1557-4679.1400","title":"Special Issue on Causal Inference in Health Research","year":2012,"lang":"en","type":"editorial","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Biostatistics; Inference; Library science; Data science; Computer science; Econometrics; Mathematics; Public health; Medicine; Artificial intelligence","score_opus":0.26051950652904116,"score_gpt":0.5478536902653409,"score_spread":0.28733418373629976,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980199310","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00001733472,0.0070583182,0.00033455226,0.012175577,0.9792509,0.000019221341,0.00008975951,0.000055994693,0.0009982908],"genre_scores_gemma":[0.00019396377,0.0040449793,0.0002011071,0.0046827304,0.9872136,0.00003073032,0.000045967387,0.000050315386,0.0035366472],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.98930687,0.0025320586,0.001700448,0.0013337363,0.0046037496,0.00052318146],"domain_scores_gemma":[0.9390982,0.033997424,0.003555599,0.0019278938,0.01641288,0.0050080763],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013037224,0.004541727,0.0059539047,0.008654956,0.0028722917,0.009612416,0.0035158026,0.009729739,0.0332571],"category_scores_gemma":[0.049167957,0.0012295072,0.0038479122,0.0040122117,0.0030331123,0.0044705803,0.0018391195,0.015695183,0.014900419],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000035971934,0.00001638012,0.000035790028,0.0004399714,0.000031051415,0.00006192366,0.000015039101,0.000047900023,0.00006178186,0.00062244956,0.9914929,0.0071388395],"study_design_scores_gemma":[0.00007779648,0.00004387456,0.0004440408,0.0009089122,0.000098915945,0.0003252181,0.00003667871,0.0003327911,0.00013602771,0.0038980849,0.9936706,0.000027019738],"about_ca_topic_score_codex":0.0014872142,"about_ca_topic_score_gemma":0.0035419264,"teacher_disagreement_score":0.0332571,"about_ca_system_score_codex":0.0036551475,"about_ca_system_score_gemma":0.005172992,"threshold_uncertainty_score":0.11125606},"labels":[],"label_agreement":null},{"id":"W1981772720","doi":"10.2202/1557-4679.1285","title":"A Tutorial on Methods to Estimating Clinically and Policy-Meaningful Measures of Treatment Effects in Prospective Observational Studies: A Review","year":2011,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":98,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Observational study; Covariate; Number needed to treat; Propensity score matching; Medicine; Randomized controlled trial; Average treatment effect; Absolute risk reduction; Relative risk; Regression toward the mean; Treatment effect; Statistics; Confidence interval; Econometrics; Mathematics; Internal medicine","score_opus":0.6067013277402696,"score_gpt":0.62685556926826,"score_spread":0.02015424152799039,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981772720","genre_codex":"review","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012121071,0.82661223,0.1629498,0.003126887,0.0018662584,0.0004980777,0.0007264602,0.00025636167,0.0038426553],"genre_scores_gemma":[0.0015423747,0.8211832,0.16788207,0.0022164194,0.0020745224,0.0022268894,0.0006331602,0.000156188,0.002085254],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98510635,0.009168173,0.0020200028,0.00081395917,0.0027511932,0.00014035204],"domain_scores_gemma":[0.91569495,0.07725851,0.0025071453,0.0013741442,0.0028876942,0.0002775555],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.021620426,0.0032189956,0.0051364936,0.009730883,0.00047410413,0.0026234302,0.0033997886,0.004047595,0.01344192],"category_scores_gemma":[0.076569885,0.001713403,0.004170728,0.013134905,0.0019099223,0.0046237693,0.0017233677,0.005102483,0.008252285],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009113369,0.00011708284,0.00045710697,0.062336843,0.0009136949,0.0002454392,0.00026469503,0.0053633116,0.00069193967,0.08400664,0.099336736,0.74617547],"study_design_scores_gemma":[0.0001232604,0.00020150158,0.0014800765,0.04123127,0.0006747498,0.0009639252,0.00013555528,0.004265593,0.0006201425,0.19552574,0.7545768,0.0002013431],"about_ca_topic_score_codex":0.00327963,"about_ca_topic_score_gemma":0.0036914095,"teacher_disagreement_score":0.97837955,"about_ca_system_score_codex":0.0023913078,"about_ca_system_score_gemma":0.0044627176,"threshold_uncertainty_score":0.11434108},"labels":[],"label_agreement":null},{"id":"W1982299419","doi":"10.1515/1557-4679.1397","title":"Partial Identification arising from Nondifferential Exposure Misclassification: How Informative are Data on the Unlikely, Maybe, and Likely Exposed?","year":2012,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Health, Environment, Cognitive Aging","field":"Environmental Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"QLT (Canada); University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Classification scheme; Identification (biology); Binary classification; Binary number; Statistics; Econometrics; Computer science; Mathematics; Machine learning","score_opus":0.06139565210296041,"score_gpt":0.28638876363063964,"score_spread":0.22499311152767923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1982299419","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2419559,0.00916514,0.7147587,0.024706945,0.0008210091,0.00047801796,0.0023334413,0.00032033227,0.0054605603],"genre_scores_gemma":[0.916339,0.00241721,0.071358055,0.0052304855,0.001125967,0.000497592,0.0015473412,0.00007034475,0.0014139871],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9260638,0.052286133,0.0049435156,0.00979993,0.0053564007,0.0015502607],"domain_scores_gemma":[0.38768217,0.5489339,0.022249082,0.03499196,0.0047679693,0.00137499],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15844384,0.0014174958,0.004758313,0.0031957668,0.002360579,0.005566973,0.0050477413,0.0061063967,0.002864462],"category_scores_gemma":[0.49990907,0.0013490937,0.0031222575,0.0041787266,0.011072824,0.012422035,0.0054006213,0.006790511,0.0005030181],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0020259463,0.00033044963,0.33996728,0.0027285689,0.0037372482,0.002065391,0.0066214968,0.057987418,0.0010122907,0.20766164,0.007374092,0.3684881],"study_design_scores_gemma":[0.0001330493,0.00025325274,0.04852671,0.0012415104,0.0008879268,0.0015143851,0.0011872164,0.07172718,0.001516219,0.86728084,0.0055490187,0.00018256478],"about_ca_topic_score_codex":0.0026360883,"about_ca_topic_score_gemma":0.0024406107,"teacher_disagreement_score":0.8415562,"about_ca_system_score_codex":0.0014013961,"about_ca_system_score_gemma":0.0018983335,"threshold_uncertainty_score":0.8379411},"labels":[],"label_agreement":null},{"id":"W1986251233","doi":"10.2202/1557-4679.1305","title":"Modeling Fetal Weight for Gestational Age: A Comparison of a Flexible Multi-level Spline-based Model with Other Approaches","year":2011,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Pregnancy and preeclampsia studies","field":"Medicine","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre","funders":"Canadian Institutes of Health Research","keywords":"Gestational age; Pointwise; Mathematics; Fetal weight; Covariance; Fetus; Statistics; Spline (mechanical); Confidence interval; Analysis of covariance; Medicine; Pregnancy; Biology","score_opus":0.3369837490580015,"score_gpt":0.3615435908988037,"score_spread":0.024559841840802232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1986251233","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.057135414,0.0007488723,0.9394703,0.0009528128,0.000072826566,0.00015530377,0.0004320796,0.00032558333,0.0007069368],"genre_scores_gemma":[0.65472114,0.0012653751,0.33900726,0.00029373105,0.00011242141,0.00089719193,0.00094312604,0.00023932829,0.0025204578],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9940247,0.004387009,0.00022510119,0.0004896219,0.00059568795,0.00027789237],"domain_scores_gemma":[0.98546857,0.011355004,0.00093943113,0.0012765886,0.0006804415,0.00027992908],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013409367,0.0008308023,0.0015210153,0.0014503814,0.0005193155,0.0014853871,0.004549354,0.001754886,0.0021463302],"category_scores_gemma":[0.026127698,0.00042903807,0.0027156132,0.002159218,0.0007262996,0.0012944074,0.0018633318,0.0021833698,0.00037443117],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000715751,0.00019752164,0.010671475,0.00024508373,0.00051477115,0.00023152378,0.00046044006,0.87011427,0.0009525193,0.03715619,0.0009683308,0.077772066],"study_design_scores_gemma":[0.000101663914,0.00023232494,0.0023401717,0.000048463015,0.000109311455,0.00006592415,0.000059912014,0.98321474,0.00018417946,0.012553841,0.0010431961,0.00004629205],"about_ca_topic_score_codex":0.015735883,"about_ca_topic_score_gemma":0.010287636,"teacher_disagreement_score":0.015735883,"about_ca_system_score_codex":0.001124976,"about_ca_system_score_gemma":0.0023115748,"threshold_uncertainty_score":0.070916355},"labels":[],"label_agreement":null},{"id":"W2011025113","doi":"10.2202/1557-4679.1121","title":"IPCW Estimator for Kendall's Tau under Bivariate Censoring","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds Québécois de la Recherche sur la Nature et les Technologies","keywords":"Estimator; Mathematics; Bivariate analysis; Statistics; Censoring (clinical trials); Nonparametric statistics; Econometrics; Consistent estimator; Efficient estimator; Minimum-variance unbiased estimator","score_opus":0.13811726294086882,"score_gpt":0.468761519193858,"score_spread":0.3306442562529892,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2011025113","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014217476,0.000943726,0.9817571,0.00018482315,0.00010569542,0.00008605458,0.0002308805,0.00022445308,0.0022497],"genre_scores_gemma":[0.4400875,0.0024871337,0.550183,0.00026592688,0.00074779964,0.0012451578,0.0014908493,0.000323067,0.003169632],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9916502,0.0050818375,0.00029068516,0.000986315,0.0016708389,0.0003201763],"domain_scores_gemma":[0.9620803,0.024057068,0.004491522,0.005819239,0.0030727207,0.00047905568],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012960953,0.00078633777,0.0017624015,0.0035534292,0.00072255573,0.0023802482,0.0026038243,0.0011103451,0.0024127385],"category_scores_gemma":[0.07298988,0.00045198743,0.0010158598,0.0046579586,0.0013469247,0.0027732116,0.0020812163,0.0024035114,0.00082372903],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019704588,0.00022965421,0.04340131,0.000871512,0.00070505677,0.0004947298,0.0006959006,0.07713669,0.0030772188,0.36374795,0.008427416,0.50101554],"study_design_scores_gemma":[0.00006807409,0.00054595387,0.026217772,0.00034215554,0.0003359275,0.0011406295,0.00032348902,0.6339664,0.004638442,0.3120031,0.020185035,0.00023300851],"about_ca_topic_score_codex":0.0014774014,"about_ca_topic_score_gemma":0.0009392916,"teacher_disagreement_score":0.012960953,"about_ca_system_score_codex":0.0005704728,"about_ca_system_score_gemma":0.0020570464,"threshold_uncertainty_score":0.068544924},"labels":[],"label_agreement":null},{"id":"W2021255504","doi":"10.1515/1557-4679.1419","title":"Testing the assumptions for the analysis of survival data arising from a prevalent cohort study with follow-up","year":2012,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; Université du Québec à Montréal","funders":"Medical Research Council; Health Canada; Pfizer Canada; University of Ottawa; Pfizer","keywords":"Censoring (clinical trials); Mathematics; Statistics; Truncation (statistics); Counting process; Event (particle physics); Survival analysis; Survival function; Econometrics; Independence (probability theory); Kaplan–Meier estimator","score_opus":0.11640586232519527,"score_gpt":0.3890585567505665,"score_spread":0.2726526944253712,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021255504","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07654383,0.0003005236,0.91696686,0.0013955774,0.00009131548,0.0013212048,0.0008084697,0.00014699652,0.0024251707],"genre_scores_gemma":[0.61625236,0.00060005806,0.36819318,0.0013662436,0.00028808953,0.008532129,0.0024980053,0.000097769014,0.0021721527],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85309625,0.1084332,0.0077608936,0.0118636405,0.016324436,0.0025216222],"domain_scores_gemma":[0.23420024,0.71499354,0.0173418,0.028697625,0.0038351147,0.0009317098],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2432146,0.001400603,0.0024757737,0.0020591014,0.0016100523,0.0031304162,0.0076685343,0.0053350916,0.005362861],"category_scores_gemma":[0.55555314,0.0012285461,0.0045793275,0.002273003,0.010312621,0.0075558424,0.006381726,0.005625619,0.00091418024],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0047369935,0.00089750096,0.18519206,0.0017641194,0.0025184161,0.0063439417,0.0057164608,0.11646518,0.0053474098,0.58055586,0.0027041924,0.087757915],"study_design_scores_gemma":[0.0009993325,0.0028664838,0.040211298,0.00065115246,0.000461414,0.002041833,0.0013735712,0.50594646,0.0057731206,0.43398747,0.0055362,0.0001516675],"about_ca_topic_score_codex":0.0016773177,"about_ca_topic_score_gemma":0.0008676974,"teacher_disagreement_score":0.7567854,"about_ca_system_score_codex":0.0016087673,"about_ca_system_score_gemma":0.0036459956,"threshold_uncertainty_score":0.93325114},"labels":[],"label_agreement":null},{"id":"W2021583648","doi":"10.2202/1557-4679.1208","title":"Accuracy of Conventional and Marginal Structural Cox Model Estimators: A Simulation Study","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":82,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Gas Technologies Centre; Montreal General Hospital; McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Covariate; Marginal structural model; Proportional hazards model; Estimator; Statistics; Inverse probability weighting; Weighting; Logistic regression; Marginal model; Confounding; Econometrics; Inverse probability; Mathematics; Censoring (clinical trials); Accelerated failure time model; Regression analysis; Computer science; Medicine; Bayesian probability","score_opus":0.0926583015508293,"score_gpt":0.4578373595405563,"score_spread":0.36517905798972705,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021583648","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.59911644,0.0024763965,0.38995466,0.0017793442,0.0001221879,0.00040003852,0.0011164721,0.00039658713,0.004637905],"genre_scores_gemma":[0.92547673,0.00043917142,0.07222096,0.00012099325,0.00003565506,0.00027404676,0.0006306698,0.00007962912,0.00072214723],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98446757,0.013023257,0.0005064835,0.00082748453,0.0008568872,0.00031823455],"domain_scores_gemma":[0.6138229,0.35689494,0.0073841033,0.013829649,0.007083357,0.0009850486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05044941,0.00079981104,0.0013931182,0.0012323023,0.0005939521,0.0011018546,0.001982216,0.0019150048,0.0026562004],"category_scores_gemma":[0.18257326,0.00042516415,0.0012018346,0.0015286119,0.0014811787,0.0021411504,0.001632953,0.0019239343,0.00026469247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0021193814,0.00037889276,0.040580973,0.0004155975,0.00059366773,0.00024748157,0.00072553894,0.8532263,0.0010756386,0.059880063,0.0025389718,0.038217407],"study_design_scores_gemma":[0.00020294265,0.0003487495,0.0033718864,0.00008678751,0.000112602356,0.00013163933,0.00013611159,0.97535056,0.00072310417,0.01862945,0.0008575462,0.000048668808],"about_ca_topic_score_codex":0.0063602095,"about_ca_topic_score_gemma":0.0043331576,"teacher_disagreement_score":0.94955057,"about_ca_system_score_codex":0.0014908705,"about_ca_system_score_gemma":0.0013957376,"threshold_uncertainty_score":0.26680523},"labels":[],"label_agreement":null},{"id":"W2035794422","doi":"10.2202/1557-4679.1096","title":"Properties of the Projected Length of the Curve (PLC) and Area Swept out by the Curve (ASC) Indices for the Receiver Operating Characteristic (SROC) Curve","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Global Cancer Incidence and Screening","field":"Medicine","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McMaster University","funders":"","keywords":"Receiver operating characteristic; Area under the curve; Context (archaeology); Statistics; Diagnostic odds ratio; Mathematics; Area under curve; Medicine; Internal medicine","score_opus":0.07648062217362388,"score_gpt":0.32806790220197146,"score_spread":0.25158728002834757,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2035794422","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025610747,0.018920965,0.94419205,0.002295301,0.00033705085,0.00070341554,0.0012869439,0.0011472823,0.0055062724],"genre_scores_gemma":[0.48968092,0.011545026,0.4842684,0.0024362982,0.0017159245,0.0037127594,0.003227223,0.0012893253,0.0021241917],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9383896,0.034683034,0.00568392,0.007821195,0.012411597,0.0010106278],"domain_scores_gemma":[0.5201442,0.40295318,0.033219017,0.022683317,0.019229732,0.0017705437],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10119332,0.0032541456,0.003889707,0.01177397,0.0011679528,0.006439872,0.0035581752,0.0047568404,0.0025042875],"category_scores_gemma":[0.37882492,0.0013710061,0.00557503,0.0083649615,0.0074582254,0.010916482,0.0056972327,0.0056898636,0.0015265276],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015148504,0.00025871955,0.121008284,0.0045234887,0.0053378292,0.0010115515,0.0029643339,0.21783394,0.003587022,0.2065846,0.01489393,0.42048135],"study_design_scores_gemma":[0.0002956578,0.002258663,0.064822674,0.0018489226,0.0014891675,0.0049576825,0.0009411267,0.48188612,0.0032201638,0.4051426,0.03210158,0.0010356343],"about_ca_topic_score_codex":0.0022179035,"about_ca_topic_score_gemma":0.00074678904,"teacher_disagreement_score":0.10119332,"about_ca_system_score_codex":0.0030555774,"about_ca_system_score_gemma":0.0022773524,"threshold_uncertainty_score":0.5351678},"labels":[],"label_agreement":null},{"id":"W2040731810","doi":"10.1515/ijb-2012-0033","title":"A New Species Abundance Distribution Model Based on Model Combination","year":2013,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Species Distribution and Climate Change","field":"Environmental Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor","funders":"","keywords":"Relative abundance distribution; Computer science; Abundance (ecology); Machine learning; Artificial intelligence; Parameterized complexity; Decomposition; Ecology; Data mining; Relative species abundance; Algorithm; Biology","score_opus":0.02357858520210514,"score_gpt":0.25322271284242714,"score_spread":0.229644127640322,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2040731810","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015952395,0.0001854195,0.9819696,0.00017599438,0.000045674962,0.000037109057,0.00018951128,0.00032314123,0.0011211298],"genre_scores_gemma":[0.63770294,0.00053567404,0.3535256,0.00036262567,0.0002402368,0.0005768348,0.0014286618,0.00028010184,0.005347273],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99903727,0.00030656045,0.000053171923,0.00031417527,0.00020940565,0.000079507656],"domain_scores_gemma":[0.9986457,0.00079174305,0.00018511133,0.00009969518,0.00019969816,0.00007808912],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017414155,0.0012201843,0.0015418526,0.0015877547,0.0004287284,0.001476208,0.0023519413,0.0014363717,0.0016984862],"category_scores_gemma":[0.003500357,0.00075731095,0.0019004714,0.0017376035,0.0006128171,0.0027510566,0.0013453003,0.0018156681,0.00046973844],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004495458,0.000051663017,0.0023841092,0.000043389522,0.0001149647,0.00008121953,0.000038894035,0.9673396,0.001338843,0.0053794123,0.0008704502,0.022312526],"study_design_scores_gemma":[0.0000031865382,0.0000074332693,0.00010242296,0.0000017210392,0.000006853676,0.00001833915,0.0000017255818,0.9978345,0.000074006784,0.0017676664,0.0001776694,0.000004507104],"about_ca_topic_score_codex":0.0038007626,"about_ca_topic_score_gemma":0.0031018222,"teacher_disagreement_score":0.0038007626,"about_ca_system_score_codex":0.0007864165,"about_ca_system_score_gemma":0.0008310458,"threshold_uncertainty_score":0.009209573},"labels":[],"label_agreement":null},{"id":"W2041711816","doi":"10.2202/1557-4679.1206","title":"Bayesian Inference for Partially Identified Models","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Bayesian Modeling and Causal Inference","field":"Computer Science","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Identification (biology); Inference; A priori and a posteriori; Bayesian probability; Frequentist inference; Computer science; Econometrics; Posterior probability; Bayesian inference; Set (abstract data type); Limit (mathematics); Observable; Point estimation; Prior probability; Posterior predictive distribution; Mathematics; Data mining; Statistics; Artificial intelligence; Bayesian linear regression; Physics","score_opus":0.03368752178275909,"score_gpt":0.3163777343436428,"score_spread":0.2826902125608837,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2041711816","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007909145,0.001082296,0.98659664,0.0014027051,0.000042992826,0.00004199718,0.0003081158,0.00014219891,0.0024739073],"genre_scores_gemma":[0.5983868,0.004861756,0.38737643,0.001120585,0.00051158253,0.0007544724,0.0015298311,0.00018368998,0.005274838],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9879149,0.0081706755,0.00048965786,0.0015686986,0.0014784511,0.00037756038],"domain_scores_gemma":[0.9076579,0.081944704,0.004446077,0.0034780093,0.0019084673,0.00056484767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017532557,0.0012426511,0.0027978534,0.0032918544,0.001483599,0.00394694,0.0032832203,0.00306814,0.0041693514],"category_scores_gemma":[0.110440515,0.0014681163,0.002261112,0.0029861208,0.0036711625,0.0069293035,0.003228431,0.0048032175,0.00058672734],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055997538,0.00003291078,0.0021206809,0.0002471439,0.00018912116,0.00025244005,0.00035803393,0.14739394,0.00017917708,0.823878,0.0019459481,0.023346635],"study_design_scores_gemma":[0.00001351231,0.000007455278,0.00030715187,0.000049652936,0.000030376992,0.000057292174,0.000038211212,0.20661479,0.00008695327,0.7914869,0.0012903685,0.000017405055],"about_ca_topic_score_codex":0.006909235,"about_ca_topic_score_gemma":0.0068435282,"teacher_disagreement_score":0.017532557,"about_ca_system_score_codex":0.0029866775,"about_ca_system_score_gemma":0.0026506232,"threshold_uncertainty_score":0.09272212},"labels":[],"label_agreement":null},{"id":"W2043714498","doi":"10.2202/1557-4679.1177","title":"Interval Estimation of Some Epidemiological Measures of Association","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Windsor; University of New Brunswick","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Statistics; Confidence interval; Mathematics; Estimator; Relative risk; Interval estimation; Coverage probability; Econometrics","score_opus":0.09281863447476195,"score_gpt":0.4080686945668315,"score_spread":0.3152500600920695,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2043714498","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0065794857,0.004051316,0.9852749,0.00050326,0.0002627745,0.0002259678,0.0006028061,0.00028646027,0.002213028],"genre_scores_gemma":[0.21944177,0.005593911,0.7675391,0.0006422818,0.00081082765,0.0023620185,0.0020613298,0.00016879811,0.0013799459],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9444697,0.041161045,0.0028943727,0.0049503515,0.0059462003,0.0005783812],"domain_scores_gemma":[0.66346306,0.2957512,0.016672721,0.013851859,0.009434486,0.0008266534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.067350894,0.0019146148,0.0029110308,0.00656517,0.0006766143,0.0034505054,0.0047222087,0.0031656795,0.003894419],"category_scores_gemma":[0.31200066,0.00083578646,0.0028161712,0.005827919,0.0026010505,0.0053389496,0.0033586416,0.0057871807,0.0007215222],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00081592426,0.000268941,0.03585869,0.0030263022,0.0032935427,0.00058652833,0.0018418207,0.12154598,0.0012618175,0.46984088,0.007990014,0.3536694],"study_design_scores_gemma":[0.0002878382,0.00087425567,0.019577764,0.0016932201,0.001060868,0.0010799957,0.00068860786,0.40705532,0.0023493588,0.5375309,0.027431965,0.0003699315],"about_ca_topic_score_codex":0.0021397246,"about_ca_topic_score_gemma":0.00066665845,"teacher_disagreement_score":0.067350894,"about_ca_system_score_codex":0.001433251,"about_ca_system_score_gemma":0.0013757325,"threshold_uncertainty_score":0.35618985},"labels":[],"label_agreement":null},{"id":"W2044055253","doi":"10.2202/1557-4679.1178","title":"A Comparison of Variable Selection Approaches for Dynamic Treatment Regimes","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute of Mental Health; Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research","keywords":"Econometrics; Variable (mathematics); Selection (genetic algorithm); Statistics; Feature selection; Mathematics; Computer science; Artificial intelligence","score_opus":0.14747852943176956,"score_gpt":0.43733046187766667,"score_spread":0.28985193244589713,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2044055253","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.066588275,0.0069137528,0.9191629,0.0019581493,0.00017270516,0.0005908626,0.000254486,0.00074065936,0.003618185],"genre_scores_gemma":[0.4941586,0.0041244826,0.49648008,0.0006831546,0.00027356783,0.0011605868,0.0008800641,0.00023483779,0.0020046008],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97421426,0.021678891,0.0007795411,0.0009756938,0.0020255027,0.00032616855],"domain_scores_gemma":[0.9172626,0.0763845,0.0013159299,0.0020623365,0.002493933,0.00048055386],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.037634686,0.0011796542,0.0023596515,0.0042425077,0.0006096616,0.0016764938,0.0018387967,0.00161782,0.0023624192],"category_scores_gemma":[0.061137337,0.0004942592,0.002471418,0.0028946646,0.0012502016,0.0017989915,0.0019919418,0.0024408603,0.00047154038],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002625321,0.00028702014,0.011008049,0.0007722508,0.0016576209,0.0000829392,0.0008223685,0.2966191,0.0009086116,0.06211403,0.0030140947,0.6200887],"study_design_scores_gemma":[0.0004560388,0.00081806036,0.005449532,0.00019780283,0.00028483444,0.00007840518,0.00024860434,0.9390409,0.0006946689,0.049796086,0.002859385,0.00007561785],"about_ca_topic_score_codex":0.0027422952,"about_ca_topic_score_gemma":0.003178562,"teacher_disagreement_score":0.037634686,"about_ca_system_score_codex":0.0013836958,"about_ca_system_score_gemma":0.0019842235,"threshold_uncertainty_score":0.19903362},"labels":[],"label_agreement":null},{"id":"W2045128971","doi":"10.2202/1557-4679.1093","title":"A Marginal Mixture Model for Selecting Differentially Expressed Genes across Two Types of Tissue Samples","year":2008,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; Western University","funders":"National Human Genome Research Institute; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Bayesian hierarchical modeling; Bayesian probability; Marginal model; Data set; Mixture model; Multivariate statistics; Bayesian information criterion; Model selection; Selection (genetic algorithm); Set (abstract data type); Mathematics; Marginal likelihood; Covariance; Biology; Statistics; Computer science; Bayes' theorem; Artificial intelligence; Regression analysis","score_opus":0.03631164427114852,"score_gpt":0.33552823760263933,"score_spread":0.2992165933314908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2045128971","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061877933,0.00010560369,0.99302906,0.00007613228,0.000012056943,0.00005826458,0.00009728064,0.00025201897,0.0001818194],"genre_scores_gemma":[0.18837416,0.0003885744,0.8053167,0.00024988153,0.000087574066,0.0010175122,0.0014553627,0.00016711773,0.002943076],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.996923,0.0013604058,0.00012913941,0.0006371729,0.00075361563,0.00019661893],"domain_scores_gemma":[0.99664634,0.002340097,0.00021955666,0.00030323042,0.00039748917,0.00009326576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0064117564,0.001241847,0.0018275367,0.0021937818,0.0007489985,0.0013789069,0.0031421145,0.0017151084,0.0023338497],"category_scores_gemma":[0.012933048,0.0008399628,0.0024281475,0.002411854,0.0013544817,0.0018746244,0.0012870639,0.0021431819,0.001189097],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011673582,0.00029076776,0.014678248,0.00037071705,0.00059067534,0.0003566171,0.00071670586,0.48503795,0.018699711,0.14236705,0.005912559,0.32981157],"study_design_scores_gemma":[0.00006439924,0.00007043692,0.0019554147,0.00001721756,0.00007521541,0.00014856976,0.000025899473,0.9611781,0.0019047158,0.032670777,0.0018373905,0.000051830695],"about_ca_topic_score_codex":0.006236582,"about_ca_topic_score_gemma":0.0054463814,"teacher_disagreement_score":0.0064117564,"about_ca_system_score_codex":0.0012107862,"about_ca_system_score_gemma":0.0016324042,"threshold_uncertainty_score":0.033909023},"labels":[],"label_agreement":null},{"id":"W2051129785","doi":"10.2202/1557-4679.1171","title":"Inference in Epidemic Models without Likelihoods","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":194,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Natural Sciences and Engineering Research Council of Canada; Biotechnology and Biological Sciences Research Council; Directorate for Biological Sciences","keywords":"Inference; Markov chain Monte Carlo; Computer science; Monte Carlo method; Econometrics; Data mining; Statistics; Machine learning; Artificial intelligence; Mathematics; Bayesian probability","score_opus":0.0851133174261388,"score_gpt":0.42630224393751154,"score_spread":0.3411889265113727,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2051129785","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008483788,0.00043079007,0.9892057,0.0006734136,0.000031650394,0.000045233533,0.00012227692,0.00029210493,0.0007150568],"genre_scores_gemma":[0.36789656,0.0016408286,0.6255092,0.00063364755,0.00025540355,0.00044574574,0.00077185687,0.00033157502,0.0025152147],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9820424,0.013669171,0.0008179413,0.001700049,0.0013139091,0.00045660668],"domain_scores_gemma":[0.7836256,0.19968055,0.0050362223,0.008092329,0.0026950322,0.0008702226],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.045771305,0.0015119726,0.0035023682,0.0034182502,0.0016175153,0.0046590553,0.0037811839,0.0039606523,0.004756791],"category_scores_gemma":[0.22900455,0.0024616073,0.002411136,0.0030840088,0.0050353585,0.010357741,0.0038155485,0.005053356,0.00089204893],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013186349,0.00005142834,0.0038587295,0.00020636235,0.00022117418,0.00022405786,0.00026330352,0.7121635,0.00030877136,0.25435045,0.00093772454,0.027282614],"study_design_scores_gemma":[0.00003204515,0.000014729466,0.00023098929,0.00003749089,0.000017855284,0.00005260181,0.000022295046,0.7747467,0.0001494413,0.22415599,0.0005202933,0.00001956788],"about_ca_topic_score_codex":0.01516664,"about_ca_topic_score_gemma":0.009574087,"teacher_disagreement_score":0.045771305,"about_ca_system_score_codex":0.0028015345,"about_ca_system_score_gemma":0.0038692974,"threshold_uncertainty_score":0.24206465},"labels":[],"label_agreement":null},{"id":"W2054723033","doi":"10.2202/1557-4679.1146","title":"Type I Error Rates, Coverage of Confidence Intervals, and Variance Estimation in Propensity-Score Matched Analyses","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":189,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Statistics; Confidence interval; Matching (statistics); Sample size determination; Observational study; Hazard ratio; Poisson regression; Type I and type II errors; Mathematics; Selection bias; Poisson distribution; Econometrics; Medicine; Population","score_opus":0.23169680834955775,"score_gpt":0.46242425669277515,"score_spread":0.2307274483432174,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2054723033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0052441065,0.0044810395,0.9867426,0.0008945862,0.00024909517,0.00047202318,0.0003055808,0.00023315655,0.0013777409],"genre_scores_gemma":[0.29661176,0.0060852175,0.6869287,0.0013255121,0.0010812387,0.005370577,0.0011197515,0.00040716465,0.0010702069],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.6799797,0.26440543,0.016456863,0.017397465,0.020204082,0.0015565029],"domain_scores_gemma":[0.19884063,0.7287346,0.03428483,0.026753936,0.01088512,0.00050084066],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.27885512,0.0023112427,0.004143573,0.0075397408,0.001485885,0.004678737,0.005224054,0.0055937828,0.0035350027],"category_scores_gemma":[0.7340432,0.0016432436,0.0048892577,0.008723359,0.0062710135,0.005747603,0.0049688537,0.006971731,0.0006051914],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010232007,0.00030270024,0.06469521,0.0060871798,0.005972852,0.0013285363,0.0031087517,0.1631899,0.0012244701,0.44423738,0.010575034,0.2982547],"study_design_scores_gemma":[0.00032693593,0.00042555292,0.014341702,0.0025950603,0.0022136122,0.001020498,0.00045832281,0.3275161,0.0033883885,0.6320861,0.015382019,0.00024569387],"about_ca_topic_score_codex":0.0044321236,"about_ca_topic_score_gemma":0.0019413539,"teacher_disagreement_score":0.7211449,"about_ca_system_score_codex":0.002807183,"about_ca_system_score_gemma":0.0051946584,"threshold_uncertainty_score":0.88930005},"labels":[],"label_agreement":null},{"id":"W2054829060","doi":"10.2202/1557-4679.1205","title":"Cutting Feedback in Bayesian Regression Adjustment for the Propensity Score","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Bayesian probability; Outcome (game theory); Bayesian linear regression; Statistics; Regression; Econometrics; Bayes' theorem; Confounding; Regression analysis; Posterior probability; Mathematics; Bayesian inference; Computer science","score_opus":0.1513029616466612,"score_gpt":0.41370864719192163,"score_spread":0.26240568554526045,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2054829060","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014185753,0.00020420365,0.9973737,0.000307983,0.00003043895,0.000034776363,0.000022506476,0.00014547948,0.00046233373],"genre_scores_gemma":[0.12666117,0.0008134567,0.86700237,0.0007323013,0.00024777153,0.00046196807,0.00012903877,0.00028810394,0.0036637667],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.976103,0.017796306,0.0005350171,0.001687865,0.0033118727,0.00056591176],"domain_scores_gemma":[0.9611466,0.03235106,0.0019183517,0.0026123628,0.0016921405,0.0002794004],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026536591,0.0010208426,0.0018403272,0.0018118713,0.0010151081,0.0016819366,0.002475014,0.0018651542,0.004949836],"category_scores_gemma":[0.107863516,0.0012178818,0.0016692955,0.0022321767,0.0022317998,0.0031733252,0.0030143776,0.0041376287,0.0011186523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026589676,0.00010087294,0.0028843367,0.00027277818,0.00034028065,0.00016366331,0.0005637614,0.12262138,0.001498988,0.55034393,0.005064047,0.31588],"study_design_scores_gemma":[0.0001263694,0.000084613835,0.0010730192,0.00008241448,0.00008703201,0.00010624182,0.000031557447,0.51690173,0.0011569439,0.4724357,0.007849329,0.00006511816],"about_ca_topic_score_codex":0.006390815,"about_ca_topic_score_gemma":0.005764041,"teacher_disagreement_score":0.026536591,"about_ca_system_score_codex":0.00182357,"about_ca_system_score_gemma":0.0025326419,"threshold_uncertainty_score":0.14034063},"labels":[],"label_agreement":null},{"id":"W2055588546","doi":"10.2202/1557-4679.1240","title":"Special Issue on Causal Inference","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Causal inference; Biostatistics; Inference; Computer science; Library science; Econometrics; Data science; Management science; Mathematics; Engineering; Medicine; Artificial intelligence; Public health","score_opus":0.07737566703058796,"score_gpt":0.4291898214705514,"score_spread":0.35181415443996344,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2055588546","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00008727104,0.016625071,0.0022531336,0.033489514,0.9413385,0.000059404123,0.00035589893,0.00016135568,0.0056298883],"genre_scores_gemma":[0.0005545886,0.0066117966,0.0006086984,0.009102243,0.97406805,0.000070772345,0.00020950385,0.00013704906,0.008637333],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9921745,0.0018353362,0.0011273725,0.0015169651,0.002864813,0.00048106955],"domain_scores_gemma":[0.9422838,0.034613848,0.003326264,0.0033946158,0.0117289405,0.004652549],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010176586,0.0028715339,0.0044758446,0.0067593483,0.002354955,0.0072211623,0.0029775342,0.008857664,0.06821808],"category_scores_gemma":[0.047069535,0.0011212352,0.0032258693,0.0030615197,0.0025533317,0.004492968,0.00272718,0.011437286,0.0243401],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003128047,0.000020701702,0.000089211964,0.00037160734,0.00003841719,0.00008960171,0.000019970035,0.00008244685,0.00010773781,0.0024674227,0.98086965,0.015811985],"study_design_scores_gemma":[0.0000334536,0.00004457021,0.0004852819,0.000452836,0.00005505996,0.000366469,0.00002594994,0.00027145282,0.00009377464,0.009284961,0.98886466,0.000021609429],"about_ca_topic_score_codex":0.0011372676,"about_ca_topic_score_gemma":0.0016057441,"teacher_disagreement_score":0.06821808,"about_ca_system_score_codex":0.003035172,"about_ca_system_score_gemma":0.003972249,"threshold_uncertainty_score":0.22821224},"labels":[],"label_agreement":null},{"id":"W2059020892","doi":"10.2202/1557-4679.1179","title":"A Comparison of the Statistical Power of Different Methods for the Analysis of Repeated Cross-Sectional Cluster Randomization Trials with Binary Outcomes","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Sample size determination; Cluster randomised controlled trial; Statistical power; Generalized estimating equation; Baseline (sea); Cluster (spacecraft); Mathematics; Random effects model; Marginal model; Randomization; Homogeneity (statistics); Econometrics; Regression analysis; Medicine; Randomized controlled trial; Computer science; Meta-analysis; Internal medicine","score_opus":0.10719052713115843,"score_gpt":0.5200359822670371,"score_spread":0.41284545513587867,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059020892","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.046881624,0.013117357,0.9243819,0.0020496524,0.0011619721,0.007877056,0.000739493,0.00064892997,0.003141885],"genre_scores_gemma":[0.2846161,0.0037172632,0.682432,0.0011180626,0.00034477445,0.025840765,0.0005929899,0.00045981637,0.0008781697],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.38693956,0.5687589,0.014704387,0.010935724,0.017692007,0.0009693619],"domain_scores_gemma":[0.13133016,0.81846225,0.015552125,0.024737312,0.009197387,0.000720829],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.48846915,0.0027059976,0.006070864,0.0061498582,0.0011966537,0.0037255648,0.004162981,0.0057283207,0.0064538512],"category_scores_gemma":[0.72804064,0.0016707447,0.009633243,0.0060391095,0.005353931,0.005466018,0.003909849,0.005290841,0.00062854885],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.06342996,0.0018517888,0.031040002,0.020099107,0.07821622,0.00050629355,0.0047553624,0.06325827,0.0042784535,0.13870798,0.0100431,0.5838135],"study_design_scores_gemma":[0.048100688,0.030455645,0.06305693,0.013493017,0.036621034,0.002044187,0.0012339392,0.39870286,0.0152849825,0.35403422,0.03482623,0.0021461954],"about_ca_topic_score_codex":0.0010455198,"about_ca_topic_score_gemma":0.00095865846,"teacher_disagreement_score":0.5115309,"about_ca_system_score_codex":0.002792958,"about_ca_system_score_gemma":0.003281375,"threshold_uncertainty_score":0.6308086},"labels":[],"label_agreement":null},{"id":"W2074774273","doi":"10.2202/1557-4679.1224","title":"A First Passage Time Model for Long-Term Survivors with Competing Risks","year":2011,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Expectation–maximization algorithm; Inverse Gaussian distribution; Term (time); Gompertz function; Econometrics; Computer science; Maximization; Accelerated failure time model; Statistics; Maximum likelihood; Distribution (mathematics); Mathematics; Covariate; Mathematical optimization","score_opus":0.556491896583013,"score_gpt":0.5140196862311603,"score_spread":0.04247221035185267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074774273","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03842579,0.002149325,0.9494961,0.0037802046,0.00040211645,0.00028311723,0.0009072439,0.00027809915,0.004278108],"genre_scores_gemma":[0.7387417,0.0054743025,0.1886506,0.0014921644,0.0011845068,0.0027202014,0.002336669,0.00037566386,0.059024233],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9955258,0.0025853338,0.00020202284,0.0007241684,0.0005641026,0.00039864454],"domain_scores_gemma":[0.96170485,0.032237377,0.0027028928,0.0009689314,0.0013615738,0.0010243807],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018862568,0.002450946,0.0034539732,0.0022116147,0.0010034608,0.0031940113,0.0068414286,0.0050643743,0.009521289],"category_scores_gemma":[0.043275308,0.0012196567,0.0029190388,0.002262779,0.0026031802,0.0039816136,0.0027303917,0.00564277,0.0017346191],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00026587056,0.00016542604,0.004408785,0.0004733354,0.00033376145,0.0011149801,0.0007447591,0.4815306,0.00084703014,0.4948967,0.003119524,0.0120992735],"study_design_scores_gemma":[0.00018063303,0.00023677644,0.00073196925,0.00007205644,0.00017718742,0.0004170138,0.00007058556,0.85981685,0.00021684503,0.1349298,0.003072752,0.000077546654],"about_ca_topic_score_codex":0.007603383,"about_ca_topic_score_gemma":0.0036740743,"teacher_disagreement_score":0.018862568,"about_ca_system_score_codex":0.0021291978,"about_ca_system_score_gemma":0.0028275857,"threshold_uncertainty_score":0.09975594},"labels":[],"label_agreement":null},{"id":"W2075362134","doi":"10.2202/1557-4679.1209","title":"Balancing and Elimination of Nuisance Variables","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Bayesian Modeling and Causal Inference","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariate; Nuisance parameter; Counterfactual thinking; Econometrics; Mathematics; Statistics; Confounding; Propensity score matching; Regression analysis; Regression; Psychology; Estimator","score_opus":0.00920589390074001,"score_gpt":0.256456430879477,"score_spread":0.247250536978737,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075362134","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048829373,0.00017302477,0.9934378,0.00036003112,0.000042810017,0.00006702232,0.00005691464,0.000040116618,0.0009392663],"genre_scores_gemma":[0.20562454,0.0010880579,0.78867996,0.00059874303,0.00028783001,0.00105695,0.00025364963,0.0000799744,0.0023303486],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9849688,0.010044543,0.00068524486,0.0017307432,0.0020984735,0.00047219527],"domain_scores_gemma":[0.9764529,0.014762906,0.0029231657,0.0044424934,0.0011374811,0.00028107266],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023970656,0.00083275215,0.0018061488,0.0014157048,0.0013906977,0.0018396527,0.0019851557,0.0020435494,0.0046254043],"category_scores_gemma":[0.0714601,0.00052335503,0.0015879521,0.002209651,0.0038376534,0.003998899,0.0036743886,0.002369059,0.0006115463],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008672507,0.000059556292,0.0018501481,0.00017830027,0.00007501236,0.00015853334,0.00043960082,0.018116415,0.0019985058,0.8995152,0.0012229105,0.07629913],"study_design_scores_gemma":[0.00004003333,0.000113471426,0.001000058,0.00008993337,0.000046629328,0.00022467706,0.00010586357,0.050905995,0.001710879,0.9378368,0.007895758,0.000029889306],"about_ca_topic_score_codex":0.00067456265,"about_ca_topic_score_gemma":0.00071558834,"teacher_disagreement_score":0.023970656,"about_ca_system_score_codex":0.0007339536,"about_ca_system_score_gemma":0.002728455,"threshold_uncertainty_score":0.12677044},"labels":[],"label_agreement":null},{"id":"W2075916106","doi":"10.2202/1557-4679.1172","title":"Using Generalized Additive Models to Detect and Estimate Threshold Associations","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Medical Research Council; Canadian Institutes of Health Research; Medical Research Council Canada; McGill University","keywords":"Mathematics; Covariate; Statistics; Threshold model; Curvature; Linear model; Range (aeronautics); Linear regression; Generalized linear model; Econometrics","score_opus":0.20462958845255994,"score_gpt":0.47037034224618895,"score_spread":0.26574075379362905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2075916106","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028328896,0.00034944486,0.9698693,0.00028477944,0.0000721114,0.00018363557,0.00014856676,0.000424582,0.0003387097],"genre_scores_gemma":[0.22954772,0.0003473985,0.7677696,0.00024212482,0.00007989297,0.0009872806,0.00040435093,0.00015729347,0.00046431785],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9314863,0.055863235,0.0020108293,0.006227171,0.0037198928,0.00069257204],"domain_scores_gemma":[0.73557705,0.24067181,0.008298313,0.011737241,0.0031677529,0.00054788694],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07620237,0.002199303,0.003958811,0.0054947156,0.0012465348,0.0038789136,0.004032861,0.00329597,0.0018145759],"category_scores_gemma":[0.24898927,0.0012036081,0.004145509,0.0049239304,0.0028538026,0.0039230343,0.0053062746,0.004674864,0.0004175933],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014627932,0.00064126065,0.11412298,0.0014661088,0.009006262,0.0014874764,0.003624884,0.38830557,0.003457411,0.12445698,0.004692823,0.3472755],"study_design_scores_gemma":[0.00025473544,0.00060115685,0.013017553,0.00014793915,0.0006586499,0.0003977899,0.00033810458,0.7152241,0.0013594693,0.26480427,0.0029977174,0.00019860019],"about_ca_topic_score_codex":0.004184552,"about_ca_topic_score_gemma":0.0036648,"teacher_disagreement_score":0.07620237,"about_ca_system_score_codex":0.0011634091,"about_ca_system_score_gemma":0.0021170336,"threshold_uncertainty_score":0.4030015},"labels":[],"label_agreement":null},{"id":"W2079826663","doi":"10.2202/1557-4679.1210","title":"Model Checking with Residuals for g-estimation of Optimal Dynamic Treatment Regimes","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Canadian Institutes of Health Research; Health Canada; UNICEF; Thrasher Research Fund","keywords":"Counterfactual thinking; Residual; Context (archaeology); Estimation; Computer science; Econometrics; Mathematics; Statistics; Algorithm; Economics","score_opus":0.08719899470162384,"score_gpt":0.4254682716849469,"score_spread":0.33826927698332304,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2079826663","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008914877,0.00015258371,0.9892897,0.00030608394,0.00003821733,0.00007193083,0.00013714269,0.0006158631,0.00047361772],"genre_scores_gemma":[0.3732713,0.00023511346,0.62380505,0.00040475078,0.000066719746,0.00064744597,0.00071302167,0.0003779309,0.0004788056],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9397137,0.053283494,0.0015772181,0.002751378,0.0020161173,0.000658179],"domain_scores_gemma":[0.58372647,0.37557474,0.012543806,0.023074366,0.0043932223,0.00068749243],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07700393,0.0015975876,0.0027769858,0.0029224646,0.0010564403,0.0024645973,0.0031943575,0.0027588329,0.007994342],"category_scores_gemma":[0.35283902,0.00090839574,0.002938177,0.0023118982,0.0032938232,0.0041232146,0.00351858,0.004802279,0.0006709363],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010070484,0.0002656694,0.022132954,0.0007715857,0.0010688221,0.0005851255,0.0010279448,0.47344354,0.0018195049,0.35298562,0.0040664887,0.14082576],"study_design_scores_gemma":[0.00017063174,0.0002343139,0.0014991312,0.00015888693,0.00010611147,0.00010290318,0.00013340938,0.7913116,0.0019407695,0.20164785,0.0026319872,0.000062428335],"about_ca_topic_score_codex":0.004265643,"about_ca_topic_score_gemma":0.001953417,"teacher_disagreement_score":0.07700393,"about_ca_system_score_codex":0.0013483147,"about_ca_system_score_gemma":0.0029890551,"threshold_uncertainty_score":0.40724057},"labels":[],"label_agreement":null},{"id":"W2087289223","doi":"10.1515/ijb-2012-0046","title":"Exact Nonparametric Confidence Bands for the Survivor Function","year":2013,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Waterloo","funders":"","keywords":"Confidence interval; Nonparametric statistics; Statistics; Mathematics; Estimator; Applied mathematics","score_opus":0.07697518084313971,"score_gpt":0.373519926900873,"score_spread":0.2965447460577333,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2087289223","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0055073793,0.00033504903,0.9907953,0.00014072881,0.000061724495,0.00011975892,0.00011105071,0.00039104652,0.0025379574],"genre_scores_gemma":[0.28678077,0.0006521759,0.7047721,0.00042661445,0.00032011725,0.0024920192,0.0008348313,0.00067953044,0.0030418271],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95838505,0.02479854,0.0019361892,0.0039772834,0.009537212,0.0013657666],"domain_scores_gemma":[0.7231367,0.22271973,0.012036558,0.026864909,0.014241986,0.0010000992],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058641694,0.0018851362,0.0024892301,0.007775127,0.0012474677,0.0046986174,0.0044325865,0.003987982,0.010756909],"category_scores_gemma":[0.30173457,0.0012195202,0.002810125,0.0038474659,0.0052269916,0.0066770636,0.007341826,0.008058819,0.0024121741],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008061206,0.00022520658,0.0059347786,0.0007329818,0.00034441013,0.00045579355,0.0015643947,0.092621736,0.0029685297,0.61879456,0.005469238,0.27008224],"study_design_scores_gemma":[0.00024032233,0.00058842875,0.0053313165,0.00084687624,0.00014177957,0.0008698795,0.0005031332,0.41533455,0.007852579,0.54964715,0.018416794,0.00022724851],"about_ca_topic_score_codex":0.0011761485,"about_ca_topic_score_gemma":0.00044233253,"teacher_disagreement_score":0.058641694,"about_ca_system_score_codex":0.001821275,"about_ca_system_score_gemma":0.001953971,"threshold_uncertainty_score":0.3101306},"labels":[],"label_agreement":null},{"id":"W2087755581","doi":"10.1515/ijb-2013-0045","title":"Principal Stratification: A Broader Vision","year":2013,"lang":"en","type":"letter","venue":"The International Journal of Biostatistics","topic":"Early Childhood Education and Development","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Jewish General Hospital","funders":"","keywords":"Stratification (seeds); Econometrics; Principal (computer security); Statistics; Mathematics; Computer science","score_opus":0.02699953065857512,"score_gpt":0.34259973495747564,"score_spread":0.3156002042989005,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2087755581","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00094371784,0.0039143236,0.006719269,0.97326034,0.010817216,0.000017719058,0.00003707773,0.000029736308,0.004260547],"genre_scores_gemma":[0.068353735,0.0071905656,0.012336252,0.72479475,0.17852683,0.00020341873,0.00012122107,0.00012923275,0.008343998],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9686113,0.018432794,0.0026754658,0.0035473835,0.0052801077,0.0014529236],"domain_scores_gemma":[0.92279977,0.044337314,0.003024542,0.009252702,0.013774086,0.006811605],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06365457,0.00071740564,0.0027040758,0.0030924808,0.0050294134,0.010517196,0.0035600455,0.023287352,0.004997483],"category_scores_gemma":[0.12330322,0.00087149686,0.0013788149,0.0025775554,0.029324599,0.015019573,0.008093707,0.048299342,0.0015102589],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011594085,0.00008939892,0.0064401976,0.00023301759,0.00008140252,0.0005431531,0.0031026523,0.00028022216,0.00020407661,0.50224644,0.40760857,0.07905503],"study_design_scores_gemma":[0.00014510746,0.000081980565,0.004038767,0.00064051535,0.00006291329,0.0012401436,0.0022343744,0.0011798528,0.00016268261,0.70913374,0.28099543,0.00008446699],"about_ca_topic_score_codex":0.009280741,"about_ca_topic_score_gemma":0.00962089,"teacher_disagreement_score":0.06365457,"about_ca_system_score_codex":0.005731692,"about_ca_system_score_gemma":0.010194407,"threshold_uncertainty_score":0.33664155},"labels":[],"label_agreement":null},{"id":"W2088893370","doi":"10.2202/1557-4679.1125","title":"Fitting Smooth-in-Time Prognostic Risk Functions via Logistic Regression","year":2009,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; Fonds Québécois de la Recherche sur la Nature et les Technologies","keywords":"Logistic regression; Hazard; Proportional hazards model; Statistics; Parametric statistics; Econometrics; Regression; Hazard ratio; Regression analysis; Mathematics; Computer science; Confidence interval","score_opus":0.19436973666883683,"score_gpt":0.41585482334367285,"score_spread":0.22148508667483602,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2088893370","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032754388,0.00037499957,0.9635951,0.000937554,0.000039823266,0.00015412895,0.00035991735,0.0007047522,0.0010794098],"genre_scores_gemma":[0.694738,0.0012038817,0.2920472,0.0003525474,0.00015738794,0.00065029174,0.0016815639,0.00038399352,0.008785099],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.992335,0.005474938,0.00030080645,0.0007260852,0.0006866826,0.00047639795],"domain_scores_gemma":[0.97245276,0.022063326,0.0019881015,0.0018053045,0.0013274002,0.00036313388],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019409893,0.001625566,0.0018621811,0.002835106,0.00041742178,0.0026728078,0.0028879207,0.0024582914,0.004442458],"category_scores_gemma":[0.07594612,0.0011441774,0.0021954388,0.0028769402,0.0012717322,0.0026149335,0.002410003,0.0034481043,0.0018496369],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039711155,0.00013186054,0.013788393,0.00013256221,0.00020454616,0.0004029718,0.00023441137,0.8677219,0.00065848837,0.035541635,0.002578775,0.078207426],"study_design_scores_gemma":[0.000028186478,0.00006661201,0.0013023686,0.0000263768,0.000030810028,0.00009268611,0.00004438756,0.9636638,0.00021616857,0.033367895,0.0011259161,0.00003472926],"about_ca_topic_score_codex":0.0061120423,"about_ca_topic_score_gemma":0.0035743266,"teacher_disagreement_score":0.019409893,"about_ca_system_score_codex":0.0013533424,"about_ca_system_score_gemma":0.0018211441,"threshold_uncertainty_score":0.10265058},"labels":[],"label_agreement":null},{"id":"W2090545088","doi":"10.2202/1557-4679.1350","title":"Meta-Analysis of Observational Studies with Unmeasured Confounders","year":2012,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Observational study; Confounding; Propensity score matching; Sample size determination; Bayesian probability; Meta-analysis; Statistics; Econometrics; Causal inference; Randomized controlled trial; Medicine; Computer science; Mathematics; Internal medicine","score_opus":0.9753175800643589,"score_gpt":0.6456409520288836,"score_spread":0.32967662803547526,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2090545088","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004048462,0.88817275,0.100639805,0.0022064773,0.001362952,0.0009318978,0.0014750201,0.00031092556,0.000851709],"genre_scores_gemma":[0.18692158,0.5823835,0.21619207,0.002811813,0.0021505323,0.0058409437,0.0023216733,0.00033700315,0.0010408392],"study_design_codex":"meta_analysis","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88469285,0.09517075,0.009815161,0.0045940056,0.005255841,0.00047127865],"domain_scores_gemma":[0.89089113,0.09381443,0.0070351316,0.005820552,0.0021600435,0.00027865538],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.080983825,0.0041013975,0.01894479,0.014665709,0.0008675089,0.005593894,0.0036519177,0.0029636347,0.0025308067],"category_scores_gemma":[0.17548539,0.0024076162,0.032047298,0.012283303,0.0011817574,0.002911046,0.0031391243,0.0040633166,0.0003857233],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012049121,0.00006278913,0.0063362718,0.09913704,0.7414968,0.0003140274,0.00018711363,0.02145296,0.0006596483,0.009350553,0.0044921194,0.11530583],"study_design_scores_gemma":[0.0015392799,0.00062018406,0.006113215,0.031218318,0.83404255,0.00051731366,0.00013112322,0.021992676,0.0016860736,0.07704264,0.02487733,0.00021930816],"about_ca_topic_score_codex":0.002791832,"about_ca_topic_score_gemma":0.0042023296,"teacher_disagreement_score":0.9190162,"about_ca_system_score_codex":0.0038828808,"about_ca_system_score_gemma":0.00620027,"threshold_uncertainty_score":0.42828852},"labels":[],"label_agreement":null},{"id":"W2091956653","doi":"10.2202/1557-4679.1106","title":"Missing Confounding Data in Marginal Structural Models: A Comparison of Inverse Probability Weighting and Multiple Imputation","year":2008,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; McGill University","funders":"","keywords":"Inverse probability weighting; Missing data; Inverse probability; Imputation (statistics); Marginal structural model; Statistics; Weighting; Confounding; Censoring (clinical trials); Computer science; Econometrics; Mathematics; Inverse distance weighting; Estimator; Data mining; Posterior probability; Bayesian probability; Medicine","score_opus":0.33358293714958803,"score_gpt":0.4591081692735752,"score_spread":0.12552523212398714,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2091956653","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01956308,0.0028250685,0.97449774,0.0010844083,0.00015118235,0.00033476815,0.00009213379,0.00012171791,0.0013299126],"genre_scores_gemma":[0.23595826,0.0033029192,0.7573376,0.0005616293,0.00025284605,0.0012370071,0.0003160755,0.00021804655,0.0008156099],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7929951,0.19296263,0.0027536608,0.003675652,0.0068370937,0.00077598984],"domain_scores_gemma":[0.58483654,0.3792959,0.0072482685,0.02168112,0.0060137664,0.0009243318],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1793651,0.0017030111,0.0040404084,0.0028723697,0.0010751954,0.002948751,0.0049065463,0.0030840617,0.002629402],"category_scores_gemma":[0.38827014,0.0013751129,0.0041610505,0.004634702,0.0032002144,0.007791617,0.0057004965,0.004291907,0.0004253681],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029710042,0.0004126206,0.013747667,0.0018076326,0.005174484,0.00024224995,0.003130805,0.13969663,0.0005526336,0.45454398,0.002919258,0.37480116],"study_design_scores_gemma":[0.00090827065,0.0010967774,0.0037756758,0.0007787714,0.0013152519,0.00034416906,0.00043943114,0.45117512,0.0008065079,0.5318533,0.0073273913,0.00017922079],"about_ca_topic_score_codex":0.0025259869,"about_ca_topic_score_gemma":0.0023725405,"teacher_disagreement_score":0.1793651,"about_ca_system_score_codex":0.0018057851,"about_ca_system_score_gemma":0.0029961402,"threshold_uncertainty_score":0.9485846},"labels":[],"label_agreement":null},{"id":"W2093789600","doi":"10.2202/1557-4679.1195","title":"Estimating Multilevel Logistic Regression Models When the Number of Clusters is Low: A Comparison of Different Statistical Software Procedures","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":192,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences; Heart and Stroke Foundation of Canada","keywords":"Statistics; Multilevel model; Logistic regression; Computer science; Variance (accounting); Statistical model; Hierarchical database model; Software; Bayesian probability; Mathematics; Data mining; Econometrics","score_opus":0.08904626714055525,"score_gpt":0.43281489976916027,"score_spread":0.343768632628605,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2093789600","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06604794,0.0007301414,0.9288916,0.0007465938,0.00007119952,0.00078869594,0.00043440668,0.00097178307,0.0013176443],"genre_scores_gemma":[0.14045507,0.00047654097,0.8554844,0.00019031369,0.00003247275,0.002012886,0.0004875823,0.00053404097,0.00032676492],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8635456,0.11910082,0.0046693757,0.0039606467,0.007822404,0.0009011734],"domain_scores_gemma":[0.5658888,0.39327246,0.010202943,0.019125283,0.010482547,0.0010279373],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.103064485,0.0010134199,0.0026317327,0.0037712674,0.0011526704,0.002634489,0.0038749548,0.001745467,0.003987554],"category_scores_gemma":[0.4144878,0.0010793235,0.0036916058,0.005520726,0.0017866071,0.004102206,0.0050717317,0.0032678903,0.00071356754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0046971906,0.0008211776,0.08773332,0.0051037315,0.0070286123,0.0007100552,0.0107267,0.09211794,0.004831906,0.09898749,0.0118589,0.6753829],"study_design_scores_gemma":[0.0016099925,0.0019552875,0.06676786,0.0019595644,0.0029711486,0.0008129569,0.0028027096,0.6859221,0.0080306055,0.20773445,0.018793121,0.0006402346],"about_ca_topic_score_codex":0.0053697126,"about_ca_topic_score_gemma":0.009124969,"teacher_disagreement_score":0.103064485,"about_ca_system_score_codex":0.0019332322,"about_ca_system_score_gemma":0.0038582012,"threshold_uncertainty_score":0.5450636},"labels":[],"label_agreement":null},{"id":"W2095288212","doi":"10.2202/1557-4679.1246","title":"Fast Function-on-Scalar Regression with Penalized Basis Expansions","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Control Systems and Identification","field":"Engineering","cited_by":135,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Science Foundation","keywords":"Pointwise; Estimator; Mathematics; Overfitting; Ordinary least squares; Model selection; Applied mathematics; Basis function; Smoothing; Functional data analysis; Algorithm; Statistics; Mathematical optimization; Computer science; Artificial intelligence","score_opus":0.006292328742969971,"score_gpt":0.22358636951406072,"score_spread":0.21729404077109074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2095288212","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017565644,0.00009535572,0.9970112,0.00006544509,0.000019468795,0.000025116406,0.00005451605,0.00078843813,0.00018382014],"genre_scores_gemma":[0.052829333,0.00029633785,0.94200283,0.00013496113,0.000066857,0.00041055438,0.00066291756,0.0010214588,0.002574726],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9959176,0.0027339663,0.00015194285,0.00036232814,0.0006707532,0.00016340888],"domain_scores_gemma":[0.9887937,0.0076870364,0.00053777307,0.001658647,0.0011315063,0.00019148238],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008583302,0.001847222,0.0020690085,0.0014464656,0.00066191505,0.001369255,0.0029498192,0.0020891202,0.005453124],"category_scores_gemma":[0.025441946,0.0014361413,0.0019320605,0.0019197508,0.0009544911,0.002216315,0.0028094517,0.0035312944,0.0040127547],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033843296,0.0001533373,0.002025407,0.00027214672,0.00027967957,0.00023277412,0.00017999136,0.6504424,0.004481523,0.071464784,0.009206518,0.26092294],"study_design_scores_gemma":[0.000018052287,0.000019492836,0.0001991822,0.000010005814,0.000007250902,0.000026410578,0.000007057865,0.9860095,0.0005322503,0.011783881,0.0013706556,0.000016317252],"about_ca_topic_score_codex":0.005476523,"about_ca_topic_score_gemma":0.007754066,"teacher_disagreement_score":0.008583302,"about_ca_system_score_codex":0.00073607004,"about_ca_system_score_gemma":0.0021223996,"threshold_uncertainty_score":0.045393407},"labels":[],"label_agreement":null},{"id":"W2097433879","doi":"10.2202/1557-4679.1223","title":"A Pseudo-EM Algorithm for Clustering Incomplete Longitudinal Data","year":2010,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Cluster analysis; Cholesky decomposition; Expectation–maximization algorithm; Covariance; Computer science; Focus (optics); Missing data; Data mining; Multivariate statistics; Algorithm; Multivariate normal distribution; Determining the number of clusters in a data set; CURE data clustering algorithm; Mathematics; Correlation clustering; Statistics; Artificial intelligence; Maximum likelihood; Machine learning","score_opus":0.05577961052628969,"score_gpt":0.3465629364035154,"score_spread":0.29078332587722566,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2097433879","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00028881265,0.000052988737,0.9991185,0.00003793524,0.000018490486,0.000027006916,0.000047693935,0.00027761093,0.00013099278],"genre_scores_gemma":[0.0050414787,0.00010225666,0.9931722,0.000055406388,0.00003496854,0.00024070789,0.0003693141,0.00015871055,0.00082500576],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9973949,0.0012438654,0.00017295935,0.0005195626,0.0005745497,0.00009413166],"domain_scores_gemma":[0.99572706,0.0023895006,0.00027544942,0.0005951807,0.00088866823,0.00012401691],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005171979,0.0016136043,0.0019712509,0.002009512,0.0012207802,0.0014677794,0.00424701,0.0022007716,0.006007168],"category_scores_gemma":[0.012895149,0.0016615608,0.0019541606,0.0030510402,0.00094437384,0.0020937875,0.0026566742,0.0032808897,0.0043932456],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019089488,0.00012987382,0.0014994753,0.00033562077,0.00043225184,0.0001614354,0.0002796164,0.27745736,0.004111873,0.055061705,0.015945682,0.64439416],"study_design_scores_gemma":[0.000053900992,0.00003856968,0.00042332296,0.00003406152,0.0000402457,0.00020297238,0.000036466194,0.9308721,0.001996872,0.053010702,0.013231721,0.00005908039],"about_ca_topic_score_codex":0.004281771,"about_ca_topic_score_gemma":0.006172785,"teacher_disagreement_score":0.006007168,"about_ca_system_score_codex":0.0009053115,"about_ca_system_score_gemma":0.002803564,"threshold_uncertainty_score":0.027352393},"labels":[],"label_agreement":null},{"id":"W2109185224","doi":"10.1515/ijb-2013-0026","title":"Latent Conditional Individual-Level Models for Infectious Disease Modeling","year":2013,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Animal Disease Management and Epidemiology","field":"Agricultural and Biological Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Brock University","funders":"","keywords":"Covariate; Latent variable; Latent variable model; Population; Computer science; Econometrics; Statistics; Conditional independence; Mathematics; Medicine","score_opus":0.1101053187091808,"score_gpt":0.2829587948001932,"score_spread":0.1728534760910124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2109185224","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0065104486,0.00043669814,0.99030334,0.0005217573,0.00006326284,0.000063530504,0.00056228205,0.00025727792,0.0012814258],"genre_scores_gemma":[0.5325222,0.0025460727,0.44788864,0.000632893,0.00046017545,0.0012867472,0.0029196017,0.00032899805,0.011414674],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9963236,0.0025886558,0.00013021947,0.00042689464,0.00033669555,0.0001940109],"domain_scores_gemma":[0.9862083,0.010934569,0.0012162208,0.00077554263,0.0006341909,0.00023120163],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0077114194,0.0011129152,0.0015817448,0.0015754385,0.00074385985,0.0020344018,0.0036928356,0.0020803923,0.0057413527],"category_scores_gemma":[0.022294255,0.00078225264,0.0018955835,0.0025364198,0.0016246283,0.0024776033,0.002477392,0.0040701493,0.001095786],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00007377764,0.00006421336,0.004327418,0.00014532426,0.0001874206,0.00011903526,0.00025594322,0.7188046,0.00029225968,0.25609046,0.0023577942,0.017281685],"study_design_scores_gemma":[0.000013775912,0.000018423994,0.00033543858,0.00002251666,0.000024863677,0.000028113582,0.00002101854,0.9023586,0.00004928773,0.09552986,0.0015807459,0.000017361388],"about_ca_topic_score_codex":0.011189094,"about_ca_topic_score_gemma":0.009947537,"teacher_disagreement_score":0.011189094,"about_ca_system_score_codex":0.0020400973,"about_ca_system_score_gemma":0.0017522558,"threshold_uncertainty_score":0.040782392},"labels":[],"label_agreement":null},{"id":"W2136204757","doi":"10.2202/1557-4679.1349","title":"Double-Robust Estimators: Slightly More Bayesian than Meets the Eye?","year":2012,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Canadian Institutes of Health Research","keywords":"Estimator; Confounding; Bayesian probability; Outcome (game theory); Parametric statistics; Econometrics; Statistics; Mathematics; Nonparametric statistics; Parametric model; Mathematical economics","score_opus":0.12095443698415621,"score_gpt":0.4227510600308651,"score_spread":0.3017966230467089,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2136204757","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015182645,0.0023773583,0.98313403,0.0085285185,0.00069663883,0.000028549171,0.0001201651,0.000259399,0.0033370538],"genre_scores_gemma":[0.10438579,0.0040394035,0.87554204,0.0068355124,0.0028972598,0.00028731851,0.00025617055,0.00078818615,0.004968298],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97317153,0.01778462,0.0012954389,0.0027907393,0.0045304215,0.0004271531],"domain_scores_gemma":[0.9106753,0.06172142,0.004957364,0.015574207,0.00624637,0.0008253626],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04842608,0.0013295772,0.0020227828,0.0015680701,0.0008483228,0.0048446576,0.0028013438,0.0043039527,0.008791051],"category_scores_gemma":[0.2365231,0.0010738682,0.001260852,0.002289356,0.0038690402,0.011525014,0.0031678984,0.0060493564,0.0032182168],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000144356,0.000038318554,0.0012928017,0.00044521978,0.000253727,0.000104396924,0.00047369293,0.0036425807,0.000680745,0.83733517,0.014935348,0.14065358],"study_design_scores_gemma":[0.00005446174,0.000059520782,0.00044126651,0.0003112269,0.000074369054,0.00028338234,0.00011745721,0.018745933,0.0008124389,0.9466583,0.03237241,0.00006927543],"about_ca_topic_score_codex":0.0022120366,"about_ca_topic_score_gemma":0.0027843255,"teacher_disagreement_score":0.04842608,"about_ca_system_score_codex":0.0011470753,"about_ca_system_score_gemma":0.0020786526,"threshold_uncertainty_score":0.25610465},"labels":[],"label_agreement":null},{"id":"W2185570897","doi":"10.1515/ijb-2015-0026","title":"Effect of Smoothing in Generalized Linear Mixed Models on the Estimation of Covariance Parameters for Longitudinal Data","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Mathematics; Statistics; Smoothing; Generalized estimating equation; Covariance; Covariate; Variance function; Generalized linear model; Semiparametric regression; Generalized linear mixed model; Binary data; Poisson distribution; Estimator; Variance (accounting); Binary number","score_opus":0.33207830972491087,"score_gpt":0.4587031214841648,"score_spread":0.12662481175925394,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2185570897","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06567377,0.0029039322,0.9273834,0.0015225576,0.00018518898,0.00019871119,0.0002212515,0.0008862053,0.0010250068],"genre_scores_gemma":[0.5688183,0.001977785,0.42570686,0.00083833013,0.00021404929,0.0006705739,0.00056027214,0.000414604,0.0007991701],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.90133727,0.088990815,0.002458757,0.003959283,0.0025304637,0.0007234536],"domain_scores_gemma":[0.2943967,0.666602,0.010187212,0.023838682,0.004241667,0.00073366676],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1498606,0.002114211,0.002130711,0.002417051,0.0015939994,0.0025474462,0.002094542,0.003667057,0.0017770258],"category_scores_gemma":[0.43288338,0.0012112608,0.0033408408,0.002969951,0.0042998777,0.0039013806,0.004148822,0.004635848,0.0003608464],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031828287,0.00026623777,0.068778515,0.0012148994,0.0042114346,0.0012266638,0.0032194671,0.5421243,0.0043023475,0.12970082,0.003270517,0.23850197],"study_design_scores_gemma":[0.00042172146,0.0009562469,0.016508052,0.0005515759,0.0013220177,0.0006553735,0.00045172064,0.83442116,0.0047417227,0.13578084,0.003907549,0.0002820318],"about_ca_topic_score_codex":0.007357428,"about_ca_topic_score_gemma":0.0060143126,"teacher_disagreement_score":0.1498606,"about_ca_system_score_codex":0.0016843155,"about_ca_system_score_gemma":0.0027468891,"threshold_uncertainty_score":0.7925481},"labels":[],"label_agreement":null},{"id":"W2278177624","doi":"10.1515/ijb-2015-0017","title":"Variable Selection for Confounder Control, Flexible Modeling and Collaborative Targeted Minimum Loss-Based Estimation in Causal Inference","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":38,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Polytechnique Montréal","funders":"National Institute of Allergy and Infectious Diseases","keywords":"Causal inference; Propensity score matching; Estimator; Computer science; Covariate; Inverse probability weighting; Inverse probability; Average treatment effect; Econometrics; Marginal structural model; Inference; Statistics; Nonparametric statistics; Weighting; Selection bias; Machine learning; Artificial intelligence; Mathematics; Posterior probability","score_opus":0.10003523274824203,"score_gpt":0.4231658834685216,"score_spread":0.3231306507202796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2278177624","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014559379,0.00021145368,0.99757534,0.00034817166,0.00001647916,0.000026900016,0.000024609551,0.000058740185,0.00028235032],"genre_scores_gemma":[0.32971388,0.0009665071,0.66437626,0.0011177367,0.00031825854,0.0008912513,0.0003398715,0.00022370079,0.0020525276],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9613752,0.031765122,0.00090392143,0.002725229,0.0026552794,0.00057526916],"domain_scores_gemma":[0.90057987,0.08088961,0.0051345597,0.010673068,0.0021852597,0.0005376325],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04498668,0.0015753695,0.0028544746,0.0021470073,0.0011007389,0.0029444543,0.003973619,0.0027921174,0.003233288],"category_scores_gemma":[0.14475344,0.0012338297,0.0033344214,0.0025504283,0.0051125865,0.0047655874,0.0054178527,0.0048740506,0.00056896295],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015094277,0.00009102445,0.0037483175,0.00036539254,0.00052791886,0.00025685452,0.0005665579,0.2614369,0.0007561685,0.64822686,0.002276649,0.08159645],"study_design_scores_gemma":[0.00007797243,0.000075098214,0.0008040436,0.00008355429,0.00007990779,0.00007320146,0.000027031694,0.5379588,0.00068727724,0.4575428,0.0025555266,0.00003467431],"about_ca_topic_score_codex":0.0033700797,"about_ca_topic_score_gemma":0.0020935684,"teacher_disagreement_score":0.04498668,"about_ca_system_score_codex":0.00224117,"about_ca_system_score_gemma":0.0027794007,"threshold_uncertainty_score":0.23791516},"labels":[],"label_agreement":null},{"id":"W2314463908","doi":"10.1515/ijb-2012-0039","title":"The Effect of Error-in-Confounders on the Estimation of the Causal Parameter When Using Marginal Structural Models and Inverse Probability-of-Treatment Weights: A Simulation Study","year":2014,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Marginal structural model; Econometrics; Weighting; Inverse probability weighting; Statistics; Sign (mathematics); Inverse probability; Confounding; Logistic regression; Mathematics; Empirical research; Empirical likelihood; Estimator; Posterior probability; Bayesian probability; Medicine","score_opus":0.14099169658779223,"score_gpt":0.41563104355077823,"score_spread":0.274639346962986,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2314463908","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.63885134,0.00076853274,0.35213256,0.0020599216,0.00006533235,0.0010563331,0.00047474104,0.00021910024,0.0043721576],"genre_scores_gemma":[0.922848,0.00015271446,0.075825006,0.00016156188,0.0000133992835,0.0004986297,0.00012448392,0.000029637138,0.00034650302],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.90012336,0.0924575,0.0021146704,0.0022327055,0.002144347,0.0009273965],"domain_scores_gemma":[0.20870009,0.75396174,0.01085974,0.020304905,0.005596684,0.0005768469],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15947758,0.0009774617,0.0014803016,0.00092639984,0.00092345336,0.001962205,0.0024775136,0.0019320355,0.003057414],"category_scores_gemma":[0.45774952,0.00082647614,0.0018625604,0.0016313818,0.0036872956,0.0028023364,0.0022718844,0.0030329407,0.00022386157],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005749658,0.0014199266,0.10342884,0.0008230002,0.0015952708,0.00073451706,0.0019381738,0.72181493,0.0017096943,0.10737344,0.001251104,0.05216141],"study_design_scores_gemma":[0.0010841021,0.0017943743,0.008144312,0.0003703886,0.0007835894,0.00028235785,0.00067016383,0.9301208,0.0046299906,0.05047215,0.0015272842,0.000120441655],"about_ca_topic_score_codex":0.007467341,"about_ca_topic_score_gemma":0.004749095,"teacher_disagreement_score":0.8405224,"about_ca_system_score_codex":0.0023069617,"about_ca_system_score_gemma":0.002768142,"threshold_uncertainty_score":0.8434081},"labels":[],"label_agreement":null},{"id":"W2400611004","doi":"10.1515/ijb-2015-0015","title":"Influence Re-weighted G-Estimation","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; McGill University","keywords":"Estimator; Weighting; Estimation; Parametric statistics; Computer science; Robust statistics; Marginal structural model; Average treatment effect; Econometrics; Mathematical optimization; Inverse probability weighting; Outcome (game theory); Mathematics; Parametric model; Statistics; Causal inference; Medicine; Economics","score_opus":0.14528751352761418,"score_gpt":0.43528432890430363,"score_spread":0.2899968153766894,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2400611004","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025985537,0.00014658974,0.9960069,0.00018414813,0.000044599692,0.000051506442,0.00006146116,0.00013543533,0.0007707543],"genre_scores_gemma":[0.23339367,0.0006102596,0.757713,0.0006851442,0.00029637947,0.0005302408,0.00086762296,0.00041653152,0.0054872395],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99358976,0.0038709277,0.0002819078,0.0010698406,0.00093207275,0.00025548425],"domain_scores_gemma":[0.9694556,0.020385,0.0015366084,0.005779224,0.0025422657,0.00030128556],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010883221,0.001391362,0.002397731,0.0020709154,0.00077114406,0.001667168,0.0034262177,0.0023270128,0.0043069636],"category_scores_gemma":[0.07206411,0.0007184669,0.0018064033,0.0017806303,0.0017167756,0.0026144749,0.0030673149,0.0026002675,0.0012248707],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023432936,0.00012010925,0.0062878667,0.0003677629,0.0005073018,0.00039598483,0.0003134428,0.42526573,0.0029099751,0.31892052,0.007980038,0.23669696],"study_design_scores_gemma":[0.000034204215,0.0000503204,0.00070583215,0.00004983918,0.00007126214,0.0001155009,0.000030059377,0.8682125,0.0011937778,0.124712944,0.0047922167,0.000031512685],"about_ca_topic_score_codex":0.004125825,"about_ca_topic_score_gemma":0.0048471736,"teacher_disagreement_score":0.010883221,"about_ca_system_score_codex":0.0009893827,"about_ca_system_score_gemma":0.0018114884,"threshold_uncertainty_score":0.05755669},"labels":[],"label_agreement":null},{"id":"W2407739463","doi":"10.1515/ijb-2015-0016","title":"The Orthogonally Partitioned EM Algorithm: Extending the EM Algorithm for Algorithmic Stability and Bias Correction Due to Imperfect Data","year":2016,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Algorithm; Stability (learning theory); Computer science; Extension (predicate logic); Missing data; Convergence (economics); Reduction (mathematics); Series (stratigraphy); Expectation–maximization algorithm; Software; Sequence (biology); Mathematics; Maximum likelihood; Statistics","score_opus":0.12748056096607074,"score_gpt":0.3903983024897696,"score_spread":0.26291774152369884,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2407739463","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0006625322,0.000044456323,0.99884343,0.00006019049,0.000017185792,0.000018299048,0.000014417132,0.000102650374,0.00023679025],"genre_scores_gemma":[0.02582562,0.00020618166,0.9723103,0.00017161304,0.00008029109,0.00019956408,0.0001549029,0.0001747353,0.0008768422],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99517256,0.002984057,0.00021964511,0.00061275664,0.00084538513,0.00016562187],"domain_scores_gemma":[0.99007297,0.005989401,0.0007477607,0.0017352356,0.0012434204,0.00021117924],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007761803,0.0013856455,0.0016089712,0.0015765566,0.0006106645,0.0015377143,0.0031559633,0.0017144971,0.0028341154],"category_scores_gemma":[0.03667521,0.00096764724,0.0014852328,0.0018744469,0.0016487805,0.0034201122,0.004376704,0.0026374327,0.0015697575],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018978288,0.00012730937,0.0026659349,0.0003037298,0.00027866682,0.00023861678,0.00038918457,0.3278489,0.0043603047,0.20144688,0.005469538,0.4566812],"study_design_scores_gemma":[0.000046115405,0.00008059108,0.00037818542,0.000043991877,0.00004184305,0.00024712097,0.000036677873,0.87977105,0.0024456861,0.10594421,0.010922561,0.00004195749],"about_ca_topic_score_codex":0.0018713367,"about_ca_topic_score_gemma":0.0016715028,"teacher_disagreement_score":0.007761803,"about_ca_system_score_codex":0.00062862766,"about_ca_system_score_gemma":0.0023369708,"threshold_uncertainty_score":0.041048825},"labels":[],"label_agreement":null},{"id":"W249493256","doi":"10.1515/ijb-2014-0037","title":"Double Bias: Estimation of Causal Effects from Length-Biased Samples in the Presence of Confounding","year":2015,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Propensity score matching; Confounding; Observational study; Estimator; Statistics; Econometrics; Hazard ratio; Causal inference; Sample size determination; Proportional hazards model; Sampling bias; Survival analysis; Estimation; Information bias; Mathematics; Selection bias; Point estimation; Data set; Pooling; Confidence interval; Computer science; Economics","score_opus":0.24735357801031266,"score_gpt":0.4444989250048111,"score_spread":0.19714534699449843,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W249493256","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012860016,0.00042795073,0.9856818,0.0003113565,0.00004358645,0.00018428572,0.000101833786,0.00008082318,0.0003084225],"genre_scores_gemma":[0.40242216,0.0010178189,0.59266615,0.00066700304,0.0002225103,0.0010926968,0.0005135024,0.000062712796,0.0013354234],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9705903,0.022282097,0.0012328172,0.0029819952,0.0025308733,0.00038191714],"domain_scores_gemma":[0.7795859,0.18992296,0.011843037,0.0149579365,0.0031444868,0.00054567086],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06578167,0.00085436023,0.001771888,0.0018529147,0.0007139447,0.001700631,0.0021949136,0.0020555006,0.0020496617],"category_scores_gemma":[0.23549408,0.00074682955,0.0020123809,0.001929066,0.0025800706,0.0023666057,0.0031183003,0.0022672627,0.00020482206],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006885879,0.00020799016,0.09039904,0.0013850832,0.0022938936,0.0014004502,0.0017935773,0.14372176,0.003103913,0.4275375,0.0024221714,0.32504606],"study_design_scores_gemma":[0.0003244046,0.00041664782,0.01533414,0.00050918065,0.00072678115,0.00095788157,0.00027591462,0.45285398,0.003830111,0.5160084,0.008653962,0.00010866622],"about_ca_topic_score_codex":0.0027566077,"about_ca_topic_score_gemma":0.0019561874,"teacher_disagreement_score":0.93421835,"about_ca_system_score_codex":0.0010260278,"about_ca_system_score_gemma":0.0021631708,"threshold_uncertainty_score":0.34789085},"labels":[],"label_agreement":null},{"id":"W2557277836","doi":"10.1515/ijb-2015-0034","title":"Effect Estimation in Point-Exposure Studies with Binary Outcomes and High-Dimensional Covariate Data – A Comparison of Targeted Maximum Likelihood Estimation and Inverse Probability of Treatment Weighting","year":2016,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University; Jewish General Hospital","funders":"Canadian Institutes of Health Research","keywords":"Covariate; Inverse probability weighting; Estimator; Statistics; Marginal structural model; Average treatment effect; Inverse probability; Econometrics; Weighting; Computer science; Causal inference; Mathematics; Medicine; Bayesian probability","score_opus":0.10122401502630411,"score_gpt":0.4121929389408524,"score_spread":0.3109689239145483,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2557277836","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02052338,0.0032405616,0.973754,0.00080152793,0.00007033364,0.00047184216,0.00014014808,0.00016069083,0.0008375543],"genre_scores_gemma":[0.3818469,0.003076372,0.610705,0.0009624414,0.00016925097,0.0017026929,0.00048075418,0.00015737125,0.00089919165],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.89255637,0.098539636,0.001998221,0.0036760024,0.002758973,0.00047077195],"domain_scores_gemma":[0.70374995,0.27436745,0.00802066,0.010156425,0.003033249,0.0006723068],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11464012,0.0015507982,0.00380804,0.0026609378,0.00048818302,0.0028659117,0.0032863207,0.0033717044,0.0027314045],"category_scores_gemma":[0.26346406,0.0012356491,0.004460532,0.0021335832,0.0025227568,0.0051196376,0.0042121643,0.00368902,0.0003811353],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031892338,0.00057119806,0.02775409,0.00604267,0.009817992,0.0006123877,0.002134223,0.3428716,0.00294058,0.17771581,0.0021936116,0.42415652],"study_design_scores_gemma":[0.0012296396,0.0016294996,0.008652855,0.0011716055,0.0017439176,0.0005794028,0.00030502622,0.71549195,0.0027246128,0.2585103,0.0077699726,0.0001913138],"about_ca_topic_score_codex":0.0017312288,"about_ca_topic_score_gemma":0.0012502755,"teacher_disagreement_score":0.11464012,"about_ca_system_score_codex":0.0011331965,"about_ca_system_score_gemma":0.0021452357,"threshold_uncertainty_score":0.6062821},"labels":[],"label_agreement":null},{"id":"W2904405044","doi":"10.1515/ijb-2017-0002","title":"Parametric Regression Analysis with Covariate Misclassification in Main Study/Validation Study Designs","year":2018,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Institute of Environmental Health Sciences; National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Covariate; Inference; Computer science; Statistics; Statistical inference; Observational error; Data mining; Econometrics; Causal inference; Parametric statistics; Nonparametric statistics; Machine learning; Mathematics; Artificial intelligence","score_opus":0.16327130706442697,"score_gpt":0.4423361246666251,"score_spread":0.27906481760219815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2904405044","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009192783,0.0013612907,0.98675984,0.0008576653,0.0002480917,0.0007333314,0.00010091586,0.00019908433,0.0005470396],"genre_scores_gemma":[0.3279396,0.000857675,0.66177064,0.0021473288,0.0003700096,0.0051552285,0.00036181288,0.00016218165,0.0012354926],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.50175136,0.44846553,0.014999668,0.019049445,0.013655355,0.0020787437],"domain_scores_gemma":[0.35334244,0.51375407,0.03867785,0.08393291,0.009135232,0.0011575113],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.41240248,0.0021240644,0.0036486504,0.0024140382,0.0021904234,0.0034527343,0.008321663,0.006198337,0.0023684348],"category_scores_gemma":[0.6400835,0.0016092184,0.0060105766,0.0034136712,0.007813836,0.0049831914,0.007074141,0.0060577802,0.00059978047],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003139499,0.0004810475,0.1072096,0.004002241,0.007573558,0.001471674,0.0050427793,0.06816195,0.0023950345,0.3951339,0.007983134,0.39740548],"study_design_scores_gemma":[0.0009758107,0.0018113115,0.024979144,0.001810885,0.0033583299,0.0014703056,0.0005923744,0.2766283,0.0062637897,0.6656975,0.016123697,0.00028855048],"about_ca_topic_score_codex":0.002353916,"about_ca_topic_score_gemma":0.0020491749,"teacher_disagreement_score":0.41240248,"about_ca_system_score_codex":0.0022419847,"about_ca_system_score_gemma":0.0052088816,"threshold_uncertainty_score":0.72461236},"labels":[],"label_agreement":null},{"id":"W2924255108","doi":"10.1515/ijb-2018-0090","title":"A Joint Poisson State-Space Modelling Approach to Analysis of Binomial Series with Random Cluster Sizes","year":2019,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"","keywords":"Mathematics; Negative binomial distribution; Poisson distribution; Overdispersion; Statistics; Randomness; Series (stratigraphy); Binomial (polynomial); Binomial distribution; State space; Random effects model","score_opus":0.04154293692951882,"score_gpt":0.313282682610338,"score_spread":0.27173974568081916,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2924255108","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015527444,0.000091756796,0.9977297,0.00011328065,0.000020270492,0.000026474945,0.00005919176,0.000052026247,0.0003545492],"genre_scores_gemma":[0.25871864,0.0020096507,0.7277377,0.00042777567,0.00036867266,0.0013243143,0.00090037996,0.00020233003,0.008310398],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9940195,0.004079081,0.00022383635,0.00066240405,0.0007956672,0.00021946657],"domain_scores_gemma":[0.9833134,0.013248776,0.0012116502,0.001011954,0.001011628,0.00020254857],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011974648,0.0009508052,0.0014793772,0.0018557875,0.0007999757,0.0017940497,0.0031276196,0.0014771768,0.004088734],"category_scores_gemma":[0.027437627,0.000762165,0.0023650695,0.0021706312,0.0018822835,0.0023286971,0.0021755146,0.0034312783,0.0007029839],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000040325915,0.00006226935,0.0031250375,0.00018678873,0.00014988454,0.0001780597,0.00032798716,0.26715663,0.0011548066,0.6946583,0.0017453555,0.031214604],"study_design_scores_gemma":[0.000008224822,0.000041727606,0.00063402974,0.000030289897,0.000031762254,0.00006917608,0.000037271137,0.8233508,0.00029427337,0.17355923,0.0019110924,0.0000321411],"about_ca_topic_score_codex":0.005021083,"about_ca_topic_score_gemma":0.004088324,"teacher_disagreement_score":0.011974648,"about_ca_system_score_codex":0.0012305095,"about_ca_system_score_gemma":0.001970225,"threshold_uncertainty_score":0.06332874},"labels":[],"label_agreement":null},{"id":"W2996445992","doi":"10.1515/ijb-2017-0092","title":"Incorporating Contact Network Uncertainty in Individual Level Models of Infectious Disease using Approximate Bayesian Computation","year":2019,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Markov chain Monte Carlo; Approximate Bayesian computation; Computer science; Computation; Bayesian probability; Particle filter; Population; Bayesian network; Monte Carlo method; Variable-order Bayesian network; Markov chain; Context (archaeology); Bayesian inference; Statistics; Machine learning; Artificial intelligence; Algorithm; Mathematics; Inference; Medicine","score_opus":0.10958220674951051,"score_gpt":0.36164546272418807,"score_spread":0.25206325597467755,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2996445992","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04737578,0.00028754372,0.95005536,0.00039522903,0.00001732517,0.00004242229,0.000102589955,0.00015746558,0.0015662037],"genre_scores_gemma":[0.7766154,0.00055475143,0.2193591,0.0001894537,0.00009621504,0.0002617719,0.00033883718,0.00014993739,0.0024344553],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998329,0.0011191571,0.000049735754,0.00015916624,0.0002544765,0.00008845513],"domain_scores_gemma":[0.98119307,0.016911596,0.00073225016,0.0005584484,0.00042591715,0.00017880245],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0040137707,0.000528324,0.0012004074,0.0012301028,0.0006430513,0.0015498535,0.0016657242,0.0015246731,0.002227016],"category_scores_gemma":[0.031001361,0.0007499819,0.0007725135,0.0013554145,0.0014295616,0.0020296674,0.0014931593,0.0015727788,0.00029675785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000013569081,0.000011419491,0.001052593,0.000016620412,0.000015878695,0.00003348919,0.00004460635,0.97587705,0.00006928825,0.017450059,0.0001672262,0.005248157],"study_design_scores_gemma":[0.000002184134,0.000002631144,0.00009071112,0.0000030244362,0.0000019819988,0.0000067483493,0.0000055746436,0.98646754,0.000017120374,0.013296618,0.00010347775,0.0000023691239],"about_ca_topic_score_codex":0.02288003,"about_ca_topic_score_gemma":0.0155037,"teacher_disagreement_score":0.02288003,"about_ca_system_score_codex":0.0014281941,"about_ca_system_score_gemma":0.0015653775,"threshold_uncertainty_score":0.045493662},"labels":[],"label_agreement":null},{"id":"W3008593490","doi":"10.1515/ijb-2019-0038","title":"A Bayesian Framework for Robust Quantitative Trait Locus Mapping and Outlier Detection","year":2020,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Outlier; Bayesian probability; Lasso (programming language); Quantitative trait locus; Anomaly detection; Artificial intelligence; Prior probability; Pattern recognition (psychology); Regression; Computer science; Mean-shift; Mathematics; Statistics; Biology; Genetics","score_opus":0.032881268497582654,"score_gpt":0.28072459969188274,"score_spread":0.24784333119430008,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3008593490","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0002559079,0.000054030224,0.99943167,0.000047814512,0.000006838914,0.0000064275987,0.000035197754,0.00007126489,0.00009082076],"genre_scores_gemma":[0.07957387,0.00079993776,0.9149471,0.00028889024,0.00028457693,0.00047132457,0.00086880795,0.00028306738,0.0024824652],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9950654,0.002269032,0.00021047737,0.00075938134,0.0014265013,0.00026930738],"domain_scores_gemma":[0.99188155,0.005135033,0.0008365907,0.00066922535,0.0012055021,0.0002722023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007846187,0.0016813114,0.002261725,0.0018235303,0.0006769671,0.0020010723,0.0043674195,0.0019021372,0.002627136],"category_scores_gemma":[0.019327328,0.0013441804,0.002120195,0.00265099,0.0018792436,0.0020673857,0.0028951492,0.0036796818,0.0011792032],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011093358,0.00008880858,0.0014047299,0.0002580309,0.0002720701,0.00021644597,0.00016259687,0.6839076,0.0043087625,0.20774019,0.0041332333,0.09739659],"study_design_scores_gemma":[0.000020039799,0.000029526433,0.00022433142,0.000019747822,0.000024695657,0.000052405696,0.000010344607,0.9350261,0.00045448632,0.061787553,0.0023232081,0.000027585937],"about_ca_topic_score_codex":0.0070985253,"about_ca_topic_score_gemma":0.0063562146,"teacher_disagreement_score":0.007846187,"about_ca_system_score_codex":0.00136701,"about_ca_system_score_gemma":0.0031986483,"threshold_uncertainty_score":0.041495144},"labels":[],"label_agreement":null},{"id":"W3048275956","doi":"10.1515/ijb-2018-0109","title":"Shrinkage estimation applied to a semi-nonparametric regression model","year":2020,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Dam Engineering and Safety","field":"Engineering","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University; Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Shrinkage; Estimation; Nonparametric statistics; Econometrics; Statistics; Nonparametric regression; Regression; Regression analysis; Mathematics; Economics","score_opus":0.014250118074654506,"score_gpt":0.24418294687060674,"score_spread":0.22993282879595223,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3048275956","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051684645,0.00011949442,0.9940659,0.00009487033,0.000020680985,0.000017819419,0.000021948088,0.000087801316,0.00040307955],"genre_scores_gemma":[0.6119691,0.0015555396,0.37583575,0.00021000986,0.000266176,0.00050279486,0.00042278887,0.00019684604,0.00904094],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996505,0.0022231073,0.00013540204,0.000405829,0.00059316173,0.00013753511],"domain_scores_gemma":[0.99173015,0.005785477,0.0008214767,0.00064640184,0.00088988227,0.00012651196],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007490337,0.0010505529,0.001549244,0.0009989796,0.0003662027,0.0011280618,0.0015343407,0.0015713987,0.0016422903],"category_scores_gemma":[0.021577634,0.0006701618,0.0014311369,0.0012298023,0.00145335,0.0012595826,0.002108924,0.0026673272,0.00072083704],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014183047,0.00006672409,0.0015700962,0.00028388004,0.00019893519,0.00032700374,0.00025990317,0.7944931,0.005312466,0.114619315,0.0016756254,0.08105128],"study_design_scores_gemma":[0.0000065653276,0.00003506766,0.00018946391,0.000011624903,0.000016151405,0.000043318065,0.000010258168,0.9826627,0.00052529323,0.015903382,0.0005853061,0.000010893936],"about_ca_topic_score_codex":0.0022341912,"about_ca_topic_score_gemma":0.0018264687,"teacher_disagreement_score":0.007490337,"about_ca_system_score_codex":0.0005501767,"about_ca_system_score_gemma":0.0013833605,"threshold_uncertainty_score":0.039613187},"labels":[],"label_agreement":null},{"id":"W3093766204","doi":"10.1515/ijb-2020-0042","title":"Parametric models for combined failure time data from an incident cohort study and a prevalent cohort study with follow-up","year":2020,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Cohort; Statistics; Parametric statistics; Statistical inference; Inference; Cohort study; Econometrics; Survival analysis; Duration (music); Proportional hazards model; Medicine; Computer science; Mathematics; Artificial intelligence","score_opus":0.12166238620044295,"score_gpt":0.390560009340417,"score_spread":0.26889762313997406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3093766204","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02816972,0.00087708037,0.966856,0.0014966497,0.0001210518,0.00037211788,0.0007853712,0.0002500723,0.0010719417],"genre_scores_gemma":[0.6255414,0.002292487,0.34992704,0.0014487415,0.0008571481,0.0051546656,0.003896057,0.00027969468,0.010602779],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9632091,0.027167218,0.0014565627,0.0038175934,0.003017698,0.0013319546],"domain_scores_gemma":[0.71081054,0.24603064,0.017598648,0.01878215,0.004923142,0.0018548787],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0950855,0.0019284749,0.0040494846,0.0041801734,0.00095864193,0.0037370354,0.008956965,0.0040350873,0.0051191975],"category_scores_gemma":[0.19911182,0.0017582974,0.0047248,0.003911563,0.0041129673,0.0055807084,0.0051699844,0.0073587513,0.0010933429],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012732913,0.0005070589,0.04766764,0.0010169188,0.002415206,0.0020079096,0.0029681947,0.3349847,0.001337273,0.5156619,0.005746657,0.084413245],"study_design_scores_gemma":[0.00019801199,0.00038803933,0.0066615534,0.00023859249,0.00038993437,0.0005038355,0.0002789781,0.65197253,0.0003678705,0.33535114,0.0035340616,0.00011550597],"about_ca_topic_score_codex":0.003839672,"about_ca_topic_score_gemma":0.003441314,"teacher_disagreement_score":0.0950855,"about_ca_system_score_codex":0.001677305,"about_ca_system_score_gemma":0.0019541886,"threshold_uncertainty_score":0.5028662},"labels":[],"label_agreement":null},{"id":"W3107334064","doi":"10.1515/ijb-2020-0073","title":"Doubly robust adaptive LASSO for effect modifier discovery","year":2022,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Université de Montréal","funders":"Canadian Institutes of Health Research","keywords":"Counterfactual thinking; Lasso (programming language); Propensity score matching; Outcome (game theory); Observational study; Covariate; Marginal structural model; Set (abstract data type); Conditional expectation","score_opus":0.13319771240494277,"score_gpt":0.3993879005224699,"score_spread":0.26619018811752715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3107334064","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012428348,0.0005133891,0.9967141,0.00038611688,0.00006443891,0.00009214195,0.00023494738,0.00051862944,0.00023340575],"genre_scores_gemma":[0.10107954,0.0011211112,0.88751894,0.0010091603,0.0007256969,0.0022623884,0.0024831463,0.00076745125,0.0030326014],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.97781634,0.017154384,0.00074680586,0.0017415348,0.0019882654,0.00055274146],"domain_scores_gemma":[0.96013725,0.032084975,0.0024039166,0.0032480867,0.0016163207,0.0005093478],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036002316,0.0028389008,0.00508782,0.0022047122,0.0013202432,0.0023372509,0.0051599415,0.0027306462,0.0049808375],"category_scores_gemma":[0.047621954,0.0015213367,0.0033170874,0.0027526545,0.0022863443,0.0016156897,0.003984557,0.0073069585,0.0013096911],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000980876,0.00041606787,0.0069047324,0.0022168562,0.0029547329,0.0007440254,0.00038692442,0.45243284,0.0039137434,0.17203002,0.028894829,0.32812434],"study_design_scores_gemma":[0.00018740217,0.00012198179,0.0005449261,0.00008508687,0.000099271354,0.00009200988,0.00002586183,0.9106457,0.0009751244,0.08288774,0.004284478,0.000050384235],"about_ca_topic_score_codex":0.0036066656,"about_ca_topic_score_gemma":0.004324423,"teacher_disagreement_score":0.036002316,"about_ca_system_score_codex":0.0012640246,"about_ca_system_score_gemma":0.005155745,"threshold_uncertainty_score":0.19040078},"labels":[],"label_agreement":null},{"id":"W3115405644","doi":"10.1515/ijb-2021-0072","title":"Increasing the efficiency of randomized trial estimates via linear adjustment for a prognostic score","year":2021,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":36,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Canadian Institutes of Health Research","keywords":"Covariate; Estimator; Statistics; Econometrics; Variance (accounting); Sample size determination; Mathematics; Standard error; Delta method","score_opus":0.09452364034429618,"score_gpt":0.4134439329947414,"score_spread":0.31892029265044525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3115405644","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006991232,0.00037151968,0.99000204,0.0010207818,0.00006852692,0.0001377886,0.000056465546,0.00042106365,0.000930616],"genre_scores_gemma":[0.4392724,0.00047265922,0.5560738,0.00089508254,0.00027602198,0.0008891275,0.00019812532,0.00035297166,0.0015697918],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94391006,0.048489235,0.0015206094,0.00230128,0.0032233035,0.00055549986],"domain_scores_gemma":[0.71861744,0.24236651,0.011398118,0.021313688,0.005746598,0.0005576182],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06531253,0.0010923195,0.0015149342,0.00165056,0.00044591224,0.0015393917,0.002191056,0.0014447812,0.0029761826],"category_scores_gemma":[0.3130362,0.00080104097,0.0013256465,0.0016060859,0.0020558762,0.0024572543,0.002531382,0.0030689936,0.00079950556],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019221887,0.0003838214,0.021837732,0.0010966033,0.0018734148,0.0003831901,0.00037487227,0.38044974,0.008198875,0.21882665,0.008307898,0.35634506],"study_design_scores_gemma":[0.00034188043,0.00039261472,0.0030062536,0.000194252,0.00023637117,0.00011264595,0.000033189273,0.8829432,0.004254907,0.10500576,0.0034301255,0.000048803544],"about_ca_topic_score_codex":0.0014915158,"about_ca_topic_score_gemma":0.0010993953,"teacher_disagreement_score":0.9346875,"about_ca_system_score_codex":0.0015419085,"about_ca_system_score_gemma":0.0032833,"threshold_uncertainty_score":0.3454098},"labels":[],"label_agreement":null},{"id":"W3137145701","doi":"10.1515/ijb-2020-0130","title":"Bayesian approaches to variable selection: a comparative study from practical perspectives","year":2021,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":50,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Public Health Ontario; University of Toronto; Queen's University","funders":"Canadian Institutes of Health Research","keywords":"Computer science; Prior probability; Bayesian probability; Feature selection; Selection (genetic algorithm); Machine learning; Variable (mathematics); Bayesian inference; Artificial intelligence; Inference; Data mining; Mathematics","score_opus":0.4570566698120438,"score_gpt":0.5017153012643956,"score_spread":0.04465863145235177,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137145701","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011551636,0.9138982,0.07627455,0.003828641,0.0002527409,0.00006720813,0.00006121909,0.000042572898,0.004419584],"genre_scores_gemma":[0.01782504,0.9260655,0.05319681,0.0009672341,0.0007101876,0.00020231756,0.00013832616,0.000056228404,0.00083823554],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9874943,0.008593378,0.0007566944,0.00069048116,0.0023318913,0.00013331455],"domain_scores_gemma":[0.9353842,0.059603367,0.000944735,0.00065654196,0.00314586,0.00026539687],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026649216,0.0012452151,0.0024161588,0.00465585,0.0004722083,0.0024167427,0.002034972,0.0019378536,0.0042605265],"category_scores_gemma":[0.053299267,0.0006577546,0.0016420488,0.006462244,0.0016498278,0.002407204,0.001266924,0.0028102493,0.0012238631],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000118141885,0.000060553102,0.0014400411,0.0076314877,0.0004791139,0.00009647629,0.00021720293,0.005258452,0.00016626962,0.057364825,0.0066542807,0.9205131],"study_design_scores_gemma":[0.0002962355,0.0009905811,0.01014088,0.027179793,0.0020196103,0.0034113848,0.00083199394,0.03561178,0.0018789967,0.3198092,0.5975172,0.00031244228],"about_ca_topic_score_codex":0.003152308,"about_ca_topic_score_gemma":0.003950321,"teacher_disagreement_score":0.97335076,"about_ca_system_score_codex":0.0016057915,"about_ca_system_score_gemma":0.0028505616,"threshold_uncertainty_score":0.14093626},"labels":[],"label_agreement":null},{"id":"W3193794660","doi":"10.1515/ijb-2020-0144","title":"Quantifying the extent of visit irregularity in longitudinal data","year":2021,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Health Services and Policy Research; Institute for Clinical Evaluative Sciences; University of Toronto; SickKids Foundation; Hospital for Sick Children; Public Health Ontario","funders":"","keywords":"Bin; Observational study; Statistics; Longitudinal data; Sample size determination; Longitudinal study; Medicine; Repeated measures design; Mathematics; Demography; Computer science; Data mining","score_opus":0.3671022536769504,"score_gpt":0.48595958555317914,"score_spread":0.11885733187622877,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193794660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3075656,0.0016318484,0.68186426,0.0019351689,0.0001792957,0.00046848218,0.0026314065,0.0007023585,0.0030215555],"genre_scores_gemma":[0.8942146,0.00046456445,0.102277316,0.0003423379,0.00013500123,0.00038530337,0.0014489866,0.00010748455,0.0006246097],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93481386,0.04866228,0.0055002784,0.005546178,0.004422153,0.0010553888],"domain_scores_gemma":[0.5372262,0.3563364,0.051633522,0.046846036,0.0066076033,0.0013502032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1078882,0.00062880374,0.001379356,0.0038227872,0.001211314,0.0027151648,0.001691957,0.0018511827,0.0012480244],"category_scores_gemma":[0.3522281,0.0007389009,0.0020398826,0.00593654,0.0029038412,0.004194939,0.0033097742,0.0025573315,0.00021272604],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007391342,0.000117182804,0.8208955,0.0005279443,0.001633807,0.00031679997,0.0021788892,0.06426073,0.0011561326,0.020659037,0.001518406,0.08599641],"study_design_scores_gemma":[0.000093114526,0.00096767757,0.5388635,0.0006338342,0.0007019596,0.0013116628,0.0017613476,0.292594,0.0031552627,0.14873797,0.010885859,0.0002938366],"about_ca_topic_score_codex":0.006641651,"about_ca_topic_score_gemma":0.006492223,"teacher_disagreement_score":0.1078882,"about_ca_system_score_codex":0.0012853104,"about_ca_system_score_gemma":0.0016258414,"threshold_uncertainty_score":0.57057416},"labels":[],"label_agreement":null},{"id":"W3197649143","doi":"10.1515/ijb-2020-0046","title":"An improved method for analysis of interrupted time series (ITS) data: accounting for patient heterogeneity using weighted analysis","year":2021,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Blood Pressure and Hypertension Studies","field":"Medicine","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; McMaster University; Children's Hospital of Eastern Ontario; Impact; St. Michael's Hospital; St. Joseph’s Healthcare Hamilton; University of Ottawa","funders":"","keywords":"Interrupted Time Series Analysis; Time series; Statistics; Series (stratigraphy); Econometrics; Interrupted time series; Computer science; Mathematics; Accounting; Medicine; Economics","score_opus":0.078531408221474,"score_gpt":0.39894760312035393,"score_spread":0.32041619489887996,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3197649143","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012803506,0.00009356237,0.99795735,0.000059564376,0.000050744016,0.00019285391,0.000110257286,0.00012153902,0.0001337868],"genre_scores_gemma":[0.05917282,0.00037376003,0.9360254,0.0002030229,0.00014732021,0.0025508527,0.0005646381,0.00020568797,0.0007565358],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9522599,0.038893625,0.002118587,0.0028359457,0.0034728278,0.0004190708],"domain_scores_gemma":[0.8990806,0.08126007,0.0053122244,0.007258637,0.0066017383,0.00048675307],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05059769,0.0016759599,0.0022962277,0.00338337,0.0004952996,0.0016157014,0.0027351414,0.0015413762,0.0043475907],"category_scores_gemma":[0.14826123,0.0007140263,0.0039495295,0.0042894315,0.000935495,0.0023033132,0.001842661,0.0026674236,0.000620876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012991588,0.00035935637,0.015383854,0.0023582974,0.004623473,0.00049084664,0.00093151524,0.15603495,0.005798933,0.16969985,0.007560551,0.6354592],"study_design_scores_gemma":[0.00037160973,0.0012188909,0.0045569306,0.00038409317,0.0009278366,0.0004488428,0.00012531469,0.87556887,0.0030922398,0.09682203,0.016312728,0.00017069228],"about_ca_topic_score_codex":0.002553498,"about_ca_topic_score_gemma":0.0014474714,"teacher_disagreement_score":0.05059769,"about_ca_system_score_codex":0.0007556727,"about_ca_system_score_gemma":0.0029181812,"threshold_uncertainty_score":0.26758933},"labels":[],"label_agreement":null},{"id":"W4294310517","doi":"10.1515/ijb-2022-0056","title":"Causal inference for oncology: past developments and current challenges","year":2022,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Fonds de Recherche du Québec - Santé","keywords":"Causal inference; Inference; Current (fluid); Medical physics; Medicine; Econometrics; Data science; Computer science; Oncology; Mathematics; Artificial intelligence; Physics","score_opus":0.48275920743690715,"score_gpt":0.5532970978116655,"score_spread":0.07053789037475833,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4294310517","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000061814084,0.99089056,0.0037051504,0.0045577567,0.00032757202,0.0000053229546,0.000013471102,0.000010200807,0.00042819267],"genre_scores_gemma":[0.0017370053,0.9920345,0.0031989592,0.0012976745,0.0015338757,0.000015126074,0.00002459019,0.000009486422,0.00014878954],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9954868,0.0027446768,0.0003577634,0.00050033134,0.0008068415,0.00010358217],"domain_scores_gemma":[0.9217266,0.07220649,0.0012245544,0.001076112,0.0032597065,0.00050659117],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.018522102,0.0010913559,0.0028637145,0.0032331927,0.0006675199,0.0026491045,0.0024053885,0.0038987042,0.0040329895],"category_scores_gemma":[0.040463466,0.00081259,0.0012999343,0.0042765713,0.004113608,0.005060812,0.0019389313,0.00762055,0.0015465145],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010903449,0.00007102768,0.00044300503,0.017324347,0.00026608098,0.0001586306,0.00024124858,0.0022970177,0.0002181614,0.14066452,0.021166438,0.81704044],"study_design_scores_gemma":[0.000058238944,0.000149607,0.0011244783,0.021397773,0.00029330148,0.000935998,0.00033269785,0.002074984,0.00039848656,0.2832964,0.68983996,0.00009805405],"about_ca_topic_score_codex":0.0025809372,"about_ca_topic_score_gemma":0.0027351596,"teacher_disagreement_score":0.9814779,"about_ca_system_score_codex":0.0021193014,"about_ca_system_score_gemma":0.0053187576,"threshold_uncertainty_score":0.097955406},"labels":[],"label_agreement":null},{"id":"W4307134400","doi":"10.1515/ijb-2022-0010","title":"A copula-based set-variant association test for bivariate continuous, binary or mixed phenotypes","year":2022,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University","funders":"Medical Research Council; Natural Sciences and Engineering Research Council of Canada; Wellcome Trust","keywords":"Bivariate analysis; Multivariate statistics; Copula (linguistics); Type I and type II errors; Genome-wide association study; Multivariate normal distribution; Statistics; Multivariate analysis; Genetic association; Mathematics; Computer science; Econometrics; Biology; Genetics; Single-nucleotide polymorphism; Gene","score_opus":0.01717379251875667,"score_gpt":0.2889192896215963,"score_spread":0.27174549710283963,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307134400","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08016092,0.0003674997,0.91697955,0.00026994557,0.000075098345,0.0001886063,0.0004856857,0.00068151177,0.00079123344],"genre_scores_gemma":[0.7528501,0.00017411368,0.24430753,0.00029097302,0.000107525,0.00046469847,0.0010729223,0.00012761886,0.00060453545],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9919704,0.0049082353,0.00037718366,0.0015447004,0.0009180991,0.0002812471],"domain_scores_gemma":[0.9490416,0.041533154,0.003533661,0.0026459082,0.0021328288,0.0011128624],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011421161,0.0008842671,0.0021998284,0.0029034035,0.00056981255,0.0014120525,0.0027409326,0.0013207444,0.004063075],"category_scores_gemma":[0.060350537,0.00039444005,0.0018288714,0.0027285614,0.0015712221,0.0012820496,0.002197256,0.0015814096,0.0005265378],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002410491,0.000828437,0.20515378,0.00075360434,0.004442388,0.0026420066,0.0005106098,0.2711271,0.01508362,0.12837619,0.008885322,0.35978648],"study_design_scores_gemma":[0.00015041592,0.0003561418,0.016833033,0.000032472813,0.00025061655,0.0004852509,0.000060684684,0.9573428,0.0017545618,0.021844685,0.0008332689,0.000056070443],"about_ca_topic_score_codex":0.0014488603,"about_ca_topic_score_gemma":0.0010589074,"teacher_disagreement_score":0.011421161,"about_ca_system_score_codex":0.00068211433,"about_ca_system_score_gemma":0.0015691275,"threshold_uncertainty_score":0.06040156},"labels":[],"label_agreement":null},{"id":"W4310956147","doi":"10.1515/ijb-2022-0017","title":"Statistics, philosophy, and health: the SMAC 2021 webconference","year":2022,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Philosophy and History of Science","field":"Arts and Humanities","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Causality (physics); Table (database); Point (geometry); Computer science; Epistemology; Statistics; Library science; Mathematics; Philosophy; Data mining","score_opus":0.08710155087595003,"score_gpt":0.2798330896389365,"score_spread":0.19273153876298646,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4310956147","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0043723346,0.0413585,0.013917811,0.58306944,0.0891691,0.00031690334,0.006308125,0.0019815557,0.25950623],"genre_scores_gemma":[0.08292396,0.028025806,0.033901956,0.11823373,0.095587015,0.0016630822,0.0102171,0.004097027,0.62535036],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9922748,0.0039133993,0.00018837643,0.00035596653,0.0026902724,0.0005771783],"domain_scores_gemma":[0.9653545,0.015367437,0.00066650816,0.0015914766,0.0069466946,0.01007345],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.025504997,0.0008449012,0.0007237032,0.0026375856,0.0031071142,0.010170964,0.0016605257,0.00537908,0.09910966],"category_scores_gemma":[0.041491356,0.0005246621,0.0006317198,0.0023577812,0.003419337,0.0055027357,0.0063403663,0.0083677,0.031461477],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026461794,0.00002137237,0.000070361304,0.00004762682,0.0000028523436,0.000037980793,0.000121062054,0.000074392156,0.00007278053,0.0050948597,0.9732056,0.02122465],"study_design_scores_gemma":[0.000018960534,0.000017815597,0.0006562798,0.00021650545,0.0000018412887,0.00006560555,0.00025494816,0.00020913663,0.00010394149,0.0074602617,0.9909773,0.000017483611],"about_ca_topic_score_codex":0.0079455525,"about_ca_topic_score_gemma":0.013100584,"teacher_disagreement_score":0.99689287,"about_ca_system_score_codex":0.0063241734,"about_ca_system_score_gemma":0.00713232,"threshold_uncertainty_score":0.33155483},"labels":[],"label_agreement":null},{"id":"W4375864930","doi":"10.1515/ijb-2021-0091","title":"Error analysis of the PacBio sequencing CCS reads","year":2023,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Genomics and Phylogenetic Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Nanopore sequencing; Computer science; Hybrid genome assembly; Word error rate; Probabilistic logic; Sequence assembly; DNA sequencing; Process (computing); k-mer; Error detection and correction; Binomial distribution; Algorithm; Computational biology; Shotgun sequencing; Data mining; Biology; Mathematics; Statistics; Artificial intelligence; Genetics; DNA","score_opus":0.02603351602590837,"score_gpt":0.29465399206466025,"score_spread":0.2686204760387519,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4375864930","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.35384062,0.0011344465,0.6384775,0.0003197905,0.00013945349,0.00018553101,0.0017537227,0.0020644444,0.0020844613],"genre_scores_gemma":[0.8602769,0.00038697373,0.12989546,0.00015257475,0.000065450025,0.00024994387,0.0058246385,0.00036839364,0.0027796635],"study_design_codex":"simulation_or_modeling","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.9939918,0.0008242645,0.00041668682,0.0014682547,0.002991323,0.00030752996],"domain_scores_gemma":[0.9761135,0.013404655,0.0025234867,0.0020919861,0.0056047086,0.00026166724],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0072384086,0.001007957,0.0007399307,0.0019451735,0.0005867142,0.0011873754,0.0016025016,0.0012906017,0.0011835796],"category_scores_gemma":[0.022810549,0.00039636937,0.00084776484,0.0017311004,0.0008102584,0.0011429394,0.0009820242,0.0009673126,0.00047570257],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013342742,0.00019765073,0.06630194,0.000555455,0.000233694,0.00080816646,0.000451196,0.74840194,0.04474036,0.017221177,0.0023392464,0.11741496],"study_design_scores_gemma":[0.000013251222,0.000067090645,0.011516485,0.000030578645,0.000029321865,0.00027868513,0.000046320038,0.95294696,0.029614378,0.0040494674,0.0013655678,0.00004196056],"about_ca_topic_score_codex":0.0075086085,"about_ca_topic_score_gemma":0.004316567,"teacher_disagreement_score":0.0075086085,"about_ca_system_score_codex":0.0015708595,"about_ca_system_score_gemma":0.0014006951,"threshold_uncertainty_score":0.038280785},"labels":[],"label_agreement":null},{"id":"W4376112662","doi":"10.1515/ijb-2022-0040","title":"Exact correction factor for estimating the OR in the presence of sparse data with a zero cell in 2 × 2 tables","year":2023,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University; Population Health Research Institute","funders":"","keywords":"Zero (linguistics); Statistics; Mathematics; Applied mathematics; Computer science; Algorithm","score_opus":0.14832876308927137,"score_gpt":0.4169003802549265,"score_spread":0.26857161716565514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376112662","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008755968,0.00046580203,0.98900616,0.00018094404,0.00013737798,0.00031109963,0.00018469665,0.00047359642,0.00048432767],"genre_scores_gemma":[0.10421833,0.0002553956,0.8932655,0.00015440409,0.00008225426,0.0009210148,0.00028194676,0.00016030071,0.00066079857],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9511493,0.035197943,0.0030649435,0.00495492,0.0049867174,0.0006462178],"domain_scores_gemma":[0.796267,0.17559443,0.0059393514,0.015655551,0.006155949,0.0003877095],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05017083,0.0008314589,0.00157526,0.0021293,0.0008674378,0.0017009799,0.0025981066,0.0018702479,0.0062640733],"category_scores_gemma":[0.27344173,0.0006906817,0.0021262607,0.0024723657,0.0018655378,0.0021578048,0.0016398443,0.002545197,0.0008754185],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019368608,0.00025929147,0.06244106,0.003086158,0.00222347,0.0013859781,0.0021492054,0.078002214,0.0084822625,0.10212323,0.010402874,0.72750735],"study_design_scores_gemma":[0.00062418345,0.0020434184,0.028514078,0.0016731032,0.0019498377,0.004091975,0.00073401455,0.6657361,0.025269123,0.21355498,0.055471435,0.00033779594],"about_ca_topic_score_codex":0.0026813122,"about_ca_topic_score_gemma":0.002607135,"teacher_disagreement_score":0.05017083,"about_ca_system_score_codex":0.00092291593,"about_ca_system_score_gemma":0.0023853078,"threshold_uncertainty_score":0.26533186},"labels":[],"label_agreement":null},{"id":"W4376637825","doi":"10.1515/ijb-2022-0073","title":"Bayesian inference for optimal dynamic treatment regimes in practice","year":2023,"lang":"en","type":"review","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Inference; Bayesian inference; Bayesian probability; Frequentist inference; Biostatistics; Econometrics; Estimator; Machine learning; Computer science; Artificial intelligence; Mathematics; Statistics; Medicine","score_opus":0.22417419034281136,"score_gpt":0.5431292370587046,"score_spread":0.31895504671589325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4376637825","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0045812,0.00062844524,0.9900746,0.0012165604,0.000051248026,0.00016397053,0.00024510163,0.00021529772,0.0028234427],"genre_scores_gemma":[0.3479912,0.0023476493,0.63685566,0.0017416326,0.00042192996,0.00217598,0.0012897518,0.0003752411,0.006801018],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9627854,0.027059596,0.0011615872,0.0051990035,0.0028364283,0.0009579061],"domain_scores_gemma":[0.84834623,0.13820405,0.004607168,0.005121014,0.0030033914,0.0007180651],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.049635272,0.0015354325,0.0048366846,0.0035581547,0.0012253457,0.0051410524,0.004299535,0.0042453026,0.012584865],"category_scores_gemma":[0.21459825,0.0022128366,0.0029499107,0.0033613848,0.005511315,0.0073215165,0.0038841502,0.008633748,0.0019076876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020997168,0.00015480083,0.0034830072,0.0004119215,0.0004411945,0.00014103824,0.00040424615,0.34858498,0.00022845353,0.5649707,0.005487802,0.075481944],"study_design_scores_gemma":[0.000089899855,0.00003837963,0.0006364834,0.00022831932,0.000058329766,0.00003966513,0.000046634363,0.44929877,0.00017818378,0.5461238,0.003225429,0.000036116748],"about_ca_topic_score_codex":0.010229823,"about_ca_topic_score_gemma":0.007646862,"teacher_disagreement_score":0.049635272,"about_ca_system_score_codex":0.0050520347,"about_ca_system_score_gemma":0.0042707804,"threshold_uncertainty_score":0.26249957},"labels":[],"label_agreement":null},{"id":"W4394615219","doi":"10.1515/ijb-2023-0102","title":"Ensemble learning methods of inference for spatially stratified infectious disease systems","year":2024,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Animal Disease Management and Epidemiology","field":"Agricultural and Biological Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Winnipeg; University of Calgary","funders":"","keywords":"Markov chain Monte Carlo; Covariate; Computer science; Bayesian inference; Inference; Bayesian probability; Ensemble learning; Population; Boosting (machine learning); Random forest; Machine learning; Markov chain; Artificial intelligence; Statistical inference; Bayes' theorem; Statistics; Econometrics; Mathematics","score_opus":0.049532261754997794,"score_gpt":0.3602157903403812,"score_spread":0.3106835285853834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394615219","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007893741,0.00037382636,0.9910063,0.00011073622,0.000026768894,0.000028997232,0.000074316,0.00016267781,0.00032258008],"genre_scores_gemma":[0.4561144,0.0013928872,0.5387611,0.00024884686,0.00023293293,0.00041515162,0.00096511655,0.00012602838,0.0017435766],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99734926,0.0016817591,0.00013967433,0.00036582616,0.00034962015,0.00011372739],"domain_scores_gemma":[0.9869486,0.010388051,0.0006795036,0.0008521698,0.0009408851,0.00019082073],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008384758,0.0011146017,0.0021206934,0.0018931627,0.00078772975,0.0011692484,0.0017766707,0.0012793153,0.0013564031],"category_scores_gemma":[0.019845422,0.0006512108,0.0015306708,0.0013671201,0.0006860707,0.0017858001,0.0014877093,0.0022378392,0.00031982228],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000039498278,0.00004050091,0.0031488403,0.000058603706,0.0002059994,0.000040463114,0.00006358079,0.9280961,0.00027946002,0.014195231,0.00070852356,0.053123135],"study_design_scores_gemma":[0.0000027912574,0.0000072250727,0.00016450872,0.00000555227,0.000007830001,0.000004884539,0.0000037542857,0.9904608,0.00005025004,0.009118462,0.00017036957,0.000003528221],"about_ca_topic_score_codex":0.007896728,"about_ca_topic_score_gemma":0.0075906813,"teacher_disagreement_score":0.008384758,"about_ca_system_score_codex":0.0009603048,"about_ca_system_score_gemma":0.0013180645,"threshold_uncertainty_score":0.044343412},"labels":[],"label_agreement":null},{"id":"W4394618888","doi":"10.1515/ijb-2023-0121","title":"The survival function NPMLE for combined right-censored and length-biased right-censored failure time data: properties and applications","year":2024,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University; University of Regina","funders":"","keywords":"Estimator; Survival function; Kaplan–Meier estimator; Cohort; Nonparametric statistics; Statistics; Function (biology); Mathematics; Survival analysis; Econometrics; Maximum likelihood; Cohort effect","score_opus":0.07410926737206686,"score_gpt":0.339667379602726,"score_spread":0.26555811223065917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4394618888","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018252853,0.00063254114,0.97949684,0.0006916073,0.000023064362,0.00006625027,0.00016323612,0.00015518304,0.0005184201],"genre_scores_gemma":[0.480422,0.0017080113,0.5099122,0.0008652189,0.00037271064,0.0010875444,0.0015787983,0.00023718487,0.0038163783],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9946287,0.00385545,0.00020531243,0.000484072,0.00062839955,0.00019796629],"domain_scores_gemma":[0.9294459,0.061035458,0.0032078023,0.0035198506,0.0023061214,0.0004848491],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03306196,0.00083971553,0.0014721559,0.0026837639,0.00041843552,0.0010988362,0.0020173832,0.0017173373,0.0020783253],"category_scores_gemma":[0.09487394,0.00046876396,0.0014737669,0.0018174396,0.0026013758,0.003932909,0.0025991362,0.0027569144,0.000417069],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003282123,0.00017266105,0.083925486,0.0007466723,0.000654172,0.00091114704,0.0011336274,0.2250704,0.0038786232,0.43473256,0.004528053,0.24391833],"study_design_scores_gemma":[0.000051629537,0.00019039755,0.015331839,0.00025417676,0.000090888665,0.0008864063,0.00021549515,0.7424169,0.0015035731,0.2336007,0.0053784777,0.000079458805],"about_ca_topic_score_codex":0.0024579556,"about_ca_topic_score_gemma":0.0015375328,"teacher_disagreement_score":0.03306196,"about_ca_system_score_codex":0.001078431,"about_ca_system_score_gemma":0.0015445278,"threshold_uncertainty_score":0.17485046},"labels":[],"label_agreement":null},{"id":"W4395117975","doi":"10.1515/ijb-2023-0056","title":"Random forests for survival data: which methods work best and under what conditions?","year":2024,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Random forest; Statistics; Work (physics); Mathematics; Econometrics; Computer science; Engineering; Machine learning","score_opus":0.21037535950266203,"score_gpt":0.5072925026780893,"score_spread":0.2969171431754273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4395117975","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033850484,0.02672266,0.92430574,0.008036658,0.00075716793,0.0007018698,0.0019226457,0.001247201,0.002455551],"genre_scores_gemma":[0.2106091,0.01470128,0.766207,0.0022264232,0.0010067935,0.001402619,0.0022025506,0.0010505697,0.00059375336],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9055507,0.080696836,0.0029284195,0.0050734235,0.0047963806,0.0009542144],"domain_scores_gemma":[0.65275604,0.30517828,0.012325343,0.018116925,0.009980448,0.0016429974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.14776777,0.0019755738,0.004273961,0.004797081,0.002054987,0.0053807152,0.0029922926,0.0031745457,0.0023090325],"category_scores_gemma":[0.34058177,0.00095654046,0.0035307324,0.006171849,0.002641653,0.008029996,0.00169823,0.004721624,0.002068341],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016121163,0.00037716076,0.09728981,0.0064887237,0.004757787,0.00026588884,0.0025648852,0.06472053,0.0014613363,0.05288273,0.027937137,0.73964185],"study_design_scores_gemma":[0.0010897329,0.0010602268,0.035500012,0.009752539,0.002132975,0.0012783296,0.0024420908,0.33734682,0.004603034,0.56597966,0.038046524,0.00076803094],"about_ca_topic_score_codex":0.004266121,"about_ca_topic_score_gemma":0.0092471475,"teacher_disagreement_score":0.14776777,"about_ca_system_score_codex":0.0014084459,"about_ca_system_score_gemma":0.0037897092,"threshold_uncertainty_score":0.78147995},"labels":[],"label_agreement":null},{"id":"W4401517718","doi":"10.1515/ijb-2023-0116","title":"History-restricted marginal structural model and latent class growth analysis of treatment trajectories for a time-dependent outcome","year":2024,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University Health Centre; Université de Montréal; McGill University; Institut National de Santé Publique du Québec; Université Laval","funders":"Canadian Institutes of Health Research; Université Laval","keywords":"Econometrics; Marginal structural model; Outcome (game theory); Class (philosophy); Latent class model; Structural equation modeling; Statistics; Marginal model; Mathematics; Computer science; Causal inference; Mathematical economics; Regression analysis; Artificial intelligence","score_opus":0.10769438102764733,"score_gpt":0.39364910278080345,"score_spread":0.2859547217531561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401517718","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035105538,0.00053970265,0.9595855,0.0012090547,0.00009411671,0.0002780017,0.0012017471,0.00037369746,0.0016125857],"genre_scores_gemma":[0.7009097,0.00084326,0.28667793,0.0004749473,0.00017833199,0.0015714578,0.0021628616,0.00020044287,0.0069812173],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9928739,0.0049858238,0.00016406401,0.0012320019,0.00044934358,0.00029488633],"domain_scores_gemma":[0.98364246,0.011865777,0.0014210945,0.0018345522,0.00093858596,0.00029766292],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013449376,0.0012473031,0.0015630495,0.0020901153,0.00055069244,0.0015387894,0.0027757883,0.001503691,0.0088538295],"category_scores_gemma":[0.032622352,0.0005592859,0.0033135593,0.0021096969,0.002136213,0.0022875378,0.0019151523,0.0028726659,0.0008941385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042238258,0.00023423844,0.043390114,0.0004468113,0.0010988533,0.000314743,0.0018353832,0.27449173,0.0009945061,0.514562,0.0047489773,0.15746024],"study_design_scores_gemma":[0.000049636456,0.00015419484,0.008232173,0.00010854551,0.00020143641,0.00009822471,0.00018965168,0.7193125,0.00034419156,0.26664674,0.004602352,0.00006031186],"about_ca_topic_score_codex":0.015010686,"about_ca_topic_score_gemma":0.01541155,"teacher_disagreement_score":0.015010686,"about_ca_system_score_codex":0.0027669985,"about_ca_system_score_gemma":0.0029218046,"threshold_uncertainty_score":0.07112795},"labels":[],"label_agreement":null},{"id":"W4410591660","doi":"10.1515/ijb-2024-0005","title":"Guidance on individualized treatment rule estimation in high dimensions","year":2025,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Interpretability; Covariate; Observational study; Estimator; Computer science; Machine learning; Mathematics; Statistics","score_opus":0.057206199167839276,"score_gpt":0.41183681128257044,"score_spread":0.3546306121147312,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410591660","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018342644,0.0025529913,0.98272735,0.007314192,0.00029307435,0.00032266203,0.0009440053,0.0012323463,0.00277917],"genre_scores_gemma":[0.0251721,0.0018667578,0.96807486,0.001953642,0.0003969897,0.0007419234,0.00073331327,0.00027140282,0.0007890905],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9605775,0.030605381,0.0024272127,0.0017586275,0.0042696116,0.0003615653],"domain_scores_gemma":[0.7022875,0.2703054,0.005659257,0.011391897,0.009249256,0.0011065925],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03731586,0.0016841929,0.0026259392,0.0030089968,0.0007913799,0.0031924634,0.003973587,0.004725027,0.013172694],"category_scores_gemma":[0.31389102,0.0013409187,0.0021152252,0.0024005726,0.00211532,0.0034995454,0.0025979942,0.0070413523,0.004588529],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00068060536,0.00038911402,0.005978319,0.0022581816,0.00035017822,0.00042902914,0.0008960493,0.11533111,0.0017839402,0.20485722,0.110473484,0.5565728],"study_design_scores_gemma":[0.00079786766,0.00030673156,0.0031139066,0.0030839378,0.00016529167,0.0006606889,0.00019306353,0.34044036,0.003834772,0.55910397,0.08805106,0.00024830937],"about_ca_topic_score_codex":0.005629851,"about_ca_topic_score_gemma":0.008944847,"teacher_disagreement_score":0.03731586,"about_ca_system_score_codex":0.0015122137,"about_ca_system_score_gemma":0.00623306,"threshold_uncertainty_score":0.19734746},"labels":[],"label_agreement":null},{"id":"W4416438862","doi":"10.1515/ijb-2024-0011","title":"Post-shrinkage strategies for nonlinear semiparametric regression models in low and high-dimensional settings","year":2025,"lang":"en","type":"article","venue":"The International Journal of Biostatistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"Türkiye Bilimsel ve Teknolojik Araştırma Kurumu","keywords":"Estimator; Parametric statistics; Semiparametric regression; Nonlinear system; Semiparametric model; Regression; Estimation; Parametric model; Nonlinear regression; Breast cancer","score_opus":0.034606502573104284,"score_gpt":0.36961705616745444,"score_spread":0.33501055359435017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416438862","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003686066,0.00015413383,0.99569464,0.000111962174,0.0000073240167,0.00001660827,0.000012204431,0.00004984427,0.0002670982],"genre_scores_gemma":[0.34274942,0.0014934716,0.6500457,0.00031473566,0.00020592374,0.0005387122,0.00026856043,0.00022425353,0.0041591846],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965623,0.0025204197,0.00011934409,0.00029823295,0.00040557896,0.00009408089],"domain_scores_gemma":[0.9878991,0.009668147,0.0009487566,0.00063463097,0.0007054222,0.00014396178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00998315,0.0011096236,0.0013505978,0.000813417,0.00037233162,0.0009725393,0.0019300992,0.0012789785,0.0013094585],"category_scores_gemma":[0.024799464,0.00071530405,0.0010213013,0.00079263165,0.0018940701,0.001709749,0.002117222,0.0019705794,0.0005410028],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010385332,0.00009699545,0.0020501,0.00041732923,0.00020227181,0.0002744984,0.0004048954,0.6804325,0.0041720467,0.1763908,0.001499398,0.13395527],"study_design_scores_gemma":[0.000012232123,0.000039338436,0.00020314267,0.000020275218,0.000017206894,0.000036950565,0.000017554672,0.96805567,0.0007046375,0.030144079,0.00073597155,0.000012977909],"about_ca_topic_score_codex":0.0009401131,"about_ca_topic_score_gemma":0.0012329033,"teacher_disagreement_score":0.00998315,"about_ca_system_score_codex":0.0005521441,"about_ca_system_score_gemma":0.0011695347,"threshold_uncertainty_score":0.052796602},"labels":[],"label_agreement":null}]}