{"meta":{"query_hash":"42798c2100f6","filters":{"venue":"The American Statistician"},"cohort_total":60,"direct_labels_cover":1,"predictions_cover":60,"exported":60,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/42798c2100f6","api":"https://metacan.xera.ac/api/v1/cohort?venue=The+American+Statistician"},"results":[{"id":"W1609447734","doi":"10.1080/00031305.2015.1033985","title":"Advanced Placement Statistics: Expanding the Scope of Statistics Education","year":2015,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Statistics; Statistics education; Scope (computer science); Quarter (Canadian coin); Descriptive statistics; Summary statistics; Mathematics education; Computer science; Psychology; Mathematics; Geography","score_opus":0.17090548150606014,"score_gpt":0.4657031647904276,"score_spread":0.2947976832843675,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1609447734","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006613673,0.02921578,0.28592074,0.49104804,0.015149451,0.00049542065,0.0018825902,0.010729886,0.15894447],"genre_scores_gemma":[0.14485128,0.1108642,0.48514488,0.09043794,0.08592962,0.0012670275,0.004765641,0.006861509,0.06987796],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9722511,0.013471335,0.002096341,0.0018791589,0.009062515,0.0012395595],"domain_scores_gemma":[0.71198964,0.15620476,0.01066656,0.0315852,0.051091257,0.038462564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06365512,0.0010638468,0.0011390998,0.012874633,0.0021464454,0.008781138,0.0036339746,0.003737857,0.04726397],"category_scores_gemma":[0.16613445,0.00096418237,0.0010823321,0.009812416,0.0063215103,0.016744908,0.01197467,0.008930937,0.026044423],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000055786026,0.00014441423,0.0035018844,0.00044637694,0.000013572175,0.000096679236,0.0007956448,0.0006261846,0.00048940413,0.09833236,0.2549346,0.6405631],"study_design_scores_gemma":[0.00003332925,0.000112564776,0.0050874166,0.0011150223,0.000008895614,0.00023303644,0.00069091935,0.0016048682,0.00033318653,0.1438184,0.84689677,0.000065697786],"about_ca_topic_score_codex":0.003932169,"about_ca_topic_score_gemma":0.0045943544,"teacher_disagreement_score":0.06365512,"about_ca_system_score_codex":0.0036653155,"about_ca_system_score_gemma":0.023407783,"threshold_uncertainty_score":0.33664447},"labels":[],"label_agreement":null},{"id":"W1763804216","doi":"10.1198/0003130031072","title":"Statistics and Ethics","year":2003,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"College of the North Atlantic","funders":"","keywords":"Advice (programming); Statistics; Work (physics); Sociology; Psychology; Computer science; Mathematics; Engineering","score_opus":0.2657415008978894,"score_gpt":0.4875637517411046,"score_spread":0.22182225084321522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1763804216","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020311489,0.0204052,0.057315007,0.7970872,0.014717276,0.00024739403,0.00024913045,0.0002117543,0.107735775],"genre_scores_gemma":[0.2020513,0.027726164,0.11261245,0.53644073,0.04971709,0.0025534483,0.00042447262,0.0007200903,0.067754336],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8421559,0.11406594,0.009037223,0.006361826,0.024379697,0.003999379],"domain_scores_gemma":[0.7603367,0.17889963,0.009544445,0.018353883,0.023671018,0.009194161],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11371463,0.0012918204,0.0022729535,0.0023761403,0.010310256,0.015591578,0.0022386187,0.015983658,0.0051729255],"category_scores_gemma":[0.17715317,0.0009349826,0.0009530163,0.002729745,0.059507977,0.009337175,0.006165949,0.028380806,0.0046230583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000020191705,0.00002800198,0.0003431048,0.00013176078,0.000019980134,0.00007039489,0.003081123,0.0002663817,0.00012587146,0.9024458,0.08321719,0.010250362],"study_design_scores_gemma":[0.000017700504,0.00003156293,0.00028050572,0.00054090604,0.000007172757,0.00015129457,0.0011700023,0.00042404069,0.000114031835,0.65614766,0.3410888,0.000026340418],"about_ca_topic_score_codex":0.004148142,"about_ca_topic_score_gemma":0.0032212485,"teacher_disagreement_score":0.88628536,"about_ca_system_score_codex":0.0062239906,"about_ca_system_score_gemma":0.019605748,"threshold_uncertainty_score":0.6013876},"labels":[],"label_agreement":null},{"id":"W1965544836","doi":"10.1198/000313002753631321","title":"Thoughts on the Origins, Concepts, and Pedagogy of Statistics as a “Separate Discipline”","year":2002,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Discipline; Subject (documents); Field (mathematics); Statistics; Statistics education; Mathematics education; Sociology; Epistemology; Mathematics; Social science; Computer science; Library science; Philosophy","score_opus":0.18099864238006144,"score_gpt":0.48182816395389355,"score_spread":0.30082952157383214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1965544836","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018844064,0.065074176,0.107552946,0.6635114,0.0063394746,0.00006114668,0.0002298244,0.00027526641,0.13811168],"genre_scores_gemma":[0.6808688,0.092705026,0.07315473,0.107958905,0.014208039,0.00044440487,0.00038668126,0.00041561387,0.029857881],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9921422,0.004714605,0.0002940705,0.0009095594,0.0015462848,0.00039333795],"domain_scores_gemma":[0.97188705,0.022905536,0.0013915139,0.00090502255,0.001996105,0.0009147341],"candidate_categories":["sts"],"consensus_categories":[],"category_scores_codex":[0.0144277485,0.00060626026,0.00057488424,0.004696239,0.0038078916,0.010349117,0.0019173804,0.003769788,0.0032932598],"category_scores_gemma":[0.023476642,0.00035738043,0.0006081243,0.0045863865,0.05215943,0.02087491,0.003779411,0.011619388,0.0011181696],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006252597,0.000009989582,0.0002159297,0.00004411837,0.000002002531,0.00001756319,0.0051060086,0.00010901911,0.000037694288,0.9835804,0.004440812,0.006430159],"study_design_scores_gemma":[0.0000062815743,0.000015286083,0.00064882764,0.0002829585,0.0000040030445,0.000059239057,0.0050305794,0.00042394825,0.000110767716,0.8430954,0.15030716,0.000015604426],"about_ca_topic_score_codex":0.003386766,"about_ca_topic_score_gemma":0.0038357107,"teacher_disagreement_score":0.9961921,"about_ca_system_score_codex":0.0061238664,"about_ca_system_score_gemma":0.006054557,"threshold_uncertainty_score":0.07630217},"labels":[],"label_agreement":null},{"id":"W1966264920","doi":"10.1198/000313008x269738","title":"Confidence Intervals for a Discrete Population Median","year":2008,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"HEC Montréal","funders":"","keywords":"Confidence interval; CDF-based nonparametric confidence interval; Robust confidence intervals; Statistics; Population; Confidence distribution; Confidence region; Statistic; Sign test; Mathematics; Credible interval; Sign (mathematics); Computer science; Medicine; Mann–Whitney U test; Wilcoxon signed-rank test","score_opus":0.5415881943883241,"score_gpt":0.581522353994503,"score_spread":0.039934159606178965,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1966264920","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0059521585,0.0012761818,0.9901452,0.00039620645,0.000104409446,0.00004453809,0.000097429234,0.00028785982,0.0016960277],"genre_scores_gemma":[0.31622577,0.0016321478,0.67882603,0.0004483944,0.00045217184,0.00058674783,0.00064239185,0.00028402536,0.0009023166],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9657569,0.021299845,0.0019322982,0.0037827676,0.0066235806,0.00060452026],"domain_scores_gemma":[0.74222606,0.22375964,0.009913344,0.012461452,0.0105301505,0.0011093745],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.044414632,0.00093249255,0.0020403827,0.005005,0.0008679715,0.003965088,0.003250215,0.0023372308,0.004267513],"category_scores_gemma":[0.30150467,0.0005100126,0.0014762812,0.0029029052,0.0038279789,0.005048527,0.0032785034,0.0057785013,0.00094657775],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005671523,0.00009891032,0.005144684,0.0010343115,0.00042555147,0.00032617865,0.0006720615,0.12137742,0.0014682197,0.66745514,0.0038563008,0.19757411],"study_design_scores_gemma":[0.00017156462,0.00029313596,0.0017843744,0.0006245586,0.00013130314,0.00046620093,0.0001792505,0.33263424,0.0030264321,0.65081537,0.009749659,0.00012389233],"about_ca_topic_score_codex":0.0008980724,"about_ca_topic_score_gemma":0.00034640334,"teacher_disagreement_score":0.044414632,"about_ca_system_score_codex":0.0015395463,"about_ca_system_score_gemma":0.001384012,"threshold_uncertainty_score":0.2348898},"labels":[],"label_agreement":null},{"id":"W1967757406","doi":"10.1198/tast.2009.0028","title":"Design Effect Caveats","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Water Quality and Resources Studies","field":"Environmental Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Statistics Canada","funders":"","keywords":"Simple (philosophy); Variance (accounting); Statistics; Computer science; Design of experiments; Econometrics; Mathematics; Economics; Epistemology","score_opus":0.0334271747039749,"score_gpt":0.26767573986853643,"score_spread":0.23424856516456152,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1967757406","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014285632,0.009863846,0.6150333,0.13194337,0.08567832,0.01827226,0.021945188,0.008489967,0.09448809],"genre_scores_gemma":[0.14990729,0.0013162307,0.67547894,0.092376664,0.0059447614,0.04104826,0.0019956247,0.002727979,0.029204244],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.5484486,0.26387727,0.06445439,0.029649625,0.08753349,0.006036577],"domain_scores_gemma":[0.15410018,0.7373166,0.019745504,0.04894438,0.037825424,0.002067938],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.37674105,0.0035895805,0.004918026,0.0062048165,0.004306616,0.0065814704,0.013076398,0.01494698,0.039808612],"category_scores_gemma":[0.7991827,0.0025390657,0.008321096,0.010235048,0.013032022,0.009559322,0.0064533865,0.026222778,0.0069975634],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003081757,0.00072577066,0.012068743,0.012324376,0.002817779,0.0031080404,0.009653738,0.0046897195,0.0015686608,0.29616657,0.4752521,0.17854278],"study_design_scores_gemma":[0.0024903708,0.0007850249,0.013683659,0.015014417,0.0018351759,0.0024494766,0.0018137124,0.018320091,0.0064207264,0.36933085,0.56737447,0.00048203458],"about_ca_topic_score_codex":0.0065974896,"about_ca_topic_score_gemma":0.014495627,"teacher_disagreement_score":0.62325895,"about_ca_system_score_codex":0.006244013,"about_ca_system_score_gemma":0.014389103,"threshold_uncertainty_score":0.76858926},"labels":[],"label_agreement":null},{"id":"W1978954330","doi":"10.1198/0003130043277","title":"Bootstrap Methods for Developing Predictive Models","year":2004,"lang":"en","type":"article","venue":"The American Statistician","topic":"Hydrology and Drought Analysis","field":"Environmental Science","cited_by":620,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Institute for Clinical Evaluative Sciences; Sunnybrook Health Science Centre","funders":"","keywords":"Resampling; Feature selection; Model selection; Computer science; Statistics; Predictive modelling; Selection (genetic algorithm); Bootstrap aggregating; Variables; Machine learning; Econometrics; Artificial intelligence; Mathematics","score_opus":0.035676760719567685,"score_gpt":0.3619012094975819,"score_spread":0.32622444877801426,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1978954330","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00054123544,0.00028371153,0.9972101,0.00012306432,0.000054019583,0.00011158383,0.00016609715,0.0008605198,0.0006497901],"genre_scores_gemma":[0.034521043,0.0011522039,0.95948493,0.00015973131,0.00028093669,0.0016938465,0.0011209889,0.00057490385,0.0010113426],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.988943,0.0076307314,0.0006155677,0.00077139755,0.0018493856,0.00019006334],"domain_scores_gemma":[0.96505606,0.028615767,0.0012377207,0.0023522535,0.0024594835,0.0002786488],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018007994,0.0029239394,0.0026691686,0.00606935,0.0012505351,0.0024912711,0.0034441003,0.0019255502,0.008046326],"category_scores_gemma":[0.07900786,0.0016726181,0.002325072,0.0048427777,0.0014452009,0.0028602963,0.0030424627,0.0047036665,0.005094206],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015949058,0.00018256917,0.0034389715,0.0010152631,0.0009757914,0.00038380324,0.0004468351,0.33391005,0.0013816832,0.21298447,0.021109397,0.4240117],"study_design_scores_gemma":[0.00008200188,0.000054273747,0.00044504364,0.00018770489,0.000088959074,0.00009624881,0.00006448936,0.77261144,0.0008039493,0.21117792,0.014341451,0.000046514746],"about_ca_topic_score_codex":0.0030684567,"about_ca_topic_score_gemma":0.002833245,"teacher_disagreement_score":0.018007994,"about_ca_system_score_codex":0.00086652866,"about_ca_system_score_gemma":0.0026247469,"threshold_uncertainty_score":0.09523654},"labels":[],"label_agreement":null},{"id":"W1991138897","doi":"10.1198/tast.2009.0008","title":"Influence Measures for General Linear Models With Correlated Errors","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Sciences and Engineering Research Council of Canada","funders":"","keywords":"Generalized linear model; General linear model; Linear regression; Linear model; Mathematics; Hierarchical generalized linear model; Simple (philosophy); Proper linear model; Statistics; Log-linear model; Generalized linear mixed model; Standard error; Econometrics; Applied mathematics; Simple linear regression; Bayesian multivariate linear regression","score_opus":0.07501124733594747,"score_gpt":0.3786968497289507,"score_spread":0.30368560239300324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1991138897","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00405291,0.0012091536,0.9900731,0.00026110656,0.0000684511,0.000040093768,0.00009681068,0.00011909711,0.004079294],"genre_scores_gemma":[0.42040548,0.009033802,0.5538487,0.0011091646,0.0017618536,0.0014529978,0.00095796207,0.0005858871,0.010844165],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9926893,0.0041506793,0.0004361283,0.00069515535,0.0016669239,0.00036181227],"domain_scores_gemma":[0.95346206,0.03842163,0.0035284017,0.0021999574,0.0019943933,0.0003934846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009383845,0.0017582522,0.0015832908,0.0033456231,0.0007315257,0.0022037663,0.0018377134,0.0017718863,0.004928056],"category_scores_gemma":[0.06733176,0.0006174504,0.0019878868,0.00359028,0.002409909,0.0041608466,0.0023692923,0.0028482557,0.0011905965],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000024365592,0.000033298515,0.0012170423,0.00022576834,0.00012569173,0.00022236459,0.0002337985,0.0618173,0.000732879,0.8939311,0.0032907764,0.038145635],"study_design_scores_gemma":[0.000012672179,0.00003668639,0.00077529147,0.00009013261,0.000069594236,0.00018096826,0.00003787098,0.23059751,0.0005071768,0.7623356,0.0053179483,0.000038615082],"about_ca_topic_score_codex":0.0014914761,"about_ca_topic_score_gemma":0.0018403752,"teacher_disagreement_score":0.009383845,"about_ca_system_score_codex":0.0015862203,"about_ca_system_score_gemma":0.0011980343,"threshold_uncertainty_score":0.049627066},"labels":[],"label_agreement":null},{"id":"W2014058093","doi":"10.1198/000313006x89947","title":"The PDF of a Function of a Random Variable","year":2006,"lang":"en","type":"article","venue":"The American Statistician","topic":"Evolutionary Algorithms and Applications","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Natural Sciences and Engineering Research Council of Canada","funders":"","keywords":"Probability density function; Random variable; Mathematics; Probability mass function; Variable (mathematics); Inverse function; Function (biology); Inverse; Analogy; Applied mathematics; Statistical physics; Statistics; Mathematical analysis; Geometry; Physics","score_opus":0.004906086841960577,"score_gpt":0.22151449896902503,"score_spread":0.21660841212706444,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2014058093","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014972276,0.0017113828,0.9538248,0.003541841,0.00065178296,0.000029837282,0.0002673948,0.0004388062,0.024561862],"genre_scores_gemma":[0.7134836,0.008185193,0.2335504,0.0025829596,0.0026833005,0.00026343597,0.0005477371,0.0007069059,0.037996616],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99876595,0.0003961222,0.000044931687,0.0003190757,0.00038747815,0.00008662023],"domain_scores_gemma":[0.99451965,0.0036646512,0.0003180836,0.00074902887,0.00061950396,0.00012917316],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024544683,0.00057918095,0.0006503828,0.0014526139,0.00053116935,0.002193376,0.0010000479,0.0018964787,0.00578406],"category_scores_gemma":[0.012593282,0.00033060092,0.00066422793,0.0010599671,0.0042888694,0.006020953,0.0008390852,0.0026498793,0.0020688265],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002776999,0.000022876302,0.00084899494,0.000118125994,0.00002706455,0.00021646201,0.00024456394,0.019955808,0.0026460218,0.94359154,0.004816551,0.02748433],"study_design_scores_gemma":[0.000020113503,0.000064301246,0.0015997873,0.000101886006,0.000031060204,0.00083056313,0.00011204619,0.12260922,0.002864768,0.83717775,0.03450692,0.00008160253],"about_ca_topic_score_codex":0.0012721544,"about_ca_topic_score_gemma":0.00038988978,"teacher_disagreement_score":0.00578406,"about_ca_system_score_codex":0.00095609215,"about_ca_system_score_gemma":0.0006993475,"threshold_uncertainty_score":0.019349635},"labels":[],"label_agreement":null},{"id":"W2021098222","doi":"10.1198/tast.2011.11018","title":"Statistics in the News","year":2011,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; HEC Montréal","funders":"","keywords":"Mathematics education; Statistics education; Course (navigation); Information literacy; Computer science; Key (lock); Literacy; Data science; Statistics; Library science; Sociology; Mathematics; Pedagogy; Engineering","score_opus":0.3374795160313217,"score_gpt":0.4504248488064071,"score_spread":0.1129453327750854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021098222","genre_codex":"editorial","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0005933422,0.033508446,0.0034689163,0.3195385,0.5078077,0.00008666796,0.0059172357,0.0016471122,0.12743218],"genre_scores_gemma":[0.008796478,0.068317816,0.0050765704,0.16853155,0.45450726,0.0002356145,0.009214495,0.0027470496,0.28257307],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9932387,0.0015318658,0.0006906122,0.00065001805,0.0034082148,0.0004805331],"domain_scores_gemma":[0.95035094,0.0242278,0.0029883916,0.004937818,0.011036501,0.0064584883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010046107,0.0009964606,0.0010663404,0.00478655,0.0015725812,0.008371134,0.0014373932,0.0035954027,0.12089101],"category_scores_gemma":[0.07571006,0.0006719979,0.00089957326,0.0061230888,0.0018281336,0.005232794,0.0021510331,0.009483563,0.08730656],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000022359416,0.00000906963,0.00014275846,0.00011170447,0.000006832881,0.00004625941,0.000035957222,0.000027054017,0.00005541714,0.003158354,0.9710045,0.02537966],"study_design_scores_gemma":[0.0000034187517,0.00000722144,0.0003248471,0.0001379409,0.0000028616219,0.00004079723,0.00002983972,0.00002192675,0.00003678426,0.0011825752,0.99820685,0.000004889044],"about_ca_topic_score_codex":0.0030053342,"about_ca_topic_score_gemma":0.0039023052,"teacher_disagreement_score":0.12089101,"about_ca_system_score_codex":0.0025497396,"about_ca_system_score_gemma":0.004019757,"threshold_uncertainty_score":0.40442067},"labels":[],"label_agreement":null},{"id":"W2025559840","doi":"10.1198/tast.2010.09147","title":"Strategies for Pulling the Goalie in Hockey","year":2010,"lang":"en","type":"article","venue":"The American Statistician","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":32,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Ice hockey; League; Markov chain; Computer science; Bayesian probability; Estimation; Econometrics; Markov chain Monte Carlo; Operations research; Simulation; Engineering; Machine learning; Artificial intelligence; Mathematics; Economics; Physical medicine and rehabilitation; Management","score_opus":0.02623175888914076,"score_gpt":0.2618707400671466,"score_spread":0.23563898117800586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2025559840","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9072314,0.000065658,0.0783058,0.00048094423,0.000040525316,0.00026496183,0.0015168876,0.00016121834,0.011932508],"genre_scores_gemma":[0.9815006,0.000066234854,0.01415145,0.000054758082,0.000005654585,0.00013935148,0.0010321307,0.000025803873,0.003023994],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9990846,0.00044237913,0.00004071291,0.00016959815,0.00014323334,0.000119458025],"domain_scores_gemma":[0.9966403,0.0021020353,0.00043407892,0.00029399118,0.0002007394,0.00032876502],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017261707,0.00048723974,0.0005099878,0.00047560013,0.00047783542,0.0011925242,0.0012682587,0.0010175825,0.006407584],"category_scores_gemma":[0.0100888,0.00029277854,0.00039820187,0.00035785945,0.000564921,0.0012588461,0.0008415555,0.00089368323,0.0007876705],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00088214467,0.0006168567,0.055648297,0.00010961671,0.00017960764,0.00017982548,0.00050740084,0.86825687,0.002801117,0.03678419,0.004353697,0.029680436],"study_design_scores_gemma":[0.00011652313,0.00047143202,0.013030138,0.000035693178,0.000029503643,0.00008164057,0.0006522962,0.9573633,0.0015136559,0.022659209,0.003996242,0.00005023048],"about_ca_topic_score_codex":0.008826665,"about_ca_topic_score_gemma":0.020881603,"teacher_disagreement_score":0.008826665,"about_ca_system_score_codex":0.0009770767,"about_ca_system_score_gemma":0.0012522312,"threshold_uncertainty_score":0.0214355},"labels":[],"label_agreement":null},{"id":"W2030031047","doi":"10.1198/tast.2009.0001","title":"Splitting a Predictor at the Upper Quarter or Third and the Lower Quarter or Third","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Decision-Making and Behavioral Economics","field":"Decision Sciences","cited_by":192,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Quarter (Canadian coin); Mathematics; Statistics; Voting; Linear regression; Econometrics; Simple (philosophy); Regression analysis; Simple linear regression; Regression; Geography; Political science; Philosophy; Politics","score_opus":0.050893470110711776,"score_gpt":0.3687126660059382,"score_spread":0.31781919589522645,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2030031047","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.79009265,0.0006841448,0.18645881,0.0016707272,0.00039448868,0.00015102586,0.0023601172,0.00066342985,0.017524643],"genre_scores_gemma":[0.9525046,0.00025400528,0.04080117,0.00021705574,0.00008409735,0.0001374875,0.0016568651,0.00012757981,0.00421702],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9973355,0.0011919495,0.00018716558,0.0004713802,0.0005425653,0.0002713832],"domain_scores_gemma":[0.98898727,0.0066559184,0.0009752076,0.0021130578,0.0010305699,0.0002379894],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0049675102,0.0006219598,0.00093753746,0.001659823,0.0006844485,0.0016386377,0.00087534386,0.00082621706,0.011837241],"category_scores_gemma":[0.026157053,0.0002520853,0.0011037261,0.0021013771,0.0015087497,0.0016726992,0.0014279737,0.0017070466,0.0034367447],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0022616347,0.0005331579,0.4766298,0.0003353589,0.00046800298,0.0003155851,0.0031536561,0.0134094665,0.011536101,0.044931777,0.011725364,0.43469998],"study_design_scores_gemma":[0.00015744194,0.0015184288,0.6845548,0.0003360312,0.00037098053,0.0010862903,0.008405773,0.121171154,0.020128822,0.124588676,0.03735251,0.0003290742],"about_ca_topic_score_codex":0.00429197,"about_ca_topic_score_gemma":0.0036117516,"teacher_disagreement_score":0.9950325,"about_ca_system_score_codex":0.0006500321,"about_ca_system_score_gemma":0.0006070802,"threshold_uncertainty_score":0.039599538},"labels":[],"label_agreement":null},{"id":"W2033411871","doi":"10.1198/0003130031450","title":"Type I Error Inflation in the Presence of a Ceiling Effect","year":2003,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":125,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences","funders":"","keywords":"Statistics; Ceiling (cloud); Econometrics; Statistical significance; Variables; Ceiling effect; Type I and type II errors; Mathematics; Standard error; Alcohol consumption; Variable (mathematics); Linear regression; Psychology; Medicine; Engineering; Biology; Alcohol","score_opus":0.09602044591037069,"score_gpt":0.43714101278193035,"score_spread":0.34112056687155967,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2033411871","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051419467,0.0036118538,0.9071278,0.009989097,0.003639398,0.002366991,0.0011422391,0.0014301947,0.019272989],"genre_scores_gemma":[0.66866106,0.0011340728,0.30980265,0.008419215,0.0015644198,0.0044522653,0.0007937006,0.00043597844,0.0047365534],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.60596365,0.2925323,0.023848902,0.033737093,0.03969298,0.0042251465],"domain_scores_gemma":[0.15382041,0.7199995,0.041441523,0.06562034,0.017668802,0.0014494449],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2854362,0.0014334503,0.0033740816,0.003136098,0.002106835,0.0043734806,0.0030612156,0.0050618662,0.006183084],"category_scores_gemma":[0.65221953,0.0013289042,0.0032142254,0.0041705654,0.006778882,0.0050981375,0.0043172413,0.007547798,0.0013987848],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004793254,0.00070543104,0.19949384,0.0029707488,0.00448009,0.0040207384,0.008454369,0.033759423,0.0025433463,0.32040527,0.04613732,0.37223613],"study_design_scores_gemma":[0.0013320805,0.0018125108,0.097762845,0.003235465,0.0031521083,0.005151125,0.0030520747,0.19548959,0.010107285,0.6492752,0.028981265,0.00064847834],"about_ca_topic_score_codex":0.0025403884,"about_ca_topic_score_gemma":0.0024567307,"teacher_disagreement_score":0.7145638,"about_ca_system_score_codex":0.0037612303,"about_ca_system_score_gemma":0.004257806,"threshold_uncertainty_score":0.88118434},"labels":[],"label_agreement":null},{"id":"W2034554153","doi":"10.1198/000313001317098158","title":"The National Hockey League Entry Draft, 1969–1995","year":2001,"lang":"en","type":"article","venue":"The American Statistician","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"League; Rank (graph theory); Championship; Statistics; Mathematics; Econometrics; Demographic economics; Operations research; Operations management; Advertising; Economics; Combinatorics; Business","score_opus":0.030208379675356126,"score_gpt":0.2569900151265436,"score_spread":0.2267816354511875,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034554153","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9120505,0.00022791726,0.0006762229,0.00020323586,0.00004177686,0.00008276546,0.076090895,0.00008197911,0.010544714],"genre_scores_gemma":[0.8000986,0.00030214037,0.00080716313,0.00004217783,0.000055940527,0.00009741743,0.17658241,0.000030826486,0.021983307],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99915636,0.00006947245,0.0000819147,0.00013377609,0.00041532368,0.0001431584],"domain_scores_gemma":[0.9941643,0.0007150289,0.0024686358,0.0002344572,0.0018105229,0.0006070811],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012649032,0.00043846903,0.0003256835,0.0032858693,0.0005104771,0.0013831444,0.0007465204,0.00026424162,0.0035959953],"category_scores_gemma":[0.0058758133,0.00022860082,0.00022689448,0.0030348052,0.00030597663,0.0006637552,0.00079325575,0.000555414,0.002584261],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003428877,0.0001514941,0.9518572,0.00005603924,0.00007157385,0.00017711318,0.0005570877,0.004175057,0.0002219553,0.00084490416,0.022880044,0.01866455],"study_design_scores_gemma":[0.000017039914,0.000097392505,0.9865753,0.000017924287,0.000018415,0.00004611917,0.0005665092,0.0028081322,0.00030762466,0.00009811247,0.009436591,0.000010860831],"about_ca_topic_score_codex":0.21828477,"about_ca_topic_score_gemma":0.34841272,"teacher_disagreement_score":0.21828477,"about_ca_system_score_codex":0.0025785705,"about_ca_system_score_gemma":0.0014611523,"threshold_uncertainty_score":0.43402845},"labels":[],"label_agreement":null},{"id":"W2040022986","doi":"10.1080/00031305.2000.10474518","title":"Late-Game Reversals in Professional Basketball, Football, and Hockey","year":2000,"lang":"en","type":"article","venue":"The American Statistician","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Okanagan University College; Okanagan College","funders":"","keywords":"Basketball; League; Football; Ice hockey; Poisson distribution; Period (music); Probabilistic logic; American football; Econometrics; Psychology; Applied psychology; Statistics; Mathematics; Geography; Physical medicine and rehabilitation","score_opus":0.015896105304651912,"score_gpt":0.23767086419442127,"score_spread":0.22177475888976936,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2040022986","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9950885,0.00012896546,0.001926685,0.0004169334,0.000015870899,0.000028266157,0.00072009617,0.00003169883,0.0016430542],"genre_scores_gemma":[0.9976599,0.000049784016,0.00016722671,0.000026328773,0.000009230253,0.00001328457,0.0007198415,0.000004534562,0.0013497274],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9987679,0.00040856126,0.000071469985,0.0002580078,0.00017400604,0.00032015113],"domain_scores_gemma":[0.98911464,0.0046082484,0.003956671,0.0006089348,0.0006911249,0.0010204389],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038345396,0.00039314808,0.000706776,0.0008687679,0.0005872633,0.002219699,0.00151253,0.0010926292,0.0063089333],"category_scores_gemma":[0.014245241,0.0003727368,0.00074983796,0.0009358271,0.00094639097,0.0010045756,0.0008664626,0.0018706457,0.0009142299],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011451753,0.00071145094,0.89627475,0.00005312439,0.0001546814,0.00046502572,0.0005106344,0.0698713,0.000650121,0.011544542,0.0043611694,0.014258102],"study_design_scores_gemma":[0.00013495504,0.00049825606,0.6975538,0.0000359224,0.00008423224,0.00025518812,0.0013009753,0.27562273,0.0008409326,0.020618735,0.0029682198,0.000086042215],"about_ca_topic_score_codex":0.03836756,"about_ca_topic_score_gemma":0.043984402,"teacher_disagreement_score":0.03836756,"about_ca_system_score_codex":0.0023327698,"about_ca_system_score_gemma":0.0008027787,"threshold_uncertainty_score":0.07628846},"labels":[],"label_agreement":null},{"id":"W2042412758","doi":"10.1198/000313008x303928","title":"Is the Overtime Period in an NHL Game Long Enough? An Example for Teaching Estimation and Hypothesis Testing in the Presence of Censored Data","year":2008,"lang":"en","type":"article","venue":"The American Statistician","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Royal Military College of Canada","funders":"","keywords":"Overtime; League; Estimation; Econometrics; Statistics; Computer science; Operations research; Psychology; Mathematics; Economics; Management; Labour economics","score_opus":0.16066606080385287,"score_gpt":0.30405033048356217,"score_spread":0.1433842696797093,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2042412758","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018984593,0.0014388278,0.9425762,0.028192779,0.0005458191,0.00015758135,0.00014143239,0.00024184292,0.007720898],"genre_scores_gemma":[0.37143698,0.002057373,0.61368483,0.006403816,0.0016700216,0.00068220234,0.00014166579,0.00020851751,0.003714569],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96814865,0.026030371,0.0009963211,0.0021148808,0.0023785557,0.00033126466],"domain_scores_gemma":[0.50107,0.48424545,0.0033556952,0.0065869116,0.0039079394,0.00083401665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.059886284,0.00091133727,0.0015757701,0.0016424373,0.0013859042,0.004175238,0.0019206319,0.0035335904,0.0035290665],"category_scores_gemma":[0.19023912,0.0006898308,0.0018262428,0.0018349322,0.008741938,0.0060075466,0.0021578192,0.0081377765,0.000541464],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006200235,0.0006948538,0.021962084,0.00064236013,0.00040451263,0.0017208782,0.0074480916,0.029901171,0.0025766834,0.6459525,0.01872401,0.26935285],"study_design_scores_gemma":[0.00017778692,0.00039468886,0.007433006,0.00033361765,0.000096090116,0.00036598087,0.0015420042,0.08762927,0.0016828715,0.8712687,0.02892875,0.00014726308],"about_ca_topic_score_codex":0.0025994736,"about_ca_topic_score_gemma":0.0016564124,"teacher_disagreement_score":0.059886284,"about_ca_system_score_codex":0.0025418655,"about_ca_system_score_gemma":0.0018885721,"threshold_uncertainty_score":0.31671274},"labels":[],"label_agreement":null},{"id":"W2056003895","doi":"10.1198/0003130032431","title":"Detecting Dependence With Kendall Plots","year":2003,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":160,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Sciences and Engineering Research Council of Canada","funders":"","keywords":"Plot (graphics); Copula (linguistics); Mathematics; Bivariate analysis; Curvature; Statistics; Scatter plot; Marginal distribution; Multivariate normal distribution; Multivariate statistics; Econometrics; Random variable; Geometry","score_opus":0.08951286293598788,"score_gpt":0.4099378926318419,"score_spread":0.320425029695854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056003895","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10119074,0.0010301115,0.8859997,0.00053511315,0.00014856688,0.00012835252,0.00075906847,0.0025903666,0.007618],"genre_scores_gemma":[0.8126207,0.00029018114,0.1839032,0.00014924245,0.00014401523,0.00024178487,0.00080635044,0.00032287167,0.0015215669],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9894224,0.0058414396,0.0006621298,0.0012905896,0.0023745203,0.00040885212],"domain_scores_gemma":[0.9335674,0.04730501,0.006705428,0.007001671,0.004689224,0.0007313219],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009477482,0.0010902882,0.0011272234,0.007496632,0.0011021212,0.0035200918,0.0013005603,0.0010761423,0.006748172],"category_scores_gemma":[0.07855667,0.0005577062,0.0011636269,0.006039542,0.0023754225,0.003544298,0.0027996728,0.0020510296,0.0012095592],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001090046,0.00027578452,0.1222366,0.00066101516,0.00092501205,0.0013421304,0.00298509,0.03236384,0.009968023,0.3557762,0.012815983,0.4595603],"study_design_scores_gemma":[0.00009342158,0.00046599866,0.0681159,0.00023920668,0.00024208178,0.001950289,0.0011801664,0.32973742,0.010727166,0.5569443,0.03005719,0.00024678133],"about_ca_topic_score_codex":0.0013412207,"about_ca_topic_score_gemma":0.0013219084,"teacher_disagreement_score":0.009477482,"about_ca_system_score_codex":0.00079760235,"about_ca_system_score_gemma":0.0009098614,"threshold_uncertainty_score":0.05012232},"labels":[],"label_agreement":null},{"id":"W2060343609","doi":"10.1198/000313007x188414","title":"Early Evidence-Based Medicine","year":2007,"lang":"en","type":"article","venue":"The American Statistician","topic":"Probability and Statistical Research","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Representativeness heuristic; Medical statistics; Statistician; Sample size determination; Population; Randomization; Sample (material); Statistics; History; Randomized controlled trial; Medicine; Demography; Mathematics; Sociology; Pathology","score_opus":0.21402363396248206,"score_gpt":0.46413807923223926,"score_spread":0.25011444526975724,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2060343609","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017453118,0.7302177,0.073993385,0.09739239,0.013348637,0.0003870362,0.0006879961,0.00016554871,0.08206196],"genre_scores_gemma":[0.121167384,0.68461704,0.089117594,0.060443845,0.024074707,0.0013656435,0.00065520743,0.00020816123,0.018350406],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9812462,0.008918079,0.0023125692,0.0015459929,0.005490322,0.0004869152],"domain_scores_gemma":[0.9415477,0.042011984,0.0016438601,0.0032865277,0.01038235,0.0011275561],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.02697557,0.0015423973,0.0028985334,0.0066735735,0.001540152,0.0070629655,0.0026281318,0.007091125,0.007133114],"category_scores_gemma":[0.07696869,0.00095898414,0.0011418076,0.0046369755,0.012000485,0.0069440617,0.004312458,0.00980777,0.0033403262],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025902275,0.00009352428,0.0005239089,0.008025631,0.0002376745,0.00038899275,0.0008882657,0.00096596597,0.00042288555,0.71329296,0.042670123,0.23223107],"study_design_scores_gemma":[0.00009599767,0.00016716556,0.00087012694,0.01166364,0.00014910781,0.0006742486,0.0002372873,0.0004400007,0.00081714126,0.36278382,0.6220306,0.000070827526],"about_ca_topic_score_codex":0.0034651682,"about_ca_topic_score_gemma":0.003179287,"teacher_disagreement_score":0.9730244,"about_ca_system_score_codex":0.01032104,"about_ca_system_score_gemma":0.008818499,"threshold_uncertainty_score":0.14266217},"labels":[],"label_agreement":null},{"id":"W2064662029","doi":"10.1198/000313001317098239","title":"A Computer-Based Lab Supplement to Courses in Introductory Statistics","year":2001,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University","funders":"","keywords":"Frequentist inference; Computer science; Curriculum; Mathematics education; Simple (philosophy); Mathematics; Psychology; Artificial intelligence; Pedagogy; Bayesian probability; Bayesian inference","score_opus":0.11081841853754852,"score_gpt":0.43043444297623246,"score_spread":0.3196160244386839,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064662029","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07982984,0.0012206585,0.62962586,0.0069250055,0.005601038,0.0052253837,0.004563755,0.04177068,0.22523777],"genre_scores_gemma":[0.23404284,0.0014211908,0.55296975,0.0046524853,0.006345696,0.00620311,0.006421192,0.0043641664,0.18357958],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99824226,0.0006307101,0.00015321282,0.0003690167,0.000434577,0.00017012503],"domain_scores_gemma":[0.9696824,0.014565486,0.0016490581,0.0064517073,0.0028606637,0.0047906665],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038163445,0.0012558193,0.0013901726,0.0015155496,0.00091493176,0.0018774736,0.0019894037,0.0013443417,0.17291835],"category_scores_gemma":[0.014700581,0.0006913959,0.00086486497,0.001738726,0.00060571305,0.0016938872,0.0034518074,0.0023612024,0.09498982],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017204769,0.003438211,0.0028260897,0.0007639184,0.000027587992,0.00050785515,0.0009337399,0.0017946613,0.037038643,0.010174161,0.17467003,0.76610464],"study_design_scores_gemma":[0.0013002862,0.009434561,0.031801235,0.0004918527,0.00007665081,0.004088441,0.0009141159,0.010220761,0.01985022,0.031267367,0.8903174,0.00023702518],"about_ca_topic_score_codex":0.00016189214,"about_ca_topic_score_gemma":0.00057211344,"teacher_disagreement_score":0.17291835,"about_ca_system_score_codex":0.0005492184,"about_ca_system_score_gemma":0.0011508391,"threshold_uncertainty_score":0.5784695},"labels":[],"label_agreement":null},{"id":"W2071800806","doi":"10.1080/00031305.2012.755361","title":"A Few Counter Examples Useful in Teaching Central Limit Theorems","year":2012,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Mathematics; Sequence (biology); Limit (mathematics); Convergence (economics); Probabilistic logic; Central limit theorem; Distribution (mathematics); Convergence of random variables; Weak convergence; Applied mathematics; Random variable; Calculus (dental); Mathematical economics; Statistics; Mathematical analysis; Computer science","score_opus":0.0851317892525428,"score_gpt":0.38904536796119393,"score_spread":0.3039135787086511,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2071800806","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0396642,0.019683389,0.5736785,0.13003054,0.009938592,0.00035179197,0.0005932172,0.0014150263,0.22464475],"genre_scores_gemma":[0.48286656,0.010548785,0.37864494,0.031000871,0.0058586844,0.0012976347,0.0004952169,0.0009073883,0.08837991],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9951383,0.0029709493,0.00018796003,0.00043893085,0.0011095349,0.00015431267],"domain_scores_gemma":[0.9697555,0.024139628,0.0012749096,0.0011032844,0.0031824736,0.0005442989],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055602244,0.001241869,0.00089885015,0.0017976202,0.0030220828,0.0030926703,0.0016794956,0.003931525,0.013094685],"category_scores_gemma":[0.05933092,0.00042205097,0.0006016114,0.0024694602,0.0042966595,0.006532237,0.0025629825,0.006247005,0.0026408439],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001097155,0.00009054728,0.0007660045,0.00018093376,0.000015867003,0.00038317047,0.0006121155,0.0031172326,0.0004141228,0.9304352,0.03705409,0.026820952],"study_design_scores_gemma":[0.00009054851,0.000059613867,0.000536355,0.00022646098,0.000014958446,0.00052338047,0.0004452295,0.022197993,0.0008474484,0.8293271,0.14566484,0.00006609008],"about_ca_topic_score_codex":0.0024697925,"about_ca_topic_score_gemma":0.0034544147,"teacher_disagreement_score":0.013094685,"about_ca_system_score_codex":0.002151589,"about_ca_system_score_gemma":0.0009717229,"threshold_uncertainty_score":0.043806136},"labels":[],"label_agreement":null},{"id":"W2085360857","doi":"10.1198/tas.2011.11077","title":"An Overview of Current Software Procedures for Fitting Linear Mixed Models","year":2011,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":67,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute of Aging","funders":"National Institute on Aging","keywords":"Current (fluid); Software; Computer science; Statistics; Econometrics; Data science; Mathematics; Engineering; Programming language","score_opus":0.3300457036600927,"score_gpt":0.4672241114054354,"score_spread":0.13717840774534268,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2085360857","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00039021779,0.0013139799,0.98141414,0.00030935399,0.00012219066,0.00032169107,0.0016679852,0.012761657,0.0016987419],"genre_scores_gemma":[0.002472406,0.002208639,0.9863643,0.00019014024,0.000111756475,0.0018481738,0.0024108284,0.0032002283,0.0011935137],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9799764,0.01250003,0.0023784756,0.0010379787,0.003822334,0.00028475438],"domain_scores_gemma":[0.9081771,0.07505353,0.0033936626,0.004916,0.007909861,0.0005499787],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026624208,0.0037190928,0.0022707658,0.008086215,0.0011675879,0.003463343,0.0054443795,0.002427743,0.049806256],"category_scores_gemma":[0.11999969,0.0028936616,0.0035186152,0.008998307,0.0010360976,0.0034291965,0.00274972,0.0039276,0.035927605],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002491427,0.00025438363,0.002298908,0.004182309,0.00049083657,0.00027868617,0.0005372406,0.017195573,0.0026396238,0.032944456,0.117797494,0.8211313],"study_design_scores_gemma":[0.0005413129,0.00039251978,0.0057588844,0.0034801217,0.000581671,0.002453953,0.00049156253,0.2317892,0.015036246,0.17343174,0.56529945,0.0007433353],"about_ca_topic_score_codex":0.0046334704,"about_ca_topic_score_gemma":0.0067127277,"teacher_disagreement_score":0.049806256,"about_ca_system_score_codex":0.0013287074,"about_ca_system_score_gemma":0.0044033895,"threshold_uncertainty_score":0.16661853},"labels":[],"label_agreement":null},{"id":"W2094806835","doi":"10.1198/tast.2009.08042","title":"Teaching Variation Reduction Using a Virtual Manufacturing Environment","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Design Education and Practice","field":"Engineering","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Login; Process (computing); Variation (astronomy); Computer science; Software; Plan (archaeology); Reduction (mathematics); Software engineering; Manufacturing engineering; Engineering; Operating system; Mathematics","score_opus":0.013882766518984511,"score_gpt":0.2648116070288507,"score_spread":0.2509288405098662,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2094806835","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.054741986,0.00023192243,0.92257315,0.00081460393,0.00012149542,0.00016235634,0.00010055452,0.0040914766,0.017162558],"genre_scores_gemma":[0.29137233,0.0004854809,0.69720143,0.00053473207,0.0001360993,0.00041568355,0.00030834335,0.0007135815,0.008832311],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965552,0.0015418585,0.00014071808,0.00041411075,0.0011639086,0.00018415446],"domain_scores_gemma":[0.98820937,0.009018731,0.00047433408,0.0012031196,0.00067582674,0.0004186231],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034891975,0.00078847253,0.00057674584,0.0012543005,0.00062795845,0.0020398807,0.0021743733,0.0007481421,0.014322684],"category_scores_gemma":[0.012123686,0.0004388899,0.00072109536,0.00090139563,0.0007004621,0.0016100568,0.0029586793,0.0013517502,0.0020861698],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002498396,0.0012528045,0.003341867,0.00032918653,0.000048742775,0.00040904584,0.0017822933,0.041884143,0.017466396,0.03173122,0.019062538,0.88244194],"study_design_scores_gemma":[0.0008063464,0.0030778896,0.012656372,0.00046266525,0.00022859688,0.004068879,0.0025286179,0.37018293,0.09950362,0.18284537,0.32329,0.00034867466],"about_ca_topic_score_codex":0.00033440703,"about_ca_topic_score_gemma":0.0006744733,"teacher_disagreement_score":0.014322684,"about_ca_system_score_codex":0.000716244,"about_ca_system_score_gemma":0.0012998565,"threshold_uncertainty_score":0.047914207},"labels":[],"label_agreement":null},{"id":"W2101508305","doi":"10.1198/000313008x269602","title":"Student's<i>z</i>,<i>t</i>, and<i>s</i>","year":2008,"lang":"he","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Statistic; Documentation; Rework; Mathematics education; Mathematics; Work (physics); Calculus (dental); Statistics; Computer science; Engineering","score_opus":0.1477300252802811,"score_gpt":0.4293276293051706,"score_spread":0.28159760402488954,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2101508305","genre_codex":"other","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016475726,0.060796384,0.11530411,0.27334678,0.1583128,0.00016730987,0.004446256,0.0023733932,0.3687773],"genre_scores_gemma":[0.3665748,0.044958986,0.068312645,0.04440307,0.049914617,0.00072655675,0.0042275977,0.00299437,0.41788736],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99541086,0.0015856839,0.0003449313,0.0010754722,0.0013462647,0.00023682398],"domain_scores_gemma":[0.983706,0.008213817,0.0019913777,0.0013327327,0.0038762493,0.00087980705],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003731206,0.0008827224,0.00090835255,0.0023258552,0.00212316,0.004695715,0.0010770346,0.0020234655,0.027502071],"category_scores_gemma":[0.03994106,0.00039677543,0.0005581835,0.0027810717,0.0045207646,0.0038987098,0.0022085917,0.0050519,0.0138743175],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001686125,0.000026796763,0.003330544,0.00023339532,0.000037482794,0.000101027756,0.0010194109,0.00030133888,0.00031060327,0.29683954,0.60364133,0.093990065],"study_design_scores_gemma":[0.000015573441,0.000054578974,0.0023308669,0.00032989233,0.000012536952,0.00032872497,0.00047504742,0.00069904403,0.00080533285,0.05889128,0.9360121,0.00004515092],"about_ca_topic_score_codex":0.0038890126,"about_ca_topic_score_gemma":0.0042000776,"teacher_disagreement_score":0.027502071,"about_ca_system_score_codex":0.0021415194,"about_ca_system_score_gemma":0.0018250125,"threshold_uncertainty_score":0.092003584},"labels":[],"label_agreement":null},{"id":"W2105139890","doi":"10.1080/00031305.2000.10474533","title":"Dawson, K. S., Gennings, C., and Carter, W. H. (1997), “Two Graphical Techniques Useful in Detecting Correlation Structure in Repeated Measures Data,” <i>The American Statistician</i> , 51, 275–283: Comment by Keselman, Algina, and Kowalchuk","year":2000,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba","funders":"","keywords":"Statistician; Correlation; Statistics; Statistical graphics; Mathematics; Computer science; Graphics; Computer graphics (images)","score_opus":0.04792635438704322,"score_gpt":0.3800085704919814,"score_spread":0.33208221610493815,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2105139890","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011682011,0.04700545,0.011982446,0.8977952,0.032933943,0.000148028,0.001019618,0.00016674485,0.0077802795],"genre_scores_gemma":[0.023726618,0.032654263,0.025388032,0.8788197,0.026052678,0.00066981034,0.00058861915,0.00027515163,0.011825201],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.962375,0.013476065,0.005570531,0.0040750294,0.013436988,0.001066443],"domain_scores_gemma":[0.6227428,0.28212437,0.016282257,0.006849575,0.06766379,0.00433722],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.050913904,0.0011856378,0.0020226105,0.0051543266,0.0068768896,0.005093437,0.00471515,0.018362803,0.008035278],"category_scores_gemma":[0.22162046,0.0016293305,0.001982099,0.0055966936,0.01136674,0.008130567,0.0031309833,0.037226386,0.006273323],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012709924,0.00001788583,0.0014986586,0.00042974774,0.000051414085,0.00016152668,0.0009622855,0.000077869634,0.00030923914,0.014213224,0.9613592,0.02079181],"study_design_scores_gemma":[0.00029696352,0.00014433343,0.013280037,0.0018241915,0.00017385627,0.0009518561,0.0014417028,0.00049206906,0.0023815369,0.041508134,0.937104,0.00040138167],"about_ca_topic_score_codex":0.051926386,"about_ca_topic_score_gemma":0.07921012,"teacher_disagreement_score":0.051926386,"about_ca_system_score_codex":0.007804855,"about_ca_system_score_gemma":0.0133444145,"threshold_uncertainty_score":0.26926166},"labels":[],"label_agreement":null},{"id":"W2129813332","doi":"10.1080/00031305.2014.904250","title":"On a Simple Construction of a Bivariate Probability Function With a Common Marginal","year":2014,"lang":"en","type":"article","venue":"The American Statistician","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Bivariate analysis; Simple (philosophy); Mathematics; Statistics; Econometrics; Function (biology); Biology","score_opus":0.009802170898168941,"score_gpt":0.2512180360990115,"score_spread":0.24141586520084257,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2129813332","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018598271,0.00014438725,0.9914984,0.0002721953,0.00004936245,0.000021599762,0.00007051255,0.000117270974,0.0059664124],"genre_scores_gemma":[0.12680586,0.0014472703,0.85995466,0.0008089847,0.00039593005,0.0003423686,0.00027460317,0.0004098726,0.009560505],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9986033,0.0005265851,0.00006320337,0.00031890575,0.00037939605,0.00010866634],"domain_scores_gemma":[0.9981881,0.0008918176,0.00015167931,0.00032492305,0.0003029919,0.00014055482],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034441657,0.0011941907,0.0009824123,0.0027157317,0.0014101907,0.0023525355,0.001457319,0.001536681,0.0075391484],"category_scores_gemma":[0.0071495757,0.00069934083,0.0017139626,0.0027321945,0.0037893401,0.0039478345,0.0029764657,0.0028374067,0.0032658004],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000104851915,0.000010536937,0.00017121407,0.000028868053,0.0000064684377,0.00009167365,0.00008989821,0.0024389976,0.00097019353,0.98390806,0.0010761045,0.011197429],"study_design_scores_gemma":[0.000011856064,0.000035833436,0.00033200503,0.00004652775,0.000018679406,0.00038624817,0.00004159753,0.042355448,0.0008681232,0.93437237,0.021493122,0.000038171307],"about_ca_topic_score_codex":0.0014668636,"about_ca_topic_score_gemma":0.0009865655,"teacher_disagreement_score":0.0075391484,"about_ca_system_score_codex":0.0010636376,"about_ca_system_score_gemma":0.001006576,"threshold_uncertainty_score":0.02522099},"labels":[],"label_agreement":null},{"id":"W2140541004","doi":"10.1198/tas.2009.0033","title":"The History of the Cluster Heat Map","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":925,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Engineers Without Borders Canada","funders":"","keywords":"Row; Row and column spaces; Column (typography); Cluster (spacecraft); Computer science; TRACE (psycholinguistics); Matrix (chemical analysis); Tile; Hierarchical clustering; Computer graphics (images); Combinatorics; Data mining; Mathematics; Cluster analysis; Geometry; Artificial intelligence; Geography; Database; Archaeology; Materials science; Connection (principal bundle)","score_opus":0.005116835551283146,"score_gpt":0.21905727621224458,"score_spread":0.21394044066096143,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2140541004","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011032944,0.029250596,0.7555727,0.049455263,0.007226348,0.00021096387,0.004732678,0.008053981,0.13446462],"genre_scores_gemma":[0.26786742,0.03359522,0.5959398,0.009827583,0.009663472,0.0012792744,0.004448611,0.012766612,0.06461191],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9929189,0.0034102302,0.00028734535,0.0010865838,0.0020669391,0.00022995389],"domain_scores_gemma":[0.96708673,0.020507816,0.00091908616,0.0038446262,0.006738057,0.0009036548],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010309058,0.0009136429,0.00085095764,0.0073220474,0.0023602569,0.009045244,0.0022710974,0.0020173197,0.017247545],"category_scores_gemma":[0.04816306,0.00092142617,0.0009907731,0.011025846,0.009839946,0.0072175227,0.0037853478,0.005085424,0.0052338145],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015364737,0.000029153323,0.0023108125,0.00048163833,0.00008274872,0.00011101466,0.0024192128,0.0055472753,0.0007329987,0.5834774,0.15201858,0.2526355],"study_design_scores_gemma":[0.000021411126,0.000029040955,0.0022170972,0.0003921385,0.000024962772,0.00017261297,0.00053864595,0.009966149,0.0014919783,0.29790124,0.68707865,0.00016607245],"about_ca_topic_score_codex":0.010524031,"about_ca_topic_score_gemma":0.006753988,"teacher_disagreement_score":0.017247545,"about_ca_system_score_codex":0.005885748,"about_ca_system_score_gemma":0.004350506,"threshold_uncertainty_score":0.057698846},"labels":[],"label_agreement":null},{"id":"W2148939588","doi":"10.1198/tast.2009.0012","title":"Where's Waldo? Visualizing Collinearity Diagnostics","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":48,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Engineers Without Borders Canada","funders":"","keywords":"Collinearity; Biplot; Salient; Computer science; Rank (graph theory); Statistics; Software; Simple (philosophy); Matrix (chemical analysis); Data mining; Mathematics; Pattern recognition (psychology); Artificial intelligence; Combinatorics; Programming language","score_opus":0.09706303419290631,"score_gpt":0.46706704157905027,"score_spread":0.370004007386144,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2148939588","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11449151,0.012703025,0.6241112,0.04668054,0.006530422,0.00032381344,0.024053102,0.095703304,0.07540312],"genre_scores_gemma":[0.60414726,0.003907922,0.34682605,0.0041958108,0.0014065764,0.00032171392,0.006182842,0.01915085,0.01386095],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.997696,0.0011859161,0.00019937147,0.00029672062,0.0004377151,0.0001843185],"domain_scores_gemma":[0.97605145,0.01783161,0.001493696,0.0016570629,0.0022860358,0.0006802168],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006432148,0.0012962779,0.0013408784,0.0050802925,0.0009234085,0.0064788763,0.0010344737,0.0014470285,0.021730902],"category_scores_gemma":[0.052508675,0.000413947,0.0008025966,0.0048763263,0.0013953721,0.0054282765,0.0020520615,0.0018874372,0.0042137485],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014747137,0.00014446785,0.043321498,0.0015759205,0.00034443397,0.001018012,0.011220871,0.0036578542,0.007463097,0.14689203,0.31649387,0.46639317],"study_design_scores_gemma":[0.0003739808,0.00020630621,0.03236594,0.0020034546,0.00031816188,0.0011302539,0.012262717,0.03200736,0.012948593,0.39651027,0.50933933,0.0005335842],"about_ca_topic_score_codex":0.0036015576,"about_ca_topic_score_gemma":0.0036554898,"teacher_disagreement_score":0.021730902,"about_ca_system_score_codex":0.00065840024,"about_ca_system_score_gemma":0.0014202225,"threshold_uncertainty_score":0.0726971},"labels":[],"label_agreement":null},{"id":"W2155808502","doi":"10.1080/00031305.2012.703888","title":"On the Boundedness and Nonmonotonicity of Generalized Score Statistics","year":2012,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Score; Statistic; Mathematics; Estimator; Bounded function; Statistics; Sufficient statistic; Context (archaeology); Variance (accounting); Applied mathematics","score_opus":0.1361649711648581,"score_gpt":0.42270008412837445,"score_spread":0.28653511296351636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2155808502","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033362478,0.0012948249,0.9587721,0.0012323086,0.000064636864,0.000035801142,0.00010262184,0.00017700816,0.004958168],"genre_scores_gemma":[0.8002065,0.0032898455,0.18896864,0.0014957944,0.00077284616,0.00042129948,0.00045028032,0.0005184919,0.0038762707],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97836167,0.013692474,0.0008587052,0.0031091804,0.003049683,0.000928286],"domain_scores_gemma":[0.6311565,0.3256634,0.015867619,0.018206894,0.0071828454,0.0019228369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.036791343,0.0014139835,0.002310906,0.0023023828,0.0010705446,0.0025912565,0.002983039,0.001828043,0.0025817144],"category_scores_gemma":[0.23445776,0.0008143473,0.0016464101,0.0022596181,0.01304438,0.0069996747,0.0046967245,0.005773348,0.00050703646],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006312973,0.000025067866,0.0030069882,0.00015829364,0.00010667136,0.0005175961,0.0005072681,0.034948956,0.0014190337,0.942162,0.00082700973,0.016258081],"study_design_scores_gemma":[0.000023421651,0.000084217456,0.001851303,0.00007325492,0.000042545995,0.00026522842,0.00006068293,0.13974033,0.00061638106,0.8557365,0.0014479585,0.000058084745],"about_ca_topic_score_codex":0.0024531714,"about_ca_topic_score_gemma":0.0016462159,"teacher_disagreement_score":0.036791343,"about_ca_system_score_codex":0.0015834211,"about_ca_system_score_gemma":0.0016097326,"threshold_uncertainty_score":0.19457352},"labels":[],"label_agreement":null},{"id":"W2158029818","doi":"10.1198/tast.2011.09217","title":"Previously Unrecognized Links Between Statistical Dependence and Some Common Modes of Convergence","year":2011,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Convergence (economics); Mathematics; Convergence of random variables; Limit (mathematics); Probability distribution; Heuristics; Sequence (biology); Simple (philosophy); Random variable; Square (algebra); Statistical physics; Statistics; Applied mathematics; Mathematical optimization; Physics; Mathematical analysis","score_opus":0.2646631902177337,"score_gpt":0.4282702303060795,"score_spread":0.1636070400883458,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158029818","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.052856013,0.0037576489,0.859231,0.011297032,0.0002442232,0.0000866973,0.00022801476,0.00031393155,0.071985394],"genre_scores_gemma":[0.82415676,0.004435339,0.16295974,0.0017133601,0.00067620195,0.00030908748,0.00021205118,0.00018534683,0.005352035],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99482083,0.0024601042,0.00039117227,0.00097058644,0.0011111544,0.00024615473],"domain_scores_gemma":[0.9023618,0.08089738,0.00490374,0.007058094,0.003982612,0.0007963849],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012543857,0.00072600134,0.0007748994,0.002914001,0.0018319356,0.0037144297,0.0020743734,0.002360048,0.007283446],"category_scores_gemma":[0.06893744,0.0005253347,0.0009514264,0.0028985154,0.014913114,0.010402456,0.004340224,0.005812471,0.0007771497],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00002074831,0.00001110506,0.0013019319,0.000091806556,0.000009699382,0.00007895493,0.00061808946,0.00071002677,0.0001549557,0.98666686,0.00082109304,0.009514828],"study_design_scores_gemma":[0.000005103273,0.000016674367,0.0008229078,0.000066710505,0.000008168894,0.00025631493,0.0001939178,0.004496137,0.00030968446,0.9902541,0.003549643,0.000020708803],"about_ca_topic_score_codex":0.00076618185,"about_ca_topic_score_gemma":0.0008528994,"teacher_disagreement_score":0.012543857,"about_ca_system_score_codex":0.0017015468,"about_ca_system_score_gemma":0.0010509138,"threshold_uncertainty_score":0.066339076},"labels":[],"label_agreement":null},{"id":"W2158803120","doi":"10.1198/000313008x298439","title":"Survival Analysis","year":2008,"lang":"en","type":"article","venue":"The American Statistician","topic":"Global Cancer Incidence and Screening","field":"Medicine","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Petro-Canada","funders":"","keywords":"Observational study; Econometrics; Mistake; Proportional hazards model; Estimator; Survival analysis; Psychology; Statistics; Mathematics","score_opus":0.10385345694741992,"score_gpt":0.377329843071578,"score_spread":0.2734763861241581,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2158803120","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.040182468,0.056557193,0.6509779,0.023798147,0.008846285,0.0051537487,0.109850064,0.00379731,0.10083689],"genre_scores_gemma":[0.45143872,0.051652003,0.26284203,0.012088152,0.007451392,0.010404552,0.11871974,0.0023805655,0.08302291],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99061894,0.004862205,0.0011173679,0.0010672616,0.0019134397,0.00042080885],"domain_scores_gemma":[0.97356963,0.015369557,0.0026857974,0.0037305732,0.004014477,0.0006299192],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015163085,0.0007413109,0.0013172219,0.0048788497,0.0006034597,0.0022200784,0.0012374846,0.00092353247,0.039509255],"category_scores_gemma":[0.05546929,0.00024169506,0.002833505,0.004902925,0.0006299588,0.0019015083,0.0014818079,0.0019652732,0.00847185],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009434992,0.00020043651,0.042699315,0.0024070246,0.0015095461,0.00029095306,0.0005702248,0.007129918,0.00036673117,0.08132363,0.16935772,0.693201],"study_design_scores_gemma":[0.00025706593,0.0012609229,0.046332195,0.003820432,0.0010934368,0.0024521833,0.00095570425,0.016546099,0.0012014731,0.12580235,0.8000779,0.00020021574],"about_ca_topic_score_codex":0.0019680695,"about_ca_topic_score_gemma":0.0019334411,"teacher_disagreement_score":0.039509255,"about_ca_system_score_codex":0.001593356,"about_ca_system_score_gemma":0.0028395944,"threshold_uncertainty_score":0.13217169},"labels":[],"label_agreement":null},{"id":"W2159445569","doi":"10.1198/0003130032369","title":"Raindrop Plots","year":2003,"lang":"en","type":"article","venue":"The American Statistician","topic":"Forest ecology and management","field":"Environmental Science","cited_by":42,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Izaak Walton Killam Health Centre","funders":"","keywords":"Mathematics; Plot (graphics); Statistics; Cutoff; Range (aeronautics); Coverage probability; Normality; Confidence interval; Dimension (graph theory); Likelihood function; Maximum likelihood; Combinatorics; Physics","score_opus":0.006542340120135166,"score_gpt":0.23156176776362986,"score_spread":0.2250194276434947,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159445569","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02011661,0.0015431035,0.7635553,0.0018793006,0.00081978657,0.0010870926,0.03313815,0.040394153,0.13746649],"genre_scores_gemma":[0.22999349,0.0015725996,0.66277665,0.0014185321,0.00053880323,0.0019028231,0.029571963,0.015129523,0.05709561],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99865097,0.00035564142,0.00011502032,0.00019379078,0.0005743436,0.00011028701],"domain_scores_gemma":[0.990612,0.006074454,0.00047053606,0.000785427,0.0017722775,0.00028533553],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017435214,0.0010362471,0.00081233215,0.004229952,0.00062954857,0.002754274,0.0011595446,0.0009589612,0.08658895],"category_scores_gemma":[0.016772455,0.00044084783,0.0006339345,0.003665495,0.00046391116,0.00268196,0.0015571624,0.0016842114,0.015228163],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009726686,0.00036885715,0.007433011,0.00080913305,0.0001541791,0.000663322,0.0011877866,0.025370555,0.005505117,0.11077154,0.38055608,0.46620783],"study_design_scores_gemma":[0.00034558907,0.00027752525,0.009954949,0.00051395525,0.00008513863,0.0010697873,0.0006107099,0.15640523,0.008823091,0.12156032,0.70017713,0.00017661671],"about_ca_topic_score_codex":0.003140754,"about_ca_topic_score_gemma":0.003991122,"teacher_disagreement_score":0.08658895,"about_ca_system_score_codex":0.00053257943,"about_ca_system_score_gemma":0.00061130186,"threshold_uncertainty_score":0.28966892},"labels":[],"label_agreement":null},{"id":"W2614013743","doi":"10.1080/00031305.2018.1459315","title":"Simple Measures of Individual Cluster-Membership Certainty for Hard Partitional Clustering","year":2018,"lang":"en","type":"article","venue":"The American Statistician","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Simple (philosophy); Cluster (spacecraft); Cluster analysis; Mathematics; Certainty; Econometrics; Statistics; Computer science; Philosophy; Epistemology","score_opus":0.07860951827381393,"score_gpt":0.33514756504687654,"score_spread":0.2565380467730626,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2614013743","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.035101328,0.000902861,0.96095824,0.00036484204,0.00006112842,0.00017289675,0.00028655466,0.00033932072,0.0018128982],"genre_scores_gemma":[0.5339091,0.00049503904,0.46298277,0.00021481779,0.00027217038,0.00043873215,0.0008159612,0.00019247513,0.00067895616],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9806625,0.006211895,0.0018478312,0.003427491,0.0073480834,0.0005022152],"domain_scores_gemma":[0.90927094,0.0568513,0.012766182,0.011824519,0.00743289,0.0018541899],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022173328,0.001613065,0.0020730915,0.007611778,0.0019282061,0.0058182296,0.0038460428,0.0034971035,0.0023292357],"category_scores_gemma":[0.14738573,0.0010346308,0.0016622618,0.004557362,0.0053234342,0.009875388,0.0063586514,0.0040115393,0.00065540796],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00087677554,0.00029155085,0.042497195,0.0013452016,0.0009446216,0.0002549846,0.00208059,0.41809922,0.005971716,0.27342707,0.0040938957,0.25011718],"study_design_scores_gemma":[0.00007753718,0.00031091692,0.0150691215,0.0003139895,0.000112743655,0.00047507294,0.00046686403,0.7488906,0.0057494435,0.22371566,0.004503555,0.00031452492],"about_ca_topic_score_codex":0.001533755,"about_ca_topic_score_gemma":0.0015529173,"teacher_disagreement_score":0.022173328,"about_ca_system_score_codex":0.0026096548,"about_ca_system_score_gemma":0.0014421104,"threshold_uncertainty_score":0.117265165},"labels":[],"label_agreement":null},{"id":"W2752232660","doi":"10.1080/00031305.2017.1395365","title":"Modeling Offensive Player Movement in Professional Basketball","year":2017,"lang":"en","type":"article","venue":"The American Statistician","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"National Science Foundation","keywords":"Offensive; Basketball; League; Computer science; Leverage (statistics); Movement (music); Ball (mathematics); Human–computer interaction; Artificial intelligence; Operations research; Mathematics; Geography","score_opus":0.04584094132041121,"score_gpt":0.28439502209581446,"score_spread":0.23855408077540324,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2752232660","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9815792,0.000112328424,0.01410436,0.00034996154,0.000020340933,0.000027172593,0.0012543068,0.00019334898,0.0023590282],"genre_scores_gemma":[0.9861194,0.00009459317,0.00958093,0.000031964206,0.00001069946,0.000024834277,0.0021586912,0.000044822253,0.0019341388],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99977833,0.000079787824,0.000008355877,0.00006193311,0.00002801989,0.00004364576],"domain_scores_gemma":[0.99951303,0.00031252432,0.000048348953,0.000027740649,0.000047258058,0.00005101527],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0008898616,0.00053187914,0.0003143981,0.00076923135,0.00032748157,0.0010225285,0.0005671803,0.0005766873,0.0014836434],"category_scores_gemma":[0.0030892584,0.00027937576,0.0005206646,0.0007026209,0.00037612478,0.0005776767,0.00070757756,0.00068398914,0.00027437016],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034083307,0.00026910068,0.13177967,0.00005560795,0.000091879396,0.00021140717,0.00054972613,0.8211141,0.0016517455,0.0054325764,0.0032876697,0.03521557],"study_design_scores_gemma":[0.000010345782,0.000038377377,0.022181714,0.000011862268,0.0000066393914,0.000017912618,0.00031646728,0.9744846,0.00032905134,0.0019042323,0.0006903763,0.0000083792775],"about_ca_topic_score_codex":0.15260588,"about_ca_topic_score_gemma":0.16375901,"teacher_disagreement_score":0.15260588,"about_ca_system_score_codex":0.0011419904,"about_ca_system_score_gemma":0.00053171767,"threshold_uncertainty_score":0.30343527},"labels":[],"label_agreement":null},{"id":"W2753035968","doi":"10.1080/00031305.2017.1375984","title":"On An Intriguing Distributional Identity","year":2017,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Identity (music); Random variable; Mathematics; Distribution (mathematics); Continuous variable; Function (biology); Variance (accounting); Probability density function; Combinatorics; Variable (mathematics); Statistics; Discrete mathematics; Mathematical analysis; Physics; Economics","score_opus":0.10563840955061554,"score_gpt":0.46597122159010573,"score_spread":0.3603328120394902,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2753035968","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06566245,0.0021384805,0.81853503,0.035234854,0.001057081,0.000059907507,0.0005182282,0.00027889234,0.076515116],"genre_scores_gemma":[0.8069638,0.002911769,0.13837405,0.009514882,0.003040746,0.00034471432,0.0006360203,0.00048737472,0.037726723],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9966324,0.0012384856,0.00014793039,0.0007443293,0.0010228088,0.00021402937],"domain_scores_gemma":[0.98619264,0.009096428,0.00080383866,0.0016514568,0.0017176792,0.00053796364],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006880851,0.00047125522,0.0009602541,0.0014138981,0.0014930491,0.002613284,0.0017945427,0.001927262,0.0056897905],"category_scores_gemma":[0.03398843,0.00036324607,0.0010201106,0.0010934991,0.005793129,0.007623313,0.0054385476,0.004983135,0.0011817523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000007957386,0.000010186351,0.00034431173,0.00001799958,0.00000417772,0.000040884286,0.00010847633,0.00065444026,0.00014292312,0.99131304,0.001514183,0.0058414163],"study_design_scores_gemma":[0.0000070587207,0.00001466253,0.00030551365,0.000017638682,0.0000025094705,0.000094913434,0.000047455425,0.0069213915,0.000095272924,0.9880136,0.004473054,0.0000069538064],"about_ca_topic_score_codex":0.0014040371,"about_ca_topic_score_gemma":0.0007725135,"teacher_disagreement_score":0.006880851,"about_ca_system_score_codex":0.0014719807,"about_ca_system_score_gemma":0.0012963581,"threshold_uncertainty_score":0.036389828},"labels":[],"label_agreement":null},{"id":"W2766225997","doi":"10.1080/00031305.2017.1377111","title":"Bayesian Analysis on a Noncentral Fisher–Student’s Hypersphere","year":2017,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Hypersphere; Mathematics; False discovery rate; Statistical hypothesis testing; Bayes factor; Null distribution; Null hypothesis; Bayesian probability; p-value; Bayes' theorem; Multiple comparisons problem; Weibull distribution; Statistics; Applied mathematics; Test statistic; Geometry","score_opus":0.3520839162328059,"score_gpt":0.5716076458469133,"score_spread":0.21952372961410738,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2766225997","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004948514,0.00017322281,0.9923872,0.00046068555,0.00003018587,0.00003070064,0.000053613945,0.00007728187,0.0018386364],"genre_scores_gemma":[0.38768217,0.0008903439,0.6036628,0.00078038784,0.00024968476,0.00046075936,0.0002458901,0.00018342018,0.005844545],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9928479,0.0043036495,0.00026354415,0.0009905128,0.001336619,0.00025775458],"domain_scores_gemma":[0.9702501,0.02398496,0.0012448921,0.0021435933,0.0019863897,0.00039009223],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016999774,0.0007283221,0.0014068928,0.0021070985,0.00093949976,0.0023355791,0.0018002182,0.0015551917,0.0038898122],"category_scores_gemma":[0.04562999,0.00056476216,0.0012944575,0.0011921388,0.0051711593,0.003933641,0.0026150842,0.0030896477,0.0007856105],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000521699,0.000021776914,0.0009209203,0.000089726556,0.000054507404,0.00014511624,0.00018464887,0.031508192,0.0010702399,0.9345512,0.0014760004,0.029925633],"study_design_scores_gemma":[0.000015450323,0.00004095461,0.0010000468,0.000045203455,0.000015429929,0.00010700765,0.0000535993,0.19386424,0.0009433283,0.7996425,0.0042357096,0.00003640203],"about_ca_topic_score_codex":0.0022435694,"about_ca_topic_score_gemma":0.0014392999,"teacher_disagreement_score":0.016999774,"about_ca_system_score_codex":0.0018049508,"about_ca_system_score_gemma":0.0018788053,"threshold_uncertainty_score":0.08990443},"labels":[],"label_agreement":null},{"id":"W2790711374","doi":"10.1080/00031305.2018.1555101","title":"The World of Research Has Gone Berserk: Modeling the Consequences of Requiring “Greater Statistical Stringency” for Scientific Publication","year":2019,"lang":"en","type":"preprint","venue":"The American Statistician","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Reliability (semiconductor); Publication; Incentive; Odds; Statistical power; Sample size determination; Sample (material); Econometrics; Statistical model; Affect (linguistics); Management science; Actuarial science; Computer science; Power (physics); Operations research; Psychology; Statistics; Economics; Political science; Mathematics; Law; Microeconomics; Logistic regression","score_opus":0.8567728382291895,"score_gpt":0.5943493876722813,"score_spread":0.2624234505569082,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2790711374","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"evaluation","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"evaluation","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10041434,0.004727623,0.8040169,0.07148692,0.00062987744,0.0010797206,0.0008794997,0.00027970682,0.016485482],"genre_scores_gemma":[0.73977196,0.0030645984,0.24509524,0.004949014,0.00075556414,0.0022494895,0.00028004375,0.00014221515,0.0036918374],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8010915,0.16813308,0.00623262,0.011207622,0.011111588,0.002223509],"domain_scores_gemma":[0.27518937,0.6452707,0.04218309,0.027351037,0.007967063,0.0020388165],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23646033,0.0014003295,0.0034932885,0.0054163346,0.0021749744,0.01109216,0.003996594,0.00773144,0.0043923114],"category_scores_gemma":[0.5678842,0.0017680951,0.0031768796,0.00800708,0.012272316,0.014616425,0.0053217,0.006473526,0.0007772485],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009375409,0.00017873335,0.01736032,0.0010616428,0.0009634662,0.0002309979,0.0022286032,0.11677461,0.00047571227,0.7777686,0.0035807265,0.07843906],"study_design_scores_gemma":[0.00021878984,0.00028304008,0.0027983566,0.0003246073,0.00023985127,0.000105021565,0.00018865359,0.10141206,0.00026220846,0.88966256,0.0044361786,0.000068644265],"about_ca_topic_score_codex":0.003053707,"about_ca_topic_score_gemma":0.0020574138,"teacher_disagreement_score":0.7635397,"about_ca_system_score_codex":0.0057477257,"about_ca_system_score_gemma":0.0058932723,"threshold_uncertainty_score":0.94158036},"labels":[],"label_agreement":null},{"id":"W2801323879","doi":"10.1080/00031305.2018.1438699","title":"Introduction: Special Issue on Data Science","year":2018,"lang":"en","type":"article","venue":"The American Statistician","topic":"Big Data and Business Intelligence","field":"Business, Management and Accounting","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Data science; Computer science","score_opus":0.07468234379272098,"score_gpt":0.34399219176750007,"score_spread":0.2693098479747791,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2801323879","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00012659373,0.028405637,0.0014390893,0.06531304,0.8892902,0.000059867863,0.0011192904,0.00022204907,0.01402426],"genre_scores_gemma":[0.0008522366,0.014431903,0.00065585756,0.029203514,0.9107745,0.00007272615,0.0013782606,0.00036800996,0.042262927],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99465394,0.0008354042,0.00070714275,0.0009340981,0.0025053022,0.00036413505],"domain_scores_gemma":[0.9678602,0.010313321,0.0024465478,0.0027093678,0.012095321,0.004575271],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007103895,0.0027456328,0.0034932054,0.011655697,0.0023267372,0.009934069,0.0027313395,0.006757431,0.070852764],"category_scores_gemma":[0.025103541,0.0009854796,0.0018941982,0.0075557465,0.0022693812,0.008924069,0.0041761496,0.009043531,0.051690325],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000008682651,0.000010903829,0.00008881857,0.00011029273,0.0000071272943,0.00001756138,0.0000062864688,0.000023646142,0.00004495876,0.0006938687,0.9900108,0.008977021],"study_design_scores_gemma":[0.0000071741315,0.000014457868,0.00058770954,0.00020658798,0.000008513595,0.00006884793,0.000017017248,0.0000792242,0.000033421806,0.002987234,0.99597895,0.000010827275],"about_ca_topic_score_codex":0.0021495936,"about_ca_topic_score_gemma":0.0047939974,"teacher_disagreement_score":0.070852764,"about_ca_system_score_codex":0.003062572,"about_ca_system_score_gemma":0.004478295,"threshold_uncertainty_score":0.2370261},"labels":[],"label_agreement":null},{"id":"W2803189886","doi":"10.1080/00031305.2018.1497537","title":"Visualizing Tests for Equality of Covariance Matrices","year":2018,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Multivariate analysis of variance; Covariance; Variety (cybernetics); Analysis of covariance; Multivariate statistics; Statistics; Covariance matrix; Test (biology); Econometrics; Plot (graphics); Computer science; Mathematics; Statistical hypothesis testing; Estimation of covariance matrices","score_opus":0.23362593522876668,"score_gpt":0.5405334951375262,"score_spread":0.30690755990875956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2803189886","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04835344,0.002194782,0.8976292,0.0023572803,0.00079527084,0.00025954813,0.0069209537,0.021893833,0.019595683],"genre_scores_gemma":[0.45123595,0.0014865656,0.52740943,0.00058369344,0.00044992418,0.00096310343,0.007190262,0.0066084485,0.0040727314],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9936824,0.0036604505,0.0003930745,0.00075324165,0.0013307715,0.00018014635],"domain_scores_gemma":[0.9293133,0.060242794,0.0028559624,0.00341856,0.0035767003,0.0005927109],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00990089,0.0015215215,0.0011942516,0.005820106,0.000854965,0.0035037415,0.0010779426,0.0011372513,0.025991999],"category_scores_gemma":[0.10125531,0.00046063555,0.0012562847,0.003910408,0.001333452,0.003743679,0.002626731,0.0022200972,0.0034028324],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00093867717,0.00025252483,0.02370568,0.0023236892,0.00075206294,0.000804505,0.0073451325,0.0266255,0.01212758,0.28755587,0.09327288,0.54429597],"study_design_scores_gemma":[0.00032741248,0.0005705722,0.030112846,0.0011473682,0.00029010014,0.0012112495,0.0030819701,0.11558652,0.016632034,0.6922554,0.13846053,0.00032401984],"about_ca_topic_score_codex":0.0011795672,"about_ca_topic_score_gemma":0.0009974118,"teacher_disagreement_score":0.025991999,"about_ca_system_score_codex":0.0005663667,"about_ca_system_score_gemma":0.0011541425,"threshold_uncertainty_score":0.08695191},"labels":[],"label_agreement":null},{"id":"W2803912231","doi":"10.1080/00031305.2018.1475304","title":"Two-Tailed <i>p</i> -Values and Coherent Measures of Evidence","year":2018,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Null hypothesis; p-value; Null (SQL); Statistical hypothesis testing; Interpretation (philosophy); Alternative hypothesis; Econometrics; Mathematics; Value (mathematics); Statistics; Set (abstract data type); Measure (data warehouse); Statistical evidence; Statistical significance; Mathematical economics; Computer science; Data mining; Linguistics; Philosophy","score_opus":0.3190207158526712,"score_gpt":0.4897757391841812,"score_spread":0.17075502333151,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2803912231","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010311665,0.016432976,0.92264265,0.025543824,0.0049028983,0.0011420805,0.002565154,0.00088440184,0.015574323],"genre_scores_gemma":[0.2609469,0.006381085,0.6985741,0.014326009,0.006170082,0.009219023,0.0016198484,0.0005764203,0.0021865338],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.66558385,0.23100717,0.03745366,0.025078163,0.03891453,0.0019625912],"domain_scores_gemma":[0.17338635,0.7268989,0.039219346,0.04209789,0.015640965,0.00275656],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.25835648,0.0022022978,0.0057911496,0.015262747,0.0025495563,0.01248225,0.007863407,0.012535124,0.0076989215],"category_scores_gemma":[0.674191,0.0016935944,0.0040775416,0.018251732,0.035414804,0.01589793,0.008314194,0.01518216,0.0025098906],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013283193,0.00019874689,0.011683627,0.00918882,0.0035244757,0.0018929389,0.0030731175,0.0052843574,0.001725899,0.7947015,0.031150037,0.13624819],"study_design_scores_gemma":[0.00017865827,0.00044382733,0.0023845173,0.0018052228,0.00044979536,0.0009923122,0.00062720216,0.004410388,0.0012153264,0.9621766,0.025144974,0.00017124617],"about_ca_topic_score_codex":0.00039637223,"about_ca_topic_score_gemma":0.00039941084,"teacher_disagreement_score":0.74164355,"about_ca_system_score_codex":0.0026216828,"about_ca_system_score_gemma":0.0048750197,"threshold_uncertainty_score":0.9145785},"labels":[],"label_agreement":null},{"id":"W2891886352","doi":"10.1080/00031305.2020.1717621","title":"Reconnecting <i>p</i> -Value and Posterior Probability Under One- and Two-Sided Tests","year":2020,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"","keywords":"Statistics; Mathematics; Posterior probability; Value (mathematics); p-value; Statistical hypothesis testing; Bayesian probability","score_opus":0.525964131273974,"score_gpt":0.5256489015127478,"score_spread":0.00031522976122622115,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891886352","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0054120356,0.0062061897,0.95341676,0.0149313,0.0029761582,0.00021464111,0.00029565525,0.00026917557,0.016278138],"genre_scores_gemma":[0.3324594,0.006219502,0.6262379,0.016755609,0.01013705,0.0026128143,0.00044644362,0.0008510643,0.004280234],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7815369,0.15299754,0.012805527,0.022218743,0.028166028,0.0022753018],"domain_scores_gemma":[0.39273527,0.54296386,0.017831735,0.031712983,0.012722984,0.0020331445],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17117052,0.0021477195,0.0046010953,0.0061371876,0.002174029,0.010870221,0.0073692882,0.009042159,0.006490612],"category_scores_gemma":[0.54528916,0.001382669,0.0028521395,0.0071148667,0.04069502,0.020224484,0.010736591,0.024944881,0.0023125645],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016661215,0.000038785078,0.0017336905,0.0005552298,0.00017979351,0.00048195836,0.0008576209,0.0034447366,0.00027408937,0.92983997,0.0043545966,0.05807291],"study_design_scores_gemma":[0.000043433865,0.00009837177,0.000504093,0.00028809963,0.000058524125,0.00047796097,0.00012837244,0.010042981,0.0004850863,0.97790545,0.009912009,0.00005554979],"about_ca_topic_score_codex":0.0011341986,"about_ca_topic_score_gemma":0.00061514846,"teacher_disagreement_score":0.17117052,"about_ca_system_score_codex":0.0042361245,"about_ca_system_score_gemma":0.004596636,"threshold_uncertainty_score":0.90524703},"labels":[],"label_agreement":null},{"id":"W2922738421","doi":"10.1080/00031305.2018.1564697","title":"A Proposed Hybrid Effect Size Plus <i>p</i> -Value Criterion: Empirical Evidence Supporting its Use","year":2019,"lang":"en","type":"article","venue":"The American Statistician","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":53,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ontario Tech University","funders":"","keywords":"Value (mathematics); Mathematics; Statistics","score_opus":0.614450181809646,"score_gpt":0.5502659135980562,"score_spread":0.06418426821158973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2922738421","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.054909,0.013056532,0.8934003,0.007791907,0.0015176602,0.004621054,0.0013079051,0.0013739321,0.022021739],"genre_scores_gemma":[0.30357546,0.0007014917,0.6887473,0.0019215174,0.0003233326,0.0034562978,0.00023863993,0.0002402025,0.00079573883],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7306148,0.19017813,0.013643328,0.019757936,0.044418976,0.0013867486],"domain_scores_gemma":[0.20735754,0.7350779,0.013901205,0.017442552,0.023632545,0.002588144],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.1985867,0.0019768877,0.0047349352,0.0073917825,0.0025703497,0.0060613295,0.009537492,0.008887697,0.007028389],"category_scores_gemma":[0.5228501,0.0010886494,0.005224446,0.008370149,0.011790921,0.0071395603,0.005793959,0.0059098112,0.0014931124],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.01131875,0.0011938148,0.11088071,0.015328057,0.0109255705,0.0012327554,0.0042828913,0.023524407,0.0051686023,0.18963394,0.017976183,0.6085342],"study_design_scores_gemma":[0.006878964,0.021143124,0.0817375,0.0068323314,0.009493228,0.0049627004,0.0028900749,0.42665607,0.015159101,0.35163972,0.07048343,0.0021237487],"about_ca_topic_score_codex":0.0017131036,"about_ca_topic_score_gemma":0.0016834041,"teacher_disagreement_score":0.8014133,"about_ca_system_score_codex":0.002603906,"about_ca_system_score_gemma":0.0054662693,"threshold_uncertainty_score":0.98828524},"labels":[],"label_agreement":null},{"id":"W2924029102","doi":"10.1080/00031305.2018.1556735","title":"The <i>p</i> -value Function and Statistical Inference","year":2019,"lang":"en","type":"article","venue":"The American Statistician","topic":"Data Analysis with R","field":"Computer Science","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada; York University","keywords":"Inference; Function (biology); Statistical inference; Scalar (mathematics); Value (mathematics); Mathematics; Power function; Statistics; Computer science; Artificial intelligence; Mathematical analysis","score_opus":0.006202599462732283,"score_gpt":0.25972193317835646,"score_spread":0.2535193337156242,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2924029102","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00079734344,0.004654926,0.9780496,0.0073225065,0.0007413798,0.00008503569,0.00022117684,0.0004548545,0.00767331],"genre_scores_gemma":[0.055332366,0.007545006,0.9216154,0.005638658,0.0035880017,0.0014237419,0.00041803365,0.0009243779,0.0035144617],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9112544,0.07149482,0.0041010175,0.0050093974,0.007438313,0.0007020053],"domain_scores_gemma":[0.6925891,0.27549943,0.0070070387,0.018026302,0.006028975,0.0008491282],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.078615434,0.0029056752,0.0034585705,0.0077570635,0.0018400047,0.0096771,0.0047307913,0.007528342,0.005974737],"category_scores_gemma":[0.25659007,0.0016772306,0.0028371504,0.010664885,0.029320303,0.014172753,0.005860439,0.017300826,0.0042011025],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004703457,0.000031575833,0.0010696788,0.0005005417,0.00012478567,0.00035815235,0.00040742857,0.007111423,0.00025818465,0.92176753,0.012922518,0.055401266],"study_design_scores_gemma":[0.000019945546,0.000043609474,0.0004041245,0.00033018077,0.000032596174,0.00051096815,0.00009542533,0.018253189,0.00050132006,0.95437545,0.025372138,0.00006113497],"about_ca_topic_score_codex":0.0025111183,"about_ca_topic_score_gemma":0.000838501,"teacher_disagreement_score":0.078615434,"about_ca_system_score_codex":0.004082754,"about_ca_system_score_gemma":0.0044765687,"threshold_uncertainty_score":0.41576314},"labels":[],"label_agreement":null},{"id":"W2940269847","doi":"10.1080/00031305.2019.1604432","title":"On a Proper Bayes, but Inadmissible Estimator","year":2019,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"","keywords":"Bayes' theorem; Mathematics; Statistics; Estimator; Mean squared error; Bayes estimator; Binomial (polynomial); Point estimation; Efficient estimator; Negative binomial distribution; Minimum-variance unbiased estimator; Applied mathematics; Bayesian probability; Poisson distribution","score_opus":0.06933036670836826,"score_gpt":0.41908410835140575,"score_spread":0.3497537416430375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2940269847","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076697967,0.00062649185,0.9845999,0.0019943004,0.00016902131,0.00003695941,0.000085139,0.00016584955,0.0046525258],"genre_scores_gemma":[0.22681087,0.0010270515,0.7638138,0.0017778254,0.0006462289,0.00034426383,0.00022325024,0.00026686577,0.005089887],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9789058,0.011812536,0.0014768662,0.0023698611,0.0048714285,0.00056343566],"domain_scores_gemma":[0.9318555,0.050032694,0.0043107974,0.00823455,0.0049891896,0.0005772429],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03673243,0.00094387506,0.0017657006,0.0018738661,0.0014863082,0.0034729755,0.0019459854,0.0036463474,0.0035349405],"category_scores_gemma":[0.1509382,0.0010747106,0.00077128806,0.0016252788,0.005829074,0.0071440265,0.0032993774,0.0048484183,0.0012235083],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00005876864,0.000015892057,0.0017999059,0.0001034372,0.000026109534,0.00033501064,0.00032374504,0.004759228,0.00051067997,0.9601541,0.0029345609,0.028978612],"study_design_scores_gemma":[0.000021173471,0.000023606255,0.0002683764,0.00010524876,0.000014159372,0.00047666737,0.000042205855,0.034672778,0.0005509957,0.9581667,0.005634323,0.000023733908],"about_ca_topic_score_codex":0.0013710492,"about_ca_topic_score_gemma":0.000762011,"teacher_disagreement_score":0.03673243,"about_ca_system_score_codex":0.0012293848,"about_ca_system_score_gemma":0.00217407,"threshold_uncertainty_score":0.19426203},"labels":[],"label_agreement":null},{"id":"W2994409524","doi":"10.1080/00031305.2020.1816214","title":"Null Hypothesis Significance Testing Interpreted and Calibrated by Estimating Probabilities of Sign Errors: A Bayes-Frequentist Continuum","year":2020,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"","keywords":"Bayes factor; Frequentist inference; Posterior probability; Bayesian probability; Statistics; Bayes' theorem; Mathematics; p-value; Statistical hypothesis testing; Sign (mathematics); Null hypothesis; Prior probability; Alternative hypothesis; Statistical power; Econometrics; Bayesian inference; Mathematical analysis","score_opus":0.36817545539381347,"score_gpt":0.4518311482418546,"score_spread":0.08365569284804114,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2994409524","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004159541,0.0021520616,0.97941923,0.007249976,0.00052592903,0.00017448147,0.00012600744,0.00024361457,0.005949276],"genre_scores_gemma":[0.24935415,0.0031924876,0.73549134,0.005299341,0.0027517106,0.0016790098,0.0002148378,0.00027535728,0.0017417977],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8348597,0.12589496,0.006035497,0.014839811,0.017239023,0.0011310703],"domain_scores_gemma":[0.54958504,0.40512696,0.0142461015,0.019388545,0.010101892,0.0015514165],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.14658393,0.001987952,0.004167129,0.008238299,0.002247982,0.012001859,0.00491396,0.0058884528,0.0039425744],"category_scores_gemma":[0.43838832,0.0015811183,0.0020103995,0.004543633,0.01949101,0.012579689,0.006221428,0.013855658,0.0011717883],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017371718,0.00005476773,0.004012246,0.00068423996,0.000426117,0.00032512585,0.0013534637,0.010062339,0.00047373184,0.86400294,0.0062012468,0.11222999],"study_design_scores_gemma":[0.000049237136,0.000037704503,0.00067890284,0.0003955391,0.00005005302,0.00016688318,0.00013022161,0.02112455,0.00036951614,0.97195554,0.0049879216,0.000054113974],"about_ca_topic_score_codex":0.0016511487,"about_ca_topic_score_gemma":0.00084907934,"teacher_disagreement_score":0.8534161,"about_ca_system_score_codex":0.0040971637,"about_ca_system_score_gemma":0.004308205,"threshold_uncertainty_score":0.7752192},"labels":[],"label_agreement":null},{"id":"W3114650575","doi":"10.1080/00031305.2020.1865199","title":"Hurdle Blockmodels for Sparse Network Modeling","year":2020,"lang":"en","type":"article","venue":"The American Statistician","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Model selection; Variety (cybernetics); Selection (genetic algorithm); Random graph; Goodness of fit; Exponential random graph models; Graph; Data mining; Theoretical computer science; Machine learning; Artificial intelligence","score_opus":0.04329076685591112,"score_gpt":0.3001625163344384,"score_spread":0.2568717494785273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3114650575","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008627901,0.00036339246,0.98749393,0.0005224648,0.00005380484,0.000068547706,0.0005800182,0.00023005198,0.0020598604],"genre_scores_gemma":[0.56091654,0.0032419206,0.40761444,0.00084394583,0.0005541006,0.0017725623,0.0035867458,0.00048998126,0.020979762],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99758923,0.0014508157,0.00009029293,0.00037770314,0.00030939977,0.00018261325],"domain_scores_gemma":[0.9895152,0.007477134,0.0011534126,0.00088431255,0.0006811294,0.0002889194],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0051065823,0.0011947891,0.0019456928,0.0022131556,0.00092435605,0.0017535549,0.0033311506,0.0019479295,0.00716937],"category_scores_gemma":[0.019424878,0.0009387629,0.0018273104,0.0024771765,0.0017091745,0.0037592868,0.0020576995,0.0031941996,0.0016241557],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000037507194,0.000030163843,0.0013660407,0.00007951807,0.00007330523,0.000095038056,0.00018209853,0.43391454,0.0003753566,0.5513428,0.0033783175,0.00912533],"study_design_scores_gemma":[0.000010551907,0.00000999756,0.0001559409,0.000011597472,0.000009899656,0.000019352903,0.000015285685,0.805674,0.00005120281,0.19237961,0.0016525483,0.000010034459],"about_ca_topic_score_codex":0.010670265,"about_ca_topic_score_gemma":0.011468554,"teacher_disagreement_score":0.010670265,"about_ca_system_score_codex":0.0015805614,"about_ca_system_score_gemma":0.0012548496,"threshold_uncertainty_score":0.027006507},"labels":[],"label_agreement":null},{"id":"W3209485542","doi":"10.1080/00031305.2021.2000495","title":"Comparative Probability Metrics: Using Posterior Probabilities to Account for Practical Equivalence in A/B tests","year":2021,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Mathematics; Statistics; Equivalence (formal languages); Posterior probability; Bayesian probability; Discrete mathematics","score_opus":0.2844714646661516,"score_gpt":0.5027176178365009,"score_spread":0.21824615317034934,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3209485542","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0044636815,0.00069260236,0.9901799,0.0006672005,0.00014442549,0.00023580018,0.00016913287,0.00020150485,0.0032456652],"genre_scores_gemma":[0.19533046,0.00076746725,0.7988912,0.00080197223,0.0005011876,0.002010027,0.00040149337,0.0003474957,0.00094878173],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.852631,0.106941275,0.007131678,0.01111703,0.02101407,0.0011649998],"domain_scores_gemma":[0.4380431,0.4938458,0.023756046,0.027471272,0.014866778,0.002016984],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12328608,0.0030094706,0.0028884164,0.011318844,0.0022449968,0.007562865,0.0047956407,0.0053503183,0.006259874],"category_scores_gemma":[0.5218622,0.0013253714,0.0024824217,0.008108482,0.012492264,0.016456077,0.007323822,0.008775358,0.0009365876],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030942785,0.00014422348,0.013400739,0.00069305685,0.00055951125,0.00036219796,0.0016618869,0.053887855,0.0013608985,0.7331965,0.0051025203,0.1893212],"study_design_scores_gemma":[0.00008235128,0.00035682667,0.0045793033,0.00037828335,0.0001522109,0.00044228803,0.00027595682,0.11707869,0.0014418222,0.8645194,0.010557282,0.00013563984],"about_ca_topic_score_codex":0.0026145084,"about_ca_topic_score_gemma":0.0017344177,"teacher_disagreement_score":0.12328608,"about_ca_system_score_codex":0.003477973,"about_ca_system_score_gemma":0.004043447,"threshold_uncertainty_score":0.6520069},"labels":[],"label_agreement":null},{"id":"W4224213250","doi":"10.1080/00031305.2022.2066725","title":"Bias Analysis for Misclassification Errors in both the Response Variable and Covariate","year":2022,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Statistics; Variable (mathematics); Econometrics; Inference; Computer science; Observational error; Variables; Mathematics; Artificial intelligence","score_opus":0.13364623097300488,"score_gpt":0.3955855856048989,"score_spread":0.26193935463189405,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224213250","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017850816,0.0020317524,0.9746285,0.0021296216,0.0002783117,0.00024615653,0.00022465983,0.00021665491,0.0023935463],"genre_scores_gemma":[0.63250256,0.0022810614,0.35543957,0.0026721745,0.00074579724,0.0013026958,0.00063786795,0.0003750998,0.0040432583],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.935142,0.04962135,0.0024900956,0.0050932853,0.006591773,0.0010614832],"domain_scores_gemma":[0.7026946,0.25409746,0.011618146,0.022366427,0.008524376,0.0006990033],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11961042,0.0010728928,0.0020294297,0.0034920124,0.0011563534,0.0024036325,0.0026757952,0.0034982187,0.0058316914],"category_scores_gemma":[0.33863488,0.00049486494,0.0047111954,0.0030002196,0.003321596,0.003450961,0.0029947434,0.0037651488,0.0007216811],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012456774,0.00020909522,0.066504136,0.0016148713,0.0041864254,0.00060386595,0.0013222699,0.053113826,0.0037428658,0.5889057,0.009756658,0.2687947],"study_design_scores_gemma":[0.00030704527,0.00049055705,0.02992079,0.0012003763,0.0024240452,0.0012449091,0.00034115862,0.29622525,0.01018329,0.6390311,0.018415056,0.00021635124],"about_ca_topic_score_codex":0.0035055317,"about_ca_topic_score_gemma":0.0017510325,"teacher_disagreement_score":0.8803896,"about_ca_system_score_codex":0.0026100609,"about_ca_system_score_gemma":0.0033740606,"threshold_uncertainty_score":0.63256794},"labels":[],"label_agreement":null},{"id":"W4251610920","doi":"10.1198/tas.2009.0021","title":"Comment","year":2009,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Mathematics","score_opus":0.18364449225361962,"score_gpt":0.4710982106444673,"score_spread":0.28745371839084766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4251610920","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0004798467,0.0003193185,0.0001035626,0.970889,0.017185716,0.000019066589,0.00020063539,0.00004104272,0.010761775],"genre_scores_gemma":[0.0014124867,0.00008036816,0.000053405784,0.98448306,0.0049750004,0.000032910193,0.000032215627,0.000023129081,0.008907435],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9794574,0.0027782428,0.0014397809,0.0049460786,0.0070639485,0.0043144915],"domain_scores_gemma":[0.9172126,0.047298916,0.0047592977,0.004561307,0.019649215,0.0065187584],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.018651998,0.0009752004,0.001903204,0.0018855517,0.010127328,0.0125187095,0.0077582304,0.10919866,0.059827648],"category_scores_gemma":[0.1509973,0.0013674619,0.0030645558,0.0028238252,0.010349176,0.009801955,0.0075148474,0.07241315,0.04544338],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003849873,0.000011176407,0.0004369358,0.000042931235,0.000013905085,0.00014033973,0.00035822598,0.000026703836,0.000075167176,0.011065958,0.9863979,0.0013923086],"study_design_scores_gemma":[0.00010914738,0.00002496747,0.0025115847,0.00047790539,0.000053265,0.00022200674,0.0018703332,0.00013650257,0.00038942852,0.01642305,0.9776719,0.000109827015],"about_ca_topic_score_codex":0.03998161,"about_ca_topic_score_gemma":0.04325041,"teacher_disagreement_score":0.9401724,"about_ca_system_score_codex":0.009130545,"about_ca_system_score_gemma":0.015786435,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4318485822","doi":"10.1080/00031305.2022.2160590","title":"Object Oriented Data Analysis","year":2023,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Database Systems and Queries","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science","score_opus":0.03783203117561788,"score_gpt":0.3352063899743726,"score_spread":0.2973743587987547,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4318485822","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00068239495,0.0047964845,0.94099015,0.0023199448,0.0012354716,0.00038555777,0.0024930947,0.019312121,0.027784832],"genre_scores_gemma":[0.011988778,0.006213785,0.9227381,0.0022128588,0.0009840905,0.0006874302,0.008594262,0.0058083073,0.040772516],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99233025,0.0017588397,0.00074005616,0.0010344991,0.0039049636,0.00023144296],"domain_scores_gemma":[0.98907334,0.0044806455,0.00047880024,0.0037464553,0.0018669222,0.0003538499],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007865197,0.001953787,0.0014377539,0.003963693,0.0012250283,0.010308442,0.0025514122,0.0014456689,0.02782735],"category_scores_gemma":[0.016241606,0.0012286596,0.0023155524,0.0052175536,0.0015253418,0.006550588,0.003965318,0.0030453918,0.029508399],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008904435,0.00007213384,0.0009045786,0.0010063952,0.00018761231,0.00017368604,0.00051830383,0.0017300989,0.002355303,0.15036032,0.23355217,0.6090504],"study_design_scores_gemma":[0.00002496688,0.00003020094,0.00046956068,0.00030002557,0.000044927016,0.0003796667,0.00015848567,0.010963501,0.0022722753,0.123027496,0.8622867,0.000042176012],"about_ca_topic_score_codex":0.0012174329,"about_ca_topic_score_gemma":0.000983439,"teacher_disagreement_score":0.02782735,"about_ca_system_score_codex":0.00095452345,"about_ca_system_score_gemma":0.0018754944,"threshold_uncertainty_score":0.093091786},"labels":[],"label_agreement":null},{"id":"W4320057135","doi":"10.1080/00031305.2022.2139293","title":"Bayes Factors and Posterior Estimation: Two Sides of the Very Same Coin","year":2022,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Bayes factor; Bayes' rule; Prior probability; Bayes' theorem; Bayesian probability; Posterior probability; Odds; Point estimation; Bayes estimator; Estimation; Statistics; Mathematics; Econometrics; Computer science; Economics; Logistic regression","score_opus":0.041926484876412824,"score_gpt":0.3594317233608289,"score_spread":0.3175052384844161,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4320057135","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00646995,0.06339111,0.73569477,0.15225029,0.009481621,0.00024623383,0.0003841857,0.00031327267,0.031768523],"genre_scores_gemma":[0.38060027,0.061916426,0.4594392,0.050267335,0.03643087,0.0016352104,0.00048707708,0.0010929424,0.008130681],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8518019,0.108040705,0.007618685,0.008682997,0.022004154,0.0018515125],"domain_scores_gemma":[0.6145619,0.34011808,0.008987963,0.018996691,0.015369548,0.0019658674],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12548709,0.0022028375,0.0049371417,0.008014689,0.0030428648,0.014449163,0.004861951,0.010025418,0.005209652],"category_scores_gemma":[0.31628445,0.0017191808,0.0025313979,0.0072846827,0.04528764,0.03106852,0.0061668,0.022094887,0.0017108618],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006396627,0.000018722192,0.00049366057,0.00025202223,0.00011262729,0.000057880432,0.0007459987,0.0007823761,0.000054672983,0.9656852,0.0039027752,0.027830034],"study_design_scores_gemma":[0.000025142826,0.000012185056,0.00020810301,0.0003382834,0.000026333028,0.00005129772,0.000111867186,0.0009559679,0.00006537613,0.9911084,0.0070654354,0.000031571562],"about_ca_topic_score_codex":0.0031043168,"about_ca_topic_score_gemma":0.0016182422,"teacher_disagreement_score":0.12548709,"about_ca_system_score_codex":0.0050108884,"about_ca_system_score_gemma":0.0043252404,"threshold_uncertainty_score":0.66364706},"labels":[],"label_agreement":null},{"id":"W4386562232","doi":"10.1080/00031305.2023.2257237","title":"Statistical Challenges in Online Controlled Experiments: A Review of A/B Testing Methodology","year":2023,"lang":"en","type":"review","venue":"The American Statistician","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Data science; The Internet; Computer science; Scale (ratio); Big data; World Wide Web; Marketing; Business; Data mining; Geography","score_opus":0.9449757609267309,"score_gpt":0.7096567412494859,"score_spread":0.235319019677245,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386562232","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003244503,0.90221244,0.08520949,0.007406957,0.0009780881,0.00095260673,0.00024309952,0.0001464717,0.002526448],"genre_scores_gemma":[0.020865886,0.8209647,0.13920046,0.007518382,0.0029195445,0.007274942,0.0003009262,0.00026304155,0.00069209025],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.7238119,0.2207592,0.0211826,0.008485605,0.024995787,0.0007649355],"domain_scores_gemma":[0.22003816,0.75033265,0.010467792,0.006687,0.011786031,0.0006883964],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23763375,0.0027651924,0.009017028,0.00816489,0.0012170891,0.006134271,0.006604015,0.0058283946,0.0040040663],"category_scores_gemma":[0.42886636,0.0020242743,0.0048247236,0.009971178,0.010341413,0.005930586,0.0033548162,0.007347941,0.0018758203],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041945756,0.00022534523,0.0019645467,0.0813158,0.0021691988,0.00019563084,0.00078759383,0.0033043732,0.00037972722,0.060647927,0.01395125,0.83463913],"study_design_scores_gemma":[0.00083194196,0.0024705566,0.0062936684,0.20451427,0.0046306243,0.0014478709,0.0009875175,0.014653612,0.002378648,0.3180416,0.4432197,0.0005300578],"about_ca_topic_score_codex":0.0051175538,"about_ca_topic_score_gemma":0.0038482335,"teacher_disagreement_score":0.76236624,"about_ca_system_score_codex":0.006343113,"about_ca_system_score_gemma":0.015777733,"threshold_uncertainty_score":0.94013333},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":[],"domain":null,"study_design":"systematic_review","genre":"review","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W4387362492","doi":"10.1080/00031305.2023.2267597","title":"Causal Quartets: Different Ways to Attain the Same Average Treatment Effect","year":2023,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Science North","funders":"","keywords":"Variation (astronomy); Context (archaeology); Simple (philosophy); Epistemology; Mathematical economics; Mathematics; Computer science; Econometrics; Sociology; Philosophy; History; Physics","score_opus":0.10626714617887423,"score_gpt":0.4161824036868427,"score_spread":0.30991525750796844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387362492","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04550739,0.0016899493,0.8757094,0.014049871,0.0009988064,0.00029715293,0.0016287522,0.0014119233,0.05870676],"genre_scores_gemma":[0.7709697,0.001488308,0.21453696,0.0038194833,0.0004640726,0.00086166937,0.00067681016,0.0006658357,0.0065172696],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9923349,0.0048818327,0.00026752797,0.0012404415,0.00088299776,0.00039221632],"domain_scores_gemma":[0.95170236,0.035893343,0.0026897131,0.007522458,0.0015121996,0.0006799216],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.012325155,0.000798135,0.0011874054,0.0029118932,0.0017257041,0.0038671622,0.0016255172,0.0027131191,0.020219529],"category_scores_gemma":[0.080889225,0.00052573445,0.0016991178,0.003227874,0.007220677,0.008570829,0.0028847833,0.0048752995,0.0017052712],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006642718,0.000026883734,0.0010324107,0.00012822625,0.000077275065,0.00009432637,0.0003530999,0.0034420744,0.0003085595,0.9630449,0.0054717823,0.025954034],"study_design_scores_gemma":[0.00003619991,0.000026873615,0.00063772936,0.000031399268,0.000028500452,0.000060919418,0.00008039554,0.005357286,0.00022050228,0.9894992,0.00400716,0.000013913768],"about_ca_topic_score_codex":0.0013240095,"about_ca_topic_score_gemma":0.0012778784,"teacher_disagreement_score":0.98767483,"about_ca_system_score_codex":0.0017225237,"about_ca_system_score_gemma":0.001008665,"threshold_uncertainty_score":0.06764108},"labels":[],"label_agreement":null},{"id":"W4389233698","doi":"10.1080/00031305.2023.2290720","title":"Hitting a Prime by Rolling a Die with Infinitely Many Faces","year":2023,"lang":"en","type":"article","venue":"The American Statistician","topic":"Experimental and Theoretical Physics Studies","field":"Physics and Astronomy","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Die (integrated circuit); Prime (order theory); Combinatorics; Mathematics; Arithmetic; Psychology; Computer science; Operating system","score_opus":0.0076238206710642535,"score_gpt":0.26203459242866733,"score_spread":0.25441077175760307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389233698","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6495719,0.00072483945,0.28663754,0.0034471333,0.0004583864,0.00016634572,0.00041925526,0.00084064645,0.05773391],"genre_scores_gemma":[0.9595298,0.00020367693,0.028835801,0.0005142832,0.00009214296,0.000095636504,0.0001880263,0.00009453889,0.01044605],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99811566,0.00064653,0.00008949302,0.0004726205,0.00026313774,0.00041255925],"domain_scores_gemma":[0.9873864,0.008594048,0.0010621676,0.0015227309,0.00045429813,0.0009802224],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0027620594,0.0007364654,0.00090165756,0.00038874702,0.0014400923,0.0022774746,0.0012961063,0.0010523114,0.010625694],"category_scores_gemma":[0.016443193,0.00042446543,0.0009577263,0.00032976613,0.0018950215,0.0036347865,0.0017971437,0.0019475012,0.0017671157],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0056393025,0.00045676212,0.020849021,0.00043099248,0.00039634467,0.0011337426,0.000782069,0.12539254,0.028308326,0.68453234,0.0224135,0.10966516],"study_design_scores_gemma":[0.0003610851,0.0014972052,0.0051288228,0.000060273873,0.00012711664,0.0012006747,0.0004683945,0.37064412,0.017715072,0.5840402,0.018599553,0.00015745896],"about_ca_topic_score_codex":0.0009757046,"about_ca_topic_score_gemma":0.0012382464,"teacher_disagreement_score":0.010625694,"about_ca_system_score_codex":0.0009905561,"about_ca_system_score_gemma":0.00088787434,"threshold_uncertainty_score":0.03554648},"labels":[],"label_agreement":null},{"id":"W4392662318","doi":"10.1080/00031305.2024.2327535","title":"Thick Data Analytics (TDA): An Iterative and Inductive Framework for Algorithmic Improvement","year":2024,"lang":"en","type":"article","venue":"The American Statistician","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"U.S. National Library of Medicine; National Institute of Environmental Health Sciences; National Institute of Allergy and Infectious Diseases; School of Medicine, Stanford University; National Institutes of Health; Canada Excellence Research Chairs, Government of Canada","keywords":"Computer science; SAFER; Subject-matter expert; USable; Data science; Analytics; Domain (mathematical analysis); Machine learning; Data mining; Domain knowledge; Frame (networking); Artificial intelligence; Risk analysis (engineering); Expert system","score_opus":0.0671994435639882,"score_gpt":0.4028620339116792,"score_spread":0.33566259034769097,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392662318","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008611621,0.000114300085,0.9964785,0.0007608888,0.000027399627,0.00032274012,0.000071029244,0.00042070413,0.00094332837],"genre_scores_gemma":[0.023968594,0.00012627163,0.97408086,0.00027741885,0.000049641312,0.00077702117,0.00021759098,0.000116495605,0.00038609444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95349526,0.030308275,0.0035107578,0.0039595626,0.007689338,0.0010367453],"domain_scores_gemma":[0.8521801,0.110080436,0.005189413,0.0168505,0.013997359,0.0017021581],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05489096,0.004000512,0.002400624,0.0090380795,0.003168335,0.008269947,0.0071384753,0.0032454638,0.006051172],"category_scores_gemma":[0.13916771,0.0024622257,0.005367057,0.004712669,0.010825564,0.011424223,0.015893327,0.009329507,0.0022734876],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029874596,0.0006404623,0.0060979202,0.0019824046,0.00050431374,0.0006099005,0.0053046313,0.14912702,0.0040613064,0.4985653,0.010211257,0.32259676],"study_design_scores_gemma":[0.000067532885,0.00016439415,0.00033659991,0.0005622489,0.00007616497,0.0001177371,0.0006957592,0.40039173,0.0022148874,0.581472,0.013812446,0.00008847889],"about_ca_topic_score_codex":0.0057084835,"about_ca_topic_score_gemma":0.006825183,"teacher_disagreement_score":0.05489096,"about_ca_system_score_codex":0.0041626296,"about_ca_system_score_gemma":0.01071809,"threshold_uncertainty_score":0.2902946},"labels":[],"label_agreement":null},{"id":"W4399726225","doi":"10.1080/00031305.2024.2368794","title":"High-Dimensional Propensity Score and Its Machine Learning Extensions in Residual Confounding Control","year":2024,"lang":"en","type":"article","venue":"The American Statistician","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Propensity score matching; Confounding; Residual; Computer science; Proxy (statistics); Exploit; Causal inference; Parametric statistics; Machine learning; Econometrics; Artificial intelligence; Data mining; Statistics; Algorithm; Mathematics","score_opus":0.12057004770728635,"score_gpt":0.39189234053654654,"score_spread":0.2713222928292602,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399726225","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020519602,0.001963767,0.9897758,0.003860153,0.00021109311,0.00007107227,0.00017101495,0.00018726265,0.0017078768],"genre_scores_gemma":[0.12698022,0.0052095638,0.85953677,0.002617202,0.0015302357,0.00095332577,0.000489572,0.00022402097,0.002459085],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9674065,0.025813026,0.0013644086,0.002272911,0.002774462,0.00036873794],"domain_scores_gemma":[0.9289892,0.05485203,0.004226819,0.008136365,0.0033925604,0.000403099],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.051241115,0.0010062193,0.0012350526,0.0027204987,0.00087355904,0.003606587,0.0023120928,0.0021544911,0.004172762],"category_scores_gemma":[0.13324124,0.00070164097,0.002376296,0.0048421617,0.0057723545,0.00552905,0.0043670903,0.0071979575,0.0010476795],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077503835,0.00003022425,0.0028229414,0.00028213492,0.00017688924,0.00009609205,0.00027941284,0.015017865,0.0001757076,0.8695447,0.006099842,0.1053967],"study_design_scores_gemma":[0.000053313724,0.00006203604,0.0017225686,0.00021500641,0.00006876987,0.00013412209,0.000050307015,0.08518506,0.00048419132,0.89391565,0.01805186,0.000057151745],"about_ca_topic_score_codex":0.002806732,"about_ca_topic_score_gemma":0.0015516802,"teacher_disagreement_score":0.051241115,"about_ca_system_score_codex":0.0015131788,"about_ca_system_score_gemma":0.0030777345,"threshold_uncertainty_score":0.27099216},"labels":[],"label_agreement":null},{"id":"W4402407033","doi":"10.1080/00031305.2024.2402898","title":"When Heavy Tails Disrupt Statistical Inference","year":2024,"lang":"en","type":"article","venue":"The American Statistician","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Statistical inference; Inference; Econometrics; Computer science; Statistics; Mathematics; Statistical physics; Artificial intelligence; Physics","score_opus":0.03880810499610163,"score_gpt":0.2962289158894527,"score_spread":0.2574208108933511,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402407033","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07426703,0.0063432287,0.8812087,0.015989803,0.0010766999,0.00034500874,0.001364644,0.0018197552,0.017585145],"genre_scores_gemma":[0.8459592,0.003987327,0.13017288,0.011337843,0.0021569289,0.0006931213,0.0011731035,0.0009815613,0.0035380535],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9631618,0.018604243,0.0028777975,0.0065264883,0.0072956667,0.0015339868],"domain_scores_gemma":[0.5789251,0.35565457,0.023371018,0.03040775,0.009404653,0.0022369772],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06541195,0.00085912494,0.0017548457,0.0034016378,0.00204111,0.006963328,0.0023495168,0.0037315872,0.004384451],"category_scores_gemma":[0.3828774,0.0013262427,0.0011683494,0.0030285865,0.008093745,0.01106297,0.005176601,0.006713803,0.0013883223],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006312956,0.0001463481,0.08019344,0.0010955515,0.0008393656,0.0019843327,0.0043927967,0.047014643,0.0033254114,0.58411014,0.023751633,0.25251496],"study_design_scores_gemma":[0.000043960543,0.000109837296,0.009110479,0.00051334366,0.00011721213,0.00067319284,0.00066620763,0.06409209,0.0027984977,0.9042281,0.017549854,0.000097224365],"about_ca_topic_score_codex":0.0031539656,"about_ca_topic_score_gemma":0.0027081333,"teacher_disagreement_score":0.06541195,"about_ca_system_score_codex":0.0029423733,"about_ca_system_score_gemma":0.0031281672,"threshold_uncertainty_score":0.34593558},"labels":[],"label_agreement":null},{"id":"W4403867438","doi":"10.1080/00031305.2024.2421370","title":"Cross-Validatory Z-Residual for Diagnosing Shared Frailty Models","year":2024,"lang":"en","type":"article","venue":"The American Statistician","topic":"Frailty in Older Adults","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University; University of Saskatchewan","funders":"","keywords":"Residual; Statistics; Computer science; Mathematics; Algorithm","score_opus":0.06678084858081718,"score_gpt":0.39010266550030365,"score_spread":0.32332181691948647,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403867438","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23988333,0.001682353,0.75370055,0.00047672822,0.00011392579,0.00013111315,0.00065704726,0.001662221,0.0016926994],"genre_scores_gemma":[0.89866114,0.00029063018,0.09857138,0.00026810184,0.000054436463,0.00011247808,0.0013046275,0.00024343975,0.00049372786],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9903274,0.005747363,0.0007131845,0.0014997104,0.0013357566,0.0003765485],"domain_scores_gemma":[0.9398732,0.042737465,0.0058766385,0.0064845206,0.004344916,0.0006833826],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027787082,0.0010642603,0.0011681636,0.0028595224,0.00068852963,0.001520457,0.0015581584,0.0013828916,0.0015374925],"category_scores_gemma":[0.094263665,0.00029389717,0.0017249058,0.0016064972,0.0014597435,0.001996537,0.0028005182,0.002052618,0.00045720587],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014951865,0.00029619178,0.3702036,0.0007114408,0.001481245,0.0007735981,0.0009837776,0.307179,0.008147135,0.033366285,0.0057471637,0.26961538],"study_design_scores_gemma":[0.00009854018,0.00064341497,0.05722184,0.00020773365,0.0003494689,0.00055885356,0.00034746085,0.89300513,0.011109594,0.031476915,0.0048152534,0.00016579987],"about_ca_topic_score_codex":0.00412353,"about_ca_topic_score_gemma":0.004015086,"teacher_disagreement_score":0.027787082,"about_ca_system_score_codex":0.0006754311,"about_ca_system_score_gemma":0.001637878,"threshold_uncertainty_score":0.14695388},"labels":[],"label_agreement":null},{"id":"W4411882452","doi":"10.1080/00031305.2025.2526545","title":"LASSO-Based Survival Prediction Modeling with Multiply Imputed Data: A Case Study in Tuberculosis Mortality Prediction","year":2025,"lang":"en","type":"article","venue":"The American Statistician","topic":"Machine Learning in Healthcare","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"BC Centre for Disease Control; St. Paul's Hospital; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; University of British Columbia","keywords":"Lasso (programming language); Statistics; Econometrics; Mathematics; Computer science; Data mining","score_opus":0.05416784748200714,"score_gpt":0.3684578644543723,"score_spread":0.31429001697236514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411882452","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.67507607,0.001963051,0.30646476,0.010826265,0.00017647505,0.00029659184,0.0012995006,0.0004019765,0.003495321],"genre_scores_gemma":[0.87661386,0.00045150096,0.1202529,0.00051567506,0.00013857277,0.00026652968,0.00070142234,0.0000790658,0.0009805467],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9877378,0.010089943,0.00032023917,0.0006874728,0.0008279912,0.00033653784],"domain_scores_gemma":[0.9375172,0.05491586,0.002061067,0.002618373,0.0021706743,0.00071665423],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02969929,0.0007495229,0.0015849378,0.0009910756,0.0011112981,0.0016726546,0.0017890773,0.0029196022,0.0017212386],"category_scores_gemma":[0.055749744,0.00051971414,0.0018902052,0.0021778066,0.001293657,0.0015973131,0.0015374287,0.0036914952,0.00024901377],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013654506,0.0009887542,0.11070636,0.00046289875,0.0006759654,0.005147449,0.0012459715,0.7572975,0.0010415675,0.035330664,0.012420451,0.07331699],"study_design_scores_gemma":[0.00015696963,0.00037726123,0.0061287736,0.00008287527,0.000097736636,0.00069171516,0.00036540016,0.97434014,0.0010143283,0.014151931,0.0025238039,0.000069038164],"about_ca_topic_score_codex":0.008855387,"about_ca_topic_score_gemma":0.008258117,"teacher_disagreement_score":0.02969929,"about_ca_system_score_codex":0.0011646465,"about_ca_system_score_gemma":0.0015735248,"threshold_uncertainty_score":0.15706676},"labels":[],"label_agreement":null},{"id":"W4412709116","doi":"10.1080/00031305.2025.2539241","title":"A Fisher’s Exact Test Justification of the TF–IDF Term-Weighting Scheme","year":2025,"lang":"en","type":"article","venue":"The American Statistician","topic":"Stock Market Forecasting Methods","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Prince Edward Island","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Term (time); Weighting; Statistics; Mathematics; Test (biology); Physics","score_opus":0.07572393262271854,"score_gpt":0.4222604066798787,"score_spread":0.34653647405716015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412709116","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004660773,0.0013512309,0.98133117,0.0046645016,0.0005614488,0.00007955827,0.00037101094,0.00018794078,0.0067924596],"genre_scores_gemma":[0.2840706,0.002237994,0.6994736,0.0028180168,0.0023634704,0.00079961336,0.0007659287,0.0002465816,0.007224205],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98509717,0.006157602,0.0010589346,0.0024849153,0.004731856,0.0004695959],"domain_scores_gemma":[0.9363114,0.047980513,0.0024722673,0.0051731546,0.0076463316,0.0004162433],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.029031588,0.00088640733,0.0013346501,0.0041577853,0.0018932078,0.0030240086,0.0024045133,0.0036969322,0.0064472654],"category_scores_gemma":[0.16114846,0.00037870088,0.001066982,0.0045557483,0.0075066364,0.0063080667,0.002574774,0.004404859,0.0026013139],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012316137,0.000031644035,0.0025701504,0.00020143724,0.000048371596,0.00024232853,0.0004295312,0.00543457,0.0013128672,0.8067622,0.010775772,0.17206793],"study_design_scores_gemma":[0.00004693677,0.00011804596,0.0016144089,0.00023461872,0.00003163136,0.0006198292,0.00014097133,0.049176157,0.0028336016,0.9212458,0.023874942,0.00006306529],"about_ca_topic_score_codex":0.0027593565,"about_ca_topic_score_gemma":0.0011465804,"teacher_disagreement_score":0.029031588,"about_ca_system_score_codex":0.00190665,"about_ca_system_score_gemma":0.0034422101,"threshold_uncertainty_score":0.15353554},"labels":[],"label_agreement":null},{"id":"W4414351985","doi":"10.1080/00031305.2025.2562891","title":"Moving Forward From the COVID-19 Pandemic","year":2025,"lang":"en","type":"article","venue":"The American Statistician","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Artificial Intelligence in Medicine (Canada)","funders":"","keywords":"Pandemic; Salient; Action (physics); Exploit; Value (mathematics); Public policy; Coronavirus disease 2019 (COVID-19)","score_opus":0.22388260942896104,"score_gpt":0.4640775369174704,"score_spread":0.24019492748850935,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414351985","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010248733,0.013401557,0.002061686,0.9344525,0.027938202,0.000034148277,0.0029291809,0.0003396599,0.017818168],"genre_scores_gemma":[0.074742414,0.09102666,0.014864109,0.6416019,0.13189425,0.0003258826,0.010750758,0.0016543987,0.033139616],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9881017,0.0062068487,0.00063828274,0.0008619981,0.0030515494,0.0011396192],"domain_scores_gemma":[0.9606294,0.016159805,0.0021342197,0.002076916,0.01001574,0.0089838365],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023624375,0.0011237037,0.0010129726,0.003040015,0.0023546391,0.010576351,0.0021113306,0.0056476607,0.07540972],"category_scores_gemma":[0.108698666,0.00045210935,0.001247593,0.0028591608,0.003446669,0.0144705465,0.007969633,0.016399456,0.026018035],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000698611,0.000022440769,0.0016264862,0.00027776675,0.000028570765,0.00005337971,0.00024417634,0.00015385258,0.00004643985,0.022900559,0.9326828,0.04189359],"study_design_scores_gemma":[0.00004517709,0.00007580205,0.004621746,0.0032363124,0.000037006015,0.00022602035,0.0014427737,0.0004349184,0.00012020391,0.068994746,0.92070705,0.00005827018],"about_ca_topic_score_codex":0.011499572,"about_ca_topic_score_gemma":0.011594477,"teacher_disagreement_score":0.07540972,"about_ca_system_score_codex":0.0047327313,"about_ca_system_score_gemma":0.01309214,"threshold_uncertainty_score":0.25227064},"labels":[],"label_agreement":null},{"id":"W7116726263","doi":"10.1080/00031305.2025.2606079","title":"Probabilistic Parameter Estimates that Require Less Small Print","year":2025,"lang":"en","type":"article","venue":"The American Statistician","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Probabilistic logic; Estimation theory; Statistical model; Estimation; Bayesian probability","score_opus":0.10987777437965937,"score_gpt":0.3954648102331808,"score_spread":0.2855870358535214,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7116726263","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018940629,0.0017019609,0.93227637,0.010427684,0.0022632545,0.00014369207,0.000641119,0.007640553,0.043011244],"genre_scores_gemma":[0.055255223,0.0023799518,0.88180804,0.0099173505,0.0030725463,0.00072375534,0.0010565807,0.008055616,0.0377309],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98126364,0.008946954,0.0012124159,0.002132567,0.0062478636,0.00019644904],"domain_scores_gemma":[0.7626982,0.18790492,0.004442847,0.03501047,0.009160606,0.00078303134],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023107976,0.0021678754,0.0016837207,0.0027704004,0.0014279779,0.009770598,0.0035561332,0.0031469287,0.09229179],"category_scores_gemma":[0.23666607,0.0017957311,0.0018062477,0.0023804812,0.0066372068,0.015080545,0.004527789,0.009213548,0.03295569],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000388764,0.00014621242,0.0012856373,0.001309215,0.00018506203,0.00056754734,0.0015046455,0.010367011,0.0025783598,0.4783378,0.12925822,0.3740716],"study_design_scores_gemma":[0.00016699311,0.0001334348,0.00091662887,0.00085407647,0.0000928275,0.001041314,0.00039061153,0.02056371,0.003243428,0.6302637,0.34215808,0.00017515723],"about_ca_topic_score_codex":0.0018928924,"about_ca_topic_score_gemma":0.0025978188,"teacher_disagreement_score":0.09229179,"about_ca_system_score_codex":0.0016527403,"about_ca_system_score_gemma":0.0019459791,"threshold_uncertainty_score":0.3087468},"labels":[],"label_agreement":null}]}