{"meta":{"query_hash":"215245d4a577","filters":{"venue":"Journal of Applied Statistics"},"cohort_total":91,"direct_labels_cover":0,"predictions_cover":91,"exported":91,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/215245d4a577","api":"https://metacan.xera.ac/api/v1/cohort?venue=Journal+of+Applied+Statistics"},"results":[{"id":"W1968805547","doi":"10.1080/02664760500168648","title":"Interpretable dimension reduction","year":2005,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Data Analysis with R","field":"Computer Science","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University; Acadia University","funders":"University of Waterloo; Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Principal component analysis; Linear subspace; Dimensionality reduction; Constraint (computer-aided design); Dimension (graph theory); Mathematics; Homogeneity (statistics); Reduction (mathematics); Mathematical optimization; Computer science; Algorithm; Statistics; Artificial intelligence; Combinatorics","score_opus":0.007379734791390265,"score_gpt":0.24240870830722677,"score_spread":0.23502897351583651,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1968805547","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061980635,0.0015732052,0.971693,0.0019458224,0.0005865162,0.00021420924,0.0028824883,0.0020585365,0.012848236],"genre_scores_gemma":[0.11136158,0.0027004043,0.8652505,0.00076808524,0.00065581535,0.0008057467,0.008748297,0.0007441205,0.008965378],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9955505,0.0015779288,0.00036737852,0.0009438913,0.0013923619,0.0001678602],"domain_scores_gemma":[0.9916182,0.00289448,0.000493999,0.0027203104,0.0021501305,0.00012290204],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004539817,0.0022565844,0.001329491,0.0037194039,0.0010000326,0.0055079656,0.0017418059,0.001108425,0.014555434],"category_scores_gemma":[0.023205332,0.00061572646,0.0017092549,0.0027017903,0.0016260968,0.0032579326,0.0033733451,0.0027143154,0.0059575518],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029821557,0.00015762736,0.0026318387,0.0012004387,0.0002732303,0.00050139305,0.0011557692,0.031249486,0.014718204,0.32751572,0.0608918,0.55940634],"study_design_scores_gemma":[0.00007758653,0.0000988991,0.0023454993,0.00038770778,0.0001362837,0.00045759883,0.00073612365,0.17567196,0.010535745,0.68850845,0.12093114,0.00011299716],"about_ca_topic_score_codex":0.0007465695,"about_ca_topic_score_gemma":0.00087718864,"teacher_disagreement_score":0.014555434,"about_ca_system_score_codex":0.0008130361,"about_ca_system_score_gemma":0.001291273,"threshold_uncertainty_score":0.048692763},"labels":[],"label_agreement":null},{"id":"W1969946313","doi":"10.1080/02664760802192981","title":"Diagnostics of prior-data agreement in applied Bayesian analysis","year":2008,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":62,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Bayesian probability; Prior probability; Computer science; Bayesian hierarchical modeling; Bayesian average; Reliability (semiconductor); Bayesian statistics; Bayesian experimental design; Data mining; Statistics; Bayesian inference; Mathematics; Artificial intelligence","score_opus":0.13993335252795808,"score_gpt":0.4126900095050708,"score_spread":0.2727566569771127,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1969946313","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037910055,0.0011870891,0.9572097,0.0005976971,0.000046557776,0.00011221114,0.00009643178,0.00021227935,0.0026278854],"genre_scores_gemma":[0.700309,0.0004775254,0.29748592,0.00034871814,0.00014892992,0.00036515054,0.00026998037,0.00013988857,0.0004548061],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.83593494,0.11540959,0.009192486,0.010848251,0.026982209,0.0016325256],"domain_scores_gemma":[0.44210616,0.4953458,0.025379434,0.020645972,0.014309294,0.0022133468],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15456474,0.0016174867,0.0027748104,0.010171414,0.0019225633,0.008395925,0.0038788144,0.005128167,0.0020748905],"category_scores_gemma":[0.489478,0.0015058202,0.0018645843,0.005859444,0.014331055,0.010285747,0.009446319,0.0057707345,0.00045918068],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005546092,0.00012514586,0.02311579,0.00095416553,0.0007480783,0.000431913,0.0027520384,0.14326677,0.0017186572,0.7349486,0.0010238807,0.09036039],"study_design_scores_gemma":[0.00006134585,0.00020681729,0.0051592533,0.0002983395,0.00007371752,0.0003107444,0.00030822077,0.25081468,0.0023157985,0.7387032,0.0016102055,0.00013763778],"about_ca_topic_score_codex":0.001142597,"about_ca_topic_score_gemma":0.0004499307,"teacher_disagreement_score":0.15456474,"about_ca_system_score_codex":0.0027396388,"about_ca_system_score_gemma":0.0026551664,"threshold_uncertainty_score":0.8174262},"labels":[],"label_agreement":null},{"id":"W1972766374","doi":"10.1080/02664763.2011.595399","title":"Applying a marginalized frailty model to competing risks","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph; Public Health Agency of Canada; Western University","funders":"","keywords":"Multivariate statistics; Econometrics; Martingale (probability theory); Multivariate analysis; Statistics; Proportional hazards model; Computer science; Breast cancer; Cluster analysis; Actuarial science; Mathematics; Medicine; Economics; Cancer","score_opus":0.1619227687976239,"score_gpt":0.366346027452832,"score_spread":0.2044232586552081,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972766374","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006004988,0.00017627706,0.99270356,0.00024938764,0.000052456966,0.00006507669,0.00010195412,0.00010045008,0.0005457253],"genre_scores_gemma":[0.4332442,0.0013405951,0.556149,0.00049156183,0.00038142968,0.0009429813,0.0006364775,0.0001757477,0.006638028],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9950046,0.003340631,0.00017334412,0.0005369661,0.0006959395,0.00024861412],"domain_scores_gemma":[0.98701626,0.0101077,0.00060676655,0.0011309285,0.0008379225,0.0003004586],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013501064,0.0012079047,0.001635968,0.0018495799,0.0004949426,0.0018324396,0.0041532037,0.0016944556,0.003978476],"category_scores_gemma":[0.034042254,0.00080167473,0.0031531367,0.0015609836,0.0016481698,0.001959231,0.0030185706,0.0035315056,0.00062790455],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015860781,0.00009986226,0.008265359,0.0002677315,0.0005381609,0.00068179396,0.00068861444,0.47601187,0.0009774368,0.45069164,0.0025539189,0.059064988],"study_design_scores_gemma":[0.000034946228,0.00011210812,0.000982985,0.00004720038,0.00007599408,0.0002117956,0.000055849134,0.8161114,0.00019988864,0.17990375,0.0022211808,0.00004287524],"about_ca_topic_score_codex":0.009052039,"about_ca_topic_score_gemma":0.0049586226,"teacher_disagreement_score":0.013501064,"about_ca_system_score_codex":0.0014433558,"about_ca_system_score_gemma":0.0024979275,"threshold_uncertainty_score":0.0714013},"labels":[],"label_agreement":null},{"id":"W1978467022","doi":"10.1080/02664760802443988","title":"Default Bayesian goodness-of-fit tests for the skew-normal model","year":2008,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Arizona; Ryerson University","keywords":"Goodness of fit; Skewness; Statistics; Mathematics; Skew; Bayesian probability; Econometrics; Asymmetry; Kurtosis; Computer science","score_opus":0.15873245974844416,"score_gpt":0.39253831372430315,"score_spread":0.23380585397585898,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1978467022","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.080640905,0.0007551902,0.9131571,0.0006213373,0.00014268295,0.00033575023,0.0005979977,0.001032355,0.0027168044],"genre_scores_gemma":[0.7697492,0.00037115318,0.22491407,0.0006982856,0.00022718452,0.001257052,0.0016477702,0.00035140174,0.0007838419],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9163275,0.06207104,0.0039020972,0.007182081,0.009228789,0.0012884607],"domain_scores_gemma":[0.59767675,0.32959673,0.015286308,0.042346206,0.012554975,0.002538927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08346078,0.0014835628,0.0035950458,0.004830542,0.0016902158,0.0033902973,0.005276977,0.0043690666,0.0063304217],"category_scores_gemma":[0.38066304,0.00091525534,0.0025035404,0.0033586782,0.005405282,0.00844605,0.004811732,0.0055581,0.0021580884],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0044483724,0.00064735964,0.15416245,0.0014948602,0.0030628198,0.0016743396,0.001859244,0.13106129,0.0070036203,0.31163952,0.01073111,0.372215],"study_design_scores_gemma":[0.00044208005,0.0012049413,0.03085463,0.00053813396,0.00038820266,0.0024218098,0.0006252855,0.45096922,0.0054735956,0.50128746,0.0054419525,0.00035268022],"about_ca_topic_score_codex":0.000556513,"about_ca_topic_score_gemma":0.0004921378,"teacher_disagreement_score":0.08346078,"about_ca_system_score_codex":0.0011139198,"about_ca_system_score_gemma":0.0015237834,"threshold_uncertainty_score":0.44138807},"labels":[],"label_agreement":null},{"id":"W1980895071","doi":"10.1080/02664763.2010.516388","title":"A flexible parametric survival model which allows a bathtub-shaped hazard rate function","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":29,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Weibull distribution; Bathtub; Log-normal distribution; Statistics; Mathematics; Parametric statistics; Hazard; Log-logistic distribution; Distribution (mathematics); Function (biology); Applied mathematics; Econometrics; Distribution fitting; Exponential distribution; Mathematical analysis; Geography","score_opus":0.05949770112114674,"score_gpt":0.29749862229911156,"score_spread":0.2380009211779648,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1980895071","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022685511,0.00032294207,0.97232515,0.00045619634,0.000098569275,0.0000884414,0.0005235187,0.00031014413,0.0031894795],"genre_scores_gemma":[0.7743011,0.0015137648,0.19547766,0.00037007532,0.00024483868,0.0009386217,0.0014052284,0.00023616794,0.025512407],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99891496,0.00045505067,0.00005409976,0.00019675099,0.00023664716,0.00014262607],"domain_scores_gemma":[0.996027,0.0024342297,0.00045262265,0.00048758628,0.0004337338,0.00016482628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003920177,0.00086588325,0.0010680213,0.0009811298,0.00047194844,0.001289437,0.0021437735,0.0012835066,0.005381037],"category_scores_gemma":[0.011082007,0.00042039042,0.0012117797,0.0014812745,0.0012399524,0.0020141427,0.0014974901,0.0025560607,0.0013142419],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002076809,0.00013650833,0.007130584,0.0002421039,0.00014718546,0.00088457315,0.0005220363,0.6088658,0.004281032,0.27910265,0.006476368,0.09200352],"study_design_scores_gemma":[0.00004177943,0.0002048235,0.0023552468,0.000058675585,0.00008255509,0.00093241094,0.000083738065,0.85315436,0.0006853315,0.13355786,0.008755132,0.000088119545],"about_ca_topic_score_codex":0.001973451,"about_ca_topic_score_gemma":0.0023736062,"teacher_disagreement_score":0.005381037,"about_ca_system_score_codex":0.0008296802,"about_ca_system_score_gemma":0.0015579602,"threshold_uncertainty_score":0.020732164},"labels":[],"label_agreement":null},{"id":"W1983604712","doi":"10.1080/02664760600679619","title":"Two-way analysis of variance for data from a concentrated bipolar Watson distribution","year":2006,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Soil Geostatistics and Mapping","field":"Environmental Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Simon Fraser University","keywords":"Watson; Variance (accounting); Distribution (mathematics); Statistics; Computer science; Mathematics; Algorithm; Econometrics; Artificial intelligence; Mathematical analysis","score_opus":0.01800048964258992,"score_gpt":0.2616770483557746,"score_spread":0.24367655871318467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1983604712","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.051234633,0.00019561012,0.94643766,0.00011707759,0.00009578221,0.00019870567,0.00025700917,0.00036393176,0.0010996602],"genre_scores_gemma":[0.62514836,0.00039177117,0.36830026,0.00020248642,0.00016715769,0.0018073728,0.00096319104,0.0003113877,0.0027079775],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9647191,0.025731837,0.0010887102,0.0042432924,0.0034227988,0.000794158],"domain_scores_gemma":[0.88103145,0.10073806,0.0036904258,0.008709257,0.005220486,0.0006102865],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03266447,0.0013461956,0.0019054518,0.0029883645,0.0010588524,0.0029179382,0.0015978272,0.0012341512,0.005909139],"category_scores_gemma":[0.109086424,0.00048457092,0.0020114244,0.0043379725,0.002966478,0.003152708,0.0017014148,0.0025941853,0.000855081],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018246059,0.00044669822,0.062250003,0.00074067776,0.0025642512,0.0013934062,0.0045377747,0.1260488,0.00969474,0.44445696,0.0066718054,0.33937028],"study_design_scores_gemma":[0.00015833777,0.00106502,0.027288953,0.00019838919,0.00031842795,0.00047520568,0.0011080995,0.6371634,0.004477067,0.31922174,0.008264881,0.0002605696],"about_ca_topic_score_codex":0.002146994,"about_ca_topic_score_gemma":0.001311165,"teacher_disagreement_score":0.03266447,"about_ca_system_score_codex":0.001047003,"about_ca_system_score_gemma":0.001299047,"threshold_uncertainty_score":0.17274827},"labels":[],"label_agreement":null},{"id":"W1984579286","doi":"10.1080/02664763.2012.711814","title":"Spatial modeling using frequentist approach for disease mapping","year":2012,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Spatial and Panel Data Analysis","field":"Economics, Econometrics and Finance","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Manitoba","funders":"","keywords":"Frequentist inference; Generalized linear mixed model; Markov chain Monte Carlo; Bayesian probability; Computer science; Econometrics; Spatial econometrics; Statistics; Data mining; Bayesian inference; Machine learning; Mathematics; Artificial intelligence","score_opus":0.11059783449113725,"score_gpt":0.25909455274568427,"score_spread":0.14849671825454702,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1984579286","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012252207,0.00028608603,0.986233,0.00027348887,0.000028777751,0.000042434258,0.00025888399,0.00017092624,0.00045427968],"genre_scores_gemma":[0.4996712,0.0008860151,0.49513054,0.00018738283,0.00017355061,0.00053427205,0.0011650182,0.00008224736,0.0021697346],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9955402,0.0028976812,0.00015802112,0.0008701263,0.00038020074,0.00015369777],"domain_scores_gemma":[0.98972523,0.008050358,0.00085793564,0.0008157845,0.00041078945,0.0001398454],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005641708,0.00073030917,0.001641036,0.00411279,0.0010612933,0.0017463047,0.00221304,0.0015805238,0.0021565107],"category_scores_gemma":[0.016974868,0.00074762496,0.0024318614,0.003755073,0.00097551633,0.0018312641,0.0017997383,0.0015950241,0.0003491384],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008268096,0.00008871396,0.01764358,0.00019304901,0.00063296885,0.00040896,0.0005125111,0.7940243,0.0005718299,0.10422932,0.0018838452,0.07972819],"study_design_scores_gemma":[0.000008038771,0.000019669602,0.0010484344,0.00001272028,0.000031633204,0.00008974917,0.000055670593,0.9467008,0.00009216861,0.050706327,0.001219349,0.000015390893],"about_ca_topic_score_codex":0.01533646,"about_ca_topic_score_gemma":0.0118795615,"teacher_disagreement_score":0.01533646,"about_ca_system_score_codex":0.0014405971,"about_ca_system_score_gemma":0.0011965528,"threshold_uncertainty_score":0.030494392},"labels":[],"label_agreement":null},{"id":"W1989860334","doi":"10.1080/0266476022000030075","title":"An extension of the Dirichlet prior for the analysis of longitudinal multinomial data","year":2003,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Multinomial distribution; Dirichlet distribution; Multinomial probit; Bayesian probability; Computer science; Econometrics; Prior probability; Longitudinal data; Statistics; Mathematics; Multinomial logistic regression; Data mining","score_opus":0.12119000676231616,"score_gpt":0.4159998562650252,"score_spread":0.29480984950270905,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1989860334","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002414765,0.00028655335,0.9956098,0.00043831355,0.000070545386,0.000069539296,0.00016480865,0.0001121036,0.0008334968],"genre_scores_gemma":[0.15121622,0.0019279325,0.837519,0.000864983,0.0007853402,0.001594862,0.0011435222,0.0003597609,0.0045883716],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9838027,0.011592895,0.000666862,0.0019727459,0.001512398,0.0004523748],"domain_scores_gemma":[0.9265287,0.06278729,0.0021564951,0.0056273704,0.002086742,0.0008134706],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03368767,0.0013513969,0.002563353,0.003884541,0.0025028107,0.0036646414,0.004714705,0.0030797208,0.008935577],"category_scores_gemma":[0.114489034,0.0015695586,0.0039657024,0.0046475073,0.004736805,0.008013373,0.004220423,0.007876952,0.0014732799],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010209878,0.00007535137,0.0029636086,0.00021002839,0.00023350501,0.00036499935,0.0009241937,0.048912045,0.0007009952,0.8914069,0.0032968796,0.050809287],"study_design_scores_gemma":[0.000040863084,0.000032712764,0.0008700656,0.00010812826,0.000054869895,0.00023392931,0.000108508204,0.16634142,0.00032886415,0.8256461,0.0061720894,0.00006242748],"about_ca_topic_score_codex":0.0060297404,"about_ca_topic_score_gemma":0.0065207323,"teacher_disagreement_score":0.03368767,"about_ca_system_score_codex":0.0023255697,"about_ca_system_score_gemma":0.0027374157,"threshold_uncertainty_score":0.17815953},"labels":[],"label_agreement":null},{"id":"W1992107314","doi":"10.1080/02664763.2012.692545","title":"Biostatistics: a computing approach","year":2012,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Big Data and Business Intelligence","field":"Business, Management and Accounting","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Biostatistics; Computer science; Data mining; Econometrics; Data science; Mathematics; Medicine","score_opus":0.058661597922472,"score_gpt":0.2880189262616139,"score_spread":0.2293573283391419,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1992107314","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00048564223,0.0022409807,0.9885999,0.004055182,0.0007088065,0.000105489205,0.0002079238,0.0006690218,0.0029270775],"genre_scores_gemma":[0.03437545,0.0045647854,0.950531,0.0028652088,0.0036488445,0.0009001874,0.0003264539,0.0005979193,0.002190215],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.97999156,0.014004019,0.0017713386,0.0013870975,0.0025531687,0.0002929089],"domain_scores_gemma":[0.8881146,0.092824645,0.0027457706,0.006986551,0.006769582,0.0025589722],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020744566,0.0020334919,0.0031681152,0.007456506,0.001718316,0.009744033,0.0028593496,0.0024005247,0.006343585],"category_scores_gemma":[0.06897199,0.0011969472,0.0021750913,0.00997011,0.0060261087,0.0047203135,0.0038903817,0.0064472742,0.0031275991],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001031273,0.00014212212,0.0038559202,0.0019641144,0.0005228154,0.0004289619,0.0006825578,0.008942211,0.0009347876,0.6814558,0.0473079,0.25365967],"study_design_scores_gemma":[0.000047596834,0.000058712172,0.00091474166,0.0003251073,0.0001670423,0.0007464226,0.00028207598,0.02542729,0.0005465277,0.9047156,0.06672097,0.000047920756],"about_ca_topic_score_codex":0.001503084,"about_ca_topic_score_gemma":0.001265953,"teacher_disagreement_score":0.020744566,"about_ca_system_score_codex":0.001763594,"about_ca_system_score_gemma":0.0067526647,"threshold_uncertainty_score":0.109709024},"labels":[],"label_agreement":null},{"id":"W1992842452","doi":"10.1080/02664763.2012.694257","title":"The Oxford handbook of quantitative asset management","year":2012,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Insurance and Financial Risk Management","field":"Economics, Econometrics and Finance","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"GDG Environnement","funders":"","keywords":"Asset management; Asset (computer security); Computer science; Econometrics; Mathematics; Economics; Finance","score_opus":0.02784343026381192,"score_gpt":0.2466945333010758,"score_spread":0.21885110303726388,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1992842452","genre_codex":"review","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0013752398,0.44760507,0.37053293,0.009519895,0.0067045414,0.00015133648,0.008150451,0.0036961609,0.15226431],"genre_scores_gemma":[0.040206,0.50875443,0.26708713,0.0029086324,0.0103468355,0.0006495897,0.0085062785,0.001970501,0.15957052],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99780566,0.00043270254,0.00038055095,0.0002746692,0.0010293707,0.00007711149],"domain_scores_gemma":[0.9932025,0.003833601,0.00046666493,0.0010897551,0.0011928487,0.00021463155],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022054361,0.0018451104,0.0029294759,0.0061388453,0.0005975258,0.0042440407,0.002168287,0.0018703457,0.037529938],"category_scores_gemma":[0.007929714,0.0017404227,0.00105555,0.00779664,0.0021225428,0.0043459893,0.00152537,0.003803365,0.017060775],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000026994874,0.0000742528,0.00074320915,0.0018243146,0.000089210065,0.000081149105,0.00019670109,0.0053042863,0.00056340947,0.2868591,0.32716945,0.377068],"study_design_scores_gemma":[0.000010929453,0.000023179262,0.0012850098,0.00056624523,0.000022737071,0.00027215763,0.000063533924,0.0031785828,0.00020714001,0.19266135,0.80166584,0.000043328855],"about_ca_topic_score_codex":0.003940644,"about_ca_topic_score_gemma":0.0044037406,"teacher_disagreement_score":0.037529938,"about_ca_system_score_codex":0.0019020367,"about_ca_system_score_gemma":0.0031656118,"threshold_uncertainty_score":0.12555015},"labels":[],"label_agreement":null},{"id":"W1995233261","doi":"10.1080/02664760050173300","title":"Unequal probability sampling in fixed area plots of stem volume with and without prior inclusion probabilities","year":2000,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Forest ecology and management","field":"Environmental Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Sport Centre Pacific; Natural Resources Canada","funders":"","keywords":"Statistics; Sampling (signal processing); Mathematics; Stratified sampling; Sample size determination; Sampling design; Poisson sampling; Cluster sampling; Consistency (knowledge bases); Sampling bias; Population; Systematic sampling; Mean squared error; Econometrics; Slice sampling; Importance sampling; Monte Carlo method; Computer science; Demography","score_opus":0.01480942598056659,"score_gpt":0.2243010419601518,"score_spread":0.2094916159795852,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1995233261","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5744833,0.0002115778,0.42154342,0.000055781322,0.0000528591,0.001440014,0.00033463913,0.00044808324,0.0014304176],"genre_scores_gemma":[0.8792249,0.00006000803,0.118188746,0.000083687555,0.000019625882,0.0012906628,0.0005539872,0.00006711876,0.00051139743],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9249868,0.057334635,0.003767366,0.008660576,0.004023781,0.001226908],"domain_scores_gemma":[0.65961426,0.29452574,0.0097480705,0.03017342,0.0048957956,0.0010426767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06256949,0.0007766144,0.0015208747,0.00095116446,0.0007811148,0.0013445152,0.0017476511,0.0013326203,0.0020962749],"category_scores_gemma":[0.19161052,0.00088624685,0.0018001709,0.0012504428,0.0029598202,0.0024066165,0.0031330243,0.0013699281,0.00043231467],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.042813964,0.002377363,0.31566072,0.0014361459,0.0021085138,0.0008071637,0.0047927788,0.2203708,0.041004274,0.027609428,0.0016219591,0.33939692],"study_design_scores_gemma":[0.0014923456,0.013151461,0.23338966,0.00022086549,0.001448854,0.0008667606,0.00058914314,0.65092915,0.059683286,0.033114307,0.0047966186,0.00031759817],"about_ca_topic_score_codex":0.002420765,"about_ca_topic_score_gemma":0.0032817493,"teacher_disagreement_score":0.06256949,"about_ca_system_score_codex":0.00087338476,"about_ca_system_score_gemma":0.0007163092,"threshold_uncertainty_score":0.330903},"labels":[],"label_agreement":null},{"id":"W2001217603","doi":"10.1080/02664760050120588","title":"Detecting excessive similarity in answers on multiple choice exams","year":2000,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Academic integrity and plagiarism","field":"Social Sciences","cited_by":72,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Cheating; False accusation; Bonferroni correction; Simple (philosophy); Computer science; Econometrics; Similarity (geometry); Statistics; Mathematics; Artificial intelligence; Psychology; Social psychology; Epistemology","score_opus":0.022900217674808723,"score_gpt":0.30883947224276775,"score_spread":0.28593925456795904,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2001217603","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.96534824,0.0011491129,0.009346758,0.0011586978,0.00022298313,0.0002688667,0.0076529905,0.0008711854,0.0139810955],"genre_scores_gemma":[0.9660235,0.00037244847,0.016556384,0.00020091553,0.00026944352,0.00013248346,0.0087270895,0.00017893927,0.0075387275],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9909984,0.0028694153,0.0013496327,0.0010792629,0.0033117558,0.00039169608],"domain_scores_gemma":[0.9105627,0.057296555,0.012325587,0.0048768544,0.012344903,0.0025934135],"candidate_categories":["research_integrity"],"consensus_categories":[],"category_scores_codex":[0.0058572115,0.00038995093,0.0010625664,0.009899152,0.0010312796,0.002063303,0.0009246392,0.0015356957,0.015086105],"category_scores_gemma":[0.09742379,0.00026279246,0.00042621192,0.0060004946,0.00043908868,0.0015308631,0.0022301865,0.0007199744,0.0034406995],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002738097,0.00088982604,0.5677499,0.0012207021,0.00028166603,0.0010788789,0.0031101876,0.0008393311,0.012447343,0.004498202,0.041349523,0.3637963],"study_design_scores_gemma":[0.00027692106,0.0011621126,0.89581585,0.0004439971,0.00025394603,0.0030701181,0.0036478362,0.013497433,0.021394068,0.01135849,0.048962507,0.000116697745],"about_ca_topic_score_codex":0.0012648784,"about_ca_topic_score_gemma":0.0026003479,"teacher_disagreement_score":0.9984643,"about_ca_system_score_codex":0.0007387597,"about_ca_system_score_gemma":0.00082495436,"threshold_uncertainty_score":0.050468087},"labels":[],"label_agreement":null},{"id":"W2002579858","doi":"10.1080/02664763.2011.580336","title":"A spatial random-effects model for interzone flows: commuting in Northern Ireland","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Urban Transport and Accessibility","field":"Social Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Econometrics; Variable (mathematics); Estimation; Geography; Latent variable; Mathematics; Statistics; Computer science; Economics","score_opus":0.03238235178081022,"score_gpt":0.29100531848409006,"score_spread":0.25862296670327983,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2002579858","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5226045,0.0012695086,0.44642156,0.0039791428,0.00041298915,0.0013291845,0.011276724,0.0011769668,0.011529436],"genre_scores_gemma":[0.9077523,0.00089221064,0.0499696,0.00025703985,0.000119150514,0.0019282458,0.0039447863,0.00011245797,0.03502414],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99202514,0.004888176,0.00033183408,0.0016397216,0.00033731855,0.0007778807],"domain_scores_gemma":[0.9917368,0.0053593535,0.00096507964,0.000890519,0.0007849881,0.00026319802],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011001035,0.0010967766,0.0024706584,0.002613616,0.0011020871,0.0028202503,0.0050790105,0.002666281,0.010518996],"category_scores_gemma":[0.011803928,0.0013340298,0.004007346,0.0028312572,0.0027061314,0.0020408547,0.002930274,0.0026923069,0.0017696281],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013443414,0.00058134005,0.07140966,0.00030976813,0.0010164842,0.000958263,0.0019489648,0.77384907,0.0006597801,0.11266213,0.0050559845,0.030204201],"study_design_scores_gemma":[0.00044627846,0.0004969863,0.01999721,0.0001271435,0.0004933223,0.00023607533,0.0009940502,0.93223745,0.00027453125,0.036805198,0.0076840487,0.0002077447],"about_ca_topic_score_codex":0.16606688,"about_ca_topic_score_gemma":0.09941189,"teacher_disagreement_score":0.16606688,"about_ca_system_score_codex":0.0049157604,"about_ca_system_score_gemma":0.0037246996,"threshold_uncertainty_score":0.33020055},"labels":[],"label_agreement":null},{"id":"W2007805548","doi":"10.1080/0266476032000075976","title":"Impact evaluation of job training programmes: Selection bias in multilevel models","year":2003,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Regione Lombardia; Memorial University of Newfoundland","keywords":"Selection (genetic algorithm); Multilevel model; Computer science; Selection bias; Observational study; Propensity score matching; Set (abstract data type); Hierarchical database model; Random effects model; Sample (material); Sample size determination; Statistics; Econometrics; Machine learning; Data mining; Mathematics; Meta-analysis","score_opus":0.47239335593781373,"score_gpt":0.4972340829281534,"score_spread":0.02484072699033968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2007805548","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5726318,0.008547816,0.3941671,0.005733388,0.00039916,0.0021919534,0.0018336738,0.00029431202,0.014200925],"genre_scores_gemma":[0.96654797,0.00071745855,0.030561022,0.00025871687,0.00013172606,0.0007497323,0.00033187922,0.00003665307,0.00066485535],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.83525366,0.14906038,0.0027965966,0.002544148,0.008716521,0.0016285565],"domain_scores_gemma":[0.6629124,0.30563176,0.014733581,0.012494062,0.003027301,0.0012008657],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09885072,0.0010391121,0.0024346705,0.0030357463,0.00078193995,0.002687308,0.0016935484,0.0020250615,0.0049549234],"category_scores_gemma":[0.25382552,0.00040715528,0.003575602,0.0034853779,0.0020853062,0.0027276704,0.004457266,0.0021842935,0.0002539769],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011289763,0.001892728,0.27469483,0.0044353055,0.016761422,0.0006591993,0.0022050973,0.21487965,0.001862516,0.12580025,0.0033679751,0.34215128],"study_design_scores_gemma":[0.0019391435,0.010172548,0.2317738,0.0014970707,0.009803337,0.00035907942,0.0017053701,0.51763666,0.0062004495,0.21161991,0.0069967597,0.0002959473],"about_ca_topic_score_codex":0.0029985968,"about_ca_topic_score_gemma":0.0022235084,"teacher_disagreement_score":0.09885072,"about_ca_system_score_codex":0.0022304729,"about_ca_system_score_gemma":0.0019181845,"threshold_uncertainty_score":0.5227788},"labels":[],"label_agreement":null},{"id":"W2009166315","doi":"10.1080/02664760902914482","title":"Inference on <i>C</i> <sub>pk</sub> for autocorrelated data in the presence of random measurement errors","year":2009,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Windsor","keywords":"Autocorrelation; Estimator; Autoregressive model; Observational error; Statistics; Econometrics; Sampling (signal processing); Mathematics; Computer science","score_opus":0.1962317579989197,"score_gpt":0.4289423317052731,"score_spread":0.23271057370635342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2009166315","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10924526,0.00060853164,0.88859755,0.00035964657,0.000058794507,0.000051136005,0.00016122339,0.00020137898,0.0007164688],"genre_scores_gemma":[0.8690268,0.001158311,0.12728652,0.0003630969,0.00024744793,0.00011932571,0.0006994105,0.00010862026,0.0009904815],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9937137,0.003189841,0.00045319897,0.0015352578,0.0007923213,0.00031563707],"domain_scores_gemma":[0.73460513,0.23741671,0.014032771,0.008709003,0.004291264,0.0009451145],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024697723,0.0007817511,0.0017938679,0.0021974277,0.00056194747,0.0024950267,0.0023686984,0.002096646,0.0012229518],"category_scores_gemma":[0.15591109,0.00074494485,0.0010609849,0.0022615036,0.0033020459,0.0031162628,0.0012669247,0.0023486766,0.000314301],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006761814,0.00031539242,0.12419908,0.0009092865,0.0011575312,0.0012520768,0.000788639,0.5509764,0.005266938,0.15939799,0.0028202652,0.1522402],"study_design_scores_gemma":[0.00005177598,0.00020303775,0.015423262,0.00017049849,0.00016150357,0.00046777914,0.00017018172,0.8940068,0.0036974936,0.08455126,0.0010102718,0.00008609146],"about_ca_topic_score_codex":0.00308201,"about_ca_topic_score_gemma":0.0017323955,"teacher_disagreement_score":0.024697723,"about_ca_system_score_codex":0.00095920294,"about_ca_system_score_gemma":0.0017267204,"threshold_uncertainty_score":0.13061559},"labels":[],"label_agreement":null},{"id":"W2010794591","doi":"10.1080/02664760701592992","title":"A Stylometric Analysis of King Alfred's Literary Works","year":2007,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Authorship Attribution and Profiling","field":"Computer Science","cited_by":12,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Actua; Simon Fraser University; University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; University of Newcastle Australia","keywords":"Computer science; Perspective (graphical); Subject (documents); Stylometry; Simple (philosophy); Key (lock); Bayesian probability; Artificial intelligence; Linguistics; Natural language processing; Epistemology; Philosophy; Library science","score_opus":0.021858001564333224,"score_gpt":0.29520584941709904,"score_spread":0.27334784785276584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2010794591","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9636139,0.0007234372,0.0051954365,0.0005389866,0.000056424928,0.000077521036,0.0009444415,0.00007331905,0.028776487],"genre_scores_gemma":[0.9962374,0.00023352762,0.0015468765,0.000012134303,0.000043327986,0.000022902159,0.00038986746,0.000011818334,0.0015021145],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99624336,0.0011312575,0.00042592784,0.00036491122,0.0015984448,0.00023618131],"domain_scores_gemma":[0.97357553,0.016889822,0.003643329,0.0015362226,0.003809901,0.0005452712],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003119166,0.00020077584,0.00036130613,0.029864686,0.0021696514,0.0034873395,0.00039947729,0.000380964,0.0030073065],"category_scores_gemma":[0.030419853,0.0001429745,0.00024071493,0.027012574,0.0025389884,0.0015354246,0.0019032203,0.00033873782,0.00076968677],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004989447,0.0001392049,0.4476974,0.0007324171,0.00014437162,0.001580513,0.13506691,0.0039262245,0.007948754,0.10974844,0.01212703,0.28038982],"study_design_scores_gemma":[0.000014326607,0.00014515274,0.78087336,0.00028696095,0.00005992909,0.0013436276,0.08300528,0.016958944,0.003748188,0.030512087,0.08294519,0.000106897125],"about_ca_topic_score_codex":0.0036756927,"about_ca_topic_score_gemma":0.004702086,"teacher_disagreement_score":0.029864686,"about_ca_system_score_codex":0.0023101377,"about_ca_system_score_gemma":0.0007501338,"threshold_uncertainty_score":0.016761303},"labels":[],"label_agreement":null},{"id":"W2012214625","doi":"10.1080/02664761003692449","title":"Bayesian–frequentist hybrid model with application to the analysis of gene copy number changes","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Genomic variations and chromosomal abnormalities","field":"Biochemistry, Genetics and Molecular Biology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"National Center for Research Resources; National Institutes of Health","keywords":"Frequentist inference; Bayesian probability; Computer science; Comparative genomic hybridization; Data mining; Bayesian inference; Artificial intelligence; Machine learning; Genome; Biology; Genetics; Gene","score_opus":0.009908883366534903,"score_gpt":0.22534686292090342,"score_spread":0.21543797955436852,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2012214625","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018023113,0.00055820454,0.97882986,0.00053817977,0.000060325223,0.00007899772,0.00015431657,0.0002673547,0.001489722],"genre_scores_gemma":[0.5464771,0.0011671028,0.44140643,0.00043669922,0.00030923984,0.0008462266,0.0007447689,0.00015766997,0.008454844],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99766266,0.0014340967,0.000078239485,0.0003503476,0.00033486256,0.00013976287],"domain_scores_gemma":[0.9897317,0.008739433,0.00040588665,0.00020832312,0.0007591238,0.00015557006],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061084456,0.0008806239,0.0023523835,0.0015627927,0.00093308755,0.0016601755,0.0026022568,0.0023740623,0.0034632967],"category_scores_gemma":[0.01218225,0.000783928,0.0018881012,0.0016363318,0.0014891068,0.0014131657,0.0012860383,0.0021589273,0.00054183445],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002044772,0.00007887969,0.002491166,0.00012358885,0.0003079226,0.00029522547,0.00020827883,0.89703244,0.00061919785,0.05731983,0.0014218134,0.039897066],"study_design_scores_gemma":[0.000015310852,0.000023209444,0.00024878274,0.000005473797,0.000018918443,0.000041351443,0.000009439958,0.98117995,0.000071212155,0.017910028,0.00045951703,0.00001670617],"about_ca_topic_score_codex":0.011780114,"about_ca_topic_score_gemma":0.007981521,"teacher_disagreement_score":0.011780114,"about_ca_system_score_codex":0.0013135392,"about_ca_system_score_gemma":0.0012717043,"threshold_uncertainty_score":0.032304943},"labels":[],"label_agreement":null},{"id":"W2018100203","doi":"10.1080/02664760120074951","title":"Economic design of X charts with variable parameters: The Markov chain approach","year":2001,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":88,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Fundação de Amparo à Pesquisa do Estado de São Paulo","keywords":"Control chart; Control limits; Markov chain; Statistics; Variable (mathematics); Sampling (signal processing); Statistical process control; Sample size determination; Mathematics; Exponential distribution; Interval (graph theory); Limit (mathematics); Computer science; Mathematical optimization; Process (computing)","score_opus":0.08370642413956754,"score_gpt":0.3382596461692194,"score_spread":0.25455322202965186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2018100203","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030798107,0.0003884302,0.96647936,0.000210648,0.000029906681,0.00026496823,0.00004772761,0.00020886106,0.001572095],"genre_scores_gemma":[0.81516385,0.00067042187,0.1820727,0.00011979924,0.000084488565,0.0005647796,0.000087583,0.000056914927,0.001179479],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9885493,0.008332699,0.0002987814,0.0009693392,0.0012322696,0.00061766175],"domain_scores_gemma":[0.96074426,0.031653382,0.0039350125,0.0012513633,0.0017429295,0.0006730202],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01640938,0.001253286,0.0019608308,0.0014244933,0.00072824577,0.0020829004,0.0015201726,0.0012376215,0.0023942762],"category_scores_gemma":[0.031337034,0.0011620685,0.0010503663,0.00093706464,0.0019956222,0.0033767216,0.0014902771,0.0015915032,0.00021564202],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005977491,0.0000971921,0.0012749651,0.000119672884,0.00008570158,0.00008168691,0.000080517326,0.8927071,0.0014644329,0.07796694,0.000296838,0.025227152],"study_design_scores_gemma":[0.00011409927,0.0003397045,0.00045020878,0.000027106717,0.000036536097,0.000021945869,0.00001907376,0.97370064,0.0011519404,0.023492415,0.00061267463,0.00003373167],"about_ca_topic_score_codex":0.0031142726,"about_ca_topic_score_gemma":0.0016769752,"teacher_disagreement_score":0.01640938,"about_ca_system_score_codex":0.0023411133,"about_ca_system_score_gemma":0.0027136751,"threshold_uncertainty_score":0.08678216},"labels":[],"label_agreement":null},{"id":"W2026793228","doi":"10.1080/02664763.2010.545374","title":"A segmented regime-switching model with its application to stock market indices","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Market Dynamics and Volatility","field":"Economics, Econometrics and Finance","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada; University of Otago","keywords":"Econometrics; Stock market; Stock market index; Volatility (finance); Stock (firearms); Markov chain; Index (typography); Economics; Computer science; Mathematics; Statistics; Geography","score_opus":0.02894789656705783,"score_gpt":0.22642639733573133,"score_spread":0.19747850076867351,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2026793228","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17774837,0.00042243753,0.8170574,0.00038678583,0.00007589043,0.00007493621,0.00020668934,0.00044712226,0.0035804145],"genre_scores_gemma":[0.9534805,0.00029934922,0.043560512,0.00006452456,0.00006118928,0.00011273424,0.00023998169,0.00004059807,0.0021406608],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99946564,0.00024038846,0.00002576763,0.00010867071,0.00008569622,0.00007391754],"domain_scores_gemma":[0.9963683,0.0027480398,0.00033799242,0.00019409956,0.00023437495,0.00011719949],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024616788,0.00055812026,0.0008834149,0.0008053055,0.00042766606,0.00092378556,0.0010519741,0.0010679298,0.0019764446],"category_scores_gemma":[0.0084050335,0.00030232305,0.0009817914,0.00077731966,0.0008351273,0.0011450938,0.00068074703,0.00095912983,0.00023823691],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013985008,0.000097367665,0.005076899,0.000059485723,0.00008893388,0.00015187691,0.00018582918,0.9227999,0.0013151043,0.051087096,0.0007289675,0.018268805],"study_design_scores_gemma":[0.0000041541066,0.00001594862,0.0002682758,0.0000020850166,0.0000051244783,0.000013531584,0.0000049210244,0.9939839,0.000056648776,0.005520737,0.000119954966,0.0000047822],"about_ca_topic_score_codex":0.006712019,"about_ca_topic_score_gemma":0.003125854,"teacher_disagreement_score":0.006712019,"about_ca_system_score_codex":0.00073782966,"about_ca_system_score_gemma":0.0006609959,"threshold_uncertainty_score":0.013345897},"labels":[],"label_agreement":null},{"id":"W2028104463","doi":"10.1080/0266476042000285503","title":"Monitoring Process Mean and Variability with One Non-central Chi-square Chart","year":2004,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":71,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico","keywords":"EWMA chart; Control chart; Chart; Statistics; Statistic; X-bar chart; Process (computing); Statistical process control; Mathematics; Control limits; Computer science","score_opus":0.05249982508359512,"score_gpt":0.3654536126362057,"score_spread":0.31295378755261055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2028104463","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04241503,0.00039424497,0.95263106,0.00009881083,0.00011138573,0.00016874509,0.00023351982,0.0027758959,0.0011713684],"genre_scores_gemma":[0.6079903,0.0004397677,0.38900706,0.0001019881,0.00018724041,0.0003371475,0.0005663094,0.00027160227,0.0010985279],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9916176,0.0029277485,0.00061087694,0.0018326205,0.002733361,0.00027775476],"domain_scores_gemma":[0.9529373,0.025617218,0.00637386,0.0045646317,0.0099192085,0.00058782846],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01032213,0.0015657977,0.0023312722,0.0033550092,0.0008527031,0.0024438668,0.001299154,0.0012221675,0.0014647557],"category_scores_gemma":[0.042601034,0.00038907424,0.0010343313,0.0028143667,0.0013031772,0.00220025,0.0010200576,0.0016810098,0.00043047155],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002558052,0.0006450853,0.053834658,0.001063146,0.00069161033,0.00077410974,0.0010960271,0.2728063,0.045577668,0.02670818,0.0057929917,0.5884522],"study_design_scores_gemma":[0.00011499518,0.0009401296,0.023345718,0.00006228856,0.00017807083,0.00047456354,0.00010739408,0.9364079,0.028420653,0.006814253,0.0028404407,0.00029360203],"about_ca_topic_score_codex":0.0036914411,"about_ca_topic_score_gemma":0.002091979,"teacher_disagreement_score":0.01032213,"about_ca_system_score_codex":0.0008480456,"about_ca_system_score_gemma":0.0016630151,"threshold_uncertainty_score":0.05458927},"labels":[],"label_agreement":null},{"id":"W2037011349","doi":"10.1080/02664763.2014.960372","title":"A multiple imputation approach to nonlinear mixed-effects models with covariate measurement errors and missing values","year":2014,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"National Natural Science Foundation of China","keywords":"Covariate; Imputation (statistics); Missing data; Markov chain Monte Carlo; Statistics; Computer science; Gibbs sampling; Econometrics; Observational error; Markov chain; Monte Carlo method; Mathematics; Bayesian probability","score_opus":0.07023764708469796,"score_gpt":0.3212560569575242,"score_spread":0.2510184098728262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037011349","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00040465494,0.0002320518,0.9988757,0.00013941649,0.000041224877,0.000033976117,0.00006261298,0.00007944932,0.00013086181],"genre_scores_gemma":[0.03667961,0.0009818295,0.95889574,0.00031388996,0.00026857544,0.00058392156,0.00047463586,0.00010975731,0.0016919767],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9855297,0.01121391,0.0005465684,0.0014837412,0.0009951446,0.00023100397],"domain_scores_gemma":[0.98757195,0.009448528,0.0008214463,0.0010133849,0.00094590546,0.00019873731],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01720132,0.0014359847,0.0030252724,0.0018412541,0.0012851238,0.0016708107,0.0059830775,0.0024882876,0.003839059],"category_scores_gemma":[0.03471332,0.0011963181,0.0041636475,0.0044247448,0.0011670381,0.0023707568,0.002687542,0.0045471624,0.001138225],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023471279,0.00017082413,0.0060742972,0.0011985911,0.0019343864,0.0010089497,0.00090884045,0.2452584,0.0014349621,0.4434046,0.009503669,0.2888677],"study_design_scores_gemma":[0.00008955204,0.00010458518,0.00075016264,0.00014676151,0.00032951505,0.00040494668,0.00006141577,0.7231028,0.00051603524,0.2620661,0.012333998,0.00009405446],"about_ca_topic_score_codex":0.006564924,"about_ca_topic_score_gemma":0.008891502,"teacher_disagreement_score":0.01720132,"about_ca_system_score_codex":0.0012779861,"about_ca_system_score_gemma":0.0032980884,"threshold_uncertainty_score":0.09097034},"labels":[],"label_agreement":null},{"id":"W2039859119","doi":"10.1080/0266476032000076056","title":"Exact prediction intervals for exponential distributions based on doubly Type-II censored samples","year":2003,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Order statistic; Mathematics; Exponential function; Statistics; Statistic; Inference; Type (biology); Exponential distribution; Applied mathematics; Exponential type; Sample size determination; Sample (material); Sufficient statistic; Computer science; Mathematical analysis","score_opus":0.07057935865896448,"score_gpt":0.3541304357021198,"score_spread":0.2835510770431553,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2039859119","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011375994,0.00030893576,0.987084,0.00005474299,0.000027997046,0.000046422967,0.000080461075,0.00022191157,0.00079955964],"genre_scores_gemma":[0.38201204,0.0008706488,0.6135966,0.00017241578,0.00015557095,0.0005299927,0.0010817058,0.00021831218,0.0013627802],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99147075,0.0043915794,0.00045665313,0.0011224386,0.0021747279,0.00038380697],"domain_scores_gemma":[0.8879537,0.09583253,0.004561573,0.0073256,0.0036984433,0.0006280841],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01734916,0.0008111518,0.0018054293,0.0028112505,0.00059912313,0.0021228741,0.0031824457,0.0011394363,0.0045745526],"category_scores_gemma":[0.14182484,0.0005894096,0.0009362668,0.0018144007,0.0020041277,0.0051494488,0.001986492,0.00349717,0.0009906315],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008411527,0.0001579215,0.010108337,0.0003934039,0.00016999342,0.000528738,0.0010252674,0.312401,0.0026131268,0.37364376,0.0026451678,0.29547217],"study_design_scores_gemma":[0.0000904574,0.00015500569,0.0026978538,0.00016453555,0.000035557052,0.00033759262,0.00012111501,0.7022655,0.0032412154,0.28771743,0.003084143,0.00008952521],"about_ca_topic_score_codex":0.001014712,"about_ca_topic_score_gemma":0.0007360658,"teacher_disagreement_score":0.01734916,"about_ca_system_score_codex":0.0009958057,"about_ca_system_score_gemma":0.00091621286,"threshold_uncertainty_score":0.09175217},"labels":[],"label_agreement":null},{"id":"W2047584164","doi":"10.1080/02664763.2011.632404","title":"Two-step and likelihood methods for HIV viral dynamic models with covariate measurement errors and missing data","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; York University","funders":"","keywords":"Covariate; Missing data; Autocorrelation; Statistics; Econometrics; Computer science; Standard error; Mathematics","score_opus":0.09824906713412437,"score_gpt":0.3427253060192883,"score_spread":0.24447623888516393,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047584164","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00057385635,0.00020563416,0.9988129,0.00010185067,0.000022163442,0.000037616563,0.00003911437,0.00008931979,0.00011740125],"genre_scores_gemma":[0.03137535,0.0008271966,0.9639377,0.00016246719,0.000131982,0.00096161495,0.0004232484,0.00021625352,0.0019642527],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98824126,0.009606634,0.0003224617,0.0006555836,0.0010160242,0.00015807823],"domain_scores_gemma":[0.9491949,0.04477755,0.0016928562,0.002475197,0.0014972865,0.00036222863],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.020983275,0.0015667322,0.0022339171,0.0026077924,0.0009240545,0.0015754439,0.0049814256,0.003085289,0.005578116],"category_scores_gemma":[0.08222451,0.0014940782,0.0027921228,0.0032566322,0.0021438652,0.0034516896,0.003529315,0.005194079,0.0018310071],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027081903,0.00019187403,0.0030143678,0.0007256802,0.0006166311,0.00040715805,0.00066238816,0.17726606,0.0013116177,0.58421934,0.0055421223,0.22577198],"study_design_scores_gemma":[0.0000657902,0.000057521633,0.0006303622,0.00010763553,0.0000653276,0.00016353776,0.000046062,0.7054457,0.0005851755,0.28672388,0.006037156,0.0000718146],"about_ca_topic_score_codex":0.0034133173,"about_ca_topic_score_gemma":0.0045038923,"teacher_disagreement_score":0.020983275,"about_ca_system_score_codex":0.0011927321,"about_ca_system_score_gemma":0.00278326,"threshold_uncertainty_score":0.11097151},"labels":[],"label_agreement":null},{"id":"W2052304942","doi":"10.1080/02664760903406488","title":"Optimal design of accelerated degradation tests based on Wiener process models","year":2010,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Reliability and Maintenance Optimization","field":"Engineering","cited_by":170,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"","keywords":"Quantile; Wiener process; Estimator; Mathematics; Robustness (evolution); Delta method; Statistics; Random variable; Sensitivity (control systems); Mathematical optimization; Range (aeronautics); Computer science; Applied mathematics; Engineering","score_opus":0.019967688203337306,"score_gpt":0.2430872403094555,"score_spread":0.2231195521061182,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2052304942","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.085544154,0.00040722097,0.9108085,0.000103380495,0.00002201316,0.00016037833,0.000051336116,0.00025085275,0.002652152],"genre_scores_gemma":[0.9211235,0.00018436571,0.077086106,0.000029575045,0.000012488086,0.0002939022,0.000058172467,0.000033404744,0.001178474],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99847466,0.00061704445,0.00006653101,0.00024459534,0.00037974896,0.00021747833],"domain_scores_gemma":[0.99733424,0.0015360774,0.00053879543,0.00008691273,0.00037721102,0.00012676156],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023368406,0.0011998793,0.0014843626,0.0010098832,0.0003400933,0.0012190668,0.0008862186,0.00082708,0.0010839723],"category_scores_gemma":[0.0049103517,0.00082907075,0.00067431584,0.00051030633,0.0010018799,0.001037478,0.00092681916,0.000825298,0.0001999715],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016314322,0.000039862134,0.00030191286,0.00003464323,0.000021516256,0.00003404121,0.000028397802,0.9808851,0.0034043859,0.0034967442,0.00008837925,0.011501918],"study_design_scores_gemma":[0.000024836801,0.00020637171,0.00026785836,0.000007965726,0.000014189178,0.000011470819,0.000011242004,0.9945368,0.0019689975,0.0027209017,0.00021917492,0.000010137242],"about_ca_topic_score_codex":0.0014427712,"about_ca_topic_score_gemma":0.0011635824,"teacher_disagreement_score":0.0023368406,"about_ca_system_score_codex":0.000998286,"about_ca_system_score_gemma":0.0013532232,"threshold_uncertainty_score":0.012358546},"labels":[],"label_agreement":null},{"id":"W2059933233","doi":"10.1080/02664763.2014.962490","title":"Application of skew-normal distribution for detecting differential expression to microRNA data","year":2014,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"MicroRNA in disease regulation","field":"Biochemistry, Genetics and Molecular Biology","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Pharma Medica Research (Canada)","funders":"","keywords":"Outlier; Statistic; Statistics; Skewness; Normal distribution; Mathematics; Normality; Context (archaeology); Skew; Skew normal distribution; Wald test; Identification (biology); Test statistic; Statistical hypothesis testing; Computer science; Biology","score_opus":0.010821660928917624,"score_gpt":0.2710627005506191,"score_spread":0.2602410396217015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2059933233","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04149659,0.00024467942,0.9550814,0.000194515,0.00011284494,0.0004661284,0.0004527969,0.0012013731,0.00074970437],"genre_scores_gemma":[0.44469863,0.00036122254,0.5497195,0.00041661778,0.00015683753,0.0022853243,0.0013473111,0.00038255122,0.00063189614],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9735248,0.016404456,0.0023387454,0.003566341,0.003564785,0.0006008941],"domain_scores_gemma":[0.86493194,0.10841125,0.007921633,0.00986064,0.00788147,0.0009930526],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04426382,0.001176942,0.0021697155,0.0038098437,0.0012382116,0.0020262876,0.0017334356,0.00206283,0.0034010122],"category_scores_gemma":[0.1525916,0.0005213649,0.002132902,0.003497361,0.0037412453,0.0034157773,0.0020142943,0.00316287,0.0008175109],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029511105,0.0005887534,0.15376988,0.0018281578,0.0012991774,0.003487615,0.0030260207,0.18159468,0.032961693,0.15897155,0.01034163,0.4491797],"study_design_scores_gemma":[0.00024520847,0.0014087122,0.021314533,0.00024470294,0.00018601342,0.0019040018,0.00075621775,0.8086998,0.020080218,0.1353786,0.009496138,0.0002858601],"about_ca_topic_score_codex":0.0012006995,"about_ca_topic_score_gemma":0.00088355754,"teacher_disagreement_score":0.04426382,"about_ca_system_score_codex":0.0013436895,"about_ca_system_score_gemma":0.002384532,"threshold_uncertainty_score":0.2340923},"labels":[],"label_agreement":null},{"id":"W2063301308","doi":"10.1080/02664760802124455","title":"Statistical inference for start-up demonstration tests with rejection of units upon observing<i>d</i>failures","year":2008,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Chinese University of Hong Kong; University of Hong Kong","keywords":"Inference; Estimator; Statistical inference; Likelihood function; Computer science; Bayesian probability; Statistics; Bayesian inference; Maximum likelihood; Expectation–maximization algorithm; Mathematics; Sample (material); Econometrics; Artificial intelligence","score_opus":0.4423127721272717,"score_gpt":0.48979964912010265,"score_spread":0.04748687699283094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2063301308","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032378096,0.000849468,0.9644337,0.0007633551,0.00007148713,0.00023711345,0.00019440778,0.0002535512,0.00081879576],"genre_scores_gemma":[0.62715304,0.0009514831,0.36521268,0.0008469318,0.0003615823,0.0018160715,0.0007645936,0.00020519005,0.0026884011],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.94898814,0.03916876,0.0017814486,0.004858549,0.004133516,0.0010696701],"domain_scores_gemma":[0.4683073,0.5027481,0.013784889,0.010823139,0.003086045,0.0012506023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10208845,0.001458393,0.0050250418,0.0024836985,0.0008387299,0.0028207814,0.0048047975,0.0038415492,0.004824151],"category_scores_gemma":[0.4220527,0.0010332862,0.0023133208,0.002559204,0.0056098904,0.0056010527,0.0029585862,0.0064806263,0.0006660104],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005819731,0.0005188459,0.046387956,0.001342249,0.0024734915,0.0032191111,0.0014300967,0.15382507,0.0032512536,0.5061732,0.0062713586,0.26928765],"study_design_scores_gemma":[0.00062864553,0.0009222566,0.009868012,0.00027689635,0.00047733018,0.00086492783,0.0002026725,0.6874549,0.0030932662,0.2933544,0.0027085983,0.00014812786],"about_ca_topic_score_codex":0.0016613639,"about_ca_topic_score_gemma":0.00080773485,"teacher_disagreement_score":0.10208845,"about_ca_system_score_codex":0.0014066416,"about_ca_system_score_gemma":0.0020229493,"threshold_uncertainty_score":0.5399018},"labels":[],"label_agreement":null},{"id":"W2064981318","doi":"10.1080/02664763.2012.740620","title":"Heterogeneity of variance and biased hypothesis tests","year":2012,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Modeling Techniques","field":"Computer Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Type I and type II errors; Statistics; Mathematics; Variance (accounting); Sample size determination; Statistical power; Normal distribution; Analysis of variance; F-test of equality of variances; Statistical hypothesis testing; Econometrics; Test statistic","score_opus":0.039078554075293384,"score_gpt":0.29527450327084737,"score_spread":0.256195949195554,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2064981318","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.11948057,0.007838894,0.8517353,0.0049057906,0.0015891852,0.00284807,0.0006040959,0.000603755,0.010394288],"genre_scores_gemma":[0.88773996,0.000983281,0.10350715,0.0025561056,0.000882558,0.002645949,0.00038383235,0.00029740113,0.0010037546],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.42695725,0.4450204,0.029764442,0.040186126,0.054085605,0.003986256],"domain_scores_gemma":[0.046146154,0.89992684,0.02390982,0.02290456,0.006580313,0.0005323239],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.433401,0.0017742536,0.003397076,0.0056857127,0.0016548708,0.0045073424,0.0041553774,0.004691307,0.0038778046],"category_scores_gemma":[0.81730026,0.0011740184,0.0042817444,0.004524173,0.0086525865,0.0074681435,0.0050086137,0.006303298,0.0004830564],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00630883,0.00077681005,0.26051456,0.005188666,0.016573654,0.005903064,0.013617538,0.04931706,0.0049510878,0.28828388,0.011603399,0.33696148],"study_design_scores_gemma":[0.0015738872,0.0036163246,0.09366008,0.0027576075,0.005200953,0.006887654,0.0029807037,0.13885304,0.0151697425,0.7109499,0.017533384,0.000816751],"about_ca_topic_score_codex":0.0010191037,"about_ca_topic_score_gemma":0.0008858762,"teacher_disagreement_score":0.566599,"about_ca_system_score_codex":0.0038518342,"about_ca_system_score_gemma":0.0027888904,"threshold_uncertainty_score":0.6987175},"labels":[],"label_agreement":null},{"id":"W2065171914","doi":"10.1080/02664760701234967","title":"Sample-based Maximum Likelihood Estimation of the Autologistic Model","year":2007,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Stochastic processes and statistical mechanics","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Resources Canada; Canadian Forest Service","funders":"","keywords":"Statistics; Mathematics; Sample size determination; Markov chain Monte Carlo; Sample variance; Sampling (signal processing); Monte Carlo method; Estimation theory; Variance (accounting); Computer science","score_opus":0.03630332767794559,"score_gpt":0.31901511875813093,"score_spread":0.28271179108018535,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065171914","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03124687,0.00007229744,0.9678132,0.00005773572,0.000007637897,0.00002353576,0.000059997354,0.0002942505,0.00042447637],"genre_scores_gemma":[0.4225176,0.00010556106,0.5758324,0.00005941565,0.000019399795,0.00020087656,0.00043999404,0.00017439666,0.000650344],"study_design_codex":"simulation_or_modeling","study_design_gemma":"not_applicable","domain_scores_codex":[0.99793315,0.001355365,0.00006134897,0.00021664434,0.0003668833,0.000066549226],"domain_scores_gemma":[0.9838307,0.013189078,0.0005616198,0.00138805,0.00091267505,0.00011776347],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043624896,0.00036991888,0.000901041,0.0009088689,0.00040948257,0.0009484599,0.0016569124,0.00071545166,0.0015228377],"category_scores_gemma":[0.03249737,0.00051295833,0.00058137364,0.000788009,0.0010765002,0.0016183963,0.0010135603,0.0015058309,0.0004434752],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012998356,0.00006331806,0.0041351477,0.00010166861,0.00006983749,0.00006204082,0.00016395349,0.8579289,0.004309987,0.057753187,0.0009472676,0.07433476],"study_design_scores_gemma":[0.000009695422,0.000007837243,0.0004352864,0.0000036122678,0.0000035137607,0.000020812735,0.000006516851,0.9839792,0.0007102979,0.014624616,0.00018985532,0.0000087426515],"about_ca_topic_score_codex":0.0029414908,"about_ca_topic_score_gemma":0.0028236506,"teacher_disagreement_score":0.0043624896,"about_ca_system_score_codex":0.0010354064,"about_ca_system_score_gemma":0.0010579989,"threshold_uncertainty_score":0.023071349},"labels":[],"label_agreement":null},{"id":"W2067267828","doi":"10.1080/02664760500449170","title":"A note comparing component-slope, Scheffé and Cox parameterizations of the linear mixture experiment model","year":2006,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Pacific Northwest National Laboratory; Simon Fraser University","keywords":"Component (thermodynamics); Mixture model; Linear model; Statistics; Mathematics; Thermodynamics; Physics","score_opus":0.08472300885455115,"score_gpt":0.39775683772838866,"score_spread":0.3130338288738375,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2067267828","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042171893,0.00095305976,0.9905545,0.0008825982,0.00036979117,0.00035707274,0.000204811,0.00046537814,0.0019956871],"genre_scores_gemma":[0.08437477,0.0014621642,0.9057274,0.0013047579,0.00034344645,0.002447503,0.0004987913,0.00042919526,0.0034119599],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.902621,0.076255664,0.0034328662,0.0048639323,0.011823132,0.0010034046],"domain_scores_gemma":[0.70376456,0.2631764,0.00420524,0.016625786,0.011609401,0.0006185899],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.12617992,0.0026373887,0.0030732725,0.002743593,0.0012340735,0.0035782328,0.005890421,0.0037841252,0.004722724],"category_scores_gemma":[0.26533642,0.0013870371,0.0038511117,0.004117114,0.0038588627,0.0072591687,0.0027351088,0.00920122,0.0013735245],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018352411,0.00035113955,0.008586318,0.0008765338,0.0009657719,0.00030412755,0.001098621,0.16871753,0.0032238406,0.5372735,0.020167084,0.2566004],"study_design_scores_gemma":[0.00030171667,0.0009290192,0.006136686,0.00024627135,0.000436765,0.0003636466,0.00034805888,0.58765656,0.004853718,0.35794482,0.040234722,0.00054810225],"about_ca_topic_score_codex":0.0061570024,"about_ca_topic_score_gemma":0.007442632,"teacher_disagreement_score":0.12617992,"about_ca_system_score_codex":0.004050287,"about_ca_system_score_gemma":0.0052156853,"threshold_uncertainty_score":0.6673112},"labels":[],"label_agreement":null},{"id":"W2074553505","doi":"10.1080/02664760903186049","title":"Clustering probability distributions","year":2010,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Cluster analysis; Joint probability distribution; Probability distribution; Computer science; Mathematics; Probability density function; Algorithm; Statistical physics; Data mining; Statistics; Physics","score_opus":0.01810154605205502,"score_gpt":0.29800518970734263,"score_spread":0.27990364365528764,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074553505","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011275623,0.0006525295,0.9811172,0.0003869126,0.000053776723,0.00009080359,0.00030979054,0.0002976435,0.0058156042],"genre_scores_gemma":[0.51999825,0.0037333206,0.45723552,0.00048563775,0.00050500676,0.00075978297,0.0020843048,0.00059716357,0.014601031],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9957515,0.0012031832,0.00022689912,0.0011985508,0.0012680135,0.0003519065],"domain_scores_gemma":[0.9895739,0.0059603993,0.00073041464,0.0013389793,0.0020343654,0.00036199862],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050532618,0.0012623522,0.0016423349,0.0063486933,0.0018775593,0.0040158927,0.0032498566,0.0026578773,0.005400025],"category_scores_gemma":[0.025323853,0.00075236347,0.0014994522,0.0040468317,0.0026531566,0.005260281,0.0025270106,0.002211621,0.0025453374],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008072009,0.000042985484,0.0022632454,0.00022653324,0.00008972787,0.00019994462,0.00047309767,0.1683348,0.002177608,0.7651075,0.0043791244,0.056624707],"study_design_scores_gemma":[0.000016467591,0.00004699074,0.0013215536,0.000118815,0.000044031123,0.00045083094,0.00024024224,0.48586956,0.0023223392,0.49809086,0.011398397,0.00007998671],"about_ca_topic_score_codex":0.0013614531,"about_ca_topic_score_gemma":0.001032174,"teacher_disagreement_score":0.0063486933,"about_ca_system_score_codex":0.0024933787,"about_ca_system_score_gemma":0.000962411,"threshold_uncertainty_score":0.026724577},"labels":[],"label_agreement":null},{"id":"W2074581004","doi":"10.1080/02664760701235279","title":"Describing the Dynamics of Attention to TV Commercials: A Hierarchical Bayes Analysis of the Time to Zap an Ad","year":2007,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Consumer Market Behavior and Pricing","field":"Business, Management and Accounting","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Bayes' theorem; Computer science; Dynamics (music); Bayesian probability; Statistics; Econometrics; Artificial intelligence; Mathematics; Psychology","score_opus":0.030774668382366675,"score_gpt":0.2712812290075166,"score_spread":0.24050656062514994,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2074581004","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.6036427,0.0015334834,0.38598105,0.0027180437,0.000089196255,0.00018128345,0.0015754304,0.00030591103,0.0039729145],"genre_scores_gemma":[0.95789856,0.0006387655,0.034241382,0.00022049266,0.00014690273,0.00015453144,0.0010508357,0.00010553053,0.0055430075],"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","domain_scores_codex":[0.9979457,0.0007864289,0.00009895432,0.00060810003,0.0002165537,0.00034420338],"domain_scores_gemma":[0.953615,0.040214058,0.0029533836,0.0014897177,0.00084997603,0.00087782484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012486735,0.00068209064,0.0020650357,0.0021924514,0.0010032811,0.0024880723,0.0027343442,0.0018113755,0.008680416],"category_scores_gemma":[0.04107106,0.0010515318,0.0019690092,0.0019197646,0.0020422896,0.004415286,0.0014290232,0.0030054543,0.00072406634],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001234568,0.0004469165,0.20438638,0.00049889623,0.0008629424,0.0010569476,0.005347597,0.394849,0.005567742,0.25028303,0.008403954,0.12706202],"study_design_scores_gemma":[0.000048437938,0.00010530403,0.036476016,0.00005791764,0.000120633726,0.00020760992,0.00040433742,0.8843304,0.00033092455,0.076380216,0.0014574628,0.00008071307],"about_ca_topic_score_codex":0.04541074,"about_ca_topic_score_gemma":0.02661465,"teacher_disagreement_score":0.04541074,"about_ca_system_score_codex":0.0025481961,"about_ca_system_score_gemma":0.0015513011,"threshold_uncertainty_score":0.09029287},"labels":[],"label_agreement":null},{"id":"W2077523965","doi":"10.1080/02664763.2010.491861","title":"A modified bootstrap procedure for cluster sampling variance estimation of species richness","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Census and Population Estimation","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Forest Service","funders":"","keywords":"Species richness; Estimator; Statistics; Mathematics; Variance (accounting); Resampling; Cluster sampling; Sampling (signal processing); Econometrics; Computer science; Ecology; Population; Biology","score_opus":0.15004602367404446,"score_gpt":0.35373574263334123,"score_spread":0.20368971895929677,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2077523965","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042438684,0.000047803773,0.99462837,0.000032177413,0.000047007466,0.00014404368,0.00009930435,0.00045986383,0.00029756365],"genre_scores_gemma":[0.053210285,0.000049671977,0.9445722,0.00007711813,0.00007365193,0.00070666283,0.00036122007,0.00026829427,0.00068088656],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9940619,0.0036241584,0.0002556866,0.00068193115,0.0012258475,0.00015042498],"domain_scores_gemma":[0.9864188,0.0071317116,0.00067008816,0.0031917915,0.0024128812,0.00017485797],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0070359767,0.00075331546,0.0011549944,0.0021008623,0.0008163513,0.00056280324,0.0020659803,0.0011084207,0.0042302897],"category_scores_gemma":[0.0403966,0.0005247536,0.0015273155,0.0019576373,0.0008330132,0.00081761996,0.0012498623,0.0017475315,0.0016678609],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061831373,0.00028209074,0.0076677212,0.00040776574,0.0007909639,0.000522397,0.0006182049,0.110700026,0.028217612,0.07519796,0.011589746,0.76338714],"study_design_scores_gemma":[0.00025426387,0.00043920169,0.012523963,0.000113428,0.00022877038,0.0009168549,0.00008886321,0.86398214,0.020446338,0.07275264,0.027999869,0.00025363057],"about_ca_topic_score_codex":0.0023797737,"about_ca_topic_score_gemma":0.0027101068,"teacher_disagreement_score":0.0070359767,"about_ca_system_score_codex":0.000551319,"about_ca_system_score_gemma":0.0012120589,"threshold_uncertainty_score":0.037210226},"labels":[],"label_agreement":null},{"id":"W2086120770","doi":"10.1080/02664760120011563","title":"Prior distribution assessment for a multivariate normal distribution: An experimental study","year":2001,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Kuwait University; Global Institute for Water Security, University of Saskatchewan","keywords":"Multivariate normal distribution; Statistics; Variance (accounting); Multivariate statistics; Distribution (mathematics); Normal distribution; Mathematics; Conjugate prior; Econometrics; Prior probability; Computer science; Bayesian probability","score_opus":0.05948208554205539,"score_gpt":0.4262112367468744,"score_spread":0.36672915120481897,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2086120770","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.84377664,0.00039234688,0.144959,0.00066298194,0.00018072051,0.0020507874,0.00027131845,0.0003431691,0.0073629688],"genre_scores_gemma":[0.8661168,0.00035784653,0.12832622,0.00037517163,0.00013650497,0.0021161698,0.0003112518,0.0001394193,0.0021205132],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.96015716,0.029113846,0.0018592966,0.0032255745,0.005113756,0.00053043343],"domain_scores_gemma":[0.5198542,0.4485922,0.0071725803,0.0146852005,0.008230925,0.0014649502],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04535807,0.0009944106,0.0011649944,0.00081082876,0.001291005,0.0022008626,0.0017505268,0.0021683273,0.008747951],"category_scores_gemma":[0.26979393,0.00050640997,0.00095210876,0.00085250865,0.0021017632,0.0041162595,0.0024163267,0.00287958,0.0010752431],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.019808734,0.02009499,0.043011565,0.006373404,0.0006766458,0.0014134776,0.0645756,0.04751639,0.11418185,0.042949658,0.01092988,0.6284679],"study_design_scores_gemma":[0.0050672763,0.079078,0.09165439,0.0020833537,0.0010546038,0.0035879975,0.023626622,0.5686181,0.092837006,0.08725353,0.043734122,0.0014050486],"about_ca_topic_score_codex":0.0008759075,"about_ca_topic_score_gemma":0.00082470535,"teacher_disagreement_score":0.04535807,"about_ca_system_score_codex":0.0010610345,"about_ca_system_score_gemma":0.00065128127,"threshold_uncertainty_score":0.23987931},"labels":[],"label_agreement":null},{"id":"W2088787243","doi":"10.1080/02664763.2013.780156","title":"A generalized bivariate Bernoulli model with covariate dependence","year":2013,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Covariate; Bernoulli's principle; Bivariate analysis; Mathematics; Statistics; Econometrics; Applied mathematics; Physics","score_opus":0.06531214407639342,"score_gpt":0.3309955742985418,"score_spread":0.2656834302221484,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2088787243","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.046456914,0.0010043066,0.94480896,0.001685775,0.00018532608,0.00032861377,0.0018969165,0.0004520735,0.0031810636],"genre_scores_gemma":[0.7043745,0.0037951358,0.26157436,0.001290266,0.0005349938,0.0029784057,0.003425812,0.0001886032,0.021837974],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99193585,0.0050428794,0.00025463125,0.0014536809,0.00082051515,0.0004925298],"domain_scores_gemma":[0.9870977,0.009037911,0.0012123226,0.0013758535,0.00097494177,0.00030130264],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014846754,0.0014930776,0.0027162614,0.0020808913,0.0007872866,0.0023713242,0.004648976,0.0028956928,0.0064822594],"category_scores_gemma":[0.028298736,0.0009885988,0.0019847674,0.0040878057,0.002264545,0.0030033404,0.002357963,0.0037163396,0.001735342],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053949107,0.00019616788,0.022729306,0.00041523157,0.00044279944,0.0012634613,0.0011237651,0.2455439,0.0014362714,0.6500441,0.0057010534,0.07056447],"study_design_scores_gemma":[0.00021169227,0.00034700547,0.0064722258,0.00014905295,0.00026419424,0.000811648,0.0001545569,0.7125451,0.0003899942,0.27014276,0.008379653,0.00013208522],"about_ca_topic_score_codex":0.009545071,"about_ca_topic_score_gemma":0.0057474147,"teacher_disagreement_score":0.014846754,"about_ca_system_score_codex":0.0014591417,"about_ca_system_score_gemma":0.00260526,"threshold_uncertainty_score":0.07851809},"labels":[],"label_agreement":null},{"id":"W2089608879","doi":"10.1080/02664760701590376","title":"Estimation of the Length Distribution of Marine Populations in the Gaussian-multinomial Setting using the Method of Moments","year":2007,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Marine and fisheries research","field":"Environmental Science","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Háskóli Íslands; Icelandic Centre for Research; University of Washington","keywords":"Estimator; Multinomial distribution; Mathematics; Statistics; Minimum-variance unbiased estimator; Covariance; Covariance matrix; Estimation of covariance matrices; Gaussian; Applied mathematics","score_opus":0.03537306179584561,"score_gpt":0.346556136312434,"score_spread":0.3111830745165884,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2089608879","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.049673047,0.00022324898,0.9496846,0.00013922097,0.000014792244,0.000007764101,0.000053484644,0.000066291446,0.0001375161],"genre_scores_gemma":[0.7602814,0.000532131,0.23755994,0.00007457453,0.00011777959,0.00006761798,0.00030632527,0.000056679015,0.0010034812],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9985599,0.0008508221,0.00006198164,0.00025126303,0.00020028805,0.00007570887],"domain_scores_gemma":[0.9932054,0.004935764,0.000988317,0.00038372536,0.0003700658,0.00011674315],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034211758,0.00030391564,0.0008448738,0.0011825485,0.0003036625,0.00073894876,0.0010873346,0.00063328986,0.00053295266],"category_scores_gemma":[0.013879016,0.00027484822,0.0005536099,0.0009730009,0.00078421674,0.0011263593,0.00100084,0.00087061955,0.00019484229],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028030385,0.00009318904,0.051233664,0.00018169319,0.00031709622,0.00040418873,0.00031572927,0.7040246,0.009965403,0.0748012,0.0016777804,0.15670513],"study_design_scores_gemma":[0.00001302511,0.000024357189,0.0048884037,0.00001630014,0.00001200859,0.00008864917,0.000034341214,0.9678524,0.00087823975,0.025712788,0.00044983454,0.000029693867],"about_ca_topic_score_codex":0.002771195,"about_ca_topic_score_gemma":0.0021161635,"teacher_disagreement_score":0.0034211758,"about_ca_system_score_codex":0.00052339316,"about_ca_system_score_gemma":0.0006514973,"threshold_uncertainty_score":0.01809311},"labels":[],"label_agreement":null},{"id":"W2091280909","doi":"10.1080/02664760903301127","title":"Bayesian and likelihood inference for cure rates based on defective inverse Gaussian regression models","year":2010,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Gibbs sampling; Bayesian probability; Statistics; Bayesian inference; Econometrics; Bayesian linear regression; Mathematics; Inference; Regression; Biostatistics; Mixture model; Computer science; Artificial intelligence; Medicine","score_opus":0.06860073087418259,"score_gpt":0.4269199345563927,"score_spread":0.35831920368221015,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2091280909","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.025324577,0.000264024,0.9732949,0.00027080943,0.000021735996,0.00007064365,0.00015161853,0.00014537179,0.00045636095],"genre_scores_gemma":[0.5255331,0.001093349,0.4677937,0.00034399703,0.00017026797,0.0008392864,0.0012491035,0.00016320632,0.0028140647],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9799104,0.014979806,0.00062222494,0.0021177467,0.0018517906,0.0005180589],"domain_scores_gemma":[0.81670403,0.16625562,0.005732893,0.00766115,0.0027626352,0.00088367023],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04989898,0.0013816389,0.0036013129,0.0035085748,0.0006972094,0.002939799,0.004636011,0.0029518243,0.0025944442],"category_scores_gemma":[0.16432442,0.0017022598,0.0025100638,0.0020003696,0.005185591,0.004011594,0.0028638698,0.004901111,0.00054697413],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006785782,0.0002287627,0.007930483,0.00024412258,0.00029240688,0.0002371756,0.00064857857,0.6059621,0.001404219,0.3275689,0.0012855127,0.053519096],"study_design_scores_gemma":[0.000063758984,0.000056585945,0.0010090027,0.00003740395,0.00004688845,0.00006752722,0.000027329037,0.8271425,0.00046315874,0.17057763,0.00046525206,0.000042964075],"about_ca_topic_score_codex":0.00442029,"about_ca_topic_score_gemma":0.0028902914,"teacher_disagreement_score":0.04989898,"about_ca_system_score_codex":0.002546632,"about_ca_system_score_gemma":0.0021254637,"threshold_uncertainty_score":0.2638942},"labels":[],"label_agreement":null},{"id":"W2104999300","doi":"10.1080/02664763.2013.800035","title":"Estimating the proportion of true null hypotheses using the pattern of observed<i>p</i>-values","year":2013,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada; Hong Kong Baptist University; St. Jude Children's Research Hospital; National Institutes of Health; National Science Foundation","keywords":"Statistics; Mathematics; Null (SQL); Null hypothesis; Econometrics; Computer science; Data mining","score_opus":0.5316892023117963,"score_gpt":0.5023413434252647,"score_spread":0.029347858886531575,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2104999300","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03400558,0.001190038,0.961361,0.0007819749,0.00009668775,0.00036721915,0.0003260611,0.00049846515,0.0013729964],"genre_scores_gemma":[0.4254579,0.0012306708,0.5676329,0.0011328576,0.00024687764,0.001701969,0.0012675714,0.00029095978,0.0010382661],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95377344,0.032471463,0.0035278173,0.0050727874,0.0047467533,0.00040763285],"domain_scores_gemma":[0.57322353,0.38507792,0.014033048,0.020250045,0.0065439045,0.00087152637],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08449587,0.0013925662,0.0028039666,0.004251766,0.00069218734,0.0037369519,0.0038274606,0.0036325334,0.002439466],"category_scores_gemma":[0.36994058,0.0009762792,0.00217807,0.0029889643,0.0037508814,0.0049854433,0.0032437702,0.003913301,0.0010009215],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023168565,0.00052599394,0.13634214,0.0026560193,0.003775944,0.0009903546,0.0015145801,0.1110954,0.008750929,0.07578234,0.0047020577,0.6515474],"study_design_scores_gemma":[0.0007196509,0.0014423131,0.052841038,0.0013865365,0.0014089913,0.002875635,0.0007799863,0.5271332,0.023090906,0.37579393,0.012069051,0.00045873283],"about_ca_topic_score_codex":0.0006951569,"about_ca_topic_score_gemma":0.00045580423,"teacher_disagreement_score":0.9155041,"about_ca_system_score_codex":0.0009213133,"about_ca_system_score_gemma":0.0017924878,"threshold_uncertainty_score":0.44686222},"labels":[],"label_agreement":null},{"id":"W2109280416","doi":"10.1080/02664760802443962","title":"Nonlinear voxel-based modelling of the haemodynamic response in fMRI","year":2008,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced MRI Techniques and Applications","field":"Medicine","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Medical Research Council","keywords":"Voxel; Convolution (computer science); Kernel (algebra); Parametric statistics; Mathematics; Nonlinear system; Curve fitting; Artificial intelligence; Computer science; Algorithm; Statistics; Physics","score_opus":0.035654251873052004,"score_gpt":0.3027550393782124,"score_spread":0.2671007875051604,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2109280416","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017047327,0.00018574132,0.98160744,0.00010675639,0.000010598992,0.000033035147,0.000098140314,0.00023288782,0.000678092],"genre_scores_gemma":[0.6294714,0.0010540982,0.36048397,0.00014729223,0.00006231365,0.0005462788,0.00046184924,0.00037605714,0.0073968214],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9997255,0.00014281018,0.000010538202,0.000039516508,0.00006121353,0.000020372845],"domain_scores_gemma":[0.9994855,0.00036457588,0.000048548143,0.000049719674,0.000038235907,0.0000134616],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00093843567,0.00045288104,0.00043143178,0.00039470353,0.00017478416,0.00057644554,0.0012426529,0.0010564729,0.0012233648],"category_scores_gemma":[0.003246599,0.00033180838,0.00057912414,0.00069075375,0.00063000986,0.00063165143,0.0006483485,0.00088108086,0.00074381026],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000052003583,0.000018673536,0.00039122548,0.0000744978,0.000022520053,0.000104925966,0.00011853564,0.9551634,0.010572854,0.014377984,0.00045819685,0.018645281],"study_design_scores_gemma":[0.0000020930813,0.00001084248,0.00019315736,0.0000025684005,0.0000026526939,0.000045547786,0.0000040852283,0.9932647,0.0008427905,0.005097281,0.000528543,0.000005855017],"about_ca_topic_score_codex":0.003266985,"about_ca_topic_score_gemma":0.003116039,"teacher_disagreement_score":0.003266985,"about_ca_system_score_codex":0.0003934908,"about_ca_system_score_gemma":0.0006139828,"threshold_uncertainty_score":0.0064959526},"labels":[],"label_agreement":null},{"id":"W2112912314","doi":"10.1080/02664763.2013.789098","title":"Multivariate models for correlated count data","year":2013,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; University of British Columbia","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico; Fundação de Amparo à Pesquisa do Estado de São Paulo","keywords":"Overdispersion; Count data; Poisson distribution; Multivariate statistics; Statistics; Negative binomial distribution; Mathematics; Zero-inflated model; Poisson regression; Econometrics; Population; Demography","score_opus":0.2020919523255862,"score_gpt":0.4319513065614795,"score_spread":0.22985935423589332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2112912314","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010123924,0.0006320182,0.9858673,0.0006315253,0.00017339607,0.00017018229,0.0009974135,0.00032610015,0.0010781393],"genre_scores_gemma":[0.39397293,0.0040793107,0.5700399,0.001222636,0.0015177516,0.004069503,0.00697432,0.0005937609,0.017529907],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.981937,0.0111764725,0.0009333965,0.0029305883,0.002087812,0.0009347051],"domain_scores_gemma":[0.9404465,0.042529818,0.007233747,0.0057794577,0.0032428894,0.00076752424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021957038,0.002701216,0.0036000607,0.0033261217,0.0010925272,0.00382434,0.006522793,0.0027412572,0.0069260756],"category_scores_gemma":[0.056406002,0.0016257416,0.0032764003,0.0062534083,0.0026483047,0.0058379206,0.0038890163,0.006262245,0.0018887985],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025523346,0.00019925924,0.010226176,0.0005921997,0.0007992458,0.0006071922,0.0006936155,0.27385682,0.00094141223,0.6577187,0.005353245,0.048756827],"study_design_scores_gemma":[0.000059575716,0.000108606895,0.0017994773,0.00009622276,0.00012043697,0.00022706103,0.00008152554,0.77150565,0.0002547575,0.21994765,0.005723146,0.00007594661],"about_ca_topic_score_codex":0.006412948,"about_ca_topic_score_gemma":0.005917565,"teacher_disagreement_score":0.021957038,"about_ca_system_score_codex":0.002228553,"about_ca_system_score_gemma":0.0020956167,"threshold_uncertainty_score":0.11612129},"labels":[],"label_agreement":null},{"id":"W2113104757","doi":"10.1080/02664763.2012.740627","title":"Contrasting the Gini and Zenga indices of economic inequality","year":2012,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Income, Poverty, and Inequality","field":"Social Sciences","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Index (typography); Econometrics; Inequality; Economics; Gini coefficient; Economic inequality; Sample (material); Contrast (vision); Statistics; Confidence interval; Population; Demographic economics; Mathematics; Demography; Sociology; Computer science","score_opus":0.042298010096055265,"score_gpt":0.33582545082759435,"score_spread":0.2935274407315391,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2113104757","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8087903,0.0058278535,0.093689375,0.005676257,0.0006173317,0.000101304446,0.0073562358,0.00017207996,0.07776925],"genre_scores_gemma":[0.9768043,0.001460082,0.01704382,0.00018232629,0.00017561812,0.000072564246,0.0026306792,0.000056440425,0.0015740407],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99854064,0.00070311024,0.00008393123,0.00014917522,0.0004037503,0.00011936362],"domain_scores_gemma":[0.99516845,0.0026093284,0.0007947528,0.0006195384,0.000631502,0.00017649564],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032517943,0.00025618955,0.00044622965,0.0032877142,0.00028562956,0.0014881507,0.0003988772,0.00031695803,0.0011909418],"category_scores_gemma":[0.017993731,0.00010783752,0.00036651953,0.0056905914,0.0010031674,0.0017662772,0.0015857561,0.0012173442,0.000195371],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031804765,0.000073607924,0.27049878,0.00021363687,0.00045537722,0.00015979543,0.0029990005,0.01939941,0.0008971964,0.48025444,0.018538926,0.20619173],"study_design_scores_gemma":[0.000025695592,0.00012849868,0.64283764,0.00013670814,0.00008890526,0.0002787511,0.0018813099,0.03574504,0.0013495447,0.2789498,0.03847446,0.00010376787],"about_ca_topic_score_codex":0.003369556,"about_ca_topic_score_gemma":0.004421079,"teacher_disagreement_score":0.003369556,"about_ca_system_score_codex":0.00082765316,"about_ca_system_score_gemma":0.00042468475,"threshold_uncertainty_score":0.01719731},"labels":[],"label_agreement":null},{"id":"W2117179243","doi":"10.1080/02664760903521476","title":"Bayesian parametric accelerated failure time spatial model and its application to prostate cancer","year":2010,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":56,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Cancer Institute; McGill University","keywords":"Prostate cancer; Bayesian probability; Parametric statistics; Accelerated failure time model; Semiparametric model; Computer science; Parametric model; Statistics; Econometrics; Mathematics; Cancer; Proportional hazards model; Medicine; Internal medicine","score_opus":0.026308004376340482,"score_gpt":0.3414047602150342,"score_spread":0.3150967558386937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2117179243","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.047344532,0.00085744134,0.9483656,0.0007705794,0.00006234081,0.00007682903,0.000243587,0.00020971414,0.0020692388],"genre_scores_gemma":[0.7675201,0.0021334004,0.22208431,0.00028671307,0.00027356212,0.00045153472,0.0008133719,0.00014529939,0.0062917103],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99614656,0.0027475383,0.00011068097,0.00032917046,0.0004565131,0.000209534],"domain_scores_gemma":[0.97693163,0.01879735,0.0014573606,0.0009262055,0.0015214016,0.0003660369],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012237096,0.0007299759,0.0020425091,0.0019760327,0.00086138723,0.0013174854,0.0022896337,0.0014740314,0.0026357989],"category_scores_gemma":[0.038040478,0.0005638156,0.0018219451,0.002549839,0.001551008,0.001396137,0.0017480813,0.0022598957,0.00036313303],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012535798,0.00007586463,0.0073089474,0.0001238008,0.00020772235,0.0003073139,0.00041629202,0.7559317,0.00041830217,0.19637288,0.0017398997,0.03697197],"study_design_scores_gemma":[0.000017995866,0.000038005765,0.001155282,0.000017633629,0.000033525706,0.000067868365,0.000039309325,0.9446416,0.00006608813,0.052840803,0.0010584593,0.000023450384],"about_ca_topic_score_codex":0.02216971,"about_ca_topic_score_gemma":0.013033464,"teacher_disagreement_score":0.02216971,"about_ca_system_score_codex":0.0013754574,"about_ca_system_score_gemma":0.0021781733,"threshold_uncertainty_score":0.06471676},"labels":[],"label_agreement":null},{"id":"W2147583488","doi":"10.1080/02664761003758976","title":"Classification with discrete and continuous variables via general mixed-data models","year":2011,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Categorical variable; Extension (predicate logic); Ordinal data; Linear discriminant analysis; Continuous variable; Ordinal regression; Generalized linear mixed model; Discriminant function analysis; Mathematics; Data mining; Statistics; Pattern recognition (psychology); Artificial intelligence; Machine learning","score_opus":0.16432620844668666,"score_gpt":0.3663746482197034,"score_spread":0.20204843977301673,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2147583488","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018609734,0.0003918203,0.97978264,0.00053368544,0.000046678546,0.00010371566,0.00013040731,0.00011228902,0.00028896995],"genre_scores_gemma":[0.37160325,0.0006735588,0.6231164,0.0004513684,0.0003141437,0.0009568943,0.0006556689,0.00008694726,0.0021417132],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9718027,0.021441383,0.00092712406,0.0034499571,0.0017110219,0.0006677404],"domain_scores_gemma":[0.903926,0.08104502,0.005917082,0.0060983817,0.002154556,0.00085889536],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041232232,0.0021835319,0.0036388673,0.003075187,0.0011760079,0.0039925533,0.0064219236,0.0043611107,0.0024963573],"category_scores_gemma":[0.091814615,0.0012111097,0.0038175266,0.0037221627,0.004096185,0.0061103366,0.004463023,0.0044273627,0.00091385195],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00073576317,0.00036939819,0.016423672,0.00049509754,0.0008979673,0.0008309879,0.0010896941,0.64298433,0.000855119,0.22789879,0.0016709495,0.10574826],"study_design_scores_gemma":[0.000042608695,0.00008529045,0.0006030248,0.00003384605,0.000048609032,0.000090647765,0.000045453155,0.85421765,0.00025916973,0.1440101,0.0005322964,0.0000313192],"about_ca_topic_score_codex":0.0022470548,"about_ca_topic_score_gemma":0.0020427764,"teacher_disagreement_score":0.041232232,"about_ca_system_score_codex":0.0018819609,"about_ca_system_score_gemma":0.0011130102,"threshold_uncertainty_score":0.21805948},"labels":[],"label_agreement":null},{"id":"W2228863754","doi":"10.1080/02664763.2015.1094454","title":"Exact confidence intervals for randomized response strategies","year":2015,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Survey Sampling and Estimation Techniques","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Saskatchewan","keywords":"Exact statistics; Confidence interval; Statistics; Randomized response; Test statistic; Coverage probability; Statistical hypothesis testing; Confidence distribution; Mathematics; CDF-based nonparametric confidence interval; Likelihood-ratio test; p-value; Statistic; Test (biology); Inference; Computer science; Artificial intelligence","score_opus":0.14001051688027102,"score_gpt":0.41346491575438765,"score_spread":0.2734543988741166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2228863754","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0048929816,0.002029703,0.98866886,0.00025177316,0.00016822778,0.0003444268,0.00024330005,0.00054988277,0.0028508152],"genre_scores_gemma":[0.2700403,0.0026244672,0.71855336,0.00069274113,0.0006108617,0.0044409,0.0010120148,0.00043755033,0.0015877362],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.85989946,0.10024154,0.006244108,0.011523174,0.020159312,0.0019324123],"domain_scores_gemma":[0.36792722,0.56459075,0.021486744,0.02727862,0.017406603,0.0013100781],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11439364,0.002377264,0.004267047,0.008275115,0.0012080295,0.0044793496,0.005744832,0.004844812,0.010178589],"category_scores_gemma":[0.5782365,0.0013509144,0.002859873,0.008255642,0.0054238173,0.011009438,0.0043755034,0.0063729333,0.0021403886],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00094171026,0.00020225738,0.005009873,0.0021450045,0.000756175,0.00048613836,0.0014457008,0.083573386,0.0008937906,0.65047455,0.0057965517,0.24827495],"study_design_scores_gemma":[0.0004771628,0.00078139734,0.002985183,0.0014741143,0.00041354587,0.0008832009,0.0005431724,0.417908,0.0023916003,0.55618155,0.01566841,0.00029262548],"about_ca_topic_score_codex":0.0014776052,"about_ca_topic_score_gemma":0.000629515,"teacher_disagreement_score":0.11439364,"about_ca_system_score_codex":0.0026527948,"about_ca_system_score_gemma":0.0026168197,"threshold_uncertainty_score":0.60497856},"labels":[],"label_agreement":null},{"id":"W2346012900","doi":"10.1080/02664763.2016.1174194","title":"<i>L</i><sup>1</sup>-distance and classification problem by Bayesian method","year":2016,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":37,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"University of Lethbridge","keywords":"Bayesian probability; Relation (database); MATLAB; Mathematics; Computer science; Econometrics; Statistics; Probability density function; Algorithm; Data mining","score_opus":0.04986414214939088,"score_gpt":0.3765667825173506,"score_spread":0.3267026403679597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2346012900","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004266857,0.0011777676,0.9923949,0.0006551417,0.00004679089,0.00002730882,0.00006805938,0.00005135579,0.0013118907],"genre_scores_gemma":[0.30948508,0.004538441,0.67626876,0.000836612,0.00085927825,0.00065126305,0.0008168084,0.00020187996,0.0063418513],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99275726,0.0035604471,0.0005127995,0.0013379457,0.0015426723,0.00028891774],"domain_scores_gemma":[0.9843164,0.012295168,0.0010464056,0.0008012908,0.001198019,0.00034271943],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008392972,0.00086630124,0.0017202966,0.0031629163,0.0009479455,0.002599993,0.002465159,0.002906959,0.0023927551],"category_scores_gemma":[0.02496154,0.00050552207,0.0013217265,0.0027605048,0.0029025823,0.0053197416,0.0027931053,0.0035747918,0.0008391136],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019881957,0.0001400961,0.0038702532,0.0007634609,0.00019625472,0.00026112166,0.0004994845,0.11344183,0.0029495128,0.6805566,0.0050313827,0.1920911],"study_design_scores_gemma":[0.000017212395,0.000107556545,0.0013609285,0.00012352206,0.000038507947,0.00036931533,0.00009657254,0.5439169,0.0013904192,0.44644713,0.006071329,0.00006063925],"about_ca_topic_score_codex":0.0018023229,"about_ca_topic_score_gemma":0.00093684456,"teacher_disagreement_score":0.008392972,"about_ca_system_score_codex":0.0020111967,"about_ca_system_score_gemma":0.0016000957,"threshold_uncertainty_score":0.044386804},"labels":[],"label_agreement":null},{"id":"W2410096635","doi":"10.1080/02664763.2016.1193846","title":"An approach to measure distance between compositional diet estimates containing essential zeros","year":2016,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":20,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of New Brunswick","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Compositional data; Measure (data warehouse); Statistics; Statistic; Property (philosophy); Mathematics; Distance measures; Coherence (philosophical gambling strategy); Econometrics; Computer science; Data mining; Artificial intelligence","score_opus":0.01989767148608147,"score_gpt":0.254926559314041,"score_spread":0.23502888782795955,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2410096635","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06683934,0.00025536394,0.93133533,0.0001580747,0.000038938033,0.00010485012,0.0002087241,0.0001747838,0.00088457507],"genre_scores_gemma":[0.43769315,0.00014596425,0.56016695,0.00017701705,0.000092180606,0.00039162996,0.0007651066,0.000117630356,0.000450336],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9906053,0.0035329117,0.0014486718,0.0018095872,0.0023044245,0.00029911086],"domain_scores_gemma":[0.91043866,0.06620731,0.0067299474,0.009585146,0.0062103686,0.00082856533],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013551519,0.0006749395,0.00094112457,0.004626184,0.0012494095,0.0018421122,0.0018175668,0.0015490818,0.0014666484],"category_scores_gemma":[0.09808199,0.00046801122,0.0011468143,0.003271544,0.002701057,0.0037335663,0.00426714,0.0023456037,0.0003676908],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014212667,0.00039589178,0.13751012,0.001253705,0.001607186,0.0007678098,0.004176196,0.06434709,0.044131953,0.23642349,0.0027195662,0.5052456],"study_design_scores_gemma":[0.00016702789,0.0029850034,0.097779825,0.00037908662,0.00038160392,0.0034206966,0.00252766,0.49656022,0.034463488,0.3413696,0.019453913,0.000511919],"about_ca_topic_score_codex":0.0010059217,"about_ca_topic_score_gemma":0.00091978855,"teacher_disagreement_score":0.013551519,"about_ca_system_score_codex":0.00089009106,"about_ca_system_score_gemma":0.0010613443,"threshold_uncertainty_score":0.07166815},"labels":[],"label_agreement":null},{"id":"W2528587226","doi":"10.1080/02664763.2016.1238054","title":"A likelihood-based approach for multivariate one-sided tests with missing data","year":2016,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Multivariate statistics; Missing data; Multivariate analysis; Anesthesiology; Statistics; Medicine; Library science; Computer science; Mathematics","score_opus":0.5821130806050215,"score_gpt":0.5298083091860011,"score_spread":0.05230477141902046,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2528587226","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000415153,0.0002282783,0.9984952,0.00027377074,0.000049113467,0.0000943256,0.00005625256,0.000113486225,0.00027434807],"genre_scores_gemma":[0.06127591,0.00089162245,0.93184114,0.00073951593,0.00074568996,0.0018091206,0.00053760153,0.00028846765,0.0018708833],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9429004,0.04768778,0.0017927656,0.002740761,0.0043115346,0.00056671945],"domain_scores_gemma":[0.79796124,0.18211077,0.004999636,0.008925242,0.0050014197,0.0010016356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06336112,0.002466544,0.003593879,0.0051342035,0.0011436009,0.0027029598,0.006367192,0.0038175774,0.009370932],"category_scores_gemma":[0.19650897,0.0012011119,0.0043534855,0.004905189,0.0043455726,0.00514971,0.0047759498,0.008671173,0.0021984514],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052103907,0.0003137098,0.0056822873,0.0016493952,0.0012879053,0.0012815244,0.00073374546,0.10020031,0.0022893646,0.54897803,0.010653492,0.3264092],"study_design_scores_gemma":[0.00023731292,0.00032862092,0.0012970308,0.00027568673,0.00022259005,0.00076034915,0.00010448398,0.4905054,0.0015112337,0.49502572,0.009613202,0.000118360746],"about_ca_topic_score_codex":0.0012774756,"about_ca_topic_score_gemma":0.0012050087,"teacher_disagreement_score":0.06336112,"about_ca_system_score_codex":0.00172429,"about_ca_system_score_gemma":0.004017425,"threshold_uncertainty_score":0.33508962},"labels":[],"label_agreement":null},{"id":"W2567192494","doi":"10.1080/02664763.2016.1268106","title":"A functional data approach to model score difference process in professional basketball games","year":2016,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Natural Science Foundation of China","keywords":"Basketball; Realization (probability); Process (computing); Computer science; Momentum (technical analysis); Econometrics; Statistics; Mathematics; Economics","score_opus":0.09927779556843992,"score_gpt":0.2682724620487213,"score_spread":0.16899466648028139,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2567192494","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.042586144,0.00028934074,0.9533043,0.00088041404,0.00007131316,0.000117733725,0.00052610994,0.0001234637,0.002101124],"genre_scores_gemma":[0.8548973,0.00070912373,0.13415739,0.00036574726,0.00016325795,0.0006930854,0.0013243179,0.0000934851,0.0075963247],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99703586,0.0017366329,0.0001504031,0.0005268919,0.00032695595,0.00022333828],"domain_scores_gemma":[0.9880751,0.008820211,0.0012258772,0.0005418031,0.0010287134,0.00030828424],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008762484,0.0013311933,0.0011165157,0.0020004525,0.00052470586,0.0016732359,0.00256554,0.0022913052,0.0042229407],"category_scores_gemma":[0.02387109,0.00064381846,0.0016266869,0.0015529254,0.0018549265,0.0028043864,0.0018857457,0.0030785028,0.0005728539],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000106855376,0.00017071777,0.022365682,0.0002003248,0.00015824071,0.000384296,0.0005774677,0.4944316,0.0008969223,0.45362422,0.0020535984,0.025029983],"study_design_scores_gemma":[0.000010859057,0.00005378318,0.0015623977,0.000019202018,0.00001569504,0.000043637265,0.000072011724,0.94711286,0.00011493841,0.04979998,0.0011757851,0.00001887564],"about_ca_topic_score_codex":0.01466079,"about_ca_topic_score_gemma":0.0093691405,"teacher_disagreement_score":0.01466079,"about_ca_system_score_codex":0.0018819817,"about_ca_system_score_gemma":0.00161248,"threshold_uncertainty_score":0.046340942},"labels":[],"label_agreement":null},{"id":"W2886082462","doi":"10.1080/02664763.2018.1510475","title":"Detection of a change-point in variance by a weighted sum of powers of variances test","year":2018,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Variance (accounting); Statistics; Mathematics; Value (mathematics); Point (geometry); Test (biology); One-way analysis of variance; Sample size determination; Sequence (biology); Analysis of variance","score_opus":0.06539002197327509,"score_gpt":0.3386058483489105,"score_spread":0.2732158263756354,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2886082462","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.036637176,0.00024116326,0.96100193,0.0001424096,0.00016313582,0.0001845837,0.00009194751,0.0003486509,0.0011889132],"genre_scores_gemma":[0.6344593,0.00032041242,0.3623639,0.00026607298,0.00036587115,0.0008004411,0.00039042017,0.00027714152,0.0007564138],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9682606,0.015735826,0.002126994,0.004962536,0.008326931,0.0005871161],"domain_scores_gemma":[0.7580515,0.21441044,0.009092918,0.008952367,0.008422018,0.0010707696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.024475042,0.0011575806,0.0027745334,0.004991876,0.0007636706,0.002031709,0.0030390602,0.0022584745,0.0027249763],"category_scores_gemma":[0.23442909,0.000573213,0.0016724205,0.002732732,0.002968408,0.004352355,0.0019765056,0.003236631,0.00074063556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027016653,0.0010232999,0.08435332,0.0012710645,0.0027365307,0.0028825086,0.0014052908,0.08588456,0.029281346,0.09178634,0.003768634,0.6929055],"study_design_scores_gemma":[0.0004032845,0.0032978542,0.0445462,0.00026897926,0.0006807714,0.0031761827,0.0005300506,0.7962806,0.02115119,0.1241273,0.005160316,0.00037713785],"about_ca_topic_score_codex":0.00041737725,"about_ca_topic_score_gemma":0.00017473185,"teacher_disagreement_score":0.024475042,"about_ca_system_score_codex":0.00046333284,"about_ca_system_score_gemma":0.0010069314,"threshold_uncertainty_score":0.12943792},"labels":[],"label_agreement":null},{"id":"W2889750398","doi":"10.1080/02664763.2018.1517145","title":"Bayesian growth curve model useful for high-dimensional longitudinal data","year":2018,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Michael's Hospital; McMaster University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Test statistic; Computer science; Inference; Monotone polygon; Curse of dimensionality; Null hypothesis; Statistical hypothesis testing; Bayesian probability; Statistic; Singularity; Null (SQL); Mathematics; Sample size determination; Statistics; Data mining; Artificial intelligence","score_opus":0.04115864328533659,"score_gpt":0.30809958014203026,"score_spread":0.2669409368566937,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2889750398","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027686087,0.0005538829,0.9674666,0.0011691996,0.00006260304,0.000116409945,0.0007730927,0.0006300965,0.0015420039],"genre_scores_gemma":[0.6252924,0.001233159,0.35970163,0.00075904286,0.00028864597,0.0011232148,0.0038465983,0.00047509136,0.0072801504],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9967416,0.001910759,0.00012512125,0.0005527198,0.0004396722,0.000230156],"domain_scores_gemma":[0.9719706,0.022692032,0.0015560192,0.0015730388,0.0016811265,0.00052722485],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014211467,0.00084704097,0.002114226,0.0022207915,0.0009224073,0.0019865525,0.0025889962,0.0022007956,0.0042942427],"category_scores_gemma":[0.048664372,0.0007013067,0.0015046814,0.0026540477,0.0019511731,0.0026435894,0.0017675615,0.0028878986,0.0010282701],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034121136,0.0001217634,0.019453084,0.00027892634,0.00025046815,0.0005651494,0.00042347622,0.618363,0.0018474564,0.26233628,0.008468898,0.08755013],"study_design_scores_gemma":[0.000025844505,0.000032873068,0.0011437132,0.000020144333,0.000021249016,0.00007733823,0.000027303435,0.9231668,0.00016639057,0.07372813,0.0015697328,0.000020546286],"about_ca_topic_score_codex":0.014108845,"about_ca_topic_score_gemma":0.0081115505,"teacher_disagreement_score":0.014211467,"about_ca_system_score_codex":0.0017243532,"about_ca_system_score_gemma":0.0028888818,"threshold_uncertainty_score":0.0751583},"labels":[],"label_agreement":null},{"id":"W2896915321","doi":"10.1080/02664763.2021.1957789","title":"A new GEE method to account for heteroscedasticity using asymmetric least-square regressions","year":2021,"lang":"en","type":"preprint","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; McGill University; Jewish General Hospital","funders":"","keywords":"Heteroscedasticity; Estimator; Mathematics; Generalized estimating equation; Estimating equations; Statistics; Asymptotic distribution; Inference; Econometrics; Covariance matrix; Applied mathematics; Computer science","score_opus":0.13253678431776542,"score_gpt":0.45245195313507025,"score_spread":0.31991516881730486,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2896915321","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011458935,0.00007654925,0.99803084,0.00008540322,0.000031005096,0.000032707234,0.000117473,0.0002728179,0.0002073853],"genre_scores_gemma":[0.05599256,0.0003955108,0.93697095,0.0003570799,0.00018649177,0.00057775434,0.0011562981,0.0010557022,0.0033076704],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9923205,0.004878204,0.00039062713,0.0011756667,0.001010499,0.00022460299],"domain_scores_gemma":[0.98211586,0.012282243,0.0010081014,0.0024980416,0.001875452,0.0002202401],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012576443,0.0014324009,0.0021829044,0.0020377997,0.0005165398,0.0014814663,0.0031025347,0.0015207828,0.0066469978],"category_scores_gemma":[0.054691777,0.00086774695,0.002640113,0.0026380597,0.00083435973,0.0028467376,0.0023257977,0.0033268423,0.0019078156],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018696101,0.0003009261,0.013584035,0.0005773619,0.0019424515,0.00063921214,0.00057525444,0.16185933,0.0044486565,0.23478226,0.020118678,0.5609848],"study_design_scores_gemma":[0.0000947675,0.00010529596,0.003343125,0.00010244592,0.0002660384,0.00045476906,0.00006446289,0.7802958,0.0013388757,0.19073172,0.023107009,0.00009574132],"about_ca_topic_score_codex":0.0043955133,"about_ca_topic_score_gemma":0.005858006,"teacher_disagreement_score":0.012576443,"about_ca_system_score_codex":0.00058940507,"about_ca_system_score_gemma":0.0025261382,"threshold_uncertainty_score":0.06651139},"labels":[],"label_agreement":null},{"id":"W2902854630","doi":"10.1080/02664763.2018.1552668","title":"Testing homogeneity in a heteroscedastic contaminated normal mixture","year":2018,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; University of Waterloo; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Homogeneity (statistics); Heteroscedasticity; Statistics; Mixture model; Inference; Mathematics; Normal distribution; Test statistic; Type I and type II errors; Statistical hypothesis testing; Computer science; Artificial intelligence","score_opus":0.32812212445169364,"score_gpt":0.49402816850563375,"score_spread":0.1659060440539401,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2902854630","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.048900485,0.00036872784,0.94846064,0.00048527954,0.00006302185,0.00022057033,0.00024943557,0.00034579445,0.00090605585],"genre_scores_gemma":[0.70850825,0.00038095578,0.28641284,0.0005908174,0.00017428507,0.0010501668,0.0010889183,0.00015569685,0.0016380307],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9495795,0.032757115,0.0022462525,0.008126241,0.00602832,0.0012626523],"domain_scores_gemma":[0.7266879,0.24289492,0.009729361,0.013184216,0.006484416,0.0010191869],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06503824,0.0013131916,0.0030412725,0.0029443214,0.0010948136,0.00322972,0.0039031897,0.0031933389,0.0035796561],"category_scores_gemma":[0.24009687,0.0010981958,0.002728996,0.002731893,0.0054058745,0.004139657,0.0039324923,0.002859873,0.0007395941],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0031549754,0.0004865895,0.08460681,0.0011519077,0.0027078378,0.0023678804,0.0026914533,0.25476918,0.008528305,0.41562042,0.0037181536,0.22019644],"study_design_scores_gemma":[0.00033806643,0.00063862314,0.016219458,0.00019490703,0.0003559848,0.0011410416,0.00039596652,0.64415956,0.0051346337,0.32775038,0.0034786172,0.00019279895],"about_ca_topic_score_codex":0.0022757938,"about_ca_topic_score_gemma":0.0010771054,"teacher_disagreement_score":0.06503824,"about_ca_system_score_codex":0.0016273229,"about_ca_system_score_gemma":0.0022196549,"threshold_uncertainty_score":0.3439592},"labels":[],"label_agreement":null},{"id":"W2964293100","doi":"10.1080/02664763.2018.1536878","title":"Is it even rainier in<i>North</i>Vancouver? A non-parametric rank-based test for semicontinuous longitudinal data","year":2018,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia","funders":"","keywords":"Parametric statistics; Rank (graph theory); Computer science; Longitudinal data; Random effects model; Statistics; Mathematics; Algorithm; Econometrics; Data mining; Medicine","score_opus":0.15126136075443297,"score_gpt":0.3990622772537438,"score_spread":0.24780091649931085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2964293100","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9375479,0.0006772655,0.043042287,0.0047244397,0.0001632188,0.00008549178,0.0039576986,0.00017109654,0.009630617],"genre_scores_gemma":[0.9913025,0.00012833165,0.00609985,0.00044087236,0.000036974634,0.00006561412,0.00094192347,0.00003315713,0.0009506723],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9959806,0.0017318376,0.00022148692,0.0010343627,0.0005486221,0.00048314253],"domain_scores_gemma":[0.97505885,0.016604397,0.003701036,0.0023329433,0.001475591,0.0008271322],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008729954,0.00032476263,0.0010217928,0.0009446159,0.0011803798,0.0018909628,0.0015512198,0.0011073796,0.0046741893],"category_scores_gemma":[0.03777278,0.00017706632,0.0007531877,0.0025854215,0.0024165818,0.0011303702,0.0012276482,0.0019702269,0.00055723253],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017171619,0.00015282158,0.87680095,0.00031542632,0.00082020677,0.000763898,0.0020580646,0.004150454,0.0029672044,0.010639784,0.0049370355,0.09467697],"study_design_scores_gemma":[0.00010514943,0.00065610994,0.88160914,0.00025438776,0.0005317061,0.0010505212,0.008740711,0.051775165,0.0035031748,0.040338278,0.011296519,0.00013910641],"about_ca_topic_score_codex":0.055272754,"about_ca_topic_score_gemma":0.093161345,"teacher_disagreement_score":0.055272754,"about_ca_system_score_codex":0.0010458037,"about_ca_system_score_gemma":0.0020385862,"threshold_uncertainty_score":0.109902084},"labels":[],"label_agreement":null},{"id":"W2967275303","doi":"10.1080/02664763.2019.1652254","title":"EM-test for homogeneity in a two-sample problem with a mixture structure","year":2019,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Homogeneity (statistics); Statistics; Sample size determination; Mathematics; Null hypothesis; Sample (material); Computer science; Chemistry; Chromatography","score_opus":0.020846216808293388,"score_gpt":0.3290732872956579,"score_spread":0.3082270704873645,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2967275303","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014821234,0.00033607098,0.9832644,0.00033654872,0.000049310205,0.00019360577,0.00021214782,0.00020928486,0.000577334],"genre_scores_gemma":[0.38787177,0.0007118996,0.6023453,0.00087138533,0.00035489004,0.0023624387,0.0020128519,0.00022679778,0.0032426908],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97810787,0.015015297,0.0010978775,0.003477776,0.0017180843,0.0005830728],"domain_scores_gemma":[0.87307304,0.115283996,0.0029474094,0.0051873294,0.002818162,0.0006900695],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.05036139,0.00184183,0.0044209613,0.0032745837,0.0012822339,0.0018791588,0.004192426,0.0037660308,0.0057664895],"category_scores_gemma":[0.13220575,0.0011920137,0.0037159794,0.0024620092,0.0048208605,0.004692908,0.0036905536,0.0038931763,0.0010881713],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023631097,0.00054625864,0.035473447,0.0015829522,0.002954607,0.0017279715,0.0012510557,0.29271328,0.0053399815,0.40202898,0.00649788,0.24752052],"study_design_scores_gemma":[0.00035874825,0.0006135215,0.006533578,0.00017590665,0.00032993508,0.00070262444,0.00024488827,0.7966831,0.004127295,0.18585166,0.0042707603,0.000108029126],"about_ca_topic_score_codex":0.0014492618,"about_ca_topic_score_gemma":0.0008344237,"teacher_disagreement_score":0.05036139,"about_ca_system_score_codex":0.001160507,"about_ca_system_score_gemma":0.0019773713,"threshold_uncertainty_score":0.26633972},"labels":[],"label_agreement":null},{"id":"W2991264399","doi":"10.1080/02664763.2019.1695759","title":"Robust signed-rank estimation and variable selection for semi-parametric additive partial linear models","year":2019,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Nonparametric statistics; Additive model; Outlier; Estimator; Covariate; Mathematics; Parametric statistics; Model selection; Smoothing; Parametric model; Spline (mechanical); Robustness (evolution); Leverage (statistics); Semiparametric model; Smoothing spline; Smoothness; Econometrics; Mathematical optimization; Statistics; Spline interpolation","score_opus":0.06985366722994428,"score_gpt":0.357185286224967,"score_spread":0.2873316189950227,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2991264399","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021474818,0.00023936601,0.9969121,0.00014513922,0.000022006609,0.000034954304,0.00009101622,0.00016562888,0.00024233405],"genre_scores_gemma":[0.19153635,0.0019414134,0.7983834,0.00032852427,0.00030613577,0.0009937306,0.0017350697,0.00030919444,0.0044661937],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98866606,0.008736103,0.0003402927,0.00081845216,0.0011459754,0.00029316955],"domain_scores_gemma":[0.97546387,0.018977446,0.0019469017,0.0016500622,0.0016658696,0.00029582658],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013556454,0.0021624197,0.00277306,0.0017286119,0.00078317715,0.0022425884,0.002676825,0.001851239,0.004374583],"category_scores_gemma":[0.042081904,0.0011296631,0.002323325,0.0031630592,0.0020128752,0.0021816907,0.0026458472,0.0037891525,0.0014565532],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00022171938,0.0001736675,0.0026586843,0.00070635276,0.0003920337,0.00045292475,0.00021670865,0.6116547,0.0021558523,0.1843456,0.006316667,0.19070505],"study_design_scores_gemma":[0.000020796268,0.000062945175,0.0003016609,0.000030285932,0.000020852709,0.000055315155,0.000024045998,0.9475216,0.00046404873,0.049873587,0.0015955115,0.000029369168],"about_ca_topic_score_codex":0.003535384,"about_ca_topic_score_gemma":0.004287351,"teacher_disagreement_score":0.013556454,"about_ca_system_score_codex":0.001126325,"about_ca_system_score_gemma":0.0036048326,"threshold_uncertainty_score":0.071694195},"labels":[],"label_agreement":null},{"id":"W2992485813","doi":"10.1080/02664763.2021.1911966","title":"Confounding adjustment methods for multi-level treatment comparisons under lack of positivity and unknown model specification","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"Fonds de Recherche du Québec - Santé; Natural Sciences and Engineering Research Council of Canada; Université Laval","keywords":"Covariate; Estimator; Observational study; Context (archaeology); Specification; Confounding; Matching (statistics); Variance (accounting); Propensity score matching","score_opus":0.6386904553834739,"score_gpt":0.5704813769769004,"score_spread":0.06820907840657353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2992485813","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069481125,0.00030424885,0.99135476,0.0002403937,0.000077280354,0.0004238946,0.00007199922,0.00022233058,0.0003569855],"genre_scores_gemma":[0.24559945,0.00032792834,0.749485,0.0004343222,0.00016662717,0.002740784,0.00028217328,0.00016068912,0.0008031192],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.90476596,0.07974041,0.003626709,0.0056586843,0.0052753943,0.0009328796],"domain_scores_gemma":[0.7690945,0.18397819,0.015398738,0.025558712,0.005129316,0.0008405609],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.09793293,0.0013224763,0.0021840825,0.0019241285,0.0013591439,0.0018071143,0.0034847022,0.0022742634,0.005721012],"category_scores_gemma":[0.30091643,0.00079125626,0.00398652,0.0024876487,0.0030021628,0.0030731307,0.004094722,0.003271505,0.0004685299],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023843574,0.00041687224,0.03440333,0.0018603071,0.005265258,0.0004878334,0.0015431072,0.07420706,0.003275932,0.28420556,0.004830739,0.5871197],"study_design_scores_gemma":[0.0015335897,0.0020631705,0.0179988,0.0005817295,0.0018619809,0.0005299191,0.00034687316,0.42318055,0.006586961,0.52814,0.01697202,0.0002043255],"about_ca_topic_score_codex":0.00209293,"about_ca_topic_score_gemma":0.0019646147,"teacher_disagreement_score":0.09793293,"about_ca_system_score_codex":0.0012797322,"about_ca_system_score_gemma":0.0041149794,"threshold_uncertainty_score":0.517925},"labels":[],"label_agreement":null},{"id":"W3043881144","doi":"10.1080/02664763.2020.1795819","title":"Identifying key factors in momentum in basketball games","year":2020,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Prince Edward Island; University of Waterloo","funders":"National Natural Science Foundation of China","keywords":"Basketball; Operationalization; Momentum (technical analysis); Attendance; Key (lock); Salary; Econometrics; Computer science; Field (mathematics); Statistic; Mathematics; Statistics; Economics; Physics; Computer security; Geography; Financial economics","score_opus":0.05086614624785881,"score_gpt":0.2377608578415713,"score_spread":0.1868947115937125,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3043881144","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98887575,0.00032049103,0.006095982,0.00040264535,0.000023411952,0.00004630313,0.00022802266,0.000022688784,0.0039846366],"genre_scores_gemma":[0.99828184,0.00010072806,0.00092980935,0.0000149935795,0.000016673195,0.000013117879,0.0001432656,0.000005245803,0.0004943839],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989002,0.00030308837,0.000100824676,0.0001890304,0.0002546148,0.00025229173],"domain_scores_gemma":[0.99229044,0.0032973716,0.0030035623,0.00027877014,0.00045409676,0.00067581225],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017282894,0.00050166127,0.000492229,0.00214161,0.0007213166,0.0024816026,0.000419324,0.00062890805,0.00290583],"category_scores_gemma":[0.011641753,0.00028718737,0.00044708542,0.0021289112,0.0012301643,0.0015049451,0.0020437322,0.0010711157,0.00033047836],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021118694,0.00021745024,0.96107626,0.000042611147,0.00007700092,0.00016774784,0.00051852077,0.004075169,0.00053801545,0.010094465,0.00048884144,0.022492766],"study_design_scores_gemma":[0.000012218599,0.00013425351,0.97509116,0.000037427337,0.000029864186,0.000050845618,0.0014178901,0.012177717,0.00031132138,0.0098573165,0.00085289817,0.000027187942],"about_ca_topic_score_codex":0.0072287037,"about_ca_topic_score_gemma":0.010797465,"teacher_disagreement_score":0.0072287037,"about_ca_system_score_codex":0.000965306,"about_ca_system_score_gemma":0.0011723596,"threshold_uncertainty_score":0.014373243},"labels":[],"label_agreement":null},{"id":"W3048846794","doi":"10.1080/02664763.2022.2034760","title":"Sensitivity analysis of error-contaminated time series data under autoregressive models with the application of COVID-19 data","year":2022,"lang":"en","type":"preprint","venue":"Journal of Applied Statistics","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Western University; University of Waterloo","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Autoregressive model; Observational error; Sensitivity (control systems); Time series; Series (stratigraphy); Statistics; Estimation; Coronavirus disease 2019 (COVID-19); Computer science; Errors-in-variables models; Autoregressive integrated moving average; Econometrics; Mathematics; Engineering","score_opus":0.3084389534572723,"score_gpt":0.45031641575627324,"score_spread":0.14187746229900094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3048846794","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.3741732,0.0023812675,0.61626446,0.0020036674,0.00023503354,0.00038381328,0.0008000695,0.00025944164,0.003498942],"genre_scores_gemma":[0.9657028,0.00049386447,0.032324154,0.00021979256,0.000058213744,0.0001440381,0.00047933686,0.00003993466,0.0005378898],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9763005,0.018527698,0.00087498553,0.0016896271,0.0020391243,0.0005680338],"domain_scores_gemma":[0.693191,0.27709383,0.012425016,0.0115417335,0.005294077,0.0004542793],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.048993092,0.00089911395,0.0011138906,0.0018618434,0.0005686368,0.0019633735,0.0015708654,0.0019174307,0.0011594351],"category_scores_gemma":[0.21256632,0.0005464934,0.0018215812,0.00200028,0.001990579,0.0023907346,0.002370688,0.0028789572,0.000092107475],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043561257,0.00011189926,0.04219901,0.00040841132,0.0009780615,0.0006144545,0.00051640585,0.8689935,0.0014520572,0.057745032,0.0011244833,0.025421007],"study_design_scores_gemma":[0.00004418331,0.00023914446,0.014943425,0.00015075377,0.00025643985,0.00021519873,0.0003925045,0.9231122,0.002532798,0.05634747,0.0016728764,0.000092944225],"about_ca_topic_score_codex":0.010662903,"about_ca_topic_score_gemma":0.0033487265,"teacher_disagreement_score":0.9510069,"about_ca_system_score_codex":0.00190883,"about_ca_system_score_gemma":0.0011554478,"threshold_uncertainty_score":0.25910336},"labels":[],"label_agreement":null},{"id":"W3093066829","doi":"10.1080/02664763.2020.1833183","title":"The GLM framework of the Lee–Carter model: a multi-country study","year":2020,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Universiti Malaya","keywords":"Deviance (statistics); Negative binomial distribution; Generalized linear model; Statistics; Poisson distribution; Econometrics; Mathematics; Count data; Poisson regression; Binomial distribution; Statistical model; Deviance information criterion; Demography; Sociology; Population; Bayesian probability; Bayesian inference","score_opus":0.028181942462116884,"score_gpt":0.31734128641478293,"score_spread":0.28915934395266607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3093066829","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.88768035,0.0022825554,0.0987042,0.001158101,0.00013472338,0.00032390305,0.0024987527,0.00018216272,0.0070351753],"genre_scores_gemma":[0.9741634,0.000732488,0.022157174,0.0001287778,0.00005002745,0.00026965726,0.0011955138,0.00006723665,0.001235746],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9921766,0.0066000386,0.00014386192,0.00048705356,0.00025649802,0.00033591696],"domain_scores_gemma":[0.9844173,0.011842537,0.0014834863,0.0011564008,0.0008206078,0.00027967955],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010654456,0.0006603908,0.0013258853,0.0025229573,0.0006969825,0.0014036382,0.0012319156,0.0009373182,0.0046369596],"category_scores_gemma":[0.01911528,0.00027688342,0.0022354373,0.0046092966,0.000688759,0.0013736344,0.0018141053,0.0018648214,0.00051478826],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012657836,0.0006790596,0.5622464,0.0007264543,0.0044996217,0.0031261237,0.0026419405,0.2840353,0.0007117749,0.05912633,0.009986372,0.07095492],"study_design_scores_gemma":[0.00024515556,0.0017574405,0.23222232,0.00043723834,0.0017928089,0.0015431289,0.0066195005,0.70584345,0.00057654077,0.032470133,0.016210059,0.00028218658],"about_ca_topic_score_codex":0.021758746,"about_ca_topic_score_gemma":0.012859395,"teacher_disagreement_score":0.021758746,"about_ca_system_score_codex":0.00093105476,"about_ca_system_score_gemma":0.0009108342,"threshold_uncertainty_score":0.056346774},"labels":[],"label_agreement":null},{"id":"W3113121140","doi":"10.1080/02664763.2020.1856352","title":"Ultrahigh-dimensional sufficient dimension reduction for censored data with measurement error in covariates","year":2020,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Covariate; Dimensionality reduction; Computer science; Observational error; Dimension (graph theory); Sufficient dimension reduction; Statistics; Subspace topology; Feature (linguistics); Reduction (mathematics); Standard error; Data mining; Mathematics; Artificial intelligence","score_opus":0.17343395960140334,"score_gpt":0.3608302552843572,"score_spread":0.18739629568295385,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3113121140","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006675529,0.00040655525,0.99235535,0.00017123613,0.000024576337,0.000028276641,0.000097772325,0.00008014669,0.00016058095],"genre_scores_gemma":[0.34986764,0.0017312911,0.6437124,0.00039272432,0.00035434982,0.0006671539,0.0014902644,0.00010182866,0.0016823359],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.994651,0.0033230067,0.00027615172,0.0007124958,0.00083370967,0.00020371011],"domain_scores_gemma":[0.98652565,0.009054861,0.0010756887,0.0018302795,0.0012540123,0.0002594844],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0070981593,0.0010775612,0.002024386,0.0014583248,0.00067012466,0.001376642,0.0018337902,0.0009847245,0.001126384],"category_scores_gemma":[0.023096321,0.00056574325,0.001682973,0.0017319204,0.0014482457,0.0021624733,0.0023890827,0.0023073305,0.00029429898],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043204697,0.00027282652,0.012080222,0.0013974799,0.0005247336,0.000543378,0.00063090085,0.41149113,0.00892628,0.2827313,0.00545305,0.2755166],"study_design_scores_gemma":[0.00003312034,0.00011820854,0.0021350968,0.00005464148,0.000038470243,0.00012743233,0.000049589773,0.91030645,0.0014834041,0.08327406,0.002315899,0.00006368807],"about_ca_topic_score_codex":0.001689783,"about_ca_topic_score_gemma":0.0012066592,"teacher_disagreement_score":0.0070981593,"about_ca_system_score_codex":0.00072798174,"about_ca_system_score_gemma":0.0015649057,"threshold_uncertainty_score":0.037539065},"labels":[],"label_agreement":null},{"id":"W3118534316","doi":"10.1080/02664763.2020.1870669","title":"Adaptive kernel scaling support vector machine with application to a prostate cancer image study","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Imbalanced Data Classification Techniques","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Health Research","keywords":"Support vector machine; Computer science; Interpretability; Pattern recognition (psychology); Artificial intelligence; Kernel (algebra); Feature vector; Classifier (UML); Relevance vector machine; Radial basis function kernel; Scaling; Kernel method; Machine learning; Data mining; Mathematics","score_opus":0.01173480914352574,"score_gpt":0.2853612597932442,"score_spread":0.27362645064971847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3118534316","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15576841,0.0013361942,0.8404363,0.0005192842,0.0001620836,0.000066408305,0.00007495823,0.00067078776,0.00096556416],"genre_scores_gemma":[0.7343148,0.00038845467,0.26403543,0.00007033203,0.00010864179,0.00006894117,0.00011293155,0.000055092536,0.00084531354],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99948907,0.00019042815,0.00003584908,0.00007655714,0.00017252055,0.000035580717],"domain_scores_gemma":[0.9982633,0.0009408244,0.00015918096,0.0001724265,0.0003816416,0.00008257814],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0014158174,0.00036875554,0.00077167037,0.00081308687,0.00027244695,0.0005824158,0.00052265386,0.0005896565,0.000614742],"category_scores_gemma":[0.005077305,0.0001576837,0.00044605657,0.0011970008,0.0004124038,0.00045389996,0.000773828,0.0007670767,0.0001843891],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041387888,0.00020296492,0.0058868835,0.00022283493,0.0000897779,0.0005575503,0.00025921068,0.56170017,0.021074485,0.0128650665,0.0030441447,0.39368305],"study_design_scores_gemma":[0.0000048368397,0.000029329407,0.00047578776,0.0000023275059,0.0000037210466,0.000038765098,0.000011455346,0.9965378,0.0012294137,0.0012477611,0.00041311185,0.000005688118],"about_ca_topic_score_codex":0.0014532185,"about_ca_topic_score_gemma":0.00065233203,"teacher_disagreement_score":0.0014532185,"about_ca_system_score_codex":0.00033603053,"about_ca_system_score_gemma":0.00039186783,"threshold_uncertainty_score":0.0074876547},"labels":[],"label_agreement":null},{"id":"W3133223479","doi":"10.1080/02664763.2021.1887102","title":"Negligible interaction test for continuous predictors","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; McMaster University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Null hypothesis; Interaction; Equivalence (formal languages); Econometrics; Null (SQL); Psychology; Test (biology); Statistics; Mathematics; Computer science; Data mining","score_opus":0.3108828984686719,"score_gpt":0.5234423770236948,"score_spread":0.21255947855502288,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3133223479","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.2559476,0.0011352301,0.7207246,0.0029926249,0.0013529574,0.0025737134,0.001836154,0.000993538,0.012443611],"genre_scores_gemma":[0.86499006,0.00015030848,0.12668952,0.0009950092,0.0003476955,0.0036525708,0.0008373174,0.00019593697,0.0021415127],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7518386,0.19195414,0.008457107,0.018821811,0.024174077,0.004754263],"domain_scores_gemma":[0.2746801,0.6790835,0.011034392,0.025655685,0.0061826175,0.0033637364],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11543566,0.0011932879,0.004177173,0.0033029828,0.0019274079,0.0030275427,0.0058626863,0.0036415465,0.023819644],"category_scores_gemma":[0.4988893,0.00075641874,0.004560354,0.0024671427,0.00837682,0.0058614863,0.005205332,0.0070332224,0.001426065],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.02831765,0.004735817,0.22722822,0.003511254,0.010148664,0.007897521,0.007083978,0.019509843,0.006798074,0.32301468,0.015623219,0.3461311],"study_design_scores_gemma":[0.0038202307,0.02743797,0.12661356,0.000998624,0.003367767,0.0053073005,0.0027427732,0.3631176,0.007150954,0.43731698,0.021725258,0.00040097878],"about_ca_topic_score_codex":0.0011969785,"about_ca_topic_score_gemma":0.0006949513,"teacher_disagreement_score":0.11543566,"about_ca_system_score_codex":0.001526024,"about_ca_system_score_gemma":0.004205797,"threshold_uncertainty_score":0.6104894},"labels":[],"label_agreement":null},{"id":"W3189285760","doi":"10.1080/02664763.2021.1962261","title":"Likelihood ratio test for genetic association study with case–control data under Probit model","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Higher Education Discipline Innovation Project; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Likelihood-ratio test; Statistics; Probit model; Probit; Score test; Econometrics; Logistic regression; Multinomial probit; Logit; Multivariate probit model; Mathematics","score_opus":0.01974508177449127,"score_gpt":0.28413637639978745,"score_spread":0.2643912946252962,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3189285760","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10500899,0.0014007434,0.88773215,0.00092981587,0.00019981706,0.00062169234,0.0011208085,0.0009274025,0.002058604],"genre_scores_gemma":[0.8188469,0.00048845494,0.17498793,0.00037892474,0.00027766157,0.0016087815,0.0018239864,0.00015698477,0.0014304678],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9413918,0.046086237,0.0017678242,0.006405411,0.0033367928,0.001011855],"domain_scores_gemma":[0.7770751,0.20954837,0.005117797,0.0047164536,0.002527024,0.0010153005],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.040893342,0.0010888993,0.0030955886,0.0039867833,0.001105058,0.0022538463,0.003962383,0.0032370216,0.0069837645],"category_scores_gemma":[0.1913062,0.0005790587,0.0022601935,0.0040050745,0.002742316,0.003733318,0.0018625463,0.00314539,0.0008001583],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004947205,0.0010213556,0.40959153,0.002561953,0.0074336855,0.007859526,0.0016820561,0.12809879,0.0052030524,0.14196378,0.011074246,0.2785629],"study_design_scores_gemma":[0.0005569098,0.0016622007,0.034500644,0.00025834623,0.0010463082,0.003716276,0.0007436162,0.85091823,0.0028342723,0.09777198,0.0057998723,0.00019145985],"about_ca_topic_score_codex":0.002144955,"about_ca_topic_score_gemma":0.00070882926,"teacher_disagreement_score":0.040893342,"about_ca_system_score_codex":0.001121793,"about_ca_system_score_gemma":0.0021025604,"threshold_uncertainty_score":0.21626729},"labels":[],"label_agreement":null},{"id":"W3206708024","doi":"10.1080/02664763.2021.1987400","title":"A novel group VIF regression for group variable selection with application to multiple change-point detection","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Group selection; Group (periodic table); Feature selection; Variance inflation factor; Computer science; Data set; Variable (mathematics); Selection (genetic algorithm); Set (abstract data type); Linear regression; Mathematics; Algorithm; Data mining; Artificial intelligence; Machine learning","score_opus":0.06313427155823831,"score_gpt":0.3346291392769928,"score_spread":0.2714948677187545,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3206708024","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011690266,0.00011852248,0.99830425,0.00006363169,0.000025864703,0.000027943805,0.000024701016,0.00016083509,0.00010508555],"genre_scores_gemma":[0.06749471,0.00036982773,0.9293166,0.00019290106,0.0002174414,0.0003733548,0.00039350052,0.00025920346,0.0013825695],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99518234,0.0025596295,0.00015438869,0.00093588396,0.0009430362,0.00022480136],"domain_scores_gemma":[0.9932836,0.0043312036,0.0004894991,0.000721986,0.0009982695,0.00017539159],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069657345,0.0013439653,0.0022235,0.002210954,0.00080367154,0.0010819692,0.003543384,0.0020866115,0.002503162],"category_scores_gemma":[0.019742766,0.0006786013,0.00211901,0.0027139955,0.001096612,0.002050682,0.0017478731,0.0031181313,0.0011633513],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021324641,0.00027662163,0.0072185714,0.00046565905,0.00054231135,0.00029896502,0.0004305178,0.34551653,0.007989461,0.055842504,0.008840239,0.57236534],"study_design_scores_gemma":[0.000021614875,0.000081513965,0.0006440867,0.000020033853,0.00003156848,0.00008217907,0.000021884456,0.9836083,0.0008774934,0.011157886,0.0034243385,0.00002915456],"about_ca_topic_score_codex":0.0032017753,"about_ca_topic_score_gemma":0.0026936159,"teacher_disagreement_score":0.0069657345,"about_ca_system_score_codex":0.00055369985,"about_ca_system_score_gemma":0.0016101144,"threshold_uncertainty_score":0.03683883},"labels":[],"label_agreement":null},{"id":"W3207567276","doi":"10.1080/02664763.2024.2317312","title":"Multiple observers ranked set samples for shrinkage estimators","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Fuzzy Systems and Optimization","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"RSS; Statistics; Collinearity; Estimator; Linear regression; Data set; Mathematics; Regression analysis; Lasso (programming language); Computer science; Shrinkage; Multicollinearity; Logistic regression; Data mining","score_opus":0.06952640954494788,"score_gpt":0.3267111903633924,"score_spread":0.25718478081844454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3207567276","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025036489,0.00007394326,0.9970132,0.000033474385,0.000016439775,0.00004191531,0.000022478225,0.00005309062,0.00024181585],"genre_scores_gemma":[0.17802681,0.00042305066,0.81614685,0.00021535395,0.0001617304,0.0010477852,0.0005393099,0.00016153218,0.0032776673],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99031633,0.0071072145,0.0002972945,0.000719521,0.001318446,0.0002412239],"domain_scores_gemma":[0.973925,0.019904563,0.001169536,0.0020862012,0.0026883914,0.00022630827],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0210481,0.0011304176,0.0013312225,0.0012739185,0.0006282107,0.0011749833,0.0022077144,0.0015645347,0.003166325],"category_scores_gemma":[0.05024125,0.0007733009,0.001663929,0.0010257801,0.0015830556,0.0019039642,0.0020309978,0.0026652806,0.00089097314],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005831593,0.00023874654,0.0064466647,0.0007670332,0.00045114072,0.00037239457,0.0007096219,0.32149455,0.011513729,0.38220006,0.003857349,0.27136555],"study_design_scores_gemma":[0.000050660623,0.00016204503,0.00090334716,0.000055762725,0.000047708578,0.000065409266,0.000051971572,0.9514644,0.0033854756,0.04109422,0.002680748,0.000038316353],"about_ca_topic_score_codex":0.0015072856,"about_ca_topic_score_gemma":0.0016780979,"teacher_disagreement_score":0.0210481,"about_ca_system_score_codex":0.00086896744,"about_ca_system_score_gemma":0.0012363843,"threshold_uncertainty_score":0.1113143},"labels":[],"label_agreement":null},{"id":"W4200286052","doi":"10.1080/02664763.2021.2017413","title":"Pearson's goodness-of-fit tests for sparse distributions","year":2021,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Lakehead University","funders":"Tianjin University; National Key Research and Development Program of China; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China; National Science Foundation","keywords":"Pearson's chi-squared test; Mathematics; Goodness of fit; Statistics; Chi-square test; Categorical variable; Test statistic; Statistic; Pearson product-moment correlation coefficient; Mean squared error; Statistical hypothesis testing","score_opus":0.19727193181187358,"score_gpt":0.4524682452303399,"score_spread":0.2551963134184663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200286052","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020125508,0.0008243177,0.9739213,0.00047347666,0.00016286249,0.00035052284,0.00066476513,0.0006021768,0.0028750382],"genre_scores_gemma":[0.47432175,0.0011411065,0.51502305,0.00079785474,0.00058689294,0.0032968966,0.0019395148,0.00049627287,0.0023967072],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9583253,0.027431063,0.0021252423,0.003928226,0.0074105132,0.0007796911],"domain_scores_gemma":[0.7146276,0.25054362,0.009551033,0.0162398,0.007779426,0.0012584806],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03623046,0.0013480264,0.0033947858,0.0061979163,0.0015608766,0.0021818972,0.0035170405,0.0025723076,0.008749176],"category_scores_gemma":[0.2836517,0.0007444031,0.0026611101,0.0074730334,0.0044656703,0.0053105652,0.0036770324,0.0044159605,0.0019013361],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009392945,0.00042306847,0.061822347,0.0019441867,0.0020880857,0.0022558616,0.0016623746,0.13560042,0.0041680303,0.43629405,0.025784558,0.32701784],"study_design_scores_gemma":[0.0002643719,0.0010822654,0.025719512,0.00064139254,0.00032614594,0.0024186438,0.0008581372,0.49509835,0.0032715292,0.4468462,0.023203345,0.00027011125],"about_ca_topic_score_codex":0.0013474032,"about_ca_topic_score_gemma":0.00090737327,"teacher_disagreement_score":0.03623046,"about_ca_system_score_codex":0.001162524,"about_ca_system_score_gemma":0.0028966006,"threshold_uncertainty_score":0.1916073},"labels":[],"label_agreement":null},{"id":"W4210655835","doi":"10.1080/02664763.2022.2031125","title":"The Kendall interaction filter for variable interaction screening in high dimensional classification problems","year":2022,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Natural Sciences and Engineering Research Council of Canada; Université du Québec à Montréal","keywords":"Categorical variable; Computer science; Measure (data warehouse); Monotonic function; Variable (mathematics); Identification (biology); Interaction; Filter (signal processing); Machine learning; Artificial intelligence; Data mining; Mathematics","score_opus":0.12165883727174664,"score_gpt":0.3661828880895972,"score_spread":0.24452405081785056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210655835","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013387925,0.0003445835,0.9851681,0.00014205588,0.000036809874,0.00006692172,0.00010418464,0.00030762653,0.00044180424],"genre_scores_gemma":[0.40894708,0.00068333885,0.5851303,0.00042963575,0.00027736672,0.0008764786,0.0012728741,0.00019694635,0.002186057],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9913755,0.0051605115,0.00045905763,0.0010986085,0.0015528675,0.0003534923],"domain_scores_gemma":[0.96869653,0.026320042,0.0015213188,0.0017597508,0.0012696127,0.0004327816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015356815,0.0013092689,0.0022564179,0.0035193742,0.0016978921,0.0016587947,0.0022433246,0.001912885,0.002567256],"category_scores_gemma":[0.04259111,0.000531799,0.00219196,0.0036106536,0.0019328357,0.0025810662,0.0017638651,0.002758273,0.00051369006],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010640675,0.000489517,0.036579538,0.00090166694,0.0017777206,0.00079640385,0.0006405986,0.2564187,0.007382247,0.1831312,0.008622745,0.50219566],"study_design_scores_gemma":[0.000045552544,0.000312659,0.005275857,0.00004837556,0.0001455259,0.0001804059,0.0000658838,0.9064617,0.0024732691,0.08182471,0.0030913064,0.000074694224],"about_ca_topic_score_codex":0.003985655,"about_ca_topic_score_gemma":0.0045181364,"teacher_disagreement_score":0.015356815,"about_ca_system_score_codex":0.0012236113,"about_ca_system_score_gemma":0.0031703566,"threshold_uncertainty_score":0.08121556},"labels":[],"label_agreement":null},{"id":"W4214628116","doi":"10.1080/02664763.2022.2041566","title":"Logarithmic confidence estimation of a ratio of binomial proportions for dependent populations","year":2022,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Process Monitoring","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"Kazan Federal University; Kasetsart University","keywords":"Confidence interval; Statistics; Mathematics; Estimator; Coverage probability; Binomial proportion confidence interval; Logarithm; Ratio estimator; Interval estimation; Tolerance interval; Monte Carlo method; Sample size determination; Negative binomial distribution; Bias of an estimator; Poisson distribution; Minimum-variance unbiased estimator","score_opus":0.1423891164881695,"score_gpt":0.43763149706737403,"score_spread":0.29524238057920454,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4214628116","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01457469,0.0005896232,0.9828151,0.00013192027,0.00004238563,0.00006047278,0.00006575203,0.00024007964,0.0014799853],"genre_scores_gemma":[0.59608877,0.000940753,0.4001345,0.000256212,0.00021444126,0.00048187986,0.00055344246,0.00018372452,0.0011463056],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97862923,0.011496107,0.0011314902,0.0035029466,0.00469696,0.00054333213],"domain_scores_gemma":[0.8163763,0.15745988,0.00850387,0.008558251,0.00812426,0.0009774294],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.030606857,0.0009582736,0.0015925014,0.004080337,0.00065487257,0.0026976254,0.0036450273,0.00201074,0.0029302307],"category_scores_gemma":[0.2499518,0.00049113046,0.0015640603,0.002541614,0.0030267066,0.0052161384,0.003451932,0.002864025,0.0006908473],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0013131399,0.00021037886,0.04217751,0.0014533665,0.0005599893,0.0011454988,0.0018519345,0.23711091,0.009394588,0.32012558,0.0029322586,0.38172486],"study_design_scores_gemma":[0.00008415099,0.00031840862,0.0076242816,0.0002784404,0.00015059215,0.0010381014,0.00028631877,0.86544317,0.007674617,0.112503536,0.004454779,0.00014359137],"about_ca_topic_score_codex":0.0010430715,"about_ca_topic_score_gemma":0.0003833678,"teacher_disagreement_score":0.030606857,"about_ca_system_score_codex":0.0011687635,"about_ca_system_score_gemma":0.0009967895,"threshold_uncertainty_score":0.16186643},"labels":[],"label_agreement":null},{"id":"W4224928706","doi":"10.1080/02664763.2022.2064440","title":"Bayesian Markov Chain Monte Carlo for reparameterized Stochastic volatility models using Asian FX rates <b>during Covid-19</b>","year":2022,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Imperial College London; McGill University","keywords":"Markov chain Monte Carlo; Stochastic volatility; Bayesian probability; Volatility (finance); Autocorrelation; Monte Carlo method; Econometrics; Markov chain; Mathematics; Approximate Bayesian computation; Coronavirus disease 2019 (COVID-19); Statistical physics; Applied mathematics; Computer science; Statistics; Physics; Artificial intelligence; Medicine","score_opus":0.0606067351453571,"score_gpt":0.2838054273426945,"score_spread":0.22319869219733737,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4224928706","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.032560293,0.00026612636,0.9649653,0.00038020324,0.00003902308,0.000049393537,0.00012135574,0.0002686388,0.0013497596],"genre_scores_gemma":[0.6436254,0.00086314755,0.3473386,0.00034921287,0.00014161423,0.00043169994,0.0011101345,0.0004198625,0.005720257],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99875474,0.00080232206,0.00004467712,0.00016203857,0.00014105061,0.000095152616],"domain_scores_gemma":[0.99128586,0.007085467,0.00045059278,0.00045101604,0.0005269322,0.0002001482],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0052452865,0.00061888417,0.0011224801,0.00095567823,0.00088406116,0.0014373461,0.0018347192,0.0013796916,0.00471353],"category_scores_gemma":[0.01751604,0.0009652619,0.0010587086,0.0010860153,0.0014611551,0.0024548394,0.0012911101,0.0031385184,0.0006392941],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000090694804,0.000052619536,0.0017921107,0.000044550765,0.000053441752,0.00008716712,0.00012312761,0.87202394,0.000510087,0.10933129,0.00075674464,0.015134164],"study_design_scores_gemma":[0.000007157148,0.000005266671,0.000098058874,0.000007649285,0.0000037565364,0.0000061484784,0.000006655741,0.9831434,0.00011224464,0.016397875,0.00020455806,0.0000072073963],"about_ca_topic_score_codex":0.02225583,"about_ca_topic_score_gemma":0.023656093,"teacher_disagreement_score":0.02225583,"about_ca_system_score_codex":0.0017773921,"about_ca_system_score_gemma":0.0023708933,"threshold_uncertainty_score":0.044252574},"labels":[],"label_agreement":null},{"id":"W4232213304","doi":"10.1080/02664763.2016.1264701","title":"Editorial","year":2017,"lang":"en","type":"editorial","venue":"Journal of Applied Statistics","topic":"","field":"","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Specialized Research Fund for the Doctoral Program of Higher Education of China; Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China; Fonds De La Recherche Scientifique - FNRS; Deutsche Forschungsgemeinschaft","keywords":"Computer science; Statistics; Mathematics","score_opus":0.009989680985973942,"score_gpt":0.30116442590020437,"score_spread":0.29117474491423045,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4232213304","genre_codex":"editorial","genre_gemma":"editorial","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"editorial","genre_consensus":"editorial","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000035813468,0.0024474636,0.00012391621,0.03363609,0.96074086,0.000029750776,0.00009716994,0.00007968702,0.0028092747],"genre_scores_gemma":[0.00041998722,0.0022004717,0.00013040155,0.019688554,0.9637481,0.000042324285,0.00009523019,0.000080164646,0.013594712],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.990419,0.0018299768,0.0010427823,0.0009965084,0.0049117594,0.00080003234],"domain_scores_gemma":[0.9423818,0.012943168,0.0044720815,0.0023750458,0.029486118,0.00834178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007932615,0.0031522932,0.003883556,0.0061009387,0.0032176508,0.010205215,0.003028218,0.010859906,0.043188684],"category_scores_gemma":[0.069038235,0.0010891752,0.0023496589,0.0022189661,0.0023861409,0.0034227755,0.0025504576,0.012545782,0.037804022],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012352018,0.000004731146,0.000019457153,0.000049748778,0.00000775616,0.0000474393,0.0000030199362,0.000006563242,0.000010719222,0.000090817644,0.99668956,0.00305789],"study_design_scores_gemma":[0.00007437323,0.000017672823,0.00024290715,0.00042174742,0.000042080348,0.00026474812,0.00003111979,0.00009664889,0.00008030566,0.0014175535,0.9972933,0.000017570663],"about_ca_topic_score_codex":0.0013352718,"about_ca_topic_score_gemma":0.0037805464,"teacher_disagreement_score":0.043188684,"about_ca_system_score_codex":0.002902284,"about_ca_system_score_gemma":0.005576587,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4284990586","doi":"10.1080/02664763.2022.2097204","title":"A flexible test for early-stage studies with multiple endpoints","year":2022,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Aging; Institute of Aging; University of Kansas Medical Center; National Institutes of Health; National Center for Advancing Translational Sciences; University of Kansas","keywords":"Null hypothesis; Parametric statistics; Statistical hypothesis testing; Computer science; Statistics; Test (biology); Type I and type II errors; Null (SQL); Econometrics; Sample size determination; Mathematics; Machine learning; Data mining","score_opus":0.21459634131199407,"score_gpt":0.38375300150811786,"score_spread":0.1691566601961238,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4284990586","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0387959,0.0006494742,0.9498645,0.0013646866,0.00061625417,0.0020545314,0.0013065251,0.0014072647,0.0039409325],"genre_scores_gemma":[0.54328465,0.00021257553,0.43954897,0.0018474307,0.00051048666,0.009914524,0.0020427122,0.00046464894,0.0021739977],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8231616,0.1250808,0.0099576805,0.018073928,0.02146625,0.0022597644],"domain_scores_gemma":[0.26937562,0.65832967,0.021109471,0.03922587,0.009388414,0.0025709209],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.17819868,0.0021831028,0.0038855302,0.0040381732,0.0023129992,0.0037315218,0.008325009,0.0064090113,0.015628912],"category_scores_gemma":[0.52677786,0.0010687612,0.0061323005,0.0048498632,0.0058410354,0.008499613,0.0064298753,0.009681539,0.0020151946],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.012387663,0.0013870931,0.11380089,0.0029447197,0.008623506,0.0028963909,0.002297817,0.036603417,0.007322703,0.15870957,0.019305112,0.6337212],"study_design_scores_gemma":[0.004803133,0.018982459,0.12433466,0.0014396372,0.0028260287,0.0038220237,0.0008896608,0.39702684,0.011781895,0.3913267,0.041839592,0.0009273689],"about_ca_topic_score_codex":0.0008545765,"about_ca_topic_score_gemma":0.00059882825,"teacher_disagreement_score":0.8218013,"about_ca_system_score_codex":0.0015574256,"about_ca_system_score_gemma":0.0034670674,"threshold_uncertainty_score":0.94241595},"labels":[],"label_agreement":null},{"id":"W4307243917","doi":"10.1080/02664763.2022.2138838","title":"A two-stage latent factor regression method to model the common and unique effects of multiple highly correlated exposure variables","year":2022,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Air Quality and Health Impacts","field":"Environmental Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Saskatchewan; Dalhousie University","funders":"Natural Sciences and Engineering Research Council of Canada; Dalhousie University; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Multicollinearity; Variance inflation factor; Statistics; Latent variable; Econometrics; Regression analysis; Collinearity; Variance (accounting); Regression; Mathematics; Regression diagnostic; Factor analysis; Linear regression; Latent variable model; Estimator; Factor regression model; Principal component analysis; Proper linear model; Polynomial regression","score_opus":0.028183303826129203,"score_gpt":0.3158498331322785,"score_spread":0.2876665293061493,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4307243917","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023017284,0.00015876156,0.99687105,0.00006411201,0.00003118488,0.00006465917,0.00010016758,0.0001761762,0.00023218096],"genre_scores_gemma":[0.17769805,0.001315285,0.8093282,0.00016551548,0.00017005896,0.00128958,0.0010729439,0.00027958266,0.008680744],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9972947,0.0016772114,0.00009320449,0.000464172,0.00030965343,0.00016097505],"domain_scores_gemma":[0.9969785,0.0020987077,0.00026243972,0.00022019212,0.00038176228,0.000058425725],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005874641,0.0017897069,0.0014288326,0.0013986683,0.00047375154,0.0009914279,0.0025416696,0.0013340223,0.0043651457],"category_scores_gemma":[0.008380818,0.0007090566,0.003016377,0.0023530258,0.0007944018,0.0015375811,0.0012273717,0.0025368035,0.0015176444],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045274952,0.00041294098,0.0152832195,0.00081990665,0.00094826135,0.00039544157,0.00068007276,0.554425,0.008088289,0.12687573,0.006518284,0.2851002],"study_design_scores_gemma":[0.00003239757,0.00015963885,0.0011795582,0.000040855164,0.00009888257,0.0001094859,0.00003338644,0.97916967,0.0009046377,0.013852346,0.004360632,0.0000584541],"about_ca_topic_score_codex":0.0102904085,"about_ca_topic_score_gemma":0.008678623,"teacher_disagreement_score":0.0102904085,"about_ca_system_score_codex":0.0007144065,"about_ca_system_score_gemma":0.0023439105,"threshold_uncertainty_score":0.031068385},"labels":[],"label_agreement":null},{"id":"W4319072054","doi":"10.1080/02664763.2023.2172143","title":"Bayesian adaptive selection of basis functions for functional data representation","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Functional data analysis; Basis (linear algebra); Computer science; Basis function; Bayesian probability; Representation (politics); Context (archaeology); Selection (genetic algorithm); Mathematics; Machine learning; Artificial intelligence","score_opus":0.2690950358091204,"score_gpt":0.41425535177611555,"score_spread":0.14516031596699513,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4319072054","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023135364,0.00006839825,0.9973066,0.00006196078,0.000008580735,0.000019888157,0.000022236982,0.00004768182,0.00015106458],"genre_scores_gemma":[0.2200264,0.0005490323,0.77620906,0.00022954136,0.00011077908,0.0006138585,0.00045745104,0.00017756147,0.0016262754],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9977124,0.0014591459,0.00007288442,0.00024644958,0.00039657135,0.000112615584],"domain_scores_gemma":[0.9953956,0.003392439,0.00027333657,0.00033460703,0.0004658231,0.00013805338],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005350978,0.000728353,0.001254153,0.001135575,0.00045875218,0.0010443361,0.0014449442,0.0011165257,0.00210506],"category_scores_gemma":[0.013045669,0.00054499996,0.0012862618,0.00096606096,0.0012136602,0.0011314534,0.001816784,0.0024362656,0.00061152416],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021491077,0.00014730032,0.0025739353,0.00022453828,0.00017039668,0.00014502936,0.00022572989,0.69599867,0.006523027,0.1301859,0.00225309,0.16133751],"study_design_scores_gemma":[0.000017550808,0.000025805648,0.00024873216,0.000017406655,0.000009763011,0.00003000885,0.000007724429,0.97770315,0.0005934976,0.020578414,0.0007539603,0.000013918872],"about_ca_topic_score_codex":0.0028217593,"about_ca_topic_score_gemma":0.0030612345,"teacher_disagreement_score":0.005350978,"about_ca_system_score_codex":0.0006311478,"about_ca_system_score_gemma":0.0018274505,"threshold_uncertainty_score":0.028299034},"labels":[],"label_agreement":null},{"id":"W4383533098","doi":"10.1080/02664763.2023.2232127","title":"Family of bivariate distributions on the unit square: theoretical properties and applications","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Conselho Nacional de Desenvolvimento Científico e Tecnológico; Fundação de Apoio à Pesquisa do Distrito Federal; Coordenação de Aperfeiçoamento de Pessoal de Nível Superior","keywords":"Bivariate analysis; Quantile; Mathematics; Marginal distribution; Statistics; Preprint; Monte Carlo method; Bivariate data; Independence (probability theory); Unit square; Unit (ring theory); Applied mathematics; Combinatorics; Random variable; Computer science","score_opus":0.14446447072446472,"score_gpt":0.3823033967727893,"score_spread":0.23783892604832457,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4383533098","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.015095656,0.0005158262,0.9809059,0.0003460185,0.000032835676,0.000028263124,0.00018797565,0.00013126995,0.0027561588],"genre_scores_gemma":[0.7935883,0.0045070094,0.18997869,0.00048451265,0.00028378208,0.00041180843,0.00090848026,0.0002545119,0.009582876],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99886286,0.0004974131,0.000036227917,0.000205951,0.00028112577,0.00011647745],"domain_scores_gemma":[0.99518824,0.0027004755,0.0005815045,0.0005120733,0.00075879815,0.00025890427],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00283007,0.0007310968,0.00088591716,0.0017230329,0.00049153017,0.0014967738,0.0013400664,0.00079222274,0.005772721],"category_scores_gemma":[0.011034371,0.00038149898,0.00091782754,0.0027989899,0.0018609689,0.002367832,0.0014535243,0.0022177177,0.0011321219],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000069430585,0.000041490854,0.004112695,0.00011154409,0.000048034948,0.00038291616,0.00024706157,0.080906324,0.0018995809,0.86885065,0.0034837194,0.039846506],"study_design_scores_gemma":[0.000020976386,0.000054779615,0.0018571442,0.000050253788,0.000023620916,0.00056501507,0.0001256676,0.5819328,0.00062525185,0.40842393,0.00627299,0.000047537465],"about_ca_topic_score_codex":0.0029564747,"about_ca_topic_score_gemma":0.0012817864,"teacher_disagreement_score":0.005772721,"about_ca_system_score_codex":0.0009254479,"about_ca_system_score_gemma":0.0009769069,"threshold_uncertainty_score":0.019311666},"labels":[],"label_agreement":null},{"id":"W4386742233","doi":"10.1080/02664763.2023.2258301","title":"The spike-and-slab lasso and scalable algorithm to accommodate multinomial outcomes in variable selection problems","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Canadian Institutes of Health Research; National Institutes of Health; Genentech; IXICO; H. Lundbeck A/S; Servier; Eisai; Northern California Institute for Research and Education; Pfizer; Novartis Pharmaceuticals Corporation; University of Southern California; Biogen; Eli Lilly and Company; Bristol-Myers Squibb; BioClinica; U.S. Department of Defense; Alzheimer's Disease Neuroimaging Initiative; Meso Scale Diagnostics; National Institute on Aging; Alzheimer's Association","keywords":"Categorical variable; Prior probability; Multinomial distribution; Lasso (programming language); Computer science; Bayesian probability; Model selection; Algorithm; Multinomial probit; Variable (mathematics); Generalization; Econometrics; Mathematical optimization; Mathematics; Multinomial logistic regression; Machine learning; Artificial intelligence","score_opus":0.030928941227488013,"score_gpt":0.3379198239562676,"score_spread":0.30699088272877956,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386742233","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011553605,0.00012002682,0.9975793,0.00022068608,0.000028422568,0.000036292022,0.00009245467,0.00032982347,0.00043774047],"genre_scores_gemma":[0.0580619,0.00039462623,0.9357138,0.00068003114,0.00024074134,0.00072950986,0.001076393,0.0005418556,0.0025610963],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9954829,0.0029208711,0.00020484718,0.0004625839,0.0006674104,0.00026141873],"domain_scores_gemma":[0.9941981,0.0040466078,0.00039216617,0.00057297427,0.0005406162,0.0002496488],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007504314,0.0018811928,0.0022864148,0.00096524344,0.0009835595,0.0016139399,0.0026478826,0.0023067344,0.0061765537],"category_scores_gemma":[0.01894497,0.0010649043,0.00172349,0.002106549,0.0014177191,0.0021350433,0.0033984855,0.0050570397,0.0022474686],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032901735,0.00018009453,0.0021255491,0.0004539318,0.00030661546,0.0003844699,0.0003954375,0.57154375,0.0032492054,0.13531062,0.026082994,0.25963834],"study_design_scores_gemma":[0.000058268997,0.000039594186,0.00015888868,0.00004191027,0.000014903077,0.00006360177,0.000030650186,0.91906977,0.0004686846,0.0767653,0.0032683704,0.00002006995],"about_ca_topic_score_codex":0.0034274666,"about_ca_topic_score_gemma":0.0056955554,"teacher_disagreement_score":0.007504314,"about_ca_system_score_codex":0.0006935476,"about_ca_system_score_gemma":0.0037416238,"threshold_uncertainty_score":0.039687097},"labels":[],"label_agreement":null},{"id":"W4386996496","doi":"10.1080/02664763.2023.2260572","title":"Estimating the prevalence of osteoporosis using ranked-based methodologies and Manitoba's population-based BMD registry","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Bone health and osteoporosis research","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Manitoba","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Medicine; Osteoporosis; Statistics; Population; Demography; Environmental health; Mathematics; Internal medicine","score_opus":0.10055409936087145,"score_gpt":0.400756879025482,"score_spread":0.30020277966461056,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386996496","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.76571566,0.0005931582,0.22664371,0.0003980954,0.00003188466,0.0014272833,0.0027265013,0.0001634402,0.0023002531],"genre_scores_gemma":[0.79993004,0.00041152482,0.19451414,0.00015684555,0.000012298152,0.0012880244,0.0024656171,0.000015589912,0.0012058658],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.98692745,0.010999155,0.0002891008,0.00060934573,0.00087778165,0.00029719292],"domain_scores_gemma":[0.9880172,0.007156059,0.0014985253,0.0010630995,0.002064542,0.0002004993],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016038183,0.00050108496,0.00063440384,0.002579493,0.00082193356,0.0009332359,0.0017600082,0.0006446707,0.0010285627],"category_scores_gemma":[0.028233439,0.00055851083,0.0011774416,0.0027482323,0.0006305084,0.00035597626,0.0011283976,0.0005101699,0.00014769602],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008244703,0.0006110837,0.6928553,0.00030652,0.001298085,0.00035817214,0.0010179733,0.20687267,0.001665387,0.015122654,0.0018347265,0.077232905],"study_design_scores_gemma":[0.00028064157,0.0010046265,0.3342397,0.00018666092,0.00052823575,0.00039150598,0.0020369343,0.6433015,0.0018245629,0.011820233,0.0042336853,0.00015174356],"about_ca_topic_score_codex":0.28611535,"about_ca_topic_score_gemma":0.28223017,"teacher_disagreement_score":0.71388465,"about_ca_system_score_codex":0.003396256,"about_ca_system_score_gemma":0.0055821296,"threshold_uncertainty_score":0.5688999},"labels":[],"label_agreement":null},{"id":"W4387972453","doi":"10.1080/02664763.2023.2272223","title":"Improving the Hosmer-Lemeshow goodness-of-fit test in large models with replicated Bernoulli trials","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Economic and Environmental Valuation","field":"Economics, Econometrics and Finance","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Goodness of fit; Covariate; Logistic regression; Statistics; Type I and type II errors; Bernoulli trial; Bernoulli's principle; Mathematics; Test (biology); Sample size determination; Computer science; Econometrics; Biology","score_opus":0.1822081850794053,"score_gpt":0.27385853381424047,"score_spread":0.09165034873483516,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4387972453","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.057270184,0.0012417348,0.93582904,0.0017974298,0.00021268442,0.00045229393,0.0004211252,0.0011616058,0.0016139268],"genre_scores_gemma":[0.5568715,0.0005046009,0.4370095,0.0013941767,0.00045150588,0.0013416606,0.0008749248,0.00064643106,0.0009056625],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8492379,0.13250147,0.0041197254,0.006863388,0.0061463015,0.0011311999],"domain_scores_gemma":[0.26117453,0.6921115,0.010707973,0.027705848,0.0066173403,0.0016827587],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.17210868,0.0017675364,0.0046883393,0.003922544,0.0019566156,0.0036526013,0.0049733375,0.004312179,0.0057232743],"category_scores_gemma":[0.55345166,0.0012249063,0.0034952227,0.0051078303,0.0060444474,0.0064683454,0.0054704365,0.0057978737,0.0011647668],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004728133,0.0006316396,0.15239882,0.002080911,0.005860642,0.0027764738,0.003975013,0.2735187,0.0037692187,0.11423261,0.016209396,0.41981843],"study_design_scores_gemma":[0.00080015644,0.0021006058,0.026091544,0.0004232466,0.00070250814,0.0011070211,0.0008852339,0.74858105,0.003880908,0.20694287,0.008093701,0.00039116634],"about_ca_topic_score_codex":0.003559049,"about_ca_topic_score_gemma":0.0027762505,"teacher_disagreement_score":0.17210868,"about_ca_system_score_codex":0.0013807775,"about_ca_system_score_gemma":0.0045748977,"threshold_uncertainty_score":0.9102086},"labels":[],"label_agreement":null},{"id":"W4388421561","doi":"10.1080/02664763.2023.2277669","title":"A computationally efficient sequential regression imputation algorithm for multilevel data","year":2023,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Imputation (statistics); Computer science; Missing data; Computation; Singleton; Algorithm; Regression; Data mining; Statistics; Machine learning; Mathematics","score_opus":0.13883124269288116,"score_gpt":0.43675601875730574,"score_spread":0.2979247760644246,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4388421561","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010237108,0.000044268843,0.9984011,0.00009244659,0.000020550753,0.00003665098,0.00005480425,0.00018090467,0.00014555796],"genre_scores_gemma":[0.019427165,0.000087617715,0.97928363,0.0000622303,0.000039433195,0.00030778968,0.00023251072,0.00005624024,0.00050341163],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99625695,0.002245747,0.00024435858,0.00045780677,0.00069169985,0.00010335413],"domain_scores_gemma":[0.99431014,0.0034054175,0.0005321825,0.00075236306,0.0008810354,0.00011881847],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007301848,0.00063186104,0.0013082611,0.0012158226,0.0008229653,0.0008927814,0.0020024364,0.0010452584,0.004344176],"category_scores_gemma":[0.019762645,0.0006736593,0.001451923,0.0030384604,0.0004548582,0.0012938898,0.0020018017,0.00284786,0.0014470036],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00029243587,0.00018700355,0.0048575,0.00033204863,0.0005263479,0.00016041534,0.00033596208,0.16275178,0.0039764033,0.07818075,0.012908765,0.7354906],"study_design_scores_gemma":[0.00012876606,0.00012985212,0.0009743953,0.000042928954,0.000074924,0.0002187904,0.000040046638,0.9355165,0.0014945231,0.05287055,0.008470575,0.00003809364],"about_ca_topic_score_codex":0.0036585426,"about_ca_topic_score_gemma":0.005705607,"teacher_disagreement_score":0.007301848,"about_ca_system_score_codex":0.0005862832,"about_ca_system_score_gemma":0.00264474,"threshold_uncertainty_score":0.03861636},"labels":[],"label_agreement":null},{"id":"W4391681347","doi":"10.1080/02664763.2024.2313459","title":"Estimating effects of time-varying exposures on mortality risk","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Health Systems, Economic Evaluations, Quality of Life","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"St. Paul's Hospital; Simon Fraser University","funders":"National Institute on Drug Abuse; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Statistics; Econometrics; Mathematics; Environmental science","score_opus":0.1425939188732576,"score_gpt":0.4118796880386475,"score_spread":0.26928576916538993,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391681347","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8338521,0.0009777137,0.15957089,0.0009869095,0.0000614675,0.00027775377,0.0024953217,0.00031818837,0.0014597536],"genre_scores_gemma":[0.969949,0.000636144,0.026377657,0.00014207335,0.000058502566,0.00023574106,0.0012803703,0.000023129665,0.0012973434],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9917154,0.0059703365,0.0002778036,0.0012824798,0.00036316607,0.00039077373],"domain_scores_gemma":[0.92672735,0.06457888,0.004860327,0.0027800703,0.00062537444,0.00042804235],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01953324,0.0008512435,0.0011665517,0.001999103,0.00042525274,0.0013677503,0.0014293343,0.0015530991,0.0023763685],"category_scores_gemma":[0.054197717,0.0007151742,0.002772985,0.0016485701,0.0010080857,0.0013414748,0.0018237785,0.0022676664,0.0003832737],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007368313,0.00055867527,0.727117,0.00016954087,0.0028566702,0.0003593984,0.00052398915,0.19290912,0.00096067437,0.012736593,0.0007304909,0.060340878],"study_design_scores_gemma":[0.0001271899,0.0011865633,0.31120262,0.000112305934,0.0015167716,0.00017268336,0.00043598365,0.66006786,0.0017162516,0.020989737,0.002359009,0.000112933805],"about_ca_topic_score_codex":0.020034753,"about_ca_topic_score_gemma":0.012169758,"teacher_disagreement_score":0.020034753,"about_ca_system_score_codex":0.0010844712,"about_ca_system_score_gemma":0.0013503047,"threshold_uncertainty_score":0.10330284},"labels":[],"label_agreement":null},{"id":"W4397013935","doi":"10.1080/02664763.2024.2355551","title":"Z-residual diagnostic tool for assessing covariate functional form in shared frailty models","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University; University of Saskatchewan","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Residual; Computer science; Data mining; Statistics; Econometrics; Mathematics; Machine learning; Algorithm","score_opus":0.20880257825316087,"score_gpt":0.404266068349312,"score_spread":0.19546349009615113,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4397013935","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020782018,0.0002265639,0.9765187,0.0002093091,0.00003859516,0.00007359734,0.00038158902,0.0010852338,0.0006843491],"genre_scores_gemma":[0.44116494,0.00027531103,0.5552838,0.00026282028,0.000063767,0.0004492557,0.001177225,0.00045755436,0.00086525886],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9944089,0.0036837084,0.00035807776,0.00062581757,0.00074461754,0.00017883693],"domain_scores_gemma":[0.96160024,0.03073409,0.0026506393,0.0026129368,0.0019889693,0.00041319308],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011223184,0.0008467468,0.0010089187,0.002879072,0.00045784874,0.001042746,0.0018122421,0.001400481,0.004624728],"category_scores_gemma":[0.08069515,0.0002538936,0.0011719386,0.0018165954,0.0014256416,0.0015528101,0.0026314973,0.0022146725,0.00087656704],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080187485,0.00024585373,0.06732432,0.0009921711,0.00045099287,0.00077835756,0.00097350345,0.2005563,0.0071755596,0.23589416,0.011787028,0.47301987],"study_design_scores_gemma":[0.0001612046,0.00037381597,0.010093157,0.00020164417,0.0001042507,0.00066123327,0.00029508345,0.83032495,0.0054435055,0.14360532,0.008630315,0.00010554044],"about_ca_topic_score_codex":0.0028843898,"about_ca_topic_score_gemma":0.002370405,"teacher_disagreement_score":0.011223184,"about_ca_system_score_codex":0.00065433234,"about_ca_system_score_gemma":0.0019540482,"threshold_uncertainty_score":0.059354544},"labels":[],"label_agreement":null},{"id":"W4398174693","doi":"10.1080/02664763.2024.2352759","title":"Iterative smoothing for change-point regression function estimation","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Fire effects on ecosystems","field":"Environmental Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Canadian Statistical Sciences Institute; Natural Sciences and Engineering Research Council of Canada; University of Waterloo; Institute for Catastrophic Loss Reduction","keywords":"Smoothing; Outlier; Computer science; Robustness (evolution); Change detection; Data mining; Algorithm; Artificial intelligence; Computer vision","score_opus":0.015737665287759765,"score_gpt":0.27174935554534324,"score_spread":0.25601169025758347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398174693","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022398867,0.000118149386,0.99697316,0.00005804565,0.00001449592,0.000021509215,0.000027374641,0.0004334004,0.00011407319],"genre_scores_gemma":[0.14221619,0.0003482051,0.8538573,0.00012964926,0.000087426255,0.00041532298,0.00060567114,0.0005087139,0.0018315954],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9970987,0.001455578,0.0002041228,0.000503106,0.0005932571,0.00014526151],"domain_scores_gemma":[0.98224247,0.013938495,0.00079012936,0.0014227931,0.0014245487,0.00018151963],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008392631,0.0011883066,0.0019500906,0.001854117,0.0008182836,0.0011578249,0.0026886975,0.0022377593,0.0017691642],"category_scores_gemma":[0.038461544,0.0011827743,0.0021050891,0.0018949448,0.0016050586,0.00136625,0.0017660444,0.0037602196,0.0012058251],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001650848,0.00007878342,0.0025930055,0.00019424492,0.00026020323,0.00014531314,0.00022647828,0.82974803,0.0047450587,0.025605535,0.002033531,0.13420478],"study_design_scores_gemma":[0.0000064406413,0.000013109931,0.00021419773,0.000006277862,0.0000063509187,0.000015689604,0.0000074582963,0.991507,0.00067351444,0.006869166,0.00067094655,0.000009907632],"about_ca_topic_score_codex":0.015999451,"about_ca_topic_score_gemma":0.013004941,"teacher_disagreement_score":0.015999451,"about_ca_system_score_codex":0.0015115457,"about_ca_system_score_gemma":0.0023561309,"threshold_uncertainty_score":0.044385016},"labels":[],"label_agreement":null},{"id":"W4399243542","doi":"10.1080/02664763.2024.2360590","title":"Bayesian modeling framework for optimizing pre-hospital stroke triage decisions","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Acute Ischemic Stroke Management","field":"Medicine","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"National Institute of Neurological Disorders and Stroke; National Institutes of Health","keywords":"Triage; Bayesian probability; Stroke (engine); Computer science; Emergency medicine; Medicine; Artificial intelligence","score_opus":0.021925721050042285,"score_gpt":0.31793197808769735,"score_spread":0.29600625703765504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399243542","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.022666357,0.0007376275,0.96666414,0.0028386929,0.00009988455,0.00015136684,0.0009940726,0.00047754703,0.005370355],"genre_scores_gemma":[0.6713574,0.0014598956,0.31111127,0.0009691735,0.0003765601,0.0009753274,0.0020595663,0.0002597622,0.011431079],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99597836,0.0025979835,0.00012802657,0.0005256087,0.0004449957,0.00032501578],"domain_scores_gemma":[0.98751825,0.010000442,0.00093602453,0.0002252676,0.00097332825,0.00034670977],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007752547,0.0015354129,0.0028922171,0.0017837664,0.00088451576,0.0025572013,0.0030573793,0.0028043906,0.0051823426],"category_scores_gemma":[0.019652357,0.0017126667,0.001980285,0.00168788,0.001363152,0.0022190306,0.0019467961,0.0033141358,0.0009491696],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006127851,0.000034128523,0.0007948529,0.000037727652,0.0000640524,0.000064325184,0.00008289986,0.9586364,0.000114752555,0.031007713,0.0012895857,0.007812347],"study_design_scores_gemma":[0.000019401778,0.000013447989,0.00016099549,0.000011828667,0.000014013413,0.00000764302,0.000012661875,0.9839648,0.000028270588,0.015184655,0.00057232904,0.000009889812],"about_ca_topic_score_codex":0.047632694,"about_ca_topic_score_gemma":0.03830963,"teacher_disagreement_score":0.047632694,"about_ca_system_score_codex":0.0036008337,"about_ca_system_score_gemma":0.004144006,"threshold_uncertainty_score":0.09471089},"labels":[],"label_agreement":null},{"id":"W4399774164","doi":"10.1080/02664763.2024.2351467","title":"Identifying waves of COVID-19 mortality using skew normal curves","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Centre for Global Health Research; St. Michael's Hospital; University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Skew; Coronavirus disease 2019 (COVID-19); Demography; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Econometrics; Statistics; Geography; Mathematics; Medicine; Computer science; Telecommunications; Internal medicine; Outbreak; Sociology; Virology","score_opus":0.41372363974161586,"score_gpt":0.5089745621759725,"score_spread":0.09525092243435662,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399774164","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22389087,0.00065282336,0.7632211,0.0031193835,0.00022025131,0.00048256095,0.0024458347,0.0007011866,0.005266016],"genre_scores_gemma":[0.90383226,0.0010846162,0.08131713,0.00053542794,0.00017029933,0.0006626171,0.002572666,0.00019439781,0.009630588],"study_design_codex":"simulation_or_modeling","study_design_gemma":"observational","domain_scores_codex":[0.99508345,0.0027273018,0.00023199349,0.00091055006,0.00040154016,0.00064513285],"domain_scores_gemma":[0.98038095,0.01196761,0.0031325382,0.0019651502,0.0018465265,0.000707273],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019535441,0.0012602312,0.0017498512,0.0032093206,0.00069739006,0.0032153057,0.0034232342,0.0020574352,0.0047055935],"category_scores_gemma":[0.045304853,0.00081508246,0.003205811,0.0029050135,0.0019946794,0.004274422,0.0024973548,0.0031735664,0.0012231889],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00046604834,0.0001431331,0.1895824,0.00018004986,0.00049254805,0.0005462885,0.0017089157,0.54687655,0.000984119,0.1908903,0.0066362973,0.061493397],"study_design_scores_gemma":[0.000040076844,0.00009893964,0.014356279,0.00006060311,0.00006976014,0.00020569492,0.0003571891,0.88385147,0.00021472927,0.097552344,0.0031244117,0.00006851401],"about_ca_topic_score_codex":0.016108587,"about_ca_topic_score_gemma":0.011553667,"teacher_disagreement_score":0.019535441,"about_ca_system_score_codex":0.0020804885,"about_ca_system_score_gemma":0.0020703636,"threshold_uncertainty_score":0.10331452},"labels":[],"label_agreement":null},{"id":"W4401219420","doi":"10.1080/02664763.2024.2383286","title":"Mixtures of logistic normal multinomial regression models for microbiome data","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Gut microbiota and health","field":"Biochemistry, Genetics and Molecular Biology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Microbiome; Cluster analysis; Logistic regression; Computer science; Multinomial logistic regression; Mixture model; Covariate; Regression; Statistics; Data mining; Artificial intelligence; Biology; Machine learning; Mathematics; Bioinformatics","score_opus":0.045773993847910026,"score_gpt":0.3420589211448471,"score_spread":0.29628492729693706,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401219420","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046157823,0.00039453775,0.9939057,0.00022705119,0.000042296044,0.00004629422,0.00018010834,0.00031828458,0.0002700126],"genre_scores_gemma":[0.31985617,0.0017347176,0.66368276,0.00052451045,0.00039828307,0.00090749393,0.0027678863,0.0005700826,0.009558169],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99483913,0.0033988238,0.00021028871,0.0008149658,0.00048484278,0.0002519977],"domain_scores_gemma":[0.9865258,0.0105081415,0.0009832035,0.00079147524,0.0009426299,0.00024893926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011907283,0.0018152265,0.0020989508,0.0017920253,0.0008062641,0.0018496888,0.004652548,0.0025592989,0.0032855303],"category_scores_gemma":[0.028915947,0.0012750074,0.0030782248,0.0023204298,0.0019861658,0.002409862,0.0025155365,0.0043449267,0.0018481102],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018977423,0.00007879246,0.0037617662,0.00018327955,0.00015071308,0.0001909479,0.0002410111,0.87143904,0.0011660568,0.08284247,0.0026376634,0.0371185],"study_design_scores_gemma":[0.000006879474,0.000009443125,0.00014979074,0.000008167762,0.0000064179726,0.000019526999,0.000012500293,0.9874879,0.00009488791,0.011604852,0.0005885196,0.000011133207],"about_ca_topic_score_codex":0.019346379,"about_ca_topic_score_gemma":0.016326215,"teacher_disagreement_score":0.019346379,"about_ca_system_score_codex":0.0017914855,"about_ca_system_score_gemma":0.0017047013,"threshold_uncertainty_score":0.062972486},"labels":[],"label_agreement":null},{"id":"W4402456274","doi":"10.1080/02664763.2024.2401470","title":"Bayesian inference for Laplace distribution based on complete and censored samples with illustrations","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"Young Scientists Fund; Government of Jiangsu Province; Natural Science Foundation of Jiangsu Province; National Natural Science Foundation of China","keywords":"Inference; Bayesian probability; Bayesian inference; Laplace distribution; Econometrics; Statistics; Laplace transform; Mathematics; Statistical inference; Laplace's method; Distribution (mathematics); Bayesian linear regression; Computer science; Applied mathematics; Artificial intelligence; Exponential distribution","score_opus":0.06054244856844389,"score_gpt":0.3517124401438856,"score_spread":0.2911699915754417,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402456274","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005131936,0.00042204876,0.99246395,0.0002693701,0.000030762458,0.000041433836,0.00009164925,0.00009473335,0.0014541234],"genre_scores_gemma":[0.4615588,0.00368861,0.52623284,0.0007752382,0.0004646369,0.0007989893,0.0009950916,0.00016134264,0.0053244517],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9941121,0.0034340865,0.00026184265,0.00075946894,0.0011718366,0.00026069002],"domain_scores_gemma":[0.96039814,0.034089267,0.0015992825,0.0018138185,0.0017583217,0.00034117777],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.019054411,0.0009971785,0.0017058393,0.0032475158,0.00072562887,0.0029293213,0.0023632094,0.0020064628,0.005802128],"category_scores_gemma":[0.08531085,0.00083224196,0.0018557204,0.0025623986,0.0039312937,0.00540749,0.0025052035,0.0036377334,0.0008752238],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009883979,0.00006494286,0.0024322043,0.00027859604,0.00008319606,0.0003694904,0.0004814676,0.1325181,0.00076978304,0.8190827,0.0021271931,0.041693557],"study_design_scores_gemma":[0.000037478854,0.00004127116,0.00071628706,0.00011764079,0.000031674583,0.00021937779,0.0001032694,0.4712389,0.00056874927,0.5246322,0.0022480357,0.000045171455],"about_ca_topic_score_codex":0.0024904415,"about_ca_topic_score_gemma":0.002106064,"teacher_disagreement_score":0.019054411,"about_ca_system_score_codex":0.00145375,"about_ca_system_score_gemma":0.0017239043,"threshold_uncertainty_score":0.10077059},"labels":[],"label_agreement":null},{"id":"W4403764486","doi":"10.1080/02664763.2024.2418473","title":"Evaluating the median <i>p</i> -value method for assessing the statistical significance of tests when using multiple imputation","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; Sunnybrook Hospital; University of Toronto","funders":"Canadian Institutes of Health Research","keywords":"Statistics; Mathematics; Wilcoxon signed-rank test; Test statistic; Statistical significance; Statistic; Statistical hypothesis testing; Logistic regression; Student's t-test; p-value; F-test; Type I and type II errors; Pearson's chi-squared test; Linear regression; Pooling; Nominal level; Imputation (statistics); Missing data; Mann–Whitney U test; Computer science; Artificial intelligence","score_opus":0.15242597773040908,"score_gpt":0.5050042235663473,"score_spread":0.3525782458359382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403764486","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0046591656,0.001880666,0.98607606,0.00072837627,0.0004116376,0.0008273226,0.001202545,0.0016071975,0.0026070778],"genre_scores_gemma":[0.08338178,0.0008359567,0.90707695,0.000952997,0.00038019003,0.0036216574,0.0014234174,0.0011437021,0.0011832548],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8497927,0.10928937,0.008306933,0.014663083,0.016544998,0.0014027918],"domain_scores_gemma":[0.45476842,0.48181292,0.018167373,0.028036596,0.015632235,0.0015824158],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15200576,0.0024423026,0.0048585352,0.008549628,0.002238934,0.00607126,0.0060272887,0.005165371,0.012437904],"category_scores_gemma":[0.4841022,0.0013753303,0.0063190185,0.008681114,0.005165964,0.004550032,0.0044956026,0.00910665,0.0029135454],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027492694,0.0006722549,0.04732412,0.007508279,0.010027985,0.0017620428,0.001949548,0.041991677,0.0046768654,0.1422543,0.05899676,0.68008685],"study_design_scores_gemma":[0.0012204963,0.0031379708,0.031668913,0.004885089,0.0050133844,0.004854445,0.0013883025,0.3757039,0.025870841,0.4057844,0.13948067,0.0009915801],"about_ca_topic_score_codex":0.0021939948,"about_ca_topic_score_gemma":0.0015174486,"teacher_disagreement_score":0.8479942,"about_ca_system_score_codex":0.002098812,"about_ca_system_score_gemma":0.0066321474,"threshold_uncertainty_score":0.8038929},"labels":[],"label_agreement":null},{"id":"W4404762088","doi":"10.1080/02664763.2024.2433567","title":"Tests of covariate effects under finite Gaussian mixture regression models","year":2024,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Bat Biology and Ecology Studies","field":"Agricultural and Biological Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; University of Guelph","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Covariate; Statistics; Regression; Cluster analysis; Regression analysis; Population; Statistical hypothesis testing; Mixture model; Type I and type II errors; Econometrics; Statistical power; Mathematics; Computer science; Medicine","score_opus":0.023407624683698114,"score_gpt":0.2588780555190716,"score_spread":0.2354704308353735,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404762088","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.14483277,0.00045964515,0.8509161,0.0005576203,0.0000992958,0.00047522713,0.00076456333,0.0007855045,0.0011093174],"genre_scores_gemma":[0.7840367,0.00032558927,0.21070828,0.0003264368,0.0001641122,0.0010556127,0.0019641612,0.00022500596,0.0011940968],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8760753,0.09599963,0.0033651632,0.01746059,0.0049808407,0.0021184306],"domain_scores_gemma":[0.3589169,0.5971565,0.014482242,0.022530723,0.004974847,0.0019387644],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13086441,0.0018775905,0.0032951587,0.0025859394,0.0020387967,0.003144393,0.0067283376,0.004135427,0.0060701873],"category_scores_gemma":[0.3746777,0.0011319186,0.005677128,0.002663303,0.0064218165,0.0054504923,0.0037331053,0.004425726,0.0007808532],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009687308,0.0011136193,0.19485678,0.0016152774,0.009084226,0.0020981126,0.0046239165,0.40787858,0.008509276,0.158087,0.004094245,0.1983516],"study_design_scores_gemma":[0.00033356363,0.0015969865,0.03840112,0.00019131963,0.000670433,0.0003856907,0.0006417475,0.87831175,0.002839764,0.07463825,0.0018435571,0.00014568925],"about_ca_topic_score_codex":0.005451606,"about_ca_topic_score_gemma":0.0025107455,"teacher_disagreement_score":0.13086441,"about_ca_system_score_codex":0.0017773625,"about_ca_system_score_gemma":0.003190461,"threshold_uncertainty_score":0.6920854},"labels":[],"label_agreement":null},{"id":"W4406887934","doi":"10.1080/02664763.2025.2457011","title":"Penalized functional regression using R package PFLR","year":2025,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University; Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Discovery Eye Foundation","keywords":"R package; Statistics; Regression; Regression analysis; Computer science; Mathematics; Econometrics","score_opus":0.1246479271484594,"score_gpt":0.40539007199199856,"score_spread":0.28074214484353915,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406887934","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026749617,0.0011656418,0.8951328,0.00094974873,0.00034510056,0.0002656671,0.028451039,0.067657046,0.0033580218],"genre_scores_gemma":[0.05014734,0.0012987923,0.8350067,0.0011940408,0.00030421827,0.0028539526,0.029126463,0.068219006,0.011849447],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9926906,0.004173538,0.00051751046,0.0010536418,0.0013153126,0.0002493927],"domain_scores_gemma":[0.97166157,0.02115475,0.0015788964,0.0030794244,0.0022736306,0.00025173358],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011647536,0.0029541322,0.002457985,0.002981414,0.0005477964,0.0027113121,0.0034443568,0.0018505404,0.067299604],"category_scores_gemma":[0.060185216,0.0015539415,0.0037942377,0.0026507906,0.0010942692,0.0021954158,0.0027810151,0.0040459824,0.036740735],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00057780434,0.00016667145,0.00987896,0.0045822505,0.002658814,0.0008189532,0.00049436785,0.08084114,0.00459697,0.093891956,0.5451432,0.256349],"study_design_scores_gemma":[0.00041159143,0.00025744122,0.006882242,0.00088192674,0.0006634651,0.00094727083,0.00014546429,0.30236986,0.0068161557,0.16395587,0.51633364,0.0003351713],"about_ca_topic_score_codex":0.0049880645,"about_ca_topic_score_gemma":0.0059733386,"teacher_disagreement_score":0.067299604,"about_ca_system_score_codex":0.00086868386,"about_ca_system_score_gemma":0.003087638,"threshold_uncertainty_score":0.22513962},"labels":[],"label_agreement":null},{"id":"W4408655878","doi":"10.1080/02664763.2025.2481458","title":"Zero-inflated Poisson mixed model for longitudinal count data with informative dropouts","year":2025,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Count data; Zero-inflated model; Zero (linguistics); Statistics; Poisson distribution; Mathematics; Poisson regression; Overdispersion; Longitudinal data; Mixed model; Quasi-likelihood; Econometrics; Computer science; Medicine; Data mining; Population","score_opus":0.0772638870620557,"score_gpt":0.3879022313273999,"score_spread":0.3106383442653442,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408655878","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0068326863,0.0005714171,0.99100935,0.0003602807,0.00006732223,0.00011226414,0.00033149708,0.00017790918,0.0005372412],"genre_scores_gemma":[0.34005734,0.0032651497,0.6382504,0.0009128417,0.0005580103,0.002961249,0.0029931527,0.00026235927,0.010739514],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98923755,0.007878618,0.0004242376,0.001115257,0.00095161016,0.00039272194],"domain_scores_gemma":[0.96534526,0.027768029,0.0026611122,0.0019915134,0.0018033077,0.00043084534],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026787985,0.0014885822,0.0032368677,0.0027867444,0.0012955045,0.0023523665,0.0066470196,0.0029918347,0.0053053033],"category_scores_gemma":[0.051096883,0.0011710564,0.0027219907,0.0041633113,0.002163948,0.003189539,0.0025011648,0.0039561796,0.0011929373],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043177084,0.00015760577,0.012427762,0.00072568306,0.0004937085,0.0015431962,0.0010295537,0.2677753,0.001200885,0.64865124,0.0049510393,0.060612295],"study_design_scores_gemma":[0.00006179386,0.00012591551,0.0013539776,0.000089999434,0.00013779601,0.00026796295,0.0001280953,0.84221864,0.00033771183,0.15109305,0.0041226693,0.00006233971],"about_ca_topic_score_codex":0.0052307197,"about_ca_topic_score_gemma":0.004113034,"teacher_disagreement_score":0.026787985,"about_ca_system_score_codex":0.0017210207,"about_ca_system_score_gemma":0.0020884601,"threshold_uncertainty_score":0.14167011},"labels":[],"label_agreement":null},{"id":"W4411538707","doi":"10.1080/02664763.2025.2520337","title":"A gradient boosting decision tree based estimation method for the mixture cure model","year":2025,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Epoxy Resin Curing Processes","field":"Engineering","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"National Social Science Fund of China; Natural Sciences and Engineering Research Council of Canada; China Scholarship Council","keywords":"Decision tree; Boosting (machine learning); Computer science; Gradient boosting; Artificial intelligence; Machine learning; Decision tree model; Tree (set theory); Statistics; Pattern recognition (psychology); Mathematics; Econometrics; Random forest","score_opus":0.013072253230806498,"score_gpt":0.30235673940852925,"score_spread":0.28928448617772273,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411538707","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0023420304,0.00024762945,0.9967746,0.00008327361,0.000028774692,0.000026788039,0.00004059353,0.00018871219,0.0002676336],"genre_scores_gemma":[0.1729949,0.0007952641,0.82072115,0.00031085216,0.00019557077,0.00040491915,0.00066048274,0.00027579005,0.0036410976],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99842876,0.00089751004,0.000055057015,0.00021553658,0.00030104248,0.00010200995],"domain_scores_gemma":[0.9981652,0.0011643295,0.00013103023,0.00010650774,0.00034877213,0.00008418838],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0044827973,0.0008412512,0.002003117,0.0012780062,0.00057222904,0.0008049503,0.001679307,0.0012474658,0.003031617],"category_scores_gemma":[0.0075923163,0.00063469505,0.0014726403,0.0011062303,0.0005518495,0.0010824038,0.0010664063,0.002110471,0.0011619123],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031550584,0.0001587524,0.0033311686,0.00028591324,0.0002410235,0.00018773408,0.0001664387,0.6023253,0.0051518376,0.051686343,0.008729472,0.3274205],"study_design_scores_gemma":[0.000012623594,0.000026525411,0.00022457093,0.000012260448,0.000018692652,0.000041055355,0.0000048856214,0.9906386,0.00034342284,0.0071426504,0.0015226469,0.000012073902],"about_ca_topic_score_codex":0.0031843083,"about_ca_topic_score_gemma":0.0026022012,"teacher_disagreement_score":0.0044827973,"about_ca_system_score_codex":0.0006070721,"about_ca_system_score_gemma":0.0012792588,"threshold_uncertainty_score":0.023707569},"labels":[],"label_agreement":null},{"id":"W4411932830","doi":"10.1080/02664763.2025.2525880","title":"A constrained robust Markov regime-switching model for long-term risk evaluation","year":2025,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China","keywords":"Term (time); Markov chain; Computer science; Mathematics; Econometrics; Statistics","score_opus":0.0506153612571772,"score_gpt":0.2849498678545155,"score_spread":0.2343345065973383,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411932830","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014246895,0.00022507297,0.9836745,0.00019870485,0.00002533216,0.000044163386,0.00016066307,0.0002526269,0.0011720908],"genre_scores_gemma":[0.80735177,0.0007104562,0.18428971,0.00026539428,0.00011417046,0.0003890585,0.00084927067,0.00017971234,0.005850433],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988531,0.0005455583,0.00005326859,0.00020891409,0.00021489264,0.0001242917],"domain_scores_gemma":[0.99518234,0.0035949443,0.00048173434,0.00019682689,0.00041373097,0.00013042607],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035301265,0.0009928585,0.001608124,0.0009937448,0.00045316195,0.0013002408,0.0019577874,0.0015315579,0.0034745436],"category_scores_gemma":[0.010160888,0.0006350284,0.0015388393,0.00087780197,0.0009349452,0.0012350755,0.0012410696,0.002193712,0.00051866105],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004678565,0.000021826574,0.0008418217,0.000039736125,0.000045929286,0.00006767302,0.000037820555,0.9607973,0.00058378844,0.028265199,0.00054227345,0.00870979],"study_design_scores_gemma":[0.0000026718399,0.0000048470224,0.000059599526,0.0000036736992,0.0000037799082,0.0000053700483,0.0000018186859,0.996633,0.000058638267,0.0031158116,0.00010641334,0.000004450814],"about_ca_topic_score_codex":0.013765329,"about_ca_topic_score_gemma":0.008582653,"teacher_disagreement_score":0.013765329,"about_ca_system_score_codex":0.0011553845,"about_ca_system_score_gemma":0.0017726651,"threshold_uncertainty_score":0.027370453},"labels":[],"label_agreement":null},{"id":"W4414911999","doi":"10.1080/02664763.2025.2567987","title":"Joint survival and longitudinal modelling for combined cohort data","year":2025,"lang":"en","type":"article","venue":"Journal of Applied Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Regina","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Joint (building); Cohort; Longitudinal data; Survival analysis; Cohort study; Proportional hazards model","score_opus":0.25192330949239683,"score_gpt":0.4043214594719593,"score_spread":0.15239814997956247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414911999","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.038826454,0.0005714975,0.9580126,0.00038319398,0.000077603814,0.00017143461,0.0012478904,0.00021684101,0.00049254776],"genre_scores_gemma":[0.53810114,0.0014585766,0.4445916,0.00031584193,0.00030463975,0.0026570319,0.005040348,0.00018751468,0.00734337],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9890581,0.0076054814,0.00047922568,0.0013787582,0.0010780923,0.00040030133],"domain_scores_gemma":[0.9503268,0.038151138,0.003987815,0.0046130503,0.0023031037,0.0006180126],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.035890393,0.0012047092,0.0020660718,0.0019949528,0.00058931607,0.0022377975,0.0034192316,0.0020124298,0.0034866089],"category_scores_gemma":[0.059092853,0.0009661107,0.0033810204,0.0025533668,0.0012936206,0.0021036211,0.00344757,0.0027684039,0.00079312315],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00090538024,0.0002811254,0.05081801,0.00035109022,0.001667086,0.00061239366,0.000773862,0.7967686,0.0012263915,0.06988095,0.0027676008,0.073947385],"study_design_scores_gemma":[0.000063351785,0.00014098434,0.004268649,0.000046221237,0.0001447252,0.00010907838,0.000056791312,0.9658043,0.00020448082,0.027513849,0.0016074592,0.00004008302],"about_ca_topic_score_codex":0.010924975,"about_ca_topic_score_gemma":0.009772006,"teacher_disagreement_score":0.035890393,"about_ca_system_score_codex":0.0010114271,"about_ca_system_score_gemma":0.001617071,"threshold_uncertainty_score":0.18980879},"labels":[],"label_agreement":null}]}