{"meta":{"query_hash":"21f556fa8269","filters":{"venue":"Japanese Journal of Statistics and Data Science"},"cohort_total":17,"direct_labels_cover":0,"predictions_cover":17,"exported":17,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/21f556fa8269","api":"https://metacan.xera.ac/api/v1/cohort?venue=Japanese+Journal+of+Statistics+and+Data+Science"},"results":[{"id":"W2915585695","doi":"10.1007/s42081-019-00035-1","title":"Estimation strategy of multilevel model for ordinal longitudinal data","year":2019,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Winnipeg","funders":"Natural Sciences and Engineering Research Council of Canada; Novartis Pharmaceuticals Corporation","keywords":"Estimator; Covariate; Random effects model; Ordinal regression; Inference; Ordinal data; Statistics; Mathematics; Econometrics; Data set; Multilevel model; Hierarchical database model; Likelihood function; Computer science; Maximum likelihood; Data mining; Artificial intelligence","score_opus":0.3367694729986219,"score_gpt":0.47333060357206497,"score_spread":0.13656113057344305,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2915585695","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008177146,0.00015062271,0.99013585,0.00037123874,0.000050839215,0.00012695952,0.0003760863,0.00019436766,0.00041690917],"genre_scores_gemma":[0.24587727,0.0005656903,0.7432489,0.0003987046,0.00023956673,0.0029187233,0.0027932818,0.00024690962,0.003710958],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9865211,0.009490728,0.0006198303,0.0018751746,0.0009256611,0.00056747196],"domain_scores_gemma":[0.9775853,0.017285429,0.00096717314,0.0022099547,0.0015702116,0.00038189927],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.015906742,0.0010379466,0.0027627018,0.0024734207,0.0014270018,0.0023412993,0.0052111945,0.0019796893,0.0117810285],"category_scores_gemma":[0.045810193,0.0010910934,0.0041677183,0.0035123192,0.0009161487,0.002810506,0.0033333092,0.0039955177,0.001525182],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00064018375,0.0003883503,0.06573342,0.0009897697,0.0030467724,0.0013469374,0.0023887074,0.099454924,0.0036614463,0.5435043,0.014356868,0.26448834],"study_design_scores_gemma":[0.0002080882,0.00030346145,0.009363349,0.00018320094,0.0009220777,0.0005025111,0.0005146348,0.73405623,0.001139621,0.2458048,0.006899661,0.00010244564],"about_ca_topic_score_codex":0.011578558,"about_ca_topic_score_gemma":0.008619625,"teacher_disagreement_score":0.015906742,"about_ca_system_score_codex":0.0012584403,"about_ca_system_score_gemma":0.0043217796,"threshold_uncertainty_score":0.08412385},"labels":[],"label_agreement":null},{"id":"W2997114865","doi":"10.1007/s42081-019-00068-6","title":"Multivariate transformed Gaussian processes","year":2019,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Soil Geostatistics and Mapping","field":"Environmental Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"King Abdullah University of Science and Technology","keywords":"Multivariate statistics; Univariate; Autoregressive model; Gaussian process; Multivariate normal distribution; Multivariate analysis; Multivariate t-distribution; Gaussian; Computer science; Mathematics; Statistics","score_opus":0.021180513897192124,"score_gpt":0.28415385375146973,"score_spread":0.2629733398542776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2997114865","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02819184,0.0004402452,0.962045,0.00047728547,0.00044103057,0.000056271096,0.0007379065,0.000537224,0.007073239],"genre_scores_gemma":[0.73747814,0.0022793945,0.17363617,0.0005114725,0.000819567,0.00033146513,0.0030940636,0.0005557061,0.08129405],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99873275,0.00034154384,0.000053936496,0.00036725187,0.00037748032,0.00012705011],"domain_scores_gemma":[0.9976706,0.0006645883,0.00037600985,0.0005184839,0.00064710755,0.00012314969],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016792703,0.00081439386,0.0008377602,0.0014122146,0.00042649175,0.0016370455,0.0010181784,0.0013360147,0.009544179],"category_scores_gemma":[0.007886327,0.0003583984,0.0015626112,0.0021134093,0.0013570214,0.0018325644,0.0014318199,0.0022101179,0.002679632],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017853186,0.00007974287,0.0019350688,0.000112290865,0.00009990291,0.00035715755,0.0002580446,0.09235168,0.0071426095,0.82350975,0.006287163,0.06768817],"study_design_scores_gemma":[0.000044779747,0.00007686816,0.004483789,0.000035728743,0.00007021314,0.0005567124,0.00009744123,0.56670386,0.0030562542,0.40319434,0.021583186,0.000096739386],"about_ca_topic_score_codex":0.0027705203,"about_ca_topic_score_gemma":0.0021469665,"teacher_disagreement_score":0.009544179,"about_ca_system_score_codex":0.0009299186,"about_ca_system_score_gemma":0.0012889752,"threshold_uncertainty_score":0.03192842},"labels":[],"label_agreement":null},{"id":"W3042907151","doi":"10.1007/s42081-020-00084-x","title":"Empirical likelihood and estimating equations for survey data analysis","year":2020,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Point estimation; Statistics; Computer science; Population; Bayesian probability; Mathematics; Econometrics; Statistical inference; Statistical hypothesis testing; Empirical likelihood; Confidence interval; Medicine","score_opus":0.3675017885248815,"score_gpt":0.4945654689663485,"score_spread":0.127063680441467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3042907151","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015116791,0.00089686294,0.9962627,0.00050063344,0.000038593113,0.00003188087,0.00020526373,0.00010948881,0.0004429852],"genre_scores_gemma":[0.11651087,0.006121821,0.8642263,0.0005607504,0.0007670231,0.0015694204,0.002361622,0.0005120656,0.007370202],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9789216,0.016712096,0.0010969564,0.0017585927,0.001249056,0.00026181483],"domain_scores_gemma":[0.845294,0.14316729,0.0029595818,0.005452703,0.0027414109,0.0003849874],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028073404,0.0015793925,0.0030256375,0.0037153545,0.00095017935,0.0033740443,0.0042484864,0.002576239,0.0053339787],"category_scores_gemma":[0.15335134,0.0019811569,0.0029636556,0.0058149872,0.0034118176,0.0060467883,0.0036982517,0.006225415,0.0013156722],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003458593,0.00004537866,0.002912691,0.0003676038,0.00025039128,0.00016141782,0.00046563963,0.053081803,0.00020927282,0.87905693,0.004302085,0.059112247],"study_design_scores_gemma":[0.000020345726,0.000014332654,0.0007942125,0.0000672892,0.00008205069,0.00012903857,0.000060920145,0.19405061,0.00010757111,0.7991706,0.005469924,0.00003307373],"about_ca_topic_score_codex":0.007780139,"about_ca_topic_score_gemma":0.004198556,"teacher_disagreement_score":0.028073404,"about_ca_system_score_codex":0.0023066676,"about_ca_system_score_gemma":0.0040164096,"threshold_uncertainty_score":0.14846808},"labels":[],"label_agreement":null},{"id":"W3077243495","doi":"10.1007/s42081-020-00083-y","title":"Variance estimation procedures in the presence of singly imputed survey data: a critical review","year":2020,"lang":"en","type":"review","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; University of Ottawa","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Variance (accounting); Statistics; Econometrics; Estimation; Survey data collection; Mathematics; Economics; Accounting","score_opus":0.296091431730889,"score_gpt":0.505309739435327,"score_spread":0.209218307704438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3077243495","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00008214651,0.9892579,0.0083063245,0.0016515168,0.0004556967,0.00001075455,0.000035928002,0.000017146627,0.00018255232],"genre_scores_gemma":[0.0024255489,0.98153657,0.012611889,0.0013108054,0.0018315283,0.00005549273,0.00006971654,0.000036960908,0.000121467405],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.98721075,0.0072959983,0.0016599137,0.0014590089,0.0022036808,0.00017066955],"domain_scores_gemma":[0.8365298,0.14890616,0.002762776,0.002596044,0.008814667,0.00039057108],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.039973494,0.0019574892,0.0059354655,0.0067437883,0.00060001976,0.0028915587,0.00528192,0.004813004,0.0022503638],"category_scores_gemma":[0.09963667,0.0018179397,0.002759481,0.008995136,0.0033317842,0.0053931475,0.0020453103,0.005936256,0.0012301116],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016186843,0.000079493235,0.0011440275,0.037550125,0.0013069223,0.00020359564,0.00022558238,0.0024508007,0.00025635364,0.037952706,0.0283415,0.89032716],"study_design_scores_gemma":[0.00023928467,0.0004167068,0.008293395,0.07669947,0.0060650213,0.002913393,0.0005006967,0.010723571,0.0016834817,0.19799168,0.69386935,0.0006039584],"about_ca_topic_score_codex":0.005136842,"about_ca_topic_score_gemma":0.0052079894,"teacher_disagreement_score":0.039973494,"about_ca_system_score_codex":0.0024392176,"about_ca_system_score_gemma":0.007676492,"threshold_uncertainty_score":0.2114026},"labels":[],"label_agreement":null},{"id":"W3084811620","doi":"10.1007/s42081-020-00088-7","title":"Analysis of cyclic recurrent event data with multiple event types","year":2020,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Center for Advancing Translational Sciences","keywords":"Predictability; Estimator; Nonparametric statistics; Gaussian process; Event (particle physics); Mathematics; Computer science; Event data; Statistics; Algorithm; Applied mathematics; Gaussian","score_opus":0.1266690097974926,"score_gpt":0.4154319901281967,"score_spread":0.28876298033070413,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3084811620","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.10053897,0.00042419974,0.897095,0.00022182992,0.000083420266,0.00009304419,0.0005716199,0.00032520288,0.0006467712],"genre_scores_gemma":[0.88821757,0.00040607018,0.10606793,0.00011896378,0.00033652812,0.00028530552,0.0028683592,0.00011331658,0.0015860136],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9944596,0.002479909,0.00044860685,0.0015234379,0.0007620648,0.00032637714],"domain_scores_gemma":[0.94453806,0.045326665,0.0035776738,0.0042486633,0.0018184693,0.0004904188],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013127764,0.00095565635,0.0017205243,0.002242407,0.0005880206,0.0016550181,0.0027144162,0.0011700077,0.0025645336],"category_scores_gemma":[0.04222147,0.00055979576,0.0019424036,0.0024886832,0.0010114209,0.0023246019,0.001358581,0.0016903944,0.000354076],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0025714876,0.00059688947,0.100826316,0.0009071461,0.0023080385,0.0023000645,0.00062528043,0.41111115,0.01116236,0.13645406,0.0038913824,0.32724577],"study_design_scores_gemma":[0.000028492303,0.00010508001,0.0062578516,0.00002469828,0.00018987255,0.0002545466,0.000055955938,0.9617962,0.0011974432,0.029284816,0.00077033805,0.000034747347],"about_ca_topic_score_codex":0.0022439652,"about_ca_topic_score_gemma":0.0016780787,"teacher_disagreement_score":0.013127764,"about_ca_system_score_codex":0.00064143044,"about_ca_system_score_gemma":0.0012132885,"threshold_uncertainty_score":0.06942707},"labels":[],"label_agreement":null},{"id":"W3137829607","doi":"10.1007/s42081-021-00115-1","title":"Likelihood analysis and stochastic EM algorithm for left truncated right censored data and associated model selection from the Lehmann family of life distributions","year":2021,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Mathematics; Model selection; Weibull distribution; Expectation–maximization algorithm; Context (archaeology); Monte Carlo method; Parametric model; Parametric statistics; Inference; Statistics; Applied mathematics; Algorithm; Maximum likelihood; Computer science; Artificial intelligence","score_opus":0.06169436170705538,"score_gpt":0.35397628676011994,"score_spread":0.29228192505306455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137829607","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038498575,0.00014196323,0.99536926,0.00011274492,0.000011611096,0.000026337404,0.00006806457,0.00015523021,0.00026481203],"genre_scores_gemma":[0.14403278,0.0008013558,0.84763366,0.00021286227,0.00015058194,0.0005991424,0.0020737909,0.00031582432,0.0041800956],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9978071,0.0013096633,0.00013661821,0.00037043725,0.0002559992,0.00012017061],"domain_scores_gemma":[0.9931426,0.005601914,0.00026866293,0.00035775773,0.0005089534,0.00012013197],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005781381,0.0008608872,0.0018439236,0.0016152405,0.000797072,0.0015946834,0.002850575,0.0015237884,0.003989242],"category_scores_gemma":[0.01685109,0.0008313741,0.0020203989,0.0020121778,0.00087167503,0.001975383,0.0024550275,0.0027153431,0.001176993],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002958337,0.00014445488,0.0045333775,0.0004137828,0.00029492262,0.00046133852,0.00046942278,0.5697032,0.0023196188,0.19627462,0.005657049,0.21943244],"study_design_scores_gemma":[0.000019807107,0.000022929276,0.00038705984,0.00002306477,0.000025112471,0.000103733924,0.000028060655,0.95869255,0.00044900776,0.039147336,0.001079489,0.000021792348],"about_ca_topic_score_codex":0.0045432597,"about_ca_topic_score_gemma":0.0044196625,"teacher_disagreement_score":0.005781381,"about_ca_system_score_codex":0.0010377221,"about_ca_system_score_gemma":0.0028961955,"threshold_uncertainty_score":0.030575216},"labels":[],"label_agreement":null},{"id":"W3174702077","doi":"10.1007/s42081-021-00129-9","title":"The XGTDL family of survival distributions","year":2021,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"University of Limerick; Irish Research eLibrary","keywords":"Covariate; Logistic regression; Parametric model; Parametric statistics; Extension (predicate logic); Scale (ratio); Proportional hazards model; Mathematics; Survival function; Statistics; Function (biology); Econometrics; Log-logistic distribution; Scale parameter; Survival analysis; Applied mathematics; Computer science; Probability density function; Geography; Cumulative distribution function","score_opus":0.15403511625581554,"score_gpt":0.4233803617571187,"score_spread":0.2693452455013031,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3174702077","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014281961,0.0007067188,0.978009,0.0007643435,0.00008218351,0.000088818866,0.00070086,0.00043838628,0.0049277768],"genre_scores_gemma":[0.6409958,0.004270721,0.30136535,0.0010746698,0.0006704128,0.0018279618,0.0047634486,0.00059728423,0.044434313],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99619675,0.0020016166,0.0001874961,0.00051962433,0.000825798,0.0002687377],"domain_scores_gemma":[0.9868233,0.008507608,0.0010751076,0.001177763,0.0019198456,0.0004963267],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007980003,0.00089723506,0.0010702631,0.003240656,0.00085350545,0.0024427522,0.0024204613,0.0011984817,0.009592331],"category_scores_gemma":[0.021573965,0.00052179967,0.001885235,0.0020727522,0.0021841002,0.0026179748,0.0025622281,0.003242528,0.0028179432],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000061789,0.000042166543,0.003419264,0.00024087727,0.000063322965,0.0006786636,0.00045984684,0.050036035,0.0006625057,0.8855696,0.0074327504,0.05133325],"study_design_scores_gemma":[0.000044286127,0.00007577681,0.0014050466,0.00009459762,0.000024692565,0.00094646297,0.00012146388,0.5299841,0.00034111942,0.45042458,0.016490664,0.000047139907],"about_ca_topic_score_codex":0.0025916868,"about_ca_topic_score_gemma":0.001200317,"teacher_disagreement_score":0.009592331,"about_ca_system_score_codex":0.0019196594,"about_ca_system_score_gemma":0.0010612857,"threshold_uncertainty_score":0.04220277},"labels":[],"label_agreement":null},{"id":"W4390143601","doi":"10.1007/s42081-023-00231-0","title":"Stein-rule M-estimation in sparse partially linear models","year":2023,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"","keywords":"Estimator; Interpretability; Mathematics; Linear model; Applied mathematics; Extremum estimator; Estimation; Linear regression; Computer science; Statistics; M-estimator; Artificial intelligence","score_opus":0.1671128408076237,"score_gpt":0.41559860583616204,"score_spread":0.24848576502853834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390143601","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005612897,0.00033143582,0.99329257,0.00015669764,0.000023961964,0.000019713882,0.000057619796,0.00009040494,0.00041473552],"genre_scores_gemma":[0.37422752,0.0023663698,0.6128448,0.0005401426,0.00038750417,0.0004718467,0.0013690066,0.000310184,0.007482525],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99568754,0.0025340414,0.00026065583,0.00067344884,0.00065108144,0.0001932255],"domain_scores_gemma":[0.9722421,0.022484507,0.0011348377,0.0018492778,0.0018279474,0.0004612383],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009517005,0.0016765872,0.0031857511,0.0016100277,0.000793074,0.0017908809,0.0032777665,0.0025079597,0.0022750674],"category_scores_gemma":[0.051391993,0.001616596,0.0017521633,0.0016815941,0.002546012,0.003724137,0.003341355,0.00316818,0.0009315951],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033906876,0.00012709612,0.0028395175,0.0006175799,0.00032448245,0.00037105242,0.0002548398,0.63197505,0.0027813383,0.2504487,0.0038537045,0.10606755],"study_design_scores_gemma":[0.000017694012,0.00004293464,0.00022955048,0.000027031736,0.000021869473,0.000060290913,0.000014166419,0.93220603,0.0005304887,0.06632488,0.00050324306,0.000021915783],"about_ca_topic_score_codex":0.0043988074,"about_ca_topic_score_gemma":0.004119821,"teacher_disagreement_score":0.009517005,"about_ca_system_score_codex":0.00094031653,"about_ca_system_score_gemma":0.0025441684,"threshold_uncertainty_score":0.050331295},"labels":[],"label_agreement":null},{"id":"W4392144211","doi":"10.1007/s42081-023-00228-9","title":"Making statistical inferences about linkage errors","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Statistics Canada","funders":"","keywords":"Linkage (software); Computer science; Statistics; Psychology; Mathematics; Biology; Genetics","score_opus":0.3100787365167909,"score_gpt":0.507185537428243,"score_spread":0.1971068009114521,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392144211","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.047040805,0.001310042,0.940572,0.0036406617,0.000754496,0.00031601457,0.0006818345,0.00087678584,0.0048073167],"genre_scores_gemma":[0.5111644,0.0009976127,0.48077726,0.0019023945,0.001199399,0.0008738522,0.0013389275,0.0003283396,0.0014178583],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.89307004,0.07688318,0.008461421,0.010367115,0.01007207,0.0011461914],"domain_scores_gemma":[0.44441047,0.49501136,0.02076681,0.026271619,0.012138434,0.0014012791],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.11608613,0.0011766443,0.0022474013,0.007824725,0.002354998,0.0066251643,0.0031949647,0.0027972548,0.0044112275],"category_scores_gemma":[0.49919206,0.0012010793,0.002830019,0.007107831,0.0029670845,0.008849328,0.004830549,0.0054852227,0.0008463338],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015466991,0.000419465,0.10259851,0.0022229657,0.0072726486,0.0019118922,0.005849503,0.026335739,0.0023678404,0.21312128,0.016151372,0.6202021],"study_design_scores_gemma":[0.00044035527,0.0003737732,0.019877031,0.00076906924,0.0029400885,0.00073376176,0.0023947323,0.12804726,0.005830704,0.8237171,0.014728557,0.00014764791],"about_ca_topic_score_codex":0.0017061651,"about_ca_topic_score_gemma":0.001117112,"teacher_disagreement_score":0.11608613,"about_ca_system_score_codex":0.0012738487,"about_ca_system_score_gemma":0.004162137,"threshold_uncertainty_score":0.6139295},"labels":[],"label_agreement":null},{"id":"W4400260432","doi":"10.1007/s42081-024-00261-2","title":"Bayesian and minimax estimators of loss","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Institut des Sciences Mathématiques, Université du Québec à Montréal","keywords":"Minimax; Bayesian probability; Estimator; Minimax estimator; Econometrics; Statistics; Computer science; Mathematics; Mathematical optimization; Minimum-variance unbiased estimator","score_opus":0.08655825488282168,"score_gpt":0.4197903353342878,"score_spread":0.33323208045146613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400260432","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011406394,0.0009195298,0.9850916,0.0008171856,0.00006647877,0.000024930063,0.000117276504,0.000120206685,0.0014362935],"genre_scores_gemma":[0.3958747,0.0039093858,0.58140075,0.0008386781,0.0013779994,0.00097036,0.0013432935,0.00062322797,0.013661615],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99074125,0.0054699676,0.0005258202,0.0013647807,0.0015682022,0.0003300301],"domain_scores_gemma":[0.92716694,0.062266435,0.00297078,0.0037500672,0.0030660913,0.0007796169],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025171608,0.0011320065,0.0025061355,0.0035559137,0.0008951592,0.0039526937,0.003359071,0.0033113256,0.003822486],"category_scores_gemma":[0.1081668,0.0014651596,0.001411375,0.0021764394,0.0041000345,0.0096809175,0.0048916917,0.004611629,0.00063309766],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017103007,0.000098448276,0.0021490061,0.00023023282,0.00013600937,0.00006654003,0.00025290519,0.08991703,0.0005745349,0.8474997,0.0030549115,0.055849683],"study_design_scores_gemma":[0.000050518698,0.00006065008,0.0011660239,0.00008773398,0.000049158385,0.00016553451,0.000035886856,0.31413743,0.0005157838,0.68135345,0.002331928,0.000045900997],"about_ca_topic_score_codex":0.00080164307,"about_ca_topic_score_gemma":0.000572387,"teacher_disagreement_score":0.025171608,"about_ca_system_score_codex":0.0019094234,"about_ca_system_score_gemma":0.0026926794,"threshold_uncertainty_score":0.13312179},"labels":[],"label_agreement":null},{"id":"W4401399991","doi":"10.1007/s42081-024-00260-3","title":"Applications of Population Sampling to Insurance Ratemaking and Reserving","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Sampling (signal processing); Weighting; Population; Credibility; Econometrics; Field (mathematics); Estimator; Data mining; Statistics; Economics; Mathematics","score_opus":0.12848584978147398,"score_gpt":0.4582514481752856,"score_spread":0.32976559839381164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401399991","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016721776,0.00009355663,0.9813409,0.0002553654,0.00002831538,0.0000493643,0.000020244195,0.00006930712,0.0014212182],"genre_scores_gemma":[0.6915467,0.00023694642,0.30580428,0.00015143825,0.000107517466,0.00017064177,0.00007751516,0.000064519925,0.0018404635],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99291986,0.004864998,0.00021344206,0.0006292303,0.0011400953,0.00023244273],"domain_scores_gemma":[0.9804529,0.014824196,0.001325908,0.0017554458,0.0013157672,0.00032572137],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014438966,0.0004050377,0.00085605157,0.001102369,0.00052281027,0.0012310105,0.0018186192,0.0011177969,0.0028276048],"category_scores_gemma":[0.044250388,0.0003593279,0.0006534321,0.0009678999,0.0019184293,0.0017533922,0.0026996892,0.0019689146,0.0002313906],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00013093621,0.00011344193,0.00520764,0.000096818316,0.00007336463,0.00030308586,0.00041787376,0.5489096,0.0013640238,0.34936297,0.0012586827,0.09276153],"study_design_scores_gemma":[0.000013854398,0.0000343972,0.00040393957,0.000020716852,0.000008143881,0.000046003785,0.00004861684,0.9143888,0.0006965745,0.08324529,0.0010814308,0.000012342916],"about_ca_topic_score_codex":0.0022287162,"about_ca_topic_score_gemma":0.0016969759,"teacher_disagreement_score":0.014438966,"about_ca_system_score_codex":0.0010111169,"about_ca_system_score_gemma":0.0011327276,"threshold_uncertainty_score":0.07636148},"labels":[],"label_agreement":null},{"id":"W4403890161","doi":"10.1007/s42081-024-00276-9","title":"Methodological challenges in studying disease processes using observational cohort data","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Observational study; Disease; Psychological intervention; Cohort; Appeal; Data science; Computer science; Cohort study; Longitudinal data; Psychology; Medicine; Management science; Risk analysis (engineering); Data mining; Engineering; Pathology","score_opus":0.5360041320382929,"score_gpt":0.46931805196175813,"score_spread":0.06668608007653476,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403890161","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010148542,0.01678277,0.93552744,0.026250422,0.0032356605,0.0026067004,0.0021037355,0.00029141046,0.0030533075],"genre_scores_gemma":[0.21893065,0.016314523,0.72358865,0.016238054,0.005964709,0.014222821,0.0023131492,0.00042223034,0.0020052716],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.58214056,0.35523194,0.024250349,0.013511297,0.023744138,0.0011216402],"domain_scores_gemma":[0.31079963,0.6108367,0.019744428,0.038266193,0.0185287,0.0018243943],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3879016,0.0014528615,0.003483739,0.005096621,0.0030618764,0.006443632,0.0070485203,0.0025963464,0.0019883674],"category_scores_gemma":[0.6272157,0.001695373,0.0031523576,0.010414642,0.0070329458,0.005813717,0.006946926,0.0074382345,0.00070433045],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007050789,0.00054842385,0.13742585,0.013619309,0.010370351,0.0016693259,0.009279819,0.03384575,0.001260628,0.41300482,0.03172941,0.34654117],"study_design_scores_gemma":[0.00036573122,0.0005062729,0.041018113,0.0059439605,0.0018625228,0.001472284,0.004579141,0.049536645,0.00087919715,0.82311475,0.0703796,0.00034174367],"about_ca_topic_score_codex":0.018546073,"about_ca_topic_score_gemma":0.011181448,"teacher_disagreement_score":0.6120984,"about_ca_system_score_codex":0.003368501,"about_ca_system_score_gemma":0.010196741,"threshold_uncertainty_score":0.7548263},"labels":[],"label_agreement":null},{"id":"W4405708154","doi":"10.1007/s42081-024-00286-7","title":"Correction: Applications of Population Sampling to Insurance Ratemaking and Reserving","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Healthcare Policy and Management","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Sampling (signal processing); Population; Actuarial science; Computer science; Data science; Statistics; Econometrics; Business; Mathematics; Telecommunications; Medicine; Environmental health","score_opus":0.11303982661357444,"score_gpt":0.3733645178651161,"score_spread":0.2603246912515417,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405708154","genre_codex":"editorial","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00087005674,0.0013112562,0.021984905,0.0563839,0.8956437,0.00013131791,0.014622954,0.0026043542,0.006447465],"genre_scores_gemma":[0.104232095,0.0056388625,0.087903544,0.06110431,0.35444382,0.0012561183,0.0152425505,0.009704022,0.36047462],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99036986,0.0032838134,0.0019626503,0.0011482855,0.002818809,0.00041659156],"domain_scores_gemma":[0.8499146,0.05057014,0.0062647853,0.015450729,0.075509705,0.0022900566],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0096357,0.002456234,0.0018561056,0.0047892886,0.002278513,0.0036411434,0.0044147344,0.0039478303,0.1075301],"category_scores_gemma":[0.25008222,0.001517481,0.0019133012,0.0067603635,0.0020709578,0.002920273,0.0019480222,0.0068181786,0.039598905],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000044740176,0.0000040296586,0.00027295563,0.00013709058,0.000032171218,0.00010573938,0.00006332657,0.00034418327,0.000029929448,0.003453246,0.98805594,0.0074566365],"study_design_scores_gemma":[0.00020022668,0.000029812083,0.004214939,0.0006134689,0.00015051446,0.00056600303,0.00024259381,0.00886091,0.0008149573,0.025049243,0.9591091,0.00014827271],"about_ca_topic_score_codex":0.057686426,"about_ca_topic_score_gemma":0.052400023,"teacher_disagreement_score":0.1075301,"about_ca_system_score_codex":0.004690888,"about_ca_system_score_gemma":0.007971941,"threshold_uncertainty_score":0.35972404},"labels":[],"label_agreement":null},{"id":"W4407248782","doi":"10.1007/s42081-025-00295-0","title":"Correction: Methodological challenges in studying disease processes using observational cohort data","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Food Security and Health in Diverse Populations","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Observational study; Data science; Cohort; Computer science; Medicine; Pathology","score_opus":0.8219778875377437,"score_gpt":0.6023865142488891,"score_spread":0.21959137328885459,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407248782","genre_codex":"editorial","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001852403,0.0031903563,0.027895372,0.066255614,0.86713207,0.0007229349,0.025604056,0.0043289457,0.0030182116],"genre_scores_gemma":[0.1755047,0.005067293,0.18108307,0.18512523,0.30206597,0.009735281,0.017791243,0.01709152,0.106535725],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88123626,0.04582284,0.032037094,0.016904475,0.018666834,0.005332519],"domain_scores_gemma":[0.4462572,0.3051906,0.03905353,0.078283995,0.12081904,0.010395688],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.085940614,0.0063167373,0.010222704,0.010799009,0.00619905,0.010802937,0.011559784,0.014807916,0.12707272],"category_scores_gemma":[0.6529557,0.004928711,0.0063192584,0.01946896,0.0061698803,0.0060974867,0.005657888,0.019160466,0.031038577],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036350236,0.000030580653,0.0022262635,0.0030112395,0.001392693,0.00088970904,0.00037918438,0.00035244762,0.0001815543,0.0022447354,0.9729829,0.015945202],"study_design_scores_gemma":[0.0039403294,0.00021305027,0.024682214,0.011410875,0.0064032963,0.004485325,0.0015986164,0.018981777,0.0026558507,0.05048121,0.8742867,0.00086084113],"about_ca_topic_score_codex":0.020853018,"about_ca_topic_score_gemma":0.0326518,"teacher_disagreement_score":0.9140594,"about_ca_system_score_codex":0.0074214702,"about_ca_system_score_gemma":0.014059528,"threshold_uncertainty_score":0.45450282},"labels":[],"label_agreement":null},{"id":"W4408047762","doi":"10.1007/s42081-025-00298-x","title":"Application of machine learning methods in the imputation of heterogeneous co-missing data","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"Canadian Institutes of Health Research; McLaughlin Centre, University of Toronto","keywords":"Imputation (statistics); Missing data; Computer science; Machine learning; Artificial intelligence; Data mining","score_opus":0.04797112399033372,"score_gpt":0.4199266282748576,"score_spread":0.3719555042845239,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408047762","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004628391,0.00039198578,0.9944518,0.00017422387,0.000046347934,0.00002385323,0.000054647888,0.000088713954,0.00013992915],"genre_scores_gemma":[0.20279764,0.0009734678,0.7934549,0.00022675317,0.0003120004,0.00027833934,0.0007610398,0.00014779925,0.0010480467],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98561144,0.01066587,0.0006743175,0.0017658486,0.0009780284,0.00030453352],"domain_scores_gemma":[0.9355209,0.054812197,0.0022701698,0.004473477,0.0024166983,0.0005065834],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.028067408,0.0011221969,0.0031688649,0.003492759,0.0016580266,0.0023439073,0.004461805,0.0026657206,0.0019076748],"category_scores_gemma":[0.067368,0.0014422993,0.0034579244,0.004813095,0.0014126505,0.0029493202,0.0035041443,0.0042015915,0.00050777785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00052576105,0.000412528,0.01880992,0.0006174088,0.0018346111,0.0005299695,0.000630206,0.58246005,0.0012506935,0.09638571,0.0037705952,0.29277262],"study_design_scores_gemma":[0.000033463755,0.0000305238,0.00095958327,0.00005758416,0.00009269107,0.00011953411,0.000035970665,0.93813676,0.00042544492,0.05906911,0.0009998013,0.000039603445],"about_ca_topic_score_codex":0.004172588,"about_ca_topic_score_gemma":0.0036815074,"teacher_disagreement_score":0.028067408,"about_ca_system_score_codex":0.00087537593,"about_ca_system_score_gemma":0.0030151343,"threshold_uncertainty_score":0.14843643},"labels":[],"label_agreement":null},{"id":"W4413801157","doi":"10.1007/s42081-025-00314-0","title":"Applying non-negative matrix factorization with covariates to multivariate time series data as a vector autoregression model","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Japan Society for the Promotion of Science","keywords":"Covariate; Vector autoregression; Multivariate statistics; Autoregressive model; Series (stratigraphy); Time series; Econometrics; Statistics; Mathematics; Computer science; Biology","score_opus":0.025026571645971923,"score_gpt":0.3298188312038354,"score_spread":0.3047922595578635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413801157","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006119713,0.00017481663,0.9929389,0.00020104488,0.000041116757,0.000024703355,0.00013440239,0.00014859677,0.00021679627],"genre_scores_gemma":[0.3694457,0.00095516746,0.6245132,0.0003050029,0.00037427357,0.00037943549,0.0012079303,0.00012991019,0.0026894165],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981737,0.00096817414,0.000081725026,0.00044491197,0.00023033858,0.00010113411],"domain_scores_gemma":[0.9963231,0.0025089094,0.00042609317,0.00029321562,0.00035972567,0.00008882174],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038783925,0.0010356707,0.0011147902,0.0011421421,0.0004893967,0.0010965294,0.0011326494,0.0010143496,0.0018255883],"category_scores_gemma":[0.009332703,0.0005630213,0.0017697135,0.0016036966,0.0008063291,0.0014133744,0.0008114533,0.001689931,0.00044744337],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011133008,0.00015053738,0.008633998,0.00025003453,0.00038480936,0.00031882306,0.00027759382,0.74098206,0.0039446442,0.09777294,0.0057850196,0.14138818],"study_design_scores_gemma":[0.0000065414392,0.000017070412,0.00063588016,0.000010278653,0.000012983166,0.000017289018,0.00000982273,0.981871,0.00016163352,0.016307937,0.00093772914,0.000011814375],"about_ca_topic_score_codex":0.010376267,"about_ca_topic_score_gemma":0.011734808,"teacher_disagreement_score":0.010376267,"about_ca_system_score_codex":0.0007248016,"about_ca_system_score_gemma":0.0016949776,"threshold_uncertainty_score":0.02063173},"labels":[],"label_agreement":null},{"id":"W4417222887","doi":"10.1007/s42081-025-00322-0","title":"On multivariate binary outcomes copulas-regression problem","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Trois-Rivières; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé","keywords":"Multivariate statistics; Copula (linguistics); Covariate; Binary number; Binary data; Estimator; Marginal distribution; Logistic regression; Multivariate normal distribution","score_opus":0.1058971062364061,"score_gpt":0.4482954307905468,"score_spread":0.3423983245541407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417222887","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.029529063,0.002721354,0.95320356,0.00530651,0.0002616473,0.000114728646,0.0007039137,0.00023632948,0.007922863],"genre_scores_gemma":[0.7035004,0.009875648,0.2358633,0.0027778756,0.0032369671,0.0009959897,0.0031440463,0.0007145373,0.039891295],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9949922,0.0029375397,0.00015157786,0.001110975,0.00041292235,0.00039480953],"domain_scores_gemma":[0.98543346,0.011204596,0.001198832,0.00066262507,0.0009370025,0.00056357007],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0074169617,0.001971176,0.0044210427,0.0018654127,0.0010953059,0.00306958,0.0034459927,0.0031303419,0.0068165776],"category_scores_gemma":[0.030664915,0.0014075361,0.0026684832,0.0038093352,0.0022364832,0.0048449086,0.0033454308,0.0051263697,0.00083291077],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00011831759,0.00020645879,0.0032344672,0.000620774,0.00041762536,0.00075271353,0.0003437849,0.12472695,0.0006299416,0.8258026,0.012774377,0.030372076],"study_design_scores_gemma":[0.000051248047,0.000046266618,0.001146197,0.00008664177,0.00013547903,0.00026761045,0.00009786679,0.47136948,0.0001908823,0.5239857,0.00257982,0.000042758216],"about_ca_topic_score_codex":0.0068163774,"about_ca_topic_score_gemma":0.0031612543,"teacher_disagreement_score":0.0074169617,"about_ca_system_score_codex":0.0021010283,"about_ca_system_score_gemma":0.00280601,"threshold_uncertainty_score":0.0392251},"labels":[],"label_agreement":null}]}