{"meta":{"query_hash":"21f556fa8269","filters":{"venue":"Japanese Journal of Statistics and Data Science"},"cohort_total":17,"direct_labels_cover":0,"predictions_cover":17,"exported":17,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/21f556fa8269","api":"https://metacan.xera.ac/api/v1/cohort?venue=Japanese+Journal+of+Statistics+and+Data+Science"},"results":[{"id":"W2915585695","doi":"10.1007/s42081-019-00035-1","title":"Estimation strategy of multilevel model for ordinal longitudinal data","year":2019,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Winnipeg","funders":"Natural Sciences and Engineering Research Council of Canada; Novartis Pharmaceuticals Corporation","keywords":"Estimator; Covariate; Random effects model; Ordinal regression; Inference; Ordinal data; Statistics; Mathematics; Econometrics; Data set; Multilevel model; Hierarchical database model; Likelihood function; Computer science; Maximum likelihood; Data mining; Artificial intelligence","score_opus":0.3367694729986219,"score_gpt":0.47333060357206497,"score_spread":0.13656113057344305,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2915585695","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.17915462,0.000009267645,0.8183068,0.00002085778,0.000059374983,0.000110959445,0.0022933905,0.0000021128847,0.00004259801],"genre_scores_gemma":[0.4890174,0.0000074172513,0.5109322,0.0000051463107,0.000009668621,3.667537e-7,0.000016457148,0.0000029850705,0.0000083628565],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984577,0.000024908937,0.00056608755,0.0002787249,0.00048538987,0.00018721759],"domain_scores_gemma":[0.9963981,0.0017541578,0.0004659506,0.00069219613,0.00055828877,0.0001313074],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029277864,0.00009464115,0.000280977,0.000092143484,0.00009188737,0.00007902381,0.0011114872,0.000022587405,0.000026752461],"category_scores_gemma":[0.007087211,0.00006816025,0.000010960128,0.00014622057,0.00032139843,0.0009966008,0.00038249753,0.00009493238,9.95507e-7],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025103157,0.00027953667,0.0026571315,0.0004947143,0.000034226658,0.000008024021,0.0006480915,0.002441787,0.011836723,0.79091036,0.0009443298,0.18949404],"study_design_scores_gemma":[0.00037614745,0.00018154498,0.005906431,0.000044868837,0.00003511954,0.000037398993,0.00014579862,0.82345164,0.0000818782,0.16966301,0.00000451346,0.00007165286],"about_ca_topic_score_codex":0.00001729555,"about_ca_topic_score_gemma":0.000004515932,"teacher_disagreement_score":0.8210099,"about_ca_system_score_codex":0.000012835648,"about_ca_system_score_gemma":0.00026711953,"threshold_uncertainty_score":0.84845656},"labels":[],"label_agreement":null},{"id":"W2997114865","doi":"10.1007/s42081-019-00068-6","title":"Multivariate transformed Gaussian processes","year":2019,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Soil Geostatistics and Mapping","field":"Environmental Science","cited_by":11,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"King Abdullah University of Science and Technology","keywords":"Multivariate statistics; Univariate; Autoregressive model; Gaussian process; Multivariate normal distribution; Multivariate analysis; Multivariate t-distribution; Gaussian; Computer science; Mathematics; Statistics","score_opus":0.021180513897192124,"score_gpt":0.28415385375146973,"score_spread":0.2629733398542776,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2997114865","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9503623,0.000020877347,0.046118,0.00016806075,0.00017654749,0.00012016937,0.00018652162,0.000005524953,0.0028420042],"genre_scores_gemma":[0.94182163,0.00006380146,0.057966348,0.00008259515,0.000013976892,4.229236e-7,0.0000060483685,0.000003776099,0.000041381292],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9987554,0.000011935695,0.00027089714,0.00022841957,0.00051044434,0.00022292415],"domain_scores_gemma":[0.9991738,0.00016398671,0.00016618594,0.00024249121,0.000067191955,0.00018632037],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009672329,0.000079395635,0.00012963267,0.000054758806,0.00015570952,0.000109202134,0.0006296739,0.000013390187,0.00026509046],"category_scores_gemma":[0.0005602598,0.00005634118,0.000006481803,0.000383262,0.00039163098,0.0011647363,0.00022254263,0.00008362448,0.00004030729],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00038637622,0.00063371443,0.36422274,0.00043426393,0.00006168523,0.00027380325,0.021578856,0.0023844233,0.36215806,0.026043609,0.0032032835,0.2186192],"study_design_scores_gemma":[0.0019497729,0.00062368996,0.91283643,0.000101843,0.0000484918,0.0004727292,0.003210855,0.060895268,0.0010989192,0.008611134,0.009647391,0.00050348905],"about_ca_topic_score_codex":0.00015965744,"about_ca_topic_score_gemma":0.000045636614,"teacher_disagreement_score":0.54861367,"about_ca_system_score_codex":0.00002523784,"about_ca_system_score_gemma":0.00008829093,"threshold_uncertainty_score":0.2902555},"labels":[],"label_agreement":null},{"id":"W3042907151","doi":"10.1007/s42081-020-00084-x","title":"Empirical likelihood and estimating equations for survey data analysis","year":2020,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Point estimation; Statistics; Computer science; Population; Bayesian probability; Mathematics; Econometrics; Statistical inference; Statistical hypothesis testing; Empirical likelihood; Confidence interval; Medicine","score_opus":0.3675017885248815,"score_gpt":0.4945654689663485,"score_spread":0.127063680441467,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3042907151","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010990221,0.000018656932,0.98394,0.00043412566,0.00004072332,0.00007918345,0.0044806544,0.000004646957,0.000011801243],"genre_scores_gemma":[0.25590995,0.000009851523,0.74386084,0.00010708496,0.000040942108,5.371964e-7,0.00006669096,0.0000037016393,4.2896454e-7],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9983915,0.00010192321,0.00052979874,0.00036657802,0.00040766658,0.00020253108],"domain_scores_gemma":[0.9898273,0.008569092,0.00032453865,0.0004910696,0.0004342051,0.00035382697],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.004997697,0.000094183255,0.0003316062,0.000104623454,0.00025869417,0.0002490496,0.0009054248,0.000019965088,0.000016785636],"category_scores_gemma":[0.06507319,0.000068741974,0.000012283336,0.0007515476,0.00036206597,0.00070005335,0.0005939108,0.00011111597,4.419241e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00045213493,0.00061984657,0.1685809,0.0007491562,0.0008237733,0.0000970619,0.010926696,0.0000939599,0.0034496621,0.45209357,0.010131848,0.35198137],"study_design_scores_gemma":[0.0002595786,0.00015816031,0.03443867,0.000012478238,0.00029212364,0.0000144794185,0.00027836216,0.8366686,0.0000059500176,0.12774871,0.00002268984,0.00010020801],"about_ca_topic_score_codex":0.000031131913,"about_ca_topic_score_gemma":0.00004048295,"teacher_disagreement_score":0.8365746,"about_ca_system_score_codex":0.000007775594,"about_ca_system_score_gemma":0.00017092595,"threshold_uncertainty_score":0.9428021},"labels":[],"label_agreement":null},{"id":"W3077243495","doi":"10.1007/s42081-020-00083-y","title":"Variance estimation procedures in the presence of singly imputed survey data: a critical review","year":2020,"lang":"en","type":"review","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval; University of Ottawa","funders":"Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada","keywords":"Variance (accounting); Statistics; Econometrics; Estimation; Survey data collection; Mathematics; Economics; Accounting","score_opus":0.296091431730889,"score_gpt":0.505309739435327,"score_spread":0.209218307704438,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3077243495","genre_codex":"methods","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0000011244865,0.44385135,0.55258125,0.00010847412,0.000069946014,0.00031152522,0.0030606901,0.0000023643008,0.000013260543],"genre_scores_gemma":[0.00007595099,0.53024393,0.46956676,0.000037734608,0.000022560422,0.0000024193255,0.000044581884,0.0000058120436,2.3727142e-7],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99577236,0.0008817244,0.0015935687,0.0005024661,0.0009930707,0.00025679532],"domain_scores_gemma":[0.974635,0.022028252,0.0012254147,0.001296208,0.0006392108,0.00017589881],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.013135969,0.0002285635,0.0013768603,0.00012541623,0.000113645234,0.0001864018,0.0036634174,0.00005334884,0.000011259219],"category_scores_gemma":[0.21146297,0.00012830268,0.00002906057,0.0013057138,0.00090420834,0.0008932189,0.0008078881,0.00044951533,0.0000010600704],"study_design_candidate":"design_other","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000014849429,0.0001515724,0.000014822328,0.04604431,0.00002045158,0.000115458184,0.00030918934,2.3396694e-7,0.0000017737776,0.10497262,0.0021361478,0.8462186],"study_design_scores_gemma":[0.0010250375,0.0015243415,0.0030842065,0.27253458,0.0038834414,0.0060432414,0.0005140349,0.103845954,0.0000011781023,0.55338234,0.052297793,0.0018638595],"about_ca_topic_score_codex":0.000036583788,"about_ca_topic_score_gemma":0.0000204947,"teacher_disagreement_score":0.8443547,"about_ca_system_score_codex":0.00002256384,"about_ca_system_score_gemma":0.0013216585,"threshold_uncertainty_score":0.7951792},"labels":[],"label_agreement":null},{"id":"W3084811620","doi":"10.1007/s42081-020-00088-7","title":"Analysis of cyclic recurrent event data with multiple event types","year":2020,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Center for Advancing Translational Sciences","keywords":"Predictability; Estimator; Nonparametric statistics; Gaussian process; Event (particle physics); Mathematics; Computer science; Event data; Statistics; Algorithm; Applied mathematics; Gaussian","score_opus":0.1266690097974926,"score_gpt":0.4154319901281967,"score_spread":0.28876298033070413,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3084811620","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.07954394,0.000045034107,0.9178689,0.00020927303,0.000039372673,0.00006636423,0.0021995862,0.0000032707042,0.000024233954],"genre_scores_gemma":[0.52245206,0.00004712752,0.47743034,0.000028546085,0.000015589278,2.4897398e-7,0.000022694156,0.0000028360919,5.954337e-7],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99815154,0.00007135613,0.0005934437,0.0003205305,0.0006893619,0.00017377411],"domain_scores_gemma":[0.99667025,0.0015062348,0.000527507,0.0006729898,0.00035119732,0.00027185236],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017576988,0.000103879436,0.0004114726,0.00014078569,0.00009293417,0.00006542033,0.0012268339,0.000015412252,0.000052198695],"category_scores_gemma":[0.008188903,0.00006549006,0.00001823155,0.0009668388,0.00040024996,0.00046742935,0.0005363097,0.00012535727,8.070709e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015085556,0.0016767998,0.13360424,0.0009156045,0.002040342,0.00033524205,0.009836775,0.00043348977,0.016312208,0.37832132,0.003324044,0.4516914],"study_design_scores_gemma":[0.0009952281,0.0012685106,0.11541768,0.00016104852,0.0019451387,0.00006523659,0.0013768551,0.84277976,0.0002736518,0.035013527,0.00036184688,0.000341522],"about_ca_topic_score_codex":0.000027302538,"about_ca_topic_score_gemma":0.0000379403,"teacher_disagreement_score":0.84234625,"about_ca_system_score_codex":0.000012420796,"about_ca_system_score_gemma":0.00015340398,"threshold_uncertainty_score":0.9803474},"labels":[],"label_agreement":null},{"id":"W3137829607","doi":"10.1007/s42081-021-00115-1","title":"Likelihood analysis and stochastic EM algorithm for left truncated right censored data and associated model selection from the Lehmann family of life distributions","year":2021,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":23,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Mathematics; Model selection; Weibull distribution; Expectation–maximization algorithm; Context (archaeology); Monte Carlo method; Parametric model; Parametric statistics; Inference; Statistics; Applied mathematics; Algorithm; Maximum likelihood; Computer science; Artificial intelligence","score_opus":0.06169436170705538,"score_gpt":0.35397628676011994,"score_spread":0.29228192505306455,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3137829607","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08640765,0.000058117766,0.85559183,0.00022982898,0.000015826326,0.000097071745,0.057591897,0.000005291743,0.0000025087556],"genre_scores_gemma":[0.64957273,0.000051958377,0.34805283,0.00003577995,0.00001233861,0.0000017394677,0.002265472,0.0000035206963,0.0000036365952],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99862474,0.00004881615,0.0005173402,0.00029218098,0.0003612309,0.00015566514],"domain_scores_gemma":[0.99632305,0.0017084095,0.00039840597,0.00039649647,0.0009891782,0.00018447374],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009970096,0.00009525817,0.0002748364,0.00006688741,0.00044617563,0.0001602,0.00039543485,0.000031271782,0.000013357515],"category_scores_gemma":[0.0072128847,0.00006840234,0.000017188213,0.0006580667,0.00036909146,0.00039426002,0.00023952077,0.0001016721,1.9304302e-7],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000298941,0.003459707,0.008874569,0.00024284597,0.003634988,0.000020790376,0.007215521,0.0028322532,0.042446125,0.7713745,0.02635972,0.13324001],"study_design_scores_gemma":[0.00044421258,0.000027463897,0.04985066,0.000013373188,0.0006005901,0.000010221695,0.00066348497,0.90087676,0.000037464695,0.04738426,0.000017892695,0.00007364506],"about_ca_topic_score_codex":0.000031324675,"about_ca_topic_score_gemma":0.00012430706,"teacher_disagreement_score":0.89804447,"about_ca_system_score_codex":0.000023174605,"about_ca_system_score_gemma":0.00026312348,"threshold_uncertainty_score":0.8635018},"labels":[],"label_agreement":null},{"id":"W3174702077","doi":"10.1007/s42081-021-00129-9","title":"The XGTDL family of survival distributions","year":2021,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"University of Limerick; Irish Research eLibrary","keywords":"Covariate; Logistic regression; Parametric model; Parametric statistics; Extension (predicate logic); Scale (ratio); Proportional hazards model; Mathematics; Survival function; Statistics; Function (biology); Econometrics; Log-logistic distribution; Scale parameter; Survival analysis; Applied mathematics; Computer science; Probability density function; Geography; Cumulative distribution function","score_opus":0.15403511625581554,"score_gpt":0.4233803617571187,"score_spread":0.2693452455013031,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3174702077","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16574775,0.000108747,0.8317956,0.00023692734,0.00023973691,0.00003368873,0.0012617591,0.0000023186888,0.00057346723],"genre_scores_gemma":[0.50118077,0.00019407204,0.49856287,0.000015540401,0.000024278866,2.8415596e-7,0.0000046565265,0.0000023795358,0.000015122676],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9986349,0.00008715457,0.00045722615,0.00013564336,0.00051811984,0.00016696325],"domain_scores_gemma":[0.99423665,0.004028742,0.00026947426,0.0004139311,0.0009197694,0.00013144178],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0028955624,0.00006108581,0.00018704479,0.000027500622,0.00030126458,0.00010819054,0.0005813282,0.000013207403,0.000017680673],"category_scores_gemma":[0.020358693,0.000035819212,0.000014010775,0.00034611937,0.0008447166,0.0002215679,0.00030039845,0.000113381,6.6506794e-7],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000011850106,0.000053798038,0.00064024795,0.000016655547,0.000008878243,0.000020443787,0.00015836708,6.318679e-7,0.011199603,0.97275966,0.0005248687,0.014605021],"study_design_scores_gemma":[0.00043417304,0.00019702861,0.086932905,0.00006386582,0.00007093822,0.00020199518,0.003302223,0.0068748742,0.0016220137,0.8985287,0.0016249676,0.0001463406],"about_ca_topic_score_codex":0.000012259381,"about_ca_topic_score_gemma":0.000010027166,"teacher_disagreement_score":0.33543304,"about_ca_system_score_codex":0.000011416675,"about_ca_system_score_gemma":0.0002931425,"threshold_uncertainty_score":0.9878932},"labels":[],"label_agreement":null},{"id":"W4390143601","doi":"10.1007/s42081-023-00231-0","title":"Stein-rule M-estimation in sparse partially linear models","year":2023,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Distribution Estimation and Applications","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University","funders":"","keywords":"Estimator; Interpretability; Mathematics; Linear model; Applied mathematics; Extremum estimator; Estimation; Linear regression; Computer science; Statistics; M-estimator; Artificial intelligence","score_opus":0.1671128408076237,"score_gpt":0.41559860583616204,"score_spread":0.24848576502853834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390143601","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.18732977,0.000003496062,0.81155086,0.00031820187,0.000036311845,0.00007822997,0.00055319513,0.000015041723,0.00011490186],"genre_scores_gemma":[0.7760075,0.00002403627,0.22385226,0.000030459036,0.000011677984,0.0000025031352,0.000055211734,0.0000036402523,0.000012719158],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99868083,0.00002673278,0.0004843737,0.00017121187,0.00045657012,0.00018027156],"domain_scores_gemma":[0.9984867,0.0006068177,0.00020255487,0.00027390433,0.0002765085,0.00015351061],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016668095,0.00006912484,0.0001422603,0.00017013242,0.00015014058,0.00007767563,0.00038703933,0.000018092032,0.000027089725],"category_scores_gemma":[0.0031847924,0.0000566271,0.000008397056,0.00078853796,0.00026259536,0.0008127571,0.0001386131,0.00009262412,0.00002116784],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000016353191,0.00009835949,0.00021944988,0.000026917847,0.00000354827,0.000021987933,0.00055254507,0.005613023,0.0012774925,0.9846008,0.001272052,0.006297474],"study_design_scores_gemma":[0.00023387984,0.000025035997,0.010680633,0.00001779643,0.000008270131,0.000020726957,0.00023832866,0.7342533,0.000048388516,0.25437754,0.000041729996,0.000054359243],"about_ca_topic_score_codex":0.000012004229,"about_ca_topic_score_gemma":0.0000118639555,"teacher_disagreement_score":0.73022324,"about_ca_system_score_codex":0.000025967556,"about_ca_system_score_gemma":0.00013264855,"threshold_uncertainty_score":0.3812724},"labels":[],"label_agreement":null},{"id":"W4392144211","doi":"10.1007/s42081-023-00228-9","title":"Making statistical inferences about linkage errors","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Data Quality and Management","field":"Decision Sciences","cited_by":3,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Statistics Canada","funders":"","keywords":"Linkage (software); Computer science; Statistics; Psychology; Mathematics; Biology; Genetics","score_opus":0.3100787365167909,"score_gpt":0.507185537428243,"score_spread":0.1971068009114521,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392144211","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.08638734,0.00033774565,0.90705305,0.001126648,0.0010309928,0.00008980541,0.00214886,0.000017286966,0.001808249],"genre_scores_gemma":[0.90680283,0.0001438064,0.092667826,0.00021682773,0.00007213785,4.6280957e-7,0.00001598243,0.0000035646751,0.00007654348],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9959859,0.00011354608,0.0008907782,0.00049147644,0.0022414832,0.00027678005],"domain_scores_gemma":[0.9959038,0.0025382743,0.00026248285,0.00065559783,0.0004066756,0.00023316866],"candidate_categories":["metaresearch","scholarly_communication"],"consensus_categories":[],"category_scores_codex":[0.014199977,0.00010875498,0.00023920024,0.0004545134,0.00030337423,0.0023197716,0.002375354,0.00002104215,0.0002795537],"category_scores_gemma":[0.010252716,0.0000671402,0.000017454255,0.0010386552,0.001037619,0.003212779,0.0010931528,0.0002016365,0.00006878788],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00003007498,0.00006129793,0.0017819761,0.00005111123,0.000020422922,0.00041545398,0.002698347,0.00006015069,0.00049694354,0.6661867,0.017919919,0.31027758],"study_design_scores_gemma":[0.00054289924,0.0006304069,0.15408412,0.00036411142,0.00011262395,0.00057171704,0.016547687,0.22569469,0.00004641189,0.42798722,0.17285162,0.0005664948],"about_ca_topic_score_codex":0.000033765664,"about_ca_topic_score_gemma":0.00004304297,"teacher_disagreement_score":0.8204155,"about_ca_system_score_codex":0.000021878333,"about_ca_system_score_gemma":0.00029448065,"threshold_uncertainty_score":0.99871594},"labels":[],"label_agreement":null},{"id":"W4400260432","doi":"10.1007/s42081-024-00261-2","title":"Bayesian and minimax estimators of loss","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Sherbrooke","funders":"Institut des Sciences Mathématiques, Université du Québec à Montréal","keywords":"Minimax; Bayesian probability; Estimator; Minimax estimator; Econometrics; Statistics; Computer science; Mathematics; Mathematical optimization; Minimum-variance unbiased estimator","score_opus":0.08655825488282168,"score_gpt":0.4197903353342878,"score_spread":0.33323208045146613,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4400260432","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24092822,0.00016018447,0.7580245,0.00011137419,0.00013064998,0.00004140438,0.00040667318,0.0000050422973,0.0001919548],"genre_scores_gemma":[0.5116804,0.000062261875,0.48822585,0.000009660563,0.00001375194,1.5515177e-7,6.710444e-7,0.0000029279283,0.0000042941188],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9988245,0.000031013904,0.00042210633,0.0001881848,0.0003876734,0.00014652415],"domain_scores_gemma":[0.99727875,0.0019657686,0.0001454645,0.00023018703,0.00019880585,0.00018102671],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0019948352,0.00007972125,0.00021589095,0.0001272218,0.00007930302,0.00013269947,0.00035699655,0.00001751062,0.000034420867],"category_scores_gemma":[0.0051914267,0.000053430344,0.0000092548125,0.00028085586,0.0008591038,0.0004431415,0.00020024755,0.00010709808,6.412521e-7],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000025509267,0.000054032767,0.002325412,0.0003700958,0.000018709312,0.000147921,0.0014507095,0.0000013626942,0.0049231444,0.9222189,0.0006778254,0.067786336],"study_design_scores_gemma":[0.0003064611,0.00044564455,0.014624874,0.00035262207,0.00009886222,0.0009118972,0.0009334186,0.14976288,0.00059026264,0.8314766,0.00030272515,0.00019373346],"about_ca_topic_score_codex":0.000012680696,"about_ca_topic_score_gemma":0.0000019185666,"teacher_disagreement_score":0.27075222,"about_ca_system_score_codex":0.000008547635,"about_ca_system_score_gemma":0.00013828414,"threshold_uncertainty_score":0.6214998},"labels":[],"label_agreement":null},{"id":"W4401399991","doi":"10.1007/s42081-024-00260-3","title":"Applications of Population Sampling to Insurance Ratemaking and Reserving","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Sampling (signal processing); Weighting; Population; Credibility; Econometrics; Field (mathematics); Estimator; Data mining; Statistics; Economics; Mathematics","score_opus":0.12848584978147398,"score_gpt":0.4582514481752856,"score_spread":0.32976559839381164,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401399991","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.13143039,0.00008545596,0.8680318,0.00007696506,0.00004422859,0.00007288621,0.00021483179,0.0000043195537,0.000039109676],"genre_scores_gemma":[0.49575785,0.00002761973,0.5041839,0.000008471824,0.000016770486,8.1951765e-7,0.0000012931804,0.0000023010546,0.0000010154778],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9989829,0.000028425831,0.00039636396,0.00018043206,0.00030004088,0.00011181519],"domain_scores_gemma":[0.9977249,0.0015763263,0.00014061086,0.00022056972,0.00022422025,0.00011335688],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00203458,0.00005803401,0.00015870512,0.0001582311,0.00012765812,0.00015689718,0.0002943231,0.000012898663,0.0000063637576],"category_scores_gemma":[0.0033930198,0.000043053886,0.000005977044,0.0004748701,0.00015329038,0.00048609657,0.00019516158,0.0000834123,3.7516415e-7],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001377581,0.000019122259,0.004259704,0.0003505358,0.000006547324,0.000006851092,0.00083043694,0.0000056165204,0.010206744,0.814109,0.00003863089,0.17015302],"study_design_scores_gemma":[0.00011440587,0.000111013105,0.08423729,0.00052335236,0.00003020077,0.0001237892,0.0005653722,0.024974747,0.00015983329,0.88882184,0.00021497173,0.00012318548],"about_ca_topic_score_codex":0.000035347177,"about_ca_topic_score_gemma":0.000008112308,"teacher_disagreement_score":0.36432746,"about_ca_system_score_codex":0.000012392441,"about_ca_system_score_gemma":0.000046837395,"threshold_uncertainty_score":0.40620065},"labels":[],"label_agreement":null},{"id":"W4403890161","doi":"10.1007/s42081-024-00276-9","title":"Methodological challenges in studying disease processes using observational cohort data","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Genetic Associations and Epidemiology","field":"Biochemistry, Genetics and Molecular Biology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; University of Toronto","keywords":"Observational study; Disease; Psychological intervention; Cohort; Appeal; Data science; Computer science; Cohort study; Longitudinal data; Psychology; Medicine; Management science; Risk analysis (engineering); Data mining; Engineering; Pathology","score_opus":0.5360041320382929,"score_gpt":0.46931805196175813,"score_spread":0.06668608007653476,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403890161","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9462051,0.004262704,0.048526164,0.0004818644,0.00010338486,0.0000572389,0.0003443327,0.0000017070918,0.00001751278],"genre_scores_gemma":[0.8780294,0.0034191562,0.11829808,0.000051937313,0.000081233586,7.7650566e-7,0.000113169226,0.000003009469,0.0000032123744],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989177,0.000095540054,0.00029188677,0.00034584844,0.00020440487,0.00014460678],"domain_scores_gemma":[0.99894214,0.0003337066,0.000103077495,0.00033629852,0.0001855788,0.00009921252],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0045355186,0.000063520165,0.00013335129,0.000066874636,0.00008982855,0.000057558475,0.0006111017,0.000024783674,0.000003573093],"category_scores_gemma":[0.0076562506,0.00004648214,0.000006498623,0.00019203019,0.00020062235,0.000061133804,0.0005649729,0.000070689464,2.8832977e-7],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010919888,0.00019739177,0.9149223,0.00024446173,0.00009018376,0.0001230314,0.0005005213,0.0020655452,0.055595294,0.0036097686,0.00076370966,0.02177862],"study_design_scores_gemma":[0.000153182,0.00010128078,0.93684524,0.00004518303,0.000039220446,0.000091170856,0.0006230871,0.058492985,0.00003768309,0.0022145547,0.0012448232,0.0001115898],"about_ca_topic_score_codex":0.00001283664,"about_ca_topic_score_gemma":0.000025115458,"teacher_disagreement_score":0.069771916,"about_ca_system_score_codex":0.00001124871,"about_ca_system_score_gemma":0.00044672567,"threshold_uncertainty_score":0.91658},"labels":[],"label_agreement":null},{"id":"W4405708154","doi":"10.1007/s42081-024-00286-7","title":"Correction: Applications of Population Sampling to Insurance Ratemaking and Reserving","year":2024,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Healthcare Policy and Management","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Sampling (signal processing); Population; Actuarial science; Computer science; Data science; Statistics; Econometrics; Business; Mathematics; Telecommunications; Medicine; Environmental health","score_opus":0.11303982661357444,"score_gpt":0.3733645178651161,"score_spread":0.2603246912515417,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405708154","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.36680576,0.0010820915,0.6290438,0.0014388498,0.0005055892,0.0001603716,0.00044756744,0.0000070898523,0.0005088625],"genre_scores_gemma":[0.97494763,0.0002858185,0.024628745,0.00006766834,0.000045851506,0.0000016565753,0.000004311585,0.000002573224,0.000015752837],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"observational","domain_scores_codex":[0.99928886,0.0000054241555,0.0003910936,0.00016516508,0.00005868095,0.00009078871],"domain_scores_gemma":[0.99940485,0.00012815735,0.00015993214,0.00016128636,0.00006748818,0.00007830055],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015724766,0.00003658722,0.00011401462,0.00025869577,0.00012836562,0.00012052334,0.0001891308,0.000009514094,0.000004654001],"category_scores_gemma":[0.0004455718,0.000035013192,0.0000052295836,0.0004462227,0.00005633563,0.00058953965,0.00013658703,0.0000571758,0.0000020227865],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00001689345,0.000027653088,0.041242253,0.0003929894,0.000014762675,0.0000045178017,0.0025700158,0.0006444693,0.00043953926,0.86122304,0.000414194,0.09300964],"study_design_scores_gemma":[0.00022757017,0.00018946608,0.7640527,0.00038222046,0.000010739974,0.00009825859,0.0012239479,0.13070863,0.000035274403,0.065717995,0.03712853,0.0002246874],"about_ca_topic_score_codex":0.0007813041,"about_ca_topic_score_gemma":0.00006046247,"teacher_disagreement_score":0.79550505,"about_ca_system_score_codex":0.000023620281,"about_ca_system_score_gemma":0.000021784743,"threshold_uncertainty_score":0.14277966},"labels":[],"label_agreement":null},{"id":"W4407248782","doi":"10.1007/s42081-025-00295-0","title":"Correction: Methodological challenges in studying disease processes using observational cohort data","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Food Security and Health in Diverse Populations","field":"Health Professions","cited_by":0,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Observational study; Data science; Cohort; Computer science; Medicine; Pathology","score_opus":0.8219778875377437,"score_gpt":0.6023865142488891,"score_spread":0.21959137328885459,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407248782","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9402972,0.0020244606,0.047691856,0.005257425,0.0024124158,0.0006021609,0.0011618093,0.000016384616,0.0005362815],"genre_scores_gemma":[0.92142457,0.0019163098,0.07609636,0.00036489934,0.000096050644,0.00000344269,0.00007578343,0.0000026898376,0.000019891468],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9982206,0.0002677984,0.00059485,0.00029940988,0.00039755684,0.00021974857],"domain_scores_gemma":[0.9959824,0.0025149905,0.0003043478,0.00043344544,0.00060112093,0.00016366754],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.006633586,0.00006743898,0.00020054942,0.00020330262,0.0009915303,0.000032108634,0.0007841907,0.00003213042,0.000027347787],"category_scores_gemma":[0.016999232,0.000053025906,0.000004422372,0.0006304574,0.00024538656,0.0012812221,0.0008220105,0.00032238735,0.0000010128746],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015687155,0.00016163538,0.9672236,0.0005000409,0.000012848085,0.000024753253,0.0029591043,0.00034983095,0.00005175407,0.024129013,0.00138495,0.0030455885],"study_design_scores_gemma":[0.00030205576,0.000032102507,0.92246616,0.00031073982,0.0000307783,0.000006595118,0.007411044,0.06362049,4.0797667e-7,0.004638166,0.0011210955,0.00006034428],"about_ca_topic_score_codex":0.00014168455,"about_ca_topic_score_gemma":0.0003705796,"teacher_disagreement_score":0.063270666,"about_ca_system_score_codex":0.000067780486,"about_ca_system_score_gemma":0.0017857586,"threshold_uncertainty_score":0.991281},"labels":[],"label_agreement":null},{"id":"W4408047762","doi":"10.1007/s42081-025-00298-x","title":"Application of machine learning methods in the imputation of heterogeneous co-missing data","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Impact","funders":"Canadian Institutes of Health Research; McLaughlin Centre, University of Toronto","keywords":"Imputation (statistics); Missing data; Computer science; Machine learning; Artificial intelligence; Data mining","score_opus":0.04797112399033372,"score_gpt":0.4199266282748576,"score_spread":0.3719555042845239,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408047762","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051653264,0.00020628572,0.9942375,0.00018942029,0.000038072438,0.00005802934,0.00004517241,0.0000017246638,0.000058497502],"genre_scores_gemma":[0.4065149,0.000042322044,0.59339535,0.000035029134,0.0000040651116,1.9995936e-7,0.0000065937143,8.1601877e-7,7.2478497e-7],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99869144,0.00024593397,0.00043797083,0.00021968513,0.00030314107,0.00010179988],"domain_scores_gemma":[0.99795145,0.0007330042,0.0004063822,0.00069406955,0.00017812295,0.000036968137],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008062416,0.00005570119,0.00016127319,0.00017920606,0.00010449589,0.00008896501,0.0022559774,0.000015186385,5.016219e-7],"category_scores_gemma":[0.00096171914,0.00003622057,0.000008056644,0.00065722,0.00020807228,0.0007978548,0.0004907674,0.00012435933,4.5246644e-8],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000012578954,0.000047707963,0.0011932738,0.00003999022,0.0000059974136,0.000004794082,0.0014170177,0.0005527546,0.043426197,0.04048116,0.000017437238,0.9128011],"study_design_scores_gemma":[0.00016435563,0.000059959188,0.004483919,0.00002520601,0.00001081494,0.000065594264,0.00008535796,0.96806777,0.0016689352,0.025194978,0.00013411984,0.000039017148],"about_ca_topic_score_codex":0.00006220733,"about_ca_topic_score_gemma":0.000005375159,"teacher_disagreement_score":0.967515,"about_ca_system_score_codex":0.000008691977,"about_ca_system_score_gemma":0.0001415471,"threshold_uncertainty_score":0.41922045},"labels":[],"label_agreement":null},{"id":"W4413801157","doi":"10.1007/s42081-025-00314-0","title":"Applying non-negative matrix factorization with covariates to multivariate time series data as a vector autoregression model","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"Japan Society for the Promotion of Science","keywords":"Covariate; Vector autoregression; Multivariate statistics; Autoregressive model; Series (stratigraphy); Time series; Econometrics; Statistics; Mathematics; Computer science; Biology","score_opus":0.025026571645971923,"score_gpt":0.3298188312038354,"score_spread":0.3047922595578635,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413801157","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.026236502,0.000007994456,0.97267187,0.00038824434,0.00011614069,0.00018743037,0.00032636174,0.000013702688,0.00005176954],"genre_scores_gemma":[0.41834638,0.000015955566,0.58142394,0.00010029635,0.000013843668,0.0000036826843,0.000035839403,0.0000029942587,0.000057076013],"study_design_codex":"bench_or_experimental","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9985633,0.000031325108,0.00028749055,0.0004178537,0.0005110582,0.00018897906],"domain_scores_gemma":[0.9982583,0.00020942223,0.00023665068,0.00068232237,0.0004506235,0.00016266822],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000877098,0.0001141568,0.00017367522,0.00022206642,0.0003757592,0.0005022934,0.0018018872,0.00002385664,0.000005620869],"category_scores_gemma":[0.00082739623,0.00007480824,0.000005689059,0.0007325001,0.000133373,0.0045202062,0.0013188686,0.00010409072,0.00000814997],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011271174,0.00046648888,0.0022255206,0.00019216935,0.00011566328,0.00015204697,0.0146822715,0.02487978,0.8330071,0.057785597,0.010984101,0.054382127],"study_design_scores_gemma":[0.00043277,0.00016272395,0.0030870885,0.00022676881,0.000015908554,0.000034466422,0.00027680007,0.9881814,0.0031709212,0.004150208,0.0001323626,0.0001285709],"about_ca_topic_score_codex":0.00006453827,"about_ca_topic_score_gemma":0.0000048782745,"teacher_disagreement_score":0.96330166,"about_ca_system_score_codex":0.000026448566,"about_ca_system_score_gemma":0.00042604396,"threshold_uncertainty_score":0.4843627},"labels":[],"label_agreement":null},{"id":"W4417222887","doi":"10.1007/s42081-025-00322-0","title":"On multivariate binary outcomes copulas-regression problem","year":2025,"lang":"en","type":"article","venue":"Japanese Journal of Statistics and Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Trois-Rivières; Université du Québec à Montréal","funders":"Fonds de Recherche du Québec - Santé","keywords":"Multivariate statistics; Copula (linguistics); Covariate; Binary number; Binary data; Estimator; Marginal distribution; Logistic regression; Multivariate normal distribution","score_opus":0.1058971062364061,"score_gpt":0.4482954307905468,"score_spread":0.3423983245541407,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417222887","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"codex-gemma-dda1882f352a","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.41593063,0.000028593102,0.581125,0.0006353071,0.00039009989,0.00017964724,0.00040382906,0.000014101255,0.0012927516],"genre_scores_gemma":[0.4192821,0.000017949942,0.58051383,0.00011314459,0.000008231889,7.613493e-7,0.0000019081467,0.0000030715576,0.000058960748],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99848604,0.000077190954,0.0004937885,0.00024755186,0.0004879176,0.00020752243],"domain_scores_gemma":[0.99574596,0.0030778288,0.00028643475,0.000417059,0.00032250406,0.00015018886],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0021906984,0.00012047104,0.00029048714,0.00018988102,0.00025159845,0.00011654037,0.00068277505,0.000025929725,0.000035655215],"category_scores_gemma":[0.011181862,0.0000697431,0.000015014827,0.00035564727,0.0003978584,0.00035320077,0.00034900967,0.00017553016,0.0000025013082],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077103585,0.0001816233,0.0026346876,0.0000670418,0.000014831336,0.00003811201,0.00032106458,0.000004385559,0.0050115674,0.9584431,0.0019689791,0.031237517],"study_design_scores_gemma":[0.0008388466,0.00037589378,0.084693484,0.00034616404,0.000048147704,0.00003072477,0.00039365148,0.020504015,0.00022316573,0.8922471,0.00014327509,0.0001555663],"about_ca_topic_score_codex":0.000027558517,"about_ca_topic_score_gemma":0.0000028678216,"teacher_disagreement_score":0.082058795,"about_ca_system_score_codex":0.000026238455,"about_ca_system_score_gemma":0.00015247622,"threshold_uncertainty_score":0.9971474},"labels":[],"label_agreement":null}]}