{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":25,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":25,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"fb1763f2f70b","filters":{"venue":"Journal of Data Science"}},"results":[{"id":"W3215602957","doi":"10.6339/22-jds1047","title":"A Review on Graph Neural Network Methods in Financial Applications","year":2022,"lang":"en","type":"review","venue":"Journal of Data Science","topic":"Advanced Graph Neural Networks","field":"Computer Science","cited_by":122,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Institute for Catastrophic Loss Reduction","keywords":"Computer science; Graph; Categorization; Artificial neural network; Financial modeling; Data mining; Data science; Finance; Artificial intelligence; Theoretical computer science; Business","authors":[{"name":"Jianian Wang","is_ca":false},{"name":"Sheng Zhang","is_ca":false},{"name":"Yanghua Xiao","is_ca":false},{"name":"Rui Song","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1986486505103352,"gpt":0.4830799741744901,"spread":0.2844313236641549,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001054458,0.001350719,0.001054327,0.002923572,0.000405476,0.001272828,0.001518348,0.001370854,0.006521754],"category_scores_gemma":[0.003143214,0.0005313901,0.0008002613,0.005228167,0.0005888001,0.002638547,0.0007012984,0.001489464,0.003061124],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009107423,"about_ca_system_score_gemma":0.001449093,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003963791,"about_ca_topic_score_gemma":0.0043921,"domain_scores_codex":[0.9996111,0.0000788808,0.00005155753,0.00008673637,0.0001477977,0.00002395152],"domain_scores_gemma":[0.9986551,0.0008524285,0.00006955398,0.00004755303,0.0003398571,0.00003545278],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00003193209,0.00008004721,0.0006500353,0.008689305,0.000116199,0.0001366564,0.00007505246,0.00762607,0.0006482947,0.03404827,0.04630078,0.9015974],"study_design_scores_gemma":[0.00001617293,0.0001102586,0.001674603,0.005224185,0.0002164082,0.0007678207,0.0001051848,0.01992776,0.001219836,0.04925986,0.9213873,0.00009072165],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0009012474,0.9558963,0.02881921,0.001808615,0.001267407,0.00004691788,0.0002017541,0.0001402986,0.01091831],"genre_scores_gemma":[0.007899849,0.9711136,0.01550638,0.0005622992,0.00106756,0.0000538596,0.0002976601,0.00004436542,0.003454514],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.006521754,"threshold_uncertainty_score":0.02181745,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2514070870","doi":"10.6339/jds.201604_14(2).0002","title":"Comparing Pre-Post Change Across Groups: Guidelines for Choosing between Difference Scores, ANCOVA, and Residual Change Scores","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":60,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"","keywords":"Analysis of covariance; Residual; Statistics; Significant difference; Psychology; Mathematics","authors":[{"name":"Megan A. Jennings","is_ca":true},{"name":"Robert A. Cribbie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.732100748033184,"gpt":0.5505718425854673,"spread":0.1815289054477167,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2154736,0.004881492,0.007278097,0.01268176,0.002076542,0.004013572,0.007316995,0.007086085,0.0268219],"category_scores_gemma":[0.5365975,0.004182421,0.006591364,0.01292636,0.004870883,0.004868586,0.003263485,0.01379003,0.01549055],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00165857,"about_ca_system_score_gemma":0.005725503,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004009793,"about_ca_topic_score_gemma":0.01028914,"domain_scores_codex":[0.7355825,0.1932982,0.04210356,0.005777583,0.02221792,0.001020215],"domain_scores_gemma":[0.4544826,0.4466504,0.01578285,0.0290677,0.05170177,0.002314688],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.003088192,0.001471573,0.005912216,0.01119392,0.001752372,0.0008778988,0.002525479,0.003143733,0.003640603,0.03207331,0.590018,0.3443028],"study_design_scores_gemma":[0.005722572,0.004749704,0.04369739,0.02564841,0.002181825,0.002037104,0.003953476,0.02960715,0.01682655,0.2235633,0.6404032,0.001609467],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.003340551,0.006468159,0.9115558,0.006568408,0.007176665,0.03160058,0.01962674,0.005497623,0.008165485],"genre_scores_gemma":[0.005084194,0.001310074,0.9330851,0.001816413,0.0004117254,0.0510013,0.002731425,0.001758681,0.002800979],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7845265,"threshold_uncertainty_score":0.9674608,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2564423956","doi":"10.6339/jds.201407_12(3).0001","title":"Factorial ANOVA with unbalanced data: A fresh look at the types of sums of squares","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":51,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"","keywords":"Confusion; Factorial; Factorial analysis; Analysis of variance; Statistics; Type (biology); Econometrics; Mathematics; Factorial experiment; Explained sum of squares; Lack-of-fit sum of squares; Generalized least squares; Computer science; Arithmetic; Psychology; Non-linear least squares","authors":[{"name":"Carrie E. Smith","is_ca":true},{"name":"Robert A. Cribbie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7074570963113356,"gpt":0.5968141994031163,"spread":0.1106428969082193,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1670331,0.002874334,0.005202207,0.007252927,0.002541747,0.009574843,0.006775101,0.003760726,0.01071181],"category_scores_gemma":[0.3763921,0.001545253,0.005393759,0.0117109,0.02245986,0.01593184,0.00744431,0.01516198,0.002975031],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004210243,"about_ca_system_score_gemma":0.005045721,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001434687,"about_ca_topic_score_gemma":0.001670494,"domain_scores_codex":[0.7392431,0.1754094,0.01810257,0.01219502,0.05342496,0.001625049],"domain_scores_gemma":[0.4868029,0.4430156,0.01594214,0.03261634,0.02029943,0.001323538],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003950957,0.00009947736,0.003202078,0.003589327,0.0006025973,0.0005152788,0.002712924,0.002361438,0.000857095,0.6458071,0.027151,0.3127066],"study_design_scores_gemma":[0.00005415593,0.0003265571,0.001388288,0.00164921,0.0001293832,0.0007264984,0.0006243025,0.005669108,0.001001262,0.909108,0.07916654,0.0001566888],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.001547598,0.01202509,0.9663254,0.008249409,0.004282298,0.0003295089,0.0003369006,0.0003754297,0.00652834],"genre_scores_gemma":[0.04839767,0.01899037,0.9063619,0.0093308,0.008458851,0.003242419,0.0005333236,0.001242438,0.003442171],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1670331,"threshold_uncertainty_score":0.883366,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2181556329","doi":"10.6339/jds.2004.02(1).135","title":"The Poisson Inverse Gaussian Regression Model in the Analysis of Clustered Counts Data","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":49,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"University of Guelph; Western University","funders":"","keywords":"Poisson regression; Statistics; Mathematics; Covariate; Poisson distribution; Negative binomial distribution; Count data; Inverse Gaussian distribution; Regression analysis; Generalized linear model; Regression; Distribution (mathematics); Population","authors":[{"name":"Mohamed M. Shoukri","is_ca":true},{"name":"Musa Hakan Asyalı","is_ca":false},{"name":"R. VanDorp","is_ca":true},{"name":"D.F. Kelton","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1427107502866689,"gpt":0.3991228810900525,"spread":0.2564121308033835,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0378621,0.001063925,0.002040311,0.002238365,0.001014501,0.002331084,0.00549582,0.002371006,0.003437403],"category_scores_gemma":[0.08831883,0.001336496,0.00239168,0.00534075,0.002759085,0.003372589,0.002410769,0.003587366,0.00144484],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002306923,"about_ca_system_score_gemma":0.004352613,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0318618,"about_ca_topic_score_gemma":0.02376825,"domain_scores_codex":[0.975911,0.01766072,0.0005715461,0.002511389,0.0027363,0.0006090143],"domain_scores_gemma":[0.9609412,0.03196189,0.002066197,0.002849516,0.001835204,0.0003459745],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002048845,0.000130774,0.01547827,0.0005286464,0.0006185742,0.000684121,0.001542808,0.2561532,0.001271149,0.6296114,0.008351541,0.08542468],"study_design_scores_gemma":[0.0000591617,0.0001280436,0.003499801,0.0001487829,0.0001365632,0.0003335587,0.0001964893,0.7338882,0.0006002334,0.2495908,0.01131738,0.0001010251],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.005080592,0.0004244591,0.9927554,0.0003206762,0.00005275923,0.00007718103,0.0001736573,0.0002285473,0.0008867633],"genre_scores_gemma":[0.1919625,0.001978667,0.7957805,0.0006558298,0.0003417983,0.001223372,0.001062862,0.0004933369,0.006501037],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.0378621,"threshold_uncertainty_score":0.2002364,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2182961570","doi":"10.6339/jds.2004.02(1).142","title":"A Two-Stage Bayesian Model for Predicting Winners in Major League Baseball","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Sports Analytics and Performance","field":"Economics, Econometrics and Finance","cited_by":43,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Korea Science and Engineering Foundation","keywords":"League; Markov chain Monte Carlo; Bayesian probability; Bayesian inference; Computer science; Econometrics; Field (mathematics); Markov chain; Inference; Artificial intelligence; Operations research; Machine learning; Mathematics","authors":[{"name":"Tae Young Yang","is_ca":false},{"name":"Tim B. Swartz","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.09328473143994379,"gpt":0.3027483287623079,"spread":0.2094635973223641,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0115235,0.001337297,0.002263237,0.002229506,0.0009904173,0.00280014,0.004578824,0.003568847,0.008001757],"category_scores_gemma":[0.02056615,0.001952392,0.00146244,0.002206312,0.001337952,0.00330529,0.00157545,0.003486095,0.001665506],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002338161,"about_ca_system_score_gemma":0.002514057,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.05744515,"about_ca_topic_score_gemma":0.05471647,"domain_scores_codex":[0.9972161,0.001396452,0.0001365872,0.0005674571,0.0002482443,0.0004352039],"domain_scores_gemma":[0.983228,0.01355905,0.00120804,0.0004646574,0.0009552582,0.0005849727],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009508852,0.0004778069,0.03041966,0.0001304848,0.0002689376,0.0002819496,0.0004542434,0.8715872,0.0006595006,0.05301533,0.005577726,0.03617632],"study_design_scores_gemma":[0.00007345159,0.00005397902,0.002677073,0.00001957798,0.00003690332,0.0000279023,0.00004043709,0.9821293,0.00007685696,0.01430944,0.0005257505,0.00002920507],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.3768713,0.00118661,0.6050221,0.003532742,0.0001682664,0.0005146361,0.005658652,0.0009362581,0.006109504],"genre_scores_gemma":[0.9054903,0.0008633287,0.07318306,0.0003511978,0.0002452883,0.0007575389,0.005772753,0.0001076899,0.01322889],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.05744515,"threshold_uncertainty_score":0.1142215,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3138069980","doi":"10.6339/jds.201207_10(3).0006","title":"A Data Mining Approach to Comparing American and Canadian Grade 10 Students’ PISA Science Test Performance","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Online Learning and Analytics","field":"Computer Science","cited_by":20,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Test (biology); Academic achievement; Mathematics education; Achievement test; Psychology; Political science; Standardized test","authors":[{"name":"Chong Ho Yu","is_ca":false},{"name":"Charles Kaprolet","is_ca":false},{"name":"Angel Jannasch‐Pennell","is_ca":false},{"name":"Samuel DiGangi","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1098757292940929,"gpt":0.3657505192465182,"spread":0.2558747899524254,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003953649,0.0009223919,0.0009794482,0.01435851,0.002737439,0.00236425,0.002102226,0.0005432669,0.001937718],"category_scores_gemma":[0.01459839,0.0003054438,0.001150182,0.01797942,0.0007365387,0.000637143,0.001225321,0.001298329,0.0004933893],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006591027,"about_ca_system_score_gemma":0.01396246,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.8147897,"about_ca_topic_score_gemma":0.8174941,"domain_scores_codex":[0.9966583,0.0004503145,0.0003577799,0.0004650523,0.001675486,0.0003930616],"domain_scores_gemma":[0.9895488,0.003159348,0.001225019,0.0004569375,0.00505081,0.0005590643],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0005833365,0.001005358,0.8490982,0.0004160466,0.0006989811,0.0004558622,0.007107997,0.002731172,0.003188734,0.00209324,0.008569917,0.1240512],"study_design_scores_gemma":[0.00003561252,0.0004066226,0.9553539,0.0001359936,0.0001673471,0.0002041498,0.01499338,0.01517406,0.002732206,0.0007564807,0.009959345,0.00008099418],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9323123,0.0003497888,0.01508754,0.0006982412,0.00009246008,0.001799525,0.03505397,0.0005384019,0.01406766],"genre_scores_gemma":[0.9503489,0.0002395953,0.0311072,0.0000993879,0.00001672191,0.001207415,0.01394662,0.00003611526,0.002998038],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.1852103,"threshold_uncertainty_score":0.3726022,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2181591901","doi":"10.6339/jds.2008.06(3).508","title":"Evaluating Aortic Stenosis Using the Archimedean Copula Methodology","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":16,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Northern British Columbia","funders":"","keywords":"Copula (linguistics); Stenosis; China; Statistics; Econometrics; Actuarial science; Mathematics; Medicine; Cardiology; Internal medicine; Business; Geography","authors":[{"name":"Pranesh Kumar","is_ca":true},{"name":"Mohamed M. Shoukri","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8478728438504952,"gpt":0.6353580343979097,"spread":0.2125148094525855,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005116201,0.001040492,0.001307817,0.002975925,0.0004530449,0.001827032,0.000720871,0.0006893609,0.003174369],"category_scores_gemma":[0.02624199,0.000275387,0.001106646,0.002007784,0.0005160042,0.001029058,0.0009732696,0.001153868,0.0005323741],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0004479314,"about_ca_system_score_gemma":0.001594342,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003916795,"about_ca_topic_score_gemma":0.003281225,"domain_scores_codex":[0.9974151,0.001310975,0.000195442,0.0002376643,0.0007279835,0.0001127157],"domain_scores_gemma":[0.9902451,0.00616023,0.000829985,0.0005401624,0.001861883,0.0003627331],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0006767026,0.0003049597,0.09931121,0.0008249703,0.0007594491,0.001943786,0.0003051503,0.2643207,0.006256142,0.02901929,0.01563445,0.5806432],"study_design_scores_gemma":[0.00003613753,0.0005437246,0.02802649,0.0001336909,0.000173513,0.001234184,0.0002359755,0.9416566,0.003944293,0.01961358,0.004340605,0.00006112954],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.09643006,0.004212942,0.8915178,0.001017455,0.0003634642,0.0002490651,0.0008241134,0.0005603131,0.004824944],"genre_scores_gemma":[0.5784276,0.002955155,0.4133562,0.0001761782,0.0003272296,0.0002334934,0.0009217756,0.0002207515,0.003381706],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.005116201,"threshold_uncertainty_score":0.02705735,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2189164006","doi":"10.6339/jds.2004.02(2).144","title":"Wavelet Analysis of Tide-affected Low Streamflows Series","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Image and Signal Denoising Methods","field":"Computer Science","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Memorial University of Newfoundland","funders":"","keywords":"Series (stratigraphy); Streamflow; Wavelet; Environmental science; Quantile; Flow (mathematics); Noise (video); Frequency domain; Wavelet transform; Geology; Mathematics; Statistics; Computer science; Geography; Mathematical analysis; Drainage basin","authors":[{"name":"Yeo-Howe Lim","is_ca":false},{"name":"Leonard M. Lye","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.04068391126091666,"gpt":0.3338900321005291,"spread":0.2932061208396125,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0006865721,0.000194768,0.0001688739,0.0007846166,0.0001279877,0.0003209946,0.0001372055,0.0001291548,0.0004300285],"category_scores_gemma":[0.001417578,0.00005934562,0.000244014,0.0009674444,0.0001940547,0.0002584343,0.0001562031,0.000254786,0.0001156343],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0001499736,"about_ca_system_score_gemma":0.0001445988,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001015415,"about_ca_topic_score_gemma":0.0009518806,"domain_scores_codex":[0.999864,0.00002830657,0.00001557663,0.00002706958,0.00004463964,0.00002029786],"domain_scores_gemma":[0.9995868,0.0001820147,0.00007712863,0.00004275348,0.0000975225,0.00001389202],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007633065,0.0002917802,0.05670226,0.000402561,0.0001644237,0.001237512,0.001284016,0.1124988,0.293805,0.01038827,0.001383713,0.5210782],"study_design_scores_gemma":[0.00001356964,0.0002150939,0.2919011,0.00003814488,0.00009020128,0.0004015812,0.0005534815,0.6365548,0.06281772,0.003395462,0.003971441,0.00004734823],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8501012,0.0001231079,0.1480215,0.00005638062,0.00002631233,0.00002666027,0.0002538838,0.0001249195,0.001265929],"genre_scores_gemma":[0.9778193,0.0001680591,0.02106627,0.000005707575,0.00001085359,0.00001268102,0.0002961966,0.00001679078,0.0006041941],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.001015415,"threshold_uncertainty_score":0.003630996,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2185363721","doi":"10.6339/jds.2010.08(1).585","title":"A Bayesian Estimator of the Intracluster Correlation Coefficient from Correlated Binary Responses","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Water Quality and Resources Studies","field":"Environmental Science","cited_by":7,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Mathematics; Estimator; Statistics; Beta-binomial distribution; Negative binomial distribution; Poisson distribution","authors":[{"name":"Marwa H. Ahmed","is_ca":false},{"name":"Mohamed M. Shoukri","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.05897463788431407,"gpt":0.2840856813768295,"spread":0.2251110434925154,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02198046,0.0009092565,0.002291245,0.003861237,0.000800672,0.001637387,0.002753301,0.002147226,0.003772251],"category_scores_gemma":[0.1237095,0.0006502728,0.001790534,0.002984361,0.001641406,0.002399416,0.001814093,0.003148533,0.001110901],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008245595,"about_ca_system_score_gemma":0.002104259,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003149094,"about_ca_topic_score_gemma":0.002348247,"domain_scores_codex":[0.9852107,0.009045621,0.0006871626,0.002164993,0.002528062,0.0003635262],"domain_scores_gemma":[0.9284711,0.05869459,0.004006181,0.003425306,0.004938075,0.0004646649],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.000749093,0.0003613605,0.03896473,0.001462064,0.001644402,0.0005277129,0.001252569,0.1423978,0.006774634,0.1615492,0.01180059,0.6325159],"study_design_scores_gemma":[0.0002626373,0.0004303967,0.02876709,0.0008037128,0.0005608773,0.001011193,0.0003326356,0.7344226,0.004015193,0.2182143,0.01090301,0.0002762928],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.009621713,0.0005921141,0.9878051,0.0001919281,0.00004163884,0.0001405058,0.0002956678,0.0002744151,0.001036882],"genre_scores_gemma":[0.2683797,0.001319592,0.7241584,0.0004965596,0.0002586754,0.001284971,0.002342893,0.0001825872,0.001576711],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.02198046,"threshold_uncertainty_score":0.1162452,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2185241920","doi":"10.6339/jds.201101_09(1).0005","title":"Estimating Transmissibility of Seasonal Influenza Virus by Surveillance Data","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Influenza Virus Research Studies","field":"Medicine","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Public Health Agency of Canada","funders":"Public Health Agency; Public Health Agency of Canada","keywords":"Transmissibility (structural dynamics); Outbreak; Estimation; Transmission (telecommunications); Flu season; Seasonal influenza; Virus; Vaccination; Influenza A virus; Virology; Statistics; Biology; Computer science; Medicine; Mathematics; Coronavirus disease 2019 (COVID-19); Disease; Engineering; Infectious disease (medical specialty)","authors":[{"name":"Shenghai Zhang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2321728817170107,"gpt":0.4759016103250826,"spread":0.2437287286080719,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003666552,0.0004933465,0.0005193127,0.0030447,0.0002310685,0.0009787313,0.0007145461,0.000590693,0.0003895201],"category_scores_gemma":[0.02114237,0.0004220651,0.0007488756,0.001732875,0.0003581024,0.002170159,0.0009431128,0.0005486099,0.0001241755],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005388059,"about_ca_system_score_gemma":0.0003483337,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004289601,"about_ca_topic_score_gemma":0.002918808,"domain_scores_codex":[0.9981948,0.0008745666,0.0002030034,0.0003562979,0.0002801049,0.0000912952],"domain_scores_gemma":[0.987788,0.00871477,0.001315672,0.001349572,0.0006546514,0.0001772876],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00049554,0.0001741054,0.5263432,0.0003072997,0.0006860466,0.0004608418,0.0004404191,0.3307506,0.009442069,0.006207515,0.0006479062,0.1240445],"study_design_scores_gemma":[0.00001337514,0.0001906817,0.08100807,0.00004487016,0.0001113774,0.0002928227,0.0001993344,0.9065078,0.003401323,0.007449266,0.0007483825,0.00003268171],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8150938,0.0007995598,0.1806151,0.0002671766,0.00002539445,0.0000803129,0.00201278,0.0001583306,0.0009476381],"genre_scores_gemma":[0.9780052,0.0004213219,0.01908637,0.00001528604,0.00003046285,0.00003555129,0.002197243,0.00001000682,0.000198528],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.004289601,"threshold_uncertainty_score":0.01939082,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2190667587","doi":"10.6339/jds.2003.01(2).131","title":"Analysis of Unbalanced Microarray Data","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":5,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Microarray analysis techniques; China; Data science; Microarray databases; Library science; Data analysis; Data mining; Computer science; Statistics; Political science; Mathematics; Biology; Gene","authors":[{"name":"Mei‐Ling Ting Lee","is_ca":false},{"name":"G. À. Whitmore","is_ca":true},{"name":"R. Yu. Yukhananov","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.06929950204773849,"gpt":0.3692050382421703,"spread":0.2999055361944318,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01198696,0.000930177,0.001916281,0.003560282,0.0007696779,0.001474328,0.001053352,0.000520326,0.009725481],"category_scores_gemma":[0.0558451,0.0005125732,0.001417651,0.005044945,0.0007450304,0.001541007,0.001111669,0.00170937,0.002122036],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008531461,"about_ca_system_score_gemma":0.001364187,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.0009644263,"about_ca_topic_score_gemma":0.001539128,"domain_scores_codex":[0.9892367,0.003787236,0.0008543865,0.002137707,0.003532005,0.0004519845],"domain_scores_gemma":[0.9616882,0.02443079,0.002138702,0.007262041,0.00405883,0.0004215067],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.002038458,0.0002330799,0.05451868,0.001778278,0.001759607,0.0007590309,0.0003797228,0.03888746,0.05127212,0.03018928,0.1117336,0.7064508],"study_design_scores_gemma":[0.0003149345,0.0007670636,0.1261126,0.0002929922,0.0008684893,0.001773123,0.0005567023,0.4924067,0.02773083,0.2018335,0.1471051,0.0002379782],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.04990222,0.002030298,0.9076702,0.001709415,0.0009671418,0.0004377561,0.03177967,0.002787235,0.00271608],"genre_scores_gemma":[0.3161926,0.002130138,0.5758262,0.0008427283,0.001232248,0.002854455,0.09364902,0.001469995,0.005802597],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01198696,"threshold_uncertainty_score":0.06339383,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3053629049","doi":"10.6339/jds.202007_18(3).0018","title":"Data Visualization and Descriptive Analysis for Understanding Epidemiological Characteristics of COVID-19: A Case Study of a Dataset from January 22, 2020 to March 29, 2020","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Case fatality rate; Epidemiology; Coronavirus disease 2019 (COVID-19); Coronavirus; Incubation period; Medicine; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); 2019-20 coronavirus outbreak; Nonparametric statistics; Disease; Internal medicine; Pathology; Statistics; Psychology; Incubation; Infectious disease (medical specialty); Outbreak","authors":[{"name":"Yasin Khadem Charvadeh","is_ca":true},{"name":"Grace Y. Yi","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.6960204092600549,"gpt":0.5511004728700827,"spread":0.1449199363899722,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002916066,0.000466183,0.0003911013,0.00516503,0.0004967499,0.001128698,0.0005815027,0.0007286182,0.0009666566],"category_scores_gemma":[0.01023502,0.0001340118,0.0007893953,0.003753086,0.0003175457,0.0008277163,0.0008241082,0.0007047968,0.0002944873],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008344476,"about_ca_system_score_gemma":0.0009319613,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01178919,"about_ca_topic_score_gemma":0.01850767,"domain_scores_codex":[0.9988287,0.0004012554,0.0002088791,0.0002004918,0.0002528817,0.0001078205],"domain_scores_gemma":[0.9892916,0.006818557,0.001361088,0.0009259353,0.001213797,0.0003890709],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0009413682,0.0005844994,0.8462569,0.000643437,0.0003733301,0.002731547,0.001682336,0.01836485,0.003846403,0.004238222,0.03728856,0.08304857],"study_design_scores_gemma":[0.00009494071,0.0003504857,0.7524094,0.0003116393,0.0001709746,0.002976158,0.006671122,0.1643013,0.005102398,0.007431256,0.06005315,0.000127171],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.8597265,0.001843299,0.01727661,0.003889458,0.0001596635,0.0001944561,0.1131064,0.001081824,0.002721892],"genre_scores_gemma":[0.8701321,0.0004990499,0.03954434,0.0001400584,0.00008685103,0.0001973348,0.08856386,0.00007156636,0.0007648261],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01178919,"threshold_uncertainty_score":0.02344108,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3047907238","doi":"10.6339/jds.202007_18(3).0015","title":"COVID-19 Fatality: A Cross-Sectional Study using Adaptive Lasso Penalized Sliced Inverse Regression","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"COVID-19 epidemiological studies","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Case fatality rate; Lasso (programming language); Coronavirus disease 2019 (COVID-19); Outbreak; Feature selection; Regression; Pandemic; Regression analysis; Population; Statistics; Medicine; Computer science; Disease; Mathematics; Infectious disease (medical specialty); Virology; Artificial intelligence; Environmental health; Internal medicine","authors":[{"name":"Kaida Cai","is_ca":true},{"name":"Wenqing He","is_ca":true},{"name":"Grace Y. Yi","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.723200934496076,"gpt":0.58094962354606,"spread":0.1422513109500161,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01037169,0.0006290504,0.0006489878,0.0008788891,0.0004781065,0.0005856582,0.0007977328,0.000836627,0.001124599],"category_scores_gemma":[0.0144384,0.0003822721,0.001336485,0.000671226,0.0004728389,0.0004433267,0.0008694871,0.001543316,0.0001742482],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0002718935,"about_ca_system_score_gemma":0.0005670321,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004212675,"about_ca_topic_score_gemma":0.003630011,"domain_scores_codex":[0.997003,0.002026874,0.0001657329,0.0005137034,0.0001743225,0.0001163422],"domain_scores_gemma":[0.9859226,0.008256771,0.002166866,0.002063248,0.001110328,0.0004801248],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001235327,0.001099392,0.9562931,0.0001501991,0.001503328,0.0007529524,0.0004790367,0.01314584,0.001908082,0.001138744,0.002216713,0.0200773],"study_design_scores_gemma":[0.0001973671,0.002733305,0.6971407,0.0001139985,0.001110548,0.001684644,0.001267696,0.2883307,0.002663545,0.001464722,0.003159209,0.0001336312],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9762926,0.0003597116,0.02179391,0.0002145134,0.00005149431,0.00009618027,0.0009119915,0.0000338879,0.0002458058],"genre_scores_gemma":[0.9779626,0.0001694298,0.01815025,0.00009254562,0.00006549681,0.000164763,0.003015633,0.00001897342,0.0003603404],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01037169,"threshold_uncertainty_score":0.05485135,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4394949264","doi":"10.6339/24-jds1122","title":"BIE: Binary Image Encoding for the Classification of Tabular Data","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Adversarial Robustness in Machine Learning","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Computer science; Artificial intelligence; Encoding (memory); Pattern recognition (psychology); Convolutional neural network; Contextual image classification; Benchmark (surveying); Image (mathematics); Deep learning; Feature (linguistics); Field (mathematics); Binary image; Image processing; Mathematics","authors":[{"name":"James R. Halladay","is_ca":false},{"name":"Drake Cullen","is_ca":false},{"name":"Nathan Briner","is_ca":false},{"name":"Darrin Miller","is_ca":false},{"name":"Riley Primeau","is_ca":false},{"name":"Abraham Avila","is_ca":false},{"name":"W. F. Watson","is_ca":false},{"name":"Ram B. Basnet","is_ca":false},{"name":"Tenzin Doleck","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1344438530442302,"gpt":0.4013867433579452,"spread":0.266942890313715,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.000584412,0.001047598,0.0006222587,0.001958009,0.0002520632,0.001172401,0.001315239,0.0007127872,0.006204164],"category_scores_gemma":[0.003403303,0.0002757703,0.0006006884,0.001849257,0.0004698569,0.00280109,0.001164151,0.001462332,0.00300788],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005975605,"about_ca_system_score_gemma":0.0006903269,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00200173,"about_ca_topic_score_gemma":0.00230177,"domain_scores_codex":[0.9995835,0.00005061513,0.00004147239,0.00008449152,0.0001745793,0.00006537759],"domain_scores_gemma":[0.999078,0.0002293364,0.0001551682,0.0002440956,0.0002296817,0.00006376427],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0007517315,0.0002495535,0.002271003,0.0004965406,0.00005789151,0.0001626999,0.0001149832,0.0208968,0.04245036,0.01508897,0.03803907,0.8794205],"study_design_scores_gemma":[0.0001000863,0.0004260703,0.003584201,0.0001842737,0.0000509015,0.0006497329,0.0001630523,0.781132,0.1413098,0.02530491,0.04699072,0.0001041888],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.06598583,0.002833297,0.8912489,0.0009685598,0.0006934915,0.0004461351,0.00708729,0.02161118,0.009125199],"genre_scores_gemma":[0.2745471,0.001626725,0.6986895,0.0007443694,0.000166836,0.0005527565,0.01458468,0.001009827,0.008078139],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.006204164,"threshold_uncertainty_score":0.02075499,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4210580103","doi":"10.6339/22-jds1034","title":"Computational Challenges of t and Related Copulas","year":2022,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":3,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Waterloo","funders":"","keywords":"Copula (linguistics); Skew; Quantile; Computer science; Marginal distribution; Applied mathematics; Mathematics; Econometrics; Random variable; Statistics","authors":[{"name":"Erik Hintz","is_ca":true},{"name":"Marius Hofert","is_ca":true},{"name":"Christiane Lemieux","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.12877524547984,"gpt":0.2953975106835824,"spread":0.1666222652037424,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01570252,0.001126951,0.00266773,0.00146025,0.001540329,0.005101045,0.003397213,0.002292418,0.01145716],"category_scores_gemma":[0.07227075,0.001230389,0.002766779,0.002405785,0.002311836,0.006855417,0.004932833,0.00524956,0.002268314],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001479679,"about_ca_system_score_gemma":0.002682653,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009800604,"about_ca_topic_score_gemma":0.008634564,"domain_scores_codex":[0.9931854,0.004741619,0.0003592409,0.0007564407,0.0007004067,0.0002568316],"domain_scores_gemma":[0.9290556,0.06071236,0.00194879,0.005252543,0.002014274,0.00101647],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001933362,0.0001211848,0.003438305,0.0004478978,0.0002587794,0.0005552113,0.0005224703,0.4066762,0.0004440226,0.483908,0.01633547,0.08709913],"study_design_scores_gemma":[0.00004575575,0.00002154796,0.0002566294,0.00005252862,0.00001706793,0.0001284564,0.000138175,0.6132873,0.0001702226,0.3819032,0.00395342,0.00002565721],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01484855,0.001234448,0.973539,0.00442528,0.0002394673,0.00008094893,0.0003983226,0.0007113503,0.004522552],"genre_scores_gemma":[0.2127151,0.00175931,0.7779531,0.001235125,0.0006836432,0.0004269167,0.0006868407,0.00087278,0.003667228],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.01570252,"threshold_uncertainty_score":0.08304381,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4392752805","doi":"10.6339/24-jds1121","title":"Testing Perceptual Accuracy in a U.S. General Population Survey Using Stacked Bar Charts","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Bar chart; Visualization; Perception; Computer science; Bar (unit); Data visualization; Information visualization; Pie chart; Population; Key (lock); Data science; Survey data collection; Human–computer interaction; Data mining; Psychology; Statistics; Mathematics; Geography","authors":[{"name":"Kiegan Rice","is_ca":false},{"name":"Heike Hofmann","is_ca":false},{"name":"Nola du Toit","is_ca":false},{"name":"Edward Mulrow","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2466232187591786,"gpt":0.4300851825046271,"spread":0.1834619637454485,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01749553,0.0004185706,0.0004350253,0.001892739,0.0006702736,0.001716636,0.000976623,0.001201784,0.003207192],"category_scores_gemma":[0.102006,0.0003640951,0.001109857,0.002226591,0.001160567,0.001995681,0.001941306,0.001107812,0.0006912305],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005479188,"about_ca_system_score_gemma":0.0006374692,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01337785,"about_ca_topic_score_gemma":0.01210647,"domain_scores_codex":[0.9859529,0.008045066,0.0013176,0.001672993,0.002356689,0.0006547995],"domain_scores_gemma":[0.9104167,0.05635109,0.01191011,0.008478437,0.01089179,0.0019519],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.000331002,0.000355607,0.9740058,0.00008113788,0.0001786514,0.00007226918,0.004626767,0.001239167,0.0004011232,0.000513787,0.002323467,0.01587127],"study_design_scores_gemma":[0.00003926989,0.0009935485,0.9801958,0.00007132401,0.00008024866,0.0001182716,0.006688212,0.008097414,0.000637668,0.0008950904,0.002136333,0.00004686625],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9927644,0.00006098879,0.003422395,0.000283957,0.00004241732,0.00009378878,0.0009103972,0.00008002602,0.002341741],"genre_scores_gemma":[0.9965557,0.00004794452,0.002103287,0.0001318019,0.00001638788,0.0001344,0.0007566457,0.00001267345,0.0002412038],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9825045,"threshold_uncertainty_score":0.09252632,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W2188439980","doi":"10.6339/jds.201404_12(2).0008","title":"SENSITIVITY ANALYSIS OF BAYES FACTOR FOR CATEGORICAL DATA WITH EMPHASIS ON SPARSE MULTINOMIAL DATA","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Sensory Analysis and Statistical Methods","field":"Agricultural and Biological Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Government of Newfoundland and Labrador","funders":"","keywords":"Categorical variable; Multinomial distribution; Contingency table; Bayes factor; Prior probability; Dirichlet distribution; Computer science; Bayes' theorem; Bayesian probability; Sensitivity (control systems); Context (archaeology); Econometrics; Statistics; Consistency (knowledge bases); Factor analysis; Data mining; Mathematics; Artificial intelligence; Machine learning","authors":[{"name":"U. Sangeetha","is_ca":false},{"name":"M.T.R. Subbiah","is_ca":true},{"name":"M. R. Srinivasan","is_ca":false},{"name":"Balgobin Nandram","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2991029132364069,"gpt":0.4089341009435077,"spread":0.1098311877071008,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.1477924,0.001386609,0.002945964,0.00379725,0.00176283,0.003571376,0.002362202,0.003202967,0.003133922],"category_scores_gemma":[0.5391139,0.0007992598,0.003199633,0.00249762,0.003648782,0.004704412,0.003642516,0.004330538,0.0003171415],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002395201,"about_ca_system_score_gemma":0.002155167,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002868391,"about_ca_topic_score_gemma":0.001179824,"domain_scores_codex":[0.8619335,0.1170666,0.003446499,0.008240194,0.008225226,0.001088048],"domain_scores_gemma":[0.2053914,0.7663671,0.007381523,0.01474424,0.005489826,0.0006258885],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.004674257,0.0004020953,0.07907245,0.003779193,0.004868426,0.002160673,0.003304628,0.5048394,0.006767096,0.1455313,0.003977795,0.2406226],"study_design_scores_gemma":[0.0002124069,0.001334022,0.01547714,0.0009445553,0.001308784,0.002276153,0.0009814742,0.7017134,0.007331107,0.2621616,0.005924296,0.0003350133],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.08319892,0.004237451,0.9067301,0.001296871,0.0003148171,0.0006245307,0.0003880007,0.0003748101,0.002834431],"genre_scores_gemma":[0.8185487,0.001057798,0.1773355,0.0006171935,0.0002865107,0.0008235544,0.0004455597,0.0002058557,0.0006793582],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.1477924,"threshold_uncertainty_score":0.78161,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4400245371","doi":"10.6339/24-jds1143","title":"Physician Effects in Critical Care: A Causal Inference Approach Through Propensity Weighting with Parametric and Super Learning Methods","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Propensity score matching; Weighting; Causal inference; Covariate; Confounding; Inverse probability weighting; Estimator; Parametric statistics; Intensive care unit; Computer science; Medicine; Statistics; Intensive care medicine; Machine learning; Mathematics","authors":[{"name":"Yuan Bian","is_ca":true},{"name":"Yu Shi","is_ca":true},{"name":"Hui Guo","is_ca":true},{"name":"Grace Y. Yi","is_ca":true},{"name":"Wenqing He","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3299550711103181,"gpt":0.5379351258148638,"spread":0.2079800547045457,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03688011,0.0008403507,0.001635642,0.002476039,0.0007713399,0.001666361,0.002895145,0.001637828,0.004022748],"category_scores_gemma":[0.09378984,0.0008275164,0.001821894,0.002803073,0.002395175,0.003494512,0.003425827,0.003474563,0.0002793364],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001448506,"about_ca_system_score_gemma":0.00263806,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004684018,"about_ca_topic_score_gemma":0.003757021,"domain_scores_codex":[0.9836869,0.01313244,0.0004136551,0.001195563,0.001245584,0.0003258385],"domain_scores_gemma":[0.8926309,0.09252554,0.005293754,0.006443361,0.002483897,0.000622481],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0002623129,0.0002798565,0.01427386,0.000318161,0.000543161,0.000316826,0.0006347632,0.4811485,0.0006146327,0.327477,0.002320346,0.1718106],"study_design_scores_gemma":[0.00003852473,0.00005850409,0.0009145621,0.00003842651,0.0000506372,0.00005879449,0.00004163733,0.8317536,0.0002392104,0.165842,0.0009464006,0.00001771402],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.006010718,0.0001466232,0.9930454,0.000251707,0.00001794358,0.00006864599,0.00003542757,0.00006876241,0.0003547135],"genre_scores_gemma":[0.4447441,0.0007843827,0.5505573,0.0004314659,0.0002608842,0.000651732,0.0002907125,0.00008631095,0.002193138],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.03688011,"threshold_uncertainty_score":0.195043,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4398770290","doi":"10.6339/24-jds1131","title":"Evaluating Perceptual Judgements on 3D Printed Bar Charts","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"3D Shape Modeling and Analysis","field":"Engineering","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Bar (unit); Bar chart; Perception; Computer science; Engineering drawing; Psychology; Statistics; Mathematics; Engineering; Geology","authors":[{"name":"Tyler Wiederich","is_ca":false},{"name":"Susan VanderPlas","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1546686567399368,"gpt":0.3983999130363163,"spread":0.2437312562963795,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01098723,0.0009188522,0.0007432115,0.003278885,0.0006143727,0.004697636,0.00165528,0.002021445,0.006536967],"category_scores_gemma":[0.1898061,0.0004712509,0.001204697,0.001306993,0.002205028,0.0040487,0.002793044,0.001173373,0.00127306],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0009879044,"about_ca_system_score_gemma":0.0004304949,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002626077,"about_ca_topic_score_gemma":0.002347043,"domain_scores_codex":[0.9851127,0.005893348,0.001152412,0.001494322,0.005870691,0.0004765258],"domain_scores_gemma":[0.859338,0.1062861,0.01161016,0.009252711,0.01119118,0.002321783],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"observational","study_design_scores_codex":[0.02331438,0.001154879,0.1569828,0.00340738,0.001190974,0.001937925,0.05143939,0.04129632,0.295525,0.01674069,0.008392027,0.3986182],"study_design_scores_gemma":[0.001192751,0.01448732,0.6721518,0.001645055,0.000825984,0.001818317,0.03909434,0.1432033,0.07146256,0.03371428,0.01875511,0.001649217],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9532722,0.0004752616,0.0322924,0.0001493425,0.0002066758,0.0002472548,0.0003006063,0.0004316643,0.01262452],"genre_scores_gemma":[0.9756638,0.0001910508,0.02222121,0.00009139657,0.0000626938,0.0001179156,0.0003127303,0.0001425917,0.001196729],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.01098723,"threshold_uncertainty_score":0.05810678,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3135587851","doi":"10.6339/jds.201807_16(3).0002","title":"Minimum Profile Hellinger Distance Estimation for A Two-Sample Location-Shifted Model","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Calgary","funders":"","keywords":"Hellinger distance; Nonparametric statistics; Parametric statistics; Robustness (evolution); Mathematics; Asymptotic distribution; Parametric model; Statistics; Semiparametric regression; Sample size determination; Consistency (knowledge bases); Estimation theory; Applied mathematics; Semiparametric model; Estimator","authors":[{"name":"Haocheng Li","is_ca":true},{"name":"Jingjing Wu","is_ca":true},{"name":"Jian Yang","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2435364681247042,"gpt":0.4655376581424227,"spread":0.2220011900177184,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007802658,0.0009567336,0.001792873,0.001297258,0.000555522,0.001449123,0.002199463,0.00168047,0.001380654],"category_scores_gemma":[0.02968349,0.0006303834,0.001278343,0.001163108,0.001547887,0.003280503,0.002831384,0.002468524,0.000366874],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00137119,"about_ca_system_score_gemma":0.001835923,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001985634,"about_ca_topic_score_gemma":0.001321341,"domain_scores_codex":[0.9956183,0.002549741,0.000244052,0.0008744052,0.0005457489,0.0001678214],"domain_scores_gemma":[0.9808865,0.01544654,0.001083621,0.00138517,0.0009540878,0.0002441772],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0003421246,0.0001195515,0.006581127,0.0004476995,0.0003259959,0.0004028011,0.0004332898,0.7353804,0.004152554,0.1411913,0.001644133,0.1089791],"study_design_scores_gemma":[0.00001636714,0.00006485269,0.0007858182,0.00002756405,0.00002616093,0.00008585607,0.0000359753,0.9498555,0.001103432,0.04726109,0.000704463,0.00003287327],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.009965167,0.0001801801,0.989335,0.0001352696,0.00001240884,0.00003451272,0.00005521106,0.00004430236,0.0002380222],"genre_scores_gemma":[0.4573408,0.0008593134,0.5373046,0.000242657,0.00008839252,0.0004328426,0.0007870364,0.00007974533,0.002864629],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.007802658,"threshold_uncertainty_score":0.04126495,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3157762174","doi":"10.6339/21-jds993","title":"Testing for COVID-19: Some Statistical Issues","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"SARS-CoV-2 detection and testing","field":"Medicine","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Coronavirus disease 2019 (COVID-19); Coronavirus; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); 2019-20 coronavirus outbreak; Test (biology); Computer science; Statistical hypothesis testing; Statistical analysis; Statistics; Virology; Medicine; Mathematics; Outbreak; Biology","authors":[{"name":"Grace Y. Yi","is_ca":true},{"name":"Wenqing He","is_ca":true},{"name":"Dennis K. J. Lin","is_ca":false},{"name":"Chun Ming Yu","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2762481615787679,"gpt":0.4780197762690521,"spread":0.2017716146902842,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5902601,0.002191209,0.004809714,0.005550388,0.003897871,0.007877523,0.008329727,0.007953352,0.003324172],"category_scores_gemma":[0.812265,0.001462666,0.005846902,0.007038286,0.02195104,0.009439767,0.006052273,0.01565295,0.0006364086],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.00620307,"about_ca_system_score_gemma":0.005458553,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.006041039,"about_ca_topic_score_gemma":0.003777082,"domain_scores_codex":[0.2888082,0.6197395,0.02453483,0.01744863,0.0470318,0.002437143],"domain_scores_gemma":[0.05643897,0.9021471,0.01032326,0.02050602,0.009606428,0.0009781964],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.003610941,0.0004478219,0.1264593,0.003880308,0.007928262,0.004902744,0.005021133,0.0245886,0.001535313,0.4238622,0.06286481,0.3348984],"study_design_scores_gemma":[0.0009927754,0.002022662,0.02675818,0.003150229,0.002074716,0.003747598,0.001937093,0.219046,0.003839068,0.6831936,0.05277184,0.0004662395],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02565914,0.01032566,0.813697,0.1287225,0.006578919,0.002281857,0.0009812039,0.001183852,0.0105699],"genre_scores_gemma":[0.5285983,0.00229401,0.3970429,0.05394564,0.01020394,0.004230318,0.0006170902,0.0005866076,0.002481253],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.4097399,"threshold_uncertainty_score":0.5052822,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3127126615","doi":"10.6339/21-jds997","title":"A Vine Copula Model for Climate Trend Analysis using Canadian Temperature Data","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Horticultural and Viticultural Research","field":"Agricultural and Biological Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"Western University; Actua; University of Waterloo","funders":"","keywords":"Copula (linguistics); Vine copula; Multivariate statistics; Econometrics; Computer science; Climate change; Climate model; Data mining; Mathematics; Machine learning; Ecology","authors":[{"name":"Haoxin Zhuang","is_ca":true},{"name":"Liqun Diao","is_ca":true},{"name":"Grace Y. Yi","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.2421264965514139,"gpt":0.3988594280744594,"spread":0.1567329315230455,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003255009,0.001033803,0.0009954922,0.001409683,0.001102683,0.001728232,0.003386817,0.001082486,0.005466345],"category_scores_gemma":[0.009968679,0.0006703598,0.0013818,0.002706829,0.0008460979,0.0013162,0.001126286,0.002251592,0.001170835],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004404006,"about_ca_system_score_gemma":0.005801886,"about_ca_topic_candidate":true,"about_ca_topic_consensus":true,"about_ca_topic_score_codex":0.5440559,"about_ca_topic_score_gemma":0.4464495,"domain_scores_codex":[0.9990714,0.0003076109,0.00003520762,0.0002507034,0.0001448202,0.0001902399],"domain_scores_gemma":[0.9975721,0.001233976,0.0001947213,0.0002074808,0.0006610687,0.0001307216],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00008702703,0.00004443973,0.007149036,0.00006075628,0.0001240446,0.0001297836,0.0001478364,0.924081,0.0004365263,0.0336453,0.007253861,0.02684044],"study_design_scores_gemma":[0.00000670704,0.000007007367,0.0009057896,0.000005858918,0.000009412121,0.0000108694,0.00001753499,0.9944071,0.00005810611,0.003196036,0.001365606,0.000009993042],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.1065535,0.001046206,0.8739454,0.001335915,0.000171262,0.0003326656,0.007549028,0.001495033,0.007571051],"genre_scores_gemma":[0.7250139,0.00137813,0.2422827,0.0003504161,0.0001041417,0.0007204111,0.01111132,0.0007314346,0.01830763],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.4559441,"threshold_uncertainty_score":0.9172585,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4415273830","doi":"10.6339/25-jds1200","title":"Q-learning with Compound Outcome and Mixed Misclassification and Measurement Error in Covariates","year":2025,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs","keywords":"Covariate; Outcome (game theory); Observational error; Univariate; Estimation; Scope (computer science); Psychological intervention; Binary number","authors":[{"name":"Yasin Khadem Charvadeh","is_ca":false},{"name":"Grace Y. Yi","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3429165163248257,"gpt":0.4523712167509067,"spread":0.109454700426081,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06155629,0.001766984,0.004324988,0.001679428,0.001367392,0.003111997,0.004428136,0.003202707,0.002692443],"category_scores_gemma":[0.1553526,0.001148508,0.002695553,0.0028482,0.005266292,0.004817293,0.003878783,0.005353344,0.000444341],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002335507,"about_ca_system_score_gemma":0.003786031,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005397001,"about_ca_topic_score_gemma":0.002775084,"domain_scores_codex":[0.9717281,0.01813161,0.001377697,0.00592288,0.002015912,0.0008238324],"domain_scores_gemma":[0.828021,0.1413833,0.01036568,0.01637367,0.003021356,0.0008349541],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001037502,0.0002982955,0.02943638,0.0007769941,0.0009878284,0.0009098903,0.0008080509,0.3101574,0.0008769587,0.4598245,0.003842512,0.1910438],"study_design_scores_gemma":[0.000189824,0.0002215291,0.002832867,0.0001609061,0.0001904707,0.0002317573,0.00005439722,0.5491047,0.001038142,0.4436155,0.002290949,0.00006890336],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.01254619,0.0005703739,0.9852754,0.0007944633,0.0001019757,0.00009545344,0.0001430805,0.0001241001,0.0003490713],"genre_scores_gemma":[0.5625746,0.001134386,0.4287798,0.001343596,0.0005962815,0.0008199188,0.0007480968,0.0001090005,0.003894311],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.06155629,"threshold_uncertainty_score":0.3255447,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4404422782","doi":"10.6339/24-jds1134","title":"Rethinking Attention Weights as Bidirectional Coefficients","year":2024,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Explainable Artificial Intelligence (XAI)","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"","funders":"Instituto de Ciencias del Mar y Limnología, Universidad Nacional Autónoma de México; Ministry of Education, India; Institute for Catastrophic Loss Reduction","keywords":"Computer science; Statistics; Mathematics; Psychology","authors":[{"name":"Yuxiang Huang","is_ca":false},{"name":"Hanfang Yang","is_ca":false},{"name":"X. Wang","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.08340618000620546,"gpt":0.3567068886842551,"spread":0.2733007086780496,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0009641593,0.0007948478,0.0004283487,0.000709576,0.0002756011,0.0008633375,0.001039729,0.0007890937,0.001888685],"category_scores_gemma":[0.00532884,0.0003320647,0.0004819903,0.0006191428,0.0007457997,0.002451816,0.001643199,0.001790899,0.000292235],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0005510871,"about_ca_system_score_gemma":0.0008050086,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004015283,"about_ca_topic_score_gemma":0.005167848,"domain_scores_codex":[0.9996096,0.0001103812,0.00002371886,0.0001084191,0.00009748671,0.00005041849],"domain_scores_gemma":[0.9990214,0.0004990607,0.0000968727,0.0001365302,0.0001932006,0.00005301786],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0002044142,0.0001464664,0.004800531,0.0002117097,0.0001506281,0.0002187044,0.000695546,0.3238857,0.05149131,0.1380998,0.00345822,0.476637],"study_design_scores_gemma":[0.00001208902,0.00003698869,0.000601252,0.00001909701,0.00002866765,0.00004009765,0.00002910905,0.955318,0.004535737,0.03803878,0.001327328,0.00001289766],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.05995353,0.0003434769,0.9359758,0.000476903,0.00008224317,0.00005291294,0.00007575093,0.0005508189,0.002488665],"genre_scores_gemma":[0.8856376,0.0004110719,0.1094204,0.0001807972,0.00007087444,0.00009606098,0.0001121354,0.0001712119,0.003899907],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.004015283,"threshold_uncertainty_score":0,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3136368678","doi":"10.6339/jds.201407_12(3).0007","title":"Copulas Applications in Estimating Value-at-Risk (VaR): Iranian Crude Oil Prices","year":2021,"lang":"en","type":"article","venue":"Journal of Data Science","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Northern British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Copula (linguistics); Economics; Econometrics; Crude oil; Normality; Risk management; Petroleum; Value at risk; Profit (economics); Multivariate statistics; Financial economics; Finance; Statistics; Microeconomics; Mathematics; Engineering","authors":[{"name":"Faramarz Kashanchi","is_ca":true},{"name":"Pranesh Kumar","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.07526248261515965,"gpt":0.3051591706552883,"spread":0.2298966880401286,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002953408,0.001570852,0.001096635,0.001858249,0.0004823014,0.001896257,0.001175193,0.001291812,0.003159124],"category_scores_gemma":[0.01584836,0.0007126881,0.001645949,0.002732765,0.0006610819,0.001606518,0.001543159,0.002581277,0.0009727885],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0007676138,"about_ca_system_score_gemma":0.001205208,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.009812504,"about_ca_topic_score_gemma":0.004260666,"domain_scores_codex":[0.9983013,0.000914746,0.0001123845,0.0002620553,0.0003025059,0.000106999],"domain_scores_gemma":[0.9949266,0.003594015,0.0006025215,0.0002351841,0.0005755291,0.00006615544],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00006859786,0.00008666712,0.009475432,0.0004234714,0.0003942282,0.001014876,0.0003234808,0.7730781,0.001734905,0.08453643,0.006705206,0.1221585],"study_design_scores_gemma":[0.00000989221,0.00004610686,0.002876371,0.0001019446,0.00008733596,0.0003099608,0.0001035939,0.9509968,0.000842115,0.03929494,0.005281519,0.00004939887],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.01048402,0.001860162,0.9826528,0.0003847793,0.0001171513,0.00007623033,0.0003768944,0.0003165342,0.00373157],"genre_scores_gemma":[0.5673917,0.01209272,0.4106434,0.0003922744,0.0005664449,0.0006029145,0.001512706,0.000441643,0.006356133],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.009812504,"threshold_uncertainty_score":0.01951081,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}