{"meta":{"query_hash":"dd146784d1e0","filters":{"venue":"Journal of Computational and Graphical Statistics"},"cohort_total":83,"direct_labels_cover":0,"predictions_cover":83,"exported":83,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/dd146784d1e0","api":"https://metacan.xera.ac/api/v1/cohort?venue=Journal+of+Computational+and+Graphical+Statistics"},"results":[{"id":"W1607933843","doi":"10.1080/10618600.2016.1237363","title":"Divide-and-Conquer With Sequential Monte Carlo","year":2016,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Gaussian Processes and Bayesian Inference","field":"Computer Science","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Engineering and Physical Sciences Research Council; Vetenskapsrådet","keywords":"Divide and conquer algorithms; Computer science; Probabilistic logic; Graphical model; Inference; Monte Carlo method; Algorithm; Class (philosophy); Theoretical computer science; Machine learning; Artificial intelligence; Mathematics; Statistics","score_opus":0.007713407732557479,"score_gpt":0.222033098086382,"score_spread":0.2143196903538245,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1607933843","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024559402,0.00013532485,0.996068,0.00010402636,0.000022643582,0.00006500299,0.000021921831,0.00039534108,0.00073169183],"genre_scores_gemma":[0.12419662,0.00018555105,0.8724932,0.00022291919,0.000093419876,0.00047412358,0.00017675864,0.00022642319,0.0019309598],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9976514,0.0011190914,0.00010289843,0.00039996443,0.0005667905,0.00015992826],"domain_scores_gemma":[0.99264914,0.0055921557,0.00032292382,0.00071368285,0.0005306051,0.00019145673],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041226,0.0015117811,0.001916283,0.0012838335,0.00095471035,0.0013376641,0.0030498742,0.001925335,0.0045308247],"category_scores_gemma":[0.015060805,0.0009749649,0.0010771399,0.0017236251,0.0017313781,0.0018520356,0.0021652828,0.0024626625,0.0009587859],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028456323,0.0001990706,0.00169346,0.00017064619,0.00015645269,0.0001307003,0.00019617182,0.7159397,0.0013548642,0.08849894,0.0038604867,0.18751495],"study_design_scores_gemma":[0.000034315788,0.000017337452,0.000036892226,0.0000045752327,0.000008273173,0.000016325175,0.0000055656133,0.97892994,0.0003017925,0.01977583,0.0008648014,0.000004268134],"about_ca_topic_score_codex":0.007806066,"about_ca_topic_score_gemma":0.010409365,"teacher_disagreement_score":0.007806066,"about_ca_system_score_codex":0.0012753292,"about_ca_system_score_gemma":0.0031767827,"threshold_uncertainty_score":0.021802664},"labels":[],"label_agreement":null},{"id":"W1763412770","doi":"10.1080/10618600.2015.1043010","title":"Reinforced Angle-Based Multicategory Support Vector Machines","year":2015,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"National Science Foundation; National Institutes of Health; National Cancer Institute; National Institute of Biomedical Imaging and Bioengineering; National Center for Research Resources; National Institute of Mental Health","keywords":"Support vector machine; Coordinate descent; Quadratic programming; Consistency (knowledge bases); Binary classification; Computer science; Machine learning; Dual (grammatical number); Mathematical optimization; Artificial intelligence; Quadratic equation; Sequential quadratic programming; Class (philosophy); Mathematics; Algorithm","score_opus":0.023325030408022324,"score_gpt":0.26742443207681543,"score_spread":0.2440994016687931,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1763412770","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.030703366,0.00050291145,0.9658821,0.0001519908,0.00008726174,0.000044080032,0.00011186084,0.0007377185,0.0017786216],"genre_scores_gemma":[0.71255517,0.00047001682,0.28149992,0.00024842026,0.00017157261,0.0001422608,0.0007085313,0.00016475197,0.0040392927],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99894494,0.00029164265,0.000087354645,0.0002583062,0.0003098705,0.00010782211],"domain_scores_gemma":[0.998372,0.00047981707,0.00021223961,0.00028047574,0.0005630213,0.00009247336],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0010950676,0.00075689825,0.0011617783,0.00075013953,0.00031746883,0.0010271246,0.0019454483,0.0008990343,0.002179151],"category_scores_gemma":[0.0049860347,0.00034611713,0.00067875814,0.0009767597,0.0005145557,0.001568386,0.0014180331,0.0014129545,0.0011057267],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002461206,0.000084855834,0.0033303527,0.00018110708,0.00009331818,0.00014414448,0.00013173171,0.3170699,0.011192129,0.033609033,0.006389044,0.6275283],"study_design_scores_gemma":[0.0000051141637,0.00003294251,0.00036357122,0.000007592481,0.0000058622654,0.000047711474,0.0000125132165,0.9910641,0.0011737118,0.0064212275,0.00085320603,0.000012405494],"about_ca_topic_score_codex":0.0013537613,"about_ca_topic_score_gemma":0.0012341007,"teacher_disagreement_score":0.002179151,"about_ca_system_score_codex":0.00035055153,"about_ca_system_score_gemma":0.00059341197,"threshold_uncertainty_score":0.007289946},"labels":[],"label_agreement":null},{"id":"W1964782536","doi":"10.1198/106186008x343785","title":"The Fast-τ Estimator for Regression","year":2008,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Estimator; Resampling; Heuristic; Mathematics; Computer science; Regression; Algorithm; Extremum estimator; Bootstrapping (finance); M-estimator; Statistics; Mathematical optimization; Econometrics","score_opus":0.08631111371913629,"score_gpt":0.4154602009907002,"score_spread":0.3291490872715639,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1964782536","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017082747,0.0007928389,0.99640286,0.0000985215,0.00007123801,0.000025167525,0.00007118986,0.00017706849,0.0006528243],"genre_scores_gemma":[0.08940529,0.0025274558,0.90089285,0.00029469604,0.00033909667,0.00034027037,0.0006003933,0.00026305442,0.005336793],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9973405,0.0015381465,0.0000854752,0.00041275378,0.0005099158,0.00011322587],"domain_scores_gemma":[0.9920357,0.005261468,0.0006123249,0.0011084621,0.00087808166,0.000103972256],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054953927,0.0007034731,0.0009711537,0.0017818682,0.00052208995,0.0011200828,0.0015911327,0.0012600559,0.0045636194],"category_scores_gemma":[0.030584946,0.00037117096,0.0011181117,0.001928653,0.0008696926,0.0019369066,0.0011167572,0.0021565023,0.0018894029],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016354893,0.000058624842,0.003051705,0.00044672025,0.00019180236,0.00010493813,0.0001064915,0.13718274,0.0034703808,0.42491218,0.012686008,0.41762483],"study_design_scores_gemma":[0.000051626714,0.00014175261,0.0025744166,0.00013165502,0.00005673471,0.0003397632,0.000057430643,0.7751893,0.0038978066,0.1817943,0.035697695,0.000067494846],"about_ca_topic_score_codex":0.0022033302,"about_ca_topic_score_gemma":0.001503968,"teacher_disagreement_score":0.0054953927,"about_ca_system_score_codex":0.0008438283,"about_ca_system_score_gemma":0.001584271,"threshold_uncertainty_score":0.029062808},"labels":[],"label_agreement":null},{"id":"W1966109447","doi":"10.1080/10618600.2000.10474871","title":"Note on “Obtaining the Maximum Likelihood Estimates in Incomplete<i>R</i>×<i>C</i>Contingency Tables Using a Poisson Generalized Linear Model”","year":2000,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Contingency table; Mathematics; Macro; Statistics; Poisson distribution; Standard error; Table (database); Generalized linear model; Missing data; Applied mathematics; Design matrix; Maximum likelihood; Algorithm; Linear model; Computer science; Data mining","score_opus":0.04626384178380755,"score_gpt":0.3564908719570994,"score_spread":0.31022703017329184,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1966109447","genre_codex":"methods","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0020411531,0.00017605122,0.9929202,0.001562858,0.0006468721,0.00010913177,0.0008314862,0.0006507448,0.0010614003],"genre_scores_gemma":[0.026479732,0.0005068189,0.96626216,0.0011882127,0.0009612735,0.00061586424,0.0014542965,0.00042056126,0.0021111434],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9894265,0.008056194,0.00037284085,0.0006612005,0.0013610198,0.00012225394],"domain_scores_gemma":[0.92451817,0.06424333,0.0017451978,0.005356081,0.0037800623,0.00035720298],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014212977,0.0007507864,0.0011583307,0.0016141259,0.0008186642,0.0010346984,0.0021789176,0.00068421435,0.021103302],"category_scores_gemma":[0.10742247,0.00070552895,0.0014455849,0.0022406837,0.001048779,0.0015515449,0.0012767311,0.0025840828,0.004168427],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036971635,0.0002441484,0.0064750714,0.0008679805,0.0004614496,0.0011898587,0.0006830842,0.059266962,0.006604829,0.22257927,0.32345173,0.37780583],"study_design_scores_gemma":[0.00027445814,0.00040884587,0.008993782,0.00058274704,0.00024799575,0.00089733314,0.00031248564,0.3403422,0.015789622,0.4775271,0.15422636,0.00039703987],"about_ca_topic_score_codex":0.0043095634,"about_ca_topic_score_gemma":0.007612876,"teacher_disagreement_score":0.021103302,"about_ca_system_score_codex":0.00063882757,"about_ca_system_score_gemma":0.00210496,"threshold_uncertainty_score":0.075166345},"labels":[],"label_agreement":null},{"id":"W1970792239","doi":"10.1198/jcgs.2009.07118","title":"Boosting for Correlated Binary Classification","year":2010,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Boosting (machine learning); Gradient boosting; Computer science; Gradient descent; Stochastic gradient descent; Binary number; Binary classification; Binary data; Source code; Machine learning; Artificial intelligence; Data mining; Algorithm; Mathematics; Random forest; Support vector machine; Artificial neural network","score_opus":0.013017065009308857,"score_gpt":0.2825035728589893,"score_spread":0.2694865078496804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1970792239","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047625727,0.0002605083,0.9938094,0.00014790847,0.000045591547,0.00006116507,0.00006806305,0.0003949729,0.00044971184],"genre_scores_gemma":[0.33494863,0.0003108682,0.660123,0.00042899195,0.00025716808,0.0005989844,0.0008300541,0.00021308356,0.0022892372],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9934822,0.0046423296,0.00020890206,0.0005478537,0.0008590281,0.00025967404],"domain_scores_gemma":[0.99134153,0.0055525214,0.00043871815,0.0011647929,0.0012753614,0.00022718142],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013937881,0.0009725384,0.0028634476,0.0016509419,0.00091189536,0.0012762777,0.0026196525,0.00163429,0.0036075825],"category_scores_gemma":[0.020920567,0.00080539257,0.001514361,0.0015522047,0.0015165225,0.001199457,0.0019200487,0.002026794,0.001536272],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00041596274,0.00015217462,0.00311024,0.00032763122,0.00030724364,0.00013909276,0.00013133643,0.65450126,0.001758543,0.072867624,0.010758583,0.2555303],"study_design_scores_gemma":[0.000030396219,0.000030668703,0.0002059782,0.000012277424,0.000010642261,0.0000213646,0.0000036002803,0.97776186,0.00035500876,0.0206622,0.0008995287,0.000006454895],"about_ca_topic_score_codex":0.0015057707,"about_ca_topic_score_gemma":0.0011121655,"teacher_disagreement_score":0.013937881,"about_ca_system_score_codex":0.0011820574,"about_ca_system_score_gemma":0.0014186428,"threshold_uncertainty_score":0.073711395},"labels":[],"label_agreement":null},{"id":"W1972260379","doi":"10.1198/jcgs.2011.10106","title":"Local-EM and the EMS Algorithm","year":2011,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Spatial and Panel Data Analysis","field":"Economics, Econometrics and Finance","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Algorithm; Context (archaeology); Expectation–maximization algorithm; Piecewise; Computer science; Mathematics; Likelihood function; Maximum likelihood; Statistics; Estimation theory","score_opus":0.025670159727348738,"score_gpt":0.20660892166286438,"score_spread":0.18093876193551564,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1972260379","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0025642628,0.00023696595,0.9943581,0.0003730932,0.00003063029,0.000026669095,0.00008164012,0.00031800038,0.0020106563],"genre_scores_gemma":[0.15519746,0.0005412243,0.83303726,0.0006231266,0.00017617155,0.00031904032,0.00080400024,0.00047061304,0.008831025],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9966282,0.002221403,0.00012428385,0.0005210936,0.0003856703,0.00011932627],"domain_scores_gemma":[0.99169075,0.0057374705,0.00036947927,0.0011041051,0.0009299387,0.00016837192],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005669892,0.00083890377,0.0011640354,0.0010978783,0.00057173026,0.0014502095,0.002532643,0.0017373353,0.008307462],"category_scores_gemma":[0.028054921,0.0005662396,0.0008840532,0.0013569297,0.0013424489,0.0025421798,0.0027117017,0.0019787136,0.003176789],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023120671,0.00006570913,0.0029590777,0.0002504943,0.0002179243,0.00017313182,0.00025722315,0.36267903,0.000952449,0.342469,0.014337721,0.27540702],"study_design_scores_gemma":[0.00003661015,0.000037637867,0.0004197555,0.000051605944,0.000030270174,0.0001646468,0.00006074974,0.7852311,0.0012546573,0.20257527,0.0101127755,0.000024869689],"about_ca_topic_score_codex":0.0019817858,"about_ca_topic_score_gemma":0.002639316,"teacher_disagreement_score":0.008307462,"about_ca_system_score_codex":0.00096036884,"about_ca_system_score_gemma":0.0014710656,"threshold_uncertainty_score":0.029985607},"labels":[],"label_agreement":null},{"id":"W1983531885","doi":"10.1198/106186002510","title":"On Markov chain Monte Carlo Algorithms for Computing Conditional Expectations Based on Sufficient Statistics","year":2002,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Memorial University of Newfoundland; National Science Foundation","keywords":"Mathematics; Markov chain Monte Carlo; Statistic; Monte Carlo method; Statistics; Sufficient statistic; Markov chain; Algorithm; Computer science","score_opus":0.05024182247687973,"score_gpt":0.33716374330664345,"score_spread":0.2869219208297637,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1983531885","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00088523334,0.00019249499,0.99698097,0.000082636616,0.00003561492,0.00010606703,0.00006834449,0.0006561331,0.0009925391],"genre_scores_gemma":[0.036879852,0.00043565934,0.958098,0.0002818599,0.00013285922,0.0009397874,0.0006830087,0.0005989417,0.0019500222],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99472564,0.0030248722,0.0003438166,0.0006334248,0.00097313547,0.00029907562],"domain_scores_gemma":[0.9469042,0.0466546,0.0015810702,0.0019638117,0.002417272,0.00047896532],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012000829,0.002906453,0.0033328878,0.0042223753,0.0016055745,0.0035843945,0.0038025028,0.0024278725,0.014375178],"category_scores_gemma":[0.052478574,0.0020082882,0.0028485493,0.004843099,0.0031762815,0.0044593657,0.004518797,0.006637314,0.0037896784],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020787456,0.00019219772,0.0019064914,0.00038199668,0.00021636675,0.00020585833,0.00029927245,0.6440355,0.00072648964,0.21872367,0.0058737285,0.12723061],"study_design_scores_gemma":[0.000054809545,0.000030465228,0.0001237908,0.000082608545,0.000019493116,0.000037202713,0.000024890618,0.85700154,0.00030945474,0.1404032,0.0018848208,0.000027732372],"about_ca_topic_score_codex":0.015846893,"about_ca_topic_score_gemma":0.018852564,"teacher_disagreement_score":0.015846893,"about_ca_system_score_codex":0.0030577006,"about_ca_system_score_gemma":0.0064631286,"threshold_uncertainty_score":0.063467205},"labels":[],"label_agreement":null},{"id":"W1992601594","doi":"10.1080/10618600.2015.1005213","title":"Tweedie’s Compound Poisson Model With Grouped Elastic Net","year":2015,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Poisson distribution; Mathematics; Library science; Statistics; Computer science","score_opus":0.06901214203725027,"score_gpt":0.33499392125358884,"score_spread":0.2659817792163386,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1992601594","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012425044,0.0002115837,0.9835692,0.0004907594,0.00010384607,0.000115753784,0.00092372077,0.00037618892,0.0017838548],"genre_scores_gemma":[0.34821936,0.00073212734,0.61485994,0.0005702971,0.00033677323,0.0012218104,0.003922768,0.00062233757,0.029514574],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99858046,0.0006415468,0.00007464812,0.00032229463,0.00024771024,0.00013339601],"domain_scores_gemma":[0.99554646,0.0029103854,0.00047238232,0.0005526023,0.0003446567,0.00017350668],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00463906,0.00083110324,0.0013275096,0.0013893328,0.00074525375,0.0020886608,0.003598607,0.0024151672,0.011107495],"category_scores_gemma":[0.012793264,0.0007010057,0.001673691,0.0018604066,0.0012512989,0.0026605232,0.0020723734,0.0030537564,0.0021215857],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014738689,0.00008279688,0.002649293,0.0001051859,0.00007662551,0.00030161178,0.00014886222,0.73621917,0.00075213955,0.20384118,0.010716982,0.044958733],"study_design_scores_gemma":[0.0000112024645,0.000012715537,0.00016702987,0.00000967801,0.0000064432816,0.00003215008,0.0000122844485,0.9607851,0.00017008951,0.036572203,0.0022086697,0.000012429253],"about_ca_topic_score_codex":0.0069876406,"about_ca_topic_score_gemma":0.0081014745,"teacher_disagreement_score":0.011107495,"about_ca_system_score_codex":0.0011178326,"about_ca_system_score_gemma":0.001690318,"threshold_uncertainty_score":0.03715831},"labels":[],"label_agreement":null},{"id":"W1998269350","doi":"10.1198/jcgs.2011.09189","title":"Conditional Logistic Regression With Longitudinal Follow-up and Individual-Level Random Coefficients: A Stable and Efficient Two-Step Estimation Method","year":2011,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Genetic and phenotypic traits in livestock","field":"Biochemistry, Genetics and Molecular Biology","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Natural Sciences and Engineering Research Council of Canada","funders":"Natural Sciences and Engineering Research Council of Canada; Parks Canada","keywords":"Statistics; Expectation–maximization algorithm; Mathematics; Likelihood function; Dimension (graph theory); Population; Computer science; Selection (genetic algorithm); Logistic regression; Random effects model; Econometrics; Estimation theory; Maximum likelihood; Artificial intelligence; Meta-analysis","score_opus":0.04198617404020803,"score_gpt":0.29383424487761073,"score_spread":0.2518480708374027,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1998269350","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024457404,0.000053133244,0.9969957,0.00005693221,0.000008455305,0.000047244168,0.00007281401,0.00022828681,0.000091719725],"genre_scores_gemma":[0.06622426,0.00016591612,0.92946786,0.00008346439,0.00005109842,0.0006751357,0.00074485695,0.00018834263,0.0023990658],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9959705,0.0030713847,0.000116529154,0.0003744391,0.00034550356,0.00012171177],"domain_scores_gemma":[0.98926544,0.008342954,0.00045431659,0.0010050274,0.00077838823,0.00015394071],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009586403,0.0009486813,0.0014881911,0.0015444815,0.00041707576,0.0007134873,0.0029572968,0.0010328867,0.003827664],"category_scores_gemma":[0.021834953,0.00081141695,0.0014893664,0.0015302532,0.0005641311,0.0012168544,0.0019783662,0.0020912096,0.0012690133],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00089411304,0.00038450366,0.01974623,0.00035030616,0.0011588583,0.00074681075,0.00037059138,0.27729386,0.0047821673,0.11367499,0.009767443,0.5708302],"study_design_scores_gemma":[0.000094759846,0.00009270503,0.001971366,0.000022638797,0.00007094017,0.00019072498,0.000019030282,0.96932125,0.0008199436,0.024680417,0.0026696678,0.000046429293],"about_ca_topic_score_codex":0.0038714167,"about_ca_topic_score_gemma":0.005106638,"teacher_disagreement_score":0.009586403,"about_ca_system_score_codex":0.0006169798,"about_ca_system_score_gemma":0.0020604206,"threshold_uncertainty_score":0.0506984},"labels":[],"label_agreement":null},{"id":"W2003144493","doi":"10.1198/jcgs.2010.08111","title":"Combining Mixture Components for Clustering","year":2010,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":348,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; National Institute of Biomedical Imaging and Bioengineering; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health","keywords":"Mixture model; Cluster analysis; Mathematics; Determining the number of clusters in a data set; Gaussian; Entropy (arrow of time); Piecewise; Cluster (spacecraft); Computer science; Statistics; Correlation clustering; CURE data clustering algorithm; Physics","score_opus":0.01577668605565137,"score_gpt":0.280924284971499,"score_spread":0.26514759891584766,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2003144493","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00042122378,0.00035758244,0.99774075,0.000086223976,0.0000495738,0.000091212,0.000121571524,0.00065293326,0.00047888464],"genre_scores_gemma":[0.020039236,0.00060015375,0.97494566,0.00015793476,0.00014580607,0.00064576196,0.0012145988,0.0007597642,0.001491072],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.989087,0.006018094,0.00053340214,0.0020574774,0.0019088507,0.00039515508],"domain_scores_gemma":[0.9885534,0.0067487643,0.0005249045,0.0017479798,0.0021963546,0.00022865178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011054225,0.0038712607,0.004523744,0.007891809,0.0025661124,0.0052668722,0.00624167,0.004184892,0.009341309],"category_scores_gemma":[0.037335694,0.0019054535,0.006105283,0.008725718,0.0019274465,0.0039005708,0.0056375638,0.006191455,0.008001325],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002598591,0.00014683469,0.0023664087,0.0010088206,0.0010308067,0.00016643787,0.00074764027,0.31377444,0.0021735462,0.1576806,0.023643188,0.4970015],"study_design_scores_gemma":[0.000024999568,0.000029438044,0.0005421613,0.00012470126,0.00012032533,0.00010713016,0.00008359998,0.828815,0.0010337965,0.1541746,0.0148649,0.00007940514],"about_ca_topic_score_codex":0.008996535,"about_ca_topic_score_gemma":0.010722637,"teacher_disagreement_score":0.011054225,"about_ca_system_score_codex":0.0025676398,"about_ca_system_score_gemma":0.0029124178,"threshold_uncertainty_score":0.05846107},"labels":[],"label_agreement":null},{"id":"W2005955505","doi":"10.1198/106186005x47291","title":"Distance Measures and Smoothing Methodology for Imputing Features of Documents","year":2005,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Image Retrieval and Classification Techniques","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Categorical variable; Smoothing; Computer science; Class (philosophy); Missing data; Distance measures; Data mining; Artificial intelligence; Machine learning","score_opus":0.03319004123874491,"score_gpt":0.3298004024824565,"score_spread":0.2966103612437116,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005955505","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.001598782,0.00029654917,0.997479,0.00012990793,0.000049159586,0.000024605277,0.00006069675,0.00016484696,0.00019645279],"genre_scores_gemma":[0.058634087,0.00085325015,0.9367713,0.00017580178,0.00044568037,0.00036906698,0.00059913885,0.00026226407,0.001889476],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9878786,0.005204823,0.0010198939,0.0022485703,0.003325841,0.00032228412],"domain_scores_gemma":[0.948255,0.030269021,0.0037943074,0.011242515,0.0057134344,0.0007257571],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016435955,0.0014675013,0.0020948758,0.009412296,0.0016275909,0.0030950382,0.0044205226,0.0029873205,0.0022781922],"category_scores_gemma":[0.080104224,0.00089245103,0.0026352496,0.009738325,0.0030493625,0.0062921494,0.003112473,0.004444443,0.0015782695],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020592439,0.00013548412,0.00471366,0.00049565383,0.0004930249,0.00022057451,0.0006744484,0.09765903,0.0046984395,0.35653123,0.005400122,0.5287724],"study_design_scores_gemma":[0.000058207093,0.0002163545,0.0028306989,0.000100076846,0.00013322491,0.00049339334,0.00012261368,0.47579733,0.0056620045,0.4959875,0.018402502,0.0001960631],"about_ca_topic_score_codex":0.0021399946,"about_ca_topic_score_gemma":0.0017091231,"teacher_disagreement_score":0.016435955,"about_ca_system_score_codex":0.0017528095,"about_ca_system_score_gemma":0.0021273496,"threshold_uncertainty_score":0.086922646},"labels":[],"label_agreement":null},{"id":"W2007402758","doi":"10.1198/106186001317114901","title":"Computational Algorithms for Censored-Data Problems Using Intersection Graphs","year":2001,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Censoring (clinical trials); Mathematics; Algorithm; Bivariate analysis; Intersection (aeronautics); Intersection graph; Graph; Nonparametric statistics; Computer science; Mathematical optimization; Discrete mathematics; Statistics; Line graph","score_opus":0.05423319711498033,"score_gpt":0.3320901280037434,"score_spread":0.27785693088876307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2007402758","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0015454165,0.00029529454,0.9967338,0.00022939601,0.000019076768,0.00004105018,0.000061278624,0.00027010386,0.00080453535],"genre_scores_gemma":[0.065488756,0.0006471673,0.9303373,0.00016184953,0.00012522636,0.0005887773,0.00077229785,0.00026849407,0.0016100828],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9943598,0.0031137338,0.00030662888,0.0008835979,0.0010128771,0.00032339367],"domain_scores_gemma":[0.97166294,0.024249416,0.000980598,0.0017396573,0.00096919877,0.00039816974],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008661693,0.0020539488,0.003723762,0.003883091,0.0018677419,0.0043967008,0.005604448,0.0027336332,0.006412574],"category_scores_gemma":[0.030876324,0.0017905623,0.0030117277,0.0051779957,0.0026575893,0.007612556,0.005958984,0.005783744,0.0013818371],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021477103,0.00014967973,0.0011158934,0.0003240105,0.0002115013,0.000103075196,0.0002933238,0.59405106,0.00028165555,0.27312055,0.0048564994,0.12527804],"study_design_scores_gemma":[0.00003737324,0.000015420372,0.00008210128,0.000025740124,0.000017640908,0.000032164327,0.000039124036,0.745064,0.00016823997,0.25299746,0.0015053488,0.000015397243],"about_ca_topic_score_codex":0.004619215,"about_ca_topic_score_gemma":0.00442473,"teacher_disagreement_score":0.008661693,"about_ca_system_score_codex":0.0031766663,"about_ca_system_score_gemma":0.0032813856,"threshold_uncertainty_score":0.045807958},"labels":[],"label_agreement":null},{"id":"W2009789458","doi":"10.1198/106186007x208966","title":"Testing Uniformity of a Spatial Point Pattern","year":2007,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Manufacturing Process and Optimization","field":"Engineering","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Point process; Computer science; Point (geometry); Statistics; Mathematics; Econometrics; Artificial intelligence; Geometry","score_opus":0.009024007963942805,"score_gpt":0.21951453846708102,"score_spread":0.2104905305031382,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2009789458","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.49674898,0.00021716476,0.4999966,0.0002510532,0.000050515075,0.0000983183,0.00041370504,0.00036670378,0.0018569304],"genre_scores_gemma":[0.969764,0.000041979663,0.029079491,0.00009767342,0.000057479403,0.00010362477,0.0005551969,0.00004795216,0.0002525712],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.985113,0.005931941,0.0011209778,0.0044544344,0.0027831893,0.0005962992],"domain_scores_gemma":[0.85806984,0.10040375,0.014215564,0.01875448,0.0062186145,0.002337861],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014343016,0.000533687,0.0013155142,0.002265001,0.0007285363,0.0017171508,0.0024478945,0.0018210608,0.0017738929],"category_scores_gemma":[0.10608951,0.0005766851,0.0013359751,0.0016591864,0.003519137,0.004946209,0.0035418624,0.0014312222,0.0004003341],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0035347396,0.0004763689,0.4966547,0.00046848145,0.0014747696,0.0013221595,0.0016177817,0.1897527,0.029615479,0.13170378,0.0024062374,0.14097284],"study_design_scores_gemma":[0.00025859303,0.0016681133,0.14869781,0.00009303761,0.00022220107,0.0016534154,0.00084153865,0.66350126,0.018449137,0.16141757,0.0029625397,0.00023478288],"about_ca_topic_score_codex":0.0008686814,"about_ca_topic_score_gemma":0.00046739355,"teacher_disagreement_score":0.014343016,"about_ca_system_score_codex":0.00063517096,"about_ca_system_score_gemma":0.0008324003,"threshold_uncertainty_score":0.075854},"labels":[],"label_agreement":null},{"id":"W2016116954","doi":"10.1080/10618600.2014.988337","title":"Parameter Expanded Algorithms for Bayesian Latent Variable Modeling of Genetic Pleiotropy Data","year":2014,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Hospital for Sick Children; University of Toronto","funders":"National Institute of Diabetes and Digestive and Kidney Diseases","keywords":"Latent variable; Bayesian probability; Computer science; Markov chain Monte Carlo; Bayesian hierarchical modeling; Latent variable model; Pleiotropy; Algorithm; Posterior probability; Bayesian inference; Machine learning; Artificial intelligence; Data mining","score_opus":0.0422801346652598,"score_gpt":0.3027630919014125,"score_spread":0.26048295723615267,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2016116954","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007791163,0.000084772335,0.9986671,0.00007340262,0.00000743767,0.000026036432,0.00005021828,0.00015646238,0.00015539573],"genre_scores_gemma":[0.034712493,0.00030217782,0.96189266,0.00015859833,0.00006859515,0.0007437875,0.00062367413,0.0003117453,0.001186268],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99603397,0.0027994516,0.00017368172,0.00041666167,0.0004378793,0.00013833017],"domain_scores_gemma":[0.9760498,0.020678215,0.00075678434,0.0013123084,0.0008969578,0.00030601356],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011017696,0.0016142704,0.0020935675,0.0023665112,0.0012046489,0.0016780499,0.004818532,0.002458192,0.006769959],"category_scores_gemma":[0.038260173,0.0015548704,0.0019366771,0.0031929929,0.0017721343,0.0033142085,0.0039028728,0.0053784247,0.0021399364],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017636603,0.00011339483,0.0017007643,0.00017644947,0.00019386188,0.0000974623,0.00036299048,0.6065365,0.000955825,0.2439085,0.0039640917,0.14181383],"study_design_scores_gemma":[0.000037386493,0.000011984078,0.00012518723,0.000026732201,0.00001229907,0.00002333021,0.000013921436,0.8684146,0.00020214243,0.12978093,0.0013307974,0.000020721169],"about_ca_topic_score_codex":0.008581485,"about_ca_topic_score_gemma":0.0124893235,"teacher_disagreement_score":0.011017696,"about_ca_system_score_codex":0.0020739033,"about_ca_system_score_gemma":0.0033493869,"threshold_uncertainty_score":0.05826783},"labels":[],"label_agreement":null},{"id":"W2018198263","doi":"10.1080/10618600.2013.837828","title":"The Conditional-Potts Clustering Model","year":2013,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Gene expression and cancer classification","field":"Biochemistry, Genetics and Molecular Biology","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Cluster analysis; Mathematics; Adjacency list; Posterior probability; Bayesian inference; Correlation clustering; Computer science; Algorithm; Bayesian probability; Statistics","score_opus":0.009403747627858285,"score_gpt":0.2532570640417436,"score_spread":0.2438533164138853,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2018198263","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019705458,0.0002943134,0.9746927,0.00068905804,0.000072179515,0.00012810307,0.00070118654,0.00038460636,0.0033323404],"genre_scores_gemma":[0.627373,0.0010937174,0.3425999,0.00071637746,0.00038560183,0.0010595585,0.0033885376,0.00053187984,0.022851354],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9958248,0.0013642622,0.00020222657,0.0013579965,0.0008746737,0.0003760024],"domain_scores_gemma":[0.9929557,0.0035637391,0.00067882275,0.0012356094,0.0012649671,0.00030104283],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005598275,0.0011228475,0.0021869347,0.0029070738,0.0015062877,0.0028595196,0.0064227968,0.00267649,0.011125806],"category_scores_gemma":[0.020463374,0.0009101345,0.002539911,0.0027613488,0.0035042942,0.0052914186,0.0029294605,0.0028964365,0.0030555236],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012699705,0.000054640906,0.0016038727,0.00015051056,0.00015810179,0.00019826474,0.00038880724,0.25726822,0.0013284442,0.70791984,0.0046633645,0.026139045],"study_design_scores_gemma":[0.000023328832,0.000016553744,0.00049513497,0.000018396795,0.00003362868,0.00010316778,0.000027656526,0.72562355,0.00032706067,0.27118292,0.0021133588,0.00003521712],"about_ca_topic_score_codex":0.010235328,"about_ca_topic_score_gemma":0.0072235353,"teacher_disagreement_score":0.011125806,"about_ca_system_score_codex":0.002805827,"about_ca_system_score_gemma":0.0018299844,"threshold_uncertainty_score":0.037219524},"labels":[],"label_agreement":null},{"id":"W2021405587","doi":"10.1198/106186002718","title":"Detecting Clusters and Nonlinearity in Three-Dimensional Dynamic Graphs","year":2002,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Cluster (spacecraft); Nonlinear system; Computer science; Diagonal; Artificial intelligence; Mathematics; Pattern recognition (psychology); Data mining; Physics; Geometry","score_opus":0.052521466278716976,"score_gpt":0.356511468138576,"score_spread":0.303990001859859,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2021405587","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5842829,0.0001393037,0.41310993,0.00029582353,0.00001584024,0.00009192391,0.00014776117,0.00075211975,0.0011644394],"genre_scores_gemma":[0.9504847,0.00007407818,0.048940964,0.00003578042,0.000011058399,0.000075271666,0.00012951749,0.000059803668,0.00018877168],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9948388,0.0029299946,0.000334614,0.00070248084,0.0010124724,0.00018159609],"domain_scores_gemma":[0.8165761,0.16227327,0.010172134,0.006990735,0.0030243946,0.0009633874],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0077476767,0.00046938102,0.0006680644,0.0019816237,0.0005209424,0.0016094276,0.0006328235,0.0009520851,0.0015638348],"category_scores_gemma":[0.103745274,0.0005836127,0.0004959993,0.0010835197,0.0024525658,0.0029307744,0.0020250345,0.0011250081,0.00019910357],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004725697,0.00040925,0.22767851,0.0012193962,0.0005652923,0.0016297381,0.008781269,0.23697677,0.16917662,0.056808405,0.0025869543,0.2894421],"study_design_scores_gemma":[0.00009232572,0.0007182727,0.1418178,0.00011143917,0.00010389651,0.0015082242,0.0013758297,0.7027229,0.04631747,0.10296218,0.0020126915,0.00025692032],"about_ca_topic_score_codex":0.000964136,"about_ca_topic_score_gemma":0.0008321544,"teacher_disagreement_score":0.0077476767,"about_ca_system_score_codex":0.000582421,"about_ca_system_score_gemma":0.00054608256,"threshold_uncertainty_score":0.04097414},"labels":[],"label_agreement":null},{"id":"W2034304555","doi":"10.1198/106186001317243412","title":"CriSP: A Tool for Bump Hunting","year":2001,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Smoothing; Bootstrapping (finance); Test statistic; Mathematics; Resampling; Statistic; Function (biology); Statistics; Statistical hypothesis testing; Algorithm; Computer science; Econometrics","score_opus":0.07553251069649514,"score_gpt":0.4139923701140274,"score_spread":0.33845985941753226,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2034304555","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031246168,0.00021324845,0.9906786,0.0003302636,0.00006897396,0.000090997026,0.0002680493,0.0040968293,0.001128349],"genre_scores_gemma":[0.08258978,0.0002246582,0.9114861,0.00050792826,0.00023703305,0.000856488,0.00076058024,0.0017186885,0.001618745],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9869544,0.006742836,0.0009810338,0.0014882758,0.0034572245,0.0003762398],"domain_scores_gemma":[0.85532886,0.123185426,0.0061710686,0.009659718,0.0040029427,0.001651877],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.023790868,0.0018438491,0.0026707265,0.011181146,0.0019170612,0.0044673914,0.004963611,0.0038346068,0.015581204],"category_scores_gemma":[0.17473263,0.0016850685,0.0027451785,0.005932981,0.0042308383,0.0067480574,0.0071209194,0.005624811,0.0044764797],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009832019,0.00035610824,0.020487664,0.0007948772,0.0007813758,0.0014839614,0.0014586729,0.11118921,0.0051535605,0.33215767,0.035560653,0.48959318],"study_design_scores_gemma":[0.00015176821,0.0002534129,0.0020534259,0.0001573634,0.00008189991,0.00077450415,0.0001851373,0.5281849,0.0026137023,0.44219968,0.023205576,0.00013868822],"about_ca_topic_score_codex":0.0014983674,"about_ca_topic_score_gemma":0.0011703455,"teacher_disagreement_score":0.023790868,"about_ca_system_score_codex":0.0008939991,"about_ca_system_score_gemma":0.0017951295,"threshold_uncertainty_score":0.12581962},"labels":[],"label_agreement":null},{"id":"W2037392129","doi":"10.1198/jcgs.2011.10021","title":"Penalized Nonlinear Least Squares Estimation of Time-Varying Parameters in Ordinary Differential Equations","year":2011,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Model Reduction and Neural Networks","field":"Physics and Astronomy","cited_by":49,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"National Cancer Institute; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; National Institute of Allergy and Infectious Diseases; King Abdullah University of Science and Technology","keywords":"Ode; Ordinary differential equation; Applied mathematics; Nonlinear system; Mathematics; Non-linear least squares; Ordinary least squares; Least-squares function approximation; Function (biology); Mathematical optimization; Polynomial; Estimation theory; Algorithm; Differential equation; Statistics; Mathematical analysis","score_opus":0.024963762130448715,"score_gpt":0.2653934609609376,"score_spread":0.24042969883048887,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037392129","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007741633,0.00007306188,0.9917862,0.000057163903,0.0000091925085,0.000010323308,0.000033861772,0.00011423424,0.00017437272],"genre_scores_gemma":[0.43027034,0.0004493213,0.56410575,0.000116014286,0.000059327638,0.0002119642,0.0004549203,0.00023758445,0.0040947823],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9992341,0.0003814521,0.00003289566,0.00014563843,0.00016930207,0.00003667418],"domain_scores_gemma":[0.99732023,0.0020010436,0.00025438913,0.00018671864,0.000196253,0.00004125929],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016089687,0.0007097749,0.0008527584,0.0005062705,0.0002760013,0.000598292,0.0010396171,0.0009148372,0.00089768396],"category_scores_gemma":[0.00798756,0.00048916816,0.0006986661,0.0005889115,0.00076832774,0.0009200839,0.00082986004,0.0015160686,0.00030894895],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00004740578,0.000022362516,0.0006593776,0.00007279559,0.000042222888,0.00006195558,0.000045694946,0.9608214,0.0034193953,0.008913729,0.000573304,0.025320396],"study_design_scores_gemma":[0.0000026962998,0.0000048900106,0.0001215087,0.000002328274,0.000002088435,0.000008448769,0.0000024039275,0.99718046,0.0004393805,0.0020540645,0.00017659832,0.000005157542],"about_ca_topic_score_codex":0.004930554,"about_ca_topic_score_gemma":0.004825282,"teacher_disagreement_score":0.004930554,"about_ca_system_score_codex":0.0004938742,"about_ca_system_score_gemma":0.0009499309,"threshold_uncertainty_score":0.009803712},"labels":[],"label_agreement":null},{"id":"W2044676318","doi":"10.1080/10618600.2012.681237","title":"The Generalized Ridge Trace Plot: Visualizing Bias<i>and</i>Precision","year":2012,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Plot (graphics); Univariate; Covariance; Mathematics; TRACE (psycholinguistics); Statistics; Ridge; Bivariate analysis; Algorithm; Multivariate statistics; Computer science","score_opus":0.12150972289259729,"score_gpt":0.4251971058374141,"score_spread":0.3036873829448168,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2044676318","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016642632,0.0009226022,0.9594832,0.00069231767,0.0001533017,0.000072067574,0.003179049,0.014526694,0.004328143],"genre_scores_gemma":[0.22863728,0.0013708445,0.7516318,0.0004769351,0.00021970745,0.00036474993,0.0042984546,0.007643832,0.0053563532],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99847347,0.0005869338,0.00010829532,0.00024763288,0.00048379417,0.000099741876],"domain_scores_gemma":[0.9878423,0.00801705,0.001300452,0.0010213505,0.0016134556,0.00020536882],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041673463,0.0017098213,0.0012130309,0.0036076372,0.0004386818,0.0027919596,0.0011695761,0.0011813613,0.011693566],"category_scores_gemma":[0.02138666,0.0005133276,0.0010539457,0.0036424394,0.0010420708,0.0027851649,0.0018079816,0.0019930066,0.002786397],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00091486255,0.0001719293,0.02246119,0.0021611576,0.000522264,0.0011320487,0.0026549196,0.08059322,0.036687575,0.10875297,0.13454753,0.60940033],"study_design_scores_gemma":[0.00023837273,0.00030661744,0.030801924,0.000686891,0.00026507553,0.001945832,0.0011952659,0.5211416,0.034585103,0.28371587,0.124557,0.00056038355],"about_ca_topic_score_codex":0.0024382225,"about_ca_topic_score_gemma":0.0021915254,"teacher_disagreement_score":0.011693566,"about_ca_system_score_codex":0.00035276602,"about_ca_system_score_gemma":0.0010398845,"threshold_uncertainty_score":0.039118886},"labels":[],"label_agreement":null},{"id":"W2047978125","doi":"10.1198/jcgs.2009.06134","title":"Examples of Adaptive MCMC","year":2009,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":1078,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Markov chain Monte Carlo; Metropolis–Hastings algorithm; Gibbs sampling; Markov chain; Computer science; Algorithm; Logarithm; Dimension (graph theory); Multivariate statistics; Mathematics; Artificial intelligence; Machine learning; Bayesian probability","score_opus":0.058553184144160234,"score_gpt":0.34562072589299764,"score_spread":0.2870675417488374,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2047978125","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061215875,0.0015271798,0.97899276,0.0004458851,0.00012900982,0.00009562868,0.00024664972,0.0008795855,0.011561746],"genre_scores_gemma":[0.17410153,0.002163192,0.81350625,0.000489378,0.00019631661,0.00043041902,0.00076289295,0.0007683732,0.007581601],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9971016,0.0015003486,0.00014139834,0.00040115244,0.00070391083,0.00015151265],"domain_scores_gemma":[0.9899816,0.006667371,0.0003400539,0.0017977506,0.0010429673,0.00017027903],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0036957753,0.0009190395,0.00082314375,0.0012715607,0.001235595,0.0013115786,0.0028349955,0.0024379047,0.008912517],"category_scores_gemma":[0.023915138,0.0006975124,0.0011220301,0.0030437547,0.0015640998,0.0015111013,0.001832315,0.0024973953,0.0018618664],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016422127,0.000112071866,0.0036671683,0.00053199776,0.00022654225,0.0003998415,0.0003796455,0.27342215,0.002098305,0.536166,0.016849112,0.16598292],"study_design_scores_gemma":[0.000071210205,0.00003193084,0.000715571,0.000072680385,0.000049550763,0.0002894248,0.00004256489,0.65749747,0.0019562715,0.3049339,0.034281667,0.000057764657],"about_ca_topic_score_codex":0.005269811,"about_ca_topic_score_gemma":0.0062957015,"teacher_disagreement_score":0.008912517,"about_ca_system_score_codex":0.0009961292,"about_ca_system_score_gemma":0.0010751633,"threshold_uncertainty_score":0.029815316},"labels":[],"label_agreement":null},{"id":"W2050605581","doi":"10.1198/1061860031220","title":"Feature Extraction for Nonparametric Discriminant Analysis","year":2003,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":59,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; National Science Foundation","keywords":"Linear discriminant analysis; Pattern recognition (psychology); Optimal discriminant analysis; Kernel Fisher discriminant analysis; Multiple discriminant analysis; Mathematics; Artificial intelligence; Discriminant; Dimensionality reduction; Nonparametric statistics; Curse of dimensionality; Projection pursuit; Parametric statistics; Gaussian; Statistics; Computer science; Facial recognition system","score_opus":0.014343301322935882,"score_gpt":0.28878006122655664,"score_spread":0.27443675990362076,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2050605581","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0016635077,0.00015098235,0.996968,0.00006569619,0.000024587534,0.000025402573,0.00009655776,0.00038636217,0.0006190225],"genre_scores_gemma":[0.09899823,0.00048105736,0.89646226,0.00010846281,0.00013219821,0.00037214573,0.00087330706,0.00021543907,0.0023568354],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99902856,0.0003236139,0.000054594173,0.00018990635,0.0003348281,0.00006863963],"domain_scores_gemma":[0.99864286,0.0005537918,0.0001126165,0.00031120874,0.00034158054,0.000038027592],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.001420704,0.0009695939,0.0012013041,0.0015188725,0.0005578208,0.0009304238,0.0010330181,0.0008041449,0.0037404718],"category_scores_gemma":[0.0067499494,0.00036541614,0.00094465323,0.0020846436,0.000627974,0.0011433641,0.0013584037,0.0014113554,0.0033811776],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014562489,0.00008977252,0.00078536343,0.00021087061,0.000059029084,0.00015263775,0.000083152954,0.043874834,0.02900254,0.044480316,0.010497599,0.8706183],"study_design_scores_gemma":[0.000032048898,0.000076454824,0.0019040353,0.00004821835,0.000033969296,0.00031573928,0.00005136303,0.8857945,0.012299943,0.07930845,0.020078747,0.000056540946],"about_ca_topic_score_codex":0.0009872067,"about_ca_topic_score_gemma":0.0009114237,"teacher_disagreement_score":0.0037404718,"about_ca_system_score_codex":0.0004033731,"about_ca_system_score_gemma":0.0006583253,"threshold_uncertainty_score":0.012513101},"labels":[],"label_agreement":null},{"id":"W2053652664","doi":"10.1080/10618600.2013.841584","title":"Parallel Bayesian Additive Regression Trees","year":2014,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Gaussian Processes and Bayesian Inference","field":"Computer Science","cited_by":64,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Acadia University","funders":"Office of Science; U.S. Department of Energy","keywords":"Markov chain Monte Carlo; Computer science; Bayesian probability; Boosting (machine learning); Approximate Bayesian computation; Bayesian inference; Inference; Computation; Machine learning; Algorithm; Artificial intelligence","score_opus":0.007996393648830565,"score_gpt":0.24549760152655614,"score_spread":0.23750120787772558,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2053652664","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0041043293,0.00037925225,0.9852609,0.00027983915,0.0001289519,0.000062288185,0.00086177536,0.0038191122,0.0051036016],"genre_scores_gemma":[0.14935583,0.0007477182,0.8288806,0.00040084546,0.0003629202,0.00039239854,0.0046273344,0.0018352813,0.013397184],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99682826,0.0010161423,0.00015094994,0.0006168818,0.0011201063,0.00026763906],"domain_scores_gemma":[0.99652326,0.0013489986,0.00021462337,0.0007611404,0.000998468,0.00015351128],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0034006338,0.0011923227,0.0019841488,0.0013971985,0.0010383471,0.0024816815,0.0030030264,0.0013159654,0.011048304],"category_scores_gemma":[0.013493839,0.0010175834,0.0018320298,0.002866071,0.00063805626,0.002269974,0.002468961,0.002099894,0.0064067645],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003156425,0.00015469256,0.0024272457,0.0002312598,0.00028631475,0.00019143143,0.00016411205,0.49001896,0.0021322863,0.10130497,0.02981983,0.37295327],"study_design_scores_gemma":[0.00004043473,0.000018744382,0.00034133243,0.000020107773,0.00003351994,0.00006992608,0.000019117748,0.9099917,0.00087221165,0.07629538,0.012276951,0.00002057482],"about_ca_topic_score_codex":0.009043022,"about_ca_topic_score_gemma":0.013512545,"teacher_disagreement_score":0.011048304,"about_ca_system_score_codex":0.0011142285,"about_ca_system_score_gemma":0.0029496807,"threshold_uncertainty_score":0.036960304},"labels":[],"label_agreement":null},{"id":"W2072240935","doi":"10.1198/106186008x321068","title":"Adjusted Empirical Likelihood and its Properties","year":2008,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":207,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"ASL Environmental Sciences (Canada); University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Mitacs","keywords":"Empirical likelihood; Likelihood function; Restricted maximum likelihood; Mathematics; Maximization; Expectation–maximization algorithm; Likelihood principle; Statistics; Mathematical optimization; Econometrics; Maximum likelihood; Computer science; Quasi-maximum likelihood; Confidence interval","score_opus":0.15607019570708372,"score_gpt":0.353252275367028,"score_spread":0.1971820796599443,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2072240935","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0037495305,0.0003176532,0.99227273,0.0004953843,0.000033955333,0.00005203191,0.000107197375,0.00024242762,0.002729132],"genre_scores_gemma":[0.32253066,0.0013629998,0.6662154,0.0007851593,0.00043494822,0.0009033251,0.001007363,0.0009520682,0.005808141],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99152195,0.0046552424,0.0004388587,0.0011241625,0.001931225,0.00032846667],"domain_scores_gemma":[0.9257566,0.059234243,0.003102336,0.0069073015,0.0043703187,0.00062932883],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013463121,0.0011068244,0.0014994879,0.0025521563,0.0010501517,0.003387281,0.0036725684,0.00240514,0.0063934806],"category_scores_gemma":[0.1487848,0.00088666915,0.0015117365,0.0026437857,0.003840615,0.0061766473,0.0035102204,0.004823849,0.0019135488],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010706919,0.000046442674,0.002869478,0.00025040627,0.00011699629,0.00028127283,0.000314299,0.17808467,0.0012964619,0.7520583,0.004170575,0.0604041],"study_design_scores_gemma":[0.000041278898,0.00004115241,0.0008479154,0.00008911201,0.000028604074,0.000360626,0.00005693441,0.5431394,0.0009958096,0.44870684,0.00563831,0.000053948846],"about_ca_topic_score_codex":0.002231633,"about_ca_topic_score_gemma":0.0011355289,"teacher_disagreement_score":0.013463121,"about_ca_system_score_codex":0.0016104003,"about_ca_system_score_gemma":0.0022597322,"threshold_uncertainty_score":0.07120067},"labels":[],"label_agreement":null},{"id":"W2080972498","doi":"10.1080/10618600.2000.10474879","title":"Markov Chain Sampling Methods for Dirichlet Process Mixture Models","year":2000,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":2212,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Gibbs sampling; Dirichlet distribution; Hierarchical Dirichlet process; Markov chain Monte Carlo; Metropolis–Hastings algorithm; Markov chain; Dirichlet process; Mathematics; Prior probability; Conjugate prior; Computer science; Sampling (signal processing); Mathematical optimization; Applied mathematics; Statistics; Bayesian probability","score_opus":0.026056546071332128,"score_gpt":0.3550975326748263,"score_spread":0.3290409866034942,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2080972498","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003964808,0.00042211037,0.99808645,0.00008972626,0.000043105607,0.00004483103,0.000056947556,0.00017357832,0.0006868368],"genre_scores_gemma":[0.041765213,0.0023030487,0.94956625,0.00018935339,0.0003806612,0.0009504164,0.00081915775,0.00052966183,0.003496173],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99167585,0.0059068706,0.00027639305,0.0006999844,0.0012353667,0.00020550721],"domain_scores_gemma":[0.985995,0.0119615095,0.00035865468,0.00065087824,0.00083728466,0.00019672983],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009324643,0.0016786077,0.002242678,0.0029453323,0.0010043675,0.0026978513,0.0033340727,0.0019662993,0.00889774],"category_scores_gemma":[0.03146299,0.0012841478,0.0021599084,0.0030074283,0.0020578308,0.003801627,0.0026415237,0.003932909,0.0029664652],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009535237,0.000066540146,0.0006901166,0.0004072908,0.00017735243,0.00010281046,0.0003261634,0.24180545,0.0006643289,0.63896286,0.006839861,0.109861776],"study_design_scores_gemma":[0.00004098034,0.000010328599,0.00010118482,0.00009473226,0.000023118679,0.000043200438,0.000026744172,0.6197132,0.00035918594,0.37069172,0.008868849,0.00002670059],"about_ca_topic_score_codex":0.005646533,"about_ca_topic_score_gemma":0.0047085197,"teacher_disagreement_score":0.009324643,"about_ca_system_score_codex":0.0020505951,"about_ca_system_score_gemma":0.0020507094,"threshold_uncertainty_score":0.049314022},"labels":[],"label_agreement":null},{"id":"W2087043468","doi":"10.1198/106186007x257025","title":"On Using Truncated Sequential Probability Ratio Test Boundaries for Monte Carlo Implementation of Hypothesis Tests","year":2007,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"National Institutes of Health; University of Lethbridge","keywords":"Resampling; Monte Carlo method; Mathematics; Estimator; Sequential probability ratio test; Minimax; Statistical hypothesis testing; Algorithm; Optimal stopping; Boundary (topology); Statistics; Computer science; Mathematical optimization","score_opus":0.117921852029038,"score_gpt":0.4014752359088856,"score_spread":0.28355338387984763,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2087043468","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00051821535,0.00006141005,0.9982059,0.000109726,0.00001902634,0.00005366214,0.000015656628,0.000456198,0.00056008314],"genre_scores_gemma":[0.01434227,0.00009824037,0.9840224,0.00017569818,0.000039267397,0.0005471549,0.00006509623,0.00041046253,0.00029933732],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.953903,0.03515865,0.0020468195,0.0021332845,0.0063040173,0.00045422913],"domain_scores_gemma":[0.7913896,0.18068086,0.0062618037,0.011786615,0.009023491,0.00085757783],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.041680425,0.0017557407,0.001601636,0.0028087986,0.0009168762,0.0030037218,0.003982427,0.002838443,0.010729381],"category_scores_gemma":[0.28378996,0.00103452,0.0016359814,0.0026868787,0.0034897914,0.006375675,0.0038127024,0.0054920055,0.00475282],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00048704902,0.00016247878,0.0020103636,0.0006157185,0.00014259772,0.00038963812,0.00079427444,0.15948841,0.0040760403,0.40177205,0.007719512,0.42234203],"study_design_scores_gemma":[0.00022168389,0.00026162606,0.00058848574,0.00046230748,0.00005377838,0.00035991252,0.00008696488,0.5589413,0.006356095,0.41719684,0.015361337,0.00010973363],"about_ca_topic_score_codex":0.0011261608,"about_ca_topic_score_gemma":0.00088334584,"teacher_disagreement_score":0.041680425,"about_ca_system_score_codex":0.0016259406,"about_ca_system_score_gemma":0.0027406525,"threshold_uncertainty_score":0.22042978},"labels":[],"label_agreement":null},{"id":"W2090439194","doi":"10.1080/10618600.2000.10474890","title":"Users, Programmers, and Statistical Software","year":2000,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Data Stream Mining Techniques","field":"Computer Science","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Bell (Canada)","funders":"","keywords":"Computer science; Software analytics; Software engineering; Software; Programmer; Software construction; Data science; Software development; Human–computer interaction; Programming language","score_opus":0.009443144865113733,"score_gpt":0.25656438406069376,"score_spread":0.24712123919558002,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2090439194","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.108486995,0.0049552554,0.70460635,0.09678338,0.0012894567,0.00050645287,0.00036899545,0.013733048,0.069270015],"genre_scores_gemma":[0.621389,0.0020392237,0.34006608,0.0108614,0.001211746,0.00058727624,0.0004926438,0.0040872176,0.019265492],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.93836325,0.042623196,0.0047019883,0.003246309,0.009588648,0.0014765939],"domain_scores_gemma":[0.5691357,0.3445128,0.01184187,0.02504214,0.0361127,0.01335479],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.058564268,0.0006382558,0.0010617063,0.0032993692,0.0024316576,0.013625077,0.0022667774,0.002362863,0.012653001],"category_scores_gemma":[0.21786824,0.0013797409,0.00054169557,0.0044054887,0.0059028566,0.014103354,0.0069323196,0.0038945857,0.004045285],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010010399,0.00037152055,0.05530204,0.0011565615,0.00011935985,0.0009825022,0.018024381,0.0027911395,0.0059131584,0.2816639,0.10480436,0.5278701],"study_design_scores_gemma":[0.00031712573,0.00084058807,0.01850892,0.0018755036,0.00023441717,0.0031954623,0.01675988,0.07022974,0.0088203885,0.500324,0.37848562,0.00040842826],"about_ca_topic_score_codex":0.0016781776,"about_ca_topic_score_gemma":0.0012556494,"teacher_disagreement_score":0.058564268,"about_ca_system_score_codex":0.0015194165,"about_ca_system_score_gemma":0.0060597043,"threshold_uncertainty_score":0.3097211},"labels":[],"label_agreement":null},{"id":"W2108273125","doi":"10.1080/10618600.2012.679223","title":"Stochastic Stepwise Ensembles for Variable Selection","year":2012,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Statistics; Feature selection; Selection (genetic algorithm); Mathematics; Computer science; Artificial intelligence","score_opus":0.06160899670397949,"score_gpt":0.35204429865891623,"score_spread":0.2904353019549367,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2108273125","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017490557,0.000674258,0.9954313,0.00014147065,0.00011891751,0.000048559537,0.0000951586,0.0004487048,0.0012925644],"genre_scores_gemma":[0.19918278,0.0024579128,0.78448635,0.00058911927,0.0008448374,0.0011737777,0.0017533374,0.0005310851,0.008980783],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9972932,0.0013737499,0.00013385723,0.00035824685,0.0007146059,0.00012632417],"domain_scores_gemma":[0.994948,0.0032676188,0.00027933877,0.00053559156,0.00085360516,0.000115819304],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0035245286,0.001774871,0.0019697177,0.001659933,0.00070913427,0.0012604119,0.0021026966,0.0012794038,0.0044778166],"category_scores_gemma":[0.009751877,0.0009640722,0.002229218,0.001710072,0.0007160256,0.0011010079,0.0022371334,0.0027287833,0.0022314356],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000065723325,0.000058103433,0.0010917896,0.00021625776,0.0003527765,0.00011101113,0.000060691,0.75921303,0.0014578638,0.063686624,0.0065184976,0.16716763],"study_design_scores_gemma":[0.000008134045,0.000022799075,0.000102054495,0.000017402861,0.000018992943,0.000019009725,0.0000027667386,0.9812306,0.00038255367,0.015542943,0.0026429968,0.00000970098],"about_ca_topic_score_codex":0.0042134365,"about_ca_topic_score_gemma":0.005103151,"teacher_disagreement_score":0.0044778166,"about_ca_system_score_codex":0.00081582804,"about_ca_system_score_gemma":0.001401294,"threshold_uncertainty_score":0.018639684},"labels":[],"label_agreement":null},{"id":"W2138868843","doi":"10.1198/106186002317375631","title":"A Brief History of the Mosaic Display","year":2002,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":92,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Mosaic; Computer science; Computer graphics (images); Artificial intelligence; Geography; Archaeology","score_opus":0.018858655242182307,"score_gpt":0.2492495687104026,"score_spread":0.2303909134682203,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2138868843","genre_codex":"other","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0076233675,0.13651007,0.3153362,0.021523418,0.0073082354,0.00040743503,0.0024039014,0.005868072,0.5030193],"genre_scores_gemma":[0.11999254,0.15450953,0.27819312,0.009877383,0.013765273,0.00060255587,0.0045952853,0.0071714083,0.41129306],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9983883,0.00045890475,0.00008463325,0.00021826712,0.0007260945,0.00012383712],"domain_scores_gemma":[0.9979365,0.00075822615,0.00006669011,0.000317822,0.0007063547,0.00021439222],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0025213114,0.0005050737,0.00050483854,0.0024449937,0.0021744117,0.0046895165,0.0012576754,0.001516805,0.046294007],"category_scores_gemma":[0.006870516,0.0008187676,0.00057422003,0.0037163608,0.0016206986,0.005879048,0.0028453195,0.0031574606,0.013671964],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018144709,0.000079990175,0.0011665282,0.0007528057,0.00002732256,0.00042886782,0.0031610203,0.0014165892,0.0042392514,0.2251639,0.22608657,0.53729564],"study_design_scores_gemma":[0.0000041341614,0.000029227787,0.00036485173,0.00017855866,0.000004815464,0.00032654763,0.00010971899,0.0006440485,0.00085237576,0.013687167,0.9837728,0.000025663732],"about_ca_topic_score_codex":0.00445539,"about_ca_topic_score_gemma":0.0034807008,"teacher_disagreement_score":0.046294007,"about_ca_system_score_codex":0.0014982048,"about_ca_system_score_gemma":0.0014279038,"threshold_uncertainty_score":0.15486884},"labels":[],"label_agreement":null},{"id":"W2144832675","doi":"10.1080/10618600.2013.844700","title":"Bayesian Estimation of Discrete Multivariate Latent Structure Models With Structural Zeros","year":2013,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":55,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Memorial University of Newfoundland; National Science Foundation","keywords":"Categorical variable; Local independence; Conditional independence; Latent class model; Mathematics; Posterior probability; Bayesian probability; Latent variable; Econometrics; Computer science; Latent variable model; Statistics","score_opus":0.008773760577415121,"score_gpt":0.2503721420045232,"score_spread":0.24159838142710804,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2144832675","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019090371,0.00013975953,0.97981346,0.00024005963,0.000010501696,0.000036808302,0.0001471407,0.00014925274,0.00037267234],"genre_scores_gemma":[0.46870545,0.00061371375,0.5259116,0.00021214699,0.000107317464,0.0005077856,0.0017287956,0.00015101158,0.0020621014],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9935601,0.0040350603,0.00027294704,0.0008728784,0.000937359,0.00032171793],"domain_scores_gemma":[0.9639505,0.030549709,0.0020293577,0.0021790753,0.0008461598,0.0004451178],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0119072385,0.0009750722,0.0020188726,0.0022549264,0.0009439313,0.0021954828,0.0031869567,0.0017095194,0.0024878322],"category_scores_gemma":[0.054329086,0.0016823851,0.001870351,0.0023183841,0.0026313937,0.0047416813,0.003601332,0.0044856817,0.00053688296],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00036481002,0.00021382011,0.011255892,0.00023593553,0.0002637818,0.00019044316,0.0004971787,0.5307477,0.0012818688,0.37278625,0.002837381,0.079325005],"study_design_scores_gemma":[0.00003467691,0.00001922107,0.00078578654,0.000029795428,0.000020332245,0.000036809462,0.000042743442,0.80651087,0.00029893094,0.1915685,0.0006278402,0.000024566101],"about_ca_topic_score_codex":0.005422287,"about_ca_topic_score_gemma":0.0073731816,"teacher_disagreement_score":0.0119072385,"about_ca_system_score_codex":0.0015018458,"about_ca_system_score_gemma":0.002339745,"threshold_uncertainty_score":0.06297225},"labels":[],"label_agreement":null},{"id":"W2162021827","doi":"10.1198/1061860043001","title":"A Split-Merge Markov chain Monte Carlo Procedure for the Dirichlet Process Mixture Model","year":2004,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":475,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Gibbs sampling; Markov chain Monte Carlo; Metropolis–Hastings algorithm; Hierarchical Dirichlet process; Dirichlet distribution; Rejection sampling; Dirichlet process; Markov chain; Slice sampling; Computer science; Algorithm; Monte Carlo method; Merge (version control); Hybrid Monte Carlo; Mathematics; Bayesian probability; Artificial intelligence; Latent Dirichlet allocation; Machine learning; Statistics; Topic model","score_opus":0.011245201410113275,"score_gpt":0.2784303576061979,"score_spread":0.2671851561960846,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2162021827","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00096301094,0.000059308255,0.99831945,0.000055170083,0.000015012644,0.000044140696,0.000020233943,0.0001755532,0.00034814057],"genre_scores_gemma":[0.03137666,0.00011933984,0.9668705,0.00007138548,0.000041379335,0.000274892,0.00014905195,0.00017733642,0.0009195658],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9954781,0.0024986116,0.00016737069,0.0006402982,0.0010710084,0.00014471113],"domain_scores_gemma":[0.99475694,0.0036527812,0.00022471085,0.0006266129,0.00055453717,0.00018445998],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006036815,0.0009104893,0.0014465855,0.0018238549,0.0016440058,0.0016319302,0.0027268867,0.002048505,0.0052290647],"category_scores_gemma":[0.01916748,0.0011303702,0.001560242,0.0015737736,0.0021747043,0.0030899195,0.0034320983,0.0038582967,0.0017915256],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00034069872,0.00016013971,0.0019617034,0.0002697139,0.00025594156,0.00023255935,0.00083189236,0.27169016,0.0056026126,0.4526477,0.006194894,0.25981194],"study_design_scores_gemma":[0.00005971825,0.000035520683,0.00027923624,0.00003200908,0.000038230508,0.00014181212,0.000041317882,0.8528287,0.0029532895,0.13444623,0.009085727,0.000058195743],"about_ca_topic_score_codex":0.0025906935,"about_ca_topic_score_gemma":0.0032149951,"teacher_disagreement_score":0.006036815,"about_ca_system_score_codex":0.001223848,"about_ca_system_score_gemma":0.0022892274,"threshold_uncertainty_score":0.031926155},"labels":[],"label_agreement":null},{"id":"W2165084744","doi":"10.1198/1061860032283","title":"Multivariate Normal Probabilities: Implementing an Old Idea of Plackett's","year":2003,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Probability and Statistical Research","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Multivariate statistics; Multivariate normal distribution; Computation; Multivariate analysis; Computer science; Key (lock); Statistics; Mathematics; Econometrics; Algorithm","score_opus":0.05978480149004771,"score_gpt":0.37181750896245586,"score_spread":0.31203270747240813,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2165084744","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022940992,0.000057485133,0.99417156,0.00015095451,0.00005462426,0.000022843251,0.00003096586,0.00024784825,0.0029695665],"genre_scores_gemma":[0.11676646,0.0003217967,0.87504256,0.0001455573,0.00020461003,0.00016234249,0.00011635569,0.00034604737,0.0068942476],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.9984237,0.00050728215,0.00006420011,0.00020197427,0.00070703996,0.00009595922],"domain_scores_gemma":[0.9985656,0.00072500866,0.00007622884,0.00028569368,0.00029502608,0.00005257465],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0017109873,0.00075485837,0.000773839,0.0015290973,0.000645119,0.0017830635,0.0015172167,0.0006203768,0.009722873],"category_scores_gemma":[0.008447512,0.00042850635,0.0010100969,0.00122858,0.0016596114,0.002416428,0.002321279,0.002302416,0.001977326],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000043422893,0.000031954583,0.0002303896,0.00007147832,0.000017644488,0.00007172414,0.00010764338,0.028611364,0.0020833996,0.87603647,0.0028695567,0.08982496],"study_design_scores_gemma":[0.000023896771,0.00003126208,0.0001997453,0.000023307546,0.000014135999,0.00011396338,0.000024177076,0.42185766,0.0034814377,0.56150496,0.012697083,0.000028268023],"about_ca_topic_score_codex":0.0018042644,"about_ca_topic_score_gemma":0.0017752368,"teacher_disagreement_score":0.009722873,"about_ca_system_score_codex":0.00089872,"about_ca_system_score_gemma":0.0011774236,"threshold_uncertainty_score":0.032526195},"labels":[],"label_agreement":null},{"id":"W2234615877","doi":"10.1080/10618600.2018.1546593","title":"A General Hybrid Clustering Technique","year":2018,"lang":"en","type":"preprint","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Clustering Algorithms Research","field":"Computer Science","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Polytechnique Montréal","funders":"Division of Mathematical Sciences; Defense Threat Reduction Agency","keywords":"Cluster analysis; Single-linkage clustering; Complete-linkage clustering; Dendrogram; Complete linkage; Correlation clustering; CURE data clustering algorithm; Series (stratigraphy); Regular polygon; Mathematics; k-medians clustering; Computer science; Joins; Hamming distance; Combinatorics; Data mining; Artificial intelligence; Geometry","score_opus":0.020955277286332633,"score_gpt":0.3180252457379465,"score_spread":0.2970699684516139,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2234615877","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0011830915,0.00021328706,0.99537,0.00012938931,0.000087933775,0.00007220484,0.000127779,0.00062893884,0.0021873089],"genre_scores_gemma":[0.029387128,0.00035313875,0.95944524,0.00035710144,0.00017093473,0.00030716474,0.0006518535,0.00047653707,0.008850901],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9962698,0.0008281509,0.00017242353,0.0012352328,0.0012620088,0.00023233121],"domain_scores_gemma":[0.9973985,0.00062984956,0.00016026034,0.0009471321,0.0007520552,0.0001121712],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026842246,0.0014745438,0.0016619278,0.004145661,0.0021045443,0.0025019643,0.004132249,0.0030596722,0.010447522],"category_scores_gemma":[0.005259081,0.00091406435,0.0028360363,0.004998524,0.0014780986,0.0030148418,0.004327227,0.0029973865,0.008916982],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002681467,0.00017054734,0.0022555368,0.0006158429,0.00062410545,0.00041114667,0.00090054143,0.098976046,0.033486072,0.22793344,0.035228007,0.5991305],"study_design_scores_gemma":[0.00008939945,0.00017260057,0.0017146631,0.000118422606,0.00018856557,0.0013441677,0.00033148,0.70768297,0.011993401,0.16560227,0.110597,0.00016511415],"about_ca_topic_score_codex":0.003092081,"about_ca_topic_score_gemma":0.0041752015,"teacher_disagreement_score":0.010447522,"about_ca_system_score_codex":0.0010770428,"about_ca_system_score_gemma":0.00140674,"threshold_uncertainty_score":0.034950495},"labels":[],"label_agreement":null},{"id":"W2256665692","doi":"10.1080/10618600.2012.723569","title":"An Adaptive Interacting Wang–Landau Algorithm for Automatic Density Exploration","year":2012,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":28,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Algorithm; Artificial intelligence; Statistical physics; Physics","score_opus":0.07624063086788722,"score_gpt":0.3818334136523043,"score_spread":0.30559278278441704,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2256665692","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032212192,0.000031678068,0.99570847,0.000046986497,0.000010653959,0.000029646673,0.000010857916,0.0003148692,0.0006256716],"genre_scores_gemma":[0.08223187,0.000047777223,0.91544,0.00006684082,0.000018231172,0.00020956605,0.000065536755,0.00015778947,0.0017622878],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99921775,0.00029538517,0.00004780624,0.00012939273,0.00024939817,0.000060240847],"domain_scores_gemma":[0.9978503,0.0013374492,0.00015444809,0.00026296815,0.00029419264,0.00010073964],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0022387796,0.000691916,0.0008437282,0.001200528,0.00086622813,0.0010551785,0.0019710793,0.0011889633,0.0044086752],"category_scores_gemma":[0.0076442175,0.0004967023,0.00071324257,0.0010043364,0.001178465,0.0014092172,0.0018595151,0.0012755212,0.0010278231],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024214265,0.00011656741,0.0021907112,0.00012950682,0.000090302274,0.00023249551,0.00034943406,0.53284705,0.008673608,0.1736545,0.003327565,0.2781461],"study_design_scores_gemma":[0.000017717293,0.000014540391,0.000063902415,0.000005150291,0.000004594673,0.00002457826,0.000007062806,0.97948265,0.0009187278,0.018591775,0.0008607194,0.000008493161],"about_ca_topic_score_codex":0.0031109583,"about_ca_topic_score_gemma":0.0055326824,"teacher_disagreement_score":0.0044086752,"about_ca_system_score_codex":0.0009059544,"about_ca_system_score_gemma":0.002039743,"threshold_uncertainty_score":0.014748514},"labels":[],"label_agreement":null},{"id":"W2297082043","doi":"10.1080/10618600.2018.1513365","title":"Adaptive Component-Wise Multiple-Try Metropolis Sampling","year":2018,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Metropolis–Hastings algorithm; Markov chain; Ergodicity; Markov chain Monte Carlo; Component (thermodynamics); Algorithm; Computer science; Mathematics; Set (abstract data type); Additive Markov chain; Mathematical optimization; Distribution (mathematics); Variable-order Markov model; Markov model; Artificial intelligence; Machine learning; Statistics; Bayesian probability","score_opus":0.08135597292753999,"score_gpt":0.36876271864346916,"score_spread":0.28740674571592917,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2297082043","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010193307,0.0002166968,0.9871114,0.00011766678,0.000056215962,0.00014662914,0.000074869204,0.00067792035,0.0014052214],"genre_scores_gemma":[0.3892712,0.0003408031,0.6011272,0.00028784908,0.00013498287,0.0010005274,0.0006121523,0.00047519224,0.0067501413],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99804926,0.0009762318,0.000070356655,0.00041144152,0.00034756487,0.00014520434],"domain_scores_gemma":[0.9936573,0.00432587,0.00027201563,0.0009951807,0.00057930604,0.00017027838],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00263375,0.00097487005,0.0019896282,0.00083167007,0.00071065105,0.0015975754,0.0035357703,0.0016810161,0.0062533463],"category_scores_gemma":[0.013772314,0.00075560116,0.0010875175,0.0012731731,0.0016485191,0.0019172545,0.001759389,0.0026314538,0.0017768558],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005632002,0.00021635996,0.0033782264,0.00033490037,0.00020743019,0.00038843157,0.00031044477,0.6241641,0.0063876486,0.2369486,0.0072464254,0.11985428],"study_design_scores_gemma":[0.000034399836,0.000025457255,0.00012029749,0.000010479488,0.000013950781,0.000053863874,0.000009941595,0.9693003,0.0014920702,0.027617354,0.0013025242,0.00001929772],"about_ca_topic_score_codex":0.002987014,"about_ca_topic_score_gemma":0.0041493736,"teacher_disagreement_score":0.0062533463,"about_ca_system_score_codex":0.00084999774,"about_ca_system_score_gemma":0.0015260841,"threshold_uncertainty_score":0.020919502},"labels":[],"label_agreement":null},{"id":"W2325530052","doi":"10.1080/10618600.2017.1385468","title":"Fast and Exact Simulation of Complex-Valued Stationary Gaussian Processes Through Embedding Circulant Matrix","year":2017,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":16,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal","funders":"Air Force Office of Scientific Research; Agence Nationale de la Recherche","keywords":"Circulant matrix; Gaussian; Embedding; Applied mathematics; Covariance matrix; Matrix (chemical analysis); Covariance function; Mathematics; Gaussian noise; Function (biology); Statistical physics; Covariance; Simple (philosophy); Gaussian process; Algorithm; Computer science; Mathematical optimization; Physics; Artificial intelligence; Statistics; Quantum mechanics","score_opus":0.05722692399551344,"score_gpt":0.3258920297182836,"score_spread":0.2686651057227702,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2325530052","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058886077,0.00010270638,0.9381225,0.00015700857,0.000041521635,0.0000461522,0.00006394242,0.0004022575,0.0021777495],"genre_scores_gemma":[0.7816223,0.00011723616,0.21676879,0.00006123063,0.000021593001,0.00011313342,0.00013031017,0.00011165746,0.0010537483],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9996407,0.00017320602,0.000015078647,0.00003613659,0.000097035234,0.00003786064],"domain_scores_gemma":[0.9967218,0.0023549376,0.00018010194,0.00030793494,0.00032235164,0.00011289608],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0012232868,0.0005129138,0.00052603363,0.00042228802,0.00043972197,0.0005960478,0.00087498943,0.00089459005,0.0016331994],"category_scores_gemma":[0.006642503,0.00025494202,0.00034115402,0.0005049622,0.0006715149,0.0009844628,0.00074827997,0.0009540352,0.00027688607],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000057005043,0.000038402522,0.00050151336,0.0000242289,0.000014513035,0.00005567608,0.0000478296,0.95103025,0.0020224594,0.036735557,0.00041361598,0.00905884],"study_design_scores_gemma":[0.0000029667574,0.0000036550148,0.000013380421,9.868713e-7,4.6650527e-7,0.000003827589,0.0000014456188,0.9978992,0.00026451366,0.0017571918,0.000050941646,0.0000014800404],"about_ca_topic_score_codex":0.0054836473,"about_ca_topic_score_gemma":0.004241845,"teacher_disagreement_score":0.0054836473,"about_ca_system_score_codex":0.0006141069,"about_ca_system_score_gemma":0.00091437704,"threshold_uncertainty_score":0.010903478},"labels":[],"label_agreement":null},{"id":"W2416022617","doi":"10.1080/10618600.2016.1195273","title":"Locally Sparse Estimator for Functional Linear Regression Models","year":2016,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":67,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; University of Toronto","funders":"","keywords":"Mathematics; Estimator; Linear model; Linear regression; Computer science; Statistics; Artificial intelligence","score_opus":0.10976346705495489,"score_gpt":0.36286634772272613,"score_spread":0.25310288066777126,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2416022617","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0017328829,0.000052440635,0.99797505,0.0000421704,0.000004874488,0.000006631763,0.000024988945,0.000061023886,0.00009997133],"genre_scores_gemma":[0.26815847,0.0006593687,0.72619206,0.0002933626,0.00017707802,0.00036239994,0.0007891596,0.00021110938,0.0031570762],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.998691,0.0006789475,0.00004323624,0.00023701189,0.00029205528,0.000057762427],"domain_scores_gemma":[0.99545395,0.002979122,0.00051146216,0.0004445693,0.00049416494,0.00011674383],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002911342,0.00070111523,0.0010179238,0.0010083243,0.00027909968,0.00063802226,0.0013716422,0.0010480639,0.0014837367],"category_scores_gemma":[0.011309269,0.0004109786,0.0008567831,0.0008473344,0.0009452799,0.0012593997,0.0013142051,0.0019304069,0.00046026226],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001553345,0.00008365391,0.003921144,0.00034462987,0.00021975834,0.00023135921,0.00018450104,0.60211957,0.01675836,0.17394237,0.005500512,0.19653878],"study_design_scores_gemma":[0.0000090388285,0.000028167857,0.00032515277,0.000010278794,0.000013801849,0.00005301912,0.000008356177,0.97764426,0.0009764091,0.019893415,0.0010244141,0.000013589115],"about_ca_topic_score_codex":0.0019737366,"about_ca_topic_score_gemma":0.0020774524,"teacher_disagreement_score":0.002911342,"about_ca_system_score_codex":0.00055279734,"about_ca_system_score_gemma":0.0009574102,"threshold_uncertainty_score":0.015396833},"labels":[],"label_agreement":null},{"id":"W2516700508","doi":"10.1080/10618600.2015.1124041","title":"A Functional Estimate of Covariation","year":2015,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Soil Geostatistics and Mapping","field":"Environmental Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Covariance; Mathematics; Covariance function; Covariance matrix; Smoothing; Bivariate analysis; Estimation of covariance matrices; Functional data analysis; Rational quadratic covariance function; Statistics; Residual; Data set; Representation (politics); Sampling (signal processing); Applied mathematics; Algorithm; Computer science; Covariance intersection","score_opus":0.0208504176801952,"score_gpt":0.2550651859011391,"score_spread":0.2342147682209439,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2516700508","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023836741,0.00037713483,0.9693554,0.0005333152,0.00010427788,0.0000349118,0.0011234389,0.00042988654,0.0042048483],"genre_scores_gemma":[0.57474315,0.0007360743,0.41273856,0.0004283175,0.0003139438,0.00022900311,0.002710354,0.0005410296,0.0075595435],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9986034,0.0004759088,0.00006962617,0.00049331895,0.00027266325,0.00008517786],"domain_scores_gemma":[0.9962728,0.0018924999,0.00034131986,0.0007196744,0.00068891887,0.00008475164],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003337305,0.0007748252,0.00083959074,0.002309618,0.00044909987,0.0013831905,0.0008989396,0.0013117897,0.0071640266],"category_scores_gemma":[0.012944016,0.00037589198,0.0012209424,0.0017403265,0.0015281993,0.002417527,0.0011921716,0.0014009385,0.0012321274],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00017415386,0.00013583996,0.033138365,0.0005590415,0.0006532069,0.00028599647,0.0004360256,0.14198293,0.020795437,0.4959638,0.011745937,0.2941292],"study_design_scores_gemma":[0.000027131622,0.00017170949,0.04290821,0.00017659589,0.00016458145,0.00097607914,0.0002957735,0.4926866,0.007593148,0.41788134,0.036939565,0.00017928435],"about_ca_topic_score_codex":0.0030594277,"about_ca_topic_score_gemma":0.0023956902,"teacher_disagreement_score":0.0071640266,"about_ca_system_score_codex":0.0010668081,"about_ca_system_score_gemma":0.001003971,"threshold_uncertainty_score":0.023966074},"labels":[],"label_agreement":null},{"id":"W2804134309","doi":"10.1080/10618600.2018.1476250","title":"Optimal Designs for Multi-Response Nonlinear Regression Models With Several Factors via Semidefinite Programming","year":2018,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"National Institute of General Medical Sciences","keywords":"Semidefinite programming; Optimal design; Mathematical optimization; Mathematics; Bivariate analysis; Design matrix; Linear model; Nonlinear system; Computation; Linear programming; Computer science; Algorithm; Statistics","score_opus":0.19381600922201345,"score_gpt":0.44673970487015846,"score_spread":0.252923695648145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2804134309","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.003165432,0.000059331505,0.99581486,0.00006748939,0.00000942275,0.000060561753,0.000044584158,0.000053687494,0.0007245822],"genre_scores_gemma":[0.15578404,0.00029160496,0.84088516,0.0001916661,0.000030221177,0.0011676854,0.00022860804,0.00012879272,0.0012921192],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99015737,0.0074120956,0.00024061474,0.0009952234,0.00092328934,0.00027150093],"domain_scores_gemma":[0.98230964,0.014235346,0.0013506853,0.00076012465,0.0010324954,0.0003118024],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0124121765,0.002157497,0.0018969995,0.0011848283,0.00042262147,0.001348779,0.0013914739,0.0011209084,0.004310894],"category_scores_gemma":[0.021298865,0.0011903096,0.0017880081,0.0011934532,0.0020559456,0.0015432832,0.002015531,0.0023452847,0.00067650824],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020489494,0.00027087753,0.0008405043,0.00041978486,0.00012688675,0.00008530156,0.0001511397,0.7822966,0.0023218691,0.14124961,0.0015129978,0.07051948],"study_design_scores_gemma":[0.000049950842,0.00019311567,0.0001281646,0.000036487978,0.000020590656,0.000016230122,0.000024889714,0.90352917,0.0008646232,0.09417436,0.000942145,0.00002026186],"about_ca_topic_score_codex":0.0012301169,"about_ca_topic_score_gemma":0.001383321,"teacher_disagreement_score":0.0124121765,"about_ca_system_score_codex":0.0013215572,"about_ca_system_score_gemma":0.0032338398,"threshold_uncertainty_score":0.065642655},"labels":[],"label_agreement":null},{"id":"W2954648680","doi":"10.1080/10618600.2020.1840995","title":"Likelihood Evaluation of Jump-Diffusion Models Using Deterministic Nonlinear Filters","year":2020,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université du Québec à Montréal; Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada; Simon Fraser University; Nvidia","keywords":"Stochastic volatility; Jump; Mathematics; Likelihood function; Particle filter; Jump diffusion; Nonlinear system; Volatility (finance); Econometrics; Applied mathematics; Maximum likelihood; Kalman filter; Statistics; Physics","score_opus":0.10269853560347117,"score_gpt":0.28406105773310847,"score_spread":0.1813625221296373,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954648680","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.019906478,0.00008024883,0.9788649,0.00015248098,0.00001581541,0.000015084624,0.000026037507,0.000114020375,0.00082489935],"genre_scores_gemma":[0.7089109,0.00026585866,0.28576607,0.00014320554,0.000062550775,0.00015186501,0.00021669448,0.00014031975,0.0043424745],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9995123,0.00020384893,0.000029202585,0.00007627317,0.00013295846,0.00004542775],"domain_scores_gemma":[0.99607533,0.0032161707,0.00021951794,0.00010417157,0.00030892142,0.00007583741],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002122349,0.0005903679,0.0008362114,0.0007044664,0.00045386012,0.0011662262,0.0008684414,0.001422785,0.0013316415],"category_scores_gemma":[0.008775897,0.0006260623,0.00081563176,0.00038969208,0.0008653752,0.0014082085,0.0008211014,0.00093618373,0.00022008343],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000021320802,0.000012969697,0.00055893546,0.000024779285,0.000018219767,0.000032034743,0.000030415798,0.9732853,0.0007820666,0.018141616,0.00012687543,0.0069655166],"study_design_scores_gemma":[0.0000016421997,0.0000021881895,0.000041580355,0.0000010967497,8.9554925e-7,0.0000027367162,0.0000013827139,0.99824333,0.00010844376,0.0015437291,0.00005045619,0.000002414966],"about_ca_topic_score_codex":0.012333625,"about_ca_topic_score_gemma":0.007366868,"teacher_disagreement_score":0.012333625,"about_ca_system_score_codex":0.0017947134,"about_ca_system_score_gemma":0.0017881503,"threshold_uncertainty_score":0.024523675},"labels":[],"label_agreement":null},{"id":"W2962861789","doi":"10.1080/10618600.2019.1598872","title":"Adaptive Incremental Mixture Markov Chain Monte Carlo","year":2019,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Markov Chains and Monte Carlo Methods","field":"Mathematics","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Center for Advanced Study, University of Illinois at Urbana-Champaign; Eunice Kennedy Shriver National Institute of Child Health and Human Development; Center for Advanced Study in the Behavioral Sciences, Stanford University; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; Insight SFI Research Centre for Data Analytics; Science Foundation Ireland; National Institutes of Health; National Science Foundation","keywords":"Markov chain Monte Carlo; Computer science; Kernel (algebra); Mixture model; Gaussian process; Mathematics; Bayesian probability; Semiparametric regression; Algorithm; Mathematical optimization; Parametric statistics; Artificial intelligence; Gaussian; Statistics","score_opus":0.021498321762273426,"score_gpt":0.298824804278164,"score_spread":0.27732648251589054,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2962861789","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038948425,0.00015507327,0.9945773,0.00011891797,0.00003189518,0.00005230577,0.00006382021,0.0004285113,0.00067741686],"genre_scores_gemma":[0.2906869,0.00039270072,0.70397705,0.0003436937,0.00015302715,0.0006099304,0.00083398377,0.00035899106,0.00264363],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99803346,0.00097128114,0.000072631665,0.00032610446,0.00044300026,0.00015366712],"domain_scores_gemma":[0.990137,0.007382311,0.0005664429,0.0008572406,0.0007791409,0.00027786664],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0042229164,0.0009847685,0.0018624222,0.0013347969,0.0008046984,0.001481338,0.0044123516,0.0016668729,0.0033851068],"category_scores_gemma":[0.01702518,0.0011002923,0.0015069937,0.0014723304,0.0014698845,0.0023203946,0.002362618,0.00297675,0.0009828391],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015670573,0.00008235068,0.002205466,0.00012039178,0.00011533333,0.00015633643,0.0001310951,0.85085607,0.00090089126,0.089416616,0.0025114438,0.053347237],"study_design_scores_gemma":[0.0000115756375,0.000007774229,0.000057736506,0.000006865288,0.000007094979,0.000014412009,0.00000305436,0.9829146,0.00017597871,0.016256012,0.00053678744,0.000008127455],"about_ca_topic_score_codex":0.0061029163,"about_ca_topic_score_gemma":0.009020966,"teacher_disagreement_score":0.0061029163,"about_ca_system_score_codex":0.0013185724,"about_ca_system_score_gemma":0.0021143197,"threshold_uncertainty_score":0.022333145},"labels":[],"label_agreement":null},{"id":"W3121888169","doi":"10.1080/10618600.2021.1873144","title":"False Discovery Rates to Detect Signals from Incomplete Spatially Aggregated Data","year":2021,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Geochemistry and Geologic Mapping","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Australian Research Council; Ministry of Science and Technology, Taiwan; Division of Social and Economic Sciences; National Sleep Foundation; National Aeronautics and Space Administration","keywords":"False discovery rate; Nonparametric statistics; Null hypothesis; Statistical hypothesis testing; Inference; SIGNAL (programming language); Null (SQL); Statistical inference; Computer science; Algorithm; Multiple comparisons problem; Pixel; Statistics; Pattern recognition (psychology); Type I and type II errors; Data mining; Mathematics; Artificial intelligence","score_opus":0.028691427621305197,"score_gpt":0.2726817872880555,"score_spread":0.24399035966675028,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3121888169","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.037978243,0.0014336188,0.955834,0.0007698248,0.00027923528,0.00057566527,0.00059286645,0.001056934,0.0014796616],"genre_scores_gemma":[0.49535114,0.0005573601,0.49775285,0.0010252523,0.00027354233,0.0028315114,0.0010114389,0.00027400616,0.0009228841],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9046277,0.067217,0.0056621805,0.010823949,0.010516314,0.0011528991],"domain_scores_gemma":[0.43662322,0.5106959,0.016431656,0.027135398,0.008038573,0.0010752599],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.13280639,0.0016783137,0.0029870295,0.0043158126,0.0014961703,0.0031621726,0.004502695,0.0042913957,0.002042893],"category_scores_gemma":[0.39572442,0.0009862869,0.003143111,0.0031150512,0.00518626,0.004339505,0.0037319225,0.0062059923,0.00041201597],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.003506632,0.00065753836,0.19069175,0.0029163775,0.0071103917,0.002963584,0.0028293184,0.20523626,0.012123189,0.22310658,0.009359692,0.3394987],"study_design_scores_gemma":[0.00069527293,0.0012072905,0.03329766,0.00066344294,0.0010394213,0.0026474383,0.0004749754,0.6835666,0.019866792,0.24569349,0.010464288,0.00038330763],"about_ca_topic_score_codex":0.0016778351,"about_ca_topic_score_gemma":0.0008681353,"teacher_disagreement_score":0.13280639,"about_ca_system_score_codex":0.001844581,"about_ca_system_score_gemma":0.0021866902,"threshold_uncertainty_score":0.70235574},"labels":[],"label_agreement":null},{"id":"W3131114373","doi":"10.1080/10618600.2022.2110883","title":"Cross-Validated Loss-based Covariance Matrix Estimator Selection in High Dimensions","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Single-cell and spatial transcriptomics","field":"Biochemistry, Genetics and Molecular Biology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute on Deafness and Other Communication Disorders; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; National Science Foundation","keywords":"Estimator; Curse of dimensionality; Covariance matrix; Dimensionality reduction; Estimation of covariance matrices; Mathematics; Sample size determination; Covariance; Model selection; Selection (genetic algorithm); Computer science; Mathematical optimization; Statistics; Artificial intelligence","score_opus":0.007898124488251633,"score_gpt":0.2743379380396968,"score_spread":0.2664398135514452,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3131114373","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062555335,0.00026361216,0.9925162,0.00018077102,0.000025254918,0.000040464074,0.000061638115,0.00023968422,0.0004167332],"genre_scores_gemma":[0.43614137,0.0009927677,0.55404556,0.00091400207,0.00022480244,0.0008064147,0.001780814,0.0005385088,0.0045557804],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9927296,0.0046503562,0.0003316241,0.00066528644,0.001308201,0.00031496087],"domain_scores_gemma":[0.95460016,0.034318004,0.0020096116,0.004145678,0.004318324,0.0006081163],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026457975,0.001349539,0.0018299373,0.0013930837,0.0007817299,0.0020355445,0.0023020774,0.0018714615,0.0022053544],"category_scores_gemma":[0.06304399,0.0006721754,0.0012206476,0.0012807479,0.00232413,0.0023890475,0.0035789844,0.0030192481,0.0009595504],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002880325,0.0001906095,0.005897049,0.0003098291,0.00030300568,0.00026498156,0.00018596191,0.7845326,0.0042733853,0.09149151,0.006164688,0.106098354],"study_design_scores_gemma":[0.000017418963,0.00005341932,0.0006030796,0.000027184316,0.000017102098,0.000055609005,0.000013097573,0.978218,0.0012796115,0.019060226,0.00063802634,0.000017079183],"about_ca_topic_score_codex":0.002239798,"about_ca_topic_score_gemma":0.0023456586,"teacher_disagreement_score":0.026457975,"about_ca_system_score_codex":0.0011792296,"about_ca_system_score_gemma":0.0029330882,"threshold_uncertainty_score":0.13992482},"labels":[],"label_agreement":null},{"id":"W3213258851","doi":"10.1080/10618600.2021.1999825","title":"Mixtures of Matrix-Variate Contaminated Normal Distributions","year":2021,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":30,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University","funders":"","keywords":"Random variate; Cluster analysis; Computer science; Expectation–maximization algorithm; Data mining; Matrix (chemical analysis); Data Matrix; Algorithm; Artificial intelligence; Statistics; Mathematics; Maximum likelihood; Random variable","score_opus":0.00868830389333632,"score_gpt":0.275012658105719,"score_spread":0.2663243542123827,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3213258851","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0039183693,0.00017213338,0.99437237,0.00009154367,0.00004038879,0.00006251912,0.00018359239,0.00027470267,0.00088434503],"genre_scores_gemma":[0.25394773,0.0011851309,0.7308484,0.0002898569,0.00019951783,0.00070343696,0.0020058996,0.00049132644,0.010328707],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9946104,0.002537312,0.00022264905,0.0011499298,0.0012176909,0.00026197918],"domain_scores_gemma":[0.9866128,0.008787794,0.0010383204,0.0016325361,0.0016609988,0.00026755835],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0078872405,0.0012033421,0.001635989,0.0027657594,0.00078217883,0.003345019,0.0024484585,0.0018724193,0.007455709],"category_scores_gemma":[0.03107068,0.0009233838,0.0019530784,0.003276257,0.0020460617,0.0033318235,0.0025551587,0.0027143038,0.0025152483],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042146732,0.00009779387,0.004863241,0.00039397477,0.00018128811,0.00039037387,0.0005844556,0.25840548,0.0042576473,0.6008972,0.007410599,0.12209657],"study_design_scores_gemma":[0.000026262358,0.000045768786,0.0012231361,0.00007072319,0.000036662725,0.0003255105,0.00006917388,0.7872141,0.0014135839,0.20217422,0.0073238304,0.00007695012],"about_ca_topic_score_codex":0.003224122,"about_ca_topic_score_gemma":0.0033718213,"teacher_disagreement_score":0.0078872405,"about_ca_system_score_codex":0.001250955,"about_ca_system_score_gemma":0.0011134407,"threshold_uncertainty_score":0.041712224},"labels":[],"label_agreement":null},{"id":"W4234894698","doi":"10.1198/106186002321018849","title":"Detecting Clusters and Nonlinearity in Three-Dimensional Dynamic Graphs","year":2002,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Complex Network Analysis Techniques","field":"Physics and Astronomy","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Computer science; Nonlinear system; Theoretical computer science; Algorithm; Physics","score_opus":0.010451391268419685,"score_gpt":0.2540165866985389,"score_spread":0.2435651954301192,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4234894698","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5910898,0.00012059539,0.40641946,0.0002888977,0.0000142453955,0.00007483569,0.00014584226,0.0007090503,0.0011372931],"genre_scores_gemma":[0.9498892,0.00007337737,0.049578067,0.00003084735,0.000010194335,0.00005989424,0.00012183819,0.000051353865,0.00018527076],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9963356,0.0020463322,0.0002322061,0.00054466823,0.000697138,0.00014395583],"domain_scores_gemma":[0.86262524,0.1214092,0.0076641776,0.0050479504,0.0023941672,0.0008593123],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0061393604,0.00041410883,0.0005596368,0.0018841979,0.00045513388,0.0014202576,0.000564788,0.0008054015,0.0015192435],"category_scores_gemma":[0.07990589,0.00050589954,0.00042373934,0.0010190299,0.0019708101,0.0027853465,0.0018098776,0.0009255374,0.0001726723],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037788467,0.00035059362,0.21033981,0.0010413361,0.00049602723,0.0013598315,0.0072790673,0.26086283,0.16850184,0.054824498,0.0024744978,0.28869087],"study_design_scores_gemma":[0.00006787963,0.00048750112,0.10823465,0.00008170919,0.00008146969,0.0011009811,0.0010036452,0.77039576,0.03550379,0.08129096,0.0015732505,0.00017846281],"about_ca_topic_score_codex":0.0010415919,"about_ca_topic_score_gemma":0.00091154093,"teacher_disagreement_score":0.0061393604,"about_ca_system_score_codex":0.0005790852,"about_ca_system_score_gemma":0.00046172028,"threshold_uncertainty_score":0.03246838},"labels":[],"label_agreement":null},{"id":"W4237076065","doi":"10.1198/jcgs.2011.09166b","title":"Comment","year":2011,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Perspective (graphical); Relation (database); Computer science; Cognition; Table (database); Psychology; Cognitive psychology; Artificial intelligence; Data mining","score_opus":0.03274139259601863,"score_gpt":0.28920280013943866,"score_spread":0.25646140754342006,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4237076065","genre_codex":"commentary","genre_gemma":"other","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"other","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00050918787,0.00042781542,0.00034933368,0.95826864,0.034171425,0.000023293653,0.0004021015,0.00014275966,0.0057054246],"genre_scores_gemma":[0.004929733,0.00033435097,0.00032613077,0.9745837,0.011232615,0.000059724134,0.00011328041,0.000061604704,0.008358946],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9942484,0.0009693052,0.0006277882,0.0011850947,0.0023152817,0.00065413665],"domain_scores_gemma":[0.95897114,0.017454628,0.0023142826,0.0023664096,0.016485553,0.0024079357],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.008064299,0.0005475017,0.00063551066,0.00096499163,0.0028196026,0.0030959167,0.004054812,0.02182657,0.04959048],"category_scores_gemma":[0.09438159,0.00038014882,0.0012212738,0.001034796,0.004020807,0.005793596,0.0028613827,0.027239887,0.034151066],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000030251247,0.0000069337616,0.00033063875,0.000058186375,0.000005687007,0.00021249152,0.00026626087,0.000032272197,0.000102828206,0.0039152973,0.99218994,0.0028493155],"study_design_scores_gemma":[0.000027402375,0.000016603064,0.00096478395,0.00027334318,0.000014253809,0.0006767122,0.00095930614,0.00013535301,0.0006531508,0.0077384803,0.9884958,0.000044783064],"about_ca_topic_score_codex":0.010921889,"about_ca_topic_score_gemma":0.008453925,"teacher_disagreement_score":0.95040953,"about_ca_system_score_codex":0.004530558,"about_ca_system_score_gemma":0.0049507613,"threshold_uncertainty_score":0},"labels":[],"label_agreement":null},{"id":"W4237780050","doi":"10.2307/1390653","title":"Markov Chain Sampling Methods for Dirichlet Process Mixture Models","year":2000,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":508,"is_retracted":false,"has_abstract":false,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Dirichlet process; Markov chain; Mathematics; Dirichlet distribution; Sampling (signal processing); Slice sampling; Markov chain Monte Carlo; Hierarchical Dirichlet process; Computer science; Markov renewal process; Applied mathematics; Statistics; Econometrics; Statistical physics; Markov model; Variable-order Markov model; Bayesian probability; Mathematical analysis","score_opus":0.026056546071332128,"score_gpt":0.3550975326748263,"score_spread":0.3290409866034942,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4237780050","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007820604,0.00031551137,0.99822754,0.00008949622,0.000032774824,0.000027498338,0.00004391105,0.00009681648,0.00038437702],"genre_scores_gemma":[0.07301152,0.0023453527,0.9163883,0.00024297585,0.00046941958,0.0009258975,0.0012251202,0.00061308517,0.0047783363],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99272716,0.005213285,0.00025340452,0.0006206266,0.0009536038,0.00023197469],"domain_scores_gemma":[0.9645931,0.031355154,0.00061167974,0.0015652133,0.0014404852,0.00043447208],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.010646879,0.00182321,0.0032240788,0.0035646001,0.0015680193,0.0034887202,0.004777779,0.0029102392,0.008950297],"category_scores_gemma":[0.04657208,0.0022911178,0.0028144603,0.003915614,0.0027089808,0.005772001,0.0034344983,0.0058032363,0.0027405561],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019102206,0.0001228292,0.0007787614,0.00032722356,0.00020634978,0.00008425559,0.0003824719,0.2564467,0.00064899476,0.65494925,0.005386373,0.080475755],"study_design_scores_gemma":[0.000042345237,0.000010858616,0.0000832955,0.000045893485,0.000026111566,0.000028855608,0.000021497928,0.66410744,0.00019169248,0.33301556,0.0023997226,0.000026642623],"about_ca_topic_score_codex":0.008344305,"about_ca_topic_score_gemma":0.009519639,"teacher_disagreement_score":0.010646879,"about_ca_system_score_codex":0.0021777218,"about_ca_system_score_gemma":0.0026660655,"threshold_uncertainty_score":0.05630678},"labels":[],"label_agreement":null},{"id":"W4250766106","doi":"10.1198/jcgs.2011.09224","title":"Functional Boxplots","year":2011,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":417,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"King Abdullah University of Science and Technology; University of Windsor; National Science Foundation","keywords":"Functional data analysis; Outlier; Computer science; Generalization; Exploratory data analysis; Anomaly detection; Envelope (radar); Artificial intelligence; Statistics; Data mining; Mathematics; Machine learning","score_opus":0.15056388113600172,"score_gpt":0.37483896033699754,"score_spread":0.22427507920099582,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4250766106","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031962579,0.0004103998,0.9485834,0.00032723267,0.00019745601,0.00013093595,0.0065128244,0.03717812,0.0034633465],"genre_scores_gemma":[0.11754642,0.00073774747,0.84943265,0.0004178727,0.00029284396,0.0014135556,0.012987043,0.012129384,0.005042457],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.996438,0.0017029656,0.00042999198,0.00048668974,0.00076115876,0.00018110944],"domain_scores_gemma":[0.98107177,0.013668234,0.001118485,0.0017496392,0.0020657727,0.00032612035],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0055913962,0.0019027248,0.0012999888,0.005688733,0.0006917379,0.0029519335,0.0020721399,0.0012355861,0.05557321],"category_scores_gemma":[0.028295726,0.0009510969,0.0016204832,0.0044232304,0.0009921031,0.0040883706,0.0021774294,0.002033754,0.01089729],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011250381,0.00022412193,0.0061213216,0.0024578902,0.00029580668,0.0006522999,0.0019113211,0.050447784,0.0075884545,0.24218194,0.19500063,0.49199343],"study_design_scores_gemma":[0.00022755055,0.00021984712,0.0038893316,0.00050931907,0.000097199496,0.0011026936,0.00047047384,0.344661,0.009756524,0.28194857,0.35684937,0.00026814386],"about_ca_topic_score_codex":0.0013119553,"about_ca_topic_score_gemma":0.0012811902,"teacher_disagreement_score":0.05557321,"about_ca_system_score_codex":0.00064889994,"about_ca_system_score_gemma":0.0010370496,"threshold_uncertainty_score":0.18591088},"labels":[],"label_agreement":null},{"id":"W4283370965","doi":"10.1080/10618600.2022.2069780","title":"Analytic Permutation Testing for Functional Data ANOVA","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Blind Source Separation Techniques","field":"Computer Science","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Sheridan College; Lakehead University; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; Pacific Institute for the Mathematical Sciences","keywords":"Permutation (music); Resampling; Univariate; Nonparametric statistics; Statistical hypothesis testing; Mathematics; Omnibus test; Multiple comparisons problem; Sample size determination; Algorithm; Parametric statistics; Computer science; Multivariate statistics; Statistics","score_opus":0.07933935138083462,"score_gpt":0.3144627546212596,"score_spread":0.235123403240425,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4283370965","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0024739187,0.00014902289,0.99534297,0.00027098416,0.000057842517,0.00009419008,0.0002674802,0.00030207093,0.0010416028],"genre_scores_gemma":[0.20419112,0.0005715396,0.78603137,0.0008866944,0.00037049316,0.0025536653,0.0018475585,0.0008041574,0.0027434533],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97965795,0.013130378,0.00095027644,0.0024389776,0.0033018847,0.00052059285],"domain_scores_gemma":[0.8805355,0.09973038,0.00351946,0.010707064,0.004689636,0.0008179724],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.022647293,0.0014871322,0.0018088914,0.0027977617,0.0013014359,0.002359709,0.0028333676,0.0019419694,0.011688464],"category_scores_gemma":[0.14584383,0.000568668,0.0020821097,0.0026501378,0.0052086567,0.0038663321,0.0036480695,0.005557839,0.0020087566],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005011787,0.0001552483,0.0047944896,0.0007782176,0.00026875891,0.00093722116,0.0005240485,0.06452388,0.0072248485,0.67335105,0.011794225,0.23514684],"study_design_scores_gemma":[0.00007712546,0.00022676672,0.0014375407,0.00011764356,0.00003899425,0.0003081716,0.000106816995,0.30975452,0.0039926553,0.6752727,0.008614058,0.000053029245],"about_ca_topic_score_codex":0.001107318,"about_ca_topic_score_gemma":0.0008286013,"teacher_disagreement_score":0.022647293,"about_ca_system_score_codex":0.001642528,"about_ca_system_score_gemma":0.003181213,"threshold_uncertainty_score":0.11977178},"labels":[],"label_agreement":null},{"id":"W4286608159","doi":"10.1080/10618600.2022.2104858","title":"Using CVX to Construct Optimal Designs for Biomedical Studies with Multiple Objectives","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Optimal Experimental Design Methods","field":"Decision Sciences","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Optimal design; Computer science; Construct (python library); MATLAB; Mathematical optimization; Code (set theory); Software; Machine learning; Mathematics; Programming language","score_opus":0.2339448673563404,"score_gpt":0.4839443142539315,"score_spread":0.24999944689759107,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4286608159","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026428725,0.00020057765,0.9957451,0.000060082006,0.00003098664,0.00028828857,0.00006501583,0.0002907975,0.0006762698],"genre_scores_gemma":[0.039668866,0.00020177345,0.9571074,0.00009234436,0.000019065079,0.0021695897,0.00014560597,0.0002146266,0.00038077103],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9833935,0.013342815,0.00055562065,0.00094827,0.0015004405,0.0002593947],"domain_scores_gemma":[0.9529123,0.041021615,0.0020103867,0.0020652045,0.0017708425,0.00021961323],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031718977,0.0022215396,0.0020337182,0.0031373654,0.00057011785,0.0017239667,0.0015263538,0.0018092608,0.007582299],"category_scores_gemma":[0.07465026,0.0013361851,0.0021482327,0.0016372995,0.0017723603,0.0012207715,0.0022831191,0.0030336876,0.00093479734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011353389,0.00035198894,0.0030163769,0.0025883506,0.0008071207,0.00026692133,0.00038871198,0.52020353,0.009365677,0.17348287,0.004836867,0.28355622],"study_design_scores_gemma":[0.00048132293,0.0013442126,0.0015562779,0.00048118454,0.00020769465,0.00016077464,0.00009887135,0.8101972,0.01195609,0.16005728,0.01334514,0.00011407057],"about_ca_topic_score_codex":0.0010173105,"about_ca_topic_score_gemma":0.0009390331,"teacher_disagreement_score":0.031718977,"about_ca_system_score_codex":0.0012746771,"about_ca_system_score_gemma":0.002957429,"threshold_uncertainty_score":0.16774803},"labels":[],"label_agreement":null},{"id":"W4297019279","doi":"10.1080/10618600.2022.2127738","title":"Beyond Linear Dynamic Functional Connectivity: A Vine Copula Change Point Model","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Functional Brain Connectivity Studies","field":"Neuroscience","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Alberta Health","funders":"Natural Sciences and Engineering Research Council of Canada; China Scholarship Council","keywords":"Computer science; Vine copula; Inference; Copula (linguistics); Dynamic functional connectivity; Sliding window protocol; Artificial intelligence; Functional magnetic resonance imaging; Machine learning; Algorithm; Econometrics; Mathematics; Window (computing); Psychology","score_opus":0.04210046127206046,"score_gpt":0.27649775414176136,"score_spread":0.2343972928697009,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4297019279","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.020130701,0.00066693424,0.9755907,0.00077008776,0.00006342751,0.00007130035,0.00047118202,0.00029912457,0.0019366136],"genre_scores_gemma":[0.7413446,0.001864464,0.24281356,0.00081467396,0.00031719534,0.0006283446,0.0018538312,0.00073896674,0.009624528],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.998467,0.0006490799,0.000057111843,0.00047080984,0.00018749484,0.00016844846],"domain_scores_gemma":[0.9940587,0.004121677,0.00063874805,0.0005463215,0.0004724138,0.00016211945],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004369977,0.0011776199,0.0016086302,0.0023644282,0.00057271874,0.0020846417,0.0026215182,0.0018535428,0.0051031923],"category_scores_gemma":[0.019596025,0.0007781664,0.0018899027,0.0022948147,0.001810386,0.0029834616,0.0017562748,0.0031798177,0.0008972381],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010552431,0.00009894278,0.007612253,0.00016522837,0.0005352164,0.00060061156,0.00038192942,0.6800388,0.0018759789,0.2433539,0.00705097,0.058180597],"study_design_scores_gemma":[0.000009156002,0.000020422567,0.0014733522,0.000017201592,0.000025894955,0.00009856602,0.000021534088,0.9336417,0.00014359708,0.06311898,0.0014098319,0.000019748053],"about_ca_topic_score_codex":0.008864339,"about_ca_topic_score_gemma":0.006495494,"teacher_disagreement_score":0.008864339,"about_ca_system_score_codex":0.0012193217,"about_ca_system_score_gemma":0.00094769435,"threshold_uncertainty_score":0.023110926},"labels":[],"label_agreement":null},{"id":"W4311305973","doi":"10.1080/10618600.2022.2157835","title":"Dependence Model Assessment and Selection with DecoupleNets","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Anomaly Detection Techniques and Applications","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Selection (genetic algorithm); Model selection; Computer science; Econometrics; Mathematics; Statistics; Artificial intelligence","score_opus":0.009588893686394585,"score_gpt":0.2711973733594322,"score_spread":0.26160847967303763,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4311305973","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.03611106,0.00017291213,0.96077806,0.00023630075,0.000026293723,0.00007210553,0.00016448426,0.00040141787,0.0020373955],"genre_scores_gemma":[0.66227037,0.00024342995,0.33094028,0.00023275215,0.00006816457,0.00040268365,0.0011368749,0.00022324949,0.0044822027],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99845195,0.0009288173,0.000055071738,0.00023177998,0.00025078293,0.00008153945],"domain_scores_gemma":[0.99421304,0.004008453,0.00038903,0.0004888736,0.00072844,0.00017227429],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003813641,0.0012354437,0.0010538704,0.0026384313,0.0005885322,0.0014267226,0.001401413,0.0009833243,0.0047257333],"category_scores_gemma":[0.014921411,0.00057023007,0.0011477536,0.0011826967,0.00089421764,0.0016704394,0.00286521,0.0015912668,0.00055231754],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016104979,0.000066463894,0.004693183,0.00008984199,0.00014117236,0.0001690118,0.000108660926,0.83277017,0.0013964113,0.04617408,0.002220122,0.11200978],"study_design_scores_gemma":[0.0000036842596,0.000011659792,0.00027265956,0.000008346851,0.0000051190405,0.000009531813,0.000006079487,0.9857303,0.00018592612,0.013438968,0.00032267655,0.0000050724657],"about_ca_topic_score_codex":0.0038191138,"about_ca_topic_score_gemma":0.0041660285,"teacher_disagreement_score":0.0047257333,"about_ca_system_score_codex":0.0012064725,"about_ca_system_score_gemma":0.0010416827,"threshold_uncertainty_score":0.020168722},"labels":[],"label_agreement":null},{"id":"W4312132359","doi":"10.1080/10618600.2022.2156522","title":"Probabilistic <i>K</i> -means with Local Alignment for Clustering and Motif Discovery in Functional Data","year":2022,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bioinformatics and Genomic Networks","field":"Biochemistry, Genetics and Molecular Biology","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"National Stroke Foundation","keywords":"Cluster analysis; Motif (music); Probabilistic logic; Computer science; Artificial intelligence; Computational biology; Data mining; Biology; Physics","score_opus":0.012692114045678056,"score_gpt":0.22682571545923966,"score_spread":0.2141336014135616,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4312132359","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.000987315,0.0000732579,0.998005,0.0000664381,0.000013269207,0.000024437737,0.000079943005,0.0005979512,0.0001523261],"genre_scores_gemma":[0.032790765,0.000098681034,0.96544427,0.00010283206,0.000045653476,0.00029628671,0.00044395454,0.0003355838,0.00044206245],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9965875,0.0013951875,0.00017460852,0.0008578524,0.00081097154,0.00017380658],"domain_scores_gemma":[0.9945024,0.003135518,0.00057855074,0.0010080467,0.0005648657,0.000210557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047498974,0.0012258173,0.0018052248,0.003436833,0.0016414173,0.0016400979,0.00416327,0.002033153,0.0030301202],"category_scores_gemma":[0.017686607,0.0010631132,0.0027804966,0.0047223233,0.0021684293,0.0023206077,0.0024855079,0.003743311,0.0021806413],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00042120923,0.00023260585,0.0040327734,0.0005421509,0.00040537713,0.0001845788,0.0005357358,0.4867336,0.0123113375,0.11521185,0.013591906,0.36579683],"study_design_scores_gemma":[0.000020661639,0.000024078969,0.00030955666,0.000013211927,0.000013604383,0.000059449223,0.000022367676,0.94834226,0.0018621199,0.04663513,0.0026618328,0.00003572245],"about_ca_topic_score_codex":0.0068602297,"about_ca_topic_score_gemma":0.0089062555,"teacher_disagreement_score":0.0068602297,"about_ca_system_score_codex":0.0016043872,"about_ca_system_score_gemma":0.002814201,"threshold_uncertainty_score":0.02512014},"labels":[],"label_agreement":null},{"id":"W4385963506","doi":"10.1080/10618600.2023.2233581","title":"Functional Nonlinear Learning","year":2023,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Metabolomics and Mass Spectrometry Studies","field":"Biochemistry, Genetics and Molecular Biology","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; University of Calgary","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Functional principal component analysis; Functional data analysis; Principal component analysis; Computer science; Multivariate statistics; Generalization; Nonlinear system; Artificial intelligence; Representation (politics); Pattern recognition (psychology); Data mining; Machine learning; Mathematics","score_opus":0.01122446183980309,"score_gpt":0.25314412752160215,"score_spread":0.24191966568179907,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4385963506","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038442374,0.00025602095,0.992485,0.0003139486,0.00005119663,0.00003123564,0.00014253505,0.000267292,0.0026084706],"genre_scores_gemma":[0.432545,0.0018237366,0.5407147,0.00077077956,0.0004066447,0.0005162896,0.0018671446,0.00041323993,0.020942431],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9993598,0.00021434754,0.000034168446,0.00019983923,0.00013950827,0.000052322586],"domain_scores_gemma":[0.9985979,0.0005894495,0.00015591636,0.00030033465,0.00028620168,0.00007017474],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0015819436,0.0010957672,0.000776087,0.0011241667,0.00045156322,0.0013004693,0.0013352763,0.0012730864,0.005293879],"category_scores_gemma":[0.004594487,0.00045978033,0.0012429766,0.0008798967,0.0013218353,0.0022732627,0.0019199272,0.0016781386,0.0014804165],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010527932,0.000096714735,0.0022167705,0.0003405185,0.00014924203,0.00015040881,0.00017176924,0.39004213,0.005501608,0.22183235,0.008918202,0.37047502],"study_design_scores_gemma":[0.000005049669,0.000023510987,0.00024229598,0.000016334194,0.000008733096,0.000048567177,0.000015359825,0.9387023,0.0006783704,0.05670561,0.0035407369,0.000013212968],"about_ca_topic_score_codex":0.00263743,"about_ca_topic_score_gemma":0.0026571872,"teacher_disagreement_score":0.005293879,"about_ca_system_score_codex":0.0010856274,"about_ca_system_score_gemma":0.001176965,"threshold_uncertainty_score":0.017709792},"labels":[],"label_agreement":null},{"id":"W4386022565","doi":"10.1080/10618600.2023.2250411","title":"Supervised Principal Component Regression for Functional Responses with High Dimensional Predictors","year":2023,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Principal component analysis; Subspace topology; Functional principal component analysis; Covariance; Computer science; Principal component regression; Covariate; Residual; Regression; Estimator; Covariance matrix; Artificial intelligence; Mathematics; Statistics; Machine learning; Algorithm","score_opus":0.0766674021052579,"score_gpt":0.3379953317703796,"score_spread":0.2613279296651217,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386022565","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022926268,0.000058120677,0.9972494,0.000047744932,0.000009539893,0.000015812668,0.00003666524,0.00015260014,0.00013747165],"genre_scores_gemma":[0.14808157,0.00048218548,0.8466378,0.00016770157,0.00015060423,0.00044837702,0.00067143864,0.00041415318,0.0029461663],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9981292,0.0010135693,0.000060541544,0.00037914616,0.00033576455,0.00008173744],"domain_scores_gemma":[0.9961999,0.0019909379,0.0004692776,0.0006654642,0.00058682787,0.0000876242],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032714738,0.001586191,0.0012829059,0.0009558139,0.0004968072,0.00094253157,0.001969117,0.0011398455,0.0020303696],"category_scores_gemma":[0.01051332,0.00077217794,0.0013050771,0.001412943,0.0013427275,0.0014176503,0.0015159776,0.002299478,0.001080605],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000233753,0.00017707006,0.0030493494,0.0004247775,0.00038482374,0.00020248242,0.00026583977,0.6147063,0.026131341,0.08121226,0.0059247958,0.26728728],"study_design_scores_gemma":[0.0000104480405,0.00002598622,0.0004601674,0.0000101203805,0.000014771777,0.00003504774,0.000009028929,0.9770039,0.0020493863,0.019160522,0.0012001265,0.000020548208],"about_ca_topic_score_codex":0.002018547,"about_ca_topic_score_gemma":0.0031943927,"teacher_disagreement_score":0.0032714738,"about_ca_system_score_codex":0.0005065343,"about_ca_system_score_gemma":0.0016471298,"threshold_uncertainty_score":0.01730144},"labels":[],"label_agreement":null},{"id":"W4386608500","doi":"10.1080/10618600.2023.2257258","title":"Clustering Sequence Data with Mixture Markov Chains with Covariates Using Multiple Simplex Constrained Optimization Routine (MSiCOR)","year":2023,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Institute of Neurological Disorders and Stroke","keywords":"Expectation–maximization algorithm; Cluster analysis; Computer science; Covariate; Context (archaeology); Maximization; Simplex; Markov chain; Mixture model; Mathematical optimization; Data mining; Artificial intelligence; Machine learning; Mathematics; Statistics; Maximum likelihood","score_opus":0.04511387327722369,"score_gpt":0.30332949743915777,"score_spread":0.2582156241619341,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386608500","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0021530373,0.000056237666,0.99686277,0.00004920527,0.000009198459,0.000058900154,0.00009498468,0.000590242,0.00012540694],"genre_scores_gemma":[0.049482916,0.00012993794,0.94808966,0.000067267705,0.000029197068,0.00047253832,0.00081246806,0.00026392515,0.0006520618],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99808794,0.0009890478,0.00012806464,0.0004328986,0.0002732848,0.0000887859],"domain_scores_gemma":[0.9960337,0.0026238372,0.00037958077,0.00039851447,0.00043807007,0.00012627672],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004240816,0.0013822418,0.0020024173,0.0017679099,0.00090185524,0.0014275931,0.002042726,0.001433311,0.0032039294],"category_scores_gemma":[0.012488146,0.0012066845,0.00228578,0.0020471683,0.00083654973,0.001559319,0.0022355958,0.0029008137,0.0012914379],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002405691,0.00009588297,0.002810937,0.00025480066,0.00027278933,0.00015963336,0.0002513144,0.8171959,0.0030727221,0.038003657,0.003937387,0.13370435],"study_design_scores_gemma":[0.000011614252,0.000012752014,0.00013548537,0.00000943322,0.0000083337,0.000024940746,0.000009189347,0.98833734,0.0005375664,0.010154782,0.0007456889,0.000012808824],"about_ca_topic_score_codex":0.0091264825,"about_ca_topic_score_gemma":0.01082752,"teacher_disagreement_score":0.0091264825,"about_ca_system_score_codex":0.0011589117,"about_ca_system_score_gemma":0.0038495956,"threshold_uncertainty_score":0.022427797},"labels":[],"label_agreement":null},{"id":"W4389126399","doi":"10.1080/10618600.2023.2289532","title":"Model-Based Smoothing with Integrated Wiener Processes and Overlapping Splines","year":2023,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Probabilistic and Robust Engineering Design","field":"Decision Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Centre for Global Health Research; St. Michael's Hospital; University of Waterloo; University of Toronto","funders":"","keywords":"Smoothing; Computer science; Smoothing spline; Econometrics; Mathematics; Mathematical optimization; Algorithm; Statistics","score_opus":0.05858149059133981,"score_gpt":0.31366986845052763,"score_spread":0.2550883778591878,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389126399","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004986782,0.00010245794,0.9944811,0.000055399516,0.000012077672,0.000006872108,0.000017739623,0.00006443996,0.00027308703],"genre_scores_gemma":[0.50511456,0.0008583098,0.48994058,0.00013943893,0.00012637433,0.00015429388,0.00027007362,0.000121822064,0.0032745842],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9973888,0.0011908242,0.00013263183,0.00048987765,0.0006219048,0.00017586738],"domain_scores_gemma":[0.99425125,0.003952774,0.00061786134,0.00067899964,0.0003939516,0.000105110026],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007363034,0.00088032143,0.001445828,0.001524033,0.0005563094,0.0014251677,0.0020043536,0.0016676553,0.0012212697],"category_scores_gemma":[0.019019952,0.0008255096,0.0018368746,0.0017705695,0.001847127,0.0023717834,0.0018766408,0.0023722267,0.00029266466],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000076390614,0.000034744222,0.0020452891,0.00008050602,0.00009486905,0.00009193304,0.00016443318,0.76716167,0.0014423628,0.18648055,0.00039245994,0.04193485],"study_design_scores_gemma":[0.0000061113114,0.000023460228,0.00026219783,0.000014377404,0.000011403918,0.0000211937,0.000009592316,0.95156413,0.00037444552,0.04719172,0.00050652475,0.000014811682],"about_ca_topic_score_codex":0.0057290187,"about_ca_topic_score_gemma":0.00427896,"teacher_disagreement_score":0.007363034,"about_ca_system_score_codex":0.0008495071,"about_ca_system_score_gemma":0.0014265786,"threshold_uncertainty_score":0.038939953},"labels":[],"label_agreement":null},{"id":"W4389312611","doi":"10.1080/10618600.2023.2285337","title":"Smooth Multi-Period Forecasting With Application to Prediction of COVID-19 Cases","year":2023,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Forecasting Techniques and Applications","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Institute of Biomedical Imaging and Bioengineering; National Institute of General Medical Sciences; Natural Sciences and Engineering Research Council of Canada; National Institutes of Health; National Science Foundation","keywords":"Coronavirus disease 2019 (COVID-19); Period (music); Econometrics; 2019-20 coronavirus outbreak; Severe acute respiratory syndrome coronavirus 2 (SARS-CoV-2); Computer science; Statistics; Mathematics; Virology; Medicine; Infectious disease (medical specialty)","score_opus":0.14253342998563678,"score_gpt":0.3946894444252252,"score_spread":0.2521560144395884,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4389312611","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.32511297,0.0022937602,0.66609764,0.0022397623,0.00016695172,0.00006869731,0.0011134824,0.00078459043,0.0021220755],"genre_scores_gemma":[0.9540625,0.00053058256,0.043677278,0.0000660796,0.000108761335,0.000040869523,0.0007623911,0.000047755802,0.00070390693],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99916697,0.0004517642,0.000044036162,0.00015589276,0.0001092605,0.00007216101],"domain_scores_gemma":[0.98750764,0.009831071,0.0009760041,0.00085713906,0.0005365661,0.00029155373],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0054771835,0.0005613305,0.0010544322,0.0012958866,0.00035833995,0.00096023805,0.0012388829,0.0011362333,0.001315305],"category_scores_gemma":[0.019534947,0.00030919822,0.0006580932,0.001777705,0.00060470647,0.0008915985,0.0010452245,0.0020781949,0.00016151823],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001007279,0.000022367876,0.0059268107,0.000042930904,0.00003708217,0.000112248315,0.00005144452,0.95837736,0.00024450367,0.009036483,0.0009377902,0.025110207],"study_design_scores_gemma":[0.0000052150535,0.000014559625,0.0008633428,0.00000449534,0.000004439232,0.000009015,0.000011431207,0.9927142,0.00010204802,0.006047172,0.00021785489,0.000006199612],"about_ca_topic_score_codex":0.0108089205,"about_ca_topic_score_gemma":0.005884624,"teacher_disagreement_score":0.0108089205,"about_ca_system_score_codex":0.00068255264,"about_ca_system_score_gemma":0.0006258398,"threshold_uncertainty_score":0.028966486},"labels":[],"label_agreement":null},{"id":"W4390618520","doi":"10.1080/10618600.2024.2302528","title":"A Bayesian Collocation Integral Method for Parameter Estimation in Ordinary Differential Equations","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Gaussian Processes and Bayesian Inference","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Natural Sciences and Engineering Research Council of Canada; Discovery Eye Foundation","keywords":"Ode; Ordinary differential equation; Collocation (remote sensing); Collocation method; Applied mathematics; Nonlinear system; Bayesian probability; Computer science; Orthogonal collocation; Mathematics; Mathematical optimization; Bayes estimator; Estimation theory; Gaussian; Basis (linear algebra); Numerical integration; Algorithm; Differential equation; Mathematical analysis; Artificial intelligence; Machine learning","score_opus":0.01458855396392059,"score_gpt":0.3136028009829331,"score_spread":0.29901424701901247,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4390618520","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0007306584,0.00016565356,0.99864894,0.000058955968,0.000017734099,0.0000126925925,0.000026804493,0.000077021665,0.00026161366],"genre_scores_gemma":[0.111222275,0.0010598375,0.8831193,0.00027190728,0.00013776332,0.00033047778,0.00040132707,0.00033976807,0.0031172761],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9990854,0.00040421492,0.000046541027,0.000132736,0.00028249554,0.000048600872],"domain_scores_gemma":[0.99713707,0.0020091264,0.0002226277,0.00013707351,0.0004059724,0.000088134584],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0031395033,0.0009623157,0.001415254,0.0011514846,0.00066459365,0.00093309325,0.0017601363,0.001835431,0.0029204213],"category_scores_gemma":[0.008888192,0.0007374349,0.0011230059,0.0011815537,0.0011746824,0.0012378071,0.0017298821,0.002424799,0.00086703576],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000111526395,0.00006135353,0.0011316655,0.00028050863,0.00014576002,0.00015842603,0.00019107568,0.7992828,0.0047132387,0.10358511,0.0033483505,0.08699021],"study_design_scores_gemma":[0.0000063215584,0.0000075489206,0.000072522285,0.00001607297,0.0000071860836,0.000013726979,0.0000051052007,0.9874665,0.00026493947,0.010872992,0.0012555632,0.000011502949],"about_ca_topic_score_codex":0.009744392,"about_ca_topic_score_gemma":0.008518134,"teacher_disagreement_score":0.009744392,"about_ca_system_score_codex":0.0010060014,"about_ca_system_score_gemma":0.0021630402,"threshold_uncertainty_score":0.019375384},"labels":[],"label_agreement":null},{"id":"W4392033304","doi":"10.1080/10618600.2024.2322561","title":"Hammock Plots: Visualizing Categorical and Numerical Variables","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Categorical variable; Mathematics; Statistics; Econometrics; Computer science; Artificial intelligence","score_opus":0.015345263605094658,"score_gpt":0.30025821888867443,"score_spread":0.2849129552835798,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392033304","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005256374,0.0018328999,0.9632043,0.002391813,0.0010048464,0.00022973791,0.005751031,0.010777066,0.00955195],"genre_scores_gemma":[0.07994742,0.0030027367,0.89123994,0.0019705673,0.0009564949,0.0010615515,0.007553078,0.0049836435,0.009284522],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9965056,0.0016048892,0.0003214554,0.0005012568,0.00085694384,0.00020987158],"domain_scores_gemma":[0.9864563,0.008270026,0.0013476821,0.0012136592,0.0022711067,0.00044135962],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004652537,0.0011556213,0.00077423657,0.004750939,0.0009081985,0.0056089084,0.0022983742,0.0013566111,0.027138622],"category_scores_gemma":[0.036259178,0.0006428368,0.0015546245,0.0062039196,0.0010487755,0.005790271,0.0033087991,0.0023879702,0.007243193],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024081589,0.00011830329,0.009450333,0.0012215093,0.00024742444,0.00043722554,0.0033671164,0.011291729,0.005394195,0.3194258,0.26710796,0.38169754],"study_design_scores_gemma":[0.000095560405,0.00016117556,0.004144895,0.0008575465,0.00014215597,0.0012344609,0.0015793949,0.08754497,0.008552708,0.3654754,0.52993876,0.00027300624],"about_ca_topic_score_codex":0.0030283877,"about_ca_topic_score_gemma":0.00338045,"teacher_disagreement_score":0.027138622,"about_ca_system_score_codex":0.0006043029,"about_ca_system_score_gemma":0.0013760213,"threshold_uncertainty_score":0.09078771},"labels":[],"label_agreement":null},{"id":"W4396688170","doi":"10.1080/10618600.2024.2350476","title":"Variance-Reduced Stochastic Optimization for Efficient Inference of Hidden Markov Models","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Marine animal studies overview","field":"Environmental Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Fisheries and Oceans Canada; Dalhousie University; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Fisheries and Oceans Canada; Canada Foundation for Innovation","keywords":"Hidden Markov model; Inference; Algorithm; Data set; Computer science; Set (abstract data type); Computation; Variance (accounting); Expectation–maximization algorithm; Statistical inference; Mathematical optimization; Mathematics; Artificial intelligence; Statistics; Maximum likelihood","score_opus":0.017910052971675323,"score_gpt":0.26792845352503847,"score_spread":0.25001840055336316,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4396688170","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0014893739,0.000108107764,0.997426,0.00007880887,0.000012017552,0.000024495706,0.00004555595,0.0005493394,0.0002662779],"genre_scores_gemma":[0.09288128,0.00024243031,0.9036992,0.00018323734,0.0000689448,0.0004413938,0.0006446382,0.0006365352,0.0012022696],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9976291,0.0013536992,0.00015948665,0.0004122846,0.00032327895,0.00012224696],"domain_scores_gemma":[0.99121606,0.0075244806,0.00030972555,0.0004266715,0.00041201446,0.00011105432],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0042926692,0.0014308889,0.0019504218,0.0013222591,0.00077528233,0.0011151045,0.002343723,0.0015560716,0.004159219],"category_scores_gemma":[0.021128476,0.0015968955,0.0017762656,0.0014504001,0.0012273238,0.0014630348,0.0021719248,0.0035769462,0.0014779874],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006708265,0.00005553016,0.00070868706,0.000112091446,0.00009427441,0.00006985025,0.00008483034,0.9064433,0.0010574653,0.02578977,0.001985001,0.06353207],"study_design_scores_gemma":[0.0000061274154,0.000006002858,0.00004090173,0.0000054979246,0.000003121976,0.000005592777,0.0000032947323,0.9919356,0.00017452463,0.0075481394,0.00026707602,0.000004129609],"about_ca_topic_score_codex":0.014554513,"about_ca_topic_score_gemma":0.017437974,"teacher_disagreement_score":0.014554513,"about_ca_system_score_codex":0.0015603543,"about_ca_system_score_gemma":0.0033591269,"threshold_uncertainty_score":0.028939545},"labels":[],"label_agreement":null},{"id":"W4398162108","doi":"10.1080/10618600.2024.2335182","title":"Dynamic Survival Prediction Using Sparse Longitudinal Images via Multi-Dimensional Functional Principal Component Analysis","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Principal component analysis; Functional principal component analysis; Component (thermodynamics); Computer science; Pattern recognition (psychology); Artificial intelligence; Mathematics; Algorithm","score_opus":0.09073121337460423,"score_gpt":0.36224534566664,"score_spread":0.2715141322920358,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398162108","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041829344,0.00030505125,0.9562601,0.000618742,0.00003451599,0.000032974232,0.0001879956,0.00037449357,0.0003568608],"genre_scores_gemma":[0.8053156,0.0006872769,0.19040696,0.000195722,0.00019355395,0.00019757297,0.0008270901,0.00010242739,0.0020737187],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9994005,0.00028365653,0.00002385221,0.00013791605,0.00009189661,0.000062235056],"domain_scores_gemma":[0.99685436,0.0020959754,0.0003546316,0.00029505155,0.0002625179,0.00013755026],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.002691151,0.0008225529,0.0008956041,0.0010760593,0.00039244,0.0008586891,0.0012251146,0.0008358749,0.0010920911],"category_scores_gemma":[0.0080725765,0.00046972072,0.0008821608,0.0009476163,0.0007823902,0.0011499407,0.0009761368,0.0019236798,0.00029755846],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002703481,0.000115242074,0.011619224,0.00007913058,0.000103590195,0.00022593707,0.00013097326,0.8494308,0.0025051336,0.022433147,0.0026616878,0.110424876],"study_design_scores_gemma":[0.0000057481825,0.000015362672,0.00039655465,0.000003434885,0.000005728361,0.000017456918,0.0000048346606,0.9935841,0.00018586345,0.005613193,0.000160559,0.000007111331],"about_ca_topic_score_codex":0.0059764087,"about_ca_topic_score_gemma":0.0054343296,"teacher_disagreement_score":0.0059764087,"about_ca_system_score_codex":0.0005792224,"about_ca_system_score_gemma":0.001134283,"threshold_uncertainty_score":0.0142323375},"labels":[],"label_agreement":null},{"id":"W4398183818","doi":"10.1080/10618600.2024.2358156","title":"Nonparametric High-Dimensional Multi-Sample Tests based on Graph Theory","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Nonparametric statistics; Computer science; Sample (material); Mathematics; Econometrics; Statistics","score_opus":0.0543335384810146,"score_gpt":0.3573869778430195,"score_spread":0.3030534393620049,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4398183818","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.033592477,0.00031962618,0.9632387,0.00030845747,0.00007072235,0.00014994356,0.00039778044,0.00075822475,0.0011640502],"genre_scores_gemma":[0.6710544,0.00024715575,0.32491472,0.00034502518,0.00020191878,0.00094132154,0.0011918397,0.00028789564,0.0008156063],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.972801,0.020074397,0.0007542805,0.002824553,0.0030486097,0.0004971152],"domain_scores_gemma":[0.7653046,0.20742965,0.0072990702,0.015634527,0.0031182345,0.001213955],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.021220598,0.00096453883,0.0021793926,0.004237527,0.0011703003,0.0021327306,0.0033920233,0.0018908934,0.0041042166],"category_scores_gemma":[0.14128405,0.00042966777,0.0020651263,0.0037444918,0.005413425,0.004270061,0.0026109,0.0035804983,0.0006266327],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014257585,0.00044467952,0.046155076,0.0009703773,0.0020482792,0.0011972183,0.00066220097,0.25326544,0.006327018,0.40371883,0.0088318465,0.27495322],"study_design_scores_gemma":[0.00015805103,0.00053304696,0.009818841,0.000073977695,0.00011576589,0.0005687854,0.00014753826,0.6931804,0.0030682096,0.2896841,0.0025570057,0.000094263065],"about_ca_topic_score_codex":0.0009326436,"about_ca_topic_score_gemma":0.0008469316,"teacher_disagreement_score":0.021220598,"about_ca_system_score_codex":0.0012342964,"about_ca_system_score_gemma":0.0014833495,"threshold_uncertainty_score":0.112226546},"labels":[],"label_agreement":null},{"id":"W4399203487","doi":"10.1080/10618600.2024.2362219","title":"Iterated Data Sharpening","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia, Okanagan Campus; University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Foundation for Innovation","keywords":"Sharpening; Computer science; Artificial intelligence; Mathematics; Algorithm","score_opus":0.14548908453833034,"score_gpt":0.41053536403263885,"score_spread":0.2650462794943085,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4399203487","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010966394,0.0001750685,0.9872185,0.00006487834,0.00003262907,0.000072704315,0.00006765984,0.0009037953,0.00049841753],"genre_scores_gemma":[0.19504198,0.00022790198,0.80151427,0.0002161312,0.000047437807,0.00033549554,0.0005289713,0.000529018,0.0015588427],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9947865,0.0022140678,0.0004716118,0.0010747208,0.0011774322,0.00027557556],"domain_scores_gemma":[0.97652507,0.012823116,0.0015402737,0.0053849425,0.003423371,0.00030320894],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008750247,0.0014195335,0.0020667,0.0022166956,0.00084531796,0.0019047953,0.003076048,0.0020690449,0.00423743],"category_scores_gemma":[0.0442387,0.0009518412,0.0022995851,0.001669801,0.0018283857,0.002554261,0.0040315874,0.00340561,0.0019360874],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00082266453,0.00031909437,0.0064638094,0.0010286367,0.00049385603,0.00040917587,0.0011766864,0.24138425,0.047108825,0.058891557,0.0041834903,0.63771796],"study_design_scores_gemma":[0.0000953326,0.00030711864,0.002121704,0.00013195342,0.00013719308,0.00036047318,0.00014376204,0.9120208,0.045495633,0.03082477,0.008237676,0.00012358646],"about_ca_topic_score_codex":0.0018269653,"about_ca_topic_score_gemma":0.0018478059,"teacher_disagreement_score":0.008750247,"about_ca_system_score_codex":0.0008557066,"about_ca_system_score_gemma":0.0016757431,"threshold_uncertainty_score":0.04627627},"labels":[],"label_agreement":null},{"id":"W4402469547","doi":"10.1080/10618600.2024.2402279","title":"Optimal Subsampling for Functional Quasi-Mode Regression with Big Data","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Control Systems and Identification","field":"Engineering","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Computer science; Regression analysis; Regression; Statistics; Big data; Mathematics; Econometrics; Artificial intelligence; Data mining","score_opus":0.038850709364129446,"score_gpt":0.27642046494984607,"score_spread":0.23756975558571664,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402469547","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0031544333,0.00005543795,0.9964217,0.00006412468,0.000013084573,0.000020010892,0.000024654508,0.0001077027,0.00013883095],"genre_scores_gemma":[0.21434431,0.00032497558,0.78267914,0.00023278553,0.00010203562,0.00036865388,0.00043196278,0.00024231065,0.0012738011],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9980221,0.0011218943,0.00008129041,0.00034568724,0.00033016125,0.000098954246],"domain_scores_gemma":[0.9922672,0.00526442,0.000558958,0.0010417057,0.0007089164,0.0001589276],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.007101917,0.0011802887,0.0013546816,0.000858996,0.0005131099,0.0010961628,0.002401106,0.0011653628,0.002112207],"category_scores_gemma":[0.0217399,0.00070554944,0.001143498,0.000759739,0.001284713,0.0021183144,0.0018740187,0.0016788065,0.00048110026],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027220137,0.00016283838,0.0051368736,0.0003831371,0.00021432091,0.0002285328,0.00025198184,0.7089184,0.010057529,0.13153005,0.0028129136,0.14003114],"study_design_scores_gemma":[0.0000071931127,0.000025003159,0.00024126793,0.000009047094,0.0000058336773,0.000017323693,0.000009217713,0.9852401,0.0008206047,0.013149874,0.00046487316,0.000009576243],"about_ca_topic_score_codex":0.0032074507,"about_ca_topic_score_gemma":0.0034067722,"teacher_disagreement_score":0.007101917,"about_ca_system_score_codex":0.0006569232,"about_ca_system_score_gemma":0.0016423567,"threshold_uncertainty_score":0.037559032},"labels":[],"label_agreement":null},{"id":"W4402469571","doi":"10.1080/10618600.2024.2402280","title":"Efficient Convex PCA with Applications to Wasserstein GPCA and Ranked Data","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"University of Toronto","keywords":"Mathematics; Regular polygon; Artificial intelligence; Computer science; Statistics; Data mining; Econometrics; Geometry","score_opus":0.07815119831874055,"score_gpt":0.375214006851606,"score_spread":0.29706280853286543,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4402469571","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0028310386,0.0001780607,0.99607533,0.00016701095,0.000018427347,0.000022248852,0.000042698186,0.00017058763,0.000494589],"genre_scores_gemma":[0.19252175,0.00076673744,0.8023445,0.0002553534,0.00016125562,0.0002916799,0.0005338502,0.00029055538,0.0028343962],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9976107,0.0011418284,0.00015978939,0.00030612532,0.000639949,0.00014157892],"domain_scores_gemma":[0.9951255,0.0029492476,0.00024243115,0.0007299726,0.0007987345,0.00015410582],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0038654616,0.001279385,0.0016042887,0.0012781029,0.0005917185,0.0017933086,0.0017818725,0.001540383,0.0023449366],"category_scores_gemma":[0.018178497,0.0007912642,0.0011924839,0.0022241836,0.00174843,0.002305542,0.002917332,0.0026986212,0.0006514644],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008275878,0.000064472275,0.00071154616,0.00013124126,0.00008855837,0.00016453401,0.00011804647,0.70463514,0.0026090029,0.16300407,0.0027853244,0.12560523],"study_design_scores_gemma":[0.0000056159442,0.000010288444,0.000084467116,0.000005869725,0.0000034107966,0.000018428536,0.0000068939685,0.96655756,0.00034986212,0.032387633,0.000562381,0.000007639112],"about_ca_topic_score_codex":0.008064943,"about_ca_topic_score_gemma":0.009373939,"teacher_disagreement_score":0.008064943,"about_ca_system_score_codex":0.0010544645,"about_ca_system_score_gemma":0.0023679514,"threshold_uncertainty_score":0.020442784},"labels":[],"label_agreement":null},{"id":"W4403839440","doi":"10.1080/10618600.2024.2421248","title":"Multi-label Random Subspace Ensemble Classification","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Text and Document Classification Technologies","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"York University; National Institute on Aging; National Institutes of Health; National Science Foundation","keywords":"Random forest; Random subspace method; Computer science; Classifier (UML); Subspace topology; Artificial intelligence; Ensemble learning; Linear subspace; Machine learning; Pattern recognition (psychology); Multinomial distribution; Multi-label classification; Data mining; Algorithm; Mathematics; Statistics","score_opus":0.03378278262940175,"score_gpt":0.30295361300985085,"score_spread":0.2691708303804491,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403839440","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011290608,0.000721577,0.98508793,0.0001758834,0.000114898765,0.000058689362,0.00017037956,0.00094695314,0.0014330515],"genre_scores_gemma":[0.448824,0.0006905093,0.5410928,0.00047789555,0.00044412163,0.00028758423,0.0022307222,0.00027441204,0.0056778733],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99730945,0.0010641029,0.000094696676,0.0005127472,0.0007966267,0.00022229805],"domain_scores_gemma":[0.99680567,0.0011754108,0.00020049127,0.0006986216,0.00097540556,0.00014436863],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0032729418,0.0010820079,0.002353039,0.0017755056,0.0007871704,0.0013156183,0.0022762117,0.0014242899,0.0022939064],"category_scores_gemma":[0.0058515775,0.00031750937,0.0014150707,0.0015616049,0.00053641084,0.002838686,0.0015482265,0.0018309862,0.0015695542],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021283256,0.00026897294,0.0041040634,0.00011570093,0.00022222524,0.000099525125,0.00012225231,0.32544717,0.002816277,0.013495817,0.011876986,0.6412181],"study_design_scores_gemma":[0.000005633073,0.0000259091,0.00019912644,0.000008077221,0.000011682212,0.000030658473,0.0000140679385,0.9915706,0.000895559,0.005731257,0.001496426,0.00001095117],"about_ca_topic_score_codex":0.0027070348,"about_ca_topic_score_gemma":0.0038872024,"teacher_disagreement_score":0.0032729418,"about_ca_system_score_codex":0.000605804,"about_ca_system_score_gemma":0.0008577617,"threshold_uncertainty_score":0.01730913},"labels":[],"label_agreement":null},{"id":"W4405429052","doi":"10.1080/10618600.2024.2441988","title":"Efficient Estimation of Parameters in Marginals in Semiparametric Multivariate Models","year":2024,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Financial Risk and Volatility Modeling","field":"Economics, Econometrics and Finance","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Brock University","funders":"Russian Science Foundation","keywords":"Copula (linguistics); Estimator; Mathematics; Univariate; Multivariate statistics; Joint probability distribution; Parametric statistics; Econometrics; Applied mathematics; Statistics","score_opus":0.033567515912302594,"score_gpt":0.2660289044829378,"score_spread":0.23246138857063522,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405429052","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01130141,0.00015722546,0.98787093,0.00013996703,0.0000047966582,0.000014494395,0.00006479109,0.00019149661,0.0002548747],"genre_scores_gemma":[0.56739616,0.0008704135,0.42885053,0.0001782401,0.00006756765,0.00017441796,0.00063969416,0.0002530119,0.0015699661],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9974456,0.001711486,0.00009723179,0.00027719713,0.00032044767,0.00014800916],"domain_scores_gemma":[0.98478556,0.012127047,0.0008774823,0.0015486887,0.0004316529,0.0002295449],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069829435,0.00095625105,0.0016695847,0.001253412,0.00038728776,0.0018804183,0.002010276,0.0014145965,0.0021476673],"category_scores_gemma":[0.034163445,0.0011052792,0.0012147485,0.001174392,0.0018073983,0.0037375502,0.003249985,0.00246255,0.0005496494],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012973249,0.00006282176,0.003710132,0.00019791165,0.00012181405,0.00020013574,0.00020425013,0.77304757,0.0020811707,0.1562037,0.001034217,0.06300658],"study_design_scores_gemma":[0.000008709355,0.000013481339,0.0003734937,0.000021200953,0.000008707694,0.000038636383,0.000014618094,0.9146502,0.0005845553,0.0838371,0.0004348185,0.000014532524],"about_ca_topic_score_codex":0.0020397399,"about_ca_topic_score_gemma":0.0021187651,"teacher_disagreement_score":0.0069829435,"about_ca_system_score_codex":0.00083676615,"about_ca_system_score_gemma":0.0010503383,"threshold_uncertainty_score":0.036929727},"labels":[],"label_agreement":null},{"id":"W4406049757","doi":"10.1080/10618600.2024.2446357","title":"Bayesian Partial Reduced-Rank Regression","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Memorial University of Newfoundland","funders":"Natural Sciences and Engineering Research Council of Canada; Consejo Nacional de Ciencia y Tecnología; Università degli Studi di Milano","keywords":"Mathematics; Rank (graph theory); Dimensionality reduction; Regression; Regression analysis; Bayesian probability; Statistics; Curse of dimensionality; Artificial intelligence; Computer science; Combinatorics","score_opus":0.0409694983498707,"score_gpt":0.3722382201307923,"score_spread":0.3312687217809216,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406049757","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0069356216,0.00044003292,0.99023813,0.00030740173,0.00003672483,0.00005342891,0.00042468958,0.00034282645,0.0012210344],"genre_scores_gemma":[0.3748266,0.0017286205,0.6057798,0.00074421347,0.0003503081,0.00054324145,0.0033547273,0.00048547605,0.012187011],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9936289,0.0038102998,0.00022602196,0.001069494,0.00088919816,0.0003760957],"domain_scores_gemma":[0.9885168,0.00678626,0.0009568859,0.0019985065,0.0014789506,0.00026266562],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.006762797,0.0013373157,0.0027537253,0.0013204858,0.0007688646,0.0023556757,0.002758084,0.0017290184,0.005901516],"category_scores_gemma":[0.027887534,0.00087316596,0.0017952396,0.0022199294,0.0017905053,0.0021572781,0.0021865447,0.0025081972,0.0023290396],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043919665,0.00015096882,0.0059344014,0.00054225477,0.0004959657,0.0003027093,0.00038345935,0.49401715,0.0028364768,0.24369368,0.013221676,0.23798202],"study_design_scores_gemma":[0.00002925184,0.000042205244,0.0010380038,0.000040988263,0.000040808613,0.00007390788,0.000027649327,0.90195227,0.0006650898,0.09228838,0.0037649907,0.000036461068],"about_ca_topic_score_codex":0.006117882,"about_ca_topic_score_gemma":0.006432258,"teacher_disagreement_score":0.006762797,"about_ca_system_score_codex":0.0011020147,"about_ca_system_score_gemma":0.0026737067,"threshold_uncertainty_score":0.03576553},"labels":[],"label_agreement":null},{"id":"W4406096298","doi":"10.1080/10618600.2024.2449074","title":"Simultaneous Estimation of Multiple Treatment Effects from Observational Studies","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Canadian Statistical Sciences Institute; Natural Sciences and Engineering Research Council of Canada","keywords":"Causal inference; Instrumental variable; Observational study; Inference; Confounding; Proxy (statistics); Robustness (evolution); Marginal structural model; Computer science; Econometrics; Exploit; Machine learning; Statistics; Mathematics; Data mining; Artificial intelligence","score_opus":0.11160337066313168,"score_gpt":0.42757067412792427,"score_spread":0.31596730346479257,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406096298","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0061812876,0.0020580213,0.98847055,0.0013983753,0.00015745928,0.00032825346,0.00053125684,0.00017046739,0.000704365],"genre_scores_gemma":[0.33163235,0.0044659674,0.6547704,0.0022481494,0.0010077528,0.0022961397,0.0016508439,0.00011847925,0.0018098868],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93459207,0.052804183,0.0024216897,0.0059815706,0.0036003836,0.0006000714],"domain_scores_gemma":[0.765545,0.20635985,0.009546893,0.015478898,0.0023372215,0.00073203765],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06388178,0.0013291017,0.004271551,0.0031540375,0.0011630866,0.0034436896,0.0038054974,0.003154507,0.0044113505],"category_scores_gemma":[0.17412154,0.0016109647,0.004855346,0.004841257,0.0035277156,0.0031988155,0.0044228653,0.006248257,0.00055165385],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011536842,0.00034944777,0.040029816,0.005625765,0.008023242,0.0013289883,0.001467003,0.10220194,0.0027452558,0.4733603,0.0075560333,0.35615847],"study_design_scores_gemma":[0.00050718174,0.0002580172,0.007930231,0.00064791506,0.001981964,0.00043264462,0.00016529075,0.14545035,0.001415591,0.83005065,0.011065319,0.00009486329],"about_ca_topic_score_codex":0.0032198832,"about_ca_topic_score_gemma":0.003506966,"teacher_disagreement_score":0.93611825,"about_ca_system_score_codex":0.0014540076,"about_ca_system_score_gemma":0.004456287,"threshold_uncertainty_score":0.33784312},"labels":[],"label_agreement":null},{"id":"W4406097138","doi":"10.1080/10618600.2024.2447478","title":"Stochastic Gradient Descent-based Inference for Dynamic Network Models with Attractors","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Opinion Dynamics and Social Influence","field":"Physics and Astronomy","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Division of Mathematical Sciences; Division of Social and Economic Sciences; Natural Sciences and Engineering Research Council of Canada","keywords":"Computer science; Inference; Attractor; Node (physics); Gradient descent; Stochastic gradient descent; Markov chain Monte Carlo; Scaling; Limit (mathematics); Theoretical computer science; Mathematical optimization; Artificial intelligence; Artificial neural network; Mathematics","score_opus":0.009910994604382018,"score_gpt":0.2840213263491029,"score_spread":0.2741103317447209,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406097138","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016051112,0.00036700803,0.98153114,0.0005426909,0.00004917819,0.000052447303,0.00022787481,0.0004194582,0.0007589607],"genre_scores_gemma":[0.644229,0.0006527376,0.34622264,0.0005289076,0.0002557286,0.00059891597,0.0019068113,0.0004057232,0.005199566],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9984023,0.0009620967,0.00007193855,0.00030978664,0.00014932406,0.00010456819],"domain_scores_gemma":[0.9836394,0.014021391,0.00075328274,0.00056241266,0.0007359765,0.0002874614],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0047215256,0.0012976101,0.00214526,0.0017299752,0.0009412084,0.0015343035,0.0027218123,0.0016829098,0.0025346375],"category_scores_gemma":[0.02430578,0.0012417318,0.0012065787,0.001547948,0.0018336079,0.0023609363,0.0020437478,0.0029968312,0.00057523395],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000058785492,0.00004116824,0.0019389159,0.00007314794,0.00009094713,0.000072363815,0.00007834989,0.9328004,0.00023483,0.044793826,0.0016767946,0.018140417],"study_design_scores_gemma":[0.0000053088434,0.000003245636,0.0000544866,0.0000041990997,0.0000026453554,0.0000035073217,0.0000033077636,0.98533964,0.000029840165,0.014416675,0.00013432346,0.0000028948998],"about_ca_topic_score_codex":0.01891364,"about_ca_topic_score_gemma":0.02668477,"teacher_disagreement_score":0.01891364,"about_ca_system_score_codex":0.0022717803,"about_ca_system_score_gemma":0.0023422998,"threshold_uncertainty_score":0.037607074},"labels":[],"label_agreement":null},{"id":"W4406321275","doi":"10.1080/10618600.2025.2451680","title":"Variable Selection and Basis Learning for Ordinal Classification","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kootenay Association for Science & Technology","funders":"National Research Foundation of Korea","keywords":"Ordinal regression; Ordinal data; Linear discriminant analysis; Mathematics; Ordinal optimization; Basis (linear algebra); Dimension (graph theory); Feature selection; Variable (mathematics); Variables; Statistics; Artificial intelligence; Pattern recognition (psychology); Computer science; Combinatorics","score_opus":0.01272680945528477,"score_gpt":0.2700614872194298,"score_spread":0.25733467776414504,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406321275","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0026218,0.000060471077,0.9968143,0.000073179704,0.000019009114,0.000021755517,0.000038469403,0.00015978841,0.00019129223],"genre_scores_gemma":[0.19042991,0.00026075408,0.80518746,0.00020909043,0.00021894858,0.0005830975,0.00069013797,0.00015508496,0.00226561],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99637896,0.0019942594,0.0001491649,0.00045372557,0.0007967925,0.00022710186],"domain_scores_gemma":[0.9936737,0.0036499714,0.00040998202,0.00094956293,0.0011033916,0.0002134127],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004613365,0.0008698401,0.0014001003,0.0017940779,0.00072593044,0.0011945792,0.0023207413,0.0011908975,0.0035415308],"category_scores_gemma":[0.016730962,0.00042863848,0.0011225952,0.0021192974,0.0013139666,0.0014304358,0.0020837192,0.0028628665,0.0012715431],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00028435793,0.00023309208,0.0037798644,0.00023824588,0.00015944142,0.00011870567,0.00017410272,0.2543751,0.00607817,0.09575152,0.0065243277,0.63228303],"study_design_scores_gemma":[0.00001760276,0.000040740608,0.0003201772,0.0000136812,0.000009933692,0.00003135668,0.000011926923,0.96165735,0.00095039594,0.035803046,0.0011309979,0.000012853376],"about_ca_topic_score_codex":0.0014669305,"about_ca_topic_score_gemma":0.0014755039,"teacher_disagreement_score":0.004613365,"about_ca_system_score_codex":0.0006299819,"about_ca_system_score_gemma":0.0013671337,"threshold_uncertainty_score":0.024398148},"labels":[],"label_agreement":null},{"id":"W4406865792","doi":"10.1080/10618600.2025.2459287","title":"Online Kernel-Based Mode Learning","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Adaptive Filtering Techniques","field":"Engineering","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"","keywords":"Computer science; Artificial intelligence; Online learning; Kernel (algebra); Machine learning; Theoretical computer science; Mathematics; World Wide Web; Combinatorics","score_opus":0.007858430918642127,"score_gpt":0.27224090429068387,"score_spread":0.26438247337204174,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406865792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00396453,0.0000829677,0.9953459,0.000052737127,0.000014033779,0.000014321084,0.000032358024,0.00024857113,0.00024456016],"genre_scores_gemma":[0.4679994,0.00050973566,0.52578235,0.00022505707,0.00012696386,0.00024003671,0.000595285,0.00029968726,0.004221537],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9989956,0.0003410803,0.00006281398,0.0002475378,0.0002721493,0.00008090235],"domain_scores_gemma":[0.9958442,0.0022976378,0.00033794544,0.00075088756,0.000640519,0.00012882803],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0026753626,0.00072674546,0.0011182496,0.0006715782,0.0002901296,0.0010123715,0.0021183789,0.0008750666,0.0021227004],"category_scores_gemma":[0.012464359,0.0004024929,0.00078027416,0.00077949715,0.00070810143,0.0022512001,0.0016352291,0.0017371791,0.000867149],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030290516,0.00018414225,0.003771044,0.00023119654,0.00014269649,0.00011131648,0.00019144021,0.5554618,0.008965369,0.0522683,0.0041137957,0.37425607],"study_design_scores_gemma":[0.0000052299038,0.000020444564,0.0001671589,0.0000054244097,0.0000049055257,0.00002263309,0.000005475396,0.99108773,0.0010698775,0.0071466146,0.00045694495,0.000007593871],"about_ca_topic_score_codex":0.001698314,"about_ca_topic_score_gemma":0.0020239921,"teacher_disagreement_score":0.0026753626,"about_ca_system_score_codex":0.00057114504,"about_ca_system_score_gemma":0.0011969216,"threshold_uncertainty_score":0.014148891},"labels":[],"label_agreement":null},{"id":"W4408144537","doi":"10.1080/10618600.2025.2475139","title":"High-Dimensional Covariate-Dependent Gaussian Graphical Models","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Bayesian Methods and Mixture Models","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Covariate; Graphical model; Computer science; Gaussian; Econometrics; Mathematics; Statistics; Artificial intelligence","score_opus":0.01453389678061359,"score_gpt":0.2733778907991399,"score_spread":0.2588439940185263,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4408144537","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.009191671,0.00016696197,0.9886579,0.00038158777,0.000025129311,0.000042851054,0.00082536734,0.00026583325,0.00044281167],"genre_scores_gemma":[0.60217756,0.0012591373,0.38206363,0.0006963494,0.00026135903,0.0008905655,0.00418969,0.0002845927,0.00817713],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99747926,0.0012252091,0.00007752078,0.0007682609,0.0002766825,0.00017309841],"domain_scores_gemma":[0.9918093,0.005295443,0.0010091111,0.0010591876,0.0005835087,0.00024342895],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0050233896,0.0010611144,0.0017091231,0.0016674306,0.0006589188,0.0016922229,0.003909238,0.0026001562,0.0037727472],"category_scores_gemma":[0.016810564,0.00082000473,0.0018561798,0.0025158597,0.0017524417,0.0026796474,0.0018040335,0.0030050986,0.00094405987],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016810803,0.000075002594,0.0060998457,0.00013251534,0.00012658974,0.0002333695,0.0002617754,0.6277122,0.0021143996,0.32865942,0.0041474006,0.030269388],"study_design_scores_gemma":[0.000023178598,0.00002252876,0.000754055,0.000014395036,0.00002385139,0.00006156128,0.000016388925,0.89517015,0.00023473156,0.10171427,0.0019429137,0.00002203912],"about_ca_topic_score_codex":0.0067545734,"about_ca_topic_score_gemma":0.008772418,"teacher_disagreement_score":0.0067545734,"about_ca_system_score_codex":0.0014999228,"about_ca_system_score_gemma":0.0014028109,"threshold_uncertainty_score":0.026566565},"labels":[],"label_agreement":null},{"id":"W4409672286","doi":"10.1080/10618600.2025.2495780","title":"A Stability Framework for Parameter Selection in the Minimum Covariance Determinant Problem","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"U.S. Public Health Service","keywords":"Stability (learning theory); Covariance; Selection (genetic algorithm); Mathematics; Mathematical optimization; Computer science; Applied mathematics; Statistics; Artificial intelligence; Machine learning","score_opus":0.06944171784907366,"score_gpt":0.4137217667928977,"score_spread":0.344280048943824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409672286","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012384569,0.00010762184,0.99802375,0.00014124434,0.000011653592,0.000018505718,0.00003374099,0.00006620412,0.00035876973],"genre_scores_gemma":[0.31066686,0.0011192049,0.681045,0.0006277551,0.00043155364,0.00071839575,0.00095165987,0.00064240873,0.0037971996],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9958578,0.0024084314,0.00019446989,0.00064077333,0.0007387332,0.00015974276],"domain_scores_gemma":[0.98130345,0.014252691,0.00095117476,0.0010612877,0.0021006924,0.00033064673],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0077962154,0.0015555745,0.0016984215,0.0020749262,0.0010470554,0.0024396065,0.0019868957,0.0016119075,0.0031329796],"category_scores_gemma":[0.035755016,0.00086007785,0.0014421977,0.0015478624,0.0026564521,0.0027255595,0.0036385993,0.0031382425,0.0010459686],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001291989,0.00006712769,0.0026449817,0.00029502003,0.0001729509,0.000251794,0.00031897982,0.54632235,0.004028733,0.37197074,0.005602198,0.06819592],"study_design_scores_gemma":[0.000012834538,0.000041960364,0.0002014793,0.00002995816,0.000014538223,0.000057518264,0.000022532515,0.896678,0.0006616374,0.1005921,0.0016685826,0.000018931567],"about_ca_topic_score_codex":0.00243774,"about_ca_topic_score_gemma":0.0018442142,"teacher_disagreement_score":0.0077962154,"about_ca_system_score_codex":0.0011424604,"about_ca_system_score_gemma":0.0019654152,"threshold_uncertainty_score":0.041230798},"labels":[],"label_agreement":null},{"id":"W4413013076","doi":"10.1080/10618600.2025.2544182","title":"On Seeded Subgraph-to-Subgraph Matching: The ssSGM Algorithm and Matchability Information Theory","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Graph Theory and Algorithms","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Toronto Metropolitan University","funders":"","keywords":"Induced subgraph isomorphism problem; Subgraph isomorphism problem; Matching (statistics); Seeding; Algorithm; Computer science; Mathematics; Artificial intelligence; Combinatorics; Graph; Statistics; Line graph; Biology","score_opus":0.003457809734509369,"score_gpt":0.22857143812472058,"score_spread":0.2251136283902112,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413013076","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.010670344,0.0003634866,0.98588437,0.0006595709,0.00004015462,0.000109552035,0.00017358272,0.00020100205,0.0018980042],"genre_scores_gemma":[0.34191492,0.0011089348,0.64773947,0.00095468323,0.000439857,0.00088442344,0.001448629,0.00038719637,0.005121839],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99461234,0.0029918419,0.00018375916,0.0010701183,0.0008405813,0.00030129557],"domain_scores_gemma":[0.9702286,0.024134096,0.0016246386,0.0024170068,0.0010394355,0.00055625144],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008084517,0.001882228,0.0033495766,0.0034632012,0.0020080025,0.0021793593,0.005000538,0.0043693716,0.005228998],"category_scores_gemma":[0.050046388,0.0011454239,0.0019125566,0.005401313,0.0050282707,0.008235175,0.005285537,0.004141411,0.0012962858],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00025648437,0.00020649527,0.0015547924,0.00027601936,0.00013675292,0.00022652265,0.00026297645,0.39505515,0.0013055148,0.5285511,0.0071820784,0.064986154],"study_design_scores_gemma":[0.00003653034,0.000041944917,0.00016577929,0.000029803765,0.00001458523,0.00006753983,0.000029083085,0.6054608,0.0004183444,0.39267004,0.001046483,0.000018986804],"about_ca_topic_score_codex":0.0034034553,"about_ca_topic_score_gemma":0.0028743478,"teacher_disagreement_score":0.008084517,"about_ca_system_score_codex":0.0027017584,"about_ca_system_score_gemma":0.0030475003,"threshold_uncertainty_score":0.042755544},"labels":[],"label_agreement":null},{"id":"W4413165906","doi":"10.1080/10618600.2025.2541012","title":"Boosting Prediction with Data Missing Not at Random","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Face and Expression Recognition","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Boosting (machine learning); Missing data; Computer science; Artificial intelligence; Random forest; Machine learning; Econometrics; Statistics; Data mining; Mathematics","score_opus":0.02070957838485018,"score_gpt":0.2705212398444851,"score_spread":0.24981166145963493,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413165906","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064505474,0.00023990266,0.9922126,0.00018194421,0.000072351904,0.000037581132,0.00005874074,0.00027347778,0.00047277968],"genre_scores_gemma":[0.5189665,0.00071838684,0.4742151,0.00064241205,0.00044240215,0.00040199282,0.0008299971,0.000240699,0.0035424894],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99601597,0.0023492314,0.00016237267,0.0005716469,0.0006219769,0.00027881813],"domain_scores_gemma":[0.9818981,0.012764297,0.00084885105,0.0026057486,0.0015124731,0.0003705734],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0179755,0.0011388492,0.003330378,0.00077737676,0.00073190924,0.001408236,0.0031505644,0.0017866427,0.003102151],"category_scores_gemma":[0.03825467,0.00081482384,0.0013295467,0.001057559,0.0014148011,0.0018611487,0.0020786724,0.0029227312,0.0014082801],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00066832674,0.0001870145,0.007671131,0.00049571146,0.00026923668,0.0005305674,0.00028505837,0.6248094,0.0027396537,0.13688654,0.009799494,0.2156579],"study_design_scores_gemma":[0.000020279445,0.000035768713,0.0002950641,0.000023185114,0.000020740987,0.0000534172,0.000007931713,0.96959275,0.00052763114,0.028206361,0.0012062817,0.000010520968],"about_ca_topic_score_codex":0.0011986643,"about_ca_topic_score_gemma":0.0011652312,"teacher_disagreement_score":0.0179755,"about_ca_system_score_codex":0.000588503,"about_ca_system_score_gemma":0.0015831739,"threshold_uncertainty_score":0.09506464},"labels":[],"label_agreement":null},{"id":"W4414200196","doi":"10.1080/10618600.2025.2560626","title":"Semiparametric Estimation for Error-Prone Partially Linear Single-Index Models","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Statistical Methods and Inference","field":"Mathematics","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada; National Science and Technology Council","keywords":"Semiparametric model; Semiparametric regression; Estimation; Estimation theory; Linear model; Estimator; Expectation–maximization algorithm","score_opus":0.099807566370477,"score_gpt":0.38613352885231333,"score_spread":0.28632596248183634,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414200196","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0062702824,0.00013745751,0.99314004,0.000085075524,0.000008351371,0.000022165505,0.00005232985,0.00008842212,0.00019587076],"genre_scores_gemma":[0.5263528,0.0009670787,0.4681101,0.00025725376,0.00015023364,0.0004852363,0.0008139139,0.0001402328,0.0027230936],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.995282,0.00339135,0.00014716467,0.00049103005,0.0005081083,0.00018027794],"domain_scores_gemma":[0.97879773,0.01680761,0.0018525268,0.0015387865,0.00073483505,0.00026840816],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009872661,0.00093100686,0.002081544,0.0010945095,0.00039543284,0.0015691695,0.0025203282,0.0009909548,0.0017270427],"category_scores_gemma":[0.036231093,0.00096004456,0.001518756,0.0013825604,0.001127269,0.001846692,0.002187631,0.0020292008,0.0004623624],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019229512,0.000118092605,0.007201391,0.0003733064,0.00037088018,0.00025125136,0.00025458023,0.7149563,0.0016346426,0.18261017,0.0016960237,0.090341054],"study_design_scores_gemma":[0.000010478846,0.00002913951,0.00047811228,0.000016017466,0.000018621527,0.00002753002,0.000010137933,0.9540895,0.00023389627,0.044578217,0.000496728,0.000011546105],"about_ca_topic_score_codex":0.0016496511,"about_ca_topic_score_gemma":0.0018074706,"teacher_disagreement_score":0.009872661,"about_ca_system_score_codex":0.00061558274,"about_ca_system_score_gemma":0.00148234,"threshold_uncertainty_score":0.05221224},"labels":[],"label_agreement":null},{"id":"W4414384679","doi":"10.1080/10618600.2025.2561900","title":"Concurrent Prediction of Multiple Survival Outcomes with a Refined Stacking Algorithm","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Machine Learning and Data Classification","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University; University of Saskatchewan; University of Victoria","funders":"Natural Sciences and Engineering Research Council of Canada; Canada Research Chairs; Michael Smith Health Research BC","keywords":"Stacking; Minification; Identification (biology); Expectation–maximization algorithm","score_opus":0.014137165551512915,"score_gpt":0.2735001843192426,"score_spread":0.2593630187677297,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414384679","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017669592,0.00016959927,0.9808936,0.00018848991,0.00004322507,0.000075464624,0.000052875173,0.0004471108,0.00046009934],"genre_scores_gemma":[0.41071412,0.00029209518,0.58421135,0.00030732335,0.00018432782,0.0004250973,0.0006024529,0.00018897098,0.0030742434],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99736637,0.0010064961,0.0002147552,0.00054779573,0.00062916806,0.0002354278],"domain_scores_gemma":[0.99239504,0.004201219,0.0005462499,0.0008939014,0.0016421564,0.00032151907],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00846406,0.0018157181,0.0021818578,0.0016689149,0.0007736639,0.0014423131,0.003255428,0.0018928753,0.0022691921],"category_scores_gemma":[0.015741218,0.00088106364,0.002099708,0.0013417299,0.0010158331,0.0026281506,0.0034138917,0.0035600655,0.0010465208],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003498919,0.00018391978,0.008383834,0.000078855104,0.00025839717,0.00016243591,0.00025951667,0.65753096,0.0022429102,0.014788369,0.0021689914,0.31359187],"study_design_scores_gemma":[0.000013802381,0.00005556808,0.00023922237,0.0000055404385,0.00002280727,0.000019452862,0.000009406752,0.9938228,0.00046396186,0.005024359,0.0003122474,0.00001080902],"about_ca_topic_score_codex":0.0056562545,"about_ca_topic_score_gemma":0.00448883,"teacher_disagreement_score":0.00846406,"about_ca_system_score_codex":0.00075473817,"about_ca_system_score_gemma":0.002481723,"threshold_uncertainty_score":0.04476273},"labels":[],"label_agreement":null},{"id":"W4414511858","doi":"10.1080/10618600.2025.2559675","title":"Approximations in the Homogeneous Ising Model with Application to Scene Analysis","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Theoretical and Computational Physics","field":"Physics and Astronomy","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"National Institute of Biomedical Imaging and Bioengineering; National Institute of Food and Agriculture","keywords":"Ising model; Homogeneous; Approximations of π; Work (physics)","score_opus":0.003290519442735462,"score_gpt":0.24304964804114476,"score_spread":0.2397591285984093,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414511858","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006454107,0.0002793104,0.9910706,0.00019586532,0.00003490796,0.00002006933,0.00012085684,0.00041105572,0.0014132501],"genre_scores_gemma":[0.36921075,0.0013946284,0.62169707,0.00028542095,0.00019230852,0.00019032,0.0007397822,0.0006703604,0.005619356],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99952614,0.00017555682,0.000023522754,0.000060690836,0.00016102458,0.00005319693],"domain_scores_gemma":[0.99677175,0.0022377656,0.00019070628,0.0003451414,0.00034090868,0.00011367844],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0016016992,0.00059813034,0.0009355725,0.0014057932,0.0006579994,0.0012559096,0.0020527656,0.0012204464,0.0026047716],"category_scores_gemma":[0.010125928,0.0004883596,0.0010440676,0.0018151816,0.0011641257,0.002084493,0.001226146,0.0014626844,0.00074982364],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000052969066,0.00003045043,0.0007500006,0.00006486373,0.00003347689,0.00012372159,0.00009971389,0.7627969,0.0014919374,0.2090731,0.0023464535,0.02313639],"study_design_scores_gemma":[0.0000024117999,0.0000026233824,0.00005507831,0.0000032479954,0.0000027369547,0.000013120667,0.000005562341,0.96454316,0.0001131185,0.034814086,0.00043966965,0.000005114192],"about_ca_topic_score_codex":0.02173805,"about_ca_topic_score_gemma":0.014237877,"teacher_disagreement_score":0.02173805,"about_ca_system_score_codex":0.0015291738,"about_ca_system_score_gemma":0.0012495392,"threshold_uncertainty_score":0.043223023},"labels":[],"label_agreement":null},{"id":"W4415351738","doi":"10.1080/10618600.2025.2574535","title":"Computationally Efficient Algorithms for Simulating Isotropic Gaussian Random Fields on Graphs with Euclidean Edges","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Point processes and geometric inequalities","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"L'Alliance Boviteq","funders":"Fondo Nacional de Desarrollo Científico y Tecnológico; Agencia Nacional de Investigación y Desarrollo","keywords":"Random field; Efficient algorithm; Euclidean geometry; Gaussian; Random graph; Isotropy; Gaussian random field","score_opus":0.030553763293131288,"score_gpt":0.32538703542045383,"score_spread":0.2948332721273225,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415351738","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02289401,0.00009377606,0.97529465,0.00013665862,0.000017469498,0.00006506299,0.00008119258,0.00045360878,0.0009636057],"genre_scores_gemma":[0.39388517,0.00020391472,0.603468,0.00012606387,0.0000408962,0.00033015147,0.00041335757,0.00018149061,0.0013509745],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99924064,0.00032549998,0.00004487671,0.00013665293,0.00015669293,0.00009569216],"domain_scores_gemma":[0.9904689,0.0075515523,0.0005650864,0.00077322096,0.0004412025,0.0002000422],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0024094824,0.0008691669,0.0011228888,0.0012066346,0.0005559108,0.0011016169,0.002376389,0.0016655194,0.0021939029],"category_scores_gemma":[0.01357888,0.0005158596,0.0007950705,0.0011353889,0.0014014649,0.0022045728,0.0017666505,0.0015640417,0.00038056943],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000077629025,0.000038526872,0.0007439367,0.00003343081,0.000021100961,0.00003605705,0.000059307135,0.93532383,0.0005190921,0.04350821,0.00040510794,0.019233743],"study_design_scores_gemma":[0.000011577962,0.00000794055,0.000033817007,0.000002738638,0.0000020086163,0.000009184261,0.000006102612,0.9848894,0.00025018887,0.0146717,0.000111744106,0.000003722591],"about_ca_topic_score_codex":0.0046508764,"about_ca_topic_score_gemma":0.005781573,"teacher_disagreement_score":0.0046508764,"about_ca_system_score_codex":0.0014543696,"about_ca_system_score_gemma":0.0015682135,"threshold_uncertainty_score":0.012742758},"labels":[],"label_agreement":null},{"id":"W4416967053","doi":"10.1080/10618600.2025.2596057","title":"Robust Multi-Model Subset Selection","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Outlier; Selection (genetic algorithm); Robustness (evolution); Robust statistics; Cheminformatics; Estimator; Code (set theory); Source code","score_opus":0.10388863209006598,"score_gpt":0.4074373059381189,"score_spread":0.3035486738480529,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4416967053","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0108217,0.00019800465,0.9873519,0.00019070637,0.00003203145,0.000046719855,0.00018418558,0.0006175493,0.00055722333],"genre_scores_gemma":[0.50473213,0.00044132656,0.48686332,0.00054342113,0.00022053096,0.00042588575,0.0031449944,0.00058179605,0.003046619],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9982015,0.0008955344,0.00007651811,0.0003612466,0.00034846776,0.00011672047],"domain_scores_gemma":[0.99531543,0.0027066895,0.0003611038,0.00092671847,0.0005541661,0.00013592908],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041898866,0.0017287222,0.0022747535,0.0011068686,0.0007119085,0.0013043694,0.002056796,0.0012173936,0.0021513475],"category_scores_gemma":[0.0122843785,0.00070736895,0.00198974,0.0010099217,0.0008031712,0.0015950325,0.0017728547,0.0020155772,0.0012083419],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014498386,0.00007860086,0.0032421113,0.00011703389,0.00027192256,0.000174051,0.00010693469,0.8510834,0.0028113218,0.015879598,0.0057682344,0.12032182],"study_design_scores_gemma":[0.00000696911,0.00002313585,0.00019015059,0.0000081419985,0.000015028806,0.000027629185,0.000012112027,0.9893856,0.00080876297,0.009004875,0.00050964183,0.000007936788],"about_ca_topic_score_codex":0.0021744343,"about_ca_topic_score_gemma":0.0025413856,"teacher_disagreement_score":0.0041898866,"about_ca_system_score_codex":0.00059991766,"about_ca_system_score_gemma":0.0016674893,"threshold_uncertainty_score":0.022158563},"labels":[],"label_agreement":null},{"id":"W4417476629","doi":"10.1080/10618600.2025.2604177","title":"Renewable <i>ℓ</i> <sub>1</sub> -Regularized Linear Support Vector Machine with High-Dimensional Streaming Data","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Machine Learning and ELM","field":"Computer Science","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China; Alberta Machine Intelligence Institute","keywords":"Support vector machine; Streaming data; Renewable energy; Minification; Data modeling","score_opus":0.007795108113412392,"score_gpt":0.24243370699554276,"score_spread":0.23463859888213037,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4417476629","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017971314,0.00025374498,0.9804683,0.00023798861,0.000045722798,0.000032706135,0.000106126565,0.00031140583,0.0005727548],"genre_scores_gemma":[0.65559155,0.00074399624,0.33743277,0.00024843976,0.00028220055,0.00024429898,0.00083885854,0.0001894827,0.0044283937],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9992588,0.00023774718,0.000048463546,0.00020210503,0.0001835863,0.00006929059],"domain_scores_gemma":[0.9954516,0.0027412472,0.0006365065,0.0005170206,0.0005401324,0.00011346295],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0023257502,0.00082049327,0.00078987953,0.00036270556,0.00026473665,0.000833832,0.0017633002,0.0009976318,0.0018930518],"category_scores_gemma":[0.0126260305,0.00033431555,0.0006457671,0.00071349886,0.0008523478,0.0018268174,0.00087144086,0.0017276149,0.0005720434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031702395,0.00011654088,0.005867786,0.00048510698,0.00009375036,0.0005325908,0.00017667723,0.7685639,0.008478061,0.058584403,0.004646857,0.1521373],"study_design_scores_gemma":[0.0000031515488,0.000015621656,0.00020904937,0.000005669737,0.0000033913454,0.00003022829,0.000006783212,0.994325,0.0006880262,0.004423687,0.00028541114,0.0000040186205],"about_ca_topic_score_codex":0.0022343476,"about_ca_topic_score_gemma":0.0018214805,"teacher_disagreement_score":0.0023257502,"about_ca_system_score_codex":0.00043883888,"about_ca_system_score_gemma":0.0006416145,"threshold_uncertainty_score":0.012299836},"labels":[],"label_agreement":null},{"id":"W7092458970","doi":"10.1080/10618600.2025.2574532","title":"Reproducing Kernel-Based Semiparametric Functional Smoothed Score Estimation with Binary Responses","year":2025,"lang":"en","type":"article","venue":"Journal of Computational and Graphical Statistics","topic":"Emotion and Mood Recognition","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo; University of Alberta","funders":"Natural Sciences and Engineering Research Council of Canada; National Natural Science Foundation of China; Alberta Machine Intelligence Institute","keywords":"Binary data; Binary number; Estimation; Covariate; Functional data analysis; Semiparametric model; Estimation theory; Pattern recognition (psychology)","score_opus":0.027921344379577596,"score_gpt":0.3138558903931978,"score_spread":0.28593454601362017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W7092458970","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016726969,0.00006964368,0.9826019,0.000106911946,0.000011773606,0.000022216149,0.000029730703,0.00015833823,0.00027248872],"genre_scores_gemma":[0.7488348,0.0002427893,0.2470992,0.00018521148,0.00008645064,0.00018085724,0.00036603532,0.00012768025,0.002877061],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99866235,0.0007107654,0.00006338954,0.00023964063,0.00024336243,0.000080587946],"domain_scores_gemma":[0.99569255,0.0025936784,0.00039309027,0.00055965333,0.00062789774,0.00013315032],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041199108,0.0007221857,0.0013015592,0.0007701137,0.00024123878,0.0010402813,0.0015859787,0.0012409514,0.0017653779],"category_scores_gemma":[0.016472617,0.00034245028,0.0009184574,0.00063127297,0.0011796475,0.0017356665,0.0014516058,0.0014734897,0.000577089],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003256958,0.00014873363,0.006098102,0.0002541524,0.00019690667,0.00017891749,0.00029257196,0.6913638,0.010460413,0.09985604,0.0018133192,0.1890113],"study_design_scores_gemma":[0.0000063987977,0.000029966162,0.00047739173,0.0000053225563,0.0000066850603,0.00002718251,0.000007223891,0.98784536,0.0005756873,0.010822117,0.00018606015,0.00001056413],"about_ca_topic_score_codex":0.0016938709,"about_ca_topic_score_gemma":0.0012084318,"teacher_disagreement_score":0.0041199108,"about_ca_system_score_codex":0.0005763617,"about_ca_system_score_gemma":0.0008354966,"threshold_uncertainty_score":0.021788478},"labels":[],"label_agreement":null}]}