{"meta":{"query_hash":"e274496c46b9","filters":{"venue":"Advances in Methods and Practices in Psychological Science"},"cohort_total":45,"direct_labels_cover":3,"predictions_cover":45,"exported":45,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/e274496c46b9","api":"https://metacan.xera.ac/api/v1/cohort?venue=Advances+in+Methods+and+Practices+in+Psychological+Science"},"results":[{"id":"W2762364541","doi":"10.1177/2515245917747646","title":"Many Analysts, One Data Set: Making Transparent How Variations in Analytic Choices Affect Results","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":855,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Kellogg's (Canada)","funders":"Natural Sciences and Engineering Research Council of Canada; Institute of Education Sciences; U.S. Department of Education; Canadian Network for Research and Innovation in Machining Technology, Natural Sciences and Engineering Research Council of Canada; Leverhulme Trust; Jan Wallanders och Tom Hedelius Stiftelse samt Tore Browaldhs Stiftelse; H2020 European Research Council; Riksbankens Jubileumsfond","keywords":"Affect (linguistics); Variation (astronomy); Set (abstract data type); Psychology; Crowdsourcing; Covariate; Odds; Quality (philosophy); Social psychology; Econometrics; Computer science; Statistics; Logistic regression; Mathematics","score_opus":0.8536502812974519,"score_gpt":0.7364175045728222,"score_spread":0.11723277672462973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2762364541","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15516958,0.022162985,0.6865839,0.061964635,0.012671021,0.03819873,0.007714119,0.0034749904,0.01206006],"genre_scores_gemma":[0.3445326,0.0016155718,0.58524954,0.011431822,0.0010085299,0.05313038,0.0014676865,0.0008158372,0.00074811693],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.13534011,0.7192823,0.087209485,0.019380067,0.03733717,0.001450864],"domain_scores_gemma":[0.040903293,0.8086302,0.03905408,0.08638895,0.023865215,0.0011582472],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.78217965,0.002942632,0.0069392817,0.011774746,0.0056977104,0.012025414,0.00741645,0.007643971,0.0027906296],"category_scores_gemma":[0.9140739,0.0047824886,0.010747814,0.010693178,0.010618689,0.011711827,0.01534434,0.008957973,0.0010065108],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.021732965,0.0010335782,0.101407476,0.046711307,0.064897254,0.0014900347,0.113373205,0.008847912,0.0137141775,0.065230004,0.060941786,0.50062037],"study_design_scores_gemma":[0.012878733,0.0037375577,0.095948406,0.035464585,0.04743647,0.0011810032,0.018351393,0.043976046,0.026126036,0.4628929,0.248612,0.003394918],"about_ca_topic_score_codex":0.0034832158,"about_ca_topic_score_gemma":0.004957522,"teacher_disagreement_score":0.21782035,"about_ca_system_score_codex":0.0058214497,"about_ca_system_score_gemma":0.012844815,"threshold_uncertainty_score":0.2686113},"labels":[],"label_agreement":null},{"id":"W2776961836","doi":"10.1177/2515245918810225","title":"Many Labs 2: Investigating Variation in Replicability Across Samples and Settings","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Impact of Technology on Adolescents","field":"Social Sciences","cited_by":1021,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"The Scarborough Hospital; Carleton University; University of Toronto; Wilfrid Laurier University","funders":"Centro de Estudios de Conflicto y Cohesión Social; Laura and John Arnold Foundation; Association for Psychological Science","keywords":"Statistics; Replication (statistics); Statistical significance; Moderation; Statistic; Mathematics; Variation (astronomy); Interaction; Psychology; Demography; Econometrics; Physics","score_opus":0.09821242544001113,"score_gpt":0.5950708810372118,"score_spread":0.4968584555972007,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2776961836","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.555729,0.0049918364,0.34570816,0.0014030753,0.0024685662,0.06722209,0.004312741,0.0029782995,0.015186386],"genre_scores_gemma":[0.723623,0.00034213436,0.17730479,0.00073846953,0.0002552166,0.09412897,0.0011101376,0.00079900445,0.0016983801],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.5499019,0.3569009,0.031909164,0.031905346,0.024987524,0.004395134],"domain_scores_gemma":[0.20966603,0.5544059,0.04347522,0.13972956,0.05037211,0.0023511732],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.4411123,0.0033850975,0.0039478606,0.0049365396,0.003428822,0.0035360712,0.0050249584,0.0038778088,0.008970419],"category_scores_gemma":[0.66336894,0.0033090825,0.009194354,0.004784922,0.0075956048,0.0045885243,0.0062673804,0.003515557,0.001477841],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.048966315,0.005259655,0.37960407,0.034237295,0.07547595,0.005984969,0.09794547,0.012329883,0.057637386,0.04186432,0.029610006,0.21108462],"study_design_scores_gemma":[0.01960742,0.054441076,0.6124883,0.0050062547,0.04284248,0.0040014447,0.014739389,0.03583684,0.062492583,0.052855663,0.093723245,0.0019651626],"about_ca_topic_score_codex":0.0018874867,"about_ca_topic_score_gemma":0.0026114227,"teacher_disagreement_score":0.5588877,"about_ca_system_score_codex":0.0025676177,"about_ca_system_score_gemma":0.0043363064,"threshold_uncertainty_score":0.68920803},"labels":[],"label_agreement":null},{"id":"W2777631817","doi":"10.1177/2515245918787489","title":"A Unified Framework to Quantify the Credibility of Scientific Findings","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":229,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Credibility; Scrutiny; Workflow; Data science; Transparency (behavior); Computer science; Falsifiability; Robustness (evolution); Crowdsourcing; Management science; Psychology; Epistemology; Political science; World Wide Web; Economics","score_opus":0.7627076276557118,"score_gpt":0.7394797943067195,"score_spread":0.023227833348992255,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2777631817","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0030795638,0.0061026444,0.97288,0.0074544926,0.00047000527,0.0021250357,0.0012306696,0.0005609669,0.0060966904],"genre_scores_gemma":[0.08710752,0.0025448152,0.9002799,0.0014950441,0.00074253284,0.0064666923,0.00074328703,0.00017042078,0.00044970989],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.44174665,0.4069107,0.056150477,0.028578794,0.06306949,0.003543927],"domain_scores_gemma":[0.2094469,0.6218076,0.05745832,0.060768172,0.04801971,0.0024992563],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.527731,0.006605445,0.0074868253,0.06738781,0.005925435,0.027557896,0.0130275525,0.01297281,0.0053758845],"category_scores_gemma":[0.7295894,0.0032545202,0.012482156,0.029494384,0.026310924,0.026447874,0.022318013,0.013782486,0.0015561854],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024538045,0.00013523063,0.008009824,0.0043924525,0.0027846019,0.00025232814,0.0037412709,0.027098907,0.0008553779,0.8264104,0.0073636356,0.118710555],"study_design_scores_gemma":[0.0001569254,0.00024465472,0.0034176412,0.0030576081,0.0010281883,0.00034353245,0.0006230418,0.036132652,0.001042347,0.9362923,0.017315218,0.00034582155],"about_ca_topic_score_codex":0.0106889615,"about_ca_topic_score_gemma":0.0047884085,"teacher_disagreement_score":0.472269,"about_ca_system_score_codex":0.015411002,"about_ca_system_score_gemma":0.025335161,"threshold_uncertainty_score":0.5823918},"labels":[],"label_agreement":null},{"id":"W2782848847","doi":"10.1177/2515245917744281","title":"Open Sharing of Data on Close Relationships and Other Sensitive Social Psychological Topics: Challenges, Tools, and Future Directions","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Ethics in Clinical Research","field":"Medicine","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Confidentiality; Transparency (behavior); Data sharing; Adversarial system; Data science; Open data; Internet privacy; Computer science; Psychology; Public relations; Political science; Computer security; World Wide Web; Medicine; Law","score_opus":0.7929189054359888,"score_gpt":0.7521299129002021,"score_spread":0.040788992535786606,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2782848847","genre_codex":"commentary","genre_gemma":"review","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0110365655,0.015696337,0.2696517,0.680151,0.0037231005,0.001991728,0.00026580848,0.00034312464,0.017140618],"genre_scores_gemma":[0.22195356,0.019635655,0.67637473,0.059119124,0.005918929,0.010734844,0.0005905701,0.00060624076,0.005066305],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.27200893,0.6516152,0.020631585,0.012617077,0.037669662,0.005457527],"domain_scores_gemma":[0.10009982,0.73579174,0.023937259,0.088884875,0.036514945,0.014771338],"candidate_categories":["metaresearch","open_science"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6647827,0.0019934305,0.004286148,0.013543592,0.02492417,0.05260233,0.016949344,0.018696647,0.007947335],"category_scores_gemma":[0.64036447,0.0030867662,0.004147555,0.013401541,0.09789449,0.121923275,0.06756303,0.03653678,0.0027778628],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002259613,0.00046281057,0.010521059,0.004657786,0.00018996462,0.0012518568,0.21675757,0.00089764135,0.00072900235,0.4442582,0.025119174,0.29492897],"study_design_scores_gemma":[0.000067265886,0.0002009449,0.0014436016,0.012131176,0.000058028585,0.001603874,0.15737031,0.0018186896,0.0009722803,0.6303175,0.19370753,0.0003088794],"about_ca_topic_score_codex":0.0034027402,"about_ca_topic_score_gemma":0.004101651,"teacher_disagreement_score":0.98305064,"about_ca_system_score_codex":0.013326798,"about_ca_system_score_gemma":0.055577576,"threshold_uncertainty_score":0.41338265},"labels":[],"label_agreement":null},{"id":"W2782905495","doi":"10.1177/2515245919900809","title":"Quantifying Sources of Variability in Infancy Research Using the Infant-Directed-Speech Preference","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Language Development and Disorders","field":"Psychology","cited_by":360,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; McMaster University; University of Manitoba; Okanagan University College; University of British Columbia, Okanagan Campus; University of British Columbia; Wilfrid Laurier University; University of Ottawa; University of Toronto; Concordia University","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; European Research Council; Economic and Social Research Council; Social Sciences and Humanities Research Council of Canada; National Institutes of Health; Children's Hospital Research Institute of Manitoba; Natural Sciences and Engineering Research Council of Canada; Max Planck Instituut voor Psycholinguïstiek; Université de Rennes 1; Technische Universität Dresden; Concordia University; Centre National de la Recherche Scientifique; Victoria University; Leibniz-Gemeinschaft; Victoria University of Wellington; Agence Nationale de la Recherche; Universität des Saarlandes; University of Manitoba; Research Manitoba; Laura and John Arnold Foundation; University of Louisville; Universidad Nacional Autónoma de México; Association for Psychological Science; University of Bristol; Fonds National de la Recherche Luxembourg; University of Oregon; Universität Konstanz; Purdue University","keywords":"Preference; Psychology; Replicate; Developmental psychology; Cognitive psychology; Statistics","score_opus":0.3481219238762389,"score_gpt":0.6289481685214379,"score_spread":0.28082624464519895,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2782905495","genre_codex":"review","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16579202,0.5457696,0.25568807,0.0051214346,0.0027462374,0.005427101,0.008203838,0.00086225884,0.010389492],"genre_scores_gemma":[0.8806821,0.023839004,0.081956506,0.0019489346,0.0004398717,0.006789462,0.0032569764,0.0003183433,0.00076877617],"study_design_codex":"meta_analysis","study_design_gemma":"observational","domain_scores_codex":[0.8179031,0.119816594,0.029063236,0.017840352,0.014624076,0.000752668],"domain_scores_gemma":[0.5581131,0.36975572,0.024930228,0.03685534,0.009736355,0.0006092533],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.20852232,0.0018536963,0.0042915116,0.0092635,0.00091384543,0.004563776,0.0026258656,0.002131298,0.0018722481],"category_scores_gemma":[0.31541112,0.00121213,0.012873868,0.008368463,0.0031777371,0.0022112485,0.003408027,0.0020870306,0.00023496864],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026397523,0.00022028243,0.2581009,0.0910933,0.48032758,0.0010532022,0.007394235,0.005484231,0.004843298,0.011690925,0.0044836435,0.13266861],"study_design_scores_gemma":[0.0018434436,0.003161795,0.4590544,0.028616741,0.3583073,0.0024050274,0.003954187,0.0076909433,0.0110288095,0.06198932,0.061148737,0.0007992696],"about_ca_topic_score_codex":0.0033389009,"about_ca_topic_score_gemma":0.00442398,"teacher_disagreement_score":0.7914777,"about_ca_system_score_codex":0.0012343781,"about_ca_system_score_gemma":0.0019010403,"threshold_uncertainty_score":0.9760329},"labels":[],"label_agreement":null},{"id":"W2810320295","doi":"10.1177/2515245918797607","title":"The Psychological Science Accelerator: Advancing Psychology Through a Distributed Collaborative Network","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Mental Health Research Topics","field":"Psychology","cited_by":390,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto; Wilfrid Laurier University; McGill University; Western University","funders":"Fondo Nacional de Desarrollo Científico y Tecnológico; Division of Graduate Education; National Institute of Mental Health; Eötvös Loránd Tudományegyetem; Humboldt-Universität zu Berlin; Social Sciences and Humanities Research Council of Canada; University of Toronto; Lunds Universitet; Queen's University; Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung; Canada Research Chairs; Nederlandse Organisatie voor Wetenschappelijk Onderzoek; Comunidad de Madrid; Agence Nationale de la Recherche; Gielen-Leyendecker-Stiftung; Queen's University Belfast; McGill University; University of Ottawa; Université de Genève; Vanderbilt University; Departamento Administrativo de Ciencia, Tecnología e Innovación (COLCIENCIAS); Technische Universiteit Eindhoven; National Science Foundation","keywords":"Psychological science; Psychology; Computer science; Social psychology","score_opus":0.1702714585772944,"score_gpt":0.686220743484649,"score_spread":0.5159492849073546,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2810320295","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021193227,0.0051256483,0.6707775,0.161503,0.004791437,0.0021197298,0.00048806958,0.0032101087,0.13079126],"genre_scores_gemma":[0.19672881,0.0062083174,0.7498838,0.011245991,0.004002642,0.0044059386,0.00066199695,0.00078555656,0.026077002],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9605226,0.029020403,0.0007577267,0.0036130715,0.004941456,0.0011446014],"domain_scores_gemma":[0.8633349,0.07415013,0.0053084907,0.02492451,0.008931877,0.02335011],"candidate_categories":["metaresearch","open_science"],"consensus_categories":[],"category_scores_codex":[0.052017342,0.0007835701,0.00079545996,0.0042535043,0.0071493154,0.012457593,0.0043015727,0.004876496,0.020867296],"category_scores_gemma":[0.09319327,0.0008806176,0.0012946819,0.00354365,0.012051598,0.024273815,0.03167993,0.006785875,0.0067069437],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00024746888,0.0005483516,0.0047803614,0.00091866124,0.00010020588,0.00030630993,0.012461788,0.0027100986,0.0020863458,0.5296124,0.07753949,0.3686885],"study_design_scores_gemma":[0.00022515215,0.00032578214,0.0019036687,0.00077580917,0.000046690642,0.00015587163,0.003756584,0.0076349373,0.0005939583,0.57616013,0.4083353,0.00008616518],"about_ca_topic_score_codex":0.0021962163,"about_ca_topic_score_gemma":0.002833939,"teacher_disagreement_score":0.99569845,"about_ca_system_score_codex":0.0036791693,"about_ca_system_score_gemma":0.019110302,"threshold_uncertainty_score":0.2750973},"labels":[],"label_agreement":null},{"id":"W2886602349","doi":"10.1177/2515245918773743","title":"Reproducible Tables in Psychology Using the apaTables Package","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Mental Health Research Topics","field":"Psychology","cited_by":51,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Disk formatting; Replication (statistics); Analysis of variance; Variance (accounting); Psychological research; Repeated measures design; Psychology; Table (database); Mixed-design analysis of variance; Statistics; Computer science; Natural language processing; Information retrieval; Database; Mathematics; Social psychology","score_opus":0.3126180029884374,"score_gpt":0.703057980321841,"score_spread":0.3904399773334036,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2886602349","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012662124,0.00081527425,0.66991913,0.002479554,0.005200767,0.0021789342,0.0775842,0.22514595,0.015409967],"genre_scores_gemma":[0.009363818,0.0008880873,0.8474485,0.0011761242,0.0013147028,0.0104515795,0.035794597,0.08054177,0.013020693],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9740217,0.012295308,0.005556215,0.0025837445,0.0049105026,0.0006324921],"domain_scores_gemma":[0.752029,0.1773311,0.010981523,0.032521702,0.024679817,0.0024569407],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03413598,0.0029011997,0.0027395021,0.008349499,0.001756769,0.00967881,0.003947189,0.0018276882,0.2796825],"category_scores_gemma":[0.24396518,0.003305759,0.004050133,0.009683793,0.0020699755,0.0071479473,0.0055734124,0.00629591,0.12269859],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00060241215,0.00016307234,0.0010758475,0.0041528777,0.00032923586,0.00033909202,0.0010131568,0.0010381342,0.001874412,0.039298676,0.74585533,0.20425777],"study_design_scores_gemma":[0.0005034178,0.00018633282,0.0017447534,0.0013764962,0.00011415211,0.00041219086,0.00022866823,0.003483306,0.004234847,0.091343366,0.89619035,0.00018222278],"about_ca_topic_score_codex":0.0007191111,"about_ca_topic_score_gemma":0.00092237565,"teacher_disagreement_score":0.965864,"about_ca_system_score_codex":0.0014087812,"about_ca_system_score_gemma":0.0066637713,"threshold_uncertainty_score":0.93563116},"labels":[],"label_agreement":null},{"id":"W2891110192","doi":"10.1177/2515245918806489","title":"Peer-Review Guidelines Promoting Replicability and Transparency in Psychological Science","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University; University of Victoria","funders":"","keywords":"Transparency (behavior); Humility; Psychology; Psychological science; Public relations; Psychological research; Peer review; Work (physics); Openness to experience; Engineering ethics; Applied psychology; Political science; Social psychology; Law; Engineering","score_opus":0.8140672404417536,"score_gpt":0.7649808354131177,"score_spread":0.04908640502863593,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2891110192","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.006972618,0.037489202,0.35084027,0.20165643,0.1160829,0.20174319,0.006022279,0.011480406,0.067712694],"genre_scores_gemma":[0.034466617,0.024222737,0.7014368,0.023471415,0.02104667,0.16745867,0.0037764362,0.003689787,0.020430777],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.23959903,0.42221856,0.2284711,0.018555388,0.08379998,0.007355957],"domain_scores_gemma":[0.037985723,0.39102045,0.080873065,0.06593899,0.411528,0.012653838],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5881494,0.005159606,0.01243309,0.034954578,0.012428677,0.025394587,0.018774822,0.04905815,0.021530893],"category_scores_gemma":[0.8167169,0.011196974,0.011133137,0.030155646,0.030979423,0.016564436,0.009376782,0.03765044,0.028968252],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017906124,0.0006503209,0.001973882,0.07867526,0.0017773709,0.0018975543,0.0132873,0.002180673,0.004721425,0.030098293,0.65930307,0.20364423],"study_design_scores_gemma":[0.004851876,0.0005817403,0.011424369,0.10871829,0.0013678129,0.002143883,0.0048567457,0.009079537,0.006005382,0.10589005,0.743593,0.0014873929],"about_ca_topic_score_codex":0.0050424063,"about_ca_topic_score_gemma":0.014657895,"teacher_disagreement_score":0.41185057,"about_ca_system_score_codex":0.012165975,"about_ca_system_score_gemma":0.09003347,"threshold_uncertainty_score":0.5078851},"labels":[],"label_agreement":null},{"id":"W2906019683","doi":"10.1177/2515245918817284","title":"Some Reflections on the Many Labs 2 Replication of Norenzayan, Smith, Kim, and Nisbett’s (2002) Study 2: Cultural Preferences for Formal Versus Intuitive Reasoning","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Cultural Differences and Values","field":"Psychology","cited_by":6,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Replication (statistics); Epistemology; Psychology; Cognitive science; Sociology; Philosophy; Biology","score_opus":0.3224087192971854,"score_gpt":0.6382533388650209,"score_spread":0.3158446195678355,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906019683","genre_codex":"commentary","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.058145966,0.004581062,0.00821507,0.88864386,0.008332276,0.00031425545,0.0007512759,0.00020020377,0.030815998],"genre_scores_gemma":[0.49863866,0.002734256,0.017012583,0.45161247,0.0036777682,0.0017537312,0.0006621401,0.0008360976,0.023072327],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.936529,0.041214097,0.003091854,0.0057274117,0.011317171,0.0021204967],"domain_scores_gemma":[0.54711366,0.2913484,0.011358254,0.051476784,0.08953281,0.009170033],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.13961227,0.0012438797,0.00090303156,0.0015627213,0.010532912,0.013614629,0.0074141575,0.007130632,0.01637907],"category_scores_gemma":[0.3249973,0.001142739,0.0015209805,0.0024794918,0.018289689,0.018096387,0.010598933,0.019824063,0.0036433425],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015308739,0.0013376825,0.020463565,0.00097520126,0.00043696986,0.0004467395,0.277024,0.00033337905,0.0025305133,0.2025181,0.3959426,0.0964603],"study_design_scores_gemma":[0.0006557793,0.0004999811,0.040611904,0.0016269003,0.0002459686,0.000360556,0.2545966,0.00071195647,0.005533964,0.11699077,0.5777679,0.0003977461],"about_ca_topic_score_codex":0.046422638,"about_ca_topic_score_gemma":0.051833857,"teacher_disagreement_score":0.86038774,"about_ca_system_score_codex":0.007913365,"about_ca_system_score_gemma":0.011857566,"threshold_uncertainty_score":0.7383491},"labels":[],"label_agreement":null},{"id":"W2906653757","doi":"10.1177/2515245918797130","title":"Structure and Goal Pursuit: Individual and Cultural Differences","year":2018,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Motivation and Self-Concept in Sports","field":"Psychology","cited_by":5,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Goal pursuit; Psychology; Cognitive psychology; Social psychology","score_opus":0.08405927265250235,"score_gpt":0.5510710885029609,"score_spread":0.4670118158504586,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2906653757","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9961312,0.00060472614,0.0004061686,0.000072221206,0.000017150016,0.000007103954,0.000044798286,0.0000024732637,0.0027141816],"genre_scores_gemma":[0.9991041,0.00020572431,0.0002604277,0.000034302626,0.000004450159,0.0000049194027,0.000054624863,0.000008853101,0.0003226168],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989882,0.00045957786,0.000060848386,0.00017118538,0.000248847,0.00007122586],"domain_scores_gemma":[0.995327,0.0024369874,0.00067417964,0.0005006404,0.00050527847,0.00055593066],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0018430311,0.00017016633,0.00033969164,0.0010136787,0.00040932154,0.0014778086,0.00030574072,0.00033221417,0.0019421644],"category_scores_gemma":[0.0059899073,0.00018598605,0.0003287425,0.00088881725,0.001164737,0.00050365186,0.0008732862,0.00058743573,0.00014059054],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00096417626,0.0005697615,0.88927203,0.00020388488,0.0010839482,0.0001267657,0.025542488,0.00055328343,0.012560895,0.00600211,0.0005862929,0.06253432],"study_design_scores_gemma":[0.000010666679,0.000106823514,0.9940568,0.000031400963,0.000050695293,0.00008848307,0.0032847447,0.00016614342,0.0004436,0.0010284004,0.0007198636,0.000012406294],"about_ca_topic_score_codex":0.0035901826,"about_ca_topic_score_gemma":0.005477848,"teacher_disagreement_score":0.0035901826,"about_ca_system_score_codex":0.0003201221,"about_ca_system_score_gemma":0.00035031617,"threshold_uncertainty_score":0.009747028},"labels":[],"label_agreement":null},{"id":"W2936257342","doi":"10.1177/2515245920958687","title":"Many Labs 5: Testing Pre-Data-Collection Peer Review as an Intervention to Increase Replicability","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":103,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Economic and Social Research Council; Templeton Religion Trust; Nederlandse Organisatie voor Wetenschappelijk Onderzoek; Agence Nationale de la Recherche; Laura and John Arnold Foundation; Association for Psychological Science; Templeton World Charity Foundation; John Templeton Foundation","keywords":"Replication (statistics); Replicate; Protocol (science); Data collection; Computer science; Sample size determination; Open science; Psychology; Range (aeronautics); Medicine; Statistics; Alternative medicine; Pathology; Mathematics","score_opus":0.8184135919381903,"score_gpt":0.7484966159576015,"score_spread":0.06991697598058877,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2936257342","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.12507188,0.0033199214,0.4017692,0.022123924,0.010363963,0.35064232,0.0043624314,0.019553017,0.06279341],"genre_scores_gemma":[0.18706417,0.00038076623,0.46974257,0.004922577,0.0008072764,0.32946163,0.0009000749,0.0017474926,0.004973488],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.31562725,0.5634632,0.050096467,0.018387578,0.045877147,0.0065482506],"domain_scores_gemma":[0.078464314,0.56875753,0.03661657,0.15418978,0.1559668,0.006005016],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.55519104,0.002362263,0.0036692042,0.0066323015,0.007616909,0.009096661,0.00656138,0.007920945,0.048231684],"category_scores_gemma":[0.8169068,0.0037974326,0.0049874564,0.0056136474,0.008068186,0.012795307,0.008400492,0.0065176287,0.011690602],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.011863392,0.0041291686,0.020812158,0.026451185,0.002713999,0.0007724444,0.05559081,0.0017723651,0.011784572,0.025298342,0.13392597,0.7048856],"study_design_scores_gemma":[0.030863686,0.020874415,0.1658073,0.03206393,0.004571209,0.0013931965,0.020217076,0.03321703,0.05145891,0.109781444,0.5267998,0.0029519422],"about_ca_topic_score_codex":0.0015097759,"about_ca_topic_score_gemma":0.0034716604,"teacher_disagreement_score":0.44480896,"about_ca_system_score_codex":0.006177098,"about_ca_system_score_gemma":0.01939668,"threshold_uncertainty_score":0.5485287},"labels":[],"label_agreement":null},{"id":"W2952843659","doi":"10.1177/2515245919849434","title":"The Power of Replicated Measures to Increase Statistical Power","year":2019,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":47,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Ottawa","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Statistical power; Sample size determination; Statistics; Null hypothesis; Representativeness heuristic; Type I and type II errors; Sample (material); Measure (data warehouse); Power (physics); Commit; Statistical hypothesis testing; Mathematics; Correlation; Population; Econometrics; Computer science; Data mining; Demography","score_opus":0.5505241764023473,"score_gpt":0.6993197340519034,"score_spread":0.1487955576495561,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2952843659","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.02121809,0.024438396,0.9114229,0.00925614,0.0049257725,0.010485601,0.0034957684,0.0015732114,0.013184051],"genre_scores_gemma":[0.36912805,0.0053067934,0.559408,0.005211456,0.0017064573,0.055168584,0.0013630494,0.0012304767,0.0014771215],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.3181443,0.5635404,0.04193279,0.030130617,0.04427759,0.0019743158],"domain_scores_gemma":[0.12374816,0.76385,0.024818579,0.06882208,0.01764487,0.0011164106],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.48515213,0.0027329416,0.009422024,0.007571965,0.0022115074,0.009300536,0.005011401,0.0064781033,0.010032771],"category_scores_gemma":[0.8157089,0.002968442,0.012475222,0.0085143335,0.008391012,0.013130363,0.008244979,0.0080424715,0.0020099883],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009625718,0.00087125093,0.053132292,0.067896195,0.062238786,0.0017534851,0.010030777,0.019653704,0.0076164324,0.20659548,0.034525707,0.52606016],"study_design_scores_gemma":[0.005593085,0.0055496707,0.06166294,0.0223408,0.025817597,0.0025028747,0.0024241558,0.04149311,0.013906227,0.6395066,0.17805009,0.0011528601],"about_ca_topic_score_codex":0.0011092314,"about_ca_topic_score_gemma":0.001018011,"teacher_disagreement_score":0.5148479,"about_ca_system_score_codex":0.0035111932,"about_ca_system_score_gemma":0.00654179,"threshold_uncertainty_score":0.63489914},"labels":[],"label_agreement":null},{"id":"W2954642664","doi":"10.1177/2515245919858072","title":"Failing Grade: 89% of Introduction-to-Psychology Textbooks That Define or Explain Statistical Significance Do So Incorrectly","year":2019,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Statistics Education and Methodologies","field":"Mathematics","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Guelph","funders":"","keywords":"Fallacy; Psychology; Odds; Significance testing; Experimental psychology; Statistical significance; Epistemology; Logistic regression; Cognition; Statistics; Mathematics","score_opus":0.2283246623473483,"score_gpt":0.6279325644064597,"score_spread":0.39960790205911145,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2954642664","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.91496,0.007610311,0.019226583,0.007661636,0.0020819684,0.00083957793,0.0055481973,0.002482274,0.039589483],"genre_scores_gemma":[0.93948215,0.0035062865,0.01760491,0.007173838,0.00026210683,0.00046012932,0.003529612,0.0007378183,0.027243156],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9891071,0.002063355,0.0016657165,0.0009001001,0.005721676,0.0005421624],"domain_scores_gemma":[0.87718785,0.060158793,0.024674365,0.004480544,0.030056132,0.003442287],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.009850525,0.00097252545,0.0011870033,0.0024693909,0.0007306725,0.0030978774,0.00149059,0.0014904999,0.011306241],"category_scores_gemma":[0.11689964,0.00066506816,0.00070095155,0.002027391,0.00135041,0.0017947801,0.0019297382,0.0019063995,0.0059049246],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009760108,0.0018427698,0.45613435,0.0047561955,0.0003480319,0.0020266506,0.020527571,0.0016655311,0.014687394,0.0062106955,0.13821882,0.3526061],"study_design_scores_gemma":[0.00024437933,0.0012686566,0.6900061,0.004681637,0.0004878047,0.002834678,0.010709385,0.005125596,0.022020517,0.012100325,0.2502786,0.0002423809],"about_ca_topic_score_codex":0.0032715998,"about_ca_topic_score_gemma":0.0067801247,"teacher_disagreement_score":0.9901495,"about_ca_system_score_codex":0.0022807352,"about_ca_system_score_gemma":0.0030394776,"threshold_uncertainty_score":0.052095234},"labels":[],"label_agreement":null},{"id":"W2990795924","doi":"10.1177/2515245919882693","title":"Advancing Meta-Analysis With Knowledge-Management Platforms: Using metaBUS in Psychology","year":2019,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Text Analysis Techniques","field":"Computer Science","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Northern Alberta Institute of Technology","funders":"","keywords":"Knowledge management; Data science; Computer science; Numbering; Visualization; Engineering ethics; World Wide Web; Psychology; Engineering","score_opus":0.11064732021659938,"score_gpt":0.5827248165838096,"score_spread":0.4720774963672102,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2990795924","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0051778746,0.10230505,0.81419337,0.028486468,0.0025678482,0.0023057018,0.010004819,0.024112122,0.010846751],"genre_scores_gemma":[0.021685451,0.024784764,0.93721884,0.002619612,0.0010075074,0.0042889444,0.0041092196,0.0033328733,0.0009528074],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.8297907,0.12674049,0.020099422,0.0071553634,0.015604566,0.00060956326],"domain_scores_gemma":[0.2452169,0.66281015,0.019161265,0.053599533,0.016745377,0.0024668232],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2446642,0.0033285916,0.005121017,0.03710539,0.0028800373,0.017891947,0.0051018656,0.0030856554,0.013336965],"category_scores_gemma":[0.55015075,0.002691045,0.007039639,0.02841002,0.004139376,0.017039519,0.014943393,0.006716573,0.0048807086],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00061866094,0.0001732076,0.005326139,0.07780028,0.009401785,0.0006769831,0.013106609,0.004927452,0.0034732078,0.10595024,0.06846631,0.71007913],"study_design_scores_gemma":[0.00038493564,0.000244159,0.0052884985,0.05703068,0.005431303,0.00065951544,0.0023393943,0.015576757,0.0053219516,0.40432915,0.5028402,0.0005534642],"about_ca_topic_score_codex":0.0021980153,"about_ca_topic_score_gemma":0.004851283,"teacher_disagreement_score":0.7553358,"about_ca_system_score_codex":0.003962976,"about_ca_system_score_gemma":0.016815491,"threshold_uncertainty_score":0.9314635},"labels":[],"label_agreement":null},{"id":"W2991459896","doi":"10.1177/2515245919884304","title":"Enriching Meta-Analytic Models of Summary Data: A Thought Experiment and Case Study","year":2019,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":14,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Computer science; Variety (cybernetics); Meta-analysis; Set (abstract data type); Data set; Data mining; Data science; Econometrics; Artificial intelligence; Mathematics","score_opus":0.8449134583857858,"score_gpt":0.7344626627543849,"score_spread":0.11045079563140092,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2991459896","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.024067443,0.016290843,0.8646291,0.06524826,0.0029929646,0.014761849,0.00045000302,0.00071749167,0.010842116],"genre_scores_gemma":[0.11164036,0.0015855647,0.86235976,0.0077050733,0.00041634205,0.01585458,0.00007289856,0.000084942236,0.00028040956],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.16719352,0.8048692,0.008962806,0.007963118,0.010138225,0.0008732035],"domain_scores_gemma":[0.0924817,0.8649931,0.010299615,0.024333004,0.0072026127,0.0006898999],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.63757676,0.0036355047,0.0062698754,0.0076914458,0.0066543254,0.0133666955,0.007189253,0.014553649,0.004104747],"category_scores_gemma":[0.68706685,0.0029483358,0.007944858,0.0075303693,0.02802227,0.028051026,0.012263487,0.013170878,0.0005739494],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026277388,0.0006600961,0.0024245593,0.013277757,0.0038250135,0.0010713416,0.030715674,0.0079739215,0.001097307,0.84620935,0.010142504,0.07997469],"study_design_scores_gemma":[0.004076261,0.002052153,0.0006373406,0.010612576,0.0020946127,0.0006952123,0.0045630718,0.025526453,0.0021830215,0.8994096,0.047742072,0.00040760785],"about_ca_topic_score_codex":0.0012761907,"about_ca_topic_score_gemma":0.0015308696,"teacher_disagreement_score":0.36242324,"about_ca_system_score_codex":0.012380011,"about_ca_system_score_gemma":0.010949942,"threshold_uncertainty_score":0.44693244},"labels":[],"label_agreement":null},{"id":"W3024441113","doi":"10.1177/2515245920903079","title":"Registered Replication Report on Fischer, Castel, Dodd, and Pratt (2003)","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Cognitive and developmental aspects of mathematical skills","field":"Mathematics","cited_by":58,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"James S. McDonnell Foundation","keywords":"Psychology; Replication (statistics); Replicate; Association (psychology); Numerical cognition; Embodied cognition; Fluency; Cognitive psychology; Reading (process); Developmental psychology; Social psychology; Cognition; Mathematics; Statistics; Computer science; Mathematics education; Psychotherapist; Artificial intelligence","score_opus":0.19253308118963355,"score_gpt":0.583398117003364,"score_spread":0.39086503581373044,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3024441113","genre_codex":"dataset","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.041941505,0.0026795403,0.036829192,0.013920582,0.022648148,0.045182675,0.61288553,0.004823074,0.21908975],"genre_scores_gemma":[0.14393353,0.002967905,0.09150668,0.012175714,0.0026345688,0.16633534,0.29261085,0.0052006356,0.2826347],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9836469,0.0038400844,0.0027651456,0.0023724514,0.006533519,0.0008419415],"domain_scores_gemma":[0.82007664,0.018435856,0.006512758,0.077448376,0.07476708,0.002759418],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.033810418,0.002075807,0.0016821352,0.005708597,0.005203678,0.0034333987,0.0051097716,0.0023578014,0.21743546],"category_scores_gemma":[0.15883344,0.0017224426,0.003079403,0.009421633,0.0018231136,0.003986138,0.004724834,0.0034953675,0.117759585],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0027003565,0.0019699638,0.011612998,0.0022625092,0.0004724841,0.00033365007,0.003869097,0.00039050842,0.0047252337,0.007287824,0.80060303,0.16377237],"study_design_scores_gemma":[0.0022038284,0.0011294162,0.08807663,0.0012062,0.0005066036,0.00037840664,0.0025158238,0.00027100946,0.0045897444,0.009958455,0.88882935,0.0003344941],"about_ca_topic_score_codex":0.04979805,"about_ca_topic_score_gemma":0.053549923,"teacher_disagreement_score":0.96618956,"about_ca_system_score_codex":0.0027973547,"about_ca_system_score_gemma":0.010001925,"threshold_uncertainty_score":0.7273941},"labels":[],"label_agreement":null},{"id":"W3030344239","doi":"10.1177/2515245920902370","title":"Average Power: A Cautionary Note","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":24,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Kellogg's (Canada)","funders":"","keywords":"Replication (statistics); Power (physics); Statistics; Point estimation; Point (geometry); Interval (graph theory); Econometrics; Set (abstract data type); Confidence interval; Computer science; Statistical power; Mathematics","score_opus":0.6789778041158172,"score_gpt":0.7176353302788105,"score_spread":0.03865752616299334,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3030344239","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0047577326,0.05708242,0.12317556,0.716057,0.08139179,0.00073778717,0.0011039311,0.001679207,0.014014534],"genre_scores_gemma":[0.14145187,0.015939249,0.17340918,0.59363174,0.061508518,0.0034446924,0.00028675326,0.0010164299,0.0093116155],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7252182,0.15802996,0.039650884,0.031752933,0.043338276,0.0020098633],"domain_scores_gemma":[0.31418347,0.58027357,0.012108487,0.048607808,0.042514164,0.0023124106],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.26050428,0.0036563708,0.0070547042,0.007771486,0.0052482807,0.0099502755,0.017006261,0.015112981,0.00382148],"category_scores_gemma":[0.6142036,0.0018760274,0.0071361875,0.0076077124,0.03479061,0.01843959,0.007332931,0.05810202,0.0034960816],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010450592,0.00018335035,0.009801473,0.008427889,0.0019577115,0.0038811406,0.013834671,0.0022400378,0.0012995173,0.26059517,0.54609555,0.15063836],"study_design_scores_gemma":[0.0003937431,0.00028368583,0.005616993,0.008533682,0.00072272104,0.0033086939,0.002816816,0.006652426,0.0028542466,0.62942755,0.33883402,0.0005554055],"about_ca_topic_score_codex":0.008910339,"about_ca_topic_score_gemma":0.008863699,"teacher_disagreement_score":0.73949575,"about_ca_system_score_codex":0.006079804,"about_ca_system_score_gemma":0.007129454,"threshold_uncertainty_score":0.9119299},"labels":[],"label_agreement":null},{"id":"W3034580050","doi":"10.1177/2515245920902743","title":"The Unbearable Lightness of Attentional Cuing by Symbolic Magnitude: Commentary on the Registered Replication Report by Colling et al.","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Cognitive and developmental aspects of mathematical skills","field":"Mathematics","cited_by":9,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Deutsche Forschungsgemeinschaft","keywords":"Lightness; Replication (statistics); Magnitude (astronomy); Psychology; Cognitive psychology; Social psychology; Computer science; Artificial intelligence; Mathematics; Statistics; Physics","score_opus":0.12856113564463587,"score_gpt":0.5572420385984878,"score_spread":0.42868090295385186,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3034580050","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0003007076,0.008069786,0.00042657118,0.9319079,0.058161493,0.00002448372,0.00024078779,0.000052936954,0.0008153359],"genre_scores_gemma":[0.0070985975,0.0037455366,0.0008063061,0.9263131,0.060358886,0.00015540735,0.000093102455,0.00010952724,0.0013194332],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.95998335,0.013502333,0.006633604,0.0067940177,0.011917285,0.0011693757],"domain_scores_gemma":[0.57722163,0.3367303,0.010019453,0.016865201,0.055012323,0.004151101],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.05289628,0.0015326974,0.002782646,0.0020895128,0.0060089137,0.005355645,0.015930017,0.046656,0.008193325],"category_scores_gemma":[0.32081527,0.001687888,0.0041819043,0.0023375945,0.014277094,0.0073379655,0.00472537,0.06820608,0.006876828],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030012362,0.00003062858,0.00029037896,0.0010220945,0.00018868923,0.00031299214,0.0017363919,0.00007565465,0.00019812268,0.004473755,0.9751947,0.016176542],"study_design_scores_gemma":[0.00070230255,0.0001908711,0.002725769,0.006635805,0.0006669971,0.00094758085,0.0033610414,0.0004828031,0.0018218096,0.034304958,0.94785184,0.00030824682],"about_ca_topic_score_codex":0.042391885,"about_ca_topic_score_gemma":0.039419413,"teacher_disagreement_score":0.94710374,"about_ca_system_score_codex":0.0063215676,"about_ca_system_score_gemma":0.013520131,"threshold_uncertainty_score":0.27974558},"labels":[],"label_agreement":null},{"id":"W3046471626","doi":"10.1177/2515245920974622","title":"A Multilab Study of Bilingual Infants: Exploring the Preference for Infant-Directed Speech","year":2021,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Language Development and Disorders","field":"Psychology","cited_by":78,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Manitoba; University of Ottawa; McGill University; University of British Columbia","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Economic and Social Research Council; Agence Nationale de la Recherche","keywords":"Preference; Active listening; Psychology; Developmental psychology; Diversity (politics); Linguistics; Communication; Mathematics; Sociology","score_opus":0.19029219943834427,"score_gpt":0.5788731476030625,"score_spread":0.3885809481647182,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3046471626","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99969196,0.0000324766,0.0000258909,0.000004133231,6.835162e-7,0.000004666667,0.000013665984,8.192328e-7,0.00022572596],"genre_scores_gemma":[0.99888176,0.00010849977,0.00023938602,0.000030775747,0.0000035654057,0.000034535242,0.000053625496,0.00000346772,0.0006443439],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99966,0.00010348793,0.00002147544,0.00007445225,0.00007356506,0.00006712262],"domain_scores_gemma":[0.9990557,0.00029198197,0.00020481154,0.00006755642,0.00015569951,0.00022421712],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00074176106,0.00040280804,0.00040643202,0.00068027264,0.0007249363,0.0006686475,0.00021361098,0.00034974757,0.0011990058],"category_scores_gemma":[0.00213719,0.00029348503,0.0002185913,0.0002524747,0.00045700106,0.00034798533,0.00083590235,0.00047656562,0.00035460517],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024673978,0.0028582804,0.7156867,0.00033912342,0.00010478768,0.007369676,0.08085624,0.0001087735,0.15800974,0.00033580154,0.00032048457,0.031543],"study_design_scores_gemma":[0.000032487624,0.0040968726,0.968891,0.000025832049,0.00005411545,0.00362128,0.017484875,0.00016745881,0.0046663363,0.00007662189,0.00085400615,0.000029032179],"about_ca_topic_score_codex":0.005592879,"about_ca_topic_score_gemma":0.011604241,"teacher_disagreement_score":0.005592879,"about_ca_system_score_codex":0.0003636107,"about_ca_system_score_gemma":0.00035622172,"threshold_uncertainty_score":0.011120677},"labels":[],"label_agreement":null},{"id":"W3095583164","doi":"10.1177/2515245920951747","title":"Your Coefficient Alpha Is Probably Wrong, but Which Coefficient Omega Is Right? A Tutorial on Using R to Obtain Better Reliability Estimates","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":542,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Omega; Confusion; Reliability (semiconductor); Construct (python library); Alpha (finance); Variety (cybernetics); Quality (philosophy); Confirmatory factor analysis; Cronbach's alpha; Computer science; Correlation coefficient; Statistics; Mathematics; Psychology; Epistemology; Physics; Psychometrics; Structural equation modeling; Philosophy; Programming language; Thermodynamics","score_opus":0.3780115946846152,"score_gpt":0.6190029165631815,"score_spread":0.2409913218785663,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3095583164","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0038157718,0.04787176,0.8112847,0.06743099,0.0168125,0.00047598925,0.0026633362,0.009432685,0.040212225],"genre_scores_gemma":[0.051017087,0.046891347,0.84927875,0.016084101,0.0077987495,0.0021679138,0.0021300334,0.00914263,0.015489422],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9474371,0.034987524,0.0052088317,0.003653409,0.008046754,0.00066643156],"domain_scores_gemma":[0.7837873,0.16364495,0.011826377,0.013911488,0.025663551,0.0011663486],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.04655836,0.002976729,0.0021514804,0.0068031037,0.0017272572,0.005904057,0.0029865794,0.003524924,0.020696683],"category_scores_gemma":[0.31876016,0.0016005185,0.0024075268,0.00867289,0.004762382,0.009216439,0.0028369534,0.008482761,0.022639908],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00012896743,0.00006060224,0.0026524668,0.0033878167,0.00027149369,0.00027738858,0.002945228,0.0014381985,0.0023344802,0.12914743,0.43799445,0.41936153],"study_design_scores_gemma":[0.000063318876,0.0001643799,0.003616639,0.0068689436,0.0002102924,0.0008731795,0.0014039021,0.0048606065,0.0043142885,0.3360133,0.6413276,0.00028357777],"about_ca_topic_score_codex":0.0017181851,"about_ca_topic_score_gemma":0.0018346572,"teacher_disagreement_score":0.9534416,"about_ca_system_score_codex":0.00160052,"about_ca_system_score_gemma":0.0024000076,"threshold_uncertainty_score":0.24622709},"labels":[],"label_agreement":null},{"id":"W3098973543","doi":"10.1177/2515245920945963","title":"Many Labs 5: Registered Replication of Albarracín et al. (2008), Experiment 5","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Mental Health Research Topics","field":"Psychology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"Association for Psychological Science","keywords":"Replication (statistics); Protocol (science); Psychology; Moderation; Affect (linguistics); Sample size determination; Task (project management); Social psychology; Cognitive psychology; Medicine; Statistics; Communication; Mathematics; Alternative medicine","score_opus":0.3270489241439772,"score_gpt":0.6988042525603092,"score_spread":0.371755328416332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3098973543","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.82283646,0.0013092299,0.036536235,0.004778696,0.0035871444,0.051969532,0.009147048,0.0031594518,0.06667626],"genre_scores_gemma":[0.6604739,0.0006598174,0.08466623,0.012255744,0.001319238,0.1840002,0.0075716074,0.0013052955,0.047748007],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.9937808,0.002816708,0.00073071517,0.0013753753,0.001011413,0.00028506323],"domain_scores_gemma":[0.97156996,0.0089091575,0.0018271828,0.012234762,0.00440193,0.0010569257],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.010427629,0.0009880315,0.0013217259,0.0005081054,0.002550676,0.0021085467,0.0018095408,0.0021846958,0.025141275],"category_scores_gemma":[0.044949777,0.001230585,0.0015916069,0.00043375886,0.0016186992,0.003174179,0.002217398,0.004002013,0.009002021],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.096020095,0.09365627,0.04973671,0.0104569,0.0026576784,0.001782422,0.034624055,0.003986046,0.16583231,0.03003118,0.15180102,0.35941523],"study_design_scores_gemma":[0.054033592,0.09623038,0.41961884,0.0009816688,0.0033143256,0.0017694542,0.0045559267,0.0054110065,0.038280036,0.062187783,0.31226298,0.0013540041],"about_ca_topic_score_codex":0.0016430503,"about_ca_topic_score_gemma":0.0023309616,"teacher_disagreement_score":0.98957235,"about_ca_system_score_codex":0.0008113215,"about_ca_system_score_gemma":0.0018663902,"threshold_uncertainty_score":0.08410591},"labels":[],"label_agreement":null},{"id":"W3108041100","doi":"10.1177/2515245920952393","title":"Measurement Schmeasurement: Questionable Measurement Practices and How to Avoid Them","year":2020,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":812,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Transparency (behavior); Misrepresentation; Scope (computer science); Set (abstract data type); External validity; Ignorance; Construct (python library); Replication (statistics); Computer science; Psychology; Data science; Social psychology; Political science; Computer security; Law; Mathematics","score_opus":0.8481492272284977,"score_gpt":0.6781301132828519,"score_spread":0.17001911394564584,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3108041100","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018761797,0.045408074,0.642478,0.26620734,0.008605335,0.0053337244,0.00062019535,0.001468164,0.011117337],"genre_scores_gemma":[0.2976503,0.009661751,0.62063706,0.052796632,0.0037801825,0.013428419,0.0002629376,0.0005808243,0.0012018889],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.15330313,0.6611352,0.0786564,0.018533029,0.08625667,0.0021155132],"domain_scores_gemma":[0.064400464,0.7439002,0.07106735,0.075173944,0.043580938,0.0018772112],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.7166332,0.003978251,0.0068597975,0.011099924,0.0070903297,0.016514843,0.008199957,0.01148854,0.002154646],"category_scores_gemma":[0.8838993,0.0039909077,0.004661659,0.011735091,0.04587048,0.027966976,0.018135663,0.019057762,0.0010884524],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0008724346,0.00033306828,0.030827593,0.026389256,0.0048731314,0.0009977742,0.051771343,0.003812917,0.0022683009,0.4355369,0.04395489,0.39836234],"study_design_scores_gemma":[0.0005685116,0.0005697464,0.009524012,0.046879064,0.001362725,0.0009357757,0.008762559,0.0135085415,0.00464283,0.8352172,0.07729287,0.00073627237],"about_ca_topic_score_codex":0.005046587,"about_ca_topic_score_gemma":0.0043726997,"teacher_disagreement_score":0.98851144,"about_ca_system_score_codex":0.015337115,"about_ca_system_score_gemma":0.02480628,"threshold_uncertainty_score":0.34944177},"labels":[],"label_agreement":null},{"id":"W3167015291","doi":"10.1177/25152459211047228","title":"A Guide to Visualizing Trajectories of Change With Confidence Bands and Raw Data","year":2021,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Mental Health Research Topics","field":"Psychology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Carleton University","funders":"","keywords":"Raw data; Graphics; Computer science; Latent variable; Latent variable model; Software; Confidence interval; Latent growth modeling; Data science; Statistics; Data mining; Machine learning; Computer graphics (images); Mathematics","score_opus":0.4427576191023546,"score_gpt":0.7213997723793312,"score_spread":0.27864215327697656,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3167015291","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0022474509,0.0074535795,0.80040365,0.0044526868,0.0019014542,0.0010838876,0.050217234,0.08217102,0.050069083],"genre_scores_gemma":[0.013393425,0.007849616,0.87687474,0.0026032215,0.00055932614,0.003645762,0.02133048,0.030531839,0.04321163],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9980743,0.00096325483,0.00021386553,0.0002369663,0.00044046316,0.00007121881],"domain_scores_gemma":[0.97848403,0.015854735,0.00081419223,0.0009613475,0.0034406239,0.00044510356],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0045943195,0.0025096496,0.0014514489,0.0042120945,0.00078790734,0.0044345227,0.0023311414,0.0017313402,0.19813661],"category_scores_gemma":[0.039799068,0.0015441783,0.002024569,0.0037488346,0.000653905,0.003834186,0.0018334796,0.0030644408,0.05931599],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018923094,0.00008498136,0.00087991037,0.0019474508,0.000097928874,0.0002585405,0.0014997615,0.004053865,0.0021670081,0.030221656,0.79522216,0.16337746],"study_design_scores_gemma":[0.00009273254,0.00008345398,0.0017247084,0.0015125884,0.000057316785,0.00054632296,0.00051144225,0.00906088,0.0016808044,0.048457522,0.9361312,0.00014109512],"about_ca_topic_score_codex":0.0043756133,"about_ca_topic_score_gemma":0.0069133616,"teacher_disagreement_score":0.9954057,"about_ca_system_score_codex":0.000999208,"about_ca_system_score_gemma":0.0018460469,"threshold_uncertainty_score":0.662833},"labels":[],"label_agreement":null},{"id":"W3193469532","doi":"10.1177/25152459211035109","title":"Summary Plots With Adjusted Error Bars: The <i>superb</i> Framework With an Implementation in R","year":2021,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":43,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Moncton; University of Ottawa","funders":"","keywords":"Confidence interval; Point (geometry); Error bar; Computer science; Plot (graphics); Statistics; Software; Point estimation; Type I and type II errors; Population; Sampling (signal processing); Limit (mathematics); Standard error; Mathematics; Programming language; Computer vision","score_opus":0.607320642218016,"score_gpt":0.7027075971575393,"score_spread":0.09538695493952332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3193469532","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00112755,0.0020765925,0.708036,0.0024630872,0.0018820374,0.0021014332,0.096628934,0.18101786,0.0046665105],"genre_scores_gemma":[0.013825506,0.0013001815,0.90388143,0.0010435904,0.0005977126,0.012365655,0.02008495,0.044215724,0.0026853175],"study_design_codex":"not_applicable","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.94808066,0.032143608,0.007504809,0.005691541,0.0058086524,0.00077082665],"domain_scores_gemma":[0.64560837,0.29216805,0.020648511,0.025583124,0.014693893,0.0012980424],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06709173,0.005722585,0.0064140144,0.014553184,0.0010984846,0.010085106,0.0065369178,0.004169959,0.16836727],"category_scores_gemma":[0.31293735,0.004438331,0.01037097,0.01671793,0.0021274872,0.008137388,0.0065913796,0.007595004,0.0395073],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019108511,0.0001988048,0.003503409,0.031859312,0.0071256724,0.00054145965,0.0018519824,0.00580439,0.0024477525,0.058406554,0.69438267,0.19196709],"study_design_scores_gemma":[0.0019552812,0.00031488758,0.0058174795,0.0072743567,0.002753867,0.00083049654,0.00041809582,0.027693596,0.006806163,0.17988604,0.7654719,0.00077790883],"about_ca_topic_score_codex":0.0030161007,"about_ca_topic_score_gemma":0.003033918,"teacher_disagreement_score":0.9329083,"about_ca_system_score_codex":0.0019810305,"about_ca_system_score_gemma":0.0055908635,"threshold_uncertainty_score":0.5632446},"labels":[],"label_agreement":null},{"id":"W3202884280","doi":"10.1177/25152459211045334","title":"Doing Better Data Visualization","year":2021,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Visualization; Computer science; Data science; Data visualization; Focus (optics); Information visualization; Code (set theory); Creative visualization; World Wide Web; Human–computer interaction; Data mining","score_opus":0.13286475681795973,"score_gpt":0.6140051293640173,"score_spread":0.48114037254605757,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3202884280","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032853899,0.0059838877,0.888305,0.033766594,0.005347955,0.00061618426,0.006213159,0.03623518,0.020246644],"genre_scores_gemma":[0.015353103,0.003624611,0.95662105,0.0044767233,0.0016189755,0.00074021996,0.0025870241,0.009332745,0.0056455596],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9597928,0.021802846,0.0034456581,0.006208724,0.007982788,0.00076717563],"domain_scores_gemma":[0.84751016,0.09066263,0.0060515488,0.036387227,0.016469615,0.0029189016],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.045387834,0.004180606,0.0034461808,0.011436374,0.0038407338,0.021163534,0.0042121927,0.004322674,0.056190934],"category_scores_gemma":[0.19070448,0.002203649,0.00525957,0.010794747,0.0038243944,0.024955459,0.010712637,0.010249173,0.027519103],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018640366,0.00021319784,0.0031461634,0.004180258,0.0005833626,0.00034485012,0.008814277,0.0032769616,0.0055245594,0.09957528,0.3931042,0.48105058],"study_design_scores_gemma":[0.000096077,0.000069793394,0.0011925643,0.001331622,0.00015768856,0.0004893928,0.0017623855,0.008138948,0.004203146,0.22613354,0.7561877,0.0002371617],"about_ca_topic_score_codex":0.0020273111,"about_ca_topic_score_gemma":0.0034816687,"teacher_disagreement_score":0.95461214,"about_ca_system_score_codex":0.0017268339,"about_ca_system_score_gemma":0.005929888,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"agree"},{"id":"W4292384610","doi":"10.1177/25152459221101816","title":"Effective Maps, Easily Done: Visualizing Geo-Psychological Differences Using Distance Weights","year":2022,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Urban Transport and Accessibility","field":"Social Sciences","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Weighting; Computer science; Coding (social sciences); Complement (music); Scale (ratio); Data mining; Artificial intelligence; Information retrieval; Cartography; Geography; Statistics; Mathematics","score_opus":0.09082553419603911,"score_gpt":0.5838870079131621,"score_spread":0.49306147371712294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4292384610","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017597828,0.0006444167,0.95838106,0.0009770702,0.00019940114,0.00020972967,0.0042292303,0.010823003,0.0069382847],"genre_scores_gemma":[0.12283128,0.0008980822,0.86803275,0.00014715827,0.00006112966,0.00058978185,0.0026381935,0.002560207,0.0022414648],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.9986847,0.00065170554,0.00010050746,0.00021647444,0.00027400293,0.000072576964],"domain_scores_gemma":[0.99374217,0.0041460306,0.00045979617,0.00064223254,0.00080622634,0.00020349273],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0029959537,0.0014913171,0.0006873528,0.0051667164,0.0008596506,0.0049593123,0.001539509,0.0010762777,0.018370764],"category_scores_gemma":[0.02680272,0.00082489505,0.0012193797,0.0052629514,0.0010153232,0.0060452814,0.0036273596,0.0016548313,0.0028550257],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039047748,0.00018094081,0.013237408,0.0021921117,0.00041275396,0.00040732423,0.014648983,0.03385445,0.01023456,0.15043716,0.083528504,0.6904753],"study_design_scores_gemma":[0.00026097236,0.00022631933,0.023468219,0.00077428157,0.0002537836,0.00063890935,0.008809313,0.24319066,0.014032533,0.46023026,0.24768507,0.00042970479],"about_ca_topic_score_codex":0.0048573576,"about_ca_topic_score_gemma":0.0067023677,"teacher_disagreement_score":0.018370764,"about_ca_system_score_codex":0.0007200931,"about_ca_system_score_gemma":0.001174056,"threshold_uncertainty_score":0.061456382},"labels":[],"label_agreement":null},{"id":"W4361012827","doi":"10.1177/25152459221144986","title":"The Chinese Open Science Network (COSN): Building an Open Science Community From Scratch","year":2023,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"scientometrics and bibliometrics research","field":"Decision Sciences","cited_by":13,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Montreal Neurological Institute and Hospital","funders":"National Key Research and Development Program of China; National Natural Science Foundation of China","keywords":"Open science; Grassroots; Mainstream; China; Sociology; Political science; Public relations; Media studies; Politics; Law","score_opus":0.6851263766474375,"score_gpt":0.7785367102522119,"score_spread":0.09341033360477446,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4361012827","genre_codex":"other","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24893631,0.005048861,0.22837801,0.10312918,0.009307053,0.0055364254,0.0025620859,0.008621917,0.38848004],"genre_scores_gemma":[0.72215027,0.0040557077,0.13231675,0.008596502,0.0019422113,0.0049873693,0.0054525025,0.0014627195,0.11903601],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.995619,0.0017759145,0.00020326937,0.0005092687,0.0012032613,0.00068921736],"domain_scores_gemma":[0.97923857,0.0026092723,0.0009068138,0.0024637252,0.0038845001,0.01089724],"candidate_categories":["open_science"],"consensus_categories":[],"category_scores_codex":[0.009863044,0.00061855366,0.00032928574,0.0025395462,0.0124004865,0.005689812,0.0018545452,0.001958313,0.013022659],"category_scores_gemma":[0.012771638,0.00039749037,0.00067247584,0.002358073,0.0036288798,0.013225188,0.016454047,0.0025526287,0.002660814],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00032971182,0.00033678312,0.018868154,0.0011775705,0.00007496366,0.0020975086,0.038790423,0.0020116274,0.008610838,0.23957677,0.28450483,0.4036208],"study_design_scores_gemma":[0.00007572011,0.00017333201,0.0061337715,0.00034959643,0.000042106705,0.00030116495,0.010272684,0.0049917977,0.0019580263,0.0364129,0.93914044,0.00014851756],"about_ca_topic_score_codex":0.01109501,"about_ca_topic_score_gemma":0.013487918,"teacher_disagreement_score":0.99814546,"about_ca_system_score_codex":0.00293105,"about_ca_system_score_gemma":0.026372269,"threshold_uncertainty_score":0.052161396},"labels":[],"label_agreement":null},{"id":"W4380537158","doi":"10.1177/25152459221140388","title":"Using Market-Research Panels for Behavioral Science: An Overview and Tutorial","year":2023,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Survey Methodology and Nonresponse","field":"Social Sciences","cited_by":39,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Queen's University","funders":"","keywords":"Demographics; Sample (material); Quality (philosophy); Market research; Survey data collection; Data science; Behavioural sciences; Psychology; Marketing; Computer science; Business; Sociology; Statistics","score_opus":0.8393164863716058,"score_gpt":0.7957092207838767,"score_spread":0.043607265587729094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380537158","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029702242,0.23198222,0.6086472,0.021199768,0.009665079,0.00591561,0.00517373,0.011666101,0.102780096],"genre_scores_gemma":[0.013171423,0.3055576,0.54882824,0.015253902,0.012791718,0.011065724,0.0056755063,0.0042858785,0.083370015],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99500763,0.002759989,0.0004406735,0.00038031553,0.0011870497,0.00022427972],"domain_scores_gemma":[0.9850609,0.01036613,0.0011206919,0.0007720085,0.0016760218,0.001004165],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.01020231,0.0026345907,0.0015465718,0.0053713685,0.0010358489,0.003815701,0.002077562,0.0027768458,0.03631242],"category_scores_gemma":[0.014466848,0.0019546861,0.0020282152,0.005705818,0.0010319322,0.008382375,0.0029173542,0.00477172,0.034027696],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009890714,0.00042278832,0.0011371898,0.004016598,0.00008164834,0.00028555226,0.00087838183,0.0012029195,0.0024508967,0.033328664,0.3267503,0.6293461],"study_design_scores_gemma":[0.000021012664,0.00013593533,0.0011646092,0.0021472455,0.000018231709,0.0005969382,0.00015158825,0.0010070849,0.0005707476,0.012759116,0.9813633,0.00006416705],"about_ca_topic_score_codex":0.0011923148,"about_ca_topic_score_gemma":0.0025238995,"teacher_disagreement_score":0.03631242,"about_ca_system_score_codex":0.0011838367,"about_ca_system_score_gemma":0.0020366528,"threshold_uncertainty_score":0.12147719},"labels":[],"label_agreement":null},{"id":"W4384938832","doi":"10.1177/25152459231162567","title":"Multidimensional Signals and Analytic Flexibility: Estimating Degrees of Freedom in Human-Speech Analyses","year":2023,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Sensory Analysis and Statistical Methods","field":"Agricultural and Biological Sciences","cited_by":32,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Carleton University; Université Laval; University of Alberta; University of Calgary","funders":"Ministerio de Ciencia e Innovación; Nederlandse Organisatie voor Wetenschappelijk Onderzoek; Deutsche Forschungsgemeinschaft; National Research University Higher School of Economics; Agence Nationale de la Recherche; Syracuse University; National Science Foundation","keywords":"Flexibility (engineering); Set (abstract data type); Construct (python library); Computer science; Variety (cybernetics); Bayesian probability; Certainty; Quality (philosophy); Econometrics; Interpretation (philosophy); Data science; Psychology; Statistics; Artificial intelligence; Mathematics; Epistemology","score_opus":0.26152394787874805,"score_gpt":0.6074150001455154,"score_spread":0.34589105226676736,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4384938832","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050135676,0.0035562105,0.94046307,0.0018298314,0.00019171559,0.0005850091,0.00018277272,0.00022755265,0.0028281908],"genre_scores_gemma":[0.5717053,0.0009283856,0.4245032,0.0004375363,0.00016636847,0.0017419561,0.00018923548,0.00014347522,0.0001846249],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.5327247,0.4039968,0.018543808,0.020303179,0.023207473,0.0012240985],"domain_scores_gemma":[0.14868407,0.76183057,0.026524736,0.053836323,0.008345466,0.0007788053],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.34368166,0.0023762092,0.0024972302,0.011323856,0.0029587245,0.01052126,0.0035940157,0.0023724276,0.0019932778],"category_scores_gemma":[0.70360094,0.0019845653,0.004691745,0.010068506,0.016255554,0.012735424,0.010160921,0.0061019245,0.00022963915],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015572348,0.00034397157,0.13362554,0.0061243265,0.015755259,0.00068225403,0.05485704,0.0454545,0.0047625895,0.31928286,0.0031039861,0.41445044],"study_design_scores_gemma":[0.0002036209,0.00058209104,0.045267016,0.0023372264,0.0015792693,0.000659471,0.0060417885,0.07648991,0.0034769913,0.8539767,0.008699726,0.00068614725],"about_ca_topic_score_codex":0.003236917,"about_ca_topic_score_gemma":0.0033398105,"teacher_disagreement_score":0.6563183,"about_ca_system_score_codex":0.0034903318,"about_ca_system_score_gemma":0.0033678769,"threshold_uncertainty_score":0.80935735},"labels":[],"label_agreement":null},{"id":"W4391300488","doi":"10.1177/25152459231213808","title":"A Delphi Study to Strengthen Research-Methods Training in Undergraduate Psychology Programs","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Delphi Technique in Research","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Medical Research Council; British Psychological Society; Canadian Institutes of Health Research; Arnold Ventures","keywords":"Accreditation; Delphi method; Curriculum; Medical education; Descriptive statistics; Psychology; Delphi; Process (computing); Qualitative research; Research design; Psychological research; Applied psychology; Pedagogy; Social psychology; Computer science; Medicine; Sociology; Social science","score_opus":0.5673271503893853,"score_gpt":0.7620638067502759,"score_spread":0.19473665636089055,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391300488","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.86421156,0.00019090805,0.07250428,0.0056250063,0.00038849126,0.04399581,0.00015453585,0.00015769762,0.012771718],"genre_scores_gemma":[0.8463917,0.0002414242,0.10127968,0.0025752515,0.0000927324,0.046853825,0.00009826631,0.00005923344,0.002407952],"study_design_codex":"qualitative","study_design_gemma":"qualitative","domain_scores_codex":[0.75514394,0.22462268,0.0056813955,0.0032729693,0.0053976164,0.005881459],"domain_scores_gemma":[0.72997767,0.21746047,0.005250836,0.01025199,0.03030029,0.0067587583],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2233965,0.0008615937,0.00073745317,0.0026051656,0.008497838,0.0028415015,0.0018719629,0.0024537994,0.005092263],"category_scores_gemma":[0.20531039,0.0012212169,0.00073477905,0.0020625012,0.004603885,0.0048162187,0.00796909,0.003929466,0.0008603525],"study_design_candidate":"qualitative","study_design_consensus":"qualitative","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0009660583,0.003678302,0.013928073,0.0020944735,0.000044116703,0.0012771632,0.82940495,0.0016982516,0.008169738,0.013623118,0.008911642,0.11620417],"study_design_scores_gemma":[0.0006711632,0.0057921098,0.025361601,0.001961286,0.000051556417,0.0006923361,0.8719073,0.008906468,0.0072329496,0.012336442,0.06482839,0.00025833928],"about_ca_topic_score_codex":0.0024884383,"about_ca_topic_score_gemma":0.003990449,"teacher_disagreement_score":0.7766035,"about_ca_system_score_codex":0.0053326227,"about_ca_system_score_gemma":0.014341229,"threshold_uncertainty_score":0.95769036},"labels":[],"label_agreement":null},{"id":"W4391548201","doi":"10.1177/25152459231225163","title":"The Moderating Role of Culture in the Generalizability of Psychological Phenomena","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Cultural Differences and Values","field":"Psychology","cited_by":24,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Canadian Institute for Advanced Research; University of British Columbia; York University","funders":"","keywords":"Generalizability theory; Psychology; Moderation; Social psychology; Developmental psychology","score_opus":0.1640138617528793,"score_gpt":0.6169027519269429,"score_spread":0.4528888901740636,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391548201","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.97649616,0.0018485301,0.007189749,0.0016296925,0.0002570007,0.00013670127,0.00019583793,0.00004579076,0.012200509],"genre_scores_gemma":[0.9975768,0.00023363829,0.0013738313,0.00026937446,0.00006180522,0.000059706224,0.000068655936,0.000044436973,0.00031168843],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96064085,0.02796141,0.001656507,0.0049790805,0.0038835441,0.00087869726],"domain_scores_gemma":[0.5834315,0.34514156,0.015631245,0.043332398,0.009011809,0.0034515876],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.043386415,0.00072142936,0.00083297904,0.0016065569,0.0019248191,0.0036995206,0.001126766,0.0013487674,0.006500487],"category_scores_gemma":[0.22885518,0.0006267722,0.001244468,0.001804352,0.0051636314,0.003134353,0.0033803263,0.0031595507,0.0003176635],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014828547,0.000616121,0.90795654,0.0005713573,0.0029887862,0.00029815463,0.024761993,0.000712847,0.0037867394,0.01045664,0.0007488883,0.045619097],"study_design_scores_gemma":[0.00012763472,0.0005847208,0.96161544,0.00027961883,0.0011281855,0.00044777067,0.010347305,0.00159086,0.0029626403,0.018905593,0.0019331549,0.000077074255],"about_ca_topic_score_codex":0.0058260825,"about_ca_topic_score_gemma":0.0052736215,"teacher_disagreement_score":0.9566136,"about_ca_system_score_codex":0.00090657006,"about_ca_system_score_gemma":0.0018012774,"threshold_uncertainty_score":0.22945201},"labels":[],"label_agreement":null},{"id":"W4391548211","doi":"10.1177/25152459231213375","title":"A Multilab Replication of the Induced-Compliance Paradigm of Cognitive Dissonance","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Social and Intergroup Psychology","field":"Social Sciences","cited_by":32,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"National Research University Higher School of Economics; Russian Science Foundation; Macquarie University; Japan Society for the Promotion of Science; John Templeton Foundation","keywords":"Cognitive dissonance; Attitude change; Psychology; Self-justification; Self-perception theory; Social psychology; Popularity; Constructive; Cognition; Exploratory research; Sociology; Social science","score_opus":0.17344572006759668,"score_gpt":0.6384609096871044,"score_spread":0.4650151896195078,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391548211","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95429486,0.00011725729,0.030444348,0.0002824994,0.0002211372,0.006793753,0.00047092594,0.00022492485,0.0071501527],"genre_scores_gemma":[0.8898002,0.00011895048,0.06935419,0.0009963154,0.0002333121,0.033388607,0.00063701184,0.000195941,0.005275507],"study_design_codex":"bench_or_experimental","study_design_gemma":"observational","domain_scores_codex":[0.9853887,0.00795398,0.0012176299,0.0027600967,0.0022685842,0.00041108005],"domain_scores_gemma":[0.9518656,0.022306668,0.0049579497,0.013808466,0.0059552644,0.0011060587],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.013140297,0.0009350882,0.00077497767,0.0007245944,0.0017200385,0.0014957307,0.0015274645,0.0012048882,0.0070827133],"category_scores_gemma":[0.045614045,0.0006523435,0.00075730955,0.0005847405,0.0025493004,0.0016292111,0.0029656545,0.0023438816,0.0012076246],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.03791595,0.07352078,0.078413725,0.005155589,0.0010798892,0.0022559643,0.07816102,0.005452504,0.3955511,0.032435924,0.007141503,0.28291604],"study_design_scores_gemma":[0.01921673,0.17215326,0.42559803,0.0006932014,0.0011851719,0.0035918066,0.016168712,0.02058564,0.20048851,0.059738852,0.079237066,0.0013429833],"about_ca_topic_score_codex":0.0006972359,"about_ca_topic_score_gemma":0.00084969937,"teacher_disagreement_score":0.9868597,"about_ca_system_score_codex":0.00070929516,"about_ca_system_score_gemma":0.0012276337,"threshold_uncertainty_score":0.06949335},"labels":[],"label_agreement":null},{"id":"W4392022385","doi":"10.1177/25152459231217932","title":"Tempered Expectations: A Tutorial for Calculating and Interpreting Prediction Intervals in the Context of Replications","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Mental Health Research Topics","field":"Psychology","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"Social Sciences and Humanities Research Council","keywords":"Replication (statistics); Consistency (knowledge bases); Computer science; Context (archaeology); Statistic; Confidence interval; Interpretation (philosophy); Interval (graph theory); Prediction interval; Statistics; Artificial intelligence; Data science; Machine learning; Mathematics","score_opus":0.1850727433818254,"score_gpt":0.6805398545476518,"score_spread":0.49546711116582637,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392022385","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00023207553,0.0015290912,0.9884615,0.0012693203,0.0006189637,0.0005234763,0.0005855398,0.0036635925,0.0031165415],"genre_scores_gemma":[0.0048460094,0.0015197739,0.986484,0.00060326105,0.0004945914,0.0021789977,0.0003948092,0.002110313,0.0013682309],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8879286,0.089685835,0.009855941,0.0033106226,0.008669788,0.0005491878],"domain_scores_gemma":[0.5248259,0.4173413,0.013927791,0.024558013,0.018124199,0.0012228758],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.120065615,0.0036719055,0.002785904,0.00797033,0.0018117867,0.009325832,0.007160056,0.0048764125,0.045454204],"category_scores_gemma":[0.48757586,0.0034357926,0.006863339,0.006087141,0.0039793393,0.012842426,0.0045264657,0.011281754,0.019046381],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031926084,0.00013450441,0.0020536378,0.00611303,0.0006384708,0.00079005194,0.005494638,0.011307594,0.0019164878,0.38447076,0.12083437,0.46592718],"study_design_scores_gemma":[0.0002289347,0.00022970977,0.0014334704,0.005696253,0.00026531817,0.0010215108,0.0008314342,0.036322854,0.0031738428,0.64768136,0.30274373,0.00037168866],"about_ca_topic_score_codex":0.0032920782,"about_ca_topic_score_gemma":0.0029634302,"teacher_disagreement_score":0.8799344,"about_ca_system_score_codex":0.0027202815,"about_ca_system_score_gemma":0.006274931,"threshold_uncertainty_score":0.63497525},"labels":[],"label_agreement":null},{"id":"W4392854292","doi":"10.1177/25152459241231581","title":"Careless Responding: Why Many Findings Are Spurious or Spuriously Inflated","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Behavioral Health and Interventions","field":"Psychology","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Spurious relationship; Psychology; Publishing; Graduate students; Psychological science; Applied psychology; Computer science; Cognitive psychology; Social psychology; Pedagogy","score_opus":0.14373440790796269,"score_gpt":0.6319925264794342,"score_spread":0.4882581185714715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4392854292","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.20287606,0.14684576,0.39580518,0.18564314,0.021459894,0.008077303,0.005826554,0.0041838097,0.02928229],"genre_scores_gemma":[0.71579826,0.015060988,0.20368351,0.050300427,0.0046192994,0.005641758,0.0014583361,0.0015771089,0.001860362],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.42875576,0.33551347,0.09695335,0.040266376,0.095649555,0.00286149],"domain_scores_gemma":[0.06602894,0.78469193,0.056240354,0.062267136,0.02970804,0.001063579],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.46658298,0.0016451002,0.0027125643,0.012827383,0.0033288857,0.008434031,0.004402936,0.004539425,0.0037252535],"category_scores_gemma":[0.86353487,0.002172882,0.0045179822,0.009959915,0.018790297,0.010063099,0.006957151,0.0057002343,0.0012111743],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0024979913,0.00031710987,0.19219983,0.0680614,0.020042863,0.0044068564,0.072437435,0.0020937468,0.0058021406,0.07205333,0.062400017,0.49768737],"study_design_scores_gemma":[0.00090376224,0.001639359,0.20597802,0.08899829,0.013035757,0.007873399,0.03143769,0.008826366,0.017447026,0.38867688,0.2340441,0.0011394756],"about_ca_topic_score_codex":0.0026029502,"about_ca_topic_score_gemma":0.0037791817,"teacher_disagreement_score":0.533417,"about_ca_system_score_codex":0.0040417057,"about_ca_system_score_gemma":0.0065277233,"threshold_uncertainty_score":0.6577982},"labels":[],"label_agreement":null},{"id":"W4393325638","doi":"10.1177/25152459241236149","title":"The Causal Cookbook: Recipes for Propensity Scores, G-Computation, and Doubly Robust Standardization","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":22,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"Institut de Valorisation des Données","keywords":"Causal inference; Observational study; Identification (biology); Computer science; Consistency (knowledge bases); Causal model; Inference; Variable (mathematics); Estimator; Instrumental variable; Econometrics; Data science; Toolbox; Machine learning; Artificial intelligence; Mathematics; Statistics","score_opus":0.2889949678395071,"score_gpt":0.6290214928348979,"score_spread":0.3400265249953908,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4393325638","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00015146587,0.0006898388,0.9916453,0.00091783004,0.0004265779,0.00014706948,0.0007380326,0.0016823524,0.0036016053],"genre_scores_gemma":[0.0033997125,0.0010005288,0.9857841,0.0006279253,0.00030171804,0.00077594497,0.00053012813,0.0018443558,0.0057356204],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"not_applicable","domain_scores_codex":[0.99724483,0.001416228,0.00023137814,0.00033533483,0.0006871538,0.000085146385],"domain_scores_gemma":[0.9914677,0.0060350997,0.00031841325,0.0012451543,0.0007545706,0.00017906015],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0069952114,0.0024886841,0.0013742436,0.0028156263,0.0010647,0.0022963153,0.0027357345,0.002646459,0.08321889],"category_scores_gemma":[0.04119661,0.0015076437,0.0019997528,0.0032132172,0.0021662577,0.003632694,0.0026666918,0.0058418047,0.0285982],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000053714495,0.00007812343,0.00032031562,0.0006797,0.000080563135,0.00027623549,0.0003073091,0.010693346,0.00073350745,0.63895077,0.1436389,0.20418756],"study_design_scores_gemma":[0.000070878785,0.000030943866,0.00025974493,0.00021400786,0.000029039118,0.00022887524,0.000048925325,0.029171793,0.00060603645,0.7969133,0.17234594,0.00008046469],"about_ca_topic_score_codex":0.0034710485,"about_ca_topic_score_gemma":0.0055463547,"teacher_disagreement_score":0.08321889,"about_ca_system_score_codex":0.0012051011,"about_ca_system_score_gemma":0.0026719118,"threshold_uncertainty_score":0.27839494},"labels":[],"label_agreement":null},{"id":"W4403819045","doi":"10.1177/25152459241267902","title":"Registered Replication Report: A Large Multilab Cross-Cultural Conceptual Replication of Turri et al. (2015)","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Social and Intergroup Psychology","field":"Social Sciences","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Carleton University; University of Toronto","funders":"Fundação para a Ciência e a Tecnologia; Australian Research Council; Uniwersytet Wrocławski; John Templeton Foundation; Kultúrna a Edukacná Grantová Agentúra MŠVVaŠ SR; Social Sciences and Humanities Research Council of Canada; National Foundation for Science and Technology Development; Narodowym Centrum Nauki","keywords":"Vignette; Luck; Psychology; Epistemology; Intuition; Attribution; Social psychology; Philosophy","score_opus":0.1540658002854109,"score_gpt":0.6662957433260897,"score_spread":0.5122299430406787,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403819045","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.44026026,0.005448862,0.07917737,0.01426133,0.021537846,0.15647942,0.13492721,0.0055585094,0.1423492],"genre_scores_gemma":[0.3902455,0.0010669742,0.083449185,0.012264603,0.0019637214,0.4309651,0.039980717,0.0025642558,0.037499946],"study_design_codex":"not_applicable","study_design_gemma":"observational","domain_scores_codex":[0.9805431,0.008408328,0.0023136653,0.0036876204,0.00446846,0.00057882525],"domain_scores_gemma":[0.79970354,0.048818864,0.007798422,0.085112385,0.05631785,0.0022489696],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.035066687,0.0019062281,0.0027292387,0.0025808956,0.0068632476,0.005192749,0.003727884,0.0031492363,0.07699824],"category_scores_gemma":[0.21207058,0.0018560559,0.0038670923,0.0033384028,0.0033568463,0.0065166894,0.0047292397,0.007850985,0.03185766],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.018139675,0.01815143,0.036593914,0.015318961,0.0024841786,0.0020655352,0.08004324,0.002264796,0.01755978,0.026006537,0.53920627,0.24216573],"study_design_scores_gemma":[0.027520819,0.0067290408,0.23075016,0.0053377114,0.003008869,0.001590144,0.040009163,0.004359443,0.009628704,0.067410514,0.6018144,0.0018410784],"about_ca_topic_score_codex":0.015612385,"about_ca_topic_score_gemma":0.019794337,"teacher_disagreement_score":0.96493334,"about_ca_system_score_codex":0.002810069,"about_ca_system_score_gemma":0.0043901433,"threshold_uncertainty_score":0.25758475},"labels":[],"label_agreement":null},{"id":"W4403819046","doi":"10.1177/25152459241268220","title":"Robust Evidence for Knowledge Attribution and Luck: A Comment on Hall et al. (2024)","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Psychology of Moral and Emotional Judgment","field":"Neuroscience","cited_by":2,"is_retracted":false,"has_abstract":false,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Luck; Attribution; Psychology; Social psychology; Epistemology; Philosophy","score_opus":0.4541122258261099,"score_gpt":0.6055116206159522,"score_spread":0.15139939478984232,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4403819046","genre_codex":"commentary","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":"commentary","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00026369386,0.0024893056,0.00031653128,0.97874475,0.016555985,0.000010081018,0.00023784638,0.000025167254,0.001356532],"genre_scores_gemma":[0.0044820127,0.00065351394,0.00057092303,0.969242,0.023331754,0.000059748687,0.00006519306,0.000032712178,0.0015621675],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9691667,0.006421268,0.003491238,0.0074726935,0.011449567,0.0019984648],"domain_scores_gemma":[0.7404607,0.19643198,0.0074453466,0.013470181,0.03639899,0.0057927957],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.052570995,0.001550218,0.0034344199,0.0025824697,0.009077498,0.009484392,0.014649124,0.073084034,0.010147057],"category_scores_gemma":[0.21740298,0.0017323608,0.0037625902,0.0032868348,0.02652427,0.014480111,0.0073562334,0.09483517,0.010622841],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000186233,0.000024890838,0.00062442356,0.00025226924,0.000111613015,0.00026851462,0.0011624709,0.00007489099,0.00017377277,0.026257368,0.9629576,0.007905827],"study_design_scores_gemma":[0.00034086962,0.000076381686,0.004876187,0.0022031812,0.0002876791,0.0007396255,0.0016661503,0.00043554915,0.0014898785,0.13412459,0.85347795,0.00028197918],"about_ca_topic_score_codex":0.02489705,"about_ca_topic_score_gemma":0.032795966,"teacher_disagreement_score":0.073084034,"about_ca_system_score_codex":0.0073560104,"about_ca_system_score_gemma":0.010600138,"threshold_uncertainty_score":0.27802533},"labels":[],"label_agreement":null},{"id":"W4404685516","doi":"10.1177/25152459241285885","title":"The Comedy of Measurement Errors: Standard Error of Measurement and Standard Error of Estimation","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Hemodynamic Monitoring and Therapy","field":"Medicine","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Guelph","funders":"","keywords":"Observational error; Standard error; Comedy; Estimation; Non-sampling error; Statistics; Computer science; Mathematics; Economics; Art; Literature","score_opus":0.1294647529042954,"score_gpt":0.5714709013283761,"score_spread":0.4420061484240807,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4404685516","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011257439,0.05524694,0.8686119,0.031043926,0.008445097,0.0004090929,0.0009797562,0.0005856812,0.023420172],"genre_scores_gemma":[0.54164773,0.024127137,0.39845,0.0141413435,0.012016818,0.002998134,0.0008117307,0.000877255,0.004929971],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.65694803,0.23617142,0.021397153,0.024473557,0.05877258,0.0022372908],"domain_scores_gemma":[0.31397295,0.59860843,0.02435141,0.038774826,0.023192167,0.0011002036],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19508994,0.002081862,0.0043978323,0.010396249,0.0022690056,0.0106837535,0.0052381386,0.006448677,0.0019516727],"category_scores_gemma":[0.570173,0.0010204639,0.0025183235,0.012795559,0.026602274,0.013379109,0.0094711855,0.011833411,0.0008445523],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014522969,0.000060470687,0.008641658,0.0016313941,0.0009877493,0.0001581626,0.0034073575,0.0063658617,0.00032860276,0.8633147,0.014500991,0.100457765],"study_design_scores_gemma":[0.00004313693,0.000119855315,0.0057215095,0.0023385156,0.0002034975,0.00034565225,0.0012411511,0.010853226,0.00062064215,0.9366142,0.041708637,0.00018994718],"about_ca_topic_score_codex":0.0045572775,"about_ca_topic_score_gemma":0.0027539413,"teacher_disagreement_score":0.80491006,"about_ca_system_score_codex":0.006162292,"about_ca_system_score_gemma":0.0055336533,"threshold_uncertainty_score":0.9925974},"labels":[],"label_agreement":null},{"id":"W4405734082","doi":"10.1177/25152459241283477","title":"Prevalence of Transparent Research Practices in Psychology: A Cross-Sectional Study of Empirical Articles Published in 2022","year":2024,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"scientometrics and bibliometrics research","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Australian Research Council; Canadian Institutes of Health Research; Arnold Ventures; Strong; State Government of Victoria; Florey Institute of Neuroscience and Mental Health","keywords":"Transparency (behavior); Field (mathematics); Political science; Empirical research; Psychology; Law","score_opus":0.8275100584952197,"score_gpt":0.8086616933891463,"score_spread":0.01884836510607346,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4405734082","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"reproducibility","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"reproducibility","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9690298,0.018513486,0.0008001798,0.0025638682,0.000113957016,0.00026357386,0.0054910863,0.000043411565,0.003180647],"genre_scores_gemma":[0.9906151,0.00447415,0.0010063818,0.0007084702,0.00020723556,0.00034826907,0.002171744,0.00004122053,0.00042739298],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.91727346,0.025206238,0.030247653,0.0065311478,0.01917028,0.0015712883],"domain_scores_gemma":[0.33421114,0.30657336,0.29300454,0.013825131,0.046086613,0.006299224],"candidate_categories":["metaresearch","bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.0645896,0.00042646108,0.0013125726,0.026239086,0.0014186268,0.005965922,0.0020193367,0.0017550915,0.003187105],"category_scores_gemma":[0.30921254,0.0008369141,0.0013399669,0.024867235,0.0023511224,0.0077300905,0.0035787195,0.001492843,0.0010127245],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00030393968,0.00013070801,0.974906,0.0026970112,0.0006536547,0.00032146575,0.005856873,0.000081296326,0.0003735774,0.00043056358,0.002323064,0.011921785],"study_design_scores_gemma":[0.000035495188,0.00015956082,0.9838784,0.0022282996,0.00030147296,0.0011811623,0.0065728324,0.00031081532,0.00028928186,0.00025692015,0.0047322856,0.00005362579],"about_ca_topic_score_codex":0.0030973654,"about_ca_topic_score_gemma":0.003396806,"teacher_disagreement_score":0.9737609,"about_ca_system_score_codex":0.0018066044,"about_ca_system_score_gemma":0.0025223596,"threshold_uncertainty_score":0.34158653},"labels":[],"label_agreement":null},{"id":"W4406518090","doi":"10.1177/25152459241287123","title":"An Aberrant Abundance of Cronbach’s Alpha Values at .70","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Mathematical Theories","field":"Mathematics","cited_by":68,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council; Deutsche Forschungsgemeinschaft; SHRM Foundation; National Science Foundation","keywords":"Cronbach's alpha; Alpha (finance); Abundance (ecology); Psychology; Biology; Clinical psychology; Ecology; Psychometrics","score_opus":0.10571938980378617,"score_gpt":0.6247253657948791,"score_spread":0.519005975991093,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406518090","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.40183008,0.036521085,0.22910482,0.026691547,0.011877217,0.0023218973,0.02098857,0.0042505157,0.26641434],"genre_scores_gemma":[0.8537947,0.008722065,0.10346748,0.008719054,0.0018315382,0.0036699364,0.0079331165,0.0017265942,0.0101355035],"study_design_codex":"design_other","study_design_gemma":"observational","domain_scores_codex":[0.8812397,0.03600207,0.018227303,0.010921706,0.051725034,0.0018841443],"domain_scores_gemma":[0.50775534,0.30703756,0.04450664,0.043149494,0.09364613,0.0039048463],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0855926,0.0014611398,0.0019608794,0.011271329,0.0022220502,0.006390482,0.0018851274,0.0020897824,0.007407893],"category_scores_gemma":[0.3888795,0.001423544,0.0014658497,0.017274862,0.0048550763,0.0065016756,0.0037018727,0.0040843035,0.005262889],"study_design_candidate":"observational","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0007460176,0.00024979835,0.2678954,0.009658454,0.0023236463,0.00080038985,0.023605654,0.0015961493,0.005805884,0.06599221,0.19055788,0.4307685],"study_design_scores_gemma":[0.00013787574,0.000657206,0.410832,0.010178215,0.0006591012,0.0013354389,0.016916662,0.003516291,0.0072870497,0.15517864,0.39282763,0.00047395134],"about_ca_topic_score_codex":0.0028951864,"about_ca_topic_score_gemma":0.0037330785,"teacher_disagreement_score":0.9144074,"about_ca_system_score_codex":0.002249849,"about_ca_system_score_gemma":0.0034554524,"threshold_uncertainty_score":0.45266235},"labels":[],"label_agreement":null},{"id":"W4409423144","doi":"10.1177/25152459251326571","title":"Navigating Unmeasured Confounding in Nonexperimental Psychological Research: A Practical Guide to Computing and Interpreting E-Value","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Confounding; Value (mathematics); Psychology; Psychological research; Econometrics; Computer science; Statistics; Social psychology; Mathematics","score_opus":0.40287867640893543,"score_gpt":0.758232983432707,"score_spread":0.3553543070237715,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409423144","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00023828751,0.0013874483,0.9812429,0.0049798363,0.00045797628,0.00093157665,0.0013211949,0.002246765,0.0071940683],"genre_scores_gemma":[0.003396163,0.0013984911,0.9874812,0.0009661279,0.0002483107,0.0038191478,0.00032378992,0.00084129936,0.0015254427],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9358778,0.05112612,0.0048092296,0.0020878431,0.005705576,0.00039340605],"domain_scores_gemma":[0.6013057,0.36373353,0.006442924,0.017473098,0.009812699,0.0012319806],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.06564412,0.00250275,0.0032217046,0.0054990086,0.0012866884,0.010192218,0.006035129,0.0049621207,0.04377747],"category_scores_gemma":[0.32859227,0.0026505673,0.0033789657,0.0074391984,0.007219932,0.009885436,0.0064842966,0.010291176,0.019215617],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020286709,0.0001433342,0.0012205328,0.0034855169,0.00032226584,0.0003445502,0.0013321057,0.010553865,0.00077237363,0.58762574,0.10544793,0.28854892],"study_design_scores_gemma":[0.0001645504,0.0000816577,0.00041655934,0.002315095,0.00006421256,0.0002880513,0.00035655755,0.02020832,0.0010431558,0.77809334,0.19685353,0.000115092145],"about_ca_topic_score_codex":0.0017928546,"about_ca_topic_score_gemma":0.0022095912,"teacher_disagreement_score":0.93435585,"about_ca_system_score_codex":0.0021587908,"about_ca_system_score_gemma":0.00753943,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":["metaresearch"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":[],"domain":null,"study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4412134464","doi":"10.1177/25152459251348431","title":"Bestiary of Questionable Research Practices in Psychology","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":9,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; St. Francis Xavier University; University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; Eötvös Loránd Tudományegyetem; Magyar Tudományos Akadémia; National Institute for Health and Care Research; Leverhulme Trust; John Templeton Foundation; National Research, Development and Innovation Office; National Science Foundation","keywords":"Bestiary; Psychology; Psychoanalysis; Literature; Art","score_opus":0.8395444366525378,"score_gpt":0.8045002882908695,"score_spread":0.03504414836166825,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4412134464","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.053909507,0.084198736,0.59026337,0.206712,0.007576016,0.0049940012,0.00036224138,0.0008912892,0.051092885],"genre_scores_gemma":[0.47668034,0.011877556,0.47148845,0.029616177,0.0016931151,0.006236263,0.00017327529,0.00041285844,0.0018220113],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.113975465,0.71535915,0.07764992,0.020561993,0.070103854,0.0023496835],"domain_scores_gemma":[0.07481387,0.6919705,0.07850985,0.11089039,0.04100052,0.002814811],"candidate_categories":["metaresearch","research_integrity"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.6713981,0.0023031204,0.005622832,0.03161875,0.015241106,0.03251893,0.0074830777,0.015455955,0.0026999395],"category_scores_gemma":[0.79698247,0.0042012245,0.0044222097,0.018060898,0.08503535,0.031996198,0.027545799,0.01531609,0.00090138585],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00054638204,0.00024197625,0.015429459,0.020686384,0.0017823664,0.0012928823,0.20452334,0.001640588,0.0018865134,0.48510918,0.016323872,0.25053707],"study_design_scores_gemma":[0.00019393704,0.0002933877,0.004622462,0.045529313,0.0006117784,0.0018219915,0.03378309,0.005539358,0.0026862463,0.8049749,0.09954135,0.00040225813],"about_ca_topic_score_codex":0.002518974,"about_ca_topic_score_gemma":0.0036539221,"teacher_disagreement_score":0.98454404,"about_ca_system_score_codex":0.017257797,"about_ca_system_score_gemma":0.036030542,"threshold_uncertainty_score":0.40522468},"labels":[{"model":"gemma","categories":["metaresearch","research_integrity"],"domain":"methods","study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"gpt","categories":["metaresearch","research_integrity"],"domain":"methods","study_design":"theoretical_or_conceptual","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"split"},{"id":"W4413602392","doi":"10.1177/25152459261424825","title":"Models as Prediction Machines: How to Convert Confusing Coefficients Into Clear Quantities","year":2025,"lang":"en","type":"preprint","venue":"Advances in Methods and Practices in Psychological Science","topic":"Explainable Artificial Intelligence (XAI)","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Computer science; Econometrics; Mathematics","score_opus":0.10721877304379691,"score_gpt":0.5487022649902978,"score_spread":0.44148349194650094,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4413602392","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00035863623,0.00016676224,0.99311054,0.0012193497,0.0001841805,0.000060339193,0.0005104509,0.003389923,0.0009997379],"genre_scores_gemma":[0.021256436,0.0007247186,0.9694932,0.0011356892,0.00028766552,0.00068512745,0.0008357612,0.0040757107,0.0015057073],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97593135,0.015288854,0.001980302,0.0027660402,0.0036786622,0.00035479706],"domain_scores_gemma":[0.85770845,0.10950722,0.0048679966,0.020371694,0.006723622,0.0008210644],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.039136402,0.0032249005,0.0023268624,0.0046849055,0.0015567257,0.012677811,0.0050042355,0.003692474,0.026420293],"category_scores_gemma":[0.28715602,0.0031176808,0.0045197494,0.004387497,0.00601822,0.018687628,0.007868741,0.010601274,0.014017835],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001570044,0.00007204925,0.0028330954,0.00096933584,0.00036766203,0.00027933464,0.0020370702,0.026954614,0.0011553305,0.6083611,0.07507581,0.28173763],"study_design_scores_gemma":[0.000034650006,0.000016260094,0.00028198631,0.00031895543,0.00003874929,0.00011851484,0.00013871759,0.066900775,0.0011855344,0.9000534,0.03083699,0.000075459386],"about_ca_topic_score_codex":0.0035670926,"about_ca_topic_score_gemma":0.0030889283,"teacher_disagreement_score":0.9608636,"about_ca_system_score_codex":0.0018201016,"about_ca_system_score_gemma":0.004068951,"threshold_uncertainty_score":0.20697552},"labels":[],"label_agreement":null},{"id":"W4415529199","doi":"10.1177/25152459251375445","title":"Consistent and Precise Description of Research Outputs Could Improve Implementation of Open Science","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Ottawa Hospital","funders":"","keywords":"Transparency (behavior); Terminology; Openness to experience; Open science; Term (time); Key (lock); Open research","score_opus":0.8306962204089413,"score_gpt":0.7862947577716962,"score_spread":0.04440146263724509,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415529199","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"reporting","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"reporting","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.017420247,0.029369783,0.7269948,0.13573976,0.014160111,0.028172951,0.009821774,0.0035303195,0.034790218],"genre_scores_gemma":[0.12382771,0.011102142,0.77620625,0.02416121,0.0033349842,0.05211055,0.0045386846,0.0018903002,0.002828234],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.08732296,0.6659178,0.17404653,0.0144206025,0.055621006,0.0026711307],"domain_scores_gemma":[0.041222237,0.63059705,0.09892458,0.14596643,0.08049757,0.0027922057],"candidate_categories":["metaresearch","open_science"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.8282312,0.0039065117,0.0066818604,0.029067246,0.007620932,0.03745032,0.009144455,0.010485484,0.0076838587],"category_scores_gemma":[0.90014017,0.005264569,0.008592311,0.026196934,0.018670052,0.05444399,0.03416754,0.021183481,0.0046223123],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0019029495,0.00048583298,0.011458378,0.05367808,0.0022839261,0.00030438713,0.07009187,0.003719805,0.0027674923,0.27452755,0.048884317,0.52989537],"study_design_scores_gemma":[0.0014155777,0.0011936638,0.016092112,0.10726457,0.001545723,0.00040221718,0.01931666,0.0042280327,0.007899292,0.43851534,0.4001674,0.0019594033],"about_ca_topic_score_codex":0.0065501034,"about_ca_topic_score_gemma":0.0067657377,"teacher_disagreement_score":0.9908556,"about_ca_system_score_codex":0.023558933,"about_ca_system_score_gemma":0.07738879,"threshold_uncertainty_score":0.21182156},"labels":[],"label_agreement":null},{"id":"W4415966353","doi":"10.1177/25152459251379432","title":"Do Musicians Have Better Short-Term Memory Than Nonmusicians? A Multilab Study","year":2025,"lang":"en","type":"article","venue":"Advances in Methods and Practices in Psychological Science","topic":"Neuroscience and Music Perception","field":"Neuroscience","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McMaster University; Université de Montréal; International Laboratory for Brain, Music and Sound Research; Centre for Research on Brain Language and Music; Saint John Regional Hospital; University of Toronto; University of New Brunswick; Western University","funders":"","keywords":"Set (abstract data type); Cognition; Working memory; Socioeconomic status; Power (physics); Cognitive neuroscience; Iconic memory","score_opus":0.1175572287158445,"score_gpt":0.5659364803586194,"score_spread":0.4483792516427749,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4415966353","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.99548435,0.0033193773,0.00026842311,0.00016258219,0.00005152672,0.000032571093,0.000118885066,0.000004574513,0.0005577319],"genre_scores_gemma":[0.9985683,0.0003679468,0.00026013545,0.0002491037,0.000091637776,0.000034753324,0.00011128725,0.0000042226325,0.00031265325],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99814355,0.0006024502,0.00030073384,0.0005087209,0.0002719198,0.00017276709],"domain_scores_gemma":[0.9938938,0.0027201618,0.001629931,0.0007673644,0.00048272192,0.00050595286],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003756909,0.0005194915,0.0009996541,0.0009195488,0.0007071219,0.0008952662,0.0006977814,0.001018176,0.004126386],"category_scores_gemma":[0.011320253,0.00029878484,0.0011850717,0.00062325347,0.0006894936,0.0011708434,0.0010005182,0.00079484243,0.0004369448],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.013860826,0.0015552329,0.92724556,0.0019930885,0.00757806,0.0005898949,0.0066932333,0.00006511343,0.002562377,0.0004990157,0.0011014467,0.03625613],"study_design_scores_gemma":[0.00060075196,0.0058393176,0.9819989,0.00025828535,0.0038633887,0.0008185626,0.003080268,0.00022302567,0.0005252825,0.00079183717,0.0019540824,0.00004614129],"about_ca_topic_score_codex":0.0017382783,"about_ca_topic_score_gemma":0.0019476375,"teacher_disagreement_score":0.004126386,"about_ca_system_score_codex":0.0002089797,"about_ca_system_score_gemma":0.00022457328,"threshold_uncertainty_score":0.019868672},"labels":[],"label_agreement":null}]}