{"meta":{"page":1,"per_page":50,"max_per_page":100,"total":15,"total_is_capped":false,"direct_labels_cover":0,"predictions_cover":15,"direct_label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline (scores rank; they never assert a category)","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12","author_layer_release":"2026-06-26"},"query_hash":"59d05407f7d7","filters":{"venue":"Meta-Psychology"}},"results":[{"id":"W2915455637","doi":"10.15626/mp.2018.843","title":"A Brief Guide to Evaluate Replications","year":2019,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":82,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Western University","funders":"","keywords":"Replication (statistics); Transparency (behavior); Independence (probability theory); Computer science; Similarity (geometry); Research design; Psychology; Statistics; Artificial intelligence; Mathematics; Computer security","authors":[{"name":"Etienne P. LeBel","is_ca":true},{"name":"Wolf Vanpaemel","is_ca":false},{"name":"Irene Cheung","is_ca":false},{"name":"Lorne Campbell","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8534897186781798,"gpt":0.6528829468946589,"spread":0.2006067717835209,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2564453,0.00543806,0.004464301,0.01406071,0.003834565,0.01199903,0.007896178,0.00924505,0.1131625],"category_scores_gemma":[0.5819283,0.005913179,0.006058019,0.01192954,0.004356264,0.007663836,0.004735066,0.01198602,0.06314661],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.005528864,"about_ca_system_score_gemma":0.02837479,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004048339,"about_ca_topic_score_gemma":0.006823273,"domain_scores_codex":[0.6641018,0.2487316,0.05471181,0.005708472,0.02503463,0.001711604],"domain_scores_gemma":[0.3295129,0.4509495,0.03029971,0.05567805,0.1294997,0.004060103],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001241559,0.0005398437,0.001174251,0.02889468,0.0006069713,0.0005159992,0.004964188,0.003198629,0.003176921,0.06608696,0.4182185,0.4713816],"study_design_scores_gemma":[0.001564083,0.0009176944,0.002091548,0.02456959,0.000375884,0.0004611259,0.001390359,0.004726281,0.002937748,0.08775476,0.8727494,0.0004615681],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.00175931,0.01395831,0.7261083,0.01203665,0.008997864,0.1593015,0.01932837,0.01204048,0.04646926],"genre_scores_gemma":[0.002200318,0.003403901,0.8678411,0.002308092,0.0007219649,0.112894,0.00230658,0.001279204,0.007044866],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.7435547,"threshold_uncertainty_score":0.9169354,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3030972095","doi":"10.15626/mp.2018.874","title":"Estimating Population Mean Power Under Conditions of Heterogeneity and Selection for Significance","year":2020,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":81,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"University of Toronto Mississauga; University of Toronto","keywords":"Statistics; Sample size determination; Mathematics; Population; Statistical power; Replication (statistics); Statistical significance; Power (physics); Selection (genetic algorithm); Statistical hypothesis testing; Econometrics; Sample (material); Set (abstract data type); Demography; Computer science","authors":[{"name":"Jerry Brunner","is_ca":true},{"name":"Ulrich Schimmack","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8026212016523445,"gpt":0.5861197031220517,"spread":0.2165014985302928,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3696058,0.002039442,0.007627585,0.008719582,0.001758997,0.006169249,0.004343329,0.007000878,0.003570552],"category_scores_gemma":[0.7589355,0.001600493,0.01320513,0.008644607,0.005236844,0.009234727,0.004992731,0.005011002,0.0006206199],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.002888749,"about_ca_system_score_gemma":0.004638342,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002039128,"about_ca_topic_score_gemma":0.001178215,"domain_scores_codex":[0.5896006,0.3269448,0.02846358,0.02739329,0.02573511,0.001862626],"domain_scores_gemma":[0.2784164,0.6475385,0.02006598,0.0424682,0.0109257,0.0005852128],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.004245606,0.000453548,0.1073486,0.03271939,0.08683512,0.002399545,0.007347824,0.0634827,0.003934705,0.2287858,0.0210765,0.4413708],"study_design_scores_gemma":[0.002608679,0.002470054,0.04232368,0.008073075,0.02737236,0.001945538,0.001384675,0.1043227,0.008226349,0.7653504,0.03525709,0.0006653801],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.02092491,0.01003424,0.9515572,0.003149929,0.0007872763,0.006067709,0.001655488,0.0007779046,0.00504536],"genre_scores_gemma":[0.5166556,0.003479107,0.4377846,0.002823718,0.0004361479,0.03630546,0.001370248,0.0004390094,0.0007060615],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.6303942,"threshold_uncertainty_score":0.7773882,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4226236655","doi":"10.15626/mp.2020.2595","title":"Tutorial in Longitudinal Measurement Invariance and Cross-lagged Panel Models Using Lavaan","year":2022,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Psychological Well-being and Life Satisfaction","field":"Psychology","cited_by":76,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Concordia University; Dalhousie University","funders":"","keywords":"Structural equation modeling; Measurement invariance; Latent variable; Computer science; Panel data; Syntax; Econometrics; Process (computing); Test (biology); Interpretation (philosophy); Mathematics; Confirmatory factor analysis; Artificial intelligence; Machine learning; Programming language","authors":[{"name":"Sean P. Mackinnon","is_ca":true},{"name":"Robin Curtis","is_ca":true},{"name":"Roisin M. O’Connor","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5074782751927323,"gpt":0.4361204782108346,"spread":0.07135779698189765,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009693327,0.002422858,0.001290628,0.002645291,0.0005180953,0.001605713,0.001903238,0.001251297,0.09320891],"category_scores_gemma":[0.04308141,0.001600085,0.00259105,0.003141325,0.0006509961,0.004276777,0.001963817,0.004092133,0.03753505],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008772358,"about_ca_system_score_gemma":0.001774635,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00379425,"about_ca_topic_score_gemma":0.005473504,"domain_scores_codex":[0.9965113,0.002150799,0.0002723587,0.000389241,0.0005972279,0.00007907341],"domain_scores_gemma":[0.970233,0.02556904,0.0006361856,0.001636899,0.001667078,0.0002578154],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","study_design_scores_codex":[0.00008193079,0.0001430541,0.001807825,0.002062821,0.0002358256,0.0003501843,0.0007457031,0.005573826,0.0009260344,0.1009919,0.5708799,0.3162011],"study_design_scores_gemma":[0.00009866241,0.00009199601,0.00314538,0.001248219,0.00008844362,0.0005601127,0.0001405091,0.02071266,0.001394707,0.2206408,0.7517089,0.0001695857],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.0009263656,0.007833837,0.9370284,0.003797256,0.001578982,0.0004321263,0.0104783,0.02170237,0.01622244],"genre_scores_gemma":[0.0132804,0.009465318,0.928889,0.002461809,0.001314779,0.002965491,0.01071383,0.01411274,0.01679668],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.09320891,"threshold_uncertainty_score":0.3118148,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4294233607","doi":"10.15626/mp.2021.2720","title":"Z-curve 2.0: Estimating Replication Rates and Discovery Rates","year":2022,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":60,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"","keywords":"Replication (statistics); Confidence interval; False discovery rate; Statistics; Selection (genetic algorithm); False positive paradox; Multiple comparisons problem; Computer science; Range (aeronautics); Extension (predicate logic); Statistical power; Econometrics; Mathematics; Artificial intelligence; Biology; Engineering","authors":[{"name":"Frantis̆ek Bartos̆","is_ca":false},{"name":"Ulrich Schimmack","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.7276317683307449,"gpt":0.64387429511749,"spread":0.083757473213255,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.342165,0.005295318,0.00670114,0.01417589,0.002363022,0.008945033,0.007793545,0.00563793,0.03242816],"category_scores_gemma":[0.7177069,0.00570673,0.01524841,0.01680871,0.005180774,0.007370513,0.009409021,0.00908967,0.01099639],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003022735,"about_ca_system_score_gemma":0.01062014,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.004232168,"about_ca_topic_score_gemma":0.003477157,"domain_scores_codex":[0.680928,0.2535161,0.02220012,0.02070647,0.02071514,0.001934108],"domain_scores_gemma":[0.3353841,0.5348835,0.02833064,0.0709689,0.02885255,0.001580347],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.00703854,0.0004350613,0.05436391,0.02564268,0.03273343,0.001105923,0.007051914,0.04063437,0.004889577,0.1404307,0.1420029,0.543671],"study_design_scores_gemma":[0.006353006,0.001834143,0.03767527,0.007169317,0.01611611,0.002059476,0.0009045934,0.1776503,0.01587936,0.3640226,0.3688277,0.001508115],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.004777447,0.00292781,0.9509302,0.001631557,0.001133932,0.008203363,0.01141744,0.01414178,0.004836496],"genre_scores_gemma":[0.0426843,0.001207307,0.9013984,0.0008049562,0.0003008787,0.03849696,0.004752269,0.008236422,0.002118522],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.657835,"threshold_uncertainty_score":0.8112277,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3135512811","doi":"10.15626/mp.2019.1645","title":"The Validation Crisis in Psychology","year":2021,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Mental Health Research Topics","field":"Psychology","cited_by":52,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":true,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Toronto","funders":"Social Sciences and Humanities Research Council of Canada; University of Toronto Mississauga; University of Toronto","keywords":"Nomological network; Construct (python library); Construct validity; Cronbach's alpha; Psychology; Criterion validity; External validity; Metatheory; Predictive validity; Incremental validity; Psychometrics; Structural equation modeling; Social psychology; Computer science; Developmental psychology; Machine learning","authors":[{"name":"Ulrich Schimmack","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3490952054780505,"gpt":0.5715458269845495,"spread":0.222450621506499,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.33139,0.001488575,0.003611179,0.008090427,0.006927119,0.01371911,0.004174522,0.01330468,0.003264888],"category_scores_gemma":[0.3992144,0.001372499,0.002501436,0.00434892,0.082321,0.03465262,0.01186969,0.02742814,0.001066827],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.01229505,"about_ca_system_score_gemma":0.01442172,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.005323608,"about_ca_topic_score_gemma":0.001930199,"domain_scores_codex":[0.7623823,0.1586303,0.01199051,0.0217745,0.04187623,0.003346133],"domain_scores_gemma":[0.3942749,0.5291212,0.007148055,0.03253593,0.03202162,0.004898328],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.0001096334,0.00009010471,0.00246269,0.0006860772,0.0001225614,0.0001108641,0.006038695,0.0004385504,0.000148662,0.8804919,0.02523626,0.08406416],"study_design_scores_gemma":[0.00008936894,0.00009204319,0.001922149,0.002377305,0.00002978287,0.0002102564,0.001722522,0.001325777,0.0002265929,0.9297298,0.06220874,0.00006575748],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"commentary","genre_gemma":"review","genre_scores_codex":[0.01187373,0.1094159,0.08535903,0.7455482,0.007598868,0.0002031695,0.0002312303,0.0002245359,0.03954538],"genre_scores_gemma":[0.5526962,0.0515237,0.1077051,0.2532234,0.02532778,0.002012552,0.0003464459,0.0007942208,0.006370576],"genre_candidate":"review","genre_consensus":null,"teacher_disagreement_score":0.66861,"threshold_uncertainty_score":0.8245152,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4308725914","doi":"10.15626/mp.2021.2803","title":"Meta-Analytic Findings of the Self-Controlled Motor Learning Literature: Underpowered, Biased, and Lacking Evidential Value","year":2022,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":28,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University; University of Ottawa","funders":"","keywords":"Moderation; Psychology; Selection bias; Robustness (evolution); Publication bias; Meta-analysis; Statistics; Social psychology; Medicine; Mathematics; Internal medicine","authors":[{"name":"Brad McKay","is_ca":true},{"name":"Zachary Yantha","is_ca":true},{"name":"Julia Hussien","is_ca":true},{"name":"Michael J Carter","is_ca":true},{"name":"Diane M. Ste‐Marie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3099148603923441,"gpt":0.382829465661358,"spread":0.07291460526901389,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch","metaepi_broad"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3160896,0.003900612,0.01496167,0.01563863,0.001415905,0.01176749,0.005407782,0.004272429,0.005114566],"category_scores_gemma":[0.5962925,0.00301758,0.04065011,0.01299676,0.005592751,0.00915664,0.005176279,0.004925286,0.000791073],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004702144,"about_ca_system_score_gemma":0.006138179,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.003571237,"about_ca_topic_score_gemma":0.008311599,"domain_scores_codex":[0.6888887,0.1866214,0.07461776,0.02051632,0.02736595,0.00198974],"domain_scores_gemma":[0.2442551,0.6875021,0.03238775,0.02184964,0.01284506,0.00116024],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"meta_analysis","study_design_gemma":"meta_analysis","study_design_scores_codex":[0.001807419,0.00004904306,0.01494318,0.2540793,0.6787665,0.00042993,0.0008270251,0.001212575,0.0004067409,0.002507015,0.001729242,0.04324195],"study_design_scores_gemma":[0.0009846847,0.0004962868,0.0100449,0.08922376,0.8735343,0.0006034483,0.0004691731,0.0009394055,0.0006597514,0.01097317,0.01196472,0.0001064082],"study_design_candidate":"meta_analysis","study_design_consensus":"meta_analysis","genre_codex":"review","genre_gemma":"empirical","genre_scores_codex":[0.009137166,0.9554598,0.02414069,0.003722443,0.001501702,0.001918892,0.001158804,0.0002239707,0.002736564],"genre_scores_gemma":[0.6088126,0.3174738,0.04932694,0.0124448,0.002286284,0.006130102,0.001995005,0.0005605539,0.0009699997],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9850383,"threshold_uncertainty_score":0.8433833,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3198867954","doi":"10.15626/mp.2020.2506","title":"What to make of equivalence testing with a post-specified margin?","year":2021,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Statistical Methods in Clinical Trials","field":"Mathematics","cited_by":13,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of British Columbia","funders":"","keywords":"Margin (machine learning); Equivalence (formal languages); Frequentist inference; Post hoc; Statistical hypothesis testing; Computer science; Econometrics; Mathematics; Statistics; Machine learning; Artificial intelligence; Bayesian probability; Medicine; Bayesian inference","authors":[{"name":"Harlan Campbell","is_ca":true},{"name":"Paul Gustafson","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.8258386333211938,"gpt":0.6156700248907838,"spread":0.21016860843041,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.5300969,0.002364435,0.01044474,0.005813953,0.00351006,0.01474725,0.0125597,0.01688892,0.003794413],"category_scores_gemma":[0.8292308,0.002035492,0.00697221,0.006589803,0.03624928,0.03028084,0.00578765,0.0224741,0.001749168],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.006537911,"about_ca_system_score_gemma":0.009961091,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00169631,"about_ca_topic_score_gemma":0.001548796,"domain_scores_codex":[0.4068259,0.4946236,0.05199464,0.01354641,0.031726,0.001283389],"domain_scores_gemma":[0.1915103,0.7323112,0.02780389,0.02907832,0.01782705,0.001469183],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.003035622,0.0002192868,0.003199628,0.03848174,0.006082676,0.0008362329,0.006517854,0.003519087,0.001010382,0.5411707,0.06158977,0.3343372],"study_design_scores_gemma":[0.001113232,0.000586189,0.001340741,0.01991832,0.001407425,0.0005864396,0.001424791,0.004558206,0.001238344,0.9129342,0.05465475,0.0002373945],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"commentary","genre_gemma":"methods","genre_scores_codex":[0.00411331,0.1089834,0.397398,0.4456781,0.03100897,0.002784909,0.000607067,0.0005545775,0.008871814],"genre_scores_gemma":[0.1408626,0.03154605,0.6381667,0.1421812,0.03314096,0.0119026,0.0003466617,0.0004610755,0.001392164],"genre_candidate":"methods","genre_consensus":null,"teacher_disagreement_score":0.4699031,"threshold_uncertainty_score":0.5794742,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4387116974","doi":"10.15626/mp.2023.4020","title":"A Plea to Psychology Professional Societies that Publish Journals: Assess Computational Reproducibility","year":2023,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"scientometrics and bibliometrics research","field":"Decision Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"University of Victoria","funders":"","keywords":"Plea; Publication; Reproducibility; Psychology; Applied psychology; Political science; Law; Mathematics; Statistics","authors":[{"name":"D. Stephen Lindsay","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.9415478893122667,"gpt":0.728999741796331,"spread":0.2125481475159358,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.356274,0.0009302802,0.002169964,0.01973707,0.00680563,0.01593093,0.004371066,0.007262245,0.01464445],"category_scores_gemma":[0.8704824,0.001828299,0.004201212,0.02706046,0.01115601,0.01923578,0.01233319,0.006286464,0.007228468],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.003504349,"about_ca_system_score_gemma":0.006893505,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001760826,"about_ca_topic_score_gemma":0.002265054,"domain_scores_codex":[0.5630577,0.3300582,0.02941982,0.02065004,0.05424701,0.002567142],"domain_scores_gemma":[0.07288624,0.6141971,0.04933104,0.1914972,0.06354548,0.008542958],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"not_applicable","study_design_scores_codex":[0.001965802,0.0009019883,0.3454654,0.002025788,0.003931458,0.0002379097,0.01010032,0.002135184,0.001812619,0.05235286,0.163737,0.4153335],"study_design_scores_gemma":[0.001489104,0.001871727,0.2456015,0.003110699,0.00260307,0.001470241,0.009667027,0.02821284,0.004261259,0.5341464,0.1667744,0.0007915418],"study_design_candidate":"not_applicable","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"commentary","genre_scores_codex":[0.1695006,0.01185395,0.302425,0.4042836,0.01111661,0.005280228,0.004681883,0.004511307,0.08634672],"genre_scores_gemma":[0.6713202,0.001786373,0.2731628,0.02876367,0.004095686,0.008659367,0.002677768,0.001931165,0.007602963],"genre_candidate":"commentary","genre_consensus":"commentary","teacher_disagreement_score":0.643726,"threshold_uncertainty_score":0.7938287,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4383908607","doi":"10.15626/mp.2021.2938","title":"A critical re-analysis of six implicit learning papers","year":2023,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Innovative Teaching and Learning Methods","field":"Psychology","cited_by":3,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"McMaster University","funders":"","keywords":"Pairwise comparison; Contrast (vision); Statistics; Psychology; Mathematics; Computer science; Econometrics; Artificial intelligence","authors":[{"name":"Brad McKay","is_ca":true},{"name":"Michael J Carter","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1946829444336663,"gpt":0.5180829281699013,"spread":0.323399983736235,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2037917,0.00358956,0.006080847,0.06882834,0.004155721,0.01046862,0.00564732,0.006221625,0.008857053],"category_scores_gemma":[0.6898084,0.002560161,0.008273343,0.02801393,0.004497114,0.008747269,0.006508126,0.005853317,0.002583924],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0109431,"about_ca_system_score_gemma":0.01425814,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.00199163,"about_ca_topic_score_gemma":0.003852887,"domain_scores_codex":[0.6966436,0.0695649,0.1150392,0.01945087,0.09457715,0.004724315],"domain_scores_gemma":[0.1172321,0.5189799,0.07711533,0.0459918,0.2383578,0.002323176],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"systematic_review","study_design_gemma":"observational","study_design_scores_codex":[0.007998708,0.0005705814,0.01547429,0.3671386,0.02894315,0.008036971,0.02954128,0.001350703,0.01413871,0.01581892,0.1884909,0.3224972],"study_design_scores_gemma":[0.002258283,0.001199488,0.02687517,0.1796994,0.03515935,0.003705152,0.009026909,0.001339086,0.02409414,0.0249449,0.6904707,0.001227325],"study_design_candidate":"observational","study_design_consensus":null,"genre_codex":"review","genre_gemma":"empirical","genre_scores_codex":[0.1232081,0.3915032,0.07832327,0.152143,0.1306452,0.04687485,0.04621347,0.003417409,0.02767162],"genre_scores_gemma":[0.499524,0.09429169,0.1683008,0.08112361,0.03464063,0.06436048,0.02991163,0.004630283,0.02321682],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.7962083,"threshold_uncertainty_score":0.9818666,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W3039001205","doi":"10.15626/mp.2019.1992","title":"Multiplicity Control vs Replication","year":2020,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Probability and Risk Models","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"","keywords":"Multiplicity (mathematics); Replication (statistics); Multiplicity of infection; Computer science; Mathematics; Biology; Statistics; Genetics; In vitro; Geometry","authors":[{"name":"Andrew Hunter","is_ca":true},{"name":"Nataly Beribisky","is_ca":true},{"name":"Linda Farmus","is_ca":true},{"name":"Robert A. Cribbie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5084974778146327,"gpt":0.4953623604817329,"spread":0.01313511733289979,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.3909402,0.003041639,0.005098824,0.006142861,0.004617464,0.008915246,0.007666187,0.009679404,0.008289803],"category_scores_gemma":[0.6786072,0.001945611,0.004703369,0.006494765,0.03535598,0.02020174,0.009596033,0.01319942,0.001534846],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004859206,"about_ca_system_score_gemma":0.006486066,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001406189,"about_ca_topic_score_gemma":0.0007358975,"domain_scores_codex":[0.356358,0.5560315,0.01672823,0.0276935,0.04123171,0.001957039],"domain_scores_gemma":[0.2208708,0.6317223,0.02827326,0.1010769,0.01657596,0.001480684],"domain_codex":"methods","domain_gemma":"methods","domain_candidate":"methods","domain_consensus":"methods","study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","study_design_scores_codex":[0.00047366,0.0000705638,0.002102304,0.002309886,0.001102706,0.0002285142,0.003230733,0.002143707,0.0004822294,0.9076174,0.004122815,0.07611547],"study_design_scores_gemma":[0.0003276766,0.000467404,0.000981698,0.001414532,0.000451788,0.0005400987,0.0005591317,0.006150212,0.001377313,0.9621881,0.02538006,0.0001619499],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","genre_codex":"methods","genre_gemma":"methods","genre_scores_codex":[0.007728989,0.01228659,0.9338692,0.02082651,0.004490721,0.001957073,0.0002261042,0.0005046758,0.01811016],"genre_scores_gemma":[0.3909264,0.006991849,0.5678552,0.01271328,0.006518814,0.009946158,0.0001571759,0.0005486385,0.004342441],"genre_candidate":"methods","genre_consensus":"methods","teacher_disagreement_score":0.6090598,"threshold_uncertainty_score":0.7510791,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4394955471","doi":"10.15626/mp.2021.2918","title":"Associations between Goal Orientation and Self-Regulated Learning Strategies are Stable across Course Types, Underrepresented Minority Status, and Gender","year":2024,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Innovative Teaching and Learning Methods","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Goal orientation; Psychology; Underrepresented Minority; Orientation (vector space); Future orientation; Social psychology; Medical education; Mathematics; Medicine","authors":[{"name":"Brendan A. Schuetze","is_ca":false},{"name":"Veronica X. Yan","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.1354320734427921,"gpt":0.4753749570623645,"spread":0.3399428836195724,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009748483,0.0003674809,0.0006717924,0.00134966,0.0008972137,0.00170719,0.0008783299,0.0003953616,0.002389141],"category_scores_gemma":[0.02520099,0.0002571108,0.001387825,0.001250713,0.0009616163,0.0009719478,0.0009738781,0.0006699035,0.0002206646],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008981498,"about_ca_system_score_gemma":0.001677961,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.02228946,"about_ca_topic_score_gemma":0.0317749,"domain_scores_codex":[0.997738,0.0008594261,0.0002098231,0.0005514518,0.0004705572,0.0001707671],"domain_scores_gemma":[0.9751221,0.009494511,0.003888278,0.00714182,0.003580444,0.000772872],"domain_codex":null,"domain_gemma":null,"domain_candidate":null,"domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.0006628973,0.0003277456,0.9571666,0.0002946189,0.001336622,0.00007011874,0.006151375,0.000133002,0.00262731,0.0004592103,0.0003263339,0.03044404],"study_design_scores_gemma":[0.00003070909,0.0004303908,0.9941685,0.00007924447,0.0005895476,0.00004518126,0.002149051,0.0002136084,0.0009266862,0.0004745233,0.0008779778,0.00001459381],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9959436,0.0007470958,0.001062109,0.0001196036,0.00002516656,0.00008726628,0.0002350155,0.00001464162,0.00176554],"genre_scores_gemma":[0.9984679,0.0001141552,0.0008326097,0.00003731236,0.000004948369,0.00006180688,0.0001757413,0.000008367349,0.0002970943],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.02228946,"threshold_uncertainty_score":0.05155557,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4415699443","doi":"10.15626/mp.2020.2643","title":"A Multi-faceted Mess: A Review of Statistical Power Analysis in Psychology Journal Articles","year":2025,"lang":"","type":"article","venue":"Meta-Psychology","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"York University","funders":"","keywords":"Sample size determination; Statistical power; Sample (material); Power (physics); Identification (biology); A priori and a posteriori; Order (exchange)","authors":[{"name":"Nataly Beribisky","is_ca":true},{"name":"Udi Alter","is_ca":true},{"name":"Robert A. Cribbie","is_ca":true}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5836364185346339,"gpt":0.5957669098937192,"spread":0.01213049135908528,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1708227,0.001891978,0.006561505,0.03542396,0.002369,0.009688934,0.004502003,0.005097982,0.00576815],"category_scores_gemma":[0.4647912,0.002772026,0.007937127,0.03141589,0.007152599,0.01198736,0.00482971,0.005630169,0.001570847],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.007082623,"about_ca_system_score_gemma":0.01850916,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.002716995,"about_ca_topic_score_gemma":0.005190324,"domain_scores_codex":[0.8369749,0.0811094,0.04307577,0.006094943,0.0317678,0.0009772063],"domain_scores_gemma":[0.3199016,0.6137779,0.02610351,0.008556624,0.03048325,0.001177039],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"design_other","study_design_gemma":"systematic_review","study_design_scores_codex":[0.0001656521,0.00006934371,0.001532709,0.2227821,0.002909984,0.0001749315,0.002152912,0.0004459708,0.000272377,0.016222,0.02141628,0.7318558],"study_design_scores_gemma":[0.0001367359,0.00035929,0.004998758,0.6086262,0.008706057,0.001375523,0.00209,0.0009438581,0.000776096,0.04369524,0.3280327,0.000259445],"study_design_candidate":"systematic_review","study_design_consensus":null,"genre_codex":"review","genre_gemma":"review","genre_scores_codex":[0.0004423407,0.9765347,0.01200157,0.007228773,0.001321654,0.0005162887,0.0001717905,0.00008165261,0.001701219],"genre_scores_gemma":[0.01355284,0.951958,0.02476717,0.005296085,0.001634073,0.001969034,0.0002118506,0.0001860927,0.0004248605],"genre_candidate":"review","genre_consensus":"review","teacher_disagreement_score":0.8291773,"threshold_uncertainty_score":0.9034076,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4409214529","doi":"10.15626/mp.2025.4708","title":"Reality Television Shows Focusing on Sexual Relationships and College Students Engagement in One-Night Stands: A Replication Report","year":2025,"lang":"en","type":"preprint","venue":"Meta-Psychology","topic":"Asian Culture and Media Studies","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":false,"ca_fund":false,"ca_venue":false,"about_ca":true},"ca_institutions":"","funders":"","keywords":"Replication (statistics); Psychology; Reality television; Sociology; Media studies; Medicine","authors":[{"name":"Somer Schaffer","is_ca":false},{"name":"Samantha M. Jones","is_ca":false},{"name":"Malvika D’Costa","is_ca":false},{"name":"Megan Lindloff","is_ca":false},{"name":"Lorne Campbell","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.3444403399668227,"gpt":0.4876013957980693,"spread":0.1431610558312466,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.01242268,0.0005752846,0.0006571417,0.001132964,0.001220857,0.001626891,0.001111338,0.0006433621,0.00467837],"category_scores_gemma":[0.0316679,0.0004723242,0.003190103,0.001716276,0.001097089,0.001219398,0.001446706,0.001193341,0.0003228598],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.0008376924,"about_ca_system_score_gemma":0.002055395,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.01898564,"about_ca_topic_score_gemma":0.02017088,"domain_scores_codex":[0.994671,0.003095945,0.0006384446,0.0007562743,0.0005739141,0.0002644464],"domain_scores_gemma":[0.9696228,0.01195957,0.005617625,0.009291624,0.002994932,0.0005135784],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"observational","study_design_scores_codex":[0.001253723,0.001219638,0.9020842,0.003728532,0.00739791,0.0002639056,0.02518536,0.0001649175,0.001943998,0.001177962,0.001445894,0.05413401],"study_design_scores_gemma":[0.0002386666,0.00181666,0.963442,0.001030961,0.006866572,0.0002531074,0.01778265,0.0002948444,0.00174484,0.0008156076,0.005642363,0.00007159227],"study_design_candidate":"observational","study_design_consensus":"observational","genre_codex":"empirical","genre_gemma":"empirical","genre_scores_codex":[0.9924192,0.002690016,0.001025913,0.0001733071,0.00008586411,0.000469797,0.0006921621,0.00001977601,0.002423986],"genre_scores_gemma":[0.9967313,0.0006789708,0.001020388,0.0001050483,0.0000319717,0.0004610293,0.0003901309,0.00001498023,0.0005662081],"genre_candidate":"empirical","genre_consensus":"empirical","teacher_disagreement_score":0.9875773,"threshold_uncertainty_score":0.06569821,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4398239542","doi":"10.15626/mp.2018.1479","title":"How Close to the Mark Might Published Heritability Estimates Be?","year":2024,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Cognitive Abilities and Testing","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Heritability; Genealogy; Econometrics; History; Evolutionary biology; Biology; Mathematics","authors":[{"name":"Michael D. Maraun","is_ca":true},{"name":"Moritz Heene","is_ca":false},{"name":"Philipp Sckopke","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.105602424643944,"gpt":0.3824294459025446,"spread":0.2768270212586006,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09953856,0.001869767,0.004041093,0.007731473,0.003081624,0.01596806,0.006043969,0.009649697,0.004910342],"category_scores_gemma":[0.424456,0.00121768,0.001831666,0.0044029,0.0161986,0.03111089,0.00589773,0.0170009,0.004998541],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.004564101,"about_ca_system_score_gemma":0.002818942,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.007169322,"about_ca_topic_score_gemma":0.002558698,"domain_scores_codex":[0.9326814,0.03954082,0.007563326,0.01083164,0.008338926,0.001043887],"domain_scores_gemma":[0.7458558,0.1542822,0.01655764,0.02935783,0.05138827,0.002558283],"domain_codex":null,"domain_gemma":"reproducibility","domain_candidate":"reproducibility","domain_consensus":null,"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.0009258962,0.0001760215,0.01215274,0.00377197,0.001969564,0.0008164867,0.005515471,0.004913652,0.000895397,0.4339413,0.173614,0.3613074],"study_design_scores_gemma":[0.0001524464,0.0002087166,0.008821437,0.007301426,0.0005517108,0.0008378758,0.003620201,0.003753591,0.001736301,0.7277437,0.2448478,0.0004247444],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"commentary","genre_gemma":"empirical","genre_scores_codex":[0.01561595,0.2061055,0.152604,0.5233346,0.07499492,0.0001447433,0.001762081,0.001618055,0.0238201],"genre_scores_gemma":[0.4378541,0.09344448,0.2103106,0.1718656,0.06877428,0.0008563622,0.002094018,0.002335765,0.01246487],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.9004614,"threshold_uncertainty_score":0.5264165,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null},{"id":"W4406183016","doi":"10.15626/mp.2021.2757","title":"The Devil is Mainly in the Nuisance Parameters: Performance of Structural Fit Indices Under Misspecified Structural Models in SEM","year":2024,"lang":"en","type":"article","venue":"Meta-Psychology","topic":"Multi-Criteria Decision Making","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"routes":{"ca_aff":true,"ca_fund":false,"ca_venue":false,"about_ca":false},"ca_institutions":"Simon Fraser University","funders":"","keywords":"Nuisance; Structural equation modeling; Econometrics; Nuisance parameter; Statistics; Mathematics; Economics; Political science; Law","authors":[{"name":"Moritz Heene","is_ca":false},{"name":"Michael D. Maraun","is_ca":true},{"name":"Nadine Juliana Glushko","is_ca":false},{"name":"Sunthud Pornprasertmanit","is_ca":false}],"retraction":null,"screen_n_in":null,"score":{"opus":0.5075904091821208,"gpt":0.5103925816882979,"spread":0.002802172506177092,"validation_status":"score_only:v0-immature-baseline"},"prediction":{"model_version":"metacan-v3-hybrid-931329e0061c","candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1493731,0.002244643,0.003685245,0.005248744,0.001397476,0.005211217,0.003225025,0.00335629,0.002094163],"category_scores_gemma":[0.4959413,0.00139811,0.002847691,0.004710621,0.007449504,0.007509721,0.004909259,0.005543773,0.000792933],"about_ca_system_candidate":false,"about_ca_system_consensus":false,"about_ca_system_score_codex":0.001587538,"about_ca_system_score_gemma":0.002442894,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_topic_score_codex":0.001727853,"about_ca_topic_score_gemma":0.002406391,"domain_scores_codex":[0.8683475,0.08911411,0.01061768,0.01502717,0.01601584,0.0008777909],"domain_scores_gemma":[0.3925655,0.5434437,0.01269315,0.04046114,0.009818693,0.001017854],"domain_codex":null,"domain_gemma":"methods","domain_candidate":"methods","domain_consensus":null,"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","study_design_scores_codex":[0.001685088,0.0004720241,0.3796666,0.001977812,0.006781644,0.001620992,0.007012066,0.1404556,0.00367695,0.17215,0.006289338,0.278212],"study_design_scores_gemma":[0.0003718493,0.002603663,0.1443345,0.001490098,0.001455511,0.003002073,0.002321812,0.4543287,0.01267621,0.3635779,0.01309432,0.0007433614],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"genre_codex":"methods","genre_gemma":"empirical","genre_scores_codex":[0.2797802,0.003206307,0.7004101,0.002316668,0.0006644072,0.0005316611,0.000761283,0.00147734,0.01085201],"genre_scores_gemma":[0.8663945,0.0006515077,0.129703,0.0004918143,0.000133675,0.0005591334,0.0006618886,0.0004407632,0.0009636803],"genre_candidate":"empirical","genre_consensus":null,"teacher_disagreement_score":0.8506269,"threshold_uncertainty_score":0.7899697,"prediction_status":"machine_predicted_unvalidated"},"labels":[],"label_agreement":null}]}