{"meta":{"query_hash":"53c7e562b0f3","filters":{"venue":"Multivariate Behavioral Research"},"cohort_total":47,"direct_labels_cover":3,"predictions_cover":47,"exported":47,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/53c7e562b0f3","api":"https://metacan.xera.ac/api/v1/cohort?venue=Multivariate+Behavioral+Research"},"results":[{"id":"W1965908312","doi":"10.1080/00273171.2011.636702","title":"Abstract: Inference and Interval Estimation for Indirect Effects With Latent Variable Models","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Statistics; Latent variable; Confidence interval; Type I and type II errors; Structural equation modeling; Mathematics; Coverage probability; Latent variable model; Covariate; Econometrics","score_opus":0.5478691541375651,"score_gpt":0.5494475282255485,"score_spread":0.0015783740879834474,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1965908312","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021352379,0.0004430723,0.97380596,0.00025894013,0.00008992928,0.0002486425,0.00039463362,0.0005036055,0.0029029874],"genre_scores_gemma":[0.30460036,0.00043314561,0.6911823,0.00015712513,0.00012549707,0.0014531027,0.001100774,0.00021694417,0.00073063636],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9512163,0.039864782,0.0013094468,0.0031734202,0.00392416,0.00051189936],"domain_scores_gemma":[0.6392919,0.32870436,0.008190058,0.015737783,0.0071353526,0.0009404636],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.056249116,0.0012475799,0.0023574133,0.0044307457,0.00097170525,0.0029587848,0.004587932,0.0016802329,0.012499384],"category_scores_gemma":[0.3665344,0.0008896166,0.0034195012,0.0040515335,0.0023014818,0.0051214593,0.003698538,0.004891288,0.0009611437],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0014710064,0.0007066675,0.043989643,0.0013644982,0.0022021895,0.00044887187,0.0026523885,0.18798219,0.0010027757,0.40129593,0.008546024,0.34833783],"study_design_scores_gemma":[0.00030104062,0.00037006213,0.0083440775,0.00071140815,0.00037723355,0.00036603934,0.000521378,0.63049644,0.0018610155,0.35189036,0.004642292,0.000118571465],"about_ca_topic_score_codex":0.003373331,"about_ca_topic_score_gemma":0.0017176226,"teacher_disagreement_score":0.056249116,"about_ca_system_score_codex":0.0014069873,"about_ca_system_score_gemma":0.0020889482,"threshold_uncertainty_score":0.2974773},"labels":[],"label_agreement":null},{"id":"W1981766652","doi":"10.1080/00273171.2012.658328","title":"Modeling Individual Differences in Within-Person Variation of Negative and Positive Affect in a Mixed Effects Location Scale Model Using BUGS/JAGS","year":2012,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":86,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"Schweizerischer Nationalfonds zur Förderung der Wissenschaftlichen Forschung","keywords":"Affect (linguistics); Stressor; Psychology; Mood; Multilevel model; Scale (ratio); Random effects model; Interaction; Correlation; Variation (astronomy); Developmental psychology; Statistics; Clinical psychology; Medicine; Mathematics; Meta-analysis","score_opus":0.45331745974860327,"score_gpt":0.5344039001917903,"score_spread":0.08108644044318702,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1981766652","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.66637325,0.00021120497,0.32812878,0.0003342776,0.00023357844,0.0008533762,0.0018231985,0.0009722306,0.0010701199],"genre_scores_gemma":[0.888557,0.00012918503,0.10075815,0.00011610182,0.000054277036,0.0027386735,0.0019357477,0.00014011367,0.00557089],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9931606,0.004770215,0.00018292782,0.0011787921,0.00030248764,0.00040496004],"domain_scores_gemma":[0.9873236,0.00930804,0.0007734473,0.0014224122,0.00087385834,0.00029870024],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013006668,0.0018479712,0.0017989384,0.0016879129,0.0007285356,0.001863134,0.0030987745,0.001632879,0.006385068],"category_scores_gemma":[0.022096682,0.0011917623,0.004999748,0.0015035106,0.0010876418,0.0010378709,0.0016719485,0.0021049168,0.00090215437],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.005085308,0.0017083012,0.25674495,0.00029753664,0.006090274,0.0009617006,0.0027672858,0.63678336,0.004574325,0.023033874,0.004208022,0.057745088],"study_design_scores_gemma":[0.0002860398,0.0011466148,0.029688781,0.000035041463,0.0005755929,0.00011590773,0.00027173778,0.96108955,0.00062305713,0.0040342542,0.0020631705,0.000070269685],"about_ca_topic_score_codex":0.025879499,"about_ca_topic_score_gemma":0.014412988,"teacher_disagreement_score":0.025879499,"about_ca_system_score_codex":0.0010926854,"about_ca_system_score_gemma":0.0011409732,"threshold_uncertainty_score":0.06878668},"labels":[],"label_agreement":null},{"id":"W1986024887","doi":"10.1080/00273171.2011.636708","title":"Abstract: Within-Person Processes Leading to Quarrelsome Behavior in Interactions Between Romantic Partners","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Attachment and Relationship Dynamics","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Psychology; Interpersonal communication; Perception; Developmental psychology; Interpersonal relationship; Multilevel model; Social psychology","score_opus":0.5314181346062891,"score_gpt":0.5929361403061177,"score_spread":0.06151800569982868,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1986024887","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9922436,0.00009167068,0.0062357527,0.00016545758,0.000007938784,0.00007950091,0.00018613561,0.000033652883,0.00095628225],"genre_scores_gemma":[0.995203,0.00006700197,0.004093033,0.00003797493,0.0000054194556,0.0001125774,0.00018592871,0.0000054468132,0.00028950578],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9945716,0.003536534,0.00028159763,0.00063133583,0.00072854635,0.00025038313],"domain_scores_gemma":[0.9867264,0.0073866234,0.003369111,0.0015113326,0.00064430316,0.00036220526],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.004559803,0.00045216002,0.0006265852,0.00091289333,0.0010858569,0.001814671,0.0007732618,0.00063947076,0.0039790426],"category_scores_gemma":[0.018361127,0.00053614756,0.001154026,0.000982014,0.0008851093,0.0013991899,0.0023652283,0.0017593665,0.00026966265],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019152334,0.00054392434,0.95565504,0.00013889215,0.00042774904,0.00029843758,0.015150118,0.0017641544,0.0014159761,0.0027222815,0.00026587315,0.02142599],"study_design_scores_gemma":[0.00003192514,0.00041443502,0.9611358,0.00012840753,0.000207371,0.00038694742,0.009025469,0.022856837,0.0011198516,0.0035466442,0.0010882356,0.000058038542],"about_ca_topic_score_codex":0.0058999215,"about_ca_topic_score_gemma":0.008659339,"teacher_disagreement_score":0.0058999215,"about_ca_system_score_codex":0.0010004501,"about_ca_system_score_gemma":0.0011204269,"threshold_uncertainty_score":0.024114788},"labels":[],"label_agreement":null},{"id":"W1988221738","doi":"10.1080/00273171.2010.498292","title":"Assessing Mediational Models: Testing and Interval Estimation for Indirect Effects","year":2010,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":398,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Markov chain Monte Carlo; Bootstrapping (finance); Computer science; Type I and type II errors; Bayesian probability; Statistics; Confidence interval; Statistical hypothesis testing; Econometrics; Null hypothesis; Prior probability; Mathematics","score_opus":0.6989123915737223,"score_gpt":0.608930368580515,"score_spread":0.08998202299320734,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1988221738","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.050216336,0.0020170363,0.93326795,0.00090172,0.00040184447,0.0027860329,0.0017468184,0.0011969535,0.00746526],"genre_scores_gemma":[0.3299869,0.00083363836,0.65456843,0.00033197686,0.00014960842,0.0120715,0.0011025518,0.0004195652,0.00053586194],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.69539905,0.25203192,0.009691572,0.017723426,0.023451751,0.0017021847],"domain_scores_gemma":[0.14683373,0.80524796,0.01644277,0.021765443,0.008976197,0.0007338804],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.21447277,0.0026955903,0.003986045,0.008753337,0.0023170258,0.004694523,0.009248227,0.0033796194,0.012620694],"category_scores_gemma":[0.6872378,0.0015022112,0.008435718,0.011407826,0.004947328,0.011112189,0.007221518,0.006815868,0.0009996388],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0029910787,0.0010810517,0.16130604,0.0069699436,0.018833056,0.0007750303,0.0119246505,0.02884867,0.0012201451,0.22463615,0.012522051,0.52889216],"study_design_scores_gemma":[0.0011806297,0.0052532465,0.094552085,0.004552107,0.007185369,0.00193225,0.008381294,0.33742955,0.005326481,0.50693685,0.026531816,0.0007384128],"about_ca_topic_score_codex":0.0024895496,"about_ca_topic_score_gemma":0.0012154735,"teacher_disagreement_score":0.21447277,"about_ca_system_score_codex":0.0017937459,"about_ca_system_score_gemma":0.004242151,"threshold_uncertainty_score":0.9686949},"labels":[],"label_agreement":null},{"id":"W1991374387","doi":"10.1080/00273171.2012.715252","title":"An Investigation of the Sample Performance of Two Nonnormality Corrections for RMSEA","year":2012,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":221,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Structural equation modeling; Statistics; Mathematics; Goodness of fit; Sample (material); Sample size determination; Population; Econometrics; Chemistry","score_opus":0.873633224993975,"score_gpt":0.6517804000643616,"score_spread":0.22185282492961345,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1991374387","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28869084,0.003953224,0.6913357,0.0036761612,0.001431756,0.0009420037,0.0008372507,0.0027151783,0.0064179],"genre_scores_gemma":[0.6560919,0.00054646324,0.33826542,0.00066544634,0.00016588921,0.0009682995,0.0010219637,0.00093032495,0.0013442701],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9299946,0.050180063,0.0033754616,0.006143354,0.009534615,0.00077185285],"domain_scores_gemma":[0.3961395,0.5184228,0.013581133,0.04320867,0.027605485,0.0010424642],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09786294,0.0016882392,0.0014137338,0.002417909,0.0013522229,0.0018115323,0.0028328395,0.0023138567,0.0022683947],"category_scores_gemma":[0.47649,0.0005993673,0.002089496,0.0036847547,0.0021658218,0.0045476137,0.0026405777,0.004068864,0.00064936734],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0032535756,0.00093393086,0.1314121,0.0013539981,0.003470416,0.0010401249,0.0066870865,0.075354904,0.011886957,0.07043649,0.015540271,0.6786301],"study_design_scores_gemma":[0.0008872827,0.0031110386,0.1646909,0.0010287332,0.0019134216,0.0025899569,0.0030813573,0.6937407,0.03022802,0.07004828,0.028011225,0.00066912954],"about_ca_topic_score_codex":0.00435038,"about_ca_topic_score_gemma":0.005149835,"teacher_disagreement_score":0.90213704,"about_ca_system_score_codex":0.0015560322,"about_ca_system_score_gemma":0.002540605,"threshold_uncertainty_score":0.5175549},"labels":[],"label_agreement":null},{"id":"W1991886460","doi":"10.1080/00273171.2014.963193","title":"Identification of Real and Artifactual Moderators of Effect Size in Meta-Analysis","year":2015,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"National Institute of Mental Health; National Institutes of Health; Medical Research Council Canada","keywords":"Meta-analysis; Confounding; Covariate; Psychology; Outcome (game theory); Clinical psychology; Statistics; Psychotherapist; Medicine; Internal medicine; Mathematics","score_opus":0.6246462726663043,"score_gpt":0.614947560363395,"score_spread":0.009698712302909307,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1991886460","genre_codex":"methods","genre_gemma":"empirical","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.016832246,0.22275145,0.7385444,0.0047200364,0.0037221364,0.0072728354,0.00148312,0.0015097731,0.003163935],"genre_scores_gemma":[0.36970025,0.028105702,0.5776508,0.0030863823,0.0009241556,0.018399337,0.0008374117,0.00055967324,0.0007363936],"study_design_codex":"meta_analysis","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.382451,0.52137274,0.057079457,0.016759241,0.021407278,0.00093034783],"domain_scores_gemma":[0.30457985,0.6360368,0.017798752,0.034715656,0.0064417943,0.00042717223],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.47307417,0.0038039503,0.0113138985,0.014371681,0.0012645267,0.0093420055,0.0059500486,0.0039537563,0.0016983763],"category_scores_gemma":[0.63617283,0.0029971974,0.03090339,0.011132019,0.0044452175,0.005755366,0.006440204,0.0061941673,0.0002554968],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002651803,0.0002074022,0.039340444,0.113424696,0.59459096,0.0010940534,0.0038379019,0.008872957,0.0020225924,0.045700796,0.005541242,0.18271515],"study_design_scores_gemma":[0.0031440957,0.002370828,0.032572478,0.03805912,0.58749,0.0016350015,0.0012221376,0.03333348,0.010077037,0.2546521,0.034593917,0.0008497385],"about_ca_topic_score_codex":0.0015487478,"about_ca_topic_score_gemma":0.0026397677,"teacher_disagreement_score":0.5269258,"about_ca_system_score_codex":0.0038161885,"about_ca_system_score_gemma":0.0050506303,"threshold_uncertainty_score":0.6497934},"labels":[],"label_agreement":null},{"id":"W2000754699","doi":"10.1080/00273170701360332","title":"Fuzzy Clusterwise Growth Curve Models via Generalized Estimating Equations: An Application to the Antisocial Behavior of Children","year":2007,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Sample (material); Monte Carlo method; Population; Covariance; Growth curve (statistics); Mathematics; Fuzzy logic; Econometrics; Computer science; Generalized estimating equation; Cluster analysis; Aggregate (composite); Statistics; Applied mathematics; Artificial intelligence","score_opus":0.39054312890837145,"score_gpt":0.5654358791865369,"score_spread":0.17489275027816548,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2000754699","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0293696,0.0003006616,0.9693484,0.00027380508,0.000019896135,0.00009337853,0.00012674494,0.000165625,0.0003018726],"genre_scores_gemma":[0.3072607,0.00073337957,0.68922347,0.00007735766,0.00006065796,0.0004953528,0.00049108703,0.00010334999,0.0015546908],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99345666,0.0053881607,0.00016608665,0.0004640829,0.00039894893,0.00012607775],"domain_scores_gemma":[0.9691153,0.02573298,0.0017605359,0.0014652074,0.0017159777,0.0002099949],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016519584,0.0010935242,0.0015770136,0.0020174272,0.00076228555,0.0012502106,0.002225889,0.0016711337,0.0016043442],"category_scores_gemma":[0.038491033,0.0006664174,0.0018295732,0.0026538987,0.0011760204,0.0014845995,0.0019378472,0.0026710415,0.00029853254],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020115855,0.00010121381,0.010283546,0.00018616479,0.0005727802,0.0002350784,0.0010181905,0.74304646,0.00071094645,0.12825018,0.0016175379,0.1137768],"study_design_scores_gemma":[0.000014571221,0.00003238352,0.00096842344,0.000013511927,0.000027278136,0.000024512412,0.000049987913,0.97151643,0.00012681853,0.026687153,0.0005138813,0.000025107376],"about_ca_topic_score_codex":0.021384964,"about_ca_topic_score_gemma":0.016966928,"teacher_disagreement_score":0.021384964,"about_ca_system_score_codex":0.0015980996,"about_ca_system_score_gemma":0.0019289007,"threshold_uncertainty_score":0.08736497},"labels":[],"label_agreement":null},{"id":"W2003103389","doi":"10.1080/00273171.2013.841089","title":"Fighting for Intelligence: A Brief Overview of the Academic Work of John L. Horn","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Cognitive Abilities and Testing","field":"Psychology","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Victoria","funders":"National Institute on Aging; National Institutes of Health","keywords":"Psychology; French horn; Personality; Exploratory factor analysis; Confirmatory factor analysis; Trait; Big Five personality traits; Cognition; Cognitive psychology; Social psychology; Developmental psychology; Structural equation modeling; Psychometrics; Computer science","score_opus":0.48454829235878805,"score_gpt":0.5396495645253334,"score_spread":0.05510127216654537,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2003103389","genre_codex":"review","genre_gemma":"review","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"review","genre_consensus":"review","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00087669695,0.9365113,0.006953055,0.026709078,0.003150454,0.00004328135,0.0001061372,0.00006908521,0.025580911],"genre_scores_gemma":[0.010219868,0.9475932,0.008508269,0.012018674,0.009306174,0.000101810525,0.00019140299,0.000088141605,0.011972463],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.99833053,0.0006410025,0.00016551578,0.00026343594,0.0004475002,0.00015198799],"domain_scores_gemma":[0.99606824,0.0028058987,0.00022224677,0.000088592125,0.00054794457,0.00026691926],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0041105305,0.0011614276,0.0012070978,0.0065163933,0.0023472535,0.0042437324,0.0011364104,0.0026622177,0.005206347],"category_scores_gemma":[0.006598212,0.0006774089,0.0007162945,0.008466377,0.004064098,0.00532453,0.0021422133,0.0057055126,0.0032626698],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008577018,0.0001997154,0.001902188,0.0037860186,0.00005403915,0.00039097737,0.0038308043,0.0009317589,0.0005003396,0.16848195,0.25369668,0.56613976],"study_design_scores_gemma":[0.000004376404,0.000042649404,0.0026976122,0.0021213798,0.000009669981,0.00040583813,0.00048449985,0.00018308319,0.00010409692,0.039455097,0.95445234,0.00003939808],"about_ca_topic_score_codex":0.007313706,"about_ca_topic_score_gemma":0.0074781557,"teacher_disagreement_score":0.007313706,"about_ca_system_score_codex":0.0042758915,"about_ca_system_score_gemma":0.0032436394,"threshold_uncertainty_score":0.03102386},"labels":[],"label_agreement":null},{"id":"W2005967696","doi":"10.1080/00273171.2014.933697","title":"Adjusting Incremental Fit Indices for Nonnormality","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":223,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; University of Ottawa","funders":"","keywords":"Statistics; Mathematics; Index (typography); Structural equation modeling; Population; Goodness of fit; Econometrics; Value (mathematics); Sample (material); Computer science","score_opus":0.9278926090737645,"score_gpt":0.6852634534042872,"score_spread":0.2426291556694773,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2005967696","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.16030167,0.00045676736,0.82753015,0.00070782966,0.0003492974,0.0008014873,0.00058325543,0.0024667825,0.006802689],"genre_scores_gemma":[0.46841952,0.00016845939,0.5269958,0.00026381112,0.000059121834,0.0012017816,0.00083289645,0.00080024044,0.0012583793],"study_design_codex":"design_other","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.97778785,0.011713574,0.0016858032,0.002522154,0.005684163,0.00060648646],"domain_scores_gemma":[0.80860966,0.13333386,0.010345889,0.020921247,0.025670504,0.0011188723],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04316852,0.0015661541,0.0011420203,0.0046334243,0.0012138088,0.0021942433,0.0027757566,0.0011341188,0.0041161855],"category_scores_gemma":[0.31610584,0.0006254057,0.0017264205,0.005068489,0.0015209827,0.0034154316,0.0026480642,0.0030570463,0.0010275758],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00047980744,0.00056914345,0.2177963,0.00050208636,0.00081886974,0.00051612477,0.003474875,0.03407717,0.005394509,0.054771345,0.016382761,0.66521704],"study_design_scores_gemma":[0.00034298954,0.0017886764,0.21744455,0.0006119922,0.0009187235,0.0017300218,0.0022287308,0.5344338,0.028922861,0.1697866,0.041069362,0.0007217167],"about_ca_topic_score_codex":0.004267641,"about_ca_topic_score_gemma":0.0053617903,"teacher_disagreement_score":0.04316852,"about_ca_system_score_codex":0.001444643,"about_ca_system_score_gemma":0.0031160288,"threshold_uncertainty_score":0.22829968},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"empirical","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"simulation_or_modeling","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"medium"}],"label_agreement":"agree"},{"id":"W2014956237","doi":"10.1080/00273171.2013.751295","title":"Abstract: RMSEA With Nonnormal Data: A Comparison of Two Robust Corrections","year":2013,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Multi-Criteria Decision Making","field":"Decision Sciences","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Structural equation modeling; Computer science; Statistics; Econometrics; Data mining; Mathematics","score_opus":0.8249248068608278,"score_gpt":0.6416101974285493,"score_spread":0.1833146094322785,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2014956237","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.23697844,0.012908432,0.7250947,0.0021100529,0.0021890812,0.0011390109,0.0057309833,0.0038336436,0.01001569],"genre_scores_gemma":[0.693403,0.0017311589,0.29396683,0.00076431053,0.0001826565,0.0012959747,0.0041360403,0.0018211721,0.0026987325],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9737595,0.014706448,0.002462568,0.0028533833,0.005869119,0.00034908095],"domain_scores_gemma":[0.8257537,0.12537009,0.0096213715,0.020347,0.018111492,0.0007962819],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03540337,0.0016087076,0.0017149551,0.003582569,0.0010006083,0.0018330023,0.0036034847,0.001547038,0.0057784715],"category_scores_gemma":[0.21704894,0.0005215433,0.002682655,0.0060527003,0.0015070926,0.003098735,0.0021550786,0.0024607552,0.0016997748],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.004261624,0.0011376877,0.07368728,0.003792862,0.006305508,0.00038905055,0.0031618671,0.10266922,0.0055092108,0.019192623,0.037407707,0.74248534],"study_design_scores_gemma":[0.0012271024,0.004184806,0.30863124,0.004099409,0.0043430817,0.0022780271,0.0038035093,0.53478163,0.02150467,0.056043707,0.0581079,0.0009949028],"about_ca_topic_score_codex":0.006100632,"about_ca_topic_score_gemma":0.0077438103,"teacher_disagreement_score":0.9645966,"about_ca_system_score_codex":0.0014050383,"about_ca_system_score_gemma":0.0020569214,"threshold_uncertainty_score":0.18723315},"labels":[],"label_agreement":null},{"id":"W2029342244","doi":"10.1207/s15327906mbr3902_8","title":"Psychometric Properties of the HEXACO Personality Inventory","year":2004,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Personality Traits and Psychology","field":"Psychology","cited_by":1958,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Brock University; University of Calgary","funders":"","keywords":"Agreeableness; Psychology; Facet (psychology); Personality Assessment Inventory; Personality; Big Five personality traits and culture; Conscientiousness; Openness to experience; Big Five personality traits; Extraversion and introversion; Alternative five model of personality; Hierarchical structure of the Big Five; Social psychology","score_opus":0.48719321848499736,"score_gpt":0.5057646919226918,"score_spread":0.01857147343769444,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2029342244","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.8767952,0.0020854885,0.020551236,0.0017098939,0.0006848959,0.0031385152,0.0106669925,0.0007156308,0.083652064],"genre_scores_gemma":[0.94987935,0.0013359957,0.030946149,0.0004345286,0.000116940246,0.0019216078,0.0060040997,0.00010139559,0.009259883],"study_design_codex":"observational","study_design_gemma":"bench_or_experimental","domain_scores_codex":[0.99769634,0.0007491554,0.00029278817,0.00015579491,0.0009792647,0.00012653203],"domain_scores_gemma":[0.9877023,0.0044129086,0.0014225827,0.0012184501,0.0044101556,0.00083354936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.00412636,0.00032274038,0.00041929501,0.0011591911,0.0004502027,0.0008267809,0.00031918322,0.00024059264,0.005985531],"category_scores_gemma":[0.019258777,0.00019244188,0.00066799374,0.0013943333,0.0003260706,0.00047747526,0.00081778126,0.00070821855,0.0013791156],"study_design_candidate":"bench_or_experimental","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00044427824,0.0003470242,0.7023088,0.00028437955,0.00030513268,0.00016794442,0.0012704056,0.0027137627,0.0011259766,0.0026732394,0.016580643,0.27177837],"study_design_scores_gemma":[0.000044167024,0.00030676855,0.9722138,0.00010656456,0.00007186382,0.00038565547,0.00054051937,0.0025090738,0.0004120657,0.0019808346,0.021388313,0.000040239276],"about_ca_topic_score_codex":0.0035188375,"about_ca_topic_score_gemma":0.004888156,"teacher_disagreement_score":0.005985531,"about_ca_system_score_codex":0.0006101784,"about_ca_system_score_gemma":0.0011242898,"threshold_uncertainty_score":0.021822512},"labels":[],"label_agreement":null},{"id":"W2036193982","doi":"10.1080/00273171.2011.568786","title":"An Introduction to Propensity Score Methods for Reducing the Effects of Confounding in Observational Studies","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":11884,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Ontario Ministry of Health and Long-Term Care; Institute for Clinical Evaluative Sciences","keywords":"Propensity score matching; Observational study; Covariate; Confounding; Statistics; Inverse probability weighting; Econometrics; Mathematics","score_opus":0.8974226593536919,"score_gpt":0.6794649079660394,"score_spread":0.2179577513876525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036193982","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00024350666,0.0043060374,0.99055266,0.0014779316,0.00049117365,0.00024828452,0.00035706715,0.00030074306,0.0020225036],"genre_scores_gemma":[0.00894371,0.012724371,0.96868503,0.0012558167,0.002510169,0.0017467625,0.00064014713,0.00033695766,0.003156957],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.976929,0.01696536,0.0011463742,0.0011722144,0.0035489518,0.0002380372],"domain_scores_gemma":[0.95614725,0.03687255,0.001960655,0.002791513,0.0018839876,0.0003440085],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.025659665,0.0021313883,0.0022606354,0.004319488,0.0010787607,0.002945566,0.0031866478,0.0030984636,0.017817618],"category_scores_gemma":[0.07310484,0.0012348326,0.003387682,0.008909905,0.002494858,0.0036621075,0.0029166888,0.007835088,0.006071698],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006495276,0.00011448645,0.0023710271,0.0019816728,0.00058784976,0.00025796302,0.0004048448,0.015073315,0.0008950936,0.55955637,0.069797106,0.34889534],"study_design_scores_gemma":[0.000119599645,0.00012052664,0.0016455252,0.0007699517,0.00016579543,0.00050272816,0.000073335344,0.037325427,0.0007373698,0.8075804,0.15083297,0.00012635336],"about_ca_topic_score_codex":0.0018122713,"about_ca_topic_score_gemma":0.0020777825,"teacher_disagreement_score":0.025659665,"about_ca_system_score_codex":0.0014363396,"about_ca_system_score_gemma":0.0032271836,"threshold_uncertainty_score":0.13570291},"labels":[],"label_agreement":null},{"id":"W2036514462","doi":"10.1080/00273171.2011.589280","title":"Multilevel SEM Strategies for Evaluating Mediation in Three-Level Data","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Mount Allison University","keywords":"Mediation; Multilevel model; Computer science; Structural equation modeling; Psychology; Data mining; Econometrics; Statistics; Mathematics; Machine learning; Sociology","score_opus":0.9563346823471308,"score_gpt":0.6781517874356203,"score_spread":0.2781828949115105,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2036514462","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0036023753,0.00032144936,0.99132675,0.0003045137,0.000103532984,0.0011958833,0.00043687416,0.00048697318,0.0022216842],"genre_scores_gemma":[0.036202673,0.00028990547,0.9547879,0.00016418807,0.000036048415,0.007572813,0.0003073838,0.00014821123,0.0004908861],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.87192535,0.1130432,0.004045983,0.0037157766,0.0064549893,0.0008146897],"domain_scores_gemma":[0.7844976,0.18693133,0.006280156,0.012915023,0.008613111,0.00076266576],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10486733,0.0026706364,0.003733756,0.0071347286,0.0022213326,0.0044105886,0.004860567,0.0021103956,0.023026016],"category_scores_gemma":[0.24336916,0.0014575113,0.0058892174,0.011604683,0.0027062756,0.0046110554,0.0049161036,0.0056153378,0.0016946445],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0005141526,0.00047042817,0.0126455715,0.0029824923,0.0055430885,0.00038477298,0.006031349,0.015570536,0.0015444028,0.60883194,0.013069507,0.3324117],"study_design_scores_gemma":[0.00066208147,0.0017092112,0.012664137,0.0018920576,0.0022003457,0.00047858193,0.0041749566,0.18834797,0.00438361,0.7344545,0.048712287,0.000320335],"about_ca_topic_score_codex":0.0029115167,"about_ca_topic_score_gemma":0.004286938,"teacher_disagreement_score":0.10486733,"about_ca_system_score_codex":0.0022197678,"about_ca_system_score_gemma":0.0050181444,"threshold_uncertainty_score":0.5545981},"labels":[],"label_agreement":null},{"id":"W2037948952","doi":"10.1080/00273171.2010.532361","title":"Selection Between Linear Factor Models and Latent Profile Models Using Conditional Covariances","year":2010,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Statistical Modeling Techniques","field":"Computer Science","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University","funders":"Social Sciences and Humanities Research Council of Canada; York University","keywords":"Latent class model; Latent variable model; Latent variable; Factor analysis; Computer science; Model selection; Class (philosophy); Mathematics; Econometrics; Statistics; Artificial intelligence; Machine learning","score_opus":0.47595027100645143,"score_gpt":0.5155987626752487,"score_spread":0.0396484916687973,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2037948952","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.014465213,0.00003692115,0.9842403,0.00009424343,0.000014167968,0.00009079705,0.00008150274,0.00030146854,0.00067535765],"genre_scores_gemma":[0.3458029,0.00011209931,0.65191454,0.0000810517,0.000040442865,0.00067780004,0.00058155943,0.00020562962,0.00058403413],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97185236,0.02233417,0.00086611486,0.0018686157,0.0023968685,0.00068183086],"domain_scores_gemma":[0.9063793,0.078621276,0.0030376231,0.007092384,0.004116225,0.00075325003],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.02591204,0.0012291184,0.0013888876,0.002673113,0.0012975588,0.0031076355,0.0020957175,0.0011178241,0.005475773],"category_scores_gemma":[0.14958975,0.0008989691,0.0020463676,0.0024451702,0.002432566,0.0043422375,0.003977123,0.0029197298,0.0011678276],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00080293126,0.00037083123,0.021828286,0.00035187628,0.00047709697,0.00043861973,0.001996348,0.11040973,0.0032239275,0.4962193,0.0039911107,0.35988995],"study_design_scores_gemma":[0.000113478694,0.00021980552,0.0043813274,0.0001329488,0.00006746995,0.00017417257,0.00034580936,0.6164996,0.0019104923,0.3740384,0.0020033687,0.00011313074],"about_ca_topic_score_codex":0.0027588394,"about_ca_topic_score_gemma":0.0028856765,"teacher_disagreement_score":0.02591204,"about_ca_system_score_codex":0.0011218186,"about_ca_system_score_gemma":0.0035033587,"threshold_uncertainty_score":0.13703763},"labels":[],"label_agreement":null},{"id":"W2051550601","doi":"10.1080/00273171.2014.905766","title":"On Johnson's (2000) Relative Weights Method for Assessing Variable Importance: A Reanalysis","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":33,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; Carleton University","funders":"","keywords":"Variable (mathematics); Metric (unit); Statistics; Mathematics; Linear regression; Regression; Regression analysis; Econometrics; Computer science; Engineering","score_opus":0.4015639991587576,"score_gpt":0.5945831617637344,"score_spread":0.19301916260497676,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2051550601","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0042283265,0.0028198964,0.9796754,0.001639662,0.0007664473,0.00026575482,0.00040326925,0.0004710235,0.009730257],"genre_scores_gemma":[0.058622822,0.0036584598,0.92597884,0.0009882278,0.0005539846,0.0008812872,0.0004581167,0.00063075445,0.008227558],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9800789,0.010091344,0.0008202084,0.0017240931,0.006901548,0.00038400368],"domain_scores_gemma":[0.97003996,0.014798261,0.0018459569,0.0035576727,0.009362324,0.00039573712],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.023912856,0.0018925834,0.0016313284,0.01038929,0.0024767264,0.006178565,0.0028378451,0.0014157043,0.007832476],"category_scores_gemma":[0.07844515,0.0010227925,0.0022398396,0.012396931,0.0033552498,0.0063458276,0.0030556573,0.0042826696,0.002639617],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008726018,0.0000948862,0.004369134,0.0006688489,0.0003879412,0.00016236918,0.0022244717,0.012004872,0.0010750591,0.2908949,0.033027723,0.65500253],"study_design_scores_gemma":[0.0000799162,0.00021678318,0.0117043955,0.0010728312,0.00049735495,0.00043234852,0.0019216306,0.06333365,0.003410119,0.71545905,0.20140691,0.00046496716],"about_ca_topic_score_codex":0.018244196,"about_ca_topic_score_gemma":0.023862664,"teacher_disagreement_score":0.97608715,"about_ca_system_score_codex":0.0028041438,"about_ca_system_score_gemma":0.0056007365,"threshold_uncertainty_score":0.12646478},"labels":[],"label_agreement":null},{"id":"W2056241146","doi":"10.1080/00273171003680278","title":"The Other Side of Method Bias: The Perils of Distinct Source Research Designs","year":2010,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Behavioral and Psychological Studies","field":"Psychology","cited_by":44,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Calgary","funders":"","keywords":"Variance (accounting); Observer (physics); Computer science; Focus (optics); Data source; Econometrics; Common-method variance; Data science; Data mining; Statistics; Mathematics","score_opus":0.8266679186751913,"score_gpt":0.6096089629458628,"score_spread":0.21705895572932854,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2056241146","genre_codex":"methods","genre_gemma":"methods","domain_codex":"methods","domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":"methods","prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0118277585,0.010544715,0.9089629,0.048993297,0.004236065,0.0016658304,0.0002887463,0.00035484845,0.013125777],"genre_scores_gemma":[0.31237927,0.006762433,0.6274203,0.034025554,0.0049726306,0.009431717,0.00021674286,0.00055302534,0.0042382097],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.42271638,0.49471965,0.016135925,0.014781073,0.050562,0.0010849683],"domain_scores_gemma":[0.20484346,0.6563017,0.027154319,0.08744502,0.022980226,0.0012752353],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.43995538,0.0018069234,0.0037340024,0.0041179527,0.0032795023,0.008446725,0.004450587,0.0065484564,0.0047965692],"category_scores_gemma":[0.66646266,0.0013891773,0.003074839,0.004030667,0.02972702,0.010451373,0.009744765,0.0105007775,0.001263779],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0011706551,0.00023949362,0.014426586,0.004853105,0.0020598392,0.0002617427,0.011956556,0.0026360827,0.0012448956,0.72631204,0.0113533,0.22348571],"study_design_scores_gemma":[0.00078328664,0.0010252896,0.007035563,0.004590558,0.00074753637,0.00078104885,0.0019645041,0.01021594,0.00328175,0.9173419,0.051999986,0.00023265599],"about_ca_topic_score_codex":0.0011543779,"about_ca_topic_score_gemma":0.0011188005,"teacher_disagreement_score":0.56004465,"about_ca_system_score_codex":0.00393081,"about_ca_system_score_gemma":0.006002847,"threshold_uncertainty_score":0.6906347},"labels":[],"label_agreement":null},{"id":"W2058280804","doi":"10.1080/00273170903504893","title":"Simultaneous Two-Way Clustering of Multiple Correspondence Analysis","year":2010,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Sensory Analysis and Statistical Methods","field":"Agricultural and Biological Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Categorical variable; Cluster analysis; Correspondence analysis; Centroid; Variable (mathematics); Multiple correspondence analysis; Partition (number theory); Cluster (spacecraft); Statistics; Mathematics; Data mining; Contingency table; Extant taxon; Multivariate statistics; Computer science; Artificial intelligence","score_opus":0.22477204831980976,"score_gpt":0.4679075736295627,"score_spread":0.24313552530975294,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2058280804","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002807089,0.00005530185,0.9963092,0.000030036457,0.000030043648,0.00008976454,0.000047183912,0.00028901445,0.00034229204],"genre_scores_gemma":[0.103045635,0.00011891494,0.8942125,0.000038127593,0.000051835428,0.00069678295,0.00032371108,0.00018544172,0.0013270908],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9839092,0.007871415,0.0008611477,0.0036847817,0.0029823203,0.0006910781],"domain_scores_gemma":[0.9860356,0.0068445564,0.0011948148,0.0021325182,0.003506131,0.00028638932],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008834481,0.0021529356,0.0035636942,0.0076176836,0.0028162422,0.00441756,0.0034037298,0.0020813062,0.003572839],"category_scores_gemma":[0.02605206,0.00142342,0.0048622624,0.008556469,0.001983268,0.0031551472,0.004496845,0.0026571343,0.0012364031],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043154156,0.0002955247,0.007142223,0.0008701043,0.0012199297,0.00037955493,0.0025274805,0.26084468,0.01155647,0.07778413,0.0059407097,0.6310076],"study_design_scores_gemma":[0.000028632483,0.00011038916,0.0021243063,0.00003957773,0.00008627061,0.00017499356,0.0002433712,0.95830256,0.0036629066,0.03020673,0.00487219,0.00014807965],"about_ca_topic_score_codex":0.0055549983,"about_ca_topic_score_gemma":0.0060770214,"teacher_disagreement_score":0.008834481,"about_ca_system_score_codex":0.0016005277,"about_ca_system_score_gemma":0.0037012063,"threshold_uncertainty_score":0.046721756},"labels":[],"label_agreement":null},{"id":"W2065417422","doi":"10.1080/00273171.2011.540480","title":"A Tutorial and Case Study in Propensity Score Analysis: An Application to Estimating the Effect of In-Hospital Smoking Cessation Counseling on Mortality","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":421,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; U.S. Public Health Service; Ontario Ministry of Health and Long-Term Care","keywords":"Propensity score matching; Covariate; Medicine; Inverse probability weighting; Observational study; Matching (statistics); Statistics; Internal medicine; Mathematics","score_opus":0.49956942762470347,"score_gpt":0.5544291490721748,"score_spread":0.05485972144747131,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2065417422","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0008189544,0.0008730586,0.9917429,0.002588795,0.0002828768,0.00021931462,0.00018440704,0.00029442794,0.0029952922],"genre_scores_gemma":[0.014026163,0.0021552313,0.9776562,0.0008737294,0.0006053913,0.0012035826,0.00021352747,0.00015664836,0.0031095291],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9867932,0.010955217,0.00054772996,0.0005663426,0.0010084211,0.00012916834],"domain_scores_gemma":[0.95052826,0.04532723,0.00091285765,0.0017056583,0.0011387295,0.00038720472],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.026334452,0.0018231301,0.0016063628,0.0029508194,0.0011791212,0.0020555065,0.0022791156,0.0036344375,0.015412812],"category_scores_gemma":[0.06575539,0.0009831543,0.0026285956,0.0036343858,0.0025689832,0.0037367549,0.0034599479,0.0055338107,0.0030062415],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016322729,0.0003867101,0.005960238,0.001001484,0.00035777903,0.002391269,0.0010855745,0.029151779,0.00076116365,0.5999829,0.07783631,0.28092158],"study_design_scores_gemma":[0.00018169377,0.00019564187,0.0016100876,0.00046582712,0.0001233946,0.0028569628,0.00025788747,0.15691513,0.0006518859,0.7326699,0.10394293,0.00012865278],"about_ca_topic_score_codex":0.0034266245,"about_ca_topic_score_gemma":0.0034823436,"teacher_disagreement_score":0.97366554,"about_ca_system_score_codex":0.0013051833,"about_ca_system_score_gemma":0.0021724228,"threshold_uncertainty_score":0.13927156},"labels":[],"label_agreement":null},{"id":"W2068031621","doi":"10.1080/00273171.2014.931800","title":"Recovering Substantive Factor Loadings in the Presence of Acquiescence Bias: A Comparison of Three Approaches","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":112,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Acquiescence; Factor (programming language); Econometrics; Statistics; Factor analysis; Psychology; Reliability engineering; Computer science; Mathematics; Political science; Engineering; Law","score_opus":0.9425613097282266,"score_gpt":0.6184554955586505,"score_spread":0.32410581416957607,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2068031621","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.24995251,0.0029446455,0.7336762,0.0014250902,0.00027983333,0.0012972965,0.0003653317,0.00085101003,0.009208141],"genre_scores_gemma":[0.55162483,0.0019607283,0.44231722,0.00029670994,0.00007912118,0.0017337989,0.00072392274,0.0003238599,0.0009398207],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.93901765,0.040677108,0.00404324,0.004501444,0.010855098,0.00090539287],"domain_scores_gemma":[0.84810936,0.11595271,0.009510292,0.01201031,0.012905688,0.0015116377],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08442005,0.0027780887,0.0018968254,0.008054696,0.0018157882,0.004862805,0.0024348127,0.0019363104,0.003104535],"category_scores_gemma":[0.23586865,0.0011280145,0.004956407,0.0071475413,0.004196816,0.0060092523,0.0057958844,0.0027188861,0.000965335],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0017944644,0.00072510145,0.15534492,0.0024201162,0.005039907,0.0002859872,0.019077156,0.005851052,0.003833044,0.038358655,0.0028082274,0.7644614],"study_design_scores_gemma":[0.0016492209,0.0040062736,0.52044827,0.004750286,0.0055303182,0.0018677663,0.035573054,0.12416612,0.012110318,0.26750666,0.020993646,0.0013980673],"about_ca_topic_score_codex":0.0036256968,"about_ca_topic_score_gemma":0.0059915907,"teacher_disagreement_score":0.91558,"about_ca_system_score_codex":0.0019856545,"about_ca_system_score_gemma":0.004146222,"threshold_uncertainty_score":0.4464612},"labels":[],"label_agreement":null},{"id":"W2084126787","doi":"10.1080/00273171.2011.606748","title":"Comparison of Methods for Collecting and Modeling Dissimilarity Data: Applications to Complex Sound Stimuli","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Multisensory perception and integration","field":"Psychology","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Sorting; Reliability (semiconductor); Computer science; Pattern recognition (psychology); Hierarchical database model; Data mining; Artificial intelligence; Statistics; Mathematics; Algorithm","score_opus":0.9508423595852682,"score_gpt":0.7395595268481697,"score_spread":0.21128283273709847,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2084126787","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.043716524,0.00016386787,0.9545267,0.000084402,0.000024510598,0.00049500685,0.00022266887,0.000459805,0.00030646622],"genre_scores_gemma":[0.09693833,0.00020308136,0.9011829,0.000025272353,0.000016473414,0.0010321883,0.00030288572,0.00015566438,0.00014315305],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.98752373,0.007819139,0.0010500351,0.0011244548,0.002355619,0.00012702832],"domain_scores_gemma":[0.9140568,0.06198847,0.004016719,0.013824383,0.005479726,0.0006339663],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.016649865,0.0010599813,0.000867049,0.0025973285,0.00041876835,0.0012125336,0.0021110375,0.00096937834,0.0022898668],"category_scores_gemma":[0.093372665,0.0006191665,0.0012918623,0.0022901697,0.00090345804,0.0015301206,0.0020676001,0.0011700105,0.00054516434],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0018144773,0.0007180206,0.026330426,0.0015370672,0.0009029315,0.00015117686,0.0016975233,0.058547232,0.04983968,0.011953546,0.0012437719,0.8452642],"study_design_scores_gemma":[0.00046593905,0.0020352874,0.0776884,0.0002792136,0.00037809458,0.0013107717,0.00069587084,0.82253224,0.0475892,0.039892696,0.0065999907,0.0005323384],"about_ca_topic_score_codex":0.0021693872,"about_ca_topic_score_gemma":0.0027567951,"teacher_disagreement_score":0.016649865,"about_ca_system_score_codex":0.0006962771,"about_ca_system_score_gemma":0.0010951547,"threshold_uncertainty_score":0},"labels":[{"model":"gpt","categories":["metaresearch"],"domain":"methods","study_design":"bench_or_experimental","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"grok","categories":[],"domain":null,"study_design":"observational","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"},{"model":"opus","categories":["metaresearch"],"domain":"methods","study_design":"bench_or_experimental","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"}],"label_agreement":"split"},{"id":"W2087644214","doi":"10.1080/00273171.2013.752267","title":"Abstract: Longitudinal Examination of the Interpersonal Impact of Behavioral Variability","year":2013,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"McGill University","funders":"","keywords":"Interpersonal communication; Psychology; Supervisor; Longitudinal study; Interpersonal relationship; Behavioural sciences; Applied psychology; Social psychology; Political science; Medicine; Psychotherapist; Law","score_opus":0.5059692537244797,"score_gpt":0.5698292122761865,"score_spread":0.0638599585517069,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2087644214","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.98915315,0.00080067926,0.001503774,0.002580286,0.00011475119,0.000046480192,0.0036867773,0.000050536604,0.002063655],"genre_scores_gemma":[0.9957807,0.0002753705,0.0005786602,0.00013316325,0.000052118645,0.00008669463,0.0016661576,0.000008991713,0.0014180936],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9989895,0.00042283194,0.00006725343,0.00017748753,0.00023747738,0.00010536457],"domain_scores_gemma":[0.9799013,0.0050316267,0.0072477018,0.002527467,0.0027298192,0.002562097],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0043173498,0.00026875996,0.00032835503,0.0007851438,0.0007282287,0.0010265689,0.0006804749,0.0008250311,0.006236954],"category_scores_gemma":[0.028637677,0.00026315777,0.00062991737,0.0008398287,0.00033696485,0.0011689155,0.0012730949,0.0020864129,0.0009971648],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004280449,0.00037218884,0.96815187,0.00004891632,0.0002991725,0.00013980367,0.0013426191,0.0004774157,0.00035728182,0.001124144,0.0066395155,0.020619133],"study_design_scores_gemma":[0.000011723212,0.0001993175,0.9962262,0.000030969288,0.00009201853,0.00013003363,0.00046669313,0.0006295919,0.00024154063,0.0007382957,0.0012160314,0.000017623886],"about_ca_topic_score_codex":0.007194476,"about_ca_topic_score_gemma":0.006902913,"teacher_disagreement_score":0.007194476,"about_ca_system_score_codex":0.00059511146,"about_ca_system_score_gemma":0.0009660104,"threshold_uncertainty_score":0.022832572},"labels":[],"label_agreement":null},{"id":"W2089004370","doi":"10.1080/00273171.2014.911075","title":"Assessing Approximate Fit in Categorical Data Analysis","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":276,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Mathematics; Statistics; Categorical variable; Goodness of fit; Bivariate analysis; Statistic; Ordinal data; Mean squared error; Multivariate statistics; Item response theory; Cutoff; Econometrics; Psychometrics","score_opus":0.959382260741685,"score_gpt":0.7182746444274037,"score_spread":0.24110761631428124,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2089004370","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021902803,0.0008573756,0.9736075,0.00034927085,0.000137096,0.00056380127,0.00055687956,0.0005503497,0.001474927],"genre_scores_gemma":[0.411172,0.0005857712,0.58095765,0.0006048955,0.00012773274,0.0039174436,0.0018465214,0.00035836003,0.00042965368],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.75448585,0.18476042,0.016591534,0.013384981,0.029433304,0.0013438846],"domain_scores_gemma":[0.353338,0.56177455,0.023649547,0.038979203,0.021054603,0.0012041304],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18531665,0.0022734737,0.004362448,0.009788658,0.0017493723,0.004915506,0.004477897,0.0030975551,0.0036122047],"category_scores_gemma":[0.6085298,0.0011311814,0.004549775,0.013675713,0.0047022467,0.00615772,0.005174622,0.0043682493,0.0010738708],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.001500892,0.0005645445,0.2501815,0.0044841,0.00853987,0.0011586563,0.0076563307,0.16200121,0.0023254652,0.10259035,0.011393585,0.4476036],"study_design_scores_gemma":[0.0002012239,0.0015503956,0.05908572,0.001561979,0.00076436787,0.0014302965,0.0033366722,0.6160533,0.002384238,0.29925436,0.013949969,0.00042751516],"about_ca_topic_score_codex":0.0029331748,"about_ca_topic_score_gemma":0.0026770069,"teacher_disagreement_score":0.18531665,"about_ca_system_score_codex":0.0022265096,"about_ca_system_score_gemma":0.0036533752,"threshold_uncertainty_score":0.98005986},"labels":[],"label_agreement":null},{"id":"W2095572468","doi":"10.1080/00273171.2013.866537","title":"A Computationally Efficient State Space Approach to Estimating Multilevel Regression Models and Multilevel Confirmatory Factor Models","year":2014,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Cultural Differences and Values","field":"Psychology","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Multilevel model; Univariate; State space; Regression analysis; Structural equation modeling; Confirmatory factor analysis; Multivariate statistics; Marginal model; Computer science; Econometrics; Regression; Statistics; Mathematics; Machine learning","score_opus":0.5219984882668063,"score_gpt":0.5198731016349213,"score_spread":0.0021253866318849957,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2095572468","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0012842533,0.00005451181,0.9971609,0.00014310802,0.000016353792,0.000055996814,0.00014373897,0.00025669785,0.0008845259],"genre_scores_gemma":[0.07397953,0.00029479107,0.9219975,0.000116571064,0.00008108904,0.00084362656,0.0008610999,0.0001701661,0.0016555823],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9926777,0.005355576,0.0003156778,0.00055457547,0.0009314636,0.00016503062],"domain_scores_gemma":[0.98919487,0.007431941,0.00073996483,0.0011566153,0.0013468175,0.00012982225],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0065672975,0.0012092389,0.0013453376,0.0024767336,0.001110312,0.0024717352,0.0020206461,0.00131579,0.012093934],"category_scores_gemma":[0.034570266,0.0010807064,0.002418246,0.003889068,0.00098558,0.003056221,0.002836043,0.0033515191,0.0022551161],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008637764,0.0001747264,0.006019352,0.00037088484,0.0004371513,0.00014872785,0.00070698094,0.20583044,0.00092413387,0.54138464,0.008287727,0.23562884],"study_design_scores_gemma":[0.00003460111,0.000086514534,0.0017708691,0.00010022194,0.00009077391,0.00007330954,0.0001730927,0.7042007,0.00055181165,0.28465018,0.008192466,0.00007554529],"about_ca_topic_score_codex":0.010806912,"about_ca_topic_score_gemma":0.0140391,"teacher_disagreement_score":0.012093934,"about_ca_system_score_codex":0.001239133,"about_ca_system_score_gemma":0.0038756137,"threshold_uncertainty_score":0.040458202},"labels":[],"label_agreement":null},{"id":"W2139491581","doi":"10.1080/00273171.2012.640600","title":"Using Ensemble-Based Methods for Directly Estimating Causal Effects: An Investigation of Tree-Based G-Computation","year":2012,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":52,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Institute for Clinical Evaluative Sciences; University of Toronto","funders":"Canadian Institutes of Health Research; Ontario Ministry of Health and Long-Term Care; U.S. Public Health Service; Heart and Stroke Foundation of Canada","keywords":"Propensity score matching; Inverse probability weighting; Statistics; Observational study; Logistic regression; Random forest; Regression; Confounding; Causal inference; Regression analysis; Inverse probability; Econometrics; Mathematics; Computer science; Machine learning; Bayesian probability","score_opus":0.6865806864982038,"score_gpt":0.6435797549976086,"score_spread":0.04300093150059525,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2139491581","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008914194,0.00035540515,0.98969007,0.00025112845,0.000027845952,0.00005187298,0.000033334207,0.0001204128,0.0005557312],"genre_scores_gemma":[0.21743083,0.0009437215,0.77986497,0.0002964344,0.0001020871,0.00035555457,0.0001631033,0.000108369575,0.0007349227],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99407154,0.004630181,0.00017833199,0.0003970255,0.0005873246,0.0001356479],"domain_scores_gemma":[0.9191429,0.073088154,0.0016414667,0.0039226706,0.0018694598,0.00033529746],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.018551677,0.0011601284,0.0023465,0.0023853022,0.0007753023,0.0013472884,0.0021945336,0.0014070624,0.001914767],"category_scores_gemma":[0.0788781,0.00070240133,0.0016133446,0.0023605477,0.0014298728,0.0026353549,0.0020448451,0.002491904,0.0002460634],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00010664286,0.00007160735,0.0052033886,0.00017532872,0.00034003338,0.00008916082,0.00030085092,0.73993313,0.00037133522,0.13438922,0.0011597237,0.11785954],"study_design_scores_gemma":[0.000018539049,0.000028165985,0.000306534,0.000032865028,0.00002470651,0.000025902822,0.000018024924,0.9335522,0.00010890238,0.065264836,0.00060983025,0.000009528543],"about_ca_topic_score_codex":0.008694078,"about_ca_topic_score_gemma":0.007373078,"teacher_disagreement_score":0.018551677,"about_ca_system_score_codex":0.0012633301,"about_ca_system_score_gemma":0.0020332208,"threshold_uncertainty_score":0.09811181},"labels":[],"label_agreement":null},{"id":"W2141002481","doi":"10.1080/00273170903333590","title":"On the Model-Based Bootstrap With Missing Data: Obtaining a <i>P</i>-Value for a Test of Exact Fit","year":2009,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":15,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"National Science Foundation","keywords":"Goodness of fit; Structural equation modeling; Bootstrapping (finance); Missing data; Covariance; Invertible matrix; Mathematics; Statistics; Applied mathematics; Test statistic; Computer science; Resampling; Covariance matrix; Algorithm; Statistical hypothesis testing; Econometrics; Pure mathematics","score_opus":0.9222058384378413,"score_gpt":0.6512099630886693,"score_spread":0.270995875349172,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2141002481","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0032266562,0.0016222503,0.9876324,0.002201212,0.00048923737,0.0004287888,0.00023787424,0.0005119634,0.003649613],"genre_scores_gemma":[0.108617194,0.002029825,0.8799091,0.002473621,0.0009202355,0.0037798856,0.0005825582,0.00081394846,0.000873577],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7935544,0.1700388,0.0053208065,0.0101829395,0.01945424,0.0014488681],"domain_scores_gemma":[0.45559573,0.4801977,0.00981252,0.039068904,0.013743015,0.0015821025],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.14800666,0.0028170324,0.0067790234,0.009558781,0.0033873727,0.0069167414,0.0072657075,0.008177357,0.008671213],"category_scores_gemma":[0.59143704,0.0021919757,0.0061208024,0.014323102,0.017786296,0.012429742,0.0095134955,0.01473377,0.0031741625],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00085855863,0.00030778392,0.0080281515,0.0023556028,0.0020648201,0.0014322998,0.0029972442,0.04405254,0.0013649919,0.53616446,0.032339685,0.36803392],"study_design_scores_gemma":[0.00026893904,0.00039140583,0.0027150367,0.00158541,0.00029796187,0.00075500517,0.0006969762,0.122821435,0.0017291687,0.8496038,0.018879857,0.00025495293],"about_ca_topic_score_codex":0.002441025,"about_ca_topic_score_gemma":0.0012916304,"teacher_disagreement_score":0.14800666,"about_ca_system_score_codex":0.0025540288,"about_ca_system_score_gemma":0.005305037,"threshold_uncertainty_score":0.7827434},"labels":[],"label_agreement":null},{"id":"W2142996385","doi":"10.1080/00273171.2010.546731","title":"The Longitudinal Interplay of Adolescents' Self-Esteem and Body Image: A Conditional Autoregressive Latent Trajectory Analysis","year":2011,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Eating Disorders and Behaviors","field":"Psychology","cited_by":104,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal; Université de Sherbrooke","funders":"","keywords":"Self-esteem; Psychology; Developmental psychology; Longitudinal study; Autoregressive model; Longitudinal data; Demography; Statistics; Mathematics","score_opus":0.13023069333193568,"score_gpt":0.4511350920320027,"score_spread":0.32090439870006704,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2142996385","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9952819,0.00005537717,0.004147802,0.000058696703,0.0000038200337,0.000015196241,0.00027982687,0.0000156788,0.00014168188],"genre_scores_gemma":[0.9969126,0.00006627114,0.0019175241,0.000005343148,0.0000021036392,0.000033226246,0.0007130665,0.0000067340534,0.00034314976],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9994388,0.0003102461,0.00003368465,0.00009479087,0.000053485586,0.00006889871],"domain_scores_gemma":[0.9984707,0.0006915583,0.000271823,0.000272717,0.00016519114,0.0001278767],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.003088469,0.00025809894,0.00027961773,0.00067995535,0.00041984997,0.00082162576,0.00047577993,0.00029415198,0.001488583],"category_scores_gemma":[0.0044987877,0.00024871386,0.00080839667,0.0008711814,0.00027794615,0.000477412,0.00066063256,0.0009377889,0.00023785447],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015905917,0.00015024448,0.98630905,0.000011320349,0.00012009521,0.000070087604,0.0004507457,0.0022839839,0.0004972743,0.00071726454,0.00016845594,0.009062268],"study_design_scores_gemma":[0.000013944076,0.0003217526,0.93013513,0.000032778255,0.00015750255,0.00016031123,0.0008125356,0.06636789,0.00048125055,0.0008580249,0.0006367063,0.000022288754],"about_ca_topic_score_codex":0.022151845,"about_ca_topic_score_gemma":0.017492674,"teacher_disagreement_score":0.022151845,"about_ca_system_score_codex":0.000424637,"about_ca_system_score_gemma":0.0008206255,"threshold_uncertainty_score":0.044045866},"labels":[],"label_agreement":null},{"id":"W2210755457","doi":"10.1080/00273171.2015.1033510","title":"Reciprocal Markov Modeling of Feedback Mechanisms Between Emotion and Dietary Choice Using Experience-Sampling Data","year":2015,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University; Dalhousie University","funders":"National Heart, Lung, and Blood Institute","keywords":"Mood; Experience sampling method; Reciprocal; Set (abstract data type); Psychology; Markov chain; Independence (probability theory); Sampling (signal processing); Generalization; Markov model; Computer science; Empirical research; Cognitive psychology; Consumption (sociology); Econometrics; Statistics; Social psychology; Machine learning; Mathematics","score_opus":0.8893287258930511,"score_gpt":0.6465473378346601,"score_spread":0.242781388058391,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2210755457","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.38759467,0.00075191475,0.60652477,0.0008038101,0.00009379732,0.00029351638,0.0013369744,0.00025022973,0.002350284],"genre_scores_gemma":[0.9552586,0.0003930261,0.039977323,0.0001133796,0.000050588933,0.0004939991,0.0010634621,0.00002460204,0.0026250987],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.997523,0.0015320284,0.00009625138,0.000535955,0.00015233837,0.00016043865],"domain_scores_gemma":[0.98620737,0.011476472,0.0008678661,0.00089312356,0.0003607671,0.00019429973],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0072596255,0.00071422406,0.0010743625,0.0009944888,0.00046982666,0.0013883302,0.0019847495,0.0012689203,0.0036326179],"category_scores_gemma":[0.02062995,0.0008215323,0.0021726163,0.0009355111,0.0012223212,0.0017045991,0.0014818375,0.0019907174,0.0004096809],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0010279793,0.00061098114,0.082010604,0.0004545669,0.00091972144,0.0007094325,0.0025884416,0.64237016,0.0022252556,0.20653133,0.0019656045,0.058585875],"study_design_scores_gemma":[0.000040805964,0.0000855185,0.0045555113,0.000023133074,0.00006527799,0.000052433687,0.00008176762,0.9630192,0.0001508762,0.031410605,0.00048642026,0.000028418395],"about_ca_topic_score_codex":0.012122818,"about_ca_topic_score_gemma":0.010327913,"teacher_disagreement_score":0.012122818,"about_ca_system_score_codex":0.001063136,"about_ca_system_score_gemma":0.0007939931,"threshold_uncertainty_score":0.03839302},"labels":[],"label_agreement":null},{"id":"W2501992360","doi":"10.1080/00273171.2016.1200454","title":"Using Marginal Structural Modeling for Grade Retention Effects","year":2016,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Simon Fraser University; Fordham University","keywords":"Equating; Covariate; Confounding; Propensity score matching; Statistics; Analysis of covariance; Marginal structural model; Econometrics; Missing data; Psychology; Computer science; Mathematics","score_opus":0.8116577974541808,"score_gpt":0.63032002163345,"score_spread":0.18133777582073074,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2501992360","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0093439445,0.0032918144,0.97364897,0.008879617,0.00062130933,0.00022482437,0.00092417665,0.0003305089,0.0027348993],"genre_scores_gemma":[0.40080276,0.006309407,0.5764747,0.0045611556,0.0013956609,0.0023726255,0.0013526422,0.00046905532,0.006262006],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9595366,0.035115678,0.0010126209,0.0024432538,0.0014231408,0.00046853037],"domain_scores_gemma":[0.87568474,0.11218732,0.0038589162,0.0054355543,0.0024713415,0.00036214985],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.044582687,0.0018326604,0.0018775798,0.002345974,0.00091864384,0.0032747036,0.0041983626,0.0029818933,0.008213577],"category_scores_gemma":[0.14296502,0.0010332661,0.005579539,0.0038059456,0.0022918994,0.004162305,0.0030340294,0.0057876585,0.0007217247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019022608,0.000098614604,0.016623907,0.0010100148,0.0036361765,0.00024577227,0.0028198028,0.04305338,0.00020623537,0.8113613,0.013441197,0.107313305],"study_design_scores_gemma":[0.00011798663,0.00015610088,0.0038082232,0.00060982176,0.0013299119,0.00011392421,0.0004719002,0.15922135,0.00040321331,0.8057617,0.027934574,0.00007126401],"about_ca_topic_score_codex":0.022313278,"about_ca_topic_score_gemma":0.026128737,"teacher_disagreement_score":0.044582687,"about_ca_system_score_codex":0.0037146448,"about_ca_system_score_gemma":0.003935194,"threshold_uncertainty_score":0.23577857},"labels":[],"label_agreement":null},{"id":"W2534977215","doi":"10.1080/00273171.2016.1225563","title":"On the Relationship Between Confidence Sets and Exchangeable Weights in Multiple Linear Regression","year":2016,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Statistics; Linear regression; Regression analysis; Mathematics; Regression; Interpretation (philosophy); Regression diagnostic; Set (abstract data type); Econometrics; Confidence interval; Computer science; Polynomial regression","score_opus":0.7532554752770059,"score_gpt":0.5941128584516712,"score_spread":0.1591426168253347,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2534977215","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.021347092,0.002111707,0.9702124,0.0023586242,0.00010426622,0.000108099855,0.00018363117,0.00013959523,0.003434471],"genre_scores_gemma":[0.54110014,0.0039434195,0.44875097,0.0013609113,0.00081956247,0.0012743946,0.00053942576,0.00036049314,0.0018506256],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.88039464,0.09336467,0.0059560644,0.008337185,0.0104566775,0.001490687],"domain_scores_gemma":[0.17703383,0.7791621,0.018433623,0.016353147,0.0079393275,0.0010780111],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.15824847,0.0022810488,0.0033600882,0.006803039,0.002214247,0.008975952,0.0053498135,0.0045579327,0.0051001427],"category_scores_gemma":[0.61677504,0.0018978403,0.0039471556,0.009401334,0.014559594,0.018605065,0.008085733,0.010765168,0.0006281069],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016299465,0.00007793281,0.0109640695,0.00037301236,0.00048500302,0.00025661173,0.0013578659,0.056412265,0.00026238363,0.8653239,0.001039747,0.06328423],"study_design_scores_gemma":[0.000032160253,0.00007990488,0.0027481152,0.0003897991,0.00009798286,0.000105647996,0.00017419856,0.11866427,0.00027439356,0.8761127,0.0012359032,0.00008491849],"about_ca_topic_score_codex":0.003923349,"about_ca_topic_score_gemma":0.0024197418,"teacher_disagreement_score":0.15824847,"about_ca_system_score_codex":0.0034948143,"about_ca_system_score_gemma":0.0026510893,"threshold_uncertainty_score":0.83690786},"labels":[],"label_agreement":null},{"id":"W2557900203","doi":"10.1080/00273171.2016.1253452","title":"Estimating Between-Person and Within-Person Subscore Reliability with Profile Analysis","year":2016,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Reliability (semiconductor); Strengths and weaknesses; Psychology; Statistics; Reliability engineering; Computer science; Mathematics; Social psychology; Engineering","score_opus":0.7913515426590917,"score_gpt":0.5884301756601152,"score_spread":0.20292136699897645,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2557900203","genre_codex":"empirical","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.5174614,0.00024981462,0.4770404,0.000086199354,0.00003268565,0.000605007,0.0003863935,0.00031389642,0.0038240852],"genre_scores_gemma":[0.84355414,0.0001472932,0.15491492,0.000019818963,0.000015771742,0.00052988576,0.00047019095,0.00004928776,0.0002986782],"study_design_codex":"observational","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.970242,0.021532213,0.0016675866,0.0022715717,0.003926322,0.0003602243],"domain_scores_gemma":[0.9018226,0.07056712,0.008058499,0.011501082,0.00759478,0.00045589806],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.038083274,0.0009785836,0.00090561697,0.0036773242,0.00056877185,0.0015239858,0.0006916408,0.00058409123,0.000933164],"category_scores_gemma":[0.123899885,0.00050282944,0.0019072418,0.0032476285,0.0008817171,0.0017361573,0.0021632852,0.0011287621,0.00042536465],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00049229193,0.00030966554,0.64410573,0.00039639627,0.0014787778,0.00014418126,0.004143125,0.028789999,0.0055040834,0.008741351,0.0011973418,0.30469692],"study_design_scores_gemma":[0.000079229314,0.0016257071,0.70426035,0.00029884625,0.0008253554,0.0007256487,0.0024492058,0.24553499,0.008045448,0.03205087,0.0037983079,0.00030600186],"about_ca_topic_score_codex":0.0020642607,"about_ca_topic_score_gemma":0.0031184885,"teacher_disagreement_score":0.038083274,"about_ca_system_score_codex":0.0005215824,"about_ca_system_score_gemma":0.0009895341,"threshold_uncertainty_score":0.201406},"labels":[],"label_agreement":null},{"id":"W2801359717","doi":"10.1080/00273171.2019.1614898","title":"Bridge Centrality: A Network Approach to Understanding Comorbidity","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":1609,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Waterloo","funders":"","keywords":"Comorbidity; Betweenness centrality; Bridge (graph theory); Centrality; Psychopathology; Computer science; Psychology; Statistics; Network analysis; Clinical psychology; Psychiatry; Medicine; Mathematics; Engineering","score_opus":0.753763044448797,"score_gpt":0.5947418133457905,"score_spread":0.1590212311030066,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2801359717","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.09106845,0.0006964066,0.90267134,0.0012054672,0.00006176712,0.00021623414,0.00082556193,0.00036299223,0.0028918125],"genre_scores_gemma":[0.7004158,0.0006725558,0.29580685,0.00017769093,0.00014717292,0.00044591603,0.000992474,0.000114649876,0.001226861],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9978708,0.0012093439,0.00012377978,0.0004509706,0.00023163667,0.0001133773],"domain_scores_gemma":[0.98246723,0.013514541,0.0016883069,0.0009545114,0.0008939311,0.00048144333],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.005092169,0.0008673382,0.0010253623,0.008172636,0.0012305434,0.0020483239,0.0015951906,0.0011470984,0.003409597],"category_scores_gemma":[0.03680929,0.000537521,0.0014795674,0.0040117013,0.0016118643,0.004919188,0.0029264772,0.001783168,0.00023164313],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00033611758,0.00017590194,0.08815989,0.00038883893,0.00064474036,0.00035610446,0.0023192521,0.45365,0.0015472508,0.31006745,0.0053355847,0.13701889],"study_design_scores_gemma":[0.00003842753,0.00005686233,0.0073888586,0.00006996788,0.00008920679,0.0001693561,0.00029032148,0.7342677,0.00031307215,0.25446424,0.0028156147,0.000036335052],"about_ca_topic_score_codex":0.008308216,"about_ca_topic_score_gemma":0.008232854,"teacher_disagreement_score":0.008308216,"about_ca_system_score_codex":0.002002605,"about_ca_system_score_gemma":0.0011583765,"threshold_uncertainty_score":0.026930332},"labels":[],"label_agreement":null},{"id":"W2940558384","doi":"10.1080/00273171.2019.1598837","title":"Bayesian Extended Redundancy Analysis: A Bayesian Approach to Component-based Regression with Dimension Reduction","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Statistical Methods and Models","field":"Mathematics","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Research Foundation of Korea","keywords":"Computer science; Markov chain Monte Carlo; Frequentist inference; Bayesian probability; Gibbs sampling; Missing data; Statistics; Dimensionality reduction; Bayesian statistics; Posterior probability; Data mining; Econometrics; Artificial intelligence; Mathematics; Machine learning; Bayesian inference","score_opus":0.26606752102610737,"score_gpt":0.512825108832424,"score_spread":0.24675758780631668,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2940558384","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0010438837,0.00022523987,0.9981749,0.0000953071,0.00001740757,0.00003679048,0.000045288332,0.00011323699,0.00024789336],"genre_scores_gemma":[0.05821003,0.00082191936,0.9386647,0.00016474309,0.00017744883,0.0005024,0.00032835102,0.00017850066,0.00095187855],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9860848,0.01050243,0.00044426677,0.0011183455,0.0015615277,0.00028867082],"domain_scores_gemma":[0.9868297,0.008951573,0.00095112,0.0015320587,0.0015153191,0.00022030076],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.013692002,0.0022435703,0.0029373681,0.0046186782,0.0010814556,0.002314417,0.0033420683,0.0014022692,0.0025276092],"category_scores_gemma":[0.032141667,0.0013409819,0.0029831268,0.004743892,0.0016131649,0.002436414,0.003584042,0.0025810588,0.00096017815],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00020296962,0.00025534295,0.004504925,0.0007041463,0.0018509936,0.0002740934,0.00077233854,0.27768818,0.0033144783,0.3369905,0.0059537496,0.36748832],"study_design_scores_gemma":[0.0000428789,0.0000999041,0.0014982666,0.000090463254,0.00019183791,0.00011643417,0.000046307596,0.747301,0.0007412445,0.24416696,0.0056047724,0.00009998045],"about_ca_topic_score_codex":0.0046367045,"about_ca_topic_score_gemma":0.004766069,"teacher_disagreement_score":0.013692002,"about_ca_system_score_codex":0.0010388002,"about_ca_system_score_gemma":0.0030305884,"threshold_uncertainty_score":0.07241112},"labels":[],"label_agreement":null},{"id":"W2965155714","doi":"10.1080/00273171.2019.1633617","title":"Evaluating Equivalence Testing Methods for Measurement Invariance","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":57,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Equivalence (formal languages); Goodness of fit; Statistics; Mathematics; Type I and type II errors; Sample size determination; Chi-square test; Measurement invariance; Test (biology); Applied mathematics; Econometrics; Structural equation modeling; Discrete mathematics; Confirmatory factor analysis","score_opus":0.9836237612469282,"score_gpt":0.7740472692881768,"score_spread":0.2095764919587514,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2965155714","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.034432374,0.0013070768,0.94365233,0.0010664114,0.0007413863,0.0036232974,0.0006196107,0.00060286734,0.01395463],"genre_scores_gemma":[0.3967861,0.0008474952,0.5840261,0.000841618,0.00039000827,0.014779673,0.00093678106,0.00037309673,0.001019204],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.67724353,0.25364348,0.014690969,0.018915929,0.033918314,0.0015877511],"domain_scores_gemma":[0.35677975,0.557525,0.02004818,0.035707172,0.02848747,0.0014523967],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.2280217,0.002463226,0.0029186015,0.006405384,0.002252233,0.0046559167,0.0039127045,0.0022440753,0.011368346],"category_scores_gemma":[0.6430418,0.00085590844,0.0058941385,0.0076662335,0.0071093324,0.006966186,0.0062208883,0.0055028303,0.0012848508],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0015669571,0.00083307066,0.07181586,0.0030898636,0.0065725385,0.00032189212,0.0044832337,0.018458515,0.0016524069,0.2650743,0.010884087,0.61524725],"study_design_scores_gemma":[0.0016521665,0.0066688214,0.08814544,0.004165506,0.003018064,0.0008082587,0.004363057,0.22416724,0.0059908363,0.6167332,0.043689802,0.00059763936],"about_ca_topic_score_codex":0.0026541348,"about_ca_topic_score_gemma":0.0016365594,"teacher_disagreement_score":0.7719783,"about_ca_system_score_codex":0.0034163797,"about_ca_system_score_gemma":0.0052560885,"threshold_uncertainty_score":0.9519867},"labels":[],"label_agreement":null},{"id":"W2974193444","doi":"10.1080/00273171.2019.1664280","title":"Model Selection of Nested and Non-Nested Item Response Models Using Vuong Tests","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Nested set model; Item response theory; Context (archaeology); Model selection; Selection (genetic algorithm); Statistical hypothesis testing; Set (abstract data type); Statistical model","score_opus":0.8817116620456461,"score_gpt":0.6364831850108131,"score_spread":0.24522847703483297,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2974193444","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.080540285,0.00024609777,0.9157924,0.00029655825,0.00012524346,0.0009362123,0.00028031098,0.0005688347,0.0012140211],"genre_scores_gemma":[0.5291041,0.00012462847,0.4662588,0.00022889949,0.000052610914,0.0028871987,0.0006812551,0.00016921578,0.0004933121],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7972298,0.18054064,0.0049652415,0.009038329,0.006364276,0.0018616796],"domain_scores_gemma":[0.58981353,0.37715542,0.008602138,0.015987132,0.0068962094,0.0015455721],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.10160839,0.0023163545,0.0045444006,0.005462297,0.0017957729,0.004699137,0.005078042,0.002027394,0.0048346035],"category_scores_gemma":[0.37885737,0.0011418724,0.00595688,0.004533008,0.0034443606,0.0053203246,0.005441344,0.004633323,0.0006160247],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026601094,0.0011943649,0.13282345,0.0016725705,0.0071994555,0.0022091581,0.0067906114,0.2279248,0.001957786,0.27124697,0.005949354,0.3383713],"study_design_scores_gemma":[0.00026422332,0.0015010928,0.011178056,0.0002993096,0.0004016581,0.00042925158,0.0010891556,0.8215594,0.001344219,0.1590145,0.0027266697,0.00019242923],"about_ca_topic_score_codex":0.0042714276,"about_ca_topic_score_gemma":0.0032976216,"teacher_disagreement_score":0.10160839,"about_ca_system_score_codex":0.0020454163,"about_ca_system_score_gemma":0.0043241233,"threshold_uncertainty_score":0.53736293},"labels":[],"label_agreement":null},{"id":"W2974998223","doi":"10.1080/00273171.2019.1660605","title":"New Recommendations on the Use of R-Squared Differences in Multilevel Model Comparisons","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":96,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Set (abstract data type); Mean squared error; Measure (data warehouse); Multilevel model; Computer science; Class (philosophy); Confusion; Data mining; Statistics; Mathematics; Artificial intelligence; Psychology","score_opus":0.8895675119762272,"score_gpt":0.598556855129321,"score_spread":0.2910106568469062,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2974998223","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0018016231,0.035344362,0.6432895,0.2318324,0.039306726,0.0028897712,0.01009374,0.008009012,0.027432837],"genre_scores_gemma":[0.0084382575,0.012250973,0.9158364,0.03771412,0.0053218766,0.0059406776,0.0027029323,0.0043067853,0.007487909],"study_design_codex":"not_applicable","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.7019737,0.22433618,0.032521363,0.00995785,0.029265305,0.001945707],"domain_scores_gemma":[0.21624403,0.58907735,0.022468967,0.049719255,0.11777425,0.0047160597],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.24952894,0.0041712504,0.004346988,0.012078642,0.0027010979,0.008575032,0.013065754,0.0120226955,0.044693694],"category_scores_gemma":[0.7133957,0.005385472,0.009831156,0.01675979,0.008873775,0.02023868,0.007440882,0.028293353,0.026348611],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003580295,0.00032090972,0.0023484675,0.0060049277,0.000436534,0.00020296719,0.0016965589,0.0025253051,0.000525263,0.053368278,0.7031774,0.22903547],"study_design_scores_gemma":[0.0008929859,0.000429068,0.005978473,0.034593876,0.0006505762,0.00062567095,0.001664713,0.010425886,0.0023206845,0.16451612,0.77701974,0.0008821504],"about_ca_topic_score_codex":0.017825056,"about_ca_topic_score_gemma":0.024006803,"teacher_disagreement_score":0.75047106,"about_ca_system_score_codex":0.005653981,"about_ca_system_score_gemma":0.014752582,"threshold_uncertainty_score":0.9254644},"labels":[],"label_agreement":null},{"id":"W2990763132","doi":"10.1080/00273171.2019.1694477","title":"Sparse Extended Redundancy Analysis: Variable Selection via the Exclusive LASSO","year":2019,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Sensory Analysis and Statistical Methods","field":"Agricultural and Biological Sciences","cited_by":18,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Latent variable; Redundancy (engineering); Computer science; Lasso (programming language); Feature selection; Set (abstract data type); Selection (genetic algorithm); Econometrics; Variables; Data mining; Artificial intelligence; Mathematics; Machine learning; Statistics","score_opus":0.19290077209158177,"score_gpt":0.4418091805023224,"score_spread":0.2489084084107406,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2990763132","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0044654324,0.00026822175,0.9941532,0.00027566342,0.000037306523,0.000073120274,0.00012752085,0.0002756408,0.0003239626],"genre_scores_gemma":[0.23788854,0.00075754494,0.7543848,0.00071384246,0.0004594718,0.0013547757,0.0017679199,0.0003475687,0.0023255695],"study_design_codex":"simulation_or_modeling","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9882957,0.009004233,0.0003383242,0.0010229609,0.0009991496,0.000339559],"domain_scores_gemma":[0.9884998,0.008383969,0.0009495956,0.00089822727,0.0010380818,0.00023045593],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.012542599,0.0027723997,0.003004493,0.0017789367,0.0012638922,0.0018856585,0.002942761,0.00176825,0.0021632193],"category_scores_gemma":[0.023096059,0.0007476214,0.0022183498,0.0023800102,0.0014891026,0.0015877767,0.0034460612,0.00329305,0.00081445556],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0006306819,0.00040467418,0.006007516,0.0007775615,0.0011943788,0.00068755716,0.00050465885,0.6205053,0.007740062,0.043879095,0.015329677,0.30233887],"study_design_scores_gemma":[0.000047181016,0.00008338089,0.00049840147,0.000033791828,0.000049669725,0.00006623784,0.00003359085,0.9801323,0.0008687585,0.01667338,0.0014820824,0.0000313229],"about_ca_topic_score_codex":0.0024041736,"about_ca_topic_score_gemma":0.0024797511,"teacher_disagreement_score":0.012542599,"about_ca_system_score_codex":0.0005702891,"about_ca_system_score_gemma":0.0024385718,"threshold_uncertainty_score":0.06633246},"labels":[],"label_agreement":null},{"id":"W3003574023","doi":"10.1080/00273171.2019.1709405","title":"Different Roles of Prior Distributions in the Single Mediator Model with Latent Variables","year":2020,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":17,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"National Institute on Drug Abuse","keywords":"Prior probability; Frequentist inference; Bayesian probability; Latent variable; Conjugate prior; Econometrics; Mathematics; Statistics; Bayesian inference; Bayesian statistics; Computer science","score_opus":0.42997985970240477,"score_gpt":0.49058741574929887,"score_spread":0.06060755604689411,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3003574023","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.28533402,0.004646276,0.6344218,0.020243775,0.00080222555,0.0009760854,0.001630208,0.0010095958,0.050936066],"genre_scores_gemma":[0.9088994,0.0015693434,0.080300376,0.0009613591,0.00019364551,0.00081406755,0.0007521693,0.0004568692,0.0060528456],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.97008455,0.024100808,0.00060699147,0.0026765035,0.0014993313,0.0010318451],"domain_scores_gemma":[0.68064654,0.3016038,0.0034715286,0.009575905,0.0024686975,0.0022335423],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07249422,0.0012770413,0.0017660513,0.0021739574,0.0017952943,0.007268649,0.0038366618,0.004816061,0.017209407],"category_scores_gemma":[0.29302642,0.0011211572,0.0024908646,0.0020345266,0.0048815194,0.012835326,0.0045586578,0.0076053403,0.0017241586],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0023364907,0.0005714203,0.012203257,0.0008608085,0.000597593,0.0006360632,0.003969743,0.04738749,0.000808644,0.83402884,0.00896279,0.08763692],"study_design_scores_gemma":[0.00067174813,0.00018412886,0.009233231,0.0006842861,0.00042716324,0.00031343874,0.001971969,0.15198794,0.000856356,0.8299783,0.0034252817,0.0002661635],"about_ca_topic_score_codex":0.007685305,"about_ca_topic_score_gemma":0.008875373,"teacher_disagreement_score":0.07249422,"about_ca_system_score_codex":0.002448746,"about_ca_system_score_gemma":0.0024671755,"threshold_uncertainty_score":0.38339067},"labels":[],"label_agreement":null},{"id":"W3006236708","doi":"10.1080/00273171.2020.1717922","title":"Improving Fit Indices in Structural Equation Modeling with Categorical Data","year":2020,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":148,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Categorical variable; Structural equation modeling; Estimator; Statistics; Computation; Mathematics; Binary data; Binary number; Econometrics; Algorithm","score_opus":0.9579372916956201,"score_gpt":0.654397403620915,"score_spread":0.3035398880747051,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3006236708","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.055365257,0.0011082754,0.9377327,0.0012703702,0.00018549424,0.00034680244,0.00030022927,0.00043813937,0.003252689],"genre_scores_gemma":[0.30743584,0.0007035364,0.6893826,0.00024355453,0.00008712285,0.0011917568,0.00054697646,0.00014681993,0.00026170776],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9081886,0.0745894,0.0035695208,0.0040119407,0.009120503,0.0005200948],"domain_scores_gemma":[0.7600685,0.20476687,0.0071346266,0.015821256,0.011364334,0.0008444689],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07878893,0.0017373676,0.00178567,0.0056435596,0.0016262556,0.0044415873,0.0023679142,0.00215324,0.0023572394],"category_scores_gemma":[0.32665926,0.0011247633,0.0031069752,0.009475463,0.0024181297,0.006332848,0.0036271769,0.005935724,0.00074935466],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003892511,0.00064899604,0.12871504,0.0016739448,0.002116571,0.00029547836,0.005188219,0.08530961,0.0018975154,0.17511734,0.0064613177,0.59218675],"study_design_scores_gemma":[0.00021535385,0.0013403103,0.04039998,0.001318175,0.00058755785,0.00037195903,0.0022783624,0.5664134,0.0028151302,0.3760105,0.007931188,0.00031798703],"about_ca_topic_score_codex":0.0022304347,"about_ca_topic_score_gemma":0.0035107478,"teacher_disagreement_score":0.07878893,"about_ca_system_score_codex":0.0018408333,"about_ca_system_score_gemma":0.0032393287,"threshold_uncertainty_score":0.41668063},"labels":[],"label_agreement":null},{"id":"W3183932977","doi":"10.1080/00273171.2021.1941729","title":"Copula-Based Redundancy Analysis","year":2021,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Spectroscopy and Chemometric Analyses","field":"Chemistry","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"","keywords":"Copula (linguistics); Computer science; Redundancy (engineering); Regression; Regression analysis; Econometrics; Bivariate analysis; Multivariate statistics; Statistics; Data mining; Machine learning; Mathematics","score_opus":0.2776338551734261,"score_gpt":0.5132476847527523,"score_spread":0.2356138295793262,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3183932977","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008950109,0.00059072435,0.9886058,0.0001386011,0.000045029345,0.00006678028,0.0002654547,0.00035670618,0.0009808613],"genre_scores_gemma":[0.40850845,0.0019156667,0.5824755,0.00029304528,0.00033700562,0.0005316044,0.0021840099,0.00061269803,0.0031420814],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.99373144,0.0035944718,0.00033902153,0.0009009288,0.001124118,0.0003100331],"domain_scores_gemma":[0.98725396,0.006815762,0.0011416925,0.002319038,0.0022730147,0.00019646152],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.008909228,0.0022667397,0.0023763087,0.0046998863,0.000857651,0.0015275235,0.0020417948,0.0007855574,0.0038769522],"category_scores_gemma":[0.029668273,0.00059171795,0.002426031,0.004451001,0.0011166895,0.0023899,0.0021393849,0.0015261765,0.0012295984],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00027181476,0.0002077763,0.009076769,0.0009361681,0.0014652499,0.00048570303,0.00039575412,0.37528586,0.009522201,0.20276359,0.010013166,0.38957602],"study_design_scores_gemma":[0.000020059771,0.00012322931,0.0036786704,0.00005021847,0.00013042674,0.00017113966,0.000046631252,0.92540586,0.0020728312,0.06347805,0.0047466047,0.00007619362],"about_ca_topic_score_codex":0.0032367632,"about_ca_topic_score_gemma":0.0020090654,"teacher_disagreement_score":0.008909228,"about_ca_system_score_codex":0.0008623954,"about_ca_system_score_gemma":0.0017584849,"threshold_uncertainty_score":0.047117054},"labels":[],"label_agreement":null},{"id":"W4306691105","doi":"10.1080/00273171.2022.2115965","title":"A Gentle Introduction to Bayesian Network Meta-Analysis Using an Automated R Package","year":2022,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Meta-analysis and systematic reviews","field":"Decision Sciences","cited_by":45,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; University of Waterloo; Carleton University","funders":"","keywords":"Computer science; Bayesian probability; Bayesian network; Consistency (knowledge bases); Meta-analysis; Ranking (information retrieval); Rank (graph theory); Data mining; Machine learning; Artificial intelligence; Mathematics; Medicine","score_opus":0.923574189906166,"score_gpt":0.6593108779782532,"score_spread":0.26426331192791286,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4306691105","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00022788074,0.0011762406,0.9751672,0.0016085048,0.0005655237,0.000555026,0.004980607,0.014068316,0.0016506793],"genre_scores_gemma":[0.0037149366,0.0012422764,0.9829153,0.0009541178,0.0003376656,0.0038019423,0.0016707835,0.0039440533,0.0014190064],"study_design_codex":"design_other","study_design_gemma":"not_applicable","domain_scores_codex":[0.979087,0.0151315145,0.0018763253,0.0012085296,0.0024912972,0.000205341],"domain_scores_gemma":[0.88179535,0.10146621,0.0034119496,0.008602492,0.0042459825,0.00047806566],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.03276121,0.003965284,0.002717985,0.0067771454,0.00097581523,0.004014289,0.0043322425,0.0025301243,0.06004605],"category_scores_gemma":[0.16750298,0.0029874525,0.007344481,0.0062163323,0.0013995357,0.0037766637,0.0045121717,0.0074310484,0.026711801],"study_design_candidate":"not_applicable","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0003854009,0.00015390613,0.002167792,0.009939828,0.0035950167,0.00096812,0.0005669301,0.03349377,0.0022317134,0.14759868,0.39929795,0.39960083],"study_design_scores_gemma":[0.00065867446,0.0001555576,0.0018381617,0.002338792,0.0009228167,0.0012653401,0.000089183304,0.094985776,0.0032039362,0.41198152,0.4821589,0.0004013253],"about_ca_topic_score_codex":0.003813179,"about_ca_topic_score_gemma":0.006306617,"teacher_disagreement_score":0.06004605,"about_ca_system_score_codex":0.0015485974,"about_ca_system_score_gemma":0.005489087,"threshold_uncertainty_score":0.20087403},"labels":[{"model":"gemma","categories":[],"domain":null,"study_design":"not_applicable","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"low"},{"model":"gpt","categories":[],"domain":null,"study_design":"design_other","genre":"methods","about_ca_system":false,"about_ca_topic":false,"confidence":"high"}],"label_agreement":"split"},{"id":"W4364353609","doi":"10.1080/00273171.2023.2193600","title":"Pay Attention to the Ignorable Missing Data Mechanisms! An Exploration of Their Impact on the Efficiency of Regression Coefficients","year":2023,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia; McGill University","funders":"","keywords":"Missing data; Computer science; Regression; Regression analysis; Statistics; Econometrics; Data mining; Mathematics; Machine learning","score_opus":0.6757811365891347,"score_gpt":0.5899222742098614,"score_spread":0.08585886237927332,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4364353609","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.027318398,0.0041303593,0.9478847,0.016204951,0.00027358741,0.000112908325,0.0001574679,0.0002451973,0.003672348],"genre_scores_gemma":[0.5271415,0.0068187187,0.45628223,0.0037655355,0.0010011065,0.00060396007,0.0002764382,0.00049069565,0.003619842],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.92200065,0.06621127,0.001707629,0.0036207398,0.005515275,0.0009445869],"domain_scores_gemma":[0.45993876,0.48327422,0.017279247,0.031251784,0.0073088007,0.0009471153],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.12866175,0.0016464038,0.002658153,0.0027120123,0.0018010784,0.004129342,0.0037761685,0.0033480027,0.0042282175],"category_scores_gemma":[0.45177087,0.0016309019,0.0033757796,0.0042725205,0.0068190643,0.011276601,0.0047246725,0.008549559,0.0007390319],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053126714,0.00018903823,0.022297127,0.0011455098,0.00137375,0.0006432316,0.0018424069,0.11054035,0.001861475,0.63531595,0.0058171125,0.21844277],"study_design_scores_gemma":[0.00014148967,0.00043339955,0.007154409,0.00088396267,0.00033736168,0.0005296553,0.0005269572,0.23343109,0.0024135031,0.7452386,0.008765339,0.00014417054],"about_ca_topic_score_codex":0.0045910296,"about_ca_topic_score_gemma":0.0027956525,"teacher_disagreement_score":0.87133825,"about_ca_system_score_codex":0.0024060775,"about_ca_system_score_gemma":0.0039548757,"threshold_uncertainty_score":0.6804365},"labels":[],"label_agreement":null},{"id":"W4391785744","doi":"10.1080/00273171.2024.2307034","title":"Correcting for Sampling Error in between-Cluster Effects: An Empirical Bayes Cluster-Mean Approach with Finite Population Corrections","year":2024,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Bayes' theorem; Statistics; Cluster (spacecraft); Population; Cluster sampling; Mathematics; Econometrics; Confidence interval; Monte Carlo method; Sample size determination; Computer science; Bayesian probability; Demography","score_opus":0.5093859889745762,"score_gpt":0.5862934565112842,"score_spread":0.07690746753670796,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4391785744","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.002224983,0.00016844353,0.99612087,0.00019977255,0.00007370432,0.00019278818,0.000046454068,0.00040498085,0.00056803547],"genre_scores_gemma":[0.07377206,0.0002031875,0.9223892,0.00037879017,0.00012811564,0.0012590028,0.00018601965,0.00031845295,0.0013651313],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9472215,0.03867868,0.0017146704,0.006612885,0.0050884914,0.0006837078],"domain_scores_gemma":[0.762152,0.19556296,0.006886677,0.021446789,0.013190203,0.0007612544],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.08901306,0.0017587092,0.0039973916,0.0036799368,0.0025652763,0.0031292527,0.0070538656,0.0035071932,0.006574625],"category_scores_gemma":[0.32018316,0.0016258407,0.0030320424,0.0036048838,0.0041441713,0.004315745,0.00427345,0.0064109336,0.0012984074],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0004462571,0.00027654748,0.019038353,0.00077946833,0.0016015144,0.00075204804,0.0029872668,0.25657004,0.000994063,0.37641323,0.0110504655,0.3290908],"study_design_scores_gemma":[0.00014466599,0.00013236348,0.003189388,0.00045186246,0.0003397873,0.00027129325,0.0002847864,0.7200138,0.0016600327,0.26202056,0.01137022,0.00012123107],"about_ca_topic_score_codex":0.018636407,"about_ca_topic_score_gemma":0.015998844,"teacher_disagreement_score":0.08901306,"about_ca_system_score_codex":0.0030466602,"about_ca_system_score_gemma":0.0058873114,"threshold_uncertainty_score":0.4707517},"labels":[],"label_agreement":null},{"id":"W4401671234","doi":"10.1080/00273171.2024.2386686","title":"Equivalence Testing Based Fit Index: Standardized Root Mean Squared Residual","year":2024,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":4,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"York University","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Equivalence (formal languages); Residual; Statistics; Structural equation modeling; Confidence interval; Mathematics; Monte Carlo method; Goodness of fit; Mean squared error; Algorithm; Computer science; Applied mathematics; Discrete mathematics","score_opus":0.8912486649793605,"score_gpt":0.6513070133320435,"score_spread":0.23994165164731696,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401671234","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.22214572,0.0011958535,0.74115026,0.0011791664,0.0004277766,0.0011957701,0.0026872214,0.0018288627,0.028189383],"genre_scores_gemma":[0.84398156,0.00040332315,0.14899054,0.00025491233,0.0001012542,0.001696644,0.0026895034,0.0004185309,0.0014636618],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9719792,0.01488886,0.0021316775,0.0031835807,0.007190331,0.00062632817],"domain_scores_gemma":[0.9321517,0.04380418,0.00617156,0.006781172,0.0103416145,0.0007498499],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.027516738,0.0014733024,0.0019368541,0.006557381,0.0010416136,0.0026623406,0.0022049597,0.0016013326,0.009760722],"category_scores_gemma":[0.15751752,0.00035781713,0.003371504,0.007481048,0.002202734,0.0041917674,0.0024680463,0.0027618299,0.0017824874],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00086475187,0.0011191866,0.21150856,0.0013194513,0.0025538916,0.00059548835,0.0029924694,0.039418336,0.0046063215,0.10106606,0.014698537,0.619257],"study_design_scores_gemma":[0.0004962381,0.0044028307,0.2739742,0.0011092618,0.001723229,0.0017000653,0.0043565487,0.41041604,0.012256088,0.2621793,0.026692146,0.00069413945],"about_ca_topic_score_codex":0.001958542,"about_ca_topic_score_gemma":0.001709461,"teacher_disagreement_score":0.027516738,"about_ca_system_score_codex":0.0010772753,"about_ca_system_score_gemma":0.0026672042,"threshold_uncertainty_score":0.14552414},"labels":[],"label_agreement":null},{"id":"W4406711879","doi":"10.1080/00273171.2024.2444943","title":"Estimated Factor Scores Are Not True Factor Scores","year":2025,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Factor regression model; Statistics; Unobservable; Factor analysis; Linear regression; Latent variable; Regression; Regression analysis; Mathematics; Factor (programming language); Reliability (semiconductor); Latent variable model; Econometrics; Variables; Proper linear model; Bayesian multivariate linear regression; Computer science","score_opus":0.8974028395791328,"score_gpt":0.6651354386211888,"score_spread":0.23226740095794396,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4406711879","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.012602511,0.001071647,0.9723002,0.00095608813,0.00046930648,0.00014126551,0.0013893852,0.0013412001,0.009728435],"genre_scores_gemma":[0.15682143,0.003382457,0.8272363,0.00060800876,0.0003218092,0.00081726135,0.0028351839,0.0013424762,0.0066351453],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98808426,0.005911511,0.00089685735,0.0014441501,0.0034027626,0.00026039698],"domain_scores_gemma":[0.9448164,0.03926973,0.003044393,0.00656344,0.0060691475,0.00023696815],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.017334394,0.0020482957,0.0010543274,0.0032052305,0.0004596412,0.0047030346,0.0016541248,0.0012986214,0.01468224],"category_scores_gemma":[0.15432346,0.0011606247,0.0011166997,0.004325142,0.002116671,0.00800137,0.0014289144,0.0029296638,0.006601513],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015814583,0.00011942655,0.01765339,0.0011603683,0.00060240005,0.00014552067,0.0013900452,0.025327176,0.0037286645,0.3368105,0.029228196,0.58367616],"study_design_scores_gemma":[0.00009692987,0.0003054247,0.022587689,0.0010201063,0.00027081743,0.0007658915,0.0010495797,0.10245423,0.009763328,0.72626287,0.13505282,0.00037026347],"about_ca_topic_score_codex":0.0015471978,"about_ca_topic_score_gemma":0.0015778203,"teacher_disagreement_score":0.9826656,"about_ca_system_score_codex":0.0009419915,"about_ca_system_score_gemma":0.0014928657,"threshold_uncertainty_score":0.09167409},"labels":[],"label_agreement":null},{"id":"W4409089898","doi":"10.1080/00273171.2025.2443366","title":"Mapping the Garden of Forking Paths in Multilevel Models","year":2025,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"demographic modeling and climate adaptation","field":"Decision Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Computer science; Multilevel model; Machine learning","score_opus":0.7429636567015804,"score_gpt":0.5697481756700487,"score_spread":0.17321548103153173,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4409089898","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.1522797,0.001968519,0.836259,0.0033370154,0.00010938485,0.00011585285,0.0007161621,0.0005388585,0.0046754046],"genre_scores_gemma":[0.7986449,0.0016445576,0.19407588,0.00037782357,0.000099497745,0.00033234016,0.0008169641,0.0004103102,0.0035976975],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.99176496,0.006009658,0.0001976261,0.0014751337,0.00021929732,0.0003332726],"domain_scores_gemma":[0.91384846,0.07561175,0.0035640427,0.004882743,0.00096855464,0.0011243791],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.020338764,0.0012550754,0.0022047858,0.003514448,0.0031213777,0.004193063,0.00330257,0.0033503314,0.01111408],"category_scores_gemma":[0.09888245,0.0019835238,0.0035725757,0.0030568722,0.004942268,0.009154368,0.0055777165,0.0053381645,0.0009580239],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00031564623,0.00009279819,0.043117568,0.00041857967,0.0008774656,0.00037608042,0.002725994,0.46575618,0.00041365574,0.4236225,0.0039347485,0.05834885],"study_design_scores_gemma":[0.00004567039,0.0000494958,0.0026071216,0.00015683447,0.00009982744,0.000058209673,0.00033600457,0.4574919,0.00010145259,0.53653,0.00247832,0.00004509064],"about_ca_topic_score_codex":0.021577101,"about_ca_topic_score_gemma":0.025042506,"teacher_disagreement_score":0.9796612,"about_ca_system_score_codex":0.0020879325,"about_ca_system_score_gemma":0.0026299912,"threshold_uncertainty_score":0.1075629},"labels":[],"label_agreement":null},{"id":"W4411126428","doi":"10.1080/00273171.2025.2512343","title":"Rnest: An R Package for the Next Eigenvalue Sufficiency Test for Factor Analysis","year":2025,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Psychometric Methodologies and Testing","field":"Decision Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université TÉLUQ","funders":"","keywords":"R package; Test (biology); Eigenvalues and eigenvectors; Factor (programming language); Statistics; Computer science; Econometrics; Mathematics; Reliability engineering; Programming language; Engineering; Biology","score_opus":0.8971086617303922,"score_gpt":0.674459204693312,"score_spread":0.22264945703708017,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4411126428","genre_codex":"methods","genre_gemma":"software","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"software","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.004899132,0.0008792678,0.8673124,0.000997013,0.00044363734,0.0009811377,0.035900753,0.08235719,0.006229483],"genre_scores_gemma":[0.034822553,0.00086738024,0.8787401,0.0006133359,0.000205068,0.0073210103,0.026748458,0.045417096,0.0052650855],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.9889102,0.00646932,0.0009922121,0.0013012055,0.0020381405,0.00028889533],"domain_scores_gemma":[0.90633595,0.07579368,0.005593161,0.0059089246,0.0057459455,0.0006222484],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014109076,0.003951706,0.0023036792,0.0038112372,0.0008209453,0.00303708,0.0028797993,0.0011765895,0.06440314],"category_scores_gemma":[0.14801387,0.001705492,0.0037852004,0.0038595137,0.0011285159,0.002844757,0.0038339966,0.003850327,0.035750873],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00074622524,0.00023569944,0.016762543,0.005077008,0.0026789098,0.0005450867,0.0012610848,0.015050988,0.0022820712,0.026964804,0.59389883,0.33449686],"study_design_scores_gemma":[0.00080056424,0.000689546,0.031439688,0.002429505,0.0013980502,0.0014345314,0.0006614047,0.13116771,0.008186446,0.16104518,0.6601725,0.0005749207],"about_ca_topic_score_codex":0.0034601763,"about_ca_topic_score_gemma":0.005347776,"teacher_disagreement_score":0.06440314,"about_ca_system_score_codex":0.0008253362,"about_ca_system_score_gemma":0.0046289163,"threshold_uncertainty_score":0.21544999},"labels":[],"label_agreement":null},{"id":"W4414296644","doi":"10.1080/00273171.2025.2551373","title":"Regularized Cross-Sectional Network Modeling with Missing Data: A Comparison of Methods","year":2025,"lang":"en","type":"article","venue":"Multivariate Behavioral Research","topic":"Mental Health Research Topics","field":"Psychology","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of the Fraser Valley; McGill University","funders":"","keywords":"Missing data; Covariance; Graphical model; Covariance matrix; Estimation of covariance matrices; Lasso (programming language); Gaussian; Data modeling; Sample (material)","score_opus":0.7826204345838472,"score_gpt":0.7286777603513154,"score_spread":0.05394267423253185,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414296644","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.018898353,0.0024910413,0.9752339,0.00084928627,0.00013295205,0.00058426923,0.00032937265,0.00040479988,0.0010760621],"genre_scores_gemma":[0.23518279,0.0034427745,0.7543195,0.000537864,0.00020565705,0.0031168319,0.0012822193,0.0004397303,0.0014727316],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9338996,0.05946385,0.0015417624,0.0027091694,0.0019441344,0.0004415025],"domain_scores_gemma":[0.7810923,0.19424368,0.0054057995,0.012395194,0.005827875,0.0010351625],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.09408184,0.0015320627,0.002483695,0.0022894824,0.00090613135,0.0022027378,0.0049675573,0.0021848546,0.0038466163],"category_scores_gemma":[0.1656307,0.0012535087,0.0037966499,0.0022602289,0.0013918047,0.0048223725,0.0036985627,0.0036871417,0.0007293236],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0038470698,0.0008184407,0.02671066,0.0022518928,0.005881171,0.00022092999,0.0021045802,0.4623591,0.0005795367,0.13446073,0.007147995,0.35361785],"study_design_scores_gemma":[0.00038452505,0.00041760708,0.004150885,0.0005517457,0.0004423679,0.00015054687,0.00030903486,0.91265947,0.00046011445,0.075070605,0.0052791536,0.00012401574],"about_ca_topic_score_codex":0.0059607043,"about_ca_topic_score_gemma":0.0045259413,"teacher_disagreement_score":0.9059182,"about_ca_system_score_codex":0.001723347,"about_ca_system_score_gemma":0.0031573693,"threshold_uncertainty_score":0.4975583},"labels":[],"label_agreement":null}]}