{"meta":{"query_hash":"ba0f37fc5bf0","filters":{"venue":"Sociological Methods & Research"},"cohort_total":33,"direct_labels_cover":0,"predictions_cover":33,"exported":33,"export_cap":100000,"truncated":false,"label_status":"direct model label, unvalidated","prediction_status":"machine_predicted_unvalidated (Codex and Gemma teacher distillation)","score_status":"score_only:v0-immature-baseline","snapshot":{"source":"OpenAlex, pinned release, all 482 partitions","release":"2026-06-24","frame_built":"2026-07-12"},"permalink":"https://metacan.xera.ac/q/ba0f37fc5bf0","api":"https://metacan.xera.ac/api/v1/cohort?venue=Sociological+Methods+%26+Research"},"results":[{"id":"W1963762678","doi":"10.1177/0049124106292362","title":"Addressing Data Sparseness in Contextual Population Research","year":2007,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Urban, Neighborhood, and Segregation Studies","field":"Social Sciences","cited_by":172,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Variance (accounting); Cluster analysis; Cluster (spacecraft); Monte Carlo method; Statistics; Population; Econometrics; Data mining; Machine learning; Mathematics","score_opus":0.9296372523519871,"score_gpt":0.7377377898052143,"score_spread":0.19189946254677281,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W1963762678","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.06528195,0.0034757268,0.9174967,0.008413354,0.00029775093,0.00070326,0.0002592761,0.00016762584,0.003904391],"genre_scores_gemma":[0.68282497,0.0018727789,0.3099285,0.0028012895,0.00030405432,0.0016159705,0.00020211548,0.00008158763,0.0003687444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7259731,0.24901192,0.0056931893,0.006976666,0.011557804,0.00078723213],"domain_scores_gemma":[0.3056238,0.6421299,0.01706518,0.024467494,0.009769466,0.0009440961],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.18119948,0.0006394638,0.0024630774,0.0035826508,0.0032175959,0.0040600626,0.0029584484,0.0038890587,0.0017677611],"category_scores_gemma":[0.5553102,0.0011590646,0.0011607076,0.0065756747,0.0072514443,0.0063467175,0.005316296,0.0042553786,0.00020262749],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00053230196,0.0003859667,0.137188,0.00427311,0.0024290439,0.0010736968,0.016898472,0.0937411,0.0010831784,0.51211596,0.0067845304,0.22349474],"study_design_scores_gemma":[0.0001495159,0.0006216357,0.022428729,0.0024501998,0.00051645987,0.00079274015,0.0040950305,0.15497208,0.0017440567,0.79339033,0.018664107,0.00017512834],"about_ca_topic_score_codex":0.005005651,"about_ca_topic_score_gemma":0.005165317,"teacher_disagreement_score":0.18119948,"about_ca_system_score_codex":0.0024789376,"about_ca_system_score_gemma":0.004684114,"threshold_uncertainty_score":0.95828587},"labels":[],"label_agreement":null},{"id":"W2013108856","doi":"10.1177/0049124105280198","title":"Mapping Social Distance","year":2005,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Urban, Neighborhood, and Segregation Studies","field":"Social Sciences","cited_by":41,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Multidimensional scaling; Ethnic group; Census; Metropolitan area; Immigration; Diversity (politics); Geography; Social distance; Sociology; Social group; Racial diversity; Census tract; Cultural diversity; Geographical distance; Economic geography; Regional science; Demography; Demographic economics; Social science; Statistics; Mathematics; Anthropology; Population","score_opus":0.496170104316695,"score_gpt":0.6084512661669489,"score_spread":0.11228116185025389,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2013108856","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.74564457,0.0012623519,0.16925988,0.00056269084,0.0001350252,0.00034271882,0.0099662235,0.0008560746,0.0719705],"genre_scores_gemma":[0.93559545,0.00039151465,0.05643403,0.000027588127,0.00001914454,0.00018069707,0.0030020017,0.000080066624,0.0042694625],"study_design_codex":"design_other","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9988495,0.00034389173,0.00006434631,0.00028274843,0.00035553865,0.00010404224],"domain_scores_gemma":[0.998381,0.0007071233,0.00022499889,0.00023011853,0.00035625754,0.00010055502],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0005583155,0.00039706277,0.0002996772,0.0072971075,0.0010615861,0.0020037119,0.00050483324,0.0004684281,0.007176226],"category_scores_gemma":[0.0060972297,0.00013758404,0.00043811093,0.0061873347,0.00048724044,0.0013799525,0.0023013132,0.0003785917,0.0017245503],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019955426,0.00019034737,0.25378948,0.00064542505,0.0002252469,0.0004521729,0.013973676,0.01232159,0.0062453146,0.054529015,0.010766449,0.6466617],"study_design_scores_gemma":[0.000048886825,0.00042027904,0.536755,0.00041100182,0.00015580891,0.0017254873,0.052600462,0.09654545,0.009727921,0.12621206,0.17518076,0.0002168629],"about_ca_topic_score_codex":0.008951135,"about_ca_topic_score_gemma":0.009242971,"teacher_disagreement_score":0.008951135,"about_ca_system_score_codex":0.0006141687,"about_ca_system_score_gemma":0.00057553174,"threshold_uncertainty_score":0.024006844},"labels":[],"label_agreement":null},{"id":"W2159263306","doi":"10.1177/0049124107301944","title":"Log-Linear Randomized-Response Models Taking Self-Protective Response Behavior Into Account","year":2007,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Survey Sampling and Estimation Techniques","field":"Mathematics","cited_by":49,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Randomized response; Respondent; Log-linear model; Response bias; Item response theory; Statistics; Outcome (game theory); Psychology; Social psychology; Econometrics; Response time; Linear model; Mathematics; Computer science; Psychometrics","score_opus":0.5305748280486128,"score_gpt":0.619559010240721,"score_spread":0.08898418219210824,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2159263306","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.04215929,0.0014472002,0.9383875,0.0029774613,0.0006038152,0.0040888945,0.0042151287,0.002398804,0.003721809],"genre_scores_gemma":[0.44838634,0.0022606796,0.47352752,0.0025572884,0.0007506367,0.02461026,0.0055173384,0.00054297387,0.041846965],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8925887,0.089785576,0.0027187802,0.008790125,0.0034610915,0.0026557846],"domain_scores_gemma":[0.75659347,0.21090318,0.012466545,0.012339609,0.0069153784,0.00078187825],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.086787336,0.0044754897,0.0056983293,0.0042512026,0.0013569419,0.0045384853,0.011164883,0.007194211,0.030318294],"category_scores_gemma":[0.18603115,0.0027759958,0.006703104,0.004603352,0.0046327845,0.006105077,0.0041070455,0.008153626,0.01057189],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0049561434,0.0014184937,0.040216863,0.0037620377,0.0047484892,0.0012791395,0.0053306865,0.31369084,0.0009903362,0.45230925,0.022092225,0.14920548],"study_design_scores_gemma":[0.0010505681,0.0010909968,0.003469306,0.0004108528,0.00086438557,0.0004839916,0.0005866892,0.7812199,0.00054887444,0.1986518,0.0114092585,0.00021341612],"about_ca_topic_score_codex":0.008139554,"about_ca_topic_score_gemma":0.004072947,"teacher_disagreement_score":0.086787336,"about_ca_system_score_codex":0.0038923742,"about_ca_system_score_gemma":0.0024002802,"threshold_uncertainty_score":0.4589808},"labels":[],"label_agreement":null},{"id":"W2164011803","doi":"10.1177/0049124113506406","title":"Prepaid Monetary Incentives—Predictors of Taking the Money and Completing the Survey","year":2013,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Survey Methodology and Nonresponse","field":"Social Sciences","cited_by":11,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Impact; Ontario Institute for Cancer Research; University of Waterloo","funders":"National Cancer Institute","keywords":"Prepayment of loan; Cash; Payment; Incentive; Survey data collection; Sample (material); Demographic economics; Survey methodology; Survey research; Actuarial science; Business; Economics; Finance; Socioeconomics; Medicine; Statistics","score_opus":0.6779027527051609,"score_gpt":0.6117124448757337,"score_spread":0.06619030782942714,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2164011803","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9957072,0.00036461937,0.0003035564,0.0009718464,0.000034360542,0.00004108737,0.0006001561,0.000009176142,0.0019680397],"genre_scores_gemma":[0.9984736,0.00015597935,0.00047304525,0.00007870287,0.000026717997,0.000022667162,0.00025897616,0.00000504021,0.0005053788],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99621576,0.002157533,0.000486941,0.00020532569,0.0005155917,0.00041882126],"domain_scores_gemma":[0.94868654,0.016312882,0.025769727,0.0022889783,0.0020645834,0.0048772492],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.005066989,0.00018984897,0.00023001627,0.00083500915,0.0006589106,0.0010826662,0.000624684,0.00086965365,0.0063753817],"category_scores_gemma":[0.039666638,0.0002496816,0.00048665906,0.0011592342,0.0004224998,0.0011190482,0.0008184965,0.0018157942,0.00064789696],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001302258,0.00012917357,0.99396706,0.000018004896,0.000026604816,0.000031356118,0.00017417515,0.00008476234,0.00003841733,0.00012469944,0.0004538401,0.0048216535],"study_design_scores_gemma":[0.000004604229,0.000116071045,0.9979583,0.000046199602,0.000014130749,0.00008625972,0.0004883871,0.00043263525,0.000035169403,0.000118969525,0.00069272023,0.000006533054],"about_ca_topic_score_codex":0.0073563484,"about_ca_topic_score_gemma":0.0076901033,"teacher_disagreement_score":0.994933,"about_ca_system_score_codex":0.0003223446,"about_ca_system_score_gemma":0.0010586648,"threshold_uncertainty_score":0.026797116},"labels":[],"label_agreement":null},{"id":"W2224720476","doi":"10.1177/0049124115610345","title":"Obtaining Predictions from Models Fit to Multiply Imputed Data","year":2015,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Statistical Methods and Bayesian Inference","field":"Mathematics","cited_by":79,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Computer science; Imputation (statistics); Set (abstract data type); Data set; Data mining; Missing data; Machine learning; Artificial intelligence","score_opus":0.8988619494689873,"score_gpt":0.6764142898064175,"score_spread":0.22244765966256985,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2224720476","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0142172035,0.00018502594,0.98059857,0.00053476525,0.00006842508,0.00015517768,0.0006534717,0.001054041,0.0025333283],"genre_scores_gemma":[0.24654344,0.0005693018,0.74460226,0.0004855439,0.000105280684,0.0010281131,0.0027356003,0.0013125291,0.0026179468],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9782995,0.01529642,0.0009910653,0.0022620424,0.0026447973,0.0005062238],"domain_scores_gemma":[0.8692594,0.11006575,0.003871038,0.01173598,0.0046265353,0.00044133913],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.031939212,0.0020530527,0.0019992809,0.0030535546,0.0009397486,0.0037557937,0.0030478043,0.0017742105,0.0073140725],"category_scores_gemma":[0.17646106,0.0017756096,0.004048218,0.002877913,0.0016935654,0.0042051063,0.0031197888,0.005975431,0.003614196],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000404,0.0002579637,0.027694864,0.0012935756,0.0016558171,0.001248776,0.002179503,0.52522945,0.002462534,0.17594035,0.021030283,0.24060291],"study_design_scores_gemma":[0.000048155616,0.00012587945,0.0039834464,0.00036685908,0.00018793135,0.00028497417,0.00036533488,0.7202096,0.0032822369,0.26353315,0.0074841245,0.000128278],"about_ca_topic_score_codex":0.00673378,"about_ca_topic_score_gemma":0.0061300425,"teacher_disagreement_score":0.9680608,"about_ca_system_score_codex":0.0019169305,"about_ca_system_score_gemma":0.002378729,"threshold_uncertainty_score":0.16891271},"labels":[],"label_agreement":null},{"id":"W2321084336","doi":"10.1177/0049124114547769","title":"What You Can—and Can’t—Do With Three-Wave Panel Data","year":2014,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Social Capital and Networks","field":"Social Sciences","cited_by":310,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Econometrics; Context (archaeology); Panel data; Sign (mathematics); Computer science; Simple (philosophy); Constant (computer programming); Specification; Point (geometry); Statistics; Mathematics; Epistemology","score_opus":0.6132883582648904,"score_gpt":0.5563295464419532,"score_spread":0.05695881182293716,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2321084336","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.023582127,0.021822598,0.51128864,0.40314528,0.0067321765,0.0004901945,0.0053740866,0.0007519803,0.026812974],"genre_scores_gemma":[0.3802779,0.030086549,0.4601183,0.098704,0.010999001,0.0024789271,0.0037168576,0.00059655175,0.013021958],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9426373,0.049217377,0.0011060592,0.0032110238,0.0029900847,0.00083808985],"domain_scores_gemma":[0.83154196,0.12507258,0.00999211,0.026755232,0.004785831,0.0018521429],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.060897004,0.0012170492,0.0022173296,0.001983131,0.0032920267,0.00628484,0.004241726,0.0063981498,0.010651647],"category_scores_gemma":[0.26140034,0.0011166359,0.0020451117,0.0054668686,0.0070205224,0.021176182,0.003528106,0.009159235,0.0032767197],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00023558088,0.000291305,0.036488578,0.0020058323,0.0018718088,0.00043717847,0.0049317847,0.010175114,0.00037720543,0.5076525,0.17469059,0.26084247],"study_design_scores_gemma":[0.00008671545,0.000105854684,0.004936767,0.0017655871,0.0002407141,0.0002112722,0.0014359845,0.0103560565,0.00044976166,0.90558046,0.07467035,0.0001604265],"about_ca_topic_score_codex":0.011220316,"about_ca_topic_score_gemma":0.009726258,"teacher_disagreement_score":0.939103,"about_ca_system_score_codex":0.0017073952,"about_ca_system_score_gemma":0.0018929952,"threshold_uncertainty_score":0.32205802},"labels":[],"label_agreement":null},{"id":"W2478027989","doi":"10.1177/0049124116661575","title":"A Novel Sequential Mixed-method Technique for Contrastive Analysis of Unscripted Qualitative Data","year":2016,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":25,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"NeuroDevNet; University of British Columbia","funders":"","keywords":"Computer science; Multimethodology; Qualitative research; Qualitative property; Subject (documents); Data science; Contrastive analysis; Psychology; Linguistics; Mathematics education; Machine learning; Sociology; World Wide Web; Social science","score_opus":0.6465089207335274,"score_gpt":0.6967122529922157,"score_spread":0.05020333225868834,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2478027989","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029561128,0.00006445442,0.9790315,0.00013995837,0.0002093292,0.0142218275,0.0005015,0.00082891405,0.0020464787],"genre_scores_gemma":[0.007341634,0.00002810428,0.94233906,0.0000957362,0.000037207345,0.049357798,0.00013153638,0.00021139489,0.0004575312],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.8098165,0.15145557,0.007825671,0.016595654,0.013145595,0.001161047],"domain_scores_gemma":[0.68397367,0.2463913,0.013741343,0.030530293,0.024149938,0.0012135046],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.11072115,0.0038440626,0.003013406,0.0077075595,0.0041068527,0.005726018,0.0054966644,0.002223079,0.024297403],"category_scores_gemma":[0.24582782,0.0022610386,0.003492907,0.008246874,0.00477624,0.003196929,0.0069487686,0.004993264,0.0037035597],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0026713947,0.0012302052,0.0039249943,0.0083706975,0.0016726259,0.000590719,0.04234854,0.008973056,0.025566585,0.16661249,0.014729532,0.7233091],"study_design_scores_gemma":[0.0048182528,0.0055153943,0.011898424,0.0036781102,0.0019304384,0.000985616,0.011324893,0.2048148,0.06432299,0.4077209,0.2817275,0.0012626604],"about_ca_topic_score_codex":0.0024921303,"about_ca_topic_score_gemma":0.0047523463,"teacher_disagreement_score":0.8892788,"about_ca_system_score_codex":0.0043325922,"about_ca_system_score_gemma":0.0073040086,"threshold_uncertainty_score":0.5855564},"labels":[],"label_agreement":null},{"id":"W2604981585","doi":"10.1177/0049124117701484","title":"The Relationship Between the Position of Name Generator Questions and Responsiveness in Multiple Name Generator Surveys","year":2017,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Survey Methodology and Nonresponse","field":"Social Sciences","cited_by":67,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Impact; McMaster University; Public Health Ontario; University of Toronto","funders":"","keywords":"Satisficing; Psychology; Social psychology; Generator (circuit theory); Position (finance); Computer science; Artificial intelligence; Business; Power (physics)","score_opus":0.7044616437765651,"score_gpt":0.6221866481149423,"score_spread":0.08227499566162277,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2604981585","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9829107,0.00016048398,0.012847714,0.00053858565,0.000039445556,0.00028953113,0.00010884217,0.000054914148,0.003049778],"genre_scores_gemma":[0.9963928,0.000031079715,0.002840041,0.00014109169,0.000028820288,0.00022833595,0.000076553166,0.000022083674,0.0002390958],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.610733,0.3471643,0.013396453,0.010573521,0.01458005,0.0035527481],"domain_scores_gemma":[0.16366701,0.76557994,0.03889298,0.021904703,0.0075199893,0.0024353545],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.23016448,0.00063181313,0.00080742396,0.0024017778,0.0013291604,0.0025137258,0.0017315404,0.0024512503,0.0057299966],"category_scores_gemma":[0.56991726,0.00085040403,0.0014718118,0.001969971,0.0030036618,0.0052230037,0.0036390903,0.0034342813,0.0011931242],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0037592042,0.0014991033,0.91088265,0.0006807023,0.0007227328,0.00045684178,0.027825953,0.0040647043,0.0042787134,0.0031020252,0.0006341815,0.042093202],"study_design_scores_gemma":[0.00039879998,0.0110733565,0.90306777,0.00060919614,0.0007451104,0.00202176,0.015985493,0.036003847,0.014369222,0.011356469,0.003976024,0.00039305506],"about_ca_topic_score_codex":0.00092935166,"about_ca_topic_score_gemma":0.00069645094,"teacher_disagreement_score":0.76983553,"about_ca_system_score_codex":0.0012589169,"about_ca_system_score_gemma":0.0013434778,"threshold_uncertainty_score":0.9493443},"labels":[],"label_agreement":null},{"id":"W2616014493","doi":"10.1177/0049124117747304","title":"Generalization of Classic Question Order Effects Across Cultures","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Social and Intergroup Psychology","field":"Social Sciences","cited_by":26,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Saskatchewan","funders":"Economic and Social Research Council; Danmarks Frie Forskningsfond","keywords":"Contrast (vision); Norm (philosophy); Order (exchange); Generalization; Perception; Context (archaeology); Social psychology; Psychology; Positive economics; Political science; Geography; Epistemology; Economics; Law; Computer science; Philosophy","score_opus":0.2567032230430472,"score_gpt":0.6683574336594847,"score_spread":0.41165421061643753,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2616014493","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.83641815,0.0010245726,0.10715385,0.0006025984,0.0004110583,0.0014293685,0.0008474974,0.00047037323,0.05164259],"genre_scores_gemma":[0.98486346,0.0001388444,0.011644218,0.00059180876,0.00012619077,0.000693728,0.00039421496,0.00013573095,0.0014118431],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9565471,0.021115832,0.0036192052,0.010695071,0.0073109986,0.00071184145],"domain_scores_gemma":[0.6172905,0.2673608,0.015657127,0.085589305,0.012583999,0.00151832],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.056691453,0.00091741444,0.0007524875,0.0018210304,0.00084024505,0.0018631897,0.0014104889,0.0009998741,0.010004301],"category_scores_gemma":[0.24257073,0.00086069363,0.001565818,0.0008063913,0.0037542419,0.003725195,0.0050154356,0.0017638877,0.00078270305],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.009552918,0.0021474846,0.45145005,0.004919823,0.0048343344,0.0009415295,0.034751724,0.005992073,0.0738524,0.07218107,0.0059209527,0.33345568],"study_design_scores_gemma":[0.0006984168,0.003294676,0.84106284,0.0005278364,0.0012958504,0.0015123335,0.0046846177,0.010072306,0.037307985,0.085078865,0.014156436,0.00030771276],"about_ca_topic_score_codex":0.0010191732,"about_ca_topic_score_gemma":0.00091860007,"teacher_disagreement_score":0.94330853,"about_ca_system_score_codex":0.0008521346,"about_ca_system_score_gemma":0.0004953168,"threshold_uncertainty_score":0.29981667},"labels":[],"label_agreement":null},{"id":"W2761888982","doi":"10.1177/0049124117729709","title":"Power Law Distributions and the Size Distribution of Strikes","year":2017,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Labor Movements and Unions","field":"Social Sciences","cited_by":8,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"University of Toronto","funders":"","keywords":"Log-normal distribution; Econometrics; Distribution (mathematics); Power law; Statistics; Power (physics); Perspective (graphical); Pareto distribution; Duration (music); Law; Economics; Mathematics; Political science; Physics","score_opus":0.17155189800997964,"score_gpt":0.5483748844190327,"score_spread":0.3768229864090531,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2761888982","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9477399,0.0013363928,0.015882146,0.0019507643,0.00006389579,0.0002014477,0.009831344,0.00019875416,0.022795413],"genre_scores_gemma":[0.9912593,0.0003760098,0.001549856,0.000065209286,0.000018829358,0.000034768407,0.0032193107,0.00003753582,0.0034392502],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9941307,0.00080033706,0.000418733,0.0012247972,0.0023866154,0.0010388434],"domain_scores_gemma":[0.96231425,0.016864441,0.009945139,0.002946983,0.006685612,0.0012435936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.0064132796,0.00033667154,0.0007162641,0.0052636755,0.001595932,0.0026802884,0.00237363,0.0010003219,0.008643116],"category_scores_gemma":[0.07329622,0.0003964087,0.0008437809,0.0070943492,0.002952432,0.0019395467,0.0012362741,0.0018692414,0.0008837588],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":true,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00018030396,0.000082796265,0.8745839,0.00014916778,0.00023138088,0.0003864678,0.0066498728,0.023591042,0.00038547727,0.039185073,0.009155848,0.04541866],"study_design_scores_gemma":[0.000029944706,0.00006201038,0.9383823,0.000105328596,0.000047205118,0.00022239875,0.004988285,0.029399378,0.00029370133,0.01214116,0.01423502,0.00009325129],"about_ca_topic_score_codex":0.8770659,"about_ca_topic_score_gemma":0.8540026,"teacher_disagreement_score":0.8770659,"about_ca_system_score_codex":0.015725555,"about_ca_system_score_gemma":0.007815064,"threshold_uncertainty_score":0.24731612},"labels":[],"label_agreement":null},{"id":"W2792032639","doi":"10.1177/0049124117747302","title":"Optimizing Count Responses in Surveys: A Machine-learning Approach","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Survey Sampling and Estimation Techniques","field":"Mathematics","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Eunice Kennedy Shriver National Institute of Child Health and Human Development; Social Science Research Institute, Duke University; University of British Columbia; University of Victoria","keywords":"Censoring (clinical trials); Count data; Poisson distribution; Computer science; Bayesian probability; Multinomial distribution; Machine learning; Statistics; Artificial intelligence; Mathematics","score_opus":0.6338353326777821,"score_gpt":0.602291176727981,"score_spread":0.03154415594980109,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2792032639","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0057369024,0.00009839907,0.99342656,0.00015981666,0.0000100847365,0.00007439717,0.000036072382,0.0001490472,0.00030872138],"genre_scores_gemma":[0.19769032,0.00022124517,0.799514,0.0002295151,0.000088227105,0.0007534893,0.00033583384,0.00009989253,0.0010674202],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9868499,0.010559501,0.00037797214,0.001113612,0.00085372967,0.00024532265],"domain_scores_gemma":[0.9675589,0.027090197,0.0017819387,0.0018266394,0.0013959239,0.0003464219],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.015657967,0.0011617806,0.002279224,0.0019311374,0.0007381362,0.0013456271,0.0027575071,0.0020985992,0.0019669833],"category_scores_gemma":[0.051484834,0.0009447563,0.0013289333,0.0020557353,0.0016434753,0.002182085,0.0021854711,0.002057486,0.0004598632],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00019480598,0.0001833446,0.0048553604,0.0002907224,0.00021570131,0.00006652307,0.00021446013,0.76111704,0.0009189674,0.06865047,0.0017709929,0.1615217],"study_design_scores_gemma":[0.000019266365,0.0000449317,0.0003299147,0.000018174056,0.0000115127705,0.0000110047295,0.000017406874,0.96835136,0.00031970572,0.030342175,0.00052461115,0.000009822913],"about_ca_topic_score_codex":0.0025593173,"about_ca_topic_score_gemma":0.0020905898,"teacher_disagreement_score":0.98434204,"about_ca_system_score_codex":0.0015998604,"about_ca_system_score_gemma":0.0017260129,"threshold_uncertainty_score":0.0828082},"labels":[],"label_agreement":null},{"id":"W2801448578","doi":"10.1177/0049124118769089","title":"Figure It Out!","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Management and Organizational Studies","field":"Business, Management and Accounting","cited_by":21,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Creativity; Value (mathematics); Epistemology; Sociology; Visualization; Domain (mathematical analysis); Computer science; Visual reasoning; Cognitive science; Psychology; Artificial intelligence; Social psychology; Mathematics","score_opus":0.33708040067142014,"score_gpt":0.5101817443061937,"score_spread":0.17310134363477353,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2801448578","genre_codex":"other","genre_gemma":"commentary","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"commentary","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005132167,0.0032486306,0.034288988,0.10982199,0.029609317,0.00021653272,0.0016642252,0.009553734,0.8064645],"genre_scores_gemma":[0.047717582,0.0025377811,0.02376313,0.030475723,0.0029160725,0.0001973658,0.0015103964,0.0043325056,0.8865495],"study_design_codex":"not_applicable","study_design_gemma":"not_applicable","domain_scores_codex":[0.99823666,0.0005828287,0.000064472995,0.0003078781,0.0005832151,0.00022490308],"domain_scores_gemma":[0.9976616,0.00054109795,0.00013748191,0.00045800215,0.00073733117,0.00046447187],"candidate_categories":["insufficient_payload"],"consensus_categories":[],"category_scores_codex":[0.001910877,0.0009617882,0.00052968494,0.0010964872,0.003992263,0.008755385,0.0011925249,0.002944754,0.3015866],"category_scores_gemma":[0.010526216,0.0003458948,0.00083181076,0.00077957293,0.002385374,0.010126865,0.005827676,0.0045301733,0.2297755],"study_design_candidate":"not_applicable","study_design_consensus":"not_applicable","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006109979,0.000029546742,0.0006472293,0.00011966682,0.00001158508,0.00027141024,0.0034313074,0.000082264705,0.0005990141,0.048419584,0.83835906,0.10796821],"study_design_scores_gemma":[0.0000036492067,0.000012037244,0.0002001054,0.0000740234,0.0000040918976,0.0001982186,0.001408098,0.00009033187,0.00016951076,0.007225251,0.99059945,0.000015147195],"about_ca_topic_score_codex":0.0043633305,"about_ca_topic_score_gemma":0.005404303,"teacher_disagreement_score":0.3015866,"about_ca_system_score_codex":0.00108566,"about_ca_system_score_gemma":0.0015603238,"threshold_uncertainty_score":0.99620193},"labels":[],"label_agreement":null},{"id":"W2802314382","doi":"10.1177/0049124118769087","title":"Regression-based Adjustment for Time-varying Confounders","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":35,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Marginal structural model; Econometrics; Estimator; Inverse probability; Regression; Average treatment effect; Statistics; Propensity score matching; Matching (statistics); Regression analysis; Computer science; Conditional expectation; Observational study; Outcome (game theory); Confounding; Estimation; Mathematics; Economics; Bayesian probability","score_opus":0.6894510924192692,"score_gpt":0.6691776798557132,"score_spread":0.02027341256355597,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2802314382","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.007112032,0.00046622095,0.99045944,0.00037223886,0.000093701674,0.00012314174,0.00019813294,0.0005166599,0.0006584257],"genre_scores_gemma":[0.25255656,0.00095624436,0.73969316,0.0003760249,0.00019268398,0.0008267977,0.0010102901,0.0004535112,0.003934804],"study_design_codex":"design_other","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9826158,0.013201843,0.00061030703,0.0019875767,0.0011904008,0.00039407445],"domain_scores_gemma":[0.96978474,0.018243518,0.0030257946,0.006908947,0.0018266166,0.00021036573],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.031245165,0.0014031583,0.001966524,0.0015604612,0.0005628746,0.0010219407,0.00341263,0.001170481,0.004546224],"category_scores_gemma":[0.10108384,0.0007112029,0.0029175999,0.0030242861,0.0007594162,0.0017954234,0.0018762319,0.0031677824,0.001217934],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00063641416,0.00038217762,0.041459154,0.0009176156,0.003998749,0.00032581078,0.0009839383,0.18262309,0.004618431,0.22163285,0.00966442,0.5327574],"study_design_scores_gemma":[0.00034836016,0.00058744085,0.021392498,0.0002267585,0.0015180489,0.00033439082,0.00022223478,0.73446894,0.0064057354,0.20590837,0.028442943,0.00014424813],"about_ca_topic_score_codex":0.00811251,"about_ca_topic_score_gemma":0.005644895,"teacher_disagreement_score":0.031245165,"about_ca_system_score_codex":0.0008369313,"about_ca_system_score_gemma":0.003159546,"threshold_uncertainty_score":0.16524214},"labels":[],"label_agreement":null},{"id":"W2812371591","doi":"10.1177/0049124118782554","title":"Perceived Corruption, Trust, and Interviewer Behavior in 26 European Countries","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Corruption and Economic Development","field":"Social Sciences","cited_by":31,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Dalhousie University","funders":"","keywords":"Interview; European Social Survey; Deviance (statistics); Language change; Psychology; Social psychology; Survey research; Variation (astronomy); Criminology; Political science; Applied psychology; Statistics; Law","score_opus":0.32786452904723834,"score_gpt":0.5547942230466409,"score_spread":0.2269296939994026,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2812371591","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9993339,0.00015860391,0.00006441148,0.000031292948,0.0000015548685,0.0000060139323,0.00005957366,6.670031e-7,0.00034398303],"genre_scores_gemma":[0.9995548,0.00011626882,0.000086077715,0.000020583175,0.0000011082922,0.000007244334,0.00009458161,7.809501e-7,0.00011858769],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.9929027,0.0056219795,0.00044218288,0.00033972992,0.00024375612,0.00044963762],"domain_scores_gemma":[0.9797601,0.009778025,0.007340418,0.00092586945,0.0013670903,0.000828436],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.009903182,0.00024657304,0.00036592246,0.0013323025,0.0006448237,0.0011290616,0.000265416,0.000546234,0.00080614665],"category_scores_gemma":[0.013686904,0.00031753635,0.0002514885,0.0018649715,0.0011303433,0.0005589816,0.0013228959,0.0004564634,0.00012375868],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00016826874,0.00011034566,0.98922473,0.00003991869,0.000048454607,0.00015196916,0.0052999263,0.000373427,0.00016454961,0.0003087984,0.00018984807,0.0039198254],"study_design_scores_gemma":[0.000011110983,0.00009404555,0.99041337,0.000052062845,0.00001661577,0.00013875443,0.0077845035,0.00047415678,0.00023920332,0.00006713503,0.0006980433,0.000011097586],"about_ca_topic_score_codex":0.011041356,"about_ca_topic_score_gemma":0.011059703,"teacher_disagreement_score":0.011041356,"about_ca_system_score_codex":0.00097004673,"about_ca_system_score_gemma":0.00052230025,"threshold_uncertainty_score":0.052373648},"labels":[],"label_agreement":null},{"id":"W2887293044","doi":"10.1177/0049124118789717","title":"A Note on a Reformulation of the KHB Method","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Spatial and Panel Data Analysis","field":"Economics, Econometrics and Finance","cited_by":106,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Logit; Probit; Statistics; Mathematics; Probit model; Logistic regression; Econometrics; Residual; Confounding; Variance (accounting); Constant (computer programming); Conditional probability; Conditional logistic regression; Computer science; Economics; Algorithm","score_opus":0.40826412402656087,"score_gpt":0.5321633408856649,"score_spread":0.12389921685910399,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2887293044","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00094633293,0.001097174,0.98290944,0.006223388,0.002544208,0.00017312281,0.00054038054,0.000550892,0.0050150487],"genre_scores_gemma":[0.016520822,0.0014223888,0.9653225,0.0042220624,0.0020412568,0.0007927741,0.0006602817,0.0013669747,0.007650988],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95914453,0.028651124,0.002017676,0.0033109833,0.0062334314,0.00064237963],"domain_scores_gemma":[0.93123543,0.041000757,0.0021466773,0.014221902,0.010704269,0.00069108326],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.04024381,0.0010907328,0.002266111,0.0030866808,0.0019292837,0.0059467745,0.0048790257,0.0031021598,0.021311903],"category_scores_gemma":[0.14419645,0.0014388437,0.0023321395,0.0043556355,0.0041191163,0.0064573316,0.006010916,0.011136628,0.015360082],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00009965121,0.00007719228,0.0014765221,0.00033328417,0.00012021664,0.00022392313,0.0010024786,0.002723419,0.0012825909,0.69842786,0.08158474,0.21264821],"study_design_scores_gemma":[0.00011043738,0.000083778694,0.0022502567,0.00056167645,0.00008827487,0.00064581085,0.00042895225,0.028894419,0.0013227056,0.5924732,0.37289137,0.0002490528],"about_ca_topic_score_codex":0.0080032665,"about_ca_topic_score_gemma":0.0069754515,"teacher_disagreement_score":0.04024381,"about_ca_system_score_codex":0.002038985,"about_ca_system_score_gemma":0.0048482893,"threshold_uncertainty_score":0.21283215},"labels":[],"label_agreement":null},{"id":"W2888408547","doi":"10.1177/0049124118782550","title":"Analyzing Heaped Counts Versus Longitudinal Presence/Absence Data in Joint Zero-inflated Discrete Regression Models","year":2018,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Crime Patterns and Interventions","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Natural Sciences and Engineering Research Council of Canada","keywords":"Count data; Statistics; Outcome (game theory); Event (particle physics); Regression analysis; Event data; Econometrics; Mathematics; Rounding; Psychology; Computer science; Covariate","score_opus":0.6965302466042542,"score_gpt":0.6410708432010603,"score_spread":0.055459403403193885,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2888408547","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.15546453,0.00088629976,0.8406141,0.0008993739,0.00009599224,0.00012088528,0.00084695045,0.00034769566,0.00072409457],"genre_scores_gemma":[0.80605084,0.00069710356,0.18826713,0.00024128896,0.00025374384,0.0004948232,0.0015353012,0.00010808484,0.0023517602],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9562864,0.03511801,0.0016544831,0.004350992,0.001557619,0.0010325705],"domain_scores_gemma":[0.74503225,0.21653719,0.016969847,0.017798936,0.0027342802,0.00092752936],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.056653712,0.0012645321,0.002335288,0.0023484866,0.0008260561,0.0032786622,0.00355806,0.0022762388,0.0024747115],"category_scores_gemma":[0.15119076,0.0008691649,0.0022391353,0.0035694523,0.003414427,0.0034565905,0.004141822,0.0031672493,0.0005099849],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0012258259,0.00058450294,0.1988495,0.0008886919,0.0026769212,0.0014498244,0.0034212675,0.4067429,0.0017677837,0.22576071,0.0028280977,0.15380396],"study_design_scores_gemma":[0.000055373584,0.0003422869,0.017278466,0.0001741408,0.00037860108,0.00022947731,0.0004562824,0.8596755,0.0009085165,0.117781565,0.0026100914,0.00010970069],"about_ca_topic_score_codex":0.0062708263,"about_ca_topic_score_gemma":0.0037403635,"teacher_disagreement_score":0.056653712,"about_ca_system_score_codex":0.0009927006,"about_ca_system_score_gemma":0.0014161,"threshold_uncertainty_score":0.29961705},"labels":[],"label_agreement":null},{"id":"W2983060199","doi":"10.1177/0049124119882460","title":"The Double Bind of Qualitative Comparative Analysis","year":2019,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Qualitative Comparative Analysis Research","field":"Social Sciences","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université de Montréal","funders":"","keywords":"Qualitative comparative analysis; Computer science; Theoretical computer science; Simple (philosophy); Set (abstract data type); Algorithm; Face (sociological concept); Data mining; Machine learning; Epistemology","score_opus":0.817819447521365,"score_gpt":0.7678292769503934,"score_spread":0.04999017057097166,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W2983060199","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011274745,0.010875412,0.71193177,0.13398021,0.0029448092,0.00060066284,0.00033420476,0.00037208325,0.12768605],"genre_scores_gemma":[0.55193996,0.0049941777,0.38829437,0.034924027,0.0021880586,0.0042067408,0.00021622347,0.00063265703,0.0126037635],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.6507431,0.28772527,0.007133225,0.01584098,0.036519464,0.0020379336],"domain_scores_gemma":[0.4979355,0.42218983,0.008248473,0.050506316,0.018059667,0.003060183],"candidate_categories":["metaresearch"],"consensus_categories":["metaresearch"],"category_scores_codex":[0.19927995,0.0012965723,0.00305923,0.007324515,0.008244819,0.016831283,0.0050818427,0.0070033707,0.011877737],"category_scores_gemma":[0.35230508,0.0017426097,0.0014026011,0.004723269,0.08368161,0.027710486,0.020752177,0.013735653,0.0015621479],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0000325316,0.000013049045,0.00027425788,0.00020791363,0.000034540688,0.000033960136,0.002580783,0.00048247067,0.00007232927,0.98074347,0.00254732,0.01297737],"study_design_scores_gemma":[0.00002520528,0.000021201746,0.00012297979,0.00038740126,0.000013116605,0.00005905522,0.00080299046,0.0013131613,0.00021048926,0.9706023,0.026416928,0.00002531397],"about_ca_topic_score_codex":0.0027622946,"about_ca_topic_score_gemma":0.0023508887,"teacher_disagreement_score":0.80072004,"about_ca_system_score_codex":0.011446217,"about_ca_system_score_gemma":0.00950422,"threshold_uncertainty_score":0.9874304},"labels":[],"label_agreement":null},{"id":"W3015404063","doi":"10.1177/0049124120914943","title":"Clustered Iconography: A Resurrected Method for Representing Multidimensional Data","year":2020,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Data Visualization and Analytics","field":"Computer Science","cited_by":2,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Université Laval","funders":"","keywords":"Iconography; Computer science; Presentation (obstetrics); Data science; Data mining; Information retrieval; History; Archaeology","score_opus":0.6367181529069946,"score_gpt":0.6249219023411513,"score_spread":0.011796250565843325,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3015404063","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0019712935,0.0006719152,0.97981936,0.001734553,0.0006900296,0.0002999193,0.0015318636,0.0043190583,0.00896195],"genre_scores_gemma":[0.047829654,0.0012288622,0.9369841,0.00088511244,0.0006172469,0.0013452219,0.0017360104,0.0031120677,0.0062617543],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.98872465,0.0067600794,0.00075851486,0.0012386609,0.0022193315,0.00029884867],"domain_scores_gemma":[0.94502157,0.03458175,0.0028816524,0.01028196,0.006241566,0.0009915698],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.011881895,0.0022091044,0.0012812372,0.014316815,0.00259281,0.0109956665,0.002890246,0.0022956782,0.030567104],"category_scores_gemma":[0.06899707,0.0010422434,0.002107301,0.013125008,0.005705713,0.008629741,0.0070984247,0.004451204,0.006881297],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00021281706,0.00005661734,0.002072135,0.0017594789,0.00019524072,0.00041328813,0.012959367,0.0058119455,0.004163193,0.52194875,0.082383946,0.3680232],"study_design_scores_gemma":[0.00009949086,0.00011328737,0.0017864681,0.0012551632,0.00013747113,0.0011383066,0.004382394,0.046356108,0.0060889833,0.48224205,0.45604503,0.00035521074],"about_ca_topic_score_codex":0.004343776,"about_ca_topic_score_gemma":0.005952127,"teacher_disagreement_score":0.030567104,"about_ca_system_score_codex":0.0019558456,"about_ca_system_score_gemma":0.0048947865,"threshold_uncertainty_score":0.10225719},"labels":[],"label_agreement":null},{"id":"W3019463389","doi":"10.1177/0049124120914928","title":"Joint Modeling of Multivariate Survival Data With an Application to Retirement","year":2020,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Insurance, Mortality, Demography, Risk Management","field":"Social Sciences","cited_by":7,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Simon Fraser University; University of Victoria","funders":"","keywords":"Univariate; Multivariate statistics; Proportional hazards model; Covariate; Event (particle physics); Econometrics; Survival analysis; Variety (cybernetics); Multivariate analysis; Event data; Computer science; Statistics; Actuarial science; Psychology; Mathematics; Economics","score_opus":0.5795516871879395,"score_gpt":0.581134355203404,"score_spread":0.0015826680154644723,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3019463389","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01101257,0.00056885224,0.9866693,0.0006319026,0.000064877015,0.000051316852,0.0002252047,0.00019253007,0.00058341335],"genre_scores_gemma":[0.5163275,0.0029703425,0.46736026,0.00033555334,0.0005872263,0.0009236614,0.0011003099,0.00024439138,0.010150782],"study_design_codex":"simulation_or_modeling","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.9940414,0.0043844036,0.00023044055,0.0005604896,0.00052319455,0.0002600857],"domain_scores_gemma":[0.9750718,0.020089053,0.002134096,0.0014218931,0.0009040693,0.0003790628],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.014374436,0.0011144419,0.0015750082,0.0016914989,0.00063266547,0.0017462266,0.0022199915,0.0014420816,0.003242206],"category_scores_gemma":[0.028292306,0.0008581059,0.0028400521,0.0027585025,0.0015644662,0.0018761917,0.0031365305,0.0028585952,0.00043432714],"study_design_candidate":"simulation_or_modeling","study_design_consensus":"simulation_or_modeling","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00014297497,0.00012281435,0.014183832,0.00018942496,0.0004386548,0.0003253473,0.0007074147,0.5834932,0.00046690108,0.3442662,0.0022118594,0.053451404],"study_design_scores_gemma":[0.000014695814,0.00007230644,0.0015410736,0.000028018194,0.000045628243,0.000063654916,0.000061157865,0.9151382,0.00010009444,0.08077292,0.0021302914,0.000031843687],"about_ca_topic_score_codex":0.013990253,"about_ca_topic_score_gemma":0.0110651245,"teacher_disagreement_score":0.014374436,"about_ca_system_score_codex":0.0011300826,"about_ca_system_score_gemma":0.0020688805,"threshold_uncertainty_score":0.07602018},"labels":[],"label_agreement":null},{"id":"W3128078314","doi":"10.1177/0049124120986197","title":"Mobilizing the Masses: Measuring Resource Mobilization on Twitter","year":2021,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Social Media and Politics","field":"Social Sciences","cited_by":23,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Measure (data warehouse); Social media; Social movement; Resource mobilization; Resource (disambiguation); Computer science; Frame (networking); Simple (philosophy); Point (geometry); Parsing; Movement (music); Lexicon; Variation (astronomy); Data science; Artificial intelligence; Political science; World Wide Web; Data mining; Mathematics; Epistemology; Politics","score_opus":0.5893974947116389,"score_gpt":0.6022507172952619,"score_spread":0.01285322258362298,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3128078314","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.95685136,0.00020562312,0.012688871,0.0015322042,0.000057820173,0.00014089637,0.0035967897,0.00026664784,0.024659691],"genre_scores_gemma":[0.99305904,0.00009415749,0.0041332077,0.00009190829,0.000046194647,0.00012945247,0.0014670322,0.000030326468,0.0009487594],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99902236,0.0004130384,0.00009368527,0.00013407819,0.0002226189,0.00011416157],"domain_scores_gemma":[0.99364614,0.0035115625,0.0017588852,0.0003017047,0.00046578643,0.0003159436],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.0018326271,0.0003901703,0.00032528417,0.0048370333,0.00074992515,0.0022135274,0.000438575,0.0005515508,0.0025161912],"category_scores_gemma":[0.014125628,0.00015500824,0.0002720817,0.004641465,0.0010058609,0.0043399003,0.0016733801,0.0005395488,0.00076003117],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0002852697,0.00015725779,0.8519128,0.00043491338,0.00018652753,0.00021041009,0.013113543,0.006439832,0.005131095,0.016064413,0.006925628,0.09913832],"study_design_scores_gemma":[0.00002560433,0.00022940949,0.84211826,0.00027270813,0.0001425152,0.00025941414,0.03254895,0.06611822,0.0056941397,0.019686826,0.032752708,0.00015130886],"about_ca_topic_score_codex":0.0037255136,"about_ca_topic_score_gemma":0.005034893,"teacher_disagreement_score":0.9981674,"about_ca_system_score_codex":0.0007407477,"about_ca_system_score_gemma":0.00044460833,"threshold_uncertainty_score":0.009692013},"labels":[],"label_agreement":null},{"id":"W3129011248","doi":"10.1177/0049124120986192","title":"A New Methodological Approach to Study Household Structure From Census and Survey Data","year":2021,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Urban, Neighborhood, and Segregation Studies","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Quebec Statistical Institute; Université de Montréal","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Census; Indigenous; Representation (politics); Survey data collection; Current Population Survey; Population; Survey methodology; Yield (engineering); Econometrics; Geography; Computer science; Regional science; Data science; Sociology; Statistics; Demography; Mathematics; Political science","score_opus":0.890380508101297,"score_gpt":0.6410469044849224,"score_spread":0.24933360361637458,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3129011248","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.008896163,0.000488548,0.98244184,0.0011138533,0.00019492103,0.00062730815,0.0010984797,0.00013790319,0.0050010933],"genre_scores_gemma":[0.16360259,0.0011832607,0.82413596,0.001018759,0.0003651621,0.004520511,0.002541968,0.00015618319,0.002475627],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9703353,0.021504188,0.0014015445,0.0026401635,0.0037905453,0.0003284029],"domain_scores_gemma":[0.9767531,0.012113081,0.0027984453,0.0051205484,0.0028215628,0.00039320858],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.017249752,0.0006703821,0.0008508851,0.007465242,0.001743978,0.0026181578,0.002300503,0.00082093396,0.003112961],"category_scores_gemma":[0.052929167,0.0006209056,0.0011680824,0.015581804,0.0028399213,0.0039501297,0.004415336,0.00246168,0.00066915085],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00006737757,0.00011362459,0.03645867,0.00066874054,0.00050496956,0.00017325368,0.006136375,0.0070650703,0.0013443059,0.72441286,0.00974309,0.2133116],"study_design_scores_gemma":[0.00013024102,0.00039433682,0.048933864,0.0008758503,0.00026501674,0.0009940844,0.0060933423,0.036489435,0.0017846968,0.73513037,0.16866297,0.00024572018],"about_ca_topic_score_codex":0.009643129,"about_ca_topic_score_gemma":0.009739916,"teacher_disagreement_score":0.017249752,"about_ca_system_score_codex":0.0023719256,"about_ca_system_score_gemma":0.004069212,"threshold_uncertainty_score":0.09122646},"labels":[],"label_agreement":null},{"id":"W3134225231","doi":"10.1177/0049124121995548","title":"Marginal and Conditional Confounding Using Logits","year":2021,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":10,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"Medical Research Council; Chief Scientist Office","keywords":"Confounding; Statistics; Weighting; Econometrics; Marginal structural model; Conditional probability; Odds; Conditional probability distribution; Logistic regression; Marginal model; Inverse probability weighting; Conditional logistic regression; Mathematics; Odds ratio; Regression analysis; Medicine; Propensity score matching","score_opus":0.8690128158201307,"score_gpt":0.7315306657257828,"score_spread":0.13748215009434783,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W3134225231","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.01028356,0.00046601036,0.98424697,0.0007622349,0.00007501829,0.00009877711,0.00022982206,0.0001628685,0.0036747132],"genre_scores_gemma":[0.51437575,0.0015199385,0.47277716,0.0007383485,0.0003733082,0.0014691266,0.00062568777,0.0002671758,0.007853547],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95044,0.037300263,0.001634205,0.0046558077,0.0048173964,0.0011523669],"domain_scores_gemma":[0.92491746,0.05919262,0.004686766,0.008261687,0.0024001412,0.0005413378],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.03944655,0.0014130984,0.0016542367,0.0032477565,0.0011502145,0.0039887833,0.002948155,0.001518717,0.010067869],"category_scores_gemma":[0.13930632,0.0008161888,0.003102359,0.00391218,0.0054695727,0.007111244,0.007903197,0.0036770864,0.00088312454],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00008242302,0.000039077313,0.0069784066,0.00019663417,0.00024725622,0.00013523299,0.0013927369,0.009968308,0.00030026308,0.93227214,0.00091999874,0.04746747],"study_design_scores_gemma":[0.000033408764,0.00004428028,0.0024630593,0.00010380408,0.0001147469,0.00015562463,0.00022115282,0.027299283,0.0005949166,0.96072346,0.008184902,0.00006130986],"about_ca_topic_score_codex":0.0029207838,"about_ca_topic_score_gemma":0.002171899,"teacher_disagreement_score":0.96055347,"about_ca_system_score_codex":0.0016835484,"about_ca_system_score_gemma":0.002473589,"threshold_uncertainty_score":0.20861578},"labels":[],"label_agreement":null},{"id":"W4200319388","doi":"10.1177/00491241211067514","title":"And the Rest is History: Measuring the Scope and Recall of Wikipedia’s Coverage of Three Women’s Movement Subgroups","year":2021,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Wikis in Education and Collaboration","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Scope (computer science); Recall; Typology; Phrase; Operationalization; Movement (music); Comparative historical research; Categorical variable; Historical method; Computer science; Sociology; Epistemology; History; Social science; Cognitive psychology; Psychology; Natural language processing; Aesthetics","score_opus":0.255754211112796,"score_gpt":0.4841200688200403,"score_spread":0.22836585770724427,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4200319388","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.9864478,0.00083226006,0.0025463295,0.00020996323,0.00002402407,0.00007153906,0.0028055166,0.000046275552,0.0070163207],"genre_scores_gemma":[0.9901252,0.00044288792,0.004401714,0.000053708427,0.000050587565,0.00015964294,0.0034421843,0.000034555444,0.001289336],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.99666494,0.0012153574,0.0007062005,0.00052383303,0.00074030354,0.00014930409],"domain_scores_gemma":[0.8931941,0.06721991,0.021035489,0.005622918,0.011525007,0.0014026507],"candidate_categories":["bibliometrics"],"consensus_categories":[],"category_scores_codex":[0.00770659,0.00030210175,0.00028733473,0.012571624,0.0009111293,0.0020438917,0.0006269463,0.00061840983,0.0011445464],"category_scores_gemma":[0.08425429,0.00015488295,0.00025314308,0.007307498,0.0011834776,0.0050329417,0.002093933,0.0005074418,0.00030597107],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00039126177,0.00009922476,0.79085654,0.0012498084,0.0002648162,0.00021982548,0.08990001,0.00070968515,0.0035894061,0.0021918355,0.0026030452,0.10792453],"study_design_scores_gemma":[0.000010262368,0.00030266077,0.90113866,0.0005992206,0.00018935179,0.00062030903,0.06362583,0.0025566062,0.004886172,0.0020464624,0.023945557,0.000078891724],"about_ca_topic_score_codex":0.005393009,"about_ca_topic_score_gemma":0.0075780842,"teacher_disagreement_score":0.98742837,"about_ca_system_score_codex":0.0006757694,"about_ca_system_score_gemma":0.00055300654,"threshold_uncertainty_score":0.04075688},"labels":[],"label_agreement":null},{"id":"W4210644525","doi":"10.1177/00491241211036165","title":"Moving Beyond Linear Regression: Implementing and Interpreting Quantile Regression Models With Fixed Effects","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":104,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Alberta","funders":"","keywords":"Quantile regression; Econometrics; Regression; Quantile; Linear regression; Fixed effects model; Regression analysis; Replication (statistics); Range (aeronautics); Wage; Statistics; Computer science; Mathematics; Economics; Panel data","score_opus":0.3809058897593379,"score_gpt":0.5984629512409576,"score_spread":0.21755706148161968,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210644525","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.005021138,0.0023643505,0.98309267,0.0046450514,0.00033472065,0.00012780106,0.00041109216,0.0004498398,0.0035533032],"genre_scores_gemma":[0.19570428,0.0043669264,0.7897656,0.0039358847,0.0006859746,0.0008488811,0.00065914384,0.00079140643,0.00324197],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.93015856,0.061323885,0.001592121,0.003099928,0.0030524137,0.00077318255],"domain_scores_gemma":[0.82615113,0.14914323,0.008184696,0.011408393,0.004680841,0.00043169557],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.07441774,0.0014469664,0.0021463525,0.0026683055,0.0010308468,0.0059016366,0.004273809,0.0027461865,0.0052955565],"category_scores_gemma":[0.23801883,0.0010147033,0.0033284002,0.005182726,0.0038360425,0.0066626514,0.0041895024,0.0067092627,0.0012048193],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000094561365,0.00008205471,0.015603997,0.0010003347,0.0007319199,0.00042800783,0.004228794,0.036603533,0.00044788452,0.78074366,0.008254695,0.15178046],"study_design_scores_gemma":[0.00005446736,0.00011088413,0.004379037,0.0010458073,0.00021872198,0.0001301103,0.0011354578,0.08725816,0.00096981274,0.8690458,0.03554846,0.00010327783],"about_ca_topic_score_codex":0.015936425,"about_ca_topic_score_gemma":0.008407128,"teacher_disagreement_score":0.07441774,"about_ca_system_score_codex":0.001977217,"about_ca_system_score_gemma":0.0033278246,"threshold_uncertainty_score":0.39356333},"labels":[],"label_agreement":null},{"id":"W4210865241","doi":"10.1177/00491241221077238","title":"Comparing Single- and Multiple-Question Designs of Measuring Family Income in China Family Panel Studies","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Advanced Causal Inference Techniques","field":"Mathematics","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"","funders":"","keywords":"Econometrics; Percentile; Economics; Contrast (vision); Quarter (Canadian coin); Demographic economics; Statistics; Mathematics; Geography; Computer science","score_opus":0.9006386086819724,"score_gpt":0.6303685016720665,"score_spread":0.27027010700990595,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4210865241","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.80515677,0.0033105763,0.17980519,0.0014279244,0.00044229167,0.003071747,0.0023087095,0.00015366632,0.004323143],"genre_scores_gemma":[0.9478622,0.00054845726,0.04320765,0.00040995443,0.00011382884,0.005896637,0.0012797964,0.000029747283,0.0006517869],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.7831442,0.19530681,0.0051614703,0.0074469163,0.0074728946,0.0014677224],"domain_scores_gemma":[0.7704344,0.16083865,0.02451498,0.02889454,0.014070876,0.0012465732],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15980399,0.0008911751,0.0011448807,0.002455997,0.0020178554,0.0020116244,0.0026229946,0.0012780258,0.002670348],"category_scores_gemma":[0.22509587,0.00078287494,0.0025779414,0.004258516,0.0016751862,0.0023297432,0.0026713782,0.001442835,0.00026856785],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0016798268,0.0004929083,0.83525425,0.0014138857,0.008655394,0.00023923733,0.009188066,0.011588871,0.0008533765,0.019282166,0.0034422835,0.107909806],"study_design_scores_gemma":[0.0010250042,0.0020543658,0.8716522,0.0009494184,0.0038954706,0.00018653553,0.0055265385,0.073958196,0.0035942602,0.025030121,0.011841394,0.0002865884],"about_ca_topic_score_codex":0.01759659,"about_ca_topic_score_gemma":0.015093084,"teacher_disagreement_score":0.840196,"about_ca_system_score_codex":0.0029441828,"about_ca_system_score_gemma":0.0027274094,"threshold_uncertainty_score":0.8451344},"labels":[],"label_agreement":null},{"id":"W4290613457","doi":"10.1177/00491241221113877","title":"The Design and Optimality of Survey Counts: A Unified Framework Via the Fisher Information Maximizer","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Survey Sampling and Estimation Techniques","field":"Mathematics","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Social Sciences and Humanities Research Council of Canada; Hong Kong Polytechnic University","keywords":"Fisher information; Range (aeronautics); Mathematics; Statistics; Generalized linear model; Computer science; Econometrics; Optimal design; Mathematical optimization","score_opus":0.6171696352915063,"score_gpt":0.5685923866874328,"score_spread":0.04857724860407342,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4290613457","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.00203174,0.000070275506,0.99746776,0.00007934656,0.000005658529,0.000036331316,0.000013813609,0.00003239186,0.00026279967],"genre_scores_gemma":[0.09819544,0.00035376367,0.89971715,0.00009030764,0.000060245355,0.0006503642,0.00008905087,0.00006642441,0.00077730574],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9711901,0.023367004,0.00074856565,0.0017627779,0.0024849363,0.00044647304],"domain_scores_gemma":[0.9619468,0.030338809,0.0027850554,0.0023539627,0.0021719302,0.0004034313],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.026922071,0.0011794391,0.0021678787,0.0019628485,0.00060002116,0.00152394,0.0024673657,0.0018912851,0.0020447683],"category_scores_gemma":[0.079620354,0.0011803994,0.0011632057,0.0018829366,0.0031625542,0.0039417488,0.0024696763,0.002080354,0.00046837228],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00015293184,0.00009396238,0.0030275148,0.0003486581,0.000109229804,0.00006530719,0.00042977906,0.3162465,0.001739083,0.5504649,0.0013606171,0.12596148],"study_design_scores_gemma":[0.00006268603,0.0002704497,0.0010082896,0.000083789,0.000036920726,0.00005359366,0.00006358059,0.77866125,0.0012247588,0.21543662,0.003053206,0.000044878965],"about_ca_topic_score_codex":0.0013636156,"about_ca_topic_score_gemma":0.0009023899,"teacher_disagreement_score":0.026922071,"about_ca_system_score_codex":0.0015539645,"about_ca_system_score_gemma":0.00259327,"threshold_uncertainty_score":0.14237922},"labels":[],"label_agreement":null},{"id":"W4310576792","doi":"10.1177/00491241221123088","title":"From Ends to Means: The Promise of Computational Text Analysis for Theoretically Driven Sociological Research","year":2022,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":34,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"","keywords":"Computer science; Skepticism; Field (mathematics); Relevance (law); Management science; Set (abstract data type); Computational model; Epistemology; Selection (genetic algorithm); Computational sociology; Data science; Process (computing); Sociology; Artificial intelligence; Political science","score_opus":0.4486729254285306,"score_gpt":0.6277772920025255,"score_spread":0.17910436657399492,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4310576792","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.011102605,0.009592866,0.8501857,0.07957366,0.0016229433,0.00039654906,0.00065047166,0.00069727143,0.046177976],"genre_scores_gemma":[0.19834,0.009189635,0.7763157,0.005223824,0.002626496,0.0016614893,0.00078656094,0.0008063406,0.0050499444],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.95196974,0.040012028,0.0012314615,0.0018979963,0.004534476,0.00035429272],"domain_scores_gemma":[0.64211494,0.3278784,0.0047164178,0.019193154,0.0045806016,0.0015165875],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.047725327,0.0013305816,0.0015621479,0.0073650302,0.004788702,0.025126962,0.004063154,0.0039947266,0.010974203],"category_scores_gemma":[0.15378138,0.00093454885,0.0015108688,0.0062463507,0.024531906,0.046403423,0.011692276,0.0089667225,0.0025589485],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000059551734,0.000041083505,0.0010593919,0.000638399,0.000059514263,0.00009275677,0.00741728,0.0015776976,0.0003419457,0.9248182,0.009976122,0.053918023],"study_design_scores_gemma":[0.000011334026,0.000009916401,0.00019881793,0.00033727774,0.000010117686,0.00006134162,0.0015065928,0.0053248443,0.00026545348,0.9622685,0.029972503,0.000033450116],"about_ca_topic_score_codex":0.0011731811,"about_ca_topic_score_gemma":0.0020033324,"teacher_disagreement_score":0.9522747,"about_ca_system_score_codex":0.003286366,"about_ca_system_score_gemma":0.005334416,"threshold_uncertainty_score":0.25239873},"labels":[],"label_agreement":null},{"id":"W4380046704","doi":"10.1177/00491241231176845","title":"Lagged Dependent Variable Predictors, Classical Measurement Error, and Path Dependency: The Conditions Under Which Various Estimators are Appropriate","year":2023,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"School Choice and Performance","field":"Social Sciences","cited_by":5,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"Western University","funders":"","keywords":"Estimator; Instrumental variable; Ordinary least squares; Statistics; Mathematics; Invariant estimator; Econometrics; Efficient estimator; Standard error; Least-squares function approximation; Consistency (knowledge bases); Minimum-variance unbiased estimator","score_opus":0.28849293208312177,"score_gpt":0.5023517921103442,"score_spread":0.21385886002722243,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4380046704","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.028333811,0.004313741,0.96084434,0.0025836984,0.00034409546,0.0002061882,0.0006708429,0.00023360128,0.0024697497],"genre_scores_gemma":[0.4519311,0.005966363,0.53250825,0.0014376226,0.0009763739,0.0013438285,0.0018375929,0.00028761488,0.0037112753],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.96815634,0.02451546,0.0017213519,0.0028132556,0.002236035,0.0005574952],"domain_scores_gemma":[0.7652132,0.2028863,0.013098165,0.011704125,0.0064606555,0.00063756964],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.070606485,0.000997104,0.0019241641,0.0023872023,0.00089554995,0.00301331,0.0025615457,0.0026954585,0.004743471],"category_scores_gemma":[0.27589768,0.00078612054,0.0019575804,0.0049383603,0.0028397497,0.006482389,0.0027187103,0.0031802258,0.00078599766],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00043848326,0.000158855,0.10093749,0.0016367899,0.001345365,0.0005941179,0.0012098273,0.055130158,0.0010784742,0.5495802,0.0087856045,0.27910465],"study_design_scores_gemma":[0.0002477777,0.00050302764,0.046895277,0.001962217,0.0007652249,0.0009284095,0.0012474346,0.3287949,0.004437915,0.5875527,0.026395837,0.00026927813],"about_ca_topic_score_codex":0.00246562,"about_ca_topic_score_gemma":0.0023426474,"teacher_disagreement_score":0.92939353,"about_ca_system_score_codex":0.0010687485,"about_ca_system_score_gemma":0.0022674182,"threshold_uncertainty_score":0.37340724},"labels":[],"label_agreement":null},{"id":"W4386245620","doi":"10.1177/00491241231192383","title":"Comparing Methods for Estimating Demographics in Racially Polarized Voting Analyses","year":2023,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Electoral Systems and Political Participation","field":"Social Sciences","cited_by":3,"is_retracted":false,"has_abstract":true,"route_ca_aff":false,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"","funders":"Social Sciences and Humanities Research Council of Canada","keywords":"Geocoding; Voting; Turnout; Bayesian probability; Demographics; Population; Race (biology); Econometrics; Inference; Causal inference; Statistics; Geography; Demography; Computer science; Political science; Mathematics; Sociology; Cartography; Artificial intelligence; Politics","score_opus":0.7717421973928245,"score_gpt":0.7209083247582806,"score_spread":0.050833872634543864,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4386245620","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.19789468,0.0019993014,0.78931296,0.0018147529,0.00028335123,0.00081174326,0.0011779371,0.00048124933,0.006224059],"genre_scores_gemma":[0.48641822,0.0006332741,0.5077069,0.00059566385,0.000118276366,0.0013635927,0.0014908669,0.00044147723,0.0012317607],"study_design_codex":"observational","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.84440476,0.13823219,0.0034201469,0.005785769,0.0071712155,0.0009859718],"domain_scores_gemma":[0.61078143,0.3412221,0.008460569,0.024646934,0.013822345,0.001066696],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.14808346,0.0011611107,0.0011034949,0.0046186675,0.0015294425,0.0038580326,0.0023014315,0.0020489292,0.0019650122],"category_scores_gemma":[0.35034057,0.0009888592,0.00232659,0.004267243,0.002513563,0.00360858,0.0047615226,0.002940371,0.0006880029],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.002324078,0.000462497,0.41599956,0.0014161231,0.008436647,0.0001537481,0.010440069,0.10587341,0.0034192696,0.11624011,0.006873025,0.32836142],"study_design_scores_gemma":[0.0005454969,0.0009419334,0.15977596,0.001187279,0.0014836679,0.00052274537,0.006313585,0.57658976,0.008055346,0.22176614,0.022312159,0.0005060065],"about_ca_topic_score_codex":0.011316496,"about_ca_topic_score_gemma":0.019216705,"teacher_disagreement_score":0.14808346,"about_ca_system_score_codex":0.0020076968,"about_ca_system_score_gemma":0.002666816,"threshold_uncertainty_score":0.7831496},"labels":[],"label_agreement":null},{"id":"W4401031998","doi":"10.1177/00491241241266634","title":"Promises and Limits of Using Targeted Social Media Advertising to Sample Global Migrant Populations: Nigerians at Home and Abroad","year":2024,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Migration, Ethnicity, and Economy","field":"Social Sciences","cited_by":6,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":true,"route_ca_venue":false,"route_about_ca":true,"ca_institutions":"Saint Mary's University; McGill University","funders":"Social Sciences and Humanities Research Council of Canada; Canada Research Chairs","keywords":"Nigerians; Sample (material); Advertising; Social media; Media use; Sociology; Demographic economics; Political science; Business; Psychology; Economics; Social psychology","score_opus":0.33410954546525834,"score_gpt":0.5486357934169476,"score_spread":0.21452624795168923,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4401031998","genre_codex":"empirical","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":"empirical","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.7260702,0.022351442,0.076538526,0.07885983,0.0033389018,0.006232582,0.0077529103,0.0002493959,0.07860624],"genre_scores_gemma":[0.8587576,0.007621503,0.09327792,0.018869752,0.0012187503,0.01307567,0.001932047,0.00012744262,0.005119285],"study_design_codex":"observational","study_design_gemma":"observational","domain_scores_codex":[0.88535225,0.09559164,0.005200182,0.0036784562,0.008042148,0.0021353983],"domain_scores_gemma":[0.7787584,0.13551609,0.020615973,0.030919192,0.029070344,0.00511995],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.15574822,0.0011408058,0.0010928893,0.003018387,0.0033247704,0.0058579445,0.003921836,0.0029846502,0.0036921424],"category_scores_gemma":[0.2300062,0.0010839981,0.0008766154,0.004077933,0.004293578,0.007648356,0.007000145,0.0029264798,0.0014739367],"study_design_candidate":"observational","study_design_consensus":"observational","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.00084819365,0.00070263026,0.60015625,0.0035294518,0.00079463463,0.000595957,0.06604451,0.0016643484,0.0022117118,0.018448813,0.01696486,0.2880387],"study_design_scores_gemma":[0.00021697857,0.0032040926,0.65631217,0.016353762,0.00082829595,0.0017791385,0.112894125,0.007560051,0.006825458,0.051155426,0.14244762,0.00042291786],"about_ca_topic_score_codex":0.022435177,"about_ca_topic_score_gemma":0.042977687,"teacher_disagreement_score":0.84425175,"about_ca_system_score_codex":0.0019018493,"about_ca_system_score_gemma":0.0046957596,"threshold_uncertainty_score":0.82368517},"labels":[],"label_agreement":null},{"id":"W4407112381","doi":"10.1177/00491241251314039","title":"When to Use Counterfactuals in Causal Historiography: Methods for Semantics and Inference","year":2025,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Qualitative Comparative Analysis Research","field":"Social Sciences","cited_by":1,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"McGill University","funders":"","keywords":"Counterfactual conditional; Causal inference; Historiography; Semantics (computer science); Inference; Econometrics; Computer science; Causal model; Epistemology; Linguistics; Counterfactual thinking; Statistics; Artificial intelligence; Mathematics; Programming language; Political science; Philosophy; Law","score_opus":0.6295248969421484,"score_gpt":0.7249763478686025,"score_spread":0.09545145092645413,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4407112381","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0029170495,0.0024472428,0.97374886,0.010831117,0.00036937854,0.00015604119,0.00014952022,0.00031359392,0.009067169],"genre_scores_gemma":[0.17857209,0.0020603058,0.8114648,0.0018900561,0.00060208375,0.0013076114,0.0002654868,0.0005520952,0.0032855812],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.9536776,0.037590448,0.0020535735,0.0030776146,0.0029575715,0.00064326404],"domain_scores_gemma":[0.8723138,0.10206456,0.0037867338,0.01739892,0.0034050422,0.001030926],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.08119246,0.0017065216,0.0027440602,0.0069911787,0.003778268,0.016241796,0.0047914665,0.006171463,0.00907598],"category_scores_gemma":[0.16365196,0.0016735188,0.00391887,0.005831581,0.038083013,0.044983976,0.0076966556,0.012947539,0.0020807825],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000018448809,0.0000140180055,0.0002719062,0.00007597339,0.00003543768,0.000039384944,0.001704005,0.0007761926,0.000054252465,0.9837054,0.00081259967,0.012492325],"study_design_scores_gemma":[0.000011187374,0.0000033847648,0.000029268727,0.00007249408,0.000007840657,0.000019547351,0.00020749224,0.0022481147,0.00011464777,0.99248075,0.0047939937,0.0000111989775],"about_ca_topic_score_codex":0.00416966,"about_ca_topic_score_gemma":0.0030108886,"teacher_disagreement_score":0.9188075,"about_ca_system_score_codex":0.004254886,"about_ca_system_score_gemma":0.003492439,"threshold_uncertainty_score":0.42939192},"labels":[],"label_agreement":null},{"id":"W4410554739","doi":"10.1177/00491241251339188","title":"Updating “The Future of Coding”: Qualitative Coding with Generative Large Language Models","year":2025,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Computational and Text Analysis Methods","field":"Social Sciences","cited_by":27,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of British Columbia","funders":"Russell Sage Foundation","keywords":"Coding (social sciences); Generative grammar; Computer science; Natural language processing; Linguistics; Qualitative research; Artificial intelligence; Sociology; Social science","score_opus":0.2818745422435381,"score_gpt":0.6225325648240265,"score_spread":0.34065802258048844,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4410554739","genre_codex":"methods","genre_gemma":"empirical","domain_codex":null,"domain_gemma":"methods","model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"empirical","genre_consensus":null,"domain_candidate":"methods","domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.013570337,0.00048650499,0.9591738,0.0150591545,0.0005261713,0.0005324371,0.0007495381,0.0008488533,0.0090532135],"genre_scores_gemma":[0.26039404,0.0005273927,0.72806484,0.0037896882,0.00019456912,0.0027355754,0.00077858864,0.0011223872,0.0023928918],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"simulation_or_modeling","domain_scores_codex":[0.79852194,0.17828849,0.0042303666,0.007846711,0.010018296,0.0010941626],"domain_scores_gemma":[0.48587582,0.38830906,0.014182528,0.07850019,0.030917224,0.0022152774],"candidate_categories":["metaresearch"],"consensus_categories":[],"category_scores_codex":[0.1450383,0.0014232078,0.00096254126,0.0040986715,0.004843164,0.0121858185,0.0049872175,0.0027984455,0.009748672],"category_scores_gemma":[0.44464272,0.0015567829,0.001525877,0.004195776,0.026945742,0.024387859,0.010678987,0.0067634475,0.0026235436],"study_design_candidate":"simulation_or_modeling","study_design_consensus":null,"about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.0001875412,0.000070704875,0.004540558,0.00127844,0.00009679854,0.00019573024,0.13612004,0.006370578,0.001849917,0.7195998,0.014411542,0.11527831],"study_design_scores_gemma":[0.00007219223,0.00003979199,0.00080979837,0.0015922155,0.000037388458,0.00017526568,0.018668812,0.03233928,0.0029460217,0.8712533,0.071906276,0.00015968915],"about_ca_topic_score_codex":0.006793946,"about_ca_topic_score_gemma":0.008921273,"teacher_disagreement_score":0.8549617,"about_ca_system_score_codex":0.0102128135,"about_ca_system_score_gemma":0.014738672,"threshold_uncertainty_score":0.767045},"labels":[],"label_agreement":null},{"id":"W4414803296","doi":"10.1177/00491241251358895","title":"Beyond the Diagonal Reference Model: Critiques and New Directions in the Analysis of Mobility Effects","year":2025,"lang":"en","type":"article","venue":"Sociological Methods & Research","topic":"Intergenerational and Educational Inequality Studies","field":"Social Sciences","cited_by":0,"is_retracted":false,"has_abstract":true,"route_ca_aff":true,"route_ca_fund":false,"route_ca_venue":false,"route_about_ca":false,"ca_institutions":"University of Toronto","funders":"","keywords":"Identification (biology); Diagonal; Bounding overwatch; Sign (mathematics); Social mobility; Mobility model","score_opus":0.46987687223096936,"score_gpt":0.6426193233113723,"score_spread":0.17274245108040293,"validation_status":"score_only:v0-immature-baseline","prediction":{"id":"W4414803296","genre_codex":"methods","genre_gemma":"methods","domain_codex":null,"domain_gemma":null,"model_version":"metacan-v3-hybrid-931329e0061c","genre_candidate":"methods","genre_consensus":"methods","domain_candidate":null,"domain_consensus":null,"prediction_status":"machine_predicted_unvalidated","genre_scores_codex":[0.0064621754,0.010902976,0.9031532,0.053595487,0.00060259283,0.000095109004,0.00041520718,0.00027927605,0.024493966],"genre_scores_gemma":[0.59299266,0.027169745,0.3361018,0.016424127,0.0063593495,0.0013414968,0.00075762527,0.00082151336,0.018031675],"study_design_codex":"theoretical_or_conceptual","study_design_gemma":"theoretical_or_conceptual","domain_scores_codex":[0.958721,0.029298915,0.0015382089,0.0037854388,0.0060321833,0.0006243452],"domain_scores_gemma":[0.8102613,0.16893458,0.0045006657,0.010789968,0.00472195,0.0007915908],"candidate_categories":[],"consensus_categories":[],"category_scores_codex":[0.06010138,0.0016739364,0.0035036085,0.0042192447,0.0019034287,0.0057201926,0.009335022,0.0041524447,0.010287748],"category_scores_gemma":[0.14504042,0.001111153,0.0036878877,0.0056393356,0.018724067,0.01335352,0.0064810314,0.010132798,0.0020381187],"study_design_candidate":"theoretical_or_conceptual","study_design_consensus":"theoretical_or_conceptual","about_ca_topic_candidate":false,"about_ca_topic_consensus":false,"about_ca_system_candidate":false,"about_ca_system_consensus":false,"study_design_scores_codex":[0.000006641344,0.000016856984,0.000532131,0.00012171328,0.000041950694,0.00003397261,0.00029721338,0.0025004053,0.000014619284,0.98467225,0.0016693353,0.01009297],"study_design_scores_gemma":[0.000008037627,0.000009325571,0.00023411473,0.00009976585,0.000011586398,0.000025207346,0.0001323248,0.010196297,0.000031612573,0.98375136,0.005489936,0.000010382415],"about_ca_topic_score_codex":0.011990459,"about_ca_topic_score_gemma":0.0069264164,"teacher_disagreement_score":0.06010138,"about_ca_system_score_codex":0.0042203306,"about_ca_system_score_gemma":0.003940622,"threshold_uncertainty_score":0.31785023},"labels":[],"label_agreement":null}]}